Together AI 与 Hugging Face 集成,Hub 上兼容 LLM 可直接微调
Together AI 与 Hugging Face 宣布新功能,Hub 上任何兼容 LLM 都可用 Together 基础设施微调。
Together AI 与 Hugging Face 宣布新功能,Hub 上任何兼容 LLM 都可用 Together 基础设施微调。
OpenAI 推出 Jobs Platform 和新的 Certifications,帮助劳动者对接工作、培训与认证机会。两项举措旨在扩大经济机会,让 AI 技能更容易获得。
Mistral 为 Le Chat 推出 Memories(beta)记忆功能,采用自动保存与智能、可见召回的混合方案。功能遵循透明、可控、主权三原则,用户可随时关闭记忆、开启隐身聊天、编辑或删除单条记忆,并支持导出导入;还提供 Memory Insights 轻量提示帮助探索记忆内容,移动端可在 App Store 或 Google Play 下载体验。
OpenAI 宣布与专家合作,进一步优化 ChatGPT 的用户体验。新措施包括为青少年强化保护、增加家长控制功能,并将敏感对话路由至 ChatGPT 中的推理模型处理。
Mistral AI 在 Le Chat 中推出 20+ 个安全 MCP 连接器(beta)和 Memories 记忆功能(beta)。
OpenAI 发布更先进的语音到语音模型 gpt-realtime,并更新 Realtime API。新能力包括 MCP server 支持、图像输入和 SIP 电话呼叫支持。
推荐理由:官方公布了语音到语音模型与 API 能力更新,读者可据此了解语音方向的新入口。
OpenAI 在全球调研了超过 1,000 人对 AI 应有行为方式的看法,并将其与 Model Spec 进行对比。这一“集体对齐”方式正用于塑造 AI 默认行为,使其更好反映多元的人类价值观与观点。
Arm 宣布 ExecuTorch 0.7 beta 中 KleidiAI 默认启用,为 Arm CPU 设备带来自动加速,无需开发者改代码。
Basis 基于 OpenAI o3、o3-Pro、GPT-4.1 和 GPT-5 构建的 AI 智能体,帮助会计师事务所节省多达 30% 的时间。释放的产能可用于拓展咨询业务与业务增长。
Hugging Face 发布开源无代码工具 AI Sheets,用于以电子表格方式构建、转换和增强数据集,可本地部署或在 Hub 上免费试用,支持通过 Inference Providers 调用 Hub 上数千个开放模型(含 OpenAI 的 gpt-oss)。
推荐理由:官方发布的无代码数据处理工具,原文说明了用提示词建列、few-shot 反馈和 LLM 评审等玩法,读者可判断是否引入自己的数据流程。
GPT-5 为编码与设计带来了新的可能性。OpenAI 介绍了如何利用 GPT-5 在这两个领域开展相关工作,展示其在编程和设计任务上的能力。
OpenAI 介绍了 GPT-5 在医学研究中的应用方式。正文仅简要说明 GPT-5 被用于医学研究,未给出具体模型参数、benchmark 分数或价格等细节。
OpenAI 发布文章介绍 Cursor 如何使用 GPT-5。原文仅说明“了解 Cursor 如何使用 GPT-5”,未提供更多细节。
OpenAI 阐述了 ChatGPT 的优化方向:在困难时刻为用户提供更好支持,已推出休息提醒功能,并在专家指导下改进生活建议方面的表现。
OpenAI 在 ChatGPT 中推出 study mode,一种全新学习体验。它通过提问、脚手架式引导和反馈,帮助学生一步步解决问题,实现更深入的学习。
Hugging Face 发布开源免费的实验跟踪 Python 库 Trackio,提供本地 Gradio 仪表盘并可同步到 Hugging Face Spaces 通过 URL 分享。
推荐理由:官方开源免费的实验跟踪库,兼容 wandb API 可零成本迁移,并支持 Spaces 分享,训练指标记录门槛更低。
Hugging Face 官方宣布 CLI 从 huggingface-cli 更名为 hf,命令重组为 hf <resource> <action> 的统一格式,认证命令归入 hf auth,旧命令仍可用但会提示弃用。
OpenAI 与 Penda Health 推出 AI 临床助手,在真实使用中将诊断错误减少 16%,为安全有效的医疗 AI 应用提供了新路径。
NVIDIA NIM 推出单一 Docker 容器,可在 Hugging Face 上快速部署超过 100,000 个 LLM。容器会自动识别模型格式、架构与量化方式(如 FP16、FP8、GGUF、AWQ),并从 NVIDIA TensorRT-LLM、vLLM 和 SGLang 中选择推理后端,无需手动配置。
Mistral 为 Le Chat 推出一批新功能,包括预览版 Deep Research 研究报告模式、基于 Voxtral 模型的语音模式、由 Magistral 驱动的多语言推理 Think 模式、按上下文组织对话的 Projects,以及与 Black Forest Labs 合作的高级图像编辑。新功能已在 chat.mistral.ai 和移动应用开放使用,无需信用卡。
OpenAI 发布 ChatGPT agent 的 System Card,介绍其将研究、浏览器自动化和代码工具整合为一的智能体能力。安全防护措施依据 Preparedness Framework 设置。
推荐理由:官方系统卡说明 ChatGPT agent 如何把研究、浏览器操作与代码工具合一,并给出安全防护框架,可作为能力与风险参考。
OpenAI 发布 ChatGPT agent,能边思考边行动,借助工具完成任务。官方称其可在用户引导下完成调研、预订和制作幻灯片等工作。
推荐理由:OpenAI 官方宣布 ChatGPT agent 上线,读者可以了解其边思考边行动、借助工具完成任务的产品定位。
Invideo AI 使用 OpenAI 的 GPT-4.1、gpt-image-1 和 text-to-speech 模型,将创意构思转化为专业视频,速度提升 10 倍,几分钟即可完成。
OpenAI Academy 联合 Walton Family Foundation、Emerson Collective 及本地非营利组织网络,举办为期一天的 Nonprofit Jam 活动。该活动为全国性线下活动,将在 10 个地点汇集超过 1,000 名非营利组织负责人,帮助社区一线组织者解决实际问题。
Gradio 团队宣布截至 5.38.0 版本的五项 MCP 服务器改进:新增 File Upload MCP 服务器让智能体直接向 Gradio 应用上传本地文件。
Hugging Face 发布官方 MCP Server 并撰文复盘其构建过程,通过一个 URL 提供可定制的 Hub 工具接入和数千个 Spaces 应用访问。
推荐理由:官方团队复盘自建 MCP Server 的传输选型与部署权衡,涵盖 Streamable HTTP、无状态配置等可迁移经验。
Hugging Face 发布 Python 库 ScreenEnv,可在 Docker 容器中创建隔离的 Ubuntu 桌面环境,用于测试和部署 GUI 智能体(Computer Use agents)。
推荐理由:原文给出在 Docker 中运行隔离 Ubuntu 桌面环境的用法和 API 与 MCP 两种接入方式,读者可直接复用搭建 GUI 智能体。
Hugging Face 与 Pollen Robotics 发布开源桌面机器人 Reachy Mini,面向人机交互、创意编程与 AI 实验,提供 $399 的 Lite 版和 $499 的无线自主版(含树莓派 4 与电池)。
Mistral AI 宣布推出 AI for Citizens 合作计划,帮助各国政府和公共机构战略性地利用 AI 转型公共服务、催化创新并确保竞争力,已与法国、卢森堡、新加坡、荷兰、英国、瑞士等国家和地区的政府、国防力量、公共部门机构和教育机构展开合作。
Genspark 基于 GPT-4.1 和 OpenAI Realtime API 构建了无代码个人智能体产品,在 45 天内实现 3600 万美元 ARR。
Retell AI 基于 GPT-4o 和 GPT-4.1 打造无代码语音自动化平台,帮助企业上线实时自然的语音智能体,自动化客户通话。该方案可降低通话成本、提升 CSAT,且无需脚本和等待时间。
AI GTM 平台 Unify 使用 OpenAI 的 o3、GPT-4.1 和 CUA 自动化客户拓潜、调研与外联。借助超个性化消息和全天候工作流,Unify 帮助销售团队规模化生成销售管道,同时专注于高价值的客户互动。
SGLang 现已支持 Hugging Face transformers 作为推理后端,任何 transformers 兼容模型可开箱获得高性能推理。
OpenAI 推出 OpenAI for Government,一项面向美国公务员提供最先进 AI 工具的新计划。该计划支持美国政府采用一流技术,并将这些工具用于公共服务。
Hugging Face 宣布 Groq 成为 Hub 上的 Inference Provider,可直接在模型页和 JS、Python 客户端 SDK 中调用 Groq 托管的开源模型,包括 Meta 的 Llama 4 和 Qwen 的 QWQ-32B。
Hugging Face 官方博客介绍 Kernel Hub,开发者可通过 kernels 库的 get_kernel 一行代码加载预编译的优化计算内核,自动匹配 Python、PyTorch 和 CUDA 版本。
推荐理由:原文给出从加载到基准测试的完整可复现步骤,读者可据此评估把优化内核接入自己模型的实际收益。
Featherless AI 成为 Hugging Face Hub 支持的 Inference Provider,用户可在模型页面直接使用其 serverless 推理服务。
Mistral AI 发布 Mistral Compute,向客户提供私有集成 AI 基础设施,涵盖 GPU、编排、API、产品和服务,形态从裸金属服务器到全托管 PaaS。作为 NVIDIA 合作伙伴,初期提供数万块 GPU 并计划快速扩张,面向欧洲、中东、亚洲及南半球的主权、企业和研究机构,强调数据主权、欧洲合规与脱碳能源,已有 Orange、BNP Paribas、Thales 等启动伙伴。
Hugging Face 与 NVIDIA 在 GTC Paris 上宣布推出 Training Cluster as a Service,让全球研究机构可按需申请 GPU 集群并只为训练运行时长付费。
Mistral 发布 Mistral Code,一款面向企业开发团队的 AI 编程助手,基于开源项目 Continue 打造,今日面向 JetBrains IDE 和 VSCode 开放 private beta,GA 即将推出。