Transformers.js v4 登陆 NPM,新增 WebGPU 运行时与众多新模型
Hugging Face 发布 Transformers.js v4,已可在 NPM 安装,核心变化是采用 C++ 重写的 WebGPU Runtime,同一套代码可运行于浏览器、Node、Bun 和 Deno。
推荐理由:官方发布说明完整列出 WebGPU 运行时重写、新架构支持和构建性能数据,读者可评估在浏览器或服务端本地跑模型的可行性。
Hugging Face 发布 Transformers.js v4,已可在 NPM 安装,核心变化是采用 C++ 重写的 WebGPU Runtime,同一套代码可运行于浏览器、Node、Bun 和 Deno。
推荐理由:官方发布说明完整列出 WebGPU 运行时重写、新架构支持和构建性能数据,读者可评估在浏览器或服务端本地跑模型的可行性。
OpenAI 介绍了其 AI 本地化方法,说明全球共享的前沿模型如何在不牺牲安全性的前提下适配当地语言、法律和文化。
SyGra 2.0.0 引入交互式环境 Studio,让用户在画布上可视化编排合成数据生成流程,替代 YAML 文件和终端操作。
OpenAI 的 GPT-5 与 Ginkgo Bioworks 的云自动化平台结合,组成自主实验室,通过闭环实验将无细胞蛋白质合成成本降低了 40%。
OpenAI 推出 Trusted Access for Cyber,这是一个基于信任的框架,在扩展前沿网络安全能力访问的同时,强化防止滥用的安全防护措施。
Google 提出原生自适应界面(NAI)框架,用多模态 AI 让应用 UI 从静态导航转向智能体驱动的动态模块,服务全球 13 亿残障人士。
OpenAI 推出 OpenAI Frontier,一个面向企业的 AI 智能体平台,支持构建、部署和管理智能体。平台提供共享上下文、员工入驻、权限管理和治理功能。
OpenAI 介绍 Codex App Server,这是一个双向 JSON-RPC API,用于嵌入 Codex 智能体。该 API 支持流式进度、工具调用、审批和 diffs。
Hugging Face 在 Hub 上推出 Community Evals 功能,评测数据集(MMLU-Pro、GPQA、HLE 已上线)可托管排行榜,模型分数存于模型仓库的 .eval_results/*.yaml 并展示在 Model Card 上。
Google Research 宣布与 Included Health 合作,待 IRB 批准后启动一项全国范围、经参与者知情同意的随机对照研究,在真实虚拟诊疗流程中评估其对话式 AI。研究基于 AMIE 诊断推理、个人健康智能体(PHA)和信息导航等前期工作,此前与 Beth Israel Deaconess Medical Center 的单中心可行性研究已观察到安全性方面的积极迹象。
OpenAI 阐述了 Sora 信息流的设计理念:通过个性化推荐激发创作、促进连接,同时保障使用安全。平台配备家长控制和严格的防护机制,让用户体验在创造力与安全之间保持平衡。
OpenAI 发布面向 macOS 的 Codex app,定位为 AI 编码与软件开发的指挥中心。它支持多个智能体协作、并行工作流和长时间运行的任务。
推荐理由:官方介绍 macOS 版 Codex app 的定位,涵盖多智能体、并行工作流和长时任务,可帮助读者判断它与现有编码工具的关系。
Google DeepMind 推出实验原型 Project Genie,即日起向美国 18 岁以上的 Google AI Ultra 订阅用户开放。
推荐理由:原文给出了 Project Genie 的三项核心能力、底层模型和明确的限制清单,读者可以据此判断世界模型的当前可用边界。
OpenAI 自研了一款内部 AI 数据智能体,结合 GPT-5、Codex 和记忆机制,对海量数据集进行推理,可在几分钟内输出可靠的数据洞察。
Hugging Face Gradio 团队发布开源 Python 库 Daggr(beta,当前版本 0.4.3),用几行代码把 Gradio Spaces、ML 模型和自定义函数连接成 AI 工作流,并自动生成可视化画布。
推荐理由:Gradio 团队介绍用代码定义 AI 工作流并自动生成可视化画布,可单步检查和重跑,适合在重编排平台和脆弱脚本之外多一个实验选择。
大成建设(Taisei Corporation)人力资源团队主导在全公司推行 ChatGPT Enterprise,以 AI 驱动的人才培养。该部署旨在推动组织范围内的 AI 赋能人才发展。
OpenAI 说明了其内置防护机制如何在 AI 智能体打开链接时保护用户数据,防范基于 URL 的数据外泄与提示词注入攻击。
Mistral 发布 Mistral Vibe 2.0,升级其终端原生编码智能体,由 Devstral 2 模型家族驱动,新增自定义 subagent、多选澄清、斜杠命令技能和统一 agent 模式,CLI 持续自动更新。
推荐理由:官方公布 Vibe 2.0 的新增控制能力与 Devstral 2 转付费后的具体价格,读者可据此评估团队编码工作流的成本与用法。
TRUSTBANK 与 Recursive 合作,基于 OpenAI 模型构建 Choice AI,通过个性化对话式推荐简化故乡纳税(Furusato Nozei)礼物的查找。
OpenAI 推出免费的 LaTeX 原生工作台 Prism,内置 GPT-5.2。产品面向研究人员,支持在同一处完成写作、协作和推理。
Indeed CRO Maggie Hulce 介绍了 AI 如何改变求职招聘流程,帮助雇主和求职者完成招聘与人才获取。
Praktika 基于 GPT-4.1 和 GPT-5.2 构建自适应 AI 导师,通过对话方式实现个性化课程与学习进度追踪。这些智能体帮助学习者达成真实场景中的语言流利度。
创作平台 Higgsfield 借助 OpenAI 的 GPT-4.1、GPT-5 和 Sora 2,让创作者用简单的输入生成电影质感、面向社交平台的视频。该方案面向内容创作者,降低了影视化视频制作的门槛。
OpenAI 推出 Edu for Countries 新计划,帮助各国政府利用 AI 现代化教育系统并培养面向未来的劳动力。
ServiceNow 扩大对 OpenAI 前沿模型的接入,在 ServiceNow Platform 上驱动 AI 企业工作流。这些模型将支持摘要、搜索和语音等能力,帮助企业实现 AI 驱动的业务流程。
OpenAI 正在 ChatGPT 中推出年龄预测,用于估计账户用户是否年满 18 岁。系统会对疑似未成年用户施加青少年保护措施,并随时间推移持续提升预测准确率。
OpenAI 宣布 ChatGPT Go 在全球范围内开放。该方案提供更多 GPT-5.2 Instant 访问权限、更高的使用上限和更长的记忆,旨在让先进 AI 更具可负担性。
Hugging Face 发布开放推理标准 Open Responses,扩展并开源 OpenAI 的 Responses API,面向 Agent 时代的推理需求。
Google DeepMind 更新 Veo 3.1 Ingredients to Video,提升基于参考图生成视频的表现力、角色身份一致性和背景与对象一致性。
Datadog 使用 OpenAI 的 Codex 对系统级代码进行审查。目前公开信息仅包含 OpenAI 与 Datadog 的品牌联合图片及该合作用途,具体实施细节与效果数据尚未公布。
OpenAI 推出 OpenAI for Healthcare,提供支持 HIPAA 合规的企业级安全 AI 服务。该方案旨在减轻医疗机构的行政负担并支持临床工作流程。
Tolan 基于 GPT-5.1 构建了语音优先的 AI 伴侣。它结合低延迟响应、实时上下文重建和基于记忆的个性化,实现自然对话。
OpenAI 推出 ChatGPT Health,一个专注健康领域的专属体验,可安全连接用户的健康数据和应用,并配备隐私保护机制。该产品采用由医生参与指导的设计。
OpenAI Grove 第二期开放申请,这是一个为期 5 周、面向从想法前到产品各阶段个人的创始人计划。参与者可获得 5 万美元 API 额度、AI 工具早期访问权限,以及 OpenAI 团队的实战指导。
OpenAI 正利用基于强化学习训练的自动化红队持续加固 ChatGPT Atlas,对抗提示词注入攻击。这种主动的"发现—修补"循环可提前识别新型攻击手法,随着 AI 越来越智能体化,不断强化该浏览器智能体的防御能力。
OpenAI 发布新的 AI 素养资源,帮助青少年和家长审慎、安全、有信心地使用 ChatGPT。这些指南包含经专家审核的建议,涵盖负责任使用、批判性思维、健康边界,以及如何支持遇到情绪化或敏感话题的青少年。
OpenAI 联合 American Journalism Project 和 The Lenfest Institute 推出 OpenAI Academy for News Organizations 学习中心,帮助新闻编辑室有效使用 AI。该学院提供培训、实际用例和负责任使用指南,支持记者、编辑和出版商在报道与运营中采用 AI。
OpenAI 宣布开发者现在可以提交应用供审核并发布到 ChatGPT,通过审核的应用将出现在新的产品内目录中便于发现。更新的工具、指南和 Apps SDK 帮助开发者构建聊天原生体验,将现实世界操作带入 ChatGPT。
推荐理由:官方宣布 ChatGPT 开放应用提交通道和新目录,开发者可据此了解应用上架流程与 Apps SDK 支持情况。
Google DeepMind 发布开源可解释性工具套件 Gemma Scope 2,覆盖 Gemma 3 从 270M 到 27B 的全部模型尺寸,结合稀疏自编码器(SAE)与 transcoder 分析模型内部行为。
OpenAI 宣布推出更快的 ChatGPT Images 体验,并在 API 中发布 GPT-Image-1.5。用户可在 ChatGPT 中体验最新的 ChatGPT Images 2.5。
推荐理由:官方公告点明 ChatGPT Images 更快的新体验和 GPT-Image-1.5 进入 API,读者可据此了解这轮图像功能更新的范围。