OpenAI 推出 Learning Outcomes Measurement Suite,评估 AI 对学生学习的影响
OpenAI 推出 Learning Outcomes Measurement Suite,用于评估 AI 对学生学习成效的影响。该工具套件面向多样化教育环境,可长期衡量 AI 在学习中的作用。
OpenAI 推出 Learning Outcomes Measurement Suite,用于评估 AI 对学生学习成效的影响。该工具套件面向多样化教育环境,可长期衡量 AI 在学习中的作用。
Amazon Bedrock 推出 Stateful Runtime for Agents,为多步骤 AI 工作流提供持久编排、记忆和安全执行能力。该运行时由 OpenAI 模型驱动,可支持跨步骤保持状态的智能体应用。
OpenAI 公布心理健康安全工作的多项更新,包括家长控制、可信联系人功能以及改进的心理困扰检测能力。公司同时提及近期相关诉讼的进展情况。
Google DeepMind 发布 Nano Banana 2(Gemini 3.1 Flash Image),以 Flash 速度提供 Pro 级世界知识、精准文本渲染、最多 5 个角色的主体一致性和 512px 到 4K 的生产级规格。
推荐理由:官方公告列出了能力细节、订阅者保留路径和各产品开放范围,读者可据此判断是否切换工作流。
OpenAI 与 Figma 推出新的 Codex 集成,打通代码与设计。该集成让团队可以在代码实现与 Figma 画布之间直接切换,从而更快地迭代和交付产品。
Google DeepMind 在 Gemini 应用中以 beta 形式上线最新音乐生成模型 Lyria 3,用户输入文字或上传照片即可生成 30 秒带歌词曲目。
推荐理由:官方介绍了 Lyria 3 的三项能力改进和 SynthID 音频验证入口,读者可据此了解 Gemini 音乐生成与识别 AI 内容的新玩法。
OpenAI 在 ChatGPT 中推出 Lockdown Mode 和 Elevated Risk 风险标签,帮助组织防御提示词注入和 AI 驱动的数据外泄。
OpenAI 介绍其构建的实时访问系统,结合速率限制、用量追踪和 credits,为 Sora 和 Codex 提供持续访问能力。材料仅提供摘要,未包含更多细节。
OpenAI for Government 宣布在 GenAI.mil 上部署定制版 ChatGPT,为美国国防团队提供安全、注重安全性的 AI 能力。
Hugging Face 发布 Transformers.js v4,已可在 NPM 安装,核心变化是采用 C++ 重写的 WebGPU Runtime,同一套代码可运行于浏览器、Node、Bun 和 Deno。
推荐理由:官方发布说明完整列出 WebGPU 运行时重写、新架构支持和构建性能数据,读者可评估在浏览器或服务端本地跑模型的可行性。
OpenAI 介绍了其 AI 本地化方法,说明全球共享的前沿模型如何在不牺牲安全性的前提下适配当地语言、法律和文化。
SyGra 2.0.0 引入交互式环境 Studio,让用户在画布上可视化编排合成数据生成流程,替代 YAML 文件和终端操作。
OpenAI 的 GPT-5 与 Ginkgo Bioworks 的云自动化平台结合,组成自主实验室,通过闭环实验将无细胞蛋白质合成成本降低了 40%。
OpenAI 推出 Trusted Access for Cyber,这是一个基于信任的框架,在扩展前沿网络安全能力访问的同时,强化防止滥用的安全防护措施。
Google 提出原生自适应界面(NAI)框架,用多模态 AI 让应用 UI 从静态导航转向智能体驱动的动态模块,服务全球 13 亿残障人士。
OpenAI 推出 OpenAI Frontier,一个面向企业的 AI 智能体平台,支持构建、部署和管理智能体。平台提供共享上下文、员工入驻、权限管理和治理功能。
OpenAI 介绍 Codex App Server,这是一个双向 JSON-RPC API,用于嵌入 Codex 智能体。该 API 支持流式进度、工具调用、审批和 diffs。
Hugging Face 在 Hub 上推出 Community Evals 功能,评测数据集(MMLU-Pro、GPQA、HLE 已上线)可托管排行榜,模型分数存于模型仓库的 .eval_results/*.yaml 并展示在 Model Card 上。
OpenAI 阐述了 Sora 信息流的设计理念:通过个性化推荐激发创作、促进连接,同时保障使用安全。平台配备家长控制和严格的防护机制,让用户体验在创造力与安全之间保持平衡。
OpenAI 发布面向 macOS 的 Codex app,定位为 AI 编码与软件开发的指挥中心。它支持多个智能体协作、并行工作流和长时间运行的任务。
推荐理由:官方介绍 macOS 版 Codex app 的定位,涵盖多智能体、并行工作流和长时任务,可帮助读者判断它与现有编码工具的关系。
Google DeepMind 推出实验原型 Project Genie,即日起向美国 18 岁以上的 Google AI Ultra 订阅用户开放。
推荐理由:原文给出了 Project Genie 的三项核心能力、底层模型和明确的限制清单,读者可以据此判断世界模型的当前可用边界。
OpenAI 自研了一款内部 AI 数据智能体,结合 GPT-5、Codex 和记忆机制,对海量数据集进行推理,可在几分钟内输出可靠的数据洞察。
OpenAI 说明了其内置防护机制如何在 AI 智能体打开链接时保护用户数据,防范基于 URL 的数据外泄与提示词注入攻击。
Mistral 发布 Mistral Vibe 2.0,升级其终端原生编码智能体,由 Devstral 2 模型家族驱动,新增自定义 subagent、多选澄清、斜杠命令技能和统一 agent 模式,CLI 持续自动更新。
推荐理由:官方公布 Vibe 2.0 的新增控制能力与 Devstral 2 转付费后的具体价格,读者可据此评估团队编码工作流的成本与用法。
TRUSTBANK 与 Recursive 合作,基于 OpenAI 模型构建 Choice AI,通过个性化对话式推荐简化故乡纳税(Furusato Nozei)礼物的查找。
OpenAI 推出免费的 LaTeX 原生工作台 Prism,内置 GPT-5.2。产品面向研究人员,支持在同一处完成写作、协作和推理。
Indeed CRO Maggie Hulce 介绍了 AI 如何改变求职招聘流程,帮助雇主和求职者完成招聘与人才获取。
Praktika 基于 GPT-4.1 和 GPT-5.2 构建自适应 AI 导师,通过对话方式实现个性化课程与学习进度追踪。这些智能体帮助学习者达成真实场景中的语言流利度。
OpenAI 推出 Edu for Countries 新计划,帮助各国政府利用 AI 现代化教育系统并培养面向未来的劳动力。
ServiceNow 扩大对 OpenAI 前沿模型的接入,在 ServiceNow Platform 上驱动 AI 企业工作流。这些模型将支持摘要、搜索和语音等能力,帮助企业实现 AI 驱动的业务流程。
OpenAI 正在 ChatGPT 中推出年龄预测,用于估计账户用户是否年满 18 岁。系统会对疑似未成年用户施加青少年保护措施,并随时间推移持续提升预测准确率。
OpenAI 宣布 ChatGPT Go 在全球范围内开放。该方案提供更多 GPT-5.2 Instant 访问权限、更高的使用上限和更长的记忆,旨在让先进 AI 更具可负担性。
Hugging Face 发布开放推理标准 Open Responses,扩展并开源 OpenAI 的 Responses API,面向 Agent 时代的推理需求。
Google DeepMind 更新 Veo 3.1 Ingredients to Video,提升基于参考图生成视频的表现力、角色身份一致性和背景与对象一致性。
Datadog 使用 OpenAI 的 Codex 对系统级代码进行审查。目前公开信息仅包含 OpenAI 与 Datadog 的品牌联合图片及该合作用途,具体实施细节与效果数据尚未公布。
OpenAI 推出 OpenAI for Healthcare,提供支持 HIPAA 合规的企业级安全 AI 服务。该方案旨在减轻医疗机构的行政负担并支持临床工作流程。
Tolan 基于 GPT-5.1 构建了语音优先的 AI 伴侣。它结合低延迟响应、实时上下文重建和基于记忆的个性化,实现自然对话。
OpenAI 推出 ChatGPT Health,一个专注健康领域的专属体验,可安全连接用户的健康数据和应用,并配备隐私保护机制。该产品采用由医生参与指导的设计。
OpenAI Grove 第二期开放申请,这是一个为期 5 周、面向从想法前到产品各阶段个人的创始人计划。参与者可获得 5 万美元 API 额度、AI 工具早期访问权限,以及 OpenAI 团队的实战指导。
OpenAI 发布新的 AI 素养资源,帮助青少年和家长审慎、安全、有信心地使用 ChatGPT。这些指南包含经专家审核的建议,涵盖负责任使用、批判性思维、健康边界,以及如何支持遇到情绪化或敏感话题的青少年。