OpenAI Codex 面向团队推出更灵活的按量付费定价
OpenAI 的 Codex 为 ChatGPT Business 和 Enterprise 用户新增按量付费定价,为团队提供更灵活的采用与扩展方式。此前团队用户只能按固定套餐使用,新模式可帮助团队从少量使用起步并随需求增长扩大规模。
OpenAI 的 Codex 为 ChatGPT Business 和 Enterprise 用户新增按量付费定价,为团队提供更灵活的采用与扩展方式。此前团队用户只能按固定套餐使用,新模式可帮助团队从少量使用起步并随需求增长扩大规模。
Gradient Labs 基于 GPT-4.1 和 GPT-5.4 mini、nano 构建 AI 智能体,为每位银行客户提供 AI 客户经理,自动化银行支持工作流程。该方案具备低延迟和高可靠性。
Hugging Face 发布 gradio.Server,一个扩展自 FastAPI 的类,让开发者用 React、Svelte 或原生 HTML/JS 等任意前端框架,同时保留 Gradio 的排队、并发管理、SSE 流式、gradio_client 兼容和 Spaces 上的 ZeroGPU 支持。
推荐理由:官方介绍了 gradio.Server 如何让任意自定义前端继续复用 Gradio 的排队、MCP 和 ZeroGPU 能力,并附完整代码示例。
Mistral AI 发布面向人类开发者和 Agent 的 Spaces CLI,三条命令即可从零搭建带热重载、数据库和生成 Dockerfile 的多服务项目并部署。
推荐理由:Mistral 以自家 CLI 为例,总结了一套让同一工具同时服务人类与 Agent 的可复用设计原则,细节具体。
Hugging Face 发布 TRL v1.0,将六年迭代的后训练代码库正式转为稳定库,已实现超过 75 种后训练方法,月下载量达 300 万次。
推荐理由:原文解释了 v1.0 的稳定与实验分层契约和反抽象设计取舍,读者可以借此理解后训练库如何应对快速变化的算法领域。
Google DeepMind 发布由 Gemini 驱动的 AI 指针实验项目,提出维持心流、展示即告知、善用 this/that、把像素变成可操作实体四项交互原则,让用户通过指向和语音代替复杂提示词。
推荐理由:原文给出了AI指针的四项交互原则和落地场景,读者可以据此了解指向加语音如何替代复杂提示词。
拥有 230 年历史的 STADLER 使用 ChatGPT 转型知识工作,覆盖 650 名员工,节省时间并加速生产力提升。
Google DeepMind 推出 Lyria 3 Pro,可生成最长 3 分钟的曲目,并支持按前奏、主歌、副歌、桥段等结构元素定制。模型已进入 Vertex AI 公开预览、AI Studio 与 Gemini API、Google Vids、Gemini 应用和 ProducerAI;输出均嵌入 SynthID 水印,且不模仿具名艺术家。
Google 宣布 Vibe Coding XR,将 Gemini 与基于 WebXR、three.js 和 LiteRT.js 的开源 XR Blocks 框架结合,把自然语言直接转为可运行的物理感知 Android XR 应用,官方称可在 60 秒内完成。
OpenAI 推出安全漏洞赏金计划(Safety Bug Bounty),征集 AI 滥用与安全风险线索。覆盖范围包括智能体漏洞、提示词注入和数据外泄。
OpenAI 发布了一套基于提示词的青少年安全策略,供开发者在 gpt-oss-safeguard 中使用,帮助审核 AI 系统中的年龄特定风险。该策略面向开发者,用于构建更安全的青少年 AI 体验。
OpenAI 宣布 ChatGPT 推出更丰富的视觉沉浸式购物体验,采用 Agentic Commerce Protocol。该功能支持商品发现、并排比较和商家接入。
OpenAI 表示,Sora 2 视频模型和 Sora 社交创作应用在开发之初就以安全为基础设计,以应对最先进视频模型和全新社交创作平台带来的新型安全挑战。其安全方案依托具体、明确的保护措施构建。
Google Research 在 The Check Up 活动上展示其在医疗健康领域的最新 AI 进展。
Mistral AI 发布 Forge,帮助企业基于内部文档、代码库和运营数据训练前沿级自有模型,并已与 ASML、Ericsson、欧洲空间局等机构合作。Forge 支持 pre-training、post-training 与强化学习,兼容 dense 和 MoE 架构及多模态输入,模型可在企业自有基础设施中运行。
OpenAI 的 Codex Security 不依赖传统 SAST 报告,而是通过 AI 驱动的约束推理和验证来发现真实漏洞,从而减少误报。
Google Research 宣布在 Flood Hub 上推出城市山洪预报,利用新的 AI 方法可提前最多 24 小时预测城市山洪风险。该模型基于 Groundsource 方法,用 Gemini 分析公开新闻报道构建历史山洪事件数据集,并采用 LSTM 架构的 RNN 训练,仅依赖全球天气产品运行。
推荐理由:原文给出用 Gemini 从新闻构建训练数据并让南半球达到接近发达国家的预报精度,读者可了解 AI 预警如何弥合警告缺口。
ChatGPT 通过约束智能体工作流中的高风险操作、保护敏感数据,来防御提示词注入和社工攻击。文章说明了 OpenAI 在 AI 智能体安全设计上的具体做法,帮助降低智能体被恶意指令利用的风险。
OpenAI 介绍了如何基于 Responses API、shell 工具和托管容器构建 Agent 运行时,用于运行带文件、工具和状态的 Agent。方案强调安全性与可扩展性。
OpenAI 在 ChatGPT 中推出数学与科学的交互式可视化讲解,帮助学生实时探索公式、变量和概念。该功能面向数学与科学学习场景,可动态呈现知识内容,辅助理解。
Hugging Face 在 Hub 上推出 Storage Buckets,一种不版本控制的可变、类 S3 对象存储,用于存放 checkpoints、处理后的数据、Agent traces 等中间产物。
推荐理由:官方发布后明确解释了为什么中间产物不适合放 Git 仓库,并给出 CLI、Python、fsspec 的完整上手路径,便于迁移现有训练和数据流程。
Hugging Face LeRobot 发布 v0.5.0,合并超过 200 个 PR、新增 50 多位贡献者。
推荐理由:官方完整发布说明覆盖硬件、策略、数据集和代码库四大方向,读者可据此评估升级对机器人训练与部署的实际影响。
OpenAI 推出 AI 应用安全智能体 Codex Security,目前处于研究预览阶段。该智能体通过分析项目上下文来检测、验证并修复复杂漏洞,从而提供更高的置信度和更少的噪音。
Balyasny Asset Management 通过严格的模型评估、全面使用 OpenAI 平台以及智能体工作流,重塑投资研究流程。公司以系统化的模型评测筛选合适的模型,并将 OpenAI 的能力嵌入投研各环节,由智能体自动执行研究任务,构建起一套 AI 驱动的研究引擎。
Descript 利用 OpenAI 推理模型实现了大型内容库的自动本地化配音,在不丢失时间对齐和原意的前提下完成多语言视频翻译。
OpenAI 发布面向学校和教育机构的新工具、认证项目及评估资源,帮助缩小 AI 能力差距、扩大学习机会。该举措涵盖工具、认证与测量资源三类支持,旨在让教育中的 AI 应用更好地带来发展机遇。
Hugging Face 发布 Modular Diffusers,将扩散流水线拆成文本编码、去噪、解码等可独立运行、自由增删互换的可复用块,作为现有 DiffusionPipeline 的灵活补充。
推荐理由:原文展示了用可组合积木搭建扩散流水线的完整用法,包括自定义块、模块化仓库和 Mellon 可视化集成,方法可直接复用。
OpenAI 推出 ChatGPT for Excel 和新的金融应用集成,由 GPT-5.4 驱动,用于加速受监管环境下的建模、研究和分析。
OpenAI 推出 Adoption news channel,用于分享将 AI 进展转化为业务优势的实用洞察和框架。该频道面向企业采纳场景,帮助组织把 AI 能力落地为商业价值。
OpenAI 推出 Learning Outcomes Measurement Suite,用于评估 AI 对学生学习成效的影响。该工具套件面向多样化教育环境,可长期衡量 AI 在学习中的作用。
Amazon Bedrock 推出 Stateful Runtime for Agents,为多步骤 AI 工作流提供持久编排、记忆和安全执行能力。该运行时由 OpenAI 模型驱动,可支持跨步骤保持状态的智能体应用。
OpenAI 公布心理健康安全工作的多项更新,包括家长控制、可信联系人功能以及改进的心理困扰检测能力。公司同时提及近期相关诉讼的进展情况。
Google DeepMind 发布 Nano Banana 2(Gemini 3.1 Flash Image),以 Flash 速度提供 Pro 级世界知识、精准文本渲染、最多 5 个角色的主体一致性和 512px 到 4K 的生产级规格。
推荐理由:官方公告列出了能力细节、订阅者保留路径和各产品开放范围,读者可据此判断是否切换工作流。
OpenAI 与 Figma 推出新的 Codex 集成,打通代码与设计。该集成让团队可以在代码实现与 Figma 画布之间直接切换,从而更快地迭代和交付产品。
OpenAI 宣布推出 Frontier Alliance Partners 计划,帮助企业将 AI 项目从试点阶段推进到生产环境,实现安全、可扩展的智能体部署。
Google DeepMind 在 Gemini 应用中以 beta 形式上线最新音乐生成模型 Lyria 3,用户输入文字或上传照片即可生成 30 秒带歌词曲目。
推荐理由:官方介绍了 Lyria 3 的三项能力改进和 SynthID 音频验证入口,读者可据此了解 Gemini 音乐生成与识别 AI 内容的新玩法。
OpenAI 在 ChatGPT 中推出 Lockdown Mode 和 Elevated Risk 风险标签,帮助组织防御提示词注入和 AI 驱动的数据外泄。
OpenAI 推出开源工具包 GABRIEL,利用 GPT 将定性文本和图像转化为定量数据,帮助社会科学家大规模分析研究数据。该工具包面向社会科学研究领域,已开源可用。
OpenAI 介绍其构建的实时访问系统,结合速率限制、用量追踪和 credits,为 Sora 和 Codex 提供持续访问能力。材料仅提供摘要,未包含更多细节。
Hugging Face 发布一个随 kernels 库分发的智能体技能,教编码智能体编写可集成进 transformers 和 diffusers 的生产级 CUDA 内核。
推荐理由:原文给出技能安装方法、覆盖内容和 H100 实测数据,读者可以照此让编码智能体生成并发布 CUDA 内核。