OpenAI 在 Responses API 中引入 WebSocket 加速智能体工作流
OpenAI 深入解析了 Codex 智能体循环,展示如何在 Responses API 中用 WebSocket 和连接级缓存降低 API 开销、改善模型延迟。文中说明了 WebSocket 连接复用如何为智能体工作流提速。该能力通过 Responses API 提供。
OpenAI 深入解析了 Codex 智能体循环,展示如何在 Responses API 中用 WebSocket 和连接级缓存降低 API 开销、改善模型延迟。文中说明了 WebSocket 连接复用如何为智能体工作流提速。该能力通过 Responses API 提供。
OpenAI 在 ChatGPT 中推出 workspace agents,这是由 Codex 驱动的智能体,可自动化复杂工作流并在云端运行。该功能面向团队,帮助团队安全地跨工具扩展工作。
OpenAI 发布 ChatGPT Images 2.0,改进了文字渲染、多语言支持和视觉推理能力。该介绍同时引导读者查看 Images 2.5 的新内容,feed 仅提供摘要,未见完整正文细节。
OpenAI 推出 Codex Labs,并与 Accenture、PwC、Infosys 等伙伴合作,帮助企业在软件开发全生命周期中部署和扩展 Codex。同时 Codex 周活跃用户达到 4M。
OpenAI 更新 macOS 和 Windows 版 Codex 应用,新增 computer use、应用内浏览、图像生成、记忆和插件功能,用于加速开发者工作流。
推荐理由:原文点出 Codex 桌面端新增的多项能力,开发者可据此评估是否将其纳入日常工作流。
OpenAI 更新 Agents SDK,新增原生沙盒执行和模型原生 harness,帮助开发者构建可跨文件与工具运行的安全的长时运行智能体。
HCompany 推出 Chrome 扩展 HoloTab,将其 3 月 31 日发布的 computer-use 模型 Holo3 直接带到浏览器中,无需配置即可在任何网站自动化操作。其 Routines 功能通过录屏和讲解生成可重复运行或定时执行的例程,适合比价、找工作等重复任务;产品目前免费开放使用。
推荐理由:原文介绍了浏览器智能体的录制生成例程能力和免费入口,读者可以据此了解它如何把 computer-use 模型带入日常工作流。
OpenAI 扩展 Trusted Access for Cyber 计划,向经过审核的网络安全防御者提供 GPT-5.4-Cyber。随着 AI 网络安全能力提升,OpenAI 同步加强了安全保障措施。
Google 与纽约大学合作推出 Vantage 研究实验,用生成式 AI 构建模拟对话环境,评估高中和大学生的批判性思维、协作等面向未来的技能。系统由 Executive LLM 动态引导对话以采集技能相关信息,AI Evaluator 依据评估量表打分并生成技能图谱。
Cloudflare 将 OpenAI 的 GPT-5.4 和 Codex 引入 Agent Cloud,帮助企业快速、安全地构建、部署和扩展用于真实任务的 AI 智能体。企业可在 Agent Cloud 上直接运行智能体工作流。
运营团队正使用 ChatGPT 精简工作流程、改善协作协调、标准化流程,并推动更快执行。
OpenAI 探讨临床医生如何使用 ChatGPT 辅助诊断、文档记录和患者护理。相关 AI 工具符合 HIPAA 安全合规要求。
OpenAI 讲解了如何在 ChatGPT 中使用 projects 功能:用它整理聊天记录、文件和自定义指令,管理持续性工作。该功能还可帮助用户更高效地协作,适合将相关工作内容归组管理。
OpenAI 为金融服务业提供一站式 AI 资源,包括提示词包、GPTs、指南和工具,帮助金融机构安全地部署和扩展 AI 应用。
CyberAgent 在广告、媒体和游戏业务中使用 ChatGPT Enterprise 和 Codex,安全地扩大 AI 应用规模。此举帮助公司提升质量并加快决策速度。
Google Research 推出两个学术智能体框架:PaperVizAgent(原 PaperBanana)用于从论文文本生成可发表的学术图表,ScholarPeer 则自动执行严格的同行评审。
OpenAI 的 Codex 为 ChatGPT Business 和 Enterprise 用户新增按量付费定价,为团队提供更灵活的采用与扩展方式。此前团队用户只能按固定套餐使用,新模式可帮助团队从少量使用起步并随需求增长扩大规模。
Gradient Labs 基于 GPT-4.1 和 GPT-5.4 mini、nano 构建 AI 智能体,为每位银行客户提供 AI 客户经理,自动化银行支持工作流程。该方案具备低延迟和高可靠性。
Hugging Face 发布 gradio.Server,一个扩展自 FastAPI 的类,让开发者用 React、Svelte 或原生 HTML/JS 等任意前端框架,同时保留 Gradio 的排队、并发管理、SSE 流式、gradio_client 兼容和 Spaces 上的 ZeroGPU 支持。
推荐理由:官方介绍了 gradio.Server 如何让任意自定义前端继续复用 Gradio 的排队、MCP 和 ZeroGPU 能力,并附完整代码示例。
Mistral AI 发布面向人类开发者和 Agent 的 Spaces CLI,三条命令即可从零搭建带热重载、数据库和生成 Dockerfile 的多服务项目并部署。
推荐理由:Mistral 以自家 CLI 为例,总结了一套让同一工具同时服务人类与 Agent 的可复用设计原则,细节具体。
Google DeepMind 发布由 Gemini 驱动的 AI 指针实验项目,提出维持心流、展示即告知、善用 this/that、把像素变成可操作实体四项交互原则,让用户通过指向和语音代替复杂提示词。
推荐理由:原文给出了AI指针的四项交互原则和落地场景,读者可以据此了解指向加语音如何替代复杂提示词。
拥有 230 年历史的 STADLER 使用 ChatGPT 转型知识工作,覆盖 650 名员工,节省时间并加速生产力提升。
Google DeepMind 推出 Lyria 3 Pro,可生成最长 3 分钟的曲目,并支持按前奏、主歌、副歌、桥段等结构元素定制。模型已进入 Vertex AI 公开预览、AI Studio 与 Gemini API、Google Vids、Gemini 应用和 ProducerAI;输出均嵌入 SynthID 水印,且不模仿具名艺术家。
Google 宣布 Vibe Coding XR,将 Gemini 与基于 WebXR、three.js 和 LiteRT.js 的开源 XR Blocks 框架结合,把自然语言直接转为可运行的物理感知 Android XR 应用,官方称可在 60 秒内完成。
OpenAI 发布了一套基于提示词的青少年安全策略,供开发者在 gpt-oss-safeguard 中使用,帮助审核 AI 系统中的年龄特定风险。该策略面向开发者,用于构建更安全的青少年 AI 体验。
OpenAI 宣布 ChatGPT 推出更丰富的视觉沉浸式购物体验,采用 Agentic Commerce Protocol。该功能支持商品发现、并排比较和商家接入。
Google Research 在 The Check Up 活动上展示其在医疗健康领域的最新 AI 进展。
Mistral AI 发布 Forge,帮助企业基于内部文档、代码库和运营数据训练前沿级自有模型,并已与 ASML、Ericsson、欧洲空间局等机构合作。Forge 支持 pre-training、post-training 与强化学习,兼容 dense 和 MoE 架构及多模态输入,模型可在企业自有基础设施中运行。
OpenAI 的 Codex Security 不依赖传统 SAST 报告,而是通过 AI 驱动的约束推理和验证来发现真实漏洞,从而减少误报。
OpenAI 介绍了如何基于 Responses API、shell 工具和托管容器构建 Agent 运行时,用于运行带文件、工具和状态的 Agent。方案强调安全性与可扩展性。
OpenAI 在 ChatGPT 中推出数学与科学的交互式可视化讲解,帮助学生实时探索公式、变量和概念。该功能面向数学与科学学习场景,可动态呈现知识内容,辅助理解。
Hugging Face 在 Hub 上推出 Storage Buckets,一种不版本控制的可变、类 S3 对象存储,用于存放 checkpoints、处理后的数据、Agent traces 等中间产物。
推荐理由:官方发布后明确解释了为什么中间产物不适合放 Git 仓库,并给出 CLI、Python、fsspec 的完整上手路径,便于迁移现有训练和数据流程。
Hugging Face LeRobot 发布 v0.5.0,合并超过 200 个 PR、新增 50 多位贡献者。
推荐理由:官方完整发布说明覆盖硬件、策略、数据集和代码库四大方向,读者可据此评估升级对机器人训练与部署的实际影响。
OpenAI 推出 AI 应用安全智能体 Codex Security,目前处于研究预览阶段。该智能体通过分析项目上下文来检测、验证并修复复杂漏洞,从而提供更高的置信度和更少的噪音。
Balyasny Asset Management 通过严格的模型评估、全面使用 OpenAI 平台以及智能体工作流,重塑投资研究流程。公司以系统化的模型评测筛选合适的模型,并将 OpenAI 的能力嵌入投研各环节,由智能体自动执行研究任务,构建起一套 AI 驱动的研究引擎。
Descript 利用 OpenAI 推理模型实现了大型内容库的自动本地化配音,在不丢失时间对齐和原意的前提下完成多语言视频翻译。
OpenAI 发布面向学校和教育机构的新工具、认证项目及评估资源,帮助缩小 AI 能力差距、扩大学习机会。该举措涵盖工具、认证与测量资源三类支持,旨在让教育中的 AI 应用更好地带来发展机遇。
Hugging Face 发布 Modular Diffusers,将扩散流水线拆成文本编码、去噪、解码等可独立运行、自由增删互换的可复用块,作为现有 DiffusionPipeline 的灵活补充。
推荐理由:原文展示了用可组合积木搭建扩散流水线的完整用法,包括自定义块、模块化仓库和 Mellon 可视化集成,方法可直接复用。
OpenAI 推出 ChatGPT for Excel 和新的金融应用集成,由 GPT-5.4 驱动,用于加速受监管环境下的建模、研究和分析。
OpenAI 推出 Adoption news channel,用于分享将 AI 进展转化为业务优势的实用洞察和框架。该频道面向企业采纳场景,帮助组织把 AI 能力落地为商业价值。