OpenAI 发布可信第三方评估的通用指南
OpenAI 发布第三方 AI 评估指南,说明如何评估前沿系统的模型能力、安全防护措施及评估有效性。该指南旨在为可信的第三方评估提供一套通用方法。
OpenAI 发布第三方 AI 评估指南,说明如何评估前沿系统的模型能力、安全防护措施及评估有效性。该指南旨在为可信的第三方评估提供一套通用方法。
Mistral 发布统一智能体 Vibe,Le Chat 品牌正式升级,一个许可同时覆盖工作与编码。
推荐理由:Mistral 官方公布了 Le Chat 升级为统一智能体 Vibe 的具体能力与各端入口,读者可据此评估其在工作与编码场景中的可用性。
Endava 使用 Codex 构建智能体组织,加速软件交付,并将需求分析时间从数周缩短到数小时。
OpenAI 公布其前沿治理框架,阐述在 AI 安全、安保与风险方面的实践。该框架明确了其做法如何与欧盟及加州新兴监管法规保持一致。
Cisco 与 OpenAI 合作,通过 Codex 重塑企业级工程。Cisco 借助 Codex 扩展 AI 原生开发,加速 AI Defense 相关工作,并实现缺陷修复自动化。
OpenAI 与 Thrive、Crete 基于 Codex 构建了能自我改进的税务智能体,实现申报自动化。该智能体提升了准确性并加快了工作流程。
Warp 使用 GPT-5.5 及 OpenAI 模型,在本地、云端和开源开发工作流中协调编码智能体。这一举措体现了 Warp 对基于 GPT-5.5 构建开源工具的重点投入。
OpenAI 公布 2026 年选举期间的应对措施,涵盖可靠选举信息、网络防御、AI 透明度、滥用防护和偏见监测五个方面。这是 OpenAI 支持全球选举、防范 AI 工具被滥用的整体安全保障方案。
OpenAI 发布新研究,显示 400 万美国人使用 ChatGPT 来创办、经营和发展小企业。AI 降低了创业成本,正在成为小企业主的第一批“员工”。
OpenAI 宣布与巴西媒体集团 Grupo Folha 和 Grupo UOL 达成战略内容合作,将可靠的巴西新闻引入 ChatGPT。合作强调内容署名与透明度,扩展用户获取新闻的途径。
Mistral 发布 Mistral Medium 3.5 公测版,一个 128B 稠密模型,256k 上下文窗口,SWE-Bench Verified 得分 77.6%,以修改版 MIT 许可开放权重,最少可在四块 GPU 上自托管。
推荐理由:官方发布给出基准成绩、定价和开放权重细节,读者可以据此评估其在自托管编码场景的可行性。
Virgin Atlantic 使用 Codex 在固定的假日出行截止期限前完成了新版移动 App 的交付。该团队借此实现了接近全覆盖的单元测试,并做到零 P1 缺陷。
OpenAI 入选 2026 年 Gartner 企业级 AI 编程智能体魔力象限领导者(Leader)。Codex 因创新性和企业级规模部署能力获得认可。
AdventHealth 正在使用 ChatGPT for Healthcare 简化工作流程,减轻行政负担,把更多时间还给患者护理。
OpenAI 宣布推进 Education for Countries 计划进入下一阶段,通过新的合作伙伴关系扩大 AI 在学校中的应用。该计划还包括教师培训和相关工具,以改善全球学习效果。
OpenAI 宣布其模型解决了有 80 年历史的单位距离问题,推翻了离散几何中的一个重要猜想。官方称这是 AI 驱动数学研究的里程碑。
推荐理由:OpenAI 官方宣布模型在数学研究上解决 80 年悬而未决的问题,可关注其对 AI 驱动数学研究的意义。
Ramp 工程师使用搭配 GPT-5.5 的 Codex 进行代码审查并发布改进,将获得实质性反馈的时间从数小时缩短到数分钟。
OpenAI 推出 OpenAI for Singapore,启动多年期 AI 合作计划,扩大 AI 部署规模、培养本地人才,并为企业与公共服务提供 AI 支持。
OpenAI 推进 AI 内容溯源,推出 Content Credentials、SynthID 及一款验证工具,帮助用户识别并信任 AI 生成的媒体内容。这些举措旨在提升 AI 生态的透明度与可信度。
SentinelOne 研究人员剖析了约 20 年前名为 fast16.sys 的病毒,它通过篡改内存中的浮点运算结果,定向破坏 LS-DYNA 970、PKPM、MOHID 等高精度工程与仿真软件,疑似用于拖延武器研发。
OpenAI 与 Dell 达成合作,将 Codex 引入混合部署与本地部署环境,帮助企业安全地在自有数据和工作流中部署 AI 编程智能体。
Google 于 2026 年 5 月宣布扩展内容透明度与验证工具,覆盖 Search、Gemini、Chrome、Pixel 和 Cloud。
推荐理由:原文给出 SynthID 验证入口扩展和 C2PA 检测的具体落地范围,读者可以据此了解内容溯源工具在自家产品中的可用变化。
OpenAI 与马耳他达成合作,向所有公民提供 ChatGPT Plus,并提供培训帮助公民掌握实用 AI 技能、负责任地使用 AI。
ChatGPT Work 提供一套实操工作流,覆盖立项简报、战略更新、决策包和进度汇报等运营场景,帮助团队在具体工作中直接使用 ChatGPT。
OpenAI 在 ChatGPT 中推出个人理财功能。用户可以连接自己的账户,追踪消费与投资、管理订阅、创建预算并规划财务目标。
Databricks 在企业 Agent 工作流中采用 GPT-5.5。此前 GPT-5.5 在 OfficeQA Pro 基准上创下新的 SOTA 成绩。
Sea Limited 的 CPO 阐述了公司为何在工程团队中部署 Codex,以加速亚洲 AI 原生软件开发。文章讨论了 Sea 对智能体软件开发未来的看法。
OpenAI 宣布 Codex 可在 ChatGPT 手机应用中使用,支持随时处理编码任务。用户可以在移动设备与远程环境中实时监控、调整和批准编码任务。
OpenAI 更新 ChatGPT 的安全功能,提升其在敏感对话中的上下文感知能力。新机制可随时间推移持续识别风险迹象,并作出更安全的回应。
OpenAI 构建了一个安全沙箱,使 Codex 能够在 Windows 上运行,并通过受控的文件访问和网络限制来保障安全。
OpenAI 介绍 ChatGPT Work 在财务场景中的实用工作流,涵盖报告、差异分析、预测、月度复盘及可直接用于决策的财务交付物。文章属于实操指南,重点展示如何把这些日常财务任务交给 ChatGPT Work 处理。
Google DeepMind 在 Nature 发表 Co-Scientist 研究,推出基于 Gemini 的多智能体 AI 系统,通过生成、辩论和进化假设迭代产生科研新假设,并通过 Hypothesis Generation 实验工具向个人研究者开放,未来几周开始推出,可在 labs.google/science 注册。
推荐理由:官方发布完整介绍了 Co-Scientist 的多智能体架构、验证机制和多所高校实验室的实际应用结果,还给出了个人研究者注册入口。
NVIDIA 的工程与研究团队使用 Codex(搭配 GPT-5.5)交付生产系统,并把研究想法转化为可运行的实验。
OpenAI 举办 Parameter Golf 活动,汇聚 1000+ 参与者和 2000+ 提交作品,探索 AI 辅助机器学习研究。活动在严格约束下覆盖 coding agents、量化和新型模型设计等方向。
德国汽车平台 AutoScout24 使用 OpenAI 的 Codex 与 ChatGPT 加速开发周期、提升代码质量,并扩大 AI 在工程团队中的应用。
OpenAI 数据显示,ChatGPT 的使用在 2026 年第一季度大幅增长,其中 35 岁以上用户增长最快,性别使用分布也更加均衡。这表明 AI 正加速进入更广泛的主流人群。
OpenAI 探讨企业如何把 AI 从早期试验推进到规模化复利影响,关键在于建立信任、完善治理、优化工作流设计,并在规模化中保证质量。
OpenAI 开放 Campus Network 学生社团兴趣报名表,面向全球学生社团开放加入。成员可使用 AI 工具、举办活动,共同建设 AI 驱动的校园社区。
OpenAI 推出企业部署公司 DeployCo,帮助各组织将前沿 AI 投入生产环境,并转化为可衡量的业务成果。
OpenAI 介绍其如何在内部安全运行 Codex 编码智能体,做法包括沙箱隔离、审批机制、网络策略和面向 Agent 的遥测,以支持安全合规的编码智能体落地。