OpenAI Japan 发布 Japan Teen Safety Blueprint,优先保障青少年安全
OpenAI Japan 发布 Japan Teen Safety Blueprint,为使用生成式 AI 的青少年引入更强的年龄保护、家长控制和身心健康保障措施。该方案明确将青少年安全放在首位。
OpenAI Japan 发布 Japan Teen Safety Blueprint,为使用生成式 AI 的青少年引入更强的年龄保护、家长控制和身心健康保障措施。该方案明确将青少年安全放在首位。
OpenAI 推出 GPT-5.4 mini 和 nano,是 GPT-5.4 更小、更快的版本。两款模型针对编程、工具调用、多模态推理进行了优化,适用于高并发的 API 与子智能体工作负载。
OpenAI 新研究显示,美国人每天向 ChatGPT 发送近 300 万条关于薪酬和收入的提问,帮助缩小工资信息差距。该发现揭示了 ChatGPT 在劳动者获取薪酬信息方面的实际使用情况。
OpenAI 的 Codex Security 不依赖传统 SAST 报告,而是通过 AI 驱动的约束推理和验证来发现真实漏洞,从而减少误报。
ChatGPT 通过约束智能体工作流中的高风险操作、保护敏感数据,来防御提示词注入和社工攻击。文章说明了 OpenAI 在 AI 智能体安全设计上的具体做法,帮助降低智能体被恶意指令利用的风险。
OpenAI 介绍了如何基于 Responses API、shell 工具和托管容器构建 Agent 运行时,用于运行带文件、工具和状态的 Agent。方案强调安全性与可扩展性。
Wayfair 使用 OpenAI 模型改进电商客服与商品目录准确性,自动化工单分类,并大规模增强数百万条商品属性信息。
OpenAI 的 IH-Challenge 训练模型优先遵循可信指令,以改进前沿 LLM 的指令层级。该方法同时提升了安全可操纵性,并增强了对提示词注入攻击的抵抗力。
OpenAI 在 ChatGPT 中推出数学与科学的交互式可视化讲解,帮助学生实时探索公式、变量和概念。该功能面向数学与科学学习场景,可动态呈现知识内容,辅助理解。
OpenAI 宣布收购 Promptfoo,该平台帮助企业在开发阶段识别并修复 AI 系统中的漏洞。材料为官方简讯,仅提供收购事实,未披露交易金额或后续整合安排。
OpenAI 推出 AI 应用安全智能体 Codex Security,目前处于研究预览阶段。该智能体通过分析项目上下文来检测、验证并修复复杂漏洞,从而提供更高的置信度和更少的噪音。
Balyasny Asset Management 通过严格的模型评估、全面使用 OpenAI 平台以及智能体工作流,重塑投资研究流程。公司以系统化的模型评测筛选合适的模型,并将 OpenAI 的能力嵌入投研各环节,由智能体自动执行研究任务,构建起一套 AI 驱动的研究引擎。
Descript 利用 OpenAI 推理模型实现了大型内容库的自动本地化配音,在不丢失时间对齐和原意的前提下完成多语言视频翻译。
OpenAI 推出 CoT-Control,发现推理模型难以控制自己的思维链(CoT)。这一局限使思维链保持可被监控的状态,强化了可监控性作为 AI 安全保障手段的价值。
OpenAI 发布 GPT-5.4,称其为面向专业工作最强、最高效的前沿模型。新模型在编码、计算机使用和工具搜索上达到 SOTA,并提供 1M-token 上下文窗口。
推荐理由:OpenAI 官方给出 GPT-5.4 的能力定位与 1M-token 上下文,可据此判断其在专业工作场景中的可用性。
OpenAI 发布面向学校和教育机构的新工具、认证项目及评估资源,帮助缩小 AI 能力差距、扩大学习机会。该举措涵盖工具、认证与测量资源三类支持,旨在让教育中的 AI 应用更好地带来发展机遇。
OpenAI 提出五大 AI 价值模型,展示企业领导者如何安排 AI 转型顺序,从员工 AI 素养培养逐步推进到流程重塑,以构建持久的业务优势。
德甲俱乐部沃尔夫斯堡(VfL Wolfsburg)以人为核心而非试点项目,将 ChatGPT 推广为覆盖全俱乐部的通用能力。此举旨在规模化提升效率、创造力和知识水平,同时不丢失俱乐部的足球本色。
OpenAI 推出 ChatGPT for Excel 和新的金融应用集成,由 GPT-5.4 驱动,用于加速受监管环境下的建模、研究和分析。
OpenAI 推出 Adoption news channel,用于分享将 AI 进展转化为业务优势的实用洞察和框架。该频道面向企业采纳场景,帮助组织把 AI 能力落地为商业价值。
一篇新预印本论文将单负振幅扩展到引力子,借助 GPT-5.2 Pro 推导并验证了量子引力中非零的引力子树级振幅。该结果展示了 GPT-5.2 Pro 在理论物理推导与验证中的辅助作用。
Axios COO Allison Murphy 介绍了该公司如何利用 AI 支持本地记者、简化新闻编辑室工作流程,并大规模交付高影响力的本地新闻报道。
OpenAI 推出 Learning Outcomes Measurement Suite,用于评估 AI 对学生学习成效的影响。该工具套件面向多样化教育环境,可长期衡量 AI 在学习中的作用。
OpenAI 官方发布与美国战争部合同的说明,内容涵盖安全红线、法律保护,以及 AI 系统在涉密环境中的部署方式。
OpenAI 与 Amazon 宣布达成战略合作,将 OpenAI 的 Frontier 平台引入 AWS。合作覆盖扩展 AI 基础设施、定制模型以及企业级 AI 智能体。
推荐理由:官方宣布合作落地,OpenAI 的 Frontier 平台将通过 AWS 提供,关注企业 AI 基础设施的读者可据此评估可选项。
OpenAI 宣布 1100 亿美元($110B)新融资,投前估值为 7300 亿美元($730B pre money)。资金来源包括 SoftBank 300 亿美元、NVIDIA 300 亿美元和 Amazon 500 亿美元。
推荐理由:官方宣布融资规模与估值,金额和投资方均为一手信息,可用于了解 OpenAI 资本结构的变化。
Amazon Bedrock 推出 Stateful Runtime for Agents,为多步骤 AI 工作流提供持久编排、记忆和安全执行能力。该运行时由 OpenAI 模型驱动,可支持跨步骤保持状态的智能体应用。
OpenAI 与 Microsoft 联合发布声明,宣布双方将继续在研究、工程和产品开发领域紧密合作。声明强调双方多年深度协作与共同成功的合作基础。
OpenAI 公布心理健康安全工作的多项更新,包括家长控制、可信联系人功能以及改进的心理困扰检测能力。公司同时提及近期相关诉讼的进展情况。
OpenAI 与太平洋西北国家实验室(PNNL)联合推出 DraftNEPABench 基准,评估 AI 编程智能体加急联邦审批的能力。该基准显示,AI 有望将 NEPA(国家环境政策法)文件起草时间缩短最多 15%,推动基础设施审查现代化。
OpenAI 与 Figma 推出新的 Codex 集成,打通代码与设计。该集成让团队可以在代码实现与 Figma 画布之间直接切换,从而更快地迭代和交付产品。
OpenAI 发布最新威胁报告,分析恶意行为者如何将 AI 模型与网站和社交平台结合实施攻击。报告还探讨了这对检测与防御工作的影响。
OpenAI 任命 Arvind KC 为首席人事官(Chief People Officer)。他将帮助公司扩大规模、强化企业文化,并主导 AI 时代的工作方式演进。
OpenAI 宣布不再使用 SWE-bench Verified 评测前沿编程能力,分析显示该基准存在测试缺陷与训练数据泄漏,污染日益严重,无法准确衡量前沿编程进展。OpenAI 推荐改用 SWE-bench Pro。
OpenAI 宣布推出 Frontier Alliance Partners 计划,帮助企业将 AI 项目从试点阶段推进到生产环境,实现安全、可扩展的智能体部署。
OpenAI 分享其 AI 模型对 First Proof 数学挑战的证明尝试,在专家级数学问题上测试研究级推理能力。相关证明过程已公开,用于检验模型在研究级难题上的推理表现。
OpenAI 向 The Alignment Project 承诺出资 750 万美元,用于资助独立的 AI 对齐研究。该举措旨在加强全球范围内应对 AGI 安全风险的努力。
OpenAI 推出 OpenAI for India 计划,在印度扩大 AI 覆盖范围。该计划包括建设本地基础设施、为印度企业提供 AI 支持以及提升劳动力 AI 技能。
OpenAI 与 Paradigm 联合推出 EVMbench,一个评估 AI 智能体能否检测、修补和利用高危智能合约漏洞的评测基准。该基准聚焦智能体在智能合约安全场景下的实际能力。
OpenAI 发布预印本,显示 GPT-5.2 提出了一个新的 gluon amplitude(胶子振幅)公式,该公式随后由 OpenAI 与学术合作者正式证明和验证。
推荐理由:模型提出的新物理公式经学术合作者证明与验证,可作为前沿模型科研能力的具体例证。