Google DeepMind 发布 AlphaEvolve 一周年影响报告并通过 Google Cloud 拓展商业应用
Google DeepMind 汇总 Gemini 驱动的编码智能体 AlphaEvolve 一年来的应用成果,并通过 Google Cloud 将其带给商业客户。
推荐理由:官方汇总了 AlphaEvolve 在医疗、电网、数学和商业客户中的具体成果数字,读者可以据此评估这类算法进化智能体的实际落地范围。
Google DeepMind 汇总 Gemini 驱动的编码智能体 AlphaEvolve 一年来的应用成果,并通过 Google Cloud 将其带给商业客户。
推荐理由:官方汇总了 AlphaEvolve 在医疗、电网、数学和商业客户中的具体成果数字,读者可以据此评估这类算法进化智能体的实际落地范围。
OpenAI 介绍了 ChatGPT 如何在了解世界的同时保护用户隐私:减少训练中的个人数据,并让用户可以选择自己的对话是否用于改进 AI 模型。
OpenAI 推出 ChatGPT Futures 2026 届,汇集 26 名运用 AI 进行构建、研究和推动现实影响的学生创新者。该项目展示了这一代人如何借助 ChatGPT 重新定义学习、创造力与机会。
Singular Bank 基于 ChatGPT 和 Codex 构建了内部助手 Singularity,帮助银行家在会议准备、投资组合分析和后续跟进等工作中每天节省 60–90 分钟。
OpenAI 的 B2B Signals 研究显示,前沿企业正在深化 AI 采用、扩展基于 Codex 的智能体工作流,并由此构建可持续的竞争优势。
Hugging Face 与 Appen Inc.、DataoceanAI 合作,为 Open ASR Leaderboard 引入 10 个高质量私有 ASR 数据集,涵盖朗读与对话风格及澳、加、印、美、英等多种口音,以防范 benchmaxxing 和测试集污染。
Uber 使用 OpenAI 驱动 AI 助手和语音功能,帮助司机更聪明地赚钱,并让乘客更快完成订车。这些能力覆盖 Uber 的全球实时交易平台,是其与 OpenAI 合作落地的核心场景。
OpenAI 发布 GPT-5.5 Instant,更新 ChatGPT 的默认模型。官方称其回答更智能、更准确,减少模型幻觉,并改进了个性化控制。
OpenAI 推出 MRC(Multipath Reliable Connection),一种新的大规模 AI 训练集群网络协议,已通过 OCP 发布。该协议旨在提升大规模 AI 训练集群的韧性与性能。
OpenAI 发布 European Youth Safety Blueprint,并推出 EMEA Youth & Wellbeing Grants,面向青少年、家庭和教育工作者推进安全、负责任的 AI。该举措聚焦 EMEA 地区的青少年安全与福祉。
OpenAI 以 Beta 形式扩展 ChatGPT 广告,推出自助式 Ads Manager、CPC 竞价和增强的衡量工具。官方称新功能以保护隐私为目标,广告与用户对话相互分离。
OpenAI 与 PwC 达成合作,帮助企业使用 AI 智能体自动化财务工作流、改进预测并强化内部控制。此次合作旨在推动 CFO 职能的现代化转型。
Jack Clark在Import AI 455撰文称,基于公开数据他勉强判断2028年底前出现无人类参与的自动化AI研发(模型自主训练后继者)的概率超过60%,2027年为30%。
OpenAI 重构了其 WebRTC 技术栈,以支持低延迟、全球规模的实时语音 AI,并实现流畅的对话轮换。这套架构让语音智能体在生产环境中可以稳定运行。
Google Research 阐述其开放科学理念,通过开源工具、开放数据集与全球科研合作推动科学进步,已服务超过 250,000 名研究者和开发者。
Google DeepMind 宣布 AI co-clinician 研究计划,探索在医生监督下辅助患者照护的 AI 智能体。在 98 个真实初级诊疗问题的盲评中 97 例零严重错误,在 RxQA 开放式用药问答上超越现有前沿模型;在 120 次远程医疗模拟会诊中,专家医生整体表现仍优于该系统,但在 140 项评估中有 68 项达到或超过初级保健医生水平,目前定位为辅助工具而非替代临床判断。
推荐理由:原文同时给出医生端与患者端的评估设计和结果,读者可以据此了解该系统当前的真实边界与局限。
Google Research 介绍自 9 月预印本发布 Empirical Research Assistance(ERA)以来,其科学家与学术合作者将其应用于真实科研的四个成果。
推荐理由:文章展示了 ERA 在疫情预测、宇宙学、气候遥感和神经回路四个真实科研场景的应用结果,可了解 LLM 辅助科研的具体形态。
OpenAI 解释了 GPT-5 行为中“地精”输出的来源,梳理了这类人格驱动的怪异输出在模型中传播的时间线、根本原因及修复措施。
IBM Granite 团队发布 Granite 4.1 系列 dense 模型,含 3B、8B、30B 三个规模,在约 15T tokens 上训练,上下文经长文本扩展达 512K,均以 Apache 2.0 许可开源。
推荐理由:原文完整披露了五阶段预训练、SFT 质控和四阶段 RL 的训练配方,8B 稠密模型对标上一代 32B-A9B MoE 的结果也可供选型参考。
OpenAI 正扩大 Stargate 规模,通过新增数据中心容量构建支撑 AGI 的算力基础设施,以满足不断增长的 AI 需求。
OpenAI 提出加强智能时代网络安全的五项行动计划,核心方向是普及 AI 驱动的网络防御并保护关键系统。原文仅概述计划框架,未披露具体措施细节。
DeepInfra 现已成为 Hugging Face Hub 支持的 Inference Provider,为开发者提供按 token 计价的低成本 serverless 推理服务。
NVIDIA 发布 Nemotron 3 Nano Omni(30B-A3B)全模态理解模型,支持文档分析、ASR、长音视频理解和 agentic computer use,并在 Hugging Face 开放 BF16、FP8 和 NVFP4 权重。
推荐理由:原文给出完整基准对比和架构细节,读者可以据此评估它是否值得替换现有的多模态工作流。
OpenAI 宣布 GPT 模型、Codex 和 Managed Agents 现已登陆 AWS,企业可在 AWS 环境中构建安全的 AI 应用。
OpenAI 介绍了其保障 ChatGPT 社区安全的整体做法,涵盖模型安全防护、滥用检测、政策执行以及与安全专家的协作。该内容说明 OpenAI 如何通过多层面措施保护用户社区安全。
OpenAI 宣布 ChatGPT Enterprise 和 OpenAI API 获得 FedRAMP Moderate 授权,使美国联邦机构能够在合规框架下安全采用 AI。授权覆盖企业版产品与 API 两条使用路径。
Mistral AI 发布 Workflows 公开预览版,这是构建于 Studio 之上的企业 AI 编排层,提供持久执行、可观测性和人在环节点审批,帮助 AI 流程从概念验证走向生产环境。
Google DeepMind 与韩国科学技术信息通信部(MSIT)宣布建立合作伙伴关系,属于其 National Partnerships for AI 计划的一部分。
OpenAI 与 Microsoft 宣布达成修订后的合作协议,简化双方伙伴关系,并提供长期明确性。新协议将支持双方持续进行大规模 AI 创新。
OpenAI 本周在 Hub 上开源发布 Privacy Filter,一个 PII 检测模型,1.5B 参数、50M 激活参数,Apache 2.0 许可,支持 128k 上下文单次前向识别 8 类个人信息,在 PII-Masking-300k 基准上达到 SOTA。
OpenAI 推出 Symphony,一个面向 Codex 编排的开源规范,可将 issue 跟踪器转化为始终运行的智能体系统。该规范旨在提升工程产出并减少上下文切换。
食品分销公司 Choco 使用 OpenAI API 构建 AI 智能体,实现食品分销流程自动化。该方案帮助 Choco 提升了生产力并释放增长空间,是 AI 在实际业务中落地应用的客户案例。
OpenAI 发布文章阐述指导其工作的五项原则,由 Sam Altman 分享。文章重申其使命是确保 AGI 造福全人类。
OpenAI 发布一个新的分析框架,评估 921 种职业和 1.48 亿个美国就业岗位,识别哪些岗位面临自动化风险、重组、增长或受 AI 影响较小。该框架为理解 AI 对就业的过渡期影响提供依据。
DeepSeek 发布 V4,在 Hub 上开源 DeepSeek-V4-Pro(1.6T 总参数 / 49B 激活)和 DeepSeek-V4-Flash(284B 总参数 / 13B 激活)两个 instruct 及对应 base 检查点,均支持 1M token 上下文。
推荐理由:文章拆解了 V4 为长上下文与 Agent 场景做的架构与后训练设计,读者可据此评估开源模型跑长任务的部署成本。
OpenAI 发布了 GPT-5.5 的 System Card(系统卡)。本次抓取仅获取到标题,正文内容缺失,具体模型能力与安全评估信息以原文链接为准:https://openai.com/index/gpt-5-5-system-card
OpenAI 发布 GPT-5.5,面向编程、研究和数据分析等复杂任务,支持跨工具使用。
ChatGPT Work 提供面向日常工作的实用工作流,覆盖重复性任务、更新汇报、调研、规划以及团队协作运营等场景,帮助用户将这些常见工作环节交给 ChatGPT 处理。
Hugging Face 发布教程,指导开发者在 Manifest V3 约束下用 Transformers.js 在 Chrome 扩展中运行本地 AI,并复刻其 Gemma 4 Browser Assistant 架构。
推荐理由:作者基于自家 Gemma 4 浏览器扩展拆解 MV3 下运行 Transformers.js 的架构决策,给出可直接迁移的运行时划分与消息契约设计。
Google 宣布将一种新的照片视角重构方法作为 Google Photos Auto frame 功能上线,用 ML 模型估计 3D 点图和相机参数,再由生成式扩散模型补全新视角下未拍摄到的区域。方法分 3D 场景与相机估计、生成式修补两阶段,可自动矫正广角前摄的透视畸变,对含人物的合格照片提供一键重构视角的备选结果。
推荐理由:原文解释了将照片当作 3D 场景重建并重定位虚拟相机的两阶段方法,读者可以了解生成式修图与经典裁剪的区别。