OpenAI 与 PwC 合作重塑 CFO 办公职能
OpenAI 与 PwC 达成合作,帮助企业使用 AI 智能体自动化财务工作流、改进预测并强化内部控制。此次合作旨在推动 CFO 职能的现代化转型。
OpenAI 与 PwC 达成合作,帮助企业使用 AI 智能体自动化财务工作流、改进预测并强化内部控制。此次合作旨在推动 CFO 职能的现代化转型。
OpenAI 重构了其 WebRTC 技术栈,以支持低延迟、全球规模的实时语音 AI,并实现流畅的对话轮换。这套架构让语音智能体在生产环境中可以稳定运行。
Google Research 阐述其开放科学理念,通过开源工具、开放数据集与全球科研合作推动科学进步,已服务超过 250,000 名研究者和开发者。
Google DeepMind 宣布 AI co-clinician 研究计划,探索在医生监督下辅助患者照护的 AI 智能体。在 98 个真实初级诊疗问题的盲评中 97 例零严重错误,在 RxQA 开放式用药问答上超越现有前沿模型;在 120 次远程医疗模拟会诊中,专家医生整体表现仍优于该系统,但在 140 项评估中有 68 项达到或超过初级保健医生水平,目前定位为辅助工具而非替代临床判断。
推荐理由:原文同时给出医生端与患者端的评估设计和结果,读者可以据此了解该系统当前的真实边界与局限。
Google Research 介绍自 9 月预印本发布 Empirical Research Assistance(ERA)以来,其科学家与学术合作者将其应用于真实科研的四个成果。
推荐理由:文章展示了 ERA 在疫情预测、宇宙学、气候遥感和神经回路四个真实科研场景的应用结果,可了解 LLM 辅助科研的具体形态。
OpenAI 解释了 GPT-5 行为中“地精”输出的来源,梳理了这类人格驱动的怪异输出在模型中传播的时间线、根本原因及修复措施。
IBM Granite 团队发布 Granite 4.1 系列 dense 模型,含 3B、8B、30B 三个规模,在约 15T tokens 上训练,上下文经长文本扩展达 512K,均以 Apache 2.0 许可开源。
推荐理由:原文完整披露了五阶段预训练、SFT 质控和四阶段 RL 的训练配方,8B 稠密模型对标上一代 32B-A9B MoE 的结果也可供选型参考。
OpenAI 正扩大 Stargate 规模,通过新增数据中心容量构建支撑 AGI 的算力基础设施,以满足不断增长的 AI 需求。
OpenAI 提出加强智能时代网络安全的五项行动计划,核心方向是普及 AI 驱动的网络防御并保护关键系统。原文仅概述计划框架,未披露具体措施细节。
DeepInfra 现已成为 Hugging Face Hub 支持的 Inference Provider,为开发者提供按 token 计价的低成本 serverless 推理服务。
NVIDIA 发布 Nemotron 3 Nano Omni(30B-A3B)全模态理解模型,支持文档分析、ASR、长音视频理解和 agentic computer use,并在 Hugging Face 开放 BF16、FP8 和 NVFP4 权重。
推荐理由:原文给出完整基准对比和架构细节,读者可以据此评估它是否值得替换现有的多模态工作流。
OpenAI 宣布 GPT 模型、Codex 和 Managed Agents 现已登陆 AWS,企业可在 AWS 环境中构建安全的 AI 应用。
OpenAI 介绍了其保障 ChatGPT 社区安全的整体做法,涵盖模型安全防护、滥用检测、政策执行以及与安全专家的协作。该内容说明 OpenAI 如何通过多层面措施保护用户社区安全。
OpenAI 宣布 ChatGPT Enterprise 和 OpenAI API 获得 FedRAMP Moderate 授权,使美国联邦机构能够在合规框架下安全采用 AI。授权覆盖企业版产品与 API 两条使用路径。
Mistral AI 发布 Workflows 公开预览版,这是构建于 Studio 之上的企业 AI 编排层,提供持久执行、可观测性和人在环节点审批,帮助 AI 流程从概念验证走向生产环境。
Google DeepMind 与韩国科学技术信息通信部(MSIT)宣布建立合作伙伴关系,属于其 National Partnerships for AI 计划的一部分。
OpenAI 与 Microsoft 宣布达成修订后的合作协议,简化双方伙伴关系,并提供长期明确性。新协议将支持双方持续进行大规模 AI 创新。
OpenAI 本周在 Hub 上开源发布 Privacy Filter,一个 PII 检测模型,1.5B 参数、50M 激活参数,Apache 2.0 许可,支持 128k 上下文单次前向识别 8 类个人信息,在 PII-Masking-300k 基准上达到 SOTA。
OpenAI 推出 Symphony,一个面向 Codex 编排的开源规范,可将 issue 跟踪器转化为始终运行的智能体系统。该规范旨在提升工程产出并减少上下文切换。
食品分销公司 Choco 使用 OpenAI API 构建 AI 智能体,实现食品分销流程自动化。该方案帮助 Choco 提升了生产力并释放增长空间,是 AI 在实际业务中落地应用的客户案例。
OpenAI 发布文章阐述指导其工作的五项原则,由 Sam Altman 分享。文章重申其使命是确保 AGI 造福全人类。
OpenAI 发布一个新的分析框架,评估 921 种职业和 1.48 亿个美国就业岗位,识别哪些岗位面临自动化风险、重组、增长或受 AI 影响较小。该框架为理解 AI 对就业的过渡期影响提供依据。
DeepSeek 发布 V4,在 Hub 上开源 DeepSeek-V4-Pro(1.6T 总参数 / 49B 激活)和 DeepSeek-V4-Flash(284B 总参数 / 13B 激活)两个 instruct 及对应 base 检查点,均支持 1M token 上下文。
推荐理由:文章拆解了 V4 为长上下文与 Agent 场景做的架构与后训练设计,读者可据此评估开源模型跑长任务的部署成本。
OpenAI 发布了 GPT-5.5 的 System Card(系统卡)。本次抓取仅获取到标题,正文内容缺失,具体模型能力与安全评估信息以原文链接为准:https://openai.com/index/gpt-5-5-system-card
OpenAI 发布 GPT-5.5,面向编程、研究和数据分析等复杂任务,支持跨工具使用。
ChatGPT Work 提供面向日常工作的实用工作流,覆盖重复性任务、更新汇报、调研、规划以及团队协作运营等场景,帮助用户将这些常见工作环节交给 ChatGPT 处理。
Hugging Face 发布教程,指导开发者在 Manifest V3 约束下用 Transformers.js 在 Chrome 扩展中运行本地 AI,并复刻其 Gemma 4 Browser Assistant 架构。
推荐理由:作者基于自家 Gemma 4 浏览器扩展拆解 MV3 下运行 Transformers.js 的架构决策,给出可直接迁移的运行时划分与消息契约设计。
Google 宣布将一种新的照片视角重构方法作为 Google Photos Auto frame 功能上线,用 ML 模型估计 3D 点图和相机参数,再由生成式扩散模型补全新视角下未拍摄到的区域。方法分 3D 场景与相机估计、生成式修补两阶段,可自动矫正广角前摄的透视畸变,对含人物的合格照片提供一键重构视角的备选结果。
推荐理由:原文解释了将照片当作 3D 场景重建并重定位虚拟相机的两阶段方法,读者可以了解生成式修图与经典裁剪的区别。
OpenAI 将 ChatGPT for Clinicians 免费提供给经认证的美国医生、执业护士和药剂师使用。该服务支持临床诊疗、文书记录和研究工作。
Google DeepMind 发布 Decoupled DiLoCo 分布式训练架构,将训练拆分为异步通信的“岛屿”(learner units),可在全球分布的数据中心间训练 LLM。
OpenAI 深入解析了 Codex 智能体循环,展示如何在 Responses API 中用 WebSocket 和连接级缓存降低 API 开销、改善模型延迟。文中说明了 WebSocket 连接复用如何为智能体工作流提速。该能力通过 Responses API 提供。
OpenAI 在 ChatGPT 中推出 workspace agents,这是由 Codex 驱动的智能体,可自动化复杂工作流并在云端运行。该功能面向团队,帮助团队安全地跨工具扩展工作。
OpenAI 介绍如何在 ChatGPT 中构建和使用工作区智能体(workspace agents),用于自动化可重复的工作流。这些智能体可连接各类工具,简化团队运营流程。
OpenAI 发布 Privacy Filter,一个开放权重(open-weight)模型,用于检测并脱敏文本中的个人身份信息(PII),准确率达到当前最先进水平。
Google Research 在 ICLR 论文中提出 ReasoningBank,一个从成功与失败经验中提炼结构化推理记忆的智能体框架,并开源了代码。它以检索、提取、整合的闭环运行,把失败案例转化为预防性经验;配合记忆感知的测试时扩展(MaTTS)进一步提效。
Google DeepMind 宣布与 Accenture、Bain & Company、BCG、Deloitte 和 McKinsey 合作,帮助企业规模化采用前沿 AI。
OpenAI 发布 ChatGPT Images 2.0,改进了文字渲染、多语言支持和视觉推理能力。该介绍同时引导读者查看 Images 2.5 的新内容,feed 仅提供摘要,未见完整正文细节。
Hugging Face 推出 QIMMA(قِمّة,意为“峰顶”),先对基准做质量校验再评估模型,确保分数反映真实的阿拉伯语能力。QIMMA 整合 14 个基准的 109 个子集、超 52,000 样本,覆盖文化、STEM、法律、医疗、安全、文学和代码 7 个领域,99% 为原生阿拉伯语内容。
OpenAI 推出 Codex Labs,并与 Accenture、PwC、Infosys 等伙伴合作,帮助企业在软件开发全生命周期中部署和扩展 Codex。同时 Codex 周活跃用户达到 4M。
Hugging Face 发文分析网络安全进入 AI 加速时代后的格局,认为关键在于模型所嵌入的系统而非模型本身,开放生态可在检测、验证、协调、补丁四个阶段分散风险、缩小攻防能力差距。文章主张防御方采用半自主 AI 智能体,配合开源安全工具在组织内部署,并保留人类审批与可审计的决策日志。
推荐理由:原文从 Mythos 出发分析开放生态为何是防御方的结构性优势,并给出半自主智能体的可行防御路线。