OpenAI 推出 Economic Research Exchange 经济研究交流计划
OpenAI 推出 Economic Research Exchange,用于研究 AI 对就业、生产率和经济的影响。该计划现已开放申请,入选的研究项目可获得支持。
OpenAI 推出 Economic Research Exchange,用于研究 AI 对就业、生产率和经济的影响。该计划现已开放申请,入选的研究项目可获得支持。
Google 推出由 Agentic RAG 驱动的 Gemini Enterprise Agent Platform 版 Cross-Corpus Retrieval,采用多智能体架构(Orchestrator、Planner Agent、Query Rewriter、Search Fanout Agent 等)处理多数据源、多跳查询。
Google 在 Nature 发表 PHRM 研究系统,利用人脸解锁后的前摄视频,通过深度学习在后台估计心率,相比 ECG 的 MAPE 为 6.09%,日静息心率相对 Fitbit Charge 6 的 MAE 为 4.39 bpm。研究覆盖近 700 名不同肤色参与者,是迄今最大规模的 rPPG 研究,并公开发布数据集与预训练 PHRM-mini 模型供合格研究者申请使用。
推荐理由:原文给出跨肤色验证数据与免费开放的数据集和模型入口,研究者可以据此评估rPPG方法的可复用性。
NVIDIA 发布 Nemotron 3.5 Content Safety,基于 Gemma 3 4B IT 微调,将多模态输入、12 种语言显式训练覆盖、自定义策略执行和可审计推理轨迹统一到一次推理调用中。
Endava 正在利用 AI 智能体、ChatGPT Enterprise 和 Codex 加速软件交付,并自动化工作流程。该公司同时在整个企业范围内建设 AI 原生文化,推动 AI 融入日常研发与业务流程。
ChatGPT 推出名为 Dreaming 的新记忆系统,用于更好地记住用户偏好,保持跨对话上下文新鲜且相关。官方称该系统让 ChatGPT 在对话间提供更有帮助的体验。
OpenAI 发布《智能时代的生物防御》报告,提出一份利用 AI 增强生物韧性的行动计划。
Hugging Face 重构官方 hf CLI,使其同时服务人类和 Claude Code、Codex、Cursor 等编码 Agent,hf v1.9.0 引入按环境变量自动检测的 agent 模式,输出 TSV、完整字段、无 ANSI、不截断,并提供 next-command 提示、--yes/--dry-run 等安全重试设计。
推荐理由:官方实测数据显示 CLI 在多步 Hub 任务上可把 token 消耗降到手工 curl/SDK 的几分之一,方法与结论可迁移给 Agent 工具设计。
Google Research 在 GitHub 上以 Apache 2.0 许可开源其水文建模框架,让各国气象水文部门可将 AI 洪水预报整合进自身工作流。
推荐理由:原文说明了开源水文框架的架构、训练数据和性能提升,读者可据此评估如何在本地流域部署 AI 洪水预报。
OpenAI 宣布为 GPT-Rosalind 推出新能力,推进生命科学研究。新能力包括增强的生物推理、药物化学专长、基因组学分析以及实验工作流能力。
Hugging Face 在 DharmaOCR 训练中把 DPO 用于聊天对齐之外的场景:用模型自身失败产生的退化循环构建拒绝对,作为第二训练阶段降低结构化 OCR 的文本退化率。
Wasmer 使用 Codex(配合 GPT-5.5)构建了一个面向边缘环境的 Node.js 运行时。该方案将开发速度提升 10x 到 20x,原本需要数月的交付缩短至数周。
OpenAI 公布其 AI 公共政策议程,涵盖 AI 安全、青少年保护、劳动力转型以及全球标准等内容,目标是确保 AI 惠及社会。
OpenAI 提出一份面向美国的前沿 AI 治理蓝图,主张建立联邦层面的监管框架。该框架聚焦安全、韧性与国家安全三个方向。
Reachy Mini 对话应用现在可以通过 MCP 调用托管在公开 Hugging Face Spaces 上的远程工具,无需修改应用即可为机器人添加查天气、搜索网页等新能力。
Hcompany 发布 Holo3.1 系列 Computer Use 模型,提供 0.8B、4B、9B 和 35B-A3B 四种尺寸。
推荐理由:官方给出各尺寸在 OSWorld 与 AndroidWorld 的量化后表现和部署路径,读者可据此评估本地 Computer Use Agent 的可行性。
Travelers 与 OpenAI 合作开发的 AI 理赔助手 Claim Assistant 已在美国全国范围内部署。该工具可引导客户完成理赔申请,提供 24/7 全天候支持,并在理赔高峰期帮助公司扩展运营能力。
OpenAI 推出 ChatGPT Sites,用户可以用 Codex 创建轻量级网站或应用。目前公开信息有限,该功能的核心用途即通过 Codex 生成这类轻量网页内容。
OpenAI 推出 Codex 插件、站点和标注功能,帮助分析师、营销人员、设计师和投资人等不同团队更高效地用 AI 完成工作。这些新能力让 Codex 覆盖更多角色与工作流场景。
OpenAI 呼吁全球共同推进青少年 AI 安全,提议建立一家国际机构,以强化针对年轻人的安全保障、标准与发展机会。该提案聚焦通过全球协作提升青少年的安全防护与成长机遇。
OpenAI 发布《The Next Era of Knowledge Work》报告,探讨 Codex 如何通过 AI 驱动的研究、数据分析、工作流自动化和内容创作来变革生产力。报告指出 Codex 正在成为面向所有人的生产力工具。
OpenAI 阐述其在 AI 政策与政治倡导方面的做法,强调透明度以及对审慎监管和 AI 安全的支持。公司同时声明,没有任何外部政治团体可以代表 OpenAI 发声。
JetBrains 发布 Mellum2,一个总参数 12B、每 token 仅激活 2.5B 的开源 Mixture-of-Experts 模型,在自然语言和代码语料上从头训练,采用 Apache 2.0 许可证。
IBM 在四个企业场景(Cobol/PL/1 遗留代码理解、Aster 测试生成、事件响应等)中验证:在智能体层加入程序分析、知识图谱等 agent logic,可约束 LLM 的上下文空间。
OpenAI 在密歇根州动工建设一个 1GW 数据中心项目,属于 Stargate 计划的一部分。该项目旨在扩展 AI 基础设施,扩大模型访问范围、创造就业并支持当地社区。
OpenAI 前沿模型与 Codex 已在 AWS 正式可用,企业可通过既有的 AWS 环境、管控和采购流程使用 OpenAI 构建应用。客户可在 AWS 上开始使用 OpenAI,加快从评估到生产落地的进程。
OpenAI 封禁了一个疑似源自 PRC 的账号集群,该集群利用 AI 生成批评美国数据中心和 AI 基础设施的社交媒体内容。该行动被称为“Data Center Bandwagon”(数据中心大篷车)campaign,属于针对美国的影响力活动。
OpenAI 封禁了疑似源自中国的账号,这些账号使用 AI 生成关于美国科技政策、关税和贸易限制的评论与漫画,属于针对美国科技政策的影响力活动。
Braintrust 工程师使用 Codex 与 GPT-5.5 将客户需求转化为代码。借助这一组合,团队能够更快地运行实验和编写代码。
波士顿儿童医院(Boston Children's Hospital)使用 OpenAI 技术改善患者护理并减轻运营负担,已协助诊断超过 40 例罕见病。该医院将 AI 用于提升诊疗效率和临床诊断能力。
OpenAI 推出 Rosalind Biodefense,向经过审查的开发者和美国政府合作伙伴扩大 GPT-Rosalind 的受信任访问。该项目旨在借助前沿 AI 推进生物防御、公共卫生和大流行防范工作。
Hugging Face 发布 PyTorch 性能分析系列教程第一篇,面向初学者讲解 torch.profiler 的设置与使用。
OpenAI 发布第三方 AI 评估指南,说明如何评估前沿系统的模型能力、安全防护措施及评估有效性。该指南旨在为可信的第三方评估提供一套通用方法。
Google Research 在 I/O 2026 上发布 Gemini for Science,包含基于 ERA 和 AlphaEvolve 构建的 Computational Discovery。
Mistral 在 AI Now Summit 2026 上发布面向工业工程的 AI 全栈方案,并与 Airbus、BMW 和 ASML 合作优化设计、仿真与生产。其智能体工具 Vibe 升级为可执行长程多步任务,涵盖深度研究、代码修复与提交可审查的 PR。位于法国 Les Ulis 的新 10 MW 推理数据中心计划于 2026 年第三季度启用。
Mistral 发布统一智能体 Vibe,Le Chat 品牌正式升级,一个许可同时覆盖工作与编码。
推荐理由:Mistral 官方公布了 Le Chat 升级为统一智能体 Vibe 的具体能力与各端入口,读者可据此评估其在工作与编码场景中的可用性。
Endava 使用 Codex 构建智能体组织,加速软件交付,并将需求分析时间从数周缩短到数小时。
Mistral AI 发布开源框架 Search Toolkit 公共预览版,将数据摄取、检索与评估整合为单一框架,供企业构建生产级搜索管线。内置 BM25、稠密向量与混合检索,以及 recall、precision、MRR、NDCG 评估指标,模块共享统一配置接口;已在金融、制造、公共服务等行业验证,CMA CGM 配合 Voxtral 用于假新闻检测,音频管线端到端 15 秒内返回告警。
OpenAI 公布其前沿治理框架,阐述在 AI 安全、安保与风险方面的实践。该框架明确了其做法如何与欧盟及加州新兴监管法规保持一致。
Google Research 提出一种零信任隐私分析方案,用新型格密码协议让设备通过单条消息完成安全聚合,无需多轮在线交互,并结合 TEE 远程证明形成多层防御。该方案将用于 Android SafetyCore,在不接触用户原始内容的情况下度量安全模型的真实准确率,帮助优化分类器阈值。