Google Research 在 I/O 2026 迈入科学发现新时代
Google Research 在 I/O 2026 上发布 Gemini for Science,包含基于 ERA 和 AlphaEvolve 构建的 Computational Discovery。
Google Research 在 I/O 2026 上发布 Gemini for Science,包含基于 ERA 和 AlphaEvolve 构建的 Computational Discovery。
Mistral 在 AI Now Summit 2026 上发布面向工业工程的 AI 全栈方案,并与 Airbus、BMW 和 ASML 合作优化设计、仿真与生产。其智能体工具 Vibe 升级为可执行长程多步任务,涵盖深度研究、代码修复与提交可审查的 PR。位于法国 Les Ulis 的新 10 MW 推理数据中心计划于 2026 年第三季度启用。
Mistral 发布统一智能体 Vibe,Le Chat 品牌正式升级,一个许可同时覆盖工作与编码。
推荐理由:Mistral 官方公布了 Le Chat 升级为统一智能体 Vibe 的具体能力与各端入口,读者可据此评估其在工作与编码场景中的可用性。
Endava 使用 Codex 构建智能体组织,加速软件交付,并将需求分析时间从数周缩短到数小时。
Mistral AI 发布开源框架 Search Toolkit 公共预览版,将数据摄取、检索与评估整合为单一框架,供企业构建生产级搜索管线。内置 BM25、稠密向量与混合检索,以及 recall、precision、MRR、NDCG 评估指标,模块共享统一配置接口;已在金融、制造、公共服务等行业验证,CMA CGM 配合 Voxtral 用于假新闻检测,音频管线端到端 15 秒内返回告警。
OpenAI 公布其前沿治理框架,阐述在 AI 安全、安保与风险方面的实践。该框架明确了其做法如何与欧盟及加州新兴监管法规保持一致。
Google Research 提出一种零信任隐私分析方案,用新型格密码协议让设备通过单条消息完成安全聚合,无需多轮在线交互,并结合 TEE 远程证明形成多层防御。该方案将用于 Android SafetyCore,在不接触用户原始内容的情况下度量安全模型的真实准确率,帮助优化分类器阈值。
Mistral 收购 Emmi AI,进入物理 AI 领域,为工业工程构建新的基础能力。物理 AI 模型从求解器输出中学习,在单 GPU 上数秒内从几何与边界条件直接预测物理场,而传统 CFD/FEM 仿真每个设计变体需数小时到数周。该能力支持快速设计探索、工装与工艺优化和实时数字孪生,已服务于 ASML、Airbus、Safran 和 Siemens Energy 等合作伙伴。
Mistral 收购工业仿真公司 Emmi AI,加码面向航空航天、汽车、半导体和能源等行业的 Physics AI 基础研究。
Cisco 与 OpenAI 合作,通过 Codex 重塑企业级工程。Cisco 借助 Codex 扩展 AI 原生开发,加速 AI Defense 相关工作,并实现缺陷修复自动化。
OpenAI 与 Thrive、Crete 基于 Codex 构建了能自我改进的税务智能体,实现申报自动化。该智能体提升了准确性并加快了工作流程。
Hugging Face 发布教程,教 Reachy Mini 用户用 speech-to-speech 库跑通完全本地的语音对话管线,音频不再上传服务器,无需云端和 API key。
Hugging Face 在 TRL 中合入 Delta Weight Sync 功能(PR huggingface/trl#5417),将相邻 RL 步之间约 99% 未变化的 bf16 权重剔除,只编码变化元素为稀疏 safetensors 文件,经 Hub Bucket 供 vLLM 拉取。
Warp 使用 GPT-5.5 及 OpenAI 模型,在本地、云端和开源开发工作流中协调编码智能体。这一举措体现了 Warp 对基于 GPT-5.5 构建开源工具的重点投入。
OpenAI 公布 2026 年选举期间的应对措施,涵盖可靠选举信息、网络防御、AI 透明度、滥用防护和偏见监测五个方面。这是 OpenAI 支持全球选举、防范 AI 工具被滥用的整体安全保障方案。
Import AI 第 458 期刊登作者在牛津大学人类中心 AI 实验室(HAI Lab)与 Cosmos Institute 合办的 2026 Cosmos HAI Lab 演讲改编的长文,提出面对 AI 持续进步,人们可以选择“探索未来”或“逃避当下”。
OpenAI 发布新研究,显示 400 万美国人使用 ChatGPT 来创办、经营和发展小企业。AI 降低了创业成本,正在成为小企业主的第一批“员工”。
OpenAI 宣布与巴西媒体集团 Grupo Folha 和 Grupo UOL 达成战略内容合作,将可靠的巴西新闻引入 ChatGPT。合作强调内容署名与透明度,扩展用户获取新闻的途径。
Hugging Face 发布 AI Agent 术语表,解释 agent 领域常被混用的术语,核心区分是模型、脚手架与 harness 三层。
Mistral AI 宣布与 Physics AI 公司 Emmi AI 达成最终收购协议,强化其面向工业企业的 AI 转型服务。Emmi AI 成立于奥地利,团队超过 30 名研究人员和工程师,将加入 Mistral 的 Science 和 Applied AI 团队;其大型工程模型可用于实时仿真替代多天计算和构建数字孪生,并推进 Mistral 的 Science 路线图。
Mistral 发布 Mistral Medium 3.5 公测版,一个 128B 稠密模型,256k 上下文窗口,SWE-Bench Verified 得分 77.6%,以修改版 MIT 许可开放权重,最少可在四块 GPU 上自托管。
推荐理由:官方发布给出基准成绩、定价和开放权重细节,读者可以据此评估其在自托管编码场景的可行性。
Mistral 发布 Studio 中的 Connectors(Public Preview),内置连接器与自定义 MCP 可通过 API/SDK 用于所有模型和 Agent 调用。
Virgin Atlantic 使用 Codex 在固定的假日出行截止期限前完成了新版移动 App 的交付。该团队借此实现了接近全覆盖的单元测试,并做到零 P1 缺陷。
OpenAI 入选 2026 年 Gartner 企业级 AI 编程智能体魔力象限领导者(Leader)。Codex 因创新性和企业级规模部署能力获得认可。
Google DeepMind 在亚太地区推出首期 "AI for the Planet" 加速器项目,为期三个月,面向该地区的初创公司、研究团队和非营利组织,用前沿 AI 解决自然、气候、农业、能源等领域的环境问题。入选机构将获得专家导师指导、定制支持,以及 Google AI 专家在整合前沿 AI 与科学 AI 模型方面的帮助。项目以新加坡的线下训练营开营,现已开放报名意向登记。
AdventHealth 正在使用 ChatGPT for Healthcare 简化工作流程,减轻行政负担,把更多时间还给患者护理。
OpenAI 宣布推进 Education for Countries 计划进入下一阶段,通过新的合作伙伴关系扩大 AI 在学校中的应用。该计划还包括教师培训和相关工具,以改善全球学习效果。
OpenAI 宣布其模型解决了有 80 年历史的单位距离问题,推翻了离散几何中的一个重要猜想。官方称这是 AI 驱动数学研究的里程碑。
推荐理由:OpenAI 官方宣布模型在数学研究上解决 80 年悬而未决的问题,可关注其对 AI 驱动数学研究的意义。
Ramp 工程师使用搭配 GPT-5.5 的 Codex 进行代码审查并发布改进,将获得实质性反馈的时间从数小时缩短到数分钟。
OpenAI 推出 OpenAI for Singapore,启动多年期 AI 合作计划,扩大 AI 部署规模、培养本地人才,并为企业与公共服务提供 AI 支持。
Hugging Face 发布 OlmoEarth v1.1,新一代对地观测模型家族,计算成本最高降低 3x,同时在研究基准和合作任务上保持 v1 的性能。效率提升来自减少 token 序列长度:将 Sentinel-2 三个分辨率的 token 合并为单个 token,并通过修改预训练方法避免性能下降。新家族提供 Base、Tiny、Nano 三种规格,权重和训练代码已开放获取。
Google 发布基于 Gemini 的科学研究工具 ERA,可搜索文献、编写和用树搜索优化科学代码,在基因组学、公共卫生、卫星图像、神经科学、时间序列预测和数学等基准上达到专家级表现,论文发表于 Nature。
推荐理由:原文给出 ERA 的树搜索方法、多领域基准结果和五篇应用论文细节,并说明新工具的开放入口,读者可了解它如何用于具体科学问题。
OpenAI 推进 AI 内容溯源,推出 Content Credentials、SynthID 及一款验证工具,帮助用户识别并信任 AI 生成的媒体内容。这些举措旨在提升 AI 生态的透明度与可信度。
Hugging Face 的 Tom Aarsen 发布 ettin-reranker-v1 系列,含 17M 到 1B 六个 Sentence Transformers CrossEncoder 重排序模型,基于 Ettin ModernBERT 编码器,Apache 2.0 许可,支持最长 8192 token 上下文。
推荐理由:作者公开了六个模型、完整训练脚本和1.43亿条蒸馏数据,并给出与主流reranker的速度和精度对比,便于按规模选型或自行复现训练。
Google DeepMind 介绍科学家 Omar Abudayyeh 与 Jonathan Gootenberg 实验室用 Co-Scientist 加速抗衰老基因研究。该系统扫描数万篇论文提出 20 多个可测试的新遗传因子,部分经实验验证能推动细胞脱离衰老状态、功能改善;原先需约六个月的筛选数据分析被缩短到几天。
PaddleOCR 3.5 通过新增 engine 参数让支持的模型(如 PP-OCRv5、PaddleOCR-VL 1.5)可用 Hugging Face Transformers 作为推理后端,并提供 engine_config 配置 dtype、设备与 attention 实现等选项。
SentinelOne 研究人员剖析了约 20 年前名为 fast16.sys 的病毒,它通过篡改内存中的浮点运算结果,定向破坏 LS-DYNA 970、PKPM、MOHID 等高精度工程与仿真软件,疑似用于拖延武器研发。
OpenAI 与 Dell 达成合作,将 Codex 引入混合部署与本地部署环境,帮助企业安全地在自有数据和工作流中部署 AI 编程智能体。
Google DeepMind 在 Project Genie 中推出 Street View 街景落地能力,用户可选美国地点并套用 Ocean World、B&W film 等风格生成可交互世界,底层由 Maps Imagery Grounding 支撑。
Google DeepMind 发布 Gemini Omni 系列首个模型 Gemini Omni Flash,可组合图像、音频、视频和文本输入生成视频,并支持自然语言多轮编辑。
推荐理由:官方说明了视频生成与对话式编辑的具体能力和订阅范围,读者可以据此判断它是否适配现有创作流程。