Mistral 在慕尼黑设立德国中心,主攻工业 AI 与 Physics AI
Mistral 在慕尼黑开设新中心,聚焦 Physics AI 与工业 AI,并计划到 2030 年建成 1 GW 欧洲算力。2026 年 5 月收购 Emmi AI 后超过 30 名物理与工程 AI 人员加入,目前正与 BMW 合作碰撞仿真、与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学(TUM)开展汽车空气动力学数字孪生研究。
Mistral 在慕尼黑开设新中心,聚焦 Physics AI 与工业 AI,并计划到 2030 年建成 1 GW 欧洲算力。2026 年 5 月收购 Emmi AI 后超过 30 名物理与工程 AI 人员加入,目前正与 BMW 合作碰撞仿真、与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学(TUM)开展汽车空气动力学数字孪生研究。
AWS 在 Machine Learning Blog 上展示了用 Amazon Nova Act 与 Amazon Bedrock AgentCore 构建智能体驱动的合成监控方案,模拟登录、结账等关键用户旅程,替代依赖 DOM 选择器、易因 UI 变化失效的 Selenium/Playwright 脚本。
Hcompany 发布 Holo4 智能体系列模型,含 27B dense 和 35B-A3B MoE 两个尺寸,并更新发布 Holotron4 Nano。模型可通过 GUI、代码、MCP 和 API 多种接口操作软件,在 OSWorld 2.0 上 Holo4 27B 得分 61.7%(Opus 5.5 为 81.8%),35B-A3B 达 30.9%,参数量和成本显著更低。
推荐理由:原文给出 OSWorld 2.0 等基准分数、成本对比和全部轨迹开源信息,读者可以据此评估这款多接口智能体模型是否适配自己的业务工作流。
OpenAI 扩大对 Lenfest AI Collaborative and Fellowship Program 的支持,提供 500 万美元资金以及最高 500 万美元的软件额度和工程支持。Lenfest 研究所借此扩大这一标志性项目规模。
GitHub Copilot app 的 canvases 功能让用户用 /create-canvas 技能以自然语言描述生成看板、清单等自定义界面,无需编码。画布是双向共享的,用户和 Agent 可同时操作并实时同步状态,创建后可作为扩展保存供个人或团队复用,社区还通过 Awesome Copilot 提供了现成的 canvas 扩展。
聊天仍是与 LLM 交互的主要方式,但作者认为在多数场景下 chat 并非合适的 UI。GitHub Copilot app 中的 canvas 是一个可与 agent 双向通信的全栈小应用,既能调用第三方 API,也能在本地执行代码,文中演示了用它玩 Connect 4、管理 Winget 包、操作 SQLite 数据库以及自动化开发工作流。
Google Research 发布 AI 视频 Co-Director 研究,在 Gemini 与 Veo 之上构建统一多智能体框架,通过全局优化与世界状态追踪生成连贯的分钟级多镜头视频。
GitHub Security Lab 的 Antonio Morales 发布开源 Fuzzing Taskflow,基于 Taskflow Agent 为 C/C++ 项目提供自主模糊测试流水线。
推荐理由:作者亲述设计取舍,读者可以照着跑起来,并理解 LLM 智能体如何接管模糊测试中重复的人工环节。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与原生实时对话结合,让模型具备唇形同步、自然表情和流畅轮次切换的动态视觉形象。
Liquid AI 发布面向视觉语言模型 LFM2.5-VL-3B 的实验性 DSpark 草稿模型,通过投机解码在不改变输出质量的前提下换取加速。
推荐理由:原文给出视觉 DSpark 草稿模型的架构细节、实测加速数字和三大推理框架接入方式,读者可评估端侧 VLM 推理加速的可迁移做法。
NVIDIA 与 Google DeepMind、EMBL-EBI 等机构合作,通过 AlphaFold Database 开放发布超过 2,800 种病毒蛋白复合物的预测 3D 结构。
GitHub 团队在 GitHub Copilot 应用中重建了 pull request 视图,以支持超大规模 diff 的流畅浏览。他们测试了一个含 2200 个文件、超过一百万行变更和 400 多条行内评论的开源 PR,通过将高度拆分为确定性代码几何与动态块几何两套体系,解决了评论高度只有渲染后才能测量的问题。团队还定义了健康指标并持续进行自动化测量与改进循环。
Microsoft Research 的研究挑战了机器人 AI 推理必须完全依赖机载 GPU 的假设,显示卸载到边缘或云端 GPU 可提升任务成功率、响应速度和精度。
Google Private AI Compute 团队宣布为其平台增加私密的服务端持久 AI 记忆能力。用户数据保存在云端加密存储中,解密密钥仅存于个人设备,模型在硬件隔离的 secure enclave 中临时解密处理后再加密,连 Google 也无法访问。配套措施包括更新技术白皮书、防篡改的公开软件记录及第三方网络安全公司独立审计结果。
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词在 100 多种语言和方言中定制角色声音,可从 30 秒音频样本复刻声音,并提供 2000 多个现成声音。
推荐理由:官方介绍了两款 TTS 模型的定制能力、基准成绩和开放渠道,开发者可以据此评估语音生成方案的选型。
NVIDIA 验证工程师 Sakeena Fiza 负责在量产前检验数据中心系统,让硬件在真实条件下被压测到极限,目标是抢在客户之前发现问题。她参与过 NVIDIA Rubin GPU 首次在系统层面点亮(enumerated)的时刻,工作覆盖固件、硬件、软件、机械、散热与制造等环节。从单板数万个元件到整机架近 50 万个元件,她通过复现问题、排查固件与信号等方式追查各类故障根因。
invideo 使用 GPT‑6 Astra 提升视频编辑精度,色彩校正与调色效率提升三倍,并可在一天内制作 50 个自定义特效。
NVIDIA 于 9 月 22-23 日在新加坡举办 AI Day,与合作伙伴展示东南亚地区的 AI 进展。
NVIDIA 在多伦多 ROSCon 大会上发布 Isaac ROS 5.0,新增面向智能体的工作流、Isaac skills 和对 ROS Lyrical 与 Ubuntu 24.04 的支持。
oMLX 的创建者和维护者 Jun Kim 加入 Hugging Face,将把 oMLX 从副业转变为获得完全维护和资金支持的项目,oMLX 仍保持 Apache 2.0 开源并由 Jun 继续领导。
UK AISI 正在使用 EvalEval 的基础设施公开分享评测结果,以提升评测的可复现性与可验证性。
Hugging Face 宣布 transformers 支持通过 from_pretrained 直接加载 GGUF 量化模型,复用 ggml 的 Metal 内核以接近 llama.cpp 的性能。
推荐理由:官方介绍 transformers 直接加载 GGUF 的用法、量化选择和与 llama.cpp 的对比数据,对想在 Mac 上本地推理的开发者有实用参考。
NVIDIA 推出 DSX Ready 认证计划,对符合 NVIDIA DSX AI 工厂参考设计要求的合作伙伴产品进行资格认证,首批开放电池储能系统(BESS)和冷却分配单元(CDU)两个类别。
NVIDIA 指出 Physical AI 规模化部署需要贯穿硬件、软件、AI 与运行环境全生命周期的安全体系,并推出 Halos——首个也是唯一的 Physical AI 全栈安全系统。
埃及 AI 生态活动在 Grand Egyptian Museum 举行,NVIDIA EMEA 副总裁 Paolo Guglielmini 发表主题演讲,埃及的 NVIDIA Deep Learning Institute 学习者规模一年内增长超十倍。
Microsoft Research 的逆合成模型 RetroChimera 发表于 Nature,结合 Transformer 架构的 R-SMILES 2 与基于 GNN 的 NeuralLoc 两个子模型,用 learning-to-rank 集成策略生成合成路线。
NVIDIA 提出 AI 安全应作为工程问题来对待,需要明确的防护要求、可执行的控制措施、指定负责人和防护有效的证据。安全防护应覆盖模型、harness 和运行环境的完整 Agent 技术栈,NVIDIA 开源的 OpenShell 提供了在 Agent 之外执行策略的沙箱运行时,Cisco 的 DefenseClaw 和 JFrog 在其上构建治理与技能扫描能力。
Higgsfield AI 使用 GPT-6 Astra 在一天内推出新的视频功能,为小企业简化视频广告制作,并更快地将新创意工具推向市场。
NVIDIA 在纽约气候周介绍五家将 AI 融入清洁能源项目的公司。ThinkLabs AI 用 NVIDIA CUDA 平台构建数字孪生和智能体,使 Southern California Edison 的电网互联申请评估时间从 30-45 天缩短到两分钟。
Hugging Face 发布 tokenizers v1 的 release candidate,在 Apple M4 Max 单线程上编码速度比 v0.23 快 3 到 30 倍(低端 t5-base,高端 gpt2),八线程扩展达线性的 76%。
推荐理由:Hugging Face 官方实测数据说明 tokenizers v1 为何能比 v0.23 快 3 到 30 倍,读者可以借此判断升级对训练和推理工作流的影响。
Google Research 推出 MilleMiglia,一个用 C++ 编写的实例生成器,可为中英里(middle-mile)物流网络生成贴近现实且保护隐私的基准数据,源代码与文档已在 GitHub 开放。
GitHub Podcast 最新一期逐条拆解五个常见 AI 观点:AI 生成代码仍需人工审查,但注意力应放在高风险处;Skills 与 MCP 解决不同问题,前者提供打包的专业知识、后者提供工具与数据接入标准,二者可组合使用;RAG 也没有死,好的检索能让模型更接近答案,与 Agent、skills、MAG 等可共存于同一工作流。
OpenAI 发布澳大利亚青少年安全蓝图(Australian Youth Safety Blueprint),这是一份包含六大支柱的路线图,旨在为青少年提供更安全、更具赋能作用的 AI 体验。
Google Research 推出一项研究实验,让教师利用生成式 UI(GenUI)动态创建定制化、有引导的教育模拟互动内容。团队已发布 30 多个面向初高中 STEM 学科的英文学习互动示例,全部由 AI 生成并经教师审核。使用 Google Workspace for Education 的学校可通过 Google for Education Pilot Program 报名提供反馈。
Pawprint Studio 的免费开放世界生物捕捉 RPG《Aniimo》于 9 月 15 日上线 GeForce NOW,玩家可捕捉 Aniimo 伙伴、与其 Twine 变形解谜战斗,无需下载 45GB 即可跨设备串流。
GitHub 用 Copilot agent 将 Copilot agent runtime 从 TypeScript 完整重写为 832,378 行生产 Rust,AI 编写了大部分代码,历时约 14.5 周、128 个 PR,采用原地逐组件替换而非一次性切换,性能有数量级提升。
推荐理由:一手复盘给出原地迁移策略、缓存命中率与子会话协作细节,对规划大规模 agent 辅助重写有可借鉴方法。
NVIDIA Vera Rubin NVL72 首次参加 MLPerf Inference v6.1 预览提交即取得领先性能:在 Qwen3-VL 上吞吐量最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上使用 TensorRT-LLM 最高达 2.5 倍。
Emerald AI、Google 与 NVIDIA 宣布成立 AI Energy Management Alliance(AEMA),推动数据中心根据电网状况动态调节用电,使 AI 基础设施与电网协同。
OpenAI 推出 AI 驱动的广告新体验,包括 Sponsored Agents 赞助智能体、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。
ChatGPT Work 和 Codex analytics 可帮助团队了解 AI 使用与支出情况,识别培训需求,并将 AI 采用与业务成果关联起来,从而把 AI 使用转化为可衡量的业务价值。