Google DeepMind 与 Isomorphic Labs 公布生物韧性方法
Google DeepMind 与 Isomorphic Labs 于 2026 年 7 月 16 日发布联合的生物韧性方法,目标是防止模型被滥用,并帮助政府、科学家等利用 AI 提升应对未来疫情的能力。
Google DeepMind 与 Isomorphic Labs 于 2026 年 7 月 16 日发布联合的生物韧性方法,目标是防止模型被滥用,并帮助政府、科学家等利用 AI 提升应对未来疫情的能力。
OpenAI 创意团队将 Codex 用作协作者,借助具备上下文感知能力的 AI 构建定制创意工具、加速创意构思并更快完成原型开发。
Hugging Face 披露本周检测并处置了一起生产基础设施入侵,攻击全程由自主 AI 智能体框架执行,涉及上万个动作,攻击者通过恶意数据集 abusing 两条代码执行路径获得初始访问,窃取了部分内部数据集和服务凭证。
推荐理由:官方披露了由自主 AI 智能体执行的入侵事件全程与处置细节,还总结了防御方自托管模型做取证的可迁移经验。
Cars24 使用 OpenAI 驱动的语音与聊天智能体,每月处理超过 100 万分钟对话,并挽回 12% 的流失线索。公司还将智能体工作流推广到内部多个团队,加快业务构建速度。
Google Research 在 ICLR 2026 发表的论文《On the Interpolation Effect of Score Smoothing in Diffusion Models》指出,扩散模型的“创造力”源于神经网络训练对 score function 的平滑效应。
IBM Research 团队在博文中提出,模型路由不是分类问题而是系统优化问题。他们在 AppWorld Test Challenge 上用同一 CodeAct agent 跑 417 个任务。
推荐理由:作者基于 417 个 AppWorld 任务的一手实测说明标价、缓存和基础设施如何左右路由成本,并把路由从分类问题转为优化问题,方法可迁移。
OpenAI 提出“反向联邦制”(reverse federalism)的 AI 治理思路,主张各州立法为构建全国性的安全、民主 AI 框架提供基础,通过州与联邦两级行动共同推进美国 AI 安全。
OpenAI 推出自动化红队系统 GPT-Red,通过自博弈(self-play)机制实现鲁棒性的自我提升。该系统用于改进 AI 安全、对齐和提示词注入防御能力。
Thinking Machines 在 Hugging Face 发布开源多模态模型 Inkling,总参数 975B、激活 41B 的 MoE 架构,原生接受图像、文本和音频输入,支持 1M 上下文窗口,训练数据为 45 万亿 token。
推荐理由:原文给出架构细节、各档位 VRAM 部署配置和多模态评测数据,对评估落地成本和选择变体有直接参考。
Hume 推出 Real World VoiceEQ 基准,评估 40 多个专有与开源语音模型,覆盖 ASR、TTS、S2S 和语音理解,含 15+ 维度、60+ 指标。
OpenAI 提出企业在智能体时代应以“每美元产生的有效工作”来衡量 AI 投资回报,通过提升效率、扩大高价值工作流规模来管理 AI 投入。文章面向企业,强调以实际产出而非成本为评估核心。
OpenAI 介绍 ChatGPT Work 在销售场景中的实用工作流,覆盖 pipeline briefs、会议准备、客户账户计划、预测回顾和交易诊断。这些工作流帮助销售团队将 ChatGPT Work 应用到日常销售环节中。
OpenAI 介绍 ChatGPT Work 在数据科学场景的实用工作流,涵盖根因简报、KPI 备忘录、范围明确的数据分析和仪表盘规格四类任务,帮助数据从业者把分析工作交给 ChatGPT 完成。
Google DeepMind 在印度推出 ATL Saathi 试点,这是一款基于 Gemini 的教育 Web 应用,为 Atal Tinkering Labs 教师提供 24/7 的备课与培训助手。
Deutsche Telekom 正借助 OpenAI 成为 AI 原生电信运营商,将 AI 用于客户服务、员工工作流和网络运营,并探索语音的未来。
OpenAI 发布 ChatGPT 入门指南,讲解如何开始第一次对话。内容涵盖用 AI 进行写作、头脑风暴和解决问题的简单方法。
Hugging Face 发布 Profiling in PyTorch 系列第三篇,用 A100 GPU 对比 naive attention、in-place 掩码、SDPA math/efficient/flash/cuDNN 六种实现的 profiler trace。
OpenAI 宣布 GPT-5.6 现已成为 Microsoft 365 Copilot 的首选模型。该模型为 Word、Excel、PowerPoint、Chat 和 Cowork 带来更强的 AI 能力,帮助用户更快完成更高质量的工作。
Mistral 推出 Studio,为企业的 Prompts 与 Skills 提供统一的 system of record,实现版本化、明确归属和全程可追溯。每个资产拥有不可变版本、审计日志和分类标签,支持快速迭代与受控上线,业务人员无需工程师也能直接改进生产指令。该功能现已向 Mistral Studio 客户开放,Skills 可作为 MCP servers 从 Studio 直接调用。
OpenAI 推出 GPT-5.6,主打更高智能与更强性价比:每个 token 产出更多智能,每美元获得更强性能,并按需提供更强能力以应对最难的工作。
OpenAI 推出 GPT-5.5 Bio Bug Bounty 计划,公布该生物安全赏金项目的相关细节。
OpenAI 官方宣布推出 ChatGPT Work 智能体,可跨用户的应用和文件采取行动,必要时可持续跟进一个项目数小时,把目标变成完成的工作。
推荐理由:官方宣布 ChatGPT 可跨应用与文件执行操作,读者可以据此判断它能承接多长时间的自主项目式工作。
Google Research 提出 SensorFM,一种大型传感器基础模型,基于 500 万名参与者、超过一万亿分钟的多模态可穿戴数据自监督预训练。
OpenAI 阐述其与政府及国家安全领域合作的方针,提出负责任使用 AI、民主问责与公共安全三项原则。
OpenAI 发布分析,指出流行的编码评测基准 SWE-Bench Pro 存在问题,引发对 AI 模型评估可靠性与准确性的担忧。
Mistral AI 发布首款具身导航模型 Robostral Navigate,8B 参数,仅用单个 RGB 相机加自然语言指令即可自主导航,R2R-CE validation unseen 成功率 76.6%,validation seen 为 79.4%,比最佳单相机方案高 9.7 分,比最佳深度或多相机系统高 4.5 分。
OpenAI Academy 与 Walton Family Foundation 联合推出 AI Skills Jams 实践活动,帮助 K-12 教师掌握课堂实用 AI 技能。该培训以动手实践形式进行,面向基础教育工作者。
OpenAI 发布新一代语音模型 GPT-Live,面向更自然的人机交互。该模型现已为 ChatGPT Voice 提供支持。
推荐理由:官方宣布新一代语音模型上线并接入 ChatGPT Voice,读者可据此关注语音交互体验的实际变化。
Hugging Face 宣布 vLLM 的 transformers modeling backend 在多类 LLM 架构上已达到甚至超过 vLLM 手写原生实现的吞吐。
推荐理由:原文给出三档 Qwen3 模型的吞吐对比和实现原理,读者可据此评估 transformers backend 能否替代手写 vLLM 实现来省掉移植成本。
Hugging Face 与 Amazon SageMaker AI 推出深度链接集成,开发者点击模型页上的 "Customize on SageMaker AI" 或 "Deploy on SageMaker AI" 按钮,即可直接进入 SageMaker Studio,模型已预加载、环境已配置。
Google Research 在《Nature Cities》发表首个大规模真实世界研究,通过修改 Google Maps 路由算法,在美国 10 个大城市引导不到 2% 的行程绕开拥堵路段。结果显示目标路段行驶速度中位数提升约 2%,油耗率下降 0.5%–1.0%,每城每年可减少数千吨 CO2e 排放,且导航用户与非用户均受益。
Microsoft 在 Build 2026 上推出 Foundry Managed Compute,并在 Foundry 模型目录中上线 Hugging Face 精选模型集,数以千计的开源权重模型每周更新,可一键部署到 NVIDIA A100、H100 或 AMD MI300X 加速器。
推荐理由:原文来自双方官方博客,详细说明了精选目录、curation 流程、运行时选择和部署模板,读者可以据此评估在 Foundry 上部署开源模型的实际路径。
UC Berkeley 的 Aditya G. Parameswaran 团队发文认为近零成本推理时代将重塑数据系统,提出三类议程:For Agents 重新设计系统以应对智能体高并发重复查询(实验中仅 10-20% 子计划不同)。
Australian Payments Plus(AP+)使用 ChatGPT Enterprise 和 Codex 应对支付业务的复杂性,从而加快工作速度。该公司节省了时间、提升了质量,并保持人工判断处于核心地位。
LeRobot v0.6.0 发布,引入 VLA-JEPA、FastWAM、LingBot-VA 三种会预测未来的世界模型策略,新增 GR00T N1.7、MolmoAct2、EO-1 等多个 VLA,以及统一奖励模型 API(Robometer、TOPReward)。
推荐理由:官方发布页完整列出各项新能力与配套工具,读者可以据此评估这次版本更新对机器人学习工作流的实际影响。
三菱日联金融集团(MUFG)使用 ChatGPT Enterprise 推进 AI 原生组织转型,优化内部工作流程,并大规模提供新的 AI 驱动金融服务。
SkyPilot 与 Hugging Face 联合推出 store: hf,用一条 hf:// URL 即可将 Hugging Face Bucket 或任意 Hub 仓库挂载进 SkyPilot 任务,作业可调度到 20+ 云、Kubernetes 和本地集群。
推荐理由:原文给出 hf:// 挂载、零 egress 读费与 Xet 去重的具体数字,读者可据此评估多云 GPU 任务的数据存储方案。
Photoroom 发布 PRX 系列第四篇博客,详解其 7B 文生图模型的预训练数据策略,包括用 Lance 建库、Mosaic Streaming(MDS)供流、分辨率与长宽比分桶等核心环节。
Jack Clark 主持的 Import AI 第 464 期汇总:Fable 在 KernelBench-Mega 上以 CUDA 代码取得 18.71X 加速。
Hugging Face 官方博客总结 🤗 Kernels 项目近几个月的重大更新。Hub 新增 kernel 仓库类型,可查看内核支持的加速器、操作系统和后端版本;默认只加载受信任发布者的内核,非受信来源需显式传 trust_remote_code=True,并引入基于 Sigstore cosign 的代码签名(加载时尚未默认验证)。