Wasmer 如何用 Codex 构建面向边缘的 Node.js 运行时
Wasmer 使用 Codex(配合 GPT-5.5)构建了一个面向边缘环境的 Node.js 运行时。该方案将开发速度提升 10x 到 20x,原本需要数月的交付缩短至数周。
Wasmer 使用 Codex(配合 GPT-5.5)构建了一个面向边缘环境的 Node.js 运行时。该方案将开发速度提升 10x 到 20x,原本需要数月的交付缩短至数周。
Hcompany 发布 Holo3.1 系列 Computer Use 模型,提供 0.8B、4B、9B 和 35B-A3B 四种尺寸。
推荐理由:官方给出各尺寸在 OSWorld 与 AndroidWorld 的量化后表现和部署路径,读者可据此评估本地 Computer Use Agent 的可行性。
OpenAI 推出 Codex 插件、站点和标注功能,帮助分析师、营销人员、设计师和投资人等不同团队更高效地用 AI 完成工作。这些新能力让 Codex 覆盖更多角色与工作流场景。
OpenAI 发布《The Next Era of Knowledge Work》报告,探讨 Codex 如何通过 AI 驱动的研究、数据分析、工作流自动化和内容创作来变革生产力。报告指出 Codex 正在成为面向所有人的生产力工具。
JetBrains 发布 Mellum2,一个总参数 12B、每 token 仅激活 2.5B 的开源 Mixture-of-Experts 模型,在自然语言和代码语料上从头训练,采用 Apache 2.0 许可证。
IBM 在四个企业场景(Cobol/PL/1 遗留代码理解、Aster 测试生成、事件响应等)中验证:在智能体层加入程序分析、知识图谱等 agent logic,可约束 LLM 的上下文空间。
Google Research 在 I/O 2026 上发布 Gemini for Science,包含基于 ERA 和 AlphaEvolve 构建的 Computational Discovery。
Mistral 在 AI Now Summit 2026 上发布面向工业工程的 AI 全栈方案,并与 Airbus、BMW 和 ASML 合作优化设计、仿真与生产。其智能体工具 Vibe 升级为可执行长程多步任务,涵盖深度研究、代码修复与提交可审查的 PR。位于法国 Les Ulis 的新 10 MW 推理数据中心计划于 2026 年第三季度启用。
Mistral 发布统一智能体 Vibe,Le Chat 品牌正式升级,一个许可同时覆盖工作与编码。
推荐理由:Mistral 官方公布了 Le Chat 升级为统一智能体 Vibe 的具体能力与各端入口,读者可据此评估其在工作与编码场景中的可用性。
Endava 使用 Codex 构建智能体组织,加速软件交付,并将需求分析时间从数周缩短到数小时。
Cisco 与 OpenAI 合作,通过 Codex 重塑企业级工程。Cisco 借助 Codex 扩展 AI 原生开发,加速 AI Defense 相关工作,并实现缺陷修复自动化。
OpenAI 与 Thrive、Crete 基于 Codex 构建了能自我改进的税务智能体,实现申报自动化。该智能体提升了准确性并加快了工作流程。
Warp 使用 GPT-5.5 及 OpenAI 模型,在本地、云端和开源开发工作流中协调编码智能体。这一举措体现了 Warp 对基于 GPT-5.5 构建开源工具的重点投入。
Hugging Face 发布 AI Agent 术语表,解释 agent 领域常被混用的术语,核心区分是模型、脚手架与 harness 三层。
Mistral AI 宣布与 Physics AI 公司 Emmi AI 达成最终收购协议,强化其面向工业企业的 AI 转型服务。Emmi AI 成立于奥地利,团队超过 30 名研究人员和工程师,将加入 Mistral 的 Science 和 Applied AI 团队;其大型工程模型可用于实时仿真替代多天计算和构建数字孪生,并推进 Mistral 的 Science 路线图。
Mistral 发布 Mistral Medium 3.5 公测版,一个 128B 稠密模型,256k 上下文窗口,SWE-Bench Verified 得分 77.6%,以修改版 MIT 许可开放权重,最少可在四块 GPU 上自托管。
推荐理由:官方发布给出基准成绩、定价和开放权重细节,读者可以据此评估其在自托管编码场景的可行性。
Mistral 发布 Studio 中的 Connectors(Public Preview),内置连接器与自定义 MCP 可通过 API/SDK 用于所有模型和 Agent 调用。
OpenAI 入选 2026 年 Gartner 企业级 AI 编程智能体魔力象限领导者(Leader)。Codex 因创新性和企业级规模部署能力获得认可。
Google 发布基于 Gemini 的科学研究工具 ERA,可搜索文献、编写和用树搜索优化科学代码,在基因组学、公共卫生、卫星图像、神经科学、时间序列预测和数学等基准上达到专家级表现,论文发表于 Nature。
推荐理由:原文给出 ERA 的树搜索方法、多领域基准结果和五篇应用论文细节,并说明新工具的开放入口,读者可了解它如何用于具体科学问题。
Google DeepMind 介绍科学家 Omar Abudayyeh 与 Jonathan Gootenberg 实验室用 Co-Scientist 加速抗衰老基因研究。该系统扫描数万篇论文提出 20 多个可测试的新遗传因子,部分经实验验证能推动细胞脱离衰老状态、功能改善;原先需约六个月的筛选数据分析被缩短到几天。
OpenAI 与 Dell 达成合作,将 Codex 引入混合部署与本地部署环境,帮助企业安全地在自有数据和工作流中部署 AI 编程智能体。
Google DeepMind 在 Project Genie 中推出 Street View 街景落地能力,用户可选美国地点并套用 Ocean World、B&W film 等风格生成可交互世界,底层由 Maps Imagery Grounding 支撑。
Google 发布 Gemini for Science,包含 Google Labs 上三个实验性工具和 Google Antigravity 中的 Science Skills。
Google DeepMind 发布 Gemini 3.5 模型系列,首个型号 3.5 Flash 当天全量开放,3.5 Pro 预计下月推出。
推荐理由:官方正文给出具体基准分数、速度对比和开放渠道,读者可据此评估 3.5 Flash 在智能体与编码场景的实用性。
Databricks 在企业 Agent 工作流中采用 GPT-5.5。此前 GPT-5.5 在 OfficeQA Pro 基准上创下新的 SOTA 成绩。
Sea Limited 的 CPO 阐述了公司为何在工程团队中部署 Codex,以加速亚洲 AI 原生软件开发。文章讨论了 Sea 对智能体软件开发未来的看法。
OpenAI 宣布 Codex 可在 ChatGPT 手机应用中使用,支持随时处理编码任务。用户可以在移动设备与远程环境中实时监控、调整和批准编码任务。
OpenAI 构建了一个安全沙箱,使 Codex 能够在 Windows 上运行,并通过受控的文件访问和网络限制来保障安全。
Google DeepMind 在 Nature 发表 Co-Scientist 研究,推出基于 Gemini 的多智能体 AI 系统,通过生成、辩论和进化假设迭代产生科研新假设,并通过 Hypothesis Generation 实验工具向个人研究者开放,未来几周开始推出,可在 labs.google/science 注册。
推荐理由:官方发布完整介绍了 Co-Scientist 的多智能体架构、验证机制和多所高校实验室的实际应用结果,还给出了个人研究者注册入口。
德国汽车平台 AutoScout24 使用 OpenAI 的 Codex 与 ChatGPT 加速开发周期、提升代码质量,并扩大 AI 在工程团队中的应用。
OpenAI 介绍其如何在内部安全运行 Codex 编码智能体,做法包括沙箱隔离、审批机制、网络策略和面向 Agent 的遥测,以支持安全合规的编码智能体落地。
Parloa 利用 OpenAI 模型构建可规模化的语音驱动 AI 客服智能体,帮助企业设计、模拟并部署可靠的实时交互服务。该方案让企业能够运行客户愿意与之对话的服务智能体。
Google DeepMind 汇总 Gemini 驱动的编码智能体 AlphaEvolve 一年来的应用成果,并通过 Google Cloud 将其带给商业客户。
推荐理由:官方汇总了 AlphaEvolve 在医疗、电网、数学和商业客户中的具体成果数字,读者可以据此评估这类算法进化智能体的实际落地范围。
OpenAI 的 B2B Signals 研究显示,前沿企业正在深化 AI 采用、扩展基于 Codex 的智能体工作流,并由此构建可持续的竞争优势。
OpenAI 与 PwC 达成合作,帮助企业使用 AI 智能体自动化财务工作流、改进预测并强化内部控制。此次合作旨在推动 CFO 职能的现代化转型。
Jack Clark在Import AI 455撰文称,基于公开数据他勉强判断2028年底前出现无人类参与的自动化AI研发(模型自主训练后继者)的概率超过60%,2027年为30%。
Google Research 介绍自 9 月预印本发布 Empirical Research Assistance(ERA)以来,其科学家与学术合作者将其应用于真实科研的四个成果。
推荐理由:文章展示了 ERA 在疫情预测、宇宙学、气候遥感和神经回路四个真实科研场景的应用结果,可了解 LLM 辅助科研的具体形态。
NVIDIA 发布 Nemotron 3 Nano Omni(30B-A3B)全模态理解模型,支持文档分析、ASR、长音视频理解和 agentic computer use,并在 Hugging Face 开放 BF16、FP8 和 NVFP4 权重。
推荐理由:原文给出完整基准对比和架构细节,读者可以据此评估它是否值得替换现有的多模态工作流。
Mistral AI 发布 Workflows 公开预览版,这是构建于 Studio 之上的企业 AI 编排层,提供持久执行、可观测性和人在环节点审批,帮助 AI 流程从概念验证走向生产环境。
OpenAI 本周在 Hub 上开源发布 Privacy Filter,一个 PII 检测模型,1.5B 参数、50M 激活参数,Apache 2.0 许可,支持 128k 上下文单次前向识别 8 类个人信息,在 PII-Masking-300k 基准上达到 SOTA。