OpenAI 投资 Merge Labs,布局脑机接口
OpenAI 宣布投资 Merge Labs,支持新型脑机接口的开发,目标是连接生物智能与人工智能,最大化人类的能力、自主性与体验。
OpenAI 宣布投资 Merge Labs,支持新型脑机接口的开发,目标是连接生物智能与人工智能,最大化人类的能力、自主性与体验。
Hugging Face 发布开放推理标准 Open Responses,扩展并开源 OpenAI 的 Responses API,面向 Agent 时代的推理需求。
OpenAI 发布新的 RFP(征集建议书),旨在通过加速美国本土制造来强化美国 AI 供应链。该计划同时着眼于创造就业机会并扩大 AI 基础设施规模。
OpenAI 与 Cerebras 达成合作,新增 750MW 高速 AI 算力,用于降低推理延迟,使 ChatGPT 在实时 AI 工作负载下更快。
Google Research 基于Android Auto的匿名数据验证了急刹车事件(HBE,减速超过 -3m/s²)与路段实际事故率呈显著正相关。分析加州和弗吉尼亚州 10 年事故数据发现,观测到 HBE 的路段数量是记录到事故的 18 倍;加州一条 HBE 率约为州均高速 70 倍的匝道路段位列全路段前 1%。
Google DeepMind 更新 Veo 3.1 Ingredients to Video,提升基于参考图生成视频的表现力、角色身份一致性和背景与对象一致性。
Zenken 在全公司推广 ChatGPT Enterprise 后,销售业绩得到提升,准备时间缩短,提案成功率提高。AI 辅助的工作流程帮助这支精简团队为客户提供更个性化、更有效的沟通。
Google 发布在 Science Advances 的论文,介绍 NeuralGCM 通过直接在 2001 至 2018 年 NASA 卫星降水观测上训练,改进全球降水模拟能力。
Berkeley AI Research 在 NeurIPS 2025 论文中提出一个基于信息含量的成像系统评估与优化框架,仅用噪声测量数据和噪声模型估计互信息。该指标在彩色摄影、射电天文、无透镜成像和显微成像四个领域预测解码器性能,优化后可匹配 SOTA 端到端方法,同时内存和计算量更低,且无需任务专属解码器设计。
OpenAI 与软银集团宣布与 SB Energy 合作,开发多吉瓦级 AI 数据中心园区,其中包含一座支持 Stargate 计划的 1.2 GW 德克萨斯州设施。
推荐理由:合作扩展了 Stargate 的算力与能源布局,读者可以借此了解 AI 数据中心建设对电力供应的依赖程度。
Datadog 使用 OpenAI 的 Codex 对系统级代码进行审查。目前公开信息仅包含 OpenAI 与 Datadog 的品牌联合图片及该合作用途,具体实施细节与效果数据尚未公布。
OpenAI 推出 OpenAI for Healthcare,提供支持 HIPAA 合规的企业级安全 AI 服务。该方案旨在减轻医疗机构的行政负担并支持临床工作流程。
Netomi 借助 GPT-4.1 和 GPT-5.2 将企业级 AI 智能体规模化,结合并发处理、治理与多步推理,支撑可靠的生产工作流。
Tolan 基于 GPT-5.1 构建了语音优先的 AI 伴侣。它结合低延迟响应、实时上下文重建和基于记忆的个性化,实现自然对话。
OpenAI 推出 ChatGPT Health,一个专注健康领域的专属体验,可安全连接用户的健康数据和应用,并配备隐私保护机制。该产品采用由医生参与指导的设计。
NVIDIA 发布 Cosmos Reason 2,一个面向物理 AI 的开源推理视觉语言模型,登顶 Physical AI Bench 和 Physical Reasoning 排行榜,成为视觉理解排名第一的开源模型。
推荐理由:官方发布给出模型规格、上下文长度和评测变化,读者可据此评估其是否适合机器人与视频分析场景。
Hugging Face 博客宣布推出 Falcon-H1-Arabic 阿拉伯语模型家族,包含 3B、7B、34B 三种规格,采用融合 Mamba(State Space Model)与 Transformer 注意力的混合架构。
Hugging Face 发布分步教程,教你在 CES 2026 演示基础上用 NVIDIA DGX Spark 和 Reachy Mini 搭建桌面私人助理。
OpenAI Grove 第二期开放申请,这是一个为期 5 周、面向从想法前到产品各阶段个人的创始人计划。参与者可获得 5 万美元 API 额度、AI 工具早期访问权限,以及 OpenAI 团队的实战指导。
Google 回顾 2025 年在 Google、Google DeepMind 和 Google Research 取得的研究进展:3 月发布 Gemini 2.5。
ServiceNow AI 发布 8B 参数安全护栏模型 AprielGuard,可检测 16 类安全风险以及提示注入、越狱、记忆投毒等对抗攻击,并支持独立提示、多轮对话和含工具调用与推理轨迹的 agentic 工作流输入。
OpenAI 正利用基于强化学习训练的自动化红队持续加固 ChatGPT Atlas,对抗提示词注入攻击。这种主动的"发现—修补"循环可提前识别新型攻击手法,随着 AI 越来越智能体化,不断强化该浏览器智能体的防御能力。
OpenAI 全球客户数已突破 100 万。文中介绍了 PayPal、Virgin Atlantic、BBVA、Cisco、Moderna 和 Canva 等公司如何借助 AI 改变工作方式、为团队赋能并开拓新机会。
Google Research 发布年度回顾,介绍 2025 年在 AI、量子计算与科学发现方面的研究进展。Gemini 3 成为其迄今最强、事实性最好的 LLM,在 SimpleQA Verified 与新发布的 FACTS 基准上达到 SOTA,并在 Gemini 3 中引入可动态生成交互界面的 generative UI;Gemma 多语言扩展至 140+ 种语言。
OpenAI 推出面向思维链(chain-of-thought)可监测性的新框架与评估套件,覆盖 13 项评估、24 个环境。研究结果显示,监测模型内部推理远比只监测输出更有效,为 AI 能力增强下的可扩展控制提供了有前景的路径。
OpenAI 更新其 Model Spec,新增 Under-18 Principles,规定 ChatGPT 应如何基于发展科学为青少年提供安全、适龄的引导。此次更新强化了防护栏,明确了模型在更高风险场景下的预期行为,是其改善 ChatGPT 青少年安全工作的延续。
OpenAI 与美国能源部签署谅解备忘录,深化在 AI 与先进计算领域支持科学发现的合作。该协议建立在双方与国家实验室持续合作的基础上,为 AI 应用于能源部生态内高影响力研究建立框架。
OpenAI 发布新的 AI 素养资源,帮助青少年和家长审慎、安全、有信心地使用 ChatGPT。这些指南包含经专家审核的建议,涵盖负责任使用、批判性思维、健康边界,以及如何支持遇到情绪化或敏感话题的青少年。
OpenAI 发布 GPT-5.2-Codex,称其为目前最先进的编码模型。该模型主打长程推理、大规模代码变换和增强的网络安全能力。
推荐理由:官方说明点出长程推理、大规模代码改造与安全能力三个方向,可作为评估其编码定位的基本参照。
Hugging Face 博客详解 Transformers v5 对分词器的重新设计:将分词器架构(normalizer、pre-tokenizer、算法类型、post-processor、decoder)与训练好的词表和 merges 分离,类似 PyTorch 分离模型结构与权重。
推荐理由:文章来自 transformers 团队,解释 v5 将分词器架构与训练词表分离的设计,便于读者直接检查组件或训练自定义分词器。
Mistral AI 发布 Mistral OCR 3,在表单、扫描件、复杂表格和手写内容上对 Mistral OCR 2 的整体胜率为 74%。模型(mistral-ocr-2512)定价 $2/1000 页,Batch-API 半价至 $1/1000 页,输出支持带 HTML 表格重建的 markdown,并可拖拽 PDF/图片解析为文本或结构化 JSON。
推荐理由:官方给出与上一代的胜率对比、定价和接入方式,读者可以据此评估它在文档解析流程中的成本与适用性。
NVIDIA 以开放评测方式发布 Nemotron 3 Nano 30B A3B,并公开其完整的评测 recipe。该 recipe 基于 NeMo Evaluator 开源库构建,任何人都可以重跑评测流水线、查看配置与产物并独立验证结果。NeMo Evaluator 将多个评测 harness 统一在同一接口下,评测流程与推理后端解耦,并可生成结构化结果与日志以便审计。
Google DeepMind 发布 Gemini 3 Flash,将 Gemini 3 Pro 级推理能力与 Flash 级速度和成本结合。
推荐理由:官方给出关键基准分数、价格和开放渠道,读者可以据此比较它与大模型在速度成本上的取舍。
OpenAI 联合 American Journalism Project 和 The Lenfest Institute 推出 OpenAI Academy for News Organizations 学习中心,帮助新闻编辑室有效使用 AI。该学院提供培训、实际用例和负责任使用指南,支持记者、编辑和出版商在报道与运营中采用 AI。
OpenAI 发布了一份企业 AI 应用现状的数据驱动报告,展示各类组织如何从实验阶段走向真实的生产力提升与新能力。报告聚焦企业采用 AI 的实际路径与成效。
OpenAI 宣布开发者现在可以提交应用供审核并发布到 ChatGPT,通过审核的应用将出现在新的产品内目录中便于发现。更新的工具、指南和 Apps SDK 帮助开发者构建聊天原生体验,将现实世界操作带入 ChatGPT。
推荐理由:官方宣布 ChatGPT 开放应用提交通道和新目录,开发者可据此了解应用上架流程与 Apps SDK 支持情况。
Google DeepMind 发布开源可解释性工具套件 Gemma Scope 2,覆盖 Gemma 3 从 270M 到 27B 的全部模型尺寸,结合稀疏自编码器(SAE)与 transcoder 分析模型内部行为。
OpenAI 推出 FrontierScience 基准,用于测试 AI 在物理、化学、生物学领域的推理能力,衡量其迈向真实科学研究水平的进展。
OpenAI 推出一个真实世界评测框架,衡量 AI 能否加速湿实验室中的生物研究。团队用 GPT-5 优化分子克隆实验方案,同时探讨了 AI 辅助实验的潜力与风险。
OpenAI 宣布推出更快的 ChatGPT Images 体验,并在 API 中发布 GPT-Image-1.5。用户可在 ChatGPT 中体验最新的 ChatGPT Images 2.5。
推荐理由:官方公告点明 ChatGPT Images 更快的新体验和 GPT-Image-1.5 进入 API,读者可据此了解这轮图像功能更新的范围。