ChatGPT 推出数学与科学交互式可视化讲解
OpenAI 在 ChatGPT 中推出数学与科学的交互式可视化讲解,帮助学生实时探索公式、变量和概念。该功能面向数学与科学学习场景,可动态呈现知识内容,辅助理解。
OpenAI 在 ChatGPT 中推出数学与科学的交互式可视化讲解,帮助学生实时探索公式、变量和概念。该功能面向数学与科学学习场景,可动态呈现知识内容,辅助理解。
Hugging Face 为给 TRL 设计新的异步训练器,调研了 16 个围绕异步 RL 训练构建的开源库,并从编排原语、rollout 缓冲、权重同步协议、staleness 管理、partial rollout、LoRA 支持和分布式训练后端 7 个维度对比。
Hugging Face 在 Hub 上推出 Storage Buckets,一种不版本控制的可变、类 S3 对象存储,用于存放 checkpoints、处理后的数据、Agent traces 等中间产物。
推荐理由:官方发布后明确解释了为什么中间产物不适合放 Git 仓库,并给出 CLI、Python、fsspec 的完整上手路径,便于迁移现有训练和数据流程。
AlphaGo 击败围棋世界冠军十周年之际,Google DeepMind 回顾其影响:2016 年对弈李世石(Lee Sae Dol)时"第 37 手"成为 AI 标志性时刻,围棋盘上共有 10^170 种可能局面。
OpenAI 宣布收购 Promptfoo,该平台帮助企业在开发阶段识别并修复 AI 系统中的漏洞。材料为官方简讯,仅提供收购事实,未披露交易金额或后续整合安排。
Hugging Face LeRobot 发布 v0.5.0,合并超过 200 个 PR、新增 50 多位贡献者。
推荐理由:官方完整发布说明覆盖硬件、策略、数据集和代码库四大方向,读者可据此评估升级对机器人训练与部署的实际影响。
Hugging Face 官方博客详解 Ulysses Sequence Parallelism 的原理,通过注意力头并行将长序列训练扩展到多卡,已集成到 Accelerate、Transformers Trainer 和 TRL 的 SFTTrainer。
Google Research 推出大规模开放语音数据集 WAXAL,覆盖撒哈拉以南非洲 27 种语言、超过 1 亿使用者。首批包含约 1,846 小时转写自然语音(WAXAL-ASR,采用图像提示引发自发话语)和 565 小时以上高保真 TTS 录音,以 CC-BY-4.0 许可发布,由 Makerere 大学、加纳大学等非洲机构主导采集,后续计划持续扩展语言。
Google 开发的开源 AI 模型 SpeciesNet 可对相机陷阱图像中约 2,500 类(2,498 类)动物进行分类,训练数据超过 6500 万张标注图像。模型在留出测试集上能找出 99.4% 含动物的图像,可识别到物种级的预测中 94.5% 正确,标准笔记本每天约可处理 3 万张图像。过去一年,全球研究团队已用它在坦桑尼亚塞伦盖蒂、哥伦比亚、澳大利亚等地分析数百万张野生动物影像。
OpenAI 推出 AI 应用安全智能体 Codex Security,目前处于研究预览阶段。该智能体通过分析项目上下文来检测、验证并修复复杂漏洞,从而提供更高的置信度和更少的噪音。
Balyasny Asset Management 通过严格的模型评估、全面使用 OpenAI 平台以及智能体工作流,重塑投资研究流程。公司以系统化的模型评测筛选合适的模型,并将 OpenAI 的能力嵌入投研各环节,由智能体自动执行研究任务,构建起一套 AI 驱动的研究引擎。
Descript 利用 OpenAI 推理模型实现了大型内容库的自动本地化配音,在不丢失时间对齐和原意的前提下完成多语言视频翻译。
NXP 发布实践指南,讲解如何在嵌入式机器人平台上录制可靠数据集并微调 ACT 与 SmolVLA 等 VLA 策略,并展示 NXP i.MX 95 SoC 优化后的实时性能。
OpenAI 推出 CoT-Control,发现推理模型难以控制自己的思维链(CoT)。这一局限使思维链保持可被监控的状态,强化了可监控性作为 AI 安全保障手段的价值。
OpenAI 发布 GPT-5.4,称其为面向专业工作最强、最高效的前沿模型。新模型在编码、计算机使用和工具搜索上达到 SOTA,并提供 1M-token 上下文窗口。
推荐理由:OpenAI 官方给出 GPT-5.4 的能力定位与 1M-token 上下文,可据此判断其在专业工作场景中的可用性。
OpenAI 发布面向学校和教育机构的新工具、认证项目及评估资源,帮助缩小 AI 能力差距、扩大学习机会。该举措涵盖工具、认证与测量资源三类支持,旨在让教育中的 AI 应用更好地带来发展机遇。
Hugging Face 发布 Modular Diffusers,将扩散流水线拆成文本编码、去噪、解码等可独立运行、自由增删互换的可复用块,作为现有 DiffusionPipeline 的灵活补充。
推荐理由:原文展示了用可组合积木搭建扩散流水线的完整用法,包括自定义块、模块化仓库和 Mellon 可视化集成,方法可直接复用。
OpenAI 提出五大 AI 价值模型,展示企业领导者如何安排 AI 转型顺序,从员工 AI 素养培养逐步推进到流程重塑,以构建持久的业务优势。
德甲俱乐部沃尔夫斯堡(VfL Wolfsburg)以人为核心而非试点项目,将 ChatGPT 推广为覆盖全俱乐部的通用能力。此举旨在规模化提升效率、创造力和知识水平,同时不丢失俱乐部的足球本色。
OpenAI 推出 ChatGPT for Excel 和新的金融应用集成,由 GPT-5.4 驱动,用于加速受监管环境下的建模、研究和分析。
OpenAI 推出 Adoption news channel,用于分享将 AI 进展转化为业务优势的实用洞察和框架。该频道面向企业采纳场景,帮助组织把 AI 能力落地为商业价值。
Google Research 通过“Bayesian teaching”监督微调,让 LLM 模仿 Bayesian Assistant 的最优贝叶斯推理预测,弥补其默认简单启发式的不足。在简化航班推荐任务中,各系列 LLM 原本表现明显差于 Bayesian Assistant,且常在单轮交互后停滞;训练后不仅显著提升推荐任务表现,还能泛化到其他任务。
一篇新预印本论文将单负振幅扩展到引力子,借助 GPT-5.2 Pro 推导并验证了量子引力中非零的引力子树级振幅。该结果展示了 GPT-5.2 Pro 在理论物理推导与验证中的辅助作用。
Axios COO Allison Murphy 介绍了该公司如何利用 AI 支持本地记者、简化新闻编辑室工作流程,并大规模交付高影响力的本地新闻报道。
OpenAI 推出 Learning Outcomes Measurement Suite,用于评估 AI 对学生学习成效的影响。该工具套件面向多样化教育环境,可长期衡量 AI 在学习中的作用。
Photoroom 以约 $1500 算力预算(32 张 H200,$2/小时/GPU)在 24 小时内完成文生图扩散模型训练,并开源 PRX 训练代码与实验框架。
Google DeepMind 发布 Gemini 3.1 Flash-Lite,定位 Gemini 3 系列中最快、最具成本效益的模型,已在 Google AI Studio 和 Vertex AI 以 preview 形式推出。
推荐理由:官方公布定价与实测对比数据,开发者可据此评估高并发场景下换用该模型的速度与成本收益。
OpenAI 官方发布与美国战争部合同的说明,内容涵盖安全红线、法律保护,以及 AI 系统在涉密环境中的部署方式。
OpenAI 与 Amazon 宣布达成战略合作,将 OpenAI 的 Frontier 平台引入 AWS。合作覆盖扩展 AI 基础设施、定制模型以及企业级 AI 智能体。
推荐理由:官方宣布合作落地,OpenAI 的 Frontier 平台将通过 AWS 提供,关注企业 AI 基础设施的读者可据此评估可选项。
OpenAI 宣布 1100 亿美元($110B)新融资,投前估值为 7300 亿美元($730B pre money)。资金来源包括 SoftBank 300 亿美元、NVIDIA 300 亿美元和 Amazon 500 亿美元。
推荐理由:官方宣布融资规模与估值,金额和投资方均为一手信息,可用于了解 OpenAI 资本结构的变化。
Amazon Bedrock 推出 Stateful Runtime for Agents,为多步骤 AI 工作流提供持久编排、记忆和安全执行能力。该运行时由 OpenAI 模型驱动,可支持跨步骤保持状态的智能体应用。
OpenAI 与 Microsoft 联合发布声明,宣布双方将继续在研究、工程和产品开发领域紧密合作。声明强调双方多年深度协作与共同成功的合作基础。
OpenAI 公布心理健康安全工作的多项更新,包括家长控制、可信联系人功能以及改进的心理困扰检测能力。公司同时提及近期相关诉讼的进展情况。
Google DeepMind 发布 Nano Banana 2(Gemini 3.1 Flash Image),以 Flash 速度提供 Pro 级世界知识、精准文本渲染、最多 5 个角色的主体一致性和 512px 到 4K 的生产级规格。
推荐理由:官方公告列出了能力细节、订阅者保留路径和各产品开放范围,读者可据此判断是否切换工作流。
OpenAI 与太平洋西北国家实验室(PNNL)联合推出 DraftNEPABench 基准,评估 AI 编程智能体加急联邦审批的能力。该基准显示,AI 有望将 NEPA(国家环境政策法)文件起草时间缩短最多 15%,推动基础设施审查现代化。
OpenAI 与 Figma 推出新的 Codex 集成,打通代码与设计。该集成让团队可以在代码实现与 Figma 画布之间直接切换,从而更快地迭代和交付产品。
Hugging Face 博客介绍 transformers 库如何让 MoE 稀疏架构成为一等公民,涵盖权重加载重构、Expert Backend、专家并行和 MoE 训练支持。
OpenAI 发布最新威胁报告,分析恶意行为者如何将 AI 模型与网站和社交平台结合实施攻击。报告还探讨了这对检测与防御工作的影响。
OpenAI 任命 Arvind KC 为首席人事官(Chief People Officer)。他将帮助公司扩大规模、强化企业文化,并主导 AI 时代的工作方式演进。
OpenAI 宣布不再使用 SWE-bench Verified 评测前沿编程能力,分析显示该基准存在测试缺陷与训练数据泄漏,污染日益严重,无法准确衡量前沿编程进展。OpenAI 推荐改用 SWE-bench Pro。