OpenAI 宣布 Codex 迎来升级
OpenAI 宣布对 Codex 进行升级,使其速度更快、更可靠,并改进实时协作与独立完成任务的能力。用户可在终端、IDE、网页端甚至手机上使用升级后的 Codex。
OpenAI 宣布对 Codex 进行升级,使其速度更快、更可靠,并改进实时协作与独立完成任务的能力。用户可在终端、IDE、网页端甚至手机上使用升级后的 Codex。
OpenAI 发布迄今最大规模 ChatGPT 使用研究,展示该工具如何通过个人与工作用途创造经济价值。研究显示使用范围正扩展到早期用户之外,缩小差距,使 AI 融入日常生活。
Hugging Face 让 Gradio 中的可见水印变得极其简单:创建 Space 中的应用或 demo 时,用一行命令即可添加水印。图片和视频通过 gr.Image 或 gr.Video 的 watermark 参数指定水印,支持文件名、在线图片或 numpy 数组;AI 生成的文本可通过 gr.Chatbot 的 watermark 参数,在用户复制 AI 回复时自动附上署名。
OpenAI 在 GPT-5 系统卡附录中发布新模型 GPT-5-Codex,是针对 Codex 中智能体编码进一步优化的 GPT-5 版本。该模型会根据任务复杂度更动态地调整思考力度,简单对话或小任务快速响应,复杂任务则可独立长时间工作。
推荐理由:原文说明新模型在思考力度上按任务复杂度动态调整,读者可了解其与 GPT-5 在编码场景下的差异。
OpenAI 公布了与美国 CAISI 和英国 AISI 合作加强 AI 安全的进展。双方通过测试与反馈机制提升 OpenAI 模型的安全性与安保能力。这项合作旨在构建更安全可信的 AI 系统。
Writer 发布 Palmyra-mini 家族三个 1.5B 到 1.7B 的开源模型:非思考基座 palmyra-mini、面向复杂逻辑的 palmyra-mini-thinking-a,以及长于数学推理的 palmyra-mini-thinking-b。
OpenAI 与 Microsoft 签署新的谅解备忘录(MOU),强化双方合作关系。双方重申在 AI 安全与创新方面的共同承诺。
OpenAI 重申非营利的主导地位,新结构使其获得 PBC 股权,从而有超过 1000 亿美元的资源用于推进安全、有益的 AI。
推荐理由:原文给出 OpenAI 非营利与 PBC 的结构安排和资金规模,读者可据此理解其治理走向。
Hugging Face 发文介绍为支持 OpenAI GPT-OSS 对 transformers 库的多项升级,包括从 Hub 下载预编译内核、原生 MXFP4 量化、张量并行与专家并行、动态滑动窗口 KV 缓存、Continuous Batching 和更快的模型加载。
推荐理由:Hugging Face 官方详解为支持 gpt-oss 对 transformers 做的各项升级,多数特性可复用到其他模型。
Together AI 与 Hugging Face 宣布新功能,Hub 上任何兼容 LLM 都可用 Together 基础设施微调。
Hugging Face 发布 Jupyter Agent 项目,用约 2TB Kaggle 笔记本构建 51k 条合成轨迹、近 0.2B tokens 的数据集,微调 Qwen3-4B-Instruct-2507 与 Qwen3-4B-Thinking-2507。
推荐理由:原文完整给出从数据清洗到微调的管线与消融数字,读者可复用其中提升小模型数据科学能力的做法。
SafetyKit 采用 OpenAI GPT-5 扩展其风控智能体,用于内容审核与合规执行。相比旧版安全系统,GPT-5 帮助其实现更高的审核准确率。
Mistral AI 宣布完成 17 亿欧元 C 轮融资,投后估值 117 亿欧元,由 ASML 领投,DST Global、Andreessen Horowitz、Bpifrance、General Catalyst、Index Ventures、Lightspeed 和 NVIDIA 参投。
推荐理由:官方公告给出融资额、估值和 ASML 领投的战略合作细节,读者可以据此了解 Mistral AI 后续的工业方向布局。
mmBERT 发布,基于 ModernBERT 架构,在 1800 多种语言、3T+ token 上训练,是首个在 XTREME 等基准上超越 XLM-R 的多语言编码器。
推荐理由:原文给出三阶段训练细节和完整评测数据,读者可以据此评估其多语言与检索能力是否适合自己的场景。
OpenAI 开放 People-First AI Fund 申请,这是总额 5000 万美元的资助计划,支持美国非营利组织在教育、社区创新和经济机会领域的工作。申请截止 2025 年 10 月 8 日,获得的是无限制用途资助,帮助社区塑造 AI 服务公共利益。
OpenAI 发布新研究,解释语言模型为何产生幻觉。研究指出改进评测方式可以提升 AI 的可靠性、诚实性与安全性。
OpenAI 与希腊政府联合启动“OpenAI for Greece”计划,将 ChatGPT Edu 引入希腊中学,支持负责任的 AI 学习。该合作旨在提升 AI 素养、扶持本地初创企业,并推动国家经济增长。
OpenAI 推出 Jobs Platform 和新的 Certifications,帮助劳动者对接工作、培训与认证机会。两项举措旨在扩大经济机会,让 AI 技能更容易获得。
Google 发布开源嵌入模型 EmbeddingGemma,308M 参数、2K 上下文窗口,支持超过 100 种语言,量化后内存占用低于 200 MB,适合端侧 RAG 和 Agent 场景。
推荐理由:官方博客给出架构、基准和各框架用法,还附完整微调示例,读者可以据此判断如何把它接入现有检索流程。
SandboxAQ 发布开源数据集 SAIR,提供超过 500 万(5.24 million)个 AI 生成的蛋白-配体 3D 共折叠结构,每个结构均配有来自 ChEMBL 或 BindingDB 的实测 IC₅₀ 数据,以 CC BY 4.0 许可免费开放。
Mistral 为 Le Chat 推出 Memories(beta)记忆功能,采用自动保存与智能、可见召回的混合方案。功能遵循透明、可控、主权三原则,用户可随时关闭记忆、开启隐身聊天、编辑或删除单条记忆,并支持导出导入;还提供 Memory Insights 轻量提示帮助探索记忆内容,移动端可在 App Store 或 Google Play 下载体验。
OpenAI 收购 Statsig 后,Vijaye Raji 将出任新的 CTO of Applications 职位,向 Applications CEO Fidji Simo 汇报。
OpenAI 宣布与专家合作,进一步优化 ChatGPT 的用户体验。新措施包括为青少年强化保护、增加家长控制功能,并将敏感对话路由至 ChatGPT 中的推理模型处理。
Mistral AI 在 Le Chat 中推出 20+ 个安全 MCP 连接器(beta)和 Memories 记忆功能(beta)。
Hugging Face 发文介绍如何在 ZeroGPU Spaces 中用 PyTorch ahead-of-time 编译优化生成式 demo,指出 torch.compile 与 ZeroGPU 短生命周期进程不兼容,需先导出再用 spaces.aoti_* API 编译加载。
推荐理由:原文给出 ZeroGPU 上 AoT 编译的完整步骤和 FP8、动态形状等进阶技巧,读者可以直接迁移到自己的 Spaces demo。
Berkeley AI Research 提出理论证明,在从接近零的小初始化等温和近似条件下,word2vec 的学习问题可归约为无加权最小二乘矩阵分解,最终学到的表示等价于对目标矩阵 M* 做 PCA。
OpenAI 发布更先进的语音到语音模型 gpt-realtime,并更新 Realtime API。新能力包括 MCP server 支持、图像输入和 SIP 电话呼叫支持。
推荐理由:官方公布了语音到语音模型与 API 能力更新,读者可据此了解语音方向的新入口。
OpenAI 推出 5000 万美元 People-First AI Fund,帮助美国非营利组织用 AI 扩大影响力。申请窗口为 2025 年 9 月 8 日至 10 月 8 日,资助领域涵盖教育、医疗、研究等方向。
OpenAI 在全球调研了超过 1,000 人对 AI 应有行为方式的看法,并将其与 Model Spec 进行对比。这一“集体对齐”方式正用于塑造 AI 默认行为,使其更好反映多元的人类价值观与观点。
OpenAI 和 Anthropic 公布了一次首创性的联合安全评估结果,双方互相测试对方模型。评估覆盖模型失准、指令遵循、幻觉、越狱等多个维度,展示了进展、挑战以及跨实验室协作的价值。
OpenAI 说明其对处于心理或情绪困境用户的安全考虑,包括当前系统的局限性和正在进行的改进工作。文章聚焦 ChatGPT 在此类场景下的安全策略完善,但未公布具体功能或数据。
OpenAI 推出专用模型 GPT-4b micro,与 Retro Bio 合作设计更有效的蛋白质,用于干细胞疗法和延寿研究。该模型面向生命科学场景,帮助提升蛋白质工程效率,加速相关研究进展。
税务研究平台 Blue J 依托专注的领域深耕和合适的 OpenAI 模型,已扩展到三个国家、服务超过 3,000 家企业。公司在税务等高度监管的复杂领域实现快速规模化,验证了领域深度与模型选型相结合的增长路径。
NVIDIA 发布 600 万条多语言推理数据集 Nemotron Post-Training Dataset v2,将原有英文推理数据翻译为法语、西班牙语、德语、意大利语和日语五种语言,并保留原始英文推理链。
日本数字娱乐与生活方式服务商 MIXI 使用 ChatGPT Enterprise 提升生产力,推动各团队采用 AI,并打造安全的环境以支持创新。
Hugging Face 发布教程,介绍如何把 Claude 连接到 Hugging Face MCP Server,用 Spaces 上的图像生成模型出图。2025 年 10 月更新后需通过 Add custom connector 设置 Remote MCP server URL 为 https://huggingface.co/mcp?
OpenAI 与 DoorDash 首席人事官 Mariana Garavaglia 对谈,介绍 DoorDash 如何在企业内部扩大 AI 的采用规模,帮助员工更快地构建、学习和创新。
Hugging Face 发布 kernel-builder 使用指南,演示如何从零构建一个 RGB 转灰度的 CUDA kernel,并用 PyTorch C++ API 将其注册为 torch.ops 原生算子。
Hugging Face 发布教程,介绍如何用 Model Context Protocol(MCP)让 AI 通过自然语言调用 arXiv、GitHub、Hugging Face 等研究工具,自动化文献发现的跨平台检索与交叉引用。
Numina 与 Kimi 开源 kimina-prover-rl,一个基于 DeepSeek-R1 推理范式、与 Verl 完全兼容的 Lean 4 形式化定理证明训练管线,采用 GRPO 强化学习并配套 kimina-lean-server 验证服务。