NVIDIA 发布 Nemotron-Personas-Japan:面向主权 AI 的日语合成数据集
NVIDIA 发布首个面向日本人口统计、地理与文化特征的开源合成人设数据集 Nemotron-Personas-Japan,采用 CC BY 4.0 许可。
NVIDIA 发布首个面向日本人口统计、地理与文化特征的开源合成人设数据集 Nemotron-Personas-Japan,采用 CC BY 4.0 许可。
OpenAI 与 AARP 达成合作,通过 AI 培训、诈骗识别工具以及面向老年人的全国性项目,帮助老年人提升上网安全。相关项目将通过 OpenAI Academy 和 OATS 的 Senior Planet 计划落地。
Hugging Face 的 Swift 库 swift-transformers 发布 1.0 版本,为开发者在 Apple Silicon 平台(含 iPhone)上运行本地 LLM 提供支持。
OpenAI 为 ChatGPT 推出团队协作与工具集成更新,包括新的 shared projects(共享项目)、更智能的 connectors(连接器),以及合规与安全方面的改进,帮助团队提升工作效率。
OpenAI 推出新评测基准 GDPval,用于衡量模型在真实世界中有经济价值的任务上的表现。该评测覆盖 44 种职业,旨在更贴近实际工作场景检验模型能力。
OpenAI 发布 ChatGPT Pulse 预览版,面向移动端 Pro 用户。Pulse 是一种新体验,ChatGPT 会主动做研究,基于用户的聊天记录、反馈以及日历等连接应用生成个性化更新。
ENEOS Materials 采用 ChatGPT Enterprise 加速研究、提升工厂设计安全性。该方案将 HR 分析时间缩短 90%,80% 的员工反馈工作流程得到改善。
SAP 与 OpenAI 合作推出 OpenAI for Germany,这是一个 2026 年的合作项目,为德国公共部门提供安全、主权的 AI 能力。该合作旨在帮助德国公共部门实现安全、高效的公共服务。
OpenAI、Oracle 与 SoftBank 宣布新增五个 Stargate AI 数据中心站点,推进 5000 亿美元、10 吉瓦规模的美国 AI 基础设施建设。该项目旨在支撑下一代 AI 并创造数万个工作岗位。
推荐理由:官方公告给出 Stargate 新增五个数据中心站点及整体规模目标,读者可以据此跟踪其基建推进节奏。
Hugging Face 发布 Smol2Operator 方案,将无 GUI 定位能力的 SmolVLM2-2.2B-Instruct 通过两阶段 SFT 训练为 GUI 智能体,在 ScreenSpot-v2 上从基线 0 提升到 61.71%。
OpenAI「Executive Function」系列介绍了新加坡媒体 CNA 用 AI 改造新闻编辑部的实践。主编 Walter Fernandez 分享了在 AI 采用、组织文化与新闻业未来方面的见解。
SchoolAI 基于 OpenAI 的 GPT-4.1、图像生成和 TTS 能力,构建了面向 K-12 教育的 AI 平台,目前已服务超过 100 万间教室。平台提供教师引导的安全 AI 工具,提升课堂参与度、教师监督能力和个性化学习体验。
OpenAI 与 NVIDIA 宣布达成战略合作,将部署由 NVIDIA 系统驱动的 10 吉瓦 AI 数据中心,第一阶段于 2026 年启动。
推荐理由:官方公布双方合作的算力规模和第一阶段启动时间,读者可以据此了解这轮数据中心部署的量级与节奏。
Hugging Face 介绍了 SyGra,一个用于 LLM 与 SLM 数据集创建、转换与对齐的低代码/无代码框架。它以 Python 库形式提供,支持 vLLM、Hugging Face TGI、Triton、Ollama 等多种推理后端,用户只需专注于提示词工程。该框架可覆盖 Q&A 生成、DPO 偏好对、推理增强、多语言转换、质量过滤及 RAG 场景等多种数据构建需求。
Meta 的 Hugging Face 团队发布 GAIA 后续基准 Gaia2 和配套开源框架 Meta Agents Research Environments(ARE),Gaia2 数据集采用 CC BY 4.0 许可,ARE 采用 MIT 许可。
推荐理由:官方发布新基准 Gaia2 和开源评估框架 ARE,含七类任务和主流模型结果,便于开发者调试和评估自己的 Agent。
Scaleway 已正式成为 Hugging Face Hub 支持的 Inference Provider,用户可通过 Hub 直接访问 gpt-oss、Qwen3、DeepSeek R1、Gemma 3 等开源权重模型。
Hugging Face 联合 Cloud Security Alliance 和 Noma Security 推出 RiskRubric.ai,从透明、可靠、安全、隐私、社会安全和声誉六个维度为模型打 0-100 分并折算 A-F 等级。
Apollo Research 与 OpenAI 开发了针对模型隐藏不对齐(即 scheming)的评测方法,在前沿模型的受控测试中发现了一致于 scheming 的行为。团队分享了具体示例,并对一种用于减少 scheming 的早期方法做了压力测试。
推荐理由:原文给出了检测模型暗中算计行为的评测方法和一种早期缓解手段的实测示例,读者可借此了解对齐研究的具体做法。
Public AI Inference Utility 现已成为 Hugging Face Hub 支持的 Inference Provider,让用户可直接访问 Swiss AI Initiative、AI Singapore 等机构的公共模型,例如通过 vLLM 后端调用 swiss-ai/Apertus-70B-Instruct-2509。
OpenAI 正在 ChatGPT 中构建年龄预测功能与家长控制工具,为青少年提供更安全、适龄的体验,同时为家庭提供新的支持工具。
OpenAI 阐述其在青少年使用 AI 时如何平衡安全、自由与隐私的方案,介绍了公司在保护未成年用户方面的整体做法。
Hugging Face 发布 LeRobotDataset:v3,将多个 episode 合并到同一 Parquet 和 MP4 文件并通过关系型元数据检索,解决 v2 每集一文件在扩展到数百万 episode 时的文件系统瓶颈。
OpenAI 宣布对 Codex 进行升级,使其速度更快、更可靠,并改进实时协作与独立完成任务的能力。用户可在终端、IDE、网页端甚至手机上使用升级后的 Codex。
OpenAI 发布迄今最大规模 ChatGPT 使用研究,展示该工具如何通过个人与工作用途创造经济价值。研究显示使用范围正扩展到早期用户之外,缩小差距,使 AI 融入日常生活。
Hugging Face 让 Gradio 中的可见水印变得极其简单:创建 Space 中的应用或 demo 时,用一行命令即可添加水印。图片和视频通过 gr.Image 或 gr.Video 的 watermark 参数指定水印,支持文件名、在线图片或 numpy 数组;AI 生成的文本可通过 gr.Chatbot 的 watermark 参数,在用户复制 AI 回复时自动附上署名。
OpenAI 在 GPT-5 系统卡附录中发布新模型 GPT-5-Codex,是针对 Codex 中智能体编码进一步优化的 GPT-5 版本。该模型会根据任务复杂度更动态地调整思考力度,简单对话或小任务快速响应,复杂任务则可独立长时间工作。
推荐理由:原文说明新模型在思考力度上按任务复杂度动态调整,读者可了解其与 GPT-5 在编码场景下的差异。
OpenAI 公布了与美国 CAISI 和英国 AISI 合作加强 AI 安全的进展。双方通过测试与反馈机制提升 OpenAI 模型的安全性与安保能力。这项合作旨在构建更安全可信的 AI 系统。
Writer 发布 Palmyra-mini 家族三个 1.5B 到 1.7B 的开源模型:非思考基座 palmyra-mini、面向复杂逻辑的 palmyra-mini-thinking-a,以及长于数学推理的 palmyra-mini-thinking-b。
OpenAI 与 Microsoft 签署新的谅解备忘录(MOU),强化双方合作关系。双方重申在 AI 安全与创新方面的共同承诺。
OpenAI 重申非营利的主导地位,新结构使其获得 PBC 股权,从而有超过 1000 亿美元的资源用于推进安全、有益的 AI。
推荐理由:原文给出 OpenAI 非营利与 PBC 的结构安排和资金规模,读者可据此理解其治理走向。
Hugging Face 发文介绍为支持 OpenAI GPT-OSS 对 transformers 库的多项升级,包括从 Hub 下载预编译内核、原生 MXFP4 量化、张量并行与专家并行、动态滑动窗口 KV 缓存、Continuous Batching 和更快的模型加载。
推荐理由:Hugging Face 官方详解为支持 gpt-oss 对 transformers 做的各项升级,多数特性可复用到其他模型。
Together AI 与 Hugging Face 宣布新功能,Hub 上任何兼容 LLM 都可用 Together 基础设施微调。
Hugging Face 发布 Jupyter Agent 项目,用约 2TB Kaggle 笔记本构建 51k 条合成轨迹、近 0.2B tokens 的数据集,微调 Qwen3-4B-Instruct-2507 与 Qwen3-4B-Thinking-2507。
推荐理由:原文完整给出从数据清洗到微调的管线与消融数字,读者可复用其中提升小模型数据科学能力的做法。
SafetyKit 采用 OpenAI GPT-5 扩展其风控智能体,用于内容审核与合规执行。相比旧版安全系统,GPT-5 帮助其实现更高的审核准确率。
Mistral AI 宣布完成 17 亿欧元 C 轮融资,投后估值 117 亿欧元,由 ASML 领投,DST Global、Andreessen Horowitz、Bpifrance、General Catalyst、Index Ventures、Lightspeed 和 NVIDIA 参投。
推荐理由:官方公告给出融资额、估值和 ASML 领投的战略合作细节,读者可以据此了解 Mistral AI 后续的工业方向布局。
mmBERT 发布,基于 ModernBERT 架构,在 1800 多种语言、3T+ token 上训练,是首个在 XTREME 等基准上超越 XLM-R 的多语言编码器。
推荐理由:原文给出三阶段训练细节和完整评测数据,读者可以据此评估其多语言与检索能力是否适合自己的场景。
OpenAI 开放 People-First AI Fund 申请,这是总额 5000 万美元的资助计划,支持美国非营利组织在教育、社区创新和经济机会领域的工作。申请截止 2025 年 10 月 8 日,获得的是无限制用途资助,帮助社区塑造 AI 服务公共利益。
OpenAI 发布新研究,解释语言模型为何产生幻觉。研究指出改进评测方式可以提升 AI 的可靠性、诚实性与安全性。
OpenAI 与希腊政府联合启动“OpenAI for Greece”计划,将 ChatGPT Edu 引入希腊中学,支持负责任的 AI 学习。该合作旨在提升 AI 素养、扶持本地初创企业,并推动国家经济增长。
OpenAI 推出 Jobs Platform 和新的 Certifications,帮助劳动者对接工作、培训与认证机会。两项举措旨在扩大经济机会,让 AI 技能更容易获得。