Hugging Face 解析全球开源 AI 生态未来:从 DeepSeek 时刻到 AI+ 行动计划
Hugging Face 发布三部曲系列的第三篇也是收官篇,分析 2025 年 1 月“DeepSeek Moment”以来中国开源 AI 社区的演进路径,并展望开源的未来方向。
Hugging Face 发布三部曲系列的第三篇也是收官篇,分析 2025 年 1 月“DeepSeek Moment”以来中国开源 AI 社区的演进路径,并展望开源的未来方向。
Photorium 发布 PRX 文生图训练系列第二篇,在统一的 Flow Matching 基线上系统消融各类训练技巧。
OpenAI 阐述了 Sora 信息流的设计理念:通过个性化推荐激发创作、促进连接,同时保障使用安全。平台配备家长控制和严格的防护机制,让用户体验在创造力与安全之间保持平衡。
OpenAI 与 Snowflake 达成一项 2 亿美元的合作协议,将前沿智能引入企业数据,使 AI 智能体和洞察分析可以直接在 Snowflake 中运行。
OpenAI 发布面向 macOS 的 Codex app,定位为 AI 编码与软件开发的指挥中心。它支持多个智能体协作、并行工作流和长时间运行的任务。
推荐理由:官方介绍 macOS 版 Codex app 的定位,涵盖多智能体、并行工作流和长时任务,可帮助读者判断它与现有编码工具的关系。
OpenAI 封禁了一个与中国执法人员相关联的个人账号,该账号利用 AI 策划影响力活动、骚扰行为和网络行动。封禁针对的是这一与其活动相关的账号。
OpenAI 封禁了疑似源自中国的账号,这些账号使用其 AI 调查美国人员、地点及社会工程学攻击战术。OpenAI 将此事称为“银色 lining playbook”的一部分,并披露了相关威胁情报活动。
OpenAI 封禁了很可能源自柬埔寨的账号,这些账号利用 AI 对印尼交友人群进行诈骗外联,包括翻译和互动环节。
OpenAI 封禁了与一个此前未被报道、疑似源自俄罗斯的行动相关的账号,OpenAI 将其命名为 "No Bell"。该行动使用 AI 生成针对美国及其盟友的批评内容,面向非洲多地受众。
OpenAI 封禁了与一个此前未披露、代号“Trolling Stone”的行动相关的账号,该行动利用 AI 生成有关一名俄罗斯教派领袖在阿根廷被捕的评论内容。OpenAI 将这一行动与俄罗斯关联的影响力活动联系起来。
OpenAI 封禁了一批极可能源自柬埔寨的账号,这些账号利用 AI 冒充追损服务、律所和官方机构,专门针对曾遭受诈骗的人群实施二次欺诈。OpenAI 将此次行动命名为“伪证人”(False Witness)。
OpenAI 封禁了利用 AI 支撑婚恋诈骗工作流的账号。这些账号将 AI 用于触达潜在受害者、翻译、与受害者互动以及投资诈骗诱饵等环节。
OpenAI 封禁了与 Rybar 网络相关的一批账号,这些账号可能源自俄罗斯,利用 AI 在多个网站和社交平台开展多语言影响力活动。此举旨在遏制借助生成式 AI 进行的内容农场式传播。
Google DeepMind 推出实验原型 Project Genie,即日起向美国 18 岁以上的 Google AI Ultra 订阅用户开放。
推荐理由:原文给出了 Project Genie 的三项核心能力、底层模型和明确的限制清单,读者可以据此判断世界模型的当前可用边界。
OpenAI 自研了一款内部 AI 数据智能体,结合 GPT-5、Codex 和记忆机制,对海量数据集进行推理,可在几分钟内输出可靠的数据洞察。
OpenAI 将于 2026 年 2 月 13 日在 ChatGPT 中下线 GPT-4o、GPT-4.1、GPT-4.1 mini 和 o4-mini,与此前宣布的 GPT-5(Instant、Thinking、Pro)退役同步进行。API 侧目前没有任何变化。
Hugging Face Gradio 团队发布开源 Python 库 Daggr(beta,当前版本 0.4.3),用几行代码把 Gradio Spaces、ML 模型和自定义函数连接成 AI 工作流,并自动生成可视化画布。
推荐理由:Gradio 团队介绍用代码定义 AI 工作流并自动生成可视化画布,可单步检查和重跑,适合在重编排平台和脆弱脚本之外多一个实验选择。
大成建设(Taisei Corporation)人力资源团队主导在全公司推行 ChatGPT Enterprise,以 AI 驱动的人才培养。该部署旨在推动组织范围内的 AI 赋能人才发展。
Google Research 发布论文《Towards a Science of Scaling Agent Systems》,通过 180 种智能体配置的受控评测,挑战了“智能体越多越好”的假设。
推荐理由:原文用 180 种配置给出多智能体系统何时有效何时退化的量化规律,为架构选择提供了可依据的任务属性判断方法。
OpenAI 推出 EU Economic Blueprint 2.0,包含新数据、合作伙伴关系和多项举措,旨在加速 AI 在欧洲的应用、技能培养与经济增长。
OpenAI 推出 EMEA Youth & Wellbeing Grant,一项总额 50 万欧元的资助计划,面向在 AI 时代推进青少年安全与福祉的 NGO 和研究人员。
OpenAI 说明了其内置防护机制如何在 AI 智能体打开链接时保护用户数据,防范基于 URL 的数据外泄与提示词注入攻击。
Hugging Face 发布 upskill 工具,用 Claude Opus 4.5 生成和评估 agent 技能,再供更小、更便宜或本地模型使用。流程为用 Claude Code 完成任务并导出 trace、从 trace 生成 SKILL.md 技能文件并自动生成测试用例,然后用 upskill eval 对比模型有无技能的表现。
推荐理由:原文给出了用大模型生成技能再迁移到小模型的完整流程和实测数字,方法可直接复用于领域任务。
Google Research 发布 ATLAS(Adaptive Transfer Scaling Laws),迄今最大规模公开多语言预训练研究,覆盖 774 次训练、10M–8B 参数模型、400+ 语言数据和 48 语言评测。
推荐理由:原文给出多语言训练的跨语言迁移矩阵和预训练与微调的token分界点,开发者可据此规划语言混合与算力预算。
Mistral 发布 Mistral Vibe 2.0,升级其终端原生编码智能体,由 Devstral 2 模型家族驱动,新增自定义 subagent、多选澄清、斜杠命令技能和统一 agent 模式,CLI 持续自动更新。
推荐理由:官方公布 Vibe 2.0 的新增控制能力与 Devstral 2 转付费后的具体价格,读者可据此评估团队编码工作流的成本与用法。
Hugging Face 发布三篇系列博客的第二篇,分析 2025 年 1 月 DeepSeek 时刻以来中国开源社区的架构与硬件选择。
Hugging Face 团队推出 Alyah(意为阿联酋方言中的"北极星"),一个评测阿拉伯语大模型阿联酋方言能力的基准,包含 1,173 个由母语者人工采集的多选题样本,覆盖问候语、诗歌、历史遗产和方言语言等类别。
Calvin Klein 和 Tommy Hilfiger 母公司 PVH Corp. 采用 ChatGPT Enterprise,将 AI 引入时尚设计、供应链和消费者互动。
Hugging Face 团队探索以 GPT-OSS(性能对标 OpenAI o3-mini 和 o4-mini)作为智能体应用骨干模型,用 verl 框架开展智能体强化学习训练。
TRUSTBANK 与 Recursive 合作,基于 OpenAI 模型构建 Choice AI,通过个性化对话式推荐简化故乡纳税(Furusato Nozei)礼物的查找。
OpenAI 推出免费的 LaTeX 原生工作台 Prism,内置 GPT-5.2。产品面向研究人员,支持在同一处完成写作、协作和推理。
Indeed CRO Maggie Hulce 介绍了 AI 如何改变求职招聘流程,帮助雇主和求职者完成招聘与人才获取。
Google Research 在 NeurIPS 2025 上提出 GIST(Greedy Independent Set Thresholding)算法,用于训练数据子集选择,兼顾数据多样性与效用。它将问题分解为一系列最大独立集近似问题,并首次为多样性-效用权衡提供可证明的强保证:所得子集的价值至少为最优解的一半。GIST 在图像分类等任务上超越现有 SOTA 基准。
OpenAI 发布对 Codex agent loop 的技术深度解读,说明 Codex CLI 如何编排模型、工具与提示词。文章介绍了其基于 Responses API 的实现方式与性能考量。
Google Research 在 EMNLP 2025 发表的论文提出一种两阶段分解方法,让小型多模态 LLM 在设备端理解用户 UI 交互轨迹:先逐屏总结交互,再从总结序列提取意图。
OpenAI 详解了其如何将 PostgreSQL 扩展到每秒数百万次查询,以支撑 8 亿 ChatGPT 用户。技术手段包括使用副本、缓存、速率限制和工作负载隔离。
Praktika 基于 GPT-4.1 和 GPT-5.2 构建自适应 AI 导师,通过对话方式实现个性化课程与学习进度追踪。这些智能体帮助学习者达成真实场景中的语言流利度。
OpenAI 发布数据驱动报告,分析各行业工作者如何在工作场景中使用 ChatGPT 与 GPT-5。报告覆盖采用趋势、高频任务、不同部门的使用模式,以及 AI 在职场的未来走向。
Mistral AI 团队分享了排查 vLLM 内存泄漏的过程,问题仅出现在 Mistral Medium 3.1 与 P/D 分离部署结合 NIXL、开启 graph compilation 的条件下,系统内存以每分钟 400 MB 的速度线性增长,数小时后触发 out of memory。
创作平台 Higgsfield 借助 OpenAI 的 GPT-4.1、GPT-5 和 Sora 2,让创作者用简单的输入生成电影质感、面向社交平台的视频。该方案面向内容创作者,降低了影视化视频制作的门槛。