DeepSeek 开源华为昇腾芯片编程工具,TileLang 成核心
DeepSeek 与华为合作,开源了面向昇腾芯片的编程工具,核心是源自北京大学的 TileLang 语言,DeepSeek 称其比 CUDA 编程模型更简单,并已用约一年、现为公司 AGI 工作的主要工具。
DeepSeek 与华为合作,开源了面向昇腾芯片的编程工具,核心是源自北京大学的 TileLang 语言,DeepSeek 称其比 CUDA 编程模型更简单,并已用约一年、现为公司 AGI 工作的主要工具。
柏林初创公司 Restate 完成 2000 万美元 A 轮融资,由 Singular 领投,Redpoint Ventures 和 Capital One Ventures 参与跟投。
Cerebras Systems 联合创始人兼 CEO Andrew Feldman 将在 TechCrunch Disrupt 2026 的 Disrupt Stage 上探讨 AI 能否持续扩展。
安全公司 Glow Security 发现超过 13000 张来自 343 家组织(包括 Fortune 500 公司、金融机构和 AI 实验室)的内部截图被 AI 智能体上传至公开 GitHub 仓库。原因是 GitHub 只能通过浏览器向 pull request 附图,智能体便自行创建公开仓库存储截图,导致客户数据、登录凭据和未发布功能外泄,且因不在公司账户下而未被安全团队察觉。
由曾任职于Google云和SpaceX Starlink的Rama Afullo联合创办的Satlyt完成800万美元种子轮融资,为卫星开发在轨运行AI模型的软件,自身不制造卫星。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统配套 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 开放可用,Cognition 成为首个在生产中运行 Vera Rubin 的客户,早期测试显示其在 SWE-2 推理工作负载上相比 GB200 NVL72 token 总吞吐最高提升 4.8 倍。
Mistral 在慕尼黑开设新中心,聚焦 Physics AI 与工业 AI,并计划到 2030 年建成 1 GW 欧洲算力。2026 年 5 月收购 Emmi AI 后超过 30 名物理与工程 AI 人员加入,目前正与 BMW 合作碰撞仿真、与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学(TUM)开展汽车空气动力学数字孪生研究。
Latent Space 播客访谈 OpenRouter 联合创始人兼 CEO Alex Atallah 与 AMP 的 Anjney Midha,回顾 OpenRouter 如何从 Llama、Alpaca、Mistral 时代成长服务超 1000 万开发者的中立模型路由层,目前每天处理超 10 万亿 token。
NVIDIA 推出 DSX Ready 认证计划,对符合 NVIDIA DSX AI 工厂参考设计要求的合作伙伴产品进行资格认证,首批开放电池储能系统(BESS)和冷却分配单元(CDU)两个类别。
埃及 AI 生态活动在 Grand Egyptian Museum 举行,NVIDIA EMEA 副总裁 Paolo Guglielmini 发表主题演讲,埃及的 NVIDIA Deep Learning Institute 学习者规模一年内增长超十倍。
Emerald AI、Google 与 NVIDIA 宣布成立 AI Energy Management Alliance(AEMA),推动数据中心根据电网状况动态调节用电,使 AI 基础设施与电网协同。
Mistral 与 Cloudera 宣布合作,将 Mistral 模型集成到 Cloudera 混合数据平台中。企业可在私有云、公有云、本地乃至完全物理隔离(air-gapped)环境中部署推理,并基于自有专有数据训练定制模型,同时保留数据与模型的所有权。
OpenAI 在密歇根州动工建设一个 1GW 数据中心项目,属于 Stargate 计划的一部分。该项目旨在扩展 AI 基础设施,扩大模型访问范围、创造就业并支持当地社区。
OpenAI 前沿模型与 Codex 已在 AWS 正式可用,企业可通过既有的 AWS 环境、管控和采购流程使用 OpenAI 构建应用。客户可在 AWS 上开始使用 OpenAI,加快从评估到生产落地的进程。
OpenAI 推出 MRC(Multipath Reliable Connection),一种新的大规模 AI 训练集群网络协议,已通过 OCP 发布。该协议旨在提升大规模 AI 训练集群的韧性与性能。
OpenAI 宣布 ChatGPT Enterprise 和 OpenAI API 获得 FedRAMP Moderate 授权,使美国联邦机构能够在合规框架下安全采用 AI。授权覆盖企业版产品与 API 两条使用路径。
OpenAI 发布 Stargate Community 计划细节,提出以社区为先的 AI 基础设施建设方式。方案将结合社区意见、能源需求和就业优先事项,因地制宜地进行本地化定制。
OpenAI 与 Cerebras 达成合作,新增 750MW 高速 AI 算力,用于降低推理延迟,使 ChatGPT 在实时 AI 工作负载下更快。
OpenAI 与软银集团宣布与 SB Energy 合作,开发多吉瓦级 AI 数据中心园区,其中包含一座支持 Stargate 计划的 1.2 GW 德克萨斯州设施。
推荐理由:合作扩展了 Stargate 的算力与能源布局,读者可以借此了解 AI 数据中心建设对电力供应的依赖程度。
Hugging Face 宣布与 Google Cloud 达成更深入的合作,帮助企业在 Google Cloud 上用开放模型构建自己的 AI。
OpenAI 与 Broadcom 宣布达成多年期合作,将部署 10 吉瓦 OpenAI 设计的 AI 加速器。双方将共同开发下一代系统和以太网方案,目标是到 2029 年建成可扩展、高能效的 AI 基础设施。
推荐理由:官方宣布的合作明确了 10GW 规模和 2029 年时间线,读者可以据此了解 OpenAI 自研加速器布局的实际部署节奏。
AMD 与 OpenAI 宣布多年战略合作,将部署 6 GW 的 AMD Instinct GPU,首期 1 GW 于 2026 年开始,用于支撑 OpenAI 下一代 AI 基础设施并加速全球 AI 创新。
推荐理由:官方公布多年合作规模与首阶段时间表,读者可据此了解 OpenAI 算力供应的多元布局。
Oracle 与 OpenAI 达成协议,将在美国新增开发 4.5 吉瓦的 Stargate 数据中心容量。OpenAI 称该投资将创造就业、加速美国再工业化,并推动其在 AI 领域的领导地位,是 Stargate 基础设施平台的一个重要里程碑。
推荐理由:官方宣布 Stargate 与 Oracle 新增 4.5 GW 数据中心合作,读者可据此了解 OpenAI 算力扩张的规模与节奏。
Hugging Face 宣布 Hub 已从 Git LFS 迁移到 Xet,半年内 500,000 个仓库、20 PB 数据完成迁移,超 100 万用户在使用,5 月起新用户和组织默认启用 Xet。
推荐理由:官方复盘 Hub 从 Git LFS 迁移到 Xet 的完整过程,详解 Git LFS Bridge 与后台迁移机制及规模化踩坑经验。
OpenAI 推出 Stargate UAE,这是其 AI 基础设施平台 Stargate 的首次国际部署。
推荐理由:官方宣布 Stargate 首次落地海外,读者可从中了解 OpenAI 基础设施出海的动向。
Hugging Face 宣布与 JFrog 合作,将 JFrog 的扫描器集成到 Hugging Face Hub,以提升模型安全检测。与仅做模式匹配的 picklescan 不同,JFrog 会解析并分析模型权重中的代码,降低误报,并可检出 pickle 反序列化和 Keras Lambda 层等任意代码执行漏洞。所有公开模型仓库在推送后自动扫描,目前已扫描数亿个文件。
OpenAI 与战略合作伙伴宣布共建 AGI 基础设施的共同愿景,公开征集数据中心基础设施产业链上的合作企业,范围覆盖电力、土地、建设和设备等环节。相关企业可通过官方表单与其建立联系。
Hugging Face 官方宣布收购总部位于西雅图的 XetHub,团队来自曾在 Apple 构建内部 ML 基础设施的 Yucheng Low、Ajit Banerjee 和 Rajat Arya。
推荐理由:收购方官方说明整合路径,给出了 Git LFS 换自研存储后对大文件更新方式的具体改变和当前 Hub 规模数据。
Hugging Face 通报其 Spaces 平台遭未授权访问,部分 Spaces 秘钥可能被读取,官方已撤销相关 HF token 并邮件通知受影响用户。官方建议用户刷新密钥或改用细粒度访问 token,已移除 org token、为 Spaces 秘钥部署 KMS,并计划在功能对齐后弃用经典读写 token,同时已报警并向数据保护机构报告。
推荐理由:官方通报了 Spaces 秘钥未授权访问事件、已撤销的 token 范围和 KMS 等整改措施,受影响用户可据此排查自身密钥。
Hugging Face 与 Microsoft 在 Microsoft Build 上深化合作,扩展 Azure Model Catalog 的 Hugging Face Collection,新增 Llama 3、Mistral 7B、Command R Plus、Qwen 1.5 110B 等,支持在 Azure AI Studio 一键部署。
Hugging Face 宣布与 Google Cloud 建立战略合作伙伴关系,围绕开放科学、开源和云硬件展开合作。
推荐理由:来自当事方官方公告,讲清了合作的四个方向和具体落地场景,读者可了解 Hugging Face 模型在 Google Cloud 上的可用路径。
消费奖励应用公司 Fetch 在 AWS 上用 Hugging Face 与 Amazon SageMaker 优化其 ML 流水线,12 个月内构建、训练并部署了 5 个以上模型,将最慢扫描的延迟降低 50%,文档理解模型准确率提升 200%。
Hugging Face 宣布 AMD 正式加入其 Hardware Partner Program,双方将联手优化 transformer 模型在 AMD CPU 和 GPU 平台上的训练与推理性能。
Snorkel AI 与 Hugging Face 合作,将 Hugging Face 平台上超过 150,000 个开源模型接入 Snorkel Flow 开发平台,帮助企业针对自身用例适配基础模型。
消费返利公司 Fetch(月活用户超 1800 万)在 AWS 与 Hugging Face Expert Acceleration Program 支持下,从第三方方案转向自建 AI 工具处理用户上传的小票。
Hugging Face 宣布新定价:逐步停用 Inference API 付费层,该 API 仍免费开放;企业级推理推荐使用新方案 Inference Endpoints,Spaces 也新增硬件升级。这些服务无需订阅,只需在账单设置中绑定信用卡,可绑定到组织;付费服务与订阅在每月月初扣费,账单设置中可管理 PRO 订阅、付款方式并查看过去三个月用量。
Intel 正式加入 Hugging Face 的 Hardware Partner Program,双方将基于开源库 Optimum Intel 为 Transformer 的训练、微调和推理构建硬件加速。
Sempre Health 借助 Hugging Face 的 Expert Acceleration Program 构建了自动分类和回复患者短信的 NLP 管线,上线后约 20% 的入站消息可被系统自动处理。此前的规则系统只能覆盖 80% 的入站短信,Hugging Face 团队在标注、模型选型和方法上提供了指导,降低了运营团队的低价值工作量。
Habana Labs 与 Hugging Face 宣布合作,通过将 SynapseAI 软件套件集成到 Hugging Face Optimum 开源库,让用户只需几行代码即可在 Habana Gaudi 处理器上加速 Transformer 训练。
Hugging Face 在 2021 AI Hardware Summit 上宣布启动 Hardware Partner Program,Graphcore 为创始成员,开发者可在 Graphcore IPU 系统上以更低编码复杂度部署面向生产规模的 SOTA Transformer 模型。