Mistral AI 宣布推出 AI for Citizens 计划,助力各国政府掌握 AI 自主权
Mistral AI 宣布推出 AI for Citizens 合作计划,帮助各国政府和公共机构战略性地利用 AI 转型公共服务、催化创新并确保竞争力,已与法国、卢森堡、新加坡、荷兰、英国、瑞士等国家和地区的政府、国防力量、公共部门机构和教育机构展开合作。
Mistral AI 宣布推出 AI for Citizens 合作计划,帮助各国政府和公共机构战略性地利用 AI 转型公共服务、催化创新并确保竞争力,已与法国、卢森堡、新加坡、荷兰、英国、瑞士等国家和地区的政府、国防力量、公共部门机构和教育机构展开合作。
Genspark 基于 GPT-4.1 和 OpenAI Realtime API 构建了无代码个人智能体产品,在 45 天内实现 3600 万美元 ARR。
Hugging Face 发布长文教程,讲解如何用 Sentence Transformers 训练和微调稀疏嵌入模型,并演示得到 sparse-encoder/example-inference-free-splade-distilbert-base-uncased-nq。
OpenAI 与 Mandala Partners 合作发布面向澳大利亚的 AI Economic Blueprint,为澳大利亚提供一项可落地的计划,以释放人工智能的全部经济与社会潜力。该蓝图发布之际,提升生产率已成为澳大利亚的国家优先事项。
NVIDIA 发布 Llama Nemotron Nano VL,一个面向智能文档处理的 8B 视觉语言模型,已在 Hugging Face 提供下载,并可通过 NVIDIA NIM API 使用。
Retell AI 基于 GPT-4o 和 GPT-4.1 打造无代码语音自动化平台,帮助企业上线实时自然的语音智能体,自动化客户通话。该方案可降低通话成本、提升 CSAT,且无需脚本和等待时间。
Google Gemma 3n 正式开源,发布 E2B 和 E4B 两个尺寸、各含 base 与 instruct 版本,支持图像、文本、音频和视频输入。E2B/E4B 实际参数为 5B/8B,但借助 MatFormer 架构与 Per-Layer Embeddings,仅需 2GB/3GB GPU 内存即可运行,E4B 还在 LMArena 上取得 1300+ 分数。
推荐理由:原文给出模型的有效参数设计、显存需求和各开源库用法,端侧开发者可以据此选择部署方式。
AI GTM 平台 Unify 使用 OpenAI 的 o3、GPT-4.1 和 CUA 自动化客户拓潜、调研与外联。借助超个性化消息和全天候工作流,Unify 帮助销售团队规模化生成销售管道,同时专注于高价值的客户互动。
SGLang 现已支持 Hugging Face transformers 作为推理后端,任何 transformers 兼容模型可开箱获得高性能推理。
Hugging Face 发布教程,展示用 QLoRA 配合 diffusers 在单张 GPU 上以约 9GB 峰值显存微调 FLUX.1-dev 学习 Alphonse Mucha 画风,700 步在 RTX 4090 上约 41 分钟完成,标准 BF16 LoRA 则需 26GB。
推荐理由:官方博客给出完整的 QLoRA 微调配方和实测显存与耗时数据,方法可直接迁移到消费级显卡上的 FLUX.1-dev 定制训练。
OpenAI 表示,先进 AI 既能变革生物学与医学,也带来生物安全风险。OpenAI 正在主动评估 AI 的相关能力,并落实安全防护措施,防止 AI 被误用于生物学领域。
OpenAI 发布研究,探讨在错误回答上训练如何导致语言模型更广泛的不对齐。研究识别出驱动该行为的内部特征,并发现通过极少量微调即可将其逆转。
推荐理由:OpenAI 官方研究探讨错误回答训练如何引发更广泛的模型不对齐,并指出该内部特征可用极少微调逆转,为对齐研究提供了新方向。
OpenAI 推出 OpenAI for Government,一项面向美国公务员提供最先进 AI 工具的新计划。该计划支持美国政府采用一流技术,并将这些工具用于公共服务。
Hugging Face 宣布 Groq 成为 Hub 上的 Inference Provider,可直接在模型页和 JS、Python 客户端 SDK 中调用 Groq 托管的开源模型,包括 Meta 的 Llama 4 和 Qwen 的 QWQ-32B。
TNG 在 24 块 H100 GPU 集群上自托管多个 LLM,日均消耗超 1 亿 token、生成超 1000 万 token。文章分析 vLLM 默认 chunked-prefill 策略下长提示词会阻塞队列:prefill 各请求只能顺序执行,导致后续请求首 token 等待时间变长。
Hugging Face 官方博客介绍 Kernel Hub,开发者可通过 kernels 库的 get_kernel 一行代码加载预编译的优化计算内核,自动匹配 Python、PyTorch 和 CUDA 版本。
推荐理由:原文给出从加载到基准测试的完整可复现步骤,读者可据此评估把优化内核接入自己模型的实际收益。
Featherless AI 成为 Hugging Face Hub 支持的 Inference Provider,用户可在模型页面直接使用其 serverless 推理服务。
OpenAI 与 Mattel 宣布合作,将 AI 引入 Barbie、Hot Wheels 等标志性品牌。双方旨在借助 AI 增强创意开发、简化工作流程,并为粉丝创造新的互动方式。
NVIDIA 发布 Isaac GR00T N1.5——首个开源通用人形机器人基础模型 GR00T N1 的首次重大更新,并提供用 LeRobot SO-101 机械臂遥操作数据进行微调的完整教程。
Mistral AI 发布 Mistral Compute,向客户提供私有集成 AI 基础设施,涵盖 GPU、编排、API、产品和服务,形态从裸金属服务器到全托管 PaaS。作为 NVIDIA 合作伙伴,初期提供数万块 GPU 并计划快速扩张,面向欧洲、中东、亚洲及南半球的主权、企业和研究机构,强调数据主权、欧洲合规与脱碳能源,已有 Orange、BNP Paribas、Thales 等启动伙伴。
Hugging Face 与 NVIDIA 在 GTC Paris 上宣布推出 Training Cluster as a Service,让全球研究机构可按需申请 GPU 集群并只为训练运行时长付费。
Mistral AI 发布首个推理模型 Magistral,含 24B 开源的 Magistral Small(Apache 2.0)和企业版 Magistral Medium。
推荐理由:原文给出两版本的具体评测分数、开源许可和部署渠道,读者可据此评估其在推理模型中的定位与可用性。
OpenAI 推出 Outbound Coordinated Disclosure Policy,指导如何负责任地向第三方软件报告漏洞。该政策强调诚信、协作与主动式安全,旨在规模化提升安全防护。
Hugging Face 发布 ScreenSuite,一套覆盖感知、定位、单步操作和多步智能体四类能力的 GUI Agent 评测套件,整合 13 个基准,如 ScreenQA-Short、ScreenSpot-Pro、AndroidWorld 和 OSWorld。
OpenAI 表示正在对抗一项应纽约时报及原告要求发出的法院命令,该命令要求无限期保留消费级 ChatGPT 和 API 用户数据。OpenAI 称将努力维护用户隐私、满足法律要求并遵守其数据保护承诺。
推荐理由:原文说明 OpenAI 为何抵制纽约时报提出的数据保留要求,读者可以了解这一法院命令对用户隐私的影响。
OpenAI 发布最新报告,通过案例说明其如何检测和防范 AI 的恶意使用。该报告为 2025 年 6 月期,展示了 OpenAI 在拦截滥用行为方面的实际做法。
Mistral 发布 Mistral Code,一款面向企业开发团队的 AI 编程助手,基于开源项目 Continue 打造,今日面向 JetBrains IDE 和 VSCode 开放 private beta,GA 即将推出。
Hugging Face 在 nanoVLM 仓库中从零实现 KV Caching,生成速度提升 38%。文章讲解自回归生成中重复计算 K/V 的冗余来源,展示通过逐层缓存字典、start_pos 位置对齐以及将 generate 循环拆分为 prefill 和 decode 两阶段来消除冗余计算,并指出这是速度与显存之间的权衡。
Arm 生态负责人 Michael Gamble 构建了一个在 Arm CPU 上本地运行的音频生成应用,无需 GPU 或云端推理。该应用基于 Stability AI 的 Stable Audio Open 模型(经 Hugging Face 获取),用 PyTorch 和 TorchAudio 执行推理,通过减少扩散步数(steps=7)和全线程利用实现数秒内生成。
H Company 发布开源 Action VLM 系列 Holo1(含 Holo1-3B 与 Holo1-7B),并同步开源含 1,639 项 UI 任务的 WebClick 多模态定位基准。
推荐理由:官方给出模型规格、定位准确率和每任务成本数字,读者可据此评估这套开源 GUI 自动化方案的实际性价比。
Hugging Face 在 TRL v0.18.0 通过 PR #3394 引入 vllm_mode="colocate",让 vLLM 不再以独立 HTTP 服务器运行,而是嵌入同一分布式进程组,与 GRPO 训练共享同一批 GPU,消除训练与生成之间的互相等待。
Hugging Face 发布 450M 参数的开源视觉-语言-动作模型 SmolVLA,基于 lerobot 标签下的社区共享数据集预训练,可在消费级硬件(甚至 CPU 或 MacBook)上运行和训练。
OpenAI 封禁了一批使用 AI 生成帖子的账号,这些帖子用于抨击一位台湾社交媒体网红并涉及相关美国议题,OpenAI 将该行动命名为 Operation Sneer Review,判断其为中国起源的影响力活动。
OpenAI 封禁了一批利用 AI 在多个社交平台上生成有关菲律宾政治和公职人员评论的账号。此次行动被 OpenAI 称为"Operation High Five"。
OpenAI 停用一批中国来源账号,这些账号利用 AI 生成美国政治内容,并调查美国人物、运动和在线社区,属于美国政治极化影响力活动。
OpenAI 封禁了疑似来自俄罗斯、利用 AI 生成涉及乌克兰、北约和德国内政的德语政治内容的账号。
OpenAI 封禁了与涉嫌欺骗性就业活动相关的账号。这些活动利用 AI 制作材料,用于可能存在欺诈行为的远程职位申请。
OpenAI 封禁了使用 AI 构建恶意软件、完善 loader 并调试网络攻击工具的俄语账号,该行动代号 Operation ScopeCreep。
OpenAI 封禁了被公开归属于中国的威胁行为体 Vixen 和 Keyhole Panda 关联的账号。这些行为体利用 AI 辅助漏洞研究、脚本编写、翻译和运维故障排查。
OpenAI 封禁了疑似源自柬埔寨、利用 AI 支持诈骗工作流的账号,这些诈骗以英国民众为目标,通过伪装成“拨错号码”开启任务型骗局。