跳到正文

全部动态

今日 28 条
9月16日周三
9月14日周一
9月12日周六
9月11日周五
9月10日周四
  1. Hugging Face Blog63

    Hugging Face 实践:用 Storage Bucket 和代理跨 HF Jobs 跑 Async GRPO + LoRA,无需 NCCL

    Hugging Face 博客介绍 TRL v1.14 的 AsyncGRPOTrainer 支持 LoRA 训练并仅向 vLLM 同步几 MB 的 adapter,训练与推理以独立 HF Jobs 运行,通过 Storage Bucket 挂载共享 adapter,前置代理负责加鉴权头、按 KV 前缀路由 rollout 并向所有副本广播 adapter 加载。

    推荐理由:原文给出了跨机 LoRA GRPO 的完整架构与五轮瓶颈调优数据,500 步从 3 小时 27 分压到 53 分钟,方法可直接复用。

9月9日周三
9月8日周二
  1. Google DeepMind72

    Google DeepMind 发布 AlphaGenome Atlas 覆盖人类基因组全部 90 亿单碱基变体预测

    Google DeepMind 发布 AlphaGenome Atlas 平台,收录人类基因组约 90 亿个单核苷酸变体的分子效应预测,数据集达 1 PB,超过 AlphaFold 数据库 30 倍以上。

    推荐理由:平台把 90 亿个单核苷酸变体的预测免费开放,配合 AVI 评分与案例结果,研究者在排序罕见病变体时可省去大量实验验证。

  2. Mistral AI72

    Mistral 完成 30 亿欧元 Series D 融资,估值超 210 亿欧元

    Mistral 宣布完成 30 亿欧元 Series D 融资,投后估值超 210 亿欧元,称其为欧洲科技公司史上最大股权融资。本轮由三星电子领投,Scaleup Europe Fund(EQT 管理)和 PSG Equity 联合领投,Advent、BlackRock、卢森堡大公国为新投资方,a16z、ASML、NVIDIA 等老股东跟投。

    推荐理由:官方公告给出融资金额、估值和资方名单,读者可以据此了解欧洲主权开源模型路线的资金与商业基础。

9月7日周一
9月5日周六
  1. GitHub Blog · AI & ML66

    GitHub 发布 Project HydraFusion 研究预览:用多模型编排实现前沿级编码质量

    GitHub 推出 Project HydraFusion 研究预览,通过运行时多模型编排提供前沿级编码智能,所有 GitHub Copilot 计划用户可在 Copilot CLI 中通过 /experimental 使用,按各模型标准费率计费。

    推荐理由:原文给出三种执行模式和跨基准的成本质量数据,读者可以据此判断多模型编排对编码工作流的实际取舍。

9月4日周五
  1. Google Research63

    Google 与 HHMI Janelia 发布完整雄性果蝇大脑及中枢神经系统连接组

    Google 与 HHMI Janelia、MRC 分子生物学实验室及剑桥大学等合作,在 Cell 发表雄性果蝇大脑和中央神经系统完整连接组,包含超过 166,000 个神经元和 1.25 亿个突触连接,是迄今按神经元数量计最大的脑图谱。

    推荐理由:原文给出雄性果蝇全脑连接组的规模、验证方式和开源查看工具,也说明雌雄对照可用于研究性行为与个体差异。

  2. GitHub Blog · AI & ML47

    GitHub Copilot app 入门:同时运行多个智能体

    GitHub Copilot app 支持同时运行多个 AI 智能体,各会话相互独立、互不干扰。每个会话可运行在各自的 Git worktree 上并保留独立上下文,并行执行不同任务。开发者可在 sessions 视图跟踪进度,把时间花在审查和决策上,无需逐个等待任务完成。

9月3日周四
  1. Hugging Face Blog75

    Hugging Face 发布 funes:为编码智能体提供可自主拥有的记忆层

    Hugging Face 发布开源工具 funes,为 Claude Code、Codex、pi、Hermes 等编码智能体提供持久记忆层,基于机器上已有的会话记录构建,本地索引与检索,一条 funes add 命令即可接入。

    推荐理由:官方介绍这款本地优先的智能体记忆层,给出了安装方式、检索管线设计和跨机器共享机制,可评估是否纳入自己的编码工作流。

  2. Hugging Face Blog62

    Hugging Face 用 100 步 GRPO 微调 LFM2.5-350M,IFStruct 成绩从 22.6% 提升至 29.7%

    Hugging Face 发布教程,展示用 TRL 库以 GRPO 微调 LiquidAI/LFM2.5-350M 提升结构化输出合规率。训练仅用约 500 样本和 100 步,可在免费版 Colab 或 Kaggle GPU 上运行,评测经 llama.cpp 在 MacBook 本地完成。

    推荐理由:原文给出完整可复现的 GRPO 微调流程和量化前后对比,读者可以用同样低成本方法提升小模型的结构化输出合规率。

  3. Google DeepMind43

    Google DeepMind 推出 Fairwind 计划:以 Gemini 3.8 Flash Cyber 提供主动网络防御

    Google DeepMind 推出 Fairwind 计划,向政府机构和受信任的合作伙伴开放先进的网络防御能力。该计划将 Gemini 3.8 Flash Cyber 模型与 CodeMender 结合,可自主查找、验证并修复漏洞,在几分钟内生成就绪的补丁,初始访问面向政府、关键基础设施运营商和核心技术平台。

9月2日周三
  1. Hugging Face Blog43

    Hugging Face 发布 BenchMIRT:审计 LLM 基准实际测的是什么

    Hugging Face 推出 BenchMIRT,一种基于多维 IRT 的方法,用于在题目层面审计 LLM 基准的真实测量内容。该方法基于 100 个 LLM、16 个基准和超过 34K 道题的结果训练,未事先标注即独立恢复出安全与通用推理两个维度。分析发现 BBQ 和 WMDP 得分与通用推理的关联强于安全,HarmBench 的版权类题目也更偏向通用推理。

9月1日周二
  1. Hugging Face Blog60

    Hugging Face 发布 @huggingface/kernels 及 207 个 WebGPU 内核

    Hugging Face WebAI 团队发布 @huggingface/kernels 库和 207 个 WebGPU 内核(Apache-2.0),每个内核以带版本号的独立仓库发布,包含 manifest、正确性测试、基准用例和 WGSL shader 模板。

    推荐理由:官方介绍了 207 个 WebGPU 内核的发布方式和与 ORT WebGPU 的实测对比,读者可以据此评估浏览器端推理优化的可用路径。

  2. Google Research53

    Google 发布 3.3 亿参数时间序列基础模型 TimesFM-3,支持零样本多变量预测

    Google Research 发布时间序列基础模型 TimesFM-3,参数量 3.3 亿,预训练语料超过 1 万亿时间点,原生支持零样本多变量预测。模型可同时预测多个目标序列,支持过去协变量与过去-未来协变量,通过交替注意力与 Contiguous Patch Masking 在单次前向传播中完成整段预测,每步输出第 10 到第 90 百分位共 9 个分位数。

8月31日周一
8月28日周五
  1. Hugging Face Blog60

    Open ASR Leaderboard 新增 Monsoon 印地语与印度英语评测集

    Voice Arena 与 Hugging Face 合作,在 Open ASR Leaderboard 引入 Monsoon en-IN 和 Monsoon hi-IN 两套评测集,覆盖 4,888 名说话人,印地语是该多语言榜单上首个非欧洲语言。

    推荐理由:原文给出 Monsoon 四个评测集的采集设计与区域误差分析样例,读者可以了解带说话人元数据的 ASR 评测能揭示什么。