跳到正文

全部动态

今日 4 条
1月27日周二
1月23日周五
1月22日周四
1月8日周四
1月5日周一
12月18日周四
  1. Hugging Face Blog64

    Transformers v5 重构分词器:架构与训练词表分离、单文件单后端

    Hugging Face 博客详解 Transformers v5 对分词器的重新设计:将分词器架构(normalizer、pre-tokenizer、算法类型、post-processor、decoder)与训练好的词表和 merges 分离,类似 PyTorch 分离模型结构与权重。

    推荐理由:文章来自 transformers 团队,解释 v5 将分词器架构与训练词表分离的设计,便于读者直接检查组件或训练自定义分词器。

12月17日周三
  1. Hugging Face Blog41

    开放评测标准:用 NeMo Evaluator 对 NVIDIA Nemotron 3 Nano 进行基准测试

    NVIDIA 以开放评测方式发布 Nemotron 3 Nano 30B A3B,并公开其完整的评测 recipe。该 recipe 基于 NeMo Evaluator 开源库构建,任何人都可以重跑评测流水线、查看配置与产物并独立验证结果。NeMo Evaluator 将多个评测 harness 统一在同一接口下,评测流程与推理后端解耦,并可生成结构化结果与日志以便审计。

12月16日周二
12月12日周五
12月11日周四
  1. Hugging Face Blog63

    llama.cpp server 新增 router mode 支持多模型动态管理

    llama.cpp server 新增 router mode,无需重启即可动态加载、卸载和切换多个模型,补上类似 Ollama 的模型管理能力。该功能采用多进程架构,单个模型崩溃不影响其他模型;支持自动发现 GGUF 文件、按需加载、LRU 淘汰(默认 --models-max 4)、请求路由和 Web UI 切换。

    推荐理由:原文给出 router mode 的加载与切换机制和具体命令选项,读者可以据此评估本地多模型管理的新工作流。

  2. Hugging Face Blog72

    Hugging Face Skills 教程:让 Codex 端到端完成模型微调实验

    Hugging Face 发布教程,展示如何用 Hugging Face Skills 让 OpenAI Codex 端到端完成机器学习实验,覆盖数据验证、硬件选择、提交 Hugging Face Jobs、用 Trackio 监控训练、维护训练报告以及用 lighteval 评测。

    推荐理由:官方教程给出让 Codex 端到端跑完微调、评测和 GGUF 导出的完整流程与成本参考,方法可直接迁移到自己的实验。

12月8日周一
12月4日周四
  1. Hugging Face Blog74

    Hugging Face 发布 Skills 让 Claude 等编码智能体完成开源模型微调

    Hugging Face 推出 hf-llm-trainer 技能,让 Claude Code、Codex、Gemini CLI 等编码智能体可自动选择 GPU、生成脚本、向 Hugging Face Jobs 提交微调任务并用 Trackio 监控进度,完成后模型自动推送到 Hub。

    推荐理由:官方发布了让 Claude Code 等编码智能体端到端微调开源模型的 hf-llm-trainer 技能,覆盖 GPU 选择、任务提交到监控的完整流程。

11月25日周二
  1. Hugging Face Blog60

    Diffusers 支持 FLUX.2 图像生成

    Hugging Face 官方博客宣布 Diffusers 支持 FLUX.2,提供 Flux2Pipeline 和 Flux2Transformer2DModel 的完整加载与推理示例。

    推荐理由:官方博客给出 FLUX.2 在 Diffusers 中的完整推理代码和量化加载方式,读者可以直接照搬运行文生图流程。

11月19日周三
11月17日周一
10月29日周三
10月28日周二
  1. Hugging Face Blog58

    Hugging Face 提出语音同意门机制,让语音克隆须先获得说话人同意

    Hugging Face 在博客中提出 voice consent gate 概念,只有说话人朗读并经 ASR 识别出明确的同意语句后,语音克隆 TTS 才能启动。文中给出包含演示 Space 的示例代码,说明用语言模型按随机日常话题生成同意句与音素多样性句的组合,并指出该设计仍可被其他 TTS 伪造,未来可探索音频溯源等验证手段。

10月21日周二
10月16日周四
10月15日周三
10月2日周四
9月29日周一
9月10日周三
  1. Hugging Face Blog64

    Hugging Face 发布 Jupyter Agent:微调 Qwen3-4B 提升 DABStep 数据科学任务表现

    Hugging Face 发布 Jupyter Agent 项目,用约 2TB Kaggle 笔记本构建 51k 条合成轨迹、近 0.2B tokens 的数据集,微调 Qwen3-4B-Instruct-2507 与 Qwen3-4B-Thinking-2507。

    推荐理由:原文完整给出从数据清洗到微调的管线与消融数字,读者可复用其中提升小模型数据科学能力的做法。

9月2日周二
  1. Hugging Face Blog64

    Hugging Face ZeroGPU Spaces 如何用 PyTorch 预编译提速图像视频生成

    Hugging Face 发文介绍如何在 ZeroGPU Spaces 中用 PyTorch ahead-of-time 编译优化生成式 demo,指出 torch.compile 与 ZeroGPU 短生命周期进程不兼容,需先导出再用 spaces.aoti_* API 编译加载。

    推荐理由:原文给出 ZeroGPU 上 AoT 编译的完整步骤和 FP8、动态形状等进阶技巧,读者可以直接迁移到自己的 Spaces demo。

8月21日周四
8月19日周二
8月18日周一
8月8日周五
8月7日周四
8月1日周五