跳到正文

全部动态

今日 4 条
7月31日周四
7月30日周三
7月25日周五
  1. Hugging Face Blog67

    Hugging Face 详解 Parquet 内容定义分块(CDC)如何配合 Xet 存储层降低数据传输量

    Hugging Face 宣布 Parquet 内容定义分块(CDC)已在 PyArrow 和 Pandas 中可用,通过 use_content_defined_chunking=True 参数启用,可与其 Xet 存储层配合仅传输变化的数据块。

    推荐理由:官方用七类数据变更场景实测 Parquet CDC 与 Xet 的去重效果,读者可据此评估迁移到 CDC 写入对上传下载的实际收益。

7月24日周四
7月23日周三
  1. Hugging Face Blog67

    Hugging Face 详解如何用 Diffusers 和 PEFT 加速 Flux LoRA 推理

    Hugging Face 发布教程,介绍结合 Flash Attention 3、torch.compile 和 FP8 量化的 Flux.1-Dev LoRA 推理优化配方,在 H100 上相对基线取得 2.23x 加速,并支持 LoRA 热切换而不触发重编译。

    推荐理由:原文给出可直接复用的 LoRA 推理优化配方和 H100、RTX 4090 两套实测延迟数据,并说明热切换避免重编译的限制。

7月18日周五
7月17日周四
7月10日周四
  1. Hugging Face Blog50

    Hugging Face 详解机器人异步推理:将动作预测与执行解耦

    Hugging Face 提出机器人异步推理方案,将动作预测与执行解耦:PolicyServer 负责推理,RobotClient 维护动作队列并执行,两者通过 gRPC 通信,比同类 REST API 快约 5 倍。该方案已在 SmolVLA 中引入,任务完成时间提速约 2 倍,成功率相当,使机器人不再等待推理,支持中途重规划和更快的控制循环。

7月9日周三
  1. Hugging Face Blog61

    Hugging Face 教你用 Gradio MCP 服务器给 LLM 添加新能力

    Hugging Face 发布教程,讲解如何通过 MCP 协议给 LLM 添加图像编辑、转写等新能力。Gradio 自 5.28.0 版本起支持 MCP 协议,使 Hugging Face Spaces 成为可按 MCP Compatible 筛选的 MCP 服务器集合。

    推荐理由:官方教程给出把 Hugging Face Spaces 当作 MCP 工具来源的具体步骤,读者可照做给自己的 LLM 添加图像编辑等新能力。

7月8日周二
7月1日周二
6月19日周四
  1. Hugging Face Blog63

    Hugging Face 教你用 QLoRA 在消费级显卡上微调 FLUX.1-dev

    Hugging Face 发布教程,展示用 QLoRA 配合 diffusers 在单张 GPU 上以约 9GB 峰值显存微调 FLUX.1-dev 学习 Alphonse Mucha 画风,700 步在 RTX 4090 上约 41 分钟完成,标准 BF16 LoRA 则需 26GB。

    推荐理由:官方博客给出完整的 QLoRA 微调配方和实测显存与耗时数据,方法可直接迁移到消费级显卡上的 FLUX.1-dev 定制训练。

6月12日周四
6月4日周三
  1. Hugging Face Blog57

    Hugging Face 在 nanoVLM 中从零实现 KV Caching

    Hugging Face 在 nanoVLM 仓库中从零实现 KV Caching,生成速度提升 38%。文章讲解自回归生成中重复计算 K/V 的冗余来源,展示通过逐层缓存字典、start_pos 位置对齐以及将 generate 循环拆分为 prefill 和 decode 两阶段来消除冗余计算,并指出这是速度与显存之间的权衡。

6月3日周二
5月25日周日
5月23日周五
5月21日周三
  1. Hugging Face Blog62

    Hugging Face Diffusers 量化后端实战:以 Flux-dev 为例对比 BnB、torchao、Quanto、GGUF 与 FP8

    Hugging Face 发布 Diffusers 量化后端解读文章,以 black-forest-labs/FLUX.1-dev 为例实测 bitsandbytes、torchao、Quanto、GGUF 和 FP8 Layerwise Casting 五种方案。

    推荐理由:文章系统对比了 Diffusers 各量化后端在 Flux-dev 上的内存、速度与画质差异,并给出选型建议和可复现代码。

5月11日周日
  1. Hugging Face Blog38

    LeRobot 社区数据集:机器人界的“ImageNet”何时到来、如何实现?

    Hugging Face LeRobot 团队认为机器人泛化本质上是一个数据问题,正通过简化录制流程、简化上传至 Hugging Face Hub、降低硬件成本,让社区数据集快速增长。目前社区贡献主要集中在 So100 和 Koch 机械臂与操作任务,但自动驾驶、辅助机器人、移动导航等领域同样受益。随着数据采集大众化,数据策展成为下一个挑战。

4月30日周三
  1. Hugging Face Blog68

    如何用 Gradio 构建 MCP Server

    Hugging Face 官方博客介绍如何用 Gradio 将 Python 函数构建为 MCP 服务器,只需安装 gradio[mcp] 并在 .launch() 中设置 mcp_server=True,即可让 LLM 通过 Claude Desktop、Cursor、Cline 等 MCP Client 调用该应用作为工具。

    推荐理由:官方教程演示只需在 launch 中设 mcp_server=True 即可把任意 Gradio 应用变成 MCP server,含资源和鉴权等进阶用法。

4月25日周五
  1. Hugging Face Blog72

    Hugging Face 发布 Tiny Agents:用 50 行代码实现基于 MCP 的 Agent

    Hugging Face 发布 Tiny Agents 教程,展示在 InferenceClient 之上实现 MCP 客户端后,Agent 本质上只是一个 while 循环,全部代码约 50 行 TypeScript。

    推荐理由:作者把 MCP 客户端到 Agent 的实现压缩成约 50 行 TypeScript,并提供可运行的开源代码,适合想理解 Agent 与 MCP 基本结构的开发者直接上手。

4月23日周三
4月16日周三
4月9日周三
4月4日周五
  1. Hugging Face Blog55

    Gradio 月活开发者突破 100 万,团队复盘五年增长经验

    Hugging Face 团队宣布 Gradio 每月有超过 100 万开发者使用,并复盘五年增长经验。核心做法包括以 Gradio Blocks 等低层原语代替高层抽象(gr.Blocks 占 80% 用量)、用 share links 一行代码实现应用传播、聚焦机器学习 Web 应用这一细分场景、不设路线图只做快速迭代,以及让每个应用同时生成 API 端点以便本地部署或程序化调用。

4月2日周三
3月31日周一
3月26日周三
  1. Hugging Face Blog79

    Sentence Transformers 官方教程:如何训练和微调 Reranker 模型

    Hugging Face 发布 Sentence Transformers 训练和微调 reranker(Cross Encoder)模型的详细教程,覆盖数据集、损失函数、训练参数、评估器和 CrossEncoderTrainer 五个组件,并介绍 mine_hard_negatives 挖掘难负样本。

    推荐理由:教程给出完整可复现的 reranker 微调配方和评测数据,读者可据此在自己领域训练出超过通用大模型的小型 reranker。

3月20日周四
3月7日周五
3月4日周二
2月28日周五
2月13日周四