跳到正文

#Hugging Face

今日 0 条
5月7日周四
5月6日周三
4月29日周三
4月28日周二
  1. Hugging Face Blog66

    NVIDIA 发布 Nemotron 3 Nano Omni 全模态模型,覆盖文档、语音、视频与 GUI 智能体

    NVIDIA 发布 Nemotron 3 Nano Omni(30B-A3B)全模态理解模型,支持文档分析、ASR、长音视频理解和 agentic computer use,并在 Hugging Face 开放 BF16、FP8 和 NVFP4 权重。

    推荐理由:原文给出完整基准对比和架构细节,读者可以据此评估它是否值得替换现有的多模态工作流。

4月27日周一
4月23日周四
  1. Hugging Face Blog63

    Hugging Face 讲解如何在 Chrome 扩展的 Manifest V3 中运行 Transformers.js

    Hugging Face 发布教程,指导开发者在 Manifest V3 约束下用 Transformers.js 在 Chrome 扩展中运行本地 AI,并复刻其 Gemma 4 Browser Assistant 架构。

    推荐理由:作者基于自家 Gemma 4 浏览器扩展拆解 MV3 下运行 Transformers.js 的架构决策,给出可直接迁移的运行时划分与消息契约设计。

4月16日周四
  1. Hugging Face Blog63

    Sentence Transformers 多模态嵌入与重排模型训练微调教程:以 Qwen3-VL-Embedding-2B 微调视觉文档检索为例

    Hugging Face 博客讲解如何用 Sentence Transformers 训练和微调多模态嵌入与重排模型,以 Qwen/Qwen3-VL-Embedding-2B 在 Visual Document Retrieval 任务上微调为例。

    推荐理由:作者用 Qwen3-VL 完整走通多模态嵌入微调流程,NDCG@10 从 0.888 提到 0.947,方法可直接迁移到自己的领域数据。

4月15日周三
  1. Hugging Face Blog64

    HCompany 发布 Chrome 扩展 HoloTab,基于 Holo3 实现网页任务自动化

    HCompany 推出 Chrome 扩展 HoloTab,将其 3 月 31 日发布的 computer-use 模型 Holo3 直接带到浏览器中,无需配置即可在任何网站自动化操作。其 Routines 功能通过录屏和讲解生成可重复运行或定时执行的例程,适合比价、找工作等重复任务;产品目前免费开放使用。

    推荐理由:原文介绍了浏览器智能体的录制生成例程能力和免费入口,读者可以据此了解它如何把 computer-use 模型带入日常工作流。

4月9日周四
  1. Hugging Face Blog71

    Sentence Transformers v5.4 发布,支持文本、图像、音频和视频的多模态嵌入与重排

    Hugging Face 发布 Sentence Transformers v5.4,用户可用同一套 API 对文本、图像、音频和视频进行嵌入编码与相关性重排。

    推荐理由:官方教程给出 v5.4 多模态嵌入与重排的完整用法、代码示例和支持模型清单,读者可以直接照着搭建跨模态检索或 RAG 流程。

4月8日周三
4月2日周四
  1. Hugging Face Blog82

    Google DeepMind 发布 Gemma 4 多模态模型系列并登陆 Hugging Face

    Google DeepMind 发布 Gemma 4 多模态模型系列,共五个尺寸(E2B、E4B、12B Unified、31B、26B A4B MoE),采用 Apache 2.0 许可,支持图像、文本和音频输入,上下文窗口最高 256K。

    推荐理由:Hugging Face 官方详解 Gemma 4 架构、多模态能力与全生态部署方式,还覆盖 DiffusionGemma 和推理加速等上手细节。

4月1日周三
  1. Hugging Face Blog62

    TII 发布 Falcon Perception 0.6B 早融合感知模型及 0.3B Falcon OCR

    TII Falcon Vision 团队发布 Falcon Perception,一个 0.6B 参数的早融合 Transformer,用混合注意力掩码处理图像块与文本,做自然语言提示的开放词汇定位与分割,在 SA-Co 上达到 68.0 Macro-F1(SAM 3 为 62.3),但在 presence calibration 上落后(MCC 0.64 vs 0.82)。

    推荐理由:TII 自述用单一早融合 Transformer 做开放词汇感知,读者可以看到架构、数据配方和 SA-Co 与 PBench 上的具体对比依据。

  2. Hugging Face Blog66

    Gradio 推出 gradio.Server,支持任意自定义前端搭配 Gradio 后端

    Hugging Face 发布 gradio.Server,一个扩展自 FastAPI 的类,让开发者用 React、Svelte 或原生 HTML/JS 等任意前端框架,同时保留 Gradio 的排队、并发管理、SSE 流式、gradio_client 兼容和 Spaces 上的 ZeroGPU 支持。

    推荐理由:官方介绍了 gradio.Server 如何让任意自定义前端继续复用 Gradio 的排队、MCP 和 ZeroGPU 能力,并附完整代码示例。

3月31日周二
  1. Hugging Face Blog32

    OpenMed 用 165 美元跨 25 物种训练 mRNA 语言模型

    OpenMed 构建了覆盖结构预测、序列设计与密码子优化的端到端蛋白质 AI 流水线。在对比多种 transformer 架构后,CodonRoBERTa-large-v2 胜出,困惑度 4.10、Spearman CAI 相关性 0.40,显著超过 ModernBERT;团队随后扩展到 25 个物种,用 55 GPU 小时训练了 4 个生产模型,建立了其他开源项目没有的物种条件化系统。

3月27日周五
3月24日周二
3月21日周六
3月18日周三
3月17日周二
3月10日周二
  1. Hugging Face Blog67

    Hugging Face Hub 推出 Storage Buckets 可变对象存储

    Hugging Face 在 Hub 上推出 Storage Buckets,一种不版本控制的可变、类 S3 对象存储,用于存放 checkpoints、处理后的数据、Agent traces 等中间产物。

    推荐理由:官方发布后明确解释了为什么中间产物不适合放 Git 仓库,并给出 CLI、Python、fsspec 的完整上手路径,便于迁移现有训练和数据流程。

3月9日周一
3月5日周四
  1. Hugging Face Blog66

    Hugging Face 推出 Modular Diffusers,用可组合积木构建扩散流水线

    Hugging Face 发布 Modular Diffusers,将扩散流水线拆成文本编码、去噪、解码等可独立运行、自由增删互换的可复用块,作为现有 DiffusionPipeline 的灵活补充。

    推荐理由:原文展示了用可组合积木搭建扩散流水线的完整用法,包括自定义块、模块化仓库和 Mellon 可视化集成,方法可直接复用。

3月4日周三
2月26日周四
2月20日周五
  1. Hugging Face Blog66

    Hugging Face 教程:用 Unsloth 和 HF Jobs 通过 Claude Code 等编码智能体免费微调 LFM2.5-1.2B-Instruct

    Hugging Face 发布教程,讲解如何用编码智能体(Claude Code、Codex、Open Code)配合 Unsloth 在 HF Jobs 上微调 LiquidAI/LFM2.5-1.2B-Instruct。

    推荐理由:官方教程给出用编码智能体加 Unsloth 在 HF Jobs 上微调小模型的完整流程,含脚本、命令和各尺寸 GPU 的每小时成本参考。

  2. Hugging Face Blog81

    GGML 与 llama.cpp 团队加入 Hugging Face 以推动本地 AI 长期发展

    GGML 及 Georgi Gerganov 团队宣布加入 Hugging Face,以保障本地 AI 的长期开源发展。团队将继续全职维护 llama.cpp,保持技术方向与社区自治,项目继续 100% 开源、社区驱动;双方计划让 transformers 中的模型定义能近乎一键地在 llama.cpp 中落地,并改进基于 ggml 的软件的打包与用户体验。

    推荐理由:收购方官方说明团队加入后的自治安排与技术方向,读者可据此评估 llama.cpp 社区的连续性与本地推理生态走向。

2月18日周三
  1. Hugging Face Blog68

    Gradio 讲解如何用 gr.HTML 一次性生成任意 Web 应用

    Hugging Face 官方博客介绍 Gradio 6 中 gr.HTML 支持自定义模板、scoped CSS 和 JavaScript 交互,可让 LLM 一次性生成前端、后端和状态管理都在单个 Python 文件里的应用。

    推荐理由:原文由官方讲解 gr.HTML 的模板机制和 API,并结合多类应用示例说明如何用单个 Python 文件构建交互式组件。

2月13日周五
2月12日周四
2月9日周一
  1. Hugging Face Blog71

    Transformers.js v4 登陆 NPM,新增 WebGPU 运行时与众多新模型

    Hugging Face 发布 Transformers.js v4,已可在 NPM 安装,核心变化是采用 C++ 重写的 WebGPU Runtime,同一套代码可运行于浏览器、Node、Bun 和 Deno。

    推荐理由:官方发布说明完整列出 WebGPU 运行时重写、新架构支持和构建性能数据,读者可评估在浏览器或服务端本地跑模型的可行性。

2月4日周三
2月3日周二