跳到正文

#Hugging Face

今日 0 条
10月16日周四
10月15日周三
10月14日周二
10月7日周二
  1. Hugging Face Blog68

    BigCode 发布 BigCodeArena:通过代码执行端到端评判代码生成模型

    BigCode 发布 BigCodeArena,一个通过真实执行来评判代码生成模型的人类投票平台,支持 10 种语言和 8 种执行环境,开放无需注册。上线 5 个月收集 14K 对话、4700+ 偏好投票,Elo 排名中 o3-mini 和 o1-mini 居首。

    推荐理由:基于5个月社区执行评估数据发布代码生成评测平台,给出分语言和执行环境的模型表现差异与两个新基准。

10月2日周四
10月1日周三
  1. Hugging Face Blog51

    Hugging Face 发布 RTEB 基准,用开放与私有数据集评估嵌入模型真实检索泛化能力

    Hugging Face 发布 Retrieval Embedding Benchmark(RTEB)测试版,旨在可靠评估嵌入模型在真实应用中的检索准确性。它采用开放与私有数据集结合的混合策略来检测基准过拟合,覆盖 20 种语言和法律、医疗、代码、金融等企业领域,默认榜单指标为 NDCG@10,榜单已上线于 MTEB 排行榜的检索板块。

9月26日周五
9月23日周二
9月22日周一
  1. Hugging Face Blog45

    SyGra:面向 LLM 和 SLM 数据构建的一站式框架

    Hugging Face 介绍了 SyGra,一个用于 LLM 与 SLM 数据集创建、转换与对齐的低代码/无代码框架。它以 Python 库形式提供,支持 vLLM、Hugging Face TGI、Triton、Ollama 等多种推理后端,用户只需专注于提示词工程。该框架可覆盖 Q&A 生成、DPO 偏好对、推理增强、多语言转换、质量过滤及 RAG 场景等多种数据构建需求。

9月19日周五
9月18日周四
9月17日周三
9月16日周二
9月15日周一
  1. Hugging Face Blog46

    Hugging Face Gradio 新增可见水印功能

    Hugging Face 让 Gradio 中的可见水印变得极其简单:创建 Space 中的应用或 demo 时,用一行命令即可添加水印。图片和视频通过 gr.Image 或 gr.Video 的 watermark 参数指定水印,支持文件名、在线图片或 numpy 数组;AI 生成的文本可通过 gr.Chatbot 的 watermark 参数,在用户复制 AI 回复时自动附上署名。

9月11日周四
  1. Hugging Face Blog73

    Hugging Face 详解 transformers 为支持 OpenAI GPT-OSS 所做的效率升级

    Hugging Face 发文介绍为支持 OpenAI GPT-OSS 对 transformers 库的多项升级,包括从 Hub 下载预编译内核、原生 MXFP4 量化、张量并行与专家并行、动态滑动窗口 KV 缓存、Continuous Batching 和更快的模型加载。

    推荐理由:Hugging Face 官方详解为支持 gpt-oss 对 transformers 做的各项升级,多数特性可复用到其他模型。

9月10日周三
  1. Hugging Face Blog64

    Hugging Face 发布 Jupyter Agent:微调 Qwen3-4B 提升 DABStep 数据科学任务表现

    Hugging Face 发布 Jupyter Agent 项目,用约 2TB Kaggle 笔记本构建 51k 条合成轨迹、近 0.2B tokens 的数据集,微调 Qwen3-4B-Instruct-2507 与 Qwen3-4B-Thinking-2507。

    推荐理由:原文完整给出从数据清洗到微调的管线与消融数字,读者可复用其中提升小模型数据科学能力的做法。

9月9日周二
9月4日周四
  1. Hugging Face Blog67

    Google 发布 EmbeddingGemma 高效多语言嵌入模型

    Google 发布开源嵌入模型 EmbeddingGemma,308M 参数、2K 上下文窗口,支持超过 100 种语言,量化后内存占用低于 200 MB,适合端侧 RAG 和 Agent 场景。

    推荐理由:官方博客给出架构、基准和各框架用法,还附完整微调示例,读者可以据此判断如何把它接入现有检索流程。

9月3日周三
9月2日周二
  1. Hugging Face Blog64

    Hugging Face ZeroGPU Spaces 如何用 PyTorch 预编译提速图像视频生成

    Hugging Face 发文介绍如何在 ZeroGPU Spaces 中用 PyTorch ahead-of-time 编译优化生成式 demo,指出 torch.compile 与 ZeroGPU 短生命周期进程不兼容,需先导出再用 spaces.aoti_* API 编译加载。

    推荐理由:原文给出 ZeroGPU 上 AoT 编译的完整步骤和 FP8、动态形状等进阶技巧,读者可以直接迁移到自己的 Spaces demo。

8月21日周四
8月19日周二
8月18日周一
8月14日周四
8月12日周二
8月8日周五
  1. Hugging Face Blog71

    Hugging Face 开源 AI Sheets:用开放模型无代码构建和增强数据集

    Hugging Face 发布开源无代码工具 AI Sheets,用于以电子表格方式构建、转换和增强数据集,可本地部署或在 Hub 上免费试用,支持通过 Inference Providers 调用 Hub 上数千个开放模型(含 OpenAI 的 gpt-oss)。

    推荐理由:官方发布的无代码数据处理工具,原文说明了用提示词建列、few-shot 反馈和 LLM 评审等玩法,读者可判断是否引入自己的数据流程。

8月7日周四
8月5日周二
  1. Hugging Face Blog92

    OpenAI 开源 GPT OSS 模型家族:gpt-oss-120b 与 gpt-oss-20b

    OpenAI 发布开源权重模型 GPT OSS,包含 117B 参数的 gpt-oss-120b 和 21B 参数的 gpt-oss-20b,均采用 MoE 架构和 MXFP4 4-bit 量化,分别可装入单张 H100 和 16GB 显存,采用 Apache 2.0 许可证。

    推荐理由:文章给出两个模型的参数量、量化方案和各硬件平台的具体推理优化建议,读者可按自己的 GPU 直接选择部署路径。

8月1日周五
7月31日周四
7月29日周二
7月25日周五
  1. Hugging Face Blog67

    Hugging Face 详解 Parquet 内容定义分块(CDC)如何配合 Xet 存储层降低数据传输量

    Hugging Face 宣布 Parquet 内容定义分块(CDC)已在 PyArrow 和 Pandas 中可用,通过 use_content_defined_chunking=True 参数启用,可与其 Xet 存储层配合仅传输变化的数据块。

    推荐理由:官方用七类数据变更场景实测 Parquet CDC 与 Xet 的去重效果,读者可据此评估迁移到 CDC 写入对上传下载的实际收益。

7月23日周三
  1. Hugging Face Blog53

    Hugging Face 发布 TimeScope 长视频理解基准

    Hugging Face 发布开源基准 TimeScope,将约 5-10 秒的短视频"针"插入 1 分钟到 8 小时的基础视频中,评测局部检索、信息综合和细粒度时序感知三类能力。测试发现多数先进模型在真实时序任务上仍吃力,Gemini 2.5-Pro 是唯一在超过一小时视频上保持高准确率的模型,而扩大参数量并不能延长模型的有效时序范围。数据集、排行榜和 lmms-eval 评测框架均已开源。

  2. Hugging Face Blog67

    Hugging Face 详解如何用 Diffusers 和 PEFT 加速 Flux LoRA 推理

    Hugging Face 发布教程,介绍结合 Flash Attention 3、torch.compile 和 FP8 量化的 Flux.1-Dev LoRA 推理优化配方,在 H100 上相对基线取得 2.23x 加速,并支持 LoRA 热切换而不触发重编译。

    推荐理由:原文给出可直接复用的 LoRA 推理优化配方和 H100、RTX 4090 两套实测延迟数据,并说明热切换避免重编译的限制。