跳到正文

#开源生态

今日 2 条
10月1日周三
  1. Hugging Face Blog51

    Hugging Face 发布 RTEB 基准,用开放与私有数据集评估嵌入模型真实检索泛化能力

    Hugging Face 发布 Retrieval Embedding Benchmark(RTEB)测试版,旨在可靠评估嵌入模型在真实应用中的检索准确性。它采用开放与私有数据集结合的混合策略来检测基准过拟合,覆盖 20 种语言和法律、医疗、代码、金融等企业领域,默认榜单指标为 NDCG@10,榜单已上线于 MTEB 排行榜的检索板块。

9月29日周一
9月26日周五
9月23日周二
9月22日周一
  1. Hugging Face Blog45

    SyGra:面向 LLM 和 SLM 数据构建的一站式框架

    Hugging Face 介绍了 SyGra,一个用于 LLM 与 SLM 数据集创建、转换与对齐的低代码/无代码框架。它以 Python 库形式提供,支持 vLLM、Hugging Face TGI、Triton、Ollama 等多种推理后端,用户只需专注于提示词工程。该框架可覆盖 Q&A 生成、DPO 偏好对、推理增强、多语言转换、质量过滤及 RAG 场景等多种数据构建需求。

  2. Hugging Face Blog61

    Meta 发布 Gaia2 智能体基准及开源评估框架 ARE

    Meta 的 Hugging Face 团队发布 GAIA 后续基准 Gaia2 和配套开源框架 Meta Agents Research Environments(ARE),Gaia2 数据集采用 CC BY 4.0 许可,ARE 采用 MIT 许可。

    推荐理由:官方发布新基准 Gaia2 和开源评估框架 ARE,含七类任务和主流模型结果,便于开发者调试和评估自己的 Agent。

9月19日周五
9月18日周四
9月17日周三
9月16日周二
9月12日周五
9月11日周四
  1. Hugging Face Blog73

    Hugging Face 详解 transformers 为支持 OpenAI GPT-OSS 所做的效率升级

    Hugging Face 发文介绍为支持 OpenAI GPT-OSS 对 transformers 库的多项升级,包括从 Hub 下载预编译内核、原生 MXFP4 量化、张量并行与专家并行、动态滑动窗口 KV 缓存、Continuous Batching 和更快的模型加载。

    推荐理由:Hugging Face 官方详解为支持 gpt-oss 对 transformers 做的各项升级,多数特性可复用到其他模型。

9月10日周三
  1. Hugging Face Blog64

    Hugging Face 发布 Jupyter Agent:微调 Qwen3-4B 提升 DABStep 数据科学任务表现

    Hugging Face 发布 Jupyter Agent 项目,用约 2TB Kaggle 笔记本构建 51k 条合成轨迹、近 0.2B tokens 的数据集,微调 Qwen3-4B-Instruct-2507 与 Qwen3-4B-Thinking-2507。

    推荐理由:原文完整给出从数据清洗到微调的管线与消融数字,读者可复用其中提升小模型数据科学能力的做法。

9月9日周二
  1. Mistral AI75

    Mistral AI 完成 17 亿欧元 C 轮融资,ASML 领投

    Mistral AI 宣布完成 17 亿欧元 C 轮融资,投后估值 117 亿欧元,由 ASML 领投,DST Global、Andreessen Horowitz、Bpifrance、General Catalyst、Index Ventures、Lightspeed 和 NVIDIA 参投。

    推荐理由:官方公告给出融资额、估值和 ASML 领投的战略合作细节,读者可以据此了解 Mistral AI 后续的工业方向布局。

9月4日周四
  1. Hugging Face Blog67

    Google 发布 EmbeddingGemma 高效多语言嵌入模型

    Google 发布开源嵌入模型 EmbeddingGemma,308M 参数、2K 上下文窗口,支持超过 100 种语言,量化后内存占用低于 200 MB,适合端侧 RAG 和 Agent 场景。

    推荐理由:官方博客给出架构、基准和各框架用法,还附完整微调示例,读者可以据此判断如何把它接入现有检索流程。

9月3日周三
9月2日周二
  1. Hugging Face Blog64

    Hugging Face ZeroGPU Spaces 如何用 PyTorch 预编译提速图像视频生成

    Hugging Face 发文介绍如何在 ZeroGPU Spaces 中用 PyTorch ahead-of-time 编译优化生成式 demo,指出 torch.compile 与 ZeroGPU 短生命周期进程不兼容,需先导出再用 spaces.aoti_* API 编译加载。

    推荐理由:原文给出 ZeroGPU 上 AoT 编译的完整步骤和 FP8、动态形状等进阶技巧,读者可以直接迁移到自己的 Spaces demo。

8月21日周四
8月18日周一
8月14日周四
8月12日周二
8月8日周五
  1. Hugging Face Blog71

    Hugging Face 开源 AI Sheets:用开放模型无代码构建和增强数据集

    Hugging Face 发布开源无代码工具 AI Sheets,用于以电子表格方式构建、转换和增强数据集,可本地部署或在 Hub 上免费试用,支持通过 Inference Providers 调用 Hub 上数千个开放模型(含 OpenAI 的 gpt-oss)。

    推荐理由:官方发布的无代码数据处理工具,原文说明了用提示词建列、few-shot 反馈和 LLM 评审等玩法,读者可判断是否引入自己的数据流程。

8月5日周二
  1. Hugging Face Blog92

    OpenAI 开源 GPT OSS 模型家族:gpt-oss-120b 与 gpt-oss-20b

    OpenAI 发布开源权重模型 GPT OSS,包含 117B 参数的 gpt-oss-120b 和 21B 参数的 gpt-oss-20b,均采用 MoE 架构和 MXFP4 4-bit 量化,分别可装入单张 H100 和 16GB 显存,采用 Apache 2.0 许可证。

    推荐理由:文章给出两个模型的参数量、量化方案和各硬件平台的具体推理优化建议,读者可按自己的 GPU 直接选择部署路径。

  2. OpenAI News85

    OpenAI 发布开放权重模型 gpt-oss-120b 和 gpt-oss-20b

    OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 两款开放权重语言模型,采用 Apache 2.0 许可证。官方称二者在推理任务上优于同等规模的开源模型,具备较强的工具调用能力,并针对消费级硬件上的高效部署做了优化。

    推荐理由:OpenAI 官方发布两款开放权重模型,读者可以据此了解其推理表现、工具调用能力和在消费级硬件上的部署定位。

8月1日周五
7月29日周二
7月25日周五
  1. Hugging Face Blog67

    Hugging Face 详解 Parquet 内容定义分块(CDC)如何配合 Xet 存储层降低数据传输量

    Hugging Face 宣布 Parquet 内容定义分块(CDC)已在 PyArrow 和 Pandas 中可用,通过 use_content_defined_chunking=True 参数启用,可与其 Xet 存储层配合仅传输变化的数据块。

    推荐理由:官方用七类数据变更场景实测 Parquet CDC 与 Xet 的去重效果,读者可据此评估迁移到 CDC 写入对上传下载的实际收益。

7月17日周四
7月16日周三
7月15日周二