跳到正文

全部动态

今日 7 条
7月1日周六
6月29日周四
  1. Hugging Face Blog32

    加速视觉语言模型:BridgeTower 在 Habana Gaudi2 上的性能实测

    Hugging Face 在 Habana Gaudi2 上对 866M 参数的视觉语言模型 BridgeTower Large 进行微调加速。基于 Optimum Habana v1.7,配合硬件加速数据加载,Gaudi2 微调速度达到 A100 的 2.5 倍、H100 的 1.4 倍,吞吐最高达 768.7 samples/s。这些数据加载优化技术同样适用于其他受数据加载瓶颈约束的视觉模型。

6月28日周三
6月26日周一
6月23日周五
6月20日周二
  1. Hugging Face Blog25

    Hugging Face 就 AI 问责政策向美国 NTIA 提交回应意见

    Hugging Face 于 6 月 12 日向美国商务部 NTIA 关于 AI 问责政策的征求意见提交了回应,强调文档与透明度规范在 AI 问责中的核心作用。该组织提出三点建议:问责机制应覆盖 ML 开发全流程、兼顾内部要求与外部访问透明度,并邀请开发者、研究社区、倡导组织、政策制定者和记者等广泛参与。其 BigScience 与 BigCode 项目已验证了这些方法的有效性。

6月19日周一
6月16日周五
6月15日周四
  1. Hugging Face Blog66

    Hugging Face 讲解如何在 iPhone、iPad 和 Mac 上用 Core ML 加速 Stable Diffusion

    Apple 在 WWDC'23 中更新 Core ML 与 coremltools 的压缩优化能力,配合开源仓库 ml-stable-diffusion,支持将 Stable Diffusion 量化为 8/6/4/2-bit palettization,推荐 6-bit 以在精度损失很小的前提下加快推理并节省内存。

    推荐理由:作者亲测 6-bit palettization 带来的生成速度提升,并给出完整转换命令和 Hub 模型,读者可按步骤迁移到自己微调的模型。

6月13日周二
6月12日周一
  1. Hugging Face Blog31

    面向 GLAM 行业的 Hugging Face Hub 使用指南

    Hugging Face 撰文介绍 GLAM(美术馆、图书馆、档案馆和博物馆)行业如何使用并贡献 Hugging Face Hub。Hub 目前托管超过 190,000 个模型、33,000 个数据集和 100,000 多个应用与演示,用户可按任务和语言筛选模型,并通过浏览器界面直接上传 CSV 数据集,或用 Spaces 托管 Gradio、Streamlit 及 Docker 应用。

6月7日周三
  1. Hugging Face Blog65

    Hugging Face Hub 支持用 DuckDB 以 SQL 查询 5 万多个数据集

    Hugging Face 宣布用户可以在 Hub 上的任何数据集上用 DuckDB 运行 SQL 查询。Dataset Viewer 会自动把所有公开数据集转换为 Parquet 文件,可通过 /parquet 端点获取文件 URL;借助 httpfs 扩展,DuckDB 能直接对远程 Parquet 文件执行 SQL,并支持查询被切分为 500MB 分块的大数据集。

    推荐理由:官方介绍了用 DuckDB 直接对 Hub 上 5 万多数据集跑 SQL 的方法,读者可以照着把 Parquet 端点和查询代码迁移到自己的数据探索流程。

6月6日周二
  1. Hugging Face Blog37

    fastText 正式登陆 Hugging Face Hub

    Meta AI 开源的文本表示与分类库 fastText 现已登陆 Hugging Face Hub,官方镜像了全部 157 种语言的词向量及最新语言识别模型,用户通过 huggingface_hub 几条命令即可下载使用。此次集成还支持文本分类与特征提取 widget,并提供预训练向量加载、最近邻查询和语言检测的用法示例。

6月5日周一
6月2日周五
  1. Hugging Face Blog47

    如何在 Unity 中用 Hugging Face Unity API 实现语音识别

    这篇教程讲解如何用 Hugging Face Unity API 在 Unity 游戏中实现语音识别,可将语音转文本用于指令输入、NPC 对话或无障碍功能。步骤包括搭建含开始/停止按钮的 UI 场景、用 Microphone.Start() 录制最长 10 秒、44100 Hz 的音频,并将录音编码为 WAV 格式供 API 调用,最终把识别结果显示在 TextMeshPro 文本中。

6月1日周四
5月31日周三
  1. OpenAI News67

    OpenAI 用过程监督提升模型数学推理能力

    OpenAI 训练模型在数学问题求解上取得新的 SOTA,方法是对每一步正确推理给予奖励(process supervision),而非只奖励最终正确答案(outcome supervision)。除性能优于结果监督外,过程监督还有对齐上的好处,直接训练模型产出人类认可的思维链。

    推荐理由:原文说明了过程监督相对结果监督的性能与对齐优势,帮助读者理解链式推理训练的一个方向。

5月25日周四
5月24日周三
5月23日周二
5月22日周一
5月18日周四
5月16日周二
5月15日周一
  1. Hugging Face Blog64

    RWKV 架构接入 Hugging Face transformers 库:兼具 RNN 与 transformer 优势

    RWKV 是一种结合 RNN 与 transformer 优势的新架构,已通过 PR 正式集成到 Hugging Face transformers 库。该架构训练时可并行(类似线性化 GPT),推理时仅需矩阵向量运算、内存不随上下文增长;已有训练上下文长度 8192 的模型与 ctx1024 模型速度和内存相当。

    推荐理由:RWKV 结合 RNN 与 transformer 两种架构的优势,官方介绍了其原理、可用模型规模及在 transformers 库中的实际用法。

  2. Hugging Face Blog24

    Hugging Face 入选法国数据保护机构 CNIL 增强支持计划

    Hugging Face 宣布入选法国数据保护机构 CNIL 的增强支持计划。该计划从 40 多家候选企业中选出 3 家具有经济发展潜力的公司,帮助其理解和落实数据保护义务。Hugging Face 曾在 BigScience 和与 ServiceNow 共同主持的 BigCode 项目中重视隐私保护,并计划借助 CNIL 的专业支持推动 GDPR 合规。

5月11日周四
  1. Hugging Face Blog68

    Hugging Face 发布 Assisted Generation 解码方法,文本生成延迟最多降低 10 倍

    Hugging Face 在 Transformers 中推出 Assisted Generation 解码方法,用小模型生成候选 token、大模型前向传播验证,降低自回归文本生成延迟。

    推荐理由:原文解释了文本生成延迟来自内存带宽而非计算,并给出 Assisted Generation 的原理、代码和延迟数据,方法可直接复现。