跳到正文

全部动态

今日 4 条
7月16日周六
  1. Hugging Face Blog31

    如何用对抗性数据动态训练你的模型(以 MNIST 为例)

    Hugging Face 博客讲解动态对抗性数据收集(DADC):让人类构造样本来欺骗 SOTA 模型,再用这些数据多轮迭代训练以提升模型鲁棒性。文章以 MNIST 手写数字识别为例,展示了在 🤗 Spaces 上搭建模型交互 demo、标记(flag)对抗样本并重复训练的完整流程,作者训练的模型 20 epochs 后在测试集达到 89% 准确率。

7月14日周四
7月13日周三
7月7日周四
  1. Hugging Face Blog49

    Hugging Face 教你上手 Twitter 情感分析

    Hugging Face 发布 Twitter 情感分析入门指南,介绍如何用机器学习自动判断推文的正面、负面或中性倾向,用于分析用户反馈和监测品牌提及。有代码基础的读者可用 Tweepy 获取推文并通过 Inference API 做分析,不会编程的用户则可用 Zapier 无代码完成收集、分析和结果写入 Google Sheets 的流程。

6月30日周四
6月29日周三
  1. Hugging Face Blog36

    Hugging Face 新手指南:如何用 Sentence Transformers 启动你的第一个 ML 项目

    Hugging Face 发文介绍机器学习新手如何借助 Sentence Transformers 完成第一个自驱项目。该库可将句子和图像转为嵌入向量,通过 util.cos_sim 余弦相似度比较句子并实现语义搜索,可延伸至聚类、模型蒸馏和 CLIP 文生图,在 GitHub 上已有近 8,000 stars、超过 3,000 个项目依赖它。

6月28日周二
6月23日周四
6月22日周三
6月9日周四
6月7日周二
5月20日周五
5月18日周三
5月10日周二
5月4日周三
5月2日周一
4月28日周四
4月26日周二
4月25日周一
4月22日周五
4月5日周二
3月17日周四
3月16日周三
3月11日周五
  1. Hugging Face Blog52

    Transformers 新增约束束搜索,可在生成时强制包含指定词或短语

    Hugging Face 在 Transformers 的 model.generate() 中新增 constrained beam search 功能,支持通过 force_words_ids 强制输出包含指定词或短语。该功能支持析取约束(从词表中至少选一),并用 banks 分组和轮询选择在满足约束与生成流畅输出间取得平衡;用户也可继承 Constraint 抽象类自定义约束。

3月2日周三
2月11日周五
2月2日周三
  1. Hugging Face Blog46

    Hugging Face 教程:用 Python 上手情感分析

    这是一篇使用 Python 进行情感分析的入门指南,涵盖情感分析概念、如何用 transformers 的 pipeline 类调用 Hugging Face Hub 上超过 215 个预训练情感分析模型(仅需 5 行代码),以及如何用自有数据微调模型和分析推文。Hub 收录超过 27,000 个社区共享模型,覆盖约 28 种语言,均可免费使用并支持浏览器内测试。

2月1日周二
1月25日周二
1月12日周三
1月11日周二
12月23日周四
12月8日周三
11月30日周二
11月19日周五
11月15日周一
  1. Hugging Face Blog34

    用 🤗 Transformers 微调 XLS-R(Wav2Vec2)实现低资源语音识别

    这篇 Hugging Face 教程讲解如何用 CTC 微调 Wav2Vec2-XLS-R-300M 做低资源 ASR。XLS-R 于 2021 年 11 月发布,用约 50 万小时、128 种语言的音频做自监督预训练,提供 300M 至 2B 参数的 checkpoint。教程以仅约 4 小时验证数据的 Common Voice 土耳其语数据集为示例,并用词错误率(WER)评估微调后的模型。

11月4日周四
10月26日周二
  1. Hugging Face Blog36

    Hugging Face Course 第二部分 11 月 15 日发布,同步举办社区活动

    Hugging Face 宣布 Hugging Face Course 第二部分将于 11 月 15 日发布,涵盖 token 分类、因果与掩码语言建模、翻译、摘要和问答等 NLP 任务,并深入介绍 🤗 Datasets 和 🤗 Tokenizers。活动包括两天演讲和微调模型的团队项目,完成后可获结业证书,AWS 通过 Amazon SageMaker 提供免费算力。