跳到正文

全部动态

今日 4 条
10月25日周一
10月13日周三
10月5日周二
  1. Hugging Face Blog62

    Hugging Face 教你用 Gradio 在 Spaces 上展示模型演示

    Hugging Face 发布教程,讲解如何用 Gradio 集成和 Spaces 托管 Hub 模型的演示应用。定义 Interface 并调用 .launch() 即可运行演示,底层通过 Inference API 支持 Transformers、spaCy、SpeechBrain 等框架以及 image-to-text、speech-to-text 等模型类型。

    推荐理由:官方教程给出几行代码即可在 Spaces 托管 Hub 模型演示的方法,含自定义模型部署和串联多模型的示例。

6月3日周四
5月25日周二
4月20日周二
4月8日周四
3月31日周三
  1. Hugging Face Blog45

    理解 BigBird 的块稀疏注意力

    BigBird 用块稀疏注意力替代 BERT 的全注意力,可处理最长 4096 的序列,计算成本远低于 BERT,其 RoBERTa 类模型已在 🤗Transformers 中可用。其注意力由三部分近似:捕获邻近依赖的滑动注意力、被所有 token 关注的全局 token,以及随机选择的随机 token,以此在长序列上高效逼近全注意力。该模型在长文档摘要、长上下文问答等任务上取得 SOTA。

3月18日周四
3月12日周五
2月25日周四
2月10日周三
2月9日周二
1月26日周二
1月25日周一
1月19日周二
1月18日周一
11月9日周一
11月3日周二
11月2日周一
10月10日周六
  1. Hugging Face Blog51

    Hugging Face 详解基于 Transformer 的编码器-解码器模型

    Hugging Face 发布长文教程,详解基于 Transformer 的编码器-解码器架构如何建模序列到序列任务。文章从 RNN 编码器-解码器模型的历史讲起,分解编码器的双向自注意力与解码器的单向自注意力和交叉注意力机制,并以 MarianMT 模型代码演示 .generate() 自回归推理,涵盖 T5、Bart、Pegasus 等模型背景,但不涉及训练方法。

7月3日周五
3月1日周日
2月14日周五
2月26日周二
12月19日周三
11月8日周四
12月21日周三
8月29日周一