跳到正文

全部动态

今日 7 条
9月1日周五
8月31日周四
8月30日周三
  1. Hugging Face Blog67

    如何用 Diffusers 优化 AudioLDM 2 推理速度至 10 倍以上

    Hugging Face 官方教程讲解如何在 🧨 Diffusers 中运行 AudioLDM 2 文生音频管线,并通过 Flash Attention、float16 半精度、torch.compile 编译 UNet、切换 DPMSolverMultistepScheduler 将 10 秒音频的生成时间从约 14 秒降到 1 秒以内,且音质几乎不降。

    推荐理由:官方教程给出四种可复用的推理优化方法,把 10 秒音频的生成时间从约 14 秒压到 1 秒以内,可直接迁移到自己的管线。

8月28日周一
  1. OpenAI News62

    OpenAI 发布 ChatGPT Enterprise

    OpenAI 发布 ChatGPT Enterprise,面向企业客户提供企业级安全与隐私保障,并称这是迄今为止最强大的 ChatGPT 版本。原文仅为摘要,未提供更多功能与定价细节。

    推荐理由:OpenAI 官方宣布推出 ChatGPT Enterprise,原文强调企业级安全与隐私以及迄今最强版本,可作为企业版本发布的信源记录。

8月25日周五
  1. Hugging Face Blog37

    Hugging Face Hub 将停止 Git 密码认证,改用访问令牌或 SSH 密钥

    Hugging Face 宣布自 2023 年 10 月 1 日起,通过 Git 操作 Hugging Face Hub 时不再支持密码认证,用户需改用个人访问令牌或 SSH 密钥。令牌具有唯一、可撤销、随机等安全优势。目前仍在使用密码的用户将收到邮件提醒,需在截止日期前完成切换,可通过 git remote set-url 命令更新仓库地址。

  2. Hugging Face Blog83

    Code Llama 发布:Llama 2 代码特化系列模型接入 Hugging Face 生态

    Hugging Face 发布 Code Llama 系列开源代码模型集成,含 7B、13B、34B 三种规格,基于 Llama 2 在 500B token 代码数据上训练,提供 Python 特化版和指令微调版。

    推荐理由:官方完整介绍了模型规格、上下文扩展原理和生态接入方式,读者可以直接据此选择规格并上手部署使用。

8月24日周四
8月23日周三
  1. Hugging Face Blog74

    Hugging Face 在 Transformers 中集成 AutoGPTQ,支持 GPTQ 量化大语言模型

    Hugging Face 宣布将 AutoGPTQ 库集成进 Transformers,用户可用 GPTQ 算法以 8、4、3 或 2-bit 精度量化和运行模型,4-bit 量化精度损失可忽略,小 batch 下推理速度接近 fp16 基线。

    推荐理由:官方宣布 AutoGPTQ 集成进 Transformers,读者可据此了解 4-bit 量化 LLM 的内存收益、用法与局限。

8月22日周二
  1. Hugging Face Blog71

    Hugging Face 发布开源视觉语言模型 IDEFICS,复现 Flamingo

    Hugging Face 发布开源视觉语言模型 IDEFICS,是 DeepMind 未公开的 Flamingo 的开放复现,接受任意图像和文本序列输入并生成文本,在多个图像文本理解基准上与原闭源模型表现相当。

    推荐理由:原文说明了 IDEFICS 基于 Flamingo 的复现路线、参数规模与完全公开数据的训练方式,适合关注开源多模态模型生态的读者。

8月16日周三
8月15日周二
  1. OpenAI News65

    OpenAI 介绍如何用 GPT-4 辅助内容审核

    OpenAI 发布文章说明其使用 GPT-4 进行内容政策制定和内容审核决策。文章指出这一做法带来更一致的标注、更快的政策修订反馈循环,并减少人工审核员的参与。

    推荐理由:OpenAI 官方说明用 GPT-4 做内容审核的具体做法,展示了加快政策迭代与降低人工审核量的可借鉴路径。

8月10日周四
8月9日周三
8月8日周二
8月4日周五
8月2日周三
  1. Hugging Face Blog35

    基于 FHE 走向加密大语言模型:在 Hugging Face transformers 上加密运行 GPT2

    Zama 提出用全同态加密(FHE)解决 LLM 隐私问题,让用户数据和模型 IP 同时得到保护。团队基于 Hugging Face transformers 库改写 GPT2 的多头注意力层,用 Concrete-Python 将推理部分转换为 FHE 等价实现,非线性函数通过 PBS(可编程自举)完成。实验表明 4-bit 量化下模型在约 80 句的数据集上保持 96% 的原始预测精度。

8月1日周二
  1. Hugging Face Blog59

    Hugging Face 实战教程:用 Shap-E 与 Dream Textures 一步步生成 PS1 风格 3D 资产

    Hugging Face 博客发布教程,演示用 Shap-E 从文本生成 3D 模型,再经 Blender 减面、Dream Textures 生成无缝贴图和 UV 展开,导出 FBX 并导入 Unity。作者选择 PS1 低多边形风格以规避当前 text-to-3D 保真度不足的问题,并配以顶点光照、浓雾和故障风后期处理还原复古观感。

7月27日周四
  1. Hugging Face Blog74

    Apple 与 Hugging Face 发布 Stable Diffusion XL 的 Core ML 版本及混合位宽量化方案

    Apple 与 Hugging Face 将 Stable Diffusion XL 移植到 Core ML,发布完整 pipeline 和 mixed-bit palettization 量化版本,UNet 以平均 4.5 位压缩后体积从 4.8GB 降至 1.4GB(减少 71%)。

    推荐理由:原文给出 Stable Diffusion XL 在 Mac 上的 Core ML 移植细节、压缩到 4.5 位后体积从 4.8GB 降到 1.4GB 的数据,以及可复用的混合位宽量化方法。

7月26日周三
7月24日周一
7月21日周五
7月20日周四
  1. OpenAI News63

    ChatGPT 推出自定义指令功能

    OpenAI 为 ChatGPT 推出自定义指令功能,用户可设置偏好,ChatGPT 会在之后的所有对话中记住并遵循这些设置,让用户对回复方式有更多控制。

    推荐理由:原文说明了自定义指令的作用范围,读者可以据此了解如何让 ChatGPT 在对话中保持个人偏好。

7月18日周二
7月17日周一
  1. Hugging Face Blog56

    Hugging Face 开源文本生成与 LLM 生态综述

    Hugging Face 发布博客,介绍其开源文本生成与大语言模型生态,覆盖 Llama 2 等开源模型、许可证对比、text-generation-inference 服务方案及 PEFT 微调工具。文中列出 Falcon 40B、MPT-30B、XGen、StarCoder 等模型的许可与用途,说明 TGI 已支撑 HuggingChat,并介绍 LoRA 等参数高效微调方法。

7月14日周五
7月7日周五
7月5日周三
7月4日周二
7月3日周一
  1. Hugging Face Blog63

    Hugging Face 教程:用 WizardCoder-15B 在 Node.js 中搭建文本生成网页应用

    Hugging Face 发布教程,展示用 Node.js 搭建文本到网页应用的生成器,模型采用部署在 Inference Endpoints 上的 WizardCoder-15B,通过 Express.js 流式渲染生成 HTML。

    推荐理由:Hugging Face 官方教程给出从 Endpoint 部署到流式渲染的完整代码,读者可以照着复现一个文本生成网页应用的服务。