跳到正文

全部动态

今日 36 条
2月1日周六
1月31日周五
1月30日周四
  1. Mistral AI66

    Mistral 发布 Mistral Small 3:24B 参数开源模型,性能对标 Llama 3.3 70B

    Mistral 发布 Mistral Small 3,一个延迟优化的 24B 参数模型,以 Apache 2.0 许可开源预训练和指令微调权重。模型 MMLU 准确率超 81%,延迟 150 tokens/s,官方称性能与 Llama 3.3 70B instruct 相当且在相同硬件上快 3 倍以上。

    推荐理由:24B 参数、Apache 2.0 开源、可在单卡 RTX 4090 本地运行,读者可据此评估低延迟场景下的替代方案。

1月28日周二
  1. Hugging Face Blog67

    Hugging Face 在 Hub 推出 Inference Providers,集成 fal、Replicate、Sambanova、Together AI

    Hugging Face 在 Hub 模型页上线四家 serverless Inference Providers:fal、Replicate、Sambanova、Together AI,并集成 JS 和 Python SDK。调用分自定义 key 直连和由 HF 路由两种模式,路由请求按提供商标准费率计费、无额外加价,PRO 用户每月获 $2 推理额度。

    推荐理由:Hugging Face 官方宣布在 Hub 模型页集成四家 serverless 推理商,给出路由计费与 SDK 用法,读者可了解如何统一调用第三方推理。

  2. Hugging Face Blog57

    Hugging Face 启动 Open-R1 项目,系统复现 DeepSeek-R1 训练流程

    Hugging Face 发布博客宣布启动 Open-R1 项目,目标是在开放环境下重建 DeepSeek-R1 的数据与训练流程。博客解释了 DeepSeek-R1 基于DeepSeek-V3 的两阶段训练方法,包括 R1-Zero 用 GRPO 纯强化学习训练和 R1 的冷启动微调加多轮 RL 提炼,并指出 DeepSeek 未公开训练数据、训练代码和超参数细节。

1月27日周一
1月24日周五
  1. Hugging Face Blog61

    smolagents 新增视觉支持,可原生接入视觉语言模型构建浏览器智能体

    Hugging Face 为 smolagents 加入视觉支持,使视觉语言模型可原生用于智能体流程。图像可在 agent.run 启动时传入,也可通过 step_callbacks 在每步动态写入 ActionStep 的 observations_images。

    推荐理由:官方详解视觉语言模型如何接入 smolagents 智能体流程,并给出可复用的截图回调和浏览器智能体完整代码。

1月23日周四
1月22日周三
1月21日周二
1月16日周四
  1. Mistral AI35

    Mistral AI 与法新社(AFP)达成全球合作,为 Le Chat 接入 AFP 新闻内容

    Mistral AI 宣布与法新社(AFP)建立全球合作伙伴关系,其 AI 助手 Le Chat 将接入 AFP 的新闻电讯内容,使回复基于可靠、最新的信息。AFP 每天 6 种语言(法语、英语、西班牙语、葡萄牙语、德语、阿拉伯语)产出 2,300 条新闻稿,全球有 1,700 名记者。该集成将在未来几周内向所有 Le Chat 用户推出。

1月15日周三
  1. Hugging Face Blog67

    Hugging Face 用 Sentence Transformers 训练快 400 倍的静态嵌入模型并开源两个新模型

    Hugging Face 发布用 Sentence Transformers 训练静态嵌入模型的方法,新模型在 CPU 上比 all-mpnet-base-v2 等常见模型快 100 到 400 倍,同时保留至少 85% 的性能。

    推荐理由:原文完整公开了静态嵌入模型的训练配方、脚本和数据集清单,并给出与主流模型的性能对比,可复用于低成本嵌入场景。

1月14日周二
1月13日周一
  1. Hugging Face Blog46

    AI 智能体已经到来,下一步怎么办?

    Hugging Face 概述了 AI 智能体的定义,并分析了其伦理权衡。文章提出,智能体的风险随自主性水平上升:用户让渡的控制越多,安全、隐私等风险越大,并建议不要开发能编写和执行自身代码的完全自主智能体,而半自主智能体的收益可能大于风险。

1月10日周五
1月9日周四
12月31日周二
  1. Hugging Face Blog75

    Hugging Face 发布 smolagents:用代码写动作的轻量智能体库

    Hugging Face 发布 smolagents,一个约几千行代码的极简智能体库,支持以代码形式编写动作的 CodeAgent,可通过 E2B 沙箱安全执行,并保留传统 JSON 调用的 ToolCallingAgent。

    推荐理由:官方发布并给出代码示例与基准对比,读者可以了解用代码写动作的智能体库如何上手以及何时该用智能体。

12月27日周五
12月24日周二
  1. Hugging Face Blog69

    Hugging Face 教程:可视化并理解 PyTorch 训练中的 GPU 内存

    Hugging Face 发布教程,讲解如何用 torch.cuda.memory 快照工具可视化 PyTorch 训练各阶段的 GPU 内存占用。文章以 Qwen/Qwen2.5-1.5B 训练循环为例拆解参数、优化器状态、激活、梯度和优化器中间值的内存构成,并给出总内存估算公式与激活数量的线性启发式。

    推荐理由:原文用 PyTorch 内存快照工具拆解训练各阶段的显存构成,并给出可复用的总内存估算公式和启发式,便于读者定位显存瓶颈。

12月23日周一
  1. Hugging Face Blog63

    Hugging Face 博客详解如何用 NVIDIA LogitsProcessorZoo 控制大语言模型生成

    Hugging Face 博客介绍 NVIDIA 开源的 LogitsProcessorZoo,一组与 Transformers 的 generate 方法兼容的模块化 logits 处理器,通过直接修改输出概率分布来控制生成。

    推荐理由:原文给出四个 logits 处理器的参数、代码和实际输出对比,读者可以直接照着控制生成长度、引用、结尾短语和选择题格式。