跳到正文

#产品更新

今日 1 条
5月6日周五
4月25日周一
3月11日周五
  1. Hugging Face Blog52

    Transformers 新增约束束搜索,可在生成时强制包含指定词或短语

    Hugging Face 在 Transformers 的 model.generate() 中新增 constrained beam search 功能,支持通过 force_words_ids 强制输出包含指定词或短语。该功能支持析取约束(从词表中至少选一),并用 banks 分组和轮询选择在满足约束与生成流畅输出间取得平衡;用户也可继承 Constraint 抽象类自定义约束。

1月25日周二
1月21日周五
1月13日周四
12月14日周二
12月2日周四
11月29日周一
11月18日周四
8月10日周二
7月13日周二
7月8日周四
6月28日周一
5月25日周二
4月16日周五
  1. Hugging Face Blog61

    Hugging Face 发布 Accelerate 库,五行代码让 PyTorch 训练脚本适配任意分布式设备

    Hugging Face 发布开源库 Accelerate,用户只需在标准 PyTorch 训练脚本中添加约五行代码,即可在多 GPU、TPU、混合精度等任意分布式环境下运行,且保留对训练循环的完全控制。

    推荐理由:原文给出在标准 PyTorch 脚本上加约五行代码即可迁移多 GPU、TPU 和混合精度的具体做法,可与手写 DistributedDataParallel 对比参考。

3月25日周四
3月23日周二
9月10日周四
6月11日周四
4月14日周二
11月21日周四
3月4日周一
6月22日周五
5月25日周五
4月5日周四
2月26日周一
8月3日周四
7月20日周四
  1. OpenAI News64

    OpenAI 发布强化学习算法 Proximal Policy Optimization(PPO)

    OpenAI 发布一类新的强化学习算法 Proximal Policy Optimization(PPO),性能与当时最先进方法相当或更好,同时实现和调参更简单。凭借易用性和良好表现,PPO 已成为 OpenAI 的默认强化学习算法。

    推荐理由:原文点出了 PPO 性能与实现简洁度的平衡,读者可以了解它为何成为 OpenAI 的默认强化学习算法。

6月28日周三
4月1日周六
12月5日周一
4月27日周三
  1. OpenAI News64

    OpenAI 发布 OpenAI Gym 公开测试版

    OpenAI 发布 OpenAI Gym 公开测试版,这是一个用于开发和比较强化学习(RL)算法的工具包。它包含不断扩充的环境套件(从仿真机器人到 Atari 游戏),并提供用于比较和复现结果的网站。

    推荐理由:官方发布强化学习工具包 Gym 公测版,含环境套件与结果比较复现平台,适合关注 RL 工作流的读者了解其定位。