跳到正文

#OpenAI

今日 9 条
4月16日周四
  1. OpenAI News41

    OpenAI 参与多方报告:提出 10 项机制提升 AI 开发可验证性

    OpenAI 参与了一份由 30 家机构、58 位作者共同撰写的多方报告,提出 10 项机制用于提升 AI 系统相关声明的可验证性。报告由未来智能研究中心、Mila 等机构参与完成。开发者可借助这些机制提供 AI 系统安全、公平或隐私保护的证据,用户、政策制定者和公民社会也可用来评估 AI 开发流程。

4月14日周二
1月30日周四
1月23日周四
12月5日周四
12月3日周二
11月21日周四
11月5日周二
  1. OpenAI News78

    OpenAI 发布 GPT-2 最大版本 1.5B 参数模型

    OpenAI 发布 GPT-2 分阶段计划的最终模型,即最大版本 1.5B 参数,同时放出代码和模型权重以帮助检测 GPT-2 的输出。OpenAI 表示虽自 8 月以来已有更大模型出现,仍按原计划完成完整的分阶段发布流程,为社区提供负责任发布的测试案例。

    推荐理由:原文交代了 GPT-2 1.5B 作为分阶段发布最终版的开放决策与考量,读者可以了解负责任发布实践的完整案例。

10月15日周二
  1. OpenAI News64

    OpenAI 用机器手求解魔方,训练完全在仿真中完成

    OpenAI 训练了一对神经网络,用仿人机器手还原魔方,训练完全在仿真中进行,采用与 OpenAI Five 相同的强化学习代码和新技术 Automatic Domain Randomization(ADR)。系统能应对训练中未见过的情况,例如被长颈鹿玩偶戳动,表明强化学习可解决需要极高灵巧度的现实物理问题。

    推荐理由:原文说明神经网络完全在仿真中训练即可操控机械手还原魔方,并给出 ADR 这一可迁移到其他物理任务的方法。

10月11日周五
9月19日周四
  1. OpenAI News74

    OpenAI 用人类偏好微调 774M 参数 GPT-2

    OpenAI 用人类反馈微调了 774M 参数的 GPT-2 语言模型,在多种任务上成功匹配外部人工标注者的偏好。摘要任务用了 6 万条人工标注,简单的续写风格任务只需 5 千条;标注者的偏好并非总与团队一致,例如摘要标注者偏好整句照抄原文,模型随之学会了照抄。OpenAI 表示此举旨在让安全技术更接近“机器与人对话”这一通用任务。

    推荐理由:原文给出了用人类偏好微调 GPT-2 的任务效果、标注成本与偏好偏差实例,可了解早期 RLHF 实践细节。

9月17日周二
  1. OpenAI News73

    OpenAI 观察到多智能体捉迷藏中自发涌现工具使用

    OpenAI 报告,智能体在其新构建的模拟捉迷藏环境中训练时逐步发现了更复杂的工具使用。智能体建立了六种不同的策略与反制策略,其中一些是团队此前不知道环境所支持的;这种自监督的涌现复杂性表明多智能体协同适应或能产生极为复杂和智能的行为。

    推荐理由:原文报告了多智能体博弈中自发涌现工具使用的观察,对理解智能体协同演化行为的读者有背景价值。

8月22日周四
8月20日周二
  1. OpenAI News63

    OpenAI 发布 774M 参数 GPT-2 模型并公开发布规范经验

    OpenAI 在 2 月发布 124M、5 月分阶段发布 355M 之后,发布 774M 参数的 GPT-2 语言模型。同时发布一份开源法律协议,便于机构间建立模型共享合作,并发布技术报告,总结与 AI 研究社区协调发布规范的经验。

    推荐理由:OpenAI 官方复盘分阶段释放 774M GPT-2 的决策过程,可了解滥用风险评估如何影响模型发布策略。

8月1日周四
7月22日周一
  1. OpenAI News77

    Microsoft 向 OpenAI 投资 10 亿美元并达成 AGI 合作

    Microsoft 向 OpenAI 投资 10 亿美元,支持其构建惠益广泛分布的 AGI。双方将在 Microsoft Azure 内共同开发可扩展至 AGI 的软硬件平台和新的 Azure AI 超算技术,Microsoft 将成为 OpenAI 的独家云提供商。

    推荐理由:OpenAI 官方宣布与 Microsoft 的投资与合作细节,涵盖资金规模和 Azure 独家云协议,可用于理解双方后续算力布局的起点。

7月10日周三
6月5日周三
5月23日周四
5月17日周五
4月25日周四
  1. OpenAI News38

    OpenAI 发布 MuseNet:可生成 10 种乐器演奏、融合多种风格的 4 分钟乐曲

    OpenAI 推出深度神经网络 MuseNet,能生成 10 种不同乐器演奏的 4 分钟乐曲,风格可从乡村音乐跨越到 Mozart 和 Beatles。MuseNet 并未显式编写音乐知识,而是通过在数十万 MIDI 文件上预测下一个 token,自行学会和声、节奏与风格规律。它与 GPT-2 采用相同的大规模 Transformer 无监督通用技术。

4月23日周二
4月15日周一
  1. OpenAI News78

    OpenAI Five 在直播中连胜两局击败 Dota 2 世界冠军 OG

    OpenAI Five 在周末决赛中连胜两局击败 Dota 2 世界冠军战队 OG,成为首个战胜电竞世界冠军的 AI。OpenAI Five 和 DeepMind 的 AlphaStar 此前都曾私下战胜过职业选手但输掉过公开职业比赛,这也是 AI 首次在直播中战胜电竞职业选手。

    推荐理由:作者本人披露了此前直播对局的失利背景,可帮读者理解这次公开战胜世界冠军与以往私下对局的差别。

3月26日周二
3月21日周四
3月13日周三
3月11日周一
  1. OpenAI News82

    OpenAI 成立 capped-profit 公司 OpenAI LP

    OpenAI 宣布成立新的 capped-profit 公司 OpenAI LP,用于快速增加在算力和人才方面的投入,同时保留制衡机制以实现其使命。

    推荐理由:官方宣布成立 capped-profit 公司,读者可以借此理解 OpenAI 后续加大算力和人才投入的商业结构基础。

3月6日周三
3月4日周一
2月26日周二
2月19日周二
  1. OpenAI News43

    OpenAI:AI 安全研究需要社会科学家参与

    OpenAI 发表论文指出,长期 AI 安全研究需要社会科学家参与,才能确保对齐算法在真实人类参与时发挥作用。让先进 AI 系统与人类价值观对齐,需解决人类理性、情感与偏见心理学中的诸多不确定性。OpenAI 希望推动机器学习与社会科学研究者合作,并计划全职招聘社会科学家。

2月14日周四
  1. OpenAI News81

    OpenAI 训练大规模无监督语言模型,无需任务特定训练即可完成多任务

    OpenAI 训练了一个大规模无监督语言模型,能生成连贯段落文本,在多项语言建模基准上达到当时最优表现。该模型无需任务特定训练即可完成基础阅读理解、机器翻译、问答和摘要任务。

    推荐理由:OpenAI 自述该无监督语言模型在多项基准上达到 SOTA 并零样本完成多任务,可作为了解无任务特定训练能力的背景材料。

12月19日周三
12月14日周五
12月6日周四
11月8日周四
11月7日周三
10月31日周三
10月22日周一
  1. OpenAI News36

    OpenAI 提出 AI 安全新技术 iterated amplification

    OpenAI 提出一项名为 iterated amplification 的 AI 安全技术,通过演示如何把任务分解为更简单的子任务,来指定超越人类规模的复杂行为和目标,而无需提供标注数据或奖励函数。目前该想法仍处早期阶段,实验仅在简单的玩具算法领域完成,但 OpenAI 认为其可能成为可扩展的 AI 安全方法。

10月11日周四