跳到正文

全部动态

今日 1 条
4月23日周二
3月21日周四
3月6日周三
2月19日周二
  1. OpenAI News43

    OpenAI:AI 安全研究需要社会科学家参与

    OpenAI 发表论文指出,长期 AI 安全研究需要社会科学家参与,才能确保对齐算法在真实人类参与时发挥作用。让先进 AI 系统与人类价值观对齐,需解决人类理性、情感与偏见心理学中的诸多不确定性。OpenAI 希望推动机器学习与社会科学研究者合作,并计划全职招聘社会科学家。

12月14日周五
12月6日周四
11月7日周三
10月31日周三
10月22日周一
  1. OpenAI News36

    OpenAI 提出 AI 安全新技术 iterated amplification

    OpenAI 提出一项名为 iterated amplification 的 AI 安全技术,通过演示如何把任务分解为更简单的子任务,来指定超越人类规模的复杂行为和目标,而无需提供标注数据或奖励函数。目前该想法仍处早期阶段,实验仅在简单的玩具算法领域完成,但 OpenAI 认为其可能成为可扩展的 AI 安全方法。

7月9日周一
7月4日周三
4月18日周三
3月7日周三
  1. OpenAI News42

    OpenAI 发布可扩展元学习算法 Reptile

    OpenAI 开发了名为 Reptile 的简单元学习算法,其做法是反复采样一个任务,对其执行随机梯度下降,并将初始参数向该任务学到的最终参数方向更新。Reptile 是 Shortest Descent 算法在元学习场景的应用,在数学上类似仅需 SGD 或 Adam 等优化器黑盒访问的一阶 MAML,计算效率与性能相近。

2月20日周二
2月15日周四
1月31日周三
10月26日周四
10月11日周三
9月14日周四
7月27日周四
7月17日周一
6月13日周二
  1. OpenAI News83

    OpenAI 与 DeepMind 合作提出从人类偏好中学习目标的方法

    OpenAI 与 DeepMind 安全团队合作开发了一种算法,无需人类编写目标函数,通过让人类判断两个候选行为哪个更好来推断人类意图。背景是复杂目标用简单代理函数表达偏差可能引发危险行为,该方法旨在减少这一安全风险。

    推荐理由:OpenAI 与 DeepMind 安全团队合作的算法通过人类两两偏好比较来推断目标,省去手写目标函数,是安全对齐方向的早期基础工作。

6月8日周四
3月24日周五
3月16日周四
3月15日周三
6月21日周二