首页 > AI前沿 > Learning complex goals with iterated amplification

Learning complex goals with iterated amplification

OpenAI 2018-10-22 15:00 1 阅读 查看原文

提出“迭代放大”技术,应对AI安全挑战

我们提出了一种名为迭代放大(iterated amplification)的AI安全技术。该技术通过演示如何将任务分解为更简单的子任务,而非提供标注数据或奖励函数,使我们能够指定超出人类规模的复杂行为和目标。

尽管这一想法仍处于非常早期的阶段,我们仅在简单的玩具算法领域完成了实验,但我们决定以初步状态呈现它,因为我们相信它可能成为一种可扩展的AI安全方法