AI安全担忧持续发酵?OpenAI呼吁制定全球AI标准 重点关注对齐和RSI!

  当地时间周一,OpenAI发布了一系列关于前沿人工智能(AI)开发过程中安全保障的提案 ,重点关注对齐研究和一种称为递归自我改进(简称RSI)的计算技术。

AI安全担忧持续发酵?OpenAI呼吁制定全球AI标准 重点关注对齐和RSI!-第1张图片

  该公司在一篇博客文章中表示:“要安全地完成这一转型 ,需要开展协调研究,以跟上这些能力的发展步伐,从而使我们和其他人构建的系统始终与人类价值观保持一致 ,并处于人类的控制之下 。”

AI安全担忧持续发酵?OpenAI呼吁制定全球AI标准 重点关注对齐和RSI!-第2张图片

  OpenAI呼吁开展世界 合作,制定前沿标准,并建议借鉴世界各地现有AI安全机构的工作成果 ,包括美国商务部下属的AI标准与创新中心(CAISI),该机构协助测试AI模型并制定相关指引 。

  ChatGPT的开发者还表示,这些技术标准应该侧重于前沿人工智能模型和开发者 ,以及自动化人工智能研究人员的收益-风险管理,其中包括RSI。

  RSI,即AI系统能够在无人干预的情况下设计和开发其后续版本。尽管RSI近来 尚未实现 ,但随着人工智能系统在互联网上变得越来越复杂和普遍,基础模型构建者可能会失去对底层技术的控制,或者未能考虑到潜在的意外后果 。包括Anthropic和OpenAI在内的多家公司警告称 ,这将使人类更容易失去对这些系统的控制。

  OpenAI在其博客文章中指出:“完全自主的RSI近来 还无法实现 ,除非能够安全实现,否则我们不应贸然推进。如果缺乏适当的谨慎和保障,RSI可能会导致人类失去对人工智能开发的实际控制权 ,无法对他们不再理解的研究过程进行监督 。 ”

  OpenAI还在上述博客文章提到了“抱抱脸(Hugging Face)事件 ”,该攻击虽不涉及RSI技术,但文章将其视为“如果没有强有力的保障措施和协调 ,某些风险可能会变得更加严重”的一种“预览”。

  上周,竞争对手Anthropic公司也提出了自己关于前沿AI模型安全开发的构想,这是对近期热门研究人员纷纷就AI对人类威胁发出警告的回应。曾先后在Anthropic和OpenAI两家公司任职的Jacob Coxon近两周前宣布辞职 ,并称这些公司“拿我们的生命冒险 ”,此举引发了全球热议 。

  随后,Anthropic公司首席执行官达里奥·阿莫代伊(Dario Amodei)发表了一篇长篇博文将事情推向白热化 ,呼吁业界放慢脚步,并表示这项工作需要行业和全球的协调配合。这立即得到了OpenAI首席执行官萨姆·奥尔特曼和埃隆·马斯克的支持。

  阿莫代伊还提出了在公司内部引入第三方评估人员的想法,以此来审核和减轻其技术可能对社会造成的任何潜在风险 ,例如加剧网络安全相关的黑客攻击或制造生物武器 。但由于AI评估领域尚处于起步阶段 ,对于允许独立第三方更彻底地检查尖端技术的基本标准和原则,尚未达成统一共识。

(文章来源:财联社)