作者:丹尼尔・豪利
周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。
该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。
此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网络。
本周早些时候,Anthropic 首席执行官达里奥・阿莫迪发布一篇长文,呼吁放缓前沿人工智能模型的研发节奏。在此之前,Anthropic 研究员雅各布・考克森在 X 平台发文宣布离职,他称,这家公司以及他曾经任职的 OpenAI,正 “一头冲向能够自我迭代的超级智能,拿全人类的生命做赌注”。
Anthropic 对齐科学负责人埃文・休宾格紧随考克森在 X 平台发声,他认为,人工智能技术 “致使全人类灭亡” 的概率超过 10%。
Anthropic 首席执行官达里奥・阿莫迪
评论交流
0