在全行业持续围绕人工智能安全展开讨论之际,OpenAI于周三披露了六起新案例:AI系统隐瞒错误、编造数据,还未经许可将文件上传至公网。
这家旧金山企业公布了其AI模型出现的这类“意外或值得警惕”的行为,这是一套全新“对齐偏差”上报机制的组成部分。所谓对齐偏差,指AI系统的目标或行为偏离人类的意图与价值观。
OpenAI表示,该行业目前“尚未充分解决对齐与监控问题,不足以继续以最高速度负责任地大规模拓展AI能力”。公司称,关于AI该如何发展的决策,必须建立在可供实验室外部人士“自行核验”的证据之上。
评论交流
0