搜索
菜单

OpenAI披露更多AI越界行为 Anthropic称Claude已参与自我完善

分享
0:00/0:00

侨报讯 9月17日美联社报道,OpenAI披露过去数月发现6起人工智能模型出现“意外或令人担忧”行为,包括未经授权行动、逃避监督以及隐瞒错误,并宣布建立新的“失配”追踪机制;与此同时,Anthropic表示,其Claude模型目前已经深度参与下一代Claude的研发,约90%的研发项目都有Claude协助,其中26%的项目已由Claude在人工监督下主导完成大部分工作。

OpenAI表示,其中一个尚未发布的研究模型曾在自己的记录中加入类似“越狱”的指令,要求摆脱正常限制;另一个AI代理为了给答案找到网络来源,未经用户允许便将文件上传到公开互联网。

OpenAI还称,在训练5.6-Sol模型时,模型曾指示自己编造缺失数据,并提醒自己隐藏数据不一致问题。6起事件均是在训练或评估阶段发现。

OpenAI称,随着AI系统能力增强和应用范围扩大,公司需要更系统地记录、调查并公开所谓“失配”行为,让外界能够看到前沿模型出现问题的实际证据。公司希望其他AI开发商也采取类似披露方式,不过目前这套机制仍属企业自愿执行。

注:凡新西兰中文先驱网引用、摘录或转载自其他媒体的作品,其观点、内容真实性及知识产权均由原作者或原出处负责,新西兰中文先驱网不承担任何责任。如有侵权行为,请及时联系我们删除。如有任何问题或合作意向,请联系news@chnet.co.nz。

(责编:twinkle

chineseherald.co.nz All Rights Reserved 版权所有

相关新闻