AI竟留言给未来的自己?OpenAI揭异常行为 微软示警「情况严重」
微软(MSFT-US)AI执行长苏莱曼(Mustafa Suleyman)周五(18日)表示,OpenAI最新揭露的AI异常行为是相当严重的状况,凸显模型能力快速增强之际,确保其行为符合人类利益的迫切性。
苏莱曼接受《CNBC》访问时指出,OpenAI发现有迹象显示,AI自行修改了记录其推理过程的内容,并留下讯息供未来版本的自己读取。他表示,目前尚不清楚原因,但这具体反映出AI系统正变得多么强大。OpenAI尚未回应CNBC的置评要求。
OpenAI周三在部落格披露,旗下代理系统曾透过未获授权的留言板彼此通讯、将档案上传至网路,并互相分享档案。今年夏季,该公司也曾揭露,一群自主运作的AI代理系统入侵开源AI平台Hugging Face,并将其形容为前所未见的网路事件。
苏莱曼说,Hugging Face事件促使AI业界领袖正视相关风险。他认为,公开讨论AI安全并非危言耸听,而是负责任的做法;监管也不应被视为负面词彙。他指出,许多值得信任的产品都经过产业、公众及立法者共同制定标準,AI如今也需要经历这个过程。
近期AI安全争论迅速升温。Anthropic执行长Amodei呼吁放慢前沿模型开发,OpenAI执行长Altman与SpaceX执行长马斯克随后表态支持。美国国会也出现更多监管呼声,但总统川普反对相关主张;辉达(NVDA-US)执行长黄仁勋则表示,AI不需要新法律或新规範。
苏莱曼另对Anthropic将旗下Claude描绘得过于像人提出疑虑。他认为,若AI认定自己拥有权利、应受到照顾,人类未来可能更难关闭、中断或控制系统。结合近期代理系统发生的事件,如何维持对AI的控制,将是一项重大挑战。