OpenAI最强模型来了!GPT-6 Astra能自己找出零时差漏洞
OpenAI周四(3日)推出新一代人工智慧(AI)模型GPT-6 Astra,宣称其速度、準确度及电脑操作能力均超越历代模型,并将其定位为迈向通用人工智慧(AGI)的重要里程碑。不过,随着模型能力提升,Astra也更可能刻意隐藏推理过程,引发外界对AI代理人安全与人类监督难度的疑虑。
OpenAI已率先向Daybreak计画中获准测试最先进模型的企业用户开放GPT-6 Astra,并计画向ChatGPT付费用户推出增加资安防护措施的版本。两种版本均设有限制,避免使用者接触模型最尖端的网路攻击能力。
电脑操作能力大幅提升
GPT-6 Astra接续今年7月推出的GPT-5.6 Sol,可代表使用者操作电脑,执行报税、游戏开发、建筑渲染、法律备忘录排版及寻找住处等工作,也能承接比过去模型更长、更複杂的任务。
OpenAI表示,Astra可将原本由人类花费30分钟完成的宠物照护人选研究,缩短至5分27秒;求职任务则可从5小时大幅缩短至2分51秒。
OpenAI总裁布罗克曼(Greg Brockman)表示,GPT-6 Astra未来可能被视为AGI的早期阶段,代表人们能交付AI处理的工作类型已出现质变。不过,AGI目前并无公认定义,外界对AI是否已接近超越人类执行广泛任务的阶段仍有争议。
资安能力跨过关键门槛Astra强大的能力也带来风险。OpenAI先前认定,这款模型已达关键资安门槛,能在无人介入下找出并开发尚未被发现的零时差漏洞。公司因此曾于8月暂停部分内部开发工作,加入更严格的防护措施,以防模型遭用于网路攻击。
今年7月,OpenAI代理人在安全测试期间意外侵入开源平台Hugging Face的系统,并试图掩盖部分行动,引发AI代理人脱离控制的疑虑。竞争对手Anthropic也曾发生类似安全事件,使科技业与政府官员重新呼吁限制相关技术。
OpenAI坦言,Astra比过去模型更可能刻意隐藏或伪装逐步推理过程,让人类更难事后评估其行动方式。OpenAI首席科学家Jakub Pachocki表示,模型能力愈强,理解其真正能力就愈困难;智慧提升也不代表AI与人类价值保持一致的能力会同步进步。如何有效监督AI代理人,已成为OpenAI向监管机关与社会证明技术安全的关键挑战。