Anthropic推Claude Fable 5.1!AI不只会回答问题、蛋白质设计成功率近50%

人工智慧(AI)模型竞争正从单纯比拚基準测试成绩,逐步转向实际解决複杂问题的能力。Anthropic于1日推出Claude Fable 5.1与Claude Mythos 5.1,强调新一代模型不只提供答案,也能进一步执行程式除错、蛋白质设计、GPU效能最佳化及行星地图绘製等工作。

Anthropic在官方部落格指出,一家投资机构长期受到软体崩溃问题困扰,工程师始终无法找出原因,甚至曾使用其他AI模型协助分析仍没有结果。直到交由Fable 5.1处理后,才成功找出问题根源。


这也凸显AI模型能力发展的方向正在改变:从过去以回答问题为主,进一步朝能够自主处理複杂任务的方向发展。

Fable 5.1效能大幅提升 蛋白质设计成功率近50%

在Terminal-Bench-Science 0.1基準测试中,Fable 5.1拿下52.6%成绩,较上一代提升超过一倍;在程式设计测试中的表现也提升13%。

Fable 5.1同时展现出跨领域的任务处理能力。Anthropic让模型取得开源蛋白质设计工具的使用权限,要求其设计能够高亲和力结合特定标靶的蛋白质。模型提出的设计随后交由两家外部机构进行实验验证。

结果显示,在3个标靶上,Fable 5.1设计的蛋白质结合亲和力较此前蛋白质设计竞赛中的最佳作品高出10倍以上,整体成功率接近50%,高于过去蛋白质设计典型约10%至15%的成功率。

Anthropic表示,针对12个标靶提出的设计,全部都经外部实验室验证为有效结合物。

在计算生物学方面,Fable 5.1也重新撰写7个开源深度学习模型的GPU核心程式码,使这些模型的推理速度最高提升2.5倍,同时维持完全一致的输出结果。

由于相关模型在一般实验中有时需要执行数千次,经过最佳化后,GPU成本可降低30%至60%。

Anthropic指出,过去这类效能最佳化通常需要性能工程团队投入数週时间,Fable 5.1则仅花费数天,且只依靠公开原始码完成。

AI重建金星地图 解析度提升至2至3公里

Fable 5.1还将AI能力延伸至行星科学领域。

Anthropic让模型利用NASA麦哲伦探测器30多年前取得的雷达影像资料,训练神经网路并重新绘製金星表面约三分之一区域的高解析度地形图。

此前已有涵盖金星约五分之一範围的地图,但解析度约为10至20公里。Fable 5.1製作的新地图则将细节提升至2至3公里,高度精度提高25%。

这份地图以知识共享授权方式发布,可作为NASA即将进行的VERITAS任务及欧洲太空总署(ESA)EnVision任务的参考。

Fable 5.1全面开放 Mythos 5.1锁定经审核机构

此次发布另一项值得注意的变化,是Anthropic同步推出两个版本的模型。

Fable 5.1向所有使用者开放,Mythos 5.1则仅提供给通过审核的机构使用。两者的模型能力相同,主要差异在于安全限制的严格程度。

Mythos 5.1放宽部分限制后,可以处理网路安全与生命科学领域的敏感任务。Anthropic并形容,Mythos 5.1是公司截至目前推出的模型中网路能力最强的一款。

Anthropic此次也调整安全机制。由于开发者过去经常反映安全护栏过于严格,导致部分无害请求遭到拦截,Fable 5.1针对生物与医学相关任务的安全拦截率降低85%,网路安全领域的防御性任务拦截则减少约60%。

企业客户则将取得新的Enterprise Frontier Safeguards功能。企业可将资料留存在自有云端环境,不必将资料存放于Anthropic伺服器;人工审查也预设由企业客户自行执行,形成零资料保留的隐私方案,同时让Anthropic持续具备侦测及阻止模型遭到滥用的能力。

这项功能由Anthropic与超过100家客户,以及亚马逊云端科技、Google Cloud、Microsoft Azure等云端合作伙伴共同开发,预计分阶段推出。

Fable 5.1 API降价 複杂AI代理任务最高省45%

除了能力提升,Anthropic也同步调降Fable 5.1的使用成本。

其中,快取读取费用降低约75%,每百万token价格降至0.25美元。对一般任务而言,整体成本较Fable 5降低约25%;如果是大量使用AI代理(AI Agent)的複杂任务,成本降幅最高可达45%。

价格下降与Anthropic近期扩大算力基础建设布局也有所关联。

Anthropic在此次模型发布前一天,与云端服务业者Lambda签署350亿美元算力租赁协议;几天前则与Nscale签署另一笔450亿美元协议。两笔交易将为Anthropic锁定未来数年的大规模算力。

其中,Lambda提供给Anthropic的基础设施将部署在美国德州Nueces县一座正在兴建的资料中心,由Hut 8 (HUT-US) 负责建设;辉达(NVDA-US) 也将持有该园区的租约。

Hut 8位于Nueces县的园区总容量为1GW,其中704MW已出租给一家未具名客户,后来确认租户为辉达。

Anthropic出手防AI蒸馏 封堵提取模型思考过程

Anthropic也针对模型蒸馏推出新的防御措施。所谓模型蒸馏,是利用高阶模型的输出训练成本较低模型的方法,但这项技术有时会遭到大规模滥用。

Anthropic表示,在新的防御机制下,新建立的API帐户将无法透过多轮对话编辑Claude的上下文历史,以此提取模型的思考过程。

这种做法过去是常见的模型蒸馏手段,如今将受到限制。新措施将逐步推行,现有帐户暂时不受影响,但未来将适用于所有使用者。

整体而言,Fable 5.1与Mythos 5.1的推出显示,AI模型竞争正从基準测试分数进一步延伸至实际问题解决能力。同时,模型成本、安全机制、企业资料隐私,以及防止模型遭到滥用,也逐渐成为新一轮AI竞争的重要面向。

发布于 2026-09-02 16:46
收藏
1
上一篇:〈SEMICON〉颖崴AI开案强劲 明年Q2至Q3产能至少增50% 下一篇:亿万富翁泰珀AI布局大转向:弃短期获利拥抱长期前景