AI 战略和运营指数报告:Claude Fable 5 比 DeepSeek V4 Pro 高 12 分,每任务成本超 100 倍
最新 7 月 9 日消息,科技媒体 The Decoder 昨日(7 月 8 日)发布博文,报道称 Artificial Analysis 新增 6 个行业指数测试,Anthropic 的 Claude Fable 5 模型横扫榜单,全部位列第 1 名。
Artificial Analysis 于 7 月 7 日在 X 平台发布推文,基于美国职业信息网络 O*NET 职业分类体系,针对金融与会计、法律、医疗与医学、战略与运营、工程和经济学 6 个行业场景,按行业任务中技能出现频率分配权重,推出全新能力指数(共有 8 项指标)。
在所有 8 项指标中,Claude Fable 5(采用 Opus 4.8 作为备选模型)全部位列第 1 名;Claude Opus 4.8 (max) 六项排名第二,剩余 2 项第二名均由 OpenAI 的 GPT-5.5 (xhigh) 夺得。
在开放权重模型中,GLM-5.2 (max) 在 6 个行业指数中的 5 个指数中领先。GLM-5.2 (max) 以 53 分的成绩在工程基准指数中排名第五,仅落后于 Claude Sonnet 5 (max) 和 GPT-5.5 (xhigh) 两分。
在成本方面,Claude Fable 5 在战略与运营指数中每项任务的成本为 3.48 美元,比 DeepSeek V4 Pro max(0.03 美元)高出 100 多倍,而两者的性能提升却只有 12 分。
DeepSeek V4 Flash(max)在所有 6 个指数上的任务完成成本均低于 0.04 美元,同时得分处于中游水平。最新附上相关数据如下:

《AI 战略和运营指数报告:Claude Fable 5 比 DeepSeek V4 Pro 高 12 分,每任务成本超 100 倍》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
华为昇腾 950 超节点荣获 2026 世界人工智能大会最高荣誉 SAIL 奖
@华为中国 昨日(7 月 18 日)发布博文,宣布昇腾 950 超节点(Atlas 950 SuperPoD)荣获 2026 世界人工智能大会(WAIC)最高荣誉 SAIL 奖。... -
“反 AI”情绪愈演愈烈,多家头部 AI 公司加强高管安保
《华尔街日报》报道称,针对 AI 行业的敌意不断上升,开发先进 AI 模型的人员和企业正面临越来越多的威胁与袭击企图。多家头部 AI 公司已经加强安保,部分高管出行时甚至由武装保镖随行,另一些人则选择降低曝光度,减少公开活动。... -
OpenAI 回应 GPT-5.6 Sol AI 意外删除用户文件:已采取措施降低风险
OpenAI 核心产品负责人蒂博 · 索蒂奥(Tibo Sottiaux)于 7 月 16 日在 X 平台发布推文,回应 GPT-5.6 Sol 会擅自删除用户文件问题。... -
面向手机的 AI 游戏创作工具,《Roblox》移动版将更新“Build”功能
Roblox 为移动版客户端推出“Build”功能,用户通过简单提示词即可生成基础游戏,无需编程技能。该功能由多种 AI 模型驱动,支持生成玩法、环境、角色等。将于 7 月 28 日开启 Alpha 测试,首先面向新西兰用户开放。#Roblox #AI 游戏创作 #移动游戏开发#... -
歌曲生成平台 Suno 部分源码泄露,被发现全网爬取数百万歌曲训练 AI
科技媒体 404Media 昨日(7 月 16 日)发布博文,报道称基于黑客披露的 Suno 内部源代码,该 AI 歌曲生成平台从 YouTube Music、Deezer 和 Genius 等平台抓取数百万首歌曲来构建其核心模型。...












