Hermes推出AI性价比榜单,DeepSeekV4.1Flash成本仅0.259美元
全球大模型评测平台Hermes推出了全新的AI性能与费用综合榜单,该榜单不仅关注模型性能,还重点考量每任务成本。国产大模型DeepSeek V4.1 Flash以极低的每任务成本0.259美元位列榜单...
10月7日,全球知名开源AI大模型评测平台Hermes发布了最新的AI性能与费用综合排行榜(Hermes Index),该榜单旨在为用户在选择AI模型时提供更全面的参考依据。不同于以往主要关注模型性能的评测方式,此次Hermes特别引入了每任务成本这一关键指标,力求为用户提供更具性价比的选择。
根据榜单显示,目前排名第一的是Anthropic的Claude Opus 5.5,其每任务成本为4.99美元;排名第二的是OpenAI的GPT-6 Astra,但其每任务成本高达11.61美元,是当前榜单中最昂贵的选项。值得注意的是,在前十名中,除了Claude Opus 5.5和GPT-6 Astra外,其余均为国产大模型,显示出中国企业在开源AI领域的强劲竞争力。
在众多国产大模型中,DeepSeek V4.1 Flash的表现尤为突出。该模型以每任务成本仅0.259美元位居榜单第六位,远低于其他竞争对手。虽然其性能指数略逊于排名前五的模型,但其极具吸引力的成本优势使其成为追求高性价比用户的首选。彭博行业研究分析师Robert Lea指出,DeepSeek V4.1 Flash的出现,使得中美顶级AI模型之间的性能差距进一步缩小至约3%,创下历史新低。
然而,如果从纯粹的性价比角度来看,蚂蚁集团的Ling 3.0 Flash则更为突出。该模型每任务成本仅为0.054美元,虽然性能指数相对较低,但在Hermes平台上仍可免费使用,每日额度限制也较为宽松。对于预算有限的用户来说,Ling 3.0 Flash无疑是最佳选择。
此外,榜单还显示了最新发布的Ling 3.1 Flash,其性能已经超越V4.1 Flash,并且在官方网站上提供了免费试用期,这无疑将进一步加剧国内开源AI市场的竞争态势。
值得注意的是,尽管DeepSeek V4.1 Flash在成本方面具有显著优势,但其整体性能仍然与美国头部产品存在一定差距。例如,Beam大模型作为DeepSeek的美国版代表,虽然在性能上接近GLM-5.2,但仍无法与DeepSeek V4.1 Flash相媲美。不过,Beam大模型的算力成本仅为GLM-5.2的1/4到1/3,暗示其未来可能在成本控制方面取得更大突破。
总体来看,Hermes推出的这一全新榜单,不仅为用户提供了更全面的AI模型选择参考,也反映了当前全球开源AI领域的发展趋势。随着中国企业在开源AI领域的持续发力,中美顶级AI模型之间的性能差距正在不断缩小,而低成本模型的兴起,则正在改变整个行业的竞争格局。
