ClaudeHaiku5.5发布,跑分超GPT-6Luna,价格降75%

Anthropic于10月7日推出Claude Haiku 5.5,这款小模型在性能、成本和功能上均有显著提升。其运行成本较前代降低约75%,输入输出单价分别降至0.10美元和0.50美元,并首次引入...

人工智能

美国时间10月7日,AI初创公司Anthropic正式发布了其最新小模型Claude Haiku 5.5。这款产品不仅在价格上实现了大幅下调,更在多个关键性能指标上取得了突破性进展,标志着小型AI模型进入了一个新的发展阶段。

核心变化:成本与性能的双重突破

Haiku 5.5最引人注目的变化是其运行成本的显著降低。对于提示词不超过10万Token的请求,API价格较前代Haiku 4.5下降90%,输入和输出价格分别为每百万Token 0.10美元和0.50美元;超过10万Token的请求,价格下降50%。这一降价幅度使得Haiku 5.5成为目前市场上性价比最高的小型AI模型之一。

在性能方面,Haiku 5.5同样表现亮眼。在知识工作、电脑操作和编程等测试中,Haiku 5.5相比上一代都有明显提升。其中,GDPval-AA v2.1拿到1620分,是Haiku 4.5的两倍多,也超过了GPT-6 Luna的1437分。在OSWorld 2.1离线子集得分达到72.4%,而Luna为48.9%,Haiku 4.5则只有15.7%。

Claude Haiku 5.5价格对比表

创新功能:可调节推理强度

Haiku 5.5的最大亮点之一是首次引入了可调节的推理强度设置,用户可以根据任务复杂度在Low、Medium、High、Xhigh、Max五档之间自由选择。这种设计使得用户可以在成本和智能之间找到最佳平衡点。例如,在需要高精度的任务上可以选择Max模式,而在对成本敏感的应用场景中则可以使用Low模式。

市场影响:小型AI模型的新标杆

Haiku 5.5的发布不仅重新定义了小型AI模型的定位,也为整个行业树立了新的标杆。随着运行成本的大幅降低,开发者可以更频繁地调用AI模型进行各种任务,这将极大地推动AI应用的普及和发展。

此外,Haiku 5.5还首次支持作为Opus 5.5和Sonnet 5.5的子智能体,这意味着它可以承担更复杂的任务分解工作,进一步提升了整体系统的效率。同时,Anthropic还将Sonnet 5.5缓存读取价格下调50%,使多数智能体任务的运行成本再降约20%。

与竞品的对比

在与OpenAI GPT-6系列的对比中,Haiku 5.5在多个测试项目中表现出色。特别是在电脑操作和编程任务上,Haiku 5.5的优势尤为明显。例如,在OSWorld 2.1测试中,Haiku 5.5以72.4%的成绩领先于GPT-6 Luna的48.9%。在Terminal-Bench 4.0测试中,Haiku 5.5更是以39.2%的成绩远超GPT-6 Luna的16.4%。

Cursor平台上的Haiku 5.5成本优势

尽管Haiku 5.5在许多方面已经接近甚至超越了大型模型的表现,但在事实知识方面仍有提升空间。不过,随着技术的不断进步,相信这些问题很快就会得到解决。

总的来说,Claude Haiku 5.5的发布标志着小型AI模型进入了新的发展阶段。通过成本的大幅降低和性能的显著提升,它不仅为开发者提供了更强大的工具,也为AI技术的广泛应用奠定了基础。