DeepSeekV4Pro正式版上线,逼近Fable5性能,定价仍具竞争力

就在科技圈刚刚经历了一场AI模型的"双雄会"后,DeepSeek再次以一款重磅产品刷新了行业认知。8月13日凌晨,这家中国人工智能实验室悄然上线了其旗舰级大模型DeepSeek V4 Pro的正式版本...

人工智能

就在科技圈刚刚经历了一场AI模型的"双雄会"后,DeepSeek再次以一款重磅产品刷新了行业认知。8月13日凌晨,这家中国人工智能实验室悄然上线了其旗舰级大模型DeepSeek V4 Pro的正式版本(版本号0813),标志着这款备受期待的模型终于从预览阶段走向成熟可用状态。

图片

根据官网API文档更新,deepseek-v4-pro对应的模型版本已升级为DeepSeek-V4-Pro-0813。这一版本在多个关键维度上实现了突破:首先,它支持高达100万Token的上下文窗口,最大输出长度达到38.4万Token,这使得单次调用能够处理更长的文本序列,减少了多轮交互的需求。其次,在功能兼容性方面,该模型同时支持JSON Output、Tool Calls、Responses API以及Anthropic API等多种接口标准,开发者无需修改现有模型名称即可无缝接入最新版本。

价格方面,DeepSeek V4 Pro目前依然保持与预览版一致的定价策略:缓存未命中输入每百万token 3元,输出6元,而缓存命中输入则低至0.025元。作为对比,同系列的V4 Flash版本对应的价格分别为1元和2元。虽然Pro版本的绝对价格高于Flash,但考虑到其更大的上下文窗口和输出能力,单位Token的性价比依然具备竞争力。

值得注意的是,DeepSeek此前已经发布公告,计划近期整体上调API服务定价,预计涨幅较大。这意味着当前的低价策略可能只是暂时的,未来可能会迎来一轮价格调整。

在实际应用中,DeepSeek V4 Pro的表现已经引起了广泛关注。根据社区反馈和第三方评测,该模型在多个基准测试中取得了显著进步。例如,在Terminal Bench 2.1测试中,V4 Pro从72.1分提升至87.9分,仅比Claude Fable 5的88.0分差0.1分;在DeepSWE软件工程智能体测试中,得分从12.8分飙升至62.7分,增长近五倍。这些数据表明,V4 Pro在代码生成、任务完成度等方面已经达到了全球领先水平。

然而,也有开发者指出,尽管V4 Pro在多数基准测试中表现出色,但在某些特定场景下仍略逊于竞争对手。例如,有博主对比后认为0813版本在部分基准测试中仍略逊于Luna MX,也有人指出它约一半基准还落后Kimi K3。官方至今没有发布完整的benchmark报告,这也意味着所有声称都要靠第三方验证。

总的来说,DeepSeek V4 Pro的正式发布不仅展示了DeepSeek在模型开发上的技术实力,也为全球开发者提供了一个更具性价比的选择。随着AI模型市场竞争日益激烈,DeepSeek能否凭借这款产品在开源生态中占据有利位置,以及如何平衡低价策略与长期盈利,将是接下来需要重点关注的问题。