机构:DeepSeek V4-Flash模型运行成本最低,远低于Anthropic Claude Fable 5

来源:爱集微 #DeepSeek# #AI模型#
1700

据研究机构Artificial Analysis测算,中国AI初创企业深度求索(DeepSeek)的新款旗舰AI模型,在基准测试中的运行成本为全球知名模型最低,不到Anthropic的Claude Fable 5的百分之一。

有知情人士称DeepSeek正筹备IPO,公司近期正式发布V4-Flash模型。这是其延续自身核心路线——主打极致性价比AI产品,以此重获市场关注度的最新举措。

2025年初,这家初创公司的R1模型曾在全球引发行业震动,一度带动全球科技股下跌,也让市场开始反思美国企业AI领域高额投入的效率问题。

定价优势明显,实际性价比突出

Artificial Analysis公布的数据显示,DeepSeek V4-Flash的官方定价为:每百万输入token收费0.14美元,每百万输出token收费 0.28 美元。token是计量 AI 模型使用量的基础数据单位。

该机构测算,V4-Flash完成单次标准测试的平均成本仅3美分。对比来看,中国同行月之暗面(Moonshot AI)的Kimi K3单次测试成本为86美分,OpenAI的GPT-5.6 Sol为1.86美元,Anthropic的Claude Fable 5更是高达3.15美元。

这种测算方式比单纯对比官方定价更能反映真实使用成本,因为它计入了模型完成一项任务所需处理和生成的总数据量。部分模型标称定价低廉,但生成答案需要多轮推理步骤,实际使用成本反而更高。

市场竞争白热化,性能仍有提升空间

DeepSeek曾是中国 AI 赛道最受瞩目的企业,但很快面临激烈的国内竞争,对手涵盖月之暗面、MiniMax、智谱AI等初创企业,以及字节跳动、阿里巴巴等科技巨头。这些企业均在与美国科技公司争夺全球市场,核心目标客户是希望低成本大规模落地AI的企业群体。

性能表现上,Artificial Analysis的智能指数满分为 100 分,综合了编码、逻辑推理、职场场景任务等 9 项基准测试结果。DeepSeek V4-Flash 得分为50分,与谷歌的Gemini 3.6 Flash持平,仅比Meta的Muse Spark 1.1、智谱AI的 GLM-5.2 低1分。

不过头部产品的性能差距仍然存在:月之暗面Kimi K3得分达57分;Anthropic的Claude Opus 5、Claude Fable 5以及OpenAI的GPT-5.6,得分均比DeepSeek V4-Flash 高出9分以上。

目前DeepSeek还在开发性能更强的V4-Pro版本,暂未公布正式发布时间。

此外,阿里巴巴近期推出了旗下迄今参数规模最大、能力最强的AI模型Qwen3.8-Max,其模型规模与国内竞争对手月之暗面上月发布的产品相近。(校对/赵月)

责编: 李梅
来源:爱集微 #DeepSeek# #AI模型#
THE END

*此内容为集微网原创,著作权归集微网所有,爱集微,爱原创

关闭
加载

PDF 加载中...