DeepSeek官宣flash系列降价 输出每百万Token仅4元
DeepSeek宣布自9月10日起下调flash系列AI模型价格,输出价格降至每百万Token 4元,输入价格同步调整,进一步降低企业调用大模型的门槛。
驱动中国9月9日消息,国产大模型厂商DeepSeek今日官宣,自9月10日起对旗下flash系列AI模型进行价格调整,其中输出价格降至每百万Token 4元。这一调价动作延续了今年以来国内大模型市场持续降价的趋势,旨在通过更低的调用成本吸引开发者和企业客户。
根据官方公告,此次降价覆盖flash系列模型的输入与输出两端。输出价格从原有水平下调至每百万Token 4元,输入价格也同步做出调整,但具体数值未在素材中详细披露。DeepSeek方面表示,此次调价是基于模型推理效率提升和算力成本优化的结果,希望让更多中小企业和个人开发者能够以更低成本接入大模型能力。
flash系列是DeepSeek面向高频调用场景推出的轻量化模型,主打低延迟和性价比,适用于对话、内容生成、代码辅助等常见任务。与旗舰级模型相比,flash系列在保证基础能力的同时,更强调推理速度和单位成本控制,因此成为许多开发者在生产环境中的首选。
今年以来,国内大模型市场经历多轮价格战。从年初多家厂商宣布免费开放部分模型,到年中主流模型纷纷下调API调用价格,行业整体呈现出明显的“以价换量”特征。DeepSeek此次对flash系列降价,被业内视为对这一竞争态势的跟进,也反映出大模型商业化正从技术比拼转向成本与服务能力的综合较量。
对于开发者而言,输出Token价格的下降直接影响生成式应用的边际成本。以每百万Token 4元计算,一个日均调用百万Token的中型应用,每月输出成本将较此前明显减少。这一变化有望刺激更多长文本生成、批量处理等场景的落地,推动大模型在客服、写作、编程辅助等领域的渗透率提升。
值得注意的是,降价的同时,DeepSeek也在持续迭代模型能力。此前发布的多个版本在推理、指令跟随和上下文理解等方面均有改进,flash系列作为轻量级产品,其性能与价格的平衡点正成为市场竞争的关键。业内分析认为,随着推理成本的进一步下降,大模型服务的定价体系将更加精细,按需付费和分层定价或成为行业常态。
此次调价将于明日正式生效,现有用户将自动适用新价格,无需额外操作。DeepSeek未透露未来是否会对其他系列模型进行类似调整,但市场普遍预期,在竞争加剧的背景下,更多厂商可能跟进降价,大模型服务的普惠化进程有望进一步提速。