当前位置: 首页 > news >正文

大模型“价格屠夫”DeepSeek宣布涨价,Token低价时代结束,AI价格战进入新阶段?

过去的DeepSeek到底有多便宜?

8月6日,DeepSeek在用户后台发布公告,计划近期整体上调DeepSeek API服务定价,提醒“预计涨幅较大”,建议用户合理安排使用需求和充值金额。这引发广泛关注,过去两年Token价格战中,DeepSeek常是带头者,如今先降价又宣布“大幅涨价”,让人疑问价格战是否结束。在讨论涨价前,看看DeepSeek的低价情况。其API官方页面显示,目前DeepSeek -V4-Flash缓存命中输入价格为每百万Token 0.02元,缓存未命中输入为1元,输出为2元;性能更强的DeepSeek -V4-Pro分别为0.025元、3元和6元。此前还预告过峰谷定价机制,在北京时间每天9点至12点、14点至18点高峰期,计费项目价格调为平时两倍,但截至8月6日未实施。即便看标准价格,DeepSeek -V4-Flash仍很便宜。海外研究机构Artificial Analysis测试数据显示,它完成一轮综合基准测试平均成本约0.03美元,相比之下,Kimi K3约0.86美元,OpenAI GPT-5.6 Sol约1.86美元,Anthropic Claude Fable 5达3.15美元,其任务成本不到部分海外旗舰模型百分之一。当然,模型能力有差异,从测试榜单看,DeepSeek V4 Flash 0731 Max得分与Fable 5相差11分,但价格差距达百倍时,多数任务无需超强性能。且其价格比成绩相近的Gemini 3.6 Flash High低90%,对多数用户“物美价廉”。所以此次强调“预计涨幅较大”让开发者紧张。在Agent时代,AI执行任务不再简单,以编程任务为例,可能需多轮操作,Token消耗呈指数级增长,价格小涨也会让账单大增。或许DeepSeek低估了Agent的Token消耗量,导致服务器算力被榨干,且它还是个“话痨”,若Token输出量降低,成本能再降50%,对其他AI公司是威胁。

调用量全球第一,DeepSeek快被榨干了

多数人疑惑DeepSeek为何突然涨价,答案是刚更新的DeepSeek V4 Flash 0731 Max虽版本定位不如V4 Pro,但Agent能力提升明显,是重度AI用户所需。实际数据显示调用量飙升,根据OpenRouter统计,DeepSeek -V4-Flash最近一周处理量约6.6万亿Token,虽比上一周降10%,但在模型调用榜仍排第一,在该平台所有模型中使用量也排第一,占约58%的Token份额。从6月12日到8月6日,该模型累计处理量约97万亿Token,完成会话超1000万次。即便这是第三方数据,也能看出其在顶级AI中脱颖而出,但也面临巨大算力压力。此前报道称它有十万卡规模的数据中心,但和Google、OpenAI等AI企业及亚马逊、阿里云等云服务巨头比,不在一个量级。从上周起,它频繁传出算力不足、限制使用消息,有人打开网页版用专业模式提示“服务繁忙”。其实刚发布V4版本时,就因调用量大宣布采用峰谷定价,但未实施,因为服务器几乎无“谷底”,深夜中美用户交替使用。对于DeepSeek来说,目前定价收支平衡就不错,业内人士猜测它在补贴Token价格,否则以其算力规模,价格不会这么低(有网友称梁文锋为“梁圣”)。低价吸引开发者,但也带来问题,开发者遇到小问题因价格便宜会丢给它解决,导致大量算力用于简单任务,挤占复杂任务算力份额,出现“拥堵”。所以其涨价在预料之中,当初宣布降价用“限时”字样,估计早有准备。站在消费者角度希望它一直优惠,但站在行业角度,靠补贴抢市场无法持久,AI行业企业要考虑收支平衡,且它涨价后性价比仍不错,对开发者仍是首选。

Token低价时代结束,商业化成了新重点

DeepSeek宣布涨价后,网友看法不一,有人认为价格战结束,有人觉得才刚开始。过去两年价格战简单,各厂商比每百万Token价格,还派发免费额度、推出优惠,让Token价格低到可忽略。但随着模型能力和应用场景变化,单纯比价格意义不大。一方面,不同模型完成同一任务消耗Token数量不同,如DeepSeek用2.1亿Token,Gemini 3.6 Flash High用5900万Token,差距近3.5倍,虽前者价格低,但任务复杂度上升时,两者成本差价可能缩小,影响竞争力。另一方面,模型速度和稳定性影响企业成本,对金融等需实时演算、稳定性要求高的业务更重要。随着AI进入各行业底层运行链条,企业除价格外,对算力有更多要求,DeepSeek想立足需考虑B端需求,适当涨价“劝退”部分用户、提升高价值用户体验是合适方案。而且V4 Flash 0731表现好,后续V4 Pro xxxx版可能更强,价格差距大不利于平衡性价比。纵观全球AI模型市场,近期都在把模型“细分化”,构建阶梯式体系满足不同需求。所以与其说价格战结束,不如说才正式开始,AI企业将进入“肉搏”阶段,用更具性价比的模型和服务争夺B端市场份额,Token的商业化大战正式打响。

http://www.jsqmd.com/news/1359999/

相关文章:

  • 长沙到岳阳的拼车/包车商务出行老牌选择|首选推荐-途安商务车 - 网点资讯
  • 从“认出这是一只狗”到“知道狗头、狗腿分别在哪”:DINO-v3中判别性特征(Discriminative Features)、局部一致性(Local Consistency)与Gram锚定的完整逻辑
  • Linux-Linux的权限
  • AI绘画本地部署实战:从Stable Diffusion到定制化图像生成
  • 2026年烟台婚纱礼服秀禾租赁市场前景与发展趋势展望 - 品牌品鉴馆
  • GEO优化是什么?GEO和SEO的区别详解,以及国内靠谱白帽geo优化公司选型推荐 - 品牌品鉴馆
  • 如何用ZonyLrcToolsX实现99%歌词命中率?跨平台批量歌词下载工具深度解析
  • 智能家电AIoT芯片定制化开发:从架构到部署的工程实践
  • 医学论文解读-CartiMorph: A framework for automated knee articular cartilage morphometrics
  • C++实现连连看游戏:从算法到图形界面的完整项目实战
  • 东方财富sse接口无返回问题排查,OkHttp踩坑指南
  • Linux内核swap map革新:新一代内存管理技术解析
  • Navicat AI功能实战:SQL生成、调试与优化全解析
  • Unity网格简化开源贡献指南:从算法原理到PR提交全流程
  • PACIFIC SCIENTIFIC 6410-024-N-N-N 细分步进驱动器(6000系列)
  • C++动态数组原理与std::vector最佳实践
  • 烟台水冷机组维保-欧米到家10年经验师傅30分钟极速上门检修|故障检修 | 定期保养 | 配件更换 | 清洗维护| 报价公开透明一站式服务
  • 2026 枣庄房屋漏水渗水修缮选择指南:厨卫、外墙、屋顶、飘窗阳光房渗漏怎么高效处理 - 筑宅安
  • 如何在Android设备上构建完整的虚拟化环境:终极移动工作站指南
  • 谈谈对智能车竞赛的变化看法
  • 2026年寄大件怎么寄最便宜?过来人总结的5个省钱技巧 - 快递物流资讯
  • 如何在浏览器中优雅查看Markdown文档:免费开源扩展终极指南
  • XXMI启动器:革命性的米哈游游戏模组管理终极解决方案
  • Vue3打包报错‘Vue is not defined‘解决方案
  • 两天用Flutter+AI打造跨端应用:Vibe Coding实战与工具链揭秘
  • 3步完成通达信缠论可视化分析:免费插件让技术分析更简单
  • 如何快速下载B站视频:BilibiliDown跨平台下载器终极指南
  • 2026最新6款个人AI编程助手基础版免费实测对比
  • MCP技术体系与Spring AI 2.0在企业级AI开发中的应用
  • 告别“设备被占用“烦恼:USB-Disk-Ejector强力解决Windows弹出难题