
DeepSeek API峰谷定价8月17日生效:高峰时段价格最高涨1100%,AI从"统一标价"走向"精细化算力调度"
8月13日DeepSeek公布新价格,8月17日0时峰谷定价生效(高峰9-12/14-18时闲时半价);V4-Pro高峰缓存命中0.3元(涨1100%/12倍)/未命中9元(涨200%)/输出27元(涨350%);V4-Flash高峰0.1/3/9元;智谱年内5轮调价累计+83%;Kimi K3输出涨近4倍;腾讯云/阿里云/百度智能云3月同步+5-34%;AWS一月EC2机器学习容量块+15%;Meta 8.5万员工30天烧73.7万亿Token月账单2.21亿美元;Uber被迫设每月1500美元/员工上限;变压器交货期115-130周;H100租赁价3个月+40%;智谱Q1涨价83%后调用量反向+400%。
【新闻原文】
8月13日,深度求索官方宣布对DeepSeek API价格进行更新调整,采用"峰谷定价"机制——空闲时段价格为高峰时段的一半。8月17日0时(北京时间),新价格正式生效。具体时段为:高峰时段为北京时间每日9:00-12:00和14:00-18:00(共7小时),其余17小时为空闲时段。DeepSeek-V4-Pro高峰时段每百万Tokens输入(缓存命中)0.3元、输入(缓存未命中)9元、输出27元;空闲时段分别为0.15元、4.5元、13.5元。DeepSeek-V4-Flash高峰时段分别为0.1元、3元、9元;空闲时段分别为0.05元、1.5元、4.5元。对比此前价格:V4-Pro缓存命中输入涨幅最高达1100%(从0.025元→0.3元,约12倍),其余项涨幅200%-350%;V4-Flash高峰时段价格涨幅50%-1100%不等。需要说明的是,此项调整针对开发者使用的API服务,并不影响普通用户使用DeepSeek网页端或手机App的免费体验。这并非孤例——智谱年内已完成5轮API调价,2026年一季度累计提价83%;月之暗面Kimi K3发布后输入定价20元/百万Tokens、输出100元(输出较前代涨近4倍);腾讯云/阿里云/百度智能云3月同步上调AI算力产品价格5%-34%(腾讯云半年内两次涨价)。海外市场更早:AWS一月把EC2机器学习容量块价格上调15%;微软2月调整GPT-4o/4T API;谷歌云5月1日起调高AI计算实例。涨价背后是供需失衡:国内Q1 AI算力需求同比+417%,但供给增速仅128%;日均Token调用量已达140万亿,较2024年初增长超1000倍。Meta 8.5万员工30天烧73.7万亿Token,月账单约2.21亿美元;Uber四个月烧光全年AI编程预算,被迫设每月1500美元/单员工上限。物理硬约束同样严峻:全球AI数据中心所需高功率变压器交货期延长至115-130周(约两年半),GE Vernova燃气轮机产品价格近三年累计涨幅超300%,H100一年期租赁价从2025年10月的1.70美元/小时涨到2026年3月的2.35美元/小时(+40%)。
来源:中证网/智东西/IT之家/金融界/长江日报/光明网/智谱官方/DeepSeek官方/腾讯云/阿里云/AWS/Microsoft官方
【企服观察】
DeepSeek API峰谷定价8月17日生效,V4-Pro缓存命中输入价格最高涨1100%,是2026年下半年AI产业最具信号意义的"价格事件"——它意味着中国AI产业从"烧钱换规模的统一标价时代"彻底转向"精细化算力调度的市场化定价时代","AI时代的电价机制"正式确立。对企业服务行业,这则新闻至少释放出五个值得深思的战略信号与未来趋势。
第一个信号:峰谷定价机制——AI从"统一标价"走向"精细化算力调度"的市场化定价。DeepSeek首次采用"高峰价格2倍+闲时价格"的分时定价机制,本质是把"电力行业的峰谷电价"逻辑引入AI API服务——通过价格杠杆调节算力供需,鼓励用户将非紧急任务(批量数据处理、代码生成、模型评测等)错峰调用。这一机制设计背后是"算力调度"思维的成熟——AI服务不再是"无差别提供",而是"按供需动态定价"。对企服行业的启示是:AI ToB服务正在从"产品化"升级为"运营化"——企服厂商必须把"算力调度+成本管理+资源优化"作为产品核心能力,构建"按使用量精细化计费+闲时优惠+批量折扣"的多层定价体系。能够提供"成本可控+资源灵活+精细化调度"AI产品的企服厂商将获得显著的成本优势。
第二个信号:涨价潮的真相——AI产业从"烧钱换规模"转向"价值定价"的商业化拐点。智谱年内5轮调价累计+83%、Kimi K3输出涨近4倍、腾讯云/阿里云/百度智能云3月同步+5%-34%——这并非个别企业的孤立行为,而是"AI ToB全行业从烧钱换规模转向价值定价"的系统性拐点。背后的核心逻辑是:①算力供需失衡(国内Q1需求+417% vs 供给+128%);②Token消耗"上不封顶"(日均140万亿、较2024年初+1000倍);③企业付费意愿上升(DeepSeek涨价后调用量反向增长400%);④物理硬约束加剧(变压器115-130周交货、燃气轮机3年涨300%)。对企服行业的启示是:AI ToB市场进入"价值定价"时代——企服厂商必须把"为客户创造实际业务价值"作为产品定价的核心依据,避免"低价竞争"的无效内卷。能够构建"价值定价模型+成本管理体系+客户ROI证明"的企服厂商将赢得新一轮AI ToB竞争。
第三个信号:Meta 30天烧73.7万亿Token+月账单2.21亿美元+Uber被迫设1500美元/月单员工上限——Token消耗"上不封顶"成为企业AI成本管理的新挑战。Meta 8.5万员工30天消耗73.7万亿Token、月账单2.21亿美元;Uber 4个月烧光全年AI编程预算、不得不设每月1500美元/员工上限——这些数字背后是"AI在企业内部应用失控"的真实状况。当AI能力越来越强、使用场景越来越多,企业AI消耗正在突破"成本可控"边界。对企服行业的启示是:企业AI成本管理正在成为新的"企服核心需求"——企服厂商应当把"Token消耗精细化管理+单用户/单部门/单项目成本预算+模型路由优化+成本可观测性仪表盘"作为关键产品能力。能够帮助企业"管住AI成本"的企服厂商将在AI ToB规模化阶段获得显著优势。
第四个信号:算力短缺的物理硬约束——电力+硬件+数据中心三层瓶颈。全球AI数据中心高功率变压器交货期延长至115-130周(约两年半)、GE Vernova燃气轮机产品价格3年涨300%、H100租赁价+40%——这些数字揭示"算力供给瓶颈"已经从"芯片产能"扩展到"电力+变压器+燃气轮机+数据中心"的全产业链物理约束。这一趋势意味着"算力供给侧改革"将成为未来3-5年AI产业的核心议题。对企服行业的启示是:企服厂商必须为"算力供给紧张"做好长期准备——①建立"多云多模型"的算力冗余架构;②探索"国产AI算力"作为补充(华为/寒武纪/摩尔线程/壁仞等);③把"推理效率优化"作为产品核心竞争力(用更少Token完成同等任务);④关注"算力Token化"等新模式(如Bitfury、Coreweave、阿里云弹性算力等)。
第五个信号:DeepSeek涨价后调用量反向增长400%——"价值定价"反而扩大市场。"智谱2026Q1累计提价83%、调用量反向增长400%"——这一反直觉的现象说明:AI ToB市场已经进入"价值定价"阶段,客户愿意为"更智能的AI"支付更高价格,"烧钱换规模"的低价竞争反而抑制了客户的付费意愿。对企服行业的启示是:AI ToB市场的"价格战"已经走到尽头——企服厂商应当把"产品智能差异化+垂直行业Know-How+客户业务价值"作为核心竞争力,放弃"低价获客"的幻觉。能够在"智能战"中胜出的企服厂商将获得更优质的客户结构、更高的客单价、更长的续约周期、更健康的单位经济模型。
总而言之,DeepSeek API峰谷定价生效、价格最高涨1100%,是2026年下半年AI产业从"烧钱换规模"彻底转向"价值定价"的市场化拐点——峰谷定价机制开启AI精细化算力调度、涨价潮揭示价值定价商业化拐点、Token消耗失控呼唤精细化成本管理、算力短缺物理硬约束加剧、价值定价反而扩大市场。对企业服务行业,这是一次全方位的战略校准:构建精细化算力调度能力、建立价值定价模型+成本管理体系、帮助客户管理AI消耗、为算力供给紧张做好长期准备、放弃低价竞争转向智能差异化——唯有在这一系列战略维度上做好准备,才能在"AI ToB价值定价"的新阶段赢得长期市场地位。







评论
请评价真实、客观、有价值的内容请回复有价值的信息,无意义的评论将很快被删除,账号将被禁止发言。