DeepSeek announces major price hike amid server overload
DeepSeek announced a significant price increase for its API, citing overwhelming server load and rising computational costs, though specific rates and effective dates were not disclosed. The move follows a surge in usage of the V4 Flash 0731 model, which caused frequent Server Busy errors and downtime, and the company advised developers to plan request volumes and control top-ups.
Coverage timeline
机器之心机器之心
顶不住,服务器真的顶不住,DeepSeek 要涨价了。 周四上午,用 DeepSeek API 的同学们都注意到了这样一条公告。DeepSeek 要涨价了,而且预期涨幅会很大。虽然这次官方并未透露具体幅度和生效时间,但已经建议企业与开发者「合理规划请求量、控制充值金额」。 AI 开发者社区里顿时炸开了锅。 长期以来,DeepSeek 凭借超高的 Token 性价比(极低的输入、输出费用,外加很高的缓存命中率)吸纳了庞大的流量,但与此同时,它也面临着的算力成本压力。随着模型调用量呈指数级暴增,补贴式的低价策略似乎难以为继了。 在上周 DeepSeek V4 Flash 0731 发布以后,大模型拥有了接近于 Opus 4.8 的能力,但同时只有 Fable 5 百分之一的价格。这样的成本,在处理高并发、日常对话、代码辅助与高吞吐检索任务时可以说占尽了优势,很多开发者都在尽情使用。 这个上下文长达 1M,速度还很快的模型几乎「用到就是赚到」,什么活都可以交给它去干,没有任何心理负担。 于是终于再现了去年 DeepSeek R1 时的盛况:本周二,不少开发者反映 DeepSeek V4 Flash API 频繁出现 Server Busy、延迟飙升或短暂停机(Downtime)的情况。就连 APP 端也出现了宕机的情况。 开源的 AI 编程智能体工具 OpenCode 因为套餐里有 DeepSeek 新模型涌进了大量用户,8 月 5 日 V4 Flash 的 token 消耗量已经到了 6.3 万亿。 有关 V4 Flash 0731 的评测已经很多了,像独立 AI 评测平台 Artificial Analysis Intelligence 就更新了一下他们的综合能力图,把知名模型的价格与智力水平都放在一起对比。V4 Flash 0731 在左上的位置:智能水平高,且价格低。 它框出来的右下的那么多模型,都有着落后的危险。 而且现在这还只是个 Flash 版,Pro 版出来预计还会继续缩圈。 如此看来,DeepSeek 似乎确实有涨价的理由。 其实在上个月,DeepSeek 已经预告采取峰谷定价机制,北京时间每日 9:00-12:00、14:00-18:00 高峰期调用价格翻倍。官方可能希望以此引导流量错峰,但这种方式看来依然难以全面平衡服务成本与负载压力,毕竟 V4 F

Hacker Newsmiroljub
🎉 The official API for DeepSeek-V4-Flash has launched for public beta, with significantly enhanced agent capabilities; the V4-Pro version remains unchanged for now. Click for details. By signing up or logging in, you consent to DeepSeek's Terms of Service and Privacy Policy. Forgot password? Sign up Log in Log in with Google Log in with Google 浙ICP备2023025841号·Contact us One more step before you proceed...