DeepSeek 涨价后,业余个人开发者的 API 成本开始肉疼了
DeepSeek 8 月 17 号开始全面涨价,最高涨了 12 倍,以前每个月是几杯瑞幸的钱,现在直接变成外面一顿正经饭。看大家也都发了很多文章,我也谈谈我这个业余个人开发者的感受吧。最近在 Agent 场景下对比了一圈 V4 Pro、Gemini 3.7 Flash、Hy3 还有 Qwen3.7 Plus,发现未来我大概率要把 DeepSeek 换掉了。
先算笔账:DeepSeek 涨价后个人开发者的 API 成本
价格单位均为 ¥/百万 tokens。
五款大模型 API 价格横向对比
| 模型名称 | 输入价格 | 输出价格 | 最大上下文窗口 | 官方标价与最新计费机制 |
|---|---|---|---|---|
| DeepSeek-V4-Flash | ¥3.0 (高峰) ¥1.5 (空闲) |
¥9.0 (高峰) ¥4.5 (空闲) |
1M | 峰谷定价:高峰期9-12点、14-18点 缓存命中:闲时 ¥0.05、高峰 ¥0.10 |
| DeepSeek-V4-Pro | ¥9 (高峰) ¥4.5 (空闲) |
¥27 (高峰) ¥13.5 (空闲) |
1M | 峰谷定价:高峰期9-12点、14-18点 缓存命中:闲时 ¥0.15、高峰 ¥0.30 |
| Gemini 3.7 Flash | ¥5($0.75) | ¥25($3.75) | 1M | 按$1=¥6.75计算,在今年年底前是这个价格 |
| Qwen3.7-Plus | ¥2 | ¥8 | 1M | 阿里云百炼标准定价(≤256K 输入 的价格,超长是¥6/¥24) |
| Hy3 (混元 3) | ¥1 | ¥4 | 256K | 缓存命中: ¥0.25 |
Agent 场景里,模型到底该怎么选
DeepSeek 这个价格吧,倒也不是说用不起,我估计一个月也就大几十块到一百多的量,但是两位数和三位数的心理预期可就差远了,之前就几杯瑞幸的钱,现在直接上升到外面正经的一顿饭了。
涨价一出来,对比自然就来了
DeepSeek V4 Pro:在Agent工具里的表现(自动浏览、PPT、Web 前后端、文案制作),也就和Gemini 3.7 Flash差不多。但白天DeepSeek V4 Pro比Gemini 3.7 Flash还要贵,晚上空闲期的价格,也没拉开差距。我算了一下,我用北美豆包的Gemini 3.7 Flash反而比DeepSeek V4 Pro好很多,不但更加便宜,任务完成的速度也快很多。-
DeepSeek V4 Pro:不如去用Hy3,DeepSeek V4 Flash现在的综合成本是Hy3的 2 倍,但实际体验并不值这 2 倍的价差。除非我把任务全扔到晚上去跑,但这不现实啊。
个人 Agent 场景下对”成本和速度”是极其敏感的,借用小众软件的对比图

速度才是 Agent 的命门:TPS 与 TTFT
Agent 工作起来是串行依赖的(调用工具 → 等待回复 → 规划下一步),跑完一个工作流往往就是几次、几十次的循环请求。如果模型生成速度(TPS)或首字延迟(TTFT)不够快,整个交互过程的等待时间是直线飙升。一轮交互慢20秒,10轮就是3分钟多钟了,复杂任务几十轮交互是常态,速度是 Agent 的命门啊——北美豆包的 Gemini 3.7 Flash 在整体能力略超 DeepSeek V4 Pro 的前提下,Gemini 3.7 Flash 的生成速度(TPS)几乎是 DeepSeek V4 Pro 的 4 倍,首字延迟(TTFT)更是只有 DeepSeek V4 Pro 的三分之一(以上都是思考开到高的情况)。而且价格还比 DeepSeek V4 Pro 综合成本便宜一点。北美豆包还是原生支持多模态的,用DeepSeek V4 Pro还不如去用 Gemini 3.7 Flash 了。
日常小活儿,便宜比聪明更重要
到了日常琐碎小任务的范畴,之前 DeepSeek V4 Flash 几毛钱做出来和现在 1 块多做出来,看似就涨了 2 倍不到,但感觉上完全不一样了。而且很多重复性任务并不需要模型具备顶尖的能力,只要模型智商合格,能遵循指令、结构化输出稳定、够便宜、速度还行就可以了。我他喵的不如去用腾讯的 Hy3 或者阿里的 Qwen3.7 Plus,大部分小任务这俩也能搞出满足需求的结果。先不说现在 Hy3 在 WordBuddy 里免费了,他就算收费也比 DeepSeek V4 Flash 便宜呀。
我的结论:DeepSeek 暂且出局,主力先切到 Hy3 和 Gemini 3.7 Flash。
感觉 DeepSeek 未来要么再搞个低价模型,要么出订阅套餐,不然大模型 API 性价比在 Agent 工具领域完全没竞争力。很多日常任务其实不需要 AI 那么聪明,只需要一个智商合格、够快够便宜的模型。反正我现在已经把主力切到 Hy3 和 Gemini 3.7 Flash 了,这俩搞不定的任务晚上交个打折的GLM5.2和Kmi-K3,实在搞不定的任务还有claude-opus-4-8和GPT-5.6呢是不。


Huo
2026-08-17 23:37
哈哈 观点一致 准备寻找新的替代品
face
2026-08-17 23:16
刚才登了一阵子,一看3刀不见了。哎呀,快比我自己手搓成本还高了。