
这两天 AI 圈被一句话刷屏:"梁圣归来"。不是新番,是 DeepSeek 又降价了——而且这次连带着把 V4.1 Flash 这个新模型也端出来了。先把结论丢前面:9 月 10 日中午 12 点起,Flash 系列缓存命中价回到 0.02 元/百万 token,降幅 60%,调用量最大的 Flash 模型直接变回"全球最低价"那一档。
社区的梗。DeepSeek 创始人梁文锋,降价、性能好、便宜的时候被尊称"梁圣""梁祖";8 月那波涨价,又被人叫"梁子""小梁"。这回 V4.1 Flash 一出,梁圣又回来了。一句话总结这半年定价史:像心电图,也像网友说的"滑动变阻器",左右横滑随心所欲。
- 输入·缓存命中:0.05 → 0.02(降 60%)
- 输入·缓存未命中:1.5 → 1.0(降 33%)
- 输出:4.5 → 4.0(降 11%)
- 高峰时段(工作日 9-12、14-18 点)价格翻倍。
注意:降得最狠的是缓存命中这一项,而这恰恰是你账单里占比最大的一块——实际业务里,系统提示词、历史对话这些"公共前缀"经常能占到输入九成以上。所以这次降价,跑量的人最爽,RAG 知识库、多轮对话类应用成本能直接砍掉一大截。
9 月 8 日晚开启中间版本内测,模型名 `deepseek-v4.1-flash-expires-on-0910`(9 月 10 日到期下线)。官方口径:新架构、原生多模态、更强更快更便宜。社区实测输出峰值冲到 507 tokens/秒,多人平均 300+。而且内测期计费跟老 V4 Flash 一样,每账号限流 20 并发——等于白嫖一波新模型。
想试 V4.1 Flash:在 WorkBuddy 的自定义模型里,把模型名改成 `deepseek-v4.1-flash-expires-on-0910`(base_url 不用动),就能直接调。等 9 月 10 日正式调价后,把常用模型的"系统提示词"固定放最前面、少改前缀,命中率上去了账单更好看。我们这套每日发文脚本就是这么抠缓存的。
免费额度和价格会变,今天核实的数字以官网实时为准;而且这次并非全系同降,部分系列没同步调价,别看到"降价"就以为所有模型都便宜了。
你平时用 DeepSeek 跑啥任务?评论区说出来,我帮你算算怎么靠缓存命中把账单砍六成。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。