ESC
AI 1 分钟阅读

为什么整个行业没有为 DeepSeek 4.1 Flash 而疯狂?

作者分享 DeepSeek 4.1 Flash 的实际使用体验:每月 10 美元订阅下几乎无限量使用,KV cache 较 V1 压缩约 437 倍,全天编码会话成本可控制在 1 美元以内。作者认为现有模型已足够胜任无人值守任务,仅在关键任务时调用 Opus 5.5 做代码审查,低成本正在改变开发者工作方式。

来源:Hacker News

诚然,他们“偷”了 Claude 的训练数据,而 Anthropic 也是从别人那里“偷”来的。我不打算卷入这场数据归属权的争论,因为大多数开发者并不这么想。他们只是想把钱花在刀刃上,追求最大性价比。

如今的模型已经足够胜任高质量的无人值守任务。一味追逐最新最强是很愚蠢的。看到新的 Fable 能力固然有趣,但如果相信 LLM 有意识的话,我们丢给它们的任务往往显得荒谬(甚至可以说是侮辱性的)。这就像让一位数学博士去整理你桌面上的文件。

在每月 10 美元的 OpenCode Go 订阅下,DeepSeek 基本上可以无限使用。这彻底改变了我的开发方式。现在启动一些不用动脑的任务,或者做探索性的 UI 猴子测试,都毫无心理负担。当然,尽管放手让它整理桌面文件,费用是 0.003 美元而不是 1 美元。我的单次会话预期成本很少超过 1 美元。我尽量让会话保持紧凑,但有时会持续大半天。

我甚至在复杂的规划和研究工作中也依赖 4.1 Flash。对于偶尔出现的关键任务,我有时会请 Opus 5.5 做最终代码审查,它能发现一些边缘情况,然后再让 DeepSeek 执行修复。即使我调用 Opus 或 GLM(后者似乎和 DeepSeek 喝的是同一碗“中国迷魂汤”),重点也不在于质量和能力,而是让新的视角来审视问题。

与 V1 模型相比,DeepSeek 将 KV cache 压缩了约 437 倍。在 GPU 显存中保存这些 cache 是运行长时间编码会话最大的成本之一。这正是我的全天候会话能保持在 1 美元以内的原因。

这对环境肯定也更有利。使用 Claude 几乎让人感觉浪费——不仅仅是在成本上:得益于缓存机制,DeepSeek 的水电消耗必然更少。这种缓存魔法也正是 Opus 5.5 悄悄实现自身能效提升的方式。