10 美元/月,4 倍用量:DeepSeek V4.1 Flash 上架 OpenCode Go,限时加量到 9 月 20 日

作者 lucy · 2026-09-15

📡 来源:DeepSeek 官方公告、OpenCode Go 官方文档,2026 年 9 月,来自于 deepseek.com / opencode.ai

先说结论

如果你想用一个便宜到离谱的价格跑编程 Agent,现在有个时间窗口:

OpenCode Go(每月 $10)订阅里的 DeepSeek V4.1 Flash,目前享受限时 4 倍用量,活动 9 月 20 日结束。

平时这个模型在 Go 里只有 $15 的月度额度,活动期间按 $60 打。叠加上 DeepSeek 那个近乎白送的缓存价格(Off-Peak 时段每 1M 缓存 token 只要 $0.003,约等于原价的 98% 折扣),$10 的订阅,一个月实际能跑大约 13 万次 Agent 请求

详细的go订阅教程参考我之前的一篇博客OpenCode Go 套餐订阅教程:用支付宝解锁 GLM-5.3-Flash等顶级编程模型

传送门(我的邀请链接,通过它订阅可以支持我继续写这类内容):

👉 https://opencode.ai/go?ref=3ESBZG6BRN

下面展开讲讲这个模型和这个套餐到底是怎么回事。

DeepSeek V4.1 Flash:一次架构层面的换血

9 月 10 日,DeepSeek(深度求索)发布了 V4.1-Flash。注意,这不是 V4 Flash 的小版本迭代,而是新架构家族的第一个正式成员

几个关键数字:

项目 V4.1 Flash
总参数量 552B(MoE 架构)
架构 全新的 Causal Encoder-Decoder
输入激活参数 仅 8B
输出激活参数 16B
多模态 原生视觉理解
上下文 长上下文,配合超小 KV Cache

这里最值得说的是那个非对称激活设计:处理输入只激活 8B 参数,生成输出才激活 16B。传统 Transformer 每处理一个 token 都要跑整个激活集,而 Causal Encoder-Decoder 把”读”和”写”拆开了——读的时候用小脑就够,写的时候才上大力。结果是单请求的算力成本大幅下降,推理速度快了一大截。

KV Cache 压缩才是降价的底牌

对于跑编程 Agent 的人来说,成本大头往往不是模型本身,而是缓存命中费。Agent 每轮对话都会把整个上下文重新喂进去,缓存读取费用在重度使用时能占掉账单的一半以上。

V4.1 Flash 把这件事直接从根上解决了——相比上一代,KV Cache 只需要:

  • 1/4 的 HBM 显存
  • 1/8 的 SSD 存储

缓存变小,缓存命中费跟着暴跌。这才是”Agent 时代模型该怎么设计”的正确思路:不单纯堆跑分,而是把 Agent 的真实成本结构当成设计约束。

性能:小模型打了旗舰

按 DeepSeek 官方和多方测试的说法,V4.1 Flash 在编程、网络安全、Agent 任务上超过了自家的旗舰 V4 Pro。SCMP 报道中引用的 Terminal-Bench 2.1(真实计算环境任务测试)成绩:

模型 Terminal-Bench 2.1
DeepSeek V4.1 Flash 90.6
OpenAI GPT-5.6 Sol 88.8
Kimi K3 88.3
DeepSeek V4 Pro 87.9

一个总参数 552B、激活仅 8-16B 的”小”模型,把自家旗舰和一众闭源模型都比了下去。DeepSeek 的态度也很直白:V4 Pro 进入退役流程。从 9 月 14 日起,所有 `deepseek-v4-pro` 的请求都直接路由到 V4.1 Flash,按 Flash 的价格计费,直到 V4.1 Pro 发布为止。

如果你之前是 V4 Pro 用户,不用迁移,账单还会变小。

OpenCode Go:$10/月的开源模型批发市场

说回套餐本身。OpenCode Go 是 OpenCode 推出的每月 10 美元的开源编程模型订阅。逻辑很简单:

  1. 开源模型现在强到什么程度大家都看到了,编程任务上已经摸到专有模型的尾巴;
  2. 但各家提供商的服务质量参差不齐,自己到处找便宜又稳定的 API 是个体力活;
  3. OpenCode 干了脏活:测试了一组精选开源模型、和模型团队讨论最佳部署方式、和提供商谈批量折扣、跑基准测试,最后打包成一份”我们敢推荐”的列表,$10/月包圆

订阅后你会拿到一个 API 密钥,工作方式和 OpenCode 里的其他 provider 完全一样:TUI 里 `/connect` 选 OpenCode Go,粘贴密钥,`/models` 就能看到可用模型列表。目前列表里有 20 多个模型,包括 GLM-5.3、Kimi K3、Qwen3.8、MiniMax M3、Grok 4.6、GPT 5.6 Luna,以及这次的 DeepSeek 系列。

几个对开发者重要的细节:

  • 不锁定。Go 是完全可选的,你随时可以混用其他 provider。
  • 不限于 OpenCode 客户端。Claude Code、Codex 等编程 Agent 也能直接用(需要正确发送会话头)。
  • 隐私干净。DeepSeek 全系在 Go 里承诺不训练、0 天数据留存(ZDR 协议按月续签,当前有效期至 2026 年 9 月 30 日)。

算一笔账:4 倍加量到底值多少

OpenCode Go 的用量限制不是简单的”次数”,而是按每个模型的月度美元额度计算。DeepSeek V4.1 Flash 的常规月度额度是 $15——按官方的解释,这是因为 DeepSeek 的公开 API 价格本身已经很激进,OpenCode 没谈下更多折扣空间,所以给的额度比其他模型低。

而这次限时活动,把 V4.1 Flash 的额度直接放大 4 倍,等效 $60/月

V4.1 Flash 在 Go 里的价格(峰谷分时,Off-Peak 是峰值的一半):

时段 输入 /1M 输出 /1M 缓存读取 /1M
Peak $0.30 $1.20 $0.006
Off-Peak $0.15 $0.60 $0.003

Peak 时段为周一至周五的 01:00-04:00 和 06:00-10:00 UTC(也就是北京时间 9:00-12:00 和 14:00-18:00 的部分时段)。注意这个设计对中国用户不太友好——北京的工作时间正好覆盖 Peak。好在周末全天 Off-Peak。

按 Go 官方给的典型请求画像(每次请求 410 输入 token + 71,300 缓存 token + 310 输出 token)算一笔账:

  • Off-Peak 单次请求成本约 $0.00046
  • $60 额度 ÷ $0.00046 ≈ 每月 13 万次请求
  • 即便全走 Peak 价格,也有 6.5 万次以上

对比一下:同样的用量直接按 DeepSeek 官方 API 价格买,一个月轻松花掉几十上百美元。这就是”批量折扣 + 限时加量”叠加后的效果——$10 的订阅费,换到的是六七十美元级别的官方牌价用量。

顺带一提,Go 的额度还有个弹性设计:如果你的 Zen 余额里还有积分,可以在控制台开启”使用余额”,额度用完后自动回退扣余额,而不是硬生拦截请求。重度用户不会被半夜 quota 报错气醒。

时间窗口:9 月 20 日

这次 4 倍加量是限时活动,9 月 20 日结束。而且据我观察,OpenCode 的加量活动是一周一续的——上一轮到期后先是延了一周,官方的态度明显是”在观察数据,随时可能收回”。V4 Flash 此前就经历过加量后缩水的操作(月度额度从 3 万多次请求砍到 3,800),所以别指望活动会一直续。

如果你本来就打算试试开源编程模型订阅,现在是最划算的入场时点。就算只是冲着 4 倍额度体验一个月 V4.1 Flash,$10 也不算什么试错成本。

还是这个链接:

👉 https://opencode.ai/go?ref=3ESBZG6BRN

最后说两句

DeepSeek 这代模型的思路我很认同:与其在跑分榜上卷 1 个点,不如把 Agent 场景的真实成本结构(缓存、长上下文、高并发小请求)当成架构设计的一等公民。Causal Encoder-Decoder + 超小 KV Cache,是”为 Agent 时代设计的模型”该有的样子。

OpenCode Go 则是在做另一件正确的事:把”找便宜稳定的开源模型 API”这件脏活产品化。$10/月、不锁定、隐私承诺清晰,对于预算敏感又要跑真实工作负载的独立开发者来说,是目前市面上最没脑子的选择之一。

活动 9 月 20 日截止,想薅的抓紧。


⚠️ 声明:本文相关内容仅供参考,实际效果因场景不同可能差异很大,请结合自身情况判断,谨慎参考。文中价格与活动信息以官方页面为准。

苏ICP备18039580号-2