从 DeepSeek-TUI 到 CodeWhale,我终端的 AI 工作流上个月换了血
上个月底到这两天,发生了几件事,直接把我用了半年的终端 AI 工作流给换了:
💡 前情提要
- 2026-07-31,DeepSeek V4-Flash 正式版 API 公测,Agent 能力大改
- 2026-08-01,OpenCode CEO 说 V4 Flash 上线后使用量单日涨了 30%
- 2026-08-13 前后,CodeWhale 发到 0.9.7
- 今天,DeepSeek 官方"近期将上调 API 定价、涨幅较大"的公告还在文档里挂着
这篇文章就是把这几条线串起来讲清楚:模型、工具、套餐,各自该用谁。
先说 V4 Flash,它已经不是预览版那个它了
4 月 24 日 DeepSeek 发 V4 预览版(Pro + Flash 两个变体)的时候,我试用完就把 Flash 扔了——Agent 能力当时是真的拉。那会儿它在 codewhale 里的表现,属于"写写补丁还行,让它自己跑完整任务就露馅"的水平。
但 7 月 31 日的 V4-Flash-0731 正式版是另一回事。官方给的几个数字:
| 基准 | 预览版 | V4-Flash-0731 | 对比对象 |
|---|---|---|---|
| DeepSWE | 7.3 | 54.4 | 直接起飞 |
| Terminal Bench 2.1 | — | 82.7 | 没给对手留面子 |
| Agent 终极测试 | — | 25.2 | Opus-4.8 = 25.7 |
| Artificial Analysis 智能指数 | 40 | 50 | GPT-5.6 Luna = 51 |
模型参数没怎么加(284B 总参数 / 13B 激活,MoE,1M 上下文,384K 输出,MIT 开源),但跑分全面反超了 V4-Pro 预览版。这波是纯工程优化,不是堆参数。
跑分是跑分,关键是实测。我这半个月的体感:长任务不再"说着说着就忘上下文"了,改代码、跑测试、修报错这条链路基本能自己走完。配合 1M 上下文,丢整个仓库进去也能兜住。
真正让我决定留下它的是价格结构:
输入 $0.14 / 1M tokens
输出 $0.28 / 1M tokens
缓存读取 $0.0028 / 1M tokens ← 关键在这Coding Agent 的使用模式是每轮都背全量项目上下文,输入 token 是大头,而缓存命中后成本直接砍 50 倍。有人实测单次请求带 15.6 万~19 万输入 token,最终费用 \(0.0006~\)0.0014。作为对比,GPT-5.6 Luna 7 月 31 日降价 80% 之后单任务成本 $0.05,还是 V4 Flash 的 1.7 倍。
OpenCode 官方数据页(今天 8 月 14 日拉的数据)说明了一切:
| 指标 | 数值 |
|---|---|
| 近两月 token 用量 | 168T,较 6 月 20 日 +413% |
| OpenCode Go 独立用户 | 2.3M |
| 已完成会话 | 12,096,796 |
| Token 份额 | 70%,用量榜 #01 |
| 平均单会话成本 | $0.13 |
| 输入 token 缓存命中率 | 96% |
第二名 deepseek-v4-pro 是 4.7T,差距一个数量级。这不是"便宜所以用的人多",这是"便宜且真的能打"。
DeepSeek 官方文档已经挂出"近期整体上调 API 定价、预计涨幅较大"的公告。当前这个价格窗口,我判断不会持续太久。
CodeWhale:那条鲸鱼,前身叫 DeepSeek-TUI
CodeWhale(GitHub: Hmbown/CodeWhale)是独立开发者 Hunter Bown 用 Rust 写的终端原生 Coding Agent,MIT 协议,GitHub 上已经 29.3K Star(6 月之前它还叫 DeepSeek-TUI)。社区给的绰号是"DeepSeek 版 Claude Code"。
它跟 Claude Code / Codex CLI 是同一形态,但设计取向完全反过来:开源开放权重模型优先。V4 和 MiMo 是一等公民,DeepSeek first,这不是宣传语,是它整个工具链的默认假设。
它的底子:
- 工具面:文件、Shell、Git、Web、MCP、RLM(递归语言模型会话)、子 Agent,全部带 schema
- 安全边界:三档操作模式(只读调查 / 审批 / 执行),审批门 + 沙箱隔离 + side-git 快照,出问题
/restore一条命令回滚 - Skills 系统:兼容 Claude Code / Cursor 的指令复用,迁移成本 ≈ 0
- 版本节奏:0.9.0 换了新的水下交互系统(对,就是它自己的那个 UI 主题),Fleet 多机编排、Workflow、路由、计费全部重做;0.9.3 是 8 月 8 日前后发的
安装很朴素:
npm install -g codewhale
codewhale doctor # 自检# 多机并行干活是这么用的
codewhale fleet init
codewhale fleet run tasks.json --max-workers 4OpenCode Go:一根 Key,$10 包月
CodeWhale 是鲸鱼,OpenCode Go 是它游的那片海。OpenCode 本身是开源 Coding Agent(GitHub 195K Star),终端 / 桌面 / IDE 全覆盖,免费,自带两套模型服务:Zen(按量付费)和 Go(包月)。
Go 的价格:首月 \(5,之后 \)10/月。截至 2026 年 8 月 6 日的模型清单:
| 模型 | 说明 |
|---|---|
deepseek-v4-flash |
默认主力,日常就它了 |
qwen3.8-max |
月折算额度 $15,留给疑难问题 |
kimi-k3 |
Moonshot 旗舰 |
glm-5.2 |
智谱 |
minimax-m3 |
MiniMax |
限额折算:5 小时 \(12 / 每周 \)30 / 每月 $60,模型不同额度不同。DeepSeek 线路走 Zero Data Retention 协议(当前到 2026-08-31)。
# TUI 里两条命令
/connect → 选 OpenCode Go,粘贴 API Key
/models → 选 opencode-go/deepseek-v4-flash关键点:这根 Key 不锁死在 OpenCode 里,可以喂给任何支持自定义 Provider 的 Agent。我就是这么干的——CodeWhale 里挂 OpenCode Go 的 Key,模型走 opencode-go/deepseek-v4-flash,工具和模型完全解耦。
订阅入口在这:
所以,8 月 14 日这个时间点的结论
- 模型层面:V4-Flash-0731 把开源模型在 Agent 场景的上限抬到了 Opus 同档,价格是它的几十分之一。这不是"够用的便宜货",是 OpenCode Go 上 70% 流量、用量榜 #01 的默认答案。
- 工具层面:CodeWhale 是当前把 DeepSeek 系模型体验做的最完整的终端 Agent,审批 + 沙箱 + side-git 这套安全机制是真在解决问题。
- 价格层面:DeepSeek 官方 API 涨价公告已经挂了几天,$10 包月 + 缓存命中 96% 的这个窗口,我不确定还能开多久。
- 8 月 13 日 V4-Pro-0813 也 GA 了,HLE / Terminal Bench / Cybergym / DeepSWE 全线超过 Opus 4.8、逼近 Fable 5,DeepSeek Harness 也开源了——DeepSeek 自家 Agent 生态正在补齐,这赛道下半年的戏还多。
工具装起来,Key 填进去,/models 选 deepseek-v4-flash,剩下的交给鲸鱼。
暂无评论
还没有评论,快来抢沙发吧!