RTK reports huge token savings, but our cost benchmarks disagree
Source: https://quesma.com/blog/does-rtk-make-ai-coding-cheaper/
Authors: Bartosz Kotrys, Jacek Migdal
Published: 2026-09-11
中文摘要
Quesma 在 Terminal-Bench 2.1 上对 RTK(Rust Token Killer,79k stars,宣称省 60% Claude Code token)做了一轮真实账单成本复测:Claude Code + Fable 5.0 与 OpenCode + DeepSeek V4 Pro 各跑一遍,每任务 5 次基线加 5 次 RTK,1740 次尝试、1500 美元账单。RTK 自报节省 3.49 亿 token(89%),但 RTK 的『rtk gain』口径是『原始输出减过滤输出的字节除以 4』,与计费 token 不是一回事;train-fasttext 任务里两次 head -1 train.txt 命令就被 RTK 记成 1.2 亿 token 节省,两次合计占整个节省计数的 69%,那两条命令本来就不会返回全文件。JetBrains SkillsBench 上的独立复测同样没看到节省。
Obsidian 证据摘要
来源:Content/Adapted/2026-09-12-X长帖-RTK-省token不省钱-1740次实测.md
"「省 60% token」的 RTK 被 Quesma 拉到 Terminal-Bench 2.1 上用真实账单测了一轮:Claude Code + Fable 5.0 和 OpenCode + DeepSeek V4 Pro 各跑一遍,每任务 5 次基线加 5 次 RTK,共 1740 次尝试、1500 多美元。矛盾出在记账方式:RTK 自报这次对比省了 3.49 亿 token(89%),但 rtk gain 的口径是原始输出减过滤输出的字节除以 4,和计费 token 是两回事。"