Wagtail 团队挑战整个九月只用 GLM 5.3 Flash 这一个高效开源模型写代码,累计 2B token(AgentsView 统计):前半个月成功坚持单模型,花费 $68(约 4kWh 能耗/365 克碳排放);后半月经受不住切换,1B token 流向其他模型两个意外:一是 vibe coding 的代价MCP server 原型选错模型,一夜烧掉 450M token/$150/5kWh,虽然原型本身效果不错,但作者估计换个模型+多花点功夫能省 5 倍成本;二是推理供应商的基础设施可用性问题这是一份少见的开源模型单人月度实战成本记录
AI 编程
3.0 · 值得看
One month coding with GLM 5.3 Flash
Wagtail 团队挑战整个九月只用 GLM 5.3 Flash 这一个高效开源模型写代码,累计 2B token(AgentsView 统计):前半个月成功坚持单模型,花费 $68(约 4kWh 能耗/365 克碳排放);后半月经受不住切换,1B token 流向其他模型两个意外:一是 vibe coding 的代价MCP server 原型选错模型,一夜烧掉 450M token/$150/5kWh,虽然原型本身效果不错,但作者估计换个模型+多花点功夫能省 5 倍成本;二是推理供应商的基础设施可用性问题这是一份少见的开源模型单人月度实战成本记录