产品与商业 4.0 · 优秀 2026-08-30 · 文章

You have to beat the models at something

Sean Goedecke 8月30日文章正面回答模型会写代码了,工程师还有什么用不是列技能清单,而是给两个他认为中期最稳的护城河:(1) codebase 熟悉度前沿 coding agent 几乎不再犯低级逻辑错误,但会高频犯两类错:ignorance(不知道仓里已经有现成模块在错误系统里改不符合团队风格)和 paranoia(给不可能跑偏的字段写三重校验给 CLI 工具加冗余 fallback),这两类只有真正熟悉代码的人才能抓到,而且你必须敢拍桌说这设计就是烂...

打开原文回到归档

You have to beat the models at something

中文导读

Sean Goedecke 8月30日文章正面回答模型会写代码了,工程师还有什么用不是列技能清单,而是给两个他认为中期最稳的护城河:(1) codebase 熟悉度前沿 coding agent 几乎不再犯低级逻辑错误,但会高频犯两类错:ignorance(不知道仓里已经有现成模块在错误系统里改不符合团队风格)和 paranoia(给不可能跑偏的字段写三重校验给 CLI 工具加冗余 fallback),这两类只有真正熟悉代码的人才能抓到,而且你必须敢拍桌说这设计就是烂;agent 之间互相 review 只会更糟,因为同模型会重复同样的错,不同模型也共享同一类结构性偏见(RL 把挑刺训进了 critic,反过来加剧 paranoid slop)(2) 技术沟通:好写作在 RLHF 里几乎无法验证(不像代码可以自动跑测),加上 labs 把几乎所有算力压在 capability 而非 communication 上,结果是 Claudish 那种内部 CoT 直译出来的半截英语正在反向污染人写的技术内容,读者的 AI-blind 又在加速形成结论:被裁最快的写法是meat proxy(只是把请求复制粘贴进 agent),2026 下半年到 2027 的活法是找到模型做不好的事 + 把经验杠杆用进去

为什么值得关注

工程师在 agent 时代的护城河不是技能清单,而是 codebase 熟悉度 + 敢拍桌 + 能写出 RLHF 验证不了的好文字

关键信息

English Summary

Sean Goedecke's answer to 'models can code, what's left for engineers?' two moats, not a skills checklist. First, codebase familiarity: frontier coding agents no longer make low-level logic errors but make two recurring classes ignorance (missing that a module exists, changing in the wrong system, violating team style) and paranoia (triple-validating impossible-to-misfield fields, adding redundant fallbacks to CLI tools). These are only catchable by people who really know the code, and you have to be willing to say 'this design is bad' on the record. Agents reviewing agents makes it worse same models repeat the same mistakes, and different models share the same structural bias (RL trains critic-skeptic, which amplifies paranoid slop)....

Obsidian Notes

  • 来源:2026-09-01 AK-RSS Digest(89源精选)/ 每日综合摘要 / 调研 / DeepResearch 视所属主题而定
  • 内容由 opencli 拉取原始来源 + Obsidian 笔记交叉核对生成。
  • 中文导读与价值判断均锚定原文摘要与作者;未补充原文章节之外的细节。
  • 抓取时间戳:2026-09-01T23:30+08:00。