模型与实验室 3.0 · 值得看 2026-07-28 · 文章

Why do OpenAI's GPT-2 weights beat mine? (1) Intro

Giles Thomas 用可复现实验把一个常见错觉钉住:预训练 test loss 更好,不等于指令微调后更好用在 Alpaca 类 IFT eval 上,OpenAI GPT-2 small 原权重稳定排在自训模型前面,即使部分自训模型 cross-entropy test loss 更低猜测差异在 IFT 损失景观上的起点位置

打开原文回到归档

Why do OpenAI's GPT-2 weights beat mine? (1) Intro

中文导读

Giles Thomas 用可复现实验把一个常见错觉钉住:预训练 test loss 更好,不等于指令微调后更好用。在 Alpaca 类 IFT eval 上,OpenAI GPT-2 small 原权重稳定排在自训模型前面,即使部分自训模型 cross-entropy test loss 更低。猜测差异在 IFT 损失景观上的起点位置。

为什么值得关注

预训练 test loss 更好 ≠ 指令微调后更好用:GPT-2 原权重指令遵循仍赢

原文摘录

Why do OpenAI's GPT

作者: Giles Thomas
发布时间: 2026-07-29T15:30:00+0000
原文链接: https://www.gilesthomas.com/2026/07/why-do-openai-gpt2-weights-beat-mine-1-intro

Giles' blog

https://x.com/gpjt https://bsky.app/profile/gilesthomas.com https://github.com/gpjt https://huggingface.co/gpjt https://www.gilesthomas.com/feed/rss.xml

Writing the post that I wished I'd found when I started learning whatever it was...

About

Contact

Archives

Categories

Blogroll

[... 原文已截断,完整内容见链接 ...]