模型与实验室 3.0 · 值得看 2026-06-23 · 文章

3个重点讲清楚GPT4.1:OpenAI 的新一代基础模型

3个重点讲清楚GPT4.1:OpenAI 的新一代基础模型 公众号: AGENT橘 发布时间: 1970-01-01 08:33:45 原文链接: OpenAI 昨晚重磅发布 GPT4.1 系列。 这个版本号非常迷惑,大家也是陷入了沉思。 为什么已经发了 GPT4.5,现在才发 GPT4.1? 其实你只需要关注这三个重点就够了: 1.GPT4.1 替换的是 4o,又便宜又好用 相比4o,4.1的图像理解更好,代码能力显著更强,上下文大升级到1M,但价格却便宜了 20%,可以说是4o的完美替代。 所以说 GPT4.1 是 OpenAI 的新一代基础模型。 2.模型具备 1M 超长上下文,而且性能很不错 虽然很多模型都宣称自己支持 1M 上下文。 但是很多模型在用户实测的时候,性能拉胯。...

打开原文回到归档

3个重点讲清楚GPT4.1:OpenAI 的新一代基础模型

公众号: AGENT橘
发布时间: 1970-01-01 08:33:45
原文链接: https://mp.weixin.qq.com/s?__biz=MzkwMzY5NzU2Nw==&mid=2247486082&idx=1&sn=906022a11a5856d922c98f3f197bfa97

OpenAI 昨晚重磅发布 GPT4.1 系列。

这个版本号非常迷惑,大家也是陷入了沉思。

为什么已经发了 GPT4.5,现在才发 GPT4.1?

其实你只需要关注这三个重点就够了:

1.GPT4.1 替换的是 4o,又便宜又好用

相比4o,4.1的图像理解更好,代码能力显著更强,上下文大升级到1M,但价格却便宜了 20%,可以说是4o的完美替代。

所以说 GPT4.1 是 OpenAI 的新一代基础模型。

2.模型具备 1M 超长上下文,而且性能很不错

虽然很多模型都宣称自己支持 1M 上下文。

但是很多模型在用户实测的时候,性能拉胯。

GPT4.1 在这方面做的很不错,在大海捞针(双针)实验中,断崖领先,在超长文本时,依然能保持不错的性能。

令人惊喜的是,比GPT4.1便宜5倍的GPT4.1 mini的性能也非常不错,可以用来做超长文本任务的最佳模型

3\. GPT4.1 的代码能力超越 GPT 4.5,但不如 o1 这样的推理模型

从衡量代码能力的 Aider 指标来看, GPT4.1 是 52%,也就是 DeepSeek V3 的水平。

通过 API 实测推理能力,一会儿说 4.10大,一会儿说4.5大,看起来脑子有点糊涂。

最后总结一下三个要点:

  • GPT4.1 替换的是 4o,又便宜又好用(在 OpenAI 体系内)
  • 1M 超长上下文,而且性能很不错,4.1 nano 和 mini 超级便宜,适合做量大的长文本任务
  • GPT 4.1 的代码能力超越 GPT 4.5,但不如 o1 这样的推理模型

大聪明整理的这张图也很清晰: