3个重点讲清楚GPT4.1:OpenAI 的新一代基础模型
公众号: AGENT橘
发布时间: 1970-01-01 08:33:45
原文链接: https://mp.weixin.qq.com/s?__biz=MzkwMzY5NzU2Nw==&mid=2247486082&idx=1&sn=906022a11a5856d922c98f3f197bfa97
OpenAI 昨晚重磅发布 GPT4.1 系列。
这个版本号非常迷惑,大家也是陷入了沉思。
为什么已经发了 GPT4.5,现在才发 GPT4.1?
其实你只需要关注这三个重点就够了:
1.GPT4.1 替换的是 4o,又便宜又好用
相比4o,4.1的图像理解更好,代码能力显著更强,上下文大升级到1M,但价格却便宜了 20%,可以说是4o的完美替代。
所以说 GPT4.1 是 OpenAI 的新一代基础模型。
2.模型具备 1M 超长上下文,而且性能很不错
虽然很多模型都宣称自己支持 1M 上下文。
但是很多模型在用户实测的时候,性能拉胯。
GPT4.1 在这方面做的很不错,在大海捞针(双针)实验中,断崖领先,在超长文本时,依然能保持不错的性能。
令人惊喜的是,比GPT4.1便宜5倍的GPT4.1 mini的性能也非常不错,可以用来做超长文本任务的最佳模型
3\. GPT4.1 的代码能力超越 GPT 4.5,但不如 o1 这样的推理模型
从衡量代码能力的 Aider 指标来看, GPT4.1 是 52%,也就是 DeepSeek V3 的水平。
通过 API 实测推理能力,一会儿说 4.10大,一会儿说4.5大,看起来脑子有点糊涂。
最后总结一下三个要点:
- GPT4.1 替换的是 4o,又便宜又好用(在 OpenAI 体系内)
- 1M 超长上下文,而且性能很不错,4.1 nano 和 mini 超级便宜,适合做量大的长文本任务
- GPT 4.1 的代码能力超越 GPT 4.5,但不如 o1 这样的推理模型
大聪明整理的这张图也很清晰: