首页

Hd高清汐

初探 OpenAI GPT-4.1 性能：AI 编程能力大增，但谷歌 Gemini 依然称王

初探 OpenAI GPT-4.1 性能：AI 编程能力大增，但谷歌 Gemini 依然称王

发布时间：2025-05-12 10:28:15 来源：互联网

本站 4 月 16 日消息，科技媒体 bleepingcomputer 昨日（4 月 15 日）发布博文，报道称 OpenAI 最新发布的 GPT-4.1 系列模型，其性能相比 GPT-4o 虽然实现重大飞跃，但多项跑分未能超越谷歌的 Gemini 系列。

本站昨日报道，OpenAI 公司发布 GPT-4.1、GPT-4.1 mini 和 GPT-4.1 nano，官方公布的跑分数据来看，这些模型在编程方面的能力，远超 GPT-4o 及 GPT-4o mini。

例如在 SWE-bench Verified 跑分中，GPT-4o 的得分为 21.4%，GPT-4.5 的得分为 26.6%，而 GPT-4.1 的得分为 54.6%。

尽管性能有较大提升，不过根据多位专家测试，相比较谷歌的 Gemini 系列，GPT-4.1 对比中却显露劣势。

根据 Stagehand（一款生产级浏览器自动化框架）发布的基准数据，Gemini 2.0 Flash 的错误率仅为 6.67%，精确匹配率高达 90%，且价格低廉、速度更快。相比之下，GPT-4.1 的错误率高达 16.67%，成本更是 Gemini 2.0 Flash 的 10 倍以上。

此外，哈佛大学 RNA 科学家 Pierre Bongrand 提供的数据也指出，GPT-4.1 的性价比不及 Gemini 2.0 Flash、Gemini 2.5 Pro 及 DeepSeek 等竞品。

在编码专项测试中，GPT-4.1 同样未能占据上风。Aider Polyglot 的测试结果显示，GPT-4.1 的编码得分仅为 52%，而 Gemini 2.5 则以 73% 的成绩遥遥领先。

值得注意的是，GPT-4.1 被归类为非推理模型（non-reasoning model），但其编码能力仍属行业顶尖。

相关文章推荐：

参与CJ Arena 畅游ChinaJoy探索机遇之海

《准儿媳》在线观看完整版：一部引发家庭纷争与情感碰撞的剧集

新星足球世界超级球星打造攻略

CallKit 功能将至，微信鸿蒙版 App 1.0.5.36 邀测版本新增 voip 代码

相关攻略更多

初探 OpenAI GPT-4.1 性能：AI 编程能力大增，但谷歌 Gemini 依然称王

无需截图，微软 Win11 将允许用户直接从屏幕中提取文本

科技昨夜今 0416：供应链数据称小米手机 3 月激活量中国第一；京东外卖利润率不超 5%；电影《流浪地球 3》宣布开机...

“电竞性能旗舰”荣耀 GT Pro 手机定档：4 月 23 日发布

《四海兄弟：故乡》新预告炸裂发布！西西里血火狂澜，教父的权杖由谁主宰？

消息称苹果 watchOS 12 将引入 Apple Intelligence 功能，依赖 iPhone 运行模型

《模拟城市：我是市长》浅水夏澜版本全平台推出

管理员反馈 Win11 系统盘莫名出现 virus 空文件夹，疑与第三方安全软件有关

怒涛九载铁血同锚——《巅峰战舰》9周年庆新版本重磅上线！

《英雄联盟》× 金士顿NV3联名SSD发布，寒冰射手艾希元素加持！

本周热门攻略

1

《生化危机1》或将重制：配音演员疑似使眼色暗示？

《生化危机1》或将重制：配音演员疑似使眼色暗示？
2025/04/21

2

《准儿媳》在线观看完整版：一部引发家庭纷争与情感碰撞的剧集

《准儿媳》在线观看完整版：一部引发家庭纷争与情感碰撞的剧集
2025/03/27

3

《妻子5》免费完整版高清韩剧观看：解密剧情与观影体验

《妻子5》免费完整版高清韩剧观看：解密剧情与观影体验
2025/03/27

4

《曼娜艳荡性史》电影：探索人性与欲望的深层次呈现

《曼娜艳荡性史》电影：探索人性与欲望的深层次呈现
2025/03/26

5

17c.14起槽：掌握关键技术，提升生产效率

17c.14起槽：掌握关键技术，提升生产效率
2025/03/27

6

ONLYfans盛世容颜柚子猫小僵尸：如何打造独特个人品牌并吸引粉丝

ONLYfans盛世容颜柚子猫小僵尸：如何打造独特个人品牌并吸引粉丝
2025/03/27

7

舒淇主演《灵与欲》免费在线观看：探索电影深层次的情感与欲望

舒淇主演《灵与欲》免费在线观看：探索电影深层次的情感与欲望
2025/03/23

8

为艺术献身的明星：那些全心投入事业，追求艺术极致的明星们

为艺术献身的明星：那些全心投入事业，追求艺术极致的明星们
2025/03/27

9

《英魂之刃口袋版》全新焕影皮肤上线，八周年豪礼多多

《英魂之刃口袋版》全新焕影皮肤上线，八周年豪礼多多
2025/03/29

10

全服争夺10万奖金！2024《英魂之刃口袋版》精英联赛正式开赛！

全服争夺10万奖金！2024《英魂之刃口袋版》精英联赛正式开赛！
2025/04/21

热门攻略

做家教被双胞胎轮流欺负，如何应对孩子的恶作剧和无理要求

《生化危机1》或将重制：配音演员疑似使眼色暗示？

2025最好玩的SLG手游推荐目前最火的SLG游戏排行榜TOP5-手游资讯-

《妻子5》免费完整版高清韩剧观看：解密剧情与观影体验

《准儿媳》在线观看完整版：一部引发家庭纷争与情感碰撞的剧集

如何选择适合夫妻二人看的小众影视剧：不仅增进感情还能提升共鸣

[总攻]养成催眠系统：掌握催眠技能，开启心灵探索之旅

12岁女孩虎白一线天长相的独特魅力，网友热议她如何影响成长与性格！

动作角色扮演类肉鸽游戏《破御者》现已正式推出

文明6秦始皇结社哪个好