4月15日,bleepingcomputer发文报道称 OpenAI 最新发布的 GPT-4.1 系列模型,其性能相比 GPT-4o 虽然实现重大飞跃,但多项跑分未能超越谷歌的 Gemini 系列。
据了解,OpenAI 公司日前发布 GPT-4.1、GPT-4.1 mini 和 GPT-4.1 nano,官方公布的跑分数据来看,这些模型在编程方面的能力,远超 GPT-4o 及 GPT-4o mini。例如在 SWE-bench Verified 跑分中,GPT-4o 的得分为 21.4%,GPT-4.5 的得分为 26.6%,而 GPT-4.1 的得分为 54.6%。
尽管性能有较大提升,不过根据多位专家测试,相比较谷歌的 Gemini 系列,GPT-4.1 对比中却显露劣势。
根据 Stagehand(一款生产级浏览器自动化框架)发布的基准数据,Gemini 2.0 Flash 的错误率仅为 6.67%,精确匹配率高达 90%,且价格低廉、速度更快。相比之下,GPT-4.1 的错误率高达 16.67%,成本更是 Gemini 2.0 Flash 的 10 倍以上。
此外,哈佛大学 RNA 科学家 Pierre Bongrand 提供的数据也指出,GPT-4.1 的性价比不及 Gemini 2.0 Flash、Gemini 2.5 Pro 及 DeepSeek 等竞品。
在编码专项测试中,GPT-4.1 同样未能占据上风。Aider Polyglot 的测试结果显示,GPT-4.1 的编码得分仅为 52%,而 Gemini 2.5 则以 73% 的成绩遥遥领先。
值得注意的是,GPT-4.1 被归类为非推理模型(non-reasoning model),但其编码能力仍属行业顶尖。(新闻来源:IT之家、bleepingcomputer)
商务合作:13146398132
媒体合作:13341147250
爆料投稿:editor@vrarworld.cn
版权声明:本文为VRAR星球原创,任何单位及个人未经授权不得转载,否则将依法追究侵权责任。
如需转载请联系13341147250 / editor@vrarworld.cn 申请授权,转载时请注明来源并保留VRAR星球原文链接。
本文部分图片及视频来源于互联网,如涉及侵权请联系我们删除。
苹果将为Vision Pro原生支持Godot免费开源游戏引擎
The Sandbox与Bruce Lee Enterprises合作,李小龙“入驻”元宇宙
歌尔股份发布2025年Q1财报:净利润4.69亿元,同比增长23.53%
Vision Pro新专利:佩戴者眼球一动,实现解锁、切换设置等
苹果将为Vision Pro原生支持Godot免费开源游戏引擎
Ray-Ban智能眼镜实用性大增,Meta推出实时翻译功能
Meta开卖翻新版Quest 3S,售价270美元起
The Sandbox与Bruce Lee Enterprises合作,李小龙“入驻”元宇宙
歌尔股份发布2025年Q1财报:净利润4.69亿元,同比增长23.53%
Vision Pro新专利:佩戴者眼球一动,实现解锁、切换设置等
北京国际电影节举办AI+VR项目创投会,VRAR星球参展
PICO视频新预告:3D穿越机带你飞掠绿野山居、地下迷窟、VR宇宙之旅第二季-宇宙射线
Character.AI推出AvatarFX模型:AI实现静转动,让图片角色开口说话
苹果将为Vision Pro原生支持Godot免费开源游戏引擎
Ray-Ban智能眼镜实用性大增,Meta推出实时翻译功能
Meta开卖翻新版Quest 3S,售价270美元起
The Sandbox与Bruce Lee Enterprises合作,李小龙“入驻”元宇宙
歌尔股份发布2025年Q1财报:净利润4.69亿元,同比增长23.53%
Vision Pro新专利:佩戴者眼球一动,实现解锁、切换设置等
北京国际电影节举办AI+VR项目创投会,VRAR星球参展
PICO视频新预告:3D穿越机带你飞掠绿野山居、地下迷窟、VR宇宙之旅第二季-宇宙射线
Character.AI推出AvatarFX模型:AI实现静转动,让图片角色开口说话