日韩综合网-日韩综合网站-日韩综合一区-日韩综合在线视频-色涩网站-色涩网站在线观看

C114通信網  |  通信人家園

人工智能
2025/4/16 08:43

初探 OpenAI GPT-4.1 性能:AI 編程能力大增,但谷歌 Gemini 依然稱王

IT之家  故淵

科技媒體 bleepingcomputer 昨日(4 月 15 日)發布博文,報道稱 OpenAI 最新發布的 GPT-4.1 系列模型,其性能相比 GPT-4o 雖然實現重大飛躍,但多項跑分未能超越谷歌的 Gemini 系列。

IT之家昨日報道,OpenAI 公司發布 GPT-4.1、GPT-4.1 mini 和 GPT-4.1 nano,官方公布的跑分數據來看,這些模型在編程方面的能力,遠超 GPT-4o 及 GPT-4o mini。

例如在 SWE-bench Verified 跑分中,GPT-4o 的得分為 21.4%,GPT-4.5 的得分為 26.6%,而 GPT-4.1 的得分為 54.6%。

盡管性能有較大提升,不過根據多位專家測試,相比較谷歌的 Gemini 系列,GPT-4.1 對比中卻顯露劣勢。

根據 Stagehand(一款生產級瀏覽器自動化框架)發布的基準數據,Gemini 2.0 Flash 的錯誤率僅為 6.67%,精確匹配率高達 90%,且價格低廉、速度更快。相比之下,GPT-4.1 的錯誤率高達 16.67%,成本更是 Gemini 2.0 Flash 的 10 倍以上。

此外,哈佛大學 RNA 科學家 Pierre Bongrand 提供的數據也指出,GPT-4.1 的性價比不及 Gemini 2.0 Flash、Gemini 2.5 Pro 及 DeepSeek 等競品。

在編碼專項測試中,GPT-4.1 同樣未能占據上風。Aider Polyglot 的測試結果顯示,GPT-4.1 的編碼得分僅為 52%,而 Gemini 2.5 則以 73% 的成績遙遙領先。

值得注意的是,GPT-4.1 被歸類為非推理模型(non-reasoning model),但其編碼能力仍屬行業頂尖。

給作者點贊
0 VS 0
寫得不太好

免責聲明:本文僅代表作者個人觀點,與C114通信網無關。其原創性以及文中陳述文字和內容未經本站證實,對本文以及其中全部或者部分內容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關內容。

熱門文章
    最新視頻
    為您推薦

      C114簡介 | 聯系我們 | 網站地圖 | 手機版

      Copyright©1999-2025 c114 All Rights Reserved | 滬ICP備12002291號

      C114 通信網 版權所有 舉報電話:021-54451141

      主站蜘蛛池模板: 色久激情| 午夜无遮挡怕怕怕免费视频 | 一区二区三区免费高清视频 | 91精品免费高清在线 | 毛片免费在线视频 | 在线观看免费国产成人软件 | 精品国产欧美另类一区 | 九九亚洲 | 一区二区三区 亚洲区 | 一级毛片aaaaaa视频免费看 | 成年男女免费视频网站播放 | 性高湖久久久久久久久aaaaa | 成人做爰视频www网站 | 国产欧美一区二区三区视频在线观看 | 在线观看欧洲成人免费视频 | 国产国产人免费视频成69堂 | 成人免费在线观看视频 | 日本一级毛片在线看 | 欧洲免费无线码一二区 | 亚洲国产成人最新精品资源 | 成人午夜视频在线观 | 中文字幕波多野不卡一区 | 亚洲精品 欧美 | 亚洲国产欧美日韩精品一区二区三区 | 成人免费aaaaa毛片 | 玖草影院| 在线看片亚洲 | 日本成人在线视频网站 | 成人a免费α片在线视频网站 | 碰碰碰免费公开在线视频 | 日韩美女专区中文字幕 | 亚洲综合伦理一区 | 99re久久精品国产首页2020 | 欧美成人香蕉网在线观看 | 国产精品亚洲精品一区二区三区 | 久久成人免费播放网站 | 美女毛片在线看 | 国产精品国产亚洲精品不卡 | 欧美深夜影院 | www.av视频在线 | 一个人免费看的www 一及 片日本 |