新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude

2025-07-11 08:42:52 - 吃瓜头条

8月2日,新王新超lmsys官方在推特发布一则消息,登基度更恭喜DeepMind研发的新王新超Gemini 1.5 Pro 实验版 (0801)在Chatbot Arena排名登顶,超越GPT 4o和Claude-3.5夺得第一。登基度更

这是新王新超继今年3月Claude 3 “超大杯”Opus版本短暂超越GPT-4以来,OpenAI第二次让出Chatbot Arena的登基度更Overall ranking宝座。

新王登基,新王新超Gemini 1.5 Pro再度更新,登基度更超越GPT 4o和Claude-3.5

Gemini 1.5 Pro 实验版 (0801)在Chatbot Arena测试一周后。获得了超过12,登基度更000个社区投票,新王新超在Chatbot Arena和Vision Leaderboard排名上均取得了第一名的登基度更好成绩。之前说GPT-4o有刷分技巧,新王新超现在看起来Gemini 1.5 Pro可能也学到了这个技巧呢。登基度更

新王登基,新王新超Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5

Gemini 1.5 Pro 实验版(0801)不仅在综合表现上极为突出,在各个细分领域上也有着出色的表现。它在数学方面排名前三,指令遵循排名前二,编码排名前五,硬提示(英语)排名前五。

Gemini 1.5 Pro 实验版(0801)具有强大的多语言能力,在中文、日语、德语、俄语方面均表现第一。

从总体胜率图上,也能看出Gemini 1.5 Pro 实验版 (0801)实力强劲,对阵 GPT-4o 的胜率为 54%,对阵 Claude-3.5-Sonnet 的胜率为 59%。

新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5

前OpenAI的开发者,现Google AI Studio的产物负责人Logan Kilpatrick火速转发,向大家宣布Gemini 1.5 Pro 实验版(0801)目前在 LMSYS 的文本和多模式排名中均位居第一的好消息。

新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5

DeepMind的CEO Demis Hassabis也转发了这条消息,祝贺Gemini 1.5 Pro 实验版(0801)能够在极具竞争力的榜单中拿下第一,并且宣布这一版本的已经可以在 AI Studio上进行试用。

新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5

带领研发Gemini的Jeff Dean也随后转发,对此次实验版本的Gemini 1.5 Pro突破1300+elo分数拿下排名第一的好消息感到非常自豪,也很期待未来能看到其他更好的模型。

新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5


听闻这则消息,其他从业人员也纷纷发来祝贺。


新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5

也有不少人分享自己的试用体验。大神elvis对在聊天机器人领域超越了 GPT-4o 和 Claude 3.5 Sonnet的Gemini 1.5 Pro非常感兴趣。elvis分享了自己的测试全过程影片,并总结道,Gemini 1.5 Pro强大的图像和PDF提取能力给他留下了深刻的印象,Gemini 1.5 Pro有着和GPT-4o不相上下的视觉能力,也有Claude 3.5 Sonnet接近的代码生成及PDF理解/推理能力。

新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5

有人认为Gemini 1.5 Pro在解决高级数学难题方面表现相当不错。

新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5

也有人说Gemini 1.5 Pro在图像识别植物和动物方面做得确实要比GPT 4o更好。

新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5

也有更多的人在期待Gemini 1.5 Pro这一版本的正式上线,希望能够API实现Gemini 1.5 Pro的实际运用。

新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5

新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5

大家对Gemini 1.5 Pro这次发布的实验版本有什么看法,欢迎评论区留言分享~雷峰网(公众号:雷峰网)雷峰网


雷峰网原创文章,未经授权禁止转载。详情见转载须知。

新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5

- END -

38155

老师因学生志愿未报清北解散群聊?校方通报

老师因学生志愿未报清北解散群聊?校方通报

情况说明7月6日,网帖反映我校22209班班主任漆某芳老师“对学生填报志愿发表不当言语”。我校立即调查核实,现将有关情况作如下说明:高考成绩公布后,漆某芳老师根据3名学生的高考成绩和与家长沟通的情况,

中国大模型数量占全球超1/3;AI模型训练成本暴涨,2027年或达1000亿美元;Kimi发布官方浏览器插件丨AI情报局

中国大模型数量占全球超1/3;AI模型训练成本暴涨,2027年或达1000亿美元;Kimi发布官方浏览器插件丨AI情报局

融资快报Quantum Rise 获 1500 万美元种子资金:Quantum Rise 以所谓的“咨询 2.0”模式将 AI 部署到公司中,以自动化工作流程、提供路线图和量身定制的 AI 解决方案,

WAIC 2024 已落幕:大模型再无新玩家,AGI 下半场是计算与应用

WAIC 2024 已落幕:大模型再无新玩家,AGI 下半场是计算与应用

导语:「十八金刚」暗示的,其实是巨大的技术想象力与迫切的 AI 生产力。作者:马蕊蕾编辑:陈彩娴WAIC 论坛最后一天下午,启明创投主管合伙人周志峰在世博中心红厅分享了一组数据:经统计,仅 2023

国内首个!商汤科技发布“日日新5o”,实时多模态流式交互对标GPT

国内首个!商汤科技发布“日日新5o”,实时多模态流式交互对标GPT

2024年7月5日,上海——2024世界人工智能大会暨人工智能全球治理高级别会议WAIC 2024)战略合作伙伴商汤科技召开“大爱无疆·向新力”人工智能论坛,发布国内首个所见即所得模型“日日新5o”,

蓝振忠也发「英雄帖」,中国版 ChatGPT 明星公司寻找 CEO

蓝振忠也发「英雄帖」,中国版 ChatGPT 明星公司寻找 CEO

「打造中国OpenAI」,「西湖心辰」这家创立时间不到两年的小公司怎么敢夸下海口?相比于国内的其他创业团队,心辰具有以下几大优势:1.在大模型的研究和商业化落地要早一年。积累了超过百万的用户,并训练出

揭秘全网刷屏的人形机器人NEO,背后是比特斯拉还猛的AI公司

揭秘全网刷屏的人形机器人NEO,背后是比特斯拉还猛的AI公司

人类一样的外型,能动能跳还能干家务,人工智能界怎么背着我们偷偷搞科研啊?科技公司1X最近推出了一款人形机器人NEO Beta,超静音,号称是专为人类家庭设计打造的全能机器人。根据1X放出来的视频,雷峰

可灵AI还是火到了马斯克那!

可灵AI还是火到了马斯克那!

马斯克点赞可灵AI8月20日,AI插画艺术爱好者Déborah在推特上发布一段时长为五秒钟的视频,内容为女人手捧一朵燃烧的玫瑰,画面表现堪称电影级别的画质与动态效果。而这一视频背后,是由可灵AI完成图

奇瑞 1 亿元成立 AI 机器人新公司;AI Infra 公司趋境科技获天使融资;地平线组建具身智能实验室丨AI情报局

奇瑞 1 亿元成立 AI 机器人新公司;AI Infra 公司趋境科技获天使融资;地平线组建具身智能实验室丨AI情报局

今日融资快报奇瑞汽车1亿成立科技新公司,含多项AI业务天眼查App显示,安徽开阳科技有限公司成立,法定代表人为尹同跃,注册资本1亿人民币,经营范围含网络与信息安全软件开发、智能机器人的研发、人工智能基

百川智能首款 AI 应用主打懂搜索,但王小川不做搜索 2.0

百川智能首款 AI 应用主打懂搜索,但王小川不做搜索 2.0

「雷峰网」二十多年前,搜索引擎的发明极大地方便了人们获取信息,很快搜索引擎便成为互联网时代第一流量入口,谷歌、百度更是凭借搜索引擎在 PC 互联网时代占据统治地位,成为两大巨头,多年以来,两者在搜索方

Anthropic 联设 1 亿美元 AI 初创基金;OpenAI推出“小”模型GPT

Anthropic 联设 1 亿美元 AI 初创基金;OpenAI推出“小”模型GPT

今日融资快报Anthropic 联手硅谷风险投资公司 Menlo Ventures 设立 1 亿美元 AI 初创基金Menlo Ventures 是 Anthropic 的重要投资者之一,双方合作推出

家务机器人或将再更新?Chelsea Finn团队推出BID新算法,机器人一键变聪明

家务机器人或将再更新?Chelsea Finn团队推出BID新算法,机器人一键变聪明

斯坦福大学的 Chelsea Finn 团队又出新成果了。Chelsea Finn 团队一直是斯坦福走在具身智能研究前沿的团队之一,之前火遍全网的 ALOHA 炒菜机器人就是出自这个团队之手。团队领头

Viggle 获 a16z 领投 1900 万美元;华为启动 AI 百校计划,解决高校算力问题;字节成立大模型研究院丨AI情报局

Viggle 获 a16z 领投 1900 万美元;华为启动 AI 百校计划,解决高校算力问题;字节成立大模型研究院丨AI情报局

今日融资快报AI视频生成公司 Viggle 获1900万美元投资,a16z领投Viggle 已完成由 Andreessen Horowitz 领投的 1900 万美元 A 轮融资,Two Small