> 自媒体 > (AI)人工智能 > 谷歌Gemini 3把GPT-5.1打成计量单位!马斯克奥特曼都服了
谷歌Gemini 3把GPT-5.1打成计量单位!马斯克奥特曼都服了
来源:量子位
2025-11-20 12:59:58
163
管理

梦晨 闻乐 发自 凹非寺

量子位 | 公众号 QbitAI

不得了。

谷歌Gemini 3 Pro进步太大了,与上一代2.5 Pro之间差出一个GPT-5.1(狗头)。

新模型在几乎所有基准测试中超过GPT-5.1和Claude4.5,包括人类最后的考试、ARC-AGI-2这些专为AGI准备的测试,数学的AIME 2025带工具拿满分,还刷新了之前让大模型全员得0分的LiveCodeBench Pro纪录。

用户投票的大模型竞技场也是一样,马斯克的Grok4.1昨天才刷完榜,今天就被反超了。

测试期间看Gemini 3模拟Windows、Mac、Linux三大操作系统界面,还以为它只擅长设计前端呢,原来设计出的程序他真能用啊。

设计一个乐高编辑器,一次尝试就完成了界面 负责空间逻辑和所有编辑器功能。

谷歌官方用Gemini 3 Pro设计的游戏更是发布在了油管上可以直接玩,纯靠AI都能搭起一个4399小游戏网了你敢信?

在智能体任务上,Gemini 3 Pro不光擅长编程,还强化了现实生活任务的长期规划能力,模拟管理自动售货机一年赚了5000美元,取得所有模型中最高的收入。

从今天起,谷歌宣布“以整个公司的体量”发布Gemini 3系列模型,包括首次在发布当天就将Gemini整合进搜索,上线独立APP,还推出全新的智能体开发平台。

还有一个更强Gemini 3 Deep Think深度思考模式,正在路上。

至于这么大的能力飞跃如何实现的,只有研究VP Oriol Vinyals透露了一点:预训练还没结束,后训练也还有很大改进空间。

Gemini系列的集大成者

回看Gemini系列这几年的演进,有点像打怪升级了,每一代都在补上一代的短板,然后在下一代里又把所有能力都打磨一遍。

1代奠定根基,把多模态能力和超长上下文打通,Gemini成为第一个能够处理百万级tokens上下文的大模型。

2代就开始变得有行动力,在1代的基础上记住大量信息后,它就整合海量信息进行决策和规划,这也为智能体能力铺了路。

到了Gemini 2.5,谷歌则开始认真搞思考和推理,给它加了思考引擎,让它能做更深入的推理、链式思考,甚至模仿人类分步解决问题。

现在的3代更是能力的集大成者,不是简单堆料,而是深度融合,多模态、推理、Agent能力这些特性一起进化,主打“你敢想,我实现”。

而且,Gemini 3更明显的变化是更懂人话了。

不用纠结提示词是否写得“有水平”,只要把需求一丢,再长的提示词它也能抓住语境、明白意图,然后回你一句更简洁又直接的答案,没有彩虹屁的那种(doge)。

多模态方面更是开挂,文本、图像、视频、音频和代码一股脑地无缝理解。

比如说,给它看一段球赛的长视频,它就能总结打法,把球员技巧整理出来,然后顺便教你复现动作。

怎么感觉,上传自己的训练视频,就可以直接让Gemini 3当教练了……

在搜索场景里,Gemini 3也不是直接扔给你一堆链接,而是把即时查询的信息组织成你真正能用的东西,生成可交互式的内容。

反重力开发平台,杀入AI编程战场

这次与旗舰模型Gemini 3 Pro同步推出的,还有Google Antigravity(反重力)实验性智能体开发平台。

其核心理念是构建一个“智能体优先”(agent-first)的开发环境,将开发者从繁琐的编码工作中解放出来,转向更高层次、面向任务的架构师角色。

官方展示了如何用1分钟开发一个航班追踪程序。

与Cursor为代表的AI IDE相比,Google Antigravity的智能体已被提升到一个独立的界面,并可直接访问编辑器、终端和浏览器。智能体可以代表用户自主规划和执行复杂的端到端软件任务,同时验证自身的代码。

全新的管理器视图旨在同时控制多个智能体,使每个智能体都能更加自主地工作。

谷歌对这款开发工具的野心很大,他不仅支持Gemini系列模型,也允许使用GPT-OSS、Claude第三方模型。

Antigravity目前以公共预览版的形式免费提供,并承诺为Gemini 3 Pro的使用提供“慷慨的速率限制”,一发布就吸引了大量开发者来“薅羊毛”。

目前Claude Code收入占Anthropic总营收约21%,OpenAI也在不断围绕Codex做文章。

AI编程工具,看来是下一个必争之地了。

参考链接:[1]https://blog.google/products/gemini/gemini-3/#learn-anything

— 完 —

量子位 QbitAI · 头条号签约

关注我们,第一时间获知前沿科技动态

0
点赞
赏礼
赏钱
0
收藏
免责声明:本文仅代表作者个人观点,与本站无关。其原创性以及文中陈述文字和内容未经本网证实,对本文以及其中全部或者 部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。 凡本网注明 “来源:XXX(非本站)”的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对 其真实性负责。 如因作品内容、版权和其它问题需要同本网联系的,请在一周内进行,以便我们及时处理。 QQ:617470285 邮箱:617470285@qq.com
相关文章
新晋“汽车第一省”,又出手了
每经记者:杨弃非 每经编辑:刘艳美一起并购,让安徽国资再次站上风口浪..
极氪召回38277辆汽车,关于召回范围、是否需要更换电池、能否正常使用等,..
2月9日,记者从据市场监管总局获悉,日前,浙江极氪智能科技有限公司根据..
一辆载有8名中国游客的汽车在贝加尔湖落水,目前仅救上1名中国游客..
当地时间20日,我使馆发布消息称,贝加尔湖汽车落水事故中,涉事车辆上载..
巨亏超1800亿元?全球第四大汽车制造商,股价巨震!
据CNBC网站报道,全球第四大汽车制造商斯泰兰蒂斯6日美股开盘后股价大幅..
12306能给汽车买“火车票”?春运订单火爆!
‍‍‍‌‍‍‌ 豹豹的自述大家好,我叫豹豹是一辆身材魁梧的SUV上次跟着..
眼红中加协议,美国汽车制造商威胁卡尼:《美加墨协定》正重新审查哦..
【文/观察者网 王一】加拿大今年1月宣布调整政策,允许每年最多4.9万辆中..
想买旅行车的注意!2026年将有这4款高颜值旅行车上市..
很多朋友都喜欢那些进口的德系旅行车,但奈何手中的钱包实在太薄,所以就..
小米汽车2025年带来200+项功能更新,车主最喜爱TOP10公布..
IT之家 2 月 13 日消息,小米汽车昨日公布数据,2025 年小米 SU7 车型 7 ..
怎么开都开不坏的九款车,省油、皮实、耐造,看看有没有你的那款..
开到报废你都开不坏的9款车,快来看看有没有你想买的车型,特别是最后一..
关于作者
司机(普通会员)
文章
1971
关注
0
粉丝
0
点击领取今天的签到奖励!
签到排行

成员 网址收录40418 企业收录2986 印章生成263660 电子证书1157 电子名片68 自媒体103602

0
0
分享
请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索