新智元报道 Gemini 4 Pro,又曝出新的检查点了! 最近,两个全新检查点(内部代号「barium-b」或 Checkpoint 2)被开发者们发现了,实测后发现,Gemini 4 Pro强得可怕! 有开发者直呼:「在爆肝 400 小时使用 Opus 5.5 和 GPT-6 之后,Gemini 4 Pro 依然让我头皮发麻!」 谷歌的新一代大杀器,展现出超强的3D 物理模拟能力、代码生成能力和长文本推理能力。 有开发者直呼:「在爆肝 400 小时使用 Opus 5.5 和 GPT-6 之后,Gemini 4 Pro 依然让我头皮发麻!」 而且,谷歌内部高层的态度也很鲜明。 Google DeepMind新任掌门Koray Kavukcuoglu首次公开确认:Gemini 4已经进入后训练早期。 它的训练进度大大提前,仅耗时两个月,早期预训练就基本结束。 准备好,一大波硬核实测来了! 核心实测大赏:7大硬核Demo 一夜之间,仿佛每个人都能用Gemini 4 Pro了。 从晒出的Demo来看,它在3D生成、物理引擎模拟和长文本代码构建上的表现,令人惊艳。 孔雀SVG测试也来了,显示出巨大的飞跃。 水上飞机起飞,吊打Opus 5.5 知名测评博主 @AI_Screening 要求它和Opus 5.5用代码生成一个3D浮筒飞机在水面滑行起飞的物理模拟。 之前,Opus 5.5生成的视频惊呆了一大群人,但没想到,这次,Gemini 4 Pro的表现完全超越了它! 可以看到,Opus 5.5生成的飞机虽然在动,但机身晃动剧烈,仿佛随时要解体,水面的物理反馈也很生硬。 但Gemini 4 Pro就要丝滑多了,加速平稳,水面反射清晰,对「溅水」效果的渲染很逼真。 从流体力学逻辑和画面整洁度看,属于把Opus 5.5按在地上摩擦。 16分钟手搓「3D国际空间站」 开发者 @thtbee_ 抛出了一个王炸。 在没有任何3D模型导入的情况下,Gemini 4 Pro 仅仅用了 16分钟,通过纯代码,就生成了一个交互式的3D国际空间站绕地球运行的模拟程序! 令人惊喜的是,它不仅自己用 Three.js 建好空间站模型,还很聪明地从网上抓取了正确的地球贴图,保证经纬度和颜色绝对准确。 这种「无中生有」的建模能力,让人惊叹。 当然,也有人吐槽生成的UI界面有点丑,且背面仍有透视bug。 从灯塔到火箭发射(Three.js渲染) 网友 @HarshithLucky3 甩给它一个高难度指令:「用 Three.js 将一个灯塔变成火箭发射,不要包含任何UI元素。」 结果,Gemini 4 Pro 完美遵循了指令! 测试者夸爆了它的「审美」:它为画面中的所有元素都添加了质感极佳的纹理,整个3D输出质量好到离谱。 3D Wii 遥控器高精度还原 开发者 @LuminaBench 测试了它的工业设计建模能力,让它生成一个 3D 的任天堂 Wii 遥控器。 结果,它对3D物体的细节把握非常强,并且生成速度「快得难以置信」! 要说有什么不完美,就是它在处理Prompt时似乎有点过度雕琢,会竭尽全力去丰富细节,哪怕你没要求。 不过,它的设计审美在不同部件上表现不太稳定,有些地方绝佳,有些地方略显违和。 据测试,Checkpoint 2 的细节密度非常出色,而且精确度高得多,还是目前最快的前沿模型,无人能及。 机械蜂鸟,碾压 GPT-6 Sol 博主 @TimJayas 甩出了他的「祖传」机器蜂鸟prompt,考验模型对复杂机械结构和动态行为的理解。 结论是:「Gemini 4 Pro 的表现简直太棒了!老实说,质量与 Fable 旗鼓相当,但远远好于 GPT-6 Sol!」 当然,它有时也会被GPT-6 Astra碾压。 14分钟生成完整网站,单提示词生成游戏 而且,它的工程能力超强。 一位开发者仅用 14分钟,就生成了一个极具创意的产品展示完整网站,前后端全包。「真的就是几分钟一个网站。」 更让人惊喜的是,多人反馈,只需要输入一个Prompt,它就能直接给你吐出一个完整交互的网页游戏。 参数大泄露:1000万上下文+自主智能体 虽然新检查点最近才曝光,但Gemini 4 Pro的参数此前就已经泄露了。 有人曝出,Gemini 4 Pro有1000万Token的上下文窗口,和256k的输出上限,如果属实,就彻底告别「代码写一半就断」的噩梦,一句话生成大型软件的全套代码。 它可以永久跨会话记忆,无需API即可联网,具备真正的AI Agent能力。 甚至,它还有机器人控制能力, 可以直接作为大脑,控制现实物理世界中的机器人! 此前一张基准测试图显示,Gemini 4 Pro在编程、智能体、推理上均超越 GPT-6 Astra 和 Claude Fable 5.1。 它