• 首页
  • AI工具集
  • AI资讯
  • AI活动
  • AI社区
  • AI短剧
  • AI创作大赛
  • AI小说
  • AI绘画
    AI视频
    AI对口型
  • AI画布AI画布AI画布
AI 对话

🎨 谷歌最强模型Gemini 4 Pro偷跑测试:SVG生图惊艳,疑似内部代号Argon

🎨 谷歌最强模型Gemini 4 Pro偷跑测试:SVG生图惊艳,疑似内部代号Argon
AI TOP100
1小时前

据 X 平台多位网友及DoNews等多家媒体 9 月 18 日消息,谷歌正以“gemini-3.8-flash”的名称,在 Arena 等基准测试平台内部测试其下一代旗舰大模型 Gemini 4 Pro,内部开发代号为 Argon。用一个旧版本号挂着跑测试,是典型的“闷声练兵”套路,谷歌官方至今未对此进行任何回应。

模型地址:谷歌Gemini官网 (海外网站需要科学上网)

Gemini 4 Pro

为何披着 Flash 马甲偷测?

谷歌选择以“gemini-3.8-flash”的名义将旗舰模型送入 Arena 盲测,背后有几重考量。Arena 是独立的第三方评测平台,允许厂商以匿名身份提交模型参与竞技,用户实测时不知道对战的是哪个模型。

谷歌选用旧版本号作为化名而非完全匿名,既留下了可供溯源的产品线线索,又让竞争对手无法从公开榜单感知到新旗舰的真实能力边界,争取发布窗口的主动权。同时,匿名盲测可在不锚定舆论预期的前提下,通过真实用户的 Elo 评分收集反馈,这对模型迭代方向有重要参考价值。

Gemini 4 Pro

SVG生图能力惊艳,多场景实测表现亮眼

网友晒出的测试图里,最抓眼球的是那道经典难题——生成“鹈鹕骑自行车”的 SVG 图片。Gemini 4 Pro 交出的成品被评价为非常优秀,发帖者还特意拉来了 OpenAI 最强模型 GPT-6 Astra Pro 做同题对比。SVG 这种矢量格式最考验模型对结构、路径与几何关系的理解,能把鹈鹕和自行车的组合画得服帖,说明它在图形生成上的功底不容小觑。

除了经典测试,全网还流传着更多惊艳的实测案例。开发者 Bee 体验后直呼“太不真实了”,短短 14 分钟,Gemini 4 Pro 就打造了一个以素描、铅笔与石墨质感为主题的创意展示网页,将“滚动即笔触”概念化,向下滑动线条逐渐加深,交互感非常丝滑。

在 3D 生成方面,它用时 10 分钟制作出带五种涂装切换的空客 H145 直升机 3D 模型,座舱、尾桨、线框模型细节满满;还能生成像素风 3D 宝塔,支持四种光照模式、六个镜头位置切换,夜景模式有满屏浮灯特效。

在游戏生成方面,Gemini 4 Pro 同样没有落下。“我的世界”从页面搭建到每个模块的设计完全不输此前放出的 Astra 测试,3D 卡丁车竞速游戏看起来比跑跑卡丁车更现代,而这都是它在很短时间内完成的。

参数规格与基准测试:全面压制对手?

从泄露的信息来看,Gemini 4 Pro 的参数规格有显著提升。AI 研究员 Qwinah 进入后端后发现,它有 1000 万输入上限,25.6 万输出上限,永久跨会话记忆,不用 API 即可连网。其中 256K 的输出 token 上限,较前代 64K 提升了 4 倍,传支持 2M 上下文窗口。

一张正在疯传的泄露基准测试表显示,

  • 若分数属实,Gemini 4 Pro 将实现全面压制:
  • 长周期软件工程测试 DeepSWE 拿下 88.7%,比 GPT-6 Astra 的 86.9% 高出近 2%;
  • 多学科推理 HLE 得分 72.1% vs 67.3%;
  • 桌面自动化 OSWorld 斩获 86.8%,击败了 Astra 和 Fable。

不过这些数字尚未经过独立验证,不代表最终发布版性能。

在价格方面,相较于 Astra 和 Fable,Gemini 4 Pro 也是“御三家”中最具性价比的那个。每百万 Token 输入价格 2.25 美元,每百万 Token 输出价格 11.25 美元,远低于同级别的其他模型。

从3.5 Pro难产到4 Pro跳级

天下人苦 Gemini Pro 久矣。上一代还停留在今年 2 月发布的 Gemini 3.1 Pro,距今已超半年无更新。传闻最多的 Gemini 3.5 Pro 曾在谷歌 I/O 大会上高调官宣,所有人都以为谷歌要开始反击了。但据报道,谷歌经过内部测试后认为 3.5 Pro 的 Agent 能力不达预期,于是悄悄取消了这个新模型的发布。再然后,谷歌开始死磕 Flash,连续发布了 3.6、3.7、3.8 三个 Flash 模型,只不过都是配角。

Gemini 3.5 Pro 从难产到流产,这次直接跳到了 Gemini 4 Pro。就在最近,全网流传着更激进的说法:Gemini 4 之所以提前完成预训练,正是因为谷歌 DeepMind 在训练中实现了“RSI 闭环”。

RSI:谷歌真正押注的关键一环

上个月,Google DeepMind 首席战略官 Jasjeet Sekhon 在伯克利的活动上,直接把话挑明了——RSI(递归自我改进),已成为 AI 巨额投资逻辑里的关键一环。整个行业押注的,是能力曲线继续向上。而如果真正撞上递归自我改进,这条曲线甚至可能从“指数增长”进一步加速。

有意思的是,就在 9 月 14 日,谷歌一项名为 Dream-RSI 的研究也公开了。它研究的正是,如何让 Agent 在探索过程中不断改进自己的搜索策略,从经验中继续升级下一轮探索。可以确认的是,谷歌 DeepMind 已经公开把 RSI 摆到了非常重要的位置。

正式发布后能力还会更强?

发帖网友认为,等谷歌官方正式发布后,Gemini 4 Pro 的能力还会再上一个台阶——毕竟测试版本往往还不是完全体。根据谷歌过往的产品迭代规律,正式发布前的优化阶段往往能带来 15%-30% 的性能提升。这意味着待 Gemini 4 Pro 正式上线时,其在多模态理解、复杂逻辑推理等核心能力上可能实现质的飞跃。

目前谷歌尚未官宣这一模型,但多方预期其上线后性能将进一步优化。有分析师预测,该模型若能如期发布,或将重新定义生成式 AI 的应用边界,特别是在创意设计、科学可视化等垂直领域引发变革。

沉寂许久的谷歌,这次真的要回来了吗?10 月见分晓。


更多AI大赛活动请关注

AITOP100平台有收录、承办、推广各类型AI大赛活动业务,需要合作的朋友可以在首页最下方联系商务洽谈

AI人工智能网站--AITOP100平台AI创作大赛专区: 点击此处进入AI创作大赛

AI人工智能网站--AITOP100平台活动专区:点击此处进入AI活动

AITOP100平台大赛社群二维码:

AI大赛社群二维码AI大赛社群二维码

0
0
文章来源:AI TOP100
免责声明:本文不代表本平台立场,且不构成投资建议,请谨慎对待。
全部评论
暂无评论
相关AI工具
  • 谷歌Gemini
相关资讯
  • 🎨 谷歌最强模型Gemini 4 Pro偷跑测试:SVG生图惊艳,疑似内部代号Argon

  • 🚀 Google发布Gemini 3.8 Live双模型:语音AI首次实现“边说边想”,推理与对话不再二选一

  • Perplexity上线混合计算:敏感数据交给本地模型,隐私和成本你自己说了算

  • OpenAI GPT-Live-1上线API:全双工语音+电话客服,每分钟仅0.05美元

  • Suno v6正式推出:图片、视频一键变音乐,现实精准编辑歌曲

热点资讯

每日AI资讯-2026年9月17日

19小时前
每日AI资讯-2026年9月17日

每日AI资讯-2026年9月14日

3天前
每日AI资讯-2026年9月14日

每日AI资讯-2026年9月16日

1天前
每日AI资讯-2026年9月16日

每日AI资讯-2026年9月15日

2天前
每日AI资讯-2026年9月15日

每日AI资讯-2026年9月10日

7天前
每日AI资讯-2026年9月10日
分享
0
0

欢迎来到AI Top100!我们聚合全球500+款AI智能软件,提供最新资讯、热门课程和活动。我们致力于打造最专业的信息平台,让您轻松了解全球AI领域动态,并为您提供优质服务。

合作伙伴
联系我们
加入AITOP100社群
加入社群
AITOP100商务微信
商务微信
相关链接
服务及隐私政策
网站地图
关于我们
粤ICP备2022124843号-2粤公网安备44030002004505广播电视节目制作经营许可证:(粤)字第00712号Copyright © 华强方特(深圳)动漫有限公司 版权所有