打开APP

用AI把一段视频变成可视化网页,Google的新模型又卷飞了

近期Google在AI领域动作频频,提前更新Gemini 2.5 Pro为05 - 06版。此版本代码能力登顶,多模态能力提升,可依视频生成代码,但也存在一些问题 。

Google也不知道受了什么刺激,最近在AI场上,好像越来越有站起来的意思了。

之前我就写过Gemini 2.5 pro,是在聊天记录可视化的文章里。

全世界,只有Gemini 2.5 pro,能吃下一个每天999+微信群聊天记录的上下文,同时还能给你干出,一个还挺好看的可视化网页。

在Qwen3的跑分中,也印证了,Gemini 2.5 Pro的能力也是真的强。

而我自己在是日常使用中,也几乎是把Gemini 2.5 Pro,变成了我的默认编程模型。

但是昨晚,Google好死不死的,又把模型更新了一版,把版本号变成了,Genmini 2.5 Pro(I/O版)。

而在后台的模型调用里,命名是Gemini 2.5 Pro Preview 05-06。

现在在Gemini自己的产品官网上,虽然看着还是原来的2.5 Pro (experimental),但其实背后的模型已经变成Gemini 2.5 Pro Preview 05-06了。

有一说一,Google你的命名到底能不能统一一下。

真的好乱。。。

而且,Google是真的感觉等不及了,其实距离他们一年一度的I/O大会,也就不到两周时间了,但是还是选择了把新模型直接放出来。

这种行为,一般要么是真牛逼,要么是来吹牛逼。

但是Google,这回是前者,是真的有点牛逼。

他们自己也说了:

We were going to release this update at Google I/O in a couple weeks, but based on the overwhelming enthusiasm for this model, we wanted to get it in your hands sooner so people can start building.

不是我来营销,是真的人民群众需要啊,我只是顺势而为。

这次Gemini 2.5 Pro 05-06版本(后面就简称05-06版了),跟今年三月DeepSeek V3 03-24的更新很像。都是完全为了代码服务的,把代码能力,往上提升了一个巨大的优先级。

而这次的05-06版,我觉得有两个亮点:

1. 模型代码能力在盲测竞技场登顶,力压Claude 3.7 Sonnet。

2. 得益于2.5 Pro强大的多模态能力,这次不仅可以给参考图生成代码,还可以,给参考视频生成代码。

特别是第二点,目前应该是全球*。

先看看代码能力的跑分。

这次最核心的榜单,就是,WebDev Arena。

https://web.lmarena.ai/leaderboard

0506版直接脚踩Claude 3.7 Sonnet,勇得*。

可能很多人不知道WebDev Arena是啥,我稍微解释一下,这玩意,还是挺有含金量的。

LMArena,最著名的大模型盲测竞技场,我相信一直关注AI的,大多数人都或多或少的听过。

跟一些传统的测试集不一样,这玩意就是纯粹的盲测,用户提出一个Prompt,然后LMArena直接给你两个你也不知道是什么模型生成的回答,让你选你觉得哪个好。

所以,在这上面,你几乎就做不了弊,全靠普通用户,一票一票投出来的,就跟拆盲盒一样。

而WebDev Arena,其实就是一个子榜,还是由LMArena他们开发的,专为评测网页前端开发任务(比如HTML、CSS 和 JavaScript)而设立的。

玩法跟LMArena一样,也是用户盲测二选一。

*不同的是,WebDev Arena会生成代码的预览给你看,而不只是文字了。

比如我让他生成一个Web的像素猫小游戏。

在等了一分钟两边全部生成完之后,你就能非常明确的看出来,两边哪个是垃圾。。。

傻子都能看出来,右边爆杀左边,这个时候,你就为右边,投出神圣的一票就行。

然后呢,他们用Bradley-Terry(BT)模型,成对对决中的胜负数据,来估算模型的强度,为每个模型计算一个分数,这个分数反映此模型相对于其他模型的获胜概率。

这个排名系统非常类似于国际象棋和LOL、*荣耀里中常用的Elo分。

只不过在WebDev Arena里,这个分数,叫做Arena Score。

现在,我们再回过头去看,你就能看到,05-06版,是结结实实提高了147分。。。

研究过*荣耀或者LOL的影藏分也就是ELO分机制的朋友,就知道,这玩意提升100多分有多难。。。

这一次,Google的Gemini,登顶了。

第二个亮点,也是我觉得很牛逼的,05-06版本,也提升了视频的理解能力,在在VideoMME基准测试中得分为84.8%。

这就带来一个很有趣的化学反应。

过去我们经常给一个PDF、给一个图片,让它生成一段可视化网页,但是现在,你可以,给一个视频,来变成可视化网页了。。。

不过现在有点BUG,Gemini官网本身不支持视频的上传,只能在AI Studio里传视频,但而上传的时候,又经常会报错。

Reddit里很多网友也遇到了这个问题。。。

Emmmmm,不过,目前使用YouTube的在线链接生成,目前是可以的。

我们直接打开AI studio的官网:

https://aistudio.google.com/

模型调整至05-06版。

在加号那,选YouTube。

我直接扔了一段OpenAI发在YouTube上的Sora教程上去,然后继续用藏师傅的可视化Prompt。

很快啊,代码就跑出来了。

我们复制一下,运行看看。

完整版网页在此:https://2uwv6grszo.app.yourware.so/

虽然这事,看着很NTR,但是,他真的很酷啊。

这玩意用于学习,你就可以想想,他有多棒。

比如我有时候,回去YouTube上看Blender教程。

现在,我就可以把这个视频和Prompt扔给他。

等输出完代码以后,我们看看效果。

真的很爽。。。

所以整体来看,这一次Gemini 2.5 Pro 05-06版本,确实是一次非常实在的升级。

既有实打实的代码能力提升,也在多模态理解上给到了新可能,尤其是视频转网页这种交叉场景,很可能会带来新的开发范式。

当然,Google 现在的问题依然是产品打磨还不够稳,入口混乱、命名迷惑、交互也还有bug,但模型本身的进步,确实值得承认。

它已经不是那个只靠PPT和论文刷存在感的Gemini了。

也不再是每次都被OpenAI狙击的AI界汪峰了。

接下来就看I/O大会正式发布时。

Google会不会再放出更大一锤了。

我们,拭目以待。

【本文由投资界合作伙伴微信公众号:数字生命卡兹克授权发布,本平台仅提供信息存储服务。】如有任何疑问题,请联系(editor@zero2ipo.com.cn)投资界处理。

相关资讯

相关机构

AI数据总览

红熊AI上海算模算样科技有限公司
融资时间2026-07-20 当前轮次A+轮 融资金额数千万人民币
AI
涉及机构: 九纬基金彰宜资产格睿丰
记忆张量记忆张量(上海)科技有限公司
融资时间2026-07-20 当前轮次Pre-A轮 融资金额亿级人民币
AI
涉及机构: 哈勃投资荣耀商汤国香资本深创投和玉资本
面壁智能北京面壁智能科技有限责任公司
融资时间2026-07-15 当前轮次D++轮 融资金额数亿人民币
AI
涉及机构: 国家级基金央企汽车制造商等各类产业方知名财务投资人
帷幄杭州帷幄未来科技有限公司
融资时间2026-07-15 当前轮次C+++轮 融资金额4000万美元
AI
涉及机构: 招银国际(CMB International CMBI) 旗下专注于 AI 及前沿科技的基金日本三井住友银行 (Sumitomo Mitsui Banking Corporation SMBC) 旗下企业风险投资基金 SARF (SMBC Asia Rising Fund)三菱 UFG (MUFG) 旗下泰国大城银行 (Bank of Ayudhya) 企业创投 (CVC) 平台 Krungsri Finnovate弘章投资 (Charisma Partners)韩国现代汽车集团 (Hyundai Motor Group) 新加坡电信 (Singtel Innov8)
知有无界知有无界(深圳)智能科技有限公司
融资时间2026-07-15 当前轮次天使+轮 融资金额数千万人民币
AI
涉及机构: 元禾璞华深圳新产投

最新资讯

热门TOP5热门机构 | VC情报局

去投资界看更多精彩内容
【声明:本页面数据来源于公开收集,未经核实,仅供展示和参考。本页面展示的数据信息不代表投资界观点,本页面数据不构成任何对于投资的建议。特别提示:投资有风险,决策请谨慎。】