张大妈

Google又又又搞大事! #人工智能 #AI #机器人 #ChatGPT #Gemini

源自抖音:GalaTech

01-18 18:04

谷歌新一代世界模型在视频生成领域取得突破,实现实时生成长达数分钟的高清视频。其核心亮点在于精准的场景交互能力,从物理模拟到角色控制均展现出惊人潜力,为AI内容创作和虚拟体验打开了新大门。

Google又又又搞大事!
#人工智能 #AI #机器人 #ChatGPT #Gemini智能速览

  • 视频生成分辨率和时长实现数十倍提升

  • 能高度模拟物理特性和复杂自然场景

  • 支持实时交互,并能保持场景状态一致性

  • 可实时修改场景中的特定元素,如更换物体

  • 交互控制可精确到场景中角色的具体行为

Google又又又搞大事!
#人工智能 #AI #机器人 #ChatGPT #Gemini精华内容

这款新模型的核心突破在于,它不再仅仅是一个视频生成器,而是一个可以被实时交互和修改的“世界”,其生成的视频内容在细节和物理逻辑上达到了新的高度。

物理真实感

模型在模拟物理特性上表现卓越,例如第一人称视角下,火山地貌的地面纹理与喷发熔岩的动态效果极为逼真。水上摩托艇行驶时,水面反射的灯光与远方灯火映衬下的透明塔楼,光影效果真实自然。海边巨浪腾空拍打后退潮的模拟,与物理现实保持了高度一致性,展现了强大的物理引擎能力。

环境细节

对复杂环境的刻画同样令人印象深刻。在森林场景中,林间穿梭时的光线变化、溪流与湖水的质感以及远处的森林雪山,均得到完美还原。对海底水母群的模拟,不仅呈现了发光的视觉效果,更捕捉到其游动的细节和进入群体中的视觉冲击。特写镜头下,树叶的脉络清晰,层叠感自然,且细节会随镜头拉近而愈发丰富。

实时交互

该模型的交互能力实现了质的飞跃,核心在于状态一致性。演示中,当用户在虚拟场景中粉刷墙壁后,即使将视线移开再转回,墙壁上的粉刷痕迹依然存在。这种对场景状态的记忆和保持,是实现复杂、连续交互的基础,摆脱了以往AI视频生成“一锤子买卖”的局限。

精准控制

交互控制达到了前所未有的精准度。在生成的集市场景中,用户可以发出具体指令,让场景中的人物走向指定的目标,例如前方的花篮、远处的面包摊位,甚至可以控制其走向蔬菜摊位并观察右侧的番茄。这种对角色行为和观察视角的精细操控,为未来的互动式叙事和游戏开发提供了强大的工具。

该模型虽然仍有交互时长和模拟精度上的提升空间,但其展现的实时生成与交互能力无疑预示着AI内容创作的未来。当AI不仅能生成内容,更能响应指令进行修改时,它将如何改变游戏、影视和虚拟现实的制作流程?

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章
相关兴趣推荐