当前位置:
AIGC文章详情

AI视频为何只能做“PPT”?拆解长视频生成的记忆诅咒

源自62位全网作者

04:19

内容由AI生成

精选参考来源

1. 从砂子到智能协作文明:第67章 视频生成与时空建模

2. 智问智答 | AI 视频生成模型的发展、原理与应用局限

3. MIT放出MilliVid:长视频生成终于能「记住」数百帧前出现过的东西了!

4. DecMem:解耦记忆架构,实现分钟级长视频世界生成

5. 快手可灵的新招:让AI"导演"当老师,视频推理性能暴涨16.7分

6. 🔥视频生成模型的后训练神器

7. 做视频后训练的半年:关于 GRPO、Reward Model 与视频评测闭环的系统性观察

8. 🔍 World-R1:不改架构让视频学会3D

9. 字节开源 Bernini:AI 视频编辑,终于开始“听得懂人话”了

10. 0 拍摄成本,Seedance +线稿一天出100条服装带货视频

11. 42 FPS实时生成、语音随时改剧情,Vidu S1把视频模型做成了“直播系统”视频生成模型终于不满足于“生成一段视频”了。

12. 【艺恩观察】Seedance/可灵3.0之后,视频生成模型的训练数据缺口到底有多大?

13. 影溯发布4D世界模型InSpatio-World技术报告,单段视频即可生成实时漫游的动态世界

14. VideoRAE:视频生成训练快了 5 倍

15. ICLR 2026 | 把视频扩散模型压到4bit,还能接近满血效果? QVGen让「超低比特视频生成量化」真正可用

16. 生数科技&清华等全流程开源minWM:把Wan、混元这些视频大模型,改造成能实时操控的"可玩世界"

17. 35+程序员从零开始学AI——Sora和视频生成模型原理

18. 左脚踩右脚进击多模态:用 Agent 自进化训练,让 VLM 与视频生成模型真正“长出眼睛和导演思维”

19. 左脚踩右脚进击多模态:用 Agent 自进化训练,让 VLM 与视频生成模型真正“长出眼睛和导演思维 - 哔哩哔哩

20. ICCV 2025 | 引入树状GRPO强化学习,多模态大模型轻松破解小时级长视频定位难题

21. 腾讯混元团队正式开源UniRL,多模态生成模型通用RL后训练框架

22. 视频模型的后训练:强化学习方法

23. NVIDIA一篇长达25页的PhysisForcing,要做物理增强的World Simulator......

24. 视频生成后训练:SAGE-GRPO 技术解读

25. 论文笔记:Coarse-to-Real: Generative Rendering for Populated Dynamic Scenes

26. MotionForesight 的训练分五步: 1. 生成训练标签:从约4万段人类交互视频中分割目标物体,并用单目深度、相机位姿和3D点追踪模型,自动生成物体在完整视频中的三维运动轨迹。这些属于视觉模型生成的伪标签,并非真实传感器数据。2. 老师—学生训练:老师模型观看完整22帧视频,提取物体真实发生的后续轨迹;学生模型只看前7帧,预测之后15帧物体各点如何移动。3. 模型输入输出:输入包括RGB画面、估算深度、相机运动和目标物体查询点;输出不是未来视频,而是物体表面各点未来的3D坐标。4. 轻量微调:它没有从头训练大模型,而是在已有视频模型和3D追踪模型上增加LoRA,只训练约1200万个参数,把“看完后追踪”改造成“提前预测”。5. 损失与推理:训练时,将预测轨迹与老师生成的伪标签计算误差;部署时只需一次前向计算,直接输出未来3D轨迹。但它仍不包含机器人动作、力觉、摩擦和接触信息。

27. World-R1:浙大、微软研究院对3D在主流的世界模型中的思考,视频基模后训练阶段挖掘视频生成模型的3D能力,不改变原本模型架构,不依赖特定视频数据,不破坏原本能力

28. 海豚善学AIGC:AI视频生成镜头连贯性优化方法与实现逻辑

29. AI视频制作中如何让角色“记住”前一帧的动作?运动连贯性科普

30. 1.3视频生成技术的当下与未来 - 哔哩哔哩

31. 当Sora 2意外停摆,这个国产视频生成创业团队,直接「开源」三连击

32. OpenAI 将停止 Sora 视频生成服务,以精简产品线,这透露出哪些行业信号?

33. ECCV 2026|DriveVA:将视频生成模型变成 Zero-Shot 自动驾驶策略。

34. 字节暂停Seedance2.0海外发布计划,AI视频生成再迎版权归属之问

35. 后训练中的RL已死?MIT新算法挑战传统后训练思维,谢赛宁转发

36. 视频AI卷向5分钟:全量开源,一次生成,正式告别「盲盒抽卡」

37. Z Tech|专访张金涛:清华朱军教授的00后博士、Vidu S1负责人,让视频生成走向实时交互

38. 为什么2026年大模型都在往“理解生成统一”方向发展?去掉VAE和VE到底能带来什么本质性的提升?

39. 超越 SFT 和 RL,混元 SOAR 开启扩散模型训练范式的新时代

40. 地平线最新提出HorizonDrive:自动驾驶世界模型新范式、实现分钟级自回归生成

41. 英伟达:从“一次性训练”的大模型到“后训练改进”的Agent,算力需求正在变化

42. 华为云CEO周跃峰:模型竞争的核心胜负手已然转向“后训练”

43. 从一张Brief看懂AIGC的钱赚在哪里?

44. 《飞驰人生3》美术指导亲临,AIGC春耕营2.24正式开营!

45. 深度|不经后训练照样能打,这家中国公司的开源具身预训练模型如何做到?

46. 深圳国产芯片成功训练万亿级AI大模型

47. 深度|顶级资本下注,Sand.ai三个月两轮融资超1亿美元,专注视频生成下一个前沿

48. 如何评价影视飓风在凌晨发布视频《改变视频行业的AI,快来了》?

49. AI 视频生成的未来在中国

50. OpenAI全面关停其AI视频生成平台Sora,从昙花一现到退场,Sora有哪些经验和问题值得关注?

51. 90% +漫剧制作难题,1 个工具全解决

52. OpenAI 拟将视频生成工具 Sora 整合进 ChatGPT,该模型的最大创新点是什么?

53. 如何评价6月23日字节发布的Seedance 2.5视频生成模型?

54. 作为影视从业者,AI视频生成是否已融入工作流?还有哪些特效是Seedance等AI工具无法做到的?

55. 解决视频生成落地难题!首个系统化后训练框架,四阶段同时提升质量、可控性和推理速度 【AI生成视频】

56. AI视频模型制作实战:从零搭建到性能优化的全流程指南

57. 跑本地AI必踩的8个深坑我全踩过!这份进阶避坑清单建议收藏

58. 让AI自主训练AI:我们学到的事

59. 影溯发布4D世界模型InSpatio-World技术报告,单段视频即可生成实时漫游的动态世界

60. AI视频生成的终点,不是更高清,而是一个能被操作的世界

61. 用免费AI生成视频,一个要40分钟,我果断放弃了

62. 免费免排队的视频生成 Agent 来了!

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章