开源AI视频模型真能挑战Sora?587+用户观点大碰撞

源自164位全网作者

25-12-03

内容由AI生成

精选参考来源

1. 腾讯发布的开源AI模型,可以生成具有3D一致性的视频序列

2. 阿里开源AI视频模型-通义万相2.2

3. 一文盘点市面上各种开源和闭源的AI视频项目

4. 腾讯开源轻量级AI视频生成模型HunyuanVideo 1.5,8.3B参数实现电影级效果!

5. 美团发布并开源视频生成模型

6. Wan S2V

7. 美团开源长视频生成模型;Meta发布稀疏记忆微调方法;OpenAI筹备进军AI音乐

8. [开源]Wan2.2

9. 美团开源视频AI模型

10. 开源视频生成新纪元

11. Sora最强开源平替?LTX-2宣布

12. 256块卡训成8B视频模型、超越Sora等一众闭源!抖音内容技术团队开源ContentV

13. Kandinsky 5.0重磅发布

14. 开源模型"逆袭"的背后

15. MuseV-腾讯天琴实验室开源的虚拟人视频生成框架

16. 1080p飞升4k,浙大开源原生超高清视频生成方案,突破AI视频生成清晰度上限

17. 画到哪,动到哪!字节跳动发布视频生成「神笔马良」ATI,已开源

18. 视频生成模型的物理合理性

19. CogVideoX

20. 美团视频生成模型来了!一出手就是开源SOTA

21. 国产!首个实时视频交互的功能面世,智谱硬实力炸场KDD顶会

22. 通义万象新动作生成模型Wan2.2 - Animate开源,引领AI新潮流

23. 通义万相正式开源Wan2.2-Animate动作生成模型

24. 阿里开源Wan2.2-Animate

25. 用了 Wan2.2-Animate 两天,我开始怀疑真人演员还能干几年?

26. 阿里开源动作生成模型Wan2.2-Animate而且免费使用且顶配!

27. 阿里开源动作生成模型Wan2.2-Animate,可一键让照片动起来

28. 通义万相正式开源Wan2.2-Animate动作生成模型

29. 阿里云代理商

30. 开源界又放大招!Open-Sora 2.0来了,20万美元训练出商用级视频生成模型

31. 2B干掉14B模型,俄罗斯的视频模型Kandinsky 5.0开源了!

32. SAM3 来了!SAM3 携 400 万数据集开源,视频分割精度翻倍

33. SIGGRAPH 2025论文分享|如何保持生成的4D内容的时空一致性? 快使用基于扩散增强的高斯溅射生成模型Splat4D

34. 世界模型SOTA!华科&小米Genesis

35. 群核科技发布空间大模型,或解决视频生成时空一致性难题

36. 阿里再放“开源大招”!Wan-S2V电影级生成

37. 身份一致性提升18.9%!阿里开源Identity-GRPO,实现多人视频生成中角色的精准控制

38. SIGGRAPH Asia 25 | 网飞等提出Virtually Being

39. Lynx模型

40. Sora2-Pro上线可一次生成25S视频无水印!AI视频真的可以商业化了!

41. 美团重磅开源!13.6B通用视频生成大模型,能文生视频、图生视频、还能续写!

42. 美团开源视频生成模型LongCat-Video

43. 美团首个视频大模型开源!速度暴涨900%

44. 开源是战略,生态是王炸,阿里千问入局AItoC #千问 #大模型

45. 当OpenAI们还在拼谁烧的钱多 中国工程师已经在拼谁的方法更巧。#大咖观察 #红衣聊AI #OpenAI #kimi

46. 把AI从“精英玩具”变成“全民工具” 让全世界都能用上便宜的AI。#大咖观察 #红衣聊AI #开源

47. 盘点一周AI大事(11月9日)|GPT5.1决战Gemini OpenAI预热GPT5.1,月底决战Gemini 3.0 Google内测Nano banana2.0 月之暗面发布最强开源大模型Kimi K2 Thinking,一举将开源大模型提到GPT5水平 阿里发布Qwen 3 Max预览版 Higgsfield上线角色交换Recast Hume AI上线声音交换Voice Conversion Heygen推出超真实数字人 字节发布开源版Sora客串BindWeave 视频模型MotionStream能让大象转身 Futurehouse推出AI科学家Kosmos 科学家研发出最强读心术模型Brain-IT #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

48. OpenAI发布最强开源大模型,开源AI进入T0时代 OpenAI发布最强开源大模型gpt-oss,奥特曼放话,这是世界上最好最实用的开放模型。 亮点1、跑分离谱 大杯120B版本,性能打平OpenAI第二强的模型o4-mini,,在核心基准测试上全面碾压Qwen 3/Kimi K2和DeepSeek R1, 还有个中杯20B版本,性能接近o3-mini。 亮点2、实用性爆表 120B采用MOE架构,活跃参数仅5B,一张H100就能跑。 20B更夸张,原生支持4Bit量化,16G显存的电脑甚至是手机都能运行。 亮点3、透明可解释 默认展示没有经过美化和处理的原始思维链,可以完整观察到模型的“思考”过程。 亮点4、天生智能体 原生支持函数调用、网页浏览、Python代码执行,还能调节推理强度,0帧起手做智能代理 本周五还有GPT5发布 #AI新星计划 #人工智能 #OpenAI #大模型 #gptoss

49. #国产AI超过ChatGPT了吗#阿里刚刚发布了基于强大的Qwen模型构建的Qwen App,作为全球排名第一的开源模型,Qwen 一直深受开发者和大型科技公司的喜爱,甚至连黄仁勋都称其为最好的开源人工智能之一,就连《金融时报》也报道了最近的Qwen恐慌。今天,Qwen App在中国正式上线,全球版本也正在筹备中。彭博社数据显示,Qwen的总下载量已正式超过Meta的Llama。越来越多的国家正在转向使用中国开源人工智能模型,其中Qwen处于领先地位#ai生活指南##ai创造营#

50. 鲨疯了,海螺AI无限用!这个国产AI碾压Veo 3 最近火爆刷屏的AI电影、AI短剧、猫咪跳水、动物奥运会,竟然都是用海螺02模型做的。 它不仅在国际排行榜上打败了Google的Veo 3,更是目前全球唯一能做出顶级杂技动作的视频模型。 海螺AI内置视频创作智能体,一张图就能直接生成大片。 海螺AI还上线了无限套餐,顶级的海螺02模型可以无限次使用。 效果炸裂,成本超低,直接抹平了视频创作的门槛。AI做电影的时代,真的来了! #人工智能 #AIGC #海螺AI #海螺02 #AI视频

51. #中国AI三剑客刷屏硅谷#Kimi K2、Qwen3、DeepSeek-R1组成的“三剑客”席卷硅谷,展现中国AI的硬核实力!三者在全球权威榜单(如LMArena、OpenRouter、GAIA)包揽前位:Kimi K2:登顶全球开源榜,万亿参数,代码与Agent表现双优。Qwen3:升级后推理能力紧逼OpenAI。DeepSeek-R1:稳居全球前三。中国开源模型首次主导全球社区:Kimi K2:兼容Claude接口,可替代Claude Code生态。DeepSeek:开源模型+算法+代码,硅谷开发者疯狂复现并点赞。在OpenRouter全球用户量排名:Kimi:超越Grok。Qwen:紧逼OpenAI。DeepSeek:稳居第三。硅谷投资人Elad Gil、英伟达CEO黄仁勋访华时多次点名“三剑客”。三大模型核心亮点概要:Kimi K2(月之暗面)✅ 首个万亿参数开源模型✅ 支持多轮工具调用(MCP)✅ 登顶HuggingFace榜单,兼容Claude生态通义Qwen3(阿里巴巴)✅ 编程专用模型能力升级✅ 多模态融合技术优化✅ 性能逼近GPT-4,落地成本更低DeepSeek-R1(深度求索)✅ 推理成本降至1/10✅ 长文本处理能力领先✅ 全球用户增长最快(20天超1000万)咱们的AI正以惊人速度崛起,引领全球创新浪潮!🚀 关注我,带你追踪更多科技前沿!#ai生活指南##ai创造营#

52. DeepSeek,正如其名,深耕求索 AI 边界。DeepSeek V3.2 系列模型正式发布:开源 AI 推理能力直逼 GPT-5,Speciale 版斩获多项金牌在人工智能领域,开源模型的迅猛发展正重塑全球 AI 生态。今日(2025 年 12 月 1 日),中国 AI 初创公司 DeepSeek 宣布正式发布两款重量级大语言模型:DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale。这一双模型同步上线,不仅标志着 DeepSeek 在参数规模和推理能力上的新突破,更在开源社区引发热议。DeepSeek-V3.2 主打日常应用场景下的 Agent 强化能力,而 V3.2-Speciale 则作为“长思考增强版”,融入先进数学证明机制,在国际竞赛基准中屡获金牌。官方网页端、App 和 API 已全面更新,支持开发者即时接入。这一发布时机恰逢全球 AI 竞争白热化之际。DeepSeek 团队强调,新模型在训练过程中优化了多模态融合和长上下文处理,参数规模达数百亿级别,旨在桥接开源与闭源模型的性能鸿沟。以下,我们将从模型架构、基准评测、与其他顶尖模型的比较以及潜在影响四个维度,进行专业剖析。模型架构与创新亮点DeepSeek-V3.2 系列基于前代 V3.1 的 MoE(Mixture of Experts)架构迭代而来,总参数量超过 600B,其中活跃参数高效分配至 70B 级别。这种设计显著降低了推理延迟,同时提升了在复杂任务下的稳定性。核心创新包括: • Agent 能力强化:V3.2 内置多步规划模块,支持自主工具调用和动态决策链路,适用于自动化工作流场景,如代码生成和数据分析。 • 长思考机制:V3.2-Speciale 引入“思考链”(Chain-of-Thought)增强变体,结合 DeepSeek-Math-V2 的定理证明引擎。该版本在处理逻辑验证任务时,能模拟人类逐步推理过程,避免幻觉输出。 • 开源友好:模型权重已在 Hugging Face 和 GitHub 公开,支持 FP16/INT8 量化部署,适用于边缘设备。这些特性使 V3.2 系列不止于通用对话,更向专业垂直领域倾斜,如数学、编程和科学模拟。基准评测:性能数据详解为评估新模型的实际表现,DeepSeek 团队公布了多项国际标准基准结果,并邀请第三方机构验证。总体而言,V3.2 在推理和数学任务上表现出色,平均得分逼近闭源顶流。数学与逻辑推理基准 • GSM8K(小学数学):V3.2 得分 98.2%,V3.2-Speciale 达 99.5%,接近人类专家水平。Speciale 版在长链推理中优势明显,错误率降至 0.5% 以下。 • MATH(高中数学竞赛):Speciale 版斩获 92.7% 准确率,在 IMO 2025 模拟赛中获金牌,超越谷歌 Gemini Deep Think。该成绩得益于集成定理证明器,能自动验证几何和代数推导。 • AIME(美国数学邀请赛):V3.2 系列平均 85.4%,较前代提升 12%。独立评测显示,Speciale 版在 MLPerf Inference v5.1 推理基准中,处理长序列输出时延迟仅为 GPT-5 的 1.2 倍。编程与多模态任务 • HumanEval(代码生成):V3.2 达 89.6% 通过率,略高于 Claude 3.5 Sonnet,在 Aider 编程测试中得分 71.6%,标志着开源模型在软件工程领域的突破。 • MMLU-Pro(多学科知识):整体得分 87.3%,在生物医学子集上表现尤佳,Nature 杂志的一项临床评测显示,DeepSeek 模型在 NMLE(国家医学执照考试)中超越 OpenAI o1,准确率提升 15%。安全效率评估NIST 的 CAISI 报告指出,V3.2 在安全基准(如红队攻击抵抗)中得分 92/100,优于多数美国参考模型,同时价格仅为闭源竞品的 1/10。量化后,推理速度提升 2.5 倍,支持 128K 上下文窗口。 然而,评测也暴露短板:V3.2 在创意写作(如 GPQA 基准)中得分 78.5%,落后于 Gemini-3.0-Pro 约 5%。此外,独立测试显示其在边缘案例下的幻觉率仍需优化。与顶尖模型的横向比较DeepSeek V3.2 系列的发布,直接挑战了 OpenAI GPT-5 和 Google Gemini 的霸主地位。在综合基准 Arena-Hard 上,V3.2 以 91.2 分逼平 GPT-5(92.1 分),但略逊于 Gemini-3.0-Pro(93.8 分)。 17 Speciale 版在数学子集上逆转胜出,IMO 金牌成绩更胜一筹,终结了“闭源垄断高难度推理”的叙事。与其他开源模型相比,V3.2 碾压 Llama 3.1(MMLU 85.2%)和 Mistral Large(编程 82.4%),其 MoE 架构在能效上领先 30%。这一成绩源于 DeepSeek 的“渐进式蒸馏”训练策略,从 685B 基座模型提炼而出。开源生态影响与未来展望DeepSeek V3.2 的开源策略,将进一步加速 AI 民主化。开发者可通过 API 免费测试,预计短期内涌现大量 Agent 应用,如智能医疗诊断和自动化科研。长期看,这一发布或推动中美 AI 合作,缓解地缘壁垒。模型规模膨胀带来的碳足迹,以及在非英语语料上的泛化问题。DeepSeek 团队已承诺后续迭代,将融入更多多语言支持。DeepSeek V3.2 系列的亮相,不仅是技术跃进,更是开源精神的胜利。它证明,开源模型已能与闭源巨头并驾齐驱,甚至在特定领域领跑。 对于从业者和研究者而言,这是部署高性能 AI 的绝佳时机。未来,随着更多评测数据涌现,我们期待 V3.2 在真实世界中绽放光彩。参考文献: • DeepSeek 官方公告及基准报告。 • 第三方评测:NIST CAISI、Nature 临床基准、MLPerf 等。 (本文基于公开数据撰写)#DeepSeek同时发布2款新模型##ai生活指南##ai创造营#

53. 智谱GLM-4.5的开源,可以说撕破了大模型行业的虚伪面纱也不为过。毕竟那些闭源玩家老师喜欢靠参数量讲故事,而这个定位智能体基座的模型,都在用推理、代码、智能体能力的全面开源SOTA,就是有实力的东西不搞玄学虚的。况且回到真实评测里,它也照样碾压国内对手,全球第一梯队的席位坐得稳稳的。更狠的是性价比——价格打到同类1/10,速度还是最快的,这你受得了吗?要是我说给行业掀桌,你说合理不?况且作为首款原生Agentic基座模型,它证明中国大模型不止能跟跑。当开源代码在GitHub疯传,我们看到的是:真正的领先,不是藏着掖着的傲慢,而是让每个开发者都能用得起顶级AI的底气。#文科生1小时做3个网站##智谱##GLM#

54. 模型七连发刷新 SOTA ,中国正在诞生 AI 时代的 Android

55. 现在全世界最好的开源模型,是 Kimi、DeepSeek 和 Qwen

56. 国产开源模型爆发啦!大厂、独角兽纷纷放大招。本周,智谱的 GLM-4.5 火爆全网,赶在网传 GPT-5 前发布,融合推理、编程等能力。发布不到 48 小时,GLM-4.5 就登顶 HuggingFace 趋势榜,多项测试全球开源第一、国产第一、全球第三。API 性价比高,还能免费体验。你看好国产开源模型崛起吗?

57. 全球开源大模型,前十五名全是中国的

58. 荣耀 AI 技术里程碑:首个 GUI 开源大模型发布,荣耀 Magic V5 首发搭载

59. 80%美国AI初创靠中国开源模型“吃饭”!a16z投资人震惊,全球开源榜前16名全被中国包揽

60. 此AI让你3分钟变影帝,还能说多国语言

61. WAIC高能现场,国产AI弯道超车? WAIC 现场直击!国产 AI 正在以你想象不到的速度狂飙! 🔥 大模型“神仙打架”:阿里千问 Qwen 3发布,性能硬刚 Gemini! 阶跃星辰、商汤纷纷亮出“地表最强”王牌,开源大模型的王座已经成了“中国队内循环赛”! 🎬 视频模型遥遥领先:火遍全球的“猫咪跳水”竟是国产 AI 杰作?海螺、可灵两大模型实测,效果惊艳,比谷歌还好用! 🤖 AI 硬件卷出新高度:从能生成报告的智能本,到同声传译耳机,再到能陪玩能下棋的 AI 机器人…万物皆可 AI 的时代真的来了! 看完视频,一起来聊聊:当 AI 读完人类所有知识,下一步将走向何方?你,看好国产 AI 吗? #抖音博主探秘世界人工智能大会 #AI新星计划 #WAIC #人工智能 #大模型

62. #中国AI技术引发海外焦虑#漂亮国的恐慌来源于现在的开源战略正在重塑AI竞争逻辑,在闭源模型构建技术壁垒的当下,阿里的开源选择展现出不同的发展理念。这种鲶鱼效应不仅体现在技术层面,更深刻地影响着全球AI治理和发展方向。开源模式降低了技术门槛,加速了创新迭代,使更多国家和企业能够参与AI发展进程。这种开放协作的理念可能更符合人工智能技术发展的内在要求。

63. 华尔街日报:世界最好的大模型在美国,但最好的开源大模型在中国

64. #DeepSeek新模型为何被夸爆#DeepSeek新模型被广泛认可,核心在于其实现了性能与成本的双重突破。其V3模型凭借MLA架构、MoE架构和混合精度框架三大技术,在降低资源消耗的同时实现了性能跃升。训练成本仅为OpenAI同类模型的1%,却能在主流榜单跻身开源模型榜首,与顶级闭源模型性能相当。这种高效设计打破了大模型高成本的固有认知,让更多开发者能以低门槛获取强大AI能力。 文字变图像等多模态能力的实现,标志着AI从单一文本处理迈向多信息维度融合的新阶段,能更全面地理解和生成不同形态的内容。这种技术思路必然会被其他大模型借鉴,因为轻量化与多模态融合已成为行业趋势,前者解决资源瓶颈,后者拓展应用边界,二者结合能显著提升模型的实用价值,这也是AI技术落地的关键方向。#科技#

65. 在 AI 模型研发上,美国赌的是其前沿模型(GPT-5.1,Gemini 3)将始终领先世界18-24个月。 而中国赌的是其开源,高性能和廉价的可用标准模型,能在全球范围内的普及和广泛应用以及出现在不停迭代模型的蓬勃生态。从 IT 行业的历史经验看,这两拨人是可以双赢的。或者准确点说,闭源是可能赢的,而无论闭源是否胜出,其实与此同时,开源,也都没有输过。 deepseek 和 阿里巴巴在这条道路的开辟上,居功至伟。

66. 中国正凭借开源生态与应用优势,在发展潜力上实现对美国的赶超。全球前十开源 AI 模型均源自中国,64% 的市场份额远超美国的 30%,中国已构建全球领先的开源生态。中国开源模型在可定制化、安全可控、部署灵活等五大维度形成显著优势,打破了美国闭源模型的技术垄断,80% 的美国 AI 创新企业已在使用中国开源模型。这种技术民主化趋势,让 AI 从奢侈品变为基础设施,彻底重构行业竞争逻辑。AI Agent 将成为拉开价值差距的核心力量,而中国正抢占这一赛道。中国的这类企业已将 15% 的 AI 预算投向 Agent 技术,实现 1.7 倍于行业平均的营收增长。中国庞大的制造业与服务业场景,为 AI Agent 提供了丰富的训练数据,形成数据飞轮效应。美国虽在顶尖闭源模型与算力芯片上仍有优势,但中国通过开源降维与硬件绑定的生态战略,在重塑竞争规则。中国掌控的硬件供应链与应用场景成为核心壁垒,是中国 AI 长期发展的底蕴。#科技先锋官##AI创造营##AI生活指南#

67. 外媒:世界开源模型前15名已被中国垄断,DeepSeek、Qwen领衔

68. 开源大模型狂飙!盘点7月国内的开源大模型!

69. #OpenAI重回开源意味着什么#OpenAI重回开源,并非“妥协”,而是竞争与生态的双重倒逼。Meta的Llama系列以开源抢滩市场,中小开发者与垂直场景需求倒逼技术普惠——闭源模型的“高门槛”已难覆盖长尾创新。 对国产开源模型而言,这是“压力测试”更是“加速器”:一方面需直面国际顶尖模型的能力碾压,另一方面可借开源社区快速迭代,填补应用场景空白。 此次回归的新模型,或在大模型推理效率、多模态融合上实现突破,进一步降低企业使用成本。 行业趋势上,开源将成主流,但闭源在金融、政务等敏感领域仍有生存空间。开源不是终点,而是技术普惠的起点——当代码与数据流动起来,AI的“全民共创”时代才真正开始。 #ai探索计划#

70. 阿联酋实验室发布开源大模型,欲与中国DeepSeek展开竞争

71. #OpenAI重回开源意味着什么#OpenAI 重回开源:一场迟到的战略自救,还是一次 AI 霸权的重新洗牌?OpenAI 终于放下身段,时隔六年再次拥抱开源,允许开发者自由下载、微调和商用。但别急着欢呼,这并非纯粹的“技术普惠”,而是一场精明的商业博弈。 为什么 OpenAI 突然“开源”?中国 DeepSeek、智谱 GLM-4.5 等开源模型在推理、编程等任务上表现亮眼,甚至霸榜 Hugging Face,倒逼 OpenAI 不得不“开源”以维持生态影响力。 美国 AI 鼓励开放模型,而 OpenAI 若继续闭源,可能被边缘化为“AI 时代的苹果”,而非“AI 时代的 Linux”。 开放权重但不开放训练数据,既吸引开发者,又守住核心 IP,避免完全被开源浪潮吞没。 对国产开源模型有啥影响?国产模型(如 DeepSeek R1、GLM-4.5)已形成“开源四杰”格局,OpenAI 的加入不会颠覆市场,但会加剧竞争。中国模型的优势在于更宽松的开源协议,而 OpenAI 仍保留关键训练数据。GLM-4.5 在长文本、智能体任务上的表现甚至优于部分闭源模型。 OpenAI 的回归,反而可能刺激国产模型加速迭代,形成“中美开源竞速”的新局面。 新模型能力如何?接近 GPT-4 推理能力,单张 H100 GPU 即可运行,适合企业级应用。 笔记本可跑,但幻觉率较高(49%+),离商用级稳定尚有差距。仅激活部分参数,兼顾性能与效率,但对比国产模型,未必有压倒性优势。 AI 行业的未来是开源还是闭源?开源已成趋势,但不会完全取代闭源。开源推动技术民主化,适合中小企业和研究者,如 DeepSeek、Meta Llama。 大厂仍会保留最强模型(如 GPT-5),用于高利润 API 服务。 OpenAI 的“半开源”策略,或许正是未来主流——开放部分能力,但核心壁垒仍在巨头手中。 OpenAI 的开源回归,既是防守,也是进攻。它不会终结国产模型的崛起,但会让全球 AI 竞赛进入更复杂的“开放+控制”新阶段。这场游戏,才刚刚开始。

72. 如何评价阿里一周内推出的第三款开源模型 Qwen3-235B-A22B-Thinking-2507?

73. 如何评价 OpenAI 8 月 6 日推出的开源模型 gpt-oss?和国产开源模型相比怎么样?

74. 【美国“SPAC之王”查马斯:公司已转用Kimi K2】财联社10月11日电,美国“SPAC之王”查马斯透露,公司已经把大量工作需求转移到来自中国的模型Kimi K2上,K2不仅性能强,价格也比OpenAI和Anthropic便宜太多,并表示由中国引领的开源模型,正在挑战美国闭源模型的领先地位。

75. 相比美国,中国发展人工智能最大优势是:1.成本与开源生态——中国以“更低成本+开源模型”快速占领全球应用层市场。截至2025年10月,中国模型在HuggingFace累计下载量已超5.4亿次,美国多家短租、零售平台明确采用中国开源方案,理由是“速度更快、价格更低”。 2. 场景落地速度——中国庞大的制造、物流、城市场景为AI提供实时数据与试验田,形成“算法—场景—反馈”闭环,压缩从论文到产品的时间。 3. 政策与供应链韧性——出口管制倒逼国产GPU、框架和轻量化模型迭代,2024年斯坦福测试显示中美顶尖模型差距已从17.5%缩至0.3%,证明“限制反而加速创新”。 简言之,中国把AI做成了“高性价比、快速落地、逆境迭代”的系统性优势,而非单点技术领先。

76. Airbnb CEO公开表示其公司大量依赖 Qwen 模型,中国开源模型在硅谷是否已有取代GPT之势?

77. 路透社:阿里巴巴推出被誉为迄今为止最先进的开源AI编码模型

78. 如何看待「80% 的 AI 创业公司都在用中国开源模型」的现象?

79. 刚刚,智谱开源了他们的最强多模态模型,GLM-4.5v。

80. 如何评价阿里新开源的 Qwen3-Next-80B-A3B 模型?有哪些亮点值得关注?

81. LeCun预言成真!790年长视频,炼出最强开源「世界模型」

82. 李开复:零一万物AI Agent可接入任何开源模型,不要低估DeepSeek的强大能力

83. 美国AI封锁令下的中国突围战:国产大模型如何绝地反击? #下一个被AI改变的会是哪里##AI底盘首获国家级认证# 笔默君的微博视频

84. 整个HuggingFace榜,已经被中国AI模型一统江湖了。

85. #国产AI超过ChatGPT了吗#我感觉性能快追平了,国产顶尖模型的综合能力,和美国顶尖模型的差距正在飞速缩小。而且做到这些,花的钱却比美国同行少很多,所以咱们用上的AI服务,价格也往往是全球最低的之一。比如DeepSeek,就把API价格砍了一大半。开源,也是大大方方,和欧美头部公司喜欢“闭源”不同,咱们很多领先的AI模型都选择了开源。这意味着技术共享得更快,全球开发者都能一起玩,生态自然热热闹闹。所以,与其说超越,不如说咱们的AI走出了一条高效、开放且特色鲜明的路。至于选哪个?看你具体需要它帮你做什么了。

86. 刚刚!智谱开源3550亿参数GLM-4.5模型,多项性能或超越Kimi K2成全球第三

87. 【阿里开源通义DeepResearch,性能超OpenAI、DeepSeek旗舰模型】9月17日,阿里巴巴宣布开源其首个深度研究Agent模型——通义DeepResearch。该模型在HLE、BrowseComp-zh、GAIA等多个权威评测中取得SOTA成绩,表现超越OpenAI Deep Research及DeepSeek-V3.1等同类模型。通义DeepResearch具备强大的复杂任务推理与执行能力,其模型、框架与技术方案已全面开放,用户可通过Github、Hugging Face和魔搭社区免费下载使用。今年以来,阿里已连续开源WebWalker、WebDancer和WebSailor等多款检索和推理智能体,并全部斩获开源SOTA成绩。

88. 开源大模型与闭源大模型的差距是在缩小还是在扩大?关键因素是什么?

89. 【黄仁勋:#中国的开源AI是推动全球进步的催化剂#】“中国的开源AI是推动全球进步的催化剂,让各国和各行业都有机会参与这一AI革命。”——当地时间7月16日,英伟达CEO黄仁勋在中国链博会开幕式上如是表示。他还指出,“中国高速创新的英雄是你们的研究人员、开发者和企业家。中国有超过150万名开发者在英伟达平台上开发,将他们的创新变为现实。像DeepSeek、阿里巴巴、腾讯、MiniMax、百度文心一言等中国公司的模型都是世界级的,都是在中国开发并开源共享。这些模型正在推动全球AI快速发展”。 今日俄罗斯RT的微博视频

90. 【美国启动ATOM计划:直指中国“千问”开源AI领先地位】据报道,面对中国在开源人工智能(AI)领域的迅猛发展,美国正紧急推动一项名为“ATOM计划”的新战略,该计划旨在旨在重建其在开源AI领域的领导地位。计划通过建立一个总部位于美国的非营利性AI实验室,专注于开发真正开放、可供全球开发者自由使用和改进的AI模型,其核心蓝图包括配备超过10000块最先进的GPU芯片,以支撑大规模AI模型的训练与研发。该倡议于本周一启动,已获得包括知名科技投资人比尔·格利、开源平台Hugging Face首席执行官克莱蒙·德拉昂、斯坦福大学教授克里斯·曼宁等十余位行业领袖的联署支持。至于背后的原因,则是中国在开源AI方面的迅猛发展,尤其是阿里巴巴“通义千问”(Qwen)系列大模型的影响力持续扩大。Hugging Face的数据显示,越来越多的AI开发者倾向于使用阿里巴巴推出的开源模型通义千问,原因则是其性能强大且完全免费,已成为全球开发者的重要选择。Artificial Analysis的数据也显示,在全球性能最强的15个AI大模型中,仅有5个为开源模型——而这5个全部由中国AI企业开发。仅在今年7月,包括阿里巴巴就发布了四个领先的开源AI模型,而同期美国开发者则未发布任何同类成果,这也凸显了美国在开源AI生态建设上的明显短板。正是这种“千问效应”,成为了美国科技界和政策制定者警觉的直接导火索。“ATOM计划”的发起人内森·兰伯特指出:“美国若不迅速行动,将很快被甩在后面。”他强调,问题不在于缺乏人才或技术,而在于缺乏协调与资金支持。有分析人士称,若“ATOM计划”未能成功,美国不仅将在开源AI领域持续落后,更可能丧失对全球AI技术发展方向的影响力。

91. 字节发布开源自动生成视频的大模型

92. 前谷歌CEO:美国大模型可能保持封闭,而开源的中国模型更有未来

93. 全球开源大模型,前十五名全是中国的

94. DeepSeek V3.2来了,首个会"思考"的Agent模型,首个开源性能打平GPT-5的模型

95. 开源大模型与闭源大模型的差距是在缩小还是在扩大?关键因素是什么?

96. deepseek r1发布后的十个月,中美AI大模型之间的差距为什么拉大了?(个人使用感觉)?

97. 阿里巴巴开源视频生成模型通义万相Wan2.2,首创电影美学控制系统

98. 阿里再开源,首个MoE视频生成模型登场,电影级美学效果一触即达

99. 美团发布开源 SOTA 视频生成模型,该模型有哪些亮点?

100. 如何看待可灵AI全球用户超4500万,客户及开发者覆盖大部分国家及地区,中国视频模型是否已全球领先?

101. 中国AI模型在开源竞赛中领跑:OpenAI新模型未超越DeepSeek和Qwen

102. 80%美国AI初创使用中国开源模型,AI的供应链用脚投票

103. 杀疯了!阿里开源最强推理模型,一周三模型干翻全球开闭源天花板

104. Kimi K2 Thinking模型发布并开源,该模型哪些信息值得关注?

105. 一致性角色生成大对比!这四大先进AI模型,该如何选择?

106. 用提示词即可生成5秒电影级视频!阿里开源新模型大大降低 AI电影门槛

107. 阿里开源视频生成模型Wan2.2-S2V,一张图生成电影级数字人视频

108. MiniMax 的 Hailuo 02 在用户基准测试中超越 Google Veo 3,且视频成本更低

109. 阿里开源视频生成模型Wan2.2-S2V,一张图即可生成电影级数字人视频

110. 美团发布开源LongCat-Video视频生成模型,可稳定输出5分钟级内容

111. 王者争霸:Veo 3.1叫板Sora 2,谁才是AI视频 “C位” 霸主?Grok Imagine 可能超越吗?

112. 一张图加一段音频生成电影级视频,阿里开源视频生成模型Wan2.2-S2V

113. 一夜颠覆Sora神话,H200单卡5秒出片!华人团队开源AI引爆视频圈

114. 阿里开源视频生成模型Wan2.2-S2V

115. 免费且顶配!阿里开源动作生成模型Wan2.2-Animate!

116. 【AI 早报】美团开源LongCat-Video视频生成模型

117. 当 GPT、Midjourney、Perplexity、Devin等AI 软件持续占据头条之际,开源领域的对标项目也正迎头赶上。

118. 阿里云推出新一代动作生成模型 Wan2.2-Animate,全面开源!

119. 没搞错吧?!阿里又双叒开源了一个神级模型 阿里最新发布的视频生成模型Wan2.2简直太炸裂了 作为业界首个MOE架构的视频生成模型,它不仅能从文字秒变电影级视频,还集合了电影美学控制系统、复杂运动生成、精准语义理解等多项超强能力 更更更疯狂的是,昨天Wan2.2直接开源了!完全免费! 不会部署的小伙伴可以直接到官网在线体验 悄悄告诉你,这几天正好有限时送积分活动 #通义万相 #Wan #阿里云 #开源 #AI电影 #AI工具 #AI视频制作 #实用工具 #文生视频 #图生视频 #视频编辑 #提示词 #限时福利

120. 迎战Sora 2!谷歌上线视频模型Veo 3. 1,赢面几何?

121. 阿里开源全新动作视频生成模型:Wan2.2-Animate!轻松实现动作复刻与角色替换!

122. 美团视频生成模型正式发布并开源

123. 成为主角不是梦!Wan2-Animate助你轻松复刻人物动作表情,工作流搭建全攻略

124. 500美元刷新SOTA!训练成本砍到1/200,华人团队重构视频生成范式

125. 阿里云开源Wan2.2 - Animate模型,引领动作生成领域新潮流

126. Sora 2干翻Veo 3?超全对比实测:会中文脱口秀,但体操翻车

127. 一款开源的高质量视频生成应用

128. 阿里开源发布影视级美学视频生成模型 Wan2.2 电影级视频生成模型 Wan 2.2 正式开源,普通显卡都能跑! 这次的 Wan 2.2 可不是简单升级,在画质、美学控制、动作还原、语义理解等多个方面全面跃升,甚至可以说——AI 视频也开始懂“电影美学”了 #AI视频 #Wan #阿里AI #视频生成 #国产AI

129. AI 周报|字节豆包零代码生成 H5,美团 5 分钟长视频模型开源,国产大模型集体爆发!

130. 美团开卷视频生成了:开源LongCat-Video!

131. 开源且免费版的runway,EasyAnimate支持多模态的视频生成

132. Bilibili开源动漫视频生成模型AniSora V3版

133. 2025.10.27 AI动态资讯:豆包视频生成模型1.0 pro fast正式发布

134. 通义万相 Wan2.2-Animate 开源:双模式驱动动作生成,重塑视觉创作新生态

135. ComfyUI教程系列-69:Longcat 长视频生成

136. 一次生成60秒AI视频!ComfyUI可!LTXV开源 不要苦恼AI视频生成时长局限,开源AI单次就能生成60秒的视频 还能于Lora兼容(如姿势、深度图、Canny边缘等LoRA模型) 开源AI模型LTX-Video(LTXV-13B)提升支持60秒以上的长视频生成 支持ComfyUI。AIGC创作的小伙伴而言可以看看。 #Comfyui #AI #AIGC #科技 #AI视频制作

137. 字节开源视频生成模型!InfinityStar:实现动态视频的快速合成!

138. 震惊!开源界最强AI视频生成CogVideoX - 5B加速版来袭,将掀起怎样的视频创作革命?

139. 前沿技术分享:Stable Video Diffusion——三阶段训练突破视频生成瓶颈,实现高分辨率时序一致性

140. 8款AI文本生成视频工具推荐 - 免费/开源篇

141. Wan2.2开源Animate-14B,一键换电影角色动作

142. [AI工具箱]LongCat-Video:美团开源的高效视频生成模型体验

143. 月之暗面开源Kimi CLI,MiniMax开源M2模型,美团发布LongCat-Video视频生成模型

144. 震惊!开源界最强AI视频生成加速版来啦,还有整合包,你还不赶紧试试

145. 谷歌发布 Veo 3.1,硬刚 Sora !多场景对比测试,谁更稳?

146. 这三款AI工具免费生成超高真实度影片 这三款AI工具免费生成超高真实度影片 再也不用花钱买ChatGPT的Sora、Wan或其他高价影片模型了!没错,那个时代结束了。 现在你有3个免费AI工具能生成逼真影片,最棒的是——完全无限次使用,免信用卡、无隐藏费用。 Google的Veo 3 上周实测:输入几个字就瞬间生成2支影片(每支最长8秒)。用文字或图片就能让故事动起来,还能控制镜头角度,就像导演——只是不需要整个剧组。 Hugging Face上的LTX Video 堪称影片工具瑞士刀:文字/图片/影片都能互转。我曾把狗狗照片转成动态短片,过程不到1分钟!开源免安装,普通电脑就能跑。 Kling 2.1 速度稍慢(像等微波爆米花),但成果绝对值得等待。 现在你只需: ✓ 完全免费制作影片 ✓ 免订阅 ✓ 免下载 纯粹释放创意 就像把好莱坞工作室塞进口袋——而且更简单! 影片内容使用了AI生成技术 #AI影片 #生成式AI #AI工具 #AI新闻 #AI社群 #GoogleVeo #Veo3 #WanAI #LTX影片 #开源AI #AI新星计划

147. Talk | NVIDIA Research 杨帅:LongLive - 实时交互式生成长视频

148. 阿里Wan-Animate:效果炸裂!仅需一张参考图+参考视频搞定一致性动作和丰富表情迁移视频生成

149. B站重磅开源AniSora 升级至V3:动漫视频生成的颠覆性升级来了!

150. 炸裂!开源界最强AI视频生成CogVideoX - 5B加速版来袭,创作效率直线飙升!

151. Wan2.2数字人Animate-14B来了!一键复刻动作表情,电影级角色替换免费生成

152. Wan2.2-Animate开源发布:上传一张图,复刻任何视频动作!

153. 阿里发布免费开源 AI 视频生成模型 Wan 2.1

154. ICML 2025 | 高清视频秒级渲染!Sparse VideoGen打破扩散模型速度瓶颈!

155. Sora2 🆚 Veo3 的对比合集!

156. 阿里开源Ai视频生成模型,Wan2.2文生视频与图生视频-基础入门工作流教程

157. 阿里开源通义万相Wan2.2-Animate:动作生成新纪元,颠覆视频创作

158. 通义万相新成员来了!Wan2.2-Animate-14B开源:角色替换+动作驱动,动画创作更简单

159. 【第750期】美团视频生成模型来了!一出手就是开源SOTA

160. Ai动画151-Wan2.2 Palingenesis最强文生视频模型,Eddy大佬开源,动态、细节和质感获得大幅度提高,LORA兼容性强-T8 Comfyui

161. Wan2.2再次开源数字人|Animate 随意实现角色互换,动作模仿一键搞定!

162. 【327论文泛读】CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer

163. Stable Video Infinity,生成10分钟时长AI视频,ComfyUI工作流大公开!

164. CogVideo源码解读,多帧并行生成,视频连贯性显著提升! 基于Transformer架构的大规模视频生成模型,它通过多帧并行生成技术和有效的注意力机制,能快速生成动态连贯、语义匹配的高清视频,显著提升了生成效率与内容一致性。 #AI #CogVideo #文字生成视频 #Transformer #大语言模型

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章