人形机器人灵巧操作的核心突破:强化学习如何让机器手像人手一样自主微调策略
05-22 17:16
精选参考来源
精选参考来源
1. 春晚宇树四分半:全球人形机器人一哥的功夫梦
微信公众号 2026-02-19 00:00:00
2. 机器人模型R1时刻!不只学动作更学会物理推理,LIBERO 99.9%
知乎 2026-05-11 00:00:00
3. #小鹏第二代VLA发布#小鹏的世界模型进步非常快,目前世界模型生成海量的优质长尾场景用于仿真测试,小鹏仿真场景从一年前的3万增加到50多万个,每日仿真测试里程等效于3,000万公里实车测试~世界模型还可以根据VLA输出的动作,调整场景,进行RL强化学习
新浪微博 2026-03-02 00:00:00
4. 18万起,连干4小时满血输出,机器人进化得有点不礼貌了吧? #具身智能 #科技改变生活 #玩个很新的东西 #机器人达人秀 #众擎机器人
抖音 2025-12-03 00:00:00
5. 专治Demo玩家:「具身灵巧操作奥林匹克」大赛三项第一,全被国内这家公司拿下
微信公众号 2026-04-10 00:00:00
6. ML:强化学习经验数据的基本结构
微信公众号 2026-03-21 00:00:00
7. 全球强化学习+VLA范式,PI*0.6背后都有这家中国公司技术伏笔
微信公众号 2025-12-12 00:00:00
8. 春晚绝活升级背后:中国人形机器人技术有了哪些新突破?
微信公众号 2026-02-28 00:00:00
9. 当AI学会了创造世界,科幻电影中的机器人时代开始全面加速! #AI新星计划 #科技改变生活 #玩个很新的东西 #世界模型 #具身智能
抖音 2026-01-30 00:00:00
10. #小米机器人灵巧手解决方案首次公开#给小米点赞,继大模型突破后又公开灵巧手方案,再次展现了龙头担当,以技术共享推动行业进步,灵巧手的研发成果进一步完善了“手脑一体”的技术布局。令人惊喜的是新款Xiaomi CyberOne仿生手实现重大设计革新:不仅是体积较前代缩减60%,还可以完美贴合工人手部;全掌8200平方毫米触觉感应,配合创新仿生汗腺设计,散热能力也得到进一步提升。核心材料历经15万次以上抓握循环考验,寿命增加的同时,其精准度也展现出令人惊叹的表现:可完成转螺丝等工业级精细任务,同时具备捏羽毛、抛气球等柔性操作能力。这将推动机器人技术从实验室快速走向工厂应用。
新浪微博 2026-03-27 00:00:00
11. Waymo刚刚的基座模型分享:快慢双系统端到端 & 世界模型仿真
微信公众号 2025-12-10 00:00:00
12. 国内机器人"最强大脑",智商到底什么水平? #机器人 #人形机器人 #自变量机器人
抖音 2026-01-13 00:00:00
13. 今早北京,中国机器人再次震撼世界! #大有学问 #机器人马拉松 #亦庄机器人马拉松 #红衣聊AI #机器人
抖音 2026-04-19 00:00:00
14. NVIDIA 的这篇论文太棒了。利用强化学习训练通用推理模型非常复杂。不同领域的响应长度和验证时间差异巨大。数学使用快速的符号验证,而代码则需要耗时的基于执行的验证,对齐需要奖励模型评分。将所有这些异构提示混合在一起,会使基础设施变得复杂,减慢训练速度,并使超参数调整变得困难。这项新研究引入了级联强化学习(Cascade RL)框架,该框架按顺序跨领域训练模型,而不是将所有模型混为一谈。首先是用于对齐的强化学习高斯过程(RLHF),然后是指令跟随强化学习,接着是数学强化学习,然后是代码强化学习,最后是软件工程强化学习。这种顺序方法能够有效避免灾难性遗忘。在强化学习中,模型会生成自身的经验,因此只要旧的行为仍然与奖励相关,它们就会被保留下来。与监督学习中先前的数据会消失不同,强化学习优化的是累积奖励,而不是精确地拟合目标值。作为预备步骤,RLHF 通过减少冗长和重复,显著提升了推理能力,远超单纯的偏好优化。后续的领域特定强化学习阶段很少会降低之前的性能,甚至可能有所提升。以下是结果:他们的 14B 模型在 LiveCodeBench v5/v6/Pro 测试中表现优于其自主研发的 SFT 教师模型 DeepSeek-R1-0528(671B)。Nemotron-Cascade-8B 在 LiveCodeBench v6 测试中取得了 71.1% 的成绩,与 DeepSeek-R1-0528 的 73.3% 成绩相当,尽管其体积仅为 DeepSeek-R1-0528 的 1/84。14B 模型在 2025 年 IOI 大赛中荣获银牌。它们还证明,统一推理模型可以在思考模式和非思考模式下有效运行,缩小与专用思考模型之间的差距,同时将所有内容保持在一个模型中。论文: arxiv.org/abs/2512.13607#ai生活指南##ai创造营#
新浪微博 2026-01-06 00:00:00
15. 「具身原生」元年!专访原力灵机汪天才,解析具身智能的「PyTorch时刻」
微信公众号 2026-02-10 00:00:00
16. ML:从状态到策略——强化学习的最小闭环
微信公众号 2026-05-12 00:00:00
17. 机器人行业爆发在即,这家公司值得关注#机器人 #AI #光轮智能 #芯片 #算力
抖音 2025-12-01 00:00:00
18. 机器人开源革命:“免费大脑”背后的四派力量与博弈|机器人系列
哔哩哔哩 2026-03-27 00:00:00
19. 前字节机器人研究一号位加盟小米孔涛博士师从清华大学智能机器人中心主任孙富春,2016年便摘得IROS机器人抓取操作竞赛冠军,在CVPR、ECCV、NeurIPS、TIP等顶刊会议中发表过20+篇论文。2019年,他被字节揽入麾下后,曾担任过机器人研究总监,一手搭建起机器人研究团队,并主导了多项机器人技术和系统的研发落地。小米机器人团队目前大咖云集。灵巧手负责人卢泽宇是新加坡国立大学机器人学博士。在特斯拉任职的两年里,曾深度参与过Optimus机器人的触觉传感器开发、抓取与操作算法的搭建等。#汽场全开#
新浪微博 2026-03-11 00:00:00
20. 地瓜机器人携手虚时科技,补上具身智能的仿真数据“黑洞”|甲子光年
微信公众号 2026-05-12 00:00:00
21. 人形机器人的2025:一半是迷雾森林,一半是星辰大海
微信公众号 2025-12-17 00:00:00
22. 强化学习,正在决定智能驾驶的上限
微信公众号 2026-02-10 00:00:00
23. 【机器人灵巧手的黎明:2026或成精细操作元年】机器人手部技术正以惊人速度演进。ALLEX展示的15自由度机械手,能完成微型抓取和紧固作业,力感知精度达100克级别,足以胜任精密操作,同时保障人机协作安全。这意味着什么?当机械手能感知一颗螺丝的细微阻力,能像人手一样完成穿针引线般的动作,制造业的游戏规则正在被改写。有人预言2026年将是灵巧操作的突破之年——届时机器人不再只是搬运工,而是真正的"手艺人"。更深远的影响在于:一旦通用机械手成熟,工厂无需再为每个任务定制昂贵的自动化产线,现有生产线可直接由机器人"上岗"。这不是取代人类,而是释放人类去做更有创造力的事。硬件的进化速度正在追赶算力的扩张。当感知、控制、智能三者汇聚,机器人的手,终于要"活"过来了。 爱可可-爱生活的微博视频
新浪微博 2025-12-31 00:00:00
24. 别再拿真机炼丹!南大终结「肉身排雷」,机器人0成本脑内练满级
知乎 2026-03-28 00:00:00
25. 人工智能通识课:机器学习之强化学习
微信公众号 2026-05-14 00:00:00
26. 比剥橘子也能拿世界冠军?别笑,这是全球最难的机器人“高考 #科技改变生活 #玩个很新的东西 #人工智能 #具身智能#机器人
抖音 2026-04-16 00:00:00
27. 强化学习远不是最优,CMU刚刚提出最大似然强化学习
微信公众号 2026-02-05 00:00:00
28. 当AI开始懂物理世界这才叫真智能Momenta R7强化学习世界模型正式发布,各位,物理AI量产上车啦!智能辅助驾驶终于从“看见世界”迈入“理解世界”的全新阶段!!!#MomentaR7强化学习世界模型##MomentaR7物理AI##Momenta##北京车展# 一雪的微博视频
新浪微博 2026-04-27 00:00:00
29. CVPR'26 Highlight | ParticleGS:首个物理驱动4DGS预测新范式,通向4D世界模型
知乎 2026-05-07 00:00:00
30. #大v聊车# Momenta R6强化学习大模型与铂智7强强联合,辅助驾驶能力要直冲第一梯队了。丰田铂智3X搭载Momenta辅助驾驶后,实现了销量六连涨。这次铂智7,搭载了Momenta R6强化学习大模型,实现了更强的高阶智驾体验,期待实车表现! 十三先生Studio的微博视频
新浪微博 2025-11-26 00:00:00
31. 大家听没听过“强化学习”、“迁移学习”这两句AI黑话? 一开始听这词我也有点懵,今天用一个故事给大家讲清楚。#大有学问 #红衣聊AI #AIGC #脱口秀 #ai视频制作
抖音 2026-05-06 00:00:00
32. 小米真的每次都闷声干大事,之前就突然发布Xiaomi MiMo和Xiaomi MiClaw,这次更离谱,直接进军机器人行业了#小米机器人灵巧手解决方案首次公开# 从大模型,到机器人灵巧手,可以看出小米的布局很清晰,就是要实现“手脑一体”。机器人进厂干活这条赛道特斯拉一直都是行业先驱者,小米这次直接把方案公开了,看的出是想带大家一起进步啊。 这次的小米机器人灵巧手的可靠性也很有保证,体积完全与工人手部尺寸一致,能够实现15万次以上的抓握操作循环寿命,像是一些精细的活,比如:转螺丝、捏羽毛、抛气球它都能干,甚至有仿生汗腺设计提升主动散热能力,简直堪比真人[允悲]
新浪微博 2026-03-27 00:00:00
33. 手残党跪了,Pi 0.6机器人15分钟学会拧螺丝,能进厂边干边学了
微信公众号 2026-03-20 00:00:00
34. 打破具身世界模型可执行性鸿沟 !港中深-跨维智能团队提出EVA框架,用强化学习让视频世界模型真正“动”起来
微信公众号 2026-03-26 00:00:00
35. 华科&小米联合提出MindDrive:首个证实在线强化学习有效性的VLA框架......
微信公众号 2025-12-17 00:00:00
36. 理想发布了下一代自动驾驶基础模型MindVLA-o1我们通过视频可以看出,MindVLA-o1对于简单的场景也有更多的分析,因为MindVLA-o1通过3D空间理解、多模态思考、统一行为生成、闭环强化学习(Closed-loop RL)和软硬件协同设计(Hardware–Software Co-Design),构建面向物理世界智能的自动驾驶基础模型为什么我说理想的车未来只是具身机器人的其中之一呢,因为统一的原生多模态VLA模型MindVLA-o1,可控的多模态世界模型MindSim,以及强化学习基础设施RL Infra,该框架不仅服务于汽车,也可扩展至机器人及各种物理系统,也就是说这套系统后面可以用在更多形态的机器人上 周高冷Ace7的微博视频
新浪微博 2026-03-18 00:00:00
37. 车展报道45: 小米在车展上公布了辅助驾驶HAD增程版的技术方案,强化学习+世界模型。 简单理解,也就是在端到端大模型的基础上,叠加强化学习与世界模型。目前行业的技术路线已经分为VLA和强化学习两大派,前者意图引入大语言模型,让车子学习人类语言宝库中的知识; 有点像AlphoGo,学习人类棋谱战胜人类。后者让车子继续磨炼,在虚拟世界中加速磨炼,自学成材;有点像AlphoZero,自己跟自己练,第一次下山就打败了全人类。 #2025广州车展##广州车展潮这看#
新浪微博 2025-11-28 00:00:00
38. 技术人必看!这本“具身智能”黑马书,真的把我惊艳到了!
微信公众号 2025-12-04 00:00:00
39. 机器人行业有泡沫,商业化必须做起来,怎么做?#机器人 #具身智能 #安努智能 #模型 #机器人泡沫
抖音 2026-05-01 00:00:00
40. #科技先锋官# 当AI从数字空间走向实体世界,物理AI正成为科技巨头的竞逐核心。这种融合物理规律与智能算法的技术,让机器具备理解重力、摩擦等现实法则的能力,在机器人、自动驾驶等领域掀起革命。海内外巨头们的技术突破与落地案例,正勾勒出物理AI的普及路径。英伟达以平台化优势领跑,推出Cosmos世界基础模型平台,通过生成式AI产出高逼真合成数据,大幅降低物理AI训练成本。该平台可模拟雪天路况、仓库拥堵等复杂场景,已被Uber、小鹏汽车等企业采用,助力自动驾驶与机器人开发。其研发的可视化令牌器,将视频处理速度提升12倍,为物理AI的高效运算提供核心支撑。特斯拉将物理AI深度融入Optimus机器人,通过端到端神经网络与压力反馈机制,把动作精度提升50倍,焊接误差控制在0.1毫米内,已在电池分拣环节试用。国内阵营中,优必选推出热插拔自主换电系统,让机器人实现7×24小时连续作业,获比亚迪等企业订单,年交付量超500台。宇树科技、智元机器人等则在运动控制领域突破,完成人形机器人前空翻、跨省行走等极限挑战。2025年物理AI加速集中在三大方向仿真训练平台构建、高精度运动控制、多场景环境适配。2026年随着技术成熟,物理AI正从实验室走向工厂、家庭,开启智能实体赋能现实的新时代。#AI创造营##AI创作热点##一分钟视频创作季# 种斌Marco的微博视频
新浪微博 2026-01-04 00:00:00
41. 以后搭载 M100 芯片的不止是汽车了?理想的人形机器人团队正在搭建当中,招聘涉及灵巧手、双足、关节模组等,软件则是汽车同源的 VLA、RL、WM;从汽车、理想同学、AI眼镜到机器人,理想的 AI 生态版图正在持续扩大中。#理想汽车##人形机器人#
新浪微博 2026-01-22 00:00:00
42. 今日推介(第2074期):面向潜空间规划的时序平直化、大语言模型强化学习中采样计算的最优缩放策略、预训练权重领域内存在高密度的多样化任务专家、不可验证场景下推理型大模型作为后训练评估者的效能研究、基于自反思元强化学习的智能体化搜索 公·众·号:爱可可爱生活 网页链接 #机器学习##人工智能##论文#
新浪微博 2026-03-14 00:00:00
43. #小米机器人灵巧手解决方案首次公开#小米机器人迎来新进展!为了进一步提升作业能力,我们对Xiaomi CyberOne的仿生手做了一些设计改造,压缩了60%的体积让其完全与工人手部尺寸一致,增加了64%的自由度,全掌触觉传感器覆盖面积增加到8200平方毫米,实现了15万次以上的抓握操作循环寿命,并增加了仿生汗腺设计提升主动散热能力。我们希望通过这些优化,可以打造一个能稳定用于工厂作业的仿生手,将作业成功率提升至接近100%。 小米机器人的全掌触觉仿生手探索
新浪微博 2026-03-27 00:00:00
44. #智元AI发布周#如果说昨天开源百万真机数据集,为机器人提供了立足现实的根基;今日智元Genie Sim 3.0仿真平台升级,则为它们打开了无限进化的空间。 以前机器人练本事,要么在实验室慢慢磨,要么靠人工搭场景,又慢又假。现在靠自然语言就能生成3D世界,一句话就能造出厨房、超市、杂乱房间,几分钟就能跑一轮训练,效率直接拉满。而且仿真和现实的差距压到极小,机器人在虚拟里练会了,现实里基本就能用。 不光造场景,还自带评测体系,相当于给机器人智力做体检,再配上超高精度的物理模拟,连精细动作都能练。感觉智元这两步走得特别清晰:先给真实数据“喂饱”机器人,再用仿真平台让它们疯狂“刷题进化”。 照这个节奏,人形机器人走出实验室、真正商用落地,真的不远了。你们觉得这种仿真训练,会不会彻底改变整个机器人行业的研发速度?#人形机器人要从实验室毕业了##人形机器人# IT九熙的微博视频
新浪微博 2026-04-08 00:00:00
45. 想要了解机器人行业的真实进度,这场比赛值得关注#ATEC2025 #AI #机器人
抖音 2025-12-08 00:00:00
46. 世界模型+闭环强化学习怎么理解?少卿还是举了一个路口选道到最右侧的场景来说明通过奖惩的方式,让系统自己学会选道,模型在仿真器中像玩游戏一样不断去做尝试,怎么选道,什么时候发起选道,由模型自己去摸索,它只看结果这个选道场景当中有几个指标,安全、安心、舒适、合规,效率模型过的好,就给它奖励,过的不好则进行处罚,所以大家能感受到新版上面,选道正确的优先级特别高,几乎没有选道错误的情况发生图2是强化学习的训练方式,少卿上次跟我们讲的时候说是有3种,1种是车端打分器,第2种是开环训练,第3种是现在蔚来上的闭环强化学习,车端打分器的逻辑就是多条轨迹筛选出最好的,大家应该也有印象,别的品牌也上过,蔚来在上个版本也有车端打分器,所以模型有时候总有跳变,它的限制主要是模仿学习的质量开环强化学习就像是PPT,车不动,环境动,如果老司机操作就会给高分,急刹或重刹就给高分,但是模型不知道我如果不按照PPT开会发生什么闭环强化学习,必须要有一个非常还愿物理世界的世界模型,在仿真器中打游戏,模型不断输出轨迹,然后环境跟车都跟着它动,在互动当中尝试蔚来Banyan 3.3.0 用的是闭环强化学习,仿真的效果比以前要好不少,只要有见过的场景,都能造出来进行训练,这次的能力提升,很大程度取决于强化学习,过程当中也有跟AI的斗智斗勇,因为AI还是会耍小聪明去拿高分,也看到一些强化学习带来的负体验,甚至有点强规则感的选道逻辑,可能只有1%的情况会遇到,下面几个版本还得慢慢去调#新能源汽车#
新浪微博 2026-01-28 00:00:00
47. 雷军:小米机器人已在汽车工厂实习,未来5年大批人形机器人进厂
抖音 2026-03-03 00:00:00
48. #首款仓储通用人形机器人发布# 仓储行业难道要变天了吗?仓储工人会被人形机器人替代吗?近日,极智嘉发布的Gino 1,是全球第一款专门为仓储场景设计的通用机器人。Gino 1 的智能大脑叫 Geek+Brain,通过学习极智嘉多年来积累的海量仓储数据,再加上大规模的仿真强化学习训练,让它具备了接近人的操作能力。简单说,一台机器人就能完成仓库里大部分需要人工干的活儿。因为是专为仓储环境设计和训练的,Gino 1 不仅稳定可靠、干活效率高,成本上也很有优势,客户更愿意用它来替代人工。目前这款产品已经具备成熟量产能力,随时可以规模化落地。硬件方面,极智嘉全栈自研,让机器人真正走得顺、拿得稳、靠得住——头部多目视觉、三指灵巧手、全关节力控的双臂、超长续航、三维环境感知,还有强大的算力支持。软件层面,搭载了具身智能 VLA 快慢协同系统,让机器人看得懂、想得清、做得准。融合多模态感知、快慢协同决策、高频动作闭环,还能通过数据持续自我进化。目前来看,Gino 1 将给仓储自动化带来四大核心价值:复杂任务高效执行、智能行为可解释可管理、作业稳定达到工业级、场景适应能力还能不断进化。这款机器人的面世,也是极智嘉发展中的一个重要里程碑。从最早“货到人”的 AMR 机器人,到后来专为拣货设计的机械臂无人站,再到今天的通用仓储机器人 Gino 1,极智嘉正在构建一个多机器人协同、全流程智能化的仓储作业体系,真正把无人仓带进新阶段。#春节二创视频大赛##三分钟视频助燃计划##具身智能# 首款仓储通用人形机器人发布 文创客的微博视频
新浪微博 2026-02-12 00:00:00
49. 一个值得探讨的问题是:为什么在自攻螺母安装这样的任务中,小米选择了五指灵巧手,而不是传统的螺丝刀或简单的夹爪? 这是因为机器人面对的任务需要同时应对多种复杂挑战:螺母本身带有不规则的花键结构且每次抓取姿态不固定,安装过程要求毫米级的精细对准和可靠贴合,还要克服定位销磁吸力带来的动态干扰。 传统的二指夹爪难以稳定抓取此类异形零件,刚性螺丝刀也缺乏柔性调整和实时力控的能力。 而灵巧手凭借多指包络的自适应抓取、多关节微调的精确定位以及触觉反馈的实时力控,能够一次性满足这些综合要求。 同一双灵巧手还能胜任后续多种装配任务,无需频繁更换工具,有利于提升产线整体节拍和实现任务泛化。#未来5年大量机器人进小米工厂干活#
新浪微博 2026-03-03 00:00:00
50. 哎,机器人玩滑板都已经这么溜了,我都混到中登的年龄了,还不会,这可怎么办。。。-----HUSKY 是一个物理感知的人形滑板框架,将任务建模为混合动力系统。- 它推导出板倾与转向转向之间的运动学等价约束,以实现基于物理的政策学习。- 利用深度强化学习(DRL),机器人通过推力学习推进,通过转向学习方向控制。论文: 网页链接 烈焰童子的微博视频
新浪微博 2026-02-04 00:00:00
51. 又一位智驾大佬加入具身智能初创公司,后面还有几位等官宣,智驾对于人才吸引力明显弱了。 前千里智驾首席科学家秦海龙加入Vbot维他动力,任研发副总裁,将负责世界模型、空间智能、Agent OS 及人形机器人,加速具身智能进入家庭生活空间。 秦海龙长期深耕自动驾驶与空间智能方向,曾在蔚来、千里智驾等企业担任核心技术岗位,历任蔚来自动驾驶高级总监、千里智驾首席科学家,主导多模态基础模型、强化学习及端到端技术应用于下一代智能驾驶方案的研发与工程落地,在物理AI领域积累了丰富研发经验。
新浪微博 2026-03-02 00:00:00
52. 具身智能奇点已至!超越π*0.6,极佳视界自我进化VLA大模型拿下世界第一
知乎 2026-02-14 00:00:00
53. 世界模型+强化学习架构亮相,500+TOPS城市NOA方案发布!轻舟智航完成关键一跃
微信公众号 2026-04-26 00:00:00
54. 小米机器人在汽车工厂「实习」装螺丝,连续运行三小时,双侧同时安装成功率 90.2%,满足了最快 76 秒的产线生产节拍要求。小米透露采用了端到端数据驱动的控制方法,在 VLA 大模型 Xiaomi-Robotics-0 的基础上,结合强化学习技术,使机器人能够适配不同工况,保证稳定工作。装螺丝看似简单,但机器人也会装错,装歪。另外小米还尝试让机器人搬零件箱,装车标 logo,都依赖于灵巧手的能力。#小米汽车# 类星频道的微博视频
新浪微博 2026-03-02 00:00:00
55. #小米机器人已进入汽车工厂实习#小米机器人直接进厂打工了🤯小米技术官宣,人形机器人已进入汽车工厂“实习”,小米Xiaomi-Robotics-0机器人搭载VLA基座模型+强化学习技术,已经能独立完成自攻螺母上件等真实产线作业这下直接从实验室直接走进汽车工厂,这波落地也太猛了,不止是概念,是真·能上班的机器人,未来感直接拉满
新浪微博 2026-03-02 00:00:00
56. 今年英伟达 GTC,具身智能成了绝对主角。宇树科技王兴兴提出,机器人正从 “按指令干活” 的伪智能,走向能在陌生环境自主完成任务的真具身智能,类似 AI 领域的 ChatGPT 时刻,预计未来几年就会到来。核心难点在高维动作控制、真实数据效率、强化学习经验复用。宇树也通过 G1、H1、As2 等不同形态机器人,一步步把算法落地到真实场景。未来机器人不再是实验室展品,而是能走进现实的 “铁同事”,物理世界的 AI 革命才刚刚开始。
新浪微博 2026-03-18 00:00:00
57. 地平线谈对具身智能发展的判断:相比现在的智能驾驶,具身智能的大脑还在更早期的阶段,模型结构会从早期 VLA 的直觉式,慢慢转向 with 世界模型,最后走向存在潜在意识的可解释模型跨越。通用能力上从和智驾接近的环境泛化性,再到指令性的上下文理解,从大规模的模仿学习也会走向持续自修正的终身学习。数据上从短期跨本体、人类视频预训练,到中期弥合仿真与现实差距,再到长期在世界模型中训练VLA,从有限示范到无限合成的演变。 具身智能的大脑进化还是分阶段、多维度协同推进的,慢慢会指向更接近人类思维模式、并且具备自主学习和泛化能力的高阶智能。#人人都是中国智驾合伙人##2025地平线技术生态大会#
新浪微博 2025-12-08 00:00:00
58. 技术专栏 | 具身智能中的强化学习
微信公众号 2026-04-03 00:00:00
59. 具身智能+强化学习!正把人形机器人推向真实任务执行
微信公众号 2026-04-18 00:00:00
60. CEAI 2026专题论坛 | 具身大模型与强化学习论坛 | 中国具身智能大会
微信公众号 2026-04-08 00:00:00
61. 浙大和杭电团队在Science Robotics发布重磅成果
今日头条 2026-02-11 00:00:00
62. 浙大和杭电团队重磅成果
微信公众号 2026-02-08 00:00:00
63. 人形机器人强化学习+具身智能学习合集教程代找 - 哔哩哔哩
哔哩哔哩 2026-05-07 00:00:00
64. 具身智能算法与实战课程核心体系资料 - 哔哩哔哩
哔哩哔哩 2026-05-08 00:00:00
65. 讲座回顾|强化学习及其具身智能应用(二)
微信公众号 2026-05-12 00:00:00
66. YEF2026 | 具身决策前沿
知乎 2026-05-11 00:00:00
67. GR-RL
知乎 2026-01-11 00:00:00
68. 分层 RL-MPC 框架
微信公众号 2026-01-27 00:00:00
69. VLA首次实现自主削苹果! 上海AI Lab最新idea突破63自由度灵巧操作瓶颈!
抖音 2026-04-02 00:00:00
70. AAAI'26|全新机械臂灵巧手抓取框架AffordDex
抖音 2025-12-29 00:00:00
71. GraspSense
微信公众号 2026-05-05 00:00:00
72. UltraDexGrasp
知乎 2026-03-07 00:00:00
73. NUS邵林团队提出T(R,O) Grasp
今日头条 2026-04-13 00:00:00
74. 物理AI九讲(二)
微信公众号 2026-05-15 00:00:00
75. WM-DAgger
知乎 2026-05-06 00:00:00
76. 从行为克隆提取 Q 值以用于机器人强化学习
小红书 2026-05-10 00:00:00
77. 延世大学&微软研究院
知乎 2026-04-06 00:00:00
78. 部署即训练!真实机器人舰队在线强化学习训练通用机器人策略【机器人学论文解读】
哔哩哔哩 2026-05-05 00:00:00
79. 不确定性感知机器人世界模型RWM-U使基于模型的离线强化学习在机器人上得以实现
哔哩哔哩 2026-01-29 00:00:00
80. 强化学习与流模型(1)—— Offline RL 与策略提取
知乎 2026-05-21 00:00:00
81. ICLR 2026人形机器人的真机强化学习突破
知乎 2026-02-09 00:00:00
82. 5.5-4|强化学习与具身智能决策
微信公众号 2026-05-05 00:00:00
83. 用残差 latent 动作实现高效机器人世界模型!解决3D交互预测模糊坍塌问题 【机器人学习】【强化学习】
哔哩哔哩 2026-05-15 00:00:00
84. 浙大最新idea登Science子刊
知乎 2026-02-10 00:00:00
85. GTC 2026
知乎 2026-03-17 00:00:00
86. Science Robotics! 人在环强化学习灵巧操作
小红书 2025-12-27 00:00:00
87. VLA首次实现自主削苹果!上海AI Lab最新idea突破63自由度灵巧操作瓶颈
知乎 2026-03-28 00:00:00
88. Sharpa放大招
微信公众号 2026-03-11 00:00:00
89. 利用高效在线强化学习进行精确操控
哔哩哔哩 2026-05-05 00:00:00
90. 超越π0.5,复旦团队首创「世界模型+具身训练+强化学习」闭环框架丨【卓戴资讯】
微信公众号 2025-12-11 00:00:00
91. RLinf团队新作|让 VLA的RL任务在想象里训练,又不被骗!
知乎 2026-02-24 00:00:00
92. 四足机器人可微运动控制
小红书 2026-03-06 00:00:00
93. 机器人物理仿真训练-Google DeepMind MuJoCo Playground
微信公众号 2026-04-01 00:00:00
94. Direction Matters
哔哩哔哩 2026-02-17 00:00:00
95. VIRAL
知乎 2025-12-16 00:00:00
96. CVPR 2026 | 人大 & 北林提出 GeCo-SRT
微信公众号 2026-04-12 00:00:00
97. 数字孪生驱动的机器人开发
微信公众号 2026-04-29 00:00:00
98. 人形机器人灵巧手与电池技术深度分析报告
微信公众号 2026-04-13 00:00:00
99. 震惊!字节Seed发布强化学习模型GR-RL,新机器人首次实现学习穿鞋带!
微信公众号 2025-12-03 00:00:00
100. 一手调研之人形机器人-灵巧手,人形机器人能力跃迁关键支点
知乎 2026-01-19 00:00:00
101. 2026年RL(强化学习)在Robotics(具身智能)中的新范式分析
知乎 2026-02-06 00:00:00
102. td3+bc与conrft强化学习算法总结
知乎 2026-01-12 00:00:00
103. 【PNP具身解读】UTEXAS:强化学习RL for Robotics,面向真实机器人系统的深度强化学习研究进展综述;PNP推荐强化学习成套方案
微信公众号 2026-02-13 00:00:00
104. 高盛调研纪要|人形机器人灵巧手技术瓶颈与产业化前景
哔哩哔哩 2025-12-15 00:00:00
105. 上海期智&交大等团队推出FARL框架,让机器人告别“人工救火”,推动具身智能安全革命
知乎 2026-02-08 00:00:00
106. 【具身智能 346】RL-100
知乎 2026-02-24 00:00:00
107. 深扒PI π*0.6迭代式强化学习思路的来源:VLA+在线RL,实现机器人的自我进化
微信公众号 2025-12-10 00:00:00
108. RSS26|用想象重构机器人强化学习
小红书 2026-05-03 00:00:00
109. 目前最流行的灵巧手强化学习基准库之一
小红书 2025-12-12 00:00:00
110. 如何把机器人控制问题转换成 RL 问题
知乎 2025-12-22 00:00:00
111. 研报解读 | 2026:人形机器人的黄金赛点,关键在「灵巧手」摩根士丹利
微信公众号 2026-03-31 00:00:00
112. ICLR 2026 | 机器人不够聪明?VLMgineer让大模型自己「发明工具」,从设计到使用全自动
知乎 2026-03-20 00:00:00
113. 深度强化学习结合示范高效解决机器人任务
微信公众号 2026-04-17 00:00:00
114. 人形机器人量产三大技术瓶颈:灵巧手、仿生关节、传感器
微信公众号 2026-05-15 00:00:00
115. 【分层强化学习】#7 HAC:从双层到多层的高效实现
知乎 2025-11-30 00:00:00
116. 具身智能sim2real的gap从何而来,怎么减小
小红书 2025-11-29 00:00:00
117. 东京大学最新!面向异构机器人数据集的跨具身离线强化学习
微信公众号 2026-02-25 00:00:00
118. 重构跨域RL框架!理论驱动「双重对齐」让跨域迁移「质变」
微信公众号 2026-04-02 00:00:00
119. RoboDexVLM:基于VLM分层构架的通用灵巧机器人操作(2)
哔哩哔哩 2026-01-23 00:00:00
120. 10+机器人抓取与操作算法:强化学习、模仿学习、VLA、VLM等(含7个Project)
微信公众号 2025-12-06 00:00:00
121. 如何从人类视频中学习机器人操作?近400篇工作一览数据配置、学习方式、核心挑战!
知乎 2026-05-09 00:00:00
122. 仿生灵巧末端执行器设计方案:面向多任务抓取与衣物折叠的工业机器人手
微信公众号 2026-02-02 00:00:00
123. ICLR2026|山大、理想汽车和中科院联合提出离线强化学习新范式:让Transformer学会「去其糟粕」
今日头条 2026-03-14 00:00:00
124. 面向通用人形机器人的可扩展仿真到现实学习(Tairan He)
哔哩哔哩 2025-12-21 00:00:00
125. 具身智能方向PnP机器人灵巧手抓取方案
哔哩哔哩 2026-02-13 00:00:00
126. 机器人通过观察人类行为即可学习的技术有多难?
今日头条 2026-02-03 00:00:00
127. CVPR'26 | 灵巧手版π0来了! 扔掉遥操作,UniDex-VLA 点云+语言控制,成功率可达76% 灵巧操作当前受限于数据采集成本高昂、末端执行器形态异构、控制维度高难泛化三大难题。 UniDex体系,给出一套面向异构灵巧手的全栈解决方案:以第一人称人体视频为低成本数据源,构建大规模机器人中心化数据集,设计统一动作空间与3D视觉-语言-动作(VLA)模型,并搭配便携采集设备实现人机数据协同训练。 论文标题:UniDex: A Robot Foundation Suite for Universal Dexterous Hand Control from Egocentric Human Videos, arXiv:2603.22264 #灵巧手 #灵巧操作 #VLA #机器人 #机械臂 #具身智能 #人工智能 #清华大学
抖音 2026-04-12 00:00:00
128. 通过状态级轨迹拼接增强离线模仿学习 (IROS2025)
哔哩哔哩 2025-12-28 00:00:00
129. 告别纯视觉!国内首次开源高质量灵巧操作数据集,人形机器人“触觉进化”迈出关键一步
微信公众号 2026-01-09 00:00:00
130. 高校科研炸场神器!具身智能机器人开发平台:五指灵巧手 + 具身闭环逻辑,复杂物体柔性抓取全搞定
微信公众号 2026-01-15 00:00:00
131. 机械灵巧手玩魔方被视为机器人领域的“里程碑”,尤其是高自由度机械灵巧手与神经网络算法的结合,实现机器人对魔方的自主操作与复原。 类人的机械灵巧手,接近人类手指的灵活度,可模拟抓握、旋转等精细动作。通过在模拟环境中训练数万次,逐步掌握魔方操作策略,最终将技能迁移至真实场景。魔方只是起点,目标是让机器人掌握人类手部的所有技能。#机器人玩魔方 #灵巧手 #机器人#拍摄现场 #实验室日常
抖音 2026-02-28 00:00:00
132. 具身智能入门,建议用这些学习工具!
小红书 2025-12-16 00:00:00
133. 跨界科技早读 | 多指灵巧手为什么这么难?机器人灵巧操作的瓶颈与未来趋势
微信公众号 2026-04-08 00:00:00
134. 机器人仿真环境避障强化学习智能体训练全流程
今日头条 2026-04-05 00:00:00
已收藏
去我的收藏夹