• <track id="oztn4"></track>
    <sup id="oztn4"><form id="oztn4"></form></sup>
    
    
    <mark id="oztn4"></mark>
  • <dfn id="oztn4"><samp id="oztn4"></samp></dfn>
      《地爆天星小姐》电影 ,麦子交换2免费观看2023年上映时间表 ,莫妮卡《爱我几何》,大牛影库战狼6欧式少女全部视频,三年大片国语版在线看,日本空姐电视剧,电影魔镜号中文字幕,和部长一起去出差旅是第几集
      全球「AI學術(shù)頂會」精華匯聚地
      您正在使用IE低版瀏覽器,為了您的雷峰網(wǎng)賬號安全和更好的產(chǎn)品體驗,強烈建議使用更快更安全的瀏覽器
      此為臨時鏈接,僅用于文章預(yù)覽,將在時失效
      頂會專區(qū) 正文
      發(fā)私信給陸毅
      發(fā)送

      0

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      導(dǎo)語:為此,本文選擇了10篇有代表性的paper(具有一定"范式意義",引用大,或獲獎【入圍】,或工作扎實等綜合視角進行選擇), 進行詳細介紹。

      來源:公眾號“AI泡哥”

      鏈接:https://mp.weixin.qq.com/s/TfCQH_PT8jItqCZDBSugPw


      轉(zhuǎn)眼 2026 年已經(jīng)過了一半了,robotics 相關(guān)會議也陸續(xù)進入一個很適合階段性回顧的時間點:AAAI 2026,ICLR 2026已經(jīng)結(jié)束了,ICML 2026 和RSS 2026 的 accepted papers 也已經(jīng)公布,ICRA 2026(2026 年 6 月 1–5 日)和CVPR 2026(2026年6月 3日 - 7日 ) 正在召開。雖然 CoRL(2026年11月 9-12日)、NeurIPS(2026年12月6-12日 )、IROS(2026年9月27日至10月1日) 等會議還未公布accepted paper。但對于2026年來說,已經(jīng)值得先總結(jié)一下。為此,本文選擇了10篇有代表性的paper(具有一定"范式意義",引用大,或獲獎【入圍】,或工作扎實等綜合視角進行選擇), 進行詳細介紹:  涵蓋策略、VLA模型(Robot foundation Policy /VLA ),  世界模型(World model),生成式監(jiān)督(Generative Supervision),Active / Temporal Perception和Diffusion Policy 理論化等議題。

      π?: A Vision-Language-Action Flow Model for General Robot Control (RSS 2026)

      作者:  Physical Intelligence

      背景 

      Physical Intelligence的π?是很“老”的文章(2024年11月就“占坑”了【2026年1月修正版】,但是RSS 2026錄用,該文引用近2000);其后,陸續(xù)發(fā)布π?.5(2025年4月) ,π*?.6(2025年11月),π?.7(2026年4月)【π 系列論文風格很像“頂級機器人學習實驗室 + 大模型公司 + 真實機器人數(shù)據(jù)工廠”的混合體:有 Berkeley的 robot learning 脈絡(luò)(尤其 Sergey Levine / Chelsea Finn),也有 Google RT-1/RT-2/Open X-Embodiment 那條大規(guī)模機器人數(shù)據(jù)路線(Karol Hausman等),還有明顯的創(chuàng)業(yè)公司式工程和部署導(dǎo)向(面向家務(wù)這個場景)】,本著“一群羊也是趕”的精神,一起梳理一下π系列(如下圖):

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      創(chuàng)新點

      π?(從 VLM 到 VLA,解決“語言視覺模型如何輸出真實動作”):傳統(tǒng) VLM 能看圖、理解語言,但不會控制機器人。機器人需要輸出的是連續(xù)、高頻、帶物理約束的動作序列,而不是離散文本 token。π? 旨在解決能否把 VLM 改造成能直接控制機器人的 Vision-Language-Action Model ?

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,π? 的核心創(chuàng)新就是:把預(yù)訓練 VLM 的語義理解能力,和一個 flow-matching action expert 的連續(xù)動作生成能力接起來,讓大模型真正從“會看會說”變成“會控制機器人”。白話文:以 VLM/VLA backbone 提取的視覺-語言-機器人狀態(tài)特征作為 condition,再接收一個 noised action chunk 和 flow timestep,學習預(yù)測從噪聲動作到真實動作的 flow / velocity field。推理時,模型從隨機噪聲動作 chunk 出發(fā),經(jīng)過若干 flow-matching 更新步驟,生成未來 H 步連續(xù)機器人動作,即 chunked action。更直白,就是VLM+diffusion model(flow matching)->chunked action

      π?.5(從 general control 到 open-world generalization):  π? 能控制機器人,但一個更難的問題是:機器人能不能離開實驗室,到從未見過的新家里完成真實家務(wù)?π?.5 核心問題是 在家務(wù)的場景下,如何實現(xiàn)open-world generalization

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      π?.5 基于 π?,通過 heterogeneous tasks 的 co-training,使機器人能在新家中完成廚房、臥室清理等 10–15 分鐘的復(fù)雜多階段任務(wù)。具體地,π?.5 分成 pre-training 和 post-training 兩階段:pre-training 結(jié)合多源數(shù)據(jù)與離散 token;post-training 專門適配 mobile manipulation,并加入通過 flow matching 輸出連續(xù) action chunk 的 action expert。它使用的數(shù)據(jù)包括多機器人數(shù)據(jù)、高層語義預(yù)測、web data、verbal instructions 等。白話文:在 π?的基礎(chǔ)上,post-training 專門適配 mobile manipulation,以適應(yīng)家務(wù)的應(yīng)用場景。

      π*?.6(從 imitation 到 experience,解決“機器人如何通過真實部署變強”):   π? 和 π?.5 主要還是 imitation learning / co-training 路線。它們能學demo數(shù)據(jù),但真實機器人部署后一定會犯錯。π*?.6 的問題變成: 機器人能不能像人一樣,通過反復(fù)嘗試、失敗、糾正、反饋,越練越強?

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      π*?.6 的核心創(chuàng)新是把 VLA 變成一個可以 post-training / RL self-improvement 的系統(tǒng):Deploy VLA on robot ->collect autonomous rollouts->human corrections / sparse reward->train value function->estimate action advantage->advantage-conditioned VLA training->improved VLA->repeat;  這就是π*?.6 提出 RECAP:RL with Experience and Corrections via Advantage-conditioned Policies。它利用 demonstrations、on-policy collection、expert teleoperated interventions,把真實部署經(jīng)驗納入訓練。RECAP 可以讓 π*?.6 在真實任務(wù)中折衣服、組裝盒子、制作 espresso,并在一些困難任務(wù)上將 throughput 提升超過 2 倍、failure rate 大約減半。白話文:π? / π?.5 類似 pretraining + SFT;π*?.6 開始 robot RL post-training(雖然π?.5有post-training ,其目的是為了適應(yīng)家務(wù)場景;π*?.6 的post-training 是面向部署,它必然也有π?.5的post-training,因此,π*?.6 更像是post-post-training

      π?.7(從 self-improvement 到 steerable generalist foundation model): π*?.6 能通過經(jīng)驗提高某些任務(wù)性能,而進一步,π?.7可能面對的問題: 數(shù)據(jù)質(zhì)量不一致,有成功、有失敗、有慢動作、有快動作;  不同機器人形態(tài)、不同任務(wù)策略混在一起,容易學成平均行為;用戶不僅想讓機器人“做什么”,還想控制它“怎么做”;  機器人需要組合舊技能完成新任務(wù),而不只是復(fù)現(xiàn)訓練任務(wù)。

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      π?.7 的核心創(chuàng)新點是把 prompt / context 變成機器人行為的控制面板:通過 diverse context conditioning,讓模型可以在 prompt 中接收任務(wù)描述、策略信息、episode metadata、subgoal images 等,從而在未微調(diào)情況下完成復(fù)雜靈巧任務(wù)、跨 embodiment 泛化和組合式任務(wù)泛化。π?.7 還引入 world model 生成 subgoal images,讓機器人能看到一個“目標狀態(tài)草圖”。白話文:π?.7 不是取消訓練,而是改成 context-conditioned training,推理時再通過 prompt/context 選擇不同的行為模式,從而減少每個新任務(wù)的fine-tune 的需求。

      意義

      π-series 的創(chuàng)新逐步形成了一個機器人基礎(chǔ)模型系統(tǒng)范式:Robot Foundation Model =VLA backbone  + action expert  + flow/diffusion continuous action generation  + cross-embodiment data  + web / human / robot heterogeneous co-training  + high-level semantic subtask inference  + real-world experience and correction loop  + value / advantage conditioning  + metadata / subgoal / memory based context steering;最終,這條路線從 “根據(jù)語言做動作” 到“能在真實世界中提示、糾正、訓練、 steer,組合技能解決新任務(wù)”


      FAST: Efficient Action Tokenization for Vision-Language-Action Models(RSS 2026)

      作者:Physical Intelligence

      背景 

      沒看錯,又是一篇Physical Intelligence的paper (引用也500+)! FAST 之所以必須推薦:  因為π? 系列說明機器人基礎(chǔ)模型可以通過 VLA + flow matching 產(chǎn)生連續(xù)動作,而 FAST 說明:動作 tokenization 做對時,動作也可以進入類似 LLM 的 next-token prediction 訓練范式。這是因為,LLM 有 text tokenizer,VLA 也必須有 action tokenizer。問題是,機器人動作不是文字,而是連續(xù)、高頻、多維的時間序列。而已有的 per-dimension、per-timestep binning 方法在 high-frequency dexterous skills 上表現(xiàn)很差。

      創(chuàng)新點

      傳統(tǒng)做法是:每個時間步 × 每個動作維度 → 單獨分桶;這會產(chǎn)生大量強相關(guān) token。高頻控制下,相鄰動作變化很小,模型很容易學成“復(fù)制上一個 token”,訓練信號變?nèi)酢AST 的核心洞察是:robot action sequence 不是普通離散 token,而是連續(xù)時間序列,所以應(yīng)該先壓縮。為此,F(xiàn)AST用 DCT,Discrete Cosine Transform 把動作序列轉(zhuǎn)到頻域,再用 BPE 壓縮,形成 Frequency-space Action Sequence Tokenization。如下圖展示了流程:normalized action chunk → DCT frequency components → sparse frequency matrix → flatten → BPE → compressed action tokens。說白了,F(xiàn)AST就是“組合創(chuàng)新”:DCT 來自經(jīng)典信號/圖像壓縮,BPE 來自文本 tokenizer,把“壓縮式編碼”應(yīng)用到 VLA 的連續(xù)機器人動作 tokenization。

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      π? 原始路線更偏 flow matching / diffusion VLA:用 action expert 輸出連續(xù) action chunk。而FAST 證明:如果 action tokenizer 做對了,autoregressive VLA 也可以訓練復(fù)雜、高頻、靈巧任務(wù)。論文顯示 FAST 可以讓 π?-FAST 在 dexterous / long-horizon manipulation 上匹配 state-of-the-art π? diffusion VLA,同時訓練快 5 倍。同時,本文發(fā)布了可以作為 black-box tokenizer 使用的通用 action tokenizer:FAST+ 是一個 universal robot action tokenizer,訓練在 100 萬真實機器人動作軌跡上,可覆蓋 single-arm、bi-manual、mobile robots、多種 action spaces 和 control frequencies。

      意義

      FAST 將 VLA 的action representation 問題展示為機器人基礎(chǔ)模型的核心問題。與 diffusion / flow VLA 相比,F(xiàn)AST 的優(yōu)勢是訓練效率和 backbone 兼容性,π?-FAST 可在保持相近表現(xiàn)的同時顯著降低訓練計算;但其代價是 autoregressive action decoding 帶來較高推理延遲。因而,F(xiàn)AST 的定位不是替代所有連續(xù)動作生成方法,而是為 VLA scaling 提供 action-tokenization 基礎(chǔ)設(shè)施。

      FP3: A 3D Foundation Policy for Robotic Manipulation (ICRA 2026)Award Finalists

      作者:Rujia Yang等(清華等)

      背景

      機器人操作肯定是在 3D 空間中,但當前很多model 主要依賴 2D 圖像,因此其泛化能力必然有限(例如unseen scenarios、new objects、distractors 等情景上泛化能力有限)。 如果機器人要在真實世界中泛化,不能只讓模型“看見圖像”,還要讓模型“知道物體在三維空間中的位置、形狀、尺度和相互關(guān)系”。為此,F(xiàn)P3 希望通過3D point cloud 可以把這些幾何關(guān)系顯式放進模型輸入里,從而讓 foundation policy 更容易泛化。

      創(chuàng)新點

      FP3 的核心創(chuàng)新是提出了3D point cloud-based language-visuomotor foundation policy ( 1.3B 參數(shù)的 3Dfoundation policy ): 用 3D point cloud + language + proprioception 作為多模態(tài)輸入,再用 diffusion transformer 輸出 action chunk,也就是把 3D 幾何感知和 diffusion policy 結(jié)合起來(如下圖); 同時, 采用 pre-training + few-shot post-training recipe:先在 DROID 60k trajectories 上預(yù)訓練,再用每個任務(wù) 80 條高質(zhì)量 demonstrations 做 LoRA fine-tuning。

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      FP3用大規(guī)模預(yù)訓練 3D encoder Uni3D ViT-L(Large):當前 point cloud-based robot policies 通常用 sparse point cloud 和小網(wǎng)絡(luò),而 FP3 增加輸入點數(shù)到每視角 4000 points,并使用 300M 參數(shù) Uni3D ViT。同時,它不是一次預(yù)測單步動作,而是 diffusion action chunk。 這讓它更接近 Diffusion Policy / RDT / π? 這類生成式動作模型,而不是傳統(tǒng) reactive controller。

      意義

      在 2026 的 robotics ,VLA很多路線仍然是:2D image + language → action;但FP3 強調(diào)3D世界的交互,例如機器人不是只要“識別杯子”,還要知道:杯子在哪里?杯口朝哪里?能不能抓?手從哪邊過去?等這些問題 3D 的問題。FP3 展示了從 2D VLA 向 3D foundation policy 的轉(zhuǎn)向的可能。


      Dexora: Open-Source VLA for High-DoF Bimanual Dexterity(ICRA 2026)Award Finalists

      作者:Zongzheng Zhang等(清華大學等)

      背景

      當前 VLA 系統(tǒng)主要受限于兩類:要么是 dual-arm low-DoF grippers,要么是 single-arm dexterous hand,無法同時處理雙臂協(xié)作和高自由度雙手靈巧操作。Dexora 的目標就是補上這個空白:構(gòu)建第一個面向 dual-arm, dual-hand, high-DoF manipulation 的開源 VLA 系統(tǒng)。

      創(chuàng)新點

      Dexora的核心創(chuàng)新點: Dexora 是第一個原生面向 dual-arm, dual-hand, high-DoF manipulation 的開源 VLA 系統(tǒng);embodiment-matched sim + real 大規(guī)模數(shù)據(jù)采集管線,也就是Dexora設(shè)計一個能高效采集“人類雙手雙臂動作”的數(shù)據(jù)機器(Hybrid teleoperation把控制拆成兩部分: 粗粒度手臂運動【custom exoskeleton backpack 捕捉 shoulder-elbow-wrist 角度】,細粒度手指運動【Apple Vision Pro markerless hand tracking 捕捉 3D finger skeleton】);Data-quality-aware training:即使高自由度 teleoperation 也很難保證每條數(shù)據(jù)都好,Dexora 的做法不是簡單地過濾掉數(shù)據(jù),而是訓練一個 discriminator,為每段 demonstration 打質(zhì)量分,然后把這個分數(shù)變成 diffusion loss 的權(quán)重(高質(zhì)量 clip → 權(quán)重大 → 多學,低質(zhì)量 clip → 權(quán)重小 → 少學),如下圖:

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,Dexora 如何處理真實 teleoperation 數(shù)據(jù)質(zhì)量不穩(wěn)定的問題, 第一步先做數(shù)據(jù)過濾:用加速度、jerk 等指標篩掉抖動大的軌跡,再通過 replay 檢查任務(wù)是否成功、是否無碰撞,得到高質(zhì)量 demo; 第二步訓練一個 discriminator,讓它根據(jù) observation、language、action chunk 和 policy 兼容性分數(shù),判斷每段數(shù)據(jù)質(zhì)量高低;第三步在訓練 diffusion-transformer policy 時,把 discriminator 的質(zhì)量分數(shù)變成 loss 權(quán)重:高質(zhì)量數(shù)據(jù)多學,低質(zhì)量數(shù)據(jù)少學。白話文,Dexora 不是盲目模仿,而是“有選擇地學”

      意義

      為什么Dexora 值得推薦,是因為它是“高自由度雙臂雙手靈巧操作”的重要基礎(chǔ)工作之一。現(xiàn)有 VLA 多集中在單臂夾爪、雙臂低自由度夾爪,或單臂靈巧手,難以覆蓋真實世界中需要雙手協(xié)作和手指精細控制的任務(wù)。而Dexora 的核心 insight 是:與其從低自由度夾爪策略向上“補全”靈巧手動作,不如直接在 36-DoF 雙臂雙手平臺上訓練 rich embodiment policy,再向低自由度 embodiment 投影。實驗顯示,Dexora 在 basic tasks 和 dexterous tasks 上均優(yōu)于 DP、π? 和 GR00T N1,并能跨 single-arm gripper、dual-arm grippers、single-arm low-DoF hand 泛化。它的意義是為高自由度機器人基礎(chǔ)模型提供了硬件、數(shù)據(jù)、訓練和跨 embodiment 泛化的提供諸多參考。


      SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning(ICLR 2026)

      作者:Haozhan Li等(清華大學等)

      背景

      當前 VLA 主要依賴大規(guī)模機器人demo數(shù)據(jù)做 SFT,但機器人軌跡昂貴、稀缺且覆蓋有限,導(dǎo)致模型在長時程任務(wù)、分布外場景和真實部署中泛化不足。而SimpleVLA-RL 的想法是:借鑒 LLM 的 RL中reward思路,VLA 也可以通過任務(wù)成功/失敗的reward,學會action planning。

      創(chuàng)新點

      SimpleVLA-RL的核心創(chuàng)新點:  把 LLM 里的 rule-based online RL 思路遷移到 VLA,形成一個面向機器人閉環(huán)交互的 RL post-training 框架; 這是通過基于 veRL 而擴展出 VLA-specific trajectory sampling、parallel multi-environment rendering、training-inference-rendering 一體化框架和優(yōu)化后的 loss computation;而獎勵設(shè)計非常簡單:一條軌跡任務(wù)成功就給 1,失敗就給 0。 白話文,模型的學習由“行為驅(qū)動”變?yōu)?/span>“結(jié)果驅(qū)動”:以前的SFT(Demo演示“抓起來、移動、放下”, 模型就模仿這條路線)是行為驅(qū)動,關(guān)鍵看像不像;而SimpleVLA-RL是嘗試不同動作,關(guān)鍵看成不成功。如下圖:

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,左邊表示傳統(tǒng) SFT 只能利用有限離線 trajectories,而右邊 SimpleVLA-RL 讓 policy 和 environment 閉環(huán)交互,采樣多條 trajectories。 每條軌跡根據(jù)任務(wù)是否成功獲得 0/1 outcome reward,然后用 group advantage computation 更新 policy。圖中還標出三個探索增強模塊,旨在解決VLA 做 RL 時探索不夠、獎勵太稀疏、梯度容易消失的問題:dynamic samplingSimpleVLA-RL會對同一個任務(wù)采樣多條軌跡,例如 8 條,
       如果這 8 條全成功或全失敗,GRPO 的 group advantage 會變成 0,模型學不到“哪條軌跡更好”。所以 dynamic sampling 會丟掉這種“全對/全錯”的 group,只保留:同一個任務(wù)(有的軌跡成功,有的軌跡失敗)
      )、higher clip rangeGRPO / PPO 會用 clip range 限制 policy 更新幅度,防止模型一下子改太猛。
       普通范圍類似:[0.8, 1.2];SimpleVLA-RL 把上界調(diào)高到:[0.8, 1.28],其目的是:
      如果某些低概率動作最后導(dǎo)致任務(wù)成功,就允許模型更大膽地提高這些動作的概率。直覺是:機器人以前不敢試的動作,比如“直接推過去”而不是“抓起來再放下”,如果成功了,RL 應(yīng)該更積極地獎勵它
      )、higher rollout temperaturetemperature 控制采樣隨機性。如果temperature 低,模型更保守,老是重復(fù) SFT 學到的動作;temperature 高,模型會嘗試更多不同動作。論文把 rollout temperature 從 1.0 提高到 1.6,讓 VLA 在環(huán)境中探索更多軌跡。這有助于發(fā)現(xiàn)新策略,比如論文里提到的 pushcut:模型不再模仿demo里的“抓-移動-放下”,而是學會直接“推過去”)。

      意義

      為什么SimpleVLA-RL值得推薦,因為它是“通過 reinforcement learning 做 post-training”學習robot foundation model ,而不是SFT。現(xiàn)有 VLA 的核心瓶頸是機器人demo數(shù)據(jù)昂貴且有限,SFT 往往只能復(fù)制訓練軌跡,遇到新場景、新物體或長時程任務(wù)時泛化不足。而SimpleVLA-RL 借鑒了 LLM reasoning model 的 RL 經(jīng)驗:不必為每一步設(shè)計復(fù)雜獎勵,只需用任務(wù)成功/失敗作為reward,就可以讓 VLA 在環(huán)境交互中改進 step-by-step action planning。它的意義在于基于已有 SFT policy 基礎(chǔ)上,通過仿真 RL 提升泛化、長時程執(zhí)行和真實部署等能力。


      Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets(RSS 2026)

      作者:Chuning Zhu等(University of Washington等)

      背景

      機器人學習依賴高質(zhì)量demo,但demo昂貴且規(guī)模有限,而大量 video data 雖然便宜豐富,卻沒有 action 標注,難以直接用于 policy learning;同時,video world model 能學習未來畫面變化,卻通常和 action policy 分離,難以直接提升機器人控制。為此,本文UWM(Unified World Models)認為:policy learning 和 world modeling 不應(yīng)該是兩個模型,而可以是同一個 video-action diffusion model 的不同推理模式。

      創(chuàng)新點

      UWM(Unified World Models)的核心創(chuàng)新點:把 action diffusion 和 video diffusion 放進同一個 diffusion transformer 中。 它最關(guān)鍵的設(shè)計是給 action 和 future observation 分別設(shè)置獨立 diffusion timestep:t_a 和 t_o'; 通過控制這兩個 timestep,模型可以在推理時切換不同功能:policy、forward dynamics、inverse dynamics、video prediction;當把 future observation 的 timestep 設(shè)為最大噪聲 T,相當于“遮住未來圖像”,模型就退化成 policy p(a|o); 這種設(shè)計還允許模型利用 action-free video data:沒有動作標簽時,就把 action 設(shè)成 fully noised / masked,仍然能訓練視頻動態(tài)理解。白話文,可以把 UWM 理解成一個“機器人因果關(guān)系學習器”(普通 imitation learning: 看到當前圖像 → 預(yù)測動作;UWM:  當前圖像 + 動作 + 未來圖像
      → 學習三者之間的關(guān)系→推理時按需要遮住某一部分→得到 policy / dynamics / inverse model / video predictor
      )。如下圖:

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,Unified World Model 可以通過不同 timestep 設(shè)置,同時扮演 policy、forward dynamics、inverse dynamics 和 video prediction 四種角色。圖中間的 UWM 接收 current observation、actions、future observations,并分別對 action 和 future observation 做 diffusion。

      意義

      為什么推薦UWM(Unified World Model )呢? 因為它把 imitation learning、world model、video prediction、inverse dynamics 這些原本分散的方向統(tǒng)一到一個 diffusion framework 中。 其重要意義在于證明 action-free video data 可以通過統(tǒng)一 diffusion timestep 機制進入 robot policy pretraining,而不是只能依賴昂貴 action-labeled robot trajectories。 實驗上,UWM 在真實機器人任務(wù)和 LIBERO benchmark 中整體優(yōu)于 DP、PAD、GR1,并且 co-training action-free videos 后進一步提升 OOD 魯棒性。 對產(chǎn)業(yè)來說,它有可能降低了對大規(guī)模真實機器人demo的依賴,因為企業(yè)通常更容易獲得視頻數(shù)據(jù)。


      Robotic Manipulation by Imitating Generated Videos Without Physical Demonstrations(ICLR 2026)

      作者:Shivansh Patel等(UIUC等)

      背景

      過去從視頻學機器人操作大致有三條路線:路線 1:真實人類視頻 / 互聯(lián)網(wǎng)視頻(問題:視角、手型、物體、環(huán)境、機器人 embodiment 差距很大);路線 2:專門采集和機器人環(huán)境對齊的人類 demo video(采集麻煩,必須控制視角、物體、場景,很難 scale);路線 3:VLM 直接預(yù)測 keypoint / constraint / goal問題(太稀疏,缺少完整動作過程,容易丟掉關(guān)鍵幾何與時序細節(jié))。本文RIGVid:生成視頻雖然不是機器人動作數(shù)據(jù),但它包含了“物體應(yīng)該如何運動”的視覺軌跡;只要能把視頻中的物體運動穩(wěn)定提取成 6D object pose trajectory,就可以繞過 action label,直接變成機器人可執(zhí)行軌跡。雖然,本文和上一篇 UWM旨在利用“沒有動作標簽的視頻”來減少對真實 robot demo 的依賴,但上一篇 UWM 是“把 video data 變成 policy pretraining 信號”,本篇 RIGVid 是“把 generated video 直接變成 object trajectory”。

      創(chuàng)新點

      本文RIGVid的核心創(chuàng)新點機器人只模仿 AI-generated videos,不需要真實 physical demo,也不需要 task-specific robot training。 它是把生成視頻轉(zhuǎn)成 6D object pose trajectory,而不是只提取稀疏 keypoint、dense flow 或 goal image。 具體,它使用 monocular depth estimation + 6D object tracking + object-to-robot retargeting,把視頻里的物體運動變成機器人末端執(zhí)行軌跡,并且支持 closed-loop execution:執(zhí)行時實時追蹤物體,如果偏離軌跡,就回退到最近成功點并繼續(xù)執(zhí)行。 白話文,普通 imitation learning是人類或機器人真實demo → 訓練 policy → 機器人執(zhí)行;而RIGVid是AI 生成一個操作視頻 → 追蹤視頻中物體怎么動 → 機器人照著這個物體軌跡動。如下圖:

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,RIGVid 的完整 pipeline:輸入初始 RGB-D 圖像和語言命令,例如 “Pour Water On Plant”,視頻生成模型先生成一段操作視頻;隨后單目深度估計器給每一幀補深度,6D object tracker 從 RGB-D 視頻中提取物體位姿軌跡;最后系統(tǒng)先抓住物體,再把 object trajectory retarget 成 robot end-effector trajectory。本文不預(yù)測機器人動作,而是預(yù)測/提取“物體應(yīng)該如何運動”,再讓機器人去實現(xiàn)這個物體運動。

      意義

      為什么推薦RIGVid呢?因為它說明了機器人可以從生成模型“想象出來”的視頻中獲得操作監(jiān)督,而不必完全依賴真實機器人demo,這是generative model × robotics 方向非常有代表性的論文。這意味中,有可能把生成式視頻模型從“視覺內(nèi)容生成工具”推進為“機器人操作監(jiān)督來源”。這對服務(wù)機器人、家務(wù)機器人、輕工業(yè)操作、低頻新任務(wù)適配都很有啟發(fā)。


      AVA-VLA: Improving Vision-Language-Action Models with Active Visual Attention(CVPR 2026)

      作者:Lei Xiao等(LiAuto Inc等)

      背景

      現(xiàn)有 VLA 大多把每個時刻的圖像單獨處理,默認當前圖像已經(jīng)包含完整狀態(tài)(這里隱含一個假設(shè):當前 observation 足夠代表完整世界狀態(tài),也就是把機器人操作當成 MDP( Markov Decision Process)),但真實情況是機器人操作往往是部分可觀測的,需要記住過去動作、過去觀察和交互歷史。也就是,真實機器人控制更像 POMDP(Partially Observable Markov Decision Process):當前圖像只是局部觀察,很多信息可能被遮擋、被歷史動作改變,或者需要從之前的交互中推斷。本文指出,現(xiàn)有 VLA 逐幀獨立處理視覺輸入,會導(dǎo)致模型每一步都“重新看圖”,無法利用過去上下文來關(guān)注關(guān)鍵區(qū)域。

      創(chuàng)新點

      AVA-VLA的核心創(chuàng)新點:以 POMDP的角度去建立VLA policy learning:動作不只依賴當前 observation,也應(yīng)該依賴歷史 belief / recurrent state。 其中,提出 recurrent state:從上一時刻 action-related hidden state 中提取壓縮表示,用來保存歷史上下文。 同時,提出了 Active Visual Attention, AVA 模塊:用 recurrent state + 當前視覺 token + 語言指令,動態(tài)計算每個視覺 token 的重要性,進而把重要性權(quán)重注入 LLM 的 attention matrix,讓模型在所有層中增強任務(wù)相關(guān)視覺 token、削弱無關(guān)視覺 token。 訓練上采用 truncated BPTT,避免完整長序列反傳帶來的顯存和計算爆炸。 白話文,AVA-VLA 可以理解為給 VLA 加了一個“任務(wù)的記憶 + 聚光燈”:上一時刻 hidden state → recurrent state:我剛才做了什么、看到了什么、任務(wù)進展到哪里→Active Visual Attention→當前圖像里哪些 token 更重要?→增強 stove switch / object / contact area→削弱背景、桌面、無關(guān)物體→預(yù)測當前 action chunk。

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,兩個連續(xù) timestep:上一時刻的 hidden state 經(jīng)過 MLP 投影成 recurrent state,這個 recurrent state 一方面用于初始化當前 action placeholder,另一方面輸入 AVA 模塊。AVA 模塊把 recurrent state 與當前視覺 token、文本 instruction 結(jié)合,通過 FiLM、cross-attention、self-attention 生成 soft importance scores。然后這些視覺 token 權(quán)重會調(diào)制 LLM backbone 內(nèi)部 attention matrix,使模型在當前幀中主動關(guān)注與歷史和任務(wù)相關(guān)的區(qū)域。本質(zhì)上,AVA-VLA 就是把上一時刻的決策隱狀態(tài)變成當前視覺處理的控制信號。

      意義

      為什么推薦AVA-VLA 呢 ?,因為本文揭示了 VLA 不是單幀圖像理解模型,而是具有閉環(huán)序列的決策系統(tǒng)。很多 VLA 論文關(guān)注更大的 backbone、更好的 action tokenizer、更強的 decoder、更大的數(shù)據(jù)集;AVA-VLA 則說明,即使你的模型足夠大,如果每一步都把當前圖像當作完整狀態(tài),仍然會在丟失重要的上下文。對于實際部署的機器人而言,常面對遮擋、視角變化、動作執(zhí)行錯誤或誤差等等問題;這些都不是單幀 VLA 能正確解決的。


      Recovering Hidden Reward in Diffusion-Based Policies  (ICML 2026)

      作者: Yanbiao Ji等(上海交大等)

      背景

      Diffusion Policy 通過學習 demo進而生成復(fù)雜、多模態(tài)動作,但本質(zhì)仍然是 behavior cloning:只學“怎么做”,沒有學明白“為什么這個動作更好”。也就是說,它知道動作的數(shù)據(jù)大體分布,但不知道這些動作背后的偏好、成功的原因、動作好壞的排序等。本文指出,diffusion-based policies 通常模仿 trajectories,但沒有顯式學習到rewards。但同時,另一條路線是 IRL / reward learning,但傳統(tǒng) IRL 往往訓練不穩(wěn)定、計算開銷大;而普通 energy-based imitation 又常常只是把 energy 當作 action score,不一定能解釋為可識別的reward。為此,本文認為Diffusion Policy 可能已經(jīng)隱含了專家策略的 reward gradient / soft Q-function gradient,也就是擴散模型學到的 score field,本質(zhì)上可能包含“專家偏好往哪里提升”的方向。白話文,普通 Diffusion Policy:學一堆箭頭,告訴動作從噪聲往哪里去,最后生成像專家的動作;本文的EnergyFlow:不只學箭頭,還學一張“能量地形圖”。好動作在低能量谷底,壞動作在高能量區(qū)域(箭頭是這張地形圖的梯度)。

      創(chuàng)新點

      EnergyFlow的核心創(chuàng)新點:用一個 scalar energy function Eθ(s, a) 來參數(shù)化擴散策略,而不是直接預(yù)測 denoising field; 通過自動微分得到 denoising score:Sθ = -?aEθ(s, a),從結(jié)構(gòu)上保證 learned field 是 conservative / integrable field。 同時,提出 centered shaping reward,通過減去 state-dependent baseline 來消除 energy 中無法識別的狀態(tài)偏置,使其更適合作為下游 RL reward。 本質(zhì)上,它把 diffusion-based imitation learning 和 inverse reinforcement learning 接起來,形成“生成動作 + 恢復(fù) reward”的統(tǒng)一框架。白話文,普通 diffusion policy 像是:給你一個動作噪聲,模型告訴你:  往左一點、往上點、再靠近專家動作一點;EnergyFlow 則像是:模型先學出一張能量地圖( 好動作 = 山谷,壞動作 = 山坡 / 山頂),然后動作生成時( 沿著能量下降方向走到低能量動作),reward 提取時選擇低能量( = 更像專家偏好的動作)。

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,左邊是普通的Diffusion Policy:模型直接預(yù)測 denoising vector field εθ(s, a),這個 field 可以把噪聲動作一步步變成專家動作,但它沒有顯式能量函數(shù),因此很難直接輸出 reward。而右邊是 EnergyFlow:模型先參數(shù)化 scalar energy Eθ(s, a),再用其梯度 ?Eθ 作為 denoising field;這樣同一個模型既能生成動作,也能輸出 reward signal。概括而言,Diffusion Policy 只學“動作往哪里去”,EnergyFlow 學“為什么往那里去”的能量地形,也因此,EnergyFlow 把 diffusion policy 從純生成模型推進到可解釋的 preference / reward model。

      意義

      為什么推薦EnergyFlow呢?因為一般的 Diffusion Policy能生成平滑、多模態(tài)、接觸豐富的動作;但沒有一個可解釋的機制,而EnergyFlow有可能成為解釋專家行為背后的reward的基礎(chǔ)。也就是,它可能把如下三個方向連接起來:Diffusion Policy(動作生成)+Energy-Based Model(偏好建模)+Inverse Reinforcement Learning(reward)。真實場景里 reward engineering 很貴,人工設(shè)計 dense reward 很難,而 sparse success reward 又太弱。EnergyFlow 提供了一種可能路徑:先用 demo訓練 EnergyFlow→得到可生成動作的 policy→同時得到 energy-based reward signal→用于 downstream RL / online improvement / policy refinement;這對各種機器人都有價值,因為這樣可能降低 reward 設(shè)計成本,并讓demo數(shù)據(jù)不僅用于模仿,還能轉(zhuǎn)化成后續(xù)強化學習的reward機制。


      OmniRetarget: Interaction-Preserving Data Generation for Humanoid  Whole-Body Loco-Manipulation and Scene Interaction (ICRA 2026 Best Paper Award on Robot Manipulation and Locomotion)

      作者:Lujie Yang等(Amazon FAR (Frontier AI & Robotics)等)

      背景

      人形機器人要學復(fù)雜動作,需要大量高質(zhì)量的人類動作demo。但把人的動作轉(zhuǎn)到機器人身上很難,現(xiàn)有方法常常會出現(xiàn)腳滑、穿模、接觸不準等問題(現(xiàn)有方法大致有兩類,第一類是 teleoperation:可以利用人類實時反饋避免一些 retargeting 錯誤,但成本高、勞動密集、不適合大規(guī)模數(shù)據(jù)生成,而且人和機器人 embodiment gap 仍然存在;第二類是 offline retargeting,通常依賴 keypoint matching、orientation matching 或 soft penalty,能把人類動作轉(zhuǎn)成人形機器人動作,但經(jīng)常忽視人-物體、人-地形之間的交互關(guān)系,容易出現(xiàn)各種問題【foot skating:腳應(yīng)該貼地卻在滑;penetration:機器人身體或手穿進物體/地形;contact loss:該接觸時沒有接觸;object interaction mismatch:人類搬箱子的相對關(guān)系沒有被機器人保持】)。結(jié)果是,機器人后續(xù)用強化學習訓練時,不得不靠一堆復(fù)雜的獎勵函數(shù)來彌補這些數(shù)據(jù)帶來的問題。而本文認為:人形機器人 retargeting 不能只匹配人的關(guān)節(jié)點,而要保留“人—物體—地形”的空間關(guān)系和接觸關(guān)系;只要demo足夠干凈,后續(xù) RL 就可以用極簡 reward 學到復(fù)雜 whole-body skills。白話文,白話說,傳統(tǒng) retargeting 像是在問:人的手在哪里?人的腳在哪里?機器人盡量把手腳放到類似位置;但本文 OmniRetarget 問的是:
      人的手和箱子是什么關(guān)系?腳和臺階是什么關(guān)系?身體、物體、地形之間的空間結(jié)構(gòu)是否被保留下來?
      機器人這樣做會不會穿模、腳滑、超關(guān)節(jié)限制?

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      創(chuàng)新點

      OmniRetarget的核心創(chuàng)新點:用 interaction mesh 顯式建模身體、物體和地形之間的空間/接觸關(guān)系; 用 Laplacian deformation minimization 保持交互結(jié)構(gòu):不是簡單匹配 keypoints,而是盡量保持 source interaction mesh 和 target interaction mesh 的局部幾何關(guān)系。 同時,引入 hard kinematic constraints:包括 collision avoidance、joint limits、velocity limits、foot sticking,避免穿模、越界和腳滑;當生成高質(zhì)量 reference motion 后,RL 訓練可以極簡化:只用 5 個 reward terms、4 個 robot domain randomization terms、純 proprioceptive observation,就能完成復(fù)雜任務(wù)。 白話文,可以把 OmniRetarget 理解成一個“人形機器人動作翻譯器”:Human motion + object + terrain→interaction mesh:記錄人、物體、地形之間的相對關(guān)系→constrained optimization:找一個機器人姿態(tài)序列→既像人類動作,又不穿模、不腳滑、不超關(guān)節(jié)限制→生成 reference motion→RL policy 學會真實機器人可執(zhí)行動作。如下圖:

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,左邊輸入來自 LAFAN1、OMOMO 和 in-house MoCap 的 human motions;中間通過 interaction mesh retargeting,最小化 source mesh 和 target mesh 的 Laplacian deformation,同時滿足 kinematic constraints; 隨后進入 efficient augmentation:同一條demo可以變成不同 terrain、object type、object pose、spatial configuration 下的多條 reference trajectories ;  右側(cè)是 RL training:使用生成的 kinematic reference,只需 5 個 rewards、4 個 domain randomization terms 和純 proprioceptive observation,就能訓練 policy ; 最右邊顯示 zero-shot sim-to-real:這些 policy 直接部署到真實 Unitree G1 上完成復(fù)雜場景交互任務(wù)。

      意義

      為什么推薦OmniRetarget呢?因為很多人形機器人 RL 的困難來自demo (reference motion )數(shù)據(jù)有問題:腳滑、穿模、接觸錯位。于是大家不得不用大量 reward terms、contact schedule、foot air-time penalty、slip penalty 等東西補救。OmniRetarget 的工作說明:如果先把數(shù)據(jù)做好,后面的 RL 就可以簡單很多。也就是,核心問題從“如何設(shè)計更復(fù)雜 reward”變成“如何生成更好的demo”問題,只要 reference motion 保留了關(guān)鍵交互關(guān)系,純 proprioceptive policy 也可以完成很復(fù)雜的交互,進而可以顯著簡化 RL、提升 sim-to-real 成功率。






      分享:
      相關(guān)文章
      最新文章
      請?zhí)顚懮暾埲速Y料
      姓名
      電話
      郵箱
      微信號
      作品鏈接
      個人簡介
      為了您的賬戶安全,請驗證郵箱
      您的郵箱還未驗證,完成可獲20積分喲!
      請驗證您的郵箱
      立即驗證
      完善賬號信息
      您的賬號已經(jīng)綁定,現(xiàn)在您可以設(shè)置密碼以方便用郵箱登錄
      立即設(shè)置 以后再說
      主站蜘蛛池模板: 六一儿童节小朋友们好歌曲| 窃听风云在线观看| 金猴降妖免费| 《偿还2》完整版| 斗罗大陆合集| 厨神全40集电视剧免费观看| XL司令第一季动漫| 狂暴之路| 德川公主| 插曲的痛60集全集完整版| 追光的日子30集免费观看| miya.737.mon| 蛇经常吐舌头是因为什么呢| 美国1985G点免费| 中华大丈夫高清| 《丰满的女学生》| 《外出》2015版| 俄罗斯女超人| 肉蒲团电影下载| 欧美日韩电影维修工的艳遇5| 陪读妈妈免费观看全集| 97播放| 五福临门电视剧全集在线观看| 今夜无法入睡电影免费观看| 嗜血狂魔2012| 《飞机上特殊服务5》在线观看| 电视剧李卫辞官| 日本伦理电影替夫还债| 美景之屋电影完整版在线播放| 在线观看完整免费高清满天星| 十二罗汉迅雷下载| 电视剧歧路兄弟| 怒放电视剧免费观看全集| 凯登克里斯版《壮志凌云》 | 坎贝奇品味人生电影在线观看| 夏家三千金27| 四个女忍者 满天星 雪姬| 赘婿免费观看| 八尺夫人正版免费观看| 僵尸福星仔下载| 男女一起愁愁免在线观看| 刘亦菲晒38岁生日照| 妻子8免费播放在线观看第二季| 《毒战2》电影| 高清在韩国成为房主的方法未删减| 美国Xxxx| 三个女人共享按摩| 长津湖西瓜免费播放| 电影《法国空少》完整版| 爱的罗曼史| 麦乐迪女超人》| 人妻在卧室被老板疯狂进入国产 | 指环王在线观看| 步步电视剧| 高清爆弹未删减| 监视者们2| 大宋少年志1| 新奥特曼 在线观看| 叶玉聊电影全集| 下一站是幸福在线观看全集| 全力以赴的行动派综艺免费观看| oh透明人间| 法国空姐2023(多塞尔航空)| 浴血黑帮第四季| 落魄的贵族琉璃川第一季| 《黑白决》免费观看| 日本在线最色| 女教授的隐密魅力| 电影美容室的特殊待遇7| 棒棒第12集免费观看视频播放| 斗罗大陆免费完整观看电视剧| 迷你宝贝| 韩国电影失足美女色诱猎物| let美人| 桃谷绘里香 ed2k| 双女任务在线观看| 布兰迪黑白配国语版免费看| 公公的浮之手电影 | 金刚大战哥斯拉在线| 北海市| 深圳卫视直播在线观看| 《家庭矛盾》麦乐迪| 吃代餐减肥肝衰竭| 韩剧办公室蓝色隐身帽子电影| 八毫米 电影| 越狱全集| 火烧天堂镇| 仙逆128集完整版高清在线观看| 小品卖拐| 龚玥菲新金梅3D无删减| 《私人家教》1983版又叫什么| 电视剧胭脂| 十七·3电影高清免费播放| 《一年后的你》动漫免费观看| 姐妹牙医完整版免费 在线观看| 电影风声未删减版在哪里可以看| 神奇的眼镜韩国免费观看完整版| 大清十二刑| 少年神探狄仁杰20| 我们都要好好的在线观看 | 天天想你电影免费观看全集| 一出好戏免费观看高清| 《辞职欢送温泉之| 异形:夺命舰 电影| 修理工绝遇中文版| 致美丽的你第三集| 电影《觉醒年代》免费观看| 电影银饰| 东北虎在水池放屁| 我的姐姐是电影免费观看全集| 荒野独居第七季| 《部长出差的日子》在线观看| 《密爱》2002完整版| 司令第一季无马赛| 延禧攻略70集免费播放完整版| 灵幻少女外传最强驱魔师vs人面犬 | 1980禁忌1980禁忌1芭芭拉全集| 成仁高清影视| 台湾版《棘手狂情》电影免费观看下 | 血腥的夜晚| 西行纪第2季| 姐姐vcd在线看免费高清电视剧| 女子拒绝同事表白后遭辱骂| 狂飙免费播放| 万年牢ppt| 《战争之暴行女囚》| 西瓜视频网| 小凤的新婚| 你的名字重映2024| 美国伦理《生殖按摩》在线| 溪暮悦影短剧免费播放大全 | 《女教师的味道3》| 琪琪电影网午夜理论片717西瓜| 电影《透视》在线观看| 高清命悬一枪未删减| 爱我几何电影完整版在线播放免费观| 韩国电视剧拜托小姐| 《贝拉6》免费观看高清| 特攻联盟| 微电影妈妈的职业| 神武主题曲| 公之浮之5HD高清版| 极道之恋| 三年高清在线观看免费播放电影| 豺狼的日子 第一季 电视剧| 新版金银悔5-8普通话1| 隐形的亿万富翁电影免费观看| 非常主播| 暖暖 在线观看 免费| 《和讨厌的部长出差》日本电影| 派出所的故事| 海之声如如免费完整版动漫| 完美诊所| 卖房子的女销售3在线播放| 不扣钮扣的女孩| 都市外乡人电视剧| 毒魔复仇2免费观看完整版高清| 人民的名义 李达康| 无神之地| 满天星护士学校在线看| 李东生鹰的重生| 金太郎的幸福生活百度影音| 白峰美羽| 泰罗 奥特曼| 军事不当行为未删减完整版在线观看| 经典传奇故事| 播种女儿| 湘西诡案电影完整版免费播放| 天国的阶梯演员表介绍 | 绅士的品格在线观看免费完整版| 战狼欧美版免费观看完整版战狼6 蒋玲玲版《渔夫的荒野史记》电影医ww | 希要爸爸的种子| 有你真好天堂飘雪| sp微电影2免费| 法网柔情剧情| xl司令全集免费观看动漫在线播放 | 花街狂奔电影| 摩伦理剧爸爸给我播个种吧| 好男人电视剧免费播放完整版| 白峰美羽237| 喜羊羊与灰太狼之决战四时代| 韩国美容店的待遇5HD电影| 林雅诗亿万富翁| 满天星电影在线播放 | 金寡妇在线观看免费版电视剧| 克宫:普京不打算祝贺特朗普胜选| 花子vs倔强驱魔师全集免费看| 旋风小子粤语| 嘘禁止想象| 岳阳市| 立花里子番号| v-hotel啄木鸟第一季全集在线观看 | 地爆天星在线高清免费观看| 幽灵公主| 蓝色隐形帽子| 深圳光头姐| 中字HD丈夫的下属中字| 华丽的外出未删减| 《最高の爱人诏》原| 文豪野犬第四季| 石门县| 《妓院里的中国姑娘》BD高清高清在线 | 总理和我| 天峨县| 渗透免费观看全集| 弥渡县| 绝对权力电视剧全集免费观看在线| 《旷野之物》朴智炫| 山野女人香| 白峰美羽在线播放| 华丽的外出未删减| 动感之星妖精第139集在线播放| 风水弃少:改运旺家短剧全集| 菠萝蜜在线观看视频| 娃娃脸1电影完整版在线观看| 电影《蛇妖1988》空姐满天星在线观看| 实验中学跳楼| 美国版《小蜜蜂》4| 鬼灭之刃第三季锻刀村篇免费观看| 《落魄贵族琉璃川》樱花动漫| 0号宿舍.| 插曲疼高清电影免费播放| 铁血使命第2部全集| 女律师的堕落2理伦片| 《疯狂动物城2》中文版| xl司令动漫第一季全集在线观看免费| 4大学生| 浴火之路免费观看策驰影院| 钢管捆绑暴菊强奸电影茌钱免费观看| 奉子成婚第一皇后| 隐形帽子电影完整版在线观看 | 《无法满足》意大利| 家庭主妇肉身归属| 蛇妖1988满天星| 纵情欲海1| 韩国年轻子1| 刘亦菲脱了内裤打开腿桶爽| 电影勇敢的心| 蝙蝠侠赞中国火锅| 《婆婆来了》电视剧| 都市护花:退役兵王短剧全集| 我和我的家乡电影免费完整版| 神之一手| 人鱼小姐全集| 荣誉法则(成人版)免费在线观看| 仙逆动漫122集完整版| 体感预报在线观看免费完整版| 悬案电视剧| 男生女生一起努力愁愁电视剧免费| 电视剧青青河边草| 新人类毒医肥尸| 爱你命中注定泰剧免费观看泰剧网| 《越南妹》99号电影在线观看免费| 人生若只如初见 奈何情深缘浅| 酒店1—80集一口气看完| 星兽猎人2| omoflow在线观看| 施金驰灭蚊灯| 17·3电影在线观看高清免费 | 把冰块一个一个挤出去| 售楼小姐的秘密完整版| 乞丐大结局全集观看| 特殊美容室待遇.6| 迪丽娜尔女儿| 麻豆AV《修车艳遇》在线| 快乐方程式动漫| 《爱我几何》免费观看完整版电影法 | 美容院的特殊待遇 在线| 电视剧新亮剑| 姐妹牙医电影在线看完整版高清 | 马晓晴和薄| 我朋友的姐姐未增删翻译| 《通房丫鬟》结局电影| 偶然与想象| 姑娘爱情郎铃声| 温柔的姨母免费观看电视剧李采潭| 母亲3中字免费完整| 奇幻贵公子第二季| 扶着腰坐好深不要| 冒牌老爸高清下载| 黑人艹美女在线免费观看视频 | 亲吻姐姐kssxsis| 烈火街头| 罗丽星克莱尔电影在线| 梦魇绝镇第二季在线观看 | 西西GOGOGO高清在线完整版| 圣特罗佩斯的姑娘们 (1982) [ 演员 ] | 潘多拉之镜在线播放| 丑闻裴勇俊| 朋友互换麦子在线观看| 老版笑傲江湖| 牛鞭擦进女人下身在线| 朝国年轻的继5免费观看| 在姨妈母家的客厅| 女人花原唱| 陈宝莲电影| 火热的告别| 被可怕的科长欺负的员工电影名字是| 轧戏未删减| 唐人街探案3全网免费| 中森眀莱| 佳木斯快乐舞步完整版第一套| 黑执事mp4下载| G点 在线| 科学怪妓在线观看| 战狼6欧式少女免费| 妻子8免费完整高清电视剧看| 扫毒3人在天涯演员表| 法国空乘2016未删减在线播放| 水手服电影| 日本大学生特殊按摩3| 赖猫的狮子倒影免费观看| 公之浮之手中有字9| 约会大作战8| 罗生门免费| 成都大熊猫玩菜刀| 星梦缘优酷| 神断狄仁杰1| 问情 黄思婷| 《三位少妇的私密按摩》韩国| 地狱宝贝| XL司令第一季免费全集在线观看| 青春草视频在线观看| 《性的暴行》越南电影| 《指尖上的热情》类似动漫| 老友记在线观看| 小团圆电视剧| VICTORYDAY护士| 功夫国语高清| 为我播放| 要爸爸的种子美国电视剧| 高清《突然的喜欢》电视剧| 奇妙的发型屋2免费观看高清| 跑跑卡丁车wkc| 台版1987渔夫荒野史记广告 | 铁证悬案第五季| XL司令第二季高清无马赛版下载| 你是谁学校2015| 沾化县| 伏击电影免费观看完整版| 娘家的故事| 宋晓波爱在日出前| 甄嬛传电视剧免费版全集| 高压监狱在线| 降头在线观看| 维修工的艳遇免费播放完整版 | 摇啊笑啊桥2018| 不可撤销下载| 越野e族二手车| 迷情校园第二视频| 漂亮的保姆6在线观看| 美国灭火宝贝2电影| 许我荣耀电视剧更新| 高压监狱2019满天星法版免费播放| 《环太平洋2》完整版在线观看| 超级教师3免费更新集数| 欢笑老弄堂| 《坎贝奇》(品味人生)| 韩国电影修车艳遇| 黑白配高清国语版大全| 碟中谍15在线观看免费版高清| 生化危机4:战神再生| 无敌破坏王qvod| 少女初体验电影免费观看完整版| 扫黑风暴25集| 独自等待迅雷下载| 新福尔摩斯 第二季| 恐怖休息站| 《部长出差的日子》2| 木府风云主题曲净土| xl司令第一季全集免费完整版在线观看高清| 暴劫柔情在线观看免费| 巫山县| 湄公河行动免费完整版| 梦境电影在线观看高清| 电信光猫破解| 偶像活动第一季| 奇葩说第六季在线观看完整版免费| 私人女性監獄電影| 疯狂动物城英语版免费| 偿还债务的麦子完整版| 朝鲜美女bbwbbw撒尿| 倔强驱魔师1-4集免费观看下载| 高清春夏秋冬代行者 春之舞| 芝加哥回收枪支| 请君入眠全集免费观看| 女友成双| 韩国蕾切尔热舞| 大明风华在线观看免费完整版 | 赵薇不能和你分手| 《战争之暴行女囚》黄色电影| 地龙宝宝| 银瓶梅全集在线观看免费| 某科学的超电磁炮动漫| 沙河市| 屋顶上的绿宝石全集| 高清手遮天未删减| 星际迷航 2009| 樱桃电视剧高清在线观看| 闪酷电影网| 第22条婚规 电视剧| 忍不住的继拇中文字幕| 迷糊天使国语版| 一本一道素人竹内纱里奈在线| 战狼12欧美版免费观看完整版国语百度 | 狂飙在线观看免费全集高清| 插曲的痛完整版在线观看免费高清电影| 整容天后完整版视频| 鸭王2在线观看免费观看| 电工的艳遇在线观看| 每日妈妈粤语| 八丈夫人意大利电影免费观看| 河神在线观看| 花样男子25| 地心冒险| 蛮好人生免费看看| 《完美无瑕》莫妮卡满天星| 燃罪 电视剧| 十七岁的天空吻戏| 郭达蔡明小品打针| 游客借位拍照与大佛击掌| 保险公司推销员2中字剧情简介| 有兽焉第二季动画免费观看| 韩国r电影在线| 电影血恋在线完整版播放| 爷们儿免费全集播放 | 我为歌狂第二季| 韩剧《控制老板》免费观看 | 黎明之战电视剧| 日本部长出差七天七夜| 芝麻胡同在线观看免费完整版剧情| 徽州女人电视剧全集在线观看| 你终于做了别人的小三| 法证先锋4国语版免费下载| 按摩乳房完整版电影| 都市的法则| 鸭王2免费观看完整版普通话| 何以笙箫默电视剧| 南航空难黑匣子录音| 歼灭天际线日韩版最新消息 | 理发店里的特殊待遇4在线观看| 欢乐颂38| 保险公司推销员8中字手机| 速度与激情4 影音| 布隆家族| 公之浮手中字15| 舒淇的全部三电影| 电影《特殊客房》在线看| 黑狐电视剧全集剧情| 雄兵连2诸天降临免费观看完整版| 偶像活动第一季| 小鸡快跑电影下载| 私人女监狱| 大水井风云| 金希贞与黑人大尺度作品| 哈利波特免费观看完整版英文版| 欢乐颂25集| 生死决断秋瓷炫电影完整版在线| 故宫开车| 《常盘贵子恶魔之吻》| 1987娃娃脸完整版| 黑道女金钗| 台湾人的身份证| 魔幻情劫| 贝拉电影1980美国版| 火口的二个人| 任达华《与鸭共舞》电影| 沈逸三妹泳装照片高清| 大风杀电影免费观看| 黑白配中文全集在线播放| 潜行狙击电影版国语| 美国禁忌3睫毛膏| 日在学校| 念念青春| 锵锵锵锵锵锵锵免费看电视剧| 美景之屋电影完整版在线播放| 爱的几何完整版免费观看| 类似3d肉蒲团的电影| 金宵大厦在线观看| 外国电影《你的导师》原片| 爱人 韩国电影快播| 满天星《荣誉守则2》| 渴望hd| 史泰龙最新电影| 欧式少女18集视频大全| 东北往事之黑道风云20年21集| 金牌销售秘密| 韩国电影后宫| 丽江小倩的歌| 《特殊游泳教练》免费观看下拉 | 电影《金悔瓶2008》演员表紫烟| rbd-509| 许要爸爸的种子| 未来影院手机版在线播放版| 爱你几何| 妖精的尾巴之百年任务| 京城小二| 男生女生一起愁愁愁电视剧观看大全| 阿修罗 剧场版| 被光抓走的人电影完整版观看| 《替弟还债十日》电影在线观看免费| 张子健大漠枪神| 《总统》星克莱尔1997年满天星在| 非诚勿扰 小德| 叶玉卿电影全高清| 白峰电影在线播放观看| 风语者高清| 圣女贞德电影| 我的绝色女房客| 立体文眉| 维修工人的绝遇2免费观看| 初恋姐妹| 岳母的诱惑| 疯狂动物城电影英文| 百家讲坛项羽| 西班牙电影《掌中之物》| 黎明之眼电影免费观看完整版| 赶尸艳谈下载| 女子消防队满天星在线观看视频| 一生一世电视剧在线高清免费观看 | 霍家拳之铁臂娇娃电影完整版| 和部长一起去出差旅行在线观看| 731部队电影高清免费播放 | 快餐车免费| 哪吒1魔童降临| 三年成全在线观看免费观看影视大全 | 轧戏电视剧在线观看免费高清全集| 初体验5在线观看整板 | 白蛇传说之法海| 日本年轻的继拇3| 开关游戏怎么玩| 妈妈的味道韩国中字| 《卢旺达的玫瑰》在线| 电影爱情呼叫转移2| 危情少女| 伊波拉病毒免费观看完整国语版| 国庆60周年阅兵| 民间怪谈录在线观看| 女子医院满天星法版免费观看| 死神来了5 qvod| 地下交通站第一部| 耍要爸爸播种子| 再生缘电视剧| 杜拉拉之似水年华歌曲| 电影需要爸爸的播种子 | jizz在线播放| 罪恶斗争电影在线播放| 拿破仑电影| 八尺夫人意大利免费在线| 野兽们的战争在线观看完整版 | 特殊美容院2| 第三次初恋| 女员工的滋味2| 女子护卫队1973电影在线观看| 为了皇帝迅雷下载| 高清今天开始是人类| 政局边缘| 猎心者免费观看| 总统夫人| 新世纪高潮战队| 水手服电影| 《金牌销售》法国| 狼来了电视剧| 电影婚礼2008| 余庆县| 不安于室by卡比丘| 七夜雪 电视剧| 法国版《女超人:麦乐迪》在线 | 美国版娃娃脸4| 他为什么依然单身电视剧| 哈萨克阿肯弹唱| 《农场主的三个女儿》 | 绝对权力剧情| 《酒店服务员》| 童军手册之僵尸启示录无删减| 劳拉失魂记| 收脱者入室强奸在线观看| 小悦悦是谁| 爱情诡计第6集| 我需要爸爸种子英文| 黑执事第三季全集| 爱人 电影 2005| 监狱不设防百度影音| 幻灵先生| 我们在黑夜中相拥免费全集 | 疯狂动物城免费中文版| 《公的浮之手中字》免费中国电影| 叛逆者电视剧全集免费| 爱情公寓5第13集| 美姊妹剥赤板栗| 封神榜之武王伐纣全集| 英雄联盟动画片第一集| xxxx69xxxx| 羞羞的铁拳迅雷下载| 金瓶梅1-5电视剧| https://www.yalan365.com/shiwutv/sreteuc.html | 《需要爸爸播种子》免费观看在线播放_HD/未删减_1080P高清电影完整版 - 天堂 | 古惑仔之社团风暴| 战狼8欧式少女全部视频| 皇子归来之欢喜县令| 张雨筱人体| 电影《需要爸爸播种》演员里的| 拼图电视剧| 计春华简介| 美国荷尔蒙6电影在线观看| 女友的妈妈免费观看| 熊熊乐园2| 木下凛凛子电影| 叶罗丽第11季正片免费观看| 嫂嫂宝库免费观看电视剧全部| 我要变坏3| 年轻的母亲在线观看韩版| 女士的品格电视剧免费| 刀剑乱舞花丸| 罗马帝国艳情史迅雷下载| 卡欧斯黑暗| 事物的秘密在水池一段是多少比喻 | 火箭军高层间谍是谁| 金瓶梅电视剧在线观看免费版电影全集| 长相思第一季全集免费完整版16 | 激战酒店1-9集全部播放时间| 古惑仔5之龙争虎斗| 央视5套无直播国足比赛计划 | 姜汉娜朋友2| 少女爱上姐姐明亮的三颗星| 三姐妹瑜伽健身西班牙| 中国第一鬼城| 铁探粤语版在线观看| 麦乐迪女超人原片法国| 浮生如梦 一晌贪欢免费阅读 | 沙漠公主满天星| 黑三角电影下载| 法警小队 第一季| 无法开口| 泰剧为你着迷| 连平县| 五感图 下载| 仙逆动漫在线观看完整版全集| 兔子先生免费全集在线观看| 新有菜免费在线观看| 沈樵第二部闺蜜20分钟| 暴躁少女的全集| 第九区在线观看免费版| 战火青春金戈版| 流光之下45集免费观看| 斯巴达女版三部曲免费观看| 德田重男全部电影| 亦舞之城电视剧免费观看完整版| 《卖保险的女销售》电影免费观看| 惊天下:女状元文武短剧全集| 鬼吹灯之精绝古城全集| 法老荒史在线观看免费版高清| 毛孩身高| 这么多年电影在线观看 | 金银悔1-5免费观看高清 | m7全英雄战记优酷| 美国版荷尔蒙2 | 高清《速度与激情9》免费| 姜素拉一脱成名2免费观看| 行尸走肉 美剧| 挡不住风情在线观看| 二十一世纪爱指南完整版| 我知道你去年夏天干了什么| 《另一个贝内特家的姐妹》| 一一 电影| 女超人在线播放| 女烈受刑| 木乃伊归来2| 老婆8| 向天再借五百年简谱| 龙凤店国语| 满天星女版《壮志凌云》| 倾心相印番外篇| 甜蜜惩罚2我是看守专用宠物| 360大佬爱上我第二季免费| 北风那个吹在线观看免费完整版| 完美世界动漫在线观看免费播放| 农场保卫战满天星免费观看| 重振精武门| 潜龙道全集免费观看| 加油吧实习生全集| omoflow第一季全集在线播放| 需要爸爸播种子2全集免费看 | 好看的美国爱情片| 赤裸的美奈子| 扎兰屯市| 法国贵夫人满天星| 轩辕剑之天之痕26| 银河护卫队2百度云资源| 壮志凌云法国版完整版 | 夏娃的诱惑2| 午夜寂寞欧美| 罗刹海市被央视点名| 锦月如歌在线观看电视剧高清| 高压监狱二免费观看完整版全集| 毕福剑歌曲100首| 王中王电视剧| 八尺夫人满天星英语翻译版| 狂飙全集免费高清| 更好的生活| 日日爱网| 莫言作品丰乳肥臀| 蜗牛电影在线观看免费| 韩剧《空调维修工》剧情介绍新任女| 家有一老电视剧全集| 几度夕阳红剧情| 爱你像心跳难动短剧免费观看| 痰多最怕一味药| 使徒行者优酷| WRITE AS 病娇| 原千岁主演的电影在线观看播放 | 电视剧错点鸳鸯| 私密地带| 白峰国语版在线观看全集| 超级女英雄| 南充属于几线城市| 大兵的寝室电影| 《杜塞》| 超神学院第7集| 《如梦令》电视剧| 楼上的邻居在线| 大约是爱2| 武直15| 意大利地爆天星电影在线观看| 电影斗牛剧情| 火锅米线培训| 按摩店的待遇1在线观看| 黑白禁区电视剧免费观看| 有女不愁嫁| 禁止的爱未删减版在线观看下载| 战狼6欧式少女一共多少集| 德克里克堡| 张碧晨 红玫瑰| 二阶堂梦电影全部免费观看| 荒野旅社| 末日村庄电影完整在线观看| 佐罗满天星版在线播放| 李玉刚 花满楼| 演员李桓| 赛尔号第三季光明的救赎| 台剧黛比| 电视剧绝不放过你| 虎胆龙威4高清百度影音| 新金银1-5普通话免费播放| 爱情故事| star-438| 女超人麦乐迪无删减版在线观看 | 与狼共舞电视剧| 替夫还债3季免费观看| 阿凡达:火与烬未删减| 开车看美女被开罚单?P的| 长谷川小夏| 《四少妇按摩完整版》 | 活着韩国免费观看| 毒医肥尸无删减免费观看电视剧| 电视剧产科男医生全集| 大嫁风尚免费观看全集完整版高清| 菲律宾电影《兽行》的剧情简介| 《杰顿魔物娘》动漫在线看| 开棺免费观看| 乌海电影在线观看| 法国空乘4大结局| 风之刀剧情| 三d肉浦团| 爱你几何| 校园的早晨舞蹈| 《活着2:丧尸危机》免费播放| 传颂之物二人的白皇| 日本新金银悔1—5普通话| 华晨宇无字歌| 韩国美女跳舞| 河间市| 星克莱尔的《美妙的爱情》| 特殊美容院5在线观看| 青春荷尔蒙2 国语| 爱唯侦察2025合集免费下载| 祸福相依| 原始武器 国语| 免费李宗瑞全集在线观看| 《安娜和父亲》麦乐迪| 《你好 李焕英》电影| 布衣神相| 女超人法国电影完整版| 加菲猫大电影1普通话版免费| 铁憨憨全部视频| 新妈妈再爱我一次电影| 菲律宾电影维修工人工的艳遇| 神马四兄弟电影| 朝国年轻的继5免费观看| 平果县| 瓜达卢佩的玫瑰免费观看 | 不戴套交换系列17部分吴琴| star-438| 金瓶梅在线高清免费播放观看电影| 十九岁大学生真人免费观看电视剧 | 双人天堂按摩在线观看| 天注定 字幕| 因为有爱| 我和黑帮的老大365天| 黑白配电影免费观看| 安娜卡列尼娜2012| 会员制餐厅完整版免费高清| 钟馗抓妖记| 姐妹牙医在线电影播放完整版中文| 新妓生传韩剧| 隔壁的女孩3在线观看| 奇葩一家亲剧情介绍| 冬之蝉动漫免费全集观看| 刀郎演唱会为何引网友期待| 中国新声带| 渔夫荒野全集| 普通文艺2b| 名侦探柯南绯色的不在证明动漫| 新妈妈k8| 德国空姐2019满天星法版主演是谁 | 聊斋先生在线观看电影| 总裁动真心了:契约婚姻全集免费| 一江春水向东流在线观看| 法国空乘2完整版在线看| 施瓦辛格最新电影| 打黑在线播放免费完整版| 关东微喜剧| 禁忌2,4年转一代禁忌| 牛郎织女全集| 那年花开月正圆 电视剧| 电影大毒枭| 爸爸为我播种| 呼啸青春| 大雄的秘密道具博物馆国语版| 罚罪全集在线完整免费| 插曲的痛30集全集高清| 赘婿电视剧在线观看| 旋转的爱中文版| 初恋这件小事电视剧在线观看| 安吉拉怀特在线观看免费版英语单词 | 和部长一起出差在线观看| 一出好戏电影完整版免费观看| 水手服饲育| 爱闪亮 电视剧| 海之声如如理论| 韩国辣舞| 电视剧一言为定| 拐个皇帝回现代| 美容院特殊待遇免费观看| 恋爱恐惧症电视剧| 牡丹夜叉1987台湾版剧情简介| 爱情面前谁怕谁分集剧情介绍| 瓜达卢佩的玫瑰电影在线| 巴哥正传电视剧| 李李妮的vk视频| 家庭瑜伽教师|