• <track id="oztn4"></track>
    <sup id="oztn4"><form id="oztn4"></form></sup>
    
    
    <mark id="oztn4"></mark>
  • <dfn id="oztn4"><samp id="oztn4"></samp></dfn>
      《地爆天星小姐》电影 ,麦子交换2免费观看2023年上映时间表 ,莫妮卡《爱我几何》,大牛影库战狼6欧式少女全部视频,三年大片国语版在线看,日本空姐电视剧,电影魔镜号中文字幕,和部长一起去出差旅是第几集
      全球「AI學術(shù)頂會」精華匯聚地
      您正在使用IE低版瀏覽器,為了您的雷峰網(wǎng)賬號安全和更好的產(chǎn)品體驗,強烈建議使用更快更安全的瀏覽器
      此為臨時鏈接,僅用于文章預(yù)覽,將在時失效
      頂會專區(qū) 正文
      發(fā)私信給陸毅
      發(fā)送

      0

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      導(dǎo)語:為此,本文選擇了10篇有代表性的paper(具有一定"范式意義",引用大,或獲獎【入圍】,或工作扎實等綜合視角進行選擇), 進行詳細介紹。

      來源:公眾號“AI泡哥”

      鏈接:https://mp.weixin.qq.com/s/TfCQH_PT8jItqCZDBSugPw


      轉(zhuǎn)眼 2026 年已經(jīng)過了一半了,robotics 相關(guān)會議也陸續(xù)進入一個很適合階段性回顧的時間點:AAAI 2026,ICLR 2026已經(jīng)結(jié)束了,ICML 2026 和RSS 2026 的 accepted papers 也已經(jīng)公布,ICRA 2026(2026 年 6 月 1–5 日)和CVPR 2026(2026年6月 3日 - 7日 ) 正在召開。雖然 CoRL(2026年11月 9-12日)、NeurIPS(2026年12月6-12日 )、IROS(2026年9月27日至10月1日) 等會議還未公布accepted paper。但對于2026年來說,已經(jīng)值得先總結(jié)一下。為此,本文選擇了10篇有代表性的paper(具有一定"范式意義",引用大,或獲獎【入圍】,或工作扎實等綜合視角進行選擇), 進行詳細介紹:  涵蓋策略、VLA模型(Robot foundation Policy /VLA ),  世界模型(World model),生成式監(jiān)督(Generative Supervision),Active / Temporal Perception和Diffusion Policy 理論化等議題。

      π?: A Vision-Language-Action Flow Model for General Robot Control (RSS 2026)

      作者:  Physical Intelligence

      背景 

      Physical Intelligence的π?是很“老”的文章(2024年11月就“占坑”了【2026年1月修正版】,但是RSS 2026錄用,該文引用近2000);其后,陸續(xù)發(fā)布π?.5(2025年4月) ,π*?.6(2025年11月),π?.7(2026年4月)【π 系列論文風格很像“頂級機器人學習實驗室 + 大模型公司 + 真實機器人數(shù)據(jù)工廠”的混合體:有 Berkeley的 robot learning 脈絡(luò)(尤其 Sergey Levine / Chelsea Finn),也有 Google RT-1/RT-2/Open X-Embodiment 那條大規(guī)模機器人數(shù)據(jù)路線(Karol Hausman等),還有明顯的創(chuàng)業(yè)公司式工程和部署導(dǎo)向(面向家務(wù)這個場景)】,本著“一群羊也是趕”的精神,一起梳理一下π系列(如下圖):

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      創(chuàng)新點

      π?(從 VLM 到 VLA,解決“語言視覺模型如何輸出真實動作”):傳統(tǒng) VLM 能看圖、理解語言,但不會控制機器人。機器人需要輸出的是連續(xù)、高頻、帶物理約束的動作序列,而不是離散文本 token。π? 旨在解決能否把 VLM 改造成能直接控制機器人的 Vision-Language-Action Model ?

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,π? 的核心創(chuàng)新就是:把預(yù)訓練 VLM 的語義理解能力,和一個 flow-matching action expert 的連續(xù)動作生成能力接起來,讓大模型真正從“會看會說”變成“會控制機器人”。白話文:以 VLM/VLA backbone 提取的視覺-語言-機器人狀態(tài)特征作為 condition,再接收一個 noised action chunk 和 flow timestep,學習預(yù)測從噪聲動作到真實動作的 flow / velocity field。推理時,模型從隨機噪聲動作 chunk 出發(fā),經(jīng)過若干 flow-matching 更新步驟,生成未來 H 步連續(xù)機器人動作,即 chunked action。更直白,就是VLM+diffusion model(flow matching)->chunked action

      π?.5(從 general control 到 open-world generalization):  π? 能控制機器人,但一個更難的問題是:機器人能不能離開實驗室,到從未見過的新家里完成真實家務(wù)?π?.5 核心問題是 在家務(wù)的場景下,如何實現(xiàn)open-world generalization

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      π?.5 基于 π?,通過 heterogeneous tasks 的 co-training,使機器人能在新家中完成廚房、臥室清理等 10–15 分鐘的復(fù)雜多階段任務(wù)。具體地,π?.5 分成 pre-training 和 post-training 兩階段:pre-training 結(jié)合多源數(shù)據(jù)與離散 token;post-training 專門適配 mobile manipulation,并加入通過 flow matching 輸出連續(xù) action chunk 的 action expert。它使用的數(shù)據(jù)包括多機器人數(shù)據(jù)、高層語義預(yù)測、web data、verbal instructions 等。白話文:在 π?的基礎(chǔ)上,post-training 專門適配 mobile manipulation,以適應(yīng)家務(wù)的應(yīng)用場景。

      π*?.6(從 imitation 到 experience,解決“機器人如何通過真實部署變強”):   π? 和 π?.5 主要還是 imitation learning / co-training 路線。它們能學demo數(shù)據(jù),但真實機器人部署后一定會犯錯。π*?.6 的問題變成: 機器人能不能像人一樣,通過反復(fù)嘗試、失敗、糾正、反饋,越練越強?

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      π*?.6 的核心創(chuàng)新是把 VLA 變成一個可以 post-training / RL self-improvement 的系統(tǒng):Deploy VLA on robot ->collect autonomous rollouts->human corrections / sparse reward->train value function->estimate action advantage->advantage-conditioned VLA training->improved VLA->repeat;  這就是π*?.6 提出 RECAP:RL with Experience and Corrections via Advantage-conditioned Policies。它利用 demonstrations、on-policy collection、expert teleoperated interventions,把真實部署經(jīng)驗納入訓練。RECAP 可以讓 π*?.6 在真實任務(wù)中折衣服、組裝盒子、制作 espresso,并在一些困難任務(wù)上將 throughput 提升超過 2 倍、failure rate 大約減半。白話文:π? / π?.5 類似 pretraining + SFT;π*?.6 開始 robot RL post-training(雖然π?.5有post-training ,其目的是為了適應(yīng)家務(wù)場景;π*?.6 的post-training 是面向部署,它必然也有π?.5的post-training,因此,π*?.6 更像是post-post-training

      π?.7(從 self-improvement 到 steerable generalist foundation model): π*?.6 能通過經(jīng)驗提高某些任務(wù)性能,而進一步,π?.7可能面對的問題: 數(shù)據(jù)質(zhì)量不一致,有成功、有失敗、有慢動作、有快動作;  不同機器人形態(tài)、不同任務(wù)策略混在一起,容易學成平均行為;用戶不僅想讓機器人“做什么”,還想控制它“怎么做”;  機器人需要組合舊技能完成新任務(wù),而不只是復(fù)現(xiàn)訓練任務(wù)。

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      π?.7 的核心創(chuàng)新點是把 prompt / context 變成機器人行為的控制面板:通過 diverse context conditioning,讓模型可以在 prompt 中接收任務(wù)描述、策略信息、episode metadata、subgoal images 等,從而在未微調(diào)情況下完成復(fù)雜靈巧任務(wù)、跨 embodiment 泛化和組合式任務(wù)泛化。π?.7 還引入 world model 生成 subgoal images,讓機器人能看到一個“目標狀態(tài)草圖”。白話文:π?.7 不是取消訓練,而是改成 context-conditioned training,推理時再通過 prompt/context 選擇不同的行為模式,從而減少每個新任務(wù)的fine-tune 的需求。

      意義

      π-series 的創(chuàng)新逐步形成了一個機器人基礎(chǔ)模型系統(tǒng)范式:Robot Foundation Model =VLA backbone  + action expert  + flow/diffusion continuous action generation  + cross-embodiment data  + web / human / robot heterogeneous co-training  + high-level semantic subtask inference  + real-world experience and correction loop  + value / advantage conditioning  + metadata / subgoal / memory based context steering;最終,這條路線從 “根據(jù)語言做動作” 到“能在真實世界中提示、糾正、訓練、 steer,組合技能解決新任務(wù)”


      FAST: Efficient Action Tokenization for Vision-Language-Action Models(RSS 2026)

      作者:Physical Intelligence

      背景 

      沒看錯,又是一篇Physical Intelligence的paper (引用也500+)! FAST 之所以必須推薦:  因為π? 系列說明機器人基礎(chǔ)模型可以通過 VLA + flow matching 產(chǎn)生連續(xù)動作,而 FAST 說明:動作 tokenization 做對時,動作也可以進入類似 LLM 的 next-token prediction 訓練范式。這是因為,LLM 有 text tokenizer,VLA 也必須有 action tokenizer。問題是,機器人動作不是文字,而是連續(xù)、高頻、多維的時間序列。而已有的 per-dimension、per-timestep binning 方法在 high-frequency dexterous skills 上表現(xiàn)很差。

      創(chuàng)新點

      傳統(tǒng)做法是:每個時間步 × 每個動作維度 → 單獨分桶;這會產(chǎn)生大量強相關(guān) token。高頻控制下,相鄰動作變化很小,模型很容易學成“復(fù)制上一個 token”,訓練信號變?nèi)酢AST 的核心洞察是:robot action sequence 不是普通離散 token,而是連續(xù)時間序列,所以應(yīng)該先壓縮。為此,F(xiàn)AST用 DCT,Discrete Cosine Transform 把動作序列轉(zhuǎn)到頻域,再用 BPE 壓縮,形成 Frequency-space Action Sequence Tokenization。如下圖展示了流程:normalized action chunk → DCT frequency components → sparse frequency matrix → flatten → BPE → compressed action tokens。說白了,F(xiàn)AST就是“組合創(chuàng)新”:DCT 來自經(jīng)典信號/圖像壓縮,BPE 來自文本 tokenizer,把“壓縮式編碼”應(yīng)用到 VLA 的連續(xù)機器人動作 tokenization。

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      π? 原始路線更偏 flow matching / diffusion VLA:用 action expert 輸出連續(xù) action chunk。而FAST 證明:如果 action tokenizer 做對了,autoregressive VLA 也可以訓練復(fù)雜、高頻、靈巧任務(wù)。論文顯示 FAST 可以讓 π?-FAST 在 dexterous / long-horizon manipulation 上匹配 state-of-the-art π? diffusion VLA,同時訓練快 5 倍。同時,本文發(fā)布了可以作為 black-box tokenizer 使用的通用 action tokenizer:FAST+ 是一個 universal robot action tokenizer,訓練在 100 萬真實機器人動作軌跡上,可覆蓋 single-arm、bi-manual、mobile robots、多種 action spaces 和 control frequencies。

      意義

      FAST 將 VLA 的action representation 問題展示為機器人基礎(chǔ)模型的核心問題。與 diffusion / flow VLA 相比,F(xiàn)AST 的優(yōu)勢是訓練效率和 backbone 兼容性,π?-FAST 可在保持相近表現(xiàn)的同時顯著降低訓練計算;但其代價是 autoregressive action decoding 帶來較高推理延遲。因而,F(xiàn)AST 的定位不是替代所有連續(xù)動作生成方法,而是為 VLA scaling 提供 action-tokenization 基礎(chǔ)設(shè)施。

      FP3: A 3D Foundation Policy for Robotic Manipulation (ICRA 2026)Award Finalists

      作者:Rujia Yang等(清華等)

      背景

      機器人操作肯定是在 3D 空間中,但當前很多model 主要依賴 2D 圖像,因此其泛化能力必然有限(例如unseen scenarios、new objects、distractors 等情景上泛化能力有限)。 如果機器人要在真實世界中泛化,不能只讓模型“看見圖像”,還要讓模型“知道物體在三維空間中的位置、形狀、尺度和相互關(guān)系”。為此,F(xiàn)P3 希望通過3D point cloud 可以把這些幾何關(guān)系顯式放進模型輸入里,從而讓 foundation policy 更容易泛化。

      創(chuàng)新點

      FP3 的核心創(chuàng)新是提出了3D point cloud-based language-visuomotor foundation policy ( 1.3B 參數(shù)的 3Dfoundation policy ): 用 3D point cloud + language + proprioception 作為多模態(tài)輸入,再用 diffusion transformer 輸出 action chunk,也就是把 3D 幾何感知和 diffusion policy 結(jié)合起來(如下圖); 同時, 采用 pre-training + few-shot post-training recipe:先在 DROID 60k trajectories 上預(yù)訓練,再用每個任務(wù) 80 條高質(zhì)量 demonstrations 做 LoRA fine-tuning。

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      FP3用大規(guī)模預(yù)訓練 3D encoder Uni3D ViT-L(Large):當前 point cloud-based robot policies 通常用 sparse point cloud 和小網(wǎng)絡(luò),而 FP3 增加輸入點數(shù)到每視角 4000 points,并使用 300M 參數(shù) Uni3D ViT。同時,它不是一次預(yù)測單步動作,而是 diffusion action chunk。 這讓它更接近 Diffusion Policy / RDT / π? 這類生成式動作模型,而不是傳統(tǒng) reactive controller。

      意義

      在 2026 的 robotics ,VLA很多路線仍然是:2D image + language → action;但FP3 強調(diào)3D世界的交互,例如機器人不是只要“識別杯子”,還要知道:杯子在哪里?杯口朝哪里?能不能抓?手從哪邊過去?等這些問題 3D 的問題。FP3 展示了從 2D VLA 向 3D foundation policy 的轉(zhuǎn)向的可能。


      Dexora: Open-Source VLA for High-DoF Bimanual Dexterity(ICRA 2026)Award Finalists

      作者:Zongzheng Zhang等(清華大學等)

      背景

      當前 VLA 系統(tǒng)主要受限于兩類:要么是 dual-arm low-DoF grippers,要么是 single-arm dexterous hand,無法同時處理雙臂協(xié)作和高自由度雙手靈巧操作。Dexora 的目標就是補上這個空白:構(gòu)建第一個面向 dual-arm, dual-hand, high-DoF manipulation 的開源 VLA 系統(tǒng)。

      創(chuàng)新點

      Dexora的核心創(chuàng)新點: Dexora 是第一個原生面向 dual-arm, dual-hand, high-DoF manipulation 的開源 VLA 系統(tǒng);embodiment-matched sim + real 大規(guī)模數(shù)據(jù)采集管線,也就是Dexora設(shè)計一個能高效采集“人類雙手雙臂動作”的數(shù)據(jù)機器(Hybrid teleoperation把控制拆成兩部分: 粗粒度手臂運動【custom exoskeleton backpack 捕捉 shoulder-elbow-wrist 角度】,細粒度手指運動【Apple Vision Pro markerless hand tracking 捕捉 3D finger skeleton】);Data-quality-aware training:即使高自由度 teleoperation 也很難保證每條數(shù)據(jù)都好,Dexora 的做法不是簡單地過濾掉數(shù)據(jù),而是訓練一個 discriminator,為每段 demonstration 打質(zhì)量分,然后把這個分數(shù)變成 diffusion loss 的權(quán)重(高質(zhì)量 clip → 權(quán)重大 → 多學,低質(zhì)量 clip → 權(quán)重小 → 少學),如下圖:

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,Dexora 如何處理真實 teleoperation 數(shù)據(jù)質(zhì)量不穩(wěn)定的問題, 第一步先做數(shù)據(jù)過濾:用加速度、jerk 等指標篩掉抖動大的軌跡,再通過 replay 檢查任務(wù)是否成功、是否無碰撞,得到高質(zhì)量 demo; 第二步訓練一個 discriminator,讓它根據(jù) observation、language、action chunk 和 policy 兼容性分數(shù),判斷每段數(shù)據(jù)質(zhì)量高低;第三步在訓練 diffusion-transformer policy 時,把 discriminator 的質(zhì)量分數(shù)變成 loss 權(quán)重:高質(zhì)量數(shù)據(jù)多學,低質(zhì)量數(shù)據(jù)少學。白話文,Dexora 不是盲目模仿,而是“有選擇地學”

      意義

      為什么Dexora 值得推薦,是因為它是“高自由度雙臂雙手靈巧操作”的重要基礎(chǔ)工作之一。現(xiàn)有 VLA 多集中在單臂夾爪、雙臂低自由度夾爪,或單臂靈巧手,難以覆蓋真實世界中需要雙手協(xié)作和手指精細控制的任務(wù)。而Dexora 的核心 insight 是:與其從低自由度夾爪策略向上“補全”靈巧手動作,不如直接在 36-DoF 雙臂雙手平臺上訓練 rich embodiment policy,再向低自由度 embodiment 投影。實驗顯示,Dexora 在 basic tasks 和 dexterous tasks 上均優(yōu)于 DP、π? 和 GR00T N1,并能跨 single-arm gripper、dual-arm grippers、single-arm low-DoF hand 泛化。它的意義是為高自由度機器人基礎(chǔ)模型提供了硬件、數(shù)據(jù)、訓練和跨 embodiment 泛化的提供諸多參考。


      SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning(ICLR 2026)

      作者:Haozhan Li等(清華大學等)

      背景

      當前 VLA 主要依賴大規(guī)模機器人demo數(shù)據(jù)做 SFT,但機器人軌跡昂貴、稀缺且覆蓋有限,導(dǎo)致模型在長時程任務(wù)、分布外場景和真實部署中泛化不足。而SimpleVLA-RL 的想法是:借鑒 LLM 的 RL中reward思路,VLA 也可以通過任務(wù)成功/失敗的reward,學會action planning。

      創(chuàng)新點

      SimpleVLA-RL的核心創(chuàng)新點:  把 LLM 里的 rule-based online RL 思路遷移到 VLA,形成一個面向機器人閉環(huán)交互的 RL post-training 框架; 這是通過基于 veRL 而擴展出 VLA-specific trajectory sampling、parallel multi-environment rendering、training-inference-rendering 一體化框架和優(yōu)化后的 loss computation;而獎勵設(shè)計非常簡單:一條軌跡任務(wù)成功就給 1,失敗就給 0。 白話文,模型的學習由“行為驅(qū)動”變?yōu)?/span>“結(jié)果驅(qū)動”:以前的SFT(Demo演示“抓起來、移動、放下”, 模型就模仿這條路線)是行為驅(qū)動,關(guān)鍵看像不像;而SimpleVLA-RL是嘗試不同動作,關(guān)鍵看成不成功。如下圖:

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,左邊表示傳統(tǒng) SFT 只能利用有限離線 trajectories,而右邊 SimpleVLA-RL 讓 policy 和 environment 閉環(huán)交互,采樣多條 trajectories。 每條軌跡根據(jù)任務(wù)是否成功獲得 0/1 outcome reward,然后用 group advantage computation 更新 policy。圖中還標出三個探索增強模塊,旨在解決VLA 做 RL 時探索不夠、獎勵太稀疏、梯度容易消失的問題:dynamic samplingSimpleVLA-RL會對同一個任務(wù)采樣多條軌跡,例如 8 條,
       如果這 8 條全成功或全失敗,GRPO 的 group advantage 會變成 0,模型學不到“哪條軌跡更好”。所以 dynamic sampling 會丟掉這種“全對/全錯”的 group,只保留:同一個任務(wù)(有的軌跡成功,有的軌跡失敗)
      )、higher clip rangeGRPO / PPO 會用 clip range 限制 policy 更新幅度,防止模型一下子改太猛。
       普通范圍類似:[0.8, 1.2];SimpleVLA-RL 把上界調(diào)高到:[0.8, 1.28],其目的是:
      如果某些低概率動作最后導(dǎo)致任務(wù)成功,就允許模型更大膽地提高這些動作的概率。直覺是:機器人以前不敢試的動作,比如“直接推過去”而不是“抓起來再放下”,如果成功了,RL 應(yīng)該更積極地獎勵它
      )、higher rollout temperaturetemperature 控制采樣隨機性。如果temperature 低,模型更保守,老是重復(fù) SFT 學到的動作;temperature 高,模型會嘗試更多不同動作。論文把 rollout temperature 從 1.0 提高到 1.6,讓 VLA 在環(huán)境中探索更多軌跡。這有助于發(fā)現(xiàn)新策略,比如論文里提到的 pushcut:模型不再模仿demo里的“抓-移動-放下”,而是學會直接“推過去”)。

      意義

      為什么SimpleVLA-RL值得推薦,因為它是“通過 reinforcement learning 做 post-training”學習robot foundation model ,而不是SFT。現(xiàn)有 VLA 的核心瓶頸是機器人demo數(shù)據(jù)昂貴且有限,SFT 往往只能復(fù)制訓練軌跡,遇到新場景、新物體或長時程任務(wù)時泛化不足。而SimpleVLA-RL 借鑒了 LLM reasoning model 的 RL 經(jīng)驗:不必為每一步設(shè)計復(fù)雜獎勵,只需用任務(wù)成功/失敗作為reward,就可以讓 VLA 在環(huán)境交互中改進 step-by-step action planning。它的意義在于基于已有 SFT policy 基礎(chǔ)上,通過仿真 RL 提升泛化、長時程執(zhí)行和真實部署等能力。


      Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets(RSS 2026)

      作者:Chuning Zhu等(University of Washington等)

      背景

      機器人學習依賴高質(zhì)量demo,但demo昂貴且規(guī)模有限,而大量 video data 雖然便宜豐富,卻沒有 action 標注,難以直接用于 policy learning;同時,video world model 能學習未來畫面變化,卻通常和 action policy 分離,難以直接提升機器人控制。為此,本文UWM(Unified World Models)認為:policy learning 和 world modeling 不應(yīng)該是兩個模型,而可以是同一個 video-action diffusion model 的不同推理模式。

      創(chuàng)新點

      UWM(Unified World Models)的核心創(chuàng)新點:把 action diffusion 和 video diffusion 放進同一個 diffusion transformer 中。 它最關(guān)鍵的設(shè)計是給 action 和 future observation 分別設(shè)置獨立 diffusion timestep:t_a 和 t_o'; 通過控制這兩個 timestep,模型可以在推理時切換不同功能:policy、forward dynamics、inverse dynamics、video prediction;當把 future observation 的 timestep 設(shè)為最大噪聲 T,相當于“遮住未來圖像”,模型就退化成 policy p(a|o); 這種設(shè)計還允許模型利用 action-free video data:沒有動作標簽時,就把 action 設(shè)成 fully noised / masked,仍然能訓練視頻動態(tài)理解。白話文,可以把 UWM 理解成一個“機器人因果關(guān)系學習器”(普通 imitation learning: 看到當前圖像 → 預(yù)測動作;UWM:  當前圖像 + 動作 + 未來圖像
      → 學習三者之間的關(guān)系→推理時按需要遮住某一部分→得到 policy / dynamics / inverse model / video predictor
      )。如下圖:

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,Unified World Model 可以通過不同 timestep 設(shè)置,同時扮演 policy、forward dynamics、inverse dynamics 和 video prediction 四種角色。圖中間的 UWM 接收 current observation、actions、future observations,并分別對 action 和 future observation 做 diffusion。

      意義

      為什么推薦UWM(Unified World Model )呢? 因為它把 imitation learning、world model、video prediction、inverse dynamics 這些原本分散的方向統(tǒng)一到一個 diffusion framework 中。 其重要意義在于證明 action-free video data 可以通過統(tǒng)一 diffusion timestep 機制進入 robot policy pretraining,而不是只能依賴昂貴 action-labeled robot trajectories。 實驗上,UWM 在真實機器人任務(wù)和 LIBERO benchmark 中整體優(yōu)于 DP、PAD、GR1,并且 co-training action-free videos 后進一步提升 OOD 魯棒性。 對產(chǎn)業(yè)來說,它有可能降低了對大規(guī)模真實機器人demo的依賴,因為企業(yè)通常更容易獲得視頻數(shù)據(jù)。


      Robotic Manipulation by Imitating Generated Videos Without Physical Demonstrations(ICLR 2026)

      作者:Shivansh Patel等(UIUC等)

      背景

      過去從視頻學機器人操作大致有三條路線:路線 1:真實人類視頻 / 互聯(lián)網(wǎng)視頻(問題:視角、手型、物體、環(huán)境、機器人 embodiment 差距很大);路線 2:專門采集和機器人環(huán)境對齊的人類 demo video(采集麻煩,必須控制視角、物體、場景,很難 scale);路線 3:VLM 直接預(yù)測 keypoint / constraint / goal問題(太稀疏,缺少完整動作過程,容易丟掉關(guān)鍵幾何與時序細節(jié))。本文RIGVid:生成視頻雖然不是機器人動作數(shù)據(jù),但它包含了“物體應(yīng)該如何運動”的視覺軌跡;只要能把視頻中的物體運動穩(wěn)定提取成 6D object pose trajectory,就可以繞過 action label,直接變成機器人可執(zhí)行軌跡。雖然,本文和上一篇 UWM旨在利用“沒有動作標簽的視頻”來減少對真實 robot demo 的依賴,但上一篇 UWM 是“把 video data 變成 policy pretraining 信號”,本篇 RIGVid 是“把 generated video 直接變成 object trajectory”。

      創(chuàng)新點

      本文RIGVid的核心創(chuàng)新點機器人只模仿 AI-generated videos,不需要真實 physical demo,也不需要 task-specific robot training。 它是把生成視頻轉(zhuǎn)成 6D object pose trajectory,而不是只提取稀疏 keypoint、dense flow 或 goal image。 具體,它使用 monocular depth estimation + 6D object tracking + object-to-robot retargeting,把視頻里的物體運動變成機器人末端執(zhí)行軌跡,并且支持 closed-loop execution:執(zhí)行時實時追蹤物體,如果偏離軌跡,就回退到最近成功點并繼續(xù)執(zhí)行。 白話文,普通 imitation learning是人類或機器人真實demo → 訓練 policy → 機器人執(zhí)行;而RIGVid是AI 生成一個操作視頻 → 追蹤視頻中物體怎么動 → 機器人照著這個物體軌跡動。如下圖:

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,RIGVid 的完整 pipeline:輸入初始 RGB-D 圖像和語言命令,例如 “Pour Water On Plant”,視頻生成模型先生成一段操作視頻;隨后單目深度估計器給每一幀補深度,6D object tracker 從 RGB-D 視頻中提取物體位姿軌跡;最后系統(tǒng)先抓住物體,再把 object trajectory retarget 成 robot end-effector trajectory。本文不預(yù)測機器人動作,而是預(yù)測/提取“物體應(yīng)該如何運動”,再讓機器人去實現(xiàn)這個物體運動。

      意義

      為什么推薦RIGVid呢?因為它說明了機器人可以從生成模型“想象出來”的視頻中獲得操作監(jiān)督,而不必完全依賴真實機器人demo,這是generative model × robotics 方向非常有代表性的論文。這意味中,有可能把生成式視頻模型從“視覺內(nèi)容生成工具”推進為“機器人操作監(jiān)督來源”。這對服務(wù)機器人、家務(wù)機器人、輕工業(yè)操作、低頻新任務(wù)適配都很有啟發(fā)。


      AVA-VLA: Improving Vision-Language-Action Models with Active Visual Attention(CVPR 2026)

      作者:Lei Xiao等(LiAuto Inc等)

      背景

      現(xiàn)有 VLA 大多把每個時刻的圖像單獨處理,默認當前圖像已經(jīng)包含完整狀態(tài)(這里隱含一個假設(shè):當前 observation 足夠代表完整世界狀態(tài),也就是把機器人操作當成 MDP( Markov Decision Process)),但真實情況是機器人操作往往是部分可觀測的,需要記住過去動作、過去觀察和交互歷史。也就是,真實機器人控制更像 POMDP(Partially Observable Markov Decision Process):當前圖像只是局部觀察,很多信息可能被遮擋、被歷史動作改變,或者需要從之前的交互中推斷。本文指出,現(xiàn)有 VLA 逐幀獨立處理視覺輸入,會導(dǎo)致模型每一步都“重新看圖”,無法利用過去上下文來關(guān)注關(guān)鍵區(qū)域。

      創(chuàng)新點

      AVA-VLA的核心創(chuàng)新點:以 POMDP的角度去建立VLA policy learning:動作不只依賴當前 observation,也應(yīng)該依賴歷史 belief / recurrent state。 其中,提出 recurrent state:從上一時刻 action-related hidden state 中提取壓縮表示,用來保存歷史上下文。 同時,提出了 Active Visual Attention, AVA 模塊:用 recurrent state + 當前視覺 token + 語言指令,動態(tài)計算每個視覺 token 的重要性,進而把重要性權(quán)重注入 LLM 的 attention matrix,讓模型在所有層中增強任務(wù)相關(guān)視覺 token、削弱無關(guān)視覺 token。 訓練上采用 truncated BPTT,避免完整長序列反傳帶來的顯存和計算爆炸。 白話文,AVA-VLA 可以理解為給 VLA 加了一個“任務(wù)的記憶 + 聚光燈”:上一時刻 hidden state → recurrent state:我剛才做了什么、看到了什么、任務(wù)進展到哪里→Active Visual Attention→當前圖像里哪些 token 更重要?→增強 stove switch / object / contact area→削弱背景、桌面、無關(guān)物體→預(yù)測當前 action chunk。

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,兩個連續(xù) timestep:上一時刻的 hidden state 經(jīng)過 MLP 投影成 recurrent state,這個 recurrent state 一方面用于初始化當前 action placeholder,另一方面輸入 AVA 模塊。AVA 模塊把 recurrent state 與當前視覺 token、文本 instruction 結(jié)合,通過 FiLM、cross-attention、self-attention 生成 soft importance scores。然后這些視覺 token 權(quán)重會調(diào)制 LLM backbone 內(nèi)部 attention matrix,使模型在當前幀中主動關(guān)注與歷史和任務(wù)相關(guān)的區(qū)域。本質(zhì)上,AVA-VLA 就是把上一時刻的決策隱狀態(tài)變成當前視覺處理的控制信號。

      意義

      為什么推薦AVA-VLA 呢 ?,因為本文揭示了 VLA 不是單幀圖像理解模型,而是具有閉環(huán)序列的決策系統(tǒng)。很多 VLA 論文關(guān)注更大的 backbone、更好的 action tokenizer、更強的 decoder、更大的數(shù)據(jù)集;AVA-VLA 則說明,即使你的模型足夠大,如果每一步都把當前圖像當作完整狀態(tài),仍然會在丟失重要的上下文。對于實際部署的機器人而言,常面對遮擋、視角變化、動作執(zhí)行錯誤或誤差等等問題;這些都不是單幀 VLA 能正確解決的。


      Recovering Hidden Reward in Diffusion-Based Policies  (ICML 2026)

      作者: Yanbiao Ji等(上海交大等)

      背景

      Diffusion Policy 通過學習 demo進而生成復(fù)雜、多模態(tài)動作,但本質(zhì)仍然是 behavior cloning:只學“怎么做”,沒有學明白“為什么這個動作更好”。也就是說,它知道動作的數(shù)據(jù)大體分布,但不知道這些動作背后的偏好、成功的原因、動作好壞的排序等。本文指出,diffusion-based policies 通常模仿 trajectories,但沒有顯式學習到rewards。但同時,另一條路線是 IRL / reward learning,但傳統(tǒng) IRL 往往訓練不穩(wěn)定、計算開銷大;而普通 energy-based imitation 又常常只是把 energy 當作 action score,不一定能解釋為可識別的reward。為此,本文認為Diffusion Policy 可能已經(jīng)隱含了專家策略的 reward gradient / soft Q-function gradient,也就是擴散模型學到的 score field,本質(zhì)上可能包含“專家偏好往哪里提升”的方向。白話文,普通 Diffusion Policy:學一堆箭頭,告訴動作從噪聲往哪里去,最后生成像專家的動作;本文的EnergyFlow:不只學箭頭,還學一張“能量地形圖”。好動作在低能量谷底,壞動作在高能量區(qū)域(箭頭是這張地形圖的梯度)。

      創(chuàng)新點

      EnergyFlow的核心創(chuàng)新點:用一個 scalar energy function Eθ(s, a) 來參數(shù)化擴散策略,而不是直接預(yù)測 denoising field; 通過自動微分得到 denoising score:Sθ = -?aEθ(s, a),從結(jié)構(gòu)上保證 learned field 是 conservative / integrable field。 同時,提出 centered shaping reward,通過減去 state-dependent baseline 來消除 energy 中無法識別的狀態(tài)偏置,使其更適合作為下游 RL reward。 本質(zhì)上,它把 diffusion-based imitation learning 和 inverse reinforcement learning 接起來,形成“生成動作 + 恢復(fù) reward”的統(tǒng)一框架。白話文,普通 diffusion policy 像是:給你一個動作噪聲,模型告訴你:  往左一點、往上點、再靠近專家動作一點;EnergyFlow 則像是:模型先學出一張能量地圖( 好動作 = 山谷,壞動作 = 山坡 / 山頂),然后動作生成時( 沿著能量下降方向走到低能量動作),reward 提取時選擇低能量( = 更像專家偏好的動作)。

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,左邊是普通的Diffusion Policy:模型直接預(yù)測 denoising vector field εθ(s, a),這個 field 可以把噪聲動作一步步變成專家動作,但它沒有顯式能量函數(shù),因此很難直接輸出 reward。而右邊是 EnergyFlow:模型先參數(shù)化 scalar energy Eθ(s, a),再用其梯度 ?Eθ 作為 denoising field;這樣同一個模型既能生成動作,也能輸出 reward signal。概括而言,Diffusion Policy 只學“動作往哪里去”,EnergyFlow 學“為什么往那里去”的能量地形,也因此,EnergyFlow 把 diffusion policy 從純生成模型推進到可解釋的 preference / reward model。

      意義

      為什么推薦EnergyFlow呢?因為一般的 Diffusion Policy能生成平滑、多模態(tài)、接觸豐富的動作;但沒有一個可解釋的機制,而EnergyFlow有可能成為解釋專家行為背后的reward的基礎(chǔ)。也就是,它可能把如下三個方向連接起來:Diffusion Policy(動作生成)+Energy-Based Model(偏好建模)+Inverse Reinforcement Learning(reward)。真實場景里 reward engineering 很貴,人工設(shè)計 dense reward 很難,而 sparse success reward 又太弱。EnergyFlow 提供了一種可能路徑:先用 demo訓練 EnergyFlow→得到可生成動作的 policy→同時得到 energy-based reward signal→用于 downstream RL / online improvement / policy refinement;這對各種機器人都有價值,因為這樣可能降低 reward 設(shè)計成本,并讓demo數(shù)據(jù)不僅用于模仿,還能轉(zhuǎn)化成后續(xù)強化學習的reward機制。


      OmniRetarget: Interaction-Preserving Data Generation for Humanoid  Whole-Body Loco-Manipulation and Scene Interaction (ICRA 2026 Best Paper Award on Robot Manipulation and Locomotion)

      作者:Lujie Yang等(Amazon FAR (Frontier AI & Robotics)等)

      背景

      人形機器人要學復(fù)雜動作,需要大量高質(zhì)量的人類動作demo。但把人的動作轉(zhuǎn)到機器人身上很難,現(xiàn)有方法常常會出現(xiàn)腳滑、穿模、接觸不準等問題(現(xiàn)有方法大致有兩類,第一類是 teleoperation:可以利用人類實時反饋避免一些 retargeting 錯誤,但成本高、勞動密集、不適合大規(guī)模數(shù)據(jù)生成,而且人和機器人 embodiment gap 仍然存在;第二類是 offline retargeting,通常依賴 keypoint matching、orientation matching 或 soft penalty,能把人類動作轉(zhuǎn)成人形機器人動作,但經(jīng)常忽視人-物體、人-地形之間的交互關(guān)系,容易出現(xiàn)各種問題【foot skating:腳應(yīng)該貼地卻在滑;penetration:機器人身體或手穿進物體/地形;contact loss:該接觸時沒有接觸;object interaction mismatch:人類搬箱子的相對關(guān)系沒有被機器人保持】)。結(jié)果是,機器人后續(xù)用強化學習訓練時,不得不靠一堆復(fù)雜的獎勵函數(shù)來彌補這些數(shù)據(jù)帶來的問題。而本文認為:人形機器人 retargeting 不能只匹配人的關(guān)節(jié)點,而要保留“人—物體—地形”的空間關(guān)系和接觸關(guān)系;只要demo足夠干凈,后續(xù) RL 就可以用極簡 reward 學到復(fù)雜 whole-body skills。白話文,白話說,傳統(tǒng) retargeting 像是在問:人的手在哪里?人的腳在哪里?機器人盡量把手腳放到類似位置;但本文 OmniRetarget 問的是:
      人的手和箱子是什么關(guān)系?腳和臺階是什么關(guān)系?身體、物體、地形之間的空間結(jié)構(gòu)是否被保留下來?
      機器人這樣做會不會穿模、腳滑、超關(guān)節(jié)限制?

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      創(chuàng)新點

      OmniRetarget的核心創(chuàng)新點:用 interaction mesh 顯式建模身體、物體和地形之間的空間/接觸關(guān)系; 用 Laplacian deformation minimization 保持交互結(jié)構(gòu):不是簡單匹配 keypoints,而是盡量保持 source interaction mesh 和 target interaction mesh 的局部幾何關(guān)系。 同時,引入 hard kinematic constraints:包括 collision avoidance、joint limits、velocity limits、foot sticking,避免穿模、越界和腳滑;當生成高質(zhì)量 reference motion 后,RL 訓練可以極簡化:只用 5 個 reward terms、4 個 robot domain randomization terms、純 proprioceptive observation,就能完成復(fù)雜任務(wù)。 白話文,可以把 OmniRetarget 理解成一個“人形機器人動作翻譯器”:Human motion + object + terrain→interaction mesh:記錄人、物體、地形之間的相對關(guān)系→constrained optimization:找一個機器人姿態(tài)序列→既像人類動作,又不穿模、不腳滑、不超關(guān)節(jié)限制→生成 reference motion→RL policy 學會真實機器人可執(zhí)行動作。如下圖:

      2026年最值得推薦的robotics[具身智能]頂會paper(RSS,ICRA,ICLR ,CVPR,ICML)半年總結(jié)

      如上圖,左邊輸入來自 LAFAN1、OMOMO 和 in-house MoCap 的 human motions;中間通過 interaction mesh retargeting,最小化 source mesh 和 target mesh 的 Laplacian deformation,同時滿足 kinematic constraints; 隨后進入 efficient augmentation:同一條demo可以變成不同 terrain、object type、object pose、spatial configuration 下的多條 reference trajectories ;  右側(cè)是 RL training:使用生成的 kinematic reference,只需 5 個 rewards、4 個 domain randomization terms 和純 proprioceptive observation,就能訓練 policy ; 最右邊顯示 zero-shot sim-to-real:這些 policy 直接部署到真實 Unitree G1 上完成復(fù)雜場景交互任務(wù)。

      意義

      為什么推薦OmniRetarget呢?因為很多人形機器人 RL 的困難來自demo (reference motion )數(shù)據(jù)有問題:腳滑、穿模、接觸錯位。于是大家不得不用大量 reward terms、contact schedule、foot air-time penalty、slip penalty 等東西補救。OmniRetarget 的工作說明:如果先把數(shù)據(jù)做好,后面的 RL 就可以簡單很多。也就是,核心問題從“如何設(shè)計更復(fù)雜 reward”變成“如何生成更好的demo”問題,只要 reference motion 保留了關(guān)鍵交互關(guān)系,純 proprioceptive policy 也可以完成很復(fù)雜的交互,進而可以顯著簡化 RL、提升 sim-to-real 成功率。






      分享:
      相關(guān)文章
      最新文章
      請?zhí)顚懮暾埲速Y料
      姓名
      電話
      郵箱
      微信號
      作品鏈接
      個人簡介
      為了您的賬戶安全,請驗證郵箱
      您的郵箱還未驗證,完成可獲20積分喲!
      請驗證您的郵箱
      立即驗證
      完善賬號信息
      您的賬號已經(jīng)綁定,現(xiàn)在您可以設(shè)置密碼以方便用郵箱登錄
      立即設(shè)置 以后再說
      主站蜘蛛池模板: 小欢喜全集免费观看| 李宗瑞在线免费观看| 女保险公司销售员2| 万古仙穹动漫第二季| 开膛手杰克电影| 电影长津湖战役完整版播放免费观看| 我们永不言弃| 高清我独自蜜月未删减| 《诱人的女教师2》在线播放| 需要爸爸播种籽在线观看 | 定结县| 女人的抉择在线观看| 卡通电影三国志| 我的麻辣女教师| 哈利·波特第一部| 《美丽女儿替父亲还债》剧情电影 | 人鱼公主动画片| 电影陷阱完整版观看高清韩国| 卖房的女销售| 高清《一路向北》完整版| 360大佬爱上我第二季观看| 婚前试爱粤语| 《修理工的艳遇》接丈夫电话还在做爱 | 四个孩子的妈妈要努力| 九河入海电视剧全集| 所罗门 凯恩| 谁是爸爸全集在线观看| 谈判官免费观看电视剧高清完整版| 《女销售员的销售秘密2》| 正者无敌演员| 《执行秘书》2016| 姐姐的朋友5在完整4视频带翻译| 荒野渔夫| 孟丽君电视剧| 按摩店电影叫什么名字| 幸福里的故事| 总统夫人的夜晚高清完整版在线观看 | 珠帘玉幕电视剧免费播放下载| 五道口宏楠怎么死的| 我和我的家乡在线播放最新| 军嫂逆袭:致富养娃两不误全集免费| 纵棠短剧演员表| 赖猫的狮子倒影免费观看星辰网| 剧场版名侦探柯南| 入间同学入魔了第一季| 吴彦祖 三级| 苏迪曼杯2023赛程| 先婚后爱全集免费| 金梅瓶免费完整在线观看 | 乌兰巴托的夜 蒋敦豪| 西安大学生兼职网| 马志明 大保镖| 致命对决| 电视剧文成公主| 金刚狼电影| 尸城在线观看| 皎洁迎宵之月| 快乐的大人| 黑皮辣妹在线观看| 春晚贺电| 心灵的呼唤| 通往天国的倒计时| 再见孙悟空| 黄百韬简介及最后结局| 美女热舞慢摇| 指匠情挑| 我是余欢水 电视剧| 电视剧真心英雄全集免费观看| 使徒行者4| 万古仙王200集完全版| 王老五的艰难爱情| 美国往事| 暗战电影| 突然的喜欢一共多少集| 黑大粗大战俄罗斯美女| 且试天下电视剧免费观看完整| 妈妈的职业免费完整版在线观看 | 一波拉病毒2| kendykross壮志凌云| 电影《军中乐园》| 白峰美羽 播放| 恋爱暴君完整免费观看| 特殊保险推销员中字8| 小橙子姐姐| 菲律宾合租电影满天星四星| 一次特殊的游泳课| 姑娘在线第8集| 不信天上掉馅饼| 法国空姐5在线看免费高清满天星全集| 天堂之吻电影版在线看| 《越南姑娘500元排毒的电影》| 我的水蜜桃好软水好多| 娃娃脸5之温莎的复仇| 年轻的妈妈hd| 银瓶梅电视剧第5集电视剧| 恰同学少年全集| 无人区高清在线观看| 英语老师在线观看| 霸道股评最新视频| 南北兄弟| 七时吉祥免费观看全集电视剧| 劈雳mit| 朋友的妈妈中语版| 重振精武门| 失笑电视剧| 繁华落尽电视剧免费观看| 影子爱人电影| 日本电影《替弟还债十日》日剧| 手铐钥匙| 妻子6免费完整高清中文版电视剧| 战神归来| 壮志凌云美版满天星| 火星西路7号| 安姨版《售楼女王》满天星在线看| 可爱的妹妹| 《年经继拇2》| 冲上云霄2大结局是什么| 女超人满天星版麦乐迪| 看了又看蓝燕| 通山县| 脏的交易| 食物链无删减| 童军手册之僵尸启示录无删减| 超级演说家在线观看完整版免费| 《迷失东京》| 亡国公主:复仇江山全集免费| 在宇田川町等我喔| 苍蝇之母电影| 维修工王李丹妮| 黄金时代电影| 动感之星 小玲 全集| 电视剧神探狄仁杰第一部| 《公的浮之手中字》免费电影| 和女邻居做爰伦理| 战狼六马大牛| 花花公主| 美国版荷尔蒙6免费观看| 我喜欢你 电视剧| 泗洪县| 四大名捕重出江湖| 流星花园2高清| 生死狙击在线观看免费观看完整版| 梅花巾 电影| 巾帼枭雄之悬崖 电视剧免费观看| 星汉灿烂在线免费观看| 吉他精灵| 少年张三丰张卫健版电视剧| 麦乐迪版女超人无删减版什么时候上映| 花与蛇4下载| sao66| 猎情武阎| 遇见你时风好甜| 奇妙的理发店| 我的妈妈动漫日语版动画片| 白峰美羽 在线伦理 妻子的诱惑| 儿女传奇变脸惊情| 日韩r片| 森林狼vs火箭| 酒店第1-5集免费观看| 凯旋在子夜电影完整版在线观看| 恋焰风暴泰剧普通话版在线观看| 维修工的艳遇4| 《蛟龙行动》在线观看高清电影| 丁·度的《妇产科》| 斗罗大陆205在线观看| 渔夫荒野史记在线播放| 老电影武当| 疯狂的性电影在线| 名侦探柯南日语中字| 种其因者须食其果短剧大结局| 美国1-7| 电影小小的我| 不满继拇上午HD| 疯狂动物城衍生剧| 叶问外传张天志国语版免费观看| 水菜丽下马番号| 电视剧银杏飘落| 电影《六个瑞典女孩》| 《斗罗大陆》全集完整版免费观看 | 寄生兽动漫| 郝板栗全部电影| 赘婿在线观看完整版| 爱我几何原声在线完整版| 当幸福来临时| 人海之中遇见你| 聊斋奇谭之武则天| 问心电视剧免费观看完整版| 顶尖飞行员2021完整版满天星| 捉妖战记| 曹查理《浪蝶狂花》电影| 电视剧夜深沉| 被闺蜜强啪百合小说H| 3对1初次体检4| 因为爱情有| 性生活的电影| u9免费看电影| 日本金银1-5普通话版| 用我的手来打扰我吧| 特殊美容室| 高清《高嫁柳嫁家》在线看| 韩国伦理部长来我家| 舒淇主演《灵与欲》免费| 麦乐迪马克斯女超人满天星电影在线观看 | 神断狄仁杰第三部全集| 长武县| 犯罪娇妻在线电视剧免费观看中文版| 日本轮理电影女儿国3| 原来我早就无敌了| 无人高清电影电视剧在线| 微笑百事达免费观看全集完整版 | 《咱们结婚吧》全集| 湘西诡战电影在线观看| 死亡笔记动漫免费高清在线观看| 珠海航展2016时间表| 电影三奸| 《康体水疗》免费播放| 欢乐颂5| melodymarks女超人免费观看全部| 阿浅来了国语电视剧免费观看| 维修工人的绝遇2免费观看| 断背山电影高清版免费观看| 做aj的电视剧大全免费观看 | 妈妈的职业免费完整版在线观看| 古惑仔2猛龙过江电影| 温州周万顺| 幻日的伊甸园| 和部长一起出差的日本电影| 《修理工的艳遇》在线| 七夕潘甜甜牛郎织女资源 | 一念永恒第三季在线播放| 金太郎的幸福生活百度影音| 暴躁少女免费看完整版| 乡下 乱 仑| 《倔强退魔师》在线观看免费高清 | 扶摇 电视剧| 四个女忍者 满天星 雪姬| 下家三千金| 义姐不是不良妈妈动漫在线观看 | 《需要爸爸播种子》免费观看在线播放_HD/未删减_1080P高清电影完整版 - 天堂 | 金瓶梅电影百度影音| 女保险公司推销员4| 特战荣耀免费观看全集| 淫的方程式动漫| 铁血壮士电视剧| 《驯服小峓子》中文板| 年轻的母亲4免费观看完整视频| 偿还债务的麦子完整版| 逆天至尊在线观看全集免费| 私人航空完整版在线播放| 以家人之名免费播放| 外出电影在线观看| 星际传奇2| 先生贵姓| 《聊斋》徐锦江在线观看| 世缘之舟泰剧在线观看| 钢铿锵锵锵锵锵锵在线观看人民| 选了戴蝴蝶面具的妈妈作者是谁| 屠宰呕吐娃娃免费观看完整版视频| 拔苗助长免费| 冰雪尖刀连在线观看| 星际迷航之复仇女神| 九号平衡车nano| 东北人都是活雷锋| 僵尸道长2高清| 内地版流星花园| 高清《钟表馆事件》电视剧| 星光大赏2020什么时间| 百炼成神第三季什么时候上映| 爱情公寓31| 银魂138| 最美情侣国语版免费观看在线| 小丈夫 电视剧| 维克托 科瓦茨| 安乃近说明书| 许冠杰光荣引退汇群星| 生化危机5:惩罚| 南洋十大邪降| 撕裂记忆体| 怪奇物语第一季4k资源免费观看| 圣诞节舞蹈| 五等分的新娘夏季特别篇| 六国紧急开会向朝鲜施压| 年请的母亲4| 今天开始是人类| 前妻回家| 魔兽世界封停超4万开挂账户| 24世纪性格爱情指南日韩| 乔布斯生平简介| 安斋拉拉在线观看| 无可奈何| 法国电影墨菲定律| 冰岛宝库电影免费观看| 人蛇大战国语| 恶女阿楚| 《驯服小峓子》2| 茶馆 电视剧| 东至县| 景区再度上演人从众| 义子的无理侵犯| 长相思2全集免费观看完整版| 电影代理丈夫满足妻子| 《桂花蜜》by居无竹txt| 最棒的情人沼电影| 花街狂奔电影| 高清《周年纪念日》电影| 洛丽塔在线观看高清免费| 扫黑风暴免费播放观看| 刀锋1937| 人间至味是清欢免费观看| 我想被最想拥抱的人威胁| 我的世界小天| 如如影视我的罪恶人生| 珠帘玉幕 电视剧| 英雄联盟动画片第一集| sp微电影2免费| 精灵梦叶罗丽第四季| 庄园色导航| 美女不坏吻戏| 社长夫人用身补偿客户| 郑钦文美网第三轮比赛时间| 神宫寺丈夫不在的五天和公| 我和我的祖国电影在线观看免费| 交换韩国| 植物大战僵尸2坚不可摧攻略| 爱回家224| 同志亦凡人第一季| 和空姐一起的日子剧情| 电视剧新洛神| 话说长江 | 咖喱辣椒3| 屠夫网电影免费观看影视大全| 小熊一族全集| 台北朝九晚五电影| 韩剧火花全32集免费观看普通话版| 最强狂兵电视剧| 年轻的母亲在线观看无删减版| 3d柔铺团之极宝乐鉴宝普通话版| 高清《血疫》电影| 发国少女6| 大开眼界高清免费观看| 日韩伦理片 儿媳妇的味道| 他是谁电影免费观看完整版高清| 电视剧乡村爱情交响曲| 迷雾重重下载| 电影热带雨| 大唐诡异录| 末日狂花钱电影在线观看免费高清 | 宰相刘罗锅40集在线观看| 将军家的小娘子免费观看影视大全| yellow在线免费观看视频| 直销堂网| 美丽小洞| 后院露营在线观看| 《overflower》动漫第1季免费观看全集| 电视剧璀璨人生全集| 高清原始战争| 维修工的艳遇在线观看完整版免费| 阁楼的拼音| 捉鬼敢死队美国满天星| 韩国恶作剧之吻| 东北往事之黑道风云20年第二部| 特殊美容院2| 步步惊心电视剧| 战狼6女版免费观看完整版| 心世界奇遇| 捡漏小能手:古玩街称霸全集免费| 罗丽·星克莱尔电影在线观看| 汽车旅馆| 最佳贼拍档| 高清《为了皇帝》| 《卡戴珊家族 第七季》| 战狼6双人版免费观看正版影视大全| 但行好事短剧免费观看全集| 人猿泰山1995意大利网盘| 美版HD古墓丽影| 春秋乐队| 折腰在线观看免费| 康斯坦丁| 完 陈奕迅| 菠萝菠萝蜜在线免费观看| 超兴奋的朋友妈妈| 潍坊科技学院是几本| 省港一号通缉犯未删减版百度云| 勇者王粤语| 酒店1~50集在线观看| 拆弹专家2完整版播放网站 | 无处逢生| 穿越火线在线观看免费版电视剧| 电影大刀王五| 房产销售电影在线观看| 冷宫废后太后:逆袭登顶全集免费| 比得兔的世界| 心跳漏一拍电视剧| 刘智贤《水润人生》免费看| 山西黄河电视台| 秘密花园在线观看全集免费| 城市的边缘| 痴情快婿国语| 法国《互换游戏》| 阅兵录像| 徐以若方发律师函否认殴打赵露思| 木子檀檀子剧免费观电影| 搜索在线观看| 时尚王中文版| 龚玥菲在线观看免费| sw283| 《忘年恋曲》海外版 | 非洲人与性动交CCOO| 银瓶梅电视剧第5集电视剧在线观看泰国版 | 少年的你豆瓣| 甘十九妹电视剧在线观看完整版| 维修工的艳遇电影完整| 狙击蝴蝶电视剧在线观看| 人心俱乐部电视剧在线观看| 夏家三千金全集下载| 最后的华雨滋动漫在线观看| 《家庭矛盾》3麦乐迪| 一梦浮生电视剧在线观看| 背叛在线观看免费完整版电视剧| 美国式家庭禁忌结局-3| 红场阅兵2015直播| 恶魔岛电影| 酒店1-100集完整版| 大喜临门| 莫比乌斯韩国百度影音| 铃原爱蜜莉| 年轻的母亲4线手在线播放| 男人女人一愁愁愁电视剧| 潘金莲之前生后世| 我的兄弟我的爱人| 格雷的五十度灰 电影| 亲爱的妈妈4韩国完整版观看| 爸爸需要播种| 电视剧《男妇女主任》| 再向虎山行连续剧83版免费观看| 炸天小姐| 斗罗大陆2绝世唐门在线| 日本战狼8免费播放视频大全| 爱情公寓5第13集| 法国版电影满天星HD版女超人| 女人被躁到高潮嗷嗷叫69 | 赛车总动员全集| 三更2之饺子普通话版| 三年中文免费播放观看 | 情满雪阳花电视剧全集免费观看| 凌云壮志满天星欧美版哪里看| 秘书在办公室被躁BD在线小说| 好男人在线观看免费观看| 热情的邻居2019| 澳门回归22周年| 1987渔夫荒野史记免费观看最新章节列| 野花高清在线观看免费完整版| 山东暴雨 压迫感| 《是上司也是老婆》第二季| 青楼十2房在线观看| 慈禧秘密生活高清完整国语电影| 欲望空姐| 银河奥特曼普通话| supergirl麦乐迪完整版 | 哇嘎免费播放完整版| 长相思在线观看| 最强和音| 麦乐迪家庭矛盾是哪部电影| 倒霉爱神下载| 至尊马蒂| 爱情而已电视剧免费观看完整版| 幸福最晴天mp4下载| 爱我几何在线观看全集免费播放莫妮 | 十二生肖电视剧| 《邻居的妻子| 于荣光电影全集| 拯救大兵瑞恩| 靖宇县| 叶卡捷琳娜大帝第一季| 朋友的妈妈在线观看完整版| 外卖员在线观看整板| 《庆余年2》第107集| 我是大歌神| 铿锵锵锵锵锵在线观看完整版 | 巴厘岛的故事电视剧| 女子私人监狱美国版电影免费观看全集| 新选组镇魂歌 江户青春篇电视剧| 《通往你的地图》| 《轮到妹妹》韩剧在线看| 陪你一起长大电视剧| 黄飞鸿电影全集| 绝笔信女教师改口| 新萧十一郎| 漂亮的小瘦了7| 影迷电影网| 斗罗大陆210| 插曲的痛在线观看| 异形3电影| 骑士勇士总决赛| 虎胆龙威3国语高清| 房间里的二人世界原声全集| 电影《寡妇村》海外版| 熊猫烧香杀毒软件| 大闹天宫| 姨母辅导高清版| 电影《女子护卫队》在线观看| 低苦艾乐队| 韩国A片巜上司的秘书| 菠萝蜜电影免费看| 生活大爆炸第十季| 读书| 花心赌圣粤语| 赘婿免费观看| 法国电影《塔日酒店》高清| 奥特曼超银河传说3| 爱情公寓第三季第二集| 销售的秘密3HD| 五十度黑电影完整版| 妹妹好色网| 阿布夏树| 爱我几何电视剧全集| 俄罗斯妈妈电影2024年上映吗 | 韩剧《女医生》免费观看| 庄园色导航| 理想之城电视剧免费观看| 欢乐颂25集| 莱恩安德森《满天星》| 交警 军车| 青蛇未删减| 妻子的视频| 顺娘全集| 扫黑全集| 《图书馆的女朋友》第一季免费 | 阴差阳错换换爱| 失笑电视剧免费观看全集高清| 麦子交换3中字版电视| 迈克杰克逊吉隆坡演唱会| 生吃电影| 牙医姐妹1986完整版资源| 高清《失窃的女孩》电视剧 | 韩国电影办公室3免费完整版在线看| 寄生兽电影迅雷下载| 《卢旺达的玫瑰》| 奥特曼大电影超银河| 若宫莉娜| 插曲的痛在线播放免费大全| 《被淋湿的年轻寡妇日本电影| 周深 卷珠帘| 电影需要爸爸播种| 现在的是哪一个多闻! ? | 狂野式到轮式的转换技巧 | 空蝉之森电影完整版在线播放免费观看| 随唐英雄第四部| 踏血寻梅电影| 我的小哥哥完整版| 苍井空的影片| 明成皇后国语版| abo成结模拟| 我们一起来看流星雨| 垦利地震| 《女同学的滋味2在线观看》剧情1080P最新全集观看 -全集偶像剧 -黑蚂蚁影院 | 三个好媳妇中字头是什么| 复仇者联盟在线观看| 纲手轮x图静音| 秋瓷炫《生死决断》在| 演员请就位第二季第五期在线观看| 借口 电影| 轩辕剑之天之痕| 卖保险的女销售2| 自由的她们免费看全集完整版| 《卿卿我心》叶玉卿电影在线观看| 死神来了6国语完整版免费观看| 咒术回战第三季在线观看| 私藏浪漫电视剧在线播放免费观看| 善良的妻子1中字巴巴鱼汤饭惹人| 泉州天宫酒吧| 韩国伦理电影大全五月天 | 伊波拉病毒2| 丫鬟主母:侯府逆袭全集免费| 初恋限定| 《替弟还债》免费播放| 《熟妇的荡欲》无删减迅雷| 香坂美优| 黄色仓库在线观看| 电视剧狂飙免费观看| 贪婪:欲望之岛 电影| 人民的名义 直播| 五十玫瑰大结局| 妻子的诱惑电视剧| 终极一班3土豆网| 墨西哥电视剧《la rosa de guadalupe》(瓜达卢佩的玫瑰/奇迹玫瑰 在线 | 刚结婚陪部长出差| 爱可以重来电视剧全集| 女销售在线播放| 龙日一 你死定了2| 半斤八两主题曲| 需要爸爸播种子手机在线播放| 电视剧使命在线观看 | 罗颖黄瑞恩官宣分手| 特种兵之火凤凰全集下载| 《爱我几何》免费观看完整版下载| 豪门弃少全集免费| 暴躁老妈46集全免费版观看| 蝙蝠侠与罗宾| 古堡女仆的守护| 疯女人的舞会| 爹地请自重全集免费| 致美丽的你韩剧免费观看全集| 维修师傅的艳遇| 安全屋未删减| 狠狠地撸2015最新版| 韩国电影需要爸爸播种免费在线| 周淑怡PGONE酒店| 《请成为我的家人》电视剧| 一起愁愁30集全免费| 亲爱的客栈2026免费观看| 巴蜀笑星| 《房奴试爱》截取了一段开头原声| 红字 韩国| 圣诞十二劫| https://www.yalan365.com/shiwutv/tvgppaiz.html | 杨鸣曾数次起诉离婚| 邛崃市| 电影欲望桃花| 人鱼小姐国语版在线观看免费全集| 贝多芬启蒙3电影在线观看免费版| 嘉科米妮| 美国禁忌睫毛膏3完整版| 名侦探柯南剧场版12| 大侦探福尔摩斯1在线| 热浪滚汤在线观看| 天天躁狂AAAA| 需要爸爸播种 美国版在哪里可以看 | 故乡别来无恙电视剧免费观看| 金城武电影全集| 《颠鸾倒凤尽合欢》电影完整版| 尤雅歌曲| 七品芝麻官电影完整版| 毒医肥尸无删减免费观看电视剧| 彭丹演过的电影| gongshoudao| 《女军医》满天星观看| 和部长一起泡温泉| 仙逆73| 荒岛惊魂在线观看免费完整版 | 唐宫美人天下杨幂| 特邀外卖员的女主角是谁| 恶作剧之吻韩版网络版| 叶罗丽第十一季在线观看| 女超人麦乐迪无删减版| 夫妻换房在线| 综艺免费观看| 善良的岳母娘| 女员工的待遇中文| 微微一笑很倾城剧情介绍| 金蝉脱壳1| 新还珠格格76| 彭丹徐锦江电影《悟间道之奇缘》| 真实real| 功夫厨神国语高清在线观看完整版 | 重逢丈夫的下属是初恋在线观看| 小胖俞涛回应九转大肠梗| 魔女的侵袭| 瓜达卢佩的玫瑰2| 丹麦女孩未删减版| 啥事佩奇| 《维修人员的培训》| 伊甸园 韩国综艺| 爱情诊所在线观看| 新妈妈k8| 《站着再来一次》| 小凉宫春日的忧郁| 狙击手特别行动电影免费完整观看 | 元气满满的哥哥| 深海狂鲨百度影音| melody在线电影免费观看| 至尊兵王:市井隐藏短剧全集| 大威虎看世界| 《我的游泳女教练》免费动漫在线看 | 《牙医姊妹》未删减版| 太极生两仪 两仪是什么| 我是刑警40集全免费看| 韩剧《激战三姊妹》在线观看 | 屋顶工拉片叫什么电影| 插曲30分钟全集免费播放国语 | 快乐的大人免费观看完整高清综艺| 按摩女技师| 泰剧甜心派| 《魔法少女伊莉雅》| 安斋拉拉电影完整版电影!| 风流一夜情在线观看| 小姬无人宠| 点燃我温暖你电视剧免费观看| 欧美1一5美国语| 365天:明日之欲| 意大利电影《小少爷和女仆》| 俘虏之锁1~4集免费观看中文版| 少年派第二季全集免费播放| 日军屠杀慰安妇影像| 满天星版《超女麦乐迪》完整版 | 酒店服务员电影免费观看| 新还珠格格98集| 珠海体育中心撞人事件| 娃娃脸在线观看完整免费高清原声满天星剧| 高清《催眠术》樱花动漫| 系统激活短剧全集| 金瓶双艳电视剧免费观看全集高清 | 在线观看塔日酒店| 电影网在线观看| 二十四小时第二季| 妻子8免费完整高清| 聊斋在线观看免费全集| 年少轻狂| 当涂县| 卖房子的女销售3无遮挡| 赖汉的幸福指数全集在线观看| 高清《八仙全传》40集全| 欧美黑白配在线免费观看| 火蓝刀锋30| 西瓜视频免费| 4法国少女| 沙特无人机表演| 马东锡乌有之地| 等到胜利的那一天| 按摩女人奶电影| 孙子兵法三十六计| 夫妻免费观看全集完整版| 三年中国免费观看完整版| 十七岁的单车电影| 《妻子去加班的夜》中文翻译| 天子寻龙| 克莱尔《X迷宫》全集免费看| 高清《蒙特利尔,我的美人》电影| 电视剧糟糠之妻| 双人调情接摩术电影| 蜡笔小新全集播放| 蔡琴如梦令| 美国《行政助理》2014| 女版壮志凌云2满天星1080p | 不良义姐是| 美丽小蜜桃免费| 蓝可儿电梯事件| 《女军医》满天星观看 | 老司机福利午夜| 古墓丽人(大人版)在线观看| 叶罗丽第11季正片免费观看| 日本男星梶田冬磨去世| 眼前人心上人短剧免费观看| 俺去也在线播放| 《曼娜艳荡性史》| 原神旅行者插雷电将军的游戏| 公之浮手电影免费播放| 基层风云| 老李头的春天第九集| 电视剧我和老妈一起嫁| 双人精油按摩调情刺激阴茎高潮伦理免费电影 | 摩登原始人英语| 黄沙武士2| 姐姐韩国电影免费观看 电视剧| 四位少妇按摩| 危险关系在线| 舞蹈家苏科老师简介| 河曲县| 男生女生一愁愁愁电影在线观看| 繁华电视剧免费观看完整版高清| 再见了大别山吕继宏| 法国空姐| 辣妹子电影电视剧在线播放| 和老板在办公室BD 中文| 情难断原唱| 麦乐迪女超人原片法国| 河山 电视剧| 撒玛利亚电影完整版在线观看| 青春禁区免费完整版观看| 美女扒精光秘 免费观看 | 老婆大人1| 驯服上司女社长| 李宗瑞 mia| 非你莫属2010| 仪征市| 成全在线观看高清动漫| 半吨先生| 台湾版红楼梦| 郝板粟电影免费播放| 巜性刑房3捆绑凌虐免费在线观看 战狼6免费观看在线播放完整版视频软件下载 | 薄暮传说剧场版| 甲种公牛1976意大利| 《有夫之妇的秘书》演员表| 黑暗领域存档| 黄绮珊离不开你歌词| 三年免费观看大全国语电影大全| 我的妈妈动漫版免费观看第一季| 杀人锦标赛| 房术入门40个动作| 巜人妻私密按摩师2| 归途电视剧全集免费观看乐视| 《夕颜》动漫番剧全集免费观看| 木下檀檩子免费观看高清版| 幻灵夹克| 下女qvod| 隔离区2| 铿铿铿锵锵锵锵免费观看| 渔夫荒野国语完整版| 电视剧嘎达梅林| 包青天开封奇案| 洪七公被谁杀的| 莫妮爱我几何免费高清电影无删减| 韩讯五第二部| 丞相夫人是首富| 乐陵市| 私人航空观看| 上课时胸罩不小心掉下来的事| 电视剧破密免费观看完整版高清| 战狼6免费观看高清| 台湾人的身份证| 胡桃大战史莱姆在线观看| 东方侠客免费观看全集| 麦乐迪满天星电影| 战狼9大牛免费观看西瓜视频| 欣德·拉贾布之声| 诛仙2电影完整免费观看| 黑崎先生停不下来的专一之爱电视剧 | 樱井莉亚4p无删减在线播放 | 星汉灿烂电视剧全集| 苍老师电视剧36集全免费播放| 陆小凤传奇绣花大盗| 斗罗大陆210| 寒枝折不断电视剧免费观看| 1-5普通话版免费播放| 痕迹在线观看| 红豆女之恋| 远远的爱电视剧免费观看| 偷窥无罪吴彦祖电影全集| 天地民心| 泰剧在线观看| 回复术士之重启人生第二季| 91制片厂 - 看她社区| 坎贝奇《品味人生》在线播放| 七次狼方针对华人免费播放| 南洋第一邪降下载| 潮安县| 特殊按摩日本电影在线观看| 迷雾追踪24集免费观看| 潜行狙击电影版国语| 欲乱上班族 电影| 暴躁的少女国语版在线观看| gae枯萎之花上的眼泪| 特利迦奥特曼国语免费观看| 刺客伍六七之暗影刺客| 《法国空姐2024版》| 权力的游戏第一季无删减| 还珠格格第一部1一24集| 恶女花魁| 意大利女超人| 达科塔-范宁| 伪娘电影|