• <track id="oztn4"></track>
    <sup id="oztn4"><form id="oztn4"></form></sup>
    
    
    <mark id="oztn4"></mark>
  • <dfn id="oztn4"><samp id="oztn4"></samp></dfn>
      《地爆天星小姐》电影 ,麦子交换2免费观看2023年上映时间表 ,莫妮卡《爱我几何》,大牛影库战狼6欧式少女全部视频,三年大片国语版在线看,日本空姐电视剧,电影魔镜号中文字幕,和部长一起去出差旅是第几集
      全球「AI學(xué)術(shù)頂會」精華匯聚地
      您正在使用IE低版瀏覽器,為了您的雷峰網(wǎng)賬號安全和更好的產(chǎn)品體驗,強(qiáng)烈建議使用更快更安全的瀏覽器
      此為臨時鏈接,僅用于文章預(yù)覽,將在時失效
      人工智能 正文
      發(fā)私信給鄭佳美
      發(fā)送

      0

      ICLR 2025:頂尖科學(xué)家最關(guān)心的 AI 趨勢有哪些?丨GAIR Live

      本文作者: 鄭佳美   梁丙鑒   2025-04-28 11:19 專題:ICLR 2019
      導(dǎo)語:Scaling Law 走到盡頭了嗎?擴(kuò)散模型會成為主流嗎?通用 Agent 還有多久會來?

      自 GPT-4 發(fā)布至今已有兩年,但對大語言模型的研究并沒有放緩,我們?nèi)蕴幵谝粋€技術(shù)進(jìn)步涌現(xiàn)的時代。Anthropic 于 2024 年11月發(fā)布 MCP,成為接通 AI 生態(tài)的橋梁,自主的 Agent 工作流距我們更進(jìn)一步。GPT-4o、GPT-4.1時隔僅一個月先后發(fā)布,實現(xiàn)上下文處理能力八倍提升。在國內(nèi),DeepSeek 憑借FP8 混合精度訓(xùn)練引發(fā)行業(yè)震動,Manus發(fā)布號稱全球首款通用Agent,先后在今年年初掀起全民AI熱潮。

      前沿方向尚未收斂,技術(shù)突破紛至沓來。以月為單位的技術(shù)迭代下,如何看清AI行業(yè)的最新趨勢?

      2025年4月26日,雷峰網(wǎng)(公眾號:雷峰網(wǎng))、AI科技評論 GAIR Live 品牌舉辦了一場主題為 “頂尖科學(xué)家聊 2025 ICLR 最近趨勢” 的線上圓桌沙龍。

      圓桌主持人為雷峰網(wǎng)高級主編馬曉寧,并邀請了南洋理工大學(xué)校長講席教授,人工智能系主任,人工智能交叉研究院院長安波、浙江大學(xué)計算機(jī)學(xué)院百人計劃研究員趙俊博、清華大學(xué)AIR研究院助理教授趙昊、埃默里大學(xué)計算機(jī)系副教授劉菲,共同開啟了一場深度對話。

      ICLR 2025:頂尖科學(xué)家最關(guān)心的 AI 趨勢有哪些?丨GAIR Live

      交談過程中,嘉賓們圍繞AI技術(shù)加速迭代下,LLM決策系統(tǒng)發(fā)展及應(yīng)用方向、Agent前沿趨勢、Scaling Law的前景、Diffusion及新模型架構(gòu)的可能性等多個方面發(fā)表了獨到見解。

      從GPT-4開始,更大規(guī)模、更高質(zhì)量的樣本使模型智力不斷提升,LLM的能力邊界逐步拓展。然而,數(shù)據(jù)枯竭的隱憂也徘徊在Scaling Law的路徑盡頭。不久前,David Silver和Richard S. Sutton兩位頂尖人工智能技術(shù)專家聯(lián)合發(fā)表論文,指出從人類數(shù)據(jù)中提取的知識正迅速接近極限,高質(zhì)量數(shù)據(jù)源大多即將耗盡。

      Scaling Law是否已經(jīng)走到盡頭?

      對此,趙俊博表示需要對不同領(lǐng)域分別考慮。高質(zhì)量數(shù)據(jù)的耗竭已成定局,預(yù)訓(xùn)練首當(dāng)其沖。“人類最高質(zhì)量的一批token加起來有10~15T,DeepSeek-V3用了14.8T。在這15T數(shù)據(jù)的基礎(chǔ)上,如果接受比較高質(zhì)量的合成數(shù)據(jù),再把數(shù)據(jù)質(zhì)量的門開得稍微大一點,差不多能擴(kuò)展到25~30T,再往上就很難有更多的數(shù)據(jù)塞進(jìn)來了。”

      有業(yè)內(nèi)人士向AI科技評論指出,當(dāng)前大模型及大模型產(chǎn)品發(fā)展的技術(shù)源動力仍為預(yù)訓(xùn)練,它直接關(guān)系到模型的智力水平。25~30T是預(yù)訓(xùn)練數(shù)據(jù)的上限,也或?qū)⒊蔀長LM的天花板。

      當(dāng)算力和樣本不足以筑起走向AGI的通天塔,技術(shù)層的創(chuàng)新點會成為AI行業(yè)邁向下個臺階的關(guān)鍵一招。

      回頭再看,劉菲對有限數(shù)據(jù)的分配提出了追問。“現(xiàn)在大家在做基礎(chǔ)模型的時候,基本上是把能夠拿到的無論是文本還是其它模態(tài)的信息,幾乎是一股腦地放在預(yù)訓(xùn)練當(dāng)中。然后在后訓(xùn)練階段,對于不同的領(lǐng)域,會有專門的數(shù)據(jù)。其實我們可以重新思考一下這個問題,有沒有可能有一種比較好的方法,能夠把數(shù)據(jù)在預(yù)訓(xùn)練和后訓(xùn)練中合理地分配,最大化地提高模型能力。”

      任務(wù)創(chuàng)新同樣富于潛力。Predict the next word一直是訓(xùn)練大語言模型的出發(fā)點,以完成這個任務(wù)為導(dǎo)向,模型性能實現(xiàn)了速度、指令遵循、推理能力等方面的全方位提升。劉菲提出:“現(xiàn)在我們能不能通過在任務(wù)上的創(chuàng)新,提出新的task,幫助我們提高模型的后訓(xùn)練效果,或者模型在某一個領(lǐng)域需要的特定能力。”

      以下是此次圓桌討論的精彩分享,AI科技評論進(jìn)行了不改原意的編輯整理:

      技術(shù)迭代,AI “狂飆”

      AI科技評論:這次我們沙龍的主題是頂尖科學(xué)家聊 2025 ICLR 的最新趨勢。我們請到了四位嘉賓,分別是浙江大學(xué)計算機(jī)學(xué)院百人計劃研究員趙俊博、南洋理工學(xué)院校長、人工智能系主任安波、埃默里大學(xué)計算機(jī)系副教授劉菲、清華大學(xué)AIR研究院助理教授、光輪智能首席科學(xué)家、智源學(xué)者趙昊。今天把四位老師請過來,希望可以跟大家分享一下我們在 ICLR 有什么樣的見聞,以及對于接下來人工智能走向和趨勢的預(yù)測。

      我想問四位老師的第一個問題是,大家覺得今年的 ICLR 跟往年比有什么不一樣的地方?

      趙俊博:我上一次來 ICLR 已經(jīng)是很多年前了。這個會其實是從我們NYU的實驗室split off出去的。14年剛開始的時候也就幾百篇論文,沒想十一年過去變化會這么大。所以我今年最直接的感受就是人多、論文多、會場大。當(dāng)年的poster要講四五個小時,因為當(dāng)時其實沒有那么多的poster,但現(xiàn)在的poster已經(jīng)壓縮到了兩個小時的極限。

      安波:今年更大一些,有很多來自中國的老師和同學(xué),內(nèi)容也特別多。今年組織注冊那個地方要排一個小時才能領(lǐng)到這個牌子,另外會場顯得更加擁擠,通道也比較窄。 我個人覺得這個會太大了,當(dāng)然也證明這個會的質(zhì)量很好,來了很多優(yōu)秀的人。

      劉菲:我去年參加了在維也納的 ICLR 會議,想把去年和今年的做一個對比。我感覺今年的論文在深度和廣度方面都是非常棒的,首先我看到了很多非常好的LLM潛在的落地相關(guān)的應(yīng)用。另外一個我注意到的現(xiàn)象是,今年有非常多金融領(lǐng)域的公司作為我們的贊助商。所以我個人也很期待,大模型將來在金融領(lǐng)域能有什么樣的突破性的發(fā)展。

      趙昊:我前年去了基加利(盧旺達(dá)首都Kigali,編者注)那場,給我印象特別好。當(dāng)時也是疫情后第一次 ICLR,能感覺到無論中國人還是外國人都很興奮。兩年以后再來,我覺得很意外的就是贊助商怎么這么多。因為最近幾次去 CV 的會議,贊助商的數(shù)量好像都有些變少。

      AI科技評論:趙老師您今年帶了幾篇論文過來?

      趙昊:今年就帶了一篇論文,是做 Conditional Image Generation 的。我的研究方法論是我們生成一些數(shù)據(jù),然后用這些數(shù)據(jù)去訓(xùn)練更好的感知和決策模型。我們用 reward modeling 的方式,用diffusion從各種控制信號生成圖片,讓它做得更好。

      AI科技評論:四位老師今年在會場上肯定看到了一些論文、演講或者 poster。這些內(nèi)容里有沒有令你們印象深刻的、有趣的、好玩的東西,可以跟我們分享一下?

      趙昊:那我就講一講我們?nèi)ψ永锝衲暌恍┯杏绊懥Φ?paper。第一個就是今年會上的最高分 IC light,也是比較少見地拿到了滿分。這個工作非常有意思,它在diffusion 里把光照做得很好。

      一般大家會認(rèn)為無論image diffusion還是video diffusion,生成出來的東西都不可控。目前的生成在幾何和物理方面表現(xiàn)都不好,但I(xiàn)C light居然能把光照做好,這件事是非常 surprising的。同時它也是一個很好的輪子,我和很多朋友最近都在用 IC light做光照控制的工作。在CVML領(lǐng)域,真正有影響力的paper 是能幫助別人的paper。

      我覺得IC light有影響力,最大的原因是它超前于時代。我經(jīng)常跟我的學(xué)生們說,我最欽佩的科學(xué)家是能發(fā)現(xiàn)超越時代的、帶著藝術(shù)性和靈感的東西。最典型的就是孟德爾,他在DNA雙螺旋結(jié)構(gòu)被發(fā)現(xiàn)之前300 年,就能夠用設(shè)計巧妙的實驗發(fā)現(xiàn)豌豆育種出現(xiàn)不同性狀的比例是3:1。可能在300年、100 年、50年之后,大家看這個技術(shù)也就是那么回事,但他們就是能超前于時代把它做出來,而且還非常有實用價值,我特別喜歡這樣的工作。所以在3D scene understanding and synthesis這個領(lǐng)域,我今年首推IC light這篇滿分論文。

      劉菲:我自己比較感興趣的方向是基于大語言模型的決策系統(tǒng)、規(guī)劃系統(tǒng)和推理系統(tǒng)。決策系統(tǒng)是一個蠻重要的方向,現(xiàn)在越來越多的用戶開始問大語言模型一些復(fù)雜問題。

      我可以舉一個最簡單的例子,比如買咖啡機(jī)有非常多的選擇,可以買一個非常便宜的咖啡機(jī)做dripping coffee,也可以買一個高檔一些的。大語言模型根據(jù)用戶需求進(jìn)行輔助決策,這就是一個非常簡單的決策系統(tǒng)。但同時也會有一些更為復(fù)雜的決策系統(tǒng),比如家里的小孩升學(xué),在擇校的時候會有非常多因素需要考慮,包括學(xué)校的地理位置、師資情況、排名、學(xué)生自身更適合哪種學(xué)校。很多時候大家只是把這些信息直接傳達(dá)給大語言模型,它當(dāng)然會給一個答案,但是我們沒有辦法驗證這個決策是不是最合適的。針對單一事件做單一的決策,傳統(tǒng)上我們基于分類器或者決策樹,配合訓(xùn)練數(shù)據(jù),大語言模型已經(jīng)可以很好地進(jìn)行輔助決策,但復(fù)雜的決策系統(tǒng)目前仍然是黑盒狀態(tài)。

      一個我們比較感興趣的方向是如何把這兩種系統(tǒng)集合在一起。基于傳統(tǒng)的機(jī)器學(xué)習(xí)得到的分類器非常robust,但是只能應(yīng)用于特定的任務(wù)上,而基于大語言模型的決策系統(tǒng)可以達(dá)到特別高的靈活性,我們想把這兩種決策方式結(jié)合在一起。我們有一個系統(tǒng)叫做Define,主要是在金融領(lǐng)域針對月報或者年報,給出投資建議。

      還有一個我們特別感興趣的方向是sequential decision making,它應(yīng)用于我們需要做一連串決定的場景。我舉個簡單的例子,如果我想制定一份新加坡旅行計劃,那我首先要決定買什么時間的機(jī)票、賓館訂在什么地方。同時我要參加ICLR,每天都會有具體的行程安排。把這一連串決策放在一起,需要一個非常復(fù)雜的系統(tǒng)。這個決策系統(tǒng)需要optimize goal,可能是多找時間和大家交流,也可能是控制有限的預(yù)算,這樣它才能做出最適合我的決策。說到這個,安老師有一篇paper叫Agent Studio,我特別喜歡,也希望能夠聽安老師講一下這個工作的細(xì)節(jié)。

      安波:謝謝劉老師。這項工作的技術(shù)性不是特別強(qiáng),我們做了一個能夠提供很多benchmark場景的工具,并做完了整個pipeline,可以讓大家更容易地開發(fā)Agent。

      我個人這兩年更關(guān)注推理RL怎么和大語言模型結(jié)合在一起,以及Agent的研究。大語言模型這個概念已經(jīng)出現(xiàn)好多年了,現(xiàn)在應(yīng)該到了我們開始思考它落地的時刻,所以我會特別關(guān)注它在垂直領(lǐng)域落地方面的事情。我看了一些session,這方面的工作相對前兩年還蠻多的。

      劉老師剛才講到?jīng)Q策系統(tǒng),這也是我們所關(guān)心的。這方面有很多挑戰(zhàn),比如多模態(tài)的推理。4月份新加坡一座房子失火,一人死亡,還有20多人受傷。我們把幾張照片發(fā)給GPT,問他能不能做一份現(xiàn)場處置應(yīng)對的規(guī)劃。我們發(fā)現(xiàn)GPT的規(guī)劃里有很多問題,體現(xiàn)出它的推理能力不夠。比如照片上明顯顯示很多小孩子受傷了,但是它推薦傷者去中央醫(yī)院,實際上新加坡有一個很好的兒科醫(yī)院叫KKH,離火災(zāi)場景只有3公里。

      讓大模型從視頻里檢索出必要的信息,基于這些情況進(jìn)行復(fù)雜推理,這是我們未來特別想做的事情。我們希望它能規(guī)劃消防人員怎么進(jìn)場,需要它考慮現(xiàn)場視頻、圖片、報案的音頻,再把起火大樓的平面圖結(jié)合到?jīng)Q策中。怎么讓這些技術(shù)真正地解決現(xiàn)實問題,還有很長的路要走。這是很有挑戰(zhàn)的事情,但是有很多真實的應(yīng)用需要。

      趙俊博:我接著剛才安老師的話說。post-training的scaling是在去年九月份左右,從GPT-o1開始出現(xiàn)的,而ICLR的截稿日期是10月2號,所以基本上在這次的poster里很難看到跟后訓(xùn)練或者RL相關(guān)的工作。

      這個年代發(fā)展太快了。去年10月ICLR截稿,現(xiàn)在文章才正式面世,但其實從去年10月到現(xiàn)在已經(jīng)發(fā)生了太多事,包括GPT-4.5、MCP、GPT-4o生成與理解統(tǒng)一的非常炫目的生成效果、國內(nèi)的Deepseek等等。當(dāng)年ICLR出現(xiàn)其實是為了縮短文章面世的周期,但是現(xiàn)在這個周期是不是還是趕不上形勢的變化,是不是需要把這些 conference 的形式再重新思考一下。

      安波:現(xiàn)在整個pipeline還是需要三個月甚至以上,也許可以再縮短一些。

      AI科技評論:我們也感覺這大半年的時間天翻地覆。趙老師你在去年九月份的時候,當(dāng)時設(shè)想今年年中可能會有哪些變化?

      趙俊博:我覺得有些事肯定變了,但有些事其實也沒變。我對團(tuán)隊說的一句話就是,我們現(xiàn)在做很多東西都是拍腦袋。比如安老師剛才說的這個場景,雖然它很難,但其實有兩種路徑解決這個問題。第一種路徑是multi-agent,比如可以專門做一個Agent解決消防車的調(diào)用,最后整個決策體系中穿插著各種Agent。但同時有些其他的問題可以依靠模型的底層能力直接解決。

      我們可以看一下LangChain的發(fā)展,他們一開始面向multi-agent編排的技術(shù)做了很多東西,但關(guān)鍵是現(xiàn)在的base model太強(qiáng)大了,導(dǎo)致這些東西好像有一些就沒有意義了。這就涉及到一個問題,有些事兩年之內(nèi)base model 能不能解決掉。如果不能就堅持投入,如果能解決,那我們是不是可以把這方面投入稍微退一步?關(guān)鍵是基于現(xiàn)在這種非常瘋狂的變化,判別在兩年內(nèi)能不能解決,我感覺比較難做。


      Scaling Law 走到盡頭了嗎

      AI科技評論:最近對 Scaling Law 的討論非常多。我也想請教一下四位老師的答案,Scaling Law 到底有沒有走到盡頭?

      趙俊博:我覺得要拆領(lǐng)域來看。首先從 Pre-train 的角度來說,我認(rèn)為已經(jīng)到頭了,因為確實沒有數(shù)據(jù)了。人類最高質(zhì)量的一批 token 加起來有10~15T,DeepSeek-V3用了14.8T。在這15T數(shù)據(jù)的基礎(chǔ)上,如果接受比較高質(zhì)量的合成數(shù)據(jù),再把數(shù)據(jù)質(zhì)量的門開得稍微大一點,我覺得差不多能擴(kuò)展到25~30T,再往上就很難有更多的數(shù)據(jù)塞進(jìn)來了。

      Post-train方面,大家現(xiàn)在還是大幅依靠數(shù)學(xué)和代碼這種可校驗的數(shù)據(jù)。那么關(guān)鍵的問題是,物理、法律、心理等其他學(xué)科的數(shù)據(jù)能不能用,以及 Reward model 或者 Process Reward Model 這些相關(guān)技術(shù)能不能繼續(xù)發(fā)展。或者還有沒有新類型數(shù)據(jù),比如說股票、游戲交互這些數(shù)據(jù)能不能拿來訓(xùn)練大模型。

      其它結(jié)構(gòu)上,Diffusion Language Model 暫時沒有跑出 Scaling Law,我們現(xiàn)在看到7B、8B 有一些效果,但是非自回歸的新方法還是值得期待的。

      安波:我贊同趙老師的觀點,我覺得Scaling Law好像要到盡頭了。我們先說最近火的post training inference,它還是需要數(shù)據(jù),需要得到那些reward signal。有人會說我們搞一個world model,但 world model也得用數(shù)據(jù)來訓(xùn)練,MPC建那個model,還是得從數(shù)據(jù)里面來。

      剛才趙老師談到了多智能體,有一個思考是有沒有 Multi-Agent Scaling Law,我感覺這個也不存在。我是做傳統(tǒng)多智能體的,我們發(fā)現(xiàn)并不見得智能體的數(shù)量增加,性能就會好,因為數(shù)量的增加會導(dǎo)致很多協(xié)調(diào)、通信方面的問題。我個人覺得學(xué)術(shù)界的人沒有必要執(zhí)著于研究 Scaling Law 是不是要走到頭了,因為這個問題已經(jīng)吵了很多年。

      趙俊博:有沒有 Scaling Law 都可以去做 research,這沒什么直接關(guān)系。

      劉菲:我非常同意安老師和俊博老師的想法,這里我可以再補(bǔ)充兩點。

      第一點我認(rèn)為可能有一個方向還可以再深入挖掘一下,就是在談到數(shù)據(jù)的時候,什么樣的數(shù)據(jù)應(yīng)該放在預(yù)訓(xùn)練當(dāng)中,什么樣的數(shù)據(jù)應(yīng)該放在后訓(xùn)練當(dāng)中。現(xiàn)在大家在做基礎(chǔ)模型的時候,基本上是把能夠拿到的無論是文本還是其它模態(tài)的信息,幾乎是一股腦地放在預(yù)訓(xùn)練當(dāng)中。然后在后訓(xùn)練階段,對于不同的領(lǐng)域,會有專門的數(shù)據(jù)。其實我們可以重新思考一下這個問題,有沒有可能有一種比較好的方法,能夠把數(shù)據(jù)在預(yù)訓(xùn)練和后訓(xùn)練中合理地分配,最大化地提高模型能力。

      另外我對 Reverse Scaling Law 也很感興趣,我想補(bǔ)充的第二個方向是,在數(shù)據(jù)一定的情況下如何提高模型的能力,尤其是模型在具體任務(wù)上的能力。我們訓(xùn)練大模型的初衷是 predict the next word,這個任務(wù)本身并不是很重要,其實是通過這樣一個簡單的任務(wù)達(dá)到訓(xùn)練模型參數(shù)的效果。那么現(xiàn)在我們能不能通過在任務(wù)上的創(chuàng)新,提出新的task,幫助我們提高模型的后訓(xùn)練效果,或者模型在某一個領(lǐng)域需要的特定能力。我認(rèn)為這兩個方向,也許可以再深入挖掘一下。

      像剛剛兩位老師提到過的,大部分大家能夠獲得的高質(zhì)量數(shù)據(jù)幾乎已經(jīng)被用掉了。這兩年大語言模型持續(xù)不斷地生成新的文本、圖片,短視頻,以后我們能夠拿到的數(shù)據(jù),會有很多是模型生成出來的。如果我們不加思考地直接用這些數(shù)據(jù)訓(xùn)練大語言模型,我不太確定對于模型究竟有沒有質(zhì)的提高。

      安波:我稍微補(bǔ)充一下。我們 NTU 前兩天邀請了一位 EPFL 的老師,他就研究這個問題。未來的數(shù)據(jù)全部是大模型產(chǎn)生的,一代一代地迭代下去,這個世界會變成什么樣?他做了一些實驗,因為是模擬所以每一代的間隔都要短得多,但是他覺得這將來會對人類的價值觀,甚至一切都帶來很大的變化。

      趙昊:在 Vision 領(lǐng)域,大家比較痛心疾首的是我們還沒有發(fā)現(xiàn) Scaling Law。之前我們做了很久自監(jiān)督的表征學(xué)習(xí),也是想復(fù)現(xiàn)NLP領(lǐng)域的成功,但普遍認(rèn)為結(jié)果不是特別成功。很多人認(rèn)為這是信息密度的原因。Language 的信息密度更高,更容易出現(xiàn) Scaling Law,而 vision 需要壓縮信息。

      我覺得 VLA 有可能在未來一段時間內(nèi)看到 Scaling Law,這是非常 promising 的一件事情。我們現(xiàn)在做 VLA,一般是用遙操作數(shù)據(jù)做動作,做完以后復(fù)原,再重新采集數(shù)據(jù)。其實每一條數(shù)據(jù)都是差不多的,但是就用這些差不多的數(shù)據(jù)訓(xùn)練,50條的時候是不 work 的,200條的時候一般剛開始 work,500條數(shù)據(jù)的時候就非常 work 了。我也不知道為什么,但感覺很像 GPT 出來的時候 NLP 領(lǐng)域那種模模糊糊的感覺。我覺得隨著這些數(shù)據(jù)積累得越來越多,也許未來12個月、24個月、36個月,突然我們的 VLA 就能做出非常靈巧的東西。

      AI科技評論:剛才趙老師提到的一個問題我很好奇。您說我們有很多行業(yè)性的數(shù)據(jù),其實現(xiàn)在還沒有辦法用來訓(xùn)練,是這樣嗎?

      趙俊博:至少在今天,通過各種技術(shù)報告我們可以看到,大家后訓(xùn)練的主體數(shù)據(jù)還是數(shù)學(xué)和 code,這是因為我們需要一個非常明確的 reward 計算公式。數(shù)學(xué)是比較容易算 reward 的,coding 可以跑個 OJ,也有比較明確的 reward 計算方式,這些肯定是最高級的數(shù)據(jù)。次一級的數(shù)據(jù)可能需要一個 model,不管叫它 judge model 還是 reward model,總之得對模型給出的結(jié)果和實際的正確答案進(jìn)行比較,這對數(shù)據(jù)的要求還是挺高的。比如你算出來答案是5,模型的輸出是5,那5是不是等于5,這就是一個 reward。我覺得強(qiáng)化學(xué)習(xí)在大語言模型上面的空間還是比較大的,后面還是有不少事可以做。

      趙昊:我有一個關(guān)于 NLP 的問題想請教一下趙老師。我以前讀書的時候,大家會管 Alexnet 這種模型叫 backbone,然后會在 backbone 上做 fine tuning。現(xiàn)在在 NLP 領(lǐng)域,大家一般會管 backbone 叫 foundation model,然后后面叫 post training。現(xiàn)在我們定義的 post training 和 fine tuning 的區(qū)別是什么?

      趙俊博:我本來想回答這兩個不是一個意思,但我后來想,SFT 好像也在 post training 的范疇里。我不確定現(xiàn)在是不是還在,大家的術(shù)語一直在穿插。

      安波:我的理解是 post training 的概念更廣。Fine tuning 早期可能只有 SFT,后來加入了 RHF,但是沒有把 test time 那些囊括進(jìn)去。現(xiàn)在用 RL 做的 inference、reasoning,是不屬于 fine tunning 的。

      模型架構(gòu)尚未收斂,Diffusion 未來可期

      AI科技評論:我們最近一直比較關(guān)心一個問題,擴(kuò)散模型和回自回歸架構(gòu)在生成任務(wù)上各自有什么優(yōu)劣?

      趙俊博:我個人比較看好 Diffusion。我說的不是直接用一個 Diffusion Model 生成圖像,我覺得 Diffusion 是個很大的概念,它可以 diffuse 很多東西。

      比如清華大學(xué)朱軍老師做的 RDT,整個機(jī)器可以用 Diffusion 在坐標(biāo)空間的幾個目標(biāo)點上跑擴(kuò)散過程。還有謝賽寧他們做的 Meta Query,它可以理解圖像和文本,同時外接了一個 Diffusion Model,通過中間一些簡單的空間上的連接,可以把 Diffusion 吐出去再去生成。這就是一個很典型的 autoregressive 和 Diffusion Model 的整合,去完成所謂的生成、理解的統(tǒng)一。

      Diffusion 打破了自回歸的限制,它的特點是可以擬合高維,可以做 Multi-Modelity 的擬合。所以我覺得 Diffusion Model 會在各種各樣的地方出現(xiàn),雖然 Diffusion LLM 還沒有跑出 Scaling Law,但我覺得它還是未來可期。

      安波:這個方向其實我們也沒有做太多工作,但我感覺可能并不是那么容易切換過去。如果真的非常厲害的話,大公司早就紛紛轉(zhuǎn)到那個賽道上去了。而且關(guān)于能不能取代 Transformer,我覺得可能性也不大。

      AI 科技評論:對于這一點,劉菲老師怎么看?

      劉菲:我們在 diffusion model上的探索也不是很多,但我比較認(rèn)同俊博剛剛的觀點。Diffusion model 在圖像生成,或者在多模態(tài)任務(wù)上,確實展現(xiàn)了比較突出的優(yōu)勢。

      我主要是做自然語言處理方向的,所以在這個領(lǐng)域,Autoregressive model 仍然是主流。原因在于,無論是文本數(shù)據(jù)還是一些時間序列數(shù)據(jù),本身都具有很強(qiáng)的序列特性,在這種情況下我們通常更傾向于使用 Autoregressive model。當(dāng)然它也有自己的問題,比如在推理(inference)階段,很難做到并行處理。針對這一問題,目前有幾個可以考慮的方向,一個是剛剛俊博提到的,將 diffusion model 和 Autoregressive model 結(jié)合起來。

      另一個方向是,即便我們現(xiàn)在談到 Autoregressive model 時,Transformer 確實非常成功,但近年來也有看到 recurrent neural networks(RNN)及其變種重新受到關(guān)注。這些變種在某些方面相較于 Transformer 是有一定優(yōu)勢的。

      AI 科技評論:所以說,接下來大家很可能會探索其他架構(gòu)?

      劉菲:對,是這樣的。

      趙昊:從我的角度來看,我覺得這個問題可以分成兩塊。一塊是 vision 本身要不要和 language 結(jié)合的問題。如果只做 vision,比如視頻或圖像生成的話,我們其實特別關(guān)注推理速度,所以未來一兩年內(nèi),純 vision 的任務(wù)應(yīng)該會慢慢轉(zhuǎn)向 AR(Auto-Regressive)思路,因為在速度上有明顯優(yōu)勢。但圈子里還是會有很多做多模態(tài)大模型的人,他們其實并不清楚該怎么和 language 更好地結(jié)合。比如多尺度的 token 如何映射到語言空間,目前誰也說不清楚。所以我覺得,未來的發(fā)展方向是需要把這兩塊問題區(qū)分開來看待。

      Agent 的機(jī)遇和挑戰(zhàn)

      AI 科技評論:最近大家對 Agent 也很關(guān)注,四位老師有什么想法嗎?

      趙昊:我自己做 Agent 的工作不是特別多,但最近找到了一個我認(rèn)為非常有趣的方向,就是把區(qū)塊鏈技術(shù)和 agent 通訊結(jié)合起來。我們目前正在機(jī)器人系統(tǒng)中,探索基于 Agent 信息交互方式,搭建一個可信的加密協(xié)同框架,我覺得這個領(lǐng)域非常值得深入。

      區(qū)塊鏈的特點是大家以分布式的方式共同計算,沒有任何一個節(jié)點能掌握全局信息,但每個節(jié)點都參與了鏈的運作。區(qū)塊鏈里有一個核心的數(shù)據(jù)結(jié)構(gòu)叫 Merkle-Tree,它的特點是每個葉子節(jié)點上的計算結(jié)果都可以被有效驗證,并最終在根節(jié)點完成整體計算,但葉子節(jié)點本身并不知道整體發(fā)生了什么。對應(yīng)到 agent 系統(tǒng)中,就是每個 agent 可以參與到協(xié)作中,通過通信協(xié)議去執(zhí)行任務(wù),并最終得出結(jié)果,但每個 agent 本身并不知道整體的任務(wù)全貌。在機(jī)器人領(lǐng)域,這種特性非常有用。

      安波:那最終你們想解決什么問題?優(yōu)化的目標(biāo)是什么?

      趙昊:想做的是一個系統(tǒng),讓 agent 可以協(xié)同完成任務(wù),而且系統(tǒng)具有很強(qiáng)的抗破壞性。

      AI 科技評論:很新穎的思路!劉菲老師您怎么看?

      劉菲:我覺得趙老師提到的將 agent 和區(qū)塊鏈結(jié)合的方向,確實非常新穎,非常值得深入挖掘。我這邊在 agent 方向上也有兩個代表性的工作。第一個是 HARBOR[1],這是一個 multi-agent system。我們設(shè)想未來,每個人都可以擁有一個專屬于自己的 personalized LLM agent,能夠深度理解你的興趣愛好,根據(jù)個性化需求,幫助你做出更合適的決策。

      在這樣的設(shè)定下,multi-agent system 既可能是合作關(guān)系,也可能是競爭關(guān)系。我舉個例子,比如大家在申請工作時,可能都會用到一些大語言模型或者 agent 幫助修改簡歷、優(yōu)化表達(dá)。如果只有一個職位,所有申請者之間就構(gòu)成了競爭。在這種場景下,我們很感興趣的問題是:在 multi-agent system 中,如何讓 agent 同時考慮個人偏好,并幫助用戶做出最具競爭力的決策。

      另一個工作是 PlanGenLLMs[2],一篇綜述性論文。我們對現(xiàn)有的 planning system 做了系統(tǒng)性的梳理和研究。因為現(xiàn)在各個 planning 系統(tǒng)在評測時缺乏統(tǒng)一標(biāo)準(zhǔn),數(shù)據(jù)集不同,定義的 agentic capabilities 也各不相同,所以我們希望能提出一個更統(tǒng)一的評估方法,對各種 Agentic system 進(jìn)行更科學(xué)的評估和比較。

      AI 科技評論:這種系統(tǒng)會去考察 agent 的哪些方向?

      劉菲:這是一個非常好的問題。我舉幾個例子,比如我們來到新加坡開會,希望讓 Agent 幫我做一個出行計劃,但它最終提供的方案可能并不是用戶真正喜歡的,所以這就是其中一個問題。還有一種情況是,比如我的預(yù)算有限,但可以接受稍微超出的方案,或者有一些截止日期,必須嚴(yán)格遵守的。這種情況下,Agent 系統(tǒng)需要在多目標(biāo)優(yōu)化環(huán)境中,深刻理解哪些目標(biāo)必須嚴(yán)格執(zhí)行,哪些目標(biāo)可以有一定的靈活性。這是我們評判 Agent 系統(tǒng)的一個重要方向。

      另一個方向是我個人比較感興趣的。因為未來很多 Agentic system 會分布到家居環(huán)境中,比如冰箱、手機(jī)等這類 edge devices,它們無法直接調(diào)用大模型,因為資源受限。所以未來的一個問題就是,如何在小模型上也能實現(xiàn)較強(qiáng)的 agentic capabilities。

      AI 科技評論:那可以理解為像冰箱、手機(jī)這種設(shè)備上,會有自己的端側(cè)小模型?

      劉菲:是的,可能在端側(cè)有一個小模型,處理一些本地任務(wù),同時后臺由大模型提供支持。一些請求可以直接在小模型上完成,另一些則發(fā)送到大模型上處理。

      AI 科技評論:安波老師,您認(rèn)為“小模型+Agent”是一個趨勢嗎?

      安波:我認(rèn)為是的。現(xiàn)在大模型的決策能力都還很弱,更不要說小模型了。總體來看,大語言模型在處理決策問題時,基本上是通過 imitation learning,即模仿已有數(shù)據(jù)。而這也解釋了為什么 inference 過程如此關(guān)鍵。我認(rèn)為未來無論是大模型還是小模型,要完成復(fù)雜決策任務(wù),都需要引入 RL(強(qiáng)化學(xué)習(xí)),因為 RL 能通過與環(huán)境的交互,不斷提升模型的能力。

      其實剛才兩位老師提到的方向,我也有研究。在做大語言模型之前,我一直在做 multi-agent system 的研究。在這個領(lǐng)域里,communication(通訊)是一種方式,但更關(guān)鍵的是如何實現(xiàn) dynamic 協(xié)作優(yōu)化,尤其是在機(jī)器人領(lǐng)域,每個 agent 如何在動態(tài)環(huán)境中高效協(xié)同,這是最困難的部分。而且劉菲老師提到的第一個方向,我認(rèn)為確實是剛需,只不過這里面還有很多算法上的挑戰(zhàn),比如如何快速找到最優(yōu)解。

      AI 科技評論:安波老師,您從什么時候開始做 multi-agent system 的?

      安波:我從上學(xué)期間就開始做了。稍微科普一下:這個領(lǐng)域起源于上世紀(jì) 80 年代,早期主要是軍方為了建傳感器網(wǎng)絡(luò)。因為當(dāng)時單個傳感器能力弱,比如確定一輛車的位置,需要三個傳感器協(xié)同定位。這就是最早的 sensor network。

      后來,機(jī)器人比賽中也需要分布式協(xié)作而非集中式控制,這種場景中,Agent 完全是合作的。之后,隨著互聯(lián)網(wǎng)興起,計算博弈論出現(xiàn)了;再后來,傳統(tǒng)的 distributed planning 難以擴(kuò)展,于是 distributed RL 被提出來了。到 deep learning 階段,這一切又被進(jìn)一步 deep 化。直到今天,隨著大語言模型的出現(xiàn),AI Agent 的概念再次被提出,但實際上,早期的 multi-agent system 已經(jīng)包含了很多基礎(chǔ)思想。

      AI 科技評論:那您怎么看 RL 和 Agent 的結(jié)合呢?

      安波:我認(rèn)為這是未來真正落地決策型大模型的關(guān)鍵環(huán)節(jié)。現(xiàn)階段我們還能通過充分挖掘大語言模型現(xiàn)有的能力,加一些工具鏈去完成任務(wù)。但如果要讓它真正運行在現(xiàn)實世界中,就必須要和環(huán)境有真實交互。我們現(xiàn)在也在做一些相關(guān)探索,比如在 token level 上做 exploration(探索),這是一個巨大的機(jī)會領(lǐng)域。所以,把 RL 和大語言模型結(jié)合起來,去解決復(fù)雜決策問題,是非常重要的方向。

      AI 科技評論:俊博老師最近有關(guān)注到一些相關(guān)的公司嗎?

      趙俊博:這種公司現(xiàn)在很多了,我覺得今年后面還會越來越多。比如前段時間 Manus,雖然功能上還有很多局限,但在交互體驗上確實讓人眼前一亮。

      趙昊:寫文獻(xiàn)綜述很好用。

      趙俊博:這個領(lǐng)域我覺得肯定是有泡沫的。我也很同意安波老師剛才的看法,大模型本身的決策能力還比較弱。但不管怎么說,大家都在努力往這個方向推進(jìn)。我相信今年 Agent 領(lǐng)域的版圖還會進(jìn)一步擴(kuò)大。

      AI 科技評論:安波老師,您最近有用過市面上的 Agent 產(chǎn)品嗎?

      安波:我用得不多,但有關(guān)注到一些,像 Manus 的評價我也看了很多。總體來說,它還是有不少值得學(xué)習(xí)的地方。

      AI 科技評論:您覺得通用 Agent 是未來可能實現(xiàn)的目標(biāo)嗎?

      安波:我認(rèn)為肯定是 AI 發(fā)展的方向。人類對 AI 的需求不只是聊天式交互,而是希望 AI 能幫我們完成特別復(fù)雜的任務(wù),這就是 Agent 的本質(zhì)。但這條路非常難。即便今天 AI 在某些數(shù)學(xué)領(lǐng)域已有突破,我覺得要實現(xiàn)真正的通用 Agent,十年時間也很難完成。

      AI 科技評論:劉菲老師,您目前的研究有沒有一些能實用化的 Agent 項目呢?

      劉菲:雖然我們正在做 Multi-agent system 和一些 planning 相關(guān)的算法開發(fā),但也注意到,盡管 agent 很火,真正能落地的項目其實并不多。

      這里面主要有兩個潛在問題。第一個是魯棒性問題。很多 agentic system 最后是以任務(wù)成功率作為評估標(biāo)準(zhǔn),但目前大部分系統(tǒng)的成功率遠(yuǎn)達(dá)不到 90%-95%,這會在落地應(yīng)用時帶來很多困難。

      第二個問題是安全性挑戰(zhàn)。比如,模型生成的內(nèi)容中可能包含幻覺信息,尤其是在代碼生成的場景下問題更突出。正常情況下,如果 agent 正確地生成代碼,是非常好的;但如果因為幻覺問題,生成了不存在的 library name,或者惡意用戶提前注冊了這些名字并植入了惡意代碼,那后果就很嚴(yán)重了。當(dāng)然,這只是當(dāng)前我們已知的一些問題,未來隨著應(yīng)用的深入,肯定還會遇到更多新的挑戰(zhàn)。所以,安全性問題必須高度重視。

      趙昊:我聽完劉菲老師講的,覺得以后如果每個人都有自己的 personal agent,大家為了搶票、搶資源,不就變成了 agent 之間的戰(zhàn)爭了嗎?如果以后要買一張機(jī)票,得付費買一個更厲害的 agent,感覺還挺可怕的。

      AI 科技評論:競價排名應(yīng)用到個人生活里了。

      趙昊:對,到那時候,要么自己處理所有復(fù)雜事務(wù),要么就得付錢用好一點的 agent。這種趨勢我覺得很快就會出現(xiàn)。

      AI 科技評論:如果從大模型智力提升的角度來看,大家能預(yù)測一下,未來有哪些技術(shù)可能幫助模型更聰明?下一個階段的研究趨勢會是什么?

      趙昊:我目前的研究方向是生成更可控的內(nèi)容,進(jìn)而訓(xùn)練出更聰明的機(jī)器人。這也是我認(rèn)為提升 AI 智力的重要方式。但目前機(jī)器人的問題在于,它們在物理世界的靈敏性還遠(yuǎn)遠(yuǎn)不夠。機(jī)器人領(lǐng)域不僅技術(shù)復(fù)雜,還涉及產(chǎn)業(yè)鏈,比如供應(yīng)鏈,所以發(fā)展速度不像純軟件那樣快。不過,隨著資金和關(guān)注度的增加,機(jī)器人技術(shù)肯定會越來越快進(jìn)步。

      AI 科技評論:那你覺得,什么樣的機(jī)器人才算是真正聰明的?

      趙昊:其實現(xiàn)在機(jī)器人借助大語言模型的能力,已經(jīng)挺聰明了。最大的問題不是智力,而是靈敏性。也就是說,當(dāng)前機(jī)器人的“小腦”還不夠發(fā)達(dá),不夠敏捷。

      AI 科技評論:劉菲老師,您覺得該如何進(jìn)一步提升大模型的智力?

      劉菲:我個人認(rèn)為,基礎(chǔ)模型(pretraining model)仍然是最核心的。最初一兩年里大家都在拼基礎(chǔ)模型,最近半年雖然評測報告少了,但基礎(chǔ)模型的重要性并沒有下降。如果有一個非常穩(wěn)健的基礎(chǔ)模型,在此基礎(chǔ)上進(jìn)行長上下文擴(kuò)展、強(qiáng)化學(xué)習(xí)(RL)微調(diào)、多模態(tài)能力擴(kuò)展等,都會變得更加順暢。而基礎(chǔ)模型質(zhì)量不好,后續(xù)的問題會層出不窮,不僅是幻覺問題。

      當(dāng)然,好的基礎(chǔ)模型并不一定非得超級大。其實大概 70B 參數(shù)的模型,就可以非常好用了。雖然更大的模型可能有額外優(yōu)勢,但“越大越好”并不總是成立的。所以,我認(rèn)為未來一個非常重要的方向,就是在適中的模型規(guī)模上,把預(yù)訓(xùn)練做到極致。

      第二個方向,是未來半年到一年內(nèi),關(guān)于模型安全性的研究,無論是評測體系還是技術(shù)本身,都會成為重點。

      最后,我也很期待大模型在交叉學(xué)科領(lǐng)域,比如 AI for Science、AI for Education、AI for Finance,能夠帶來真正突破性的進(jìn)展。

      AI 科技評論:安波老師,您覺得呢?

      安波:我這邊還是更關(guān)注決策相關(guān)的問題,無論是在 inference 階段,還是在 multi-agent 階段。我認(rèn)為這確實是一件非常難的事情。完成一個具體任務(wù)是一方面,但如果希望進(jìn)一步提升系統(tǒng)的魯棒性,特別是在應(yīng)用到一些此前數(shù)據(jù)未覆蓋到的場景時,基本上是非常困難的。整體來說,我們還有很長的路要走。

      劉菲:我非常同意安老師的觀點。未來與環(huán)境的真實交互,確實是 agentic system 中非常重要的一環(huán)。

      AI 科技評論:俊博老師,您的看法呢?

      趙俊博:我的觀點一半樂觀一半悲觀。樂觀的地方是,LLM 的 post-training 這一條路徑已經(jīng)逐漸被摸索清楚了,而且今年之內(nèi)依然有不少可以深挖的空間。比如說,數(shù)據(jù)目前還沒有被完全窮盡,還有很多新型的數(shù)據(jù)尚未真正鋪開應(yīng)用。同時,算法和基礎(chǔ)設(shè)施(Infra)方面也仍有比較大的提升空間。當(dāng)然,長文本問題涉及到的一些結(jié)構(gòu)體系改進(jìn),也是接下來的挑戰(zhàn)之一。不過整體來看,一切變化發(fā)展都很快,所以最終要到今年年底,我們才能真正看到會發(fā)生什么樣的新變化。

      AI 科技評論:好的,那我們就靜靜期待,今年年底還會有哪些新的突破出現(xiàn)。也非常感謝四位老師今天和我們分享了這么多寶貴的內(nèi)容,謝謝大家!

      參考文檔:

      1.https://arxiv.org/pdf/2502.12149

      2.https://arxiv.org/pdf/2502.11221

      雷峰網(wǎng)原創(chuàng)文章,未經(jīng)授權(quán)禁止轉(zhuǎn)載。詳情見轉(zhuǎn)載須知

      ICLR 2025:頂尖科學(xué)家最關(guān)心的 AI 趨勢有哪些?丨GAIR Live

      分享:
      相關(guān)文章
      最新文章
      請?zhí)顚懮暾埲速Y料
      姓名
      電話
      郵箱
      微信號
      作品鏈接
      個人簡介
      為了您的賬戶安全,請驗證郵箱
      您的郵箱還未驗證,完成可獲20積分喲!
      請驗證您的郵箱
      立即驗證
      完善賬號信息
      您的賬號已經(jīng)綁定,現(xiàn)在您可以設(shè)置密碼以方便用郵箱登錄
      立即設(shè)置 以后再說
      主站蜘蛛池模板: 我的好兄弟的女朋友| 银河奥特曼3| 禁忌家庭秘密手机在线观看| 地下偶像在线全集免费观看| 蜜桃熟了| 妈妈说带套可以给我| 体感预报日剧免费观看| 慈溪 门| 女超人1979版满天星| 电影邻居完整版| 完美搭配2韩版| 电视剧寻人启事| 谁能百里挑一20130504| 王牌杀姬免费观看完整版| 不良义姐真人版第一季在线看免费| 帕丁顿熊3电影国语版免费观看 | 黑暗圣经在线| 拐个皇子回现代| 波斯王子| 公媳在线观看| 爱我几何免费观看| 不老山异事| 她来自胡志明市电影| 洪真英电影完整版免费观看| 雪豹优酷| 弥勒县| 生死搭档电视剧| 王爷追妻忙:王妃要和离短剧全集| 《公的浮之手中字》免费在线观看 | 小东西我们几个都喂不饱你| 二人房间荷尔蒙爆发原声一集| 无间免费观看40集全集| 和部长一起出去差旅被欺负 | 你好李焕英免费观看天堂| 日本妈妈2在线电影免费观看| 总统的蛋糕| 漂亮的妈妈中字开头5个字| 兵临城下qvod| 电影赤壁| 她被搬运工侵犯免费观看| 小姑娘免费观看全集电影| 战狼6欧美版免费观看完整版国语在线 | 夜销魂2国语版高清在线播放| 木下檩檩子的电影全集| 铁锈味的雨滴泰剧在线观看| 朝鲜战争 王树增| 神奇女侠在线观看| 海绵宝宝全集| 两人互换麦子3| 乖巧的儿媳免费观看电视连续剧| 甜蜜惩罚全集免费观看| 夫妻俩一起按摩精油在线观看| 我在秋斩刑场当缝尸人那些 年| 万年县| 新白娘子传奇全集50全集| 八百彪兵奔北坡| 《双乳丰满的女学生》在线观看| 人体ys| 儿子的房间老妈跟外人睡好吗| 通天塔电视剧在线观看完整版免费| 《激战丛林》完整版免费| 《恋爱女子宿舍》| 刺青在线观看| 《女兵俘虏营》在线观看免费完整版| 亲爱的爸妈| 落魄贵族琉璃川免费观看全集动漫版| 最强和音| 日本电影追捕完整版| 三年大片高清电影免费观看| 杨思敏电视剧免费看| 妻子6免费的电视剧完整版_第6集| 花开如梦电视剧免费播放40集| 踏日酒店电影完整版在线观看| 深夜的蠕动未增删有翻译樱| 烟锁重楼主题曲| 九一神雕侠侣| 少女第19集在线观看免费| 郝板粟电影免费播放| 孤注电影完整版在线看| 情债电影在线观看| 囧妈高清在线观看| 法国空姐6大结局| 租一个女友回家过年| 情人电影完整版免费播放| 大牛荷尔蒙6免费全集观看 | 《刺激的瑜伽教练3》| 花木兰2动画片国语| 泰国银瓶梅| 高清黄泉的使者| 吴健版《农民伯伯2》电影免费观看http | 田中君总是如此慵懒| 黄石的孩子下载| 白峰免费全集在线观看| 我的不靠谱白马王子| 王府深宅:后宅我做主短剧全集| 扫毒免费观看完整版电影| 包青天开封奇案| 部长来做客HD中字| 《长相思》第二部| 高清《怦然与你》电视剧| 美国式保罗2 原版电影| 媳妇和少奶奶电视剧在线观看| 交换漂亮的女邻居3| overflower第一季动漫免费观看| 唐禹哲电视剧| 边缘行者免费观看全集高清| 1dldss00361当我打电话叫应召女郎时,我发现了一个高傲的大胸秘书......在办公 | 米林县| 电影善良的妻子| 浴血黑帮:不朽传奇全集观看| 女超人未删减版| 轧戏电视剧演员表| 白鹿原做爰未删减片段| 冢本监督昭和系列越南女子别动队在线观看完整版 | 韩国修理工的艳| 四大美人之西施高清完整版| 一眉道长国语高清| 楚辞招魂| 养个孩子不容易 电视剧| 女超人满天星版麦乐迪| 上海电视台直播| 我的老婆是学生会长第一季| 1995版《泰山和珍妮》| 乱世三义电视剧免费观看 | 正在播放: DRPT-048 春药曝露性爱 仓田真央带乳头导线与前女友相见 十年来同 | 龙之谷夏萝莉的照片| 《头脑特工队》2| 壮志凌云女版1994美国满天星| ♀女精油按摩大学生| 高清战旗如画未删减| 松阳县| 神印王座动漫免费完整版观看| 羊城暗哨电影完整版| 公立之浮之中字2023最新版| 兔子更喜欢哪种食物| 电视剧使命全集| 罗曼蒂克地下室骑马画面| 死亡笔记 日剧| 高清《黑狱断肠歌之砌生猪肉》| 《地铁蓝衣女》完整剧名叫什么来着| 我成了他的班主任| 水润女人刘志贤主演电视剧| 新奥特曼列传| 好久不见结局| 电视剧正者无敌全集| 天降之物动画| 女女女hd| 要爸爸播种美国电影在线观看免费| 戴口罩剧烈运动或引发猝死| 宫锁沉香结局| 黑人金希贞被黑人玩弄的视频| 李斌回应撞脸黑神话悟空金池长老| 《孤舟》免费观看| 妈妈屈身儿子同学,为救儿子,嫁给同学 | 韩式翘睫| 最强车模| 无颜之月完整版| 《法国空姐6大结局》在线观看| 民主之澜| 李茂换太子电影在线观看| 酒店1-100集全集| 维密天使内衣秀2015| 美乃雀电影手机看| 迈阿密风云电影| 漂亮妈妈7中字开头7个字| 四少妇的秘密按摩在线观看伦理电影 | 母亲的眼睛电影| 喜欢本大爷的竟然就你一个| 义姐不良妈ova观看渠道| 海天之恋剧情| 圣斗士星矢国语全集| 法国监狱法版1时56| 邻家女孩百度影音| 恋爱禁区动漫| 光明与黑暗| 星动烟火| 三位大学位按摩记的更新内容和角色| 大宋王朝| 贝雷帽钩织教程视频| 人妻秘书替夫还债HD| 一个完美的结局无删减网盘资源| 姐妹反目全集免费| 动感之星168妖精全集免费看| 金瓶艳谈| 超级鉴定师| 女员工的付出 中文| 无所畏惧40集免费看爱奇艺 | 台剧浪漫女家教1免费观看| 马本斋传奇| 电影《山雀儿》免费观看高清| 电视剧妻子免费观看| k动漫免费观看第二季| 咒术回战第一季中文版| 木下免费在线观看| 好儿子妈好爽快插我嫩草视频| 天下长河免费观看全集高清| 小巷人家电视剧免费版观看| 双女任务高清无删减| 雪豹优酷| 修理工的艳福在线观看| 罗曼史 快播| 斗破阴阳宅电影免费观看| 《我的私人游戏教练》| 狮子王原版英文版免费观看| 黄飞鸿6免费| 《Overflower》动漫第一季真人| 电视剧温柔的背后在线观看| 朋友的妈妈电影| 美姐妹牙医在线播放| 阳光灿烂的日子完整版观看| 武则天秘史快播| 学生的妈妈5字ID5中字| 绿野奇缘| 法国版《女超人:麦乐迪》完整版| 《出轨的女人2》| 安非他命高清完整版| 南京人身份证上为啥没省名 | 火影忍者剧场版失落之塔| 和部长一起去出差旅电影完整版| 警中警第一部| 加勒比女海盗完整版高清中文版| 林肯公园的numb| 大耳朵图图之小小欢乐魔法师| 援助交际扑灭运动| 给我免费观看片在线电影的| 健身瑜伽2国语中字版| 苦尽柑来遇见你 电视剧 | 拆弹专家2免费观看完整版| 苹果在线高清免费播放| 夏洛特烦恼完整版| 聊斋艳谈百度影音| 快乐再出发第一季综艺免费观看| 渔夫荒野淫记1988版电影在线观看| 头脑特工队2电影| 黑白配高清免费观看在线看| 全红婵首夺世锦赛单人金牌| 好看的女人克劳迪亚斯电影| 狐仙黄神婆女儿| 我国实行周末双休制还不足30年| 女长官的体罚1-43集介绍| 燃罪 电视剧| 千斤肉板栗免费观看| 男子地铁上扇女子脸质问爱谁| 亚当电影在线观看免费完整版| 电影《她被丈夫的老板欺负》| 街头霸王之春丽传| 赤坂丽的《牙医诊所》百度云| 奇怪的理发店在线播放| 嘴唇1981凯·帕克| 守望正义| 高清《诱人的女教师2》在线播放| 好想跟你在一起| 闪婚大佬后免费全集在线观看| 巜商务旅行戴绿色帽的演员表和角色 | 惊天绑架团 电影| 法医秦明之无声的证词电视剧免费| 鸡毛飞上天剧情| 17种幻想电影在线完整观看免费 | 韩国电影免费观看高清完整版在线 | 嫁给西北糙汉子的小说爱情| 《和部长一起去出差旅》遇到暴雨 | 我的岳父大人| 女律师替夫还债完整版| 有秘密的我们| 电视剧大唐游侠传| 名侦探柯南2024剧场版| 公公的之浮之2| 情侣之夜| 韩国小电影男子获得遥控器控制女领导 | 厨房激战在线观看| 我的鄂尔多斯| 日漫图书馆的女朋友动漫免费观看高清电视剧第五集 | 金刚归来1| 青梅竹马是消防员第一季未增删看| x的天使| 永乐大帝电视剧全集免费观看| 媚者无疆 电视剧| 美景之屋6:我的完美人生中字| 毒香在线观看| 南京大学辟谣周恒致女生怀孕| 高清盐沼之下未删减| 爱情有烟火全集免费观看| 《新生》更新| 荣誉守则(成人版)高清修复1080p,精彩 | 亲爱的她们| 反恐特战队全集免费观看| 50岁大胸继拇5 | 酒店实生3美国 | 法国《少女1979》完整版电影| 新金银悔5一10普通话| 李卫当官第二部| 恐龙战士| 我真是个弱女子短剧免费观看| 海洋之恋泰剧在线观看免费| 女销售的秘密2| 人民万岁电影| 失忆娇妻短剧全集| 飞轮海mv花絮| 专治各种不服| 美国禁忌1980| 聚会的目的地2完整有限中字| 正在播放: JUQ-345 我的无精症丈夫什幺都不知道。我恳求一位匿名男子进行性爱 | 我爱hk开心万岁国语| 庆余年手机在线观看| 免费观看甜蜜惩罚| 大乐透21039期开奖结果| 意大利私人女人监狱免费看| 苏炳添说对不起大家| 湟源县| 亲吻姐姐下载| 赌圣周星驰| 美景之屋6:我的完美人生中字| 辽粤大战徐杰怒吼张镇麟| 《年经继拇2》| 韩国电影姐姐的朋友1在线观看中文| 如果明天的路你不知该往哪走| 1905电影网免费观看完整版| 异形:夺命舰 电影| 《千金赤子板栗》完整版免费| 乌鸦小姐和蜥蜴先生| 电影《酥醇的绣感》| 高清《扫黑风暴》免费观看完整版| 海绵宝宝电影| 征途电影国语版免费观看| 搞笑一家人国语配音| 沙漠行动满天星| 李丽珍爱的 精灵| 《黏黏糊糊的你》第1集| 羚羊号历险记| 一起又看流星雨14| 终极宿舍2| 女子离职后把手机静音1年| 是妈妈是女儿2综艺| 高清《贝尔法斯特天堂路》电视剧| 奔跑吧兄弟第二季直播| 《理想之城》第二部| 虚颜电视剧一共多少集| 新金银悔1-5普通话| 登陆之日豆瓣| 白娘子传奇插曲| 凤凰军事观察室最新| 白峰电影全集免费观看国语| 野花高清1在线观看免费| 和田市| 美女如云片尾曲| 酒店第1-100集| 善良的姐姐在线播放| 小柔的性放荡羞辱日记动漫| 卖保险套的女销售在线观看| 解读西游记| 电影《千金小姐》免费观看| 终极一班3mp4下载| 舒淇早期作品| 想要爸爸播种子免费观看 | 战狼9免费高清999加拿大版在线观看| 五等分的花嫁在线观看| 护士交换粗吟配乱大交| 重影电视剧免费观看全集完整版| 《女销售员的销售秘密》签合同| 名侦探柯南剧场版20纯黑的恶梦| 女友的妈妈在线| 人猿泰山意大利1995时长1小时34分| 电视剧母亲的战争| 遵义县| 动画片巧虎| 霜花店免费观看完整版视频| 《社长夫人》天使萌演员表| 《神探狄仁杰2》电视剧| 《八尺夫人意大利满天星》在线观看| 触及真心| 高清《江山为聘》免费观看| 戒不掉的温柔| 都市妖孽战神林齐 小说| 私密按摩师电影在线观看中:字| 姐妹牙医在线电影播放| 蜡笔小新第九季| 游戏007| 雪豹坚强岁月免费观看| 美国1985小辣椒| 电影法国空姐1| 欢乐颂4免费观看| 法国空姐4号| 食人鱼事件剧情介绍| 奥伊米亚康村| 神探夏洛克第三季第二集| 满天星女版《壮志凌云》| 咱们结婚吧20集| 波多野结衣教师系列精品| 婷婷玖玖| a篇免费视频| 蜜桃成熟时3下载| 五号特工组1第一部免费观看| 妻子的姐妹免费版电视剧大全| 修理工艳遇韩| 暗红1936高清全集| 夏娃的丑闻| 台版1987渔夫荒野史记在线看| 韩国售楼小姐美景之屋| 刺客伍六七之暗影宿命在线观看| 宝莲灯后传| 八尺夫人满天星英语翻译版| 老k是谁| 漂浪青春插曲| 魔界之龙珠下载| 菜鸟老警 第八季全集观看| 《女销售员:》法国| 一年一度喜剧大赛第2季综艺 | 需要爸爸播种 中文播放| 年轻的保姆5线观高清多鱼| 玄女心经2免费观看全集| 初恋大作战| 天龙八部舒畅第几集| 新还珠格格剧照| 落魄贵族琉璃川动漫免费高清全集 | 伍六七第5季全集免费观看| 你是我的荣耀免费观看完整版西瓜| 电影《大突围》完整版| 蝴蝶与鲸鱼| 下属的妻子2020韩国女演员| 天使与龙的轮舞 在线观看| 木下凛凛子免费观看平台| 为新中国前进| 诱人的岳HD中文字幕| 神采飞扬完整版在线观看高清免费| 肥肉合集| 沙漠行动在线观看满天星| 色女仆网站| 巴不得妈妈粤语| 1992米利亚姆莱昂| 宇宙战舰大和号复活| 折腰电视剧在线观看全集| 高清《囚禁时间》电影免费观看全集| 乡村兵法| 我妻子的妈妈双字ID免费| 《灭火宝贝》美国中文| 还好 璀璨人生| 维修工的艳遇韩国电影在线看| 欣德·拉贾布之声| 铡美案免费| 韩国电影《修理工的艳遇》中文字幕 | 演员李桓| 爱回家433| 法国电影法国空姐4| 连诗雅三级| 李幼斌《守望者》免费播放| 鲜花朵朵全集下载| 卷卷初恋未删减| 牙医姐妹1986日语版免费| 牧神记第62集完整版| 麦乐迪《家庭矛盾》4在线免费观看| 高清《红字》| 异星灾变第二季| 烟雨蒙蒙电影| 金牌得主 第二季| 傻儿传奇电视剧全集| 需要爸爸播种籽2演员名字 | 按摩院| 摇滚狂花电视剧免费观看| 高清强制窃贼未删减| 识骨寻踪第十一季| 黑白潜行| 欧式少女第16集最新消息| 孤男寡女粤语| 东陵大盗电影全集| 韩国小电影男子获得遥控器控制女领导| 河北杂技频道直播| 《汤唯》电影免费观看高清| 【JUL-975(中字)老公不在家5日间 身心被性豪公公彻底调教 水川堇#鬼父】https | 君心藏不住电视剧| 金银梅5普通话国语版| 情色电影网| 特种兵之火凤凰全集下载| 美容院:待遇服务5hd| 贾青神枪| 神奇海盗团qvod| 《蛇王波后》完整版| 名门绅士之珍爱妙方| 黄冈市| 鬼怪13| 黑社会之龙城岁月| 50岁阿姨大人免费观看电视剧全集 | 鬼子暴行少女电影vcd| 千山暮雪在线观看| 西游降魔篇粤语| 妇科诊室2满天星| 底牌电视剧| 感官之旅| 爱丫爱丫电视剧免费高清 | 总裁夫人来自农村短剧免费观看| 我的游泳女教练 云播| 昆瑙 内亚| 侯门深宅短剧全集| 电影《官人我要》免费观看国语| 黑草莓帝国| 横山县| 咱家爷们儿电视剧在线观看| 名侦探柯南第14个目标| 欢迎来到实力至上主义的教室| 法证先锋6粤语版免费完整版高清| 战旗如画电视剧| 《落魄贵族琉璃川》免费动漫| 风犬少年的天空百度云| 王蓉蓉龙凤呈祥| 班主任的两个大山峰该用| 艾玛 德考尼斯| 《和部长出差的日子》| 美景之屋5未增减板| 电影捉迷藏| 张蕙兰瑜伽冥想| 满天星《V家酒店第一季》在线播放| 使徒行者2在线播放| 狂野时速| 日韩理论电影生活中的马丽亚在线观看| 上海滩主题曲简谱| 王杰演唱会高清| 金银悔5一1| 武警特警电视剧| 笨蛋测试召唤兽2| 咱俩结婚吧电视剧| 女员工的滋味2中文| 国产人与禽ZoZ0性伦多活几年| 年年柿柿红电视剧| 极度兽性下载| 我爱你比你爱我多| 私人家教韩国| 可以的话| 插曲的痛免费高清完整版 | 黑人骚妹妹在线观看| 曝江西一河中现碎尸| 鸡泽县| 匿杀未删减| 花咒电影完整版| 1995版泰山1小时34分观看国外版| 好想做一次电视剧完整版| 八百壮士在线观看| 工地上的女人免费观看电视剧| 金瓶梅完整视频观看视频| 小楼又东风| Overflower在线观看第一季| 韩剧国语版面包大王| 播求训练| 食人晚宴| 速度与激情7 在线观看| 禁忌2年转一代禁忌| 烧酒舞歌词| 核弹危机| 电影《生活中的玛丽》免费播放| 叛逆者免费观看完整版| 《禁忌》1无删减| 《给十九岁的我》获金像奖最佳电影| 法证先锋4国语版免费下载| 生活中的马丽亚无删减在线观看免费| 石纪元 第四季 Part 3| 暴劫倾情电影| 美丽的梦想电影| 缺宅男女国语| omoflow第一季全集在线播放| 小炸jackson| 逃学神探在线观看免费完整| 欧美ZZZ| 兔子先生7季在线观看免费高清 | 使徒行者优酷| 南剑北鞭铁扇子| 想要爸爸播种子在线观看| 千年情人| 绣球小苗| 风流女管家最新电视剧全集| 狂飙风云短剧免费观看| 甜美的咬痕动漫全集在线观看| 《隐身帽子》| 女烈受刑| 狱中龙无删减完整版| 《埃及皇后》2003桑德拉拉索| 你比星光更美丽免费观看全集| 狙击生命线| 电影聊斋叶子楣| 夜夜电影| 当阳市| 《你在等什么》西班牙电影| 棋士在线观看| 金瓶梅电视剧全集电视剧在线观看免费 | 上海风云1| 农民伯伯吴健国语版免费观看百度云| 间谍过家家第2季| 不忠在线观看免费全集电视剧高清| 牢笼中的妖精| 《漂亮男孩》动漫在线观看全集| 男男少年乖H调教跪趴SM主| 苹果范冰冰无删减| 销售的销售秘密3HD中字国| 唐探1900在线观看| 僵尸启示录没删掉版在线观看| 亮剑的主题曲| 火星哥treasure| 顶尖飞行员2021完整版满天星 | 韩国情事2014| 叱咤乐坛| 可疑的美容院韩剧| 119号纳粹女子集中营电影| 百变狸猫| 大秦赋全集| 偷偷藏不住40集完整版| HD版《激战丛林》完整版 | 尖峰时刻3国语高清| 无双谱国语| 法国空姐4成人版| 如懿传在哪里看| 欢笑老弄堂| 《空中决战》电影| 家属1-6集全集免费| 美国禁忌结局-7| 布拉格之恋下载| 金银悔1-10集在线播放| 包子先生| 赤祼狂奔| 酒店1-100集全免费播放| 昨日的果实| 神医安道全| 禁忌5未删减版| 冬之蝉动漫免费全集观看| 沉香如屑60集全免费看| 足球小将初中篇| yellow免费视频| 李恩美修电工的全部电影| 朝鲜世界杯| 大叔的爱泰剧一共多少集| 凤姐qq| 人猿泰山意大利1995时长1小时34分| 婆婆的味道大结局| 电视剧一生为奴| 49ai| 正在播放: CJOD-348 乳头冰巨乳零食妈妈厚直到早上无与伦比的客户服务中出事 | 杨光的快乐生活第三部| 团鬼六女教师绳地狱| 保罗1—3| 广场舞最美西藏| 花花公主| 我的性感小阿姨| 《法国空姐6大结局》在线观看| 雪平利左电影免费播放西瓜视频 | 重启电视剧| 法国女版《壮志凌云》第三集| 南北少林电影| 跑出一片天下载| 女大学沙龙| 夏目彩春猛烈肉体破坏版| 小凤新婚下集免费观看视频播放大全 | 夫妇互换之木下凛凛子| 惊变28周快播| 电影铁原阻击战在线观看| 电视剧大清风云| 战狼6免费观看高清下载| 美容院:待遇服务5hd| 小神八不可怕电视剧| 庆余年第二季全集免费观看| 一剪梅歌曲| 美国《行政助理》2014| 白峰601电影免费观看| 奔跑吧兄弟第一期| 大工匠2| 电影《异常》完整版观看免费| 电影《牙医姊妹》在线观看免费 | 欢天喜地七仙女2| 守护者联盟| 最好的遇见电视剧| 美式保罗和雪莉一家5| 水浒后传电视剧免费观看| 俄语电影| 土豆粉培训| 冬至电视剧黄景瑜孙千免费观看| 《束缚游戏》在线观看第一季 | 法国兄妹开荒原版免费看| 赶尸谭艳| 香醇绣感1996版的主要人物| 星际穿越电影完整版| 高清《诱人的女教师2》在线播放| 斗罗大陆135集| 红罂粟第二部| 伍六七大电影| 《好好的时代》免费观看高清| 尖峰电视剧全集在线观看| 快乐方程式 level c| 贝金赛尔满天星| 天雷一部之春花秋月 电视剧| 日历女郎 韩国| 送上司回家,看到上司老婆| 飞驰人生2在线观看免费完整版| 爱我几何电影在线观看免费 | 神雕侠侣刘亦菲| 星克莱尔(啄木鸟)第一夫人| 《四大美人之貂蝉》| 少年派2正版全集免费观看| 凯登·克罗斯《唤醒》| 韩版 花样男子| 高清《天气之子》电影免费看| 豫剧吹牛| 给岳肚子播种怀孕| 秘密花园韩剧免费全集| 金鸡sss国语| 女子私人监狱美国版电影免费观看全 | 冬日的什么呀,春日的什么呢电视剧 | 和讨厌的部长一起去出差旅电影在线观看| 女生黏糊糊的水哄睡| 电影《心动》| 加勒比女海盗在线观看| 星辰变第四季| 吞噬星空动漫在线观看39集| 大兵的寝室| 吸血鬼的拥抱| 一路向西国语百度影音| 想明白了再结婚 电视剧| 忍不住的继拇中字3 | 枭起青壤免费观看| 《新金银悔1—5普通话》第21集 | 白宝山全集| 《高压监狱2》免费观看| 扫黑风暴高清完整版免费观看| 隋唐演义全集在线观看| 《维修工的艳遇》金美贤| 夕阳红简谱| 就爱小姐姐| 黑白配国语在线播放观看| 中国帅男同志1069播放| 大工匠2| 龙虎山张天师电影免费观看| 做aj的电视剧在线观看| 许我荣耀电视剧更新| 超级喜欢你| 《公的浮之手中字》免费在线观看| 一招辨别是否怀孕| 人面兽心在线播放| 1—5集普通话版免费播放下载| 少年包青天第二部| 党同伐异免费| 玛雅最新地址| 理发店里的特殊待遇4在线观看| 蒙面超人rx粤语| 探险旅行| XL司令第一季免费全集在线观看| 于小慧电视剧| 《姐妹新娘》全集观看| 《战狼6》免费观看完整版高清| 《陷阱》未删减版在线观看 | 高清《解语花》曹宝儿| 欧美裸体电影| 试驾问界m9| 极品家丁5200| 粉红女郎电视剧免费高清| 草莓之夜电影版在线观看| 大兵的寝室第一季在线观看| 侏罗纪公园4电影免费完整版观看| 新蜀山剑侠传| 金银梅美国| 喀秋莎行动电影完整版免费观看| 台中市| 妽妽洗澡我被弄硬了在线观看 | 西瓜视频免费| 战狼9免费高清999加拿大版在线观看| 我们在黑夜中相拥电视剧免费观看| 老电影歌曲| 我的野蛮女友全集| 女泳永教练的欲望| 扫黑风暴21集在线观看| 被闺蜜捆绑震蛋折磨调教 | 舍我其谁电视剧| 韩国野花精油按摩师视频| 请做我的奴隶| 折腰电视剧全集| 金银梅1-5普通话免费观看完整版 82板杨敏思版本1-5电视剧在线观看 | 死神264| 扫黄先锋国语| 肥猫流浪记| 北原多香子无打码在线观看| 太谷县| 伦理影片岳母厨房在线观看| 锦衣卫:女扮男装当缇骑短剧全集| 新乌龙女校3| 韩国电影和部长一起出差旅日本电影叫什么 | 部长出差日子电影免费观看| 东条夏电影在线观看免费版韩剧| 急诊护士在线免费观看| 肉丝跑蛋| 朋友的姐姐2016| 欢乐颂二| 《法国空乘10| 夫妻成长记| 穿靴子的猫1免费观看完整版 | 撒贝宁原名叫啥| 僵尸伯伯国语版在线播放| 日本电影《特殊游泳课》的编剧是谁| snis-986| 缉毒警察绝不会输动漫免费观看| 电影《播种女儿》完整版视频在| 我的危险妻子| 朋友的姐姐播放| 天海翼护士在线| 警察锅哥第一季免费全集| 无颜之月1到5免费动漫| 情圣终结者下载| 法国版女超人麦乐迪哪里看| 心灵诡计| 会员制餐厅完整版免费高清 | 法国电影私人航空免费观看| 全肉野战高h| 不死者之王在线观看| 电视剧一起来看流星雨| 禁忌1| 迷航昆仑墟| 苹果在线观看| 高清《机械师1》高清完整版| 吴健版农民伯伯国语版在线看| 斗罗大陆免费完整观看170集| 危情在线播放| 旅游| 法国《监狱伦理3》| 亲爱的这并不是爱情| 兽魂觉醒动漫免费观看高清| 通江县| 维修工的艳遇理论片免费看| 逆流而上的你全集免费观看| 终极追捕电视剧全集免费观看| 洞头县| 女篮坎贝奇无憾 在线观看 | 电视剧武则天免费观看全集| 艾曼纽2| 女员工的付出中文字| 联姻对象是肉食系警官| 七夜雪 电视剧| 李玟墓地杂草已被清除 | 贞观之治所有演员表| 黑匣子情况公布| 午夜的太阳| 黑白配国语在线播放| 悬赏粤语版| 金毛动漫库| 镇雄县| 《别有用心的妻子》| 正者无敌全集下载| 太古神王在线观看| 头文字d电影粤语| 2008徐少强在线观看完整版| 咒怨1 日版| 高清《鬼父上卷》1| 美国爸爸要播种2季免费观看| 绝强驱魔师花子| 她俩和他俩| 陷入热恋的我们在线观看| 电视剧叛逆者在线观看| 多人轮换电影| 郭洋子个人资料| 封神英雄80|