成年女人免费碰碰视频-国产精品一区二区熟女不卡-激情视频一区二区三区-毛片黄色片在线观看-碰超免费人妻中文字幕-少妇与黑人一二三区无码

首頁 > 生活分享 > 免費教學 > 多模態對齊在小紅書推薦的研究及應用

多模態對齊在小紅書推薦的研究及應用

發布時間:2024-09-24 16:52:42

在 CIKM 2024 上,小紅書中臺算法團隊提出了一種創新的聯合訓練框架 AlignRec,用于對齊多模態表征學習模型和個性化推薦模型。本文指出,由于多模態模型與推薦模型在訓練過程中存在步調不一致問題,導致聯合訓練被推薦信號主導,從而丟失大量多模態信息。AlignRec 通過分階段對齊的方式,設計了三種針對性的優化損失函數,使得聯合訓練能夠同時兼顧多模態信息和推薦信息。實驗結果表明,AlignRec 在多個數據集上的性能超過了現有的 SOTA(state-of-the-art)模型。此外,AlignRec 還提供了在當前廣泛使用的公開數據集亞馬遜上的預處理特征,這些特征的效果顯著優于現有的開源特征。


最近多模態是個非常熱門的話題,尤其是在大模型以及 AIGC 領域,多模態基建和技術是走向未來商業化的奠基石。在過去的多模態大模型研究方向上,模態的“對齊”已經被驗證非常重要,分布的不一致損害不同模態的理解,我們此次要討論的核心問題是多模態在推薦中的對齊問題;

 

在具體介紹論文工作之前,我們先來介紹下我們過去在推薦和電商中的實踐工作:

 

推薦實踐


上述方法是我們對 BM3論文進行改進 上線的方案,該方案實際上做的是通過損失函數來實現“對齊”工作。我們的對模型的期望也是保留個性化的同時,能夠對齊行為和多模態的空間,進一步增加長尾的個性化分發能力。先說效果:

 

該模型實驗在推薦發現頁取得時長、曝光、點擊等核心指標收益,除此之外,在長尾分發上,0 粉作者筆記點擊和曝光獲得大幅增長,整個召回路增加了全局可分發筆記數 6%,分發筆記集中在 1k-5k 的筆記曝光集合;同時,我們的方法也被復用在了電商場景,分發長尾同時,獲得 DGMV 等核心指標收益。

 

很顯然,從上述可以看出,“對齊”的效果立竿見影,在業界應用上我們已經取得實質性進展,但本質上這樣的設計方案依然并沒有完全解決多模態推薦問題,因為我們的多模態模型和推薦模型是相對割裂的,等同于直接拿表征來使用,這樣的設計打通了應用范式,卻無法判斷多模態模型本身能力對效果的上限,對于選擇合適多模態表征存在一定的難度。但如果我們引入文本/圖等 Encoder(Transformer)等進行聯合訓練,會引入如下的問題:

 

在大規模的數據下,分布式訓練引入圖文 Encoder 會造成資源和性能問題,尤其是注重高時效性的 Streaming Data;
訓練步調不一致,往往多模態模型需要大量數據甚至多個 Epoch 才能收斂,但推薦模型通常采取單輪訓練,這也導致多模態模型訓練不充分;

所以我們設計聯合訓練模型,通過設計分階段對齊的方式和中間指標評估,解決上述聯合訓練問題,并且引入了三種針對性的優化損失函數,使得聯合訓練能夠同時兼顧多模態信息和推薦信息,解決聯合訓練中的“對齊”問題,提升效果上限。

 

下面我們從相關工作,核心挑戰,模型設計介紹整體工作。

 

我們在這里通過 (a), (b), (c) 描述了在過往的學術界目前多模態推薦方向的相關工作,總結主要的發展路徑:

圖(a),直接利用,比如把 embedding,多模態特征作為信號輸入網絡;
圖(b),利用圖等方式聚合,希望能得到更豐富的多模態信息表達,這本質上也是增加多模態側信息的召回率;
圖(c),聯合優化,把模態損失和行為損失共同優化,但這忽略了本身筆記側的多模態學習。
在工業界,現階段推薦系統主要還是依賴于 ID 特征的學習, 大多數多模態推薦把多模態信息作為 sideinfo 去輔助 ID 特征的學習。但是, 多模態之間以及 ID 模型與多模態之間都存在著語義鴻溝, 直接使用甚至可能適得其反。

 

核心挑戰

為了貼合業界實際,設計一款有效的多模態與推薦聯合訓練模型會遇到如下的挑戰:

 

挑戰1: 如何對齊多模態表征。包括內容模態之間(如圖文)的對齊,以及內容模態與 ID 模態之間的對齊;
挑戰2: 如何平衡好內容模態和 ID 模態之間的學習速度問題。內容模態可能需要超大規模的數據和時間去訓練, 而 ID 模態的學習更新可能只需要幾個 epoch。
挑戰3: 如何評估多模態特征對推薦系統的影響。引入不合適的多模態信息可能需要更多的精力去做糾正, 甚至可能影響推薦系統的性能。

我們所提出的方法命名為 AlignRec,整體框架如下圖所示, 主要包含3個模塊: Multimodal Encoder Module, Aggregation Module, 以及 Fusion Module, 下面分別進行介紹。


Multimodal Encoder Module

 

免費教學更多>>

3000萬輛不敵900萬輛!中國汽車深陷“利潤黑洞” “方盒子”SUV市場要熱鬧了!四款新車來襲 奇瑞風云X3L配增程動力 福特烈馬推出新能源車型,方程豹、坦克應該感到恐懼嗎? 7月底上市/雙動力組合 比亞迪海獅06內飾官圖發布 紅旗以技術自強與用戶共情,領跑新能源時代的長紅之路! 今年才買的華為ADS 3.3新車,一下就被ADS 4淘汰了? 2.0T+8AT的瑪莎拉蒂格雷嘉SUV落地40萬+ 車主現身說法,五菱星光2025款純電車值不值得買? 外觀大氣定位務實,捷達VS8即將推出 “新威馬”卷土重來?吉利與極氪合并!新能源下半場誰的機會大? 極氪回歸,“一個吉利”的威力 國內專供?奧迪Q6諜照來襲 寶馬牽手Momenta、奔馳CLA秋季上市,BBA智駕競賽加劇 年薪2億!比肩C羅的華人AI大神究竟是誰? 酒旅三國殺,已不止于即時零售行業本身,它已蔓延到了范圍更廣的本地生活服務領域 百度蘿卜快跑與Uber達成戰略合作,全球部署數千輛無人駕駛汽車 基于Chromium,消息稱OpenAI的AI瀏覽器內部代號為“Aura” 聽勸、慎言、慢功夫:嵐圖的“央企反射弧”,成就了FREE+的爆款護城河 全球首款超混旅行車!海豹06DM-i旅行版亮相石家莊 奔馳全新CLA長軸版碰撞測試!“低調測試”才真理 1200天:騰勢如何從“跟隨者”演進到“逆襲者” 理想i8內飾沒大改?但電耗不錯配置還以下犯上! 20多萬的樂道L90,要做純電時代的漢蘭達 年中盤點:吉利上半年總銷量193萬臺,臺州宣言見成效? 年中盤點:吉利上半年總銷量193萬臺,臺州宣言見成效? 瑪莎拉蒂價格暴雷!專家:明后年是超豪華“最低點” 擁抱華為、補課智能化 嵐圖高管:嵐圖FREE+非常有信心挑戰月銷目標2萬+ 破產2年后,威馬擬8月復產:今年銷售1萬輛,后年開啟IPO 銷量回暖、產品推新,“一口價”常態化,合資品牌又行了? 7月14日,蔚來汽車港股市場表現非常亮眼,再次暴漲10.6%。
主站蜘蛛池模板: 精品国产自线午夜福利| 免费无码又爽又刺激高潮虎虎视频| 亚洲第一无码专区天堂| 天天躁日日躁狠狠躁| 一级特色黄大片| 极品嫩模高潮叫床| 中文在线а天堂中文在线新版| 男人和女人做爽爽免费视频| 国产精品自在在线午夜出白浆| 国产最新进精品视频| 欧美成人一区二免费视频| 开心五月色婷婷综合开心网| 国产+成+人+亚洲欧洲自线| 国产精久久一区二区三区| 国产精品一区二区三级| h动漫无遮挡成本人h视频| 大胸少妇午夜三级| 亚洲乱亚洲乱少妇无码| 亚洲高清乱码午夜电影网| 伊伊人成亚洲综合人网香| 色翁荡熄又大又硬又粗又视频| 久久不见久久见免费视频7| 亚洲毛片无码专区亚洲乱| 免费无码不卡视频在线观看| 草草影院精品一区二区三区 | 日日碰狠狠躁久久躁婷婷| 无码尹人久久相蕉无码| 少妇与黑人一二三区无码| 精品麻豆剧传媒av国产| 精品水蜜桃久久久久久久| 一区二区三区无码被窝影院| 精品国模一区二区三区| 久久综合九色综合97欧美| 欧美巨大性爽欧美精品| 久久欧美与黑人双交男男| 亚洲国产一区二区波多野结衣| 亚洲日韩一页精品发布| 综合自拍亚洲综合图区高清| 天天干天天日夜夜操| 久久这里只有热精品18| 国产zzjjzzjj视频全免费|