a级毛毛片_亚洲99_魔兽1~6集在线观看_黑白配在线观看_天天操日日操_四虎免费网站

首頁 > 知識分享 > 知識分享 > 多模態對齊在小紅書推薦的研究及應用

多模態對齊在小紅書推薦的研究及應用

發布時間:2024-09-24 16:52:42

在 CIKM 2024 上,小紅書中臺算法團隊提出了一種創新的聯合訓練框架 AlignRec,用于對齊多模態表征學習模型和個性化推薦模型。本文指出,由于多模態模型與推薦模型在訓練過程中存在步調不一致問題,導致聯合訓練被推薦信號主導,從而丟失大量多模態信息。AlignRec 通過分階段對齊的方式,設計了三種針對性的優化損失函數,使得聯合訓練能夠同時兼顧多模態信息和推薦信息。實驗結果表明,AlignRec 在多個數據集上的性能超過了現有的 SOTA(state-of-the-art)模型。此外,AlignRec 還提供了在當前廣泛使用的公開數據集亞馬遜上的預處理特征,這些特征的效果顯著優于現有的開源特征。


最近多模態是個非常熱門的話題,尤其是在大模型以及 AIGC 領域,多模態基建和技術是走向未來商業化的奠基石。在過去的多模態大模型研究方向上,模態的“對齊”已經被驗證非常重要,分布的不一致損害不同模態的理解,我們此次要討論的核心問題是多模態在推薦中的對齊問題;

 

在具體介紹論文工作之前,我們先來介紹下我們過去在推薦和電商中的實踐工作:

 

推薦實踐


上述方法是我們對 BM3論文進行改進 上線的方案,該方案實際上做的是通過損失函數來實現“對齊”工作。我們的對模型的期望也是保留個性化的同時,能夠對齊行為和多模態的空間,進一步增加長尾的個性化分發能力。先說效果:

 

該模型實驗在推薦發現頁取得時長、曝光、點擊等核心指標收益,除此之外,在長尾分發上,0 粉作者筆記點擊和曝光獲得大幅增長,整個召回路增加了全局可分發筆記數 6%,分發筆記集中在 1k-5k 的筆記曝光集合;同時,我們的方法也被復用在了電商場景,分發長尾同時,獲得 DGMV 等核心指標收益。

 

很顯然,從上述可以看出,“對齊”的效果立竿見影,在業界應用上我們已經取得實質性進展,但本質上這樣的設計方案依然并沒有完全解決多模態推薦問題,因為我們的多模態模型和推薦模型是相對割裂的,等同于直接拿表征來使用,這樣的設計打通了應用范式,卻無法判斷多模態模型本身能力對效果的上限,對于選擇合適多模態表征存在一定的難度。但如果我們引入文本/圖等 Encoder(Transformer)等進行聯合訓練,會引入如下的問題:

 

在大規模的數據下,分布式訓練引入圖文 Encoder 會造成資源和性能問題,尤其是注重高時效性的 Streaming Data;
訓練步調不一致,往往多模態模型需要大量數據甚至多個 Epoch 才能收斂,但推薦模型通常采取單輪訓練,這也導致多模態模型訓練不充分;

所以我們設計聯合訓練模型,通過設計分階段對齊的方式和中間指標評估,解決上述聯合訓練問題,并且引入了三種針對性的優化損失函數,使得聯合訓練能夠同時兼顧多模態信息和推薦信息,解決聯合訓練中的“對齊”問題,提升效果上限。

 

下面我們從相關工作,核心挑戰,模型設計介紹整體工作。

 

我們在這里通過 (a), (b), (c) 描述了在過往的學術界目前多模態推薦方向的相關工作,總結主要的發展路徑:

圖(a),直接利用,比如把 embedding,多模態特征作為信號輸入網絡;
圖(b),利用圖等方式聚合,希望能得到更豐富的多模態信息表達,這本質上也是增加多模態側信息的召回率;
圖(c),聯合優化,把模態損失和行為損失共同優化,但這忽略了本身筆記側的多模態學習。
在工業界,現階段推薦系統主要還是依賴于 ID 特征的學習, 大多數多模態推薦把多模態信息作為 sideinfo 去輔助 ID 特征的學習。但是, 多模態之間以及 ID 模型與多模態之間都存在著語義鴻溝, 直接使用甚至可能適得其反。

 

核心挑戰

為了貼合業界實際,設計一款有效的多模態與推薦聯合訓練模型會遇到如下的挑戰:

 

挑戰1: 如何對齊多模態表征。包括內容模態之間(如圖文)的對齊,以及內容模態與 ID 模態之間的對齊;
挑戰2: 如何平衡好內容模態和 ID 模態之間的學習速度問題。內容模態可能需要超大規模的數據和時間去訓練, 而 ID 模態的學習更新可能只需要幾個 epoch。
挑戰3: 如何評估多模態特征對推薦系統的影響。引入不合適的多模態信息可能需要更多的精力去做糾正, 甚至可能影響推薦系統的性能。

我們所提出的方法命名為 AlignRec,整體框架如下圖所示, 主要包含3個模塊: Multimodal Encoder Module, Aggregation Module, 以及 Fusion Module, 下面分別進行介紹。


Multimodal Encoder Module

 

知識分享更多>>

全新Q5L上市、全新A6L首秀!越過千萬輛之巔的奧迪,再度啟航 現代帕里斯帝獲得北美年度汽車! 一份年度成績單,再證CR-V“全維度”哲學 上汽大眾首款9系旗艦ID. ERA 9X亮相:一款車,一場轉型的宣言 極狐喬心昱:北汽新能源自動駕駛技術全覆蓋 L3級至L4級全貫通 50萬內實用標桿?廣汽本田新款飛度正式上市 煥新價6.68萬元 央視鏡頭直擊-21℃極寒戰場!東風睿立達完成中汽冬測,破解物流凍阻難題 本田汽車近日官宣品牌標識煥新計劃,沿用多年的經典\"H\"標將升級為全新設計版本,新標識定于2027年正式啟用 星動紀元與順豐科技簽約,推動具身智能機器人在供應鏈落地 德系豪華三強,連續兩年失守中國市場 萬能的《甄嬛傳》,在迅雷反腐這兒就失靈了? 沃爾沃EX60純電SUV將搭載谷歌Gemini AI,配大尺寸豎屏 聯發科發布天璣9500s:3nm工藝,支持硬件級光線追蹤技術 消息稱鴻蒙智行1月20日前后分批推送華為乾崑智駕ADS 4.1 美運營商Verizon服務中斷十小時:波及數十萬人,官方承諾補償 金融時報:蘋果避開AI燒錢大戰,卻成為谷歌與OpenAI的“造王者” 李小龍透露華為手表市場份額超手機,國內超30%使用非華為手機 賈國龍確認:西貝將關閉102家門店 “酸菜魚之王”賣不動了? 太二親手拆招牌,轉戰川菜賽道 日本霸占20年的汽車銷量第一寶座,2026年被中國掀翻了? 為何中國茶業跑不出一個「茅臺」? 房企聚焦核心城市“掐尖”,北上杭三城2025年土地出讓收入均超千億元 順豐同城元旦同城配送單量同比增55%,攜手敦煌美術研究所神馬IP共啟新年 AMD預告MI500處理器,性能提升千倍!還首秀了商用人形機器人 京東數字人上線“直播間復刻”功能 阿里Qoder升級補全功能,AI代碼采納率提升65% 3.2億元新訂單!佑駕創新智能座艙方案獲全球知名車企定點 FF任命企業家及私募股權投資人Shahryar Oveissi擔任戰略顧問 特斯拉將考慮自建芯片工廠;馬斯克萬億美元薪酬方案獲批;日產汽車上季度營業利潤轉正 馬斯克:特斯拉擬自建芯片工廠,并考慮與英特爾合作
主站蜘蛛池模板: 日韩一区二区中文字幕 | 亚洲911精品成人18网站 | 免费a级片在线观看 | 91在线无精精品一区二区 | 最新的黄色网址 | 中文字幕影院 | 中文字幕观看在线 | 国模吧一区二区三区 | 国产精品久久久亚洲 | 亚洲黄色激情 | 六月婷婷中文字幕 | 中文字幕在线免费 | 97av免费视频 | 校园春色第一页 | 肢体的诱惑在线观看 | 欧美精品在线一区二区三区 | japanese在线视频 | 日韩欧美视频免费观看 | 欧美极品一区二区三区 | 久久久www成人免费毛片 | 婷婷激情丁香 | 欧美裸体xxxx极品少妇 | 中文成人在线 | 超碰在线观看免费 | 欧美日韩中文视频 | 日本精品一区二区 | 酒色成人网 | xxx日本在线观看 | 国产激情视频 | 香蕉网在线观看 | 亚拍一区| www.精品一区 | 五月天综合激情网 | 青青青草视频在线 | 久久精品91 | 亚洲精品卡一卡二 | 日韩网站免费观看 | 欧美成人天堂 | 久久久久黄色片 | 爱射综合 | 亚洲黄色一级大片 |