久久久亚洲精品一区二区三区_精品无码午夜福利理论片_爱豆传媒在线观看视频_国产av综合第一页_精品国产乱码久久久久久鸭王1_广东少妇大战黑人34厘米视频_久久精品人人做人人综合_日韩国产成人无码av毛片_国产成人无码A区精油按摩_欧美一曲二曲三曲的区别小说

首頁 > 新車圖片 > 新車圖片 > 多模態(tài)對(duì)齊在小紅書推薦的研究及應(yīng)用

多模態(tài)對(duì)齊在小紅書推薦的研究及應(yīng)用

發(fā)布時(shí)間:2024-09-24 16:52:42

在 CIKM 2024 上,小紅書中臺(tái)算法團(tuán)隊(duì)提出了一種創(chuàng)新的聯(lián)合訓(xùn)練框架 AlignRec,用于對(duì)齊多模態(tài)表征學(xué)習(xí)模型和個(gè)性化推薦模型。本文指出,由于多模態(tài)模型與推薦模型在訓(xùn)練過程中存在步調(diào)不一致問題,導(dǎo)致聯(lián)合訓(xùn)練被推薦信號(hào)主導(dǎo),從而丟失大量多模態(tài)信息。AlignRec 通過分階段對(duì)齊的方式,設(shè)計(jì)了三種針對(duì)性的優(yōu)化損失函數(shù),使得聯(lián)合訓(xùn)練能夠同時(shí)兼顧多模態(tài)信息和推薦信息。實(shí)驗(yàn)結(jié)果表明,AlignRec 在多個(gè)數(shù)據(jù)集上的性能超過了現(xiàn)有的 SOTA(state-of-the-art)模型。此外,AlignRec 還提供了在當(dāng)前廣泛使用的公開數(shù)據(jù)集亞馬遜上的預(yù)處理特征,這些特征的效果顯著優(yōu)于現(xiàn)有的開源特征。


最近多模態(tài)是個(gè)非常熱門的話題,尤其是在大模型以及 AIGC 領(lǐng)域,多模態(tài)基建和技術(shù)是走向未來商業(yè)化的奠基石。在過去的多模態(tài)大模型研究方向上,模態(tài)的“對(duì)齊”已經(jīng)被驗(yàn)證非常重要,分布的不一致?lián)p害不同模態(tài)的理解,我們此次要討論的核心問題是多模態(tài)在推薦中的對(duì)齊問題;

 

在具體介紹論文工作之前,我們先來介紹下我們過去在推薦和電商中的實(shí)踐工作:

 

推薦實(shí)踐


上述方法是我們對(duì) BM3論文進(jìn)行改進(jìn) 上線的方案,該方案實(shí)際上做的是通過損失函數(shù)來實(shí)現(xiàn)“對(duì)齊”工作。我們的對(duì)模型的期望也是保留個(gè)性化的同時(shí),能夠?qū)R行為和多模態(tài)的空間,進(jìn)一步增加長尾的個(gè)性化分發(fā)能力。先說效果:

 

該模型實(shí)驗(yàn)在推薦發(fā)現(xiàn)頁取得時(shí)長、曝光、點(diǎn)擊等核心指標(biāo)收益,除此之外,在長尾分發(fā)上,0 粉作者筆記點(diǎn)擊和曝光獲得大幅增長,整個(gè)召回路增加了全局可分發(fā)筆記數(shù) 6%,分發(fā)筆記集中在 1k-5k 的筆記曝光集合;同時(shí),我們的方法也被復(fù)用在了電商場景,分發(fā)長尾同時(shí),獲得 DGMV 等核心指標(biāo)收益。

 

很顯然,從上述可以看出,“對(duì)齊”的效果立竿見影,在業(yè)界應(yīng)用上我們已經(jīng)取得實(shí)質(zhì)性進(jìn)展,但本質(zhì)上這樣的設(shè)計(jì)方案依然并沒有完全解決多模態(tài)推薦問題,因?yàn)槲覀兊亩嗄B(tài)模型和推薦模型是相對(duì)割裂的,等同于直接拿表征來使用,這樣的設(shè)計(jì)打通了應(yīng)用范式,卻無法判斷多模態(tài)模型本身能力對(duì)效果的上限,對(duì)于選擇合適多模態(tài)表征存在一定的難度。但如果我們引入文本/圖等 Encoder(Transformer)等進(jìn)行聯(lián)合訓(xùn)練,會(huì)引入如下的問題:

 

在大規(guī)模的數(shù)據(jù)下,分布式訓(xùn)練引入圖文 Encoder 會(huì)造成資源和性能問題,尤其是注重高時(shí)效性的 Streaming Data;
訓(xùn)練步調(diào)不一致,往往多模態(tài)模型需要大量數(shù)據(jù)甚至多個(gè) Epoch 才能收斂,但推薦模型通常采取單輪訓(xùn)練,這也導(dǎo)致多模態(tài)模型訓(xùn)練不充分;

所以我們?cè)O(shè)計(jì)聯(lián)合訓(xùn)練模型,通過設(shè)計(jì)分階段對(duì)齊的方式和中間指標(biāo)評(píng)估,解決上述聯(lián)合訓(xùn)練問題,并且引入了三種針對(duì)性的優(yōu)化損失函數(shù),使得聯(lián)合訓(xùn)練能夠同時(shí)兼顧多模態(tài)信息和推薦信息,解決聯(lián)合訓(xùn)練中的“對(duì)齊”問題,提升效果上限。

 

下面我們從相關(guān)工作,核心挑戰(zhàn),模型設(shè)計(jì)介紹整體工作。

 

我們?cè)谶@里通過 (a), (b), (c) 描述了在過往的學(xué)術(shù)界目前多模態(tài)推薦方向的相關(guān)工作,總結(jié)主要的發(fā)展路徑:

圖(a),直接利用,比如把 embedding,多模態(tài)特征作為信號(hào)輸入網(wǎng)絡(luò);
圖(b),利用圖等方式聚合,希望能得到更豐富的多模態(tài)信息表達(dá),這本質(zhì)上也是增加多模態(tài)側(cè)信息的召回率;
圖(c),聯(lián)合優(yōu)化,把模態(tài)損失和行為損失共同優(yōu)化,但這忽略了本身筆記側(cè)的多模態(tài)學(xué)習(xí)。
在工業(yè)界,現(xiàn)階段推薦系統(tǒng)主要還是依賴于 ID 特征的學(xué)習(xí), 大多數(shù)多模態(tài)推薦把多模態(tài)信息作為 sideinfo 去輔助 ID 特征的學(xué)習(xí)。但是, 多模態(tài)之間以及 ID 模型與多模態(tài)之間都存在著語義鴻溝, 直接使用甚至可能適得其反。

 

核心挑戰(zhàn)

為了貼合業(yè)界實(shí)際,設(shè)計(jì)一款有效的多模態(tài)與推薦聯(lián)合訓(xùn)練模型會(huì)遇到如下的挑戰(zhàn):

 

挑戰(zhàn)1: 如何對(duì)齊多模態(tài)表征。包括內(nèi)容模態(tài)之間(如圖文)的對(duì)齊,以及內(nèi)容模態(tài)與 ID 模態(tài)之間的對(duì)齊;
挑戰(zhàn)2: 如何平衡好內(nèi)容模態(tài)和 ID 模態(tài)之間的學(xué)習(xí)速度問題。內(nèi)容模態(tài)可能需要超大規(guī)模的數(shù)據(jù)和時(shí)間去訓(xùn)練, 而 ID 模態(tài)的學(xué)習(xí)更新可能只需要幾個(gè) epoch。
挑戰(zhàn)3: 如何評(píng)估多模態(tài)特征對(duì)推薦系統(tǒng)的影響。引入不合適的多模態(tài)信息可能需要更多的精力去做糾正, 甚至可能影響推薦系統(tǒng)的性能。

我們所提出的方法命名為 AlignRec,整體框架如下圖所示, 主要包含3個(gè)模塊: Multimodal Encoder Module, Aggregation Module, 以及 Fusion Module, 下面分別進(jìn)行介紹。


Multimodal Encoder Module

 

新車圖片更多>>

重大發(fā)現(xiàn):全球80%海域發(fā)現(xiàn)“吃塑料”細(xì)菌,已進(jìn)化出降解能力 軟銀與OpenAI宣布成立合資公司,明年推出企業(yè)級(jí)AI解決方案 小鵬新一代人形機(jī)器人IRON亮相:首推女性形態(tài),目標(biāo)2026年規(guī)模量產(chǎn) 中國科學(xué)家破解140年難題:動(dòng)輒百萬起抗癌藥成本有望斷崖下降! 三星美國泰勒工廠即將投入運(yùn)營 ASML正協(xié)助安裝EUV設(shè)備 高德成小鵬Robotaxi首個(gè)全球生態(tài)伙伴,共推L4級(jí)自動(dòng)駕駛出行服務(wù) 小鵬發(fā)布第二代VLA:大眾成首個(gè)客戶,將面向全球開源 東芝發(fā)布S300 AI系列監(jiān)控硬盤:針對(duì)AI負(fù)載進(jìn)行優(yōu)化 上海第一輪汽車以舊換新補(bǔ)貼搖號(hào)報(bào)名10月25日啟動(dòng) Redmi K90 Pro Max發(fā)布:搭載5X潛望長焦鏡頭,3999元起 不到13kg重就有千匹馬力!奔馳新電機(jī)功率密度打破世界紀(jì)錄 Redmi K90標(biāo)準(zhǔn)版發(fā)布:搭載超級(jí)像素屏幕,起售價(jià)2599元 吉利銀河星耀8首個(gè)大版本OTA發(fā)布,新增哨兵模式 優(yōu)步推出Uber Electric計(jì)劃:美國網(wǎng)約車主換電動(dòng)汽車可享最高5000美元補(bǔ)貼 快手進(jìn)軍“AI編程”賽道,推出“工具+模型+平臺(tái)”產(chǎn)品矩陣 指導(dǎo)價(jià)9.78-12.78萬元 江鈴羿馳05S上市 9月熱門新SUV銷量:僅2款過萬,動(dòng)不動(dòng)就幾萬的訂單去哪了? 華為又出新車了?廣汽啟境首款車型明年亮相 預(yù)售價(jià)19.99 萬起!風(fēng)云T11截胡小米YU9 魏牌高山7: 標(biāo)配激光雷達(dá)+四驅(qū),不到29萬的家庭MPV新殺手來了! 以越級(jí)空間為馬悅意03長續(xù)航定義秋日出行 魏牌高山7震撼上市,28.58萬開啟家庭MPV價(jià)值新篇 純電奧迪A4曝光,700km續(xù)航挺好,但造型看不下去 全新奧迪A6L不老氣,大眾全新中型車有點(diǎn)料 奇瑞汽車提前“沖刺”第四季度加推4款SUV新車 iCAR V27領(lǐng)銜 政策紅利與長續(xù)航對(duì)決:榮威M7 DMH如何重塑10萬級(jí)混動(dòng)市場格局? 購置稅退坡進(jìn)入倒計(jì)時(shí),新能源車市兜底戰(zhàn)打響! 極氪9X上市:搭2.0T超級(jí)電混發(fā)動(dòng)機(jī),純電巡航起步300公里 曝比亞迪今年海外銷量占比或?qū)⑼黄?0% 新時(shí)代B級(jí)車開創(chuàng)者 別克至境L7正式上市,限時(shí)權(quán)益價(jià)16.99萬~21.59萬元