6月14日消息,研究人員近日發(fā)現(xiàn),“在訓(xùn)練中使用模型生成的內(nèi)容,將導(dǎo)致后續(xù)生成的模型出現(xiàn)不可逆轉(zhuǎn)的缺陷”,也就是說,“用 AI 生成的結(jié)果訓(xùn)練 AI,只會讓模型變得越來越差”。這項研究成果的詳細論文已發(fā)表在了 arXiv 之上。
據(jù)IT之家報道,研究人員專門研究了 AI 生成模型的概率分布,主要圍繞“文本到文本”和“圖像到圖像”展開,最終得出結(jié)論:“由于每個模型生成的結(jié)果都具有一定的特點,因此用 AI 生成的模型訓(xùn)練 AI,隨著時間的推移,后者會忘記真正的底層數(shù)據(jù)分布。”
論文的主要作者之一 Ilia Shumailov 表示,“隨著時間的推移,生成數(shù)據(jù)中的錯誤會迫使 AI 進一步錯誤地感知現(xiàn)實,我們驚訝地觀察到模型崩潰發(fā)生的速度相當(dāng)快,模型可以迅速忘記他們最初從中學(xué)習(xí)的大部分原始數(shù)據(jù)。”
如果將 AI 生成的結(jié)果經(jīng)過人工潤色后再投入模型訓(xùn)練,是否可以避免模型“退化”?答案是否定的,研究人員發(fā)現(xiàn)“模型退化過程是不可避免的”,因此即使對于“經(jīng)過潤色后理想化的 AI 輸出內(nèi)容”,模型在長期學(xué)習(xí)后,也會出現(xiàn)一定的退化現(xiàn)象。
對于任何大模型而言,由于其學(xué)習(xí)數(shù)據(jù)過多,它們都將不可避免地接觸到其他 AI 生成的數(shù)據(jù),因此研究人員表示“應(yīng)當(dāng)引入 AI 鑒定來挑出可能存在錯誤的學(xué)習(xí)數(shù)據(jù)”以提升模型的學(xué)習(xí)能力與準(zhǔn)確性。
文章內(nèi)容僅供閱讀,不構(gòu)成投資建議,請謹(jǐn)慎對待。投資者據(jù)此操作,風(fēng)險自擔(dān)。
海報生成中...
海藝AI的模型系統(tǒng)在國際市場上廣受好評,目前站內(nèi)累計模型數(shù)超過80萬個,涵蓋寫實、二次元、插畫、設(shè)計、攝影、風(fēng)格化圖像等多類型應(yīng)用場景,基本覆蓋所有主流創(chuàng)作風(fēng)格。
9月9日,國際權(quán)威市場調(diào)研機構(gòu)英富曼(Omdia)發(fā)布了《中國AI云市場,1H25》報告。中國AI云市場阿里云占比8%位列第一。
IDC今日發(fā)布的《全球智能家居清潔機器人設(shè)備市場季度跟蹤報告,2025年第二季度》顯示,上半年全球智能家居清潔機器人市場出貨1,2萬臺,同比增長33%,顯示出品類強勁的市場需求。