HuggingFace Daily Papers(社區熱門論文)·· 2 天前AI 評分61
Prior-Fitted Language Model(PFLM)學會從上下文推斷語言
Learning to Learn a Language
摘要
研究提出 300M 參數的 Prior-Fitted Language Model(PFLM),讓模型在凍結權重下從真實文本前綴推斷語言並預測後續內容。它只以合成的非語言先驗樣本預訓練;每條訓練序列均由從分佈中重新抽取的遞迴結構因果模型生成,因此模型未見過任何真實語言的詞,也不會在訓練中兩次遇到同一語言。
來源:HuggingFace Daily Papers(社區熱門論文) · huggingface.co