AI-For-Beginners/translations/mo/lessons/5-NLP/15-LanguageModeling
localizeflow[bot] 3dcd19b725 chore(i18n): sync translations with latest source changes (chunk 73/148, 100 files) 2026-01-01 14:20:58 +00:00
..
lab 🌐 Update translations via Co-op Translator 2025-08-26 12:09:18 +00:00
CBoW-PyTorch.ipynb 🌐 Update translations via Co-op Translator 2025-08-28 12:35:46 +00:00
CBoW-TF.ipynb 🌐 Update translations via Co-op Translator 2025-08-28 12:35:46 +00:00
README.md chore(i18n): sync translations with latest source changes (chunk 73/148, 100 files) 2026-01-01 14:20:58 +00:00

README.md

語言建模

語意嵌入(如 Word2Vec 和 GloVe實際上是邁向語言建模的第一步——創建某種理解(或表示)語言本質的模型。

課前測驗

語言建模的核心思想是以無監督的方式在未標註的數據集上進行訓練。這點非常重要,因為我們擁有大量未標註的文本,而標註文本的數量則始終受限於我們能投入的標註工作量。通常,我們可以構建能夠預測缺失單詞的語言模型,因為在文本中隨機遮蔽一個單詞並將其作為訓練樣本是非常簡單的。

訓練嵌入

在之前的例子中,我們使用了預訓練的語意嵌入,但了解這些嵌入是如何訓練的也很有趣。有幾種可能的思路可以用來訓練嵌入:

  • N-Gram 語言建模:通過查看前 N 個標記來預測當前標記N-gram
  • 連續詞袋模型CBoW在標記序列 W_{-N}, ..., W_N 中預測中間的標記 W_0
  • Skip-gram:從中間標記 W_0 預測一組相鄰的標記 {W_{-N},\dots, W_{-1}, W_1,\dots, W_N}。

來自將單詞轉換為向量的論文的圖片

圖片來源:這篇論文

✍️ 範例筆記本:訓練 CBoW 模型

繼續學習以下筆記本中的內容:

結論

在上一課中,我們看到詞嵌入的效果就像魔法一樣!現在我們知道,訓練詞嵌入並不是一件非常複雜的事情,如果需要,我們應該能夠為特定領域的文本訓練自己的詞嵌入。

課後測驗

回顧與自學

🚀 作業:訓練 Skip-Gram 模型

在實驗中,我們挑戰你修改本課的代碼來訓練 Skip-Gram 模型,而非 CBoW 模型。閱讀詳情