AI-For-Beginners/translations/pt-PT/lessons/5-NLP/15-LanguageModeling/lab
localizeflow[bot] 7f61888e3b chore(i18n): sync translations with latest source changes (chunk 8/8, 60 changes) 2026-01-30 01:46:12 +00:00
..
README.md chore(i18n): sync translations with latest source changes (chunk 8/8, 60 changes) 2026-01-30 01:46:12 +00:00

README.md

Treinar Modelo Skip-Gram

Trabalho prático do Currículo AI for Beginners.

Tarefa

Neste laboratório, desafiamos-te a treinar um modelo Word2Vec utilizando a técnica Skip-Gram. Treina uma rede com embeddings para prever palavras vizinhas numa janela Skip-Gram de N tokens de largura. Podes usar o código desta lição e modificá-lo ligeiramente.

O Conjunto de Dados

Podes usar qualquer livro. Podes encontrar muitos textos gratuitos no Project Gutenberg, por exemplo, aqui está um link direto para Alice's Adventures in Wonderland de Lewis Carroll. Ou, podes usar as peças de Shakespeare, que podes obter utilizando o seguinte código:

path_to_file = tf.keras.utils.get_file(
   'shakespeare.txt', 
   'https://storage.googleapis.com/download.tensorflow.org/data/shakespeare.txt')
text = open(path_to_file, 'rb').read().decode(encoding='utf-8')

Explora!

Se tiveres tempo e quiseres aprofundar o tema, tenta explorar várias questões:

  • Como o tamanho do embedding afeta os resultados?
  • Como diferentes estilos de texto afetam o resultado?
  • Escolhe vários tipos de palavras muito diferentes e os seus sinónimos, obtém as suas representações vetoriais, aplica PCA para reduzir as dimensões para 2 e representa-as num espaço 2D. Consegues identificar algum padrão?

Aviso Legal:
Este documento foi traduzido utilizando o serviço de tradução por IA Co-op Translator. Embora nos esforcemos pela precisão, esteja ciente de que traduções automáticas podem conter erros ou imprecisões. O documento original na sua língua nativa deve ser considerado a fonte autoritária. Para informações críticas, recomenda-se uma tradução profissional realizada por humanos. Não nos responsabilizamos por quaisquer mal-entendidos ou interpretações incorretas decorrentes da utilização desta tradução.