Do Código à Geração

por Frank de Alcantara em 17/02/2025

Do Código à Geração

Já discutimos atenção, quando desbravamos os mares do bloco codificador dos Transformers. Vimos como a auto-atenção, do inglês self-attention, especialmente em sua forma multi-cabeça, do inglês multi-head, permite que o modelo pese a importância de palavras diferentes na sequência de entrada. Exploramos a necessidade da codificação posicional para reintroduzir a ordem das palavras e como as redes feed-forward (FFN) processam as representações contextuais geradas. Com esses componentes, um bloco codificador transforma uma sequência de embeddings de entrada em uma sequência de representações contextuais semanticamente ricas.

Conteúdo Exclusivo
Quer continuar lendo?

Este artigo completo contém estratégias práticas e dados exclusivos reservados para nossos membros cadastrados.

Continuar com Google Acesso gratuito e instantâneo com sua conta Google

(Updated: )