§ Fundamentos
Transformer
Também conhecido como: arquitetura Transformer
Transformer é a arquitetura de rede neuronal introduzida em 2017 no paper «Attention Is All You Need» (Google). Mudou o campo: introduziu o mecanismo de self-attention que permite processar sequências longas em paralelo (vs. RNNs sequenciais). É a base de todos os LLMs modernos (GPT, Claude, Gemini, Llama). Em 2026 começa a haver alternativas competitivas (Mamba, RWKV) mas Transformer continua dominante.
Termos relacionados
Aprender Transformer na prática
O Instituto Português de IA ensina este e outros temas em formações estruturadas com projetos. Começa pelo curso gratuito (48 aulas).