Português
← Voltar às tecnologias de IA

Arquitetura de modelos

Transformer

Uma arquitetura neural baseada em atenção que processa posições de uma sequência em paralelo. Tornou-se a base de muitos modelos modernos de linguagem e multimodais.

Período de referência
2017
Última revisão

Termos-chave

  • self-attention
  • encoder
  • decoder
  • positional encoding

Ligações no projeto

Fontes primárias

  1. Attention Is All You Need

Este é um mapa técnico selecionado, não uma afirmação de cobertura completa.