Русский
← Назад к технологиям ИИ

Архитектура моделей

Transformer

Нейросетевая архитектура на основе механизма внимания, параллельно обрабатывающая позиции последовательности. Она стала основой многих современных языковых и мультимодальных моделей.

Опорный период
2017
Последняя проверка

Ключевые термины

  • self-attention
  • encoder
  • decoder
  • positional encoding

Связи внутри проекта

Связанные технологии

Исторический контекст

Первичные источники

  1. Attention Is All You Need

Это отобранная техническая карта, а не заявление о полном охвате.