Volver a Glossary

Atención Multi-Cabeza

MLTransformer

Un mecanismo de atención que ejecuta múltiples operaciones de atención en paralelo, cada una con proyecciones aprendidas diferentes, y luego concatena sus salidas. La atención multi-cabeza permite que el modelo atienda simultáneamente a diferentes tipos de información (posición, color, forma). Es la primitiva computacional central de las arquitecturas Transformer utilizadas en VLAs y políticas de transformadores.

Related terms