Por qué los Transformers reemplazaron a las RNN y LSTM
Durante años, las redes neuronales recurrentes (RNN) y las redes de memoria a corto y largo plazo (LSTM) fueron las campeonas indiscutibles del procesamiento de datos secuenciales. Impulsaron sistemas de traducción de última generación, asistentes de voz y modelos de generación de texto. Sin embargo, en 2017, el artículo fundamental “Attention Is All You Need” (Vaswani et al.) introdujo la arquitectura Transformer. En pocos años, las RNN y LSTM se eliminaron casi por completo de los modelos de IA principales.
Transformers
RNN
LSTM
NLP
Deep Learning