Las RNN fueron la arquitectura dominante en procesamiento de lenguaje antes de los transformers. En este episodio explicamos cómo funcionan, qué es el vanishing gradient y por qué es un límite real en producción. Con el caso de Google GNMT y la reducción del sesenta por ciento en errores de traducción.