EAGLE y EAGLE-2: Aceleración de inferencia LLM sin pérdida
📺 Vídeo de estudio recomendado hoy: https://www.youtube.com/watch?v=oXRSorx-Llg EAGLE: Aceleración de LLM sin pérdida mediante predicción de características y árboles dinámicos La inferencia de los modelos de lenguaje masivos suele ser lenta debido a su naturaleza secuencial, pero nuevos marcos de…