Llama 3 de Meta representa un salto significativo hacia adelante en los modelos de lenguaje de gran tamaño de código abierto. Disponible en variantes de 8B y 70B parámetros (con un modelo de 405B que se publicaría posteriormente), ofrece un rendimiento impresionante que rivaliza con muchos modelos propietarios en tareas de razonamiento, codificación y conocimiento general. La naturaleza completamente de código abierto bajo una licencia permisiva lo hace excepcionalmente accesible para desarrolladores, investigadores y empresas que buscan alojar o ajustar modelos sin costes de licencia.
Entre sus fortalezas se incluyen un excelente rendimiento en benchmarks relativo a su clase de tamaño, amplia disponibilidad en las principales plataformas de nube y proveedores de inferencia, una generosa ventana de contexto de 8K y un tokenizador considerablemente mejorado con un vocabulario de 128K. El modelo destaca en la generación de código y en tareas multilingües en comparación con su predecesor.
Las limitaciones incluyen una ventana de contexto predeterminada más pequeña en comparación con algunos competidores, y la variante más grande de 405B requiere hardware sustancial para el alojamiento propio. Aunque sólido, todavía queda por detrás de GPT-4 y Claude 3 Opus en las tareas de razonamiento más complejas. Dicho esto, para una oferta gratuita y de código abierto con acceso completo a la API a través de múltiples proveedores, Llama 3 ofrece un valor sobresaliente y se ha convertido en una piedra angular del ecosistema de IA de código abierto.
El Llama 3 de Meta representa un salto significativo hacia adelante en el panorama de los grandes modelos de lenguaje de pesos abiertos. Disponible inicialmente en tamaños de parámetros de 8B y 70B, ofrece un rendimiento de vanguardia que rivaliza con los modelos propietarios de primer nivel como GPT-4 y Claude 3 en varios benchmarks. El modelo sobresale en el razonamiento, la generación de código y la escritura creativa, mostrando una mejora notable respecto a su predecesor, Llama 2.
Para desarrolladores e investigadores, la propuesta de valor es inmensa. Al ser de código abierto (con una licencia comunitaria permisiva), se puede ejecutar localmente a través de herramientas como Ollama o acceder a través de varios proveedores de API como Groq y AWS. Si bien la ventana de contexto inicial de 8k se siente restrictiva en comparación con los competidores que ofrecen 128k+, la pura calidad de salida y la velocidad lo convierten en una opción versátil para la mayoría de las aplicaciones RAG y de chatbot. Llama 3 democratiza efectivamente la inteligencia de IA de alta gama, convirtiéndolo en una herramienta esencial para cualquiera que construya soluciones de IA independientes.