LatamGPT, un modelo de lenguaje de gran tamaño (LLM) creado con datos en español y portugués gracias a una colaboración entre varias universidades latinoamericanas, recibirá una segunda versión con mayor calidad y más datos, según informa Fábio Cozman, profesor de la Escuela Politécnica de la USP, director del C4AI (Centro de Inteligencia Artificial y Aprendizaje Automático) y uno de los colaboradores de la iniciativa en Brasil. Cozman participará en un panel sobre soberanía nacional en inteligencia artificial durante la Super Bots Experience 2026 , evento que tendrá lugar el 18 y 19 de agosto en el WTC de São Paulo. Cabe recordar que LatamGPT fue el gran ganador del premio Mobile Time Selection Award de este año.
En una entrevista con Mobile Time, Cozman habla más sobre LatamGPT y da su opinión sobre el desarrollo de la IA en Brasil.

Fabio Cozman, profesor de la Escuela Politécnica de la USP y director de C4AI.
Mobile Time: ¿Cómo surgió el proyecto LatamGPT? ¿Cuál es su objetivo?
Fabio Cozman — El proyecto LatamGPT es una iniciativa que surge del Centro de Inteligencia Artificial (CENIA) de Chile y que es liderada por dicho centro. Este centro reúne a instituciones de toda Latinoamérica para construir una familia de Modelos de Lenguaje a Gran Escala (LLM, por sus siglas en inglés), publicando periódicamente un modelo también llamado “LatamGPT”. El primer modelo se publicó en el primer semestre de este año, tras haber sido entrenado (proceso de entrenamiento continuo y posterior al entrenamiento) utilizando el modelo de código abierto Llama 70B. El entrenamiento se llevó a cabo en Chile, utilizando datos recopilados de países latinoamericanos, incluyendo datos textuales, datos de seguimiento de instrucciones y datos de evaluación.
¿Cuál es el papel de Brasil en este proyecto? ¿Cuáles fueron las principales fuentes de datos en portugués utilizadas para entrenar el modelo?
Nuestro grupo aquí en Brasil aporta datos para la evaluación. Los datos en portugués se obtuvieron de varios conjuntos de datos públicos, uno de los cuales es el corpus Carolina, que se construyó en Brasil (en nuestro centro de investigación aquí en la USP) con anotaciones lingüísticas para garantizar una mayor calidad ( https://sites.usp.br/corpuscarolina/ ).
¿En qué fase de desarrollo se encuentra el proyecto? ¿Está LatamGPT disponible para uso público?
Se creó la primera versión y el proyecto continúa con planes para una versión 2 posterior, con mayor calidad y que utilice más datos.
El modelo LatamGPT está disponible en la plataforma HuggingFace (código Llama-3.1-70B-LatamGPT-SFT-1.0), y se puede acceder a un chat en copuchat.latamgpt.org. Su uso es gratuito, sujeto a ciertas restricciones estipuladas en la licencia de uso.
Es una plantilla de uso general; se puede utilizar para responder preguntas, crear resúmenes y corregir textos.
¿Qué papel puede desempeñar Brasil en el ecosistema global de IA? ¿Seremos meros consumidores de la tecnología o podremos ser protagonistas en su desarrollo? ¿Tenemos el potencial para liderar en algún área específica?
Creo que existen vías interesantes para el país, trabajando con algoritmos de IA predictiva para aplicaciones que beneficien a la sociedad, por ejemplo, en sectores gubernamentales y productivos como finanzas, agricultura y salud. El uso intensivo de grandes modelos de lenguaje aún nos coloca en una posición más vulnerable, ya que la tecnología no está completamente dominada, pero contamos con grupos de investigación que pueden desarrollar buenas ideas con cierto apoyo. Considero que las iniciativas del PBIA (Plan Brasileño de Inteligencia Artificial) en general son positivas para organizar el panorama general de inversión y aumentar el enfoque en temas estratégicos, aunque es difícil competir con el nivel de inversión internacional con los recursos disponibles.
¿Cuál es su opinión sobre el Proyecto de Ley 2338, el marco legal para la IA? Existen críticas que señalan que el proceso en la Cámara de Diputados se está desarrollando sin transparencia ni participación ciudadana. ¿Está de acuerdo?
Respecto al proyecto de ley 2338, he estado siguiendo el debate, pero no soy un experto en derecho; lo que sí puedo decir es que me parece positivo que se esté debatiendo en el Congreso, ya que el tema se está aclarando poco a poco. No se justifican decisiones precipitadas, puesto que, por el momento, carecemos de claridad sobre el mejor curso de acción.
También hay quienes critican que no deberíamos copiar la legislación europea, sino buscar nuestro propio camino en materia de legislación sobre IA. ¿Cuál es su opinión al respecto?
De hecho, creo que el camino que representa la Ley de IA de la UE es demasiado restrictivo; necesitamos regulaciones más flexibles, pero que, al mismo tiempo, garanticen cierta protección para los usuarios y los productores de contenido.


