Probablemente hayas oído que los modelos de inteligencia artificial se describan como “abiertos” o “cerrados”. Estas no son descripciones de la personalidad del modelo. Las grandes IAs de modelos de lenguaje como la que hay bajo el capó de ChatGPT no tienen personalidades reales, a pesar de las apariencias.
Las etiquetas se refieren a si toda la información sobre cómo funciona un modelo de IA es pública y el modelo puede modificarse, o si el desarrollador del modelo mantiene en secreto su funcionamiento interno y el propio modelo es propiedad privada.
Software de código abierto
El concepto de software de código abierto se originó en el movimiento del software libre de los años 80 y 90. Los fundadores del movimiento creían que los creadores y usuarios de software tenían derecho a “cuatro libertades”: ejecutar el programa, estudiarlo y modificarlo, distribuir copias del original y distribuir copias de versiones modificadas posteriormente. El requisito fundamental era que el código fuente —las instrucciones básicas— de un programa estuviera disponible.
A finales de los años 90, desarrolladores de software asociados a proyectos como el navegador web Netscape y el sistema operativo Linux acuñaron y promovieron el término “código abierto” para referirse a estos ideales.
Como parte del movimiento en evolución, ciertas organizaciones desarrollaron licencias de código abierto que especificaban cómo se podía usar y distribuir un fragmento concreto de código fuente, incluyendo la Licencia General Pública Gnu, la Licencia Apache, la Licencia MIT y la Distribución de Software de Berkeley. Cada tipo de licencia también especificaba posibles restricciones sobre cómo se aplicaban las patentes de software al código fuente.
Te puede interesar: Conoce al multimillonario de aguas residuales con su ojo puesto en los centros de datos de IA
¿Código abierto o peso abierto?
La idea del código abierto ha vuelto a cobrar protagonismo en los últimos años, ya que los grandes modelos de lenguaje de inteligencia artificial han aumentado en particular, especialmente ChatGPT de OpenAI, lanzado en 2022. Los desarrolladores primero entrenan nuevos modelos con grandes conjuntos de datos y luego despliegan los modelos para que otros los utilicen.
Meta fue una de las primeras grandes empresas en lanzar un modelo de lenguaje grande de código abierto, llamado LLaMa. La empresa lanzó LLaMa el 24 de febrero de 2023 y puso a disposición el código fuente de “inferencia”, es decir, las instrucciones que ejecutan el modelo. Y liberó los llamados pesos, el conocimiento codificado que el modelo adquirió durante el entrenamiento. Sin embargo, organizaciones de código abierto como la Open Source Initiative han declarado que las directrices de licencias de LLaMa prohíben la reutilización comercial, lo cual la iniciativa sostiene que no es realmente de código abierto.
Otras empresas han lanzado modelos de “peso abierto”, como DeepSeek de DeepSeek AI y Qwen de Alibaba. Los modelos tienen términos menos restrictivos para la reutilización, y la comunidad de IA los ha adoptado rápidamente. Aun así, muchos desarrolladores creen que un verdadero modelo de IA de código abierto debe incluir no solo el código fuente y los pesos, sino también los datos que se utilizan para entrenar el modelo.
Mucho que abrir
La definición de modelo de IA totalmente open-source de la Open Source Initiative incluye los datos de entrenamiento como elemento clave. Sin embargo, algunos desarrolladores se preguntan cuán factible es distribuir los enormes conjuntos de datos necesarios.
*Jeffrey Young es Científico Investigador Principal para el Partnership for an Advanced Computing Environment del Instituto Tecnológico de Georgia.
Este artículo fue publicado originalmente en The Conversation/Reuters
Síguenos en Google Noticias para mantenerte siempre informado










