SODP logo

    ¿Qué es la IA de código abierto? Un investigador de ingeniería de software lo explica

    Probablemente hayas oído describir los modelos de inteligencia artificial como “abiertos” o “cerrados”. Estas no son descripciones de la personalidad del modelo. Las grandes IA de modelos de lenguaje, como la que se encuentra en el núcleo de…
    Actualizado el: 28 de julio de 2026
    Jeffrey Young

    Creado por

    Jeffrey Young

    La conversación

    Hecho verificado por

    La conversación

    Jeffrey Young

    Editado por

    Jeffrey Young

    Probablemente hayas oído que los modelos de inteligencia artificial se describen como "abiertos" o "cerrados". Estas no son descripciones de la personalidad del modelo. Los grandes modelos de lenguaje de IA, como el que impulsa ChatGPT, no tienen personalidades reales, a pesar de las apariencias.

    Las etiquetas indican si toda la información sobre cómo funciona un modelo de IA está disponible públicamente y el modelo puede modificarse, o si el desarrollador del modelo mantiene en secreto su funcionamiento interno y el modelo en sí es propiedad privada.

    Software de código abierto

    El concepto de software de código abierto surgió en el movimiento del software libre de los años 80 y 90. Los fundadores del movimiento creían que los creadores y usuarios de software tenían derecho acuatro libertades: ejecutar el programa, estudiarlo y modificarlo, distribuir copias del original y distribuir copias de versiones modificadas posteriormente. El requisito fundamental era que el código fuente —las instrucciones básicas— del programa estuviera disponible.

    A finales de la década de 1990, los desarrolladores de software asociados con proyectos como el navegador web Netscape y el sistema operativo Linux acuñaron y promovieron el término "código abierto" para referirse a estos ideales.

    Como parte de este movimiento en constante evolución, algunas organizaciones desarrollaron licencias de código abierto que especificaban cómo se podía usar y distribuir un fragmento de código fuente determinado, como la Licencia Pública General de GNU, la Licencia Apache, la Licencia MIT y la Distribución de Software de Berkeley. Cada tipo de licencia también especificaba las posibles restricciones sobre cómo se aplicaban las patentes de software al código fuente.

    ¿Código abierto o peso libre?

    La idea del código abierto ha vuelto a cobrar protagonismo en los últimos años, a medida que los grandes modelos de lenguaje de inteligencia artificial han experimentado un auge, especialmente ChatGPT de OpenAI, lanzado en 2022. Los desarrolladores primero entrenan nuevos modelos con grandes conjuntos de datos y luego los implementan para que otros usuarios puedan utilizarlos.

    La inteligencia artificial de código abierto se explica en dos minutos.

    Meta fue una de las primeras grandes empresas en lanzar un modelo de lenguaje de gran tamaño de código abierto, llamado LLaMa. La compañía lanzó LLaMa el 24 de febrero de 2023 y puso a disposición el código fuente de "inferencia", es decir, las instrucciones para ejecutar el modelo. También publicó los denominados pesos, el conocimiento codificado que el modelo aprendió durante el entrenamiento. Sin embargo, organizaciones de código abierto como la Open Source Initiative han declarado que las directrices de licencia de LLaMa prohíben la reutilización comercial, lo que, según la iniciativa, no constituye un verdadero código abierto.

    Otras empresas han lanzadomodelos de "peso abierto", como DeepSeek de DeepSeek AI y Qwen de Alibaba. Estos modelos tienen condiciones de reutilización menos restrictivas y la comunidad de IA los ha adoptado rápidamente. Sin embargo, muchos desarrolladores creen que un verdadero modelo de IA de código abierto no solo debe incluir el código fuente y los pesos, sino también los datos utilizados para entrenarlo.

    Hay mucho que abrir

    La definición de modelo de IA totalmente de código abierto incluye los datos de entrenamiento como un elemento clave. Sin embargo, algunos desarrolladores se preguntan cuán factible es distribuir los enormes conjuntos de datos necesarios.

    Jeffrey Young, científico investigador principal de Partnership for an Advanced Computing Environment, Georgia Institute of Technology.

    Este artículo se republica de The Conversation bajo una licencia Creative Commons. Lea el artículo original.

    0
    Me encantaría conocer tu opinión, por favor comenta.x