SODP logo

    Qu’est-ce que l’IA open source ? Un chercheur en génie logiciel nous l’explique

    Vous avez probablement déjà entendu parler de modèles d'intelligence artificielle qualifiés d'« ouverts » ou de « fermés ». Il ne s'agit pas de descriptions de la personnalité du modèle. Les IA de grande envergure utilisant des modèles de langage, comme celle qui est au cœur de…
    Mise à jour : 28 juillet 2026
    Jeffrey Young

    Créé par

    Jeffrey Young

    La conversation

    Vérifié par

    La conversation

    Jeffrey Young

    Édité par

    Jeffrey Young

    Vous avez probablement déjà entendu parler de modèles d'intelligence artificielle qualifiés d'« ouverts » ou de « fermés ». Il ne s'agit pas de descriptions de la personnalité du modèle. Les grands modèles d'IA de langage, comme celui qui sous-tend ChatGPT, n'ont pas de véritable personnalité, malgré les apparences.

    Ces étiquettes indiquent si toutes les informations relatives au fonctionnement d'un modèle d'IA sont publiques et si le modèle peut être modifié, ou si le développeur du modèle garde secrets ses mécanismes internes et que le modèle lui-même reste une propriété privée.

    Logiciel libre

    Le concept de logiciel libre est né du mouvement du logiciel libre des années 1980 et 1990. Les fondateurs de ce mouvement estimaient que les créateurs et les utilisateurs de logiciels avaient droit à « quatre libertés » : exécuter le programme, l’étudier et le modifier, distribuer des copies de la version originale et distribuer des copies des versions modifiées ultérieurement. L’exigence fondamentale était que le code source – les instructions de base – d’un programme soit accessible.

    À la fin des années 1990, les développeurs de logiciels associés à des projets tels que le navigateur web Netscape et le système d'exploitation Linux ont inventé et promu le terme « open source » pour désigner ces idéaux.

    Dans le cadre de ce mouvement en pleine évolution, certaines organisations ont élaboré des licences open source précisant les conditions d'utilisation et de distribution d'un code source donné, notamment la licence publique générale GNU (GPL), la licence Apache, la licence MIT et la distribution Berkeley (BSD). Chaque type de licence spécifie également les éventuelles restrictions relatives à l'application des brevets logiciels au code source.

    Logiciel libre ou poids libre ?

    L'idée de l'open source a retrouvé une place prépondérante ces dernières années avec l'essor des grands modèles de langage d'intelligence artificielle, notamment ChatGPT d'OpenAI, sorti en 2022. Les développeurs entraînent d'abord ces nouveaux modèles sur de vastes ensembles de données, puis les déploient pour qu'ils soient utilisés par d'autres personnes.

    L'intelligence artificielle open source expliquée en deux minutes.

    Meta a été l'une des premières grandes entreprises à publier un modèle de langage open source de grande taille, appelé LLaMa. L'entreprise a publié LLaMa le 24 février 2023 et a mis à disposition le code source d'« inférence », c'est-à-dire les instructions qui exécutent le modèle. Elle a également publié les poids, c'est-à-dire les connaissances encodées que le modèle a apprises lors de son entraînement. Cependant, des organisations open source telles que l' Open Source Initiative ont déclaré que les directives de licence de LLaMa interdisent sa réutilisation commerciale, ce qui, selon l'initiative, ne correspond pas à la définition d'un logiciel véritablement open source.

    D'autres entreprises ont publiédes modèles à « poids ouverts », comme DeepSeek de DeepSeek AI et Qwen d'Alibaba. Ces modèles, dont les conditions de réutilisation sont moins restrictives, ont été rapidement adoptés par la communauté de l'IA. Cependant, de nombreux développeurs estiment qu'un véritable modèle d'IA open source doit inclure non seulement le code source et les poids, mais aussi les données utilisées pour son entraînement.

    Beaucoup de choses à ouvrir

    La définition d'un modèle d'IA entièrement open source inclut les données d'entraînement comme élément clé. Certains développeurs s'interrogent toutefois sur la faisabilité de la distribution des énormes ensembles de données nécessaires.

    Jeffrey Young, chercheur principal, Partenariat pour un environnement informatique avancé, Georgia Institute of Technology.

    Cet article est republié de The Conversation sous licence Creative Commons. Lire l' article original.

    0
    J'aimerais beaucoup avoir votre avis, n'hésitez pas à commenter.x