Les LLM sont des logiciels libres qui s’ignorent.

https://cahiers-derrances.fr/actualites/les-llm-sont-des-logiciels-libres-qui-signorent/

Une remarque qui me semble assez peu soulevée :

Un réseau de neurones artificiels ne fonctionne pas sans données d’entrainement. En fait la création de ces données constitue même très souvent la majorité du travail. Il me semble donc assez difficile d’argumenter qu’un modèle de deep learning n’est pas un travail dérivé des données d’entrainement.

Pourquoi c’est important : parce que si le modèle a utilisé une seule donnée sous licence libre héréditaire (à tout hasard, Wikipédia, ou le code d’un logiciel libre quelconque), alors le modèle est théoriquement sous licence libre : tout le monde à le droit d’utiliser, d’étudier, de modifier et de partager, avec interdiction d’« appliquer des Mesures techniques efficaces à l’Œuvre dérivée qui seraient de nature à restreindre l’exercice des Droits accordés par la Licence d’Œuvre dérivée que Vous appliquez. »

Je ne parle pas de la sortie du modèle (si j’ai lu Dumas, ça ne signifie pas que tout ce j’écris est une œuvre dérivée de Dumas). Je parle du modèle lui-même. Avec le code qui l’a généré, les poids obtenus et les données qui ont permis de les obtenir. La licence GPL est sans ambiguïté quand à ce qui constitue une œuvre dérivée.