Les questions de propriété intellectuelle, d’entraînement des modèles et de copie concurrentielle continuent de façonner le secteur de l’intelligence artificielle, en particulier alors que des entreprises aux États-Unis et en Chine publient des modèles de langage de grande taille toujours plus performants.
Le contenu fourni décrit un différend impliquant OpenAI et un développeur chinois d’IA, mais il ne contient aucun élément de preuve, aucune date, aucun détail technique, aucune déclaration d’entreprise ni aucune autre information permettant de vérifier une allégation précise. Par conséquent, il n’est pas possible d’établir de manière indépendante si un modèle a été copié de façon inappropriée ou si une plainte officielle a été déposée.
Comment des accusations de copie de modèles peuvent survenir
Dans le domaine de l’IA, les accusations de copie peuvent concerner plusieurs activités distinctes. L’une d’elles est l’acquisition non autorisée de code source, de poids de modèle ou de recherches internes. Une autre est la « distillation », dans laquelle un modèle est entraîné à l’aide de sorties générées par un autre système. Les chercheurs et les entreprises peuvent également diverger sur la question de savoir si des résultats de benchmarks accessibles au public, des API, des données synthétiques ou des contenus internet collectés à grande échelle peuvent être utilisés lors de l’entraînement.
Ces questions se distinguent des litiges plus larges relatifs aux données utilisées pour créer de grands systèmes d’IA. Les entreprises technologiques, les éditeurs, les artistes et d’autres titulaires de droits débattent de la nécessité d’obtenir une autorisation, une licence ou une compensation pour entraîner des systèmes sur des contenus disponibles en ligne. Les tribunaux et régulateurs de plusieurs juridictions examinent encore la manière dont les règles existantes en matière de droit d’auteur, de secret des affaires et de contrats doivent s’appliquer.
Implications pour le secteur
- Les entreprises utilisent de plus en plus des restrictions d’API, des outils de surveillance des sorties et des clauses contractuelles afin de limiter l’extraction automatisée des réponses des modèles.
- Les développeurs investissent dans des contrôles de provenance et dans une documentation destinée à démontrer comment les données d’entraînement et les composants des modèles ont été obtenus.
- La concurrence transfrontalière peut compliquer l’application des règles lorsque les entreprises opèrent dans des systèmes juridiques et selon des normes de divulgation différents.
Toute accusation précise de vol de modèle ou d’usage abusif de propriété intellectuelle doit être évaluée au regard d’éléments techniques vérifiables, des contrats applicables et du droit pertinent. Les accusations publiques ne suffisent pas à établir une faute, et le contenu disponible ne fournit pas suffisamment de détails pour évaluer le différend sous-jacent.
