Résumé :
Alors que les sociétés américaines d'intelligence artificielle telles qu'OpenAI et Anthropic continuent d'accuser les entreprises chinoises de copier des technologies avancées via une « distillation de modèles », Garry Tan, PDG de Y Combinator, un accélérateur de startups américain bien connu, a publiquement exprimé un point de vue complètement différent. Il a déclaré que si cela ne tenait qu'à lui, "rien ne serait fait" sur la question de la distillation et estimait que la réglementation actuelle ne devrait pas se concentrer sur la lutte contre la distillation.

Garry Tan a fait la déclaration ci-dessus lors d'une interview lors de l'événement annuel Demo Day de Y Combinator. Au cours des derniers mois, la distillation de modèles est devenue l’un des sujets les plus controversés de l’industrie mondiale de l’IA. La distillation fait référence à l'utilisation des résultats générés par un modèle d'intelligence artificielle plus puissant pour former un modèle plus petit ou moins performant. Dans certains cas, ce processus peut ne pas être autorisé par le développeur du modèle d'origine. Il est donc considéré par certaines grandes sociétés d'IA comme une menace pour les droits de propriété intellectuelle et les intérêts commerciaux.
À l'heure actuelle, Anthropic a publiquement accusé des sociétés chinoises telles que Dark Side of the Moon, DeepSeek et MiniMax d'avoir prétendument utilisé ses modèles pour la formation à la distillation. OpenAI estime qu'une partie de l'architecture du modèle de DeepSeek peut emprunter ou provenir des résultats de sortie de ses modèles des séries GPT-4 et GPT-4o. Dans le même temps, la National Security Agency des États-Unis, la Cybersecurity and Infrastructure Security Agency et le FBI ont récemment publié conjointement un avertissement en matière de cybersécurité, répertoriant les comportements pertinents comme des risques de sécurité nécessitant une attention particulière.
Cependant, Garry Tan n'est pas favorable à des restrictions plus strictes en matière de distillation. Il estime que les régulateurs devraient vraiment se concentrer sur la manière d’établir un équilibre sain entre les modèles de poids ouverts et les modèles de pointe à source fermée, plutôt que de simplement interdire ou réprimer les pratiques de distillation. Selon lui, tant que le modèle leader peut encore conserver des avantages de performance et des primes de prix suffisants pour permettre à son modèle commercial de continuer à fonctionner, l'existence d'un modèle ouvert sera propice à la vulgarisation de la technologie et à la diffusion de l'innovation.
Il a déclaré que l'idéal devrait être que le modèle à poids ouvert offre une liberté et des opportunités d'utilisation à un plus grand nombre de développeurs et d'entreprises, tandis que le modèle de pointe conserve sa valeur commerciale grâce à son leadership technologique. Bien que cet équilibre soit très fragile et aussi difficile que « marcher sur une corde raide », il reste la voie de développement la plus valable pour l'industrie.
Un autre contexte à la controverse sur la distillation vient des problèmes de droits d'auteur de longue date dans le secteur de l'intelligence artificielle. De nombreux critiques soulignent que des entreprises telles qu'OpenAI et Anthropic ont également été confrontées à des questions concernant l'utilisation non autorisée de reportages, de livres et d'autres contenus protégés par le droit d'auteur lors de la formation de leurs propres modèles. Le New York Times a déjà poursuivi OpenAI et Microsoft, les accusant d'utiliser du contenu d'actualité pour former des modèles sans autorisation ; de nombreux écrivains ont également intenté des poursuites contre Anthropic pour des problèmes similaires. Garry Tan estime que cela complique la position éthique de l'industrie en matière de distillation.
En plus de la question de la concurrence des modèles, Garry Tan reste également prudent quant à la « théorie apocalyptique de l'IA » actuelle. Récemment, alors que certains chercheurs en intelligence artificielle ont publiquement exprimé leurs inquiétudes quant au risque de perte de contrôle de l'IA avancée, le débat dans la société sur les risques existentiels de l'intelligence artificielle s'est considérablement accru. Mais Tan estime que l'industrie devrait accorder plus d'attention aux problèmes qui se sont déjà produits ou sont sur le point de se produire dans la réalité, plutôt que de se livrer à des scénarios catastrophes de science-fiction.
Selon lui, les risques dans le domaine de la sécurité des réseaux constituent actuellement le défi le plus urgent. Par exemple, si les systèmes d’IA sont utilisés pour des cyberattaques, la pénétration d’infrastructures ou des crimes automatisés, ils méritent bien plus d’être traités en priorité que le scénario lointain d’une extermination de l’humanité par l’IA. Concernant des questions telles que les impacts sur l’emploi et les changements dans la structure économique, il estime que, même si ces impacts sont réels, ils sont plus susceptibles d’apparaître progressivement au cours des prochaines décennies plutôt que d’éclater sur une courte période.
Il convient de noter que malgré l'escalade du débat autour de la sécurité de l'intelligence artificielle et de la concurrence entre les modèles, Y Combinator continue de miser massivement sur l'industrie de l'IA. Parmi les 196 startups présentées lors de ce Demo Day, 149 étaient liées à l'apprentissage automatique et à l'intelligence artificielle, représentant plus des trois quarts de tous les projets, reflétant le grand optimisme de l'agence quant au développement futur de l'intelligence artificielle.
Les analystes estiment que la déclaration de Garry Tan représente une autre voix au sein de la Silicon Valley. Contrairement aux développeurs de modèles d’avant-garde qui prônent le renforcement de la protection et la limitation de la prolifération technologique, cette faction met l’accent sur l’écologie ouverte, la pleine concurrence et la démocratisation de la technologie. Alors que l’industrie de l’IA continue de se développer à un rythme rapide, les débats autour de la « distillation », des modèles open source, de la sécurité nationale et de la propriété intellectuelle devraient continuer à devenir des enjeux importants dans le domaine mondial de l’intelligence artificielle au cours des prochaines années.
Commentaires