Le nouveau modèle d'IA de ByteDance exposé : il peut générer des vidéos spatiales en temps réel et Zhang Yiming en est personnellement responsable

📅 2026-09-07

Résumé :

Selon Bloomberg, ByteDance se prépare à lancer un modèle d'IA pour la génération de vidéos spatiales en temps réel afin de concurrencer Alphabet, société mère de Meta et de Google, dans les domaines de la robotique et des applications de systèmes autonomes. Le fondateur de ByteDance, Zhang Yiming, supervise personnellement le développement du nouveau modèle, qui pourrait sortir dès le mois prochain, selon des personnes proches du dossier. Des personnes proches du dossier ont déclaré que Zhang Yiming coordonnait le travail pertinent des différents départements commerciaux de l'entreprise et allouait des ressources d'IA et de la puissance de calcul à ce projet. La date de sortie du modèle est incertaine et les plans sont susceptibles de changer.


ByteDance

Des sources bien informées ont déclaré que le modèle est construit sur le modèle d'IA de génération vidéo de film existant de Bytedance, Seedance, et permettra aux utilisateurs de créer des mondes virtuels interactifs pour des diffusions en direct, des pièces de théâtre courtes et des jeux.

Zhang Yiming espère que ce dernier modèle d'IA permettra à l'entreprise d'entrer dans le domaine des modèles mondiaux en développement rapide grâce à ses capacités professionnelles de pointe dans le domaine de la vidéo. Il rejoindra Fei-Fei Li, Yann LeCun et d'autres pour explorer la voie visuelle de l'IA, une direction considérée comme essentielle à la robotique, aux jeux et aux voitures autonomes.

Le dernier modèle de ByteDance vise à générer des mondes virtuels qui répondent à la voix ou aux mouvements de l'utilisateur du casque Pico. Une personne proche du dossier a révélé que le modèle peut générer de la vidéo à la demande à une vitesse de 20 images par seconde avec une latence d'environ 0,05 seconde, et peut servir des environnements informatiques spatiaux et des interfaces interactives.

Le modèle chinois vise à réduire les coûts initiaux liés à l'adoption de la réalité virtuelle en déplaçant le processus intensif de calcul de génération de contenu spatial vers le cloud. Cela réduirait la puissance de traitement requise pour le casque, ouvrant la voie à des appareils moins chers avec des configurations matérielles plus simples. La génération rapide de contenu peut également contribuer à déplacer le champ de bataille pour les utilisateurs, des spécifications matérielles vers les modèles d'IA, l'infrastructure informatique et les plateformes de distribution de contenu.

En cas de succès, ce nouveau modèle pourrait ouvrir un nouveau champ de bataille permettant à ByteDance de rivaliser avec Meta et Apple. Meta et Apple ont tous deux investi massivement dans les équipements de réalité virtuelle et de réalité mixte. Meta a tenté de créer un écosystème de marché de masse autour du casque Quest, tandis qu'Apple a positionné Vision Pro comme une plate-forme informatique spatiale haut de gamme. Mais aucune des deux sociétés n’a été en mesure de commercialiser de tels produits sur le marché grand public.

Au moment de mettre sous presse, un porte-parole de ByteDance n'a fait aucun commentaire à ce sujet.

Tags associés

Articles similaires

Commentaires

0/500
Captcha (click to refresh)
Aucun commentaire