Alphabet a dévoilé mardi trois nouveaux modèles Gemini, y compris sa réponse la plus claire au leadership d'Anthropic en matière de cybersécurité. L'entreprise cherche à démontrer ses progrès alors qu'elle est confrontée à des retards dans ses gammes de produits et à une concurrence accrue.

Gemini 3.5 Flash Cyber ​​​​est conçu pour détecter et corriger les vulnérabilités logicielles et sera initialement disponible uniquement pour les gouvernements et les partenaires de confiance via un programme pilote à accès limité. Google affirme que ce modèle spécialisé est moins cher au mot que les modèles plus grands. Cela aide Google à combler le fossé en matière de cybersécurité avec Anthropic, qui a pris une longueur d'avance en matière de défense automatisée des codes.

Google a également lancé Gemini 3.6 Flash, qui a amélioré les performances d'encodage, de multimodal et de travail de connaissances, tout en utilisant jusqu'à 17 % de jetons en moins que le modèle de génération précédente et un coût unitaire par jeton inférieur, ce qui signifie une réduction significative des coûts pour l'exécution de charges de travail à haut débit.

Gemini 3.5 Flash-Lite, quant à lui, est le modèle le plus rapide et le moins coûteux de la série 3.5 de Google, conçu pour les charges de travail à haut débit et les petites tâches dans les grands systèmes d'agents d'IA. Cette gamme de produits plus large reflète le pari de Google selon lequel le prix et l'efficacité aideront à compenser le ralentissement de son déploiement dans plusieurs catégories de produits clés.

Les données d'analyse artificielle montrent que Gemini Flash est déjà moins coûteux que les modèles comparables d'Anthropic, OpenAI et des concurrents chinois. Selon Google, le plus performant des deux nouveaux modèles, le Gemini 3.6 Flash, coûte moins cher par tâche que le GPT-5.6 Terra Max, le Kimi K3 et le Qwen 3.7 Max, tandis que le 3.5 Flash-Lite coûte une fraction de ce prix.

Cette demande met en évidence une autre facette de la course à l’IA : construire des modèles compétitifs n’est qu’une partie du défi ; les entreprises ont également besoin de suffisamment de puissance de calcul pour fournir des services à grande échelle. Google dispose d'un avantage potentiel grâce à sa capacité à personnaliser les puces, l'infrastructure cloud et à co-élaborer des logiciels et du matériel, bien que l'entreprise soit confrontée à ses propres contraintes de capacité.

Le lancement du modèle mardi intervient alors que Google serait en train de développer une puce spécialisée conçue pour permettre à Gemini de fonctionner jusqu'à 10 fois plus efficacement, dans le cadre de ses efforts plus larges visant à réduire le coût des services d'intelligence artificielle. Un porte-parole de Google Cloud a déclaré dans un communiqué que son équipe "continue de rechercher et d'essayer de nouvelles innovations pour offrir des performances et une efficacité maximales à nos utilisateurs et clients" et que "même si tous les projets n'atteindront pas la production, cette exploration rigoureuse est au cœur de notre approche full-stack". "En co-concevant notre matériel et nos logiciels à partir de zéro, nous garantissons que nos systèmes sont intégrés et hautement optimisés pour les charges de travail du monde réel", poursuit le communiqué.

Google rend également sa feuille de route produit plus transparente après avoir été confronté à des questions sur les retards. Gemini 3.5 Pro est actuellement testé avec des partenaires en vue d'une version plus large, tandis que la société a lancé sa plus grande série de pré-formation Gemini 4 jamais réalisée.