Google lance Gemini 4 Argon avec une limite de production d’un million de jetons, en commençant par Cyber Defenders
Google DeepMind a annoncé le 30 septembre Gemini 4 Argon, un nouveau modèle d'IA de pointe conçu pour les tâches longues et complexes en ingénierie logicielle, en cybersécurité défensive et en gestion des connaissances en entreprise.
Selon Google , Argon est d'abord déployé auprès de cyberdéfenseurs agréés via le programme Fairwind de l'entreprise, les niveaux d'API payants pour les développeurs et les abonnés à Google AI Ultra étant prévus ultérieurement.
Gemini 4 Argon n'est actuellement pas disponible pour les utilisateurs de la version gratuite de Gemini, et Google n'a pas communiqué de dates pour les phases de déploiement ultérieures.
Gemini 4 Argon relève la limite de production à 1 million de jetons
Le principal changement technique réside dans le plafond de production. Gemini 4 Argon peut générer jusqu'à 1 million de jetons en une seule exécution, contre 64 000 jetons pour les générations Gemini précédentes.
La capacité de sortie détermine la quantité d'informations qu'un modèle peut traiter et analyser dans une seule réponse ; des limites plus basses l'obligent à raccourcir ses réponses ou à diviser les tâches importantes en fragments.
Google positionne Argon pour les tâches à long terme où le modèle doit conserver le contexte tout au long d'une longue chaîne d'étapes, comme l'audit d'une base de code complète ou la réalisation d'un projet de migration jusqu'à son terme, plutôt que de répondre rapidement à des requêtes ponctuelles.
Comment Google utilise déjà Argon en interne
Google indique avoir déployé Argon au sein de ses équipes d'ingénierie et d'infrastructure. L'entreprise répertorie les déploiements suivants :
- Migration du code C et C++ existant vers Rust, y compris les bibliothèques multimédias principales et plus de 800 000 lignes du noyau Fuchsia Zircon
- Optimisation de la version Rust de libgav1, le décodeur vidéo open source de Google , qui, selon l'entreprise, est désormais 2,7 fois plus rapide avec des performances de sortie identiques.
- L'analyse des données télémétriques des serveurs a permis aux équipes d'agents Argon de découvrir des optimisations de mémoire qui ont libéré plus de 300 téraoctets, avec des économies projetées pouvant atteindre 1 pétaoctet.
Du côté de la sécurité, Google indique qu'Argon a découvert une faille de sécurité critique exposant des données sensibles dans un logiciel hospitalier utilisé dans le monde entier, lors d'une collaboration avec la société de sécurité Wiz dans le cadre de son initiative Scan for Good. Selon l'entreprise, les modèles de pointe précédents n'avaient pas détecté cette faille.
Le déploiement progressif est conditionné par les exigences de calcul et les mesures de sécurité strictes qu'un modèle offrant ce niveau d'autonomie requiert. Les spécialistes de la cybersécurité du programme Fairwind y ont accès avant le grand public des développeurs.
Les développeurs souhaitant utiliser Argon devront disposer d'un abonnement payant à l'API Gemini dès l'ouverture de celle-ci. Les utilisateurs devront quant à eux souscrire Google AI Ultra, les offres Gemini moins onéreuses n'étant pas concernées par le déploiement annoncé.
Ce lancement fait suite à la publication par OpenAI de GPT-6 Sol et Luna en septembre. Google n'a pas encore communiqué le prix de l'API Gemini 4 Argon ni la date de disponibilité de cette dernière dans Google AI Ultra.
Merci de votre fidélité à Ghacks . L'article Google lance Gemini 4 Argon avec une limite de production de 1 million de jetons, en commençant par Cyber Defenders » est paru initialement sur gHacks.
