Présentation du modèle Gemini 4 Argon
Google a annoncé le modèle d'IA Gemini 4 Argon, qualifié d'« industry‑leading » pour le codage, le travail de connaissance et la cybersécurité. Le modèle accepte jusqu'à 1 million de tokens en entrée, ce qui représente une capacité de contexte largement supérieure aux modèles précédents.
Performances et usages internes
Les ingénieurs de Google utilisent déjà Argon pour migrer des bases de code C/C++ vers Rust, démontrant une capacité à analyser et réécrire du code à grande échelle. Le même modèle est exploité dans des tâches de cybersécurité, où il aide à identifier des vulnérabilités dans des rapports techniques grâce à son large champ lexical.
Tarification et disponibilité
Google propose une tarification temporaire de 2 $ par million de tokens d'entrée et 10 $ par million de tokens de sortie. Cette offre est limitée à la phase de test et ne s'applique pas encore aux clients grand public ou aux entreprises. Le modèle reste en limited testing et aucune date de lancement officiel n’a été communiquée.
Analyse des implications
Le plafond de 1 M de tokens permet des dialogues ou des analyses de documents très longs sans fragmentation, mais augmente proportionnellement le coût d’utilisation. À 10 $ le million de tokens de sortie, un traitement de 100 k tokens coûterait environ 1 $, ce qui reste abordable pour des prototypes mais peut devenir un facteur limitant pour des déploiements massifs. L’absence d’une feuille de route claire crée une incertitude pour les développeurs qui souhaitent intégrer Argon dans des produits commerciaux. Enfin, la mise à disposition interne uniquement indique que Google teste la robustesse du modèle avant d’envisager une exposition plus large, notamment en matière de sécurité des données et de conformité aux politiques de confidentialité.