Google a annoncé le lancement de Gemini 3.7 Flash, le dernier modèle de la série Flash, axé sur la programmation, les agents intelligents et les flux de travail complexes. Selon l’entreprise, le nouveau modèle apporte des améliorations importantes en ingénierie logicielle, en développement web et dans les tâches cognitives. Il arrive seulement trois semaines après le lancement de Gemini 3.6 Flash, à la suite des retours des développeurs et d’innovations algorithmiques dont Google affirme qu’elles profiteront à ses futurs modèles.
Gemini 3.7 Flash est proposé à un tarif de lancement de 0,75 dollar par million de jetons d’entrée et de 3,75 dollars par million de jetons de sortie jusqu’à la fin de 2026. À compter du 1er janvier 2027, le prix passera à 1,50 dollar par million de jetons d’entrée et à 7,50 dollars par million de jetons de sortie.
Améliorations de la programmation et du développement web
Selon Google, le nouveau modèle progresse par rapport à Gemini 3.6 Flash dans des tâches de programmation comme le débogage et la résolution de problèmes, avec une meilleure précision dès la première tentative et une capacité accrue à générer du code prêt pour la production. Dans les tests cités par l’entreprise, Gemini 3.7 Flash a obtenu 43,6 % contre 34,4 % pour le modèle précédent dans FrontierCode 1.1 Main, et 65,3 % contre 49,0 % dans DeepSWE v1.1.
Dans le développement web, le modèle peut créer des interfaces plus utilisables et des applications complètes dotées de toutes leurs fonctionnalités avec moins de requêtes. Les tâches de génération d’interfaces utilisateur ont également montré une meilleure conformité au design de référence, qu’il s’agisse d’une capture d’écran, d’une image ou d’un système de design complet. Le modèle a obtenu 1588 points Elo dans le classement WebDev Arena d’Arena.ai, contre 1538 points pour Gemini 3.6 Flash.
Meilleures performances dans les connaissances et les flux de travail
Google affirme que Gemini 3.7 Flash offre un meilleur raisonnement et une meilleure précision dans les domaines à forte densité de connaissances, comme la finance, le droit et les sciences de la vie. Dans le test GDP.pdf consacré au traitement de documents complexes, le modèle a obtenu 34,0 % contre 22,0 % pour le modèle précédent. Il a également enregistré 30,4 % contre 17,0 % dans AutomationBench, une évaluation de l’accomplissement de tâches professionnelles réelles.
Du point de vue de l’expérience développeur, l’entreprise affirme que le modèle s’adapte mieux aux obstacles, demande des précisions sur l’intention lorsque cela est nécessaire et suit les instructions avec davantage de précision. Il consacre également plus d’efforts à la planification en plusieurs étapes et à l’appel d’outils, ce qui pourrait réduire le besoin de supervision manuelle et de nouvelles tentatives dans les flux de travail d’ingénierie.
Disponibilité et utilisation dans Gemini Spark
Gemini Spark, disponible pour les abonnés Google AI Pro et Ultra dans plus de 160 pays, a commencé à utiliser Gemini 3.7 Flash. Google avait présenté Spark lors de la conférence I/O comme un agent personnel d’intelligence artificielle fonctionnant en continu et exécutant des actions sous la direction de l’utilisateur. Selon l’entreprise, la mise à jour du modèle aide Spark à effectuer plus efficacement les tâches de connaissance, tout en améliorant l’utilisation des outils des applications Google Workspace et la précision des résultats dans les tâches complexes faisant appel à plusieurs compétences.
Les développeurs peuvent essayer le modèle via Google Antigravity ou l’API Gemini, par l’intermédiaire de Google AI Studio et d’Android Studio. Il est également disponible pour les entreprises via Gemini Enterprise Agent Platform et l’application Gemini Enterprise. Les particuliers peuvent y accéder via Spark dans l’application Gemini, pour les abonnés Google AI Pro et Ultra dans les pays pris en charge.
Contrôles de sécurité
Gemini 3.7 Flash est commercialisé avec des mises à jour de ses contrôles de protection contre les abus dans les domaines chimique, biologique, radiologique et nucléaire, ainsi que contre les abus cybernétiques, tandis que Google continue de développer la couverture et la robustesse de ces contrôles. L’entreprise renvoie à la fiche du modèle pour obtenir davantage d’informations détaillées.