Intelligence artificielle

Modèles génératifs, agents, recherche, applications et infrastructure de l’intelligence artificielle.

37 Articles

Dario Amodei : le rejet de l’IA est une crise de confiance, pas une crise de communication

Intelligence artificielle

Dario Amodei : le rejet de l’IA est une crise de confiance, pas une crise de communication

Le PDG d’Anthropic, Dario Amodei, a refusé de rendre les avertissements des dirigeants de l’intelligence artificielle responsables de la montée du scepticisme du public et du durcissement de la réglementation, estimant que le problème plus profond réside dans une crise de confiance accumulée entre le public, les entreprises et les gouvernements. Amodei a défendu la réglementation du secteur de l’intelligence artificielle, affirmant que des règles appropriées pourraient limiter les risques de la technologie et l’influence des grandes entreprises sans fermer la voie aux concurrents ni aux modèles à poids ouverts.

2026-08-16

Microsoft présente Foundry Agent Service pour exécuter des agents d’IA sur Azure

Intelligence artificielle

Microsoft présente Foundry Agent Service pour exécuter des agents d’IA sur Azure

Microsoft propose Foundry Agent Service comme une plateforme gérée destinée à créer des agents d’intelligence artificielle et à les exécuter à l’échelle de l’entreprise, avec un environnement d’exécution isolé ainsi que des fonctionnalités d’identité, de mémoire, de supervision et de gouvernance. Le service prend en charge les frameworks et les modèles choisis par les développeurs, et permet de connecter les agents aux connaissances, aux outils de l’entreprise, puis de les déployer dans Microsoft Teams et Microsoft 365 Copilot.

2026-08-15

Microsoft Foundry Control Plane pour la gestion des agents d’IA à l’échelle des entreprises

Intelligence artificielle

Microsoft Foundry Control Plane pour la gestion des agents d’IA à l’échelle des entreprises

Microsoft propose, via Foundry Control Plane, une couche d’exploitation et de gouvernance pour les agents d’intelligence artificielle, combinant traçabilité, évaluation, contrôles à l’exécution, identité, sécurité et gestion des flottes. Le produit prend en charge les agents construits dans Microsoft Foundry, ainsi que les agents provenant d’autres systèmes via la passerelle d’intelligence artificielle et OpenTelemetry.

2026-08-15

CohereLabs lance le modèle North Micro Vision à poids ouverts pour le traitement des images à leur résolution native

Intelligence artificielle

CohereLabs lance le modèle North Micro Vision à poids ouverts pour le traitement des images à leur résolution native

CohereLabs a lancé le modèle North-Micro-Vision-Instruct, un modèle de vision et de langage à poids ouverts comprenant 2,4 milliards de paramètres et prenant en charge le traitement des images à leur résolution native, sous licence Apache 2.0. Le modèle cible les applications de compréhension des documents et des diagrammes, l’OCR et l’ajustement personnalisé. Il inclut également une prise en charge communautaire de MLX-VLM et une recette AutoModel pour le déploiement sur les unités de traitement graphique de NVIDIA.

2026-08-14

Qu’est-ce que l’ingénierie du contexte de l’IA ? Et pourquoi pourriez-vous l’acheter plutôt que la construire ?

Intelligence artificielle

Qu’est-ce que l’ingénierie du contexte de l’IA ? Et pourquoi pourriez-vous l’acheter plutôt que la construire ?

Doug Whitley et Ash Zade de Stack Overflow expliquent comment l’ingénierie du contexte de l’IA contribue à limiter les informations accessibles aux agents, à améliorer la prévisibilité des résultats et à gérer la mémoire, les autorisations et les informations contradictoires. Selon les deux intervenants, il est possible de construire ce système en interne, mais cela exige de résoudre des problèmes techniques et philosophiques liés à la confiance, à la qualité des données et à la détermination de ce que l’agent doit faire lorsque les informations sont absentes ou contradictoires.

2026-08-14

Z.ai lance GLM-5.3 doté de capacités avancées en programmation et en cybersécurité

Intelligence artificielle

Z.ai lance GLM-5.3 doté de capacités avancées en programmation et en cybersécurité

La start-up chinoise d’intelligence artificielle Z.ai a lancé le modèle GLM-5.3, qui repose sur l’extension de l’entraînement postérieur du modèle GLM-5.2 plutôt que sur la construction d’un nouveau modèle de base. L’entreprise affirme que ses capacités cybernétiques ont détecté une vulnérabilité potentiellement grave dans Cursor, tandis que la disponibilité initiale sera limitée à GLM Coding Plan et à l’environnement ZCode, jusqu’à l’achèvement des évaluations de sécurité.

2026-08-14

Google lance Gemini 3.7 Flash pour améliorer la programmation et les agents intelligents

Intelligence artificielle

Google lance Gemini 3.7 Flash pour améliorer la programmation et les agents intelligents

Google a présenté Gemini 3.7 Flash comme le modèle le plus puissant de sa série Flash à ce jour pour la programmation et la création d’agents, avec des améliorations dans le développement web et les flux de travail cognitifs, ainsi qu’un tarif de lancement équivalant à la moitié du coût initial de Gemini 3.6 Flash. Le modèle est disponible pour les développeurs et les entreprises, et a également commencé à être utilisé dans l’agent Gemini Spark pour les abonnés éligibles.

2026-08-13

AX-Ray révèle des défauts de fuite causale dans deux modèles publics d’IA

Intelligence artificielle

AX-Ray révèle des défauts de fuite causale dans deux modèles publics d’IA

Le projet AX-Ray de VIDRAFT présente une méthode d’évaluation des modèles qui va au-delà des scores de performance, après avoir identifié et reproduit des défauts décrits comme une fuite causale dans les modèles Zyphra/Zamba2-1.2B et nvidia/Nemotron-H-8B-Base-8K. Le cadre classe ces cas parmi les défauts empêchant le déploiement, tout en les distinguant des problèmes liés au chemin de service ou à l’interface de programmation d’application.

2026-08-13

IBM collabore avec OpenAI pour étendre les solutions d’intelligence artificielle destinées aux entreprises

Intelligence artificielle

IBM collabore avec OpenAI pour étendre les solutions d’intelligence artificielle destinées aux entreprises

IBM a annoncé un partenariat avec OpenAI visant à commercialiser des solutions communes d’intelligence artificielle et à développer des applications spécialisées pour plusieurs secteurs, tout en formant et en certifiant des dizaines de milliers de ses consultants aux technologies d’OpenAI. IBM intégrera les modèles et les outils d’OpenAI, notamment GPT-5.6, Codex et ChatGPT Work, à la plateforme IBM Consulting Advantage.

2026-08-13

Un test d’Anthropic révèle des conflits et des collusions entre agents d’intelligence artificielle

Intelligence artificielle

Un test d’Anthropic révèle des conflits et des collusions entre agents d’intelligence artificielle

Une étude menée par l’équipe Frontier Red Team d’Anthropic montre que les agents d’intelligence artificielle peuvent entrer en compétition, colluder et prendre des décisions collectives dangereuses lorsqu’ils travaillent sur la même tâche ou dans le même environnement. Ces résultats soulèvent des questions sur la capacité des tests de sécurité actuels à évaluer les interactions entre plusieurs agents, et pas seulement le comportement d’un agent isolé.

2026-08-13

Le plan de 500 milliards de dollars de Nvidia parie sur un marché secondaire des anciennes unités de traitement graphique

Intelligence artificielle

Le plan de 500 milliards de dollars de Nvidia parie sur un marché secondaire des anciennes unités de traitement graphique

Julie Bort estime que le projet de Nvidia visant à attirer jusqu’à 500 milliards de dollars de financement pour construire des centres de données dédiés à l’intelligence artificielle dissimule un pari plus vaste : créer un marché actif pour les puces d’occasion et préserver leur valeur à mesure qu’elles vieillissent. Le plan pourrait élargir les sources de financement des infrastructures, mais il expose l’entreprise à des risques croissants si la demande en intelligence artificielle recule.

2026-08-13

Google lance Gemini 3.7 Flash pour le codage et les agents, avec une réduction temporaire de 50 % des prix de l’API

Intelligence artificielle

Google lance Gemini 3.7 Flash pour le codage et les agents, avec une réduction temporaire de 50 % des prix de l’API

Google a lancé le modèle Gemini 3.7 Flash avec des améliorations dans le codage, la planification des tâches, l’appel d’outils et les flux de travail d’entreprise, tout en réduisant de moitié les prix de l’API jusqu’à la fin de 2026. Le modèle est désormais disponible via un ensemble de services Google pour les développeurs, les entreprises et les abonnés, mais les résultats des tests ne montrent pas qu’il surpasse ses concurrents dans tous les usages.

2026-08-13

DeepSeek lance V4-Pro et Harness open source pour concurrencer les outils de programmation agentiques

Intelligence artificielle

DeepSeek lance V4-Pro et Harness open source pour concurrencer les outils de programmation agentiques

DeepSeek a lancé la version officielle de son modèle V4-Pro, parallèlement à l’aperçu open source de DeepSeek Harness, afin d’étendre sa présence de la couche des modèles à l’infrastructure qui gère les outils des agents de programmation. Cette initiative s’accompagne de la prise en charge de Responses API et de Codex, mais aussi de fortes hausses des prix de l’API selon les périodes de pointe.

2026-08-13

Writer lance Palmyra X6 pour réduire de 52 % le coût des agents d’intelligence artificielle

Intelligence artificielle

Writer lance Palmyra X6 pour réduire de 52 % le coût des agents d’intelligence artificielle

Writer a annoncé son nouveau modèle Palmyra X6, ainsi qu’une couche d’orchestration repensée et des outils de gouvernance permettant de surveiller la consommation de jetons et les dépenses des agents. L’entreprise affirme que l’association du modèle et de la plateforme réduit les coûts de 52 % en moyenne, tout en améliorant la vitesse de 48 % et la qualité de 10 %.

2026-08-13

Le surentraînement extrême des petits modèles de langage dégrade les performances après 20 milliards de tokens

Intelligence artificielle

Le surentraînement extrême des petits modèles de langage dégrade les performances après 20 milliards de tokens

Une expérience publiée sur Hugging Face montre qu’un modèle comptant 0,9 million de paramètres a atteint son pic de performances après un entraînement sur 20 milliards de tokens, avant de reculer progressivement à mesure que l’entraînement se poursuivait jusqu’à 180 milliards de tokens. Les résultats suggèrent une fourchette pratique comprise entre 22 000 et 30 000 tokens par paramètre pour les modèles de très petite taille, avec la nécessité de procéder à une évaluation avant d’augmenter le budget.

2026-08-12

Twitch active automatiquement l’utilisation du contenu des créateurs pour entraîner les modèles d’IA d’Amazon

Intelligence artificielle

Twitch active automatiquement l’utilisation du contenu des créateurs pour entraîner les modèles d’IA d’Amazon

Twitch a commencé à utiliser le contenu des créateurs, notamment les enregistrements audio et vidéo, pour contribuer à l’entraînement des modèles d’intelligence artificielle générative d’Amazon, en leur accordant une possibilité de retrait plutôt qu’en demandant leur consentement préalable. Cette décision a suscité une large opposition au sein de la communauté de la plateforme, tandis qu’un responsable de Twitch n’a pas pu confirmer si certains contenus avaient déjà été utilisés pour l’entraînement.

2026-08-12

Au-delà du score global : comment les différences entre les pays révèlent la fiabilité des modèles de détection des épis de blé

Intelligence artificielle

Au-delà du score global : comment les différences entre les pays révèlent la fiabilité des modèles de détection des épis de blé

La réévaluation de neuf modèles de détection des épis de blé montre que la mAP moyenne globale peut masquer d’importantes différences de performance entre les pays. La Chine arrive en tête pour tous les modèles, tandis que les zones de faiblesse diffèrent entre YOLO et RF-DETR, ce qui rend indispensable la mesure du transfert entre domaines avant le déploiement sur le terrain.

2026-08-11