Introduction
Juillet 2026 confirme une tendance de fond : le paysage des modèles d'IA générative devient quasi permanent, avec des sorties quasi mensuelles. Pour les administrateurs Microsoft 365 et Azure, l'enjeu n'est plus de suivre chaque nouveauté mais de savoir où et comment router intelligemment les requêtes vers le bon modèle, selon la complexité, la latence attendue et le coût. Cette mise à jour couvre les nouveaux modèles disponibles sur les plateformes Microsoft, les évolutions de Microsoft Foundry, de Copilot Studio, de Microsoft 365 Copilot et de GitHub Copilot.
Bon à savoir
Le choix du modèle ne doit plus se limiter au plus puissant disponible. La plupart des scénarios métier nécessitent un niveau de raisonnement modéré : pensez routage multi-modèles plutôt que sélection unique.
Nouveaux modèles disponibles sur les plateformes Microsoft
GPT-5.6 d'OpenAI arrive sur la majorité des plateformes Microsoft, décliné en trois niveaux :
- Sol : raisonnement avancé, résolution de problèmes complexes.
- Terra : équilibre entre intelligence, vitesse et coût.
- Luna : interactions temps réel, expériences à forte volumétrie.
Ces trois variantes sont disponibles dans Microsoft 365 Copilot Chat, Cowork, ainsi que dans Copilot pour Word, Excel et PowerPoint, avec sélection automatique du modèle le plus adapté. Côté GitHub Copilot, l'accès est conditionné par le plan : Sol nécessite Copilot Pro Plus ou supérieur, tandis que Terra et Luna sont accessibles dès Copilot Pro. GPT-5.6 est également exposé dans Microsoft Foundry, avec les briques de sécurité, gouvernance et évaluation propres à la plateforme.
Foundry accueille aussi GPT transcribe et GPT live transcribe, deux modèles de reconnaissance vocale automatique (ASR) haute précision :
- GPT transcribe traite des fichiers audio complets (enregistrements de réunion, messagerie vocale, médias).
- GPT live transcribe fonctionne en streaming basse latence, pour des cas d'usage type assistant vocal ou sous-titrage en direct.
Les deux gèrent mieux le bruit de fond, les chuchotements, la parole à faible volume, les changements de langue et les séquences alphanumériques.
Microsoft AI publie deux nouveaux modèles propriétaires :
- MAI Image 2.5 Pro : fidélité visuelle maximale, meilleur contrôle créatif, forte cohérence des objets entre images générées.
- MAI Voice 2 Flash : conçu pour les applications vocales à très faible latence, disponible en 15 langues, adapté aux centres d'appels et assistants vocaux.
Le versant Anthropic évolue avec Claude Opus 5, qui succède à Opus 4.8 avec un saut de capacité significatif, pour environ la moitié du coût de Fable 5 (le modèle haut de gamme du mois précédent). Opus 5 cible le raisonnement profond et les tâches longues, et se déploie dans Foundry, Microsoft 365 Copilot (Chat, Cowork), Copilot Studio, GitHub Copilot et Azure Databricks.
Du côté open-weight, Kimi K3 de Moonshot arrive dans Foundry via le moteur d'inférence Fireworks AI, avec 2,8 billions de paramètres et une fenêtre de contexte de 1 million de tokens, en déploiement de type data zone.
Enfin, GitHub Copilot ajoute Grok 4.5 (codage agentique rapide, workflows multi-étapes, fenêtre de contexte jusqu'à 500 000 tokens, entrées texte et image, effort de raisonnement configurable bas/moyen/haut) et Gemini 3.6 Flash (développement web et code, tâches longues, usage parallèle d'outils). Les deux sont réservés aux plans Pro et supérieurs.
| Modèle | Usage principal | Disponibilité clé |
|---|---|---|
| GPT-5.6 Sol | Raisonnement avancé | Copilot Pro Plus et Foundry |
| Claude Opus 5 | Raisonnement profond, tâches longues | Foundry, M365 Copilot, GitHub Copilot, Azure Databricks |
| Kimi K3 | Contexte étendu (1M tokens) | Foundry via Fireworks AI |
| Grok 4.5 | Codage agentique complexe | GitHub Copilot Pro et plus |
| MAI Voice 2 Flash | Voix temps réel, 15 langues | Microsoft AI natif |
Microsoft Foundry : gouvernance, ROI et nouveau portail
La plateforme Microsoft Foundry reçoit plusieurs améliorations structurantes pour les équipes en charge de la production d'agents.
Mesurer le retour sur investissement des agents
En private preview, le suivi du ROI pour les agents répond à une question récurrente : l'agent apporte-t-il une valeur métier proportionnée à son coût ? Le mécanisme s'appuie sur les données de trace App Insights, passées dans un évaluateur de valeur métier (satisfaction client, taux de complétion de tâche, ou évaluateurs personnalisés). Chaque interaction qui satisfait cet évaluateur est mappée à une valeur métier définie par l'organisation, consultable ensuite dans les tableaux de bord.
Résidence des données et nouveau portail
La data zone APAC passe en disponibilité générale (GA), rejoignant les zones US et Europe déjà existantes. Cela permet de déployer des modèles au-delà d'une seule région tout en respectant une contrainte de résidence régionale, en complément des options globales déjà disponibles.
Le nouveau portail Foundry, orienté projet, atteint également la GA. Il couvre l'ensemble du cycle de vie : découverte, construction, exploitation, avec gestion complète des déploiements de modèles, évaluations, fine-tuning, garde-fous, mémoire, outillage et bacs à sable d'expérimentation.
Traçabilité renforcée des données sensibles
La fonctionnalité de sensitive trace content handling (preview) isole les données générées par l'IA — prompts, réponses, system prompt, appels d'outils — dans une table dédiée du Log Analytics Workspace, utilisée par App Insights. Cette table applique un contrôle d'accès basé sur les rôles (RBAC) distinct, avec un accès refusé par défaut.
Attention
Si votre organisation exploite déjà App Insights pour le monitoring d'agents, vérifiez l'attribution des rôles RBAC sur cette nouvelle table dédiée : sans configuration explicite, personne n'y accède, y compris les équipes qui géraient auparavant les traces standard.
Copilot Studio : Foundry IQ et harnais GitHub Copilot
Foundry IQ entre en preview dans Copilot Studio. Le principe : constituer une base de connaissances institutionnelle curée à partir d'une ou plusieurs sources (comptes de stockage, sites SharePoint, etc.). À la réception d'une requête, le moteur détermine quelles sources interroger et formule une requête spécifique par source, plutôt que d'envoyer la question brute à l'ensemble des sources. Cette capacité complète l'existant Work IQ (comment vous travaillez) et Fabric IQ (l'état de votre activité).
Autre nouveauté notable : le harnais GitHub Copilot devient disponible comme option dans Copilot Studio. Rappel : un harnais définit la façon dont un agent interagit avec les compétences, outils, connaissances et garde-fous — il permet notamment les boucles agentiques longues. Ce harnais ouvre l'accès aux capacités de codage de GitHub Copilot, avec des modèles comme Opus 5, GPT-5.6 Sol ou Fable 5.
Copilot Studio propose désormais trois choix de harnais :
| Harnais | Cas d’usage | Facturation |
|---|---|---|
| Copilot Chat | Personnalisation de l’expérience Copilot Chat | Standard |
| Standard | Agents conversationnels à base de règles (majorité des cas) | Standard |
| GitHub Copilot | Processus métier autonomes et complexes | Facturation à la consommation |
Le flux de conception combine un concepteur d'agent intuitif et un concepteur de workflow visuel, avec intégration de l'évaluation en amont.
Microsoft 365 Copilot : productivité augmentée
Dans Copilot Chat, il devient possible de mentionner directement les agents Word, Excel et PowerPoint via @Word, @Excel ou @PowerPoint, pour créer un document, une feuille de calcul ou une présentation sans quitter la conversation.
Copilot dans Word gagne la prise en charge du suivi des modifications (track changes), ce qui facilite la revue collaborative, ainsi que des capacités de rédaction assistée : génération de table des matières, modification d'en-têtes et de pieds de page. Excel et PowerPoint peuvent désormais exploiter les brand kits du M365 Brand Center, pour des résultats alignés sur la charte graphique de l'organisation.
Côté Teams, les récapitulatifs de réunion (meeting recaps) passent en GA et sont accessibles via une recherche directe dans la barre d'applications. L'application Microsoft 365 Copilot sur mobile (iOS et Android) prend en charge les notifications push, redirigeant directement l'utilisateur vers l'élément concerné.
Autre avancée notable : les tâches déclenchées par événement. Jusqu'ici, une tâche Copilot se programmait sur une base temporelle. Il est désormais possible de la déclencher sur un événement : réception d'un e-mail, message Teams d'une personne précise, ou mention dans un canal Teams.
Enfin, Cowork passe en GA sur son support de compétences enrichies : import d'un fichier skill.md, ou création guidée d'une nouvelle compétence pour enrichir l'environnement de travail.
Astuce
Si votre organisation utilise déjà des tâches planifiées Copilot, testez les déclencheurs événementiels sur un scénario simple (mention Teams) avant de les généraliser : le comportement diffère des automatisations Power Automate classiques.
GitHub Copilot : capture de compétences et navigation web
Le dépôt skill-recorder (github.com/microsoft/skill-recorder) introduit un enregistreur de compétences pour GitHub Copilot. Il capture l'écran et l'activité pendant l'exécution d'une tâche (clics, changements de fenêtre, interactions applicatives), avec possibilité de narration vocale via une barre de contrôle audio dédiée. L'outil s'appuie ensuite sur le GitHub Copilot CLI pour analyser l'intention et la séquence d'étapes, puis génère, après validation, un fichier skill.md ou une automatisation programmable, réutilisable dans différents écosystèmes d'agents.
Copilot Vision passe en GA : images et PDF peuvent être joints directement aux prompts de chat, pour un raisonnement combinant contexte visuel et code. Les outils de navigateur pour Copilot dans VS Code atteignent également la GA : un agent peut piloter un navigateur réel, naviguer sur une application web live, cliquer, saisir, inspecter, capturer des erreurs et prendre des captures d'écran.
API Management : un palier dédié à l'IA
Azure API Management introduit un palier AI Gateway, spécifique aux scénarios IA : modèles, serveurs MCP (Model Context Protocol), outils. Il permet de transformer un ensemble d'opérations REST en serveur MCP, ou d'agréger plusieurs serveurs MCP pour les exposer comme un seul point d'entrée. Ce palier ne se limite pas aux modèles hébergés dans Microsoft Foundry : il fonctionne aussi avec des modèles hébergés sur AWS, Google, OpenAI ou Anthropic, et remonte des métriques complètes d'utilisation de tokens via OpenTelemetry.
Points clés à retenir
- GPT-5.6 (Sol, Terra, Luna) se déploie sur M365 Copilot, GitHub Copilot et Foundry, avec des seuils de licence différenciés selon le niveau.
- Claude Opus 5 offre un rapport performance/coût amélioré face à Fable 5, pour le raisonnement profond.
- La data zone APAC et le nouveau portail Foundry passent en GA, tandis que le ROI pour agents reste en private preview.
- Copilot Studio gagne un harnais GitHub Copilot à facturation à la consommation, en plus des harnais Chat et Standard.
- Microsoft 365 Copilot simplifie la création de contenu via mention directe des agents Office et introduit les tâches déclenchées par événement.
- Le nouveau palier AI Gateway d'API Management centralise la gouvernance des serveurs MCP, multi-cloud compris.
Pour approfondir la gouvernance des modèles multiples évoquée en introduction, la documentation officielle de Microsoft Foundry et de Copilot Studio constitue une base de référence à consulter avant tout déploiement en production.



