IA en entreprise : mesurer le retour réel, au-delà de la tendance
Une direction financière conteste rarement l’intérêt de l’IA ; elle conteste le chiffre qu’on lui présente pour le démontrer, et elle a souvent de bonnes raisons de le faire.
Les outils de mesure ne manquent pourtant pas, puisque Microsoft en fournit trois. Ils mesurent en revanche un usage, et un usage n’est pas un retour sur investissement. Confondre les deux revient à présenter un dossier qui ne résistera pas au premier examen sérieux.
Ce que Microsoft mesure pour vous
Le système de contrôle Copilot organise ces capacités en trois volets : sécurité et gouvernance, contrôles de gestion, et mesure et rapports. Ce dernier volet se répartit sur trois surfaces qui ne servent pas la même conversation.
- Les rapports d’usage du centre d’administration donnent des compteurs : utilisateurs équipés, utilisateurs actifs, taux d’actifs, répartition par application, jours actifs par personne, date de dernière activité. Fenêtres de 7, 28, 90 ou 180 jours.
- Le tableau de bord Copilot donne une lecture d’adoption et de ressenti à l’échelle de l’organisation. Il ne demande aucune licence supplémentaire — ni Viva Insights payant, ni licence Copilot pour le consulter.
- Copilot Analytics porte la partie destinée à une direction générale, avec un rapport d’impact métier.
Ces trois surfaces sont solides sur ce qu’elles annoncent : elles comptent des gestes, et elles les comptent bien. Microsoft ne retient comme actif qu’un geste intentionnel — ouvrir un volet ne compte pas, soumettre une demande compte. Le taux affiché n’est donc pas gonflé.
Ce que Microsoft ne mesure pas, et le dit
Le tableau de bord affiche des heures assistées, qui ne constituent pas une mesure du temps gagné. La valeur est obtenue en appliquant aux volumes d’usage des multiplicateurs issus des travaux de recherche de Microsoft, et Microsoft qualifie elle-même ces valeurs d’approximations larges plutôt que de calculs précis. La valeur monétaire dérivée applique ensuite à ces heures un taux horaire par défaut de 72 dollars, tiré d’une statistique du marché du travail américain.
Présenter à une direction financière suisse un gain calculé sur un taux horaire américain par défaut expose à une remise en cause qui ne portera pas seulement sur cette ligne, mais sur la rigueur du dossier entier.
Trois choses restent donc hors de portée de tout rapport, quelle que soit la surface :
- le temps réellement économisé, par métier et par tâche ;
- la qualité de ce qui est produit ;
- le lien de cause à effet entre l’outil et un résultat d’entreprise.
La seule méthode qui produit un chiffre défendable
Microsoft ne cache pas la réponse : le rapport d’impact métier ne devine aucun résultat. Il exige que vous téléversiez vos propres données de résultats, et il fournit la liste des métriques attendues par fonction.
- Vente : taille moyenne des affaires, taux de rétention client, coût par prospect.
- Informatique : nombre de demandes résolues, délai de résolution.
- Ressources humaines : engagement des collaborateurs, taux de rétention.
L’exigence est réelle, et c’est la seule voie qui produise un résultat défendable. Le raisonnement à suivre relève de l’expérimentation plutôt que du tableau de bord :
- Choisissez une fonction et une métrique qu’elle suit déjà, depuis au moins un an.
- Relevez sa valeur avant tout déploiement. Sans point de départ, il n’y a pas de mesure.
- Équipez cette fonction, et une seule.
- Laissez passer deux trimestres. Un trimestre ne suffit pas à sortir du bruit saisonnier.
- Comparez, et cherchez activement les autres explications possibles avant de conclure.
Notre lecture
Notre position va à l’encontre du discours ambiant : dans la plupart des organisations, la mesure du retour sur investissement de l’IA ne vaut pas ce qu’elle coûte.
Monter le dispositif décrit ci-dessus suppose une métrique existante, un point de départ propre, deux trimestres de patience et la discipline de ne pas équiper tout le monde entre-temps. Beaucoup d’entreprises n’ont ni la métrique ni la patience, et produisent alors un chiffre bricolé qu’elles défendent mal, au prix de la confiance de leur direction financière sur un sujet qui, sur le fond, tenait parfaitement debout.
Dans ce cas, nous recommandons de renoncer à la preuve de valeur et de changer de terrain. Défendez un coût par utilisateur actif : c’est un fait, il se produit en une demi-journée, et il permet un arbitrage réel — à ce prix, pour cet usage, on continue ou on réduit. L’ambition est plus modeste que celle d’un retour sur investissement, la solidité est sans commune mesure.
La mesure complète vaut l’effort dans un cas précis : lorsqu’une seule fonction concentre le déploiement et suit déjà une métrique sérieuse. Un service client qui mesure son délai de résolution depuis trois ans peut produire une démonstration crédible. Une entreprise qui a distribué des licences à tout le monde n’y parviendra pas, parce que l’effet y est dilué au point d’être indétectable.
Pour ceux qui ont déjà déployé largement, il n’est pas trop tard, à condition d’accepter de restreindre le périmètre de mesure. Reprenez une fonction, isolez-la et mesurez là. Vous n’obtiendrez pas le chiffre global qu’on vous demande, mais vous obtiendrez un chiffre exact, et c’est celui-là qui fait bouger une décision.
Ce qu’il faut faire
- Décidez maintenant si vous visez une preuve de valeur ou un coût par usage. Les deux sont défendables. Les mélanger ne l’est pas.
- Si vous visez la preuve : choisissez la fonction et la métrique avant de distribuer une seule licence, et relevez le point de départ.
- Ne présentez jamais les heures assistées du tableau de bord comme un résultat mesuré. Nommez-les pour ce qu’elles sont.
- Refusez le taux horaire par défaut. S’il doit servir, remplacez-le par le vôtre.
- Produisez le taux d’utilisateurs actifs sur 90 jours à chaque comité. C’est le chiffre qui déclenche les bonnes questions.
- Gardez deux trimestres de patience avant toute conclusion.
Le montage de ce dispositif ne demande aucun outil que vous n’ayez déjà ; il demande de choisir la métrique et de tenir la discipline pendant six mois. Lambert Consulting peut poser ce cadre de mesure avec la fonction concernée et arbitrer, honnêtement, s’il vaut la peine d’être monté chez vous. Les usages qui produisent un effet dès le premier mois et le relevé des processus candidats sont les deux entrées les plus fréquentes vers cette question.
Les sources Microsoft
Ce qu'un article ne peut pas savoir
Un article décrit ce qui vaut pour tout le monde. Ce qui change d'une organisation à l'autre, c'est l'inventaire : quelles applications, quels comptes, quels équipements sont réellement concernés chez vous. C'est l'inventaire qui décide de l'effort, et il ne se répond pas sur une page.
Vous parlez aux ingénieurs qui feraient le travail, pas à un intermédiaire. Réponse sous 24 heures ouvrées.
Vérifier ce qui est encore vrai
Les dates annoncées sont parfois repoussées, les produits changent de nom, les conditions évoluent. Le blog suit ces sujets au fil du temps : quand une règle change, un nouvel article le dit.
Chercher un sujet dans le blogDans le même dossier
Trois articles du même sujet. Le blog en compte 149, tous en accès libre.

