Skip to content
Ancien logo de Centrale Marseille, avec le C orange et le globe bleu
Centrale Marseille, le logo historique
Logo de Centrale Méditerranée
Centrale Méditerranée, le logo actuel

DDEFI · Côté terrain

L'IA générative en finance : ce qui tourne pour de vrai

Tout le monde a un POC. Beaucoup moins de monde a un outil en production que des gens ouvrent le lundi matin. Voici ceux qui ont publié des chiffres, ce qui a cassé, et ce qu'on attend d'un ingénieur là-dedans.

Par Sitraka Forler · Enseignant, Durham Business SchoolMis à jour le 3 octobre 2026 À propos du site

Question : « Le résultat net 2025 de la Banque Imaginaire est de  ?  »

  • 1,2 milliard d’euros32 %
  • 980 millions d’euros26 %
  • 2,4 milliards d’euros19 %
  • 850 millions d’euros15 %
  • en nette hausse8 %
  • [je ne sais pas]0 %

Banque, chiffres et probabilités inventés pour la démonstration. Le mécanisme, lui, est le vrai : un softmax sur des scores, divisé par la température.

Commencez par jouer avec la démo du haut : cliquez sur « Tirer un mot » plusieurs fois, puis fournissez le document et recommencez. Tout ce qui suit sur cette page est une conséquence de ce que vous venez de voir.

200 000

utilisateurs de LLM Suite chez JPMorgan, huit mois après le lancement [2]

98%

des équipes de conseillers de Morgan Stanley ont adopté l'assistant interne [1]

61%

des cas d'usage d'IA recensés au Luxembourg sont de l'IA générative [10]

81%

d'échecs sur FinanceBench avec un index commun à tous les documents [13]

D'abord, de quoi on parle

Version gamin

Un LLM, c'est le collègue qui a lu toute la bibliothèque et qui ne dit presque jamais « je ne sais pas ». Très utile pour préparer une réunion. Très dangereux si vous le laissez y aller seul.

Version ingénieur

Un modèle auto-régressif : il estime p(mot suivant | contexte) et on échantillonne. Sa fonction de perte ne connaît ni « vrai » ni « faux », seulement « probable ». D'où le RAG : on glisse les bons documents dans le contexte et on exige des citations.

p(moti) = exp(si / T) / Σj exp(sj / T)
Le softmax avec température. T petit : on prend presque toujours le mot le plus probable. T grand : tout devient possible, y compris n'importe quoi. C'est le curseur de la démo.

Question éclair

À température très basse, que fait le modèle ?

Qui a quoi en production

Je n'ai gardé que les entreprises qui ont publié elles-mêmes des chiffres. Les « on m'a dit que chez X », je les garde pour la pause café.

Morgan Stanley98 % des équipes de conseillers en gestion de fortune ont adopté l'assistant interne. L'outil Debrief prend les notes d'un rendez-vous client (avec son accord), prépare le mail de suivi et range le tout dans le CRM. [1]
JPMorgan ChaseLLM Suite, la plateforme interne : de zéro à 200 000 utilisateurs en huit mois. [2]
BBVA3 000 licences ChatGPT Enterprise. Cinq mois plus tard, 83 % des détenteurs s'en servent chaque semaine, et ils ont fabriqué près de 3 000 assistants maison. [3]
BNP ParibasPartenariat pluriannuel avec Mistral AI depuis juillet 2024, puis une plateforme interne « LLM as a Service » hébergée dans les centres de données du groupe. [4][5]
Groupe BPCELa moitié des 100 000 collaborateurs utilise l'assistant MAiA, en moyenne 40 fois par mois. [6]
AXA et AllianzAXA Secure GPT a démarré avec 1 000 collaborateurs en 2023, avec les 140 000 du groupe comme cible. AllianzGPT compte plus de 60 000 utilisateurs actifs. [7][8]
INGLa part des conversations client réglées par le chatbot sans humain : 46 % en 2023, 54 % en 2024, 75 % en 2025. [9]

Regardez bien la liste. C'est presque partout le même produit : un assistant interne branché sur les documents de la maison. Aucun robot trader là-dedans. Désolé pour ceux qui espéraient haha.

Le cas Klarna, à raconter jusqu'au bout

Février 2024. Klarna annonce que son assistant IA traite deux tiers des conversations du service client dès son premier mois : 2,3 millions de conversations, l'équivalent du travail de 700 agents à temps plein, une résolution en moins de 2 minutes au lieu de 11, et 40 millions de dollars de profit en plus sur l'année, selon Klarna. Le même communiqué affirme aussi une satisfaction client égale à celle des agents humains. [11] La slide a beaucoup tourné.

Mai 2025. D'après la presse, le patron de Klarna explique qu'il réembauche des humains au service client, pour qu'un client puisse toujours parler à quelqu'un s'il le veut. [12]

Ce que j'en retiens pour vous : tous les chiffres de 2024, satisfaction comprise, venaient de Klarna elle-même. Une métrique déclarée par l'équipe qui porte le projet n'est pas une métrique vérifiée. Vous le savez déjà pour un modèle : on ne s'évalue pas sur son propre jeu d'entraînement.

Là où ça casse

  • Les questions financières précises. Sur FinanceBench (des questions sur de vrais rapports annuels), un GPT-4 Turbo branché sur un index commun à tous les documents échoue dans 81 % des 150 cas testés : 68 % de refus, 13 % d'erreurs. Avec le bon document dans le contexte, il a juste à 79 %. Le maillon faible, c'est la recherche. [13]
  • Les citations inventées. Aux États-Unis, deux avocats et leur cabinet ont été condamnés solidairement à 5 000 dollars d'amende pour un mémoire rempli de décisions de justice inventées par ChatGPT. [14]
  • Le chatbot qui engage l'entreprise. Air Canada a soutenu qu'elle n'était pas responsable de ce que disait son chatbot. Pour le tribunal, cela revenait à en faire une entité distincte, un argument qu'il a jugé « remarquable ». La compagnie a payé. [15]
  • Le marketing plus gros que le produit. La SEC a sanctionné deux sociétés de conseil en investissement qui prétendaient utiliser de l'IA sans le faire vraiment : 225 000 et 175 000 dollars. Ça porte un nom, l'« AI washing ». [16]
  • L'injection de prompt. Numéro un du classement OWASP des risques des applications LLM. [17] Un document piégé contient une instruction cachée, votre assistant la lit et obéit. Si l'assistant a le droit de faire des virements, vous voyez le problème.

Question éclair

Le chatbot de votre banque donne une mauvaise information à un client, qui perd de l’argent. Qui est responsable ?

« Quand on ne sait pas où l'on va, il faut y aller… et le plus vite possible. »
Devise Shadok (Jacques Rouxel)

La stratégie IA générative de pas mal de boîtes en 2023. Vous, vous fixez la métrique avant de coder.

Ce qu'un ingénieur fait vraiment là-dedans

Spoiler : très peu de « prompt engineering ». Le vrai boulot, c'est l'évaluation.

La briqueCe que vous construisezComment vous savez que ça marche
Recherche documentaire (RAG)découpage des documents, embeddings, index, rerankinghit rate@k : le bon passage est-il dans les k premiers ?
Évaluationun jeu de 200 questions avec les réponses attendues, rejoué à chaque changementtaux de réponses correctes ET sourcées
Garde-fousfiltres en entrée et en sortie, droits par utilisateur, journalisationtests d'attaque, dont l'injection de prompt
Coût et latencechoix du modèle, cache, taille du contexteeuros et secondes par requête
Mise en productionAPI, suivi, alertes, retours utilisateursle drift, comme pour un modèle de crédit

Version gamin

Le RAG, c'est un examen à livre ouvert. L'élève n'a pas besoin de tout savoir par cœur, mais il doit trouver la bonne page. S'il ouvre le mauvais livre, il recopie très proprement une bêtise.

Version ingénieur

On encode question et passages dans le même espace, on récupère les k plus proches (similarité cosinus), on les met dans le contexte. La qualité d'une réponse sourcée est bornée par la recherche. C'est donc elle qu'on mesure en premier.

P(réponse correcte et sourcée) ≤ P(bon passage récupéré)
FinanceBench le montre bien : même modèle, 19 % de bonnes réponses avec un index mal fichu, 79 % avec le bon document sous les yeux.

Question éclair

Votre assistant RAG répond faux à une question sur un rapport annuel. Premier réflexe ?

Bonne nouvelle : tout ce que vous apprenez dans ce cours sert ici. Un jeu de test tenu à l'écart, une métrique choisie avant de commencer, la méfiance envers un score trop beau. Le modèle a changé, la méthode non.

Les règles du jeu en Europe

  • AI Act, modèles à usage général. Les obligations des fournisseurs de grands modèles (documentation, politique de droit d'auteur, résumé des données d'entraînement) s'appliquent depuis le 2 août 2025. [18]
  • AI Act, transparence. Depuis le 2 août 2026, un chatbot doit dire qu'il est un chatbot. [18]
  • AI Act, haut risque. Repoussé au 2 décembre 2027 pour les usages comme le scoring de crédit. En France, l'ACPR surveillera. [18][20]
  • ESMA. Pour les services d'investissement aux particuliers, les décisions restent de la responsabilité des dirigeants de la société, qu'elles soient prises par des humains ou avec un outil d'IA. [19]
  • L'état des lieux. Selon l'EBA, 92 % des banques européennes déploient de l'IA. Selon l'AMF, 83 % des cas d'usage recensés chez les acteurs de marché sont à usage interne. [22][21]
  • Le risque systémique. Le FSB retient quatre vulnérabilités : la dépendance à quelques fournisseurs, les comportements de marché corrélés, le risque cyber et le risque de modèle. [23]

Les grands chiffres, avec des pincettes

Vous verrez passer ce chiffre partout : l'IA générative apporterait 200 à 340 milliards de dollars par an au secteur bancaire. Il vient de McKinsey (2023), et la phrase complète contient « si les cas d'usage étaient pleinement mis en œuvre ». [24] En face, Daron Acemoglu, prix Nobel d'économie 2024, estime le gain de productivité globale des facteurs lié à l'IA à 0,66 % au plus en dix ans. [25]

Entre les deux, il y a un sacré écart, et on ne va pas trancher en TD. Mais quand quelqu'un vous sort un chiffre en milliards, demandez la source et les hypothèses. C'est gratuit.

Et dans ce cours ?

Les sources

Chaque chiffre vient d'une source publique, relue le 3 octobre 2026. Lien mort, chiffre qui a bougé ? Dites-le-moi.

  1. [1]Morgan Stanley lance AI @ Morgan Stanley Debrief · Morgan Stanley, juin 2024
  2. [2]LLM Suite, « Innovation of the Year » 2025 d’American Banker · JPMorgan Chase, juin 2025
  3. [3]BBVA et le déploiement de ChatGPT Enterprise · BBVA, novembre 2024
  4. [4]BNP Paribas et Mistral AI signent un partenariat · BNP Paribas, juillet 2024
  5. [5]BNP Paribas met une plateforme « LLM as a Service » à disposition de ses métiers · BNP Paribas, juin 2025
  6. [6]Un collaborateur sur deux utilise MAiA · Groupe BPCE, novembre 2025
  7. [7]AXA offre une IA générative sécurisée à ses collaborateurs · AXA, juillet 2023
  8. [8]L'impact d'AllianzGPT · Allianz, février 2025
  9. [9]Driving value through digitalisation, scalability and GenAI · ING, mars 2026
  10. [10]Revue thématique sur l'usage de l'IA dans le secteur financier luxembourgeois, 2e édition · CSSF et BCL, mai 2025
  11. [11]L'assistant IA de Klarna traite deux tiers des conversations dès son premier mois · Klarna, février 2024
  12. [12]Klarna CEO reverses course by hiring more humans · Entrepreneur, citant Bloomberg, mai 2025
  13. [13]FinanceBench: A New Benchmark for Financial Question Answering · Islam et al., arXiv, novembre 2023
  14. [14]Mata v. Avianca, décision du 22 juin 2023 · Tribunal fédéral du district sud de New York, juin 2023
  15. [15]Moffatt v. Air Canada, 2024 BCCRT 149 · Civil Resolution Tribunal de Colombie-Britannique, février 2024
  16. [16]La SEC sanctionne deux conseillers pour « AI washing » · SEC, mars 2024
  17. [17]LLM01:2025 Prompt Injection · OWASP, Top 10 pour les applications LLM, 2025
  18. [18]AI Act · Commission européenne, mis à jour en août 2026
  19. [19]Déclaration sur l'usage de l'IA dans les services d'investissement aux particuliers · ESMA, mai 2024
  20. [20]Intelligence artificielle : les nouvelles frontières du risque (discours de Denis Beau) · Banque de France, septembre 2026
  21. [21]L'IA déjà largement adoptée par les acteurs des marchés financiers · AMF, février 2026
  22. [22]Rising application of AI in the EU banking and payments sector · Autorité bancaire européenne (EBA), septembre 2025
  23. [23]The Financial Stability Implications of Artificial Intelligence · Conseil de stabilité financière (FSB), novembre 2024
  24. [24]The economic potential of generative AI · McKinsey, juin 2023
  25. [25]The Simple Macroeconomics of AI · Daron Acemoglu, NBER, mai 2024
La suiteAprès le diplôme : les métiers, et comment y entrer

Page tenue par Sitraka Forler, enseignant vacataire à Centrale Marseille dans l'option DDEFI. Les entreprises citées le sont à partir de leurs propres publications, je ne parle pas en leur nom. Une erreur ? Signalez-la et je corrige.