Commencez par jouer avec la démo du haut : cliquez sur « Tirer un mot » plusieurs fois, puis fournissez le document et recommencez. Tout ce qui suit sur cette page est une conséquence de ce que vous venez de voir.
200 000
utilisateurs de LLM Suite chez JPMorgan, huit mois après le lancement [2]
98%
des équipes de conseillers de Morgan Stanley ont adopté l'assistant interne [1]
61%
des cas d'usage d'IA recensés au Luxembourg sont de l'IA générative [10]
81%
d'échecs sur FinanceBench avec un index commun à tous les documents [13]
D'abord, de quoi on parle
Version gamin
Un LLM, c'est le collègue qui a lu toute la bibliothèque et qui ne dit presque jamais « je ne sais pas ». Très utile pour préparer une réunion. Très dangereux si vous le laissez y aller seul.
Version ingénieur
Un modèle auto-régressif : il estime p(mot suivant | contexte) et on échantillonne. Sa fonction de perte ne connaît ni « vrai » ni « faux », seulement « probable ». D'où le RAG : on glisse les bons documents dans le contexte et on exige des citations.
Question éclair
À température très basse, que fait le modèle ?
Qui a quoi en production
Je n'ai gardé que les entreprises qui ont publié elles-mêmes des chiffres. Les « on m'a dit que chez X », je les garde pour la pause café.
Regardez bien la liste. C'est presque partout le même produit : un assistant interne branché sur les documents de la maison. Aucun robot trader là-dedans. Désolé pour ceux qui espéraient haha.
Le cas Klarna, à raconter jusqu'au bout
Février 2024. Klarna annonce que son assistant IA traite deux tiers des conversations du service client dès son premier mois : 2,3 millions de conversations, l'équivalent du travail de 700 agents à temps plein, une résolution en moins de 2 minutes au lieu de 11, et 40 millions de dollars de profit en plus sur l'année, selon Klarna. Le même communiqué affirme aussi une satisfaction client égale à celle des agents humains. [11] La slide a beaucoup tourné.
Mai 2025. D'après la presse, le patron de Klarna explique qu'il réembauche des humains au service client, pour qu'un client puisse toujours parler à quelqu'un s'il le veut. [12]
Ce que j'en retiens pour vous : tous les chiffres de 2024, satisfaction comprise, venaient de Klarna elle-même. Une métrique déclarée par l'équipe qui porte le projet n'est pas une métrique vérifiée. Vous le savez déjà pour un modèle : on ne s'évalue pas sur son propre jeu d'entraînement.
Là où ça casse
- Les questions financières précises. Sur FinanceBench (des questions sur de vrais rapports annuels), un GPT-4 Turbo branché sur un index commun à tous les documents échoue dans 81 % des 150 cas testés : 68 % de refus, 13 % d'erreurs. Avec le bon document dans le contexte, il a juste à 79 %. Le maillon faible, c'est la recherche. [13]
- Les citations inventées. Aux États-Unis, deux avocats et leur cabinet ont été condamnés solidairement à 5 000 dollars d'amende pour un mémoire rempli de décisions de justice inventées par ChatGPT. [14]
- Le chatbot qui engage l'entreprise. Air Canada a soutenu qu'elle n'était pas responsable de ce que disait son chatbot. Pour le tribunal, cela revenait à en faire une entité distincte, un argument qu'il a jugé « remarquable ». La compagnie a payé. [15]
- Le marketing plus gros que le produit. La SEC a sanctionné deux sociétés de conseil en investissement qui prétendaient utiliser de l'IA sans le faire vraiment : 225 000 et 175 000 dollars. Ça porte un nom, l'« AI washing ». [16]
- L'injection de prompt. Numéro un du classement OWASP des risques des applications LLM. [17] Un document piégé contient une instruction cachée, votre assistant la lit et obéit. Si l'assistant a le droit de faire des virements, vous voyez le problème.
Question éclair
Le chatbot de votre banque donne une mauvaise information à un client, qui perd de l’argent. Qui est responsable ?
« Quand on ne sait pas où l'on va, il faut y aller… et le plus vite possible. »
La stratégie IA générative de pas mal de boîtes en 2023. Vous, vous fixez la métrique avant de coder.
Ce qu'un ingénieur fait vraiment là-dedans
Spoiler : très peu de « prompt engineering ». Le vrai boulot, c'est l'évaluation.
| La brique | Ce que vous construisez | Comment vous savez que ça marche |
|---|---|---|
| Recherche documentaire (RAG) | découpage des documents, embeddings, index, reranking | hit rate@k : le bon passage est-il dans les k premiers ? |
| Évaluation | un jeu de 200 questions avec les réponses attendues, rejoué à chaque changement | taux de réponses correctes ET sourcées |
| Garde-fous | filtres en entrée et en sortie, droits par utilisateur, journalisation | tests d'attaque, dont l'injection de prompt |
| Coût et latence | choix du modèle, cache, taille du contexte | euros et secondes par requête |
| Mise en production | API, suivi, alertes, retours utilisateurs | le drift, comme pour un modèle de crédit |
Version gamin
Le RAG, c'est un examen à livre ouvert. L'élève n'a pas besoin de tout savoir par cœur, mais il doit trouver la bonne page. S'il ouvre le mauvais livre, il recopie très proprement une bêtise.
Version ingénieur
On encode question et passages dans le même espace, on récupère les k plus proches (similarité cosinus), on les met dans le contexte. La qualité d'une réponse sourcée est bornée par la recherche. C'est donc elle qu'on mesure en premier.
Question éclair
Votre assistant RAG répond faux à une question sur un rapport annuel. Premier réflexe ?
Bonne nouvelle : tout ce que vous apprenez dans ce cours sert ici. Un jeu de test tenu à l'écart, une métrique choisie avant de commencer, la méfiance envers un score trop beau. Le modèle a changé, la méthode non.
Les règles du jeu en Europe
- AI Act, modèles à usage général. Les obligations des fournisseurs de grands modèles (documentation, politique de droit d'auteur, résumé des données d'entraînement) s'appliquent depuis le 2 août 2025. [18]
- AI Act, transparence. Depuis le 2 août 2026, un chatbot doit dire qu'il est un chatbot. [18]
- AI Act, haut risque. Repoussé au 2 décembre 2027 pour les usages comme le scoring de crédit. En France, l'ACPR surveillera. [18][20]
- ESMA. Pour les services d'investissement aux particuliers, les décisions restent de la responsabilité des dirigeants de la société, qu'elles soient prises par des humains ou avec un outil d'IA. [19]
- L'état des lieux. Selon l'EBA, 92 % des banques européennes déploient de l'IA. Selon l'AMF, 83 % des cas d'usage recensés chez les acteurs de marché sont à usage interne. [22][21]
- Le risque systémique. Le FSB retient quatre vulnérabilités : la dépendance à quelques fournisseurs, les comportements de marché corrélés, le risque cyber et le risque de modèle. [23]
Les grands chiffres, avec des pincettes
Vous verrez passer ce chiffre partout : l'IA générative apporterait 200 à 340 milliards de dollars par an au secteur bancaire. Il vient de McKinsey (2023), et la phrase complète contient « si les cas d'usage étaient pleinement mis en œuvre ». [24] En face, Daron Acemoglu, prix Nobel d'économie 2024, estime le gain de productivité globale des facteurs lié à l'IA à 0,66 % au plus en dix ans. [25]
Entre les deux, il y a un sacré écart, et on ne va pas trancher en TD. Mais quand quelqu'un vous sort un chiffre en milliards, demandez la source et les hypothèses. C'est gratuit.
Et dans ce cours ?
Les sources
Chaque chiffre vient d'une source publique, relue le 3 octobre 2026. Lien mort, chiffre qui a bougé ? Dites-le-moi.
- [1]Morgan Stanley lance AI @ Morgan Stanley Debrief · Morgan Stanley, juin 2024
- [2]LLM Suite, « Innovation of the Year » 2025 d’American Banker · JPMorgan Chase, juin 2025
- [3]BBVA et le déploiement de ChatGPT Enterprise · BBVA, novembre 2024
- [4]BNP Paribas et Mistral AI signent un partenariat · BNP Paribas, juillet 2024
- [5]BNP Paribas met une plateforme « LLM as a Service » à disposition de ses métiers · BNP Paribas, juin 2025
- [6]Un collaborateur sur deux utilise MAiA · Groupe BPCE, novembre 2025
- [7]AXA offre une IA générative sécurisée à ses collaborateurs · AXA, juillet 2023
- [8]L'impact d'AllianzGPT · Allianz, février 2025
- [9]Driving value through digitalisation, scalability and GenAI · ING, mars 2026
- [10]Revue thématique sur l'usage de l'IA dans le secteur financier luxembourgeois, 2e édition · CSSF et BCL, mai 2025
- [11]L'assistant IA de Klarna traite deux tiers des conversations dès son premier mois · Klarna, février 2024
- [12]Klarna CEO reverses course by hiring more humans · Entrepreneur, citant Bloomberg, mai 2025
- [13]FinanceBench: A New Benchmark for Financial Question Answering · Islam et al., arXiv, novembre 2023
- [14]Mata v. Avianca, décision du 22 juin 2023 · Tribunal fédéral du district sud de New York, juin 2023
- [15]Moffatt v. Air Canada, 2024 BCCRT 149 · Civil Resolution Tribunal de Colombie-Britannique, février 2024
- [16]La SEC sanctionne deux conseillers pour « AI washing » · SEC, mars 2024
- [17]LLM01:2025 Prompt Injection · OWASP, Top 10 pour les applications LLM, 2025
- [18]AI Act · Commission européenne, mis à jour en août 2026
- [19]Déclaration sur l'usage de l'IA dans les services d'investissement aux particuliers · ESMA, mai 2024
- [20]Intelligence artificielle : les nouvelles frontières du risque (discours de Denis Beau) · Banque de France, septembre 2026
- [21]L'IA déjà largement adoptée par les acteurs des marchés financiers · AMF, février 2026
- [22]Rising application of AI in the EU banking and payments sector · Autorité bancaire européenne (EBA), septembre 2025
- [23]The Financial Stability Implications of Artificial Intelligence · Conseil de stabilité financière (FSB), novembre 2024
- [24]The economic potential of generative AI · McKinsey, juin 2023
- [25]The Simple Macroeconomics of AI · Daron Acemoglu, NBER, mai 2024
Page tenue par Sitraka Forler, enseignant vacataire à Centrale Marseille dans l'option DDEFI. Les entreprises citées le sont à partir de leurs propres publications, je ne parle pas en leur nom. Une erreur ? Signalez-la et je corrige.

