Série d'apprentissage de l'IA · Leçon 4 sur 4
On ne peut pas réduire ce qu'on n'a pas mesuré. Toute affirmation de coût d'IA qui vaille commence par une vraie référence, change une seule chose à la fois et compte la qualité chaque fois qu'elle compte la dépense — une exécution moins chère qui échoue à la vérification est une perte, pas une économie.
Statut : plan. La démonstration à l'écran n'a pas encore été enregistrée, et toute la prémisse de cette leçon est un résultat mesuré — il n'y a donc encore aucun chiffre ici. Aucun ne sera inventé pour donner à l'article un air terminé ; la vraie référence et le tableau final remplaceront cette note une fois la leçon diffusée.
| Leçon | Sujet | Question traitée |
|---|---|---|
| 1 — L'usage des modèles | Niveau de modèle, contexte, tokens | De quel modèle cette tâche a-t-elle besoin ? |
| 2 — Prompt, projet et contexte | Structure du prompt, contexte permanent | Que place-t-on devant le modèle ? |
| 3 — Documentation, règles et skills | Structure du dépôt | Comment un dépôt reste-t-il cohérent d'une session à l'autre ? |
| 4 — Réduire le coût | Mesure, leviers, garde-fous | Comment dépenser moins sans perdre en qualité ? |
Ce que vous saurez faire
- Mesurer ce que coûte une vraie tâche d'IA
- Découvrir où part réellement cette dépense
- La réduire avec un changement que vous pouvez nommer et défendre — sans dégrader le résultat
L'affirmation que cette leçon peut faire est volontairement étroite : moins pour le même résultat, mesuré à l'écran. Pas un pourcentage emprunté ailleurs. Le chiffre mesuré, quel qu'il soit, est celui qui est publié, même s'il est petit.
Hors périmètre : négociation avec les fournisseurs, remises entreprise, auto-hébergement pour éviter entièrement la dépense d'API, et tout prix ou pourcentage d'économie présenté comme un fait établi. Chaque chiffre à l'écran vient de l'usage réel de la semaine, affiché avec sa source.
Les quatre leviers
Le coût vient en dernier parce que les leviers sont ce qu'enseignent les leçons 1 à 3. Sans elles, il n'y a rien à actionner.
| Levier | Enseigné dans |
|---|---|
| Dimensionner le modèle selon le travail | Leçon 1 |
| Envoyer moins de contexte, mieux choisi | Leçons 1 et 2 |
| Réussir du premier coup — critères d'acceptation dès le départ | Leçon 2 |
| Ne charger que ce dont la tâche a besoin — documentation, règles et skills en couches | Leçon 3 |
La méthode
Référence — mesurer avant de toucher à quoi que ce soit
- Une tâche qui se répète vraiment, exécutée telle quelle aujourd'hui
- Tokens en entrée et en sortie, nombre de relances et réussite/échec enregistrés avant tout changement
▶ show code▼ hide code
# Baseline Log — one task, before any change
Task: (one you actually repeat)
Model/setting:
Input tokens:
Output tokens:
Retries:
Result: pass / fail against the stated check
Source/date: where each number came from, and when
Décomposition — où part réellement la dépense
- La référence est découpée par étape : quelle partie de la tâche, quel contexte, quelles relances
- La partie coûteuse n'est pas toujours celle qui en a l'air
Un levier à la fois — remesurer après chaque changement
- Changez une chose, remesurez et ne gardez le changement que si la qualité tient
- Une exécution moins chère qui échoue à la vérification reste dans le tableau comme une perte — jamais retirée en silence
Refonte du flux — étapes simples sur modèles bon marché
- Découpez la tâche pour que les étapes routinières tournent sur un petit modèle et que seule l'étape vraiment difficile fasse appel à un modèle coûteux
- Deux exemples concrets du même levier : le guide de configuration d'IA hybride répartit un flux de développement entre Hugging Face et Claude, et le routage des fournisseurs du chatbot d'OpenTechnologyApp envoie automatiquement les questions faciles d'un chatbot vers un modèle bon marché et les difficiles vers un modèle coûteux
Garde-fous — conditions d'arrêt et budgets de dépense
- Tout ce qui tourne en boucle reçoit une condition d'arrêt et un budget de dépense, pour qu'une erreur ne fasse pas grimper la facture sans surveillance
- À l'écran : une boucle dépasse exprès ses limites et se fait arrêter par sa propre limite
Le tableau final
Rempli avec des valeurs mesurées une fois la leçon enregistrée — montré ici sous la forme qu'il prendra.
| Changement | Coût par rapport à la référence | Vérification de qualité | Conservé ? |
|---|---|---|---|
| Référence | — | — | — |
| Levier 1 | — | — | — |
| Levier 2 | — | — | — |
| Levier 3 | — | — | — |
Les règles des résultats
- La qualité est mesurée chaque fois que le coût l'est. Une exécution moins chère qui échoue à la vérification est une perte, point.
- Un levier par relance. Sinon, le tableau ne peut pas dire quel changement a produit quoi.
- Les leviers sans économie restent. Les retirer pour que les résultats paraissent plus nets trahirait la méthode.
Vérifiez avant de vous y fier
- Le prix actuel par modèle — et si l'entrée, la sortie et l'entrée en cache sont facturées différemment — relevé sur la page tarifaire du fournisseur la semaine même, avec la date à l'écran
- L'existence de la mise en cache des prompts ou du traitement par lots pour le modèle et l'outil présentés, leurs noms et leurs contraintes
- La façon dont l'outil rapporte l'usage de tokens par requête, pour que la référence soit mesurée et non estimée
- Que la tâche choisie se répète vraiment et peut être exécutée en direct sans risque
- Toute fonction de plafond de dépense ou d'usage dans l'outil, pour le segment des garde-fous
Questions fréquentes
« Combien vais-je économiser ? » Impossible à dire tant que vous n'avez pas mesuré votre propre référence. Tout pourcentage cité sans référence décrit la charge de travail de quelqu'un d'autre.
« Dois-je tout basculer sur le modèle le moins cher ? » Seulement les étapes qui réussissent encore leur vérification avec lui. Une exécution bon marché qui échoue vous coûte la relance, la relecture et la correction.
« Je suis venu pour le coût — puis-je sauter les leçons 1 à 3 ? » Vous pouvez lire celle-ci d'abord, mais les leviers ne fonctionnent qu'une fois la préparation précédente en place.
La série complète
Choisissez le modèle. Écrivez le prompt et configurez le projet. Structurez le dépôt. Puis dépensez moins sur l'ensemble sans perdre en qualité. Rien de tout cela ne remplace la documentation du fournisseur pour ce qui est à jour — c'est un ordre des opérations, appliqué à une vraie tâche plutôt qu'à des diapositives. Commencez par la leçon 1, ou parcourez toute la série sur la page Apprendre l'IA.