« Et alors, la première astuce, elle est juste ici. Si on revient sur l'utilisation des tokens, on a vu que 97 % c'est du chargement en coulisse. Donc ce qui va nous intéresser, ça va être de réduire ici la décomposition de ces 97 %. »
Explication de la réduction de la consommation de tokens dans Claude.
« Le 30e message de votre conversation et bien il a coûté 30 fois plus de token que le premier. C'est juste totalement dingue et ça personne ne vous le dit. »
Impact de l'historique de conversation sur la consommation de tokens.
« Le PDF ici, contenu du PDF, on est entre 6800 et 7000 tokens pour aller l'analyser. Alors que dans le même temps, ici, j'ai juste mis le fichier. MD que m'a généré chat GPT. Et là en input, donc en entrée, on est à 2800 tokens réduction divisé par 3 en seulement quelques secondes, juste en ayant mis ce PDF dans chat GPT. »
Comparaison de la consommation de tokens entre un PDF et un fichier .md généré par ChatGPT.
« Si vous avez besoin d'utiliser un PDF plusieurs fois, passez au maximum par les projets. »
Conseil pour optimiser l'utilisation de fichiers répétés dans Claude.
« Opus le plus puissant à ce moment-là, utiliser que pour des relectures finales ou bien pour du raisonnement complexe pour pouvoir aller faire du code de l'architecture de système. C'est là qui va vraiment être pertinent. »
Utilisation optimale du modèle Opus de Claude.
📚 Ressources mentionnées dans la vidéo
app
Claude
Intelligence artificielle conversationnelle développée par Anthropic.
app
ChatGPT
Modèle de langage développé par OpenAI, utilisé ici pour convertir des PDF en fichiers Markdown.
guide
Les 7 jours de l'IA
Guide gratuit proposé par Elliott Pierret pour apprendre les bases de l'IA en 7 jours.
masterclass
IA Master
Masterclass sur le prompt engineering, context engineering et vibe coding, couvrant plusieurs outils d'IA.
skill
Caveman
Skill pour Claude qui réduit la consommation de tokens en utilisant un langage plus concis.
📖 Glossaire
Token
Unité de mesure utilisée par les modèles d'IA pour traiter et générer du texte. La limite de tokens détermine la quantité d'informations qu'un modèle peut gérer.
Prompt
Instruction ou question donnée à un modèle d'IA pour obtenir une réponse spécifique.
Système Prompt
Instructions initiales et règles définies pour un modèle d'IA, qui peuvent inclure des personnalités ou des contraintes.
RAG (Retrieval Augmented Generation)
Technique permettant à un modèle d'IA de rechercher des informations pertinentes dans une base de données avant de générer une réponse, optimisant ainsi la pertinence et réduisant la consommation.
Skills
Fonctionnalités ou capacités spécifiques que l'on peut activer ou désactiver dans Claude pour accomplir certaines tâches.
⭐ Avis de la communauté
Soyez le premier à noter ce résumé
Merci pour ton avis !
❓ Questions fréquentes
La consommation de tokens augmente car Claude doit relire et prendre en compte tout l'historique de la conversation à chaque nouveau message. Le 30ème message peut coûter 30 fois plus cher en tokens que le premier.
Il est recommandé de convertir les fichiers PDF en fichiers Markdown (.md) à l'aide d'un autre outil comme ChatGPT. Le fichier .md consomme beaucoup moins de tokens pour l'analyse par Claude.
La fonction 'Projets' permet de centraliser des fichiers et des instructions. Au lieu de charger un fichier dans chaque nouvelle conversation, vous le chargez une fois dans le projet, ce qui réduit considérablement la consommation de tokens, surtout si vous utilisez le même fichier dans plusieurs chats.
Claude propose plusieurs modèles : Haiku (le moins cher et rapide, pour 90% des tâches), Sonnet (pour des tâches de complexité moyenne) et Opus (le plus puissant, pour les relectures finales ou le raisonnement complexe). Il est conseillé d'utiliser les modèles moins coûteux pour les tâches courantes.
Il faut désactiver les fonctionnalités non utilisées dans les paramètres, comme les connecteurs, la recherche web, les artefacts IA, les visualisations intégrées et les skills, sauf si vous en avez spécifiquement besoin pour la tâche en cours.
Résumez n'importe quelle vidéo YouTube
EnBref génère un résumé IA en 1 clic, directement sur YouTube. Gratuit.