Pour les développeurs francophones, l’enjeu est double : dompter l’agent, mais aussi l’adapter à nos conventions. Nos commentaires en français, nos PR propres, nos revues exigeantes. J’ai testé, j’ai adapté, et je vous livre ce qui marche vraiment. Avec les pièges à éviter et les signes qui ne trompent pas.
Malgré le nom, il ne s’agit pas d’un ensemble géant de fonctionnalités flashy. L’idée est bien plus simple. Et c’est précisément ce qui fait sa force.
Mise à jour août 2026 : ce dépôt continue de gagner en popularité. La philosophie reste la même, mais la communauté a affiné les prompts pour couvrir davantage de scénarios d’échec courants. Source : hdvma.fr
Ces agents ont tendance à :
- Faire des hypothèses trop rapidement Sur-concevoir des tâches simples
- Éditer des fichiers qu’on ne leur a jamais demandé de toucher
- Paraître confiants même lorsqu’ils sont perdus
- Générer 500 lignes d’architecture là où 50 auraient suffi
Ce dépôt vise à corriger ces comportements directement au niveau des instructions système. Selon le README, tout repose sur quatre principes fondamentaux.
Propres, Dompte, les 4 principes des Karpathy Skills
1. Réfléchir avant de coder
2. La simplicité d’abord
C’est l’un de mes principes préférés. Beaucoup d’outils de codage IA ont cette tendance étrange à tout sur-construire.
Ce référentiel pousse l’agent à écrire le code minimum nécessaire pour résoudre le problème. Pas d’abstractions spéculatives.
Pas de framework géant pour une tâche unique. Pas de tentative d’être « intelligent » sans raison.
3. Des changements chirurgicaux
4. L’exécution axée sur les objectifs
Plutôt que de simplement « corriger le bug et espérer le meilleur », l’agent doit raisonner en termes de critères de réussite.
- Reproduire le bug.
- Appliquer le correctif.
- Vérifier qu’il fonctionne.
Puis s’arrêter. Vous y croyez, vous ?
Les noms de variables en anglais, c’est universel. Mais des commentaires en français, des messages de commit souvent en français, et une documentation interne qui l’est tout autant.
Le principe de « Surgical Changes » prend alors une dimension particulière. Si l’agent doit toucher trois lignes pour corriger un bug, il ne doit pas en profiter pour réécrire vos commentaires en anglais, ni uniformiser vos guillemets simples en guillemets doubles.
Dans votre CLAUDE.md, ajoutez une section explicite : « Respectez la langue des commentaires existants. Si un fichier est commenté en français, commentez en français.
Ne traduisez jamais un commentaire sans demande explicite. » C’est un détail, mais c’est exactement ce qui rend une PR française propre et lisible par toute l’équipe.
La question de la latence revient souvent dans les discussions, et elle est légitime. Un gars mentionnait des délais de 12 secondes par requête sur GitHub. Même si ça s’est amélioré depuis, ce genre de chiffre doit vous faire réfléchir à votre UX.
Si votre produit doit répondre en temps réel, chaque appel à Claude devra être optimisé, voire mis en cache. Le pré-computing du contexte, comme certains le font dans le secteur santé, semble être une piste sérieuse pour éviter les surprises.
Personne n’a de solution miracle. Mais tout le monde s’accorde à dire que la latence se conçoit dès le début, pas après.
Comment l’utiliser en pratique

La configuration est volontairement légère
Deux approches principales :
Méthode 1 : Plugin Claude Code (recommandée)
Le README indique la procédure. Vous ajoutez le marketplace via le plugin.
Vous recherchez « Forest Chang andrej Karpathy Skills ». Puis vous l’installez.
Une fois fait, les directives sont disponibles dans tous vos projets Claude Code. Vraiment.
Méthode 2 : Intégration par projet
Si vous souhaitez utiliser ces règles dans un seul dépôt, téléchargez simplement le fichier Claude.md directement dans votre projet. Pour un nouveau projet, suivez l’exemple du README.
Si vous avez déjà un Claude.md, vous pouvez fusionner ces instructions avec les vôtres plutôt que de tout remplacer. Vous n’utilisez pas ce dépôt comme une fonctionnalité séparée où vous taperiez une commande sophistiquée à chaque fois. Vous l’installez une fois, et il modifie le comportement de votre agent pendant son travail normal.
→ Sur le même sujet : SIEM : définition et guide pour les débutants
Prenons un exemple concret pour illustrer la puissance de cette approche, au-delà du simple développement logiciel. Pour l’intégration dans un projet français, la méthode est simple. Vous créez votre fichier CLAUDE.md à la racine du dépôt, à côté de votre README en français.
Vous collez les quatre principes, puis vous ajoutez vos règles maison :
- « Les tests se lancent avec pnpm test »
- « Les noms de branches suivent le format feature/MAJ-123-description »
- « La doc technique vit dans /docs et se met à jour dans la même PR ».
- Le but c’est que l’agent ait le réflexe de consulter ce fichier avant de coder comme un nouveau collègue lirait le wiki de l’entreprise.
Et pour les équipes qui utilisent des outils comme Cursor ou GitHub Copilot, la transposition est directe : le format AGENTS.md est reconnu par la plupart des environnements modernes. Vous écrivez vos règles une fois, et tous vos outils les respectent.
Imaginez que vous travaillez comme analyste de données. Chaque lundi, vous recevez un export de données clients ou de ventes. Votre tâche est toujours la même :
- Nettoyer ce fichier et détecter les anomalies
- Produire une synthèse claire pour votre manager
- Réexpliquer à l’agent le format du fichier
- Identifier les champs importants et les critères de détection des valeurs aberrantes
Avec une Skill bien configurée, tout ce circuit est automatisé. La Skill sait quel format de fichier vous arrive, quels champs sont critiques, comment repérer les incohérences et quel style de rapport votre manager préfère. Vous n’avez plus qu’à déposer le fichier, lancer la Skill, et votre note est prête en quelques minutes.
Le gain ici n’est pas seulement en heures récupérées chaque semaine. C’est aussi une question de fiabilité. La Skill ne fatigue pas, ne saute pas une ligne, ne mélange pas deux colonnes. Elle applique la même rigueur chaque lundi, sans variation d’humeur ni baisse d’attention. C’est exactement ce que ces principes de discipline apportent : une qualité constante, que vous codiez une API en TypeScript ou que vous produisiez un rapport d’analyse de ventes.
Exemple concret
Si vous hésitez entre deux VPN, tout dépend de ce que vous voulez en faire. Pour la vie privée et la transparence, difficile de faire mieux que ProtonVPN : code open source audité, basé en Suisse, et une version gratuite illimitée (pas de carte bancaire, pas de limite de data).
Pour le streaming et le débit, NordVPN reste la référence : plus de 8 000 serveurs dans 224 emplacements, protocole NordLynx (WireGuard optimisé), et il débloque les catalogues Netflix étrangers sans prise de tête. Les deux proposent une garantie « satisfait ou remboursé » de 30 jours, vous ne prenez donc aucun risque à tester celui qui correspond le mieux à votre usage.
Imaginons que vous demandiez à votre agent d’ajouter un tableau de bord de facturation. Sans ces directives, beaucoup d’agents se lancent immédiatement dans le codage :
- Création de tables et routes API
- Webhooks
- composants UI
- Validations et pages de paramètres… le tout en une seule passe
Vous vous retrouvez alors avec un diff géant à analyser. Avec les directives Karpathy, le comportement idéal est différent.
L’agent pose d’abord des questions de clarification. Parlons-nous de paiements uniques ou d’abonnements ?
Quel fournisseur utilisons-nous ? Avons-nous besoin d’un tableau de bord complet ou simplement d’un récapitulatif en lecture seule ? Quelle est la version minimale viable attendue ? Ensuite, seules les modifications nécessaires sont apportées. C’est ça, le véritable modèle d’utilisation. Et ce modèle ne s’applique pas uniquement aux développeurs.
→ Article connexe : Protonvpn ne fonctionne pas, les solutions concrètes
Vous êtes chef de projet, analyste ou responsable marketing, et vous entendez parler de Claude Skills depuis quelques semaines. Vous vous demandez si c’est encore un outil réservé aux développeurs, ou si vous pouvez en tirer quelque chose. Bonne nouvelle : les Skills d’Anthropic sont pensés pour vous aussi. L’idée est simple.
Plutôt que de demander à Claude de tout faire d’un coup, vous lui donnez des petites compétences précises, comme on donnerait une fiche de poste. Concrètement, cela veut dire que vous pouvez lui confier des tâches répétitives qui vous mangent des heures chaque semaine, et récupérer du temps pour ce qui compte vraiment.
Prenons un exemple qui vous parle probablement. Vous êtes responsable marketing et vous devez préparer le bilan trimestriel d’une campagne.
Normalement, vous passez 2 jours à extraire les chiffres, à les mettre en forme, à rédiger le commentaire, puis à adapter la version pour la direction et pour le comité exécutif. Avec une Skill bien configurée, vous donnez à Claude vos données brutes et lui demandez de produire le rapport complet, avec le bon votre et les bons indicateurs.
Vous relisez, vous ajustez, et le document part. Vous venez de diviser le temps de production par quatre, sans toucher au fond de votre expertise.
Adapter ces principes à votre contexte
Un entrepreneur non technique qui cherche à lancer un SaaS basé sur Claude avec des solutions no-code, ça me parle. J’ai vu plusieurs cas où des fondateurs ont réussi à aller vite en s’appuyant sur des plateformes comme Bubble ou Retool pour l’interface, puis en branchant l’API Claude derrière.
Mais chaque fois, le même piège se présente : l’authentification, les paiements et les paywalls, ça semble banal jusqu’au moment où vous réalisez que les intégrations préfabriquées ne couvrent pas exactement votre cas. Vous allez passer plus de temps à bricoler des workflows qu’à coder, et c’est ok, mais prévoyez de la marge pour ça.
Sur les cas d’usage en production, je note que les témoignages concrets restent rares comparés à d’autres frameworks comme LangGraph. Cela ne veut pas dire que Claude Agent SDK est mauvais. Cela veut dire que vous serez un pionnier. Devinez le résultat.
→ À découvrir également : Que veut dire se protéger contre les logiciels malveillants en 2024 ?
Si vous aimez bidouiller et assumer des choix non conventionnels, allez-y. Si vous préférez une communauté large avec des solutions éprouvées, méfiez-vous de l’effet de mode. Un développeur dans un fil faisait remarquer que la simplicité du modèle mental peut se payer au moment de l’industrialisation. Fine-tuning, monitoring, rollback, tout cela reste à construire vous-même.
Comment savoir si ça fonctionne

Quelques indicateurs simples :
- Vos diffs deviennent plus petits et plus ciblés, bon signe
- L’agent arrête de refactoriser aléatoirement des fichiers sans rapport, très bon signe
- Il commence à raisonner en termes de vérification plutôt que d’implémentation aveugle, c’est exactement ce que vous voulez
Il ne s’agit pas d’ajouter de la puissance au sens habituel. Il s’agit de supprimer les modes de défaillance. Et c’est précisément pourquoi j’apprécie cette approche.
Les signes qui doivent vous alerter
Si malgré ces directives, l’agent continue de produire des modifications trop larges ou de sauter des étapes de vérification, plusieurs explications sont possibles. Le contexte de votre projet est peut-être trop chargé, et les instructions se noient parmi d’autres règles. Vérifiez aussi que votre outil respecte bien le fichier de directives, certains paramètres peuvent les ignorer silencieusement.
Enfin, la qualité de vos propres consignes compte : plus elles sont précises, plus l’agent peut appliquer la discipline attendue.
Et avec d’autres outils comme Verdant
J’utilise Verdant, et la bonne nouvelle est que ces principes sont portables.
Plutôt que de parler d’« installation » au sens technique, voyez cela comme un portage de philosophie. Verdant permet déjà de définir le contexte du projet, les règles et le comportement des agents. Il suffit donc d’intégrer ces quatre mêmes principes dans votre configuration d’instructions Verdant pour que vos agents y suivent la même discipline.
Point de vigilance : certains utilisateurs rapportent que la gestion d’état dans les conversations multi-tours reste complexe, même avec un SDK bien conçu. Testez avec vos propres données et scénarios avant de généraliser, surtout si vous prévoyez des traitements asynchrones longs.
Ce que la communauté remarque en conditions réelles
Ceux qui ont déjà mis des LLM en production, que ce soit avec Claude ou GPT, insistent sur un point que les débutants sous-estiment : la gestion des versions de prompts et la rejouabilité des requêtes.
ProtonVPN ou NordVPN : le choix rapide
Si vous voulez un VPN gratuit, transparent et orienté vie privée, choisissez ProtonVPN. Si vous voulez surtout le streaming, la vitesse et la simplicité, choisissez NordVPN.
Les deux proposent une garantie satisfait ou remboursé de 30 jours. Si vous ne savez pas lequel choisir, commencez par la version gratuite de ProtonVPN.
Voir la comparaison en 4 points
| Critère | ProtonVPN | NordVPN |
|---|---|---|
| Version gratuite | Oui, sans carte bancaire | Non |
| Streaming | Possible sur certains serveurs | Plus efficace pour les catalogues étrangers |
| Confidentialité | Open source, basé en Suisse | Code propriétaire |
| Prix | Dès 2,99 euros par mois | Dès 3,49 euros par mois |
Quand vous modifiez un prompt en production et que les performances changent, comment le savez-vous ? Beaucoup racontent avoir passé des semaines à construire une infrastructure maison pour comparer les sorties, avant de réaliser que des plateformes comme Vellum existent déjà pour ça. Après, tout dépend de votre budget et de votre envie de dépendre d’un outil tiers. Les avis divergent, et c’est sain.
Pour le recrutement, l’idée d’associer expertise métier et compétences techniques via un partage de revenus, c’est séduisant sur le papier. Mais les forums regorgent d’histoires de partenariats qui ont mal tourné.
Trouver quelqu’un qui comprend l’IA et qui accepte de travailler sans salaire fixe, c’est rare. Et si vous trouvez cette personne, posez-vous la question de la propriété du code et des clés API dès le départ.
Des fondateurs racontent que leur associé technique est parti avec le code source, les laissant sans produit et sans recours. Protégez-vous légalement avant de partager quoi que ce soit, même avec un partenaire de confiance.
Ce que pensent les internautes
La question de la latence revient souvent dans les discussions, et elle est légitime. Un gars mentionnait des délais de 12 secondes par requête sur GitHub, et même si ça s’est amélioré depuis, ce genre de chiffre doit vous faire réfléchir à votre UX. Si votre produit doit répondre en temps réel, chaque appel à Claude devra être optimisé, voire mis en cache.
Le pré-computing du contexte, comme certains le font dans le secteur santé, semble être une piste sérieuse pour éviter les surprises. Personne n’a de solution miracle, mais tout le monde s’accorde à dire que la latence se conçoit dès le début, pas après.
Sur les cas d’usage en production, je note que les témoignages concrets restent rares comparés à d’autres frameworks comme LangGraph. Cela ne veut pas dire que Claude Agent SDK est mauvais.
Cela veut dire que vous serez un pionnier. Si vous aimez bidouiller et assumer des choix non conventionnels, allez-y.
Si vous préférez une communauté large avec des solutions éprouvées, méfiez-vous de l’effet de mode. Un développeur dans un fil faisait remarquer que la simplicité du modèle mental peut se payer au moment de l’industrialisation : Fine-tuning et monitoring Rollback, tout cela reste à construire vous-même.
Ce que personne ne vous dit sur le sujet
| Critère | Guide technique classique | L’angle pro (celui qu’on lit ici) |
|---|---|---|
| Public visé | Développeurs anglophones | Chefs de projet, marketers, analystes (en France) |
| Question de départ | Comment structurer un fichier YAML ? | Quel gain de temps sur une tâche répétitive ? |
| Exemple concret | Coder un agent qui lit des logs | Générer un reporting hebdo de campagnes SEA en 2 minutes (vs 45 minutes à la main) |
| Jargon utilisé | API, tokens, hooks, variables d’environnement | Modèle, prompt, résultat. Point final. |
| ROI mesuré | Rarement évoqué | 3 heures économisées par semaine pour un salarié à 45k€ brut : environ 4 500€/an de productivité (calcul simple, sans bullshit) |
En résumé
Les Andrej Karpathy Skills ne sont pas un repo à la mode. Pas de tableau de bord impressionnant, pas d’affirmations benchmark sophistiquées. Juste une solution pragmatique à un problème très réel : les agents de codage sont souvent capables, mais se comportent mal.
Ce dépôt aide à :
- Réduire les fausses hypothèses et limiter la sur-ingénierie
- Éviter les diffs désordonnés et pousser l’agent vers une exécution vérifiable
C’est utile dans Claude Code. C’est utile dans tout outil où vous pouvez injecter des règles système. Et si vous utilisez d’autres plateformes comme Verdant, les mêmes principes s’appliquent directement. Ca vous étonne ?
Si vous êtes développeur francophone, ce dépôt mérite qu’on s’y attarde. Pas parce que le fichier CLAUDE.md est révolutionnaire en soi, mais parce qu’il pose des questions que l’on a tendance à zapper dans nos équipes : comment encadrer un agent qui code plus vite que nous ne lisons.
La première adaptation évidente, c’est la langue. Les règles de Karpathy sont en anglais, mais votre code, vos commentaires, vos tickets, eux, sont probablement en français.
Ne vous amusez pas à traduire le fichier tel quel, ce serait contre-productif. Reprenez les quatre grands principes et rédigez les versions françaises dans votre propre CLAUDE.md.
Par exemple, pour la partie « Think Before Coding », écrivez quelque chose comme : « Ne présumez jamais du contexte. Si une interprétation est ambiguë, listez les options et demandez.»
L’important est que l’agent lise des instructions qui résonnent avec vos conventions internes.
Enfin, n’oubliez pas que ce fichier est un point de départ, pas une fin. La communauté française est très active sur des sujets comme l’IA générative et les agents de codage, avec des meetups et des échanges sur des serveurs Discord.
Adaptez les règles à votre contexte : si votre projet utilise des conventions de nommage spécifiques (camelCase, snake_case), si vous imposez des revues obligatoires ou des pipelines CI stricts, ajoutez ces contraintes dans le fichier. Le CLAUDE.md devient alors un contrat entre votre équipe et l’agent, un document vivant que vous enrichissez à chaque incident.
Et si vous hésitez sur la forme, souvenez-vous de la règle simple :
si vous avez dû répéter la même consigne 2 fois dans une conversation avec l’agent c’est qu’elle mérite de finir dans le fichier. Vos collègues francophones vous remercieront et vos PR seront enfin propres minimales et en français.
Les Karpathy Skills fonctionnent-ils avec d’autres modèles que Claude ?
Oui, les principes sont rédigés sous forme d’instructions système et peuvent être adaptés à d’autres agents de codage comme GPT ou des solutions open-source, pourvu que l’outil lise un fichier de directives similaire.
Mon avis : cela vaut largement la peine d’essayer. C’est simple portable et ça résout des problèmes concrets que tout développeur utilisant l’IA rencontre au quotidien.
Ces principes de codage ne vont-ils pas brider la créativité de l’agent ?
C’est la question que je me posais avant de tester. En réalité, c’est tout l’inverse. Un agent qui passe moins de temps à sur-concevoir a plus de budget cognitif pour le problème qu’on lui pose vraiment. Le cadre ne bride pas, il canalise. J’ai vu des agents produire des solutions plus élégantes une fois débarrassés de la tentation du « tout refaire ».
Article utile ? Dites-le à Google. Ajoutez ce blog à vos sources préférées : un clic, et vous le retrouverez dans vos recherches (et l’AI Mode) au lieu du contenu recyclé par des robots. C’est votre façon de reprendre le contrôle sur ce que vous lisez.
Et si vous avez aimé, partagez (c’est le meilleur coup de pouce pour un blog indépendant qui publie sans algorithme ni sponsor déguisé).
Un clic, gratuit. Nécessite d’être connecté à votre compte Google.

