Six habitudes,et les projets qui me les ont apprises.
Pas des valeurs affichées au mur. Chacune est née d'un projet qui s'est mieux déroulé lorsque je l'ai suivie — ou moins bien lorsque je l'ai ignorée. Comme chaque habitude implique un geste concret, je l'ai indiqué juste en dessous.
01
Des chiffres défendables
Un chiffre que je défendrais devant ma directrice de mémoire, ou pas de chiffre du tout.
YEPA
Le classifieur de YEPA est évalué sur 350 échantillons annotés par les chercheurs et chercheuses en pédagogie, pas sur une démo qui s'est bien passée. Le modèle d'entités censé remplacer l'extraction plafonnait à un F1 de 0,024 : j'ai écrit ce chiffre dans le rapport et j'ai arrêté le modèle, plutôt que de livrer quelque chose que je ne pouvais pas défendre.
KOCO Predict
Sur KOCO Predict, j'ai évalué chaque modèle plusieurs fois, notamment sur la courbe interpolée et sur les seuls jours de collecte réels, parce que le premier chiffre mesure surtout l'accord avec une droite que j'avais tracée moi-même. Les deux classements ne sont pas tombés d'accord, et c'est ce désaccord qui était le résultat.
ce que ça demande
Des semaines de travail. Constituer un corpus annoté est exigeant et minutieux, mais c'est lui qui a rendu possible le modèle spécialisé.
02
Savoir quand un LLM n'est pas le bon outil
Les grands modèles sont puissants et non déterministes. Le vrai savoir-faire consiste à reconnaître les situations où il vaut mieux utiliser autre chose.
YEPA
Sortir les éléments significatifs d'un entretien YEPA est une tâche ouverte : un LLM contraint par un schéma a battu net un NER affiné. Ranger ces mêmes éléments dans les sept concepts d'une ontologie pédagogique est une tâche fermée et répétable : un petit classifieur entraîné sur 14 000 échantillons a devancé de douze points tous les modèles de pointe que j'ai testés. Même produit, même semaine, réponses opposées.
Atelier
Dans Atelier, je découpe le travail sur la même ligne : ffmpeg trouve les silences, parce qu'un blanc entre deux mots relève de l'arithmétique, et le modèle ne lit que des mots et rend des indices qu'il ne peut pas inventer. La moitié coûteuse et faillible ne tourne que là où le jugement est vraiment nécessaire.
ce que ça demande
Avoir son propre modèle, c'est posséder une chaîne d'entraînement et un corpus annoté au lieu d'utiliser une API.
03
Garder la complexité en dessous
Rigoureux là où c'est essentiel, invisible partout ailleurs.
FlowerCam
FlowerCam fait de la détection de visages et de la reconnaissance d'identité sur chaque image d'un flux vidéo relayé, et l'équipe de la boutique ne devrait voir que la clientèle en train de se promener dans les rayons. C'est la rigueur du dessous qui permet à la surface de rester calme. Ce n'est pas une chose à exposer.
YEPA
YEPA repose sur une ontologie pédagogique issue de la recherche, et rien de ce vocabulaire n'a sa place à l'écran : la personne doit voir sa propre expérience, bien décrite. Chaque résultat généré imprime quand même ses cartes sources en dessous, pour que la rigueur reste vérifiable sans jamais devenir l'interface.
ce que ça demande
Ce travail ne se voit pas en démo : il se révèle le jour où tout continue de tenir malgré la charge.
04
Prototyper, puis optimiser
On discute d'un produit qu'on voit. On négocie un concept qu'on ne voit pas.
YEPA
L'entretien de YEPA est passé devant 36 participants, en trois vagues de tests, avant tout travail de finition. La deuxième vague a désigné la latence comme la friction principale, la troisième version a donc été la version simplifiée, et le score qui comptait, le temps laissé pour réfléchir, est resté au plafond du début à la fin. Les mêmes vagues ont mis un chiffre sur l'outil le plus faible, la correspondance d'emploi, à 3,75 sur 5. C'est exactement à ça que sert un prototype.
Dutine
Sur Dutine, un sondage de sept personnes et huit questions a déplacé tout le produit : 57 % pensaient tenir les deux rôles, donc l'inscription crée une relation avec soi-même au lieu d'un mode solo greffé sur le côté. Sept réponses ont changé le produit plus qu'un mois de réflexion.
ce que ça demande
Une version brute se fait juger comme une version finie. Je précise donc systématiquement, à voix haute, ce qui relève encore de l'échafaudage.
05
Expliquer la décision, pas seulement le résultat
Un client qui comprend le pourquoi peut prendre la prochaine décision avec vous.
YEPA
La décision phare de YEPA, entraîner un classifieur dédié plutôt que d'interroger un modèle de pointe, a tenu parce que le pourquoi était écrit : nous avons testé trois tailles de GPT-5 et la famille Claude avec des prompts optimisés, et ils plafonnaient. Le résultat publié dit que la difficulté était la nuance conceptuelle, pas l'échelle, et le prix a été posé sur la table en même temps : posséder le modèle, c'est posséder une chaîne d'entraînement et un corpus annoté au lieu d'utiliser une API. Deux chercheurs en pédagogie portent cet arbitrage avec moi parce qu'il leur a été expliqué, pas annoncé.
KOCO Predict
Sur KOCO Predict, j'ai fait passer la prévision de l'heure au jour, soit l'inverse de ce qui avait été convenu. À l'heure, 2 % des points étaient de vraies mesures. Au jour, 26 %. Le modèle devenait moins flatteur et les chiffres devenaient utilisables, et ce n'est une bonne décision que si on sait la dire en délais et en coûts, dans les mots du client.
ce que ça demande
C'est plus long que de livrer le chiffre, et la version honnête est parfois la plus sobre.
06
Concevoir pour qui maintiendra
Des budgets écrits, de vraies frontières, du code partagé là où deux produits se recoupent.
YEPA
Chez YEPA, je suis CTO et ingénieur à plein temps : toute règle qui dépend de la mémoire de quelqu'un finira par ne pas être appliquée. La barrière de déploiement lit le différentiel d'infrastructure et s'arrête si un changement remplaçait une table ou un pool d'utilisateurs. Des limites de taille par type de fichier, et une procédure écrite pour extraire une fonctionnalité vers le paquet partagé, font le même travail côté code.
SAFE
Le présent d'un day trader dure quelques heures, celui d'une caisse de pension un trimestre, et si cette frontière est apprise par le modèle, servir les deux publics oblige à réannoter le corpus et à tout réentraîner. Sur SAFE, les seuils temporels vivent donc dans un fichier de configuration, et les dates explicites n'atteignent jamais le réseau : changer ce que « présent » veut dire est une ligne, pas un réentraînement.
ce que ça demande
Un garde-fou coûte le jour où on l'écrit ou le met en place. Il rapporte le jour où quelqu'un est fatigué, et le jour où la personne qui savait n'est plus là.
Je transforme une idée en produit utilisé par de vraies personnes, de la première ligne de code jusqu'au déploiement.
FlowerCam permettait à une personne restée chez elle de piloter un robot dans un vrai magasin, et j'ai écrit le serveur vidéo qui rendait cet appel possible.
Structurer
Je conçois des systèmes qui restent compréhensibles quand quelqu'un d'autre les rouvre un an plus tard.
SAFE lit l'actualité financière et situe chaque événement dans le temps, alors que personne n'est d'accord sur ce que veut dire « récent ».
Décider
Je fixe la direction, je répartis le travail, et j'assume l'arbitrage quand les réponses se contredisent.
Chez YEPA, je suis CTO et ingénieur à plein temps : tout désaccord entre la recherche, les freelances et le produit finit sur mon bureau.
Enseigner
Je transforme la complexité en outils concrets, puis je vérifie qu'ils répondent vraiment aux besoins.
La plupart des personnes que j'accompagne arrivent sans savoir créer de site web et repartent capables d'en construire un qui fonctionne, et de le prouver.