Léonard Noth
ENFRDE
Méthode

Six habitudes,et les projets qui me les ont apprises.

Pas des valeurs affichées au mur. Chacune est là parce qu'un projet s'est mieux passé quand je l'ai suivie, ou moins bien quand je l'ai ignorée. Chacune a aussi un prix, alors le prix est écrit dessous.

01

Mesurer ce qui compte

Un chiffre que je défendrais devant un directeur de mémoire, ou pas de chiffre du tout.

YEPA

Le classifieur de YEPA est évalué sur 350 échantillons annotés par les chercheuses en pédagogie, pas sur une démo qui s'est bien passée. Le modèle d'entités censé remplacer l'extraction plafonnait à un F1 de 0,024 : j'ai écrit ce chiffre dans le rapport et j'ai arrêté le modèle, plutôt que de livrer quelque chose d'indéfendable.

KOCO Predict

Sur KOCO Predict, j'ai évalué chaque modèle deux fois, une fois sur la courbe interpolée et une fois sur les seuls jours de collecte réels, parce que le premier chiffre mesure surtout l'accord avec une droite que j'avais tracée moi-même. Les deux classements ne sont pas tombés d'accord, et c'est ce désaccord qui était le résultat.

ce que ça coûte

Des semaines. Un corpus annoté est lent et ingrat, et c'est la seule raison pour laquelle le modèle spécialisé a pu exister.

02

Savoir quand un LLM est le mauvais outil

Les grands modèles sont puissants et non déterministes. Le savoir-faire, c'est de distinguer les cas.

YEPA

Sortir les éléments signifiants d'un entretien YEPA est une tâche ouverte : un LLM contraint par un schéma a battu net un NER affiné. Ranger ces mêmes éléments dans les sept concepts d'une ontologie pédagogique est une tâche fermée et répétable : un petit classifieur entraîné sur 14 000 échantillons a devancé de douze points tous les modèles de pointe que j'ai testés. Même produit, même semaine, réponses opposées.

Atelier

Dans Atelier, je découpe le travail sur la même ligne : ffmpeg trouve les silences, parce qu'un blanc entre deux mots relève de l'arithmétique, et le modèle ne lit que des mots et rend des indices qu'il ne peut pas inventer. La moitié coûteuse et faillible ne tourne que là où le jugement est vraiment nécessaire.

ce que ça coûte

Avoir son propre modèle, c'est posséder une chaîne d'entraînement et un corpus annoté au lieu de louer une API.

03

Garder la complexité en dessous

Rigoureux là où ça compte, invisible là où ça ne compte pas.

FlowerCam

FlowerCam fait de la détection de visages et de la reconnaissance d'identité sur chaque image d'un flux vidéo relayé, et la fleuriste ne devrait voir que sa cliente en train de se promener dans la boutique. C'est la rigueur du dessous qui permet à la surface de rester calme. Ce n'est pas une chose à exposer.

YEPA

YEPA repose sur une ontologie pédagogique issue de la recherche, et rien de ce vocabulaire n'a sa place à l'écran : la personne doit voir sa propre expérience, bien décrite. Chaque résultat généré imprime quand même ses cartes sources en dessous, pour que la rigueur reste vérifiable sans jamais devenir l'interface.

ce que ça coûte

Personne ne félicite ce qu'il ne voit pas. Ce travail est invisible en démo et ne se remarque que le jour où il lâche.

04

Prototyper, puis optimiser

On discute d'un produit qu'on voit. On négocie un concept qu'on ne voit pas.

YEPA

L'entretien de YEPA est passé devant 36 participants, en trois vagues de tests, avant tout travail de finition. La deuxième vague a désigné la latence comme la friction principale, la troisième version a donc été la version simplifiée, et le score qui comptait, le temps laissé pour réfléchir, est resté au plafond du début à la fin. Les mêmes vagues ont mis un chiffre sur l'outil le plus faible, la correspondance d'emploi, à 3,75 sur 5. C'est exactement à ça que sert un prototype.

Dutine

Sur Dutine, un sondage de sept personnes et huit questions a déplacé tout le produit : 57 % pensaient tenir les deux rôles, donc l'inscription crée une relation avec soi-même au lieu d'un mode solo greffé sur le côté. Sept réponses ont changé le produit plus qu'un mois de réflexion.

ce que ça coûte

Une version brute se fait juger comme une version finie. Je dis à voix haute ce qui est encore de l'échafaudage, à chaque fois.

05

Expliquer la décision, pas seulement le résultat

Un client qui comprend pourquoi peut faire le prochain arbitrage avec vous.

YEPA

La décision phare de YEPA, entraîner notre propre classifieur plutôt que d'interroger un modèle de pointe, a tenu parce que le pourquoi était écrit : nous avons testé trois tailles de GPT-5 et la famille Claude avec des prompts optimisés, et ils plafonnaient. Le résultat publié dit que la difficulté était la nuance conceptuelle, pas l'échelle, et le prix a été posé sur la table en même temps : posséder le modèle, c'est posséder une chaîne d'entraînement et un corpus annoté au lieu de louer une API. Deux chercheurs en pédagogie portent cet arbitrage avec moi parce qu'il leur a été expliqué, pas annoncé.

KOCO Predict

Sur KOCO Predict, j'ai fait passer la prévision de l'heure au jour, soit l'inverse de ce qui avait été convenu. À l'heure, 2 % des points étaient de vraies mesures. Au jour, 26 %. Le modèle devenait moins flatteur et les chiffres devenaient utilisables, et ce n'est une bonne décision que si on sait la dire en délais et en coûts, dans les mots du client.

ce que ça coûte

C'est plus long que de livrer le chiffre, et la version honnête est parfois la moins impressionnante.

06

Concevoir pour qui maintiendra

Des budgets écrits, de vraies frontières, du code partagé là où deux produits se recoupent.

YEPA

YEPA a un seul ingénieur à plein temps, moi, donc toute règle qui dépend de la mémoire finira par ne pas être appliquée. La barrière de déploiement lit le diff d'infrastructure et s'arrête si un changement remplaçait une table ou un pool d'utilisateurs. Des limites de taille par type de fichier, et une procédure écrite pour extraire une fonctionnalité vers le paquet partagé, font le même travail côté code.

SAFE

Le présent d'un day trader dure quelques heures, celui d'une caisse de pension un trimestre, et si cette frontière est apprise par le modèle, servir les deux publics oblige à réannoter le corpus et à tout réentraîner. Sur SAFE, les seuils temporels vivent donc dans un fichier de configuration, et les dates explicites n'atteignent jamais le réseau : changer ce que « présent » veut dire est une ligne, pas un réentraînement.

ce que ça coûte

Un garde-fou coûte le jour où on l'écrit. Il rapporte le jour où quelqu'un est fatigué.

Ce que je fais vraiment

  1. 01Problème
  2. 02Comprendre
  3. 03Concevoir
  4. 04Construire
  5. 05Expliquer
  6. itérer: Construire → Comprendre · apprendre: Expliquer → Problème

Construire

Je mène une idée de rien jusqu'à ce qu'elle tourne devant de vrais utilisateurs, sans quitter le code.

FlowerCam permettait à une cliente restée chez elle de piloter un robot dans un vrai magasin, et j'ai écrit le serveur vidéo qui rendait cet appel possible.

Structurer

Je conçois des systèmes qui restent compréhensibles quand quelqu'un d'autre les rouvre un an plus tard.

SAFE lit l'actualité financière et situe chaque événement dans le temps, alors que personne n'est d'accord sur ce que veut dire « récent ».

Décider

Je fixe la direction, je répartis le travail, et j'assume l'arbitrage quand les réponses se contredisent.

Chez YEPA, je suis le seul ingénieur à plein temps : tout désaccord entre la recherche, les freelances et le produit finit sur mon bureau.

Enseigner

Je transforme quelque chose de compliqué en quelque chose qu'on peut tenir en main, puis je vérifie que c'est bien le cas.

La plupart de mes étudiants arrivent sans savoir faire un site web et repartent capables d'en construire un qui fonctionne, et de le prouver.