← Retour aux preuves

Preuve · Juillet–septembre 2026 · Systèmes agentiques

Le soir où tout a crashé — et ce que j'ai reconstruit depuis

Chronique d'un système de travail avec des agents IA : la panne, l'audit, la deuxième version.

1 · 29 juillet, 18h34

Cinq agents IA moissonnent le web pour moi depuis un quart d'heure. C'est la récolte finale de cinq semaines de travail sur un pipeline de prospection que je construis avec les ingénieurs de Talium. J'attends le résultat comme un verdict. Écran noir. Puis un message rouge : « Nous avons rencontré un problème. Réinstallez l'application. » Reboot. Même message.

Si vous avez dirigé un projet dans les années 90, vous connaissez ce froid dans le dos : le crash sous DOS, les pages envolées parce que l'autosave n'existait pas encore. Trente ans que je n'avais pas ressenti ça.

Les trois heures qui ont suivi ont été étranges. Une IA amnésique après réinstallation, qui relit ses propres documents comme un collaborateur brillant qui aurait oublié vos dix dernières réunions. Un renversement où ce n'est plus moi qui guide l'agent, mais l'agent qui me dicte les commandes pour retrouver sa propre mémoire. Une chasse au trésor dans les entrailles de la machine, avec fausses pistes, fichiers vides, et deux agents « fauchés en plein vol » dont le travail dormait dans leurs traces.

Bilan : cinq agents sur cinq récupérés. Coût du crash : une soirée. Pas par chance — par discipline. Journal de décisions. Apprentissages écrits. Versions traçables. La différence entre tout perdre et perdre quelques heures ne tenait pas à la technologie ; elle tenait à l'organisation autour d'elle.

Je m'étais arrêté là dans le premier récit. Voici la suite, parce qu'elle est moins flatteuse et plus utile.

2 · Deux jours plus tard : l'audit

Le 31 juillet, veille de vacances, j'ai confié l'audit des cinq semaines à un orchestrateur d'agents chargé de relire vingt-cinq fils de travail, cinquante-deux décisions et six sondes de validation, et de dire ce qui tenait. J'ai épuisé mon quota hebdomadaire de calcul dans la journée. L'audit s'est terminé le 3 août, par sessions de trois heures. Il a la forme d'un dépôt de travail versionné : vingt-cinq rendus de récolte, sept livrables, une quarantaine de commits — la récupération des agents du 29 juillet y est archivée — et, au sommet, une synthèse exécutive de deux pages. Trois lignes de cette synthèse m'ont coûté.

« La perte vit dans les conteneurs éphémères. » Ce qui avait failli disparaître le 29 juillet n'était pas dans les documents de fond, qui étaient solides. C'était dans les widgets, les résumés automatiques, les scripts de construction, les mails sortants — tout ce qui n'avait pas de maison. L'action humaine, l'envoi, le geste vers l'extérieur : le seul étage du système sans trace.

« Un code retour nominal ne vaut pas confirmation. » Une écriture dans ma base de connaissances avait été silencieusement perdue pendant vingt-cinq jours. Le système m'avait dit « fait ». Il n'avait rien fait. Je ne l'ai su qu'en relisant.

« La règle existe et la pratique suit un fil sur sept. » J'avais inventé, dès la deuxième semaine, une méthode de validation par sondes : un critère d'échec écrit avant chaque test, pour ne plus raconter le verdict après coup. L'audit a compté. Je l'appliquais deux fois sur quinze. Le reste du temps, je faisais précisément ce que la méthode était censée empêcher.

Et une ligne qui inverse ce que tout le monde répète en ce moment : les erreurs les plus coûteuses évitées pendant ces cinq semaines ne l'ont pas été par la confiance dans l'IA. Elles l'ont été par ma lecture. « Faites-lui confiance, lisez moins » est en tension frontale avec la preuve.

Le crash, paradoxalement, avait assaini. Le dépôt versionné est devenu la source de vérité, et l'audit a récupéré ou localisé l'essentiel des orphelins.

3 · La deuxième version

Ce que j'avais construit en juillet était un wiki vivant, tenu à jour par l'IA dans un outil de notes. Bien pour lire. Insuffisant pour opérer sous charge : à mesure que montait le nombre de dossiers, de contacts et de pièces en cours, le système fissurait — pas d'un coup, par petites pertes que je rattrapais de mémoire. Et déjà fin juillet, avant même le crash, il s'était retourné contre lui-même : la règle de relecture que j'avais imposée pour ne plus perdre d'écriture produisait l'effet inverse dès que je travaillais plusieurs dossiers en parallèle. Deux agents écrivant puis relisant le même réceptacle se disputaient la version. La sécurité que j'avais ajoutée créait la panne.

Depuis fin août, la version 2 est un harnais. Un dépôt local versionné. Des pièces de travail nommées, chacune avec un objectif écrit et une date de fin. Un protocole de trace : chaque ligne porte l'étiquette de sa source — dit par l'interlocuteur, décidé par moi, trouvé par la machine, hypothèse. Et une règle simple : l'IA écrit seule à l'intérieur, tout ce qui sort vers un humain passe par moi. L'itération est mensuelle. Le système est relu, ce qui a cassé est analysé, la version suivante porte en en-tête le motif du changement. C'est la cadence d'une industrie qui livre un nouveau Frontier Model presque chaque semaine : si vous ne relisez pas votre propre système au moins une fois par mois, c'est lui qui vous relit.

Pourquoi je raconte ça à un dirigeant

Parce que c'est exactement ce que je vois dans les entreprises. L'IA est déjà là, elle accélère la production, et personne n'a construit l'organisation qui garde la trace de ce qu'elle décide. Le crash n'est pas le risque. Le risque, c'est de ne pas savoir ce qu'on a perdu. J'ai payé pour l'apprendre sur mon propre système, à petite échelle, avant de le proposer à quelqu'un d'autre.

Le premier pas

Un appel de trente minutes, en visio, pour se dire si ça vaut quarante-cinq minutes chez vous. Je vous dis à la fin ce que je propose comme suite, ou je vous dis qu'il n'y en a pas.

Réserver un appel de découverte