<?xml version="1.0" encoding="utf-8"?><?xml-stylesheet type="text/xsl" href="rss.xsl"?>
<rss version="2.0" xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/">
    <channel>
        <title>Florian JUDITH Blog</title>
        <link>https://florian.testruction.io/blog</link>
        <description>Florian JUDITH Blog</description>
        <lastBuildDate>Sat, 03 Oct 2026 00:00:00 GMT</lastBuildDate>
        <docs>https://validator.w3.org/feed/docs/rss2.html</docs>
        <generator>https://github.com/jpmonette/feed</generator>
        <language>fr</language>
        <item>
            <title><![CDATA[La cohésion ne se déploie pas]]></title>
            <link>https://florian.testruction.io/blog/la-cohesion-ne-se-deploie-pas</link>
            <guid>https://florian.testruction.io/blog/la-cohesion-ne-se-deploie-pas</guid>
            <pubDate>Sat, 03 Oct 2026 00:00:00 GMT</pubDate>
            <description><![CDATA[Ancien de l'outsourcing offshore, j'ai passé des années à traverser la distance en personne pour bâtir de la cohésion. J'ai démissionné quand le DevOps, le cloud et les conteneurs l'ont rendue obsolète. Le Covid m'a fait rallumer ce muscle plus tôt que prévu. Les agents le rallument pour de bon — en recréant une distance que personne ne peut plus aller franchir.]]></description>
            <content:encoded><![CDATA[<p>J'ai été outsourceur offshore. Pendant des années, mon métier n'était pas de gouverner des centres de livraison à distance : c'était d'aller les créer, puis d'y retourner — physiquement, régulièrement — pour une raison que les SOW ne savaient pas écrire. La cohésion. Faire en sorte que l'équipe de là-bas et l'équipe d'ici se sentent appartenir au même projet. On ne pilote pas ça par tableau de bord. On prend l'avion.</p>
<p>Il y a onze ans, j'ai démissionné. Pas par lassitude : par lucidité. Je voyais le DevOps, le 12-factor, le cloud et la conteneurisation en train de dissoudre le problème que je résolvais. La distance devenait bon marché à franchir. La proximité — co-localisation, <em>you build it you run it</em>, le product owner dans la pièce — gagnait la guerre. Mon métier, le type qu'on envoie recréer du lien par-dessus la frontière, devenait une relique. J'ai eu raison de partir. Je commence à croire que j'ai eu tort de croire que ce muscle était mort.</p>
<!-- -->
<p>Le Covid a été le premier rappel. Du jour au lendemain, des organisations entières se sont remises à gérer des équipes opaques, distantes, pilotées par instruments — et j'ai senti le vieux réflexe se rallumer, avant que la plupart ne comprennent ce qui se passait. La distance que l'agilité croyait avoir tuée n'était pas morte. Elle était cachée par le bureau partagé.</p>
<p>Les agents sont le second rappel, et le plus brutal. Déployer une flotte d'agents, c'est rétablir exactement la distance que j'ai passé ma carrière à franchir — sauf qu'il n'y a plus personne de l'autre côté à qui rendre visite. On ne prend pas un café avec un agent. On n'aligne pas une flotte d'agents par un dîner d'équipe. La thèse de ce billet, posée crûment : <strong>l'agilité a si bien gagné la guerre de la proximité qu'elle a détruit le muscle qui gérait la distance — et nous redéployons aujourd'hui la distance sans l'outil qui servait à la refermer.</strong> La cohésion ne se déploie pas.</p>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="oubliez-loffshore-que-vous-croyez-connaître">Oubliez l'offshore que vous croyez connaître<a href="https://florian.testruction.io/blog/la-cohesion-ne-se-deploie-pas#oubliez-loffshore-que-vous-croyez-conna%C3%AEtre" class="hash-link" aria-label="Lien direct vers Oubliez l'offshore que vous croyez connaître" title="Lien direct vers Oubliez l'offshore que vous croyez connaître" translate="no">​</a></h2>
<p>Avant d'aller plus loin, il faut tuer une lecture paresseuse, parce que c'est elle qui va vous faire décrocher. Quand j'écris « offshore », vous entendez probablement « main-d'œuvre pas chère, loin, pour faire baisser le coût ». C'est la version décorative. Ce n'est pas celle qui est utile ici, et ce n'est même pas celle qui a fait vivre ou mourir les centres de livraison.</p>
<p>Ce que l'offshore a vraiment produit, c'est une <strong>machinerie sociale</strong> : l'ensemble des rituels, des gabarits, des gestes qu'on a inventés pour collaborer à travers une frontière opaque avec quelqu'un qu'on ne voyait pas travailler. Le vrai problème n'a jamais été le coût horaire. Ça, c'était la ligne du business case. Le vrai problème, celui qui faisait échouer un centre à vingt millions pendant qu'un autre tournait, c'était la confiance, l'alignement et le transfert de savoir par-dessus une distance. Le coût était l'argument de vente ; la distance était le métier.</p>
<p>Et c'est précisément cette distinction que l'agilité a brouillée en gagnant. En supprimant la distance physique — squads co-localisées, QA embarquée, livraison continue — elle a rendu la machinerie sociale invisible, puis superflue, puis oubliée. On n'a pas décidé que gérer la distance était inutile. On a simplement arrêté d'avoir de la distance à gérer. Le savoir-faire ne s'est pas périmé : il a perdu son terrain d'exercice. Pendant dix ans, personne n'a eu besoin de prendre l'avion pour recréer du lien, parce que tout le monde était déjà dans la même pièce — ou à un appel vidéo de l'être.</p>
<p>Déployer des agents, c'est rouvrir ce terrain. Vous récupérez d'un coup une main-d'œuvre industrialisée, opaque, « de l'autre côté » — et vous découvrez que les gestes pour la gérer, vous les avez désappris. Pire : certains ne se rejouent plus du tout. C'est là que commence l'inventaire — ce qui se transfère, ce qui s'invente, et le seul réflexe qui, lui, vous trahira.</p>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="ce-qui-se-transfère">Ce qui se transfère<a href="https://florian.testruction.io/blog/la-cohesion-ne-se-deploie-pas#ce-qui-se-transf%C3%A8re" class="hash-link" aria-label="Lien direct vers Ce qui se transfère" title="Lien direct vers Ce qui se transfère" translate="no">​</a></h2>
<p>Deux disciplines offshore se rejouent presque à l'identique sur une flotte d'agents.</p>
<p><strong>La confiance à travers l'opacité.</strong> Je n'ai jamais regardé un développeur offshore coder. J'ai construit des rituels pour fabriquer une confiance que je ne pouvais pas observer directement : critères d'acceptation, revues de jalon, portes de qualité, reporting. Exactement ce que vous rebâtissez aujourd'hui autour d'un agent — eval gates, revue humaine, rituel d'approbation. Le problème est identique : produire de la confiance sans voir le travail. Le réflexe offshore se transfère sans retouche, et il arrive déjà entraîné.</p>
<p><strong>Le transfert de savoir vers la boîte.</strong> Le SOW qu'on écrivait jusqu'à la douleur, le runbook, la spec « si détaillée qu'elle fait mal » — c'est votre contexte, votre prompt, votre spec d'agent, réincarnés. Même discipline, et surtout <strong>même mode d'échec</strong> : sous-spécifiez, et la boîte produit quelque chose de plausible et de faux, exactement comme le centre offshore livrait au pied de la lettre une consigne mal écrite. Celui qui a souffert d'un SOW bâclé sait déjà pourquoi votre agent part en vrille — et il sait que la réponse n'est pas « un meilleur modèle », c'est « une meilleure consigne ».</p>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="ce-qui-sinvente">Ce qui s'invente<a href="https://florian.testruction.io/blog/la-cohesion-ne-se-deploie-pas#ce-qui-sinvente" class="hash-link" aria-label="Lien direct vers Ce qui s'invente" title="Lien direct vers Ce qui s'invente" translate="no">​</a></h2>
<p>Ici, le transfert s'arrête net, et c'est le cœur de ce que j'ai à dire.</p>
<p>La partie de mon métier qui n'avait rien à voir avec le pilotage, c'était la cohésion : le déplacement, le dîner d'équipe, la présence physique qui faisait que deux équipes séparées par six mille kilomètres se sentaient appartenir au même projet. Ce geste-là <strong>n'a aucun équivalent agent.</strong> On ne prend pas l'avion pour aligner une flotte. Il n'y a personne à qui serrer la main, personne à mettre à l'aise, personne dont la déférence culturelle masque un désaccord qu'un bon dîner ferait sortir.</p>
<p>Ce qui veut dire que la cohésion, côté agents, ne se transfère pas : elle se réinvente, et elle se déplace. Elle ne vit plus entre vous et la boîte — il n'y a rien dans la boîte à aligner. Elle vit <strong>entre les humains au contact de la boîte.</strong> Vos développeurs, votre QA, vos opérateurs qui, chacun, promptent, corrigent, approuvent un peu différemment. La dérive que je combattais jadis — douze donneurs d'ordre onshore, douze consignes subtilement différentes à un seul centre — se rejoue intégralement, mais entièrement du côté onshore. La frontière culturelle n'est plus entre ici et là-bas. Elle est entre vous et votre collègue d'à côté, médiée par un agent qui amplifie vos divergences au lieu de les absorber. Le muscle à réinventer, ce n'est pas « gouverner l'agent ». C'est <strong>gouverner la cohérence des humains qui le tiennent</strong> — sans l'outil qui marchait, la proximité, puisqu'elle est déjà là et n'a rien résolu.</p>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="ce-qui-vous-trahit">Ce qui vous trahit<a href="https://florian.testruction.io/blog/la-cohesion-ne-se-deploie-pas#ce-qui-vous-trahit" class="hash-link" aria-label="Lien direct vers Ce qui vous trahit" title="Lien direct vers Ce qui vous trahit" translate="no">​</a></h2>
<p>Reste un réflexe, un seul, et c'est le plus dangereux parce qu'il est juste assez proche pour sembler transférable.</p>
<p>L'offshore m'a entraîné au <strong>temps dilaté.</strong> La boucle de correction coûtait cher et traînait : décalage horaire, aller-retour nocturne, perte du feedback en temps réel. D'où le réflexe : sur-spécifier en amont, batcher le feedback, parce qu'une correction tardive est hors de prix. Vingt ans de delivery distribué ont gravé ce réflexe dans une génération de managers.</p>
<p>L'agent inverse tout. La boucle est <strong>effondrée</strong> : la correction est gratuite et instantanée. Le manager qui rejoue le réflexe offshore va sur-spécifier et sous-itérer — écrire le SOW géant, lancer, attendre, inspecter — là où l'économie de l'agent récompense l'exact inverse : spec mince, boucle rapide, correction dans l'instant. Et l'ironie se referme : le temps effondré, c'est précisément le réflexe que l'agilité m'a vendu il y a onze ans. Celui pour lequel j'ai démissionné. La synthèse que personne ne détient encore, c'est <strong>une gouvernance de la confiance façon offshore qui tourne à la cadence de l'agilité</strong> — le muscle de la distance, mais câblé sur la boucle courte. Ni le vétéran offshore ni l'agiliste pur ne l'ont : le premier a la gouvernance mais le mauvais tempo, le second a le tempo mais a oublié la gouvernance.</p>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="le-poste-que-nous-avons-supprimé">Le poste que nous avons supprimé<a href="https://florian.testruction.io/blog/la-cohesion-ne-se-deploie-pas#le-poste-que-nous-avons-supprim%C3%A9" class="hash-link" aria-label="Lien direct vers Le poste que nous avons supprimé" title="Lien direct vers Le poste que nous avons supprimé" translate="no">​</a></h2>
<p>Regardez votre organigramme. L'équipe plateforme possède la tuyauterie. L'équipe data possède les modèles. Qui possède la cohérence des humains au contact de la boîte — la dérive entre dix opérateurs, l'alignement des consignes, la confiance qu'on ne peut pas observer ? Personne. La case est vide.</p>
<p>Elle n'a pas toujours été vide. Elle portait un nom : le delivery manager, le responsable de la transition de services, le type qu'on envoyait recréer du lien par-dessus la frontière. L'agilité a supprimé ce poste parce qu'elle avait supprimé la frontière — et elle a eu raison, tant que la frontière restait supprimée. Sauf qu'on vient de la rouvrir. Nous avons effacé le rôle exactement au moment où il redevenait porteur, et nous confions aujourd'hui la partie la plus difficile — coordonner l'opacité — à l'équipe la moins entraînée pour ça, en croyant que c'est un problème d'outillage.</p>
<p>Alors voici le pari, daté, que vous pourrez me rejeter à la figure dans dix-huit mois : <strong>les équipes qui réussiront le déploiement d'agents à l'échelle ne seront pas celles qui auront la meilleure plateforme, mais celles qui auront reconstitué le muscle de la distance — et elles iront le chercher chez des gens que l'agilité avait déclarés obsolètes.</strong> Pas pour leur plateforme. Pour leur cicatrice.</p>
<p>Je suis parti il y a onze ans convaincu que ce métier était fini. Je commence à ranger mes certitudes. On peut déployer une flotte en une après-midi ; on ne déploie pas la confiance qui la tient. Celle-là, il faut encore aller la chercher — et il n'y a plus d'avion à prendre. La cohésion ne se déploie pas. C'est tout le problème, et c'est le vôtre maintenant.</p>]]></content:encoded>
            <category>AI</category>
            <category>Management</category>
            <category>Offshore</category>
        </item>
        <item>
            <title><![CDATA[Agent producteur, agent produit : deux plateformes, un seul mot]]></title>
            <link>https://florian.testruction.io/blog/agent-producteur-agent-produit</link>
            <guid>https://florian.testruction.io/blog/agent-producteur-agent-produit</guid>
            <pubDate>Sat, 19 Sep 2026 00:00:00 GMT</pubDate>
            <description><![CDATA[Ma carte des plateformes agentiques tient-elle face à la CNCF, au platform engineering et aux analystes ? Elle converge, diverge sur deux points, et révèle une distinction que personne ne fait : l'agent qu'on produit contre l'agent qui produit.]]></description>
            <content:encoded><![CDATA[<p>Dans un <a class="" href="https://florian.testruction.io/blog/couches-plateformes-agentiques">précédent billet</a>, j'ai posé une carte : sept couches, deux préoccupations transverses, de quoi situer chaque terme et savoir de quelle couche relève votre prochain problème. Une carte maison. Reste à savoir si elle tient debout face à ce que l'écosystème décrit de son côté.</p>
<p>La réponse courte : elle converge avec la CNCF et le platform engineering sur presque toutes les frontières, elle diverge sur un point que j'assume — et elle bute sur une distinction que peu de gens font explicitement, alors qu'elle décide de tout : <strong>l'agent qu'on produit n'est pas l'agent qui produit.</strong> C'est la thèse de ce billet. Le reste est l'étayage.</p>
<!-- -->
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="la-convergence--personne-ne-dessine-les-mêmes-couches-tout-le-monde-décrit-les-mêmes-tensions">La convergence : personne ne dessine les mêmes couches, tout le monde décrit les mêmes tensions<a href="https://florian.testruction.io/blog/agent-producteur-agent-produit#la-convergence--personne-ne-dessine-les-m%C3%AAmes-couches-tout-le-monde-d%C3%A9crit-les-m%C3%AAmes-tensions" class="hash-link" aria-label="Lien direct vers La convergence : personne ne dessine les mêmes couches, tout le monde décrit les mêmes tensions" title="Lien direct vers La convergence : personne ne dessine les mêmes couches, tout le monde décrit les mêmes tensions" translate="no">​</a></h2>
<p>Première surprise en confrontant la carte aux sources : les modèles en couches abondent, mais aucun ne fait autorité au sens strict.</p>
<p>Les documents qui <em>font</em> autorité ne dessinent pas de couches. Le <a href="https://tag-app-delivery.cncf.io/whitepapers/platforms/" target="_blank" rel="noopener noreferrer" class="">Platforms White Paper de la CNCF</a> liste des <em>capacités</em>, pas des strates. Gartner raisonne en plans de supervision et va jusqu'à écrire que les modèles de référence statiques sont inutiles face à des agents qui bougent à la nanoseconde — position frontalement opposée à l'exercice cartographique. L'autorité existe, mais elle refuse de faire la carte.</p>
<p>Les modèles qui <em>dessinent</em> des couches ne font pas autorité : ils viennent d'analystes indépendants et de blogs de fournisseurs. <a href="https://aimultiple.com/agentic-ai-stack" target="_blank" rel="noopener noreferrer" class="">AIMultiple</a> propose sept couches aussi, avec une lecture moat/commoditisation proche de mon tableau d'achat — mais empile la gouvernance en couche 7 au lieu de la traiter en transverse. Le stack Letta/a16z, repris par <a href="https://www.oreilly.com/radar/the-ai-agents-stack-2026-edition/" target="_blank" rel="noopener noreferrer" class="">O'Reilly</a>, tient en cinq couches orientées <em>construction d'un agent</em>. Seul <a href="https://www.catio.tech/blog/agentic-ai-reference-architecture" target="_blank" rel="noopener noreferrer" class="">Catio</a> partage mon parti pris : séparer les composants (perception, raisonnement, mémoire, action) des <em>plans transverses</em> (orchestration, observabilité, sécurité, gouvernance).</p>
<p>Le découpage exact varie donc d'une carte à l'autre. Ce qui ne varie pas, ce sont les tensions décrites : accès aux modèles à centraliser, protocoles à standardiser, état à gérer, coût à borner, gouvernance à rendre omniprésente. Ma carte ne découvre rien ; elle range ces tensions dans un ordre défendable.</p>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="le-platform-engineering-nomme-lhypothèse-qui-casse">Le platform engineering nomme l'hypothèse qui casse<a href="https://florian.testruction.io/blog/agent-producteur-agent-produit#le-platform-engineering-nomme-lhypoth%C3%A8se-qui-casse" class="hash-link" aria-label="Lien direct vers Le platform engineering nomme l'hypothèse qui casse" title="Lien direct vers Le platform engineering nomme l'hypothèse qui casse" translate="no">​</a></h2>
<p>Le déplacement le plus utile vient d'une discipline plus ancienne. Le Platforms White Paper pose deux principes qui s'appliquent à ma carte sans retouche : la plateforme interne est un produit, et on construit <strong>la couche la plus mince possible</strong> au-dessus des implémentations managées. Traduit : couches 1, 2 et 5 s'achètent, 3 se construit, le reste doit rester remplaçable.</p>
<p>Puis, dans <a href="https://www.cncf.io/blog/2026/07/21/platform-engineering-for-the-agentic-enterprise-managing-applications-resources-and-ai-agents/" target="_blank" rel="noopener noreferrer" class="">« Platform engineering for the agentic enterprise »</a> (juillet 2026), la CNCF nomme l'hypothèse implicite de dix ans d'<em>Internal Developer Platforms</em> : <strong>le consommateur de la plateforme est un développeur humain</strong>. L'agent casse cette hypothèse. Il provisionne, déploie, investigue des incidents, déclenche des workflows. Il devient un consommateur au même titre, avec une exigence supplémentaire : identité propre, permissions restreintes, piste d'audit. La conclusion est explicite — pas de plateforme séparée pour l'IA, mais une extension de la plateforme existante.</p>
<p>Deux conséquences pour ma carte :</p>
<ul>
<li class=""><strong>La couche 7 est plus large que je ne l'avais dit.</strong> Portail, CLI, GitOps et serveur MCP sont quatre surfaces de la même plateforme. Si elles ne partagent pas le même modèle de gouvernance, vous n'avez pas une plateforme avec quatre surfaces — vous en avez deux.</li>
<li class=""><strong>Le contexte devient une capacité, pas un accessoire.</strong> Topologie, propriété, dépendances, historique de déploiement : l'agent qui diagnostique un échec a besoin de savoir <em>qui possède quoi</em>, pas seulement de retrouver un document. C'est plus exigeant que le RAG de la couche 5.</li>
</ul>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="les-standards-durcissent-dans-le-sens-de-la-carte">Les standards durcissent, dans le sens de la carte<a href="https://florian.testruction.io/blog/agent-producteur-agent-produit#les-standards-durcissent-dans-le-sens-de-la-carte" class="hash-link" aria-label="Lien direct vers Les standards durcissent, dans le sens de la carte" title="Lien direct vers Les standards durcissent, dans le sens de la carte" translate="no">​</a></h2>
<p>Côté normalisation, trois signaux datés confirment les tendances que la carte annonçait :</p>
<ul>
<li class=""><strong>Couche 1 — la conformité arrive.</strong> Le <a href="https://www.cncf.io/announcements/2025/11/11/cncf-launches-certified-kubernetes-ai-conformance-program-to-standardize-ai-workloads-on-kubernetes/" target="_blank" rel="noopener noreferrer" class="">Kubernetes AI Conformance Program</a>, lancé en novembre 2025, définit un socle minimal pour exécuter des charges IA. La <a href="https://www.cncf.io/announcements/2026/03/24/cncf-nearly-doubles-certified-kubernetes-ai-platforms/" target="_blank" rel="noopener noreferrer" class="">révision de mars 2026</a> a durci les exigences (codifiées en <em>Kubernetes AI Requirements</em>) et fait passer les plateformes certifiées de 18 à 31. Une couche qui se certifie est une couche qui se banalise : ma maturité « élevée » est confirmée, et le risque s'y déplace vers le gateway plutôt que vers le runtime.</li>
<li class=""><strong>Couches 4 et 6 — la gouvernance des protocoles change le calcul du lock-in.</strong> MCP a été <a href="https://www.anthropic.com/news/donating-the-model-context-protocol-and-establishing-of-the-agentic-ai-foundation" target="_blank" rel="noopener noreferrer" class="">donné à l'Agentic AI Foundation</a> sous Linux Foundation en décembre 2025, <a href="https://www.linuxfoundation.org/press/linux-foundation-announces-the-formation-of-the-agentic-ai-foundation" target="_blank" rel="noopener noreferrer" class="">rejoint par A2A en août 2026</a>. Mon « faible si protocole standard » n'est plus un pari : les deux protocoles sont sous gouvernance neutre. Ce qui reste ouvert, c'est la couche 6 elle-même — aucun standard ne décrit encore comment <em>orchestrer</em> des agents, seulement comment ils se <em>parlent</em>.</li>
<li class=""><strong>Transverses A et B — le travail est déjà cadré.</strong> Le document <a href="https://www.cncf.io/blog/2026/03/23/cloud-native-agentic-standards/" target="_blank" rel="noopener noreferrer" class="">Cloud native agentic standards</a> (CNCF AI TCG, mars 2026) ouvre quatre chantiers : communication, observabilité, gouvernance, sécurité. Deux points à retenir tels quels. <strong>L'identité de l'agent n'est pas celle de l'utilisateur</strong> : dès qu'un agent agit hors session ou au-delà du périmètre de son commanditaire, il lui faut une identité de charge de travail propre (SPIFFE/SPIRE, comptes de service scopés, jetons courts), sinon l'audit ne veut rien dire. Et l'observabilité agentique n'est pas l'observabilité applicative : tokens, coût d'inférence, durée d'exécution, trajectoires — les <a href="https://opentelemetry.io/docs/specs/semconv/gen-ai/gen-ai-agent-spans/" target="_blank" rel="noopener noreferrer" class="">conventions sémantiques GenAI d'OpenTelemetry</a> donnent déjà de quoi instrumenter.</li>
</ul>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="la-divergence-que-jassume--paroi-pas-couche-fondamentale">La divergence que j'assume : paroi, pas couche fondamentale<a href="https://florian.testruction.io/blog/agent-producteur-agent-produit#la-divergence-que-jassume--paroi-pas-couche-fondamentale" class="hash-link" aria-label="Lien direct vers La divergence que j'assume : paroi, pas couche fondamentale" title="Lien direct vers La divergence que j'assume : paroi, pas couche fondamentale" translate="no">​</a></h2>
<p>Sur un point, je ne suis pas la CNCF. Elle raisonne depuis Kubernetes et traite la gouvernance comme une <strong>couche fondamentale obligatoire</strong> — sans elle, rien ne démarre. Ma carte en fait une <strong>paroi transverse</strong>.</p>
<p>La nuance n'est pas cosmétique. Une couche fondamentale est en dessous : on la pose, puis on empile. Une paroi longe toute la hauteur : elle s'applique <em>à chaque</em> couche, de l'inférence à l'interface. Traiter la gouvernance comme un socle, c'est risquer de croire qu'une fois posée, elle est acquise. La traiter comme une paroi, c'est se rappeler qu'une permission gouverne l'appel d'outil (couche 4) autant que la surface d'interface (couche 7), et qu'aucune couche n'en est exemptée.</p>
<p>Leur cadrage est plus strict que le mien — « rien ne démarre sans gouvernance » est une bonne règle. Mais il naît d'un contexte Kubernetes où le socle est littéral. Hors de ce contexte, la paroi décrit mieux la réalité : la gouvernance n'est pas une étape, c'est une exigence permanente.</p>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="le-cadre-de-fournisseur--platform-engineering-20">Le cadre de fournisseur : Platform Engineering 2.0<a href="https://florian.testruction.io/blog/agent-producteur-agent-produit#le-cadre-de-fournisseur--platform-engineering-20" class="hash-link" aria-label="Lien direct vers Le cadre de fournisseur : Platform Engineering 2.0" title="Lien direct vers Le cadre de fournisseur : Platform Engineering 2.0" translate="no">​</a></h2>
<p>Un troisième corpus circule, et il demande une précaution de lecture. <a href="https://platformengineering.org/blog/introducing-platform-engineering-2-0-an-evolution-for-the-ai-era" target="_blank" rel="noopener noreferrer" class="">Platform Engineering 2.0</a> (juin 2026) est un cadre directionnel commandité par Broadcom, co-écrit avec VMware. Ni standard, ni certification : <a href="https://moorinsightsstrategy.com/field-notes/platform-engineering-must-modernize-for-agentic-ai/" target="_blank" rel="noopener noreferrer" class="">Moor Insights le formule sans détour</a>, c'est un argument de fournisseur, en partie prospectif, dont l'implémentation proposée se trouve vendre de l'infrastructure. Ses cinq piliers restent largement indépendants du produit — mais on ne les lit pas comme un document de fondation neutre.</p>
<p>Ce sont d'ailleurs des <strong>piliers, pas des couches</strong>. Les versions qui vous les présentent empilés en stack ont reconstruit le modèle. Deux de ces piliers corrigent ma carte :</p>
<ul>
<li class=""><strong>FinOps embarqué.</strong> Dans mon billet précédent, « la facture explose » était attribuée à l'absence de mesure par appel en couche 1. C'est vrai mais incomplet. L'outillage de coût actuel est rétrospectif : il dit ce que vous avez dépensé <em>après</em>. Le pilier propose de faire apparaître le coût <em>au moment du provisionnement</em>, avec ses alternatives. Mesurer ne suffit pas ; il faut arbitrer avant. La couche 1 n'était que la moitié de la réponse.</li>
<li class=""><strong>Sécurité « shift-down ».</strong> Le shift-left n'a pas échoué, mais la surface d'attaque agentique — injection de prompt, fuite par inférence, exécution non relue — est un problème de runtime qu'un scan de pipeline ne voit pas. D'où l'isolation descendue dans le substrat : microVM et sandbox (Firecracker, gVisor, Kata Containers) plutôt qu'un conteneur partagé, dès que la couche 4 exécute du code que personne n'a lu.</li>
</ul>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="la-distinction-que-personne-ne-fait--produire-un-agent-produire-avec-un-agent">La distinction que personne ne fait : produire un agent, produire avec un agent<a href="https://florian.testruction.io/blog/agent-producteur-agent-produit#la-distinction-que-personne-ne-fait--produire-un-agent-produire-avec-un-agent" class="hash-link" aria-label="Lien direct vers La distinction que personne ne fait : produire un agent, produire avec un agent" title="Lien direct vers La distinction que personne ne fait : produire un agent, produire avec un agent" translate="no">​</a></h2>
<p>C'est ici que la confrontation devient vraiment utile. À côté de PE 2.0 s'est installée la catégorie des <strong>agentic development platforms</strong> (ADP), à laquelle <a href="https://www.forrester.com/blogs/launching-the-agentic-development-platforms-vendor-landscape-q3-2026/" target="_blank" rel="noopener noreferrer" class="">Forrester consacre un vendor landscape depuis le troisième trimestre 2026</a> : des plateformes où humains et agents développent côte à côte.</p>
<p>Ce n'est pas l'objet de ma carte. Et pourtant les deux portent le même adjectif — « agentique ». Deux plateformes différentes, un seul mot :</p>
<ul>
<li class=""><strong>L'agent comme producteur</strong> (ADP, PE 2.0) : l'agent <em>écrit le logiciel</em>. Le goulot se déplace de l'écriture vers la mise en production — PE 2.0 avance des volumes de code multipliés par deux à dix. La plateforme doit absorber un débit de PR, de revues et d'environnements éphémères qu'elle n'a jamais eu à encaisser.</li>
<li class=""><strong>L'agent comme produit</strong> (ma carte) : l'agent <em>est le logiciel livré</em>. Ce qui compte devient la mémoire, la reprise après compaction, la coordination.</li>
</ul>
<p>Les deux partagent leur socle — couches 1 et 2 — et leurs deux parois, puis divergent franchement. Aucune couche de livraison à haut débit n'apparaît dans ma carte, et c'est délibéré : elle relève du monde producteur. Symétriquement, la couche 5 (mémoire, connaissance) est quasi absente des modèles ADP, et c'est cohérent — un agent qui produit du code n'a pas besoin de mémoire persistante ; un agent qu'on met en production, si.</p>
<p>Cette distinction explique la moitié des malentendus de réunion. « On va mettre un agent là-dessus » ne désigne pas la même plateforme selon qui parle : l'un pense à un copilote qui accélère l'équipe, l'autre à un service autonome en production. Mêmes mots, budgets, risques et propriétaires différents.</p>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="ce-que-la-confrontation-aura-servi">Ce que la confrontation aura servi<a href="https://florian.testruction.io/blog/agent-producteur-agent-produit#ce-que-la-confrontation-aura-servi" class="hash-link" aria-label="Lien direct vers Ce que la confrontation aura servi" title="Lien direct vers Ce que la confrontation aura servi" translate="no">​</a></h2>
<p>Ma carte n'en sort ni invalidée ni sacralisée. Elle converge avec l'écosystème là où ça compte, diverge sur la gouvernance-paroi pour de bonnes raisons, et gagne deux corrections utiles — le coût qui s'arbitre avant, la sécurité qui descend dans le substrat.</p>
<p>Mais le vrai gain est la distinction producteur/produit. Elle ne figure sur aucune des cartes voisines, et c'est elle qui décide si votre prochain « agent » a besoin d'une couche 5 ou d'une couche de livraison à haut débit. Avant de choisir une plateforme, demandez-vous lequel des deux agents vous construisez. Le mot ne le dira pas pour vous.</p>]]></content:encoded>
            <category>Agentic Platforms</category>
            <category>Architecture</category>
            <category>AI</category>
        </item>
        <item>
            <title><![CDATA[Anatomie d'une plateforme agentique]]></title>
            <link>https://florian.testruction.io/blog/couches-plateformes-agentiques</link>
            <guid>https://florian.testruction.io/blog/couches-plateformes-agentiques</guid>
            <pubDate>Sat, 12 Sep 2026 00:00:00 GMT</pubDate>
            <description><![CDATA[LLM, agent, agentique, MCP : une cartographie en sept couches pour situer chaque terme et savoir de quelle couche vient ton prochain problème.]]></description>
            <content:encoded><![CDATA[<p>« On va coller un agent là-dessus. »</p>
<p>Dans la même réunion : pour l'un, c'est un appel LLM avec un prompt système. Pour l'autre, c'est un orchestrateur multi-agents avec mémoire persistante et sandbox d'exécution. Personne ne bronche. Tout le monde hoche la tête.</p>
<p>LLM, agent, agentique, mémoire long / moyen / court terme, MCP, RAG, A2A… comment ranger tout ça, que dois-je prioriser : acheter, construire, héberger, louer, distribuer, centraliser ?</p>
<p>D'où cette cartographie : <strong>sept couches, deux préoccupations transverses</strong>. Pas de classement, pas de fournisseur à te recommander — juste de quoi situer chaque terme et comprendre <strong>de quelle couche</strong> vient ton prochain problème.</p>
<p>Attention, ce n'est pas un modèle neutre. Deux partis pris le traversent — traiter sécurité et observabilité comme des <em>parois</em> plutôt que comme des couches, et lire la même cartographie de deux façons opposées — et je les assume plus loin. D'autres cartographies existent ; celle-ci a un point de vue.</p>
<!-- -->
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="la-cartographie">La cartographie<a href="https://florian.testruction.io/blog/couches-plateformes-agentiques#la-cartographie" class="hash-link" aria-label="Lien direct vers La cartographie" title="Lien direct vers La cartographie" translate="no">​</a></h2>
<p>Reprenons l'étagère. Sept niveaux empilés, un pour chaque type de jouet : une place par étage, et la règle qui vaut partout — <em>on ne laisse rien traîner par terre</em>. Ranger, ce n'est pas caser au hasard ; c'est savoir de quel étage relève chaque chose.</p>
<p>Sept dalles empilées, donc, et deux parois qui les longent sur toute la hauteur : les préoccupations transverses. Chaque dalle porte ses composants types peints au sol, colorés selon leur nature — brique différenciante à construire, service managé, infrastructure, standard ouvert, surface utilisateur, ou composant encore émergent.</p>
<p><img decoding="async" loading="lazy" alt="Vue isométrique de sept dalles empilées, de 01 Compute et inférence en bas à 07 Interface et surfaces en haut. Chaque dalle porte ses composants types, colorés selon leur nature : brique différenciante à construire, service managé, infrastructure, standard ouvert, surface utilisateur, composant émergent. Deux parois translucides longent la pile sur toute sa hauteur : A Sécurité et gouvernance, B Observabilité et évaluation." src="https://florian.testruction.io/assets/images/agentic-ai-architecture-layers-v1.0-6fb3b229ba4c0e1922fe9d0e66d2d1e3.png" width="1800" height="1800" class="img_Q6x2"></p>
<p>Pourquoi sécurité et observabilité sont <strong>transverses</strong> et pas des couches à part ? Parce qu'elles ne se glissent pas <em>entre</em> deux strates : elles s'appliquent <em>à chacune</em>. Une permission gouverne aussi bien l'appel d'outil (couche 4) que la surface d'interface (couche 7) ; une trace instrumente aussi bien l'inférence (couche 1) que la coordination multi-agents (couche 6). Les ranger dans une couche, c'est les rétrograder au rang de simple module — et se rendre compte trop tard qu'elles auraient dû être partout. La règle « on ne laisse rien traîner par terre » ne vit pas sur un étage : elle vaut pour tous.</p>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="les-sept-couches">Les sept couches<a href="https://florian.testruction.io/blog/couches-plateformes-agentiques#les-sept-couches" class="hash-link" aria-label="Lien direct vers Les sept couches" title="Lien direct vers Les sept couches" translate="no">​</a></h2>
<table><thead><tr><th>#</th><th>Couche</th><th>Responsabilité</th><th>Composants types</th></tr></thead><tbody><tr><td>1</td><td>Compute &amp; inférence</td><td>Faire tourner les modèles et router les requêtes</td><td>Accélérateurs (GPU/TPU), serving (vLLM, TGI), model gateways, routing multi-modèles</td></tr><tr><td>2</td><td>Modèles</td><td>Fournir la capacité de raisonnement/génération</td><td>Foundation models, fine-tunes, petits modèles spécialisés (SLM)</td></tr><tr><td>3</td><td>Orchestration / runtime</td><td>Exécuter la boucle agentique et gérer l'état</td><td>Boucle act-observe-verify, planning, gestion d'état, mémoire de session</td></tr><tr><td>4</td><td>Outils &amp; intégrations</td><td>Donner à l'agent des capacités d'action</td><td>Function calling, MCP, connecteurs, sandbox d'exécution</td></tr><tr><td>5</td><td>Mémoire &amp; connaissance</td><td>Fournir le contexte durable et récupérable</td><td>RAG, vector stores, knowledge graphs, mémoire persistante</td></tr><tr><td>6</td><td>Coordination multi-agents</td><td>Faire collaborer plusieurs agents</td><td>Orchestrateur/workers, délégation, sous-agents, protocoles (A2A)</td></tr><tr><td>7</td><td>Interface &amp; surfaces</td><td>Exposer l'agent à l'humain et aux systèmes</td><td>Chat, IDE, dashboards, exécution planifiée (cron), webhooks</td></tr></tbody></table>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="où-ça-casse">Où ça casse<a href="https://florian.testruction.io/blog/couches-plateformes-agentiques#o%C3%B9-%C3%A7a-casse" class="hash-link" aria-label="Lien direct vers Où ça casse" title="Lien direct vers Où ça casse" translate="no">​</a></h2>
<p>La cartographie devient vraiment utile quand tu t'en sers comme grille de diagnostic. Une étagère rangée se dérange toute seule dès que personne ne sait plus de quel étage relève quoi — chaque symptôme ci-dessous, c'est un jouet remis au mauvais niveau, ou laissé par terre.</p>
<table><thead><tr><th>Symptôme</th><th>Couche en cause</th></tr></thead><tbody><tr><td>La facture explose sans qu'on sache pourquoi</td><td><strong>1</strong> — pas de gateway, donc pas de mesure par appel</td></tr><tr><td>Changer de modèle t'oblige à toucher au code métier</td><td><strong>1</strong> — accès aux modèles non centralisé</td></tr><tr><td>L'agent « oublie » au milieu d'une tâche longue</td><td><strong>3</strong> — pas d'état après compaction du contexte</td></tr><tr><td>Chaque outil te coûte une intégration sur mesure</td><td><strong>4</strong> — pas de protocole standard</td></tr><tr><td>L'agent a fait un truc destructeur</td><td><strong>A</strong> — rayon d'impact non borné, pas d'approbation</td></tr><tr><td>Impossible de dire si la v2 est meilleure que la v1</td><td><strong>B</strong> — sans evals, la fiabilité, c'est une opinion</td></tr><tr><td>Ajouter un canal (cron, webhook) = tout réécrire</td><td><strong>7</strong> — logique agentique couplée à la surface</td></tr></tbody></table>
<p>Si plusieurs lignes te parlent, il y a de fortes chances qu'elles ne pointent pas vers le même responsable dans ton organisation. Et c'est souvent ça, le vrai problème.</p>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="deux-lectures-de-la-même-cartographie">Deux lectures de la même cartographie<a href="https://florian.testruction.io/blog/couches-plateformes-agentiques#deux-lectures-de-la-m%C3%AAme-cartographie" class="hash-link" aria-label="Lien direct vers Deux lectures de la même cartographie" title="Lien direct vers Deux lectures de la même cartographie" translate="no">​</a></h2>
<h3 class="anchor anchorTargetStickyNavbar_tyhp" id="si-tu-portes-larchitecture">Si tu portes l'architecture<a href="https://florian.testruction.io/blog/couches-plateformes-agentiques#si-tu-portes-larchitecture" class="hash-link" aria-label="Lien direct vers Si tu portes l'architecture" title="Lien direct vers Si tu portes l'architecture" translate="no">​</a></h3>
<p><em>Ce que tu cherches à optimiser : la cohérence, une dette maîtrisée, des dépendances lisibles.</em></p>
<ul>
<li class=""><strong>Couche 1 — le gateway, c'est le seul point qui dure.</strong> Centraliser l'accès aux modèles derrière une interface unique, ça découple tout le reste du fournisseur. Trois jours de boulot qui t'en épargnent trente.</li>
<li class=""><strong>Couche 3 — c'est là que se joue le produit.</strong> Ce qui te différencie, ce n'est pas le framework d'orchestration, c'est la gestion d'état : reprise après compaction, idempotence des étapes. Le framework, tu le remplaces ; un état mal pensé, tu le paies.</li>
<li class=""><strong>Couche 4 — MCP transforme « N agents × M outils » en « N + M ».</strong> Et le sandboxing arrête d'être négociable dès l'instant où l'agent exécute du code.</li>
<li class=""><strong>Couche 7 — c'est ton test de maturité.</strong> Si la logique agentique sait sur quelle surface elle tourne, chaque nouveau canal devient une réécriture. Découpler le runtime de la surface, c'est exactement ce qui sépare une vraie plateforme d'une démo.</li>
<li class=""><strong>Transverses — reformule la question.</strong> Pas « est-ce que l'agent est sûr ? » mais « quelle est sa pire action possible, et qui l'approuve ? ».</li>
</ul>
<h3 class="anchor anchorTargetStickyNavbar_tyhp" id="si-tu-portes-la-décision-dachat">Si tu portes la décision d'achat<a href="https://florian.testruction.io/blog/couches-plateformes-agentiques#si-tu-portes-la-d%C3%A9cision-dachat" class="hash-link" aria-label="Lien direct vers Si tu portes la décision d'achat" title="Lien direct vers Si tu portes la décision d'achat" translate="no">​</a></h3>
<p><em>Ce que tu cherches à optimiser : le risque, le coût total, la dépendance, la maturité.</em></p>
<table><thead><tr><th>Couche</th><th>Build vs Buy</th><th>Coût dominant</th><th>Lock-in</th><th>Maturité</th></tr></thead><tbody><tr><td>1. Compute &amp; inférence</td><td>Buy</td><td>Usage (tokens / heure GPU)</td><td>Élevé sans gateway</td><td>Élevée</td></tr><tr><td>2. Modèles</td><td>Buy / Build (fine-tunes)</td><td>Prix par token, fine-tuning</td><td>Moyen (portable via gateway)</td><td>Élevée</td></tr><tr><td>3. Orchestration / runtime</td><td>Build ou framework OSS</td><td>Ingénierie interne</td><td>Moyen à élevé si propriétaire</td><td>Moyenne</td></tr><tr><td>4. Outils &amp; intégrations</td><td>Buy + standard (MCP)</td><td>Intégration &amp; maintenance</td><td>Faible si protocole standard</td><td>Moyenne</td></tr><tr><td>5. Mémoire &amp; connaissance</td><td>Buy / Build</td><td>Stockage + requêtes vectorielles</td><td>Moyen</td><td>Moyenne-élevée</td></tr><tr><td>6. Coordination multi-agents</td><td>Build</td><td>Ingénierie</td><td>Faible</td><td>Faible (early)</td></tr><tr><td>7. Interface &amp; surfaces</td><td>Buy / Build</td><td>Licences par siège</td><td>Moyen</td><td>Élevée</td></tr></tbody></table>
<p><strong>Cinq questions à poser avant de signer quoi que ce soit :</strong></p>
<ul>
<li class="">Est-ce que l'accès aux modèles passe par un gateway standard ?</li>
<li class="">Est-ce que les outils passent par un protocole ouvert (MCP) ?</li>
<li class="">Est-ce que la mémoire est exportable — et dans quel format ?</li>
<li class="">Est-ce que les traces et les coûts s'exportent vers ton observabilité déjà en place ?</li>
<li class="">Est-ce que la sécurité et l'audit sont natifs, ou vendus plus tard en add-on ?</li>
</ul>
<p>Une réponse floue sur l'une des cinq, ça passe. Deux, c'est un pattern.</p>
<h2 class="anchor anchorTargetStickyNavbar_tyhp" id="ce-que-cette-cartographie-ne-dit-pas">Ce que cette cartographie ne dit pas<a href="https://florian.testruction.io/blog/couches-plateformes-agentiques#ce-que-cette-cartographie-ne-dit-pas" class="hash-link" aria-label="Lien direct vers Ce que cette cartographie ne dit pas" title="Lien direct vers Ce que cette cartographie ne dit pas" translate="no">​</a></h2>
<p>Ce qu'elle t'apporte est modeste, mais utile : un vocabulaire commun. Le jour où l'architecte dit « c'est un problème de couche 3 » et que l'acheteur comprend pourquoi ça ne se réglera pas en changeant de fournisseur, la cartographie a fait son job. La chambre n'est jamais rangée une fois pour toutes — mais au moins, tout le monde sait enfin de quel étage relève quoi.</p>
<p><strong>Un mot sur les normes, tant qu'on y est.</strong> Sous la couche 2, une norme ISO existe déjà : <em>ISO/IEC 23053</em> décompose l'anatomie d'un système d'apprentissage automatique — modèle, entraînement, inférence, tâche. C'est le dictionnaire normatif de ta couche 2, et du bord de la couche 1. Mais il <strong>s'arrête au modèle</strong> : la boucle agentique, MCP, la coordination multi-agents, les surfaces (couches 3 à 7) n'ont <strong>aucun équivalent ISO</strong>. Quant aux deux parois, elles relèvent d'autres normes de la même famille (SC 42) — <em>42001</em> pour la gouvernance, <em>23894</em> pour le risque — pas de 23053. Autrement dit : la moitié basse de l'étagère a un dictionnaire officiel, la moitié agentique n'en a pas encore. Ce n'est pas un trou dans la cartographie, c'est <em>pourquoi</em> elle est utile.</p>
<p>Reste une question qu'elle ne tranche pas : est-ce qu'elle tient la route face à ce que la CNCF, le platform engineering et les analystes décrivent de leur côté ? Elle converge avec eux sur la plupart des frontières, diverge sur deux points que j'assume — et bute sur une distinction que personne ne fait vraiment : celle entre l'agent qu'on <em>produit</em> et l'agent qui <em>produit</em>. <a class="" href="https://florian.testruction.io/blog/agent-producteur-agent-produit">C'est justement le sujet d'un second billet.</a></p>]]></content:encoded>
            <category>Agentic Platforms</category>
            <category>Architecture</category>
            <category>AI</category>
        </item>
    </channel>
</rss>