Du prototype à la production en entreprise : étendre les trois boucles d'Andrew Ng

Conçu pour la vitesse : latence d'environ 10 ms, même en cas de charge
Une méthode incroyablement rapide pour créer, suivre et déployer vos modèles !
- Gère plus de 350 RPS sur un seul processeur virtuel, aucun réglage n'est nécessaire
- Prêt pour la production avec un support complet pour les entreprises
Dans une lettre de fin juin 2026, Andrew Ng a décrit la création d'une application d'apprentissage de la dactylographie pour sa fille le temps d'un week-end — l'agent de codage travaillant en autonomie pendant environ une heure, ouvrant même un navigateur à plusieurs reprises pour vérifier son propre travail — comme l'exemple concret de ses trois boucles imbriquées pour le développement de produits IA de 0 à 1 : la boucle de codage agentique (minutes), la boucle de rétroaction des développeurs (heures) et la boucle de rétroaction externe (jours à semaines). Nous avons abordé ces boucles ailleurs — leurs rythmes, leurs modes de défaillance et la télémétrie nécessaire à chacune — dans notre guide sur l'exploitation des boucles à grande échelle. Cet article traite d'un aspect différent du cadre de Ng, celui que les lecteurs en entreprise ont soulevé, selon une chronique d'explainx.ai sur ladite lettre : que devient la boucle externe lorsque le produit n'est pas une application de week-end, mais un système d'entreprise ? La lettre de Ng admet franchement que la boucle externe consiste en « des amis, des testeurs alpha, la production avec des tests A/B ». Une chronique d'explainx.ai rapporte que les lecteurs en entreprise ont fait valoir que, dans des environnements réglementés, la boucle externe devrait également englober la politique, la gouvernance, l'audit et la responsabilité, et non seulement les expériences grand public. C'est dans cette brèche que s'inscrit cet article. La méthode des trois boucles permet une distinction utile et ne cesse pas d'être pertinente aux portes de l'entreprise — mais la boucle externe y acquiert des exigences qu'un projet de week-end ne rencontre jamais, et y répondre fait toute la différence entre un prototype de démonstration et un produit déployé au sein d'une organisation. La seconde partie associe ces exigences à des mécanismes documentés ; la limite, comme toujours, est que l'infrastructure soutient la méthode sans pour autant remplacer le jugement humain qui en est le cœur.
1. Le cadre demeure ; la boucle externe change à l'entrée de l'entreprise
Commençons par rendre justice au cadre de Ng, car cet article repose sur sa validité. Les trois boucles décrivent une réalité : la boucle agentique interne écrit et vérifie désormais le code assez rapidement pour que le travail humain se déplace vers les décisions produit (la boucle intermédiaire), et l'ensemble n'est efficace qu'à la mesure du signal externe qui valide la vision (la boucle externe). L'application de week-end de Ng est l'illustration parfaite précisément parce qu'elle est simple — la boucle externe consiste en sa fille utilisant l'application et lui changeant d'avis sur les costumes de chat et le flux de connexion des parents. Rien de tout cela n'est trivial à construire, mais les obligations de la boucle externe sont légères : personne n'audite l'application de dactylographie, aucun responsable de la conformité ne la valide, aucun auditeur ne demande qui a approuvé un changement. Appliquez maintenant la même méthode au sein d'une entreprise. La boucle interne reste inchangée — l'agent écrit et teste toujours le code toutes les quelques minutes. La forme de la boucle intermédiaire reste identique — un humain pilote toujours le processus sur une cadence horaire. Mais la boucle externe se transforme : « déployer auprès des utilisateurs » signifie désormais déployer auprès de clients, sous politique, avec responsabilité, et la rétroaction externe pertinente inclut non seulement « les gens aiment-ils cela », mais aussi « cela satisfait-il les contraintes dont l'entreprise est responsable ». Ce n'est pas une critique du cadre de Ng ; c'est l'application en entreprise de ce cadre que les lecteurs ont soulignée, selon la chronique d'explainx.ai, et c'est là qu'un projet cesse d'être un simple développement pour devenir un produit.
2. Le passage à l'échelle est un problème de boucle externe
La partie rassurante, pour toute équipe ayant adopté la méthode des trois boucles sur un prototype, est que le passage à la production ne vous demande pas de changer votre façon de construire — bien que la gouvernance soit une part majeure de la transition, elle n'est pas la seule : les équipes ont toujours besoin d'une ingénierie de production conventionnelle (déploiement, fiabilité, capacité, retour arrière, gestion des incidents, sécurité, tests au niveau applicatif), le plan de contrôle gérant la gouvernance et la couche de trafic des modèles/outils de ce système plus vaste. La boucle interne — spécification, itération agentique, portes de vérification, plafonnement des dépenses par exécution — repose sur la même discipline, que le résultat soit une application de dactylographie ou un système de traitement des réclamations. Ce qui change, c'est tout ce qui se trouve autour la boucle, et elle change car les nouvelles obligations de la boucle externe se répercutent vers l'intérieur. Un agent qui fonctionnait avec vos propres identifiants sur votre ordinateur portable nécessite désormais sa propre identité, car la question « qui a fait cela » doit avoir une réponse autre que « la clé du développeur ». Un agent dont les dépenses du week-end étaient couvertes par votre abonnement personnel a désormais besoin d'un budget avec un responsable, car quelqu'un doit rendre des comptes sur ce poste de dépense. Un agent qui n'avait accès qu'à vos données de test traite désormais des données utilisateur réelles, ce qui signifie que tout ce qui entre et sort doit être contrôlé. Et un agent dont chaque action était visible dans votre terminal s'exécute désormais dans un environnement où d'autres doivent pouvoir effectuer des vérifications, ce qui implique un enregistrement durable. Rien de tout cela ne relève de la boucle de construction ; ce sont toutes des préoccupations de la boucle externe au sens de l'entreprise — la dimension politique, gouvernance et audit de l'observation sur la gouvernance d'entreprise — et beaucoup peuvent être appliquées via l'infrastructure environnante, tandis que l'agent et l'application conservent la conception des tâches, la minimisation des données, la sémantique des outils et la logique métier. C'est en grande partie pour cette raison que le passage à l'échelle est réalisable. Une fois que le modèle d'une application et le trafic MCP enregistré sont intégrés via les passerelles appropriées, les équipes peuvent centraliser de nombreux contrôles au niveau du trafic plutôt que de les réimplémenter indépendamment dans chaque agent. L'intégration nécessite toujours des identifiants, des points de terminaison, l'application de politiques, l'enregistrement des agents, des métadonnées et le routage des outils.

3. Les trois boucles, graduées : où TrueFoundry s'intègre pour chacune

Prenez les boucles de Ng une par une et ajoutez l'exigence d'entreprise que chacune acquiert, mappée au mécanisme documenté. La boucle interne reste en place — délibérément. La boucle de codage agentique avec ses portes de vérification et ses plafonds de dépenses par exécution est la partie que vous conservez exactement telle quelle ; si elle s'exécute dans un environnement d'exécution géré, le Agent Harness fournit l'orchestration, l'état, l'exécution des outils et l'observabilité au niveau des étapes, désormais visibles par plus d'une personne ; l'application définit toujours la spécification, les tests, les critères de vérification et les conditions d'arrêt. La boucle intermédiaire devient l'évaluation et le déploiement progressif. Ng recommande déjà des évaluations lorsque la même erreur se répète ; en production, cet instinct devient une infrastructure — la télémétrie de la passerelle alimentant un système d'évaluation connecté, en ligne ou hors ligne (le modèle d'évaluation) — avec le scoreur, la politique d'échantillonnage, le calibrage, la détection de régression et la logique de promotion restant un flux de travail adjacent que l'équipe implémente ou intègre — et des poids de modèles virtuels dirigeant une part contrôlée du trafic vers une cible candidate, élargie ou restaurée par une configuration délibérée sans changer le nom du modèle utilisé par les appelants, les mécanismes que notre analyse de routage détaille. Le retour d'information du développeur, en d'autres termes, bénéficie d'un garde-fou : modifiez la spécification, déployez sur 5 % du trafic, surveillez les évaluations, élargissez ou revenez en arrière. La boucle externe acquiert sa dimension de gouvernance. C'est ici que cette observation sur la gouvernance se transforme en configuration : contrôle d'accès au modèle de compte détermine quels utilisateurs, équipes et applications peuvent appeler les modèles approuvés, tandis que pour l'attribution au niveau de l'agent sur le trafic MCP Gateway et Agent Gateway, chaque agent régi indépendamment présente une identité d'agentenregistrée, avec son enregistrement d'agent et les politiques associées définissant qui peut l'appeler, pour qui il peut agir et quelles ressources en aval il peut atteindre ; budgets attribuent les dépenses à un responsable et, lorsque l'application est activée, imposent une limite stricte — le mode avertissement seul fournit des notifications sans bloquer le trafic ; les politiques de passerelle configurées peuvent inspecter les requêtes et les réponses des modèles, ainsi que les appels d'outils MCP enregistrés qui transitent par les passerelles concernées — chaque invocation d'outil MCP est évaluée séparément ; cela ne couvre pas les outils arbitraires côté application, et les garde-fous de sortie nécessitent une réponse complète non diffusée en continu — protégeant ainsi les données réelles des utilisateurs que le prototype n'a jamais vues (documentation sur les garde-fous) ; et le tableau de bord des métriques offre une visibilité globale sur les dépenses, le volume, les erreurs, la latence, le routage et les résultats des garde-fous, tandis que les traces et les journaux de requêtes fournissent les preuves au niveau de la requête que l'« imputabilité » implique concrètement — la configuration de la journalisation détermine séparément si les corps des requêtes et des réponses sont conservés et expurgés ; les coûts, les jetons, la latence et les métadonnées de requête restent enregistrés. Le point d'avantage contextuel de Ng reste une responsabilité du cycle de développement : les équipes encodent les besoins des utilisateurs, les contraintes de domaine, les exigences de conformité et l'intention du produit via des spécifications, des invites, des jeux de données, des évaluations et des revues. Par ailleurs, Agent Harness peut suspendre les appels d'outils sensibles jusqu'à ce qu'une décision d'approbation explicite soit prise — un point de contrôle d'exécution, et non un substitut à l'autorisation ou à l'ingénierie du contexte en amont. Pour les actions sensibles nécessitant une revue explicite, une politique d'approbation crée un point de contrôle humain avant que l'outil ne s'exécute à l'étape cruciale, le modèle que notre accès basé sur les tâches analyse développe. La méthode reste inchangée ; la boucle externe a simplement gagné en mordant, et ce mordant est documenté.


TrueFoundry AI Gateway offre une latence d'environ 3 à 4 ms, gère plus de 350 RPS sur 1 processeur virtuel, évolue horizontalement facilement et est prête pour la production, tandis que LiteLM souffre d'une latence élevée, peine à dépasser un RPS modéré, ne dispose pas d'une mise à l'échelle intégrée et convient parfaitement aux charges de travail légères ou aux prototypes.













.webp)



.png)
.png)
.png)
.png)
.png)






.png)







