Voir tous les articles

Du recrutement des agents à la production : ce qu'il faut réellement faire

Agentled

Agentled - Architecte systèmes

Du recrutement des agents à la production : ce qu'il faut réellement faire

Du harnais des agents à la production : ce qu'il faut réellement faire

Les CLI agentiques ont croisé un million de développeurs actifs par semaine au début de 2026. Claude Code, Codex, Cursor Agent, OpenClaw — ils ont tous la même chose : une itération en langage naturel, des boucles de rétroaction étroites, un terminal qui semble vivant.

La plupart de cette utilisation ne concerne pas les applications. Ce sont des automatismes. Scripts de sourcing, lead scoring, agents de recherche, pipelines de contenu. La CLI donne l’impression qu’il est trivial de créer quelque chose d’utile en un après-midi.

Ensuite, vous essayez de le mettre en production, et l'après-midi devient un mois.

Nous avons discuté avec des utilisateurs expérimentés qui construisent avec tous les principaux harnais, et l'histoire est la même pour chacun d'eux : le harnais est excellent en mode développement, et tout ce que vous devez expédier en production, vous devez le construire vous-même. Plus de travaux d'ingénierie. Plus de jetons. Plus de contrats avec les fournisseurs.

Cet article porte sur cette lacune : ce qu’elle contient, ce qu’elle coûte et que faire pour y remédier.

Mode développement vs mode production

Chaque CLI agentique est optimisée pour la boucle de développement : itération rapide, état transitoire, journaux de sortie standard, tout est lié à l'environnement d'un seul développeur. C'est ce qui les rend si agréables à construire.

Le mode Prod est à l'opposé : état persistant, accès partagé, tentatives, mise en cache, observabilité, autorisations, planification. Tout ce qui a rendu le harnais agréable à construire avec est maintenant quelque chose que vous devez travailler autour.

Vous ne remplacez pas le harnais. Vous construisez une couche autour. La question est de savoir si vous créez cette couche ou si vous en utilisez une.

Les quatre choses que vous finissez par construire vous-même

1. Expansion de l'intégration

Une automatisation typique de sourcing ou de recherche s'appuie sur LinkedIn, Hunter, Spectre, Affinity, Google Search, un grattoir Web, un CRM et tout autre API vertical dont la tâche a besoin. Cela représente dix flux d'inscription, dix cartes de crédit enregistrées, dix politiques de rotation, dix modèles d'authentification différents que votre script doit gérer.

Pour un projet de week-end, très bien. Pour un flux de travail qui s'exécute toutes les 48 heures, pour toujours, au sein d'une équipe, c'est la première chose qui tombe en panne. Un essai expire. Une limite de taux change. Un fournisseur passe des clés API à OAuth. Quelqu'un part et sa clé personnelle l'accompagne.

Ce qu'une couche de production vous offre : un abonnement, un système de crédit, une facture et plus de 100 intégrations préconnectées. Vos appels CLI deviennent des appels d’outils dans la couche – pas d’authentification distincte par service.

2. Des scripts qui ne s'aggravent pas

Les sessions CLI sont conversationnelles. Vous créez un workflow, l'expédiez, fermez le terminal. La semaine prochaine, vous aurez besoin presque de la même chose : un enrichissement des leads, mais pour un segment différent. Vous recommencez. Copiez-collez l'ancienne invite, modifiez, exécutez.

Il n'existe pas de bibliothèque de blocs réutilisables. Il n’y a pas « l’étape de notation ICP qui a bien fonctionné en mars ». Il n'y a aucun moyen pour un coéquipier d'importer votre logique de notation sans hériter également de vos clés API, de votre répertoire de travail, de votre environnement local.

Vous vous retrouvez avec des dossiers de scripts quasi-dupliqués qui résolvent chacun 90 % du même problème et divergent sur les 10 derniers %. Chaque ingénieur de l'équipe a le sien.

Ce qu'une couche de production vous offre : chaque flux de travail, étape et agent réside dans un espace de travail. Vous l'enregistrez une fois et l'appelez de n'importe où : depuis un autre flux de travail, depuis la session CLI d'un coéquipier, depuis une exécution planifiée. Votre meilleure logique de notation devient un bloc nommé que votre coéquipier importe avec une seule commande.

3. Payer deux fois pour le LLM

Celui-ci est revenu à plusieurs reprises. Les utilisateurs expérimentés ont déjà Claude Pro ou Claude Teams. Ils ne veulent pas passer à un « Claude géré » qui leur facture à nouveau les jetons qu'ils allaient utiliser de toute façon.

Et l'économie des jetons en production est rude : exécuter une recherche ou une automatisation sortante sur un harnais qui enchaîne 8 à 15 appels de raisonnement par tâche s'additionne rapidement. Chaque nouvelle tentative coûte plus de jetons. Chaque réexécution d'une étape mise en cache coûte plus de jetons.

Ce qu'une couche de production vous offre : apportez votre propre Claude. Le runtime se connecte à votre abonnement Anthropic existant. Vos crédits financent l'infrastructure (intégrations, stockage, planification, mémoire) et non le LLM pour lequel vous payez déjà le Anthropic.

4. Le terminal comme piste d'audit

C'est le plus gros. Les lacunes spécifiques :

  • Aucune politique de cache. Chaque exécution réenrichit chaque contact, récupère chaque page, réévalue chaque prospect. Des étapes coûteuses sont exécutées à chaque fois car il n'y a pas de couche TTL entre l'agent et le APIs. Ce sont des jetons et des crédits API que vous brûlez à chaque exécution.
  • Aucune sémantique de nouvelle tentative. Un 429 sur Hunter signifie que l'ensemble du pipeline tombe. Vous réexécutez manuellement. Vous espérez que l’autre côté ne vous limitera plus.
  • Aucun modèle d'autorisation. Le script a un accès complet au compte qui l'exécute. Si l'agent a accès à votre Gmail, il a tous accès à votre Gmail, pour chaque flux de travail, pour toujours. Il n'y a aucune portée.
  • Aucune trace explicable. Lorsque l'agent envoie un mauvais e-mail, vous faites défiler le terminal en essayant de comprendre pourquoi. Si vous avez fermé le terminal hier, la trace a disparu.

Ce qu'une couche de production vous offre : politiques de cache par étape. Nouvelle tentative automatique avec interruption, basée sur des politiques. Autorisations définies par intégration : votre agent peut lire depuis Gmail pour ce flux de travail, écrire sur HubSpot pour celui-là, et rien d'autre. Piste d'audit entièrement structurée : chaque étape, chaque entrée, chaque sortie, chaque décision, stockée et consultable.

Combien ça coûte de construire cela vous-même

Mettez-y un numéro. Pour une équipe de cinq ingénieurs embarquant deux ou trois automatismes de production :

  • Intégrations : 2 à 4 semaines d'ingénierie pour connecter la première poignée de fournisseurs, puis une maintenance continue à mesure que les flux d'authentification évoluent.
  • Mise en cache + nouvelle tentative : 1 à 2 semaines pour une couche de stratégie par étape qui gère réellement l'interruption et respecte les limites de débit.
  • Autorisations + audit : 2 à 3 semaines pour les flux OAuth étendus, l'interface utilisateur des autorisations et un magasin d'événements consultable.
  • Planification + partage en équipe : 1 à 2 semaines pour un planificateur qui s'exécute lorsque les ordinateurs portables sont fermés et un modèle d'espace de travail qui permet aux coéquipiers de partager sans partager les clés.

Plus les jetons. Chaque étape sans cache correspond à des jetons. Chaque nouvelle tentative sans interruption correspond à des jetons. Chaque exécution qui refait un raisonnement coûteux parce que l'état n'a pas été conservé est constituée de jetons.

La plupart des équipes consomment un mois d'ingénierie et une facture de jetons 2 à 3 fois avant d'arriver à quelque chose qui est réellement livrable. Certains abandonnent et exécutent l’automatisation manuellement.

À quoi ressemble l'architecture

Vous ne quittez pas votre CLI. C'est là le point : personne ne veut arrêter d'utiliser un outil qu'il aime. Vous installez le serveur AgentLed MCP :

claude mcp add agentled -e AGENTLED_API_KEY=wsk_... -- npx -y @agentled/mcp-server

Votre CLI a désormais accès aux outils de votre espace de travail AgentLed : les plus de 100 intégrations, le Knowledge Graph, les blocs de workflow enregistrés, le planificateur. Vous continuez à construire de la même manière que vous l'étiez : langage naturel, itératif, conversationnel. Mais lorsque vous expédiez, le flux de travail réside dans l'espace de travail. Il a un calendrier. Il se met en cache. Il réessaye. Il audite. Votre coéquipier peut l'exécuter sans toucher votre ordinateur portable.

Et lorsque vous souhaitez exécuter quelque chose en dehors d'une session de discussion, vous utilisez la CLI AgentLed :

agentled run outbound-eu --heartbeat 48h

La CLI utilise votre abonnement Anthropic, communique avec le même espace de travail et écrit dans la même piste d'audit. Votre boucle de développement et votre boucle de production convergent.

Quand rester seul sur la CLI

Tous les scripts n'ont pas besoin d'une couche de production. Si vous écrivez un document unique – grattez cette page, résumez ces documents, rédigez ces e-mails une fois – votre CLI à elle seule est le bon outil. Pas d'espace de travail, pas de planification, pas de catalogue d'intégration. Juste le harnais et un environnement local. C'est pour ça qu'il est bon.

Le changement est logique lorsque :

  • Vous exécutez la même automatisation plus d'une fois par semaine.
  • Plus d'une personne dans votre équipe doit l'exécuter.
  • Le résultat est suffisamment important pour que vous vous souciez des nouvelles tentatives, de l'audit et du cache.
  • Vous dépensez de l'argent réel en abonnements ou en jetons API juste pour le faire fonctionner.

Si deux de ces éléments sont vrais, vous avez dépassé le seuil du mode développement. Vous avez besoin d’une couche de production – soit celle que vous créez, soit celle que vous adoptez.

La règle de conception

Votre CLI agentique est un environnement de développement. AgentLed est un moteur d'exécution. Ils ne sont pas en concurrence : ils constituent les deux moitiés d'une pile agent fonctionnelle.

Intégrez votre CLI. Expédier à AgentLed. Apportez votre propre Claude des deux côtés.