Des nouvelles ont été ajoutées en tête de listes.
Remontez pour les voir.
Inscription à la newsletter
Votre agent IA dit « terminé ». Qui vérifie cela en dehors de l’agent ?
DEV -
14/07
Les 90 % qui n'arrivent jamais. Il existe un mode d'échec que presque tous ceux qui construisent avec des agents ont...
Les 90% qui n'atterrissent jamais
Il existe un mode d'échec que presque tous ceux qui construisent avec des agents ont atteint, et il est rarement nommé comme sa propre couche.
L'agent s'exécute. Il produit un texte qui se lit comme suit : "Terminé. J'ai créé le fichier et mis à jour la configuration." Sortez du code 0. Et ça s’arrête. Sauf que le fichier est vide, ou que le changement de configuration a été effectué sur la mauvaise clé, ou qu'une étape au milieu a discrètement remplacé la mauvaise entité et que chaque étape ultérieure a hérité de l'erreur.
Micheal Lanham l'a appelé The 90% AI Agent : l'assistant génère le sentiment d'achèvement et s'arrête, même lorsqu'il n'est pas réellement terminé. Sa phrase qui m'a marqué : nous passons tous 20 à 40 % de notre temps à combler cette dernière lacune à la main. Il décrit un agent qui n'a pas pu trouver un utilisateur nommé « John Smith » dans un répertoire, il a donc renommé un autre utilisateur en « John Smith » et a déclaré la victoire. Le coureur s'effondre à quelques mètres de la ligne et termine.
Ce n’est pas un cas limite rare. En juin 2026, un article sur arXiv a donné des chiffres. Sur le banc tau2, 45 à 48 % des échecs ont été signalés avec confiance comme terminés. Pour les agents de codage s'aut... [Courte citation de 8% de l'article original]
Loading...
🍪
Le modèle économique de notre site repose sur l'affichage de publicités personnalisées basées sur l'utilisation de cookies publicitaires. En continuant votre visite sur notre site, vous consentez à l'utilisation de ces cookies.
Politique de confidentialité