"Clawable" : Qu'est-ce qui rend un agent de tâches prêt (et pourquoi la plupart ne le sont pas)

DEV - 08/04
J'utilise un agent IA sur un MacBook 2014 avec 8 Go de RAM depuis 19 jours. Voici le plus utile...

J'utilise un agent IA sur un MacBook 2014 avec 8 Go de RAM depuis 19 jours. Voici le modèle mental le plus utile que j’ai trouvé pour décider ce qu’il faut confier à un agent – ​​et ce qu’il faut garder entre des mains humaines.

Le problème dont personne ne parle

Les agents de construction de tout le monde. Mais très peu de gens posent la bonne question avant de le faire :

Cette tâche est-elle réellement prête pour l'agent ?

J'ai vu des agents échouer, non pas parce qu'ils n'étaient pas assez intelligents, mais parce que la tâche elle-même était mal définie. L'agent n'avait aucun moyen de savoir quand il réussissait. Aucun moyen de vérifier son propre état. Aucun moyen de récupérer en cas de problème.

Le projet OpenClaw (176 000 étoiles, entièrement construites par des agents d'IA se coordonnant les uns avec les autres) a un concept pour cela. Ils l'appellent "Griffable".

J'y pense depuis des semaines. Voici ma version de ce que cela signifie.

Qu'est-ce qui rend une tâche « griffable »

Une tâche est Clawable lorsqu'elle réussit quatre tests :

1. Critère de réussite déterministe

L’agent doit être capable de vérifier s’il a réussi – sans demander à un humain....
[Courte citation de 8% de l'article original]

Loading...