| Jubijub |
masklinn a écrit :
Bah la boucle que t'as listé mais avec un truc déterministe qui invoque l'IA au lieu d'avoir l'IA qui est censée se souvenir de la boucle, que ce soit intégré au service, ou bien en local (je sais pas ce que tu fais actuellement mais pareil, juste que ton harness soit pas stochastique).
Je présume que tu peux aussi faire ça avec une couche de sous-agents si le but est l'aimaxxing, mais tant que ton orchestrateur est pas déterministe tu peux pas éviter d'avoir la boucle qui se termine sans que la condition de fin soit résolue.
|
Ben y’a pas de callback, pour autant que notre infra le sache, j’ai pu soumettre le code en ligne de commande, ou utiliser notre IDE, ou utiliser un agent.
Le seul signal qu’a l’infra, c’est « hey, voilà un nouveau snapshot du code », après quoi comme dit Hepha y’a plusieurs niveau de checks qui se font. Y’a pas de callbacks, mais ils sont tous monitorables.
Apres le non-déterminisme je veux bien, mais le principe d’un agent c’est que si tu l’outilles bien, il peut mesurer le delta à la fin d’une itération entre ce qu’il a produit et un résultat, et ne pas rendre la main tant que le résultat est pourri.
La ce qui m’énerve c’est qu’il y a un Check trivial a faire (présence de warning ou de commentaires) et que l’agent le fait pas.
C’est exactement pareil qu’un agent qui implémente sum(a: int, b: int) pour toi, que le truc te dit « t’inquiètes gros, ça passe les tests », tu lances la test suite et ça foire sur 1+1.
Et l’agent te répond « ah oui s’agit d’une erreur super triviale, j’ai fait return a-b au lieu de a+b |