| Quich |
Quich a écrit :
En parlant d'amélioration, pour ne pas cramer tout mon quota codex (en Luna max, j'atteins souvent le quota 5h ), j'utilise la partie Chat de l'app pour faire les plans et les prompts à filer à codex, et parfois pour modifier un peu de documentation. Souvent, il me donnait des prompts en inline dans "des balises codes" (je ne sais pas comment ça s'appelle sur l'appli) comme ceci : https://rehost.diberie.com/Picture/Get/r/540437 Mais la "balise" était souvent cassé en plein milieu du prompt qu'il me donnait et ça mettait la suite du prompt en "texte normal" donc à copier-coller c'était très chiant. Depuis quelques jours je n'ai plus le soucis du tout, donc c'est plus pratique. Je ne sais pas si c'est une très bonne approche cela dit, parce que les prompts qu'il me génère sont de plus en plus longs :pt1cable: Par ailleurs, j'ai installé l'app ChatGPT "officielle" sur Ubuntu 24 et non plus l'adaptation de l'app MacOS qu'on trouvait sur https://github.com/ilysenko/codex-desktop-linux et ça fonctionne correctement pour mon cas d'usage :jap: Je fais tout depuis mon téléphone : un VPS 3vCPU/20GBram/100GBssd à 8€/mois sur PacketDecreaser ; Ubuntu 24 server + xfce avec l'app desktop ChatGPT ; contrôle de codex via l'app Android ChatGPT en remote ; accès ssh/sftp avec Termius pour les actions git ou quand j'ai des fichiers à transférer ; accès au desktop via l'app Android aRDP dans un tunnel ssh si vraiment j'ai besoin de voir le desktop. J'avais installé Hermes sur le VPS avec utilisation du backend codex car le remote de l'app ChatGPT a été cassé ~24h mais finalement je ne m'en sers pas.
|
Quelques updates sur mon approche. Je cramais le quota assez vite même en sélectionnant toujours 5.6-luna depuis l'App Android. Je me suis rendu compte que j'avais laissé les définitions de certains sous agents avec du 5.6-tera, du 5.5 voire rien et qu'il choisissait le modèle de manière non pertinente. https://rehost.diberie.com/Picture/Get/r/542210 J'ai corrigé ça en mettant 5.6-luna partout mais j'avais toujours une grosse conso. J'ai fait un audit avec le chat de l'App ChatGPT, ce qui a permis d'améliorer l'agents.md et les définitions des sous-agents. Synthèse :
Citation :
Alarming symptom: development was consuming roughly 3.6 billion tokens over Aug 28–Sep 2, with about 96–97% cached input. We initially suspected context inheritance and long-lived chats. Both turned out to be secondary or mostly false leads. The current Codex strategy is therefore: Fresh compact task → bounded root coordinator → scoped implementer for substantial changes → focused tests → only justified specialist reviewers → final verification → stop. And several things we originally suspected have now been effectively ruled out as primary causes: Android Remote chat reuse, full-history subagent forking, giant tool outputs, exact-command repetition, and implementer reasoning effort. The dominant historical causes were overactive root execution, excessive iterative repository exploration/validation, repeated compaction cycles, and automatic specialist/reviewer fan-out. OLD large cached context x ~1,000 execution/reasoning cycles x many compactions = enormous usage NEW large cached context x ~200-300 cycles x 1-3 compactions = far lower usage Before, the substantial-task distribution was roughly: - Q1: 176M - median: 251M - Q3: 360M After: - Q1: 51M - median: 69M - Q3: 99M
|
Bon, par contre ma plus value dans l'histoire est assez faible : 1) je demande au chat dans l'App ChatGPT de me produire un prompt pour codex en respectant certains guidelines, pour implémenter telle feature. 2) je copie-colle le prompt à codex. 3) je copie-colle la réponse de codex à l'App ChatGPT, l'App me donne un nouveau prompt de vérification indépendante. 4) je copie-colle le prompt de vérification dans une nouvelle session codex. 5a) si la vérification ne ressort aucun problème (rarement le cas), l'implémentation est validée. 5b) si la vérification ressort des problèmes, je copie-colle la réponse de codex suite à la vérification à l'App ChatGPT pour qu'il me donne un prompt de remédiation et on repart en étape 2 jusqu'à arriver en 5.a. J'ai déjà une liste de features à implémenter qui sont relativement bien spécifiées avec des priorités, donc c'est assez chiant de devoir faire ça où je ne sers globalement qu'à faire du copier-coller. Vu que j'ai mis Hermes sur le VPS, j'essaie d'automatiser cela via Hermes (en m'appuyant sur le chat ChatGPT pour tout ce qui est conf/archi), en utilisant sur des modèles dispos via NVIDIA Build pour éviter de bouffer le quota codex et pour garder les contextes bien séparés, mais c'est pour l'instant un échec. Auriez-vous des idées ? Edit : et merci pour les infos sur les resets, il me restait 15% en weekly hier soir, j'ai lancé une tâche de review en 6-astra medium sur un point particulier et il a trouvé pas mal de trucs, ça a bouffé 8% du quota en 10-15 minutes, et j'ai pu commencé les corrections avec mon process habituel avant le reset :jap:
|