Forum |  HardWare.fr | News | Articles | PC | S'identifier | S'inscrire | Shop Recherche
2675 connectés 

 


Avez-vous basculé sur ChatGPT Plus ?




Attention si vous cliquez sur "voir les résultats" vous ne pourrez plus voter

 Mot :   Pseudo :  
  Aller à la page :
 
 Page :   1  2  3  4  5  ..  491  492  493  494  495  496
Page Suivante
Auteur Sujet :

[Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co

n°48167
Quich
Pouet ?
Posté le 08-09-2026 à 10:33:47  profilanswer
 

Reprise du message précédent :

Quich a écrit :

En parlant d'amélioration, pour ne pas cramer tout mon quota codex (en Luna max, j'atteins souvent le quota 5h ), j'utilise la partie Chat de l'app pour faire les plans et les prompts à filer à codex, et parfois pour modifier un peu de documentation.

 

Souvent, il me donnait des prompts en inline dans "des balises codes" (je ne sais pas comment ça s'appelle sur l'appli) comme ceci :
https://rehost.diberie.com/Picture/Get/r/540437
Mais la "balise" était souvent cassé en plein milieu du prompt qu'il me donnait et ça mettait la suite du prompt en "texte normal" donc à copier-coller c'était très chiant.
Depuis quelques jours je n'ai plus le soucis du tout, donc c'est plus pratique.

 

Je ne sais pas si c'est une très bonne approche cela dit, parce que les prompts qu'il me génère sont de plus en plus longs  :pt1cable:

 

Par ailleurs, j'ai installé l'app ChatGPT "officielle" sur Ubuntu 24 et non plus l'adaptation de l'app MacOS qu'on trouvait sur https://github.com/ilysenko/codex-desktop-linux et ça fonctionne correctement pour mon cas d'usage :jap:

 

Je fais tout depuis mon téléphone : un VPS 3vCPU/20GBram/100GBssd à 8€/mois sur PacketDecreaser ; Ubuntu 24 server + xfce avec l'app desktop ChatGPT ; contrôle de codex via l'app Android ChatGPT en remote ; accès ssh/sftp avec Termius pour les actions git ou quand j'ai des fichiers à transférer ; accès au desktop via l'app Android aRDP dans un tunnel ssh si vraiment j'ai besoin de voir le desktop.

 

J'avais installé Hermes sur le VPS avec utilisation du backend codex car le remote de l'app ChatGPT a été cassé ~24h mais finalement je ne m'en sers pas.


Quelques updates sur mon approche.

 

Je cramais le quota assez vite même en sélectionnant toujours 5.6-luna depuis l'App Android.
Je me suis rendu compte que j'avais laissé les définitions de certains sous agents avec du 5.6-tera, du 5.5 voire rien et qu'il choisissait le modèle de manière non pertinente.
https://rehost.diberie.com/Picture/Get/r/542210
J'ai corrigé ça en mettant 5.6-luna partout mais j'avais toujours une grosse conso.

 

J'ai fait un audit avec le chat de l'App ChatGPT, ce qui a permis d'améliorer l'agents.md et les définitions des sous-agents.
Synthèse :

Citation :


Alarming symptom: development was consuming roughly 3.6 billion tokens over Aug 28–Sep 2, with about 96–97% cached input. We initially suspected context inheritance and long-lived chats. Both turned out to be secondary or mostly false leads.

 

The current Codex strategy is therefore: Fresh compact task → bounded root coordinator → scoped implementer for substantial changes → focused tests → only justified specialist reviewers → final verification → stop.

 

And several things we originally suspected have now been effectively ruled out as primary causes: Android Remote chat reuse, full-history subagent forking, giant tool outputs, exact-command repetition, and implementer reasoning effort.

 

The dominant historical causes were overactive root execution, excessive iterative repository exploration/validation, repeated compaction cycles, and automatic specialist/reviewer fan-out.

 

OLD
large cached context x ~1,000 execution/reasoning cycles x many compactions = enormous usage

 

NEW
large cached context x ~200-300 cycles x 1-3 compactions = far lower usage

 

Before, the substantial-task distribution was roughly:
- Q1: 176M
- median: 251M
- Q3: 360M

 

After:
- Q1: 51M
- median: 69M
- Q3: 99M

 

Bon, par contre ma plus value dans l'histoire est assez faible :
1) je demande au chat dans l'App ChatGPT de me produire un prompt pour codex en respectant certains guidelines, pour implémenter telle feature.
2) je copie-colle le prompt à codex.
3) je copie-colle la réponse de codex à l'App ChatGPT, l'App me donne un nouveau prompt de vérification indépendante.
4) je copie-colle le prompt de vérification dans une nouvelle session codex.
5a) si la vérification ne ressort aucun problème (rarement le cas), l'implémentation est validée.
5b) si la vérification ressort des problèmes, je copie-colle la réponse de codex suite à la vérification à l'App ChatGPT pour qu'il me donne un prompt de remédiation et on repart en étape 2 jusqu'à arriver en 5.a.

 

J'ai déjà une liste de features à implémenter qui sont relativement bien spécifiées avec des priorités, donc c'est assez chiant de devoir faire ça où je ne sers globalement qu'à faire du copier-coller.

 

Vu que j'ai mis Hermes sur le VPS, j'essaie d'automatiser cela via Hermes (en m'appuyant sur le chat ChatGPT pour tout ce qui est conf/archi), en utilisant sur des modèles dispos via NVIDIA Build pour éviter de bouffer le quota codex et pour garder les contextes bien séparés, mais c'est pour l'instant un échec.
Auriez-vous des idées ?

 

Edit : et merci pour les infos sur les resets, il me restait 15% en weekly hier soir, j'ai lancé une tâche de review en 6-astra medium sur un point particulier et il a trouvé pas mal de trucs, ça a bouffé 8% du quota en 10-15 minutes, et j'ai pu commencé les corrections avec mon process habituel avant le reset :jap:


Message édité par Quich le 08-09-2026 à 10:39:09

---------------
Feedback
n°48168
magicien96
Même pas peur @sato
Posté le 08-09-2026 à 10:38:39  profilanswer
 

jix a écrit :


Tu as quand même toutes tes données en local, github et cie [:transparency]


Yes et sauvegardées sur Github :jap:


---------------
Ils ne savaient pas que c'était impossible, alors ils l'ont fait. ©Mark Twain
n°48169
Piwig
SteamID : Piwig
Posté le 08-09-2026 à 10:47:10  profilanswer
 

C'est vrai qu'on garde les données en local avec obsidian...
Tu as néanmoins raison. Après on peut adopter les deux je dirais. En tout cas pour l'instant c'est ce que j'ai en place :)

n°48170
FlorentG
Posté le 08-09-2026 à 10:49:36  profilanswer
 

Piwig a écrit :

Pour le développement logiciel, l’avancée est particulièrement intéressante : combinée à la capacité du modèle à poursuivre un objectif sur plusieurs heures, elle ouvre la voie à des agents réellement autonomes sur des tâches complexes.


Ça c'est une des avancées les plus importantes.
 
Je l'ai lancé sur la transformation de mon Excel de gestion de comptes personnels vers une application web full-fledged. On a commencé par faire un cahier des charges complet. Là il bosse depuis hier soir, et il est en train d'itérer tout seul. Je peux même voir ce qu'il fabrique à distance avec le mode Remote [:implosion du tibia]

n°48171
Jules Winn​field
порой не та...
Posté le 08-09-2026 à 10:49:39  profilanswer
 

C'est passé, Astra qui régularise les captchas ?
https://www.numerama.com/tech/23269 [...] eveux.html

n°48172
FlorentG
Posté le 08-09-2026 à 10:51:42  profilanswer
 


J'ai vu ça hier sur X. Mais il me semblait que de toute manière le captcha du genre "saisissez les lettres" ou "sélectionnez les bornes à incendies" étaient morts depuis longtemps. C'est pour ça que ReCaptcha v3 utilise une analyse comportementale avec un score heuristique à la clé.

n°48173
XaTriX
Posté le 08-09-2026 à 11:03:02  profilanswer
 

Au bout de presque 5 jours de travail avec Fable 5.1 low et quelques subagent Opus 5 xhigh je suis à 46% sur la quota Fable et 32% sur le quota tous modèles, pour un Max6.
Je pense tester une semaine entière sur Fable 5.1 xhigh, il fait l'orchestration et fait du gate aussi en subagent, voir de la review.  
Ma théorie - toujours la même - c'est qu'autant y aller à fond avec le même mode de chaque modèle pour l'efficacité/meilleure efficience. Si on peut éviter de revenir plus tard sur un truc généré par le meilleur mode, c'est de l'économie de token/temps au final.
 
En tout cas Fable 5.1 est moins débile qu'Opus 5 xhigh sur de l'orchestration/"long" run.
Astra est très bon mais putain le quota il se barre vite :o mais quand même y'a de quoi faire sur un compte à 20 boules ... alors avec les reset ;)


---------------
[:dawa]
n°48176
speedboyz3​0
Guide Michelin :o
Posté le 08-09-2026 à 11:39:13  profilanswer
 

Mevo a écrit :


Tu n'es pas forcément obligé de faire du H24, les GPUs peuvent se louer facilement à l'heure (et tu payes très peu, voire quasi rien, lorsque tu n'utilises pas. Ensuite, tu bootes le truc dès que t'as besoin, tu lances un gros batch, et tu ré-arrêtes - c'est même automatique)
 
Ca ne se vend pas "au Go", mais par GPU, donc tu ne peux pas ajuster exactement comme tu veux, il faut prendre ce qui colle à peu près pour que tu aies au moins assez + ce qu'il faut pour le contexte, tout en essayant que ce soit le moins possible (pour les $$$ :o ). En plus, ce qui est chiant est que tu ne peux généralement avoir qu'un nombre pair de GPUs. Si tu pouvais en avoir 3, ca t'arrangerait bien pour utiliser du GLM 5.3 Flash quantifié en Q4 (c'est un peu moins performant, mais ca marche tout de même bien). Ca ferait 200 Go tout rond pour du Q4 XL, mais 3 GPU, c'est pas trop possible.
 
Tu peux regarder chez AWS, ou il y a un tas de providers qui proposent ca. (Lambda, Vast, etc.)
 
Disons que si t'es quand même un peu radin comme moi ( :o ), et que tu te contentes d'une quantification en 6 bits (là, t'es bien, en rapport taille/perf). GLM 5.3 Flash Q6 XL, c'est 292 Go.
4 GPUs de 80 Go te fera 320 Go, ca devrait être chouette. De l'A100, qui est dans le "pas trop cher", mais tout de même performant, et ca a 80 Go, ca coute par exemple $2.5 de l'heure chez AWS. Donc $10 l'heure pour 4. T'as 720 ou 750 heures par mois (30 ou 31 jours) si tu veux tourner en continu (soit $7200 à $7500 par mois). EDIT: En fait, c'est 744 heures pour un mois de 31 jours, mais 750 est souvent utilisé pour tout calculer facilement :o
 
Tu dois pouoir trouver assez facilement moins cher que AWS, surtout si t'es flexible (certains providers font de super tarifs si tu acceptes de te faire éjecter dès qu'ils ont un besoin. Tu loues ce qui est inutilisé et t'acceptes de lâcher à n'importe quel moment en échange d'un bon prix).
 
Vast annonce de la H100 (une version supérieure à la A100, aussi avec 80 Go) mentionée par LibreArbitre à $2 de moyenne en ce moment et à partir de $1.33. Ca te donne à peu près les chiffres pour faire tes calculs (donc x4 et c'est par heure).


 
Intéressant  [:zyzz:2]

n°48177
Olivie
SUUUUUUUUUUUUUU
Posté le 08-09-2026 à 11:42:29  profilanswer
 

Astra Pro qui vient de disparaître dans mon app ChatGPT alors que je l’ai presque pas utilisé aujourd’hui (après reset)
 
https://img3.super-h.fr/images/2026/09/08/snapshot_6316293841480413489.jpg


---------------

n°48178
XaTriX
Posté le 08-09-2026 à 11:43:58  profilanswer
 

cheh


---------------
[:dawa]
n°48179
AllenMadis​on
Oracle du Keb's
Posté le 08-09-2026 à 11:50:16  profilanswer
 

Des nouvelles du bébou Mistralou

 

https://i.imgur.com/c3PvAcJ.png

 

On est sauvés :o

 

Et HuggingFace va héberger le modèle Le Chaton Fat

 

Fat annonces que cela


Message édité par AllenMadison le 08-09-2026 à 11:51:04

---------------
Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss.
n°48184
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 08-09-2026 à 12:32:45  profilanswer
 

AllenMadison a écrit :

Saint Tibo a délivré le reset :o


 [:bulldozer_fusion:1]

Piwig a écrit :

 

Oui !
En plus, ça va éviter qu’avec une requête mal formée on bouffe tous nos tokens dans deux secondes…
Je me demande si on peut aller plus loin en lui demandant d’estimer combien il utiliserait de pourcentage de notre abonnement pour pour un prompt…


Faut pas trop en demander non plus :O


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°48186
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 08-09-2026 à 12:52:50  profilanswer
 

Olivie a écrit :

Y a des petits soucis de réseau avec ChatGPT la…


Le gars qui veut encore gratter un reset  :O


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°48193
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 08-09-2026 à 13:24:54  profilanswer
 

Mistral donne signe de vie

Citation :

L'entreprise française d'intelligence artificielle Mistral est désormais valorisée à plus de 21 milliards d'euros, après avoir levé 3 milliards d'euros auprès du géant coréen Samsung notamment, afin de développer son infrastructure et ses travaux de recherche.


https://x.com/BFMTV/status/2097199689191874831


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°48199
Olivie
SUUUUUUUUUUUUUU
Posté le 08-09-2026 à 14:09:38  profilanswer
 

Vous avez tous encore accès à Astra Pro dans le chat ? Je suis le seul à ne plus le voir ? :o


---------------

n°48200
XaTriX
Posté le 08-09-2026 à 14:10:20  profilanswer
 

oui


---------------
[:dawa]
n°48201
Olivie
SUUUUUUUUUUUUUU
Posté le 08-09-2026 à 14:12:08  profilanswer
 

bulldozer_fusion a écrit :

Mistral donne signe de vie

Citation :

L'entreprise française d'intelligence artificielle Mistral est désormais valorisée à plus de 21 milliards d'euros, après avoir levé 3 milliards d'euros auprès du géant coréen Samsung notamment, afin de développer son infrastructure et ses travaux de recherche.


https://x.com/BFMTV/status/2097199689191874831


Cool :o
 
https://img3.super-h.fr/images/2026/09/08/snapshot_7413006242947890349.jpg


---------------

n°48202
XaTriX
Posté le 08-09-2026 à 14:23:54  profilanswer
 

OQTF :fou:


---------------
[:dawa]
 Page :   1  2  3  4  5  ..  491  492  493  494  495  496
Page Suivante

Aller à :
Ajouter une réponse
 

Sujets relatifs
sécurité de l'IA / agentique et des Devs en roue libre 
Plus de sujets relatifs à : [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co


Copyright © 1997-2025 Groupe LDLC (Signaler un contenu illicite / Données personnelles)