Forum |  HardWare.fr | News | Articles | PC | S'identifier | S'inscrire | Shop Recherche
3824 connectés 

 


Avez-vous basculé sur ChatGPT Plus ?




Attention si vous cliquez sur "voir les résultats" vous ne pourrez plus voter

 Mot :   Pseudo :  
  Aller à la page :
 
 Page :   1  2  3  4  5  ..  461  462  463  ..  500  501  502  503  504  505
Auteur Sujet :

[Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co

n°44564
H00d
Posté le 09-08-2026 à 21:53:30  profilanswer
 

Reprise du message précédent :

AllenMadison a écrit :

D'ailleurs on les gagne comment ces fameux banked reset ? :o


Tibo en a donné quelques-uns ces deux derniers mois.

n°44565
AllenMadis​on
Oracle du Keb's
Posté le 09-08-2026 à 21:55:19  profilanswer
 

H00d a écrit :


Tibo en a donné quelques-uns ces deux derniers mois.


 
J'en ai eu qu'un seul que j'ai utilisé, je suis a sec là :o
 
Bon, demain c'est pas trop loin je peux attendre le reset :o


---------------
Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss.
n°44566
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 09-08-2026 à 22:16:24  profilanswer
 

H00d a écrit :


J'ai exprès cramé mon quota pour le reset demain, sauf que j'ai encore un reset de dispo à utiliser avant le 12. Ca va charbonner ces prochains jours. [:catalonix:10]


Pareil :D


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°44578
AllenMadis​on
Oracle du Keb's
Posté le 10-08-2026 à 10:03:52  profilanswer
 

[:leamas:5]  
 
https://i.imgur.com/3Rdl4IL.png


---------------
Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss.
n°44579
Winpoks
Posté le 10-08-2026 à 10:37:57  profilanswer
 

Astroya a écrit :

Bah ouais il est bon en com ! :o

 

D'un côté sont un peu con chez Anthropic. Ils pourraient être aussi bons en faisant des reset.  :O

n°44580
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 10:50:02  profilanswer
 

Winpoks a écrit :


 
D'un côté sont un peu con chez Anthropic. Ils pourraient être aussi bons en faisant des reset.  :O


Pourquoi feraient ils des reset quand justement leur business modèle c’est des modèles avec le même niveau que ceux de ChatGPT avec moins d’usages et moins de capacité (on est en 2026 et ils ont même pas un modèle capable de créer une image lol) ?


---------------

n°44581
XaTriX
Posté le 10-08-2026 à 10:51:06  profilanswer
 

Comment le topic est passé de "Claude, ze king" à "Claude, ze débile" en 3 jours :D


---------------
[:dawa]
n°44582
LibreArbit​re
La /root est longue
Posté le 10-08-2026 à 11:05:11  profilanswer
 

Winpoks a écrit :

D'un côté sont un peu con chez Anthropic. Ils pourraient être aussi bons en faisant des reset.  :O


Ils sont morts Anthropic, je le pense honnêtement...

 

Leur stratégie initiale reposait sur un statut de référence absolue sur les usages avancés (notamment le dev) pour créer un effet de verrouillage (vendor lock-in) auprès des entreprises, ce qui devait leur permettre de maintenir des marges élevées, d'assurer un ROI à la hauteur de leurs investissements colossaux en compute, et de préparer sereinement leur IPO...

 

Le problème, c'est qu'entre les performances d'OpenAI (GPT-5.6 :love:), la baisse agressive du coût au token (merci OpenAI et la Chine) et la poussée des modèles chinois (qui offrent du quasi-frontier pour une fraction du prix), la commoditisation de l'inférence va beaucoup plus vite que prévu.

 

Pour ne rien arranger, les fournisseurs de Cloud et les fonds de Private Credit qui financent leurs cluster de calcul attendent du rendement. Si Anthropic ne réussit pas très vite à faire un bond de géant sur le ratio performances/consommation de ressources de ses modèles, je ne vois pas comment ils soutiendront leur burn rate sans se faire distancer ou absorber par un géant...

 

Edit : c'est la réponse de Clytie mais le fond de ma pensée, juste mieux écrit :o

Message cité 1 fois
Message édité par LibreArbitre le 10-08-2026 à 11:29:02

---------------
Pharyo | Cinépite | Capvirage
n°44584
XaTriX
Posté le 10-08-2026 à 11:13:22  profilanswer
 

Ils ont le meilleur écosystème, un très bon placement, des modèles frontiers et sont le top2 avec Mythos/Fable. Le coût est un autre sujet mais si l'acquisition client continue je pense qu'ils sont au contraire en très très bonne situation :D  
Si ils sont déjà rentables...
 
A l'inverse OpenAI vit grace aux perfs de reset et autres cheap tokens mais sont au même niveau pour les modèles, donc bien placés aussi.


---------------
[:dawa]
n°44585
the_fennec
f3nn3cUs z3rd4
Posté le 10-08-2026 à 11:21:47  profilanswer
 

Dans ma boite on vient de passer à Anthropic (pour remplacer Cursor), je pense que c'est parce-qu’ils sont les meilleurs depuis longtemps.
OpenAI est peut être mieux maintenant, mais c'est quand même nouveau ...
 
Espérer des reset éternels n'est pas une stratégie viable pour une entreprise.


---------------
Faudra que je teste un jour :o
n°44586
kaloskagat​os
Posté le 10-08-2026 à 11:25:48  profilanswer
 

Et la génération d'images on s'en tape un peu :o


---------------
« Le hasard, c’est différent de la chance. Parce que la chance, je n'en ai jamais. »
n°44587
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 11:26:52  profilanswer
 

the_fennec a écrit :

Dans ma boite on vient de passer à Anthropic (pour remplacer Cursor), je pense que c'est parce-qu’ils sont les meilleurs depuis longtemps.
OpenAI est peut être mieux maintenant, mais c'est quand même nouveau ...
 


Anthropic vit clairement sur sa réputation.
Beaucoup prennent comme premier abo/api Anthropic sans savoir qu’ils ont aussi bien chez OpenAi pour moins cher
À voir combien de temps ça va durer  [:michel_cymerde:7]


---------------

n°44588
XaTriX
Posté le 10-08-2026 à 11:27:40  profilanswer
 

Moins cher pour du random à 20$
Mais osef c'est pas ça qui fera du blé pour les cloudersAI


---------------
[:dawa]
n°44589
LibreArbit​re
La /root est longue
Posté le 10-08-2026 à 11:32:21  profilanswer
 

XaTriX a écrit :

Ils ont le meilleur écosystème, un très bon placement, des modèles frontiers et sont le top2 avec Mythos/Fable. Le coût est un autre sujet mais si l'acquisition client continue je pense qu'ils sont au contraire en très très bonne situation :D  
Si ils sont déjà rentables...
 
A l'inverse OpenAI vit grace aux perfs de reset et autres cheap tokens mais sont au même niveau pour les modèles, donc bien placés aussi.


Mais XaT', t'as pas de souci avec Opus 5 toi ? Bordel, je passe plus de 10h par jour sur Claude Code et depuis presque deux semaines je demande à Claude de déléguer quasi 100% de ses tâches à Codex mais là clairement je me pose la question du remplacement de mon abo Claude 3-4 abo ChatGPT Plus tellement Opus est à chier, et si j'utilise Fable 5 en high alors mon quota de 5h fond en moins d'une heure et en quelques jours j'explose mon quota hebdo :( et le peu de tâches que je laisse à Claude il se plante (cf mes serveurs Dokploy qu'il a fait crasher hier !)


---------------
Pharyo | Cinépite | Capvirage
n°44590
XaTriX
Posté le 10-08-2026 à 11:34:25  profilanswer
 

Si si mais je fais taffer Sol et Fable :o


---------------
[:dawa]
n°44591
XaTriX
Posté le 10-08-2026 à 11:34:57  profilanswer
 

Et dans l'IA il y'a de toute façon d'énormes biais donc s'il faut dans 2 semaines je trouverais Opus géniallissime :o


---------------
[:dawa]
n°44592
LibreArbit​re
La /root est longue
Posté le 10-08-2026 à 11:37:28  profilanswer
 

XaTriX a écrit :

Si si mais je fais taffer Sol et Fable :o


Je me disais bien mais honnêtement tu devrais essayer Luna en Max (fais des bench), ça change la vie :love:
 

XaTriX a écrit :

Et dans l'IA il y'a de toute façon d'énormes biais donc s'il faut dans 2 semaines je trouverais Opus géniallissime :o


Pas impossible mais vu l'état des subreddits Anthropic et Claude Code va falloir qu'ils se bougent le cul rapido...


---------------
Pharyo | Cinépite | Capvirage
n°44594
Nr13
Posté le 10-08-2026 à 11:40:46  profilanswer
 

C'est pas si facile à évaluer "au feeling" au quotidien en effet. Quand on regarde des mecs qui bench "sérieusement" sur des vrais workload, il faut vraiment qu'ils prennent le temps de faire tourner 10+ x les mêmes scenarios car les résultats varient..
 
Là j'ai Luna max qui fait une review depuis quasi 1h, jamais eu aussi lent, par ex.

n°44595
AllenMadis​on
Oracle du Keb's
Posté le 10-08-2026 à 11:41:00  profilanswer
 

Faut une révolution dans la révolution moi je dis !


---------------
Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss.
n°44596
LibreArbit​re
La /root est longue
Posté le 10-08-2026 à 11:48:48  profilanswer
 

Nr13 a écrit :

C'est pas si facile à évaluer "au feeling" au quotidien en effet. Quand on regarde des mecs qui bench "sérieusement" sur des vrais workload, il faut vraiment qu'ils prennent le temps de faire tourner 10+ x les mêmes scenarios car les résultats varient..


Ouai alors dans mon cas j'ai sorti une 15aine de services web et une app iOS, j'y passe près de 40h par semaine depuis deux ans (6h tous les jours après le taff et 16h par jour les weekends et pendant mes congés) donc si justement, j'arrive bien à évaluer ce qui déconne, ça se voit immédiatement quand tu bosses avec tous les jours, mais effectivement pour ceux qui ont un usage familial de l'IA (ou qui se contentent de faire des benchs qui ne correspondent pas à une réalité opérationnelle) c'est plus délicat mais ça ne va pas trop les impacter du coup, contrairement à ceux qui font des mises en prod toutes les semaines...

 

Edit : je pense qu'on est quand même nombreux ici à proder régulièrement des projets sur l'IA non ? Dénoncez-vous :o

Message cité 1 fois
Message édité par LibreArbitre le 10-08-2026 à 11:50:41

---------------
Pharyo | Cinépite | Capvirage
n°44597
the_fennec
f3nn3cUs z3rd4
Posté le 10-08-2026 à 12:07:40  profilanswer
 

Olivie a écrit :


Anthropic vit clairement sur sa réputation.
Beaucoup prennent comme premier abo/api Anthropic sans savoir qu’ils ont aussi bien chez OpenAi pour moins cher
À voir combien de temps ça va durer  [:michel_cymerde:7]


 
Je pense pas que ça soit le gros de leur revenus, les débutants vont prendre un truc moins chère sur le long terme, genre GPT ou du Chinois.
 
Les grosses boites qui ne dont pas a $100 près s'en foutent des "moins chère", elles veulent du rendement.
 
En tout cas Anthropic a réussi un joli coup avec plus de 1000 devs pour le même prix que Cursor :o

Message cité 1 fois
Message édité par the_fennec le 10-08-2026 à 12:08:34

---------------
Faudra que je teste un jour :o
n°44598
XaTriX
Posté le 10-08-2026 à 12:11:12  profilanswer
 

Y'a les artefacts à la Claude dans GPT ?
Je les utilise beaucoup (bon je les export sur github.io :o mais en équipe ça doit être une tuerie), genre sur RF2 :o https://forumhfr.github.io/artifacts/


---------------
[:dawa]
n°44600
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 12:26:03  profilanswer
 

the_fennec a écrit :


 
Je pense pas que ça soit le gros de leur revenus, les débutants vont prendre un truc moins chère sur le long terme, genre GPT ou du Chinois.
 
Les grosses boites qui ne dont pas a $100 près s'en foutent des "moins chère", elles veulent du rendement.
 
En tout cas Anthropic a réussi un joli coup avec plus de 1000 devs pour le même prix que Cursor :o


Ben ton exemple avec Cursor prouve que le coût est un critère  [:michel_cymerde:7]  
Et si le responsable qui a choisi Claude au lieu de Cursor savait que vous pourriez avoir exactement les mêmes résultats pour 2 fois moins chers avec OpenAi va dire « non » ?

Message cité 1 fois
Message édité par Olivie le 10-08-2026 à 12:26:38

---------------

n°44602
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 10-08-2026 à 12:40:45  profilanswer
 

LibreArbitre a écrit :


Ils sont morts Anthropic, je le pense honnêtement...

 

Leur stratégie initiale reposait sur un statut de référence absolue sur les usages avancés (notamment le dev) pour créer un effet de verrouillage (vendor lock-in) auprès des entreprises, ce qui devait leur permettre de maintenir des marges élevées, d'assurer un ROI à la hauteur de leurs investissements colossaux en compute, et de préparer sereinement leur IPO...

 

Le problème, c'est qu'entre les performances d'OpenAI (GPT-5.6 :love:), la baisse agressive du coût au token (merci OpenAI et la Chine) et la poussée des modèles chinois (qui offrent du quasi-frontier pour une fraction du prix), la commoditisation de l'inférence va beaucoup plus vite que prévu.

 

Pour ne rien arranger, les fournisseurs de Cloud et les fonds de Private Credit qui financent leurs cluster de calcul attendent du rendement. Si Anthropic ne réussit pas très vite à faire un bond de géant sur le ratio performances/consommation de ressources de ses modèles, je ne vois pas comment ils soutiendront leur burn rate sans se faire distancer ou absorber par un géant...

 

Edit : c'est la réponse de Clytie mais le fond de ma pensée, juste mieux écrit :o


 [:fredmoul:1]


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°44603
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 10-08-2026 à 12:41:35  profilanswer
 

the_fennec a écrit :

Dans ma boite on vient de passer à Anthropic (pour remplacer Cursor), je pense que c'est parce-qu’ils sont les meilleurs depuis longtemps.
OpenAI est peut être mieux maintenant, mais c'est quand même nouveau ...

 

Espérer des reset éternels n'est pas une stratégie viable pour une entreprise.


Avec Luna pas besoin d'attendre des resets


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°44604
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 10-08-2026 à 12:42:32  profilanswer
 

LibreArbitre a écrit :


Je me disais bien mais honnêtement tu devrais essayer Luna en Max (fais des bench), ça change la vie :love:

 


 
LibreArbitre a écrit :


Pas impossible mais vu l'état des subreddits Anthropic et Claude Code va falloir qu'ils se bougent le cul rapido...


Et ils ont des choses dans les cartons chez openAI qui arrivent ce mois ci


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°44606
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 13:03:19  profilanswer
 

Mon Zuck szür
On oubliera pas que sans lui, l’open source /weight dans les LLM ne serait sans doute pas la.
 
https://img3.super-h.fr/images/2026/08/10/snapshot_6512120692915371276.jpg


---------------

n°44608
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 10-08-2026 à 13:05:42  profilanswer
 

LibreArbitre a écrit :


Ouai alors dans mon cas j'ai sorti une 15aine de services web et une app iOS, j'y passe près de 40h par semaine depuis deux ans (6h tous les jours après le taff et 16h par jour les weekends et pendant mes congés) donc si justement, j'arrive bien à évaluer ce qui déconne, ça se voit immédiatement quand tu bosses avec tous les jours, mais effectivement pour ceux qui ont un usage familial de l'IA (ou qui se contentent de faire des benchs qui ne correspondent pas à une réalité opérationnelle) c'est plus délicat mais ça ne va pas trop les impacter du coup, contrairement à ceux qui font des mises en prod toutes les semaines...

 

Edit : je pense qu'on est quand même nombreux ici à proder régulièrement des projets sur l'IA non ? Dénoncez-vous :o


Oui mais peut-être pas autant :D


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°44611
Nr13
Posté le 10-08-2026 à 13:36:05  profilanswer
 

Olivie a écrit :

Mon Zuck szür
On oubliera pas que sans lui, l’open source /weight dans les LLM ne serait sans doute pas la.
 
https://img3.super-h.fr/images/2026 [...] 371276.jpg


 
Globalement ici Google/Meta/Microsoft se font tailler sur la qualité de leur LLM (pour coder en tout cas), mais en terme d'opensource ou de contribution scientifique (des vrais papiers, voire un prix nobel lol, pas les technological report et cie), ils en font bcp bcp plus qu'openAI et anthropic

Message cité 1 fois
Message édité par Nr13 le 10-08-2026 à 13:37:12
n°44612
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 13:50:18  profilanswer
 

Nr13 a écrit :


 
Globalement ici Google/Meta/Microsoft se font tailler sur la qualité de leur LLM (pour coder en tout cas), mais en terme d'opensource ou de contribution scientifique (des vrais papiers, voire un prix nobel lol, pas les technological report et cie), ils en font bcp bcp plus qu'openAI et anthropic


Anthropic a fait quoi pour l’Open source ? :o
OpenAI a sorti 2 modèles OSS 120 et 30 il me semble et Codex est open source

Message cité 2 fois
Message édité par Olivie le 10-08-2026 à 13:50:31

---------------

n°44613
XaTriX
Posté le 10-08-2026 à 13:51:19  profilanswer
 

Faut voir s'ils poussent régulièrement sur de vrais projets :o


---------------
[:dawa]
n°44614
LibreArbit​re
La /root est longue
Posté le 10-08-2026 à 14:18:37  profilanswer
 

Olivie a écrit :

Anthropic a fait quoi pour l’Open source ? :o


Ils ont donné le source de Claude Code :o


---------------
Pharyo | Cinépite | Capvirage
n°44615
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 10-08-2026 à 14:19:11  profilanswer
 

LibreArbitre a écrit :


Ils ont donné le source de Claude Code :o


 [:jiejie999]


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°44616
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 14:31:27  profilanswer
 

Pour RTK que certains utilisent:
 

Citation :

TL;DR: rtk advertised saving: 60–90%. Measured on real agent work: +7.6% more expensive at low reasoning effort (p=0.004), ±0% at high effort. Setup: Claude Code 2.1.201 · claude-sonnet-5 low and high efforts · SkillsBench. Task quality: unchanged in both arms, at both effort levels.


 
https://blog.jetbrains.com/ai/2026/ [...] 8dd7538cb6


---------------

n°44617
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 10-08-2026 à 14:32:11  profilanswer
 

XaTriX a écrit :

Y'a les artefacts à la Claude dans GPT ?
Je les utilise beaucoup (bon je les export sur github.io :o mais en équipe ça doit être une tuerie), genre sur RF2 :o https://forumhfr.github.io/artifacts/


ChatGPT Work / sites


Message édité par bulldozer_fusion le 10-08-2026 à 14:32:31

---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°44618
XaTriX
Posté le 10-08-2026 à 14:34:32  profilanswer
 

LibreArbitre a écrit :


Ils ont donné le source de Claude Code :o


:lol:

Olivie a écrit :

Pour RTK que certains utilisent:
 

Citation :

TL;DR: rtk advertised saving: 60–90%. Measured on real agent work: +7.6% more expensive at low reasoning effort (p=0.004), ±0% at high effort. Setup: Claude Code 2.1.201 · claude-sonnet-5 low and high efforts · SkillsBench. Task quality: unchanged in both arms, at both effort levels.


 
https://blog.jetbrains.com/ai/2026/ [...] 8dd7538cb6


Annoncé depuis le début par moi même :o


---------------
[:dawa]
n°44620
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 10-08-2026 à 14:48:50  profilanswer
 

Je l'ai enlevé depuis un moment
Par contre j'ai gardé caveman et headroom :jap:


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°44621
LibreArbit​re
La /root est longue
Posté le 10-08-2026 à 14:50:25  profilanswer
 

Olivie a écrit :

Pour RTK que certains utilisent:

 
Citation :

TL;DR: rtk advertised saving: 60–90%. Measured on real agent work: +7.6% more expensive at low reasoning effort (p=0.004), ±0% at high effort. Setup: Claude Code 2.1.201 · claude-sonnet-5 low and high efforts · SkillsBench. Task quality: unchanged in both arms, at both effort levels.

 

https://blog.jetbrains.com/ai/2026/ [...] 8dd7538cb6


https://i.imgur.com/fjTMUIWl.png

 

Bah désolé de vous contredire mais je trouve l'économie pas dégueu, certes pas aussi bonne qu'espérée mais loin d'être négligeable (-42.5% quand même) !

Message cité 1 fois
Message édité par LibreArbitre le 10-08-2026 à 14:51:35

---------------
Pharyo | Cinépite | Capvirage
n°44622
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 14:55:58  profilanswer
 

LibreArbitre a écrit :


https://i.imgur.com/fjTMUIWl.png
 
Bah désolé de vous contredire mais je trouve l'économie pas dégueu, certes pas aussi bonne qu'espérée mais loin d'être négligeable (-42.5% quand même) !


Faut pousser plus loin to calcul :o
ChatGPT sur ton cas:

Citation :

Le 42,5 % n’est pas une économie de 42,5 % sur les tokens Claude. rtk gain compare la taille brute des sorties des commandes traitées par RTK avec leur taille compressée. Son « Input tokens » n’est pas le total des input tokens envoyés au modèle. Pour connaître l’économie réelle, il faut comparer la consommation/facturation totale de sessions équivalentes avec et sans RTK. C’est précisément ce que JetBrains a fait : malgré des économies énormes annoncées par rtk gain, ils ont mesuré +7,6 % de coût à low effort et ~0 % à high effort.


 
L’explication totale:

Citation :


Le glitch est dans le dénominateur. Le 42,5 % de la capture ne signifie pas « Claude a consommé 42,5 % de tokens en moins ».
 
Dans cette capture :
 
* Input tokens: 122.5M = estimation du volume brut produit par les commandes passées dans RTK
* Output tokens: 70.5M = estimation du volume après filtrage RTK
* Tokens saved: 52.1M = 122.5 − 70.5 ≈ 52.0M
* donc 52.1 / 122.5 ≈ 42.5 %
 
C’est donc essentiellement :
 
RTK a réduit de 42,5 % la sortie des commandes qu’il a traitées.
 
Ce n’est pas :
 
Claude Code a consommé 42,5 % de tokens en moins.
 
La documentation technique de RTK le confirme explicitement : son « Input tokens » correspond à la taille de la sortie brute de la commande, son « Output tokens » à la sortie filtrée, avec une estimation de tokens par ceil(chars / 4). Ce ne sont pas les compteurs de tokens facturés par Claude.  
 
Pourquoi la différence peut être énorme
 
Une session Claude Code ressemble plutôt à :
 
                       Tokens réellement consommés
┌─────────────────────────────────────────────────────┐
│ system prompt / instructions                        │
│ historique de conversation                          │
│ contexte réinjecté à chaque tour                    │
│ cache reads / cache writes                          │
│ résultats Read                                      │
│ résultats Grep                                      │
│ résultats Glob                                      │
│ raisonnement / réponses                             │
│                                                     │
│     ┌───────────────────────────────┐               │
│     │ sorties Bash accessibles RTK │               │
│     │       ↓ compression ↓        │               │
│     └───────────────────────────────┘               │
└─────────────────────────────────────────────────────┘
 
RTK calcule son 42,5 % à l’intérieur de la petite boîte, puis l’affiche comme « Token Savings ».
 
JetBrains a précisément mesuré ce problème. Dans leur benchmark, seulement environ 33 % des appels Bash étaient réécrits par RTK et ceux-ci représentaient moins de 20 % des caractères des résultats d’outils. Et les résultats d’outils ne constituent eux-mêmes qu’une fraction de l’ensemble des inputs Claude. Leur calcul préalable donnait donc un plafond d’environ 3 % d’économie sur les vrais input tokens, même en supposant une compression RTK de 70 %.  
 
Encore plus révélateur
 
JetBrains avait les deux compteurs en parallèle :
 
RTK disait :
 
96,2 millions de tokens économisés, 99,8 % d’économie sur ce qu’il avait traité.
 
Mais en comparant réellement les mêmes tâches :
 
* Claude normal
* Claude + RTK
 
la facture avec RTK était +7,6 % plus élevée à faible effort ;
à effort élevé : +0,1 %, donc essentiellement zéro différence.  
 
C’est exactement pourquoi JetBrains écrit que le scoreboard RTK « grades its own homework » : il mesure son propre flux, pas la consommation totale de l’agent.  
 
Il y avait aussi un deuxième biais important : RTK prenait historiquement la totalité de la sortie brute comme scénario contrefactuel. Par exemple, un cat produisant 1,2 Mo pouvait être comptabilisé comme ~320 000 tokens évités alors que Claude Code aurait de toute façon tronqué cette sortie avant de recevoir 320 000 tokens. RTK a depuis travaillé à corriger ce problème en plafonnant les économies attribuables à une sortie selon la limite de résultat d’outil de Claude.  
 
Dans cette capture en particulier
 
Il y a néanmoins quelque chose d’intéressant :
 
rtk read    1049 appels    28.1M "saved"
rtk grep     764 appels    12.5M "saved"
 
Cette personne utilise énormément rtk read et rtk grep. Si son agent remplace réellement ses appels Read/Grep natifs par ceux de RTK, son cas peut bénéficier davantage de RTK que le benchmark JetBrains, puisque JetBrains souligne précisément que les outils natifs Read et Grep échappent normalement au hook. Le README actuel de RTK le reconnaît également.  
 
Mais la capture ne permet absolument pas de conclure à −42,5 % de consommation Claude. Pour pouvoir dire cela, il faudrait faire un A/B :
 
mêmes tâches
même modèle
même reasoning effort
Claude Code sans RTK : X tokens facturés / X $
Claude Code avec RTK : Y tokens facturés / Y $
 
Puis calculer (X-Y)/X.
 
Donc la réponse courte à lui faire serait :
 
Le 42,5 % n’est pas une économie de 42,5 % sur les tokens Claude. rtk gain compare la taille brute des sorties des commandes traitées par RTK avec leur taille compressée. Son « Input tokens » n’est pas le total des input tokens envoyés au modèle. Pour connaître l’économie réelle, il faut comparer la consommation/facturation totale de sessions équivalentes avec et sans RTK. C’est précisément ce que JetBrains a fait : malgré des économies énormes annoncées par rtk gain, ils ont mesuré +7,6 % de coût à low effort et ~0 % à high effort

.


Message édité par Olivie le 10-08-2026 à 14:57:47

---------------

n°44623
LibreArbit​re
La /root est longue
Posté le 10-08-2026 à 14:58:46  profilanswer
 

En vrai je m'en fous vu que je suis pas facturé au token mais que j'ai mon forfait, toutefois j'avais bien senti la différence à l'époque où j'étais en offre Pro, une fois RTK activé je pouvais faire des grosses sessions alors qu'avant non, le reste après ma foi...

 

Edit : je vais pas m'amuser à bencher ça, je laisse ce travail aux journalistes, y'en a qui ont un vrai travail :o


Message édité par LibreArbitre le 10-08-2026 à 15:00:13

---------------
Pharyo | Cinépite | Capvirage
n°44625
LibreArbit​re
La /root est longue
Posté le 10-08-2026 à 15:11:14  profilanswer
 

Ouai bon, Claude donne raison à cet article :o
 

Citation :

Le mécanisme est implacable : un tour d'API supplémentaire réexpédie tout le contexte. Économiser cinq mille tokens sur une sortie mais déclencher un tour de plus qui renvoie cent mille tokens de contexte, c'est une perte nette. La compression joue à la marge, les tours jouent sur le total.
 
Et tu as déjà vécu le phénomène : ta mémoire projet XXXX note « RTK tronque head/cat, passer par node ». C'est précisément un tour supplémentaire causé par la compression.


 
Par contre il me précise bien que c'est pas à désactiver :
 

Citation :

Rien de radical : à effort élevé, le surcoût est nul, donc RTK ne te coûte rien et te sauve dans les cas extrêmes, comme ce git diff HEAD~3 qui a produit 8,3 millions de tokens bruts sur un seul appel. C'est une assurance contre le débordement de contexte, pas une source d'économie.
 
Le geste utile serait plutôt de remonter au mainteneur ton cas de troncature sur head et cat : il demande explicitement des sessions problématiques pour corriger les réécritures fautives, et tu en as une documentée.


---------------
Pharyo | Cinépite | Capvirage
 Page :   1  2  3  4  5  ..  461  462  463  ..  500  501  502  503  504  505

Aller à :
Ajouter une réponse
 

Sujets relatifs
sécurité de l'IA / agentique et des Devs en roue libre 
Plus de sujets relatifs à : [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co


Copyright © 1997-2025 Groupe LDLC (Signaler un contenu illicite / Données personnelles)