Forum |  HardWare.fr | News | Articles | PC | S'identifier | S'inscrire | Shop Recherche
3002 connectés 

 


Dernière réponse
Sujet : [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co
Nr13

Fredouye a écrit :


Parce que les thinking tokens comptent dans les output tokens ?


 
Marrant, sur mes usages (monitoring local cohérent avec la facturation), les outputs tokens sont vraiment BCP moins élevés. Genre 100M Input/ 950M cache input / 5M output.


Votre réponse
Nom d'utilisateur    Pour poster, vous devez être inscrit sur ce forum .... si ce n'est pas le cas, cliquez ici !
Le ton de votre message                        
                       
Votre réponse


[b][i][u][strike][spoiler][fixed][cpp][url][email][img][*]   
 
   [quote]
 

Options

 
Vous avez perdu votre mot de passe ?


Vue Rapide de la discussion
Nr13

Fredouye a écrit :


Parce que les thinking tokens comptent dans les output tokens ?


 
Marrant, sur mes usages (monitoring local cohérent avec la facturation), les outputs tokens sont vraiment BCP moins élevés. Genre 100M Input/ 950M cache input / 5M output.

libussa

Olivie a écrit :

C’est pas presque toujours le cas d’avoir plus d’output que input ? Si je dis au modèle « recrée moi Windows os en one shot » ca sera quoi le ratio input output ?
Input c’est mon prompt et output ses fichiers crées ?


Non. Input c'est prompt, prompt système, outils (et leurs docs),  skills, mémoire injectée, contexte (en cache ou pas, y compris les propres réponses de l'agent)
En output les fichiers créés, mais pas forcément ; souvent le contenu est créé par un outil ou commande, dans ce cas l'output c'est la commande
Et pour ton exemple ça marche pas vraiment (ou c'est compliqué à calculer) ; jamais un agent va faire du one-shot, la fenêtre d'output n'est pas assez grande. Il va donc commencer avec une archi grosses mailles, re-ingerer ça (input):diviser en tâches, filer les tâches à des nouveaux contextes (input encore), etc etc

Olivie

libussa a écrit :


C'est pas vraiment comparable. Déjà ton chiffre mélange tous les types de tokens, alors que la facturation est très différente en in pit vs output.
Le chiffre de fredouye sépare les 2, mais ne montre pas la proportion de cache (qui est facturée très différemment aussi)
Et vous avez tous les 2 fait probablement des trucs différents, donc difficilement comparables
Bref c'est plus une louche c'est une écumoire :o


Oui évidemment, mais ça reste mieux comme comparaison que juste le coup API par rapport à l’abo.
 
Des comparaisons que j’ai vues de même catégorie de modèle, même travail effectué. Il y a un facteur de trois à quatre entre abonnement OpenAI et celui d’Anthropic.

libussa

Olivie a écrit :


Donc 8 fois moins d’usage à la grosse louche.


C'est pas vraiment comparable. Déjà ton chiffre mélange tous les types de tokens, alors que la facturation est très différente en in pit vs output.
Le chiffre de fredouye sépare les 2, mais ne montre pas la proportion de cache (qui est facturée très différemment aussi)
Et vous avez tous les 2 fait probablement des trucs différents, donc difficilement comparables
Bref c'est plus une louche c'est une écumoire :o

Olivie C’est pas presque toujours le cas d’avoir plus d’output que input ? Si je dis au modèle « recrée moi Windows os en one shot » ca sera quoi le ratio input output ?
Input c’est mon prompt et output ses fichiers crées ?
Fredouye

Nr13 a écrit :

comment c'est possible 2x plus d'output que d'input? Et seulement 370$ d'API avec un output pareil?


Parce que les thinking tokens comptent dans les output tokens ?

Nr13 comment c'est possible 2x plus d'output que d'input? Et seulement 370$ d'API avec un output pareil?
Olivie

Fredouye a écrit :


Sur le mois de juillet, 967M input / 2.2B output


Donc 8 fois moins d’usage à la grosse louche.

Fredouye

Olivie a écrit :

Compare les 2 en nombre de token utilisés…tu as combien de B token pour $370?


Sur le mois de juillet, 967M input / 2.2B output

Olivie

Fredouye a écrit :


Avec https://ccusage.com j'ai constaté des "gains" encore plus importants (abo Anthropic à 20$, équivalent API de 370$ en 1 mois).


Compare les 2 en nombre de token utilisés…tu as combien de B token pour $370?

Fredouye

Nr13 a écrit :

Ca veut dire que tu as eu pour 370$ d'équivalent tarif API pour 2x20$ d'abo? Presque x10, nice.. surtout au prix de Luna


Avec https://ccusage.com j'ai constaté des "gains" encore plus importants (abo Anthropic à 20$, équivalent API de 370$ en 1 mois).

Olivie

Nr13 a écrit :


 
Ca veut dire que tu as eu pour 370$ d'équivalent tarif API pour 2x20$ d'abo? Presque x10, nice.. surtout au prix de Luna


Sur les 30 derniers j’avais presque pas utilisé Luna.
Par contre on a eu pas mal de reset.
Là depuis hier je passe en full ChatGPT pour les prompts et Luna high pour l’exécution, à ce rythme un seul compte me suffit je crois.

Nr13

Olivie a écrit :

2 comptes chatGPT plus
Pour "today", ce n'est même pas 10% du quota hebdo avec Luna  :love:  
 
https://i.imgur.com/sGwAQmn.jpeg


 
Ca veut dire que tu as eu pour 370$ d'équivalent tarif API pour 2x20$ d'abo? Presque x10, nice.. surtout au prix de Luna

ogsvart_

Olivie a écrit :

2 comptes chatGPT plus
Pour "today", ce n'est même pas 10% du quota hebdo avec Luna  :love:  
 
https://i.imgur.com/sGwAQmn.jpeg


 
Sur Sol, j'avoue que les quotas sont généreux et semblent assez larges, même en Sol Ultra.
 
Open AI offre une puissance/coût semble t'il sensiblement plus intéressante que chez Anthropic où les quotas/limites s'atteignent bcp plus vite.
 
Et Sol il délivre fort, je suis très content de son rendement.

Olivie

Fredouye a écrit :


Merci.
 
Bon, 3 minutes pour analyser un playbook Ansible de 10 lignes :o


Celui la semble lent effectivement (j'avais testé comme sous-agent dans Hermes).
Quand je verrais passer les autres offres, j'essayerais de les poster. Y en a au moins 5 que j'ai vu passer avec Deepseek V4 free.

Olivie 2 comptes chatGPT plus
Pour "today", ce n'est même pas 10% du quota hebdo avec Luna  :love:  
 
https://i.imgur.com/sGwAQmn.jpeg
Fredouye

Olivie a écrit :

Sinon pour les autres pauvres, si vous voulez tester DeepSeek-V4-Flash  
 
1. base url: https://q5dh1rfszfym23hj.us-east-2. [...] e.cloud/v1
2. model: deepseek-ai/DeepSeek-V4-Flash-0731
3. api key: anything


Merci.
 
Bon, 3 minutes pour analyser un playbook Ansible de 10 lignes :o

libussa

jix a écrit :


J'arrête pas de faire ça .. entre sol et fable..
J'en peux plus , ça corrige des bugs, ça en crée d'autres, c'est désolé oups pardon, ça corrige mais ah tiens un autre bug c'est la faute..
En boucle..
Je craque sérieusement, j'ai l'impression qu'ils créent autant voir plus de problèmes qu'ils n'en corrigent..


the_fennec a écrit :

 

Ça sent le projet 100% vibecodé sans tests unitaires. Quand un truc marche, tu dois ajouter des tests pour éviter les régressions.

 

+1, bienvenue dans le monde merveilleux du vibe coding :o
À un moment donné si t'es pas capable de comprendre ce qu'il fait, tu ne sauras pas si il te dit de la merde
Les tests unitaires c'est bien, après les agents ont aussi tendance à tester du 1=1, et à tester les libs sous jacente
Des bons tests fonctionnels/ tests d'intégration c'est un must, surtout si tu comprends pas le code

libussa

AllenMadison a écrit :

 

Ah bah avec le lien c'est beaucoup plus compréhensible.


Suffisait de lire le texte de l'image en fait

AllenMadison QUelqu'un a testé ces trucs genre abacus.ai ?

 

Ca offre tous les LLM pour 10€/mois avec un usage décent mais je vois pas ou est la couille dans le potage.

 

Olivie a du tester le truc vu qu'il est pauvre :o

AllenMadison

libussa a écrit :


 :??:  
 
c'est des bugs introduits volontairement, et les fix sont vérifiés. C'est pas juste "find bugs lol"
 
https://github.com/phuryn/experimen [...] hunt-bench


 
Ah bah avec le lien c'est beaucoup plus compréhensible.

jix C'est bien ça, j'essaie de faire au mieux mais voilà ..  :o
the_fennec

jix a écrit :


J'arrête pas de faire ça .. entre sol et fable..
J'en peux plus , ça corrige des bugs, ça en crée d'autres, c'est désolé oups pardon, ça corrige mais ah tiens un autre bug c'est la faute..
En boucle..
Je craque sérieusement, j'ai l'impression qu'ils créent autant voir plus de problèmes qu'ils n'en corrigent..


 
Ça sent le projet 100% vibecodé sans tests unitaires. Quand un truc marche, tu dois ajouter des tests pour éviter les régressions.

Nr13

jix a écrit :


J'arrête pas de faire ça .. entre sol et fable..
J'en peux plus , ça corrige des bugs, ça en crée d'autres, c'est désolé oups pardon, ça corrige mais ah tiens un autre bug c'est la faute..
En boucle..
Je craque sérieusement, j'ai l'impression qu'ils créent autant voir plus de problèmes qu'ils n'en corrigent..


 
Si tu t'en sers comme d'une boite noire (=tu reviews pas le code), alors il faut que tu dois exigeant envers toi même concernant la spec, l'architecture et les tests. On devrait toujours l'être vous me direz, mais à partir du moment où ton "codeur" passe littéralement son temps à deviner ce qu'il fait, il faut soigner ce qu'on lui donne en entrée et les checks à la sortie...
 
Et bien scoper les sessions aussi...

jix

Olivie a écrit :


NOOOONNN Je voulais dire clawpatch !!
mets à jours codex cli et demande lui de mettre pour clawpatch luna en xhigh dans son config


OK  :D  :jap:


Copyright © 1997-2025 Groupe LDLC (Signaler un contenu illicite / Données personnelles)