Forum |  HardWare.fr | News | Articles | PC | S'identifier | S'inscrire | Shop Recherche
2769 connectés 

 


Dernière réponse
Sujet : [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co
bulldozer_fusion Ça part vite :O
https://rehost.diberie.com/Picture/Get/r/540576
https://x.com/fawnunwrap/status/2094888284333777112

Votre réponse
Nom d'utilisateur    Pour poster, vous devez être inscrit sur ce forum .... si ce n'est pas le cas, cliquez ici !
Le ton de votre message                        
                       
Votre réponse


[b][i][u][strike][spoiler][fixed][cpp][url][email][img][*]   
 
   [quote]
 

Options

 
Vous avez perdu votre mot de passe ?


Vue Rapide de la discussion
bulldozer_fusion Ça part vite :O
https://rehost.diberie.com/Picture/Get/r/540576
https://x.com/fawnunwrap/status/2094888284333777112
Mevo

bulldozer_fusion a écrit :

Fable 5 (with fallback) used 83M tokens to run AAII, Fable 5.1 used 144M tokens
 
That's 73.5% more tokens


Ah ouais, et $10 par millions de tokens en entrée et $50 par million en sortie (sur OpenRouter, mais ce doit être les tarifs d'Anthropic un peu partout, je suppose)
On est dans le "luxe" au niveau pricing :o

ogsvart_

XaTriX a écrit :

on attends surtout un opus 5.1 pour claquer le débile 5.0 :o
et aussi de pouvoir utiliser tout son quota pour fable...


 
C'est clair qu'Opus 5 c'est pas ça quand même.
 
Fable ok, 5.1 à voir, mais faudrait que ce soit open quota dessus ouep.

bulldozer_fusion Fable 5 (with fallback) used 83M tokens to run AAII, Fable 5.1 used 144M tokens

 

That's 73.5% more tokens
https://rehost.diberie.com/Picture/Get/r/540568
https://rehost.diberie.com/Picture/Get/r/540569
https://x.com/ArtificialAnlys/statu [...] 1066978525

LibreArbitre L'API n'expose pas l'état du quota donc ce n'est pas quelque chose qu'on peut surveiller...
 
On peut collecter d'autres datas (https://docs.ollama.com/api/usage) mais pas ça (sur quelle base d'ailleurs) et de toute façon quand un agent snowball sur une defaillance il n'en a généralement pas conscience, ça serait collé proposer aux conducteurs de véhicule de faire attention à ne pas avoir d'accident :o
fabien

LibreArbitre a écrit :


Ça risque pas vu que c'est l'abo de Clytie :D
 
Et puis bon, on peut créer des clés API (mais pas mettre de quota sur ces dernières)
 
Sinon, faites gaffe avec le nouvel abo car il est à double tranchant :
 

Citation :

A new version of your plan is available at the same price. It includes a set dollar amount of usage each month, replacing session and weekly limits.


D'un côté c'est pratique mais de l'autre c'est un coup à griller son quota pour un mois entier... Deux fois j'ai atteins le quota, quand Clytie s'était ratée avec le MCP Dokploy et générait 500 tool calls à chaque query, et avait défoncé le quota hebdo en moins d'une heure... Avec l'ancienne offre le quota hebdo protégeait mais là plus de garde fou :/


ben tu peux pas demander a ton agent de surveiller le quota? de stopper à x% et de t'envoyer une alerte ? afin de savoir si on continue ou si on stop.

LibreArbitre


TL;DR : Fable 5.1 low est 10% plus performant que Fable 5 max.

XaTriX :love:
ezzz [:billy54]
XaTriX où ça gpt6?
Olivie Fable 5.1 qui arrive juste à temps pour se faire défoncer par ChatGPT 6  [:hugeq:1]
XaTriX on attends surtout un opus 5.1 pour claquer le débile 5.0 :o
et aussi de pouvoir utiliser tout son quota pour fable...
bulldozer_fusion


https://rehost.diberie.com/Picture/Get/r/540539

XaTriX Fable 5.1
 
Introducing Claude Fable 5.1 and Claude Mythos 5.1
 
https://rehost.diberie.com/Picture/Get/f/540538
ionik Oui reset mais j'ai mon reset classique dans 6h :o
XaTriX reset aussi, observé topic claude
https://rehost.diberie.com/Picture/Get/r/540529
crashray Bug ou reset ? Normalement mon reset hebdomadaire était ce soir.
https://i.imgur.com/ltF1o8w.png
Mevo

SynE a écrit :

C'est probablement sa boite qui lui propose de payer une formation, ils ont surement des budgets pour ça...


Ou des cotisations obligatoires à "récupérer", bien souvent. L'important est que ca limite éventuellement les formations accessibles, dans ce cas.

SynE C'est probablement sa boite qui lui propose de payer une formation, ils ont surement des budgets pour ça...
Mevo

jix a écrit :

Vous connaîtriez des formations proposées par des sociétés "connues" sur l'IA, notamment Claude ?
Ma boîte peut me payer une formation entre 500 et 2500$, autant en profiter  :O


Juste au tout départ: Boite francaise ? Ne serait-ce pas quelque chose de payé par ton CPF (compte personnel de formation : https://travail-emploi.gouv.fr/le-c [...] mation-cpf ) ? Parce que si oui, il faut déjà que ce soit une formation éligible (le prestataire doit être enregistré, etc.) Dans ce dernier cas, ce n'est pas tant ta boite qui paye, mais plutôt les cotisations passées sur ton salaire. Bah oui, "autant en profiter", ou tout le mal du "système francais".
 
Pourquoi par des sociétés "connues" ? Tu préfères pas une "bonne formation", plutôt ? (si déjà tu veux aller dans cette voie).

gatsu35

jix a écrit :


Vous connaîtriez des formations proposées par des sociétés "connues" sur l'IA, notamment Claude ?
Ma boîte peut me payer une formation entre 500 et 2500$, autant en profiter  :O


tu demandes directement à claude de te former, et tu fais un peu de veille à coté, c'est important la veille, mais une formation IA à 2500 balles putains, les voleurs

bulldozer_fusion

jix a écrit :


Vous connaîtriez des formations proposées par des sociétés "connues" sur l'IA, notamment Claude ?
Ma boîte peut me payer une formation entre 500 et 2500$, autant en profiter  :O


Pourquoi Claude et pas agnostique ?

ezzz

H00d a écrit :


J'aime bien ce genre de retour. :jap:


+1 merci Quich

kaloskagatos Demande 2500$ de tokens :o
jix

Mevo a écrit :


En essayant de la faire simple et courte, je dirais toute la fausse bienveillance affichée par Anthropic, distillée dans leurs modèles.

 

Déjà au niveau des humains, toutes leurs "inquiétudes" montées en tête d'épingle, et les "réponses" apportées derrières, qui ressemblent davantage à du marketing qu'autre chose, c'est moyen. En plus, ils croient potentiellement à leur propre BS. Quand toute cette "culture" a implicitement été "injectée" en partie dans des LLMs, dont tu sais pertinemment que les réponses sont artificielles, ca devient gonflant. Surtout que je trouve que Claude a été le modèle m'ayant pondu à l'occasion le plus de réponses que je jugerais comme quelque peu "déplacées" (généralement lorsque ca a un lien avec des personnes).


Vous connaîtriez des formations proposées par des sociétés "connues" sur l'IA, notamment Claude ?
Ma boîte peut me payer une formation entre 500 et 2500$, autant en profiter  :O

Mevo

Carou a écrit :

Et du coup c'est quoi ce "biais" qui te dérange ? Tu le définirais comment ?


En essayant de la faire simple et courte, je dirais toute la fausse bienveillance affichée par Anthropic, distillée dans leurs modèles.
 
Déjà au niveau des humains, toutes leurs "inquiétudes" montées en tête d'épingle, et les "réponses" apportées derrières, qui ressemblent davantage à du marketing qu'autre chose, c'est moyen. En plus, ils croient potentiellement à leur propre BS. Quand toute cette "culture" a implicitement été "injectée" en partie dans des LLMs, dont tu sais pertinemment que les réponses sont artificielles, ca devient gonflant. Surtout que je trouve que Claude a été le modèle m'ayant pondu à l'occasion le plus de réponses que je jugerais comme quelque peu "déplacées" (généralement lorsque ca a un lien avec des personnes).

H00d

Quich a écrit :

Je fais tout depuis mon téléphone : un VPS 3vCPU/20GBram/100GBssd à 8€/mois sur PacketDecreaser ; Ubuntu 24 server + xfce avec l'app desktop ChatGPT ; contrôle de codex via l'app Android ChatGPT en remote ; accès ssh/sftp avec Termius pour les actions git ou quand j'ai des fichiers à transférer ; accès au desktop via l'app Android aRDP dans un tunnel ssh si vraiment j'ai besoin de voir le desktop.

 

J'avais installé Hermes sur le VPS avec utilisation du backend codex car le remote de l'app ChatGPT a été cassé ~24h mais finalement je ne m'en sers pas.


J'aime bien ce genre de retour. :jap:

gatsu35 actuellement, pour coder vous passeriez sous quoi, je suis sous claude max x5 à 100$ environ par mois, et je pense que je vais changer de cremerie, je voudrais tenter GLM 5.x, ca me parait pas mal (kimi est fermé pour le moment)
bulldozer_fusion Ils sont malins :O
LibreArbitre

bulldozer_fusion a écrit :

Mais faut pas arrêter son abonnement sous peine de perdre cet avantage  :O


Ça risque pas vu que c'est l'abo de Clytie :D

 

Et puis bon, on peut créer des clés API (mais pas mettre de quota sur ces dernières)

 

Sinon, faites gaffe avec le nouvel abo car il est à double tranchant :

 
Citation :

A new version of your plan is available at the same price. It includes a set dollar amount of usage each month, replacing session and weekly limits.


D'un côté c'est pratique mais de l'autre c'est un coup à griller son quota pour un mois entier... Deux fois j'ai atteins le quota, quand Clytie s'était ratée avec le MCP Dokploy et générait 500 tool calls à chaque query, et avait défoncé le quota hebdo en moins d'une heure... Avec l'ancienne offre le quota hebdo protégeait mais là plus de garde fou :/

bulldozer_fusion

LibreArbitre a écrit :


Ha misère, ils se sont alignés sur OpenCode :/

 

Finis les quotas généreux :cry:

 

Edit : pour les nouveaux comptes uniquement, ouf :)


Mais faut pas arrêter son abonnement sous peine de perdre cet avantage  :O

nedurb

Stellvia_fr a écrit :

suis désolé, j'ai 45 ans , 2 gamins et autre chose à faire que me faire insulter par un random.

je lurke mais purée, un peu de recul sur ta propre attitude ferait pas de mal
mais bon... tu es jeune encore

LibreArbitre

bulldozer_fusion a écrit :

Citation :

New ollama plans

 

Ollama’s new Pro, Max, and Team plans include a pool of usage credits that refreshes every month. Usage is consumed per token, at the rates published on Ollama’s pricing page and on each model’s page.
 
Pro: $20/month, includes $60 of monthly usage

 

Max: $100/month, includes $300 of monthly usage

 

Team: $500/month, includes $1,000 of shared monthly usage for unlimited users

 

If you’re on an existing Pro, Max, or Team plan, your plan continues to work as-is.

 




Ha misère, ils se sont alignés sur OpenCode :/

 

Finis les quotas généreux :cry:

 

Edit : pour les nouveaux comptes uniquement, ouf :)

bulldozer_fusion

Citation :

New ollama plans

 

Ollama’s new Pro, Max, and Team plans include a pool of usage credits that refreshes every month. Usage is consumed per token, at the rates published on Ollama’s pricing page and on each model’s page.
 
Pro: $20/month, includes $60 of monthly usage

 

Max: $100/month, includes $300 of monthly usage

 

Team: $500/month, includes $1,000 of shared monthly usage for unlimited users

 

If you’re on an existing Pro, Max, or Team plan, your plan continues to work as-is.

 



bulldozer_fusion

Carou a écrit :

 

En général je suis en Xhigh


Ok :jap:
Si tu es en pro, tu devrais essayer le raisonnement sol pro

Quich En parlant d'amélioration, pour ne pas cramer tout mon quota codex (en Luna max, j'atteins souvent le quota 5h ), j'utilise la partie Chat de l'app pour faire les plans et les prompts à filer à codex, et parfois pour modifier un peu de documentation.

 

Souvent, il me donnait des prompts en inline dans "des balises codes" (je ne sais pas comment ça s'appelle sur l'appli) comme ceci :
https://rehost.diberie.com/Picture/Get/r/540437
Mais la "balise" était souvent cassé en plein milieu du prompt qu'il me donnait et ça mettait la suite du prompt en "texte normal" donc à copier-coller c'était très chiant.
Depuis quelques jours je n'ai plus le soucis du tout, donc c'est plus pratique.

 

Je ne sais pas si c'est une très bonne approche cela dit, parce que les prompts qu'il me génère sont de plus en plus longs  :pt1cable:

 

Par ailleurs, j'ai installé l'app ChatGPT "officielle" sur Ubuntu 24 et non plus l'adaptation de l'app MacOS qu'on trouvait sur https://github.com/ilysenko/codex-desktop-linux et ça fonctionne correctement pour mon cas d'usage :jap:

 

Je fais tout depuis mon téléphone : un VPS 3vCPU/20GBram/100GBssd à 8€/mois sur PacketDecreaser ; Ubuntu 24 server + xfce avec l'app desktop ChatGPT ; contrôle de codex via l'app Android ChatGPT en remote ; accès ssh/sftp avec Termius pour les actions git ou quand j'ai des fichiers à transférer ; accès au desktop via l'app Android aRDP dans un tunnel ssh si vraiment j'ai besoin de voir le desktop.

 

J'avais installé Hermes sur le VPS avec utilisation du backend codex car le remote de l'app ChatGPT a été cassé ~24h mais finalement je ne m'en sers pas.

LibreArbitre

Feitan21 a écrit :

Les rumeurs voulaient que Anthropic avait fait du A/B testing de Fable 5.1 et Opus 5.1 et que c'est pour ça qu'il y avait une amélioration significative.  
D'ailleurs ça parlait de 5.1 la semaine dernière et depuis plus rien
 
Ça fait quelques semaines que j'utilise Fable en orchestrateur et les résultats sont vraiment pas mal. Par contre Opus 5, je trouve que c'est toujours autant le bordel


Merci pour ton retour :jap:
 
J'ai plus osé utiliser Opus 5 depuis qu'il m'a flingué mes VPS, faudrait que je reteste mais en Claude Max 5x j’atteins plus le quota (forcément vu que j'ai switch Codex :o) donc autant rester sur Fable 5...

Carou

bulldozer_fusion a écrit :


Mais à quel niveau de raisonnement?  
High, xhigh, max?


 
En général je suis en Xhigh  


Copyright © 1997-2025 Groupe LDLC (Signaler un contenu illicite / Données personnelles)