Forum |  HardWare.fr | News | Articles | PC | S'identifier | S'inscrire | Shop Recherche
5021 connectés 

 


Dernière réponse
Sujet : [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co
AllenMadison

LibreArbitre a écrit :

C'est ce qui est dit sur les subreddit Anthropic et Claude Code depuis des semaines hein [:zedlefou:1]

 

J'ai pas migré sur Codex par plaisir de perdre des heures par projets (j'en suis à plus de 10h de migration de conversations, contextes, formalisme, formalisations, reprises du passif, etc. et c'est loin d'être terminé)... C'est compliqué les migrations de harness [:tagazou:3]

 

Seul Fable 5 Max est utilisable mais vla la conso du quota... Et encore, quand je compare ses analyses il se fait toujours défoncer par GPT-5.6 Luna en réflexion high (pas max) !

 


 
LibreArbitre a écrit :


Ils ont acheté du compute auprès de Meta récemment mais honnêtement j'ai surtout l'impression que leurs modèles n'a plus d'étape de thinking, comme les LLM de early 2025...

 

J'ai exactement la même impression. Je suis en Fable ultra, le process en gros c'est

 

- Je pose une question
- Répond plus ou moins correctement
- Je lui donne des inputs, il me répond (la plupart du temps) "non, c'est faux", "non je ne pense pas"
- Je lui donne les bonnes réponses, il s'excuse "oui ma réponse précédente était fausse" et me propose d'améliorer encore avec plusieurs pistes
- part dans des trucs completement faux tout seul en affirmant péremptoirement
- Passe 3 plombes a le corriger en permanence
- s'excuse "oui je suis désolé, j'aurais du faire plus attention/être plus rigoureux" puis repart dans ses conneries

 

Bilan : quota bouffé, tout est inexploitable, il passe a coté des trucs évidents et balance des choses fausse, ce qu'il pourrait voir de lui même il ne l'explore pas

 

Je remarque que c'est depuis qu'ils ont caché le chain of toughts que c'est foireux comme ça. C'est juste insupportable. Je ne sais pas ce qu'il s'est passé, mais à côté, GPT Sol 5.6 sort de l'X :o


Votre réponse
Nom d'utilisateur    Pour poster, vous devez être inscrit sur ce forum .... si ce n'est pas le cas, cliquez ici !
Le ton de votre message                        
                       
Votre réponse


[b][i][u][strike][spoiler][fixed][cpp][url][email][img][*]   
 
   [quote]
 

Options

 
Vous avez perdu votre mot de passe ?


Vue Rapide de la discussion
bulldozer_fusion

LibreArbitre a écrit :

Merci Olivie :jap:

 

En fait je suis en train de migrer tous mes projets de Claude Code vers Codex (enfin vers la nouvelle app) et le temps de transmettre tous le passif ça consomme malgré tout pas mal de token, même si Luna Max est vraiment très très généreux...

 

En espérant qu'Anthropic revienne dans le game à terme...


 [:dr_doak]

bulldozer_fusion

Olivie a écrit :


Y a un nouveau reset  [:michel_cymerde:7]

 
Citation :

@thsottiaux

 

Old news actually from a bunch of days ago, but crossed that 15M. Enjoy a nice reset everyone. Landing in the next hour or so, go /fast.



Je voulais un bank reset :(

Nr13

XaTriX a écrit :

opencode2 :??:


 
C'est en beta encore non?

dante2002

speedboyz30 a écrit :

T'es libre mercredi soir ?  [:caporacaver:3]


 
J assume complètement  :D

XaTriX

dante2002 a écrit :

Sinon usage autre que du code : Gemini à enfin la mémoire activée dans le mode live.
 
Je peux ainsi discuter retrogaming avec elle dans mes trajets en voiture, et elle s’y connaît peux que les participants de forums en 2026 c’est cool  :D  
 
D autant plus que j’ai des lubies particulières (je suis passionné par le hardware des consoles des années 90, et j adore discuter de comparaisons de puissance entre le super FX2 et le Sega SVP :D)


j'ai fait un topic sur les modes live mais ça n'a pas décollé :o
 
https://forum.hardware.fr/forum2.ph [...] w=0&nojs=0

Olivie

dante2002 a écrit :

Sinon usage autre que du code : Gemini à enfin la mémoire activée dans le mode live.
 
Je peux ainsi discuter retrogaming avec elle dans mes trajets en voiture, et elle s’y connaît peux que les participants de forums en 2026 c’est cool  :D  
 
D autant plus que j’ai des lubies particulières (je suis passionné par le hardware des consoles des années 90, et j adore discuter de comparaisons de puissance entre le super FX2 et le Sega SVP :D)


Tu te rends compte combien de litre d’eau tu dépenses pour parler de retro-gaming pendant que tu roules ? :o
 

dante2002 a écrit :


 
Vous vous rendez compte de la dérive « j essaie de tout cramer »?
 
Vous vous comportez comme les gens qui se gavent jusqu’à en degueuler sur les buffets à volonté « pour pas gâcher »

speedboyz30 T'es libre mercredi soir ?  [:caporacaver:3]
dante2002 Sinon usage autre que du code : Gemini à enfin la mémoire activée dans le mode live.
 
Je peux ainsi discuter retrogaming avec elle dans mes trajets en voiture, et elle s’y connaît peux que les participants de forums en 2026 c’est cool  :D  
 
D autant plus que j’ai des lubies particulières (je suis passionné par le hardware des consoles des années 90, et j adore discuter de comparaisons de puissance entre le super FX2 et le Sega SVP :D)
jix

LibreArbitre a écrit :

Merci Olivie :jap:

 

En fait je suis en train de migrer tous mes projets de Claude Code vers Codex (enfin vers la nouvelle app) et le temps de transmettre tous le passif ça consomme malgré tout pas mal de token, même si Luna Max est vraiment très très généreux...

 

En espérant qu'Anthropic revienne dans le game à terme...


Pas déçu ?

 

Je le tâte à faire pareil, mais ce qui m'embête c'est que je fais bosser fable et sol pour vérifier que chacun ne fait pas trop de conneries et il me semble que fable n'est dispo qu'à partir d'un compte max ..

Tronklou Oui j'ai eu la même réaction que toi :D
 
Je suis tombé hier sur le tweet de Dax qui en parlais https://x.com/thdxr/status/2087761397132234875
 
https://i.imgur.com/YhLWksR.png
XaTriX opencode2 :??:
Tronklou J'avais quitté opencode ( le harness) suite à mon abonnement Claude, mais devant ses performances plus que navrantes depuis quelques temps, j'ai fait le switch sur opencode2 et pour le moment je suis ravis.
 
Je pense y rester vus que c'est facile de changer de provider, mais tout comme LibreArbrite j’espère aussi qu'Anthropic se bouge...
LibreArbitre Merci Olivie :jap:
 
En fait je suis en train de migrer tous mes projets de Claude Code vers Codex (enfin vers la nouvelle app) et le temps de transmettre tous le passif ça consomme malgré tout pas mal de token, même si Luna Max est vraiment très très généreux...
 
En espérant qu'Anthropic revienne dans le game à terme...
Olivie

LibreArbitre a écrit :

HA PUTAIN DE MERDE


Y a un nouveau reset  [:michel_cymerde:7]  
 

Citation :

@thsottiaux
 
Old news actually from a bunch of days ago, but crossed that 15M. Enjoy a nice reset everyone. Landing in the next hour or so, go /fast.

AllenMadison

 

Qui ? [:christian_keyboard:1]

 

[:somberlain1208]

 
bulldozer_fusion a écrit :

Vous avez utilisé votre bank reset avant qu'il expire j'espère?

 


Oui.

bulldozer_fusion https://rehost.diberie.com/Picture/Get/f/535738
Mais vous n’aurez pas le reset :O
https://x.com/i/status/2087635262390026525
bulldozer_fusion

H00d a écrit :


J'avais deux heures, Sol Ultra fast pour pas gâcher. :o


 [:bultom:3]
Pareil :D

H00d

bulldozer_fusion a écrit :

Vous avez utilisé votre bank reset avant qu'il expire j'espère?


J'avais deux heures, Sol Ultra fast pour pas gâcher. :o

bulldozer_fusion

Olivie a écrit :

Et ça correspondait à quoi 1 crédit ?


1 crédit c'est compliqué, en fonction du modèle utilisé, ça part plus ou moins vite avec Luna max t'as de quoi faire des choses
En sol Max tu vas pas te loin

Tronklou

Olivie a écrit :


Tu vois une différence entre le pro et le flash?
Le flash est bcp plus rapide ?


 
Le flash est beaucoup plus rapide oui.
Dans mon usage courant, le flash en high versus le pro en low ( voir medium en fonction ) c'est kif kif, mais le pro en high c'est vraiment plus perf.
 
Je fait mes plans en pro a fond, puis flash pour cracher du code et exécuter, l'association fonctionne bien.

Olivie Et ça correspondait à quoi 1 crédit ?
bulldozer_fusion Vous allez pouvoir m'offrir du crédits codex :D
Plus sérieusement vous pourrez envoyer du crédit codex à quelqu'un
https://rehost.diberie.com/Picture/Get/r/535730
Les crédits sont valables 1 an
https://help.openai.com/en/articles [...] in-chatgpt
Olivie Il a l’air bien excité, il a du prendre trop de ketamine :o
 
https://img3.super-h.fr/images/2026 [...] 983073.jpg  
Olivie

Tronklou a écrit :

Très content de deepseek, en pro comme en flash.
Par contre claudecode ca deviens une farce :O


Tu vois une différence entre le pro et le flash?
Le flash est bcp plus rapide ?

Tronklou Très content de deepseek, en pro comme en flash.
Par contre claudecode ca deviens une farce :O
bulldozer_fusion Non me dites pas que  :sweat:
LibreArbitre HA PUTAIN DE MERDE
bulldozer_fusion Vous avez utilisé votre bank reset avant qu'il expire j'espère?
Nr13 Tiens ben je viens de voir que le terrible mauvais matching entre deux algos de detection que Luna dénonçait.. vient tout bêtement d'un décalage d'un frame, lolz
Big Blue

Olivie a écrit :


Ca dépendra de l'usage. Teste et tu nous diras  [:michel_cymerde:7]


Ha bah non, hier j’ai viré deepseek de toutes mes app :o

 

Hermes m’a créé un endpoint api pour utiliser Luna codex de partout :D

Olivie

Citation :

@elonmusk
 
Grok 4.7 is significantly better than 4.6 and should be ready in 3 to 4 weeks.  
 
Initial training is complete and now we’re adding a massive amount of SpaceX company data in supplemental training. This will be something special.

Olivie

Nr13 a écrit :


 
et le cache read comme d'hab aussi...


Il concurrencerait presque leur version flash :o
 
https://pbs.twimg.com/media/HPiHZas [...] name=small

Nr13

Olivie a écrit :


Je pensais qu'il sortirait bien plus tard.
Le prix est très bon:
In / Out Price
 
$0,435 / $0,87per 1M
 
https://openrouter.ai/deepseek/deepseek-v4-pro-0813


 
et le cache read comme d'hab aussi...

Olivie

Big Blue a écrit :

Est ce qu’il vaut la différence de coût ?  
 
D’où l’augmentation du tarif de Flash :o


Ca dépendra de l'usage. Teste et tu nous diras  [:michel_cymerde:7]  

Olivie

Nr13 a écrit :

Vu les réels progrès de flash il y a 2 semaines, celui là était attendu :D


Je pensais qu'il sortirait bien plus tard.
Le prix est très bon:
In / Out Price
 
$0,435 / $0,87per 1M
 
https://openrouter.ai/deepseek/deepseek-v4-pro-0813

Big Blue Est ce qu’il vaut la différence de coût ?

 

D’où l’augmentation du tarif de Flash :o

Nr13 Vu les réels progrès de flash il y a 2 semaines, celui là était attendu :D
Olivie Wut the fuks
 

Citation :

@ChrisGPT
 
DeepSeek V4 Pro 0813 is out today too!
 
DeepSeek reports jumps from 72.1% to 87.9% on Terminal-Bench 2.1, 52.7% to 83.3% on CyberGym, and 12.8% to 62.7% on DeepSWE!!
 
It costs $0.435/M input and $0.87/M output with a 1M-token context window.
 
I don’t like how every company report very separate benchmarks every time.. So I guess we will have to rely on the index.
 
https://pbs.twimg.com/media/HPiMbft [...] ame=medium

bulldozer_fusion Y en a encore? :O
Olivie


Les gens qui ont un abo cursor :o
 
https://pbs.twimg.com/media/HPiHGvG [...] name=small

bulldozer_fusion Qui utilise grok

Copyright © 1997-2025 Groupe LDLC (Signaler un contenu illicite / Données personnelles)