Forum |  HardWare.fr | News | Articles | PC | S'identifier | S'inscrire | Shop Recherche
5027 connectés 

 


Avez-vous basculé sur ChatGPT Plus ?




Attention si vous cliquez sur "voir les résultats" vous ne pourrez plus voter

 Mot :   Pseudo :  
  Aller à la page :
 
 Page :   1  2  3  4  5  ..  462  463  464  465  466  467  468  469
Auteur Sujet :

[Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co

n°44625
LibreArbit​re
La /root est longue
Posté le 10-08-2026 à 15:11:14  profilanswer
 

Reprise du message précédent :
Ouai bon, Claude donne raison à cet article :o
 

Citation :

Le mécanisme est implacable : un tour d'API supplémentaire réexpédie tout le contexte. Économiser cinq mille tokens sur une sortie mais déclencher un tour de plus qui renvoie cent mille tokens de contexte, c'est une perte nette. La compression joue à la marge, les tours jouent sur le total.
 
Et tu as déjà vécu le phénomène : ta mémoire projet XXXX note « RTK tronque head/cat, passer par node ». C'est précisément un tour supplémentaire causé par la compression.


 
Par contre il me précise bien que c'est pas à désactiver :
 

Citation :

Rien de radical : à effort élevé, le surcoût est nul, donc RTK ne te coûte rien et te sauve dans les cas extrêmes, comme ce git diff HEAD~3 qui a produit 8,3 millions de tokens bruts sur un seul appel. C'est une assurance contre le débordement de contexte, pas une source d'économie.
 
Le geste utile serait plutôt de remonter au mainteneur ton cas de troncature sur head et cat : il demande explicitement des sessions problématiques pour corriger les réécritures fautives, et tu en as une documentée.


---------------
Pharyo | Cinépite | Capvirage
n°44635
the_fennec
f3nn3cUs z3rd4
Posté le 10-08-2026 à 16:25:25  profilanswer
 

Olivie a écrit :


Ben ton exemple avec Cursor prouve que le coût est un critère  [:michel_cymerde:7]  
Et si le responsable qui a choisi Claude au lieu de Cursor savait que vous pourriez avoir exactement les mêmes résultats pour 2 fois moins chers avec OpenAi va dire « non » ?


 
Le rendement est différent du coût! On était passé à $500/mois/dev chez Cursor, on a la même chose chez Antropic, donc le coût est le même. Après ça veut peut-être dire moins de tokens, mais c'est un autre problèmes, on a un procédure pour passer ponctuellement à $1000 si besoin. (Et on garde Kiro et Bedrock en backup).
 
Tous les devs de ma boite a qui j'ai parlé utilisaient les modèles Antropic avec Cursor ou de l'auto (composer), je connais personne qui utilisait GPT. Donc c'est beaucoup plus rentable et moins risqué de passer chez Antropic, moins de risques de changements, tout le monde déjà habitué au comportement des modèles.


---------------
Faudra que je teste un jour :o
n°44637
H00d
Posté le 10-08-2026 à 16:30:43  profilanswer
 

J'ai ça qui a popé :
 
https://rehost.diberie.com/Picture/Get/f/535110
 
Mais pourtant elle n'apparaît pas ici :
 
https://rehost.diberie.com/Picture/Get/f/535111
 
Tibo kestufou ! :o [:f5 powa]

n°44638
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 16:38:03  profilanswer
 

H00d a écrit :

J'ai ça qui a popé :
Tibo kestufou ! :o [:f5 powa]


Il a tweeté y a une heure. Le reset ne va plus tarder.
Gros audit avec Sol sur mon VPS + Hermes qui bosse + Codex en local. 25% restant sur les 2 comptes, j'essaie de tout cramer avant le reset.
Puis ca sera gros cramage pour utiliser mon dernier reset qui expire le 12  :ange:

Message cité 1 fois
Message édité par Olivie le 10-08-2026 à 16:38:20

---------------

n°44639
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 16:40:19  profilanswer
 

Intéressant de voir comment le harnais change les choses
 

Citation :

@composio
 
We ran DeepSeek V4 Flash through 4 more agent harnesses (Hermes Agent, Pi Agent, Prime Agent, Deep Agents) on 30 challenging agentic tasks.
 
Pi Agent was the cheapest harness and passed the most tasks  
 
https://pbs.twimg.com/media/HPXZaY5XUAAmz_p?format=jpg&name=medium


---------------

n°44644
the_fennec
f3nn3cUs z3rd4
Posté le 10-08-2026 à 17:15:00  profilanswer
 

Dommage de pas avoir testé des trucs plus mainstream. Au moins Opencode.


---------------
Faudra que je teste un jour :o
n°44645
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 17:22:14  profilanswer
 

the_fennec a écrit :

Dommage de pas avoir testé des trucs plus mainstream. Au moins Opencode.


Si si voila pour DeepSeekV4 (Le résultat avec Claude code va vous étonner...ou pas :o )
 

Citation :

Here’s how the 4 new harnesses scored:
 
- Pi Agent passed 20 of 30 tasks.
 
- Deep Agents (by LangChain) passed 16 of 30 tasks.
 
- Hermes Agent passed 15 of 30 tasks.
 
- Prime Agent passed 15 of its 24 valid runs (6 runs were excluded; more on that later).
 
Here are the final scores across all 8 harnesses (we covered Codex, Claude Code, OpenCode, and OMP in a previous thread a few days ago):
 
 
https://pbs.twimg.com/media/HPXY5n5XcAAXfPc?format=jpg&name=medium


 

Citation :

@composio
Here is the estimated cost per successful task at current API rates:
 
- Pi Agent: $0.028 per successful task
 
- Deep Agents: $0.045 per successful task
 
- Hermes: $0.056 per successful task
 
- Prime Agent: $0.131 per successful task
 
And how all 8 harnesses compare:
 
https://pbs.twimg.com/media/HPXN_poWsAAIjnA?format=jpg&name=medium


---------------

n°44647
LibreArbit​re
La /root est longue
Posté le 10-08-2026 à 17:46:36  profilanswer
 

Ils auraient pu tester OpenClaw :/


---------------
Pharyo | Cinépite | Capvirage
n°44650
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 17:50:00  profilanswer
 

LibreArbitre a écrit :

Ils auraient pu tester OpenClaw :/


Ca fait 2 mois que je vous dis sur le topik Openclaw que presque tout le monde est passé sur Hermes :o


---------------

n°44652
XaTriX
Posté le 10-08-2026 à 17:52:23  profilanswer
 

LibreArbitre a écrit :

Ils auraient pu tester OpenClaw :/


Soyons sérieux :o


---------------
[:dawa]
n°44653
XaTriX
Posté le 10-08-2026 à 17:52:45  profilanswer
 

J'ai testé Luna en vhigh, première commande : existe pas.
Commence bien :o


---------------
[:dawa]
n°44654
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 10-08-2026 à 17:53:41  profilanswer
 

XaTriX a écrit :

J'ai testé Luna en vhigh, première commande : existe pas.
Commence bien :o


Il faut mettre Luna en max


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°44655
LibreArbit​re
La /root est longue
Posté le 10-08-2026 à 17:53:53  profilanswer
 

Olivie a écrit :


Ca fait 2 mois que je vous dis sur le topik Openclaw que presque tout le monde est passé sur Hermes :o


Je m'en pète vu que je suis toujours sous OpenClaw :o


---------------
Pharyo | Cinépite | Capvirage
n°44656
XaTriX
Posté le 10-08-2026 à 17:54:31  profilanswer
 

bulldozer_fusion a écrit :


Il faut mettre Luna en max


Oui je l'ai mis après. Mais bon :o


---------------
[:dawa]
n°44659
the_fennec
f3nn3cUs z3rd4
Posté le 10-08-2026 à 18:18:37  profilanswer
 

Olivie a écrit :


Si si voila pour DeepSeekV4 (Le résultat avec Claude code va vous étonner...ou pas :o )
 
[quote]Here’s how the 4 new harnesses scored:
 
- Pi Agent passed 20 of 30 tasks.
 
- Deep Agents (by LangChain) passed 16 of 30 tasks.
 
- Hermes Agent passed 15 of 30 tasks.
 
- Prime Agent passed 15 of its 24 valid runs (6 runs were excluded; more on that later).
 
Here are the final scores across all 8 harnesses (we covered Codex, Claude Code, OpenCode, and OMP in a previous thread a few days ago):


 
Ça fait longtemps que je trouve Opencode pourris, et même en local avec Qwen 3.6, Claude code est meilleur. Je suis passé sur little-coder qui est basé sur Pi et que je trouve aussi bon si ce n'est meilleur que Claude.
 
Par contre c'est dommage qu'il n'y ait pas le détail de la config de Pi (ou des tests :o), il me semble que de base il lui manque plein de trucs. J'imagine que c'est pour ça qu'ils utilisent OMP aussi.


---------------
Faudra que je teste un jour :o
n°44660
the_fennec
f3nn3cUs z3rd4
Posté le 10-08-2026 à 18:19:46  profilanswer
 

LibreArbitre a écrit :

Ils auraient pu tester OpenClaw :/


 
Ils l'ont fait: il a bouffé ses 1M pour dire bonjour et demander son prénom :o
 

Spoiler :

[:r3g]


---------------
Faudra que je teste un jour :o
n°44677
ogsvart_
Posté le 10-08-2026 à 18:53:23  profilanswer
 

Gpt Sol c'est solide ce qu'on peut faire avec le quota à 200 balles maintenant.
 
J'ai Sol Maxi qui tourne à balle sur un gros sujet, XX heures par jour, et Sol Ultra et ses agents qui charbonnent en // sur un autre gros sujet, XX heures par jour aussi, et ça grignote mon quota mais moins que j'aurais imaginé, on peut vraiment y aller gaiement, ça fait plaisir !

n°44681
AllenMadis​on
Oracle du Keb's
Posté le 10-08-2026 à 19:00:11  profilanswer
 

Citation :

Et l'apparition de F2 comme structure de l'arrangement de branchement, après le u4 de la torsion, le v à valeurs dans un F2-espace du §14 et la parité du §17, fait quatre fois que le nombre 2 organise ce problème. Ce n'est probablement pas une coïncidence, mais je n'ai pas de théorème à en tirer aujourd'hui.

 

A quoi il sert alors, bordel [:poutrella]


Message édité par AllenMadison le 10-08-2026 à 19:01:19

---------------
Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss.
n°44689
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 19:33:37  profilanswer
 

Citation :

@SpotifyEng
We just launched Xirp, a vendor-neutral agentic development environment. One place to manage agent sessions across @ClaudeDevs, @GeminiApp CLI, and @OpenAI Codex. 1,300+ @Spotify engineers already use it. Now it's available for you to try. Learn more at http://xirp.spotify.com.


 
https://portal.spotify.com/blog/introducing-xirp


---------------

n°44690
XaTriX
Posté le 10-08-2026 à 19:48:12  profilanswer
 

Joce rouge pleure rouge


---------------
[:dawa]
n°44692
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 19:54:31  profilanswer
 

XaTriX a écrit :

Joce rouge pleure rouge


Oui chacun sort sa solution là  :D  
 
https://xirp.spotify.com./_next/static/media/home-app-desktop.0on4omda4vxrz.webp


---------------

n°44693
XaTriX
Posté le 10-08-2026 à 19:55:41  profilanswer
 

Me faut un Mac  [:fabrice division]


---------------
[:dawa]
n°44694
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 19:58:12  profilanswer
 

XaTriX a écrit :

Me faut un Mac  [:fabrice division]


Faut être riche pour ca  [:michel_cymerde:7]


---------------

n°44695
XaTriX
Posté le 10-08-2026 à 20:08:56  profilanswer
 

Tout part dans les tokens :o


---------------
[:dawa]
n°44696
Fredouye
Shivers !
Posté le 10-08-2026 à 20:23:59  profilanswer
 

Olivie a écrit :

Citation :

@SpotifyEng
We just launched Xirp, a vendor-neutral agentic development environment. One place to manage agent sessions across @ClaudeDevs, @GeminiApp CLI, and @OpenAI Codex. 1,300+ @Spotify engineers already use it. Now it's available for you to try. Learn more at http://xirp.spotify.com.


 
https://portal.spotify.com/blog/introducing-xirp


Dans le même genre, j'ai commencé à jouer avec https://nodeterm.dev
 
https://nodeterm.dev/screenshot.png


---------------
Le dernier arrivé est fan de Phil Collins
n°44697
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 21:28:51  profilanswer
 

Il s'est foutu de nous le tibo ou quoi ?  [:wiids]


---------------

n°44698
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 21:32:38  profilanswer
 

Waaa l'annonce de fou d'Anthropic !!  :ouch:  :ouch:  
 

Citation :

@claudeai
 
We're making Claude Sonnet 5's introductory pricing permanent.
 
We launched Sonnet 5 in June at $2 per million input tokens and $10 per million output tokens through August 31, and that price will remain unchanged.


 
Incroyable, ils ne vont pas augmenter le prix de Sonnet  :lol:


---------------

n°44699
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 10-08-2026 à 21:33:06  profilanswer
 

Olivie a écrit :

Il s'est foutu de nous le tibo ou quoi ?  [:wiids]


ce sera dans la nuit :o


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°44700
david42fr
Posté le 10-08-2026 à 21:42:43  profilanswer
 

Olivie a écrit :

Il s'est foutu de nous le tibo ou quoi ?  [:wiids]


On dirait des junkies en attente de leur dose...  [:orbitax:3]


---------------
A life spent making mistakes is not only more honorable, but more useful than a life spent doing nothing. -- Shaw -- mon topic de vente photo
n°44701
loulou le ​marlou
Posté le 10-08-2026 à 21:50:42  profilanswer
 

Ça fait quoi, un million de token ?

 

Vu qu'un token, ça peut être une apostrophe et un mot monosyllabique.

n°44702
Olivie
SUUUUUUUUUUUUUU
Posté le 10-08-2026 à 21:59:53  profilanswer
 

david42fr a écrit :


On dirait des junkies en attente de leur dose...  [:orbitax:3]


J’ai des projets qui tournent en auto sur mon quota et la, ça commence à être limite :o
 
https://img3.super-h.fr/images/2026/08/10/snapshot_6897259020043351747.jpg


---------------

n°44704
Nr13
Posté le 10-08-2026 à 22:14:15  profilanswer
 

Olivie a écrit :


Anthropic a fait quoi pour l’Open source ? :o
OpenAI a sorti 2 modèles OSS 120 et 30 il me semble et Codex est open source


 
C'est bien ce que je dis, dans un cas quasi rien et dans l'autre pas grand chose.
 
Pas mal le git diff à 8M de token mdr, est-ce qu'un vrai agent ne devrait pas  clipper systématiquement quand il fait appel à des tools dont la taille de sortie n'est pas prévisible?

n°44707
the_fennec
f3nn3cUs z3rd4
Posté le 10-08-2026 à 22:24:15  profilanswer
 

XaTriX a écrit :

Me faut un Mac  [:fabrice division]


 
Hackintosh :o


---------------
Faudra que je teste un jour :o
n°44708
Feitan21
Posté le 10-08-2026 à 22:29:34  profilanswer
 

ogsvart_ a écrit :

Gpt Sol c'est solide ce qu'on peut faire avec le quota à 200 balles maintenant.
 
J'ai Sol Maxi qui tourne à balle sur un gros sujet, XX heures par jour, et Sol Ultra et ses agents qui charbonnent en // sur un autre gros sujet, XX heures par jour aussi, et ça grignote mon quota mais moins que j'aurais imaginé, on peut vraiment y aller gaiement, ça fait plaisir !


 
Ça a changé ? Parce-que la semaine dernière j'ai explosé mon quota en 2j avec du Sol high et j'ai pas l'impression que j'ai fait grand chose.

n°44711
H00d
Posté le 10-08-2026 à 23:59:36  profilanswer
 

loulou le marlou a écrit :

Ça fait quoi, un million de token ?
 
Vu qu'un token, ça peut être une apostrophe et un mot monosyllabique.


Ah vous êtes charmante mais… Vous voyez déjà ce que ça fait un million, Larmina ? [:l4stragal:8]
 

Olivie a écrit :

Il s'est foutu de nous le tibo ou quoi ?  [:wiids]


[:zest:1]
 
Ce qui est bizarre, c'est que j'ai bien reçu la notif de nouveau reset, mais il n'est pas visible. [:jean_michel_covid:5]
 
Je suis à 0%, j'en ai profité pour jouer un peu avec SillyTavern et KoboldCpp...

n°44712
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 11-08-2026 à 00:04:27  profilanswer
 

Olivie a écrit :

Waaa l'annonce de fou d'Anthropic !!  :ouch:  :ouch:

 
Citation :

@claudeai

 

We're making Claude Sonnet 5's introductory pricing permanent.

 

We launched Sonnet 5 in June at $2 per million input tokens and $10 per million output tokens through August 31, and that price will remain unchanged.

 

Incroyable, ils ne vont pas augmenter le prix de Sonnet  :lol:


Et cette info

Citation :

Claude models will now have invisible watermarks embedded in ALL text, and ALL metadata attached to files…


https://support.claude.com/en/artic [...] ed-content


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°44714
AllenMadis​on
Oracle du Keb's
Posté le 11-08-2026 à 00:21:58  profilanswer
 

https://i.imgur.com/QdPMCMb.png

 

Ils vont y arriver ces enfoirés

 

Bon j'ai mon lot de consolation, un progrès sur le cuboïde parfait de mon côté :o

 

https://en.wikipedia.org/wiki/Euler_brick

 

Un très, mais alors très charmant problème de maths. Simple en apparence, compliqué comme le diable.

 

(De toute évidence, un cuboïde parfait ne peut jamais exister à cause d'une propriété des nombres premiers, mais il faut combiner des résultats de la conjecture BSD avec des outils d'Andrew Wiles (pour le théoreme de Fermat) afin de montrer un mécanisme d'obstruction via des courbes elliptiques)

 

https://i.imgur.com/fm3l4Ll.png

 

Ils ont quasiment utilisé les mêmes idées que je faisais avec Weil mais sous une forme légèrement différente.

 

https://i.imgur.com/ULG2CG5.png

 

C'est vraiment des enfoirés chez Anthropic :o

 

Bon après je ne suis pas le seul sur le morceau mais ils ont trouvé là ou il fallait chercher, exactement avec mes idées, en partant de Weil/Deligne sur les corps finis et en regardant le facteur de compression. A noter que pour le 97,53%, je n'ai aucune idée de ou provient le 2,47% restant qui est indiscernable d'un bruit statistique et je bute toujours dessus :o Si j'avais 100% au lieu de 97,53% RH tomberait immédiatement.

 


Message édité par AllenMadison le 11-08-2026 à 00:58:00

---------------
Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss.
n°44716
AllenMadis​on
Oracle du Keb's
Posté le 11-08-2026 à 00:23:28  profilanswer
 

Olivie a écrit :

Il s'est foutu de nous le tibo ou quoi ?  [:wiids]


 
Faut croire :o
 
Je suis a sec


---------------
Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss.
n°44720
bulldozer_​fusion
rip Mekthoub & Marc
Posté le 11-08-2026 à 01:18:20  profilanswer
 

Je pouvais pas faire mieux :O
Usage: Week 1% left


---------------
feed-back : http://forum.hardware.fr/forum2.ph [...] nojs=0#bas
n°44722
AllenMadis​on
Oracle du Keb's
Posté le 11-08-2026 à 01:19:56  profilanswer
 

Franchement je suis a zéro, sinon je serais directement parti avec le papier pour tester des idées pour ruiner le quota

 

https://i.imgur.com/ojFZZDm.png

 

Ils emploient quasiment la même méthode de calinothérapie que moi pour mon problème du cuboïde :o (qui a fait des progrès notables)

 


Pour Olivie, qui ne sait que prompter, un petit aperçu de ce que j'avais sous le coude :

 

https://i.imgur.com/omen1Nd.png

 

https://i.imgur.com/GBcC7kK.png

 

Sauf que moi je n'ai pas utilisé les 300000 agents simultanés sur une machine unique avec temps illimité mais mes cellules grises :o

 


Edit : le papier d'Anthropic est juste lumineux en fait

 
Citation :

[2026-08-11 04:10:55] V12 SUMMARY
[2026-08-11 04:10:55] SSA rank 32: trajectory explained=99.2960% | residual=0.7040%
[2026-08-11 04:10:55] Pointwise residual variance=0.6528%
[2026-08-11 04:10:55] Zero coherence RAW: mean=0.0275835 vs random=0.0141984 | effect=0.524 sd
[2026-08-11 04:10:55] Zero coherence RESIDUAL: mean=3.55535e-05 vs random=1.55878e-05 | effect=1.284 sd
[2026-08-11 04:10:55] Randomized-μ residual zero coherence: mean=2.0765e-05 vs random=1.75089e-05
[2026-08-11 04:10:55] Injected off-RH calibration: coh raw=0.0357109, coh residual=1.05948e-05 | best delta raw=0.15, residual=0.15
[2026-08-11 04:10:55] Nearest ESPRIT pole: gamma=59.2714, delta=-2.41994, |z|=0.999484842

 

C'est lumineux.

 

https://i.imgur.com/7M4fKFB.png

 

C'est même completement limpide maintenant, mais il fallait avoir l'idée.


Message édité par AllenMadison le 11-08-2026 à 04:21:53

---------------
Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss.
n°44723
Tronklou
❤❤ Vrp Bambulab à mi-temps ❤❤
Posté le 11-08-2026 à 02:02:12  profilanswer
 

the_fennec a écrit :


 
Ça fait longtemps que je trouve Opencode pourris, et même en local avec Qwen 3.6, Claude code est meilleur. Je suis passé sur little-coder qui est basé sur Pi et que je trouve aussi bon si ce n'est meilleur que Claude.
 
Par contre c'est dommage qu'il n'y ait pas le détail de la config de Pi (ou des tests :o), il me semble que de base il lui manque plein de trucs. J'imagine que c'est pour ça qu'ils utilisent OMP aussi.


 
C'est marrant ce soir j'ai comparé claude code et opencode sur le meme projet : opencode devant ( avec deepseek derrière )


---------------
Victime de girafophobie, mais se soigne.
 Page :   1  2  3  4  5  ..  462  463  464  465  466  467  468  469

Aller à :
Ajouter une réponse
 

Sujets relatifs
sécurité de l'IA / agentique et des Devs en roue libre 
Plus de sujets relatifs à : [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co


Copyright © 1997-2025 Groupe LDLC (Signaler un contenu illicite / Données personnelles)