Forum |  HardWare.fr | News | Articles | PC | S'identifier | S'inscrire | Shop Recherche
4661 connectés 

 


Dernière réponse
Sujet : [blabla@olympe] Le topic du modo, dieu de la fibre et du monde
Dion https://img3.super-h.fr/images/2026/08/20/image.png

Votre réponse
Nom d'utilisateur    Pour poster, vous devez être inscrit sur ce forum .... si ce n'est pas le cas, cliquez ici !
Le ton de votre message                        
                       
Votre réponse


[b][i][u][strike][spoiler][fixed][cpp][url][email][img][*]   
 
   [quote]
 

Options

 
Vous avez perdu votre mot de passe ?


Vue Rapide de la discussion
hephaestos

Dion a écrit :

tu nous as dis plusieurs fois que chrome c'était un repère de hippies  [:cosmoschtroumpf]


 :fou:

Dion tu nous as dis plusieurs fois que chrome c'était un repaire de hippies  [:cosmoschtroumpf]
hephaestos Donc la théorie c'est que les branlos de firefox se sont rendu compte que les LLMs pouvaient détecter des failles quand Anthropic les a contactés, et que les branlos de Chrome ont dû attendre qu'on les force à s'intéresser au sujet en faisant une campagne marketing hors du commun ?

 

Et le corolaire, c'est que les "boîtes moins à cheval sur la sécurité" c'est Google et Firefox ?

theShockWave

Dion a écrit :


T'es pas obligé de me croire mais j'en suis bien conscient.
Tu sais qu'il y a encore des gens qui t'expliquent qu'AWS perdait des tonnes de pognon en 2014 ou qu'AWS a été créé juste pour vendre la capacité de calcul qu'ils avaient en trop en dehors des soldes ? Le jean-louis de la COGIP est pas beaucoup plus malin que le jean-louis d'ici (même si nous avons quelques pépites pour influer sur notre moyenne).


 :jap:

Dion

theShockWave a écrit :


Note que c'est même pas ce que "le mec de curl" en a dit.


T'es pas obligé de me croire mais j'en suis bien conscient.
Tu sais qu'il y a encore des gens qui t'expliquent qu'AWS perdait des tonnes de pognon en 2014 ou qu'AWS a été créé juste pour vendre la capacité de calcul qu'ils avaient en trop en dehors des soldes ? Le jean-louis de la COGIP est pas beaucoup plus malin que le jean-louis d'ici (même si nous avons quelques pépites pour influer sur notre moyenne).

theShockWave

Dion a écrit :

pour répondre aux propos de type "non mais le mec de curl il a dit que c'était un bug de merde, ça fait rien les IA"


Note que c'est même pas ce que "le mec de curl" en a dit.
Son point, c'est que si la sécurité est importante, t'utilises déjà tout un tas d'outils qui offrent une couverture, et Mythos n'ajoute rien.
Si tu suis le mec, tu verras qu'il utilisait déjà d'autres modèles en complément de l'analyse statique de code. Son point, c'est que Mythos n'est pas le saut en qualité qu'Anthropic annonce.
Des boîtes qui sont moins à cheval sur la sécurité en général et qui utilisent Mythos à cause de la hype vont potentiellement trouver une plâtrée de soucis valides qu'ils auraient pu déjà trouver avant [:jagstang] Ca peut aussi expliquer la corrélation qu'Hephaestos met en avant.

hephaestos Aujourd'hui 3.7 flash a défoncé la PR de mon collègue L7. Il est fort, en temps normal je lui fais entièrement confiance mais c'est une villaine race condition C++ qui me fait chier depuis des semaines j'ai demandé à Gemini ce qu'il en pensait, et paf. Je crois vraiment qu'ils tiennent un truc cette fois.
hephaestos

Dion a écrit :

c'est mignon, tu peux rajouter les cvss stp ?


J'ai plus de quota, là. Demain.

Dion pour répondre aux propos de type "non mais le mec de curl il a dit que c'était un bug de merde, ça fait rien les IA"
Dion c'est mignon, tu peux rajouter les cvss stp ?
hephaestos On parlait de l'effet Mythos il y a quelques jours, et ce matin j'ai vu des gens affirmer sur reddit que depuis quelques mois les gros projets croulent sous les patchs. Du coup j'ai demandé à Claude de me faire un peu de recherche, et une infographie.  
 
Ça vaut ce que ça vaut, c'est de la corrélation. C'est intéressant, sachant que Mythos a été développé et testé sur Firefox (ça fait partie du system card), et on voit clairement une différence de phase entre l'uptick de firefox et celui de chrome. Pas trouvé de résultats probants chez Apple et Linux.
 
Rapport complet sur hephaestos.fr/sec
 
https://i.imgur.com/yNN1Pbh.pngm
mechkurt

Dion a écrit :

ok mechkurt


Si t'as pas la réf c'est pas grave, on t'aime bien quand même... [:raff]

el muchacho Test intéressant.
Je donne le même problème de physique à Claude Sonnet, Kimi K3, DeepSeek et chatGPT (version gratuite). chatGPT est de loin le plus rapide, mais son résultat est différent des trois autres.

 

Le prompt est le suivant:

Citation :


On a 3 réservoirs complètement remplis d'eau. Ils ont à leur base une ouverture identique permettant à un liquide de s'écouler.
- Le premier réservoir est cylindrique de rayon R et de hauteur 2R ,
- le 2e est cônique de rayon R et de hauteur 2R, pointe en bas,
- le 3e est sphérique de diamètre 2R.
Les frottements sont négligeables.
Quel est le réservoir qui se vide le plus rapidement ? Est-ce que pointe en haut, le réservoir conique se vide plus, vite, plus lentement ou dans le même temps que pointe en bas ?


Si vous voulez essayer, sachez que ce n'est pas intuitif du tout.

  

Kimi, DeepSeek et Claude donnent le résultat suivant (où A est l'aire de l'ouverture et g la gravité):

  

Kimi est intéressant car comme DeepSeek, on peut lire en direct ses réflexions, et corriger si besoin le prompt pour éviter les ambiguïtés. Il met beaucoup plus de temps que les trois autres, et il fait vérifier ses calculs par Python/SymPy.

 

Mais chatGPT sort


où a est l'aire de l'ouverture.
 
Quand je lui fais remarquer que d'autres LLM trouvent que cone pointe en haut et sphère se vident dans la même durée, il refait le calcul et se trompe de nouveau. Ce n'est que quand je lui soumets l'explication de son erreur par Claude AI que chatGPT admet qu'il s'est trompé.

 

Le chatGPT gratuit n'est probablement pas au même niveau mathématique que chatGPT-sol, mais la conclusion est que même sur les mathématiques, il faut vérifier absolument les calculs (ce que je n'ai pas fait).

 

edit: une autre instance de chatGPT avec le même prompt donne le bon résultat.

Dion

Citation :

The Euro-cloud will also increase the price it charges to access its 2024-era equipment when customers renew contracts, but by less than the increase charged to use new machines.

 :D

el_barbone

el_barbone a écrit :


Vu les dernières augmentations d’apple, les prix sont abusés je trouve.
Comme chez tout les monde et ça s’améliorera pas en 2027.
Toute la production de mémoire de 2027 est déjà vendue depuis juin 26.


https://www.theregister.com/off-pre [...] ts/5285867

Dion ok mechkurt
koskoz

Citation :

L'effet Mandela (1/6) «Luke, je suis ton père» : dites ce que Jedi, pas ce que je dis pas


 
 [:prozac]

mechkurt

Citation :

Un petit hommage avec cette photo prise à Vannes aujourd'hui même
https://rehost.diberie.com/Picture/Get/r/534979


Source : Topic Hontes

koskoz

Xavier_OM a écrit :


Un ptit /doctor sur ta config peut-être ? t'as rien changé récemment ?


 
Rien changé non.
 
/doctor ne donne rien de probant, à part de faux positifs (des MCP peut utilisés qu'il suggère de désinstaller).
 

sligor a écrit :

Opus 5 est maintenant connu pour faire énormément de over-engineering par rapport à Opus 4.8.
 
Opus 4.8 est toujours dispo au passage


 
On est plus sur de l'under-engineering que de l'over-engineering là [:drraoultihu]

sligor Je me méfiait aussi jusqu’à ce que je vois aussi opus 5 faire de l’overthinking puis partir en couille sur un point de mes impots ( pas de probleme avec sonnet et chat gpt)
Jubijub

sligor a écrit :

Opus 5 est maintenant connu pour faire énormément de over-engineering par rapport à Opus 4.8.
 
Opus 4.8 est toujours dispo au passage


 
je me méfie toujours un peu de ce genre de trucs
- Reddit est une chambre d'écho monstrueuse
- les gens reproduisent jamais leurs tests, et vu comme la technologie est sensible au contexte, va t'en savoir dans quelles conditions ils ont eu leur problème (session fraiche ou reprise d'une vieille session, quantité de chose dans le contexte, qualité de ce qui est dans le contexte, skills/MCP/AGENTS.md).
 
Donc ça peut etre vrai comme ça peut etre de la merde. Selon les jours si tu me demandes, Gemini c'est incroyable, ou intolérable à quel point c'est à chier, même avec un pinning de version qui doit donc a priori pas trop changer d'un jour à l'autre. (et d'ailleurs on sait que Gemini a peu changé en 14 mois :o )

sligor Opus 5 est maintenant connu pour faire énormément de over-engineering par rapport à Opus 4.8.
 
Opus 4.8 est toujours dispo au passage
Xavier_OM

koskoz a écrit :

J'ai l'impression depuis une paire de semaine que Claude, que ce soit avec Fable ou Opus, a régressé [:pingouino]
 
C'est dur d'expliquer ce ressenti facilement (et rapidement :o ) à l'écrit, mais là où il me faisait gagner du temps avant ou me proposait des solutions intéressantes, c'est l'inverse maintenant, j'ai l'impression d'être revenu au niveau d'il y a 6 mois.


Un ptit /doctor sur ta config peut-être ? t'as rien changé récemment ?

flo850 A l'inverse je fais des essais de couleur de crépis / volets et je jongle entre chatgpt et gemini
Jusque là chatgpt faisait mieux et là il m'a fait de la merde (genre déplacer par mal de chose ) alors que gemini m'a fait un rendu nickel
koskoz J'ai l'impression depuis une paire de semaine que Claude, que ce soit avec Fable ou Opus, a régressé [:pingouino]
 
C'est dur d'expliquer ce ressenti facilement (et rapidement :o ) à l'écrit, mais là où il me faisait gagner du temps avant ou me proposait des solutions intéressantes, c'est l'inverse maintenant, j'ai l'impression d'être revenu au niveau d'il y a 6 mois.
Ydalb Ça cache la hotte qui a pas l'air ouf et les meubles haut qui sont visuellement lourds. Je trouve ça pas mal.

 

( :o )

Flaie
Ça a de la gueule cela dit
koskoz Pour la science, j'ai comparé Kimi à ChatGPT pour la génération d'images. Ce n'est pas encore très concluant [:michel_cymerde:3]  
 

Citation :


Je veux que tu appliques l'image du carrelage sur les deux photos de la cuisine. Le carrelage doit se trouver sur l'entièreté des murs blancs. Je parle du mur du fond, ainsi que celui derrière l'évier.
 
Garde tous les éléments présents sur les photos, sauf les plateaux qui se trouvent derrière la plaque de cuisson, sous la hotte.


 

DDT D'ailleurs
 
https://world.hey.com/dhh?page=eyJw [...] NDQyfX0%3D
 
C'est quoi l'intérêt de mettre du JSON en base64 dans le paramètre pour un objet aussi bidon

Code :
  1. {"page_number":14,"values":{"created_at":"2022-04-28T11:56:51.437064Z","id":20465}}


à part détruire la SEO j'imagine?

Kenshineuh

sligor a écrit :

Il est de gauche liberale d’après GrokFlaie


 
:o

sligor Il est de gauche liberale d’après Grok
DDT

Plam a écrit :

Faut essayer sur DHH et ses blogs :o


J'avais jamais réalisé malgré ce qu'en pense Dion mais il publie une chiée d'articles. :lol:  
 
Vous avez le prompt je vous laisse lancer un essaim de sous-agents pour scraper son blog. :o

Devil'sTiger

Flaie a écrit :


Il n'a pas encore de notion de droite et centre droite cela dit :o


 
Et encore, si seulement il avait la VRAIE définition.

Hermes le Messager

hephaestos a écrit :

C'est clair que ma position sur les LLM en 2022, c'est ultra pertinent...


 
 [:rofl]

sligor

Plam a écrit :

Faut essayer sur DHH et ses blogs :o


 [:founenational:4]

hephaestos C'est clair que ma position sur les LLM en 2022, c'est ultra pertinent...
DDT

hephaestos a écrit :


Aucune, mais je veux pas faire genre je critique parce que j'aime pas ce qu'il dit de moi :o
 
C'est assez plat ; ce qui est incisif est à côté de la plaque. Mais oui il a détecté que Flaie était de droite, waouh.


Tu as froissé DeepSeek, il en sûrement tenu compte lors du résumé.
 

Code :
  1. {
  2.   "message_num": 2425083,
  3.   "quote": "Pour le coup un docstring généré automatiquement qui écrit en prose ce que fait le code ce serait chouette. Je pense que c'est quand même utile de dire avec des mots ce que fait le code, c'est plus facile à lire et à comprendre. Le problème c'est que c'est souvent faux.",
  4.   "note": "Il exprime un intérêt pour l'IA générative, contrairement à sa position plus sceptique sur les LLM dans d'autres messages.",
  5.   "posted_at": "2022-08-29T19:24:01+00:00"
  6. }


 
 [:ocolor]

Flaie

hephaestos a écrit :


Aucune, mais je veux pas faire genre je critique parce que j'aime pas ce qu'il dit de moi :o
 
C'est assez plat ; ce qui est incisif est à côté de la plaque. Mais oui il a détecté que Flaie était de droite, waouh.


Il n'a pas encore de notion de droite et centre droite cela dit :o

Plam Faut essayer sur DHH et ses blogs :o
hephaestos

Jubijub a écrit :


 
t'as trouvé quelle partie pertinente exactement ?


Aucune, mais je veux pas faire genre je critique parce que j'aime pas ce qu'il dit de moi :o
 
C'est assez plat ; ce qui est incisif est à côté de la plaque. Mais oui il a détecté que Flaie était de droite, waouh.

el_barbone

Jubijub a écrit :


 
t'as trouvé quelle partie pertinente exactement ? Le truc prend des quotes relativement au hasard et les interprète de la façon la plus claquée au sol possible
 
C'est rigolo et tout, mais c'est pas vraiment utile (et en soit je trouve que c'est une example formidable de ce qu'on peut faire avec les LLMs: tu arrives très vite à un résultat joli, qui semble bien d'un premier abord, et en fait c'est à chier si tu mets pas sérieusement les mains dedans


[:yann39]


Copyright © 1997-2025 Groupe LDLC (Signaler un contenu illicite / Données personnelles)