| |||||
| Dernière réponse | |
|---|---|
| Sujet : [blabla@olympe] Le topic du modo, dieu de la fibre et du monde | |
| Dion | https://img3.super-h.fr/images/2026/08/20/image.png |
| Aperçu |
|---|
| Vue Rapide de la discussion |
|---|
| hephaestos |
|
| Dion | tu nous as dis plusieurs fois que chrome c'était un repaire de hippies [:cosmoschtroumpf] |
| hephaestos | Donc la théorie c'est que les branlos de firefox se sont rendu compte que les LLMs pouvaient détecter des failles quand Anthropic les a contactés, et que les branlos de Chrome ont dû attendre qu'on les force à s'intéresser au sujet en faisant une campagne marketing hors du commun ? Et le corolaire, c'est que les "boîtes moins à cheval sur la sécurité" c'est Google et Firefox ? |
| theShockWave |
|
| Dion |
|
| theShockWave |
|
| hephaestos | Aujourd'hui 3.7 flash a défoncé la PR de mon collègue L7. Il est fort, en temps normal je lui fais entièrement confiance mais c'est une villaine race condition C++ qui me fait chier depuis des semaines j'ai demandé à Gemini ce qu'il en pensait, et paf. Je crois vraiment qu'ils tiennent un truc cette fois. |
| hephaestos |
|
| Dion | pour répondre aux propos de type "non mais le mec de curl il a dit que c'était un bug de merde, ça fait rien les IA" |
| Dion | c'est mignon, tu peux rajouter les cvss stp ? |
| hephaestos | On parlait de l'effet Mythos il y a quelques jours, et ce matin j'ai vu des gens affirmer sur reddit que depuis quelques mois les gros projets croulent sous les patchs. Du coup j'ai demandé à Claude de me faire un peu de recherche, et une infographie. Ça vaut ce que ça vaut, c'est de la corrélation. C'est intéressant, sachant que Mythos a été développé et testé sur Firefox (ça fait partie du system card), et on voit clairement une différence de phase entre l'uptick de firefox et celui de chrome. Pas trouvé de résultats probants chez Apple et Linux. Rapport complet sur hephaestos.fr/sec https://i.imgur.com/yNN1Pbh.pngm |
| mechkurt |
|
| el muchacho | Test intéressant. Je donne le même problème de physique à Claude Sonnet, Kimi K3, DeepSeek et chatGPT (version gratuite). chatGPT est de loin le plus rapide, mais son résultat est différent des trois autres. Le prompt est le suivant:
Kimi, DeepSeek et Claude donnent le résultat suivant (où A est l'aire de l'ouverture et g la gravité):
Kimi est intéressant car comme DeepSeek, on peut lire en direct ses réflexions, et corriger si besoin le prompt pour éviter les ambiguïtés. Il met beaucoup plus de temps que les trois autres, et il fait vérifier ses calculs par Python/SymPy. Mais chatGPT sort
Le chatGPT gratuit n'est probablement pas au même niveau mathématique que chatGPT-sol, mais la conclusion est que même sur les mathématiques, il faut vérifier absolument les calculs (ce que je n'ai pas fait). edit: une autre instance de chatGPT avec le même prompt donne le bon résultat. |
| Dion |
:D |
| el_barbone |
|
| Dion | ok mechkurt |
| koskoz |
|
| mechkurt |
|
| koskoz |
|
| sligor | Je me méfiait aussi jusqu’à ce que je vois aussi opus 5 faire de l’overthinking puis partir en couille sur un point de mes impots ( pas de probleme avec sonnet et chat gpt) |
| Jubijub |
|
| sligor | Opus 5 est maintenant connu pour faire énormément de over-engineering par rapport à Opus 4.8.
Opus 4.8 est toujours dispo au passage |
| Xavier_OM |
|
| flo850 | A l'inverse je fais des essais de couleur de crépis / volets et je jongle entre chatgpt et gemini Jusque là chatgpt faisait mieux et là il m'a fait de la merde (genre déplacer par mal de chose ) alors que gemini m'a fait un rendu nickel |
| koskoz | J'ai l'impression depuis une paire de semaine que Claude, que ce soit avec Fable ou Opus, a régressé [:pingouino]
C'est dur d'expliquer ce ressenti facilement (et rapidement :o ) à l'écrit, mais là où il me faisait gagner du temps avant ou me proposait des solutions intéressantes, c'est l'inverse maintenant, j'ai l'impression d'être revenu au niveau d'il y a 6 mois. |
| Ydalb | Ça cache la hotte qui a pas l'air ouf et les meubles haut qui sont visuellement lourds. Je trouve ça pas mal. ( :o ) |
| Flaie |
Ça a de la gueule cela dit |
| koskoz | Pour la science, j'ai comparé Kimi à ChatGPT pour la génération d'images. Ce n'est pas encore très concluant [:michel_cymerde:3]
|
| DDT | D'ailleurs
https://world.hey.com/dhh?page=eyJw [...] NDQyfX0%3D C'est quoi l'intérêt de mettre du JSON en base64 dans le paramètre pour un objet aussi bidon
|
| Kenshineuh |
|
| sligor | Il est de gauche liberale d’après Grok |
| DDT |
|
| Devil'sTiger |
|
| Hermes le Messager |
|
| sligor |
|
| hephaestos | C'est clair que ma position sur les LLM en 2022, c'est ultra pertinent... |
| DDT |
|
| Flaie |
|
| Plam | Faut essayer sur DHH et ses blogs :o |
| hephaestos |
|
| el_barbone |
|




