| |||||
| Auteur | Sujet : Infra IA : aide au choix et troubleshot de LLM Locaux |
|---|---|
chris282 id steam/psn : chris282_fr | Reprise du message précédent :
|
chris282 id steam/psn : chris282_fr | Qwen3.6-35B-A3B est le modèle qui me plait le plus. je vais prochainement le faire tourner (d'ici les prochaines semaines) et discuter avec vous des résultats |
moyen_moins chat réincarné | J'aime bien le ornith 1.5 35b. |
sloth |
|
neo world | Ils l’ont appelé cette itération le chon . Pas super AI sayajin |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
moyen_moins chat réincarné | Mimo 2.6 flash et glm 5.3 flash sur les Strix halo : https://youtu.be/jtyjgHsaTc0 |
morcok |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
moyen_moins chat réincarné |
|
gremi Vieux con des neiges d'antan | C'est exactement ce que j'ai fait --------------- In aligot we trust. |
moyen_moins chat réincarné | t'avais testé avec le flag proposé (fit_max_tokens) dans le json du coup ? |
the_fennec f3nn3cUs z3rd4 | Il voulait pas démarrer avec, mais je vois en cherchant qu'il faut le mettre a la racine du json et pas dans les args --------------- Faudra que je teste un jour :o |
morcok |
|
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
moyen_moins chat réincarné |
|
moyen_moins chat réincarné | C'est "exa" : il vient en "standard" avec le chatbot.
Message cité 1 fois Message édité par moyen_moins le 07-10-2026 à 18:52:19 |
morcok |
moyen_moins chat réincarné | par contre, je viens de voir ce que donnait le qwen 3.8 27B gsq rco sur la R9700 pro et j'obtiens ceci en performance (lmstudio en vulkan):
vitesse correcte mais surtout, résultat "bon" du 1er coup sur mon petit test que je fais à chaque fois. tous ces clones plus ou moins raté de qwen 3.8 27B, ça commence à être un peu relou en fait Message cité 1 fois Message édité par moyen_moins le 07-10-2026 à 19:08:45 |
neo world |
|
epsiloncentaury | VICTOIRE Cela fait bien une dizaine de jours que j'essaie (avec ma config toute pourrie) de piloter FreeCAD avec KoboldCpp via MCP. J'ai ensuite tenté un boulon avec son filetage. Et après plusieurs tentatives ratées, il n'a pas pu faire mieux que ça : Bon évidemment, c'est pas viable en l'état. C'est très lent avec beaucoup d'échecs. Qwen 3.6 a beaucoup de mal à piloter FreeCAD. Ce matin, je tombe sur une vidéo de Strata. Je me suis dit ça, c'est pour ma config toute pourrie.. La première utilisation que j'ai voulu tester a été FreeCAD... Et il m'a fait ça très rapidement comparé à KoboldCpp, je dirais 2/3mn Je lui ai montré la capture d'écran en lui disant que ce n'était tout à fait ce que j'avais demandé, et il m'a fait ça : Je lui ai ensuite demandé simplement : "Fais-moi un boulon M12 avec son écrou. Le boulon a une longueur de 80mm." Il a fait ça : Incroyable .. Message cité 5 fois Message édité par epsiloncentaury le 07-10-2026 à 20:17:05 |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
the_fennec f3nn3cUs z3rd4 |
Message édité par the_fennec le 07-10-2026 à 20:26:47 --------------- Faudra que je teste un jour :o |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
epsiloncentaury |
|
neo world |
|
neo world |
|
b-tzu Geek a toute heure... |
--------------- Topic Ventes || Topic Jeux Vidéos || Topic Téléphonie (Rien pour le moment) |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
moyen_moins chat réincarné |
|
epsiloncentaury |
|
moyen_moins chat réincarné | j'ai juste l'interface genre le llamaserver avec le truc de chat de base edit: ça doit être un bug ou un problème de cache de firefox car je faisais mumuse avant avec llama.cpp Message cité 1 fois Message édité par moyen_moins le 07-10-2026 à 23:08:08 |
epsiloncentaury |
|

| Sujets relatifs | |
|---|---|
| [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co | sécurité de l'IA / agentique et des Devs en roue libre |
| Plus de sujets relatifs à : Infra IA : aide au choix et troubleshot de LLM Locaux | |




