| |||||
| Auteur | Sujet : Infra IA : aide au choix et troubleshot de LLM Locaux |
|---|---|
Nr13 | Reprise du message précédent : |
M300A |
Bah franchement pour le moment niveau intelligence ça m'a l'air assez proche (je reste 100% convaincu qu'antropic bride les modèles car ils sont surchargés donc la plupart du temps tu peux foutre sur max c'est pas pris en compte), par contre c'est 10x mieux niveau réactivité. Pour l'instant je me suis beaucoup servi avec OpenCode et je suis ravi, j'ai pris un peu de temps pour me bricoler un launcher de VSCode avec des variables d'environnement pour utiliser le plugin Claude Code sur cette instance, ça fonctionne maintenant, comme ca je peux lancer un VSCode ou l'autre et faire la même tâche en double aveugle J'ai encore collé un openweb-ui mais je vais m'arrêter là pour le moment, j'aimerais bcp avoir une gestion propre de l'auth avec des métriques par users et des clefs d'api pour les codeurs, à priori je devrais commencer par un keycloack branché sur l'AD on permises... Plus la fois la Message édité par M300A le 02-08-2026 à 19:27:54 --------------- :wq |
M300A | Au passage je suis en 1M sur ds4, inutile au quotidien mais c'est cool pour auditer des apps, et vu qu'il me reste plein de vram... --------------- :wq |
Plam Bear Metal | Du coup entre DeepSeek V4 flash 284B / GLM / Laguna ta une préf ? --------------- Spécialiste du bear metal |
Olivie SUUUUUUUUUUUUUU |
--------------- |
M300A |
Laguna j'ai pas essayé. GLM-5.2 j'aime beaucoup mais c'est pas le même budget, en dessous de 8 RTX tu peux oublier. Message cité 1 fois Message édité par M300A le 02-08-2026 à 22:06:48 --------------- :wq |
Plam Bear Metal |
--------------- Spécialiste du bear metal |
the_fennec f3nn3cUs z3rd4 | Laguna j'ai testé ya quelques posts, c'est tout pourris, en dessous de Qwen 35B ou 27B. --------------- Faudra que je teste un jour :o |
neo world | |
ibuprophet | Agréablement surpris, je n'y croyais plus |
M300A | Bon par contre je vais pas avoir que ça a faire moi --------------- :wq |
the_fennec f3nn3cUs z3rd4 | Qwen3.8-Max ? C'est la première fois qu'ils publient leur gros modèle non?
--------------- Faudra que je teste un jour :o |
Tronklou ❤❤ Vrp Bambulab à mi-temps ❤❤ |
--------------- Victime de girafophobie, mais se soigne. |
Plam Bear Metal | Oui, je suis curieux du gap potentiel entre 3.6 27B vs le nouveau en 3.8, vu que ça sera les même ressources derrières --------------- Spécialiste du bear metal |
M300A | Si vous voulez je teste tout ça pour vous, il me faut 50k juste pour rajouter 4 RTX, le châssis en prend 8 --------------- :wq |
Plam Bear Metal |
--------------- Spécialiste du bear metal |
Plam Bear Metal | Putain la RTX que j'ai acheté 8k fin mai est déjà presque au double moins de 3 mois après… https://www.grafikkarten.com/fr/NVI [...] ulk/A18607 --------------- Spécialiste du bear metal |
ibuprophet | J'ai une RTX 5090 à vendre 4000€ pour ceux qui veulent anticiper la sortie de qwen3.8-27B |
M300A |
C'est un revendeur allemand et le châssis c'est un machin Asus. En vrai je l'ai jamais vu mais je vais faire un saut sur place à l'occase. --------------- :wq |
neo world |
|
M300A |
Tu verrais une sacrée quantité d'Alcatel --------------- :wq |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
neo world |
the_fennec f3nn3cUs z3rd4 | Non, ça serait une première dans le monde des modèles open weight --------------- Faudra que je teste un jour :o |
M300A |
--------------- :wq |
M300A | Plus sérieusement, de toute façon tout ce qui va sortir sera ridicule par rapport au nouveau DS4 Flash. Ça sera quelques pouillemes mieux en demandant, 2, 3 ou 4x de ressources --------------- :wq |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
Pipould's |
Franchement sur des tâches spécialisées le 27b fait très bien le taff. |
M300A | Si je m'emmerde je regarderai si je peux le charger à côté de DS4 Flash mais j'ai peur que ça me force à faire des compromis sur la taille du contexte où les utilisateurs simultanés, pas sur que ça soit une bonne idée --------------- :wq |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
Pipould's |
|
ibuprophet | 3000/80 |
the_fennec f3nn3cUs z3rd4 | Perso, 100/7 mais c'est parceque je lance un prompt et je le laisse tourner la nuit voire des jours... --------------- Faudra que je teste un jour :o |
neo world |
|
Pipould's |
|
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
Pipould's |
Hmmmmmm je vois. Je suppose que ça pourrait être utile avec du crewai ou autre... Mais pour moi en dessous de 500/30, j'ai vraiment du mal... |
neo world | tu as du mal parce que tu as des deadlines à tenir ou tu es pressé. Perso ça fait 5 mois que je rebuild mon homelab (trois grosses itérations avec des amélioration entre chaque)
|

| Sujets relatifs | |
|---|---|
| [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co | sécurité de l'IA / agentique et des Devs en roue libre |
| Plus de sujets relatifs à : Infra IA : aide au choix et troubleshot de LLM Locaux | |




