| |||||
| Auteur | Sujet : Infra IA : aide au choix et troubleshot de LLM Locaux |
|---|---|
neo world | Reprise du message précédent :
Message édité par neo world le 27-08-2026 à 16:29:45 |
neo world | Pour info avec le Q6_k j'arrive à 24,8TPS. |
the_fennec f3nn3cUs z3rd4 | T'es sur ton Strix non?
--------------- Faudra que je teste un jour :o |
neo world |
|
neo world | J’ai assez de plaques chauffantes au sous-sol mais c’est gentil de penser aux longues nuits d’hiver Message édité par neo world le 27-08-2026 à 18:31:15 |
the_fennec f3nn3cUs z3rd4 | Benchmarking Qwen3.8 27B quantizations: 4-bit holds up, 1-bit collapses
--------------- Faudra que je teste un jour :o |
Tronklou ❤❤ Vrp Bambulab à mi-temps ❤❤ | Le Q4, meilleur compromis comme d'hab --------------- Victime de girafophobie, mais se soigne. |
the_fennec f3nn3cUs z3rd4 | J'ai mis Q4_K_XL en test pour voir!
--------------- Faudra que je teste un jour :o |
neo world | https://youtu.be/Idoif7BzZbg
|
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
neo world | Ouvrir une chaine sur le hardware IA pour les dev avant 2025 et devenir riche en 2026 |
the_fennec f3nn3cUs z3rd4 | Build llama.cpp pour Qwen3.8 Flash Next dispo! Message cité 1 fois Message édité par the_fennec le 27-08-2026 à 23:57:17 --------------- Faudra que je teste un jour :o |
neo world |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
the_fennec f3nn3cUs z3rd4 | With HuggingFace, Nvidia is also acquiring llama.cpp and the team behind it
--------------- Faudra que je teste un jour :o |
neo world |
|
AllenMadison Oracle du Keb's |
--------------- Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss. |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
neo world |
|
Nr13 |
|
moyen_moins chat réincarné |
|
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
Nr13 |
Message édité par Nr13 le 28-08-2026 à 09:58:31 |
neo world | pas forcément, repartir sur des bases saines de forks avec des optimisations plus profondes pour des machines comme le strix halo, le mi, MLX etc. n'est pas forcément une mauvaise nouvelle. llama est super mais je n'ose imaginer toutes les optimisations encore à faire si la route actuelle pousse des devs et des entreprises à revoir les fondations. Vu le traitement de la Chine par les US/Nvidia ils vont aussi commencer à envisager des plans de sortie. Jusque là ça a toujours payé pour eux de sortir de l'écosystème existant pour développer le leur (android huawey, licences ARM, Marché de cartes d'acceleration artificiellement limité par le gouv US ...) Message édité par neo world le 28-08-2026 à 10:09:33 |
Nr13 | Ha oui c'est une possibilité, mais on est d'accord que c'est en mode "NVidia va tuer le projet pour tous les autres, le point positif c'est que ça va forcer d'autres acteurs à y consacrer des ressources" |
neo world |
|
speedboyz30 Guide Michelin :o | On en est où du RTX Spark au fait ? |
neo world | ça suit son cours :
|
speedboyz30 Guide Michelin :o |
neo world |
Message cité 1 fois Message édité par neo world le 28-08-2026 à 11:38:10 |
moyen_moins chat réincarné |
|
lapin |
|
moyen_moins chat réincarné | J'ai essayé que Vulkan, j'ai pas de nvidia dans mon pc |
moyen_moins chat réincarné | Bc-250 reçu, va falloir que j'installe tout ça ce weekend et que je regarde quel modèle je peux mettre la dessus |
Pipould's |
|

| Sujets relatifs | |
|---|---|
| [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co | sécurité de l'IA / agentique et des Devs en roue libre |
| Plus de sujets relatifs à : Infra IA : aide au choix et troubleshot de LLM Locaux | |




