| |||||
| Auteur | Sujet : Infra IA : aide au choix et troubleshot de LLM Locaux |
|---|---|
AllenMadison Oracle du Keb's | Reprise du message précédent : En dessous c'est mort, et mes 32go de ram sur mon pc ça va pas suffire Oui je sais que poser cette question là en pleine pénurie de ram... Pour les curieux, je tente de calculer de l'entropie sur une absorption de positivité de signe des nombres premiers (forme de weil pour RH) via une construction par des matrices de hadamard. Pour 1024 et 2048 matrices ça me demande respectivement entre 80 et 120go de ram / 220/320go (sans optimisations). La VM de ChatGPT n'a que 32go de ram aussi donc ça coince un peu Message cité 1 fois Message édité par AllenMadison le 01-09-2026 à 15:13:42 --------------- Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss. |
neo world | Envoie un MP à Joce. M’enfin si c’est rapide t’es pas plus mal à louer un serveur quelques minutes via les crédits gratuits d’un fournisseur quelconque |
SynE Agri du dessert |
|
neo world | |
AllenMadison Oracle du Keb's |
--------------- Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss. |
neo world | peut être des paramètres plus adaptés. Toujours bon à prendre |
neo world | Décision difficile mais nécessaire ici Message édité par neo world le 01-09-2026 à 22:33:41 |
b-tzu Geek a toute heure... | Bon, j'ai testé qwen 3.8 27b sur le mac 24Go ca passe pas (LM Studio : pas assez de mémoire, alors que c'est eux qui m'ont recommandé ce modele adapté --------------- Topic Ventes || Topic Jeux Vidéos || Topic Téléphonie (Rien pour le moment) |
neo world | quel quantisation pour le modèle ? Tu as le qwen3.8 27b 4 bit MLX qui pèse 16Go. ça passe Message cité 2 fois Message édité par neo world le 02-09-2026 à 00:07:04 |
neo world | p'tit dashboard bien pratique qui récupère les stats llamacpp ( / metrics ) et ceux de rocm-smi pour surveiller ce que fait mon modèle / les agents :
|
b-tzu Geek a toute heure... |
--------------- Topic Ventes || Topic Jeux Vidéos || Topic Téléphonie (Rien pour le moment) |
neo world | d'après la reglette magique lm studio : 12k. Au dessus tu arrives à plus de 20GO en RAM |
AllenMadison Oracle du Keb's | Au rang des cartes qui vont interesser tout le monde : https://hardwareand.co/actualites/l [...] w-pour-lia Intel Crescent Island, jusqu'à 480go de ram sur une carte Spécialement dédiée à l'IA, pas de raytracing, 350w
Un petit setup avec 2 cartes je dirais pas non ça va être sympa l'année prochaine, entre ces cartes, la xiaomi AI box etc Message cité 2 fois Message édité par AllenMadison le 02-09-2026 à 07:49:21 --------------- Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss. |
FlorentG |
|
AllenMadison Oracle du Keb's |
Honnetement Intel est pas con sur le coup, plutot que de faire des cartes de jeu et concurrencer nvidia (chose impossible), faire des cartes AI pour l'avoir en local ils peuvent se faire des couilles en or. Si c'est bien pricé et qu'ils font eux meme la ram dans leur usines de gravure, ça peut être intéressant. Il faudra voir s'ils ont sur la carte des trucs équivalent a ce que xiaomi prévoit sur sa box avec des chip qui accélèrent l'inférence et le prefill Message cité 1 fois Message édité par AllenMadison le 02-09-2026 à 08:21:28 --------------- Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss. |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
b-tzu Geek a toute heure... |
--------------- Topic Ventes || Topic Jeux Vidéos || Topic Téléphonie (Rien pour le moment) |
the_fennec f3nn3cUs z3rd4 |
Message cité 2 fois Message édité par the_fennec le 02-09-2026 à 09:01:56 --------------- Faudra que je teste un jour :o |
AllenMadison Oracle du Keb's |
Rien ne t'empeche d'en prendre une pour la ram et à côté mettre une blackwell pro Faudra voir les benchs, mais mettre 480go de ram si c'est pour avoir du compute riquiqui c'est pas forcément judicieux oui Message cité 1 fois Message édité par AllenMadison le 02-09-2026 à 09:23:06 --------------- Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss. |
neo world |
|
neo world |
|
speedboyz30 Guide Michelin :o |
|
neo world |
|
neo world |
|
epsiloncentaury | Dilemme avec ma RAM. Il y a 3 ans, je voulais commander 2x16 Go. Je me suis trompé, j'ai reçu une barrette de 32 Go. Sur le moment, je me suis dit que ce n'était pas grave. Aujourd'hui, je me rends compte que c'est une erreur. Le single channel, c'est une catastrophe pour la bande passante. Je perds 50% par rapport à du dual channel. 25,6 Go/s en moins, c'est énorme pour IA en offloading sur le CPU. Je me suis dit que j'allais racheter une barrette de 32 Go pour faire du dual channel. Mais aux prix actuels, c'est mort. Du coup, j'ai pensé à une autre solution. Utiliser des barrettes qui dorment dans un tiroir. J'ai 2x8 Go en 2400 et 2x8 Go en 3200 SODIMM. Avec des adaptateurs, je peux les mettre sur la carte mère et avoir 32 Go en dual channel. Bande passante estimée 46,4 Go/s au lieu de 25,6 Go/s, si je les pousse a 2900. C'est un vrai gain, et je pourrais vendre ma barrette de 32Go Qu'est-ce que vous en pensez ?. Message cité 1 fois Message édité par epsiloncentaury le 02-09-2026 à 09:57:09 |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
Quich Pouet ? |
Une des questions c'est la bande passante de la mémoire embarquée, un commentaire ici estime 1,3TB/s :
Message cité 1 fois Message édité par Quich le 02-09-2026 à 10:33:32 --------------- Feedback |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
speedboyz30 Guide Michelin :o | Bon, Fable 5.1 vient de me convaincre d'abandonner le M3 Ultra :
|
b-tzu Geek a toute heure... | Si quelqu’un veut un Mac mini M1 Pro avec 32Go de ram pour 650€ : --------------- Topic Ventes || Topic Jeux Vidéos || Topic Téléphonie (Rien pour le moment) |
neo world |
|
the_fennec f3nn3cUs z3rd4 | 2/5 of my CMP 170HX have died after 2 weeks and the 3rd came with defective tensor cores. Current prices DO NOT justify the risk you are taking
--------------- Faudra que je teste un jour :o |
neo world | Sinon déménagement sur Strix halo fait : le NAS et en particulier les disques ont juste perdu 8°. Le Strix halo a perdu 18°
Message édité par neo world le 02-09-2026 à 11:57:19 |
neo world |
|
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
speedboyz30 Guide Michelin :o |
Bon, Claude me dirige de plus en plus vers ça : Mini PC Asus Ascent GX10 GB10 128GB 1TB SSD NVIDIA Blackwell WiFi 7 Edit: mes liens sont morts, les prix plus dispos Il me dit à juste titre que le gap de prix ne vaut pas le coup. Et on gagne Cuda Et surtout on gagne 1400 euros
Message cité 1 fois Message édité par speedboyz30 le 02-09-2026 à 19:49:55 |
neo world |
|
neo world | Je test un nouveau workflow ici :
Message édité par neo world le 02-09-2026 à 12:51:27 |

| Sujets relatifs | |
|---|---|
| [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co | sécurité de l'IA / agentique et des Devs en roue libre |
| Plus de sujets relatifs à : Infra IA : aide au choix et troubleshot de LLM Locaux | |




