| |||||
| Auteur | Sujet : Infra IA : aide au choix et troubleshot de LLM Locaux |
|---|---|
SynE Agri du dessert | Reprise du message précédent : |
M300A | Il te faut des rtx6000 --------------- :wq |
gremi Vieux con des neiges d'antan |
--------------- In aligot we trust. |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
M300A | Oui il y a aussi ça : il y a des setup qui sont classiques, et du coup tu trouves beaucoup de recettes pour les faire tourner. Quand t'as des cartes un peu exotiques ou un nombre exotique c'est le saut dans l'inconnu T'as la même chose pour les RTX6000 en 2/4/8: Message édité par M300A le 04-09-2026 à 15:18:14 --------------- :wq |
neo world |
Message édité par neo world le 04-09-2026 à 15:52:41 |
speedboyz30 Guide Michelin :o | https://minisforumpc.eu/products/mi [...] 1-max-p495
|
neo world | 79,99€ Message édité par neo world le 04-09-2026 à 16:04:21 |
speedboyz30 Guide Michelin :o | C’est ptet juste pour faire du buzz oui.
|
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
neo world | Une étagère sur coulisses et t’es mieux servi |
the_fennec f3nn3cUs z3rd4 | Pareil, je suis arrivé a //// assez vite malgré la lenteur de mon setup. J'avais jamais trop regardé AtomicChat, mais la j'y toucherais plus. J'ai vu par mal de commentaires sur Reddit qui sont aussi suspicieux a cause de la taille de son modèle.
--------------- Faudra que je teste un jour :o |
neo world |
neo world |
Message cité 1 fois Message édité par neo world le 04-09-2026 à 18:38:16 |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
neo world |
|
neo world | Bon après trois jours de run (enfin debug surtout Message cité 1 fois Message édité par neo world le 04-09-2026 à 23:04:07 |
AllenMadison Oracle du Keb's |
Pour te répondre, si c'est la partie software que tu demandes (parce que j'ai l'impression qu'en fait il te faut une idée de la partie hardware POUR le software, les deux vont ensemble en fait) : - Pour la partie hardware, pour faire tourner correctement des IA (voire pour la lecture de gros documents), il te faudra au moins des rtx pro blackwell (comme dit) ET beaucoup de ram. Ca consomme pas mal. 1. Avec ton matos actuel, tu pourras bidouiller/faire mumuse pour te donner une idée de comment configurer, ce qu'il faut du point de vue software - commence par un bête ollama qwen en local, et vois comment tu peux l'installer, puis vois ce qu'il est possible de faire avec ta potite carte. Normalement, pour la partie software, on commence tous par là pour "se faire la main". Tu verras que c'est pas tres rapide, pas tres perf, c'est bien pour du local domestique pour des taches pas tres lourdes. A titrer perso je l'ai utilisé (pour tester) pour analyser des documents financiers d'entreprise (qwen9b de mémoire...) avec une petite 3080, et l'output n'était pas terrible mais ça faisait quand meme le taf. Si tu veux entrainer un modèle pour toi même, comme dit, soit il va falloir être patient, soit il va falloir du compute. Pour te donner un ordre de grandeur, le dernier ChatGPT Astra a été entrainé sur 100.000 GPUs pendant 3 à 4 mois. Au doigt mouillé, faire de l'entrainement perso (et correct) d'un modèle il faudrait minimum x8 gpus H100 sur une station qui coute 100k€ et beaucoup de patience Message cité 1 fois Message édité par AllenMadison le 05-09-2026 à 08:10:08 --------------- Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss. |
tfpsly Sly |
Message cité 2 fois Message édité par tfpsly le 08-09-2026 à 00:01:01 |
Pipould's |
Pourquoi pas Claude code simplement ? |
neo world |
|
neo world |
|
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
the_fennec f3nn3cUs z3rd4 |
Message cité 1 fois Message édité par the_fennec le 05-09-2026 à 10:28:06 --------------- Faudra que je teste un jour :o |
neo world |
|
tfpsly Sly |
Message cité 1 fois Message édité par tfpsly le 05-09-2026 à 12:10:38 |
moyen_moins chat réincarné |
neo world | en même temps vu le nombre de téléchargements y'a peu de chance que ce soit quelqu'un tu topic |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
neo world |
|
the_fennec f3nn3cUs z3rd4 | Bon c'est fini pour les BC250 bon marché --------------- Faudra que je teste un jour :o |
neo world |
|
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
neo world | C’est ce que je fais. Je passe mes nuits à prompter pour intégrer des composants. La je fini l’intégration un SIEM (wazuh) pour surveiller ce que font mes agents |
the_fennec f3nn3cUs z3rd4 | Je voulais dire donner un budget à une IA pour qu'elle achète des trucs. --------------- Faudra que je teste un jour :o |
neo world | pour finir avec une 1065 rebadgée 5090 à seulement 800 balles sur wish ? |
moyen_moins chat réincarné | Je suis en train de tester un truc depuis quelques jours mais pour des raisons de "confidentialité", je m'oblige à faire ça en local. Bref, hier soir j'ai essayé de lancer une "analyse" : 4-5 étapes avec revue, en moyenne par étape, ça génère entre 30000 et quasi 60000 tokens (voire plus entre 15 à 20 t/s mais prefill entre 150 et 180t/s sur la longueur) en fonction de la taille du contexte. Quel est, selon vous, le meilleur investissement à faire dans un budget d'environ 4-5k ? Je suppose qu'avec ce genre de budget, on resterait dur des modèles denses de 27-30B ou des MoE de 120B mais ça devrait largement me suffire. Message cité 1 fois Message édité par moyen_moins le 06-09-2026 à 16:08:14 |

| Sujets relatifs | |
|---|---|
| [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co | sécurité de l'IA / agentique et des Devs en roue libre |
| Plus de sujets relatifs à : Infra IA : aide au choix et troubleshot de LLM Locaux | |




