| |||||
| Auteur | Sujet : Infra IA : aide au choix et troubleshot de LLM Locaux |
|---|---|
AllenMadison Oracle du Keb's | Reprise du message précédent :
Medusa halo en 2027 pfft. Ecoutez l'oracle et attendez un an les gars Message édité par AllenMadison le 31-08-2026 à 23:07:18 --------------- Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss. |
neo world | ce serait vraiment la première fois qu'AMD foire un produit et déçoit ceux qui attendent |
neo world |
Message édité par neo world le 01-09-2026 à 01:18:11 |
neo world |
Message édité par neo world le 01-09-2026 à 01:58:13 |
neo world | le contexte à 32000 tokens après 11 minutes d'échange. Ca engloutie des tokens plus vite que des tic tac Message cité 2 fois Message édité par neo world le 01-09-2026 à 02:50:11 |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
the_fennec f3nn3cUs z3rd4 |
Message édité par the_fennec le 01-09-2026 à 08:18:22 --------------- Faudra que je teste un jour :o |
speedboyz30 Guide Michelin :o | Y a des M3 Ultra qui sont tombés sur le refurb. 96Go ram 820GB/s de bande passante pour 5200 euros. On perd un peu de bande passante et les neural accelerators mais ça positionne bien dans l’étalement de la gamme Message cité 1 fois Message édité par speedboyz30 le 01-09-2026 à 09:13:44 |
AllenMadison Oracle du Keb's | C'est reuch et a la fois pas reuch pour du Apple --------------- Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss. |
neo world | 3x la bande passante du strix halo pour 2 fois le prix et à peine moins de ram. Ça joue |
neo world | Mac m5 Max ou gamme ultra ou rtx 6000 pro. Pour la complétion de code le DGX spark est très bien mais pour de l’agentique ça va être compliqué d’être productif |
croustx Modoadorateur |
neo world | T’as pas lu mes messages du dessus |
Plam Bear Metal |
--------------- Spécialiste du bear metal |
neo world |
|
croustx Modoadorateur | et par qui sont appelés les agents ? Une IA de supervision, ou bien les utilisateurs en direct ?
|
Plam Bear Metal |
1. Dans l'interface de OpenWebUI, ils choisissent (ou configurent par défaut) l'agent avec qui ils bossent (ou font juste "@" pour en changer en cours de conversation). Puis ils posent les questions et ça répond à tout. Comme un ChatGPT mais qui connait la boîte sur sa partie métier et capable de faire des rapports/graphs et trouver des pattern en quelques secondes sur des tonnes de data. Message édité par Plam le 01-09-2026 à 10:56:07 --------------- Spécialiste du bear metal |
tfpsly Sly |
Message édité par tfpsly le 01-09-2026 à 11:17:17 |
moyen_moins chat réincarné |
|
speedboyz30 Guide Michelin :o |
|
Amonchakai |
the_fennec f3nn3cUs z3rd4 | J'ai l'impression que mon Qwen Next a des doutes Message cité 1 fois Message édité par the_fennec le 01-09-2026 à 11:39:25 --------------- Faudra que je teste un jour :o |
moyen_moins chat réincarné | ah oui, je crois qu'il est perdu dans ses pensées |
AllenMadison Oracle du Keb's |
Hmm hmm hmm.
Oui ton qwen pédale dans la semoule Message cité 1 fois Message édité par AllenMadison le 01-09-2026 à 12:15:52 --------------- Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss. |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
neo world |
Message cité 1 fois Message édité par neo world le 01-09-2026 à 13:14:07 |
AllenMadison Oracle du Keb's |
--------------- Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss. |
neo world | Il est un peu dans le futur : voici la doc à utiliser pour revenir dans le passé et pousser le code qu'on t'a demandé plus rapidement |
speedboyz30 Guide Michelin :o |
|
neo world | si je devais choisir le plus gros nombre de GB que de RAM et de stockage que je peux me permettre. A priori c'est plutôt chez M3 que chez M5 |
Neji Hyuga :grut: |
speedboyz30 Guide Michelin :o |
neo world | pour nous impressionner faut encore les brancher |
Neji Hyuga :grut: | Celui du dessous l'est déjà, mais plus pour longtemps malheureusement --------------- Le Topic Unique des collections de cartes graphiques - GPUCHAN.ORG |
speedboyz30 Guide Michelin :o |
|
neo world | Le M5 max semble un bon milieu dans ces conditions mais je suis plus sensible à la capacité qu'à la vitesse |
neo world | n'empêche gros coup de coeur pour Hermes : c'est rapide, verbeux juste ce qu'il faut, il récupère bien des erreurs. Que du positif vs openclaw |
the_fennec f3nn3cUs z3rd4 |
--------------- Faudra que je teste un jour :o |
AllenMadison Oracle du Keb's | Est-ce que quelqu'un ici a un serveur avec au moins 192 ou 320go de ram pour effectuer un calcul python et me rendre un petit service ? En dessous c'est mort, et mes 32go de ram sur mon pc ça va pas suffire Oui je sais que poser cette question là en pleine pénurie de ram... Pour les curieux, je tente de calculer de l'entropie sur une absorption de positivité de signe des nombres premiers (forme de weil pour RH) via une construction par des matrices de hadamard. Pour 1024 et 2048 matrices ça me demande respectivement entre 80 et 120go de ram / 220/320go (sans optimisations). La VM de ChatGPT n'a que 32go de ram aussi donc ça coince un peu Message cité 1 fois Message édité par AllenMadison le 01-09-2026 à 15:13:42 --------------- Nothing much to teach, man. There's ze high, there's ze low and yall still fucking miss. |

| Sujets relatifs | |
|---|---|
| [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co | sécurité de l'IA / agentique et des Devs en roue libre |
| Plus de sujets relatifs à : Infra IA : aide au choix et troubleshot de LLM Locaux | |




