Forum |  HardWare.fr | News | Articles | PC | S'identifier | S'inscrire | Shop Recherche
2845 connectés 

 


Je génère ...
Sondage à 3 choix possibles.
Ce sondage expirera le 20-09-2026 à 10:00




Attention si vous cliquez sur "voir les résultats" vous ne pourrez plus voter

 Mot :   Pseudo :  
  Aller à la page :
 
 Page :   1  2  3  4  5  ..  61  62  63  64  65  66  67  68  69
Auteur Sujet :

Infra IA : aide au choix et troubleshot de LLM Locaux

n°48478
neo world
Posté le 10-09-2026 à 10:37:28  profilanswer
 

Reprise du message précédent :

speedboyz30 a écrit :

J'attends avec impatience les annonces de prix pour les nouveaux strix halo / RTX [:clooney9]  
 
Et les benchmark IRL des Studio M5  [:zest:1]


tu as posté toutes les bonnes affaires du refurb Apple depuis 6 mois sans jamais en acheter. J'en déduis que tu attends une machine avec 2TB de RAM / 1,2TB/s minimum pour environ 5000 balles :o . Ce sera pas pour cette gen de strix. Surtout on va se rapprocher de la disponibilité de la DDR6 (qui sera pas moins cher  :whistle: mais peut être fera baisser un peu plus vite la ddr5 si la pénurie se calme un peu ?)
 
T'es dans le [:psedo:3] pour te décider vu le timing pourri qu'on se tape en ce moment  :pt1cable:

n°48479
katkar
Posté le 10-09-2026 à 10:37:54  profilanswer
 

Bonjour, bonjour :hello:

n°48481
Nr13
Posté le 10-09-2026 à 10:44:04  profilanswer
 

Merci pour les infos :p

n°48484
neo world
Posté le 10-09-2026 à 10:50:15  profilanswer
 

raukoras a écrit :

Merci  pour l'accueil.
 
En matos je suis light, j'ai une vieille 1050ti qui crachait déjà ses poumons il y a deux ans sur les quelques tests que j'ai fait (génération d'image et workflow de réponse à des emails).
 
Là je zyeute pour investir dans quelque chose qui puisse soutenir une utilisation "professionnelle" (automatisation de workflows, et assistant personnel pour  2/3 personnes).


completion de code pour 3 personnes (un nvidia stark GB10 sera sans doute bien) ou 3 agents utilisés par 3 personnes en même temps ? (RTX6000 pro idéalement je dirais mais c'est plus du tout le même budget)

n°48485
neo world
Posté le 10-09-2026 à 10:51:12  profilanswer
 

katkar a écrit :

Bonjour, bonjour :hello:


welcome, on manquait de retour d'experience terrain avec Intel justement. On prend avec plaisir les aventuriers ici :D

n°48486
katkar
Posté le 10-09-2026 à 10:52:03  profilanswer
 

Pour reprendre la question Arc Pro B50 vs Mac Mini ....  
 
Chatgtp me sort ceci :
 
 
Caractéristique                             Intel Arc Pro B50                                  Mac mini M4 16 Go  
 
Type                                        Carte graphique dédiée                                Ordinateur complet  
GPU                                                 16 Xe2 Cores                                GPU Apple 10 cœurs  
Mémoire accessible au GPU        16 Go GDDR6 dédiés               16 Go unifiés, partagés avec macOS et le CPU
Bande passante mémoire                    224 Go/s |                                          120 Go/s
Puissance GPU théorique FP32        ≈ 10,65 TFLOPS                        ≈ 4,3 à 4,6 TFLOPS estimés
Consommation                            70 W pour la carte seule            25–40 W pour la machine entière en charge
API principales                            DirectX 12, Vulkan, OpenCL, oneAPI                                             Metal

Message cité 1 fois
Message édité par katkar le 10-09-2026 à 10:54:54
n°48488
the_fennec
f3nn3cUs z3rd4
Posté le 10-09-2026 à 10:52:21  profilanswer
 

tfpsly a écrit :


5060 Ti 16gb = à partir de 460 CHF. Moins la 3060 si je la revends bien ~ les 250 dont je parlais pour l'upgrade ;)
 
Mais je pense qu'il faudrait prendre une carte avec encore plus de VRAM pour faire un vrai upgrade. Et là, je dois changer la PSU aussi.


 
Non mais tu nous trolles avec tes prix suisses :o
 
En france c'est 200 de plus, minimum:
https://fr.pcpartpicker.com/product [...] ice&page=1
 
C'est quoi ta config actuelle et ton budget? Une 5060 ça bouffe rien.
 
Pour la VRAM tu va vite découvrir la triste réalité, déjà les cartes avec 16GB sont pas données, mais tout ce qui est au dessus c'est plus de 1000 balles. Même une V100 32GB sur Ali c'est facilement 800 euros.


---------------
Faudra que je teste un jour :o
n°48489
the_fennec
f3nn3cUs z3rd4
Posté le 10-09-2026 à 10:52:40  profilanswer
 

katkar a écrit :

Bonjour, bonjour :hello:


 :hello:


---------------
Faudra que je teste un jour :o
n°48490
the_fennec
f3nn3cUs z3rd4
Posté le 10-09-2026 à 10:54:54  profilanswer
 

katkar a écrit :

Pour reprendre la question Arc Pro B50 vs Mac Mini ....  
 
Chatgtp me sort ceci :
 
 
| Caractéristique              |                  Intel Arc Pro B50 |                                 Mac mini M4 16 Go |
| ---------------------------- | ---------------------------------: | ------------------------------------------------: |
| Type                         |             Carte graphique dédiée |                                Ordinateur complet |
| GPU                          |                       16 Xe2 Cores |                                GPU Apple 10 cœurs |
| Mémoire accessible au GPU    |                 16 Go GDDR6 dédiés |      16 Go unifiés, partagés avec macOS et le CPU |
| Bande passante mémoire       |                           224 Go/s |                                          120 Go/s |
| Puissance GPU théorique FP32 |                     ≈ 10,65 TFLOPS |                        ≈ 4,3 à 4,6 TFLOPS estimés |
| Consommation                 |           70 W pour la carte seule | Environ 25–40 W pour la machine entière en charge |
| API principales              | DirectX 12, Vulkan, OpenCL, oneAPI |                                             Metal |
| Mise à niveau                |                                Oui |                                               Non |


 
Tu lui diras que c'est pas bien formaté ;)
 
Attention, tu pourras pas utiliser les 16GB du mac mini en entier, peut être 12GB.


---------------
Faudra que je teste un jour :o
n°48492
katkar
Posté le 10-09-2026 à 10:57:05  profilanswer
 

De base j'en veux pas du Mac mini
 
Apple et hors budget  
 
:o

n°48494
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 11:00:43  profilanswer
 

neo world a écrit :


tu as posté toutes les bonnes affaires du refurb Apple depuis 6 mois sans jamais en acheter. J'en déduis que tu attends une machine avec 2TB de RAM / 1,2TB/s minimum pour environ 5000 balles :o . Ce sera pas pour cette gen de strix. Surtout on va se rapprocher de la disponibilité de la DDR6 (qui sera pas moins cher  :whistle: mais peut être fera baisser un peu plus vite la ddr5 si la pénurie se calme un peu ?)
 
T'es dans le [:psedo:3] pour te décider vu le timing pourri qu'on se tape en ce moment  :pt1cable:


 
J'ai bien fait de ne pas acheter en refurb je pense.
On gagne pas mal pour l'IA avec les M5 vs M4 / M3U.
 
Je pense très fortement aujourd'hui pour un M5 Max 128Go avec 1To.
 
Mais c'est normal de vouloir attendre un peu pour voir tout ce qui sort très prochainement avant de sortir presque 6000 balles :o
 
Et rien ne sert de courir pour le studio, il est pas encore livrable :jap:

n°48495
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 11:12:22  profilanswer
 

neo world a écrit :

3 agents utilisés par 3 personnes en même temps ?


 
C'est sur ce type d'usage justement que le GB10 se distingue.
La bande passante est plus faible, mais il encaisse sans broncher 10x streams en parallèle sans impact sur les t/s.

n°48497
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 11:13:14  profilanswer
 

katkar a écrit :

De base j'en veux pas du Mac mini
 
Apple et hors budget  
 
:o


 
C'est quoi ton budget ? :o

n°48500
neo world
Posté le 10-09-2026 à 11:18:14  profilanswer
 

speedboyz30 a écrit :


 
J'ai bien fait de ne pas acheter en refurb je pense.
On gagne pas mal pour l'IA avec les M5 vs M4 / M3U.
 
Je pense très fortement aujourd'hui pour un M5 Max 128Go avec 1To.
 
Mais c'est normal de vouloir attendre un peu pour voir tout ce qui sort très prochainement avant de sortir presque 6000 balles :o
 
Et rien ne sert de courir pour le studio, il est pas encore livrable :jap:


m'est avis que tu en seras content :jap:

n°48501
neo world
Posté le 10-09-2026 à 11:18:30  profilanswer
 

speedboyz30 a écrit :


 
C'est quoi ton budget ? :o


+1 :D

n°48502
neo world
Posté le 10-09-2026 à 11:19:49  profilanswer
 

speedboyz30 a écrit :


 
C'est sur ce type d'usage justement que le GB10 se distingue.
La bande passante est plus faible, mais il encaisse sans broncher 10x streams en parallèle sans impact sur les t/s.


tu as un article là dessus ? le NPU est assurément meilleur que sur le Strix halo (+NVFP4 miraculeux) mais au point d'enquiller les streams parallèles sans broncher ?

n°48503
Winpoks
Posté le 10-09-2026 à 11:23:04  profilanswer
 

speedboyz30 a écrit :


 
C'est quoi ton budget ? :o


 
Il va en annoncer un et dans 3h il aura commandé en l’explosant. :o

n°48508
neo world
Posté le 10-09-2026 à 11:30:24  profilanswer
 

Winpoks a écrit :


 
Il va en annoncer un et dans 3h il aura commandé en l’explosant. :o


L’histoire du topic  [:midnaite:4]

n°48509
moyen_moin​s
chat réincarné
Posté le 10-09-2026 à 11:30:28  profilanswer
 

neo world a écrit :


m'est avis que tu en seras content :jap:


dommage qu'il y ait pas un entre 2 entre le 128Go et le 256Go (comme les prochains strix halo d'amd) :o
ça pourrait faire tourner des MoE de 300-400B avec un quant pas si dégueulasse :o
on en veut toujours plus [:tinostar]

n°48512
Tronklou
❤❤ Vrp Bambulab à mi-temps ❤❤
Posté le 10-09-2026 à 11:39:01  profilanswer
 

Moi j'attend le prochain gpu avec un rad a ouvrir au marteau, j'ai du matériel a rentabiliser  [:mastersam]


---------------
Victime de girafophobie, mais se soigne.
n°48513
neo world
Posté le 10-09-2026 à 11:40:28  profilanswer
 

Tronklou a écrit :

Moi j'attend le prochain gpu avec un rad a ouvrir au marteau, j'ai du matériel a rentabiliser  [:mastersam]


V100 / A100 ? :o

n°48515
neo world
Posté le 10-09-2026 à 11:41:54  profilanswer
 

moyen_moins a écrit :


dommage qu'il y ait pas un entre 2 entre le 128Go et le 256Go (comme les prochains strix halo d'amd) :o
ça pourrait faire tourner des MoE de 300-400B avec un quant pas si dégueulasse :o
on en veut toujours plus [:tinostar]


Ca va venir mais pas cette année. C'est plutôt une bonne nouvelle d'ailleurs. le jour où le 256GB devient la norme on pourra dire adieu à nos montages à base de bc250 scotché à une 4060 lui même attaché à la ficelle à colis à un Strix halo :o

Message cité 3 fois
Message édité par neo world le 10-09-2026 à 11:42:11
n°48516
seu
M 41
Posté le 10-09-2026 à 11:42:53  profilanswer
 

neo world a écrit :


L’histoire du topic  [:midnaite:4]


 
ah booooooooon ?  :o

n°48522
moyen_moin​s
chat réincarné
Posté le 10-09-2026 à 12:34:24  profilanswer
 

neo world a écrit :


Ca va venir mais pas cette année. C'est plutôt une bonne nouvelle d'ailleurs. le jour où le 256GB devient la norme on pourra dire adieu à nos montages à base de bc250 scotché à une 4060 lui même attaché à la ficelle à colis à un Strix halo :o


ça reste un hobby de niche :o

n°48524
neo world
Posté le 10-09-2026 à 12:38:36  profilanswer
 

moyen_moins a écrit :


ça reste un hobby de niche :o


le faire soit même en expérimentant façon informatique des années 80/90 oui. Par contre le marché est déjà juste énorme et peu d'organisation ferait avec les outils d'automatisation traditionnels comme il y a trois ans :jap:

n°48533
tfpsly
Sly
Posté le 10-09-2026 à 13:27:51  profilanswer
 

the_fennec a écrit :

 

Non mais tu nous trolles avec tes prix suisses :o

 

En france c'est 200 de plus, minimum:
https://fr.pcpartpicker.com/product [...] ice&page=1

 

C'est quoi ta config actuelle et ton budget? Une 5060 ça bouffe rien.

 

Pour la VRAM tu va vite découvrir la triste réalité, déjà les cartes avec 16GB sont pas données, mais tout ce qui est au dessus c'est plus de 1000 balles. Même une V100 32GB sur Ali c'est facilement 800 euros.


J'ai un Ryzen 3600X, 32gb, et une 3060 12gb.
Gemini estime que upgrader à une 5060 Ti 16gb ne donnerait que +20% de perfs max. Donc je ne pense pas upgrader pour l'instant.

 

Et effectivement pour avoir plus de RAM... Les 3090 24gb se vendent verts 800 CHF en occas. Une autre raison de rester sur ma config, qui me satisfait.

Message cité 1 fois
Message édité par tfpsly le 10-09-2026 à 13:31:33
n°48543
moyen_moin​s
chat réincarné
Posté le 10-09-2026 à 14:06:11  profilanswer
 

j'ai vu des 4090 48GB sur ebay en France à 4k pour ceux qui veulent :o


Message édité par moyen_moins le 10-09-2026 à 14:06:42
n°48554
katkar
Posté le 10-09-2026 à 14:48:08  profilanswer
 

speedboyz30 a écrit :


 
C'est quoi ton budget ? :o


Je cite mon post sur Serveurs@home
 
"Je rappel que c'est pour du @home ...
J'ai 3 contraintes :
 
- de 500€
- 2 slots Low Profil (c'est pour mon hyperviseur)
- Ne pas faire exploser ma conso électrique "

Message cité 3 fois
Message édité par katkar le 10-09-2026 à 14:50:51
n°48559
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 15:09:15  profilanswer
 

katkar a écrit :


Je cite mon post sur Serveurs@home
 
"Je rappel que c'est pour du @home ...
J'ai 3 contraintes :
 
- de 500€
- 2 slots Low Profil (c'est pour mon hyperviseur)
- Ne pas faire exploser ma conso électrique "


 
Il te manque un 0 ?  [:zyzz:2]  [:la chancla:1]

n°48560
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 15:11:10  profilanswer
 

Qui fait du "semi" local?
 
Quelques petits modèles locaux pour ce qui touche aux données sensibles, un orchestrateur frontière pour gérer ce beau monde ?

n°48561
M300A
Posté le 10-09-2026 à 15:12:09  profilanswer
 

Non mais je prépare tout avec mon GLM local, je review le plan avec Opus, j'implemente avec GLM et je review l'implémentation avec Opus


---------------
:wq
n°48565
neo world
Posté le 10-09-2026 à 15:19:49  profilanswer
 

katkar a écrit :


Je cite mon post sur Serveurs@home
 
"Je rappel que c'est pour du @home ...
J'ai 3 contraintes :
 
- de 500€
- 2 slots Low Profil (c'est pour mon hyperviseur)
- Ne pas faire exploser ma conso électrique "


La B50 semble pas si pire comme c’est la seule qui rentre dans ton cahier des charges. Tu souhaites en faire quoi ? (Lab ? Monitoring/remediation de ton infra ? Coder des apps ? Agentique ? Étonnamment tout ça en même temps sera compliqué si tu n’es pas très patient :o )

n°48567
neo world
Posté le 10-09-2026 à 15:22:07  profilanswer
 

speedboyz30 a écrit :

Qui fait du "semi" local?
 
Quelques petits modèles locaux pour ce qui touche aux données sensibles, un orchestrateur frontière pour gérer ce beau monde ?


Itou :
Chat / orchestration / archi : Claude avec backup local si il ne répond pas
Dev pur et dur : strix halo avec Qwen 3.8 flash next
Revue de code avec soumission d’un rapport de préconisations : DS4 flash ou GLM 5.3 selon ce qui coute le moins cher  

n°48568
katkar
Posté le 10-09-2026 à 15:32:05  profilanswer
 

neo world a écrit :


La B50 semble pas si pire comme c’est la seule qui rentre dans ton cahier des charges. Tu souhaites en faire quoi ? (Lab ? Monitoring/remediation de ton infra ? Coder des apps ? Agentique ?


 
:)
 
Comme les cartes Intel gère SR-IOV, je pourrais tester d'autres usages !  
 
 

n°48569
the_fennec
f3nn3cUs z3rd4
Posté le 10-09-2026 à 15:36:20  profilanswer
 

katkar a écrit :

De base j'en veux pas du Mac mini
 
Apple et hors budget  
 
:o


 
Pourquoi en parler alors?


---------------
Faudra que je teste un jour :o
n°48570
neo world
Posté le 10-09-2026 à 15:37:00  profilanswer
 

C’est moi qui lui en a parlé sur l’autre topic :D

n°48571
the_fennec
f3nn3cUs z3rd4
Posté le 10-09-2026 à 15:37:55  profilanswer
 

neo world a écrit :


Ca va venir mais pas cette année. C'est plutôt une bonne nouvelle d'ailleurs. le jour où le 256GB devient la norme on pourra dire adieu à nos montages à base de bc250 scotché à une 4060 lui même attaché à la ficelle à colis à un Strix halo :o


 
Hé oh, j'ai rien de scotché! ... enfin il me semble :O


---------------
Faudra que je teste un jour :o
n°48572
the_fennec
f3nn3cUs z3rd4
Posté le 10-09-2026 à 15:43:56  profilanswer
 

tfpsly a écrit :


J'ai un Ryzen 3600X, 32gb, et une 3060 12gb.
Gemini estime que upgrader à une 5060 Ti 16gb ne donnerait que +20% de perfs max. Donc je ne pense pas upgrader pour l'instant.
 
Et effectivement pour avoir plus de RAM... Les 3090 24gb se vendent verts 800 CHF en occas. Une autre raison de rester sur ma config, qui me satisfait.


 
Gemini dit de la merde :o
 
A ton/notre niveau c'est pas trop une question de perf, mais de quel modèle tu peux charger. Avec 16GB tu peux mettre un 27B Q4 ou un 35B avec de l'offload CPU et faire des trucs pas mal. Avec 12GB c'est quand même bien serré. L’idéal c'est de mettre les deux pour 28GB de VRAM :o
 
Je comprends pas trop pour ta config, tu veux rien changer finalement?


---------------
Faudra que je teste un jour :o
n°48576
Tronklou
❤❤ Vrp Bambulab à mi-temps ❤❤
Posté le 10-09-2026 à 16:01:53  profilanswer
 

neo world a écrit :


Ca va venir mais pas cette année. C'est plutôt une bonne nouvelle d'ailleurs. le jour où le 256GB devient la norme on pourra dire adieu à nos montages à base de bc250 scotché à une 4060 lui même attaché à la ficelle à colis à un Strix halo :o


 
[:cosmoschtroumpf]
 

katkar a écrit :


Je cite mon post sur Serveurs@home
 
"Je rappel que c'est pour du @home ...
J'ai 3 contraintes :
 
- de 500€
- 2 slots Low Profil (c'est pour mon hyperviseur)
- Ne pas faire exploser ma conso électrique "


 
Commence par définir ton besoin en terme de models avec l'usage réel envisagé.
A l'heure actuelle, pour du généraliste ou un minimum performant, a titre perso j'estime que 24gb c'est le minimum pour être confortable.
Et avec ton budget et tes contraintes c'est mort.
 
Donc faut vraiment commencer par voir quelle taille de vram tu as vraiment besoin pour voir si c'est réaliste :jap:  


---------------
Victime de girafophobie, mais se soigne.
n°48581
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 16:31:53  profilanswer
 

M300A a écrit :

Non mais je prépare tout avec mon GLM local, je review le plan avec Opus, j'implemente avec GLM et je review l'implémentation avec Opus


 

neo world a écrit :


Itou :
Chat / orchestration / archi : Claude avec backup local si il ne répond pas
Dev pur et dur : strix halo avec Qwen 3.8 flash next
Revue de code avec soumission d’un rapport de préconisations : DS4 flash ou GLM 5.3 selon ce qui coute le moins cher  


 
Vous utilisez quoi pour gérer la bascule local / cloud ?
 
A priori openclaw se débrouille bien. En soit je pourrais me satisfaire de moins de RAM, si mes workers ne doivent pas gérer le planning / high-level reasoning.

n°48584
Tronklou
❤❤ Vrp Bambulab à mi-temps ❤❤
Posté le 10-09-2026 à 16:41:58  profilanswer
 

Ça dépend ce que tu colle en terme de models et de contexte, mais globalement les agents types openclaw/hermes il faut déjà du lourd pour que ça fonctionne correctement en full local.  
 
Perso je laisse l'agent sur du cloud et le local par contre c'est du harness spécialisé ( pi/cc/opc2 ) qui est supervisé par le model cloud.


---------------
Victime de girafophobie, mais se soigne.
 Page :   1  2  3  4  5  ..  61  62  63  64  65  66  67  68  69

Aller à :
Ajouter une réponse
 

Sujets relatifs
[Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & cosécurité de l'IA / agentique et des Devs en roue libre
Plus de sujets relatifs à : Infra IA : aide au choix et troubleshot de LLM Locaux


Copyright © 1997-2025 Groupe LDLC (Signaler un contenu illicite / Données personnelles)