Forum |  HardWare.fr | News | Articles | PC | S'identifier | S'inscrire | Shop Recherche
3286 connectés 

 


Je génère ...
Sondage à 3 choix possibles.
Ce sondage expirera le 20-09-2026 à 10:00




Attention si vous cliquez sur "voir les résultats" vous ne pourrez plus voter

 Mot :   Pseudo :  
  Aller à la page :
 
 Page :   1  2  3  4  5  ..  60  61  62  63  64  65
Auteur Sujet :

Infra IA : aide au choix et troubleshot de LLM Locaux

n°48584
Tronklou
❤❤ Vrp Bambulab à mi-temps ❤❤
Posté le 10-09-2026 à 16:41:58  profilanswer
 

Reprise du message précédent :
Ça dépend ce que tu colle en terme de models et de contexte, mais globalement les agents types openclaw/hermes il faut déjà du lourd pour que ça fonctionne correctement en full local.  
 
Perso je laisse l'agent sur du cloud et le local par contre c'est du harness spécialisé ( pi/cc/opc2 ) qui est supervisé par le model cloud.


---------------
Victime de girafophobie, mais se soigne.
n°48585
croustx
Modoadorateur
Posté le 10-09-2026 à 16:47:51  profilanswer
 

Pour le lab du boulot, on regarde pour un Nvidia DGX Spark.
 
Ca s'utilise comme un PC ?
(une distri linux + Ollama ?)

n°48587
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 16:48:45  profilanswer
 

croustx a écrit :

Pour le lab du boulot, on regarde pour un Nvidia DGX Spark.
 
Ca s'utilise comme un PC ?
(une distri linux + Ollama ?)


 
Tu peux m'en commander un ?  [:la chancla:1]

n°48588
neo world
Posté le 10-09-2026 à 16:51:27  profilanswer
 

croustx a écrit :

Pour le lab du boulot, on regarde pour un Nvidia DGX Spark.
 
Ca s'utilise comme un PC ?
(une distri linux + Ollama ?)


Yes mais attention cpu ARM donc distrib qui va bien, drivers etc :jap:

n°48593
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 17:02:43  profilanswer
 

Tronklou a écrit :

Ça dépend ce que tu colle en terme de models et de contexte, mais globalement les agents types openclaw/hermes il faut déjà du lourd pour que ça fonctionne correctement en full local.  
 
Perso je laisse l'agent sur du cloud et le local par contre c'est du harness spécialisé ( pi/cc/opc2 ) qui est supervisé par le model cloud.


 
Je pensais effectivement à du openclaw avec ChatGPT mais faire appel à un model local pour des trucs du genre accès boite mail, messages, TTS, STT, données santé, RH, financières.

n°48598
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 17:17:49  profilanswer
 

neo world a écrit :


tu as un article là dessus ? le NPU est assurément meilleur que sur le Strix halo (+NVFP4 miraculeux) mais au point d'enquiller les streams parallèles sans broncher ?


 
Ici par exemple :
 

Citation :

Thanks to the power of the NVIDIA Grace Blackwell Superchip, the GPU can parallelize multiple subagents. Two, four, or even eight subagents concurrently working through requests can make use of the strong concurrency capabilities in DGX Spark.  
 
Completing four times as many tasks requires only 2.6x more time, while prompt processing throughput increases by about 3x


 
https://developer.nvidia.com/blog/s [...] dgx-spark/
 
Et là :  
 

Citation :

In a sustained “Race to 1 Million Tokens” benchmark testing highly concurrent inference workflows:
 
The DGX Spark running vLLM completes the 1-million-token workload 3.8x faster than the M3 Ultra. Because it finishes so rapidly, the Spark consumes less total energy for the project despite its higher 45-watt idle power draw.


 

Citation :

Massive Model (120B Parameter) Decode Performance
 
When scaling to extremely large parameters (e.g., GPT-OSS 120B in MXFP4 format), memory bandwidth becomes the primary performance bottleneck.
 
    Prompt Processing: The DGX Spark handles prompt prefilling at 1,723 tokens/sec. The M3 Ultra processes prompts at 863 tokens/sec.
 
    Token Generation: The M3 Ultra’s 819 GB/s memory bandwidth allows it to generate 70.79 tokens/sec. The DGX Spark is limited by its 273 GB/s bandwidth, generating 38.55 tokens/sec.
 
vLLM on the DGX Spark provides a massive lead in concurrent workflows and rapid prompt prefilling. However, the MLX framework on the M3 Ultra excels at raw decode generation for massive models where memory bandwidth acts as a strict ceiling.


 
https://elitetestengineering.substa [...] o-m3-ultra

n°48599
neo world
Posté le 10-09-2026 à 17:30:46  profilanswer
 

speedboyz30 a écrit :


 
Vous utilisez quoi pour gérer la bascule local / cloud ?
 
A priori openclaw se débrouille bien. En soit je pourrais me satisfaire de moins de RAM, si mes workers ne doivent pas gérer le planning / high-level reasoning.


C'est un peu bordelique pour le moment mais le process tel que je l'imagine d'ici quelques semaines :
 
=> un salon nextcloud talk avec claude (un par membre de la famille) : tu lui demande designer des trucs avec les skills qui vont bien selon le projet
=> Une fois validé ça part en création de repo Git avec les documents "design doc" et "features request" (faut que je regarde ce qui existe au dessus de forgejo mais au pire y'a ce qui faut dans nextcloud)
=>une moulinette voit arriver le nouveau repo, design doc, feature request et regarde si le strix halo est occupé et par quel projet : si nouveau projet plus prioritaire envoi d'un message pour arreter le dev en cours et après si ça arrete pas tout seul ça coupe pi après 15 minutes de grace period pour reprendre le strix
=> les instructions sont chargées dans une nouvelle session pi et ça démarre le dev + confirmation au user du début du dev
=> une fois fini le code arrive dans Git avec une demande de code review via OCR (Deepseek flash v4) + confirmation au user que son app part en review
Deepseek ecrit dans une page wiki ses trouvailles (pour garder le tracking pas de modif du code en direct par un modèle externe) et ça repart en correction sur le strix halo + confirmation au user que son app part en correction
=> Une fois la correction faite ça part en hosting (LXC sur Proxmox) + confirmation au user que l'app est accessible pour test par un humain et claude vs les feature request
=> Une fois ok ça part en "prod" (backup du container/ hosting perenne) si pas ok ça reboucle en phase de dev
 
et puis ça reboucle sur un nouveau projet ou l'autre projet mis en pause qui n'a pas fini à l'infini
 
y'aura pas mal de trucs à automatiser via du CICD et de l'automatisation de pentests / forensics mais on verra quand on y sera :o
 
Overkill pour une famille ? oui ! mais derrière je vend mieux à mes clients avec un process relativement industriel que je maîtrise et qui doit avoir entre un et 5 ans d'avance sur la plupart des structures avec lesquelles je travail (pas par manque de compétences ou de temps de leur part mais parce qu'ils doivent gérer le legacy et le change management)

Message cité 2 fois
Message édité par neo world le 10-09-2026 à 17:34:49
n°48604
Pipould's
Posté le 10-09-2026 à 18:07:38  profilanswer
 

neo world a écrit :


C'est un peu bordelique pour le moment mais le process tel que je l'imagine d'ici quelques semaines :

 

=> un salon nextcloud talk avec claude (un par membre de la famille) : tu lui demande designer des trucs avec les skills qui vont bien selon le projet
=> Une fois validé ça part en création de repo Git avec les documents "design doc" et "features request" (faut que je regarde ce qui existe au dessus de forgejo mais au pire y'a ce qui faut dans nextcloud)
=>une moulinette voit arriver le nouveau repo, design doc, feature request et regarde si le strix halo est occupé et par quel projet : si nouveau projet plus prioritaire envoi d'un message pour arreter le dev en cours et après si ça arrete pas tout seul ça coupe pi après 15 minutes de grace period pour reprendre le strix
=> les instructions sont chargées dans une nouvelle session pi et ça démarre le dev + confirmation au user du début du dev
=> une fois fini le code arrive dans Git avec une demande de code review via OCR (Deepseek flash v4) + confirmation au user que son app part en review
Deepseek ecrit dans une page wiki ses trouvailles (pour garder le tracking pas de modif du code en direct par un modèle externe) et ça repart en correction sur le strix halo + confirmation au user que son app part en correction
=> Une fois la correction faite ça part en hosting (LXC sur Proxmox) + confirmation au user que l'app est accessible pour test par un humain et claude vs les feature request
=> Une fois ok ça part en "prod" (backup du container/ hosting perenne) si pas ok ça reboucle en phase de dev

 

et puis ça reboucle sur un nouveau projet ou l'autre projet mis en pause qui n'a pas fini à l'infini

 

y'aura pas mal de trucs à automatiser via du CICD et de l'automatisation de pentests / forensics mais on verra quand on y sera :o

 

Overkill pour une famille ? oui ! mais derrière je vend mieux à mes clients avec un process relativement industriel que je maîtrise et qui doit avoir entre un et 5 ans d'avance sur la plupart des structures avec lesquelles je travail (pas par manque de compétences ou de temps de leur part mais parce qu'ils doivent gérer le legacy et le change management)

 

Tu es conscient qu'à chaque étape ça va te sortir un truc potentiellement buggé et qu'il faudra que tu vérifies tout ?

 

Au début j'adressais mes bots avec OpenClaw mais a la fin j'ai compris que 80% des mes tokens étaient cramés sur des tâches annexes. Du coup a la fin j'ai tout viré, pris vibeyard et Claude code avec modèles locaux et zou.

 

Par contre j'ai pas de pipeline H24. Mais ça me dérange pas.

 

La d'après ce que tu décris pour que ça marche il faut que t'ai une archi au poil par app et un pipeline pour coder les features car si tu fais tout en un coup c'est pas 262k de contexte qui va suffire.

Message cité 1 fois
Message édité par Pipould's le 10-09-2026 à 18:09:29
n°48605
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 18:09:25  profilanswer
 

neo world a écrit :


C'est un peu bordelique pour le moment mais le process tel que je l'imagine d'ici quelques semaines


 
Oula oui :o
 
Moi je pensais plus à un filtre par outil / fonctions :  
 
Paperless / Immich / Mail / Whatsapp / Contacts (Monica) / Santé (Healthlog) / Finance
100% local
 
Le reste cloud avec un genre de filtre PII au cas où.

n°48608
neo world
Posté le 10-09-2026 à 18:21:13  profilanswer
 

Pipould's a écrit :


 
Tu es conscient qu'à chaque étape ça va te sortir un truc potentiellement buggé et qu'il faudra que tu vérifies tout ?
 
Au début j'adressais mes bots avec OpenClaw mais a la fin j'ai compris que 80% des mes tokens étaient cramés sur des tâches annexes. Du coup a la fin j'ai tout viré, pris vibeyard et Claude code avec modèles locaux et zou.  
 
Par contre j'ai pas de pipeline H24. Mais ça me dérange pas.
 
La d'après ce que tu décris pour que ça marche il faut que t'ai une archi au poil par app et un pipeline pour coder les features car si tu fais tout en un coup c'est pas 262k de contexte qui va suffire.


ça compact pour ça. là j'en suis à 9 10 désormais compactages depuis que j'ai commencé mon projet de connecteur (et il marche nickel (y compris les partages de documents). Je lui ait demandé de le convertir en format plugin pour pi et j'en suis à l'étape d'implémentation des correctifs trouvés via OCR.
 
Je regarde pas une seule ligne de code produite : je laisse aller le vibe :o puis je test naïvement et je lui dit ce qui va pas (par exemple manque la feature d'accès aux documents dans un salon. C'est pas via API bot mais via webdav et une clé APP il m'a tout expliqué (et j'avais déjà remarqué le problème sur les plugins officiels hermes et Openclaw). J'ai revérifier en lisant la doc pour voir si c'est pas de l'over engineering mais en fait non c'est bien le process officiel. et maintenant ça marche nickel : il détecte un nouveau document, démarre une tâche tout seul en suivant mes instructions et dans la réponse il a pris en compte le document en PJ
 
So far  [:boisse]


Message édité par neo world le 10-09-2026 à 18:28:36
n°48609
neo world
Posté le 10-09-2026 à 18:28:07  profilanswer
 

speedboyz30 a écrit :


 
Oula oui :o
 
Moi je pensais plus à un filtre par outil / fonctions :  
 
Paperless / Immich / Mail / Whatsapp / Contacts (Monica) / Santé (Healthlog) / Finance
100% local
 
Le reste cloud avec un genre de filtre PII au cas où.


Pour un usage moins industrialisé oui en effet. Il te manque probablement un DLP (data loss prevention) pour détecter des trucs qui n'ont rien à faire à un endroit avant de l'envoyer. j'ai des regex avec Wazuh (un peu léger mais tout est centralisé) mais tu as des trucs tout pêts sur github genre : https://github.com/data-privacy-stack/presidio  
 
Si tu demandes sur le topic de la securité des IA tu pourrais avoir une réponse de Quich qui en connait plus que moi :jap:

n°48610
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 18:31:12  profilanswer
 

neo world a écrit :


Pour un usage moins industrialisé oui en effet. Il te manque probablement un DLP (data loss prevention) pour détecter des trucs qui n'ont rien à faire à un endroit avant de l'envoyer. j'ai des regex avec Wazuh (un peu léger mais tout est centralisé) mais tu as des trucs tout pêts sur github genre : https://github.com/data-privacy-stack/presidio  
 
Si tu demandes sur le topic de la securité des IA tu pourrais avoir une réponse de Quich qui en connait plus que moi :jap:


 
Enfin surtout il me faut la partie local LLM  [:leve le pied jeannot:4]

n°48611
neo world
Posté le 10-09-2026 à 18:32:27  profilanswer
 

speedboyz30 a écrit :


 
Enfin surtout il me faut la partie local LLM  [:leve le pied jeannot:4]


tu peux écrire ton code toi même avec un user ID "Qwen3.8 Max". C'est tout comme :o

n°48612
M300A
Posté le 10-09-2026 à 18:38:31  profilanswer
 

speedboyz30 a écrit :

 

Vous utilisez quoi pour gérer la bascule local / cloud ?

 

A priori openclaw se débrouille bien. En soit je pourrais me satisfaire de moins de RAM, si mes workers ne doivent pas gérer le planning / high-level reasoning.

 

Des fichiers markdown tout simplement


---------------
:wq
n°48613
neo world
Posté le 10-09-2026 à 19:10:25  profilanswer
 

katkar a écrit :


 
:)
 
Comme les cartes Intel gère SR-IOV, je pourrais tester d'autres usages !  
 
 


Je sais pas te conseiller ces B50. si tu ne veux pas étendre ton budget 500 balles de deepseek V4 flash / GLM te mèneront loin. Sinon surveiller 2 BC250 (pas pressé vu que les prix varient beaucoup mais plus de place en vram) ou économiser encore un peu plus et espérer que la DDR6 rebatte un peu les cartes des prix actuels (je vois pas de baisse avant au moins fin d'année prochaine et probablement pas une baisse soudaine ni forte mais j'espère me tromper)

n°48615
Tronklou
❤❤ Vrp Bambulab à mi-temps ❤❤
Posté le 10-09-2026 à 19:23:58  profilanswer
 

Perso un gitea en auto hébergé, chaque dossier est là en mémoire commune. Chaque model interviens sur ses propres fiches et le gros du cloud reprend et fait le support du fichier principal. C'est pas le plus économe mais c'est un bon compromis.


---------------
Victime de girafophobie, mais se soigne.
n°48616
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 19:26:06  profilanswer
 

M300A a écrit :


 
Des fichiers markdown tout simplement


 
Dis en plus  [:zyzz:2]

n°48619
neo world
Posté le 10-09-2026 à 20:14:17  profilanswer
 

le prochain bosgame viendra avec l'occulink. le 495 128Gb serait dispo en octobre et début 2027 pour la version 196GB :
https://www.bosgame.com/blogs/news/ [...] -processor

n°48620
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 20:22:16  profilanswer
 

On veut le prix :o
 
D'ailleurs ça a baissé non ??
 
https://www.bosgamepc.com/products/ [...] 3749034095
 
2600 européens

n°48622
neo world
Posté le 10-09-2026 à 20:23:23  profilanswer
 

je l'ai payé 2200€ en avril  [:tinostar]

n°48624
M300A
Posté le 10-09-2026 à 20:26:31  profilanswer
 

speedboyz30 a écrit :

 

Dis en plus  [:zyzz:2]

 

Bah je lui dis de sauvegarder le plan dans un fichier plan.md et je bascule sur une autre session pour générer un fichier review.md puis je demande au premier de vérifier le contenu de review et d'amender le plan


---------------
:wq
n°48625
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 20:27:45  profilanswer
 

neo world a écrit :

je l'ai payé 2200€ en avril  [:tinostar]

 

C'était 3200 y a pas longtemps  [:la chancla:1]

 

Edit: même sur amazon en fait c'est 3400. Bonne affaire :o

 

https://rehost.diberie.com/Picture/Get/r/542949


Message édité par speedboyz30 le 10-09-2026 à 20:30:09
n°48628
neo world
Posté le 10-09-2026 à 20:40:52  profilanswer
 

ça fait bien 5 ans qu'il faut se méfier des prix sur amazon et comparer (idealo / savemoney camelcamelcamel) si c'est pas une babiole vite fait :jap:

n°48630
moyen_moin​s
chat réincarné
Posté le 10-09-2026 à 21:25:01  profilanswer
 

neo world a écrit :

le prochain bosgame viendra avec l'occulink. le 495 128Gb serait dispo en octobre et début 2027 pour la version 196GB :
https://www.bosgame.com/blogs/news/ [...] -processor


l'intérêt de l'oculink, c'est quoi ? le prefill qui peut être effetcué sur un gros gpu ?

n°48631
speedboyz3​0
Guide Michelin :o
Posté le 10-09-2026 à 21:26:59  profilanswer
 

moyen_moins a écrit :


l'intérêt de l'oculink, c'est quoi ? le prefill qui peut être effetcué sur un gros gpu ?


 
Utiliser un gros gpu pour de l’image / vidéo génération ?

n°48633
neo world
Posté le 10-09-2026 à 21:30:52  profilanswer
 

Prefill Gpu, carte réseau 40 ou 80gb/s pour empiler des strix halo, empiler un second modèle dans le GPU (use case de niche mais si tu veux un modèle débridé pour de la recherche de failles / forensic) ou même augmenter la vram (192 GB + 32GB par exemple :D)

n°48642
moyen_moin​s
chat réincarné
Posté le 10-09-2026 à 21:54:57  profilanswer
 

Pas les mêmes BP, c'est pour ça que je puisse la question :)

n°48666
neo world
Posté le 11-09-2026 à 09:52:14  profilanswer
 

moyen_moins a écrit :

Pas les mêmes BP, c'est pour ça que je puisse la question :)


ni la même puissance de calcul dispo (NPU) tu as des tests sur internet de gens qui ont collé au strix halo jusqu'au 6000 pro et ça aide bien :jap:

n°48673
moyen_moin​s
chat réincarné
Posté le 11-09-2026 à 10:36:10  profilanswer
 

J'ai pas compris :sweat:
Le NPU, il sert à quelque chose ? je veux dire à part pour copilot qui sert à rien ?

n°48674
speedboyz3​0
Guide Michelin :o
Posté le 11-09-2026 à 10:58:57  profilanswer
 

neo world a écrit :

le prochain bosgame viendra avec l'occulink. le 495 128Gb serait dispo en octobre et début 2027 pour la version 196GB :
https://www.bosgame.com/blogs/news/ [...] -processor


 
J'ai creusé un peu, y a déjà l'oculink sur certains :
 
https://de.gmktec.com/en/products/g [...] 95-mini-pc
 
Donc effectivement, un gros modèle pour de l'agentique sur les 128Gb et un GPU 24Go pour faire de la vidéo / image gen par exemple [:zyzz:1]  
Jouable pour 5k~  [:la chancla:1]

n°48675
neo world
Posté le 11-09-2026 à 11:08:44  profilanswer
 

moyen_moins a écrit :

J'ai pas compris :sweat:
Le NPU, il sert à quelque chose ? je veux dire à part pour copilot qui sert à rien ?


Le NPU est souvent utilisé pour le prefill. C'est lui qui accélère les calculs des tensors vs les circuits graphiques traditionnels qui font du bon calcul matriciel mais perdent beaucoup d'energie à charger / décharger inutilement les registres entiers de datas (utile pour le rafraichissement d'écran / les caculs 3D mais contre productifs en calcul de paramètres). Evidemment c'est un peu sursimplifié y'a plein d'autres spécificités qui sont apparus depuis que des circuits spécialisés en tensors sont apparus :jap:
 
Mais le fait est que les NPU sont très utiles en prefill et sur les chips intégrés et il est efficace sur des p'tits contextes mais quand ça commence à empiler 100k et plus de tokens avant de répondre tu commences à souffrir sur le temps d'attente vs un GPU (qui consomme beaucoup plus) mais qui va t'avaler les tokens comme si c'était des smarties :o

n°48678
lapin
Posté le 11-09-2026 à 11:18:26  profilanswer
 

moyen_moins a écrit :

J'ai pas compris :sweat:
Le NPU, il sert à quelque chose ? je veux dire à part pour copilot qui sert à rien ?


 
 
Ce n'est pas à proprement parler de l'intéligence artificiel, c'est de l'inférence, donc les algorithmes d'inférence sont généré depuis d'autres serveur, ensuite il faut mettre à jour régulièrement le moteur d'inférence.

n°48679
speedboyz3​0
Guide Michelin :o
Posté le 11-09-2026 à 11:26:10  profilanswer
 

En fait quand j'y pense, j'ai un oculink sur mon GMKTec M7 Pro [:leve le pied jeannot:1]

n°48680
neo world
Posté le 11-09-2026 à 11:30:49  profilanswer
 

tu peux y coller un GPU genre 3090 en attendant de trouver chaussure à ton pied :jap:
 
Par contre ce sera moche : station d'acceuil de la carte + alimentation externe dédiée sur ton bureau :o

n°48683
speedboyz3​0
Guide Michelin :o
Posté le 11-09-2026 à 12:02:32  profilanswer
 

neo world a écrit :

tu peux y coller un GPU genre 3090 en attendant de trouver chaussure à ton pied :jap:
 
Par contre ce sera moche : station d'acceuil de la carte + alimentation externe dédiée sur ton bureau :o


 
Les 3 serveurs et le nas sont dans une kallax, un truc de plus ça devrait passer :o
 
D'ailleurs même sur ton bosgame je viens de voir qu'un mec sur reddit avait mis un oculink sur le slot M.2  [:zyzz:1]  

n°48685
neo world
Posté le 11-09-2026 à 12:04:01  profilanswer
 

speedboyz30 a écrit :


 
Les 3 serveurs et le nas sont dans une kallax, un truc de plus ça devrait passer :o
 
D'ailleurs même sur ton bosgame je viens de voir qu'un mec sur reddit avait mis un oculink sur le slot M.2  [:zyzz:1]  


oui c'est une option tout comme dégager la carte wifi / bluetooth pour récupérer encore des lignes de PCI express. Mais pour le moment j'ai déjà mis trop de pognon là dedans et même si c'est pas parfait il me manque pas vraiment de truc important :jap:

n°48690
moyen_moin​s
chat réincarné
Posté le 11-09-2026 à 12:33:36  profilanswer
 

neo world a écrit :


Le NPU est souvent utilisé pour le prefill. C'est lui qui accélère les calculs des tensors vs les circuits graphiques traditionnels qui font du bon calcul matriciel mais perdent beaucoup d'energie à charger / décharger inutilement les registres entiers de datas (utile pour le rafraichissement d'écran / les caculs 3D mais contre productifs en calcul de paramètres). Evidemment c'est un peu sursimplifié y'a plein d'autres spécificités qui sont apparus depuis que des circuits spécialisés en tensors sont apparus :jap:

 

Mais le fait est que les NPU sont très utiles en prefill et sur les chips intégrés et il est efficace sur des p'tits contextes mais quand ça commence à empiler 100k et plus de tokens avant de répondre tu commences à souffrir sur le temps d'attente vs un GPU (qui consomme beaucoup plus) mais qui va t'avaler les tokens comme si c'était des smarties :o


Je pensais que l'apport du NPU c'était assez anecdotique.

 

edit: c'est valable qu'avec lemonade non ?
J'ai un 7640HS avec un petit NPU je l'ai jamais vu chargé ce machin.


Message édité par moyen_moins le 11-09-2026 à 13:36:26
n°48691
SynE
Agri du dessert
Posté le 11-09-2026 à 12:46:12  profilanswer
 

Rien ne l'utilise au final, microsoft avaient des idées mais ils n'ont rien fait.
 
Et les éditeurs tiers encore moins, c'est anecdotique et il vaut mieux se baser sur le gpu pour toucher plus de monde.

n°48694
speedboyz3​0
Guide Michelin :o
Posté le 11-09-2026 à 13:32:34  profilanswer
 

SynE a écrit :

Rien ne l'utilise au final, microsoft avaient des idées mais ils n'ont rien fait.
 
Et les éditeurs tiers encore moins, c'est anecdotique et il vaut mieux se baser sur le gpu pour toucher plus de monde.


 
Apple en met partout et l'utilise à fond :o
Anecdotique ? [:zyzz:2]

n°48696
moyen_moin​s
chat réincarné
Posté le 11-09-2026 à 13:35:35  profilanswer
 

speedboyz30 a écrit :


 
Apple en met partout et l'utilise à fond :o
Anecdotique ? [:zyzz:2]


Sur windows ? oui :)

n°48698
speedboyz3​0
Guide Michelin :o
Posté le 11-09-2026 à 13:41:48  profilanswer
 

moyen_moins a écrit :


Sur windows ? oui :)


 
On parlait de windows ? J'ai pas vu.
Je pensais qu'on parlait NPU au sens large, notamment avec l'exemple strix halo + GPU via oculink.

 Page :   1  2  3  4  5  ..  60  61  62  63  64  65

Aller à :
Ajouter une réponse
 

Sujets relatifs
[Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & cosécurité de l'IA / agentique et des Devs en roue libre
Plus de sujets relatifs à : Infra IA : aide au choix et troubleshot de LLM Locaux


Copyright © 1997-2025 Groupe LDLC (Signaler un contenu illicite / Données personnelles)