Forum |  HardWare.fr | News | Articles | PC | S'identifier | S'inscrire | Shop Recherche
4130 connectés 

 


Je génère ...
Sondage à 3 choix possibles.
Ce sondage expirera le 20-09-2026 à 10:00




Attention si vous cliquez sur "voir les résultats" vous ne pourrez plus voter

 Mot :   Pseudo :  
  Aller à la page :
 
 Page :   1  2  3  4  5  ..  59  60  61  62  63  64
Page Suivante
Auteur Sujet :

Infra IA : aide au choix et troubleshot de LLM Locaux

n°48698
speedboyz3​0
Guide Michelin :o
Posté le 11-09-2026 à 13:41:48  profilanswer
 

Reprise du message précédent :

moyen_moins a écrit :


Sur windows ? oui :)


 
On parlait de windows ? J'ai pas vu.
Je pensais qu'on parlait NPU au sens large, notamment avec l'exemple strix halo + GPU via oculink.

n°48701
moyen_moin​s
chat réincarné
Posté le 11-09-2026 à 14:44:13  profilanswer
 

speedboyz30 a écrit :


 
On parlait de windows ? J'ai pas vu.
Je pensais qu'on parlait NPU au sens large, notamment avec l'exemple strix halo + GPU via oculink.


C'est vendredi :o

n°48702
neo world
Posté le 11-09-2026 à 14:56:44  profilanswer
 

en plus rien interdit d'installer llamacpp et faire tourner des modèles sur windows. Y'avait un bon exemple avec yohaskan et ses modèles qui récupèrent des infos sur l’environnement dans ses jeux vidéos pour le guider

n°48703
Tronklou
❤❤ Vrp Bambulab à mi-temps ❤❤
Posté le 11-09-2026 à 14:57:58  profilanswer
 

SynE a écrit :

Rien ne l'utilise au final, microsoft avaient des idées mais ils n'ont rien fait.
 
Et les éditeurs tiers encore moins, c'est anecdotique et il vaut mieux se baser sur le gpu pour toucher plus de monde.


 
C'est fou car les petits NPU en embarqués c'est vraiment une pile intéressante ( en vidéo notamment ), mais clairement quand tu vois toutes les contraintes aussi bien dev que en intégrations hardware... Ca n'a rien a foutre sur un pc desktop :D


---------------
Victime de girafophobie, mais se soigne.
n°48704
neo world
Posté le 11-09-2026 à 15:00:58  profilanswer
 

bah ça coute pas non plus des fortunes d'en graver un bout sur le CPU "au cas où" et ça évite d'acheter un dell avec un core I5 dernière génération mais une 1650 parce que y'en avait qui trainait dans le stock et s'étonner que cortana mets 10 minutes à lui dire quel temps il fera demain ensuite :o

Message cité 1 fois
Message édité par neo world le 11-09-2026 à 15:01:17
n°48713
tfpsly
Sly
Posté le 11-09-2026 à 16:03:20  profilanswer
 

Le pire avec les NPUs est surtout leur fragmentation. Même pour les Qualcomm, il faut faire un modèle par génération pour les utiliser au mieux. Seules les grosses boîtes peuvent se permettre d'optimiser un kernel par SoC, même sur téléphone.

n°48726
Tronklou
❤❤ Vrp Bambulab à mi-temps ❤❤
Posté le 11-09-2026 à 16:47:17  profilanswer
 

neo world a écrit :

bah ça coute pas non plus des fortunes d'en graver un bout sur le CPU "au cas où" et ça évite d'acheter un dell avec un core I5 dernière génération mais une 1650 parce que y'en avait qui trainait dans le stock et s'étonner que cortana mets 10 minutes à lui dire quel temps il fera demain ensuite :o


 
Le seul vrai intérêt du NPU, c’est son rendement. Sur de l’embarqué ok, mais sur un PC portable ou desktop tu as déjà un igpu bien plus polyvalent et infiniment plus simple à exploiter avec des environnements de dev standards.  
Aller optimiser un modèle spécifiquement pour le NPU, c’est souvent se taper une quantité de boulot monstrueuse pour finir avec un truc assez anémique. La consolation, c’est qu’il aura consommé 3 W au lieu de 15 :O
 
Et en plus l’essentiel des petits modèles qui rentrent bien dans le cadre d’un NPU sont tellement petits qu’ils tournent déjà très correctement sur le CPU :O  
Donc tu te tapes un environnement spécifique, de la quantif, des opérateurs pas supportés et potentiellement une optimisation par génération de puce, tout ça pour accélérer un truc qui tournait déjà convenablement sur le CPU.  
 
Tout ca pour ca... Je préfère encore qu’on me mette le budget silicium dans l’igpu ou la bd mémoire.
 
Pour moi c'est juste du marketing et de la segmentation artificielle avec le copilot ready :D


---------------
Victime de girafophobie, mais se soigne.
n°48727
neo world
Posté le 11-09-2026 à 16:50:01  profilanswer
 

faut voir si l'agentique "locale" decolle avec des petites optimisations genre commander ton billet d'avion ou mettre un rdv à ta place. Si c'est pas le cas ce ne sera que du marketing.
 
Ne pas oublier que le NPU consomme moins aussi que le CPU où ça va devoir taper dans des fonctions comme l'AVX pour sortir quelque chose à une vitesse potable.


Message édité par neo world le 11-09-2026 à 16:53:07
n°48728
Tronklou
❤❤ Vrp Bambulab à mi-temps ❤❤
Posté le 11-09-2026 à 16:55:02  profilanswer
 

A ce compte là ton igpu ou cpu fera déjà le taff  :sweat:  
 
Ceux a suivre pour la voie NPU ce serais apple : ils ont intégrés les npu directement dans les cores gpu, ce qui est la voie la plus logique je dirais.


---------------
Victime de girafophobie, mais se soigne.
n°48729
neo world
Posté le 11-09-2026 à 17:00:48  profilanswer
 

l'intégration verticale jusqu'à ce niveau de détail fait toute la différence pour Apple.
 
C'est bordélique côté PC en comparaison mais au moins tu peux installer linux, BSD ou autre sans pleurer le manque absolut de drivers :o
 
l'IGPU sans NPu bouffe beaucoup plus à performance identique en comparaison et pareil pour le CPU. Ca marche mais c'est tout sauf non douloureux pour la batterie et l'enveloppe thermique en général de détourner un accelerateurs sans registres spécialisés. Le LLM ressemble vraiment à du bruteforce si tu regardes un peu comment ça se comporte avec le matos en dessous


Message édité par neo world le 11-09-2026 à 17:02:37
n°48734
Tronklou
❤❤ Vrp Bambulab à mi-temps ❤❤
Posté le 11-09-2026 à 17:15:25  profilanswer
 

La force de la standardisation soft/hardware, clairement.
 
Mais c'est bien les seuls à pouvoir intégrer du NPU efficacement de par cette verticalité.
 
Sur pc vouloir pousser du NPU revient à ajouter un bloc séparé, avec encore une surcouche à gérer côté soft et hard, un bordel sans nom. :O
 
À côté de ça, les gros du GPU intègrent directement des Tensor Cores / Matrix Cores / XMX => c'est ça la voie à suivre.
 
Personne va s'emmerder à optimiser pour un NPU anémique et spécifique à chaque plateforme versus utiliser des outils déjà intégrés et standardisés.


---------------
Victime de girafophobie, mais se soigne.
n°48737
neo world
Posté le 11-09-2026 à 17:34:09  profilanswer
 

Tronklou a écrit :

La force de la standardisation soft/hardware, clairement.
 
Mais c'est bien les seuls à pouvoir intégrer du NPU efficacement de par cette verticalité.
 
Sur pc vouloir pousser du NPU revient à ajouter un bloc séparé, avec encore une surcouche à gérer côté soft et hard, un bordel sans nom. :O
 
À côté de ça, les gros du GPU intègrent directement des Tensor Cores / Matrix Cores / XMX => c'est ça la voie à suivre.
 
Personne va s'emmerder à optimiser pour un NPU anémique et spécifique à chaque plateforme versus utiliser des outils déjà intégrés et standardisés.


attends que ça se stabilise. Personne ne savait quoi faire du TPU de google avant que tf light facilite la détection d'objets à 100 fps pour moins de 5w :D
 
d'ailleurs on attend toujours un successeur autre part que sur le pixel :/

n°48739
Tronklou
❤❤ Vrp Bambulab à mi-temps ❤❤
Posté le 11-09-2026 à 17:38:11  profilanswer
 

C'est tellement efficace et génial que le produit est mort :D  
 
Je parie qu'on vas avoir directement les cores spécialisés propre a chaque constructeur dans leurs apu et/igpu, tout simplement. Ca consommera pas grand chose non plus, ce sera super standard et logiciellement simple à exploiter.


---------------
Victime de girafophobie, mais se soigne.
n°48741
moyen_moin​s
chat réincarné
Posté le 11-09-2026 à 17:48:25  profilanswer
 

des testeurs d'halogen pour les strix halo ? sur qwen 3.8 flash next, ça a l'air de bien améliorer le pp te le pg [:paysan]

 Page :   1  2  3  4  5  ..  59  60  61  62  63  64
Page Suivante

Aller à :
Ajouter une réponse
 

Sujets relatifs
[Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & cosécurité de l'IA / agentique et des Devs en roue libre
Plus de sujets relatifs à : Infra IA : aide au choix et troubleshot de LLM Locaux


Copyright © 1997-2025 Groupe LDLC (Signaler un contenu illicite / Données personnelles)