Forum |  HardWare.fr | News | Articles | PC | S'identifier | S'inscrire | Shop Recherche
5257 connectés 

 


Dernière réponse
Sujet : [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co
Big Blue Je vais vraiment commander cette BC-250 en rab :o

 

Rien qu’aujourd’hui, 60% de quotas, quasi 10€ de HF :whistle:

 

Reset demain, pas envie de prendre le plan à 100€ … Faut que je tente Qwen 3.8 sur la carte, unsloth a sorti une version dynamic de la 27B :o


Votre réponse
Nom d'utilisateur    Pour poster, vous devez être inscrit sur ce forum .... si ce n'est pas le cas, cliquez ici !
Le ton de votre message                        
                       
Votre réponse


[b][i][u][strike][spoiler][fixed][cpp][url][email][img][*]   
 
   [quote]
 

Options

 
Vous avez perdu votre mot de passe ?


Vue Rapide de la discussion
Big Blue Je vais vraiment commander cette BC-250 en rab :o

 

Rien qu’aujourd’hui, 60% de quotas, quasi 10€ de HF :whistle:

 

Reset demain, pas envie de prendre le plan à 100€ … Faut que je tente Qwen 3.8 sur la carte, unsloth a sorti une version dynamic de la 27B :o

Tronklou Mais je n'ai jamais dit qu'il fallait acheter du compute et virer tous les ingés :O
 
Évidemment qu'il faut conserver les compétences. Par contre, t'as pas besoin de claquer une fortune à pré-entraîner un modèle de A à Z pour conserver ces compétences.
 
Mon point de vue, c'est que dans un contexte où les moyens sont limités, le compute est l'actif prioritaire : il te permet de faire tout le reste derrière.
 
Un modèle que t'as payé une blinde aujourd'hui sera potentiellement dépassé dans 12 mois. C'est pas fondamentalement mieux que le problème que tu soulèves avec un modèle open qui serait bloqué du jour au lendemain.
Ton infra et tes compétences, elles, te permettront d'entraîner ou d'adapter le suivant.
 
Donc oui, il faut les deux : du compute et des gens compétents. Là où je ne te suis pas, c'est qu'il faudrait forcément financer en plus un gros modèle souverain from scratch maintenant pour conserver les seconds.
 
Les cerveaux, ça reste mobile, le compute beaucoup moins. Les capacités de calcul, ça implique des datacenters, du foncier, des commandes de matos et des investissements sur le long terme. C'est littéralement le moins "baguette magique" des deux.
bulldozer_fusion

Tronklou a écrit :


 
Si on en arrive là, au moins on aura la base, c'est-à-dire le compute et l'infra pour pouvoir développer nous-mêmes si besoin est.
 
L'inverse n'est pas vrai : avoir un modèle souverain aujourd'hui ne sert arien si demain t'as pas le compute pour l'entraîner, le faire évoluer ou même le faire tourner à grande échelle.
 
Et actuellement la course, c'est justement d'accumuler le plus de compute possible. Lächer  du fric disponible à vouloir absolument développer un modèle souverain de A à Z n'a aucun intérêt aujourd'hui.
 
Le jour où t'as le compute, l'infra et les compétences, tu peux toujours te mettre à entraîner ton propre modèle si la situation l'impose. Sans compute, tu peux avoir toute la souveraineté théorique que tu veux, t'es quand même coincé.


et moi je te dis qu'il te faut les 2
avoir que le compute et pas les ingénieurs qui savent créer/entrainer/gérer des modèles, ça se décrète pas d'un coup de baguette magique

homunculus

the_fennec a écrit :


 
Avec ou sans extincteurs? :o


 
 :lol:

the_fennec


 
Avec ou sans extincteurs? :o

Tronklou

homunculus a écrit :


 
Et si Microsoft ou Amazon nous coupent le cloud on fera comment?


 
Oh bah là avoir de l'IA souveraine, sera, je pense, le dernier de nos soucis dans l'immédiat.

the_fennec

Olivie a écrit :


Et puis tu as à coté
 

Citation :

@ornith_
 
Aloha! Introducing Ornith-1.5, a family of open-source LLMs spanning 9B Dense, 35B MoE, and 397B MoE, trained with self-improving strategies.
 



 
C'est juste des fine-tune de Qwen 3.5 3.6, ça n'apporte pas grand-chose:
https://www.youtube.com/watch?v=aNnoz_KOnVg
 
J'ai du mal a imaginer une utilisation autre de ce genre de modèle que faire une vidéo sur YT, poster sur Twitter ou Reddit :o

Olivie

homunculus a écrit :


 
Et si Microsoft ou Amazon nous coupent le cloud on fera comment?


Ovh :o

homunculus

Tronklou a écrit :


 
Si on en arrive là, au moins on aura la base, c'est-à-dire le compute et l'infra pour pouvoir développer nous-mêmes si besoin est.
 
L'inverse n'est pas vrai : avoir un modèle souverain aujourd'hui ne sert arien si demain t'as pas le compute pour l'entraîner, le faire évoluer ou même le faire tourner à grande échelle.
 
Et actuellement la course, c'est justement d'accumuler le plus de compute possible. Lächer  du fric disponible à vouloir absolument développer un modèle souverain de A à Z n'a aucun intérêt aujourd'hui.
 
Le jour où t'as le compute, l'infra et les compétences, tu peux toujours te mettre à entraîner ton propre modèle si la situation l'impose. Sans compute, tu peux avoir toute la souveraineté théorique que tu veux, t'es quand même coincé.


 
Et si Microsoft ou Amazon nous coupent le cloud on fera comment?

Tronklou

bulldozer_fusion a écrit :


Ça vend du rêve [:pl4y4z:5]  


 

bulldozer_fusion a écrit :


Je ne suis pas d'accord sur un point avec toi
Il FAUT avoir un modèle souverain, si la Chine et les US arrêtent tout
Tu vas composer avec un modèle daté et tu n'auras plus accès aux modèles avancés et on fait quoi, même si on 400 data centers en Europe
Avoir le compute ça ne fait pas tout


 
Si on en arrive là, au moins on aura la base, c'est-à-dire le compute et l'infra pour pouvoir développer nous-mêmes si besoin est.
 
L'inverse n'est pas vrai : avoir un modèle souverain aujourd'hui ne sert arien si demain t'as pas le compute pour l'entraîner, le faire évoluer ou même le faire tourner à grande échelle.
 
Et actuellement la course, c'est justement d'accumuler le plus de compute possible. Lächer  du fric disponible à vouloir absolument développer un modèle souverain de A à Z n'a aucun intérêt aujourd'hui.
 
Le jour où t'as le compute, l'infra et les compétences, tu peux toujours te mettre à entraîner ton propre modèle si la situation l'impose. Sans compute, tu peux avoir toute la souveraineté théorique que tu veux, t'es quand même coincé.

bulldozer_fusion

homunculus a écrit :

 

On fera comme les chinois il y a 20 ans on copiera tout :o
L’Europe deviendra l’usine IA du monde.


Ça vend du rêve [:pl4y4z:5]

Tronklou a écrit :

 

C'est justement pour ça que je parle d'hébergement souverain et de modèles ouverts. Si demain les US et la Chine ferment les robinets, un modèle open que tu fais tourner sur ton infra ne disparaît pas.

 

Le problème, c'est de vouloir absolument que le modèle soit lui aussi conçu et entraîné en EU, alors qu'on n'a pas les moyens de jouer à la même échelle. Rajoute à ça une réglementation aberrante qui rend de facto beaucoup plus compliqué d'avoir les mêmes moyens juridiques que les acteurs US...

 

Entre "dépendre totalement des API étrangères" et "construire toute la filière IA EU de zéro" y a quand même un énorme milieu.

 

Surtout qu'au final, il faut avant tout du compute, et là on dépend complètement du bon vouloir américain...

 

Alors autant foutre le pognon là-dedans pour avoir de vraies capacités d'hébergement souverain. Sinon, on va se retrouver à devoir louer du compute à l'étranger et on retombera sur un double couperet en termes de dépendance.


Je ne suis pas d'accord sur un point avec toi
Il FAUT avoir un modèle souverain, si la Chine et les US arrêtent tout
Tu vas composer avec un modèle daté et tu n'auras plus accès aux modèles avancés et on fait quoi, même si on 400 data centers en Europe
Avoir le compute ça ne fait pas tout

Olivie 3 milliards c'est rien face à OpenAi et le reste :o

 

Et puis tu as à coté

 
Citation :

Des annuaires tiers (EveryDev.ai, There’s An AI For That) mentionnent parfois « $100M raised » ou une valuation autour de $50M, mais ce sont des estimations non confirmées par la presse ou l’équipe elle-même. Aucune annonce de seed/Series A n’a circulé.En résumé : petite équipe de chercheurs RL très pointus (ex-Stanford/NLP), qui sort des modèles open-source SOTA sur les benchmarks agentic coding, sans communication transparente sur le financement pour l’instant.

 
Citation :

@ornith_

 

Aloha! Introducing Ornith-1.5, a family of open-source LLMs spanning 9B Dense, 35B MoE, and 397B MoE, trained with self-improving strategies.

 

It achieves state-of-the-art performance among open-source models of comparable size and delivers performance comparable to Claude Opus 4.8 across reasoning, agentic, and coding tasks:
Terminal-Bench 2.1 (86.1)
SWE-Bench (86 on verified, 65.1 on pro, 79.6 on Multilingual)
DeepSWE (56)
HLE (44.6)
ClawEval (81.4)
Tool Decathlon (71.2)

 

Ornith-1.5 takes a major step toward training foundation models through end-to-end self-improvement, extending the self-scaffolding strategies introduced in Ornith-1.0 into a more complete self-improvement loop: the model proposes new tasks, generates task-specific scaffolds, and produces solution rollouts for reinforcement learning, continuously creating new learning experiences from which it can improve.

 

All models, along with their quantized versions (FP8, GGUF, MLX, and NVFP4), have been released under the MIT License, enabling unrestricted commercial and research use.
Tech Blog: http://ornith.ai/ornith_1_5.html
Huggingface: http://huggingface.co/collections/ornith-ai/ornith-15…

 

https://pbs.twimg.com/media/HQFvRnJ [...] ame=medium

Tronklou

bulldozer_fusion a écrit :


C'est bien le problème
Le monde change et se ferme, et le jour où on sera entre les deux grosses puissances qui nous coupent simultanément, là on sera dans la merde


 
C'est justement pour ça que je parle d'hébergement souverain et de modèles ouverts. Si demain les US et la Chine ferment les robinets, un modèle open que tu fais tourner sur ton infra ne disparaît pas.
 
Le problème, c'est de vouloir absolument que le modèle soit lui aussi conçu et entraîné en EU, alors qu'on n'a pas les moyens de jouer à la même échelle. Rajoute à ça une réglementation aberrante qui rend de facto beaucoup plus compliqué d'avoir les mêmes moyens juridiques que les acteurs US...
 
Entre "dépendre totalement des API étrangères" et "construire toute la filière IA EU de zéro" y a quand même un énorme milieu.
 
Surtout qu'au final, il faut avant tout du compute, et là on dépend complètement du bon vouloir américain...
 
Alors autant foutre le pognon là-dedans pour avoir de vraies capacités d'hébergement souverain. Sinon, on va se retrouver à devoir louer du compute à l'étranger et on retombera sur un double couperet en termes de dépendance.

homunculus

bulldozer_fusion a écrit :


C'est bien le problème
Le monde change et se ferme, et le jour où on sera entre les deux grosses puissances qui nous coupent simultanément, là on sera dans la merde

 

On fera comme les chinois il y a 20 ans on copiera tout :o
L’Europe deviendra l’usine IA du monde.

the_fennec

Tronklou a écrit :


De manière réaliste, je ne vois pas comment on pourrait avoir une IA souveraine et compétitive face aux usa ou la chine.
Pourquoi cramer le peu de cash disponible pour se faire ramasser par les models open sources dispo gratuitement ?  
/quotemsg]
 
Vous partez toujours du principe qu'il y aura toujours des modèles open-weight dispo. Au bout d'un moment il y aura une contraction des acteurs et faire de nouveaux modèles from scratch ne sera plus possible en terme de puissance ou de données. A ce moment il restera 3/4 acteurs et ils n'auront aucune raison de continuer a diffuser leur modèles.
 
Si Mistral n'est pas soutenu, de manière artificielle, comme les boites Chinoises le sont par un ou des gouvernements, il n'y aura plus rien en Europe.
 
[quotemsg=45679,18919,563008]Ca couterait combien à Mistral de prendre le modèle le plus puissant Open source, genre Kimi K3 et de l'entrainer au lieu de continuer sur leurs propres modèles ?
S'ils ont du matos pour faire de l'inférence et entrainer leurs modèles, ils pourraient mettre le paquet sur le meilleur modèle open source et sortir quelque chose de bien.


C'est pas vraiment du training, mais du fine tuning, je trouve que ça n'a aucune valeur ajoutée. Les modèles locaux le montrent bien, le fine tuning ne sert qu'a monter dans des benchs mais en utilisation réelle, ça change pas grand-chose. Après c'est peut être différent avec plus de matos, mais tu resteras a la merci du fournisseur de modèle et de ses changements techniques.

Big Blue Soit c’est mon hermes, soit c’est luna mais ca merde comme il faut, j’ai kill Hermes, plus rien ne répondait et cet après midi j’ai restauré la db à la main :/
bulldozer_fusion Chez moi ça marche toujours aussi bien
Big Blue

AllenMadison a écrit :

Ah ça commence a se plaindre de Sol sur touittère, des hallucinations de plus en plus fréquentes, temps de réponse plus longs, l'usage qui drain plus vite
 
Je suppose que la cause c'est trop d'users et l'infrastructure tient pas non plus, comme pour claude :o
 
 
Perso je constate un gap dans la rapidité de la réponse entre la semaine et le weekend, et sur certaines heures de la journée.


Sur luna aussi ca gueule et vu qu’il vient deux fois de boucler, me siphoner la moitié du quotas et m’a même pete la db de hermes …

bulldozer_fusion

Tronklou a écrit :

Oui, c'est le refrain qu'on sort à chaque nouvelle techno, dans les faits, on est dans l’incapacité de financer quoi que ce soit à la même échelle que la concurrence étrangère.

 

Réglementations plus dures, des etats frileux, recrutement "compliqué " parce que pas de sous pour s'aligner...

 

De manière réaliste, je ne vois pas comment on pourrait avoir une IA souveraine et compétitive face aux usa ou la chine.
Pourquoi cramer le peu de cash disponible pour se faire ramasser par les models open sources dispo gratuitement ?

 

Par contre, héberger de manière souveraine en faisant tourner des modèles open source chinois ça c'est possible. Et ce sera déjà très bien.

 

N'oublions jamais que globalement l'UE n'en a rien à foutre d'utiliser des outils étrangers bien au contraire :D


C'est bien le problème
Le monde change et se ferme, et le jour où on sera entre les deux grosses puissances qui nous coupent simultanément, là on sera dans la merde


Copyright © 1997-2025 Groupe LDLC (Signaler un contenu illicite / Données personnelles)