| |||||
FORUM HardWare.fr

Intelligence Artificielle

[Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co| Dernière réponse | ||
|---|---|---|
| Sujet : [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co | ||
| bulldozer_fusion |
|
|
| Aperçu |
|---|
| Vue Rapide de la discussion |
|---|
| bulldozer_fusion |
|
| Olivie |
|
| bulldozer_fusion | https://rehost.diberie.com/Picture/Get/r/540266 GPT down |
| speedboyz30 |
|
| Mevo | NOTE: Il n'y a pas si longtemps, j'avais deux listes de pays que je voulais comparer (les couvertures de deux services différents). J'avais demandé à des modèles de faire 3 listes: Celle des pays figurant dans les deux listes fournies, celle des pays figurant dans l'une et pas l'autre, et l'inverse. Le truc est qu'une liste était en anglais et l'autre en francais, et certains pays n'étaient pas forcément libellés de la même facon.
C'est un usage que j'avais déjà eu en tentant de comparer la liste de constituents de deux ETFs. Même problème: Toutes les sociétés ne sont pas toujours mentionnées pareil dans les deux listes (acronymes ou une partie du nom abrégée, présence de "ltd" ou "limited" ou non, etc.) A ce genre d'exercice, les modèles Chinois ne sont pas forcément mauvais, et parfois meilleurs que les gros modèles propriétaires US (ca parait "simple" comme tâche, mais les erreurs sont fréquentes :/ ). J'avais lancé quelques tests sur Arena.ai (ex-LMarena) pour faire de la comapraison entre modèles. Sur les deux listes de pays, Claude se vautrait par exemple en citant un pays dans la mauvaise liste, tout en se corrigeant lui-même entre parenthèses tout de suite derrière :o GLM 5.2 avait été carrément impressionant: C'est le seul qui avait déterminé de lui-même qu'un pays ne figurant PAS dans l'une des liste était sans doute un oubli, et y était probablement (la liste contenait tous les pays de l'UE sauf un). Il a mentionné la chose sans que ca ne lui ait été demandé. Tout ca pour dire que la comparaison entre les modèles, ca dépend aussi des usages et de ce qu'on tente de leur faire faire :jap: |
| falkon1000 |
Sinon pour tes questions, tu peux sans problème faire tourner Deepseek en local. Si tu veux l'équivalent de ce que l'API propose en quantization et taille de contexte, prévois un peu plus qu'un Mac. Ensuite, si tu as absolument besoin de Fable ou Sol pour coder, il faut revoir ta manière de bosser. On peut déjà coder à peu près n'importe quoi avec une qualité totalement compatible avec la prod à grande échelle avec un Deepseek flash 4 ou un vieux 5.3-codex. |
| SynE | Mais qui télécharge encore des jeux piratés :o |
| jix | Piratage de Claude : Anthropic alerte ses clients d’une cyberattaque, 6 virus à l’assaut de votre PC https://www.01net.com/actualites/pi [...] virus.html Qui disait que ses tokens partaient tout seul après le reset ? :O |
| Mevo |
|
| Mevo |
|
| Olivie |
|
| Stellvia_fr | Déjà ne pas envoyer toute sa vie/code en chine ou au us, je trouve que c'est un argument qui se tient. A part ca, tout simplement le plaisir d'avoir sa propre bécanne et sa propre ia, et la bidouille c'est intéressant aussi. Je voulais simplement dire, qu'il y a un sacrés décalage de mon point de vue entre les soit disant "benchmark" qui classe les chinois "au poil de cul prêt" juste derrière les gros et la réalité de mes propre essaie. |
| SynE | C'est clairement plus que deux pauvres BC250 :o |
| Olivie |
|
| Mevo |
|
| Stellvia_fr | J'avais oublié l'ambiance troll de hardware a force de parler a des llm.
Tu ne connais pas mon budget ni mes projets. C'est dommage de critiquer les gens sans savoir. Efface donc ma phrase " sur un mac local" , comme ca ca passera mieux. Ca change rien au fait qu'un minimum d'échange d'expérience est toujours plus utile que des benchmark idiots. Je suis vraiment curieux de savoir si vous arrivez à travailler pour de vrai sur de vrai projet avec une ia chinoise, perso je suis incapable de trouver un vrai "contre auditeur" crédible à chat gpt. |
| Mevo |
|
| Stellvia_fr | Salut,
Je suis a la recherche d'expérience par des " vrais gens ". Utilisation : opencode ou codex, full agent de partout, contre audit systématique par un second llm qui corrige les oublie/erreurs de chat gpt. Actuellement mon classement perso de llm pour dev/agent : - fable ( inutilisable car trop cher qu quotidien de mon point de vue ) - suivis de pret par chat gpt sol - bien moins bon mais utile quand même opus 5 ( je m'en sert essentiellement comme contre audit de chat gpt ) Idéalement dispo en local sur un gros mac, mais..... sans déconner je suis incapable trouver un bon contre auditeur à chat gpt sol pour remplacer opus. Je sais pas votre avis sur la question mais je trouve les benchmark bien loin de la réalité du terrain, ils encensent sans arrêt les chinois, moi j'aimerais bien... mais la realité je les trouve pas si bien. J'ai testé deep seek v4 pro et glm 5.3, bah non ils oublient des trucs que opus trouve. Je parle même pas de chat gpt sol loin devant. Ca dépend de l'utilisation de chacun, je veux pas lancer un débat de tiers list llm on s'en fiche, mais si quelqu'un a mon utilisation qu'il hésite pas à me conseiller. |
| bulldozer_fusion | Le saviez vous? https://rehost.diberie.com/Picture/Get/r/540224 https://rehost.diberie.com/Picture/Get/r/540225 https://x.com/thsottiaux/status/2094254532020818191 |
| extenue1 |
Je plussoie ... 4% de quota mensuel bouffé avec une seule requete luna |
| gusano | AAF |
| AllenMadison | Plus que 47mn [:rage_anormale] Reset effectué avec 1H de retard :o |
| AllenMadison |
Franch'ment... Edit : quota épuisé, plus qu'a attendre le reset :o |
| AllenMadison |
|


