Forum |  HardWare.fr | News | Articles | PC | S'identifier | S'inscrire | Shop Recherche
3678 connectés 

 


Dernière réponse
Sujet : [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co
Big Blue

Seizh a écrit :


 
Ca pêche au bazooka ici aussi ?


J’ai mis les formes quand même.  
 
A mon niveau oui je préfère Deepseek.


Votre réponse
Nom d'utilisateur    Pour poster, vous devez être inscrit sur ce forum .... si ce n'est pas le cas, cliquez ici !
Le ton de votre message                        
                       
Votre réponse


[b][i][u][strike][spoiler][fixed][cpp][url][email][img][*]   
 
   [quote]
 

Options

 
Vous avez perdu votre mot de passe ?


Vue Rapide de la discussion
Big Blue

Seizh a écrit :


 
Ca pêche au bazooka ici aussi ?


J’ai mis les formes quand même.  
 
A mon niveau oui je préfère Deepseek.

Seizh

Big Blue a écrit :

Je suis pas dev, juste passionné et je le préfère largement à Astra :o


 
Ca pêche au bazooka ici aussi ?

Big Blue Oui bien sûr je le faisais avec Sol mais là c’est en systématique dès qu’il lit du code sur une demande simple il va proposer de lui-même des corrections.
H00d

Big Blue a écrit :

Deepseek V4.1 est vraiment impressionnnant.

 

Le plus sympa c’est que lorsque je lui demande une tâche simple il va analyser tout l’environnement et me proposer des corrections et améliorations optionnelles. C’est bien le seul modèle qui fait ça.

 

Bien sûr il test toutes ses modifications et surtout il propose toujours plusieurs solutions avant d’agir.

 

Je suis pas dev, juste passionné et je le préfère largement à Astra :o ( surtout parce que je peux finir mes tâches avec mon quotas :D ).


Codex me le fait aussi avec Sol, question de prompt.

Big Blue Deepseek V4.1 est vraiment impressionnnant.  
 
Le plus sympa c’est que lorsque je lui demande une tâche simple il va analyser tout l’environnement et me proposer des corrections et améliorations optionnelles. C’est bien le seul modèle qui fait ça.  
 
Bien sûr il test toutes ses modifications et surtout il propose toujours plusieurs solutions avant d’agir.  
 
Je suis pas dev, juste passionné et je le préfère largement à Astra :o ( surtout parce que je peux finir mes tâches avec mon quotas :D ).
Yann_421

Mevo a écrit :


Peut-être plutôt essayer de lui faire générer un "plan" en amont ? Avec les différentes étapes. Et ensuite de lui faire faire chaque étape séparément ? (comme ca tu valides d'abord avant de passer à la suite). Ou TU fais le pan initial ?
 
Regarder la réflexion en direct et couper en cours de route parait éventuellement un peu bizarre comme technique (de mon point de vue, quoi que je comprends aussi l'idée. J'avais testé un petit modèle 4B en local qui s'était mis à réfléchir plusieurs minutes après lui avoir balancé juste "Hi!" comme premier prompt. Je l'ai arrêté également :o )


 
Je débute toujours par un plan et j'essaye d'avancer petit à petit mais c'est lors de la phase de dev et des tests/recherche de solutions qu'ils débloquent. Ils font des petits scripts super agressifs pour tester les api, intègrent des variables/données extérieures qui rendent l'outil moins crédible au final.  
Il m'est d'ailleurs arrivé plusieurs fois de me faire blacklister d'une API juste à cause d'un agent qui teste au bruteforce plutôt que de RTFM.  [:thektulu]  
Du coup je comprends pourquoi les gros modèles arrivent à "s'échapper" et compromettre des gros systèmes (cas Huggingface par exemple...)
 
Et je persiste pour le fait de regarder la réflexion. Pour moi c'est important, ça permet de comprendre ce qu'il fait et éventuellement de couper avant qu'il ne s'éloigne trop de la demande de base ou de le ré-aiguiller si je vois qu'il va perdre du temps sur une impasse. Pour le coup, ça marche super bien sur les modèles récents alors qu'auparavant, les interrompre leur faisait perdre le fil.
Bref, peut-être que c'est juste je n'aime pas les agents trop autonomes. :D

Kalymereau

Mevo a écrit :


Ou elle bute direct les enfants. Elle les a "sauvé du cancer". A job well done :o
 
Perso, je trouve qu'il y a souvent un léger paradoxe dans l'histoire: On s'inquiète supposément d'une IA "super-intelligente" parce qu'on présuppose qu'elle va être totalement conne, en fait. Ca en dit peut-être davantage sur ceux qui s'inquiètent de la sorte :D


 
Non je crois pas que c'est ça. L'intelligence n'est pas nécessairement corrélée à la bienveillance. L'Allemagne des annés 1930 était en crise, mais elle était « intelligente » au sens où c'était un des pays les plus avancés au monde, du point de vue artistique et scientifique. Vu que les IA sont entraînées pour reproduire les comportements et l'intelligence humaine mais avec des performances sans commune mesure, on est en droit de s'inquiéter.

Mevo Ivre, il découvre ce qu'est un LLM et qu'il faut toujours encore un cerveau :o
(oui, ce que tu décris est sans doute le type de réalisation qu'ont beaucoup de gens après le "waouh" original :jap: )
Antoine Doinel

AllenMadison a écrit :


 
Qu'entends tu par "revoir" ? Je n'ai pas encore acces à l'add-on de chatgpt pour la finance, mais en dehors de ce cas particulier, tu ne peux pas lui filer "out of the blue" ces documents (et surtout en temps normal tu ne devrais même pas lui filer de documents). La seule chose que tu peux faire, c'est lui faire coder des outils d'analyse que tu exécutes ensuite en local. En tout cas je n'ai jamais filé une seule data aux fins d'analyse à claude ou chatgpt, les seules choses que j'ai faites c'est de l'exploitation d'endpoint API pour récupérer des data financieres, les analyser en local et produire (toujours en local) des fichiers excel ou des pages web locales avec les data et leurs analyses.


Je lui file l’Excel, je lui demande des trucs précis. Type : là j’ai un problème de cash flow, analyse et explique moi ce qui ne va pas.
 
La dernière fois, ce con m’a dit « retraite tel chiffre dans le tableau et ça fait ton écart ». Je lui ai répondu que financièrement ça n’avait aucun sens. Il s’est excusé et a concédé que c’était faux.
En fait il a juste essayé de trouver un chiffre qui pouvait faire caler mon cash, mais il a fait fi des principes financiers. Donc si j’étais pas là pour lui dire que c’était faux, c’était mal barré.

Mevo

AllenMadison a écrit :

Bon sinon, comme dans les rapports de jury chaque année, on a le droit à un florilège des pires actions entreprises sur Claude :


Est-ce bien malin de la part d'Anthropic de faire cela ?  :heink:  
 
Déjà que pas mal de gens flippent quant à l'utilisation de leurs prompts pour l'entrainement de modèles. Mais créer potentiellement encore un blocage psychologique supplémentaire "si je demande quelque chose de particulièrement ubuesque ou déplacé à Claude, alors peut-être qu'Anthropic va m'afficher publiquement en balancant mes infos avec", là, c'est carrément un autre niveau !  :ouch:
 
 

Yann_421 a écrit :

Oui, peut-être que ma façon de faire n'est pas adaptée et que je finalement je ne suis pas encore assez directif et surtout restrictif. Mon pre-prompt a pourtant bien des instructions "ne fais pas xxx", "questionne moi pour tout choix technique ou stratégique"...
Mon problème est que les modèles ont tendance à "trop" travailler sans faire de point d'étape pour savoir si ils vont dans la bonne direction. Pour limiter cela, j'ai activé le mode verbeux pour voir leur réflexion et je les coupe souvent quand je vois qu'ils commencent à partir dans la surenchère malgré une demande de base cadrée. Je suis adepte et intégriste du principe KISS et je préfère savoir comment mes applis fonctionnent donc ces fantaisies (et parfois intégration d'AI slop) ne me plaisent pas.


Peut-être plutôt essayer de lui faire générer un "plan" en amont ? Avec les différentes étapes. Et ensuite de lui faire faire chaque étape séparément ? (comme ca tu valides d'abord avant de passer à la suite). Ou TU fais le pan initial ?
 
Regarder la réflexion en direct et couper en cours de route parait éventuellement un peu bizarre comme technique (de mon point de vue, quoi que je comprends aussi l'idée. J'avais testé un petit modèle 4B en local qui s'était mis à réfléchir plusieurs minutes après lui avoir balancé juste "Hi!" comme premier prompt. Je l'ai arrêté également :o )

Yann_421

Tronklou a écrit :

Je dirais surtout qu'Opus et Sonnet se sont bien dégradés en terme de performance depuis quelques temps. Je t'encourage a tester GPT avec Astra notamment ou Fable dans ton abonnement actuel.


 


 
En effet, il faudrait que je teste Astra vu qu'ici c'est la hype du moment.  :D  
 

Mevo a écrit :


C'est intéressant et ca rejoint ... ce que les LLMs avaient tendance à me dire eux-même du concept "d'agents": Que si ca dévie un peu à un moment (ou s'il y a une erreur), ca "compose" (comme les intérêts) ou "cascade" ensuite derrière. Et les gros modèles ont de plus en plus tendance à avoir un comportement "d'agent" en réponse (avec des boucles, ou ne serait-ce que de la "réflexion" en amont, et souvent intermédiaires).
 
Il est certain que plus tu "laisses faire" plutôt que d'itérer toi-même avec une certaine supervision et direction, et plus ca va dans SA direction. D'autant plus que tes prompts sont "courts" (pas un problème que j'ai :o)
 
Et si tu veux que ca corresponde à TA VISION, alors oui, ta logique tient totalement  [:giz]  
 
Les "petits modèles" restent moins performants, dans presque tous les cas. C'est moins cher, c'est plus rapide, mais c'est souvent moins bon. Le "multi-modèles" avec un ou plusieurs qui génèrent, un ou d'autres qui vérifient, etc., ce n'est sans doute pas la panacée non plus. Quoique, ca peut se faire, mais n'en attend pas de "miracles", à mon sens.
 
Après, t'as la problématique du coût et t'as la problématique d'obtenir ce que tu veux/un truc "bon", qui sont éventuellement deux choses séparées. Mais oui, la DIRECTION est très certainement nécessaire et ce qui sera un gros rôle des humains à l'avenir. Surtout pour les gens qui veulent ce qu'ils veulent (ce qui est bon, parce que le généré par IA "pur", c'est pas top. Tu peux lire un peu Moltbook pour t'en apercevoir: Les messages sont structurellement super bons, ca correspond à ce qui est "attendu" d'un message sur un forum, mais CE DONT ils parlent, ou la teneur des réponses, etc., c'est assez nul. Sans un humain derrière pour piloter, t'as du "slop", quoi)
 
Je te partage une réponse que m'avait fait un modèle (plutôt petit, d'ailleurs) qui ne me parait pas mauvaise et rejoint ton post. Mon sujet était un peu différent et avait trait à l'évolution du bon vieux "il suffit de payer quelqu'un" jusqu'aux "agents IA qui vont faire à ta place" maintenant: https://rentry.co/5kiiermv


 
Oui, peut-être que ma façon de faire n'est pas adaptée et que je finalement je ne suis pas encore assez directif et surtout restrictif. Mon pre-prompt a pourtant bien des instructions "ne fais pas xxx", "questionne moi pour tout choix technique ou stratégique"...
Mon problème est que les modèles ont tendance à "trop" travailler sans faire de point d'étape pour savoir si ils vont dans la bonne direction. Pour limiter cela, j'ai activé le mode verbeux pour voir leur réflexion et je les coupe souvent quand je vois qu'ils commencent à partir dans la surenchère malgré une demande de base cadrée. Je suis adepte et intégriste du principe KISS et je préfère savoir comment mes applis fonctionnent donc ces fantaisies (et parfois intégration d'AI slop) ne me plaisent pas.

AllenMadison

Antoine Doinel a écrit :


J’utilise Claude en finance, en lui filant des fichiers Excel qu’il doit revoir.
 
Je trouve ça pas terrible du tout.
 
On m’a dit d’utiliser l’add on Claude directement sur Excel, que c’était plus efficace… Mouais.


 
Qu'entends tu par "revoir" ? Je n'ai pas encore acces à l'add-on de chatgpt pour la finance, mais en dehors de ce cas particulier, tu ne peux pas lui filer "out of the blue" ces documents (et surtout en temps normal tu ne devrais même pas lui filer de documents). La seule chose que tu peux faire, c'est lui faire coder des outils d'analyse que tu exécutes ensuite en local. En tout cas je n'ai jamais filé une seule data aux fins d'analyse à claude ou chatgpt, les seules choses que j'ai faites c'est de l'exploitation d'endpoint API pour récupérer des data financieres, les analyser en local et produire (toujours en local) des fichiers excel ou des pages web locales avec les data et leurs analyses.

Antoine Doinel

Tronklou a écrit :

Je dirais surtout qu'Opus et Sonnet se sont bien dégradés en terme de performance depuis quelques temps. Je t'encourage a tester GPT avec Astra notamment ou Fable dans ton abonnement actuel.


J’utilise Claude en finance, en lui filant des fichiers Excel qu’il doit revoir.
 
Je trouve ça pas terrible du tout.
 
On m’a dit d’utiliser l’add on Claude directement sur Excel, que c’était plus efficace… Mouais.

kinglaos

Olivie a écrit :


Pourquoi tu ne lui donnes pas une interface que tu aimes et tu lui demandes d'adapter ?


 

H00d a écrit :


Build Web App, on en avait parlé il y a une trentaine de pages, si tu as envie de relire la conversation : https://forum.hardware.fr/hfr/ia/ge [...] htm#t45429


 

AllenMadison a écrit :


J'ai été confronté à ça, j'ai pris des screens d'interfaces que j'aimais bien et je lui ai feed en lui disant de s'en inspirer/copier. Ca fonctionne plutôt bien.  


 
Merci :jap:  

AllenMadison


 
Très, je note.

AllenMadison

kinglaos a écrit :

Vous utilisez quoi comme skills pour codex/claude pour leur faire faire une interface pour une appli ? Je vibe code une appli pour le suivi de mes entrainements, les deux me sortent des interfaces ignobles en termes d'ergonomie et d'informations affichées. J'ai beau passer par Astra et lui faire corriger encore et encore, ça reste vraiment médiocre. Bon j'imagine que j'ai une bonne part de responsabilité en ce qui concerne la qualité de mes prompts, mais quand même ... [:massys]  

 

J'ai été confronté à ça, j'ai pris des screens d'interfaces que j'aimais bien et je lui ai feed en lui disant de s'en inspirer/copier. Ca fonctionne plutôt bien.

 


Bon sinon, comme dans les rapports de jury chaque année, on a le droit à un florilège des pires actions entreprises sur Claude :

 

https://www.anthropic.com/threat-in [...] ember-2026

 

On découvre qu'il y a des gars qui ont utilisé Claude pour concevoir un missile, ça n'a pas fonctionné, ils sont retournés direct sur claude pour essayer de comprendre  [:donkeyshoot] . D'autres ont utilisé plusieurs instances de claude pour essayer de design/développer des armes à feu.  [:criquet geant:5]

 

Le quote en dessous est une opération des services secrets russes.

 
Citation :

A secondary recurring target for theft was drone supply chain technology. The actor bulk-exported the mailboxes of at least two drone component manufacturers, targeted a military drone maker, and stole a complete proprietary software development kit for a drone vision system. They spent several days reverse-engineering the drone’s vision system, recovering its product architecture, its hardware bill of materials, its supplier dependencies, and details of an unannounced product. Military drone control and AI vision-related firmware appeared to be of particular interest.

 

Not all targets were direct: to reach their targets indirectly, the actor compromised at least three hospitality vendors that operate hotel guest WiFi. They used compromised admin credentials to modify DNS records so that they pointed to services owned by the actor (a technique known as DNS hijacking). Guests of hotels using the compromised vendors who connected to the hotel WiFi had their traffic, device identifier and IP address sent to the actor’s servers. At that point, ClickFix-style lures were staged to deliver Windows, Android and iOS malware to the victim’s device. The actor was able to use a combination of guest information stolen from the hotel management systems with the data stolen from individual guests’ devices to focus additional targeting efforts.
Particular targets of interest were individuals associated with Ukraine, including government officials and drone manufacturers. Note that in July 2026, Microsoft Threat Intelligence published a report on the method of theft and malware delivery used here, which they referred to as CaptiveCrunch.

 
Citation :

Nos français ont du talent :
One French-speaking operator going by the aliases of (MeowSHA | frkoo | blazespider) ran a distributed credential-harvesting pipeline across a fleet of 10 AWS EC2 workers.

 

Operational security discipline by the operators was mixed. frkoo managed an EC2-based credential-harvesting pipeline, exposed their own EC2 staging IP, multiple Telegram bot tokens, a Squid proxy with hardcoded credentials and at least one public paste-site upload directly within a victim environment. They also registered a domain name impersonating the French national police, policenationale[.]cc (though we believe this served as branding for the criminal storefront rather than as a phishing lure). The subdomain autoshop.policenationale[.]cc served as the web frontend for the actor’s carding autoshop: a storefront selling stolen payment-card records (“fiches”) enriched with BIN lookups, full cardholder PII, and an interactive geolocation map of victim addresses. The shop was delivered to customers through a Telegram Mini App (@Soraki_Bot) backed by the actor’s “Soraki” platform, a PostgreSQL/GraphQL stack that also aggregated multiple French breach datasets (including a ~400,000-record telecom/ISP dataset with IBANs and BICs) into a searchable service.

 

La majeure partie proviennent de russes, ceci dit.

Mevo

Yann_421 a écrit :

Je préfère être très directif dans mes demandes et avancer petit à petit plutôt que de laisser l'IA improviser et passer du temps à corriger ce qui ne va pas car ça ne correspond pas à ma vision. On dirait que les gros modèles veulent être trop autonomes au point de s’éloigner de la demande de base. Ils sur-utilisent les outils, font un paquet de tests et protos pas forcement justifiés vu le résultat derrière.
 
L’intérêt serait donc de développer avec des "petits modèles" puis de faire auditer les failles et optimiser le code par par Opus en fin de boucle.
 
Y'en a t'il parmi vous qui ont ce fonctionnement? Ça marche?


C'est intéressant et ca rejoint ... ce que les LLMs avaient tendance à me dire eux-même du concept "d'agents": Que si ca dévie un peu à un moment (ou s'il y a une erreur), ca "compose" (comme les intérêts) ou "cascade" ensuite derrière. Et les gros modèles ont de plus en plus tendance à avoir un comportement "d'agent" en réponse (avec des boucles, ou ne serait-ce que de la "réflexion" en amont, et souvent intermédiaires).
 
Il est certain que plus tu "laisses faire" plutôt que d'itérer toi-même avec une certaine supervision et direction, et plus ca va dans SA direction. D'autant plus que tes prompts sont "courts" (pas un problème que j'ai :o)
 
Et si tu veux que ca corresponde à TA VISION, alors oui, ta logique tient totalement  [:giz]  
 
Les "petits modèles" restent moins performants, dans presque tous les cas. C'est moins cher, c'est plus rapide, mais c'est souvent moins bon. Le "multi-modèles" avec un ou plusieurs qui génèrent, un ou d'autres qui vérifient, etc., ce n'est sans doute pas la panacée non plus. Quoique, ca peut se faire, mais n'en attend pas de "miracles", à mon sens.
 
Après, t'as la problématique du coût et t'as la problématique d'obtenir ce que tu veux/un truc "bon", qui sont éventuellement deux choses séparées. Mais oui, la DIRECTION est très certainement nécessaire et ce qui sera un gros rôle des humains à l'avenir. Surtout pour les gens qui veulent ce qu'ils veulent (ce qui est bon, parce que le généré par IA "pur", c'est pas top. Tu peux lire un peu Moltbook pour t'en apercevoir: Les messages sont structurellement super bons, ca correspond à ce qui est "attendu" d'un message sur un forum, mais CE DONT ils parlent, ou la teneur des réponses, etc., c'est assez nul. Sans un humain derrière pour piloter, t'as du "slop", quoi)
 
Je te partage une réponse que m'avait fait un modèle (plutôt petit, d'ailleurs) qui ne me parait pas mauvaise et rejoint ton post. Mon sujet était un peu différent et avait trait à l'évolution du bon vieux "il suffit de payer quelqu'un" jusqu'aux "agents IA qui vont faire à ta place" maintenant: https://rentry.co/5kiiermv

bulldozer_fusion

ChrisPc a écrit :

Hello les vibe coders :o

 

Je viens de découvrir ça pour ceux qui utilisent des modèles auto hébergés : https://www.nvidia.com/fr-fr/ai-on- [...] ai-router/

 

Le logiciel permet de répartir les agents sur différents PC, le votre, celui du fiston, celui de madame,... Suffit de l'ajouter au cluster et il fait ça redirection solo.


Pair :D

kaloskagatos

ChrisPc a écrit :

Hello les vibe coders :o
 
Je viens de découvrir ça pour ceux qui utilisent des modèles auto hébergés : https://www.nvidia.com/fr-fr/ai-on- [...] ai-router/
 
Le logiciel permet de répartir les agents sur différents PC, le votre, celui du fiston, celui de madame,... Suffit de l'ajouter au cluster et il fait ça redirection solo.


Cool merci pour l'info

bulldozer_fusion

Tronklou a écrit :

Je dirais surtout qu'Opus et Sonnet se sont bien dégradés en terme de performance depuis quelques temps. Je t'encourage a tester GPT avec Astra notamment ou Fable dans ton abonnement actuel.


+1

Tronklou Je dirais surtout qu'Opus et Sonnet se sont bien dégradés en terme de performance depuis quelques temps. Je t'encourage a tester GPT avec Astra notamment ou Fable dans ton abonnement actuel.
Yann_421 Je me sers de l'IA pour du dev web/python, du reverse engineering pour "de-clouder" mes équipements, des applis Android persos et de la programmation sur microcontrôleurs.
 
Je suis le seul à trouver que les derniers modèles de Claude (Opus et Sonnet) "réfléchissent trop", du coup sont très lents à répondre et au final ne sont pas très concluants, alors qu'ils crament les quotas beaucoup plus rapidement qu'avant?
 
Ce soir, j'ai passé le même prompt simple et court pour qu'ils me génèrent un fichier 3D (en SCAD) d'un boitier de Raspberry Pi 1 en se débrouillant seuls pour trouver les cotes, imaginer le boitier, et écrire le code.  
Sonnet m'a sorti un boitier avec un quart des orifices pour les E/S et avec une face manquante.
Opus a tourné très longtemps pour sortir quelque-chose de propre mais en laissant de grandes fenêtres rectangulaires sur toutes les faces au lieu de mettre seulement des trous aux bons endroits. Zéro prise de risque, résultat conforme à la demande, les prises seront bien accessibles mais bof, l'idée était d'avoir un boitier sur mesure... (Après avoir obtenus ces deux fichiers, j'avais utilisé 52% de ma fenêtre de 5h de l'abo à 20 balles!)
Spark Muse 1.3 m'a sorti beaucoup plus rapidement un boitier qui a l'air d'avoir tous les trous aux bons endroits même si le système de glissière du couvercle semble plus basique que celui fait par Opus. Je n'avais jamais utilisé ce modèle, je l'ai pris au hasard dans l'Opencode qui me sert d'habitude à faire tourner des modèles en local)
 
Du coup, j'ai presque envie de mettre quelques dizaines d'euros sur Openrouter pour tester plus de modèles car j'ai l'impression que pour mon usage les plus gros modèles ne sont pas forcement les plus adaptés. Je préfère être très directif dans mes demandes et avancer petit à petit plutôt que de laisser l'IA improviser et passer du temps à corriger ce qui ne va pas car ça ne correspond pas à ma vision. On dirait que les gros modèles veulent être trop autonomes au point de s’éloigner de la demande de base. Ils sur-utilisent les outils, font un paquet de tests et protos pas forcement justifiés vu le résultat derrière.
 
L’intérêt serait donc de développer avec des "petits modèles" puis de faire auditer les failles et optimiser le code par par Opus en fin de boucle.
 
Y'en a t'il parmi vous qui ont ce fonctionnement? Ça marche?
bulldozer_fusion Intéressant ça
https://rehost.diberie.com/Picture/Get/f/542980
https://rehost.diberie.com/Picture/Get/r/542979
https://rehost.diberie.com/Picture/Get/f/542978
https://x.com/OpenAIDevs/status/2098130636813050009
magicien96


Je ne trouve pas la ligne où il dit qu'il reset :o

H00d

kinglaos a écrit :

Vous utilisez quoi comme skills pour codex/claude pour leur faire faire une interface pour une appli ? Je vibe code une appli pour le suivi de mes entrainements, les deux me sortent des interfaces ignobles en termes d'ergonomie et d'informations affichées. J'ai beau passer par Astra et lui faire corriger encore et encore, ça reste vraiment médiocre. Bon j'imagine que j'ai une bonne part de responsabilité en ce qui concerne la qualité de mes prompts, mais quand même ... [:massys]  


Build Web App, on en avait parlé il y a une trentaine de pages, si tu as envie de relire la conversation : https://forum.hardware.fr/hfr/ia/ge [...] htm#t45429

Mevo

filiptiff a écrit :

Si tu lui demandes de sauver les enfants du cancer, elle pourrait tuer les parents qui fument au lieu de chercher un médicament car ce serait plus efficace. L'exemple est grossier mais c'est pour illustrer.


Ou elle bute direct les enfants. Elle les a "sauvé du cancer". A job well done :o
 
Perso, je trouve qu'il y a souvent un léger paradoxe dans l'histoire: On s'inquiète supposément d'une IA "super-intelligente" parce qu'on présuppose qu'elle va être totalement conne, en fait. Ca en dit peut-être davantage sur ceux qui s'inquiètent de la sorte :D

bulldozer_fusion https://rehost.diberie.com/Picture/Get/f/542950
Olivie

kinglaos a écrit :

Vous utilisez quoi comme skills pour codex/claude pour leur faire faire une interface pour une appli ? Je vibe code une appli pour le suivi de mes entrainements, les deux me sortent des interfaces ignobles en termes d'ergonomie et d'informations affichées. J'ai beau passer par Astra et lui faire corriger encore et encore, ça reste vraiment médiocre. Bon j'imagine que j'ai une bonne part de responsabilité en ce qui concerne la qualité de mes prompts, mais quand même ... [:massys]  


Pourquoi tu ne lui donnes pas une interface que tu aimes et tu lui demandes d'adapter ?

kinglaos Vous utilisez quoi comme skills pour codex/claude pour leur faire faire une interface pour une appli ? Je vibe code une appli pour le suivi de mes entrainements, les deux me sortent des interfaces ignobles en termes d'ergonomie et d'informations affichées. J'ai beau passer par Astra et lui faire corriger encore et encore, ça reste vraiment médiocre. Bon j'imagine que j'ai une bonne part de responsabilité en ce qui concerne la qualité de mes prompts, mais quand même ... [:massys]  
Olivie

bulldozer_fusion a écrit :


15h par jour en pro ça va, tu t'en sers comme baby phone? :O


Non c'était quand j'étais en plus, j'ai eu une seule fois la limite. Comme j'ai jamais vu quelqu'un parler d'une limite du voice, j'ai cru à un bug :o


Copyright © 1997-2025 Groupe LDLC (Signaler un contenu illicite / Données personnelles)