| |||||
FORUM HardWare.fr

Intelligence Artificielle

[Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co| Dernière réponse | ||
|---|---|---|
| Sujet : [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co | ||
| Big Blue |
|
|
| Aperçu |
|---|
| Vue Rapide de la discussion |
|---|
| Big Blue |
|
| Seizh |
|
| Big Blue | Oui bien sûr je le faisais avec Sol mais là c’est en systématique dès qu’il lit du code sur une demande simple il va proposer de lui-même des corrections. |
| H00d |
|
| Big Blue | Deepseek V4.1 est vraiment impressionnnant. Le plus sympa c’est que lorsque je lui demande une tâche simple il va analyser tout l’environnement et me proposer des corrections et améliorations optionnelles. C’est bien le seul modèle qui fait ça. Bien sûr il test toutes ses modifications et surtout il propose toujours plusieurs solutions avant d’agir. Je suis pas dev, juste passionné et je le préfère largement à Astra :o ( surtout parce que je peux finir mes tâches avec mon quotas :D ). |
| Yann_421 |
|
| Kalymereau |
|
| Mevo | Ivre, il découvre ce qu'est un LLM et qu'il faut toujours encore un cerveau :o
(oui, ce que tu décris est sans doute le type de réalisation qu'ont beaucoup de gens après le "waouh" original :jap: ) |
| Antoine Doinel |
|
| Mevo |
|
| Yann_421 |
|
| AllenMadison |
|
| Antoine Doinel |
|
| kinglaos |
|
| AllenMadison |
J'ai été confronté à ça, j'ai pris des screens d'interfaces que j'aimais bien et je lui ai feed en lui disant de s'en inspirer/copier. Ca fonctionne plutôt bien.
https://www.anthropic.com/threat-in [...] ember-2026 On découvre qu'il y a des gars qui ont utilisé Claude pour concevoir un missile, ça n'a pas fonctionné, ils sont retournés direct sur claude pour essayer de comprendre [:donkeyshoot] . D'autres ont utilisé plusieurs instances de claude pour essayer de design/développer des armes à feu. [:criquet geant:5] Le quote en dessous est une opération des services secrets russes.
La majeure partie proviennent de russes, ceci dit. |
| Mevo |
|
| bulldozer_fusion |
|
| kaloskagatos |
|
| bulldozer_fusion |
|
| Tronklou | Je dirais surtout qu'Opus et Sonnet se sont bien dégradés en terme de performance depuis quelques temps. Je t'encourage a tester GPT avec Astra notamment ou Fable dans ton abonnement actuel. |
| Yann_421 | Je me sers de l'IA pour du dev web/python, du reverse engineering pour "de-clouder" mes équipements, des applis Android persos et de la programmation sur microcontrôleurs.
Je suis le seul à trouver que les derniers modèles de Claude (Opus et Sonnet) "réfléchissent trop", du coup sont très lents à répondre et au final ne sont pas très concluants, alors qu'ils crament les quotas beaucoup plus rapidement qu'avant? Ce soir, j'ai passé le même prompt simple et court pour qu'ils me génèrent un fichier 3D (en SCAD) d'un boitier de Raspberry Pi 1 en se débrouillant seuls pour trouver les cotes, imaginer le boitier, et écrire le code. Sonnet m'a sorti un boitier avec un quart des orifices pour les E/S et avec une face manquante. Opus a tourné très longtemps pour sortir quelque-chose de propre mais en laissant de grandes fenêtres rectangulaires sur toutes les faces au lieu de mettre seulement des trous aux bons endroits. Zéro prise de risque, résultat conforme à la demande, les prises seront bien accessibles mais bof, l'idée était d'avoir un boitier sur mesure... (Après avoir obtenus ces deux fichiers, j'avais utilisé 52% de ma fenêtre de 5h de l'abo à 20 balles!) Spark Muse 1.3 m'a sorti beaucoup plus rapidement un boitier qui a l'air d'avoir tous les trous aux bons endroits même si le système de glissière du couvercle semble plus basique que celui fait par Opus. Je n'avais jamais utilisé ce modèle, je l'ai pris au hasard dans l'Opencode qui me sert d'habitude à faire tourner des modèles en local) Du coup, j'ai presque envie de mettre quelques dizaines d'euros sur Openrouter pour tester plus de modèles car j'ai l'impression que pour mon usage les plus gros modèles ne sont pas forcement les plus adaptés. Je préfère être très directif dans mes demandes et avancer petit à petit plutôt que de laisser l'IA improviser et passer du temps à corriger ce qui ne va pas car ça ne correspond pas à ma vision. On dirait que les gros modèles veulent être trop autonomes au point de s’éloigner de la demande de base. Ils sur-utilisent les outils, font un paquet de tests et protos pas forcement justifiés vu le résultat derrière. L’intérêt serait donc de développer avec des "petits modèles" puis de faire auditer les failles et optimiser le code par par Opus en fin de boucle. Y'en a t'il parmi vous qui ont ce fonctionnement? Ça marche? |
| bulldozer_fusion | Intéressant ça https://rehost.diberie.com/Picture/Get/f/542980 https://rehost.diberie.com/Picture/Get/r/542979 https://rehost.diberie.com/Picture/Get/f/542978 https://x.com/OpenAIDevs/status/2098130636813050009 |
| magicien96 |
|
| H00d |
|
| Mevo |
|
| bulldozer_fusion | https://rehost.diberie.com/Picture/Get/f/542950 |
| Olivie |
|
| kinglaos | Vous utilisez quoi comme skills pour codex/claude pour leur faire faire une interface pour une appli ? Je vibe code une appli pour le suivi de mes entrainements, les deux me sortent des interfaces ignobles en termes d'ergonomie et d'informations affichées. J'ai beau passer par Astra et lui faire corriger encore et encore, ça reste vraiment médiocre. Bon j'imagine que j'ai une bonne part de responsabilité en ce qui concerne la qualité de mes prompts, mais quand même ... [:massys] |
| Olivie |
|


