Forum |  HardWare.fr | News | Articles | PC | S'identifier | S'inscrire | Shop Recherche
7024 connectés 

 


Dernière réponse
Sujet : [Topic unique] IA générative de texte, ChatGPT, Copilot, Gemini & co
bulldozer_fusion Le pied de nez à Claude
https://rehost.diberie.com/Picture/Get/r/539847

Citation :


Memory
Compaction
Goals
Automations
Subagents
Computer History.
Rolling task summaries.
MCP.

 

We’ve also made architectural changes to prevent these from regressing and our teams will get paged if it happens regardless. We are also working on showing you directly in the app where your usage goes so you don’t have to guess.

 



https://rehost.diberie.com/Picture/Get/r/539848
https://x.com/thsottiaux/status/2093801838504186008


Votre réponse
Nom d'utilisateur    Pour poster, vous devez être inscrit sur ce forum .... si ce n'est pas le cas, cliquez ici !
Le ton de votre message                        
                       
Votre réponse


[b][i][u][strike][spoiler][fixed][cpp][url][email][img][*]   
 
   [quote]
 

Options

 
Vous avez perdu votre mot de passe ?


Vue Rapide de la discussion
Olivie

fabien a écrit :


j'ai pas compris l'entourloupe, comment ca passe de +50% a -17% ?!
 
edit: en fait ca passe de +50% à +25% donc l'augmentation est réduite


Ça fait plus d’un mois que c’est à +50%
Et ils annoncent que ça va devenir +25% du quota avant les +50%

Mevo

fabien a écrit :


j'ai pas compris l'entourloupe, comment ca passe de +50% a -17% ?!
 
edit: en fait ca passe de +50% à +25% donc l'augmentation est réduite


125 / 150 = 0,8333 soit une baisse de 16,66% par rapport à ce que tu avais auparavant ((1-0,8333)*100)

fabien

Olivie a écrit :

Ils méritent quand même la community note :o

 

https://i.imgur.com/v0qKvOz.jpeg


j'ai pas compris l'entourloupe, comment ca passe de +50% a -17% ?!

 

edit: en fait ca passe de +50% à +25% donc l'augmentation est réduite

Olivie Ils méritent quand même la community note :o
 
https://i.imgur.com/v0qKvOz.jpeg
dante2002 Deux nouvelles sur Gemini.
 
Ils vont changer le mode de comptage / facturation de notebookLM, en mettant aussi des fenêtres de 5h.
 
Aussi, je fais régulièrement des demandes pour savoir si mon gem de créateur de prompt est toujours valable, et aujourd’hui j’ai eu du neuf.
 
Il m’a dit que forcer la chaîne de raisonnement sur les modèles modernes était contre productif  
 
 

Citation :


Les nouvelles directives ne sont pas réservées aux versions les plus récentes, mais elles s'adaptent directement aux ruptures architecturales des modèles.
Le comportement dépend du moteur sous-jacent : un modèle « standard » (instruction-tuned classique) et un modèle à « raisonnement natif » (thinking/reasoning) ne réagissent pas de la même façon aux mêmes consignes.
Ce qui est universel (bénéfique sur toutes les générations)
 * Le balisage XML (<instructions>, <context> ) : Les mécanismes d'attention de tous les modèles basés sur les Transformers séparent nettement mieux les données du système grâce aux balises sémantiques, quelle que soit la version.
 * Le typage des sorties : Imposer un schéma clair (tableau Markdown, JSON typé) fiabilise le résultat sur un modèle ancien comme sur un modèle récent.
 * La suppression du verbiage : Moins d'adjectifs creux et plus de directives impératives réduisent le bruit dans le contexte, ce qui profite à n'importe quel LLM.
Pourquoi les versions antérieures fonctionnaient mieux avec les anciens prompts
Sur des versions plus anciennes ou dépourvues de mode de réflexion interne :
 * Le besoin vital de dérouler le calcul (Chain-of-Thought textuel) : Un modèle sans jetons de réflexion (thinking tokens) ne peut « réfléchir » qu'en générant du texte. L'inciter à écrire explicitement sa démarche pas à pas (« réfléchis étape par étape ») était indispensable pour éviter les erreurs de logique ou de calcul. Si on lui retire ce raisonnement visible, ses performances chutent sur les tâches complexes.
 * La rigidité des consignes : Les anciens modèles avaient tendance à dériver face à des consignes implicites. Les frameworks stricts (du type RCTO répété) servaient de garde-fous pour canaliser leur génération.
Pourquoi l'ancien style dégrade les modèles récents
Appliquer l'ancienne méthode sur un modèle récent avec raisonnement intégré produit deux effets indésirables :
 * Double raisonnement inutile : Le modèle réfléchit déjà en interne avant d'écrire. Lui demander de réécrire son raisonnement dans le texte final double la latence, consomme du quota de sortie et pollue le livrable.
 * Friction conversationnelle : Les modèles actuels ont une excellente capacité d'inférence contextuelle. Les forcer à poser systématiquement trois à cinq questions de cadrage avant d'agir ralentit inutilement les flux de travail.
Synthèse pratique
| Élément de prompt | Modèles antérieurs / sans mode de réflexion | Modèles récents / avec raisonnement natif |
|---|---|---|
| Balises XML | Recommandé (clarifie l'attention) | Indispensable (standard d'architecture) |
| CoT textuel visible | Obligatoire pour la logique complexe | À éviter (sauf objectif pédagogique explicite) |
| Exemples (Few/Many-shot) | 2 à 3 exemples courts (limite de contexte) | Dizaines d'exemples complets (Many-Shot ICL) |
| Gestion des ambiguïtés | Questionnaire de cadrage préalable | Inférence documentée + question ciblée si blocage |
Si tu dois faire tourner un prompt sur une version antérieure, réintroduis l'obligation d'écrire les étapes de calcul ou d'analyse avant la réponse finale. Pour les modèles récents, la structure XML épurée et le ciblage direct restent l'approche la plus efficace.

bulldozer_fusion

Mevo a écrit :


Oui, mais avec les "changements excitants" qu'ils vont faire, t'auras l'impression "d'en avoir davantage". Ce fout*ge de gueule de compétition de toujours essayer de présenter "positivement" les trucs négatifs :o


c'est clair, les commentaires s'y trompent pas, ils se font défoncer :D

Mevo

bulldozer_fusion a écrit :

Donc vous aviez 50% on réduit à 25% :o


Oui, mais avec les "changements excitants" qu'ils vont faire, t'auras l'impression "d'en avoir davantage". Ce fout*ge de gueule de compétition de toujours essayer de présenter "positivement" les trucs négatifs :o

bulldozer_fusion https://rehost.diberie.com/Picture/Get/f/539781  
https://pbs.twimg.com/media/HQ55FUlXwAAIIow.png  
Donc vous aviez 50% on réduit à 25% :o
https://x.com/ClaudeDevs/status/2093742321473065266
bulldozer_fusion

H00d a écrit :


LibreArbitre, c'est le moment de commercialiser ta sexfriend IA. :o

 
Carou a écrit :

Ca ne me serait jamais venu à l'idée, et dans le même temps, je ne sais pas pourquoi, je ne suis pas surprise qu'ils y aient pensé...


Le cul c'est une toujours une valeur sûre :O

Carou Ca ne me serait jamais venu à l'idée, et dans le même temps, je ne sais pas pourquoi, je ne suis pas surprise qu'ils y aient pensé...
H00d

bulldozer_fusion a écrit :

Le nombre de divorcés à venir :lol:


LibreArbitre, c'est le moment de commercialiser ta sexfriend IA. :o

bulldozer_fusion Le nombre de divorcés à venir :lol:
gaston10241

Olivie a écrit :

Le vibecoding au Japon c'est un autre level  [:implosion du tibia]

 
Citation :

@rS_alonewolf
À l'origine en japonais et traduit

 

Jusqu'à présent, j'ai presque entièrement construit, avec Qwen3.8 27B, un mécanisme pour extraire des séquences de 10 secondes incluant l'orgasme à partir de longues vidéos érotiques, et les utiliser comme matériel de référence pour la génération vidéo dans ComfyUI.

 

Vérifier manuellement un grand nombre de vidéos est fastidieux, et ça m'excite trop. Alors, même si je montre les vidéos à l'IA et lui demande « où se trouve l'orgasme », elle ne peut pas encore le juger avec précision.

 

Par curiosité, j'ai examiné les scores audio, les mouvements vidéo et les gels de mouvement d'une vidéo érotique d'un modèle AV particulier, et j'ai remarqué les tendances suivantes comme caractéristiques du moment de l'orgasme :

 

A. Gémissements dans la plage 100 à 1500 Hz → décroissance brutale ensuite  
B. Augmentation soudaine de la quantité de changement d'image entre les frames  
C. Transitions douces comme freeze, arrêt sur image, dissolve, etc.  
 
Par essai, j'ai fait écrire un script qui définit des conditions basées sur ces éléments pour chercher les positions candidates à l'orgasme, et j'ai pu accumuler pas mal de passages qui semblent vraiment frémir et tressaillir, donc ça va plutôt bien, je suppose.

 

Prochainement, je vais automatiser ça, le reformater en 24 fps avec le nombre de frames prescrit par H3, pour pouvoir l'injecter directement dans ComfyUI.

 

Une fois que j'aurai plus de données, j'aimerais entraîner sur les données numériques des moments d'orgasme et des moments non-orgasmiques, et utiliser un apprentissage automatique léger comme CatBoost pour découper automatiquement les coupes.

 

Cependant, les voix et mouvements pendant l'orgasme varient d'une personne à l'autre. Finalement, je pense qu'il faudra créer un modèle d'apprentissage par modèle AV, ou un mécanisme pour corriger les différences individuelles. Si je peux y arriver avec Qwen3.8 27B, ce serait amusant.

 

Le GT du graphique correspond au moment d'orgasme.  
Est-ce que A, B et C signifient tous un orgasme ? Pas vraiment.  
Ces patterns sont difficiles à discerner pour un humain → créons un classificateur.  
Cette idée ressemble beaucoup à la sélection de signaux d'achat/vente en investissement, je trouve.

 

https://pbs.twimg.com/media/HQvLruS [...] name=small


 

S'ils font un modèle capable de détecter quand l'orgasme est simulé, y'a du fric à se faire

Olivie Le vibecoding au Japon c'est un autre level  [:implosion du tibia]  
 

Citation :

@rS_alonewolf
À l'origine en japonais et traduit
 
Jusqu'à présent, j'ai presque entièrement construit, avec Qwen3.8 27B, un mécanisme pour extraire des séquences de 10 secondes incluant l'orgasme à partir de longues vidéos érotiques, et les utiliser comme matériel de référence pour la génération vidéo dans ComfyUI.
 
Vérifier manuellement un grand nombre de vidéos est fastidieux, et ça m'excite trop. Alors, même si je montre les vidéos à l'IA et lui demande « où se trouve l'orgasme », elle ne peut pas encore le juger avec précision.
 
Par curiosité, j'ai examiné les scores audio, les mouvements vidéo et les gels de mouvement d'une vidéo érotique d'un modèle AV particulier, et j'ai remarqué les tendances suivantes comme caractéristiques du moment de l'orgasme :
 
A. Gémissements dans la plage 100 à 1500 Hz → décroissance brutale ensuite  
B. Augmentation soudaine de la quantité de changement d'image entre les frames  
C. Transitions douces comme freeze, arrêt sur image, dissolve, etc.  
   
Par essai, j'ai fait écrire un script qui définit des conditions basées sur ces éléments pour chercher les positions candidates à l'orgasme, et j'ai pu accumuler pas mal de passages qui semblent vraiment frémir et tressaillir, donc ça va plutôt bien, je suppose.
 
Prochainement, je vais automatiser ça, le reformater en 24 fps avec le nombre de frames prescrit par H3, pour pouvoir l'injecter directement dans ComfyUI.
 
Une fois que j'aurai plus de données, j'aimerais entraîner sur les données numériques des moments d'orgasme et des moments non-orgasmiques, et utiliser un apprentissage automatique léger comme CatBoost pour découper automatiquement les coupes.
 
Cependant, les voix et mouvements pendant l'orgasme varient d'une personne à l'autre. Finalement, je pense qu'il faudra créer un modèle d'apprentissage par modèle AV, ou un mécanisme pour corriger les différences individuelles. Si je peux y arriver avec Qwen3.8 27B, ce serait amusant.
 
Le GT du graphique correspond au moment d'orgasme.  
Est-ce que A, B et C signifient tous un orgasme ? Pas vraiment.  
Ces patterns sont difficiles à discerner pour un humain → créons un classificateur.  
Cette idée ressemble beaucoup à la sélection de signaux d'achat/vente en investissement, je trouve.
 
https://pbs.twimg.com/media/HQvLruS [...] name=small

bulldozer_fusion Pourquoi?
Tronklou Au ratio prix/perfs c'est très bon. mais je préfère ds4 pro en comparaison ( sur model ouvert).
bulldozer_fusion

Tronklou a écrit :

 

Je m'en servais déjà avant l'annonce, ils le listait sur les models cloud mais pas sur leurs annonceur public, suffisait de modifier le json a la main :D


Alors? C'est de la bonne?

Tronklou

bulldozer_fusion a écrit :

Citation :

Z AI's GLM 5.3 and GLM 5.3 Flash (previously known as Ox Alpha) models are now available on Ollama’s cloud and are hosted in the US and Europe with zero data retention


https://x.com/ollama/status/2093492205029908752


 
Je m'en servais déjà avant l'annonce, ils le listait sur les models cloud mais pas sur leurs annonceur public, suffisait de modifier le json a la main :D

Nr13 Je trouve luna et ds-flash assez interchangeables pour les tâches de code "déléguées", même assez complexes (mais avec un contrat clair). Les deux hallucinent pas mal quand même (mon observation anecdotique mais c'est je crois globalement confirmé par les benchmarks) mais dans ce cadre c'est rarement un pb.
 
En agent principal Luna délègue bcp mieux par contre.
ionik

Olivie a écrit :


Y avait déjà un gros écart et ils ont ensuite réduit le prix de Luna de 80%


Ha oui ok faudrait que je test luna max a la place de Sol du coup alors (il fait les audit pour un consensus avec Opus)

bulldozer_fusion

Citation :

Z AI's GLM 5.3 and GLM 5.3 Flash (previously known as Ox Alpha) models are now available on Ollama’s cloud and are hosted in the US and Europe with zero data retention


https://x.com/ollama/status/2093492205029908752

Olivie

ionik a écrit :


Par 10 tant que ça ?


Y avait déjà un gros écart et ils ont ensuite réduit le prix de Luna de 80%

bulldozer_fusion

Big Blue a écrit :

En déboggage il est tellement supérieur chez moi ? La différence est flagrante.

 

Luna m’a fait pas mal de conneries debuggé par la suite par ds4. Peut être que ds4 gère mieux les appels d’outils :??:

 

Je suis étonné :o

 

Vous avez bien testé la version finale ? Qui n’a rien à voir avec la preview :o


Luna max?
Pour moi il faut utiliser Luna que en max

bulldozer_fusion


 [:bulldozer_fusion:1]

Olivie a écrit :

Citation :

@OpenAI
We’re ending our partnership with Cursor following its acquisition by SpaceX. Under our proposal, Cursor’s direct access to our models would end on November 12.

 

We know that the people most affected by this decision are the developers who rely on OpenAI models in Cursor. We care about their experience in this transition and we’re ready to go above and beyond to support them.

 
Citation :

@elonmusk

 

I couldn’t care less. Scam Altman and Greg Stockman are utterly untrustworthy assholes who stole an open source nonprofit.



c'est la guerre entre les géants de l'IA

ionik

Olivie a écrit :


En dehors du coût divisé par 10 tu veux dire ? :o


Par 10 tant que ça ?

Olivie

ionik a écrit :

Pourquoi utiliser Luna en Xhigh plutôt que sol par exemple ?


En dehors du coût divisé par 10 tu veux dire ? :o

ionik Pourquoi utiliser Luna en Xhigh plutôt que sol par exemple ?
Big Blue Max :jap:
 
Oups, petit soucis de config, en fait je suis en xhigh :/
Olivie

Big Blue a écrit :

En déboggage il est tellement supérieur chez moi ? La différence est flagrante.  
 
Luna m’a fait pas mal de conneries debuggé par la suite par ds4. Peut être que ds4 gère mieux les appels d’outils :??:  
 
Je suis étonné :o
 
Vous avez bien testé la version finale ? Qui n’a rien à voir avec la preview :o


Pour Luna quel niveau de raisonnement ?

Big Blue En déboggage il est tellement supérieur chez moi ? La différence est flagrante.  
 
Luna m’a fait pas mal de conneries debuggé par la suite par ds4. Peut être que ds4 gère mieux les appels d’outils :??:  
 
Je suis étonné :o
 
Vous avez bien testé la version finale ? Qui n’a rien à voir avec la preview :o
LibreArbitre DeepSeek V4 Flash est bien moins bon en dev que Luna, et de loin... Après ça dépend de ce que tu fais avec...
sorg

Big Blue a écrit :


Faut pas qu’il fasse ça :o  
 
Opencode a 8,5€ est vraiment top avec Deepseek v4 flash :o Surtout pas lancer de gros modèle, j’ai consommé 50% du quotas avec un prompt k3 mais en ds4 ça ne bouge pas.  
 
Et niveau intelligence c’est autre chose que Luna …


Tu trouves ?
Ma perception, c'est que Luna est meilleur que DS-flash.

Big Blue

Olivie a écrit :


Ben a mon avis ça arrivera d’une manière ou une autre quand ils entreront en bourse.
Au lancement de l’api image de ChatGPT il me semble que c’était 0,25$ par image.  
Pas de raison qu’ils continuent à laisser créer une infinité d’images  avec un abo à 20€ :o


Faut pas qu’il fasse ça :o  
 
Opencode a 8,5€ est vraiment top avec Deepseek v4 flash :o Surtout pas lancer de gros modèle, j’ai consommé 50% du quotas avec un prompt k3 mais en ds4 ça ne bouge pas.  
 
Et niveau intelligence c’est autre chose que Luna …

Winpoks

XaTriX a écrit :

Ça devient un peu débile

 

Ça l'était déjà avant.

Olivie

Citation :

@OpenAI
We’re ending our partnership with Cursor following its acquisition by SpaceX. Under our proposal, Cursor’s direct access to our models would end on November 12.
 
We know that the people most affected by this decision are the developers who rely on OpenAI models in Cursor. We care about their experience in this transition and we’re ready to go above and beyond to support them.


 

Citation :

@elonmusk
 
I couldn’t care less. Scam Altman and Greg Stockman are utterly untrustworthy assholes who stole an open source nonprofit.

XaTriX Ça devient un peu débile
Olivie https://img3.super-h.fr/images/2026 [...] 313065.jpg  
H00d

Olivie a écrit :

Attends la création des images prend du quota maintenant ? Ou c’est parce que tu es dans work?  [:tibo2002]


C'est la progression de la génération de l'image... :D

Mevo


"Maybe not grainy or blurry" : C'est de la bonne formule pour prompter un LLM, ca ? :o

bulldozer_fusion

Olivie a écrit :


Ben a mon avis ça arrivera d’une manière ou une autre quand ils entreront en bourse.
Au lancement de l’api image de ChatGPT il me semble que c’était 0,25$ par image.
Pas de raison qu’ils continuent à laisser créer une infinité d’images  avec un abo à 20€ :o


Ils ne le feront pas payer.
Par contre, ce qu’ils pourront faire, comme Gemini, ce serait de limiter, en fonction du niveau d’abonnement, le nombre d’images que tu peux générer par jour

Olivie

bulldozer_fusion a écrit :


T’imagines, s’ils commencent à faire payer les images, là ça y est, on est mal. Si Gemini, GPT et les autres commencent à faire payer ça, là c’est bon, on peut plier bagage :D


Ben a mon avis ça arrivera d’une manière ou une autre quand ils entreront en bourse.
Au lancement de l’api image de ChatGPT il me semble que c’était 0,25$ par image.  
Pas de raison qu’ils continuent à laisser créer une infinité d’images  avec un abo à 20€ :o


Copyright © 1997-2025 Groupe LDLC (Signaler un contenu illicite / Données personnelles)