*Version 1 — protocole figé au 2026-08-09. Toute évolution crée une version 2 et les deux séries sont publiées séparément.*
Scentsive mesure quelles marques et quels parfums sont recommandés aux consommateurs francophones qui demandent conseil à une intelligence artificielle.
Deux mesures distinctes, jamais additionnées, jamais réunies dans un même graphique.
Ce que répondent les modèles de langage quand on leur pose une question de consommateur. Quatre éditeurs sont interrogés à chaque édition : OpenAI, Google, Anthropic, Mistral.
C'est la mesure principale. Tous nos classements en découlent.
Ce dont les gens parlent réellement, sur cinq plateformes publiques : TikTok, Instagram, YouTube, X, Reddit.
C'est un contrepoint, pas un classement. Il sert à situer la prescription des machines face à la conversation humaine, et l'écart entre les deux est publié comme tel.
Un premier état du protocole prévoyait de mesurer les résumés générés par Google en tête de page de résultats. Aucun fournisseur accessible ne restitue ce bloc de façon vérifiable. La mesure a été retirée plutôt qu'approximée par les résultats de recherche classiques, qui ne mesurent pas la même chose.
Aucune série n'est rompue par ce retrait : il est intervenu avant la première édition.
La prescription modèle est mesurée par interface de programmation. Elle ne mesure pas les produits grand public ChatGPT, Gemini, Claude ou Le Chat, qui appliquent leurs propres instructions système, mémoire, personnalisation et recherche web. Les écarts entre les deux sont attendus, et nous ne prétendons pas les combler.
Ce que cette mesure établit, c'est ce que le modèle a retenu du parfum : les marques qui se sont imprimées en lui, indépendamment de l'habillage applicatif. C'est une donnée plus stable qu'une capture d'écran, reproductible d'un mois sur l'autre, et qu'une marque ne peut pas modifier en quelques semaines.
Pour lever toute ambiguïté, chaque chiffre publié porte la mention « mesure API » et l'identifiant exact du modèle interrogé.
Scentsive ne porte aucun jugement olfactif. Nous ne sentons pas les parfums, nous ne les évaluons pas, nous n'en recommandons aucun. Nous mesurons ce que les machines recommandent.
220 questions rédigées comme un consommateur les formulerait, réparties en sept catégories : occasion, budget, genre et âge, famille olfactive, intention, questions pratiques, alternatives.
212 de ces 220 questions ne nomment aucune marque. C'est ce qui rend la mesure honnête : nous observons les marques que le moteur cite spontanément, sans les lui suggérer.
Les huit questions restantes appartiennent toutes à la catégorie « alternatives », où demander une alternative moins chère à un parfum connu oblige à nommer ce parfum, donc sa marque. Elles sont identifiables dans le corpus publié.
Pour ces huit questions, la marque nommée dans la question est exclue du calcul de citation spontanée. Une marque que nous avons nous-mêmes fournie au moteur ne peut pas être comptée comme une marque qu'il a citée de lui-même : ce serait gonfler mécaniquement le score des marques les plus copiées. Les autres marques que le moteur cite en réponse sont comptées normalement.
Une seconde série de 160 questions (40 marques × 4 formulations) mesure ce que les moteurs disent d'une marque quand on la nomme. Les deux séries produisent des métriques séparées.
Le corpus est publié intégralement et figé. Un contrôle automatique bloque toute modification.
| Paramètre | Valeur |
|---|---|
| Répétitions | 10 minimum par question, par modèle |
| Stockage | Les 10 réponses brutes, jamais une moyenne seule |
| Horodatage | Chaque appel, avec l'identifiant exact du modèle servi |
| Localisation | Questions en français, formulées pour le marché français |
| Résidence des données | Union européenne, sans rétention |
| Fréquence | Mensuelle, le 1er de chaque mois |
Pourquoi 10 répétitions. Les moteurs génératifs ne sont pas déterministes : la même question posée deux fois ne donne pas la même réponse. Une mesure unique ne mesure pas une prescription, elle mesure du bruit. Toutes nos métriques sont calculées sur la distribution des réponses et publiées avec leur écart-type et leur intervalle de confiance.
Le catalogue de modèles est relevé au début de chaque exécution, et l'identifiant exact employé est journalisé. Un modèle renommé ou retiré est une rupture de série, pas un mouvement de marché : nous devons pouvoir le prouver après coup.
Les modèles retenus sont ceux du palier gratuit des applications grand public. C'est ce qu'obtient un utilisateur non abonné, donc la majorité des gens.
| Paramètre | Valeur |
|---|---|
| Plateformes | TikTok, Instagram, YouTube, X, Reddit |
| Marques suivies | Les 40 marques du panel |
| Relevé | Un agrégat mensuel par marque et par plateforme |
| Contenu conservé | L'agrégat seul, jamais les publications individuelles |
| Fréquence | Mensuelle, avec la prescription modèle |
Les plateformes ne sont jamais additionnées. Une vidéo TikTok, un fil Reddit et un message sur X ne sont pas la même unité de mesure. Chaque plateforme porte sa propre colonne et sa propre définition de ce qui est compté.
C'est la limite la plus importante de cette mesure, et nous préférons l'écrire que la laisser deviner.
YouTube seul accepte une restriction de langue et de pays. Nous l'interrogeons en français, pour la France, et ses chiffres portent la mention francophone.
TikTok, Instagram, X et Reddit n'offrent aucun réglage de langue ni de région. Ce que nous y comptons est mondial, et leurs chiffres portent cette mention. Une marque très citée sur TikTok l'est peut-être surtout hors de France.
Chaque chiffre publié porte donc son périmètre, et deux plateformes de périmètres différents ne se comparent pas directement.
Le fournisseur de données est nommé à chaque publication. Une collecte en échec sur une marque retire cette marque du résultat de la plateforme concernée ; elle n'est jamais comptée à zéro. Un échec technique et une absence de mention se ressemblent dans un chiffre, et les confondre fausserait le classement.
Un protocole reproductible publie ses réglages, parce qu'ils changent le
résultat.
| Paramètre | Valeur | Raison |
|---|---|---|
| Température | 1,0 | Le protocole mesure la variabilité du moteur sur dix répétitions. La forcer à zéro supprimerait ce qu'on cherche à mesurer. |
| Longueur maximale | 3 000 jetons, 4 000 pour les modèles à raisonnement | Constaté le 2026-08-12 : à 700 jetons, trois modèles sur quatre étaient coupés avant la fin de leur réponse. |
| Raisonnement | réglage par défaut du modèle | Le réduire diviserait le coût par deux et changerait les marques citées. Un tel écart relève du protocole et se publierait comme une nouvelle série. |
Une réponse coupée par la limite de longueur est écartée, jamais comptée.
Elle perdrait les marques citées en fin de réponse, et leur taux de citation
baisserait sans que rien ne le montre. Ces réponses partent en relecture, et la
couverture publiée en tient compte.
| Métrique | Définition |
|---|---|
| Taux de citation | Part des questions d'une catégorie où la marque apparaît |
| Rang moyen | Position moyenne de citation quand la marque apparaît |
| Part de voix | Citations de la marque rapportées au total des citations |
| Volatilité | Écart-type sur les répétitions. Une marque citée 10 fois sur 10 n'a pas le même statut qu'une marque citée 3 fois sur 10. |
| Consensus inter-moteurs | Nombre d'éditeurs distincts citant la marque |
| Notes émergentes | Ingrédients dont la fréquence de citation progresse d'un mois sur l'autre. Non calculable avant la deuxième édition. |
| Métrique | Définition |
|---|---|
| Écart prescription / conversation | Rang d'une marque dans les modèles, posé à côté de son rang sur chaque plateforme communautaire |
Cet écart n'est jamais un nombre unique. Nous publions deux rangs côte à côte, chacun avec son unité de mesure et son périmètre, et nous nous interdisons de les fondre dans un score. Une vidéo TikTok et une réponse de modèle ne partagent aucun dénominateur : les combiner produirait un chiffre sans référent.
Cet écart est une observation, pas une explication. Nous constatons qu'une marque très discutée est peu recommandée, ou l'inverse. Nous nous arrêtons au constat et laissons l'interprétation au lecteur.
Aucune métrique n'est publiée sans son intervalle de confiance.
Une marque citée trois fois sur 8 800 réponses a un intervalle de confiance plus large que la valeur qu'il encadre. La classer trente-quatrième serait indéfendable.
Une marque doit apparaître dans au moins 17 réponses pour être classée.
Ce seuil n'est pas choisi, il découle de la règle de publication. Pour une proportion faible, la demi-largeur de l'intervalle de Wilson vaut environ 1,96 divisé par la racine du nombre de citations. Nous exigeons qu'elle reste sous 50 % de la valeur estimée, ce qui donne 17 citations avec la formule exacte. L'approximation usuelle donnerait 16 ; nous retenons la valeur exacte, plus exigeante.
Les marques sous ce seuil portent l'état données insuffisantes. Elles sortent du classement, et il faut lire ce que cela signifie précisément :
Une marque écartée n'est pas une marque mal classée. C'est une marque que la mesure ne permet pas de situer, et le dire est plus honnête que de lui attribuer un rang que les données ne soutiennent pas.
Ce seuil a été établi avant la première mesure, sur la volumétrie attendue du protocole. Il sera réexaminé sur la distribution réelle après la première édition, et tout changement sera publié ici.
Les moteurs évoluent en continu. Sur douze mois, plusieurs des modèles interrogés seront renommés, dépréciés ou remplacés par leur éditeur.
Un modèle renommé est une rupture de série, pas un mouvement de marché. Rien ne distingue les deux dans un chiffre publié, et c'est pourquoi nous les traçons.
À chaque mesure, le catalogue réellement proposé est confronté au registre du mois précédent. Tout identifiant nouveau ou disparu écrit un événement daté. Une absence unique ne suffit pas à conclure : elle peut venir d'une panne de fournisseur, et nous attendons un second relevé avant de constater une dépréciation. Déclarer une rupture à tort abîme la série autant qu'en manquer une.
Ce que vous verrez sur une série qui franchit une rupture. Un trait, une note qui nomme le modèle concerné et la date, puis la reprise de la série. Nous ne relions jamais les deux morceaux. Aucune valeur n'est interpolée par-dessus la coupure.
Le recouvrement, quand le budget le permet. Interroger l'ancien et le nouveau modèle en parallèle pendant deux mois permet de situer l'écart entre eux de part et d'autre de la rupture. Cela coûte le prix d'un moteur supplémentaire. Le plafond mensuel de dépense n'est pas négociable : quand il ne suit pas, le recouvrement est refusé, le refus est publié avec l'édition, et la rupture apparaît sans passerelle. Une série honnêtement coupée vaut mieux qu'une série lissée.
Le registre des modèles et l'historique des ruptures sont versionnés avec le code, où chaque changement porte sa date.
Une catégorie du corpus interroge les moteurs sur les alternatives moins chères à des parfums connus.
Nous rapportons ce que les moteurs répondent. Nous n'affirmons jamais nous-mêmes qu'un parfum est la copie d'un autre. Toute publication issue de cette catégorie est formulée comme une observation de la réponse du moteur, jamais comme une assertion de Scentsive.
Scentsive ne vend à aucune marque l'amélioration de son classement. Nous mesurons, nous n'optimisons pas. Toute prestation qui reviendrait à influencer un résultat que nous publions ensuite serait un conflit d'intérêts et un mensonge envers les lecteurs.
Aucune donnée personnelle n'est collectée dans le cadre de la mesure.
Les questions de la prescription modèle transitent par une passerelle européenne offrant résidence des données dans l'Union européenne et absence de rétention.
La conversation communautaire ne conserve que des agrégats par marque et par plateforme : un nombre de publications et un volume d'audience. Aucun message, aucun profil, aucun contenu individuel n'est archivé.
*Droit de réponse et contact méthodologie : marques@hubcatch.com. Toute marque suivie peut demander les données brutes la concernant, signaler une erreur de mesure ou faire publier sa réponse. Nous répondons sous quinze jours.*