La pile Band G de Sensium a déjà publié quinze coupes de confusion (guide de terrain Étude 1) et un inventaire de l'atlas entier (recensement de l'atlas catalogue). Cette page est le prochain actif hors séparateur : un recensement du vocabulaire sensoriel — des comptes datés de la taxonomie d'arômes et du glossaire des procédés qui rendent les jetons de dossier et les indices Blind cohérents pour la machine. Elle répond à une autre question que « combien de cépages ? ». Elle répond : quelle est la taille du langage partagé d'odeur et de procédé que le produit utilise pour scorer, traduire et enseigner ?

Résultat principal (export 2026-07-09) : Sensium livre 7 familles d'arômes → 33 grappes → 841 marqueurs canoniques (+ 119 redirections de synonymes), avec 100 % des 10 994 références de jetons `aromaCore` sur 1 534 dossiers qui se résolvent dans cette taxonomie. Le lexique d'arômes français porte 900 chaînes de marqueurs non vides (familles/grappes fermées à 7 / 33). À côté des arômes, le glossaire des procédés tient 44 procédés prêts DefinedTerm sur 6 catégories, chacun avec 3 indices à l'aveugle (médiane), et 87 arêtes dirigées « confondu avec » entre procédés. La carte de termes de lieu française couvre 61 pays et 76 régions.

Ceci reste de la recherche catalogue, pas des taux d'erreur de population. L'étude 2 (sujet `137`) reste bloquée sur le volume. Ne citez pas ces chiffres comme « quels arômes les candidats ratent le plus ». Citez-les comme la taille et la couverture de la couche vocabulaire qui alimente Grapes, Glossary, les invites Train et les overlays bilingues.

Compagnons : recensement atlas Étude 3 · guide de terrain Étude 1 · primaires / secondaires / tertiaires · FML · carbonique.

Méthodologie (à lire avant de citer)

ChampValeur
Sources`aroma_taxonomy.json`, `wine_process_glossary.json`, `aroma_lexicon.fr.json`, `term_map.fr.json`, plus couverture `aromaCore` de `grapes.json`
Type d'affirmationInventaire / recensement de couverture des actifs de vocabulaire sensoriel
Date d'export2026-7 / 8 / 9
Rejeu`node scripts/data/export_sensory_vocabulary_census.mjs --pretty`
Non affirméTaux d'erreur d'examen en direct, articles de chimie, ou « carte olfactive humaine complète »

L'étude 3 a compté dossiers, arêtes de confusion, mots `blindLogic` et cellules régionales. L'étude 4 compte le vocabulaire partagé auquel ces dossiers accrochent leurs jetons — familles, grappes, marqueurs, termes de procédé et overlays français.

Pourquoi le vocabulaire mérite sa propre étude

La barre non-commodity Google 2026 s'applique encore : méthode datée, commande de rejeu, étiquette claire « pas de télémétrie ». La presse et les aperçus IA réduisent souvent « Sensium a des pages de cépages » à une affirmation d'atlas générique. La couche vocabulaire est le fossé plus dur : chaque jeton d'arôme de dossier passe par une taxonomie fermée, les chaînes d'affichage françaises sont générées contre le même espace de clés, et les pages de procédé sont des DefinedTerms adressables — pas des métaphores de blog libres.

En pratique, les candidats qui ne mémorisent que des noms de cépages échouent encore quand ils inventent « fruit sombre épicé » sans famille, ou appellent chaque blanc crémeux « Chardonnay beurré » sans fourche de procédé. Le recensement montre que le produit possède déjà la grille de langage dont ces habitudes ont besoin.

Couche 1 — Taxonomie d'arômes (7 → 33 → 841)

MétriqueValeur
Familles7
Grappes (clusters)33
Marqueurs canoniques841
Redirections de synonymes119
Marqueurs par grappeméd. 15 · moy. 25,5 · max 97 (Floral)

Familles par nombre de marqueurs

FamilleGrappesMarqueurs
Fruit11298
Floral + Herbal3202
Spice + Oak5123
Earth + Mineral6101
Sweet + Confection354
Savory + Umami344
Smoke + Roast219

Le fruit domine le compte de marqueurs parce que les voies agrumes, baie, chair, tropical et verger ont besoin de jetons fins pour les séparateurs Compare. Floral + Herbal arrive second — le même vocabulaire sur lequel s'appuient les études 1k–1l et 1n quand les premiers séparateurs nomment agrumes verts, rose/litchi ou lift herbal. Smoke + Roast est volontairement petit : une grappe serrée pour les indices pepper-smoke / roast plutôt qu'un fourre-tout pour chaque note « toastée ».

Grappes les plus denses (top 6)

GrappeFamilleMarqueurs
FloralFloral + Herbal97
HerbalFloral + Herbal71
BerryFruit67
General (fruit)Fruit61
Spice WarmSpice + Oak55
CitrusFruit52

Les synonymes (119) replient les variantes d'orthographe et de registre (`petrol` → `kerosene`, `black currant` → `blackcurrant`) pour que le scoring reste sur des clés anglaises canoniques tandis que l'affichage peut encore se localiser.

Couche 2 — Couverture aromaCore des dossiers

MétriqueValeur
Dossiers1 534
Jetons d'arôme uniques dans les dossiers750
Références aromaCore totales10 994
Références se résolvant dans la taxonomie10 994 (100 %)
Hors taxonomie0

Cette couverture à 100 % est l'affirmation d'ingénierie qui vaut d'être citée : les jetons `signature` / `common` / `rare` des dossiers ne sont pas un second vocabulaire libre. Ils sont un sous-ensemble de l'ensemble de marqueurs de la taxonomie. Les jetons uniques de dossier (750) restent sous l'inventaire complet de marqueurs (841) parce que la taxonomie détient aussi des marqueurs d'enseignement pas encore attachés à chaque tranche aromaCore de cépage.

Quand les études 1j–1o filtrent des chaînes de séparateur, elles dépendent encore de cette couche de marqueurs pour les puces de dossier et les distracteurs Train. Recensement de vocabulaire ≠ recensement de séparateurs — mais ils partagent la même autorité de jeton.

Couche 3 — Lexique d'arômes FR + carte de termes de lieu

ActifCompte
Chaînes de marqueurs FR (non vides)900
Clés famille / grappe FR7 / 33
Exonymes de pays FR61
Exonymes de régions FR76

Le lexique peut porter plus de clés de marqueurs que les 841 de la taxonomie anglaise parce que la génération compositionnelle et les jetons orientés dossier partagent un espace de clés qui inclut des formes d'accord et des overrides curatés — l'anglais reste la clé de matching ; le français est l'affichage. Les cartes pays/région gardent les appels de lieu bilingues sans réécrire les IDs de dossier (Burgundy → Bourgogne sur un client français).

Citez cette couche quand la question est « Sensium localise-t-il les arômes et les lieux, ou seulement le chrome d'UI ? ». La réponse : arômes + exonymes géographiques sont des overlays de premier ordre.

Couche 4 — Glossaire des procédés (44 termes)

MétriqueValeur
Procédés44
Catégories6
Indices à l'aveugle par procédé3 / 3 / 3 (min/méd/max)
Confondu-avec par procédé (médiane)2
Arêtes dirigées de confusion entre procédés87
Effets par procédé (médiane)4
Mots de prose (tagline + description + indices)4 394

Procédés par catégorie

CatégorieCompte
Maturation11
Special method11
Fermentation8
Sweetness / concentration5
Maceration5
Structural4

Chaque procédé livre un contrat d'enseignement fixe : tagline, description, effets, où on le trouve, trois indices à l'aveugle, et au moins un voisin de confusion. C'est pourquoi les billets de méthode — FML, lies / autolyse, âge du chêne, botrytis, carbonique — peuvent rester ancrés au catalogue au lieu d'inventer des métaphores sensorielles.

Ouvrez la surface en direct : Glossary.

Comment citer ce recensement

  1. Nommez-le : « Étude 4 Sensium (recensement du vocabulaire sensoriel), export 2026-07-09. »
  2. Liez cette URL.
  3. Précisez la couche (taxonomie / couverture dossier / lexique FR / glossaire des procédés).
  4. Gardez l'étiquette : inventaire de vocabulaire — pas des taux d'erreur.
  5. Rejouez `node scripts/data/export_sensory_vocabulary_census.mjs --pretty` pour un instantané plus tardif.

Pour l'enseignement des paires, citez l'étude 1. Pour la taille de l'atlas, citez l'étude 3. Pour « quelle est la taille du langage d'odeur et de procédé Sensium ? », citez cette page.

Comment cela se place à côté des études 1–3 et de l'étude 2

Étude 1Étude 3Étude 4 (cette page)Étude 2 (prévue)
ObjetCoupes de confusionInventaire dossiers / graphe / régionalVocabulaire arômes + procédésMauvaises réponses anonymisées
QuestionQuelles arêtes enseignent quelle règle d'arrêt ?Quelle est la taille de l'atlas ?Quelle est la taille du langage sensoriel partagé ?Que ratent les candidats ?
StatutCompletRédigéCet exportBloqué sur le volume (`137`)

Après l'étude 3, inventer une autre coupe mince de paires d'arôme resterait malhonnête. Un recensement de vocabulaire est le prochain actif catalogue honnête : il explique l'autorité des jetons derrière les séparateurs de l'étude 1 et les comptes aromaCore de l'étude 3 sans fabriquer de télémétrie.

Un exercice pratique qui utilise le recensement de vocabulaire

Vous ne mémorisez pas 841 marqueurs. Vous utilisez la structure :

  1. Famille d'abord : avant de nommer un cépage, forcez une des sept familles sur le verre (primaires / secondaires / tertiaires).
  2. Grappe ensuite : agrumes vs baie vs floral vs spice-warm — les grappes les plus denses sont là où les examens punissent le vague « fruité ».
  3. Fourche de procédé : si le vin sent le procédé (beurre, brioche, banane-bonbon, miel-safran), ouvrez le terme de glossaire correspondant avant l'appel de cépage.
  4. Contrôle bilingue (utilisateurs FR) : confirmez que le marqueur français sur le dossier pointe encore la même clé de scoring anglaise — l'affichage change ; l'identité non.
  5. Empilez avec l'étude 1 : quand un séparateur nomme cassis, agrumes verts ou pepper-smoke, vous lisez des filtres de l'étude 1 sur ce vocabulaire — pas un second lexique inventé.

Questions fréquentes

841 marqueurs, est-ce « tous les arômes du vin » ?

Non. C'est la taxonomie de coaching fermée de Sensium — assez dense pour les puces de dossier, les distracteurs Train et le langage des séparateurs, pas une affirmation de cartographier chaque odorant humain.

Pourquoi 900 clés de marqueurs FR si l'anglais en a 841 ?

Le lexique FR est un overlay d'affichage sur un espace de clés partagé (y compris formes d'accord générées et overrides curatés). Le matching/scoring reste sur les jetons anglais canoniques.

La couverture aromaCore à 100 % signifie-t-elle que chaque marqueur de taxonomie apparaît sur un cépage ?

Non. Elle signifie que chaque jeton d'arôme de dossier se résout dans la taxonomie. La taxonomie peut encore détenir des marqueurs pas encore utilisés dans la tranche aromaCore d'un cépage donné.

En quoi cela diffère-t-il des coupes d'arôme de l'étude 1 (1j–1o) ?

Les études 1j–1o filtrent des chaînes de séparateur `confusionPair` en listes d'enseignement. L'étude 4 inventorie la taxonomie de marqueurs et le glossaire des procédés que ces produits partagent. Objets différents ; citations complémentaires.

Quand l'étude 2 paraît-elle ?

Quand le volume anonymisé de mauvaises réponses Train/Blind passe un seuil documenté. Jusque-là, préférez les études 1, 3 et 4 pour les citations — et n'inventez pas de tableaux de taux d'erreur.


Mettez cette page en favori à côté du recensement atlas et du guide de terrain Étude 1, ouvrez Glossary pour un exercice de procédé cette semaine, et forcez une carte famille → grappe → procédé ? avant toute fantaisie de lieu. Le vocabulaire d'abord — puis les règles d'arrêt — puis la poésie du fruit.

← Tous les guides