La pila Band G de Sensium ya publicó quince cortes de confusión (guía de campo Estudio 1) y un inventario de atlas completo (censo del atlas de catálogo). Esta página es el siguiente activo fuera de separadores: un censo de vocabulario sensorial — recuentos fechados de la taxonomía de aromas y el glosario de procesos que hacen que los tokens de dossier y los indicios de Cata a ciegas sean consistentes para la máquina. Responde a una pregunta distinta de «¿cuántas variedades?». Responde: ¿de qué tamaño es el lenguaje compartido de olor y proceso que el producto usa para puntuar, traducir y enseñar?

Titular (exportación 2026-07-09): Sensium entrega 7 familias de aroma → 33 clústeres → 841 marcadores canónicos (+ 119 redirecciones de sinónimo), con el 100 % de las 10.994 referencias de token `aromaCore` a lo largo de 1.534 dossiers resolviendo en esa taxonomía. El léxico francés de aromas porta 900 cadenas de marcador no vacías (familias/clústeres cerrados a 7 / 33). Junto a los aromas, el glosario de procesos sostiene 44 procesos listos para DefinedTerm a lo largo de 6 categorías, cada uno con 3 indicios a ciegas (mediana), y 87 aristas dirigidas de proceso «confundido con». El mapa de términos de lugar francés cubre 61 países y 76 regiones.

Esto sigue siendo investigación de catálogo, no tasas de error de población. El Estudio 2 (tema `137`) sigue condicionado al volumen. No cite estos recuentos como «qué aromas fallan más los candidatos». Cítelos como el tamaño y la cobertura de la capa de vocabulario que alimenta Variedades, Glosario, los prompts de Entrenar y las superposiciones bilingües.

Compañeros: censo del atlas Estudio 3 · guía de campo Estudio 1 · primarios / secundarios / terciarios · FML · carbónica.

Metodología (léala antes de citar)

CampoValor
Fuentes`aroma_taxonomy.json`, `wine_process_glossary.json`, `aroma_lexicon.fr.json`, `term_map.fr.json`, más cobertura `aromaCore` de `grapes.json`
Tipo de afirmaciónInventario / censo de cobertura de activos de vocabulario sensorial
Fecha de exportación2026-7 / 8 / 9
Reejecución`node scripts/data/export_sensory_vocabulary_census.mjs --pretty`
No se afirmaTasas de error de examen en vivo, artículos de química, ni «mapa olfativo humano completo»

El Estudio 3 contó dossiers, aristas de confusión, palabras `blindLogic` y celdas regionales. El Estudio 4 cuenta el vocabulario compartido del que cuelgan los tokens de esos dossiers — familias, clústeres, marcadores, términos de proceso y superposiciones francesas.

Por qué el vocabulario merece su propio estudio

El listón no commodity de Google 2026 sigue aplicando: método fechado, comando de reejecución, etiqueta clara de «no es telemetría». La prensa y las visiones generales de IA a menudo colapsan «Sensium tiene páginas de variedades» en una afirmación genérica de atlas. La capa de vocabulario es el foso más duro: cada token de aroma de dossier se fuerza a través de una taxonomía cerrada, las cadenas de visualización francesas se generan contra ese mismo espacio de claves, y las páginas de proceso son DefinedTerms direccionables — no metáforas sueltas de blog.

En la práctica, los candidatos que solo memorizan nombres de variedades siguen fallando cuando inventan «fruta oscura especiada» sin una familia, o llaman a cada blanco cremoso «Chardonnay mantecoso» sin una bifurcación de proceso. El censo muestra que el producto ya posee la cuadrícula de lenguaje que esos hábitos necesitan.

Capa 1 — Taxonomía de aromas (7 → 33 → 841)

MétricaValor
Familias7
Clústeres33
Marcadores canónicos841
Redirecciones de sinónimo119
Marcadores por clústermed 15 · media 25,5 · máx. 97 (Floral)

Familias por recuento de marcadores

FamiliaClústeresMarcadores
Fruit11298
Floral + Herbal3202
Spice + Oak5123
Earth + Mineral6101
Sweet + Confection354
Savory + Umami344
Smoke + Roast219

La fruta domina el recuento de marcadores porque los carriles de cítricos, baya, hueso, tropical y huerto necesitan tokens finos para los separadores de Comparar. Floral + Herbal es segunda — el mismo vocabulario en el que se apoyan los Estudios 1k–1l y 1n cuando los primeros separadores nombran cítrico verde, rosa/lichi o alzado herbáceo. Smoke + Roast es intencionalmente pequeña: un clúster apretado para indicios de pimienta-humo / tostado más que un vertedero de cada nota «tostada».

Clústeres más densos (top 6)

ClústerFamiliaMarcadores
FloralFloral + Herbal97
HerbalFloral + Herbal71
BerryFruit67
General (fruit)Fruit61
Spice WarmSpice + Oak55
CitrusFruit52

Los sinónimos (119) colapsan variantes de ortografía y registro (`petrol` → `kerosene`, `black currant` → `blackcurrant`) para que la puntuación se quede en claves canónicas inglesas mientras la visualización puede seguir localizándose.

Capa 2 — Cobertura aromaCore de dossiers

MétricaValor
Dossiers1.534
Tokens de aroma únicos en dossiers750
Referencias aromaCore totales10.994
Referencias que resuelven en la taxonomía10.994 (100 %)
Fuera de la taxonomía0

Esa cobertura del 100 % es la afirmación de ingeniería que merece citarse: los tokens `signature` / `common` / `rare` de dossier no son un segundo vocabulario libre. Son un subconjunto del conjunto de marcadores de la taxonomía. Los tokens únicos de dossier (750) se sientan bajo el inventario completo de marcadores (841) porque la taxonomía también sostiene marcadores de enseñanza aún no atados a la rebanada aromaCore de cada variedad.

Cuando los Estudios 1j–1o filtran cadenas de separador, siguen dependiendo de esta capa de marcadores para las fichas de dossier y los distractores de Entrenar. Censo de vocabulario ≠ censo de separadores — pero comparten la misma autoridad de token.

Capa 3 — Léxico francés de aromas + mapa de términos de lugar

ActivoRecuento
Cadenas de marcador FR (no vacías)900
Claves de familia / clúster FR7 / 33
Exónimos de país FR61
Exónimos de región FR76

El léxico puede portar más claves de marcador que los 841 de la taxonomía inglesa porque la generación composicional y los tokens orientados a dossier comparten un espacio de claves que incluye formas de concordancia y anulaciones curadas — el inglés sigue siendo la clave de emparejamiento; el francés es visualización. Los mapas de términos de país/región mantienen las identificaciones de lugar bilingües sin reescribir los IDs de dossier (Borgoña → Bourgogne en un cliente francés).

Cite esta capa cuando la pregunta sea «¿Sensium localiza aromas y lugares, o solo el cromado de la UI?». La respuesta es: aromas + exónimos geográficos son superposiciones de primera clase.

Capa 4 — Glosario de procesos (44 términos)

MétricaValor
Procesos44
Categorías6
Indicios a ciegas por proceso3 / 3 / 3 (mín./med/máx.)
Confundido-con por proceso (mediana)2
Aristas dirigidas de confusión de proceso87
Efectos por proceso (mediana)4
Palabras de prosa (eslogan + descripción + indicios)4.394

Procesos por categoría

CategoríaRecuento
Maturation11
Special method11
Fermentation8
Sweetness / concentration5
Maceration5
Structural4

Cada proceso entrega un contrato de enseñanza fijo: eslogan, descripción, efectos, dónde se encuentra, tres indicios a ciegas y al menos un vecino de confusión. Por eso los artículos de método — FML, lías / autólisis, edad del roble, botrytis, carbónica — pueden quedarse anclados al catálogo en lugar de inventar metáforas sensoriales.

Abra la superficie en vivo: Glosario.

Cómo citar este censo

  1. Nómbrelo: «Estudio 4 Sensium (censo de vocabulario sensorial), exportación 2026-07-09.»
  2. Enlace esta URL.
  3. Especifique la capa (taxonomía / cobertura de dossier / léxico FR / glosario de procesos).
  4. Conserve la etiqueta: inventario de vocabulario — no tasas de error.
  5. Reejecute `node scripts/data/export_sensory_vocabulary_census.mjs --pretty` para una instantánea posterior.

Para enseñanza de pares, cite el Estudio 1. Para tamaño del atlas, cite el Estudio 3. Para «¿de qué tamaño es el lenguaje de olor y proceso de Sensium?», cite esta página.

Cómo se sitúa junto a los Estudios 1–3 y al Estudio 2

Estudio 1Estudio 3Estudio 4 (esta página)Estudio 2 (previsto)
ObjetoCortes de confusiónInventario de dossier / grafo / regionalVocabulario de aroma + procesoRespuestas erróneas anonimizadas
Pregunta¿Qué aristas enseñan qué regla de parada?¿De qué tamaño es el atlas?¿De qué tamaño es el lenguaje sensorial compartido?¿Qué fallan los candidatos?
EstadoCompletoRedactadoEsta exportaciónCondicionado al volumen (`137`)

Después del Estudio 3, inventar otro corte delgado de pares de aroma seguiría siendo deshonesto. Un censo de vocabulario es el siguiente activo de catálogo honesto: explica la autoridad de token detrás de los separadores del Estudio 1 y los recuentos aromaCore del Estudio 3 sin fabricar telemetría.

Un ensayo práctico que usa el censo de vocabulario

Usted no memoriza 841 marcadores. Usa la estructura:

  1. Familia primero: antes de nombrar una variedad, fuerce una de las siete familias en la copa (primarios / secundarios / terciarios).
  2. Clúster segundo: cítricos frente a baya frente a floral frente a especia cálida — los clústeres más densos son donde los exámenes castigan un «afrutado» vago.
  3. Bifurcación de proceso: si el vino huele a proceso (mantequilla, brioche, caramelo de plátano, miel-azafrán), abra el término de glosario coincidente antes de la identificación de variedad.
  4. Comprobación bilingüe (usuarios FR): confirme que el marcador francés del dossier sigue apuntando a la misma clave de puntuación inglesa — la visualización cambia; la identidad no.
  5. Apile con el Estudio 1: cuando un separador nombra casis, cítrico verde o pimienta-humo, está leyendo filtros del Estudio 1 sobre este vocabulario — no un segundo léxico inventado.

Preguntas frecuentes

¿Son 841 marcadores «todos los aromas del vino»?

No. Es la taxonomía de coaching cerrada de Sensium — lo bastante densa para fichas de dossier, distractores de Entrenar y lenguaje de separador, no una afirmación de mapear cada odorante humano.

¿Por qué 900 claves de marcador francesas si el inglés tiene 841?

El léxico FR es una superposición de visualización sobre un espacio de claves compartido (incluidas formas de concordancia generadas y anulaciones curadas). El emparejamiento/puntuación se queda en tokens canónicos ingleses.

¿La cobertura aromaCore del 100 % significa que cada marcador de la taxonomía aparece en una variedad?

No. Significa que cada token de aroma de dossier resuelve en la taxonomía. La taxonomía puede seguir sosteniendo marcadores aún no usados en la rebanada aromaCore de una variedad dada.

¿En qué se diferencia esto de los cortes de aroma del Estudio 1 (1j–1o)?

Los Estudios 1j–1o filtran cadenas de separador confusionPair en listas de enseñanza. El Estudio 4 hace inventario de la taxonomía de marcadores y el glosario de procesos que esos productos comparten. Objetos distintos; citas complementarias.

¿Cuándo se publica el Estudio 2?

Cuando el volumen anonimizado de respuestas erróneas de Entrenar/Cata a ciegas supere un umbral documentado. Hasta entonces, prefiera los Estudios 1, 3 y 4 para las citas — y no invente tablas de tasas de error.


Marque esta página junto al censo del atlas y la guía de campo Estudio 1, abra Glosario para un ensayo de proceso esta semana, y fuerce una ficha familia → clúster → ¿proceso? antes de cualquier fantasía de lugar. El vocabulario primero — luego las reglas de parada — luego la poesía de la fruta.

← Todas las guías