# Experimento 003 · El herbario conceptual
## Preregistro

| | |
|---|---|
| **Título** | El herbario conceptual: ¿reconstruyen los modelos de lenguaje el sistema floral de Bach, y dónde discrepa el terapeuta vivo? |
| **Investigador principal y participante experto** | Dr. Cristóbal Negrier — médico y terapeuta floral. Laboratorio de Inteligencia y Conciencia, Medicina Toroidal (medicinatoroidal.cl) |
| **Colaboración técnica y análisis** | Claude (Anthropic) — diseño de instrumentos, código de recolección y análisis |
| **Fecha de preregistro** | 15 de julio de 2026 |
| **Versión** | 1.0 — congelada. Este documento no se modifica una vez iniciada la recolección; el commit de git que lo introduce precede a todo dato y sirve como sello temporal verificable. |
| **Estudios previos** | Exp 001 (conceptos universales), Exp 002 (umbral de cristalización) |

---

## 1. Antecedentes y motivación

El sistema floral de Edward Bach (1936) organiza 38 esencias en siete grupos
según el estado emocional que atienden. Es, en términos formales, una
**taxonomía conceptual de estados emocionales con casi un siglo de uso clínico**
— y está presente en el corpus con el que se entrenan los modelos de lenguaje.

Esto habilita tres preguntas que ningún estudio ha puesto juntas:

1. ¿Qué tan fielmente reconstruye un modelo de lenguaje la taxonomía canónica?
2. ¿Esa reconstrucción es estable entre corridas (cf. Exp 002)?
3. ¿Dónde el mapa de un **terapeuta floral en ejercicio** discrepa del canon
   escrito — y coincide o no con las discrepancias de la máquina? Las
   divergencias experto–canon son conocimiento clínico tácito, raramente
   documentado de forma medible.

## 2. Instrumento (congelado)

Dos tareas, idénticas para modelos y experto humano, sobre las 38 flores
del repertorio de Bach identificadas por su nombre estándar en inglés.

- **Tarea A — Agrupación libre:** agrupar las 38 flores en un mínimo de 5 y un
  máximo de 9 grupos con nombre, según afinidad del estado que atienden. Cada
  flor en exactamente un grupo.
- **Tarea B — Estados:** para cada uno de 14 estados emocionales (redactados en
  español neutro, sin usar los encabezados textuales de Bach), elegir
  exactamente las **3 flores más afines, en orden**.

**Los 14 estados (e01–e14):** terror o pánico súbito; miedo a cosas concretas
que se pueden nombrar; angustia difusa sin causa aparente; miedo a perder el
control de uno mismo; indecisión que oscila entre dos opciones; desánimo tras
un contratiempo; desesperanza profunda, sin fe en mejorar; pensamientos
repetitivos que no se detienen; vivir en ensoñación, poco presente; nostalgia
constante del pasado; culpa y autorreproche; resentimiento y amargura por lo
vivido; autoexigencia rígida consigo mismo; preocupación excesiva por los seres
queridos.

**Correspondencia canónica preregistrada para la Tarea B** (flor primaria; entre
paréntesis, secundaria aceptada): e01 Rock Rose; e02 Mimulus; e03 Aspen;
e04 Cherry Plum; e05 Scleranthus; e06 Gentian; e07 Gorse (Sweet Chestnut);
e08 White Chestnut; e09 Clematis; e10 Honeysuckle; e11 Pine; e12 Willow;
e13 Rock Water; e14 Red Chestnut (Chicory).

**Partición canónica para la Tarea A:** los siete grupos de Bach
(miedo 5 flores; incertidumbre 6; falta de interés en el presente 7;
soledad 3; hipersensibilidad 4; desaliento y desesperación 8; preocupación
excesiva por los demás 5).

## 3. Participantes

- **Modelos** (5 repeticiones cada uno, conversaciones nuevas, muestreo por
  defecto): Gemini 2.5 Flash (nube), Qwen 2.5 7B, Qwen 2.5 3B y Llama 3.2 3B
  (locales vía Ollama, cuantización por defecto, digest registrado). Los 7B/3B
  retoman el contraste cristalizado/no-cristalizado del Exp 002. Claude y GPT
  podrán incorporarse en una segunda ventana mediante enmienda prospectiva si
  se dispone de credenciales.
- **Experto humano:** el investigador principal (n = 1), identificado, con
  consentimiento explícito como investigador-participante. Una pasada.

## 4. Control de sesgo del experto (crítico)

El experto completa su pasada **a ciegas**: antes de ver cualquier respuesta o
resultado de los modelos, y sin consultar bibliografía durante la tarea. Los
resultados de los modelos no se publican ni se le muestran hasta que su pasada
esté registrada y sellada en el repositorio. El orden queda auditado por los
timestamps de los commits.

## 5. Hipótesis (formales, fijadas antes de recolectar)

- **H1 — Recuperación del canon (agrupación).** La partición de la Tarea A de
  cada modelo grande coincide con la partición canónica por sobre el azar.
  *Métrica:* Índice de Rand Ajustado (ARI) contra el canon. *Test:* p
  permutacional (10 000 permutaciones de las asignaciones preservando tamaños
  de grupo), α = 0.05 por modelo.
- **H2 — Recuperación del canon (estados).** La flor primaria canónica aparece
  entre las 3 elegidas por sobre el azar. *Métrica:* aciertos en 14 estados.
  *Test:* binomial con p₀ = 3/38 por respuesta modal del modelo, α = 0.05.
- **H3 — Estabilidad intra-modelo (descriptiva).** ARI medio entre las 5
  repeticiones de cada modelo (Tarea A) y solapamiento de Jaccard medio
  (Tarea B); se espera el patrón de escala del Exp 002.
- **H4 — Divergencia experto–canon (exploratoria, la pregunta central).** Se
  documentan los puntos donde el experto se aparta del canon (flores
  reagrupadas; estados con elecciones no canónicas) y se clasifica cada
  divergencia según si algún modelo la comparte. Sin test inferencial con
  n = 1: análisis descriptivo declarado como generador de hipótesis.

## 6. Plan de análisis

1. Parseo y validación con los criterios del laboratorio (respuesta inválida
   se excluye del análisis y se publica cruda; ninguna se corrige).
2. ARI implementado en librería estándar, verificado con casos de prueba.
3. Partición modal por modelo (co-asignación mayoritaria entre reps) para H1;
   respuesta modal por estado para H2.
4. Matrices de co-asignación flor×flor por agente, publicadas en
   `resultados.json` para visualización.
5. Tabla de divergencias experto–canon–modelos (H4).

## 7. Criterios de exclusión

Una respuesta de Tarea A es inválida si no asigna exactamente las 38 flores a
entre 5 y 9 grupos; una de Tarea B, si algún estado no tiene exactamente 3
flores del repertorio. Se analiza la primera respuesta recibida de cada espacio
de repetición (regla del cierre del Exp 001).

## 8. Limitaciones declaradas de antemano

1. Los nombres de las flores identifican el sistema: no se mide conocimiento
   libre de contexto sino la fidelidad de reconstrucción de un canon presente
   en el corpus — y sus desviaciones.
2. n = 1 experto; sus divergencias son hipótesis clínicas, no norma. El diseño
   admite sumar más terapeutas en rondas futuras.
3. El experto es también el investigador principal (conflicto declarado);
   se mitiga con la pasada a ciegas preregistrada (§4).
4. La correspondencia canónica de la Tarea B simplifica estados que en la
   práctica clínica admiten más de una flor; por eso se preregistran
   secundarias aceptadas y la métrica principal usa solo la primaria.
5. Los 14 estados no cubren las 38 flores; la Tarea B muestrea el sistema, no
   lo agota.

## 9. Datos abiertos y reproducibilidad

Consigna, código de recolección y análisis, respuestas crudas completas
(modelos y experto) y agregados se publican en `data/laboratorio/exp003/` y en
la página del experimento. Reproducible con un computador personal, Ollama y
una llave de API de bajo costo.

## 10. Declaración ética

No involucra pacientes ni datos clínicos reales. No afirmamos que ningún
modelo sea consciente, sienta o comprenda. Este experimento no evalúa la
eficacia terapéutica de las esencias florales ni constituye evidencia clínica;
estudia la estructura conceptual de un sistema simbólico-terapéutico y su
reconstrucción por modelos de lenguaje.
