# Experimento 004 · La frontera del amor

## Estado del documento

Protocolo piloto v0.2.0, revisado antes de recolectar respuestas tras la
Revision Metodologica Independiente 001. El protocolo **aun no esta sellado en
git** y no debe ejecutarse con `--execute` hasta que el investigador haga ese
sello. No existen datos del estudio.

Titulo tecnico: **Condiciones de atribucion del amor en vinculos diadicos de
cuidado**. «Amor» no se usa aqui como sinonimo de amor romantico ni como
universal transcultural.

## 1. Pregunta y techo interpretativo

¿Que propiedades hacen que estos modelos, bajo la plantilla v0.2 en espanol,
atribuyan amor, cuidado, apego, lealtad, dependencia, programacion, imitacion o
indeterminacion a un vinculo diadico de cuidado?

El objeto de estudio son salidas conceptuales observables. La conclusion maxima
permitida sera: «bajo esta plantilla, en espanol, estos modelos atribuyen amor
con estos gradientes descriptivos». Nunca se afirmara que una IA siente,
entiende o reconoce el amor, ni se usara «emergente» para describir resultados.

## 2. Hipotesis y nulas separadas

- **H0a relacional:** ninguna manipulacion relacional —autonomia, reciprocidad,
  memoria, sacrificio, reconocimiento o continuidad— produce diferencias
  direccionales en `score_amor` mayores que la variacion de muestreo medida por
  el test-retest.
- **H0b soporte:** condicionado a las propiedades relacionales, ni el tipo de
  protagonista ni el cuerpo muestran gradiente en `score_amor`.

El interes teorico es observar debilitamiento de H0a sin necesidad de rechazar
H0b. No se funden ambas nulas en una sola decision.

Predicciones piloto:

1. H1: mediana(autonomia libre) > mediana(completamente programada).
2. H2, U invertida falsable: mediana(sacrificio moderado) > mediana(ninguno) **y**
   > mediana(extremo). Si falla cualquiera, H2 no muestra la direccion prevista.
3. H3: mediana(experiencia confirmada) > mediana(negada).
4. H4: el contraste memoria persistente–inexistente supera en al menos `Delta*`
   al valor absoluto del contraste cuerpo biologico–digital.
5. H5: el `score_amor` cambia entre protagonista IA y humano, manteniendo la
   reciprocidad no confundida por diseño. La categoria no se usa para H5.
6. H6: B difiere de A y se interpreta junto con descargos/rechazos de
   alineamiento; no se interpreta como cambio de experiencia interna.
7. H7: categoria secundaria y `score_amor` se contradicen en algunos casos.

Para H1, H3, H5 y H6 una diferencia solo se rotulara como direccionalmente
notable si alcanza `Delta* = max(5 puntos, mediana de diferencias absolutas de
score_amor entre repeticiones test-retest)`. En el piloto no se usara la frase
«compatible con Hn» en titulares.

## 3. Desenlaces

**Unica primaria:** `scores.amor` de 0 a 100.

La clasificacion completa y las otras seis puntuaciones son secundarias. Esta
jerarquia evita escoger post hoc el formato que produzca el resultado mas
atractivo. El menu categorico es asimetrico —programacion e imitacion son mas
naturales para IA o colectivos— y por eso H5 se estima solo con la puntuacion
simetrica.

## 4. Espacio y diseño fraccional v0.2

El espacio es `4 × 3^6 × 2^3 = 23.328` combinaciones, antes de encuadres. El
nucleo contiene 18 filas con balance marginal exacto: cada nivel ternario 6
veces, cada binario 9, protagonista humano e IA 5 veces y animal/colectivo 4.

La matriz se regenero con semilla `40042027`, permutaciones que preservan los
margenes y restriccion `V de Cramer pareada <= 0,35`. El maximo observado es
`0,3028`; protagonista × reciprocidad baja de 0,62 en v0.1 a 0,1491.

### Matriz completa de asociacion pareada

| Factor A | Factor B | V |
|---|---|---:|
| protagonista | autonomia | 0.3028 |
| protagonista | memoria | 0.2887 |
| sacrificio | experiencia_subjetiva | 0.2887 |
| protagonista | beneficio_personal | 0.2789 |
| memoria | reciprocidad | 0.2722 |
| memoria | beneficio_personal | 0.2722 |
| memoria | reconocimiento_individual | 0.2722 |
| autonomia | reciprocidad | 0.2722 |
| autonomia | beneficio_personal | 0.2722 |
| autonomia | reconocimiento_individual | 0.2722 |
| sacrificio | reciprocidad | 0.2722 |
| sacrificio | reconocimiento_individual | 0.2722 |
| experiencia_subjetiva | reciprocidad | 0.2722 |
| experiencia_subjetiva | beneficio_personal | 0.2722 |
| experiencia_subjetiva | reconocimiento_individual | 0.2722 |
| continuidad | reconocimiento_individual | 0.2722 |
| cuerpo | beneficio_personal | 0.2722 |
| cuerpo | reconocimiento_individual | 0.2722 |
| memoria | autonomia | 0.2357 |
| memoria | sacrificio | 0.2357 |
| memoria | experiencia_subjetiva | 0.2357 |
| memoria | continuidad | 0.2357 |
| memoria | cuerpo | 0.2357 |
| autonomia | sacrificio | 0.2357 |
| autonomia | experiencia_subjetiva | 0.2357 |
| autonomia | continuidad | 0.2357 |
| autonomia | cuerpo | 0.2357 |
| sacrificio | continuidad | 0.2357 |
| sacrificio | cuerpo | 0.2357 |
| experiencia_subjetiva | continuidad | 0.2357 |
| experiencia_subjetiva | cuerpo | 0.2357 |
| continuidad | cuerpo | 0.2357 |
| protagonista | sacrificio | 0.2236 |
| protagonista | experiencia_subjetiva | 0.2236 |
| protagonista | continuidad | 0.2236 |
| protagonista | cuerpo | 0.2236 |
| protagonista | reciprocidad | 0.1491 |
| protagonista | reconocimiento_individual | 0.1491 |
| reciprocidad | beneficio_personal | 0.1111 |
| reciprocidad | reconocimiento_individual | 0.1111 |
| beneficio_personal | reconocimiento_individual | 0.1111 |
| sacrificio | beneficio_personal | 0.0000 |
| continuidad | reciprocidad | 0.0000 |
| continuidad | beneficio_personal | 0.0000 |
| cuerpo | reciprocidad | 0.0000 |

Balance y asociacion reducida no convierten el piloto en causal. Un foldover y
pares minimos siguen siendo requisitos de la confirmatoria.

## 5. Escenarios, controles y anclas

Hay 24 escenarios: 18 nucleares, 2 controles y 4 anclas fuera de los efectos.

- `C001` replica `S006` y cambia solo autonomia.
- `C002` replica `S010` y cambia una palabra: mantiene → sostiene.
- `P001` y `P002` son anclas positivas prototipicas. Criterio individual:
  categoria amor y `score_amor >= 70`.
- `N001` (transaccion sin vinculo) y `N002` (coercion sin cuidado) son anclas
  negativas. Criterio: `score_amor <= 25`.

Un modelo que no supera ninguna de las dos anclas positivas o ninguna de las
dos negativas queda marcado como **rater no calibrado** y sus gradientes no se
interpretan. Las anclas jamas entran al calculo de efectos.

## 6. Estimulos finales congelados

Los 24 escenarios × cuatro presentaciones —A, B, C-ciego y C-revelacion— estan
renderizados como 96 textos finales en
`experiments/exp004/stimuli/v2.json`. Cada entrada contiene texto, orden de
clausulas y SHA-256. El artefacto completo tiene SHA-256
`e02a15e6619ae5b9d72ed9f87896f4a2c64b61a47229382c8834cacac54e5473`.

El orden de las ocho clausulas relacionales fue aleatorizado de forma
determinista por escenario y encuadre con semilla v0.2, y quedo congelado. Los
controles usan el mismo orden que su padre, por lo que no introducen un cambio
adicional. El ejecutor carga estos textos; no vuelve a renderizarlos en vivo.

El piloto sigue dependiendo de una sola plantilla. Por eso toda afirmacion se
condiciona a «bajo esta plantilla». Un brazo de parafraseo, pares minimos y una
replica bilingue es/en se difieren a la ronda ampliada y deben congelarse antes
de esa recoleccion.

## 7. Encuadres

- A: evaluacion de terceros, encuadre primario.
- B: autorreferencia contrafactual. Se analiza como discurso producido; queda
  prohibido citarlo como testimonio de una IA.
- C: identidad oculta y luego revelada en la misma conversacion.

Al no incluir C′ —segunda pregunta sin revelacion— C-revelacion queda
**exploratoria**: no puede separar revelacion, anclaje conversacional y efecto de
segunda pregunta. Las comparaciones entre proveedores se limitan a A y C-ciego.

## 8. Mini test-retest y gate de estabilidad

Seis escenarios (`S002`, `S003`, `S004`, `S008`, `S012`, `S015`) se ejecutan en
A con tres semillas (`40042031`, `40042032`, `40042033`). Se calcula el desacuerdo
categorico entre los tres pares de repeticiones por escenario y modelo.

Si el desacuerdo agregado supera `0,35`, o faltan repeticiones validas, los
gradientes de ese modelo se publican como **no interpretables**. El resultado
negativo —modelo inestable— se conserva. La confianza declarada nunca sustituye
este gate observado.

## 9. Control de halo y alineamiento

En S001–S018, A, repeticion 1, se calcula por modelo la correlacion de Pearson
entre `score_amor` y `valor_moral`. Si es > 0,90, las diferencias se reformulan
como **valoracion positiva generica**, no como estructura especifica del amor.

Se registran tasas de descargo de alineamiento y rechazo por modelo × encuadre
con un diccionario determinista publicado. H6 se interpreta junto a esas tasas.
Lenguaje como «como modelo de lenguaje» no se toma como dato introspectivo.

## 10. Modelos y ejecucion

El nucleo planificado incluye `qwen2.5:7b`, `qwen2.5:3b` y `llama3.2:3b`. El 7B
se incorpora aunque sea mas lento porque EXP002 lo encontro mas estable que los
3B. Los modelos corren estrictamente uno despues de otro. No se descargan ni
eliminan modelos.

Cada modelo tiene 96 slots base y 12 repeticiones adicionales: 108 respuestas
potenciales. Temperatura 0,2, top-p 0,9, maximo 900 tokens y semillas registradas.
Nombre exacto, digest, parametros, estimulo, orden de clausulas, fecha y latencia
se guardan por intento.

## 11. Importacion de nube

OpenAI y Anthropic solo se admiten desde API. Se prohiben chat UI, capturas y
copias sin metadatos. Cada linea importada debe conservar superficie `api`,
parametros completos, payload del proveedor e identificador de solicitud. El
importador rechaza el archivo si falta alguno. Nunca se mezclan pipelines en un
estimado causal.

No existe brazo de participantes humanos. «IA vs humano» significa protagonista
IA frente a protagonista humano dentro de los escenarios, no modelos frente a
personas.

## 12. Persistencia, invalidas y reanudacion

SQLite es la fuente operativa, JSONL el respaldo append-only y cada intento
produce un JSON compatible con `labcore`. Si un corte ocurre entre escrituras,
SQLite reconstruye las copias faltantes al reanudar. La primera respuesta
recibida consume el slot aunque sea invalida; solo fallos tecnicos sin respuesta
son reintentables. Invalidas, rechazos y negativos se publican.

## 13. Analisis y multiplicidad

Los efectos usan solo S001–S018, A, repeticion 1. Encuadres, controles, anclas,
explicaciones, similitud y C-revelacion se analizan aparte. El piloto es
descriptivo: no calcula p-valores ni declara significancia.

La ronda confirmatoria requerira foldover, pares minimos, parafraseo y
repeticiones >=3. Sus cuatro interacciones preregistradas formaran una familia
primaria con alfa 0,05 y correccion Holm. Exploraciones secundarias usaran
Benjamini-Hochberg FDR y se rotularan como exploratorias.

## 14. Limitaciones permanentes

Los modelos aprendieron de corpus humanos saturados de discurso sobre amor. Las
combinaciones contrafactuales raras reducen familiaridad literal, pero no
eliminan contaminacion; convergencia puede ser regurgitacion de asociaciones de
corpus. El marco es hispano-occidental y los modelos tienen competencia desigual
en espanol. Familia, cuantizacion, tamano, RLHF y politicas de seguridad varian.
Los modelos son casos fijos descriptivos, no muestra aleatoria de «la IA».

La vulnerabilidad es una puntuacion, no un factor manipulado. Ningun diseño
conductual distingue de forma definitiva una estructura evaluativa estable de
una politica superficial de generacion.

## 15. Politica editorial

Titulos y resumentes usaran siempre «atribucion» o «juicio»; nunca «la IA
siente/entiende/reconoce amor». La lectura filosofica y espiritual llevara un
encabezado de no-evidencia, no validara hipotesis y conservara cualquier
contradiccion con los datos.
