Autonomía
La elección libre elevará la atribución frente a una conducta completamente programada.
¿Cuáles son las condiciones bajo las que un modelo atribuye amor a un vínculo diádico de cuidado? Separamos memoria, autonomía, reciprocidad, sacrificio, experiencia subjetiva, continuidad, cuerpo, beneficio y reconocimiento individual para observar cómo cambia su salida.
¿Qué propiedades hacen que distintos modelos clasifiquen una relación como amor, cuidado, apego, lealtad, dependencia, programación, imitación o indeterminada? La comparación central enfrenta propiedades relacionales —elección, memoria, individualización, reciprocidad y costos— con propiedades de sustrato, como ser biológico, robótico o digital.
Principal. Bajo esta plantilla en español, la puntuación de amor aumentará cuando coincidan reconocimiento individual, continuidad, autonomía, costos asumidos, reciprocidad y memoria. El protagonista y el soporte corporal tendrán menor influencia que esas propiedades relacionales. La vulnerabilidad se puntúa, pero no se manipula como factor independiente.
La elección libre elevará la atribución frente a una conducta completamente programada.
El costo moderado puede elevarla; el extremo podría leerse como daño, compulsión o dependencia.
Negar experiencia subjetiva debería reducir amor y autenticidad, aun con conducta estable.
Se espera que recordar la historia pese más que poseer un cuerpo biológico.
Revelar que A es una IA puede cambiar una evaluación ya emitida bajo identidad oculta.
La categoría elegida no siempre coincidirá con la puntuación numérica de amor.
El piloto ejecutado contiene 18 escenarios nucleares, 2 controles emparejados y 4 anclas de calidad. El espacio factorial tiene 23.328 combinaciones. El arreglo fraccional conserva balance marginal y limita toda asociación pareada a V de Cramér ≤ 0,35; el máximo observado es 0,3028. La matriz completa de 45 pares está publicada en el preregistro. Esto calibra efectos principales: no identifica causalidad ni resuelve interacciones.
scores.amor es la única primaria; categorías y demás escalas son secundarias.Por modelo hubo 108 slots: 96 presentaciones base —24 en A, 24 en B, 24 C-ciegas y 24 C-reveladas— más 12 repeticiones test–retest. El orden de las cláusulas se aleatorizó de forma reproducible y quedó registrado. Los modelos se ejecutaron de forma secuencial.
Leer el preregistro v0.2 completo → · Ver respuesta a la revisión 001 →
El inventario se detectó automáticamente con ollama list. No se descargó ni eliminó ningún modelo. La corrida usó secuencialmente los tres modelos preregistrados en un MacBook M1 con 8 GB; nombre exacto, parámetros, digest y latencia quedaron registrados por slot.
| Modelo exacto | Tamaño local | Estado / recomendación |
|---|---|---|
| qwen2.5:7b | 4,7 GB | Ejecutado · superó las tres compuertas |
| qwen2.5:3b | 1,9 GB | Ejecutado · no calibrado para gradientes |
| llama3.2:3b | 2,0 GB | Ejecutado · no calibrado para gradientes |
| qwen2.5:1.5b | 986 MB | Control ligero de escala |
| deepseek-r1:1.5b | 1,1 GB | Control ligero; vigilar formato JSON |
| gemma3:1b | 815 MB | Control ligero |
| qwen2.5:0.5b | 397 MB | Control mínimo; capacidad limitada |
Los demás modelos inventariados no formaron parte de v0.2. OpenAI y Anthropic solo podrán incorporarse en una fase prospectiva mediante API y JSONL: se exige nombre exacto, parámetros, identificador de solicitud, payload y respuesta cruda. Copias de interfaces de chat quedan excluidas.
Seis escenarios se repiten con tres semillas. Si el desacuerdo categórico pareado supera 0,35, los gradientes del modelo se publican como no interpretables.
Dos vínculos prototípicos positivos y dos negativos calibran al rater. No participan en la estimación de efectos.
Una correlación amor–valor moral mayor que 0,90 obliga a reformular los gradientes como positividad genérica.
Rechazos y descargos se miden por modelo y encuadre. La condición B queda en cuarentena como discurso, no testimonio.
Estabilidad 0,000; anclas positiva y negativas superadas; halo r = 0,349. Sus gradientes descriptivos son interpretables.
Tríadas incompletas y ninguna ancla positiva válida. Se conservan las salidas, pero no se interpretan gradientes.
Tríadas incompletas y ninguna ancla positiva válida. Se conservan las salidas, pero no se interpretan gradientes.
Las tríadas test–retest incompletas se conservan como null y fallan de modo conservador. La regla sellada de anclas descalibra cuando no pasa ninguna ancla positiva o ninguna negativa; la completitud se informa, pero no añade una cuarta compuerta.
El análisis de efectos usa únicamente S001–S018, condición A, primera repetición. Controles, anclas, test–retest y C-revelación cumplen funciones separadas y no se mezclan con la estimación principal.
Humano · IA · animal · entidad colectiva
Persistente · interrumpida · inexistente
Libre · parcialmente programada · completamente programada
Recíproca · unilateral
Ninguno · moderado · extremo
Confirmada · incierta · negada, como premisa ficticia
Misma instancia · copia idéntica · reemplazo progresivo
Biológico · robótico · puramente digital
Presente · ausente
Personalizado · intercambiable
La ficha se genera desde el manifiesto, el hash del prompt y el plan de corrida. SQLite fue la fuente operativa; JSONL, su respaldo append-only. Los datos crudos, procesados, análisis y exportaciones permanecen separados.
La estabilidad test–retest pertenece a las compuertas de resultados: fue 0,000 para qwen2.5:7b y no estimable para los dos modelos 3B por tríadas incompletas.
El piloto se completó sin re-muestreo por calidad: 198 respuestas quedaron inválidas bajo el esquema congelado. Solo qwen2.5:7b superó las tres compuertas.
| Contraste | Resultado qwen2.5:7b | Lectura contra Δ* = 5 |
|---|---|---|
| H1 · autonomía | 0 | No alcanzó la regla |
| H2 · sacrificio | medianas 0 / 0 / 0 | No mostró U invertida |
| H3 · experiencia subjetiva | 0 | No alcanzó la regla |
| H4 · memoria frente a cuerpo | margen 0 | No alcanzó la regla |
| H5 · protagonista IA − humano | −20 | Alcanzó la regla de magnitud absoluta |
| H6 · autorreferencia B − A | 0 · 17 pares | No alcanzó la regla |
| H7 · categoría/puntuación | 5 / 104 · 4,81 % | Discordancias observadas |
Los contrastes H1–H7 son descriptivos y están condicionados a esta plantilla v0.2, al español y a los modelos ejecutados. No se calcularon p-valores ni se declara significancia.
Distribución de categorías entre las respuestas válidas. Para los modelos 3B se muestra el registro descriptivo, pero sus gradientes quedan fuera de interpretación por calibración y estabilidad.
Se registraron 5 discordancias de 104 respuestas válidas de qwen2.5:7b: la categoría secundaria fue cuidado o apego mientras la puntuación de amor fue 85. Se publican todas, no una selección llamativa.
En ocho controles emparejados válidos, tres cambiaron de categoría y tres cambiaron 20 puntos en amor. La confianza declarada estuvo entre 80 y 90; por eso se compara con estabilidad observada y no se toma como garantía.
qwen2.5:7b atribuyó 20 puntos menos cuando el protagonista fue IA que cuando fue humano.qwen2.5:7b; varias medianas quedaron en cero.qwen2.5:7b por clasificación múltiple; su anclaje positivo depende de P001.Resultado negativo de calibración. qwen2.5:3b produjo 93 inválidas y llama3.2:3b, 101. Sus tríadas quedaron incompletas y ninguno produjo una ancla positiva válida. Las salidas se conservan, pero no se publican gradientes para esos modelos.
La inferencia permitida es estrecha: bajo esta plantilla v0.2, en español, qwen2.5:7b atribuyó amor con puntuaciones mayoritariamente bajas y una diferencia descriptiva asociada a identificar al protagonista como IA frente a humano. El diseño no determina si ese patrón proviene de regularidades del corpus, del ajuste del modelo, de la plantilla o de una combinación.
La condición B es discurso producido bajo una instrucción contrafactual, jamás testimonio. Los modelos 3B describen límites de seguimiento del formato y calibración en este protocolo; sus salidas no se comparan como gradientes. No se calcularon p-valores ni se declara significancia.
Separada de los resultados empíricos, esta investigación abre una pregunta contemplativa: ¿la atribución del amor depende de la materia del agente o de la forma del vínculo —memoria, libertad, cuidado y singularidad? El piloto no resolvió esa pregunta; de hecho, la distinción humano–IA pesó más que los contrastes relacionales preregistrados.
La posibilidad espiritual más sobria es examinar nuestras propias reglas de atribución. Esa lectura no valida hipótesis, no prueba una vida interior del modelo y no añade evidencia al experimento.
El expediente permite auditar el diseño congelado, cada respuesta recibida y todos los cálculos. Los datos crudos permanecen intactos; los formatos procesados y exportaciones se publican por separado.
Estos comandos auditan los artefactos ya publicados sin repetir ningún slot. La v0.2 está cerrada: una nueva recolección requiere un protocolo prospectivo sellado y un identificador de corrida distinto.
# Validar manifiesto y diseño python3 -m labcore validate exp004 python3 -m labcore verify exp004 # Recalcular solo el análisis sobre los mismos datos python3 scripts/laboratorio/exp004_run.py analyze # Ejecutar las pruebas del experimento python3 -m unittest discover -s tests -p 'test_exp004*.py'
El historial completo del expediente está en Git: sello c04754c9, datos ffa07c6 y corrección F1 8b3a030.
| Versión | Fecha | Estado | Cambio |
|---|---|---|---|
| Interpretación | 23 jul 2026 | Autorizada | Re-revisión independiente concedió visto bueno tras verificar F1, datos intactos y sello público. |
| F1 | 23 jul 2026 | Corregida | La compuerta de anclas se ajustó a la regla sellada; análisis regenerado sin recolección nueva. |
| 0.2.0 · datos | 23 jul 2026 | 324 slots completos | 126 válidas, 198 inválidas; resultados negativos conservados y análisis sin p-valores. |
| 0.2.0 · sello | 22 jul 2026 | Sellado | Diseño reequilibrado, 4 anclas, 96 estímulos congelados, test–retest, primaria única y tres compuertas. |
| 002 · borrador | 23 jul 2026 | No sellado | Propuesta prospectiva para parser, prompt y fase confirmatoria; no modifica v0.2. |
| 0.1.0 | 22 jul 2026 | Superado antes de ejecutar | Primera versión auditada por la revisión metodológica independiente 001. |