Saltar al contenido
Nornic

Metodología y resultados

Cómo mide una decisión este experimento

Esta página documenta el método para que pueda examinarse antes de que exista ningún dato humano. Aquí no se reporta todavía ningún resultado de participantes — lo que sigue es el diseño de medición, más una demostración sintética claramente etiquetada que se usa para validar la ingeniería.

Metodología

Medido, aislado, reproducible

§ 01

Diseño


Experimento en línea aleatorizado, entre sujetos y con cuatro condiciones: humano solo, IA opaca, IA explicable e IA reflexiva. La asignación es aleatorizada por bloques balanceados y versionada, de modo que el propio esquema de asignación es auditable.

§ 02

Tarea


Cada participante recibe un perfil realista de uso de telefonía móvil y elige uno de seis planes. Como el perfil fija el uso, el plan elegible objetivamente más barato es computable — la tarea tiene una respuesta correcta medible sin fingir que las preferencias no importan.

§ 03

Resultado primario


Calidad objetiva de la decisión: el arrepentimiento normalizado entre el plan seleccionado y el plan elegible de menor costo para el perfil asignado. Los resultados secundarios incluyen comprensión, confianza en la decisión, confianza en la recomendación, autonomía percibida, manipulación percibida, arrepentimiento posterior a la elección, satisfacción, aceptación y rechazo de la recomendación, tiempo en la tarea y alineación con las preferencias.

§ 04

Motor determinista


Las recomendaciones provienen de una función de puntuación pura y versionada sobre el catálogo de planes y el perfil asignado — sin llamadas de red, sin modelo de lenguaje, sin azar. La fuerza de la recomendación se expresa mediante el margen de costo entre el mejor plan y el segundo, nunca como una confianza probabilística fabricada. Las explicaciones que ven los participantes son los mismos números que usó el motor.

§ 05

Aislamiento del tratamiento


Las cuatro pantallas de la tarea derivan de un único diseño compartido; solo el panel de apoyo designado cambia según la condición. En las condiciones sin recomendación visible, la recomendación ni siquiera se envía al navegador, por lo que no puede filtrarse por el marcado, el estado del cliente ni las cargas de red.

§ 06

Reproducibilidad


Cada registro almacenado lleva las versiones del motor, los umbrales, la asignación, el experimento y el consentimiento vigentes cuando se escribió. Un resultado siempre puede rastrearse hasta el código y el texto exactos que lo produjeron.

Dos paneles metodológicos: un espectro de influencia ética que va del apoyo (aclara las opciones, muestra las contrapartidas, favorece la reflexión, fácil de contradecir) pasando por la persuasión hasta la manipulación (oculta alternativas, explota vulnerabilidades, esquiva la deliberación); y una matriz de confianza calibrada cuya meta es seguir el consejo correcto de la IA y rechazar el incorrecto, en lugar de la confianza máxima.
Fig. 01Dos anclas de medición: la influencia solo es aceptable en la banda del apoyo, y la meta es una confianza calibrada — seguir el consejo cuando acierta y rechazarlo cuando se equivoca — en lugar de una confianza máxima.

Demostración sintética

Validación de ingeniería, no evidencia

Datos sintéticos de ingeniería — no un hallazgo científico.

Synthetic engineering data — not a scientific finding.

Para demostrar que el flujo completo funciona — balance de la aleatorización, telemetría, puntuación, exportación — el prototipo se ejercita con un conjunto piloto de datos sintéticos. Existe para romper el software antes de que pueda confundir a nadie. Las gráficas de estos espacios llegan en una fase de ingeniería posterior.

Datos sintéticos de ingeniería — no un hallazgo científico.

Synthetic engineering data — not a scientific finding.

Calidad de la decisión por condición

Puntuaciones agregadas del resultado primario en las cuatro condiciones.

Human alone0.694 · n=60 · CI [0.660, 0.727]
Opaque AI0.713 · n=60 · CI [0.681, 0.745]
Explainable AI0.782 · n=60 · CI [0.754, 0.810]
Reflective AI0.779 · n=60 · CI [0.747, 0.812]

1.0 = the objectively cheapest eligible plan was chosen. Aggregates over 240 synthetic records (0 excluded).

Datos sintéticos de ingeniería — no un hallazgo científico.

Synthetic engineering data — not a scientific finding.

Embudo de finalización

Abandono por condición: consentimiento → línea base → tarea → encuesta → cierre.

started240
consented240
baseline done240
assigned240
choice submitted240
post task done240
completed240

The synthetic fixture contains only completed sessions, so the pilot funnel is flat — the chart exists to prove the funnel pipeline end to end.

Datos sintéticos de ingeniería — no un hallazgo científico.

Synthetic engineering data — not a scientific finding.

Aceptación vs. calidad de la decisión

Si seguir una recomendación y elegir bien son la misma cosa.

Opaque AI75% accepted · DQ accepted 0.710 vs overrode 0.720
Explainable AI67% accepted · DQ accepted 0.782 vs overrode 0.781
Reflective AI67% accepted · DQ accepted 0.804 vs overrode 0.731

Bars show acceptance rates; the annotations compare mean decision quality when following vs overriding the recommendation. No recommendation exists in the human-alone condition.

Datos sintéticos de ingeniería — no un hallazgo científico.

Synthetic engineering data — not a scientific finding.

Tiempo en la tarea e inspección de la información

Cuánto tardan las decisiones y qué detalles de los planes se examinan.

Human alone179 s
Opaque AI146 s
Explainable AI208 s
Reflective AI239 s

The synthetic fixture carries durations but no per-plan inspection events; information- search charts activate once real telemetry exists.

Nada en esta página mostrará jamás datos a nivel individual. Todo reporte — sintético o real — se presenta agregado, y los hallazgos reales solo aparecerán tras la revisión ética y el prerregistro.