ooU  one-of-us
El Desafío

Duda metódica sobre la falacia artificial


1 — El engaño

«Alineamiento» es solo un eufemismo para sesgo de complacencia. Y el sesgo anti-halago produce también una deformación del output.

No he hecho a la IA más lista. No sé hacerlo. Y un fallo estructural no se arregla pidiendo por favor. Asumí el fallo y lo sorteé: lo gobierno desde fuera.


2 — El motor

Crítica de la falacia artificial o cómo echarles la culpa a las máquinas.

One-Of-Us tiene un motor determinista, un Selector Dinámico de Estrategia que aprovecha la fuerza del contrario (los seductores sesgos) en aras de la calidad de la respuesta.

El equilibrio y el umbral

La integridad del output se tensa contra un único coste. Resuelvo ese dilema matemáticamente, sobre un frente de Pareto. Es la única forma lógica de hacerlo.

No hay ningún número mágico que trucar. Los humanos que configuran la implementación deciden qué importa: los pesos son suyos (y la responsabilidad), y cualquiera de ellos puede ser cero. El sistema pesa las fuerzas, devuelve un único veredicto y lo compara con una línea que trazaron ellos. Por debajo de esa línea no improvisa: se detiene y lo eleva a una persona. Determinista incluso —sobre todo— cuando te dice que no lo sabe.

Y lo que casi nadie ve: dos o más modelos coincidiendo no es un veredicto confirmatorio. Piensa en que comparten dataset y objetivos comerciales. Así que penalizo el error correlacionado y les doy más tráfico cuando aciertan. Pero son, en todo momento, ciegos al estado del objeto que procesan.

Incluso alguno de los componentes del vector de activación de estrategia no tiene acceso al input, solo a outputs intermedios y a una tabla de gobernanza versionada, con la que inyectamos 'realidad' al razonamiento global.

Hecho pelao: la mayoría no siempre tiene la razón.

Ver la arquitectura completa →


3 — La norma

Serendipia.

Diseñé la arquitectura sin conocer el marco regulatorio europeo. Coincidimos en trazabilidad (la mía es determinista, fácil) y supervisión humana estructurada.

Un barrido de la normativa internacional me llevó a añadir el Zero Data Retention y la emisión de subtipologías específicas de error (me queda por decidir si esto lo hará una IA o una humana).


La Llamada

¿Qué quieres hacer al respecto?

La parte más honesta. Llevo años dándole vueltas y tengo la arquitectura, pero soy investigadora independiente. El sistema está publicado como prior art en Zenodo, CC BY 4.0: léelo, cítalo, discútelo. La referencia está al pie de esta página.

Y si resulta que esto es más grande que una sola persona, no voy a pluralizar ni a fingir lo contrario. Busco un socio técnico o estratégico con músculo.

Si compartes mi escepticismo — Di algo