POLARIS

Garantías del método

POLARIS no reemplaza el criterio experto: lo ordena y lo hace trazable. Esta página enuncia las garantías reales del método y del modelo de trabajo (qué sostiene el sistema, qué no hace por su cuenta, qué queda siempre en manos de la persona evaluadora) y declara también los límites que el canon reconoce, sin ocultarlos.

Dos canales que no se mezclan

El método trabaja sobre dos planos separados. El índice publicable y la proyección de la IA conviven, se contrastan, y nunca se confunden.

Canal humano

El índice RC2 publicable lo forman solo los indicadores que una persona codificó, verificó y cerró. Es el plano del juicio experto. La capa de la IA nunca escribe en él.

Canal Polaris

La capa Proyecciones Polaris (IA) es una proyección paralela: insumo y opinión que lee la misma evidencia y propone, para contrastar. Propone, pero no decide, y nunca se promueve sola al índice.

El canon es explícito sobre el alcance de esta capa: POLARIS funciona como observatorio de monitoreo, no como componente de agregación del índice, y no debe crear puntuación sin evidencia, reemplazar la validación humana, ni generar por sí mismo un índice adicional.

La X nunca va sobre rojo

El puntaje de cada indicador es el estado base más el complemento por apoyo internacional, P(i) = B(i) + X(i). El complemento aporta su valor fijo y nunca acompaña a un estado base rojo: primero se asigna B, y solo después se evalúa si X aplica. El sistema impide marcar X sobre rojo en todas las capas; es la única restricción de integridad de datos que esta página afirma como mecanismo, porque es real.

\[ P(i) = B(i) + X(i),\qquad X(i)=0 \text{ si } B(i)=\text{rojo} \]

La fórmula y las seis condiciones operativas de X viven en Fórmulas y Referencia de reglas.

La X es la codificación humana del apoyo internacional, no una compuerta por número de fuentes. Exige implementación real, evidencia verificable y específica del país, vinculada de forma directa al indicador, que no sea mera adhesión formal, y que no reutilice la evidencia ya usada para B. El conteo de fuentes mide fuerza de evidencia, una señal aparte, no habilita la X.

Puntos abiertos (pendientes de validación metodológica). Si una sola fuente que documenta a la vez la implementación y la cooperación puede sostener B y X, o si se exige una fuente distinta; y si un amarillo sostenido solo por implementación subnacional puede además recibir X. El método no los decide por sí mismo.

Quien propone no es quien confirma

La máquina propone y el humano confirma. La separación entre quien escribe y quien revisa se mantiene incluso dentro del canal de la IA: una pasada de investigación propone el semáforo y su razonamiento, una pasada de crítica lo contesta, y recién entonces una persona codifica el veredicto que entra al índice. No hay rubber-stamp: la validación humana tiene prioridad sobre cualquier propuesta automática.

La evidencia está por encima del volumen

El principio rector es claro: la evidencia está por encima del volumen, sin alucinación y sin inferencia más allá de las fuentes. De ahí se derivan tres garantías prácticas:

  • Sin fuentes inventadas. Si tras una búsqueda seria no hay evidencia abrible, se registra el vacío probatorio de forma honesta en lugar de rellenarlo. El vacío probatorio no prueba ausencia, pero tampoco se disimula.
  • Razonar leyendo, no contar palabras clave. La evidencia se clasifica leyendo y razonando cada fuente. Una heurística de términos reimporta el sesgo optimista: que la palabra "implementación" aparezca en un texto no prueba que exista implementación.
  • Sin puntuación prematura. No se asigna puntaje antes del cierre de la evidencia, salvo solicitud expresa.

Las distinciones duras

El método separa de forma deliberada lo declarado de lo probado. Estas distinciones son principios rectores, no preferencias de estilo:

DistinciónQué significa
Ley ≠ implementación Una norma vigente o un programa anunciado no demuestran, por sí solos, operación real.
Norma ≠ práctica Un marco normativo aislado no justifica un verde; hace falta evidencia de práctica.
La implementación prevalece Ante conflicto, la evidencia de implementación pesa más que la declaración normativa.
No extrapolación territorial Lo local, lo estatal o lo regional no equivale a lo nacional; cada nivel se sostiene con evidencia de su propio alcance (ver Eje territorial).
Lo internacional no es prueba doméstica La cooperación o el reconocimiento internacional no se trata como evidencia de práctica dentro del país.
El prestigio no es fuerza probatoria La reputación de una fuente no sustituye la verificación de lo que afirma.

No se puntúa sin suficiencia mínima

Para habilitar amarillo o verde, la evidencia debe alcanzar un mínimo: tres fuentes, dos categorías de evidencia distintas (ambas probatorias) y al menos una vinculada de forma directa al indicador. No se puntúa con una sola fuente débil, con evidencia puramente contextual, sin verificación ni convergencia, o sin haber removido los falsos positivos. Si no se cumple, el caso se reporta como "La cobertura de evidencia es insuficiente para la validación RC2" en lugar de cerrarse. Solo un indicador con preparación declarada "Preparada" pasa a puntuación final.

Puntos abiertos (pendientes de validación metodológica). Si un indicador por debajo del mínimo se asigna rojo (con el vacío documentado) o queda sin puntuar como insuficiente, son resultados distintos y la decisión no está fijada. Tampoco están operacionalizados los umbrales de "evidencia débil" y "evidencia fuerte" ni qué constituye "cobertura nacional suficiente".

De la evidencia al puntaje, trazable

El cálculo sigue una cadena ordenada: fuente, evidencia, codificación, valor, peso y puntaje. Cada eslabón es auditable hacia atrás:

  • Un indicador codificado tiene siempre al menos una fuente que lo respalda; la evidencia documentada es un requisito de la auditoría interna, no un adorno.
  • La cita se verifica contra el documento y se muestra a la vista (y, cuando hay texto, se resalta dentro de la fuente). La evidencia se comprueba, no se da por sentada.
  • La fuerza de la evidencia (sólida, probable o débil) es una señal de calidad separada del puntaje: dice cuán respaldado está el veredicto, sin alterar la fórmula.

Validación humana, sin ediciones silenciosas

El control del trabajo es humano y reversible. Sin correcciones silenciosas y sin ediciones destructivas no autorizadas: una fuente que una persona revisó no se edita ni se borra sin autorización. Ante un error crítico, la regla es divulgarlo y proponer la restauración, no repararlo en silencio.

Auditoría interna y control de errores

Antes de calcular, el método verifica un conjunto fijo de consistencias (la auditoría interna del canon):

  • Los pesos suman uno, Σ Wi = 1.
  • Cada indicador tiene exactamente un estado base; cero es un registro incompleto y más de uno es inválido.
  • La X solo se admite si hay implementación, y como máximo una por indicador.
  • La evidencia está documentada.
  • No se permiten combinaciones de varios estados base en una misma celda.

El trabajo avanza en bloques con un umbral de error: si el riesgo de un bloque supera el máximo admitido, el bloque se pone en cuarentena, no se usa para el cierre y se solicita revisión, en lugar de arrastrar el error al puntaje. Cada sesión deja además un reporte de auditoría que registra qué se revisó, qué se validó y qué se descartó, junto con los vacíos y la preparación.

Punto abierto (pendiente de validación metodológica). El denominador exacto de ese umbral de error (sobre qué total se mide el porcentaje) aún no está fijado, de modo que la regla de cuarentena no se aplica de forma uniforme hasta definirlo.

Los límites se declaran, no se ocultan

El canon reconoce de forma explícita las limitaciones del sistema, y exige documentarlas en el análisis sin disimularlas en la presentación de resultados:

  • Dependencia de datos secundarios y diferencias de disponibilidad y calidad documental entre jurisdicciones.
  • Subjetividad residual en la codificación.
  • Sensibilidad a los pesos.
  • Riesgo de sobreinterpretación si no se separa la evidencia normativa de la implementación.
  • Riesgo de confundir evidencia internacional con prueba doméstica si no se aplica el control metodológico.
Otros puntos abiertos del canon (pendientes de validación metodológica). Si el reporte final de una sesión es un superconjunto de la auditoría de sesión o un artefacto aparte; y si alguna vez se quiere un índice integrado opcional que combine el Baseline y el Benchmark para comunicación, y con qué pesos. Hoy las dos capas van separadas; ninguna de estas decisiones se toma de forma implícita.

Lo que el sistema NO hace

  • No decide por la persona experta: produce insumos, no veredictos.
  • No mueve el índice por su cuenta: un indicador entra solo cuando un humano lo cierra.
  • No deriva el Baseline del Benchmark, ni al revés.
  • No inventa fuentes: registra el vacío en lugar de rellenarlo.
  • No convierte una predicción en un resultado.

Lo que queda a criterio experto

Estas decisiones son siempre humanas; el sistema las acompaña, no las automatiza:

  • El semáforo de cada indicador y su justificación.
  • La aplicación de la X (apoyo internacional).
  • El veredicto sobre cada fuente.
  • La codificación del perfil Baseline de cada país.

En resumen: POLARIS hace el trabajo pesado y repetitivo (reunir evidencia, ordenarla, dejarla a la vista y calcular con exactitud) para que el tiempo experto se concentre en el juicio. La autoridad sobre el resultado es, y sigue siendo, humana.