POLARIS

El recorrido de una evaluación

Una evaluación recorre las ocho pestañas de la plataforma en orden: Panel, Worklist, Cola de revisión, Triage QA, Cobertura, Benchmark, Reporte y Auditoría. El ciclo combina trabajo fuera de la interfaz (ingesta de fuentes y proyección Polaris, vía comandos) con la adjudicación humana dentro de ella. El detalle de cada pantalla está en Las pantallas.

Recorrido de un vistazo

  1. 1 Ingreso y acceso /login/ · /
  2. 2 Ingesta de fuentes y proyección Polaris mayormente offline
  3. 3 Panorámica: Panel (radar dual Humano vs Polaris) · Worklist /assessment/<id>/
  4. 4 Adjudicación de fuentes /queue/
  5. 5 Triage de propuestas /triage/
  6. 6 Veredicto humano en el Workspace mueve el índice /indicator/<code>/
  7. 7 Cobertura y brechas /investigation/
  8. 8 Resultado agregado: Puntaje (en Codificar) · Reporte · Auditoría /worklist/ ···
  9. ↩ Vuelta al Panel: el ciclo se repite por indicador

Los dos canales que conviven en toda la UI

Canal Humano (azul)

El RC2 Index publicable. Solo lo mueve el investigador al codificar en el Workspace. Cada codificación escribe en IndicatorEvaluation y actualiza el índice al instante.

Canal Polaris (púrpura)

Proyección paralela de la IA: insumo y opinión para contrastar, que nunca promueve sola al índice. Visible en todas las pantallas operativas como contraste, no como reemplazo.

La máquina propone; la persona confirma.

1. Ingreso y acceso

Pantallas
Login · lista de evaluaciones.
Rutas
/login/ y /
Qué ocurre
El investigador se autentica con usuario y contraseña. Las vistas de cada evaluación exigen sesión activa. La portada es pública y presenta POLARIS; con sesión suma la lista de evaluaciones disponibles (país, año, número de indicadores ya evaluados) con el enlace a cada una.

2. Ingesta de fuentes y proyección Polaris

Esta etapa ocurre mayormente fuera de la UI

Offline
Las fuentes se cargan mediante procesos que se ejecutan fuera de la interfaz. La proyección Polaris, con sus semáforos, razonamiento y evidencia, también se prepara fuera de la interfaz y se deposita en el sistema. No existe una pantalla de ingesta masiva: ese trabajo ocurre en sesión fuera de la plataforma y los datos aparecen ya cargados cuando el investigador la abre.
En la UI
El investigador puede agregar fuentes individualmente desde el Workspace de cada indicador (pestaña Evidencia, botón "Agregar fuente · Investigadores"). Esa es la única acción de carga de fuentes disponible en la interfaz.

3. Panorámica

Con las fuentes y la proyección Polaris ya cargadas, la primera tarea en la UI es orientarse: entender el estado global de la evaluación y decidir por dónde empezar. Las dos pantallas de panorámica son el Panel y la Worklist.

Panel /assessment/<id>/

Cuatro tarjetas de resumen: RC2 Index Humano (con el componente X), Proyección Polaris, RC2 Baseline y cobertura. Dos radares ECharts: el radar del Baseline (9 dimensiones de Fase 1, en teal) y el radar dual "Humano vs Proyección Polaris" sobre las 9 dimensiones del Benchmark, que muestra en una misma figura la serie azul del canal Humano y la serie púrpura de Polaris. Ese radar revela de un vistazo dónde el humano ya codificó y qué proyecta Polaris donde aún no lo hizo. Solo lectura.

Worklist /assessment/<id>/worklist/

Los 231 indicadores del Benchmark, agrupados por las 9 dimensiones con barra de cobertura por grupo. Cada fila muestra el semáforo del canal Humano, la marca "+X" si aplica, la fuerza de evidencia (SOLID / PROBABLE / WEAK), un aviso "desactualizado" cuando el humano editó después de la última opinión Polaris, y la etiqueta "+N evidencia Polaris" cuando Polaris aporta fuentes determinantes que el humano no codificó. Desde aquí se entra al Workspace de cualquier indicador. Solo lectura.

4. Adjudicación de fuentes

Cola de revisión /assessment/<id>/queue/

Bandeja del auditor: las fuentes que esperan dictamen, agrupadas por indicador. Polaris ya las pre-triajó con una nota. El auditor confirma el veredicto en un click con uno de cuatro opciones:

  • Canónica: probatoria y de primera mano. Contribuye a la fuerza de evidencia del indicador.
  • Retenida: útil como contexto, no como prueba dura.
  • Bajo valor: débil; se conserva pero no pesa en la fuerza de evidencia.
  • Falso positivo: no corresponde al indicador o el enlace es inaccesible; se descarta.

Solo las fuentes con veredicto Canónica cuentan para calcular la fuerza de evidencia (SOLID / PROBABLE / WEAK) que el indicador muestra en la Worklist, el Triage y el Workspace.

5. Triage de propuestas

Triage QA /assessment/<id>/triage/

Vista priorizada de las propuestas Polaris que la QA adversarial marcó para revisión humana (cita no verificada o semáforo a revisar), ordenadas por impacto y confianza. Cada tarjeta muestra el semáforo propuesto por Polaris, el veredicto de la QA (Sostener / Bajar / Subir), la fuerza de evidencia, la etiqueta "+N evidencia Polaris" y el razonamiento expandible. El botón "Resolver" abre el Workspace del indicador en cuestión. La adjudicación real ocurre siempre en el Workspace; el Triage QA es la cola priorizada que lleva hasta allí.

6. Veredicto humano en el Workspace

El Workspace es el único lugar donde el investigador escribe en el canal Humano. Toda codificación actualiza el RC2 Index al instante.

Workspace del indicador /assessment/<id>/indicator/<code>/

Diagnóstico: Investigador

Canal Humano · escribe IndicatorEvaluation

Selector de semáforo con atajos de teclado (verde / amarillo / rojo), casilla "+X" deshabilitada si el semáforo es rojo (regla X-vs-rojo), banda de confianza calibrada (tentativa / probable / firme), glosa con markdown y botón Guardar. El investigador puede optar por adoptar el semáforo que Polaris recomienda como punto de partida, sin estar obligado a seguirlo.

Proyección: Polaris

Canal IA · solo lectura

Semáforo propuesto, confianza, reglas aplicadas del Manual Operativo, razonamiento de la IA, aviso "Polaris desactualizado" si el humano editó después, y la sección "Evidencia que Polaris aporta y el humano no codificó": fuentes nuevas (que el humano no tenía) y relectura divergente (que el humano tenía, pero Polaris ponderó distinto). Línea de tiempo fechada con eventos Polaris, Humano y Sistema.

Evidencia

Dos lanes: Investigadores y Polaris. Tabla por fuente con tipo, alcance, fuerza, verificación, jurisdicción y dictamen. Cada fila se expande para ver la cita extraída del documento. El dictamen se actualiza desde aquí con un click. Botón para agregar fuentes a mano en el lane Investigadores.

Historial del veredicto

El Workspace muestra las versiones del veredicto etiquetadas por origen: v1 propuesta IA, v2 auditoría adversarial IA, v3 veredicto humano. El investigador ve el recorrido completo antes de confirmar su codificación.

Navegación de cola en el Workspace: cuando el investigador llega desde el Triage QA, el Workspace muestra una barra de navegación de cola (anterior, posición X de Y, siguiente) que permite avanzar por los indicadores marcados sin volver al Triage.

7. Cobertura y brechas

Cobertura /assessment/<id>/investigation/

Vista de diagnóstico de cobertura: indicadores con y sin fuente, desglose por fuerza de evidencia (SOLID / PROBABLE / WEAK), eje territorial (estados centinela con y sin evidencia estatal) y tabla de brechas ordenada por peso del indicador. También muestra los borradores de solicitudes de acceso a la información (FOIA) generados para los indicadores con vacío o evidencia débil; una negativa oficial documentada también es evidencia de opacidad. Solo lectura.

Estado de la adquisición automática: la pantalla es real y lee datos ya cargados. La adquisición automática de evidencia todavía está en construcción: para funcionar en vivo necesita conexión a servicios de búsqueda externos. Sin ella, las tablas muestran indicaciones de configuración pendiente.

8. Resultado agregado

Con los indicadores codificados, tres pantallas consolidan el índice, el borrador narrativo y el registro de auditoría.

Puntaje /assessment/<id>/worklist/

La misma tabla de Codificar (una sola para los 231 indicadores; la antigua ruta /benchmark/ redirige ahí) con el conmutador Puntaje encendido: por fila la marca +X, el puntaje \(P = B + X\) y el peso del canal humano, y al lado el P que propone Polaris (insumo, no publicable). Filtrable por dimensión y semáforo desde la URL, con exportación D2 del subconjunto filtrado. Solo lectura.

Reporte /assessment/<id>/report/

El borrador narrativo: secciones con markdown renderizado, tabla de contenido y citas numeradas clickeables que saltan a la lista de fuentes al pie del documento. Si el reporte proviene del canal Polaris, aparece con el banner "Borrador Proyecciones Polaris"; las secciones marcadas como revisadas o aprobadas no se pisan en regeneraciones posteriores. El reporte se genera fuera de la UI (load_report, con el borrador autorado por Claude en sesión) y se visualiza aquí. Solo lectura.

Auditoría /assessment/<id>/audit/

Reporte de auditoría de la sesión: estado de trabajo, fuentes revisadas y validadas, brechas identificadas, nivel de preparación alcanzado y próxima acción sugerida. Incluye un checklist de preparación para el cierre que funciona como guía de sign-off, no como compuerta dura. Solo lectura.

9. Vuelta al Panel

El ciclo se repite por indicador

Procesados los indicadores de la sesión, el investigador vuelve al Panel. El radar dual Humano vs Proyección Polaris refleja el estado actualizado: las codificaciones humanas en azul, la proyección Polaris en púrpura. El ciclo continúa con los indicadores pendientes, uno por uno, hasta completar los 231 del Benchmark. La cobertura acumulada es visible en todo momento desde el Panel y la Worklist.

Tres reglas que el sistema cuida automáticamente

Estas invariantes se verifican en cada codificación. El investigador no necesita recordarlas: el sistema bloquea cualquier intento de violarlas.

  • El complemento X solo acompaña a semáforo verde o amarillo, nunca a rojo (regla X-vs-rojo del canon).
  • El Baseline (Fase 1, 9 dimensiones, codificación manual independiente) es independiente del Benchmark (Fase 2, 231 indicadores): no se derivan valores de uno al otro.
  • Un indicador codificado tiene al menos una fuente que lo respalde; no existe IndicatorEvaluation sin fuente asociada.

Para el detalle de cada pantalla, sus campos y sus acciones posibles, ver Las pantallas. Para las fórmulas del puntaje (\(P = B + X\), RC2 Index, Baseline), ver Fórmulas.