gov-map

Cómo clasificamos las noticias

Esta página describe, de forma honesta y verificable, qué prensa se monitorea, cómo se clasifica cada titular, con qué vara se midió esa clasificación antes de usarla, y por qué —hoy— ninguna noticia se vincula a una ficha de proyecto por su clasificación. Cada cifra de esta página viaja con su tamaño de muestra (n) y su intervalo de confianza.

Qué se monitorea

La plataforma sigue por RSS a cinco medios chilenos: La Tercera, La Cuarta, Ex-Ante, BioBioChile y Cooperativa. De cada noticia se guarda solo el titular y la bajada públicos que el propio medio publica en su feed — el texto completo de la noticia no se almacena ni se muestra en ningún lugar del sitio.

La taxonomía

Cada titular y bajada se clasifica en una de seis clases, a partir de lo que el propio texto dice —nunca de lo que el lector podría inferir sobre el tema—:

La vara antes de medir

Antes de medir cualquier clasificador, se construyó un conjunto de referencia (golden set) de 159 casos, etiquetado por dos anotadores independientes —ambos modelos de inteligencia artificial de la misma familia, un dato relevante para leer las cifras— con arbitraje de un tercer modelo sobre los desacuerdos. Sobre los 154 casos doble-anotados del conjunto (los 5 restantes se incorporaron en un paso posterior de sobre-muestreo dirigido), el acuerdo bruto entre anotadores fue 88,96 %; el coeficiente kappa de Cohen —que descuenta el acuerdo esperable por azar— fue 0,83 (intervalo de confianza 95 %: 0,75–0,91, n=154).

Limitación declarada, no disimulada: por decisión del operador, la calibración de referencia se hizo con un modelo de inteligencia artificial distinto, actuando en sustitución del operador humano. El acuerdo entre un anotador humano y el clasificador en producción no está medido — se declara aquí como ausente, no se estima ni se aproxima con otra cifra.

Umbrales pre-registrados y resultado

Los umbrales de aprobación se fijaron antes de correr el clasificador sobre el golden set (pre-registro). El clasificador en producción (DeepSeek) aprobó con una exactitud macro de 87,66 % (intervalo de confianza 95 %: 81,3–91,8 %), medida sobre las tres clases del golden set con al menos 8 casos cada una.

Dos clases —tramitación legislativa y actividad parlamentaria— quedaron con un tamaño de muestra insuficiente (menos de 25 casos) para medir su propio umbral de precisión. Por una regla fijada antes del experimento, ninguna noticia se vincula automáticamente a una ficha de proyecto o de parlamentario por su clasificación mientras esa medición no exista. Es la razón por la que, hoy, el vínculo entre una noticia y un proyecto de ley es solo por mención textual del número de boletín en el titular o la bajada: un criterio determinista y verificable, no una inferencia del clasificador.

Limitaciones

Trazabilidad

Los artefactos que respaldan esta página están congelados con hash sha256 en el repositorio público del proyecto, con su historial de cambios registrado:

← Volver a Metodología