Metodología

Qué hacemos

Jujuy en Datos monitorea el Boletín Oficial de la Provincia de Jujuy todos los días: detecta decisiones públicas con montos, sanciones, licitaciones y convenios, y las convierte en datos estructurados verificables y en notas periodísticas con contexto.

Cómo procesamos cada boletín

  1. Descarga: el servidor detecta y descarga el boletín nuevo del sitio oficial.
  2. Extracción con IA: un modelo de lenguaje (Gemini) lee el PDF completo y devuelve un JSON estructurado: tipo y número de documento, fecha, organismo, montos en números y letras, actores con rol, vínculos entre documentos, página y cita textual.
  3. Validación local: se comparan los montos en letras y en números; si difieren, el documento queda marcado y no se publica. Se descartan por regla las tarifas de publicación (líneas LIQ) y las tablas de la AGPJ.
  4. Base de datos: todo se acumula en una base SQLite (documentos, actores, participaciones, vínculos) que permite métricas cruzadas entre boletines y años.
  5. Redacción y publicación: las notas de relevancia alta se redactan con cita y página de origen, y se publican con la fecha del boletín, no la del procesamiento.

Qué publicamos y qué no

No todos los documentos del Boletín Oficial se convierten en notas. Aplicamos criterios de relevancia editorial para enfocar el trabajo periodístico en decisiones con impacto público directo:

Sí publicamos (relevancia alta)

  • Licitaciones y adjudicaciones de obra pública o suministros del Estado.
  • Convenios de infraestructura entre organismos o con terceros.
  • Sanciones a concesionarias de servicios públicos (transporte, energía, agua).
  • Contrataciones mayores con montos significativos para el contexto económico de la época.

Registrados pero no publicados (relevancia media o baja)

Los siguientes documentos se extraen, validan y almacenan en la base de datos para métricas y análisis, pero no generan notas individuales:

  • Sanciones disciplinarias a empleados públicos.
  • Ordenanzas que crean programas o modificaciones menores.
  • Convenios institucionales sin montos significativos.
  • Adjudicaciones de lotes fiscales.
  • Trámites societarios (creación de empresas, cambios de estatuto).
  • Promociones, designaciones y movimientos de personal.
  • Adhesiones a leyes nacionales o provinciales.
  • Promulgaciones de leyes sin contenido normativo propio.

Estos documentos alimentan las métricas agregadas (total de documentos por organismo, por tipo, por año) que podés consultar en la sección Métricas. Si un boletín fue procesado pero no tiene documentos de relevancia alta, queda registrado allí como “analizado sin nota publicada”.

Cómo verificamos lo que publicamos

  • Cada nota cita su fuente: tipo de documento, número y página del boletín.
  • La cita textual permite contrastar cualquier dato con el PDF original en segundos.
  • Cada nota lleva la firma del sistema: qué hizo la IA y qué hacen los humanos.
  • En modo piloto, la publicación es automática y la revisión editorial es posterior; si detectamos un error, corregimos y lo aclaramos en la nota.

Qué no hacemos

  • No emitimos juicios políticos ni de valor: solo clasificación administrativa y datos.
  • No priorizamos notas de boletines anteriores a julio de 2026: se usan principalmente para métricas históricas.
  • No publicamos anexos ni ediciones con letra hasta revisarlos caso por caso.

Limitaciones conocidas

  • Los boletines históricos escaneados pueden tener errores de lectura.
  • Las personas sin CUIL/DNI explícito pueden duplicarse en las métricas de empleo.
  • Un mismo evento puede aparecer en varios documentos (decreto, imputación, llamado): los totales por organismo pueden contarlo más de una vez hasta terminar la deduplicación por evento.
  • Los totales por organismo incluyen leyes presupuestarias sancionadas, cuya magnitud es de otra naturaleza que las compras y contrataciones: el tablero en construcción las separará.