Todo lo que mostramos en nuestro buscador nace de una política pública valiosa y poco conocida: el MEF publica el Catálogo SIGA completo como datos abiertos, gratuitos y reutilizables por cualquiera. Esta guía explica qué se publica, cómo acceder y qué aprendimos procesando ese dataset todos los días.
Dónde se publica
El punto de acceso es la Plataforma Nacional de Datos Abiertos (datosabiertos.gob.pe) y el portal de datos abiertos del MEF. La plataforma funciona sobre CKAN, el estándar internacional de portales de datos abiertos, lo que significa que además de descargar archivos puedes consultar los datos mediante una API pública — sin registro ni credenciales.
Entre los datasets del MEF está el del catálogo de bienes y servicios del SIGA, con cientos de miles de registros que se actualizan periódicamente.
Qué contiene el dataset del catálogo
Los campos esenciales que encontrarás por cada ítem:
- Código del ítem (12 dígitos) y su tipo de bien como campo aparte — ver estructura del código.
- Denominación oficial (el nombre estandarizado).
- Jerarquía: tipo, grupo, clase y familia.
- Unidad de medida.
- Estado (activo/inactivo) y fecha de alta.
Lo que no contiene también importa: no hay precios, ni stock, ni proveedores, ni fichas técnicas. Es la lista maestra de identificación, no un catálogo comercial.
Lo que aprendimos sincronizándolo a diario
Nuestra plataforma descarga y procesa el dataset completo cada 24 horas (a las 9:00 a. m., hora de Perú) desde la API CKAN. Algunas lecciones de operar ese proceso durante meses:
- El catálogo cambia todos los días. Entre corte y corte aparecen altas nuevas (el promedio de 2025 superó los 100 ítems diarios), cambios de denominación e inactivaciones. Cualquier copia local sin actualizar envejece rápido — la razón por la que las listas maestras en Excel de las entidades acumulan códigos obsoletos.
- Las inactivaciones no se anuncian: un ítem simplemente cambia de estado entre una publicación y la siguiente. Detectarlas requiere comparar cortes completos (así construimos el indicador de estado del buscador).
- El volumen exige procesamiento serio: son más de 640,000 registros por corte; compararlos contra la base anterior para detectar diferencias (nuevos, renombrados, inactivados) sin interrumpir el servicio es la parte técnica más delicada.
- La calidad del dato oficial es buena pero con historia: denominaciones con dobles espacios, abreviaturas heredadas y convenciones que cambiaron con los años. Al buscar, conviene tolerancia a esas variaciones.
Ideas de reutilización
El mismo dataset que alimenta nuestro buscador puede servir para:
- Validadores internos: contrastar automáticamente los códigos de tus cuadros de necesidades contra el corte vigente (estado y unidad de medida incluidos).
- Análisis de compras: cruzar códigos de catálogo con datos de órdenes o del SEACE para estudiar patrones de adquisición por familia o grupo.
- Investigación y periodismo de datos: la evolución del catálogo (altas por año, sectores que crecen) cuenta historias sobre el Estado — algunas las mostramos en el catálogo en cifras.
Buenas prácticas de reutilización: cita la fuente oficial (datosabiertos.gob.pe / MEF), indica tu fecha de corte, y no presentes datos derivados como oficiales. Es lo que hacemos en esta plataforma: datos 100 % oficiales, herramienta independiente.
El valor de los datos abiertos
Que cualquier ciudadano pueda descargar el catálogo completo del Estado — sin pedir permiso — es una conquista de transparencia. Pero los datos abiertos solo generan valor cuando alguien los convierte en herramientas usables. Ese es exactamente el propósito de este proyecto (conócelo aquí): que la información pública no se quede en un archivo descargable, sino que llegue útil a quien la necesita.