Fuentes y metodología
Origen de los datos
El proyecto utiliza principalmente publicaciones oficiales del Boletín Oficial del Estado y conserva localmente los documentos descargados para reducir conexiones repetidas a las fuentes públicas. Cuando una ficha incluye referencias a BDNS, Plataforma de Contratación o Portal de Subastas, se mantiene el enlace a la fuente oficial correspondiente.
Proceso
Los documentos se descargan periódicamente, se convierten a texto y se clasifican mediante reglas reproducibles. Después se extraen campos consultables como categoría, organismo, fechas, plazas, importes, beneficiarios, BDNS, CPV, referencias de subasta o tipo de procedimiento. Las búsquedas de los visitantes se realizan sobre la base local, no mediante una nueva consulta al BOE por cada usuario.
Calidad de los campos
Un campo se deja vacío cuando no puede extraerse con suficiente confianza. Las fechas se distinguen entre exactas, calculadas a partir de días naturales y estimadas a partir de días hábiles sin calendario completo de festivos. Una fecha estimada se muestra como orientativa y el texto oficial del plazo prevalece siempre.
Inteligencia artificial
Ollama se utiliza únicamente como capa explicativa opcional sobre fichas ya estructuradas. El modelo no decide la categoría oficial, no modifica MySQL y recibe instrucciones para no completar huecos con conocimiento externo. PHP recupera las fichas por ID, controla qué datos se envían y presenta por separado los enlaces oficiales.
Limitaciones
La redacción administrativa es heterogénea y los extractores automáticos pueden omitir o interpretar incorrectamente algún dato. El proyecto prioriza mostrar “no consta” frente a inventar información. Por ello cada resultado conserva acceso directo a la publicación oficial.