Sistematización y automatización del flujo de trabajo para la consulta de datos del HFLAV

UDC.coleccionTraballos académicos
UDC.tipotrabTFM
UDC.titulacionMáster Universitario en Enxeñaría Informática
dc.contributor.advisorCastro, Laura M.
dc.contributor.advisorCastro Souto, David
dc.contributor.authorGoyanes Legazpi, Sergio
dc.date.accessioned2026-07-17T11:32:24Z
dc.date.available2026-07-17T11:32:24Z
dc.date.issued2026-02
dc.description.abstract[Abstract]: This work aims to simplify the workflow for scientists who will use data that the Heavy Flavor Averaging Group (HFLAV) publishes on open-access repositories like Zenodo [1]. Accessing these datasets is currently a fragmented and manual task, which introduces inefficiencies and potential errors in a domain where reproducibility is critical. To address this, a Python library is developed to automate data access, search, retrieval, and validation, providing a unified interface that allows scientists to focus on data analysis and exploitation. The library supports flexible searches, JSON schema validation, semi-structured Python objects, and a command-line interface suitable for non-programmers. Its modular design, based on software design patterns and dependency injection, ensures maintainability, extensibility, and adaptability to other repositories. This tool not only improves HFLAV data-related workflows, but also provides a reusable framework aligned with Findable, Accessible, Interoperable, and Reusable (FAIR) principles for scientific data.
dc.description.abstract[Resumen]: Este trabajo tiene como objetivo simplificar el flujo de trabajo para los científicos que utilizarán datos que el HFLAV publica como resultados en repositorios de acceso abierto como Zenodo. Actualmente, el acceso a estos conjuntos de datos es fragmentado y manual, lo que introduce ineficiencias y posibles errores en un ámbito donde la reproducibilidad es crítica. Para abordar esta situación, se desarrolla una librería en Python que automatiza el acceso, la búsqueda, la recuperación y la validación de los datos, proporcionando una interfaz unificada que permitirá a los científicos centrarse en el análisis y uso de los mismos. La librería permite búsquedas flexibles, validación mediante JSON schema, objetos Python semi-estructurados y una interfaz de línea de comandos para usuarios sin experiencia en programación. Su diseño modular, basado en patrones de diseño de software e inyección de dependencias, garantiza su mantenibilidad, extensibilidad y adaptabilidad a otros repositorios de datos. Esta herramienta no solo mejora los flujos de trabajo que usan datos proporcionados por HFLAV, sino que también proporciona un marco reutilizable alineado con los principios FAIR para datos científicos.
dc.description.traballosTraballo fin de mestrado (UDC.FIC). Enxeñaría Informática. Curso 2025/2026
dc.identifier.urihttps://hdl.handle.net/2183/48891
dc.language.isoeng
dc.rightsAttribution 4.0 Internationalen
dc.rights.accessRightsopen access
dc.rights.urihttp://creativecommons.org/licenses/by/4.0/
dc.subjectHFLAV
dc.subjectCERN
dc.subjectHigh Energy Physics
dc.subjectScientific Data Management
dc.subjectResearch Data Repositories
dc.subjectFAIR Principles
dc.subjectScientific Workflow Automation
dc.subjectReproducible Research
dc.subjectOpen Science
dc.subjectFísica de Altas Energías
dc.subjectGestión de Datos Científicos
dc.subjectRepositorios de Datos de Investigación
dc.subjectPrincipios FAIR
dc.subjectAutomatización de Flujos de Trabajo Científicos
dc.subjectInvestigación Reproducible
dc.subjectCiencia Abierta
dc.titleSistematización y automatización del flujo de trabajo para la consulta de datos del HFLAV
dc.typemaster thesis
dspace.entity.typePublication
relation.isAdvisorOfPublication5510ff34-1757-4dea-b825-fb66e62d39a9
relation.isAdvisorOfPublication.latestForDiscovery5510ff34-1757-4dea-b825-fb66e62d39a9

Files

Original bundle

Now showing 1 - 1 of 1
Loading...
Thumbnail Image
Name:
GoyanesLegazpi_Sergio_2026_TFM.pdf
Size:
8.09 MB
Format:
Adobe Portable Document Format