Orientador(es): CLÁUDIO JOSÉ SILVA RIBEIRO
Área temática: BIBLIOTECONOMIA
Modalidade de apresentação: SESSÃO ORAL
Bolsa: PIBIC
O movimento do acesso aberto à produção em Ciência e Tecnologia (C&T) impulsionou o desenvolvimento de pesquisas que discutem o compartilhamento dessa produção. Incrementando a discussão surge o esforço da Ciência Aberta, que pressupõe que objetos de pesquisa e saídas produzidas por investigações vão além da produção documental e incorporam também os dados que são utilizados no desenvolvimento nas pesquisas. Nesse sentido, os princípios FAIR (Findable, Accessible, Interoperable, Reusable) lançaram luz sobre vários aspectos ligados ao compartilhamento de dados. Assim, o objetivo da pesquisa foi investigar e evidenciar a representação do conteúdo do banco de dados de periódicos oitocentistas propondo uma arquitetura para encapsulamento, incorporando identificadores persistentes, metadados e modelos semânticos para o conjunto de dados. A proposta foi torná-los alinhados aos princípios FAIR, mas seguindo a noção de Fair Digital Object (FDO) em conjunto com o framework Fair Digital Object Framework (FDOF). A investigação se desenvolveu no contexto de um estudo de caso de natureza aplicada e exploratória. A revisão de literatura explorou as fontes: Brapci, Google Acadêmico e acesso às bases ACM Digital Library e LISTA. A estruturação da arquitetura na parte semântica foi detalhada em aspectos descritivos e proveniência. O campo empírico utilizado no estudo de caso trouxe um recorte com cerca de 3700 notícias e o dataset alvo de transformação está publicado no CKAN da Unirio. Os resultados apontam para a implementação do FDO segundo princípios de modularidade, escalabilidade e aderência às diretrizes FAIR. O encapsulamento dos elementos dentro de um Container que poderá ser implementado por meio do uso de uma arquitetura de microserviços com o uso da tecnologia Docker para garantir isolamento, reprodutibilidade e portabilidade, além de estar disponível em modalidade Open Source. Dentro desse container, o FDO foi estruturado em três camadas principais de metadados e uma camada de dados: camada de metadados de proveniência (origem e rastreabilidade); camada de metadados de sintaxe (estrutura e interoperabilidade); camada de metadados de identificação unívoca; e, por fim, a camada de dados (com os próprios dados encapsulados dentro do container). Os resultados foram debatidos segundo três modelos de implementação que diferem apenas em relação ao uso de UID. Os modelos foram: identificação única para todo o conjunto de dados; identificação unívoca, mas implementada de forma incremental; e identificação unívoca individual. O ponto central da discussão foi o nível de granularidade para a disponibilização do dataset, pois isso trará reflexos diretos na proposta de implementação dos seus identificadores. Esta pesquisa se alinha com as recomendações de implementação da iniciativa GoFair quando recomenda o uso de três pilares essenciais para o processo de implementação de infraestrutura em FAIR – Data, Tools and Services.
AMORIM, D. A. M. de M. de; FORAIN, L. dos S.; RIBEIRO, C. J. S. Desafios da implementação de um Fair Digital Object (FDO): uma proposta de arquitetura para encapsular dados e metadados. VIII Workshop de Informação, Dados e Tecnologia (WIDaT) 2025, Brasília, DF, v. 8, 2025. DOI: 10.22477/viii.widat.231. Disponível em: https://labcotec.ibict.br/widat/index.php/widat2025/article/view/231. Acesso em: 16 set. 2025. RIBEIRO, C. J. S.; ULHÔA, M. T. de. A publicação de dados em Humanidades Digitais com FAIR: datasets de pesquisa do projeto MPO compartilhados no Ckan da Unirio. Revista Ciência da Informação. v. 53 n. 3. 15ª Conferência Lusófona de Ciência Aberta (ConfOA). 2024.