| Grant number: | 26/10431-9 |
| Support Opportunities: | Scholarships in Brazil - Technical Training Program - Technical Training |
| Start date: | May 01, 2026 |
| End date: | January 31, 2027 |
| Field of knowledge: | Applied Social Sciences - Information Science - Archival Science |
| Principal Investigator: | Benedicto Eduardo da Silva |
| Grantee: | Fernanda da Rocha Parrado |
| Associated research grant: | 25/13168-4 - Media Portal: Intelligent System for Automating the Cataloguing and Indexing of Historical Audiovisual Archives through Natural Language Processing, AP.PIPE |
Abstract O trabalho a ser desenvolvido pelo bolsista B2 será focado na modelagem de dados, no tratamento e padronização de metadados técnicos e editoriais, e no apoio à estruturação do banco de dados da solução Media Portal. O bolsista atuará nas etapas de levantamento de requisitos para a ficha de catalogação, no mapeamento dos campos existentes em acervos legados e na definição dos relacionamentos entre os dados, visando garantir consistência, interoperabilidade e aderência aos padrões arquivísticos e museológicos utilizados em instituições públicas e privadas. Também será responsável pela seleção e documentação das bibliotecas de NLP utilizadas na extração semântica das transcrições e na estruturação automatizada das informações, além de participar do mapeamento semântico dos dados extraídos com vocabulários controlados. Sua atuação será fundamental para a curadoria da base de treinamento e para o alinhamento dos processos de extração com os requisitos da LGPD, contribuindo para o Desafio Científico 1 e os Desafios Técnicos 2 e 4. O plano permitirá ao bolsista desenvolver habilidades técnicas relacionadas à engenharia de dados e curadoria semântica em ambientes de alta complexidade informacional.O bolsista B2 será responsável por atividades de estruturação de dados e suporte à organização semântica das informações que alimentarão o sistema automatizado de catalogação audiovisual do projeto Media Portal. Para isso, os objetivos incluem:* Realizar o levantamento, padronização e modelagem dos campos da ficha de metadados utilizada para catalogação, garantindo aderência aos padrões arquivísticos e museológicos;* Apoiar a estruturação da arquitetura do banco de dados textual, com definição clara dos relacionamentos entre campos e categorias semânticas;* Selecionar e documentar bibliotecas de NLP e ferramentas de extração semântica, garantindo sua compatibilidade com os desafios técnicos e científicos do projeto;* Atuar na avaliação da integridade e completude dos dados legados, propondo estratégias de tratamento e preenchimento de lacunas que assegurem consistência e usabilidade;* Contribuir para a conformidade legal do sistema no tratamento dos dados, com foco na adequação às exigências da LGPD no tocante à anonimização e controle de dados sensíveis. (AU) | |
| News published in Agência FAPESP Newsletter about the scholarship: | |
| More itemsLess items | |
| TITULO | |
| Articles published in other media outlets ( ): | |
| More itemsLess items | |
| VEICULO: TITULO (DATA) | |
| VEICULO: TITULO (DATA) | |