Arquitetura e Engenharia de Dados do Laboratório Agadê

Este trabalho apresenta o projeto e a implementação da estrutura e do fluxo de dados do Laboratório Agadê, visando consolidar em um repositório de dados abertos, múltiplas fontes da Prefeitura do Recife para apoiar atividades de ensino, pesquisa e extensão. A partir do problema da dispersão e heterogeneidade dos conjuntos de dados em ambientes acadêmicos, definiu-se como objetivo desenvolver um fluxo de trabalho automatizado para coletar, processar e organizar dados em um repositório de dados baseado no Pos tgreSQL, utilizando a ferramenta Apache Hop e disponibilizando as bases por meio de um catálogo de dados. A pesquisa é classificada como aplicada e exploratória, com abor dagem predominantemente qualitativa, complementada por elementos quantitativos, e de senvolvida por meio de pesquisa bibliográfica e documental articulada a um estudo de caso experimental no ambiente computacional do Laboratório Agadê. Foram projetados workflows e pipelines parametrizados por metadados para processos de ELT com extra ções em CSV e via API, além de um catálogo de dados. Como resultado, nove bases de dados abertas, relacionadas ao trânsito e à saúde, foram integradas ao repositório, totali zando quase 54 milhões de registros, com rotinas de atualização e um catálogo de dados publicado na página web do laboratório, reduzindo o esforço manual de preparação de bases e facilitando a análise de dados no Laboratório Agadê.

Palavras-chave Arquitetura de dados, engenharia de dados, ELT, repositório de dados, catálogo de dados

Citação ALCÂNTARA, Adriel Sena de. Arquitetura e Engenharia de Dados do Laboratório Agadê. 2025. Trabalho de Conclusão de Curso (Gestão da Informação) - Universidade Federal de Pernambuco, Recife, 2025.

Disponível em https://repositorio.ufpe.br/handle/123456789/67424

Um Novo Modelo de Dicionário de Dados Baseado em Regras e sua Aplicação em uma Biblioteca Hospitalar Infantil

Dicionário de dados é um instrumento que documenta os dados presentes em uma base de dados específica, embora o seu uso seja comumente negligenciado. Este trabalho teve como objetivo desenvolver um novo modelo de dicionário de dados baseado em regras para apoiar a gestão e o uso dos dados em ambientes organizacionais e, em seguida, aplicá-lo em uma biblioteca hospitalar infantil para automatizar a medição da qualidade de dados. O modelo proposto simplifica e uniformiza os metadados necessários, além de formalizar as regras que os dados devem seguir, incluído as regras de integridade e de negócio. O estudo adotou uma metodologia exploratória, com abordagem qualitativa e quantitativa, combinando revisão bibliográfica sobre dicionário de dados. O modelo foi aplicado na base de dados da biblioteca hospitalar infantil do Hospital da Restauração de Pernambuco, Brasil. O dicionário de dados foi implementado no sistema de gerenciamento de banco de dados PostgreSQL e com apoio do software Agadê Bibliotecas, desenvolvido pela Laboratório Agadê, UFPE. Um total de 417 regras foram verificadas, das quais 414 foram satisfeitas, resultando em um grau de qualidade de dados de 99,28%. Os resultados experimentais servem de evidência da eficácia do modelo proposto como instrumento para qualidade, controle e gestão automatizada de dados.

Palavras-chave Dicionário de dados, banco de dados, qualidade de dados, biblioteca hospitalar infantil

Citação PASSOS, Karolayne. Um Novo Modelo de Dicionário de Dados Baseado em Regras e sua Aplicação em uma Biblioteca Hospitalar Infantil. 2025. Trabalho de Conclusão de Curso (Gestão da Informação) - Universidade Federal de Pernambuco, Recife, 2025.

Disponível em https://attena.ufpe.br/handle/123456789/65692

Descoberta e Análise de Padrões na Base de Dados de Infrações de Trânsito do Recife

Este trabalho investiga como a mineração de dados públicos sobre infrações de trânsito pode revelar padrões de comportamento na cidade do Recife. Utilizando dados do Portal de Dados Abertos do Recife, a pesquisa adota uma abordagem exploratória e descritiva, com o objetivo de descobrir e analisar os padrões identificados. A metodologia envolve a coleta e a mineração de dados, por meio do uso do algoritmo Apriori, com o intuito de identificar associações relevantes entre os registros de infrações de trânsito e variáveis temporais. Os resultados demonstram que as variáveis temporais influenciam significativamente os padrões de registros de infrações, possibilitando uma melhor compreensão das dinâmicas urbanas e contribuindo para o planejamento estratégico. Conclui-se que a mineração de dados pode colaborar para uma gestão urbana mais eficiente, promovendo transparência, conscientização e fornecendo subsídios para a formulação de políticas públicas.

Palavras-chave Padrões, enriquecimento de dados, mineração de dados

Citação RIBAS, André Felipe Cicco. Descoberta e análise de padrões na base de dados de infrações de trânsito do Recife. 2025. Trabalho de Conclusão de Curso (Gestão da Informação) - Universidade Federal de Pernambuco, Recife, 2025.

Disponível em https://repositorio.ufpe.br/handle/123456789/62773

Infant Hospital Library: Case Study in a Brazilian Public Hospital

A criança, quando hospitalizada, perde a liberdade de se divertir, como está acostumada, por estar confinada em um ambiente hospitalar, sujeita a um tratamento médico que pode causar dor e medo. O adulto que acompanha precisa de informação sobre a doença e o tratamento da criança. A biblioteca hospitalar infantil tenta atender às necessidades de ambos os usuários. No entanto, essa biblioteca não totalmente considerada para investigação científica. Assim, este artigo investiga a estrutura e ações abordando três pontos como seguem. Primeiro, o software foi desenvolvido especificamente para esse tipo de biblioteca, o qual registrou os dados do catálogo, usuários e empréstimos de dois anos de serviço da biblioteca hospitalar infantil voluntária em um hospital público estadual brasileiro. Em seguida, um estudo exploratório das preferências de leitura dos usuários enquanto hospitalizados foi realizado, cujos achados seguem. Adultos exercem um importante papel em incentivar e auxiliar a leitura recreativa, na qual ocorrerem todas as faixas etárias de uma criança e similarmente entre gêneros. Além disso, os usuários preferiram ler literatura, religião e revistas em quadrinhos na língua nativa deles que geralmente consistem em histórias curtas. Finalmente, políticas de desenvolvimento de coleção foram determinadas com base nas preferências de leitura dos usuários.

Palavras-chave Infant hospital library, specialized software, collection development policies

Citação ÁVILA, B.; SILVA, M. Infant Hospital Library: Case Study in a Brazilian Public Hospital. Brazilian Journal of Information Science: Research Trends, v. 15, p. e02130, 2021. doi: 10.36311/1981-1640.2021.v15.e02130.

Disponível em https://revistas.marilia.unesp.br/index.php/bjis/article/view/12444

Estado da arte
Meta-Fibonacci Codes: Efficient Universal Coding of Natural Numbers

In this paper, we address the problem of the universal coding of natural numbers. A new numeration system is introduced, which is based on variable-r meta-Fibonacci sequences and it is a generalization of the Zeckendorf numeration system. This new numeration system is used to construct binary, prefix-free, uniquely decodable universal codes called meta-Fibonacci codes. The main advantage of these codes is that they are parametrized by a sequence of numbers, the sequence o. By controlling the growth of the values of this sequence, we can control the length of the code word. This means that we can provide a general framework for building efficient universal coders for natural numbers. Such framework is applied to the upper bounds of the code word length defined by Leung-Yan-Cheong and Cover (1978), Levenshtein (1968), and Ahlswede (1997). There is no other code meeting these bounds. In each case, we build meta-Fibonacci codes and demonstrate that the upper bound of their code word length is satisfied up to an additive constant, thereby solving these open problems. The framework may be applied to other upper bounds that satisfy Kraft inequality.

Palavras-chave Universal coding, natural numbers, numeration system, variable-r meta-Fibonacci sequences

Citação ÁVILA, B. T.; SOUZA, R. M. C. de. Meta-Fibonacci Codes: Efficient Universal Coding of Natural Numbers. IEEE Transactions on Information Theory, v. 63, n. 4, pp. 2357-2375, 2017, doi: 10.1109/TIT.2017.2663433.

Disponível em https://ieeexplore.ieee.org/document/7839972

Estado da arte
A Fast Orientation and Skew Detection Algorithm for Monochromatic Document Images

Very often in the digitization process, documents are either not placed with the correct orientation or are rotated of small angles in relation to the original image axis. These factors make more difficult the visualization of images by human users, increase the complexity of any sort of automatic image recognition, degrade the performance of OCR tools, increase the space needed for image storage, etc. This paper presents a fast algorithm for orientation and skew detection for complex monochromatic document images, which is capable of detecting any document rotation at a high precision.

Palavras-chave Image processing, computer vision, skew detection

Citação ÁVILA, B. T.; LINS, R. D. A fast orientation and skew detection algorithm for monochromatic document images. In: Proceedings of the 2005 ACM Symposium on Document Engineering. 2005. p. 118-126.

Disponível em https://dl.acm.org/doi/abs/10.1145/1096601.1096631

Estado da arte
A New Rotation Algorithm for Monochromatic Images

The classical rotation algorithm applied to monochromatic images introduces white holes in black areas, making edges uneven and disconnecting neighboring elements. Several algorithms in the literature address only the white hole problem. This paper proposes a new algorithm that solves those three problems, producing better quality images.

Palavras-chave Image processing, computer vision, rotation algorithm

Citação ÁVILA, B. T.; LINS, R. D.; OLIVEIRA, L. A new rotation algorithm for monochromatic images. In: Proceedings of the 2005 ACM Symposium on Document Engineering. 2005. p. 130-132.

Disponível em https://doi.org/10.1145/1096601.109663

Cataloging in a Children’s Hospital Library: A Case Study in a Brazilian Public Hospital

Cataloging is an essential activity of a children’s hospital library used not only to identify and retrieve bibliographic resources, but mainly to protect its users: hospitalized child and accompanying adult. The child is in a situation of extreme vulnerability, in which reading a mis-indicated book may harm him/her, while an appropriate book may help his/her recovery. In this paper, metadata is introduced to indicate the most appropriate user profile for each book. In addition, the design and cataloging process in the children’s hospital library of a Brazilian public hospital are detailed, including specific software and experimental results for cataloging.

Palavras-chave Children’s hospital library, cataloging, metadata, strategy, policy, software

Citação ÁVILA, B. T.; RAMINE, G.; FRANÇA, V.; SIZINA, I. Cataloging in a Children’s Hospital Library: A Case Study in a Brazilian Public Hospital. Cataloging & Classification Quarterly, v. 61, n. 3–4, p. 263–289, 2023.

Disponível em https://doi.org/10.1080/01639374.2023.2229822

Merge Source Coding

We show that any comparison-based merging algorithm can be naturally mapped into a source coder via a conversion function introduced here. By applying this function over some well known merging algorithms, namely Binary Merging and Recursive Merging, we show that they are closely related to a runlength-based coder with Rice coding and to the Binary Interpolative Coder, respectively. Furthermore, by applying the conversion function over the Probabilistic Merging algorithm we obtain a runlength-based coder that uses a new variant of the Rice code, namely Randomized Rice Code. This new code uses a random source of bits with the aim of reducing its average redundancy.

Palavras-chave Binary entropy coding, merging algorithms

Citação ÁVILA, B. T.; LABER, E. S. Merge source coding. ISIT'09: Proceedings of the 2009 IEEE international conference on Symposium on Information Theory, v. 1, p. 214-218, 2009.

Disponível em https://dl.acm.org/doi/10.5555/1701495.1701539