Virtualização de grandes bases de dados irregularmente distribuídas e replicadas

Diego Lopes Nogueira

Please use this identifier to cite or link to this item: http://hdl.handle.net/1843/SLBS-6XYFRZ

Full metadata record

DC Field	Value	Language
dc.contributor.advisor1	Renato Antonio Celso Ferreira	pt_BR
dc.contributor.referee1	Dorgival Olavo Guedes Neto	pt_BR
dc.contributor.referee2	Wagner Meira Junior	pt_BR
dc.creator	Diego Lopes Nogueira	pt_BR
dc.date.accessioned	2019-08-12T08:41:45Z	-
dc.date.available	2019-08-12T08:41:45Z	-
dc.date.issued	2006-12-01	pt_BR
dc.identifier.uri	http://hdl.handle.net/1843/SLBS-6XYFRZ	-
dc.description.abstract	Large volumes of data are generated every day by experiments, simulations and all sorts of applications. It is common to observe situations where portions of data are irregularly replicated and distributed in different data sources. The independent generation of correlated data and lack of collaboration on sharing these data result in an irregularly replicated and distributed data set. It would be desirable to be able to handle these several pieces of irregular data (replicated or not) as a unique large dataset. This is called data virtualization and is the focus of this work. On this dissertation, we explore a system which is capable of dealing with irregularly replicated data and is able to create a virtual view of the union of the individual irregular portions of data hosted by each data source. We present a geometric model to represent data intervals. The model allows for virtualization of an irregularly replicated and distributed data set. The work also presents a meta-data indexing mechanism to allow the system to process ranged queries submitted to the data set available through the data virtualization system. Two query fragment scheduling algorithms are proposed, based on the greedy andsimulated annealing approaches. These algorithms are responsible for the selection of which server will be in charge of serving each data queryfragment. The algorithms try to minimize the queries' response time and to balance the load between the servers, taking into account their differentservice capacities and the workload to which each server is submitted to at any given time. The performances of the algorithms are compared based on simulation results and the parameter values used were taken from the workload characterization of a real data-oriented application (the Virtual Microscope).	pt_BR
dc.description.resumo	Grandes volumes de dados são gerados diariamente por experimentos, simulações e vários outros tipos de aplicações. É comum observar situações nas quais porções desses dados são irregularmente replicadas e distribuídas em diferentes fontesde dados. A replicação e distribuição irregulares se dão pela geraçãoindependente dos diferentes intervalos de dados correlacionados e pela freqüente ausência de colaboração no compartilhamento de parte desses volumes de dados. É desejável que seja possível lidar com essas várias porções de dados irregulares (replicados ou não) como uma única base de dados. A virtualização de dados torna isto possvel e é o principal foco deste trabalho. Nesta dissertação, exploramos um sistema capaz de lidar com dados irregularmente replicados e criar uma visão virtual única a partir da união de porções irregulares dos dados disponíveis em cada uma das fontes de dados que compõem o sistema. Apresentamos uma modelagem geométrica dos intervalos de dados que suporta a virtualização de uma base de dados irregularmente replicada e distribuída, assim como um mecanismo de indexação de meta-dados que permite o processamento de consultas por intervalos de dados submetidas à base de dados disponível no sistema de virtualização de dados. Esta dissertação também propõe dois algoritmos de escalonamento de fragmentos de consultas baseados nas abordagens gulosa e resfriamento simulado. Esses algoritmos são responsáveis pela seleção de qual servidor é responsável porservir cada fragmento de uma consulta por intervalo de dados. Os algoritmos buscam minimizar o tempo de resposta das consultas e balancear a carga de trabalho entre os servidores considerando sua capacidade de serviço e carga de trabalho instantânea. A comparação de desempenho dos algoritmos são baseadas em simulações e os valores dos parâmetros utilizados foram obtidos a partir da caracterização da carga de trabalho de uma aplicação real e fortementedependente de dados (o Microscópio Virtual).	pt_BR
dc.language	Português	pt_BR
dc.publisher	Universidade Federal de Minas Gerais	pt_BR
dc.publisher.initials	UFMG	pt_BR
dc.rights	Acesso Aberto	pt_BR
dc.subject	virtualização	pt_BR
dc.subject	base de dados	pt_BR
dc.subject.other	Sistemas de computação virtual	pt_BR
dc.subject.other	Computação	pt_BR
dc.subject.other	Banco de dados Gerência	pt_BR
dc.title	Virtualização de grandes bases de dados irregularmente distribuídas e replicadas	pt_BR
dc.type	Dissertação de Mestrado	pt_BR
Appears in Collections:	Dissertações de Mestrado

Files in This Item:

File	Description	Size	Format
diegolopesnogueira.pdf		641.05 kB	Adobe PDF	View/Open

Show simple item record