Publication:
Clusterização hierárquica espacial

Loading...
Thumbnail Image

item.page.format.extent

item.page.description.firstpage

item.page.description.lastpage

Publication data

item.page.date.series

item.page.date.event

item.page.organization.date

item.page.date.submitted

item.page.project.date

item.page.description.edition

Language

por

item.page.coverage.spatial

Brasil

item.page.coverage.temporal

item.page.location.country

BR

organization.page.location.country

item.page.type.events

item.page.type

item.page.degree.level

item.page.source.urlsource

ISBN

ISSN

DOI

dARK

item.page.project.ID

item.page.project.productID

Copyright Holder

Instituto de Pesquisa Econômica Aplicada (Ipea)

Access to Information

Acesso Aberto

Terms of Use

É permitida a reprodução deste texto, desde que obrigatoriamente citada a fonte. Reproduções para fins comerciais são rigorosamente proibidas.

item.page.title.alternative

Texto para Discussão (TD) 1427: Clusterização hierárquica espacial, Hierarchical spatial clustering

item.page.organization.alternative

item.page.name.variant

Advisor

item.page.contributor.editor

item.page.contributor.thesiscommitee

item.page.contributor.organizer

item.page.contributor.coordinator

item.page.contributor.other

item.page.relation.ispartofseries

Speaker / Moderator / Discussant

Abstract

Este estudo apresenta uma nova metodologia para clusterização hierárquica espacial de polígonos contíguos, com base em um sistema de coordenadas georreferenciadas. O algoritmo proposto é construído a partir de uma modificação do algoritmo de clusterização hierárquica tradicional, comumente utilizado na literatura de análise multivariada. De acordo com o método proposto neste trabalho, a cada passo do processo sequencial de junção de clusters, impõe-se que somente conglomerados (grupos de polígonos originais, como municípios, estados ou setores censitários) vizinhos possam ser unidos para formar um novo cluster maior. Neste caso, foram definidos como vizinhos polígonos que possuem um vértice em comum (vizinhança do tipo queen) ou uma aresta em comum (vizinhança do tipo rook). O estudo apresenta aplicações da nova metodologia para clusterização dos municípios brasileiros, no ano de 2000, com base em um conjunto de variáveis socioeconômicas. Diversos métodos de clusterização são estudados, assim como diferentes tipos de distâncias entre vetores. Os métodos estudados foram: centroid, single linkage, complete linkage, average linkage e average linkage weighted, Ward’s minimum variance e método da mediana. As distâncias utilizadas foram: norma Lp (em particular, as normas L1 e L2), Mahalanobis e distância euclidiana corrigida pela variância (variance corrected) – caso particular da distância de Mahalanobis. Finalmente, apresenta-se uma discussão sobre alguns métodos comumente utilizados para seleção do número de clusters.

item.page.description.abstractalternative

This paper presents a new methodology for hierarchical spatial clustering of contiguous polygons, based on a geographic coordinate system. The proposed algorithm is built upon a modification of traditional hierarchical clustering algorithm, commonly used in the multivariate analysis literature. According to the proposed method in this paper, at each step of the sequential process of collapsing clusters, only neighbor clusters (groups of original polygons, i.e. municipalities, census tracts, states) are allowed to be collapsed to form a bigger cluster. Two types of neighborhood are used: polygons with one edge in common (rook neighborhood) or polygons with only one point in common (queen neighborhood). In this paper, the methodology is employed to create clusters of Brazilian municipalities, for the year 2000, based on a group of socio-economic variables. Several clustering methods are investigated, as well as several types of vector distances. The studied methods were: centroid method, single linkage, complete linkage, average linkage, average linkage weighted, Ward minimum variance e median method. The studied distances were: Lp norm (particularly, L1 e L2 norms), Mahalanobis distance and variance corrected Euclidian distance. Finally, a discussion on selection of the number of clusters is presented.

organization.page.description

person.page.description

Email Address

person.page.identifier.orcid

person.page.identifier.lattes

person.page.identifier.gsid

person.page.identifier.rid

person.page.identifier.scopus-author-id

project.page.project.description

project.page.project.productdescription

item.page.subject.vcipea

item.page.subject.otherlanguages

Citation

item.page.description.version

Description

item.page.description.series

item.page.relation.replaces

Final version of this publication

item.page.relation.references

organization.page.relation.references

Book Chapter

Primary Version

Events

News

REPOSITÓRIO DO CONHECIMENTO DO IPEA
Redes sociais