Torna ai risultati
Scheda bibliografica · Consultazione e accesso
Document

Classificação automática de documentos usando subespaços aleatórios e conjuntos de classificadores

Gean, Chu Chia · SEDICI UNLP · 2004

Testo completo ad accesso aperto
Lettura rapida. Controlla i dati essenziali della risorsa e accedi al contenuto con il pulsante principale. La scheda mostra solo le informazioni necessarie per identificare, citare e aprire l’opera.

Accesso alla risorsa

Apri il contenuto dall’opzione principale o scegli un’altra fonte disponibile.

SEDICI UNLP SEDICI UNLP OAI-PMH
Entrar por SEDICI UNLP
Accesso principale

Testo completo ad accesso aperto

Texto completo identificado como acceso abierto.
Apri testo

Riepilogo

Descripción general del contenido del recurso.

Atualmente, devido ao volume grande de texto disponível em meios digitais, a classificação automática de documentos se torna uma tarefa importante da área do Tratamento Automatizado de Informações. Neste artigo descreve-se uma nova abordagem para o problema, baseada no modelo vetorial para o tratamento de textos e no uso de técnicas de Reconhecimento de Padrões. Como coleções de textos produzem espaços vetoriais de dimensão bastante elevada, o problema é tratado usando várias técnicas de préprocessamento e um conjunto de classificadores baseados em instâncias – do tipo k-vizinhos mais próximos, cada um dos quais dedicado a um subespaço do espaço original. A classificação final é obtida por uma combinação de resultados dos classificadores individuais. Esta abordagem foi aplicada a documentos oriundos das bases de dados TIPSTER e REUTERS, amplamente utilizadas na área. São apresentados os principais resultados obtidos e algumas conclusões e perspectivas do trabalho. Nowadays, due to the large volume of text available in digital media, the automatic document categorization becomes an important modern Information Retrieval task. In this paper we describe a new approach to the problem, based on the classical vector space model for text treatment and on the use of Pattern Recognition techniques. As texts collections produce huge dimensional vector spaces, we attack the problem using several preprocessing techniques, and a set of k-Nearest-Neighbors classifiers, each of them dedicated to a sub-space of the original space. The final classification is obtained by a combination of the results of the individual classifiers. We apply our approach to documents extracted from the TIPSTER and REUTERS databases. The obtained results and some conclusions are presented. Eje: V - Workshop de agentes y sistemas inteligentes

Come citare

Elegí el formato que necesitás y copiá la referencia al portapapeles.

APA 7

Gean, C. C. (2004). Classificação automática de documentos usando subespaços aleatórios e conjuntos de classificadores. SEDICI UNLP. http://sedici.unlp.edu.ar/handle/10915/22507

MLA

Gean, Chu Chia. Classificação automática de documentos usando subespaços aleatórios e conjuntos de classificadores. SEDICI UNLP, 2004. http://sedici.unlp.edu.ar/handle/10915/22507.

Chicago

Gean, Chu Chia. 2004. Classificação automática de documentos usando subespaços aleatórios e conjuntos de classificadores. SEDICI UNLP. http://sedici.unlp.edu.ar/handle/10915/22507.

Harvard

Gean, C. C. 2004, Classificação automática de documentos usando subespaços aleatórios e conjuntos de classificadores, SEDICI UNLP, available at: http://sedici.unlp.edu.ar/handle/10915/22507 [Accessed 7 Aug. 2026].

Condividi e stampa

Salva la scheda, copia il link permanente o stampala in PDF.

Esporta riferimento

Esporta il record nei formati più comuni per usarlo con un gestore bibliografico.

Dettagli della risorsa

Informazioni bibliografiche utili per verificare che sia il materiale corretto.

Titolo
Classificação automática de documentos usando subespaços aleatórios e conjuntos de classificadores
Autore / collaboratori
Gean, Chu Chia
Editore
SEDICI UNLP
Anno di pubblicazione
2004
Lingua
Portugués

Soggetti

Esplora risorse correlate a partire da questi soggetti.

Copiato