Back to results
Bibliographic record · Consultation and access
Document

Classificação automática de documentos usando subespaços aleatórios e conjuntos de classificadores

Gean, Chu Chia · SEDICI UNLP · 2004

Open-access full text
Quick overview. Review the resource’s basic details, then access the content using the main button. This page shows only the information needed to identify, cite, and open the work.

Resource access

Open the content from the main option or choose another available source.

SEDICI UNLP SEDICI UNLP OAI-PMH
Entrar por SEDICI UNLP
Main access

Open-access full text

Texto completo identificado como acceso abierto.
Open text

Summary

Descripción general del contenido del recurso.

Atualmente, devido ao volume grande de texto disponível em meios digitais, a classificação automática de documentos se torna uma tarefa importante da área do Tratamento Automatizado de Informações. Neste artigo descreve-se uma nova abordagem para o problema, baseada no modelo vetorial para o tratamento de textos e no uso de técnicas de Reconhecimento de Padrões. Como coleções de textos produzem espaços vetoriais de dimensão bastante elevada, o problema é tratado usando várias técnicas de préprocessamento e um conjunto de classificadores baseados em instâncias – do tipo k-vizinhos mais próximos, cada um dos quais dedicado a um subespaço do espaço original. A classificação final é obtida por uma combinação de resultados dos classificadores individuais. Esta abordagem foi aplicada a documentos oriundos das bases de dados TIPSTER e REUTERS, amplamente utilizadas na área. São apresentados os principais resultados obtidos e algumas conclusões e perspectivas do trabalho. Nowadays, due to the large volume of text available in digital media, the automatic document categorization becomes an important modern Information Retrieval task. In this paper we describe a new approach to the problem, based on the classical vector space model for text treatment and on the use of Pattern Recognition techniques. As texts collections produce huge dimensional vector spaces, we attack the problem using several preprocessing techniques, and a set of k-Nearest-Neighbors classifiers, each of them dedicated to a sub-space of the original space. The final classification is obtained by a combination of the results of the individual classifiers. We apply our approach to documents extracted from the TIPSTER and REUTERS databases. The obtained results and some conclusions are presented. Eje: V - Workshop de agentes y sistemas inteligentes

How to cite

Elegí el formato que necesitás y copiá la referencia al portapapeles.

APA 7

Gean, C. C. (2004). Classificação automática de documentos usando subespaços aleatórios e conjuntos de classificadores. SEDICI UNLP. http://sedici.unlp.edu.ar/handle/10915/22507

MLA

Gean, Chu Chia. Classificação automática de documentos usando subespaços aleatórios e conjuntos de classificadores. SEDICI UNLP, 2004. http://sedici.unlp.edu.ar/handle/10915/22507.

Chicago

Gean, Chu Chia. 2004. Classificação automática de documentos usando subespaços aleatórios e conjuntos de classificadores. SEDICI UNLP. http://sedici.unlp.edu.ar/handle/10915/22507.

Harvard

Gean, C. C. 2004, Classificação automática de documentos usando subespaços aleatórios e conjuntos de classificadores, SEDICI UNLP, available at: http://sedici.unlp.edu.ar/handle/10915/22507 [Accessed 6 Aug. 2026].

Share and print

Save the record, copy its permanent link, or print it as a PDF.

Export reference

You can export the record in common formats for use in a reference manager.

Resource details

Bibliographic information to help confirm that this is the correct material.

Title
Classificação automática de documentos usando subespaços aleatórios e conjuntos de classificadores
Author / contributors
Gean, Chu Chia
Publisher
SEDICI UNLP
Publication year
2004
Language
Portuguese

Subjects

Explore related resources through these subjects.

Copied