Um sistema imunológico artificial para classificação hierárquica e multi-label de funções de proteínas

CAPES === Esta tese propõe um novo algoritmo baseado em Sistemas Imunológicos Artificiais (SIA) para classificação hierárquica e multi-label, onde os classificadores gerados são representados na forma de regras SE-ENTÃO. A classificação hierárquica e multi-label é considerada desafiadora uma vez que...

Full description

Bibliographic Details
Main Author: Alves, Roberto Teixeira
Other Authors: Delgado, Myriam Regattieri de Biase da Silva
Language:Portuguese
Published: Universidade Tecnológica Federal do Paraná 2015
Subjects:
Online Access:http://repositorio.utfpr.edu.br/jspui/handle/1/1057
id ndltd-IBICT-oai-repositorio.utfpr.edu.br-1-1057
record_format oai_dc
collection NDLTD
language Portuguese
sources NDLTD
topic Bioinformática
Sistema imunológico - Simulação por computador
Mineração de dados (Computação)
Engenharia elétrica
Bioinformatics
Immune system - Computer simulation
Data mining
Electric engineering
spellingShingle Bioinformática
Sistema imunológico - Simulação por computador
Mineração de dados (Computação)
Engenharia elétrica
Bioinformatics
Immune system - Computer simulation
Data mining
Electric engineering
Alves, Roberto Teixeira
Um sistema imunológico artificial para classificação hierárquica e multi-label de funções de proteínas
description CAPES === Esta tese propõe um novo algoritmo baseado em Sistemas Imunológicos Artificiais (SIA) para classificação hierárquica e multi-label, onde os classificadores gerados são representados na forma de regras SE-ENTÃO. A classificação hierárquica e multi-label é considerada desafiadora uma vez que um exemplo está associado a uma ou mais classes organizadas hierarquicamente, sendo que esta organização estrutural de classes deve ser considerada na construção dos classificadores. A técnica proposta aborda a construção de classificadores hierárquicos locais (onde cada classificador processa apenas exemplos de classes em uma região local da hierarquia) e globais (onde um único classificador processa exemplos de todas as classes ao mesmo tempo). A área de aplicação utilizada para validação desta tese foi a predição de função biológica de proteínas usando termos da ontologia gênica como classes a serem preditas pelo SIA. O desempenho do algoritmo é avaliado experimentalmente para 10 bases de proteínas. Os critérios de avaliação do algoritmo nos experimentos computacionais são a precisão preditiva (taxa de acerto e área da curva precision-recall) e a simplicidade do conhecimento descoberto (medida pelo número de regras e número total de condições nas regras descobertas). Os experimentos computacionais permitem identificar parâmetros e procedimentos que influenciam no desempenho da técnica proposta. Os testes comparativos com outras abordagens mostram que sobre alguns conjuntos de experimentos a abordagem proposta se mostrou superior, enquanto em outros conjuntos não foi possível superar a técnica da literatura usada para comparação. === This thesis proposes a new approach based on Artificial Immune System (AIS) for hierarchical multi-label classification, where the classifiers produced by the system are represented in the form of IF-THEN classification rules. Hierarchical multi-label classification is a challenging problem, because an example is associated with one or more classes organized into a hierarchy and the class hierarchy must be considered in the construction of the classifiers. The proposed method addresses the construction of local hierarchical classifiers (where each classifier processes only examples of classes in a local region of the hierarchy) and global hierarchical classifiers (where a single classifier processes examples of all classes at the same time). The application domain used to validate the proposed methods was the prediction of the biological function of proteins, using terms of the Gene Ontology as classes to be predicted by the AIS. The performance of the algorithm was evaluated in computational experiments with 10 datasets of proteins. The evaluation criteria in these experiments were the predictive accuracy (accuracy rate and the area under the precision-recall curve) and the simplicity of the discovered knowledge (measured by the number of rules and total number of conditions in the discovered rules). The computational experiments allowed the identification of parameter settings and procedures that significantly influence the performance of the proposed method. The experiments comparing the proposed method with other methods have shown that in some datasets the proposed method outperformed other methods, whilst in other datasets it was not possible to outperform other methods proposed in the literature.
author2 Delgado, Myriam Regattieri de Biase da Silva
author_facet Delgado, Myriam Regattieri de Biase da Silva
Alves, Roberto Teixeira
author Alves, Roberto Teixeira
author_sort Alves, Roberto Teixeira
title Um sistema imunológico artificial para classificação hierárquica e multi-label de funções de proteínas
title_short Um sistema imunológico artificial para classificação hierárquica e multi-label de funções de proteínas
title_full Um sistema imunológico artificial para classificação hierárquica e multi-label de funções de proteínas
title_fullStr Um sistema imunológico artificial para classificação hierárquica e multi-label de funções de proteínas
title_full_unstemmed Um sistema imunológico artificial para classificação hierárquica e multi-label de funções de proteínas
title_sort um sistema imunológico artificial para classificação hierárquica e multi-label de funções de proteínas
publisher Universidade Tecnológica Federal do Paraná
publishDate 2015
url http://repositorio.utfpr.edu.br/jspui/handle/1/1057
work_keys_str_mv AT alvesrobertoteixeira umsistemaimunologicoartificialparaclassificacaohierarquicaemultilabeldefuncoesdeproteinas
_version_ 1718680986136346624
spelling ndltd-IBICT-oai-repositorio.utfpr.edu.br-1-10572018-05-28T04:41:08Z Um sistema imunológico artificial para classificação hierárquica e multi-label de funções de proteínas Alves, Roberto Teixeira Delgado, Myriam Regattieri de Biase da Silva Freitas, Alex Alves Bioinformática Sistema imunológico - Simulação por computador Mineração de dados (Computação) Engenharia elétrica Bioinformatics Immune system - Computer simulation Data mining Electric engineering CAPES Esta tese propõe um novo algoritmo baseado em Sistemas Imunológicos Artificiais (SIA) para classificação hierárquica e multi-label, onde os classificadores gerados são representados na forma de regras SE-ENTÃO. A classificação hierárquica e multi-label é considerada desafiadora uma vez que um exemplo está associado a uma ou mais classes organizadas hierarquicamente, sendo que esta organização estrutural de classes deve ser considerada na construção dos classificadores. A técnica proposta aborda a construção de classificadores hierárquicos locais (onde cada classificador processa apenas exemplos de classes em uma região local da hierarquia) e globais (onde um único classificador processa exemplos de todas as classes ao mesmo tempo). A área de aplicação utilizada para validação desta tese foi a predição de função biológica de proteínas usando termos da ontologia gênica como classes a serem preditas pelo SIA. O desempenho do algoritmo é avaliado experimentalmente para 10 bases de proteínas. Os critérios de avaliação do algoritmo nos experimentos computacionais são a precisão preditiva (taxa de acerto e área da curva precision-recall) e a simplicidade do conhecimento descoberto (medida pelo número de regras e número total de condições nas regras descobertas). Os experimentos computacionais permitem identificar parâmetros e procedimentos que influenciam no desempenho da técnica proposta. Os testes comparativos com outras abordagens mostram que sobre alguns conjuntos de experimentos a abordagem proposta se mostrou superior, enquanto em outros conjuntos não foi possível superar a técnica da literatura usada para comparação. This thesis proposes a new approach based on Artificial Immune System (AIS) for hierarchical multi-label classification, where the classifiers produced by the system are represented in the form of IF-THEN classification rules. Hierarchical multi-label classification is a challenging problem, because an example is associated with one or more classes organized into a hierarchy and the class hierarchy must be considered in the construction of the classifiers. The proposed method addresses the construction of local hierarchical classifiers (where each classifier processes only examples of classes in a local region of the hierarchy) and global hierarchical classifiers (where a single classifier processes examples of all classes at the same time). The application domain used to validate the proposed methods was the prediction of the biological function of proteins, using terms of the Gene Ontology as classes to be predicted by the AIS. The performance of the algorithm was evaluated in computational experiments with 10 datasets of proteins. The evaluation criteria in these experiments were the predictive accuracy (accuracy rate and the area under the precision-recall curve) and the simplicity of the discovered knowledge (measured by the number of rules and total number of conditions in the discovered rules). The computational experiments allowed the identification of parameter settings and procedures that significantly influence the performance of the proposed method. The experiments comparing the proposed method with other methods have shown that in some datasets the proposed method outperformed other methods, whilst in other datasets it was not possible to outperform other methods proposed in the literature. 2015-02-09T18:46:47Z 2015-02-09T18:46:47Z 2010-02-26 info:eu-repo/semantics/publishedVersion info:eu-repo/semantics/doctoralThesis ALVES, Roberto Teixeira. Um sistema imunológico artificial para classificação hierárquica e multi-label de funções de proteínas. 2010. 219 f. Tese (Doutorado em Engenharia Elétrica e Informática Industrial) – Universidade Tecnológica Federal do Paraná, Curitiba, 2010. http://repositorio.utfpr.edu.br/jspui/handle/1/1057 por info:eu-repo/semantics/openAccess Universidade Tecnológica Federal do Paraná Curitiba Programa de Pós-Graduação em Engenharia Elétrica e Informática Industrial reponame:Repositório Institucional da UTFPR instname:Universidade Tecnológica Federal do Paraná instacron:UTFPR