| Processo: | 09/12643-8 |
| Modalidade de apoio: | Bolsas no Brasil - Mestrado |
| Data de Início da vigência: | 01 de março de 2010 |
| Data de Término da vigência: | 30 de setembro de 2011 |
| Área de conhecimento: | Ciências Biológicas - Bioquímica - Biologia Molecular |
| Pesquisador responsável: | Arthur Gruber |
| Beneficiário: | Luiz Thibério Lira Diniz Rangel |
| Instituição Sede: | Instituto de Ciências Biomédicas (ICB). Universidade de São Paulo (USP). São Paulo , SP, Brasil |
| Assunto(s): | Biologia computacional |
| Palavra(s)-Chave do Pesquisador: | Anotação de sequências | bioinformática | Pipeline | Processamento de sequências | Sequenciamento de ESTs | Sequenciamento de genomas | Bioinformática |
Resumo A plataforma EGene (Durham et al., Bioinformatics 21(12): 2812-2813, 2005) foi desenvolvida pelo nosso grupo e se caracteriza por ser um sistema integrado e customizável para a construção de pipelines. O sistema EGene permite encadear uma série de componentes diferentes de processamento, em uma ordem e composição totalmente definidas pelo usuário. A versão 2 do sistema EGene, ainda não disponibilizada publicamente, possui uma ampla gama de componentes de anotação que inclui um programa para a determinação de ORFs com tradutor das sequências protéicas, módulos para sete preditores de genes (Genscan, GlimmerM, GlimmerHMM, Twinscan, Phat, ESTscan e SNAP) , três programas de busca de repetições seriadas (TRF, String e MREPs), tRNAscan-SE, mapeamento de cDNAs (Sim4 e Exonerate), busca de similaridade (Blast), busca de motivos protéicos (HMMER/Pfam, RPS-Blast, InterProScan), busca de domínios transmembranares (TMHMM) e de peptídeo sinal (SignalP) ou ambos (Phobius), busca de sítios de ancoragem GPI (DGPI), mapeamento de termos GO, e geradores de anotação no padrão feature table (FT) e GFF3. Além disso, há um componente que agrega todas as evidências de anotação numa página web para cada uma das sequências anotadas de forma automática. No presente projeto pretende-se dar prosseguimento ao desenvolvimento da plataforma, incrementando o escopo de aplicações e a funcionalidade do EGene para permitir a integração com bancos de dados e anotação funcional. Assim, objetiva-se: desenvolver componentes para a identificação de ortologia em diferentes bases (COG/KOG e eggNOG) e o mapeamento das proteínas em vias metabólicas do KEGG; a integração de dados de anotação com dados de expressão; desenvolver um componente para integração dos dados de anotação do EGene com o visualizador Genome Browser; implementar a integração do EGene com um sistema de gerenciamento de banco de dados relacional; e desenvolver a infra-estrutura computacional no contexto do EGene para permitir anotações probabilísticas e com vocabulário controlado. Pretende-se ainda aplicar essas novas ferramentas para se obter uma melhor anotação funcional dos dados de sequenciamento de ORESTES de três espécies de Eimeria de galinha doméstica; e construir um banco de dados relacional que permita o uso de buscas complexas e a mineração do dados. | |
| Matéria(s) publicada(s) na Agência FAPESP sobre a bolsa: | |
| Mais itensMenos itens | |
| TITULO | |
| Matéria(s) publicada(s) em Outras Mídias ( ): | |
| Mais itensMenos itens | |
| VEICULO: TITULO (DATA) | |
| VEICULO: TITULO (DATA) | |