A Bioinformatics Approach for Detecting Repetitive Nested Motifs using Pattern Matching

Authors
Romero, José Rodolfo; Carballido, Jessica Andrea; Garbus, Ingrid; Echenique, Carmen Viviana; Ponzoni, Ignacio
Publication Year
2016
Language
English
Format
article
Status
Published version
Description
The identification of nested motifs in genomic sequences is a complex computational problem. The detection of these patterns is important to allow discovery of transposable element (TE) insertions, incomplete reverse transcripts, deletions, and/or mutations. Here, we designed a de novo strategy for detecting patterns that represent nested motifs based on exhaustive searches for pairs of motifs and combinatorial pattern analysis. These patterns can be grouped into three categories: motifs within other motifs, motifs flanked by other motifs, and motifs of large size. Our methodology, applied to genomic sequences from the plant species Aegilops tauschii and Oryza sativa, revealed that it is possible to find putative nested TEs by detecting these three types of patterns. The results were validated though BLAST alignments, which revealed the efficacy and usefulness of the new method, which we call Mamushka.
Fil: Romero, José Rodolfo. Consejo Nacional de Investigaciones Científicas y Técnicas. Centro Científico Tecnológico Conicet - Bahía Blanca. Centro de Recursos Naturales Renovables de la Zona Semiárida. Universidad Nacional del Sur. Centro de Recursos Naturales Renovables de la Zona Semiárida; Argentina
Fil: Carballido, Jessica Andrea. Consejo Nacional de Investigaciones Científicas y Técnicas. Centro Científico Tecnológico Conicet - Bahía Blanca. Instituto de Cs. E Ingeniería de la Computacion; Argentina
Fil: Garbus, Ingrid. Consejo Nacional de Investigaciones Científicas y Técnicas. Centro Científico Tecnológico Conicet - Bahía Blanca. Centro de Recursos Naturales Renovables de la Zona Semiárida. Universidad Nacional del Sur. Centro de Recursos Naturales Renovables de la Zona Semiárida; Argentina
Fil: Echenique, Carmen Viviana. Consejo Nacional de Investigaciones Científicas y Técnicas. Centro Científico Tecnológico Conicet - Bahía Blanca. Centro de Recursos Naturales Renovables de la Zona Semiárida. Universidad Nacional del Sur. Centro de Recursos Naturales Renovables de la Zona Semiárida; Argentina
Fil: Ponzoni, Ignacio. Consejo Nacional de Investigaciones Científicas y Técnicas. Centro Científico Tecnológico Conicet - Bahía Blanca. Instituto de Cs. E Ingeniería de la Computacion; Argentina
Subject
REPETITIVE MOTIFS
NESTED MOTIFS
EXACT SEQUENCE ANALYSIS
STRUCTURAL BIOINFORMATICS
Ética relacionada con Biotecnología Agrícola
Biotecnología Agropecuaria
CIENCIAS AGRÍCOLAS
Access level
Open access
License
https://creativecommons.org/licenses/by-nc-sa/2.5/ar/
Repository
CONICET Digital (CONICET)
Institution
Consejo Nacional de Investigaciones Científicas y Técnicas
OAI Identifier
oai:ri.conicet.gov.ar:11336/25982