Aplicaciones de data mining al estudio de la biodiversidad

Autores
Santa María, Cristóbal; Soria, Marcelo A.
Año de publicación
2011
Idioma
español castellano
Tipo de recurso
documento de conferencia
Estado
versión publicada
Descripción
El trabajo propone la utilización conjunta de técnicas de data mining y simulación para evaluar la riqueza y diversidad de comunidades microbianas. Se parte de una muestra formada por distintas secuencias de ADN que se alinean para luego ser agrupadas según su similaridad en clusters. Cada uno de estos clusters es una especie y el propósito es estimar su número y distribución en la comunidad basándose en la información que da la muestra. La técnica de rarefacción, sustentada en el procedimiento bootstrap, permite construir una curva cuya tendencia asintótica es precisamente la riqueza de la comunidad. Para alcanzar tal asíntota, y a la vez para estimar la distribución estadística de las especies, se propone una simulación que utiliza la estimación de Turing sobre la probabilidad de nueva especie al seleccionar un individuo nuevo y la idea de cobertura para la porción de la distribución que cubre la muestra.
Eje: Bases de datos y minería de datos
Red de Universidades con Carreras en Informática (RedUNCI)
Materia
Ciencias Informáticas
base de datos
cluster
Data mining
riqueza
diversidad
rarefacción
simulación
cobertura
Nivel de accesibilidad
acceso abierto
Condiciones de uso
http://creativecommons.org/licenses/by-nc-sa/2.5/ar/
Repositorio
SEDICI (UNLP)
Institución
Universidad Nacional de La Plata
OAI Identificador
oai:sedici.unlp.edu.ar:10915/20030

id SEDICI_308f204bb19c4274129f67a4697aec54
oai_identifier_str oai:sedici.unlp.edu.ar:10915/20030
network_acronym_str SEDICI
repository_id_str 1329
network_name_str SEDICI (UNLP)
spelling Aplicaciones de data mining al estudio de la biodiversidadSanta María, CristóbalSoria, Marcelo A.Ciencias Informáticasbase de datosclusterData miningriquezadiversidadrarefacciónsimulacióncoberturaEl trabajo propone la utilización conjunta de técnicas de data mining y simulación para evaluar la riqueza y diversidad de comunidades microbianas. Se parte de una muestra formada por distintas secuencias de ADN que se alinean para luego ser agrupadas según su similaridad en clusters. Cada uno de estos clusters es una especie y el propósito es estimar su número y distribución en la comunidad basándose en la información que da la muestra. La técnica de rarefacción, sustentada en el procedimiento bootstrap, permite construir una curva cuya tendencia asintótica es precisamente la riqueza de la comunidad. Para alcanzar tal asíntota, y a la vez para estimar la distribución estadística de las especies, se propone una simulación que utiliza la estimación de Turing sobre la probabilidad de nueva especie al seleccionar un individuo nuevo y la idea de cobertura para la porción de la distribución que cubre la muestra.Eje: Bases de datos y minería de datosRed de Universidades con Carreras en Informática (RedUNCI)2011-05info:eu-repo/semantics/conferenceObjectinfo:eu-repo/semantics/publishedVersionObjeto de conferenciahttp://purl.org/coar/resource_type/c_5794info:ar-repo/semantics/documentoDeConferenciaapplication/pdf258-267http://sedici.unlp.edu.ar/handle/10915/20030spainfo:eu-repo/semantics/altIdentifier/isbn/978-950-673-892-1info:eu-repo/semantics/openAccesshttp://creativecommons.org/licenses/by-nc-sa/2.5/ar/Creative Commons Attribution-NonCommercial-ShareAlike 2.5 Argentina (CC BY-NC-SA 2.5)reponame:SEDICI (UNLP)instname:Universidad Nacional de La Platainstacron:UNLP2025-09-29T10:54:05Zoai:sedici.unlp.edu.ar:10915/20030Institucionalhttp://sedici.unlp.edu.ar/Universidad públicaNo correspondehttp://sedici.unlp.edu.ar/oai/snrdalira@sedici.unlp.edu.arArgentinaNo correspondeNo correspondeNo correspondeopendoar:13292025-09-29 10:54:06.194SEDICI (UNLP) - Universidad Nacional de La Platafalse
dc.title.none.fl_str_mv Aplicaciones de data mining al estudio de la biodiversidad
title Aplicaciones de data mining al estudio de la biodiversidad
spellingShingle Aplicaciones de data mining al estudio de la biodiversidad
Santa María, Cristóbal
Ciencias Informáticas
base de datos
cluster
Data mining
riqueza
diversidad
rarefacción
simulación
cobertura
title_short Aplicaciones de data mining al estudio de la biodiversidad
title_full Aplicaciones de data mining al estudio de la biodiversidad
title_fullStr Aplicaciones de data mining al estudio de la biodiversidad
title_full_unstemmed Aplicaciones de data mining al estudio de la biodiversidad
title_sort Aplicaciones de data mining al estudio de la biodiversidad
dc.creator.none.fl_str_mv Santa María, Cristóbal
Soria, Marcelo A.
author Santa María, Cristóbal
author_facet Santa María, Cristóbal
Soria, Marcelo A.
author_role author
author2 Soria, Marcelo A.
author2_role author
dc.subject.none.fl_str_mv Ciencias Informáticas
base de datos
cluster
Data mining
riqueza
diversidad
rarefacción
simulación
cobertura
topic Ciencias Informáticas
base de datos
cluster
Data mining
riqueza
diversidad
rarefacción
simulación
cobertura
dc.description.none.fl_txt_mv El trabajo propone la utilización conjunta de técnicas de data mining y simulación para evaluar la riqueza y diversidad de comunidades microbianas. Se parte de una muestra formada por distintas secuencias de ADN que se alinean para luego ser agrupadas según su similaridad en clusters. Cada uno de estos clusters es una especie y el propósito es estimar su número y distribución en la comunidad basándose en la información que da la muestra. La técnica de rarefacción, sustentada en el procedimiento bootstrap, permite construir una curva cuya tendencia asintótica es precisamente la riqueza de la comunidad. Para alcanzar tal asíntota, y a la vez para estimar la distribución estadística de las especies, se propone una simulación que utiliza la estimación de Turing sobre la probabilidad de nueva especie al seleccionar un individuo nuevo y la idea de cobertura para la porción de la distribución que cubre la muestra.
Eje: Bases de datos y minería de datos
Red de Universidades con Carreras en Informática (RedUNCI)
description El trabajo propone la utilización conjunta de técnicas de data mining y simulación para evaluar la riqueza y diversidad de comunidades microbianas. Se parte de una muestra formada por distintas secuencias de ADN que se alinean para luego ser agrupadas según su similaridad en clusters. Cada uno de estos clusters es una especie y el propósito es estimar su número y distribución en la comunidad basándose en la información que da la muestra. La técnica de rarefacción, sustentada en el procedimiento bootstrap, permite construir una curva cuya tendencia asintótica es precisamente la riqueza de la comunidad. Para alcanzar tal asíntota, y a la vez para estimar la distribución estadística de las especies, se propone una simulación que utiliza la estimación de Turing sobre la probabilidad de nueva especie al seleccionar un individuo nuevo y la idea de cobertura para la porción de la distribución que cubre la muestra.
publishDate 2011
dc.date.none.fl_str_mv 2011-05
dc.type.none.fl_str_mv info:eu-repo/semantics/conferenceObject
info:eu-repo/semantics/publishedVersion
Objeto de conferencia
http://purl.org/coar/resource_type/c_5794
info:ar-repo/semantics/documentoDeConferencia
format conferenceObject
status_str publishedVersion
dc.identifier.none.fl_str_mv http://sedici.unlp.edu.ar/handle/10915/20030
url http://sedici.unlp.edu.ar/handle/10915/20030
dc.language.none.fl_str_mv spa
language spa
dc.relation.none.fl_str_mv info:eu-repo/semantics/altIdentifier/isbn/978-950-673-892-1
dc.rights.none.fl_str_mv info:eu-repo/semantics/openAccess
http://creativecommons.org/licenses/by-nc-sa/2.5/ar/
Creative Commons Attribution-NonCommercial-ShareAlike 2.5 Argentina (CC BY-NC-SA 2.5)
eu_rights_str_mv openAccess
rights_invalid_str_mv http://creativecommons.org/licenses/by-nc-sa/2.5/ar/
Creative Commons Attribution-NonCommercial-ShareAlike 2.5 Argentina (CC BY-NC-SA 2.5)
dc.format.none.fl_str_mv application/pdf
258-267
dc.source.none.fl_str_mv reponame:SEDICI (UNLP)
instname:Universidad Nacional de La Plata
instacron:UNLP
reponame_str SEDICI (UNLP)
collection SEDICI (UNLP)
instname_str Universidad Nacional de La Plata
instacron_str UNLP
institution UNLP
repository.name.fl_str_mv SEDICI (UNLP) - Universidad Nacional de La Plata
repository.mail.fl_str_mv alira@sedici.unlp.edu.ar
_version_ 1844615798122872832
score 13.070432