Una revisión sistemática de problemas de calidad en los datos en tareas de descubrimiento de conocimiento

Cargando...
Miniatura

Compartir

Título de la revista

ISSN de la revista

Título del volumen

Editor

Universidad de Medellín
Documentos PDF

Resumen

Hay un gran crecimiento en el volumen de datos porque las organizaciones capturan permanentemente la cantidad colectiva de datos para lograr un mejor proceso de toma de decisiones. El desafío mas fundamental es la exploración de los grandes volúmenes de datos y la extracción de conocimiento útil para futuras acciones por medio de tareas para el descubrimiento del conocimiento; sin embargo, muchos datos presentan mala calidad. Presentamos una revisión sistemática de los asuntos de calidad de datos en las áreas del descubrimiento de conocimiento y un estudio de caso aplicado a la enfermedad agrícola conocida como la roya del café.


Large volume of data is growing because the organizations are continuously capturing the collective amount of data for better decision-making process. The most fundamental challenge is to explore the large volumes of data and extract useful knowledge for future actions through knowledge discovery tasks, nevertheless many data has poor quality. We presented a systematic review of the data quality issues in knowledge discovery tasks and a case study applied to agricultural disease named coffee rust.

Descripción

Palabras clave

Heterogeneity, Outliers, noise, Inconsistency, Incompleteness, Amount of data, Redundancy, Timeliness, Heterogeneidad, Valores atípicos, Ruido, Inconsistencia, Valores perdidos, Cantidad de datos, Redundancia, Oportunidad

Citación

Aprobación

Revisión

Complementado por

Referenciado por