Predictive maintenance using administrative work orders: A machine learning framework for failure criticality classification.
Cargando...
Archivos
Fecha
Autores
Director
Enlace al recurso
DOI
ORCID
0009-0008-8952-0198
Google Scholar
Cvlac
gruplac
Descripción Dominio:
Título de la revista
ISSN de la revista
Título del volumen
Editor
Universidad Santo Tomás
Compartir
Documentos PDF
Descripción
Este estudio evalúa la viabilidad del mantenimiento predictivo utilizando únicamente registros históricos de mantenimiento correctivo de una planta de la industria alimentaria, sin datos de sensores. El conjunto de datos comprendió 6731 eventos de falla en 664 máquinas, con nueve variables operacionales. La criticidad de la falla se clasificó en baja (≤23 min), media (24–44 min) y alta (>44 min) según los percentiles de tiempo de inactividad. Se desarrollaron tres modelos basados en árboles (Random Forest, XGBoost, LightGBM) y un perceptrón multicapa. La optimización de hiperparámetros se realizó utilizando RandomizedSearchCV y Optuna, este último con una función objetivo personalizada penalizada por brecha para mitigar el sobreajuste. Una división cronológica (70/15/15) respetó el orden temporal. El mejor modelo, XGBoost con Optuna penalizada por brecha, alcanzó un F1 macro de prueba de 0,3829 y un F1 ponderado de 0,4871, con una brecha de generalización mínima. La red neuronal obtuvo el F1 ponderado más alto (0,5512), pero falló en la clase de criticidad media. Los resultados confirman que los registros administrativos por sí solos tienen un techo predictivo estructural, y que la penalización explícita de brechas es efectiva para potenciar los modelos. El marco propuesto permite la comparación sistemática de modelos neuronales y basados en árboles para la clasificación de criticidad de fallas utilizando únicamente registros de órdenes de trabajo. Si bien los métodos estadísticos como ANOVA pueden establecer si existen diferencias significativas entre grupos operativos, no proporcionan un marco predictivo capaz de clasificar nuevos eventos de falla en el momento en que ocurren. Por el contrario, los modelos de aprendizaje automático están diseñados para identificar y generalizar patrones a partir de datos históricos, pero no explican inherentemente la estructura estadística de las variables subyacentes. Este estudio aborda ambas dimensiones de manera complementaria: se utilizan ANOVA y pruebas post-hoc Tukey HSD para validar estadísticamente la relevancia de la identidad de la máquina, la interacción del turno de trabajo y el número de técnicos en el tiempo de inactividad del equipo, mientras que posteriormente se desarrollan modelos de aprendizaje automático para evaluar si esos patrones son aprendibles y generalizables a eventos de falla no vistos. Este enfoque dual permite una caracterización más completa de la dinámica de fallas industriales que cualquiera de los métodos por separado.
Abstract
This study evaluates the feasibility of predictive maintenance using only historical correc-tive maintenance records from a food industry plant, without sensor data. The dataset comprised 6,731 failure events across 664 machines, with nine operational variables. Failure criticality was classified into low (≤23 min), medium (24–44 min), and high (>44 min) based on downtime percentiles. Three tree based models (Random Forest, XGBoost, LightGBM) and a multilayer perceptron were developed. Hyperparameter optimization was performed using RandomizedSearchCV and Optuna, the latter with a custom gap penalized objective function to mitigate overfitting. A chronological split (70/15/15) respected temporal order. The best model, XGBoost with gap penalized Optuna, achieved a test Macro F1 of 0.3829 and a weighted F1 of 0.4871, with a minimal generalization gap. The neural network obtained the highest weighted F1 (0.5512) but failed on the medium criticality class. Results confirm that administrative records alone have a structural pre-dictive ceiling, and that explicit gap penalization is effective for boosting models. The proposed framework enables systematic comparison of tree based and neural models for failure criticality classification using only work order logs. While statistical methods such as ANOVA can establish whether significant differences exist between operational groups, they do not provide a predictive framework capable of classifying new failure events at the moment they occur. Conversely, machine learning models are designed to identify and generalize patterns from historical data, but do not inherently explain the statistical structure of the underlying variables. This study addresses both dimensions in a complementary fashion: ANOVA and post-hoc Tukey HSD tests are used to statistically validate the relevance of machine identity, work shift interaction, and technician count on equipment downtime, while machine learning models are subsequently developed to as-sess whether those patterns are learnable and generalizable to unseen failure events. This dual approach enables a more complete characterization of industrial failure dynamics than either method alone.
Idioma
spa
Palabras clave
Citación
Cruz Martinez, J.M(2026). Predictive Maintenance Using Administrative Work Orders: A Machine Learning Framework For Failure Criticality Classification.[Trabajo de grado Pregrado, Universidad Santo Tomás]. Reposito institucional
Colecciones
Licencia Creative Commons
Attribution-NonCommercial-NoDerivs 2.5 Colombia

