[29] Sculley, D., Holt, G., Golovin, D., Davydov, E., Phillips, T., Ebner, D., ... & Young, M. (2015). Hidden technical debt in machine learning systems. In Advances in Neural Information Processing Systems (pp. 2503–2511). Artículo influyente que identifica las fuentes de deuda técnica en sistemas de ML en producción, enfatizando la complejidad de los pipelines de datos y la monitorización. [30] Karras, T., Aila, T., Laine, S., & Lehtinen, J. (2018). Progressive growing of GANs for improved quality, stability, and variation. In International Conference on Learning Representations. Aunque enfocado en GANs, introduce prácticas de ingeniería de entrenamiento progresivo y monitorización de métricas que son transferibles a MLOps. [31] Breck, E., Cai, S., Chen, E., Chen, M., Chi, M., Chiu, C., ... & Zilka, M. (2016). The ML test score: A rubric for ML production systems. In IEEE International Conference on Big Data (pp. 1105–1112). Propone un marco de evaluación (rubric) para sistemas de ML en producción, cubriendo pruebas de datos, modelos, infraestructura y monitorización. [32] Gretton, A., Borgwardt, K. M., Rasch, M. J., Schölkopf, B., & Smola, A. (2012). A kernel two-sample test. Journal of Machine Learning Research, 13, 723–773. Desarrolla el test estadístico basado en Maximum Mean Discrepancy (MMD) para detectar diferencias entre distribuciones, fundamental para la detección de data drift. [33] Lu, J., Liu, A., Greer, D., & Dong, G. (2004). Capturing concept drift to retrain classifiers. ACM SIGKDD Explorations Newsletter, 6(1), 52–59. Introduce métodos adaptativos para detectar concept drift en flujos de datos continuos y disparar reentrenamientos automáticos. Implementaciones de Software y Librerías [34] Pedregosa, F., Varoquaux, G., Gramfort, A., Michel, V., Thirion, B., Grisel, O., ... & Duchesnay, É. (2011). Scikit-learn: Machine learning in Python. Journal of Machine Learning Research, 12, 2825–2830. Paper original de scikit-learn que describe la arquitectura orientada a objetos, la API consistente (fit/predict/transform) y los principios de diseño que han establecido el estándar de facto en ML. [35] Abadi, M., Agarwal, A., Barham, P., Brevdo, E., Chen, Z., Citro, C., ... & Zheng, X. (2016). TensorFlow: A system for large-scale machine learning. In 12th USENIX Symposium on Operating Systems Design and Implementation (pp. 265–283). Describe la arquitectura de computación gráfica de TensorFlow, incluyendo diferenciación automática, ejecución distribuida y optimizaciones de hardware. [36] Paszke, A., Gross, S., Massa, F., Lerer, A., Bradbury, J., Chanan, G., ... & Chintala, S. (2019). PyTorch: An imperative style, high-performance deep learning library. In Advances in Neural Information Processing Systems (pp. 8024–8035). Introduce el modelo de programación imperativa (eager execution) de PyTorch, que facilita la depuración y la investigación en deep learning. [37] Harris, C. R., Millman, J. K., van der Walt, S. J., Gommers, R., Virtanen, P., Cournapeau, D., ... & Oliphant, T. E. (2020). Array programming with NumPy. Nature, 585(7825), 357–362. Abraham Zamudio 61