En industrias de alto riesgo como la salud, la banca y la justicia penal, donde la responsabilidad y la transparencia son tan importantes como el rendimiento previsto, el aprendizaje automático (ML) ha emergido como un componente clave en la toma de decisiones. Sin embargo, muchos modelos de aprendizaje automático de alto rendimiento—especialmente los complejos como las redes neuronales profundas—se consideran frecuentemente "cajas negras" debido a su opacidad, lo que presenta problemas en aplicaciones donde comprender la lógica detrás de las predicciones es crucial. Se busca combinar previsibilidad y transparencia explorando maneras de mejorar la interpretabilidad del modelo sin sacrificar la velocidad. Este estudio compara métodos de interpretabilidad incluyendo mecanismos de atención, modelos sustitutos y análisis de importancia de características para encontrar estrategias que preserven buenos niveles de rendimiento mientras ofrecen valiosos conceptos sobre las elecciones del modelo. La efectividad y las compensaciones de estas técnicas se evalúan a través de pruebas empíricas en varias situaciones de alto riesgo. Los hallazgos muestran que estrategias específicas de interpretabilidad podrían alcanzar el mejor posible equilibrio entre transparencia y rendimiento, especialmente en situaciones donde la confianza del usuario y el cumplimiento legal son cruciales. El sector se beneficia ofreciendo recomendaciones para aplicar el aprendizaje automático interpretable en áreas delicadas, abriendo la puerta a una toma de decisiones impulsada por IA más confiable, responsable y eficiente.
J Arya (Sat,) estudió esta cuestión.