Em indústrias de alto risco, como saúde, bancária e justiça criminal, onde a responsabilidade e a transparência são tão importantes quanto o desempenho previsto, o aprendizado de máquina (ML) surgiu como um componente chave na tomada de decisões. No entanto, muitos modelos de aprendizado de máquina de alto desempenho—especialmente os intrincados como redes neurais profundas—são frequentemente considerados "caixas-pretas" devido à sua opacidade, o que apresenta problemas em aplicações onde compreender a lógica por trás das previsões é crucial. Este estudo busca combinar previsibilidade e transparência, explorando maneiras de melhorar a interpretabilidade do modelo sem sacrificar a velocidade. O estudo compara métodos de interpretabilidade, incluindo mecanismos de atenção, modelos substitutos e análise de importância de características, para encontrar estratégias que preservem bons níveis de desempenho enquanto oferecem insights valiosos sobre as escolhas do modelo. A eficácia e os trade-offs dessas técnicas são avaliados por meio de testes empíricos em várias situações de alto risco. Os resultados mostram que estratégias específicas de interpretabilidade podem alcançar o melhor equilíbrio possível entre transparência e desempenho, especialmente em situações onde a confiança do usuário e a conformidade legal são cruciais. O setor se beneficia ao oferecer recomendações para a aplicação de aprendizado de máquina interpretável em áreas delicadas, abrindo a porta para uma tomada de decisão impulsionada por IA mais confiável, responsável e eficiente.
J Arya (Sab,) estudou esta questão.