Skip to content
Open access

Translational Evaluation of Interpretable Machine Learning for Cardiovascular Risk Prediction: Calibration Decomposition, Subgroup Audits, and Decision-Utility Analysis

Jul 2026 · International Journal of Analysis and Applications · Vol 24, pp. 202 · 0 citations · 56 references

TL;DR

A translational evaluation of interpretable machine-learning models for heart disease prediction using a deployment-oriented framework integrating discrimination, calibration, explainability, subgroup stability, and decision-utility analysis via decision curve analysis is conducted.

Abstract

Cardiovascular disease risk prediction models are often evaluated primarily by discrimination, although translational decision making depends on well-calibrated probabilities, subgroup reliability, and demonstrated clinical utility at actionable risk thresholds. This study conducted a translational evaluation of interpretable machine-learning models for heart disease prediction using a deployment-oriented framework integrating discrimination, calibration (including Murphy decomposition), explainability, subgroup stability, and decision-utility analysis via decision curve analysis. Using a large secondary dataset (308,774 observations; 19 predictors; prevalence 8.1%), models were trained with a stratified hold-out design and evaluated on a fixed test set. Histogram-based gradient boosting achieved the strongest discrimination (PR-AUC 0.3177; AUROC 0.8407) and strong probabilistic accuracy (Brier score 0.0633; ECE 0.0045), with Murphy decomposition indicating minimal reliability loss while preserving resolution. Explainability analyses (SHAP with PDP/ALE/ICE diagnostics) enabled transparent assessment of feature contributions and nonlinear effects relevant to plausibility and governance. Subgroup analyses indicated broadly stable discrimination but more variable calibration across age and self-reported general health strata, supporting the need for subgroup-aware monitoring. Decision curve analysis demonstrated positive net benefit relative to treat-all and treat-none strategies across screening-relevant thresholds (0.05–0.15), with workload trade-offs informing threshold selection for practice.

Read PDF

Similar papers

Open access Oct 2026

Heart disease prediction through feature optimization, ensembles, and threshold calibration

Early detection of cardiovascular disease is critical for reducing mortality and enabling timely clinical intervention. While machine learning models have been widely applied to heart disease prediction, many studies prioritize overall accuracy rather than sensitivity, which is essential in medical screening tasks. Thi...

Mehdi Mostofi, T. Banirostam · 0 citations
Open access Jul 2026

Explainable Ensemble Learning for Cardiovascular Risk Stratification A Multi-Hospital Stacking Approach with SHAP-Based Clinical Decision Support

This paper presents an explainable stacking ensemble framework for binary heart disease classification and three-tier risk stratification using multi-hospital cardiac data using a novel Dual-Balanced SMOTE strategy that simultaneously addresses class imbalance and gender bias.

B. Kusuma, Madhu M. Nayak · 0 citations
Open access Aug 2026

A Reliability-Aware and Interpretable Machine Learning Framework for Diabetes Prediction Using Structured Clinical Data

A reliability-aware and interpretable machine learning framework for diabetes prediction from structured clinical data is developed and a Feature Consistency Index (FCI) is formalised that quantifies the cross-model agreement of SHAP-derived feature importance and combines it with normalised importance into a single ra...

R. V., S. Sasirekha · 0 citations
Open access Aug 2026

Explainable Machine Learning-Based Decision Support for Diabetes Risk Screening Using Public Health Indicator Data

Diabetes remains a major public-health challenge because many individuals at elevated risk are identified only after avoidable metabolic deterioration or complication pathways have already begun. This study develops and evaluates an explainable machine-learning decision-support framework for diabetes risk screening usi...

Almothana Altamimi · 0 citations
Sep 2026

An Explainable Hybrid Machine Learning Framework for Proactive Heart Disease Prediction and Risk Classification

Traditional clinical cardiovascular risk scoring systems are based mainly on linear risk factors that often do not adequately reflect the non-linear interactions of a heterogeneous demographic and physiological risk factors. In this study, an explainable hybrid machine learning system for early heart disease prediction...

Ronak Jain, Sachin Patel · 0 citations

We use cookies to run the site and, with your consent, for analytics and to show ads. See our Cookie Policy.