This work proposes MOSAIC, the first modality-agnostic federated framework for weakly supervised binary tumor segmentation under client-specific missing modalities, which introduces a client-specific modality-alignment module, a spectral prototype alignment loss that reconciles cross-client distribution shift using compact non-invertible frequency-domain statistics, and a dedicated federated refinement network.
Abstract
Trustworthy multimodal fusion in clinical settings requires handling incomplete and heterogeneous modality subsets across institutions, where privacy constraints prohibit centralized data sharing. Federated learning (FL) mitigates data-sharing constraints but suffers from client-specific missing modalities, where institutions possess incomplete multimodal subsets, degrading fusion quality and segmentation performance. While FL and weak supervision have been studied separately, their joint use with image-level labels under heterogeneous missing modalities remains unaddressed. We propose \textbf{MOSAIC}, the first modality-agnostic federated framework for weakly supervised binary tumor segmentation under client-specific missing modalities. We introduce a client-specific modality-alignment module that fuses available channels into a shared latent space without prior knowledge of modality identity, a spectral prototype alignment loss that reconciles cross-client distribution shift using compact non-invertible frequency-domain statistics, and a dedicated federated refinement network that denoises the resulting CAM pseudo-labels into accurate masks, breaking the accuracy ceiling of weak supervision. Experiments on three multi-institutional brain tumor benchmarks (FeTS2022, BraTS-MEN, and BraTS-SSA) demonstrate significant improvements over all image, box, and point-supervised baselines, approaching fully supervised accuracy using only image-level labels and reaching 0.84 Dice on FeTS2022. Dynamic new client addition enables previously unseen institutions to join an already-trained federation within 0.01-0.04 Dice without retraining. Code is available at https://github.com/Tarun2201/MOSAIC.
Accurate lesion segmentation remains a critical yet challenging task in medical imaging due to scarce pixel-level annotations, inter-observer variability and modality-specific noise. Conventional fully supervised models require exhaustive manual labeling, which limits scalability and clinical applicability. To address...
A. Zaheer, Sui-Rong Cao, Muhammad Farhan et al.· IEEE journal of biomedical a...· 0 citations
CoReFuse-Med is proposed, a Corruption-aware Rebalanced Fusion framework that suppresses corruption during feature transmission and rebalances modality contributions during high-level fusion, demonstrating improved accuracy and robustness under modality-quality discrepancies.
Yu-Chen Pei, Xiao-Yu Hu, Yi-Xiong Zou et al.· 0 citations
Multimodal medical imaging benefits from the global context modeling of transformers, yet most existing models fuse modalities implicitly by channel concatenation, leaving cross-modal interaction unstructured or relying on costly multi-stream cross-attention. We propose Modality-Aware Token Interaction (MATI), an archi...
Selene Tomassini, Hafiza Ayesha Hoor Chaudhry, A. Galdelli et al.· Proceedings of the Thirty-Fi...· 0 citations
In clinical practice, Magnetic Resonance Imaging (MRI) data frequently suffer from the absence of certain imaging modalities, which inevitably degrades predictive performance. Existing approaches typically treat different modalities as independent and non-interacting during modal feature extraction, despite the prese...
Multi-center medical image modeling faces persistent challenges arising from data privacy constraints and cross-institutional distribution discrepancies. Federated learning provides a feasible paradigm for collaborative training of intelligent diagnostic models for breast magnetic resonance imaging (MRI) without sharin...
Wenbiao Du, Bo-Ya Zhang, Liu-Quan Cheng et al.· Journal of King Saud Univers...· 0 citations
Selective Cross-Modal Learning is introduced, a lightweight pre-fusion refinement framework that enriches unimodal embeddings by selectively incorporating complementary cues from concurrently available modalities and maintains its advantage under missing-pathology and missing-genomics conditions.
Mohammed Belghadi, Younès Bennani, Valérie Paradis· 0 citations
We use cookies to run the site and, with your consent, for analytics and to show ads.
See our Cookie Policy.