MMSep: Efficient Multimodal Long-Generation Reasoning via Multimodal Separator Compression
MMSep is proposed, a training-free multimodal separator localization and compression framework that improves efficiency in both prefilling and decoding and consistently reduces latency while maintaining competitive generation quality and reasoning accuracy.