SEP 10, 2026 · PREPRINT
EMMI: Edge Multi-Modal Intelligence for Communication-Efficient MLLM Inference via Fused Representation Compression
arXiv
A technical design proposal evaluated on a representative benchmark with communication and latency metrics, but lacking peer review, clinical validation, or comparison against established baselines in a controlled trial setting.
Reported
Communication payload reduction32x
End-to-end inference latency redu…up to 3.4x