Omni-LLMs suffer from perception-decision misalignment; authors diagnose it using causal modality sensitivity and a dual-lens framework for evaluation.
Read the original at arxiv.org→arXiv:2608.14655v1 Announce Type: new Abstract: Omni-Large Language Models (Omni-LLMs) power complex multi-modal reasoning in applications like World Action Models and autonomous agents. However, their strong...
Original headline: "Diagnosing and Mitigating Perception-Decision Misalignment in Omni-LLMs via Modality Subspace Activation"
Coverage timeline
- Aug 18, 04:00 UTC arXiv cs.LG lead source Diagnosing and Mitigating Perception-Decision Misalignment in Omni-LLMs via Modality Subspace Activation