Torna ai risultati
Scheda bibliografica · Consultazione e accesso
Artículo

Quantifying Modality Contributions via Disentangling Multimodal Representations

Padegal Amit et al · LibraryPress@UF · 2026

Testo completo ad accesso aperto
Lettura rapida. Controlla i dati essenziali della risorsa e accedi al contenuto con il pulsante principale. La scheda mostra solo le informazioni necessarie per identificare, citare e aprire l’opera.

Accesso alla risorsa

Apri il contenuto dall’opzione principale o scegli un’altra fonte disponibile.

DOAJ DOAJ Articles
Entrar por DOAJ
Accesso principale

Testo completo ad accesso aperto

Texto completo identificado como acceso abierto.
Apri testo

Riepilogo

Descripción general del contenido del recurso.

Quantifying modality contributions in Vision-Language Models (VLMs) remains challenging. Existing approaches rely on perturbation or gradient-based methods, which conflate inherent modality informativeness with model-specific biases and fail to capture complex cross-modal interactions. We address this gap by introducing an information-theoretic framework based on Partial Information Decomposition (PID) that decomposes internal representations into unique, redundant, and synergistic components. Our method operates directly on internal embeddings and derives an inference-only modality contribution metric from unique information scores. Applying our framework to six modern VLMs across six benchmarks, we uncover a persistent imbalance in modality contributions driven by low cross-modal synergy. Analysis reveals that fusion architecture significantly impacts the distribution of unique, redundant, and synergistic information. Our framework provides a scalable diagnostic tool for understanding and improving multimodal integration in vision-language systems.

Come citare

Elegí el formato que necesitás y copiá la referencia al portapapeles.

APA 7

al, P. A. E. (2026). Quantifying Modality Contributions via Disentangling Multimodal Representations. https://journals.flvc.org/FLAIRS/article/view/141869

MLA

al, Padegal Amit et. "Quantifying Modality Contributions via Disentangling Multimodal Representations." 2026. https://journals.flvc.org/FLAIRS/article/view/141869.

Chicago

al, Padegal Amit et. 2026. "Quantifying Modality Contributions via Disentangling Multimodal Representations.". https://journals.flvc.org/FLAIRS/article/view/141869.

Harvard

al, P. A. E. 2026, Quantifying Modality Contributions via Disentangling Multimodal Representations, LibraryPress@UF, available at: https://journals.flvc.org/FLAIRS/article/view/141869 [Accessed 6 Aug. 2026].

Condividi e stampa

Salva la scheda, copia il link permanente o stampala in PDF.

Esporta riferimento

Esporta il record nei formati più comuni per usarlo con un gestore bibliografico.

Dettagli della risorsa

Informazioni bibliografiche utili per verificare che sia il materiale corretto.

Titolo
Quantifying Modality Contributions via Disentangling Multimodal Representations
Autore / collaboratori
Padegal Amit et al
Editore
LibraryPress@UF
Anno di pubblicazione
2026
ISSN
2334-0754
ISSN
2334-0754
Lingua
Inglés
Copiato