Volver a resultados
Ficha bibliográfica · Consulta y acceso
Artículo

Quantifying Modality Contributions via Disentangling Multimodal Representations

Padegal Amit et al · LibraryPress@UF · 2026

Acceso abierto al texto completo
Lectura rápida. Revisá los datos básicos del recurso y luego accedé al contenido desde el botón principal. En esta ficha solo se muestra la información necesaria para identificar la obra, citarla y abrirla.

Acceso al recurso

Entrá al contenido desde la opción principal o elegí otra fuente disponible.

DOAJ DOAJ Articles
Entrar por DOAJ
Acceso principal

Acceso abierto al texto completo

Texto completo identificado como acceso abierto.
Abrir texto

Resumen

Descripción general del contenido del recurso.

Quantifying modality contributions in Vision-Language Models (VLMs) remains challenging. Existing approaches rely on perturbation or gradient-based methods, which conflate inherent modality informativeness with model-specific biases and fail to capture complex cross-modal interactions. We address this gap by introducing an information-theoretic framework based on Partial Information Decomposition (PID) that decomposes internal representations into unique, redundant, and synergistic components. Our method operates directly on internal embeddings and derives an inference-only modality contribution metric from unique information scores. Applying our framework to six modern VLMs across six benchmarks, we uncover a persistent imbalance in modality contributions driven by low cross-modal synergy. Analysis reveals that fusion architecture significantly impacts the distribution of unique, redundant, and synergistic information. Our framework provides a scalable diagnostic tool for understanding and improving multimodal integration in vision-language systems.

Cómo citar

Elegí el formato que necesitás y copiá la referencia al portapapeles.

APA 7

al, P. A. E. (2026). Quantifying Modality Contributions via Disentangling Multimodal Representations. https://journals.flvc.org/FLAIRS/article/view/141869

MLA

al, Padegal Amit et. "Quantifying Modality Contributions via Disentangling Multimodal Representations." 2026. https://journals.flvc.org/FLAIRS/article/view/141869.

Chicago

al, Padegal Amit et. 2026. "Quantifying Modality Contributions via Disentangling Multimodal Representations.". https://journals.flvc.org/FLAIRS/article/view/141869.

Harvard

al, P. A. E. 2026, Quantifying Modality Contributions via Disentangling Multimodal Representations, LibraryPress@UF, available at: https://journals.flvc.org/FLAIRS/article/view/141869 [Accessed 8 Aug. 2026].

Compartir e imprimir

Guardá la ficha, copiá su enlace permanente o imprimila como PDF.

Exportar referencia

Si usás un gestor bibliográfico, podés exportar el registro en los formatos más comunes.

Detalles del recurso

Información bibliográfica útil para confirmar que se trata del material correcto.

Título
Quantifying Modality Contributions via Disentangling Multimodal Representations
Autor / colaboradores
Padegal Amit et al
Editorial
LibraryPress@UF
Año de publicación
2026
ISSN
2334-0754
ISSN
2334-0754
Idioma
Inglés
Copiado