A generalist biomedical vision-language model via multi-CLIP knowledge distillation. [PDF]
Wang S +11 more
europepmc +1 more source
Towards explainable language reasoning via multi-modal knowledge graphs. [PDF]
Lu C +6 more
europepmc +1 more source
A linguistic lens into vision-language models for open-ended question-answers in medical visual question answering. [PDF]
Lameesa A +3 more
europepmc +1 more source
A visually grounded language model for fetal ultrasound understanding. [PDF]
Guo X +6 more
europepmc +1 more source
Collaborative positional attention for image to English question answering. [PDF]
Li Y, Teng H.
europepmc +1 more source
Attention re-alignment in multimodal large language models via intermediate-layer guidance. [PDF]
Chen Y +5 more
europepmc +1 more source
Key concept learning for medical vision language model with reasoning capabilities. [PDF]
Lou W +7 more
europepmc +1 more source
A visual question answering method based on task decomposition. [PDF]
Cong Y, Mo H.
europepmc +1 more source
Advancing radiology foundation models with reasoning through step-by-step verification from daily reports. [PDF]
Fan Z +5 more
europepmc +1 more source
Biomedical multimodal large language models: From model-centric development to clinically grounded evaluation and integration. [PDF]
Bian J +4 more
europepmc +1 more source

