Who Matters More in Radiology Report Generation: Vision Encoders or Language Models?

Published in SAIMBio Workshop at IEEE ICDM Workshops 2025, 2025

This study uses controlled component swaps to isolate the individual and interaction effects of vision encoders and language backbones. Access the paper.

Recommended citation: Kun Zhao, Yang Du, Rhianna Zhang, Liang Zhan, Dongkuan Xu, Pengfei Gu, Haoteng Tang, "Who Matters More in Radiology Report Generation: Vision Encoders or Language Models?" IEEE ICDM Workshops, 2025.
Download Paper