@inproceedings{chen25longvila,
  title = {{LongVILA}: Scaling Long-Context Visual Language Models for Long Videos},
  author = {Yukang Chen and Fuzhao Xue and Dacheng Li and Qinghao Hu and Ligeng Zhu and Xiuyu Li and Yunhao Fang and Haotian Tang and Shang Yang and Zhijian Liu and Yihui He and Hongxu Yin and Pavlo Molchanov and Jan Kautz and Linxi Fan and Yuke Zhu and Yao Lu and Song Han},
  year = {2025},
  month = {April},
  booktitle = {International Conference on Learning Representations (ICLR)},
  eprint = {2408.10188},
  archiveprefix = {arxiv},
}
