| 标题 |
Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond |
| 网址 | |
| DOI |
10.48550/arxiv.2308.12966
doi
|
| 其它 |
期刊:Cornell University - arXiv 作者:Jinze Bai; Shuai Bai; Shusheng Yang; Shijie Wang; Sinan Tan; et al 出版日期:2023-08-24 |
| 求助人 | |
| 下载 | 求助已完成,仅限求助人或该文件上传人下载。 |
PDF的下载单位、IP信息已删除
(2025-6-4)