| 标题 |
StructXLIP: Enhancing Vision-language Models with Multimodal Structural Cues 相关领域
计算机科学
人工智能
Boosting(机器学习)
光学(聚焦)
代表(政治)
GSM演进的增强数据速率
匹配(统计)
感觉线索
相互信息
模式
计算机视觉
编码(集合论)
可视化
模式识别(心理学)
隐藏字幕
可视对象
结构线形
地点
模态(人机交互)
机器学习
自然语言处理
钥匙(锁)
源代码
特征学习
信息丢失
|
| 网址 | |
| DOI | |
| 其它 |
期刊:arXiv (Cornell University) 作者:Zanxi Ruan; Gao, Songqun; Kong, Qiuyu; Yiming Wang; Marco Cristani 出版日期:2026-02-23 |
| 求助人 | |
| 下载 | 该求助完结已超 24 小时,文件已从服务器自动删除,无法下载。 |
|
温馨提示:该文献已被科研通 学术中心 收录,前往查看
科研通『学术中心』是文献索引库,收集文献的基本信息(如标题、摘要、期刊、作者、被引量等),不提供下载功能。如需下载文献全文,请通过文献求助获取。
|
PDF的下载单位、IP信息已删除
(2025-6-4)