Wesum AI
首页
图谱
主题百科
首页
/
图谱
/
Vision Transformer
Vision Transformer
技术
Vision Transformer,基于自注意力机制处理图像的深度学习架构,将图像分块并线性嵌入进行特征提取
4 次提及
7 个连接
首次出现: 2026-04-01
最近出现: 2026-07-06
关系图谱
关系 (7)
使用技术 (4)
全局注意力
CLIP
TIPSv2
CLIPPO
应用于 (3)
AI金融
LazyStrike
多模态理解
相关文章 (4)
1.
AI有道 - 196篇多模态融合论文开放下载!
2.
CVer - CVPR2026你的ViT可能训错了!LaSt-ViT:让模型真正看懂前景
3.
CVer - CVPR2026谷歌提出多模态TIPSv2:新型图像-文本编码器模型
4.
量子位 - Fable5被网友薅出省钱神招!最高减70%!