Wesum AI
首页
图谱
主题百科
首页
/
图谱
/
Qwen2.5-VL-7B
Qwen2.5-VL-7B
模型
Qwen2.5-VL-7B,阿里云开发的70亿参数视觉语言模型,擅长图像与文本处理,支持视觉问答和文档理解等任务
10 次提及
12 个连接
首次出现: 2026-04-03
最近出现: 2026-07-29
关系图谱
关系 (12)
基于 (6)
GTR-Turbo
Video-o3
SE-GA
PolyV
VideoTemp-o3
FinePruner
使用技术 (3)
RAG
Chain-of-Thought
GRPO
使用 (2)
TaRO
SmartPhotoCrafter
应用于 (1)
多模态理解
相关文章 (10)
1.
量子位 - 别再花钱请GPT当老师了!GTR-Turbo用「历史经验」自我蒸馏,训练成本砍半,效果反超丨CVPR'26
2.
新智元 - 多模态大模型别盲目刷题!诊断-生成-强化闭环,找准盲点ICML'26
3.
极市平台 - ICML2026|让多模态大模型像人类一样看视频:原生工具调用长视频理解新框架Video-o3
4.
机器之心 - GUIAgent「记与学」双修,长程任务有了专属记忆增强型自进化框架
5.
AI科技评论 - CVPR2026模型适应性研究盘点:从保留旧知识,到适应真实世界
6.
PaperWeekly - ICML2026快手提出Agentic长视频框架,统一时序定位与深度理解
7.
机器之心 - 从「找视频」到「产视频」:快手RaG推动推荐系统迈向完全生成时代
8.
极市平台 - ICML2026|让多模态大模型学会带着时间思考:北大与华为团队开源TaRO框架
9.
CVer - 顶刊TIP2026!北大彭宇新团队提出FinePruner:让多模态大模型更快更准
10.
量子位 - 三步训练法+强化学习,vivo新框架把AI修图从“概率生成”训练成了“有审美的修图师”