介绍
Aliyun Qwen VL 是开源项目 alicloud-skills 中的一个多模态视觉理解技能(Skill),把阿里云百炼(Model Studio)的通义千问视觉语言模型封装成可复用的 Agent 技能,面向图片问答、视觉分析、OCR 式信息提取、图表与表格读取、截图理解等场景。技能以标准 SKILL.md 结构发布,附带可直接调用的 Python 脚本、参数示例与参考文档,可被 Claude Code、OpenCode 等支持 Agent Skills 规范的工具一键安装调用。
把阿里云百炼通义千问视觉模型封装成标准 Agent Skill 的开源技能:图片问答、OCR 式提取、图表理解,一条命令装入 Claude Code 等兼容工具。
Aliyun Qwen VL 是开源项目 alicloud-skills 中的一个多模态视觉理解技能(Skill),把阿里云百炼(Model Studio)的通义千问视觉语言模型封装成可复用的 Agent 技能,面向图片问答、视觉分析、OCR 式信息提取、图表与表格读取、截图理解等场景。技能以标准 SKILL.md 结构发布,附带可直接调用的 Python 脚本、参数示例与参考文档,可被 Claude Code、OpenCode 等支持 Agent Skills 规范的工具一键安装调用。