OCR开源智谱AI视觉理解 多模态模型
CogVLM 2 2
CogVLM系列 · 智谱AI / 清华 · 2024-05发布
模型介绍
智谱与清华联合开源的视觉语言模型,支持高清图像理解与文档 OCR,中文场景适配良好。
模型基础信息
模型系列CogVLM系列
开发机构智谱AI / 清华
发布时间2024-05
参数规模19B
上下文窗口未公开
模型类型多模态(视觉 + 文本)
中文能力优秀
使用方式网页体验 / 本地部署
免费额度与收费政策
按量付费 订阅
模型能力介绍
✅ 核心优势
- 文档理解强
- OCR 好
- 中文适配
⚠️ 短板与局限
- 19B 显存要�
🎯 适用场景
- 票据识别
- 文档问答
- 图片理解
模型使用教程
本章节整理 CogVLM 2 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。
暂无内容,可前往官方文档查看。
该模型支持本地部署,教程整理中,敬请期待。
Aitishiku.com