SAVRN
Search Contact SAVRN

Organization

openRFM

hk-eai

Models in Library1
Datasets in Library0
Models on Hugging Face9
Followers12

Models

openPangu-VL-7B 是基于昇腾 NPU ,基于openPangu-Embedded-7B-V1.1语言基模和openPangu-ViT-600M视觉编码器训练的高效多模态模型。openPangu-VL-7B 训练了约 3T tokens,具备通用视觉对话、文档理解、目标定位与计数、视频理解、视觉高阶推理等能力。该模型为快思考模型。 注: 评测使用vllm-ascend部署推理,系统prompt为空。一般而言,图片最小分辨率设置为2304\28\28能获得最优的测评效果。(OCRBench中的极小图OCR除外,建议设置为不大于64\28\28。)具体prompt和分辨率设置参见技术报告附录。 - 使用vllm-ascend推理框架,参考[vllmascendforopenpanguvl7b]进行服务部署。 - python==3.10 - CANN==8.1.RC1 - 更多推理样例和能力展示,请参见cookbooks。 除文件中对开源许可证另有约定外,openPangu-VL-7B 模型根据 OPENPANGU MODEL LICENSE AGREEMENT VERSION 1.0 授权,旨在允许使用并促进人工智能技术的进一步发展。有关详细信息,请参阅模型存储库根目录中的 LICENSE 文件。 由于 openPangu-VL-7B (“模型”)所依赖的技术固有的限制,以及人工智能生成的内容是由盘古自动生成的,华为无法对以下事项做出任何保证: 如果有任何意见和建议,请提交issue或联系[email protected]。

Open weights 8.8B parameters 131,072 tokens