【模型部署】vLLM 部署 Qwen2-VL 踩坑记 03 - 多图支持和输入格式问题

【模型部署】vLLM 部署 Qwen2-VL 踩坑记 03 - 多图支持和输入格式问题

NLP Github 项目:


其他细节(非常重要)

多图支持问题

多张图片请求失败,状态码400:

在启动命令中添加多图支持的参数:

nohup python -m vllm.entrypoints.openai.api_server --served-model-name Qwen2-VL-7B-Instruct --model Qwen/Qwen2-VL-7B-Instruct --limit-mm-per-prompt image=5 > ./logs/output.log 2>&1 &

重新启动服务:

多图请求成功:

输入格式问题

本地推理

vllm部署


系列文章:

本文由mdnice多平台发布

posted @ 2024-11-18 21:52  青松^_^  阅读(10)  评论(0编辑  收藏  举报