资讯动态

Qwen3.5-35B-A3B-AWQ-4bit镜像快速上手:无需conda/pip,直接supervisorctl启动

发布时间:2026/8/7 11:38:04 来源:尧图企业网站定制
Qwen3.5-35B-A3B-AWQ-4bit镜像快速上手无需conda/pip直接supervisorctl启动1. 模型介绍Qwen3.5-35B-A3B-AWQ-4bit是一个专为视觉多模态理解设计的量化模型特别适合需要图片分析和图文交互的应用场景。这个模型最大的特点是能够理解图片内容并围绕图片进行智能对话。1.1 核心能力功能说明图片内容理解可以准确识别图片中的物体、场景和文字图文问答支持针对图片内容的多轮提问和回答视觉描述能够用自然语言描述图片内容中文支持问答和描述均支持中文输出1.2 技术特点开箱即用预装完整环境无需额外安装conda或pip包稳定部署采用vLLMcompressed-tensors技术路线双卡支持经过验证可在双24GB GPU环境下稳定运行自动恢复服务重启后会自动恢复运行状态2. 快速部署指南2.1 访问方式根据您的网络环境有两种访问方式直接访问如果平台已经配置了外网映射可以直接访问分配的7860端口地址SSH隧道如果没有外网映射建议使用以下命令建立隧道ssh -L 7860:127.0.0.1:7860 -p 32468 rootgpu-kktv84d3pq.ssh.gpu.csdn.net然后在本地浏览器打开http://127.0.0.1:78602.2 服务验证部署完成后可以通过以下命令检查服务状态# 检查后端服务 supervisorctl status qwen35awq-backend # 检查前端服务 supervisorctl status qwen35awq-web # 检查端口占用 ss -ltnp | egrep 7860|80003. 基础使用教程3.1 图文对话操作步骤打开Web界面后点击上传图片按钮选择要分析的图片在下方输入框中输入您的问题点击发送按钮提交问题等待模型处理并返回回答3.2 推荐测试流程为了获得最佳体验建议按照以下顺序测试先上传一张清晰、主体明确的图片从简单描述性问题开始如描述这张图片的内容逐步测试更复杂的问题如识别特定物体或分析图片中的文字最后尝试需要推理的问题如图片中的人物可能在做什么重要提示更换新图片后建议先刷新页面或重新上传以确保模型正确识别新图片内容。4. 服务管理4.1 常用命令# 重启服务 supervisorctl restart qwen35awq-backend supervisorctl restart qwen35awq-web # 查看日志 tail -100 /root/workspace/qwen35awq-backend.log tail -100 /root/workspace/qwen35awq-web.log4.2 参数配置参数项说明默认值tensor-parallel-size张量并行数2max-model-len最大上下文长度4096enforce-eager推理模式已启用5. 最佳实践建议5.1 图片选择技巧优先使用高分辨率、主体清晰的图片避免过于复杂或包含大量文字的图片对于专业图表建议先测试简单问题5.2 提问技巧从整体到细节先问整体描述再问具体细节一次一个问题避免在单个问题中包含多个子问题明确具体问题越具体回答越准确6. 常见问题解答Q: 为什么需要双显卡A: 即使经过4bit量化模型对显存需求仍然较高。双卡24GB配置经过验证可以稳定运行单卡可能会出现内存不足的情况。Q: 首次响应为什么比较慢A: 首次请求包含模型预热过程后续请求会快很多。图片越大、问题越复杂响应时间也会相应增加。Q: 如何判断服务是否正常运行A: 可以依次检查服务状态supervisorctl status qwen35awq-backend端口监听ss -ltnp | grep 7860日志信息tail -100 /root/workspace/qwen35awq-backend.logQ: 更换图片后回答不准确怎么办A: 建议在上传新图片后刷新页面或者等待几秒再提问确保模型已经正确加载新图片。获取更多AI镜像想探索更多AI镜像和应用场景访问 CSDN星图镜像广场提供丰富的预置镜像覆盖大模型推理、图像生成、视频生成、模型微调等多个领域支持一键部署。

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价