简单易学:星图平台快速部署Qwen3-VL:30B,打造看图聊天的AI助手

1. 项目概述

Qwen3-VL:30B是目前最强的多模态大模型之一,能够同时处理文本和图像输入,实现"看图聊天"的智能交互体验。本文将带您通过CSDN星图AI云平台,零基础完成这个强大模型的私有化部署,并接入Clawdbot管理平台。

实验环境说明:本文所有操作均在CSDN星图AI云平台完成,使用预装的Qwen3-VL-30B镜像作为基础环境。

1.1 硬件配置要求

组件 规格要求
GPU显存 推荐48GB以上
CPU核心 20核心以上
内存 240GB以上
系统盘 50GB以上

2. 环境准备与模型部署

2.1 镜像选择与启动

  1. 登录星图平台控制台
  2. 在镜像市场搜索"Qwen3-vl:30b"
  3. 选择官方提供的30B模型镜像

镜像搜索界面

2.2 实例创建

  • 选择GPU实例类型(推荐48G显存配置)
  • 保持其他默认设置
  • 点击"立即创建"

实例创建界面

2.3 模型测试

实例启动后,通过预装的Ollama Web界面进行基础测试:

from openai import OpenAI

client = OpenAI(
    base_url="您的实例公网URL/v1",
    api_key="ollama"
)

response = client.chat.completions.create(
    model="qwen3-vl:30b",
    messages=[{"role": "user", "content": "描述这张图片", "image": "图片URL"}]
)
print(response.choices[0].message.content)

3. Clawdbot安装与配置

3.1 安装Clawdbot

npm i -g clawdbot

安装过程截图

3.2 初始化配置

clawdbot onboard

按照向导完成基础配置,高级设置可后续在控制面板调整。

3.3 启动网关服务

clawdbot gateway

访问控制面板(默认端口18789):

https://您的实例公网URL:18789/

4. 关键配置调整

4.1 网络监听设置

修改~/.clawdbot/clawdbot.json配置文件:

"gateway": {
    "bind": "lan",
    "port": 18789,
    "auth": {
        "mode": "token",
        "token": "自定义安全令牌"
    },
    "trustedProxies": ["0.0.0.0/0"]
}

4.2 模型集成配置

在配置文件中添加Qwen3-VL模型:

"models": {
    "providers": {
        "my-ollama": {
            "baseUrl": "http://127.0.0.1:11434/v1",
            "apiKey": "ollama",
            "models": [{
                "id": "qwen3-vl:30b",
                "name": "Local Qwen3 30B"
            }]
        }
    }
},
"agents": {
    "defaults": {
        "model": {
            "primary": "my-ollama/qwen3-vl:30b"
        }
    }
}

5. 功能测试与验证

5.1 文本对话测试

在Clawdbot的Chat界面输入文本问题,观察模型响应:

用户:请介绍一下你自己
AI:我是基于Qwen3-VL-30B模型的智能助手,能够处理文本和图像输入...

5.2 多模态能力测试

上传图片并提问:

用户:[上传图片] 请描述这张图片的内容
AI:这张图片显示的是... [详细描述]

5.3 资源监控

通过命令监控GPU使用情况:

watch nvidia-smi

6. 总结与下一步

通过本文,您已经成功:

  1. 在星图平台部署了Qwen3-VL:30B大模型
  2. 安装配置了Clawdbot管理平台
  3. 实现了基础的多模态对话功能

下一步计划

  • 接入飞书等办公平台
  • 实现更复杂的业务场景应用
  • 优化模型响应速度

获取更多AI镜像

想探索更多AI镜像和应用场景?访问 CSDN星图镜像广场,提供丰富的预置镜像,覆盖大模型推理、图像生成、视频生成、模型微调等多个领域,支持一键部署。

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐