Qwen3-vl-flash

阿里
视觉
对话
text
模型 Code
qwen3-vl-flash
服务状态
可调用

模型介绍

Qwen3系列小尺寸视觉理解模型,实现思考模式和非思考模式的有效融合,效果优于开源版Qwen3-VL-30B-A3B,响应速度快。全面升级图像/视频理解,支持长视频长文档等超长上下文、空间感知与万物识别;具备视觉2D/3D定位能力,胜任复杂现实任务。

模型能力

输入模态
模型体验支持
思考模式不支持
Function Calling不支持
结构化输出不支持
输出模态
内置工具不支持
联网搜索未提供
缓存未提供

模型价格

输入0.15元/ 百万 token
输入(缓存命中)0.03元/ 百万 token
输入(Batch File)0.075元/ 百万 token
显式缓存创建0.1875元/ 百万 token
显式缓存命中0.015元/ 百万 token
输入(Batch Chat)0.15元/ 百万 token
输出1.5元/ 百万 token
输出(Batch File)0.75元/ 百万 token
输出(Batch Chat)1.5元/ 百万 token

模型限流与上下文

最大输入长度
252K Tokens
上下文长度
128K Tokens
最大输出长度
16K Tokens

API 代码示例

import requests

url = "https://limapi.com/api/v1/chat/completions"
headers = {
    "Authorization": "Bearer YOUR_API_KEY",
    "Content-Type": "application/json"
}

payload = {
    "model": "qwen3-vl-flash",
    "stream": True,
    "messages": [
        {"role": "system", "content": "You are a helpful assistant."},
        {"role": "user", "content": "你好,请介绍一下你自己"}
    ]
}

response = requests.post(url, headers=headers, json=payload, stream=True)
for line in response.iter_lines():
    if line:
        print(line.decode("utf-8"))

将示例中的 YOUR_API_KEY 替换为你的 API Key 即可调用。