qwen3.5-flash

模型介绍

通义千问文本生成深度思考

Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步;响应速度快,兼具推理速度和性能。

支持协议OpenAI

输入模态

文本

输出模态

文本

模型能力

  • 工具调用模型可根据对话内容决定调用你定义的工具函数,并返回结构化参数。
  • 多模态输入除文字外,还可以理解图片等非文本输入。
  • 内容缓存重复的输入前缀可命中缓存,按更低的价格计费。
  • 推理能力模型会先进行内部思考再作答,适合复杂推理与编程任务。

模型价格

输入 128K–256K

输入
0.8元/每百万tokens
输出
8元/每百万tokens

价格仅供参考,实际结算价格以合同为准。数据更新于 2026-08-01。

模型限流与上下文

上下文长度
1M
最大输出长度
64K
curl https://netnexus.top/api/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.5-flash",
    "messages": [{ "role": "user", "content": "你好,请介绍一下你自己" }]
  }'

需要开通 qwen3.5-flash?

官方渠道 Key 交付,支持对公结算开票。

浏览更多模型

联系商务

为您的企业定制 AI 接入方案

微信同号,在微信中搜索手机号即可添加