跳到主要内容
模型列表

QwenQwen3.7-Plus

大厂直供
chatstreamingvisiontoolsthinkingbatchcache

技术规格

详细的技术参数和能力

上下文窗口
1,000,000 tokens
最大输出
131,072 tokens

支持的请求模式

对话

能力

对话

支持多轮对话式补全

流式输出

生成过程中逐 token 增量返回

视觉理解

支持在请求中传入图片输入

工具调用

可调用请求中定义的函数/工具

深度思考

给出最终答案前先输出一段内部推理过程

批量处理

支持异步批量请求处理

提示缓存

以更低价格复用先前处理过的提示前缀

快速集成

一个 API 调用即可开始

quickstart.py
import openai
 
client = openai.OpenAI(
base_url="https://api.modelsite.ai/v1",
api_key="sk-ms-...",
)
 
response = client.chat.completions.create(
model="qwen3.7-plus",
messages=[{"role": "user", "content": "Hello!"}],
)
print(response.choices[0].message.content)

推荐场景

适合多模态对话、工具调用与批量推理场景。

按量付费
官方85折

定价

无承诺,仅按使用量付费

完整计价明细

Qwen3.7-Plus 的每个计价维度

Token 计费

  • Cache Read$0.050 每百万 tokens
    • 满 256000 tokens 起$1.20 每百万 tokens
  • Input$0.251 每百万 tokens
    • 满 256000 tokens 起$6.00 每百万 tokens
  • Output$1.01 每百万 tokens
    • 满 256000 tokens 起$24.00 每百万 tokens
  • Thinking$1.01 每百万 tokens
    • 满 256000 tokens 起$24.00 每百万 tokens

Cache 写入

  • Cache Write$0.314 每百万 tokens
    • 满 256000 tokens 起$7.50 每百万 tokens

其他维度

  • Cache Read (Explicit)$0.025 每百万 tokens
    • 满 256000 tokens 起$0.600 每百万 tokens

定价仅供参考——最终费用以请求时为准。