模型列表
技术规格
详细的技术参数和能力
- 上下文窗口
- 1,000,000 tokens
- 最大输出
- 131,072 tokens
支持的请求模式
对话
能力
对话
支持多轮对话式补全
流式输出
生成过程中逐 token 增量返回
视觉理解
支持在请求中传入图片输入
工具调用
可调用请求中定义的函数/工具
深度思考
给出最终答案前先输出一段内部推理过程
批量处理
支持异步批量请求处理
提示缓存
以更低价格复用先前处理过的提示前缀
快速集成
一个 API 调用即可开始
quickstart.py
import openai
client = openai.OpenAI(
base_url="https://api.modelsite.ai/v1",
api_key="sk-ms-...",
)
response = client.chat.completions.create(
model="qwen3.7-plus",
messages=[{"role": "user", "content": "Hello!"}],
)
print(response.choices[0].message.content)
推荐场景
适合多模态对话、工具调用与批量推理场景。
按量付费
官方85折
定价
无承诺,仅按使用量付费
完整计价明细
Qwen3.7-Plus 的每个计价维度
Token 计费
- Cache Read$0.050 每百万 tokens
- 满 256000 tokens 起$1.20 每百万 tokens
- Input$0.251 每百万 tokens
- 满 256000 tokens 起$6.00 每百万 tokens
- Output$1.01 每百万 tokens
- 满 256000 tokens 起$24.00 每百万 tokens
- Thinking$1.01 每百万 tokens
- 满 256000 tokens 起$24.00 每百万 tokens
Cache 写入
- Cache Write$0.314 每百万 tokens
- 满 256000 tokens 起$7.50 每百万 tokens
其他维度
- Cache Read (Explicit)$0.025 每百万 tokens
- 满 256000 tokens 起$0.600 每百万 tokens
定价仅供参考——最终费用以请求时为准。