/v1/chat/completions)提供服务。系列内所有模型的请求和响应格式完全一致——只需修改 model 参数即可切换。
可用模型
-highspeed 高速版与对应标准版的参数和响应格式完全相同,区别在于运行在更快的推理基础设施上、计费更高——对延迟敏感、对成本不敏感的场景选高速版。核心能力
- Chat Completions API — 标准
/v1/chat/completions端点,使用messages格式 - 推理 — 回答前先思考,思维链通过
reasoning_content字段随回复返回(max_tokens需留足思考预算) - Anthropic 兼容 — 也可通过
/v1/messages以 Claude 消息格式调用 - 流式输出 — 通过 SSE 实现实时 Token 流式传输
- 工具调用 — 支持函数调用和工具使用
快速示例
参数说明
API 参考
查看可交互的 API Playground。