三大模型,覆盖快速问答与专业内容场景
YONG 系列轻量对话模型(本地部署),低延迟快速响应,适合高频问答与日常对话场景。
平台本地部署的轻量对话模型,毫秒级响应、无需排队,适合高频调用、快速问答、文本摘要与内容生成等场景。
YONG 平台提供的专业服务模型,由平台专家团队保障的高质量响应,面向对内容质量有严格要求的业务场景。
完全兼容 /v1/chat/completions 协议,主流 SDK 与框架零改动接入。
API Key 鉴权 + 独立密钥管理,HTTPS 加密传输,密钥随时吊销。
控制台实时查看调用次数、Token 消耗与费用明细,按天/按模型统计。
按模型配置 RPM/TPM 限额,标准化限流错误码,保障服务稳定。
统一 OpenAI 风格错误结构,11 类标准错误码,便于程序化处理。
注册即送 ¥10 体验额度,按 Token 精确计费,余额随时查询。
注册即送 ¥10 体验额度,无需绑定任何支付方式。
在控制台一键创建密钥,按需命名、随时吊销。
一行 curl 即可调用,兼容 OpenAI SDK。
curl https://platform.yongzheng.online/v1/chat/completions \
-H "Authorization: Bearer sk-yong-..." \
-H "Content-Type: application/json" \
-d '{
"model": "qwen-0.5b-chat",
"messages": [{"role": "user", "content": "你好,介绍一下你自己"}]
}'