算力 API
平台算力 API
通过 Bearer Token 或 API 密钥调用平台托管的推理服务,支持流式输出与中断续传
最后更新:2026 年 8 月 26 日
1. 认证方式
- 在控制台「账户设置 → 开发者」创建密钥,需具备 services:invoke 权限。
- 请求头携带 Authorization: Bearer <api_key>。
- (X-Api-Key 请求头暂未实现,请统一使用 Bearer Token。)
- Web 控制台会话 Cookie 不建议用于服务端脚本;生产环境请使用独立 API 密钥。
- 控制台「模型中心」可按类型筛选公开模型、查看可用状态,并复制 curl / Python / Node.js 调用示例(Base URL 为 https://api.suanliyunxiang.com)。
- 各模型卡片可进入对应试玩台(对话 / 语音识别 / 语音合成 / 图片生成);音色库管理已并入语音合成试玩页。
- 开放服务目录中模型卡片的「文档」按钮会定位到本章对应章节(对话 / 语音 / 图像 / 向量)。
2. Chat Completions 端点
- POST https://api.suanliyunxiang.com/v1/chat/completions(或路径代理 /api/platform-services/{slug}/v1/chat/completions)。
- 自建 GPU 对话:model=qwen2.5-7b(通义千问 Qwen2.5-7B-Instruct AWQ,公开·Qwen 对话池);商业上游示例 model=deepseek-lite。
- 请求体兼容 OpenAI Chat Completions:model、messages、stream 等字段。
- 非流式请求返回完整 JSON;stream: true 时返回 text/event-stream。
- 主机从 /host/pools 加入「公开·Qwen 对话池」后,模型中心该 SKU 才会显示可用。
3. 向量嵌入 Embeddings
- 用于 RAG 检索、语义搜索与文档聚类的稠密向量服务(如 BGE-M3)。
- 调用路径以开放服务目录中该 SKU 的 invoke_path / 模型中心示例为准;计费多为按请求。
- 请求需携带 Authorization: Bearer <api_key>,并指定对应 model(如 bge-m3)。
- 将返回的向量写入自有向量库后做相似度检索;平台不托管业务侧向量索引。
- 具体字段与维度以当前上线 SKU 与试调用响应为准。
4. 流式 SSE
- 设置 stream: true 后,响应为 Server-Sent Events(SSE)格式。
- 每个 data: 行包含 JSON 片段;流结束以 data: [DONE] 或含 usage 的最终块标识。
- 响应头 X-Suanli-Stream-Status 标识流式结果:complete(正常完成)、interrupted(中断)。
- 客户端应监听连接断开与超时,结合续传接口恢复未完成生成。
5. 中断计费(免扣费)
- 流式响应未正常完成(无 [DONE]、连接中断、上游 5xx)时,billing_status=interrupted。
- 中断记录 amount_cents=0,不产生钱包扣费流水,主机亦无分成。
- 可在「账户 → API 调用记录」查看计费状态与流式状态;中断行可能含 resume_token。
6. 续传 POST /continue
- POST /api/v1/platform-services/{slug}/continue
- 请求体:{ "resume_token": "<token>" },token 来自中断响应头 X-Suanli-Resume-Token 或调用记录。
- 续传成功后 stream_status=continued,按最终 usage 计费(billing_status=charged)。
- 续传会话默认 24 小时有效,过期后需重新发起完整请求。
7. 查询续传会话
- GET /api/v1/platform-services/resume-sessions/{token}
- 返回 resume_token、status、partial_assistant_text、expires_at 等字段。
- 用于在续传前确认会话是否仍有效,以及已生成的部分内容。
8. 语音合成 POST /v1/audio/speech
- OpenAI 兼容 TTS:POST https://api.suanliyunxiang.com/v1/audio/speech(或路径代理 /api/platform-services/voxcpm2/v1/audio/speech)。
- 模型 model=voxcpm2(OpenBMB VoxCPM2,vLLM-Omni)。请求体字段:input(文本)、voice、response_format(如 wav)。
- 扩展:voice_description 用自然语言设计音色(如「年轻女性,温柔甜美」);reference_audio / ref_audio 为参考音频 URL 或 data URI,配合 reference_text / prompt_text 做声音克隆。
- 亦支持 multipart/form-data 上传 reference_audio 文件。控制台试听与音色库:从「模型中心」进入语音合成试玩(/dashboard/tts)。
- 计费按平台 SKU「voxcpm2」per_request;密钥需 services:invoke。权重与代码 Apache-2.0,可商用。
9. 语音识别 POST /v1/audio/transcriptions
- OpenAI 兼容 ASR:POST https://api.suanliyunxiang.com/v1/audio/transcriptions(或路径代理 /api/platform-services/sensevoice-small/v1/audio/transcriptions)。
- 模型 model=sensevoice-small(阿里 FunAudioLLM SenseVoice Small,国内)。请求须为 multipart/form-data,字段 file 必填(最大 25MB);可选 language、response_format。
- 控制台提供试听页:从「模型中心」进入语音识别试玩(/dashboard/asr,登录 Cookie 即可,无需再填 API Key)。
- 计费按平台 SKU「sensevoice-small」per_minute;密钥需 services:invoke。旧 SKU whisper-large-v3 已停用。
10. 图片生成 POST /v1/images/generations · 图生图 /v1/images/edits
- OpenAI 兼容文生图:POST https://api.suanliyunxiang.com/v1/images/generations(或路径代理 /api/platform-services/kolors/v1/images/generations)。
- 图生图:POST /v1/images/edits(JSON:prompt + image base64/data URL + 可选 strength,默认 0.65)。也可在 generations 请求体里带 image 字段走同一底座。
- 模型 model=kolors(快手可图 Kolors,国内)。请求体字段:prompt(必填)、size、response_format(b64_json 或 url)。平台强制 n=1,按次计费。
- 控制台生成预览:从「模型中心」进入图片生成试玩(/dashboard/image,登录 Cookie 即可)。出图走 GPU 图像池,主机从 /host/pools 加入「公开·可图图像池」,与 SenseVoice/VoxCPM2 相同。
- 计费按平台 SKU「kolors」per_request;密钥需 services:invoke。旧 SKU flux-schnell 已停用。