算力 API

平台算力 API

通过 Bearer Token 或 API 密钥调用平台托管的推理服务,支持流式输出与中断续传

最后更新:2026 年 8 月 26 日

1. 认证方式

  • 在控制台「账户设置 → 开发者」创建密钥,需具备 services:invoke 权限。
  • 请求头携带 Authorization: Bearer <api_key>。
  • (X-Api-Key 请求头暂未实现,请统一使用 Bearer Token。)
  • Web 控制台会话 Cookie 不建议用于服务端脚本;生产环境请使用独立 API 密钥。
  • 控制台「模型中心」可按类型筛选公开模型、查看可用状态,并复制 curl / Python / Node.js 调用示例(Base URL 为 https://api.suanliyunxiang.com)。
  • 各模型卡片可进入对应试玩台(对话 / 语音识别 / 语音合成 / 图片生成);音色库管理已并入语音合成试玩页。
  • 开放服务目录中模型卡片的「文档」按钮会定位到本章对应章节(对话 / 语音 / 图像 / 向量)。

2. Chat Completions 端点

  • POST https://api.suanliyunxiang.com/v1/chat/completions(或路径代理 /api/platform-services/{slug}/v1/chat/completions)。
  • 自建 GPU 对话:model=qwen2.5-7b(通义千问 Qwen2.5-7B-Instruct AWQ,公开·Qwen 对话池);商业上游示例 model=deepseek-lite。
  • 请求体兼容 OpenAI Chat Completions:model、messages、stream 等字段。
  • 非流式请求返回完整 JSON;stream: true 时返回 text/event-stream。
  • 主机从 /host/pools 加入「公开·Qwen 对话池」后,模型中心该 SKU 才会显示可用。

3. 向量嵌入 Embeddings

  • 用于 RAG 检索、语义搜索与文档聚类的稠密向量服务(如 BGE-M3)。
  • 调用路径以开放服务目录中该 SKU 的 invoke_path / 模型中心示例为准;计费多为按请求。
  • 请求需携带 Authorization: Bearer <api_key>,并指定对应 model(如 bge-m3)。
  • 将返回的向量写入自有向量库后做相似度检索;平台不托管业务侧向量索引。
  • 具体字段与维度以当前上线 SKU 与试调用响应为准。

4. 流式 SSE

  • 设置 stream: true 后,响应为 Server-Sent Events(SSE)格式。
  • 每个 data: 行包含 JSON 片段;流结束以 data: [DONE] 或含 usage 的最终块标识。
  • 响应头 X-Suanli-Stream-Status 标识流式结果:complete(正常完成)、interrupted(中断)。
  • 客户端应监听连接断开与超时,结合续传接口恢复未完成生成。

5. 中断计费(免扣费)

  • 流式响应未正常完成(无 [DONE]、连接中断、上游 5xx)时,billing_status=interrupted。
  • 中断记录 amount_cents=0,不产生钱包扣费流水,主机亦无分成。
  • 可在「账户 → API 调用记录」查看计费状态与流式状态;中断行可能含 resume_token。

6. 续传 POST /continue

  • POST /api/v1/platform-services/{slug}/continue
  • 请求体:{ "resume_token": "<token>" },token 来自中断响应头 X-Suanli-Resume-Token 或调用记录。
  • 续传成功后 stream_status=continued,按最终 usage 计费(billing_status=charged)。
  • 续传会话默认 24 小时有效,过期后需重新发起完整请求。

7. 查询续传会话

  • GET /api/v1/platform-services/resume-sessions/{token}
  • 返回 resume_token、status、partial_assistant_text、expires_at 等字段。
  • 用于在续传前确认会话是否仍有效,以及已生成的部分内容。

8. 语音合成 POST /v1/audio/speech

  • OpenAI 兼容 TTS:POST https://api.suanliyunxiang.com/v1/audio/speech(或路径代理 /api/platform-services/voxcpm2/v1/audio/speech)。
  • 模型 model=voxcpm2(OpenBMB VoxCPM2,vLLM-Omni)。请求体字段:input(文本)、voice、response_format(如 wav)。
  • 扩展:voice_description 用自然语言设计音色(如「年轻女性,温柔甜美」);reference_audio / ref_audio 为参考音频 URL 或 data URI,配合 reference_text / prompt_text 做声音克隆。
  • 亦支持 multipart/form-data 上传 reference_audio 文件。控制台试听与音色库:从「模型中心」进入语音合成试玩(/dashboard/tts)。
  • 计费按平台 SKU「voxcpm2」per_request;密钥需 services:invoke。权重与代码 Apache-2.0,可商用。

9. 语音识别 POST /v1/audio/transcriptions

  • OpenAI 兼容 ASR:POST https://api.suanliyunxiang.com/v1/audio/transcriptions(或路径代理 /api/platform-services/sensevoice-small/v1/audio/transcriptions)。
  • 模型 model=sensevoice-small(阿里 FunAudioLLM SenseVoice Small,国内)。请求须为 multipart/form-data,字段 file 必填(最大 25MB);可选 language、response_format。
  • 控制台提供试听页:从「模型中心」进入语音识别试玩(/dashboard/asr,登录 Cookie 即可,无需再填 API Key)。
  • 计费按平台 SKU「sensevoice-small」per_minute;密钥需 services:invoke。旧 SKU whisper-large-v3 已停用。

10. 图片生成 POST /v1/images/generations · 图生图 /v1/images/edits

  • OpenAI 兼容文生图:POST https://api.suanliyunxiang.com/v1/images/generations(或路径代理 /api/platform-services/kolors/v1/images/generations)。
  • 图生图:POST /v1/images/edits(JSON:prompt + image base64/data URL + 可选 strength,默认 0.65)。也可在 generations 请求体里带 image 字段走同一底座。
  • 模型 model=kolors(快手可图 Kolors,国内)。请求体字段:prompt(必填)、size、response_format(b64_json 或 url)。平台强制 n=1,按次计费。
  • 控制台生成预览:从「模型中心」进入图片生成试玩(/dashboard/image,登录 Cookie 即可)。出图走 GPU 图像池,主机从 /host/pools 加入「公开·可图图像池」,与 SenseVoice/VoxCPM2 相同。
  • 计费按平台 SKU「kolors」per_request;密钥需 services:invoke。旧 SKU flux-schnell 已停用。
返回文档中心

需要更多帮助? 联系客服