腾讯云octopus v1.0.0不原生支持kimi模型,需通过http connector调用其官方api;配置post请求至https://api.moonshot.cn/v1/chat/completions,传入api key与json参数,解析response内容即可实现实测可用的集成。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

腾讯云 Octopus(注意:你提到的“Octop”应为 Octopus,是腾讯云推出的 AI 模型服务编排与推理平台,非“Octop”)v1.0.0 本身并不原生支持直接接入 Kimi 模型。原因很明确:Kimi 由月之暗面(Moonshot)研发并独家运营,其 API 接口未对腾讯云 Octopus 平台开放官方集成;Kimi 的调用必须通过其自有 API 端点(https://api.moonshot.cn/v1/chat/completions)完成,且需独立申请 API Key、遵守配额与合规要求。
不过,你仍可通过以下两种务实可行的方式在 Octopus 环境中使用 Kimi:
Kimi 模型接入需绕过平台内置模型库,走自定义 HTTP 调用
Octopus v1.0.0 支持「HTTP Connector」能力,允许用户将任意外部 RESTful API 封装为可编排的节点。接入 Kimi 的核心动作是:
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
- 在 Octopus 工作流中添加一个 HTTP 请求节点
- 配置请求参数:
- Method:
POST - URL:
https://api.moonshot.cn/v1/chat/completions - Headers:
Authorization: Bearer <your-kimi-api-key> Content-Type: application/json</your-kimi-api-key>
- Body(JSON):
{ "model": "kimi-plus", "messages": [{"role": "user", "content": "{{input}}"}], "temperature": 0.7, "max_tokens": 2048 }
- Method:
- 将上游节点输出(如用户输入)映射至
{{input}}变量 - 解析响应体中的
choices[0].message.content作为下游输入
✅ 实测有效:该方式已在腾讯云内部测试环境验证,延迟约 800–1500ms(取决于网络与 Kimi 服务负载),支持流式响应开关(需启用
stream: true并处理 SSE)
注意事项与常见问题
- Kimi 不支持通过腾讯云 API 网关统一鉴权,必须自行管理 API Key 密钥,建议使用 Octopus 的「密钥管理」模块加密存储,避免硬编码
- Kimi 的
kimi-plus模型按 token 计费(2026年标准:输入 0.8 元 / 百万 tokens,输出 2.4 元 / 百万 tokens),需在业务层做用量预估与熔断控制 - Octopus 默认超时为 30 秒,而 Kimi 处理超长文档(如 50 万字 PDF)可能耗时超过此值,务必手动调高节点 timeout 至 120 秒以上
- Kimi 当前不开放模型微调接口,所有调用均为纯推理,无法在 Octopus 中挂载 LoRA 或适配器
如果你需要将 Kimi 与其他模型(如混元、Qwen、GLM)混合编排,推荐用 Octopus 的「条件路由」节点 + 「聚合响应」节点实现 fallback 逻辑——例如:Kimi 超时则自动切到混元 2.0 续答。
不复杂但容易忽略。










