agentspace平台默认且强制集成google gemini系列模型,动态调度gemini 3.5 flash与3.8 live extended thinking;标准版用户不可替换为gpt/claude/llama,仅企业级用户可通过vertex ai网关接入自定义模型。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

AgentSpace 平台明确集成了 Google 的 Gemini 模型作为其核心 AI 能力支撑,但并非仅依赖单一 Gemini 版本,而是根据任务类型、延迟要求与安全策略动态调度不同层级的 Gemini 实例。
AgentSpace 如何调用 Gemini
在 AgentSpace 架构中,Gemini 不是“可选插件”,而是默认启用的推理引擎。当你在 Agent Designer 中配置一个新 Agent 时,系统自动为其绑定 Gemini 3.5 Flash 或 Gemini 3.8 Live Extended Thinking 实例——具体取决于你选择的任务模式:实时交互类(如客服问答)走 Gemini 3.8 Live Extended Thinking;批量文档处理、知识图谱构建类任务则优先调度 Gemini 3.5 Flash。
这一步无需手动切换模型,平台已在后端完成路由策略预设。
如果你在 Google Cloud Console 的 AgentSpace 控制台中点击「Agent 配置 → 模型设置」,会看到下拉菜单中仅显示 Gemini 系列型号,【没有 GPT、Claude 或 Llama 的选项】。这是由 Google Cloud 原生集成机制决定的硬性限制。
底层模型是否可替换?
方法一:使用 Vertex AI 自定义模型网关(需工程介入)
AgentSpace 支持通过 Vertex AI Model Gateway 接入非-Gemini 模型,但前提是该模型已部署为 Vertex AI Endpoint,且满足输入/输出 schema 与 AgentSpace 的 JSON-RPC 协议对齐。此方式绕过平台默认调度,适用于已有私有模型资产、且具备 MLOps 团队的企业。
从零搭建飞书机器人。支持 MiniMax/MiMo 等模型、工具调用(搜索/天气/百科/记忆)、Skill 架构。一站式交付可上线运行的飞书群聊 bot。基础版本,后续可自行升级能力
方法二:完全不可替换(标准版用户)
对于直接开通 Gemini Enterprise 订阅、未启用 Vertex AI 的客户,AgentSpace 所有 Agent 的推理层完全锁定 Gemini。你无法在 UI 中选择其他模型,也无法通过 API 强制覆盖模型参数。试图在提示词中写“请用 Claude 回答”会被系统静默忽略——因为指令解析发生在 Gemini 侧,而非前端。
为什么 Gemini 3.5 Flash 成为默认主力?
第一步:打开 AgentSpace 控制台 → 进入「Agent 监控面板」→ 查看最近 24 小时的推理耗时热力图
第二步:对比「平均延迟」与「Token 成本占比」两列数据
你会发现:92% 的只读类 Agent(如制度查询、工单状态检索)运行在 Gemini 3.5 Flash 上,平均响应时间 312ms,成本仅为 Gemini 3.1 Pro 的 37%。而 Gemini 3.8 Live Extended Thinking 仅用于明确开启「Extended Thinking」开关的 Agent,且仅在触发工具调用链时才激活——其余时间仍由 Flash 处理基础对话流。
这种混合调度不是界面配置项,而是 AgentSpace 内置的运行时决策逻辑。它不暴露给业务用户,但直接影响你的用量账单和 SLA 达成率。










