Couchbase 基于 Amazon Bedrock 与 Claude 构建 Capella iQ 多模型架构
AWS 与 Couchbase 合写的技术博客,详解 Capella iQ 如何借助 Bedrock 与 Claude…
数据库厂商 Couchbase 在其 AI 开发者助手产品 Capella iQ 中,采用 Amazon Bedrock 作为统一推理底座,并以 Anthropic 的 Claude 模型家族作为核心生成引擎。该架构面向企业客户,强调模型无关性、跨区域高可用以及私有网络部署能力。
多模型推理架构概览
Capella iQ 的推理层运行在 AWS 控制平面内,跨 us-east-1 与 us-west-2 两个区域部署以保障可用性。us-east-1 中的 Amazon EKS 集群承载三类核心微服务:
- cp-api pod:接收开发者请求并编排推理调用,通过 VPC 接口端点转发至 Bedrock。
- cp-internal-api pod:处理内部服务通信与模型路由逻辑。
- cp-ns pod:管理命名空间级别的模型厂商配置、租户级覆盖与组织级偏好。
请求链路全程通过 VPC 接口端点连接 Bedrock 运行时,提示词与响应数据不经过公网,满足企业级数据驻留与安全要求。Bedrock 的跨区域推理(CRIS)在 us-east-1、us-east-2 与 us-west-2 之间自动调度流量,应对突发负载与区域降级,无需应用层介入。模型厂商或版本切换只需在命名空间层更新配置,不涉及代码改动或停机。
模型选型与内部基准
Couchbase 在上线前针对 Capella iQ 的核心工作流——SQL++ 生成、索引推荐、查询解释、iQ Insights 生成与多轮对话——构建了标准化测试集,评估维度涵盖功能正确性、确定性、延迟与格式一致性。Claude Sonnet 4.5 在借鉴 BIRD 方法的内部评测中取得约 76% 的准确率,覆盖结构化代码生成、自然语言解释与多轮推理等场景,无关键回归。该结果同时验证了一套模型评测框架,便于后续在 Bedrock 上快速引入新一代模型。
Bedrock 的工程价值
Amazon Bedrock 提供完全托管的无服务器推理环境,免去底层模型基础设施运维。其不断扩展的基础模型目录让 Couchbase 能够在不重构推理管道的前提下评估并接入新模型;跨区域推理则内置了弹性与地理分布能力,避免了自建多区域调度系统的工程成本。
对 Couchbase 而言,通过单一 API 访问多个模型家族,与其在 Capella 产品线中追求的灵活性与客户部署多样性目标高度契合,也为未来扩展到其他模型厂商保留了接口空间。
