桃子桃子快讯
返回首页
工具

Octomind Cloud Beta 上线:为 AI 智能体提供持久云端算力

Octomind Cloud 把模型网关与持久云端容器整合,统一密钥与计费,面向长跑 AI 智能体工作流。

2026.07.22 · 周三5 分钟阅读

Octomind Cloud 今日以 Beta 形式开放公测,把模型 API 网关与持久化 Linux 容器整合到同一订阅、同一计费钱包与同一密钥之下,面向需要长时间运行的 AI 智能体工作流。原文为产品方自述。

产品瞄准的三类痛点

团队在公告中把当前 AI 智能体落地的常见问题归纳为三点:

  • 智能体进程与笔记本生命周期绑定:关闭笔记本、断网或休眠,会让进行中的会话与上下文一起丢失,已消耗的 Token 也随之作废。
  • 多家供应商的密钥分散在不同仪表盘:OpenRouter、Anthropic、OpenAI、Voyage 等各家计费、限速、最低充值彼此独立,没有统一的实际花费视图。
  • 计费不透明:订阅制工具存在限速黑盒,按用量计费的工具又可能因失控脚本一夜烧掉数十美元,二者都缺少逐 Token 的实时计量。

Octomind Cloud 将 Hub(模型)与 Machines(算力)打包在同一订阅里,试图用一个钱包覆盖上述场景。

模型网关 Hub

Hub 是一个兼容 OpenAI 接口的网关,背后是经过筛选的模型清单,公告中按两层划分:

  • 开放层(Open Shelf):随付费计划额度调用,公告列出 DeepSeek V4 Flash 与 Pro、Qwen3.7 Plus 与 Max、Kimi 2.6 与 2.7 Code、MiniMax M3、GLM-5.2、Gemma 4。
  • 付费层(Premium Shelf):按 Token 从预付费额度扣费,列出 Claude Fable 5、Opus 4.8、Sonnet 5;GPT-5.6 系列(Sol、Terra、Luna)以及 GPT-5.5、5.5 Pro、5.4 mini 与 nano;Gemini 3.5 Flash 与 3.1 Pro。
  • 免费层:每日配额的免费模型,付费额度耗尽后仍可继续调用,避免智能体在触顶时完全停摆。

并发按账号而非按密钥计算:Free 1 路、Pro 2 路、Max 5 路、Team 15 路共享;超额请求会短暂排队而非直接失败。Hub 底层为开源 Rust 项目 octohub,可由用户使用自有供应商密钥自行部署。

持久算力 Machines

Machine 是一个常驻 Linux 容器,内置智能体工具链:octomind 智能体、octocode 代码索引与语义搜索、octobrain 记忆模块、Web 终端、Git、Docker,以及默认镜像中的 Node、bun、无头浏览器、ffmpeg、图像处理工具。容器拥有独立磁盘,可在面板中创建,约一分钟内就绪。

状态化计费与价格

Machine 在任何时刻都处于以下四种状态之一,按状态计费,状态由系统自动迁移:

状态触发条件Small(1 vCPU / 2 GB)价格
Active正在执行工具、代码、索引、Embedding$0.05/小时
Idle-warm会话存活但等待(含等待模型返回)$0.01/小时
Suspended空闲自动挂起接近 $0(仅磁盘)
Archived挂起超过 3 天进入冷存接近 $0(额外磁盘 $0.04/GB·月)

按秒级计量。智能体等待模型返回的时段占大多数,按 Idle-warm 计费意味着这部分仅按 Active 价格的五分之一计费。官方举例:一次 5 分钟的会话约 0.5 美分,另加每次会话启动费 $0.001。

规格与磁盘价格:Small $0.05/小时,Medium(2 vCPU/4 GB)$0.10/小时,Large(4 vCPU/8 GB)$0.20/小时;每台机器默认 10 GB 工作磁盘,可分别预留 50/80/160 GB,超额按 $0.10/GB·月计费。原文在此处截断,更高规格的扩展上限与价格未披露。

备注

文中提及的部分模型名称(如 GPT-5.6 系列的 Sol/Terra/Luna、Claude Opus 4.8、Qwen3.7 Plus/Max、Gemini 3.5 Flash 等)为产品方在其 Beta 公告中列出的可用型号,并非市场已公开发布的版本,读者宜结合各模型厂商实际发布情况交叉核对。

信源