一个入口,一整片模型

一份订阅,
一整个模型光谱。

你原来用的编程工具不用换。注册、跑一行脚本,就能在前沿模型和国产模型之间随意挑。

人民币结算 · 中英双语 · 不用信用卡 · 可开发票、可签合同

12 个模型可选可用率与事故复盘全部公开查看状态页

你的额度,随时可查

5× Pro
本计费月
39%
本周
65%
5 小时窗口
68%
当前模型 · 随时换
前沿推理1.00×均衡通用0.42×国产旗舰0.18×高速轻量0.06×
01怎么开始

三步,五分钟

不用信用卡,不用换汇,不用读文档。第一次用大模型服务的人也能自己跑通。

第一步

注册账号

一个邮箱就行,收个验证码。注册不需要付款,也不用绑卡。

第二步

跑一行脚本

在控制台建一把密钥,然后跑下面这行。脚本会让你粘贴密钥,把接口地址和密钥写进 ~/.config/agiplan/env,不装任何程序,也不改你的 shell 配置。

第三步

打开你原来的工具

照常用就行。要换模型,改请求里的 model 字段:填具体模型就固定用它,填 auto 交给 Prism。

shell
# 第二步就是这一行
curl -fsSL https://agiplan.dev/setup -o setup.sh && sh setup.sh

# 让它在当前 shell 生效,再确认一下通了
. ~/.config/agiplan/env
curl -s "$API_BASE_URL/models" -H "Authorization: Bearer $API_KEY"

脚本做了什么全部公开在文档里,也可以完全不用它——手动配两个环境变量同样可以。密钥写在你主目录下的配置文件里(权限 600),不在任何项目目录里,不会被误提交进 git。命令行工具还没有发布,脚本不假装装了什么。

注册账号

注册不产生任何费用。登录后在控制台选档位、建密钥。

你现在用的工具,基本都能直接接

我们同时兼容两套主流 API 协议。凡是允许你改接口地址的工具,配置里换个地址就能用,不用装插件,不用改业务代码。

命令行 AI 编程助手IDE 与编辑器插件Agent 与工作流框架自建应用与官方 SDK各类自动化脚本
02能挑什么

别把整套工作,
押在一个模型上。

模型每季度换代,价格每半年腰斩。今天最好用的那个,明年未必还在。我们把模型按能力分成四组,同一份额度按各自的兑换效率消耗,换一个就是网页上点一下。

很多人默认国产模型是省钱用的备胎。做中文长文本和批量整理的时候它本来就更合适,顺便还便宜。

能力组输入输出什么时候用它最划算
前沿推理0.201.00长链路 agent、复杂重构、需要一次做对的任务
均衡通用0.080.42日常编码和代码审查,大多数人的默认档
国产旗舰0.030.18中文长文本、资料整理、成本敏感的批量任务
高速轻量0.010.06补全、分类、格式化,追求响应速度

这张表公开在 /models 页,倍率任何调整提前 30 天公告。同样是 480,000 CU,全用前沿推理跑一个月,和把日常任务放到均衡组、批量整理丢给国产旗舰组,能跑的量差好几倍。 怎么花是你的事,我们只负责把账算清楚。

03Prism

Prism,把任务分到该去的地方

你一天里的任务难度差得很远。改个变量名和重构一个模块,如果都用同一个最贵的模型跑,钱就是这么烧掉的。

Prism 是我们的调度层。请求进来先过它,判断这次任务的难度和需要的能力,再分配到光谱上合适的位置。你可以直接用我们调好的 auto,也可以自己定一套规则。

你的请求照常调用,不改代码PRISM前沿推理 · 1.00×均衡通用 · 0.42×国产旗舰 · 0.18×高速轻量 · 0.06×

算一下同样的钱能多做多少

用公开的真实倍率计算
20%
前沿推理 20%均衡通用 48%国产旗舰 20%高速轻量 12%
不用 Prism,全程前沿组480,000 CU 的工作量
交给 Prism,能力相同1,079,137 CU 的工作量
2.2×同一份 5× Pro 额度,多做 599,137 CU 的活——等于白拿这么多。
倍数对每一档都成立。档位越高,多出来的绝对量越大。

这是按任务构成的估算,不是承诺值。真实倍数取决于你的实际任务分布,控制台每月会给你一份实测对比。

想自己指定模型,随时可以

同一个 model 字段两种用法:填一个具体模型就固定用它,填 auto 或者你自己的自定义模型名就交给 Prism 动态调度。换用法不用改别的代码,也不用重新配环境。

request
model: "model-a"        // 固定用这一个模型,Prism 不介入
model: "auto"           // 交给 Prism,按任务难度自动挑
model: "coder"          // 你自己的自定义模型,规则你定

自己的模型名,按每一轮的活挑模型

回答四个问题,得到一个自己的模型名,比如 coder。调用时填它:要审美的、难的交给强模型,有把握的简单活交给便宜模型,其余走你选的默认模型。每一条规则、每一个门槛都摆在控制台里,改了先用你自己的流量回放,再存成新的一版。

拖一下,看每句话会交给谁

示例对话 · 判定概率为示意值 · 规则和线上是同一份代码
质量优先:拿不准就用强模型成本优先:更敢往下放
  1. 你帮我把登录页的按钮和间距调得好看一点

    前端 / UI0.84要审美0.78困难0.10
    强模型前沿推理做好要靠审美
  2. 你写个脚本,把 logs 目录下的 .gz 解压后按日期归档

    脚本0.90要审美0.03困难0.06
    便宜模型高速轻量有把握是简单的活
  3. 你这个报错是什么意思:Cannot read properties of undefined

    调试0.78要审美0.02困难0.16
    便宜模型高速轻量有把握是简单的活
  4. 你把订单模块从回调改成 async/await,行为一点都不能变

    重构0.80要审美0.04困难0.58
    强模型前沿推理判定为困难
  5. 你给这个接口的返回值加一个分页字段,旧客户端不能挂

    后端0.71要审美0.05困难0.30
    默认模型均衡通用都不算,走默认
  6. 你给这个接口补一段 README 说明

    写作0.74要审美0.28困难0.05
    默认模型均衡通用都不算,走默认
  7. 你设计一下多租户的数据隔离方案,列出取舍

    架构0.86要审美0.12困难0.72
    强模型前沿推理判定为困难
  8. 你在吗?先问个小问题

    闲聊0.95要审美0.01困难0.01
    便宜模型高速轻量有把握是简单的活
这 8 轮:3 轮强模型 · 2 轮默认 · 3 轮便宜模型同样的额度,能做全用前沿组时的 2.0× 的活
按公开的能力组系数、每轮 12K 上下文和 900 输出估算,每一轮单独算,不含对话里的缓存。实际倍数取决于你的任务分布,建好之后控制台会用你自己的流量回放给你看。
一

回答四个问题

主要拿它做什么、质量和成本怎么取舍、强 / 默认 / 便宜三个位置各用谁、要不要顺手给 subagent 建偏质量和偏成本两档。规则由这几个答案生成,不是黑箱。

二

用你自己的流量回放

改一个门槛,立刻看到过去 30 天的请求会怎么分、多做还是少做多少活、哪些请求会换去处。在你的浏览器里算,存下来的每一版都能一键恢复。

三

填进工具的三个槽位

Claude Code 本来就把主任务和 subagent 分三档。把 coder-high、coder、coder-lite 填进去,工具分档,我们在档内按任务挑模型。

建一个自定义模型

判定要看你最近一条消息,判完即丢;我们只存判定的概率这类数字,不存对话内容。保存可以随时关掉、一键清空。

按任务类型分流还在规划中,尚未对外开放:现在已经可以建自定义模型、调用它,开放之前每一轮都走你设的「判不了时」那个模型,开放后不用改任何配置。

降本不能降能力。 auto 在难度落在边界上的时候一律往高了走——多花点钱远好过输出变差,这是写死的。自定义模型里往哪边偏由你定:只有你自己调向成本的那部分才会往下放,而且每一次往下放都写在调度链路里。

模型出故障,自动切到同能力的灾备模型

任何一个模型都有可能限流、超时或者临时不可用。Prism 会立刻把请求转给同一能力组里的灾备模型,你这一次调用不会失败。这个功能默认开着,你可以关掉。

可控

可按需关闭

默认开启。在自定义模型里设置 `"failover": { "enabled": false }` 后,模型故障时直接返回失败,不切换模型。自定义灾备顺序尚未支持:目前仅在同能力组内自动选择,`scope` 只接受 `same_tier`。

同能力

只往同一能力组里切

只在同一能力组内切,绝不跨组降到更便宜的组——那种降级我们宁可失败并告诉你(503,附完整尝试记录),也不偷偷换。组内会优先挑质量档更高的那条,所以故障时可能落到组内档次稍低的一条;每次响应都带 `x-agiplan-model-actual`,实际是谁答的一直摆在那儿。

不重复计费

失败的尝试不算钱

只对最终成功返回的那一次计量。中间试了几次都不进你的账单。

按实际计价

换到哪条线,就按哪条线收

灾备切换后按真正服务你的那条线的售价计费,账单上写的是实际服务的模型和它的价。失败的那几次尝试一个字都不计——你不该为我们的故障买单。

每一次调度,都能回放

自动调度天生让人怀疑「是不是偷偷给我用了便宜货」。唯一的解法是把每一次决策摊开给你看。每个请求都有一条链路记录,保留 30 天,可导出。

示例trace tr_01J8FQ3M7X总耗时 8.42s · 实扣 4.970 CU
  1. 0ms鉴权ap_live_…f3c2 · 5× Pro
  2. 3ms配额预扣 11.742 CU(输入 14,200 + max_tokens 8,192 的最坏情况),三窗口余量充足
  3. 11msPrism难度 0.82 · tools=3 tokens_in=14,200 code_blocks=2
  4. 12ms路由规则 #1 命中 → 前沿推理组 · model-a
  5. 14ms响应model-a 限流
  6. 210ms灾备切换转同能力灾备模型 model-b · 按 model-b 计价
  7. 224ms流式首 token 890ms
  8. 8.42s结算in 14,200 / out 2,130 → 实扣 4.970 CU,退回预扣差额 6.772 CU

链路记录只含元数据,不含请求正文——和第 07 节的零留存是同一套架构。报障时把 trace_id 发给我们就行,客服能一键定位。

04算得清

额度怎么算,写在明处

贵不贵是其次,先得算得清。我们用一个统一单位 CU: 1 CU = 基准模型 1,000 输出 token

每个模型的输入输出系数公开,每一次调用的消耗可查、可导出、可对账。为了让你有个直观参照,四档的用量当量是这样的:

档位月额度用量当量大致相当于
Lite30,000 CU入门级月付套餐的用量
Pro96,000 CU标准订阅档的用量
5× Pro480,000 CU标准订阅档的 5 倍
Max1,920,000 CU标准订阅档的 20 倍
三个窗口

5 小时 · 周 · 计费月

三个窗口同时生效,控制台实时可见。计费月按你的下单日算,不是自然月,月末订阅不会只给你两天额度。

逐条明细

每一次调用都可查

时间、模型、输入输出 token、扣减 CU、延迟、追踪号。可按项目和时间段导出 CSV。

不静默变更

倍率上调提前 30 天公告

已售出的订阅在周期内口径不变。套餐版本不可变,改价只对新订阅生效。

用不完

按剩余周期比例退

随时可退订,按未使用的周期比例退款。我们不靠你用不完的额度赚钱。

实时状态

每个模型现在能不能用

状态页按模型给出:当前是否可用、近 30 天可用率、你所在地能不能用,以及每一条探测的原始记录(时刻、成败、延迟、失败类型,可按月导出)。数据来自每 15 分钟一次的真实探测。倍率在 /models 页。延迟目前只在内部看,没有对外发布。

用量预警

快用完之前告诉你

周额度或月额度到 80% 时提醒(阈值目前固定,不可自定义),并给出建议:换到哪个能力组还能再跑多久,或者升档要补多少差价。5 小时窗口不发邮件——它一天要重置好几次,发了就成了打扰;那一档的余量在每个响应头里都有,控制台的额度环上也是实时的。

05多少钱

我们不打价格战。省下来的力气花在别处:不断供,算得清,出事有人认。

Lite
¥49/月

先试试水的量

  • 8,000 CU / 周
  • 30,000 CU / 月
  • 5 小时窗口 600 CU
  • 可选择不同模型
  • Prism auto 调度
开始使用
Pro
¥119/月

当量 ≈ 标准订阅档

  • 24,000 CU / 周
  • 96,000 CU / 月
  • 5 小时窗口 1,800 CU
  • 可选择不同模型
  • 邮件支持,中文人工回复
开始使用
5× Pro最多人选择
¥569/月

当量 ≈ Pro 的 5 倍

  • 120,000 CU / 周
  • 480,000 CU / 月
  • 5 小时窗口 9,000 CU
  • 自定义 Prism 模型
  • 优先通道(规划中)
开始使用
Max
¥1,368/月

当量 ≈ Pro 的 20 倍

  • 480,000 CU / 周
  • 1,920,000 CU / 月
  • 5 小时窗口 30,000 CU
  • 并发 8 路
  • 专属通道(规划中)
开始使用
年付八折,相当于省两个月可开增值税发票,支持对公转账7 天内用量不足 10% 全额退额度用完还想继续?换一个更省的能力组,或者升一档,见计费说明多人协作看 企业方案
06给团队

一份合同,管住整个团队的用量与成本。

团队用起来,麻烦的往往不是能不能用,是月底对不上账。这些能力都跑在我们自研的网关上——配额、路由、计量、审计是同一套代码,不是拼装出来的中间件。

统一采购与账单

按席位或按额度包批量采购,一次开票、对公结算,支持年度框架合同与预付。

部门与项目配额

把总额度分到部门、项目、个人,各自独立的周月上限和告警阈值,一个团队用超不影响别人。

成本归因看板

按项目、成员、模型三个维度拆分消耗,可导出到你自己的 BI。谁花了多少一目了然。

SSO 与成员治理规划中

规划中:OIDC / SAML 与主流企业办公平台登录、入离职同步。密钥作用域与强制轮换现在就能用,单点登录还没有做出来。

统一的 Prism 策略

为团队定一套调度规则并下发到所有成员,成本可控,也不用每个人自己琢磨该用哪个模型。

私有化与合规规划中

数据处理协议、安全问卷与审计配合现在就能谈。VPC 内的网关节点尚未提供,需要的话先联系我们,别按它已经存在来做方案。

07你的数据

你的代码和提示词,我们默认不保存

你要把工作里最敏感的东西发给我们——代码、文档、客户资料。这一节写得比一般营销页啰嗦,希望你真的读一下。

默认零留存

请求与响应正文不落盘

网关只记录计量必需的元数据:模型、token 数、延迟、状态码、追踪号。正文在内存里转发,流一结束就释放,不写日志、不写数据库、不进对象存储。

诊断日志

我们没有做这个开关

排障时能看正文当然方便,而我们没有做——正文一律不落盘,没有例外。将来要做的话会默认关闭、由你自己开、有明确保留期,并且提前公告。在那之前,不存在任何一条能让我们看到你正文的路径。

绝不训练

不训练、不转售、不人工阅读

你的内容不会进入任何训练或微调流程,不会给第三方,员工也无权查看。这三条同时写在服务条款里,有合同效力。

传输

全链路加密

对外 TLS 1.3,内部服务之间 mTLS 双向认证,对上游的连接同样强制加密。

密钥

只存哈希,我们也看不到

API 密钥只存哈希,明文只在创建时显示一次——我们自己也读不回来,丢了只能轮换。

访问控制

最小权限,全量审计

后台每一次涉及账户的操作都留痕:谁、什么时间、改了什么、从哪个 IP。审计日志不可篡改,可应你要求提供相关记录。

你的权利

随时导出与删除

用量数据随时导出。注销时,邮箱、凭据、密钥、技术日志在 30 天内彻底删除;交易与用量账本删不掉,只能与你解除关联——那三类记录是只可追加的,而一个能被删改的账本在对账争议里没有任何证明力。这一条隐私政策里写得更细。(注销入口还没做,见下方条款。)

出了事

72 小时内主动告知

如果发生可能影响你数据的安全事件,我们在 72 小时内主动通知受影响用户,并公开事后复盘。

08利益一致

我们靠什么赚钱,直接告诉你

判断一家公司会不会坑你,最靠谱的办法是看它怎么赚钱。所以我们写在这儿。

我们赚的是采购规模和调度效率的差价。

我们以远大于单个用户的量向多家供应商采购,把规模优势和 Prism 的调度效率变成你的价格。这门生意要你长期留下来才划算:拉一个新用户的成本远高于一个月的毛利,坑你一次就是净亏损。

我们不靠你用不完的额度赚钱,退订按剩余周期比例退。不靠降低你实际拿到的东西赚钱,你选的模型就是实际调用的模型。不靠你的数据赚钱,不训练也不转售。

利润的大头长期会来自企业和团队方案,而企业客户只找口碑干净的供应商。所以这里没什么善意可言,纯粹是算过账。

我们绝不会做的八件事

这份清单会以《服务承诺》单独成页,随条款一并生效。违反其中任意一条,你可以要求全额退款。

  1. 01

    绝不静默替换你选择的模型

    不降参数、不截断上下文、不在高峰期悄悄换成更便宜的模型。响应头里带实际调用的模型标识,你可以自己核对。

  2. 02

    绝不训练、转售或人工阅读你的内容

    你的提示词和输出不进入任何训练流程,不提供给第三方,员工无权查看。

  3. 03

    绝不在订阅期内单方面下调已售出的额度口径

    倍率和配额的任何调整只对新周期生效;上调提前 30 天公告。

  4. 04

    绝不使用限时、限量、拉人返利这类促销手段

    价格就是价格。倒计时是为了不让你多想,我们不缺这点转化。

  5. 05

    绝不声称与任何上游供应商存在官方授权或合作关系

    我们是独立的聚合网关,不会这么说。别家这么说的时候,你可以要求它出示书面证明。

  6. 06

    绝不在故障发生时装作无事发生

    影响面超过 1% 用户的事故,48 小时内发布署名复盘:发生了什么、根因是什么、我们改了什么。

  7. 07

    绝不设置退款门槛

    退款规则写死在条款里,控制台自助操作,不用联系客服,不用说明理由,也没有挽留话术。

  8. 08

    绝不在关停服务时不告而别

    如果有一天我们决定停止服务,提前 60 天公告,未使用额度全额退还,并协助你迁移到别家。

09我们反对什么

你的请求正文,是有价的

这件事在行业里很少被公开讲。用户发出去的每一段提示词和每一份代码,都可以被完整记录下来——用于蒸馏更小的模型,打包成训练语料出售,或者在几个平台之间私下流转。整个过程你不会收到任何通知,条款里通常也找不到明确的禁止。

你贴进去的内部文档、客户资料、还没发布的代码,可能已经在别人的训练集里了。

我们反对这件事,也不打算只用嘴反对。

  1. 01

    零留存是架构,不是政策

    网关里根本没有写入正文的代码路径。不是「我们承诺不看」,是没地方存。这一条可以通过审计核实。

  2. 02

    不买任何来路不明的数据

    我们不向任何平台、数据商采购请求语料,无论价格多低、包装成什么名目。

  3. 03

    不接受以数据换价格的交易

    如果供应商愿意用更低的报价换取数据共享,我们拒绝——哪怕这意味着我们的采购成本更高、毛利更薄。

  4. 04

    愿意为此付钱

    上面每一条都在减少我们能赚的钱。这是我们选择付的代价,也是我们希望你把钱付给我们而不是别家的理由。

  5. 05

    接受核查

    这些写进服务条款,具有合同效力。我们接受第三方安全审计,也欢迎你自己抓包核对。

我们改变不了整个行业。但至少经过我们这条管道的东西,能保证它不去任何别的地方。

10谁在做

这不是一个匿名的站点。

同类服务大多是匿名的:没有主体,没有人,域名随时可换。我们把名字、工程日志和事故复盘都放在这里,你可以自己去看。

姓名占位网关与计量配额预扣、Prism 调度、计费对账
姓名占位产品与设计控制台、文档、全部对外表达
姓名占位供给与运维多供应商采购、容量规划、可用性
姓名占位支持与合规支持邮件、发票、合同、安全问卷
工程日志 每周更新,每条署名状态页 保留 90 天完整历史事故复盘 全部公开可查
11你在担心的

你大概想问这些。

我完全没接触过这类服务,能自己搞定吗?

能。注册之后在控制台建一把密钥,跑一行脚本把它写进本机配置,然后打开你原来用的编程工具就能用了,不用手动改配置文件。要是卡住了,在控制台里提一张工单,中文人工回复。工单有回复我们会给你发邮件提醒(信里不带回复正文,内容只在站上)。

你们会不会做一阵子就跑路?

这是最合理的担心,空口保证也没意义。我们能做的是让跑路这件事对我们代价更大:公司主体和备案信息公开在页脚,可开发票,可签合同,团队实名。《服务承诺》第 8 条写明,若停止服务提前 60 天公告、未使用额度全额退还、协助迁移。你也可以先买 ¥49 的 Lite 试一个月,我们没有年付锁定。

我买的额度会不会突然被降低?

不会。套餐版本不可变:你订阅时的额度口径和倍率在整个周期内固定,任何调整只对新周期生效,上调提前 30 天公告。这是数据库层面的约束,不只是承诺——存进去的就是你订阅时那个版本。

用 Prism 自动调度,会不会给我用便宜货?

会——但只在任务本身不需要更强模型的时候。判断逻辑和结果都对你公开:每个请求的链路记录里有难度评分、命中的规则、实际调用的模型,保留 30 天可导出。难度落在边界上时一律往高了走,声明了工具调用或长上下文需求的请求,不支持的模型直接排除。你也可以完全不用 Prism,自己指定模型。

模型挂了怎么办?会不会多扣钱?

默认开启灾备切换,Prism 会立刻转到同一能力组里的灾备模型,你这次调用不会失败。失败的尝试不计费,只对最终成功的那一次计量。如果只能切到成本更高的模型,仍按你原本请求的能力组计费,差价我们承担。这个功能可以关掉(在组合里把 failover.enabled 设成 false);灾备对象和顺序目前不能自己指定,由 Prism 在同一能力组内选。

额度提前用完了怎么办?

两个选择:换到消耗更低的能力组继续跑;或者升级到更高档位,差价按剩余天数折算、计费日不变。还有第三条路叫「按量续用」:超出部分从余额扣,1 元 = 500 CU,各模型的系数和套餐内一样。默认关闭,开启时要设月度上限,到顶自动停。

我的代码和提示词会被看到吗?

默认不保存。网关只记录计量元数据,正文在内存里转发、流结束即释放。不训练、不转售、员工无权查看,这三条写在服务条款里有合同效力。

所有模型在哪里都能用吗?

不是。部分模型未在中国大陆完成生成式人工智能服务备案,按规定不向中国大陆用户提供,控制台会标注每个模型的可用地域。请如实填写你的所在地——绕开地域限制使用不向你所在地提供的模型,后果由使用者自行承担,具体见服务条款第 4 条。

和直接买官方套餐比,我为什么选你们?

三件事:人民币结算和发票,不用信用卡和换汇;一份额度覆盖多家供应商的模型,包括国产模型,随时切换而代码不改;Prism 能让同样的钱多跑不少——多多少取决于你有多少活必须用前沿模型:前沿占比降到三成以下时,同一份额度大约能多跑一倍;如果九成请求都非前沿不可,那差别很小。/prism 上的对比器可以自己拖着算。如果你只用一家的一个模型,又有合适的支付方式,直接买官方是更简单的选择。我们不认为需要说服每一个人。

你们是官方授权的吗?

不是,我们也不会这么宣称。我们是独立的多供应商聚合网关。任何声称拥有官方授权的同类平台,建议你要求它出示书面证明。

算力应当像水电:计量透明,按需取用,随时可以换一家供应。

一张信用卡、一次汇率、一个地区限制,不该成为用不上最好的 AI 的理由。这是我们开始做这件事的原因。

后来发现还有第二个原因:好模型正在变得可及,但代价常常是你不知情地交出了自己的数据。这个代价不该存在,我们有多少钱就挡多少。

我们做的是中间那条管道。希望它结实,希望账算得清,希望你想走的时候随时能走。而在你用它的时候,它就只是一条管道——不多记一个字。

先用一个月,再决定信不信

没有年付锁定,随时可退订。7 天内用量不足 10% 全额退款,控制台自助操作,不用联系客服。