三步,五分钟
不用信用卡,不用换汇,不用读文档。第一次用大模型服务的人也能自己跑通。
注册账号
一个邮箱就行,收个验证码。注册不需要付款,也不用绑卡。
跑一行脚本
在控制台建一把密钥,然后跑下面这行。脚本会让你粘贴密钥,把接口地址和密钥写进 ~/.config/agiplan/env,不装任何程序,也不改你的 shell 配置。
打开你原来的工具
照常用就行。要换模型,改请求里的 model 字段:填具体模型就固定用它,填 auto 交给 Prism。
# 第二步就是这一行 curl -fsSL https://agiplan.dev/setup -o setup.sh && sh setup.sh # 让它在当前 shell 生效,再确认一下通了 . ~/.config/agiplan/env curl -s "$API_BASE_URL/models" -H "Authorization: Bearer $API_KEY"
脚本做了什么全部公开在文档里,也可以完全不用它——手动配两个环境变量同样可以。密钥写在你主目录下的配置文件里(权限 600),不在任何项目目录里,不会被误提交进 git。命令行工具还没有发布,脚本不假装装了什么。
注册不产生任何费用。登录后在控制台选档位、建密钥。
你现在用的工具,基本都能直接接
我们同时兼容两套主流 API 协议。凡是允许你改接口地址的工具,配置里换个地址就能用,不用装插件,不用改业务代码。
别把整套工作,
押在一个模型上。
模型每季度换代,价格每半年腰斩。今天最好用的那个,明年未必还在。我们把模型按能力分成四组,同一份额度按各自的兑换效率消耗,换一个就是网页上点一下。
很多人默认国产模型是省钱用的备胎。做中文长文本和批量整理的时候它本来就更合适,顺便还便宜。
| 能力组 | 输入 | 输出 | 什么时候用它最划算 |
|---|---|---|---|
| 前沿推理 | 0.20 | 1.00 | 长链路 agent、复杂重构、需要一次做对的任务 |
| 均衡通用 | 0.08 | 0.42 | 日常编码和代码审查,大多数人的默认档 |
| 国产旗舰 | 0.03 | 0.18 | 中文长文本、资料整理、成本敏感的批量任务 |
| 高速轻量 | 0.01 | 0.06 | 补全、分类、格式化,追求响应速度 |
这张表公开在 /models 页,倍率任何调整提前 30 天公告。同样是 480,000 CU,全用前沿推理跑一个月,和把日常任务放到均衡组、批量整理丢给国产旗舰组,能跑的量差好几倍。 怎么花是你的事,我们只负责把账算清楚。
Prism,把任务分到该去的地方
你一天里的任务难度差得很远。改个变量名和重构一个模块,如果都用同一个最贵的模型跑,钱就是这么烧掉的。
Prism 是我们的调度层。请求进来先过它,判断这次任务的难度和需要的能力,再分配到光谱上合适的位置。你可以直接用我们调好的 auto,也可以自己定一套规则。
算一下同样的钱能多做多少
用公开的真实倍率计算这是按任务构成的估算,不是承诺值。真实倍数取决于你的实际任务分布,控制台每月会给你一份实测对比。
想自己指定模型,随时可以
同一个 model 字段两种用法:填一个具体模型就固定用它,填 auto 或者你自己的自定义模型名就交给 Prism 动态调度。换用法不用改别的代码,也不用重新配环境。
model: "model-a" // 固定用这一个模型,Prism 不介入 model: "auto" // 交给 Prism,按任务难度自动挑 model: "coder" // 你自己的自定义模型,规则你定
自己的模型名,按每一轮的活挑模型
回答四个问题,得到一个自己的模型名,比如 coder。调用时填它:要审美的、难的交给强模型,有把握的简单活交给便宜模型,其余走你选的默认模型。每一条规则、每一个门槛都摆在控制台里,改了先用你自己的流量回放,再存成新的一版。
拖一下,看每句话会交给谁
示例对话 · 判定概率为示意值 · 规则和线上是同一份代码你帮我把登录页的按钮和间距调得好看一点
前端 / UI0.84要审美0.78困难0.10强模型前沿推理做好要靠审美你写个脚本,把 logs 目录下的 .gz 解压后按日期归档
脚本0.90要审美0.03困难0.06便宜模型高速轻量有把握是简单的活你这个报错是什么意思:Cannot read properties of undefined
调试0.78要审美0.02困难0.16便宜模型高速轻量有把握是简单的活你把订单模块从回调改成 async/await,行为一点都不能变
重构0.80要审美0.04困难0.58强模型前沿推理判定为困难你给这个接口的返回值加一个分页字段,旧客户端不能挂
后端0.71要审美0.05困难0.30默认模型均衡通用都不算,走默认你给这个接口补一段 README 说明
写作0.74要审美0.28困难0.05默认模型均衡通用都不算,走默认你设计一下多租户的数据隔离方案,列出取舍
架构0.86要审美0.12困难0.72强模型前沿推理判定为困难你在吗?先问个小问题
闲聊0.95要审美0.01困难0.01便宜模型高速轻量有把握是简单的活
回答四个问题
主要拿它做什么、质量和成本怎么取舍、强 / 默认 / 便宜三个位置各用谁、要不要顺手给 subagent 建偏质量和偏成本两档。规则由这几个答案生成,不是黑箱。
用你自己的流量回放
改一个门槛,立刻看到过去 30 天的请求会怎么分、多做还是少做多少活、哪些请求会换去处。在你的浏览器里算,存下来的每一版都能一键恢复。
填进工具的三个槽位
Claude Code 本来就把主任务和 subagent 分三档。把 coder-high、coder、coder-lite 填进去,工具分档,我们在档内按任务挑模型。
判定要看你最近一条消息,判完即丢;我们只存判定的概率这类数字,不存对话内容。保存可以随时关掉、一键清空。
按任务类型分流还在规划中,尚未对外开放:现在已经可以建自定义模型、调用它,开放之前每一轮都走你设的「判不了时」那个模型,开放后不用改任何配置。
降本不能降能力。 auto 在难度落在边界上的时候一律往高了走——多花点钱远好过输出变差,这是写死的。自定义模型里往哪边偏由你定:只有你自己调向成本的那部分才会往下放,而且每一次往下放都写在调度链路里。
模型出故障,自动切到同能力的灾备模型
任何一个模型都有可能限流、超时或者临时不可用。Prism 会立刻把请求转给同一能力组里的灾备模型,你这一次调用不会失败。这个功能默认开着,你可以关掉。
可按需关闭
默认开启。在自定义模型里设置 `"failover": { "enabled": false }` 后,模型故障时直接返回失败,不切换模型。自定义灾备顺序尚未支持:目前仅在同能力组内自动选择,`scope` 只接受 `same_tier`。
只往同一能力组里切
只在同一能力组内切,绝不跨组降到更便宜的组——那种降级我们宁可失败并告诉你(503,附完整尝试记录),也不偷偷换。组内会优先挑质量档更高的那条,所以故障时可能落到组内档次稍低的一条;每次响应都带 `x-agiplan-model-actual`,实际是谁答的一直摆在那儿。
失败的尝试不算钱
只对最终成功返回的那一次计量。中间试了几次都不进你的账单。
换到哪条线,就按哪条线收
灾备切换后按真正服务你的那条线的售价计费,账单上写的是实际服务的模型和它的价。失败的那几次尝试一个字都不计——你不该为我们的故障买单。
每一次调度,都能回放
自动调度天生让人怀疑「是不是偷偷给我用了便宜货」。唯一的解法是把每一次决策摊开给你看。每个请求都有一条链路记录,保留 30 天,可导出。
- 0ms鉴权ap_live_…f3c2 · 5× Pro
- 3ms配额预扣 11.742 CU(输入 14,200 + max_tokens 8,192 的最坏情况),三窗口余量充足
- 11msPrism难度 0.82 · tools=3 tokens_in=14,200 code_blocks=2
- 12ms路由规则 #1 命中 → 前沿推理组 · model-a
- 14ms响应model-a 限流
- 210ms灾备切换转同能力灾备模型 model-b · 按 model-b 计价
- 224ms流式首 token 890ms
- 8.42s结算in 14,200 / out 2,130 → 实扣 4.970 CU,退回预扣差额 6.772 CU
链路记录只含元数据,不含请求正文——和第 07 节的零留存是同一套架构。报障时把 trace_id 发给我们就行,客服能一键定位。
额度怎么算,写在明处
贵不贵是其次,先得算得清。我们用一个统一单位 CU: 1 CU = 基准模型 1,000 输出 token
每个模型的输入输出系数公开,每一次调用的消耗可查、可导出、可对账。为了让你有个直观参照,四档的用量当量是这样的:
| 档位 | 月额度 | 用量当量大致相当于 |
|---|---|---|
| Lite | 30,000 CU | 入门级月付套餐的用量 |
| Pro | 96,000 CU | 标准订阅档的用量 |
| 5× Pro | 480,000 CU | 标准订阅档的 5 倍 |
| Max | 1,920,000 CU | 标准订阅档的 20 倍 |
5 小时 · 周 · 计费月
三个窗口同时生效,控制台实时可见。计费月按你的下单日算,不是自然月,月末订阅不会只给你两天额度。
每一次调用都可查
时间、模型、输入输出 token、扣减 CU、延迟、追踪号。可按项目和时间段导出 CSV。
倍率上调提前 30 天公告
已售出的订阅在周期内口径不变。套餐版本不可变,改价只对新订阅生效。
按剩余周期比例退
随时可退订,按未使用的周期比例退款。我们不靠你用不完的额度赚钱。
每个模型现在能不能用
状态页按模型给出:当前是否可用、近 30 天可用率、你所在地能不能用,以及每一条探测的原始记录(时刻、成败、延迟、失败类型,可按月导出)。数据来自每 15 分钟一次的真实探测。倍率在 /models 页。延迟目前只在内部看,没有对外发布。
快用完之前告诉你
周额度或月额度到 80% 时提醒(阈值目前固定,不可自定义),并给出建议:换到哪个能力组还能再跑多久,或者升档要补多少差价。5 小时窗口不发邮件——它一天要重置好几次,发了就成了打扰;那一档的余量在每个响应头里都有,控制台的额度环上也是实时的。
我们不打价格战。省下来的力气花在别处:不断供,算得清,出事有人认。
一份合同,管住整个团队的用量与成本。
团队用起来,麻烦的往往不是能不能用,是月底对不上账。这些能力都跑在我们自研的网关上——配额、路由、计量、审计是同一套代码,不是拼装出来的中间件。
统一采购与账单
按席位或按额度包批量采购,一次开票、对公结算,支持年度框架合同与预付。
部门与项目配额
把总额度分到部门、项目、个人,各自独立的周月上限和告警阈值,一个团队用超不影响别人。
成本归因看板
按项目、成员、模型三个维度拆分消耗,可导出到你自己的 BI。谁花了多少一目了然。
SSO 与成员治理规划中
规划中:OIDC / SAML 与主流企业办公平台登录、入离职同步。密钥作用域与强制轮换现在就能用,单点登录还没有做出来。
统一的 Prism 策略
为团队定一套调度规则并下发到所有成员,成本可控,也不用每个人自己琢磨该用哪个模型。
私有化与合规规划中
数据处理协议、安全问卷与审计配合现在就能谈。VPC 内的网关节点尚未提供,需要的话先联系我们,别按它已经存在来做方案。
你的代码和提示词,我们默认不保存
你要把工作里最敏感的东西发给我们——代码、文档、客户资料。这一节写得比一般营销页啰嗦,希望你真的读一下。
请求与响应正文不落盘
网关只记录计量必需的元数据:模型、token 数、延迟、状态码、追踪号。正文在内存里转发,流一结束就释放,不写日志、不写数据库、不进对象存储。
我们没有做这个开关
排障时能看正文当然方便,而我们没有做——正文一律不落盘,没有例外。将来要做的话会默认关闭、由你自己开、有明确保留期,并且提前公告。在那之前,不存在任何一条能让我们看到你正文的路径。
不训练、不转售、不人工阅读
你的内容不会进入任何训练或微调流程,不会给第三方,员工也无权查看。这三条同时写在服务条款里,有合同效力。
全链路加密
对外 TLS 1.3,内部服务之间 mTLS 双向认证,对上游的连接同样强制加密。
只存哈希,我们也看不到
API 密钥只存哈希,明文只在创建时显示一次——我们自己也读不回来,丢了只能轮换。
最小权限,全量审计
后台每一次涉及账户的操作都留痕:谁、什么时间、改了什么、从哪个 IP。审计日志不可篡改,可应你要求提供相关记录。
随时导出与删除
用量数据随时导出。注销时,邮箱、凭据、密钥、技术日志在 30 天内彻底删除;交易与用量账本删不掉,只能与你解除关联——那三类记录是只可追加的,而一个能被删改的账本在对账争议里没有任何证明力。这一条隐私政策里写得更细。(注销入口还没做,见下方条款。)
72 小时内主动告知
如果发生可能影响你数据的安全事件,我们在 72 小时内主动通知受影响用户,并公开事后复盘。
我们靠什么赚钱,直接告诉你
判断一家公司会不会坑你,最靠谱的办法是看它怎么赚钱。所以我们写在这儿。
我们赚的是采购规模和调度效率的差价。
我们以远大于单个用户的量向多家供应商采购,把规模优势和 Prism 的调度效率变成你的价格。这门生意要你长期留下来才划算:拉一个新用户的成本远高于一个月的毛利,坑你一次就是净亏损。
我们不靠你用不完的额度赚钱,退订按剩余周期比例退。不靠降低你实际拿到的东西赚钱,你选的模型就是实际调用的模型。不靠你的数据赚钱,不训练也不转售。
利润的大头长期会来自企业和团队方案,而企业客户只找口碑干净的供应商。所以这里没什么善意可言,纯粹是算过账。
我们绝不会做的八件事
这份清单会以《服务承诺》单独成页,随条款一并生效。违反其中任意一条,你可以要求全额退款。
- 01
绝不静默替换你选择的模型
不降参数、不截断上下文、不在高峰期悄悄换成更便宜的模型。响应头里带实际调用的模型标识,你可以自己核对。
- 02
绝不训练、转售或人工阅读你的内容
你的提示词和输出不进入任何训练流程,不提供给第三方,员工无权查看。
- 03
绝不在订阅期内单方面下调已售出的额度口径
倍率和配额的任何调整只对新周期生效;上调提前 30 天公告。
- 04
绝不使用限时、限量、拉人返利这类促销手段
价格就是价格。倒计时是为了不让你多想,我们不缺这点转化。
- 05
绝不声称与任何上游供应商存在官方授权或合作关系
我们是独立的聚合网关,不会这么说。别家这么说的时候,你可以要求它出示书面证明。
- 06
绝不在故障发生时装作无事发生
影响面超过 1% 用户的事故,48 小时内发布署名复盘:发生了什么、根因是什么、我们改了什么。
- 07
绝不设置退款门槛
退款规则写死在条款里,控制台自助操作,不用联系客服,不用说明理由,也没有挽留话术。
- 08
绝不在关停服务时不告而别
如果有一天我们决定停止服务,提前 60 天公告,未使用额度全额退还,并协助你迁移到别家。
你的请求正文,是有价的
这件事在行业里很少被公开讲。用户发出去的每一段提示词和每一份代码,都可以被完整记录下来——用于蒸馏更小的模型,打包成训练语料出售,或者在几个平台之间私下流转。整个过程你不会收到任何通知,条款里通常也找不到明确的禁止。
你贴进去的内部文档、客户资料、还没发布的代码,可能已经在别人的训练集里了。
我们反对这件事,也不打算只用嘴反对。
- 01
零留存是架构,不是政策
网关里根本没有写入正文的代码路径。不是「我们承诺不看」,是没地方存。这一条可以通过审计核实。
- 02
不买任何来路不明的数据
我们不向任何平台、数据商采购请求语料,无论价格多低、包装成什么名目。
- 03
不接受以数据换价格的交易
如果供应商愿意用更低的报价换取数据共享,我们拒绝——哪怕这意味着我们的采购成本更高、毛利更薄。
- 04
愿意为此付钱
上面每一条都在减少我们能赚的钱。这是我们选择付的代价,也是我们希望你把钱付给我们而不是别家的理由。
- 05
接受核查
这些写进服务条款,具有合同效力。我们接受第三方安全审计,也欢迎你自己抓包核对。
我们改变不了整个行业。但至少经过我们这条管道的东西,能保证它不去任何别的地方。
这不是一个匿名的站点。
同类服务大多是匿名的:没有主体,没有人,域名随时可换。我们把名字、工程日志和事故复盘都放在这里,你可以自己去看。
你大概想问这些。
我完全没接触过这类服务,能自己搞定吗?
能。注册之后在控制台建一把密钥,跑一行脚本把它写进本机配置,然后打开你原来用的编程工具就能用了,不用手动改配置文件。要是卡住了,在控制台里提一张工单,中文人工回复。工单有回复我们会给你发邮件提醒(信里不带回复正文,内容只在站上)。
你们会不会做一阵子就跑路?
这是最合理的担心,空口保证也没意义。我们能做的是让跑路这件事对我们代价更大:公司主体和备案信息公开在页脚,可开发票,可签合同,团队实名。《服务承诺》第 8 条写明,若停止服务提前 60 天公告、未使用额度全额退还、协助迁移。你也可以先买 ¥49 的 Lite 试一个月,我们没有年付锁定。
我买的额度会不会突然被降低?
不会。套餐版本不可变:你订阅时的额度口径和倍率在整个周期内固定,任何调整只对新周期生效,上调提前 30 天公告。这是数据库层面的约束,不只是承诺——存进去的就是你订阅时那个版本。
用 Prism 自动调度,会不会给我用便宜货?
会——但只在任务本身不需要更强模型的时候。判断逻辑和结果都对你公开:每个请求的链路记录里有难度评分、命中的规则、实际调用的模型,保留 30 天可导出。难度落在边界上时一律往高了走,声明了工具调用或长上下文需求的请求,不支持的模型直接排除。你也可以完全不用 Prism,自己指定模型。
模型挂了怎么办?会不会多扣钱?
默认开启灾备切换,Prism 会立刻转到同一能力组里的灾备模型,你这次调用不会失败。失败的尝试不计费,只对最终成功的那一次计量。如果只能切到成本更高的模型,仍按你原本请求的能力组计费,差价我们承担。这个功能可以关掉(在组合里把 failover.enabled 设成 false);灾备对象和顺序目前不能自己指定,由 Prism 在同一能力组内选。
额度提前用完了怎么办?
两个选择:换到消耗更低的能力组继续跑;或者升级到更高档位,差价按剩余天数折算、计费日不变。还有第三条路叫「按量续用」:超出部分从余额扣,1 元 = 500 CU,各模型的系数和套餐内一样。默认关闭,开启时要设月度上限,到顶自动停。
我的代码和提示词会被看到吗?
默认不保存。网关只记录计量元数据,正文在内存里转发、流结束即释放。不训练、不转售、员工无权查看,这三条写在服务条款里有合同效力。
所有模型在哪里都能用吗?
不是。部分模型未在中国大陆完成生成式人工智能服务备案,按规定不向中国大陆用户提供,控制台会标注每个模型的可用地域。请如实填写你的所在地——绕开地域限制使用不向你所在地提供的模型,后果由使用者自行承担,具体见服务条款第 4 条。
和直接买官方套餐比,我为什么选你们?
三件事:人民币结算和发票,不用信用卡和换汇;一份额度覆盖多家供应商的模型,包括国产模型,随时切换而代码不改;Prism 能让同样的钱多跑不少——多多少取决于你有多少活必须用前沿模型:前沿占比降到三成以下时,同一份额度大约能多跑一倍;如果九成请求都非前沿不可,那差别很小。/prism 上的对比器可以自己拖着算。如果你只用一家的一个模型,又有合适的支付方式,直接买官方是更简单的选择。我们不认为需要说服每一个人。
你们是官方授权的吗?
不是,我们也不会这么宣称。我们是独立的多供应商聚合网关。任何声称拥有官方授权的同类平台,建议你要求它出示书面证明。
算力应当像水电:计量透明,按需取用,随时可以换一家供应。
一张信用卡、一次汇率、一个地区限制,不该成为用不上最好的 AI 的理由。这是我们开始做这件事的原因。
后来发现还有第二个原因:好模型正在变得可及,但代价常常是你不知情地交出了自己的数据。这个代价不该存在,我们有多少钱就挡多少。
我们做的是中间那条管道。希望它结实,希望账算得清,希望你想走的时候随时能走。而在你用它的时候,它就只是一条管道——不多记一个字。