人为什么最后会开着五个 AI 标签页
这很少是一开始就定下的决定。你注册了一个助手,然后同事给你看了第二个写代码更强的,接着又出现第三个批量摘要更便宜的,几个月下来你就攒了四个登录、两份订阅,外加一个在浏览器标签之间来回粘贴半成品草稿的习惯。这一切都不算稀奇:模型的领先地位每隔几个月就轮换一次,没有哪一家能长期在所有事情上都保持领先。
这个习惯的代价不只是钱。你的历史记录散落在一堆互相搜不到的产品里;对比两个答案得把一个粘进另一个窗口;而且因为每个产品分开计费,你一个月在 AI 上到底花了多少,只能靠信用卡账单去拼凑。
解法是一个 multi-model 应用:一个界面就能接到多家供应商的模型,配一份统一历史,还有一个地方能看清你在花多少钱。本文讲三条抵达那里的路,按对大多数人来说合理的顺序排列:从那条对你毫无门槛的路开始。
把多个模型收进一处的三条路
multi-model 应用之间的主要差别,在于谁持有和模型供应商之间的那层关系。这个单一选择决定了你发第一条消息前需要准备什么、由谁给你开账单,以及每个答案的价格有多透明。实用的路线有三条,而且它们并不互斥:同一个应用可以同时提供三条,你也能在其间来回切换而不丢失聊天记录。
把下面这张表当作决策辅助,而不是排名。哪条路对你合适,完全取决于你手上已经有什么。如果你从没开过供应商账号,第一条路能让你几秒钟内开聊;如果你已经把 API key 存在密码管理器里,第三条路的每条消息单价最低。
| 路线 | 起步需要什么 | 谁为模型用量结算 | 适合谁 |
|---|---|---|---|
| Oriveo Free | 什么都不用:不用账号、不用银行卡、不用 API key | 没有人。每日额度已包含在这一层里 | 在投入任何东西之前,先把这套工作流试一遍 |
| 托管模型(Oriveo AI) | 一个登录后的账号 | 从一份预付余额扣,按各模型的官方 list 价计费 | 想要很多家供应商、又不想去开供应商账号的人 |
| 自带 API key(BYOK) | 你想用的每一家供应商的一个 API key | 各家供应商直接向你自己的账户开账单 | 已经有供应商账号,或想要每条消息单价最低的人 |
方案 A:完全不用账号就开始
要弄清一套 multi-model 工作流是否适合你,最快的办法就是先不注册任何东西直接用起来。Oriveo Free 是一个托管的免费层:在 Web、iPhone 或 Android 上打开应用就能开始打字。没有账号要创建、没有银行卡要填、没有 API key 要粘贴。它有每日额度,并且每天重置。
要清楚这一层是干什么用的。它跑的是从 OpenRouter 目录里精选出来的一批免费层模型,而那份目录会随着模型上新和下线而变,所以确切清单并不固定。它的设计意图是让你先把这套工作流试一遍(模型选择器、聊天历史、把一个答案存成笔记),然后再接入任何属于你自己的东西。它不是通往前沿模型的路,某些依赖供应商账号的功能在这一层也用不了。
这个取舍值得你有意为之。大多数人在真正用过一个下午之前,都说不清自己到底要不要一个 multi-model 应用,而这一层把所有不去试的理由都拿掉了。当额度或模型清单开始限制你时,后面两条路都只在几下点击之外,而你已有的对话会原地不动。
- 不用登录、不用银行卡、不用 API key,第一条消息立刻就能发。
- 每日额度会重置,所以这一层最适合先试试水。
- 模型清单是精选的,会随时间变化;它不是一份固定目录。
- 在 Web app 以及 iPhone、Android 原生 app 上都能用。
方案 B:用托管模型
第二条路把供应商那套繁琐手续拿掉,同时不牺牲选模型的自由。Oriveo AI 是一项付费的托管服务,它作为一个内置供应商出现,和你自己接入的任何东西并列。你登录、选一个模型、发一条消息。没有供应商账号要开,也没有 key 要管理。它代表了九大品牌、彼此之间三十多个模型,目录随着模型上线和下线由中心统一维护。
登录本身每周含 10 次请求,按周重置,而且可用于托管目录里的任意模型,而不只是便宜的那几个。超出部分从一份预付的 AI Balance 中扣除,按各模型的官方 list 价计费。这份 list 价之上不加任何加价。这一点正是你拿它和任何平台作比较时值得核对的地方:credit 体系通常不会公布一个 credit 和一个 token 之间的换算。
这是给那些想要覆盖面、又不想搞行政手续的人准备的路。你在一个选择器里就能拿到很多家供应商、用一份余额而不是好几张账单,而且能看到和自带 key 时同样的每条消息费用估算。相对第三条路你放弃的,是和供应商的直接关系:你是通过一份余额买入,而不是在每一家供应商那里各持一个账号。
方案 C:自带 API key
BYOK(bring your own key,自带 key)意思是你在想用的每一家供应商那里创建一个 API key,粘进应用。之后每一次请求都走你自己的账户去到那家供应商,由它按公示的 list 价直接向你开账单。Oriveo 以这种方式支持 15 家官方供应商:OpenAI、Anthropic (Claude)、Google Gemini、xAI Grok、DeepSeek、Mistral、Qwen、Kimi、MiniMax、Z.ai、Groq、Together AI、Fireworks AI、OpenRouter 与 SiliconFlow,外加任何你以自定义 relay 形式加入的 OpenAI 兼容端点。这些供应商加在一起,把 500+ 模型放进同一个选择器里。
在每一家拿 key 都是同一套简短流程:在供应商的开发者控制台创建账号、添加付款方式、生成一个 key,然后复制一次。大多数控制台只在创建时显示一次 key。在应用里你添加一个供应商、粘贴 key,那家供应商的模型清单就会加载出来。key 存在你自己的设备上,不会上传到 Oriveo 的服务器。接入一家供应商就足以起步,其余的可以之后再加。
这条路在本文里排最后而不是最前,是因为它是唯一一条有前置条件的路。对一个已经把三个 key 存在密码管理器里的开发者来说,它是能拿到的最便宜、最透明的选项:Oriveo 完全不加价,所以你付给每家供应商的,正好就是它价目表上写的数。而对一个从没见过开发者控制台的人来说,它是一堵墙。从方案 A 起步,等到 key 不再像个苦差事时再来这里。

一步步来:你的第一次 multi-model 对话
不管你选了哪条路,第一次对话看起来都一样。下面这些步骤从头到尾只要几分钟,而且没有一步是不可逆的:你随时可以删掉一个供应商、清空一段聊天,或退出登录。
第一天有件事值得刻意试一下:在两段对话里,就一个你熟到能给答案打分的任务,向两个不同的模型问同一个问题。这是最快建立起「该找哪个模型」直觉的办法,也正是拥有不止一个模型的全部意义。
- 安装 iPhone 或 Android app,或在浏览器里打开 Web app,同一个账号、同一份历史在三端都通用。
- 选你的路线:在免费层立刻开聊、登录用托管模型,或添加一个供应商并粘贴一个 API key。
- 打开模型选择器,挑一个模型。模型按供应商分组,所以来自哪一家始终一目了然。
- 发一条消息。答案会流式返回,答完之后会附上一个费用估算。
- 把值得留的内容存成笔记,笔记会记下是哪个模型写的、来自哪段对话。
- 换一个模型开第二段对话来对比。文件夹、标签与全文搜索让这两段之后都找得回来。
在对话中途切换模型
你不必在开聊之前就把模型定死。从选择器里换掉模型,同一段对话里的下一条消息就会发给新模型,并把到目前为止的对话作为它的上下文。一种常见做法是先用一个又快又便宜的模型起草,最后一遍再切到一个更强的,你保留了整条线索、附件和历史,变的只有模型。
要留意这对账单意味着什么。你重新发出去当作上下文的整段对话,每家供应商都要计费,所以不论你切到哪个模型,一条长线索的每条消息都比短线索更贵。为一个真正全新的话题另起一段对话,是最简单的费用控制手段,而且通常还能让答案更好。
这里值得把切换的机制说精确,因为各家产品并不一样。Oriveo 里的模型切换是顺序进行的:一次只有一个模型作答。Oriveo 不会对同一个提示词并排展示两个答案,也绝不会把同一个提示词同时发给多个模型。如果「在一屏里对同一个问题比较两个答案」对你是硬需求,那在挑任何应用之前先核实这个具体行为:有好几款产品确实提供它,而这一款没有。
给一个答案找个第二意见
这套顺序设计确实有一个专为验证打造的功能。Cross-check 会把你已经拿到的答案,交给你指定的一个第二模型重跑一遍,然后把原答案和第二意见放在一起对照展示,方便你比较。它是一次顺序进行的第二次查看,而不是并行提问,每次只用一个第二模型。核对结果连同两个来源,可以存成笔记。
有两条限制决定了谁能用它,值得直说:Cross-check 跑在你用自己的 API key 接入的供应商上,在 Oriveo Free 免费层不可用。换句话说,它是你走第三条路才会拿到的东西之一,而不是免账号那一层能做的事。
用好了,这是「究竟为什么要有不止一个模型」最有力的理由。两个由不同实验室、用不同数据训练出来的模型,对一个事实性说法产生分歧,是「这个说法需要核实」的可靠信号。意见一致是较弱的证据,但也比单独一个模型自信满满地断言要强。
让你的历史跨设备保留
聊天记录首先存在你的设备上。这意味着应用打开时,不用等一次网络往返就能读到历史,也意味着你的对话默认是本地的而非托管的。笔记同理:它们在你的设备上无限量,且不花钱。
跨设备同步才是属于付费方案的部分。Pro 增加跨最多五台设备的聊天与笔记实时同步,Lifetime 把同样的同步扩展到无限台设备。两者都带 20 GB 同步存储,单个文件上限 100 MB。这正是让 iPhone、Android 与 Web 感觉像一个产品、而不是三份拷贝的关键。付费方案还会解除对 Skills、文件夹与置顶聊天的数量限制。
付费方案有意不包含的一样东西,是 AI 用量。Pro 与 Lifetime 不含任何模型 credits、不含托管余额、不含供应商订阅。它们是软件功能。不论你用三条路里的哪一条来跑模型,那部分都是分开付费的,这也正是「方案的价格」和「你用量的价格」从不会被搅在一起的原因。
盯住它花了多少
每条消息都会显示一个费用估算,在答案结束的那一刻,按供应商公示的 token 定价和实际用掉的 token 算出来。这个估算在每一层都有,不只是付费方案。它把「我该用哪个模型」从一个口味问题变成一个算术问题:当你能看到一次常规摘要任务在某个模型上只花几分之一美分、在另一个上明显更贵时,选择就自己浮现了。
把这个数字当作一件把方向的仪器,而不是一本账。它是用公示价和上报的 token 数算出来的估算;供应商自己的账单才是最终依据,而且供应商会套用各自的取整、最低计费额和偶尔的促销价。两者不一致时,以账单为准。
更深入的分析是付费功能。Usage Insights(按供应商和模型拆分、月度趋势和预算提醒)属于 Pro 与 Lifetime。逐条消息的估算本身不设门槛,所以日常的这套反馈闭环在任何一层都能用,包括免账号那层。
之后在三条路之间来回切换
这三条路不是一架你只爬一次的梯子。它们在同一个应用里共存,而且选择是按消息而非按账号来的:你可以持有自己的 OpenAI key、为那些还没注册的供应商留一份托管余额,同时在某台没登录的设备上照样退回免账号那层。选择器把它们全都摆在一起,按供应商分组。
因为这几条路共用一份历史,改主意的成本很低。之后加一个 API key,并不会迁移或改写你已经聊过的对话;它们仍然在同一个列表里可搜。移除一个供应商,只会把它的模型从选择器里拿掉,别无其他。如果你决定彻底离开,笔记和对话都能导出成 Markdown,在任何编辑器里都读得了。
这就是「在一个应用里使用多个 AI 模型」的务实答案:挑一条和你今天手上所有条件相符的路,用得够久去弄清哪个模型配哪类任务,然后在约束条件变化时换路,而不是在某个方案催你换的时候。