Warum man am Ende fünf KI-Tabs offen hat
Selten beginnt es als Entscheidung. Sie melden sich bei einem Assistenten an, dann zeigt Ihnen ein Kollege einen zweiten, der besser programmiert, dann einen dritten, der fürs Zusammenfassen in Masse günstiger ist, und binnen weniger Monate haben Sie vier Logins, zwei Abos und die Gewohnheit, halbfertige Entwürfe zwischen Browser-Tabs zu kopieren. Nichts daran ist ungewöhnlich. Die Führung unter den Modellen rotiert alle paar Monate, und kein einzelner Anbieter war lange bei allem vorn.
Der Preis dieser Gewohnheit ist nicht nur Geld. Ihr Verlauf landet verstreut über Produkte, die einander nicht durchsuchen können. Zwei Antworten zu vergleichen heißt, die eine ins andere Fenster zu kopieren. Und weil jedes Produkt getrennt abrechnet, lässt sich die Summe, die Sie in einem Monat für KI ausgeben, nur aus Kreditkartenabrechnungen rekonstruieren.
Die Lösung ist eine multi-model-App: eine Oberfläche, die Modelle vieler Anbieter erreichen kann, mit einem Verlauf und einem Ort, um zu sehen, was Sie ausgeben. Diese Anleitung behandelt drei Wege dorthin, in der Reihenfolge, die für die meisten Sinn ergibt — beginnend mit dem, der überhaupt nichts von Ihnen verlangt.
Drei Wege, mehrere Modelle an einem Ort zu haben
Multi-model-Apps unterscheiden sich vor allem darin, wer die Beziehung zum Modellanbieter hält. Diese eine Wahl bestimmt, was Sie vor Ihrer ersten Nachricht brauchen, wer Ihnen Rechnungen stellt und wie sichtbar der Preis jeder Antwort ist. Es gibt drei praktische Routen, und sie schließen sich nicht aus: Dieselbe App kann alle drei bieten, und Sie können ohne Verlust Ihrer Chats zwischen ihnen wechseln.
Lesen Sie die Tabelle unten als Entscheidungshilfe, nicht als Rangliste. Die richtige Route hängt völlig davon ab, was Sie bereits haben. Wenn Sie nie ein Anbieterkonto erstellt haben, bringt Sie Route eins in Sekunden ins Chatten. Wenn Sie bereits einen API key in einem Passwortmanager halten, kostet Sie Route drei am wenigsten pro Nachricht.
| Route | Was Sie zum Start brauchen | Wer die Modellnutzung abrechnet | Am besten für |
|---|---|---|---|
| Oriveo Free | Nichts — kein Konto, keine Karte, kein API key | Niemand. Ein tägliches Kontingent ist in der Ebene enthalten | Den Ablauf ausprobieren, bevor man sich auf etwas festlegt |
| Verwaltete Modelle (Oriveo AI) | Ein angemeldetes Konto | Ein vorausbezahltes Guthaben, zum offiziellen Listenpreis jedes Modells | Wer viele Anbieter will, ohne Anbieterkonten zu eröffnen |
| Eigene API keys (BYOK) | Einen API key von jedem gewünschten Anbieter | Jeder Anbieter stellt Ihrem eigenen Konto direkt in Rechnung | Wer schon Anbieterkonten hat oder den niedrigsten Preis pro Nachricht will |
Option A — starten Sie ganz ohne Konto
Der schnellste Weg herauszufinden, ob ein multi-model-Ablauf zu Ihnen passt, ist, einen zu nutzen, ohne sich für irgendetwas anzumelden. Oriveo Free ist eine verwaltete kostenlose Ebene: Öffnen Sie die App im Web, auf iPhone oder Android und tippen Sie los. Es gibt kein Konto zu erstellen, keine Karte einzugeben und keinen API key einzufügen. Ein tägliches Kontingent gilt, und es setzt sich täglich zurück.
Seien Sie sich klar darüber, wofür diese Ebene da ist. Sie betreibt eine kuratierte Auswahl von Modellen der kostenlosen Ebene aus dem OpenRouter-Katalog, und dieser Katalog ändert sich, während Modelle hinzukommen und ausscheiden, sodass die genaue Liste nicht feststeht. Sie ist dafür gedacht, dass Sie den Ablauf ausprobieren — die Modellauswahl, den Chatverlauf, eine Antwort als Notiz speichern —, bevor Sie etwas Eigenes verbinden. Sie ist keine Route zu den Spitzenmodellen, und einige Funktionen, die ein Anbieterkonto voraussetzen, sind darauf nicht verfügbar.
Dieser Handel lohnt sich, wenn man ihn bewusst eingeht. Die meisten wissen nicht, ob sie eine multi-model-App wollen, bis sie sie einen Nachmittag genutzt haben, und dies nimmt jeden Grund, es nicht zu versuchen. Wenn das Kontingent oder die Modellliste Sie zu begrenzen beginnt, sind die anderen zwei Routen nur wenige Fingertipps entfernt, und Ihre bestehenden Unterhaltungen bleiben, wo sie sind.
- Keine Anmeldung, keine Karte, kein API key — die erste Nachricht funktioniert sofort.
- Ein tägliches Kontingent, das sich zurücksetzt, sodass die Ebene sich am besten zum Ausprobieren eignet.
- Die Modellliste ist kuratiert und ändert sich mit der Zeit; sie ist kein fester Katalog.
- Verfügbar in der Web-App und in den nativen iPhone- und Android-Apps.
Option B — nutzen Sie verwaltete Modelle
Die zweite Route nimmt den Anbieter-Papierkram weg, ohne die Modellwahl zu nehmen. Oriveo AI ist ein kostenpflichtiger verwalteter Dienst, der als eingebauter Anbieter neben allem erscheint, was Sie selbst verbinden. Sie melden sich an, wählen ein Modell und senden eine Nachricht — es gibt keine Anbieterkonten zu eröffnen und keine Schlüssel zu verwalten. Neun große Marken sind vertreten, mit mehr als dreißig Modellen dazwischen, und der Katalog wird zentral gepflegt, während Modelle erscheinen und ausscheiden.
Die Anmeldung enthält zehn Anfragen pro Woche, die sich wöchentlich zurücksetzen und auf jedem Modell des verwalteten Katalogs funktionieren, nicht nur auf den günstigen. Die Nutzung darüber hinaus wird aus einem vorausbezahlten AI Balance gezogen, zum offiziellen Listenpreis jedes Modells abgerechnet. Auf diesen Listenpreis wird kein Aufschlag addiert, und das ist der Teil, den es gegen jede Plattform zu prüfen lohnt, mit der Sie es vergleichen: credit-Systeme veröffentlichen die Umrechnung zwischen einem credit und einem token meist nicht.
Das ist die Route für alle, die Breite ohne Verwaltung wollen. Sie erhalten viele Anbieter in einer Auswahl, ein Guthaben statt mehrerer Rechnungen und dieselbe Kostenschätzung pro Nachricht, die Sie mit eigenen Schlüsseln sähen. Was Sie gegenüber Route drei abgeben, ist die direkte Anbieterbeziehung: Sie kaufen über ein Guthaben, statt ein Konto bei jedem Anbieter zu halten.
Option C — bringen Sie Ihre eigenen API keys mit
BYOK — bring your own key — bedeutet, dass Sie bei jedem Anbieter, den Sie nutzen wollen, einen API key erstellen und ihn in die App einfügen. Danach geht jede Anfrage auf Ihrem eigenen Konto an diesen Anbieter, und dieser Anbieter stellt Ihnen direkt zum veröffentlichten Listenpreis in Rechnung. Oriveo unterstützt so 15 offizielle Anbieter: OpenAI, Anthropic (Claude), Google Gemini, xAI Grok, DeepSeek, Mistral, Qwen, Kimi, MiniMax, Z.ai, Groq, Together AI, Fireworks AI, OpenRouter und SiliconFlow — plus jeden OpenAI-kompatiblen Endpunkt, den Sie als eigenes relay hinzufügen. Zusammen stellen diese Anbieter 500+ Modelle in eine Auswahl.
Einen Schlüssel zu bekommen ist bei jedem Anbieter derselbe kurze Vorgang: Erstellen Sie ein Konto in der Entwicklerkonsole des Anbieters, fügen Sie eine Zahlungsmethode hinzu, erzeugen Sie einen Schlüssel und kopieren Sie ihn einmal — die meisten Konsolen zeigen einen Schlüssel nur bei der Erstellung. In der App fügen Sie einen Anbieter hinzu, fügen den Schlüssel ein, und die Modellliste dieses Anbieters lädt. Schlüssel werden auf Ihrem eigenen Gerät gespeichert und nicht auf die Server von Oriveo hochgeladen. Ein Anbieter genügt zum Start; die übrigen können Sie später hinzufügen.
Dass diese Route in dieser Anleitung die letzte ist und nicht die erste, liegt daran, dass sie die einzige mit einer Voraussetzung ist. Für eine Entwicklerin, die bereits drei Schlüssel in einem Passwortmanager hat, ist sie die günstigste und transparenteste verfügbare Option — Oriveo schlägt gar nichts auf, Sie zahlen jedem Anbieter also genau, was seine Preisliste sagt. Für jemanden, der nie eine Entwicklerkonsole gesehen hat, ist sie eine Wand. Beginnen Sie bei Route A und kommen Sie hierher, wenn der Schlüssel sich nicht mehr wie eine Mühe anfühlt.

Schritt für Schritt: Ihr erster multi-model-Chat
Welche Route Sie auch gewählt haben, die erste Unterhaltung sieht gleich aus. Die Schritte unten dauern insgesamt ein paar Minuten, und keiner ist unumkehrbar: Sie können jederzeit einen Anbieter löschen, einen Chat leeren oder sich abmelden.
Eine Sache, die man am ersten Tag bewusst probieren sollte: Stellen Sie zwei verschiedenen Modellen in zwei Unterhaltungen dieselbe Frage, zu einer Aufgabe, die Sie gut genug kennen, um sie zu benoten. Das ist der schnellste Weg, ein Gespür dafür zu entwickeln, zu welchem Modell man greift, und der ganze Grund, mehr als eins zu haben.
- Installieren Sie die iPhone- oder Android-App oder öffnen Sie die Web-App im Browser — dasselbe Konto und derselbe Verlauf funktionieren auf allen dreien.
- Wählen Sie Ihre Route: sofort auf der kostenlosen Ebene chatten, für verwaltete Modelle anmelden, oder einen Anbieter hinzufügen und einen API key einfügen.
- Öffnen Sie die Modellauswahl und wählen Sie ein Modell. Modelle sind nach Anbieter gruppiert, der Anbieter ist also stets sichtbar.
- Senden Sie eine Nachricht. Die Antwort kommt im Stream zurück, und eine estimated Kostenangabe wird ihr angeheftet, sobald sie fertig ist.
- Speichern Sie Erhaltenswertes als Notiz — die Notiz hält fest, welches Modell sie geschrieben hat und aus welcher Unterhaltung sie stammt.
- Starten Sie eine zweite Unterhaltung mit einem anderen Modell und vergleichen Sie. Ordner, Tags und Volltextsuche machen beide später auffindbar.
Das Modell mitten in der Unterhaltung wechseln
Sie müssen sich vor dem Start nicht auf ein Modell festlegen. Wechseln Sie das Modell in der Auswahl, und die nächste Nachricht derselben Unterhaltung geht an das neue Modell, mit der bisherigen Unterhaltung als Kontext. Ein häufiges Muster ist, mit einem schnellen, günstigen Modell zu entwerfen und dann für den letzten Durchgang zu einem stärkeren zu wechseln: Sie behalten den Verlauf, die Anhänge und die Historie, und nur das Modell ändert sich.
Achten Sie darauf, was das mit der Rechnung macht. Jeder Anbieter berechnet die ganze Unterhaltung, die Sie als Kontext neu senden, sodass ein langer Verlauf mehr pro Nachricht kostet als ein kurzer, egal zu welchem Modell Sie wechseln. Für ein wirklich neues Thema eine frische Unterhaltung zu beginnen ist die einfachste Kostenkontrolle überhaupt und verbessert meist auch die Antworten.
Es lohnt sich, genau zu sein, wie der Wechsel hier funktioniert, denn Produkte unterscheiden sich. Der Modellwechsel in Oriveo ist sequenziell: Ein Modell antwortet zur Zeit. Oriveo zeigt keine side by side-Antworten auf denselben Prompt und sendet nie einen Prompt gleichzeitig an mehrere Modelle. Wenn es für Sie Bedingung ist, zwei Antworten auf dieselbe Frage auf einem Bildschirm zu vergleichen, prüfen Sie dieses konkrete Verhalten, bevor Sie eine App wählen: mehrere Produkte bieten es, dieses nicht.
Eine zweite Meinung zu einer Antwort einholen
Das sequenzielle Design hat sehr wohl eine eigens für die Überprüfung gebaute Funktion. Cross-check nimmt eine Antwort, die Sie bereits haben, und führt sie über ein von Ihnen gewähltes zweites Modell erneut aus, dann zeigt es die ursprüngliche Antwort und die zweite Meinung nebeneinander, damit Sie sie vergleichen. Es ist ein sequenzieller zweiter Blick und keine parallele Abfrage, und pro Durchlauf wird nur ein zweites Modell verwendet. Das Ergebnis lässt sich mit beiden Quellen als Notiz speichern.
Zwei Grenzen entscheiden, wer es nutzen kann, und sie sollten klar benannt werden. Cross-check runs on a provider you connected with your own API key, and it is not available on the Oriveo Free tier. Mit anderen Worten: Es ist eines der Dinge, die Sie mit Route C erhalten, nicht etwas, das die kontolose Ebene kann.
Gut genutzt ist dies das stärkste Argument dafür, überhaupt mehr als ein Modell zu haben. Wenn zwei von verschiedenen Laboren auf verschiedenen Daten gebaute Modelle bei einer Sachbehauptung uneins sind, ist das ein verlässliches Signal, dass die Behauptung Prüfung braucht. Übereinstimmung ist ein schwächerer Beleg, aber immer noch mehr, als wenn ein einzelnes Modell etwas selbstsicher allein behauptet.
Ihren Verlauf über Geräte hinweg behalten
Chats werden zuerst auf Ihrem Gerät gespeichert. Das heißt, die App öffnet sich und Ihr Verlauf ist lesbar, ohne auf eine Netzwerkrunde zu warten, und der Standardzustand Ihrer Unterhaltungen ist lokal statt gehostet. Notizen funktionieren genauso: Sie sind auf Ihrem Gerät unbegrenzt und kosten nichts.
Die geräteübergreifende Synchronisierung ist der Teil, der zu den bezahlten Plänen gehört. Pro fügt Echtzeit-Sync von Chats und Notizen über bis zu fünf Geräte hinzu, und Lifetime bringt dieselbe Sync auf unbegrenzt viele Geräte. Beide kommen mit 20 GB Sync-Speicher und einer Grenze von 100 MB pro einzelner Datei. Das ist es, was die iPhone-, Android- und Web-Apps wie ein Produkt statt wie drei Kopien wirken lässt. Die bezahlten Pläne heben zudem die Grenzen für Skills, Ordner und angepinnte Chats an.
Eines, das die bezahlten Pläne bewusst nicht enthalten, ist die KI-Nutzung. Pro und Lifetime enthalten keine Modell-credits, kein verwaltetes Guthaben und kein Anbieter-Abo — es sind Softwarefunktionen. Welche der drei Routen Sie auch für Modelle nutzen, das zahlen Sie separat, und darum vermischen sich der Preis eines Plans und der Preis Ihrer Nutzung nie.
Im Blick behalten, was es kostet
Jede Nachricht zeigt eine estimated Kostenangabe, berechnet aus dem veröffentlichten token-Preis des Anbieters und den tatsächlich genutzten tokens, im Moment, in dem die Antwort fertig ist. Diese Schätzung erscheint auf jeder Ebene, nicht nur bei bezahlten Plänen. Sie verwandelt „welches Modell soll ich nutzen“ von einer Geschmacks- in eine Rechenfrage: Wenn Sie sehen, dass eine Routine-Zusammenfassung auf einem Modell einen Bruchteil eines Cents kostet und auf einem anderen spürbar mehr, trifft sich die Wahl von selbst.
Behandeln Sie die Zahl als Steuerinstrument, nicht als Kontobuch. Es ist eine Schätzung aus veröffentlichten Preisen und gemeldeten token-Zahlen; die Rechnung Ihres Anbieters hat das letzte Wort, und Anbieter wenden eigene Rundungen, Mindestbeträge und gelegentliche Aktionspreise an. Sind die zwei uneins, gewinnt die Rechnung.
Tiefere Analyse ist eine bezahlte Funktion. Usage Insights — die Aufschlüsselung nach Anbieter und Modell, Monatstrends und Budgetwarnungen — gehört zu Pro und Lifetime. Die Schätzung pro Nachricht selbst ist nicht eingeschränkt, sodass die tägliche Rückkopplungsschleife auf jeder Ebene funktioniert, auch der kontolosen.
Später zwischen den drei Routen wechseln
Die drei Routen sind keine Leiter, die man einmal erklimmt. Sie bestehen nebeneinander in derselben App, und die Wahl gilt pro Nachricht statt pro Konto: Sie können Ihren eigenen OpenAI-Schlüssel halten, ein verwaltetes Guthaben für Anbieter behalten, bei denen Sie sich nicht angemeldet haben, und auf einem Gerät, wo Sie nicht angemeldet sind, dennoch auf die kontolose Ebene zurückgreifen. Die Auswahl zeigt sie alle zusammen, nach Anbieter gruppiert.
Weil die Routen einen Verlauf teilen, ist Umentscheiden günstig. Einen API key später hinzuzufügen migriert oder überschreibt die Unterhaltungen, die Sie schon hatten, nicht; sie bleiben in derselben Liste durchsuchbar. Einen Anbieter zu entfernen entfernt seine Modelle aus der Auswahl und sonst nichts. Entscheiden Sie sich, ganz zu gehen, exportieren sich Notizen und Unterhaltungen als Markdown, das in jedem Editor lesbar bleibt.
Das ist die praktische Antwort darauf, mehrere KI-Modelle in einer App zu nutzen. Wählen Sie die Route, die zu dem passt, was Sie heute haben, nutzen Sie sie lang genug, um zu lernen, welches Modell zu welcher Aufgabe passt, und wechseln Sie die Route, wenn sich die Beschränkung ändert, nicht wenn ein Plan es Ihnen sagt.