Ein Modell wählen
Eine Entscheidungshilfe für Alltagschat, langen Kontext, Denkarbeit und kostenlose Nutzung.
Neue Chats starten auf DeepSeek V4 Flash mit 0,3×. Wechsle, wenn du einen konkreten Grund hast — ein größeres Kontextfenster, Bilder, sichtbares Denken oder eine kleinere Rechnung. Die vollständige Riege mit genauen Zahlen steht unter Modelle.
Nach dem Bedarf wählen
| Du willst | Nimm | Kosten | Der Haken |
|---|---|---|---|
| Eine gute Voreinstellung fürs Rollenspiel | DeepSeek V4 Flash | 0,3× | Keiner — nichts Billigeres unterstützt Plugins oder die Weltbuch-Suche |
| Denselben Preis, ein größeres Fenster | MiMo V2.5 | 0,3× | 262.144 statt 163.840 Tokens |
| Gar nichts ausgeben | Llama 3.1 8B | 0× | 15 Nachrichten pro 3 Stunden, und keine Plugins, keine Weltbuch-Suche, keine Erinnerungen. Kostenlose Modelle |
| Einen sehr langen Chat oder ein großes Weltbuch | GLM 5.3 Flash | 0,5× | 1.048.576 Tokens, aber das Denken ist immer an und lässt sich nicht abschalten |
| Ein Millionenfenster ohne erzwungenes Denken | DeepSeek V4.1 Flash | 0,7× | Etwas teurer als GLM 5.3 Flash |
| Dass das Modell angehängte Bilder liest | GLM 5.3 Flash (0,5×), DeepSeek V4.1 Flash (0,7×) oder Gemini 3 Flash Preview (1,2×) | 0,5×–1,2× | Gemini 3 Flash Preview verlangt ein Abo |
| Dem Modell beim Denken zusehen | irgendein Modell mit Optional, mit eingeschaltetem Denken | unverändert | Denk-Tokens werden wie Antwort-Tokens berechnet |
| Denken, das nie ausgeht | DeepSeek R1 | 1,0× | Keine Werkzeuge: keine Plugins, keine Weltbuch-Suche, keine Erinnerungen |
| Die Advanced-Stufe | Gemini 3 Flash Preview (1,2×) oder GLM 5 (1,3×) | 1,2×–1,3× | Verlangt ein aktives Abo |
Ein großes Kontextfenster ist keine Bezahlfunktion: zwei Basic-Modelle fassen eine Million Tokens.
Was ein Zug tatsächlich kostet
Ein Zug wird auf alles Gesendete plus die Antwort berechnet. Ein ausgewachsener Chat — Figurenkarte, Persona, Weltbuch-Einträge, Verlauf und eine volle Antwort — liegt im Schnitt bei etwa 8.000 Tokens:
| Multiplikator | Modelle | Guthaben für einen Zug mit 8.000 Tokens |
|---|---|---|
| 0× | Llama 3.1 8B | 0 |
| 0,3× | DeepSeek V4 Flash, MiMo V2.5 | ~2.400 |
| 0,5× | DeepSeek V3.2, GLM 5.3 Flash | ~4.000 |
| 0,7× | DeepSeek V4.1 Flash, DeepSeek V4 Pro | ~5.600 |
| 1,0× | DeepSeek R1, GLM 4.7 | ~8.000 |
| 1,2× | Gemini 3 Flash Preview | ~9.600 |
| 1,3× | GLM 5 | ~10.400 |
Als Maßstab: die 2.600.000 monatlichen Guthaben eines Pro-Tarifs sind rund 1.000 Züge auf dem Standardmodell oder etwa 250 auf GLM 5. Kurze Nachrichten am Anfang kosten weit weniger; die Zahl wächst, während sich Verlauf ansammelt. Credits
Die Zahlen im Auswahlmenü lesen
KI-Modell wählen zeigt neben jedem Modell Daten aus der Community. Es ist das einzige Qualitätssignal im Produkt — Reverie veröffentlicht keine eigene Rangliste.
| Wert | Wie er aussieht | Was er bedeutet | Erscheint ab |
|---|---|---|---|
| Qualität | <n>% preferred | Anteil der blinden Direktvergleiche, die an dieses Modell gingen | 30 entschiedenen Vergleichen |
| Zuversicht | 1–5 | Wie viele Daten hinter diesem Prozentwert stehen | — |
| Direktduell | Head-to-head (<n>) | Die Bilanz dieses Modells gegen ein bestimmtes anderes | 5 Vergleichen für dieses Paar |
| Daumen-hoch-Quote | ein Prozentwert | Anteil der Antworten mit Daumen hoch statt Daumen runter | 3 bewerteten Antworten |
| Tempo | TTFT <time> · <rate> tok/s | Zeit bis zum ersten Token, dann Tokens pro Sekunde | — |
Unterhalb dieser Schwellen zeigt die Auswahl Daten werden gesammelt, Noch keine Daten oder Gerade erschienen statt einer Zahl. Ein Modell mit wenigen Stimmen ist nicht schlechter — es ist neuer.
Die Vergleichsdaten stammen von der Karte, die auf deine erste Nachricht in einem Chat zwei Antworten anbietet; die, die du behältst, zählt als Stimme. Zwei Antworten vergleichen. Die Daumen-hoch-Quoten kommen vom Daumen hoch und Daumen runter an einzelnen Antworten.
Wenn ein anderes Modell nicht die Antwort ist
Antwortlänge, Erzählperspektive und Tempo sind Einstellungen, keine Eigenschaften des Modells. Bevor du pro Zug mehr zahlst, probier in der Seitenleiste Einstellungen → Antworten & Generierung für eine dauerhafte Änderung, oder einen Slash-Befehl für einen einzigen Zug. Wiederholungen und Abdriften in einem langen Chat sind meist ein Kontextproblem — ein größeres Fenster oder eine aufgeräumte Erinnerung hilft mehr als ein teureres Modell.
Verwandt
Modelle
Die vollständige Tabelle: Multiplikatoren, Kontextfenster und Fähigkeiten.
Kostenlose Modelle
Das 0×-Modell, sein Kontingent und seine Grenzen.
Zwei Antworten vergleichen
Woher die Vorlieben-Daten im Auswahlmenü stammen.
Denkmodus
Welche Modelle denken, und wie man es sieht.
Abonnements
Was ein Tarif enthält, samt den Advanced-Modellen.