Wybór modelu
Przewodnik wyboru modelu do codziennego czatu, długiego kontekstu, rozumowania i darmowych modeli.
Nowe czaty startują na DeepSeek V4 Flash przy 0,3×. Zmieniaj model, gdy masz konkretny powód — większe okno kontekstu, obrazy, widoczne rozumowanie albo mniejszy rachunek. Pełna lista z dokładnymi liczbami jest na stronie Modele.
Wybierz według potrzeby
| Czego chcesz | Weź | Koszt | Kompromis |
|---|---|---|---|
| Dobry domyślny model do odgrywania ról | DeepSeek V4 Flash | 0,3× | Żaden — nic tańszego nie obsługuje wtyczek ani wyszukiwania w lore |
| Tej samej ceny, ale większego okna | MiMo V2.5 | 0,3× | 262 144 tokeny zamiast 163 840 |
| Nie wydawać nic | Llama 3.1 8B | 0× | 15 wiadomości na 3 godziny, bez wtyczek, wyszukiwania w lore i zapisu pamięci. Darmowe modele |
| Bardzo długiego czatu albo dużej księgi świata | GLM 5.3 Flash | 0,5× | 1 048 576 tokenów, ale rozumowanie jest zawsze włączone i nie da się go wyłączyć |
| Miliona tokenów bez wymuszonego rozumowania | DeepSeek V4.1 Flash | 0,7× | Odrobinę drożej niż GLM 5.3 Flash |
| Modelu, który odczyta załączone obrazy | GLM 5.3 Flash (0,5×), DeepSeek V4.1 Flash (0,7×) lub Gemini 3 Flash Preview (1,2×) | 0,5×–1,2× | Gemini 3 Flash Preview wymaga subskrypcji |
| Podglądać, jak model myśli | dowolny model oznaczony Optional, z włączonym rozumowaniem | bez zmian | Tokeny myślenia liczą się jak tokeny odpowiedzi |
| Rozumowania, które nigdy się nie wyłącza | DeepSeek R1 | 1,0× | Brak obsługi narzędzi: bez wtyczek, wyszukiwania w lore i zapisu pamięci |
| Poziomu zaawansowanego | Gemini 3 Flash Preview (1,2×) lub GLM 5 (1,3×) | 1,2×–1,3× | Wymaga aktywnej subskrypcji |
Duże okno kontekstu nie jest funkcją płatną: dwa modele poziomu podstawowego mieszczą milion tokenów.
Ile naprawdę kosztuje tura
Tura jest naliczana od wszystkiego, co zostało wysłane, plus odpowiedź. Dojrzały czat — karta postaci, persona, wpisy z księgi świata, historia i pełna odpowiedź — to średnio około 8 000 tokenów:
| Mnożnik | Modele | Kredyty za turę 8 000 tokenów |
|---|---|---|
| 0× | Llama 3.1 8B | 0 |
| 0,3× | DeepSeek V4 Flash, MiMo V2.5 | ~2 400 |
| 0,5× | DeepSeek V3.2, GLM 5.3 Flash | ~4 000 |
| 0,7× | DeepSeek V4.1 Flash, DeepSeek V4 Pro | ~5 600 |
| 1,0× | DeepSeek R1, GLM 4.7 | ~8 000 |
| 1,2× | Gemini 3 Flash Preview | ~9 600 |
| 1,3× | GLM 5 | ~10 400 |
Dla skali: 2 600 000 miesięcznych kredytów w planie Pro to mniej więcej 1 000 tur na modelu domyślnym albo około 250 na GLM 5. Krótkie wiadomości na początku kosztują dużo mniej; liczba rośnie wraz z historią. Kredyty
Jak czytać statystyki w wyborze modelu
Wybierz model AI pokazuje przy każdym modelu dane od społeczności. To jedyny sygnał jakości w produkcie — Reverie nie publikuje własnego rankingu.
| Statystyka | Jak wygląda | Co znaczy | Pojawia się po |
|---|---|---|---|
| Jakość | <n>% preferowanych | Udział ślepych wyborów w parach, które padły na ten model | 30 rozstrzygniętych porównaniach |
| Pewność | 1–5 | Ile danych stoi za tym odsetkiem | — |
| Twarz w twarz | Twarz w twarz (<n>) | Bilans tego modelu przeciwko jednemu konkretnemu innemu | 5 porównaniach tej pary |
| Odsetek polubień | wartość procentowa | Udział odpowiedzi z kciukiem w górę zamiast w dół | 3 ocenionych odpowiedziach |
| Szybkość | TTFT <czas> · <tempo> tok/s | Czas do pierwszego tokena, potem tokeny na sekundę | — |
Poniżej tych progów zamiast liczby pojawia się Zbieranie danych, Brak danych albo Wydane właśnie. Model z niewieloma próbkami nie jest gorszy — jest nowszy.
Dane porównawcze pochodzą z karty, która na pierwszą wiadomość w czacie proponuje dwie odpowiedzi; ta, którą zostawisz, zapisuje się jako głos. Porównywanie dwóch odpowiedzi. Odsetek polubień bierze się z kciuków w górę i w dół przy pojedynczych odpowiedziach.
Kiedy inny model nie jest odpowiedzią
Długość odpowiedzi, narracja i tempo to ustawienia, a nie cechy modelu. Zanim zapłacisz więcej za turę, spróbuj Ustawienia → Model i generowanie w panelu bocznym, żeby zmienić coś na stałe, albo polecenia ukośnikowego na jedną turę. Powtarzanie się i dryf w długim czacie to zwykle problem kontekstu — większe okno albo uporządkowana pamięć pomogą bardziej niż droższy model.
Powiązane
Modele
Pełna tabela: mnożniki, okna kontekstu i możliwości.
Darmowe modele
Model 0×, jego limit i ograniczenia.
Porównywanie dwóch odpowiedzi
Skąd biorą się dane o preferencjach w wyborze modelu.
Tryb rozumowania
Które modele myślą i jak to zobaczyć.
Subskrypcje
Co obejmuje plan, łącznie z modelami zaawansowanymi.