Scegliere un modello
Una guida per decidere tra chat quotidiana, contesto lungo, ragionamento e uso gratuito.
Le chat nuove partono su DeepSeek V4 Flash, a 0,3×. Cambia quando hai un motivo preciso: una finestra di contesto più ampia, le immagini, il ragionamento a vista o un conto più leggero. La scuderia completa con i numeri esatti sta su Modelli.
Scegli in base a cosa ti serve
| Vuoi | Usa | Costo | In cambio di |
|---|---|---|---|
| Un buon predefinito per il gioco di ruolo | DeepSeek V4 Flash | 0,3× | Niente — nulla di più economico supporta i plugin o la ricerca nel world book |
| Lo stesso prezzo, una finestra più grande | MiMo V2.5 | 0,3× | 262.144 token invece di 163.840 |
| Non spendere nulla | Llama 3.1 8B | 0× | 15 messaggi ogni 3 ore, e niente plugin, ricerca nel lore o scrittura di ricordi. Modelli gratuiti |
| Una chat lunghissima, o un world book grande | GLM 5.3 Flash | 0,5× | 1.048.576 token, però il ragionamento è sempre acceso e non si spegne |
| Una finestra da un milione senza ragionamento forzato | DeepSeek V4.1 Flash | 0,7× | Un filo più caro di GLM 5.3 Flash |
| Che il modello legga le immagini che alleghi | GLM 5.3 Flash (0,5×), DeepSeek V4.1 Flash (0,7×) o Gemini 3 Flash Preview (1,2×) | 0,5×–1,2× | Gemini 3 Flash Preview richiede un abbonamento |
| Guardare il modello mentre pensa | qualunque modello segnato Facoltativo, con il ragionamento acceso | invariato | I token del pensiero si pagano come quelli della risposta |
| Un ragionamento che non si spegne mai | DeepSeek R1 | 1,0× | Nessun supporto agli strumenti: niente plugin, ricerca nel lore o scrittura di ricordi |
| Il livello avanzato | Gemini 3 Flash Preview (1,2×) o GLM 5 (1,3×) | 1,2×–1,3× | Richiede un abbonamento attivo |
Una finestra di contesto ampia non è una funzione a pagamento: due modelli di livello base reggono un milione di token.
Quanto costa davvero un turno
Un turno si paga su tutto ciò che viene inviato più la risposta. Una chat matura — scheda del personaggio, persona, voci del world book, cronologia e una risposta intera — sta in media sugli 8.000 token:
| Moltiplicatore | Modelli | Crediti per un turno da 8.000 token |
|---|---|---|
| 0× | Llama 3.1 8B | 0 |
| 0,3× | DeepSeek V4 Flash, MiMo V2.5 | ~2.400 |
| 0,5× | DeepSeek V3.2, GLM 5.3 Flash | ~4.000 |
| 0,7× | DeepSeek V4.1 Flash, DeepSeek V4 Pro | ~5.600 |
| 1,0× | DeepSeek R1, GLM 4.7 | ~8.000 |
| 1,2× | Gemini 3 Flash Preview | ~9.600 |
| 1,3× | GLM 5 | ~10.400 |
Per darti la scala: i 2.600.000 crediti mensili di un piano Pro sono all'incirca 1.000 turni sul modello predefinito, o circa 250 su GLM 5. I primi messaggi, corti, costano molto meno; il numero cresce man mano che la cronologia si accumula. Crediti
Leggere i numeri del selettore
Scegli modello IA mostra accanto a ogni modello i dati della community. È l'unico segnale di qualità nel prodotto: Reverie non pubblica una classifica propria.
| Dato | Come si legge | Cosa significa | Compare dopo |
|---|---|---|---|
| Qualità | <n>% preferred | Quota delle scelte alla cieca finite a questo modello | 30 confronti decisi |
| Affidabilità | 1–5 | Quanti dati stanno dietro quella percentuale | — |
| Testa a testa | Head-to-head (<n>) | Il bilancio di questo modello contro un altro modello preciso | 5 confronti per quella coppia |
| Tasso di mi piace | una percentuale | Quota di risposte che hanno ricevuto un pollice su anziché giù | 3 risposte valutate |
| Velocità | TTFT <time> · <rate> tok/s | Tempo al primo token, poi token al secondo | — |
Sotto quelle soglie il selettore scrive Raccolta dati, Ancora nessun dato o Appena uscito invece di un numero. Un modello con pochi campioni non è peggiore: è più nuovo.
I dati dei confronti arrivano dalla scheda che propone due risposte al tuo primo messaggio in una chat; quella che tieni viene registrata come voto. Confrontare due risposte. I tassi di mi piace vengono dai pollici su e giù sulle singole risposte.
Quando cambiare modello non è la risposta
Lunghezza della risposta, punto di vista e ritmo sono impostazioni, non tratti del modello. Prima di pagare di più a turno, prova Impostazioni → Risposte e generazione nel pannello laterale per un cambiamento stabile, o un comando slash per un turno solo. Ripetizioni e derive in una chat lunga di solito sono un problema di contesto: una finestra più ampia o una memoria più ordinata aiutano più di un modello costoso.
Correlati
Modelli
La tabella completa: moltiplicatori, finestre di contesto e capacità.
Modelli gratuiti
Il modello a 0×, la sua quota e i suoi limiti.
Confrontare due risposte
Da dove arrivano i dati sulle preferenze del selettore.
Modalità ragionamento
Quali modelli pensano, e come vederlo.
Abbonamenti
Cosa comprende un piano, modelli avanzati inclusi.