Escolhendo um modelo
Um guia de decisão para conversa do dia a dia, contexto longo, raciocínio e uso gratuito.
Conversas novas começam no DeepSeek V4 Flash, a 0,3×. Troque quando tiver um motivo concreto — uma janela de contexto maior, imagens, raciocínio à vista ou uma conta menor. A linha completa com os números exatos está em Modelos.
Escolha pelo que você precisa
| Você quer | Use | Custo | Em troca de |
|---|---|---|---|
| Um bom padrão para interpretação | DeepSeek V4 Flash | 0,3× | Nenhum — nada mais barato aceita plugins nem busca no world book |
| O mesmo preço, janela maior | MiMo V2.5 | 0,3× | 262.144 tokens em vez de 163.840 |
| Não gastar nada | Llama 3.1 8B | 0× | 15 mensagens a cada 3 horas, e sem plugins, sem busca de lore nem escrita de memórias. Modelos gratuitos |
| Uma conversa longuíssima, ou um world book grande | GLM 5.3 Flash | 0,5× | 1.048.576 tokens, mas o raciocínio fica sempre ligado e não desliga |
| Um milhão de tokens sem raciocínio forçado | DeepSeek V4.1 Flash | 0,7× | Um pouco mais caro que o GLM 5.3 Flash |
| Que o modelo leia as imagens que você anexa | GLM 5.3 Flash (0,5×), DeepSeek V4.1 Flash (0,7×) ou Gemini 3 Flash Preview (1,2×) | 0,5×–1,2× | O Gemini 3 Flash Preview pede assinatura |
| Ver o modelo pensando | qualquer modelo marcado como Opcional, com o raciocínio ligado | igual | Os tokens de pensamento são cobrados como os da resposta |
| Raciocínio que nunca desliga | DeepSeek R1 | 1,0× | Sem ferramentas: nada de plugins, busca de lore ou escrita de memórias |
| A faixa avançada | Gemini 3 Flash Preview (1,2×) ou GLM 5 (1,3×) | 1,2×–1,3× | Exige uma assinatura ativa |
Uma janela de contexto grande não é recurso pago: dois modelos da faixa básica seguram um milhão de tokens.
Quanto um turno custa de verdade
Um turno é cobrado sobre tudo o que é enviado mais a resposta. Uma conversa já madura — ficha do personagem, persona, entradas do world book, histórico e uma resposta inteira — dá em média uns 8.000 tokens:
| Multiplicador | Modelos | Créditos por um turno de 8.000 tokens |
|---|---|---|
| 0× | Llama 3.1 8B | 0 |
| 0,3× | DeepSeek V4 Flash, MiMo V2.5 | ~2.400 |
| 0,5× | DeepSeek V3.2, GLM 5.3 Flash | ~4.000 |
| 0,7× | DeepSeek V4.1 Flash, DeepSeek V4 Pro | ~5.600 |
| 1,0× | DeepSeek R1, GLM 4.7 | ~8.000 |
| 1,2× | Gemini 3 Flash Preview | ~9.600 |
| 1,3× | GLM 5 | ~10.400 |
Para dar escala: os 2.600.000 créditos mensais do plano Pro dão mais ou menos 1.000 turnos no modelo padrão, ou cerca de 250 no GLM 5. As mensagens curtas do começo custam bem menos; o número cresce conforme o histórico se acumula. Créditos
Lendo os números do seletor
Escolher modelo de IA mostra dados da comunidade ao lado de cada modelo. É o único sinal de qualidade no produto — a Reverie não publica um ranking próprio.
| Número | Como aparece | O que quer dizer | Aparece depois de |
|---|---|---|---|
| Qualidade | <n>% preferred | Fatia das escolhas às cegas que ficou com este modelo | 30 comparações decididas |
| Confiança | 1–5 | Quanto dado está por trás daquela porcentagem | — |
| Confronto direto | Head-to-head (<n>) | O retrospecto deste modelo contra um outro específico | 5 comparações naquela dupla |
| Taxa de curtidas | uma porcentagem | Fatia das respostas que levaram joinha em vez de deslike | 3 respostas avaliadas |
| Velocidade | TTFT <time> · <rate> tok/s | Tempo até o primeiro token e então tokens por segundo | — |
Abaixo desses limiares, o seletor diz Coletando dados, Sem dados ainda ou Recém-lançado em vez de um número. Um modelo com poucas amostras não é pior — é mais novo.
Os dados de comparação vêm do cartão que oferece duas respostas à sua primeira mensagem numa conversa; a que você guarda conta como voto. Comparando duas respostas. As taxas de curtida vêm dos joinhas e deslikes em cada resposta.
Quando outro modelo não é a resposta
Tamanho da resposta, ponto de vista e ritmo são configurações, não traços do modelo. Antes de pagar mais por turno, experimente Configurações → Respostas e geração no painel lateral para uma mudança permanente, ou um comando de barra só para aquele turno. Repetição e desvio numa conversa longa costumam ser problema de contexto — uma janela maior ou uma memória mais arrumada ajudam mais que um modelo caro.
Relacionado
Modelos
A tabela completa: multiplicadores, janelas de contexto e capacidades.
Modelos gratuitos
O modelo de 0×, a cota dele e suas limitações.
Comparando duas respostas
De onde vêm os dados de preferência do seletor.
Modo de raciocínio
Quais modelos pensam, e como ver isso.
Assinaturas
O que um plano inclui, inclusive os modelos avançados.