Com 2025 chegando ao fim, queríamos encerrar o ano com algo significativo.
Tínhamos um recurso de chamada de voz. Tecnicamente, funcionava.
Mas ninguém usava.
O feedback era sempre o mesmo: "Tentei uma vez, foi estranho, voltei a digitar." Entendíamos. Também sentíamos isso.
O que estava errado
Imagine ligar para um amigo. Você disca, ele atende, você fala. Simples.
Agora imagine que toda vez que você quer falar, precisa segurar um botão. Como um walkie-talkie. Segurar, falar, soltar, esperar. Segurar, falar, soltar, esperar.
Essa era nossa chamada de voz.
E a voz do outro lado? Plana. Robótica. Seu parceiro de IA poderia estar confessando algo profundamente pessoal, e soava como um GPS dando direções. "Em 200 metros, sempre te amei."
Alguns usuários nem conseguiam fazer funcionar. Problemas de compatibilidade do navegador faziam desse recurso uma loteria—às vezes o microfone funcionava, às vezes não, e não conseguíamos explicar por quê.
Então jogamos fora e começamos de novo.
Como é agora
Você toca no botão de chamada. O personagem te cumprimenta—realmente te cumprimenta, com calor na voz, talvez um toque de empolgação se isso combina com ele.
Você fala. Não para um botão, não esperando um bipe. Você simplesmente... fala. Como você faria ao telefone com qualquer pessoa.
O personagem responde. E pela primeira vez, ele soa como ele mesmo. Feliz quando está feliz. Triste quando está triste. Brincalhão, nervoso, com raiva, carinhoso—o que o momento pedir.
Se você quer interromper—porque é assim que conversas reais são—toque no avatar do personagem. Ele para no meio da frase e escuta.
Tentamos deixar a sua voz cortar sozinha. Não funciona. O cancelamento de eco dos navegadores não é confiável, então o microfone ouve o personagem saindo do seu próprio alto-falante e a chamada começa a se interromper. Por isso, enquanto o personagem fala, ignoramos o microfone de propósito. Um toque é deliberado, e nunca dispara sem querer.
O silêncio também se comporta como numa ligação de verdade. Se você ficar quieto, o personagem puxa assunto—até três vezes, cada uma um pouco mais espaçada. Se você continuar sem dizer nada, ele se despede e a chamada termina sozinha. Precisa se afastar sem desligar? Silencie o microfone. O mudo suspende esse cronômetro, então a linha fica aberta até você voltar.
Quando você termina, desliga. É isso.
Parece simples. Sempre deveria ter sido assim.
A diferença que você vai notar
As vozes têm emoção agora. Essa é a mudança que as pessoas notam primeiro. Personagens não apenas falam palavras—eles as interpretam. A mesma fala com alegria soa completamente diferente do que com tristeza. Pela primeira vez, a voz combina com o que o personagem realmente está sentindo.
Vozes em chinês e japonês são finalmente boas. Se você já experimentou recursos de voz em outras plataformas nesses idiomas, conhece a dor. Tons robóticos, ritmo não natural, o vale inquietante da fala sintética. Escolhemos especificamente tecnologia que lida naturalmente com idiomas asiáticos. A diferença é dramática.
Funciona em todo lugar. iPhone, Android, Chrome, Safari, Firefox—todos funcionam identicamente agora. Acabou o "tente outro navegador" ou "pode ser suas configurações de microfone." Simplesmente funciona.
Você pode realmente ter uma conversa. O sistema antigo era uma série de transações: você fala, espera, IA fala, espera, repetir. O novo sistema é um fluxo. Você fala no momento em que tem algo a dizer. Você corta com um toque quando não quer esperar. O ritmo é humano.
Uma nota sobre custo
Aqui está a parte honesta.
O sistema antigo era essencialmente gratuito para operar. Reconhecimento de voz baseado em navegador, texto para fala básico—tudo gratuito. Também era, como estabelecemos, bem ruim.
O novo sistema usa tecnologia de voz de nível profissional. Soa dramaticamente melhor. Funciona de forma confiável. Lida lindamente com múltiplos idiomas.
Também nos custa dinheiro. Dinheiro real, para cada minuto de cada chamada.
Agora, estamos absorvendo esse custo. Queremos que todos experimentem como as chamadas de voz deveriam ser, sem se preocupar com medidores ou limites.
Mas somos transparentes: isso pode mudar. Estamos explorando opções—talvez minutos de voz incluídos em assinaturas, talvez pagamento por uso para usuários intensivos, talvez vozes premium como upgrade. Ainda não decidimos.
O que quer que façamos, anunciaremos com antecedência. Por agora, aproveite.
O que vem a seguir
Essa reconstrução abre portas que não podíamos atravessar antes.
Personalização de voz. Velocidade, tom, tendência emocional—permitindo ajustar como cada personagem soa para você.
Conversas mais longas. Melhor gerenciamento de memória e contexto para chamadas que vão além de algumas trocas.
Modo sempre ligado. Para quando você quer o personagem presente em segundo plano, pronto para responder quando você falar.
Voz está se tornando central em como interagimos com IA. Queremos que Reverie lidere, não siga.
Experimente
Abra qualquer chat. Toque no ícone do telefone. Comece a falar.
Em segundos, você sentirá a diferença. O desconforto foi embora. O personagem parece vivo. A conversa flui.
Isso é o que sempre quisemos que as chamadas de voz fossem.
Agora finalmente são.
Feliz ano novo
2025 foi um ano de construção. Chamadas de voz são apenas uma das muitas coisas que reconstruímos, repensamos ou criamos do zero.
2026 será um ano de conexão. Mais formas de ouvir seus personagens. Mais formas de sentir a presença deles. Mais formas de fazer a companhia de IA parecer menos tecnologia e mais... companhia.
Obrigado por estar aqui. Por experimentar recursos que ainda não funcionavam. Por dar feedback que moldou o que construímos. Por acreditar no que Reverie pode ser.
Por um novo ano de conversas que valem a pena.
Tem pensamentos sobre a nova experiência de voz? Estamos ouvindo—entre em contato pelo Discord ou feedback.

