A Anthropic anunciou uma atualização significativa para o seu modo de voz, expandindo a compatibilidade da ferramenta para os modelos Opus e Sonnet. Lançada originalmente em maio de 2025, a funcionalidade de conversas em áudio estava restrita ao modelo Haiku, conhecido por ser a opção mais veloz e econômica da empresa, mas que limitava a profundidade das interações.
A integração permite que os usuários utilizem as capacidades avançadas de raciocínio dos modelos mais robustos da plataforma durante interações verbais. A mudança atende a uma demanda por maior precisão e inteligência nas respostas, aproximando o Claude de concorrentes que já exploram o processamento de voz em larga escala.
Expansão de modelos e flexibilidade nas conversas
O funcionamento do recurso mantém a premissa de permitir interações sem a necessidade de digitação ou leitura de tela. Por padrão, o sistema utiliza o modelo mais recente empregado pelo usuário na conversa, mas oferece a flexibilidade de alternar entre as opções disponíveis a qualquer momento. Essa transição permite que o usuário ajuste o nível de complexidade e o esforço computacional dedicado a cada resposta conforme a necessidade do diálogo.
Todas as funcionalidades nativas do chat, incluindo o acesso a conectores, consulta à memória do sistema, navegação na web e a geração de artefatos, permanecem operacionais durante o uso do modo de voz. A Anthropic confirmou que a ferramenta está disponível em fase Beta para as versões mobile, desktop e web, com recomendação de uso otimizado para dispositivos móveis.
Desafios na latência e naturalidade do diálogo
Apesar do ganho em inteligência, a experiência de uso ainda enfrenta desafios técnicos relacionados à fluidez. Em declaração ao Engadget, um porta-voz da empresa explicou que a arquitetura do sistema segue baseada em turnos. Isso significa que o processamento da resposta só é iniciado após a conclusão da fala do usuário, o que resulta em uma cadência mais pausada e menos natural em comparação a outras IAs do mercado.
Além da latência, a qualidade da voz sintetizada ainda apresenta um tom robotizado, ponto que contrasta com a sofisticação dos modelos de linguagem subjacentes. Embora a atualização traga suporte a diversos idiomas, incluindo o português brasileiro, inglês, francês, alemão, hindi, espanhol, italiano e japonês, a experiência de conversação em tempo real ainda carece da agilidade encontrada em plataformas como o ChatGPT ou o Gemini.
Limitações nos planos de uso
É importante notar que o acesso aos recursos segue as diretrizes dos planos de assinatura da Anthropic. Usuários do plano gratuito permanecem limitados ao uso do modelo Haiku e possuem restrições na conexão de ferramentas externas. O consumo de limites de uso para o modo de voz segue os mesmos critérios aplicados às interações via texto, exigindo que o usuário gerencie o volume de requisições para evitar interrupções no serviço.





