
Fortalecendo e protegendo as eleições
- Categoria
- Empresa
- Data
A escolha de mais de 1 milhão de usuários • Comece grátis
Selecionado para o seu caso de uso
Selecionado para o seu caso de uso
Selecione uma voz
Transformar texto em áudio
Nossa IA de voz responde a sinais emocionais no texto e adapta a interpretação ao conteúdo imediato e ao contexto mais amplo. Isso permite que nossas vozes IA tenham uma ampla variedade emocional e evitem erros de lógica ao ler seu conteúdo em voz alta.

Crie falas expressivas e controláveis, com emoções, eventos de áudio e paisagens sonoras imersivas.
A voz fez uma pausa por um momento, [suavemente] como se estivesse reunindo seus pensamentos antes de continuar. Cada respiração parecia intencional, cada hesitação perfeitamente cronometrada.
Isso não era mais uma fala sintética [ri calorosamente] - era uma voz que entendia o tempo, a emoção e o espaço entre as palavras.
Texto transformado em presença. [suspira contente] Palavras ganhando vida, personalidade, alma.
Explore uma coleção em constante crescimento de vozes expressivas e realistas para qualquer caso de uso, da narração à criação de personagens.
Crie conversas em áudio nas quais os participantes compartilham contexto e emoção.
Replique sua própria voz instantaneamente ou crie vozes IA exclusivas com controle total.
Dê vida às histórias em mais de 70 idiomas, todos com emoção e clareza de nível nativo.







Nosso modelo mais avançado e expressivo, com tags de áudio para controle emocional preciso. Ideal para histórias, games e produção de mídia em mais de 70 idiomas.

Nosso modelo de Text to Speech mais realista e emocionalmente rico, com suporte a 29 idiomas. Ideal para locuções, audiolivros, pós-produção e criação de conteúdo.

Nosso modelo de TTS de alta qualidade e baixa latência em 32 idiomas. Ideal para casos de uso de desenvolvedores em que a velocidade é importante e você precisa de idiomas além do inglês.

Modelo de alta qualidade e baixa latência, com bom equilíbrio entre qualidade e velocidade
10k créditos por mês
10k créditos por mês
30k créditos por mês
121k créditos por mês
600k créditos por mês
Minutos incluídos
Minutos extras
Qualidade do áudio
~10
~$ 0,36
128 kbps, 44.1kHz
~30
~$ 0,20
128 kbps, 44.1kHz
~121
~$ 0,18
128 kbps, 44.1kHz
~600
~$ 0,17
128 e 192 kbps (via Estúdio e API), 44.1kHz
Os preços não incluem impostos, taxas e encargos. Ver todos os planos de preços.
Os melhores modelos de áudio com IA em um editor poderoso.

Gere áudio expressivo em segundos com nossos apps para iOS e Android.

Integre o Text to Speech (TTS) da ElevenLabs ao seu produto por APIs ou SDKs.

Sim, a ElevenLabs oferece duas maneiras de criar uma voz personalizada:
Clonagem instantânea de voz permite criar uma versão digital de qualquer voz a partir de uma pequena amostra de áudio (cerca de 1 minuto). É rápida, está disponível nos planos pagos e é ideal para começar sem demora.
Clonagem profissional de voz usa mais de 30 minutos de áudio gravado em alta qualidade para criar um clone muito realista, que captura o sotaque, a variedade emocional e as características vocais da pessoa original.
As duas opções foram desenvolvidas pensando na segurança. Você precisa ter permissão para clonar qualquer voz, e usamos a tecnologia AI Speech Classifier para detectar áudio clonado. Depois de criada, sua voz pode ser usada no Text to Speech, Estúdio, dublagem e na API em mais de 32 idiomas.
A ElevenLabs oferece acesso a mais de 11.000 vozes, incluindo:
• Centenas de vozes prontas que abrangem diferentes idades, sotaques, tons e estilos.
• Milhares de vozes compartilhadas pela comunidade na Voice Library, pesquisáveis por idioma, gênero, sotaque e caso de uso.
• Vozes icônicas da televisão e do cinema para leitura em voz alta e narração.
Se não encontrar a voz ideal, você também pode:
• Usar Voice Design para gerar uma voz IA totalmente nova a partir de um prompt de texto que descreve como ela deve soar.
• Usar Clonar Voz com IA para criar uma versão digital da sua própria voz (com permissão).
Esta é uma das maiores bibliotecas de vozes disponíveis em uma plataforma de Text to Speech com IA.
O plano gratuito da ElevenLabs inclui 10.000 caracteres por mês, o suficiente para gerar cerca de 10 minutos de áudio. Você também tem acesso a:
• O gerador completo de Text to Speech com vozes prontas.
• Clonar Voz com IA (a Clonagem instantânea de voz está disponível nos planos pagos).
• A API de Text to Speech para desenvolvedores.
• Geração em mais de 32 idiomas.
Os planos pagos têm um baixo custo mensal e liberam mais caracteres, geração mais rápida, Clonagem profissional de voz, direitos de uso comercial e maior simultaneidade para cargas de trabalho de produção.
Sim. Os planos pagos da ElevenLabs incluem direitos completos de uso comercial para o áudio que você gera. Isso significa que você pode usá-lo em vídeos do YouTube, podcasts, anúncios, audiolivros, filmes, jogos e apps sem pagar royalties adicionais.
O plano gratuito é destinado ao uso pessoal e não comercial, e requer atribuição à ElevenLabs. Se você precisa monetizar seu conteúdo ou usar áudio em trabalhos para clientes, faça upgrade para um plano pago e tenha acesso a todos os direitos de uso comercial.*
*Os direitos comerciais estão sujeitos aos nossos Termos de Uso e à Política de Uso Proibido.
A ElevenLabs oferece vários modelos de Text to Speech, cada um ajustado para um caso de uso diferente:
• Eleven v3 - Nosso modelo mais expressivo e emocionalmente rico, com suporte a tags de áudio inseridas no texto, como [whispers], [laughs] e [excited]. Ideal para conteúdo longo, audiolivros, filmes e locuções dramáticas.
• Multilingual v2 - O modelo mais estável e realista para produção de conteúdo de alta qualidade em 29 idiomas. Ideal para narração e pós-produção.
• Flash v2.5 - Modelo de latência ultrabaixa (menos de 500 ms de ponta a ponta) com suporte a 32 idiomas. Ideal para IA conversacional em tempo real, agentes e aplicações ao vivo.
• Turbo v2.5 - Um equilíbrio entre qualidade e velocidade, adequado para casos de uso com alto volume que ainda exigem uma interpretação natural.
A maioria dos usuários começa com o Multilingual v2 para conteúdo e muda para o Flash em qualquer uso em tempo real.
Sim. O ElevenLabs Flash v2.5 oferece latência de ponta a ponta inferior a 500 ms, sendo um dos modelos de Text to Speech prontos para produção mais rápidos disponíveis. A API de Text to Speech oferece suporte a streaming de áudio, para que você possa começar a reproduzir a fala para seus usuários enquanto o restante da resposta ainda está sendo gerado.
Isso torna a ElevenLabs ideal para:
• IA conversacional e agentes de voz que precisam de tempos de resposta naturais.
• Suporte ao cliente ao vivo, telefonia e sistemas IVR.
• NPCs de games em tempo real e experiências interativas.
• Apps habilitados para voz em que cada milissegundo importa.
Para casos de uso conversacionais completos, o ElevenAgents combina Text to Speech, Speech to Text e um LLM em uma única plataforma de agentes de voz de baixa latência.
O Text to Speech da ElevenLabs oferece suporte a uma ampla variedade de formatos de saída para que você possa integrar áudio a qualquer workflow:
• MP3 - Formato padrão para podcasts, YouTube e escuta em geral.
• WAV / PCM - Áudio sem compressão para trabalho em estúdio, dublagem e pós-produção.
• µ-law - Otimizado para telefonia e integrações de call center.
Você também pode escolher a taxa de amostragem e a taxa de bits pela API para equilibrar qualidade e largura de banda para seu caso de uso específico.
A ElevenLabs leva a segurança de dados a sério e conta com a confiança de grandes clientes empresariais. Nossa conformidade inclui:
• Certificação SOC 2 Type II.
• Certificação ISO 27001.
• Certificação PCI DSS Nível 1.
• Conformidade com a LGPD.
• Workflows qualificados para HIPAA na área da saúde.
Sua entrada de texto não é usada para treinar nossos modelos sem seu consentimento. Clientes empresariais podem ativar o modo de retenção zero para serviços qualificados.*
Os clones de voz são protegidos pela tecnologia AI Speech Classifier, capaz de detectar áudio gerado por IA.
Nos serviços qualificados para ZRM, quando o ZRM está corretamente ativado, determinados tipos de dados não são retidos. Consulte a documentação para ver os detalhes.
Sim. A ElevenLabs oferece várias formas de ajustar como seu texto é falado:
• Tags de áudio (Eleven v3) - Use tags inseridas no texto, como [whispers], [laughs], [excited] ou [sighs], para direcionar a interpretação e a emoção.
• Configurações de voz - Ajuste estabilidade, similaridade e estilo para controlar o quão expressiva ou consistente a voz soa.
• Dicionários de pronúncia - Defina exatamente como nomes de marcas, termos técnicos ou palavras incomuns devem ser pronunciados.
• Suporte a SSML - Use tags da Speech Synthesis Markup Language para controlar com precisão pausas, ênfases e fonemas pela API.
Esses controles permitem transformar texto bruto em narração com qualidade de estúdio sem precisar gravar novamente.
Sim, muitos estudantes usam a ElevenLabs como um instrutor de pronúncia com IA. Como nossas vozes soam como falantes nativos reais em mais de 32 idiomas e dezenas de sotaques regionais, você pode:
• Ouvir como qualquer palavra, frase ou trecho completo soa em outro idioma.
• Comparar sotaques ingleses britânico, americano, australiano, indiano e outros.
• Praticar compreensão auditiva com trechos mais longos de fala natural.
• Gerar áudio para listas de vocabulário, diálogos e exercícios de leitura.
O plano gratuito oferece 10.000 caracteres por mês, suficientes para sessões diárias de prática, e o ElevenReader permite importar artigos e livros para ouvir onde estiver.
A IA de voz da ElevenLabs combina métodos proprietários de compreensão de contexto e alta compressão para produzir falas ultrarrealistas e de alta qualidade em diversas emoções.
Nosso modelo contextual de Text to Speech foi desenvolvido para entender as relações entre as palavras e ajustar a interpretação de acordo. Ele também não tem recursos codificados de forma fixa, o que significa que pode prever dinamicamente milhares de características vocais.
O que diferencia a ElevenLabs de outros provedores de TTS:
• Mais de 11.000 vozes na Voice Library, além de Voice Design e Clonar Voz com IA.
• Geração de baixa latência (~75 ms de inferência do modelo*) com o Flash v2.5, ideal para agentes e apps em tempo real.
• Suporte a mais de 32 idiomas com sotaques de qualidade nativa.
• Modelo Eleven v3 com tags de áudio para emoção, risadas, sussurros e mais.
• A escolha de mais de 100.000 desenvolvedores e grandes clientes empresariais.
Refere-se apenas ao tempo de inferência do modelo. A latência real de ponta a ponta varia conforme fatores como sua localização e o tipo de endpoint usado.
Sim. A ElevenLabs oferece suporte a Text to Speech em mais de 32 idiomas em nossa linha de modelos, com sotaques nativos de alta qualidade em cada um deles.
O Multilingual v2 oferece suporte a 29 idiomas para conteúdo longo da mais alta qualidade. O Flash v2.5 oferece suporte a 32 idiomas com geração de baixa latência para aplicações em tempo real. O Eleven v3 (alpha) também oferece suporte a um amplo conjunto de idiomas com a interpretação mais expressiva e emocional.
Os idiomas incluem inglês, espanhol, francês, alemão, italiano, português, polonês, hindi, japonês, chinês, coreano, árabe, russo, holandês, turco, sueco, indonésio, filipino, ucraniano, grego, tcheco, finlandês, romeno, dinamarquês, búlgaro, malaio, eslovaco, croata, tâmil, norueguês, húngaro e vietnamita.
O Text to Speech da ElevenLabs é grátis para começar. O plano gratuito inclui 10.000 caracteres por mês, cerca de 10 minutos de áudio, acesso a vozes prontas e à API.
Os planos pagos começam com um baixo preço mensal e liberam:
• Mais caracteres por mês, chegando a milhões nos planos mais avançados.
• Direitos de uso comercial para conteúdo monetizado.
• Clonagem profissional de voz para vozes personalizadas hiper-realistas.
• Maior simultaneidade e geração mais rápida para uso em produção.
• Acesso prioritário a novos modelos, como o Eleven v3.
Os planos Enterprise incluem SSO, contratos personalizados, suporte dedicado e modo de retenção zero para serviços qualificados.

.png&w=3840&q=80)

.jpg&w=3840&q=80)

.jpg&w=3840&q=80)


.png&w=3840&q=80)
