Design de Voz por IA: Crie uma Voz Personalizada a Partir de um Único Comando de Texto
Descreva uma voz em palavras simples e o Voice Design da Fish Audio a gera em cerca de 15 segundos. Crie vozes de personagens personalizadas por IA — gratuito durante o lançamento.
Você precisa de uma voz que ainda não existe. Talvez seja um ajudante robô sarcástico para o seu jogo, um narrador caloroso para o seu documentário ou um locutor de rádio noturno para a introdução do seu podcast. Navegar por bibliotecas de voz faz com que você encontre as mesmas cem vozes que todo mundo está usando, e a clonagem de voz exige que uma pessoa real grave amostras primeiro.
O Voice Design resolve isso de forma diferente. Já disponível na Fish Audio, ele permite criar uma voz de IA totalmente original e personalizada descrevendo-a em texto simples — idade, gênero, sotaque, tom, ritmo, humor — e transforma essa descrição em um modelo de voz utilizável em cerca de 15 segundos. Sem gravações, sem dubladores, sem buscas exaustivas em bibliotecas.
Durante o lançamento, a geração de voz com o Voice Design é completamente gratuita (normalmente 2.000 créditos por geração).
O Que É Design de Voz por IA?
O design de voz por IA é o processo de criação de uma voz sintética original e personalizada a partir de uma descrição escrita, em vez de uma amostra de áudio. Você digita um comando descrevendo como a voz deve soar — for exemplo, "um narrador de meia-idade, caloroso, com a voz levemente rouca e um sotaque americano suave" — e a IA gera uma voz totalmente nova que corresponde a essa descrição, pronta para ser usada em conversão de texto em fala.
Isso torna o design de voz fundamentalmente diferente da clonagem de voz, que replica a voz de uma pessoa existente a partir de gravações. Com o design de voz, a voz que você cria nunca existiu antes — ninguém mais a está usando, em lugar nenhum.
Como Criar Sua Própria Voz de IA com o Voice Design (Passo a Passo)
Quer saber como criar uma voz de IA apenas com uma descrição? Aqui está o fluxo de trabalho completo, do início ao fim. Acesse a página Criar Voz e selecione Voice Design.
Passo 1: Descreva a voz que você deseja
Na caixa de descrição, escreva a voz que você está imaginando. Quanto mais específico, melhor. Cubra estas dimensões:
- Idade e gênero — "uma mulher no final dos 30 anos"
- Sotaque — "sotaque americano suave", "leve sotaque britânico"
- Tom e textura — "rouco", "brilhante", "levemente áspero"
- Ritmo — "relaxado e sem pressa", "rápido e enérgico"
- Humor e contexto — "como se estivessem falando com um único ouvinte em uma sala silenciosa"
Não sabe por onde começar? Use um dos prompts iniciais integrados, como um locutor de rádio noturno caloroso, narrador de documentário ou contador de histórias para crianças — e edite a partir daí.
Você também pode adicionar um texto de visualização opcional (o roteiro que suas amostras falarão) ou deixá-lo em branco e permitir que o sistema escreva uma amostra contextualizada para você. Quando estiver pronto, clique em Gerar Amostras. A geração normalmente custa 2.000 créditos, mas é gratuita durante o lançamento.
Passo 2: Compare duas amostras de voz geradas e escolha uma
O Voice Design gera duas amostras de voz distintas a partir do seu prompt. Reproduza ambas, compare e selecione a que melhor se adapta. Não ficou perfeito? Ajuste sua descrição e clique em Gerar Novas Amostras — iterar não custa nada durante o período de lançamento, então refine até soar exatamente como a voz na sua cabeça.
Passo 3: Salve-a como seu próprio modelo de voz
Clique em Continuar e transforme a amostra escolhida em um modelo de voz reutilizável:
- Nome e capa — dê uma identidade à sua voz
- Tags — gênero, idade, estilo de voz (calorosa, suave, profunda, soprosa...)
- Casos de uso — conversacional, narração, voz de personagem, redes sociais, educacional, anúncio ou entretenimento
Em seguida, escolha quem pode usá-la:
- Público — listada na página de descoberta para que todos possam encontrar e usar
- Não listado — oculta da descoberta, compartilhável via link direto
- Privado — visível apenas para você
Confirme que a voz não personifica uma pessoa real e identificável, clique em Criar Voz e pronto. Sua voz de IA personalizada agora vive em sua biblioteca, pronta para qualquer projeto de conversão de texto em fala — e com as tags em linha de nível de palavra do S2, você pode direcionar exatamente como ela entrega cada fala.
Comece com um prompt inicial → — a geração é gratuita durante o lançamento.
Como Escrever Melhores Prompts de Design de Voz
A qualidade da sua voz depende da qualidade da sua descrição. Aqui está o que diferencia um resultado genérico de um perfeito.
Pegue este prompt inicial:
"Um locutor de rádio noturno caloroso e íntimo, no final dos 30 anos, com uma voz suave e rouca. Ritmo relaxado e sem pressa, com risadas suaves ocasionais, como se estivesse falando com um único ouvinte em uma sala silenciosa."
Veja o que ele faz:
-
Ancoragem de uma persona ("locutor de rádio noturno") — um papel que o modelo pode caracterizar instantaneamente, mais poderoso do que listar dez adjetivos
-
Sobrepõe qualidades vocais concretas ("suave, rouca") — palavras de textura superam palavras vagas como "agradável" ou "boa"
-
Especifica a entrega ("ritmo relaxado e sem pressa, com risadas suaves ocasionais") — o ritmo e as peculiaridades dão vida a uma voz
-
Define o cenário ("falando com um único ouvinte em uma sala silenciosa") — o contexto molda a intimidade e a energia melhor do que qualquer adjetivo isolado
Prompt fraco: "Uma voz feminina, agradável e clara."
Prompt forte: "Uma guia turística alegre na casa dos 20 anos com um sotaque australiano vibrante, ritmo rápido e brincalhão, sempre parecendo estar sorrindo."
Uma persona, três ou quatro detalhes sensoriais, um cenário. Essa é a fórmula.
Um Gerador de Voz de Personagem Criado para Personagens Originais
Se você cria personagens — para jogos, animações, audiolivros, dramas de áudio ou companheiros virtuais — o Voice Design funciona como um gerador de voz de personagem com uma vantagem decisiva: cada voz é original.
As vozes da biblioteca são compartilhadas por milhares de usuários; seu vilão não deve soar como o aplicativo de meditação de outra pessoa. Clonar a voz de uma pessoa real para um personagem fictício levanta questões de consentimento e licenciamento. Uma voz projetada evita ambos — uma voz construída para o seu personagem, sem a imagem de uma pessoa real por trás dela.
Algumas direções de prompt para despertar ideias — do realista ao totalmente fantástico:
- "Um dragão antigo e rouco com uma entrega lenta e estrondosa e uma ameaça teatral"
- "Um inventor adolescente hiperativo, que fala rápido, a voz falha levemente quando está animado"
- "Uma bibliotecária idosa e serena com um tom suave como um sussurro e pausas deliberadas"
- "Um detetive durão na casa dos 50 anos, tom monótono baixo e rouco, cansado do mundo, entrega seca"
- "Um apresentador de programa de culinária entusiasmado com um sotaque italiano forte, barulhento, expressivo, sempre à beira do riso"
- "Uma IA de nave glitchy: plana, precisa, um pouco calma demais, com cadência robótica cortada"
Gere, compare duas amostras, refine, salve — um elenco original completo em uma tarde. Em seguida, coloque-os em uma cena juntos com a conversão de texto em fala multilocutor, ou navegue pelas vozes de personagens de IA que outros criaram para se inspirar.
Voice Design vs. Clonagem de Voz: Qual Você Deve Usar?
A Fish Audio agora oferece três maneiras de criar uma voz, e elas servem para propósitos diferentes:
| Voice Design | Instant Voice Clone | Professional Voice Clone | |
|---|---|---|---|
| Entrada | Uma descrição de texto | ~10s de áudio | Gravações com qualidade de estúdio |
| Tempo | ~15 segundos | ~1 minuto | 1–2 horas |
| Ideal para | Personagens originais e vozes totalmente novas | Replicar rapidamente uma gravação existente | Clone verificado e de nível de estúdio de uma pessoa real |
| A voz já existe? | Não — criada do zero | Sim | Sim — com verificação de propriedade |
A regra de ouro: se a voz ainda não existe, faça o design dela. Se ela existe, clone-a.
Original por design
Há um benefício mais silencioso nas vozes projetadas que vale a pena mencionar: elas não pegam nada emprestado de ninguém. Cada saída do Voice Design é gerada a partir de uma descrição, não de gravações de uma pessoa — e cada voz criada na Fish Audio deve passar por uma confirmação de que não personifica uma pessoa real e identificável. É um fluxo de trabalho projetado para manter seu projeto livre de preocupações com consentimento e imagem.
E quando a voz que você precisa pertence a uma pessoa real — a sua ou a de um dublador — acreditamos que a resposta não é confundir essa linha, mas tornar a propriedade explícita. Dubladores em todo o mundo estão lutando exatamente por isso: consentimento e compensação justa por como suas vozes são usadas na era da IA. Essa é a ideia por trás do nosso novo Professional Voice Clone: um clone verificado e com qualidade de estúdio da voz de uma pessoa real, construído com verificação de propriedade em tempo real, com lançamento comercial opcional e participação na receita para o proprietário da voz. É o início de um acordo mais limpo entre os proprietários de voz e as pessoas que desejam usar suas vozes — mais sobre isso em nossa próxima análise profunda.
Projete Sua Primeira Voz em 15 Segundos
A voz certa costumava significar fazer testes com atores, vasculhar bibliotecas ou se contentar com algo "próximo o suficiente". Agora, significa escrever uma boa frase.
Projete sua primeira voz gratuitamente → — gratuito durante o lançamento.
Perguntas Frequentes
O que é design de voz por IA?
O Voice Design é gratuito?
Qual é a diferença entre design de voz e clonagem de voz?
Posso usar uma voz projetada comercialmente?
Como escrevo um bom prompt de design de voz?
Sabrina is part of Fish Audio's support and marketing team, helping users get the most out of AI voice products while turning launches, updates, and customer insights into clear, practical content.
Leia mais de Sabrina Shu