Ir para
  • -1

Vsl com voz robótica converte?


Vins

Posts Recomendados

  • 0

Faz isso não, mano!

 

O tom de emoções mais orgânicas é essencial pra fazer o seu VSL converter, posso te ajudar com isso, mesmo se não tiver tanta verba.

 

Aliás, eu tenho experiência com atuação, e estou pensando em começar a fazer locução para VSLs, se quiser fechar um orçamento comigo, faço um preço BEM em conta, já que estou no início, qualquer coisa, só me chamar https://wa.me/5548996343779

 

Já é melhor do que a voz robótica né...

 

Acredito que podemos chegar em um negócio que sirva para ambas as partes.


Link para o comentário
  • 0
31 minutos atrás, Stefan Georgi disse:

 

Oi meus amigos ratos 🙂 Não tenho certeza sobre VSLs de forma longa. Posso dizer que exibir mini VSLs como anúncios em lugares como o YouTube funciona incrivelmente bem. Conheço cerca de 8 dígitos + agências onde mais de 70% dos anúncios veiculados são com imagens de estoque + uma voz robótica de IA lendo o script.

É um prazer ter você conosco. Seria incrível se você pudesse fazer algum post para compartilhar um pouco do seu conhecimento 🥹

Link para o comentário
  • 0
Agora, Hot dog seller disse:

Já postou contéudo sobre esse jeito certo?

Já postei sobre a ferramenta (link abaixo), sobre o jeito certo é teste. Para essa ferramenta específica, tente não usar o "?", sei que é difícil em uma VSL, mas infelizmente essas vozes neurais do Azure (em específico) não fazem muito bem a dicção do interrogação. Porém, se pesquisar bem, tenho certeza que existem ferramentas pagas para isso com mais realidade.

 

Estou para testar em breve a Polly, text-to-speech da Amazon, ai faço um post sobre: https://aws.amazon.com/pt/polly/pricing/?p=ft&c=ml&z=3

Natural Readers é muito bom também, porém pago: https://www.naturalreaders.com/online/

 

Obviamente contratar um narrado é MIL VEZES MELHOR, mas para quem não tem muito caixa para isso e está validando a oferta, é uma boa opção.

 

 


Link para o comentário
  • 0

A questão dos pontos de interrogação e da falta de emoção, pode ser contornada!

Neste link, tem como utilizar o potencial máximo da ferramenta e que é totalmente acessível criar ali no modo gratuito, usando a aba SSML

https://docs.microsoft.com/pt-br/azure/cognitive-services/speech-service/speech-synthesis-markup?tabs=csharp

Pode-se criar inclusive uma conversa, usando mais de um tipo de voz, para tornar o VSL ainda mais com cara voz real!

Tenta copiar e colar esse exemplo lá:

<speak version="1.0" xmlns="http://www.w3.org/2001/10/synthesis" xml:lang="en-US">
    <voice name="en-US-JennyNeural">
        Good morning!
    </voice>
    <voice name="en-US-ChristopherNeural">
        Good morning to you too Jenny!
    </voice>
</speak>

 

Olha a quantidade de emoções que podem ser utilizadas e realmente tem uma alteração bem visível na forma que o audio é feito:

Troque o "cherful" por qualquer outro da tabela abaixo e veja a diferença!

<speak version="1.0" xmlns="http://www.w3.org/2001/10/synthesis"
       xmlns:mstts="https://www.w3.org/2001/mstts" xml:lang="en-US">
    <voice name="en-US-JennyNeural">
        <mstts:express-as style="cheerful">
            That'd be just amazing!
        </mstts:express-as>
    </voice>
</speak>

 

Estilo Descrição
style="advertisement-upbeat" Expressa um tom animado e de alta energia para promover um produto ou serviço.
style="affectionate" Expressa um tom cordial e afetuoso, com timbre mais alto e mais energia vocal. O locutor está em um estado de atrair a atenção do ouvinte. Em geral, a personalidade do locutor é afetuosa por natureza.
style="angry" Expressa um tom irritado e incomodado.
style="assistant" Expressa um tom cordial e descontraído para assistentes digitais.
style="calm" Expressa uma atitude calma, ponderada e serena durante a fala. O tom, o timbre e a prosódia são muito mais uniformes em comparação com outros tipos de fala.
style="chat" Expressa um tom casual e descontraído.
style="cheerful" Expressa um tom positivo e alegre.
style="customerservice" Expressa um tom amig��vel e prestativo para atendimento ao cliente.
style="depressed" Expressa um tom melancólico e desanimado com um timbre mais baixo e menos energia.
style="disgruntled" Expressa um tom de desprezo e reclamação. A fala dessa emoção exibe o desgosto e o menosprezo.
style="embarrassed" Expressa um tom incerto e hesitante quando o locutor se sente constrangido.
style="empathetic" Expressa um senso de preocupação e compreensão.
style="envious" Expressa um tom de moderação quando desejar algo que outra pessoa tenha.
style="excited" Expressa um tom otimista e esperançoso. Parece que algo ótimo está acontecendo e o orador está muito feliz com isso.
style="fearful" Expressa um tom de medo e nervosismo, com timbre mais alto, mais energia vocal e uma velocidade mais alta. O locutor está em um estado de tensão e desconforto.
style="friendly" Expressa um tom agradável, convidativo e caloroso. Parece sincero e carinhoso.
style="gentle" Expressa um tom moderado, educado e agradável, com timbre mais baixo e menos energia vocal.
style="hopeful" Expressa um tom caloroso e ansioso. Parece que algo de bom vai acontecer com o orador.
style="lyrical" Expressa emoções de uma forma melódica e sentimental.
style="narration-professional" Expressa um tom profissional e objetivo para leitura de conteúdo.
style="narration-relaxed" Expresse um tom suave e melodioso para leitura de conteúdo.
style="newscast" Expressa um tom formal e profissional para narração de notícias.
style="newscast-casual" Expressa um tom versátil e casual para entrega de notícias em geral.
style="newscast-formal" Expressa um tom formal, confiável e autoritativo para entrega de notícias.
style="poetry-reading" Expressa um tom emocional e rítmico enquanto lê um poema.
style="sad" Expressa um tom triste.
style="serious" Expressa um tom rígido e autoritário. Em geral, o locutor parece mais rígido e muito menos descontraído com uma cadência firme.
style="shouting" Fala como de muito distante ou de fora e para fazer-se ser claramente ouvido
style="sports-commentary" Expressa um tom descontraído e interessante para transmitir um evento esportivo.
style="sports-commentary-excited" Expressa um tom intensivo e enérgico para transmitir momentos emocionantes em um evento esportivo.
style="whispering" Fala muito suavemente e faz um som silencioso e gentil
style="terrified" Expressa um tom muito assustado, com ritmo mais rápido e uma voz mais trêmula. Parece que o locutor está em um status instável e frenético.
style="unfriendly" Expressa um tom frio e indiferente.
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
18 minutos atrás, Fogaça disse:

 

 

Já postei sobre a ferramenta (link abaixo), sobre o jeito certo é teste. Para essa ferramenta específica, tente não usar o "?", sei que é difícil em uma VSL, mas infelizmente essas vozes neurais do Azure (em específico) não fazem muito bem a dicção do interrogação. Porém, se pesquisar bem, tenho certeza que existem ferramentas pagas para isso com mais realidade.

 

Estou para testar em breve a Polly, text-to-speech da Amazon, ai faço um post sobre: https://aws.amazon.com/pt/polly/pricing/?p=ft&c=ml&z=3

Natural Readers é muito bom também, porém pago: https://www.naturalreaders.com/online/

 

Obviamente contratar um narrado é MIL VEZES MELHOR, mas para quem não tem muito caixa para isso e está validando a oferta, é uma boa opção.

 

 

 

 

 

 

Link para o comentário
  • 0
1 hora atrás, Stefan Georgi disse:

 

Oi meus amigos ratos 🙂 Não tenho certeza sobre VSLs de forma longa. Posso dizer que exibir mini VSLs como anúncios em lugares como o YouTube funciona incrivelmente bem. Conheço cerca de 8 dígitos + agências onde mais de 70% dos anúncios veiculados são com imagens de estoque + uma voz robótica de IA lendo o script.

Stefan, queria te agradecer por tirar varios brasileiros da extrema pobreza e da amazonia!!!

Voce é responsavel por um dos scripts mais famosos do marketing digital brasileiros

nós te amamos.

Link para o comentário
  • 0
16 minutos atrás, Elon M- selfie neide disse:

Stefan, queria te agradecer por tirar varios brasileiros da extrema pobreza e da amazonia!!!

Voce é responsavel por um dos scripts mais famosos do marketing digital brasileiros

nós te amamos.

Que script é esse mano, já percebi que o Stefan é foda mas não conheço o trabalho dele, poderia compartilha-lo conosco?

Link para o comentário
  • 0
2 horas atrás, Tio da Sukita disse:

A questão dos pontos de interrogação e da falta de emoção, pode ser contornada!

Neste link, tem como utilizar o potencial máximo da ferramenta e que é totalmente acessível criar ali no modo gratuito, usando a aba SSML

https://docs.microsoft.com/pt-br/azure/cognitive-services/speech-service/speech-synthesis-markup?tabs=csharp

Pode-se criar inclusive uma conversa, usando mais de um tipo de voz, para tornar o VSL ainda mais com cara voz real!

Tenta copiar e colar esse exemplo lá:

<speak version="1.0" xmlns="http://www.w3.org/2001/10/synthesis" xml:lang="en-US">
    <voice name="en-US-JennyNeural">
        Good morning!
    </voice>
    <voice name="en-US-ChristopherNeural">
        Good morning to you too Jenny!
    </voice>
</speak>

 

Olha a quantidade de emoções que podem ser utilizadas e realmente tem uma alteração bem visível na forma que o audio é feito:

Troque o "cherful" por qualquer outro da tabela abaixo e veja a diferença!

<speak version="1.0" xmlns="http://www.w3.org/2001/10/synthesis"
       xmlns:mstts="https://www.w3.org/2001/mstts" xml:lang="en-US">
    <voice name="en-US-JennyNeural">
        <mstts:express-as style="cheerful">
            That'd be just amazing!
        </mstts:express-as>
    </voice>
</speak>

 

Estilo Descrição
style="advertisement-upbeat" Expressa um tom animado e de alta energia para promover um produto ou serviço.
style="affectionate" Expressa um tom cordial e afetuoso, com timbre mais alto e mais energia vocal. O locutor está em um estado de atrair a atenção do ouvinte. Em geral, a personalidade do locutor é afetuosa por natureza.
style="angry" Expressa um tom irritado e incomodado.
style="assistant" Expressa um tom cordial e descontraído para assistentes digitais.
style="calm" Expressa uma atitude calma, ponderada e serena durante a fala. O tom, o timbre e a prosódia são muito mais uniformes em comparação com outros tipos de fala.
style="chat" Expressa um tom casual e descontraído.
style="cheerful" Expressa um tom positivo e alegre.
style="customerservice" Expressa um tom amigável e prestativo para atendimento ao cliente.
style="depressed" Expressa um tom melancólico e desanimado com um timbre mais baixo e menos energia.
style="disgruntled" Expressa um tom de desprezo e reclamação. A fala dessa emoção exibe o desgosto e o menosprezo.
style="embarrassed" Expressa um tom incerto e hesitante quando o locutor se sente constrangido.
style="empathetic" Expressa um senso de preocupação e compreensão.
style="envious" Expressa um tom de moderação quando desejar algo que outra pessoa tenha.
style="excited" Expressa um tom otimista e esperançoso. Parece que algo ótimo está acontecendo e o orador está muito feliz com isso.
style="fearful" Expressa um tom de medo e nervosismo, com timbre mais alto, mais energia vocal e uma velocidade mais alta. O locutor está em um estado de tensão e desconforto.
style="friendly" Expressa um tom agradável, convidativo e caloroso. Parece sincero e carinhoso.
style="gentle" Expressa um tom moderado, educado e agradável, com timbre mais baixo e menos energia vocal.
style="hopeful" Expressa um tom caloroso e ansioso. Parece que algo de bom vai acontecer com o orador.
style="lyrical" Expressa emoções de uma forma melódica e sentimental.
style="narration-professional" Expressa um tom profissional e objetivo para leitura de conteúdo.
style="narration-relaxed" Expresse um tom suave e melodioso para leitura de conteúdo.
style="newscast" Expressa um tom formal e profissional para narração de notícias.
style="newscast-casual" Expressa um tom versátil e casual para entrega de notícias em geral.
style="newscast-formal" Expressa um tom formal, confiável e autoritativo para entrega de notícias.
style="poetry-reading" Expressa um tom emocional e rítmico enquanto lê um poema.
style="sad" Expressa um tom triste.
style="serious" Expressa um tom rígido e autoritário. Em geral, o locutor parece mais rígido e muito menos descontraído com uma cadência firme.
style="shouting" Fala como de muito distante ou de fora e para fazer-se ser claramente ouvido
style="sports-commentary" Expressa um tom descontraído e interessante para transmitir um evento esportivo.
style="sports-commentary-excited" Expressa um tom intensivo e enérgico para transmitir momentos emocionantes em um evento esportivo.
style="whispering" Fala muito suavemente e faz um som silencioso e gentil
style="terrified" Expressa um tom muito assustado, com ritmo mais rápido e uma voz mais trêmula. Parece que o locutor está em um status instável e frenético.
style="unfriendly" Expressa um tom frio e indiferente.
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   

 

 

 

 

Sim, existe essa função, porém na prática não funciona. Já tentei utilizar esses scripts, não muda absolutamente nada. Tenho conta criada lá, fiz todos os procedimentos, mas para narrações brasileiras, não existe diferença.

 

Outro idioma sim, mas as vozes neurais do Brasil, pelo menos nos testes que fiz, não mudaram absolutamente nada.


Link para o comentário
  • 0
3 horas atrás, Tio da Sukita disse:

A questão dos pontos de interrogação e da falta de emoção, pode ser contornada!

Neste link, tem como utilizar o potencial máximo da ferramenta e que é totalmente acessível criar ali no modo gratuito, usando a aba SSML

https://docs.microsoft.com/pt-br/azure/cognitive-services/speech-service/speech-synthesis-markup?tabs=csharp

Pode-se criar inclusive uma conversa, usando mais de um tipo de voz, para tornar o VSL ainda mais com cara voz real!

Tenta copiar e colar esse exemplo lá:

<speak version="1.0" xmlns="http://www.w3.org/2001/10/synthesis" xml:lang="en-US">
    <voice name="en-US-JennyNeural">
        Good morning!
    </voice>
    <voice name="en-US-ChristopherNeural">
        Good morning to you too Jenny!
    </voice>
</speak>

 

Olha a quantidade de emoções que podem ser utilizadas e realmente tem uma alteração bem visível na forma que o audio é feito:

Troque o "cherful" por qualquer outro da tabela abaixo e veja a diferença!

<speak version="1.0" xmlns="http://www.w3.org/2001/10/synthesis"
       xmlns:mstts="https://www.w3.org/2001/mstts" xml:lang="en-US">
    <voice name="en-US-JennyNeural">
        <mstts:express-as style="cheerful">
            That'd be just amazing!
        </mstts:express-as>
    </voice>
</speak>

 

Estilo Descrição
style="advertisement-upbeat" Expressa um tom animado e de alta energia para promover um produto ou serviço.
style="affectionate" Expressa um tom cordial e afetuoso, com timbre mais alto e mais energia vocal. O locutor está em um estado de atrair a atenção do ouvinte. Em geral, a personalidade do locutor é afetuosa por natureza.
style="angry" Expressa um tom irritado e incomodado.
style="assistant" Expressa um tom cordial e descontraído para assistentes digitais.
style="calm" Expressa uma atitude calma, ponderada e serena durante a fala. O tom, o timbre e a prosódia são muito mais uniformes em comparação com outros tipos de fala.
style="chat" Expressa um tom casual e descontraído.
style="cheerful" Expressa um tom positivo e alegre.
style="customerservice" Expressa um tom amigável e prestativo para atendimento ao cliente.
style="depressed" Expressa um tom melancólico e desanimado com um timbre mais baixo e menos energia.
style="disgruntled" Expressa um tom de desprezo e reclamação. A fala dessa emoção exibe o desgosto e o menosprezo.
style="embarrassed" Expressa um tom incerto e hesitante quando o locutor se sente constrangido.
style="empathetic" Expressa um senso de preocupação e compreensão.
style="envious" Expressa um tom de moderação quando desejar algo que outra pessoa tenha.
style="excited" Expressa um tom otimista e esperançoso. Parece que algo ótimo está acontecendo e o orador está muito feliz com isso.
style="fearful" Expressa um tom de medo e nervosismo, com timbre mais alto, mais energia vocal e uma velocidade mais alta. O locutor está em um estado de tensão e desconforto.
style="friendly" Expressa um tom agradável, convidativo e caloroso. Parece sincero e carinhoso.
style="gentle" Expressa um tom moderado, educado e agradável, com timbre mais baixo e menos energia vocal.
style="hopeful" Expressa um tom caloroso e ansioso. Parece que algo de bom vai acontecer com o orador.
style="lyrical" Expressa emoções de uma forma melódica e sentimental.
style="narration-professional" Expressa um tom profissional e objetivo para leitura de conteúdo.
style="narration-relaxed" Expresse um tom suave e melodioso para leitura de conteúdo.
style="newscast" Expressa um tom formal e profissional para narração de notícias.
style="newscast-casual" Expressa um tom versátil e casual para entrega de notícias em geral.
style="newscast-formal" Expressa um tom formal, confiável e autoritativo para entrega de notícias.
style="poetry-reading" Expressa um tom emocional e rítmico enquanto lê um poema.
style="sad" Expressa um tom triste.
style="serious" Expressa um tom rígido e autoritário. Em geral, o locutor parece mais rígido e muito menos descontraído com uma cadência firme.
style="shouting" Fala como de muito distante ou de fora e para fazer-se ser claramente ouvido
style="sports-commentary" Expressa um tom descontraído e interessante para transmitir um evento esportivo.
style="sports-commentary-excited" Expressa um tom intensivo e enérgico para transmitir momentos emocionantes em um evento esportivo.
style="whispering" Fala muito suavemente e faz um som silencioso e gentil
style="terrified" Expressa um tom muito assustado, com ritmo mais rápido e uma voz mais trêmula. Parece que o locutor está em um status instável e frenético.
style="unfriendly" Expressa um tom frio e indiferente.
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   
   

 

 

 

 

SSML não tem suporte para as vozes em português.

Link para o comentário
  • 0

falando por experiência própria a narração não faz essa diferença toda q a guruzada fala pra vender os cursinhos deles, o q importa de vdd é a copy, já vendi multiplos 5 digitos em emagrecimento q dizem ser sofisticado com narração do azure, coisa de 1/2k dia sem pagar narrador nenhum, sem VSL cinematográfica, era fundo branco, letra preta, um ou outro vídeo no meio e um pouco mais de vídeos na lead só e chegou a vender mais de 1k no dia gastando 150 conto em ads, nem narração nem edição muda tanto assim, testei mesma coisa em renda extra e tbm deu certo

Link para o comentário
  • 0
9 minutos atrás, Cristihano Morais disse:

falando por experiência própria a narração não faz essa diferença toda q a guruzada fala pra vender os cursinhos deles, o q importa de vdd é a copy, já vendi multiplos 5 digitos em emagrecimento q dizem ser sofisticado com narração do azure, coisa de 1/2k dia sem pagar narrador nenhum, sem VSL cinematográfica, era fundo branco, letra preta, um ou outro vídeo no meio e um pouco mais de vídeos na lead só e chegou a vender mais de 1k no dia gastando 150 conto em ads, nem narração nem edição muda tanto assim, testei mesma coisa em renda extra e tbm deu certo

Isso ai, você pode ter uma VSL cinematográfica com narração profissional.

 

Se sua copy for ruim, o lead vai fechar a página. Simples assim.


Link para o comentário
  • 0
8 horas atrás, Stefan Georgi disse:

 

Oi meus amigos ratos 🙂 Não tenho certeza sobre VSLs de forma longa. Posso dizer que exibir mini VSLs como anúncios em lugares como o YouTube funciona incrivelmente bem. Conheço cerca de 8 dígitos + agências onde mais de 70% dos anúncios veiculados são com imagens de estoque + uma voz robótica de IA lendo o script.

 

Stefan quebrou com categoria os 3 primeiros comentários!  🤣❤️

7 horas atrás, Fogaça disse:

Mas tem o jeito certo de fazer.

Qual o jeito certo?

Link para o comentário
  • 0
4 minutos atrás, Maurício disse:

 

Stefan quebrou com categoria os 3 primeiros comentários!  🤣❤️

Qual o jeito certo?

Citei um pouco aqui.

7 horas atrás, Fogaça disse:

Já postei sobre a ferramenta (link abaixo), sobre o jeito certo é teste. Para essa ferramenta específica, tente não usar o "?", sei que é difícil em uma VSL, mas infelizmente essas vozes neurais do Azure (em específico) não fazem muito bem a dicção do interrogação. Porém, se pesquisar bem, tenho certeza que existem ferramentas pagas para isso com mais realidade.

 

Estou para testar em breve a Polly, text-to-speech da Amazon, ai faço um post sobre: https://aws.amazon.com/pt/polly/pricing/?p=ft&c=ml&z=3

Natural Readers é muito bom também, porém pago: https://www.naturalreaders.com/online/

 

Obviamente contratar um narrado é MIL VEZES MELHOR, mas para quem não tem muito caixa para isso e está validando a oferta, é uma boa opção.

 

 

Porém, outra dica que dou é a seguinte...

 

Quebra de linhas, virgulas, ponto de exclamação e 3 pontos > ...

 

Leve isso em consideração na hora de pedir para o robô falar sua copy.

 

Coloque a vírgula no lugar certo, use exclamação quando necessário e 3 pontos também

 

E sempre que tiver uma pausa (entre um slide e outro) use a quebra de linha, se colocar tudo junto a fala fica desconexa com o slide.


Link para o comentário
Atenção: Este conteúdo tem mais de 6 meses desde que foi postado. Verifique se o método ensinado nele ainda é válido para os dias atuais.
Infelizmente, seu conteúdo contém termos que não permitimos. Caso esteja tentando publicar seu número de WhatsApp, lembre-se que isso é proibido expor no Fórum.
Responder esta pergunta...

×   Você colou conteúdo com formatação.   Remover formatação

  Apenas 75 emojis são permitidos.

×   Seu link foi automaticamente incorporado.   Mostrar como link

×   Seu conteúdo anterior foi restaurado.   Limpar o editor

×   Não é possível colar imagens diretamente. Carregar ou inserir imagens do URL.

Processando...
×
×