Sobre este projeto
it-programming / web-development
Aberto
Busca-se um desenvolvedor para criar uma plataforma de geração de áudio avançada, similar ao Dark Planner, focada na narração de roteiros extensos. O sistema deve permitir que o usuário insira ou importe roteiros em texto e selecione o idioma da narração, inicialmente português brasileiro (pt-br) e inglês americano (en-us). Um dos requisitos mais críticos é a capacidade de cadastrar e gerenciar vozes personalizadas. Isso será feito através do upload de amostras de áudio autorizadas, que o sistema deverá analisar para reproduzir a voz com a maior fidelidade possível, preservando timbre, entonação, ritmo, pronúncia, intensidade e estilo de narração.
A principal prioridade do projeto é garantir a consistência vocal em roteiros longos. A identidade da voz não pode sofrer alterações perceptíveis entre diferentes partes do texto, mesmo que o roteiro precise ser dividido internamente para processamento. A divisão deve ser automática e imperceptível no resultado final.
Funcionalidades essenciais incluem:
- Campo intuitivo para inserir ou importar roteiros em formato de texto.
- Suporte robusto para processamento de textos extensos.
- Opções de seleção de idioma para narração: Português Brasileiro (pt-br) e inglês americano (en-us).
- Um sistema de cadastro e biblioteca para gerenciar vozes, incluindo as personalizadas.
- Funcionalidade de upload de áudio de referência para criação de vozes personalizadas.
- Recurso de prévia da voz antes da geração completa do áudio.
- Capacidade de gerar o roteiro inteiro ou por parágrafos, conforme a necessidade do usuário.
- Exportação de áudios separados, seguindo a numeração ou estrutura do roteiro original.
- Controles ajustáveis de velocidade, estabilidade e expressividade da voz, quando tecnicamente viável.
- Funcionalidade de exportação do áudio final em formatos comuns.
- Interface de usuário simples, rápida, organizada e fácil de usar, garantindo um fluxo de trabalho direto: inserir roteiro, escolher idioma, selecionar voz e gerar áudio.
Este não é um projeto para um Text-to-Speech genérico, mas sim para uma ferramenta profissional de narração de conteúdo longo, com foco em vozes personalizadas autorizadas e alta fidelidade ao áudio de referência, mantendo a mesma identidade vocal de forma contínua.
Categoria TI e Programação
Subcategoria Programação
Qual é o alcance do projeto? Criar um novo site personalizado
Prazo de Entrega: Não estabelecido
Habilidades necessárias