Realizado

Desenvolvimento de Plataforma de Geração de Áudio com Vozes Personalizadas para Narração de Roteiros

Publicado em 20 de Setembro de 2026 dias na TI e Programação

Sobre este projeto

Aberto

Busca-se um desenvolvedor para criar uma plataforma de geração de áudio avançada, similar ao Dark Planner, focada na narração de roteiros extensos. O sistema deve permitir que o usuário insira ou importe roteiros em texto e selecione o idioma da narração, inicialmente português brasileiro (pt-br) e inglês americano (en-us). Um dos requisitos mais críticos é a capacidade de cadastrar e gerenciar vozes personalizadas. Isso será feito através do upload de amostras de áudio autorizadas, que o sistema deverá analisar para reproduzir a voz com a maior fidelidade possível, preservando timbre, entonação, ritmo, pronúncia, intensidade e estilo de narração.

A principal prioridade do projeto é garantir a consistência vocal em roteiros longos. A identidade da voz não pode sofrer alterações perceptíveis entre diferentes partes do texto, mesmo que o roteiro precise ser dividido internamente para processamento. A divisão deve ser automática e imperceptível no resultado final.

Funcionalidades essenciais incluem:
- Campo intuitivo para inserir ou importar roteiros em formato de texto.
- Suporte robusto para processamento de textos extensos.
- Opções de seleção de idioma para narração: Português Brasileiro (pt-br) e inglês americano (en-us).
- Um sistema de cadastro e biblioteca para gerenciar vozes, incluindo as personalizadas.
- Funcionalidade de upload de áudio de referência para criação de vozes personalizadas.
- Recurso de prévia da voz antes da geração completa do áudio.
- Capacidade de gerar o roteiro inteiro ou por parágrafos, conforme a necessidade do usuário.
- Exportação de áudios separados, seguindo a numeração ou estrutura do roteiro original.
- Controles ajustáveis de velocidade, estabilidade e expressividade da voz, quando tecnicamente viável.
- Funcionalidade de exportação do áudio final em formatos comuns.
- Interface de usuário simples, rápida, organizada e fácil de usar, garantindo um fluxo de trabalho direto: inserir roteiro, escolher idioma, selecionar voz e gerar áudio.

Este não é um projeto para um Text-to-Speech genérico, mas sim para uma ferramenta profissional de narração de conteúdo longo, com foco em vozes personalizadas autorizadas e alta fidelidade ao áudio de referência, mantendo a mesma identidade vocal de forma contínua.

Categoria TI e Programação
Subcategoria Programação
Qual é o alcance do projeto? Criar um novo site personalizado

Prazo de Entrega: Não estabelecido

Habilidades necessárias

Outro projetos publicados por D.