kokoro-tts-mcp logo

kokoro-tts-mcpServidor Kokoro Text to Speech (TTS) MCP

(0)
Daniel NikulshynAvaliado por Daniel Nikulshyn·Atualizado julho de 2026

Visão geral

O Kokoro Text to Speech (TTS) MCP Server é um sistema de conversão de texto em fala de código aberto que gera arquivos .mp3 com a opção de fazer upload para S3. Ele usa o modelo Kokoro-TTS fornecido pelo Hugging Face. O sistema permite aos usuários personalizar vozes, velocidade e idioma. O servidor é configurado por meio de variáveis de ambiente no arquivo .env. As variáveis de ambiente suportadas incluem chaves de acesso da AWS, informações do bucket S3 e modo de depuração. O servidor pode ser executado localmente usando a biblioteca UV. O cliente TTS, encontrado no script mcp_client.py, permite aos usuários enviar solicitações TTS ao servidor. Ele suporta várias opções, como fornecer texto, ler de um arquivo, personalizar voz e velocidade e desativar o upload para S3. Os arquivos MP3 locais são armazenados em uma pasta especificada e os usuários podem configurar a limpeza automática definindo o número de dias para reter arquivos e se excluir arquivos locais após o upload bem-sucedido para S3.

Funcionalidades principais

  • Funcionalidade de conversão de texto em fala
  • Voz, velocidade e idioma personalizáveis
  • Integração com upload para S3
  • Gerenciamento automático de arquivos MP3
  • Servidor local e script de cliente para gerenciamento

Preços

Modelo
Free
Avaliação
Ainda sem avaliações

Casos de uso

Criação de Conteúdo

Gerar conteúdo de áudio a partir de texto para podcasts, audiolivros ou mídia social usando vozes e velocidades personalizáveis.

Automação

Gerar e fazer upload automaticamente de arquivos MP3 para S3 para uso em aplicativos ou sites.

Prós e contras

Prós

  • Vozes e velocidades TTS personalizáveis
  • Upload opcional para S3 de arquivos MP3 gerados
  • Limpeza automática de arquivos MP3 locais

Contras

  • Requer configuração de variáveis de ambiente e configurações MCP
  • Dependente de ferramentas adicionais como ffmpeg para conversão de .wav para .mp3

Avaliações

Entra para deixar uma avaliação.

Ainda sem avaliações. Sê o primeiro!

Perguntas e respostas

What are the limitations of running this TTS server locally?

You need to configure several environment variables, install ffmpeg for conversion, and manage local MP3 storage. Automatic cleanup is based on MP3_RETENTION_DAYS, and deleting after upload is optional. The system requires Python, uv, and the Hugging Face model files to be downloaded locally.

Asked by Grzegorz Lewandowski · Feb 9, 2026

How do I customize voice, speed, and language in the TTS output?

Set the environment variables TTS_VOICE, TTS_SPEED, and TTS_LANGUAGE in the .env file or pass them as options when calling mcp_client.py. The server uses the Kokoro‑TTS model from Hugging Face, which supports multiple voices and languages.

Asked by Ines Zeković · Jan 28, 2026

What are the main integrations that Kokoro TTS supports?

The server integrates with Amazon S3 for optional MP3 uploads, requires ffmpeg for converting .wav to .mp3, and can be accessed via a local client script (mcp_client.py) or any HTTP client using the MCP configuration.

Asked by Katarzyna Zielinska · Dec 21, 2025

Is Kokoro TTS MCP Server free to use or is there a licensing cost?

Kokoro TTS MCP Server is open-source and released under a license that allows free use. No subscription or per‑use fees are required, but you must host and maintain the server yourself.

Asked by Camille Laurent · Dec 15, 2025

Faz uma pergunta

Alternativas a Servidores MCP