kokoro-tts-mcp logo

kokoro-tts-mcpKokoro Text to Speech (TTS) MCP Server

(0)
Daniel NikulshynReseñado por Daniel Nikulshyn·Actualizado julio de 2026

Resumen

El servidor Kokoro Text to Speech (TTS) MCP es un sistema de texto a voz de código abierto que genera archivos .mp3 con la opción de subirlos a S3. Utiliza el modelo Kokoro-TTS proporcionado por Hugging Face. El sistema permite a los usuarios personalizar voces, velocidad e idioma. El servidor se configura a través de variables de entorno en el archivo .env. Las variables de entorno compatibles incluyen claves de acceso a AWS, información de bucket de S3 y modo de depuración. El servidor se puede ejecutar localmente utilizando la biblioteca UV. El cliente TTS, que se encuentra en el script mcp_client.py, permite a los usuarios enviar solicitudes TTS al servidor. Soporta varias opciones, como proporcionar texto, leer desde un archivo, personalizar la voz y la velocidad, y desactivar la carga en S3. Los archivos MP3 locales se almacenan en una carpeta especificada, y los usuarios pueden configurar la limpieza automática estableciendo el número de días para conservar los archivos y si eliminar los archivos locales después de una carga exitosa en S3.

Funciones clave

  • Funcionalidad de Text-to-Speech
  • Voz, velocidad e idioma personalizables
  • Integración con S3
  • Gestión automática de archivos MP3
  • Servidor local y script cliente para la gestión

Precio

Modelo
Free
Categoría
Servidores MCP
Valoración
Aún sin reseñas

Casos de uso

Creación de Contenido

Generar contenido de audio a partir de texto para podcasts, audiolibros o redes sociales usando voces y velocidades personalizables.

Automatización

Generar y cargar automáticamente archivos MP3 a S3 para su uso en aplicaciones o sitios web.

Pros y contras

Ventajas

  • Voces y velocidades TTS personalizables
  • Carga opcional a S3 de los archivos MP3 generados
  • Limpieza automática de archivos MP3 locales

Contras

  • Requiere configuración de variables de entorno y ajustes MCP
  • Dependiente de herramientas adicionales como ffmpeg para la conversión de .wav a .mp3

Reseñas

Inicia sesión para dejar una reseña.

Aún sin reseñas. ¡Sé el primero!

Preguntas y respuestas

What are the limitations of running this TTS server locally?

You need to configure several environment variables, install ffmpeg for conversion, and manage local MP3 storage. Automatic cleanup is based on MP3_RETENTION_DAYS, and deleting after upload is optional. The system requires Python, uv, and the Hugging Face model files to be downloaded locally.

Asked by Grzegorz Lewandowski · Feb 9, 2026

How do I customize voice, speed, and language in the TTS output?

Set the environment variables TTS_VOICE, TTS_SPEED, and TTS_LANGUAGE in the .env file or pass them as options when calling mcp_client.py. The server uses the Kokoro‑TTS model from Hugging Face, which supports multiple voices and languages.

Asked by Ines Zeković · Jan 28, 2026

What are the main integrations that Kokoro TTS supports?

The server integrates with Amazon S3 for optional MP3 uploads, requires ffmpeg for converting .wav to .mp3, and can be accessed via a local client script (mcp_client.py) or any HTTP client using the MCP configuration.

Asked by Katarzyna Zielinska · Dec 21, 2025

Is Kokoro TTS MCP Server free to use or is there a licensing cost?

Kokoro TTS MCP Server is open-source and released under a license that allows free use. No subscription or per‑use fees are required, but you must host and maintain the server yourself.

Asked by Camille Laurent · Dec 15, 2025

Hacer una pregunta

Alternativas a Servidores MCP