kokoro-tts-mcp logo

kokoro-tts-mcpKokoro Teksti ääneksi (TTS) MCP-palvelin

(0)
Daniel NikulshynArvostellut Daniel Nikulshyn·Päivitetty heinäkuu 2026

Yleiskatsaus

Kokoro Text to Speech (TTS) MCP -palvelin on avoimen lähdekoodin Text-to-Speech-järjestelmä, joka luo .mp3-tiedostoja ja tarjoaa vaihtoehdon lähettää ne S3:en. Se käyttää Hugging Facen tarjoamaa Kokoro-TTS-mallia. Järjestelmä mahdollistaa äänien, nopeuden ja kielen mukauttamisen käyttäjille. Palvelin konfiguroidaan ympäristömuuttujien avulla .env-tiedostossa. Tuettuihin ympäristömuuttujiin kuuluvat AWS-avainparit, S3-vedostiedot ja virhetilamuoto. Palvelinta voidaan suorittaa paikallisesti UV-kirjaston avulla. TTS-asiakasohjelma, joka löytyy mcp_client.py -scriptistä, mahdollistaa TTS-pyynnön lähettämisen palvelimelle. Se tukee useita vaihtoehtoja, kuten tekstin toimittamisen, tiedoston lukemisen, äänen ja nopeuden mukauttamisen sekä S3-latauksen poistamisen. Paikalliset MP3-tiedostot tallennetaan määrättyyn kansioon, ja käyttäjät voivat konfiguroida automaattisen siivous-toiminnon asettamalla säilytyspäivien määrän ja valitsemalla, poistetaanko paikalliset tiedostot onnistuneen S3-latauksen jälkeen.

Pääominaisuudet

  • Teksti-ääneksi-toiminto
  • Mukautettava ääni, nopeus ja kieli
  • S3-latausintegrointi
  • Automaattinen MP3-tiedostojen hallinta
  • Paikallinen palvelin ja asiakasohjelma hallintaan

Hinnat

Malli
Free
Arvio
Ei arvioita

Käyttötapaukset

Sisällön luominen

Luo äänisisältöä tekstistä podcaasteja, äänikirjoja tai sosiaalisen median käyttöä varten mukautettavilla äänillä ja nopeuksilla.

Automaatio

Luo ja lataa MP3-tiedostot automaattisesti S3:en sovellusten tai verkkosivustojen käyttöä varten.

Plussat ja miinukset

Plussat

  • Mukautettavat TTS-äänet ja nopeudet
  • Valinnainen S3-lataus generoiduille MP3-tiedostoille
  • Automaattinen paikallisten MP3-tiedostojen puhdistus

Miinukset

  • Vaatii ympäristömuuttujien ja MCP-asetusten määrittelyn
  • Riippuu lisätyökaluista kuten ffmpeg .wav -> .mp3 -muunnoksessa

Arvostelut

Kirjaudu sisään jättääksesi arvostelun.

Ei arvosteluja. Ole ensimmäinen!

Kysymykset

What are the limitations of running this TTS server locally?

You need to configure several environment variables, install ffmpeg for conversion, and manage local MP3 storage. Automatic cleanup is based on MP3_RETENTION_DAYS, and deleting after upload is optional. The system requires Python, uv, and the Hugging Face model files to be downloaded locally.

Asked by Grzegorz Lewandowski · Feb 9, 2026

How do I customize voice, speed, and language in the TTS output?

Set the environment variables TTS_VOICE, TTS_SPEED, and TTS_LANGUAGE in the .env file or pass them as options when calling mcp_client.py. The server uses the Kokoro‑TTS model from Hugging Face, which supports multiple voices and languages.

Asked by Ines Zeković · Jan 28, 2026

What are the main integrations that Kokoro TTS supports?

The server integrates with Amazon S3 for optional MP3 uploads, requires ffmpeg for converting .wav to .mp3, and can be accessed via a local client script (mcp_client.py) or any HTTP client using the MCP configuration.

Asked by Katarzyna Zielinska · Dec 21, 2025

Is Kokoro TTS MCP Server free to use or is there a licensing cost?

Kokoro TTS MCP Server is open-source and released under a license that allows free use. No subscription or per‑use fees are required, but you must host and maintain the server yourself.

Asked by Camille Laurent · Dec 15, 2025

Kysy kysymys

MCP Palvelimet vaihtoehdot