docker-talkies

psyb0t/docker-talkies
★ 4 stars Python AI/LLM Updated today
OpenAI-compatible audio server in Docker. 7 ASR backends (Whisper, Distil-Whisper, Parakeet, Canary, Canary-Qwen) + 2 TTS engines (Kokoro, Qwen3-TTS voice cloning). Single /v1/audio/{transcriptions,speech,voices} surface. CPU + CUDA images. Hot model swap. MCP server built in.
View on GitHub → 🔍 Audit Wallet Slippage →

Quick Install

Copy the config for your editor. Some servers may need additional setup — check the README.

Add to claude_desktop_config.json:

{
  "mcpServers": {
    "docker-talkies": {
      "command": "uvx",
      "args": [
        "docker-talkies"
      ]
    }
  }
}

Or install with pip: pip install docker-talkies

README Excerpt

> **Self-hosted, OpenAI-compatible speech server.** 7 ASR backends, 2 TTS engines, voice cloning, MCP — one Docker container, one wire format. ```python from openai import OpenAI c = OpenAI(base_url="http://localhost:8000/v1", api_key="x") c.audio.transcriptions.create(model="whisper-large-v3-turbo", file=open("a.mp3", "rb"))

Tools (20)

AidenDylanEricHF_HUB_OFFLINEOno_AnnaRyanSerenaSoheeTALKIES_AUTH_TOKENTALKIES_BLOCK_PRIVATE_DOWNLOADSTALKIES_DATA_DIRTALKIES_DEVICETALKIES_ENABLED_MODELSTALKIES_LOAD_TIMEOUTTALKIES_MAX_DOWNLOAD_BYTESTALKIES_MAX_UPLOAD_BYTESTALKIES_MODELS_FILETALKIES_MODEL_TTLTALKIES_PRELOADTALKIES_READY_TIMEOUT

Topics

asraudio-processingcanarydiarizationdockerkokoromcpmodel-context-protocolnemoopenai-apiparakeetqwen3self-hostedspeech-recognitionspeech-to-text