dumont-talker / config /config.yaml
marcosremar2
Initial commit: dumont-talker speech-to-speech avatar
71e110b
Raw
History Blame
723 Bytes
# dumont-talker Configuration
# Ports
ports:
whisper: 8766
vllm: 8000
musetalk: 3000
# Models
models:
stt:
name: "freds0/distil-whisper-large-v3-ptbr"
path: "models/stt/whisper"
llm:
name: "google/gemma-3-1b-it"
path: "models/llm/gemma"
avatar:
unet: "models/avatar/musetalk"
vae: "models/avatar/vae"
dwpose: "models/avatar/dwpose"
face_parser: "models/avatar/face-parser"
# Server settings
server:
resolution: 256
batch_size: 8
fps: 25
codec: "jpeg"
# TTS settings
tts:
provider: "espeak" # espeak or elevenlabs
voice: "pt-br"
elevenlabs_voice_id: "pNInz6obpgDQGcFmaJgB" # Adam
# Environment
environment:
FFMPEG_PATH: "/usr/bin"
HF_HOME: "/tmp/hf_home"