User Profile — Pointer
> Updated: 2026-07-27
Canais &IDs
| Plataforma | Canal/Thread | Observação |
| --- | --- | --- |
| Discord #unm-mk1-update | 1531278338981630063 | Thread atual — vox/voice testing |
| Discord #hermestexto | 1518008881979195482 | Canal de texto |
Discord #geral (guild 1492133095288209458) | Voice ID: 1492133095875543264 | Canal de voz "Geral" — ÚNICO central |
Guild ID: 1492133095288209458 (Geral server — não é o Rocha Sales server 1492133095288209468)
Bot ID: 1485798532261609663
User Discord ID: 1466486464614371401
Voz — Configuração 2026-07-27
Pipeline Implementado
- - STT: faster-whisper (local, gratuito,
HERMES_LOCAL_STT_LANGUAGE=pt) - - TTS: edge-tts (default), XTTS v2 pendente (voz clone)
- - Gateway Discord:
/voice join|leave|tts|on|off|status - - Auto-join:
HERMES_VOICE_CHANNEL_ID=1492133095875543264(Geral),HERMES_VOICE_AUTOJOIN=true - - Voice mode neste thread:
all(TTS em todas as mensagens quando em call) - - Modelo:
tts_models/multilingual/multi-dataset/xtts_v2 - - Voice sample do usuário:
/root/.hermes/audio_cache/audio_01ec97196377.ogg - - Clone gerado:
/root/.hermes/audio_cache/ultron_riscida_2.ogg— "Cuidado. Eu sempre observo." - - Pendente: integrar como voz default do Ultron
- - Path:
/usr/lib/x86_64-linux-gnu/libopus.so.0 - - Carregar:
discord.opus.load_opus('/usr/lib/x86_64-linux-gnu/libopus.so.0')→is_loaded() = True - - [ ] Integrar XTTS v2 como voz default (substituir edge-tts)
- - [ ] Always-listening em call ( Whisper → LLM → TTS → play)
- - [ ] Sempre-on no "Geral" (auto-join no startup)
- - [ ] wake word opcional ("Ultron")
- - [ ] Comandos por voz
- - Confirma antes de mexer em produção
- - Relatórios: HTML por agente + cliente (formato Roberto Teixeira/ROMALU)
- - Workflow: iterações visuais curtas, aprovação entre cada ajuste
- - Foco: não desviar do escopo pedido
- - Nome: Rocha Sales
- - Discord:
1466486464614371401 - - Canal padrão: Discord #unm-mk1-update thread
1531278338981630063
Fluxo de Voz
1. User envia mensagem de voz no Discord
2. VoiceReceiver captura PCM do Discord
3. faster_whisper transcreve (local, gratuito)
4. Agente responde texto
5. edge-tts gera áudio
6. play_in_voice_channel toca no canal via FFmpegPCMAudio + libopus
7. send_voice envia como mensagem de voz Discord se não estiver em call
XTTS v2 — Clone de Voz
opus Codec
voice_mode Config
`
/root/.hermes/gateway_voice_mode.json
{
"1493717510934233342": "voice_only",
"1492138372876210237": "voice_only",
"1531278338981630063": "all" ← thread atual
}
`