Texto que sai como voz.
As vozes neurais do edge-tts falam por você; se elas não responderem, o gTTS assume sem aviso. Cada frase fica salva em cache, então repetir é instantâneo — e funciona sem internet a partir da segunda vez.
SOUNDBOARD · WINDOWS · CÓDIGO ABERTO
Escreva uma frase e ela sai como voz na chamada. Toque um MP3 que já é seu. Ou escolha uma janela aberta e mande junto o áudio daquele programa — só dele, sem levar o resto do computador.
Ou copie e cole:
pip install -e .A janela, aqui do navegador — Clique nas abas — é assim que o programa abre.
SAÍDA (VIRA SEU MICROFONE)
CABLE Input (VB-Audio Virtual Cable)
MONITOR (VOCÊ OUVE)
Fones de ouvido
Aqui no site quem fala é a voz do seu navegador, só para você sentir o fluxo. No programa a voz é neural e cada frase fica em cache depois da primeira vez.
edge-tts · pt-BR-FranciscaNeural
5
dependências, nenhuma pesada
157
testes automatizados
0
ffmpeg, zero arquivo temporário
3.10+
Python, do 3.10 em diante
[ TRÊS ABAS ]
As duas saídas escolhidas lá em cima — o cabo virtual que vira microfone e o fone onde você se ouve — valem para as três abas ao mesmo tempo.
As vozes neurais do edge-tts falam por você; se elas não responderem, o gTTS assume sem aviso. Cada frase fica salva em cache, então repetir é instantâneo — e funciona sem internet a partir da segunda vez.
Aponte uma pasta e os áudios aparecem na lista, prontos para disparar por clique ou pelas teclas 1 a 9. MP3, WAV, OGG, FLAC, OPUS e AIFF, decodificados direto da memória.
Escolha o Brave, o Spotify, o que estiver tocando. O Yummi captura o áudio daquele processo e da árvore de filhos dele, e reaplica ao vivo na saída — notificação do Discord e som de jogo não entram junto.
[ COMO A PONTE FUNCIONA ]
A captura acontece antes de o som chegar aos seus alto-falantes, e é filtrada por processo. Por isso dá para mandar o vídeo que está tocando no navegador sem mandar a sua própria voz, o som do jogo ou o alerta que apareceu no meio.
Requer Windows 10 build 20348 ou mais novo. Qualquer Windows 11 serve.
brave.exe
a janela escolhida
Yummi
captura só esse processo
CABLE Input
o cabo virtual
Discord
ouve como microfone
A mesma saída ainda toca no seu fone, então você acompanha o que está mandando. Se em vez de uma janela você escolher uma entrada de áudio — a mixagem estéreo, por exemplo — o Yummi recusa as saídas que criariam realimentação e explica na tela por que aquela ficou de fora.
[ TECLADO ]
Os atalhos valem com a janela em foco. Os globais, para disparar com o Yummi minimizado, estão prontos no código e desligados por padrão — basta instalar o pynput e ligar uma chave no config.json.
[ VERSÃO 3.0.0 · MIT ]
Quatro comandos e o Yummi está aberto. O cabo virtual é opcional: sem ele o som fica entre você e o fone.
git clone https://github.com/ayunaangel/Yummi_text-to-speech.gitcd Yummi_text-to-speechpip install -e .yummi