Ir para o conteúdo
Yummi

SOUNDBOARD · WINDOWS · CÓDIGO ABERTO

Você digita.
Seu microfone fala.

Escreva uma frase e ela sai como voz na chamada. Toque um MP3 que já é seu. Ou escolha uma janela aberta e mande junto o áudio daquele programa — só dele, sem levar o resto do computador.

Ou copie e cole:

pip install -e .

A janela, aqui do navegadorClique nas abas — é assim que o programa abre.

yummi.exe

SAÍDA (VIRA SEU MICROFONE)

CABLE Input (VB-Audio Virtual Cable)

MONITOR (VOCÊ OUVE)

Fones de ouvido

CTRL+ENTER

Aqui no site quem fala é a voz do seu navegador, só para você sentir o fluxo. No programa a voz é neural e cada frase fica em cache depois da primeira vez.

BIBLIOTECA4

edge-tts · pt-BR-FranciscaNeural

STATUS / PRONTO48 KHZ

5

dependências, nenhuma pesada

157

testes automatizados

0

ffmpeg, zero arquivo temporário

3.10+

Python, do 3.10 em diante

[ TRÊS ABAS ]

Uma janela. Todo o seu áudio.

As duas saídas escolhidas lá em cima — o cabo virtual que vira microfone e o fone onde você se ouve — valem para as três abas ao mesmo tempo.

01FALA

Texto que sai como voz.

As vozes neurais do edge-tts falam por você; se elas não responderem, o gTTS assume sem aviso. Cada frase fica salva em cache, então repetir é instantâneo — e funciona sem internet a partir da segunda vez.

CACHE EM DISCO
02ARQUIVOS

Os sons que você já tem.

Aponte uma pasta e os áudios aparecem na lista, prontos para disparar por clique ou pelas teclas 1 a 9. MP3, WAV, OGG, FLAC, OPUS e AIFF, decodificados direto da memória.

SEM IMPORTAR NADAMP3 · WAV · OGG · FLAC · OPUS · AIFF
03PONTE

O áudio de uma janela só.

Escolha o Brave, o Spotify, o que estiver tocando. O Yummi captura o áudio daquele processo e da árvore de filhos dele, e reaplica ao vivo na saída — notificação do Discord e som de jogo não entram junto.

WASAPI PROCESS LOOPBACK

[ COMO A PONTE FUNCIONA ]

Por programa, não pela placa de som.

A captura acontece antes de o som chegar aos seus alto-falantes, e é filtrada por processo. Por isso dá para mandar o vídeo que está tocando no navegador sem mandar a sua própria voz, o som do jogo ou o alerta que apareceu no meio.

Requer Windows 10 build 20348 ou mais novo. Qualquer Windows 11 serve.

  1. 01

    brave.exe

    a janela escolhida

  2. 02

    Yummi

    captura só esse processo

  3. 03

    CABLE Input

    o cabo virtual

  4. 04

    Discord

    ouve como microfone

A mesma saída ainda toca no seu fone, então você acompanha o que está mandando. Se em vez de uma janela você escolher uma entrada de áudio — a mixagem estéreo, por exemplo — o Yummi recusa as saídas que criariam realimentação e explica na tela por que aquela ficou de fora.

[ TECLADO ]

A mão não sai do lugar.

Os atalhos valem com a janela em foco. Os globais, para disparar com o Yummi minimizado, estão prontos no código e desligados por padrão — basta instalar o pynput e ligar uma chave no config.json.

  • CtrlEnterfala o texto
  • CtrlSsalva o texto como clipe
  • CtrlOabre um arquivo de áudio e toca
  • Escpara a reprodução
  • F5procura dispositivos de áudio de novo
  • 19tocam os primeiros itens da lista em foco
  • Deleteremove o clipe selecionado

[ VERSÃO 3.0.0 · MIT ]

Pronto para falar pelo teclado?

Quatro comandos e o Yummi está aberto. O cabo virtual é opcional: sem ele o som fica entre você e o fone.

git clone https://github.com/ayunaangel/Yummi_text-to-speech.git
cd Yummi_text-to-speech
pip install -e .
yummi