Laguna Translate
Sua voz, traduzida na hora. PT ↔ EN, 100% no seu PC.
Você fala português, seus amigos ouvem inglês — e o contrário também. Tudo em menos de meio segundo, sem nada saindo da sua máquina.
Windows 10/11 · Python 3.13 · CUDA opcional · licença MIT
O problema
Conversas multilíngues no Discord são uma fricção constante
Você joga ou conversa com gente que fala outro idioma. O Google Translate não captura a call, os bots dependem de cloud, e as soluções prontas têm latência de segundos — o suficiente para a conversa travar.
Latência mata o ritmo
Acima de ~3s a conversa quebra. Ferramentas cloud quase sempre passam disso. A Laguna mira meio segundo.
Nuvem = sua voz vazando
Mandar áudio de calls privadas para servidores de terceiros é desconfortável — e às vezes ilegal. Aqui nada sai do PC.
Nada se encaixa no Discord
Bots precisam de servidor, apps móveis não capturam a call. Faltava uma ponte client-side que o Discord enxergasse como mic.
A Laguna é uma ponte, não um produto SaaS. É para quem joga e conversa com gente de outro idioma e quer fluidez sem depender da nuvem.
Como funciona
Um pipeline em cinco passos, em menos de meio segundo
Você fala. A Laguna escuta, transcreve, traduz, ressintetiza e injeta a voz traduzida no Discord como se fosse seu microfone. O caminho inverso também roda, ao mesmo tempo.
Microfone
sounddevice + WebRTC VAD
Captura sua voz em PCM 16kHz e detecta quando você está falando (frames de 30ms).
STT
faster-whisper (small, CUDA fp16)
Transcreve o trecho de fala em texto. É o estágio mais pesado — e o sweet spot de qualidade.
MT
Argos Translate (pb ↔ en)
Traduz o texto. Se você já falou no idioma alvo, pula essa etapa automaticamente.
TTS
Piper (en_US-lessac · pt_BR-faber)
Ressintetiza a tradução em voz natural, em ~40ms por trecho.
Mic virtual
VB-CABLE (Laguna Mic)
O áudio traduzido entra como se fosse o seu microfone — o Discord nem percebe.
Dois workers rodam simultâneos e independentes. Um servidor FastAPI orquestra tudo: REST para controle, WebSocket para STT parcial, tradução e latência ao vivo.
Destaques
Por que a Laguna é diferente
100% local e privado
Nenhum dado sai da máquina. Sem API key, sem cloud, sem telemetria. Sua voz nunca toca a internet.
~450ms de latência
Small + CUDA fp16 é o ponto ótimo — rápido e preciso. A conversa flui sem aquele atraso que quebra o ritmo.
Funciona em qualquer app
Entra como microfone virtual no Discord, Meet, Zoom, OBS. O outro lado nem percebe que tem tradução no meio.
Bidirecional simultâneo
Dois pipelines independentes: FALAR (PT→EN) e ESCUTAR (EN→PT) rodando ao mesmo tempo, cada um com sua config.
Detecção de idioma
Se você já falou no idioma alvo, pula a tradução automaticamente. Zero latência extra de MT/TTS.
Leve, sem torch
Dependências enxutas e bem definidas. CUDA é opcional — roda em CPU também, é só mais lento.
Performance medida
Os números, sem firula
Stress test com 200 segmentos contínuos, stack small + CUDA fp16. Frase de teste de ~4s de áudio, fala → tradução já sintetizada.
Small é o ponto ótimo: mais rápido e mais preciso para o caso de uso. Medium chega a traduzir “Discord” como “discórdia” — small acerta tudo.
FALAR
você → Discord
olá pessoal, teste de tradução em tempo real▏
hello everyone, real-time translation test
ESCUTAR
Discord → você
nice, the latency is really low▏
boa, a latência tá bem baixa
Como usar
Do zero ao Discord em quatro passos
Windows 10/11, Python 3.13. GPU NVIDIA recomendada, mas opcional.
Clone e instale
git clone do repositório e pip install -r requirements.txt com Python 3.13. Os modelos (~800MB) baixam sozinhos no primeiro run.
C:/Python313/python.exe -m pip install -r requirements.txtCopiado!(Opcional) Ative a GPU
Para o caminho rápido com CUDA 12, instale os pacotes NVIDIA. Sem GPU? Pule — o app cai para CPU sozinho.
pip install nvidia-cublas-cu12 nvidia-cudnn-cu12Copiado!Rode a UI web
Abre http://127.0.0.1:7531 automaticamente, com os dois painéis FALAR e ESCUTAR e métricas ao vivo.
C:/Python313/python.exe laguna_server.pyCopiado!Conecte ao Discord
Instale o VB-CABLE, renomeie o dispositivo para 'Laguna Translator Mic' e selecione-o como entrada no Discord. Pronto.
Dúvidas
Perguntas frequentes
Não. Tudo — captura, transcrição, tradução e síntese — roda na sua própria máquina. Sem API key, sem servidor externo, sem telemetria. Sua voz nunca sai do seu PC.
Não é obrigatório. Com GPU (CUDA fp16) você fica no sweet spot de ~450ms. Sem GPU, o app cai automaticamente para o caminho de CPU — funciona, só com mais latência.
Foi pensado para o Discord, mas como ele entrega a tradução por um microfone virtual (VB-CABLE), funciona em qualquer app que aceite escolher o dispositivo de entrada: Meet, Zoom, OBS, etc.
Português ↔ Inglês, nas duas direções e simultaneamente. Há dois painéis independentes: FALAR (PT→EN) e ESCUTAR (EN→PT). Outros pares estão no roadmap.
Só se quiser entrar 'invisível' como microfone no Discord. Sem ele o app continua funcionando para testar e ouvir traduções — só não injeta o áudio como mic virtual.
Sim. Licença MIT: use comercial, pessoal, faça fork, remix, rebrand. Só mantenha o copyright. É open-source de verdade.
Sua voz, traduzida na hora.
Open-source, MIT, 100% local. Faça fork, mexa à vontade, use em qualquer call.