100% local · sem nuvem · sem API key

Laguna Translate

Sua voz, traduzida na hora. PT ↔ EN, 100% no seu PC.Você fala português, seus amigos ouvem inglês — e o contrário também. Tudo em menos de meio segundo, sem nada saindo da sua máquina.

Windows 10/11 · Python 3.13 · CUDA opcional · licença MIT

O problema

Conversas multilíngues no Discord são uma fricção constante

Você joga ou conversa com gente que fala outro idioma. O Google Translate não captura a call, os bots dependem de cloud, e as soluções prontas têm latência de segundos — o suficiente para a conversa travar.

Latência mata o ritmo

Acima de ~3s a conversa quebra. Ferramentas cloud quase sempre passam disso. A Laguna mira meio segundo.

Nuvem = sua voz vazando

Mandar áudio de calls privadas para servidores de terceiros é desconfortável — e às vezes ilegal. Aqui nada sai do PC.

Nada se encaixa no Discord

Bots precisam de servidor, apps móveis não capturam a call. Faltava uma ponte client-side que o Discord enxergasse como mic.

A Laguna é uma ponte, não um produto SaaS. É para quem joga e conversa com gente de outro idioma e quer fluidez sem depender da nuvem.

Como funciona

Um pipeline em cinco passos, em menos de meio segundo

Você fala. A Laguna escuta, transcreve, traduz, ressintetiza e injeta a voz traduzida no Discord como se fosse seu microfone. O caminho inverso também roda, ao mesmo tempo.

Microfone

sounddevice + WebRTC VAD

Captura sua voz em PCM 16kHz e detecta quando você está falando (frames de 30ms).

STT

faster-whisper (small, CUDA fp16)

Transcreve o trecho de fala em texto. É o estágio mais pesado — e o sweet spot de qualidade.

MT

Argos Translate (pb ↔ en)

Traduz o texto. Se você já falou no idioma alvo, pula essa etapa automaticamente.

TTS

Piper (en_US-lessac · pt_BR-faber)

Ressintetiza a tradução em voz natural, em ~40ms por trecho.

Mic virtual

VB-CABLE (Laguna Mic)

O áudio traduzido entra como se fosse o seu microfone — o Discord nem percebe.

Dois workers rodam simultâneos e independentes. Um servidor FastAPI orquestra tudo: REST para controle, WebSocket para STT parcial, tradução e latência ao vivo.

Destaques

Por que a Laguna é diferente

100% local e privado

Nenhum dado sai da máquina. Sem API key, sem cloud, sem telemetria. Sua voz nunca toca a internet.

~450ms de latência

Small + CUDA fp16 é o ponto ótimo — rápido e preciso. A conversa flui sem aquele atraso que quebra o ritmo.

Funciona em qualquer app

Entra como microfone virtual no Discord, Meet, Zoom, OBS. O outro lado nem percebe que tem tradução no meio.

Bidirecional simultâneo

Dois pipelines independentes: FALAR (PT→EN) e ESCUTAR (EN→PT) rodando ao mesmo tempo, cada um com sua config.

Detecção de idioma

Se você já falou no idioma alvo, pula a tradução automaticamente. Zero latência extra de MT/TTS.

Leve, sem torch

Dependências enxutas e bem definidas. CUDA é opcional — roda em CPU também, é só mais lento.

Performance medida

Os números, sem firula

Stress test com 200 segmentos contínuos, stack small + CUDA fp16. Frase de teste de ~4s de áudio, fala → tradução já sintetizada.

458ms
p50 · PT → EN
fala → tradução sintetizada
424ms
p50 · EN → PT
média sobre 200 segmentos
562ms
p95 · PT → EN
cauda de pior caso
~800MB
modelos no 1º run
baixam sozinhos

Small é o ponto ótimo: mais rápido e mais preciso para o caso de uso. Medium chega a traduzir “Discord” como “discórdia” — small acerta tudo.

Laguna Translator

FALAR

você → Discord

ao vivo
Transcrição

olá pessoal, teste de tradução em tempo real

Tradução

hello everyone, real-time translation test

p50 458msp95 562msn 200

ESCUTAR

Discord → você

ao vivo
Transcrição

nice, the latency is really low

Tradução

boa, a latência tá bem baixa

p50 424msp95 496msn 200
Os painéis FALAR e ESCUTAR rodando ao mesmo tempo, com transcrição, tradução e latência ao vivo.

Como usar

Do zero ao Discord em quatro passos

Windows 10/11, Python 3.13. GPU NVIDIA recomendada, mas opcional.

01

Clone e instale

git clone do repositório e pip install -r requirements.txt com Python 3.13. Os modelos (~800MB) baixam sozinhos no primeiro run.

C:/Python313/python.exe -m pip install -r requirements.txt
Copiado!
02

(Opcional) Ative a GPU

Para o caminho rápido com CUDA 12, instale os pacotes NVIDIA. Sem GPU? Pule — o app cai para CPU sozinho.

pip install nvidia-cublas-cu12 nvidia-cudnn-cu12
Copiado!
03

Rode a UI web

Abre http://127.0.0.1:7531 automaticamente, com os dois painéis FALAR e ESCUTAR e métricas ao vivo.

C:/Python313/python.exe laguna_server.py
Copiado!
04

Conecte ao Discord

Instale o VB-CABLE, renomeie o dispositivo para 'Laguna Translator Mic' e selecione-o como entrada no Discord. Pronto.

Dúvidas

Perguntas frequentes

Não. Tudo — captura, transcrição, tradução e síntese — roda na sua própria máquina. Sem API key, sem servidor externo, sem telemetria. Sua voz nunca sai do seu PC.

Não é obrigatório. Com GPU (CUDA fp16) você fica no sweet spot de ~450ms. Sem GPU, o app cai automaticamente para o caminho de CPU — funciona, só com mais latência.

Foi pensado para o Discord, mas como ele entrega a tradução por um microfone virtual (VB-CABLE), funciona em qualquer app que aceite escolher o dispositivo de entrada: Meet, Zoom, OBS, etc.

Português ↔ Inglês, nas duas direções e simultaneamente. Há dois painéis independentes: FALAR (PT→EN) e ESCUTAR (EN→PT). Outros pares estão no roadmap.

Só se quiser entrar 'invisível' como microfone no Discord. Sem ele o app continua funcionando para testar e ouvir traduções — só não injeta o áudio como mic virtual.

Sim. Licença MIT: use comercial, pessoal, faça fork, remix, rebrand. Só mantenha o copyright. É open-source de verdade.

Sua voz, traduzida na hora.

Open-source, MIT, 100% local. Faça fork, mexa à vontade, use em qualquer call.