O produto, por inteiro

Um lugar para cada ideia.
Um passo para cada recurso.

Explore o que existe no projeto e o que estamos planejando. Preview técnico indica presença no código, sem afirmar uma versão desktop distribuída e validada.

Neste website

Website e identidade

História do produto, demonstração ilustrativa, guia, imagens originais e identidade compartilhada com o futuro app.

ConhecerConhecer a fase 1 →
Preview técnico

Ditado global e atalhos

Captura por atalho e orquestração de transcrição já estão no projeto. O primeiro ditado guiado e recuperável é o foco da fase 2.

DitarConhecer a fase 2 →
Planejado

Configuração guiada

Escolher idioma e modelo, entender permissões e fazer um ditado de teste com texto recuperável. A nova identidade começa a entrar no app aqui.

ComeçarConhecer a fase 2 →
Preview técnico

Whisper local e idiomas

Reconhecimento de fala local e seleção de modelos/idiomas existem. O download inicial exige conexão; escolha por hardware e inicialização offline ainda serão qualificadas.

DitarConhecer a fase 2 →
Preview técnico

Microfones e prioridades

Seleção de dispositivo e lista de prioridades já existem. Recuperação de desconexões, Bluetooth e mudanças de formato será reforçada na fase 4.

DitarConhecer a fase 4 →
Preview técnico

Texto no aplicativo e clipboard

O fluxo atual usa clipboard e comando de colar, com opção de copiar. Preservar o clipboard e confirmar o destino são entregas da fase 3.

ContinuarConhecer a fase 3 →
Preview técnico

Overlay Classic e Mini

Indicadores de áudio e estado, posição e tema já existem. Isso não é uma prévia textual da transcrição ao vivo. A identidade será aplicada gradualmente.

DitarConhecer a fase 2 →
Planejado

Captura mais previsível

Reduzir esperas medidas, preservar início e fim da fala e manter a interface responsiva. Ganhos só serão anunciados depois dos testes no mesmo hardware.

DitarConhecer a fase 4 →
Planejado

Vocabulário pessoal

Substituições como “nano uísper” → “NanoWhisper”, com cuidado com palavras, caixa e acentos. A tela atual é um placeholder; não há treinamento acústico anunciado.

PersonalizarConhecer a fase 5 →
Planejado

Formatação falada

Comandos explícitos para parágrafos e formatação, com um prefixo que evite transformar palavras comuns em comandos por engano.

PersonalizarConhecer a fase 5 →
Preview técnico

Histórico e retenção

Histórico em banco local, áudio associado, reprodução, remoção e retenção por dias. Separar original, revisão e áudio opcional faz parte da fase 6.

RecuperarConhecer a fase 6 →
Preview técnico

Estatísticas de uso

O dashboard usa dados do histórico. Estimativas de tempo não são benchmarks de velocidade; medições por etapa serão tratadas separadamente.

RecuperarConhecer a fase 6 →
Planejado

Texto enquanto você fala

Prévia revisável no overlay, resultado final separado e descarte de respostas de sessões antigas. O ditado atual transcreve ao parar.

DitarConhecer a fase 7 →
Planejado

Um novo motor qualificado

Avaliar um motor adicional em português e no hardware real. Parakeet é um candidato, não uma integração ou ganho de desempenho já disponível.

DitarConhecer a fase 7 →
Preview técnico

Servidor configurado e nuvem

Há caminhos para serviço externo no projeto. A seleção da interface ainda precisa ser alinhada ao roteamento efetivo; esta prévia não promete processamento local absoluto.

EscolherConhecer a fase 8 →
Preview técnico

Prompts e melhoria por IA

Prompts e processamento com OpenAI existem. Um provedor externo pode receber o texto. A fase 8 organiza revisão opcional, limites claros e preservação do original.

PersonalizarConhecer a fase 8 →
Planejado

Revisão com IA local

Uma etapa opcional depois do reconhecimento de fala, com modelo escolhido e custo de memória/latência medido. Não usa o runtime privado Fluid Intelligence.

PersonalizarConhecer a fase 8 →
Planejado

Modos por aplicativo

Aplicar um estilo conforme o aplicativo ou site de destino. Os campos de configuração existem, mas o comportamento automático ainda não foi encontrado no fluxo ativo.

ContinuarConhecer a fase 9 →
Planejado

Reescrever uma seleção

Selecionar um texto e pedir uma mudança por voz, com prévia, cancelamento e substituição segura. Prompts de ditado não equivalem a esse recurso.

ContinuarConhecer a fase 9 →
Preview técnico

Transcrição de YouTube

Download, conversão de mídia e transcrição fazem parte do projeto. Esse caminho precisa de internet e ferramentas auxiliares; não é um fluxo offline.

RecuperarConhecer a fase 10 →
Planejado

Arquivos longos e falantes

Importação dedicada, fila de trabalhos longos, segmentos e identificação de falantes serão entregues e avaliados como um fluxo próprio.

RecuperarConhecer a fase 10 →
Planejado

Exportação estruturada

Exportações adequadas a textos longos e segmentos, junto à jornada de arquivos. Disponibilidade e formatos serão anunciados com a entrega validada.

RecuperarConhecer a fase 10 →
Planejado

Instalação e atualizações

O projeto possui configuração de empacotamento e release. Este site ainda não oferece um binário validado; requisitos e instaladores virão com a qualificação de cada plataforma.

ComeçarConhecer a fase 2 →
Fora deste ciclo

API local e integrações

Integrações estão fora deste primeiro ciclo. Descobrir portas de serviços não significa que já exista uma API pública e estável de transcrição.

ExpandirSem compromisso de entrega neste ciclo
Fora deste ciclo

Execução de comandos por voz

Não faz parte das dez fases de ditado. Um eventual modo de comandos exigiria escopo, permissões e confirmação próprios.

ExpandirSem compromisso de entrega neste ciclo

Uma evolução que você pode acompanhar.

Cada fase termina com um resultado que pode ser testado no uso real. A ordem prioriza o primeiro ditado, a entrega do texto e a confiança antes de ampliar a inteligência.

  1. Fase 1 · este website

    Conheça o NanoWhisper

    Website, demonstração, imagens e identidade. Esta é a entrega que você está explorando.

  2. Fase 2

    Faça seu primeiro ditado

    Configuração guiada, modo local previsível, recuperação do texto e identidade aplicada ao app.

  3. Fase 3

    Continue no campo certo

    Inserção no destino pretendido, preservação do clipboard e recuperação quando não for possível inserir.

  4. Fase 4

    Dite com mais confiança

    Captura estável, interface responsiva e desempenho medido, inclusive após trocar de microfone.

  5. Fase 5

    Use suas próprias palavras

    Vocabulário determinístico e formatação falada com resultados verificáveis.

  6. Fase 6

    Recupere o que importa

    Histórico com originais, revisões e controle de retenção de texto e áudio.

  7. Fase 7

    Acompanhe o texto surgir

    Prévia textual durante a fala e um motor adicional aprovado no mesmo corpus de teste.

  8. Fase 8

    Escolha a revisão

    Melhoria opcional por IA local ou provedor explícito, preservando o original.

  9. Fase 9

    Adapte o texto ao contexto

    Reescrita de seleção e modos que consideram o aplicativo de destino.

  10. Fase 10

    Dê espaço a conversas longas

    Arquivos, trabalhos em fila, segmentos, falantes e exportações.

Estado editorial verificado no código em 9 de setembro de 2026. Fases são sequência de trabalho, não datas prometidas.