01Visão geral
Um assistente de voz com IA multiplataforma que combina reconhecimento de voz, IA conversacional e interação em tempo real em aplicações desktop e web.
Projeto independente
Assistente de voz com IA
Um assistente de voz com IA multiplataforma que combina reconhecimento de voz, IA conversacional e interação em tempo real em aplicações desktop e web.
Assistente de voz com IA
Composição ilustrativa do projeto · imagens originais em breve
01Visão geral
Um assistente de voz com IA multiplataforma que combina reconhecimento de voz, IA conversacional e interação em tempo real em aplicações desktop e web.
02Desafio
Explorar uma forma mais natural de interagir com software através da voz. O desafio técnico passa por coordenar o reconhecimento de voz, as respostas da IA e a síntese de voz, mantendo claro o que está a acontecer.
03Abordagem
Tratar a voz e o feedback visual como uma experiência única. Uma interface futurista e interativa indica quando o assistente está pronto, a ouvir, a processar ou a responder.
04Solução
Um assistente pessoal independente desenvolvido por Enzo Sena em duas vertentes complementares: uma aplicação desktop com processamento local de voz e uma experiência web/PWA com integração de IA através de API.
05Aplicação desktop
Desenvolvida com Tauri e React / Vite. O processamento de voz no desktop utiliza whisper.cpp para converter fala em texto e Piper para converter texto em fala, numa interface interativa que torna visível o estado do assistente.
06Experiência web / PWA
Acessível pelo navegador, com uma experiência adaptada a dispositivos móveis. A versão web combina reconhecimento e síntese de voz no navegador com uma arquitetura serverless e integração de IA através de API.
07Interação por voz
A entrada de voz, o processamento e a resposta falada compõem o ciclo de interação. Os estados visuais — pronto, a ouvir, a processar e a responder — permitem acompanhar cada etapa em tempo real.
08Integração com IA
Na versão web, a IA conversacional é integrada através de uma API. Esta ligação reúne a interação por voz e as respostas da IA na experiência acessível pelo navegador.
09Tecnologias utilizadas
Desktop: Tauri, React, Vite, whisper.cpp e Piper. Web / PWA: reconhecimento de voz pelo navegador, síntese de voz, API de IA e arquitetura serverless.
Foco técnico
Resultado
Uma exploração independente de voz, IA conversacional e feedback visual em tempo real, em desktop e na web. O projeto reúne desenvolvimento desktop, interfaces móveis, integração de APIs e software à medida.