01Panoramica
Un assistente vocale multipiattaforma che combina riconoscimento vocale, IA conversazionale e interazione in tempo reale su desktop e web.
Progetto indipendente
Assistente vocale con IA
Un assistente vocale multipiattaforma che combina riconoscimento vocale, IA conversazionale e interazione in tempo reale su desktop e web.
Assistente vocale con IA
Composizione illustrativa del progetto · schermate originali in arrivo
01Panoramica
Un assistente vocale multipiattaforma che combina riconoscimento vocale, IA conversazionale e interazione in tempo reale su desktop e web.
02Sfida
Esplorare un modo più naturale di interagire con il software attraverso la voce. La sfida tecnica consiste nel coordinare riconoscimento vocale, risposte dell’IA e sintesi vocale, rendendo chiara ogni fase.
03Approccio
Progettare voce e riscontro visivo come un’unica esperienza. Un’interfaccia futuristica e interattiva mostra quando l’assistente è pronto, in ascolto, in elaborazione o sta rispondendo.
04Soluzione
Un assistente personale indipendente sviluppato da Enzo Sena in due forme complementari: un’applicazione desktop con elaborazione locale della voce e un’esperienza web/PWA con integrazione dell’IA tramite API.
05Applicazione desktop
Sviluppata con Tauri e React / Vite. L’elaborazione vocale su desktop utilizza whisper.cpp per trascrivere il parlato e Piper per la sintesi vocale, in un’interfaccia interattiva che rende visibile lo stato dell’assistente.
06Esperienza web / PWA
Accessibile dal browser e adattata ai dispositivi mobili. La versione web combina riconoscimento e sintesi vocale del browser con un’architettura serverless e l’integrazione dell’IA tramite API.
07Interazione vocale
L’ingresso vocale, l’elaborazione e la risposta parlata compongono il ciclo di interazione. Gli stati visivi — pronto, in ascolto, in elaborazione e in risposta — permettono di seguire ogni fase in tempo reale.
08Integrazione dell’IA
Nella versione web, l’IA conversazionale è integrata tramite un’API. Questa connessione unisce l’interazione vocale alle risposte dell’IA nell’esperienza accessibile dal browser.
09Tecnologie utilizzate
Desktop: Tauri, React, Vite, whisper.cpp e Piper. Web / PWA: riconoscimento vocale del browser, sintesi vocale, API di IA e architettura serverless.
Aspetti tecnici
Risultato
Un’esplorazione indipendente di voce, IA conversazionale e riscontro visivo in tempo reale su desktop e web. Il progetto unisce sviluppo desktop, interfacce mobili, integrazione di API e software su misura.