senz.
Iniziamo un progetto
Progetti

Progetto indipendente

J.A.R.V.I.S.

Assistente vocale con IA

Un assistente vocale multipiattaforma che combina riconoscimento vocale, IA conversazionale e interazione in tempo reale su desktop e web.

Composizione illustrativa del progetto · schermate originali in arrivo

01Panoramica

Un assistente vocale multipiattaforma che combina riconoscimento vocale, IA conversazionale e interazione in tempo reale su desktop e web.

02Sfida

Esplorare un modo più naturale di interagire con il software attraverso la voce. La sfida tecnica consiste nel coordinare riconoscimento vocale, risposte dell’IA e sintesi vocale, rendendo chiara ogni fase.

03Approccio

Progettare voce e riscontro visivo come un’unica esperienza. Un’interfaccia futuristica e interattiva mostra quando l’assistente è pronto, in ascolto, in elaborazione o sta rispondendo.

04Soluzione

Un assistente personale indipendente sviluppato da Enzo Sena in due forme complementari: un’applicazione desktop con elaborazione locale della voce e un’esperienza web/PWA con integrazione dell’IA tramite API.

05Applicazione desktop

Sviluppata con Tauri e React / Vite. L’elaborazione vocale su desktop utilizza whisper.cpp per trascrivere il parlato e Piper per la sintesi vocale, in un’interfaccia interattiva che rende visibile lo stato dell’assistente.

06Esperienza web / PWA

Accessibile dal browser e adattata ai dispositivi mobili. La versione web combina riconoscimento e sintesi vocale del browser con un’architettura serverless e l’integrazione dell’IA tramite API.

07Interazione vocale

L’ingresso vocale, l’elaborazione e la risposta parlata compongono il ciclo di interazione. Gli stati visivi — pronto, in ascolto, in elaborazione e in risposta — permettono di seguire ogni fase in tempo reale.

08Integrazione dell’IA

Nella versione web, l’IA conversazionale è integrata tramite un’API. Questa connessione unisce l’interazione vocale alle risposte dell’IA nell’esperienza accessibile dal browser.

09Tecnologie utilizzate

Desktop: Tauri, React, Vite, whisper.cpp e Piper. Web / PWA: riconoscimento vocale del browser, sintesi vocale, API di IA e architettura serverless.

Aspetti tecnici

  • Riconoscimento e sintesi vocale
  • IA conversazionale tramite API nella versione web
  • Stati visivi di interazione in tempo reale
  • Elaborazione locale della voce su desktop
  • Accesso da browser e supporto mobile
  • Esperienze desktop e web/PWA

Risultato

Un’esplorazione indipendente di voce, IA conversazionale e riscontro visivo in tempo reale su desktop e web. Il progetto unisce sviluppo desktop, interfacce mobili, integrazione di API e software su misura.

Prossimo progetto

RESISOL

Iniziamo un progetto

Creiamo qualcosa di utile.

In Europa. Al lavoro, ovunque.hello@senzcompany.com