• Pneumatici
  • Pneumatici
  • OBSBOT DE
  • OBSBOT DE
  • Europcar IT
  • OBSBOT DE
  • OBSBOT DE
  • Caffè Vergnano
  • Pneumatici
  • OBSBOT DE
  • Europcar IT
  • Tappeto.it

Come usare Rhasspy con Google Assistant per comandi vocali in italiano

Negli ultimi anni gli assistenti vocali sono diventati il punto di riferimento per il controllo domotico e per l’interazione con i dispositivi smart. Tuttavia la maggior parte delle soluzioni più diffuse (Google Assistant, Amazon Alexa, Apple Siri) dipendono da servizi cloud, con conseguenze sulla privacy e sulla disponibilità della rete. Rhasspy è un’alternativa open‑source, completamente offline, che permette di gestire i comandi vocali in più di 30 lingue, tra cui l’italiano. In questa guida approfondiremo come collegare Rhasspy a Google Assistant per sfruttare le capacità di quest’ultimo (ad esempio la ricerca di informazioni su internet) mantenendo il nucleo di riconoscimento locale.

Il documento è strutturato in modo da fornire un percorso passo‑passo, dalla preparazione dell’hardware alla configurazione avanzata, con esempi concreti, tabelle comparative e box riassuntivi utili sia per gli appassionati di home automation sia per i professionisti che devono implementare una soluzione vocale in ambienti aziendali.

Cos’è Rhasspy

Architettura modulare

Rhasspy è costituito da una serie di micro‑servizi che comunicano tramite il protocollo Hermes (originariamente sviluppato da Snips). Ogni modulo svolge una funzione specifica:

  • Speech‑to‑Text (STT): converte l’audio in testo.
  • Intent parser: interpreta il testo e genera un intent in formato JSON.
  • Text‑to‑Speech (TTS): sintetizza la risposta vocale.
  • Audio playback: gestisce l’output audio verso gli altoparlanti.

Grazie a questa separazione è possibile sostituire ogni componente con l’alternativa più adatta al proprio hardware (ad esempio DeepSpeech per lo STT o PicoTTS per la sintesi).

Vantaggi principali

  • Privacy totale: tutti i dati rimangono sul dispositivo locale.
  • Operatività offline: nessuna dipendenza da internet per il riconoscimento.
  • Personalizzazione: è possibile definire intent in linguaggio naturale e collegarli a qualsiasi automazione (Home Assistant, Node‑RED, OpenHAB, ecc.).
  • Supporto multilingue: l’italiano è supportato nativamente con modelli pre‑addestrati.

Requisiti hardware consigliati

Componenti
Modello consigliato
Motivazione
Computer di base
Raspberry Pi 4 (4 GB) o PC x86‑64
Potenza sufficiente per STT e TTS in tempo reale.
Microfono
ReSpeaker 4‑Mic Array o ReSpeaker 2‑Mics pHAT
Array a più microfoni per ridurre il rumore ambientale.
Altoparlante
Altoparlante USB o HDMI con supporto audio
Uscita chiara per le risposte vocali.
Alimentazione
Alimentatore 5 V 3 A (Raspberry Pi) o PSU PC
Garantisce stabilità anche sotto carico.

Preparazione dell’ambiente

Installazione di Rhasspy su Raspberry Pi

Esistono tre metodi principali per installare Rhasspy:

  1. Docker (consigliato per chi ha già Docker installato).
  2. Pacchetto Debian (.deb) per ARM.
  3. Add‑on di Home Assistant (per chi utilizza Hass.io).

Di seguito la procedura più semplice con Docker:

sudo apt update && sudo apt install -y docker.iodocker run -d \ --name rhasspy \ -p 12101:12101 \ -v "$HOME/.config/rhasspy:/data" \ --restart unless-stopped \ rhasspy/rhasspy:latest \ --user-profiles /data \ --profile it

Il comando scarica l’immagine più recente, espone la porta 12101 per l’interfaccia web e imposta il profilo lingua it.

Installazione come Add‑on in Home Assistant

Se si utilizza Home Assistant, è possibile aggiungere Rhasspy direttamente dal Supervisor → Add‑on Store. Dopo aver inserito il repository (senza creare link esterni) basta cliccare su Install, avviare l’add‑on e accedere all’interfaccia web tramite http://<em>IP_HA</em>:12101.

Configurazione del microfono

Dopo l’avvio, la prima cosa da verificare è il corretto funzionamento del microfono. Nella sezione Audio dell’interfaccia Rhasspy selezionare il dispositivo di input (es. hw:1,0 per ReSpeaker 4‑Mic). È consigliabile attivare la cancellazione del rumore (Noise Suppression) e impostare un threshold adeguato per evitare falsi attivamenti.

Impostazione del microfono nella UI di Rhasspy

Configurazione della lingua italiana

Modello Speech‑to‑Text (STT)

Per l’italiano Rhasspy supporta diversi motori STT:

  • Vosk – modello offline leggero, ottimo per Raspberry Pi.
  • DeepSpeech – più accurato ma richiede più RAM.
  • Coqui STT – alternativa open‑source con buoni risultati.

Nell’interfaccia, nella scheda STT, selezionare Vosk e caricare il modello it‑IT (disponibile nella sezione “Download” del pannello).

Modello Text‑to‑Speech (TTS)

Per la sintesi vocale in italiano sono consigliati:

  • PicoTTS – leggero, ma voce robotica.
  • Coqui TTS – voci più naturali, richiede più risorse.
  • eSpeak NG – buona per test rapidi.

Impostare il TTS nella scheda TTS scegliendo Coqui TTS e il modello it_IT. È possibile regolare la velocità (speed) e il pitch per adattare la voce al proprio ambiente.

Definizione degli intent

Gli intent sono le azioni riconosciute da Rhasspy. Si definiscono tramite sentences (frasi modello) e intents (file JSON). Ecco un esempio di file lights.txt:

[AccendiLuce] accendi (la | il) luce {room}[SpegniLuce] spegni (la | il) luce {room}[StatoLuce] (qual è | qual è lo stato di) la luce {room}

Il placeholder {room} è un slot che può assumere valori come “cucina”, “soggiorno” o “camera da letto”. Dopo aver salvato il file, cliccare su Train per addestrare il motore di riconoscimento.

Integrazione con Google Assistant

Perché collegare Google Assistant

Rhasspy gestisce perfettamente i comandi locali, ma non dispone di un motore di ricerca avanzato né di integrazioni native per servizi come Google Calendar, YouTube o Google Maps. Collegandolo a Google Assistant è possibile delegare questi compiti al cloud solo quando necessario, mantenendo comunque il riconoscimento vocale locale.

Panoramica dell’architettura di integrazione

Flusso di comunicazione tra Rhasspy, Hermes e Google Assistant

Il flusso tipico è il seguente:

  1. L’utente pronuncia un comando.
  2. Rhasspy converte l’audio in testo e genera un intent JSON.
  3. Se l’intent è marcato come “forward_to_google”, Rhasspy invia il testo a Google Assistant SDK tramite l’API Assist.
  4. Google Assistant elabora la richiesta (es. “Che tempo farà a Roma?”) e restituisce una risposta vocale.
  5. Rhasspy riceve la risposta, la sintetizza con TTS e la riproduce.

Creazione di un progetto Google Cloud (senza link esterni)

Per utilizzare l’API di Google Assistant è necessario un progetto Google Cloud con:

  • Abilitazione dell’Assistant API.
  • Creazione di una OAuth 2.0 client ID di tipo “Desktop”.
  • Download del file credentials.json da inserire nella cartella /data/google-assistant di Rhasspy.

Dopo aver posizionato il file, nella sezione Google Assistant dell’interfaccia Rhasspy impostare il percorso del file e premere Authorize. Verrà visualizzato un URL da aprire su un browser; inserendo il codice di verifica si completa l’autenticazione.

Configurazione di Rhasspy per il forwarding

Per indicare a Rhasspy quali intent devono essere inviati a Google Assistant, è necessario aggiungere la proprietà forward: true nel file di intent. Esempio:

{"name": "TempoRoma", "slots": [], "forward": true, "text": "Che tempo farà a Roma?"}

In alternativa, è possibile definire una regola globale nella sezione Intent handling impostando forward_intents: [TempoRoma, RicercaWeb].

Passaggi dettagliati per l’integrazione

1. Preparare l’ambiente Python per Google Assistant SDK

Sul dispositivo che ospita Rhasspy (Raspberry Pi o PC) installare le dipendenze:

sudo apt-get updatesudo apt-get install -y python3-venv python3-pippython3 -m venv ~/google-assistant-envsource ~/google-assistant-env/bin/activatepip install --upgrade google-assistant-sdk[samples]pip install --upgrade google-auth-oauthlib[tool]

2. Autenticare l’account Google

Eseguire il comando di autorizzazione:

google-assistant-sdk-devicetool auth --client-secrets /data/google-assistant/credentials.json

Copiare il codice di verifica mostrato nel browser nella console e completare il login. Il token verrà salvato in ~/.config/google-assistant-sdk/.

3. Configurare il servizio di forwarding in Rhasspy

Nella UI di Rhasspy, andare su Settings → Services → Google Assistant e inserire:

  • Path del file credentials.json.
  • Path del token di accesso (di solito ~/.config/google-assistant-sdk/).
  • Lingua impostata su it-IT.

Salvare le impostazioni e riavviare Rhasspy per applicare le modifiche.

4. Definire gli intent da forwardare

Creare un file google_intents.txt con contenuti simili a:

[TempoRoma] (che tempo farà | qual è il meteo) a Roma[RicercaWeb] (cerca su google | trova) {query}[ImpostaTimer] (imposta un timer di) {duration} minuti

Per ogni intent aggiungere la proprietà forward: true nel file JSON corrispondente (es. TempoRoma.json).

5. Testare la catena completa

Dalla UI di Rhasspy, utilizzare la sezione Test per inviare il comando “Che tempo farà a Roma”. Se tutto è configurato correttamente, Rhasspy dovrebbe inoltrare il testo a Google Assistant, ricevere la risposta (“A Roma è sereno, 18°C”) e riprodurla tramite il TTS.

Esempi pratici di utilizzo

Controllo luci con fallback a Google Assistant

Supponiamo di avere una luce “cucina” gestita da Home Assistant. L’intent AccendiLuce è gestito localmente. Tuttavia, se l’utente dice “Accendi la luce della cucina e dimmi se c’è il sole”, Rhasspy può:

  1. Eseguire l’azione di accensione tramite Home Assistant.
  2. Riconoscere la seconda parte della frase (“e dimmi se c’è il sole”) come TempoRoma e forwardarla a Google Assistant.

Il risultato è un unico comando vocale che combina automazione locale e informazione cloud.

Richiesta meteo e notizie

Un file info.txt può contenere:

[MeteoCitta] (che tempo fa | qual è il meteo) a {city}[Notizie] (dammi | mostrami) le notizie di {category}

Entrambi gli intent hanno forward: true. Rhasspy invierà il testo a Google Assistant, che risponderà con le informazioni richieste.

Impostazione timer e sveglia

Per gestire timer localmente è possibile utilizzare il modulo Timer di Rhasspy, ma se si preferisce la precisione di Google Assistant si può forwardare l’intent:

[ImpostaTimer] (imposta un timer di) {duration} minuti

Il valore {duration} viene passato a Google Assistant, che avvierà il timer e, al termine, invierà una notifica vocale al dispositivo Rhasspy.

Ottimizzazioni e troubleshooting

Riconoscimento vocale: migliorare l’accuratezza

  • Posizionamento microfono: collocare il microfono a circa 30 cm dal punto di emissione della voce, evitando ostacoli.
  • Calibrazione del livello di soglia: nella sezione Audio impostare un valore di energy_threshold che riduca i falsi attivamenti.
  • Modelli di lingua personalizzati: aggiungere frasi specifiche al file sentences.ini per coprire vocaboli di dominio (es. “cameretta”, “sala studio”).

Ritardi nella risposta di Google Assistant

Se la latenza supera i 2‑3 secondi, verificare:

  1. Connessione internet stabile (preferibilmente via Ethernet).
  2. Carico CPU del Raspberry Pi (usare htop per monitorare).
  3. Versione del modello STT: Vosk è più veloce di DeepSpeech su hardware limitato.

Errore “Invalid token” durante il forwarding

Questo errore indica che il token OAuth è scaduto. È necessario rieseguire il comando di autenticazione (vedi sezione Autenticare l’account Google) oppure impostare un refresh token automatico aggiungendo l’opzione --auto-refresh al comando di avvio del servizio.

Log di debug

Rhasspy espone i log tramite l’interfaccia web nella scheda Logs. Per un debug più approfondito, è possibile avviare Rhasspy in modalità debug:

docker run -d --name rhasspy -p 12101:12101 \ -v "$HOME/.config/rhasspy:/data" \ rhasspy/rhasspy:latest \ --profile it --debug

I messaggi più dettagliati mostrano il flusso di intent, i payload inviati a Google Assistant e le eventuali risposte di errore.

Sicurezza e privacy

L’integrazione con Google Assistant introduce un punto di contatto con i server Google. Per minimizzare l’esposizione dei dati:

  • Inviare a Google solo il testo necessario (es. “che tempo farà a Roma”) evitando di includere informazioni sensibili.
  • Utilizzare un account Google dedicato con privilegi limitati.
  • Revocare i token OAuth non più in uso dalla console di gestione delle credenziali.
  • Abilitare la crittografia TLS (HTTPS) per le comunicazioni tra Rhasspy e l’API di Google Assistant (già di default).

Il resto dell’infrastruttura (STT, TTS, automazioni) rimane completamente locale, garantendo che le conversazioni quotidiane non vengano registrate su cloud.

Confronto tra soluzioni offline e cloud

Caratteristica
Rhasspy (offline)
Google Assistant (cloud)
Privacy dei dati
Elevata – tutti i dati rimangono in locale
Media – i dati vocali sono inviati a Google
Dipendenza da internet
Assoluta – funziona anche offline
Necessaria per la maggior parte delle funzioni
Capacità di ricerca
Limitata – richiede integrazioni esterne
Avanzata – accesso a Knowledge Graph, Maps, YouTube
Supporto linguistico
Modelli personalizzabili, ma meno raffinati
Riconoscimento e sintesi di alta qualità in molte lingue
Consumo di risorse
Moderato – dipende dal modello STT/TTS scelto
Minimo sul dispositivo (solo invio audio)
Scalabilità
Facile da distribuire su più dispositivi locali
Scalabilità gestita da Google, ma con costi di banda

Box riassuntivo: i passaggi chiave

In sintesi – dalla preparazione hardware al test finale.
  • Installa Rhasspy (Docker o Add‑on).
  • Configura microfono e scegli Vosk (STT) + Coqui TTS.
  • Crea un progetto Google Cloud, abilita Assistant API e scarica credentials.json.
  • Autentica l’account con google-assistant-sdk-devicetool auth.
  • Definisci gli intent da forwardare (es. TempoRoma).
  • Imposta forward: true nei file JSON degli intent.
  • Testa la catena con la UI di Rhasspy; verifica risposta vocale.

Conclusioni

Integrare Rhasspy con Google Assistant consente di ottenere il meglio di entrambi i mondi: la privacy e la reattività di un assistente locale, unita alla potenza informativa dei servizi cloud di Google. Seguendo i passaggi descritti in questa guida è possibile realizzare un sistema vocale completo, personalizzabile e pronto per l’uso sia in ambito domestico sia in contesti professionali dove la sicurezza dei dati è fondamentale.

Ricordate che la chiave del successo è una configurazione accurata del microfono, la scelta di modelli STT/TTS adeguati alle capacità hardware e una gestione consapevole dei token di accesso a Google. Con questi accorgimenti, il vostro assistente vocale sarà pronto a rispondere a comandi in italiano, a gestire la domotica e a fornirvi informazioni aggiornate, il tutto senza compromettere la privacy della vostra casa o del vostro ufficio.


Linkedin

Potrebbero interessarti

ZeroClaw vs Alternativi: Quale scegliere nel 2024?

Nel panorama attuale dell', la tendenza si sta spostando rapidamente verso gli ...

Leggi ->

Cosa sono i PLC: Una Guida Completa

I PLC, o Controllori Logici Programmabili, so ...

Leggi ->

Come creare un canale WhatsApp

Nei vari agiornamenti di WhatsApp il grupo di Meta ha introdotto un po in sordina ...

Leggi ->

Anthropic, accordo con SpaceX: concesso l’uso di un data center da oltre 300 megawatt

Il panorama dell' ha subito un'accelerazione strategica senza precedenti con l'annuncio ...

Leggi ->

Superare il gap IT/OT: strategie pratiche per integrare dati e processi nelle fabbriche food & beverage

Nel settore food & beverage la sicurezza alimentare, la tracciabil ...

Leggi ->

Batterie di accumulo per impianti fotovoltaici: Perché sono essenziali?

L'energia solare sta rivoluzionando le ...

Leggi ->

Internet of Things (IoT) nell'Industria 4.0: Una Rivoluzione Digitale in Corso

L'Internet of Things (IoT) rappresenta u ...

Leggi ->

Come migliorare la sicurezza dei dati analizzando i log di rete con LLM

Nel panorama attuale, le reti aziendali sono sempre più complesse: il lavoro remoto, l’ ...

Leggi ->

Come avere informazioni catastali di immobili e terreni Online Gratis

Se sei giunto qui significa che ti sei trovato difronte alla necessità di avere i ...

Leggi ->
  • Pneumatici
  • OBSBOT DE
  • Pneumatici
  • OBSBOT DE
  • Caffè Vergnano
  • Tappeto.it
  • OBSBOT DE
  • OBSBOT DE
  • Europcar IT
  • OBSBOT DE
  • Pneumatici
  • Europcar IT