
OpenWhispr è un’applicazione desktop open source pensata per trasformare la voce in testo, note e azioni direttamente dal computer. Il progetto punta a offrire un’alternativa gratuita e orientata alla privacy a strumenti come WisprFlow e Granola, con supporto multipiattaforma per macOS, Windows e Linux.
L’idea alla base del progetto è semplice: premere una scorciatoia da tastiera, parlare e ottenere immediatamente il testo nella posizione in cui si trova il cursore. Non serve quindi aprire ogni volta un’applicazione dedicata alla trascrizione. OpenWhispr può lavorare con editor di testo, browser, applicazioni per la produttività e praticamente qualsiasi programma che permetta di inserire testo.
Uno degli aspetti più interessanti riguarda la possibilità di scegliere dove elaborare la voce. L’utente può utilizzare motori locali come Whisper e NVIDIA Parakeet, mantenendo l’audio sul dispositivo, oppure affidarsi a servizi cloud quando è più importante ottenere velocità o utilizzare determinati modelli.
Dettatura locale, traduzione e trascrizione delle riunioni
La funzione principale di OpenWhispr è la dettatura vocale globale. Una scorciatoia dedicata consente di iniziare a parlare e il testo trascritto viene automaticamente inserito nell’applicazione attiva. Questo approccio può risultare particolarmente utile quando si scrivono email, documentazione, messaggi, articoli o codice accompagnato da descrizioni.
Il programma include anche una modalità dedicata alla traduzione durante la dettatura. È possibile parlare in una lingua e fare in modo che il testo risultante venga prodotto in un’altra, utilizzando una scorciatoia separata.
La gestione locale della trascrizione rappresenta uno dei punti centrali del progetto. OpenWhispr supporta modelli di riconoscimento vocale eseguiti direttamente sul computer, inclusi Whisper e Parakeet. L’accelerazione GPU può essere sfruttata attraverso Metal sui sistemi compatibili Apple e tramite CUDA e Vulkan su hardware supportato.
Questo significa che l’utente può configurare un flusso completamente locale, evitando di inviare le registrazioni audio a server esterni. Il progetto dichiara inoltre di non raccogliere dati e di non utilizzare sistemi di telemetria.
OpenWhispr non si limita però alla semplice dettatura. Include strumenti per la trascrizione delle riunioni, con rilevamento automatico di chiamate effettuate tramite Zoom, Microsoft Teams e FaceTime. Il software può inoltre integrarsi con Google Calendar, Microsoft Calendar e Apple Calendar per facilitare la gestione degli incontri.
La diarizzazione degli interlocutori permette di distinguere le diverse persone che partecipano a una conversazione. Anche questa elaborazione può essere effettuata localmente, con riconoscimento delle voci e identificazione degli speaker senza dover necessariamente utilizzare servizi cloud.
Agente AI, note e integrazione con i modelli locali
Un’altra componente importante è l’agente AI controllabile tramite voce. OpenWhispr permette di parlare direttamente con diversi servizi e modelli, tra cui GPT-5, Claude, Gemini, Groq, Tinfoil e OpenRouter, oltre ai modelli eseguiti localmente.
L’agente può essere richiamato attraverso una scorciatoia dedicata, senza bisogno di una parola di attivazione. La voce viene quindi interpretata come un comando e il risultato può essere inserito direttamente nel punto in cui si trova il cursore. Se è presente del testo evidenziato, l’assistente può anche modificarlo direttamente.
Quando non è disponibile un campo di testo modificabile, OpenWhispr può mostrare le risposte in un pannello flottante e copiarle negli appunti. È inoltre possibile autorizzare l’invio di uno screenshot dello schermo come contesto aggiuntivo per l’agente AI.
Il sistema di note completa le funzionalità dell’applicazione. Gli utenti possono creare, organizzare e cercare le proprie note attraverso cartelle e ricerca semantica, oltre a sfruttare funzioni AI e sincronizzazione cloud.

Sono disponibili anche strumenti per la collaborazione attraverso spazi di lavoro condivisi. Le note possono essere condivise sul web tramite link, dominio o inviti, mentre gli spazi dedicati ai team permettono di gestire ruoli e membri.
Un’altra caratteristica utile è l’importazione di file audio e video. È possibile trascinare i file nell’applicazione, effettuare caricamenti multipli oppure utilizzare URL di YouTube e altre sorgenti audio. La trascrizione può essere accompagnata dal rilevamento degli interlocutori.
OpenWhispr include inoltre API pubbliche e supporto MCP, permettendo di gestire programmaticamente note e trascrizioni oppure collegare un assistente AI esterno al server MCP del progetto.
La disponibilità di elaborazione locale e cloud lascia quindi all’utente la scelta tra maggiore privacy e maggiore comodità. Per chi utilizza Linux e cerca uno strumento unico per dettatura, trascrizione, riunioni, note e interazione con modelli AI, OpenWhispr rappresenta un progetto particolarmente interessante da tenere d’occhio.
Installare OpenWhispr
OpenWhispr viene rilasciato per Linux con pacchetti deb, rpm e nella versione “portable” AppImage, abbiamo testato il software su Zorin OS 18.1.