AI per desktop

 Programmi di intelligenza artificiale per pc

C'è anche la sezione per AI (web - online)


 

 

Note importanti:

In questa pagina vengono/verranno segnalati alcuni programmi (e modelli) di intelligenza artificiali (detti anche Modelli Linguistici di grandi dimensioni, o LLM), che hanno alcuni vantaggi e svantaggi rispetto ai più noti modelli online:

  • richiedono hardware adeguato (CPU moderna, almeno 32 GB RAM, ma soprattutto una scheda video nVidia con oltre 8 GB di VRAM, meglio se almeno 12 GB). Ultimamente in questo campo stanno migliorando anche le schede AMD (anche se forse non ancora versatili come le nVidia in ambito IA).
  • si possono utilizzare anche con Windows, per quanto è su Linux che diano il meglio
  • permettono di rispettare la privacy (è tutto sul nostro pc)
  • sono in grandissima parte gratuiti
  • si possono usare per dialogo/informazioni, creare immagini, tradurre o scrivere testi, fare riassunti, da testo a voce (con voce naturale), trascrizioni e tanto altro
  • sono decisamente meno potenti dei modelli online (Chatgpt, Claude, ecc.), ma danno comunque risultati interessanti

 
 
LM Studio

commento inserito: Agosto 2025

LM Studio per Windows è un'interfaccia che permette di installare vari modelli open source di LLM (come OpenAI GPT OSS, DeepSeek, Llama, ecc.) sul nostro pc Windows.

Una volta scaricato (oltre 450 MB) e installato (non c'è bisogno di utilizzare la riga di comando, si riesce a fare tutto com pochi clic), bisogna andare alla sezione download e scegliere il modello che desideriamo (per esempio deepseek-coder 6.7B Q4_K_M), quindi possiamo 'Chat' e da lì iniziare ad interagire con il nostro modello linguistico avanzato (o LLM).

Esistono anche interfacce più complesse rispetto a LMStudio (per esempio Text Generation WebUI), che però sono più complesse da configurare.

Per ottenere buone prestazioni è opportuna una GPU Nvidia di ultima generazione (con almeno 8 GB di VRAM), ma, in caso si volesse fare solo qualche tentativo, si può anche utilizzare solo la CPU, prezzo però di tempi di svariate volte maggiori (tra le 5 e le 20 volte, a seconda della complessità della domanda). .

download

GIUDIZIO: BUONO ++
 

 
 
ComfyUI

commento inserito: Settembre 2025

ComfyUI è un’interfaccia grafica gratuita (anzi, è pure open source) per la generazione di immagini tramite modelli AI come Stable Diffusion.

A differenza di altri software simili, che puntano su un’interfaccia semplificata, ComfyUI utilizza un sistema a nodi, cioè una serie di blocchi collegati tra loro, ciascuno con una funzione specifica (caricamento modello, generazione, salvataggio, ecc.).

È simile al modo in cui si lavora in programmi come DaVinci Resolve nella parte degli effetti (o anche n8n, presente qui sotto).

 A prima vista può sembrare complicato, ma dopo qualche minuto si inizia a capirne la logica e si scopre quanto sia potente e flessibile. Ogni passaggio è visibile, controllabile, e modificabile: l’utente può decidere ogni cosa, dalla risoluzione al tipo di algoritmo usato per generare l’immagine, passando per gli effetti, fino alla mescolanza di stili e modelli diversi.

Funziona sia su Windows che su Linux.

Ho avuto l'occasione di provare, come modello, Chroma, basato sul generatore di immagini FLUX, con risultati veramente notevoli.

 ComfyUI richiede un minimo di apprendimento, ma per chi vuole ottenere risultati notevoli, o anche solo sperimentare, è una delle soluzioni più interessanti oggi disponibili.

La versione per Linux funziona molto bene (soprattutto su macchine abbastanza potenti), mentre su Windows può servire qualche configurazione in più.

download

GIUDIZIO: OTTIMO
 

 
 
Whisper WebUI (trascrizioni automatiche)

commento inserito: Ottobre 2025

Whisper WebUI è un’interfaccia grafica open source che permette di utilizzare il sistema di riconoscimento vocale Whisper di OpenAI.

 Una volta avviato, mette a disposizione un'interfaccia web accessibile dal browser, tramite la quale è possibile caricare file audio o registrare direttamente dal microfono per ottenere trascrizioni automatiche.

Tra le varie lingue supportate, per fortuna c'è anche l'italiano.

La qualità della trascrizione è di solito molto buona grazie al motore Whisper.
L’utilizzo è intuitivo, con pulsanti e menu chiari che rendono il programma adatto anche a chi non ha esperienza con Python o con strumenti da riga di comando: tra le funzioni avanzate troviamo la possibilità di separare la musica di sottofondo e il riconoscimento dei diversi parlanti, anche se queste opzioni richiedono l’installazione di moduli aggiuntivi che possono non essere semplicissimi da configurare, soprattutto con versioni recenti di Python.

L’installazione iniziale, infatti, è forse l’unico vero ostacolo: è necessario avere Python (che comunque è gratuito) e aggiungere manualmente alcuni moduli, cosa non proprio immediata per chi non ha molta dimestichezza con l’ambiente (nulla di impossibile, comuque).

 Superato ciò, Whisper WebUI si rivela un valido programma, gratuito e completamente locale, che non invia dati a server esterni e permette di scegliere il modello Whisper più adatto alle proprie esigenze.

 Su Linux (dove l'ho provato) funziona molto bene, su Windows in teoria è in grado di girare, ma la procedura di installazione può essere ancora più complessa che con Linux.

download

GIUDIZIO: BUONO ++
 

 
 
n8n

commento inserito: Settembre 2025

n8n (è un software gratuito e open source per creare automazioni complesse tra programmi, app e servizi online, tramite un sistema a nodi (ricorda ComfyUI).

Richiede di essere installato su Linux in un pc/server proprio (è gratuito per uso personale, a pagamento solo se lo vogliamo su un server 24/7 gestito in cloud).

Il punto forte di n8n è la straordinaria flessibilità: permette di costruire catene di azioni in base a eventi specifici, come l’arrivo di una mail, la modifica di un sito web, un nuovo file caricato su Dropbox o Google Drive, e così via.

A quel punto può inviare notifiche (es. su Telegram), salvare dati, attivare altri processi, gestire file, ecc., praticamente una sorta di Zapier gratuito (se usato su pc proprio) e senza limiti.

L’interfaccia è visuale, a nodi, e l’installazione è semplice (anche su una macchina virtuale, come ad esempio VMWare su Linux); la configurazione iniziale è più impegnativa (la versione cloud, a pagamento, ne semplifica l'installazione, non l'utilizzo), ma una volta capito il meccanismo si aprono possibilità impressionanti.

A differenza degli altri programi di questa pagina, non richiede un hardware particolarmente avanzato.

Homepage di n8n

download

GIUDIZIO: OTTIMO
 

 
 
Coqui TTS (TTS - da testo a voce)

commento inserito: Ottobre 2025

Coqui TTS è un programma open source per trasformare il testo scritto in parlato, da eseguire interamente sul proprio PC.

Non si tratta di un servizio online, ma di un software che si installa (preferibilmente su Linux, anzi, se volete provarlo vi suggerisco di utilizzare Linux) e che consente di generare audio vocali in molte lingue, incluso l'italiano, senza alcun limite di tempo o utilizzo.

Le voci disponibili, basate soprattutto sul modello XTTS‑v2, sono di qualità elevata e in alcuni casi anche espressive.

In teoria, con un po' di lavoro aggiuntivo, è anche possibile anche clonare una voce a partire da pochi secondi di registrazione.

Funziona molto bene, ma richiede un'attenta configurazione iniziale: l’installazione può dare qualche problema (conflitti tra versioni di Python, dipendenze, ecc.), e potrebbe servire l’aiuto di forum o assistenti IA per risolverli.

Una volta superato questo scoglio, l’utilizzo è semplice: si incolla il testo, si genera l’audio e si salva il file .wav. Se il testo è troppo lungo, basta dividerlo in più parti.

Attualmente è supportato nativamente su Linux; su Windows può essere eseguito tramite Docker o WSL, ma l’installazione diretta spesso ha problemi.

download

GIUDIZIO: OTTIMO
 

 
 
 Vibe Voice (da voce a testo - trascrizioni)

commento aggiornato: Luglio 2026

VibeVoice è un programma open source per trasformare l'audio in testo (speech-to-text): basta infatti parlare e, se non parliamo troppo velocemente e non ci mangiamo troppe parole, riuscirà a tradurre tutto il testo con una certa accuratezza. L'utilizzo è elementare, anche perché i comandi a disposizione sono pochi: basta scegliere i tasti per avviarlo e, da quel momento in poi, ogni cosa che diremo verrà trascritta. Per ritrovarla, basta andare nel menu History.

La cosa notevole è che, esattamente come per i servizi web di questo tipo (su Programmifree ne sono presenti alcuni molto validi, come TurboScribe), viene aggiunta automaticamente la punteggiatura. Se al posto di convertire del testo in tempo reale, vogliamo caricare e trascrivere qualcosa, c'è qualcosa di molto interessante qui (sempre basato su VibeVoice).

download

GIUDIZIO: OTTIMO
 

 
 
Altri programmi AI interessanti:

DeepSeek Desktop (Chatbot - LLM per LM Studio)
Gemma (Chatbot creato da Google - funziona anche con hardware ridotto)
Mistral (Chatbot - LLM per LM Studio)
OpenAI GPT OSS (Chatbot per LM Studio)
Phi (LLM basato sul ragionamento)

Bark (da testo a voce, TTS)

Chroma (modello per la creazione immagini tramite AI)
NightShade (per artisti e fotografi, rovina i dataset delle AI in addestramento)
Video2X (upscale video tramite AI)

Wayfu Extension GUI (upscale video tramite AI)