Panoramica · Aggiornato al 13 agosto 2026

Quale modello di IA è più adatto al tuo progetto?

Dicci cosa vuoi fare e che tipo di dispositivo possiedi. Ti indicheremo i modelli adatti alle tue esigenze.

Quali sono le caratteristiche dei vari modelli?

Un modello che riassume bene le informazioni non deve necessariamente essere ben programmato. Seleziona a sinistra ciò di cui hai bisogno. A destra appariranno tutti i modelli in grado di farlo, indipendentemente dal fatto che siano installati sul tuo dispositivo, ospitati da un provider o disponibili tramite abbonamento cloud.

1 Quali devono essere le funzionalità del modello?

È possibile selezionare più opzioni.

Dove è consentito correre

Di default, mostriamo tutte e tre le opzioni una accanto all'altra, in modo che tu possa confrontarle.

Seleziona a sinistra le funzionalità che desideri per il modello. I modelli corrispondenti verranno visualizzati qui.

Ricerche più frequenti

Cosa puoi fare con il tuo hardware?

Indica che tipo di dispositivo possiedi e come lo utilizzi. Ti mostreremo quali attività è possibile svolgere con esso, con quale fluidità funzionano e quali altri ostacoli potrebbero presentarsi.

La memoria di lavoro e la potenza di calcolo sono due aspetti distinti

Per l'IA locale non serve una scheda grafica dedicata. Un modello funziona anche solo con il processore e la normale memoria di lavoro. Ciò che manca non è la capacità, ma la velocità.

La memoria di lavoro è lo scaffale su cui si trova il modello. Il processore è un cuoco che esegue le ricette. Una scheda grafica è composta da centinaia di piccoli cuochi che effettuano calcoli contemporaneamente, e la memoria grafica è il loro scaffale a portata di mano.

La memoria di lavoro determina quale modello è compatibile. La potenza di calcolo determina quanta pazienza occorre.

  • da 7 a 8 miliardida 4 a 6 GB
  • 14 miliardida 8 a 10 GB
  • 32 miliardida 18 a 22 GB
  • 70 miliardida 40 a 50 GB

Valori indicativi per modelli quantizzati. A ciò si aggiunge una riserva per il programma, lo svolgimento della conversazione e i calcoli interni.

Che tipo di dispositivo hai?
Quali sono le previsioni?
Solo processore e memoria RAM. È il caso più comune ed è sufficiente per chi è alle prime armi.

10 su 10

In questo modo i compiti diventano fattibili

Restano 11 GB per il modello, che rientra nella categoria “Notebook potenti”.

  • Software e sistema operativo4 GB
  • Trascrizione della conversazione1 GB
  • Spazio per il modello11 GB

Solo il processore. Ad esempio, la velocità di lettura. La risposta si costruisce sotto gli occhi dell’utente; per ogni paragrafo bisogna attendere alcuni secondi. Per domande occasionali, sintesi e semplici analisi di documenti, è sufficiente.

  • Scrivere testiGemma 4 12B · 10 GB
  • RiassuntoGemma 4 12B · 10 GB
  • TraduciEuroLLM 9B · 8 GB
  • Consultare i propri documentiGranite 4.1 8B · 7 GB
  • ProgrammazionePhi-4 14B · 11 GB
  • Ragionamento in più fasiPhi-4 14B · 11 GB
  • Leggere immagini e scansioniGemma 4 12B · 10 GB
  • Trascrizione del parlatoWhisper large-v3 · 3 GB
  • Ricerca nei documentiEmbedding Qwen3 8B · 8 GB
  • Utilizzo degli attrezziGranite 4.1 8B · 7 GB

Tutte le operazioni sono già fattibili. Una maggiore quantità di memoria di lavoro consente in questo caso di utilizzare modelli più grandi per le stesse operazioni, ma non di eseguire più operazioni né di ottenere una maggiore velocità.

Maggiori dettagli sui modelli citati sono disponibili nella sezione “Ricerca modelli” qui sopra.

Valori indicativi. In caso di più richieste simultanee, ciascuna occupa la propria memoria di conversazione. Il modello stesso viene caricato una sola volta, mentre la cronologia si moltiplica.

Cosa può fare ancora questa misura

  • 0,5 miliardiDa classificare e completare. Troppo poco per un colloquio.
  • 1 miliardoSintesi semplici e funzioni di base. Per il tedesco siamo già al limite.
  • Da 3 a 4 miliardiIl punto saliente per il telefono. Riassumere, riformulare, trarre conclusioni semplici.
  • 8 miliardiUna solida cultura generale. Ormai quasi inutile sul telefono, ma ormai lo standard sul notebook.

Sul cellulare

  • Riassumere e riformulare testi brevi
  • Traduci semplicemente
  • Elaborare un testo dettato
  • Informazioni aggiornate, poiché il modello non dispone di accesso a Internet
  • Esercizi articolati in più fasi con attività di pianificazione e calcolo
  • Documenti lunghi che richiedono un elevato livello di precisione

Il termine “Small Language Model”, tra l’altro, non ha una definizione rigida. Microsoft parla di 10 miliardi di parametri e allo stesso tempo definisce “piccolo” un modello da 14 miliardi. Più utili del termine stesso sono le due domande riportate sopra.

Confronto tra tutti i modelli di IA aperti.

La colonna “Tedesco” indica quanto sia attendibile la nostra valutazione, non un voto inventato.

ModelloScadeMemoriaTedescoLicenzaConsultare
Qwen 3.5Alibaba · CinaSmartphone0,8B a partire da 2 GB · 9B circa 8 GB · 27B circa 20 GBTedesco accettabileApache 2.0OllamaHugging Face
Qwen 3 30B-A3BAlibaba · CinaNotebook da 32 GBcirca 20 GBBuono in tedescoApache 2.0OllamaHugging Face
ApertusETH Zurigo, EPFL e CSCS · SvizzeraNotebook8B circa 6 GB · 70B circa 45 GBBuono in tedescoApache 2.0Hugging Face
Gemma 4Google · Stati UnitiSmartphoneE4B circa 4 GB · 12B circa 10 GB · 31B circa 20 GBBuono in tedescoApache 2.0OllamaHugging Face
gpt-ossOpenAI · Stati UnitiNotebook da 32 GB20B circa 14 GB · 120B oltre 60 GBBuono in tedescoApache 2.0OllamaHugging Face
Muse GlimmerMeta · Stati UnitiDesktopcirca 20 GBTedesco non revisionatoApache 2.0Hugging Face
Granite 4.1IBM · Stati UnitiNotebook3B circa 3 GB · 8B circa 7 GB · 30B circa 20 GBTedesco accettabileApache 2.0OllamaHugging Face
Ministral 3Mistral AI · FranciaSmartphone3B circa 3 GB · 8B circa 7 GB · 14B circa 11 GBTedesco accettabileApache 2.0OllamaHugging Face
Phi-4Microsoft · Stati UnitiNotebook3,8B circa 3 GB · 14B circa 11 GBBuono in tedescoMITOllamaHugging Face
SmolLM3Hugging Face · Francia e Stati UnitiSmartphonecirca 3 GBTedesco accettabileApache 2.0Hugging Face
Teuken 7BFraunhofer e OpenGPT-X · GermaniaNotebookcirca 6 GBTedesco scarsoApache 2.0 solo nella versione con l'aggiunta "commercial" e con alcune condizioniHugging Face
EuroLLMConsorzio europeo di ricerca · UENotebook9B circa 8 GB · 22B circa 16 GBBuono in tedescoApache 2.0Hugging Face
Nemotron 3 NanoNVIDIA · Stati UnitiDesktopcirca 20 GBTedesco non revisionatoLicenza NVIDIA Open Modelcon condizioniOllamaHugging Face
DeepSeek V4DeepSeek · CinaServerdiverse centinaia di GBBuono in tedescoMITHugging Face
Mistral Large 3 e Small 4Mistral AI · FranciaServera partire da circa 70 GBBuono in tedescoApache 2.0Hugging Face

Modelli che sanno fare qualcosa di diverso.

Un modello linguistico scrive testi. Non ascolta, non vede e non effettua ricerche in archivi. Per queste operazioni esistono modelli specifici, solitamente di dimensioni molto ridotte, che vengono combinati con un modello linguistico.

Lingua nel testo

Whisper large-v3

Trascrive le registrazioni in 99 lingue. Per il tedesco sono disponibili versioni addestrate con tassi di errore molto bassi. Il tedesco svizzero rimane difficile: anche le versioni appositamente adattate presentano circa un errore ogni quattro parole.

circa 3 GB · Apache 2.0

Ricerca nei documenti

Embedding Qwen3

Converte i testi in sequenze di numeri, in modo da trovare risultati simili dal punto di vista del contenuto anziché solo corrispondenze esatte a livello di parole. Attualmente è il modello gratuito più potente di questo tipo per più lingue. Non risponde autonomamente.

Da 0,6 GB a 8 GB · Apache 2.0

Ricerca nei documenti

BGE-M3

L'alternativa collaudata, progettata per oltre cento lingue e sezioni più lunghe. La scelta più affidabile per archivi multilingue.

circa 1 GB · MIT

Leggere immagini e scansioni

Qwen3-VL

Legge il testo contenuto in foto, documenti e moduli in 32 lingue. Importante: si tratta di un unico modello, non di una combinazione tra riconoscimento delle immagini e modello linguistico.

a partire da circa 3 GB · Apache 2.0

Programmazione

Programmatore Qwen3

Specializzato nel codice e addestrato a leggere e modificare autonomamente i file all’interno di un progetto. La variante 30B funziona su un potente computer da lavoro.

circa 19 GB · Apache 2.0

Comprendere la lingua

Voxtral

Alternativa europea a Whisper, che non solo trascrive ciò che viene detto, ma ne comprende anche il contenuto. Attenzione alla sintesi vocale: questa funzione non può essere utilizzata a fini commerciali.

3B a partire da circa 3 GB · Apache 2.0, ma la sintesi vocale è consentita solo per uso non commerciale

Quanto sono bravi i modelli a parlare tedesco?

I produttori pubblicizzano il numero di lingue supportate. Si tratta di una dichiarazione relativa ai dati di addestramento, non di una misurazione. La Bundesdruckerei tedesca ha effettuato una misurazione in collaborazione con l’Istituto Fraunhofer: 39 modelli per compiti amministrativi in lingua tedesca.

Rispondere alle domande in tedesco

Confronto MÖVE della Bundesdruckerei tedesca, 39 modelli testati

  1. 1Mistral Large 2.10,704
  2. 2gpt-oss 120B0,703
  3. 3Apertus70B Svizzera0,697
  4. 4Qwen3 30B-A3B0,694
  5. 5Gemma 2 9B0,693
  6. 6GPT-4: non disponibile0,692
  7. 7Llama 3.3 70B0,691
  8. 8Qwen3 4B0,689
  9. 9DeepSeek R10,689
  10. 10Phi-40,689

Le dimensioni contano meno di quanto ci si aspetti

Qwen3, con 4 miliardi di parametri, si colloca all’ottavo posto, subito dietro a GPT-4o. Un modello per notebook è alla pari con uno del centro dati. Vale più la pena scegliere questo modello che potenziare il proprio computer.

L'origine europea non è una garanzia

Il modello Teuken, sviluppato appositamente per l’UE, ha ottenuto il 47,7% nel test di conoscenza sulla Germania, mentre il modello Llama di Meta, di dimensioni equivalenti, ha raggiunto il 61,5%. Essere addestrati per il tedesco non sostituisce un buon addestramento.

Le misurazioni sono state effettuate in Germania

Il confronto valuta il linguaggio amministrativo tedesco e, per la verifica dei valori, fa riferimento alla Costituzione tedesca. Non fornisce indicazioni riguardo al tedesco standard svizzero, agli “helvetismi” e ai termini amministrativi locali. Finora non esiste un test svizzero analogo, pertanto questo rimane il miglior punto di riferimento disponibile.

Apertus è più forte di quanto si dica

Il modello svizzero si colloca al terzo posto, davanti a GPT-4o. Per lo svizzero tedesco, tuttavia, non esiste ancora una soluzione locale affidabile: nella trascrizione del dialetto, circa una parola su quattro risulta errata. Maggiori informazioni sulla nascita di Apertus nella Swiss AI Initiative.

Quanto dista da ChatGPT?

I modelli cloud non possono essere scaricati. Ciononostante, costituiscono il punto di riferimento più importante.

Solo pochi modelli sono stati testati in tedesco. Per Claude Opus 5, GPT-5.6, DeepSeek V4, Qwen 3.5, Gemma 4 e Mistral Large 3 non sono ancora disponibili dati relativi al tedesco, sebbene siano in circolazione già da tempo. Mostriamo quindi l’ultimo stato misurato per ciascun fornitore e segnaliamo ciò che nel frattempo è stato sostituito. Il valore relativo a Gemini 3.1 Pro è pubblicato arrotondato, mentre tutti gli altri sono arrotondati al primo decimale.

Global MMLU, sezione tedesca, dati raccolti da Artificial Analysis, percentuali

Gemini 3.1Pro - Versione attuale≈95,0solo cloud
Gemini 3 Prosostituito dal 3.1 Pro93,2solo cloud
Claude Opus 4.5sostituito dall'Opus 593,0solo su cloud
GPT-5.2sostituito da GPT-5.691,5solo cloud
DeepSeek V3.2sostituito dalla versione V490,8aperto, ma server
Llama 4 Maverick87,8aperto, ma server
gpt-oss120B attuale87,3aperto, ma server

Ciò che conta è l'ordine di grandezza, non la classifica espressa in decimi di punto: tra il miglior modello cloud e il miglior modello aperto vi è una differenza di circa quattro punti, mentre tra i modelli cloud tra loro la differenza è in alcuni casi inferiore a due.

I modelli di punta attualmente disponibili richiedono un server. Per quanto riguarda le attività complesse, le prestazioni su un notebook rimangono ancora nettamente inferiori a quelle di ChatGPT. In caso di attività ben definite, come la sintesi, la differenza è quasi impercettibile.

  • GPT-5.6OpenAI, Stati UnitiVersione gratuita · Plus 20 USD/mese · Pro 100 USD/mese
  • Claude Opus 5Anthropic, Stati UnitiPiano gratuito · Pro 20 USD/mese · Max a partire da 100 USD/mese
  • Gemini 3.1 ProGoogle, Stati UnitiVersione gratuita · AI Plus CHF 5 · AI Pro CHF 17 · AI Ultra a partire da CHF 100
  • MistralMistral AI, FranciaVersione gratuita · Versione Pro a circa 15 EUR al mese

Abbonamento cloud

Per privati e per un utilizzo sporadico

Venti franchi al mese, nessuna configurazione, sempre il modello più potente. Finché non sono in gioco dati sensibili, questa è la soluzione più pragmatica.

In locale sul proprio dispositivo

Per i dati sensibili e l'indipendenza

Non viene trasmesso alcun dato all'esterno, non ci sono costi ricorrenti e funziona senza Internet. In compenso, le prestazioni sono inferiori e la configurazione richiede un po' di impegno.

Ospitato in Svizzera

Per aziende e team

Modelli aperti offerti da un fornitore svizzero. Coniugano prestazioni adeguate con una situazione giuridica chiara, senza che ogni postazione di lavoro necessiti di hardware proprio.

La terza opzione è poco conosciuta: Infomaniak, Swisscom ed Exoscale gestiscono modelli aperti in data center svizzeri, in parte con Apertus. Si paga in base all’utilizzo e i dati rimangono nel Paese. Chi, invece di un’interfaccia, cerca una chat già pronta, può trovare questi fornitori su Schweizer KI-Chats. Altri fornitori sono elencati su Swiss AI Landscape.

Puoi utilizzarlo in negozio?

È possibile scaricare tutti questi modelli. Tuttavia, non tutti possono essere utilizzati a fini commerciali. Questo è l’ostacolo più comune nelle aziende.

La regola è semplice: se il modello riporta la licenza Apache 2.0 o MIT, puoi utilizzarlo a fini commerciali, modificarlo e distribuirlo senza bisogno di chiedere autorizzazione. Questo vale per la maggior parte dei modelli qui presenti.

Per tutti gli altri, vale la pena dare un'occhiata al file di licenza. Alcuni produttori consentono solo l'uso a fini di ricerca e privato. Altri fissano un limite massimo al numero di utenti. All'interno della stessa famiglia di modelli, le condizioni possono variare; pertanto, è necessario verificare la licenza del modello specifico, non quella del produttore in generale. Per la strategia di IA nell'azienda nel suo complesso, l'associazione offre un proprio pacchetto pratico.

Questi quattro hanno un problema

  • Codestral 22B è coperto dalla licenza "Non-Production" di Mistral. Non è consentito utilizzarlo a fini commerciali, sebbene sia scaricabile gratuitamente e sia disponibile su Ollama.
  • Command A (111B) È autorizzato solo per la ricerca e l'uso privato. Il suo successore, Command A+, è invece realmente libero dal maggio 2026.
  • Teuken 7B, versione base. Non utilizzabile a fini commerciali. Solo la variante con l'aggiunta "commercial" è soggetta alla licenza Apache 2.0.
  • MiniMax M2.7: l'uso commerciale è consentito solo previa espressa autorizzazione del produttore.

È possibile combinare più modelli?

È possibile, ma non in qualsiasi modo. Questi sono i quattro casi che si verificano più spesso.

Consultare i documenti

Adatto all'uso quotidiano

Modello di ricerca, poi modello linguistico

Il modello di ricerca individua i passaggi pertinenti nei tuoi documenti, mentre il modello linguistico formula la risposta sulla base di essi. I due modelli funzionano contemporaneamente e il loro fabbisogno di memoria si somma. Si tratta della struttura più diffusa in assoluto ed è già integrata in strumenti come AnythingLLM o Open WebUI.

Trascrivere e riassumere la seduta

Adatto all'uso quotidiano

Riconoscimento vocale, poi modello linguistico

Whisper genera il testo, mentre il modello linguistico lo trasforma in un log. I due processi vengono eseguiti in sequenza, non contemporaneamente, pertanto è sufficiente la memoria per il più grande dei due.

Analisi di documenti e moduli

Un errore comune

Un unico modello

In questo caso non serve alcuna combinazione. Modelli come Qwen3-VL o Gemma 4 integrano già il riconoscimento delle immagini. Chi collega in serie un modello di immagini e un modello linguistico perde in qualità, anziché guadagnarne.

Accelerare le risposte

Funziona, ma l'effetto è moderato

Prima un modello in scala ridotta, poi un modello in grande scala

Il modello più piccolo anticipa diverse parole, mentre quello più grande le verifica tutte in un’unica operazione. La qualità delle risposte rimane invariata, mentre la velocità aumenta. Su hardware standard, l’aumento è compreso tra un fattore di 1,5 e 2, non il multiplo spesso promesso.

Una regola vale in tutti i casi: se due modelli vengono eseguiti contemporaneamente, il loro fabbisogno di memoria si somma per intero; se vengono eseguiti in sequenza, è sufficiente lo spazio necessario per quello più grande.

Da dove provengono i dati.

In modo che tu possa verificare ciò che è scritto qui.

Come è nata questa pagina

La ricerca, la raccolta dei dati e la realizzazione sono state effettuate con il supporto dell'intelligenza artificiale. Tutte le informazioni sono state verificate confrontandole con le fonti originali indicate nei link sopra riportati. Ciò che non è stato possibile comprovare non è riportato in questa pagina.

Le versioni dei modelli, le licenze e i valori di misura cambiano rapidamente. Manca un modello o un dato non è più corretto? Scrivici, provvederemo a correggerlo.

Rimani aggiornato.

Seguiamo lo sviluppo dei modelli aperti per la Svizzera e vi teniamo aggiornati sui cambiamenti.