OpenAI ha inaspettatamente rivoluzionato il panorama dell'intelligenza artificiale con il lancio di GPT-OSS , il suo primo importante modello open source in oltre cinque anni. Questo sviluppo segna una svolta rispetto alla recente strategia dell'azienda, che si era concentrata principalmente su modelli proprietari e servizi chiusi. Con GPT-OSS, OpenAI torna alle sue origini, aprendo le porte a chiunque, singoli individui o organizzazioni, per accedere, eseguire e personalizzare un potente modello linguistico senza dover dipendere dalla sua piattaforma cloud o da connessioni internet.
Il nuovo modello è disponibile in due versioni: una con 120.000 miliardi di parametri e una più leggera con 20.000 miliardi . La variante più potente può essere eseguita su una singola GPU professionale con almeno 80 GB di memoria, mentre la versione più leggera è pensata per computer desktop e portatili convenzionali con 16 GB di RAM, democratizzando significativamente l'accesso alle funzionalità avanzate di intelligenza artificiale . Entrambe le versioni possono essere scaricate gratuitamente da piattaforme come Hugging Face e distribuite su servizi popolari come Azure o AWS.
Caratteristiche tecniche e tecnologia utilizzata
Con GPT-OSS , OpenAI ha introdotto due modelli progettati con un'architettura basata su Transformer e sulla combinazione di esperti (MoE) . Questo ottimizza l'utilizzo della memoria e la latenza attivando solo una frazione selezionata di esperti per ogni token di input, aumentando l'efficienza senza sacrificare la potenza. L'edizione da 120B utilizza 36 blocchi e attiva 5.100 miliardi di parametri per token, mentre l'edizione da 20B utilizza 24 blocchi e ne attiva 3.600 miliardi, risultando adatta ad hardware più economico.
Entrambi i modelli sono stati addestrati principalmente su dati in lingua inglese provenienti da ambiti STEM, programmazione e cultura generale , includendo una fase aggiuntiva di ottimizzazione e rinforzo supervisionati per migliorarne l' allineamento con le istruzioni umane . Le loro capacità includono il ragionamento a catena , la capacità di scomporre i passaggi intermedi prima di fornire una risposta e l'utilizzo di strumenti esterni come la navigazione web e l'esecuzione di codice Python.
Disponibilità , licenze e opzioni di integrazione
Uno dei principali vantaggi di GPT-OSS è la sua licenza Apache 2.0 , che elimina molte delle restrizioni tipiche di altri modelli proprietari: consente l' uso commerciale, la ridistribuzione e l'integrazione in tutti i tipi di progetti, dalle piccole startup alle grandi organizzazioni pubbliche o iniziative di ricerca e sviluppo. I pesi del modello sono disponibili in formato MXFP4 e includono implementazioni di riferimento in PyTorch e Apple Metal, oltre alla piena compatibilità con strumenti come Ollama, llama.cpp, LM Studio e vLLM , facilitandone l'utilizzo sia in ambito professionale che domestico.
L'installazione e la distribuzione di GPT-OSS-20B sono particolarmente semplici grazie a utility come LM Studio, che permette anche agli utenti senza esperienza di programmazione di scaricare e testare il modello localmente tramite un'interfaccia grafica. Inoltre, OpenAI ha pubblicato raccomandazioni e documentazione dettagliata per la messa a punto e l'adattamento dei modelli, nonché integrazioni predefinite per piattaforme cloud e on-premise.
Sicurezza, test e approccio responsabile
Il lancio di GPT-OSS si è concentrato non solo sull'apertura, ma anche sulla sicurezza e sull'uso responsabile dei modelli. OpenAI ha integrato nuovi meccanismi di revisione e validazione per prevenire i rischi associati all'uso improprio, soprattutto in aree sensibili come la sicurezza informatica e la creazione di agenti dannosi. A tal fine, ha implementato una metodologia di test avversariale (red teaming), con revisioni esterne da parte di esperti indipendenti e protocolli per simulare scenari di sfruttamento estremi.
Insieme al rilascio dei modelli, OpenAI ha lanciato una sfida di collaborazione in rete con premi in denaro per coloro che identificano vulnerabilità o comportamenti problematici, cercando una collaborazione attiva da parte della comunità globale nel rilevamento dei rischi. Inoltre, GPT-OSS espone la sua catena di ragionamento , facilitando la verifica delle risposte e il monitoraggio per prevenire distorsioni o errori critici.
Prestazioni e confronto con altri modelli aperti
Nei benchmark accademici e nei test di ragionamento , GPT-OSS-120B si comporta in modo analogo, e in alcuni ambiti addirittura superiore, ai recenti modelli proprietari di OpenAI come o4-mini, e surclassa altri come DeepSeek R1 o la serie Llama in determinati contesti. La versione 20B, ottimizzata per dispositivi domestici, mantiene un eccellente equilibrio tra efficienza e prestazioni , con punteggi altamente competitivi in ​​compiti di matematica, programmazione e salute.
OpenAI avverte che questi modelli aperti potrebbero essere più inclini a "allucinazioni" (errori fattuali) rispetto alle loro controparti basate sul cloud, date le differenze nelle fasi di addestramento e monitoraggio. Tuttavia, gli utenti ora hanno la possibilità di utilizzare modelli di alto livello senza bisogno di servizi online.