OpenAI rivoluziona l'intelligenza artificiale con GPT-OSS: un modello di ponderazione aperto a tutti

  • GPT-OSS segna il ritorno di OpenAI ai modelli di peso aperti, disponibili in due versioni (parametri 120B e 20B), progettati per facilitare l'esecuzione locale e la personalizzazione.
  • Entrambi i modelli offrono ragionamento avanzato, generazione di codice e utilizzo di strumenti e sono stati sviluppati secondo una rigorosa metodologia di test di sicurezza.
  • La distribuzione con licenza Apache 2.0 consente l'uso gratuito, la modifica e lo sfruttamento commerciale, aprendo nuove opportunità per aziende, sviluppatori e organizzazioni pubbliche.
  • L'implementazione di GPT-OSS pone OpenAI in diretta competizione con soluzioni come Llama e DeepSeek, favorendo la democratizzazione e l'accessibilità dell'IA.

GPT-OSS

OpenAI ha inaspettatamente rivoluzionato il panorama dell'intelligenza artificiale con il lancio di GPT-OSS , il suo primo importante modello open source in oltre cinque anni. Questo sviluppo segna una svolta rispetto alla recente strategia dell'azienda, che si era concentrata principalmente su modelli proprietari e servizi chiusi. Con GPT-OSS, OpenAI torna alle sue origini, aprendo le porte a chiunque, singoli individui o organizzazioni, per accedere, eseguire e personalizzare un potente modello linguistico senza dover dipendere dalla sua piattaforma cloud o da connessioni internet.

Il nuovo modello è disponibile in due versioni: una con 120.000 miliardi di parametri e una più leggera con 20.000 miliardi . La variante più potente può essere eseguita su una singola GPU professionale con almeno 80 GB di memoria, mentre la versione più leggera è pensata per computer desktop e portatili convenzionali con 16 GB di RAM, democratizzando significativamente l'accesso alle funzionalità avanzate di intelligenza artificiale . Entrambe le versioni possono essere scaricate gratuitamente da piattaforme come Hugging Face e distribuite su servizi popolari come Azure o AWS.

Caratteristiche tecniche e tecnologia utilizzata

Con GPT-OSS , OpenAI ha introdotto due modelli progettati con un'architettura basata su Transformer e sulla combinazione di esperti (MoE) . Questo ottimizza l'utilizzo della memoria e la latenza attivando solo una frazione selezionata di esperti per ogni token di input, aumentando l'efficienza senza sacrificare la potenza. L'edizione da 120B utilizza 36 blocchi e attiva 5.100 miliardi di parametri per token, mentre l'edizione da 20B utilizza 24 blocchi e ne attiva 3.600 miliardi, risultando adatta ad hardware più economico.

Entrambi i modelli sono stati addestrati principalmente su dati in lingua inglese provenienti da ambiti STEM, programmazione e cultura generale , includendo una fase aggiuntiva di ottimizzazione e rinforzo supervisionati per migliorarne l' allineamento con le istruzioni umane . Le loro capacità includono il ragionamento a catena , la capacità di scomporre i passaggi intermedi prima di fornire una risposta e l'utilizzo di strumenti esterni come la navigazione web e l'esecuzione di codice Python.

libre software
Articolo correlato:
Il software libero di fronte alla sfida dell'intelligenza artificiale e ai conflitti con le grandi aziende tecnologiche

Disponibilità, licenze e opzioni di integrazione

Uno dei principali vantaggi di GPT-OSS è la sua licenza Apache 2.0 , che elimina molte delle restrizioni tipiche di altri modelli proprietari: consente l' uso commerciale, la ridistribuzione e l'integrazione in tutti i tipi di progetti, dalle piccole startup alle grandi organizzazioni pubbliche o iniziative di ricerca e sviluppo. I pesi del modello sono disponibili in formato MXFP4 e includono implementazioni di riferimento in PyTorch e Apple Metal, oltre alla piena compatibilità con strumenti come Ollama, llama.cpp, LM Studio e vLLM , facilitandone l'utilizzo sia in ambito professionale che domestico.

L'installazione e la distribuzione di GPT-OSS-20B sono particolarmente semplici grazie a utility come LM Studio, che permette anche agli utenti senza esperienza di programmazione di scaricare e testare il modello localmente tramite un'interfaccia grafica. Inoltre, OpenAI ha pubblicato raccomandazioni e documentazione dettagliata per la messa a punto e l'adattamento dei modelli, nonché integrazioni predefinite per piattaforme cloud e on-premise.

Sicurezza, test e approccio responsabile

Il lancio di GPT-OSS si è concentrato non solo sull'apertura, ma anche sulla sicurezza e sull'uso responsabile dei modelli. OpenAI ha integrato nuovi meccanismi di revisione e validazione per prevenire i rischi associati all'uso improprio, soprattutto in aree sensibili come la sicurezza informatica e la creazione di agenti dannosi. A tal fine, ha implementato una metodologia di test avversariale (red teaming), con revisioni esterne da parte di esperti indipendenti e protocolli per simulare scenari di sfruttamento estremi.

Insieme al rilascio dei modelli, OpenAI ha lanciato una sfida di collaborazione in rete con premi in denaro per coloro che identificano vulnerabilità o comportamenti problematici, cercando una collaborazione attiva da parte della comunità globale nel rilevamento dei rischi. Inoltre, GPT-OSS espone la sua catena di ragionamento , facilitando la verifica delle risposte e il monitoraggio per prevenire distorsioni o errori critici.

Prestazioni e confronto con altri modelli aperti

Nei benchmark accademici e nei test di ragionamento , GPT-OSS-120B si comporta in modo analogo, e in alcuni ambiti addirittura superiore, ai recenti modelli proprietari di OpenAI come o4-mini, e surclassa altri come DeepSeek R1 o la serie Llama in determinati contesti. La versione 20B, ottimizzata per dispositivi domestici, mantiene un eccellente equilibrio tra efficienza e prestazioni , con punteggi altamente competitivi in ​​compiti di matematica, programmazione e salute.

OpenAI avverte che questi modelli aperti potrebbero essere più inclini a "allucinazioni" (errori fattuali) rispetto alle loro controparti basate sul cloud, date le differenze nelle fasi di addestramento e monitoraggio. Tuttavia, gli utenti ora hanno la possibilità di utilizzare modelli di alto livello senza bisogno di servizi online.

alibaba AI
Articolo correlato:
Alibaba, ha rilasciato un'intelligenza artificiale open source per competere contro Llama 2

Aggiungi come fonte preferita in Google