Open Assistant è un progetto volto a dare a tutti l'accesso a un grande modello di linguaggio di grandi dimensioni basato su chat.
Recentemente il Comunità LAION (Large-Scale Artificial Intelligence Open Network) svelata attraverso un annuncio la prima release del progetto «OpenAssistant»., che sviluppa un chatbot di intelligenza artificiale in grado di comprendere e rispondere a domande in linguaggio naturale, interagire con sistemi di terze parti ed estrarre dinamicamente le informazioni necessarie.
Per chi non conosce LAION, sappiate che sviluppa strumenti, modelli e raccolte di dati per creare sistemi di machine learning gratuiti (ad esempio, la raccolta LAION serve per addestrare i modelli del sistema di sintesi di immagini Stable Diffusion).
Aggiunta codice per formare e organizzare il lavoro del bot sul tuo computer, si propone di utilizzare una raccolta di modelli già pronti utilizzare già addestrato e un modello linguistico, addestrato sulla base di 600mila esempi di dialoghi sotto forma di richiesta-risposta (istruzione-esecuzione), preparato e rivisto con la partecipazione di una comunità di appassionati.
È stato inoltre lanciato un servizio online per valutare la qualità del chatbot, utilizzando il modello di conoscenza OA_SFT_Llama_30B_6, che copre 30 miliardi di parametri.
Il nostro team ha lavorato instancabilmente negli ultimi mesi raccogliendo enormi quantità di informazioni e feedback basati su testo per creare un set di dati incredibilmente vario e unico, progettato specificamente per l'addestramento di modelli linguistici o altre applicazioni di intelligenza artificiale.
Con oltre 600 punti dati generati dall'uomo che coprono una vasta gamma di argomenti e stili di scrittura, il nostro set di dati si rivelerà uno strumento prezioso per qualsiasi sviluppatore che desideri creare modelli didattici di nuova generazione.
Per aumentare l'efficienza del sistema ed evitare la necessità di farlo memorizzare grandi quantità di parametri preimpostati, il progetto prevede la possibilità di utilizzare una base di conoscenza dinamicamente aggiornata in grado di recuperare le informazioni richieste attraverso motori di ricerca o servizi esterni.
Ad esempio, durante la generazione di risposte, il bot può accedere ad API esterne per ottenere dati aggiuntivi. Tra le funzionalità avanzate si evidenzia anche il supporto alla personalizzazione, ovvero la capacità di adattarsi a un utente specifico in base alle sue frasi precedenti.
Per coloro che sono interessati all'installazione di OpenAssistant, dovresti sapere che puoi installarlo localmente e che i modelli Pythia SFT candidati sono disponibili da HuggingFace e possono essere caricati tramite la libreria HuggingFace Transformers. Pertanto, è possibile che possano essere utilizzati con hardware sufficiente. Ci sono anche spazi su HF che possono essere usati per chattare con il candidato OA senza il proprio hardware. Tuttavia, questi modelli non sono definitivi e possono produrre risultati scadenti o indesiderati.
I modelli LLaMa SFT non possono essere rilasciati direttamente a causa della licenza Meta, ma i pesi XOR verranno rilasciati presto.
È importante ricordare che l'attuale modello più piccolo (Pythia) ha parametri 12B ed è difficile da eseguire su hardware consumer, ma può essere eseguito su una singola GPU professionale. Potrebbero esserci modelli più piccoli in futuro e speriamo di avanzare metodi come la quantizzazione di interi che possono aiutare a eseguire il modello su hardware più piccolo.
Il progetto non prevede di fermarsi a ripetere le funzionalità di ChatGPT. Si prevede che Open-Assistant stimolerà lo sviluppo dello sviluppo aperto nel campo della generazione di contenuti e dell'elaborazione di query in linguaggi naturali, proprio come il progetto open source Stable Diffusion ha stimolato lo sviluppo di strumenti per la generazione di immagini.
Il codice del progetto è scritto in Python ed è distribuito con licenza Apache 2.0. Gli sviluppi di OpenAssistant possono essere utilizzati per creare i propri assistenti intelligenti e sistemi di dialogo che non sono legati ad API e servizi esterni. L'hardware di consumo convenzionale è sufficiente per funzionare, ad esempio è possibile lavorare su uno smartphone. I dati di Open Assistant sono rilasciati con una licenza Creative Commons che consente un'ampia gamma di usi, incluso l'uso commerciale.
Infine, se sei interessato a poter saperne di più oltre a poterne consultare il codice sorgente, puoi consultare i dettagli nel seguente link