Open Assistant je projekt čiji je cilj dati svima pristup velikom jezičnom modelu koji se temelji na chatu.
Nedavno LAION zajednica (Large-Scale Artificial Intelligence Open Network) predstavljen kroz najavu prvo izdanje projekta «OpenAssistant»., koji razvija chatbot umjetne inteligencije sposoban razumjeti i odgovarati na pitanja na prirodnom jeziku, komunicirati sa sustavima trećih strana i dinamički izvlačiti potrebne informacije.
Za one koji nisu upoznati s LAION-om, trebali biste znati da razvija alate, modele i zbirke podataka za stvaranje besplatnih sustava strojnog učenja (na primjer, kolekcija LAION koristi se za obuku modela sustava za sintezu slike Stable Diffusion).
Osim kod osposobiti i organizirati rad bota na vašem računalu, predlaže se korištenje zbirke gotovih modela koristiti već uvježban i jezični model, uvježban na temelju 600 tisuća primjera dijaloga u obliku zahtjeva-odgovora (uputa-izvršenje), pripremljenih i revidiranih uz sudjelovanje zajednice entuzijasta.
Pokrenuta je i online usluga za procjenu kvalitete chatbota pomoću modela znanja OA_SFT_Llama_30B_6 koji pokriva 30 milijardi parametara.
Naš je tim proteklih nekoliko mjeseci neumorno radio na prikupljanju golemih količina informacija i tekstualnih povratnih informacija kako bi stvorio nevjerojatno raznolik i jedinstven skup podataka posebno dizajniran za obuku jezičnih modela ili drugih AI aplikacija.
S više od 600 podatkovnih točaka koje su generirali ljudi i pokrivaju širok raspon tema i stilova pisanja, naš skup podataka pokazat će se neprocjenjivim alatom za svakog programera koji želi stvoriti modele učenja sljedeće generacije.
Za povećanje učinkovitosti sustava i izbjeći potrebu za pohraniti velike količine unaprijed postavljenih parametara, projektom je predviđena mogućnost korištenja dinamički ažurirane baze znanja koja može dohvaćati tražene informacije putem tražilica ili vanjskih servisa.
Na primjer, prilikom generiranja odgovora, bot može pristupiti vanjskim API-jima kako bi dobio dodatne podatke. Od naprednih značajki ističe se i podrška za personalizaciju, odnosno mogućnost prilagodbe određenom korisniku na temelju njegovih prethodnih fraza.
Za one koji su zainteresirani za instalaciju OpenAssistanta, trebali biste znati da ga možete instalirati lokalno i da su Pythia SFT modeli kandidati dostupni na HuggingFaceu i mogu se učitati putem biblioteke HuggingFace Transformers. Kao takvi, moguće je da se mogu koristiti s dovoljno hardvera. Također postoje prostori na HF-u koji se mogu koristiti za razgovor s OA kandidatom bez vlastitog hardvera. Međutim, ti modeli nisu konačni i mogu dati loše ili neželjene rezultate.
LLaMa SFT modeli ne mogu se objaviti izravno zbog Meta licence, ali će XOR težine biti objavljene uskoro.
Važno je spomenuti da trenutno najmanji model (Pythia) ima 12B parametara i teško ga je pokrenuti na potrošačkom hardveru, ali može raditi na jednom profesionalnom GPU-u. U budućnosti bi moglo biti manjih modela i nadamo se da ćemo unaprijediti metode poput cjelobrojne kvantizacije koje mogu pomoći u pokretanju modela na manjem hardveru.
Projekt se ne planira zaustaviti na ponavljanju mogućnosti ChatGPT-a. Očekuje se da će Open-Assistant potaknuti razvoj otvorenog razvoja u području generiranja sadržaja i obrade upita na prirodnim jezicima, kao što je open source projekt Stable Diffusion potaknuo razvoj alata za generiranje slika.
Kôd projekta napisan je u Pythonu i distribuira se pod licencom Apache 2.0. Razvoj OpenAssistant-a može se koristiti za stvaranje vlastitih inteligentnih pomoćnika i dijaloških sustava koji nisu vezani za vanjske API-je i usluge. Konvencionalni potrošački hardver dovoljan je za rad, na primjer, moguće je raditi na pametnom telefonu. Podaci Open Assistant objavljeni su pod licencom Creative Commons koja omogućuje širok raspon upotreba, uključujući komercijalnu upotrebu.
Konačno, ako ste zainteresirani da možete saznati više o tome, kao i da možete konzultirati izvorni kod, možete pogledati detalje U sljedećem linku.