OpenAI revolucionira umjetnu inteligenciju s GPT-OSS-om: otvorenim modelom ponderiranja za sve

  • GPT-OSS označava povratak OpenAI-a modelima otvorene težine, dostupnim u dvije verzije (parametri 120B i 20B), osmišljenim za olakšavanje lokalnog izvršavanja i prilagodbe.
  • Oba modela nude napredno zaključivanje, generiranje koda i korištenje alata, a razvijeni su prema strogo propisanoj metodologiji sigurnosnog testiranja.
  • Licencirana distribucija Apache 2.0 omogućuje slobodno korištenje, modifikaciju i komercijalnu eksploataciju, otvarajući nove mogućnosti za tvrtke, programere i javne organizacije.
  • Implementacija GPT-OSS-a stavlja OpenAI u izravnu konkurenciju s rješenjima poput Llame i DeepSeeka, potičući demokratizaciju i dostupnost umjetne inteligencije.

GPT-OSS

OpenAI je neočekivano uzdrmao krajolik umjetne inteligencije lansiranjem GPT -OSS-a , svog prvog velikog modela otvorenog koda u više od pet godina. Ovaj razvoj događaja označava odstupanje od nedavne strategije tvrtke, koja se prvenstveno usredotočila na vlasničke modele i zatvorene usluge. S GPT-OSS-om, OpenAI se vraća svojim korijenima, otvarajući vrata svima ili bilo kojoj organizaciji da pristupe, pokrenu i prilagode moćan jezični model bez oslanjanja na svoju cloud platformu ili internetske veze.

Novi model dostupan je u dvije verzije: jedna sa 120.000 milijardi parametara i lakša s 20.000 milijardi . Snažnija varijanta može raditi na jednoj profesionalnoj grafičkoj kartici s najmanje 80 GB memorije, dok je manja verzija usmjerena na konvencionalna stolna i prijenosna računala sa 16 GB RAM-a, značajno demokratizirajući pristup naprednim mogućnostima umjetne inteligencije . Obje verzije mogu se besplatno preuzeti s platformi poput Hugging Facea i implementirati na popularnim servisima poput Azurea ili AWS-a.

Tehničke karakteristike i korištena tehnologija

S GPT-OSS-om , OpenAI je predstavio dva modela dizajnirana s arhitekturom temeljenom na Transformeru i mješavinom stručnjaka (MoE) . To optimizira korištenje memorije i latenciju aktiviranjem samo odabranog dijela stručnjaka po ulaznom tokenu, povećavajući učinkovitost bez žrtvovanja snage. Izdanje 120B koristi 36 blokova i aktivira 5.100 milijardu parametara po tokenu, dok izdanje 20B koristi 24 bloka i aktivira 3.600 milijardi, što ga čini prikladnim za pristupačniji hardver.

Oba modela su prvenstveno obučena na podacima na engleskom jeziku iz STEM područja, programiranja i općeg znanja , uključujući dodatnu fazu nadziranog podešavanja i pojačavanja kako bi se poboljšala njihova usklađenost s ljudskim uputama . Njihove sposobnosti uključuju zaključivanje o lancu misli , sposobnost razbijanja međukoraka prije davanja odgovora i korištenje vanjskih alata poput pregledavanja weba i izvršavanja Python koda.

free software
Povezani članak:
Slobodni softver suočava se s izazovom umjetne inteligencije i sukobima s velikim tehnološkim tvrtkama

Dostupnost, licenciranje i opcije integracije

Jedna od glavnih prednosti GPT-OSS-a je njegova Apache 2.0 licenca , koja eliminira mnoga uobičajena ograničenja drugih vlasničkih modela: omogućuje komercijalnu upotrebu, redistribuciju i integraciju u sve vrste projekata, od malih startupa do velikih javnih organizacija ili istraživačko-razvojnih inicijativa. Težine modela dostupne su u MXFP4 formatu i uključuju referentne implementacije u PyTorchu i Apple Metalu, kao i potpunu kompatibilnost s alatima kao što su Ollama, llama.cpp, LM Studio i vLLM , što olakšava njegovu upotrebu u profesionalnom i kućnom okruženju.

Instaliranje i implementacija GPT-OSS-20B posebno je jednostavna zahvaljujući uslužnim programima poput LM Studija, koji korisnicima bez iskustva u programiranju omogućuje preuzimanje i lokalno testiranje modela pomoću grafičkog sučelja. Nadalje, OpenAI je objavio preporuke i detaljnu dokumentaciju za fino podešavanje i prilagodbu modela, kao i gotove integracije za cloud i lokalne platforme.

Sigurnost, testiranje i odgovoran pristup

Pokretanje GPT-OSS-a nije se usredotočilo samo na otvorenost već i na sigurnost i odgovorno korištenje modela. OpenAI je uključio nove mehanizme pregleda i validacije kako bi spriječio rizike povezane sa zlouporabom, posebno u osjetljivim područjima poput kibersigurnosti i stvaranja zlonamjernih agenata. U tu svrhu implementirao je metodologiju suparničkog testiranja (crveni tim), s vanjskim pregledima neovisnih stručnjaka i protokolima za simuliranje ekstremnih scenarija iskorištavanja.

Uz objavu modela, OpenAI je pokrenuo izazov mrežnog timskog rada s financijskim nagradama za one koji identificiraju ranjivosti ili problematično ponašanje, tražeći aktivnu suradnju globalne zajednice u otkrivanju rizika. Nadalje, GPT-OSS otkriva svoj lanac zaključivanja , olakšavajući reviziju odgovora i praćenje kako bi se spriječile pristranosti ili kritične pogreške.

Performanse i usporedba s drugim otvorenim modelima

U akademskim testovima i testovima logičkog zaključivanja , GPT-OSS-120B postiže rezultate usporedive s, a u nekim područjima čak i nadmašuje, nedavne vlasničke OpenAI modele poput o4-mini, a u određenim kontekstima nadmašuje i druge poput DeepSeek R1 ili serije Llama. Verzija 20B, optimizirana za kućne uređaje, održava izvrsnu ravnotežu između učinkovitosti i performansi , s vrlo konkurentnim rezultatima u matematici, kodiranju i zdravstvenim zadacima.

OpenAI upozorava da bi ovi otvoreni modeli mogli biti skloniji "halucinacijama" (činjeničnim pogreškama) u usporedbi s njihovim ekvivalentima u oblaku, s obzirom na razlike u obuci i praćenju. Međutim, korisnici sada imaju mogućnost korištenja modela visoke razine bez potrebe za online uslugama.

alibaba AI
Povezani članak:
Alibaba je izdala AI otvorenog koda za natjecanje s Llama 2

Dodaj kao preferirani izvor na Googleu