OpenAI se v oblasti umělé inteligence nečekaně zaměřila. Oběd de GPT-OSS, její první open source jazykový model za více než pět let. Tento vývoj představuje odklon od nedávné strategie společnosti, která se spoléhala především na proprietární modely a uzavřené služby. S příchodem GPT-OSS se OpenAI vrací ke svým kořenům a otevírá dveře komukoli i subjektu k přístupu, spouštění a úpravě výkonného jazykového modelu bez nutnosti spoléhat se na cloudovou platformu nebo internetové připojení.
Nový model je k dispozici ve dvou verzích: jedna se 120.000 miliardami parametrů a odlehčená verze s 20.000 miliardami parametrů.Nejvýkonnější varianta může běžet na jedné profesionální grafické kartě s alespoň 80 GB paměti, zatímco slabší verze je určena pro běžné počítače a notebooky se 16 GB RAM, což... výrazně demokratizuje přístup k pokročilým funkcím umělé inteligenceObě verze lze zdarma stáhnout z platforem jako Hugging Face a nasadit na populární služby jako Azure nebo AWS.
Technické vlastnosti a použitá technologie
s GPT-OSSSpolečnost OpenAI představila dva modely navržené s architekturou založenou na Transformátor a směs expertů (MoE). To umožňuje optimalizovat využití paměti a latenci Aktivací pouze vybraného zlomku expertů na vstupní token se zvyšuje efektivita bez ztráty výkonu. Verze 120B používá 36 bloků a aktivuje 5.100 miliardy parametrů na token, zatímco verze 20B používá 24 bloků a aktivuje 3.600 miliardy, což usnadňuje provoz na dostupnějším hardwaru.
Oba modely byly trénovány primárně na anglických datech z oblastí STEM, programování a všeobecné znalosti, včetně dodatečné fáze kontrolovaného přizpůsobení a posilování ke zlepšení vašeho sladění s lidskými pokynyMezi jeho schopnosti patří myšlenkový řetězec, schopnost rozdělit mezikroky před poskytnutím odpovědi a také schopnost používat externí nástroje, jako je prohlížení webu nebo spouštění kódu v Pythonu.
Dostupnost, licencování a možnosti integrace
Jednou z velkých předností GPT-OSS je jeho Licence Apache 2.0, což eliminuje mnoho obvyklých omezení jiných uzavřených modelů: umožňuje jeho komerční využití, redistribuce a integrace ve všech typech projektů, od malých startupů až po velké veřejné subjekty nebo iniciativy výzkumu a vývoje. Váhy modelů jsou k dispozici ve formátu MXFP4 a mají referenční implementace v PyTorch a Apple Metal, stejně jako plnou kompatibilitu s nástroji, jako je Ollama, llama.cpp, LM Studio a vLLM, což usnadňuje jeho použití v profesionálním i domácím prostředí.
Instalace a uvedení GPT-OSS-20B do provozu je obzvláště jednoduché díky nástrojům, jako je LM Studio, které vám umožňují uživatelé bez zkušeností s programováním Stáhněte si a otestujte model lokálně pomocí grafického rozhraní. OpenAI navíc publikovala podrobnou dokumentaci a doporučení pro doladění a přizpůsobení modelů a také připravené integrace pro cloudové a on-premise platformy.
Bezpečnost, testování a zodpovědný přístup
Spuštění GPT-OSS se nezaměřovalo pouze na otevřenost, ale také na bezpečnost a zodpovědné používání modelů. OpenAI zavedla nové mechanismy kontroly a ověřování, aby se zabránilo rizikům spojeným se zneužitím, zejména v citlivých oblastech, jako je kybernetická bezpečnost nebo vytváření škodlivých agentů. Za tímto účelem zavedla metodologii adversarial testování (red teaming) s externími kontrolami prováděnými nezávislými odborníky a protokoly pro simulaci extrémních scénářů zneužití.
Spolu se zveřejněním modelů spustila společnost OpenAI červená týmová výzva s finančními odměnami pro ty, kteří identifikují zranitelnosti nebo problematické chování, a usilují tak o aktivní spolupráci globální komunity při detekci rizik. GPT-OSS navíc odhaluje své řetězec uvažování, což usnadňuje audit a monitorování odpovědí, aby se předešlo zkreslení nebo citlivým chybám.
Výkon a srovnání s jinými otevřenými modely
V akademické kritéria a testy uvažováníGPT-OSS-120B je srovnatelný s nedávnými proprietárními modely od OpenAI, jako je o4-mini, a v některých ohledech je dokonce překonává, a v určitých kontextech překonává i jiné, jako je DeepSeek R1 nebo řada Llama. Verze 20B, přizpůsobená pro domácí zařízení, si udržuje vynikající vztah mezi účinností a kapacitou, s velmi konkurenceschopnými výsledky v matematice, programování a úkolech týkajících se zdraví.
OpenAI varuje, že tyto otevřené modely mohou představovat větší sklon k „halucinacím“ (faktické chyby) ve srovnání s jejich cloudovými protějšky, a to vzhledem k rozdílům v školení a monitorování. Uživatelé však nyní mají možnost používat modely na vysoké úrovni bez nutnosti online služeb.