Open Assistant je projekt, jehož cílem je poskytnout všem přístup ke skvělému modelu velkého jazyka založeného na chatu.
Nedávno se komunita LAION (Large-Scale Artificial Intelligence Open Network) odhalena prostřednictvím oznámení první vydání projektu «OpenAssistant», která vyvíjí chatbota s umělou inteligencí schopného porozumět a odpovídat na otázky v přirozeném jazyce, interagovat se systémy třetích stran a dynamicky extrahovat potřebné informace.
Pro ty, kteří LAION neznají, měli byste vědět, že vyvíjí nástroje, modely a kolekce dat pro vytváření bezplatných systémů strojového učení (sbírka LAION se například používá k trénování modelů systému syntézy obrazu Stable Diffusion).
Kromě kód pro školení a organizaci práce robota na vašem počítači, navrhuje se použít kolekci hotových modelů používat již vyškolený a jazykový model, natrénovaný na základě 600 tisíc příkladů dialogů ve formě žádost-odpověď (instrukce-provedení), připravený a revidovaný za účasti komunity nadšenců.
Spuštěna byla také online služba pro hodnocení kvality chatbota využívající znalostní model OA_SFT_Llama_30B_6, který pokrývá 30 miliard parametrů.
Náš tým během posledních několika měsíců neúnavně pracoval na shromažďování obrovského množství informací a textové zpětné vazby, aby vytvořil neuvěřitelně rozmanitou a jedinečnou datovou sadu speciálně navrženou pro trénovací jazykové modely nebo jiné aplikace AI.
S více než 600 000 datovými body vytvořenými lidmi, které pokrývají širokou škálu témat a stylů psaní, se naše datová sada ukáže jako neocenitelný nástroj pro každého vývojáře, který chce vytvořit výukové modely nové generace.
Pro zvýšení efektivity systému a vyhnout se nutnosti uložit velké množství přednastavených parametrů, projekt počítá s možností využití dynamicky aktualizované znalostní báze, která dokáže získat požadované informace prostřednictvím vyhledávačů nebo externích služeb.
Například při generování odpovědí může bot přistupovat k externím rozhraním API, aby získal další data. Z pokročilých funkcí je vyzdvihována i podpora personalizace, tedy možnost přizpůsobit se konkrétnímu uživateli na základě jeho předchozích frází.
Pro zájemce o instalaci OpenAssistant byste měli vědět, že jej můžete nainstalovat lokálně a že kandidátské modely Pythia SFT jsou dostupné z HuggingFace a lze je načíst prostřednictvím knihovny HuggingFace Transformers. Je tedy možné, že je lze používat s dostatečným hardwarem. Na HF jsou také prostory, které lze použít k chatování s kandidátem OA bez vlastního hardwaru. Tyto modely však nejsou definitivní a mohou přinést špatné nebo nežádoucí výsledky.
Modely LLaMa SFT nemohou být vydány přímo kvůli licenci Meta, ale závaží XOR budou brzy vydány.
Je důležité zmínit, že současný nejmenší model (Pythia) má parametry 12B a je obtížné jej spustit na spotřebním hardwaru, ale může běžet na jediném profesionálním GPU. V budoucnu mohou existovat menší modely a doufáme, že rozšíříme metody, jako je celočíselná kvantizace, které mohou pomoci spustit model na menším hardwaru.
Projekt neplánuje skončit u opakování schopností ChatGPT. Očekává se, že Open-Assistant podnítí rozvoj otevřeného vývoje v oblasti generování obsahu a zpracování dotazů v přirozených jazycích, stejně jako open source projekt Stable Diffusion podnítil vývoj nástrojů pro generování obrázků.
Kód projektu je napsán v Pythonu a je distribuován pod licencí Apache 2.0. Vývoj OpenAssistant lze použít k vytvoření vašich vlastních inteligentních asistentů a dialogových systémů, které nejsou vázány na externí API a služby. K práci stačí běžný spotřebitelský hardware, pracovat je možné například na chytrém telefonu. Data Open Assistant jsou vydána pod licencí Creative Commons, která umožňuje širokou škálu použití, včetně komerčního využití.
A konečně, pokud máte zájem dozvědět se o něm více a také si prohlédnout zdrojový kód, můžete se podívat na podrobnosti Na následujícím odkazu.