Alibaba, vydala open source AI, aby soutěžila s Llama 2

Alibaba AI

Alibaba se snaží konkurovat svým modelům AI s těmi, které již na trhu existují

Společnost Alibaba před několika dny oznámila , že vydala dva velké modely programovacích jazyků s otevřeným zdrojovým kódem (LLM) ve snaze konkurovat metaplatformám.

Modely umělé inteligence s názvem Qwen-7B a Qwen-7B-Chat mají každý sedm miliard parametrů, které se často používají k měření jejich síly. Jeden z těchto modelů umělé inteligence od Alibaby si klade za cíl etablovat se jako konverzační alternativa k nedávno uvedenému modelu „Llama 2“ od společnosti Meta.

Společnost v tiskové zprávě uvedla, že „ kód, váhy modelů a dokumentace k oběma modelům budou volně dostupné akademikům, výzkumníkům a komerčním institucím po celém světě .“ Jedná se o první případ, kdy velká čínská technologická společnost zpřístupnila své programy LLM.

Dodal, že spuštění těchto open-source modelů má za cíl umožnit těmto rozsáhlým modelům LLM přispět k úsilí o demokratizaci technologie umělé inteligence a podpořit startupy v oblasti LLM. Dále bylo zmíněno, že akademikům, výzkumníkům a komerčním institucím po celém světě bude poskytnut bezplatný přístup ke kódu, dokumentaci a interním mechanismům modelů.

Je třeba mít na paměti, že modely LLM AI mohou zpracovávat obrovské množství dat a generovat všechny druhy obsahu z textu, obrázků, zvuku a videa, kromě informací sloužících jako páteř chatbotů AI, jako je ChatGPT.

Pokud jde o své modely LLM, Alibaba uvedla, že oba jsou založeny na modelu Tongyi Qianwen LLM od Alibaby, který byl oznámen v dubnu. Tongyi Qianwen má několik verzí s různým počtem parametrů a Qwen-7B a Qwen-7B-Chat jsou dvě menší verze určené k tomu, aby pomohly malým a středním podnikům začít s umělou inteligencí.

„Naším cílem je podporovat inkluzivní technologie a umožnit více vývojářům a malým a středním podnikům využívat výhod generativní umělé inteligence,“ řekl CTO Alibaba Cloud Intelligence Zhou Jingren.

Zatímco velké technologické společnosti „otevřené zdroje“ svých modelů AI, otevřenost je předmětem diskuse. Stejně jako Alibaba i Meta připouští, že existují části LLaMA 2, ke kterým nelze přistupovat. Podobně OpenAI omezuje, co sdílíte z vaší GPT-4 AI. Nedávná studie ukazuje, že ChatGPT od OpenAI a LLaMA od Meta nejsou vůbec příliš otevřené.

Alibaba Cloud uvedla, že společnosti s méně než 100 miliony aktivních uživatelů měsíčně mohou modely implementovat zdarma; zatímco společnosti s více než 100 miliony aktivních uživatelů měsíčně budou muset před použitím obou modelů požádat o licenci od Alibaba. Podobně Llama 2 od Meta vyžaduje licenci pro uživatele s více než 700 miliony uživatelů.

Alibaba řekl, že Tongyi Qianwen měl verze s více parametry, které nebyly vydány zdarma, ale neuvedl, kolik parametrů jeho největší model obsahuje. Největší verze Meta's Llama 2 má 70 miliard parametrů.

„Dnes je Alibaba Cloud první, kdo v Číně spustil školení a implementační řešení pro celou sérii Llama 2,“ napsal Alibaba na svém kanálu WeChat. "Všichni vývojáři mohou vytvářet vlastní velké modely na Alibaba Cloud."

Čína se snaží dohnat Spojené státy v oblasti umělé inteligence a Peking povzbuzuje čínské společnosti k rychlému vývoji domácích a „ovladatelných“ modelů umělé inteligence, které by mohly konkurovat těm vyvinutým americkými společnostmi.

Kromě Alibaby mnoho technologických gigantů, jako je Huawei, v posledních měsících agresivně vyvíjí své vlastní modely umělé inteligence. Kašna

Jak již bylo zmíněno, pro zájemce jsou modely založené na Tongyi Qianwen společnosti Alibaba (Qwen-7B a verze Qwen-7B-Chat) pro konverzace dostupné komukoli s bezplatnou licencí a společnostem s více než 100 miliony uživatelů měsíčně, o jeden je třeba požádat.

A konečně, pokud se chcete o tomto tématu dozvědět více , podrobnosti naleznete na následujícím odkazu.


Přidat jako preferovaný zdroj v Googlu