Reflection AI išleidžia Beam – atviro svorio modelį, konkuruojantį su geriausiais Kinijos AI už mažesnę inferencijos kainą

Vaizdas: TechCrunch · Šaltinis
Brooklyno startuolis Reflection AI pristato Beam – 501 milijardo parametrų atviro svorio kalbos modelį, kuris teigia turintis panašią loginio samprotavimo galią kaip Kinijos GLM-5.2, tačiau naudoja 3–4 kartus mažiau skaičiavimo išteklių. Beam skirtas įmonių ir suverenių programų poreikiams, o jo svoriai bus išleisti šį mėnesį.
Reflection AI – Brooklyne įsikūrusi startuolių įmonė, įkurta buvusių Google DeepMind tyrėjų, oficialiai pristatė Beam – savo pirmąjį atviro svorio DI modelį, kuris siekia konkuruoti su pagrindiniais Kinijos kalbos modeliais, tokiais kaip Z.ai GLM-5.2. Įmonė paskelbė apie Beam išsamioje tinklaraščio įraše, po to kai Axios pranešė apie artėjančią jo premjerą. Beam yra teksto orientuotas ekspertų mišinio modelis, apmokytas plačiai naudojant stiprinamąjį mokymą, puikiai atliekantis loginį samprotavimą, programavimą ir autonominių agentų užduotis, žymiai sumažindamas inferencijos skaičiavimo išlaidas.
Beam turi 501 milijardą parametrų, iš kurių naudojimo metu aktyvūs yra 23 milijardai, ir buvo iš anksto apmokytas 23,8 trilijono žetonų. Išskirtinai modelyje įdiegta 1 milijono žetonų konteksto lango galimybė, leidžianti apdoroti gerokai ilgesnę įvestį nei dauguma konkurentų. Palyginimui, GLM-5.2 turi apie 744 mlrd. bendrų parametrų ir 40 mlrd. aktyvių parametrų. Reflection teigia, kad Beam atitinka GLM-5.2 pažangiuose loginio samprotavimo testuose, tačiau reikalauja 3–4 kartus mažiau inferencijos skaičiavimo, nors šie teiginiai dar nėra nepriklausomai patvirtinti.
Skirtas būti ekonomiškai efektyviu "darbinio arklio" modeliu, Beam orientuotas į įmones, viešojo sektoriaus organizacijas ir kūrėjus, siekiančius atvirų modelių su tvirtomis DI galimybėmis. Reflection taip pat konkuruoja su vakarietiškais DI laboratorijomis, tokiomis kaip Anthropic, OpenAI, Mistral, Meta, Cohere, ir naujesniais dalyviais kaip Mira Murati vadovaujama Thinking Machines Lab. Reflection atlikti bandymai rodo, kad Beam pranoksta Thinking Machines Inkling modelį programavimo užduotyse, nors Inkling yra multimodalis, o Beam – tik teksto.
Reflection pritraukė reikšmingą finansavimą, siekiantį apie 4,7 mlrd. USD iš žinomų investuotojų, įskaitant Nvidia, Sequoia Capital ir Lightspeed Venture Partners, o paskutinė vertė įvertinta 25 mlrd. USD. Įmonė taip pat susitarė dėl didelių skaičiavimo išteklių su SpaceX ir Nebius už daugiau nei 7 mlrd. USD, užtikrindama prieigą prie naujausių Nvidia GB300 GPU iki 2029 metų. Ši infrastruktūra yra esminė didelio masto pažangiems modeliams treniruoti, galintiems konkuruoti su pagrindiniais uždaro kodo tiekėjais.
Į ateitį žvelgiant, Reflection siekia sukurti „DI fabrikus“ – platformas, leidžiančias įmonėms ir suvereninėms valstybėms kurti lokalizuotas, pritaikytas DI sistemas, apmokytas pagal savus duomenis. Ši vizija dera su Nvidia generalinio direktoriaus Jenseno Huang'o raginimu sukurti atviras DI ekosistemas, pagrįstas Nvidia aparatine įranga. Ankstyvos partnerystės apima testavimą su Pietų Korėjos Shinsegae grupė, o susidomėjimas apima ir rizikos draudimo fondus bei prekybos įmones, ieškančias pritaikytų DI sprendimų.
Beam modelio svoriai ir išsami techninė dokumentacija turėtų būti išleisti iki 2026 metų spalio mėnesio, platinami per didelius debesijos tiekėjus ir hyperscaler platformas kartu su integracija į atviruosius šaltinius bibliotekas. Šis išleidimas gali tapti svarbiu įvykiu konkurencijoje tarp Vakarų ir Kinijos atvirų didelių kalbos modelių, ypač atsižvelgiant į Beam pažadėtą efektyvumą ir našumą.
Šaltiniai ir originalūs pranešimai
Skaityti originalų šaltinį ↗

Komentarai (0)
Komentarų dar nėra. Pradėkite diskusiją.
Rašyti komentarą
Komentarai publikuojami po moderavimo. Jūsų vardas ir komentaras bus vieši. Paskyra