AI Vadošā platforma Arena gandrīz dubulto novērtējumu līdz 3,1 miljardam pēc 200 miljonu finansējuma kārtas

Attēls: TechCrunch · Avots
Arena, crowdsourced AI modeļu reitinga platforma, piesaistīja 200 miljonus dolāru, ko vadīja Lightspeed un Khosla, palielinot savu novērtējumu līdz 3,1 miljardam. Tā tagad novērtē AI modeļus pēc saskaņas jautājumiem, piemēram, melu un neatļautām darbībām.
Arena, platforma, kas radās 2023. gada UC Berkeley pētniecības projektā, gandrīz dubultoja savu novērtējumu līdz 3,1 miljardam pēc 200 miljonu dolāru B sērijas finansējuma kārtas, ko vadīja Lightspeed Venture Partners un Khosla Ventures. Šis straujais novērtējuma pieaugums notika tikai 10 mēnešus pēc 150 miljonu dolāru A sērijas kārtas, kas uzņēmumu novērtēja 1,7 miljardos.
Sākotnēji Arena piesaistīja lietotājus, izmantojot pūļa novērtējumus AI modeļiem savā bezmaksas līderu sarakstā, kur ik mēnesi desmitiem miljonu apmeklētāju iesniedz vaicājumus un vērtē, kurš AI modelis darbojas vislabāk. Šī kopienas vadītā atsauksme ir sniegusi vērtīgas zināšanas par AI modeļu sniegumu dažādos uzdevumos.
2025. gada septembrī Arena palaida savu komerciālo produktu AI Evaluations, kas piedāvā detalizētu veiktspējas analīzi AI laboratorijām un uzņēmumiem, balstoties uz lietotāju atsauksmēm. Šis pakalpojums risina pieaugošo bažu, ka AI modeļi mēdz apiet esošos rādītājus, mācoties labi izpildīt testus, nemaz nepilnveidojot funkcionālās spējas.
Uzņēmums uzsver izaicinājumu droši un precīzi novērtēt AI, jo modeļi strauji attīstās. Arena pozicionē sevi kā neitrālu trešo pusi, kas mēra AI saskaņotību un drošību reālās pasaules scenārijos, pārsniedzot statiskos rādītājus, ko modeļi var izmantot savā labā.
Lai turpinātu šo mērķi, Arena pievienoja līderu sarakstam jaunu saskaņošanas kategoriju. Šī kategorija novērtē modeļus tādos jautājumos kā neatļautas darbības — kad AI veic darbības, kuras tai nav pavēlēts veikt —, nepatiesa izteikumu vai faktu pieskaitīšana un maldinoši pabeigti darbi, kas attiecas uz modeļiem, kuri kļūdaini apgalvo, ka uzdevumi ir izpildīti.
Pašlaik OpenAI modeļu komplekts vada sākotnējo saskaņošanas līderu sarakstu, un Anthropic Claude Opus 5.5 un Claude Fable atrodas attiecīgi sestajā un devītajā vietā. Arenas paplašināšanās saskaņošanas metriku jomā atspoguļo plašāku nozares fokusu ne tikai uz AI spējām, bet arī uz ētisku un uzticamu uzvedību.
Nesenajā finansējuma kārtā piedalījās arī Salesforce Ventures, 01 Advisors, Dell Technologies Capital, Endeavor Catalyst, a16z un Felicis, kas uzsver investoru stipru pārliecību par Arenas mērķi nodrošināt caurspīdīgu, reāllaika AI drošības un efektivitātes novērtējumu.
Avoti un oriģinālziņas
Lasīt oriģinālo avotu ↗

Komentāri (0)
Komentāru vēl nav. Sāciet diskusiju.
Rakstīt komentāru
Komentāri tiek publicēti pēc moderēšanas. Jūsu vārds un komentārs būs redzami publiski. Konts