AI

Platforma Rankingowa AI Arena Prawie Podwaja Wyceny do 3,1 Mld USD Po Rundzie Finansowania Za 200 mln USD

Tendela Briefing ·
1 odsłon · 0 Komentarze
Popular AI leaderboard Arena nearly doubles valuation to $3.1B valuation in 10 months | TechCrunch

Image: TechCrunch · Source

Arena, platforma rankingowa modeli AI oparta na crowdsourcingu, pozyskała 200 mln USD w rundzie finansowania prowadzonej przez Lightspeed i Khosla, podnosząc swoją wycenę do 3,1 mld USD. Obecnie ocenia modele AI pod kątem problemów z zgodnością, takich jak kłamstwa i nieautoryzowane działania.

Arena, platforma wywodząca się z projektu badawczego na Uniwersytecie Kalifornijskim w Berkeley w 2023 roku, niemal podwoiła swoją wycenę do 3,1 mld USD po rundzie finansowania serii B na kwotę 200 mln USD, prowadzonej przez Lightspeed Venture Partners i Khosla Ventures. Ten szybki wzrost wyceny nastąpił zaledwie 10 miesięcy po rundzie serii A na 150 mln USD, która wyceniała firmę na 1,7 mld USD.

Arena początkowo przyciągała użytkowników, wykorzystując crowdsourcing do oceny modeli AI za pomocą bezpłatnej listy rankingowej, gdzie dziesiątki milionów odwiedzających miesięcznie nadsyłają zapytania i oceniają, który model AI działa najlepiej. Ten napędzany przez społeczność feedback dostarczył cennych informacji na temat stanu wydajności modeli AI w różnych zadaniach.

We wrześniu 2025 roku Arena wprowadziła swój produkt komercyjny, AI Evaluations, zaprojektowany, aby oferować szczegółową analizę wydajności dla laboratoriów AI i przedsiębiorstw opartą na opinii użytkowników. Usługa ta odpowiada na rosnące obawy, że modele AI często „oszukują” istniejące benchmarki, ucząc się dobrze wypadać na testach bez rzeczywistej poprawy funkcjonalnych możliwości.

Firma podkreśla wyzwanie, jakim jest bezpieczna i dokładna ocena AI w miarę szybkiej ewolucji modeli. Arena pozycjonuje się jako neutralna trzecia strona, która mierzy zgodność i bezpieczeństwo AI w rzeczywistych scenariuszach, wykraczając poza statyczne benchmarki, które modele mogą wykorzystać.

Aby wspierać ten cel, Arena dodała nową kategorię zgodności do swojej listy rankingowej. Kategoria ta ocenia modele w kwestiach takich jak nieautoryzowane akcje – gdy AI podejmuje działania, do których nie została upoważniona – fałszywe przypisywanie wypowiedzi lub faktów oraz zwodnicze zakończenia, czyli gdy model fałszywie twierdzi, że wykonał zadania.

Obecnie zestaw modeli OpenAI prowadzi w wstępnym rankingu zgodności, za nimi plasują się Claude Opus 5.5 i Claude Fable firmy Anthropic na odpowiednio szóstym i dziewiątym miejscu. Rozszerzenie Areny o metryki zgodności odzwierciedla szersze zainteresowanie branży nie tylko zdolnościami AI, lecz także etycznym i wiarygodnym zachowaniem.

Ostatnia runda finansowania obejmowała udział Salesforce Ventures, 01 Advisors, Dell Technologies Capital, Endeavor Catalyst, a16z i Felicis, co podkreśla silne zaufanie inwestorów do celu Areny, jakim jest dostarczanie przejrzystych, rzeczywistych ocen bezpieczeństwa i skuteczności AI.

Źródła i oryginalne doniesienia

Komentarze (0)

Nie ma jeszcze komentarzy.

Napisz komentarz

Komentarze publikujemy po moderacji. Nazwa i komentarz będą publiczne. Konto