Tekoäly

AI-johtolistapalvelu Arena lähes kaksinkertaisti arvonsa 3,1 miljardiin dollariin 200 miljoonan dollarin rahoituskierroksen jälkeen

Tendela Briefing ·
1 näkymää · 0 Kommentit
Popular AI leaderboard Arena nearly doubles valuation to $3.1B valuation in 10 months | TechCrunch

Kuva: TechCrunch · Lähde

Arena, joukkoistettu tekoälymallien ranking-alusta, keräsi 200 miljoonaa dollaria johtajinaan Lightspeed ja Khosla, mikä nosti sen arvon 3,1 miljardiin dollariin. Se mittaa nyt tekoälymalleja yhteensopivuusongelmien, kuten valehtelun ja luvattomien toimien, näkökulmasta.

Arena, alun perin UC Berkeleyn vuoden 2023 tutkimusprojektista lähtöisin oleva alusta, on lähes kaksinkertaistanut arvonsa 3,1 miljardiin dollariin 200 miljoonan dollarin B-sarjan rahoituskierroksen jälkeen, jota johtoivat Lightspeed Venture Partners ja Khosla Ventures. Tämä nopea arvonnousu tapahtui vain 10 kuukautta sen jälkeen, kun yhtiön arvo oli A-sarjan 150 miljoonan dollarin kierroksen jälkeen 1,7 miljardia.

Arena houkutteli aluksi käyttäjiä joukkoistamalla tekoälymallien arvioinnin ilmaisen johtotaulukon kautta, johon kymmeniä miljoonia kuukausittaisia kävijöitä lähettää kyselyitä ja arvioi, mikä tekoälymalli toimii parhaiten. Tämä yhteisön antama palaute on tarjonnut arvokkaita näkemyksiä tekoälymallien suorituskykyyn eri tehtävissä.

Syyskuussa 2025 Arena lanseerasi kaupallisen tuotteensa AI Evaluations, joka tarjoaa yksityiskohtaisia suorituskykyanalyysejä tekoälylaboratorioille ja yrityksille käyttäjäpalautteen perusteella. Tämä palvelu vastaa kasvaviin huoliin siitä, että tekoälymallit manipuloivat nykyisiä testejä oppimalla suoriutumaan hyvin testeistä ilman, että toiminnalliset kyvyt aidosti paranevat.

Yhtiö korostaa tekoälyn turvallista ja tarkkaa arviointia haastavana, koska mallit kehittyvät nopeasti. Arena asemoituu neutraalina kolmansena osapuolena, joka mittaa tekoälyn yhteensopivuutta ja turvallisuutta todellisissa tilanteissa, yli staattisten testien, joita mallit voivat kiertää.

Tämän tavoitteen edistämiseksi Arena lisäsi johtotaulukkoonsa uuden yhteensopivuuskategorian. Tässä kategoriassa arvioidaan malleja muun muassa luvattomiin toimiin liittyen — missä tekoäly tekee toimia, joita sille ei ole annettu — virheelliseen lausumien tai tosiasioiden esittämiseen sekä petollisiin vastauksiin, joissa mallit virheellisesti väittävät suorittaneensa tehtäviä.

Tällä hetkellä OpenAI:n mallisto johtaa alustavaa yhteensopivuusjohtotaulukkoa, ja Anthropicin Claude Opus 5.5 ja Claude Fable sijoittuvat kuudenneksi ja yhdeksänneksi. Arenan laajentuminen yhteensopivuusmittareihin heijastaa laajempaa alan keskittymistä paitsi tekoälyn kyvykkyyteen myös eettiseen ja luotettavaan käyttäytymiseen.

Viimeisellä rahoituskierroksella osallistuivat Salesforce Ventures, 01 Advisors, Dell Technologies Capital, Endeavor Catalyst, a16z ja Felicis, mikä osoittaa vahvaa sijoittajien luottamusta Arenan tavoitteeseen tarjota läpinäkyviä, todelliseen maailmaan perustuvia arvioita tekoälyn turvallisuudesta ja tehokkuudesta.

Lähteet ja alkuperäiset raportit

Kommentit (0)

Ei vielä kommentteja. Aloita keskustelu.

Kirjoita kommentti

Kommentit julkaistaan moderoinnin jälkeen. Nimesi ja kommenttisi näkyvät julkisesti. Tili