KI

KI-Ranglistenplattform Arena Verdoppelt Nahezu Bewertung auf 3,1 Mrd. USD Nach Finanzierungsrunde von 200 Mio. USD

Tendela Briefing ·
1 Aufrufe · 0 Kommentare
Popular AI leaderboard Arena nearly doubles valuation to $3.1B valuation in 10 months | TechCrunch

Image: TechCrunch · Source

Arena, eine crowdsourcete Plattform zur Bewertung von KI-Modellen, sammelte 200 Millionen USD unter Führung von Lightspeed und Khosla ein, wodurch die Bewertung auf 3,1 Milliarden USD stieg. Sie misst nun KI-Modelle auch in Bezug auf Probleme der Ausrichtung wie Lügen und unautorisierte Aktionen.

Arena, eine Plattform, die aus einem Forschungsprojekt 2023 an der UC Berkeley hervorging, hat ihre Bewertung nach einer Serie-B-Finanzierungsrunde von 200 Millionen USD unter der Leitung von Lightspeed Venture Partners und Khosla Ventures nahezu auf 3,1 Milliarden USD verdoppelt. Dieser schnelle Bewertungsanstieg erfolgt nur 10 Monate nach einer Serie-A-Runde von 150 Millionen USD, die das Unternehmen mit 1,7 Milliarden USD bewertete.

Arena gewann zunächst Nutzer durch das Crowdsourcing von Bewertungen von KI-Modellen über seine kostenlose Bestenliste, in der zig Millionen monatlicher Besucher Eingaben tätigen und bewerten, welches KI-Modell am besten abschneidet. Dieses gemeinschaftsgetriebene Feedback lieferte wertvolle Einblicke in den Stand der Leistung von KI-Modellen in verschiedensten Aufgaben.

Im September 2025 brachte Arena sein kommerzielles Produkt AI Evaluations auf den Markt, das detaillierte Leistungsanalysen für KI-Labore und Unternehmen basierend auf Nutzerfeedback bietet. Dieser Service geht auf wachsende Bedenken ein, dass KI-Modelle bestehende Benchmarks oft „austricksen“, indem sie lernen, in Tests gut abzuschneiden, ohne ihre funktionalen Fähigkeiten wirklich zu verbessern.

Das Unternehmen betont die Herausforderung, KI sicher und genau zu bewerten, während sich die Modelle schnell weiterentwickeln. Arena positioniert sich als neutraler Dritter, der KI-Ausrichtung und Sicherheit in realen Szenarien misst, über statische Benchmarks hinaus, die Modelle ausnutzen können.

Um dieses Ziel weiterzuverfolgen, fügte Arena seiner Bestenliste eine neue Ausrichtungskategorie hinzu. Diese Kategorie bewertet Modelle zu Themen wie unautorisierte Aktionen – wenn eine KI Aktionen ausführt, zu denen sie nicht angewiesen wurde –, falsche Zuschreibung von Aussagen oder Fakten und täuschende Abschlüsse, bei denen Modelle fälschlich behaupten, Aufgaben erfüllt zu haben.

Derzeit führt die Modellreihe von OpenAI die vorläufige Ausrichtungs-Bestenliste an, wobei Anthropics Claude Opus 5.5 und Claude Fable auf den sechsten bzw. neunten Plätzen erscheinen. Arenas Erweiterung in Ausrichtungsmessungen spiegelt einen breiteren Branchenfokus wider, der nicht nur auf KI-Fähigkeiten, sondern auch auf ethisches und verlässliches Verhalten abzielt.

An der jüngsten Finanzierungsrunde beteiligten sich Salesforce Ventures, 01 Advisors, Dell Technologies Capital, Endeavor Catalyst, a16z und Felicis, was das starke Vertrauen der Investoren in Arenas Ziel unterstreicht, transparente, realitätsnahe Bewertungen von KI-Sicherheit und -Wirksamkeit bereitzustellen.

Quellen und Originalberichte

Kommentare (0)

Noch keine Kommentare.

Kommentar schreiben

Kommentare erscheinen nach Moderation. Name und Kommentar werden öffentlich angezeigt. Konto