CoreWeave wprowadza infrastrukturę NVIDIA Vera Rubin AI oraz platformę Forge dla produkcyjnie gotowej agentowej AI

Image: NVIDIA · Source
CoreWeave wprowadza do swojego chmury systemy NVIDIA Vera Rubin NVL72 oraz procesor Vera CPU, co przyspiesza działania AI agentów nawet 4,8-krotnie w zakresie inferencji i ponad 3-krotnie czas uruchamiania sandboxów. Równocześnie zaprezentowano platformę CoreWeave Forge - zintegrowane środowisko do trenowania i wdrażania modeli AI.
CoreWeave, dostawca chmury specjalizujący się w obciążeniach AI, ogłosił wdrożenie najnowszej generacji infrastruktury AI NVIDIA w swojej platformie chmurowej, co stanowi istotny krok w obsłudze produkcyjnych aplikacji agentowych AI. Bazując na niemal dziesięcioletniej bliskiej współpracy z NVIDIA, CoreWeave oferuje klientom system NVIDIA Vera Rubin NVL72 wyposażony w sieć Spectrum-X 102,4T Ethernet, zapewniając znaczną poprawę wydajności inferencji.
Cognition, laboratorium specjalizujące się w zastosowaniach AI i znane z ich inżyniera oprogramowania Devin AI, jest pierwszym użytkownikiem produkcyjnych obciążeń na Vera Rubin NVL72. Wstępne testy wykazały, że nowa infrastruktura zapewnia do 4,8-krotnego wzrostu przepustowości tokenów przy zadaniach inferencji związanych z inżynierią oprogramowania w porównaniu do poprzedniego systemu NVIDIA GB200 NVL72. Ta poprawa przekłada się na szybsze generowanie kodu w czasie rzeczywistym oraz bardziej responsywne wieloetapowe rozumowanie agenta Devin,—co jest kluczowe dla obsługi złożonych obciążeń z długimi kontekstami i wysoką współbieżnością.
Ponadto CoreWeave jest jednym z pierwszych dostawców chmury oferujących procesor NVIDIA Vera CPU zaprojektowany od podstaw dla obciążeń agentowej AI. Jego architektura wspiera uruchamianie tysięcy izolowanych środowisk jednocześnie, co jest krytyczne dla skalowania potrzeb treningu i oceny agentów. Testy pokazują, że wdrożenie procesorów Vera CPU przez CoreWeave zapewnia ponad trzykrotnie szybszy czas uruchamiania sandboxów agentów, przyspieszając izolowane środowiska uczenia ze wzmocnieniem i oceny. Racki Vera CPU oferują do 11 264 rdzeni na stojak, umożliwiając ponad 11 000 jednoczesnych izolowanych obciążeń agentów.
Uzupełniając tę infrastrukturę, CoreWeave uruchamia platformę Forge — zintegrowane środowisko mające na celu zamknięcie pętli rozwoju AI przez unifikację trenowania, oceny i ciągłej poprawy modeli. Forge łączy narzędzia takie jak Weights & Biases, doświadczenie OpenPipe oraz projekt notatnika open-source marimo, oferując otwarte i połączone środowisko odpowiednie dla różnych modeli AI, frameworków i chmur. Nowe funkcje to CoreWeave ARIA do analizy eksperymentów i iteracji kodu, Agent Lens do lepszego monitorowania produkcyjnych agentów i wykrywania błędów oraz CoreWeave Sandboxes do bezpiecznego i wydajnego uruchamiania izolowanych zadań AI agentów.
CoreWeave Forge wspiera bezserwerowe nadzorowane dostrajanie oraz uczenie ze wzmocnieniem, co według danych pozwala trenować modele 1,4 razy szybciej i przy 40% niższych kosztach względem zarządzanych samodzielnie rozwiązań. Dodatkowo otwartoźródłowy framework inferencji NVIDIA Dynamo zasila zarządzane usługi inferencyjne CoreWeave oraz wspiera RL Rollouts, umożliwiając ciągłe uczenie ze wzmocnieniem bez konieczności ponownego wdrażania.
Połączona platforma NVIDIA i CoreWeave przyciąga szerokie grono użytkowników, od startupów po przedsiębiorstwa. Na przykład Ennoble Care, duży dostawca opieki zdrowotnej, korzysta z infrastruktury CoreWeave do klinicznej inferencji AI wspierającej dokumentację i podejmowanie decyzji w wielu stanach USA. CoreWeave posiada także wyróżnienia w branży, w tym status Platynowy w kilku benchmarkach MLPerf i obsługuje dziewięć z dziesięciu czołowych laboratoriów AI.
Te postępy stawiają CoreWeave i NVIDIA jako kluczowych uczestników umożliwiających przejście agentów AI z faz eksperymentalnych do trwałych systemów produkcyjnych, zdolnych do rozwoju oprogramowania, wsparcia klinicznego i innych złożonych zadań w świecie rzeczywistym. Nowości zostały ogłoszone i zaprezentowane podczas wydarzenia CoreWeave Fully Connected w San Francisco.
Źródła i oryginalne doniesienia
Read the original source ↗

Komentarze (0)
Nie ma jeszcze komentarzy.
Napisz komentarz
Komentarze publikujemy po moderacji. Nazwa i komentarz będą publiczne. Konto