Loading market data...

Kimi K3 od Moonshot AI uruchamia jądra H100 14,8 razy szybciej niż PyTorch, zaostrzając wyścig AI między USA a Chinami

Kimi K3 od Moonshot AI uruchamia jądra H100 14,8 razy szybciej niż PyTorch, zaostrzając wyścig AI między USA a Chinami

Firma Moonshot AI udostępniła Kimi K3, model o otwartych wagach z 2,8 biliona parametrów, który generuje jądra CUDA dla procesorów graficznych Nvidia H100 z prędkością 14,82 razy większą niż standardowy PyTorch. Ten skok wydajności bezpośrednio rzuca wyzwanie czołowym amerykańskim laboratoriom AI i pogłębia już i tak intensywną rywalizację w dziedzinie sztucznej inteligencji między USA a Chinami.

Co oznacza to przyspieszenie

Wynik 14,82 razy lepszy od PyTorcha to nie syntetyczny benchmark — to rzeczywista prędkość generowania jąder. Oznacza to, że Kimi K3 może pisać i optymalizować niskopoziomowy kod GPU znacznie szybciej niż powszechnie używana platforma PyTorch. Dla programistów prowadzących na dużą skalę trenowanie lub wnioskowanie na klastrach H100 różnica przekłada się na znacznie krótszy czas oczekiwania i niższe koszty obliczeniowe. Moonshot AI twierdzi, że model jest open-weight, więc badacze spoza firmy mogą analizować i dostosowywać architekturę.

Kimi K3 pojawia się w momencie, gdy Waszyngton zaostrza kontrole eksportu zaawansowanych układów scalonych do Chin. Amerykańskie laboratoria, takie jak OpenAI, Google DeepMind i Meta, od dawna dominują w dziedzinie dużych modeli językowych i optymalizacji GPU. Model Moonshot AI pokazuje, że chińskie firmy wciąż mogą zwiększać wydajność sprzętu bez dostępu do najnowszych układów Nvidii — H100 jest objęty ograniczeniami eksportowymi, ale w Chinach jest szeroko dostępny dzięki zapasom zgromadzonym przed wprowadzeniem zakazu. Liczba parametrów wynosząca 2,8 biliona stawia Kimi K3 wśród największych kiedykolwiek wydanych modeli o otwartych wagach, dorównując skalą zamkniętym modelom amerykańskich liderów.

Czynnik otwartych wag

Udostępniając Kimi K3 jako model o otwartych wagach, Moonshot AI zaprasza programistów z całego świata do rozwijania swojej pracy. Może to przyspieszyć adopcję w Chinach i innych krajach, podczas gdy amerykańskie firmy zazwyczaj utrzymują swoje najbardziej zaawansowane modele jako zamknięte. Ten krok wywiera również presję na amerykańskie laboratoria, aby albo otworzyły swoje modele, albo ryzykowały pozostanie w tyle w ekosystemie optymalizacji stron trzecich. Platforma CUDA firmy Nvidia pozostaje dominującym środowiskiem programowania GPU, ale model, który pisze jądra CUDA szybciej niż PyTorch, może zmienić sposób, w jaki programiści podchodzą do optymalizacji wydajności.

Moonshot AI nie ujawniła kosztów trenowania ani dokładnego sprzętu użytego do wytrenowania Kimi K3. Firma nie powiedziała również, czy model zostanie zaktualizowany, ani czy planuje wydać wersję zoptymalizowaną pod nadchodzącą architekturę Blackwell firmy Nvidia. Na razie model jest dostępny do pobrania, a pierwsze niezależne benchmarki spodziewane są w ciągu kilku tygodni.