Miesiąc po premierze Grok 4.5 SpaceXAI dorzuca kolejną wersję i tym razem nie chodzi tylko o numer. Grok 4.6 ma wyniki, które stawiają go obok GPT-5.6 Sol, ale jego najmocniejszym argumentem może być po prostu cena.

Co SpaceXAI poprawiło w Grok 4.6?

SpaceXAI, wcześniej działające jako xAI, kieruje Grok 4.6 w stronę długich i wieloetapowych zadań. Chodzi o pracę z nieznanym tematem, analizę dużych repozytoriów kodu i przejście od pomysłu do działającej aplikacji bez ciągłego ręcznego prowadzenia modelu.

Według materiałów SpaceXAI i zestawień Artificial Analysis największy skok widać w benchmarkach agentycznych, takich jak Terminal-Bench, GDPval-AA i AA-Briefcase. Firma sugeruje też, że mniej tur dialogu przekłada się na niższe zużycie tokenów, choć w praktyce to trzeba jeszcze sprawdzić w realnych wdrożeniach, a nie tylko na tabelkach.

Jak Grok 4.6 wypada obok GPT-5.6 Sol i Kimi K3?

W rankingu Artificial Analysis Intelligence Index Grok 4.6 zdobył 61 punktów. To tyle samo, ile GPT-5.6 Sol Max, i o punkt więcej niż Kimi K3 od Moonshot AI. Wyżej są jeszcze Claude Opus 5 i Fable 5 z wynikami odpowiednio 63 i 62.

Sam benchmark nie rozstrzyga wszystkiego, ale daje prosty punkt odniesienia. Jeśli patrzeć na relację ceny do wyniku, Grok 4.6 wygląda ciekawie, bo zbliża się do droższych modeli OpenAI i Anthropic bez wejścia w ich najwyższy próg cenowy.

Ile kosztuje Grok 4.6 i gdzie już jest dostępny?

SpaceXAI wyceniło API Grok 4.6 na $2 za milion tokenów wejściowych i $6 za milion tokenów wyjściowych przy promptach poniżej 200 tys. tokenów. Przy dłuższym kontekście stawka rośnie do $4/$12. Dla polskiego odbiorcy to w przybliżeniu od ok. 7,5 zł i 22,5 zł za milion tokenów przy kursie rzędu 3,7–3,8 zł za dolara.

Według informacji podanych przez firmę model działa już w Grok Build, Cursorze oraz u partnerów takich jak OpenRouter, Vercel i Cloudflare. W komunikacji SpaceXAI pojawia się też podwojony limit startowy w pierwszym tygodniu po premierze.

Czy Grok 4.6 jest realną alternatywą dla droższych modeli?

Jeśli ktoś kupuje model głównie do kodowania, przeszukiwania wiedzy i budowy agentów, odpowiedź brzmi: być może tak. Nie dlatego, że Grok 4.6 wygrywa każdy benchmark, tylko dlatego, że zmniejsza różnicę między topem rynku a segmentem „wystarczająco dobry, ale bez bólu przy fakturze”.

To też kolejny sygnał, że rynek modeli AI przestaje układać się w prosty podział na tanie open-weight i bardzo drogie amerykańskie API. Środek stawki gęstnieje, a to dobra wiadomość dla firm, które chcą testować agentowe workflow bez płacenia stawek z najwyższej półki. Zobacz: Poprzednia wersja Grok 4.5.