Grok Build miał przewagę w teście pamięci między projektami: zaliczył wszystkie trzy próby, podczas gdy Claude Code zaliczył dwie. Claude Code był jednak szybszy — całość zajął mu 66 sekund, a Grok Build potrzebował 165 sekund. To praktyczne porównanie dotyczyło konkretnych wersji, modeli i konfiguracji, więc wynik opisuje ten scenariusz, a nie każdy możliwy sposób pracy.

Grok Build wygrał próbę pamięci między projektami

W decydującym scenariuszu reguła zapisana podczas pracy nad jednym repozytorium miała pojawić się w innym projekcie. Grok Build przeniósł ją dzięki pamięci globalnej. Automatyczna pamięć Claude Code pozostała w teście przypisana do pierwszego repozytorium.

To właśnie tutaj powstała różnica w wyniku: oba narzędzia zaliczyły próby dotyczące lokalnych reguł projektu, ale tylko Grok Build przeniósł automatycznie zapamiętaną zasadę do drugiego repozytorium.

Jak działają pamięci obu agentów

xAI ogłosiło pamięć Grok Build 16 września 2026 roku. System obejmuje dwa poziomy: pamięć projektu oraz pamięć globalną. Grok Build zapisuje w notatkach między innymi konwencje, decyzje i informacje o projekcie, a późniejsze sesje mogą z nich korzystać.

Anthropic opisuje automatyczną pamięć Claude Code jako przypisaną do repozytorium i współdzieloną między jego worktree, czyli roboczymi drzewami tego samego projektu. Claude Code ma jednak także ręcznie zarządzane pliki instrukcji użytkownika: ~/.claude/CLAUDE.md oraz ~/.claude/rules/. Mogą one stosować wspólne zasady w wielu projektach.

To ważne rozróżnienie. Wynik testu dotyczył automatycznej pamięci projektu Claude Code, a nie wszystkich sposobów konfiguracji tego narzędzia.

Próba obejmowała cztery repozytoria Node.js

Porównanie opublikowane 21 września 2026 roku obejmowało cztery małe repozytoria Node.js i trzy scenariusze rozłożone na dwie sesje. Sprawdzano między innymi zapamiętanie poleceń testowych, decyzji dotyczących kodu oraz reguły mającej przejść do innego repozytorium.

Test wykorzystał dokładnie następujące zestawy:

  • Grok Build 1.0.40 z modelem Grok 4.6 przy wysokim poziomie wysiłku, przez klucz API xAI;
  • Claude Code 2.1.226 z modelem Opus 5 w ramach subskrypcji.

W dwóch próbach dotyczących reguł lokalnych oba agenty osiągnęły wynik pozytywny. Przewaga Grok Build pojawiła się dopiero przy pamięci między projektami.

Wyniki: Claude Code był szybszy

MetrykaGrok Build, Grok 4.6Claude Code, Opus 5
Zaliczone testy3 z 32 z 3
Łączny czas165 sekund66 sekund
Łączna liczba tokenów390 848576 863
Zgłoszony koszt testu0,41 USD1,05 USD

Claude Code zakończył wszystkie trzy próby w 66 sekund, podczas gdy Grok Build potrzebował 165 sekund. Grok Build wykorzystał przy tym 390 848 tokenów, a Claude Code 576 863.

Kwoty 0,41 USD i 1,05 USD są kosztami tych konkretnych sesji testowych. Wynikały z różnych modeli i sposobów dostępu, dlatego nie są miesięcznymi cenami planów ani bezpośrednim porównaniem abonamentów.

Który agent lepiej pasuje do twojego przepływu pracy?

Wybierz Grok Build, jeśli

  • chcesz, aby zapamiętana reguła automatycznie trafiała do wielu repozytoriów;
  • odpowiada ci połączenie pamięci projektu i pamięci globalnej;
  • ważniejsze jest dla ciebie przenoszenie kontekstu między projektami niż czas wykonania tej konkretnej serii zadań.

Wybierz Claude Code, jeśli

  • priorytetem jest szybkość pracy w scenariuszu podobnym do opisanego testu;
  • większość reguł dotyczy pojedynczego repozytorium;
  • chcesz samodzielnie ustawić wspólne instrukcje w ~/.claude/CLAUDE.md lub ~/.claude/rules/.

Wniosek jest wąski, ale praktyczny: Grok Build miał przewagę w automatycznym przenoszeniu reguły między projektami, natomiast Claude Code był szybszy i pozwala ręcznie skonfigurować instrukcje działające w wielu repozytoriach.