Przejdź do głównej zawartości

Zarządzanie kontekstem i koszty

Okno kontekstu ma od 200 tys. tokenów (Haiku 4.5) do 1 mln (Opus, Sonnet i Fable 5 z aliasami [1m]). Gdy się zapełnia, jakość spada - to najważniejszy zasób, którym zarządzasz.

/compact [instrukcje] podsumowuje rozmowę i zwalnia miejsce, zachowując wątek. /clear startuje czystą rozmowę, ale zachowuje pamięć z CLAUDE.md.

Auto-compact uruchamia się sam przy zapełnieniu. Sterują nim /autocompact, --autocompact i CLAUDE_AUTOCOMPACT_PCT_OVERRIDE.

/context pokazuje, co zajmuje okno: memory files, narzędzia MCP, historię.

Oszczędzanie tokenów sprowadza się do pięciu nawyków: częste /clear między zadaniami, subagenci do operacji o dużym wyjściu (logi, testy), --bare w skryptach, ograniczanie liczby serwerów MCP (pomaga Tool Search) i zwięzły CLAUDE.md.

Ponowne użycie cache obniża koszty. Przełączanie modelu unieważnia cache - Claude Code o tym ostrzega. Fork sesji dzieli cache z rodzicem.

NOWE v2.1.243: promptCacheTtl. Na kluczu API albo providerze chmurowym ustaw promptCacheTtl, żeby cache głównej rozmowy żył 60 minut zamiast 5. Powrót po przerwie nie startuje wtedy z zimnego cache - realna oszczędność przy pracy w blokach z przerwami.

NOWE v2.1.248. Naprawiono cogodzinny miss cache: po odświeżeniu tokenu OAuth definicje narzędzi były renderowane od nowa i następna tura mijała się z cache, mniej więcej raz na godzinę. Długie sesje trzymają teraz cache przez refresh.

Haiku do prostych i szybkich rzeczy, Sonnet do codziennego kodowania, Opus do złożonego rozumowania, Fable do najtrudniejszych zadań. Alias opusplan daje Opus w plan mode i Sonnet w wykonaniu.

Thinking. Option+T albo Alt+T przełącza extended thinking. Słowa “think”, “think harder” i “ultrathink” w prompcie zwiększają budżet rozumowania. MAX_THINKING_TOKENS (minimum 1000, na przykład 31999) steruje budżetem, a --effort i /effort poziomem (low do max, plus ultracode).

  1. Po długiej sesji uruchom /context i zapisz zapełnienie.
  2. Uruchom /compact "zachowaj decyzje architektoniczne".
  3. Uruchom /context ponownie i porównaj liczby.

Zaliczenie: masz dwie liczby i wiesz, ile miejsca odzyskało streszczenie. Sprawdź też, czy Claude nadal pamięta decyzje, o których zachowanie prosiłeś.

Jeśli nic nie zgrzyta i zostaje czas: zobacz w /context, ile zajmują narzędzia MCP. Jeśli to duży kawałek, masz gotowy pomysł na oszczędność.

  • Okno kontekstu jest zasobem, a spadek jakości to pierwszy objaw jego zapełnienia.
  • Compact zostaje w wątku, clear go kończy - i to jest cała różnica.
  • Model dobierasz do trudności zadania, a nie zawsze do góry.

Następny krok: Najlepsze praktyki i workflow - cykl Explore, Plan, Code, Commit i to, czego wymagać od raportu agenta.

Częste pytania

Czym różni się /compact od /clear?

/compact podsumowuje dotychczasową rozmowę i zwalnia miejsce, zachowując wątek. /clear startuje czystą rozmowę, ale zachowuje pamięć z pliku CLAUDE.md. Compact wybierasz w środku zadania, clear między zadaniami.

Co unieważnia cache promptów?

Przełączenie modelu w trakcie sesji - Claude Code o tym ostrzega. Fork sesji natomiast dzieli cache z rodzicem, więc nie płacisz drugi raz za to samo.

Który model wybrać do jakiego zadania?

Haiku do rzeczy prostych i szybkich, Sonnet do codziennego kodowania, Opus do złożonego rozumowania, Fable do najtrudniejszych zadań. Alias opusplan daje Opus w trybie planowania i Sonnet w wykonaniu.

made with ❤️ by aitomate.pl - Łukasz Podgórski