Rdzeń · krok 4/5Rdzeń programu czytasz bez konta. Quizy, zapis postępu i biblioteka — dla członków.
Agent pracuje w pętli: plan → działanie → obserwacja → kolejny krok. Ta pętla kręci się sama — ale nie bez ciebie. Ten moduł nie uczy jej programowania. Uczy, gdzie w nią wchodzisz: przy planie, przy kroku, który wygląda źle, i przy warunku końca.
- 1Wchodzisz tam, gdzie to tanie — korekta planu to jedno zdanie, korekta po dziesięciu krokach to odkręcanie. Uwagę wydajesz na trzy momenty, nie na każdy krok.
- 2„Gotowe" przestaje znaczyć „skończone" — warunek końca jest w twoim zleceniu, a deklaracja agenta to dopiero kandydat do odbioru.
- 3Wiesz, kiedy przestać poprawiać — trzecia ta sama poprawka to sygnał, że błąd siedzi w zleceniu. Nowe zlecenie w czystej sesji wygrywa z czwartą rundą.
- 4Ten sam rytm w każdym narzędziu — Claude Code przy kodzie, Cowork przy dokumentach, własny agent na API. Zmienia się narzędzie, pętla zostaje.
Pętla, którą prowadzisz
Czat odpowiada raz. Agent działa w pętli:
code1. Plan — rozbija zlecenie na kroki 2. Działanie — czyta pliki, szuka, edytuje, uruchamia 3. Obserwacja — patrzy na wynik kroku (błąd? test przeszedł?) 4. Decyzja — następny krok, poprawka albo koniec
Tak samo działa Claude Code przy kodzie i Cowork przy dokumentach. Różni się tylko to, czym agent działa — rytm jest ten sam.
Pętla kręci się szybko i sama. Dlatego twoja rola nie polega na pilnowaniu każdego kroku, tylko na trzech momentach, w których wejście kosztuje najmniej, a daje najwięcej.
Moment 1: plan, zanim cokolwiek się zmieni
Najtańsza korekta to ta przed pierwszym działaniem. Poproś o plan i przeczytaj go wobec zlecenia, nie wobec własnego entuzjazmu:
- •Czy plan dotyka tylko tego, czego dotyczy zlecenie? (pliki, foldery, źródła)
- •Czy mówi, jak agent sprawdzi wynik — i czy to jest twoje kryterium „skończone, gdy…"?
- •Czy jest krok, którego nie da się cofnąć? (usuwanie, wysyłka, zmiana na produkcji)
Jedno zdanie poprawki na tym etapie oszczędza godzinę odkręcania później. W Claude Code służy do tego plan mode, w Cowork — plan, który Claude pokazuje przed startem.
Moment 2: rozmiar kroku i punkty kontrolne
Duże zadanie zlecone jednym strzałem to loteria: jeśli coś poszło źle w kroku 2, kroki 3–10 budują na błędzie. Dlatego:
- •Małe kroki. „Najpierw przeanalizuj, potem zaproponuj plan, potem zrób pierwszy element" zamiast „zrób całość".
- •Punkt kontrolny po kroku, który dużo kosztuje albo wiele zmienia. Ty decydujesz, gdzie: „zatrzymaj się po zebraniu źródeł i pokaż listę, zanim zaczniesz pisać".
- •Jedna zmiana naraz. Gdy coś nie działa, wiesz, która zmiana to zepsuła.
- •Punkt powrotu. Przy kodzie — commit (i checkpointy w Claude Code); przy dokumentach — kopia albo osobny folder na wynik.
Moment 3: warunek końca
Agent kończy, gdy uzna, że skończył. To nie jest to samo, co „skończone" w twoim zleceniu.
- •Warunek końca piszesz w zleceniu: „skończone, gdy testy przechodzą i eksport otwiera się z polskimi znakami".
- •„Gotowe" od agenta to kandydat do odbioru, nie wynik. Odbierasz według kosztu błędu (moduł „Delegacja i weryfikacja").
- •Poproś o dowód zamiast deklaracji: komenda i wynik testów, lista sprawdzonych źródeł, porównanie przed i po.
Kiedy przerwać i zacząć od nowa
Pętla potrafi kręcić się w miejscu. Sygnały, że czas ją zatrzymać:
- •Ta sama poprawka trzeci raz. Agent naprawia, psuje coś obok, naprawia z powrotem. Nie dawaj czwartej szansy — zatrzymaj, wróć do punktu powrotu.
- •Plan się rozjechał. Agent robi rzeczy, których nie było w planie, i nie potrafi powiedzieć dlaczego.
- •Kontekst zarósł. Długa sesja, dużo prób, sprzeczne instrukcje — agent zaczyna gubić początek.
Wtedy nie dopisujesz kolejnej prośby. Poprawiasz zlecenie i zaczynasz od czystej sesji z tym, czego się nauczyliście: „Poprzednio próbowaliśmy X i Y, nie zadziałało, bo Z. Zacznij od…". Błąd, który wynika ze zlecenia, naprawia nowe zlecenie — nie kolejna runda poprawek.
Przykład: raport z pięciu źródeł (bez kodu)
codeZlecenie: „Zestaw porównanie 3 dostawców z dokumentów w folderze /oferty. Skończone, gdy każda liczba ma wskazane źródło (plik, strona). Niczego nie usuwaj, wynik zapisz jako nowy plik." Moment 1 — plan: agent chce przeczytać też /archiwum → poprawiasz: „tylko /oferty" Moment 2 — kontrola: „Pokaż tabelę z liczbami i źródłami, zanim napiszesz podsumowanie" → jedna cena bez źródła, prosisz o uzupełnienie Moment 3 — koniec: sprawdzasz 2 losowe liczby w oryginałach (próbka), cenę kluczowego dostawcy — do dna
Trzy wejścia, każde po kilka zdań. Resztę pętli agent prowadzi sam.
Dla budujących: jak pętla wygląda w kodzie
Jeśli budujesz własnego agenta na API, pętla to kilka linii. Model sam decyduje, czy wywołać narzędzie (wymuszony tool_choice na aktualnych modelach zwraca 400), więc warunkiem końca jest stop_reason:
pythonimport anthropic client = anthropic.Anthropic() def agent_loop(task: str, tools: list, max_iterations: int = 10): messages = [{"role": "user", "content": task}] for _ in range(max_iterations): response = client.messages.create( model="claude-sonnet-5-5", max_tokens=16000, tools=tools, messages=messages, ) # Całą odpowiedź (z blokami thinking) dopisujesz bez zmian messages.append({"role": "assistant", "content": response.content}) if response.stop_reason != "tool_use": return "".join(b.text for b in response.content if b.type == "text") # Wszystkie wywołania z tej tury → wszystkie wyniki w JEDNEJ wiadomości tool_results = [ {"type": "tool_result", "tool_use_id": b.id, "content": str(execute_tool(b.name, b.input))} for b in response.content if b.type == "tool_use" ] messages.append({"role": "user", "content": tool_results}) return "Przekroczono limit iteracji"
Trzy momenty z tego modułu mają tu swoje odpowiedniki: plan (pierwsza tura bez narzędzi albo osobny krok planowania), punkty kontrolne (zatwierdzenie przez człowieka przed narzędziem, które zmienia świat), warunek końca (limit iteracji + sprawdzenie wyniku poza modelem). Tekst wybierasz po typie bloku — na modelach 5.x myślenie jest domyślnie włączone, więc odpowiedź bywa poprzedzona blokiem thinking.