Jak działają limity w Claude Pro - dwie warstwy, nie jeden licznik
Limit w Claude Pro nie jest jednym miesięcznym licznikiem, tylko systemem dwuwarstwowym. Zgodnie z dokumentacją Anthropic pierwsza warstwa to okno 5 godzin, a druga to pułap tygodniowy obejmujący wszystkie modele.
Obie działają równolegle, więc w sufit można uderzyć na 2 sposoby. W Claude limity resetują się w dwóch różnych rytmach, a nie raz w miesiącu. To zmienia sposób planowania pracy: nie chodzi o to, żeby nie przekroczyć miesięcznego pakietu, tylko żeby rozłożyć ciężkie zadania i nie wyczerpać okna w najgorszym momencie. Wybór między Pro a Max rozbieram we wpisie Claude Pro vs Max.
Dlaczego nikt nie poda Ci liczby wiadomości
Anthropic celowo nie publikuje stałej liczby wiadomości na plan i warto zrozumieć dlaczego. W materiałach o limitach pada wprost stwierdzenie, że nie ma ustalonego licznika wiadomości.
Zgodnie z dokumentacją na zużycie wpływa 7 czynników. Są to: długość wiadomości, wielkość załączonych plików, długość bieżącej rozmowy, użyte narzędzia takie jak Research czy wyszukiwanie w sieci, wybrany model, poziom wysiłku oraz tworzenie i wykorzystywanie artefaktów. Przy tylu zmiennych każda liczba podana jako „tyle wiadomości dostaniesz” byłaby zmyślona.
To, co Anthropic deklaruje, jest za to konkretne i porównywalne. Plan Pro daje co najmniej 5 razy większe zużycie na sesję niż wersja darmowa, a Max odpowiednio 5 lub 20 razy więcej niż Pro. Miarą jest zużycie w oknie czasowym, a nie liczba wysłanych wiadomości.
Dlatego uważaj na poradniki podające konkretne liczby wiadomości. Krążą od lat, pochodzą zwykle ze starych komunikatów i nikt ich nie aktualizuje, a różnica między krótkim pytaniem a rozmową z załączonym plikiem PDF potrafi być kilkudziesięciokrotna.
Okno pięciu godzin - limit na bieżącą pracę
Okno pięciogodzinne to krótkoterminowy próg zużycia, który zgodnie z dokumentacją resetuje się co 5 godzin. Kiedy je wyczerpiesz, widzisz komunikat i czekasz na reset.
Okno liczy się od pierwszej wiadomości, a nie od północy, i to zmienia planowanie dnia. Zaczniesz ciężkie zadanie o 15, to Twoje okno zamknie się około 20, niezależnie od pory dnia.
W ustawieniach zużycia widać dokładnie, na czym stoisz, i warto tam zaglądać przed dużym zadaniem. Anthropic pokazuje 2 paski postępu: zużycie bieżącej sesji pięciogodzinnej razem z czasem pozostałym do jej końca oraz stan limitów tygodniowych.
Limit tygodniowy i osobna pula na Opusa
Obok okna pięciogodzinnego działa drugi, dłuższy pułap: limit tygodniowy. Zgodnie z dokumentacją resetuje się o stałej porze każdego tygodnia, przypisanej do Twojego konta.
Ta pora nie zależy od tego, kiedy zacząłeś korzystać z Claude ani kiedy wykupiłeś subskrypcję, a pełną tygodniową pulę dostajesz w każdym cyklu. To ta warstwa najczęściej zaskakuje intensywnych użytkowników, bo w porównaniach planów prawie się o niej nie mówi.
Najważniejszy szczegół dotyczy modeli i tu w sieci krąży sporo bałaganu. W ustawieniach zużycia Anthropic pokazuje osobno termin resetu limitu tygodniowego dla Opusa i osobno dla pozostałych modeli. Praktycznie oznacza to, że najcięższy model ma własne rozliczenie, więc wyczerpanie puli na Opusie nie musi odbierać możliwości pracy na lżejszych modelach.
Warto też wiedzieć, że Anthropic zastrzega sobie prawo do dodatkowych ograniczeń. W dokumentacji pada zapowiedź limitów tygodniowych i miesięcznych oraz ograniczeń dotyczących konkretnych modeli i funkcji, stosowanych w celu zapewnienia sprawiedliwego dostępu.
Jedna pula na czat, Cowork i Claude Code
Zużycie ze wszystkich powierzchni Claude liczy się do tego samego limitu. Dokumentacja wymienia je wprost: claude.ai, Claude Code i aplikacja desktopowa czerpią z jednej puli.
W praktyce 1 ciężka sesja Cowork rano potrafi zjeść limit potrzebny na pracę z kodem po południu. Dlatego przy intensywnym dniu warto zaplanować alokację z góry: drobne pytania w czacie, wieloetapowe zadania na plikach w Cowork, a robotę na kodzie w Claude Code.
Dlaczego Cowork zużywa limit szybciej niż czat
Anthropic pisze wprost, że praca w Cowork zużywa więcej limitu niż rozmowa z Claude. Powodem jest to, że złożone, wieloetapowe zadania są kosztowne obliczeniowo i wymagają więcej tokenów.
1 zadanie w trybie agentowym to nie 1 odpowiedź, tylko cała seria operacji. Claude planuje pracę, dzieli ją na etapy, wykonuje kod, czasem koordynuje kilku podagentów równolegle i zapisuje wynik. Stąd zależność: im dłuższe i bardziej złożone zadanie, tym więcej limitu pochłania.
Dokumentacja podaje przy tym 3 konkretne zalecenia dla często uderzających w sufit. Łącz powiązaną pracę w jedną sesję zamiast rozbijać ją na wiele, używaj zwykłego czatu do prostszych zadań niedotykających plików i obserwuj własne zużycie w ustawieniach. Naturę samej pracy agentowej opisuję we wpisie Claude Cowork - co to jest.
Jest jeszcze jeden kosztowny tryb, o którym łatwo zapomnieć. Tryb automatycznego zatwierdzania w Cowork zużywa więcej limitu niż pozostałe, bo każda akcja przechodzi dodatkową kontrolę bezpieczeństwa.
Limit zużycia to nie to samo co limit długości rozmowy
Anthropic rozróżnia 2 zupełnie różne limity, a mylenie ich prowadzi do złych wniosków. Limit zużycia mówi, ile możesz pracować w danym czasie. Limit długości dotyczy okna kontekstu jednej rozmowy.
Rozmiar okna kontekstu zależy od modelu i planu. Zgodnie z dokumentacją na planach płatnych najnowsze modele obsługują do 1 miliona tokenów, a pozostałe 500 albo 200 tysięcy. Część okna jest zawsze zarezerwowana na odpowiedź Claude, więc najdłuższa możliwa rozmowa jest nieco krótsza niż pełne okno.
Przy włączonym wykonywaniu kodu działa automatyczne zarządzanie kontekstem i to ma bezpośredni wpływ na limit. Gdy rozmowa zbliża się do granicy okna, Claude streszcza wcześniejsze wiadomości, żeby móc kontynuować. Dokumentacja zaznacza jednak, że takie długie rozmowy zużywają więcej limitu, i sugeruje rozpoczęcie nowej, gdy zbliżasz się do sufitu.
Rozróżnienie ma prostą konsekwencję praktyczną. Po wyczerpaniu limitu zużycia czekasz na reset, kupujesz kredyty albo zmieniasz plan. Po osiągnięciu limitu długości zaczynasz nową rozmowę albo przenosisz materiały do projektu.
Co robi buforowanie i dlaczego projekty się opłacają
Zgodnie z dokumentacją treści w projektach są buforowane i przy ponownym użyciu nie liczą się do limitu. To najbardziej niedoceniany sposób na wyciśnięcie więcej z tego samego planu.
Anthropic wymienia 2 dodatkowe mechanizmy działające poza projektami. Pierwszy to częściowe buforowanie często używanych, podobnych zapytań. Drugi to pamiętanie kontekstu z wcześniejszej części rozmowy, dzięki czemu nie trzeba go powtarzać.
Wniosek jest konkretny. Jeśli wracasz do tych samych dokumentów, wrzuć je raz do projektu zamiast załączać przy każdym pytaniu. Przy pracy na stałym zestawie materiałów różnica w zużyciu bywa większa niż wszystkie inne oszczędności razem wzięte.
Co się dzieje, gdy przekroczysz limit
Nie ma automatycznych dopłat, ale są kredyty zużycia, które sam możesz włączyć. To rozróżnienie warto znać, bo od niego zależy, czy w ogóle zobaczysz dodatkowy rachunek.
Zgodnie z dokumentacją na planach płatnych możesz włączyć kredyty zużycia i pracować dalej po standardowych stawkach API. Domyślnie jednak po wyczerpaniu limitu po prostu widzisz komunikat i czekasz na reset. Kredyty są decyzją użytkownika, a nie ukrytą opłatą.
Masz więc 4 wyjścia i każde ma inny koszt:
- Poczekaj na reset okna i wróć do pracy, gdy próg się odnowi. Koszt zerowy.
- Przełącz się na zwykły czat, który zużywa mniej i wystarcza do lżejszych zadań.
- Włącz kredyty zużycia, jeśli przerwa jest droższa niż stawka API.
- Przejdź na wyższy plan. Zmiana działa od razu, a niewykorzystany czas jest zaliczany na poczet nowego planu.
Który ruch ma sens, zależy od tego, jak często uderzasz w sufit. Sporadycznie - poczekaj. Codziennie w środku pracy - to sygnał, że plan jest po prostu za mały. Pełne kwoty w złotówkach zebrałem w przewodniku Claude Cowork cennik.
Ile realnie daje Max ponad Pro
Max nie daje więcej funkcji, tylko wyższy próg zużycia w tym samym oknie czasowym. Zgodnie z opisem planów Max 5x podnosi go pięciokrotnie, a Max 20x dwudziestokrotnie względem Pro.
Max 5x to nie 5 razy więcej tokenów miesięcznie, tylko 5 razy wyższy próg w jednostce czasu. To najczęściej mylone miejsce w całym cenniku. Nie kupujesz większego worka na miesiąc, tylko szerszą rurę na godziny szczytu.
Do tego dochodzi priorytetowy dostęp w okresach dużego obciążenia oraz wcześniejszy dostęp do nowych modeli i funkcji, co Anthropic wymienia wśród głównych korzyści planu. Warto też wiedzieć o różnicy w rozliczeniu: Max jest dostępny wyłącznie w abonamencie miesięcznym, podczas gdy Pro ma także wariant roczny.
Przy zmianie planu obowiązują konkretne zasady rozliczenia. Przejście na wyższy wariant Max jest rozliczane proporcjonalnie do końca cyklu, a przy przejściu z rocznego Pro na Max pozostała wartość wraca jako środki na koncie, o ile adres rozliczeniowy się nie zmienił.
Jak nie marnować limitu
Kilka nawyków sprawia, że ten sam limit starcza na wyraźnie więcej pracy. Część z nich Anthropic podaje wprost w zaleceniach.
- Wyłączaj nieużywane narzędzia i connectory. Dokumentacja mówi wprost, że są kosztowne tokenowo i obciążają zarówno okno kontekstu, jak i limit zużycia.
- Obniż poziom wysiłku przy rutynowych zadaniach. Wyższy poziom zużywa więcej tokenów, a przy prostej robocie nic nie wnosi.
- Łącz powiązane pytania w jedną wiadomość zamiast wysyłać serię krótkich, bo każda runda kosztuje osobno.
- Dziel duże zadania agentowe na mniejsze. Łatwiej skorygować kurs i nie tracisz całego okna na jedną nieudaną próbę.
- Ciężkie zadania planuj na początek okna, a nie pod koniec już wykorzystanego.
Warto wdrożyć je od pierwszego dnia, zanim w ogóle poczujesz limit. Dzięki temu nawet na planie Pro wyciśniesz wyraźnie więcej, niż rzucając wszystkim naraz w tryb agentowy.
Podsumowanie
Limit w Claude Pro to 2 warstwy: okno 5 godzin i pułap tygodniowy resetujący się o stałej porze. Anthropic nie podaje liczby wiadomości, bo zużycie zależy od długości rozmowy, załączników, modelu, poziomu wysiłku i użytych narzędzi.
Max podnosi próg 5 lub 20 razy względem Pro w tej samej jednostce czasu. W ustawieniach zużycia widać przy tym osobny reset dla Opusa i osobny dla pozostałych modeli. Cowork zjada limit szybciej niż czat, bo jedno zadanie to seria operacji, a czat, Cowork i Claude Code czerpią z jednej puli.
Po przekroczeniu limitu nie ma automatycznych dopłat: czekasz na reset, włączasz kredyty zużycia po stawkach API albo zmieniasz plan. Jeśli uderzasz w sufit codziennie, to nie kwestia nawyków, tylko sygnał, że pora spojrzeć na Pro kontra Max.
Limity przestają uwierać, gdy praca jest poukładana w procesy zamiast w przypadkowe rozmowy. Tak to układam we wdrażaniu AI.
