LAB · CLAUDE CERTIFIED ARCHITECT 7 min czytania

Egzamin próbny Claude Certified Architect: 60 pytań za darmo

Do certyfikacji napisałem sobie 60 własnych pytań. Zdałem: 833 na 1000. Teraz oddaję je za darmo. Działają w przeglądarce i nie musisz zakładać konta.

Ciemna karta egzaminacyjna z czterema odpowiedziami A do D, jedna zaznaczona na zielono, obok statystyki: 60 pytań, 120 minut, próg 720, 5 domen

Piętnastego lipca zdałem Claude Certified Architect Foundations z wynikiem 833 na 1000, przy progu ustawionym na 720. Jak wyglądał sam egzamin, opisałem w osobnym wpisie, a całość zebrałem w kompletnym przewodniku po certyfikacji Claude Certified Architect. Dziś oddaję Ci narzędzie, którym się przygotowałem. Pełny egzamin próbny, 60 pytań. Napisałem je sam, od zera, na bazie oficjalnego przewodnika. Rozwiążesz je za darmo na stronie egzaminu próbnego albo pobierzesz całość z GitHuba.

Co dokładnie dostajesz

To nie są pytania wyciekłe z egzaminu. Nie są to też przeróbki cudzych materiałów. Każde z 60 pytań napisałem sam podczas nauki, wzorując się na publicznym przewodniku Anthropic: te same domeny, te same wagi i ten sam format czterech odpowiedzi z jedną poprawną. Potem próbowałem każde pytanie obalić. Sprawdzałem dwie rzeczy. Czy poprawna odpowiedź faktycznie się broni. I czy któryś dystraktor nie jest przypadkiem też poprawny.

Cały ten egzamin to dosłownie jeden plik HTML. Działa w przeglądarce. Niczego nie instalujesz i nikomu nie wysyłasz danych. Postęp zapisuje się lokalnie u Ciebie, więc możesz zamknąć kartę w połowie i wrócić jutro dokładnie tam, gdzie skończyłeś.

Co sprawdza prawdziwy egzamin

Ale najpierw fakty. Anthropic wystartował z certyfikacją 12 marca 2026. Egzamin ma kod CCAR-F i składa się z 60 pytań zamkniętych, na które dostajesz 120 minut pod pełnym proktoringiem. Zdajesz od 720 punktów w skali od 100 do 1000. Materiał dzieli się na pięć domen o oficjalnych wagach:

Domena Waga Pytań w moim mocku
D1 · Architektura agentowa i orkiestracja 27% 16
D2 · Projektowanie narzędzi i integracja MCP 18% 11
D3 · Konfiguracja Claude Code i workflow 20% 12
D4 · Prompt engineering i structured output 20% 12
D5 · Zarządzanie kontekstem i niezawodność 15% 9

Z prawdziwego egzaminu wyniosłem jedno. On nie pyta o definicje. Pyta o decyzje. Prawie każde pytanie daje Ci kilka technicznie poprawnych opcji i każe wskazać tę, która pasuje do sytuacji, budżetu i wymagań. Swoje pytania zbudowałem tak samo. Każde ma scenariusz produkcyjny i cztery odpowiedzi. Różnice między nimi są subtelne.

WSPÓŁPRACA

To robię na co dzień — doradzam przy strategii AI i buduję agentów, którzy przeżywają demo.

Trzy pytania na próbę

Zamiast gadać, pokażę. Oto trzy pytania z mocku, z trzech różnych domen. Dasz radę bez podpowiedzi?

PYTANIE · D1 · ARCHITEKTURA AGENTOWA

Polityka firmy mówi, że każdy zwrot powyżej 500 dolarów musi zatwierdzić menedżer. Audyt wykazał jednak, że agent supportu kilka razy sam wywołał process_refund dla wyższych kwot. Jak zagwarantować, że polityka będzie respektowana?

  • A. Dodaj hook PreToolUse na process_refund, który blokuje każde wywołanie powyżej 500 dolarów i przekierowuje sprawę do eskalacji do człowieka.
  • B. Dopisz do system promptu instrukcję, żeby agent zawsze eskalował zwroty powyżej 500 dolarów.
  • C. Usuń process_refund z zestawu narzędzi agenta, żeby każdy zwrot obsługiwał człowiek.
  • D. Dotrenuj model na historycznych zgłoszeniach, żeby nauczył się progu 500 dolarów.

Poprawna: A. Reguła, która nie może zostać złamana nigdy, wymaga deterministycznego mechanizmu, nie prośby. Hook blokuje wywołanie niezależnie od tego, co postanowi model. Instrukcja w prompcie to dokładnie to, co audyt już obnażył, a usunięcie narzędzia wyrzuca całą legalną automatyzację poniżej progu.

PYTANIE · D4 · STRUCTURED OUTPUT

W dokumentach bez numeru zamówienia Claude w około 11% przypadków wymyśla wiarygodnie wyglądający numer, zamiast zasygnalizować jego brak. Systemy niżej traktują zmyślone wartości jak prawdziwe. Jaka poprawka na poziomie schematu działa najlepiej?

  • A. Dodaj do każdego pola wymagany współczynnik pewności i odcinaj niskie wartości dalej w pipeline.
  • B. Przełącz tool_choice na "auto", żeby model mógł pominąć ekstrakcję, gdy numeru brakuje.
  • C. Dodaj przykład few-shot z poprawnie sformatowanym numerem zamówienia.
  • D. Zrób pole po_number opcjonalnym (nullable) i poinstruuj model, żeby zwracał null, gdy wartości nie ma w źródle.

Poprawna: D. Model zmyśla, bo wymagane pole nie daje mu żadnego legalnego sposobu na powiedzenie „nie ma". Pole nullable plus instrukcja zwracania null usuwa przyczynę. Współczynnik pewności filtruje tylko skutki, a few-shot wzmacnia format i nie rozwiązuje braku danych.

PYTANIE · D5 · ZARZĄDZANIE KONTEKSTEM

W środku spójnej, wielogodzinnej refaktoryzacji sesja zbliża się do limitu kontekstu. Historia jest pełna nieaktualnych, pośrednich diffów, ale zadanie i cel się nie zmieniły, a najnowsze wersje plików są wciąż poprawne. Co zrobić, żeby kontynuować bez utraty wątku?

  • A. Zacznij nową sesję od zera i opisz zadanie jeszcze raz.
  • B. Zrób fork sesji, żeby odbić w rozbieżną linię pracy.
  • C. Poproś o większe okno kontekstu i pracuj dalej bez zmian.
  • D. Odpal /compact, który skondensuje nagromadzoną historię do podsumowania, i kontynuuj to samo zadanie.

Poprawna: D. Wątek jest jeden, a balastem jest wyłącznie historia pośrednich zmian. /compact usuwa martwy ciężar i zachowuje cel. Nowa sesja wyrzuciłaby wciąż aktualny stan, fork służy do rozgałęzień, a większe okno tylko odsuwa problem w czasie.

Zawahałeś się gdzieś między dwiema odpowiedziami? No właśnie. Tak ma być. Mnie takie wahanie męczyło przez pełne dwie godziny prawdziwego egzaminu.

Tryb nauki i tryb egzaminu

Aplikacja ma dwa tryby, bo uczysz się inaczej, niż się sprawdzasz. W trybie nauki zaznaczasz odpowiedź, możesz jeszcze zmienić zdanie, a po kliknięciu „Check answer” dostajesz pełny opis: dlaczego ta odpowiedź wygrywa i czym kuszą pozostałe trzy. Zegar staje, gdy czytasz feedback. Nic Cię nie goni. Tryb egzaminu odtwarza prawdziwy CCAR-F: 120 minut na zegarze, feedback dopiero po tym, jak oddasz arkusz, a do samego końca możesz flagować pytania i zmieniać odpowiedzi.

Gdy skończysz, dostajesz wynik w skali Anthropic: od 100 do 1000, z progiem 720. Widzisz też, jak poszło Ci w każdej z pięciu domen. Od razu wiesz, czy leżysz na MCP, czy na kontekście. Na końcu przeglądasz wszystkie pytania z odpowiedziami i uzasadnieniami. Możesz odfiltrować błędne i oflagowane.

Jak bym z tego korzystał

Gdybym zaczynał od zera, zrobiłbym tak:

PLAN PRZYGOTOWAŃ

  1. 1. Pierwsze podejście w trybie nauki. Bez presji czasu, pytanie po pytaniu. Czytaj każde wyjaśnienie, nawet gdy trafiłeś. Chodzi o zrozumienie, dlaczego dystraktory są złe.
  2. 2. Pełne podejście w trybie egzaminu. Jedno siedzenie, 120 minut, bez przerw. Symulujesz warunki, nie tylko sprawdzasz wiedzę.
  3. 3. Analiza rozbicia na domeny. Wynik per domena mówi Ci, gdzie doczytać. Wróć do dokumentacji tych dwóch najsłabszych obszarów.
  4. 4. Traktuj 720 na mocku jako podłogę, nie cel. Prawdziwy egzamin gra o klasę wyżej niż materiały przykładowe. Celuj w wynik z solidnym zapasem.

Jeszcze jedna rada spoza aplikacji. Przeczytaj moje 12 zasad budowy agentów. Spisałem je, gdy uczyłem się do tego samego egzaminu. Pokrywają spory kawałek domen D1 i D2.

Ważne zastrzeżenie. To nieoficjalny materiał do nauki. Nie jest powiązany z Anthropic ani przez Anthropic autoryzowany czy rekomendowany. Wszystkie 60 pytań napisałem samodzielnie, wzorując się wyłącznie na publicznie dostępnym przewodniku egzaminacyjnym. Nazwy Claude i Claude Certified Architect należą do Anthropic.

Mnie te pytania dowiozły do 833 na 1000. Ty możesz ten wynik przebić. Jak zdasz, napisz do mnie i pochwal się, jak poszło Ci w każdej z pięciu domen.

Gotowy na 60 pytań?

Za darmo, w przeglądarce, bez rejestracji. Postęp zapisuje się lokalnie.

SP

Szymon Paluch

Claude Certified Architect · ex-CTO

Sprawdź, czy jesteś gotowy na CCAR-F

60 pytań, 120 minut, próg 720. Ten sam format co na prawdziwym egzaminie, tylko bez proktora za plecami.

Rozwiąż egzamin próbny
Powiązane wpisy
Workflow Studio: podejrzyj i zaprojektuj workflow Claude Code
awesome-ai-gtm: mapa autonomicznego lejka GTM
RATCHET: iteracja wobec zamrożonej miarki