W marcu 2026 zbudowałem 19-agentowy zespół programistów działający w całości wewnątrz Claude Code. Nie jako zabawę. Jako narzędzie produkcyjne — do budowania moich własnych SaaS-ów. Ten artykuł to uczciwe podsumowanie: co działa, co nie, ile to kosztuje i kiedy ma sens.
Dlaczego 19 agentów zamiast jednego Claude
Jeden Claude robi wiele rzeczy jednocześnie i żadnej nie robi dobrze. Piszesz mu "zbuduj mi endpoint płatności Stripe" — dostaje backend, ale zapomina o walidacji schematu. Dodajesz "z testami" — testy są, ale nie pokrywają edge cases. "I zabezpiecz" — patch pojawia się, ale devops nie skonfigurował zmiennych środowiskowych dla staging.
Problem to brak podziału odpowiedzialności. Jeden model ma za dużo kontekstu, za dużo priorytetów, za mało specjalizacji. Rozwiązaniem jest to samo co w prawdziwych firmach: specjaliści z wąskim zakresem odpowiedzialności + PM który koordynuje.
Tak powstał Dev Team v3.1: 19 agentów w 4 warstwach, pipeline 10 faz, zawarty w pliku ~/.claude/skills/team-dev/SKILL.md.
Architektura: 4 warstwy, 19 agentów
Warstwa 1 — Design & Architecture (1 agent)
API Designer — projektuje kontrakty API zanim ktokolwiek napisze linię kodu. Wykrywa breaking changes, wersjonuje endpointy, generuje OpenAPI spec. To on jako pierwszy dostaje brief i jako pierwszy kończy — output trafia do warstwy 2 jako wejście.
Warstwa 2 — Core Development (4 agenty)
- PM (orchestrator) — koordynuje resztę, prowadzi
board.jsonz statusem zadań, nie pisze kodu - Backend — Node.js/Express, baza danych, cache, kolejki
- Frontend — React/Vite, i18n, state management
- Integration Engineer — Stripe, zewnętrzne API, MCP, webhooki
Warstwa 3 — Quality & Security (9 agentów)
- Code Reviewer — SOLID, architektura, peer review
- Database Admin — migracje, rollback, wydajność zapytań
- Security Engineer — OWASP Top 10, CSP/HSTS, skanowanie sekretów
- Tester — E2E (Playwright), testy regresji, kontrakt
- Mobile QA — matrix urządzeń, iOS Safari, dławienie sieci
- UX Researcher — WCAG 2.1, testy A/B, user flows
- Performance — Core Web Vitals, Lighthouse, analiza bundla
- Billing/Compliance — PCI-DSS, GDPR, audit płatności
Plus jeszcze jeden: Incident Commander — runbooki, post-mortemy, eskalacja on-call.
Warstwa 4 — Delivery & Operations (5 agentów)
- DevOps — Docker, GitHub Actions CI/CD, monitoring
- SEO — meta tagi, schema.org, sitemap, hreflang
- Release Manager — bramy, rollout, authority do rollbacku
- Documentation Writer — API docs, architektury, runbooki
- Data/Analytics Engineer — zdarzenia GA4, lejki, A/B testy
Pipeline 10 faz — jak przebiega jedno wdrożenie
| Faza | Agenty | Cel |
|---|---|---|
| 0 | API Designer | Projekt kontraktów API przed kodem |
| A | Backend + Frontend | Implementacja równoległa |
| B | Code Reviewer + DBA | Review kodu + migracje DB |
| B.5 | wszystkie | Walidacja staging |
| C | Security + Perf + UX + Mobile + Billing | Audyty równoległe |
| C.5 | Release Manager | Gotowość do deployu |
| D | Tester | Full testing |
| D.5 | DevOps | Post-deploy smoke tests |
| E | SEO + DevOps + Docs + Analytics | Obsługa po wdrożeniu |
| E.5 | Release Manager | Release + runbooki + monitoring |
W praktyce nie każde zadanie przechodzi przez wszystkie 10 faz. Mam skróty oparte na ryzyku:
- LOW risk (literówka w copy, zmiana koloru): A → B → D → deploy
- MEDIUM risk (nowy endpoint, nowa strona): 0 → A → B → C → D → E → deploy
- HIGH risk (zmiana płatności, migracja DB): wszystkie 10 faz
- HOTFIX: A → B → D → deploy → audit nazajutrz
Case study: reklamacje24.pl zbudowany z team-dev
W lutym 2026 zbudowałem reklamacje24.pl. SaaS do generowania pism reklamacyjnych. Pierwsza wersja (landing + płatność + generowanie pisma) zajęła 4 dni developer-dni. W tym:
- Dzień 1: API Designer → Backend (Express + PostgreSQL schema)
- Dzień 2: Frontend (React + Vite) + Integration Engineer (Stripe Checkout + webhooki)
- Dzień 3: Security Engineer (CSP headers, input validation, SQLi scan) + Tester (Playwright E2E)
- Dzień 4: DevOps (Docker + GitHub Actions) + SEO (schema.org, sitemap)
Bez team-dev: oceniam że to samo zajęłoby mi 2-3 tygodnie. Nie dlatego że Claude pisze szybciej — tylko dlatego że zapomina się o mniej rzeczy. Security Engineer zawsze sprawdzi to co ja bym pominął po 8 godzinach pisania kodu. DBA zawsze sprawdzi czy migracja ma rollback.
Co naprawdę nie działa (bez owijania w bawełnę)
Długi kontekst się degeneruje. Po 4-5 fazach pipeline'u, PM traci wątek. Zaczyna powtarzać zadania albo pomijać kroki. Rozwiązanie: reset kontekstu po fazie C, ręczne podanie board.json z dotychczasowym stanem.
Agenty piszą do siebie sprzeczne rzeczy. Backend zrobił endpoint POST /api/v1/complaints, Frontend wywołuje /api/complaints. Bez API Designer na wejściu to normalne. API Designer nie jest opcjonalny — jest blokerem dla wszystkich.
Koszt tokenów przy HIGH risk rośnie szybko. Pełny pipeline 10 faz na złożonej funkcji (np. integracja Stripe + BLIK + P24 z obsługą błędów) to łatwo 500K-1M tokenów. Z Opus 4 → $15-30 za jedną feature. To uzasadnione przy funkcji płatności, nie uzasadnione przy zmianie tekstu w stopce.
Mobile QA i UX Researcher są rzadko potrzebne. Dla moich projektów (admin panele, SaaS B2B) to overkill. Wycięłem je z LOW/MEDIUM risk track.
Konfiguracja u mnie
Skill zapisany w ~/.claude/skills/team-dev/SKILL.md. Wywołanie: /team-dev opisz co chcesz zbudować. Claude wciela się w PM, który spawnuje kolejne agenty przez wbudowany Agent() tool z izolowanym kontekstem per agent.
Do team-dev nie potrzebujesz żadnych zewnętrznych narzędzi — działa w standardowym Claude Code CLI (od wersji 1.x). Jedyna zależność to aktywna subskrypcja Claude Max albo klucz API z dostępem do Opus/Sonnet.
Kiedy NIE używać team-dev
- Proste jednorazowe skrypty (<100 linii) — za dużo overhead
- Szybka odpowiedź na pytanie — zwykły Claude szybszy
- Projekty zewnętrzne klientów z wrażliwymi danymi — nie mieszaj kontekstów
- Kiedy nie wiesz co budujesz — team-dev nie zastępuje product thinking
Chcesz wdrożyć to u siebie?
Jeśli budujesz własny produkt i chcesz skrócić czas developmentu przez multi-agent setup w Claude Code — mogę pokazać jak skonfigurować pipeline pod twój stack. Zobacz moje usługi albo Umów bezpłatną rozmowę (30 min).