A expertise que os agentes carregam
Skills operacionais ativadas automaticamente por contexto — de TDD a threat intelligence, de billing webhook a SLO burn-rate. Cada uma com gatilhos claros e agentes consumidores.
Red-Green-Refactor com testes antes da implementação em features novas. Bug é reproduzido com teste antes do fix. Cobertura mínima 70%.
Test pyramid, risk-based testing, property-based (fast-check/hypothesis), mutation testing (Stryker), contract testing (Pact).
EXPLAIN ANALYZE, índices BTREE/GIN/BRIN, partial indexes, RLS performance, query rewrite, pooling. Detecta N+1 e table bloat.
Vocabulário de deep modules (Ousterhout/Feathers): interface, seam, adapter, depth, leverage. Interfaces que escondem complexidade e ficam testáveis. Inclui DEEPENING + DESIGN-IT-TWICE.
Linguagem ubíqua, glossário CONTEXT.md e ADRs. Desafia termo vago e registra decisão arquitetural que não deve ser re-litigada.
Varre a codebase, acha oportunidades de deepening e entrega relatório HTML visual (Tailwind + Mermaid).
Loop de diagnóstico pra bug difícil: construir e apertar um feedback loop red-capable antes de hipotetizar. 6 fases + script HITL.
OWASP top 10 enforcement, threat modeling, RBAC review, secret rotation, CVE check. Ativa quando o código toca auth, payment, PII ou endpoint público.
Pentesting autorizado: STRIDE/PASTA, MITRE ATT&CK, OWASP Top 10/Mobile/API/LLM. Recon, exploitation e post-exploitation com legal gates explícitos.
Cyber Threat Intelligence: 8 case patterns (incident response, fraude, BEC, ransomware), legal gates, OPSEC. Condensado pra operação real.
Eval-driven prompt design, decision tree few-shot vs zero-shot, structured outputs, prompt caching, otimização de token.
Multi-LLM (OpenRouter, Claude API, Gemini), retry com backoff, token tracking, fallback chain e RAG patterns.
DeepEval, Ragas, promptfoo, LangSmith. CI gate pra prompts, golden datasets, A/B de variantes.
Ollama, LM Studio, llama.cpp, vLLM. Quantization (GGUF/AWQ/GPTQ), context window, GPU offloading, API OpenAI-compat.
Build de MCP servers (SDK TypeScript/Python), discovery, design de tools/prompts/resources, pinning de versões.
Diagnóstico 12-layer de stack de agente em produção: wrapper regression, memory pollution, repair loops escondidos. Findings por severidade com fix code-first.
Logs estruturados, traces OpenTelemetry, métricas RED/USE, SLOs definidos, alertas acionáveis, dashboards.
SLI/SLO com error budget, multi-window burn-rate (Google SRE Workbook), alert design 1h/6h/3d, runbooks, postmortem blameless.
USE method, eBPF, perf, py-spy, heaptrack, async-profiler. Race conditions, memory leaks e p99 em produção.
Stripe, Polar, Paddle e Lemon Squeezy com verificação HMAC, idempotency keys, cálculo de MRR/ARR/churn, dunning e refund/chargeback.
Design de webhook (retries, dead-letter queue, idempotency), assinatura HMAC, replay protection e debugging com tunnels.
GitHub Actions, GitLab CI, CircleCI. Caching estratégico, matrix builds, reusable workflows, deployment gates.
Turborepo, Nx, pnpm workspaces. Task pipelines, remote cache, dependency boundaries, incremental builds.
Pages + Workers + Functions + KV + D1. wrangler CLI, custom domains, env vars, patterns HMAC em Functions.
TanStack Query/Router/Table/Form. Cache invalidation, optimistic updates, infinite scroll, type-safe routing.
Busca dirigida em docs oficiais (Context7, llms.txt) e extração de tarefas repetitivas em sub-agentes especializados.
Runbooks de VPS Hetzner/Hostinger: PM2, docker-compose, Caddy/nginx, systemd, hardening SSH, TLS, backups e healthchecks.
Audita o consumo de janela de contexto de agents, skills, MCPs e rules. Acha o que infla o token budget e corta com cirurgia.
Garbage collection humano-no-loop do ~/.claude: config stale, órfãos e duplicados com proposta de remoção segura.
security, webhooks, deploy e DX complementares — catálogo completo dentro do zip, com gatilhos documentados por skill.
6 MCP configs por contexto
Em vez de carregar todos os MCPs sempre, o squad usa configs nichadas — você ativa só o relevante pro contexto. Versões pinadas, escopo mínimo.
| Config | MCPs incluídos | Quando usar |
|---|---|---|
cloudflare | cloudflare, hostinger, github | Pages, Workers, DNS |
devops | cloudflare, hostinger, github, gh-actions | Deploy, infra, CI/CD |
security | github, supabase, shodan, semgrep, stripe | Security audit, hardening, billing audit |
observability | grafana, datadog, sentry, logtail | Incidente, perf audit, SRE |
frontend | shadcn, context7, playwright | UI/UX, frontend dev |
fullstack | postgres, supabase, context7, github | Feature dev fullstack |
20 rules enforcadas
Padrões herdados por todos os agentes — nenhum escapa.
anti-ai-engineering-protocol · naming · error-handling · dependency-management · testing · performance
security · accessibility · monitoring · api-design · database · supabase-source-of-truth
cloudflare-bypass · cloudflare-pages-deploy · ci-cd-caching · monorepo-conventions · docs-site-structure
local-llm-routing · next-standalone-middleware
karpathy-guidelines · surgical-changes · no-fake-data · accentuation-pt-br