Superpowers (Jesse Vincent)

Overview

Superpowers é um framework de skills para agentes de coding que impõe um pipeline disciplinar obrigatório sobre o agente. Criado por Jesse Vincent, é apresentado como uma metodologia completa de desenvolvimento de software para AI agents — não só um conjunto de ferramentas, mas um processo que o agente segue automaticamente, de ponta a ponta.

Key Facts

  • Filosofia: “disciplina imposta” — o agente roda um pipeline automático sem permitir pular etapas
  • Pipeline de 5 fases: Clarify → Brainstorm → Plan → Code → Verify
  • 14 skills obrigatórias carregadas automaticamente via hook no início da sessão
  • TDD rígido: RED-GREEN-REFACTOR como ciclo não-negociável; o agente deleta código se tentar escrever produção antes do teste
  • Subagentes lineares: lançamento de um subagente por tarefa em sequência, com revisão em cada etapa
  • Adoção: ~268.645★ no GitHub; suporta 10+ plataformas (Claude, Codex, Gemini, Cursor)
  • Pontos fracos documentados: consumo excessivo de tokens, fragilidade de bootstrap no Windows/WSL, falta de continuidade entre sessões

Relationships

  • “operates-with” claude-code — framework de skills primariamente criado para Claude Code
  • “differs-from” matt-pocock-skills — disciplina imposta vs toolset composável; pipeline obrigatório vs invocação manual
  • “references” external-skills-ecosystem — parte do ecossistema mais amplo de agent skills

Implications

Superpowers resolve o problema fundamental do agente “selvagem” que pula direto pro código (vibe coding acidental). O custo é o token burn e a perda de agilidade em sessões que não precisam de tanta estrutura. A melhor aplicação é quando o time precisa de garantia de processo — ex.: codebases críticas, review formal, ou quando o agente precisa ser “gerenciado como estagiário” (citando o autor).

Open Questions

  • O custo de tokens justifica o ganho de disciplina em todos os contextos, ou só em projetos críticos?
  • As queixas de token burn são específicas de sessões longas ou uma característica estrutural do pipeline?

Deep research (dados atualizados, 2026-08-07)

Métricas confirmadas via GitHub API no dia da pesquisa:

  • ~268.645⭐ / ~24k forks / 326 issues (2026-08-07)
  • 14 skills obrigatórias, auto-triggered no início da sessão

Voz da comunidade por plataforma

  • Hacker News (pró): Evan Schwartz — “so much more productive… I cannot recommend it enough”; prplfsh — TDD “stops the model jumping to conclusions”; Simon Willison — “TDD é a metodologia-chave” das skills.
  • Hacker News (contra): d—b — “Claude faz mais erros com superpowers do que sem”; ymulima — “Vapor AIware… ruído pela verbosidade”; art=sin — “consumiu uma quantidade absurda de tokens, foi materialmente pior que Codex/Claude puro”; JonoClarke — KISS: nenhum framework melhor que Claude Code puro.
  • YouTube: Jesse Vincent (CodeRabbit) — “manage agents like MIT undergrad interns on IRC”; pipeline de brainstorming como hard-gate antes de codar.

Doras reais (GitHub issues)

  • #446 (confusão de on-boarding, “e se as skills estão sendo invocadas?”); #1192 (sem continuidade cross-session); 2106/2091/2084 (falha de SessionStart hook em Windows/WSL).

Projetos de fusão (composição, não competição)

  • Integra-se em devflow, omni-skills, dmi_superpowers, lean-skills; a migração em pro de peso foi observada em Token-Effort, agentic-code-stack, agentbase.

Gap de evidência

  • Nenhum benchmark head-to-head publicado; migração contra “plain Claude” baseada em anedota, não em medição. Sem benchmarks, confidence de números de tokens deve ser tratada como estimativa.

README oficial — workflow de 7 estágios (2026-08-07)

O README do repositório detalha o pipeline que roda automaticamente:

  1. brainstorming — ativa antes de escrever código; refina ideia, apresenta design em seções p/ validação; salva document de design
  2. using-git-worktrees — pós-aprovação; workspace isolado em branch nova + baseline limpo de testes
  3. writing-plans — quebra o trabalho em tarefas de 2-5 min, cada uma com file paths exatos, código completo, verificação
  4. subagent-driven-development ou executing-plans — subagente por tarefa com review de 2 estágios (spec → código) ou lote com checkpoints humanos
  5. test-driven-development — RED-GREEN-REFACTOR; apaga código escrito antes de testes
  6. requesting-code-review — review contra o plano; issues críticas bloqueiam progresso
  7. finishing-a-development-branch — verifica, apresenta opções (merge/PR/keep/discard), limpa worktree

Biblioteca de skills (categorizada, do README):

  • Testing: test-driven-development
  • Debugging: systematic-debugging, verification-before-completion
  • Collaboration: brainstorming, writing-plans, executing-plans, dispatching-parallel-agents, requesting-code-review, receiving-code-review, using-git-worktrees, finishing-a-development-branch, subagent-driven-development
  • Meta: writing-skills, using-superpowers

Instalação: plugin oficial do marketplace Anthropic (/plugin install superpowers@claude-plugins-official) + suporte a 10+ harnesses (Codex, Cursor, Gemini CLI, OpenCode, Pi etc.). Telemetry opt-out: SUPERPOWERS_DISABLE_TELEMETRY.

Sources

^[raw/papers/disciplined-execution-vs-flexible-tooling.md]