Sumário

Claude 3 é a família de modelos da Anthropic que inclui três versões: Haiku (mais rápido e barato), Sonnet (2x mais rápido que iterações anteriores) e Opus (modelo mais forte, supera gpt-4 em benchmarks como MMLU e HumanEval).

Capacidades (confidence: high)

  • Janela de contexto de 200K tokens, extensível a 1M
  • Quase perfeito no teste “Needle In A Haystack” (NIAH)
  • Capacidades avançadas: raciocínio, matemática, análise, código, geração de conteúdo
  • Suporte multilíngue (espanhol, japonês, francês)
  • Visão computacional para fotos, gráficos e diagramas
  • Menos recusas e menos alucinações que versões anteriores
  • Melhor na produção de saídas estruturadas (JSON)

Prompt Caching e Seleção de Modelo (confidence: high)

No Claude Code, Sonnet é o padrão para a maioria das tarefas de código (equilíbrio entre capacidade e custo); Opus é reservado para decisões arquiteturais complexas ou raciocínio multi-passo; subagentes simples podem usar model: haiku. O custo depende de prompt caching: o histórico é relido à tarifa de cache, com lifetime de 1 hora na assinatura e 5 minutos em usage credits/API key — uma pausa longa entre mensagens causa cache miss e reprocessa todo o contexto.

Implicações

A família Claude 3 tem papel duplo: além das capacidades de modelo, os tiers Sonnet/Opus/Haiku são a principal alavanca de custo de um agente de código como o claude-code-system-prompt, com estratégias detalhadas em token-usage-reduction.

Implicações

Claude 3 estabeleceu um novo padrão para modelos multimodais com contexto longo, rivalizando diretamente com gemini e gpt-4.

llm-models-guide | prompt-engineering-techniques | llm-research-findings

Sources

  • raw/prompts/articles/promptingguide-pt-models-claude-3.md