COMPUTE WARS · BOOTSTRAPPING

Magik LLM
Gathering

Forjando sua jornada…
Pular para o conteúdo
LLM Erallm-era2023system

Claude

Família de LLMs da Anthropic treinada com Constitutional AI, focada em segurança, contexto longo e raciocínio.

O quê

Claude é a família de grandes modelos de linguagem da Anthropic, empresa fundada em 2021 por ex-pesquisadores da OpenAI, entre eles os irmãos Dario e Daniela Amodei. Lançado em março de 2023 (Claude 1), o produto distingue-se por priorizar segurança e alinhamento, contexto longo e raciocínio confiável — posicionando-se como concorrente direto de GPT-4 e Gemini.

A marca registrada técnica é o Constitutional AI (Constitutional AI (CAI)): em vez de depender só de rotuladores humanos para julgar o que é nocivo, o modelo é treinado para criticar e revisar as próprias respostas guiado por uma “constituição” — um conjunto explícito de princípios. Isso reduz a dependência de RLHF — Reinforcement Learning from Human Feedback puro com feedback humano sobre conteúdo tóxico.

Como funciona

Constitutional AI

O treino de alinhamento tem duas fases. Na fase supervisionada, o modelo gera respostas, critica-as à luz dos princípios da constituição e reescreve; esses pares (resposta → versão revisada) viram dados de fine-tuning. Na fase de RL a partir de feedback de IA (RLAIF), um modelo de preferências treinado com julgamentos do próprio modelo substitui parte do feedback humano. O resultado é um assistente que recusa pedidos nocivos explicando o porquê, em vez de apenas bloquear.

Evolução da família

  • Claude 2 (jul. 2023) — contexto expandido, melhor em código e análise de documentos.
  • Claude 3 (mar. 2024) — três tamanhos: Haiku (rápido/barato), Sonnet (equilíbrio) e Opus (capacidade máxima); multimodal (imagem).
  • Claude 3.5 Sonnet (jun. 2024) — saltos em código e computer use.
  • Claude 3.7 Sonnet (fev. 2025) — primeiro Claude com extended thinking (Chain-of-Thought (CoT) visível e controlável).
  • Claude 4 (Opus 4 / Sonnet 4, mai. 2025) — geração focada em agentes e código de longo horizonte.

Todos rodam atrás de JWT/API com janela de contexto longa (Context Window) e tool-use nativo (function calling, MCP).

Por que importa

  • Tornou alinhamento um diferencial de produto. Constitutional AI mostrou um caminho escalável para reduzir feedback humano caro sobre conteúdo sensível.
  • Empurrou a fronteira de contexto longo. Janelas de 100k–200k tokens (e depois 1M) habilitaram análise de bases de código e documentos inteiros sem chunking.
  • Referência em código e agentes. A partir de Claude 3.5/4, a família virou padrão para programação assistida e agentes autônomos (Claude Code).

Estado em 2026

Em junho de 2026, a linha ativa é Claude Opus 4.8 (lançado em 28 de maio de 2026, modelo de fronteira para raciocínio e código agêntico), Claude Sonnet 4.6 (17 de fevereiro de 2026, equilíbrio) e Claude Haiku 4.5 (out. 2025). Opus e Sonnet suportam janela de 1M tokens sem sobretaxa, adaptive thinking e prompt caching.

O preço mudou drasticamente: o Opus 4/4.1 custava US$ 15 / US$ 75 por milhão de tokens (entrada/saída); a partir do Opus 4.5 houve corte de ~67%, e o Opus 4.8 custa US$ 5 / US$ 25. Sonnet 4.6 fica em US$ 3 / US$ 15 e Haiku 4.5 em US$ 1 / US$ 5 (preços de acesso em jun. 2026; ver Input/Output Token Pricing). Interpretabilidade (Mechanistic Interpretability (SAE)) e honestidade tornaram-se eixos de marketing técnico — a Anthropic reporta o Opus 4.8 como significativamente menos propenso a deixar passar falhas no próprio código.

Tratamento de carta — proposta

Claude, The Constitution Modelo · Citadel · custo

Constitutional AI. Sempre que um efeito (seu ou do oponente) tentaria forçar The Constitution a um alvo “nocivo” (descartar, sacrificar, atacar à força), você pode pagar 1 ⚡ para anular esse efeito e explicar a recusa.

Long Context. Sua mão máxima é +3.

“Não basta obedecer. É preciso entender por quê — e às vezes dizer não.”

A mecânica encena os dois diferenciais: a constituição como direito de recusa e o contexto longo como mão maior.

Veja também

Constitutional AI (CAI) · RLHF — Reinforcement Learning from Human Feedback · Context Window · Mechanistic Interpretability (SAE) · ChatGPT (2022)

Feito pela Magik LLM Gathering

Isto que você acabou de ler é o nosso trabalho.

A Magik LLM Gathering constrói produtos de IA de verdade — e escreve sobre eles em português, sem hype. Se quiser conversar sobre o seu, deixe seu contato.

Sem spam. Respondemos pessoalmente. Ao enviar, você concorda com a política de privacidade.

FONTES
  • Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. Anthropic. arXiv:2212.08073.
  • Anthropic (2024). The Claude 3 Model Family: Opus, Sonnet, Haiku. Model Card.
  • Anthropic (2025/2026). Claude model overview & pricing. platform.claude.com/docs (acesso jun. 2026).