Não. A API do Claude não possui um nível gratuito, e isso inclui o Claude Sonnet 5.5 (claude-sonnet-5-5). O uso do Console é pré-pago: você adiciona créditos ao saldo da sua organização antes da primeira chamada, e esses créditos expiram um ano após a data da compra e não são reembolsáveis. Nenhuma página oficial da Anthropic oferece um crédito de inscrição, e um plano de chat pago do Claude não inclui acesso à API ou ao Console. O que existe é uma pequena lista de programas de crédito com regras de elegibilidade reais e um caminho pago barato o suficiente para que uma solicitação de teste típica custe menos de um centavo.
Conversar com o Sonnet 5.5 no plano gratuito do Claude.ai não custa nada, mas não oferece uma chave de API; nosso guia sobre como usar o Claude Sonnet 5.5 gratuitamente cobre essa rota. Esta postagem é para desenvolvedores: quais programas pagam pelas chamadas da API, quais alegações de gateway "gratuitas" não se sustentam, a aritmética por trás da configuração paga mais barata e uma primeira solicitação salva no Apidog para que cada execução de teste relate seu próprio custo. Para o modelo em si, comece com o que é o Claude Sonnet 5.5.
A resposta curta
| Rota | Grátis? | Notas |
|---|---|---|
| API do Claude (Console) | Não | Pré-pago, $2 entrada / $10 saída por milhão de tokens |
| Plano Gratuito Claude.ai | Apenas Chat | Sem chave de API |
| Programas de crédito Anthropic | Se aceito | $1.000 a $50.000; valor para startups não publicado |
| AWS Activate | Se você tiver créditos | Paga pelo Claude no Amazon Bedrock |
| Gateways e testes na nuvem | Não (AWS Free Tier não confirmado) | Veja a tabela abaixo |
Programas de crédito que podem pagar por chamadas da API do Sonnet 5.5
Estas são as únicas rotas onde outra pessoa cobre a fatura de tokens, e cada uma delas depende de quem você é.
Programa de Acesso para Pesquisadores Externos. A Anthropic aplica $1.000 em créditos de API à conta de um pesquisador aceito. O programa visa a pesquisa de segurança e alinhamento de IA, e as candidaturas são revisadas na primeira segunda-feira de cada mês. Os créditos cobrem o conjunto de modelos padrão da Anthropic, não o aplicativo web do Claude. A página não menciona o Sonnet 5.5.
IA para a Ciência. Pesquisadores podem se candidatar a até $50.000 em créditos por projeto, e qualquer pesquisador é elegível para se candidatar. O porém: a Anthropic afirma que pesquisadores de biologia e química ainda estão limitados aos seus modelos da classe Opus, então um projeto de biologia ou química não obterá o Sonnet 5.5 por esta rota.
Claude para Startups. Startups com financiamento de risco podem se candidatar a créditos gratuitos e limites de taxa prioritários. Você precisa de financiamento de capital de um investidor institucional, uma empresa fundada nos últimos quatro anos e sem créditos de startup anteriores da Anthropic. A Anthropic não publica um valor. Os créditos funcionam na API própria do Claude apenas através do Console, não no Amazon Bedrock, Google Cloud Vertex AI ou outras plataformas de terceiros.
AWS Activate. Desde abril de 2024, os créditos do AWS Activate podem pagar por modelos de terceiros no Amazon Bedrock, incluindo os da Anthropic. A política não é específica do Sonnet, mas o Sonnet 5.5 está no Bedrock como anthropic.claude-sonnet-5-5, e no bedrock-runtime em Regiões comerciais, ele só é executado por inferência global entre Regiões (perfil global.anthropic.claude-sonnet-5-5). Dois limites afetam o teste de custo: o cartão do modelo Bedrock marca o Batch como não suportado, e ferramentas rigorosas não estão disponíveis para o Sonnet 5.5 lá.
Alegações de API “gratuita” do Sonnet 5.5 que não se sustentam
Gateways e testes na nuvem são apresentados como rotas gratuitas para o Sonnet 5.5. Veja o que cada página oficial disse em 29 de setembro de 2026:
| Alegação | O que a página oficial diz | Veredito |
|---|---|---|
| Sonnet 5.5 grátis no OpenRouter | Apenas anthropic/claude-sonnet-5.5 ($2/$10) e sua variante :batch ($1/$5); nenhum dos seus modelos :free é da Anthropic |
Pago |
| “$5 em créditos a cada 30 dias” do Vercel AI Gateway | O nível gratuito cobre um subconjunto de modelos, e Sonnet 5.5 é marcado como availableToFreeTier: false |
Não coberto |
| Teste de $300 do Google Cloud | Exclui modelos de parceiros de IA generativa oferecidos como uma API gerenciada | Não coberto |
| Conta gratuita Azure | Claude no Microsoft Foundry requer uma assinatura paga; contas de teste gratuito e somente crédito não são suportadas | Não coberto |
| Créditos do AWS Free Tier | Nenhuma página confirma de uma forma ou de outra, e os créditos promocionais da AWS ignoram as cobranças do Marketplace a menos que a AWS os autorize | Não verificado |
| Um “crédito inicial de $5” em novas contas do Console | Não está em nenhuma página oficial; o onboarding diz para adicionar créditos | Não encontrado |
Se você deseja um gateway para roteamento ou faturamento, compare as opções em nosso comparativo de alternativas ao OpenRouter, mas não para tokens gratuitos do Sonnet 5.5. Se o preço for mais importante que o modelo, veja os provedores de API LLM mais baratos.
O caminho pago mais barato: uma solicitação de teste custa menos de um centavo
O Sonnet 5.5 custa $2 por milhão de tokens de entrada e $10 por milhão de tokens de saída, inalterado em relação ao Sonnet 5. Leituras de cache custam $0,20, escritas de cache de 5 minutos $2,50, escritas de cache de 1 hora $4, e a API Batch reduz pela metade a entrada e a saída para $1 e $5 (documentação de preços). Nossa análise de preços do Sonnet 5.5 tem a tabela completa.
2.000 x $2 / 1M = $0,004
500 x $10 / 1M = $0,005
Total = $0,009
Cem desses custam $0,90. Quatro configurações decidem se sua conta permanece nesse valor.
Defina o esforço como baixo ou médio
Na Plataforma Claude, o Sonnet 5.5 usa high como esforço padrão, e uma solicitação sem o campo thinking executa o pensamento adaptativo. O guia de prompting da Anthropic recomenda usar medium ou low para chat e reservar xhigh e max para ganhos de qualidade mensuráveis. De medium para cima, o modelo pensa antes de quase toda resposta, até mesmo um cumprimento, e pedir para ele pensar menos no prompt não funciona de forma confiável. Diminua o esforço, em vez disso.
A diferença é grande. A Artificial Analysis gastou $544,49 para executar seu Índice de Inteligência com esforço baixo, $1.175,84 com alto e $8.976,65 com máximo: 7,6 vezes a conta de alto esforço para uma pontuação de 55,98 contra 46,74. O máximo também é prolixo, com cerca de 193.000 tokens de saída por tarefa de índice, de acordo com a análise da OfficeChai dos dados da AA.
Pule o pensamento inicial com between_tools
thinking: {"type": "between_tools"} substituiu disabled no Sonnet 5.5 e desativa a etapa de pensamento inicial; enviar o valor disabled antigo retorna um erro 400. between_tools é aceito apenas em low, medium ou high. Em xhigh ou max, retorna um erro 400, assim como adicionar display ou budget_tokens a ele. Uma desvantagem do guia de prompting: em uma solicitação sem ferramentas, between_tools responde sem pensar primeiro, então mantenha o pensamento adaptativo para respostas JSON que precisam de algumas etapas de elaboração.
Armazene em cache as partes que se repetem
O cache de prompt requer um prompt de pelo menos 512 tokens (o Sonnet 5 precisava de 1.024). Digamos que sua suíte de testes envie o mesmo prompt de sistema de 10.000 tokens e fixtures 50 vezes:
Sem cache: 50 x 10.000 = 500.000 x $2 / 1M = $1,00
Com cache: 1 escrita: 10.000 x $2,50 / 1M = $0,025
49 leituras: 490.000 x $0,20 / 1M = $0,098
Total = $0,123
Isso representa cerca de 88% menos no prefixo repetido. Para execuções espaçadas, a escrita de 1 hora custa $4 por milhão ($0,04 aqui). Uma armadilha: mudar o nível de esforço de alto nível entre as requisições invalida o cache, então teste os níveis de esforço em execuções separadas. Nossa matemática de custo do cache de prompt do Opus 5.5 detalha os pontos de equilíbrio.
Processe em lote o que pode esperar, e limite a saída
A API Batch reduz as taxas para $1 de entrada e $5 de saída, então a solicitação de 2.000/500 acima cai de $0,009 para $0,0045. Use-a para avaliações e execuções de regressão que não precisam de uma resposta imediata (não está disponível para o Sonnet 5.5 no Bedrock). Para testes de fumaça, defina um max_tokens pequeno e trate stop_reason: "max_tokens" como uma resposta falha, conforme o guia de prompting aconselha.
Obtenha uma chave e envie uma primeira solicitação
- Crie uma organização no Console do Claude e adicione créditos de uso ao seu saldo.
- Crie uma chave de API. Nosso guia de chave de API da Anthropic explica as telas.
- Exporte-a como
ANTHROPIC_API_KEYem seu shell para que nunca apareça em um script ou commit.
Em seguida, faça uma primeira chamada barata: esforço baixo, sem pensamento inicial, saída limitada.
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 1024,
"thinking": {"type": "between_tools"},
"output_config": {"effort": "low"},
"messages": [
{"role": "user", "content": "Liste três casos extremos para testar em GET /users/{id}."}
]
}'
O objeto usage da resposta informa input_tokens e output_tokens; multiplique-os por $2 e $10 por milhão para obter o custo. Deixe temperature, top_p e top_k de fora, pois qualquer valor não padrão retorna um erro 400 no Sonnet 5.5. Para streaming, ferramentas e o restante da superfície de requisição, veja como usar a API do Claude Sonnet 5.5.
Faça com que cada execução de teste mostre seu custo no Apidog
Uma chamada curl informa o custo uma vez. Salvar a requisição no Apidog torna a verificação repetível:
- Crie um ambiente e adicione
ANTHROPIC_API_KEYcomo uma variável. Defina o cabeçalho comox-api-key: {{ANTHROPIC_API_KEY}}para que a chave nunca esteja na própria requisição. - Crie uma requisição POST para
https://api.anthropic.com/v1/messagescom os cabeçalhosanthropic-versionecontent-type, e cole o corpo JSON acima. - Adicione asserções:
$.usage.input_tokense$.usage.output_tokensexistem e permanecem dentro do seu orçamento, e$.stop_reasonnão émax_tokens. - Adicione um script de pós-processamento que converte o uso em dólares:
const usage = pm.response.json().usage;
const cost = (usage.input_tokens * 2 + usage.output_tokens * 10) / 1e6;
console.log(`in=${usage.input_tokens} out=${usage.output_tokens} cost=$${cost.toFixed(4)}`);
pm.test("A requisição de teste custa menos de um centavo", () => {
pm.expect(cost).to.be.below(0.01);
});
O script usa preços de tabela padrão; altere-os se adicionar cache ou lote. Duplique a requisição em low, medium e high, coloque todas as três em um cenário de teste, e uma execução mostrará o custo de cada nível de esforço com seus próprios prompts. Você pode baixar o Apidog para acompanhar, e nosso guia sobre como testar aplicações LLM estende o padrão para a qualidade da resposta.
FAQ
Existe uma chave de API gratuita para o Claude Sonnet 5.5? Não. Toda chave utiliza créditos pré-pagos do Console; as únicas rotas sem custo são os programas de crédito com elegibilidade mencionados acima.
O Claude Pro ou Max inclui créditos de API? Não. Os planos de chat pagos cobrem os aplicativos Claude e o Claude Code. O uso da API é cobrado separadamente através do Console.
Novas contas do Console recebem créditos de API gratuitos? Nenhuma página oficial diz isso. O “crédito inicial de $5” que alguns blogs mencionam não está nas páginas da Anthropic.
Créditos AWS podem pagar pelo Sonnet 5.5? Os créditos do AWS Activate podem, no Amazon Bedrock. Se os créditos do AWS Free Tier cobrem o Claude no Bedrock não é confirmado, então não conte com eles.
Qual é a maneira mais barata de testar o Sonnet 5.5? Baixo esforço, between_tools, um max_tokens pequeno, cache para prefixos repetidos e a API Batch para tudo que pode esperar. O guia da API do Claude Sonnet 5.5 mostra cada configuração em uma requisição completa.
Por onde começar
Adicione um pequeno saldo a uma conta do Console, envie a requisição de baixo esforço acima e salve-a no Apidog com o script de custo anexado. Algumas execuções lhe dirão quanto o Sonnet 5.5 custa com seus próprios prompts. Se você se qualificar para um programa de crédito, inscreva-se em paralelo; a configuração de teste é a mesma de qualquer forma.
