Language

Referência da API

apikey.sh fala o protocolo da OpenAI. Qualquer SDK, framework ou ferramenta que já funciona com a OpenAI funciona aqui depois de trocar o base_url.

Início rápido

Crie uma chave no painel, coloque-a em uma variável de ambiente e aponte a base URL:
from openai import OpenAI

client = OpenAI(
    api_key="sk-ak-...",                  # your key from apikey.sh
    base_url="https://apikey.sh/v1",      # change only this line
)

resp = client.chat.completions.create(
    model="claude-sonnet-5",
    messages=[{"role": "user", "content": "Hello!"}],
)
print(resp.choices[0].message.content)

Base URL

A mesma chave de API funciona em todos os domínios abaixo — escolha o que preferir.
https://apikey.sh/v1ativo
https://api.onie.net/v1ativo
O SDK da Anthropic usa a base URL sem /v1 (por exemplo https://apikey.sh).

Autenticação

Envie sua chave em um header:
Authorization: Bearer sk-ak-...

# or, with the Anthropic SDK:
x-api-key: sk-ak-...
A chave é exibida apenas uma vez, na criação. Se perdê-la, crie outra e revogue a antiga — a revogação vale imediatamente.

Endpoints

POST/v1/chat/completionsGera completions (suporta streaming SSE e tool calling)
POST/v1/embeddingsCria embeddings para RAG e busca semântica
POST/v1/images/generationsGera imagens (modelos gpt-image-*)
GET/v1/modelsLista os modelos disponíveis para a chave atual

Streaming

Adicione stream: true para receber tokens em tempo real via SSE:
stream = client.chat.completions.create(
    model="claude-sonnet-5",
    messages=[{"role": "user", "content": "Write a short poem"}],
    stream=True,
)
for chunk in stream:
    print(chunk.choices[0].delta.content or "", end="")

Prompt caching

Nos modelos compatíveis (linha GPT-5.x), o prefixo repetido do seu prompt é cacheado automaticamente e cobrado na tarifa de cache — cerca de 90% mais barata que tokens novos. Não é preciso mudar nada no código; os tokens em cache aparecem em Uso, no painel.As respostas incluem usage.prompt_tokens_details.cached_tokens para você conferir por conta própria.

Limites por chave

Cada chave pode ter seu próprio teto de gastos e lista de modelos permitidos. É a forma segura de compartilhar chaves entre projetos ou colegas sem que um deles esgote o orçamento. Configure em Painel → Chaves de API.

Códigos de erro

401Chave inválida, revogada ou conta suspensa
402Sem crédito — recarregue no painel
403Modelo fora da lista permitida desta chave
429Limite de requisições da chave excedido
5xxErro do provedor upstream — tente de novo em alguns segundos

Modelos disponíveis

37 modelos ativos. Lista legível por máquina em GET /v1/models ou /api/models (JSON, sem autenticação).