Language

Référence API

apikey.sh parle le protocole OpenAI. Tout SDK, framework ou outil qui fonctionne déjà avec OpenAI fonctionne ici après changement de base_url.

Démarrage rapide

Créez une clé dans le tableau de bord, placez-la dans une variable d'environnement, puis pointez l'URL de base :
from openai import OpenAI

client = OpenAI(
    api_key="sk-ak-...",                  # your key from apikey.sh
    base_url="https://apikey.sh/v1",      # change only this line
)

resp = client.chat.completions.create(
    model="claude-sonnet-5",
    messages=[{"role": "user", "content": "Hello!"}],
)
print(resp.choices[0].message.content)

URL de base

La même clé API fonctionne sur tous les domaines ci-dessous — choisissez celui que vous préférez.
https://apikey.sh/v1en ligne
https://api.onie.net/v1en ligne
Le SDK Anthropic utilise l'URL de base sans /v1 (par exemple https://apikey.sh).

Authentification

Envoyez votre clé dans un header :
Authorization: Bearer sk-ak-...

# or, with the Anthropic SDK:
x-api-key: sk-ak-...
La clé n'est affichée qu'une seule fois, à la création. En cas de perte, créez-en une nouvelle et révoquez l'ancienne — la révocation est immédiate.

Endpoints

POST/v1/chat/completionsGénérer des complétions (SSE streaming et tool calling pris en charge)
POST/v1/embeddingsCréer des embeddings pour le RAG et la recherche sémantique
POST/v1/images/generationsGénérer des images (modèles gpt-image-*)
GET/v1/modelsLister les modèles accessibles à la clé courante

Streaming

Ajoutez stream: true pour recevoir les tokens en temps réel via SSE :
stream = client.chat.completions.create(
    model="claude-sonnet-5",
    messages=[{"role": "user", "content": "Write a short poem"}],
    stream=True,
)
for chunk in stream:
    print(chunk.choices[0].delta.content or "", end="")

Prompt caching

Sur les modèles compatibles (la gamme GPT-5.x), le préfixe répété de votre prompt est mis en cache automatiquement et facturé au tarif cache — environ 90 % moins cher que des tokens neufs. Rien à changer dans votre code ; les tokens servis depuis le cache apparaissent sous Consommation dans le tableau de bord.Les réponses incluent usage.prompt_tokens_details.cached_tokens pour vérifier par vous-même.

Limites par clé

Chaque clé peut avoir son propre plafond de dépenses et sa liste de modèles autorisés. C'est la façon sûre de partager des clés entre projets ou coéquipiers sans qu'un seul vide le budget. Configurez-le dans Tableau de bord → Clés API.

Codes d'erreur

401Clé invalide, clé révoquée ou compte suspendu
402Crédit épuisé — rechargez dans le tableau de bord
403Modèle absent de la liste autorisée de cette clé
429Limite de débit de la clé dépassée
5xxErreur du fournisseur en amont — réessayez dans quelques secondes

Modèles disponibles

37 modèles sont en ligne. Liste exploitable par machine sur GET /v1/models ou /api/models (JSON, sans authentification).