Référence API
apikey.sh parle le protocole OpenAI. Tout SDK, framework ou outil qui fonctionne déjà avec OpenAI fonctionne ici après changement de base_url.Démarrage rapide
Créez une clé dans le tableau de bord, placez-la dans une variable d'environnement, puis pointez l'URL de base :from openai import OpenAI
client = OpenAI(
api_key="sk-ak-...", # your key from apikey.sh
base_url="https://apikey.sh/v1", # change only this line
)
resp = client.chat.completions.create(
model="claude-sonnet-5",
messages=[{"role": "user", "content": "Hello!"}],
)
print(resp.choices[0].message.content)URL de base
La même clé API fonctionne sur tous les domaines ci-dessous — choisissez celui que vous préférez.Le SDK Anthropic utilise l'URL de base sans /v1 (par exemple https://apikey.sh).
https://apikey.sh/v1en lignehttps://api.onie.net/v1en ligneAuthentification
Envoyez votre clé dans un header :
Authorization: Bearer sk-ak-... # or, with the Anthropic SDK: x-api-key: sk-ak-...La clé n'est affichée qu'une seule fois, à la création. En cas de perte, créez-en une nouvelle et révoquez l'ancienne — la révocation est immédiate.
Endpoints
| POST | /v1/chat/completions | Générer des complétions (SSE streaming et tool calling pris en charge) |
| POST | /v1/embeddings | Créer des embeddings pour le RAG et la recherche sémantique |
| POST | /v1/images/generations | Générer des images (modèles gpt-image-*) |
| GET | /v1/models | Lister les modèles accessibles à la clé courante |
Streaming
Ajoutez stream: true pour recevoir les tokens en temps réel via SSE :
stream = client.chat.completions.create(
model="claude-sonnet-5",
messages=[{"role": "user", "content": "Write a short poem"}],
stream=True,
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="")Prompt caching
Sur les modèles compatibles (la gamme GPT-5.x), le préfixe répété de votre prompt est mis en cache automatiquement et facturé au tarif cache — environ 90 % moins cher que des tokens neufs. Rien à changer dans votre code ; les tokens servis depuis le cache apparaissent sous Consommation dans le tableau de bord.Les réponses incluent usage.prompt_tokens_details.cached_tokens pour vérifier par vous-même.
Limites par clé
Chaque clé peut avoir son propre plafond de dépenses et sa liste de modèles autorisés. C'est la façon sûre de partager des clés entre projets ou coéquipiers sans qu'un seul vide le budget. Configurez-le dans Tableau de bord → Clés API.
Codes d'erreur
401 | Clé invalide, clé révoquée ou compte suspendu |
402 | Crédit épuisé — rechargez dans le tableau de bord |
403 | Modèle absent de la liste autorisée de cette clé |
429 | Limite de débit de la clé dépassée |
5xx | Erreur du fournisseur en amont — réessayez dans quelques secondes |