getdeepseekapi.comDocumentation
API DeepSeek : Première requête en cinq minutes
Obtenez votre première réponse en cinq minutes en pointant votre client compatible OpenAI vers notre URL de base et en vous authentifiant avec la clé générée lors de l'inscription.
URL de base et authentification
Notre API suit l’interface standard OpenAI, vous devez donc modifier uniquement deux valeurs dans la configuration de votre client. Définissez l’URL de base sur https://api.getdeepseekapi.com/v1 et utilisez la clé API affichée immédiatement après la création de votre compte sur la page Get API key. Aucun numéro de téléphone ni carte bancaire n’est requis pour commencer, et vous recevez 0,50 $ de crédit d’essai gratuit qui dure sept jours.
Chaque compte ne permet qu'une seule clé active à la fois. Si vous faites tourner votre clé, l'ancienne est immédiatement révoquée. Cela simplifie la gestion des secrets entre les environnements de développement et de production sans nécessiter de portées de permissions complexes.
Envoyer une complétion de chat
Effectuez une requête POST standard vers /v1/chat/completions pour recevoir une réponse textuelle. L'endpoint accepte un tableau messages contenant votre prompt système et votre requête utilisateur, ainsi qu'un identifiant model défini sur uncensored. Ce modèle s'exécute sur nos propres serveurs GPU et est ajusté pour répondre sans refus de contenu pour une utilisation adulte légale.
Assurez-vous que le corps de votre requête reste inférieur à 8 Mo. Si la clé est invalide ou expirée, le serveur renvoie une erreur 401. Si votre crédit prépayé est épuisé, vous recevez une erreur 402 nécessitant une recharge. Vous pouvez ajouter des fonds à partir de 10 $ via les cryptomonnaies (USDT ou USDC).
curl https://api.getdeepseekapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Installer et utiliser le SDK Python
L’utilisation de la bibliothèque Python officielle OpenAI est la méthode la plus rapide pour intégrer. Installez le package via pip, puis configurez le client avec votre URL de base personnalisée et votre clé API. Le paramètre model doit être défini sur uncensored pour vous assurer de vous adresser à notre instance spécifique.
Cette approche fonctionne avec n'importe quel SDK compatible OpenAI, y compris ceux utilisés pour Node.js ou Go. Le client gère la sérialisation et les nouvelles tentatives automatiquement. Rappelez-vous que l'identifiant du modèle n'est pas un nom de fournisseur comme GPT-4 ; c'est un identifiant spécifique pour notre modèle sans censure.
from openai import OpenAI
client = OpenAI(base_url="https://api.getdeepseekapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Intégration Node.js
Pour les environnements JavaScript, installez le SDK OpenAI et configurez-le de manière similaire à l’exemple Python. Définissez le baseUrl sur notre endpoint et fournissez votre clé API. Le SDK Node.js prend en charge les modes synchrone et asynchrone.
Lors de la construction de la requête, spécifiez model: 'uncensored' dans les paramètres. Cela garantit que le client envoie des requêtes à l'endpoint du modèle correct. Le SDK gère uniformément les réponses en streaming et non en streaming, vous permettant de changer les implémentations sans modifier la logique de requête principale.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.getdeepseekapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Activer le streaming (SSE)
Définissez le paramètre stream sur true pour recevoir une réponse Server-Sent Events (SSE). Le serveur envoie une série de blocs, chacun contenant une partie du texte généré. Cela réduit la latence perçue pour les réponses longues et permet au client d'afficher les tokens au fur et à mesure de leur production.
Assurez-vous que le code de votre client gère correctement l'événement de fin de streaming. Le streaming ne modifie pas la tarification ni le comptage des tokens ; vous êtes toujours facturé par 1M de tokens pour l'entrée et la sortie. La fenêtre de contexte totale reste limitée à 100 000 tokens pour le prompt et la complétion combinés.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, erreurs et fenêtre de contexte
Votre clé API est limitée à 300 requêtes par minute. Si vous dépassez ce seuil, le serveur renvoie une erreur 429 indiquant une limite de débit. Chaque corps de requête ne doit pas dépasser 8 Mo. La fenêtre de contexte prend en charge 100 000 tokens pour la somme du prompt et de la complétion, ce qui signifie que vous devez prendre en compte les longueurs d'entrée et de sortie lors de la conception de votre application.
Les erreurs courantes incluent 401 pour les clés invalides, 402 pour le crédit prépayé insuffisant et 429 pour les limites de débit. Vous pouvez régénérer votre clé API à tout moment depuis les paramètres de votre compte, ce qui invalide immédiatement l'ancienne clé. Cela est utile si vous suspectez une fuite ou si vous devez faire tourner les identifiants entre les environnements.
Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authentification | Authorization: Bearer YOUR_KEY |
| ID du modèle | uncensored |
| Base URL | https://api.getdeepseekapi.com/v1 |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Mode JSON | response_format: {"type": "json_object"} |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Limite de débit | 300 requêtes par minute et par clé |
| Taille | jusqu'à 8 Mo par requête |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Connexion | Google ou e-mail et mot de passe |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Quelle est la taille de la fenêtre de contexte ?
La fenêtre de contexte fait 100 000 tokens, calculés comme la somme des tokens du prompt d'entrée et des tokens de la complétion de sortie. Ce n'est pas 100 000 tokens disponibles exclusivement pour l'entrée.
Ce service prend-il en charge l'appel de fonctions ?
Oui, l'endpoint <code>/v1/chat/completions</code> prend en charge l'appel d'outils et de fonctions. Vous pouvez définir des outils dans votre requête et le modèle retournera des arguments structurés pour ceux-ci.
Comment gérer une erreur 402 ?
Une erreur 402 indique que votre solde de crédit prépayé est à zéro. Vous pouvez recharger votre compte à partir de 10 $ en crypto (USDT ou USDC). Les crédits n'expirent jamais.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.