DeepSeek-API: Erste Anfrage in fünf Minuten
Erhalte deine erste Antwort in fünf Minuten, indem du deinen bestehenden OpenAI-kompatiblen Client auf unsere Basis-URL zeigst und dich mit dem bei der Registrierung generierten Schlüssel authentifizierst.
Basis-URL und Authentifizierung
Unsere API folgt der Standard-Oberfläche von OpenAI, sodass du in deiner Client-Konfiguration nur zwei Werte ändern musst. Setze die Basis-URL auf https://api.getdeepseekapi.com/v1 und verwende den API-Schlüssel, der direkt nach der Erstellung deines Kontos auf der Seite API-Schlüssel erhalten angezeigt wird. Es werden keine Telefonnummer oder Kreditkarte benötigt, um zu starten, und du erhältst $0,50 an Testguthaben, die sieben Tage lang gültig sind.
Jedes Konto erlaubt nur einen aktiven Schlüssel gleichzeitig. Wenn du deinen Schlüssel rotierst, wird der vorherige sofort widerrufen. Dies vereinfacht die Verwaltung von Geheimnissen in Entwicklungs- und Produktionsumgebungen ohne komplexe Berechtigungsbereiche.
Chat-Vervollständigung senden
Sende eine Standard-POST-Anfrage an /v1/chat/completions, um eine Textantwort zu erhalten. Der Endpunkt akzeptiert ein messages-Array, das deinen System-Prompt und die Benutzerabfrage enthält, sowie eine model-Kennung, die auf uncensored gesetzt ist. Dieses Modell läuft auf unseren eigenen GPU-Servern und ist darauf abgestimmt, ohne Inhaltsablehnungen für die legale Erwachsenennutzung zu antworten.
Stelle sicher, dass der Anfragetextkörper 8 MB nicht überschreitet. Wenn der Schlüssel ungültig oder abgelaufen ist, gibt der Server einen 401-Fehler zurück. Wenn dein Prepaid-Guthaben aufgebraucht ist, erhältst du einen 402-Fehler, der eine Aufladung erfordert. Du kannst ab $10 über Krypto (USDT oder USDC) Guthaben aufladen.
curl https://api.getdeepseekapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python-SDK installieren und verwenden
Die Verwendung der offiziellen OpenAI Python-Bibliothek ist der schnellste Weg zur Integration. Installiere das Paket über pip und konfiguriere den Client mit deiner benutzerdefinierten Basis-URL und deinem API-Schlüssel. Der Parameter model muss auf uncensored gesetzt sein, um sicherzustellen, dass du mit unserer spezifischen Instanz kommunizierst.
Dieser Ansatz funktioniert mit jedem OpenAI-kompatiblen SDK, einschließlich der für Node.js oder Go. Der Client übernimmt die Serialisierung und Wiederholungen automatisch. Denke daran, dass die Modell-ID kein Herstellername wie GPT-4 ist; es ist eine spezifische Kennzeichnung für unser unzensiertes Modell.
from openai import OpenAI
client = OpenAI(base_url="https://api.getdeepseekapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js-Integration
Für JavaScript-Umgebungen installiere das OpenAI SDK und konfiguriere es ähnlich wie im Python-Beispiel. Setze die baseUrl auf unseren Endpunkt und gib deinen API-Schlüssel an. Das Node-SDK unterstützt sowohl synchrone als auch asynchrone Muster.
Gib bei der Erstellung der Anfrage die Parameter model: 'uncensored' an. Dies stellt sicher, dass der Client Anfragen an den richtigen Modell-Endpunkt sendet. Das SDK verarbeitet Streaming- und Non-Streaming-Antworten einheitlich, sodass du Implementierungen austauschen kannst, ohne die Kernlogik der Anfrage zu ändern.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.getdeepseekapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming (SSE) aktivieren
Setze den Parameter stream auf true, um eine Server-Sent Events (SSE)-Antwort zu erhalten. Der Server sendet eine Reihe von Chunks, die jeweils einen Teil des generierten Texts enthalten. Dies reduziert die wahrgenommene Latenz bei langen Antworten und ermöglicht es dem Client, Token so anzuzeigen, wie sie erzeugt werden.
Stelle sicher, dass dein Client-Code das Stream-Ende-Ereignis ordnungsgemäß verarbeitet. Das Streaming ändert nichts an der Preisgestaltung oder Token-Zählung; du wirst weiterhin pro 1M Token für Input und Output berechnet. Das gesamte Kontextfenster bleibt auf 100.000 Token für die kombinierte Prompt- und Vervollständigungslänge begrenzt.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limits, Fehler und Kontextfenster
Dein API-Schlüssel ist auf 300 Anfragen pro Minute begrenzt. Wenn du diesen Schwellenwert überschreitest, gibt der Server einen 429-Fehler zurück, der ein Ratenlimit anzeigt. Jeder Anfragetextkörper darf 8 MB nicht überschreiten. Das Kontextfenster unterstützt 100.000 Token für die Summe aus Prompt und Vervollständigung, was bedeutet, dass du sowohl die Eingabe- als auch die Ausgabelängen berücksichtigen musst, wenn du deine Anwendung entwirfst.
Häufige Fehler sind 401 für ungültige Schlüssel, 402 für unzureichendes Prepaid-Guthaben und 429 für Ratenlimits. Du kannst deinen API-Schlüssel jederzeit über deine Kontoeinstellungen neu generieren, wodurch der alte Schlüssel sofort ungültig wird. Dies ist nützlich, wenn du einen Leck vermutest oder Anmeldeinformationen zwischen Umgebungen rotieren musst.
Funktionen und Limits
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Modell-ID | uncensored |
| Base-URL | https://api.getdeepseekapi.com/v1 |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-Modus | response_format: {"type": "json_object"} |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Anfragegröße | bis 8 MB |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Anmeldung | Google oder E-Mail und Passwort |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Wie groß ist das Kontextfenster?
Das Kontextfenster umfasst 100.000 Token, berechnet als Summe der Eingabe-Prompt-Token und der Output-Completion-Token. Es sind nicht exklusiv 100.000 Token nur für die Eingabe verfügbar.
Unterstützt dieser Dienst Function Calling?
Ja, der Endpunkt <code>/v1/chat/completions</code> unterstützt Tool- und Function Calling. Du kannst Tools in deiner Anfrage definieren, und das Modell gibt strukturierte Argumente dafür zurück.
Wie gehe ich mit einem 402-Fehler um?
Ein 402-Fehler bedeutet, dass dein Prepaid-Guthaben aufgebraucht ist. Du kannst dein Konto ab $10 mit Krypto (USDT oder USDC) aufladen. Guthaben verfällt nie.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.