DE ▾
API-Schlüssel erhalten

getdeepseekapi.comDocs

DeepSeek-API: Erste Anfrage in fünf Minuten

Erhalte deine erste Antwort in fünf Minuten, indem du deinen bestehenden OpenAI-kompatiblen Client auf unsere Basis-URL zeigst und dich mit dem bei der Registrierung generierten Schlüssel authentifizierst.

Basis-URL und Authentifizierung

Unsere API folgt der Standard-Oberfläche von OpenAI, sodass du in deiner Client-Konfiguration nur zwei Werte ändern musst. Setze die Basis-URL auf https://api.getdeepseekapi.com/v1 und verwende den API-Schlüssel, der direkt nach der Erstellung deines Kontos auf der Seite API-Schlüssel erhalten angezeigt wird. Es werden keine Telefonnummer oder Kreditkarte benötigt, um zu starten, und du erhältst $0,50 an Testguthaben, die sieben Tage lang gültig sind.

Jedes Konto erlaubt nur einen aktiven Schlüssel gleichzeitig. Wenn du deinen Schlüssel rotierst, wird der vorherige sofort widerrufen. Dies vereinfacht die Verwaltung von Geheimnissen in Entwicklungs- und Produktionsumgebungen ohne komplexe Berechtigungsbereiche.

Chat-Vervollständigung senden

Sende eine Standard-POST-Anfrage an /v1/chat/completions, um eine Textantwort zu erhalten. Der Endpunkt akzeptiert ein messages-Array, das deinen System-Prompt und die Benutzerabfrage enthält, sowie eine model-Kennung, die auf uncensored gesetzt ist. Dieses Modell läuft auf unseren eigenen GPU-Servern und ist darauf abgestimmt, ohne Inhaltsablehnungen für die legale Erwachsenennutzung zu antworten.

Stelle sicher, dass der Anfragetextkörper 8 MB nicht überschreitet. Wenn der Schlüssel ungültig oder abgelaufen ist, gibt der Server einen 401-Fehler zurück. Wenn dein Prepaid-Guthaben aufgebraucht ist, erhältst du einen 402-Fehler, der eine Aufladung erfordert. Du kannst ab $10 über Krypto (USDT oder USDC) Guthaben aufladen.

curl https://api.getdeepseekapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python-SDK installieren und verwenden

Die Verwendung der offiziellen OpenAI Python-Bibliothek ist der schnellste Weg zur Integration. Installiere das Paket über pip und konfiguriere den Client mit deiner benutzerdefinierten Basis-URL und deinem API-Schlüssel. Der Parameter model muss auf uncensored gesetzt sein, um sicherzustellen, dass du mit unserer spezifischen Instanz kommunizierst.

Dieser Ansatz funktioniert mit jedem OpenAI-kompatiblen SDK, einschließlich der für Node.js oder Go. Der Client übernimmt die Serialisierung und Wiederholungen automatisch. Denke daran, dass die Modell-ID kein Herstellername wie GPT-4 ist; es ist eine spezifische Kennzeichnung für unser unzensiertes Modell.

from openai import OpenAI

client = OpenAI(base_url="https://api.getdeepseekapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js-Integration

Für JavaScript-Umgebungen installiere das OpenAI SDK und konfiguriere es ähnlich wie im Python-Beispiel. Setze die baseUrl auf unseren Endpunkt und gib deinen API-Schlüssel an. Das Node-SDK unterstützt sowohl synchrone als auch asynchrone Muster.

Gib bei der Erstellung der Anfrage die Parameter model: 'uncensored' an. Dies stellt sicher, dass der Client Anfragen an den richtigen Modell-Endpunkt sendet. Das SDK verarbeitet Streaming- und Non-Streaming-Antworten einheitlich, sodass du Implementierungen austauschen kannst, ohne die Kernlogik der Anfrage zu ändern.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.getdeepseekapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming (SSE) aktivieren

Setze den Parameter stream auf true, um eine Server-Sent Events (SSE)-Antwort zu erhalten. Der Server sendet eine Reihe von Chunks, die jeweils einen Teil des generierten Texts enthalten. Dies reduziert die wahrgenommene Latenz bei langen Antworten und ermöglicht es dem Client, Token so anzuzeigen, wie sie erzeugt werden.

Stelle sicher, dass dein Client-Code das Stream-Ende-Ereignis ordnungsgemäß verarbeitet. Das Streaming ändert nichts an der Preisgestaltung oder Token-Zählung; du wirst weiterhin pro 1M Token für Input und Output berechnet. Das gesamte Kontextfenster bleibt auf 100.000 Token für die kombinierte Prompt- und Vervollständigungslänge begrenzt.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limits, Fehler und Kontextfenster

Dein API-Schlüssel ist auf 300 Anfragen pro Minute begrenzt. Wenn du diesen Schwellenwert überschreitest, gibt der Server einen 429-Fehler zurück, der ein Ratenlimit anzeigt. Jeder Anfragetextkörper darf 8 MB nicht überschreiten. Das Kontextfenster unterstützt 100.000 Token für die Summe aus Prompt und Vervollständigung, was bedeutet, dass du sowohl die Eingabe- als auch die Ausgabelängen berücksichtigen musst, wenn du deine Anwendung entwirfst.

Häufige Fehler sind 401 für ungültige Schlüssel, 402 für unzureichendes Prepaid-Guthaben und 429 für Ratenlimits. Du kannst deinen API-Schlüssel jederzeit über deine Kontoeinstellungen neu generieren, wodurch der alte Schlüssel sofort ungültig wird. Dies ist nützlich, wenn du einen Leck vermutest oder Anmeldeinformationen zwischen Umgebungen rotieren musst.

Funktionen und Limits

Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
EndpunktePOST /v1/chat/completions · GET /v1/models
AuthentifizierungAuthorization: Bearer YOUR_KEY
Modell-IDuncensored
Base-URLhttps://api.getdeepseekapi.com/v1
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON-Modusresponse_format: {"type": "json_object"}
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Ratenlimit300 Anfragen pro Minute und Schlüssel
Anfragegrößebis 8 MB
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Bonus+5 % ab $50, +10 % ab $100
AnmeldungGoogle oder E-Mail und Passwort
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Wie groß ist das Kontextfenster?

Das Kontextfenster umfasst 100.000 Token, berechnet als Summe der Eingabe-Prompt-Token und der Output-Completion-Token. Es sind nicht exklusiv 100.000 Token nur für die Eingabe verfügbar.

Unterstützt dieser Dienst Function Calling?

Ja, der Endpunkt <code>/v1/chat/completions</code> unterstützt Tool- und Function Calling. Du kannst Tools in deiner Anfrage definieren, und das Modell gibt strukturierte Argumente dafür zurück.

Wie gehe ich mit einem 402-Fehler um?

Ein 402-Fehler bedeutet, dass dein Prepaid-Guthaben aufgebraucht ist. Du kannst dein Konto ab $10 mit Krypto (USDT oder USDC) aufladen. Guthaben verfällt nie.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten