DeepSeek API: 5분 내 첫 요청
기존 OpenAI 호환 클라이언트를 기본 URL에 연결하고 가입 시 생성된 키로 인증하여 5분 내에 첫 응답을 받으세요.
기본 URL 및 인증
당사의 API는 표준 OpenAI 인터페이스를 따르므로 클라이언트 구성에서 두 가지 값만 변경하면 됩니다. 기본 URL을 https://api.getdeepseekapi.com/v1로 설정하고 API 키 받기 페이지에서 계정을 생성한 직후 표시되는 API 키를 사용하세요. 시작하는 데 전화번호나 신용카드가 필요 없으며, 7일 동안 유효한 $0.50의 무료 체험 크레딧을 받습니다.
각 계정당 동시에 활성화될 수 있는 키는 하나뿐입니다. 키를 교체하면 이전 키가 즉시 무효화됩니다. 이는 복잡한 권한 범위 없이 개발 및 프로덕션 환경 전반에 걸쳐 시크릿 관리를 단순화합니다.
채팅 완료 전송
텍스트 응답을 받으려면 POST 요청을 /v1/chat/completions 엔드포인트로 전송하세요. 이 엔드포인트는 시스템 프롬프트와 사용자 쿼리를 포함하는 messages 배열과 uncensored로 설정된 model 식별자를 받습니다. 이 모델은 자체 GPU 서버에서 실행되며 합법적인 성인 사용에 대한 콘텐츠 거부 없이 답변하도록 조정되었습니다.
요청 본문이 8 MB 미만인지 확인하세요. 키가 잘못되었거나 만료된 경우 서버는 401 오류를 반환합니다. 선불 크레딧이 고갈되면 충전이 필요한 402 오류가 발생합니다. 암호화폐(USDT 또는 USDC)로 최소 $10부터 자금을 추가할 수 있습니다.
curl https://api.getdeepseekapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK 설치 및 사용
공식 OpenAI Python 라이브러리를 사용하는 것이 통합을 위한 가장 빠른 방법입니다. pip를 통해 패키지를 설치한 후 사용자 정의 기본 URL과 API 키로 클라이언트를 구성하세요. model 매개변수는 uncensored로 설정해야 특정 인스턴스와 통신할 수 있습니다.
이 접근 방식은 Node.js 또는 Go에 사용되는 SDK를 포함한 모든 OpenAI 호환 SDK와 함께 작동합니다. 클라이언트는 직렬화 및 재시도를 자동으로 처리합니다. 모델 ID는 GPT-4와 같은 벤더 이름이 아니라 당사의 무검열 모델에 대한 특정 식별자임을 기억하세요.
from openai import OpenAI
client = OpenAI(base_url="https://api.getdeepseekapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js 통합
JavaScript 환경에서는 OpenAI SDK를 설치하고 Python 예제와 유사하게 구성하세요. baseUrl을 엔드포인트로 설정하고 API 키를 제공하세요. Node SDK는 동기식 및 비동기식 패턴을 모두 지원합니다.
요청을 구성할 때 매개변수에 model: 'uncensored'를 지정하세요. 이렇게 하면 클라이언트가 올바른 모델 엔드포인트로 요청을 보냅니다. SDK는 스트리밍 및 비스트리밍 응답을 균일하게 처리하여 핵심 요청 로직을 변경하지 않고도 구현을 교체할 수 있게 합니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.getdeepseekapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
스트리밍(SSE) 활성화
stream 매개변수를 true로 설정하여 SSE 응답을 받으세요. 서버는 생성된 텍스트의 일부를 포함하는 청크 시리즈를 보냅니다. 이는 긴 응답의 지각된 지연을 줄이고 클라이언트가 생성된 토큰을 즉시 표시할 수 있게 합니다.
클라이언트 코드에서 스트리밍 종료 이벤트를 적절히 처리하는지 확인하세요. 스트리밍은 가격 책정이나 토큰 카운팅에 영향을 주지 않습니다. 입력 및 출력에 대해 여전히 100만 토큰당 요금이 부과됩니다. 총 컨텍스트 창은 프롬프트와 완성을 합한 100,000 토큰으로 제한됩니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
제한, 오류 및 컨텍스트 창
API 키는 분당 300개의 요청으로 제한됩니다. 이 한도를 초과하면 서버는 속도 제한을 나타내는 429 오류를 반환합니다. 각 요청 본문은 8 MB를 초과할 수 없습니다. 컨텍스트 창은 프롬프트와 완성의 합계에 대해 100,000 토큰을 지원하므로, 애플리케이션을 설계할 때 입력과 출력 길이를 모두 고려해야 합니다.
일반적인 오류로는 잘못된 키에 대한 401, 선불 크레딧 부족에 대한 402, 속도 제한에 대한 429가 있습니다. 계정 설정에서 언제든지 API 키를 재생성할 수 있으며, 이는 이전 키를 즉시 무효화합니다. 이는 유출이 의심되거나 환경 간에 자격 증명을 교체해야 할 때 유용합니다.
API 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| 인증 | Authorization: Bearer YOUR_KEY |
| 모델 ID | uncensored |
| Base URL | https://api.getdeepseekapi.com/v1 |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON 모드 | response_format: {"type": "json_object"} |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 속도 제한 | 키당 분당 300회 |
| 요청 크기 | 최대 8 MB |
| 동시 요청 | 키당 동시 8개 |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 로그인 | Google 또는 이메일과 비밀번호 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
컨텍스트 창 크기는 얼마인가요?
컨텍스트 창은 입력 프롬프트 토큰과 출력 완료 토큰의 합계로 계산된 100,000 토큰입니다. 입력 전용으로 사용 가능한 100,000 토큰이 아닙니다.
이 서비스는 함수 호출을 지원하나요?
네, <code>/v1/chat/completions</code> 엔드포인트는 도구 및 함수 호출을 지원합니다. 요청에 도구를 정의하면 모델이 이에 대한 구조화된 인수를 반환합니다.
402 오류를 어떻게 처리하나요?
402 오류는 선불 크레딧 잔액이 0임을 의미합니다. 암호화폐(USDT 또는 USDC)로 최소 $10부터 계정을 충전할 수 있습니다. 크레딧은 만료되지 않습니다.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고 키를 복사한 후 기본 URL을 변경하세요. 설정은 이것뿐입니다.