AI 코딩 API 시작 가이드
코드 중심의 프롬프트를 불필요한 콘텐츠 거부 없이 처리하는 무검열 OpenAI 호환 엔드포인트에 코딩 에이전트를 연결하세요. 이 가이드에서는 ai coding api에 대한 인증, SDK 통합, 스트리밍 및 속도 제한을 다룹니다.
인증 설정
API 키 받기에서 계정을 생성하세요. 이메일과 비밀번호만 있으면 되며, 시작하기 위해 카드가 필요하지 않습니다. 가입하면 즉시 단일 API 키를 받게 됩니다. 이 키는 기본 URL https://api.codingllmapi.com/v1로의 모든 요청을 인증하는 데 사용됩니다.
키를 안전하게 보관하세요. 대시보드에서 언제든지 키를 재생성할 수 있으며, 이전 키는 즉시 무효화됩니다. 요청에 포함할 모델 식별자는 uncensored입니다. 이는 GPT, Claude 또는 Gemini의 프록시가 아닌 자체 서버에서 실행되는 오픈 웨이트 모델입니다.
첫 번째 요청
OpenAI 호환 형식을 사용하여 표준 채팅 완료 요청을 보내세요. API는 역할(user/assistant/system)과 콘텐츠가 있는 메시지를 받습니다. 미성년자를 제외한 합법적인 성인 콘텐츠나 논쟁적인 주제를 필터링하지 않고 코드 생성에 최적화된 텍스트 출력을 반환합니다.
- 기본 URL:
https://api.codingllmapi.com/v1 - 엔드포인트:
POST /v1/chat/completions - 모델:
uncensored
curl https://api.codingllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK 통합
공식 OpenAI Python SDK를 사용하세요. 클라이언트를 기본 URL로 지정하고 API 키를 제공하세요. SDK는 요청 형식을 자동으로 처리합니다. 이 방법은 간단한 텍스트 생성이나 더 복잡한 에이전트 루프 구축에 적합합니다.
openai 패키지의 최신 버전을 사용하고 있는지 확인하세요. 클라이언트는 엔드포인트에 맞게 JSON 직렬화 및 HTTP 헤더를 올바르게 처리합니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.codingllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK 통합
Anthropic 또는 Google 전용 SDK가 아닌 공식 openai Node.js 패키지를 사용하세요. 기본 URL을 우리 서비스에 연결하도록 구성하세요. 이는 우리가 제공하는 OpenAI 호환 요청 구조와의 호환성을 보장합니다.
npm install openai를 통해 패키지를 설치하세요. 키와 사용자 지정 기본 URL로 클라이언트를 초기화하세요. 이 방법은 코드 스니펫 생성이나 저장소 분석이 필요한 서버 측 코딩 에이전트에 적합합니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.codingllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
스트리밍 코드 응답
실시간 피드백을 위해 stream: true를 설정하여 스트리밍을 활성화하세요. API는 서버 전송 이벤트(SSE)를 반환합니다. 각 청크에는 부분 토큰 출력이 포함되어 있어 에이전트가 생성되는 대로 코드를 표시할 수 있습니다. 이는 긴 코드 블록의 지각된 지연 시간을 줄입니다.
스트림 이벤트를 처리하여 최종 응답을 누적하세요. 모델은 컨텍스트 한도에 도달하거나 max_tokens 매개변수에 도달할 때까지 생성을 계속합니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
제한 사항 및 오류
중단을 피하려면 이러한 제한 사항을 확인하세요. 키당 분당 300개의 요청이 허용됩니다. 최대 요청 본문 크기는 8 MB입니다. 속도 제한을 초과하면 429 오류가 발생합니다. 선불 크레딧이 고갈되면 402 오류가 발생합니다. 유효하지 않거나 회수된 키의 경우 401 오류가 반환됩니다.
컨텍스트 창은 총 100,000 토큰(프롬프트 + 완성)입니다. 프롬프트와 생성된 코드가 이를 초과하면 모델이 중지됩니다. 출력에 여유를 두기 위해 입력 토큰을 신중하게 계획하세요.
API 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 인증 | Authorization: Bearer YOUR_KEY |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| 모델 ID | uncensored |
| Base URL | https://api.codingllmapi.com/v1 |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON 모드 | response_format: {"type": "json_object"} |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 동시 요청 | 키당 동시 8개 |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 요청 크기 | 최대 8 MB |
| 속도 제한 | 키당 분당 300회 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 로그인 | Google 또는 이메일과 비밀번호 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
이 모델은 GPT-4나 Claude와 동일합니까?
아니요. 우리는 자체 GPU 서버에서 하나의 무검열 오픈 웨이트 모델을 제공합니다. 이 모델은 코드 생성에 최적화되어 있으며, 범용 모델과 달리 합법적인 성인 콘텐츠나 논쟁적인 주제에 대해 콘텐츠 필터를 사용하지 않습니다. OpenAI나 Anthropic의 프록시가 아닙니다.
가격 정책은 어떻게 되나요?
선불 크레딧 모델을 사용합니다. 입력 토큰은 100만 토큰당 $0.25, 출력 토큰은 100만 토큰당 $1.00입니다. 크레딧은 만료되지 않습니다. 암호화폐(USDT 또는 USDC)로 충전할 수 있으며, 최소 충전 금액은 $10입니다. 월 구독료나 구독이 없습니다.
어떤 콘텐츠가 차단되나요?
단 하나의 하드 제한은 미성년자가 포함된 성적 콘텐츠입니다. 그 외의 모든 합법적인 성인, 허구적 또는 논쟁적인 주제는 허용됩니다. 우리는 학습을 위해 프롬프트를 사용하지 않습니다. 귀하의 데이터는 계정 비공개로 유지됩니다.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고 키를 복사한 후 기본 URL을 변경하세요. 설정은 이것으로 끝입니다.
API 키 받기