Przewodnik szybkiego startu API do kodowania AI
Podłącz swojego agenta programistycznego do endpointu bez cenzury kompatybilnego z OpenAI, który obsługuje prompty obfitujące w kod bez zbędnych odrzuceń treści. Ten przewodnik obejmuje uwierzytelnianie, integrację SDK, strumieniowanie i limity zapytań dla API programistycznego.
Konfiguracja uwierzytelniania
Zacznij od założenia konta na stronie Get API key. Potrzebujesz tylko adresu e-mail i hasła; nie jest wymagana karta do rozpoczęcia. Po rejestracji otrzymujesz natychmiast jeden klucz API. Ten klucz uwierzytelnia wszystkie zapytania do adresu bazowego: https://api.codingllmapi.com/v1.
Chroń swój klucz. Możesz go wygenerować ponownie w dowolnym momencie z pulpitu nawigacyjnego, co natychmiast unieważnia poprzedni klucz. Identyfikator modelu do wysłania w zapytaniach to uncensored. Jest to model o otwartych wagach działający na naszych własnych serwerach, a nie proxy dla GPT, Claude ani Gemini.
Pierwsze zapytanie
Wyślij standardowe zapytanie uzupełnienie rozmowy czatu w formacie kompatybilnym z OpenAI. API akceptuje wiadomości z rolą (user/assistant/system) i treścią. Zwraca tekst zoptymalizowany pod kątem generowania kodu bez filtrowania prawnie dopuszczalnych tematów dla dorosłych lub kontrowersyjnych (z wyjątkiem małoletnich).
- Bazowy URL:
https://api.codingllmapi.com/v1 - Endpoint:
POST /v1/chat/completions - Model:
uncensored
curl https://api.codingllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integracja z Python SDK
Użyj oficjalnego SDK Python OpenAI. Wskaż klientowi bazowy URL i podaj swój klucz API. SDK automatycznie obsługuje format zapytania. Podejście to działa do prostego generowania tekstu lub budowania bardziej złożonych pętli agentów.
Upewnij się, że używasz najnowszej wersji pakietu openai. Klient poprawnie obsłuży serializację JSON i nagłówki HTTP dla naszego endpointu.
from openai import OpenAI
client = OpenAI(base_url="https://api.codingllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integracja z Node SDK
Użyj oficjalnego pakietu Node.js openai, a nie SDK specyficznych dla Anthropic lub Google. Skonfiguruj bazowy URL tak, aby wskazywał na naszą usługę. Zapewnia to kompatybilność ze strukturą zapytań kompatybilną z OpenAI, którą udostępniamy.
Zainstaluj pakiet poleceniem npm install openai. Zainicjuj klienta swoim kluczem i niestandardowym bazowym URL. Ta metoda jest niezawodna dla serwerowych agentów kodujących, które muszą generować fragmenty kodu lub analizować repozytoria.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.codingllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Strumieniowanie odpowiedzi z kodem
Aby uzyskać natychmiastową informację zwrotną, włącz strumieniowanie, ustawiając stream: true. API zwraca zdarzenia wysłane przez serwer (SSE). Każdy fragment zawiera częściowe wyjścia tokenów, pozwalając Twojemu agentowi wyświetlać kod w miarę jego generowania. Zmniejsza to postrzeganą opóźnienie dla długich bloków kodu.
Obsłuż zdarzenia strumieniowania, aby zebrać ostateczną odpowiedź. Model kontynuuje generowanie, aż osiągnie limit okna kontekstu lub parametr max_tokens.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limity i błędy
Zwróć uwagę na te limity, aby uniknąć przerw. Masz 300 zapytań na minutę na klucz. Maksymalny rozmiar ciała zapytania to 8 MB. Jeśli przekroczysz limit zapytań, otrzymasz błąd 429. Jeśli wyczerpiesz przedpłacony kredyt, otrzymasz błąd 402. Nieprawidłowy lub unieważniony klucz zwraca 401.
Okno kontekstu wynosi łącznie 100 000 tokenów (prompt + uzupełnienie). Jeśli Twój prompt plus wygenerowany kod przekracza tę wartość, model przestaje generować. Planuj tokeny wejściowe ostrożnie, aby zostawić miejsce na wyjście.
Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| ID modelu | uncensored |
| Base URL | https://api.codingllmapi.com/v1 |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Tryb JSON | response_format: {"type": "json_object"} |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozmiar zapytania | do 8 MB |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Bonus | +5% od $50, +10% od $100 |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Logowanie | Google albo e-mail i hasło |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czy ten model jest taki sam jak GPT-4 czy Claude?
Nie. Udostępniamy jeden model o otwartych wagach bez cenzury na własnych serwerach GPU. Jest dostosowany do generowania kodu i nie stosuje filtrów treści dla legalnych tematów dla dorosłych lub kontrowersyjnych, w przeciwieństwie do modeli ogólnego przeznaczenia. Nie jest proxy dla OpenAI ani Anthropic.
Jak działa cennik?
Stosujemy model z przedpłaconym kredytem. Tokeny wejściowe kosztują $0,25 za 1 mln; tokeny wyjściowe kosztują $1,00 za 1 mln. Kredyty nigdy nie wygasają. Możesz doładować środki kryptowalutą (USDT lub USDC), zaczynając od $10. Bez miesięcznych opłat ani subskrypcji.
Jaka treść jest blokowana?
Jedynym bezwzględnym limitem jest treść seksualna z udziałem małoletnich. Wszystkie inne legalne tematy dla dorosłych, fikcyjne lub kontrowersyjne są dozwolone. Nie używamy promptów do trenowania. Twoje dane pozostają prywatne w ramach Twojego konta.
Twój klucz jest o jeden formularz stąd
Załóż konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.
Pobierz klucz API