Snelstartgids AI-coderings-API
Koppel je code-agent aan een ongecensureerde, OpenAI-compatibele endpoint die prompts met veel code verwerkt zonder onnodige inhoudsfilters. Deze gids behandelt authenticatie, SDK-integratie, streaming en rate limits voor de AI-coderings-API.
Authenticatie-instellingen
Maak een account aan op Get API key. Je hebt alleen een e-mailadres en wachtwoord nodig; er is geen kaart nodig om te beginnen. Na registratie ontvang je direct één API-sleutel. Deze sleutel verifieert alle verzoeken naar de basis-URL: https://api.codingllmapi.com/v1.
Houd je sleutel veilig. Je kunt deze op elk moment opnieuw genereren via je dashboard, waardoor de vorige sleutel direct ongeldig wordt. De model-ID die je in je verzoeken moet verzenden is uncensored. Dit is een open-weight model dat op onze eigen servers draait, geen proxy voor GPT, Claude of Gemini.
Eerste verzoek
Stuur een standaard chat-completieverzoek in het OpenAI-compatibele formaat. De API accepteert berichten met een rol (user/assistant/system) en inhoud. Het retourneert tekstuitvoer geoptimaliseerd voor codegeneratie zonder filtering van wettelijke volwassen of controversiële onderwerpen (behalve bij minderjarigen).
- Basis-URL:
https://api.codingllmapi.com/v1 - Endpoint:
POST /v1/chat/completions - Model:
uncensored
curl https://api.codingllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK-integratie
Gebruik de officiële OpenAI Python SDK. Wijs de client naar onze basis-URL en lever je API-sleutel. De SDK verwerkt het verzoekformaat automatisch. Deze aanpak werkt voor eenvoudige tekstgeneratie of het bouwen van complexere agent-loops.
Zorg ervoor dat je een recente versie van het openai pakket gebruikt. De client verwerkt JSON-serialisatie en HTTP-headers correct voor onze endpoint.
from openai import OpenAI
client = OpenAI(base_url="https://api.codingllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK-integratie
Gebruik het officiële openai Node.js-pakket, niet de specifieke SDK's van Anthropic of Google. Configureer de basis-URL om naar onze service te verwijzen. Dit zorgt voor compatibiliteit met de OpenAI-compatibele verzoekstructuur die wij aanbieden.
Installeer het pakket via npm install openai. Initialiseer de client met je sleutel en de aangepaste basis-URL. Deze methode is betrouwbaar voor server-side code-agents die codefragmenten moeten genereren of repositories moeten analyseren.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.codingllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming code-antwoorden
Schakel streaming in voor realtime feedback door stream: true in te stellen. De API retourneert Server-Sent Events (SSE). Elke chunk bevat gedeeltelijke token-uitvoer, waardoor je agent code kan weergeven terwijl deze wordt gegenereerd. Dit vermindert de waargenomen latentie voor lange codeblokken.
Verwerk de stream-events om de definitieve respons op te bouwen. Het model blijft genereren totdat de contextlimiet is bereikt of de max_tokens parameter.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limieten en fouten
Houd deze limieten in de gaten om onderbrekingen te voorkomen. Je krijgt 300 verzoeken per minuut per sleutel. De maximale grootte van de request body is 8 MB. Als je de rate limit overschrijdt, ontvang je een 429-fout. Als je prepaid tegoed op is, krijg je een 402-fout. Een ongeldige of ingetrokken sleutel retourneert 401.
Het contextvenster is in totaal 100.000 tokens (prompt + completion). Als je prompt plus gegenereerde code dit overschrijdt, stopt het model. Plan je input tokens zorgvuldig zodat er ruimte is voor de output.
API-specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Model-ID | uncensored |
| Base URL | https://api.codingllmapi.com/v1 |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-modus | response_format: {"type": "json_object"} |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Verzoekgrootte | tot 8 MB |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Inloggen | Google of e-mail en wachtwoord |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Is dit model hetzelfde als GPT-4 of Claude?
Nee. Wij bieden één ongecensureerd open-weight model aan op onze eigen GPU-servers. Het is geoptimaliseerd voor codegeneratie en hanteert geen inhoudsfilters voor wettelijk volwassen of controversiële onderwerpen, in tegenstelling tot algemene modellen. Het is geen proxy voor OpenAI of Anthropic.
Hoe werkt de prijsstelling?
Wij gebruiken een prepaid credit model. Input tokens kosten $0,25 per 1M; output tokens kosten $1,00 per 1M. Credits vervallen nooit. Je kunt opwaarderen met crypto (USDT of USDC), vanaf $10. Geen maandelijkse kosten of abonnementen.
Welke inhoud wordt geblokkeerd?
De enige harde limiet is seksuele inhoud met minderjarigen. Alle andere wettelijke volwassen, fictieve of controversiële onderwerpen zijn toegestaan. Wij gebruiken prompts niet voor training. Je gegevens blijven privé voor je account.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.
API-sleutel aanvragen