AI Coding API Schnellstart-Anleitung
Verbinde deinen Coding-Agenten mit einem unzensierten, OpenAI-kompatiblen Endpunkt, der codeintensive Prompts ohne unnötige Inhaltsablehnungen verarbeitet. Diese Anleitung behandelt Authentifizierung, SDK-Integration, Streaming und Ratenlimits für die AI-Coding-API.
Authentifizierung einrichten
Erstelle ein Konto und erhalte den API-Schlüssel. Du brauchst nur eine E-Mail-Adresse und ein Passwort; zum Starten ist keine Karte erforderlich. Nach der Anmeldung erhältst du sofort einen einzelnen API-Schlüssel. Dieser Schlüssel authentifiziert alle Anfragen an die Basis-URL: https://api.codingllmapi.com/v1.
Bewahre deinen Schlüssel sicher auf. Du kannst ihn jederzeit über dein Dashboard neu generieren, wodurch der vorherige Schlüssel sofort ungültig wird. Die Modellkennung, die du in deinen Anfragen senden musst, ist uncensored. Dies ist ein Open-Weight-Modell, das auf unseren eigenen Servern läuft, kein Proxy für GPT, Claude oder Gemini.
Erste Anfrage
Sende eine Standard-Chat-Vervollständigungsanfrage im OpenAI-kompatiblen Format. Die API akzeptiert Nachrichten mit einer Rolle (user/assistant/system) und Inhalt. Sie gibt Textausgaben zurück, die für die Codegenerierung optimiert sind, ohne rechtmäßige Erwachsenenthemen oder kontroverse Themen zu filtern (außer bei Minderjährigen).
- Basis-URL:
https://api.codingllmapi.com/v1 - Endpunkt:
POST /v1/chat/completions - Modell:
uncensored
curl https://api.codingllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK-Integration
Verwende das offizielle OpenAI Python SDK. Weise den Client auf unsere Basis-URL hin und gib deinen API-Schlüssel an. Das SDK verarbeitet das Anfrageformat automatisch. Dieser Ansatz funktioniert für einfache Textgenerierung oder zum Aufbau komplexerer Agenten-Schleifen.
Stelle sicher, dass du eine aktuelle Version des openai-Pakets verwendest. Der Client serialisiert JSON und HTTP-Header korrekt für unseren Endpunkt.
from openai import OpenAI
client = OpenAI(base_url="https://api.codingllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK-Integration
Verwende das offizielle openai Node.js-Paket, nicht die Anthropic- oder Google-spezifischen SDKs. Konfiguriere die Basis-URL so, dass sie auf unseren Dienst zeigt. Dies gewährleistet die Kompatibilität mit der OpenAI-kompatiblen Anfragestruktur, die wir bereitstellen.
Installiere das Paket über npm install openai. Initialisiere den Client mit deinem Schlüssel und der benutzerdefinierten Basis-URL. Diese Methode ist zuverlässig für serverseitige Coding-Agenten, die Code-Snippets generieren oder Repositories analysieren müssen.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.codingllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming-Code-Antworten
Aktiviere für Echtzeit-Feedback das Streaming, indem du stream: true setzt. Die API gibt Server-Sent Events (SSE) zurück. Jeder Chunk enthält teilweise Token-Ausgaben, sodass dein Agent Code anzeigen kann, während er generiert wird. Dies reduziert die wahrgenommene Latenz für lange Codeblöcke.
Verarbeite die Streaming-Ereignisse, um die finale Antwort zu sammeln. Das Modell generiert weiter, bis das Kontextfenster oder der Parameter max_tokens erreicht ist.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Grenzen und Fehler
Behalte diese Limits im Auge, um Unterbrechungen zu vermeiden. Du erhältst 300 Anfragen pro Minute pro Schlüssel. Die maximale Größe des Anfragekörpers beträgt 8 MB. Wenn du das Ratenlimit überschreitest, erhältst du einen 429-Fehler. Wenn dein Prepaid-Guthaben aufgebraucht ist, erhältst du einen 402-Fehler. Ein ungültiger oder widerrufenen Schlüssel gibt 401 zurück.
Das Kontextfenster beträgt insgesamt 100.000 Token (Prompt + Vervollständigung). Wenn dein Prompt plus generierter Code dies überschreitet, stoppt das Modell. Plane deine Input-Token sorgfältig, um Platz für den Output zu lassen.
Funktionen und Limits
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Modell-ID | uncensored |
| Base-URL | https://api.codingllmapi.com/v1 |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-Modus | response_format: {"type": "json_object"} |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Anfragegröße | bis 8 MB |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist dieses Modell dasselbe wie GPT-4 oder Claude?
Nein. Wir bieten ein einzelnes unzensiertes Open-Weight-Modell auf unseren eigenen GPU-Servern an. Es ist auf Codegenerierung abgestimmt und verwendet keine Inhaltsfilter für rechtmäßige erwachsene oder kontroverse Themen, im Gegensatz zu allgemeinen Modellen. Es ist kein Proxy für OpenAI oder Anthropic.
Wie funktioniert die Preisgestaltung?
Wir nutzen ein Prepaid-Guthaben-Modell. Input-Token kosten 0,25 $ pro 1M; Output-Token kosten 1,00 $ pro 1M. Guthaben verfällt nie. Du kannst mit Krypto (USDT oder USDC) aufladen, ab 10 $. Keine monatlichen Gebühren oder Abonnements.
Welcher Inhalt wird blockiert?
Die einzige harte Grenze ist sexuell explizite Darstellung von Minderjährigen. Alle anderen rechtmäßigen, erwachsenen, fiktiven oder kontroversen Themen sind erlaubt. Wir verwenden Prompts nicht zum Training. Deine Daten bleiben in deinem Konto privat.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.
API-Schlüssel erhalten