Guide de démarrage rapide de l'API de codage IA
Connectez votre agent de codage à un endpoint compatible OpenAI sans censure, capable de gérer des prompts lourds en code sans refus de contenu superflu. Ce guide couvre l'authentification, l'intégration SDK, le streaming et les limites de débit pour l'API de codage IA.
Configuration de l'authentification
Commencez par créer un compte sur Get API key. Vous n'avez besoin que d'une adresse e-mail et d'un mot de passe ; aucune carte n'est requise pour commencer. Après vous être inscrit, vous recevez immédiatement une clé API unique. Cette clé authentifie toutes les requêtes vers l'URL de base : https://api.codingllmapi.com/v1.
Conservez votre clé en sécurité. Vous pouvez la régénérer à tout moment depuis votre tableau de bord, ce qui invalide instantanément la clé précédente. L'identifiant de modèle à envoyer dans vos requêtes est uncensored. Il s'agit d'un modèle à poids ouverts fonctionnant sur nos propres serveurs, et non d'un proxy pour GPT, Claude ou Gemini.
Première requête
Envoyez une requête standard de complétion de chat au format compatible OpenAI. L'API accepte les messages avec un rôle (user/assistant/system) et un contenu. Elle renvoie un texte de sortie optimisé pour la génération de code sans filtrer les sujets adultes licites ou controversés (sauf pour les mineurs).
- URL de base :
https://api.codingllmapi.com/v1 - Endpoint :
POST /v1/chat/completions - Modèle :
uncensored
curl https://api.codingllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Intégration SDK Python
Utilisez le SDK Python officiel OpenAI. Pointez le client vers notre URL de base et fournissez votre clé API. Le SDK gère automatiquement le format de la requête. Cette approche fonctionne pour la génération de texte simple ou pour créer des boucles d'agents plus complexes.
Assurez-vous d'utiliser une version récente du package openai. Le client gère correctement la sérialisation JSON et les en-têtes HTTP pour notre endpoint.
from openai import OpenAI
client = OpenAI(base_url="https://api.codingllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Intégration SDK Node.js
Utilisez le package Node.js officiel openai, et non les SDK spécifiques à Anthropic ou Google. Configurez l'URL de base pour pointer vers notre service. Cela garantit la compatibilité avec la structure de requête compatible OpenAI que nous proposons.
Installez le package via npm install openai. Initialisez le client avec votre clé et l'URL de base personnalisée. Cette méthode est fiable pour les agents de codage côté serveur qui doivent générer des extraits de code ou analyser des dépôts.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.codingllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Réponses de code en streaming
Pour obtenir des retours en temps réel, activez le streaming en définissant stream: true. L'API renvoie des Server-Sent Events (SSE). Chaque fragment contient des sorties de token partielles, ce qui permet à votre agent d'afficher le code au fur et à mesure de sa génération. Cela réduit la latence perçue pour les longs blocs de code.
Gérez les événements de streaming pour accumuler la réponse finale. Le modèle continue de générer jusqu'à ce qu'il atteigne la limite de la fenêtre de contexte ou le paramètre max_tokens.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites et erreurs
Vigilez ces limites pour éviter les interruptions. Vous bénéficiez de 300 requêtes par minute par clé. La taille maximale du corps de la requête est de 8 Mo. Si vous dépassez la limite de débit, vous recevez une erreur 429. Si votre crédit prépayé est épuisé, vous obtenez une erreur 402. Une clé invalide ou révoquée renvoie 401.
La fenêtre de contexte est de 100 000 tokens au total (prompt + complétion). Si votre prompt plus le code généré dépasse cette limite, le modèle s'arrête. Planifiez soigneusement vos tokens d'entrée pour laisser de la place à la sortie.
Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Authentification | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID du modèle | uncensored |
| Base URL | https://api.codingllmapi.com/v1 |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Mode JSON | response_format: {"type": "json_object"} |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Taille | jusqu'à 8 Mo par requête |
| Limite de débit | 300 requêtes par minute et par clé |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Ce modèle est-il identique à GPT-4 ou Claude ?
Non. Nous proposons un seul modèle à poids ouverts sans censure sur nos propres serveurs GPU. Il est optimisé pour la génération de code et n'applique pas de filtres de contenu pour les sujets adultes licites ou controversés, contrairement aux modèles à usage général. Il ne s'agit pas d'un proxy pour OpenAI ou Anthropic.
Comment fonctionne la tarification ?
Nous utilisons un modèle de crédit prépayé. Les tokens d'entrée coûtent 0,25 $ par 1M ; les tokens de sortie coûtent 1,00 $ par 1M. Les crédits n'expirent jamais. Vous pouvez recharger avec des cryptomonnaies (USDT ou USDC), à partir de 10 $. Aucun frais mensuel ni abonnement.
Quel contenu est bloqué ?
La seule limite stricte concerne le contenu sexuel impliquant des mineurs. Tous les autres sujets adultes licites, fictifs ou controversés sont autorisés. Nous n'utilisons pas vos prompts pour l'entraînement. Vos données restent privées à votre compte.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.
Obtenir une clé API