ES ▾
Obtener clave de API

Guía de inicio rápido de la API de codificación IA

Conecta tu agente de codificación a un endpoint compatible con OpenAI sin censura que maneja prompts intensivos en código sin rechazos de contenido innecesarios. Esta guía cubre autenticación, integración con SDK, streaming y límites de peticiones para la API de codificación IA.

Configuración de autenticación

Comienza creando una cuenta en Obtener clave de API. Solo necesitas un correo electrónico y contraseña; no se requiere tarjeta para comenzar. Al registrarte, recibes una única clave de API de inmediato. Esta clave autentica todas las peticiones a la URL base: https://api.codingllmapi.com/v1.

Mantén tu clave segura. Puedes regenerarla en cualquier momento desde tu panel, lo que invalida instantáneamente la clave anterior. El identificador del modelo para enviar en tus peticiones es uncensored. Es un modelo de pesos abiertos que se ejecuta en nuestros propios servidores, no un proxy para GPT, Claude o Gemini.

Primera petición

Envía una petición estándar de finalización de chat usando el formato compatible con OpenAI. La API acepta mensajes con un role (user/assistant/system) y content. Devuelve texto optimizado para generación de código sin filtrar temas adultos lícitos o controversiales (excepto menores).

  • URL base: https://api.codingllmapi.com/v1
  • Endpoint: POST /v1/chat/completions
  • Modelo: uncensored
curl https://api.codingllmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Integración con SDK Python

Usa el SDK oficial de OpenAI para Python. Apunta el cliente a nuestra URL base y proporciona tu clave de API. El SDK maneja el formato de la petición automáticamente. Este enfoque funciona para generación de texto simple o para construir bucles de agentes más complejos.

Asegúrate de usar una versión reciente del paquete openai. El cliente manejará la serialización JSON y los encabezados HTTP correctamente para nuestro endpoint.

from openai import OpenAI

client = OpenAI(base_url="https://api.codingllmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integración con SDK Node.js

Usa el paquete oficial openai para Node.js, no los SDK específicos de Anthropic o Google. Configura la URL base para apuntar a nuestro servicio. Esto garantiza la compatibilidad con la estructura de peticiones compatible con OpenAI que ofrecemos.

Instala el paquete mediante npm install openai. Inicializa el cliente con tu clave y la URL base personalizada. Este método es fiable para agentes de codificación en el lado del servidor que necesitan generar fragmentos de código o analizar repositorios.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.codingllmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Respuestas de código en streaming

Para obtener retroalimentación en tiempo real, activa el streaming estableciendo stream: true. La API devuelve eventos enviados por el servidor (SSE). Cada fragmento contiene salidas de tokens parciales, lo que permite que tu agente muestre el código a medida que se genera. Esto reduce la latencia percibida en bloques de código largos.

Gestiona los eventos del streaming para acumular la respuesta final. El modelo continúa generando hasta que alcanza el límite de la ventana de contexto o el parámetro max_tokens.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Límites y errores

Ten en cuenta estos límites para evitar interrupciones. Tienes 300 peticiones por minuto por clave. El tamaño máximo del cuerpo de la petición es 8 MB. Si excedes el límite de peticiones, recibes un error 429. Si se agota tu crédito prepago, recibes un error 402. Una clave inválida o revocada devuelve 401.

La ventana de contexto es de 100,000 tokens en total (prompt + completion). Si tu prompt más el código generado supera este límite, el modelo se detiene. Planifica tus tokens de entrada cuidadosamente para dejar espacio para la salida.

Funciones y límites

Una tabla con cada límite, función y precio.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
AutenticaciónAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
ID del modelouncensored
Base URLhttps://api.codingllmapi.com/v1
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Ventana de contexto100.000 tokens (entrada + salida)
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Modo JSONresponse_format: {"type": "json_object"}
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Concurrencia8 peticiones a la vez por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamaño de peticiónhasta 8 MB
Límite de peticiones300 por minuto por clave
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Bono+5 % desde $50, +10 % desde $100
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Caducidadel crédito pagado no caduca, sin suscripción
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores
AccesoGoogle o correo y contraseña

Códigos de error

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Es este modelo igual a GPT-4 o Claude?

No. Ofrecemos un único modelo de pesos abiertos sin censura en nuestros propios servidores GPU. Está optimizado para generación de código y no aplica filtros de contenido para temas adultos lícitos o controversiales, a diferencia de los modelos de propósito general. No es un proxy de OpenAI ni de Anthropic.

¿Cómo funciona la facturación?

Usamos un modelo de crédito prepago. Los tokens de entrada cuestan $0,25 por 1M; los de salida, $1,00 por 1M. Los créditos no caducan. Puedes recargar con criptomonedas (USDT o USDC), desde $10. Sin cuotas ni suscripciones mensuales.

¿Qué contenido está bloqueado?

El único límite estricto es el contenido sexual que involucre a menores. Todos los demás temas adultos lícitos, ficticios o controversiales están permitidos. No usamos prompts para entrenamiento. Tus datos permanecen privados para tu cuenta.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API