Guia de Início Rápido da API de Codificação IA
Conecte seu agente de codificação a um endpoint compatível com OpenAI e sem censura que lida com prompts pesados em código sem recusas desnecessárias de conteúdo. Este guia cobre autenticação, integração com SDK, streaming e limites de requisições para a API de codificação IA.
Configuração de Autenticação
Comece criando uma conta em Obter chave de API. Você só precisa de um e-mail e senha; nenhum cartão é necessário para começar. Ao se registrar, você recebe uma única chave de API imediatamente. Esta chave autentica todas as requisições para a URL base: https://api.codingllmapi.com/v1.
Mantenha sua chave segura. Você pode regenerá-la a qualquer momento no seu painel, o que invalida instantaneamente a chave anterior. O identificador do modelo a enviar em suas requisições é uncensored. Este é um modelo de pesos abertos executado em nossos próprios servidores, não um proxy para GPT, Claude ou Gemini.
Primeira Requisição
Envie uma solicitação de conclusão de chat padrão usando o formato compatível com OpenAI. A API aceita mensagens com um role (user/assistant/system) e content. Ela retorna texto otimizado para geração de código sem filtrar tópicos adultos legais ou controversos (exceto para menores).
- URL base:
https://api.codingllmapi.com/v1 - Endpoint:
POST /v1/chat/completions - Modelo:
uncensored
curl https://api.codingllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integração com SDK Python
Use o SDK Python oficial da OpenAI. Aponte o client para nossa URL base e forneça sua chave de API. O SDK trata o formato da requisição automaticamente. Esta abordagem funciona para geração de texto simples ou para construir loops de agentes mais complexos.
Certifique-se de estar usando uma versão recente do pacote openai. O cliente tratará a serialização JSON e os cabeçalhos HTTP corretamente para nosso endpoint.
from openai import OpenAI
client = OpenAI(base_url="https://api.codingllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integração com SDK Node.js
Use o pacote Node.js oficial openai, não os SDKs específicos da Anthropic ou Google. Configure a URL base para apontar para nosso serviço. Isso garante compatibilidade com a estrutura de requisição compatível com OpenAI que servimos.
Instale o pacote via npm install openai. Inicialize o cliente com sua chave e a URL base personalizada. Este método é confiável para agentes de codificação no lado do servidor que precisam gerar trechos de código ou analisar repositórios.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.codingllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respostas de Código em Streaming
Para feedback em tempo real, ative o streaming definindo stream: true. A API retorna Server-Sent Events (SSE). Cada chunk contém saídas parciais de token, permitindo que seu agente exiba o código conforme é gerado. Isso reduz a latência percebida para blocos longos de código.
Manipule os eventos do stream para acumular a resposta final. O modelo continua gerando até atingir o limite da janela de contexto ou o parâmetro max_tokens.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites e Erros
Observe esses limites para evitar interrupções. Você tem 300 requisições por minuto por chave. O tamanho máximo do corpo da requisição é 8 MB. Se você exceder o limite de requisições, receberá um erro 429. Se seu crédito pré-pago acabar, você receberá um erro 402. Uma chave inválida ou revogada retorna 401.
A janela de contexto é de 100.000 tokens no total (prompt + completion). Se seu prompt mais o código gerado exceder isso, o modelo para. Planeje seus tokens de entrada cuidadosamente para deixar espaço para a saída.
Recursos e limites
Uma tabela com cada limite, recurso e preço.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID do modelo | uncensored |
| Base URL | https://api.codingllmapi.com/v1 |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modo JSON | response_format: {"type": "json_object"} |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tamanho | até 8 MB por requisição |
| Limite de taxa | 300 requisições por minuto por chave |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Validade | crédito pago não expira, sem assinatura |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Login | Google ou e-mail e senha |
Códigos de erro
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Este modelo é igual ao GPT-4 ou Claude?
Não. Oferecemos um único modelo de pesos abertos sem censura em nossos próprios servidores GPU. Ele é ajustado para geração de código e não usa filtros de conteúdo para tópicos adultos lícitos ou controversos, ao contrário dos modelos de propósito geral. Não é um proxy para OpenAI ou Anthropic.
Como funciona o preço?
Usamos um modelo de crédito pré-pago. Tokens de entrada custam $0,25 por 1M; tokens de saída custam $1,00 por 1M. Créditos nunca expiram. Você pode recarregar com criptomoedas (USDT ou USDC), a partir de $10. Sem taxas mensais ou assinaturas.
Qual conteúdo é bloqueado?
A única restrição rígida é conteúdo sexual envolvendo menores. Todos os outros tópicos adultos lícitos, fictícios ou controversos são permitidos. Não usamos prompts para treinamento. Seus dados permanecem privados para sua conta.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.
Obter chave de API