D↗DevHub AIDOCUMENTAÇÃO
ConsoleReferência da API ↗
DA CONFIGURAÇÃO À PRIMEIRA RESPOSTA

Leve a DevHub para
onde você constrói.

Crie uma chave no console, escolha um modelo do catálogo e configure sua ferramenta. Estes exemplos usam https://api.seudominio.com; substitua pelo endereço da sua instalação. Para testar neste computador, use http://127.0.0.1:8000.

As três informações da conexão

CampoValor de exemplo
Base URL · OpenAIhttps://api.seudominio.com/v1
API keydh_SUA_CHAVE
Model IDO ID exato mostrado no catálogo do console
  1. Entre no console e abra Chaves de API. Crie uma chave com inference e models:read.
  2. Copie e guarde a chave completa. Ela não é recuperável no servidor.
  3. Abra Playground. Escolha um modelo e faça uma chamada curta.
  4. Confira a resposta, o consumo e seu saldo antes de configurar uma ferramenta que executa muitas chamadas.

O modelo devhub-echo, quando habilitado, serve para testar a integração e retorna texto simulado. Para usar IA real, escolha um modelo de um provedor configurado no catálogo.

VISUAL STUDIO CODE

Cline

  1. Abra a extensão Cline no VS Code e clique nas configurações.
  2. Em API Provider, selecione OpenAI Compatible.
  3. Informe a Base URL terminada em /v1 e sua chave dh_....
  4. Preencha Model ID com o ID do catálogo DevHub.
  5. Se a extensão pedir janela de contexto e limite de saída, use valores suportados pelo modelo. Comece com uma tarefa pequena e confirme o consumo.

Ative recursos como imagens ou ferramentas somente para modelos que os suportem. Fluxos de agente dependem também do comportamento do modelo e da versão da extensão.

VISUAL STUDIO CODE

Continue

Na configuração YAML do Continue, adicione um modelo com provider: openai e sua URL em apiBase. O gateway expõe Chat Completions; configure useResponsesApi: false quando necessário.

name: DevHub AI
version: 1.0.0
schema: v1
models:
  - name: Meu modelo DevHub
    provider: openai
    model: ID_DO_MODELO
    apiBase: https://api.seudominio.com/v1
    apiKey: dh_SUA_CHAVE
    useResponsesApi: false

Guarde essa configuração em um arquivo local privado ou use o mecanismo de segredos da sua versão do Continue. Não envie a chave para um repositório.

EDITOR

Cursor

  1. Em Settings → Models, procure as opções de chaves de API próprias.
  2. Se sua versão oferecer Override OpenAI Base URL, habilite e informe https://api.seudominio.com/v1.
  3. Configure a chave DevHub na conexão OpenAI e habilite seu uso.
  4. Selecione ou adicione um Model ID que corresponda exatamente ao catálogo do gateway.
  5. Teste um chat curto e confira se a requisição apareceu no histórico DevHub.

A disponibilidade de Base URL personalizada e os recursos que usam a chave dependem da versão e do plano do Cursor. Recursos próprios, modelos vinculados a outros protocolos e Tab Completion podem usar infraestrutura do Cursor. A conexão não substitui a assinatura da ferramenta nem garante suporte a todos os modelos ou recursos.

TERMINAL · COMPATIBILIDADE EXPERIMENTAL

Claude Code

Claude Code usa o protocolo Anthropic. A DevHub expõe /v1/messages; configure a URL raiz, pois o cliente acrescenta /v1/messages. Não acrescente /v1 à variável abaixo.

PowerShell:

$env:ANTHROPIC_BASE_URL="https://api.seudominio.com"
$env:ANTHROPIC_AUTH_TOKEN="dh_SUA_CHAVE"
$env:ANTHROPIC_MODEL="ID_DO_MODELO"
claude

macOS / Linux:

export ANTHROPIC_BASE_URL="https://api.seudominio.com"
export ANTHROPIC_AUTH_TOKEN="dh_SUA_CHAVE"
export ANTHROPIC_MODEL="ID_DO_MODELO"
claude

A compatibilidade Anthropic desta instalação é experimental: inclui texto, streaming e tradução de ferramentas (tool use / tool result) para modelos que as suportem. O endpoint de contagem de tokens retorna uma estimativa local. Thinking, ferramentas nativas de servidor, documentos/PDFs e cache de prompt avançado não estão implementados. A configuração acima não equivale a uma certificação de funcionamento integral do agente. A Anthropic não oferece suporte ao uso do Claude Code com modelos não Claude.

Use uma chave específica para esse cliente e faça um teste completo de leitura, edição e execução em um projeto descartável antes de adotar em trabalho real.

SEU APLICATIVO

SDK OpenAI e HTTP

Use Chat Completions com a Base URL DevHub. Mantenha a chave no servidor ou em variáveis de ambiente de uma aplicação local.

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["DEVHUB_API_KEY"],
    base_url="https://api.seudominio.com/v1",
)
response = client.chat.completions.create(
    model="ID_DO_MODELO",
    messages=[{"role": "user", "content": "Olá"}],
    max_tokens=512,
)
print(response.choices[0].message.content)

Streaming:

stream = client.chat.completions.create(
    model="ID_DO_MODELO",
    messages=[{"role": "user", "content": "Olá"}],
    max_tokens=512,
    stream=True,
    stream_options={"include_usage": True},
)
for chunk in stream:
    if chunk.choices:
        print(chunk.choices[0].delta.content or "", end="")

cURL (macOS/Linux; troque curl por curl.exe no Windows e adapte a continuação de linhas ao seu terminal):

curl https://api.seudominio.com/v1/models \
  -H "Authorization: Bearer $DEVHUB_API_KEY"

curl https://api.seudominio.com/v1/chat/completions \
  -H "Authorization: Bearer $DEVHUB_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"ID_DO_MODELO","messages":[{"role":"user","content":"Olá"}],"max_tokens":512,"stream":true}'

PowerShell, sem depender do escape de aspas do cURL:

$body = @{
  model = "ID_DO_MODELO"
  messages = @(@{ role = "user"; content = "Olá" })
  max_tokens = 512
} | ConvertTo-Json -Depth 10

Invoke-RestMethod -Method Post `
  -Uri "https://api.seudominio.com/v1/chat/completions" `
  -Headers @{ Authorization = "Bearer $env:DEVHUB_API_KEY" } `
  -ContentType "application/json" -Body $body

O contrato desta versão inclui GET /v1/models e POST /v1/chat/completions. Não configure clientes que exigem /v1/responses, embeddings, imagens ou áudio sem uma implementação específica desses endpoints. Ferramentas e formatos de saída dependem do modelo e do adaptador configurado.

Abrir a referência dos endpoints ↗
CONTROLE DE USO

Saldo, limites e respostas de erro

Créditos não são tokens. O preço de entrada e saída varia por modelo e aparece no catálogo. Antes de executar, o gateway reserva saldo; quando o consumo é apurado, devolve a diferença. Se o provedor não informar consumo exato, o histórico identifica a estimativa.

CódigoO que verificar
400 / 422Campos, conteúdo e parâmetros da chamada.
401 / 403Chave válida, permissões e situação da conta.
402Saldo disponível e limite de tokens solicitado.
404URL do endpoint e Model ID do catálogo.
429Limite de requisições; respeite o cabeçalho Retry-After.
502 / 503Disponibilidade do serviço ou provedor. Aguarde e tente com intervalos progressivos.

Guarde o X-Request-ID retornado para localizar a chamada no histórico. Interromper streaming pode gerar consumo pelos tokens já processados. Um modelo simulado não valida os recursos de um provedor real.

Boas práticas para suas chaves

Recargas PIX

Use Créditos e PIX no console. Confira valor e recebedor no seu banco antes de pagar. Um pedido pendente pode ser retomado no histórico sem gerar uma nova cobrança. Os créditos entram somente após confirmação; se o pedido estiver em revisão, aguarde a verificação antes de fazer outro pagamento.