Leve a DevHub para
onde você constrói.
Crie uma chave no console, escolha um modelo do catálogo e configure sua ferramenta. Estes exemplos usam https://api.seudominio.com; substitua pelo endereço da sua instalação. Para testar neste computador, use http://127.0.0.1:8000.
As três informações da conexão
| Campo | Valor de exemplo |
|---|---|
| Base URL · OpenAI | https://api.seudominio.com/v1 |
| API key | dh_SUA_CHAVE |
| Model ID | O ID exato mostrado no catálogo do console |
- Entre no console e abra Chaves de API. Crie uma chave com
inferenceemodels:read. - Copie e guarde a chave completa. Ela não é recuperável no servidor.
- Abra Playground. Escolha um modelo e faça uma chamada curta.
- Confira a resposta, o consumo e seu saldo antes de configurar uma ferramenta que executa muitas chamadas.
O modelo devhub-echo, quando habilitado, serve para testar a integração e retorna texto simulado. Para usar IA real, escolha um modelo de um provedor configurado no catálogo.
Cline
- Abra a extensão Cline no VS Code e clique nas configurações.
- Em API Provider, selecione OpenAI Compatible.
- Informe a Base URL terminada em
/v1e sua chavedh_.... - Preencha Model ID com o ID do catálogo DevHub.
- Se a extensão pedir janela de contexto e limite de saída, use valores suportados pelo modelo. Comece com uma tarefa pequena e confirme o consumo.
Ative recursos como imagens ou ferramentas somente para modelos que os suportem. Fluxos de agente dependem também do comportamento do modelo e da versão da extensão.
Referência: configuração oficial do Cline.
Continue
Na configuração YAML do Continue, adicione um modelo com provider: openai e sua URL em apiBase. O gateway expõe Chat Completions; configure useResponsesApi: false quando necessário.
name: DevHub AI
version: 1.0.0
schema: v1
models:
- name: Meu modelo DevHub
provider: openai
model: ID_DO_MODELO
apiBase: https://api.seudominio.com/v1
apiKey: dh_SUA_CHAVE
useResponsesApi: falseGuarde essa configuração em um arquivo local privado ou use o mecanismo de segredos da sua versão do Continue. Não envie a chave para um repositório.
Referência: provedores OpenAI compatíveis no Continue.
Cursor
- Em Settings → Models, procure as opções de chaves de API próprias.
- Se sua versão oferecer Override OpenAI Base URL, habilite e informe
https://api.seudominio.com/v1. - Configure a chave DevHub na conexão OpenAI e habilite seu uso.
- Selecione ou adicione um Model ID que corresponda exatamente ao catálogo do gateway.
- Teste um chat curto e confira se a requisição apareceu no histórico DevHub.
A disponibilidade de Base URL personalizada e os recursos que usam a chave dependem da versão e do plano do Cursor. Recursos próprios, modelos vinculados a outros protocolos e Tab Completion podem usar infraestrutura do Cursor. A conexão não substitui a assinatura da ferramenta nem garante suporte a todos os modelos ou recursos.
Referência: documentação oficial do Cursor. Consulte as opções de modelos e API Keys da versão instalada.
Claude Code
Claude Code usa o protocolo Anthropic. A DevHub expõe /v1/messages; configure a URL raiz, pois o cliente acrescenta /v1/messages. Não acrescente /v1 à variável abaixo.
PowerShell:
$env:ANTHROPIC_BASE_URL="https://api.seudominio.com" $env:ANTHROPIC_AUTH_TOKEN="dh_SUA_CHAVE" $env:ANTHROPIC_MODEL="ID_DO_MODELO" claude
macOS / Linux:
export ANTHROPIC_BASE_URL="https://api.seudominio.com" export ANTHROPIC_AUTH_TOKEN="dh_SUA_CHAVE" export ANTHROPIC_MODEL="ID_DO_MODELO" claude
A compatibilidade Anthropic desta instalação é experimental: inclui texto, streaming e tradução de ferramentas (tool use / tool result) para modelos que as suportem. O endpoint de contagem de tokens retorna uma estimativa local. Thinking, ferramentas nativas de servidor, documentos/PDFs e cache de prompt avançado não estão implementados. A configuração acima não equivale a uma certificação de funcionamento integral do agente. A Anthropic não oferece suporte ao uso do Claude Code com modelos não Claude.
Use uma chave específica para esse cliente e faça um teste completo de leitura, edição e execução em um projeto descartável antes de adotar em trabalho real.
Referência: guia oficial de gateways do Claude Code.
SDK OpenAI e HTTP
Use Chat Completions com a Base URL DevHub. Mantenha a chave no servidor ou em variáveis de ambiente de uma aplicação local.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["DEVHUB_API_KEY"],
base_url="https://api.seudominio.com/v1",
)
response = client.chat.completions.create(
model="ID_DO_MODELO",
messages=[{"role": "user", "content": "Olá"}],
max_tokens=512,
)
print(response.choices[0].message.content)Streaming:
stream = client.chat.completions.create(
model="ID_DO_MODELO",
messages=[{"role": "user", "content": "Olá"}],
max_tokens=512,
stream=True,
stream_options={"include_usage": True},
)
for chunk in stream:
if chunk.choices:
print(chunk.choices[0].delta.content or "", end="")cURL (macOS/Linux; troque curl por curl.exe no Windows e adapte a continuação de linhas ao seu terminal):
curl https://api.seudominio.com/v1/models \
-H "Authorization: Bearer $DEVHUB_API_KEY"
curl https://api.seudominio.com/v1/chat/completions \
-H "Authorization: Bearer $DEVHUB_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"ID_DO_MODELO","messages":[{"role":"user","content":"Olá"}],"max_tokens":512,"stream":true}'PowerShell, sem depender do escape de aspas do cURL:
$body = @{
model = "ID_DO_MODELO"
messages = @(@{ role = "user"; content = "Olá" })
max_tokens = 512
} | ConvertTo-Json -Depth 10
Invoke-RestMethod -Method Post `
-Uri "https://api.seudominio.com/v1/chat/completions" `
-Headers @{ Authorization = "Bearer $env:DEVHUB_API_KEY" } `
-ContentType "application/json" -Body $bodyO contrato desta versão inclui GET /v1/models e POST /v1/chat/completions. Não configure clientes que exigem /v1/responses, embeddings, imagens ou áudio sem uma implementação específica desses endpoints. Ferramentas e formatos de saída dependem do modelo e do adaptador configurado.
Saldo, limites e respostas de erro
Créditos não são tokens. O preço de entrada e saída varia por modelo e aparece no catálogo. Antes de executar, o gateway reserva saldo; quando o consumo é apurado, devolve a diferença. Se o provedor não informar consumo exato, o histórico identifica a estimativa.
| Código | O que verificar |
|---|---|
| 400 / 422 | Campos, conteúdo e parâmetros da chamada. |
| 401 / 403 | Chave válida, permissões e situação da conta. |
| 402 | Saldo disponível e limite de tokens solicitado. |
| 404 | URL do endpoint e Model ID do catálogo. |
| 429 | Limite de requisições; respeite o cabeçalho Retry-After. |
| 502 / 503 | Disponibilidade do serviço ou provedor. Aguarde e tente com intervalos progressivos. |
Guarde o X-Request-ID retornado para localizar a chamada no histórico. Interromper streaming pode gerar consumo pelos tokens já processados. Um modelo simulado não valida os recursos de um provedor real.
Boas práticas para suas chaves
- Use uma chave por projeto ou ferramenta e conceda só as permissões necessárias.
- Não coloque chaves em sites públicos, capturas de tela, logs ou repositórios.
- Rotacione uma chave exposta e atualize sua configuração. A chave antiga deixa de funcionar imediatamente.
- Use HTTPS no ambiente publicado e consulte o histórico quando houver dúvidas sobre consumo.
Recargas PIX
Use Créditos e PIX no console. Confira valor e recebedor no seu banco antes de pagar. Um pedido pendente pode ser retomado no histórico sem gerar uma nova cobrança. Os créditos entram somente após confirmação; se o pedido estiver em revisão, aguarde a verificação antes de fazer outro pagamento.