Invision · LLM API

Um endpoint para todos os modelos.

Compatível com o SDK da OpenAI. Você aponta a baseURL para a Invision, escolhe o modelo e paga só pelos tokens que usar.

URL base · compatível com OpenAIhttps://invision.dreamvision.com.br/v1
Início rápido

Primeira resposta em três minutos.

Copie, cole a sua chave e rode. O mesmo formato de resposta que você já conhece.

curl https://invision.dreamvision.com.br/v1/chat/completions \
  -H "Authorization: Bearer $DRVN_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-6-astra",
    "messages": [
      { "role": "user", "content": "Resuma este texto em 3 linhas." }
    ]
  }'
Como funciona

Feito para trocar de modelo sem medo.

Compatível com o SDK da OpenAI

Troque a baseURL e a chave. O resto do seu código continua igual, incluindo streaming e tool calling.

Um endpoint, todos os modelos

Mudar de GPT-5 para Claude ou Gemini é mudar o campo model. Sem novo contrato, sem nova integração.

Crédito que você controla

Recarrega por Pix, consome por token. Sem mensalidade, sem fidelidade e sem cobrança surpresa.

Cobrança transparente

Cada requisição registra tokens de entrada, de saída e o custo em reais no seu histórico.

Limites e latência

Números que a gente sustenta.

Requisições por minuto

600

Por chave. Ajustável sob demanda.

Tokens por minuto

1,2M

Somando entrada e saída.

Timeout padrão

120s

Streaming mantém a conexão aberta.

Latência do 1º token

≈ 0,6s

Medida nos modelos rápidos.