Endpoints públicos
GET /v1/models
Seção intitulada “GET /v1/models”Retorna os modelos autorizados para o projeto da chave, com object: "list" e
data[]. Cada modelo tem id, object, created e owned_by.
O ID lógico usado no chat tem o formato nexvra/nome.
Um modelo listado ainda pode estar temporariamente indisponível para inferência.
POST /v1/chat/completions
Seção intitulada “POST /v1/chat/completions”Requer JSON com model e messages. Cada mensagem usa role (system, user
ou assistant) e content textual. Para receber JSON completo, omita stream
ou use false. Para eventos SSE, use stream: true.
| Campo | Regra |
|---|---|
model |
ID lógico autorizado, no formato nexvra/[a-z0-9-]+ |
messages |
Lista não vazia de mensagens de texto |
temperature |
Número de 0 a 2, quando informado |
top_p |
Número maior que 0 e até 1 |
max_tokens |
Inteiro positivo; limitado pelo modelo/projeto/deployment |
max_completion_tokens |
Alternativa a max_tokens; não enviar ambos |
n |
Somente 1 |
stop |
String ou lista de 1 a 4 strings |
stream |
Booleano |
stream_options |
Somente com streaming; include_usage obrigatório quando o objeto é informado |
Campos omitidos usam a política/default aplicável. Campos desconhecidos ou null
são recusados; não envie automaticamente todos os campos de um SDK genérico.
O corpo tem limite de 1 MiB.
Respostas e rastreabilidade
Seção intitulada “Respostas e rastreabilidade”No modo JSON, o texto está em choices[0].message.content. finish_reason
pode ser stop, length ou content_filter. O header x-nexvra-request-id
identifica a requisição; guarde-o para diagnóstico sem registrar sua chave.
Uso desconhecido não deve ser interpretado como zero tokens. A resposta pode indicar ausência de uso conhecido conforme o contrato e o caminho de inferência.
Veja os schemas completos na referência interativa e baixe o OpenAPI.