Pular para o conteúdo

Endpoints públicos

Retorna os modelos autorizados para o projeto da chave, com object: "list" e data[]. Cada modelo tem id, object, created e owned_by. O ID lógico usado no chat tem o formato nexvra/nome. Um modelo listado ainda pode estar temporariamente indisponível para inferência.

Requer JSON com model e messages. Cada mensagem usa role (system, user ou assistant) e content textual. Para receber JSON completo, omita stream ou use false. Para eventos SSE, use stream: true.

Campo Regra
model ID lógico autorizado, no formato nexvra/[a-z0-9-]+
messages Lista não vazia de mensagens de texto
temperature Número de 0 a 2, quando informado
top_p Número maior que 0 e até 1
max_tokens Inteiro positivo; limitado pelo modelo/projeto/deployment
max_completion_tokens Alternativa a max_tokens; não enviar ambos
n Somente 1
stop String ou lista de 1 a 4 strings
stream Booleano
stream_options Somente com streaming; include_usage obrigatório quando o objeto é informado

Campos omitidos usam a política/default aplicável. Campos desconhecidos ou null são recusados; não envie automaticamente todos os campos de um SDK genérico. O corpo tem limite de 1 MiB.

No modo JSON, o texto está em choices[0].message.content. finish_reason pode ser stop, length ou content_filter. O header x-nexvra-request-id identifica a requisição; guarde-o para diagnóstico sem registrar sua chave.

Uso desconhecido não deve ser interpretado como zero tokens. A resposta pode indicar ausência de uso conhecido conforme o contrato e o caminho de inferência.

Veja os schemas completos na referência interativa e baixe o OpenAPI.