Texto e streaming
Resposta completa ou eventos incrementais com stream: true.
Um endpoint compatível com o formato da OpenAI, usando a mesma conta e o mesmo controle de uso do ecossistema Cortex.
Ao criar uma conta ou entrar pela primeira vez, o Cortex emite uma chave pessoal no formato sk-…. Você não precisa inventar uma chave manualmente.
curl https://cortex.gehost.com.br/v1/chat/completions \
-H "Authorization: Bearer $CORTEX_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "Cortex",
"messages": [{"role": "user", "content": "Explique este projeto em uma frase."}],
"reasoning_effort": "medium",
"stream": false
}'import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["CORTEX_API_KEY"],
base_url="https://cortex.gehost.com.br/v1",
)
response = client.chat.completions.create(
model="Cortex",
messages=[{"role": "user", "content": "Olá, Cortex!"}],
)
print(response.choices[0].message.content)/v1/modelsLista os modelos que esta credencial pode usar.
/v1/chat/completionsGera respostas de texto, com streaming, raciocínio e ferramentas no formato compatível.
Use sempre o que /v1/models devolver. O catálogo pode mudar conforme disponibilidade, plano e capacidades da conta.
Resposta completa ou eventos incrementais com stream: true.
reasoning_effort: off, low, medium, high ou xhigh, quando o modelo oferecer.
tools e tool_choice seguem o formato de chat compatível.
Envie o histórico necessário em messages; seu projeto não é anexado automaticamente.
Chamadas feitas por projeto, editor ou automação entram no contador de uso externo. A conta pode ter uma franquia diária; depois dela, o Cortex exige créditos e cobra conforme os tokens do modelo. Se não houver saldo, a API responde 402 antes de iniciar uma nova geração.
Consulte os valores e seu saldo em Minha conta → Uso. Administradores seguem a política administrativa da conta.