Skip to content

Responses API

Compatible with OpenAI's next-generation Responses API. It's similar to chat completions, but responses are kept as a server-side object; you can create, fetch, cancel and list their inputs.

Create a response

POST/v1/responses
bash
curl https://app.qevron.ai/v1/responses \
  -H "Authorization: Bearer $QEVRON_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "verinova",
    "input": "Explain AI in three bullet points."
  }'
python
resp = client.responses.create(
    model="verinova",
    input="Explain AI in three bullet points.",
)
print(resp.id, resp.status)

Response

json
{
  "object": "response",
  "id": "resp_abc123",
  "status": "completed",
  "created_at": 1716200000,
  "usage": { "input_tokens": 12, "output_tokens": 64, "total_tokens": 76 }
}

status values: in_progress, completed, failed, cancelled.

Fetch a response

GET/v1/responses/{response_id}
bash
curl https://app.qevron.ai/v1/responses/resp_abc123 \
  -H "Authorization: Bearer $QEVRON_API_KEY"

Delete a response

DELETE/v1/responses/{response_id}

A successful delete returns 204 No Content.

Cancel a response

POST/v1/responses/{response_id}/cancel

Cancels an in-progress (in_progress) response.

List input items

GET/v1/responses/{response_id}/input_items

Returns the list of input items given to the response.

TIP

For simple text generation, Chat Completions is usually more practical. Prefer the Responses API for stateful, advanced workflows.

Qevron — AI gateway. Arpanet / OpenAI / Anthropic / Gemini compatible.