Skip to main content
POST
Chat Completions GPT
Product: Visual Intelligence — Image Model APIs (atomic) Use case: Call an Image Language Model (Gemini / GPT / Nova / Qwen) directly with your own prompt. Full control over model and parameters. Host: https://mavi-backend.memories.ai/serve/api/v2 Auth: Authorization: sk-mavi-... (no Bearer prefix)
This endpoint allows you to generate chat completions with image inputs using GPT ILM model.
Endpoint: POST https://mavi-backend.memories.ai/serve/api/v2/iu/chat/completionsImage Understanding (ILM) endpoints use the /iu path prefix. Video Understanding (VLM) endpoints use /vu instead.

Supported Models

All models require the gpt: prefix when used in the model parameter (e.g., gpt:gpt-4o).

GPT-5 Series (Latest)

O-Series (Reasoning Models)

GPT-4.1 Series

GPT-4o Series

GPT-4 Turbo

Pricing Notes:
  • All prices are per 1 million tokens
  • GPT-5 series offers the latest capabilities with improved performance
  • O-series models are optimized for complex reasoning tasks
  • GPT-4.1 and GPT-4o provide balanced performance and cost
  • Mini and Nano variants offer cost-effective alternatives
  • Remember to include the gpt: prefix: "model": "gpt:gpt-4o"

Request Body

Code Example

Response

Returns the chat completion response with JSON format.

Response Parameters

Authorizations

Authorization
string
header
required

Body

application/json
model
string
required

The model to use (e.g., gpt:gpt-4o)

Example:

"gpt:gpt-4o"

messages
object[]
required

Array of message objects

response_format
object

Force JSON output format

temperature
number
default:0

Controls randomness: 0.0-2.0, 0 = deterministic

Required range: 0 <= x <= 2
max_tokens
integer
default:1000

Maximum number of tokens to generate

top_p
number
default:1

Nucleus sampling: 0.0-1.0

Required range: 0 <= x <= 1
frequency_penalty
number
default:0

Reduces repetition of frequent tokens: -2.0 to 2.0

Required range: -2 <= x <= 2
presence_penalty
number
default:0

Increases likelihood of new topics: -2.0 to 2.0

Required range: -2 <= x <= 2
n
integer
default:1

Number of completions to generate

stream
boolean
default:false

Whether to stream the response

stop

Stop sequences

Response

200 - application/json

Chat completion response with JSON format

id
string
required
Example:

"chatcmpl-CsRhYgDaLSNjl80v5uYBufEDbJqAM"

object
string
required
Example:

"chat.completion"

created
integer
required
Example:

1767092232

model
string
required

The model used for the completion

Example:

"gpt-4o-2024-08-06"

choices
object[]
required
usage
object
required
service_tier
string

The service tier used for the request

Example:

"default"

system_fingerprint
string

System fingerprint for the model version

Example:

"fp_deacdd5f6f"