Back to models

llama-4-maverick-17b

Saudi-hosted
llm Tools · Released Dec 17, 2025

Context length

Avg latency

~214ms

Requests served

165

Success rate

17.6%

Quick start

Quick start
from openai import OpenAI

client = OpenAI(
    base_url="https://dev.alapi.deep.sa/v1",
    api_key="sk-alapi-...",
)

resp = client.chat.completions.create(
    model="llama-4-maverick-17b",
    messages=[{"role": "user", "content": "مرحبا"}],
)

1 SAR = 10 requests · Any model, any size input/output

Activate account?

Activate this account?