Back to models
Saudi-hosted
Quick start
llama-4-maverick-17b
Saudi-hosted
llm
Tools
·
Released Dec 17, 2025
Context length
—
Avg latency
~214ms
Requests served
165
Success rate
17.6%
Quick start
from openai import OpenAI
client = OpenAI(
base_url="https://dev.alapi.deep.sa/v1",
api_key="sk-alapi-...",
)
resp = client.chat.completions.create(
model="llama-4-maverick-17b",
messages=[{"role": "user", "content": "مرحبا"}],
)
1 SAR = 10 requests · Any model, any size input/output