Back to models
Saudi-hosted
Quick start
llama-3.3-70b
Saudi-hosted
llm
Tools
·
Released Dec 04, 2025
Context length
—
Avg latency
~398ms
Requests served
14,106
Success rate
98.4%
Request volume — last 30 days
Quick start
from openai import OpenAI
client = OpenAI(
base_url="https://dev.alapi.deep.sa/v1",
api_key="sk-alapi-...",
)
resp = client.chat.completions.create(
model="llama-3.3-70b",
messages=[{"role": "user", "content": "مرحبا"}],
)
1 SAR = 10 requests · Any model, any size input/output