Back to models

llama-3.3-70b

Saudi-hosted
llm Tools · Released Dec 04, 2025

Context length

Avg latency

~398ms

Requests served

14,106

Success rate

98.4%

Request volume — last 30 days

Jul 29 — 8 Aug 19 — 11 Aug 20 — 65 Aug 23 — 40 Aug 24 — 10 Aug 25 — 8 Jul 29 Aug 25

Quick start

Quick start
from openai import OpenAI

client = OpenAI(
    base_url="https://dev.alapi.deep.sa/v1",
    api_key="sk-alapi-...",
)

resp = client.chat.completions.create(
    model="llama-3.3-70b",
    messages=[{"role": "user", "content": "مرحبا"}],
)

1 SAR = 10 requests · Any model, any size input/output

Activate account?

Activate this account?