Back to models
Quick start
google/gemini-3-flash
llm
Tools
·
Released Dec 18, 2025
Context length
—
Avg latency
~3021ms
Requests served
201
Success rate
98.5%
Quick start
from openai import OpenAI
client = OpenAI(
base_url="https://dev.alapi.deep.sa/v1",
api_key="sk-alapi-...",
)
resp = client.chat.completions.create(
model="google/gemini-3-flash",
messages=[{"role": "user", "content": "مرحبا"}],
)
1 SAR = 10 requests · Any model, any size input/output