Back to models

google/gemini-3-flash

llm Tools · Released Dec 18, 2025

Context length

Avg latency

~3021ms

Requests served

201

Success rate

98.5%

Quick start

Quick start
from openai import OpenAI

client = OpenAI(
    base_url="https://dev.alapi.deep.sa/v1",
    api_key="sk-alapi-...",
)

resp = client.chat.completions.create(
    model="google/gemini-3-flash",
    messages=[{"role": "user", "content": "مرحبا"}],
)

1 SAR = 10 requests · Any model, any size input/output

Activate account?

Activate this account?