All models

deepseek-v4-flash

Deepseek · Reasoning

Available
Context window
1M
Input / 1M
$0.44
Cache / 1M
$0.014
Output / 1M
$1.32

Call this model

request.py
from openai import OpenAI

client = OpenAI(
    base_url="https://api.tokener.ai/v1",
    api_key="sk-tk-••••••••••••",
)

response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[{"role": "user", "content": "Explain retrieval augmented generation."}],
)