deepseek-v4-flash
AvailableDeepseek · Chat
Context window1M
Input / 1M$0.14
Cache / 1M$0.0028
Output / 1M$0.28
Call this model
from openai import OpenAI
client = OpenAI(
base_url="https://api.tokener.dev/v1",
api_key="sk-tk-••••••••••••",
)
response = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "Explain retrieval augmented generation."}],
)