Flat per request. Tokens free.
Pay ONLY per request — input & output tokens are FREE no matter how many for models marked FREE below. Prices are in GeraiPoints (GP), 1 GP = Rp1, top up in the dashboard, balance never expires.
There are two tiers, one shared balance: Standard is billed flat per request (cheap for short requests), Premium is billed per token with genuine models straight from the official providers (Anthropic, OpenAI).
| Model | Input /1M | Output /1M |
|---|---|---|
| Claude Opus 5claude-opus-5 Supports images1.000K contextFlat 100 GP / request | ||
| Claude Opus 4.8claude-opus-4-8 Supports images1.000K contextFlat 80 GP / request | ||
| Claude Opus 4.6claude-opus-4-6 Supports images1.000K contextFlat 50 GP / request | ||
| Claude Opus 4.7claude-opus-4-7 Supports images1.000K contextFlat 70 GP / request | ||
| Claude Sonnet 5claude-sonnet-5 Supports images1.000K contextFlat 50 GP / request | ||
| Claude Sonnet 4.6claude-sonnet-4-6 Supports images1.000K contextFlat 40 GP / request | ||
| Claude Haiku 4.5claude-haiku-4-5 Supports images200K contextFlat 30 GP / request | ||
| Claude Fable 5claude-fable-5 Supports images1.000K contextFlat 110 GP / request | ||
| DeepSeek V4 Prodeepseek-v4-pro Text only512K contextFlat 25 GP / request | ||
| DeepSeek V4 Flashdeepseek-v4-flash Text only512K contextFlat 10 GP / request | ||
| Claude Opus 5 Thinkingclaude-opus-5-thinking Supports images1.000K contextFlat 100 GP / request | ||
| Claude Sonnet 5 Thinkingclaude-sonnet-5-thinking Supports images1.000K contextFlat 100 GP / request | ||
| GLM-5.1glm-5.1 Text only200K contextFlat 30 GP / request | ||
| GLM-5 Turboglm-5-turbo Text only200K contextFlat 30 GP / request | ||
| GLM 5.3glm-5.3 Text only1.000K contextFlat 60 GP / request | ||
| GLM 5.2glm-5.2 Text only1.000K contextFlat 30 GP / request | ||
| GPT 5.4gpt-5.4 Supports images512K contextFlat 50 GP / request | ||
| GPT 5.5gpt-5.5 Text only512K contextFlat 180 GP / request | ||
| GPT 5.5-xhighgpt-5.5-xhigh Text only512K contextFlat 60 GP / request | ||
| GPT 5.6 Lunagpt-5.6-luna Supports images512K contextFlat 50 GP / request | ||
| GPT 5.6 Solgpt-5.6-sol Supports images512K contextFlat 80 GP / request | ||
| GPT 5.6 Terragpt-5.6-terra Supports images512K contextFlat 30 GP / request | ||
| Qwen3 Maxqwen-max Text only1.000K contextFlat 40 GP / request | ||
| Qwen3 Plusqwen-plus Text only1.000K context | 1.200 | 6.200 |
| Qwen3 Flashqwen-flash Text only1.000K context | 800 | 1.500 |
| Qwen3 Coder Plusqwen-coder-plus Text only1.000K context | 1.200 | 6.200 |
| Kimi K2.7 Codekimi-k2.7-code Text only256K context | 1.500 | 7.000 |
| Kimi K3kimi-k3 Text only256K contextFlat 50 GP / request |
Models marked FREE are billed flat per request: input, output, and cache rates count as zero, and your bill = the number on the Flat N GP / request chip. Models without the mark stay metered per token as usual. Click a row for model details, a cost estimator, and call examples.
Need genuine models straight from the official providers with per-token billing? See the Premium API tab — it uses the same GeraiPoints balance.