Model benchmarks

Choose the right QFOXAI model for each job

Use branded model aliases for production integrations. Choose a lighter model for everyday automation, a balanced model for general chat, or an advanced QFOXAI route for deeper reasoning while private provider names stay internal.

Current routing mode: BALANCED. Benchmarks use recent platform telemetry where available and public branded model aliases only.
Default Chat API All users

QFOXLITE

LITE

Best for: Fast replies, support drafts, routing, and high-volume automation.

Latency34,418 ms avg
Cost$0.001 / 1K mixed tokens
30D Calls33
30D Tokens130,136
Chat API All users

QFOXAI

Branded QFOXAI model for chat and OpenAI-compatible API usage.

Best for: Balanced chat, API, business writing, summaries, and internal tools.

Latency25,090 ms avg
Cost$0.002 / 1K mixed tokens
30D Calls2,081
30D Tokens3,169,334
Chat API Subscribed users

QFOXPRO

Premium QFOXAI model alias for deeper reasoning, longer answers, and higher-value API usage.

Best for: Complex reasoning, stronger writing, coding, analysis, and premium workflows.

Latency38,531 ms avg
Cost$0.009 / 1K mixed tokens
30D Calls4
30D Tokens14,336