ONE ENDPOINT · LIVE SCOREBOARD · YOUR KEYS

One endpoint.
Live provider scoreboard.
Bring your own keys.

Call Llama, DeepSeek, GPT-OSS, Kimi, and more through a single OpenAI-compatible endpoint. Tesseract routes every request to the fastest and cheapest provider — across the accounts you already pay for. You bring the keys; we bring the routing intelligence.

Get your API key
$39/month for the tool. You pay your providers directly.
LLAMA 3.1 70B · LIVE ROUTINGOUR KEYSPROVIDERTTFT$/1MBADGEGROQmanaged89ms0.87FASTESTTOGETHER AImanaged142ms0.41CHEAPESTFIREWORKSmanaged165ms0.60SAME PROMPT · EVERY PROVIDER · RANKED LIVE24H TREND▼ 12ms7D▼ $0.04
CAPABILITIES

The routing intelligence behind one endpoint

01 / ENDPOINT

One OpenAI-compatible endpoint

Point your existing OpenAI client at Tesseract, pick a model, and go. It routes across every provider you have a key for — no per-provider client to maintain.

02 / KEYS

Bring your own provider keys

Add an API key for Together AI, Groq, Fireworks, Baseten, or OpenRouter. Keys are encrypted at rest, verified with a live test call, and only the last four are ever shown.

03 / SCOREBOARD

A live provider scoreboard

Tesseract benchmarks the same prompt across your connected providers and tracks which is fastest and cheapest per model — the data that powers routing.

04 / ROUTING

Routing on real data

Every request is sent to the best provider under your objective — lowest latency, highest throughput, or lowest cost — using the scoreboard, not a guess.

05 / PLAYGROUND

Test before you integrate

Try any catalog model in the browser playground before you write a line of integration code.

06 / ALERTS

Know when the leaderboard moves

Get notified when a provider degrades or a cheaper one appears for a model you care about.

HOW IT WORKS

Bring your keys. Point your client. Ship.

01

Connect your provider keys

Add an API key for each provider you already pay for. Tesseract encrypts it, verifies it with a live test call, and you only ever see the last four characters.

02

Point your client at Tesseract

The endpoint is OpenAI-compatible: swap the base URL, pick any catalog model, and your requests route through your own provider keys to the fastest, cheapest backend.

03

Watch the scoreboard, ship with confidence

Tesseract benchmarks every provider live and routes each request on the result. You pay your providers directly — Tesseract is the $39/mo routing layer on top.

benchmark_results.json
{
  "model": "gpt-oss-120b",
  "prompt": "Explain gravity in one sentence.",
  "results": [
    {"provider": "Groq",
     "ttft_ms": 89,
     "tokens_per_sec": 480,
     "cost_per_m": 0.60,
     "badges": ["Fastest"]},\n    {"provider": "OpenRouter",
     "ttft_ms": 145,
     "tokens_per_sec": 190,
     "cost_per_m": 0.17,
     "badges": ["Cheapest"]},\n  ]
}
Model latency comparison · sample SAMPLE
MODEL · PROVIDERTTFT · USD / 1M TOKENS
GPT-OSS 120B · Groq89ms 0.60/MFASTEST
DeepSeek V4 Flash · Fireworks118ms 0.28/MCHEAPEST
Llama 3.3 70B · Together AI152ms 1.04/M
Kimi K3 · Baseten198ms 15.00/M
AVAILABLE MODELS

One catalog, every serving backend you bring.

Tesseract exposes Llama, DeepSeek, GPT-OSS, Kimi, and Qwen through one OpenAI-compatible endpoint. Connect a key for any provider that serves a model and Tesseract routes to it on your key — benchmarking the same prompt across every backend you have access to. The catalog refreshes nightly from each provider's live model list.

CATALOGUE LAST UPDATED 9h ago · SERVED BY 5/5 PROVIDERS

Llama 3.2 1b Instruct

Llama · 1B
CONTEXT
131K
IN / 1M
$0.06
OUT / 1M
$0.06
SERVING PROVIDERS
Together AI$0.06 IN / $0.06 OUT
OpenRouter$0.03 IN / $0.20 OUT

Llama 3.2 3b Instruct

Llama · 3B
CONTEXT
131K
IN / 1M
$0.06
OUT / 1M
$0.06
SERVING PROVIDERS
Together AI$0.06 IN / $0.06 OUT
OpenRouter$0.05 IN / $0.33 OUT

Llama 3.1 8B

Llama · 8B
CONTEXT
131K
IN / 1M
$0.05
OUT / 1M
$0.08
SERVING PROVIDERS
OpenRouter$0.05 IN / $0.08 OUT

Mistral Small 24b Instruct 2501

Mistral · 24B
CONTEXT
33K
IN / 1M
$0.05
OUT / 1M
$0.08
SERVING PROVIDERS
Together AI$0.10 IN / $0.30 OUT
OpenRouter$0.05 IN / $0.08 OUT

Gemma 3 4b It

Google · 4B
CONTEXT
131K
IN / 1M
$0.05
OUT / 1M
$0.10
SERVING PROVIDERS
Together AIPRICE NOT PUBLISHED
OpenRouter$0.05 IN / $0.10 OUT

GPT-OSS 20B

OpenAI · 20B
CONTEXT
131K
IN / 1M
$0.03
OUT / 1M
$0.13
SERVING PROVIDERS
Groq$0.07 IN / $0.30 OUT
Together AI$0.05 IN / $0.20 OUT
Fireworks AI$0.07 IN / $0.30 OUT
OpenRouter$0.03 IN / $0.13 OUT

Qwen3.5 9B

Qwen · 9B
CONTEXT
262K
IN / 1M
$0.10
OUT / 1M
$0.15
SERVING PROVIDERS
Together AI$0.17 IN / $0.25 OUT
OpenRouter$0.10 IN / $0.15 OUT

GPT-OSS 120B

OpenAI · 120B
CONTEXT
131K
IN / 1M
$0.04
OUT / 1M
$0.17
SERVING PROVIDERS
Groq$0.15 IN / $0.60 OUT
Baseten$0.10 IN / $0.50 OUT
Together AI$0.15 IN / $0.60 OUT
Fireworks AI$0.15 IN / $0.60 OUT
OpenRouter$0.04 IN / $0.17 OUT

DeepSeek V4 Flash

DeepSeek · 671B
CONTEXT
1.3M
IN / 1M
$0.07
OUT / 1M
$0.18
SERVING PROVIDERS
Baseten$0.13 IN / $0.26 OUT
Together AI$0.14 IN / $0.28 OUT
Fireworks AI$0.14 IN / $0.28 OUT
OpenRouter$0.07 IN / $0.18 OUT

Qwen3 14b

Qwen · 14B
CONTEXT
131K
IN / 1M
$0.12
OUT / 1M
$0.24
SERVING PROVIDERS
Together AIPRICE NOT PUBLISHED
OpenRouter$0.12 IN / $0.24 OUT

Qwen3 Coder 30b A3b Instruct

Qwen · 30B
CONTEXT
262K
IN / 1M
$0.07
OUT / 1M
$0.28
SERVING PROVIDERS
Together AIPRICE NOT PUBLISHED
OpenRouter$0.07 IN / $0.28 OUT

Qwen3 32b

Qwen · 32B
CONTEXT
131K
IN / 1M
$0.08
OUT / 1M
$0.28
SERVING PROVIDERS
Together AIPRICE NOT PUBLISHED
OpenRouter$0.08 IN / $0.28 OUT

Gpt Oss Safeguard 20b

OpenAI · 20B
CONTEXT
131K
IN / 1M
$0.07
OUT / 1M
$0.30
SERVING PROVIDERS
GroqPRICE NOT PUBLISHED
OpenRouter$0.07 IN / $0.30 OUT

Llama 3.3 70B

Llama · 70B
CONTEXT
131K
IN / 1M
$0.10
OUT / 1M
$0.32
SERVING PROVIDERS
Together AI$1.04 IN / $1.04 OUT
OpenRouter$0.10 IN / $0.32 OUT

Gemma 4 26b A4b It

Google · 26B
CONTEXT
262K
IN / 1M
$0.07
OUT / 1M
$0.34
SERVING PROVIDERS
Together AIPRICE NOT PUBLISHED
OpenRouter$0.07 IN / $0.34 OUT

Gemma 4 31b It

Google · 31B
CONTEXT
262K
IN / 1M
$0.09
OUT / 1M
$0.34
SERVING PROVIDERS
Together AI$0.39 IN / $0.97 OUT
OpenRouter$0.09 IN / $0.34 OUT

Qwen 2.5 72B

Qwen · 72B
CONTEXT
33K
IN / 1M
$0.36
OUT / 1M
$0.40
SERVING PROVIDERS
OpenRouter$0.36 IN / $0.40 OUT

Llama 3.1 70B

Llama · 70B
CONTEXT
131K
IN / 1M
$0.40
OUT / 1M
$0.40
SERVING PROVIDERS
OpenRouter$0.40 IN / $0.40 OUT

Qwen3 Vl 32b Instruct

Qwen · 32B
CONTEXT
262K
IN / 1M
$0.10
OUT / 1M
$0.42
SERVING PROVIDERS
Together AI$0.50 IN / $1.50 OUT
OpenRouter$0.10 IN / $0.42 OUT

Gemma 3 27b It

Google · 27B
CONTEXT
131K
IN / 1M
$0.08
OUT / 1M
$0.45
SERVING PROVIDERS
Together AIPRICE NOT PUBLISHED
OpenRouter$0.08 IN / $0.45 OUT

Qwen3 Vl 8b Instruct

Qwen · 8B
CONTEXT
262K
IN / 1M
$0.12
OUT / 1M
$0.46
SERVING PROVIDERS
Together AI$0.18 IN / $0.68 OUT
OpenRouter$0.12 IN / $0.46 OUT

Qwen3 8b

Qwen · 8B
CONTEXT
131K
IN / 1M
$0.12
OUT / 1M
$0.46
SERVING PROVIDERS
Together AIPRICE NOT PUBLISHED
OpenRouter$0.12 IN / $0.46 OUT

Qwen3.8 Flash

Qwen ·
CONTEXT
1M
IN / 1M
$0.15
OUT / 1M
$0.47
SERVING PROVIDERS
Together AI$0.15 IN / $0.47 OUT
OpenRouter$0.15 IN / $0.47 OUT

Qwen3 30b A3b

Qwen · 30B
CONTEXT
131K
IN / 1M
$0.12
OUT / 1M
$0.50
SERVING PROVIDERS
Together AIPRICE NOT PUBLISHED
OpenRouter$0.12 IN / $0.50 OUT

Gemma 2 27b It

Google · 27B
CONTEXT
8K
IN / 1M
$0.65
OUT / 1M
$0.65
SERVING PROVIDERS
Together AI$0.80 IN / $0.80 OUT
OpenRouter$0.65 IN / $0.65 OUT

DeepSeek V3

DeepSeek · 671B
CONTEXT
164K
IN / 1M
$0.32
OUT / 1M
$0.89
SERVING PROVIDERS
OpenRouter$0.32 IN / $0.89 OUT

Qwen2.5 Vl 72b Instruct

Qwen · 72B
CONTEXT
128K
IN / 1M
$0.80
OUT / 1M
$1.00
SERVING PROVIDERS
Together AI$1.95 IN / $8.00 OUT
OpenRouter$0.80 IN / $1.00 OUT

Qwen3 Next 80b A3b Instruct

Qwen · 80B
CONTEXT
262K
IN / 1M
$0.10
OUT / 1M
$1.10
SERVING PROVIDERS
Together AI$0.15 IN / $1.50 OUT
OpenRouter$0.10 IN / $1.10 OUT

Inkling Small

Inkling ·
CONTEXT
1.0M
IN / 1M
$0.50
OUT / 1M
$1.20
SERVING PROVIDERS
Together AI$0.50 IN / $1.20 OUT
OpenRouter$0.45 IN / $1.20 OUT

Qwen3 Next 80b A3b Thinking

Qwen · 80B
CONTEXT
262K
IN / 1M
$0.15
OUT / 1M
$1.20
SERVING PROVIDERS
Together AI$0.15 IN / $1.50 OUT
OpenRouter$0.15 IN / $1.20 OUT

Qwen3.5 35b A3b

Qwen · 35B
CONTEXT
262K
IN / 1M
$0.31
OUT / 1M
$1.25
SERVING PROVIDERS
Together AIPRICE NOT PUBLISHED
OpenRouter$0.31 IN / $1.25 OUT

Qwen3.7 Plus

Qwen ·
CONTEXT
1M
IN / 1M
$0.32
OUT / 1M
$1.28
SERVING PROVIDERS
Together AI$0.32 IN / $1.28 OUT
OpenRouter$0.32 IN / $1.28 OUT

Qwen3.6 Plus

Qwen ·
CONTEXT
1M
IN / 1M
$0.33
OUT / 1M
$1.95
SERVING PROVIDERS
Together AI$0.50 IN / $3.00 OUT
OpenRouter$0.33 IN / $1.95 OUT

Qwen3.6 27b

Qwen · 27B
CONTEXT
262K
IN / 1M
$0.30
OUT / 1M
$2.00
SERVING PROVIDERS
GroqPRICE NOT PUBLISHED
OpenRouter$0.30 IN / $2.00 OUT

Qwen3.8 27b

Qwen · 27B
CONTEXT
1M
IN / 1M
$0.42
OUT / 1M
$3.00
SERVING PROVIDERS
GroqPRICE NOT PUBLISHED
OpenRouter$0.42 IN / $3.00 OUT

Nemotron 3 Ultra 550b A55b

NVIDIA · 550B
CONTEXT
512K
IN / 1M
$0.63
OUT / 1M
$3.13
SERVING PROVIDERS
Together AI$0.60 IN / $3.60 OUT
OpenRouter$0.63 IN / $3.13 OUT

Kimi K2.7 Code

Moonshot ·
CONTEXT
262K
IN / 1M
$0.66
OUT / 1M
$3.40
SERVING PROVIDERS
Together AI$0.95 IN / $4.00 OUT
OpenRouter$0.66 IN / $3.40 OUT

Qwen3.5 397b A17b

Qwen · 397B
CONTEXT
262K
IN / 1M
$0.55
OUT / 1M
$3.50
SERVING PROVIDERS
Together AI$0.60 IN / $3.60 OUT
OpenRouter$0.55 IN / $3.50 OUT

Kimi K2.6

Moonshot ·
CONTEXT
262K
IN / 1M
$0.95
OUT / 1M
$4.00
SERVING PROVIDERS
Together AI$1.20 IN / $4.50 OUT
OpenRouter$0.95 IN / $4.00 OUT

Inkling

Inkling ·
CONTEXT
1.0M
IN / 1M
$1.00
OUT / 1M
$4.05
SERVING PROVIDERS
Together AI$1.00 IN / $4.05 OUT
OpenRouter$1.00 IN / $4.05 OUT

Qwen3.7 Max

Qwen ·
CONTEXT
1M
IN / 1M
$1.48
OUT / 1M
$4.42
SERVING PROVIDERS
Together AI$2.50 IN / $7.50 OUT
OpenRouter$1.48 IN / $4.42 OUT

Qwen3.8 2.4t A95b

Qwen · 4T
CONTEXT
1.0M
IN / 1M
$2.00
OUT / 1M
$6.00
SERVING PROVIDERS
Together AI$2.00 IN / $6.00 OUT
OpenRouter$2.00 IN / $6.00 OUT

Kimi K3

Moonshot · 1T
CONTEXT
1.0M
IN / 1M
$3.00
OUT / 1M
$15.00
SERVING PROVIDERS
Baseten$3.00 IN / $15.00 OUT
Together AI$3.00 IN / $15.00 OUT
Fireworks AI$3.00 IN / $15.00 OUT
OpenRouter$3.00 IN / $15.00 OUT

PER-MILLION-TOKEN RATES ARE EACH PROVIDER'S PUBLIC PRICING, SHOWN FOR TRANSPARENCY. YOU PAY YOUR PROVIDERS DIRECTLY; TESSERACT IS A FLAT $39/MO TOOL — NEVER PER-TOKEN METERING.

PRICING

One tool. One flat monthly price.

Pro is $39/month for the routing and benchmarking tool. You bring your own provider keys and pay your providers directly for usage — Tesseract never marks up inference. Cancel anytime.

Free

Free

Try the routing tool and live scoreboard. No credit card required.

  • Connect up to 2 providers with your own keys
  • OpenAI-compatible endpoint + routing on real benchmark data
  • Live provider scoreboard per model
  • Playground to test models
  • 1 Tesseract gateway key
  • 5 benchmark runs per day

Pro

$39/month

The routing and benchmarking tool, unlimited. You bring your own provider keys and pay your providers directly for usage.

  • Connect unlimited providers with your own keys
  • OpenAI-compatible endpoint + routing on real benchmark data
  • Live provider scoreboard per model
  • Playground to test models
  • Up to 5 Tesseract gateway keys
  • Unlimited benchmark runs + scheduled benchmarks + alerts
QUESTIONS

Free tier included. Bring your own provider keys.

GET STARTED

Bring your keys. Ship the routing.

Sign up, connect your provider keys, and call any top open model from a single OpenAI-compatible endpoint. Tesseract benchmarks every backend live and routes each request to the fastest, cheapest one — you pay your providers directly.

Get your API key
$39/month for the tool. Bring your own provider keys.
MODELSLlamaDeepSeekGPT-OSSKimi