Loading skill
Install any skill in seconds. Free to start, no credit card required.
Get Started Free →Model selection by provider health, not task complexity. Tier 0 (local) handles most tasks. Paid models are break-glass only. Fallbacks activate on 429 or timeout — never on perceived task difficulty.
| Test case | Without → With | Effect | Δ tokens | Δ turns |
|---|---|---|---|---|
| case-01 | ✗→✓ | ▲ Improved | -9% | 0% |
| case-02 | ✗→✓ | ▲ Improved | 4% | 0% |
| case-03 | ✗→✓ | ▲ Improved | -8% | 0% |
| case-07 | ✗→✓ | ▲ Improved | -28% | 0% |
| case-08 | ✗→✓ | ▲ Improved | -18% | 0% |
Tier 0 — Local (never dies, zero cost)
ollama/qwen3-coder:latest primary, MoE, 128 TPS, 64k ctx
ollama/gpt-oss:20b fallback, 32k ctx HARD LIMIT
Tier 1 — Fast Free Cloud (up to 2100 TPS)
cerebras/qwen-3-235b-a22b-instruct-2507 235B MoE, fast free
cerebras/llama3.1-8b 8B, ultra-fast light tasks
Tier 2 — Free Cloud (normal latency)
openrouter/z-ai/glm-4.5-air
openrouter/qwen/qwen3-coder
Tier 3 — Free Cloud Deep Reasoning
openrouter/nousresearch/hermes-3-llama-3.1-405b:free
Tier 4 — Break-Glass (paid, restricted use)
openrouter/anthropic/claude-opus-4.6 [narco-check and audit ONLY]DO fallback when:
DO NOT fallback when:
Use the primary model. Iterate. Fallback is for infrastructure failure, not preference.
bash# Tier 0 curl -s localhost:11434/api/tags | python3 -c "import json,sys; d=json.load(sys.stdin); print('TIER-0 OK:', len(d['models']), 'models')" # Tier 1 curl -s -o /dev/null -w "%{http_code}" \ -H "Authorization: Bearer $CEREBRAS_API_KEY" \ https://api.cerebras.ai/v1/models # Tier 4 curl -s -o /dev/null -w "%{http_code}" \ https://openrouter.ai/api/v1/models
bash# Check today's OpenRouter spend curl -s "https://openrouter.ai/api/v1/auth/key" \ -H "Authorization: Bearer $OPENROUTER_API_KEY" \ | python3 -c " import json,sys d=json.load(sys.stdin)['data'] print(f'today: \${d[\"usage_daily\"]:.2f} | week: \${d[\"usage_weekly\"]:.2f} | month: \${d[\"usage_monthly\"]:.2f}') "
Daily > $5: flag to Ludo. Weekly > $50: flag immediately — tier-4 model is likely being over-used.
Other measured skills in the registry, with their headline benchmark lift.