Arcana ARCANA

Model Recommendations

Not sure which model to use? This guide picks the best model for common tasks based on current provider catalogs (OpenRouter, AIHubMix, Cloudflare Workers AI). All models work through Arcana — just set the provider key and go.

Model data sourced from: OpenRouter API, AIHubMix API, Cloudflare AI. Last verified Jul 25, 2026.

Quick Picks

TaskRecommendedContextWhy
Everyday codingclaude-sonnet-5 or gpt-5.41MBest all-round quality and tool use
Budget codinggpt-4.1-mini or gemini-3.6-flash1MVery cheap, still very capable
Deep reasoningclaude-opus-5 or claude-fable-51MFlagship reasoning and agentic work
Long documentsgemini-3.6-flash or kimi-k31MMassive context windows
Fast responsesgpt-4.1-nano or gemini-3.5-flash-lite1MLowest latency, high throughput
Free / localollama/llama3variesNo API key, runs on your machine

By Provider

OpenAI

ModelContextStrengthsCost Tier
gpt-5.6-sol1MState-of-the-art coding, science, cybersecurityHigh
gpt-5.6-terra1MBalanced intelligence and cost (mini tier)Medium
gpt-5.6-luna1MCost-sensitive, high-volume workloads (nano tier)Low
gpt-5.5variesStrong coding, reasoning, multimodalHigh
gpt-5.4variesFlagship model, strong all-roundHigh
gpt-5.4-minivariesSmaller, faster, cost-efficientMedium
gpt-5.4-nanovariesSmallest and fastest, edge use casesLow
gpt-5variesCoding, writing, reasoningHigh
gpt-5-minivariesLightweight, high-volume tasksMedium
gpt-5-nanovariesSmallest GPT-5, low latencyLow
gpt-4.11MReliable flagship, excellent tool useMedium
gpt-4.1-mini1MFast, affordable, still very capableLow
gpt-4.1-nano1MSmallest, cheapest, high-throughputVery Low

Anthropic

ModelContextStrengthsCost Tier
claude-fable-51MMost capable model, demanding reasoning, long-horizon agentic workVery High
claude-opus-51MFlagship for complex agentic coding and enterprise workHigh
claude-opus-4.8200KMost powerful publicly available, complex reasoningHigh
claude-opus-4.71MStep-change improvement in agentic codingHigh
claude-sonnet-51MMost agentic Sonnet, coding, tool use, reasoningMedium
claude-sonnet-4.6variesBalanced coding, reasoning, agentic capabilitiesMedium
claude-haiku-4.5variesCoding performance at 1/3 cost, 2x speedLow

Google Gemini

ModelContextStrengthsCost Tier
gemini-3.6-flash1MFrontier intelligence, code generation, agentic execution, spatial reasoningLow
gemini-3.5-flash1MFast multimodal, sub-agent deployment, long-horizon tasksLow
gemini-3.5-flash-lite1MLowest latency, high-throughput subagent tasksVery Low
gemini-3.1-pro1MMost intelligent Gemini, improved reasoningMedium
gemini-2.5-pro1MStrong reasoning, thinking supportMedium
gemini-2.5-flash1MFast multimodal, strong reasoningLow

xAI (Grok)

ModelContextStrengthsCost Tier
grok-4.51MCoding, science, engineering, math — exceeds comparable frontier modelsMedium
grok-build-0.1256KFast coding model for agentic coding workflowsLow

MoonshotAI (Kimi)

ModelContextStrengthsCost Tier
kimi-k31M2.8T params, long-horizon coding, knowledge work, #1 in multiple arenasMedium
coding-kimi-k31MCoding-specialized variant of Kimi K3Low

DeepSeek

ModelContextStrengthsCost Tier
deepseek-v4-provariesHigh-capability reasoning, production-grade inferenceLow

Alibaba (Qwen)

ModelContextStrengthsCost Tier
qwen3.8-max-preview~1M2.4T params, full-stack dev, data analysis, Office workflowsLow
qwen3-maxvariesStrong coding, reasoning, multilingualLow

Other Notable Models

ModelProviderContextStrengths
glm-5.2Zhipu AI1MProject-level engineering, full dev workflow
muse-spark-1.1Meta1MMultimodal reasoning, agentic tasks, accepts video/audio/PDF
hy3Tencent256K295B MoE, coding agent, long-doc analysis
m3MiniMax1MFrontier coding, agentic capabilities
doubao-seed-2.1-proByteDance256KEnterprise coding, agent, multimodal
laguna-s-2.1Poolside1M118B coding agent model, 70.2% Terminal-Bench

By Task Type

Coding & Development

ModelStrengthsCost
claude-opus-5End-to-end software tasks, code review, bug finding, agentic codingHigh
gpt-5.6-solState-of-the-art across coding, knowledge, scienceHigh
claude-sonnet-5Strong coding, tool use, follows instructions preciselyMedium
kimi-k3#1 in coding arenas, 1M context, long-horizon codingMedium
gpt-4.1Reliable code generation, debugging, refactoringMedium
deepseek-v4-proHigh-capability reasoning, very cheapVery Low
laguna-s-2.1Purpose-built coding agent, 1M contextLow

Writing & Content

ModelStrengthsCost
claude-sonnet-5Natural prose, creative writing, editing, professional workMedium
gpt-5.4Structured content, technical writing, strong all-roundHigh
gemini-3.6-flashLong-form content, document analysis, 1M contextLow

Analysis & Research

ModelStrengthsCost
claude-fable-5Most capable reasoning, 1M context, nuanced analysisVery High
gemini-3.6-flash1M context, analyze entire codebases or document setsLow
kimi-k32.8T params, #1 in knowledge work arenasMedium

Creative & Brainstorming

ModelStrengthsCost
claude-sonnet-5Creative writing, worldbuilding, dialogueMedium
gpt-5.4Brainstorming, diverse ideas, multimodalHigh
grok-4.5Real-time context, current events, humorMedium

The Utility Model

Arcana uses a secondary "utility model" for background tasks like fact extraction, session compaction, and summarization. Set this to a cheap, fast model:

{
  "model": "claude-sonnet-5",
  "utilityModel": "gpt-4.1-nano"
}

Good utility model picks: gpt-4.1-nano, gpt-4.1-mini, gemini-3.5-flash-lite, gemini-3.6-flash.

Switching Models

You can switch models mid-session without restarting:

# In the TUI, type:
/providers

# Or set in config:
export ARCANA_MODEL=claude-sonnet-5

Tips

  • Start with claude-sonnet-5 or gpt-5.4 — they handle most tasks well
  • Use gpt-4.1-nano or gemini-3.5-flash-lite as the utility model to keep costs low
  • Switch to claude-opus-5 or claude-fable-5 only when you need deep reasoning
  • For budget coding, deepseek-v4-pro and kimi-k3 punch well above their price
  • Run arcana models to see all available models from your detected providers
  • Prices change frequently — check provider pricing pages for current rates
Last updated: Jul 25, 2026 · Data from OpenRouter, AIHubMix, Cloudflare AI