Skip to content

Provider Comparison

Victor supports 24 LLM providers with unified interfaces.

Quick Comparison

Provider Tool Calls Streaming Max Context Air-Gapped Cost
Anthropic ✅ Native 200K $$$
OpenAI ✅ Native 128K $$$
Google Gemini ✅ Native 1M $$
Ollama ✅ Native Varies Free
LM Studio ✅ Native Varies Free
vLLM ✅ Native Varies Free
Azure OpenAI ✅ Native 128K $$$
AWS Bedrock ✅ Native Varies $$$
Mistral ✅ Native 32K $$

Decision Tree

flowchart TD
    START["Choose Provider"] --> AIR{"Need<br/>Air-Gapped?"}
    AIR -->|Yes| LOCAL{"Hardware?"}
    AIR -->|No| CLOUD{"Budget?"}

    LOCAL -->|GPU| VLLM["vLLM"]
    LOCAL -->|CPU/Any| OLLAMA["Ollama"]
    LOCAL -->|GUI| LMSTUDIO["LM Studio"]

    CLOUD -->|Free| GROQ["Groq Free Tier"]
    CLOUD -->|$$| GOOGLE["Gemini"]
    CLOUD -->|$$$| FEATURES{"Features?"}

    FEATURES -->|Long Context| ANTHROPIC["Anthropic 200K"]
    FEATURES -->|Vision| GPT4O["GPT-4o"]
    FEATURES -->|Enterprise| AZURE["Azure OpenAI"]

    style START fill:#e0e7ff
    style OLLAMA fill:#d1fae5
    style ANTHROPIC fill:#fef3c7

Feature Matrix

Feature Anthropic OpenAI Google Ollama vLLM
Native Tool Calls
Parallel Tools
Streaming
Vision ⚠️ ⚠️
Extended Thinking
JSON Mode
System Prompts

Model Recommendations

Use Case Provider Model Why
Coding Anthropic claude-sonnet-4-5 Best code understanding
Long Context Google gemini-pro 1M tokens
Vision OpenAI gpt-4o Best multimodal
Local Free Ollama codellama Privacy + cost
Fast vLLM Any Optimized throughput
Enterprise Azure gpt-4 Compliance

Setup Commands

# Anthropic
victor chat --provider anthropic --model claude-sonnet-4-5

# OpenAI
victor chat --provider openai --model gpt-4o

# Ollama (local)
victor init --local
victor chat --provider ollama --model codellama

# Google
victor chat --provider google --model gemini-pro

API Key Setup

# Using keyring (recommended)
victor keys --set anthropic --keyring

# Using environment variable
export ANTHROPIC_API_KEY="sk-..."
victor chat

# Using .env file
echo "ANTHROPIC_API_KEY=sk-..." > ~/.victor/.env

Air-Gapped Setup

Provider Setup Time Model Management
Ollama 5 min Built-in
LM Studio 10 min GUI-based
vLLM 30 min Advanced
# Quick air-gapped setup
victor init --local
victor chat --provider ollama --model llama3

Cost Comparison

Provider Input (per 1M tokens) Output (per 1M tokens)
Anthropic $3.00 $15.00
OpenAI $5.00 $15.00
Google $0.50 $1.50
Ollama Free Free

Performance

Provider Avg Latency (p50) Throughput
Ollama 500ms Medium
vLLM 200ms High
Anthropic 300ms Medium
OpenAI 250ms High
Google 400ms Medium

See Also