Provider Comparison
Victor supports 24 LLM providers with unified interfaces.
Quick Comparison
| Provider |
Tool Calls |
Streaming |
Max Context |
Air-Gapped |
Cost |
| Anthropic |
✅ Native |
✅ |
200K |
❌ |
$$$ |
| OpenAI |
✅ Native |
✅ |
128K |
❌ |
$$$ |
| Google Gemini |
✅ Native |
✅ |
1M |
❌ |
$$ |
| Ollama |
✅ Native |
✅ |
Varies |
✅ |
Free |
| LM Studio |
✅ Native |
✅ |
Varies |
✅ |
Free |
| vLLM |
✅ Native |
✅ |
Varies |
✅ |
Free |
| Azure OpenAI |
✅ Native |
✅ |
128K |
❌ |
$$$ |
| AWS Bedrock |
✅ Native |
✅ |
Varies |
❌ |
$$$ |
| Mistral |
✅ Native |
✅ |
32K |
❌ |
$$ |
Decision Tree
flowchart TD
START["Choose Provider"] --> AIR{"Need<br/>Air-Gapped?"}
AIR -->|Yes| LOCAL{"Hardware?"}
AIR -->|No| CLOUD{"Budget?"}
LOCAL -->|GPU| VLLM["vLLM"]
LOCAL -->|CPU/Any| OLLAMA["Ollama"]
LOCAL -->|GUI| LMSTUDIO["LM Studio"]
CLOUD -->|Free| GROQ["Groq Free Tier"]
CLOUD -->|$$| GOOGLE["Gemini"]
CLOUD -->|$$$| FEATURES{"Features?"}
FEATURES -->|Long Context| ANTHROPIC["Anthropic 200K"]
FEATURES -->|Vision| GPT4O["GPT-4o"]
FEATURES -->|Enterprise| AZURE["Azure OpenAI"]
style START fill:#e0e7ff
style OLLAMA fill:#d1fae5
style ANTHROPIC fill:#fef3c7
Feature Matrix
| Feature |
Anthropic |
OpenAI |
Google |
Ollama |
vLLM |
| Native Tool Calls |
✅ |
✅ |
✅ |
✅ |
✅ |
| Parallel Tools |
✅ |
✅ |
✅ |
✅ |
✅ |
| Streaming |
✅ |
✅ |
✅ |
✅ |
✅ |
| Vision |
✅ |
✅ |
✅ |
⚠️ |
⚠️ |
| Extended Thinking |
✅ |
❌ |
❌ |
❌ |
❌ |
| JSON Mode |
✅ |
✅ |
✅ |
❌ |
❌ |
| System Prompts |
✅ |
✅ |
✅ |
✅ |
✅ |
Model Recommendations
| Use Case |
Provider |
Model |
Why |
| Coding |
Anthropic |
claude-sonnet-4-5 |
Best code understanding |
| Long Context |
Google |
gemini-pro |
1M tokens |
| Vision |
OpenAI |
gpt-4o |
Best multimodal |
| Local Free |
Ollama |
codellama |
Privacy + cost |
| Fast |
vLLM |
Any |
Optimized throughput |
| Enterprise |
Azure |
gpt-4 |
Compliance |
Setup Commands
# Anthropic
victor chat --provider anthropic --model claude-sonnet-4-5
# OpenAI
victor chat --provider openai --model gpt-4o
# Ollama (local)
victor init --local
victor chat --provider ollama --model codellama
# Google
victor chat --provider google --model gemini-pro
API Key Setup
# Using keyring (recommended)
victor keys --set anthropic --keyring
# Using environment variable
export ANTHROPIC_API_KEY="sk-..."
victor chat
# Using .env file
echo "ANTHROPIC_API_KEY=sk-..." > ~/.victor/.env
Air-Gapped Setup
| Provider |
Setup Time |
Model Management |
| Ollama |
5 min |
Built-in |
| LM Studio |
10 min |
GUI-based |
| vLLM |
30 min |
Advanced |
# Quick air-gapped setup
victor init --local
victor chat --provider ollama --model llama3
Cost Comparison
| Provider |
Input (per 1M tokens) |
Output (per 1M tokens) |
| Anthropic |
$3.00 |
$15.00 |
| OpenAI |
$5.00 |
$15.00 |
| Google |
$0.50 |
$1.50 |
| Ollama |
Free |
Free |
| Provider |
Avg Latency (p50) |
Throughput |
| Ollama |
500ms |
Medium |
| vLLM |
200ms |
High |
| Anthropic |
300ms |
Medium |
| OpenAI |
250ms |
High |
| Google |
400ms |
Medium |
See Also