Ollama a OpenRouter jsou alternativní způsoby připojení modelů k Claude Code
medium
current
Ollama
Lokální inference server pro běh LLM modelů. Podporuje širokou škálu modelů (Llama, Qwen, Mistral, Gemma aj.) a poskytuje OpenAI-compatible API endpoint.
Klíčové vlastnosti
Lokální běh — modely běží na vlastním hardware, žádné API náklady
OpenAI-compatible API — snadné připojení z Claude Code a dalších nástrojů
Model management — ollama pull, ollama list, ollama run
Široká podpora modelů — Llama, Qwen, Mistral, Gemma, Phi a další
Použití s Claude Code
Nastav OPENAI_API_BASE=http://localhost:11434/v1 a OPENAI_API_KEY=ollama
Vyber model v .claude/settings.json nebo přes env var ANTHROPIC_MODEL
Výhoda: nulové náklady, soukromí. Nevýhoda: nižší kvalita než cloud modely.