This commit is contained in:
lachtan
2026-09-16 08:56:28 +02:00
parent b0827177d2
commit 5407931bdc
4 changed files with 550 additions and 29 deletions

View File

@@ -7,44 +7,44 @@ trvalá změna defaultu = `agents.defaults.modelPreset` v `~/.nanobot/config.jso
## Nakonfigurované presety (`/model`)
Zdroj: `~/.nanobot/config.json``model_presets`. Všechny mají `maxTokens = 16384`,
`temperature = 0.1`, `provider = ollama`.
Zdroj: `~/.nanobot/config.json``model_presets`. Všechny mají `maxTokens = 16384`
a `temperature = 0.1`. Default je `glm`, fallback `kimi`.
| Preset | Model id | Kontext | reasoningEffort |
|---|---|---|---|
| `glm` *(default)* | `glm-5.3-flash:cloud` | 976 000 | high |
| `glm53` | `glm-5.3:cloud` | 976 000 | high |
| `glm52` *(legacy)* | `glm-5.2:cloud` | 976 000 | high |
| `glmi51` *(legacy)* | `glm-5.1:cloud` | 196 608 | — |
| `kimi` | `kimi-k2.6:cloud` | 262 144 | — |
| `kimi27` | `kimi-k2.7-code:cloud` | 262 144 | — |
| `kimi3` | `kimi-k3:cloud` | 1 020 000 | — |
| Preset | Provider | Model id | Kontext | reasoningEffort |
|---|---|---|---|---|
| `glm` *(default)* | ollama | `glm-5.3:cloud` | 976 000 | high |
| `flash` | ollama | `glm-5.3-flash:cloud` | 976 000 | high |
| `glm52` *(legacy)* | ollama | `glm-5.2:cloud` | 976 000 | high |
| `glm51` *(legacy)* | ollama | `glm-5.1:cloud` | 196 608 | — |
| `kimi` | ollama | `kimi-k2.7-code:cloud` | 262 144 | — |
| `kimi26` | ollama | `kimi-k2.6:cloud` | 262 144 | — |
| `kimi3` | ollama | `kimi-k3:cloud` | 1 020 000 | — |
| `sonnet` | openrouter | `anthropic/claude-sonnet-4.6` | 256 000 | — |
| `haiku` | openrouter | `anthropic/claude-haiku-4.5` | 200 000 | — |
| `gemini-flash` | openrouter | `google/gemini-3.5-flash` | 256 000 | — |
| `gemini-flash-lite` | openrouter | `google/gemini-3.1-flash-lite` | 256 000 | — |
`glmi51` a `glm52` jsou legacní — jen pro regression srovnání, k práci nepoužívat.
`glm51` a `glm52` jsou legacní — jen pro regression srovnání, k práci nepoužívat.
`kimi3` nepoužívat (viz níž), zvaž odstranění presetu z configu.
---
## Strategie modelů (potvrzeno uživatelem, 2026-02)
## Strategie modelů (potvrzeno uživatelem, 2026-09)
| Role | Model |
|---|---|
| **Daily driver** | `glm` — glm-5.3-flash |
| **Těžké úlohy** | `glm53` — glm-5.3 |
| **Kódování** | `kimi27` — kimi-k2.7-code (fallback: `kimi`) |
| **Běžné agentní práce na Kimi** | `kimi` — kimi-k2.6 |
| **Daily driver + těžké úlohy** | `glm` — glm-5.3 |
| **Kódování** | `kimi` — kimi-k2.7-code |
| **Běžné agentní práce na Kimi** | `kimi26` — kimi-k2.6 |
| **Levnější/rychlejší + multimodální vstup** | `flash` — glm-5.3-flash |
| **Nepoužívat** | `kimi3` — extra high usage, zasekávání v agentním modu (2026-02) |
### Kdy přepnout na glm53 („těžká úloha")
### Kdy sáhnout po `flash`
- Multi-step research / deep-research skill (30+ iterací, cross-checking, dlouhé syntézy).
- Multi-file refactor (5+ souborů, velký kontext).
- Dlouhý debug / root-cause analýza přes víc systémů.
- Wiki-compile s velkými vstupy (drain tisíců řádků).
- Prompt injection / security analýza.
Pravidlo: nejdřív `glm` (flash); když task „cuchne" (model ztrácí nit, opakuje tool
call, potřebuje přes 100 iterací), restartuj na `glm53`.
- **Multimodální vstup** — obrázek, screenshot, sken, video. `glm` (glm-5.3) je
**text-only**, flash je jediný GLM preset, co obrázky přijme (viz níž).
- Levné rutinní tahy, kde nejde o maximální kvalitu a záleží na rychlosti
(TTFT ~0,4 s vs ~0,7 s).
### GLM-5.3 řada — srovnání (deep research, 2026-06)