nanobot: 2026-09-13 21:38:42
This commit is contained in:
240
cron/jobs.json
240
cron/jobs.json
@@ -96,35 +96,11 @@
|
||||
"originMetadata": {}
|
||||
},
|
||||
"state": {
|
||||
"nextRunAtMs": 1789306583197,
|
||||
"lastRunAtMs": 1789299383186,
|
||||
"nextRunAtMs": 1789335383261,
|
||||
"lastRunAtMs": 1789328183249,
|
||||
"lastStatus": "ok",
|
||||
"lastError": null,
|
||||
"runHistory": [
|
||||
{
|
||||
"runAtMs": 1789162581894,
|
||||
"status": "ok",
|
||||
"durationMs": 12,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789169781907,
|
||||
"status": "ok",
|
||||
"durationMs": 14,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789176981922,
|
||||
"status": "ok",
|
||||
"durationMs": 11,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789184182133,
|
||||
"status": "ok",
|
||||
"durationMs": 10,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789191382144,
|
||||
"status": "ok",
|
||||
@@ -220,11 +196,35 @@
|
||||
"status": "ok",
|
||||
"durationMs": 11,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789306583199,
|
||||
"status": "ok",
|
||||
"durationMs": 15,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789313783216,
|
||||
"status": "ok",
|
||||
"durationMs": 19,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789320983237,
|
||||
"status": "ok",
|
||||
"durationMs": 11,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789328183249,
|
||||
"status": "ok",
|
||||
"durationMs": 12,
|
||||
"error": null
|
||||
}
|
||||
]
|
||||
},
|
||||
"createdAtMs": 1789032980434,
|
||||
"updatedAtMs": 1789299383197,
|
||||
"updatedAtMs": 1789328183261,
|
||||
"deleteAfterRun": false
|
||||
},
|
||||
{
|
||||
@@ -251,101 +251,11 @@
|
||||
"originMetadata": {}
|
||||
},
|
||||
"state": {
|
||||
"nextRunAtMs": 1789302985765,
|
||||
"lastRunAtMs": 1789301185764,
|
||||
"nextRunAtMs": 1789329986900,
|
||||
"lastRunAtMs": 1789328186900,
|
||||
"lastStatus": "ok",
|
||||
"lastError": null,
|
||||
"runHistory": [
|
||||
{
|
||||
"runAtMs": 1789266985730,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789268785731,
|
||||
"status": "ok",
|
||||
"durationMs": 1,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789270585733,
|
||||
"status": "ok",
|
||||
"durationMs": 1,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789272385736,
|
||||
"status": "ok",
|
||||
"durationMs": 1,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789274185738,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789275985741,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789277785742,
|
||||
"status": "ok",
|
||||
"durationMs": 1,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789279585744,
|
||||
"status": "ok",
|
||||
"durationMs": 1,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789281385746,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789283185747,
|
||||
"status": "ok",
|
||||
"durationMs": 1,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789284985750,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789286785751,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789288585752,
|
||||
"status": "ok",
|
||||
"durationMs": 1,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789290385754,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789292185755,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789293985756,
|
||||
"status": "ok",
|
||||
@@ -375,11 +285,101 @@
|
||||
"status": "ok",
|
||||
"durationMs": 1,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789302985766,
|
||||
"status": "ok",
|
||||
"durationMs": 1,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789304785768,
|
||||
"status": "ok",
|
||||
"durationMs": 1,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789306585772,
|
||||
"status": "ok",
|
||||
"durationMs": 7,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789308386232,
|
||||
"status": "ok",
|
||||
"durationMs": 7,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789310186241,
|
||||
"status": "ok",
|
||||
"durationMs": 7,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789311986249,
|
||||
"status": "ok",
|
||||
"durationMs": 1,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789313786252,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789315586254,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789317386522,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789319186523,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789320986525,
|
||||
"status": "ok",
|
||||
"durationMs": 7,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789322786743,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789324586744,
|
||||
"status": "ok",
|
||||
"durationMs": 1,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789326386747,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
},
|
||||
{
|
||||
"runAtMs": 1789328186900,
|
||||
"status": "ok",
|
||||
"durationMs": 0,
|
||||
"error": null
|
||||
}
|
||||
]
|
||||
},
|
||||
"createdAtMs": 1789032980437,
|
||||
"updatedAtMs": 1789301185765,
|
||||
"updatedAtMs": 1789328186900,
|
||||
"deleteAfterRun": false
|
||||
}
|
||||
]
|
||||
|
||||
@@ -87,3 +87,14 @@ https://www.librechat.ai/docs/local/docker
|
||||
5. Čas v summary skriptu je wall-clock celého běhu včetně prvního načtení modelu; `load_duration` z API se vypisuje zvlášť (load>0 jen při prvním requestu).
|
||||
|
||||
**Doporučení pro agenta / tool use:** granite4.1:8b (nejlepší balance), ministral-3 (nejrychlejší), qwen3 (spolehlivost, pomalejší).
|
||||
- 2026-09-13: Cena/výkon srovnání plných desítek + rozhodnutí testovat finální kandidáty doplněk: uživatel si vybral tři finalisty (lfm2.5-thinking, granite4.1:8b, ministral-3), lfm vypadá nejlépe (nejmenší velikost + rozumný čas). Domluveno: na finalisty pustím **náročnější sadu testů** pro lepší rozlišení — vstupní 10 scénářů už je plní neseparuje (všichni 10/10).
|
||||
- 2026-09-13: Uživatelova zkušenost: **Ollama na nvidia.hell je výrazně nestabilní** — padá, když něco nezvládne (neznámý request, špatně zvládnutý model/template) nebo když přetíží stroj (paměť). Pro uživatele **v praxi nepoužitelné**; je z toho dost zklamaný.
|
||||
|
||||
Koreluje s dřívějšími nálezy z tool-call testů (2026-09-12/13), kdy nestabilita nebyla ojedinělá, ale systémový vzorec:
|
||||
- Memory watchdog na nvidia.hell opakovaně zabíjel llama-server (`Remote end closed connection`) — sejmul ho aya-expanse (hned na S1), qwen3.5 (na S10 s 5 nástroji), dřív i gemma4/gemma4:e4b (9.6 GB).
|
||||
- Více nástrojů v promptu = vyšší paměťové nároky = watchdog kill. Pády nejsou náhodné — spouští je kombinace velkého modelu + většího kontextu.
|
||||
- phi4-mini-reasoning: reasoning CoT tolik zpomalí, že ~3 min bez odpovědi — Ollama se nezachytí ani graciozně.
|
||||
- gemini-3-flash-preview:cloud vracel HTTP 410 Gone — mrtvý cloud pointer v instanci.
|
||||
|
||||
Závěr uživatele: současný stav (modely pod 10 GB na této GPU instanci) není použitelný pro reálný provoz, jen pro testy. Otevřené otázky pro případné hledání řešení: stabilizace Ollama serveru (limit paměti per model, OLLAMA_MAX_LOADED_MODELS, auto-restart), alternativní runtime (llama.cpp server přímo, vLLM), nebo kapacitnější hardware.
|
||||
- 2026-09-13: Research alternativ k Ollama (uživatel: nestabilita na nvidia.hell je v praxi nepoužitelná). Root cause potvrzen: watchdog killy = OOM na RAM, llama-server je stejně llama.cpp — problém je Ollamina heuristika offloadingu/kontextu, ne engine sám. Alternativy ověřeny z více zdrojů (codersera, local-llm.net, inventivehq, r/LocalLLaMA thread k postu „Friends Don't Let Friends Use Ollama", duben 2026): (1) llama.cpp llama-server + llama-swap — konsensus komunity, OpenAI-compatible API, hot-swap modelů, explicitní -c/-ngl kontrola → doporučeno uživateli; (2) vLLM — pro multi-user serving, na RTX 4060 tight (safetensors, KV cache overhead), odloženo; (3) LM Studio/Jan — zavrhnuté (Electron, closed source); (4) zůstat na Ollama + hardening (OLLAMA_MAX_LOADED_MODELS=1, systemd Restart/MemoryMax) — fallback. Čeká se na rozhodnutí uživatele, nabídka přípravy llama-swap yaml + systemd unit + litellm wiring.
|
||||
|
||||
1
projects/travel/memory.md
Normal file
1
projects/travel/memory.md
Normal file
@@ -0,0 +1 @@
|
||||
- 2026-09-13: Založen projekt travel pro mapování dovolených, cestování a zajímavých míst. Scope: plánování výletů, místa k navštívení, postřehy z cest.
|
||||
3
projects/travel/prompt.md
Normal file
3
projects/travel/prompt.md
Normal file
@@ -0,0 +1,3 @@
|
||||
# Travel
|
||||
|
||||
Mapování dovolených, cestování a zajímavých míst. Plánování výletů, místa k navštívení, postřehy z cest.
|
||||
0
projects/travel/state.md
Normal file
0
projects/travel/state.md
Normal file
Reference in New Issue
Block a user