nanobot: 2026-09-13 21:38:42

This commit is contained in:
lachtan
2026-09-13 21:38:43 +02:00
parent 964f9975a3
commit 947f594356
5 changed files with 135 additions and 120 deletions

View File

@@ -96,35 +96,11 @@
"originMetadata": {}
},
"state": {
"nextRunAtMs": 1789306583197,
"lastRunAtMs": 1789299383186,
"nextRunAtMs": 1789335383261,
"lastRunAtMs": 1789328183249,
"lastStatus": "ok",
"lastError": null,
"runHistory": [
{
"runAtMs": 1789162581894,
"status": "ok",
"durationMs": 12,
"error": null
},
{
"runAtMs": 1789169781907,
"status": "ok",
"durationMs": 14,
"error": null
},
{
"runAtMs": 1789176981922,
"status": "ok",
"durationMs": 11,
"error": null
},
{
"runAtMs": 1789184182133,
"status": "ok",
"durationMs": 10,
"error": null
},
{
"runAtMs": 1789191382144,
"status": "ok",
@@ -220,11 +196,35 @@
"status": "ok",
"durationMs": 11,
"error": null
},
{
"runAtMs": 1789306583199,
"status": "ok",
"durationMs": 15,
"error": null
},
{
"runAtMs": 1789313783216,
"status": "ok",
"durationMs": 19,
"error": null
},
{
"runAtMs": 1789320983237,
"status": "ok",
"durationMs": 11,
"error": null
},
{
"runAtMs": 1789328183249,
"status": "ok",
"durationMs": 12,
"error": null
}
]
},
"createdAtMs": 1789032980434,
"updatedAtMs": 1789299383197,
"updatedAtMs": 1789328183261,
"deleteAfterRun": false
},
{
@@ -251,101 +251,11 @@
"originMetadata": {}
},
"state": {
"nextRunAtMs": 1789302985765,
"lastRunAtMs": 1789301185764,
"nextRunAtMs": 1789329986900,
"lastRunAtMs": 1789328186900,
"lastStatus": "ok",
"lastError": null,
"runHistory": [
{
"runAtMs": 1789266985730,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789268785731,
"status": "ok",
"durationMs": 1,
"error": null
},
{
"runAtMs": 1789270585733,
"status": "ok",
"durationMs": 1,
"error": null
},
{
"runAtMs": 1789272385736,
"status": "ok",
"durationMs": 1,
"error": null
},
{
"runAtMs": 1789274185738,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789275985741,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789277785742,
"status": "ok",
"durationMs": 1,
"error": null
},
{
"runAtMs": 1789279585744,
"status": "ok",
"durationMs": 1,
"error": null
},
{
"runAtMs": 1789281385746,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789283185747,
"status": "ok",
"durationMs": 1,
"error": null
},
{
"runAtMs": 1789284985750,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789286785751,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789288585752,
"status": "ok",
"durationMs": 1,
"error": null
},
{
"runAtMs": 1789290385754,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789292185755,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789293985756,
"status": "ok",
@@ -375,11 +285,101 @@
"status": "ok",
"durationMs": 1,
"error": null
},
{
"runAtMs": 1789302985766,
"status": "ok",
"durationMs": 1,
"error": null
},
{
"runAtMs": 1789304785768,
"status": "ok",
"durationMs": 1,
"error": null
},
{
"runAtMs": 1789306585772,
"status": "ok",
"durationMs": 7,
"error": null
},
{
"runAtMs": 1789308386232,
"status": "ok",
"durationMs": 7,
"error": null
},
{
"runAtMs": 1789310186241,
"status": "ok",
"durationMs": 7,
"error": null
},
{
"runAtMs": 1789311986249,
"status": "ok",
"durationMs": 1,
"error": null
},
{
"runAtMs": 1789313786252,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789315586254,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789317386522,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789319186523,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789320986525,
"status": "ok",
"durationMs": 7,
"error": null
},
{
"runAtMs": 1789322786743,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789324586744,
"status": "ok",
"durationMs": 1,
"error": null
},
{
"runAtMs": 1789326386747,
"status": "ok",
"durationMs": 0,
"error": null
},
{
"runAtMs": 1789328186900,
"status": "ok",
"durationMs": 0,
"error": null
}
]
},
"createdAtMs": 1789032980437,
"updatedAtMs": 1789301185765,
"updatedAtMs": 1789328186900,
"deleteAfterRun": false
}
]

View File

@@ -87,3 +87,14 @@ https://www.librechat.ai/docs/local/docker
5. Čas v summary skriptu je wall-clock celého běhu včetně prvního načtení modelu; `load_duration` z API se vypisuje zvlášť (load>0 jen při prvním requestu).
**Doporučení pro agenta / tool use:** granite4.1:8b (nejlepší balance), ministral-3 (nejrychlejší), qwen3 (spolehlivost, pomalejší).
- 2026-09-13: Cena/výkon srovnání plných desítek + rozhodnutí testovat finální kandidáty doplněk: uživatel si vybral tři finalisty (lfm2.5-thinking, granite4.1:8b, ministral-3), lfm vypadá nejlépe (nejmenší velikost + rozumný čas). Domluveno: na finalisty pustím **náročnější sadu testů** pro lepší rozlišení — vstupní 10 scénářů už je plní neseparuje (všichni 10/10).
- 2026-09-13: Uživatelova zkušenost: **Ollama na nvidia.hell je výrazně nestabilní** — padá, když něco nezvládne (neznámý request, špatně zvládnutý model/template) nebo když přetíží stroj (paměť). Pro uživatele **v praxi nepoužitelné**; je z toho dost zklamaný.
Koreluje s dřívějšími nálezy z tool-call testů (2026-09-12/13), kdy nestabilita nebyla ojedinělá, ale systémový vzorec:
- Memory watchdog na nvidia.hell opakovaně zabíjel llama-server (`Remote end closed connection`) — sejmul ho aya-expanse (hned na S1), qwen3.5 (na S10 s 5 nástroji), dřív i gemma4/gemma4:e4b (9.6 GB).
- Více nástrojů v promptu = vyšší paměťové nároky = watchdog kill. Pády nejsou náhodné — spouští je kombinace velkého modelu + většího kontextu.
- phi4-mini-reasoning: reasoning CoT tolik zpomalí, že ~3 min bez odpovědi — Ollama se nezachytí ani graciozně.
- gemini-3-flash-preview:cloud vracel HTTP 410 Gone — mrtvý cloud pointer v instanci.
Závěr uživatele: současný stav (modely pod 10 GB na této GPU instanci) není použitelný pro reálný provoz, jen pro testy. Otevřené otázky pro případné hledání řešení: stabilizace Ollama serveru (limit paměti per model, OLLAMA_MAX_LOADED_MODELS, auto-restart), alternativní runtime (llama.cpp server přímo, vLLM), nebo kapacitnější hardware.
- 2026-09-13: Research alternativ k Ollama (uživatel: nestabilita na nvidia.hell je v praxi nepoužitelná). Root cause potvrzen: watchdog killy = OOM na RAM, llama-server je stejně llama.cpp — problém je Ollamina heuristika offloadingu/kontextu, ne engine sám. Alternativy ověřeny z více zdrojů (codersera, local-llm.net, inventivehq, r/LocalLLaMA thread k postu „Friends Don't Let Friends Use Ollama", duben 2026): (1) llama.cpp llama-server + llama-swap — konsensus komunity, OpenAI-compatible API, hot-swap modelů, explicitní -c/-ngl kontrola → doporučeno uživateli; (2) vLLM — pro multi-user serving, na RTX 4060 tight (safetensors, KV cache overhead), odloženo; (3) LM Studio/Jan — zavrhnuté (Electron, closed source); (4) zůstat na Ollama + hardening (OLLAMA_MAX_LOADED_MODELS=1, systemd Restart/MemoryMax) — fallback. Čeká se na rozhodnutí uživatele, nabídka přípravy llama-swap yaml + systemd unit + litellm wiring.

View File

@@ -0,0 +1 @@
- 2026-09-13: Založen projekt travel pro mapování dovolených, cestování a zajímavých míst. Scope: plánování výletů, místa k navštívení, postřehy z cest.

View File

@@ -0,0 +1,3 @@
# Travel
Mapování dovolených, cestování a zajímavých míst. Plánování výletů, místa k navštívení, postřehy z cest.

0
projects/travel/state.md Normal file
View File