runtime
This commit is contained in:
43
projects/ai/artifacts/agent-to-human-tools.md
Normal file
43
projects/ai/artifacts/agent-to-human-tools.md
Normal file
@@ -0,0 +1,43 @@
|
||||
# Převod agent-nástrojů na nástroje pro člověka
|
||||
|
||||
Ověřený postup. Když AI agent napsal nástroj (runbook, skripty) původně
|
||||
**pro sebe**, nejde ho přímočaře zjednodušit pro lidské použití.
|
||||
|
||||
## Proč opačný postup nefunguje
|
||||
|
||||
- Model nevidí hranici, kde končí pro člověka použitelná složitost —
|
||||
„zjednoduš to" produkuje kosmetické úpravy, ne redesign.
|
||||
- Existující podoba psaná pro agenta (hromada parametrů, dlouhé runbooky)
|
||||
model **ukotvuje** — upravuje, co vidí, místo aby navrhl jiné rozhraní.
|
||||
- Plan mode u designu rozhraní nestačí: plánuje implementaci, ne podobu
|
||||
rozhraní. Tu musí určit člověk.
|
||||
|
||||
## Princip
|
||||
|
||||
**Rozhraní navrhuje člověk, model implementuje.** LLM je nejsilnější v
|
||||
dokódování těla funkce se zadaným podpisem — přebírání designu je jeho slabá
|
||||
stránka.
|
||||
|
||||
## Postup
|
||||
|
||||
1. **Existující agent-runbook ani skripty nepoužívat jako základ** — jen jako
|
||||
zdroj doménových faktů (co nástroj umí, jaké scénáře existují, jak se čeká
|
||||
na konec testu). Strukturu ne. Začít v čistém adresáři.
|
||||
2. **Tabulka scénář → příkaz** — člověk ručně napíše, co kdy spouští.
|
||||
To je celý human-runbook; žádný postup kroků.
|
||||
3. **Kostry skriptů píše člověk** — param block, komentáře po sekcích,
|
||||
protokol čekání na dokončení (např. čekat na exit procesu, žádný polling).
|
||||
Složitost je tím rozhodnutá předem.
|
||||
4. **Model jen dokódovává těla** — zadání: „dokóduj těla, parametry
|
||||
a strukturu neměň, nic nepřidávej.“ Review pak kontroluje jen implementaci,
|
||||
ne design.
|
||||
|
||||
## Pravidla pro zadání
|
||||
|
||||
- Složitost zadávat **čísly, ne adjektivy**: max počet parametrů na skript,
|
||||
max počet kroků, jeden skript = jeden scénář. Model na numerické limity
|
||||
reaguje spolehlivě; na „simple" ne.
|
||||
- Negativní omezení („žádné extra parametry") prosadit **v kódu kostry,
|
||||
ne v promptu** — když param block má 3 parametry, model 15 nedoplní.
|
||||
- Agent-runbook pro sebe si nechat vedle — převod „agent-runbook →
|
||||
human-runbook" je cesta, kde se to pořád láme. Nejsou to stejný dokument.
|
||||
54
projects/ai/artifacts/file-based-agent-communication.md
Normal file
54
projects/ai/artifacts/file-based-agent-communication.md
Normal file
@@ -0,0 +1,54 @@
|
||||
# Anotace v souborech místo chatu („mob with AI")
|
||||
|
||||
Zdroj: článek „Don't Chat With Your AI. Mob With It." (David Rodenas, Medium,
|
||||
2026). Článek sám je slabý — argument o latenci (GPU sloty, uvolňování/
|
||||
načítání inference) je nedoložený a nesedí; reálná latence je round-trip
|
||||
klient↔server, sériovost kroků a opakovaný prefill. Analogie s mob
|
||||
programmingem taky ne — v mobu píše jeden driver a víc lidí řídí, tady je to
|
||||
obráceně. Jádro je ale použitelné.
|
||||
|
||||
## Co drží (jádro oddělené od balastu)
|
||||
|
||||
- **Instrukce patří tam, kde je předmět instrukce.** Tag na konkrétním řádku
|
||||
dá kontext pozicí — agent nepotřebuje popis „v tom souboru, u té funkce".
|
||||
Stejný princip jako TODO komentář / poznámka v code review.
|
||||
- **Trvalost:** anotace nesedí v chatu, který se zavře — je v souboru, vidět
|
||||
v diffu, přežije session.
|
||||
- Není to o latenci ani paralelizaci. „Zrychlení" je ve skutečnosti **fronta**:
|
||||
zadám a nejdu čekat. Round-trip se nezkrátil, jen u něj nestojím.
|
||||
- Článek si protiřečí vlastním východiskem (DORA/TDD = rychlý feedback):
|
||||
hromadné zadání a společný review na konci **prodlouží feedback loop pro
|
||||
člověka**, ne pro agenta. „Hotovo dřív, než si všimnu" je z tohoto pohledu
|
||||
špatná zpráva, ne dobrá.
|
||||
|
||||
## Mechanismus
|
||||
|
||||
Komunikace přes tagy přímo v souborech (autor: `[[CLAUDE: …]]` instrukce,
|
||||
`[[DAVID: …]]` dotaz agenta). Pravidlo v CLAUDE.md: agent tagy hledá, provádí,
|
||||
odpovídá. Autor tag po provedení maže — to je chyba.
|
||||
|
||||
## Úpravy oproti článku
|
||||
|
||||
- **Tag nemaže, jen připisuje odpověď pod něj** — vlákno zůstane v souboru
|
||||
a v diffu; mazání je jen člověk, před commitem (grep na prefix).
|
||||
- **Nespouštět agenta ve smyčce nad soubory** (autonomní reakce = ztráta
|
||||
kontrolního bodu). Místo toho explicitní příkaz „projdi tagy a vyjádři se".
|
||||
- **Max 1–2 tagy na kolo.** Deset tagů = deset změn ke společnému review =
|
||||
nejasné, co odkud přišlo.
|
||||
|
||||
## Varianty kam dát vlákno
|
||||
|
||||
1. **Anotace jako komentáře v kódu** — nulová infrastruktura, funguje všude,
|
||||
diff ukáže celou historii výměny. Nevýhoda: zaneřádí kód, hlídání ručně.
|
||||
Dobré na krátké výměny u konkrétního místa.
|
||||
2. **Vedlejší soubor** (`file.notes.md` vedle zdrojáku, odkaz na symbol,
|
||||
ne na číslo řádku) — kód čistý, vlákna libovolně dlouhá, .gitignore.
|
||||
Dobré na dlouho se vlečoucí věci.
|
||||
|
||||
## Otevřené otázky
|
||||
|
||||
- Korekce agentových odpovědí („odpověď chci přepsat") — chat to řeší tím,
|
||||
že je mimo kód; anotace v souboru to nemají kde. Varianta 1 to řeší
|
||||
nejlíp (přepis = nová verze vlákna na místě), ale je potřeba vyzkoušet.
|
||||
- Vazba na symboly místo řádků u varianty 2 — jinak se odkazy rozbijí
|
||||
při každém editu.
|
||||
@@ -1,3 +1,10 @@
|
||||
- 2026-09-02: Založen projekt: deník + hledání řešení pro AI témata (agenti, kódování s AI, LLM).
|
||||
- 2026-09-02: Incident „gpt 5.3 se zasekl na PH/PZ/TX z mobilu": rekonstruováno — finální odpověď byla kompletní a verzovaná; problém byl agent loop (guard bloky, retry smyčky, ~6-8 min). Model = glm-5.3:cloud (žádný gpt 5.3). Kanál na kvalitu vliv nemá.
|
||||
- 2026-09-02: Compaction: uživatel si vyžádal drastické zkrácení incident zápisu; detaily zahozdeny, zachovány jen závěry.
|
||||
- 2026-09-02: Compaction: uživatel si vyžádal drastické zkrácení incident zápisu; detaily zahozdeny, zachovány jen závěry.
|
||||
- 2026-09-08: Série měření na Solarflare X2/X4 (TCPDirect, C# knihovna). Claude Code navrhl měřicí setup, aplikace sockbench na měření, Claude spouštěl scénáře, ukládal a vyhodnocoval výsledky. Fungovalo.
|
||||
Pak cíl: převést proces na ruční spouštění skriptů (PowerShell) pod vlastní kontrolou. Claude zde selhává opakovaně: skripty zbytečně složité, moc parametrů, špatně čekal na dokončení test setu, testoval zbytečné věci. Zadání v plan modu se nedaří, výsledek stále špatný — frustrace, ztracený čas místo ušetřeného.
|
||||
Uživatelova diagnóza: nedokáže správně popsat zadání; buď málo informací, nebo špatný přístup. Zvažované cesty: napsat kostry skriptů sám s komentáři a nechat Claude dokodovat; lepší projektový dokument; úplně odpoutat se od současné verze a začít znovu. Hledá efektivní způsob práce.
|
||||
- 2026-09-08: Upřesnění diagnózy (Solarflare/sockbench): Claude si původně napsal runbook pro sebe — pro agenta byl ok, pro člověka nepoužitelný (moc kroků, moc složitosti). Skripty nebyly úplně špatné, ale měly tunu parametrů. Jádro problému: dvě různé cílové skupiny — agent snese libovolnou složitost, člověk potřebuje mnohem menší míru komplexity. Uživatel se o tom v plan modu snažil mluvit, přiblížil se, ale komunikace nestačila.
|
||||
- 2026-09-08: correction: „úplně znovu od nuly — ne" z minula bylo nedorozuměním. Uživatel tím nemyslel „znovu bez specifikace", ale nepoužít existující runbook a existující skripty jako základ — ty ho limitují a anchornují ho špatným směrem. Restart s jeho vlastní specifikací (tabulka scénářů + kostry) je v pořádku, jediné co ne: recyklace agent-runbooku.
|
||||
- 2026-09-08: Destilace postupu „převod agent-nástrojů na nástroje pro člověka" uložena jako artefakt: projects/ai/artifacts/agent-to-human-tools.md. Strukturovaný markdown: proč zjednodušení agent-nástrojů nefunguje (neviditelná hranice složitosti, ukotvení existující podobou, plan mode neřeší design), princip „rozhraní navrhuje člověk, model implementuje", 4krokový postup (čistý adresář → tabulka scénář→příkaz → kostry → dokódování těl) a pravidla pro zadání (čísla místo adjektiv, omezení v kódu ne v promptu, agent-runbook nepřevádět). Po vzájemné korektní diskusi: knowledge/ odmítnut, artefakt patří do projektu ai.
|
||||
- 2026-09-08: Rozbor článku „Don't Chat With Your AI. Mob With It." (Rodenas) + diskuse s Claude uložen jako artefakt: projects/ai/artifacts/file-based-agent-communication.md. Technikou je komunikace s agentem přes tagy v souborech místo chatu. Článková argumentace odmítnuta (latence ≠ GPU sloty; mob analogie obrácená; autonomní smyčka + mazání tagů = ztráta kontrolního bodu a prodloužení feedback loopu pro člověka). Použitelné jádro: anotace patří tam, kde je předmět anotace (pozice = kontext, jako TODO komentář), trvalost v diffu, tag se nemaže jen se připíše odpověď, max 1–2 tagy na kolo, explicitní spouštění místo autonomní smyčky. Otevřená otázka: jak korigovat agentovy odpovědi — kandidát varianta „vlákno jako komentáře v kódu" oproti vedlejšímu .notes.md souboru. Zájem uživatele o vyzkoušení.
|
||||
|
||||
Reference in New Issue
Block a user