This commit is contained in:
lachtan
2026-09-08 20:37:38 +02:00
parent af0ffc522a
commit a3f007bea3
7 changed files with 310 additions and 1 deletions

View File

@@ -0,0 +1,43 @@
# Převod agent-nástrojů na nástroje pro člověka
Ověřený postup. Když AI agent napsal nástroj (runbook, skripty) původně
**pro sebe**, nejde ho přímočaře zjednodušit pro lidské použití.
## Proč opačný postup nefunguje
- Model nevidí hranici, kde končí pro člověka použitelná složitost —
„zjednoduš to" produkuje kosmetické úpravy, ne redesign.
- Existující podoba psaná pro agenta (hromada parametrů, dlouhé runbooky)
model **ukotvuje** — upravuje, co vidí, místo aby navrhl jiné rozhraní.
- Plan mode u designu rozhraní nestačí: plánuje implementaci, ne podobu
rozhraní. Tu musí určit člověk.
## Princip
**Rozhraní navrhuje člověk, model implementuje.** LLM je nejsilnější v
dokódování těla funkce se zadaným podpisem — přebírání designu je jeho slabá
stránka.
## Postup
1. **Existující agent-runbook ani skripty nepoužívat jako základ** — jen jako
zdroj doménových faktů (co nástroj umí, jaké scénáře existují, jak se čeká
na konec testu). Strukturu ne. Začít v čistém adresáři.
2. **Tabulka scénář → příkaz** — člověk ručně napíše, co kdy spouští.
To je celý human-runbook; žádný postup kroků.
3. **Kostry skriptů píše člověk** — param block, komentáře po sekcích,
protokol čekání na dokončení (např. čekat na exit procesu, žádný polling).
Složitost je tím rozhodnutá předem.
4. **Model jen dokódovává těla** — zadání: „dokóduj těla, parametry
a strukturu neměň, nic nepřidávej.“ Review pak kontroluje jen implementaci,
ne design.
## Pravidla pro zadání
- Složitost zadávat **čísly, ne adjektivy**: max počet parametrů na skript,
max počet kroků, jeden skript = jeden scénář. Model na numerické limity
reaguje spolehlivě; na „simple" ne.
- Negativní omezení („žádné extra parametry") prosadit **v kódu kostry,
ne v promptu** — když param block má 3 parametry, model 15 nedoplní.
- Agent-runbook pro sebe si nechat vedle — převod „agent-runbook →
human-runbook" je cesta, kde se to pořád láme. Nejsou to stejný dokument.

View File

@@ -0,0 +1,54 @@
# Anotace v souborech místo chatu („mob with AI")
Zdroj: článek „Don't Chat With Your AI. Mob With It." (David Rodenas, Medium,
2026). Článek sám je slabý — argument o latenci (GPU sloty, uvolňování/
načítání inference) je nedoložený a nesedí; reálná latence je round-trip
klient↔server, sériovost kroků a opakovaný prefill. Analogie s mob
programmingem taky ne — v mobu píše jeden driver a víc lidí řídí, tady je to
obráceně. Jádro je ale použitelné.
## Co drží (jádro oddělené od balastu)
- **Instrukce patří tam, kde je předmět instrukce.** Tag na konkrétním řádku
dá kontext pozicí — agent nepotřebuje popis „v tom souboru, u té funkce".
Stejný princip jako TODO komentář / poznámka v code review.
- **Trvalost:** anotace nesedí v chatu, který se zavře — je v souboru, vidět
v diffu, přežije session.
- Není to o latenci ani paralelizaci. „Zrychlení" je ve skutečnosti **fronta**:
zadám a nejdu čekat. Round-trip se nezkrátil, jen u něj nestojím.
- Článek si protiřečí vlastním východiskem (DORA/TDD = rychlý feedback):
hromadné zadání a společný review na konci **prodlouží feedback loop pro
člověka**, ne pro agenta. „Hotovo dřív, než si všimnu" je z tohoto pohledu
špatná zpráva, ne dobrá.
## Mechanismus
Komunikace přes tagy přímo v souborech (autor: `[[CLAUDE: …]]` instrukce,
`[[DAVID: …]]` dotaz agenta). Pravidlo v CLAUDE.md: agent tagy hledá, provádí,
odpovídá. Autor tag po provedení maže — to je chyba.
## Úpravy oproti článku
- **Tag nemaže, jen připisuje odpověď pod něj** — vlákno zůstane v souboru
a v diffu; mazání je jen člověk, před commitem (grep na prefix).
- **Nespouštět agenta ve smyčce nad soubory** (autonomní reakce = ztráta
kontrolního bodu). Místo toho explicitní příkaz „projdi tagy a vyjádři se".
- **Max 12 tagy na kolo.** Deset tagů = deset změn ke společnému review =
nejasné, co odkud přišlo.
## Varianty kam dát vlákno
1. **Anotace jako komentáře v kódu** — nulová infrastruktura, funguje všude,
diff ukáže celou historii výměny. Nevýhoda: zaneřádí kód, hlídání ručně.
Dobré na krátké výměny u konkrétního místa.
2. **Vedlejší soubor** (`file.notes.md` vedle zdrojáku, odkaz na symbol,
ne na číslo řádku) — kód čistý, vlákna libovolně dlouhá, .gitignore.
Dobré na dlouho se vlečoucí věci.
## Otevřené otázky
- Korekce agentových odpovědí („odpověď chci přepsat") — chat to řeší tím,
že je mimo kód; anotace v souboru to nemají kde. Varianta 1 to řeší
nejlíp (přepis = nová verze vlákna na místě), ale je potřeba vyzkoušet.
- Vazba na symboly místo řádků u varianty 2 — jinak se odkazy rozbijí
při každém editu.

View File

@@ -1,3 +1,10 @@
- 2026-09-02: Založen projekt: deník + hledání řešení pro AI témata (agenti, kódování s AI, LLM).
- 2026-09-02: Incident „gpt 5.3 se zasekl na PH/PZ/TX z mobilu": rekonstruováno — finální odpověď byla kompletní a verzovaná; problém byl agent loop (guard bloky, retry smyčky, ~6-8 min). Model = glm-5.3:cloud (žádný gpt 5.3). Kanál na kvalitu vliv nemá.
- 2026-09-02: Compaction: uživatel si vyžádal drastické zkrácení incident zápisu; detaily zahoz­deny, zachovány jen závěry.
- 2026-09-02: Compaction: uživatel si vyžádal drastické zkrácení incident zápisu; detaily zahoz­deny, zachovány jen závěry.
- 2026-09-08: Série měření na Solarflare X2/X4 (TCPDirect, C# knihovna). Claude Code navrhl měřicí setup, aplikace sockbench na měření, Claude spouštěl scénáře, ukládal a vyhodnocoval výsledky. Fungovalo.
Pak cíl: převést proces na ruční spouštění skriptů (PowerShell) pod vlastní kontrolou. Claude zde selhává opakovaně: skripty zbytečně složité, moc parametrů, špatně čekal na dokončení test setu, testoval zbytečné věci. Zadání v plan modu se nedaří, výsledek stále špatný — frustrace, ztracený čas místo ušetřeného.
Uživatelova diagnóza: nedokáže správně popsat zadání; buď málo informací, nebo špatný přístup. Zvažované cesty: napsat kostry skriptů sám s komentáři a nechat Claude dokodovat; lepší projektový dokument; úplně odpoutat se od současné verze a začít znovu. Hledá efektivní způsob práce.
- 2026-09-08: Upřesnění diagnózy (Solarflare/sockbench): Claude si původně napsal runbook pro sebe — pro agenta byl ok, pro člověka nepoužitelný (moc kroků, moc složitosti). Skripty nebyly úplně špatné, ale měly tunu parametrů. Jádro problému: dvě různé cílové skupiny — agent snese libovolnou složitost, člověk potřebuje mnohem menší míru komplexity. Uživatel se o tom v plan modu snažil mluvit, přiblížil se, ale komunikace nestačila.
- 2026-09-08: correction: „úplně znovu od nuly — ne" z minula bylo nedorozuměním. Uživatel tím nemyslel „znovu bez specifikace", ale nepoužít existující runbook a existující skripty jako základ — ty ho limitují a anchornují ho špatným směrem. Restart s jeho vlastní specifikací (tabulka scénářů + kostry) je v pořádku, jediné co ne: recyklace agent-runbooku.
- 2026-09-08: Destilace postupu „převod agent-nástrojů na nástroje pro člověka" uložena jako artefakt: projects/ai/artifacts/agent-to-human-tools.md. Strukturovaný markdown: proč zjednodušení agent-nástrojů nefunguje (neviditelná hranice složitosti, ukotvení existující podobou, plan mode neřeší design), princip „rozhraní navrhuje člověk, model implementuje", 4krokový postup (čistý adresář → tabulka scénář→příkaz → kostry → dokódování těl) a pravidla pro zadání (čísla místo adjektiv, omezení v kódu ne v promptu, agent-runbook nepřevádět). Po vzájemné korektní diskusi: knowledge/ odmítnut, artefakt patří do projektu ai.
- 2026-09-08: Rozbor článku „Don't Chat With Your AI. Mob With It." (Rodenas) + diskuse s Claude uložen jako artefakt: projects/ai/artifacts/file-based-agent-communication.md. Technikou je komunikace s agentem přes tagy v souborech místo chatu. Článková argumentace odmítnuta (latence ≠ GPU sloty; mob analogie obrácená; autonomní smyčka + mazání tagů = ztráta kontrolního bodu a prodloužení feedback loopu pro člověka). Použitelné jádro: anotace patří tam, kde je předmět anotace (pozice = kontext, jako TODO komentář), trvalost v diffu, tag se nemaže jen se připíše odpověď, max 12 tagy na kolo, explicitní spouštění místo autonomní smyčky. Otevřená otázka: jak korigovat agentovy odpovědi — kandidát varianta „vlákno jako komentáře v kódu" oproti vedlejšímu .notes.md souboru. Zájem uživatele o vyzkoušení.