[{"data":1,"prerenderedAt":377},["ShallowReactive",2],{"/blog/kdyz-vsechno-vypada-v-poradku-zacina-moje-prace":3},{"id":4,"title":5,"author":6,"body":7,"date":354,"description":355,"draft":356,"extension":357,"image":358,"meta":359,"navigation":360,"path":361,"readingTime":362,"seo":363,"stem":364,"tags":365,"tldr":371,"__hash__":376},"blog/blog/kdyz-vsechno-vypada-v-poradku-zacina-moje-prace.md","Když všechno vypadá v pořádku, začíná moje práce","Petr Balvín",{"type":8,"value":9,"toc":343},"minimark",[10,20,23,26,29,32,37,40,51,54,57,60,64,79,82,85,113,116,119,123,130,133,136,139,148,151,155,158,171,178,181,185,188,191,194,200,203,206,209,212,216,219,225,235,241,247,250,254,257,260,267,270,274,283,286,289,292,297],[11,12,13,14,19],"p",{},"Minule jsem psal o tom, že ",[15,16,18],"a",{"href":17},"/blog/kdyz-kod-pisou-agenti-bottleneckem-se-stava-clovek/","když kód píšou agenti, bottleneckem se stává\nčlověk",". Že mým limitem není\nimplementační kapacita, ale kolik rozhodnutí za den udělám dobře.",[11,21,22],{},"Od té doby mi vrtá hlavou nepříjemné pokračování. Napsal jsem, že těžiště mojí práce je\nteď v kontrole a v rozhodování. Ale co když je zrovna kontrola slabší, než si o ní myslím?",[11,24,25],{},"Došlo mi to na obyčejném review. Agent vrátil změnu ve zpracování objednávek a k tomu\nodstavec, proč to udělal zrovna takhle. Dávalo to smysl. Kód vypadal čistě, testy zelené.\nNapsal jsem „ok\". Za dva dny se ukázalo, že jeden typ objednávky se zpracuje špatně.",[11,27,28],{},"Když jsem si to přehrál zpátky, zjistil jsem nepříjemnou věc. Ta informace v tom diffu byla.\nJá jsem ji četl. Jen jsem s ní nic neudělal. Nehledal jsem totiž chybu. Ověřoval jsem,\njestli mi to dává smysl.",[11,30,31],{},"To je rozdíl, který jsem si dlouho neuvědomoval.",[33,34,36],"h2",{"id":35},"co-se-vlastně-změnilo","Co se vlastně změnilo",[11,38,39],{},"Dřív měla moje práce zabudovanou pojistku. Když jsem něco navrhl špatně, nefungovalo to.\nVerdikt přišel sám a bylo mu jedno, jak moc jsem si věřil.",[41,42,47],"pre",{"className":43,"code":45,"language":46},[44],"language-text","dřív:  problém → můj nápad → zkusím → nefunguje → přemýšlím znovu\ndnes:  problém → hotové řešení i s vysvětlením → posoudím → „ok\"\n","text",[48,49,45],"code",{"__ignoreMap":50},"",[11,52,53],{},"Vypadá to jako drobnost. Není.",[11,55,56],{},"V prvním případě problém řeším. Mám o něm vlastní představu dřív, než uvidím jakoukoli\nodpověď. Ve druhém případě hotovou odpověď posuzuju. A představu o tom problému mi dodá\nten, koho mám zkontrolovat.",[11,58,59],{},"Kontrolovat hotovou práci je něco jiného než tu práci udělat. A jde mi to hůř,\nnež jsem si myslel.",[33,61,63],{"id":62},"nedávno-pro-to-vznikl-pojem-kognitivní-kapitulace","Nedávno pro to vznikl pojem: kognitivní kapitulace",[11,65,66,67,71,72,78],{},"Kognitivní kapitulace (anglicky ",[68,69,70],"em",{},"cognitive surrender",") je moment, kdy člověk vezme odpověď\nAI za svou, aniž by ji pořádně prohnal vlastní hlavou. Ten pojem nedávno navrhli Steven Shaw\na Gideon Nave z Whartonu ve ",[15,73,77],{"href":74,"rel":75},"https://papers.ssrn.com/sol3/papers.cfm?abstract_id=6097646",[76],"nofollow","studii z ledna 2026",",\nnení to zavedený termín z učebnice.",[11,80,81],{},"Zkoušeli to jednoduše. Lidé řešili logické úlohy, u kterých první nápad bývá špatně.\nČást z nich mohla použít chatbota. Ten měl náhodně nastavené, jestli poradí dobře,\nnebo sebejistě špatně.",[11,83,84],{},"Co jim vyšlo:",[86,87,88,97,103],"ul",{},[89,90,91,92,96],"li",{},"s dobrou radou se lidé zlepšili o ",[93,94,95],"strong",{},"25 procentních bodů"," oproti těm bez AI",[89,98,99,100],{},"se špatnou radou si pohoršili o ",[93,101,102],{},"15 procentních bodů",[89,104,105,106,109,110],{},"dobrou radu poslechli v ",[93,107,108],{},"93 %"," případů, špatnou v ",[93,111,112],{},"80 %",[11,114,115],{},"Tu první odrážku beru stejně vážně jako tu druhou. Není to studie proti AI. Když AI poradí\ndobře, přínos je velký. Když poradí špatně, škoda je taky velká. A o tom, co z toho nastane,\nnerozhoduje nástroj. Rozhoduje to, jestli si tu odpověď zkontroluju.",[11,117,118],{},"Přidám dvě výhrady. Studie zatím neprošla recenzním řízením. A testovaly se na ní logické\nhádanky, ne skutečná práce. Naletět u chytáku a schválit špatný merge není totéž.",[33,120,122],{"id":121},"podle-pocitu-se-to-poznat-nedá","Podle pocitu se to poznat nedá",[11,124,125,126,129],{},"Ze stejné studie vyšla ještě jedna věc. Lidé s chatbotem si věřili asi o ",[93,127,128],{},"12 % víc","\nnež lidé bez něj. A to jim chatbot v polovině případů radil špatně.",[11,131,132],{},"Tohle je pro mě jádro celé věci.",[11,134,135],{},"Kdybych u špatného rozhodnutí cítil nejistotu, nemám problém. Zpomalím, projdu to znovu,\nzeptám se někoho. Jenže ta nejistota nepřijde. Přijde pravý opak.",[11,137,138],{},"Minule jsem zmiňoval experiment METR. Vývojáři s AI tam byli o 19 % pomalejší a i po\nskončení testu si mysleli, že jim AI pomohla. Tehdy mi to přišlo jako kuriozita. Dneska\nto čtu jinak. Je to ta samá věc: mám pocit, že práce jde dobře, a ten pocit nemá s výsledkem\nmoc společného. (Sami autoři v únoru 2026 doplnili, že u novějších nástrojů už zrychlení\nnejspíš nastává. To ale nic nemění na tom rozdílu mezi pocitem a měřením, kvůli kterému\ntu studii zmiňuju.)",[11,140,141,142,147],{},"Podobně dopadla ",[15,143,146],{"href":144,"rel":145},"https://arxiv.org/abs/2211.03622",[76],"studie ze Stanfordu",", tentokrát rovnou\nna vývojářích. Jedna skupina psala bezpečnostně citlivý kód s AI asistentem, druhá bez něj.\nTa s asistentem napsala méně bezpečný kód. A přitom si víc věřila, že píše bezpečně.\nNejlíp dopadli lidé, kteří asistentovi věřili nejmíň.",[11,149,150],{},"Testovaly se tam modely z roku 2022, dneska je to muzeum. Neberu si z toho, že AI píše\nnebezpečný kód. Beru si jediné: podle pocitu se to poznat nedá.",[33,152,154],{"id":153},"hranice-schopností-ai-není-vidět","Hranice schopností AI není vidět",[11,156,157],{},"Kdyby chyby chodily tam, kde je čekám, dám si na ta místa pozor a mám hotovo.\nJenže tak to nefunguje.",[11,159,160,161,164,165,170],{},"Existuje na to termín: ",[93,162,163],{},"jagged frontier",", tedy roztřepená hranice schopností. Znamená to,\nže AI nezvládá úkoly podle toho, jak jsou těžké pro člověka. Něco snadného jí nejde,\nněco složitého zvládne bez zaváhání. Termín zavedli výzkumníci z Harvardu a BCG\nv ",[15,166,169],{"href":167,"rel":168},"https://pubsonline.informs.org/doi/10.1287/orsc.2025.21838",[76],"experimentu se 758 konzultanty",".",[11,172,173,174,177],{},"U úkolů, které AI zvládala, zvedla kvalitu výstupu o víc než 40 %. U úkolu kousek za tou\nhranicí byli lidé s AI o ",[93,175,176],{},"19 procentních bodů"," náchylnější odevzdat špatné řešení.\nTo druhé číslo je potřeba brát s rezervou: stojí na jediné úloze, schválně navržené tak,\naby na ní model selhal, a testoval se GPT-4 z dubna 2023.",[11,179,180],{},"Praktický dopad ale zůstává: nemůžu si dopředu říct, u které skupiny úkolů budu opatrný.\nPodle toho, jak těžký mi ten úkol připadá, se to poznat nedá. Špatný výstup navíc vypadá\nstejně sebejistě jako dobrý.",[33,182,184],{"id":183},"co-pomáhá","Co pomáhá",[11,186,187],{},"Wharton zkoušel dvě cesty, jak kapitulaci zmenšit. Časový tlak nezabral vůbec. Zabralo\nněco jiného: odměna za správnou odpověď a okamžitá zpětná vazba u každého pokusu.\nLidé pak špatné rady odmítali mnohem častěji.",[11,189,190],{},"Pro moji práci z toho plyne jednoduchá věc. Nemá smysl si slibovat, že budu číst pozorněji.\nSmysl má mít u výsledku něco, co ho posoudí za mě.",[11,192,193],{},"Rozdělil jsem si podle toho práci na dvě hromádky:",[41,195,198],{"className":196,"code":197,"language":46},[44],"posoudí to za mě:   testy, typecheck, lint, build, migrace, běh na reálných datech\nposoudím jen já:    návrh, byznysová logika, priority, text pro klienta, odhad dopadu\n",[48,199,197],{"__ignoreMap":50},[11,201,202],{},"U první hromádky převedu velkou část kontroly na automatické pojistky. Stačí je zadat\ndopředu a agent si je pustí sám, ještě než mi práci předá.",[11,204,205],{},"Vyřešené to ale není a nechci to tak tvrdit. Na začátku článku je chyba, která prošla\npřes zelené testy, a nebyla to náhoda. Když testy píše ten samý agent, co psal kód,\nvycházejí ze stejného pochopení zadání. Chybný předpoklad si tak dostane vlastní zelený\ntest. Je to přesně stejná past jako to hezky napsané zdůvodnění, jen o patro níž. Taky\nvypadá jako důkaz a taky jím není.",[11,207,208],{},"Váhu má hlavně kontrola, která nevznikla spolu s tím řešením. Zadání, co má platit.\nPorovnání se zdrojovým systémem. Kontrolní součet. Běh na reálných datech.",[11,210,211],{},"U druhé hromádky ani tohle nemám. Tam jsem kontrola já a nikdo jiný. A platí u ní\nnepříjemné pravidlo: čím míň dané věci rozumím, tím míň se můžu spolehnout na vlastní\nreview. Nemusím umět napsat všechno, co kontroluju, ale musím vědět, co má platit a podle\nčeho to poznám. Kde tohle nemám, tam nekontroluju. Tam jenom čtu a přikyvuju.",[33,213,215],{"id":214},"jak-to-dělám-já","Jak to dělám já",[11,217,218],{},"Nesnažím se AI míň věřit. To zní chytře a nedá se podle toho pracovat. Zkouším místo toho\nčtyři konkrétní věci a jedu je asi tři týdny.",[11,220,221,224],{},[93,222,223],{},"Vlastní odhad si píšu dřív, než otevřu výsledek."," Do zadání si přidám dvě tři věty:\njak bych to řešil já a co se u toho dá pokazit. Nejde o to mít pravdu. Jde o to mít vlastní\npředstavu dřív, než dostanu hotovou. Když se pak výsledek liší, mám o čem přemýšlet.\nBez toho jenom kývu na cizí návrh.",[11,226,227,230,231,234],{},[93,228,229],{},"Po agentovi chci důkaz, ne vysvětlení."," V ",[15,232,233],{"href":17},"minulém\nčlánku"," jsem psal, že definition\nof done patří do zadání. Posunul jsem to dál. Nezajímá mě věta, že to funguje. Zajímá mě,\nco to dokazuje. Které testy na to sahají a jestli vznikly z mého zadání, nebo si je agent\ndomyslel k vlastnímu řešení. Co je ověřené na reálných datech. Co záměrně neřeším. Hezky\nnapsaný odstavec o tom, jak je řešení správné, mi kontrolu neusnadňuje. Ztěžuje ji.",[11,236,237,240],{},[93,238,239],{},"Rychlý souhlas beru jako varovný signál."," Tohle je nejpodivnější návyk z celé sady\na funguje mi nejlíp. Když do půl minuty cítím „ok, tohle je ono\", je to přesně ten stav,\nkterý ta studie měří. Nemusí to znamenat, že je to špatně. Znamená to, že jsem zatím nic\nnezkontroloval, jen jsem dostal dobrý pocit. Tak si položím otázku: kdyby to bylo špatně,\nkde by se to projevilo?",[11,242,243,246],{},[93,244,245],{},"U druhé hromádky zpomaluju schválně."," Nechám si návrh rozepsat do dvou tří variant\ni s tím, co mluví proti každé z nich. Jednu možnost umím jenom schválit nebo zamítnout.\nMezi třemi se musím rozhodnout. To je jiná práce a mnohem hůř se u ní přikyvuje.",[11,248,249],{},"Co naopak nedělám: nečtu všechno dvakrát pomaleji. Tím bych se vrátil přesně do toho\nbottlenecku, o kterém byl minulý článek.",[33,251,253],{"id":252},"mimo-kód-je-to-stejné-jen-to-není-vidět","Mimo kód je to stejné, jen to není vidět",[11,255,256],{},"U kódu mám aspoň ty testy. Většina firem ale nasazuje AI přesně tam, kde nic takového\nnení. Do nabídek, odpovědí zákazníkům, podkladů pro rozhodnutí, analýz, shrnutí schůzek.",[11,258,259],{},"Kontrola se pak formuluje jako „ať to po AI někdo přečte\". Podle čísel výš je to slabší\npojistka, než jak zní. Čte to člověk, který dostal hotovou odpověď i s vysvětlením.\nČasto ji neumí ověřit rychleji, než by ji sám napsal. A pocit jistoty ho neupozorní,\nže něco nehraje.",[11,261,262,263,266],{},"Když dneska navrhuju automatizaci, ptám se dřív než na nástroj: ",[93,264,265],{},"co v tomhle kroku hraje\nroli testu?"," Někdy je to kontrolní součet nebo porovnání se zdrojovým systémem. Někdy\nvzorek, který se ověří ručně. Někdy stačí, že výstup nikam neodejde, dokud ho někdo\nschválí a má k tomu podklady mimo AI.",[11,268,269],{},"Když na tu otázku odpověď není, není to hotová automatizace. Je to jen rychlejší způsob,\njak vyrobit něco, co nikdo neověří.",[33,271,273],{"id":272},"kde-to-podle-mě-je","Kde to podle mě je",[11,275,276,279,280],{},[15,277,278],{"href":17},"Minulý článek"," jsem uzavřel\ntím, že mým výsledkem už není jen napsaný kód, ale i dobré rozhodnutí. Tenhle bych uzavřel doplňkem, který mi tam chyběl. ",[93,281,282],{},"Dobré rozhodnutí není to,\nu kterého mám dobrý pocit.",[11,284,285],{},"Nebaví mě verze téhle debaty, kde se řeší, jestli AI lidi hloupne. Zajímavější je, co se\ns tím dá dělat. Kapitulace není povahová vada. Je to reakce na situaci, kterou si kolem\nsebe stavím sám. A dá se postavit jinak: mít vlastní odhad dřív než odpověď, chtít důkaz\nmísto vysvětlení a být nejostražitější zrovna ve chvíli, kdy se všechno zdá v pořádku.",[11,287,288],{},"Zajímalo by mě, jak to řešíte vy, hlavně mimo vývoj. Co u vás v procesu hraje roli testu?\nOzvěte se, tohle je téma, kde se docela rád nechám vyvést z omylu.",[290,291],"hr",{},[11,293,294],{},[93,295,296],{},"Zdroje",[86,298,299,312,320,328],{},[89,300,301,302,306,307,170],{},"Shaw, Nave: ",[15,303,305],{"href":74,"rel":304},[76],"Thinking Fast, Slow, and Artificial: How AI is Reshaping Human Reasoning and the Rise of Cognitive Surrender"," (1/2026). Preprint bez recenzního řízení, tři předregistrované experimenty, 1 372 účastníků. Srozumitelné shrnutí od autorů na ",[15,308,311],{"href":309,"rel":310},"https://knowledge.wharton.upenn.edu/podcast/ripple-effect/how-ai-is-reshaping-human-intuition-and-reasoning-gideon-nave-and-steven-shaw/",[76],"Knowledge at Wharton",[89,313,314,315,319],{},"Dell'Acqua a kol.: ",[15,316,318],{"href":167,"rel":317},[76],"Navigating the Jagged Technological Frontier",", Organization Science (3/2026). Terénní experiment se 758 konzultanty BCG, prošlo recenzním řízením. Zhoršení o 19 procentních bodů ale stojí na jediné úloze mimo hranici a na GPT-4 z dubna 2023.",[89,321,322,323,327],{},"Perry, Srivastava, Kumar, Boneh: ",[15,324,326],{"href":144,"rel":325},[76],"Do Users Write More Insecure Code with AI Assistants?",", ACM CCS 2023. Testované modely jsou dnes zastaralé, použitelné je hlavně zjištění o sebedůvěře.",[89,329,330,331,336,337,342],{},"METR: ",[15,332,335],{"href":333,"rel":334},"https://metr.org/blog/2025-07-10-early-2025-ai-experienced-os-dev-study/",[76],"Measuring the Impact of Early-2025 AI on Experienced Open-Source Developer Productivity"," (7/2025) a ",[15,338,341],{"href":339,"rel":340},"https://metr.org/blog/2026-02-24-uplift-update/",[76],"aktualizace z 2/2026",", podle které u novějších nástrojů zrychlení nejspíš nastává. Zmiňuju kvůli rozdílu mezi vnímanou a skutečnou rychlostí, ten aktualizace nevyvrací.",{"title":50,"searchDepth":344,"depth":344,"links":345},2,[346,347,348,349,350,351,352,353],{"id":35,"depth":344,"text":36},{"id":62,"depth":344,"text":63},{"id":121,"depth":344,"text":122},{"id":153,"depth":344,"text":154},{"id":183,"depth":344,"text":184},{"id":214,"depth":344,"text":215},{"id":252,"depth":344,"text":253},{"id":272,"depth":344,"text":273},"2026-08-17","Agent nevrátí jen výsledek, vrátí ho i s vysvětlením, proč je správný. Sepsal jsem, proč se to tak těžko kontroluje a co s tím dělám.",false,"md",null,{},true,"/blog/kdyz-vsechno-vypada-v-poradku-zacina-moje-prace",8,{"title":5,"description":355},"blog/kdyz-vsechno-vypada-v-poradku-zacina-moje-prace",[366,367,368,369,370],"AI","agentní vývoj","rozhodování","code review","automatizace",[372,373,374,375],"Dřív jsem problém řešil sám. Dnes mi agent pošle hotové řešení i s vysvětlením, proč je správné. A takový výstup se kontroluje mnohem hůř.","Nedávno pro to vznikl pojem: kognitivní kapitulace. Když chatbot radil správně, lidé ho poslechli v 93 % případů. Když radil špatně, poslechli ho v 80 %.","Není to argument proti AI. S dobrou radou si lidé ve stejné studii polepšili o 25 procentních bodů. Problém je, že špatná rada vypadá stejně dobře.","Co s tím dělám: vlastní odhad si píšu dřív, než otevřu výsledek. Po agentovi chci důkaz, ne vysvětlení. A rychlý souhlas beru jako varovný signál.","peQIkPBV4MPu5vHJTSWnTByVweiRvpKveqbmtZ7aEec",1786973705396]