Evaluace a zlepšování systému

Analýza chyb

Error analysis je systematické skúmání nesprávnych nebo neuspokojivých výstupů s cílem vytvořit taxonomii zlyhaní, určit jejich frekvenci, závažnost a pravdepodobnou príčinu. Neobmedzuje se na průměrnou metriku. Spojuje konkrétně případy s dátovými rezmi, anotacemi, komponenty pipeline a podmienkami použití. Výsledkem má být prioritizovaný seznam zásahů, například oprava štítků, nový eval set, změna retrievalu, úprava promptu, kalibrace prahu nebo bezpečnostní kontrola.

Poslední odborná revize
7. srpna 2026
Odborný garant
Miroslav Schmiedt
ID
AI-GEO-E-18

Odborná definice

Odborná definice

Error analysis je systematické skúmání nesprávnych nebo neuspokojivých výstupů s cílem vytvořit taxonomii zlyhaní, určit jejich frekvenci, závažnost a pravdepodobnou príčinu. Neobmedzuje se na průměrnou metriku. Spojuje konkrétně případy s dátovými rezmi, anotacemi, komponenty pipeline a podmienkami použití. Výsledkem má být prioritizovaný seznam zásahů, například oprava štítků, nový eval set, změna retrievalu, úprava promptu, kalibrace prahu nebo bezpečnostní kontrola.

Srozumitelné vysvětlení

Srozumitelné vysvětlení

Model může mít 92 procent přesnost a navzdory tomu zlyhávat přesně tam, kde to firmu nejvíce bolí. Analýza chyb vezme vzorek neúspechů a rozdělí jejich podle mechanizmu, například chybějící dokument, nesprávně rozpoznaná entita, nejasná otázka nebo chybná citace. Potom se spočítá, které skupiny jsou časté a které mají velký dopad. Cílem není seznam kuriozít, ale rozhodnutí, či další týždeň priniese větší úžitok oprava dat, retrievera nebo používatelského rozhraní. Každá kategorie má vést ku konkrétnímu testu nebo zásahu.

Časté otázky

Časté otázky

Jak se vybírá vzorek chyb na analýzu?

Kombinuje se náhodná vzorek s rizikovými rezmi, novými typmi vstupů a prípadmi s vysokou nejistotou. Pouze najviditelnejšie stížnosti by skreslili obraz.

Co má obsahovat taxonomie chyb?

Kategorie musí být jednoznačné, akčné a přiměřeně úplné. Při každé se eviduje příklad, závažnost, fáza vzniku a možný způsob nápravy.

Jak se odlišuje chyba modelu od chyby dat?

Sleduje se původní vstup, ground truth, transformace a medzivýstupy. Nesprávný štítek nebo chybějící kontext nelze připsat pouze modelu.

Proč je potřebná analýza po používatelských skupinách?

Průměr může skrýt systematické selhání v menším jazyku, zařízení nebo segmente. Slice analýza ukáže nerovnomerné rozdělení rizika.

Kdy je analýza chyb ukončená?

Když se zistení pretavia do testovatelných hypotéz, priorít a nových eval případů. Po změně se ověří, či cílová chyba klesla bez poškodení jiných oblastí.

Související pojmy

Související pojmy

Zdroje a redakční stopa

Zdroje a redakční stopa

Definícia je autorská odborná syntéza. Pri právnych a regulačných rozhodnutiach má prednosť aktuálne oficiálne znenie predpisu a posúdenie konkrétneho prípadu.