Learning to rank a vyhledávání informací

Ranking model

Ranking model odhaduje relatívnu relevanci, preferenci nebo užitečnost položek a používá ji na sestavení pořadí pro konkrétní dotaz, uživatele nebo kontext. Může se učit pointwise ze samostatných známok, pairwise z preferencií mezi dvojicami nebo listwise přímo z vlastností celého seznamu. Výstupní skóre nemusí být kalibrovaná pravděpodobnost. Kvalitu ovlivňují relevance labels, výběr negativních příkladů, expozičné zkreslení a soulad tréninkové ztráty s cílovou rankingovou metrikou.

Poslední odborná revize
7. srpna 2026
Odborný garant
Miroslav Schmiedt
ID
AI-GEO-R-04

Odborná definice

Odborná definice

Ranking model odhaduje relatívnu relevanci, preferenci nebo užitečnost položek a používá ji na sestavení pořadí pro konkrétní dotaz, uživatele nebo kontext. Může se učit pointwise ze samostatných známok, pairwise z preferencií mezi dvojicami nebo listwise přímo z vlastností celého seznamu. Výstupní skóre nemusí být kalibrovaná pravděpodobnost. Kvalitu ovlivňují relevance labels, výběr negativních příkladů, expozičné zkreslení a soulad tréninkové ztráty s cílovou rankingovou metrikou.

Srozumitelné vysvětlení

Srozumitelné vysvětlení

Klasifikátor se ptá, zda je položka dobrá nebo zlá. Ranking model řeší jemnejšiu otázku, kterou z více prijatelných položek má uživatel vidět dříve. V e-shope může zohladnit shodu s dopytom, dostupnost, cenu, preference i čerstvost. Pořadí je vždy viazané na konkrétní seznam kandidátů, takže vysoké skóre samo sám o sobě nemusí mít stabilní význam mimo daného dotazu. Model také zdedí zkreslení z toho, co bylo uživatelům v minulosti vůbec zobrazené.

Časté otázky

Časté otázky

Jaký je rozdíl mezi rankingom a klasifikací?

Klasifikace optimalizuje správně přiřazení tříd jednotlivým položkám. Ranking kladie důraz na relativně usporiadání, zejména na první pozice, kde chyba bývá najdrahšia.

Odkial pochádzají tréninková relevance labels?

Z manuálnych posudků, kliknutí, nákupů, dwell time nebo syntetických preferencií. Každý zdroj má vlastní zkreslení a nemal by se bez úprav považovat za čistou pravdu.

Které metriky se používají?

Běžné jsou ndcg, MRR, MAP, Precision@k a Recall@k. Výběr závisí na toho, zda je důležité první relevantní místo, více relevantních položek nebo odstupňovaná relevance.

Proč kliknutí skreslují trénink?

Uživatel může kliknúť dříve na položku, kterou systém umiestnil vyšší, i když není nejlepší. Position bias se řeší experimentmi, propensity weightingom nebo kontrolovaným zberom dat.

Musí ranking model fungovat v reálném čase?

Ne vždy, ale online vyhledávání a doporučení často vyžadují milisekundovou latenci. Proto se složité modely používají až na menším zozname kandidátů.

Související pojmy

Související pojmy

Zdroje a redakční stopa

Zdroje a redakční stopa

  • Microsoft Research, Learning to Rank for Information Retrieval

Definícia je autorská odborná syntéza. Pri právnych a regulačných rozhodnutiach má prednosť aktuálne oficiálne znenie predpisu a posúdenie konkrétneho prípadu.