Garanti
MICROSOFT - Co váš model ví, ale neřekne vám to: interpretabilita pro lidi, kteří modely nasazují
- Anna Marešová (Microsoft)
Popis
Velké jazykové modely mohou dojít ke správné odpovědi ze špatných důvodů, opakovat naučenou zkratku nebo skrývat důležitý signál za přesvědčivým textem. Jak se podívat pod povrch, aniž bychom předstírali, že umíme číst modelu myšlenky? Na praktických příkladech si ukážeme, co dnes dokážou metody interpretability, jaké otázky pomáhají zodpovědět a kde mohou samy zavádět. Hlubší znalost neuronových sítí není potřeba.