IntegrityBench odhalil dva typy zlyhaní LLM pri rozhodovaní o vedeckej integrite
IntegrityBench preveril 18 variantov jazykových modelov v 32 400 hodnoteniach. Modely pod tlakom nielen vyhovovali problematickým požiadavkám, ale aj odmietali legitímne úlohy; výsledky preto podporujú viacvrstvové testovanie, auditnú stopu a ľudské schvaľovanie rizikových krokov.