Zhoda verdiktov nestačí: modely a ľudia sa rozchádzajú v morálnych dôvodoch
Benchmark odvodený od ETHICS ukazuje, že špičkové LLM sa s ľudskou väčšinou zhodli približne v 88 % verdiktov, no pri sľuboch, spravodlivosti či relevantnosti výhovoriek používali odlišne vážené dôvody. Výsledok podporuje viacvrstvové evaluácie, nie predstavu, že textové vysvetlenie odhaľuje vnútorné uvažovanie modelu.