Аудит предвзятости ИИ: все инструменты находят дискриминацию, но не могут согласовать рейтинг моделей
Исследователи проверили десять инструментов аудита предвзятости на десяти frontier-моделях. Вывод: детекция работает, но ранжирование моделей по степени предвзятости невозможно — инструменты измеряют разные конструкты.
Открыть материал →
