Аудит предвзятости ИИ: все инструменты находят дискриминацию, но не могут согласовать рейтинг моделей

Исследователи проверили десять инструментов аудита предвзятости на десяти frontier-моделях. Вывод: детекция работает, но ранжирование моделей по степени предвзятости невозможно — инструменты измеряют разные конструкты.

Открыть материал →