OpenAI представила фреймворк для оценки наблюдаемости цепочек рассуждений ИИ-моделей
Исследователи OpenAI опубликовали набор из 13 тестов для оценки того, насколько внутренние рассуждения языковых моделей поддаются мониторингу. Результаты показывают, что анализ цепочек мыслей значительно эффективнее проверки только финальных ответов, а масштабирование RL-обучения не ухудшает...
Открыть материал →

