Тема COMRAD404

reasoning модели

7 материалов

OpenAI представила фреймворк для оценки наблюдаемости цепочек рассуждений ИИ-моделей

Исследователи OpenAI опубликовали набор из 13 тестов для оценки того, насколько внутренние рассуждения языковых моделей поддаются мониторингу. Результаты показывают, что...

Может ли текущая архитектура LLM привести к AGI? Мнение инженера-практика

Инженер-программист с двадцатилетним стажем ставит под сомнение способность современных LLM достичь AGI. Он анализирует фундаментальные ограничения авторегрессивной генерации и приходит...

OpenAI представила o1 с «цепочкой мыслей»: что изменилось в генерации рассуждений

Модель OpenAI o1 использует внутреннюю «цепочку мыслей» для решения сложных задач. Разбираем архитектурные особенности, тесты производительности и ограничения новой парадигмы...