Исследования ИИ: технологии, модели и бенчмарки

133 материалов

Глубокие исследования искусственного интеллекта: разборы papers, моделей, бенчмарков, безопасности, регулирования и механизмов работы.

Схема трёх осей масштабирования LLM: данные, параметры и вычисления во время вывода, с влиянием на качество, стоимость и латентность

Три оси масштабирования LLM: данные, параметры и вычисления вывода

Разбираем, почему масштабирование LLM больше не сводится к росту параметров. На основе работ 2020–2025 объясняем три рычага: данные, ёмкость модели и вычисления во время...

Открыть материал →
Схема, где плавное улучшение токеновых вероятностей LLM превращается в резкий скачок итоговой точности из-за пороговой метрики и низкого разрешения оценки

«Эмерджентность — мираж?»: разбор Schaeffer et al. о внезапных способностях LLM

Schaeffer и коллеги утверждают: многие «внезапные способности» LLM могут быть не скачком модели, а эффектом метрики. Разбираем, что именно показала работа 2023 года и...

Открыть материал →