Исследования ИИ: технологии, модели и бенчмарки

133 материалов

Глубокие исследования искусственного интеллекта: разборы papers, моделей, бенчмарков, безопасности, регулирования и механизмов работы.

Схема test-time compute: оценка сложности запроса, выбор политики бюджета, генерация нескольких кандидатов, проверка verifier'ом или тестами, ревизии и остановка по лимиту

Test-time compute: почему вычисление во время ответа стало новой осью масштабирования

Test-time compute — это отдельный дизайн вычислений на этапе ответа: sampling, ревизии, verifier и поиск. Разбираем, как работы 2024 года превратили эту идею в...

Открыть материал →
Схема работы Gemini 1.5: мультимодальный вход, длинное окно контекста, MoE-маршрутизация, context caching и текстовый ответ

Gemini 1.5 и окно в 1–10 млн токенов: что это значило на практике

Разбираем исторический срез Gemini 1.5 в 2024 году: что Google DeepMind реально открыла разработчикам, где заканчивался продуктовый лимит и где начинался исследовательский стресс-тест на...

Открыть материал →