Тема COMRAD404

GPU

10 материалов

Как работают локальные языковые модели на ПК: разбор инструментов и производительности

Разбор запуска локальных LLM на потребительском «железе»: обзор актуальных утилит, требования к видеокартам и оперативной памяти, а также реальные сценарии...

Аллокатор GPU, работающий с учётом приоритетов, поднимает утилизацию на 33 процентных пункта без замены оборудования

Инженеры Dharma AI опубликовали в блоге Hugging Face детальное описание аллокатора GPU, который на том же оборудовании и тех же...

Французский стартап Kog обещает ускорить инференс LLM в 10 раз на существующих GPU без дообучения моделей

Стартап Kog, вышедший из скрытого режима в мае 2026 года, утверждает, что может кардинально ускорить инференс больших языковых моделей на...