Французский стартап Kog обещает ускорить инференс LLM в 10 раз на существующих GPU без дообучения моделей
Стартап Kog, вышедший из скрытого режима в мае 2026 года, утверждает, что может кардинально ускорить инференс больших языковых моделей на стандартных датацентровых GPU, таких как AMD MI300X и Nvidia H200. Компания нацелена на агентные...
Открыть материал →
