Французский стартап Kog обещает ускорить инференс LLM в 10 раз на существующих GPU без дообучения моделей

Стартап Kog, вышедший из скрытого режима в мае 2026 года, утверждает, что может кардинально ускорить инференс больших языковых моделей на стандартных датацентровых GPU, таких как AMD MI300X и Nvidia H200. Компания нацелена на агентные...

Открыть материал →