oMLX ускоряет локальные агенты на Mac за счет многоуровневого кэша KV

Новый сервер oMLX для Apple Silicon решает проблему медленной работы локальных LLM при работе с агентами. Инструмент переносит кэш KV на SSD и сокращает время отклика в долгих диалогах.

Открыть материал →