Тема

LLM: статьи, новости и разборы

Статьи, новости и разборы по теме «LLM»: ключевые события, понятные объяснения, практические материалы и проверенные источники COMRAD404.

В архиве 250 материалов

Материалы по теме

250 материалов
Серверные графические ускорители Nvidia H200 и AMD MI300X в стойке датацентра, используемые для инференса больших языковых моделей

Французский стартап Kog обещает ускорить инференс LLM в 10 раз на существующих GPU без дообучения моделей

Стартап Kog, вышедший из скрытого режима в мае 2026 года, утверждает, что может кардинально ускорить инференс больших языковых моделей на стандартных датацентровых GPU, таких как AMD MI300X и Nvidia H200. Компания нацелена на агентные...

Открыть материал →
Редакционная обложка COMRAD404: Локальный запуск больших языковых моделей: обзор инструментов для разработчиков

Локальный запуск больших языковых моделей: обзор инструментов для разработчиков

Разбор актуальных утилит и сред для запуска открытых LLM на персональном железе: от Ollama и Llama.cpp до MLX для Apple Silicon. Плюсы, ограничения и...

Открыть материал →
Редакционная обложка COMRAD404: Автономные агенты в разработке: об архитектуре, мультиагентных системах и ограничениях оркестрации

Автономные агенты в разработке: об архитектуре, мультиагентных системах и ограничениях оркестрации

Разбор актуальных паттернов проектирования автономных ИИ-агентов, подходов к оркестрации мультиагентных систем и ключевых технических ограничений при интеграции в рабочий процесс разработчиков.

Открыть материал →
Здание офиса компании OpenAI

Кадровые перестановки в OpenAI: уход Денис Дрессер и подготовка к масштабированию бизнеса

Главный коммерческий директор OpenAI Денис Дрессер покидает компанию на фоне череды громких кадровых изменений и подготовки к коммерческому этапу масштабирования. Новым CRO назначен Дали...

Открыть материал →
Редакционная обложка COMRAD404: Автономные AI-агенты в разработке: от экспериментов до контроля деградации контекста

Автономные AI-агенты в разработке: от экспериментов до контроля деградации контекста

Разбор практических вызовов при внедрении AI-агентов в инженерные пайплайны. Почему автономные задачи застревают в циклах, как справляться с дрейфом контекста и какие инструменты заслуживают...

Открыть материал →
Редакционная обложка COMRAD404: DeepSeek V4 Pro 0813: релиз модели через API, особенности генерации и децентрализованные утечки бенчмарков

DeepSeek V4 Pro 0813: релиз модели через API, особенности генерации и децентрализованные утечки бенчмарков

Новая языковая модель DeepSeek V4 Pro 0813 появилась в каталоге OpenRouter. Релиз сопровождается необычными особенностями работы уровней рассуждения и сложной судьбой предварительных бенчмарков в...

Открыть материал →