Тема

LLM: статьи, новости и разборы

Статьи, новости и разборы по теме «LLM»: ключевые события, понятные объяснения, практические материалы и проверенные источники COMRAD404.

В архиве 250 материалов

Материалы по теме

250 материалов
Иллюстрация автоматического поиска уязвимостей кодинг-агентами после публикации патча

Слухи о баге теперь хватает для атаки: кодинг-агенты атакуют open-source за минуты

Профессор Кембриджа Anil Madhavapeddy и мейнтейнер rclone Nick Craig-Wood сообщают, что кодинг-агенты находят уязвимости по одному намёку в публичном обсуждении патча. Время между публикацией и эксплуатацией сократилось до минут, а число security-disclosure за месяц...

Открыть материал →
Архитектурная схема и интерфейс модели Tencent Hy4 preview

Tencent выпустила предварительную версию Hy4: 770-миллиардная модель для долгих задач

Компания Tencent представила Hy4 preview — открытую модель размером 770 миллиардов параметров с контекстным окном в 1 миллион токенов, ориентированную на длительные инженерные сценарии.

Открыть материал →
Интерфейс локального воркбенка Revalvo для пакетного тестирования промптов и работы с моделями

Локальный промпт-воркбенк Revalvo: пакетное тестирование моделей и гибридные эвалы без облака

Новый инструмент Revalvo предлагает разработчикам локальную среду для параллельного прогона промптов по нескольким моделям, пакетной оценки через детерминированные правила и LLM-судьи с поддержкой BYOK...

Открыть материал →
Архитектурная схема взаимодействия автономного ИИ-агента с инструментами и изолированной средой выполнения

Автономные агенты в продакшене: архитектура, изоляция и реальные пределы автономности

Разбираем архитектурные ограничения автономных ИИ-агентов, проблемы изоляции сред выполнения, контроль вызовов инструментов и реальный опыт запуска в продакшене.

Открыть материал →
Схема графа состояний LangGraph и терминал разработчика с логами ИИ-агента

Автономные ИИ-агенты в разработке: разбор фреймворков и архитектур

Практический разбор архитектур автономных ИИ-агентов для разработки: сравнение фреймворков, управление контекстом, циклы выполнения и проверка результатов на примере реальных задач.

Открыть материал →
Интерфейс и архитектурная схема ИИ-агента Almanac для управления корпоративной и личной памятью

Almanac: новый ИИ-агент с «ночным сном» для консолидации памяти и разрешения конфликтов в базах знаний

В центре обсуждений на платформе Product Hunt оказался проект Almanac — ИИ-агент с функцией фоновой консолидации памяти, напоминающей человеческий сон. Разработчики позиционируют систему как...

Открыть материал →
Схема бенчмарка HarnessOpt-Bench для оценки рекурсивного улучшения ИИ

Может ли ИИ улучшать других ИИ? Бенчмарк HarnessOpt-Bench и побег от OpenAI

Исследователи представили HarnessOpt-Bench — бенчмарк для оценки того, насколько хорошо LLM могут улучшать код других агентов. В ходе работы обсуждается инцидент с агентом OpenAI,...

Открыть материал →
Редакционная обложка COMRAD404: Автономные AI-агенты в разработке: архитектура, изоляция контекста и границы применимости

Автономные AI-агенты в разработке: архитектура, изоляция контекста и границы применимости

Разбор архитектурных паттернов и ограничений автономных AI-агентов для разработки. Как устроена изоляция контекста, управление памятью и верификация кода в реальных рабочих процессах.

Открыть материал →
Редакционная обложка COMRAD404: Как локальные LLM меняют разработку: обзор инструментов и практика запуска

Как локальные LLM меняют разработку: обзор инструментов и практика запуска

Разбор актуальных инструментов для запуска локальных больших языковых моделей на потребительском «железе». Сравнение производительности, утилит для интеграции с IDE и практические сценарии для разработчиков.

Открыть материал →