LangGraph — фреймворк агентов с состоянием
LangGraph — open-source фреймворк LangChain для stateful-агентов: что умеет, как запускать локально, какие есть лимиты cloud-деплоя и где продукт не подходит.
Открыть материал →Редактор оперативной ленты
Дарья Ким ведёт оперативную ленту COMRAD404 и собирает сигналы из социальных платформ, каналов разработчиков и продуктовых сообществ. Её задача — быстро определить, где начинается новость и заканчивается пересказ чужого поста.
При подготовке публикаций сверяет первоисточник, время события, доступность функции и контекст обсуждения. Неподтверждённые детали в материалы не попадают.

LangGraph — open-source фреймворк LangChain для stateful-агентов: что умеет, как запускать локально, какие есть лимиты cloud-деплоя и где продукт не подходит.
Открыть материал →
На Product Hunt вышел Human Behavior — проект, который обещает превращать «грязные» записи сессий в готовые выводы о проблемах пользователей. Пока доступ только через...
Открыть материал →
arXiv:2608.11232v1 Announce Type: new Abstract: Evaluating LLM coding agents in algorithmic trading is difficult because static benchmarks risk data contamination and numerical backtest outputs...
Открыть материал →
Новый arXiv-препринт (2608.11342) описывает WFT — метод персональной адаптации LLM без дообучения, работающий на уровне логитов. На бенчмарках LaMP WFT приближается к SFT, используя...
Открыть материал →
Новый closed-loop бенчмарк arXiv: кодинг-агенты автономно улучшают модели мира в восьми игровых средах — успех в 63 из 64 сессий, 91% выигрышных правок носят...
Открыть материал →
На Hacker News опубликован ранний анонс проекта Drift — инструмента для интент-ориентированного версионирования изменений от AI-кодинг-агентов. Обсуждения пока нет: 1 очко, 0 комментариев. Детали...
Открыть материал →
Разработчик на Hacker News предлагает использовать V-модель в промптах для AI-агентов, чтобы бороться с падением качества кода. Разбираем тезис, статус дискуссии и что проверить...
Открыть материал →
Our company is changing its Software Development Lifecycle (SDLC). Curious to hear from others what theirs looks like overall + bottlenecks. Ours: - 1...
Открыть материал →
Show HN: CrewScore 0.6.11 сверяет промпты AI-агентов с 23 публичными гардрейлами — локально в браузере, без выгрузки текста. Медианное покрытие по выборке из 83...
Открыть материал →
Article URL: https://github.com/dynobox/dynobox Comments URL: https://news.ycombinator.com/item?id=49274758 Points: 1 # Comments: 0
Открыть материал →
Стартап YC P26 Discovered Materials представил AI-агентов для поиска новых материалов в полупроводниках. Все фронт-модели находят стабильные материалы, но рецепты лабораторного синтеза остаются слабым...
Открыть материал →
arXiv:2608.10042v1 Announce Type: new Abstract: Tool-use LLMs are increasingly asked to act on users' behalf, but existing benchmarks usually focus on profile recall, style...
Открыть материал →