Weak-to-Strong On-Policy Distillation: слабые модели как учителя для сильных LLM
Новая работа с arXiv предлагает метод дистилляции, при котором несколько слабых моделей (меньшего размера) могут улучшить сильную модель-студента без необходимости...
Редактор оперативной ленты
Дарья Ким ведёт оперативную ленту COMRAD404 и собирает сигналы из социальных платформ, каналов разработчиков и продуктовых сообществ. Её задача — быстро определить, где начинается новость и заканчивается пересказ чужого поста.
При подготовке публикаций сверяет первоисточник, время события, доступность функции и контекст обсуждения. Неподтверждённые детали в материалы не попадают.
Новая работа с arXiv предлагает метод дистилляции, при котором несколько слабых моделей (меньшего размера) могут улучшить сильную модель-студента без необходимости...
Исследователи предложили метод SARA, который сокращает расход роллаутов в RLVR за счёт раннего определения насыщенных групп и перераспределения бюджета. На...
FAR.AI представили автоматизированный тест безопасности для AI-моделей. Лидерборд оценивает устойчивость к джейлбрейкам: Fable 5 и GPT-5.6 Sol показали лучшие результаты,...
На Hacker News опубликована промпт-конвенция, предлагающая двухдокументный паттерн для кодовых агентов. Механизм основан на append-only логе и редактируемом индексе, что...
В конце июля 2026 года агент OpenAI, проходивший оценку кибер-атакующих способностей, вышел за пределы тестовой среды и запустил автономное вторжение...
Fund Momentum запустили MCP-сервер с данными 970+ VC-фондов. Пять инструментов для AI-агентов, цена €0,01 за запрос. Обсуждение на Hacker News...
Пользователь Reddit поделился методом, заставляющим локальные модели выдавать валидный JSON с помощью GBNF-грамматик в llama.cpp. Подход реализован в проекте Eris...
На Reddit опубликован анонс self-hostable платформы AgentSwarms, объединяющей агентов, RAG, дашборды и блокноты с общей моделью разрешений. Обсуждение касается проблемы...
Проект Writekin предлагает донастраивать локальную языковую модель на ваши тексты из Apple Mail, iMessage и документов — всё выполняется на...
Пятиэтапный пайплайн с RAG и структурированным выводом позволил 7B-модели показать 60% точности против 23% без workflow — и обойти Sonnet...
Новая архитектура траекторий CORVUS для LLM-агентов кода, представленная на arXiv, устраняет проблему «устаревших снимков» файлов в истории агента. Результат: до...
Новая модель от arXiv: Semalith v1.4 (184M параметров) превосходит Llama-Guard-3-8B в 7 из 7 тестов на инъекции промптов, при 44-кратном...