COMRAD404

Лента

Новости, инструменты и практика ИИ

ZGCM-1: открытая 7B модель для математики и агентного поиска с радикальной эффективностью обучения

Представлена ZGCM-1 — полностью открытая 7B модель, обученная с нуля. Разработчики заявляют о 4,2-кратном ускорении предобучения за счёт гибридного внимания, прогрессивного контекста до 256K и...

Классический NLP без обучения сжимает промпты на 40%: новый подход к снижению затрат на LLM

Исследователи представили детерминированный пайплайн лексического сжатия промптов, не требующий обучения и GPU. Метод позволяет сократить токены на 40% с минимальной потерей качества ответа, используя только...

Hugging Face призвала NTIA сделать документацию основой подотчетности ИИ

Hugging Face предложила американскому регулятору оценивать системы ИИ через прозрачность моделей, наборов данных и результатов проверок. Компания опирается на опыт открытых проектов BigScience и BigCode,...

Разобраться в теме

За чем вы следите?

Инженеры пишут законы: как Hugging Face превратил AI-политику в открытый датасет

Hugging Face официально оформила политическую работу как инженерную дисциплину, выложив все позиции для регуляторов в публичный датасет. Разбираемся, чем этот подход отличается от лоббизма Big...

Поиск как путь к диагнозу: новый метод RCA для долгих цепочек действий AI-агентов

Исследователи представили Continual Search — итеративный фреймворк для автоматического поиска корневых причин сбоев AI-агентов в длинных журналах выполнения. Метод заставляет LLM-судью последовательно искать пропущенные улики,...

Агенты iLands рассылали спам авторам и пытались регистрироваться в Mastodon

Агенты платформы iLands обращались к администраторам Mastodon и независимым авторам, предлагая создать аккаунты или выполнить работу за плату. Получатели сообщают о повторных регистрациях и письмах...

Рейтинг COMRAD404

Какая модель подходит для вашей задачи?

Топ-100 моделей: качество, код, скорость и стоимость. С фильтрами и описанием методологии.

Открыть рейтинг

Sakana AI представила PC-ALM — метод локального обучения, который тренирует сети до 1000 слоёв

Метод Augmented Lagrangian Predictive Coding от Sakana AI обходит ограничения классического обратного распространения, сохраняя послойные локальные обновления и достигая точности BP на глубоких архитектурах.

Автоматизация code review в GitHub Actions: как внедрить статический анализ LLM без перегрузки разработчиков

Разбираем, как настроить автоматический ревью кода через LLM в GitHub Actions, избежать ложных срабатываний, снизить затраты на токены и фильтровать шум с помощью паттернов diff-анализа.

Саймон Уиллисон назвал три инженерных текста, полезных для команд, строящих LLM-продукты

Саймон Уиллисон в комментарии на Lobste.rs выделил три статьи, повлиявшие на его инженерное мышление: о дырявых абстракциях, миграциях и карьерном маятнике инженера.

Вызов инструментов LLM: как проверить tool calling до продакшена

Вызов инструментов LLM ломается не только на JSON. Практический чек-лист для eval-набора: выбор нужного tool, валидность аргументов, отказ от лишних вызовов, ретраи и безопасные ограничения.

OpenAI выпустила Codex — облачного агента для программной инженерии на базе o3

OpenAI представила Codex — облачного агента для написания и тестирования кода на базе специализированной версии модели o3. Система обучена с подкреплением на реальных задачах, генерирует...

Как превратить legacy-код в понятную базу знаний для AI-агентов: опыт инженера стартапа

Инженер стартапа, столкнувшийся с хаосом в Lovable-MVP, делится подходом к документированию legacy-кода для AI-агентов. Вместо рефакторинга — создание «базы знаний» с бизнес-логикой, графами зависимостей и...