COMRAD404

Лента

Новости, инструменты и практика ИИ

TypeSafe AI представила Jev — модель для выбора действий вместо генерации текста

Jev возвращает вероятности для заранее заданных вариантов ответа. Первые пользователи сообщают об ускорении классификации, но их тесты пока не позволяют судить о работе модели на...

Anthropic подтвердила работу биологической лаборатории с ИИ-моделями

Anthropic использует собственную лабораторию в районе залива Сан-Франциско для физических биологических экспериментов. Компания подтвердила существование площадки, но не раскрыла проекты, степень автоматизации и правила контроля.

Разобраться в теме

За чем вы следите?

GitHub Copilot обновил код-ревью: история замечаний, авторазрешение и умные сообщения коммитов

GitHub сделал новые возможности Copilot code review общедоступными: обзор pull request теперь сохраняет историю ревью, комментарии получают короткие заголовки, а исправленные замечания Copilot может разрешать...

Как тестировать tool calling в LLM перед продакшеном: набор кейсов, метрики и CI

Tool calling ломается не как обычный API: модель может выбрать не тот инструмент, пропустить вызов или передать валидный JSON с неверным смыслом. Разбираем практичный набор...

OpenAI опубликовала системную карту GPT‑4.5: что известно о новой модели

OpenAI представила GPT‑4.5 как исследовательское превью и опубликовала системную карту модели. Документ посвящён заявленным возможностям, оценке рисков и ограничениям, однако не раскрывает всех технических параметров.

Рейтинг COMRAD404

Какая модель подходит для вашей задачи?

Топ-100 моделей: качество, код, скорость и стоимость. С фильтрами и описанием методологии.

Открыть рейтинг

OpenAI обновила Moderation API: модель на базе GPT-4o проверяет текст и изображения

OpenAI представила модель модерации на базе GPT-4o для проверки текста и изображений. Компания заявляет о более точном выявлении вредоносного контента, но доступные сведения не позволяют...

LoRA на аблейтированной модели: наследуемое поведение или результат дообучения? Разбор кейса

Инженер протестировал LoRA-адаптер, обученный на модели Qwen с удалённым механизмом отказа. Результат: улучшение по целевой задаче оказалось статистически незначимым, а всё «безопасное» поведение адаптер унаследовал...

npm вводит stage-only токены: публикация пакетов через ревью, а не прямой push

GitHub представил новый тип npm-токенов, который позволяет автоматизированным пайплайнам отправлять версии пакетов на проверку, но не публиковать их напрямую. Это промежуточное решение для команд, которые...

Claude Code научился читать AGENTS.md — ещё один шаг к универсальной конфигурации агентов

Anthropic добавила в Claude Code поддержку файла AGENTS.md — он используется, если в проекте нет CLAUDE.md. Нововведение построено на системе mods и расширяет возможности настройки...

Forcefield — быстрый лёгкий AI-агент на Go для локальных моделей

Разработчик представил Forcefield — минималистичную платформу для запуска AI-агентов, написанную на Go. Инструмент ориентирован на локальные модели и не требует учётной записи или телеметрии.