COMRAD404

Лента

Новости, инструменты и практика ИИ

Replay Doctor: Go-утилита для аудита скрытых сбоев кэша промптов в AI-агентах

Вышел Replay — локальный Go CLI для форензики логов AI-агентов. Инструмент выявляет момент разрыва кэша промптов, называет причину и подсчитывает перевыставленные токены по цене холодной...

Критические уязвимости в CI/CD агентах Anthropic, Google и OpenAI: RCE через GitHub Issue

Исследователи безопасности обнаружили, что стандартные конфигурации GitHub Actions для Claude Code, Gemini CLI и Codex позволяют выполнить удаленный код через неаутентифицированный GitHub Issue. Google присвоил...

Утечка Spaces-секретов: Hugging Face раскрывает детали инцидента и меняет политику токенов

Hugging Face сообщил о несанкционированном доступе к секретам платформы Spaces. В ответ компания отозвала скомпрометированные токены, внедрила KMS для управления ключами и объявила о полном...

Разобраться в теме

За чем вы следите?

Chopthin-консенсус: как сохранить разнообразие траекторий при декодировании LLM без дообучения

Метод CCPS (Chopthin-Consensus Power Sampling) предлагает новый подход к сэмплированию на этапе инференса LLM, заменяя агрессивное обнуление весов на их сбалансированное сохранение. Это повышает точность...

Трамп и Майк Джонсон отвергли призывы замедлить разработку передовых ИИ-моделей

Дарио Амодеи из Anthropic призвал сдержать темпы развития передовых ИИ-систем. Сэм Альтман, Илон Маск и Демис Хассабис отнеслись к предложению положительно, но Дональд Трамп и...

Эволюция стратегий генерации текстов: разбор алгоритмов декодирования от Hugging Face для разработчиков LLM

Команда Hugging Face обновила фундаментальное руководство по стратегиям генерации текста в библиотеке Transformers. Разбираем особенности Greedy Search, Beam Search и сэмплирования для современных языковых моделей...

Рейтинг COMRAD404

Какая модель подходит для вашей задачи?

Топ-100 моделей: качество, код, скорость и стоимость. С фильтрами и описанием методологии.

Открыть рейтинг

Саймон Виллисон выпустил утилиту commit-rewriter 0.1 для очистки истории Git от артефактов ИИ-агентов

Известный разработчик Саймон Виллисон представил утилиту commit-rewriter 0.1. Инструмент предназначен для автоматической очистки истории коммитов от служебного мусора ИИ-агентов, внутренних идентификаторов задач и черновиков перед...

Как оценивать стабильность контекста в LLM-агентах: разбор метрик, уязвимостей к «забыванию» и методов проверки

Разбираем, как длинный контекст в LLM-агентах подвергается деградации, почему стандартные тесты не видят «забывания» инструкций и какие метрики помогают измерить стабильность памяти в автономных пайплайнах.

OpenAI опубликовала System Card агента ChatGPT: архитектура, безопасность и границы возможностей

OpenAI выпустила технический отчёт о внутреннем устройстве агента ChatGPT — модели, объединяющей исследования, браузерную автоматизацию и выполнение кода. Разбираем ключевые выводы документа и что они...

MCP в Claude Desktop: безопасная настройка инструментов и собственного сервера

Практическое руководство по MCP в Claude Desktop: где находится конфигурация, как подключить файловую систему и SQLite, как передавать ключи через переменные окружения и как проверить...