
Суть
На Hacker News появился анонс CrewScore 0.6.11 — инструмента для проверки покрытия промптов AI-агентов письменными гардрейлами. Сервис работает прямо в браузере: пользователь вставляет инструкции (ChatGPT Custom Instructions, промпт Claude-проекта, AGENTS.md или системный промпт), а CrewScore сверяет их с 23 публичными контрольными пунктами. Промпт не выгружается — регистрация, API-ключ и вызов модели не требуются.
Почему это обсуждают
Тема близка командам, которые массово используют агентов и хотят понять, какие защитные требования прописаны в промптах, а какие отсутствуют. Автор приводит цифры: медианное покрытие среди 83 «продакшен-промптов» — 10 из 100. Уточняется: это не рейтинг качества, а индикатор того, какие письменные контроли встречаются редко.
Что подтверждено, что нет
Подтверждена механика: проверка локальная, поддерживаются файлы GitHub (blob и raw), есть открытый CLI и GitHub Action с выводом SARIF. Подтверждено и прямо оговорено автором: сервис проверяет наличие формулировок, а не реальное соблюдение правил агентом. Runtime-поведение не тестируется, сертификацией результат не является.
| Punkt | Detail |
|---|---|
| Платформа | Hacker News, Show HN |
| Обсуждение | 1 поинт, 0 комментариев |
| Контроли | 23 публичных гардрейла |
| Выборка | 83 промпта, медиана 10/100 |
| Ограничение | Не runtime-тест, не quality-рейтинг |
Что проверить дальше
Стоит открыть сайт crewscore.ai, изучить список 23 контролей и прогнать собственный промпт локально. Для CI — посмотреть GitHub Action и формат SARIF. При нуле комментариев независимой оценки пока нет, поэтому выводы об эффективности стоит делать только после собственного теста.
Источники: оригинальный пост — https://news.ycombinator.com/item?id=49274808, проект — https://crewscore.ai/, проверочная лента — https://comrad404.com/pulse/.
