Тема

hn: статьи, новости и разборы

Статьи, новости и разборы по теме «hn»: ключевые события, понятные объяснения, практические материалы и проверенные источники COMRAD404.

В архиве 101 материал

Материалы по теме

101 материал
Иллюстрация тестирования LLM API с помощью мок-сервера

Почему у LLM-API до сих пор нет нормального тестового режима — вопрос, который задали на Hacker News

Разработчики жалуются, что для нагрузочного тестирования чат-ботов приходится тратить реальные токены или писать собственные моки. На Hacker News предлагают взять пример со Stripe и внедрить официальный тестовый эндпоинт.

Открыть материал →
Схема работы Mireye: AI-агент отправляет запрос через API/MCP, получает структурированные данные, инструменты и сигналы о физическом объекте

Mireye (YC S26) строит «физический слой» для ИИ-агентов: 366 полей данных о каждом объекте в США

Стартап Ansh Chokshi превращает разрозненные данные о недвижимости, инфраструктуре и зонировании в единый API и MCP-сервер для агентов. В основе — не просто датасет,...

Открыть материал →
Лидерборд языковых моделей для игры Redactle

Redactle запустил лидерборд LLM: модели сравнивают по игре в угадывание статей

Redactle опубликовал лидерборд для языковых моделей: они угадывают скрытые заголовки статей, а результат считается по числу лишних ходов и стоимости.

Открыть материал →
Схема ускорения инференса LLM с помощью speculative decoding

NVIDIA разобрала co-design LLM для ускорения инференса через speculative decoding

NVIDIA опубликовала разбор speculative decoding как части совместного проектирования LLM: малый draft-модель предлагает токены, большая модель проверяет их параллельно, а ускорение зависит от длины...

Открыть материал →
Абстрактное изображение кибербезопасности и кода

Исследователи взломали ИИ-агентов Fortune 500 через файл llms.txt

Эксперты по безопасности выяснили, что файл llms.txt, предназначенный для инструктажа ИИ-агентов, стал вектором для атак на цепочку поставок и выполнения произвольного кода.

Открыть материал →
Скриншот отчёта Flawd с результатами мутационного тестирования

Flawd: мутационное тестирование для эпохи AI-агентов — локально и без утечки кода

Инструмент мутационного тестирования Flawd запущен как единый бинарник, работающий локально. Поддерживает Python, JS, TS, Go и Rust, не отправляет код на внешние серверы и...

Открыть материал →
Схема локального управления Markdown-документами для AI-агентов

Markdown Gatekeeper: локальный слой «истины» для Markdown-документов AI-агентов

На GitHub появился Markdown Gatekeeper — CLI-инструмент, который помогает проектам с Claude, Codex и другими агентами не плодить конкурирующие «актуальные» Markdown-документы.

Открыть материал →
Визуализация графа проекта с узлами целей, решений, рисков и требований, управляемого AI-агентом

Compilr.dev Studio: AI-агент как архитектор проекта, а не просто генератор кода

Проект Compilr.dev Studio предлагает превратить AI-агента в архитектора проекта, который записывает цели, решения, риски и требования в виде связного графа, а не просто генерирует...

Открыть материал →
Схема машиночитаемого changelog API для AI-агентов и разработчиков

API Delta Manifest предлагает машиночитаемый changelog для API и AI-агентов

На GitHub опубликована спецификация API Delta Manifest v1: JSON-манифест для описания изменений API в формате, который могут читать скрипты, IDE-агенты и команды разработки.

Открыть материал →