Тема COMRAD404

JSON Schema

4 материалов

Релизный шлюз для LLM-инструментов: как проверять вызовы до запуска

Практическая схема тестирования LLM-инструментов перед релизом: сценарии, проверка аргументов, метрики выбора функций, повторные прогоны и безопасный CI без выполнения реальных...

Контрактные тесты для вызова инструментов LLM: как поставить релизный барьер в CI

Практическая схема проверки вызовов инструментов в AI-агентах: контракты на основе JSON Schema, метрики выбора функций и аргументов, негативные сценарии, повторные...

Агенты ИИ: функциональные вызовы в LLM — сравнение OpenAI, Anthropic и open-source на практике

Сравнительный обзор реализации function calling у OpenAI, Anthropic и open-source библиотек. Практические примеры, таблица характеристик, типичные ошибки и рекомендации по...