COMRAD404

Лента

Новости, инструменты и практика ИИ

Hugging Face разобрал, как считать стоимость миллиарда классификаций и эмбеддингов

В блоге Hugging Face опубликована методика оценки стоимости и производительности энкодерных моделей при более чем миллиарде запросов в сутки. Автор предлагает подбирать конфигурацию GPU, размер...

ИИ-агенты учатся изучать среду до получения задач: новый подход без syllabus

Исследователи формализовали задачу предварительной подготовки среды без знания целевых заданий. Мета-агент с архивом превзошёл фиксированные методы на пяти из шести бенчмарков, но увеличение бюджета «изучения»...

Разобраться в теме

За чем вы следите?

GoatCode v2.1.10: терминальный AI-агент с автоматическим переключением провайдеров и кэшированием промптов

Вышел GoatCode v2.1.10 — open-source терминальный AI-агент, который умеет переключать LLM-провайдера прямо во время сессии при падении квоты, не теряя контекст. Поддержка 180+ провайдеров, параллельные...

Саймон Уиллисон о кризисе разработчика: «Перевод спецификации в код больше не уникальный навык»

Создатель Datasette и LLM комментирует экзистенциальный кризис разработчиков, столкнувшихся с кодинг-агентами. Уиллисон призывает сместить фокус с написания кода на инженерию более высокого уровня.

Гэрри Тан предлагает разрешить американским open-weight-моделям дистилляцию. Это спор не только о коде, но и о власти над ИИ

Глава Y Combinator Гэрри Тан считает, что американским разработчикам стоит разрешить открыто дистиллировать закрытые frontier-модели. Его аргумент: передовые системы сами обучались на общедоступном человеческом знании....

Рейтинг COMRAD404

Какая модель подходит для вашей задачи?

Топ-100 моделей: качество, код, скорость и стоимость. С фильтрами и описанием методологии.

Открыть рейтинг

Агенты ИИ должны не просто выполнять задачи, но и быть устойчивыми: новый взгляд на оценку

arXiv:2609.10724. Исследователи предлагают оценивать ИИ-агентов не только по успешности выполнения задач, но и по двум новым параметрам: операционная устойчивость и деликатное участие. В симуляции 120...

Структурированный вывод LLM: как получать валидный JSON для агентов и автоматизации

Структурированный вывод LLM нужен там, где ответ модели сразу попадает в код: тикеты, CRM, пайплайны агентов, RAG и проверки безопасности. Разбираем, чем отличаются JSON mode,...