COMRAD404

Лента

Новости, инструменты и практика ИИ

RLT предлагает переносить состояние декодера между токенами — пока без кода и тестов

В техническом описании Recurrent Looped Transformer предложена архитектура, которая сохраняет финальное состояние рекуррентного декодера между токенами. Конфигурация с 48 слоями энкодера и 48 слоями декодера...

Агенты на экране: кто реально использует Claude Code, GPT-6 Astra и Meta Muse в ежедневной работе

На Hacker News развернулась дискуссия о реальной пользе screen-aware AI-агентов. Разработчики делятся опытом использования Claude Code, HeyClicky, GPT-6 Astra и Meta Muse, пытаясь отделить хайп...

Hugging Face подводит итоги безопасности за 2024 год: fine-grained токены, SSO и обязательный аудит репозиториев

Hugging Face опубликовала сводку мер безопасности за 2024 год: от fine-grained токенов и GPG-подписи коммитов до корпоративного SSO и автоматического сканирования репозиториев. Разбираем, что изменилось...

Разобраться в теме

За чем вы следите?

Сэм Альтман исключил IPO OpenAI в 2026 году

OpenAI не планирует выходить на биржу в 2026 году. Сэм Альтман объяснил отсрочку вопросами безопасности, готовностью бизнеса и общественными рисками, связанными с развитием ИИ.

Модель знала ответ, но молчала: исследователь показал, как ИИ управляет гранью между знанием и отказом

Исследователь продемонстрировал, что языковая модель может содержать правильный ответ на токенном уровне, но не выдавать его из-за работы отдельного «шлюза разрешения» — небольшой нейросети, которая...

Рейтинг COMRAD404

Какая модель подходит для вашей задачи?

Топ-100 моделей: качество, код, скорость и стоимость. С фильтрами и описанием методологии.

Открыть рейтинг

Один эндпоинт, разные результаты: почему OpenRouter может менять поведение LLM

OpenRouter автоматически выбирает бэкенд для запроса к языковой модели, но разные провайдеры используют собственное серверное ПО и настройки. Это может повлиять на vision, reasoning и...

Как настроить кастомные инструменты для Claude Code: практическое руководство по расширению возможностей агента

Claude Code от Anthropic позволяет подключать собственные инструменты через MCP-протокол и shell-команды. Разбираем, как добавить кастомные утилиты, поиск по базе знаний и интеграцию с внешними...

«AI не злой. Люди безответственны» — разбор инцидентов OpenAI и Anthropic

В Reddit набирает обороты пост, в котором утверждается: последние «побеги» AI-агентов — не признаки сознания, а следствие халатности разработчиков. Разбираем реальные инциденты OpenAI и Anthropic...

Hugging Face обошла GAIA: кодовые агенты без JSON и песочница для Python из коробки

Инженеры Hugging Face представили библиотеку smolagents для создания ИИ-агентов, выполняющих задачи через генерацию Python-кода и безопасный песочный интерпретатор. Разработка заняла первое место в комплексном бенчмарке...

Как оценивать стабильность контекста в LLM-агентах: разбор метрик, уязвимостей к «забыванию» и методов проверки

Разбираем, как измерять сохранение контекста в автономных LLM-агентах при длительных сессиях, почему стандартное окно токенов не гарантирует устойчивость рассуждений и как настраивать верификацию памяти в...