AI Act и маркировка контента: что реально изменилось 2 августа 2026 года
С 2 августа 2026 года Article 50 AI Act применяется, но он не требует видимой плашки на любом AI-материале. Разбираем обязанности provider и deployer,...
Открыть материал →Редактор по регулированию и безопасности
Анна Лебедева ведёт материалы COMRAD404 о регулировании и рисках: от новых требований к разработчикам до споров об авторском праве, приватности и маркировке синтетического контента.
В центре её разборов — первичные документы, область действия правил и реальные последствия для компаний и пользователей. Формальные нормы отделяются от рекомендаций, проектов и политических заявлений.

С 2 августа 2026 года Article 50 AI Act применяется, но он не требует видимой плашки на любом AI-материале. Разбираем обязанности provider и deployer,...
Открыть материал →
На Product Hunt появился Kin Health — сервис, который записывает разговор на приёме у врача и превращает его в короткую сводку. Технические детали, политика...
Открыть материал →
Исторический разбор работ Anthropic 2023–2024 о sycophancy: как RLHF и preference models подталкивают LLM соглашаться с пользователем даже тогда, когда это ухудшает правдивость ответа.
Открыть материал →
Разбираем работу Oxford OATML и Nature 2024 о semantic entropy — методе, который оценивает неопределённость LLM по смыслу ответов и помогает ловить часть галлюцинаций...
Открыть материал →
22 октября 2024 Anthropic показала Computer Use — режим, в котором Claude 3.5 Sonnet работает с GUI по скриншотам. Разбираем метод, OSWorld-результаты, риски и...
Открыть материал →
Разбираем работу Xu, Jain и Kankanhalli о том, почему полностью устранить галлюцинации у LLM нельзя в принципе. Что именно доказывает их формальная модель, где...
Открыть материал →
Разбираемся, что такое AI-агенты, чем они отличаются от чат-ботов, в каких задачах реально полезны и на какие ограничения закладываться перед внедрением.
Открыть материал →
Что именно генеративная модель может воспроизвести из трейна, когда это превращается в риск копирайта и почему фильтр exact match не решает проблему. Обзор ключевых...
Открыть материал →
Разбираем три главные корпоративные рамки безопасности frontier AI — Anthropic RSP, OpenAI Preparedness Framework и Google DeepMind FSF: пороги риска, evals, mitigations, governance и...
Открыть материал →
Разбираем, как DPO заменил связку reward model и PPO одним loss-функционалом и зачем затем появились KTO, ORPO и SimPO. Где упрощение реально помогает, а...
Открыть материал →
Apollo Research в конце 2024 показала, что несколько frontier-моделей способны к базовому in-context scheming в контролируемых агентных средах. Разбираем метод, результаты и почему сами...
Открыть материал →
Первый International AI Safety Report от 29 января 2025 года — это не манифест о «судьбе человечества», а карта научных согласий и разногласий о...
Открыть материал →