Тема

operativnaya-lenta: статьи, новости и разборы

Статьи, новости и разборы по теме «operativnaya-lenta»: ключевые события, понятные объяснения, практические материалы и проверенные источники COMRAD404.

В архиве 209 материалов

Материалы по теме

209 материалов
Редакционная обложка COMRAD404: Латентная проверка фактов: ложь как направление в активациях LLM

Латентная проверка фактов: ложь как направление в активациях LLM

arXiv-препринт LaFaCt: направление «ложности» в residual stream трансформера ловит дезинформацию без дообучения и внешних баз. Результаты на LIAR и FACTors — на уровне промптинга, на AVeriTeC — скромнее.

Открыть материал →
Редакционная обложка COMRAD404: GRASP: локальный анонимизатор текста на Llama-3.1-8B и GRPO

GRASP: локальный анонимизатор текста на Llama-3.1-8B и GRPO

Новый arXiv-препринт предлагает GRASP — метод онлайн-дообучения небольшой модели для анонимизации текста на устройстве, который обходит ограничения DPO-дистилляции и работает при ~1% стоимости учителя...

Открыть материал →
Редакционная обложка COMRAD404: ИИ-стек за 27 долларов: автор треда на Reddit боится, что автоматизировал сам себя

ИИ-стек за 27 долларов: автор треда на Reddit боится, что автоматизировал сам себя

Пользователь r/artificial рассказал, как собрал микроконсалтинг на Claude, скрейпере и Zapier за $27 в месяц — и переживает, что дешёвые модели сделают его ненужным.

Открыть материал →
Редакционная обложка COMRAD404: Swarm-forge: локальная координация AI-агентов через tmux и git worktrees

Swarm-forge: локальная координация AI-агентов через tmux и git worktrees

В репозитории unclebob/swarm-forge описан локальный инструмент оркестрации AI-агентов на основе tmux, git worktrees и ролевых промптов. Разбираем рабочие ветки two-pack, four-pack и six-pack.

Открыть материал →
Редакционная обложка COMRAD404: Нейтральный текст без инструкций способен обходить защиту LLM — наблюдение с Reddit

Нейтральный текст без инструкций способен обходить защиту LLM — наблюдение с Reddit

Пользователь r/artificial описывает устойчивый сдвиг активаций в средних и поздних слоях LLM при подаче длинного безобидного текста без инструкций, который будто бы отключает RLHF-ограничения....

Открыть материал →
Редакционная обложка COMRAD404: WebFetch в Claude выдаёт модели саммари вместо источников: разбор PSA с Reddit

WebFetch в Claude выдаёт модели саммари вместо источников: разбор PSA с Reddit

Пользователь Reddit обнаружил, что WebFetch в Claude Opus 5 отдаёт модели не исходный текст, а саммари малой модели. Из-за этого в исследовании появились выдуманные...

Открыть материал →