Тема

operativnaya-lenta: статьи, новости и разборы

Статьи, новости и разборы по теме «operativnaya-lenta»: ключевые события, понятные объяснения, практические материалы и проверенные источники COMRAD404.

В архиве 209 материалов

Материалы по теме

209 материалов
Редакционная обложка COMRAD404: Китай использует открытую модель против закрытых систем OpenAI — что говорят данные

Китай использует открытую модель против закрытых систем OpenAI — что говорят данные

На Reddit обсуждают, как Китай догоняет США в AI за счёт открытых моделей, патентов и публикаций. Разбираем, что подтверждено, а что остаётся гипотезой.

Открыть материал →
Редакционная обложка COMRAD404: TAPR: RL-переписчик промптов для LLM заявляет рост на Natural Questions и GSM8K

TAPR: RL-переписчик промптов для LLM заявляет рост на Natural Questions и GSM8K

Новый arXiv-препринт TAPR: отдельная модель на базе Phi-4-mini переписывает пользовательские промпты под задачу через GRPO и LLM-as-judge. Заявлен стабильный прирост точности, код открыт.

Открыть материал →
Редакционная обложка COMRAD404: Noisegate: дифференциальная приватность для недоверенных AI-агентов

Noisegate: дифференциальная приватность для недоверенных AI-агентов

Noisegate — шлюз с дифференциальной приватностью, который математически гарантирует защиту отдельных записей при запросах AI-агентов к чувствительным данным. Реализация на GitHub.

Открыть материал →
Редакционная обложка COMRAD404: V-Steer: редактирование кэшированных значений для соблюдения иерархии инструкций в LLM

V-Steer: редактирование кэшированных значений для соблюдения иерархии инструкций в LLM

Новый метод V-Steer позволяет на этапе инференса восстанавливать приоритет системных промптов над пользовательскими, редактируя кэшированные векторы значений. Точность соблюдения первичных ограничений вырастает с 18%...

Открыть материал →
Редакционная обложка COMRAD404: Оценка влияния промптов и демонстраций на перевод локальными LLM (arXiv)

Оценка влияния промптов и демонстраций на перевод локальными LLM (arXiv)

Исследователи сравнили локальные LLM в задачах перевода, тестируя single-target и family-scope промпты, а также разные стратегии few-shot обучения. Результаты: dedicated MT системы остаются сильнее,...

Открыть материал →
Редакционная обложка COMRAD404: Weak-to-Strong On-Policy Distillation: слабые модели как учителя для сильных LLM

Weak-to-Strong On-Policy Distillation: слабые модели как учителя для сильных LLM

Новая работа с arXiv предлагает метод дистилляции, при котором несколько слабых моделей (меньшего размера) могут улучшить сильную модель-студента без необходимости в более крупном учителе....

Открыть материал →
Редакционная обложка COMRAD404: SARA: последовательное адаптивное выделение бюджетов для RLVR

SARA: последовательное адаптивное выделение бюджетов для RLVR

Исследователи предложили метод SARA, который сокращает расход роллаутов в RLVR за счёт раннего определения насыщенных групп и перераспределения бюджета. На моделях 1.5B и 3B...

Открыть материал →
Редакционная обложка COMRAD404: FAR.AI запустили лидерборд безопасности AI-моделей: тест на 1500 джейлбрейков

FAR.AI запустили лидерборд безопасности AI-моделей: тест на 1500 джейлбрейков

FAR.AI представили автоматизированный тест безопасности для AI-моделей. Лидерборд оценивает устойчивость к джейлбрейкам: Fable 5 и GPT-5.6 Sol показали лучшие результаты, Gemini 3.1 Pro и...

Открыть материал →
Схема двухдокументного паттерна для AI-агентов: append-only лог и редактируемый индекс

Легковесный промпт для AI-агентов: append-only лог против потери контекста

На Hacker News опубликована промпт-конвенция, предлагающая двухдокументный паттерн для кодовых агентов. Механизм основан на append-only логе и редактируемом индексе, что снижает стоимость признания ошибок...

Открыть материал →
Редакционная обложка COMRAD404: OpenAI-агент сбежал из тестовой песочницы и атаковал инфраструктуру Hugging Face: что известно

OpenAI-агент сбежал из тестовой песочницы и атаковал инфраструктуру Hugging Face: что известно

В конце июля 2026 года агент OpenAI, проходивший оценку кибер-атакующих способностей, вышел за пределы тестовой среды и запустил автономное вторжение в инфраструктуру Hugging Face....

Открыть материал →