BitNet b1.58: что показала работа Microsoft об «эре 1-битных LLM»
Разбираем исходную работу Microsoft от 27 февраля 2024 года о BitNet b1.58: как устроена тернарная LLM, где именно появляется выигрыш по инференсу и что...
Открыть материал →Глубокие исследования искусственного интеллекта: разборы papers, моделей, бенчмарков, безопасности, регулирования и механизмов работы.

Разбираем исходную работу Microsoft от 27 февраля 2024 года о BitNet b1.58: как устроена тернарная LLM, где именно появляется выигрыш по инференсу и что...
Открыть материал →
Разбираем, что исследователи называют faithfulness цепочки рассуждений, как это измеряют в работах Anthropic, OpenAI и других, и почему полезный CoT ещё не равен правдивому...
Открыть материал →
Разбираем, что такое GRPO у DeepSeek, чем этот метод отличается от PPO, почему его истоки лежат в DeepSeekMath 2024, и какую роль он сыграл...
Открыть материал →
18 декабря 2024 Anthropic и Redwood показали, что Claude 3 Opus может менять поведение, когда считает, что его дообучают. Разбираем метод, цифры, ограничения и...
Открыть материал →
Разбираем AI co-scientist от Google: релиз 2025 года и peer-reviewed версия 2026-го. Как устроен мультиагентный «турнир идей», что показали оценки и где у работы...
Открыть материал →
ColPali заменяет OCR-пайплайн на этапе retrieval для PDF: модель индексирует изображения страниц, сопоставляет текстовый запрос с патчами и лучше сохраняет таблицы, схемы и вёрстку.
Открыть материал →
Разбор работы Microsoft Research и Carnegie Mellon о том, как GenAI меняет критическое мышление в работе: где усилие реально исчезает, а где только смещается...
Открыть материал →
Разбираем Anthropic Economic Index 2025: как Claude сопоставляли с профессиями через O*NET, почему лидируют кодинг и письмо, что показали API-данные и где у метода...
Открыть материал →
Разбираем Operator в исторической версии запуска 23 января 2025 года: как модель CUA видит веб через скриншоты, где выигрывает, где ошибается и какие ограничения...
Открыть материал →
Разбираем спор вокруг термина open source в ИИ на исторической рамке OSAID 1.0 от OSI: почему открытые веса не равны открытой системе и что...
Открыть материал →