FlashAttention-3: почему внимание стало быстрее на Hopper
Разбираем статью FlashAttention-3 от 11 июля 2024 года: как авторы переписали exact attention под NVIDIA Hopper, зачем нужны TMA, WGMMA и FP8, и что...
Открыть материал →Редактор исследований и методологии
София Белова ведёт исследовательское направление COMRAD404. Она разбирает статьи, препринты и отчёты так, чтобы читателю были понятны дизайн исследования, выборка, метрики и границы вывода.
Отдельное внимание уделяет темам образования, науки и общественных эффектов ИИ. Корреляции не превращаются в причинность, а предварительные результаты обозначаются как предварительные.

Разбираем статью FlashAttention-3 от 11 июля 2024 года: как авторы переписали exact attention под NVIDIA Hopper, зачем нужны TMA, WGMMA и FP8, и что...
Открыть материал →
Разбираем историческую схему Anthropic: что такое Constitutional AI, как RLAIF заменяет часть человеческой обратной связи, где метод полезен и в чём его ограничения.
Открыть материал →
Практическое сравнение AutoGen, CrewAI и LangGraph по официальным paper, блогам и документации: где живёт состояние, как устроен control flow, чем отличается human-in-the-loop и что...
Открыть материал →
Разбор paper Дарона Асемоглу о том, почему генеративный ИИ, по его оценке, даст США лишь скромный макроэффект: около +0,53–0,66% TFP и порядка +1% GDP...
Открыть материал →
Разбираем отчёт Epoch AI 2024 о «стене данных»: как авторы оценивали запас публичного человеческого текста, почему получили окно 2026-2032 и какие допущения стоят за...
Открыть материал →
Разбираем исходную работу Microsoft от 27 февраля 2024 года о BitNet b1.58: как устроена тернарная LLM, где именно появляется выигрыш по инференсу и что...
Открыть материал →
Разбираем спор вокруг термина open source в ИИ на исторической рамке OSAID 1.0 от OSI: почему открытые веса не равны открытой системе и что...
Открыть материал →
Разбираем Mobile ALOHA — работу Stanford о мобильном двуруком роботе с бюджетом $32k: как он собирает демонстрации, зачем смешивает их со статическим ALOHA и...
Открыть материал →
Разбираем позиционную статью Google DeepMind для ICML 2024: зачем ей понадобились уровни AGI, как устроены оси performance и generality, что означают уровни autonomy и...
Открыть материал →
В июне 2024 Леопольд Ашенбреннер выпустил эссе «Situational Awareness» с тезисом: AGI к 2027 году правдоподобен. Разбираем, на каких данных строится прогноз и где...
Открыть материал →
Разбираем исходную работу Sakana AI от августа 2024: что именно делает The AI Scientist, на чём он реально был показан, как устроен автоматический рецензент...
Открыть материал →
Разбираем работу ESM3 об esmGFP без медийной формулы про «500 миллионов лет эволюции»: что именно задали модели, как шёл отбор кандидатов и что реально...
Открыть материал →