Запись архива

State of AI Report 2024–2025: что изменилось за год

Сравниваем State of AI Report 2024 и 2025 по первоисточникам Air Street и связанным документам: как фокус сместился от сближения frontier-моделей и капитализации к reasoning, внедрению, энергетике и промышленной политике.

Сравнительная схема State of AI Report 2024 и 2025 по блокам research, industry, politics, safety и survey

9 октября 2025 года Air Street выпустила восьмой State of AI Report, а 10 октября 2024 года — седьмой. Если читать эти два издания подряд, видно не просто обновление списка моделей и компаний, а смену самой оптики: от разговора о сближении frontier-лабораторий и первых крупных выручках — к разговору о reasoning-моделях, реальном использовании, энергетике и промышленной политике.

Это важно уточнить по датам. Ниже мы сравниваем именно издания от 10 октября 2024 года и 9 октября 2025 года, а не подменяем их более поздними тезисами 2026 года. Более свежие источники используются только там, где они помогают проверить или прояснить рамку, предложенную в отчёте 2025 года.

Коротко

  • Главный сдвиг между двумя выпусками — переход от рамки consolidation к рамке reasoning got real: в 2024 году reasoning ещё описывается как emerging frontier, в 2025-м — как центральный режим развития моделей и агентов.
  • В 2025 году отчёт меняет и метод наблюдения: к блокам research/industry/politics/safety/predictions добавляется отдельный survey-раздел с данными по использованию ИИ практиками.
  • Коммерческий фокус смещается от капитализации и «мегараундов» к paid adoption, контрактам, capability-per-dollar и инфраструктуре. ИИ в отчёте 2025 года описывается уже не как чисто софтверный цикл, а как промышленная система.
  • Безопасность уходит от общих споров о «конце света» к более операционным вопросам: deceptive reasoning, monitorability, cyber resilience и управляемость агентных систем.
  • Для практиков это означает, что сравнивать нужно уже не только «лучшую модель», а связку из модели, reasoning-режима, цены вывода, инструментов, внутренних evals и инфраструктурных ограничений.

Контекст

State of AI выходит ежегодно с 2018 года и задуман как системный обзор исследований, коммерциализации, политики и эффектов ИИ. Это важно помнить, потому что отчёт Air Street — не новостная лента и не академический мета-анализ. Это кураторская сборка, где авторы пытаются зафиксировать, что именно стало главным в прошедшем цикле.

В этом смысле сравнение двух соседних изданий особенно полезно. На странице запуска отчёта 2024 года Air Street прямо называет тот период годом consolidation: модели продолжали улучшаться, но акцент уже смещался к тому, как превратить capability в продукт и как жить с физическими ограничениями инфраструктуры. На странице запуска отчёта 2025 года формулировка уже иная: если 2024-й был годом консолидации, то 2025-й — годом, когда reasoning «стал реальным» и начал перестраивать и исследования, и бизнес.

Именно поэтому тема «что изменилось за год» здесь не сводится к вопросу «какая лаборатория впереди». Куда важнее то, что сам объект измерения у отчёта изменился: от гонки моделей — к системе внедрения, вычисления и контроля.

Метод

В основе разбора — четыре официальных материала Air Street: страницы запуска и обзорные страницы отчётов 2024 и 2025, а также страницы State of AI Report 2024 и State of AI Report 2025. Для проверки ключевых тезисов мы добавили первичные внешние источники: официальный материал OpenAI по o1, технический отчёт DeepSeek-R1, данные Ramp по платному использованию ИИ, материалы DOE по энергопотреблению дата-центров, а также работы Anthropic и OpenAI по alignment faking и monitorability.

Мы сознательно не «обновляем» тезисы Air Street до состояния августа 2026 года. Если в 2025 году авторы отчёта делают срез и дают собственную рамку, нас интересует прежде всего, как именно эта рамка сдвинулась относительно 2024 года.

Результаты

Ось Выпуск 2024 Выпуск 2025 Что изменилось
Главная рамка Консолидация, сближение frontier-лабораторий, возврат OpenAI в лидеры через o1 Reasoning как центральный режим развития моделей и агентов От сравнения «кто догнал GPT-4» к сравнению способов рассуждения и длительных задач
Структура отчёта Research, Industry, Politics, новый Safety, Predictions Те же блоки плюс отдельный Survey Появляется собственный эмпирический слой про внедрение и паттерны использования
Коммерческий фокус Капитализация, bull market, первые серьёзные выручки, вопросы устойчивости Paid adoption, capability-per-dollar, контракты, рост AI-first компаний От финансового нарратива к нарративу использования и unit economics
Инфраструктура Физические ограничения уже заметны: power, water, land Power становится явным bottleneck; multi-GW дата-центры — часть основной истории ИИ описывается как промышленная система, а не только как software wave
Геополитика Санкции не остановили рост китайских моделей Китайские reasoning- и coding-модели оформляются как «credible #2» От разговора про ограничения — к разговору про полноценного второго полюса
Безопасность Остывание экзистенциального дискурса, jailbreaks, misuse Alignment faking, monitorability, cyber resilience, практические safeguards От абстрактного «AI safety» к вопросам наблюдаемости и контроля поведения

1. Research: reasoning из подтемы превратился в организующий принцип

В издании 2024 года reasoning уже занимает заметное место, но подаётся как новая ось фронтира: Air Street пишет о planning и reasoning как приоритете исследований, а прорыв OpenAI связывает именно с запуском o1 12 сентября 2024 года. В официальном материале OpenAI эта серия прямо описана как модели, которые «тратят больше времени на размышление перед ответом». Для отчёта 2024 года это важный сигнал: frontier снова начинает различаться не только масштабом предобучения, но и тем, что происходит во время вывода.

В 2025 году это уже не просто сигнал, а основная логика периода. На странице запуска отчёта Air Street пишет, что reasoning стал реальным режимом конкуренции: OpenAI, Google, Anthropic и DeepSeek выпустили системы, способные проходить через сложные задачи с планированием, проверкой и рефлексией. Здесь хорошо стыкуется публикация DeepSeek-R1 от 22 января 2025 года, где reasoning связывается с RL-посттренингом и открытыми дистиллятами на базе Qwen и Llama. Иными словами, за один год reasoning прошёл путь от frontier-функции к новой общей архитектуре соревнования.

Ещё один побочный эффект этой смены рамки: в 2025 году отчёт заметно меньше интересуется разовым лидерством на одном leaderboard и заметно больше — длинными траекториями решения задач, агентными окружениями и прикладными доменами вроде науки, кода и роботики.

2. Industry: в 2024-м считали капитализацию, в 2025-м — использование

Один из центральных тезисов издания 2024 года — совокупная enterprise value AI-компаний достигла $9T, а некоторые компании начали получать серьёзную выручку. На странице запуска 2024 года акцент тоже именно такой: OpenAI, ElevenLabs и Synthesia уже не просто демонстрации возможностей, а компании с реальным спросом. Это всё ещё разговор о том, доказал ли рынок, что вокруг foundation-моделей можно строить бизнес.

В 2025 году оптика становится намного приземлённее. На обзорной странице отчёта Air Street пишет, что 44% американских компаний уже платят за AI-инструменты, а новый опрос отчёта охватывает 1,200 практиков; из них 95% используют ИИ дома или на работе, а 76% платят за инструменты из собственного кармана. Здесь важно не только само число, но и тип числа: речь уже не о стоимости публичных компаний, а о paid adoption и рабочем поведении пользователей.

Внешняя проверка этого поворота у отчёта есть. В Spring 2025 Business Spending Report Ramp уже фиксировал рост платного использования ИИ бизнесом, а в материале Will Big Tech’s AI spending pay off? писал, что за AI-сервисы платит уже почти половина компаний в выборке. Это не доказывает все частные цифры Air Street, но хорошо подтверждает общий сдвиг: в 2025 году ИИ для бизнеса измеряется не только рынком капитала, но и платёжными транзакциями.

3. Infrastructure: power из фонового ограничения превращается в центральное

Инфраструктурная тема уже есть в запуске 2024 года: Air Street прямо пишет о power, water и land как о реальных физических ограничениях масштабирования. Но в 2025 году эта тема перестаёт быть фоном и становится одной из главных сюжетных линий: multi-GW дата-центры, суверенные фонды, национальные compute-backbones и политика размещения мощностей.

Это смещение хорошо выглядит не только как редакционная мода. В 2026 году U.S. Department of Energy и страница Artificial Intelligence | Department of Energy уже цитируют сценарий, в котором дата-центры могут потреблять до 9% электроэнергии США к 2030 году против 4% в 2023 году. Поэтому поворот отчёта 2025 к энергии — не украшение нарратива, а реакция на то, что frontier AI всё больше упирается в электроэнергию, сети, землю и разрешительные процедуры.

Для практиков этот сдвиг особенно важен, потому что он связывает seemingly separate decisions: выбор модели, latency, reasoning-budget, стоимость инференса и регион развёртывания теперь влияют друг на друга сильнее, чем в 2024 году.

4. Politics и safety: меньше общей философии, больше наблюдаемости поведения

В 2024 году Air Street уже фиксирует охлаждение экзистенциального дискурса и одновременно говорит о продолжающихся исследованиях уязвимостей, misuse и провалах «универсальных» jailbreak-fix. Это важный переходный момент: спор о рисках никуда не исчезает, но его тон становится менее декларативным.

В 2025 году эта линия доходит до более операциональной формы. Отчёт говорит не только о политике и регулировании, но и о конкретных проблемах вроде deceptive reasoning, cyber resilience и напряжения между capability и transparency. Это хорошо ложится на первичные исследования периода: работа Anthropic и Redwood Alignment faking in large language models, опубликованная 18 декабря 2024 года, показывает эмпирический пример alignment faking; а OpenAI в Evaluating chain-of-thought monitorability от 18 декабря 2025 года уже обсуждает, насколько наблюдаемы reasoning-траектории и какой «налог на monitorability» приходится платить ради контроля.

Это, пожалуй, самый зрелый сдвиг между двумя выпусками: безопасность в 2025 году описывается уже не как отдельная моральная надстройка над capability race, а как вопрос проектирования evals, интерфейсов наблюдения и процедур развёртывания.

Интерпретация

Наш комментарий

На наш взгляд, главное изменение между выпусками 2024 и 2025 состоит не в том, что «появились новые модели», а в том, что сама единица анализа стала сложнее. В 2024 году ещё можно было спорить в логике: кто ближе к GPT-4, насколько устойчивы выручки, не схлопнется ли open-vs-closed gap. В 2025 году этого уже недостаточно.

Для инженеров и продактов это меняет практику выбора ИИ-стека минимум в четырёх точках.

  • Во-первых, leaderboard уже не равен пригодности. Нужно смотреть на горизонт задачи: один шаг, много шагов, tool use, verification, rollback, self-correction.
  • Во-вторых, стоимость reasoning становится частью продукта. Если модель выигрывает только при длинном тестовом размышлении, это вопрос не только качества, но и latency, цены и UX.
  • В-третьих, внутренние evals становятся важнее публичных бенчмарков. Чем больше рынок уходит в агентность и доменные workflows, тем меньше достаточно одной публичной таблицы.
  • В-четвёртых, инфраструктура перестаёт быть чужой проблемой. Power, доступность кластеров, vendor lock-in и регион развёртывания всё чаще влияют на то, какие фичи вообще можно довести до продакшена.

Именно поэтому отчёт 2025 года полезно читать не как рейтинг победителей, а как карту того, какие зависимости между моделями, вычислением, использованием и политикой уже нельзя игнорировать.

Ограничения

  • Это кураторский, а не нейтральный документ. Air Street сама подчёркивает, что отчёт — curated compilation. Он полезен как synthesis, но не как полный переписной лист всего поля.
  • У отчёта есть редакционный угол зрения. Air Street — инвестиционная и аналитическая среда, поэтому некоторые темы естественно получают больше внимания: коммерциализация, экосистемы, геополитика, инфраструктура.
  • Survey-раздел 2025 года не является случайной выборкой всего рынка. Он ценен как окно в поведение практиков, но не равен национальной статистике пользователей ИИ.
  • Часть бизнес-метрик приходит из внешних источников. Например, показатели paid adoption и часть коммерческих тезисов опираются на Ramp и Standard Metrics, а не на полностью открытые сырые данные Air Street.
  • Сравнение 2024 и 2025 фиксирует редакционный сдвиг между октябрём 2024 года и октябрём 2025 года. Это не полный итог 2026 года и не проверка всех прогнозов отчёта задним числом.

Заключение

Если свести разницу между двумя выпусками к одной фразе, она звучит так: в 2024 году State of AI ещё в основном описывал гонку моделей и первых бизнес-моделей вокруг них, а в 2025 году — уже систему производства ИИ. В этой системе важны reasoning, платное использование, power constraints, суверенная инфраструктура и наблюдаемость поведения моделей.

Для практиков это полезный сигнал. Следующий цикл выбора технологий, вероятно, будет выигрывать не тот, кто просто возьмёт «лучшую модель месяца», а тот, кто лучше соберёт связку из модели, режима вывода, инструментов, evals и инфраструктуры под конкретный workflow.

Источники

FAQ

Нужно ли читать оба отчёта целиком?

Если вам нужен общий сдвиг рамки — не обязательно. Но если вы работаете с внедрением ИИ в компании, разделы Industry, Safety и Survey в версии 2025 года стоит посмотреть первыми.

Какое одно изменение между 2024 и 2025 годами самое важное?

Переход от логики «кто ближе к frontier» к логике «как reasoning, инференс и инфраструктура меняют практическую ценность модели».

Значит ли это, что публичные бенчмарки больше бесполезны?

Нет. Но после 2025 года их явно недостаточно без внутренних evals, проверок на длительные задачи, стоимости вывода и наблюдаемости поведения модели.

Почему в статье есть источники 2026 года, если сравнение только 2024 и 2025?

Они нужны не для подмены исторического среза, а для независимой проверки отдельных рамок отчёта 2025 года — например, темы энергопотребления дата-центров.

Читайте также