Запись архива

Три сигнала недели: чип OpenAI Jalapeño, слух о покупке Hugging Face Nvidia и Qwen3.8-Flash

OpenAI представила тестовый чип Jalapeño, Nvidia, по слухам, покупает Hugging Face за $12.9 млрд, а Alibaba выпустила Qwen3.8-Flash. Разбираем, что из этого подтверждено, а что — пока предмет обсуждений.

Серверная стойка с чипом OpenAI Jalapeño для инференса
Серверная стойка с чипом OpenAI Jalapeño для инференса
Редакционная тематическая обложка COMRAD404

Чип OpenAI Jalapeño: первые результаты

OpenAI объявила о результатах тестирования своего первого кастомного чипа для инференса (Jalapeño), разработанного совместно с Broadcom и Celestica. По заявлению компании, чип показывает на 50–90% более высокую пропускную способность на киловатт и снижает задержку в 1.7–3.6 раза по сравнению с Nvidia GB200/GB300. Развёртывание запланировано на конец 2026 года. Важно: это вендорские бенчмарки, независимых тестов пока нет. Сигнал — всё больше лабораторий проектируют собственный кремний для инференса, снижая зависимость от Nvidia.

Nvidia и Hugging Face: слух о покупке за $12.9 млрд

TechCrunch и Fortune сообщили, что Nvidia близка к приобретению Hugging Face за примерно $12.9 млрд. Hugging Face — нейтральный хаб для открытых моделей, датасетов и Spaces. Если сделка состоится, это вызовет вопросы о нейтральности платформы и возможном смещении в сторону железа Nvidia. Пока ни одна из сторон не подтвердила сделку официально. Это главная тема обсуждения на Reddit: пользователи опасаются, что открытая экосистема потеряет независимость.

Alibaba Qwen3.8-Flash: открытая модель с агрессивной ценой

Alibaba выпустила Qwen3.8-Flash — 125-миллиардную модель с открытыми весами, которая, по заявлению разработчиков, конкурирует с Opus 4.6 и DeepSeek V4-Flash. Цены установлены крайне низко. Qwen уже превысил 3 миллиарда загрузок, обогнав Meta и Google. Alibaba также тестирует модель разделения выручки (revenue-sharing) для крупных коммерческих пользователей. Это указывает на то, что битва за долю рынка инференса смещается в сторону открытых и дешёвых моделей.

Что это значит для разработчиков

На Reddit отмечают, что инфраструктурные раунды (Fireworks AI ~$1.5 млрд, Together AI ~$800 млн) показывают: инференс — главное событие. Стоимость токенов падает быстро. Практический совет: не фиксироваться на одном провайдере, тестировать дешёвые открытые модели на своих задачах и иметь резервного поставщика.

Punkt Detail
Что случилось OpenAI показала Jalapeño, слух о покупке HF Nvidia, Alibaba выпустила Qwen3.8-Flash
Что подтверждено Заявления OpenAI о чипе (бенчмарки от вендора), выход Qwen3.8-Flash
Что под вопросом Сделка Nvidia-Hugging Face (не подтверждена), независимые тесты Jalapeño
Ключевой сигнал Инференс дешевеет, рынок консолидируется, зависимость от одного поставщика рискованна

Источник: Reddit r/artificial (https://www.reddit.com/r/artificial/comments/1w0wf8z/). Проверка: страница новостей OpenAI (https://openai.com/news/).