ChatGPT vs Claude: что выбрать
Сравниваем ChatGPT и Claude по тарифам, геодоступности, приватности, API и прозрачности изменений на 13.08.2026. Только подтверждённые условия и сценарный вердикт...
Редактор направления «Модели и evals»
В редакции COMRAD404 Ирина Волкова ведёт направление моделей и evals: следит за релизами, изменениями модельных линеек и тем, как новые возможности проявляются в реальных задачах.
В материалах сопоставляет model cards, технические отчёты, независимые тесты и ограничения методик. Основной принцип — отделять измеряемый прогресс от маркетинговых формулировок.
Сравниваем ChatGPT и Claude по тарифам, геодоступности, приватности, API и прозрачности изменений на 13.08.2026. Только подтверждённые условия и сценарный вердикт...
Исторический разбор DeepSeek-V3 конца 2024 года: что означают 671B/37B, откуда взялась цифра $5.576M, какие инженерные решения дали выигрыш и где...
Обзор трёх линий ускорения вывода LLM из окна 2023–2024: классического speculative decoding, Medusa и EAGLE. Разбираем механику, цифры, гарантии точности...
Разбираем, что на самом деле показал релиз Claude 3 от 4 марта 2024 года: где Opus вышел на уровень GPT-4,...
Выход Grok 4.6 и обновление экосистемы агентов: главное из августовского дайджеста Latent Space
Разбор Contextual Retrieval от Anthropic: зачем добавлять к каждому чанку короткий машинно-сгенерированный контекст, как это влияет на embeddings, BM25 и...
Разбираем, как устроен SWE-bench Verified: из чего он вырос, что именно измерял у coding-агентов, почему его цифры часто сравнивали некорректно...
Новая языковая модель DeepSeek V4 Pro 0813 появилась в каталоге OpenRouter. Релиз сопровождается необычными особенностями работы уровней рассуждения и сложной...
Объясняем, что на самом деле показала работа Chinchilla от 29 марта 2022 года, почему многие LLM были недообучены по токенам...
Разбираем, как Chatbot Arena превращает анонимные парные сравнения в «Arena Elo», почему на деле это Bradley–Terry, и зачем LMSYS отдельно...
Исторический обзор 2024 года: чем Suno и Udio как генераторы музыки отличались от голосового GPT‑4o, какие режимы управления они дали...
Разбираем три ключевых подхода к низкобитной работе с LLM — GPTQ, AWQ и QLoRA: что именно они квантуют, для чего...