ИИ и производительность программистов: что реально показали RCT по GitHub Copilot
Обзор контролируемых и полевых исследований GitHub Copilot к концу 2024 года: где действительно виден рост продуктивности, почему 55,8% нельзя переносить...
Редактор направления «Модели и evals»
В редакции COMRAD404 Ирина Волкова ведёт направление моделей и evals: следит за релизами, изменениями модельных линеек и тем, как новые возможности проявляются в реальных задачах.
В материалах сопоставляет model cards, технические отчёты, независимые тесты и ограничения методик. Основной принцип — отделять измеряемый прогресс от маркетинговых формулировок.
Обзор контролируемых и полевых исследований GitHub Copilot к концу 2024 года: где действительно виден рост продуктивности, почему 55,8% нельзя переносить...
Пошагово разбираем, как загрузить PDF в ChatGPT через окно чата, получить краткое резюме, таблицу или извлечение фактов, а затем проверить...
Пошаговая инструкция по настройке Custom Instructions в ChatGPT на web, desktop, iOS и Android: где включить персонализацию, какие лимиты символов...
Пошаговая инструкция по написанию эффективного промпта для ChatGPT: как задать цель, контекст, формат и тон, когда использовать Custom Instructions и...
Сравнение open weights и closed API на примере Llama 4, OpenAI GPT-5.6 и gpt-oss: где важнее контроль над развертыванием, где...
Сравниваем AutoGen и LangGraph для мультиагентов по одинаковым критериям: статус проекта, установка, архитектура, persistence, patterns и пригодность для новых workflow...
Сравнение GPT-4 и GPT-4o на 2026-08-13: цены API, 8k против 128k контекста, image input, structured outputs, ограничения ChatGPT и случаи,...
vLLM — self-hosted движок для инференса и сервинга больших языковых моделей. Подходит тем, кому нужен OpenAI-совместимый API и контроль над...
Google DeepMind анонсировала Gemini 3.7 Flash — модель для кодинга, веб-разработки и агентных сценариев. Заметный рост по бенчмаркам, вдвое более...
Разбираем исторический релиз GPT-5 от 7 августа 2025 года: почему «единая модель» OpenAI на деле была системой из chat-модели, reasoning-модели...
ARC-AGI часто подают как индикатор пути к AGI, но по замыслу Франсуа Шолле он измеряет более узкую вещь: насколько система...
Разбираем FLUX.1 в рамке августа–октября 2024: что выпустила Black Forest Labs, почему 12B rectified flow transformer оказался таким сильным и...