Claude vs DeepSeek: что выбрать для кода, документов и локального развёртывания
Практическое сравнение Claude и DeepSeek: управляемый корпоративный сервис против более гибкого и часто более дешёвого подхода с локальным запуском.
Редактор направления «Модели и evals»
В редакции COMRAD404 Ирина Волкова ведёт направление моделей и evals: следит за релизами, изменениями модельных линеек и тем, как новые возможности проявляются в реальных задачах.
В материалах сопоставляет model cards, технические отчёты, независимые тесты и ограничения методик. Основной принцип — отделять измеряемый прогресс от маркетинговых формулировок.
Практическое сравнение Claude и DeepSeek: управляемый корпоративный сервис против более гибкого и часто более дешёвого подхода с локальным запуском.
Grok 4.5 от xAI: $2/$6 за млн токенов против $5/$25 у Opus 4.8. Разбираем, почему важна не цена токена, а...
GPT-5.6 Sol в общем доступе. Дали ей задачу не для скриншота, а для проверки: реконструкция стадиона 1908 с источниками, кодом...
GPT-5.6 Sol восстановила White City Stadium 1908 на Three.js с источниками, кодом и автотестами. Разбираем цены, бенчмарки и историю с...
Google представила Gemini 1.5 Pro, модель с беспрецедентным контекстным окном до 1 миллиона токенов. Узнайте, как это меняет правила игры...
Разбираемся в многообразии локальных больших языковых моделей, их применении и подводных камнях при выборе и настройке.
Бенчмарк сам по себе мало что значит. Важнее понять, сколько стоит задача, как долго она выполняется и где модель стабильно...