Запись архива

Релиз llm-gemini 0.34: поддержка Gemini 3.8 Flash и новые уровни «мышления»

Вышло обновление плагина llm-gemini 0.34 для инструмента командной строки LLM. Главное новшество — поддержка модели Gemini 3.8 Flash с тремя уровнями глубины рассуждений. Обновление также исправляет ошибку асинхронных ответов.

Сравнение изображений пеликанов, сгенерированных моделями Gemini 3.8 Flash и Gemini 3.7 Flash, демонстрирующее разницу в качестве.
Сравнение изображений пеликанов, сгенерированных моделями Gemini 3.8 Flash и Gemini 3.7 Flash, демонстрирующее разницу в качестве.
Изображение из исходного материала

Саймон Уиллисон (Simon Willison), создатель инструмента командной строки LLM, выпустил версию 0.34 плагина llm-gemini. Главное изменение — поддержка свежей модели Google Gemini 3.8 Flash, которая была представлена 2 сентября 2026 года. Новая версия плагина позволяет разработчикам и энтузиастам AI работать с моделью прямо из терминала, выбирая один из трёх уровней глубины рассуждений.

Ключевые факты

Параметр Значение
Версия плагина llm-gemini 0.34
Новая модель Gemini 3.8 Flash (gemini-3.8-flash)
Уровни мышления low, medium, high
Основное исправление Асинхронные ответы теперь корректно фиксируют версию модели
Дата релиза 2 сентября 2026 года

Что нового в llm-gemini 0.34

Основная функциональность обновления — поддержка модели gemini-3.8-flash. Google позиционирует Gemini 3.8 Flash как быструю и недорогую модель, способную на генерацию сложного кода, включая HTML и JavaScript. В рамках обновления плагин получил три уровня «мышления» (thinking levels): low, medium и high. Это позволяет пользователю выбирать, насколько глубоко модель будет анализировать запрос перед выдачей ответа.

Кроме того, исправлена ошибка, при которой асинхронные ответы (async responses) не записывали разрешённую версию модели. Исправление внесено разработчиком Чарли Тоннесланом (Charlie Tonneslan) и задокументировано в запросе #137.

Демонстрация возможностей Gemini 3.8 Flash

Саймон Уиллисон привёл несколько примеров работы Gemini 3.8 Flash. В частности, он сравнил генерацию изображений пеликанов на моделях Gemini 3.8 Flash и Gemini 3.7 Flash. Разница в качестве, по его словам, заметна невооружённым глазом.

Также Уиллисон протестировал модель на создание веб-интерфейсов. Он задал модели промпт «сделай мне крутую штуку на HTML» (make me a cool thing in html). Gemini 3.8 Flash сгенерировала рабочий HTML-документ с интерактивными элементами. Время выполнения составило 13 секунд, стоимость — 1,8 цента. Это демонстрирует привлекательность модели для быстрого прототипирования и экспериментов.

Практическое применение: markdown-svg-renderer

В рамках тестирования Уиллисон также использовал Gemini 3.8 Flash для доработки своего инструмента markdown-svg-renderer. Этот инструмент позволяет отображать Markdown-файлы из Gist, корректно обрабатывая блоки кода с SVG. С помощью Gemini 3.8 Flash и собственного плагина-агента llm-coding-agent он добавил поддержку HTML-блоков. Теперь любые HTML-блоки внутри Markdown рендерятся с использованием sandboxed iframe, что повышает безопасность и функциональность инструмента.

Что это значит для разработчиков

Обновление llm-gemini 0.34 — это не просто добавление новой модели. Возможность выбирать уровень «мышления» даёт разработчикам гибкость: для простых задач (генерация кода, перевод, суммаризация) можно использовать низкий уровень, экономя время и токены. Для сложных аналитических задач — высокий уровень, который тратит больше ресурсов, но выдаёт более глубокий и структурированный ответ.

Плагин остаётся open-source и доступен для установки через pip. Для работы потребуется API-ключ Google AI Studio или Vertex AI. Релиз распространяется через GitHub.

Источник: Simon Willison — llm-gemini 0.34 release notes (https://simonwillison.net/2026/Sep/2/llm-gemini/)