Запись архива

AutoFigure: инструмент для генерации научных иллюстраций на основе текста и документов

Исследовательский проект AutoFigure позволяет автоматически создавать научные диаграммы и схемы из текстовых описаний и статей. Разбираем, как работает инструмент и где он может пригодиться разработчикам AI-агентов.

Редакционная обложка COMRAD404: AutoFigure: инструмент для генерации научных иллюстраций на основе текста и документов
Редакционная обложка COMRAD404: AutoFigure: инструмент для генерации научных иллюстраций на основе текста и документов
Редакционная тематическая обложка COMRAD404

21 августа 2026 года на MarkTechPost вышло практическое руководство по AutoFigure — инструменту для генерации научных иллюстраций из текстовых описаний и исследовательских статей. Проект разработан командой ResearAI и доступен как open-source репозиторий на GitHub.

AutoFigure позволяет автоматически создавать публикационные схемы и диаграммы, описывая их текстом. В руководстве авторы демонстрируют полный пайплайн: от настройки окружения и решения проблем с зависимостями (например, Pillow) до генерации SVG и PNG, экспорта в галерею и zip-архив.

Как это работает

Инструмент использует API-модели, включая Google Gemini 3.1 Pro Preview, через провайдеров OpenRouter или напрямую. Пользователь задаёт описание диаграммы на естественном языке — система итеративно генерирует изображение, оценивая качество по шкале от 0 до 10. Пороговое значение по умолчанию — 8.5, а количество итераций можно настроить.

В качестве примера в руководстве создаётся схема agentic long-document intelligence pipeline — системы для обработки длинных финансовых документов. Диаграмма включает модули нормализации, маршрутизации, специализированных экспертов (суммаризация, извлечение полей, таблицы, анализ визуальных данных, привязка цитат), оркестрации с учётом бюджета и слоя верификации.

Ключевые факты
Разработчик ResearAI
Репозиторий github.com/ResearAI/AutoFigure
Поддерживаемые форматы SVG, PNG, MXGraph XML
Рекомендуемая модель Google Gemini 3.1 Pro Preview
Порог качества 5 из 10 (настраивается)

Для кого это полезно

AutoFigure может быть полезен исследователям, инженерам по машинному обучению и разработчикам AI-агентов, которым нужно быстро создавать схемы архитектур, пайплайнов и методологий для публикаций, презентаций или документации. Вместо ручного рисования в редакторах или заказа дизайнеру — текстовое описание и одна команда.

Инструмент также поддерживает генерацию диаграмм из Markdown-версий статей: можно подать на вход текст с секциями «Метод» или «Эксперименты» и получить готовую иллюстрацию.

Ограничения и нюансы

На данный момент AutoFigure — экспериментальный проект. В руководстве отмечаются проблемы с совместимостью библиотек (Pillow) и необходимость ручной настройки API-ключей. Качество результата сильно зависит от модели. Рекомендуется использовать Gemini 3.1 Pro Preview, но доступны и другие провайдеры.

Кроме того, генерация сложных схем с множеством модулей и связей может потребовать нескольких итераций и корректировки описания. Инструмент пока не поддерживает редактирование уже сгенерированных диаграмм — только перегенерацию.

Практическое применение

Для читателей Comrad404, работающих с agentic pipeline и document intelligence, AutoFigure может стать удобным способом визуализировать архитектуру собственных систем. Вместо того чтобы описывать схему словами в README или презентации, можно сгенерировать наглядную диаграмму из того же описания.

Также инструмент подходит для автоматизации создания иллюстраций в научных статьях и технических отчётах — особенно в областях, где схемы пайплайнов и архитектур являются стандартом.

Источник: MarkTechPost — Building Agentic Document Intelligence Pipelines: Creating Scientific Figures with AutoFigure