<figure><img src="https://rss.neurootlichnik.ru/images/ce0a0964-e68b-4ffe-8619-6c0dfd8ad5da/0.jpg"></figure>
<p>В экосистеме генерации изображений на основе искусственного интеллекта появился новый инструмент — <b>What to Edit Next</b>. Это фреймворк от Alibaba, который помогает пользователю понять, какой следующий шаг стоит сделать при работе с картинкой в чате. Его задача — не просто предлагать случайные изменения, а давать <b>релевантные</b>, <b>разнообразные</b> и <b>реализуемые</b> советы, которые действительно можно применить к текущему изображению.</p>
<h2>Как работает What to Edit Next</h2>
<p>В основе фреймворка лежит модель <b>Qwen3-VL-8B</b>. Она анализирует текущее изображение и историю диалога, чтобы после каждой итерации генерации подсказывать, что можно улучшить или изменить. Это не просто генерация идей — рекомендации учитывают, что уже было сделано, и не повторяют себя. Такой подход делает процесс доработки изображения более осмысленным и экономит время: не нужно гадать, что ещё можно попробовать, если хочется получить лучший результат.</p>
<h3>Для чего это может пригодиться</h3>
<ul>
<li>Пошаговая доработка сложных изображений, где важно не потерять детали.</li>
<li>Эксперименты с разными стилями и элементами без риска зациклиться на одних и тех же правках.</li>
<li>Обучение новичков: фреймворк подсказывает, какие аспекты изображения можно менять, и почему это имеет смысл.</li>
</ul>
<p>Отдельно стоит отметить, что <b>кода-весов</b> для модели нет — это исследовательская разработка, а не готовый open-source продукт. Тем не менее, сам подход к формированию подсказок может быть интересен тем, кто работает с визуальными языковыми моделями или разрабатывает инструменты для интерактивной генерации изображений.</p>
Нейро Отличник
www.neurootlichnik.ru