Alibaba запустила мощный ИИ-генератор изображений Qwen-Image-2.0

Alibaba объявила о выпуске новой модели искусственного интеллекта Qwen-Image-2.0, созданной для генерации изображений. По словам разработчиков, прорыв состоит в том, что модель стабильно отрисовывает текст без ошибок и позволяет выбирать стиль изображения; промпты поддерживаются до тысячи токенов, и на выходе можно получить фотореалистичные изображения, иллюстрации для презентаций, плакаты, комиксы и многое другое.

Разработка Qwen-Image-2.0 шла по двум параллельным направлениям: создание высокоточной генерации изображений с детализированным отображением текста и развитие возможностей редактирования изображений, обеспечивающих функциональность и согласованность без искажения исходника. Объединив эти подходы, проект получил единую универсальную модель, обладающую преимуществами обеих веток, при этом архитектура стала более лёгкой, а скорость вывода — выше.

Основные преимущества Qwen-Image-2.0 включают точность, унаследованную от ветки редактирования, и способность создавать сложные композиции благодаря поддержке подробных запросов длиной до тысячи токенов. Также выделяется эстетическое качество: модель умеет гармонично размещать текст на изображении и подбирать подходящее начертание.

Примеры реального применения — создание реалистичных изображений с текстом на глянцевых поверхностях с отражениями, аккуратное размещение объектов и текста на кинопостерах, а также создание комиксов с информативными иллюстрациями и корректным текстовым сопровождением.

Alibaba проводила слепое тестирование Qwen-Image-2.0 на площадке AI Arena, сравнивая её возможности в генерации и редактировании изображений с аналогами. В задачах генерации модель оказалась сильнее только у Gemini-3-Pro-Image-Preview и OpenAI GPT Image 1.5; в задачах редактирования Qwen-Image-2.0 уступила лишь флагманской Gemini.

Регион: 

Рубрики: 

Заметили ошибку? Выделите ее мышкой и нажмите Ctrl+Enter!