Одна открытая модель на 6B параметров умеет и генерировать изображения, и редактировать их по инструкции. LLaDA-Image работает с запросами текст → картинка, VQ-кодами и отдельно умеет рендерить текст внутри изображения.
Для качества ей нужно 50 шагов, но есть Turbo-версия на 4 шага. Причём авторы заявляют SOTA на Qwen-Image-Bench, а китайский и английский текст модель рисует без привычной каши из иероглифов. Для постеров, заголовков и надписей это, пожалуй, самая цепляющая часть.
Код: https://github.com/inclusionAI/LLaDA-Image
Модели на Hugging Face: https://huggingface.co/collections/inclusionAI/llada-image

3
2
2
2
1September 4, 2026 40