Одна открытая модель на 6B параметров умеет и генерировать… — Fix_and_go — TG.ME

Одна открытая модель на 6B параметров умеет и генерировать изображения, и редактировать их по инструкции. LLaDA-Image работает с запросами текст → картинка, VQ-кодами и отдельно умеет рендерить текст внутри изображения.

Для качества ей нужно 50 шагов, но есть Turbo-версия на 4 шага. Причём авторы заявляют SOTA на Qwen-Image-Bench, а китайский и английский текст модель рисует без привычной каши из иероглифов. Для постеров, заголовков и надписей это, пожалуй, самая цепляющая часть.

Код: https://github.com/inclusionAI/LLaDA-Image
Модели на Hugging Face: https://huggingface.co/collections/inclusionAI/llada-image
🔥3👍2❤‍🔥2💯2❤1
September 4, 2026 40