Вышла нейросеть, которая изменила индустрию генерации картинок
Разработчики
Reve 2.0 доказали, что для крутых моделей не нужна куча GPU — достаточно смекалки. Они используют LLM в лице открытой Qwen: она придумывает композицию и расположение объектов, а уже потом подключается привычная диффузионная модель, которая рисует картинку
Что умеет модель:
- точный рендеринг текста на картинке
- редактирование только выбранных обьектов на фото, без перерисовки всей картинки
- сохранение стиля между генерациями
- работа с несколькими референсами сразу
- сборка сложных многообъектных сцен
Модель Reve сейчас Топ-2 в мире, она обгоняет даже Nano Banana и уступает только ChatGPT, который, к слову, ещё раньше стал использовать
подобный подход для картинок. Это значит, что скоро все генеративные модели перейдут на такой подход — он уже показал эффективность. И самое главное —
генерация красивых картинок
станет кратно дешевле
Агентный подход — абсолютный тренд ближайших 10 лет, нейронкам нужно просто позволить общаться друг с другом — и будут чудеса, ну либо Скайнет
@n2d2ai
Обсуждение 17
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram