А мы точно про одного и того же человека говорим?Yndikator3033 писал(а): ↑07.10.2024, 12:58 Чем намереваетесь заменить детскую непосредственность, мягкость, cпособность смеяться?
Рисуем Алису с нейросетями
Модераторы: модераторы, авторы
-
Pinhead
- Сообщений: 5969
- Зарегистрирован: 13.11.2007, 21:52
- Благодарил (а): 17 раз
- Поблагодарили: 1358 раз
Рисуем Алису с нейросетями
"Какая горькая память - память о том,
О том, что будет потом."
О том, что будет потом."
-
Лапин
Автор темы - Сообщений: 348
- Зарегистрирован: 15.09.2005, 11:15
- Желаемая форма обращения: Как хотите к себе
- Откуда: Планета по имени Алиса
- Благодарил (а): 18 раз
- Поблагодарили: 285 раз
- Контактная информация:
Рисуем Алису с нейросетями
Внимая рекомендациям уважаемых Алисоведов и собственным внутренним ощущениям, поправим в первом тестовом промпте выражение лица, чтоб потенциальная Алиса смотрела на нас с прищуром:
Test_1_Prompt:
12-year-old Russian girl, pretty, slender, charming, blue eyes, short white hair, red spacesuit, looks at the viewer with a squint, close-up, on a large spaceship, professional photo,
Первым проверим, что отрисует Шедеврум:
Шедеврум .v1.3, Test_1_Prompt:

Странно, что в этом ряду генераций резкими выходят только глаза. Всё остальное подчас размыто, почти как задний план. Улыбаться перестали, но характерного доброго прищура не получается. Иные словно щас спросят "Семки есть?"
Кажется, что попадания в образ в этом кастинге стали заметно чаще, и некоторые даже можно сказать, что в чёрный круг, не в 10-ку конечно, но 7-8 иногда есть, вот например, см. ниже:

Шедеврум .v2.0, Test_1_Prompt:

Здесь напротив, резкость на лицах такова, что аж режет глаз. Плюс иногда гиперреалистичные косметические дефекты кожи на лицах, светящиеся глаза, волосы будто из пакли, хм... Многие выглядят как-то кукольно, что ли. Как куклы из одного набора. И комбезы у всех из одной коллекции.

Но вот иногда как будто разные рендеры с одной модели - прям портретное сходство, по крайней мере меж собой.
Шедеврум опять обновился, в браузере теперь только v2.0, через эмулятор не переключается, и 50 генераций в браузере вместо 30 слабо утешают. Лучше бы редактор хоть какой-нибудь прикрутили.
И ещё нежданчик - после обновления Шедеврум блокирует запрос со словами "Alice Selezneva, 12-year-old girl,".
По отдельности Alice Selezneva и 12-year-old girl не блочатся.
В чём тут смысл?!
___________________________________
Едем дальше.
TurboText
Регистрация через акк Гугла. Понимает по русски. При регистрации даётся 3 безплатных попытки, на пробу. После требует плату. Минимальная подписка - 150 попыток за 365р на 90 дней. Рублями, российской картой - плизз.
Есть ряд инструментов - фото в фото, удаление фона, замена фона, улучшение лица, много чего, и музыку тоже пишет.
Есть ползунки Contrast и SEED, первый отвечает должно быть за... Хм... (ставишь на 0,1- картинка как через мутное дверное стекло, на 10 - рисует тряпочную куклу. По умолчанию 2,5), второй (SEED) видимо за повторяемость результата.
5 "версий нейросети", v3 - реалистичный, v4 - реализм + анимэ.
Генерация в пределах минуты.
TurboText_v3, Test_1_Prompt:

Все дети будто только с мороза, румяные как антоновские яблоки. Генерит много явных пацанок. Картинки все меж собой похожи, словно рандомное освещение бывает только одно. С частотой раз через 2-3 вместо румяных деток в красных комбезах появляются лохматые девицы в белых скафандрах.
TurboText_v3, Test_2_Prompt:

Мелкие стриженные детки, бегущие по прямой дорожке, и лохматая девушка в бронескафандре - это опять с одного и того же промпта. Потратил несколько десятков попыток - в среднем на 2 мелких ребенка одна девица.
Других вариантов не рисует. Как такое возможно? Две модели генерации, рандомно тасуемых меж собой внутри одной "версии" и стиля? Кнопку выбора модели генерации не нашел.
TurboText_v4, Test_1_Prompt:

В этой "версии нейросети" отрисовались сплошь девчонки, все с пепельными волосами, иногда оочень хмурые.
Та что внизу слева чем-то напоминает, вроде бы. Повторить даже близко не получилось.
TurboText_v4, Test_2_Prompt:

А тут вообще не понял, что произошло. Неужели ИИ решил crashed spaceship показать огненной вспышкой, заодно спалив весь лес вокруг?
Более подробное знакомство с TurboText откладываю на неопределенное время.
___________________________
Playground AI.
Его вроде бы хвалят. Регистрация через акк Гугла. Интерфейс чисто английский, по отзывам - плохо понимает запросы на русском.
Есть бесплатная генерация, с урезаным функционалом и неясным лимитом. Через некоторое количество генераций начинает требовать подписку. Тарифы от 15$ месяц. Или обращайтесь завтра.
Playground AI может изменять и дорисовывать готовые варианты; создавать визуал на основе загруженных изображений; осуществлять детализацию; применять широкий набор стилей – от классики до аниме; удалять фон и использовать другие инструменты для редактирования.
Это так обещают, не уточняя, насколько результат соответствует вашим ожиданиям.
Процесс генерации с нуля в бесплатной версии Доооооолгий. Минуты 2-3 обрабатывает простой запрос, то и дело выпадает - "истек лимит времени на обработку".
по 1, 2, 4 или 8 картинок за раз. Модели генерации - рандомный "NoStyle", Realistic Portrait SDXL, и Fantasy Words PGv2.5.
Playground AI, NoStyle, Test_1_Prompt:

12-year-old Russian girl рисует практически одинаково, и не сказать чтоб очень красиво.
Playground AI, NoStyle, Test_2_Prompt:

Э-э... Комично как-то это всё выглядит. Бегут одуревшие лилипуты по нарисованной полянке. Неестесвенность вопиющая.
Есть тут режим создания своего дизайна - грузишь свою картинку, ИИ как-то по-своему её перерисовывает (Создаёт Дизайн), потом её можно опять переделать типа в этом же стиле но по иному текстовому описанию.
Загрузил девчулю из Шедеврума:

Генерация по готовой картинке шустрее. В итоге получается считай то же лицо, как если вводишь промпт напрямую. Только ещё менее естественное, с химически ярким румянцем, белыми бровями, и прочими приметами, которых не было у исходной картинки.
Загрузил Мигуновский рисунок из "Девочки с Земли".

Мдя... хрень короче, эти дизайны. Лажа. Примитив.
За Мигунова рисовать это ИИ не сможет.
(Была надежда, каюсь...)
В общем, пока мне Playground AI похвалить не за что.
Test_1_Prompt:
12-year-old Russian girl, pretty, slender, charming, blue eyes, short white hair, red spacesuit, looks at the viewer with a squint, close-up, on a large spaceship, professional photo,
Первым проверим, что отрисует Шедеврум:
Шедеврум .v1.3, Test_1_Prompt:
► Показать

Странно, что в этом ряду генераций резкими выходят только глаза. Всё остальное подчас размыто, почти как задний план. Улыбаться перестали, но характерного доброго прищура не получается. Иные словно щас спросят "Семки есть?"
Кажется, что попадания в образ в этом кастинге стали заметно чаще, и некоторые даже можно сказать, что в чёрный круг, не в 10-ку конечно, но 7-8 иногда есть, вот например, см. ниже:
Шедеврум .v2.0, Test_1_Prompt:
► Показать

Здесь напротив, резкость на лицах такова, что аж режет глаз. Плюс иногда гиперреалистичные косметические дефекты кожи на лицах, светящиеся глаза, волосы будто из пакли, хм... Многие выглядят как-то кукольно, что ли. Как куклы из одного набора. И комбезы у всех из одной коллекции.

Но вот иногда как будто разные рендеры с одной модели - прям портретное сходство, по крайней мере меж собой.
Шедеврум опять обновился, в браузере теперь только v2.0, через эмулятор не переключается, и 50 генераций в браузере вместо 30 слабо утешают. Лучше бы редактор хоть какой-нибудь прикрутили.
И ещё нежданчик - после обновления Шедеврум блокирует запрос со словами "Alice Selezneva, 12-year-old girl,".
По отдельности Alice Selezneva и 12-year-old girl не блочатся.
В чём тут смысл?!
___________________________________
Едем дальше.
TurboText
Регистрация через акк Гугла. Понимает по русски. При регистрации даётся 3 безплатных попытки, на пробу. После требует плату. Минимальная подписка - 150 попыток за 365р на 90 дней. Рублями, российской картой - плизз.
Есть ряд инструментов - фото в фото, удаление фона, замена фона, улучшение лица, много чего, и музыку тоже пишет.
Есть ползунки Contrast и SEED, первый отвечает должно быть за... Хм... (ставишь на 0,1- картинка как через мутное дверное стекло, на 10 - рисует тряпочную куклу. По умолчанию 2,5), второй (SEED) видимо за повторяемость результата.
5 "версий нейросети", v3 - реалистичный, v4 - реализм + анимэ.
Генерация в пределах минуты.
TurboText_v3, Test_1_Prompt:
► Показать

Все дети будто только с мороза, румяные как антоновские яблоки. Генерит много явных пацанок. Картинки все меж собой похожи, словно рандомное освещение бывает только одно. С частотой раз через 2-3 вместо румяных деток в красных комбезах появляются лохматые девицы в белых скафандрах.
TurboText_v3, Test_2_Prompt:
► Показать

Мелкие стриженные детки, бегущие по прямой дорожке, и лохматая девушка в бронескафандре - это опять с одного и того же промпта. Потратил несколько десятков попыток - в среднем на 2 мелких ребенка одна девица.
Других вариантов не рисует. Как такое возможно? Две модели генерации, рандомно тасуемых меж собой внутри одной "версии" и стиля? Кнопку выбора модели генерации не нашел.
TurboText_v4, Test_1_Prompt:

В этой "версии нейросети" отрисовались сплошь девчонки, все с пепельными волосами, иногда оочень хмурые.
Та что внизу слева чем-то напоминает, вроде бы. Повторить даже близко не получилось.
TurboText_v4, Test_2_Prompt:

А тут вообще не понял, что произошло. Неужели ИИ решил crashed spaceship показать огненной вспышкой, заодно спалив весь лес вокруг?
Более подробное знакомство с TurboText откладываю на неопределенное время.
___________________________
Playground AI.
Его вроде бы хвалят. Регистрация через акк Гугла. Интерфейс чисто английский, по отзывам - плохо понимает запросы на русском.
Есть бесплатная генерация, с урезаным функционалом и неясным лимитом. Через некоторое количество генераций начинает требовать подписку. Тарифы от 15$ месяц. Или обращайтесь завтра.
Playground AI может изменять и дорисовывать готовые варианты; создавать визуал на основе загруженных изображений; осуществлять детализацию; применять широкий набор стилей – от классики до аниме; удалять фон и использовать другие инструменты для редактирования.
Это так обещают, не уточняя, насколько результат соответствует вашим ожиданиям.
Процесс генерации с нуля в бесплатной версии Доооооолгий. Минуты 2-3 обрабатывает простой запрос, то и дело выпадает - "истек лимит времени на обработку".
по 1, 2, 4 или 8 картинок за раз. Модели генерации - рандомный "NoStyle", Realistic Portrait SDXL, и Fantasy Words PGv2.5.
Playground AI, NoStyle, Test_1_Prompt:
► Показать

12-year-old Russian girl рисует практически одинаково, и не сказать чтоб очень красиво.
Playground AI, NoStyle, Test_2_Prompt:
► Показать

Э-э... Комично как-то это всё выглядит. Бегут одуревшие лилипуты по нарисованной полянке. Неестесвенность вопиющая.
Есть тут режим создания своего дизайна - грузишь свою картинку, ИИ как-то по-своему её перерисовывает (Создаёт Дизайн), потом её можно опять переделать типа в этом же стиле но по иному текстовому описанию.
Загрузил девчулю из Шедеврума:

Генерация по готовой картинке шустрее. В итоге получается считай то же лицо, как если вводишь промпт напрямую. Только ещё менее естественное, с химически ярким румянцем, белыми бровями, и прочими приметами, которых не было у исходной картинки.
Загрузил Мигуновский рисунок из "Девочки с Земли".

Мдя... хрень короче, эти дизайны. Лажа. Примитив.
За Мигунова рисовать это ИИ не сможет.
(Была надежда, каюсь...)
В общем, пока мне Playground AI похвалить не за что.
- Привет Алисе. Мне двенадцать. Я пошёл.
-
Pinhead
- Сообщений: 5969
- Зарегистрирован: 13.11.2007, 21:52
- Благодарил (а): 17 раз
- Поблагодарили: 1358 раз
Рисуем Алису с нейросетями
Получается всё та же тупенькая малолетка, просто серьёзная.
Впрочем, в другой теме проскальзывало пару очень неплохих изображений.
Впрочем, в другой теме проскальзывало пару очень неплохих изображений.
"Какая горькая память - память о том,
О том, что будет потом."
О том, что будет потом."
-
Yndikator3033
- Сообщений: 4083
- Зарегистрирован: 02.11.2008, 06:36
- Реальное имя: Вадим
- Желаемая форма обращения: Всё равно
- Откуда: СПб
- Поблагодарили: 789 раз
- Возраст: 55
Рисуем Алису с нейросетями
Почему у Мигунова все персонажи какие-то приплюснутые, словно их мешком по башкам ударяли?
Не уверен. Моя Алиса умеет и улыбаться и смеяться.
-
Pinhead
- Сообщений: 5969
- Зарегистрирован: 13.11.2007, 21:52
- Благодарил (а): 17 раз
- Поблагодарили: 1358 раз
Рисуем Алису с нейросетями
Характерно слово "умеет". Вы подсознательно подобрали подходящий глагол.
"Какая горькая память - память о том,
О том, что будет потом."
О том, что будет потом."
-
Лапин
Автор темы - Сообщений: 348
- Зарегистрирован: 15.09.2005, 11:15
- Желаемая форма обращения: Как хотите к себе
- Откуда: Планета по имени Алиса
- Благодарил (а): 18 раз
- Поблагодарили: 285 раз
- Контактная информация:
Рисуем Алису с нейросетями
Dream by Wombo. (Dream ai).
Регистрация через акк Гугла.
Поддерживает русский язык. Не блочит имена в запросах. Есть бесплатная генерация, безлимитная, с урезаным функционалом. Безплатно по 1 картинке, платно по 4 за раз. Тарифы от 9.99$ месяц. Есть пожизненная подписка.
В бесплатной версии ограничение на размер промпта - 350 символов. Поэтому подробный промпт выгоднее писать сразу на английском.
Работы можно публиковать, можно сохранять себе без публикаций.
Есть 159 установок стилей, из них больше сотни доступны бесплатно. Стили постоянно добавляются.
Годно рисует во многих стилях которые .v3. Стили без .v3 - можно и не пробовать. Мне не зашли.
Wombo, стили Anime.v3 / Comic.v3, Test_1_Prompt:

Wombo, стили Dreamland.v3 / Figure.v3, Test_1:

Wombo, стили Mechanic.v3 / Robots.v3, Test_1:

Сплошная милота. Даже когда не улыбаются. Но искомый прищур наблюдается у одной-двух, все остальные просто грустят.
Наверно, потому что red space suit здесь красным не рисуется почти никогда.
Зато здесь русской девочке рисуют иногда шеврон с триколором, и красные звёзды. Наверное, нейросеть всё-таки что-то знает. Шеврон юэсэй и лейблы NASA тоже иногда лепит на рукав.
Внутри стилей лица в значительной степени повторяются.
Girl часто получается похожей на молодую Глюкозу. Ну и на Супервуман, конечно. А иной раз на... Или показалось?
Wombo, стиль Sketch, Test_1:
Иногда в этом стиле выпадают тааакие вот картинки. Но только иногда

Wombo, стили Anime.v3 / Comic.v3, Test_2_Prompt:

Wombo, стили Robots.v3 / Mechanical v3.1, Test_2:

На ростовых фигурах очень заметно, что Wombo часто рисует явных акселераток, которые в свои 12 выглядят минимум на 15+. М.б. за исключением Anime.
При этом на ростовых фигурах постоянно проблемы с проработкой лиц. Глаза, рты, зубы - всё кривое. Чем мельче план, тем кривее.
В HDR.v3, Dreamland v3, Surrealism v3 при ближайшем рассмотрении лица ооочень страшные.
В Anime.v3, Comic.v3, Robots.v3, Mechanical v3.0 и Mechanical v3.1 это не так заметно.
Wombo имеет странное вИдение Алисы - если в запросе указать Alice Selezneva, девушка выходит скуластой, худой, измождённой. Как злая училка.
Wombo, Test_1* +"Alice Selezneva" - под катом, на всякий случай:
Wombo, Test_2*, "Alice Selezneva" / "12-year-old girl":

В нижнем ряду - безымянные 12-year-old girl, смотрятся симпатичнее.
С динамикой тут плохо. Лучше всего у Wombo получаются портреты в пояс. Позы сложнее чем "Идёт" рисует неохотно и криво. Разве что кроме стиля Comic.
Но там слишком характерные рандомные установки, чтоб рисовать кого-то кроме Супервуман и К.
Ручки-ножки часто прячет за край кадра. Иногда рисует лишние ноги.
Фраза в промпте "similar to Natasha Guseva", кажется, добавляет милоты персонажу.
Впрочем, так же влияет и просто Natasha в промпте. Не уверен, что этот ИИ знает кто такая Natasha Guseva.
Wombo, стиль Robots.v3:
Зато Wombo точняк знает Милу Йовович, рисует её весьма узнаваемо.
Wombo, стиль Anime.v3:

Тут, в Wombo, похоже, есть поле для экспериментов. Главное, чтоб ИИ молнию рисовал где надо.
Регистрация через акк Гугла.
Поддерживает русский язык. Не блочит имена в запросах. Есть бесплатная генерация, безлимитная, с урезаным функционалом. Безплатно по 1 картинке, платно по 4 за раз. Тарифы от 9.99$ месяц. Есть пожизненная подписка.
В бесплатной версии ограничение на размер промпта - 350 символов. Поэтому подробный промпт выгоднее писать сразу на английском.
Работы можно публиковать, можно сохранять себе без публикаций.
Есть 159 установок стилей, из них больше сотни доступны бесплатно. Стили постоянно добавляются.
Годно рисует во многих стилях которые .v3. Стили без .v3 - можно и не пробовать. Мне не зашли.
Wombo, стили Anime.v3 / Comic.v3, Test_1_Prompt:
► Показать

Wombo, стили Dreamland.v3 / Figure.v3, Test_1:

Wombo, стили Mechanic.v3 / Robots.v3, Test_1:

Сплошная милота. Даже когда не улыбаются. Но искомый прищур наблюдается у одной-двух, все остальные просто грустят.
Наверно, потому что red space suit здесь красным не рисуется почти никогда.
Зато здесь русской девочке рисуют иногда шеврон с триколором, и красные звёзды. Наверное, нейросеть всё-таки что-то знает. Шеврон юэсэй и лейблы NASA тоже иногда лепит на рукав.
Внутри стилей лица в значительной степени повторяются.
Girl часто получается похожей на молодую Глюкозу. Ну и на Супервуман, конечно. А иной раз на... Или показалось?
Wombo, стиль Sketch, Test_1:
Иногда в этом стиле выпадают тааакие вот картинки. Но только иногда

Wombo, стили Anime.v3 / Comic.v3, Test_2_Prompt:
► Показать

Wombo, стили Robots.v3 / Mechanical v3.1, Test_2:

На ростовых фигурах очень заметно, что Wombo часто рисует явных акселераток, которые в свои 12 выглядят минимум на 15+. М.б. за исключением Anime.
При этом на ростовых фигурах постоянно проблемы с проработкой лиц. Глаза, рты, зубы - всё кривое. Чем мельче план, тем кривее.
В HDR.v3, Dreamland v3, Surrealism v3 при ближайшем рассмотрении лица ооочень страшные.
В Anime.v3, Comic.v3, Robots.v3, Mechanical v3.0 и Mechanical v3.1 это не так заметно.
Wombo имеет странное вИдение Алисы - если в запросе указать Alice Selezneva, девушка выходит скуластой, худой, измождённой. Как злая училка.
Wombo, Test_1* +"Alice Selezneva" - под катом, на всякий случай:
► Показать

В нижнем ряду - безымянные 12-year-old girl, смотрятся симпатичнее.
С динамикой тут плохо. Лучше всего у Wombo получаются портреты в пояс. Позы сложнее чем "Идёт" рисует неохотно и криво. Разве что кроме стиля Comic.
Но там слишком характерные рандомные установки, чтоб рисовать кого-то кроме Супервуман и К.
Ручки-ножки часто прячет за край кадра. Иногда рисует лишние ноги.
Фраза в промпте "similar to Natasha Guseva", кажется, добавляет милоты персонажу.
Впрочем, так же влияет и просто Natasha в промпте. Не уверен, что этот ИИ знает кто такая Natasha Guseva.
Wombo, стиль Robots.v3:
Зато Wombo точняк знает Милу Йовович, рисует её весьма узнаваемо.
Wombo, стиль Anime.v3:

Тут, в Wombo, похоже, есть поле для экспериментов. Главное, чтоб ИИ молнию рисовал где надо.
- Привет Алисе. Мне двенадцать. Я пошёл.
-
Nik
- Сообщений: 3273
- Зарегистрирован: 03.03.2006, 09:19
- Желаемая форма обращения: Всё равно
- Благодарил (а): 174 раза
- Поблагодарили: 1104 раза
- Контактная информация:
Рисуем Алису с нейросетями
https://www.krea.ai/apps/image/realtime
бесплатно
ГЕНЕРИТ, ПОКА ВЫ ПИШЕТЕ ПРОМТ!
И меняет картинку реал-тайм
бесплатно
ГЕНЕРИТ, ПОКА ВЫ ПИШЕТЕ ПРОМТ!
И меняет картинку реал-тайм
-
Pinhead
- Сообщений: 5969
- Зарегистрирован: 13.11.2007, 21:52
- Благодарил (а): 17 раз
- Поблагодарили: 1358 раз
Рисуем Алису с нейросетями
А чего у неё везде волосы крашеные? Не бывает в натуре таких волос, если только человек не альбинос. Если блондинка, то обязательно платиновая? По идее, у Алисы волосы соломенного цвета (на просвет "золотые").
"Какая горькая память - память о том,
О том, что будет потом."
О том, что будет потом."
-
Лапин
Автор темы - Сообщений: 348
- Зарегистрирован: 15.09.2005, 11:15
- Желаемая форма обращения: Как хотите к себе
- Откуда: Планета по имени Алиса
- Благодарил (а): 18 раз
- Поблагодарили: 285 раз
- Контактная информация:
Рисуем Алису с нейросетями
Если что, тут пока по большей части тесты - кто из нейронок на что способен. Все тесты с white hair.
Не бывает таких волос? Да ладно.
Бывает, особенно в раннем детстве. По большей части потом темнеют, кто в 5 лет, кто в 8м классе, а кто и нет.
Другое дело, что пшеничный / соломенный цвет волос трудно правильно передать. Чуть не так - лезут неестественные оттенки.
Столкнулся с этим уж давно, когда стал пробовать моделить в 3Д. С белым проще.
Набей уж сам в какой-нибудь нейронке пару строк, проверь, м.б. что годное нарисуется.
Problembo AI.
Вход через аккаунт Гугл.
Понимает запросы на русском, размер промпта до 880 знаков, много, пиши не хочу
(в Шедевруме к примеру, 500).
Платный, но на каждый акк ежедневно даётся 0.6$ Free (не копится). Сумма на реальном счете считается отдельно. Оплату принимает в т.ч. рублями с российских карт.
Несколько ИИ инструментов, в том числе генератор картинок, генератор анимэ, удалитель фона, промпт по вашей картинке. В генераторах картинок по несколько моделей генерации.
General XL v3/ Anime XL v4, PhotoStab v2 и PhotoStab v2.5 - доступны с оплатой через Free, Dall-E v3, MidJourney v5 и MidJourney v6 - только за оплату с реального счета.
Насколько модели Dall-E и MidJourney соответствуют оригинальным - тот ещё вопрос.
В модели General XL v3 на сегодня 201 стиль генерации.
Редакторы - несколько отдельных ИИ инструментов, ленты нет (не нашел), история своих генераций с картинками доступна за текущие сутки, из прошлых можно узнать только промпты.
Problembo (генератор аниме), Anime XL v4,Test_1_Prompt:

Всё, что надо знать - в модели Anime XL v4 Problembo рисует только ЭТО лицо.
Можно сменить цвет глаз, волос, но заставить ее прищуриться не выйдет.
Problembo (генератор аниме), Anime XL v4,Test_2_Prompt:

Anime XL v4 - оно такое анимэ...
Problembo (генератор аниме), PhotoStab v2, Test_1*: (anime style drawing, иначе рисует просто "фотку")
Problembo (генератор аниме), PhotoStab v2.5, Test_1:
Картинки под катами для информации - чтоб не тратить зря время, в надежде получить что-то иное.
Problembo (генератор картинок), General XL v3,Test_1_Prompt:

12-year-old Russian girl получается здесь почти одинаковой во многих стилях.
Улыбочку!


На этом кастинге девчонки выглядят помладше заявленных 12 лет.
Problembo, похоже, весьма стабильно повторяет лица на одинаковый промпт.
Есть надежда создать подходящее описание Алисы, не используя имя Алиса, которое будет стабильно выдавать годный результат.
Problembo, General XL v3,Test_2_Prompt:


Снова странное видение Алисы - если в запросе пишем Alice Selezneva, девушка выходит скуластой и страшной. И прямо портретное сходство с иными стилями Dream by Wombo.
Видимо, модели генерации General XL v3 и Dream by Wombo за одной партой учились. Какая зараза обучила их ТАК Алису рисовать?!!
У ростовых фигур знакомые уже проблемы со страхолюдностью лиц на среднем/мелком плане.
Сейчас только понял, что за хрень растёт там в лесу.
Пишем ведь surreal orange forest, раз "surreal" - значит ИИ рисует грибы ростом с дерево, "orange" - значит гриб "апельсиновый", а не просто оранжевого цвета.
Problembo, General XL v3 - Рисует картинки по образцу. Использует композицию картинки-образца, но не стиль.
Загрузил свой рендер - комбезы всё равно отрисовались оранжевыми, на поляне возник всяческий Sci-Fi хлам.

Problembo (генератор картинок), PhotoStab v2, Test_1:

PhotoStab v2 - похожие между собой лица, и не по всем можно уверенно сказать, что это девочка. Похоже, эта модель генерации натаскана только на этот тип лица.
Problembo (генератор картинок), PhotoStab v2.5, Test_1:

PhotoStab v2.5 - лица тут более разнообразные, но по многим с уверенностью можно сказать, что это пацан.
Problembo (генератор картинок), PhotoStab v2, Test_2:

Кто эти дети?
Кто из них девочка?
Кому тут 12 лет?
Даже spacesuit здесь - не скафандр а какие-то треники. Но - ярко-красные, да.
С динамикой в кадре проблембо - словно все картинки в какой-то не совсем характерной фазе движения.
Problembo (генератор картинок), PhotoStab v2.5, Test_2:

В этом детском садике девочек стало заметно больше. Костюмы (красные!) теперь больше напоминают про космос, чем про урок физры. Динамика в позах более естественная.
Всегда прямая дорожка под ногами ничего не напоминает? Да-да, Шедеврум v2.0 теперь рисует похожую фигню, только со страхолюдными тётками.
Problembo (генератор картинок), Dall-E v3, Test_1:

Хм... постоянно пепельный оттенок волос, похожие между собой кукольные лица, типовые бровки, носики итд. Сами картинки больше напоминают какой-то средненький 3D-art, а не фото.
Problembo (генератор картинок), Dall-E v3, Test_2:

Dall-E v3 - да уж, до фотореализма тут далеко. Кукольные мультики мне никогда не нравились, а ощущение тут именно такое.
Притом что генерация в Dall-E v3 самая дорогая, аж 0.16$ за одну картинку. Грабёж. Развод. За чо плОтим?
Problembo (генератор картинок), MidJourney v5, Test_1:

Оу, MidJourney! Симпатичные девчули, однако.
Problembo (генератор картинок), MidJourney v5, Test_2:

Персонажи игнорят промпт "бежит навстречу...", стоят в кустах полубоком или неспешно идут.
Комбезы прям стильные, гламур, винтаж, детали от пылесоса....
Problembo (генератор картинок), MidJourney v6, Test_1:

Да, лица тут весьма естественно выглядят, и разнообразнее. Совсем уж "разнообразных" не стал показывать.
Problembo (генератор картинок), MidJourney v6, Test_2:


С динамикой на картинках тут заметно лучше, промпт "бежит" игнорят через раз.
Сквозь фотореализм пробивается некий арт-стиль.

MidJourney жжот,
вот так кадр, вот так динамика - и горизонт задрал, и волосы по ветру, и хлещет дождь... из рыбок золотых?!
Жаль, на Алису не очень похожа.
Problembo (генератор аниме), MidJourney v6, Test_2: (anime style drawing)

А чё, прикольно рисует. Не дай Бог, конечно, чтоб такой мульт сделали.
Problembo (генератор аниме), MidJourney v6, Test_2:

С головой и пропорциями у этих персонажей что-то не так, но опять же - ах, какова динамика в кадре!
Не бывает таких волос? Да ладно.
Бывает, особенно в раннем детстве. По большей части потом темнеют, кто в 5 лет, кто в 8м классе, а кто и нет.
Другое дело, что пшеничный / соломенный цвет волос трудно правильно передать. Чуть не так - лезут неестественные оттенки.
Столкнулся с этим уж давно, когда стал пробовать моделить в 3Д. С белым проще.
Набей уж сам в какой-нибудь нейронке пару строк, проверь, м.б. что годное нарисуется.
Problembo AI.
Вход через аккаунт Гугл.
Понимает запросы на русском, размер промпта до 880 знаков, много, пиши не хочу
Платный, но на каждый акк ежедневно даётся 0.6$ Free (не копится). Сумма на реальном счете считается отдельно. Оплату принимает в т.ч. рублями с российских карт.
Несколько ИИ инструментов, в том числе генератор картинок, генератор анимэ, удалитель фона, промпт по вашей картинке. В генераторах картинок по несколько моделей генерации.
General XL v3/ Anime XL v4, PhotoStab v2 и PhotoStab v2.5 - доступны с оплатой через Free, Dall-E v3, MidJourney v5 и MidJourney v6 - только за оплату с реального счета.
Насколько модели Dall-E и MidJourney соответствуют оригинальным - тот ещё вопрос.
В модели General XL v3 на сегодня 201 стиль генерации.
Редакторы - несколько отдельных ИИ инструментов, ленты нет (не нашел), история своих генераций с картинками доступна за текущие сутки, из прошлых можно узнать только промпты.
Problembo (генератор аниме), Anime XL v4,Test_1_Prompt:
► Показать

Всё, что надо знать - в модели Anime XL v4 Problembo рисует только ЭТО лицо.
Можно сменить цвет глаз, волос, но заставить ее прищуриться не выйдет.
Problembo (генератор аниме), Anime XL v4,Test_2_Prompt:
► Показать

Anime XL v4 - оно такое анимэ...
Problembo (генератор аниме), PhotoStab v2, Test_1*: (anime style drawing, иначе рисует просто "фотку")
► Показать
► Показать
Problembo (генератор картинок), General XL v3,Test_1_Prompt:
► Показать

12-year-old Russian girl получается здесь почти одинаковой во многих стилях.
Улыбочку!
► Показать


На этом кастинге девчонки выглядят помладше заявленных 12 лет.
Problembo, похоже, весьма стабильно повторяет лица на одинаковый промпт.
Есть надежда создать подходящее описание Алисы, не используя имя Алиса, которое будет стабильно выдавать годный результат.
Problembo, General XL v3,Test_2_Prompt:
► Показать


Снова странное видение Алисы - если в запросе пишем Alice Selezneva, девушка выходит скуластой и страшной. И прямо портретное сходство с иными стилями Dream by Wombo.
Видимо, модели генерации General XL v3 и Dream by Wombo за одной партой учились. Какая зараза обучила их ТАК Алису рисовать?!!
У ростовых фигур знакомые уже проблемы со страхолюдностью лиц на среднем/мелком плане.
Сейчас только понял, что за хрень растёт там в лесу.
Пишем ведь surreal orange forest, раз "surreal" - значит ИИ рисует грибы ростом с дерево, "orange" - значит гриб "апельсиновый", а не просто оранжевого цвета.
Problembo, General XL v3 - Рисует картинки по образцу. Использует композицию картинки-образца, но не стиль.
Загрузил свой рендер - комбезы всё равно отрисовались оранжевыми, на поляне возник всяческий Sci-Fi хлам.

Problembo (генератор картинок), PhotoStab v2, Test_1:

PhotoStab v2 - похожие между собой лица, и не по всем можно уверенно сказать, что это девочка. Похоже, эта модель генерации натаскана только на этот тип лица.
Problembo (генератор картинок), PhotoStab v2.5, Test_1:

PhotoStab v2.5 - лица тут более разнообразные, но по многим с уверенностью можно сказать, что это пацан.
Problembo (генератор картинок), PhotoStab v2, Test_2:

Кто эти дети?
Даже spacesuit здесь - не скафандр а какие-то треники. Но - ярко-красные, да.
С динамикой в кадре проблембо - словно все картинки в какой-то не совсем характерной фазе движения.
Problembo (генератор картинок), PhotoStab v2.5, Test_2:

В этом детском садике девочек стало заметно больше. Костюмы (красные!) теперь больше напоминают про космос, чем про урок физры. Динамика в позах более естественная.
Всегда прямая дорожка под ногами ничего не напоминает? Да-да, Шедеврум v2.0 теперь рисует похожую фигню, только со страхолюдными тётками.
Problembo (генератор картинок), Dall-E v3, Test_1:

Хм... постоянно пепельный оттенок волос, похожие между собой кукольные лица, типовые бровки, носики итд. Сами картинки больше напоминают какой-то средненький 3D-art, а не фото.
Problembo (генератор картинок), Dall-E v3, Test_2:

Dall-E v3 - да уж, до фотореализма тут далеко. Кукольные мультики мне никогда не нравились, а ощущение тут именно такое.
Притом что генерация в Dall-E v3 самая дорогая, аж 0.16$ за одну картинку. Грабёж. Развод. За чо плОтим?
Problembo (генератор картинок), MidJourney v5, Test_1:

Оу, MidJourney! Симпатичные девчули, однако.
Problembo (генератор картинок), MidJourney v5, Test_2:

Персонажи игнорят промпт "бежит навстречу...", стоят в кустах полубоком или неспешно идут.
Комбезы прям стильные, гламур, винтаж, детали от пылесоса....
Problembo (генератор картинок), MidJourney v6, Test_1:

Да, лица тут весьма естественно выглядят, и разнообразнее. Совсем уж "разнообразных" не стал показывать.
Problembo (генератор картинок), MidJourney v6, Test_2:


С динамикой на картинках тут заметно лучше, промпт "бежит" игнорят через раз.
Сквозь фотореализм пробивается некий арт-стиль.

MidJourney жжот,
Жаль, на Алису не очень похожа.
Problembo (генератор аниме), MidJourney v6, Test_2: (anime style drawing)

А чё, прикольно рисует. Не дай Бог, конечно, чтоб такой мульт сделали.
Problembo (генератор аниме), MidJourney v6, Test_2:

С головой и пропорциями у этих персонажей что-то не так, но опять же - ах, какова динамика в кадре!
- Привет Алисе. Мне двенадцать. Я пошёл.
-
Pinhead
- Сообщений: 5969
- Зарегистрирован: 13.11.2007, 21:52
- Благодарил (а): 17 раз
- Поблагодарили: 1358 раз
Рисуем Алису с нейросетями
На первой картинке правильное выражение поймано, но сама внешность не очень похожа. Во всяком случае, это хотя бы что-то, в отличие от. Видно, что человек решает вопросы. Остальное просто жуть.
"Какая горькая память - память о том,
О том, что будет потом."
О том, что будет потом."
-
пацак
- Сообщений: 1931
- Зарегистрирован: 18.06.2005, 21:48
- Желаемая форма обращения: На "ты"
- Откуда: Казахстан
- Благодарил (а): 1827 раз
- Поблагодарили: 227 раз
Рисуем Алису с нейросетями
дайте по башке уже этой нейросети ... ВОТ Алиса !!! ну вы програматоры или вы где ?


бога нет ! есть вера в него !
-
Лапин
Автор темы - Сообщений: 348
- Зарегистрирован: 15.09.2005, 11:15
- Желаемая форма обращения: Как хотите к себе
- Откуда: Планета по имени Алиса
- Благодарил (а): 18 раз
- Поблагодарили: 285 раз
- Контактная информация:
Рисуем Алису с нейросетями
Нэт Алисы кроме Наташи, да...
Да ладно
Ушибленные книжкой видят иначе.

В "Гостье " тож кастинг был, фотопробы итд.

И здесь считай - нейро-фотопробы
Вот, сегодня бенефис Милы Йовович на заданную тему:
Шедеврум в.1.3, Рrompt:




Pinhead ,
, сегодня белые волосы рисуются не белыми, Шедеврум тебя услышал.
Шедеврум в.2.0, Рrompt тот же:

Здесь Миллу прям не узнать, вылитый Пашка Гераскин. И комбез мужской.

И здесь как-то больше не на Миллу похожей вышла.
А вот здесь - очень даже похожа.

Да ладно
Ушибленные книжкой видят иначе.
В "Гостье " тож кастинг был, фотопробы итд.

И здесь считай - нейро-фотопробы
Вот, сегодня бенефис Милы Йовович на заданную тему:
Шедеврум в.1.3, Рrompt:
► Показать
Pinhead ,
Шедеврум в.2.0, Рrompt тот же:
Здесь Миллу прям не узнать, вылитый Пашка Гераскин. И комбез мужской.
И здесь как-то больше не на Миллу похожей вышла.
А вот здесь - очень даже похожа.
- Привет Алисе. Мне двенадцать. Я пошёл.
-
пацак
- Сообщений: 1931
- Зарегистрирован: 18.06.2005, 21:48
- Желаемая форма обращения: На "ты"
- Откуда: Казахстан
- Благодарил (а): 1827 раз
- Поблагодарили: 227 раз
Рисуем Алису с нейросетями
насчёт молнии точно подмечено, а вдруг если очень сильно надо тогда что ? Алисы, вас выручит памперс ! не забывайте надевать его ! это луше чем в штаны !
Отправлено спустя 7 минут 28 секунд:
не понял вопроса ... или это не вопрос ? Наташа это не Алиса
бога нет ! есть вера в него !
-
Pinhead
- Сообщений: 5969
- Зарегистрирован: 13.11.2007, 21:52
- Благодарил (а): 17 раз
- Поблагодарили: 1358 раз
Рисуем Алису с нейросетями
Толку-то. Какое-то чёрти что.
"Какая горькая память - память о том,
О том, что будет потом."
О том, что будет потом."
-
Лапин
Автор темы - Сообщений: 348
- Зарегистрирован: 15.09.2005, 11:15
- Желаемая форма обращения: Как хотите к себе
- Откуда: Планета по имени Алиса
- Благодарил (а): 18 раз
- Поблагодарили: 285 раз
- Контактная информация:
Рисуем Алису с нейросетями
Продолжаем.
Перебрав пару-тройку десятков нейросеток, начинаешь замечать, что многие результаты имеют явное сходство между собой, и становится охота понять, как так получается.
Если "заглянуть под капот" той или иной НС, то обнаружится движок, или модель генерации (или несколько), которую эта НС использует.
Оригинальных движков, понятно, сильно меньше чем сайтов для генерации изображений.
Основные - DALL-E, Stable Diffusion и MidJourney. Вроде бы еще Flux, YandexART, Ideogram, Kandinsky и Leonardo подаются как оригинальные модели генерации.
Модели обучаются на датасетах для машинного обучения, с парами «картинка-текст», общими для многих НС.
Соответственно, постоянно обновляются их версии, в ходу сейчас в основном вот что:
Stable Diffusion: SD 1.4, SD 1.5, SD 1.6, SD 2.0, SD 2.1, SDXL или SDXL 1.0, SD UIweb, SD 3 (Medium, Large, Turbo), Stable Image Ultra, и вот на днях SD 3.5 (Large, Turbo),
FLUX: FLUX.1 [pro], FLUX.1 [dev], FLUX.1 [schnell];
DALL-E: DALL-E 3 (и старый DALL-E 2);
Leonardo_Phoenix;
MidJourney 4, 5, 5,1, 5.2, 6, 6.1.
Ideogram 1.0, 2.0,
YandexART,
Kandinsky 3.1.
Stable Diffusion встречается чаще всех. Потому что исходник SD в открытом доступе, можно установить хоть себе на комп (если видяха достаточно мощная).
Из всех версий самые ходовые SD 1.5, SD 2.1 и SDXL. В чистом виде без доп. стилей рисуют милоту в белых скафандрах крупным планом и страаашненьких Alice Selezneva в полный рост.
Вообще, в этих версиях SD все лица на мелких планах обычно кривые.
Test_1_Prompt / Test_2_Prompt:

Перечислять НС, которые используют Stable Diffusion нет смысла, их многие десятки. А можнт и сотни. Только "Оффициальных платформ SD в России" штук несколько.
Отличаются количеством бесплатных генераций и ценой картинки по тарифам, наборами платных и бесплатных доп. возможностей, стилей, моделей - соразмерно степени жлобства владельцев.
Тарифы как правило от 10 бакс/мес, но где-то этого хватит на полста картинок, а где-то на тысячи.
Самые ушлые предоставляют типа полный безлимит all Free доступ, со всеми функциями, но после первой же генерации начинают канючить донаты, сообщая что часть функций временно отключена из-за роста затрат на..., итп.
Stable Diffusion 3 и FLUX на крупных планах рисуют считай одно и то же лицо, и детский садик в трениках на прямой дорожке.
Оно понятно - FLUX создан выходцами из компании Stability AI, авторами Stable Diffusion. И видать - не с нуля.
PhotoStab v2 и PhotoStab v2.5 видно тоже из этой серии. НО: Stable Diffusion 3 выхолощен донельзя внутренней цензурой, урезаны возможности применения стилей итд, а цензуры во FLUX минимум.

Stable Diffusion 3.5 - стало похоже на смесь ранешних версий и SD 3. Фигня какая-то. Еще и обязательный юэсэй-шеврон на полрукава. фи.

DALL-E 3 - это вот такие, зачастую полу-кукольные картинки. DALL-E 3 у нас мало где доступна, да и шут с ней.

Ideogram_2.0 - старомодные spacesuit с обязательным чепчиком, и кривенькие девчули на общих планах, в особо мрачном антураже. Где-то упоминалось, что модель сделана на основе DALL-E 2.

Leonardo_Phoenix, хм, Портреты весьма своеобразные. А на общих планах по первому впечатлению результат напоминает Ideogram мрачностью и DALL-E кукольностью. Локации выглядят пустовато. М.б. тоже сделано на базе DALL-E?
Есть вроде бы один заметный плюс - на мелких планах неплохо прорабатывает лица, в отличие от SD и SDXL. B Leonardo можно тренировать пользовательские модели, на платном тарифе ессесно.

MidJourney - Иногда хорошо "ловит фазу" движения, с динамикой в позах тут заметно лучше, чем у прочих. Вместо фото то и дело выдаёт некий арт-стиль, или рисует что-то э-э... странное.
Насколько модели генерации в доступных НС соответствуют оригиналу - вопрос пока открытый.

Лица бывают весьма нестандартные, убрал под кат, чтоб не винили потом "как это развидеть"
Kandinsky_3.1 - используется только на fusionbrain.ai, результаты заметно отличаются от прочих, в том числе кривизной рук и ног.
YandexART(Шедеврум) - результаты своеобразные, иногда даже неплохо. ИМХО, Шедеврум в.2 обучали на тех же датасетах, что и FLUX, но накрутили чего-то ещё.
Он мутирует прям на глазах, стал рисовать меньше страшных теток (и больше мелких девчулек), блочит запросы типа "Имя, 12-year-old girl" (но "Имя, а twelve-year-old girl" не блочит, хм?), вместо фото стабильно рисует какой-то арт-стиль.
Фразу "professional photo" может истолковать по-иному, вручив персонажу массивную зеркалку.
Ещё Шедеврум открыл для себя способ бороться с кривизной лиц - рисуя шлем скафандра закрытым.
Так же как SD3.5 и FLUX то и дело разворачивает персонажа лицом к зрителю, который должно быть скрыт в глубине кадра.
Сделали бы ему уже полноценную десктопную версию, и возможность создания пользовательских моделей.

Когда речь заходит о дообучении моделей генерации, начинается путаница в терминах.
В Stable Diffusion есть функция создания пользовательской модели генерации на основе загруженных картинок, с которых выделяется стиль, объект или персонаж.
Т.е. создается некий набор пресетов/предустановок итп, который после применяестя для генерации изображений в соответствующей версии модели/движка.
Для моделей малого объема (десятки-сотни мегабайт) есть свой термин "LoRA". Влияющие на стиль изображения - именуются Стилями.
Есть модели, дообученные на нескольких картинках, есть - на миллионах картинок. Есть сборки на основе разных моделей, весом в десятки гигов. Их оооочень много.
Встречал инфу, что моделей для Stable Diffusion в общем доступе свыше 7000. Семь тысяч. По другим данным 20 000.
Модели, стили, лоры можно смешивать, применяя одновременно. Но далеко не каждый сервис даёт такую возможность.
Как это влияет на результат, можно попробовать на Krea.AI.
Krea.AI.
Вход через аккаунт Гугл, или по емейлу.
Понимает запросы на русском, размер промпта до 1800 знаков,
Есть бесплатный доступ, 24 генерации в день, 200 сompute units на аккаунт, для пробы. Разные типы генераций стоят по разному. Тарифы 10, 35, 60$/мес.
Есть возможность создания пользовательских моделей. За 10$/мес можно сделать 3 своих модели для SDXL.
Krea AI выделяется такой фишкой: может вести процесс генерации в режиме реального времени, с возможностью корректировки промежуточных результатов. Делает это в SDXL.
Изменения промта, добавление фильтра/стиля, загрузка картинки-образца и другие действия в считаные секунды отражаются на xолсте, успевай только сохранять.
Есть другая фишка (работает на FLUX) - генерация с возможностью смешивать до пяти стилей, указывая их влияние с шагом 0,1.
Доступно, правда, всего чуть больше сотни стилей, крохи...
Для примера - стили выставлены с весом 0.8 по умолчанию (верхняя левая без стиля):

А тут стили смешаны в разных пропорциях:

В общем, рисование с нейросеткой - это игра типа лотереи. Причем каждоразовое ожидание чуда всё чаще сменяется на мрачную уверенность, что результат будет предсказуемо негодный.
И наступает понимание, что для того чтоб нарисовать Алису с помощью нейросети, нужно создать модель, обучив нейросеть на множестве изображений Алисы. Которых ещё нет. Круг замыкается.
Но.
Есть рисунки Мигунова, по которым складывалось первое представление об Алисе.
Загрузив пару десятков его рисунков для пробы, я получил некую модель, стиль.
И она как-то работает:



Перебрав пару-тройку десятков нейросеток, начинаешь замечать, что многие результаты имеют явное сходство между собой, и становится охота понять, как так получается.
Если "заглянуть под капот" той или иной НС, то обнаружится движок, или модель генерации (или несколько), которую эта НС использует.
Оригинальных движков, понятно, сильно меньше чем сайтов для генерации изображений.
Основные - DALL-E, Stable Diffusion и MidJourney. Вроде бы еще Flux, YandexART, Ideogram, Kandinsky и Leonardo подаются как оригинальные модели генерации.
Модели обучаются на датасетах для машинного обучения, с парами «картинка-текст», общими для многих НС.
Соответственно, постоянно обновляются их версии, в ходу сейчас в основном вот что:
Stable Diffusion: SD 1.4, SD 1.5, SD 1.6, SD 2.0, SD 2.1, SDXL или SDXL 1.0, SD UIweb, SD 3 (Medium, Large, Turbo), Stable Image Ultra, и вот на днях SD 3.5 (Large, Turbo),
FLUX: FLUX.1 [pro], FLUX.1 [dev], FLUX.1 [schnell];
DALL-E: DALL-E 3 (и старый DALL-E 2);
Leonardo_Phoenix;
MidJourney 4, 5, 5,1, 5.2, 6, 6.1.
Ideogram 1.0, 2.0,
YandexART,
Kandinsky 3.1.
Stable Diffusion встречается чаще всех. Потому что исходник SD в открытом доступе, можно установить хоть себе на комп (если видяха достаточно мощная).
Из всех версий самые ходовые SD 1.5, SD 2.1 и SDXL. В чистом виде без доп. стилей рисуют милоту в белых скафандрах крупным планом и страаашненьких Alice Selezneva в полный рост.
Вообще, в этих версиях SD все лица на мелких планах обычно кривые.
Test_1_Prompt / Test_2_Prompt:
► Показать

Перечислять НС, которые используют Stable Diffusion нет смысла, их многие десятки. А можнт и сотни. Только "Оффициальных платформ SD в России" штук несколько.
Отличаются количеством бесплатных генераций и ценой картинки по тарифам, наборами платных и бесплатных доп. возможностей, стилей, моделей - соразмерно степени жлобства владельцев.
Тарифы как правило от 10 бакс/мес, но где-то этого хватит на полста картинок, а где-то на тысячи.
Самые ушлые предоставляют типа полный безлимит all Free доступ, со всеми функциями, но после первой же генерации начинают канючить донаты, сообщая что часть функций временно отключена из-за роста затрат на..., итп.
Stable Diffusion 3 и FLUX на крупных планах рисуют считай одно и то же лицо, и детский садик в трениках на прямой дорожке.
Оно понятно - FLUX создан выходцами из компании Stability AI, авторами Stable Diffusion. И видать - не с нуля.
PhotoStab v2 и PhotoStab v2.5 видно тоже из этой серии. НО: Stable Diffusion 3 выхолощен донельзя внутренней цензурой, урезаны возможности применения стилей итд, а цензуры во FLUX минимум.

Stable Diffusion 3.5 - стало похоже на смесь ранешних версий и SD 3. Фигня какая-то. Еще и обязательный юэсэй-шеврон на полрукава. фи.

DALL-E 3 - это вот такие, зачастую полу-кукольные картинки. DALL-E 3 у нас мало где доступна, да и шут с ней.

Ideogram_2.0 - старомодные spacesuit с обязательным чепчиком, и кривенькие девчули на общих планах, в особо мрачном антураже. Где-то упоминалось, что модель сделана на основе DALL-E 2.

Leonardo_Phoenix, хм, Портреты весьма своеобразные. А на общих планах по первому впечатлению результат напоминает Ideogram мрачностью и DALL-E кукольностью. Локации выглядят пустовато. М.б. тоже сделано на базе DALL-E?
Есть вроде бы один заметный плюс - на мелких планах неплохо прорабатывает лица, в отличие от SD и SDXL. B Leonardo можно тренировать пользовательские модели, на платном тарифе ессесно.

MidJourney - Иногда хорошо "ловит фазу" движения, с динамикой в позах тут заметно лучше, чем у прочих. Вместо фото то и дело выдаёт некий арт-стиль, или рисует что-то э-э... странное.
Насколько модели генерации в доступных НС соответствуют оригиналу - вопрос пока открытый.

Лица бывают весьма нестандартные, убрал под кат, чтоб не винили потом "как это развидеть"
► Показать
Kandinsky_3.1 - используется только на fusionbrain.ai, результаты заметно отличаются от прочих, в том числе кривизной рук и ног.
YandexART(Шедеврум) - результаты своеобразные, иногда даже неплохо. ИМХО, Шедеврум в.2 обучали на тех же датасетах, что и FLUX, но накрутили чего-то ещё.
Он мутирует прям на глазах, стал рисовать меньше страшных теток (и больше мелких девчулек), блочит запросы типа "Имя, 12-year-old girl" (но "Имя, а twelve-year-old girl" не блочит, хм?), вместо фото стабильно рисует какой-то арт-стиль.
Фразу "professional photo" может истолковать по-иному, вручив персонажу массивную зеркалку.
Ещё Шедеврум открыл для себя способ бороться с кривизной лиц - рисуя шлем скафандра закрытым.
Так же как SD3.5 и FLUX то и дело разворачивает персонажа лицом к зрителю, который должно быть скрыт в глубине кадра.
Сделали бы ему уже полноценную десктопную версию, и возможность создания пользовательских моделей.

Когда речь заходит о дообучении моделей генерации, начинается путаница в терминах.
В Stable Diffusion есть функция создания пользовательской модели генерации на основе загруженных картинок, с которых выделяется стиль, объект или персонаж.
Т.е. создается некий набор пресетов/предустановок итп, который после применяестя для генерации изображений в соответствующей версии модели/движка.
Для моделей малого объема (десятки-сотни мегабайт) есть свой термин "LoRA". Влияющие на стиль изображения - именуются Стилями.
Есть модели, дообученные на нескольких картинках, есть - на миллионах картинок. Есть сборки на основе разных моделей, весом в десятки гигов. Их оооочень много.
Встречал инфу, что моделей для Stable Diffusion в общем доступе свыше 7000. Семь тысяч. По другим данным 20 000.
Модели, стили, лоры можно смешивать, применяя одновременно. Но далеко не каждый сервис даёт такую возможность.
Как это влияет на результат, можно попробовать на Krea.AI.
Krea.AI.
Вход через аккаунт Гугл, или по емейлу.
Понимает запросы на русском, размер промпта до 1800 знаков,
Есть бесплатный доступ, 24 генерации в день, 200 сompute units на аккаунт, для пробы. Разные типы генераций стоят по разному. Тарифы 10, 35, 60$/мес.
Есть возможность создания пользовательских моделей. За 10$/мес можно сделать 3 своих модели для SDXL.
Krea AI выделяется такой фишкой: может вести процесс генерации в режиме реального времени, с возможностью корректировки промежуточных результатов. Делает это в SDXL.
Изменения промта, добавление фильтра/стиля, загрузка картинки-образца и другие действия в считаные секунды отражаются на xолсте, успевай только сохранять.
Есть другая фишка (работает на FLUX) - генерация с возможностью смешивать до пяти стилей, указывая их влияние с шагом 0,1.
Доступно, правда, всего чуть больше сотни стилей, крохи...
Для примера - стили выставлены с весом 0.8 по умолчанию (верхняя левая без стиля):

А тут стили смешаны в разных пропорциях:

В общем, рисование с нейросеткой - это игра типа лотереи. Причем каждоразовое ожидание чуда всё чаще сменяется на мрачную уверенность, что результат будет предсказуемо негодный.
И наступает понимание, что для того чтоб нарисовать Алису с помощью нейросети, нужно создать модель, обучив нейросеть на множестве изображений Алисы. Которых ещё нет. Круг замыкается.
Но.
Есть рисунки Мигунова, по которым складывалось первое представление об Алисе.
Загрузив пару десятков его рисунков для пробы, я получил некую модель, стиль.
И она как-то работает:



- Привет Алисе. Мне двенадцать. Я пошёл.
-
Schustram
- Сообщений: 671
- Зарегистрирован: 27.02.2019, 13:31
- Реальное имя: Анатолий
- Желаемая форма обращения: Всё равно
- Откуда: Москва
- Благодарил (а): 1778 раз
- Поблагодарили: 63 раза
- Возраст: 53
- Контактная информация:
Рисуем Алису с нейросетями
Лапин,
Ну, Лапин, ты замутил! Молодец!
Это хорошо когда есть свободное время и комп перед носом. Я этим обделён. Двигай Тему.
Ну, Лапин, ты замутил! Молодец!
Это хорошо когда есть свободное время и комп перед носом. Я этим обделён. Двигай Тему.
Чем дальше в лес, тем толще штурмовик.
-
Лапин
Автор темы - Сообщений: 348
- Зарегистрирован: 15.09.2005, 11:15
- Желаемая форма обращения: Как хотите к себе
- Откуда: Планета по имени Алиса
- Благодарил (а): 18 раз
- Поблагодарили: 285 раз
- Контактная информация:
Рисуем Алису с нейросетями
Krea.ai. SDXL+(MIGUNOVBOOKGRAFIC)
prompt:








C этой моделью много чего не нарисуешь, с 20 картинок обучилась немногому. Даже красный комбез рисует в основном белым, как принято в SDXL
Для второй модели загрузил 300+ мигуновских рисунков. Вторую неделю висит в статусе "Started",
.
prompt:
► Показать








C этой моделью много чего не нарисуешь, с 20 картинок обучилась немногому. Даже красный комбез рисует в основном белым, как принято в SDXL
Для второй модели загрузил 300+ мигуновских рисунков. Вторую неделю висит в статусе "Started",
- Привет Алисе. Мне двенадцать. Я пошёл.
-
Schustram
- Сообщений: 671
- Зарегистрирован: 27.02.2019, 13:31
- Реальное имя: Анатолий
- Желаемая форма обращения: Всё равно
- Откуда: Москва
- Благодарил (а): 1778 раз
- Поблагодарили: 63 раза
- Возраст: 53
- Контактная информация:
Рисуем Алису с нейросетями
Тут дело скорее всего в том, что обучить именно сетку до конца невозможно. Она "забывает", на мой взгляд, всё то, что нарисовала пять минут назад. Скорее всего контроль установлен, чтобы лишнего не развивалась.
Последний раз редактировалось Schustram 04.11.2024, 05:50, всего редактировалось 1 раз.
Чем дальше в лес, тем толще штурмовик.
-
Дин-70
- Сообщений: 15085
- Зарегистрирован: 09.09.2009, 19:13
- Реальное имя: Дмитрий
- Желаемая форма обращения: Всё равно
- Благодарил (а): 16 раз
- Поблагодарили: 5611 раз
Рисуем Алису с нейросетями
По личному опыту скажу, что всё, что рисует нейросеть, воспринимать следует как эскиз, который потом надо дорабатывать в фотошопе.
Кто сейчас на конференции
Сейчас этот форум просматривают: нет зарегистрированных пользователей и 20 гостей






