Раніше ми розповідали про свої враження та результати тестування додатків на основі нейромережі. У роботі над платформою «РСГБ у цифрі» ми активно використовуємо Midjourney. У новій статті хочемо поділитися своїми напрацюваннями, які допоможуть з нуля розібратися в основних функціях та командах (версія Midjourney 5.1), щоб розпочати створення цікавих зображень за допомогою цієї програми. Зараз використовувати Midjourney можна тільки через Discord, де створюється обліковий запис. Midjourney відображається в Discord окремим загальним сервером, де різні користувачі генерують зображення у спільних чатах. Ще робота можна додати на власний сервер і взаємодіяти без сторонніх людей. На зображенні позначено спільний сервер Midjourney з різними каналами для генерації зображень, та особистий, до якого можна додати чат-бот. Взаємодія з ботом Midjourney в Discord відбувається за допомогою команд. Команди використовуються для створення зображень, зміни налаштувань за промовчанням, відстеження інформації про користувача та виконання інших корисних завдань. /imagine – генерує унікальне зображення із короткого текстового опису. /settings - відкриває поле зі спрощеними налаштуваннями генерації, якості, приватності тощо. У вікні швидких налаштувань можна вибрати: /info — викликає вікно з підпискою. /subscribe - викликає вікно з можливістю переходу до тарифних планів. /blend — допомагає схрещувати зображення, коли хочемо з кількох отримати щось спільне. Без цієї команди також можна створити змішане зображення, але підвантажуючи кілька посилань та описуючи результат. /prefer option set — дозволяє зберегти настройки, що часто використовуються: вводимо команду, далі вказуємо назву для налаштування, а потім сам параметр через елемент «--». приклад: /prefer option set mine --hd --ar 16:9 промт створює опцію під назвою « mine », при введенні якої в рядок запиту як --mine Midjourney зчитуватиме її як --hd --ar 16:9 Усі створені налаштування можна переглянути через команду /prefer option list. /help - показує корисну інформацію та поради про бот Midjourney. 1. Введіть /imagine prompt: або виберіть команду /imagine у спливаючому вікні команд з косою межею. 2. Введіть опис зображення, яке потрібно створити, в prompt полі. 3. Надішліть повідомлення. Midjourney Bot найкраще працює з простими короткими пропозиціями.Довгі запити можуть ламати логіку на згенерованому зображенні або призводити до неякісних результатів. Після завершення генерації з'являються зображення та кілька додаткових командних кнопок: Кнопки
U масштабують зображення, створюючи збільшену версію вибраного зображення (збільшене зображення трохи відрізнятиметься від оригіналу). Кнопки V створюють невеликі варіації вибраного зображення сітки. При створенні варіанта створюється нова сітка зображення, аналогічна загальному стилю та композиції вибраного зображення. Кнопка «Оновити» створює нові зображення під поточний запит. Після використання масштабування зображення (Кнопки U) з'явиться новий набір параметрів: "Make Variations" створює новий набір із чотирьох варіантів на основі поточного. «Web» відкриває зображення у своїй галереї на Midjourney.com. "Favorite" допомагає відзначити найкращі зображення, щоб їх було легко знайти на веб-сайті Midjourney. Нещодавно було додано нову функцію "Remaster", не просто генерує варіанти на запит, а допрацьовує вже сформований варіант. Чим більший об'єкт на зображенні, тим більше шансів, що "Remaster" спрацює добре. Чим дрібніші деталі, тим складніше Midjourney помітити та переосмислити їх. Нині функцію "Remaster" прибрали, чи з'явиться вона знову - відповіді немає. Для отримання результату, максимально наближеного до бажаного, запити Midjourney краще писати, дотримуючись певної структури після /imagine prompt : 1. сюжет зображення; 2. стиль зображення; 3. інформація про розмір, освітлення і т.д. Для поділу запиту на складові необхідно використовувати коми або двокрапки (при необхідності суворого розмежування). Приклад: beautiful happy cow in meadow with flowers in perfect hair to spike, high wool detail, warm sunny day: : illustration style: : --ar 16:9 Важливо!
Midjourney однаково сприймає два короткі дефіси «--» та довге тире «—» --ar - Встановлює чітке співвідношення сторін. --q — встановлює якість зображення; за умовчанням якість дорівнює 1 (--q 2 – збільшує деталізацію, але витрачає більше машиночасу, --q 0.5, --q 0.25 відповідно, зменшує якість, але витрачає менше машиночасу; --q 5 – експериментальне налаштування) --no — виключає деталі, наприклад «--no cow» означатиме відсутність корів на зображенні (принаймні Midjourney спробує їх робити). --uplight — дозволяє масштабувати зображення (кнопка U) зменшити відмінність від оригіналу (при збільшенні зображення завжди є невелика різниця, особливо у невеликих деталях). :: - якщо додати значення від -1 до 2 до будь-якого слова в запиті (в даному випадку без пробілів), можна розподілити умовну вагу запиту, тобто важливість тієї чи іншої підказки перед іншими. команді - no. Приклад: за запитом "/imagine prompt: hot dog::1.5 food::-1" буде створена "гаряча собака", не їжа; а по промту "hot dog" буде створена сосиска. dog» поділ буде аналогічним. Коли подвійна двокрапка «::» використовується для розділення підказки на різні частини, можна додати число відразу після подвійної двокрапки, щоб призначити відносну важливість цієї частини підказки. приклад:
hot:: dog згенерував гарячу собаку. «гарячий» вдвічі важливіше за слово "собака". --iw — встановлює вагу зображення щодо ваги тексту. --chaos - вносить різноманітність у результати. Діапазон значень від 0 до 100. Чим вище значення, тим незвичайніша буде композиція, але на шкоду самому запиту. Приклад: beautiful happy cow in meadow with flowers in perfect hair to spike, high wool detail, warm sunny day, illustration, wallpaper --ar 16:9 --chaos 100 beautiful happy cow in meadow with flowers in perfect hair to spike, high wool detail, warm sunny day, illustration, wallpaper --ar 16:9 --chaos 0 На другому зображенні у запиті ми лише змінилися число, написавши "0" замість "100", а результат отримали зовсім інший. --seed — застосовується у разі потреби створювати максимально схожі зображення; діапазон значень від 0 до 4294967295. Якщо параметр не вказано, автоматично вибирається випадкове число. Приклад: beautiful happy cow in meadow with flowers in perfect hair to spike, high wool detail, warm sunny day, illustration, wallpaper --ar 16:9 --seed 1234567 --s — стилізація зображення: що вище значення, то вища стилізація. Беремо промт: beautiful happy cow in meadow with flowers in perfect hair to spike, high wool detail, wallpaper --ar 16:9 Зображення в Midjourney можна ставити ракурс. Ми можемо отримати як портрет, так і вид із висоти пташиного польоту. Відразу уточню, спрацьовує який завжди на 100%, т.к. дуже багато залежить від довжини та складності самого запиту, але, проте, знати про це варто. Коли необхідно отримати зображення з прямою перспективою, додатково слід вказати «Looking into the camera» або «full-face ». Однак Midjourney часто сам пропонує саме такі візуали. Якщо потрібен вид зверху, то найпростіші варіанти "drone shot photo of" або "birds-eye-view photo". Варіанти схожі, але також можуть змінюватись в залежності від запиту. Приклад: Drone shot photo of Beautiful happy cow in meadow with flowers in perfect hair to spike, high wool detail, wallpaper --ar 16:9 Приклад: birds-eye-view photo Beautiful happy cow in meadow with flowers in perfect hair to spike, high wool detail, wallpaper --ar 16:9 Також можна трохи підняти кут огляду за допомогою введення вказівки «High- angle photo of» або опустити камеру через запит «a hip/knee/ground level shot of» (спрацьовує частіше) або "view from below". Вигляд знизу і не дуже (іноді й таке буває). Ілюстрації нижче. При необхідності отримати певний кут огляду, використовуємо "in profile", "three quarter view", "back view". Відразу уточню, що на людях дані налаштування працюють безперечно краще, але т.к. у нас корова, працюватимемо з нею. Зображення можна зробити різного плану: портрет, середній план, на повне зростання або здалеку. Для цього до запиту додаємо "closeup photo" або "closeup shot", "medium-full photo/shot", "full photo/shot" або "full body photo/shot". Відповідно, якщо хочемо зобразити групу об'єктів, що містяться на зображенні цілком або видимі здалеку, використовуємо long photo/shot , a wide photo/shot і view from afar . Спробуємо також ефект риб'ячого ока чи GoPro. Важливо! Зверніть увагу: використання в запиті описів, що суперечать один одному, не буде призводити до бажаних результатів, наприклад, ми хочемо отримати вид здалеку, але, при цьому, вказуємо на задоволену морду корови або високу деталізацію вовни. Для прикладів "long photo" і "view from afar" зробимо запит трохи простіше: cow in a meadow, --ar 16:9» Ефект риб'ячого ока теж виглядає досить цікаво, додаємо «GoPro» За варіантами простого освітлення все дуже легко. Необхідно просто вказати в запиті той часовий інтервал або джерело світла, яке необхідно отримати, наприклад: "sunny afternoon", "daylight", "incandescent light", "backlighting" і т.д. Midjourney є відмінним інструментом для дизайнерів, ілюстраторів та багатьох інших людей творчих професій. Цей інструмент дозволяє втілювати в життя найсміливіші ідеї, створювати незвичайний та унікальний контент у різних стилях та варіаціях. Бажаний результат не завжди виходить з першого і навіть з десятого разу, але, спробуйте і експериментуйте. Експерти діляться досвідом, як складати промпти, генерувати варіанти рішень та економити години роботи. Ілюстрація: Поліна Честнова для Skillbox Media Вчиться на графічного дизайнера в BBE, викладає англійську та розвиває до розорення збитковий керамічний проект Bröken. Midjourney - одна з найпопулярніших нейромереж серед дизайнерів, художників та розробників ігор. Ми вирішили поговорити з тими, хто використовує її для своїх робочих завдань, та з'ясувати: що саме варто робити з цим ІІ, як отримувати від алгоритму якісні результати та які можливості він відкриває. Midjourney - сервіс на базі алгоритмів штучного інтелекту, за допомогою якого можна отримати готові зображення лише за текстовим описом. Щоб згенерувати картинку, треба зайти до Discord. На цій платформі є спеціально відведений "простір" - сервер Midjourney, в інтерфейсі якого користувачі вводять текстову команду - промпт. У відповідь алгоритм генерує зображення так, як він зрозумів завдання. Прохання намалювати Cactus Case - ящик для кактусів - ІІ зрозумів не зовсім буквально і видав зображення кактусів у кейсі-чохлі для смартфона Завдання цієї нейромережі — створювати зображення, тому використовують її насамперед у сферах, де візуалізація відіграє ключову роль. Ведучий бренд-дизайнер у «Тінькофф» — В основному я використовую Midjourney або для створення візуалізацій за ідеями, або для створення фотоконтенту. Наприклад, я працювала над креативною ідеєю реклами. Вона мала і трансформуватися у відеоролик, і реалізовуватися в статиці — постерах, банерах, рекламі в інтернеті. Щоб якісно проілюструвати ідею, мені знадобилося б зробити складний фотомонтаж у Photoshop і витратити на нього день або два. А завдяки Midjourney я вирішила це завдання за чотири години: нагенерувала візуальне рішення та злегка доопрацювала його у графічному редакторі. Найчастіше доводиться витрачати багато часу на пошук відповідних образів в інтернеті або у власних архівах. Якщо використовувати нейромережу, достатньо ввести запит, і Midjourney запропонує добірку зображень. Це не тільки економить час, а й дозволяє зробити мудборди та чернетки проектів більш креативними та ефективними. Партнер у VOSK — Спочатку, як і всі, ми в студії бавилися, робили різні картинки із закосом під стиль відомих художників. Потім стало зрозуміло, що можна генерувати контент для Інтернету, айдентики. Наприклад, робити «рибні» візуалізації продукту для e-commerce, проектувати архетип бренду за допомогою унікальних промптів та збирати зі згенерованих картинок точніші мудборди. Читайте думку експертів про AI, який змінить індустрію дизайну, але не замінить людей: "Припинити боятися і полюбити нейромережі". Основне місце дії для генерування картинок у Midjourney – це сервер Discord, а саме – канали Newcomer Rooms. Вони розділені на сотні підрозділів під назвою Newbies, і саме в них користувачі за допомогою робота створюють і публікують картинки. Розділи Newbies зліва на панелі. Користувач може побачити їх тільки після того, як приєднається до сервера Сервіс видає зображення за спеціальним текстовим описом - промпти, до яких треба додавати комбінації команд і параметрів. Згенерована картинка близько схожа на предметну фотозйомку Штучний інтелект сам не вигадує і не творить: він працює на складних математичних моделях, на основі яких відбувається аналіз текстової інформації, що надійшла. Саме від якості, повноти та чіткості вхідної інформації – промпту – залежить результат. Тому якщо дизайнер вирішує використовувати Midjourney для вирішення своїх робочих завдань, а не просто для експериментів та хобі, йому важливо навчитися складати правильні промпти. Ось що порадили експерти. Співзасновник дистанційної студії брендингу Prizma Studio, де займається арт-дирекшеном бренд-айдентики - Вдалі промпти - це постійний процес пошуку та експерименти. Спочатку я практично весь час копіювала ключові слова та запити з вдалих, на мою думку, результатівзгенеровані іншими користувачами або ботом Midjourney. Так набралася «бібліотека» із ключових слів, якими я користуюсь досі. До того ж кожне таке ключове слово, яке я відпрацювала, допомогло мені зрозуміти, як працює інструмент. Також раджу мати під рукою бібліотеку з «Гітхаба» з добіркою стилів та інструментів, яким навчена Midjourney. Дуже люблю команду /Blend — використовую її для міксування зображень, щоб отримати щось нове, виходячи з набору існуючих картинок. — Я вчуся складати промпти методом підбору, спроб та помилок. Наприклад, вивела закономірність: перерахування через подвійну двокрапку (::) працює краще, ніж через кому. Рекомендую класний параметр "--chaos", який допомагає генерувати максимально різні варіанти на один і той же запит - це зручно. Взагалі, я по шматочках збираю інформацію, як користуватися ІІ. Багато що є у самому Midjourney: наприклад, такий гайд про написання промптів. Обережно, він гігантський і англійською. - Ефективно користуватися нейромережами допомагають інтуїція, Reddit, телеграм-канали. Все у різному співвідношенні. Ще допомагають промпт-дешифрувальники, коли потрібно вичленувати один із неочевидних промптів. Жук-самодур та вільний дизайнер — Познайомив мене з Midjourney арт-директор Endy, і він дав мені міцну базу більше з концептуальної сторони, ніж практичної. Замість «пиши так, отак і так» він навчив: «Для Midjourney потрібно писати історію, картину, а не набір фактів». Крім цього я читаю канали друзів та знайомих, дивлюся відео і так отримую більш прикладні знання: наприклад, які налаштування рендеру та світла на що впливають. І тепер я з «Яндекс Перекладачем» сиджу та пишу промпти. Перекладач тут потрібний для того, щоб я розуміла різницю між усіма синонімами одного слова та під контекст підбирала потрібне. І це, на диво, дуже важливо! "Загадковий", "містичний", "таємничий", "дивний", "невідомий" - будь-який синонім може змінити візуалізацію. Я думаю, це можна порівняти з літературою: як письменники малюють картину в уяві читача, так і інженеру нейронки потрібно вміти керувати різницею цих ледве вловимих відтінків. Рекомендуємо не ігнорувати активацію останньої версії. Сервіс Midjourney іноді допрацьовують і оновлюють: так, в актуальній версії 5.2 додали кілька функцій, які ще більше спрощують створення картинок. Деякі називають Midjourney "другим пілотом": ця нейромережа допомагає дизайнерам з вирішенням багатьох завдань, якщо використовувати її як інструмент і один з технічних ресурсів, а не "віддавати" їй повністю керування креативною роботою. Дизайнерам часто доводиться робити безліч ітерацій, щоб наблизитись до оптимальної якості результату.У Midjourney можна швидко змінювати параметри чи окремі елементи дизайну, і це прискорює робочі процеси. — Midjourney допомагає швидше перевірити, який макет працюватиме у конкретному контексті. Я в роботі керуюсь алгоритмом «гіпотеза → експеримент», і для цього потрібно перебирати багато варіантів. Нейронка чудово в цьому допомагає. Замість того, щоб розпорошуватися на малювальні дрібниці, я можу накидати візуал і подивитися, що варте подальшої уваги. Іноді дизайнерам важко придумати нове та свіже рішення, особливо під тиском термінів та бюджету. Midjourney може стати джерелом натхнення: алгоритм не втомлюється і завжди здатний запропонувати несподівані та оригінальні візуальні рішення. — Спочатку я зверталася до Midjourney заради експериментів зі смислами та образами. Наприклад: Що буде, якщо об'єднати банан і ведмедя? Зараз — для творчості та з робочих завдань. У Prizma Studio ми використовуємо Midjourney для розробки концепції або створення контенту. В арті він допомагає пробувати різні ролі: від фотографа та художника до режисера. - Я багато фантазую. Для мене Midjourney — гідний співрозмовник із такою самою свободою думки. Я вирішила не робити жодних комерційних замовлень у нейронках, незважаючи на хайп і гроші. Хочу залишити це як хобі, guilty pleasure та віддушину для досліджень меж уяви. За допомогою Midjourney можна створити базові шаблони або елементи, а потім адаптувати їх до різних проектів. Так у зображень точно буде єдиний стиль: алгоритм не може вийти за межі заданих стандартів. — Нині почали з'являтися кастомізовані рішення з нейромережами, які, наприклад, здатні масово генерувати ілюстрації в одній айдентиці та замінювати ілюстраторів. З Midjourney можна генерувати варіативні зображення на основі існуючих картинок та фотографій. Так можна швидко та без великих витрат створити новий візуальний контент. — Можу згенерувати фото в Midjourney для чогось на зразок іншої фотографії. Наприклад, мені потрібна аватарка з обличчям людини в інтерфейс, але при цьому я не маю зачепити нічиї права. Тоді я просто можу нагенерувати "фотографію" неіснуючої персони. А ще в Midjourney я беру мокапи: відправити в чат картинку існуючого мокапа і попросити нейромережі зробити її варіації. Так можна отримати зображення для примірки дизайну швидко та безкоштовно – це непогана альтернатива фотостокам. У новачків робота з нейромережами може викликати захоплення, проте з досвідом користувачі неминуче виявляють обмеження цього інструменту. Дизайнери стикаються з проблемою «сліпих зон» у Midjourney. Буває, що платформа не може виконати деякі запити, навіть після багатьох спроб переформулювати їх. — Більше 15 разів я просила Midjourney показати мені певний принт на шарфі у дівчини, що зображається. Змінювала послідовність слів, їх написання, і в результаті нічого не сталося. Основні «знання» алгоритму певною мірою застарілі: серед усього масиву інформації, на якому навчений Midjourney, багато неактуальних візуальних рішень і порівняно мало свіжих та проривних.Щоб нейромережа генерувала образи в сучасних стилях та за останніми трендами, необхідно додатково навчати ІІ. — Бракує останніх трендових рішень. Наприклад, я хочу отримати згенеровану модну зйомку у стилі сестер Пастернак. У програми не вийде, як не крути. Все, що потрібно для роботи з Midjourney, - це чітко дотримуватися інструкцій і багато разів коригувати текстові запити. Це може позбавити творчість та пошук рішень необхідної свободи. — Те, що видає нейромережа, — це рулетка, і в роботі з AI не вдається поринути у творчість у звичному вигляді. Ти ніби перебуваєш за виробничим верстатом, де потрібна точна послідовність дій, оцінка, коригування, і так щоразу по новій. Нині на якісну генерацію зображення нейромережа витрачає від 3 до 7 хвилин. Безумовно, це набагато менше, ніж витратив би сам дизайнер чи ілюстратор на детальне відмальовування, але для деяких це може бути незручним. - Вона повільна. Я хочу швидше! Хоча я розумію, як це все працює і чому це займає стільки часу, але я щоразу сиджу і чекаю на ці важкі 3–7 хвилин. Схоже на відкриту кухню – ти бачиш, як твоя локшина готується. Це заохочує апетит. Ти відчуваєш смак, але не відчуваєш його. І це фантомне відчуття посилюється у міру того, як ти бачиш ступінь готовності. Але ти поки не можеш її спробувати, дивишся, як локшина готується - картинки вантажаться, - а потім, як можеш, насолоджуєшся результатом. Використовувати Midjourney дизайнерам необхідно – так само, як їм необхідні Figma, Adobe Illustrator, фотостоки, Awwwards та інші сучасні інструменти та джерела візуальної інформації. — На мою думку, якщо і є якась проблема з ІІ, то вона не в самому інструменті, а в очікуваннях від нього. Midjourney - не магічна коробка, яка сама зробить за вас всю роботу. Щоб працювати з нейромережею, потрібно вигадувати ідеї, підбирати референси, шліфувати промпти, а результати, що вийшли, обов'язково доопрацьовувати. Якщо розуміти і приймати це – з Midjourney все чудово. - Midjourney - це бл. Якщо і є проблеми, то скоріше у використанні, відсутності революційних комерційних інструментів на його основі та стереотипах, пов'язаних із побудовою моделей на його основі. Здається, що не вистачає фахівців з більш рівневим мисленням, які зможуть дивитися на існуючі, консервативні сфери та імплементувати в них нейромережі, а не просто генерувати забавні картинки або стандартні тексти. Більше цікавого про дизайн у нашому телеграм-каналі. Підписуйтесь! Читайте також: Ті, що відрізняються сильно або злегка - в залежності від заданого параметра.Як використовувати Midjourney: докладний гайд, лайфхакі, промти
Як працюють команди Midjourney у Discord
Основні команди
Детальніше про генерацію зображень із /imagine prompt
Додаткові установки у запитах
Трохи про додаткові промти
Ракурс, кут, план та освітлення
В кінці
Як правильно працювати в Midjourney: найкращі команди, промпти та лайфхаки від дизайнерів
Що таке Midjourney
Зображення: Suri / канал V5-showcaseЯк нейромережа Midjourney полегшує роботу дизайнерів
Маша Троїцька
Саша Базан
Дизайн у нейромережі покроково: як генерувати картинки в Midjourney
Скриншот: Skillbox Media
Зображення: juicy Pyneapple / канал V5-showcaseЯк правильно складати промпти
Збирайте свою бібліотеку промптів та команд у Midjourney
Аня Голуб
Скріншот: Аня Голуб
Ось так Midjourney поєднав два образи
Зображення: Аня Голуб / Midjourney
Перебирайте параметри промптів та синтаксис у нейромережі
Маша Троїцька
Саша Базан
Не перераховуйте факти, а пишіть твір
Микита Нова
Функції у Midjourney п'ятої версії
Однозначні плюси Midjourney
Прискорює експерименти із концептами
Микита Нова
Підганяє натхнення
Аня Голуб
Зображення: Аня Голуб / Midjourney
Микита Нова
Допомагає із систематизацією та уніфікацією
Саша Базан
Надає більше гнучкості у створенні контенту та дотриманні авторських прав
Маша Троїцька
Недоліки Midjourney
Є проблеми із виконанням специфічних запитів
Аня Голуб
Алгоритм не розуміється на трендах
Аня Голуб
Є ризик механізації креативного процесу
Аня Голуб
Швидкість
Микита Нова
Навіщо використовувати нейромережу
Маша Троїцька
Саша Базан