생성형 AI 시대에 맞춘 디자인

미드저니 사용법의 모든 것(AI 이미지 쉽게 만들기)

본문 썸네일

디자이너가 한 장의 완성도 높은 그림을 그리기까지 투자한 시간은 얼마나 될까요? 최소한 고등학교 다니던 입시생부터 봐야 하지 않을까요? 하지만 이제 이 모든 노력과 시간을 가볍게 만들어 버리는 존재가 있습니다. 그것은 바로 생성형(generative) AI입니다. 오늘은 생성형 AI 시대에 알아두면 쓸 데 있는 디자인 지식에 대해 알아보겠습니다.


🐵 목차

  • 생성형(generative) AI란?
  • 이미지 생성 AI, 미드저니

생성형(generative) AI란?


생성형 AI는 사용자가 AI에 요청하는 텍스트인 ‘프롬프트(prompt)’를 분석하여 사용자가 요구하는 이미지, 영상, 글, 음악을 생성하는 인공지능을 뜻합니다. 이러한 생성형 AI를 통해 소설을 쓰기도 하고 영상을 만들며 게임 아트부터 사진과 일러스트레이션까지 작업하는 사례가 심심치 않게 등장하고 있습니다. 그렇기 때문에 생성형 AI를 배우고자 하면 무엇부터 시작해야 할지 복잡함을 느끼게 되죠. 이는 너무 다양한 종류의 생성형 AI 서비스가 파편화되어 있기 때문입니다. 

이미지 생성 ai


이미지 생성 AI, 미드저니


대표적으로 이미지 생성 AI를 찾아봅시다. 아마도 가장 많이 거론되는 툴은 미드저니(Midjourney)일 것입니다. 그리고 챗 GPT로 유명한 Open AI의 이미지 생성 인공지능인 Dall-E, 이미지와 영상을 생성하는 스테이블 디퓨전(Stable Diffusion)이 거론될 것입니다.


이 툴 중에서 입문자가 배워야 한다면 미드저니를 추천합니다. 미드저니는 초보자가 쉽게 따라 할 수 있도록 가이드가 상세히 제시되어 있습니다. 또한 실시간으로 다른 사용자의 이미지가 생성되는 과정을 보며 아이디어 교환에 긍정적인 영향을 미칩니다. 미드저니가 다른 생성형 AI 서비스보다 먼저 이슈가 된 만큼 여러 방법도 쉽게 찾아볼 수 있습니다. 



1. 미드저니는 어떤 서비스일까?

미드저니 커뮤케이션 서비스인 디스코드(Discord)에서 사용하는 서비스입니다. 월 구독료는 10달러부터 120달러까지 제시되어 있습니다. 미드저니 구독제는 생성형 AI를 사용하는 시간으로 설정되어 있습니다. 가장 저렴한 Basic 구독으로 10달러에 이미지 생성 모드를 200분간 사용할 수 있습니다.



2. 미드저니에서 어떻게 이미지를 생성할까?

미드저니에서 이미지를 생성하고자 한다면 디스코드 하단 채팅 창에 ‘/prompt’를 작성하면 됩니다. 그러면 프롬프트를 작성할 텍스트 박스가 생성됩니다. 그 후, 이 텍스트 박스에 필요한 이미지 내용을 작성하면 됩니다. 보편적으로 프롬프트를 작성하면 1:1 정사각형 비율의 이미지가 4점 생성됩니다. 그리고 원하는 이미지 스타일과 관련된 이미지를 더 생성하도록 요구하거나 더 큰 크기로 이미지를 보도록 요구하는 버튼이 함께 배치됩니다.


미드저니 1

(*디스코드에서 보이는 미드저니 화면)



3. 미드저니와 브랜드 디자인

미드저니에서 생성할 수 있는 이미지 범위는 매우 포괄적입니다. 사진과 같은 이미지부터 디지털 아트, 일본풍 애니메이션과 웹툰 그림체, 게임 아트와 유명 아티스트의 스타일, UI 디자인과 로고 디자인까지 생성할 수 있습니다. 


이 중에서 브랜드 디자인을 이야기하고자 합니다. 브랜드 디자인을 대표하는 작업은 로고를 디자인하는 일입니다. 디자이너가 하나의 로고를 디자인하기까지 많은 시간이 소요됩니다. 특히 작업 초기에 다양한 로고 형태를 스케치합니다. 보통 클라이언트는 1~2개 스케치를 보고 최종 디자인을 결정하지 않을 것입니다. 그러므로 다양한 로고 디자인의 스케치가 필요합니다. 이 상황에서 생성형 AI는 여러 로고 디자인을 테스트하고 스케치하는 시간을 대폭 줄여줍니다. 프롬프트만 명확하다면 초기 디자인 과정에서 보일 수 있을 정도의 로고 디자인은 짧은 시간에 10작품 이상 도출할 수 있을 것입니다.

생성형 ai 결과물

(*생성형 AI&그래픽스 강의 결과물 : 프로젝트 니브, 로고 디자인(여성민, 박광균, 박용하, 최재현))



그렇다고 미드저니로 로고 디자인을 완벽하게 할 수는 없습니다. 아직 생성형 AI가 완벽히 문자를 만들지는 못하기 때문입니다. 프롬프트로 텍스트 작성을 요구해도 뭉개지는 글자가 많습니다. 따라서 초기 스케치 과정에서 글자를 요구하지 않거나 생성한 이미지에서 글자가 놓인 영역을 지우고 보완해야 합니다. 이 과정에서 다양한 서체를 직접 실험하며 가장 나은 서체를 찾아가야 합니다. 또한 AI가 생성한 이미지는 jpg 포맷만 제공하기 때문에 로고 디자인의 이미지를 생성한 다음 일러스트레이션에서 재차 작업하여 AI 포맷으로 옮겨야 합니다. 



4. 미드저니를 어떻게 활용할 수 있을까?

제가 대학교 2학년 수업으로 개설한 '생성형 AI&그래픽스' 수업에서는 10~15분 정도 배운 '미드저니'를 활용하여 로고 디자인을 누구나 도출할 수 있다는 것을 증명했습니다. 수업 과정에서 도출한 로고 디자인의 스케치, 실험, 탐구, 최종 디자인 작업을 위해 일러스트레이터로 옮긴 과정은 다음과 같았습니다.



생성형 AI&그래픽스 강의 결과물 : 프로젝트 JOGYM (김경미, 김도영, 박효경, 신혜은)

로고 디자인 예시

(*일본 애니메이션, 게임을 좋아하는 학생을 위한 GYM 브랜드를 위해서 초기 테스트를 한 로고 디자인)


유명 캐릭터 프롬프트로 한 로고 디자인

(*스타일을 하나 선택한 뒤 유명 캐릭터를 프롬프트로 작성하여 테스트해 본 GYM 로고 디자인)

최종 형태

(*최종 형태를 선택한 뒤 일러스트레이터로 옮기고 타이포그래피를 보완한 로고 디자인)



로고 디자인을 마쳤다면 생성형 AI를 어떻게 활용할 수 있을까요? 혹시 영화나 드라마의 트레일러 영상을 기억하시나요? 트레일러 영상은 3~5분 동안 짧고 임펙트있게 콘텐츠에 대한 내용을 가능한 가득 담아서 전달하는 목적을 가지고 있습니다. 따라서 수업에서는 미드저니 외에도 다양한 생성형 AI를 배우고, 이를 응용하여 하나의 영상을 만드는 과정으로 진행되었습니다.


미드저니로 다양한 이미지를 로고 디자인의 스케치처럼 만들고 부족한 이미지는 Dall-E, 스테이블 디퓨전으로 만들었습니다. 그리고 이미지에서 사람의 얼굴을 인식하고 입을 움직이는 영상으로 만드는 D-ID, 이미지를 영상으로 생성해 주는 런웨이, 카이버, 스테이 블 디퓨전, 후보정 결과물은 에프터이펙트로 디자이너가 직접 편집했습니다. 어도비 툴처럼 오랫동안 공부하지 않아도 금방 만들 수 있다면 우리는 앞으로 AI와 어떻게 공존해야 할까요? 고민이 필요한 시점입니다. 


생성형 AI 강의 결과물

(*생성형 AI&그래픽스 강의 결과물 : 프로젝트 니브, JOGYM 영상 일부분)

강의 결과물

(*생성형 AI&그래픽스 강의 결과물 : 프로젝트 니브, JOGYM 영상 일부분)

현재 생성형 AI는 디자인 초기 작업 과정에서 다양한 디자인 스타일을 만들고 실험하는 어시스턴트로서 충분히 제 몫을 하고 있습니다. 하지만 디자인의 퀄리티를 향상하기 위해서 후보정 작업을 하거나 일러스트레이터로 옮기는 역할은 아직 인간의 몫입니다. 이 때문에 생성형 AI는 아직 사람의 일자리를 대체하지 못한다고 할 수 있습니다. 그렇지만 지금의 기술 발전 속도라면 인간과 AI가 완벽히 공존하며 디자인할 날은 곧 다가오지 않을까요?

장순규

계명대학교 시각디자인전공 교수


일상의 소소한 소재를 탐구하고

잡지식과 호기심을 상식으로 UX를 만들어 가르치고 있습니다. (@312ab)

문의하기 cta