KR20200106754A

KR20200106754A - 타겟 이미지의 채색 완성 방법, 장치 및 컴퓨터 프로그램

Info

Publication number: KR20200106754A
Application number: KR1020190025357A
Authority: KR
Inventors: 장재혁; 강성민; 이가영
Original assignee: 네이버웹툰컴퍼니 주식회사
Priority date: 2019-03-05
Filing date: 2019-03-05
Publication date: 2020-09-15
Also published as: KR102216749B1; WO2020180084A1; US20210398331A1

Abstract

본 발명의 일 실시예에 따른 레퍼런스(Reference) 이미지를 이용하여 채색하고자 하는 타겟(Target) 이미지의 채색을 완성하는 방법은, 학습된 제1 인공 신경망을 이용하여, 상기 타겟 이미지의 일부 영역을 포함하는 적어도 하나의 타겟 마스크(Mask)를 생성하는 단계; 상기 제1 인공 신경망을 이용하여, 상기 적어도 하나의 타겟 마스크 각각에 대응되고, 상기 레퍼런스 이미지의 적어도 일부 영역을 포함하는 적어도 하나의 레퍼런스 마스크를 생성하는 단계; 상기 적어도 하나의 레퍼런스 마스크의 색상을 참조하여, 상기 적어도 하나의 타겟 마스크 각각을 채색하여 적어도 하나의 채색된 타겟 마스크를 생성하는 단계; 및 학습된 제2 인공 신경망을 이용하여, 상기 타겟 이미지, 상기 적어도 하나의 타겟 마스크 및 상기 적어도 하나의 채색된 타겟 마스크로부터 채색된 타겟 이미지를 생성하는 단계;를 포함할 수 있다.

Description

타겟 이미지의 채색 완성 방법, 장치 및 컴퓨터 프로그램{Method, apparatus and computer program for coloring of a target image}

본 발명은 레퍼런스 이미지를 이용하여 채색하고자 하는 타겟 이미지의 채색을 완성하는 방법, 장치 및 컴퓨터 프로그램에 관한 것이다.

컴퓨터를 비롯한 다양한 스마트기기가 보급됨에 따라 현대에는 온라인망을 이용한 서비스, 특히 온라인을 통해 콘텐츠를 제공하는 서비스가 제공되고 있다.

온라인으로 만화 콘텐츠를 제공하는 웹툰 서비스가 이러한 서비스 들의 대표적인 예시이다.

종래기술에 따르면, 이러한 만화 콘텐츠의 제작을 위해 제작자가 모든 장면을 개별적으로 작성하였다. 그러나 오늘날 이러한 방식에 따른 콘텐츠 제작 속도는 온라인 콘텐츠 시장의 확대 속도 및 이에 따른 사용자 수의 증가 속도를 따라가지 못하여 원활한 콘텐츠의 공급을 방해하는 요소로써 작용한다.

따라서 보다 효율적인 웹툰 콘텐츠의 제작 방법의 필요성이 대두되고 있다.

본 발명은 온라인 콘텐츠를 보다 효율적으로 제작할 수 있도록 하고자 한다.

특히 본 발명은 웹툰과 같은 사용자의 채색이 필요한 콘텐츠의 제작에 있어서, 사용자가 채색에 사용하는 시간을 절감시킴으로써 콘텐츠를 보다 빠른 시간 내에 제작할 수 있도록 하고자 한다.

또한 본 발명은 사용자에 의하지 않은 이미지의 자동 채색에 있어서, 함께 제공된 레퍼런스 이미지를 참조하여 채색을 수행함으로써, 사용자의 니즈에 보다 부합하는 채색을 수행하고자 하며, 이로써 사용자의 수정에 따른 작업 시간을 절감시키고자 한다.

상기 제1 인공 신경망은 각 영역에 채색하고자 하는 색상의 유사도에 기초하여 상기 타겟 이미지를 적어도 하나의 영역으로 구분하고, 구분된 적어도 하나의 영역 각각을 포함하는 상기 적어도 하나의 타겟 마스크를 생성하도록 학습된 신경망일 수 있다.

상기 적어도 하나의 타겟 마스크는 상기 타겟 이미지를 구성하는 복수의 지점 각각이 적어도 하나의 타겟 마스크 각각에 포함되는지 여부를 포함할 수 있다.

상기 제1 인공 신경망은 각 영역에 채색하고자 하는 색상의 유사도 및 상기 적어도 하나의 타겟 마스크에 포함된 영역과의 형상 유사도에 기초하여, 상기 레퍼런스 이미지를 적어도 하나의 영역으로 구분하고, 구분된 적어도 하나의 영역 각각을 포함하는 상기 적어도 하나의 레퍼런스 마스크를 생성하도록 학습된 신경망일 수 있다.

상기 적어도 하나의 레퍼런스 마스크는 상기 레퍼런스 이미지를 구성하는 복수의 지점 각각이 적어도 하나의 레퍼런스 마스크 각각에 포함되는지 여부를 포함할 수 있다.

상기 제2 인공 신경망은 상기 타겟 이미지 및 상기 적어도 하나의 타겟 마스크를 참조하여, 상기 적어도 하나의 채색된 타겟 마스크로부터 상기 채색된 타겟 이미지를 생성하도록 학습된 신경망일 수 있다.

상기 제2 인공 신경망은 상기 타겟 이미지 및 상기 적어도 하나의 타겟 마스크를 참조하여, 상기 적어도 하나의 채색된 타겟 마스크로부터 상기 채색된 타겟 이미지를 생성하되, 상기 적어도 하나의 채색된 타겟 마스크에 소정의 이미지 효과를 적용하여 상기 채색된 타겟 이미지를 생성하도록 학습된 신경망일 수 있다.

상기 소정의 이미지 효과는 상기 적어도 하나의 채색된 타겟 마스크 각각에 포함되는 픽셀들이 인접하는 픽셀과의 색상 차이가 소정의 임계 차이 이하가 되도록 하는 효과일 수 있다.

상기 채색된 타겟 마스크를 생성하는 단계는 소정의 방식에 따라 제1 레퍼런스 마스크에 포함된 영역의 대표 색상을 결정하는 단계; 및 상기 대표 색상을 상기 제1 레퍼런스 마스크에 대응되는 타겟 마스크의 색상으로 결정하여, 상기 채색된 타겟 마스크를 생성하는 단계;를 포함할 수 있다.

상기 소정의 방식은 상기 제1 레퍼런스 마스크에 포함된 영역의 색상의 평균 색상을 상기 대표 색상으로 결정하는 방식일 수 있다.

본 발명의 일 실시예에 따른 레퍼런스 이미지를 이용하여 채색하고자 하는 타겟 이미지의 채색을 완성하는 장치에 있어서, 상기 장치는 프로세서를 포함하고, 상기 프로세서는 학습된 제1 인공 신경망을 이용하여, 상기 타겟 이미지의 일부 영역을 포함하는 적어도 하나의 타겟 마스크(Mask)를 생성하고, 상기 제1 인공 신경망을 이용하여, 상기 적어도 하나의 타겟 마스크 각각에 대응되고, 상기 레퍼런스 이미지의 적어도 일부 영역을 포함하는 적어도 하나의 레퍼런스 마스크를 생성하고, 상기 적어도 하나의 레퍼런스 마스크의 색상을 참조하여, 상기 적어도 하나의 타겟 마스크 각각을 채색하여 적어도 하나의 채색된 타겟 마스크를 생성하고, 학습된 제2 인공 신경망을 이용하여, 상기 타겟 이미지, 상기 적어도 하나의 타겟 마스크 및 상기 적어도 하나의 채색된 타겟 마스크로부터 채색된 타겟 이미지를 생성할 수 있다.

상기 프로세서는 소정의 방식에 따라 제1 레퍼런스 마스크에 포함된 영역의 대표 색상을 결정하고, 상기 대표 색상을 상기 제1 레퍼런스 마스크에 대응되는 타겟 마스크의 색상으로 결정하여, 상기 채색된 타겟 마스크를 생성할 수 있다.

본 발명에 따르면, 온라인 콘텐츠를 보다 효율적으로 제작할 수 있다. 특히 웹툰과 같은 사용자의 채색이 필요한 콘텐츠의 제작에 있어서, 사용자가 채색에 사용하는 시간을 절감시킴으로써 콘텐츠를 보다 빠른 시간 내에 제작할 수 있도록 한다.

또한 사용자에 의하지 않은 이미지의 자동 채색에 있어서, 함께 제공된 레퍼런스 이미지를 참조하여 채색을 수행함으로써, 사용자의 니즈에 보다 부합하는 채색을 수행할 수 있으며, 이로써 사용자의 수정에 따른 작업 시간을 절감시킬 수 있다.

도 1은 본 발명의 일 실시예에 따른 네트워크 환경의 예를 도시한 도면이다.
도 2 는 본 발명의 일 실시예에 있어서 사용자 단말(100) 및 서버(200)의 내부 구성을 설명하기 위한 블록도이다.
도 3은 프로세서(212)에 의해 학습된 예시적인 인공 신경망의 구조를 설명하기 위한 도면이다.
도 4는 타겟 이미지의 예시를 도시한 도면이다.
도 5a 내지 도 5d는 본 발명의 일 실시예에 따른 프로세서(212)가 도 4의 타겟 이미지로부터 생성한 예시적인 타겟 마스크를 도시한 도면이다.
도 6은 레퍼런스 이미지의 예시를 도시한 도면이다.
도 7a 내지 도 7d는 프로세서(212)가 도 6의 레퍼런스 이미지로부터 생성한 예시적인 레퍼런스 마스크를 도시한 도면이다.
도 8은 채색된 타겟 마스크의 예시를 도시한 도면이다.
도 9는 채색된 타겟 이미지의 예시이다.
도 10a 내지 도 10b은 프로세서(212)가 채색된 타겟 이미지를 생성하는 과정을 개략적으로 설명하기 위한 도면이다.
도 11은 본 발명의 일 실시예에 따른 서버(200)에 의해 수행되는 타겟 이미지의 채색을 완성하는 방법을 설명하기 위한 흐름도이다.

후술하는 본 발명에 대한 상세한 설명은, 본 발명이 실시될 수 있는 특정 실시예를 예시로서 도시하는 첨부 도면을 참조한다. 이러한 실시예는 당업자가 본 발명을 실시할 수 있기에 충분하도록 상세히 설명된다. 본 발명의 다양한 실시예는 서로 다르지만 상호 배타적일 필요는 없음이 이해되어야 한다. 예를 들어, 본 명세서에 기재되어 있는 특정 형상, 구조 및 특성은 본 발명의 정신과 범위를 벗어나지 않으면서 일 실시예로부터 다른 실시예로 변경되어 구현될 수 있다. 또한, 각각의 실시예 내의 개별 구성요소의 위치 또는 배치도 본 발명의 정신과 범위를 벗어나지 않으면서 변경될 수 있음이 이해되어야 한다. 따라서, 후술하는 상세한 설명은 한정적인 의미로서 행하여지는 것이 아니며, 본 발명의 범위는 특허청구범위의 청구항들이 청구하는 범위 및 그와 균등한 모든 범위를 포괄하는 것으로 받아들여져야 한다. 도면에서 유사한 참조부호는 여러 측면에 걸쳐서 동일하거나 유사한 구성요소를 나타낸다.

이하에서는, 본 발명이 속하는 기술분야에서 통상의 지식을 가진 자가 본 발명을 용이하게 실시할 수 있도록 하기 위하여, 본 발명의 여러 실시예에 관하여 첨부된 도면을 참조하여 상세히 설명한다.

도 1은 본 발명의 일 실시예에 따른 네트워크 환경의 예를 도시한 도면이다. 도 1의 네트워크 환경은 복수의 사용자 단말들(101, 102, 103, 104), 서버(200) 및 네트워크(300)를 포함하는 예를 나타내고 있다. 이러한 도 1은 발명의 설명을 위한 일례로 사용자 단말들(101, 102, 103, 104)의 수나 서버(200)의 수가 도 1과 같이 한정되는 것은 아니다.

본 발명의 일 실시예에서, 복수의 사용자 단말들(101, 102, 103, 104)은 사용자의 조작에 따라 채색을 완성하고자 하는 타겟 이미지 및 채색에 참조할 레퍼런스 이미지를 서버(200)에 전송하고, 서버(200)로부터 채색된 타겟 이미지를 수신할 수 있다.

본 발명의 다른 실시예에서, 복수의 사용자 단말들(101, 102, 103, 104)은 사용자의 조작에 따라 채색을 완성하고자 하는 타겟 이미지 및 채색에 참조할 레퍼런스 이미지를 결정하고, 타겟 이미지의 채색을 완성할 수도 있다.

복수의 사용자 단말들(101, 102, 103, 104)은 컴퓨터 장치로 구현되는 고정형 단말이거나 이동형 단말일 수 있다. 복수의 사용자 단말들(101, 102, 103, 104)의 예를 들면, 스마트폰, 휴대폰, 네비게이션, 컴퓨터, 노트북, 디지털방송용 단말, PDA(Personal Digital Assistants), PMP(Portable Multimedia Player), 테블릿 PC 등이 있다.

복수의 사용자 단말들(101, 102, 103, 104)은 무선 또는 유선 통신 방식을 이용하여 네트워크(300)를 통해 복수의 사용자 단말들(101, 102, 103, 104) 상호간에 및/또는 서버(200)와 통신할 수 있다.

한편 복수의 사용자 단말들(101, 102, 103, 104)의 통신 방식은 제한되지 않으며, 네트워크(300)가 포함할 수 있는 통신망(일례로, 이동통신망, 유선 인터넷, 무선 인터넷, 방송망)을 활용하는 통신 방식뿐만 아니라 기기들간의 근거리 무선 통신 역시 포함될 수 있다.

예를 들어, 네트워크(300)는 PAN(Personal Area Network), LAN(Local Area Network), CAN(Campus Area Network), MAN(Metropolitan Area Network), WAN(Wide Area Network), BBN(Broad Band Network), 인터넷 등의 네트워크 중 하나 이상의 임의의 네트워크를 포함할 수 있다.

또한, 네트워크(300)는 버스 네트워크, 스타 네트워크, 링 네트워크, 메쉬 네트워크, 스타-버스 네트워크, 트리 또는 계층적(Hierarchical) 네트워크 등을 포함하는 네트워크 토폴로지 중 임의의 하나 이상을 포함할 수 있으나, 이에 제한되지 않는다.

이하에서는 설명의 편의를 위하여 복수의 사용자 단말들(101, 102, 103, 104)을 사용자 단말(100)로 명명하여 설명한다.

서버(200)는 전술한 사용자 단말(100)로부터 채색하고자 하는 타겟 이미지 및 타겟 이미지의 채색에 참조할 레퍼런스 이미지를 수신하고, 학습된 인공 신경망들을 이용하여 타겟 이미지를 채색할 수 있다. 이에 대한 상세한 설명은 후술한다. 이와 같은 서버(200)는 네트워크(300)를 통하여 사용자 단말(100)에 명령, 코드, 파일, 콘텐츠, 서비스 등을 제공하는 컴퓨터 장치 또는 복수의 컴퓨터 장치들로 구현될 수 있다.

도 2 는 본 발명의 일 실시예에 있어서 사용자 단말(100) 및 서버(200)의 내부 구성을 설명하기 위한 블록도이다.

사용자 단말(100)과 서버(200)는 메모리(111, 211), 프로세서(112, 212), 통신 모듈(113, 213) 그리고 입출력 인터페이스(114, 214)를 포함할 수 있다.

메모리(111, 211)는 컴퓨터에서 판독 가능한 기록 매체로서, RAM(Random Access Memory), ROM(Read Only Memory) 및 디스크 드라이브와 같은 비소멸성 대용량 기록장치(Permanent Mass Storage Device)를 포함할 수 있다.

또한, 메모리(111, 211)에는 운영체제와 적어도 하나의 프로그램 코드(일례로 사용자 단말(100)에 설치되어 서버(200)와 데이터 송수신을 통하여 이미지를 채색하는 프로그램을 위한 코드)가 저장될 수 있다.

이러한 소프트웨어 구성요소들은 드라이브 메커니즘(Drive Mechanism)을 이용하여 메모리(111, 211)와는 별도의 컴퓨터에서 판독 가능한 기록 매체로부터 로딩될 수 있다. 이러한 별도의 컴퓨터에서 판독 가능한 기록 매체는 플로피 드라이브, 디스크, 테이프, DVD/CD-ROM 드라이브, 메모리 카드 등의 컴퓨터에서 판독 가능한 기록 매체를 포함할 수 있다.

다른 실시예에서 소프트웨어 구성요소들은 컴퓨터에서 판독 가능한 기록 매체가 아닌 통신 모듈(113, 213)을 통해 메모리(111, 211)에 로딩될 수도 있다. 예를 들어, 적어도 하나의 프로그램은 개발자들 또는 어플리케이션의 설치 파일을 배포하는 파일 배포 시스템(일례로 상술한 서버(200))이 네트워크(300)를 통해 제공하는 파일들에 의해 설치되는 프로그램에 기반하여 메모리(111, 211)에 로딩될 수 있다.

프로세서(112, 212)는 기본적인 산술, 로직 및 입출력 연산을 수행함으로써, 컴퓨터 프로그램의 명령을 처리하도록 구성될 수 있다. 명령은 메모리(111, 211) 또는 통신 모듈(113, 213)에 의해 프로세서(112, 212)로 제공될 수 있다. 예를 들어 프로세서(112, 212)는 메모리(111, 211)와 같은 기록 장치에 저장된 프로그램 코드에 따라 수신되는 명령을 실행하도록 구성될 수 있다.

통신 모듈(113, 213)은 네트워크(300)를 통해 사용자 단말(100)과 서버(200)가 서로 통신하기 위한 기능을 제공할 수 있으며, 다른 사용자 단말(미도시) 또는 다른 서버(미도시)와 통신하기 위한 기능을 제공할 수 있다. 일례로, 사용자 단말(100)의 프로세서(112)가 메모리(111)와 같은 기록 장치에 저장된 프로그램 코드에 따라 생성한 요청이 통신 모듈(113)의 제어에 따라 네트워크(300)를 통해 서버(200)로 전달될 수 있다. 역으로, 서버(200) 프로세서(212)의 제어에 따라 제공되는 제어 신호나 명령, 콘텐츠, 파일 등이 통신 모듈(213)과 네트워크(300)를 거쳐 사용자 단말(100)의 통신 모듈(113)을 통해 사용자 단말(100)로 수신될 수 있다.

입출력 인터페이스(114, 214)는 입출력 장치(115)와의 인터페이스를 위한 수단일 수 있다. 이때 입력 장치는 예를 들어 키보드 또는 마우스 등의 장치를, 그리고 출력 장치는 이미지를 표시하기 위한 디스플레이와 같은 장치를 포함할 수 있다. 다른 예로 입출력 인터페이스(114, 214)는 터치스크린과 같이 입력과 출력을 위한 기능이 하나로 통합된 장치와의 인터페이스를 위한 수단일 수도 있다.

또한, 다른 실시예들에서 사용자 단말(100) 및 서버(200)는 도 2 의 구성요소들보다 더 많은 구성요소들을 포함할 수도 있다. 그러나, 대부분의 종래기술적 구성요소들을 명확하게 도시할 필요성은 없다. 예를 들어, 사용자 단말(100)은 상술한 입출력 장치(115) 중 적어도 일부를 포함하도록 구현되거나 또는 트랜시버(Transceiver), GPS(Global Positioning System) 모듈, 카메라, 각종 센서, 데이터베이스 등과 같은 다른 구성요소들을 더 포함할 수도 있다.

본 발명의 일 실시예에 따른 서버(200)의 프로세서(212)는 학습된 인공 신경망들을 이용하여 타겟 이미지의 채색을 완성할 수 있다.

본 발명에서 '타겟 이미지'(Target Image)는 채색을 완성하고자 하는 이미지로, 적어도 일부 영역의 채색이 완성되지 않은(즉 적어도 일부 영역의 색상정보가 없는) 이미지를 의미할 수 있다. 이때 '영역'은 이미지 내의 윤곽선 등에 의해 구분되는 이미지의 일 부분을 의미할 수 있다.

본 발명에서 '레퍼런스 이미지'(Reference Image)는 전술한 타겟 이미지의 채색에 참조하기 위한 이미지로, 채색이 완성된 이미지를 의미할 수 있다. 이와 같은 레퍼런스 이미지는 타겟 이미지와 함께 획득되어 타겟 이미지의 채색에 사용될 수 있다.

본 발명의 일 실시예에서, 레퍼런스 이미지는 사용자에 의해 제공될 수 있다. 사용자는 자신이 원하는 스타일(즉 원하는 색상 조합)로 채색된 레퍼런스 이미지를 타겟 이미지와 함께 제공하여, 타겟 이미지가 레퍼런스 이미지와 유사한 스타일로 채색되도록 할 수 있다.

또 다른 실시예에서, 레퍼런스 이미지는 소정의 이미지 분석 결과에 기초하여 프로세서(212)에 의해 제공될 수도 있다. 이러한 경우 프로세서(212)는 복수의 후보 레퍼런스 이미지와 타겟 이미지의 형태의 유사성(즉 이미지를 구성하는 적어도 하나의 영역들의 형상의 유사성)에 기초하여, 복수의 후보 레퍼런스 이미지 중 어느 하나를 레퍼런스 이미지로 선택할 수 있다. 이러한 경우 사용자는 단지 타겟 이미지만을 제공하여 채색된 타겟 이미지를 획득할 수 있다.

본 발명에서 '타겟 마스크' 및 '레퍼런스 마스크'와 같은 '마스크'(Mask)는 원본 이미지(가령 레퍼런스 이미지 또는 타겟 이미지)의 적어도 일부 영역을 포함하는 이미지로, 원본 이미지를 구성하는 복수의 지점 각각이 해당 마스크에 포함되는지 여부에 관한 정보를 포함하는 이미지를 의미할 수 있다.

가령 타겟 이미지로부터 생성되는 제1 타겟 마스크는 타겟 이미지를 구성하는 복수의 지점 각각이 제1 타겟 마스크에 포함되는지 여부를 Ground Truth형태(즉 1 또는 0의 형태로)로 포함할 수 있다.

이와 유사하게, 레퍼런스 이미지로부터 생성되는 제1 레퍼런스 마스크는, 레퍼런스 이미지를 구성하는 복수의 지점 각각이 제1 레퍼런스 마스크에 포함되는지 여부를 Ground Truth형태(즉 1 또는 0의 형태로)로 포함할 수 있다.

본 발명에서 '채색된 마스크'는 전술한 마스크에 색상 정보가 더 추가된 이미지를 의미할 수 있다.

가령 제1 타겟 마스크에 색상 정보가 추가된 형태인 '채색된 제1 타겟 마스크'는 타겟 이미지를 구성하는 복수의 지점 각각이 제1 타겟 마스크에 포함되는지 여부를 Ground Truth형태(즉 1 또는 0의 형태로)로 포함하고, 포함되는 영역의 색상정보를 더 포함하는 이미지를 의미할 수 있다.

본 발명에서 제1 인공 신경망 및 제2 인공 신경망과 같은 '인공 신경망'은 목적 및/또는 용도에 따라 적절하게 학습된 신경망으로, 머신 러닝(Machine Learning) 또는 딥러닝(Deep Learning) 기법에 의해 학습된 것 일 수 있다.

본 발명에서 '제1 인공 신경망'은 입력 이미지가 타겟 이미지인 경우, 타겟 이미지의 각 영역에 채색하고자 하는 색상의 유사도에 기초하여 타겟 이미지를 적어도 하나의 영역으로 구분하고, 구분된 적어도 하나의 영역 각각을 포함하는 적어도 하나의 타겟 마스크를 생성하도록 학습된 신경망일 수 있다.

바꾸어 말하면, 제1 인공 신경망은 입력된 이미지를 복수의 영역으로 구분하여 적어도 하나의 마스크를 생성하도록 학습된 신경망으로, 채색하고자 하는 색상의 유사도에 기초하여 입력된 이미지를 복수의 영역으로 구분하여 마스크를 생성할 수 있다.

한편 제1 인공 신경망은 입력 이미지가 레퍼런스 이미지인 경우, 레퍼런스 이미지(이때 레퍼런스 이미지는 채색된 레퍼런스 이미지로부터 생성된 윤곽선 이미지를 의미한다)의 각 영역에 채색하고자 하는 색상의 유사도 및 전술한 과정에 의해 생성된 적어도 하나의 타겟 마스크에 포함된 타겟 이미지의 일부 영역과의 형상 유사도에 기초하여, 레퍼런스 이미지를 적어도 하나의 영역으로 구분하고, 구분된 적어도 하나의 영역 각각을 포함하는 적어도 하나의 레퍼런스 마스크를 생성하도록 학습된 신경망일 수 있다.

바꾸어 말하면, 제1 인공 신경망은 타겟 이미지의 경우와 마찬가지로 입력된 이미지를 복수의 영역으로 구분하여 적어도 하나의 마스크를 생성하도록 학습된 신경망으로, 채색하고자 하는 색상의 유사도와 더불어 함께 입력된 마스크들을 참조하여 입력된 이미지를 복수의 영역으로 구분하여 마스크를 생성할 수 있다.

본 발명에서 '제2 인공 신경망'은 채색하고자 하는 타겟 이미지 및 이러한 타겟 이미지로부터 생성된 적어도 하나의 타겟 마스크를 참조하여, 적어도 하나의 채색된 타겟 마스크로부터 채색된 타겟 이미지를 생성하도록 학습된 신경망일 수 있다. 이때 제2 인공 신경망은 적어도 하나의 채색된 타겟 마스크에 소정의 이미지 효과를 적용하여 채색된 타겟 이미지를 생성하도록 학습될 수 있다. 채색된 타겟 마스크에 대한 설명은 후술한다. 이하에서는 설명의 편의를 위하여 때때로 제1 인공 신경망 및 제2 인공 신경망을 '인공 신경망'으로 통칭하여 설명한다.

도 3은 프로세서(212)에 의해 학습된 예시적인 인공 신경망의 구조를 설명하기 위한 도면이다.

본 발명의 일 실시예에 따른 인공 신경망은 합성 곱 신경망(CNN: Convolutional Neural Network) 모델에 따른 신경망일 수 있다. 이때 CNN 모델은 복수의 연산 레이어(Convolutional Layer, Pooling Layer)를 번갈아 수행하여 최종적으로는 입력 데이터의 특징을 추출하는 데 사용되는 계층 모델일 수 있다.

도 3에 도시된 신경망 모델이 제1 인공 신경망에 대한 것이라는 전제 하에, 프로세서(212)는 학습 데이터에 포함되는 타겟 이미지의 특징 값을 추출하는 컨볼루션 레이어(Convolution layer)와, 추출된 특징 값을 결합하여 특징 맵을 구성하는 풀링 레이어(pooling layer)를 생성할 수 있다.

또한 프로세서(212)는 생성된 특징 맵을 결합하여, 적어도 하나의 타겟 마스크의 생성하는 준비를 하는 풀리 커넥티드 레이어(Fully Conected Layer)를 생성할 수 있다.

마지막으로 프로세서(212)는 적어도 하나의 타겟 마스크를 포함하는 아웃풋 레이어(Output Layer)를 산출할 수 있다.

도 3에 도시된 예시에서는, 컨볼루션 레이어의 입력 데이터(가령 타겟 이미지)가 5X7 형태의 블록으로 나누어지며, 컨볼루션 레이어의 생성에 5X3 형태의 단위 블록이 사용되고, 풀링 레이어의 생성에 1X4 또는 1X2 형태의 단위 블록이 사용되는 것으로 도시되었지만, 이는 예시적인 것으로 본 발명의 사상이 이에 한정되는 것은 아니다. 따라서 각 레이어의 생성에 사용되는 이미지 블록의 크기는 다양하게 설정될 수 있다.

또한 도 3 도시된 예시는, 앞서 설명한 바와 같이 예시적인 제1 인공 신경망의 구조를 도시한 것으로, 제1 인공 신경망의 구조는 입력 데이터의 종류 및/또는 수량에 따라 도 3과 상이할 수 있다.

가령 제1 인공 신경망은 컨볼루션 레이어의 입력 데이터로써, 레퍼런스 이미지 외에 적어도 하나의 타겟 마스크를 입력 받기 위한 블록을 포함할 수 있다. 이러한 경우에도 프로세서(212)는 전술한 과정에 따라 적어도 하나의 레퍼런스 마스크를 포함하는 아웃풋 레이어(Output Layer)를 산출할 수 있다.

제2 인공 신경망의 경우, 컨볼루션 레이어에 타겟 이미지, 해당 타겟 이미지로부터 생성된 적어도 하나의 타겟 마스크, 적어도 하나의 채색된 타겟 마스크를 입력 받기 위한 블록을 포함할 수 있다. 물론 출력 레이어에는 채색된 타겟 이미지를 출력하기 위한 블록이 포함될 수 있다.

이와 같은 인공 신경망은 전술한 메모리(211)에 인공 신경망을 구성하는 적어도 하나의 노드의 계수, 노드의 가중치 및 인공 신경망을 구성하는 복수의 레이어 간의 관계를 정의하는 함수의 계수들의 형태로 저장될 수 있다. 물론 인경 신경망의 구조 또한 메모리(211)에 소스코드 및/또는 프로그램의 형태로 저장될 수 있다.

본 발명의 일 실시예에 따른 프로세서(212)는 학습 데이터를 지도학습(Supervised Learning) 기법에 따라 처리하여 신경망 모델을 구축하거나 학습시킬 수 있다.

가령 제1 인공 신경망의 학습에 있어서, 학습 데이터는 타겟 이미지와 해당 타겟 이미지로부터 생성된 적어도 하나의 타겟 마스크를 포함할 수 있다.

프로세서(212)는 이와 같은 학습 데이터에 기초하여, 제1 인공 신경망이 타겟 이미지와 해당 타겟 이미지로부터 생성된 적어도 하나의 타겟 마스크간의 대응관계를 학습하도록 학습을 반복하여 수행할 수 있다.

바꾸어 말하면 프로세서(212)는 원본 이미지와 이러한 원본 이미지를 분할한 적어도 하나의 마스크를 이용하여, 이미지 분할에 관한 특징이 반영되도록 제1 인공 신경망을 학습시킬 수 있다. 이에 따라 제1 인공 신경망은 타겟 이미지의 입력에 대해, 적어도 하나의 타겟 마스크를 출력하도록 학습될 수 있다.

또한 제1 인공 신경망의 학습에 있어서, 학습 데이터는 레퍼런스 이미지와 해당 레퍼런스 이미지로부터 생성된 적어도 하나의 레퍼런스 마스크 그리고 적어도 하나의 레퍼런스 마스크의 생성에 참조하는 적어도 하나의 타겟 마스크를 포함할 수 있다.

이러한 경우, 프로세서(212)는 제1 인공 신경망이 레퍼런스 이미지 및 적어도 하나의 타겟 마스크와 해당 레퍼런스 이미지로부터 생성된 적어도 하나의 레퍼런스 마스크 간의 대응관계를 학습하도록 학습을 수행할 수도 있다.

바꾸어 말하면 프로세서(212)는 원본 이미지, 원본 이미지의 분할에 참조한 정보 및 원본 이미지를 분할한 적어도 하나의 마스크를 이용하여, 참조 정보를 이용한 이미지 분할에 관한 특징이 반영되도록 제1 인공 신경망을 더 학습시킬 수 있다. 이에 따라 제1 인공 신경망은 레퍼런스 이미지 및 적어도 하나의 타겟 마스크의 입력에 대해, 적어도 하나의 레퍼런스 마스크를 출력하도록 학습될 수 있다. 물론 이러한 경우에도 학습은 반복적으로 수행될 수 있다.

제2 인공 신경망의 학습에 있어서, 학습 데이터는 타겟 이미지, 해당 타겟 이미지로부터 생성된 적어도 하나의 타겟 마스크, 적어도 하나의 채색된 타겟 마스크 및 채색된 타겟 이미지를 포함할 수 있다.

프로세서(212)는 제1 인공 신경망의 학습에서와 마찬가지로, 제2 인공 신경망이 타겟 이미지, 해당 타겟 이미지로부터 생성된 적어도 하나의 타겟 마스크 및 적어도 하나의 채색된 타겟 마스크와 채색된 타겟 이미지의 간의 대응관계를 학습하도록 학습을 수행할 수 있다. 이에 따라 제2 인공 신경망은 타겟 이미지, 해당 타겟 이미지로부터 생성된 적어도 하나의 타겟 마스크 및 적어도 하나의 채색된 타겟 마스크의 입력에 대해, 채색된 타겟 이미지를 출력하도록 학습될 수 있다. 물론 이러한 경우에도 학습은 반복적으로 수행될 수 있다.

한편 본 발명에서 인공 신경망을 '학습 시키는 것'은 인공 신경망을 구성하는 적어도 하나의 노드의 계수, 노드의 가중치 및/또는 인공 신경망을 구성하는 복수의 레이어 간의 관계를 정의하는 함수의 계수들을 갱신하는 것을 의미할 수 있다.

도 3에서는 인공 신경망이 합성 곱 신경망(CNN) 모델에 따른 신경망인 것을 예시적으로 설명하지만, 이는 예시적인 것으로 신경망 모델이 이에 한정되는 것은 아니다. 따라서 인공 신경망은 다양한 종류의 신경망 모델에 따른 신경망일 수 있다.

이하에서는 상술한 인공 신경망이 프로세서(212)에 의해 학습되었음을 전제로, 프로세서(212)가 타겟 이미지의 채색을 완성하는 방법에 대해서 설명한다.

본 발명의 일 실시예에 따른 프로세서(212)는 채색하고자 하는 타겟 이미지를 획득할 수 있다. 가령 프로세서(212)는 전술한 사용자 단말(100)로부터 타겟 이미지를 수신할 수도 있고, 서버(200) 내의 메모리(211)로부터 타겟 이미지를 독출할 수도 있다.

이때 본 발명의 일 실시예에 따른 프로세서(212)는 타겟 이미지의 채색에 참조를 위한 레퍼런스 이미지를 함께 획득할 수 있다. 물론 이러한 레퍼런스 이미지 또한 사용자 단말(100)로부터 수신하거나, 메모리(211)로부터 독출하는 방식으로 획득될 수 있다.

도 4는 타겟 이미지의 예시를 도시한 도면이다.

전술한 바와 같이 본 발명에서 '타겟 이미지'(Target Image)는 채색을 완성하고자 하는 이미지로, 적어도 일부 영역의 채색이 완성되지 않은 이미지를 의미할 수 있다.

이러한 타겟 이미지는 도 4에 도시된 바와 같이 만화의 한 장면(또는 한 컷)일 수도 있고, 포스터, 일러스트 등 다양한 종류의 이미지일 수도 있다. 이하에서는 설명의 편의를 위하여 타겟 이미지가 도 4에 도시된 이미지와 같음을 전제로 설명한다.

본 발명의 일 실시예에 따른 프로세서(212)는 학습된 제1 인공 신경망을 이용하여 획득된 타겟 이미지의 일부 영역을 포함하는 적어도 하나의 타겟 마스크(Mask)를 생성할 수 있다.

전술한 바와 같이 제1 인공 신경망은 원본 이미지와 이러한 원본 이미지를 분할한 적어도 하나의 마스크를 이용하여, 이미지 분할에 관한 특징을 학습한 인공 신경망일 수 있다. 따라서 프로세서(212)는 제1 인공 신경망을 이용하여 타겟 이미지로부터 적어도 하나의 타겟 마스크를 생성할 수 있다. 바꾸어 말하면, 프로세서(212)는 제1 인공 신경망에 타겟 이미지를 입력하여, 그 출력으로써 적어도 하나의 타겟 마스크를 획득할 수 있다.

도 5a 내지 도 5d는 본 발명의 일 실시예에 따른 프로세서(212)가 도 4의 타겟 이미지로부터 생성한 예시적인 타겟 마스크를 도시한 도면이다.

가령 본 발명의 일 실시예에 따른 프로세서(212)는 도 4와 같은 타겟 이미지로부터 도 5a와 같이 배경의 상단 영역을 포함하는 첫 번째 타겟 마스크를 생성할 수 있다.

제1 인공 신경망은 채색하고자 하는 색상의 유사도에 기초하여 타겟 마스크를 생성하므로, 하나의 타겟 마스크에 포함되는 영역들은 서로 유사한 색상이 채색될 수 있는 영역에 해당한다. 따라서 도 5a에 도시된 마스크에 포함되는 영역(즉 흰색으로 표시된 영역)은 하나의 색상 또는 이와 유사한 색상으로 채색될 수 있는 영역에 해당할 수 있다.

이와 유사하게, 본 발명의 일 실시예에 따른 프로세서(212)는 도 4와 같은 타겟 이미지로부터 도 5b와 같이 배경의 하단 영역을 포함하는 두 번째 타겟 마스크, 말풍선 영역을 포함하는 세 번째 타겟 마스크 및 머리카락 영역을 포함하는 네 번째 타겟 마스크를 생성할 수 있다. 물론 전술한 첫 번째 타겟 마스크와 마찬가지로, 각각의 마스크 상에 포함되는 영역들은 서로 유사한 색상으로 채색될 수 있는 영역에 해당할 수 있다.

한편 도 5a 내지 도 5d에 도시된 타겟 마스크는 예시적인 것으로, 타겟 마스크의 수량이나 구체적인 형태가 이에 한정되는 것은 아니다. 따라서 프로세서(212)는 도 5a 내지 5d에서 설명한 타겟 마스크 외에, 얼굴 영역을 포함하는 마스크, 몸통 영역을 포함하는 마스크 등을 더 생성할 수 있다.

본 발명의 일 실시예에 따른 프로세서(212)는 학습된 제1 인공 신경망을 이용하여, 전술한 과정에 의해 생성된 적어도 하나의 타겟 마스크 각각에 대응되고, 획득된 레퍼런스 이미지의 적어도 일부 영역을 포함하는 적어도 하나의 레퍼런스 마스크를 생성할 수 있다.

제1 인공 신경망은 전술한 바와 같이 입력된 이미지를 복수의 영역으로 구분하여 적어도 하나의 마스크를 생성하도록 학습된 신경망으로, 채색하고자 하는 색상의 유사도와 더불어, 입력된 마스크들(즉 입력된 타겟 마스크들)을 참조하여 입력된 이미지를 복수의 영역으로 구분하여 마스크를 생성하도록 학습된 신경망일 수 있다. 따라서 프로세서(212)는 제1 인공 신경망을 이용하여 레퍼런스 이미지 및 적어도 하나의 타겟 마스크들로부터 적어도 하나의 레퍼런스 마스크를 생성할 수 있다. 바꾸어 말하면, 프로세서(212)는 제1 인공 신경망에 레퍼런스 이미지 및 적어도 하나의 타겟 마스크를 입력하여, 그 출력으로써 적어도 하나의 레퍼런스 마스크를 획득할 수 있다.

도 6은 레퍼런스 이미지의 예시를 도시한 도면이다. 도 7a 내지 도 7d는 프로세서(212)가 도 6의 레퍼런스 이미지로부터 생성한 예시적인 레퍼런스 마스크를 도시한 도면이다.

본 발명의 일 실시예에 따른 프로세서(212)는 타겟 이미지(도 4)의 배경 상단 영역을 포함하는 도 5a와 같은 타켓 마스크를 참조하여, 도 6과 같은 레퍼런스 이미지로부터 도 7a와 같이 배경의 상단 영역을 포함하는 첫 번째 레퍼런스 마스크를 생성할 수 있다.

이와 유사하게, 프로세서(212)는 배경의 하단 영역을 포함하는 도 5b와 같은 타켓 마스크를 참조하여, 도 6과 같은 레퍼런스 이미지로부터 도 7b와 같이 배경의 하단 영역을 포함하는 두 번째 레퍼런스 마스크를 생성할 수 있다.

물론 프로세서(212)는 말풍선 영역을 포함하는 도 5c와 같은 타겟 마스크를 참조하여 도 7c와 같은 레퍼런스 마스크를 생성할 수도 있고, 머리카락 영역등을 포함하는 도 5d와 같은 타겟 마스크를 참조하여, 도 7d와 같은 레퍼런스 마스크를 생성할 수도 있다.

한편 도 7a 내지 도 7d에 도시된 레퍼런스 마스크는 예시적인 것으로, 레퍼런스 마스크의 수량이나 구체적인 형태가 이에 한정되는 것은 아니다. 따라서 프로세서(212)는 도 7a 내지 7d에서 설명한 타겟 마스크 외에, 얼굴 영역을 포함하는 마스크, 몸통 영역을 포함하는 마스크 등을 더 생성할 수 있다.

본 발명의 일 실시예에 따른 프로세서(212)는 적어도 하나의 레퍼런스 마스크의 색상을 참조하여, 적어도 하나의 타겟 마스크 각각을 채색하여 적어도 하나의 채색된 타겟 마스크를 생성할 수 있다.

이를 위하여 본 발명의 일 실시예에 따른 프로세서(212)는 소정의 방식에 따라 레퍼런스 마스크에 포함된 영역의 대표 색상을 결정할 수 있다.

전술한 마와 같이 레퍼런스 마스크와 같은 '마스크'는 원본 이미지의 적어도 일부 영역을 포함하는 것으로, 원본 이미지를 구성하는 복수의 지점 각각이 해당 마스크에 포함되는지 여부만을 포함한다.

따라서 프로세서(212)는 레퍼런스 마스크와 레퍼런스 이미지를 함께 참조하여 해당 레퍼런스 마스크에 포함된 영역의 대표 색상을 해당 레퍼런스 마스크의 색상으로 결정할 수 있다.

가령 프로세서(212)는 도 7a에 도시된 첫 번째 레퍼런스 마스크에 포함되는 영역을 참조하여, 도 6의 레퍼런스 이미지에서 해당 영역의 평균 색상을 첫 번째 레퍼런스 마스크에 포함되는 영역의 대표 색상, 즉 해당 레퍼런스 마스크의 색상으로 결정할 수 있다.

물론 프로세서(212)는 도 7b에 도시된 두 번째 레퍼런스 마스크에 포함되는 영역을 참조하여, 도 6의 레퍼런스 이미지에서 해당 영역의 평균 색상을 두 번째 레퍼런스 마스크에 포함되는 영역의 대표 색상(즉 해당 레퍼런스 마스크의 색상)으로 결정할 수도 있다.

프로세서(212)는 전술한 과정에 의해 결정된 대표 색상을 해당 레퍼런스 마스크에 대응되는 타겟 마스크의 색상으로 결정하여 채색된 타겟 마스크를 생성할 수 있다. 바꾸어 말하면 프로세서(212)는 타겟 마스크를 각각의 타겟 마스크에 대응되는 레퍼런스 마스크의 색상으로 채색하여 채색된 타겟 마스크를 생성할 수 있다.

도 8은 채색된 타겟 마스크의 예시를 도시한 도면이다.

전술한 바와 같이 프로세서(212)는 도 7a에 도시된 첫 번째 레퍼런스 마스크에 포함되는 영역을 참조하여, 도 6의 레퍼런스 이미지에서 해당 영역의 평균 색상을 첫 번째 레퍼런스 마스크에 포함되는 영역의 대표 색상으로 결정할 수 있다. 또한 프로세서(212)는 레퍼런스 마스크와 타겟 마스크 간의 대응관계를 고려하여, 도 5a에 도시된 첫 번째 타겟 마스크를 결정된 대표 색상으로 채색하여 도 8에 도시된 바와 같이 채색된 타겟 마스크를 생성할 수 있다.

물론 프로세서(212)는 이와 동일한 방법으로, 도 5b, 도 5c 및 도 5d에 도시된 타겟 마스크 각각을, 각각에 대해 결정된 대표 색상으로 채색하여 도 8에 도시된 바와 같이 채색된 타겟 마스크를 생성할 수 있다. 프로세서(212)에 의해 채색된 타겟 마스크는 채색된 타겟 이미지를 생성하는데 사용될 수 있다.

본 발명의 일 실시예에 따른 프로세서(212)는 학습된 제2 인공 신경망을 이용하여, 타겟 이미지, 적어도 하나의 타겟 마스크 및 적어도 하나의 채색된 타겟 마스크로부터 채색된 타겟 이미지를 생성할 수 있다.

전술한 바와 같이 제2 인공 신경망은 채색하고자 하는 타겟 이미지 및 이러한 타겟 이미지로부터 생성된 적어도 하나의 타겟 마스크를 참조하여, 적어도 하나의 채색된 타겟 마스크로부터 채색된 타겟 이미지를 생성하도록 학습된 신경망일 수 있다. 바꾸어 말하면, 제2 인공 신경망은 적어도 하나의 채색된 타겟 마스크로부터 채색된 타겟 이미지를 생성하도록 학습된 신경망일 수 있다.

프로세서(212)는 이러한 제2 인공 신경망을 이용하여, 적어도 하나의 채색된 타겟 마스크를 병합하여 채색된 타겟 이미지를 생성하되, 적어도 하나의 채색된 타겟 마스크에 소정의 이미지 효과를 적용하여 채색된 타겟 이미지를 생성할 수 있다.

이때 소정의 이미지 효과는 적어도 하나의 채색된 타겟 마스크 각각에 포함되는 픽셀들이 인접하는 픽셀과의 색상 차이가 소정의 임계 차이 이하가 되도록 하는 효과일 수 있다. 이와 같은 이미지 효과는 제2 인공 신경망에 의해 생성된 이미지에 포함되는 부자연스러운 부분(예를 들어 checkerboard artifacts에 의해 생성되는 경계선 등)이나, 복수의 마스크의 병합에 의해 발생되는 부자연스러운 부분들을 완화시켜 채색된 타겟 이미지의 완성도를 향상시키기 위한 것일 수 있다.

도 9는 채색된 타겟 이미지의 예시이다.

타겟 이미지의 채색에 참조된 레퍼런스 이미지(도 6)와 타겟 이미지를 대비하여 살펴보면, 제1 인공 신경망 및 제2 인공 신경망에 의해 타겟 이미지와 레퍼런스의 이미지 내의 서로 대응되는 영역에 동일한 색상이 채색될 수 있다.

이로써 본 발명은 사용자에 의하지 않은 이미지의 자동 채색에 있어서, 함께 제공된 레퍼런스 이미지를 참조하여 채색을 수행함으로써, 사용자의 니즈에 보다 부합하는 채색을 수행할 수 있으며, 이로써 사용자의 수정에 따른 작업 시간을 절감시킬 수 있다.

이하에서는 도 10a 내지 도 10b를 참조하여 프로세서(212)가 채색된 타겟 이미지를 생성하는 과정을 다시 한번 설명한다.

본 발명의 일 실시예에 따른 프로세서(212)는 제1 인공 신경망을 이용하여, 타겟 이미지(도 4)로부터 적어도 하나의 타겟 마스크(도 5a 내지 도 5d)를 생성할 수 있다.

한편 본 발명의 일 실시예에 따른 프로세서(212)는 레퍼런스 이미지(도 6)로부터, 채색이 제거된 레퍼런스 이미지(즉 윤곽선만 잔존하는 이미지)를 생성할 수 있다. 프로세서(212)는 제1 인공 신경망을 이용하여, 채색이 제거된 레퍼런스 이미지로부터 적어도 하나의 레퍼런스 마스크(도 7a 내지 도 7d)를 생성할 수 있다. 이때 프로세서는 앞서 생성된 적어도 하나의 타겟 마스크(도 5a 내지 도 5d)를 참조하여, 적어도 하나의 타겟 마스크(도 5a 내지 도 5d) 각각에 대응되도록 적어도 하나의 레퍼런스 마스크(도 7a 내지 도 7d)를 생성할 수 있다.

본 발명의 일 실시예에 따른 프로세서(212)는 상술한 과정에 의해서 생성된 적어도 하나의 타겟 마스크, 적어도 하나의 레퍼런스 마스크 및 레퍼런스 이미지를 참조하여, 적어도 하나의 채색된 타겟 마스크를 생성할 수 있다.

이때 프로세서(212)는 각각의 타겟 마스크와 대응되는 레퍼런스 마스크에 포함되는 영역(레퍼런스 이미지의 일부 영역)의 레퍼런스 이미지 상에서의 평균 색상에 기초하여, 각각의 타겟 마스크를 채색할 수 있다.

본 발명의 일 실시예에 따른 프로세서(212)는 제2 인공 신경망을 이용하여, 전술한 과정에 따라 생성된 적어도 하나의 채색된 타겟 마스크, 적어도 하나의 타겟 마스크 및 타겟 이미지로부터 채색된 타겟 이미지를 생성할 수 있다.

이로써 본 발명은 함께 제공된 레퍼런스 이미지와 유사한 스타일로 자동 채색된 타겟 이미지를 생성할 수 있다.

도 11은 본 발명의 일 실시예에 따른 서버(200)에 의해 수행되는 타겟 이미지의 채색을 완성하는 방법을 설명하기 위한 흐름도이다. 이하에서는 도 1 내지 도 10b를 함께 참조하여 설명하되, 도 1 내지 도 10b와 중복되는 내용의 설명은 생략한다.

본 발명의 일 실시예에 따른 서버(200)는 학습된 제1 인공 신경망을 이용하여 획득된 타겟 이미지의 일부 영역을 포함하는 적어도 하나의 타겟 마스크(Mask)를 생성할 수 있다.(S111)

전술한 바와 같이 제1 인공 신경망은 원본 이미지와 이러한 원본 이미지를 분할한 적어도 하나의 마스크를 이용하여, 이미지 분할에 관한 특징을 학습한 인공 신경망일 수 있다. 따라서 서버(200)는 제1 인공 신경망을 이용하여 타겟 이미지로부터 적어도 하나의 타겟 마스크를 생성할 수 있다. 바꾸어 말하면, 서버(200)는 제1 인공 신경망에 타겟 이미지를 입력하여, 그 출력으로써 적어도 하나의 타겟 마스크를 획득할 수 있다.

가령 본 발명의 일 실시예에 따른 서버(200)는 도 4와 같은 타겟 이미지로부터 도 5a와 같이 배경의 상단 영역을 포함하는 첫 번째 타겟 마스크를 생성할 수 있다.

이와 유사하게, 본 발명의 일 실시예에 따른 서버(200)는 도 4와 같은 타겟 이미지로부터 도 5b와 같이 배경의 하단 영역을 포함하는 두 번째 타겟 마스크, 말풍선 영역을 포함하는 세 번째 타겟 마스크 및 머리카락 영역을 포함하는 네 번째 타겟 마스크를 생성할 수 있다. 물론 전술한 첫 번째 타겟 마스크와 마찬가지로, 각각의 마스크 상에 포함되는 영역들은 서로 유사한 색상으로 채색될 수 있는 영역에 해당할 수 있다. 또한 도면에는 도시되지 않았지만, 서버(200)는 도 5a 내지 5d에서 설명한 타겟 마스크 외에, 얼굴 영역을 포함하는 마스크, 몸통 영역을 포함하는 마스크 등을 더 생성할 수 있다.

본 발명의 일 실시예에 따른 서버(200)는 학습된 제1 인공 신경망을 이용하여, 전술한 과정에 의해 생성된 적어도 하나의 타겟 마스크 각각에 대응되고, 획득된 레퍼런스 이미지의 적어도 일부 영역을 포함하는 적어도 하나의 레퍼런스 마스크를 생성할 수 있다.(S112)

제1 인공 신경망은 전술한 바와 같이 입력된 이미지를 복수의 영역으로 구분하여 적어도 하나의 마스크를 생성하도록 학습된 신경망으로, 채색하고자 하는 색상의 유사도와 더불어, 입력된 마스크들(즉 입력된 타겟 마스크들)을 참조하여 입력된 이미지를 복수의 영역으로 구분하여 마스크를 생성하도록 학습된 신경망일 수 있다. 따라서 서버(200)는 제1 인공 신경망을 이용하여 레퍼런스 이미지 및 적어도 하나의 타겟 마스크들로부터 적어도 하나의 레퍼런스 마스크를 생성할 수 있다. 바꾸어 말하면, 서버(200)는 제1 인공 신경망에 레퍼런스 이미지 및 적어도 하나의 타겟 마스크를 입력하여, 그 출력으로써 적어도 하나의 레퍼런스 마스크를 획득할 수 있다.

본 발명의 일 실시예에 따른 서버(200)는 타겟 이미지(도 4)의 배경 상단 영역을 포함하는 도 5a와 같은 타켓 마스크를 참조하여, 도 6과 같은 레퍼런스 이미지로부터 도 7a와 같이 배경의 상단 영역을 포함하는 첫 번째 레퍼런스 마스크를 생성할 수 있다.

이와 유사하게, 서버(200)는 배경의 하단 영역을 포함하는 도 5b와 같은 타켓 마스크를 참조하여, 도 6과 같은 레퍼런스 이미지로부터 도 7b와 같이 배경의 하단 영역을 포함하는 두 번째 레퍼런스 마스크를 생성할 수 있다.

물론 서버(200)는 말풍선 영역을 포함하는 도 5c와 같은 타겟 마스크를 참조하여 도 7c와 같은 레퍼런스 마스크를 생성할 수도 있고, 머리카락 영역등을 포함하는 도 5d와 같은 타겟 마스크를 참조하여, 도 7d와 같은 레퍼런스 마스크를 생성할 수도 있다.

한편 도 7a 내지 도 7d에 도시된 레퍼런스 마스크는 예시적인 것으로, 레퍼런스 마스크의 수량이나 구체적인 형태가 이에 한정되는 것은 아니다. 따라서 서버(200)는 도 7a 내지 7d에서 설명한 타겟 마스크 외에, 얼굴 영역을 포함하는 마스크, 몸통 영역을 포함하는 마스크 등을 더 생성할 수 있다.

본 발명의 일 실시예에 따른 서버(200)는 적어도 하나의 레퍼런스 마스크의 색상을 참조하여, 적어도 하나의 타겟 마스크 각각을 채색하여 적어도 하나의 채색된 타겟 마스크를 생성할 수 있다.(S113)

이를 위하여 본 발명의 일 실시예에 따른 서버(200)는 소정의 방식에 따라 레퍼런스 마스크에 포함된 영역의 대표 색상을 결정할 수 있다.

따라서 서버(200)는 레퍼런스 마스크와 레퍼런스 이미지를 함께 참조하여 해당 레퍼런스 마스크에 포함된 영역의 대표 색상을 해당 레퍼런스 마스크의 색상으로 결정할 수 있다.

가령 서버(200)는 도 7a에 도시된 첫 번째 레퍼런스 마스크에 포함되는 영역을 참조하여, 도 6의 레퍼런스 이미지에서 해당 영역의 평균 색상을 첫 번째 레퍼런스 마스크에 포함되는 영역의 대표 색상, 즉 해당 레퍼런스 마스크의 색상으로 결정할 수 있다.

물론 서버(200)는 도 7b에 도시된 두 번째 레퍼런스 마스크에 포함되는 영역을 참조하여, 도 6의 레퍼런스 이미지에서 해당 영역의 평균 색상을 두 번째 레퍼런스 마스크에 포함되는 영역의 대표 색상(즉 해당 레퍼런스 마스크의 색상)으로 결정할 수도 있다.

서버(200)는 전술한 과정에 의해 결정된 대표 색상을 해당 레퍼런스 마스크에 대응되는 타겟 마스크의 색상으로 결정하여 채색된 타겟 마스크를 생성할 수 있다. 바꾸어 말하면 서버(200)는 타겟 마스크를 각각의 타겟 마스크에 대응되는 레퍼런스 마스크의 색상으로 채색하여 채색된 타겟 마스크를 생성할 수 있다.

전술한 바와 같이 서버(200)는 도 7a에 도시된 첫 번째 레퍼런스 마스크에 포함되는 영역을 참조하여, 도 6의 레퍼런스 이미지에서 해당 영역의 평균 색상을 첫 번째 레퍼런스 마스크에 포함되는 영역의 대표 색상으로 결정할 수 있다. 또한 서버(200)는 레퍼런스 마스크와 타겟 마스크 간의 대응관계를 고려하여, 도 5a에 도시된 첫 번째 타겟 마스크를 결정된 대표 색상으로 채색하여 도 8에 도시된 바와 같이 채색된 타겟 마스크를 생성할 수 있다.

물론 서버(200)는 이와 동일한 방법으로, 도 5b, 도 5c 및 도 5d에 도시된 타겟 마스크 각각을, 각각에 대해 결정된 대표 색상으로 채색하여 도 8에 도시된 바와 같이 채색된 타겟 마스크를 생성할 수 있다. 서버(200)에 의해 채색된 타겟 마스크는 채색된 타겟 이미지를 생성하는데 사용될 수 있다.

본 발명의 일 실시예에 따른 서버(200)는 학습된 제2 인공 신경망을 이용하여, 타겟 이미지, 적어도 하나의 타겟 마스크 및 적어도 하나의 채색된 타겟 마스크로부터 채색된 타겟 이미지를 생성할 수 있다.(S114)

서버(200)는 이러한 제2 인공 신경망을 이용하여, 적어도 하나의 채색된 타겟 마스크를 병합하여 채색된 타겟 이미지를 생성하되, 적어도 하나의 채색된 타겟 마스크에 소정의 이미지 효과를 적용하여 채색된 타겟 이미지를 생성할 수 있다.

타겟 이미지의 채색에 참조된 레퍼런스 이미지(도 6)와 타겟 이미지(도 9)를 대비하여 살펴보면, 제1 인공 신경망 및 제2 인공 신경망에 의해 타겟 이미지와 레퍼런스의 이미지 내의 서로 대응되는 영역에 동일한 색상이 채색될 수 있다.

본 발명의 다른 실시예에서, 사용자 단말(100)은 도 11에서 설명하는 타겟 이미지의 채색을 완성하는 방법을 수행할 수 있다. 바꾸어 말하면, 도 1 내지 도 11에서 서버(200) 및/또는 서버(200)의 프로세서(212)에 의해 수행되는 것으로 설명된 타겟 이미지의 채색을 완성하는 방법은, 사용자 단말(100) 및/또는 사용자 단말(100)의 프로세서(112)에 의해 수행될 수 있다.

이러한 경우, 사용자 단말(100)은 사용자의 조작에 기초하여 타겟 이미지 및 레퍼런스 이미지를 결정하고, 단계 S111에서 설명한 바와 같이 학습된 제1 인공 신경망을 이용하여 획득된 타겟 이미지의 일부 영역을 포함하는 적어도 하나의 타겟 마스크(Mask)를 생성할 수 있다.

또한 단계 S112에서 설명한 바와 같이, 사용자 단말(100)은 학습된 제1 인공 신경망을 이용하여, 전술한 과정에 의해 생성된 적어도 하나의 타겟 마스크 각각에 대응되고, 획득된 레퍼런스 이미지의 적어도 일부 영역을 포함하는 적어도 하나의 레퍼런스 마스크를 생성할 수 있다.

또한 단계 S113에서 설명한 바와 같이, 사용자 단말(100)은 적어도 하나의 레퍼런스 마스크의 색상을 참조하여, 적어도 하나의 타겟 마스크 각각을 채색하여 적어도 하나의 채색된 타겟 마스크를 생성할 수 있다.

마지막으로 단계 S114에서 설명한 바와 같이, 사용자 단말(100)은 학습된 제2 인공 신경망을 이용하여, 타겟 이미지, 적어도 하나의 타겟 마스크 및 적어도 하나의 채색된 타겟 마스크로부터 채색된 타겟 이미지를 생성할 수 있다. 단계 S111 내지 단계 S114에 대한 상세한 설명은 생략한다.

이상에서 설명된 장치는 하드웨어 구성요소, 소프트웨어 구성요소, 및/또는 하드웨어 구성요소 및 소프트웨어 구성요소의 조합으로 구현될 수 있다. 예를 들어, 실시예들에서 설명된 장치 및 구성요소는, 예를 들어, 프로세서, 콘트롤러, ALU(arithmetic logic unit), 디지털 신호 프로세서(digital signal processor), 마이크로컴퓨터, FPGA(field programmable gate array), PLU(programmable logic unit), 마이크로프로세서, 또는 명령(instruction)을 실행하고 응답할 수 있는 다른 어떠한 장치와 같이, 하나 이상의 범용 컴퓨터 또는 특수 목적 컴퓨터를 이용하여 구현될 수 있다. 처리 장치는 운영 체제(OS) 및 운영 체제 상에서 수행되는 하나 이상의 소프트웨어 어플리케이션을 수행할 수 있다. 또한, 처리 장치는 소프트웨어의 실행에 응답하여, 데이터를 접근, 저장, 조작, 처리 및 생성할 수도 있다. 이해의 편의를 위하여, 처리 장치는 하나가 사용되는 것으로 설명된 경우도 있지만, 해당 기술분야에서 통상의 지식을 가진 자는, 처리 장치가 복수 개의 처리 요소(processing element) 및/또는 복수 유형의 처리 요소를 포함할 수 있음을 알 수 있다. 예를 들어, 처리 장치는 복수 개의 프로세서 또는 하나의 프로세서 및 하나의 콘트롤러를 포함할 수 있다. 또한, 병렬 프로세서(parallel processor)와 같은, 다른 처리 구성(processing configuration)도 가능하다.

소프트웨어는 컴퓨터 프로그램(computer program), 코드(code), 명령(instruction), 또는 이들 중 하나 이상의 조합을 포함할 수 있으며, 원하는 대로 동작하도록 처리 장치를 구성하거나 독립적으로 또는 결합적으로(collectively) 처리 장치를 명령할 수 있다. 소프트웨어 및/또는 데이터는, 처리 장치에 의하여 해석되거나 처리 장치에 명령 또는 데이터를 제공하기 위하여, 어떤 유형의 기계, 구성요소(component), 물리적 장치, 가상 장치(virtual equipment), 컴퓨터 저장 매체 또는 장치, 또는 전송되는 신호 파(signal wave)에 영구적으로, 또는 일시적으로 구체화(embody)될 수 있다. 소프트웨어는 네트워크로 연결된 컴퓨터 시스템 상에 분산되어서, 분산된 방법으로 저장되거나 실행될 수도 있다. 소프트웨어 및 데이터는 하나 이상의 컴퓨터 판독 가능 기록 매체에 저장될 수 있다.

실시예에 따른 방법은 다양한 컴퓨터 수단을 통하여 수행될 수 있는 프로그램 명령 형태로 구현되어 컴퓨터 판독 가능 매체에 기록될 수 있다. 컴퓨터 판독 가능 매체는 프로그램 명령, 데이터 파일, 데이터 구조 등을 단독으로 또는 조합하여 포함할 수 있다. 매체에 기록되는 프로그램 명령은 실시예를 위하여 특별히 설계되고 구성된 것들이거나 컴퓨터 소프트웨어 당업자에게 공지되어 사용 가능한 것일 수도 있다. 컴퓨터 판독 가능 기록 매체의 예에는 하드 디스크, 플로피 디스크 및 자기 테이프와 같은 자기 매체(magnetic media), CD-ROM, DVD와 같은 광기록 매체(optical media), 플롭티컬 디스크(floptical disk)와 같은 자기-광 매체(magneto-optical media), 및 롬(ROM), 램(RAM), 플래시 메모리 등과 같은 프로그램 명령을 저장하고 수행하도록 특별히 구성된 하드웨어 장치가 포함된다. 프로그램 명령의 예에는 컴파일러에 의해 만들어지는 것과 같은 기계어 코드뿐만 아니라 인터프리터 등을 사용해서 컴퓨터에 의해서 실행될 수 있는 고급 언어 코드를 포함한다. 상기된 하드웨어 장치는 실시예의 동작을 수행하기 위해 하나 이상의 소프트웨어 모듈로서 작동하도록 구성될 수 있으며, 그 역도 마찬가지이다.

이상과 같이 실시예들이 비록 한정된 실시예와 도면에 의해 설명되었으나, 해당 기술분야에서 통상의 지식을 가진 자라면 상기의 기재로부터 다양한 수정 및 변형이 가능하다. 예를 들어, 설명된 기술들이 설명된 방법과 다른 순서로 수행되거나, 및/또는 설명된 시스템, 구조, 장치, 회로 등의 구성요소들이 설명된 방법과 다른 형태로 결합 또는 조합되거나, 다른 구성요소 또는 균등물에 의하여 대치되거나 치환되더라도 적절한 결과가 달성될 수 있다.

그러므로, 다른 구현들, 다른 실시예들 및 특허청구범위와 균등한 것들도 후술하는 특허청구범위의 범위에 속한다.

100: 사용자 단말
101, 102, 103, 104: 사용자 단말
111: 메모리
112: 프로세서
113: 통신 모듈
114: 입출력 인터페이스
115: 입출력 장치
200: 서버
211: 메모리
212: 프로세서
213: 통신 모듈
214: 입출력 인터페이스
300: 네트워크

Claims

레퍼런스(Reference) 이미지를 이용하여 채색하고자 하는 타겟(Target) 이미지의 채색을 완성하는 방법에 있어서,
학습된 제1 인공 신경망을 이용하여, 상기 타겟 이미지의 일부 영역을 포함하는 적어도 하나의 타겟 마스크(Mask)를 생성하는 단계;
상기 제1 인공 신경망을 이용하여, 상기 적어도 하나의 타겟 마스크 각각에 대응되고, 상기 레퍼런스 이미지의 적어도 일부 영역을 포함하는 적어도 하나의 레퍼런스 마스크를 생성하는 단계;
상기 적어도 하나의 레퍼런스 마스크의 색상을 참조하여, 상기 적어도 하나의 타겟 마스크 각각을 채색하여 적어도 하나의 채색된 타겟 마스크를 생성하는 단계; 및
학습된 제2 인공 신경망을 이용하여, 상기 타겟 이미지, 상기 적어도 하나의 타겟 마스크 및 상기 적어도 하나의 채색된 타겟 마스크로부터 채색된 타겟 이미지를 생성하는 단계;를 포함하는, 타겟 이미지의 채색을 완성하는 방법.
청구항 1에 있어서
상기 제1 인공 신경망은
각 영역에 채색하고자 하는 색상의 유사도에 기초하여 상기 타겟 이미지를 적어도 하나의 영역으로 구분하고, 구분된 적어도 하나의 영역 각각을 포함하는 상기 적어도 하나의 타겟 마스크를 생성하도록 학습된 신경망인, 타겟 이미지의 채색을 완성하는 방법.
청구항 2에 있어서
상기 적어도 하나의 타겟 마스크는
상기 타겟 이미지를 구성하는 복수의 지점 각각이 적어도 하나의 타겟 마스크 각각에 포함되는지 여부를 포함하는, 타겟 이미지의 채색을 완성하는 방법.
청구항 2에 있어서
상기 제1 인공 신경망은
각 영역에 채색하고자 하는 색상의 유사도 및 상기 적어도 하나의 타겟 마스크에 포함된 영역과의 형상 유사도에 기초하여, 상기 레퍼런스 이미지를 적어도 하나의 영역으로 구분하고, 구분된 적어도 하나의 영역 각각을 포함하는 상기 적어도 하나의 레퍼런스 마스크를 생성하도록 학습된 신경망인, 타겟 이미지의 채색을 완성하는 방법.
청구항 4에 있어서
상기 적어도 하나의 레퍼런스 마스크는
상기 레퍼런스 이미지를 구성하는 복수의 지점 각각이 적어도 하나의 레퍼런스 마스크 각각에 포함되는지 여부를 포함하는, 타겟 이미지의 채색을 완성하는 방법.
청구항 1에 있어서
상기 제2 인공 신경망은
상기 타겟 이미지 및 상기 적어도 하나의 타겟 마스크를 참조하여, 상기 적어도 하나의 채색된 타겟 마스크로부터 상기 채색된 타겟 이미지를 생성하도록 학습된 신경망인, 타겟 이미지의 채색을 완성하는 방법.
청구항 6에 있어서
상기 제2 인공 신경망은
상기 타겟 이미지 및 상기 적어도 하나의 타겟 마스크를 참조하여, 상기 적어도 하나의 채색된 타겟 마스크로부터 상기 채색된 타겟 이미지를 생성하되, 상기 적어도 하나의 채색된 타겟 마스크에 소정의 이미지 효과를 적용하여 상기 채색된 타겟 이미지를 생성하도록 학습된 신경망인, 타겟 이미지의 채색을 완성하는 방법.
청구항 7에 있어서
상기 소정의 이미지 효과는
상기 적어도 하나의 채색된 타겟 마스크 각각에 포함되는 픽셀들이 인접하는 픽셀과의 색상 차이가 소정의 임계 차이 이하가 되도록 하는 효과인, 타겟 이미지의 채색을 완성하는 방법.
청구항 1에 있어서
상기 채색된 타겟 마스크를 생성하는 단계는
소정의 방식에 따라 제1 레퍼런스 마스크에 포함된 영역의 대표 색상을 결정하는 단계; 및
상기 대표 색상을 상기 제1 레퍼런스 마스크에 대응되는 타겟 마스크의 색상으로 결정하여, 상기 채색된 타겟 마스크를 생성하는 단계;를 포함하는, 타겟 이미지의 채색을 완성하는 방법.
청구항 9에 있어서
상기 소정의 방식은
상기 제1 레퍼런스 마스크에 포함된 영역의 색상의 평균 색상을 상기 대표 색상으로 결정하는 방식인, 타겟 이미지의 채색을 완성하는 방법.
컴퓨터를 이용하여
청구항 1 내지 청구항 10 중 어느 한 항의 방법을 실행하기 위하여 매체에 저장된 컴퓨터 프로그램.
레퍼런스 이미지를 이용하여 채색하고자 하는 타겟 이미지의 채색을 완성하는 장치에 있어서, 상기 장치는 프로세서를 포함하고,
상기 프로세서는
학습된 제1 인공 신경망을 이용하여, 상기 타겟 이미지의 일부 영역을 포함하는 적어도 하나의 타겟 마스크(Mask)를 생성하고,
상기 제1 인공 신경망을 이용하여, 상기 적어도 하나의 타겟 마스크 각각에 대응되고, 상기 레퍼런스 이미지의 적어도 일부 영역을 포함하는 적어도 하나의 레퍼런스 마스크를 생성하고,
상기 적어도 하나의 레퍼런스 마스크의 색상을 참조하여, 상기 적어도 하나의 타겟 마스크 각각을 채색하여 적어도 하나의 채색된 타겟 마스크를 생성하고,
학습된 제2 인공 신경망을 이용하여, 상기 타겟 이미지, 상기 적어도 하나의 타겟 마스크 및 상기 적어도 하나의 채색된 타겟 마스크로부터 채색된 타겟 이미지를 생성하는, 타겟 이미지의 채색을 완성하는 장치.
청구항 12에 있어서
상기 제1 인공 신경망은
각 영역에 채색하고자 하는 색상의 유사도에 기초하여 상기 타겟 이미지를 적어도 하나의 영역으로 구분하고, 구분된 적어도 하나의 영역 각각을 포함하는 상기 적어도 하나의 타겟 마스크를 생성하도록 학습된 신경망인, 타겟 이미지의 채색을 완성하는 장치.
청구항 13에 있어서
상기 적어도 하나의 타겟 마스크는
상기 타겟 이미지를 구성하는 복수의 지점 각각이 적어도 하나의 타겟 마스크 각각에 포함되는지 여부를 포함하는, 타겟 이미지의 채색을 완성하는 장치.
청구항 13에 있어서
상기 제1 인공 신경망은
각 영역에 채색하고자 하는 색상의 유사도 및 상기 적어도 하나의 타겟 마스크에 포함된 영역과의 형상 유사도에 기초하여, 상기 레퍼런스 이미지를 적어도 하나의 영역으로 구분하고, 구분된 적어도 하나의 영역 각각을 포함하는 상기 적어도 하나의 레퍼런스 마스크를 생성하도록 학습된 신경망인, 타겟 이미지의 채색을 완성하는 장치.
청구항 15에 있어서
상기 적어도 하나의 레퍼런스 마스크는
상기 레퍼런스 이미지를 구성하는 복수의 지점 각각이 적어도 하나의 레퍼런스 마스크 각각에 포함되는지 여부를 포함하는, 타겟 이미지의 채색을 완성하는 장치.
청구항 12에 있어서
상기 제2 인공 신경망은
상기 타겟 이미지 및 상기 적어도 하나의 타겟 마스크를 참조하여, 상기 적어도 하나의 채색된 타겟 마스크로부터 상기 채색된 타겟 이미지를 생성하도록 학습된 신경망인, 타겟 이미지의 채색을 완성하는 장치.
청구항 17에 있어서
상기 제2 인공 신경망은
상기 타겟 이미지 및 상기 적어도 하나의 타겟 마스크를 참조하여, 상기 적어도 하나의 채색된 타겟 마스크로부터 상기 채색된 타겟 이미지를 생성하되, 상기 적어도 하나의 채색된 타겟 마스크에 소정의 이미지 효과를 적용하여 상기 채색된 타겟 이미지를 생성하도록 학습된 신경망인, 타겟 이미지의 채색을 완성하는 장치.
청구항 18에 있어서
상기 소정의 이미지 효과는
상기 적어도 하나의 채색된 타겟 마스크 각각에 포함되는 픽셀들이 인접하는 픽셀과의 색상 차이가 소정의 임계 차이 이하가 되도록 하는 효과인, 타겟 이미지의 채색을 완성하는 장치.
청구항 12에 있어서
상기 프로세서는
소정의 방식에 따라 제1 레퍼런스 마스크에 포함된 영역의 대표 색상을 결정하고,
상기 대표 색상을 상기 제1 레퍼런스 마스크에 대응되는 타겟 마스크의 색상으로 결정하여, 상기 채색된 타겟 마스크를 생성하는, 타겟 이미지의 채색을 완성하는 장치.
청구항 20에 있어서
상기 소정의 방식은
상기 제1 레퍼런스 마스크에 포함된 영역의 색상의 평균 색상을 상기 대표 색상으로 결정하는 방식인, 타겟 이미지의 채색을 완성하는 장치.