WO2018070552A1 - 영상을 부호화/복호화 하는 방법 및 그 장치 - Google Patents

영상을 부호화/복호화 하는 방법 및 그 장치 Download PDF

Info

Publication number
WO2018070552A1
WO2018070552A1 PCT/KR2016/011299 KR2016011299W WO2018070552A1 WO 2018070552 A1 WO2018070552 A1 WO 2018070552A1 KR 2016011299 W KR2016011299 W KR 2016011299W WO 2018070552 A1 WO2018070552 A1 WO 2018070552A1
Authority
WO
WIPO (PCT)
Prior art keywords
coding unit
unit
transform
information
coding
Prior art date
Application number
PCT/KR2016/011299
Other languages
English (en)
French (fr)
Inventor
민정혜
박민우
진보라
김찬열
Original Assignee
삼성전자 주식회사
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Priority to CN201680091481.9A priority Critical patent/CN110063058B/zh
Priority to CN202211629079.5A priority patent/CN115802035A/zh
Application filed by 삼성전자 주식회사 filed Critical 삼성전자 주식회사
Priority to CA3239143A priority patent/CA3239143A1/en
Priority to PCT/KR2016/011299 priority patent/WO2018070552A1/ko
Priority to CA3114825A priority patent/CA3114825A1/en
Priority to KR1020237027322A priority patent/KR20230125329A/ko
Priority to KR1020217033063A priority patent/KR102367136B1/ko
Priority to CA3039663A priority patent/CA3039663C/en
Priority to CN202211629080.8A priority patent/CN115802036A/zh
Priority to KR1020197007991A priority patent/KR102315926B1/ko
Priority to CN202211629119.6A priority patent/CN115802037A/zh
Priority to EP16918754.9A priority patent/EP3506631A4/en
Priority to KR1020227005817A priority patent/KR102568900B1/ko
Priority to CN202211587859.8A priority patent/CN115883826A/zh
Priority to US16/339,574 priority patent/US10904537B2/en
Publication of WO2018070552A1 publication Critical patent/WO2018070552A1/ko
Priority to US17/115,423 priority patent/US11178408B2/en
Priority to US17/115,402 priority patent/US11653006B2/en

Links

Images

Classifications

    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N19/00Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
    • H04N19/10Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
    • H04N19/169Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding
    • H04N19/17Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding the unit being an image region, e.g. an object
    • H04N19/176Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding the unit being an image region, e.g. an object the region being a block, e.g. a macroblock
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N19/00Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
    • H04N19/10Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
    • H04N19/102Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the element, parameter or selection affected or controlled by the adaptive coding
    • H04N19/119Adaptive subdivision aspects, e.g. subdivision of a picture into rectangular or non-rectangular coding blocks
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N19/00Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
    • H04N19/10Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
    • H04N19/102Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the element, parameter or selection affected or controlled by the adaptive coding
    • H04N19/12Selection from among a plurality of transforms or standards, e.g. selection between discrete cosine transform [DCT] and sub-band transform or selection between H.263 and H.264
    • H04N19/122Selection of transform size, e.g. 8x8 or 2x4x8 DCT; Selection of sub-band transforms of varying structure or type
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N19/00Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
    • H04N19/10Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
    • H04N19/134Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the element, parameter or criterion affecting or controlling the adaptive coding
    • H04N19/157Assigned coding mode, i.e. the coding mode being predefined or preselected to be further used for selection of another element or parameter
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N19/00Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
    • H04N19/10Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
    • H04N19/169Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding
    • H04N19/18Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding the unit being a set of transform coefficients
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N19/00Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
    • H04N19/10Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
    • H04N19/169Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding
    • H04N19/186Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding the unit being a colour or a chrominance component
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N19/00Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
    • H04N19/44Decoders specially adapted therefor, e.g. video decoders which are asymmetric with respect to the encoder
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N19/00Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
    • H04N19/46Embedding additional information in the video signal during the compression process
    • H04N19/463Embedding additional information in the video signal during the compression process by compressing encoding parameters before transmission
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N19/00Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
    • H04N19/60Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using transform coding

Definitions

  • Various data units may be used to compress an image, and there may be an inclusion relationship among these data units.
  • the data unit may be divided by various methods, and the optimized data unit is determined according to the characteristics of the image, thereby encoding or decoding the image.
  • square coding units are determined through a recursive partitioning process that determines whether to split in a process of determining a size of coding units included in a picture, and then splits them into four equally sized coding units. Decided.
  • a bitstream obtainer for obtaining block shape information of a current coding unit and at least one coding unit for dividing the image are determined based on the block shape information
  • a decoder configured to decode the image by determining at least one transform unit based on a form of a current coding unit included in at least one coding unit, and performing inverse transform based on the at least one transform unit
  • the block shape information may be provided with an image decoding apparatus that indicates whether the current coding unit is a square form or a non-square form.
  • An image encoding method may be provided that includes generating a bitstream including the bitstream.
  • an apparatus for encoding an image includes: determining at least one coding unit for dividing the image, and based on a form of a current coding unit included in the at least one coding unit, at least one transformation unit And an encoding unit encoding the image by performing transformation based on the at least one transformation unit, block shape information indicating whether the current coding unit is square or non-square, and the encoded image.
  • An image encoding apparatus including a bitstream generator configured to generate a bitstream may be provided.
  • transform unit adaptive to the characteristics of the image may be used, thereby enabling efficient image encoding and decoding. It is possible to improve the quality of the reconstructed image.
  • FIG. 2 is a block diagram of an image encoding apparatus that encodes an image based on a transformation unit included in a coding unit that divides an image, according to an exemplary embodiment.
  • 4A, 4B, and 4C illustrate various types of transformation units that may be determined in a current coding unit having a non-square shape according to an embodiment.
  • FIG. 5 illustrates a process of determining a plurality of transformation units included in a current coding unit based on a result of comparing a size of a current coding unit with a maximum size of a transformation unit, according to an embodiment.
  • FIG. 6 is a diagram for describing a feature in which a combination of forms that a transformation unit may have may vary for each predetermined data unit, according to an exemplary embodiment.
  • FIG. 7 illustrates a conversion unit having a minimum size that can be determined for each luminance component and a chrominance component according to an embodiment.
  • FIG. 8 is a diagram for describing a process of obtaining information indicating whether a transform unit other than zero is included in a transform unit of a current depth in a process of determining at least one transform unit included in a current coding unit, according to an embodiment. Drawing.
  • FIG. 10 illustrates a process in which at least one coding unit is determined by dividing a coding unit having a non-square shape according to an embodiment.
  • FIG. 11 illustrates a process of splitting a coding unit based on at least one of block type information and split type information, according to an embodiment.
  • FIG. 12 illustrates a method of determining a predetermined coding unit among odd number of coding units according to an embodiment.
  • FIG. 13 illustrates an order in which a plurality of coding units are processed when a current coding unit is divided and a plurality of coding units are determined according to an embodiment.
  • 15 is a diagram illustrating a process of determining at least one coding unit by dividing a first coding unit according to an embodiment.
  • FIG. 16 illustrates that a form in which a second coding unit may be split is limited when the second coding unit having a non-square shape determined by splitting the first coding unit satisfies a predetermined condition according to an embodiment. .
  • FIG. 18 illustrates that a processing order between a plurality of coding units may vary according to a division process of coding units, according to an embodiment.
  • 19 is a diagram illustrating a process of determining a depth of a coding unit according to an embodiment when a coding unit is recursively divided and a plurality of coding units are determined.
  • FIG. 20 illustrates a depth and a part index (PID) for distinguishing a coding unit, which may be determined according to the shape and size of coding units, according to an embodiment.
  • PID depth and a part index
  • 21 illustrates that a plurality of coding units are determined according to a plurality of predetermined data units included in a picture according to an embodiment.
  • FIG. 22 is a diagram of a processing block serving as a reference for determining a determination order of a reference coding unit included in a picture, according to an embodiment.
  • FIG. 23 illustrates coding units that may be determined for each picture when combinations of forms in which coding units may be divided are different for each picture, according to an embodiment.
  • 26 is a block diagram of an image encoding and decoding system for performing loop filtering.
  • FIG. 27 is a diagram illustrating an example of filtering units included in a maximum coding unit and filtering performance information of a filtering unit, according to an embodiment.
  • FIG. 28 illustrates a process of merging or splitting between coding units determined according to a predetermined encoding method, according to an embodiment.
  • 29 illustrates an index according to a Z scan order of coding units, according to an embodiment.
  • FIG. 30 is a diagram illustrating a reference sample for intra prediction of a coding unit, according to an embodiment.
  • An image decoding method may be provided that indicates whether the shape is square or non-square.
  • the determining of the plurality of transformation units may include determining a plurality of transformation units having a square form when the current coding unit is a square form, and when the current coding unit is a non-square form when the current coding unit is a non-square form. And dividing the current coding unit in a vertical direction or a horizontal direction to determine a plurality of transformation units.
  • the determining of at least one transform unit may include determining a plurality of transform units of the maximum size included in the current coding unit when the size of the current coding unit is greater than the maximum size of the transform unit. It may further comprise a step.
  • the image decoding method may further include obtaining at least one of information on the maximum size and information on the minimum size of the transform unit from the bitstream.
  • the image decoding method may further include acquiring, from the bitstream, information about a block type that the at least one transformation unit may have.
  • the determining of the at least one transform unit may be performed if the size of the current coding unit for decoding a chroma sample of the image is smaller than the minimum size of the at least one transform unit.
  • the method may further include determining the at least one conversion unit having a size greater than or equal to size.
  • the image decoding method may be characterized in that the depth of the at least one transformation unit is determined based on the length of the long side of the at least one transformation unit.
  • the determining of the at least one transform unit may further include obtaining information from the bitstream indicating whether a transform coefficient other than zero is included in the transform unit of the current depth determined during the splitting of the transform unit.
  • decoding the image may include decoding the image by using information indicating whether a non-zero transform coefficient is included.
  • the obtaining of the information indicating whether a non-zero transform coefficient is included from the bitstream may include: a shape of the current coding unit, whether the color difference component of the image is included in the current coding unit, and the current Obtaining from the bitstream information indicating whether the non-zero transform coefficient is included based on at least one of whether intra prediction used in a coding unit is performed and the number of transform units included in the current coding unit. can do.
  • the obtaining of the information from the bitstream indicating whether a non-zero transform coefficient is included may further include that when the shape of the current coding unit is non-square, the transform unit of the current depth is no longer split. Otherwise, obtaining information from the bitstream indicating whether a non-zero transform coefficient is included in the transform unit of the current depth.
  • decoding the image may include determining a context index based on the form of the at least one transformation unit, and decoding the image based on the determined context index.
  • An image encoding method may be provided that includes generating a bitstream including the bitstream.
  • an apparatus for encoding an image includes: determining at least one coding unit for dividing the image, and based on a form of a current coding unit included in the at least one coding unit, at least one transformation unit And an encoding unit encoding the image by performing transformation based on the at least one transformation unit, block shape information indicating whether the current coding unit is square or non-square, and the encoded image.
  • An image encoding apparatus including a bitstream generator configured to generate a bitstream may be provided.
  • part refers to a hardware component, such as software, FPGA or ASIC, and “part” plays certain roles. However, “part” is not meant to be limited to software or hardware.
  • the “unit” may be configured to be in an addressable storage medium and may be configured to play one or more processors.
  • a “part” refers to components such as software components, object-oriented software components, class components, and task components, processes, functions, properties, procedures, Subroutines, segments of program code, drivers, firmware, microcode, circuits, data, databases, data structures, tables, arrays and variables.
  • the functionality provided within the components and “parts” may be combined into a smaller number of components and “parts” or further separated into additional components and “parts”.
  • the "image” may be a static image such as a still image of a video or may represent a dynamic image such as a video, that is, the video itself.
  • sample means data to be processed as data allocated to a sampling position of an image.
  • pixel values and transform coefficients on a transform region may be samples in an image of a spatial domain.
  • a unit including the at least one sample may be defined as a block.
  • FIG. 1 is a block diagram of an image decoding apparatus for decoding an image based on a transformation unit included in a coding unit for dividing an image, according to an exemplary embodiment.
  • the bitstream obtainer 110 of the image decoding apparatus 100 may obtain split information of a transform unit from a bitstream, and the decoder 120 parses split information of a transform unit from a bitstream. It may be used to determine at least one transformation unit included in the current coding unit.
  • the decoding unit 120 determines whether the current coding unit is square or non-square. Based on, a plurality of transformation units included in the current coding unit may be determined.
  • the current transform unit may mean a data block used in a process of recursively partitioning a transform unit that has a tree structure and is no longer split. That is, the current transformation unit may be a data block of various shapes and sizes in which it may be determined whether to divide into a plurality of transformation units of small size in the recursive partitioning process.
  • the split information of the transformation unit indicates that the current transformation unit is divided into a plurality of transformation units, and when the current coding unit is in a square form, the decoder 120 may include a plurality of squares included in the current coding unit.
  • the conversion unit can be determined.
  • the decoder 120 may set the current coding unit in a vertical direction or a horizontal direction.
  • a plurality of transformation units may be determined by dividing by.
  • 3A and 3B illustrate various types of transformation units that may be determined by a current coding unit having a square shape according to an embodiment.
  • the decoder 120 of the image decoding apparatus 100 may determine at least one coding unit including the current coding unit 300 based on block shape information. A process of determining a coding unit based on block shape information will be described with reference to various embodiments described below.
  • the determined coding unit may have a square shape or a non-square shape.
  • the decoder 120 may determine a type of a transformation unit that may be included in the current coding unit 300 based on the shape of the current coding unit 300 according to an embodiment.
  • the decoder 120 is a transform unit having a 2N ⁇ 2N size as a form of at least one transform unit included in the current coding unit 300.
  • a transformation unit 310b having an N ⁇ 2N size or a transformation unit 310c having a 2N ⁇ N size may be determined.
  • the decoder 120 of the image decoding apparatus 100 may determine at least one coding unit including the current coding unit 350 based on block shape information.
  • the decoder 120 may determine a type of a transform unit that may be included in the current coding unit 350 based on the shape of the current coding unit 350 having a square shape. For example, if the current coding unit 350 is a block having a square shape having a size of 2N ⁇ 2N, the decoder 120 may form one block having a 2N ⁇ 2N size as a form of at least one transform unit included in the current coding unit 300.
  • the transformation unit 360a may be determined, or four transformation units 370b having an N ⁇ N size may be determined.
  • the bitstream obtainer 110 may obtain split information indicating whether to split a current transformation unit from the bitstream.
  • the decoder 120 may determine at least one transform unit included in the current coding unit based on the split information of the transform unit. For example, when the split information of the obtained transformation unit indicates that the current transformation unit is divided into a plurality of transformation units, the plurality of transformation units included in the current coding unit based on whether the current coding unit is square or non-square.
  • the conversion unit can be determined.
  • the shape of the current coding unit may be related to block shape information related to the current coding unit.
  • 4A, 4B, and 4C illustrate various types of transformation units that may be determined in a current coding unit having a non-square shape according to an embodiment.
  • the decoder 120 may determine at least one transform unit included in a current coding unit 400a having a non-square shape having a height greater than a width according to an embodiment.
  • the decoder 120 may determine that one transform unit 410a is included in the current coding unit 400a or may be determined to include a plurality of transform units 420a by dividing in the horizontal direction.
  • at least one transformation unit included in the current coding unit 450a having a non-square shape having a width greater than a height may be determined according to an embodiment.
  • the decoder 120 may determine that one transform unit 460a is included in the current coding unit 450a or may be determined to include a plurality of transform units 470a by dividing in the horizontal direction.
  • the shapes of the plurality of transformation units 420a or 470a that may be determined by the non-square coding units 400a or 450a may be square.
  • the decoder 120 may determine at least one transform unit included in the current coding unit 400b having a non-square shape having a height greater than a width according to an embodiment.
  • the decoder 120 may determine that one transformation unit 410b is included in the current coding unit 400b, or may be determined to include a plurality of transformation units 420b or 430b by dividing in a horizontal or vertical direction.
  • at least one transformation unit included in the current coding unit 450b having a non-square shape having a width greater than a height may be determined according to an embodiment.
  • the decoder 120 may determine that one transformation unit 460b is included in the current coding unit 450b, or may be determined to include a plurality of transformation units 470b or 480b by dividing in a vertical direction or a horizontal direction. .
  • the decoder 120 may determine at least one transform unit included in the current coding unit 400c having a non-square shape having a height greater than a width according to an embodiment.
  • the decoder 120 may determine that one transformation unit 410c is included in the current coding unit 400c, and may be determined to include a plurality of transformation units 420c or 430c by dividing in a horizontal or vertical direction.
  • the plurality of transformation units 440c may be determined by dividing into a vertical direction and a horizontal direction.
  • at least one transformation unit included in the current coding unit 450c having a non-square shape having a width greater than a height may be determined according to an embodiment.
  • the decoder 120 may determine that one transformation unit 460c is included in the current coding unit 450c, and may be determined to include a plurality of transformation units 470c or 480c by dividing in a vertical direction or a horizontal direction.
  • the plurality of transformation units 490c may be included in the vertical direction and the horizontal direction.
  • the decoder 120 may determine at least one transformation unit. Combination of forms should not be limited to the above-described form, it should be construed that may include a variety of types of transformation unit included in the current coding unit.
  • FIG. 5 illustrates a process of determining a plurality of transformation units included in a current coding unit based on a result of comparing a size of a current coding unit with a maximum size of a transformation unit, according to an embodiment.
  • the decoder 120 may determine at least one transform unit included in the current coding unit 500, and a maximum size of the transform unit may be predetermined. According to an embodiment, the decoder 120 may compare the current coding unit 500 with a transformation unit 510 having a predetermined maximum size. As a result of the comparison, when the size of the current coding unit 500 is larger than the maximum size of the transformation unit, the decoder 120 may determine the plurality of change units 520 having the maximum size included in the current coding unit 500. have. Referring to FIG. 5, when the size of the current coding unit 500 is 2N ⁇ 2N and the maximum size of the transform unit 510 is N ⁇ N, the decoder 120 may determine at least one transform included in the current coding unit 500.
  • the unit may be divided into a transform unit 520 of the largest size included in the current coding unit 500. That is, the decoder 120 determines a plurality of largest transform units included in the current coding unit to determine at least one transform unit included in the current coding unit that is larger than the largest transform unit, and then determines the maximum size. It may be determined whether to divide each transform unit of into smaller transform units.
  • the bitstream obtainer 110 may obtain information about the maximum size of the transform unit from the bitstream.
  • the information on the maximum size of the transformation unit may be an integer directly indicating the maximum size of the transformation unit, or may be an index related to the maximum size.
  • the bitstream obtainer 110 may obtain information about a block type that a transform unit may have from the bitstream, and the decoder 120 may obtain information about a block type that the transform unit may have. Based on the at least one transform unit included in the current coding unit may be determined.
  • the block type that a transformation unit may have may vary, and the decoder may determine a transformation unit included in a data unit (eg, a picture, a slice, a slice segment, a tile, a maximum coding unit, a coding unit, etc.).
  • a data unit eg, a picture, a slice, a slice segment, a tile, a maximum coding unit, a coding unit, etc.
  • a combination of forms that a transformation unit may have may vary for each data unit (for example, a picture, a slice, a slice segment, a tile, a maximum coding unit, and a coding unit).
  • the bitstream generator 110 may obtain information about a block type that a transformation unit may have for each data unit from the bitstream, and the decoder 120 may have a block that the transformation unit may have. Based on the information on the shape, a combination of block types that a transformation unit may have for each predetermined data unit may be differently determined.
  • FIG. 6 is a diagram for describing a feature in which a combination of forms that a transformation unit may have may vary for each predetermined data unit, according to an exemplary embodiment.
  • the bitstream generator 110 may obtain, from the bitstream, information about a block type that a transformation unit may have for each of the maximum coding units 600, 610, 620, and 630 which are predetermined data units.
  • the decoder 120 may determine at least one transform unit based on information on a block shape that a transform unit obtained for each largest coding unit may have.
  • the information on the block shape that the transform unit may have refers to combinations of predetermined block types including shapes that may be obtained by transform units having a small size that may be determined by dividing a square or non-square type transform unit. Information.
  • FIGS. 4A, 4B, and 4C combinations of block types indicated by information on block types that a transformation unit may have will be described based on the types shown in FIGS. 4A, 4B, and 4C.
  • the bitstream obtainer 110 associates a bitstream including information indicating a combination including a form of a transform unit illustrated in FIG. 4A with a maximum coding unit 600. Can be obtained.
  • the decoder 120 may determine at least one transform unit included in one of at least one coding unit included in the maximum coding unit 600 using the types of transform units described above with reference to FIG. 4A. . That is, within the maximum coding unit 600, the decoder 120 may determine a transformation unit by dividing a long side of the non-square transformation unit or not dividing the transformation unit.
  • the bitstream obtainer 110 associates a bitstream including information indicating a combination including a form of a transform unit illustrated in FIG. 4B with a maximum coding unit 610. Can be obtained.
  • the decoder 120 may determine at least one transform unit included in one of at least one coding unit included in the maximum coding unit 610 using the types of transform units described above with reference to FIG. 4B. . That is, within the maximum coding unit 610, the decoder 120 may determine at least one transformation unit by dividing the non-square-shaped transformation unit in the vertical direction or the horizontal direction or not dividing the transformation unit.
  • the bitstream obtainer 110 associates a bitstream including information indicating a combination including a form of a transform unit illustrated in FIG. 4C with the maximum coding unit 620.
  • the decoder 120 may determine at least one transform unit included in one of at least one coding unit included in the maximum coding unit 620 using the types of transform units described above with reference to FIG. 4C. . That is, within the maximum coding unit 620, the decoder 120 divides the non-square-shaped transform unit into at least one of the vertical direction and the horizontal direction or does not divide the transform unit by at least one transform unit. Can be determined.
  • the bitstream obtainer 110 may acquire a bitstream including information indicating a combination including a form of a transform unit illustrated in FIGS. 3A and 3B in relation to the maximum coding unit 600. Can be.
  • the decoder 120 may determine at least one transform unit included in one of at least one coding unit included in the maximum coding unit 600 using the types of transform units described above with reference to FIGS. 3A and 3B. .
  • Combinations of forms of transform units in which square transform units may be divided and determined should not be construed as being limited to the forms shown in FIGS. 3A and 3B and include only some of the forms shown in FIGS. 3A and 3B. Combinations may be included.
  • the bitstream obtainer 110 obtains at least one of information representing the type of transformation unit that the decoder 120 can use and information representing the size of the transformation unit from the bitstream for each predetermined data unit. can do.
  • the image decoding apparatus 100 may include a sequence parameter set, a picture parameter set, a video parameter set, a slice header, and a slice segment header. In one of the segment headers, at least one of information indicating a type of a transformation unit and information indicating a size of a transformation unit may be obtained.
  • the image decoding apparatus 100 may obtain and use from a bitstream including at least one of a maximum coding unit, a reference coding unit, information indicating a shape of a transformation unit for each processing block, and information indicating a size of a transformation unit. .
  • a maximum coding unit e.g., a maximum coding unit
  • a reference coding unit e.g., a reference coding unit
  • information indicating a shape of a transformation unit for each processing block e.g., information indicating a shape of a transformation unit for each processing block
  • information indicating a size of a transformation unit e.g., a size of a transformation unit.
  • the bitstream obtainer 110 of the image decoding apparatus 100 may obtain at least one of information on the maximum size and information on the minimum size of the transform unit from the bitstream.
  • at least one of a maximum size and a minimum size that a transformation unit may have may be predetermined, and accordingly, at least one of information on the maximum size of the transformation unit and information on the minimum size of the transformation unit may be determined.
  • the bitstream may be obtained from the bitstream through the bitstream obtainer 110.
  • the decoder 120 may determine at least one transform unit using the maximum size and the minimum size of the transform unit that may be determined using the obtained information.
  • the information on the maximum size of the transform unit and the information on the minimum size of the transform unit may be obtained for each data unit (sequence, picture, slice, slice segment, tile, maximum coding unit, coding unit, etc.). Can be.
  • the bitstream obtainer 110 obtains at least one of information on the maximum size of the transform unit and information on the minimum size of the transform unit for each sequence including a plurality of pictures from the bitstream, the decoder.
  • the 120 may determine the maximum size and the minimum size of the transform unit for each sequence using this information.
  • the information on the maximum size of the transformation unit and the information on the minimum size of the transformation unit may be information indicating the length of one side of the transformation unit of the square form or the length of the long side of the non-square form. It may be an index indicating the size of a block.
  • the information indicating the length of the sides of the transformation unit may be the number of samples or a logarithm of the number of samples.
  • the bitstream obtainer 110 may provide information indicating a difference between the maximum size and the minimum size of the bitstream and the transformation unit including information on the maximum size of the transformation unit or information on the minimum size of the transformation unit. Can be obtained from the bitstream.
  • the decoding unit 120 uses the maximum size or the minimum size of the transformation unit by using one of information on the maximum size of the transformation unit or information on the minimum size of the transformation unit and information indicating the difference between the maximum and minimum sizes of the transformation unit. Can be determined.
  • the decoder 120 may determine the maximum size of the transform unit using information on the minimum size of the transform unit and information representing the difference between the maximum size and the minimum size of the transform unit.
  • the decoder 120 may determine the minimum size of the transformation unit using information on the maximum size of the transformation unit and information representing the difference between the maximum size and the minimum size of the transformation unit.
  • the decoder 120 may determine, for each component, a transformation unit for performing inverse transformation of a luma component and a chroma component of an image. According to an embodiment, the decoder 120 may differently set a minimum size of the transform unit for the luminance component of the image and a minimum size of the transform unit for the chrominance component. For example, the decoder 120 may determine the minimum size of the transform unit for the luminance component as 4x4 and the minimum size of the transform unit for the chrominance component to 4x2 or 2x4.
  • the decoder 120 may determine the minimum size that the transformation unit may have by dividing the luminance component and the chrominance component in consideration of the relationship or ratio between the luminance component and the chrominance component used according to a method of decoding an image. . According to an embodiment, the decoder 120 may set the minimum size of the transform unit for the luminance component of the image and the minimum size of the transform unit for the chrominance component differently and set the maximum size to be the same.
  • FIG. 7 illustrates a conversion unit having a minimum size that can be determined for each luminance component and a chrominance component according to an embodiment.
  • the decoder 120 may determine at least one transformation unit included in the current coding unit 700 for the luminance component of the image, and include it in the current coding unit 710 for the color difference component of the image. At least one transformation unit may be determined. According to an embodiment, the decoder 120 may differently set the minimum size of the transform unit for the luminance component and the minimum size of the transform unit for the color difference component. For example, the decoder 120 may determine the minimum size of the transform unit for the luminance component as 4x4 and the minimum size of the transform unit for the chrominance component to 4x2 or 2x4.
  • the decoder 120 when the size of the current coding unit 700 for the luminance component is 8x8, the decoder 120 is at least one transform unit included in the current coding unit 700 for the luminance component and has a size of 4x4 or more. At least one transformation unit having may be determined. Referring to FIG. 7, the decoder 120 may determine four transform units included in the current coding unit 710 having a size of 8 ⁇ 8, and in this case, the transform units may have a size of 4 ⁇ 4 having a minimum size.
  • the decoder 120 may determine a coding unit 710 for a color difference component associated with a luminance component of the current coding unit 700. According to an embodiment, when the size of the current coding unit 700 for the luminance component is 2N ⁇ 2N, the decoder 120 may determine that the size of the coding unit 710 for the color difference component associated with the luminance component is N ⁇ N. Referring to FIG. 7, when the size of the current coding unit 700 for the luminance component is 8 ⁇ 8, the size of the current coding unit 710 for the color difference component may be determined to be 4 ⁇ 4.
  • the size of the transform unit for the chrominance component may be a size obtained by dividing the transform unit for the luminance component in at least one of a vertical direction and a horizontal direction. That is, the transformation unit for the color difference component may have a smaller size than the transformation unit for the luminance component.
  • the minimum size of the transform unit for each of the luminance component and the color difference component may be different.
  • the decoder 120 may determine at least one transform unit included in the current coding unit 710 for the color difference component in consideration of the minimum size of the transform unit.
  • the decoder 120 may have a size obtained by dividing the transform unit for the chrominance component in the vertical direction and the horizontal direction. However, when the size of dividing the transform unit for the luminance component in the vertical direction and the horizontal direction is smaller than the minimum size of the transform unit for the color difference component, the decoder 120 considers the color difference in consideration of the minimum size of the transform unit for the color difference component. The unit of conversion for the component can be determined.
  • the decoder 120 may apply to the chrominance component having the minimum size.
  • the conversion unit can be determined.
  • the decoder 120 when the size obtained by dividing the transform unit for the luminance component in the vertical direction and the horizontal direction is smaller than the minimum size of the transform unit for the chrominance component, the decoder 120 adjusts the transform unit for the luminance component in the vertical direction. And transform units having a size divided in a horizontal direction, to determine a transform unit having a size greater than or equal to a minimum size of the transform unit for the color difference component.
  • the decoder 120 may use the size of the transform unit for the luminance component as the size of the transform unit for the color difference component without dividing the transform unit for the luminance component in the vertical direction and the horizontal direction.
  • the decoder 120 may determine the chrominance component.
  • the transformation units split into the minimum size of the transformation unit may be merged. For example, by comparing the minimum size of four 2x2 transform units determined by dividing a transform unit for a luminance component having a 4x4 size and a transform unit for a chrominance component, merging four 4x2 transform units. At least one transform unit for the chrominance component having the smallest size may be determined.
  • the decoder 120 may determine at least one transformation unit (eg, 730, 750, 760, 770) included in the coding unit 710 for the color difference component.
  • the decoder 120 may determine a transform unit for the color difference component in consideration of the minimum size of the transform unit, and the minimum size of the transform unit may vary depending on the luminance component and the color difference component. If the size of the current coding unit 710 for the chrominance component is 2Nx2N, the decoder 120 may include a transform unit 730 having an NxN size, a transform unit 750 having a 2Nx2N size, a transform having a 2NxN or Nx2N size. Unit 760 or 770 may be determined.
  • the decoder 120 may determine the transform unit in consideration of the minimum size of the transform unit for the color difference component. For example, when the minimum size of the transform unit for the color difference component is 4x2 or 2x4, the decoder 120 determines four transform units 730 having a 2x2 size in the current coding unit 710 having a 4x4 size. There is no number. In this case, the decoder 120 may determine a transform unit 760 having a 2 ⁇ 4 size or determine a transform unit 770 having a 4 ⁇ 2 size by merging the transform units 730 having a 2 ⁇ 2 size. As another example, the decoder 120 skips the process of determining four transform units 730 having a 2x2 size, and includes at least one transform unit having a minimum size in the current coding unit 710. It can also be determined as a conversion unit.
  • the bitstream obtainer 110 may obtain information indicating whether the current transform unit includes a non-zero transform coefficient from the bitstream, and the decoder 120 may determine that a non-zero transform coefficient A decoding process may be performed on a sample included in a transformation unit of the current depth using information indicating whether the information is included.
  • the information indicating whether a non-zero transform coefficient is included may be information related to a conversion unit of a current depth determined in a division process of a conversion unit, and the conversion unit of the current depth is later transform unit having a smaller size It may be divided into.
  • the decoder 120 determines whether to perform a residual signal decoding process on a transformation unit of the current depth based on information indicating whether a transformation coefficient other than zero is included in the transformation unit of the current depth. You can decide. That is, when a transform coefficient other than 0 is not included in the transform unit of the current depth, the decoding process of the residual signal for the transform unit of the current depth may be omitted. On the contrary, when a transform coefficient other than 0 is included in a transform unit of the current depth, a residual signal for the transform unit of the current depth may be obtained from the bitstream to perform a decoding process.
  • the bitstream obtainer 110 may obtain information indicating whether a transform coefficient other than zero is included in the transform unit of the current depth for each of the luminance component and the chrominance component related to the current coding unit, from the bitstream. . That is, the bitstream obtainer 110 includes information indicating whether a transform coefficient of the current depth for the luminance component includes a non-zero transform coefficient and a non-zero transform coefficient in the transform unit of the current depth for the chrominance component. At least one of the information indicating whether the information can be obtained from the bitstream.
  • the bitstream obtainer 110 determines that at least one transform unit included in the current coding unit is no longer divided in the current unit of the luminance component when the transform unit of the current depth is no longer split. At least one of information indicating whether a transform unit of depth includes a non-zero transform coefficient and information indicating whether a transform unit of a current depth for a color difference component includes a non-zero transform coefficient may be obtained from the bitstream. have.
  • the image decoding apparatus 100 may obtain a bitstream including information indicating whether a non-zero transform coefficient is included in a transform unit of a current depth for each luminance component and chrominance component.
  • the image decoding apparatus 100 may use the transform unit for the luminance component and the transform unit for the chrominance component differently.
  • the bitstream obtainer 110 acquires information indicating whether a transform coefficient other than zero is included in a transform unit of a current depth for a chrominance component, for each transform unit of a current depth used in the partitioning process. Can be obtained from the bitstream.
  • the bitstream obtainer 110 indicates whether a transform coefficient other than zero is included in the transform unit of the current depth for the luminance component only when the transform unit of the current depth is no longer divided.
  • Information can be obtained from the bitstream.
  • the above-described embodiment is an example for explaining that a method of obtaining information indicating whether a transform unit includes a non-zero transform coefficient may be different for each luminance component or chrominance component. It is to be understood that a method of obtaining information indicating whether a including transform unit includes a non-zero transform coefficient may be implemented according to a combination of various embodiments.
  • FIG. 8 is a diagram for describing a process of obtaining information indicating whether a transform unit other than zero is included in a transform unit of a current depth in a process of determining at least one transform unit included in a current coding unit, according to an embodiment. Drawing.
  • the decoder 120 may determine at least one transformation unit included in the current coding unit 800. 3A, 3B, and 4A through 4C for determining the conversion unit, detailed description thereof will be omitted. Referring to FIG. 8, the decoder 120 may perform a division process 802 of at least one transformation unit included in the current coding unit 800. The decoder 120 may determine a block having the same size as the current coding unit 800 as a transformation unit of the current depth, and then divide the transformation unit of the current depth. According to an embodiment, the blocks determined by dividing the transform unit of the current depth into smaller sizes may be blocks of a lower depth than the current depth of the transform unit before splitting.
  • the depth of the blocks determined by dividing the transformation unit of the current depth into a smaller size is also determined by the current depth. May be the same as
  • the decoder 120 may decode the image using the transform unit of the current depth.
  • the decoder 120 determines a block 810 having the same size as the current coding unit 800 as a transformation unit or splits a block 810 having the same size as the current coding unit 800 according to an embodiment.
  • the decoder 120 may decode the image using the transformation unit of the current depth.
  • the decoder 120 may further divide the transform unit of the current depth, which may be a recursive partitioning process.
  • the decoder 120 may perform a partitioning process on the non-square transform unit 812a. Since the partitioning process has been described above with reference to FIGS. 4A, 4B, and 4C, a detailed description thereof will be omitted.
  • the bitstream obtainer 110 converts information indicating whether a transform coefficient other than zero is included in a transform unit of a current depth determined in a splitting process to determine at least one transform unit. Can be obtained per unit.
  • the decoder 120 may recursively divide a block having the same size as the current coding unit 800 to determine at least one transformation unit included in the current coding unit 800. have. For example, while the decoder 120 determines one of the at least one transformation unit 824a included in the current coding unit 800, the bitstream obtainer 110 is the same as the current coding unit 800.
  • the bitstream obtainer 110 may obtain information indicating whether a non-zero transform coefficient is included in at least one transform unit included in the current coding unit for at least one transform unit.
  • the decoder 120 recursively transforms a transform unit of a current depth having the same size as the current coding unit 800 to determine at least one transform unit included in the current coding unit 800. Can be divided into
  • the bitstream obtainer 110 may obtain information indicating whether a transform coefficient other than 0 is included in a transform unit that is no longer divided from the bitstream. For example, while the decoder 120 determines one of the at least one transformation unit 824a included in the current coding unit 800, the bitstream obtainer 110 is the same as the current coding unit 800.
  • bitstream obtainer 110 determines that the transform unit 824a is no longer divided, information indicating whether a transform coefficient other than zero is included in the transform unit 824a during decoding of the transform unit 824a. Can be obtained from the bitstream.
  • FIG. 8 is merely a mere embodiment used for convenience of description, and the shape of the current coding unit may represent not only a square shape but also a non-square shape, and the process of determining the transform unit is also illustrated in FIG. 8. It should not be construed as limited to the process shown in.
  • the image decoding apparatus 100 may determine whether a block shape of a current coding unit, a luminance component or a chrominance component of an image is related to the current coding unit, a prediction mode used in the current coding unit, and a conversion unit included in the current coding unit. Based on at least one of the numbers, a method of obtaining information from a bitstream that indicates whether a transform coefficient other than zero is included in a transform unit of a current depth may be differently determined.
  • the image decoding apparatus 100 may differently determine a method of obtaining information indicating whether a non-zero transform coefficient is included in the current block from the bitstream based on the shape of the coding unit.
  • the bitstream obtainer 110 may provide information indicating whether each transformation unit determined in a splitting process for determining at least one transformation unit includes a non-zero transform coefficient and a transformation unit of the current depth. Can be obtained every time.
  • the bitstream obtainer 110 may obtain information indicating whether a non-zero transform coefficient is included in the transform unit of the current depth only when the transform unit of the current depth is not divided.
  • the image decoding apparatus 100 may determine at least one transform unit included in a coding unit having a square shape or a non-square shape.
  • the decoder 120 may determine at least one transform unit included in the current coding unit through a recursive division process of the transform unit.
  • the bitstream obtainer 110 for each transformation unit of the current depth used in the splitting process of the transformation unit for determining at least one transformation unit Information indicating whether a non-zero transform coefficient is included can be obtained.
  • the image decoding apparatus 100 determines whether a non-zero transform coefficient is included in a current block based on whether a block shape of a coding unit, a luminance component of a video, or a chrominance component is related to a current coding unit.
  • the method of obtaining the information indicating from the bitstream may be differently determined.
  • the bitstream obtainer 110 may determine a transform to determine at least one transformation unit. For each transformation unit of the current depth used in the division process of the unit, information indicating whether a non-zero transformation coefficient is included may be generated.
  • the image decoding apparatus 100 may obtain information indicating whether a non-zero transform coefficient is included in a current block from a bitstream based on a block shape of a coding unit and a prediction mode used in the current coding unit. Can be determined differently.
  • the bitstream obtainer 110 may determine the at least one transformation unit. For each transformation unit of the current depth used in the partitioning process, information indicating whether a non-zero transform coefficient is included may be generated.
  • the image decoding apparatus 100 may determine a method of obtaining information indicating whether a transformation unit includes a non-zero transform coefficient based on a form of a transformation unit of the current depth. For example, when the transform unit of the current depth is square, the bitstream obtainer 110 uses a method for obtaining information indicating whether a non-zero transform coefficient is included. Different conversion units for the unit and the color difference component may be used. In contrast, when the transform unit of the current depth is a non-square form, the bitstream obtainer 110 may include information indicating whether a transform unit other than zero is included in the transform unit for the luminance component and the transform unit for the chrominance component. In the same method (for example, information is obtained for each transformation unit of the current depth used in the division process or information is acquired only when the transformation unit of the current depth is no longer divided). Can be used).
  • the method for the image decoding apparatus 100 to obtain information indicating whether a non-zero transform coefficient is included in the current block based on a combination of the various conditions described above is a block for determining at least one transform unit. It should not be interpreted to be limited to what is obtained for each division process, and may be used in various ways for each combination of conditions. That is, a method of obtaining information indicating whether a non-zero transform coefficient is included in each division unit of the current depth by dividing the case based on a combination of various conditions described above, or the current depth only when the current transformation unit is no longer divided. A method of acquiring information indicating whether a transform unit of U includes non-zero transform coefficients may be used.
  • the decoder 120 may determine at least one transformation unit based on at least one of the shape and size of the current coding unit. For example, when the current coding unit is a non-square form, the decoder 120 may determine a transform unit having the same form as the current coding unit without performing a splitting process for determining the transform unit. According to an embodiment, when the current coding unit is in a non-square form and a transform unit having the same form as the current coding unit cannot be used, the decoder 120 may divide the transform unit into a plurality of transform units having a minimum size or more. have.
  • the decoder 120 may not determine that two 4x4 transform units are included when the current coding unit is a non-square form having 4x8 or 8x4. Can be. In this case, the decoder 120 may determine a transform unit having a non-square shape of 4x8 or 8x4 having the same size as the current coding unit.
  • the decoder 120 may determine the depth of the transform unit based on the length of the long side of the transform unit. That is, even when the transform unit 120 divides the transform unit of the current depth, when the length of the long side of the divided block is the same as the long side of the transform unit of the current depth (for example, the transform unit having a square shape is vertical or horizontal). In case of dividing only, the depth of the divided block may be determined to be equal to the current depth.
  • the image decoding apparatus 100 may obtain at least one syntax related to the transformation unit from the bitstream based on the form of the transformation unit of the current depth.
  • the decoder 120 may decode the residual signal based on at least one transformation unit included in the current coding unit.
  • the bitstream obtainer 110 may acquire from the bitstream based on at least one transformation unit that determines the information related to the residual signal, and the decoder 120 decodes the information using the acquired residual signal. Can be performed.
  • the bitstream obtainer 110 may obtain an empty string for the residual signal from the bitstream in one of at least one transformation unit.
  • the decoder 120 may decode the syntax by using an empty string, and in this decoding process, the decoder 120 may use various context information.
  • Such context information may include various information used in the CABAC decoding process.
  • the context information may indicate a context index used to determine a syntax corresponding to the empty string.
  • the decoder 120 may determine a value corresponding to the context index as an initial value by using the context table, and perform CABAC decryption using the determined initial value.
  • the decoder 120 may consider various information in order to determine context information.
  • the decoder 120 may consider the form of a transformation unit of the current depth in order to determine the context information. That is, context information used for CABAC may vary according to the type of transformation unit.
  • the decoder 120 may determine one of syntax types, a depth of a coding unit including a transformation unit of a current depth, syntax of a neighboring block, a size of a transformation unit, and a transformation unit to determine context information.
  • the context information may be determined using at least one.
  • the decoder 120 may determine context information based on a form of a transformation unit, and the context information may indicate a context index used to determine a syntax corresponding to an empty string, and such context
  • the index may be determined using a context index offset (ctxIdxOffset) and a value added to the context index offset (eg, ctxInc). That is, the decoder 120 may determine the context index ctxIndx by adding ctxIdxOffset and ctxInc.
  • the context index offset ctxIdxOffset may be defined as a minimum value of the context index ctxIdx that may be determined on the context table ctxTable based on an initial type used in the initialization procedure of the syntax.
  • the decoder 120 may use at least one of a syntax type, a depth of a coding unit including a transformation unit of a current depth, syntax of a neighboring block, a size of a transformation unit, and a transformation unit to determine ctxInc.
  • the determined ctxInc may be added to ctxIdxOffset to determine a context index (ctxIdx).
  • the decoder 120 may determine context information based on a form of a transformation unit for each syntax that may be used in the CABAC decoding process of the residual signal.
  • FIG. 2 is a block diagram of an image encoding apparatus that encodes an image based on a transformation unit included in a coding unit that divides an image, according to an exemplary embodiment.
  • the image encoding apparatus 200 may include predetermined information such as an encoder 220 and block shape information for encoding an image, or information including syntax and information about an encoded image. It may include a bitstream generator 210 for generating a stream. According to an embodiment, the encoder 220 of the image encoding apparatus 200 may determine at least one coding unit for dividing an image, and the bitstream generator 210 may block at least one coding unit. A bitstream including shape information may be generated. Furthermore, the encoder 220 of the image encoding apparatus 200 may determine at least one transformation unit included in the current coding unit based on the shape of the current coding unit which is one of the at least one coding unit. . According to an embodiment, the block shape information may be information or syntax indicating whether the current coding unit is square or non-square.
  • the split information of the transformation unit indicates that the current transformation unit is divided into a plurality of transformation units, and when the current coding unit is in a square form, the encoder 220 includes a plurality of squares included in the current coding unit.
  • the conversion unit can be determined.
  • the encoder 220 may set the current coding unit in the vertical direction or the horizontal direction.
  • a plurality of transformation units may be determined by dividing by.
  • 3A illustrates various types of transformation units that may be determined by a current coding unit having a square shape according to an embodiment.
  • the encoder 220 of the image encoding apparatus 200 may determine at least one coding unit including the current coding unit 300.
  • the determined coding unit may have a square shape or a non-square shape.
  • the encoder 220 may determine a shape of a transform unit that may be included in the current coding unit 300 based on the shape of the current coding unit 300 according to an embodiment. For example, if the current coding unit 300 is a block having a square shape having a size of 2N ⁇ 2N, the encoder 220 is a transformation unit having a 2N ⁇ 2N size as a form of at least one transformation unit included in the current coding unit 300. In operation 310a, a transformation unit 310b having an N ⁇ 2N size or a transformation unit 310c having a 2N ⁇ N size may be determined.
  • the encoder 220 of the image encoding apparatus 200 may determine at least one coding unit including the current coding unit 350.
  • the encoder 220 may determine a shape of a transform unit that may be included in the current coding unit 350 based on the shape of the current coding unit 350 having a square shape. For example, if the current coding unit 350 is a block having a square shape having a size of 2N ⁇ 2N, the encoder 220 is a type having at least one transform unit included in the current coding unit 300 and has one size of 2N ⁇ 2N.
  • the transformation unit 360a may be determined, or four transformation units 370b having an N ⁇ N size may be determined.
  • various embodiments including FIGS. 3A and 3B may be used in a method in which the encoder 220 determines at least one transformation unit included in a square coding unit, and a transform that may be determined
  • the unit form may include various forms in which the embodiments are combined.
  • the encoder 220 may determine at least one transformation unit included in the current coding unit based on the form of the current coding unit. For example, a plurality of transformation units included in the current coding unit may be determined based on whether the current coding unit is a square form or a non-square shape.
  • 4A, 4B, and 4C illustrate various types of transformation units that may be determined in a current coding unit having a non-square shape according to an embodiment.
  • the encoder 220 may determine at least one transform unit included in the current coding unit 400a having a non-square shape having a height greater than a width according to an embodiment.
  • the encoder 220 may determine at least one transform unit included in the current coding unit 400b having a non-square shape having a height greater than a width according to an embodiment.
  • the encoder 220 may determine at least one transform unit included in the current coding unit 400c having a non-square shape having a height greater than a width according to an embodiment. Since the operation of the encoder 220 may correspond to an operation similar to the operation of the decoder 120 described above, a detailed description thereof will be omitted.
  • the encoder 220 may determine a plurality of transform units included in the current coding unit by comparing the size of the current coding unit and the maximum size of the transform unit.
  • FIG. 5 illustrates a process of determining a plurality of transformation units included in a current coding unit based on a result of comparing a size of a current coding unit with a maximum size of a transformation unit, according to an embodiment.
  • the encoder 220 may determine at least one transform unit included in the current coding unit 500, and a maximum size of the transform unit may be predetermined. According to an embodiment, the encoder 220 may compare the current coding unit 500 with a transformation unit 510 having a predetermined maximum size. As a result of the comparison, when the size of the current coding unit 500 is greater than the maximum size of the transformation unit, the encoder 220 may determine the plurality of change units 520 having the maximum size included in the current coding unit 500. have. Referring to FIG. 5, when the size of the current coding unit 500 is 2N ⁇ 2N and the maximum size of the transform unit 510 is N ⁇ N, the encoder 220 may perform at least one transform included in the current coding unit 500.
  • the unit may be divided into a transform unit 520 of the largest size included in the current coding unit 500. That is, the encoder 220 determines a plurality of maximum transform units included in the current coding unit to determine at least one transform unit included in the current coding unit that is larger than the transform unit of the maximum size, and then the maximum size. It may be determined whether to divide each transform unit of into smaller transform units.
  • the bitstream generator 210 may generate a bitstream including information on the maximum size of the transform unit.
  • the information on the maximum size of the transformation unit may be an integer directly indicating the maximum size of the transformation unit, or may be an index related to the maximum size.
  • the encoder 220 may determine at least one transform unit included in the current coding unit based on a block shape that the transform unit may have.
  • the bitstream generator 210 may generate a bitstream including information about a block type that a transformation unit may have.
  • the block unit that a transformation unit may have may vary.
  • a predetermined data unit eg, picture or slice
  • a slice segment, a tile, a maximum coding unit, a coding unit, etc. must generate a bitstream including information or syntax capable of representing all types of transformation units.
  • a combination of forms that a transformation unit may have may vary for each data unit (for example, a picture, a slice, a slice segment, a tile, a maximum coding unit, and a coding unit).
  • the bitstream generator 110 may generate a bitstream including information about a block type that a transformation unit may have for each predetermined data unit.
  • the image decoding apparatus 100 having such information may differently determine a combination of block types that a transformation unit may have for each predetermined data unit based on information on a block form that the transformation unit may have.
  • FIG. 6 is a diagram for describing a feature in which a combination of forms that a transformation unit may have may vary for each predetermined data unit, according to an exemplary embodiment.
  • the encoder 220 may determine at least one transform unit in a predetermined data unit (for example, maximum coding units 600, 610, 620, and 630), and the bitstream generator 110 may determine A bitstream including information on a block type that a transformation unit may have may be generated for each of the maximum coding units 600, 610, 620, and 630 which are predetermined data units.
  • a predetermined data unit for example, maximum coding units 600, 610, 620, and 630
  • a bitstream including information on a block type that a transformation unit may have may be generated for each of the maximum coding units 600, 610, 620, and 630 which are predetermined data units.
  • the bitstream generator 210 associates a bitstream including information indicating a combination including a form of a transform unit illustrated in FIG. 4A with a maximum coding unit 600. Can be generated. That is, the encoder 220 may use the types of transformation units described above with reference to FIG. 4A to determine at least one transformation unit included in one of at least one coding unit included in the maximum coding unit 600. In this case, the bitstream generator 210 may generate a bitstream including information indicating a combination including the form of the transform unit illustrated in FIG. 4A in relation to the maximum coding unit 600.
  • the bitstream generator 210 associates a bitstream including information indicating a combination including a form of a transform unit illustrated in FIG. 4B with a maximum coding unit 610. Can be generated. That is, the encoder 220 may use the types of transformation units described above with reference to FIG. 4B to determine at least one transformation unit included in one of at least one coding unit included in the maximum coding unit 610. In this case, the bitstream generator 210 may generate a bitstream including information indicating that the types of the transformation units of FIG. 4B may be used in the maximum coding unit 610.
  • the bitstream generator 210 associates a bitstream including information indicating a combination including a form of a transform unit illustrated in FIG. 4C with the maximum coding unit 620. Can be generated. That is, the encoder 220 may use the types of transformation units described above with reference to FIG. 4C to determine at least one transformation unit included in one of at least one coding unit included in the maximum coding unit 620. In this case, the bitstream generator 210 may generate a bitstream including information indicating that the shapes of the transformation units of FIG. 4C may be used in the maximum coding unit 620.
  • the bitstream generator 210 generates a bitstream including information indicating a combination including a form of a transform unit illustrated in FIG. 3A in relation to a maximum coding unit 600, 610, or 620. can do. That is, the encoder 220 forms the transform unit described above with reference to FIG. 3A to determine at least one transform unit included in one of at least one coding unit included in the maximum coding unit 600, 610, or 620. In this case, the bitstream generator 210 may generate a bitstream including information indicating that the maximum coding units 600, 610, or 620 may use the types of the transformation units of FIG. 3A. . Combinations of types of transform units in which a square transform unit may be divided and determined may not be construed as being limited to the forms shown in FIG. 3A, and may include combinations including only some of the forms shown in FIG. 3A. .
  • the bitstream generator 210 may generate a bitstream including at least one of information indicating the shape of a transformation unit used by the encoder 220 to determine a transformation unit and information indicating the size of the transformation unit. Can be generated for each predetermined data unit.
  • the image encoding apparatus 200 may include a sequence parameter set, a picture parameter set, a video parameter set, a slice header, and a slice segment header. At least one of information indicating a type of a transformation unit and information indicating a size of a transformation unit may be generated in a segment header.
  • bitstream generator 210 may generate a bitstream including at least one of information indicating a shape of a transform unit and information indicating a size of a transform unit for each maximum coding unit, reference coding unit, and processing block. .
  • information indicating a shape of a transform unit and information indicating a size of a transform unit for each maximum coding unit, reference coding unit, and processing block.
  • the encoder 220 may determine at least one transform unit using the maximum size and the minimum size of the transform unit.
  • the bitstream generator 210 may generate a bitstream including at least one of information on the maximum size and information on the minimum size of the transform unit.
  • at least one of a maximum size and a minimum size that a transformation unit may have may be predetermined, and accordingly, at least one of information on the maximum size of the transformation unit and information on the minimum size of the transformation unit may be determined.
  • the bitstream may be generated from the bitstream through the bitstream generator 210.
  • the information on the maximum size of the transform unit and the information on the minimum size of the transform unit may be generated for each predetermined data unit (sequence, picture, slice, slice segment, tile, maximum coding unit, coding unit, etc.).
  • the encoder 220 may determine the maximum size and the minimum size of the transform unit for each sequence, and the bitstream generator 210 may provide information about the maximum size of the transform unit and information about the minimum size of the transform unit.
  • a bitstream including at least one of the plurality of bits may be generated for each sequence including a plurality of pictures.
  • the information on the maximum size of the transformation unit and the information on the minimum size of the transformation unit may be information indicating the length of one side of the transformation unit of the square form or the length of the long side of the non-square form. It may be an index indicating the size of a block.
  • the information indicating the length of the sides of the transformation unit may be the number of samples or a logarithm of the number of samples.
  • the bitstream generator 210 may provide information indicating a difference between the maximum size and the minimum size of the bitstream and the transformation unit including information about the maximum size of the transformation unit or information on the minimum size of the transformation unit. It may generate a bitstream including.
  • the image decoding apparatus 100 capable of acquiring such information from the bitstream includes information indicating a difference between the maximum size and the minimum size of the transformation unit and one of the information about the maximum size of the transformation unit or the minimum size of the transformation unit.
  • the maximum size or the minimum size of the transformation unit can be determined using. Since the description of the image decoding apparatus 100 using information on the maximum size of the transform unit or information on the minimum size of the transform unit obtained from the bitstream has been described above with reference to various embodiments, a detailed description thereof will be omitted.
  • the encoder 220 may determine, for each component, a transformation unit for performing inverse transformation of a luma component and a chroma component of an image. According to an embodiment, the encoder 220 may differently set the minimum size of the transform unit for the luminance component of the image and the minimum size of the transform unit for the chrominance component. For example, the encoder 220 may determine the minimum size of the transform unit for the luminance component as 4x4 and the minimum size of the transform unit for the chrominance component to 4x2 or 2x4.
  • the encoder 220 may determine the minimum size that the transformation unit may have by dividing the luminance component and the chrominance component in consideration of the relationship or ratio between the luminance component and the chrominance component used according to a method of decoding an image. . According to an embodiment, the encoder 220 may set the minimum size of the transform unit for the luminance component of the image and the minimum size of the transform unit for the chrominance component differently and set the maximum size to be the same.
  • FIG. 7 illustrates a conversion unit having a minimum size that can be determined for each luminance component and a chrominance component according to an embodiment.
  • the encoder 220 may determine at least one transformation unit included in the current coding unit 700 for the luminance component of the image, and include it in the current coding unit 710 for the color difference component of the image. At least one transformation unit may be determined. According to an embodiment, the encoder 220 may differently set the minimum size of the transform unit for the luminance component and the minimum size of the transform unit for the chrominance component. For example, the encoder 220 may determine the minimum size of the transform unit for the luminance component as 4x4 and the minimum size of the transform unit for the chrominance component to 4x2 or 2x4.
  • the encoder 220 when the size of the current coding unit 700 for the luminance component is 8x8, the encoder 220 is at least one transform unit included in the current coding unit 700 for the luminance component and has a size of 4x4 or more. At least one transformation unit having may be determined. Referring to FIG. 7, the encoder 220 may determine four transform units included in the current coding unit 710 having a size of 8 ⁇ 8, and in this case, the transform units may have a size of 4 ⁇ 4 having a minimum size.
  • the encoder 220 may determine a coding unit 710 for a color difference component associated with a luminance component of the current coding unit 700. According to an embodiment, when the size of the current coding unit 700 for the luminance component is 2N ⁇ 2N, the encoder 220 may determine that the size of the coding unit 710 for the color difference component associated with the luminance component is N ⁇ N. Referring to FIG. 7, when the size of the current coding unit 700 for the luminance component is 8 ⁇ 8, the size of the current coding unit 710 for the color difference component may be determined to be 4 ⁇ 4.
  • the size of the transform unit for the chrominance component may be a size obtained by dividing the transform unit for the luminance component in at least one of a vertical direction and a horizontal direction. That is, the transformation unit for the color difference component may have a smaller size than the transformation unit for the luminance component.
  • the minimum size of the transform unit for each of the luminance component and the color difference component may be different.
  • the encoder 220 may determine at least one transform unit included in the current coding unit 710 for the color difference component in consideration of the minimum size of the transform unit.
  • the encoder 220 may have a size obtained by dividing the transform unit for the chrominance component into a vertical direction and a horizontal direction. However, when the size obtained by dividing the transform unit for the luminance component in the vertical direction and the horizontal direction is smaller than the minimum size of the transform unit for the color difference component, the encoder 220 considers the minimum size of the transform unit for the color difference component to determine the color difference. The unit of conversion for the component can be determined.
  • the encoder 220 may apply to the color difference component having the minimum size.
  • the conversion unit can be determined.
  • the encoder 220 when the size obtained by dividing the transform unit for the luminance component in the vertical direction and the horizontal direction is smaller than the minimum size of the transform unit for the chrominance component, the encoder 220 converts the transform unit for the luminance component into the vertical direction. And merging transformation units having a size divided in a horizontal direction, to determine a transformation unit having a size equal to or greater than a minimum size of the transformation unit for the color difference component.
  • the encoder 220 may use the size of the transform unit for the luminance component as the size of the transform unit for the chrominance component without dividing the transform unit for the luminance component in the vertical direction and the horizontal direction.
  • the encoder 220 may apply to the chrominance component.
  • the transformation units split into the minimum size of the transformation unit may be merged. For example, by comparing the minimum size of four 2x2 transform units determined by dividing a transform unit for a luminance component having a 4x4 size and a transform unit for a chrominance component, merging four 4x2 transform units. At least one transform unit for the chrominance component having the smallest size may be determined.
  • the encoder 220 may determine at least one transformation unit (eg, 730, 750, 760, 770) included in the coding unit 710 for the color difference component.
  • the encoder 220 may determine a transform unit for the color difference component in consideration of the minimum size of the transform unit, and the minimum size of the transform unit may vary according to the luminance component and the color difference component.
  • the encoder 220 converts the transform unit 730 having NxN size, the transform unit 750 having 2Nx2N size, and the transform having 2NxN or Nx2N size.
  • Unit 760 or 770 may be determined.
  • the encoder 220 may determine the transform unit in consideration of the minimum size of the transform unit for the color difference component. For example, when the minimum size of the transform unit for the color difference component is 4x2 or 2x4, the encoder 220 determines four transform units 730 having a 2x2 size in the current coding unit 710 having a 4x4 size. There is no number. In this case, the encoder 220 may determine a transform unit 760 having a 2 ⁇ 4 size or determine a transform unit 770 having a 4 ⁇ 2 size by merging the transform units 730 having a 2 ⁇ 2 size. As another example, the encoder 220 skips the process of determining four transform units 730 having a 2x2 size, and includes at least one transform unit having a minimum size in the current coding unit 710. It can also be determined as a conversion unit.
  • the encoder 220 may omit the encoding process of the residual signal for the transform unit of the current depth.
  • the bitstream generator 210 may generate a bitstream including information indicating whether a non-zero transform coefficient is included in a transform unit of a current depth for each luminance component and a chrominance component associated with a current coding unit. Can be. That is, the bitstream generator 210 includes information indicating whether or not a non-zero transform coefficient is included in the transform unit of the current depth for the luminance component and a non-zero transform coefficient in the transform unit of the current depth for the chrominance component. It may generate a bitstream including at least one of the information indicating whether or not.
  • the bitstream generator 210 may determine the current unit for the luminance component when the transformation unit of the current depth is no longer split in the division process for determining at least one transformation unit included in the current coding unit. Generate a bitstream comprising at least one of information indicating whether a transform unit of depth includes a non-zero transform coefficient and information indicating whether a transform unit of a current depth for a color difference component includes a non-zero transform coefficient can do.
  • the image encoding apparatus 200 may generate a bitstream including information indicating whether a non-zero transform coefficient is included in a transform unit of a current depth for each luminance component and chrominance component.
  • the image encoding apparatus 200 may use a transform unit for a luminance component and a transform unit for a chrominance component differently. Can be.
  • the bitstream generator 120 may include a bitstream including information indicating whether a transform coefficient other than zero is included in a transform unit of a current depth of a chrominance component, and a current depth used in the partitioning process of the transform unit.
  • the bitstream obtainer 110 indicates whether a transform coefficient other than zero is included in the transform unit of the current depth for the luminance component only when the transform unit of the current depth is no longer divided.
  • a bitstream including information may be generated.
  • the above-described embodiment is an example for explaining that a method of generating a bitstream including information indicating whether a transform unit includes a non-zero transform coefficient may be different for each luminance component or chrominance component, and thus luminance. It should be construed that a method for generating a bitstream including information indicating whether a transform unit including a component or a chrominance component includes a non-zero transform coefficient may be implemented according to a combination of the various embodiments described above. .
  • FIG. 8 illustrates a process of generating information indicating whether a transform coefficient other than 0 is included in a transform unit of a current depth in a process of determining at least one transform unit included in a current coding unit, according to an embodiment.
  • the image encoding apparatus 200 determines whether a block shape of a current coding unit, a luminance component or a chrominance component of an image is related to the current coding unit, a prediction mode used in the current coding unit, and a conversion unit included in the current coding unit. Based on at least one of the numbers, a method of generating information indicating whether a transform coefficient other than zero is included in the transform unit of the current depth may be differently determined.
  • the image encoding apparatus 200 may differently determine a method of generating information indicating whether a non-zero transform coefficient is included in a current block based on the shape of a coding unit.
  • the bitstream generator 210 may provide information indicating whether each transformation unit determined in a splitting process for determining at least one transformation unit includes a non-zero transform coefficient and a transformation unit of the current depth. It can be generated every time. Furthermore, the bitstream generator 210 may generate information indicating whether a non-zero transform coefficient is included in the transform unit of the current depth only when the transform unit of the current depth is not divided.
  • the image encoding apparatus 200 may determine at least one transform unit included in a coding unit having a square shape or a non-square shape.
  • the encoder 220 may determine at least one transform unit included in the current coding unit through a recursive division process of the transform unit.
  • the bitstream generator 210 for each transformation unit of the current depth used in the splitting process of the transformation unit for determining at least one transformation unit Information indicating whether a non-zero transform coefficient is included may be generated.
  • the image encoding apparatus 200 determines whether a current block includes a non-zero transform coefficient based on whether a block shape of a coding unit, a luminance component of a video, or a chrominance component is related to a current coding unit.
  • the way of generating the information that is represented can be determined differently.
  • the bitstream generator 210 may determine at least one transformation unit. For each conversion unit of the current depth used in the division process of the unit, information indicating whether a non-zero transform coefficient is included may be generated.
  • the image encoding apparatus 200 obtains a bitstream including information indicating whether a non-zero transform coefficient is included in a current block based on a block shape of a coding unit and a prediction mode used in the current coding unit. You can decide how to do it differently.
  • the bitstream generator 210 may determine at least one transformation unit. Information indicating whether a non-zero transform coefficient is included in each transform unit of the current depth used in the partitioning process may be generated.
  • the image encoding apparatus 200 may determine a method of generating a bitstream including information indicating whether a transformation unit includes non-zero transform coefficients based on a shape of a transformation unit of a current depth. .
  • the bitstream generator 210 generates a bitstream including information indicating whether a non-zero transform coefficient is included, thereby transforming the luminance component.
  • Different methods may be used for each conversion unit for the unit and the color difference component.
  • the bitstream obtainer 110 may include information indicating whether a transform unit other than zero is included in the transform unit for the luminance component and the transform unit for the chrominance component.
  • the same method eg, information is obtained for each transformation unit of the current depth used in the segmentation process or information is acquired only when the transformation unit of the current depth is no longer divided.
  • the method in which the image encoding apparatus 200 generates information indicating whether a non-zero transform coefficient is included in the current block based on the combination of the various conditions described above is a transformation of the current depth for determining at least one transform unit. It should not be interpreted to be limited to generating a bitstream for each unit, and may be variously used for each combination of conditions. That is, a method of obtaining information indicating whether a non-zero transform coefficient is included in each division unit of the current depth by dividing the case based on a combination of various conditions described above, or the current depth only when the current transformation unit is no longer divided. A method of generating information indicating whether a transform unit of includes non-zero transform coefficients may be used.
  • the encoder 220 may determine at least one transformation unit based on at least one of the shape and size of the current coding unit. For example, when the current coding unit is a non-square shape, the encoder 220 may determine a transform unit having the same shape as the current coding unit without performing a splitting process for determining the transform unit. According to an embodiment, when the current coding unit is in a non-square form and a transform unit having the same form as the current coding unit cannot be used, the encoder 220 may split the transform unit into a plurality of transform units having a minimum size or more. have.
  • the encoder 220 may not determine that two 4x4 transform units are included when the current coding unit is a non-square form having 4x8 or 8x4. Can be. In this case, the encoder 220 may determine a transform unit having a non-square shape of 4x8 or 8x4 having the same size as the current coding unit.
  • the encoder 220 may determine the depth of the transform unit based on the length of the long side of the transform unit. That is, even if the length of the long side of the divided block is the same as the long side of the transformation unit of the current depth even if the transformation unit of the current depth is divided (for example, the transformation unit of the square shape is vertical or horizontal direction). In case of dividing only, the depth of the divided block may be determined to be equal to the current depth.
  • the image encoding apparatus 200 may generate a bitstream including at least one syntax associated with a transformation unit, based on the form of the transformation unit of the current depth.
  • the encoder 220 may encode the residual signal based on at least one transformation unit included in the current coding unit.
  • the bitstream generator 110 may generate a bitstream including information related to the residual signal based on at least one conversion unit.
  • the bitstream generator 210 may generate a bitstream including an empty string indicating syntax used in an encoding process.
  • the encoder 220 may use various context information in the encoding process, and the context information may correspond to various information used in the CABAC decoding process.
  • the context information may indicate a context index used to determine a syntax corresponding to the empty string.
  • the encoder 120 may determine a value corresponding to the context index as an initial value by using the context table, and perform CABAC encoding using the determined initial value.
  • the encoder 220 may consider various information in order to determine context information.
  • the encoder 220 may consider the form of a transformation unit of the current depth in order to determine the context information. That is, context information used for CABAC may vary according to the type of transformation unit.
  • the encoder 220 in order to determine context information, may include a syntax type, a depth of a coding unit including a transformation unit of a current depth, syntax of a neighboring block, a size of a transformation unit, and a form of a transformation unit.
  • the context information may be determined using at least one.
  • the encoder 220 may determine context information based on a form of a transformation unit, and the context information may indicate a context index used to determine a syntax corresponding to an empty string.
  • the index may be determined using a context index offset (ctxIdxOffset) and a value added to the context index offset (eg, ctxInc). That is, the encoder 220 may determine the context index (ctxIndx) by adding ctxIdxOffset and ctxInc.
  • the context index offset ctxIdxOffset may be defined as a minimum value of the context index ctxIdx that may be determined on the context table ctxTable based on an initial type used in the initialization procedure of the syntax. .
  • the encoder 220 may use at least one of a syntax type, a depth of a coding unit including a transformation unit of a current depth, syntax of a neighboring block, a size of a transformation unit, and a transformation unit to determine ctxInc.
  • the determined ctxInc may be added to ctxIdxOffset to determine a context index (ctxIdx).
  • the encoder 220 may determine context information based on a form of a transformation unit for each syntax that may be used in the CABAC encoding process of the residual signal.
  • the bitstream obtainer 110 may obtain information for obtaining predetermined information such as partition type information and block shape information from the bitstream, and the decoder 120 may use the obtained information.
  • Video can be decoded.
  • the decoder 120 of the image decoding device 100 is a block type. At least one coding unit for dividing an image may be determined based on at least one of the information and the split type information.
  • the decoder 120 of the image decoding apparatus 100 may determine a shape of a coding unit based on block shape information.
  • the block shape information may include information indicating whether a coding unit is square or non-square.
  • the decoder 120 may determine a shape of a coding unit by using block shape information.
  • the decoder 120 may determine which type of coding unit is divided based on the split type information.
  • the split type information may indicate information about the type of at least one coding unit included in the coding unit.
  • the decoder 120 may determine whether a coding unit is divided or not divided according to split type information.
  • the split type information may include information about at least one coding unit included in a coding unit, and if the split type information indicates that only one coding unit is included in the coding unit or not, The decoder 120 may determine that the coding unit including the split type information is not split.
  • the decoder 120 may split the plurality of coding units included in the coding unit based on the split type information.
  • the split type information may indicate how many coding units are divided or in which direction.
  • the split type information may indicate splitting in at least one of a vertical direction and a horizontal direction or may not split.
  • FIG. 9 illustrates a process of determining, by the image decoding apparatus 100, at least one coding unit by dividing a current coding unit according to an embodiment.
  • the decoder 120 may determine the shape of a coding unit by using block shape information, and may determine in which form the coding unit is divided using the split shape information. That is, the method of dividing the coding unit represented by the split type information may be determined according to which block type the block type information used by the decoder 120 indicates.
  • the decoder 120 may use block shape information indicating that the current coding unit is square. For example, the decoder 120 may determine whether to split a square coding unit, split vertically, split horizontally, or split into four coding units according to split type information. Referring to FIG. 9, when the block shape information of the current coding unit 900 indicates a square shape, the decoder 120 may have the same size as the current coding unit 900 according to the split shape information indicating that the block shape information is not divided. The divided coding units 910b, 910c, 910d, and the like may be determined based on split type information indicating a predetermined division method.
  • the decoder 120 may determine two coding units 910b that divide the current coding unit 900 in the vertical direction based on split type information indicating that the split is performed in the vertical direction. have.
  • the decoder 120 may determine two coding units 910c obtained by dividing the current coding unit 900 in the horizontal direction, based on the split type information indicating the split in the horizontal direction.
  • the decoder 120 may determine four coding units 910d obtained by dividing the current coding unit 900 in the vertical direction and the horizontal direction, based on the split type information indicating the division in the vertical direction and the horizontal direction.
  • the divided form in which the square coding unit may be divided should not be limited to the above-described form and may include various forms represented by the divided form information. Certain division forms in which a square coding unit is divided will be described in detail with reference to various embodiments below.
  • FIG. 10 illustrates a process of determining, by the image decoding apparatus 100, at least one coding unit by dividing a coding unit having a non-square shape according to an embodiment.
  • the decoder 120 may use block shape information indicating that the current coding unit is a non-square shape.
  • the decoder 120 may determine whether to divide the current coding unit of the non-square according to the split type information or to split it by a predetermined method. Referring to FIG. 10, when the block shape information of the current coding unit 1000 or 1050 indicates a non-square shape, the decoder 120 may determine that the current coding unit 1000 or Coding units 1010 or 1060 having the same size as 1050, or are divided based on division type information indicating a predetermined division method 1020a, 1020b, 1030a, 1030b, 1030c, 1070a, 1070b , 1080a, 1080b, 1080c).
  • a predetermined division method in which a non-square coding unit is divided will be described in detail with reference to various embodiments below.
  • the decoder 120 may determine a shape in which a coding unit is divided using split shape information, and in this case, the split shape information may indicate the number of at least one coding unit generated by splitting the coding unit. Can be.
  • the decoder 120 may select the current coding unit 1000 or 1050 based on the split form information. Two coding units 1020a and 1020b or 1070a and 1070b included in the current coding unit may be determined by being divided.
  • the decoder 120 divides the current coding unit 1000 or 1050 of the non-square form based on the split form information
  • the length of the current coding unit 1000 or 1050 of the non-square form is long.
  • the current coding unit may be split in consideration of the position of the side. For example, the decoder 120 divides the current coding unit 1000 or 1050 in a direction of dividing a long side of the current coding unit 1000 or 1050 in consideration of the shape of the current coding unit 1000 or 1050.
  • a plurality of coding units may be determined.
  • the decoder 120 may determine an odd number of coding units included in the current coding unit 1000 or 1050. For example, when the split form information indicates that the current coding unit 1000 or 1050 is divided into three coding units, the decoder 120 divides the current coding unit 1000 or 1050 into three coding units 1030a,. 1030b, 1030c, 1080a, 1080b, 1080c). According to an embodiment, the decoder 120 may determine an odd number of coding units included in the current coding unit 1000 or 1050, and not all sizes of the determined coding units may be the same.
  • the size of a predetermined coding unit 1030b or 1080b among the determined odd coding units 1030a, 1030b, 1030c, 1080a, 1080b, and 1080c is different from other coding units 1030a, 1030c, 1080a, and 1080c. May have That is, a coding unit that may be determined by dividing the current coding unit 1000 or 1050 may have a plurality of types, and in some cases, odd number of coding units 1030a, 1030b, 1030c, 1080a, 1080b, and 1080c Each may have a different size.
  • the decoder 120 may determine an odd number of coding units included in the current coding unit 1000 or 1050.
  • the unit 120 may set a predetermined limit on at least one coding unit among odd-numbered coding units generated by dividing.
  • the decoder 120 may determine a coding unit positioned at the center of three coding units 1030a, 1030b, 1030c, 1080a, 1080b, and 1080c generated by dividing a current coding unit 1000 or 1050.
  • the decoding process for 1030b and 1080b may be different from other coding units 1030a, 1030c, 1080a and 1080c.
  • the decoder 120 restricts the coding units 1030b and 1080b positioned in the center from being split any more, unlike other coding units 1030a, 1030c, 1080a, and 1080c, or divides only a predetermined number of times. You can limit it as much as possible.
  • FIG. 11 illustrates a process of splitting a coding unit by the image decoding apparatus 100 based on at least one of block type information and split shape information, according to an embodiment.
  • the decoder 120 may determine whether to split or not divide the first coding unit 1100 having a square shape into coding units based on at least one of block shape information and split shape information. According to an embodiment, when the split type information indicates splitting the first coding unit 1100 in the horizontal direction, the decoder 120 divides the first coding unit 1100 in the horizontal direction to divide the second coding unit ( 1110 may be determined.
  • the first coding unit, the second coding unit, and the third coding unit used according to an embodiment are terms used to understand a before and after relationship between the coding units. For example, when the first coding unit is split, the second coding unit may be determined. When the second coding unit is split, the third coding unit may be determined. The relationship between the first coding unit, the second coding unit, and the third coding unit used hereinafter may be understood to be in accordance with the above-described features.
  • the image decoding apparatus 100 may determine to divide or not split the determined second coding unit 1110 into coding units based on at least one of block shape information and split shape information.
  • the decoder 120 may select at least a second coding unit 1110 having a non-square shape determined by dividing the first coding unit 1100 based on at least one of block shape information and split shape information.
  • One third coding unit (1120a, 1120b, 1120c, 1120d, etc.) may be split or the second coding unit 1110 may not be split.
  • the bitstream obtainer 110 of the image decoding apparatus 100 may obtain at least one of block type information and split type information, and the decoder 120 may be based on at least one of the obtained block type information and split type information.
  • the decoder 120 may be based on at least one of the obtained block type information and split type information.
  • a plurality of second coding units eg, 1110 of various types may be divided, and the second coding unit 1110 may include at least one of block shape information and split shape information. Based on one, the first coding unit 1100 may be split according to a split scheme.
  • the second The coding unit 1110 may also be divided into third coding units (eg, 1120a, 1120b, 1120c, 1120d, etc.) based on at least one of the block shape information and the split shape information of the second coding unit 1110. have. That is, the coding unit may be recursively divided based on at least one of the partition shape information and the block shape information associated with each coding unit.
  • a square coding unit may be determined in a non-square coding unit, and a coding unit of a square shape may be recursively divided to determine a coding unit of a non-square shape.
  • a predetermined coding unit eg, located in the center of an odd number of third coding units 1120b, 1120c, and 1120d determined by splitting a second coding unit 1110 having a non-square shape
  • Coding unit or a coding unit having a square shape may be recursively divided.
  • the third coding unit 1120c having a square shape which is one of odd third coding units 1120b, 1120c, and 1120d, may be divided in a horizontal direction and divided into a plurality of fourth coding units.
  • the fourth coding unit 1140 having a non-square shape which is one of the plurality of fourth coding units, may be divided into a plurality of coding units.
  • the fourth coding unit 1140 having a non-square shape may be further divided into odd coding units 1150a, 1150b, and 1150c.
  • the decoder 120 splits each of the third coding units 1120a, 1120b, 1120c, 1120d, etc. into coding units based on at least one of the block shape information and the split shape information, or the second coding unit. It may be determined not to divide 1110.
  • the decoder 120 may split the second coding unit 1110 having a non-square shape into an odd number of third coding units 1120b, 1120c, and 1120d.
  • the image decoding apparatus 100 may place a predetermined limit on a predetermined third coding unit among the odd number of third coding units 1120b, 1120c, and 1120d.
  • the image decoding apparatus 100 may be limited to the number of coding units 1120c positioned in the middle of the odd number of third coding units 1120b, 1120c, and 1120d, or may be divided by a set number of times. It can be limited to.
  • the image decoding apparatus 100 may include a coding unit positioned at the center of odd-numbered third coding units 1120b, 1120c, and 1120d included in a second coding unit 1110 having a non-square shape.
  • 1120c is no longer divided, is limited to being divided into a predetermined division form (for example, only divided into four coding units or divided into a form corresponding to the divided form of the second coding unit 1110), or predetermined It can be limited to dividing only by the number of times (e.g., dividing only n times, n> 0).
  • a predetermined division form for example, only divided into four coding units or divided into a form corresponding to the divided form of the second coding unit 1110
  • predetermined It can be limited to dividing only by the number of times (e.g., dividing only n times, n> 0).
  • the coding unit 1120c located in the center is merely a mere embodiment, it should not be construed as being limited to the above-described embodiments, and the coding unit 1120c located in the center may have different coding units 1120b and 1120d. ), It should be interpreted as including various restrictions that can be decoded.
  • the image decoding apparatus 100 may obtain at least one of block shape information and split shape information used to divide a current coding unit at a predetermined position in the current coding unit.
  • At least one of the block shape information and the split shape information of the current coding unit 1200 may be a sample at a predetermined position (for example, located at the center of a plurality of samples included in the current coding unit 1200). Sample 1240). However, a predetermined position in the current coding unit 1200 from which at least one of such block shape information and split form information may be obtained should not be interpreted as being limited to the center position shown in FIG.
  • the image decoding apparatus 100 may determine that the current coding unit is divided into coding units of various shapes and sizes by not obtaining at least one of block shape information and split shape information obtained from a predetermined position.
  • the image decoding apparatus 100 may select one coding unit from among them. Methods for selecting one of a plurality of coding units may vary, which will be described below through various embodiments.
  • the decoder 120 of the image decoding apparatus 100 may divide a current coding unit into a plurality of coding units and determine a coding unit of a predetermined position.
  • FIG. 12 illustrates a method for the image decoding apparatus 100 to determine a coding unit of a predetermined position among odd-numbered coding units according to an embodiment.
  • the decoder 120 may use information indicating the position of each of the odd coding units to determine a coding unit located in the middle of the odd coding units.
  • the decoder 120 may divide the current coding unit 1200 to determine odd number of coding units 1220a, 1220b, and 1220c.
  • the decoder 120 may determine the center coding unit 1220b by using information about the positions of the odd number of coding units 1220a, 1220b, and 1220c. For example, the decoder 120 determines the positions of the coding units 1220a, 1220b, and 1220c based on the information indicating the positions of predetermined samples included in the coding units 1220a, 1220b, and 1220c.
  • the coding unit 1220b may be determined. Specifically, the decoder 120 positions the positions of the coding units 1220a, 1220b, and 1220c based on information indicating the positions of the samples 1230a, 1230b, and 1230c in the upper left of the coding units 1220a, 1220b, and 1220c.
  • the coding unit 1220b located in the center may be determined by determining.
  • the information indicating the positions of the samples 1230a, 1230b, and 1230c in the upper left included in the coding units 1220a, 1220b, and 1220c may be located in the pictures of the coding units 1220a, 1220b, and 1220c. Or it may include information about the coordinates. According to an embodiment, the information indicating the positions of the samples 1230a, 1230b, and 1230c in the upper left included in the coding units 1220a, 1220b, and 1220c, respectively, may be included in the coding units 1220a and 1220b.
  • the coding unit 1220b positioned in the center may be determined.
  • the information indicating the position of the sample 1230a at the upper left of the upper coding unit 1220a may indicate (xa, ya) coordinates, and the sample 1230b at the upper left of the middle coding unit 1220b.
  • the information indicating the position of) may indicate the (xb, yb) coordinates, and the information indicating the position of the sample 1230c on the upper left of the lower coding unit 1220c may indicate the (xc, yc) coordinates.
  • the image decoding apparatus 100 may determine the center coding unit 1220b using the coordinates of the samples 1230a, 1230b, and 1230c of the upper left included in the coding units 1220a, 1220b, and 1220c, respectively.
  • the coordinates indicating the positions of the samples 1230a, 1230b, and 1230c at the upper left may indicate coordinates indicating the absolute positions in the picture, and further, the positions of the samples 1230a at the upper left of the upper coding unit 1220a.
  • the (dxb, dyb) coordinate which is the information indicating the relative position of the sample 1230b at the upper left of the center coding unit 1220b, and the relative position of the sample 1230c at the upper left of the lower coding unit 1220c.
  • Information (dxc, dyc) coordinates can also be used.
  • the method of determining the coding unit of a predetermined position by using the coordinates of the sample as information indicating the position of the sample included in the coding unit should not be interpreted to be limited to the above-described method, and various arithmetic operations that can use the coordinates of the sample It should be interpreted in a way.
  • the image decoding apparatus 100 may split the current coding unit 1200 into a plurality of coding units 1220a, 1220b, and 1220c, and may determine a predetermined reference among the coding units 1220a, 1220b, and 1220c. According to the coding unit can be selected. For example, the decoder 120 may select coding units 1220b having different sizes from among the coding units 1220a, 1220b, and 1220c.
  • the image decoding apparatus 100 may include (xa, ya) coordinates, information indicating a position of the sample 1230a on the upper left side of the upper coding unit 1220a, and a sample on the upper left side of the center coding unit 1220b.
  • Coding unit 1220a using the (xb, yb) coordinate which is the information indicating the position of 1230b and the (xc, yc) coordinate which is the information indicating the position of the sample 1230c of the upper left of the lower coding unit 1220c. 1220b, 1220c) may determine the width or height of each.
  • the image decoding apparatus 100 uses (xa, ya), (xb, yb), and (xc, yc) coordinates indicating the positions of the coding units 1220a, 1220b, and 1220c. ) Each size can be determined.
  • the image decoding apparatus 100 may determine the width of the upper coding unit 1220a as xb-xa and the height as yb-ya.
  • the decoder 120 may determine the width of the center coding unit 1220b as xc-xb and the height as yc-yb.
  • the decoder 120 may determine the width or height of the lower coding unit using the width or height of the current coding unit, and the width and height of the upper coding unit 1220a and the center coding unit 1220b.
  • the decoder 120 may determine one coding unit having a different size from other coding units based on the width and height of the determined coding units 1220a, 1220b, and 1220c.
  • the image decoding apparatus 100 may determine a coding unit 1220b as a coding unit having a predetermined position while having a size different from that of the upper coding unit 1220a and the lower coding unit 1220c.
  • the coding unit at a predetermined position may be determined using the size of the coding unit determined based on the sample coordinates.
  • various processes of determining a coding unit at a predetermined position by comparing the sizes of coding units determined according to predetermined sample coordinates may be used.
  • the position of the sample to be considered for determining the position of the coding unit should not be interpreted as being limited to the upper left side described above, but may be interpreted that information on the position of any sample included in the coding unit may be used.
  • the image decoding apparatus 100 may select a coding unit of a predetermined position among odd-numbered coding units determined by dividing the current coding unit in consideration of the shape of the current coding unit. For example, if the current coding unit has a non-square shape having a width greater than the height, the decoder 120 may determine the coding unit at a predetermined position in the horizontal direction. That is, the decoder 120 may determine one of the coding units having different positions in the horizontal direction to limit the corresponding coding unit. If the current coding unit has a non-square shape having a height greater than the width, the decoder 120 may determine the coding unit at a predetermined position in the vertical direction. That is, the decoder 120 may determine one of the coding units having different positions in the vertical direction to limit the corresponding coding unit.
  • the image decoding apparatus 100 may use information indicating the positions of each of the even coding units to determine the coding unit of the predetermined position among the even coding units.
  • the decoder 120 may determine an even number of coding units by dividing a current coding unit and determine a coding unit of a predetermined position by using information about the positions of the even coding units.
  • a detailed process thereof may be similar to the process of determining a coding unit of a predetermined position (for example, a middle position) among the odd number of coding units described above with reference to FIG.
  • a predetermined value for a coding unit of a predetermined position in the splitting process is determined to determine a coding unit of a predetermined position among the plurality of coding units.
  • Information is available.
  • the decoder 120 of the image decoding apparatus 100 may store a sample included in a middle coding unit during splitting to determine a coding unit located in a center among coding units in which a current coding unit is divided into a plurality. At least one of block type information and split type information may be used.
  • the decoder 120 of the image decoding apparatus 100 may determine a current coding unit 1200 based on at least one of block shape information and split shape information, and include a plurality of coding units 1220a, 1220b, and 1220c.
  • the coding unit 1220b positioned in the center of the plurality of coding units 1220a, 1220b, and 1220c may be determined.
  • the decoder 120 may determine a coding unit 1220b positioned in the center in consideration of a position where at least one of the block shape information and the split shape information is obtained.
  • At least one of the block shape information and the split shape information of the current coding unit 1200 may be obtained from a sample 1240 positioned in the center of the current coding unit 1200.
  • the coding unit 1220b including the sample 1240 is a coding unit positioned at the center. You can decide.
  • the information used to determine the coding unit located in the middle should not be interpreted as being limited to at least one of the block type information and the split type information, and various types of information may be used in the process of determining the coding unit located in the center. Can be.
  • predetermined information for identifying a coding unit of a predetermined position may be obtained from a predetermined sample included in the coding unit to be determined.
  • the decoder 120 encodes a coding unit (for example, a plurality of encoding units at a predetermined position) among a plurality of coding units 1220a, 1220b, and 1220c determined by splitting a current coding unit 1200.
  • Block shape information and division obtained from a sample of a predetermined position in the current coding unit 1200 (for example, a sample located in the center of the current coding unit 1200) in order to determine a coding unit located in the center of the units. At least one of the shape information may be used.
  • the decoder 120 may determine a sample of the predetermined position in consideration of the block block form of the current coding unit 1200, and the decoder 120 may determine a plurality of samples in which the current coding unit 1200 is divided and determined.
  • a coding unit 1220b including a sample from which predetermined information (for example, at least one of block shape information and split shape information) may be obtained may be determined to determine a predetermined time. Limitations can be placed. Referring to FIG.
  • the decoder 120 may determine a sample 1240 positioned in the center of the current coding unit 1200 as a sample from which predetermined information may be obtained, and the decoder 120 ) May set a predetermined limit in decoding the coding unit 1220b including the sample 1240.
  • the position of the sample from which the predetermined information can be obtained should not be interpreted as being limited to the above-described position, but may be interpreted as samples of arbitrary positions included in the coding unit 1220b to be determined for the purpose of limitation.
  • a position of a sample from which predetermined information may be obtained may be determined according to the shape of the current coding unit 1200.
  • the block shape information may determine whether the shape of the current coding unit is square or non-square, and determine the position of a sample from which the predetermined information may be obtained according to the shape.
  • the decoder 120 is located on a boundary that divides at least one of the width and the height of the current coding unit in half using at least one of information about the width and height of the current coding unit. May be determined as a sample from which predetermined information can be obtained.
  • the decoder 120 may select one of samples adjacent to a boundary that divides the long side of the current coding unit in half. It can be determined as a sample from which information can be obtained.
  • the image decoding apparatus 100 when the image decoding apparatus 100 divides a current coding unit into a plurality of coding units, at least one of block shape information and split shape information may be used to determine a coding unit of a predetermined position among a plurality of coding units. You can use one.
  • the bitstream obtainer 110 may obtain at least one of block shape information and split shape information from a sample at a predetermined position included in a coding unit, and the decoder 120 splits the current coding unit.
  • the generated plurality of coding units may be split using at least one of split shape information and block shape information obtained from a sample of a predetermined position included in each of the plurality of coding units.
  • the coding unit may be recursively split using at least one of block shape information and split shape information obtained from a sample of a predetermined position included in each coding unit. Since the recursive division process of the coding unit has been described above with reference to FIG. 11, a detailed description thereof will be omitted.
  • the image decoding apparatus 100 may determine at least one coding unit by dividing a current coding unit, and determine an order in which the at least one coding unit is decoded in a predetermined block (for example, the current coding unit). Can be determined according to
  • FIG. 13 illustrates an order in which a plurality of coding units are processed when the image decoding apparatus 100 determines a plurality of coding units by dividing a current coding unit.
  • the decoder 120 determines the second coding units 1310a and 1310b by dividing the first coding unit 1300 in the vertical direction according to the block shape information and the split shape information, or the first coding unit (
  • the second coding units 1330a and 1330b may be determined by dividing the 1300 in the horizontal direction, or the second coding units 1350a, 1350b, 1350c, and 1350d may be determined by dividing the first coding unit 1300 in the vertical and horizontal directions. You can decide.
  • the decoder 120 may determine an order such that the second coding units 1310a and 1310b determined by dividing the first coding unit 1300 in the vertical direction are processed in the horizontal direction 1310c.
  • the image decoding apparatus 100 may determine the processing order of the second coding units 1330a and 1330b determined by dividing the first coding unit 1300 in the horizontal direction, in the vertical direction 1330c.
  • the image decoding apparatus 100 processes the coding units for positioning the second coding units 1350a, 1350b, 1350c, and 1350d determined by dividing the first coding unit 1300 in the vertical direction and the horizontal direction.
  • the coding units located in the next row may be determined according to a predetermined order (for example, raster scan order or z scan order 1350e).
  • the image decoding apparatus 100 may recursively split coding units.
  • the decoder 120 may determine a plurality of coding units 1310a, 1310b, 1330a, 1330b, 1350a, 1350b, 1350c, and 1350d by dividing the first coding unit 1300.
  • Each of the plurality of coding units 1310a, 1310b, 1330a, 1330b, 1350a, 1350b, 1350c, and 1350d may be recursively divided.
  • the method of splitting the plurality of coding units 1310a, 1310b, 1330a, 1330b, 1350a, 1350b, 1350c, and 1350d may be similar to the method of splitting the first coding unit 1300. Accordingly, the plurality of coding units 1310a, 1310b, 1330a, 1330b, 1350a, 1350b, 1350c, and 1350d may be independently divided into a plurality of coding units. Referring to FIG. 13, the decoder 120 may determine the second coding units 1310a and 1310b by dividing the first coding unit 1300 in the vertical direction, and further, respectively, the second coding units 1310a and 1310b. You can decide to split independently or not.
  • the decoder 120 may divide the second coding unit 1310a on the left side into horizontal units and split the third coding unit 1320a and 1320b into the horizontal direction, and the second coding unit 1310b on the right side. May not be divided.
  • the processing order of coding units may be determined based on a split process of the coding units.
  • the processing order of the divided coding units may be determined based on the processing order of the coding units before splitting.
  • the decoder 120 may independently determine the order in which the third coding units 1320a and 1320b determined by splitting the second coding unit 1310a on the left side from the second coding unit 1310b on the right side. Since the second coding unit 1310a on the left is divided in the horizontal direction to determine the third coding units 1320a and 1320b, the third coding units 1320a and 1320b may be processed in the vertical direction 1320c.
  • the third coding unit included in the second coding unit 1310a on the left side corresponds to the horizontal direction 1310c
  • the right coding unit 1310b may be processed.
  • FIG. 14 illustrates a process of determining that a current coding unit is divided into an odd number of coding units when the image decoding apparatus 100 may not process the coding units in a predetermined order, according to an embodiment.
  • the image decoding apparatus 100 may determine that the current coding unit is divided into odd coding units based on the block shape information and the partition shape information acquired by the bitstream obtainer 110.
  • a first coding unit 1400 having a square shape may be divided into second coding units 1410a and 1410b having a non-square shape, and each of the second coding units 1410a and 1410b may be independently formed. It may be divided into three coding units 1420a, 1420b, 1420c, 1420d, and 1420e.
  • the decoder 120 may determine a plurality of third coding units 1420a and 1420b by dividing the left coding unit 1410a in the horizontal direction among the second coding units, and may include the right coding unit 1410b. May be divided into odd third coding units 1420c, 1420d, and 1420e.
  • the decoder 120 determines whether the third coding units 1420a, 1420b, 1420c, 1420d, and 1420e may be processed in a predetermined order to determine whether there are oddly divided coding units. Can be. Referring to FIG. 14, the decoder 120 may recursively divide the first coding unit 1400 to determine the third coding units 1420a, 1420b, 1420c, 1420d, and 1420e. The decoder 120 may perform the first coding unit 1400, the second coding unit 1410a, 1410b, or the third coding unit 1420a, 1420b, 1420c, or 1420d based on at least one of the block shape information and the split shape information.
  • 1420e may be determined to be split into an odd number of coding units.
  • a coding unit positioned on the right side of the second coding units 1410a and 1410b may be divided into odd third coding units 1420c, 1420d, and 1420e.
  • the order in which the plurality of coding units included in the first coding unit 1400 is processed may be a predetermined order (for example, a z-scan order 1430), and the decoder 120 ) May determine whether the third coding units 1420c, 1420d, and 1420e determined by splitting the right second coding unit 1410b into an odd number satisfy the condition in which the right coding unit 1410b is processed according to the predetermined order.
  • the image decoding apparatus 100 may satisfy a condition that the third coding units 1420a, 1420b, 1420c, 1420d, and 1420e included in the first coding unit 1400 may be processed in a predetermined order. And whether the at least one of the width and the height of the second coding unit 1410a, 1410b is divided in half according to the boundary of the third coding unit 1420a, 1420b, 1420c, 1420d, or 1420e.
  • the third coding units 1420a and 1420b which are determined by dividing the height of the left second coding unit 1410a in the non-square form in half, satisfy the condition, but the right second coding unit 1410b is 3 times.
  • the third coding units 1420c, 1420d, and 1420e determined by dividing into two coding units does not divide the width or height of the right second coding unit 1410b in half
  • the third coding units 1420c, 1420d, 1420e may be determined not to satisfy the condition, and the image decoding apparatus 100 may determine that the scan sequence is disconnected in the case of dissatisfaction with the condition, and the right second coding unit 1410b may be determined based on the determination result. It may be determined to be divided into an odd number of coding units.
  • the image decoding apparatus 100 when the image decoding apparatus 100 is divided into an odd number of coding units, the image decoding apparatus 100 may set a predetermined limit on a coding unit of a predetermined position among the divided coding units. Since the above has been described through the embodiments, detailed description thereof will be omitted.
  • FIG. 15 illustrates a process of determining, by the image decoding apparatus 100, at least one coding unit by dividing the first coding unit 1500 according to an embodiment.
  • the decoder 120 may split the first coding unit 1500 based on at least one of the block shape information and the split shape information obtained through the bitstream obtainer 110.
  • the first coding unit 1500 having a square shape may be divided into coding units having four square shapes, or may be divided into a plurality of coding units having a non-square shape. For example, referring to FIG.
  • the decoder 120 may determine the first coding unit ( 1500 may be divided into a plurality of non-square coding units.
  • the decoder 120 may form a square first coding unit 1500. May be divided into second coding units 1510a, 1510b, and 1510c that are determined by being split in the vertical direction as odd coding units, or second coding units 1520a, 1520b, and 1520c that are determined by splitting in the horizontal direction.
  • the decoder 120 may determine a condition in which the second coding units 1510a, 1510b, 1510c, 1520a, 1520b, and 1520c included in the first coding unit 1500 may be processed in a predetermined order.
  • the condition may be determined, and the condition is whether at least one of the width and the height of the first coding unit 1500 is divided in half according to the boundary of the second coding units 1510a, 1510b, 1510c, 1520a, 1520b, and 1520c.
  • a boundary between second coding units 1510a, 1510b, and 1510c which is determined by dividing a square first coding unit 1500 in a vertical direction, divides the width of the first coding unit 1500 in half.
  • the first coding unit 1500 may be determined to not satisfy a condition that may be processed in a predetermined order.
  • a boundary between the second coding units 1520a, 1520b, and 1520c which is determined by dividing the first coding unit 1500 having a square shape in the horizontal direction, does not divide the width of the first coding unit 1500 in half,
  • the one coding unit 1500 may be determined as not satisfying a condition that may be processed in a predetermined order.
  • the image decoding apparatus 100 may determine that such a condition is not satisfied as disconnection of the scan order, and determine that the first coding unit 1500 is divided into odd coding units based on the determination result. According to an embodiment, when the image decoding apparatus 100 is divided into an odd number of coding units, the image decoding apparatus 100 may set a predetermined limit on a coding unit of a predetermined position among the divided coding units. Since the above has been described through the embodiments, detailed description thereof will be omitted.
  • the image decoding apparatus 100 may determine various coding units by dividing the first coding unit.
  • the image decoding apparatus 100 may split a first coding unit 1500 having a square shape and a first coding unit 1530 or 1550 having a non-square shape into various coding units. .
  • FIG. 16 illustrates that the second coding unit is split when the second coding unit having a non-square shape determined by splitting the first coding unit 1600 according to an embodiment satisfies a predetermined condition. It shows that the form that can be limited.
  • the decoder 120 may form a non-square shape first coding unit 1600 having a square shape based on at least one of block shape information and partition shape information obtained through the bitstream obtainer 116. It may be determined by dividing into second coding units 1610a, 1610b, 1620a, and 1620b. The second coding units 1610a, 1610b, 1620a, and 1620b may be split independently. Accordingly, the decoder 120 may determine whether to split or not split into a plurality of coding units based on at least one of block shape information and split shape information related to each of the second coding units 1610a, 1610b, 1620a, and 1620b. have.
  • the decoder 120 divides the left second coding unit 1610a of the non-square shape, determined by dividing the first coding unit 1600 in the vertical direction, in the horizontal direction, and then splits the third coding unit 1612a. 1612b).
  • the decoder 120 splits the left second coding unit 1610a in the horizontal direction the right second coding unit 1610b is horizontally identical to the direction in which the left second coding unit 1610a is divided. It can be restricted so that it cannot be divided. If the right second coding unit 1610b is divided in the same direction and the third coding units 1614a and 1614b are determined, the left second coding unit 1610a and the right second coding unit 1610b are horizontally respectively.
  • the third coding units 1612a, 1612b, 1614a, and 1614b may be determined. However, this is because the decoder 120 divides the first coding unit 1600 into four square second coding units 1630a, 1630b, 1630c, and 1630d based on at least one of the block shape information and the split shape information. This is the same result as that and may be inefficient in terms of image decoding.
  • the decoder 120 divides the second coding unit 1620a or 1620b of the non-square shape, which is determined by dividing the first coding unit 900 in the horizontal direction, in the vertical direction, and then uses the third coding unit ( 1622a, 1622b, 1624a, 1624b.
  • the second decoding unit for example, lower coding
  • the unit 1620b may restrict the upper second coding unit 1620a from being split in the vertical direction in the same direction as the split direction.
  • FIG. 17 illustrates a process of splitting a coding unit having a square shape by the image decoding apparatus 100 when the split shape information cannot be divided into four square coding units according to an embodiment.
  • the decoder 120 determines the second coding unit 1710a, 1710b, 1720a, 1720b, etc. by dividing the first coding unit 1700 based on at least one of block shape information and split shape information.
  • the split type information may include information about various types in which a coding unit may be split, but the information on various types may not include information for splitting into four coding units having a square shape.
  • the decoder 120 may not divide the first coding unit 1700 having a square shape into four second coding units 1730a, 1730b, 1730c, and 1730d having four square shapes.
  • the decoder 120 may determine second non-square second coding units 1710a, 1710b, 1720a, 1720b, and the like based on the split shape information.
  • the decoder 120 may independently split the non-square second coding units 1710a, 1710b, 1720a, 1720b, and the like.
  • Each of the second coding units 1710a, 1710b, 1720a, 1720b, etc. may be split in a predetermined order through a recursive method, which is based on at least one of the block shape information and the split shape information 1700. May be a split method similar to the method in which?
  • the decoder 120 may split the left second coding unit 1710a in the horizontal direction to determine the third coding units 1712a and 1712b having a square shape, and the right second coding unit 1710b may be horizontal.
  • the third coding units 1714a and 1714b having a square shape may be determined by being split in the direction.
  • the decoder 120 may divide the left second coding unit 1710a and the right second coding unit 1710b in the horizontal direction to determine the third coding units 1716a, 1716b, 1716c, and 1716d having a square shape.
  • the coding unit may be determined in the same form as that in which the first coding unit 1700 is divided into four second coding units 1730a, 1730b, 1730c, and 1730d.
  • the decoder 120 may determine the third coding units 1722a and 1722b having a square shape by dividing the upper second coding unit 1720a in the vertical direction, and the lower second coding unit 1720b. Is divided in the vertical direction to determine the third coding units 1724a and 1724b having a square shape. In addition, the decoder 120 may divide the upper second coding unit 1720a and the lower second coding unit 1720b in the vertical direction to determine the third coding units 1722a, 1722b, 1724a, and 1724b having a square shape. . In this case, the coding unit may be determined in the same form as that in which the first coding unit 1700 is divided into four second coding units 1730a, 1730b, 1730c, and 1730d.
  • FIG. 18 illustrates that a processing order between a plurality of coding units may vary according to a division process of coding units, according to an embodiment.
  • the decoder 120 may split the first coding unit 1800 based on the block shape information and the split shape information.
  • the block shape information indicates a square shape and the split shape information indicates that the first coding unit 1800 is divided into at least one of a horizontal direction and a vertical direction
  • the decoder 120 may determine the first coding unit 1800.
  • the second coding unit (for example, 1810a, 1810b, 1820a, 1820b, 1830a, 1830b, 1830c, 1830d, etc.) may be determined by dividing. Referring to FIG.
  • non-square-type second coding units 1810a, 1810b, 1820a, and 1820b which are determined by dividing the first coding unit 1800 only in the horizontal direction or the vertical direction, respectively, may include block shape information and split shape information for each. It can be divided independently based on.
  • the decoder 120 divides the second coding units 1810a and 1810b generated by splitting the first coding unit 1800 in the vertical direction in the horizontal direction, respectively, and then uses the third coding units 1816a, 1816b, and 1816c.
  • the decoder 120 may process coding units in a predetermined order. Features of the processing of the coding unit according to the predetermined order have been described above with reference to FIG. 13, and thus a detailed description thereof will be omitted. Referring to FIG. 18, the decoder 120 divides a first coding unit 1800 having a square shape, and then divides four third coding units 1816a, 1816b, 1816c, 1816d, 1826a, 1826b, 1826c, and 1826d having four square shapes. Can be determined.
  • the decoder 120 determines a processing order of the third coding units 1816a, 1816b, 1816c, 1816d, 1826a, 1826b, 1826c, and 1826d according to the form in which the first coding unit 1800 is divided. Can be.
  • the decoder 120 may divide the second coding units 1810a and 1810b generated by splitting in the vertical direction in the horizontal direction to determine the third coding units 1816a, 1816b, 1816c, and 1816d.
  • the decoder 120 first processes the third coding units 1816a and 1816b included in the left second coding unit 1810a in the vertical direction, and then includes a third included in the right second coding unit 1810b.
  • the third coding units 1816a, 1816b, 1816c, and 1816d may be processed according to an order 1817 of processing the coding units 1816c and 1816d in the vertical direction.
  • the decoder 120 may divide the second coding units 1820a and 1820b generated by splitting in the horizontal direction, respectively, in the vertical direction to determine the third coding units 1826a, 1826b, 1826c, and 1826d.
  • the decoder 120 first processes the third coding units 1826a and 1826b included in the upper second coding unit 1820a in the horizontal direction, and then includes a third included in the lower second coding unit 1820b.
  • the third coding units 1826a, 1826b, 1826c, and 1826d may be processed according to an order 1827 of processing the coding units 1826c and 1826d in the horizontal direction.
  • second coding units 1810a, 1810b, 1820a, and 1820b may be divided, respectively, and square third coding units 1816a, 1816b, 1816c, 1816d, 1826a, 1826b, 1826c, and 1826d may be determined. have.
  • the second coding units 1810a and 1810b determined by dividing in the vertical direction and the second coding units 1820a and 1820b determined by dividing in the horizontal direction are divided into different forms, but are subsequently determined by the third coding unit 1816a.
  • the first coding unit 1800 is divided into coding units having the same type.
  • the decoder 120 recursively splits the coding unit through a different process based on at least one of the block shape information and the split shape information, thereby determining the coding units having the same shape, but the plurality of the plurality of the determined shape having the same shape. Coding units may be processed in different orders.
  • 19 is a diagram illustrating a process of determining a depth of a coding unit according to an embodiment when a coding unit is recursively divided and a plurality of coding units are determined.
  • the decoder 120 may determine the depth of the coding unit according to a predetermined criterion.
  • the predetermined criterion may be the length of the long side of the coding unit.
  • the length of the long side of the current coding unit is divided by 2n (n> 0) times the length of the long side of the coding unit before the split, the depth of the current coding unit is n than the depth of the coding unit before the split. Depth can be determined to increase by.
  • a coding unit having an increased depth is expressed as a coding unit of a lower depth.
  • the decoder 120 may have a square shape based on block shape information indicating that the shape is square (for example, block shape information may indicate '0: SQUARE').
  • the coding unit 1900 may be divided to determine a second coding unit 1902, a third coding unit 1904, and the like of a lower depth. If the size of the first coding unit 1900 having a square shape is 2Nx2N, the second coding unit 1902 determined by dividing the width and height of the first coding unit 1900 by 1/21 times may have a size of NxN. have.
  • the third coding unit 1904 determined by dividing the width and the height of the second coding unit 1902 into half the size may have a size of N / 2 ⁇ N / 2.
  • the width and height of the third coding unit 1904 correspond to 1/22 times the first coding unit 1900.
  • the depth of the first coding unit 1900 is D
  • the depth of the second coding unit 1902 that is 1/21 times the width and the height of the first coding unit 1900 may be D + 1
  • the depth of the third coding unit 1904, which is 1/22 times the width and the height of 1900 may be D + 2.
  • block shape information indicating a non-square shape (e.g., block shape information indicates that the height is a non-square longer than the width '1: NS_VER' or the width is a non-square longer than the height).
  • 2 may represent NS_HOR ', and the decoder 120 divides the first coding unit 1910 or 1920 having a non-square shape to form the second coding unit 1912 or 1922 of the lower depth.
  • Three coding units 1914 or 1924 may be determined.
  • the decoder 120 may determine a second coding unit (eg, 1902, 1912, 1922, etc.) by dividing at least one of a width and a height of the Nx2N size of the first coding unit 1910. That is, the decoder 120 may divide the first coding unit 1910 in the horizontal direction to determine a second coding unit 1902 having an NxN size or a second coding unit 1922 having an NxN / 2 size, and horizontally.
  • the second coding unit 1912 having a size of N / 2 ⁇ N may be determined by splitting in the vertical direction and the vertical direction.
  • the decoder 120 may determine a second coding unit (eg, 1902, 1912, 1922, etc.) by dividing at least one of a width and a height of the 2N ⁇ N first coding unit 1920. have. That is, the decoder 120 may divide the first coding unit 1920 in the vertical direction to determine a second coding unit 1902 having an NxN size or a second coding unit 1912 having an N / 2xN size, and horizontally.
  • the second coding unit 1922 having a size of NxN / 2 may be determined by splitting in the direction and the vertical direction.
  • the decoder 120 may determine a third coding unit (eg, 1904, 1914, 1924, etc.) by dividing at least one of a width and a height of the NxN-sized second coding unit 1902. have. That is, the decoder 120 divides the second coding unit 1902 in the vertical direction and the horizontal direction to determine the third coding unit 1904 having a size of N / 2 ⁇ N / 2 or a third size of N / 22 ⁇ N / 2.
  • the coding unit 1914 may be determined, or a third coding unit 1924 having a size of N / 2 ⁇ N / 22 may be determined.
  • the decoder 120 divides at least one of the width and the height of the N / 2xN sized second coding unit 1912 to determine a third coding unit (eg, 1904, 1914, 1924, etc.). You can also decide. That is, the decoder 120 divides the second coding unit 1912 in the horizontal direction to form a third coding unit 1904 having a size of N / 2xN / 2 or a third coding unit 1924 having a size of N / 2xN / 22.
  • the third coding unit 1914 having the size of N / 22 ⁇ N / 2 may be determined by determining or splitting in the vertical direction and the horizontal direction.
  • the decoder 120 splits at least one of a width and a height of the NxN / 2 sized second coding unit 1914 to form a third coding unit (for example, 1904, 1914, 1924, etc.). You can also decide. That is, the decoder 120 divides the second coding unit 1912 in the vertical direction to form a third coding unit 1904 having an N / 2 ⁇ N / 2 size or a third coding unit 1914 having an N / 22xN / 2 size.
  • the third coding unit 1924 having the size of N / 2 ⁇ N / 22 may be determined by determining or splitting in the vertical direction and the horizontal direction.
  • the decoder 120 may divide a coding unit having a square shape (for example, 1900, 1902, and 1904) in a horizontal direction or a vertical direction.
  • the first coding unit 1900 having a size of 2Nx2N is divided in the vertical direction to determine the first coding unit 1910 having the size of Nx2N, or the first coding unit 1920 having a size of 2NxN is determined by splitting in the horizontal direction.
  • the depth of the coding unit determined by dividing the first coding unit 1900, 1902, or 1904 having a size of 2N ⁇ 2N into the horizontal or vertical direction is determined. May be the same as the depth of the first coding unit 1900, 1902, or 1904.
  • the width and height of the third coding unit 1914 or 1924 may correspond to 1/22 times the first coding unit 1910 or 1920.
  • the depth of the second coding unit 1912 or 1914 which is 1/2 the width and height of the first coding unit 1910 or 1920, may be D + 1.
  • the depth of the third coding unit 1914 or 1924 that is 1/22 times the width and the height of the first coding unit 1910 or 1920 may be D + 2.
  • FIG. 20 illustrates a depth and a part index (PID) for distinguishing a coding unit, which may be determined according to the shape and size of coding units, according to an embodiment.
  • PID depth and a part index
  • the decoder 120 may determine a second coding unit having various forms by dividing the first coding unit 2000 having a square shape. Referring to FIG. 20, the decoder 120 divides the first coding unit 2000 in at least one of a vertical direction and a horizontal direction according to the split type information to form a second coding unit 2002a, 2002b, 2004a, 2004b. , 2006a, 2006b, 2006c, 2006d). That is, the decoder 120 may determine the second coding units 2002a, 2002b, 2004a, 2004b, 2006a, 2006b, 2006c, and 2006d based on the split type information about the first coding unit 2000.
  • the second coding units 2002a, 2002b, 2004a, 2004b, 2006a, 2006b, 2006c, and 2006d which are determined according to split shape information about the first coding unit 2000 having a square shape, have a long side length. Depth can be determined based on this. For example, since the length of one side of the first coding unit 2000 in the square form and the length of the long side of the second coding units 2002a, 2002b, 2004a, and 2004b in the non-square form are the same, the first coding unit ( 2000 and the depths of the non-square second coding units 2002a, 2002b, 2004a, and 2004b may be regarded as D.
  • the decoder 120 divides the first coding unit 2000 into four second coding units 2006a, 2006b, 2006c, and 2006d based on the split form information
  • the second unit having a square form Since the length of one side of the coding units 2006a, 2006b, 2006c, and 2006d is 1/2 times the length of one side of the first coding unit 2000, the depths of the second coding units 2006a, 2006b, 2006c, and 2006d are It may be a depth of D + 1 that is one depth lower than D, which is a depth of the first coding unit 2000.
  • the decoder 120 divides the first coding unit 2010 having a shape whose height is greater than the width in the horizontal direction according to the split shape information, thereby performing a plurality of second coding units 2012a, 2012b, 2014a, and 2014b. , 2014c).
  • the decoder 120 divides the first coding unit 2020 having a width greater than the height in the vertical direction according to the split shape information, thereby performing a plurality of second coding units 2022a, 2022b, 2024a, and 2024b. 2024c).
  • the second coding units 2012a, 2012b, 2014a, 2014b, 2016a, 2016b, 2016c, and 2016d that are determined according to split shape information about the first coding unit 2010 or 2020 having a non-square shape may be Depth may be determined based on the length of the long side. For example, since the length of one side of the second coding units 2012a and 2012b having a square shape is 1/2 times the length of one side of the first coding unit 2010 having a non-square shape having a height greater than the width, the square is square.
  • the depth of the second coding units 2002a, 2002b, 2004a, and 2004b of the form is D + 1, which is a depth lower than the depth D of the first coding unit 2010 of the non-square form.
  • the decoder 120 may divide the non-square first coding unit 2010 into odd second coding units 2014a, 2014b, and 2014c based on the split shape information.
  • the odd number of second coding units 2014a, 2014b, and 2014c may include non-square second coding units 2014a and 2014c and square shape second coding units 2014b.
  • the length of the long side of the second coding units 2014a and 2014c in the non-square shape and the length of one side of the second coding unit 2014b in the square shape is 1 / time of the length of one side of the first coding unit 2010.
  • the depths of the second coding units 2014a, 2014b, and 2014c may be a depth of D + 1 that is one depth lower than the depth D of the first coding unit 2010.
  • the decoder 120 is a coding unit associated with the first coding unit 2020 having a non-square shape having a width greater than a height in a manner similar to the above method of determining depths of the coding units related to the first coding unit 2010. Depth of field can be determined.
  • the decoder 120 in determining an index (PID) for dividing the divided coding units, when the odd-numbered split coding units are not the same size, the decoder 120 is based on the size ratio between the coding units. To determine the index. Referring to FIG. 20, a coding unit 2014b positioned at the center of odd-numbered split coding units 2014a, 2014b, and 2014c has the same width as the other coding units 2014a and 2014c but has a different height. It may be twice the height of the fields 2014a, 2014c. That is, in this case, the coding unit 2014b positioned in the center may include two of the other coding units 2014a and 2014c.
  • the decoder 120 may determine whether odd-numbered split coding units are not the same size based on whether there is a discontinuity of an index for distinguishing the split coding units.
  • the image decoding apparatus 100 may determine whether the image decoding apparatus 100 is divided into a specific division type based on a value of an index for dividing the plurality of coding units determined by dividing from the current coding unit. Referring to FIG. 20, the image decoding apparatus 100 may determine an even number of coding units 2012a and 2012b by dividing a first coding unit 2010 having a rectangular shape having a height greater than a width, or an odd number of coding units 2014a and 2014b. , 2014c). The image decoding apparatus 100 may use an index (PID) indicating each coding unit to distinguish each of the plurality of coding units. According to an embodiment, the PID may be obtained from a sample (eg, an upper left sample) at a predetermined position of each coding unit.
  • a sample eg, an upper left sample
  • the image decoding apparatus 100 may determine a coding unit of a predetermined position among coding units determined by splitting by using an index for dividing coding units. According to an embodiment, when the split type information of the first coding unit 2010 having a height greater than the width is divided into three coding units, the image decoding apparatus 100 may determine the first coding unit 2010. It may be divided into three coding units 2014a, 2014b, and 2014c. The image decoding apparatus 100 may allocate an index for each of three coding units 2014a, 2014b, and 2014c. The image decoding apparatus 100 may compare the indices of the respective coding units to determine the coding unit among the oddly divided coding units.
  • the image decoding apparatus 100 encodes a coding unit 2014b having an index corresponding to a center value among the indices based on the indices of the coding units, and encodes the center position among the coding units determined by splitting the first coding unit 2010. It can be determined as a unit. According to an embodiment, when determining the indexes for distinguishing the divided coding units, the image decoding apparatus 100 may determine the indexes based on the size ratio between the coding units when the coding units are not the same size. . Referring to FIG. 20, the coding unit 2014b generated by dividing the first coding unit 2010 may include the coding units 2014a and 2014c that have the same width but different heights than the other coding units 2014a and 2014c. It can be twice the height.
  • the image decoding apparatus 100 may determine that the image decoding apparatus 100 is divided into a plurality of coding units including a coding unit having a different size from other coding units. In this case, when the split form information is divided into odd coding units, the image decoding apparatus 100 may have a shape different from a coding unit having a different coding unit (for example, a middle coding unit) at a predetermined position among the odd coding units.
  • the current coding unit can be divided by.
  • the image decoding apparatus 100 may determine a coding unit having a different size by using an index (PID) for the coding unit.
  • PID index
  • the above-described index, the size or position of the coding unit of the predetermined position to be determined are specific to explain an embodiment and should not be construed as being limited thereto. Various indexes and positions and sizes of the coding unit may be used. Should be interpreted.
  • the decoder 120 may use a predetermined data unit at which recursive division of coding units begins.
  • 21 illustrates that a plurality of coding units are determined according to a plurality of predetermined data units included in a picture according to an embodiment.
  • the predetermined data unit may be defined as a data unit in which a coding unit starts to be recursively divided using at least one of block shape information and split shape information. That is, it may correspond to the coding unit of the highest depth used in the process of determining a plurality of coding units for dividing the current picture.
  • a predetermined data unit will be referred to as a reference data unit.
  • the reference data unit may represent a predetermined size and shape.
  • the reference coding unit may include samples of M ⁇ N. M and N may be the same as each other, and may be an integer represented by a multiplier of two. That is, the reference data unit may represent a square or non-square shape, and then may be divided into integer coding units.
  • the decoder 120 of the image decoding apparatus 100 may split the current picture into a plurality of reference data units.
  • the decoder 120 may divide a plurality of reference data units for dividing a current picture by using split information for each reference data unit.
  • the division process of the reference data unit may correspond to the division process using a quad-tree structure.
  • the decoder 120 may predetermine the minimum size of the reference data unit included in the current picture. Accordingly, the decoder 120 may determine a reference data unit having various sizes having a minimum size or more, and determine at least one coding unit by using block shape information and split shape information based on the determined reference data unit. Can be.
  • the image decoding apparatus 100 may use a reference coding unit 2100 having a square shape, or may use a reference coding unit 2102 having a non-square shape.
  • the shape and size of the reference coding unit may include various data units (eg, a sequence, a picture, a slice, and a slice segment) that may include at least one reference coding unit. slice segment, maximum coding unit, etc.).
  • the bitstream obtainer 110 of the image decoding apparatus 100 obtains at least one of information on a shape of a reference coding unit and information on a size of a reference coding unit from each bitstream. can do.
  • the process of determining at least one coding unit included in the reference coding unit 2100 having a square shape is described above by splitting the current coding unit 900 of FIG. 9.
  • the reference coding unit 2100 having a non-square shape has been described above. Since the process of determining at least one coding unit included in the above) is described above through the process of splitting the current coding unit 1000 or 1050 of FIG. 10, a detailed description thereof will be omitted.
  • the decoder 120 may determine an index for identifying the size and shape of the reference coding unit in order to determine the size and shape of the reference coding unit according to some data unit determined in advance based on a predetermined condition. It is available. That is, the bitstream obtaining unit 110 may have a predetermined condition (for example, a size equal to or less than a slice) among the various data units (eg, sequence, picture, slice, slice segment, maximum coding unit, etc.) from the bitstream. As the data unit satisfying the data unit), only an index for identifying the size and shape of the reference coding unit may be obtained for each slice, slice segment, maximum coding unit, or the like.
  • a predetermined condition for example, a size equal to or less than a slice
  • the various data units eg, sequence, picture, slice, slice segment, maximum coding unit, etc.
  • the decoder 120 may determine the size and shape of the reference data unit for each data unit satisfying the predetermined condition by using the index.
  • the index may be obtained and used. In this case, at least one of the size and shape of the reference coding unit associated with the index indicating the size and shape of the reference coding unit may be predetermined.
  • the decoder 120 determines at least one of the size and shape of the reference coding unit included in the data unit, which is the reference for index acquisition, by selecting at least one of the predetermined size and shape of the reference coding unit according to the index. Can be.
  • the decoder 120 may use at least one reference coding unit included in one maximum coding unit. That is, at least one reference coding unit may be included in the maximum coding unit for dividing an image, and the coding unit may be determined through a recursive division process of each reference coding unit. According to an embodiment, at least one of the width and the height of the maximum coding unit may correspond to an integer multiple of at least one of the width and the height of the reference coding unit. According to an embodiment, the size of the reference coding unit may be a size obtained by dividing the maximum coding unit n times according to a quad tree structure.
  • the decoder 120 may determine the reference coding unit by dividing the maximum coding unit n times according to the quad tree structure, and according to various embodiments, the reference coding unit may be included in at least one of block shape information and split shape information. Can be divided based on this.
  • FIG. 22 is a diagram of a processing block serving as a reference for determining a determination order of a reference coding unit included in a picture 2200.
  • the decoder 120 may determine at least one processing block for dividing a picture.
  • the processing block is a data unit including at least one reference coding unit for dividing an image, and the at least one reference coding unit included in the processing block may be determined in a specific order. That is, the determination order of at least one reference coding unit determined in each processing block may correspond to one of various types of order in which the reference coding unit may be determined, and the reference coding unit determination order determined in each processing block. May be different per processing block.
  • the order of determination of the reference coding units determined for each processing block is raster scan, Z-scan, N-scan, up-right diagonal scan, and horizontal scan. It may be one of various orders such as a horizontal scan, a vertical scan, etc., but the order that may be determined should not be construed as being limited to the scan orders.
  • the decoder 120 may determine the size of at least one processing block included in the image by obtaining information about the size of the processing block.
  • the decoder 120 may determine the size of at least one processing block included in the image by obtaining information about the size of the processing block from the bitstream.
  • the size of such a processing block may be a predetermined size of a data unit indicated by the information about the size of the processing block.
  • the bitstream obtainer 110 of the image decoding apparatus 100 may obtain information about a size of a processing block from a bitstream for each specific data unit.
  • the information about the size of the processing block may be obtained from the bitstream in data units such as an image, a sequence, a picture, a slice, and a slice segment. That is, the bitstream obtainer 110 may obtain information about the size of the processing block from the bitstream for each of the various data units, and the decoder 120 may divide the picture using the obtained information about the size of the processing block.
  • a size of at least one processing block can be determined, and the size of the processing block can be an integer multiple of the reference coding unit.
  • the decoder 120 may determine the sizes of the processing blocks 2202 and 2212 included in the picture 2200. For example, the decoder 120 may determine the size of the processing block based on the information about the size of the processing block obtained from the bitstream. Referring to FIG. 22, the decoder 120 determines a horizontal size of the processing blocks 2202 and 2212 to be four times the horizontal size of the reference coding unit and four times the vertical size of the reference coding unit, according to an exemplary embodiment. Can be. The decoder 120 may determine an order in which at least one reference coding unit is determined in at least one processing block.
  • the decoder 120 may determine each of the processing blocks 2202 and 2212 included in the picture 2200 based on the size of the processing block, and the reference coding unit determiner 12 may process A determination order of at least one reference coding unit included in blocks 2202 and 2212 may be determined.
  • the determination of the reference coding unit may include the determination of the size of the reference coding unit.
  • the decoder 120 may obtain information about a determination order of at least one reference coding unit included in at least one processing block from a bitstream, and based on the obtained determination order An order in which at least one reference coding unit is determined may be determined.
  • the information about the determination order may be defined in an order or direction in which reference coding units are determined in the processing block. That is, the order in which the reference coding units are determined may be independently determined for each processing block.
  • the image decoding apparatus 100 may obtain information about a determination order of a reference coding unit from a bitstream for each specific data unit.
  • the bitstream obtainer 110 may obtain information on the determination order of the reference coding unit from the bitstream for each data unit such as an image, a sequence, a picture, a slice, a slice segment, and a processing block. Since the information about the determination order of the reference coding unit indicates the determination order of the reference coding unit in the processing block, the information about the determination order may be obtained for each specific data unit including an integer number of processing blocks.
  • the image decoding apparatus 100 may determine at least one reference coding unit based on the order determined according to the embodiment.
  • the bitstream obtainer 110 may obtain information about a reference coding unit determination order from the bitstream as information related to the processing blocks 2202 and 2212, and the decoder 120 may process the processing.
  • An order of determining at least one reference coding unit included in blocks 2202 and 2212 may be determined, and at least one reference coding unit included in the picture 2200 may be determined according to the determination order of the coding units.
  • the decoder 120 may determine determination orders 2204 and 2214 of at least one reference coding unit associated with each processing block 2202 and 2212. For example, when information about the determination order of the reference coding unit is obtained for each processing block, the reference coding unit determination order associated with each processing block 2202 and 2212 may be different for each processing block.
  • the reference coding unit included in the processing block 2202 may be determined according to the raster scan order.
  • the reference coding unit determination order 2214 associated with the other processing block 2212 is the reverse order of the raster scan order
  • the reference coding units included in the processing block 2212 may be determined according to the reverse order of the raster scan order.
  • the decoder 120 may decode the determined at least one reference coding unit.
  • the decoder 120 may decode the image based on the reference coding unit determined through the above-described embodiment.
  • the method of decoding the reference coding unit may include various methods of decoding an image.
  • the image decoding apparatus 100 may obtain and use block shape information indicating a shape of a current coding unit or split shape information indicating a method of dividing a current coding unit from a bitstream.
  • Block type information or split type information may be included in a bitstream associated with various data units.
  • the image decoding apparatus 100 may include a sequence parameter set, a picture parameter set, a video parameter set, a slice header, and a slice segment header. block type information or segmentation type information included in a segment header) may be used.
  • the image decoding apparatus 100 may obtain and use syntax related to block shape information or split shape information from the bitstream from the bitstream for each maximum coding unit, reference coding unit, and processing block.
  • the decoder 120 may differently determine the type of division type into which the coding unit may be divided, for each predetermined data unit. According to an embodiment, the decoder 120 of the image decoding apparatus 100 may differently determine a combination of forms in which coding units may be divided for each predetermined data unit (eg, sequence, picture, slice, etc.). .
  • FIG. 23 illustrates coding units that may be determined for each picture when combinations of forms in which coding units may be divided are different for each picture, according to an embodiment.
  • the decoder 120 may differently determine a combination of division forms in which a coding unit may be divided for each picture. For example, the decoder 120 may divide the picture 2300 into four coding units among at least one picture included in the image, and the picture 2310 may be divided into two or four coding units. And a picture 2320 that may be divided into two, three, or four coding units, to decode the image.
  • the decoder 120 may use only division type information indicating that the picture 2300 is divided into four square coding units in order to divide the picture 2300 into a plurality of coding units.
  • the decoder 120 may use only split type information indicating splitting into two or four coding units to split the picture 2310.
  • the decoder 120 may use only partition type information indicating that the picture is divided into two, three, or four coding units in order to divide the picture 2320.
  • the combination of the above-described divisional forms is only an embodiment for explaining the operation of the image decoding apparatus 100. Therefore, the above-described combination of the divisional forms should not be interpreted to be limited to the above-described embodiment, and the division of various forms for each predetermined data unit It is to be understood that combinations of forms may be used.
  • the bitstream acquisition unit 110 of the image decoding apparatus 100 sets an index indicating a combination of segmentation type information from a bitstream for each predetermined data unit unit (eg, sequence, picture, slice, etc.). Can be obtained.
  • the bitstream obtainer 110 obtains an index indicating a combination of segmentation type information from a bitstream in a sequence parameter set, a picture parameter set, or a slice header. can do.
  • the decoder 120 of the image decoding apparatus 100 may determine a combination of division types in which coding units may be divided for each predetermined data unit by using the obtained index, and thus different divisions for each predetermined data unit may be performed. Combinations of forms may be used.
  • FIG. 24 illustrates various forms of coding units that may be determined based on split form information that may be represented by binary codes, according to an embodiment.
  • the image decoding apparatus 100 may divide a coding unit into various forms by using block shape information and segmentation shape information obtained through the bitstream obtainer 110.
  • the form of the coding unit that may be split may correspond to various forms including the forms described through the above-described embodiments.
  • the decoder 120 may split a coding unit having a square shape into at least one of a horizontal direction and a vertical direction based on split shape information, and divide the coding unit having a non-square shape into a horizontal direction. Or it can divide in a vertical direction.
  • the split type information of the square coding unit may be represented.
  • the partition type information may be represented by a 2-digit binary code, and a binary code may be allocated to each partition type.
  • the partition type information when the coding unit is not divided, the partition type information may be represented by (00) b, and when the coding unit is split in the horizontal direction and the vertical direction, the partition type information may be represented by (01) b, When the coding unit is split in the horizontal direction, the split type information may be represented by (10) b, and when the coding unit is split in the vertical direction, the split type information may be represented by (11) b.
  • the type of split type that can be represented by the split type information may be determined according to how many coding units are split. Can be. Referring to FIG. 24, the decoder 120 may split up to three non-square coding units according to an embodiment. The decoder 120 may split the coding unit into two coding units, and in this case, the split type information may be represented by (10) b. The decoder 120 may divide the coding unit into three coding units, and in this case, the split type information may be represented by (11) b.
  • the decoder 120 may determine not to split the coding unit, and in this case, the split type information may be expressed as (0) b. That is, the decoder 120 may use variable length coding (VLC) instead of fixed length coding (FLC) in order to use a binary code indicating split type information.
  • VLC variable length coding
  • FLC fixed length coding
  • a binary code of split type information indicating that a coding unit is not split may be represented by (0) b. If the binary code of the partition type information indicating that the coding unit is not split is set to (00) b, even if there is no partition type information set to (01) b, all of the binary codes of the 2-bit partition type information are included. Should be used. However, as shown in FIG. 24, in the case of using three split types for a non-square coding unit, even if the decoder 120 uses one-bit binary code (0) b as split type information. Since the coding unit can be determined not to be divided, the bitstream can be efficiently used. However, the divided form of the non-square-type coding unit indicated by the divided form information is not limited to only the three forms illustrated in FIG. 24 and should be interpreted in various forms including the embodiments described above.
  • FIG. 25 illustrates another form of a coding unit that may be determined based on split form information that may be represented by a binary code, according to an embodiment.
  • the decoder 120 may split a coding unit having a square shape in a horizontal direction or a vertical direction based on split shape information, and may split the coding unit having a non-square shape in a horizontal direction or a vertical direction.
  • the split type information may indicate that a coding unit having a square shape is split in one direction.
  • the binary code of the split type information indicating that the coding unit of the square type is not split may be represented by (0) b. If the binary code of the partition type information indicating that the coding unit is not split is set to (00) b, even if there is no partition type information set to (01) b, all of the binary codes of the 2-bit partition type information are included. Should be used.
  • the coding unit can determine that is not to be divided, so that the bitstream can be used efficiently.
  • the divided form of the square coding unit represented by the divided form information is not limited to the three forms illustrated in FIG. 25 but should be interpreted in various forms including the embodiments described above.
  • the block type information or the split type information may be represented by using a binary code, and such information may be immediately generated in a bitstream.
  • block type information or partition type information that can be represented by a binary code may be used as a binary code that is not directly generated as a bitstream but input by context adaptive binary arithmetic coding (CABAC).
  • CABAC context adaptive binary arithmetic coding
  • the image decoding apparatus 100 describes a process of obtaining syntax about block type information or partition type information through CABAC.
  • the bitstream obtainer 110 may acquire a bitstream including a binary code for the syntax.
  • the decoder 120 may inverse binarize the bin string included in the obtained bitstream to detect a syntax element representing the block type information or the split type information.
  • the decoder 120 may obtain a set of binary bin strings corresponding to syntax elements to be decoded, and decode each bin using probability information, and the decoder 120 may decode the bin. You can iterate until an empty string consisting of is equal to one of the previously obtained empty strings.
  • the decoder 120 may determine the syntax element by performing inverse binarization of the empty string.
  • the decoder 120 may determine a syntax for an empty string by performing a decoding process of adaptive binary arithmetic coding, and the decoder 120 may obtain a bitstream obtainer 110. ) Can be used to update the probability model for the acquired bins.
  • the bitstream obtaining unit 110 of the image decoding apparatus 100 may obtain from a bitstream indicating a binary code indicating segmentation type information, according to an exemplary embodiment.
  • the decoder 120 may determine the syntax of the partition type information by using the obtained binary code having a size of 1 bit or 2 bits.
  • the decoder 120 may update the probability of each bit of the 2-bit binary code to determine the syntax of the partition type information. That is, the decoder 120 may update the probability of having a value of 0 or 1 when decoding the next bin, depending on which value of the first bin is 0 or 1 in the 2-bit binary code.
  • the decoder 120 may update a probability for bins used in decoding bins of an empty string for syntax, and the decoder 120 may update the bin. It may be determined that a specific bit of the string has the same probability without updating the probability.
  • the decoder 120 does not split the coding unit having a non-square shape.
  • the syntax of the partition type information may be determined using one bin having a value of 0. That is, when the block type information indicates that the current coding unit is a non-square type, the first bin of the empty string for the split type information is 0 when the coding unit of the non-square type is not divided, and two or three It may be 1 when it is divided into coding units. Accordingly, the probability that the first bin of the empty string of the split form information for the non-square coding unit is 0 may be 1/3, and the probability that 1 is 2/3.
  • the decoder 120 may represent only one bit of an empty string having a value of 0, the decoder 120 may indicate the split type information. Only when the first bin of 1 is 1, the syntax of the partition type information may be determined by determining whether the second bin is 0 or 1. FIG. According to an embodiment, when the first bin for the partition type information is 1, the decoder 120 may decode the bins as having a probability that the second bin is 0 or 1 with the same probability.
  • the image decoding apparatus 100 may use various probabilities for each bin in the process of determining the bin of the bin string for the split type information.
  • the decoder 120 may differently determine a probability of a bin with respect to partition type information according to the direction of the non-square block.
  • the decoder 120 may differently determine a probability of a bin with respect to the split shape information according to the width or the length of the long side of the current coding unit.
  • the decoder 120 may differently determine a probability of a bin with respect to the split shape information according to at least one of a shape of a current coding unit and a length of a long side.
  • the decoder 120 may determine the same probability of bins for the partition type information for coding units having a predetermined size or more. For example, based on the length of the long side of the coding unit, it may be determined that the coding units having a size of 64 samples or more have the same probability of bins for the split shape information.
  • the decoder 120 may determine an initial probability of bins constituting an empty string of split type information based on a slice type (eg, I slice, P slice, or B slice).
  • a slice type eg, I slice, P slice, or B slice.
  • 26 is a block diagram of an image encoding and decoding system for performing loop filtering.
  • the encoding stage 2610 of the image encoding and decoding system 2600 transmits an encoded bitstream of an image, and the decoding stage 2650 receives and decodes the bitstream to output a reconstructed image.
  • the encoding stage 2610 may have a configuration similar to that of the image encoding apparatus 260 which will be described later, and the decoding stage 2650 may have a configuration similar to the image decoding apparatus 100.
  • the prediction encoder 2615 outputs a reference image through inter prediction and intra prediction, and the transform and quantization unit 2620 quantizes the residual data between the reference image and the current input image. Quantize this to output it.
  • the entropy encoder 2625 encodes and transforms the quantized transform coefficients and outputs the bitstream.
  • the quantized transform coefficients are reconstructed as data in the spatial domain through the inverse quantization and inverse transform unit 2630, and the reconstructed spatial domain data is output as a reconstructed image through the deblocking filtering unit 2635 and the loop filtering unit 2640. do.
  • the reconstructed image may be used as a reference image of the next input image through the prediction encoder 2615.
  • the encoded image data in the bitstream received by the decoder 2650 is reconstructed as residual data in the spatial domain through the entropy decoder 2655 and the inverse quantization and inverse transform unit 2660.
  • the reference image and the residual data output from the predictive decoder 2675 are combined to form image data of the spatial domain, and the deblocking filter 2665 and the loop filter 2670 filter the image data of the spatial domain.
  • the reconstructed image of the current original image can be output by performing.
  • the reconstructed image may be used as the reference image for the next original image by the prediction decoder 2475.
  • the loop filtering unit 2640 of the encoder 2610 performs loop filtering using the filter information input according to a user input or system setting.
  • the filter information used by the loop filter 2640 is output to the entropy encoder 2610 and transmitted to the decoder 2650 together with the encoded image data.
  • the loop filter 2670 of the decoder 2650 may perform loop filtering based on filter information input from the decoder 2650.
  • FIG. 27 is a diagram illustrating an example of filtering units included in a maximum coding unit and filtering performance information of a filtering unit, according to an embodiment.
  • the data filtering unit of the loop filtering unit 2040 of the encoding end 2010 and the loop filtering unit 2070 of the decoding end 2050 is similar to the coding unit according to the above-described embodiment through FIGS. 9 to 11.
  • the filter information may include block type information and split type information of a data unit to indicate a filtering unit, and loop filtering performance information indicating whether to perform loop filtering on the filtering unit.
  • the filtering units included in the maximum coding unit 2700 may have the same block form and split form as the coding units included in the maximum coding unit 2700. Also, the filtering units included in the maximum coding unit 2700 may be split based on the sizes of the coding units included in the maximum coding unit 2700. For example, with reference to FIG. 27, the filtering units include square-shaped filtering units 2740 of depth D, non-square-shaped filtering units 2732 and 2734 of depth D, and square-shaped filtering units of depth D + 1.
  • Block shape information, split shape information (depth), and loop filtering performance information of the filtering units included in the maximum coding unit 2700 may be encoded as shown in Table 1 below.
  • a process of determining a plurality of coding units by recursively dividing coding units according to block shape information and block splitting information according to an embodiment is as described above with reference to FIG. 19.
  • Loop filtering performance information of the filtering units according to an embodiment indicates that loop filtering is performed on the corresponding filtering unit when the flag value is 1 and loop filtering is not performed on the corresponding filtering unit.
  • all data unit information for determining a filtering unit to be filtered by the loop filtering units 2640 and 2670 may be encoded and transmitted as filter information.
  • coding units configured according to an embodiment are coding units configured in a form of minimizing an error with an original image, it is expected that spatial correlation is high in the coding unit. Therefore, since the filtering unit is determined based on the coding unit according to an embodiment, the operation of determining the filtering unit separately from the determination of the coding unit may be omitted. Accordingly, since information for determining the division type of the filtering unit may be omitted by determining the filtering unit based on the coding unit, the transmission bit rate of the filter information may be saved.
  • the filtering unit is determined to be determined based on the coding unit according to an embodiment.
  • the filtering unit is split based on the coding unit, and the filtering unit is further divided up to the corresponding depth without further dividing at any depth.
  • the shape of may be determined.
  • the determination of the filtering unit disclosed in the above-described embodiments may be applied to various embodiments, such as deblocking filtering and adaptive loop filtering, as well as loop filtering.
  • the image decoding apparatus 100 may split a current coding unit by using at least one of block shape information and split shape information, and the block shape information is previously determined to use only a square shape and the split shape information. May be determined in advance as not to divide or to indicate splitting into four square coding units. That is, in the current coding unit, according to the block shape information, the coding unit always has a square shape, and may be divided into four coding units having no square or four square shapes based on the split shape information.
  • the image decoding apparatus 100 may obtain the bitstream generated by using the predetermined encoding method by using only the block form and the split form, through the bitstream obtainer 110, and the decoder 120 may Only predetermined block types and split types may be used.
  • the image decoding apparatus 100 may solve the compatibility problem with the predetermined encoding method by using the predetermined decoding method similar to the predetermined encoding method.
  • the image decoding apparatus 100 uses the above-described predetermined decoding method using only a predetermined block shape and a split shape among various types that can be represented by the block shape information and the split shape information, the block shape information may be Since only the square shape is represented, the image decoding apparatus 100 may omit the process of acquiring block shape information from the bitstream.
  • a syntax indicating whether to use the above-described predetermined decoding method may be used, and the syntax may include a bitstream for each data unit of various types that may include a plurality of coding units such as a sequence, a picture, a slice unit, and a maximum coding unit. Can be obtained from. That is, the bitstream obtaining unit 110 may determine whether to obtain a syntax indicating the block type information from the bitstream based on the syntax indicating whether a predetermined decoding method is used.
  • 29 illustrates an index according to a Z scan order of coding units, according to an embodiment.
  • the image decoding apparatus 100 may scan the lower data units included in the upper data unit in the Z scan order. Also, the image decoding apparatus 100 according to an embodiment may sequentially access data according to a Z scan index in a maximum coding unit or a coding unit included in a processing block.
  • the image decoding apparatus 100 may split the reference coding unit into at least one coding unit.
  • square coding units and non-square coding units may be mixed in the reference coding unit.
  • the image decoding apparatus 100 according to an embodiment may perform data access according to a Z scan index included in each coding unit in a reference coding unit. In this case, the method of applying the Z scan index may be different depending on whether a non-square type coding unit exists in the reference coding unit.
  • coding units having a lower depth in the reference coding unit may have consecutive Z scan indices.
  • the coding units of the higher depths may include four coding units of the lower depths.
  • the coding units of the four lower depths may be adjacent to each other, and the coding units of the lower depths may be scanned in the Z scan order according to an index indicating the Z scan order.
  • an index indicating a Z scan order may be set to a number that increases according to the Z scan order for each coding unit. In this case, scanning units according to depths of the same depth may be scanned according to a Z scan order.
  • the image decoding apparatus 100 divides the coding units in the reference coding unit into subblocks, respectively, A scan according to the Z scan order may be performed on the blocks. For example, when a coding unit having a non-square shape in the vertical direction or the horizontal direction exists in the reference coding unit, the Z scan may be performed using the divided subblocks. Also, for example, when splitting is performed in odd coding units within a reference coding unit, a Z scan may be performed using subblocks. The sub block is obtained by dividing a coding unit that is no longer split or an arbitrary coding unit, and may have a square shape. For example, four square subblocks may be split from a square coding unit. Also, for example, two square subblocks may be split from a non-square coding unit.
  • the image decoding apparatus 100 may perform a Z scan order on coding units 2902, 2904, 2906, 2908, and 2910 of a lower depth in a coding unit 2900. You can scan according to. Coding units 2900 and coding units 2902, 2904, 2906, 2908, and 2910 are relatively higher coding units and lower coding units, respectively.
  • the coding unit 2900 includes coding units 2906 and 2910 of a non-square shape in a horizontal direction. These non-square shaped coding units 2906 and 2910 are discontinuous at boundaries with adjacent square shaped coding units 2902 and 2904.
  • the coding unit 2908 has a square shape, and a coding unit having a non-square shape is an encoding unit located in the middle when the odd-numbered coding units are divided into odd numbers.
  • the coding unit 2908 has a discontinuous boundary with the adjacent square coding units 2902 and 2904. If coding units 2900 include non-square coding units 2906 and 2910 or non-square coding units are divided into odd numbered coding units 2908, the coding units 2908 may be included.
  • a continuous Z scan index cannot be set because adjacent boundaries are discontinuous. Therefore, the image decoding apparatus 100 may continuously set the Z scan index by dividing coding units into subblocks. Also, the image decoding apparatus 100 may perform a continuous Z scan on the non-square coding units 2906 and 2910 or the coding unit 2908 located in the middle of the odd-numbered non-square coding units. Can be done.
  • the coding unit 2920 illustrated in FIG. 29 is obtained by dividing the coding units 2902, 2904, 2906, 2908, and 2910 in the coding unit 2900 into subblocks. Since the Z scan index may be set for each of the sub blocks, and adjacent boundaries between the sub blocks are continuous, the sub blocks may be scanned according to the Z scan order.
  • the coding unit 2908 may be divided into subblocks 2922, 2924, 2926, and 2928.
  • the sub blocks 2922 and 2924 may be scanned after the data processing for the sub block 2930, and the sub blocks 2926 and 2928 may be scanned after the data processing for the sub block 2932.
  • each of the sub blocks may be scanned according to the Z scan order.
  • scanning according to the Z scan order for the data units may be for data storage, data loading, data access, and the like.
  • the data units can be scanned according to the Z scan order, but the scanning order of the data units includes various scan orders such as raster scan, N scan, right upward diagonal scan, horizontal scan, and vertical scan. It can be performed as, and not limited to the Z scan order.
  • the target of the scanning may be a maximum coding unit or any block in a processing block. have.
  • the scan is performed according to the Z scan order by dividing into sub-blocks only when there is at least one non-square type block, but the non-square type is provided for simplified implementation. Even if a block of s does not exist, the sub blocks may be divided to perform a scan according to the Z scan order.
  • the image decoding apparatus 100 may generate prediction data by performing inter prediction or intra prediction on a coding unit, and generate residual data by performing inverse transform on a transform unit included in a current coding unit.
  • the current coding unit may be reconstructed using the generated prediction data and the residual data.
  • the prediction mode of the coding unit may be at least one of an intra mode, an inter mode, and a skip mode. According to an embodiment, a prediction mode may be independently selected for each coding unit.
  • inter mode prediction and intra mode prediction may be performed separately for each coding unit.
  • a skip mode may be applied to coding units of 2NxN or Nx2N form according to an embodiment.
  • the image decoding apparatus 100 may be allowed to perform bi-prediction in a skip mode of an 8x4 or 4x8 type coding unit.
  • the image decoding apparatus 100 may increase the decoding efficiency by allowing bidirectional prediction for a coding unit to which a skip mode is applied.
  • the image decoding apparatus 100 allows bidirectional prediction for 8x4 or 4x8 type coding units, but sets the number of interpolation taps to be relatively small in the motion compensation step to efficiently use the memory bandwidth.
  • an interpolation filter of less than 8 taps eg, a 2-tap interpolation filter
  • the image decoding apparatus 100 may divide the region included in the current coding unit into a predetermined form (for example, diagonal based division) to signal intra or inter prediction information on each divided region. You may.
  • the image decoding apparatus 100 may obtain a prediction sample of the current coding unit using an intra mode by using a neighboring sample of the current coding unit. At this time, intra prediction performs prediction using surrounding reconstructed samples, which are called reference samples.
  • FIG. 30 is a diagram illustrating a reference sample for intra prediction of a coding unit, according to an embodiment.
  • a current coding unit 3000 having a non-square block shape for a current coding unit 3000 having a non-square block shape, a horizontal length w and a vertical length h, w + h reference samples 3002 at the top, A total of 2 (w + h) +1 reference samples are required, one w + h reference sample 3004 on the left and one reference reference 3003 on the upper left.
  • padding may be performed on a portion where a reference sample does not exist, and a reference mode filtering process for each prediction mode may be performed to reduce quantization error included in the reconstructed reference sample.
  • the number of reference samples when the block shape of the current coding unit is a non-square shape has been described.
  • the number of the reference samples is equally applied even when the current coding unit is a block shape of a rectangular shape.
  • the encoder 220 may determine at least one coding unit for dividing an image, and the bitstream generator 210 may determine split shape information, block shape information, and the like in the process of determining at least one coding unit.
  • the encoder 220 may be configured to encode an image using the predetermined information for generating a bitstream including the same predetermined information.
  • the encoder 220 of the image encoding apparatus 200 may determine at least one coding unit for dividing an image based on at least one of block shape information and split shape information, and may encode the image encoder 200.
  • the bitstream generator 210 may generate a bitstream including at least one of such block type information and split type information.
  • the block shape information may mean information or syntax indicating a shape of a coding unit
  • the split shape information may mean information or syntax indicating a shape in which a coding unit is split.
  • the encoder 220 of the image encoding apparatus 200 may determine a shape of a coding unit.
  • the coding unit may be square or have a non-square shape, and information representing such a shape may be included in the block shape information.
  • the encoder 220 may determine how to split the coding unit.
  • the encoder 220 may determine the form of at least one coding unit included in the coding unit, and the bitstream generator 210 may generate a bitstream including split form information including information about the shape of the coding unit. Can be generated.
  • the encoder 220 may determine whether a coding unit is divided or not. When the encoder 220 determines that only one coding unit is included in the coding unit or that the coding unit is not split, the bitstream generator 210 includes split type information indicating that the coding unit is not split. A bitstream can be generated. Also, the encoder 220 may split the plurality of coding units included in the coding unit, and the bitstream generator 210 may divide the bitstream including the split type information indicating that the coding unit is divided into a plurality of coding units. Can be generated.
  • information indicating how many coding units to divide or in which direction to split coding units may be included in split type information.
  • the split type information may indicate splitting in at least one of a vertical direction and a horizontal direction or may not split.
  • FIG. 9 illustrates a process of determining, by the image encoding apparatus 200, at least one coding unit by dividing a current coding unit according to an embodiment.
  • the encoder 220 may determine a shape of a coding unit. For example, the encoder 220 may determine a shape of a coding unit having an optimal RD-cost in consideration of a rate distortion (RD) cost.
  • RD rate distortion
  • the encoder 220 may determine that the current coding unit is in a square shape, and thus, determine a shape in which the coding unit having a square shape is divided. For example, the encoder 220 may determine whether to split a square coding unit, to split vertically, to split horizontally, or to split into four coding units. Referring to FIG. 9, the encoder 220 does not divide a coding unit 910a having the same size as the current coding unit 900, or splits coding units based on split type information indicating a predetermined splitting method ( 910b, 910c, 910d, etc.) may be determined.
  • a predetermined splitting method 910b, 910c, 910d, etc.
  • the encoder 220 may determine two coding units 910b obtained by dividing the current coding unit 900 in the vertical direction.
  • the encoder 220 may determine two coding units 910c obtained by dividing the current coding unit 900 in the horizontal direction.
  • the encoder 220 may determine four coding units 910d obtained by dividing the current coding unit 900 in the vertical direction and the horizontal direction.
  • the divided form in which the square coding unit may be divided should not be limited to the above-described form and may include various forms represented by the divided form information. Certain division forms in which a square coding unit is divided will be described in detail with reference to various embodiments below.
  • the bitstream generator 210 of the image encoding apparatus 200 may generate a bitstream including split shape information indicating a shape in which a current coding unit 900 is split by the encoder 220. Can be.
  • FIG. 10 illustrates a process of determining, by the image encoding apparatus 200, at least one coding unit by dividing a coding unit having a non-square shape according to an embodiment.
  • the encoder 220 may determine whether to split the current coding unit of the non-square or whether to split the current coding unit in a predetermined method.
  • the encoder 220 of the current coding unit 1000 or 1050 does not divide a coding unit 1010 or 1060 having the same size as the current coding unit 1000 or 1050 or a predetermined division method.
  • the divided coding units 1020a, 1020b, 1030a, 1030b, 1030c, 1070a, 1070b, 1080a, 1080b, and 1080c may be determined according to the divided coding units.
  • the bitstream generator 210 of the image encoding apparatus 200 may generate a bitstream including split type information indicating the split type.
  • a predetermined division method in which a non-square coding unit is divided will be described in detail with reference to various embodiments below.
  • the encoder 220 may determine a form in which a coding unit is divided. Referring to FIG. 10, the encoder 220 may divide the current coding unit 1000 or 1050 to determine two coding units 1020a, 1020b, or 1070a, 1070b included in the current coding unit, and generate a bitstream. The unit 210 may generate a bitstream including split type information indicating the split type.
  • the encoder 220 may consider the position of the long side of the current coding unit 1000 or 1050 in the non-square. Coding units may be split. For example, the encoder 220 divides the current coding unit 1000 or 1050 in a direction of dividing a long side of the current coding unit 1000 or 1050 in consideration of the shape of the current coding unit 1000 or 1050. A plurality of coding units may be determined, and the bitstream generator 210 may generate a bitstream including split type information indicating the split type.
  • the encoder 220 may determine an odd number of coding units included in the current coding unit 1000 or 1050. For example, the encoder 220 may divide the current coding unit 1000 or 1050 into three coding units 1030a, 1030b, 1030c, 1080a, 1080b, and 1080c. According to an embodiment, the encoder 220 may determine an odd number of coding units included in the current coding unit 1000 or 1050, and not all sizes of the determined coding units may be the same.
  • the size of a predetermined coding unit 1030b or 1080b among the determined odd coding units 1030a, 1030b, 1030c, 1080a, 1080b, and 1080c is different from other coding units 1030a, 1030c, 1080a, and 1080c. May have That is, a coding unit that may be determined by dividing the current coding unit 1000 or 1050 may have a plurality of types, and in some cases, odd number of coding units 1030a, 1030b, 1030c, 1080a, 1080b, and 1080c Each may have a different size.
  • the encoder 220 may determine an odd number of coding units included in the current coding unit 1000 or 1050, and further, the encoder 220 may divide at least one of the odd number of coding units generated by splitting. A predetermined limit may be placed on the coding unit of. Referring to FIG. 10, the encoder 220 may determine a coding unit positioned at the center of three coding units 1030a, 1030b, 1030c, 1080a, 1080b, and 1080c generated by dividing a current coding unit 1000 or 1050. The decoding process for 1030b and 1080b may be different from other coding units 1030a, 1030c, 1080a and 1080c.
  • the encoder 220 restricts the coding units 1030b and 1080b positioned at the center from being split any more, unlike the other coding units 1030a, 1030c, 1080a, and 1080c, or splits only a predetermined number of times. You can limit it.
  • FIG. 11 illustrates a process of splitting a coding unit by the image encoding apparatus 200 according to an embodiment.
  • the image encoding apparatus 200 may determine to divide or not split the determined second coding unit 1110 into coding units based on at least one of block shape information and split shape information.
  • the encoder 220 may perform at least a second coding unit 1110 having a non-square shape determined by dividing the first coding unit 1100 based on at least one of block shape information and split shape information.
  • One third coding unit (1120a, 1120b, 1120c, 1120d, etc.) may be split or the second coding unit 1110 may not be split.
  • the bitstream generator 210 of the image encoding apparatus 200 may generate a bitstream including at least one of block type information and split type information, and the encoder 220 may generate at least one of block type information and split type information.
  • the first coding unit 1100 may be divided based on one to divide a plurality of second coding units (eg, 1110) of various types, and the second coding unit 1110 may include block shape information and a split shape.
  • the first coding unit 1100 may be split based on at least one piece of information according to a split scheme.
  • the second The coding unit 1110 may also be divided into third coding units (eg, 1120a, 1120b, 1120c, 1120d, etc.) based on at least one of the block shape information and the split shape information of the second coding unit 1110. have. Therefore, a square coding unit may be determined in a non-square coding unit, and a coding unit of a square shape may be recursively divided to determine a coding unit of a non-square shape. Referring to FIG.
  • a predetermined coding unit (eg, located in the center of an odd number of third coding units 1120b, 1120c, and 1120d determined by splitting a second coding unit 1110 having a non-square shape) may be included. Coding unit or a coding unit having a square shape) may be recursively divided. According to an embodiment, the third coding unit 1120c having a square shape, which is one of odd third coding units 1120b, 1120c, and 1120d, may be divided in a horizontal direction and divided into a plurality of fourth coding units. The fourth coding unit 1140 having a non-square shape, which is one of the plurality of fourth coding units, may be divided into a plurality of coding units. For example, the fourth coding unit 1140 having a non-square shape may be further divided into odd coding units 1150a, 1150b, and 1150c.
  • the coding unit may be recursively divided based on at least one of the split form information and the block form information associated with each coding unit.
  • a method that can be used for recursive division of coding units will be described later through various embodiments.
  • the encoder 220 splits each of the third coding units 1120a, 1120b, 1120c, 1120d, etc. into coding units based on at least one of the block shape information and the split shape information, or the second coding unit. It may be determined not to divide 1110.
  • the encoder 220 may split the second coding unit 1110 having a non-square shape into an odd number of third coding units 1120b, 1120c, and 1120d, according to an exemplary embodiment.
  • the image encoding apparatus 200 may place a predetermined limit on a predetermined third coding unit among the odd number of third coding units 1120b, 1120c, and 1120d.
  • the image encoding apparatus 200 may be limited to the number of coding units 1120c positioned in the middle of the odd number of third coding units 1120b, 1120c, and 1120d, or may be divided by a set number of times. It can be limited to.
  • the image encoding apparatus 200 may include a coding unit positioned at the center among odd-numbered third coding units 1120b, 1120c, and 1120d included in a second coding unit 1110 having a non-square shape.
  • 1120c is no longer divided, is limited to being divided into a predetermined division form (for example, only divided into four coding units or divided into a form corresponding to the divided form of the second coding unit 1110), or predetermined It can be limited to dividing only by the number of times (eg, dividing only n times, n> 0).
  • a predetermined division form for example, only divided into four coding units or divided into a form corresponding to the divided form of the second coding unit 1110
  • predetermined It can be limited to dividing only by the number of times (eg, dividing only n times, n> 0).
  • the coding unit 1120c located in the center is merely a mere embodiment, it should not be construed as being limited to the above-described embodiments, and the coding unit 1120c located in the center may have different coding units 1120b and 1120d. ), It should be interpreted as including various restrictions that can be decoded.
  • the bitstream generator 210 may include a bitstream associated with a sample (eg, a sample 1240 located at the center) of a predetermined position among a plurality of samples included in the current coding unit 1200.
  • a bitstream including at least one of block shape information and split shape information of the current coding unit 1200 may be generated.
  • a predetermined position in the current coding unit 1200 associated with at least one of the block shape information and the split form information should not be interpreted as being limited to the center position shown in FIG. 12, and the predetermined position may be included in the current coding unit 1200. It should be construed that various positions (eg, top, bottom, left, right, top left, bottom left, top right or bottom right, etc.) may be included.
  • the image encoding apparatus 200 may select one coding unit from among them. Methods for selecting one of a plurality of coding units may vary, which will be described below through various embodiments.
  • the encoder 220 of the image encoding apparatus 200 may divide a current coding unit into a plurality of coding units, and determine a coding unit of a predetermined position.
  • FIG. 12 illustrates a method for the image encoding apparatus 200 to determine a coding unit at a predetermined position among odd-numbered coding units according to an embodiment.
  • the encoder 220 may use information indicating the position of each of the odd coding units to determine a coding unit located in the middle of the odd coding units.
  • the encoder 220 may divide the current coding unit 1200 to determine odd number of coding units 1220a, 1220b, and 1220c.
  • the encoder 220 may determine the center coding unit 1220b by using information about the positions of the odd number of coding units 1220a, 1220b, and 1220c. For example, the encoder 220 determines the positions of the coding units 1220a, 1220b, and 1220c based on information indicating the positions of predetermined samples included in the coding units 1220a, 1220b, and 1220c.
  • the coding unit 1220b may be determined.
  • the encoder 220 may determine the positions of the coding units 1220a, 1220b, and 1220c based on information indicating the positions of the samples 1230a, 1230b, and 1230c in the upper left of the coding units 1220a, 1220b, and 1220c. By determining, the coding unit 1220b located in the center may be determined.
  • the information indicating the positions of the samples 1230a, 1230b, and 1230c in the upper left included in the coding units 1220a, 1220b, and 1220c may be located in the pictures of the coding units 1220a, 1220b, and 1220c. Or it may include information about the coordinates. According to an embodiment, the information indicating the positions of the samples 1230a, 1230b, and 1230c in the upper left included in the coding units 1220a, 1220b, and 1220c, respectively, may be included in the coding units 1220a and 1220b.
  • the coding unit 1220b positioned in the center may be determined.
  • the information indicating the position of the sample 1230a at the upper left of the upper coding unit 1220a may indicate (xa, ya) coordinates, and the sample 1230b at the upper left of the middle coding unit 1220b.
  • the information indicating the position of) may indicate the (xb, yb) coordinates, and the information indicating the position of the sample 1230c on the upper left of the lower coding unit 1220c may indicate the (xc, yc) coordinates.
  • the image encoding apparatus 200 may determine the center coding unit 1220b using the coordinates of the samples 1230a, 1230b, and 1230c of the upper left included in the coding units 1220a, 1220b, and 1220c, respectively.
  • the coordinates indicating the positions of the samples 1230a, 1230b, and 1230c at the upper left may indicate coordinates indicating the absolute positions in the picture, and further, the positions of the samples 1230a at the upper left of the upper coding unit 1220a.
  • the (dxb, dyb) coordinate which is the information indicating the relative position of the sample 1230b at the upper left of the center coding unit 1220b, and the relative position of the sample 1230c at the upper left of the lower coding unit 1220c.
  • Information (dxc, dyc) coordinates can also be used.
  • the method of determining the coding unit of a predetermined position by using the coordinates of the sample as information indicating the position of the sample included in the coding unit should not be interpreted to be limited to the above-described method, and various arithmetic operations that can use the coordinates of the sample It should be interpreted in a way.
  • the image encoding apparatus 200 may divide the current coding unit 1200 into a plurality of coding units 1220a, 1220b, and 1220c, and may predetermined reference among the coding units 1220a, 1220b, and 1220c. According to the coding unit can be selected. For example, the encoder 220 may select coding units 1220b having different sizes from among the coding units 1220a, 1220b, and 1220c.
  • the image encoding apparatus 200 may have (xa, ya) coordinates, information indicating a position of the sample 1230a on the upper left side of the upper coding unit 1220a, and a sample on the upper left side of the center coding unit 1220b.
  • Coding unit 1220a using the (xb, yb) coordinate which is the information indicating the position of 1230b and the (xc, yc) coordinate which is the information indicating the position of the sample 1230c of the upper left of the lower coding unit 1220c. 1220b, 1220c) can determine the width or height of each.
  • the image encoding apparatus 200 uses (xa, ya), (xb, yb), and (xc, yc) coordinates indicating the positions of the coding units 1220a, 1220b, and 1220c. ) Each size can be determined.
  • the image encoding apparatus 200 may determine the width of the upper coding unit 1220a as xb-xa and the height as yb-ya. According to an embodiment, the encoder 220 may determine the width of the center coding unit 1220b as xc-xb and the height as yc-yb. According to an embodiment, the encoder 220 may determine the width or height of the lower coding unit using the width or height of the current coding unit, and the width and height of the upper coding unit 1220a and the center coding unit 1220b. The encoder 220 may determine a coding unit having a different size from other coding units based on the width and the height of the determined coding units 1220a, 1220b, and 1220c.
  • the image encoding apparatus 200 may determine a coding unit 1220b as a coding unit having a predetermined position while having a size different from that of the upper coding unit 1220a and the lower coding unit 1220c.
  • the coding unit at a predetermined position is determined using the size of the coding unit determined based on the sample coordinates.
  • various processes of determining a coding unit at a predetermined position by comparing the sizes of coding units determined according to predetermined sample coordinates may be used.
  • the position of the sample to be considered for determining the position of the coding unit should not be interpreted as being limited to the upper left side described above, but may be interpreted that information on the position of any sample included in the coding unit may be used.
  • the image encoding apparatus 200 may select a coding unit of a predetermined position among odd-numbered coding units determined by dividing the current coding unit in consideration of the shape of the current coding unit. For example, if the current coding unit is a non-square shape having a width greater than the height, the encoder 220 may determine the coding unit at a predetermined position in the horizontal direction. That is, the encoder 220 may determine one of the coding units having different positions in the horizontal direction and place a restriction on the corresponding coding unit. If the current coding unit has a non-square shape having a height greater than the width, the encoder 220 may determine a coding unit at a predetermined position in the vertical direction. That is, the encoder 220 may determine one of the coding units having different positions in the vertical direction to limit the corresponding coding unit.
  • the image encoding apparatus 200 may use information indicating the positions of each of the even coding units in order to determine the coding unit of the predetermined position among the even coding units.
  • the encoder 220 may determine the even number of coding units by dividing the current coding unit and determine the coding unit of the predetermined position by using information about the positions of the even number of coding units.
  • a detailed process thereof may be similar to the process of determining a coding unit of a predetermined position (for example, a middle position) among the odd coding units described above with reference to FIG.
  • a predetermined method used in the splitting process of the current coding unit to determine a coding unit of a predetermined position among the plurality of coding units Information is available.
  • the encoder 220 of the image encoding apparatus 200 may determine predetermined information used in the process of dividing the current coding unit in order to determine a coding unit positioned among the coding units in which the current coding unit is divided into a plurality. At least one of block type information and split type information may be used as the above information.
  • the encoder 220 of the image encoding apparatus 200 may split the current coding unit 1200 into a plurality of coding units 1220a, 1220b, and 1220c, and may include a plurality of coding units 1220a. , 1220b and 1220c may determine a coding unit 1220b located in the center, the bitstream generator 210 is at least one of the block shape information and the partition shape information used in the split process of the current coding unit 1200 It may generate a bitstream comprising a.
  • the encoder 220 may consider a location of a sample associated with at least one bitstream among the block shape information and the partition shape information used in the splitting process of the current coding unit 1200, and select the coding unit 1220b located in the center. You can decide. That is, a bitstream including at least one of block type information and split type information of the current coding unit 1200 may be generated together with a bitstream associated with a sample 1240 positioned in the center of the current coding unit 1200. In this case, the encoder 220 may determine the coding unit 1220 b including the sample 1240 as the coding unit located in the center of the plurality of coding units 1220a, 1220b, and 1220c.
  • the information used to determine the coding unit located in the center among the plurality of coding units determined by dividing the current coding unit is limited to at least one of block shape information and split shape information used in the splitting process of the current coding unit. It should not be, but various kinds of information may be used.
  • the process of determining the coding unit of the predetermined position by the image encoding apparatus 200 is opposite to the process of the image decoding apparatus 100 determining the coding unit of the predetermined position among a plurality of coding units determined from the current coding unit. Since the process may be a detailed description thereof will be omitted.
  • the image encoding apparatus 200 may determine at least one coding unit by dividing a current coding unit, and determine an order in which the at least one coding unit is decoded in a predetermined block (for example, the current coding unit). Can be determined according to
  • FIG. 13 illustrates an order in which a plurality of coding units are processed when the image encoding apparatus 200 determines a plurality of coding units by dividing a current coding unit.
  • the process of processing the plurality of coding units by the image encoding apparatus 200 related to FIG. 13 may be similar to the operation of the image decoding apparatus 100 described above with reference to FIG. 13, and thus a detailed description thereof will be omitted.
  • FIG. 14 illustrates a process of determining that a current coding unit is divided into an odd number of coding units when the image encoding apparatus 200 may not process the coding units in a predetermined order, according to an embodiment.
  • the encoder 220 of the image encoding apparatus 200 may determine that the current coding unit is divided into an odd number of coding units, and the bitstream generator 210 indicates a form of the current coding unit.
  • a bitstream including block type information and split type information indicating a split type of the current coding unit (divided into odd numbers) may be generated.
  • a first coding unit 1400 having a square shape may be divided into second coding units 1410a and 1410b having a non-square shape, and each of the second coding units 1410a and 1410b may be independently formed. It may be divided into three coding units 1420a, 1420b, 1420c, 1420d, and 1420e.
  • the encoder 220 may determine a plurality of third coding units 1420a and 1420b by dividing the left coding unit 1410a in the horizontal direction among the second coding units, and may include the right coding unit 1410b. May be divided into odd third coding units 1420c, 1420d, and 1420e.
  • the process of determining that the current coding unit is divided into an odd number of coding units by the image encoding apparatus 200 related to FIG. 14 may be a process opposite to that of the image decoding apparatus 100 described above with reference to FIG. 14. Detailed description will be omitted.
  • FIG. 15 illustrates that the image encoding apparatus 200 determines at least one coding unit by dividing the first coding unit 1500 according to an embodiment.
  • the encoder 220 may divide the first coding unit 1500, and the bitstream generator 210 may block information indicating the shape of the first coding unit 1500 and the first encoding.
  • a bitstream including at least one of split type information indicating a split type of the unit 1500 may be generated.
  • the first coding unit 1500 having a square shape may be divided into coding units having four square shapes, or may be divided into a plurality of coding units having a non-square shape. For example, referring to FIG.
  • the encoder 220 may split the first coding unit 1500 into a plurality of non-square coding units, and in this case, the bitstream generator 210 may include the first coding unit 1500.
  • the coding unit 1500 may generate a bitstream including block shape information indicating a square and split shape information indicating that the first coding unit 1500 is divided into non-square coding units.
  • the encoder 220 is a second coding unit 1510a, 1510b, or 1510c determined by dividing the first coding unit 1500 having a square shape in the vertical direction as an odd number of coding units, or by dividing the first coding unit 1500 in the horizontal direction. 2 coding units 1520a, 1520b, and 1520c.
  • the bitstream generator 210 divides the first coding unit 1500 in a horizontal direction or a vertical direction to determine an odd number of coding units.
  • a bitstream including split type information indicating may be generated.
  • the process of determining the at least one coding unit by dividing the first coding unit 1500 by the image encoding apparatus 200 related to FIG. 15 is opposite to the operation of the image decoding apparatus 100 described above with reference to FIG. 15. The detailed description will be omitted since this may be a process.
  • FIG. 16 illustrates that the second coding unit is split when the second coding unit having a non-square shape determined by splitting the first coding unit 1600 according to an embodiment satisfies a predetermined condition. It shows that the form that can be limited.
  • the encoder 220 may determine that the first coding unit 1600 having a square shape is divided into second coding units 1610a, 1610b, 1620a, and 1620b having a non-square shape.
  • the second coding units 1610a, 1610b, 1620a, and 1620b may be split independently. Accordingly, the encoder 220 may determine whether to split each of the second coding units 1610a, 1610b, 1620a, and 1620b into a plurality of coding units or not.
  • An operation of restricting a form in which a second coding unit having a non-square form satisfies a predetermined condition by the image encoding apparatus 200 related to FIG. 16 may be limited to the image decoding apparatus 100 described above with reference to FIG. 16. ) May be the opposite of the operation, so detailed description thereof will be omitted.
  • FIG. 17 illustrates a process of splitting a coding unit having a square shape by the image encoding apparatus 200 when the split shape information cannot be divided into four square coding units.
  • the operation of the image encoding apparatus 200 in this regard may be the reverse of the operation of the image decoding apparatus 100 described above with reference to FIG. 17, a detailed description thereof will be omitted.
  • FIG. 18 illustrates that a processing order between a plurality of coding units may vary according to a division process of coding units, according to an embodiment.
  • the encoder 220 may divide the first coding unit 1800 having a square shape into at least one of a horizontal direction and a vertical direction.
  • the bitstream generator 210 determines that the block shape information indicating that the first coding unit 1800 is square and the first coding unit 1800 are split into at least one of a horizontal direction and a vertical direction.
  • a bitstream including split type information indicating may be generated.
  • the encoder 220 may divide the first coding unit 1800 to determine a second coding unit (for example, 1810a, 1810b, 1820a, 1820b, 1830a, 1830b, 1830c, 1830d, etc.). have.
  • second coding units 1810a, 1810b, 1820a, and 1820b of a non-square shape determined by splitting the first coding unit 1800 only in the horizontal direction or the vertical direction may be split independently.
  • the encoder 220 divides the second coding units 1810a and 1810b generated by splitting the first coding unit 1800 in the vertical direction, respectively, in the horizontal direction, to thereby separate the third coding units 1816a, 1816b, and 1816c.
  • FIG. 19 is a diagram illustrating a process of determining a depth of a coding unit according to an embodiment when a coding unit is recursively divided and a plurality of coding units are determined.
  • the process of determining the depth of the coding unit by the encoder 220 of the image encoding apparatus 200 may include determining that the depth of the coding unit is determined by the decoder 120 of the image decoding apparatus 100 described above with reference to FIG. 19. The detailed description may be omitted since it may be contrary to the process.
  • the image encoding apparatus 200 may determine whether the image encoding apparatus is divided into a specific division type based on a value of an index for distinguishing a plurality of coding units determined by dividing from the current coding unit. Referring to FIG. 20, the image encoding apparatus 200 determines an even number of coding units 2012a and 2012b by dividing a first coding unit 2010 having a height greater than a width, or an odd number of coding units 2014a and 2014b. , 2014c). The image encoding apparatus 200 may use an index (PID) indicating each coding unit to distinguish each of the plurality of coding units.
  • PID index
  • the PID may be obtained from a sample (eg, an upper left sample) at a predetermined position of each coding unit. Since the operation of the image encoding apparatus 200 related to FIG. 20 may be opposite to that of the image decoding apparatus 100 described above with reference to FIG. 20, a detailed description thereof will be omitted.
  • the encoder 220 may use the above-described reference coding unit as a predetermined data unit in which recursive division of the coding unit starts.
  • the operation of the image encoding apparatus 200 using the reference coding unit in relation to FIG. 21 may be the opposite of the operation of the image decoding apparatus 100 described above with reference to FIG. 21 using the reference coding unit. Do it.
  • the bitstream generator 210 of the image encoding apparatus 200 may include a bitstream including at least one of information about a shape of a reference coding unit and information about a size of a reference coding unit, in the various data units. It can be generated every time.
  • a process of determining at least one coding unit included in the reference coding unit 2100 having a square shape is described above by splitting the current coding unit 300 of FIG. 9, and referring to the reference coding unit 2100 having a non-square shape. Since the process of determining at least one coding unit included in the above) is described above through the process of splitting the current coding unit 400 or 450 of FIG. 10, a detailed description thereof will be omitted.
  • the encoder 220 may determine an index for identifying the size and shape of the reference coding unit in order to determine the size and shape of the reference coding unit according to some data unit that is predetermined based on a predetermined condition. It is available. That is, the bitstream generator 210 may select a predetermined condition (for example, a data unit having a size less than or equal to a slice) among the various data units (for example, a sequence, a picture, a slice, a slice segment, and a maximum coding unit). For each data unit that satisfies, a bitstream including an index for identifying the size and shape of the reference coding unit may be generated.
  • a predetermined condition for example, a data unit having a size less than or equal to a slice
  • the various data units for example, a sequence, a picture, a slice, a slice segment, and a maximum coding unit.
  • the encoder 220 may determine the size and shape of the reference data unit for each data unit satisfying the predetermined condition by using the index.
  • a reference related to an index indicating the size and shape of the reference coding unit may be used.
  • At least one of the size and shape of the coding unit may be predetermined. That is, the encoder 220 determines at least one of the size and shape of the reference coding unit included in the data unit that is the index acquisition reference by selecting at least one of the predetermined size and shape of the reference coding unit according to the index. Can be. Since an operation of the encoder 220 using an index for identifying the size and shape of the reference coding unit may be similar to that of the decoder 120 described above, a detailed description thereof will be omitted.
  • FIG. 22 is a diagram of a processing block serving as a reference for determining a determination order of a reference coding unit included in a picture 2200.
  • the encoder 220 may obtain information about the size of the processing block and determine the size of at least one processing block included in the image.
  • the encoder 220 may determine the size of at least one processing block included in the image, and the bitstream generator 210 may generate a bitstream including information about the size of the processing block.
  • the size of such a processing block may be a predetermined size of a data unit indicated by the information about the size of the processing block.
  • the bitstream generator 210 of the image encoding apparatus 200 may generate a bitstream including information about a size of a processing block for each specific data unit.
  • a bitstream including information on the size of a processing block may be generated for each data unit such as an image, a sequence, a picture, a slice, and a slice segment. That is, the bitstream generator 210 may generate a bitstream including information about the size of the processing block for each of the various data units, and the encoder 220 may use the information about the size of the processing block.
  • a size of at least one processing block for dividing a picture may be determined, and the size of the processing block may be an integer multiple of a reference coding unit.
  • the encoder 220 may determine the sizes of the processing blocks 2202 and 2212 included in the picture 2200. For example, the encoder 220 may determine the size of the processing block based on the information about the size of the processing block. Referring to FIG. 22, the encoder 220 determines a horizontal size of the processing blocks 2202 and 2212 to be four times the horizontal size of the reference coding unit and four times the vertical size of the reference coding unit, according to an exemplary embodiment. Can be. The encoder 220 may determine an order in which at least one reference coding unit is determined in at least one processing block. Since the operation of the encoder 220 related to the processing block may be similar to that of the decoder 120 described above with reference to FIG. 22, a detailed description thereof will be omitted.
  • the bitstream generator 210 of the image encoding apparatus 200 generates a bitstream including block shape information indicating a shape of a current coding unit or split shape information indicating a method of splitting a current coding unit. can do.
  • Block type information or split type information may be included in a bitstream associated with various data units.
  • the bitstream generator 210 of the image encoding apparatus 200 may include a sequence parameter set, a picture parameter set, a video parameter set, and a slice header. header, block type information or split type information included in a slice segment header may be used.
  • the bitstream generator 210 of the image encoding apparatus 200 may generate a bitstream including syntax indicating block type information or split type information for each maximum coding unit, reference coding unit, and processing block.
  • the encoder 220 may differently determine the type of division type into which the coding unit may be divided, for each predetermined data unit. According to an embodiment, the encoder 220 of the image encoding apparatus 200 may differently determine a combination of forms in which coding units may be divided for each predetermined data unit (eg, sequence, picture, slice, etc.). .
  • FIG. 23 illustrates coding units that may be determined for each picture when combinations of forms in which coding units may be divided are different for each picture, according to an embodiment.
  • the encoder 220 may differently determine a combination of division forms in which a coding unit may be divided for each picture.
  • the encoder 220 may include a picture 2300 that may be divided into four coding units among at least one picture included in an image, and a picture 2310 that may be divided into two or four coding units. And a picture 2320 that may be divided into two, three, or four coding units, to decode the image.
  • the encoder 220 may divide the picture 2300 into four square coding units.
  • the encoder 220 may divide the picture 2310 into two or four coding units.
  • the encoder 220 may divide the picture 2320 into two, three, or four coding units.
  • the encoder 220 of the image encoding apparatus 200 may determine a combination of division types that may be divided into coding units for each predetermined data unit by using an index indicating a combination of division type information. As a result, a combination of different partition types may be used for each predetermined data unit. Furthermore, the bitstream generator 210 of the image encoding apparatus 200 may generate a bitstream including an index indicating a combination of segmentation type information for each data unit (eg, sequence, picture, slice, etc.). Can be. For example, the bitstream generator 210 may include bits for a sequence parameter set, a picture parameter set, or a slice header including an index indicating a combination of segmentation type information. You can create a stream.
  • 24 and 25 illustrate various types of coding units that may be determined based on split type information that may be represented by binary codes, according to an exemplary embodiment.
  • the encoder 220 of the image encoding apparatus 200 may divide a coding unit into various forms, and include a bitstream including block shape information and segmentation shape information through the bitstream generator 210. Can be generated.
  • the form of the coding unit that may be split may correspond to various forms including the forms described through the above-described embodiments. Referring to FIG. 24, the encoder 220 may divide a square coding unit into at least one of a horizontal direction and a vertical direction based on the split shape information, and divide the coding unit having a non-square shape into a horizontal direction. Or it can divide in a vertical direction.
  • a feature of the binary code of the segmentation information that may be used by the image encoding apparatus 200 may correspond to the feature of the image decoding apparatus 100 described above with reference to FIGS. 24 and 25, and thus, a detailed description thereof will be omitted.
  • the image encoding apparatus 200 may generate prediction data by performing inter prediction or intra prediction on a coding unit, and generate residual data by performing inverse transform on a transform unit included in a current coding unit.
  • the current coding unit may be encoded by using the generated prediction data and the residual data.
  • the prediction mode of the coding unit may be at least one of an intra mode, an inter mode, and a skip mode. According to an embodiment, prediction may be independently performed for each coding unit, and thus a prediction mode having the smallest error may be selected.
  • inter mode prediction and intra mode prediction may be performed separately for each coding unit.
  • the encoder 220 of the image encoding apparatus 200 may not only apply a coding unit to a square form but also use a CU skip mode to encode the coding unit using a non-square form. Can be encoded.
  • the non-square coding unit can be decoded using the CU skip mode. By enabling the use of the adaptive skip mode, the image encoding / decoding efficiency can be improved. Since the feature of the image encoding apparatus 200 using the skip mode in the non-square coding unit may be similar to the above-described feature in connection with the use of the skip mode of the image encoding apparatus 200, a detailed description thereof will be omitted.
  • FIG. 28 illustrates a process of merging or splitting between coding units determined according to a predetermined encoding method, according to an embodiment.
  • the image encoding apparatus 200 may determine coding units for dividing a picture using the above-described predetermined encoding method. For example, the image encoding apparatus 200 may determine a coding unit of the current depth or split it into four coding units of a lower depth based on split information of the coding unit. As described above, the image encoding apparatus 200 according to an embodiment may include block shape information indicating that the current coding unit always has a square shape, and indicate that the current coding unit is not split or to four coding units having a square shape. The coding unit may be determined using split type information that may indicate splitting. Referring to FIG. 28, pictures 2800 and 2820 may be divided according to square coding units determined according to the above-described predetermined coding method.
  • the image encoding apparatus 200 encodes the decoding for the small object 2821 by dividing the first coding unit 2822 into four coding units having four lower depths in order to reconstruct the small object 2821. The unit can be determined.
  • the large object 2823 is not included in the current coding unit 2822, the large object 2823 is not suitable to be decoded using the current coding unit 2822, and further, to decode the small object 2821. Since the coding unit 2822 is divided, it is inefficient because a process of splitting an unnecessary coding unit must be performed for decoding the large object 2823. That is, if the image encoding apparatus 200 may use one coding unit to encode a portion of the large object 2823, image encoding may be efficiently performed.
  • the encoder 220 of the image encoding apparatus 200 may split a current coding unit by using at least one of block shape information and split shape information, and the block shape information uses only a square shape in advance.
  • the split type information may be determined in advance to indicate that the split type information is not split or may be split into four square coding units. This may correspond to a coding unit determination process used in the above-described predetermined encoding method through various embodiments.
  • the encoder 220 may use a sample value included in the picture to merge the coding units determined using the predetermined coding method with each other or to split the coding units determined. For example, the encoder 220 may detect various objects included in the picture by examining a portion having similar sample values, and performs a merge / split process of coding units based on the portions of the detected objects. Can be done.
  • the encoder 220 may determine a plurality of coding units for dividing the picture 2800 using the above-described predetermined encoding method. However, even though the portion 2801 having similar sample values included in the picture exists, a process of dividing the similar region into a plurality of coding units instead of one coding unit may be performed. In this case, even if the coding unit is determined through a predetermined coding method, the encoder 220 may merge the coding units into one coding unit 2802 and encode the coding unit as one coding unit. Referring to FIG.
  • the encoder 220 may split the coding unit 2822 for encoding the small object 2821 into four coding units by using the predetermined encoding method described above. have. In the case of the divided coding units, since the detected large object 2823 may not be included in all, the encoder 220 may merge the coding units into one coding unit including a portion having a similar sample value (2825). .
  • the encoder 220 determines a coding unit by using a predetermined coding method that does not divide a coding unit or divides the coding unit into four coding units by using split information of the coding unit, and then includes a sample included in the picture.
  • the coding unit may be divided again in consideration of the sample values. That is, the encoder 120 may split not only the merged coding units but also the previously determined coding units in order to determine the coding units for each object. Referring to FIG. 28, the encoder 120 may merge coding units for the object 2823, and the coding unit merged for the object 2823 to determine the coding unit optimized for the object 2823. Can be divided again (2826). In other words, the encoder 220 may determine a portion in which the object 2823 is not included as a coding unit 2827 separate from the object 2823 through the splitting process 2826.
  • the image decoding apparatus may decode the image by performing the image decoding method corresponding to the reverse operation of the image encoding method after obtaining from the bitstream.
  • 29 illustrates an index according to a Z scan order of coding units, according to an embodiment.
  • the encoder 220 of the image encoding apparatus 200 may scan the lower data units included in the upper data unit in the Z scan order. Also, the image encoding apparatus 200 according to an embodiment may sequentially access data according to a Z scan index in a maximum coding unit or a coding unit included in a processing block.
  • the encoder 220 of the image encoding apparatus 200 according to an embodiment may split the reference coding unit into at least one coding unit, as described above with reference to FIGS. 9 through 10. In this case, square coding units and non-square coding units may be mixed in the reference coding unit. Since the image encoding apparatus 200 may have a feature similar to that of the image decoding apparatus 100 described above with reference to FIG. 29, the index of the index according to the Z scan order of the coding unit will be omitted.
  • the above-described embodiments of the present invention can be written as a program that can be executed in a computer, and can be implemented in a general-purpose digital computer that operates the program using a computer-readable recording medium.
  • the computer-readable recording medium may include a storage medium such as a magnetic storage medium (eg, a ROM, a floppy disk, a hard disk, etc.) and an optical reading medium (eg, a CD-ROM, a DVD, etc.).

Landscapes

  • Engineering & Computer Science (AREA)
  • Multimedia (AREA)
  • Signal Processing (AREA)
  • Physics & Mathematics (AREA)
  • Discrete Mathematics (AREA)
  • General Physics & Mathematics (AREA)
  • Compression Or Coding Systems Of Tv Signals (AREA)

Abstract

일 실시예에 따라 영상을 복호화 하는 방법에 있어서, 현재 부호화 단위의 블록 형태 정보에 기초하여 상기 영상을 분할하는 적어도 하나의 부호화 단위를 결정하는 단계, 상기 적어도 하나의 부호화 단위에 포함되는 현재 부호화 단위의 형태에 기초하여, 적어도 하나의 변환 단위를 결정하는 단계 및 상기 적어도 하나의 변환 단위에 기초하여 역변환을 수행함으로써 상기 영상을 복호화 하는 단계를 포함하고, 상기 블록 형태 정보는 상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 것을 특징으로 하는 영상 복호화 방법이 제공될 수 있다. 상술한 복호화 방법에 대응되는 부호화 방법이 제공될 수 있다. 또한 상술한 부호화 또는 복호화 방법을 수행할 수 있는 부호화 장치 또는 복호화 장치가 제공될 수도 있다.

Description

영상을 부호화/복호화 하는 방법 및 그 장치
일 실시예에 따른 방법 및 장치는 영상에 포함되는 다양한 데이터 단위를 이용하여, 영상을 부호화 또는 복호화 할 수 있다.
영상 데이터는 소정의 데이터 압축 표준, 예를 들면 MPEG(Moving Picture Expert Group) 표준에 따른 코덱에 의하여 부호화된 후 비트스트림의 형태로 기록매체에 저장되거나 통신 채널을 통해 전송된다.
고해상도 또는 고화질 영상 컨텐트를 재생, 저장할 수 있는 하드웨어의 개발 및 보급에 따라, 고해상도 또는 고화질 영상 컨텐트를 효과적으로 부호화 또는 복호화 하는 코덱(codec)의 필요성이 증대하고 있다. 부호화된 영상 컨텐트는 복호화됨으로써 재생될 수 있다. 최근에는 이러한 고해상도 또는 고화질 영상 컨텐트를 효과적으로 압축하기 위한 방법들이 실시되고 있다. 예를 들면, 부호화 하려는 영상을 임의적 방법으로 처리하는 과정을 통한 효율적 영상 압축 방법이 실시되고 있다.
영상을 압축하기 위하여 다양한 데이터 단위가 이용될 수 있으며 이러한 데이터 단위들 간에 포함관계가 존재할 수 있다. 이러한 영상 압축에 이용되는 데이터 단위의 크기를 결정하기 위해 다양한 방법에 의해 데이터 단위가 분할될 수 있으며 영상의 특성에 따라 최적화된 데이터 단위가 결정됨으로써 영상의 부호화 또는 복호화가 수행될 수 있다.
종래의 압축방식의 경우, 픽쳐에 포함되는 부호화 단위의 크기를 결정하는 과정에서 분할할지 여부를 결정한 후 획일적으로 4개의 동일한 크기의 부호화 단위들로 분할하는 재귀적 분할 과정을 통해 정사각형의 부호화 단위들을 결정하였다.
하지만 최근 고해상도의 영상에 대한 수요가 급증하고 영상 재생에 필요한 데이터량이 많아지는 상황에서, 효율적인 영상 부호화 및 복호화 과정을 수행할 것을 요함과 동시에, 정사각형이라는 획일적인 형태의 부호화 단위 또는 변환 단위의 이용에 의해 야기되는 복원 영상의 화질열화가 문제되고 있다.
일 실시예에 따라 영상을 복호화 하는 방법에 있어서, 현재 부호화 단위의 블록 형태 정보에 기초하여 상기 영상을 분할하는 적어도 하나의 부호화 단위를 결정하는 단계, 상기 적어도 하나의 부호화 단위에 포함되는 현재 부호화 단위의 형태에 기초하여, 적어도 하나의 변환 단위를 결정하는 단계 및 상기 적어도 하나의 변환 단위에 기초하여 역변환을 수행함으로써 상기 영상을 복호화 하는 단계를 포함하고, 상기 블록 형태 정보는 상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 것을 특징으로 하는 영상 복호화 방법이 제공될 수 있다.
일 실시예에 따라 영상을 복호화 하는 장치에 있어서, 현재 부호화 단위의 블록 형태 정보를 획득하는 비트스트림 획득부 및 상기 블록 형태 정보에 기초하여 상기 영상을 분할하는 적어도 하나의 부호화 단위를 결정하고, 상기 적어도 하나의 부호화 단위에 포함되는 현재 부호화 단위의 형태에 기초하여, 적어도 하나의 변환 단위를 결정하고, 상기 적어도 하나의 변환 단위에 기초하여 역변환을 수행함으로써 상기 영상을 복호화 하는 복호화부를 포함하고, 상기 블록 형태 정보는 상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 것을 특징으로 하는 영상 복호화 장치가 제공될 수 있다.
일 실시예에 따라 영상을 부호화 하는 방법에 있어서, 상기 영상을 분할하는 적어도 하나의 부호화 단위를 결정하는 단계, 상기 적어도 하나의 부호화 단위에 포함되는 현재 부호화 단위의 형태에 기초하여, 적어도 하나의 변환 단위를 결정하는 단계, 상기 적어도 하나의 변환 단위에 기초하여 변환을 수행함으로써 상기 영상을 부호화 하는 단계 및 상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 블록 형태 정보 및 상기 부호화된 영상을 포함하는 비트스트림을 생성하는 단계를 포함하는 영상 부호화 방법이 제공될 수 있다.
일 실시예에 따라 영상을 부호화 하는 장치에 있어서, 상기 영상을 분할하는 적어도 하나의 부호화 단위를 결정하고, 상기 적어도 하나의 부호화 단위에 포함되는 현재 부호화 단위의 형태에 기초하여, 적어도 하나의 변환 단위를 결정하고, 상기 적어도 하나의 변환 단위에 기초하여 변환을 수행함으로써 상기 영상을 부호화 하는 부호화부 및 상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 블록 형태 정보 및 상기 부호화된 영상을 포함하는 비트스트림을 생성하는 비트스트림 생성부를 포함하는 영상 부호화 장치가 제공될 수 있다.
부호화 단위의 형태에 기초하여 결정되는 다양한 형태의 변환 단위를 영상의 부호화 및 복호화 과정에서 이용할 수 있음에 따라, 영상의 특성에 적응적인 변환 단위를 이용할 수 있고 이에 따라 효율적인 영상 부호화 및 복호화가 가능하고 복원 영상의 화질 향상이 가능하다.
도 1은 일 실시예에 따라 영상을 분할하는 부호화 단위에 포함되는 변환 단위에 기초하여 영상을 복호화 하는 영상 복호화 장치에 대한 블록도를 도시한다.
도 2는 일 실시예에 따라 영상을 분할하는 부호화 단위에 포함되는 변환 단위에 기초하여 영상을 부호화 하는 영상 부호화 장치에 대한 블록도를 도시한다.
도 3a 및 도 3b는 일 실시예에 따라 정사각형 형태의 현재 부호화 단위에서 결정될 수 있는 다양한 형태의 변환 단위를 도시한다.
도 4a, 도 4b, 도 4c는 일 실시예에 따라 비-정사각형 형태의 현재 부호화 단위에서 결정될 수 있는 다양한 형태의 변환 단위를 도시한다.
도 5는 일 실시예에 따라 현재 부호화 단위의 크기와 변환 단위의 최대 크기의 비교 결과에 기초하여 현재 부호화 단위에 포함되는 복수개의 변환 단위를 결정하는 과정을 도시한다.
도 6은 일 실시예에 따라 변환 단위가 가질 수 있는 형태의 조합이 소정의 데이터 단위마다 다를 수 있는 특징을 설명하기 위한 도면이다.
도 7은 일 실시예에 따라 휘도 성분 및 색차 성분 마다 결정될 수 있는 최소 크기의 변환 단위를 도시한다.
도 8은 일 실시예에 따라 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정하는 과정에서 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득하는 과정을 설명하기 위한 도면이다.
도 9는 일 실시예에 따라 현재 부호화 단위가 분할되어 적어도 하나의 부호화 단위가 결정되는 과정을 도시한다.
도 10은 일 실시예에 따라 비-정사각형의 형태인 부호화 단위가 분할되어 적어도 하나의 부호화 단위가 결정되는 과정을 도시한다.
도 11은 일 실시예에 따라 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 부호화 단위가 분할되는 과정을 도시한다.
도 12는 일 실시예에 따라 홀수개의 부호화 단위들 중 소정의 부호화 단위가 결정되는 방법을 도시한다.
도 13은 일 실시예에 따라 현재 부호화 단위가 분할되어 복수개의 부호화 단위들이 결정되는 경우, 복수개의 부호화 단위들이 처리되는 순서를 도시한다.
도 14는 일 실시예에 따라 소정의 순서로 부호화 단위가 처리될 수 없는 경우, 현재 부호화 단위가 홀수개의 부호화 단위로 분할되는 것으로 결정되는 과정을 도시한다.
도 15는 일 실시예에 따라 제1 부호화 단위가 분할되어 적어도 하나의 부호화 단위가 결정되는 과정을 도시한다.
도 16은 일 실시예에 따라 제1 부호화 단위가 분할되어 결정된 비-정사각형 형태의 제2 부호화 단위가 소정의 조건을 만족하는 경우, 제2 부호화 단위가 분할될 수 있는 형태가 제한되는 것을 도시한다.
도 17은 일 실시예에 따라 분할 형태 정보가 4개의 정사각형 형태의 부호화 단위로 분할하는 것을 나타낼 수 없는 경우, 정사각형 형태의 부호화 단위가 분할되는 과정을 도시한다
도 18은 일 실시예에 따라 복수개의 부호화 단위들 간의 처리 순서가 부호화 단위의 분할 과정에 따라 달라질 수 있음을 도시한 것이다.
도 19는 일 실시예에 따라 부호화 단위가 재귀적으로 분할되어 복수개의 부호화 단위가 결정되는 경우, 부호화 단위의 형태 및 크기가 변함에 따라 부호화 단위의 심도가 결정되는 과정을 도시한다.
도 20은 일 실시예에 따라 부호화 단위들의 형태 및 크기에 따라 결정될 수 있는 심도 및 부호화 단위 구분을 위한 인덱스(part index, 이하 PID)를 도시한다.
도 21은 일 실시예에 따라 픽쳐에 포함되는 복수개의 소정의 데이터 단위에 따라 복수개의 부호화 단위들이 결정된 것을 도시한다.
도 22는 일 실시예에 따라 픽쳐에 포함되는 기준 부호화 단위의 결정 순서를 결정하는 기준이 되는 프로세싱 블록을 도시한다.
도 23은 일 실시예에 따라 부호화 단위가 분할될 수 있는 형태의 조합이 픽쳐마다 서로 다른 경우, 각각의 픽쳐마다 결정될 수 있는 부호화 단위들을 도시한다.
도 24는 일 실시예에 따라 바이너리(binary)코드로 표현될 수 있는 분할 형태 정보에 기초하여 결정될 수 있는 부호화 단위의 다양한 형태를 도시한다.
도 25는 일 실시예에 따라 바이너리 코드로 표현될 수 있는 분할 형태 정보에 기초하여 결정될 수 있는 부호화 단위의 또 다른 형태를 도시한다.
도 26은 루프 필터링을 수행하는 영상 부호화 및 복호화 시스템의 블록도를 나타낸 도면이다.
도 27은 일 실시예에 따른 최대 부호화 단위에 포함되는 필터링 단위들의 일례와 필터링 단위의 필터링 수행 정보를 나타낸 도면이다.
도 28은 일 실시예에 따라 소정의 부호화 방법에 따라 결정된 부호화 단위들 간의 병합(merge) 또는 분할(split)이 수행되는 과정을 도시한다.
도 29는 일 실시예에 따른 부호화 단위의 Z 스캔 순서에 따른 인덱스를 도시한다.
도 30은 일 실시예에 따른 부호화 단위의 인트라 예측을 위한 참조 샘플을 나타내는 도면이다.
일 실시예에 따라, 영상을 복호화 하는 방법에 있어서, 현재 부호화 단위의 블록 형태 정보에 기초하여 상기 영상을 분할하는 적어도 하나의 부호화 단위를 결정하는 단계, 상기 적어도 하나의 부호화 단위에 포함되는 현재 부호화 단위의 형태에 기초하여, 적어도 하나의 변환 단위를 결정하는 단계 및 상기 적어도 하나의 변환 단위에 기초하여 역변환을 수행함으로써 상기 영상을 복호화 하는 단계를 포함하고, 상기 블록 형태 정보는 상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 것을 특징으로 하는 영상 복호화 방법이 제공될 수 있다.
일 실시예에 따라, 적어도 하나의 변환 단위를 결정하는 단계는 현재 변환 단위를 분할할지 여부를 나타내는 정보인 변환 단위의 분할 정보를 비트스트림으로부터 획득하는 단계 및 상기 획득한 변환 단위의 분할 정보가, 상기 현재 변환 단위는 복수개의 변환 단위로 분할됨을 나타내는 경우, 상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지에 기초하여 상기 현재 부호화 단위에 포함되는 복수개의 변환 단위를 결정하는 단계를 포함할 수 있다.
일 실시예에 따라, 복수개의 변환 단위를 결정하는 단계는 상기 현재 부호화 단위가 정사각형 형태인 경우, 정사각형 형태의 복수개의 변환 단위를 결정하는 단계 및 상기 현재 부호화 단위가 비-정사각형 형태인 경우, 상기 현재 부호화 단위를 수직 방향 또는 수평 방향으로 분할하여 복수개의 변환 단위를 결정하는 단계를 포함할 수 있다.
일 실시예에 따라, 적어도 하나의 변환 단위를 결정하는 단계는 변환 단위의 최대 크기보다 상기 현재 부호화 단위의 크기가 큰 경우, 상기 현재 부호화 단위에 포함되는 복수개의 상기 최대 크기의 변환 단위를 결정하는 단계를 더 포함할 수 있다.
일 실시예에 따라, 영상 복호화 방법은 변환 단위의 최대 크기에 대한 정보 및 최소 크기에 대한 정보 중 적어도 하나를 비트스트림으로부터 획득하는 단계를 더 포함할 수 있다.
일 실시예에 따라, 영상 복호화 방법은 상기 적어도 하나의 변환 단위가 가질 수 있는 블록 형태에 대한 정보를 비트스트림으로부터 획득하는 단계를 더 포함할 수 있다.
일 실시예에 따라, 적어도 하나의 변환 단위를 결정하는 단계는 상기 영상의 색차(chroma) 샘플을 복호화 하기 위한 상기 현재 부호화 단위의 크기가 상기 적어도 하나의 변환 단위의 최소 크기보다 작은 경우, 상기 최소 크기 이상의 크기를 갖는 상기 적어도 하나의 변환 단위를 결정하는 단계를 더 포함할 수 있다
일 실시예에 따라, 영상 복호화 방법은 상기 적어도 하나의 변환 단위의 심도는 상기 적어도 하나의 변환 단위의 긴 변의 길이에 기초하여 심도가 결정되는 것을 특징으로 할 수 있다.
일 실시예에 따라, 적어도 하나의 변환 단위를 결정하는 단계는 변환 단위의 분할 과정에서 결정되는 현재 심도의 변환 단위 내에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 단계를 더 포함하고, 상기 영상을 복호화 하는 단계는, 상기 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 이용하여 상기 영상을 복호화 하는 단계를 포함할 수 있다.
일 실시예에 따라, 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 단계는, 상기 현재 부호화 단위의 형태, 상기 현재 부호화 단위에 상기 영상의 색차 성분이 포함되는지 여부, 상기 현재 부호화 단위에서 이용되는 인트라 예측이 수행되는지 여부 및 상기 현재 부호화 단위에 포함되는 변환 단위의 개수 중 적어도 하나에 기초하여 상기 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 단계를 포함할 수 있다.
일 실시예에 따라, 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 단계는, 상기 현재 부호화 단위의 형태가 비-정사각형인 경우, 상기 현재 심도의 변환 단위가 더 이상 분할되지 않을 때에 한해 상기 현재 심도의 변환 단위 내에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 단계를 포함할 수 있다.
일 실시예에 따라 영상을 복호화 하는 단계는 상기 적어도 하나의 변환 단위의 형태에 기초하여 컨텍스트 인덱스를 결정하는 단계 및 상기 결정된 컨텍스트 인덱스에 기초하여 상기 영상을 복호화 하는 단계를 포함할 수 있다.
일 실시예에 따라 영상을 복호화 하는 장치에 있어서, 현재 부호화 단위의 블록 형태 정보를 획득하는 비트스트림 획득부 및 상기 블록 형태 정보에 기초하여 상기 영상을 분할하는 적어도 하나의 부호화 단위를 결정하고, 상기 적어도 하나의 부호화 단위에 포함되는 현재 부호화 단위의 형태에 기초하여, 적어도 하나의 변환 단위를 결정하고, 상기 적어도 하나의 변환 단위에 기초하여 역변환을 수행함으로써 상기 영상을 복호화 하는 복호화부를 포함하고, 상기 블록 형태 정보는 상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 것을 특징으로 하는 영상 복호화 장치가 제공될 수 있다.
일 실시예에 따라 영상을 부호화 하는 방법에 있어서, 상기 영상을 분할하는 적어도 하나의 부호화 단위를 결정하는 단계, 상기 적어도 하나의 부호화 단위에 포함되는 현재 부호화 단위의 형태에 기초하여, 적어도 하나의 변환 단위를 결정하는 단계, 상기 적어도 하나의 변환 단위에 기초하여 변환을 수행함으로써 상기 영상을 부호화 하는 단계 및 상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 블록 형태 정보 및 상기 부호화된 영상을 포함하는 비트스트림을 생성하는 단계를 포함하는 영상 부호화 방법이 제공될 수 있다.
일 실시예에 따라 영상을 부호화 하는 장치에 있어서, 상기 영상을 분할하는 적어도 하나의 부호화 단위를 결정하고, 상기 적어도 하나의 부호화 단위에 포함되는 현재 부호화 단위의 형태에 기초하여, 적어도 하나의 변환 단위를 결정하고, 상기 적어도 하나의 변환 단위에 기초하여 변환을 수행함으로써 상기 영상을 부호화 하는 부호화부 및 상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 블록 형태 정보 및 상기 부호화된 영상을 포함하는 비트스트림을 생성하는 비트스트림 생성부를 포함하는 영상 부호화 장치가 제공될 수 있다.
본 발명의 이점 및 특징, 그리고 그것들을 달성하는 방법은 첨부되는 도면과 함께 후술되어 있는 실시예들을 참조하면 명확해질 것이다. 그러나 본 발명은 이하에서 개시되는 실시예들에 한정되는 것이 아니라 서로 다른 다양한 형태로 구현될 수 있으며, 단지 본 실시예들은 본 발명의 개시가 완전하도록 하고, 본 발명이 속하는 기술분야에서 통상의 지식을 가진 자에게 발명의 범주를 완전하게 알려주기 위해 제공되는 것이며, 본 발명은 청구항의 범주에 의해 정의될 뿐이다.
본 명세서에서 사용되는 용어에 대해 간략히 설명하고, 본 발명에 대해 구체적으로 설명하기로 한다.
본 발명에서 사용되는 용어는 본 발명에서의 기능을 고려하면서 가능한 현재 널리 사용되는 일반적인 용어들을 선택하였으나, 이는 관련 분야에 종사하는 기술자의 의도 또는 판례, 새로운 기술의 출현 등에 따라 달라질 수 있다. 또한, 특정한 경우는 출원인이 임의로 선정한 용어도 있으며, 이 경우 해당되는 발명의 설명 부분에서 상세히 그 의미를 기재할 것이다. 따라서 본 발명에서 사용되는 용어는 단순한 용어의 명칭이 아닌, 그 용어가 가지는 의미와 본 발명의 전반에 걸친 내용을 토대로 정의되어야 한다.
본 명세서에서의 단수의 표현은 문맥상 명백하게 단수인 것으로 특정하지 않는 한, 복수의 표현을 포함한다.
명세서 전체에서 어떤 부분이 어떤 구성요소를 "포함"한다고 할 때, 이는 특별히 반대되는 기재가 없는 한 다른 구성요소를 제외하는 것이 아니라 다른 구성요소를 더 포함할 수 있음을 의미한다. 또한, 명세서에서 사용되는 "부"라는 용어는 소프트웨어, FPGA 또는 ASIC과 같은 하드웨어 구성요소를 의미하며, "부"는 어떤 역할들을 수행한다. 그렇지만 "부"는 소프트웨어 또는 하드웨어에 한정되는 의미는 아니다. "부"는 어드레싱할 수 있는 저장 매체에 있도록 구성될 수도 있고 하나 또는 그 이상의 프로세서들을 재생시키도록 구성될 수도 있다. 따라서, 일 예로서 "부"는 소프트웨어 구성요소들, 객체지향 소프트웨어 구성요소들, 클래스 구성요소들 및 태스크 구성요소들과 같은 구성요소들과, 프로세스들, 함수들, 속성들, 프로시저들, 서브루틴들, 프로그램 코드의 세그먼트들, 드라이버들, 펌웨어, 마이크로 코드, 회로, 데이터, 데이터베이스, 데이터 구조들, 테이블들, 어레이들 및 변수들을 포함한다. 구성요소들과 "부"들 안에서 제공되는 기능은 더 작은 수의 구성요소들 및 "부"들로 결합되거나 추가적인 구성요소들과 "부"들로 더 분리될 수 있다.
이하, "영상"은 비디오의 정지영상와 같은 정적 이미지이거나 동영상, 즉 비디오 그 자체와 같은 동적 이미지를 나타낼 수 있다.
이하 "샘플"은, 영상의 샘플링 위치에 할당된 데이터로서 프로세싱 대상이 되는 데이터를 의미한다. 예를 들어, 공간영역의 영상에서 픽셀값, 변환 영역 상의 변환 계수들이 샘플들일 수 있다. 이러한 적어도 하나의 샘플들을 포함하는 단위를 블록이라고 정의할 수 있다.
아래에서는 첨부한 도면을 참고하여 본 발명의 실시예에 대하여 본 발명이 속하는 기술 분야에서 통상의 지식을 가진 자가 용이하게 실시할 수 있도록 상세히 설명한다. 그리고 도면에서 본 발명을 명확하게 설명하기 위해서 설명과 관계없는 부분은 생략한다.
도 1은 일 실시예에 따라 영상을 분할하는 부호화 단위에 포함되는 변환 단위에 기초하여 영상을 복호화 하는 영상 복호화 장치에 대한 블록도를 도시한다.
도 1을 참조하면, 영상 복호화 장치(100)는 일 실시예에 따라 블록 형태 정보 등과 같은 소정의 정보 또는 신택스를 비트스트림으로부터 획득하기 위한 비트스트림 획득부(110), 획득한 정보를 이용하여 영상을 복호화 하기 위한 복호화부(120)를 포함할 수 있다. 일 실시예에 따라 영상 복호화 장치(100)의 비트스트림 획득부(110)에서 블록 형태 정보를 비트스트림으로부터 획득한 경우, 영상 복호화 장치(100)의 복호화부(120)는 블록 형태 정보에 기초하여 영상을 분할하는 적어도 하나의 부호화 단위를 결정할 수 있다. 나아가 영상 복호화 장치의 복호화부(120)는 일 실시예에 따라 적어도 하나의 부호화 단위 중 하나인 현재 부호화 단위의 형태에 기초하여 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 일 실시예에 따라 블록 형태 정보는 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 정보 또는 신택스일 수 있다.
일 실시예에 따라 영상 복호화 장치(100)의 비트스트림 획득부(110)는 변환 단위의 분할 정보를 비트스트림으로부터 획득할 수 있고, 복호화부(120)는 비트스트림으로부터 변환 단위의 분할 정보를 파싱하여 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정하는 데 이용할 수 있다. 일 실시예에 따라 영상 복호화 장치(100)의 복호화부(120)는 변환 단위의 분할 정보가 현재 변환 단위가 복수개의 변환 단위로 분할됨을 나타내는 경우, 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지에 기초하여 현재 부호화 단위에 포함되는 복수개의 변환 단위를 결정할 수 있다. 여기서 현재 변환 단위란, 트리 구조를 가지고 더 이상 이상 분할되지 않는 변환 단위까지 재귀적으로 분할하는 과정에서 이용되는 데이터 블록을 의미할 수 있다. 즉, 현재 변환 단위는 재귀적 분할 과정에서 작은 크기의 복수개의 변환 단위로 분할될지가 결정될 수 있는 다양한 형태 및 크기의 데이터 블록일 수 있다.
일 실시예에 따라 변환 단위의 분할 정보가 현재 변환 단위는 복수개의 변환 단위로 분할됨을 나타내고, 현재 부호화 단위가 정사각형 형태인 경우, 복호화부(120)는 현재 부호화 단위에 포함되는 정사각형 형태의 복수개의 변환 단위를 결정할 수 있다.
일 실시예에 따라 변환 단위의 분할 정보가 현재 변환 단위는 복수개의 변환 단위로 분할됨을 나타내고, 현재 부호화 단위가 비-정사각형 형태인 경우, 복호화부(120)는 현재 부호화 단위를 수직 방향 또는 수평 방향으로 분할하여 복수개의 변환 단위를 결정할 수 있다.
도 3a 및 도 3b는 일 실시예에 따라 정사각형 형태의 현재 부호화 단위에서 결정될 수 있는 다양한 형태의 변환 단위를 도시한다.
도 3a를 참조하면, 영상 복호화 장치(100)의 복호화부(120)는 블록 형태 정보에 기초하여 현재 부호화 단위(300)를 포함하는 적어도 하나의 부호화 단위를 결정할 수 있다. 블록 형태 정보에 기초하여 부호화 단위가 결정되는 과정에 대하여는 후술하는 다양한 실시예를 통해 설명하도록 한다. 결정된 부호화 단위의 형태는 정사각형 형태 또는 비-정사각형 형태일 수 있다. 복호화부(120)는 일 실시예에 따라 현재 부호화 단위(300)의 형태에 기초하여 현재 부호화 단위(300)에 포함될 수 있는 변환 단위의 형태를 결정할 수 있다. 예를 들면 현재 부호화 단위(300)가 2Nx2N의 크기를 가지는 정사각형 형태의 블록이라면, 복호화부(120)는 현재 부호화 단위(300)에 포함되는 적어도 하나의 변환 단위의 형태로서 2Nx2N크기를 가지는 변환 단위(310a), Nx2N크기를 가지는 변환 단위(310b) 또는 2NxN크기를 가지는 변환 단위(310c)를 결정할 수 있다.
도 3b를 참조하면, 영상 복호화 장치(100)의 복호화부(120)는 블록 형태 정보에 기초하여 현재 부호화 단위(350)를 포함하는 적어도 하나의 부호화 단위를 결정할 수 있다. 복호화부(120)는 일 실시예에 따라 정사각형 형태의 현재 부호화 단위(350)의 형태에 기초하여 현재 부호화 단위(350)에 포함될 수 있는 변환 단위의 형태를 결정할 수 있다. 예를 들면 현재 부호화 단위(350)가 2Nx2N의 크기를 가지는 정사각형 형태의 블록이라면, 복호화부(120)는 현재 부호화 단위(300)에 포함되는 적어도 하나의 변환 단위의 형태로서 2Nx2N크기를 가지는 하나의 변환 단위(360a)를 결정하거나, 또는 NxN크기를 가지는 4개의 변환 단위(370b)를 결정할 수 있다.
일 실시예에 따라 복호화부(120)가 정사각형 형태의 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정하는 방법에는 도 3a 및 도 3b를 포함하는 다양한 실시예들이 이용될 수 있으며, 결정될 수 있는 변환 단위의 형태는 실시예들이 조합된 다양한 형태들이 포함될 수 있다.
일 실시예에 따라 비트스트림 획득부(110)는 현재 변환 단위를 분할할지 여부를 나타내는 분할 정보를 비트스트림으로부터 획득할 수 있다. 복호화부(120)는 변환 단위의 분할 정보에 기초하여 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 예를 들면, 획득한 변환 단위의 분할 정보가 현재 변환 단위는 복수개의 변환 단위로 분할됨을 나타내는 경우, 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지에 기초하여 상기 현재 부호화 단위에 포함되는 복수개의 변환 단위를 결정할 수 있다. 현재 부호화 단위의 형태는 현재 부호화 단위와 관련된 블록 형태 정보와 관련된 것일 수 있다.
도 4a, 도 4b, 도 4c는 일 실시예에 따라 비-정사각형 형태의 현재 부호화 단위에서 결정될 수 있는 다양한 형태의 변환 단위를 도시한다.
도 4a를 참조하면, 복호화부(120)는 일 실시예에 따라 높이가 너비보다 긴 비-정사각형 형태의 현재 부호화 단위(400a)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 복호화부(120)는 현재 부호화 단위(400a)에 하나의 변환 단위(410a)가 포함되도록 결정할 수 있고, 수평 방향으로 분할하여 복수개의 변환 단위(420a) 가 포함되도록 결정할 수도 있다. 또 다른 예를 들면, 일 실시예에 따라 너비가 높이보다 긴 비-정사각형 형태의 현재 부호화 단위(450a)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 복호화부(120)는 현재 부호화 단위(450a)에 하나의 변환 단위(460a)가 포함되도록 결정할 수 있고, 수평 방향으로 분할하여 복수개의 변환 단위(470a)가 포함되도록 결정할 수도 있다. 일 실시예에 따라 비-정사각형 형태의 부호화 단위(400a 또는 450a)에서 결정될 수 있는 복수개의 변환 단위(420a 또는 470a)의 형태는 정사각형 형태일 수 있다..
도 4b를 참조하면, 복호화부(120)는 일 실시예에 따라 높이가 너비보다 긴 비-정사각형 형태의 현재 부호화 단위(400b)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 복호화부(120)는 현재 부호화 단위(400b)에 하나의 변환 단위(410b)가 포함되도록 결정할 수 있고, 수평 방향 또는 수직 방향으로 분할하여 복수개의 변환 단위(420b 또는 430b)가 포함되도록 결정할 수도 있다. 또 다른 예를 들면, 일 실시예에 따라 너비가 높이보다 긴 비-정사각형 형태의 현재 부호화 단위(450b)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 복호화부(120)는 현재 부호화 단위(450b)에 하나의 변환 단위(460b)가 포함되도록 결정할 수 있고, 수직 방향 또는 수평 방향으로 분할하여 복수개의 변환 단위(470b 또는 480b)가 포함되도록 결정할 수도 있다.
도 4c를 참조하면, 복호화부(120)는 일 실시예에 따라 높이가 너비보다 긴 비-정사각형 형태의 현재 부호화 단위(400c)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 복호화부(120)는 현재 부호화 단위(400c)에 하나의 변환 단위(410c)가 포함되도록 결정할 수 있고, 수평 방향 또는 수직 방향으로 분할하여 복수개의 변환 단위(420c 또는 430c)가 포함되도록 결정할 수 있고, 수직 방향 및 수평 방향으로 분할하여 복수개의 변환 단위(440c)를 결정할 수도 있다. 또 다른 예를 들면, 일 실시예에 따라 너비가 높이보다 긴 비-정사각형 형태의 현재 부호화 단위(450c)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 복호화부(120)는 현재 부호화 단위(450c)에 하나의 변환 단위(460c)가 포함되도록 결정할 수 있고, 수직 방향 또는 수평 방향으로 분할하여 복수개의 변환 단위(470c 또는 480c)가 포함되도록 결정할 수 있고, 수직 방향 및 수평 방향으로 분할하여 복수개의 변환 단위(490c)가 포함되도록 결정할 수도 있다.
다만, 상술한 적어도 하나의 변환 단위의 형태는 현재 부호화 단위의 형태에 기초하여 변환 단위가 결정될 수 있는 다양한 형태를 실시예로서 설명한 것이므로, 복호화부(120)가 결정할 수 있는 적어도 하나의 변환 단위의 형태의 조합은 상술한 형태에 한정되어서는 안되며 현재 부호화 단위에 포함되는 다양한 종류의 변환 단위의 형태가 포함될 수 있는 것으로 해석되어야 한다.
일 실시예에 따라 복호화부(120)는 현재 부호화 단위의 크기 및 변환 단위의 최대 크기를 비교하여 현재 부호화 단위에 포함되는 복수개의 변환 단위를 결정할 수 있다.
도 5는 일 실시예에 따라 현재 부호화 단위의 크기와 변환 단위의 최대 크기의 비교 결과에 기초하여 현재 부호화 단위에 포함되는 복수개의 변환 단위를 결정하는 과정을 도시한다.
일 실시예에 따라 복호화부(120)는 현재 부호화 단위(500)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있으며, 이러한 변환 단위가 가질 수 있는 최대 크기는 미리 결정되어있을 수 있다. 일 실시예에 따라 복호화부(120)는 현재 부호화 단위(500)와 미리 결정된 최대 크기를 가지는 변환 단위(510)를 비교할 수 있다. 비교 결과 변환 단위의 최대 크기보다 현재 부호화 단위(500)의 크기가 더 큰 경우, 복호화부(120)는 현재 부호화 단위(500)에 포함되는 최대 크기를 갖는 복수개의 변화 단위(520)를 결정할 수 있다. 도 5를 참조하면, 현재 부호화 단위(500)의 크기가 2Nx2N이고, 변환 단위(510)의 최대 크기가 NxN인 경우, 복호화부(120)는 현재 부호화 단위(500)에 포함되는 적어도 하나의 변환 단위를 결정하기 위한 과정과 함께 현재 부호화 단위(500)에 포함되는 최대 크기의 변환 단위(520)로 분할할 수 있다. 즉, 복호화부(120)는 최대 크기의 변환 단위보다 큰 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정하기 위해서, 현재 부호화 단위에 포함되는 복수개의 최대 크기의 변환 단위를 결정한 후, 최대 크기의 변환 단위 각각을 더 작은 크기의 변환 단위들로 분할할지 여부를 결정할 수 있다.
일 실시예에 따라 비트스트림 획득부(110)는 변환 단위의 최대 크기에 대한 정보를 비트스트림으로부터 획득할 수 있다. 변환 단위의 최대 크기에 대한 정보는 변환 단위의 최대 크기를 직접적으로 나타내는 정수일 수 있고, 또는 최대 크기와 관련된 인덱스일 수도 있다.
일 실시예에 따라 비트스트림 획득부(110)는 변환 단위가 가질 수 있는 블록 형태에 대한 정보를 비트스트림으로부터 획득할 수 있고, 복호화부(120)는 변환 단위가 가질 수 있는 블록 형태에 대한 정보에 기초하여 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 변환 단위가 가질 수 있는 블록 형태는 다양할 수 있으며, 데이터 단위(예를 들면, 픽쳐, 슬라이스, 슬라이스 세그먼트, 타일, 최대 부호화 단위, 부호화 단위 등)에 포함되는 변환 단위를 결정하기 위하여 복호화부(120)가 모든 형태를 이용할 수 있으려면 변환 단위가 가질 수 있는 다양한 형태를 모두 나타낼 수 있는 정보 또는 신택스를 비트스트림으로부터 획득하여야 한다. 이러한 경우, 비트스트림 획득부(110)가 획득하여야 하는 데이터량이 상대적으로 많아지게 되어 비트스트림 이용효율이 좋지 않을 수 있다. 일 실시예에 따라 소정의 데이터 단위(예를 들면, 픽쳐, 슬라이스, 슬라이스 세그먼트, 타일, 최대 부호화 단위, 부호화 단위 등)마다 변환 단위가 가질 수 있는 형태의 조합이 다를 수 있다. 예를 들면, 비트스트림 생성부(110)는 소정의 데이터 단위마다 변환 단위가 가질 수 있는 블록 형태에 대한 정보를 비트스트림으로부터 획득할 수 있고, 복호화부(120)는 변환 단위가 가질 수 있는 블록 형태에 대한 정보에 기초하여 소정의 데이터 단위마다 변환 단위가 가질 수 있는 블록 형태의 조합을 다르게 결정할 수 있다.
도 6은 일 실시예에 따라 변환 단위가 가질 수 있는 형태의 조합이 소정의 데이터 단위마다 다를 수 있는 특징을 설명하기 위한 도면이다.
일 실시예에 따라 비트스트림 생성부(110)는 소정의 데이터 단위인 최대 부호화 단위(600, 610, 620, 630)마다 변환 단위가 가질 수 있는 블록 형태에 대한 정보를 비트스트림으로부터 획득할 수 있고, 복호화부(120)는 최대 부호화 단위마다 획득한 변환 단위가 가질 수 있는 블록 형태에 대한 정보에 기초하여 적어도 하나의 변환 단위를 결정할 수 있다. 여기서 변환 단위가 가질 수 있는 블록 형태에 대한 정보란 정사각형 형태 또는 비-정사각형 형태의 변환 단위가 분할되어 결정될 수 있는 작은 크기의 변환 단위들이 가질 수 있는 형태들을 포함하는 미리 결정된 블록 형태의 조합들을 가리키는 정보일 수 있다. 이하에서는 설명 상의 편의를 위해, 변환 단위가 가질 수 있는 블록 형태에 대한 정보가 나타내는 블록 형태의 조합들을 도 4a, 4b, 4c에서 도시한 형태에 기초하여 설명하도록 한다.
일 실시예에 따라 도 6을 참조하면, 비트스트림 획득부(110)는 도 4a에서 도시하는 변환 단위의 형태가 포함된 조합을 나타내는 정보를 포함하는 비트스트림을, 최대 부호화 단위(600)와 관련하여 획득할 수 있다. 이 경우, 복호화부(120)는 최대 부호화 단위(600)에 포함되는 적어도 하나의 부호화 단위 중 하나에 포함되는 적어도 하나의 변환 단위를 도 4a를 통해 상술한 변환 단위의 형태들을 이용하여 결정할 수 있다. 즉, 최대 부호화 단위(600)내에서, 복호화부(120)는 비-정사각형 형태의 변환 단위의 긴 변을 분할하거나 변환 단위를 분할하지 않음으로써 변환 단위를 결정할 수 있다.
일 실시예에 따라 도 6을 참조하면, 비트스트림 획득부(110)는 도 4b에서 도시하는 변환 단위의 형태가 포함된 조합을 나타내는 정보를 포함하는 비트스트림을, 최대 부호화 단위(610)와 관련하여 획득할 수 있다. 이 경우, 복호화부(120)는 최대 부호화 단위(610)에 포함되는 적어도 하나의 부호화 단위 중 하나에 포함되는 적어도 하나의 변환 단위를 도 4b를 통해 상술한 변환 단위의 형태들을 이용하여 결정할 수 있다. 즉, 최대 부호화 단위(610)내에서, 복호화부(120)는 비-정사각형 형태의 변환 단위를 수직 방향 또는 수평 방향으로 분할하거나 변환 단위를 분할하지 않음으로써 적어도 하나의 변환 단위를 결정할 수 있다.
일 실시예에 따라 도 6을 참조하면, 비트스트림 획득부(110)는 도 4c에서 도시하는 변환 단위의 형태가 포함된 조합을 나타내는 정보를 포함하는 비트스트림을, 최대 부호화 단위(620)와 관련하여 획득할 수 있다. 이 경우, 복호화부(120)는 최대 부호화 단위(620)에 포함되는 적어도 하나의 부호화 단위 중 하나에 포함되는 적어도 하나의 변환 단위를 도 4c를 통해 상술한 변환 단위의 형태들을 이용하여 결정할 수 있다. 즉, 최대 부호화 단위(620)내에서, 복호화부(120)는 비-정사각형 형태의 변환 단위를 수직 방향 및 수평 방향 중 적어도 하나의 방향으로 분할하거나 변환 단위를 분할하지 않음으로써 적어도 하나의 변환 단위를 결정할 수 있다.
일 실시예에 따라 비트스트림 획득부(110)는 도 3a 및 도 3b에서 도시하는 변환 단위의 형태가 포함된 조합을 나타내는 정보를 포함하는 비트스트림을, 최대 부호화 단위(600)와 관련하여 획득할 수 있다. 복호화부(120)는 최대 부호화 단위(600)에 포함되는 적어도 하나의 부호화 단위 중 하나에 포함되는 적어도 하나의 변환 단위를 도 3a 및 도 3b 를 통해 상술한 변환 단위의 형태들을 이용하여 결정할 수 있다. 정사각형 형태의 변환 단위가 분할되어 결정될 수 있는 변환 단위의 형태의 조합에는, 도 3a 및 도 3b 에서 도시한 형태들에 한정하여 해석되어서는 안되고 도 3a 및 도 3b 에서 도시하는 형태 중 일부 형태만을 포함하는 조합들이 포함될 수도 있다.
일 실시예에 따라 비트스트림 획득부(110)는 복호화부(120)가 이용할 수 있는 변환 단위의 형태를 나타내는 정보 및 변환 단위의 크기를 나타내는 정보 중 적어도 하나를 비트스트림으로부터 소정의 데이터 단위마다 획득할 수 있다. 예를 들면, 영상 복호화 장치(100)는 시퀀스 파라미터 세트(sequence parameter set), 픽쳐 파라미터 세트(picture parameter set), 비디오 파라미터 세트(video parameter set), 슬라이스 헤더(slice header), 슬라이스 세그먼트 헤더(slice segment header) 중 하나에서, 변환 단위의 형태를 나타내는 정보 및 변환 단위의 크기를 나타내는 정보 중 적어도 하나를 획득할 수 있다. 그 외에도, 영상 복호화 장치(100)는 최대 부호화 단위, 기준 부호화 단위, 프로세싱 블록마다 변환 단위의 형태를 나타내는 정보 및 변환 단위의 크기를 나타내는 정보 중 적어도 하나를 포함하는 비트스트림으로부터 획득하여 이용할 수 있다. 기준 부호화 단위, 프로세싱 블록에 대한 특징은 후술하도록 한다.
일 실시예에 따라 영상 복호화 장치(100)의 비트스트림 획득부(110)는 변환 단위의 최대 크기에 대한 정보 및 최소 크기에 대한 정보 중 적어도 하나를 비트스트림으로부터 획득할 수 있다. 일 실시예에 따라 변환 단위가 가질 수 있는 최대 크기 및 최소 크기 중 적어도 하나가 미리 결정되어 있을 수 있고, 이에 따라 변환 단위의 최대 크기에 대한 정보 및 변환 단위의 최소 크기에 대한 정보 중 적어도 하나가 비트스트림으로부터 비트스트림 획득부(110)를 통해 획득될 수 있다. 복호화부(120)는 획득한 정보를 이용하여 결정될 수 있는 변환 단위의 최대 크기 및 최소 크기를 이용하여 적어도 하나의 변환 단위를 결정할 수 있다. 일 실시예에 따라 변환 단위의 최대 크기에 대한 정보 및 변환 단위의 최소 크기에 대한 정보는 소정의 데이터 단위(시퀀스, 픽쳐, 슬라이스, 슬라이스 세그먼트, 타일, 최대 부호화 단위, 부호화 단위 등)마다 획득될 수 있다. 예를 들면, 비트스트림 획득부(110)가 변환 단위의 최대 크기에 대한 정보 및 변환 단위의 최소 크기에 대한 정보 중 적어도 하나를 비트스트림으로부터 복수개의 픽쳐를 포함하는 시퀀스마다 획득하는 경우, 복호화부(120)는 이러한 정보를 이용하여 시퀀스 마다 변환 단위의 최대 크기 및 최소 크기를 결정할 수 있다. 일 실시예에 따라 변환 단위의 최대 크기에 대한 정보 및 변환 단위의 최소 크기에 대한 정보는 정사각형 형태의 변환 단위의 한 변의 길이 또는 비-정사각형 형태의 긴 변의 길이를 나타내는 정보일 수 있고, 미리 결정된 블록의 크기를 나타내는 인덱스일 수도 있다. 변환 단위의 변의 길이를 나타내는 정보는 샘플의 개수이거나, 샘플의 개수를 로그 연산한 것일수도 있다.
일 실시예에 따라 비트스트림 획득부(110)가 변환 단위의 최대 크기에 대한 정보 또는 변환 단위의 최소 크기에 대한 정보를 포함하는 비트스트림 및 변환 단위의 최대 크기 및 최소 크기의 차이를 나타내는 정보를 비트스트림으로부터 획득할 수 있다. 복호화부(120)는 변환 단위의 최대 크기에 대한 정보 또는 변환 단위의 최소 크기에 대한 정보 중 하나와 변환 단위의 최대 크기 및 최소 크기의 차이를 나타내는 정보를 이용하여 변환 단위의 최대 크기 또는 최소 크기를 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 변환 단위의 최소 크기에 대한 정보 및 변환 단위의 최대 크기 및 최소 크기의 차이를 나타내는 정보를 이용하여 변환 단위의 최대 크기를 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 변환 단위의 최대 크기에 대한 정보 및 변환 단위의 최대 크기 및 최소 크기의 차이를 나타내는 정보를 이용하여 변환 단위의 최소 크기를 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 영상의 휘도(Luma) 성분 및 색차(Chroma) 성분의 역변환을 수행하기 위한 변환 단위를 성분 별로 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 영상의 휘도 성분에 대한 변환 단위의 최소 크기 및 색차 성분에 대한 변환 단위의 최소 크기를 다르게 설정할 수 있다. 예를 들면, 복호화부(120)는 휘도 성분에 대한 변환 단위의 최소 크기를 4x4로 결정할 수 있고, 색차 성분에 대한 변환 단위의 최소 크기를 4x2 또는 2x4로 결정할 수 있다. 즉, 복호화부(120)는 영상을 복호화 하는 방법에 따라 이용되는 휘도 성분과 색차 성분간의 관계 또는 비율을 고려하여, 휘도 성분 및 색차 성분을 구분하여 변환 단위가 가질 수 있는 최소 크기를 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 영상의 휘도 성분에 대한 변환 단위의 최소 크기 및 색차 성분에 대한 변환 단위의 최소 크기를 다르게 설정하고 최대 크기를 동일하게 설정할 수 있다.
도 7은 일 실시예에 따라 휘도 성분 및 색차 성분 마다 결정될 수 있는 최소 크기의 변환 단위를 도시한다.
일 실시예에 따라 복호화부(120)는 영상의 휘도 성분에 대한 현재 부호화 단위(700)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있고, 영상의 색차 성분에 대한 현재 부호화 단위(710)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 휘도 성분에 대한 변환 단위의 최소 크기 및 색차 성분에 대한 변환 단위의 최소 크기를 다르게 설정할 수 있다. 예를 들면, 복호화부(120)는 휘도 성분에 대한 변환 단위의 최소 크기를 4x4로 결정할 수 있고, 색차 성분에 대한 변환 단위의 최소 크기를 4x2 또는 2x4로 결정할 수 있다.
일 실시예에 따라 휘도 성분에 대한 현재 부호화 단위(700)의 크기가 8x8인 경우, 복호화부(120)는 휘도 성분에 대한 현재 부호화 단위(700)에 포함되는 적어도 하나의 변환 단위로서 4x4이상의 크기를 가지는 적어도 하나의 변환 단위를 결정할 수 있다. 도 7을 참조하면, 복호화부(120)는 8x8 크기를 가지는 현재 부호화 단위(710)에 포함되는 4개의 변환 단위를 결정할 수 있고, 이 경우 변환 단위는 각각 최소 크기인 4x4크기를 가질 수 있다.
일 실시예에 따라 복호화부(120)는 현재 부호화 단위(700)의 휘도 성분과 관련된 색차 성분에 대한 부호화 단위(710)를 결정할 수 있다. 일 실시예에 따라 휘도 성분에 대한 현재 부호화 단위(700)의 크기가 2Nx2N인 경우 복호화부(120)는 휘도 성분과 관련된 색차 성분에 대한 부호화 단위(710)의 크기는 NxN인 것으로 결정할 수 있다. 도 7을 참조하면, 일 실시예에 따라 휘도 성분에 대한 현재 부호화 단위(700)의 크기가 8x8인 경우, 색차 성분에 대한 현재 부호화 단위(710)의 크기는 4x4인 것으로 결정될 수 있다.
일 실시예에 따라 색차 성분에 대한 변환 단위의 크기는 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향 적어도 하나의 방향으로 분할한 크기일 수 있다. 즉, 색차 성분에 대한 변환 단위는 휘도 성분에 대한 변환 단위보다 적은 크기를 가질 수 있다.
일 실시예에 따라 휘도 성분에 대한 변환 단위 및 색차 성분 각각에 대한 변환 단위의 최소 크기는 다를 수 있다. 이하에서는 설명상의 편의를 위해, 휘도 성분에 대한 변환 단위의 최소 크기를 4x4, 색차 성분에 대한 변환 단위의 최소 크기를 4x2 또는 2x4인 실시예를 이용하여 설명하도록 한다.
일 실시예에 따라 복호화부(120)는 변환 단위의 최소 크기를 고려하여 색차 성분에 대한 현재 부호화 단위(710)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 색차 성분에 대한 변환 단위는 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할한 크기를 가질 수 있다. 다만 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할한 크기가 색차 성분에 대한 변환 단위의 최소 크기보다 작은 경우, 복호화부(120)는 색차 성분에 대한 변환 단위의 최소 크기를 고려하여 색차 성분에 대한 변환 단위를 결정할 수 있다.
일 실시예에 따라, 복호화부(120)는 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할한 크기가 색차 성분에 대한 변환 단위의 최소 크기보다 작은 경우, 최소 크기를 가지는 색차 성분에 대한 변환 단위를 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할한 크기가 색차 성분에 대한 변환 단위의 최소 크기보다 작은 경우, 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할한 크기를 가지는 변환 단위들을 병합하여, 상기 색차 성분에 대한 변환 단위의 최소 크기 이상의 크기를 가지는 변환단위를 결정할 수 있다. 예를 들면, 복호화부(120)는 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할하지 않고, 휘도 성분에 대한 변환 단위의 크기를 색차 성분에 대한 변환 단위의 크기로 이용할 수 있다. 또다른 예를 들면, 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할한 변환 단위의 크기가 색차 성분의 변환 단위의 최소 크기보다 작은 것으로 판단되는 경우, 복호화부(120)는 색차 성분에 대한 변환 단위의 최소 크기로 분할된 변환 단위들을 병합할 수 있다. 예를 들면, 4x4크기를 가지는 휘도 성분에 대한 변환 단위가 분할되어 결정된 4개의 2x2 크기의 변환 단위와 색차 성분에 대한 변환 단위의 최소 크기를 비교하여, 4개의 2x2 크기의 변환 단위끼리의 병합을 통해 최소 크기를 가지는 색차 성분에 대한 적어도 하나의 변환 단위를 결정할 수 있다.
도 7을 참조하면, 복호화부(120)는 색차 성분에 대한 부호화 단위(710)에 포함되는 적어도 하나의 변환 단위(예를 들면, 730, 750, 760, 770)을 결정할 수 있다. 복호화부(120)는 변환 단위의 최소 크기를 고려하여 색차 성분에 대한 변환 단위를 결정할 수 있으며 변환 단위의 최소 크기는 휘도 성분 및 색차 성분에 따라 달라질 수 있다. 색차 성분에 대한 현재 부호화 단위(710)의 크기가 2Nx2N인 경우, 복호화부(120)는 NxN크기를 가지는 변환 단위(730), 2Nx2N크기를 가지는 변환 단위(750), 2NxN 또는 Nx2N크기를 가지는 변환 단위(760 또는 770)를 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 색차 성분에 대한 변환 단위의 최소 크기를 고려하여 변환 단위를 결정할 수 있다. 예를 들면, 색차 성분에 대한 변환 단위의 최소 크기가 4x2 또는 2x4인 경우, 복호화부(120)는 4x4크기를 가지는 현재 부호화 단위(710)에서는 2x2크기를 가지는 4개의 변환 단위(730)를 결정할 수는 없다. 이 경우 복호화부(120)는 2x2크기를 가지는 변환 단위(730)를 병합하여 2x4크기를 가지는 변환 단위(760)를 결정하거나 4x2크기를 가지는 변환 단위(770)를 결정할 수 있다. 또다른 예를 들면, 복호화부(120)는 2x2크기를 가지는 4개의 변환 단위(730)를 결정하는 과정을 생략하고, 최소 크기를 갖는 변환 단위를 현재 부호화 단위(710)에 포함되는 적어도 하나의 변환 단위로서 결정할 수도 있다.
일 실시예에 따라 비트스트림 획득부(110)는 현재 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 비트스트림으로부터 획득할 수 있고, 복호화부(120)는 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 이용하여 현재 심도의 변환 단위에 포함되는 샘플에 대한 복호화 과정을 수행할 수 있다. 여기서, 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보는 변환 단위의 분할 과정에서 결정되는 현재 심도의 변환 단위에 관련된 정보일 수 있으며, 상기 현재 심도의 변환 단위는 이후에 더 작은 크기의 변환 단위로 분할될 수도 있다.
일 실시예에 따라 복호화부(120)는 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보에 기초하여, 현재 심도의 변환 단위에 대한 레지듀얼 신호 복호화 과정을 수행할지 여부를 결정할 수 있다. 즉, 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되지 않는 경우 현재 심도의 변환 단위에 대한 레지듀얼 신호의 복호화 과정을 생략할 수 있다. 반대로, 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는 경우, 현재 심도의 변환 단위에 대한 레지듀얼 신호를 비트스트림으로부터 획득하여 복호화 과정을 수행할 수 있다.
일 실시예에 따라 비트스트림 획득부(110)는 현재 부호화 단위와 관련된 휘도 성분 및 색차 성분 별로 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 비트스트림으로부터 획득할 수 있다. 즉, 비트스트림 획득부(110)는 휘도 성분에 대한 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보 및 색차 성분에 대한 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보 중 적어도 하나를 비트스트림으로부터 획득할 수 있다.
일 실시예에 따라 비트스트림 획득부(110)는 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정하기 위한 분할 과정에서, 더 이상 현재 심도의 변환 단위가 분할되지 않는 경우에 휘도 성분에 대한 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보 및 색차 성분에 대한 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보 중 적어도 하나를 비트스트림으로부터 획득할 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 포함하는 비트스트림을 휘도 성분 및 색차 성분 별로 획득할 수 있다. 영상 복호화 장치(100)는 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득하기 위한 방법을 이용함에 있어서, 휘도 성분에 대한 변환 단위 및 색차 성분에 대한 변환 단위 별로 다르게 이용할 수 있다. 예를 들면, 비트스트림 획득부(110)는 색차 성분에 대한 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득하기 위하여, 분할과정에서 이용되는 현재 심도의 변환 단위마다 비트스트림으로부터 획득할 수 있다. 또다른 예를 들면, 비트스트림 획득부(110)는 현재 심도의 변환 단위가 더 이상 분할되지 않는 경우에 한해, 휘도 성분에 대한 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 비트스트림으로부터 획득할 수 있다. 다만, 상술한 실시예는 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득하는 방법이 휘도 성분 또는 색차 성분 마다 다를 수 있다는 점을 설명하기 위한 예시이므로, 휘도 성분 또는 색차 성분을 포함하는 변환 단위가 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득하는 방법은, 다양한 실시예들의 조합에 따라 구현될 수 있는 것으로 해석되어야 한다.
도 8은 일 실시예에 따라 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정하는 과정에서 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득하는 과정을 설명하기 위한 도면이다.
일 실시예에 따라 복호화부(120)는 현재 부호화 단위(800)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 변환 단위를 결정하는 도 3a, 도 3b 및 도 4a 내지 도 4c를 통해 상술하였으므로 자세한 설명은 생략하도록 한다. 도 8을 참조하면, 복호화부(120)는 현재 부호화 단위(800)에 포함되는 적어도 하나의 변환 단위의 분할과정(802)을 수행할 수 있다. 복호화부(120)는 현재 부호화 단위(800)와 동일한 크기를 가지는 블록을 현재 심도의 변환 단위로 결정한 후, 현재 심도의 변환 단위를 분할하는 과정을 수행할 수 있다. 일 실시예에 따라 현재 심도의 변환 단위가 작은 크기로 분할되어 결정된 블록들은 분할되기 전의 변환 단위의 현재 심도보다 하위 심도의 블록일 수 있다. 다만 일 실시예에 따라 블록의 긴 변을 기준으로 심도를 결정하는 경우, 현재 심도의 변환 단위가 작은 크기로 분할(예를 들면 수평 방향 또는 수직 방향으로만 분할)되어 결정된 블록들의 심도 역시 현재 심도와 동일할 수 있다.
일 실시예에 따라 복호화부(120)는 현재 심도의 변환 단위가 더 이상 작은 크기의 블록들로 분할되지 않는 것으로 결정되는 경우 현재 심도의 변환 단위를 이용하여 영상의 복호화를 수행할 수 있다. 복호화부(120)는 일 실시예에 따라 현재 부호화 단위(800)와 동일한 크기를 가지는 블록(810)을 변환 단위로 결정하거나, 현재 부호화 단위(800)와 동일한 크기를 가지는 블록(810)을 분할하여 복수개의 블록(812a, 812b; 814a, 814b; 또는 816a, 816b, 816c, 816d)을 결정할 수 있다. 변환 단위의 결정을 위한 분할 과정에서 현재 심도의 변환 단위가 더 이상 분할되지 않는 경우, 복호화부(120)는 현재 심도의 변환 단위를 이용하여 영상을 복호화 할 수 있다. 만일 현재 심도의 변환 단위(예를 들면, 812a)가 더 작은 크기로 분할됨을 나타내는 경우, 복호화부(120)는 현재 심도의 변환 단위를 더 분할할 수 있고 이는 재귀적 분할과정일 수 있다. 복호화부(120)는 비-정사각형 형태의 변환 단위(812a)에 대한 분할 과정을 수행할 수 있으며, 이러한 분할 과정은 도 4a, 4b, 4c와 관련하여 상술하였으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 비트스트림 획득부(110)는 적어도 하나의 변환 단위를 결정하기 위한 분할 과정에서 결정되는 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 현재 심도의 변환 단위마다 획득할 수 있다. 도 8을 참조하면, 복호화부(120)는 현재 부호화 단위(800)에 포함되는 적어도 하나의 변환 단위를 결정하기 위하여, 현재 부호화 단위(800)과 동일한 크기를 가지는 블록을 재귀적으로 분할할 수 있다. 예를 들면 복호화부(120)가 현재 부호화 단위(800)에 포함되는 적어도 하나의 변환 단위 중 하나(824a)를 결정하는 과정에서, 비트스트림 획득부(110)는 현재 부호화 단위(800)과 동일한 크기를 가지는 현재 심도의 변환 단위를 수직 방향으로 분할할 때 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득하고, 현재 심도의 변환 단위로부터 분할된 변환 단위 중 하나(812a)를 수평 방향으로 분할할 때 다시 분할된 블록(812a)에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득할 수 있다.
일 실시예에 따라 비트스트림 획득부(110)는 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위 내에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 적어도 하나의 변환 단위 마다 획득할 수 있다. 도 8을 참조하면, 복호화부(120)는 현재 부호화 단위(800)에 포함되는 적어도 하나의 변환 단위를 결정하기 위하여, 현재 부호화 단위(800)과 동일한 크기를 가지는 현재 심도의 변환 단위를 재귀적으로 분할할 수 있다. 비트스트림 획득부(110)는 더 이상 분할되지 않는 변환 단위에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득할 수 있다. 예를 들면 복호화부(120)가 현재 부호화 단위(800)에 포함되는 적어도 하나의 변환 단위 중 하나(824a)를 결정하는 과정에서, 비트스트림 획득부(110)는 현재 부호화 단위(800)과 동일한 크기를 가지는 블록을 수직 방향으로 분할할 때 및 분할된 블록 중 하나(812a)를 수평 방향으로 분할할 때 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득할 필요 없다. 비트스트림 획득부(110)는 더 이상 분할되지 않는 변환 단위(824a)로 결정되었을 때 해당 변환 단위(824a)의 복호화 과정에서 변환 단위(824a) 내에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 비트스트림으로부터 획득할 수 있다.
다만 도 8에 관하여 상술한 설명은 설명 상 편의를 위해 이용한 단순한 실시예에 불과하며, 현재 부호화 단위의 형태는 정사각형 형태뿐만 아니라 비-정사각형 형태를 나타낼 수도 있으며, 변환 단위가 결정되는 과정 역시 도 8에서 도시하는 과정에 한정하여 해석되어서는 안된다.
영상 복호화 장치(100)는 현재 부호화 단위의 블록 형태, 영상의 휘도 성분 또는 색차 성분 중 현재 부호화 단위와 관련된 것이 무엇인지 여부, 현재 부호화 단위에서 이용되는 예측 모드, 현재 부호화 단위에 포함되는 변환 단위의 개수 중 적어도 하나에 기초하여 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 방법을 다르게 결정할 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 부호화 단위의 형태에 기초하여 현재 블록에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 방법을 다르게 결정할 수 있다. 일 실시예에 따라 비트스트림 획득부(110)는 적어도 하나의 변환 단위를 결정하기 위한 분할 과정에서 결정되는 각각의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 현재 심도의 변환 단위마다 획득할 수 있다. 나아가 비트스트림 획득부(110)는 현재 심도의 변환 단위가 분할되지 않는 경우에 한해 현재 심도의 변환 단위 내에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득할 수도 있다.
예를 들면, 도 3a 및 도 3b과 관련하여 상술한 바와 같이 영상 복호화 장치(100)는 정사각형 형태 또는 비-정사각형 형태의 부호화 단위의 포함되는 적어도 하나의 변환 단위가 결정할 수 있다. 복호화부(120)는 변환 단위의 재귀적 분할 과정을 통해 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 일 실시예에 따라 비트스트림 획득부(110)는 현재 부호화 단위의 형태가 비-정사각형 형태인 경우, 적어도 하나의 변환 단위를 결정하기 위한 변환 단위의 분할 과정에서 이용되는 현재 심도의 변환 단위마다, 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득할 수 있다
일 실시예에 따라 영상 복호화 장치(100)는 부호화 단위의 블록 형태, 영상의 휘도 성분 또는 색차 성분 중 현재 부호화 단위와 관련된 것이 무엇인지 여부에 기초하여 현재 블록에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 방법을 다르게 결정할 수 있다. 일 실시예에 따라 비트스트림 획득부(110)는 현재 부호화 단위의 형태가 비-정사각형 형태이고, 현재 부호화 단위는 영상의 색차 성분에 관련된 부호화 단위인 경우, 적어도 하나의 변환 단위를 결정하기 위한 변환 단위의 분할 과정에서 이용되는 현재 심도의 변환 단위마다, 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 생성할 수 있다
일 실시예에 따라 영상 복호화 장치(100)는 부호화 단위의 블록 형태, 현재 부호화 단위에서 이용되는 예측 모드에 기초하여 현재 블록에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 방법을 다르게 결정할 수 있다. 일 실시예에 따라 비트스트림 획득부(110)는 현재 부호화 단위의 형태가 비-정사각형 형태이고 현재 부호화 단위에서 인트라 예측 모드가 이용될 수 있는 경우, 적어도 하나의 변환 단위를 결정하기 위한 변환 단위의 분할 과정에서 이용되는 현재 심도의 변환 단위마다, 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 생성할 수 있다
일 실시예에 따라 영상 복호화 장치(100)는 현재 심도의 변환 단위의 형태에 기초하여 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득하는 방법을 결정할 수 있다. 예를 들면, 현재 심도의 변환 단위가 정사각형 형태인 경우, 비트스트림 획득부(110)는 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득하기 위한 방법을 이용함에 있어서, 휘도 성분에 대한 변환 단위 및 색차 성분에 대한 변환 단위별로 다르게 이용할 수 있다. 이에 반해, 현재 심도의 변환 단위가 비-정사각형 형태인 경우, 비트스트림 획득부(110)는 휘도 성분에 대한 변환 단위 및 색차 성분에 대한 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 획득하기 위한 방법을 이용함에 있어서 동일한 방법(예를 들면, 분할 과정에서 이용되는 현재 심도의 변환 단위마다 정보가 획득되는 방법 또는 현재 심도의 변환 단위가 더 이상 분할되지 않는 경우에 한하여 정보가 획득되는 방법)을 이용할 수 있다.
다만 영상 복호화 장치(100)가 상술한 다양한 조건의 조합에 기초하여 현재 블록에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 방법이, 적어도 하나의 변환 단위를 결정하기 위한 블록 분할 과정마다 획득하는 것으로 한정하여 해석되어서는 안되며, 각각의 조건의 조합마다 다양하게 이용될 수 있다. 즉, 상술한 다양한 조건의 조합에 기초하여 경우를 나누어, 현재 심도의 분할 단위 마다 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 획득하는 방법 또는 더 이상 현재 변환 단위가 분할되지 않는 경우에만 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 획득하는 방법이 이용될 수 있다.
일 실시예에 따라 복호화부(120)는 현재 부호화 단위의 형태 및 크기 중 적어도 하나에 기초하여 적어도 하나의 변환 단위를 결정할 수 있다. 예를 들면, 복호화부(120)는 현재 부호화 단위가 비-정사각형 형태인 경우 변환 단위 결정을 위한 분할 과정을 수행하지 않고, 현재 부호화 단위와 동일한 형태의 변환 단위를 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 현재 부호화 단위가 비-정사각형 형태이고 현재 부호화 단위와 동일한 형태의 변환 단위가 이용될 수 없는 경우, 변환 단위의 최소 크기 이상의 복수개의 변환 단위로 분할할 수 있다.
일 실시예에 따라 변환 단위의 최소 크기가 4x4인 경우라도, 복호화부(120)는 현재 부호화 단위가 4x8 또는 8x4인 비-정사각형 형태인 경우 두 개의 4x4크기의 변환 단위가 포함되는 것으로 결정하지 않을 수 있다. 이 경우 복호화부(120)는 현재 부호화 단위와 동일한 크기를 가지는 4x8 또는 8x4인 비-정사각형 형태인 변환 단위를 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 변환 단위의 긴 변의 길이에 기초하여 변환 단위의 심도를 결정할 수 있다. 즉, 복호화부(120)는 현재 심도의 변환 단위를 분할하더라도 분할된 블록의 긴 변의 길이가 현재 심도의 변환 단위의 긴 변과 동일한 경우(예를 들면 정사각형 형태의 변환 단위를 수직 방향 또는 수평 방향으로만 분할하는 경우) 분할된 블록의 심도를 현재 심도와 동일한 것으로 결정할 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 현재 심도의 변환 단위의 형태에 기초하여, 변환 단위와 관련된 적어도 하나의 신택스를 비트스트림으로부터 획득할 수 있다.
일 실시예에 따라 복호화부(120)는 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위에 기초하여 레지듀얼 신호를 복호화할 수 있다. 비트스트림 획득부(110)는 레지듀얼 신호와 관련된 정보를 결정한 적어도 하나의 변환 단위에 기초하여 비트스트림으로부터 획득할 수 있고, 복호화부(120)는 획득한 레지듀얼 신호와 관련된 정보를 이용하여 복호화를 수행할 수 있다.
일 실시예에 따라 비트스트림 획득부(110)는 적어도 하나의 변환 단위 중 하나에서 레지듀얼 신호에 대한 빈 스트링을 비트스트림으로부터 획득할 수 있다. 이러한 복호화부(120)는 빈 스트링을 이용하여 신택스를 복호화할 수 있고, 이러한 복호화 과정에서 복호화부(120)는 다양한 컨텍스트 정보를 이용할 수 있다. 이러한 컨텍스트 정보는 CABAC 복호화 과정에서 이용되는 다양한 정보를 포함할 수 있다. 예를 들면, 컨텍스트 정보란 빈 스트링에 대응하는 신택스를 결정하기 위하여 이용되는 컨텍스트 인덱스를 나타낼 수 있다. 복호화부(120)는 컨텍스트 테이블을 이용함으로써 컨텍스트 인덱스에 대응하는 값을 초기값으로 결정하고, 결정된 초기값을 이용하여 CABAC 복호화를 수행할 수 있다.
일 실시예에 따라 복호화부(120)는 컨텍스트 정보를 결정하기 위하여, 다양한 정보를 고려할 수 있다. 예를 들면, 복호화부(120)는 컨텍스트 정보를 결정하기 위하여, 현재 심도의 변환 단위의 형태를 고려할 수 있다. 즉, 변환 단위의 형태에 따라 CABAC에 이용되는 컨텍스트 정보가 달라질 수 있다. 일 실시예에 따라 복호화부(120)는 컨텍스트 정보를 결정하기 위하여, 신택스의 종류, 현재 심도의 변환 단위가 포함되는 부호화 단위의 심도, 주변 블록의 신택스, 변환 단위의 크기 및 변환 단위의 형태 중 적어도 하나를 이용하여 컨텍스트 정보를 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 변환 단위의 형태에 기초하여 컨텍스트 정보를 결정할 수 있고, 이러한 컨텍스트 정보는 빈 스트링에 대응하는 신택스를 결정하기 위하여 이용되는 컨텍스트 인덱스를 나타낼 수 있으며, 이러한 컨텍스트 인덱스는 컨텍스트 인덱스 오프셋(ctxIdxOffset) 및 컨텍스트 인덱스 오프셋에 가산되는 값(예를 들면, ctxInc)을 이용하여 결정될 수 있다. 즉, 복호화부(120)는 ctxIdxOffset 및 ctxInc를 더하여 컨텍스트 인덱스(ctxIndx)를 결정할 수 있다. 일 실시예에 따라 컨텍스트 인덱스 오프셋(ctxIdxOffset)은 신택스의 산술초기화 과정에서 이용되는 초기 타입(initType)에 기초하여, 컨텍스트 테이블(ctxTable) 상에서 결정될 수 있는 컨텍스트 인덱스(ctxIdx)의 최소값으로 정의될 수 있다. 복호화부(120)는 ctxInc를 결정하기 위하여, 신택스의 종류, 현재 심도의 변환 단위가 포함되는 부호화 단위의 심도, 주변 블록의 신택스, 변환 단위의 크기 및 변환 단위의 형태 중 적어도 하나를 이용할 수 있고, 결정된 ctxInc를 ctxIdxOffset과 더하여 컨텍스트 인덱스(ctxIdx)를 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 레지듀얼 신호의 CABAC 복호화 과정에서 이용될 수 있는 신택스 별로, 변환 단위의 형태에 기초하여 컨텍스트 정보를 결정할 수 있다.
상술한 다양한 실시예들은 영상 복호화 장치(100)가 수행하는 영상 복호화 방법과 관련된 동작을 설명한 것이다. 이하에서는 이러한 영상 복호화 방법에 역순의 과정에 해당하는 영상 부호화 방법을 수행하는 영상 부호화 장치(200)의 동작을 다양한 실시예를 통해 설명하도록 한다.
도 2는 일 실시예에 따라 영상을 분할하는 부호화 단위에 포함되는 변환 단위에 기초하여 영상을 부호화 하는 영상 부호화 장치에 대한 블록도를 도시한다.
도 2를 참조하면, 영상 부호화 장치(200)는 일 실시예에 따라 영상을 부호화 하기 위한 부호화부(220) 및 블록 형태 정보 등과 같은 소정의 정보 또는 신택스와 부호화된 영상에 대한 정보를 포함하는 비트스트림을 생성하기 위한 비트스트림 생성부(210)를 포함할 수 있다. 일 실시예에 따라 영상 부호화 장치(200)의 부호화부(220)는 영상을 분할하는 적어도 하나의 부호화 단위를 결정할 수 있고, 비트스트림 생성부(210)에서는 적어도 하나의 부호화 단위의 형태를 나타내는 블록 형태 정보를 포함하는 비트스트림을 생성할 수 있다. 나아가 영상 부호화 장치(200)의 부호화부(220)는 일 실시예에 따라 적어도 하나의 부호화 단위 중 하나인 현재 부호화 단위의 형태에 기초하여 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 일 실시예에 따라 블록 형태 정보는 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 정보 또는 신택스일 수 있다.
일 실시예에 따라 영상 부호화 장치(200)의 부호화부(220)는 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 비트스트림 생성부(210)는 적어도 하나의 변환 단위 중 하나인 현재 변환 단위가 작은 변환 단위들로 분할되는지 여부를 나타내는 분할 정보를 포함하는 비트스트림을 생성할 수 있다. 일 실시예에 따라 영상 부호화 장치(200)의 부호화부(220)는 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지에 기초하여 현재 부호화 단위에 포함되는 복수개의 변환 단위를 결정할 수 있다. 여기서 현재 변환 단위란, 트리 구조를 가지고 더 이상 이상 분할되지 않는 변환 단위까지 재귀적으로 분할하는 과정에서 이용되는 데이터 블록을 의미할 수 있다. 즉, 현재 변환 단위는 재귀적 분할 과정에서 작은 크기의 복수개의 변환 단위로 분할될지가 결정될 수 있는 다양한 형태 및 크기의 데이터 블록일 수 있다.
일 실시예에 따라 변환 단위의 분할 정보가 현재 변환 단위는 복수개의 변환 단위로 분할됨을 나타내고, 현재 부호화 단위가 정사각형 형태인 경우, 부호화부(220)는 현재 부호화 단위에 포함되는 정사각형 형태의 복수개의 변환 단위를 결정할 수 있다.
일 실시예에 따라 변환 단위의 분할 정보가 현재 변환 단위는 복수개의 변환 단위로 분할됨을 나타내고, 현재 부호화 단위가 비-정사각형 형태인 경우, 부호화부(220)는 현재 부호화 단위를 수직 방향 또는 수평 방향으로 분할하여 복수개의 변환 단위를 결정할 수 있다.
도 3a는 일 실시예에 따라 정사각형 형태의 현재 부호화 단위에서 결정될 수 있는 다양한 형태의 변환 단위를 도시한다.
도 3a를 참조하면, 영상 부호화 장치(200)의 부호화부(220)는 현재 부호화 단위(300)를 포함하는 적어도 하나의 부호화 단위를 결정할 수 있다. 부호화 단위가 결정되는 과정에 대하여는 후술하는 다양한 실시예를 통해 설명하도록 한다. 결정된 부호화 단위의 형태는 정사각형 형태 또는 비-정사각형 형태일 수 있다. 부호화부(220)는 일 실시예에 따라 현재 부호화 단위(300)의 형태에 기초하여 현재 부호화 단위(300)에 포함될 수 있는 변환 단위의 형태를 결정할 수 있다. 예를 들면 현재 부호화 단위(300)가 2Nx2N의 크기를 가지는 정사각형 형태의 블록이라면, 부호화부(220)는 현재 부호화 단위(300)에 포함되는 적어도 하나의 변환 단위의 형태로서 2Nx2N크기를 가지는 변환 단위(310a), Nx2N크기를 가지는 변환 단위(310b) 또는 2NxN크기를 가지는 변환 단위(310c)를 결정할 수 있다.
도 3b를 참조하면, 영상 부호화 장치(200)의 부호화부(220)는 현재 부호화 단위(350)를 포함하는 적어도 하나의 부호화 단위를 결정할 수 있다. 부호화부(220)는 일 실시예에 따라 정사각형 형태의 현재 부호화 단위(350)의 형태에 기초하여 현재 부호화 단위(350)에 포함될 수 있는 변환 단위의 형태를 결정할 수 있다. 예를 들면 현재 부호화 단위(350)가 2Nx2N의 크기를 가지는 정사각형 형태의 블록이라면, 부호화부(220)는 현재 부호화 단위(300)에 포함되는 적어도 하나의 변환 단위의 형태로서 2Nx2N크기를 가지는 하나의 변환 단위(360a)를 결정하거나, 또는 NxN크기를 가지는 4개의 변환 단위(370b)를 결정할 수 있다.
일 실시예에 따라 부호화부(220)가 정사각형 형태의 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정하는 방법에는 도 3a 및 도 3b를 포함하는 다양한 실시예들이 이용될 수 있으며, 결정될 수 있는 변환 단위의 형태는 실시예들이 조합된 다양한 형태들이 포함될 수 있다.
일 실시예에 따라 부호화부(220)는 현재 부호화 단위의 형태에 기초하여 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 예를 들면, 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지에 기초하여 상기 현재 부호화 단위에 포함되는 복수개의 변환 단위를 결정할 수 있다.
도 4a, 도 4b, 도 4c는 일 실시예에 따라 비-정사각형 형태의 현재 부호화 단위에서 결정될 수 있는 다양한 형태의 변환 단위를 도시한다.
도 4a를 참조하면, 부호화부(220)는 일 실시예에 따라 높이가 너비보다 긴 비-정사각형 형태의 현재 부호화 단위(400a)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 도 4b를 참조하면, 부호화부(220)는 일 실시예에 따라 높이가 너비보다 긴 비-정사각형 형태의 현재 부호화 단위(400b)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 도 4c를 참조하면, 부호화부(220)는 일 실시예에 따라 높이가 너비보다 긴 비-정사각형 형태의 현재 부호화 단위(400c)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 이러한 부호화부(220)의 동작은 상술한 복호화부(120)의 동작에 유사한 동작에 해당할 수 있으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 부호화부(220)는 현재 부호화 단위의 크기 및 변환 단위의 최대 크기를 비교하여 현재 부호화 단위에 포함되는 복수개의 변환 단위를 결정할 수 있다.
도 5는 일 실시예에 따라 현재 부호화 단위의 크기와 변환 단위의 최대 크기의 비교 결과에 기초하여 현재 부호화 단위에 포함되는 복수개의 변환 단위를 결정하는 과정을 도시한다.
일 실시예에 따라 부호화부(220)는 현재 부호화 단위(500)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있으며, 이러한 변환 단위가 가질 수 있는 최대 크기는 미리 결정되어있을 수 있다. 일 실시예에 따라 부호화부(220)는 현재 부호화 단위(500)와 미리 결정된 최대 크기를 가지는 변환 단위(510)를 비교할 수 있다. 비교 결과 변환 단위의 최대 크기보다 현재 부호화 단위(500)의 크기가 더 큰 경우, 부호화부(220)는 현재 부호화 단위(500)에 포함되는 최대 크기를 갖는 복수개의 변화 단위(520)를 결정할 수 있다. 도 5를 참조하면, 현재 부호화 단위(500)의 크기가 2Nx2N이고, 변환 단위(510)의 최대 크기가 NxN인 경우, 부호화부(220)는 현재 부호화 단위(500)에 포함되는 적어도 하나의 변환 단위를 결정하기 위한 과정과 함께 현재 부호화 단위(500)에 포함되는 최대 크기의 변환 단위(520)로 분할할 수 있다. 즉, 부호화부(220)는 최대 크기의 변환 단위보다 큰 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정하기 위해서, 현재 부호화 단위에 포함되는 복수개의 최대 크기의 변환 단위를 결정한 후, 최대 크기의 변환 단위 각각을 더 작은 크기의 변환 단위들로 분할할지 여부를 결정할 수 있다.
일 실시예에 따라 비트스트림 생성부(210)는 변환 단위의 최대 크기에 대한 정보를 포함하는 비트스트림을 생성할 수 있다. 변환 단위의 최대 크기에 대한 정보는 변환 단위의 최대 크기를 직접적으로 나타내는 정수일 수 있고, 또는 최대 크기와 관련된 인덱스일 수도 있다.
일 실시예에 따라, 부호화부(220)는 변환 단위가 가질 수 있는 블록 형태에 기초하여 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 비트스트림 생성부(210)는 변환 단위가 가질 수 있는 블록 형태에 대한 정보를 포함하는 비트스트림을 생성할 수 있다. 변환 단위가 가질 수 있는 블록 형태는 다양할 수 있으며, 영상 전체에서 코덱이 지원하는 모든 형태를 부호화부(220)가 이용할 수 있으려면 영상에 포함되는 소정의 데이터 단위(예를 들면, 픽쳐, 슬라이스, 슬라이스 세그먼트, 타일, 최대 부호화 단위, 부호화 단위 등)마다 변환 단위의 형태를 모두 나타낼 수 있는 정보 또는 신택스를 포함하는 비트스트림을 생성하여야 한다. 이러한 경우, 비트스트림 생성부(210)가 생성하여야 하는 데이터량이 상대적으로 많아지게 되어 비트스트림 이용효율이 좋지 않을 수 있다. 일 실시예에 따라 소정의 데이터 단위(예를 들면, 픽쳐, 슬라이스, 슬라이스 세그먼트, 타일, 최대 부호화 단위, 부호화 단위 등)마다 변환 단위가 가질 수 있는 형태의 조합이 다를 수 있다. 예를 들면, 비트스트림 생성부(110)는 소정의 데이터 단위마다 변환 단위가 가질 수 있는 블록 형태에 대한 정보를 포함하는 비트스트림을 생성할 수 있다. 이러한 정보를 획득한 영상 복호화 장치(100)에서는 변환 단위가 가질 수 있는 블록 형태에 대한 정보에 기초하여 소정의 데이터 단위마다 변환 단위가 가질 수 있는 블록 형태의 조합을 다르게 결정할 수 있다.
도 6은 일 실시예에 따라 변환 단위가 가질 수 있는 형태의 조합이 소정의 데이터 단위마다 다를 수 있는 특징을 설명하기 위한 도면이다.
일 실시예에 따라 부호화부(220)는 소정의 데이터 단위(예를 들면, 최대 부호화 단위(600, 610, 620, 630))적어도 하나의 변환 단위를 결정할 수 있고 비트스트림 생성부(110)는 소정의 데이터 단위인 상기 최대 부호화 단위(600, 610, 620, 630)마다 변환 단위가 가질 수 있는 블록 형태에 대한 정보를 포함하는 비트스트림을 생성할 수 있다.
일 실시예에 따라 도 6을 참조하면, 비트스트림 생성부(210)는 도 4a에서 도시하는 변환 단위의 형태가 포함된 조합을 나타내는 정보를 포함하는 비트스트림을, 최대 부호화 단위(600)와 관련하여 생성할 수 있다. 즉, 부호화부(220)는 최대 부호화 단위(600)에 포함되는 적어도 하나의 부호화 단위 중 하나에 포함되는 적어도 하나의 변환 단위를 결정하기 위하여 도 4a를 통해 상술한 변환 단위의 형태들을 이용할 수 있고, 이 경우 비트스트림 생성부(210)는 최대 부호화 단위(600)와 관련하여 도 4a에서 도시한 변환 단위의 형태가 포함된 조합을 나타내는 정보를 포함하는 비트스트림을 생성할 수 있다.
일 실시예에 따라 도 6을 참조하면, 비트스트림 생성부(210)는 도 4b에서 도시하는 변환 단위의 형태가 포함된 조합을 나타내는 정보를 포함하는 비트스트림을, 최대 부호화 단위(610)와 관련하여 생성할 수 있다. 즉, 부호화부(220)는 최대 부호화 단위(610)에 포함되는 적어도 하나의 부호화 단위 중 하나에 포함되는 적어도 하나의 변환 단위를 결정하기 위하여 도 4b를 통해 상술한 변환 단위의 형태들을 이용할 수 있고, 이 경우 비트스트림 생성부(210)는 최대 부호화 단위(610)에서는 도 4b의 변환 단위의 형태들을 이용할 수 있음을 나타내는 정보를 포함하는 비트스트림을 생성할 수 있다
일 실시예에 따라 도 6을 참조하면, 비트스트림 생성부(210)는 도 4c에서 도시하는 변환 단위의 형태가 포함된 조합을 나타내는 정보를 포함하는 비트스트림을, 최대 부호화 단위(620)와 관련하여 생성할 수 있다. 즉, 부호화부(220)는 최대 부호화 단위(620)에 포함되는 적어도 하나의 부호화 단위 중 하나에 포함되는 적어도 하나의 변환 단위를 결정하기 위하여 도 4c를 통해 상술한 변환 단위의 형태들을 이용할 수 있고, 이 경우 비트스트림 생성부(210)는 최대 부호화 단위(620)에서는 도 4c의 변환 단위의 형태들을 이용할 수 있음을 나타내는 정보를 포함하는 비트스트림을 생성할 수 있다
일 실시예에 따라 비트스트림 생성부(210)는 도 3a에서 도시하는 변환 단위의 형태가 포함된 조합을 나타내는 정보를 포함하는 비트스트림을, 최대 부호화 단위(600, 610 또는 620)와 관련하여 생성할 수 있다. 즉, 부호화부(220)는 최대 부호화 단위(600, 610 또는 620)에 포함되는 적어도 하나의 부호화 단위 중 하나에 포함되는 적어도 하나의 변환 단위를 결정하기 위하여 도 3a를 통해 상술한 변환 단위의 형태들을 이용할 수 있고, 이 경우 비트스트림 생성부(210)는 최대 부호화 단위(600, 610 또는 620)에서는 도 3a의 변환 단위의 형태들을 이용할 수 있음을 나타내는 정보를 포함하는 비트스트림을 생성할 수 있다. 정사각형 형태의 변환 단위가 분할되어 결정될 수 있는 변환 단위의 형태의 조합에는, 도 3a에서 도시한 형태들에 한정하여 해석되어서는 안되고 도 3a에서 도시하는 형태 중 일부 형태만을 포함하는 조합들이 포함될 수도 있다.
일 실시예에 따라 비트스트림 생성부(210)는 부호화부(220)가 변환 단위를 결정하기 위해 이용한 변환 단위의 형태를 나타내는 정보 및 변환 단위의 크기를 나타내는 정보 중 적어도 하나를 포함하는 비트스트림을 소정의 데이터 단위마다 생성할 수 있다. 예를 들면, 영상 부호화 장치(200)는 시퀀스 파라미터 세트(sequence parameter set), 픽쳐 파라미터 세트(picture parameter set), 비디오 파라미터 세트(video parameter set), 슬라이스 헤더(slice header), 슬라이스 세그먼트 헤더(slice segment header)에 변환 단위의 형태를 나타내는 정보 및 변환 단위의 크기를 나타내는 정보 중 적어도 하나를 생성할 수 있다. 그 외에도, 비트스트림 생성부(210)는 변환 단위의 형태를 나타내는 정보 및 변환 단위의 크기를 나타내는 정보 중 적어도 하나를 포함하는 비트스트림을 최대 부호화 단위, 기준 부호화 단위, 프로세싱 블록마다 생성할 수 있다. 기준 부호화 단위, 프로세싱 블록에 대한 특징은 후술하도록 한다.
일 실시예에 따라 부호화부(220)는 변환 단위의 최대 크기 및 최소 크기를 이용하여 적어도 하나의 변환 단위를 결정할 수 있다. 비트스트림 생성부(210)는 변환 단위의 최대 크기에 대한 정보 및 최소 크기에 대한 정보 중 적어도 하나를 포함하는 비트스트림을 생성할 수 있다. 일 실시예에 따라 변환 단위가 가질 수 있는 최대 크기 및 최소 크기 중 적어도 하나가 미리 결정되어 있을 수 있고, 이에 따라 변환 단위의 최대 크기에 대한 정보 및 변환 단위의 최소 크기에 대한 정보 중 적어도 하나가 비트스트림으로부터 비트스트림 생성부(210)를 통해 생성될 수 있다. 일 실시예에 따라 변환 단위의 최대 크기에 대한 정보 및 변환 단위의 최소 크기에 대한 정보는 소정의 데이터 단위(시퀀스, 픽쳐, 슬라이스, 슬라이스 세그먼트, 타일, 최대 부호화 단위, 부호화 단위 등)마다 생성될 수 있다. 예를 들면, 부호화부(220)는 시퀀스 마다 변환 단위의 최대 크기 및 최소 크기를 결정할 수 있고, 비트스트림 생성부(210)가 변환 단위의 최대 크기에 대한 정보 및 변환 단위의 최소 크기에 대한 정보 중 적어도 하나를 포함하는 비트스트림을 복수개의 픽쳐를 포함하는 시퀀스마다 생성할 수 있다. 일 실시예에 따라 변환 단위의 최대 크기에 대한 정보 및 변환 단위의 최소 크기에 대한 정보는 정사각형 형태의 변환 단위의 한 변의 길이 또는 비-정사각형 형태의 긴 변의 길이를 나타내는 정보일 수 있고, 미리 결정된 블록의 크기를 나타내는 인덱스일 수도 있다. 변환 단위의 변의 길이를 나타내는 정보는 샘플의 개수이거나, 샘플의 개수를 로그 연산한 것일수도 있다.
일 실시예에 따라 비트스트림 생성부(210)가 변환 단위의 최대 크기에 대한 정보 또는 변환 단위의 최소 크기에 대한 정보를 포함하는 비트스트림 및 변환 단위의 최대 크기 및 최소 크기의 차이를 나타내는 정보를 포함하는 비트스트림을 생성할 수 있다. 이러한 정보를 비트스트림으로부터 획득할 수 있는 영상 복호화 장치(100)는 변환 단위의 최대 크기에 대한 정보 또는 변환 단위의 최소 크기에 대한 정보 중 하나와 변환 단위의 최대 크기 및 최소 크기의 차이를 나타내는 정보를 이용하여 변환 단위의 최대 크기 또는 최소 크기를 결정할 수 있다. 비트스트림으로부터 획득한 변환 단위의 최대 크기에 대한 정보 또는 변환 단위의 최소 크기에 대한 정보를 이용하는 영상 복호화 장치(100)에 대한 설명은 다양한 실시예를 통해 상술하였으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 부호화부(220)는 영상의 휘도(Luma) 성분 및 색차(Chroma) 성분의 역변환을 수행하기 위한 변환 단위를 성분 별로 결정할 수 있다. 일 실시예에 따라 부호화부(220)는 영상의 휘도 성분에 대한 변환 단위의 최소 크기 및 색차 성분에 대한 변환 단위의 최소 크기를 다르게 설정할 수 있다. 예를 들면, 부호화부(220)는 휘도 성분에 대한 변환 단위의 최소 크기를 4x4로 결정할 수 있고, 색차 성분에 대한 변환 단위의 최소 크기를 4x2 또는 2x4로 결정할 수 있다. 즉, 부호화부(220)는 영상을 복호화 하는 방법에 따라 이용되는 휘도 성분과 색차 성분간의 관계 또는 비율을 고려하여, 휘도 성분 및 색차 성분을 구분하여 변환 단위가 가질 수 있는 최소 크기를 결정할 수 있다. 일 실시예에 따라 부호화부(220)는 영상의 휘도 성분에 대한 변환 단위의 최소 크기 및 색차 성분에 대한 변환 단위의 최소 크기를 다르게 설정하고 최대 크기를 동일하게 설정할 수 있다.
도 7은 일 실시예에 따라 휘도 성분 및 색차 성분 마다 결정될 수 있는 최소 크기의 변환 단위를 도시한다.
일 실시예에 따라 부호화부(220)는 영상의 휘도 성분에 대한 현재 부호화 단위(700)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있고, 영상의 색차 성분에 대한 현재 부호화 단위(710)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 일 실시예에 따라 부호화부(220)는 휘도 성분에 대한 변환 단위의 최소 크기 및 색차 성분에 대한 변환 단위의 최소 크기를 다르게 설정할 수 있다. 예를 들면, 부호화부(220)는 휘도 성분에 대한 변환 단위의 최소 크기를 4x4로 결정할 수 있고, 색차 성분에 대한 변환 단위의 최소 크기를 4x2 또는 2x4로 결정할 수 있다.
일 실시예에 따라 휘도 성분에 대한 현재 부호화 단위(700)의 크기가 8x8인 경우, 부호화부(220)는 휘도 성분에 대한 현재 부호화 단위(700)에 포함되는 적어도 하나의 변환 단위로서 4x4이상의 크기를 가지는 적어도 하나의 변환 단위를 결정할 수 있다. 도 7을 참조하면, 부호화부(220)는 8x8 크기를 가지는 현재 부호화 단위(710)에 포함되는 4개의 변환 단위를 결정할 수 있고, 이 경우 변환 단위는 각각 최소 크기인 4x4크기를 가질 수 있다.
일 실시예에 따라 부호화부(220)는 현재 부호화 단위(700)의 휘도 성분과 관련된 색차 성분에 대한 부호화 단위(710)를 결정할 수 있다. 일 실시예에 따라 휘도 성분에 대한 현재 부호화 단위(700)의 크기가 2Nx2N인 경우 부호화부(220)는 휘도 성분과 관련된 색차 성분에 대한 부호화 단위(710)의 크기는 NxN인 것으로 결정할 수 있다. 도 7을 참조하면, 일 실시예에 따라 휘도 성분에 대한 현재 부호화 단위(700)의 크기가 8x8인 경우, 색차 성분에 대한 현재 부호화 단위(710)의 크기는 4x4인 것으로 결정될 수 있다.
일 실시예에 따라 색차 성분에 대한 변환 단위의 크기는 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향 적어도 하나의 방향으로 분할한 크기일 수 있다. 즉, 색차 성분에 대한 변환 단위는 휘도 성분에 대한 변환 단위보다 적은 크기를 가질 수 있다.
일 실시예에 따라 휘도 성분에 대한 변환 단위 및 색차 성분 각각에 대한 변환 단위의 최소 크기는 다를 수 있다. 이하에서는 설명상의 편의를 위해, 휘도 성분에 대한 변환 단위의 최소 크기를 4x4, 색차 성분에 대한 변환 단위의 최소 크기를 4x2 또는 2x4인 실시예를 이용하여 설명하도록 한다.
일 실시예에 따라 부호화부(220)는 변환 단위의 최소 크기를 고려하여 색차 성분에 대한 현재 부호화 단위(710)에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 일 실시예에 따라 부호화부(220)는 색차 성분에 대한 변환 단위는 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할한 크기를 가질 수 있다. 다만 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할한 크기가 색차 성분에 대한 변환 단위의 최소 크기보다 작은 경우, 부호화부(220)는 색차 성분에 대한 변환 단위의 최소 크기를 고려하여 색차 성분에 대한 변환 단위를 결정할 수 있다.
일 실시예에 따라, 부호화부(220)는 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할한 크기가 색차 성분에 대한 변환 단위의 최소 크기보다 작은 경우, 최소 크기를 가지는 색차 성분에 대한 변환 단위를 결정할 수 있다.
일 실시예에 따라 부호화부(220)는 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할한 크기가 색차 성분에 대한 변환 단위의 최소 크기보다 작은 경우, 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할한 크기를 가지는 변환 단위들을 병합하여, 상기 색차 성분에 대한 변환 단위의 최소 크기 이상의 크기를 가지는 변환단위를 결정할 수 있다. 예를 들면, 부호화부(220)는 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할하지 않고, 휘도 성분에 대한 변환 단위의 크기를 색차 성분에 대한 변환 단위의 크기로 이용할 수 있다. 또다른 예를 들면, 휘도 성분에 대한 변환 단위를 수직 방향 및 수평 방향으로 분할한 변환 단위의 크기가 색차 성분의 변환 단위의 최소 크기보다 작은 것으로 판단되는 경우, 부호화부(220)는 색차 성분에 대한 변환 단위의 최소 크기로 분할된 변환 단위들을 병합할 수 있다. 예를 들면, 4x4크기를 가지는 휘도 성분에 대한 변환 단위가 분할되어 결정된 4개의 2x2 크기의 변환 단위와 색차 성분에 대한 변환 단위의 최소 크기를 비교하여, 4개의 2x2 크기의 변환 단위끼리의 병합을 통해 최소 크기를 가지는 색차 성분에 대한 적어도 하나의 변환 단위를 결정할 수 있다.
도 7을 참조하면, 부호화부(220)는 색차 성분에 대한 부호화 단위(710)에 포함되는 적어도 하나의 변환 단위(예를 들면, 730, 750, 760, 770)을 결정할 수 있다. 부호화부(220)는 변환 단위의 최소 크기를 고려하여 색차 성분에 대한 변환 단위를 결정할 수 있으며 변환 단위의 최소 크기는 휘도 성분 및 색차 성분에 따라 달라질 수 있다. 색차 성분에 대한 현재 부호화 단위(710)의 크기가 2Nx2N인 경우, 부호화부(220)는 NxN크기를 가지는 변환 단위(730), 2Nx2N크기를 가지는 변환 단위(750), 2NxN 또는 Nx2N크기를 가지는 변환 단위(760 또는 770)를 결정할 수 있다. 일 실시예에 따라 부호화부(220)는 색차 성분에 대한 변환 단위의 최소 크기를 고려하여 변환 단위를 결정할 수 있다. 예를 들면, 색차 성분에 대한 변환 단위의 최소 크기가 4x2 또는 2x4인 경우, 부호화부(220)는 4x4크기를 가지는 현재 부호화 단위(710)에서는 2x2크기를 가지는 4개의 변환 단위(730)를 결정할 수는 없다. 이 경우 부호화부(220)는 2x2크기를 가지는 변환 단위(730)를 병합하여 2x4크기를 가지는 변환 단위(760)를 결정하거나 4x2크기를 가지는 변환 단위(770)를 결정할 수 있다. 또다른 예를 들면, 부호화부(220)는 2x2크기를 가지는 4개의 변환 단위(730)를 결정하는 과정을 생략하고, 최소 크기를 갖는 변환 단위를 현재 부호화 단위(710)에 포함되는 적어도 하나의 변환 단위로서 결정할 수도 있다.
일 실시예에 따라 비트스트림 생성부(210)는 현재 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 포함하는 비트스트림을 생성할 수 있다. 여기서, 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보는 변환 단위의 분할 과정에서 결정되는 현재 심도의 변환 단위에 관련된 정보일 수 있으며, 상기 현재 심도의 변환 단위는 이후에 더 작은 크기의 변환 단위로 분할될 수도 있다.
일 실시예에 따라 부호화부(220)는 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되지 않는 경우 현재 심도의 변환 단위에 대한 레지듀얼 신호의 부호화 과정을 생략할 수 있다.
일 실시예에 따라 비트스트림 생성부(210)는 현재 부호화 단위와 관련된 휘도 성분 및 색차 성분 별로 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 포함하는 비트스트림을 생성할 수 있다. 즉, 비트스트림 생성부(210)는 휘도 성분에 대한 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보 및 색차 성분에 대한 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보 중 적어도 하나를 포함하는 비트스트림을 생성할 수 있다.
일 실시예에 따라 비트스트림 생성부(210)는 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정하기 위한 분할 과정에서, 더 이상 현재 심도의 변환 단위가 분할되지 않는 경우에 휘도 성분에 대한 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보 및 색차 성분에 대한 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보 중 적어도 하나를 포함하는 비트스트림을 생성할 수 있다.
일 실시예에 따라 영상 부호화 장치(200)는 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 포함하는 비트스트림을 휘도 성분 및 색차 성분 별로 생성할 수 있다. 영상 부호화 장치(200)는 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 포함하는 비트스트림을 생성하기 위한 방법을 이용함에 있어서, 휘도 성분에 대한 변환 단위 및 색차 성분에 대한 변환 단위 별로 다르게 이용할 수 있다. 예를 들면, 비트스트림 생성부(120)는 색차 성분에 대한 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 포함하는 비트스트림을 변환 단위의 분할과정에서 이용되는 현재 심도의 변환 단위마다 생성할 수 있다. 또다른 예를 들면, 비트스트림 획득부(110)는 현재 심도의 변환 단위가 더 이상 분할되지 않는 경우에 한해, 휘도 성분에 대한 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 포함하는 비트스트림을 생성할 수 있다. 다만, 상술한 실시예는 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 포함하는 비트스트림을 생성하는 방법이 휘도 성분 또는 색차 성분 마다 다를 수 있다는 점을 설명하기 위한 예시이므로, 휘도 성분 또는 색차 성분을 포함하는 변환 단위가 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 포함하는 비트스트림을 생성하는 방법은, 상술한 다양한 실시예들의 조합에 따라 구현될 수 있는 것으로 해석되어야 한다.
도 8은 일 실시예에 따라 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정하는 과정에서 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 생성하는 과정을 설명하기 위한 도면이다. 도 8과 관련하여 영상 부호화 장치(200)가 수행하는 동작은 도 8과 관련하여 상술한 영상 복호화 장치(100)의 동작과 유사한 동작일 수 있으므로 자세한 설명은 생략하도록 한다.
영상 부호화 장치(200)는 현재 부호화 단위의 블록 형태, 영상의 휘도 성분 또는 색차 성분 중 현재 부호화 단위와 관련된 것이 무엇인지 여부, 현재 부호화 단위에서 이용되는 예측 모드, 현재 부호화 단위에 포함되는 변환 단위의 개수 중 적어도 하나에 기초하여 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 생성하는 방법을 다르게 결정할 수 있다.
일 실시예에 따라 영상 부호화 장치(200)는 부호화 단위의 형태에 기초하여 현재 블록에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 생성하는 방법을 다르게 결정할 수 있다. 일 실시예에 따라 비트스트림 생성부(210)는 적어도 하나의 변환 단위를 결정하기 위한 분할 과정에서 결정되는 각각의 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 현재 심도의 변환 단위마다 생성할 수 있다. 나아가 비트스트림 생성부(210)는 현재 심도의 변환 단위가 분할되지 않는 경우에 한해 현재 심도의 변환 단위 내에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 생성할 수도 있다.
예를 들면, 도 3a과 관련하여 상술한 바와 같이 영상 부호화 장치(200)는 정사각형 형태 또는 비-정사각형 형태의 부호화 단위의 포함되는 적어도 하나의 변환 단위가 결정할 수 있다. 부호화부(220)는 변환 단위의 재귀적 분할 과정을 통해 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위를 결정할 수 있다. 일 실시예에 따라 비트스트림 생성부(210)는 현재 부호화 단위의 형태가 비-정사각형 형태인 경우, 적어도 하나의 변환 단위를 결정하기 위한 변환 단위의 분할 과정에서 이용되는 현재 심도의 변환 단위마다, 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 생성할 수 있다.
일 실시예에 따라 영상 부호화 장치(200)는 부호화 단위의 블록 형태, 영상의 휘도 성분 또는 색차 성분 중 현재 부호화 단위와 관련된 것이 무엇인지 여부에 기초하여 현재 블록에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 생성하는 방법을 다르게 결정할 수 있다. 일 실시예에 따라 비트스트림 생성부(210)는 현재 부호화 단위의 형태가 비-정사각형 형태이고, 현재 부호화 단위는 영상의 색차 성분에 관련된 부호화 단위인 경우, 적어도 하나의 변환 단위를 결정하기 위한 변환 단위의 분할 과정에서 이용되는 현재 심도의 변환 단위마다, 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 생성할 수 있다.
일 실시예에 따라 영상 부호화 장치(200)는 부호화 단위의 블록 형태, 현재 부호화 단위에서 이용되는 예측 모드에 기초하여 현재 블록에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 포함하는 비트스트림을 획득하는 방법을 다르게 결정할 수 있다. 일 실시예에 따라 비트스트림 생성부(210)는 현재 부호화 단위의 형태가 비-정사각형 형태이고 현재 부호화 단위에서 인트라 예측 모드가 이용될 수 있는 경우, 적어도 하나의 변환 단위를 결정하기 위한 변환 단위의 분할 과정에서 이용되는 현재 심도의 변환 단위마다 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 생성할 수 있다.
일 실시예에 따라 영상 부호화 장치(200)는 현재 심도의 변환 단위의 형태에 기초하여 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 포함하는 비트스트림을 생성하는 방법을 결정할 수 있다. 예를 들면, 현재 심도의 변환 단위가 정사각형 형태인 경우, 비트스트림 생성부(210)는 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 포함하는 비트스트림을 생성함에 있어서, 휘도 성분에 대한 변환 단위 및 색차 성분에 대한 변환 단위별로 다른 방법을 이용할 수 있다. 이에 반해, 현재 심도의 변환 단위가 비-정사각형 형태인 경우, 비트스트림 획득부(110)는 휘도 성분에 대한 변환 단위 및 색차 성분에 대한 변환 단위에 0이 아닌 변환 계수가 포함되는지 여부를 나타내는 정보를 포함하는 비트스트림을 생성함에 있어서 동일한 방법(예를 들면, 분할 과정에서 이용되는 현재 심도의 변환 단위마다 정보가 획득되는 방법 또는 현재 심도의 변환 단위가 더 이상 분할되지 않는 경우에 한하여 정보가 획득되는 방법)을 이용할 수 있다.
다만 영상 부호화 장치(200)가 상술한 다양한 조건의 조합에 기초하여 현재 블록에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 생성하는 방법이, 적어도 하나의 변환 단위를 결정하기 위한 현재 심도의 변환 단위마다 비트스트림을 생성하는 것으로 한정하여 해석되어서는 안되며, 각각의 조건의 조합마다 다양하게 이용될 수 있다. 즉, 상술한 다양한 조건의 조합에 기초하여 경우를 나누어, 현재 심도의 분할 단위 마다 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 획득하는 방법 또는 더 이상 현재 변환 단위가 분할되지 않는 경우에만 현재 심도의 변환 단위에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 생성하는 방법이 이용될 수 있다.
일 실시예에 따라 부호화부(220)는 현재 부호화 단위의 형태 및 크기 중 적어도 하나에 기초하여 적어도 하나의 변환 단위를 결정할 수 있다. 예를 들면, 부호화부(220)는 현재 부호화 단위가 비-정사각형 형태인 경우 변환 단위 결정을 위한 분할 과정을 수행하지 않고, 현재 부호화 단위와 동일한 형태의 변환 단위를 결정할 수 있다. 일 실시예에 따라 부호화부(220)는 현재 부호화 단위가 비-정사각형 형태이고 현재 부호화 단위와 동일한 형태의 변환 단위가 이용될 수 없는 경우, 변환 단위의 최소 크기 이상의 복수개의 변환 단위로 분할할 수 있다.
일 실시예에 따라 변환 단위의 최소 크기가 4x4인 경우라도, 부호화부(220)는 현재 부호화 단위가 4x8 또는 8x4인 비-정사각형 형태인 경우 두 개의 4x4크기의 변환 단위가 포함되는 것으로 결정하지 않을 수 있다. 이 경우 부호화부(220)는 현재 부호화 단위와 동일한 크기를 가지는 4x8 또는 8x4인 비-정사각형 형태인 변환 단위를 결정할 수 있다.
일 실시예에 따라 부호화부(220)는 변환 단위의 긴 변의 길이에 기초하여 변환 단위의 심도를 결정할 수 있다. 즉, 부호화부(220)는 현재 심도의 변환 단위를 분할하더라도 분할된 블록의 긴 변의 길이가 현재 심도의 변환 단위의 긴 변과 동일한 경우(예를 들면 정사각형 형태의 변환 단위를 수직 방향 또는 수평 방향으로만 분할하는 경우) 분할된 블록의 심도를 현재 심도와 동일한 것으로 결정할 수 있다.
일 실시예에 따라 영상 부호화 장치(200)는 현재 심도의 변환 단위의 형태에 기초하여, 변환 단위와 관련된 적어도 하나의 신택스를 포함하는 비트스트림을 생성할 수 있다.
일 실시예에 따라 부호화부(220)는 현재 부호화 단위에 포함되는 적어도 하나의 변환 단위에 기초하여 레지듀얼 신호를 부호화할 수 있다. 비트스트림 생성부(110)는 적어도 하나의 변환 단위에 기초하여 레지듀얼 신호와 관련된 정보를 포함하는 비트스트림을 생성할 수 있다.
일 실시예에 따라 비트스트림 생성부(210)는 부호화 과정에서 이용된 신택스를 나타내는 빈 스트링을 포함하는 비트스트림을 생성할 수 있다. 부호화부(220)는 부호화 과정에서 다양한 컨텍스트 정보를 이용할 수 있고 이러한 컨텍스트 정보는 CABAC 복호화 과정에서 이용되는 다양한 정보에 해당할 수 있다. 예를 들면, 컨텍스트 정보란 빈 스트링에 대응하는 신택스를 결정하기 위하여 이용되는 컨텍스트 인덱스를 나타낼 수 있다. 부호화부(120)는 컨텍스트 테이블을 이용함으로써 컨텍스트 인덱스에 대응하는 값을 초기값으로 결정하고, 결정된 초기값을 이용하여 CABAC 부호화를 수행할 수 있다.
일 실시예에 따라 부호화부(220)는 컨텍스트 정보를 결정하기 위하여, 다양한 정보를 고려할 수 있다. 예를 들면, 부호화부(220)는 컨텍스트 정보를 결정하기 위하여, 현재 심도의 변환 단위의 형태를 고려할 수 있다. 즉, 변환 단위의 형태에 따라 CABAC에 이용되는 컨텍스트 정보가 달라질 수 있다. 일 실시예에 따라 부호화부(220)는 컨텍스트 정보를 결정하기 위하여, 신택스의 종류, 현재 심도의 변환 단위가 포함되는 부호화 단위의 심도, 주변 블록의 신택스, 변환 단위의 크기 및 변환 단위의 형태 중 적어도 하나를 이용하여 컨텍스트 정보를 결정할 수 있다.
일 실시예에 따라 부호화부(220)는 변환 단위의 형태에 기초하여 컨텍스트 정보를 결정할 수 있고, 이러한 컨텍스트 정보는 빈 스트링에 대응하는 신택스를 결정하기 위하여 이용되는 컨텍스트 인덱스를 나타낼 수 있으며, 이러한 컨텍스트 인덱스는 컨텍스트 인덱스 오프셋(ctxIdxOffset) 및 컨텍스트 인덱스 오프셋에 가산되는 값(예를 들면, ctxInc)을 이용하여 결정될 수 있다. 즉, 부호화부(220)는 ctxIdxOffset 및 ctxInc를 더하여 컨텍스트 인덱스(ctxIndx)를 결정할 수 있다. 일 실시예에 따라 컨텍스트 인덱스 오프셋(ctxIdxOffset)은 신택스의 산술초기화 과정에서 이용되는 초기 타입(initType)에 기초하여, 컨텍스트 테이블(ctxTable) 상에서 결정될 수 있는 컨텍스트 인덱스(ctxIdx)의 최소값으로 정의될 수 있다. 부호화부(220)는 ctxInc를 결정하기 위하여, 신택스의 종류, 현재 심도의 변환 단위가 포함되는 부호화 단위의 심도, 주변 블록의 신택스, 변환 단위의 크기 및 변환 단위의 형태 중 적어도 하나를 이용할 수 있고, 결정된 ctxInc를 ctxIdxOffset과 더하여 컨텍스트 인덱스(ctxIdx)를 결정할 수 있다. 일 실시예에 따라 부호화부(220)는 레지듀얼 신호의 CABAC 부호화 과정에서 이용될 수 있는 신택스 별로, 변환 단위의 형태에 기초하여 컨텍스트 정보를 결정할 수 있다.
이하에서는 상술한 다양한 실시예에서 영상 복호화 장치(100) 또는 영상 부호화 장치(200)가 이용할 수 있는 다양한 형태의 부호화 단위를 결정하는 방법에 대하여 설명하도록 한다.
일 실시예에 따라 비트스트림 획득부(110)는 분할 형태 정보, 블록 형태 정보 등과 같은 소정의 정보를 획득하기 위한 정보를 비트스트림으로부터 획득할 수 있고, 복호화부(120)는 획득한 정보를 이용하여 영상을 복호화 할 수 있다. 일 실시예에 따라 영상 복호화 장치(100)의 비트스트림 획득부(110)에서 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 획득한 경우, 영상 복호화 장치(100)의 복호화부(120)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 영상을 분할하는 적어도 하나의 부호화 단위를 결정할 수 있다.
일 실시예에 따라 영상 복호화 장치(100)의 복호화부(120)는 블록 형태 정보에 기초하여 부호화 단위의 형태를 결정할 수 있다. 예를 들면 블록 형태 정보는 부호화 단위가 정사각형인지 또는 비-정사각형인지 여부를 나타내는 정보를 포함할 수 있다. 복호화부(120)는 블록 형태 정보를 이용하여 부호화 단위의 형태를 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 분할 형태 정보에 기초하여 부호화 단위가 어떤 형태로 분할될지를 결정할 수 있다. 예를 들면 분할 형태 정보는 부호화 단위에 포함되는 적어도 하나의 부호화 단위의 형태에 대한 정보를 나타낼 수 있다.
일 실시예에 따라 복호화부(120)는 분할 형태 정보에 따라 부호화 단위가 분할되는지 분할되지 않는지 여부를 결정할 수 있다. 분할 형태 정보는 부호화 단위에 포함되는 적어도 하나의 부호화 단위에 대한 정보를 포함할 수 있으며, 만일 분할 형태 정보가 부호화 단위에 하나의 부호화 단위만이 포함되는 것을 나타내거나 또는 분할되지 않음을 나타내는 경우, 복호화부(120)는 분할 형태 정보를 포함하는 부호화 단위가 분할되지 않는 것으로 결정할 수 있다. 분할 형태 정보가, 부호화 단위가 복수개의 부호화 단위로 분할됨을 나타내는 경우 복호화부(120)는 분할 형태 정보에 기초하여 부호화 단위에 포함되는 복수개의 부호화 단위로 분할할 수 있다.
일 실시예에 따라 분할 형태 정보는 부호화 단위를 몇 개의 부호화 단위로 분할할 지를 나타내거나 어느 방향으로 분할할지를 나타낼 수 있다. 예를 들면 분할 형태 정보는 수직 방향 및 수평 방향 중 적어도 하나의 방향으로 분할하는 것을 나타내거나 또는 분할하지 않는 것을 나타낼 수 있다.
도 9는 일 실시예에 따라 영상 복호화 장치(100)가 현재 부호화 단위를 분할하여 적어도 하나의 부호화 단위를 결정하는 과정을 도시한다.
일 실시예에 따라 복호화부(120)는 블록 형태 정보를 이용하여 부호화 단위의 형태를 결정할 수 있고, 분할 형태 정보를 이용하여 부호화 단위가 어떤 형태로 분할되는지를 결정할 수 있다. 즉, 복호화부(120)가 이용하는 블록 형태 정보가 어떤 블록 형태를 나타내는지에 따라 분할 형태 정보가 나타내는 부호화 단위의 분할 방법이 결정될 수 있다.
일 실시예에 따라, 복호화부(120)는 현재 부호화 단위가 정사각형 형태임을 나타내는 블록 형태 정보를 이용할 수 있다. 예를 들어 복호화부(120)는 분할 형태 정보에 따라 정사각형의 부호화 단위를 분할하지 않을지, 수직으로 분할할지, 수평으로 분할할지, 4개의 부호화 단위로 분할할지 등을 결정할 수 있다. 도 9를 참조하면, 현재 부호화 단위(900)의 블록 형태 정보가 정사각형의 형태를 나타내는 경우, 복호화부(120)는 분할되지 않음을 나타내는 분할 형태 정보에 따라 현재 부호화 단위(900)와 동일한 크기를 가지는 부호화 단위(910a)를 분할하지 않거나, 소정의 분할방법을 나타내는 분할 형태 정보에 기초하여 분할된 부호화 단위(910b, 910c, 910d 등)를 결정할 수 있다.
도 9를 참조하면 복호화부(120)는 일 실시예에 따라 수직방향으로 분할됨을 나타내는 분할 형태 정보에 기초하여 현재 부호화 단위(900)를 수직방향으로 분할한 두개의 부호화 단위(910b)를 결정할 수 있다. 복호화부(120)는 수평방향으로 분할됨을 나타내는 분할 형태 정보에 기초하여 현재 부호화 단위(900)를 수평방향으로 분할한 두개의 부호화 단위(910c)를 결정할 수 있다. 복호화부(120)는 수직방향 및 수평방향으로 분할됨을 나타내는 분할 형태 정보에 기초하여 현재 부호화 단위(900)를 수직방향 및 수평방향으로 분할한 네개의 부호화 단위(910d)를 결정할 수 있다. 다만 정사각형의 부호화 단위가 분할될 수 있는 분할 형태는 상술한 형태로 한정하여 해석되어서는 안되고, 분할 형태 정보가 나타낼 수 있는 다양한 형태가 포함될 수 있다. 정사각형의 부호화 단위가 분할되는 소정의 분할 형태들은 이하에서 다양한 실시예를 통해 구체적으로 설명하도록 한다.
도 10는 일 실시예에 따라 영상 복호화 장치(100)가 비-정사각형의 형태인 부호화 단위를 분할하여 적어도 하나의 부호화 단위를 결정하는 과정을 도시한다.
일 실시예에 따라 복호화부(120)는 현재 부호화 단위가 비-정사각형 형태임을 나타내는 블록 형태 정보를 이용할 수 있다. 복호화부(120)는 분할 형태 정보에 따라 비-정사각형의 현재 부호화 단위를 분할하지 않을지 소정의 방법으로 분할할지 여부를 결정할 수 있다. 도 10를 참조하면, 현재 부호화 단위(1000 또는 1050)의 블록 형태 정보가 비-정사각형의 형태를 나타내는 경우, 복호화부(120)는 분할되지 않음을 나타내는 분할 형태 정보에 따라 현재 부호화 단위(1000 또는 1050)와 동일한 크기를 가지는 부호화 단위(1010 또는 1060)를 분할하지 않거나, 소정의 분할방법을 나타내는 분할 형태 정보에 따라 기초하여 분할된 부호화 단위(1020a, 1020b, 1030a, 1030b, 1030c, 1070a, 1070b, 1080a, 1080b, 1080c)를 결정할 수 있다. 비-정사각형의 부호화 단위가 분할되는 소정의 분할 방법은 이하에서 다양한 실시예를 통해 구체적으로 설명하도록 한다.
일 실시예에 따라 복호화부(120)는 분할 형태 정보를 이용하여 부호화 단위가 분할되는 형태를 결정할 수 있고, 이 경우 분할 형태 정보는 부호화 단위가 분할되어 생성되는 적어도 하나의 부호화 단위의 개수를 나타낼 수 있다. 도 10를 참조하면 분할 형태 정보가 두개의 부호화 단위로 현재 부호화 단위(1000 또는 1050)가 분할되는 것을 나타내는 경우, 복호화부(120)는 분할 형태 정보에 기초하여 현재 부호화 단위(1000 또는 1050)를 분할하여 현재 부호화 단위에 포함되는 두 개의 부호화 단위(1020a, 1020b; 또는 1070a, 1070b)를 결정할 수 있다.
일 실시예에 따라 복호화부(120)가 분할 형태 정보에 기초하여 비-정사각형의 형태의 현재 부호화 단위(1000 또는 1050)를 분할하는 경우, 비-정사각형의 현재 부호화 단위(1000 또는 1050)의 긴 변의 위치를 고려하여 현재 부호화 단위를 분할할 수 있다. 예를 들면, 복호화부(120)는 현재 부호화 단위(1000 또는 1050)의 형태를 고려하여 현재 부호화 단위(1000 또는 1050)의 긴 변을 분할하는 방향으로 현재 부호화 단위(1000 또는 1050)를 분할하여 복수개의 부호화 단위를 결정할 수 있다.
일 실시예에 따라, 분할 형태 정보가 홀수개의 블록으로 부호화 단위를 분할하는 것을 나타내는 경우, 복호화부(120)는 현재 부호화 단위(1000 또는 1050)에 포함되는 홀수개의 부호화 단위를 결정할 수 있다. 예를 들면, 분할 형태 정보가 3개의 부호화 단위로 현재 부호화 단위(1000 또는 1050)를 분할하는 것을 나타내는 경우, 복호화부(120)는 현재 부호화 단위(1000 또는 1050)를 3개의 부호화 단위(1030a, 1030b, 1030c, 1080a, 1080b, 1080c)로 분할할 수 있다. 일 실시예에 따라 복호화부(120)는 현재 부호화 단위(1000 또는 1050)에 포함되는 홀수개의 부호화 단위를 결정할 수 있으며, 결정된 부호화 단위들의 크기 모두가 동일하지는 않을 수 있다. 예를 들면, 결정된 홀수개의 부호화 단위(1030a, 1030b, 1030c, 1080a, 1080b, 1080c) 중 소정의 부호화 단위(1030b 또는 1080b)의 크기는 다른 부호화 단위(1030a, 1030c, 1080a, 1080c)들과는 다른 크기를 가질 수도 있다. 즉, 현재 부호화 단위(1000 또는 1050)가 분할되어 결정될 수 있는 부호화 단위는 복수의 종류의 크기를 가질 수 있고, 경우에 따라서는 홀수개의 부호화 단위(1030a, 1030b, 1030c, 1080a, 1080b, 1080c)가 각각 서로 다른 크기를 가질 수도 있다.
일 실시예에 따라 분할 형태 정보가 홀수개의 블록으로 부호화 단위가 분할되는 것을 나타내는 경우, 복호화부(120)는 현재 부호화 단위(1000 또는 1050)에 포함되는 홀수개의 부호화 단위를 결정할 수 있고, 나아가 복호화부(120)는 분할하여 생성되는 홀수개의 부호화 단위들 중 적어도 하나의 부호화 단위에 대하여 소정의 제한을 둘 수 있다. 도 10를 참조하면 복호화부(120)는 현재 부호화 단위(1000 또는 1050)가 분할되어 생성된 3개의 부호화 단위(1030a, 1030b, 1030c, 1080a, 1080b, 1080c)들 중 중앙에 위치하는 부호화 단위(1030b, 1080b)에 대한 복호화 과정을 다른 부호화 단위(1030a, 1030c, 1080a, 1080c)와 다르게 할 수 있다. 예를 들면, 복호화부(120)는 중앙에 위치하는 부호화 단위(1030b, 1080b)에 대하여는 다른 부호화 단위(1030a, 1030c, 1080a, 1080c)와 달리 더 이상 분할되지 않도록 제한하거나, 소정의 횟수만큼만 분할되도록 제한할 수 있다.
도 11은 일 실시예에 따라 영상 복호화 장치(100)가 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 부호화 단위를 분할하는 과정을 도시한다.
일 실시예에 따라 복호화부(120)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 정사각형 형태의 제1 부호화 단위(1100)를 부호화 단위들로 분할하거나 분할하지 않는 것으로 결정할 수 있다. 일 실시예에 따라 분할 형태 정보가 수평 방향으로 제1 부호화 단위(1100)를 분할하는 것을 나타내는 경우, 복호화부(120)는 제1 부호화 단위(1100)를 수평 방향으로 분할하여 제2 부호화 단위(1110)를 결정할 수 있다. 일 실시예에 따라 이용되는 제1 부호화 단위, 제2 부호화 단위, 제3 부호화 단위는 부호화 단위 간의 분할 전후 관계를 이해하기 위해 이용된 용어이다. 예를 들면, 제1 부호화 단위를 분할하면 제2 부호화 단위가 결정될 수 있고, 제2 부호화 단위가 분할되면 제3 부호화 단위가 결정될 수 있다. 이하에서 이용되는 제1 부호화 단위, 제2 부호화 단위 및 제3 부호화 단위의 관계는 상술한 특징에 따르는 것으로 이해될 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 결정된 제2 부호화 단위(1110)를 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 부호화 단위들로 분할하거나 분할하지 않는 것으로 결정할 수 있다. 도 11을 참조하면 복호화부(120)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1100)를 분할하여 결정된 비-정사각형의 형태의 제2 부호화 단위(1110)를 적어도 하나의 제3 부호화 단위(1120a, 1120b, 1120c, 1120d 등)로 분할하거나 제2 부호화 단위(1110)를 분할하지 않을 수 있다. 영상 복호화 장치(100)의 비트스트림 획득부(110)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 획득할 수 있고 복호화부(120)는 획득한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1100)를 분할하여 다양한 형태의 복수개의 제2 부호화 단위(예를 들면, 1110)를 분할할 수 있으며, 제2 부호화 단위(1110)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1100)가 분할된 방식에 따라 분할될 수 있다.
일 실시예에 따라, 제1 부호화 단위(1100)가 제1 부호화 단위(1100)에 대한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제2 부호화 단위(1110)로 분할된 경우, 제2 부호화 단위(1110) 역시 제2 부호화 단위(1110)에 대한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제3 부호화 단위(예를 들면, 1120a, 1120b, 1120c, 1120d 등)으로 분할될 수 있다. 즉, 부호화 단위는 부호화 단위 각각에 관련된 분할 형태 정보 및 블록 형태 정보 중 적어도 하나에 기초하여 재귀적으로 분할될 수 있다. 따라서 비-정사각형 형태의 부호화 단위에서 정사각형의 부호화 단위가 결정될 수 있고, 이러한 정사각형 형태의 부호화 단위가 재귀적으로 분할되어 비-정사각형 형태의 부호화 단위가 결정될 수도 있다. 도 11을 참조하면, 비-정사각형 형태의 제2 부호화 단위(1110)가 분할되어 결정되는 홀수개의 제3 부호화 단위(1120b, 1120c, 1120d) 중 소정의 부호화 단위(예를 들면, 가운데에 위치하는 부호화 단위 또는 정사각형 형태의 부호화 단위)는 재귀적으로 분할될 수 있다. 일 실시예에 따라 홀수개의 제3 부호화 단위(1120b, 1120c, 1120d) 중 하나인 정사각형 형태의 제3 부호화 단위(1120c)는 수평 방향으로 분할되어 복수개의 제4 부호화 단위로 분할될 수 있다. 복수개의 제4 부호화 단위 중 하나인 비-정사각형 형태의 제4 부호화 단위(1140)는 다시 복수개의 부호화 단위들로 분할될 수 있다. 예를 들면, 비-정사각형 형태의 제4 부호화 단위(1140)는 홀수개의 부호화 단위(1150a, 1150b, 1150c)로 다시 분할될 수도 있다.
부호화 단위의 재귀적 분할에 이용될 수 있는 방법에 대하여는 다양한 실시예를 통해 후술하도록 한다.
일 실시예에 따라 복호화부(120)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제3 부호화 단위(1120a, 1120b, 1120c, 1120d 등) 각각을 부호화 단위들로 분할하거나 제2 부호화 단위(1110)를 분할하지 않는 것으로 결정할 수 있다. 복호화부(120)는 일 실시예에 따라 비-정사각형 형태의 제2 부호화 단위(1110)를 홀수개의 제3 부호화 단위(1120b, 1120c, 1120d)로 분할할 수 있다. 영상 복호화 장치(100)는 홀수개의 제3 부호화 단위(1120b, 1120c, 1120d) 중 소정의 제3 부호화 단위에 대하여 소정의 제한을 둘 수 있다. 예를 들면 영상 복호화 장치(100)는 홀수개의 제3 부호화 단위(1120b, 1120c, 1120d) 중 가운데에 위치하는 부호화 단위(1120c)에 대하여는 더 이상 분할되지 않는 것으로 제한하거나 또는 설정 가능한 횟수로 분할되어야 하는 것으로 제한할 수 있다. 도 11을 참조하면, 영상 복호화 장치(100)는 비-정사각형 형태의 제2 부호화 단위(1110)에 포함되는 홀수개의 제3 부호화 단위(1120b, 1120c, 1120d)들 중 가운데에 위치하는 부호화 단위(1120c)는 더 이상 분할되지 않거나, 소정의 분할 형태로 분할(예를 들면 4개의 부호화 단위로만 분할하거나 제2 부호화 단위(1110)가 분할된 형태에 대응하는 형태로 분할)되는 것으로 제한하거나, 소정의 회수로만 분할(예를 들면 n회만 분할, n>0)하는 것으로 제한할 수 있다. 다만 가운데에 위치한 부호화 단위(1120c)에 대한 상기 제한은 단순한 실시예들에 불과하므로 상술한 실시예들로 제한되어 해석되어서는 안되고, 가운데에 위치한 부호화 단위(1120c)가 다른 부호화 단위(1120b, 1120d)와 다르게 복호화 될 수 있는 다양한 제한들을 포함하는 것으로 해석되어야 한다.
일 실시예에 따라 영상 복호화 장치(100)는 현재 부호화 단위를 분할하기 위해 이용되는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 현재 부호화 단위 내의 소정의 위치에서 획득할 수 있다.
도 12는 일 실시예에 따라 복호화부(120)가 홀수개의 부호화 단위들 중 소정의 부호화 단위를 결정하기 위한 방법을 도시한다. 도 12를 참조하면, 현재 부호화 단위(1200)의 블록 형태 정보 및 분할 형태 정보 중 적어도 하나는 현재 부호화 단위(1200)에 포함되는 복수개의 샘플 중 소정 위치의 샘플(예를 들면, 가운데에 위치하는 샘플(1240))에서 획득될 수 있다. 다만 이러한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나가 획득될 수 있는 현재 부호화 단위(1200) 내의 소정 위치가 도 12에서 도시하는 가운데 위치로 한정하여 해석되어서는 안되고, 소정 위치에는 현재 부호화 단위(1200)내에 포함될 수 있는 다양한 위치(예를 들면, 최상단, 최하단, 좌측, 우측, 좌측상단, 좌측하단, 우측상단 또는 우측하단 등)가 포함될 수 있는 것으로 해석되어야 한다. 영상 복호화 장치(100)는 소정 위치로부터 획득되는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 획득하여 현재 부호화 단위를 다양한 형태 및 크기의 부호화 단위들로 분할하거나 분할하지 않는 것으로 결정할 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 현재 부호화 단위가 소정의 개수의 부호화 단위들로 분할된 경우 그 중 하나의 부호화 단위를 선택할 수 있다. 복수개의 부호화 단위들 중 하나를 선택하기 위한 방법은 다양할 수 있으며, 이러한 방법들에 대한 설명은 이하의 다양한 실시예를 통해 후술하도록 한다.
일 실시예에 따라 영상 복호화 장치(100)의 복호화부(120)는 현재 부호화 단위를 복수개의 부호화 단위들로 분할하고, 소정 위치의 부호화 단위를 결정할 수 있다.
도 12는 일 실시예에 따라 영상 복호화 장치(100)가 홀수개의 부호화 단위들 중 소정 위치의 부호화 단위를 결정하기 위한 방법을 도시한다.
일 실시예에 따라 복호화부(120)는 홀수개의 부호화 단위들 중 가운데에 위치하는 부호화 단위를 결정하기 위하여 홀수개의 부호화 단위들 각각의 위치를 나타내는 정보를 이용할 수 있다. 도 12를 참조하면, 복호화부(120)는 현재 부호화 단위(1200)를 분할하여 홀수개의 부호화 단위들(1220a, 1220b, 1220c)을 결정할 수 있다. 복호화부(120)는 홀수개의 부호화 단위들(1220a, 1220b, 1220c)의 위치에 대한 정보를 이용하여 가운데 부호화 단위(1220b)를 결정할 수 있다. 예를 들면 복호화부(120)는 부호화 단위들(1220a, 1220b, 1220c)에 포함되는 소정의 샘플의 위치를 나타내는 정보에 기초하여 부호화 단위들(1220a, 1220b, 1220c)의 위치를 결정함으로써 가운데에 위치하는 부호화 단위(1220b)를 결정할 수 있다. 구체적으로, 복호화부(120)는 부호화 단위들(1220a, 1220b, 1220c)의 좌측 상단의 샘플(1230a, 1230b, 1230c)의 위치를 나타내는 정보에 기초하여 부호화 단위(1220a, 1220b, 1220c)의 위치를 결정함으로써 가운데에 위치하는 부호화 단위(1220b)를 결정할 수 있다.
일 실시예에 따라 부호화 단위(1220a, 1220b, 1220c)에 각각 포함되는 좌측 상단의 샘플(1230a, 1230b, 1230c)의 위치를 나타내는 정보는 부호화 단위(1220a, 1220b, 1220c)의 픽쳐 내에서의 위치 또는 좌표에 대한 정보를 포함할 수 있다. 일 실시예에 따라 부호화 단위(1220a, 1220b, 1220c)에 각각 포함되는 좌측 상단의 샘플(1230a, 1230b, 1230c)의 위치를 나타내는 정보는 현재 부호화 단위(1200)에 포함되는 부호화단위(1220a, 1220b, 1220c)들의 너비 또는 높이를 나타내는 정보를 포함할 수 있고, 이러한 너비 또는 높이는 부호화 단위(1220a, 1220b, 1220c)의 픽쳐 내에서의 좌표 간의 차이를 나타내는 정보에 해당할 수 있다. 즉, 영상 복호화 장치(100)는 부호화 단위(1220a, 1220b, 1220c)의 픽쳐 내에서의 위치 또는 좌표에 대한 정보를 직접이용하거나 좌표간의 차이값을 나타내는 부호화 단위의 너비 또는 높이에 대한 정보를 이용함으로써 가운데에 위치하는 부호화 단위(1220b)를 결정할 수 있다.
일 실시예에 따라, 상단 부호화 단위(1220a)의 좌측 상단의 샘플(1230a)의 위치를 나타내는 정보는 (xa, ya) 좌표를 나타낼 수 있고, 가운데 부호화 단위(1220b)의 좌측 상단의 샘플(1230b)의 위치를 나타내는 정보는 (xb, yb) 좌표를 나타낼 수 있고, 하단 부호화 단위(1220c)의 좌측 상단의 샘플(1230c)의 위치를 나타내는 정보는 (xc, yc) 좌표를 나타낼 수 있다. 영상 복호화 장치(100)는 부호화 단위(1220a, 1220b, 1220c)에 각각 포함되는 좌측 상단의 샘플(1230a, 1230b, 1230c)의 좌표를 이용하여 가운데 부호화 단위(1220b)를 결정할 수 있다. 예를 들면, 좌측 상단의 샘플(1230a, 1230b, 1230c)의 좌표를 오름차순 또는 내림차순으로 정렬하였을 때, 가운데에 위치하는 샘플(1230b)의 좌표인 (xb, yb)를 포함하는 부호화 단위(1220b)를 현재 부호화 단위(1200)가 분할되어 결정된 부호화 단위(1220a, 1220b, 1220c) 중 가운데에 위치하는 부호화 단위로 결정할 수 있다. 다만 좌측 상단의 샘플(1230a, 1230b, 1230c)의 위치를 나타내는 좌표는 픽쳐 내에서의 절대적인 위치를 나타내는 좌표를 나타낼 수 있고, 나아가 상단 부호화 단위(1220a)의 좌측 상단의 샘플(1230a)의 위치를 기준으로, 가운데 부호화 단위(1220b)의 좌측 상단의 샘플(1230b)의 상대적 위치를 나타내는 정보인 (dxb, dyb)좌표, 하단 부호화 단위(1220c)의 좌측 상단의 샘플(1230c)의 상대적 위치를 나타내는 정보인 (dxc, dyc)좌표를 이용할 수도 있다. 또한 부호화 단위에 포함되는 샘플의 위치를 나타내는 정보로서 해당 샘플의 좌표를 이용함으로써 소정 위치의 부호화 단위를 결정하는 방법이 상술한 방법으로 한정하여 해석되어서는 안되고, 샘플의 좌표를 이용할 수 있는 다양한 산술적 방법으로 해석되어야 한다.
일 실시예에 따라 영상 복호화 장치(100)는 현재 부호화 단위(1200)를 복수개의 부호화 단위(1220a, 1220b, 1220c)로 분할할 수 있고, 부호화 단위(1220a, 1220b, 1220c)들 중 소정의 기준에 따라 부호화 단위를 선택할 수 있다. 예를 들면, 복호화부(120)는 부호화 단위(1220a, 1220b, 1220c) 중 크기가 다른 부호화 단위(1220b)를 선택할 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 상단 부호화 단위(1220a)의 좌측 상단의 샘플(1230a)의 위치를 나타내는 정보인 (xa, ya) 좌표, 가운데 부호화 단위(1220b)의 좌측 상단의 샘플(1230b)의 위치를 나타내는 정보인 (xb, yb) 좌표, 하단 부호화 단위(1220c)의 좌측 상단의 샘플(1230c)의 위치를 나타내는 정보인 (xc, yc) 좌표를 이용하여 부호화 단위(1220a, 1220b, 1220c) 각각의 너비 또는 높이를 결정할 수 있다. 영상 복호화 장치(100)는 부호화 단위(1220a, 1220b, 1220c)의 위치를 나타내는 좌표인 (xa, ya), (xb, yb), (xc, yc)를 이용하여 부호화 단위(1220a, 1220b, 1220c) 각각의 크기를 결정할 수 있다.
일 실시예에 따라, 영상 복호화 장치(100)는 상단 부호화 단위(1220a)의 너비를 xb-xa로 결정할 수 있고 높이를 yb-ya로 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 가운데 부호화 단위(1220b)의 너비를 xc-xb로 결정할 수 있고 높이를 yc-yb로 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 하단 부호화 단위의 너비 또는 높이는 현재 부호화 단위의 너비 또는 높이와 상단 부호화 단위(1220a) 및 가운데 부호화 단위(1220b)의 너비 및 높이를 이용하여 결정할 수 있다. 복호화부(120)는 결정된 부호화 단위(1220a, 1220b, 1220c)의 너비 및 높이에 기초하여 다른 부호화 단위와 다른 크기를 갖는 하나의 부호화 단위를 결정할 수 있다. 도 12를 참조하면, 영상 복호화 장치(100)는 상단 부호화 단위(1220a) 및 하단 부호화 단위(1220c)의 크기와 다른 크기를 가지는 가운데 부호화 단위(1220b)를 소정 위치의 부호화 단위로 결정할 수 있다. 다만 상술한 영상 복호화 장치(100)가 다른 부호화 단위와 다른 크기를 갖는 부호화 단위를 결정하는 과정은 샘플 좌표에 기초하여 결정되는 부호화 단위의 크기를 이용하여 소정 위치의 부호화 단위를 결정하는 일 실시예에 불과하므로, 소정의 샘플 좌표에 따라 결정되는 부호화 단위의 크기를 비교하여 소정 위치의 부호화 단위를 결정하는 다양한 과정이 이용될 수 있다.
다만 부호화 단위의 위치를 결정하기 위하여 고려하는 샘플의 위치는 상술한 좌측 상단으로 한정하여 해석되어서는 안되고 부호화 단위에 포함되는 임의의 샘플의 위치에 대한 정보가 이용될 수 있는 것으로 해석될 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 현재 부호화 단위의 형태를 고려하여, 현재 부호화 단위가 분할되어 결정되는 홀수개의 부호화 단위들 중 소정 위치의 부호화 단위를 선택할 수 있다. 예를 들면, 현재 부호화 단위가 너비가 높이보다 긴 비-정사각형 형태라면 복호화부(120)는 수평 방향에 따라 소정 위치의 부호화 단위를 결정할 수 있다. 즉, 복호화부(120)는 수평 방향으로 위치를 달리 하는 부호화 단위들 중 하나를 결정하여 해당 부호화 단위에 대한 제한을 둘 수 있다. 현재 부호화 단위가 높이가 너비보다 긴 비-정사각형 형태라면 복호화부(120)는 수직 방향에 따라 소정 위치의 부호화 단위를 결정할 수 있다. 즉, 복호화부(120)는 수직 방향으로 위치를 달리 하는 부호화 단위들 중 하나를 결정하여 해당 부호화 단위에 대한 제한을 둘 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 짝수개의 부호화 단위들 중 소정 위치의 부호화 단위를 결정하기 위하여 짝수개의 부호화 단위들 각각의 위치를 나타내는 정보를 이용할 수 있다. 복호화부(120)는 현재 부호화 단위를 분할하여 짝수개의 부호화 단위들을 결정할 수 있고 짝수개의 부호화 단위들의 위치에 대한 정보를 이용하여 소정 위치의 부호화 단위를 결정할 수 있다. 이에 대한 구체적인 과정은 도 12에서 상술한 홀수개의 부호화 단위들 중 소정 위치(예를 들면, 가운데 위치)의 부호화 단위를 결정하는 과정에 유사한 과정일 수 있으므로 생략하도록 한다.
일 실시예에 따라, 비-정사각형 형태의 현재 부호화 단위를 복수개의 부호화 단위로 분할한 경우, 복수개의 부호화 단위들 중 소정 위치의 부호화 단위를 결정하기 위하여 분할 과정에서 소정 위치의 부호화 단위에 대한 소정의 정보를 이용할 수 있다. 예를 들면 영상 복호화 장치(100)의 복호화부(120)는 현재 부호화 단위가 복수개로 분할된 부호화 단위들 중 가운데에 위치하는 부호화 단위를 결정하기 위하여 분할 과정에서 가운데 부호화 단위에 포함된 샘플에 저장된 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 이용할 수 있다.
도 12를 참조하면 영상 복호화 장치(100)의 복호화부(120)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 현재 부호화 단위(1200)를 복수개의 부호화 단위들(1220a, 1220b, 1220c)로 분할할 수 있으며, 복수개의 부호화 단위들(1220a, 1220b, 1220c) 중 가운데에 위치하는 부호화 단위(1220b)를 결정할 수 있다. 나아가 복호화부(120)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나가 획득되는 위치를 고려하여, 가운데에 위치하는 부호화 단위(1220b)를 결정할 수 있다. 즉, 현재 부호화 단위(1200)의 블록 형태 정보 및 분할 형태 정보 중 적어도 하나는 현재 부호화 단위(1200)의 가운데에 위치하는 샘플(1240)에서 획득될 수 있으며, 상기 블록 형태 정보 및 상기 분할 형태 정보 중 적어도 하나에 기초하여 현재 부호화 단위(1200)가 복수개의 부호화 단위들(1220a, 1220b, 1220c)로 분할된 경우 상기 샘플(1240)을 포함하는 부호화 단위(1220b)를 가운데에 위치하는 부호화 단위로 결정할 수 있다. 다만 가운데에 위치하는 부호화 단위로 결정하기 위해 이용되는 정보가 블록 형태 정보 및 분할 형태 정보 중 적어도 하나로 한정하여 해석되어서는 안되고, 다양한 종류의 정보가 가운데에 위치하는 부호화 단위를 결정하는 과정에서 이용될 수 있다.
일 실시예에 따라 소정 위치의 부호화 단위를 식별하기 위한 소정의 정보는, 결정하려는 부호화 단위에 포함되는 소정의 샘플에서 획득될 수 있다. 도 12를 참조하면, 복호화부(120)는 현재 부호화 단위(1200)가 분할되어 결정된 복수개의 부호화 단위들(1220a, 1220b, 1220c) 중 소정 위치의 부호화 단위(예를 들면, 복수개로 분할된 부호화 단위 중 가운데에 위치하는 부호화 단위)를 결정하기 위하여 현재 부호화 단위(1200) 내의 소정 위치의 샘플(예를 들면, 현재 부호화 단위(1200)의 가운데에 위치하는 샘플)에서 획득되는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 이용할 수 있다. 즉, 복호화부(120)는 현재 부호화 단위(1200)의 블록 블록 형태를 고려하여 상기 소정 위치의 샘플을 결정할 수 있고, 복호화부(120)는 현재 부호화 단위(1200)가 분할되어 결정되는 복수개의 부호화 단위(1220a, 1220b, 1220c)들 중, 소정의 정보(예를 들면, 블록 형태 정보 및 분할 형태 정보 중 적어도 하나)가 획득될 수 있는 샘플이 포함된 부호화 단위(1220b)를 결정하여 소정의 제한을 둘 수 있다. 도 12를 참조하면 일 실시예에 따라 복호화부(120)는 소정의 정보가 획득될 수 있는 샘플로서 현재 부호화 단위(1200)의 가운데에 위치하는 샘플(1240)을 결정할 수 있고, 복호화부(120)는 이러한 샘플(1240)이 포함되는 부호화 단위(1220b)를 복호화 과정에서의 소정의 제한을 둘 수 있다. 다만 소정의 정보가 획득될 수 있는 샘플의 위치는 상술한 위치로 한정하여 해석되어서는 안되고, 제한을 두기 위해 결정하려는 부호화 단위(1220b)에 포함되는 임의의 위치의 샘플들로 해석될 수 있다.
일 실시예에 따라 소정의 정보가 획득될 수 있는 샘플의 위치는 현재 부호화 단위(1200)의 형태에 따라 결정될 수 있다. 일 실시예에 따라 블록 형태 정보는 현재 부호화 단위의 형태가 정사각형인지 또는 비-정사각형인지 여부를 결정할 수 있고, 형태에 따라 소정의 정보가 획득될 수 있는 샘플의 위치를 결정할 수 있다. 예를 들면, 복호화부(120)는 현재 부호화 단위의 너비에 대한 정보 및 높이에 대한 정보 중 적어도 하나를 이용하여 현재 부호화 단위의 너비 및 높이 중 적어도 하나를 반으로 분할하는 경계 상에 위치하는 샘플을 소정의 정보가 획득될 수 있는 샘플로 결정할 수 있다. 또다른 예를 들면, 복호화부(120)는 현재 부호화 단위에 관련된 블록 형태 정보가 비-정사각형 형태임을 나타내는 경우, 현재 부호화 단위의 긴 변을 반으로 분할하는 경계에 인접하는 샘플 중 하나를 소정의 정보가 획득될 수 있는 샘플로 결정할 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 현재 부호화 단위를 복수개의 부호화 단위로 분할한 경우, 복수개의 부호화 단위들 중 소정 위치의 부호화 단위를 결정하기 위하여, 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 이용할 수 있다. 일 실시예에 따라 비트스트림 획득부(110)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 부호화 단위에 포함된 소정 위치의 샘플에서 획득할 수 있고, 복호화부(120)는 현재 부호화 단위가 분할되어 생성된 복수개의 부호화 단위들을 복수개의 부호화 단위 각각에 포함된 소정 위치의 샘플로부터 획득되는 분할 형태 정보 및 블록 형태 정보 중 적어도 하나를 이용하여 분할할 수 있다. 즉, 부호화 단위는 부호화 단위 각각에 포함된 소정 위치의 샘플에서 획득되는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 이용하여 재귀적으로 분할될 수 있다. 부호화 단위의 재귀적 분할 과정에 대하여는 도 11을 통해 상술하였으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 영상 복호화 장치(100)는 현재 부호화 단위를 분할하여 적어도 하나의 부호화 단위를 결정할 수 있고, 이러한 적어도 하나의 부호화 단위가 복호화되는 순서를 소정의 블록(예를 들면, 현재 부호화 단위)에 따라 결정할 수 있다.
도 13은 일 실시예에 따라 영상 복호화 장치(100)가 현재 부호화 단위를 분할하여 복수개의 부호화 단위들을 결정하는 경우, 복수개의 부호화 단위들이 처리되는 순서를 도시한다.
일 실시예에 따라 복호화부(120)는 블록 형태 정보 및 분할 형태 정보에 따라 제1 부호화 단위(1300)를 수직 방향으로 분할하여 제2 부호화 단위(1310a, 1310b)를 결정하거나 제1 부호화 단위(1300)를 수평 방향으로 분할하여 제2 부호화 단위(1330a, 1330b)를 결정하거나 제1 부호화 단위(1300)를 수직 방향 및 수평 방향으로 분할하여 제2 부호화 단위(1350a, 1350b, 1350c, 1350d)를 결정할 수 있다.
도 13을 참조하면, 복호화부(120)는 제1 부호화 단위(1300)를 수직 방향으로 분할하여 결정된 제2 부호화 단위(1310a, 1310b)를 수평 방향(1310c)으로 처리되도록 순서를 결정할 수 있다. 영상 복호화 장치(100)는 제1 부호화 단위(1300)를 수평 방향으로 분할하여 결정된 제2 부호화 단위(1330a, 1330b)의 처리 순서를 수직 방향(1330c)으로 결정할 수 있다. 영상 복호화 장치(100)는 제1 부호화 단위(1300)를 수직 방향 및 수평 방향으로 분할하여 결정된 제2 부호화 단위(1350a, 1350b, 1350c, 1350d)를 하나의 행에 위치하는 부호화 단위들이 처리된 후 다음 행에 위치하는 부호화 단위들이 처리되는 소정의 순서(예를 들면, 래스터 스캔 순서(raster scan order) 또는 z 스캔 순서(z scan order)(1350e) 등)에 따라 결정할 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 부호화 단위들을 재귀적으로 분할할 수 있다. 도 13을 참조하면, 복호화부(120)는 제1 부호화 단위(1300)를 분할하여 복수개의 부호화 단위들(1310a, 1310b, 1330a, 1330b, 1350a, 1350b, 1350c, 1350d)을 결정할 수 있고, 결정된 복수개의 부호화 단위들(1310a, 1310b, 1330a, 1330b, 1350a, 1350b, 1350c, 1350d) 각각을 재귀적으로 분할할 수 있다. 복수개의 부호화 단위들(1310a, 1310b, 1330a, 1330b, 1350a, 1350b, 1350c, 1350d)을 분할하는 방법은 제1 부호화 단위(1300)를 분할하는 방법에 유사한 방법이 될 수 있다. 이에 따라 복수개의 부호화 단위들(1310a, 1310b, 1330a, 1330b, 1350a, 1350b, 1350c, 1350d)은 각각 독립적으로 복수개의 부호화 단위들로 분할될 수 있다. 도 13을 참조하면 복호화부(120)는 제1 부호화 단위(1300)를 수직 방향으로 분할하여 제2 부호화 단위(1310a, 1310b)를 결정할 수 있고, 나아가 제2 부호화 단위(1310a, 1310b) 각각을 독립적으로 분할하거나 분할하지 않는 것으로 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 좌측의 제2 부호화 단위(1310a)를 수평 방향으로 분할하여 제3 부호화 단위(1320a, 1320b)로 분할할 수 있고, 우측의 제2 부호화 단위(1310b)는 분할하지 않을 수 있다.
일 실시예에 따라 부호화 단위들의 처리 순서는 부호화 단위의 분할 과정에 기초하여 결정될 수 있다. 다시 말해, 분할된 부호화 단위들의 처리 순서는 분할되기 전의 부호화 단위들의 처리 순서에 기초하여 결정될 수 있다. 복호화부(120)는 좌측의 제2 부호화 단위(1310a)가 분할되어 결정된 제3 부호화 단위(1320a, 1320b)가 처리되는 순서를 우측의 제2 부호화 단위(1310b)와 독립적으로 결정할 수 있다. 좌측의 제2 부호화 단위(1310a)가 수평 방향으로 분할되어 제3 부호화 단위(1320a, 1320b)가 결정되었으므로 제3 부호화 단위(1320a, 1320b)는 수직 방향(1320c)으로 처리될 수 있다. 또한 좌측의 제2 부호화 단위(1310a) 및 우측의 제2 부호화 단위(1310b)가 처리되는 순서는 수평 방향(1310c)에 해당하므로, 좌측의 제2 부호화 단위(1310a)에 포함되는 제3 부호화 단위(1320a, 1320b)가 수직 방향(1320c)으로 처리된 후에 우측 부호화 단위(1310b)가 처리될 수 있다. 상술한 내용은 부호화 단위들이 각각 분할 전의 부호화 단위에 따라 처리 순서가 결정되는 과정을 설명하기 위한 것이므로, 상술한 실시예에 한정하여 해석되어서는 안되고, 다양한 형태로 분할되어 결정되는 부호화 단위들이 소정의 순서에 따라 독립적으로 처리될 수 있는 다양한 방법으로 이용되는 것으로 해석되어야 한다.
도 14는 일 실시예에 따라 영상 복호화 장치(100)가 소정의 순서로 부호화 단위가 처리될 수 없는 경우, 현재 부호화 단위가 홀수개의 부호화 단위로 분할되는 것임을 결정하는 과정을 도시한다.
일 실시예에 따라 영상 복호화 장치(100)는 비트스트림 획득부(110)가 획득한 블록 형태 정보 및 분할 형태 정보에 기초하여 현재 부호화 단위가 홀수개의 부호화 단위들로 분할되는 것을 결정할 수 있다. 도 14를 참조하면 정사각형 형태의 제1 부호화 단위(1400)가 비-정사각형 형태의 제2 부호화 단위(1410a, 1410b)로 분할될 수 있고, 제2 부호화 단위(1410a, 1410b)는 각각 독립적으로 제3 부호화 단위(1420a, 1420b, 1420c, 1420d, 1420e)로 분할될 수 있다. 일 실시예에 따라 복호화부(120)는 제2 부호화 단위 중 좌측 부호화 단위(1410a)는 수평 방향으로 분할하여 복수개의 제3 부호화 단위(1420a, 1420b)를 결정할 수 있고, 우측 부호화 단위(1410b)는 홀수개의 제3 부호화 단위(1420c, 1420d, 1420e)로 분할할 수 있다.
일 실시예에 따라 복호화부(120)는 제3 부호화 단위들(1420a, 1420b, 1420c, 1420d, 1420e)이 소정의 순서로 처리될 수 있는지 여부를 판단하여 홀수개로 분할된 부호화 단위가 존재하는지를 결정할 수 있다. 도 14를 참조하면, 복호화부(120)는 제1 부호화 단위(1400)를 재귀적으로 분할하여 제3 부호화 단위(1420a, 1420b, 1420c, 1420d, 1420e)를 결정할 수 있다. 복호화부(120)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여, 제1 부호화 단위(1400), 제2 부호화 단위(1410a, 1410b) 또는 제3 부호화 단위(1420a, 1420b, 1420c, 1420d, 1420e)가 분할되는 형태 중 홀수개의 부호화 단위로 분할되는지 여부를 결정할 수 있다. 예를 들면, 제2 부호화 단위(1410a, 1410b) 중 우측에 위치하는 부호화 단위가 홀수개의 제3 부호화 단위(1420c, 1420d, 1420e)로 분할될 수 있다. 제1 부호화 단위(1400)에 포함되는 복수개의 부호화 단위들이 처리되는 순서는 소정의 순서(예를 들면, z-스캔 순서(z-scan order)(1430))가 될 수 있고, 복호화부(120)는 우측 제2 부호화 단위(1410b)가 홀수개로 분할되어 결정된 제3 부호화 단위(1420c, 1420d, 1420e)가 상기 소정의 순서에 따라 처리될 수 있는 조건을 만족하는지를 판단할 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 제1 부호화 단위(1400)에 포함되는 제3 부호화 단위(1420a, 1420b, 1420c, 1420d, 1420e)가 소정의 순서에 따라 처리될 수 있는 조건을 만족하는지를 결정할 수 있으며, 상기 조건은 제3 부호화 단위(1420a, 1420b, 1420c, 1420d, 1420e)의 경계에 따라 제2 부호화 단위(1410a, 1410b)의 너비 및 높이 중 적어도 하나를 반으로 분할되는지 여부와 관련된다. 예를 들면 비-정사각형 형태의 좌측 제2 부호화 단위(1410a)의 높이를 반으로 분할하여 결정되는 제3 부호화 단위(1420a, 1420b)는 조건을 만족하지만, 우측 제2 부호화 단위(1410b)를 3개의 부호화 단위로 분할하여 결정되는 제3 부호화 단위(1420c, 1420d, 1420e)들의 경계가 우측 제2 부호화 단위(1410b)의 너비 또는 높이를 반으로 분할하지 못하므로 제3 부호화 단위(1420c, 1420d, 1420e)는 조건을 만족하지 못하는 것으로 결정될 수 있고, 영상 복호화 장치(100)는 이러한 조건 불만족의 경우 스캔 순서의 단절(disconnection)로 판단하고, 판단 결과에 기초하여 우측 제2 부호화 단위(1410b)는 홀수개의 부호화 단위로 분할되는 것으로 결정할 수 있다. 일 실시예에 따라 영상 복호화 장치(100)는 홀수개의 부호화 단위로 분할되는 경우 분할된 부호화 단위들 중 소정 위치의 부호화 단위에 대하여 소정의 제한을 둘 수 있으며, 이러한 제한 내용 또는 소정 위치 등에 대하여는 다양한 실시예를 통해 상술하였으므로 자세한 설명은 생략하도록 한다.
도 15는 일 실시예에 따라 영상 복호화 장치(100)가 제1 부호화 단위(1500)를 분할하여 적어도 하나의 부호화 단위를 결정하는 과정을 도시한다. 일 실시예에 따라 복호화부(120)는 비트스트림 획득부(110)를 통해 획득한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1500)를 분할할 수 있다. 정사각형 형태의 제1 부호화 단위(1500)는 4개의 정사각형 형태를 가지는 부호화 단위로 분할되거나 또는 비-정사각형 형태의 복수개의 부호화 단위로 분할할 수 있다. 예를 들면 도 15를 참조하면, 블록 형태 정보가 제1 부호화 단위(1500)는 정사각형임을 나타내고 분할 형태 정보가 비-정사각형의 부호화 단위로 분할됨을 나타내는 경우 복호화부(120)는 제1 부호화 단위(1500)를 복수개의 비-정사각형의 부호화 단위들로 분할할 수 있다. 구체적으로, 분할 형태 정보가 제1 부호화 단위(1500)를 수평 방향 또는 수직 방향으로 분할하여 홀수개의 부호화 단위를 결정하는 것을 나타내는 경우, 복호화부(120)는 정사각형 형태의 제1 부호화 단위(1500)을 홀수개의 부호화 단위들로서 수직 방향으로 분할되어 결정된 제2 부호화 단위(1510a, 1510b, 1510c) 또는 수평 방향으로 분할되어 결정된 제2 부호화 단위(1520a, 1520b, 1520c)로 분할할 수 있다.
일 실시예에 따라 복호화부(120)는 제1 부호화 단위(1500)에 포함되는 제2 부호화 단위(1510a, 1510b, 1510c, 1520a, 1520b, 1520c)가 소정의 순서에 따라 처리될 수 있는 조건을 만족하는지를 결정할 수 있으며, 상기 조건은 제2 부호화 단위(1510a, 1510b, 1510c, 1520a, 1520b, 1520c)의 경계에 따라 제1 부호화 단위(1500)의 너비 및 높이 중 적어도 하나를 반으로 분할되는지 여부와 관련된다. 도 15를 참조하면 정사각형 형태의 제1 부호화 단위(1500)를 수직 방향으로 분할하여 결정되는 제2 부호화 단위(1510a, 1510b, 1510c)들의 경계가 제1 부호화 단위(1500)의 너비를 반으로 분할하지 못하므로 제1 부호화 단위(1500)는 소정의 순서에 따라 처리될 수 있는 조건을 만족하지 못하는 것으로 결정될 수 있다. 또한 정사각형 형태의 제1 부호화 단위(1500)를 수평 방향으로 분할하여 결정되는 제2 부호화 단위(1520a, 1520b, 1520c)들의 경계가 제1 부호화 단위(1500)의 너비를 반으로 분할하지 못하므로 제1 부호화 단위(1500)는 소정의 순서에 따라 처리될 수 있는 조건을 만족하지 못하는 것으로 결정될 수 있다. 영상 복호화 장치(100)는 이러한 조건 불만족의 경우 스캔 순서의 단절(disconnection)로 판단하고, 판단 결과에 기초하여 제1 부호화 단위(1500)는 홀수개의 부호화 단위로 분할되는 것으로 결정할 수 있다. 일 실시예에 따라 영상 복호화 장치(100)는 홀수개의 부호화 단위로 분할되는 경우 분할된 부호화 단위들 중 소정 위치의 부호화 단위에 대하여 소정의 제한을 둘 수 있으며, 이러한 제한 내용 또는 소정 위치 등에 대하여는 다양한 실시예를 통해 상술하였으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라, 영상 복호화 장치(100)는 제1 부호화 단위를 분할하여 다양한 형태의 부호화 단위들을 결정할 수 있다.
도 15를 참조하면, 영상 복호화 장치(100)는 정사각형 형태의 제1 부호화 단위(1500), 비-정사각형 형태의 제1 부호화 단위(1530 또는 1550)를 다양한 형태의 부호화 단위들로 분할할 수 있다.
도 16은 일 실시예에 따라 영상 복호화 장치(160)가 제1 부호화 단위(1600)가 분할되어 결정된 비-정사각형 형태의 제2 부호화 단위가 소정의 조건을 만족하는 경우 제2 부호화 단위가 분할될 수 있는 형태가 제한되는 것을 도시한다.
일 실시예에 따라 복호화부(120)는 비트스트림 획득부(116)를 통해 획득한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 정사각형 형태의 제1 부호화 단위(1600)를 비-정사각형 형태의 제2 부호화 단위(1610a, 1610b, 1620a, 1620b)로 분할하는 것으로 결정할 수 있다. 제2 부호화 단위(1610a, 1610b, 1620a, 1620b)는 독립적으로 분할될 수 있다. 이에 따라 복호화부(120)는 제2 부호화 단위(1610a, 1610b, 1620a, 1620b) 각각에 관련된 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 복수개의 부호화 단위로 분할하거나 분할하지 않는 것을 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 수직 방향으로 제1 부호화 단위(1600)가 분할되어 결정된 비-정사각형 형태의 좌측 제2 부호화 단위(1610a)를 수평 방향으로 분할하여 제3 부호화 단위(1612a, 1612b)를 결정할 수 있다. 다만 복호화부(120)는 좌측 제2 부호화 단위(1610a)를 수평 방향으로 분할한 경우, 우측 제2 부호화 단위(1610b)는 좌측 제2 부호화 단위(1610a)가 분할된 방향과 동일하게 수평 방향으로 분할될 수 없도록 제한할 수 있다. 만일 우측 제2 부호화 단위(1610b)가 동일한 방향으로 분할되어 제3 부호화 단위(1614a, 1614b)가 결정된 경우, 좌측 제2 부호화 단위(1610a) 및 우측 제2 부호화 단위(1610b)가 수평 방향으로 각각 독립적으로 분할됨으로써 제3 부호화 단위(1612a, 1612b, 1614a, 1614b)가 결정될 수 있다. 하지만 이는 복호화부(120)가 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1600)를 4개의 정사각형 형태의 제2 부호화 단위(1630a, 1630b, 1630c, 1630d)로 분할한 것과 동일한 결과이며 이는 영상 복호화 측면에서 비효율적일 수 있다.
일 실시예에 따라 복호화부(120)는 수평 방향으로 제1 부호화 단위(900)가 분할되어 결정된 비-정사각형 형태의 제2 부호화 단위(1620a 또는 1620b)를 수직 방향으로 분할하여 제3 부호화 단위(1622a, 1622b, 1624a, 1624b)를 결정할 수 있다. 다만 복호화부(120)는 제2 부호화 단위 중 하나(예를 들면 상단 제2 부호화 단위(1620a))를 수직 방향으로 분할한 경우, 상술한 이유에 따라 다른 제2 부호화 단위(예를 들면 하단 부호화 단위(1620b))는 상단 제2 부호화 단위(1620a)가 분할된 방향과 동일하게 수직 방향으로 분할될 수 없도록 제한할 수 있다.
도 17은 일 실시예에 따라 분할 형태 정보가 4개의 정사각형 형태의 부호화 단위로 분할하는 것을 나타낼 수 없는 경우, 영상 복호화 장치(100)가 정사각형 형태의 부호화 단위를 분할하는 과정을 도시한다.
일 실시예에 따라 복호화부(120)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1700)를 분할하여 제2 부호화 단위(1710a, 1710b, 1720a, 1720b 등)를 결정할 수 있다. 분할 형태 정보에는 부호화 단위가 분할될 수 있는 다양한 형태에 대한 정보가 포함될 수 있으나, 다양한 형태에 대한 정보에는 정사각형 형태의 4개의 부호화 단위로 분할하기 위한 정보가 포함될 수 없는 경우가 있다. 이러한 분할 형태 정보에 따르면, 복호화부(120)는 정사각형 형태의 제1 부호화 단위(1700)를 4개의 정사각형 형태의 제2 부호화 단위(1730a, 1730b, 1730c, 1730d)로 분할하지 못한다. 분할 형태 정보에 기초하여 복호화부(120)는 비-정사각형 형태의 제2 부호화 단위(1710a, 1710b, 1720a, 1720b 등)를 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 비-정사각형 형태의 제2 부호화 단위(1710a, 1710b, 1720a, 1720b 등)를 각각 독립적으로 분할할 수 있다. 재귀적인 방법을 통해 제2 부호화 단위(1710a, 1710b, 1720a, 1720b 등) 각각이 소정의 순서대로 분할될 수 있으며, 이는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1700)가 분할되는 방법에 유사한 분할 방법일 수 있다.
예를 들면 복호화부(120)는 좌측 제2 부호화 단위(1710a)가 수평 방향으로 분할되어 정사각형 형태의 제3 부호화 단위(1712a, 1712b)를 결정할 수 있고, 우측 제2 부호화 단위(1710b)가 수평 방향으로 분할되어 정사각형 형태의 제3 부호화 단위(1714a, 1714b)를 결정할 수 있다. 나아가 복호화부(120)는 좌측 제2 부호화 단위(1710a) 및 우측 제2 부호화 단위(1710b) 모두 수평 방향으로 분할되어 정사각형 형태의 제3 부호화 단위(1716a, 1716b, 1716c, 1716d)를 결정할 수도 있다. 이러한 경우 제1 부호화 단위(1700)가 4개의 정사각형 형태의 제2 부호화 단위(1730a, 1730b, 1730c, 1730d)로 분할된 것과 동일한 형태로 부호화 단위가 결정될 수 있다.
또 다른 예를 들면 복호화부(120)는 상단 제2 부호화 단위(1720a)가 수직 방향으로 분할되어 정사각형 형태의 제3 부호화 단위(1722a, 1722b)를 결정할 수 있고, 하단 제2 부호화 단위(1720b)가 수직 방향으로 분할되어 정사각형 형태의 제3 부호화 단위(1724a, 1724b)를 결정할 수 있다. 나아가 복호화부(120)는 상단 제2 부호화 단위(1720a) 및 하단 제2 부호화 단위(1720b) 모두 수직 방향으로 분할되어 정사각형 형태의 제3 부호화 단위(1722a, 1722b, 1724a, 1724b)를 결정할 수도 있다. 이러한 경우 제1 부호화 단위(1700)가 4개의 정사각형 형태의 제2 부호화 단위(1730a, 1730b, 1730c, 1730d)로 분할된 것과 동일한 형태로 부호화 단위가 결정될 수 있다.
도 18은 일 실시예에 따라 복수개의 부호화 단위들 간의 처리 순서가 부호화 단위의 분할 과정에 따라 달라질 수 있음을 도시한 것이다.
일 실시예에 따라 복호화부(120)는 블록 형태 정보 및 분할 형태 정보에 기초하여 제1 부호화 단위(1800)를 분할할 수 있다. 블록 형태 정보가 정사각형 형태를 나타내고, 분할 형태 정보가 제1 부호화 단위(1800)가 수평 방향 및 수직 방향 중 적어도 하나의 방향으로 분할됨을 나타내는 경우, 복호화부(120)는 제1 부호화 단위(1800)를 분할하여 제2 부호화 단위(예를 들면, 1810a, 1810b, 1820a, 1820b, 1830a, 1830b, 1830c, 1830d 등)를 결정할 수 있다. 도 18을 참조하면 제1 부호화 단위1800)가 수평 방향 또는 수직 방향만으로 분할되어 결정된 비-정사각형 형태의 제2 부호화 단위(1810a, 1810b, 1820a, 1820b)는 각각에 대한 블록 형태 정보 및 분할 형태 정보에 기초하여 독립적으로 분할될 수 있다. 예를 들면 복호화부(120)는 제1 부호화 단위(1800)가 수직 방향으로 분할되어 생성된 제2 부호화 단위(1810a, 1810b)를 수평 방향으로 각각 분할하여 제3 부호화 단위(1816a, 1816b, 1816c, 1816d)를 결정할 수 있고, 제1 부호화 단위(1800)가 수평 방향으로 분할되어 생성된 제2 부호화 단위(1820a, 1820b)를 수평 방향으로 각각 분할하여 제3 부호화 단위(1826a, 1826b, 1826c, 1826d)를 결정할 수 있다. 이러한 제2 부호화 단위(1810a, 1810b, 1820a, 1820b)의 분할 과정은 도 16과 관련하여 상술하였으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 복호화부(120)는 소정의 순서에 따라 부호화 단위를 처리할 수 있다. 소정의 순서에 따른 부호화 단위의 처리에 대한 특징은 도 13과 관련하여 상술하였으므로 자세한 설명은 생략하도록 한다. 도 18을 참조하면 복호화부(120)는 정사각형 형태의 제1 부호화 단위(1800)를 분할하여 4개의 정사각형 형태의 제3 부호화 단위(1816a, 1816b, 1816c, 1816d, 1826a, 1826b, 1826c, 1826d)를 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 제1 부호화 단위(1800)가 분할되는 형태에 따라 제3 부호화 단위(1816a, 1816b, 1816c, 1816d, 1826a, 1826b, 1826c, 1826d)의 처리 순서를 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 수직 방향으로 분할되어 생성된 제2 부호화 단위(1810a, 1810b)를 수평 방향으로 각각 분할하여 제3 부호화 단위(1816a, 1816b, 1816c, 1816d)를 결정할 수 있고, 복호화부(120)는 좌측 제2 부호화 단위(1810a)에 포함되는 제3 부호화 단위(1816a, 1816b)를 수직 방향으로 먼저 처리한 후, 우측 제2 부호화 단위(1810b)에 포함되는 제3 부호화 단위(1816c, 1816d)를 수직 방향으로 처리하는 순서(1817)에 따라 제3 부호화 단위(1816a, 1816b, 1816c, 1816d)를 처리할 수 있다.
일 실시예에 따라 복호화부(120)는 수평 방향으로 분할되어 생성된 제2 부호화 단위(1820a, 1820b)를 수직 방향으로 각각 분할하여 제3 부호화 단위(1826a, 1826b, 1826c, 1826d)를 결정할 수 있고, 복호화부(120)는 상단 제2 부호화 단위(1820a)에 포함되는 제3 부호화 단위(1826a, 1826b)를 수평 방향으로 먼저 처리한 후, 하단 제2 부호화 단위(1820b)에 포함되는 제3 부호화 단위(1826c, 1826d)를 수평 방향으로 처리하는 순서(1827)에 따라 제3 부호화 단위(1826a, 1826b, 1826c, 1826d)를 처리할 수 있다.
도 18을 참조하면, 제2 부호화 단위(1810a, 1810b, 1820a, 1820b)가 각각 분할되어 정사각형 형태의 제3 부호화 단위(1816a, 1816b, 1816c, 1816d, 1826a, 1826b, 1826c, 1826d)가 결정될 수 있다. 수직 방향으로 분할되어 결정된 제2 부호화 단위(1810a, 1810b) 및 수평 방향으로 분할되어 결정된 제2 부호화 단위(1820a, 1820b)는 서로 다른 형태로 분할된 것이지만, 이후에 결정되는 제3 부호화 단위(1816a, 1816b, 1816c, 1816d, 1826a, 1826b, 1826c, 1826d)에 따르면 결국 동일한 형태의 부호화 단위들로 제1 부호화 단위(1800)가 분할된 결과가 된다. 이에 따라 복호화부(120)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 상이한 과정을 통해 재귀적으로 부호화 단위를 분할함으로써 결과적으로 동일한 형태의 부호화 단위들을 결정하더라도, 동일한 형태로 결정된 복수개의 부호화 단위들을 서로 다른 순서로 처리할 수 있다.
도 19는 일 실시예에 따라 부호화 단위가 재귀적으로 분할되어 복수개의 부호화 단위가 결정되는 경우, 부호화 단위의 형태 및 크기가 변함에 따라 부호화 단위의 심도가 결정되는 과정을 도시한다.
일 실시예에 따라 복호화부(120)는 부호화 단위의 심도를 소정의 기준에 따라 결정할 수 있다. 예를 들면 소정의 기준은 부호화 단위의 긴 변의 길이가 될 수 있다. 복호화부(120)는 현재 부호화 단위의 긴 변의 길이가 분할되기 전의 부호화 단위의 긴 변의 길이보다 2n (n>0) 배로 분할된 경우, 현재 부호화 단위의 심도는 분할되기 전의 부호화 단위의 심도보다 n만큼 심도가 증가된 것으로 결정할 수 있다. 이하에서는 심도가 증가된 부호화 단위를 하위 심도의 부호화 단위로 표현하도록 한다.
도 19를 참조하면, 일 실시예에 따라 정사각형 형태임을 나타내는 블록 형태 정보(예를 들면 블록 형태 정보는 ′0: SQUARE′를 나타낼 수 있음)에 기초하여 복호화부(120)는 정사각형 형태인 제1 부호화 단위(1900)를 분할하여 하위 심도의 제2 부호화 단위(1902), 제3 부호화 단위(1904) 등을 결정할 수 있다. 정사각형 형태의 제1 부호화 단위(1900)의 크기를 2Nx2N이라고 한다면, 제1 부호화 단위(1900)의 너비 및 높이를 1/21배로 분할하여 결정된 제2 부호화 단위(1902)는 NxN의 크기를 가질 수 있다. 나아가 제2 부호화 단위(1902)의 너비 및 높이를 1/2크기로 분할하여 결정된 제3 부호화 단위(1904)는 N/2xN/2의 크기를 가질 수 있다. 이 경우 제3 부호화 단위(1904)의 너비 및 높이는 제1 부호화 단위(1900)의 1/22배에 해당한다. 제1 부호화 단위(1900)의 심도가 D인 경우 제1 부호화 단위(1900)의 너비 및 높이의 1/21배인 제2 부호화 단위(1902)의 심도는 D+1일 수 있고, 제1 부호화 단위(1900)의 너비 및 높이의 1/22배인 제3 부호화 단위(1904)의 심도는 D+2일 수 있다.
일 실시예에 따라 비-정사각형 형태를 나타내는 블록 형태 정보(예를 들면 블록 형태 정보는, 높이가 너비보다 긴 비-정사각형임을 나타내는 ′1: NS_VER′ 또는 너비가 높이보다 긴 비-정사각형임을 나타내는 ′2: NS_HOR′를 나타낼 수 있음)에 기초하여, 복호화부(120)는 비-정사각형 형태인 제1 부호화 단위(1910 또는 1920)를 분할하여 하위 심도의 제2 부호화 단위(1912 또는 1922), 제3 부호화 단위(1914 또는 1924) 등을 결정할 수 있다.
복호화부(120)는 Nx2N 크기의 제1 부호화 단위(1910)의 너비 및 높이 중 적어도 하나를 분할하여 제2 부호화 단위(예를 들면, 1902, 1912, 1922 등)를 결정할 수 있다. 즉, 복호화부(120)는 제1 부호화 단위(1910)를 수평 방향으로 분할하여 NxN 크기의 제2 부호화 단위(1902) 또는 NxN/2 크기의 제2 부호화 단위(1922)를 결정할 수 있고, 수평 방향 및 수직 방향으로 분할하여 N/2xN 크기의 제2 부호화 단위(1912)를 결정할 수도 있다.
일 실시예에 따라 복호화부(120)는 2NxN 크기의 제1 부호화 단위(1920) 의 너비 및 높이 중 적어도 하나를 분할하여 제2 부호화 단위(예를 들면, 1902, 1912, 1922 등)를 결정할 수도 있다. 즉, 복호화부(120)는 제1 부호화 단위(1920)를 수직 방향으로 분할하여 NxN 크기의 제2 부호화 단위(1902) 또는 N/2xN 크기의 제2 부호화 단위(1912)를 결정할 수 있고, 수평 방향 및 수직 방향으로 분할하여 NxN/2 크기의 제2 부호화 단위(1922)를 결정할 수도 있다.
일 실시예에 따라 복호화부(120)는 NxN 크기의 제2 부호화 단위(1902) 의 너비 및 높이 중 적어도 하나를 분할하여 제3 부호화 단위(예를 들면, 1904, 1914, 1924 등)를 결정할 수도 있다. 즉, 복호화부(120)는 제2 부호화 단위(1902)를 수직 방향 및 수평 방향으로 분할하여 N/2xN/2 크기의 제3 부호화 단위(1904)를 결정하거나 N/22xN/2 크기의 제3 부호화 단위(1914)를 결정하거나 N/2xN/22 크기의 제3 부호화 단위(1924)를 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 N/2xN 크기의 제2 부호화 단위(1912)의 너비 및 높이 중 적어도 하나를 분할하여 제3 부호화 단위(예를 들면, 1904, 1914, 1924 등)를 결정할 수도 있다. 즉, 복호화부(120)는 제2 부호화 단위(1912)를 수평 방향으로 분할하여 N/2xN/2 크기의 제3 부호화 단위(1904) 또는 N/2xN/22 크기의 제3 부호화 단위(1924)를 결정하거나 수직 방향 및 수평 방향으로 분할하여 N/22xN/2 크기의 제3 부호화 단위(1914)를 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 NxN/2 크기의 제2 부호화 단위(1914)의 너비 및 높이 중 적어도 하나를 분할하여 제3 부호화 단위(예를 들면, 1904, 1914, 1924 등)를 결정할 수도 있다. 즉, 복호화부(120)는 제2 부호화 단위(1912)를 수직 방향으로 분할하여 N/2xN/2 크기의 제3 부호화 단위(1904) 또는 N/22xN/2 크기의 제3 부호화 단위(1914)를 결정하거나 수직 방향 및 수평 방향으로 분할하여 N/2xN/22크기의 제3 부호화 단위(1924)를 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 정사각형 형태의 부호화 단위(예를 들면, 1900, 1902, 1904)를 수평 방향 또는 수직 방향으로 분할할 수 있다. 예를 들면, 2Nx2N 크기의 제1 부호화 단위(1900)를 수직 방향으로 분할하여 Nx2N 크기의 제1 부호화 단위(1910)를 결정하거나 수평 방향으로 분할하여 2NxN 크기의 제1 부호화 단위(1920)를 결정할 수 있다. 일 실시예에 따라 심도가 부호화 단위의 가장 긴 변의 길이에 기초하여 결정되는 경우, 2Nx2N 크기의 제1 부호화 단위(1900, 1902 또는 1904)가 수평 방향 또는 수직 방향으로 분할되어 결정되는 부호화 단위의 심도는 제1 부호화 단위(1900, 1902 또는 1904)의 심도와 동일할 수 있다.
일 실시예에 따라 제3 부호화 단위(1914 또는 1924)의 너비 및 높이는 제1 부호화 단위(1910 또는 1920)의 1/22배에 해당할 수 있다. 제1 부호화 단위(1910 또는 1920)의 심도가 D인 경우 제1 부호화 단위(1910 또는 1920)의 너비 및 높이의 1/2배인 제2 부호화 단위(1912 또는 1914)의 심도는 D+1일 수 있고, 제1 부호화 단위(1910 또는 1920)의 너비 및 높이의 1/22배인 제3 부호화 단위(1914 또는 1924)의 심도는 D+2일 수 있다.
도 20은 일 실시예에 따라 부호화 단위들의 형태 및 크기에 따라 결정될 수 있는 심도 및 부호화 단위 구분을 위한 인덱스(part index, 이하 PID)를 도시한다.
일 실시예에 따라 복호화부(120)는 정사각형 형태의 제1 부호화 단위(2000)를 분할하여 다양한 형태의 제2 부호화 단위를 결정할 수 있다. 도 20을 참조하면, 복호화부(120)는 분할 형태 정보에 따라 제1 부호화 단위(2000)를 수직 방향 및 수평 방향 중 적어도 하나의 방향으로 분할하여 제2 부호화 단위(2002a, 2002b, 2004a, 2004b, 2006a, 2006b, 2006c, 2006d)를 결정할 수 있다. 즉, 복호화부(120)는 제1 부호화 단위(2000)에 대한 분할 형태 정보에 기초하여 제2 부호화 단위(2002a, 2002b, 2004a, 2004b, 2006a, 2006b, 2006c, 2006d)를 결정할 수 있다.
일 실시예에 따라 정사각형 형태의 제1 부호화 단위(2000)에 대한 분할 형태 정보에 따라 결정되는 제2 부호화 단위(2002a, 2002b, 2004a, 2004b, 2006a, 2006b, 2006c, 2006d)는 긴 변의 길이에 기초하여 심도가 결정될 수 있다. 예를 들면, 정사각형 형태의 제1 부호화 단위(2000)의 한 변의 길이와 비-정사각형 형태의 제2 부호화 단위(2002a, 2002b, 2004a, 2004b)의 긴 변의 길이가 동일하므로, 제1 부호화 단위(2000)와 비-정사각형 형태의 제2 부호화 단위(2002a, 2002b, 2004a, 2004b)의 심도는 D로 동일하다고 볼 수 있다. 이에 반해 복호화부(120)가 분할 형태 정보에 기초하여 제1 부호화 단위(2000)를 4개의 정사각형 형태의 제2 부호화 단위(2006a, 2006b, 2006c, 2006d)로 분할한 경우, 정사각형 형태의 제2 부호화 단위(2006a, 2006b, 2006c, 2006d)의 한 변의 길이는 제1 부호화 단위(2000)의 한 변의 길이의 1/2배 이므로, 제2 부호화 단위(2006a, 2006b, 2006c, 2006d)의 심도는 제1 부호화 단위(2000)의 심도인 D보다 한 심도 하위인 D+1의 심도일 수 있다.
일 실시예에 따라 복호화부(120)는 높이가 너비보다 긴 형태의 제1 부호화 단위(2010)를 분할 형태 정보에 따라 수평 방향으로 분할하여 복수개의 제2 부호화 단위(2012a, 2012b, 2014a, 2014b, 2014c)로 분할할 수 있다. 일 실시예에 따라 복호화부(120)는 너비가 높이보다 긴 형태의 제1 부호화 단위(2020)를 분할 형태 정보에 따라 수직 방향으로 분할하여 복수개의 제2 부호화 단위(2022a, 2022b, 2024a, 2024b, 2024c)로 분할할 수 있다.
일 실시예에 따라 비-정사각형 형태의 제1 부호화 단위(2010 또는 2020)에 대한 분할 형태 정보에 따라 결정되는 제2 부호화 단위(2012a, 2012b, 2014a, 2014b, 2016a, 2016b, 2016c, 2016d)는 긴 변의 길이에 기초하여 심도가 결정될 수 있다. 예를 들면, 정사각형 형태의 제2 부호화 단위(2012a, 2012b)의 한 변의 길이는 높이가 너비보다 긴 비-정사각형 형태의 제1 부호화 단위(2010)의 한 변의 길이의 1/2배이므로, 정사각형 형태의 제2 부호화 단위(2002a, 2002b, 2004a, 2004b)의 심도는 비-정사각형 형태의 제1 부호화 단위(2010)의 심도 D보다 한 심도 하위의 심도인 D+1이다.
나아가 복호화부(120)가 분할 형태 정보에 기초하여 비-정사각형 형태의 제1 부호화 단위(2010)를 홀수개의 제2 부호화 단위(2014a, 2014b, 2014c)로 분할할 수 있다. 홀수개의 제2 부호화 단위(2014a, 2014b, 2014c)는 비-정사각형 형태의 제2 부호화 단위(2014a, 2014c) 및 정사각형 형태의 제2 부호화 단위(2014b)를 포함할 수 있다. 이 경우 비-정사각형 형태의 제2 부호화 단위(2014a, 2014c)의 긴 변의 길이 및 정사각형 형태의 제2 부호화 단위(2014b)의 한 변의 길이는 제1 부호화 단위(2010)의 한 변의 길이의 1/2배 이므로, 제2 부호화 단위(2014a, 2014b, 2014c)의 심도는 제1 부호화 단위(2010)의 심도인 D보다 한 심도 하위인 D+1의 심도일 수 있다. 복호화부(120)는 제1 부호화 단위(2010)와 관련된 부호화 단위들의 심도를 결정하는 상기 방식에 유사한 방식으로, 너비가 높이보다 긴 비-정사각형 형태의 제1 부호화 단위(2020)와 관련된 부호화 단위들의 심도를 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 분할된 부호화 단위들의 구분을 위한 인덱스(PID)를 결정함에 있어서, 홀수개로 분할된 부호화 단위들이 서로 동일한 크기가 아닌 경우, 부호화 단위들 간의 크기 비율에 기초하여 인덱스를 결정할 수 있다. 도 20을 참조하면, 홀수개로 분할된 부호화 단위들(2014a, 2014b, 2014c) 중 가운데에 위치하는 부호화 단위(2014b)는 다른 부호화 단위들(2014a, 2014c)와 너비는 동일하지만 높이가 다른 부호화 단위들(2014a, 2014c)의 높이의 두 배일 수 있다. 즉, 이 경우 가운데에 위치하는 부호화 단위(2014b)는 다른 부호화 단위들(2014a, 2014c)의 두 개를 포함할 수 있다. 따라서, 스캔 순서에 따라 가운데에 위치하는 부호화 단위(2014b)의 인덱스(PID)가 1이라면 그 다음 순서에 위치하는 부호화 단위(2014c)는 인덱스가 2가 증가한 3일수 있다. 즉 인덱스의 값의 불연속성이 존재할 수 있다. 일 실시예에 따라 복호화부(120)는 이러한 분할된 부호화 단위들 간의 구분을 위한 인덱스의 불연속성의 존재 여부에 기초하여 홀수개로 분할된 부호화 단위들이 서로 동일한 크기가 아닌지 여부를 결정할 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 현재 부호화 단위로부터 분할되어 결정된 복수개의 부호화 단위들을 구분하기 위한 인덱스의 값에 기초하여 특정 분할 형태로 분할된 것인지를 결정할 수 있다. 도 20을 참조하면 영상 복호화 장치(100)는 높이가 너비보다 긴 직사각형 형태의 제1 부호화 단위(2010)를 분할하여 짝수개의 부호화 단위(2012a, 2012b)를 결정하거나 홀수개의 부호화 단위(2014a, 2014b, 2014c)를 결정할 수 있다. 영상 복호화 장치(100)는 복수개의 부호화 단위 각각을 구분하기 위하여 각 부호화 단위를 나타내는 인덱스(PID)를 이용할 수 있다. 일 실시예에 따라 PID는 각각의 부호화 단위의 소정 위치의 샘플(예를 들면, 좌측 상단 샘플)에서 획득될 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 부호화 단위의 구분을 위한 인덱스를 이용하여 분할되어 결정된 부호화 단위들 중 소정 위치의 부호화 단위를 결정할 수 있다. 일 실시예에 따라 높이가 너비보다 긴 직사각형 형태의 제1 부호화 단위(2010)에 대한 분할 형태 정보가 3개의 부호화 단위로 분할됨을 나타내는 경우 영상 복호화 장치(100)는 제1 부호화 단위(2010)를 3개의 부호화 단위(2014a, 2014b, 2014c)로 분할할 수 있다. 영상 복호화 장치(100)는 3개의 부호화 단위(2014a, 2014b, 2014c) 각각에 대한 인덱스를 할당할 수 있다. 영상 복호화 장치(100)는 홀수개로 분할된 부호화 단위 중 가운데 부호화 단위를 결정하기 위하여 각 부호화 단위에 대한 인덱스를 비교할 수 있다. 영상 복호화 장치(100)는 부호화 단위들의 인덱스에 기초하여 인덱스들 중 가운데 값에 해당하는 인덱스를 갖는 부호화 단위(2014b)를, 제1 부호화 단위(2010)가 분할되어 결정된 부호화 단위 중 가운데 위치의 부호화 단위로서 결정할 수 있다. 일 실시예에 따라 영상 복호화 장치(100)는 분할된 부호화 단위들의 구분을 위한 인덱스를 결정함에 있어서, 부호화 단위들이 서로 동일한 크기가 아닌 경우, 부호화 단위들 간의 크기 비율에 기초하여 인덱스를 결정할 수 있다. 도 20을 참조하면, 제1 부호화 단위(2010)가 분할되어 생성된 부호화 단위(2014b)는 다른 부호화 단위들(2014a, 2014c)와 너비는 동일하지만 높이가 다른 부호화 단위들(2014a, 2014c)의 높이의 두 배일 수 있다. 이 경우 가운데에 위치하는 부호화 단위(2014b)의 인덱스(PID)가 1이라면 그 다음 순서에 위치하는 부호화 단위(2014c)는 인덱스가 2가 증가한 3일수 있다. 이러한 경우처럼 균일하게 인덱스가 증가하다가 증가폭이 달라지는 경우, 영상 복호화 장치(100)는 다른 부호화 단위들과 다른 크기를 가지는 부호화 단위를 포함하는 복수개의 부호화 단위로 분할된 것으로 결정할 수 있다, 일 실시예에 따라 분할 형태 정보가 홀수개의 부호화 단위로 분할됨을 나타내는 경우, 영상 복호화 장치(100)는 홀수개의 부호화 단위 중 소정 위치의 부호화 단위(예를 들면 가운데 부호화 단위)가 다른 부호화 단위와 크기가 다른 형태로 현재 부호화 단위를 분할할 수 있다. 이 경우 영상 복호화 장치(100)는 부호화 단위에 대한 인덱스(PID)를 이용하여 다른 크기를 가지는 가운데 부호화 단위를 결정할 수 있다. 다만 상술한 인덱스, 결정하고자 하는 소정 위치의 부호화 단위의 크기 또는 위치는 일 실시예를 설명하기 위해 특정한 것이므로 이에 한정하여 해석되어서는 안되며, 다양한 인덱스, 부호화 단위의 위치 및 크기가 이용될 수 있는 것으로 해석되어야 한다.
일 실시예에 따라 복호화부(120)는 부호화 단위의 재귀적인 분할이 시작되는 소정의 데이터 단위를 이용할 수 있다.
도 21은 일 실시예에 따라 픽쳐에 포함되는 복수개의 소정의 데이터 단위에 따라 복수개의 부호화 단위들이 결정된 것을 도시한다.
일 실시예에 따라 소정의 데이터 단위는 부호화 단위가 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 이용하여 재귀적으로 분할되기 시작하는 데이터 단위로 정의될 수 있다. 즉, 현재 픽쳐를 분할하는 복수개의 부호화 단위들이 결정되는 과정에서 이용되는 최상위 심도의 부호화 단위에 해당할 수 있다. 이하에서는 설명 상 편의를 위해 이러한 소정의 데이터 단위를 기준 데이터 단위라고 지칭하도록 한다.
일 실시예에 따라 기준 데이터 단위는 소정의 크기 및 형태를 나타낼 수 있다. 일 실시예에 따라, 기준 부호화 단위는 MxN의 샘플들을 포함할 수 있다. 여기서 M 및 N은 서로 동일할 수도 있으며, 2의 승수로 표현되는 정수일 수 있다. 즉, 기준 데이터 단위는 정사각형 또는 비-정사각형의 형태를 나타낼 수 있으며, 이후에 정수개의 부호화 단위로 분할될 수 있다.
일 실시예에 따라 영상 복호화 장치(100)의 복호화부(120)는 현재 픽쳐를 복수개의 기준 데이터 단위로 분할할 수 있다. 일 실시예에 따라 복호화부(120)는 현재 픽쳐를 분할하는 복수개의 기준 데이터 단위를 각각의 기준 데이터 단위에 대한 분할 정보를 이용하여 분할할 수 있다. 이러한 기준 데이터 단위의 분할 과정은 쿼드 트리(quad-tree)구조를 이용한 분할 과정에 대응될 수 있다.
일 실시예에 따라 복호화부(120)는 현재 픽쳐에 포함되는 기준 데이터 단위가 가질 수 있는 최소 크기를 미리 결정할 수 있다. 이에 따라, 복호화부(120)는 최소 크기 이상의 크기를 갖는 다양한 크기의 기준 데이터 단위를 결정할 수 있고, 결정된 기준 데이터 단위를 기준으로 블록 형태 정보 및 분할 형태 정보를 이용하여 적어도 하나의 부호화 단위를 결정할 수 있다.
도 21을 참조하면, 영상 복호화 장치(100)는 정사각형 형태의 기준 부호화 단위(2100)를 이용할 수 있고, 또는 비-정사각형 형태의 기준 부호화 단위(2102)를 이용할 수도 있다. 일 실시예에 따라 기준 부호화 단위의 형태 및 크기는 적어도 하나의 기준 부호화 단위를 포함할 수 있는 다양한 데이터 단위(예를 들면, 시퀀스(sequence), 픽쳐(picture), 슬라이스(slice), 슬라이스 세그먼트(slice segment), 최대부호화단위 등)에 따라 결정될 수 있다.
일 실시예에 따라 영상 복호화 장치(100)의 비트스트림 획득부(110)는 기준 부호화 단위의 형태에 대한 정보 및 기준 부호화 단위의 크기에 대한 정보 중 적어도 하나를 상기 다양한 데이터 단위마다 비트스트림으로부터 획득할 수 있다. 정사각형 형태의 기준 부호화 단위(2100)에 포함되는 적어도 하나의 부호화 단위가 결정되는 과정은 도 9의 현재 부호화 단위(900)가 분할되는 과정을 통해 상술하였고, 비-정사각형 형태의 기준 부호화 단위(2100)에 포함되는 적어도 하나의 부호화 단위가 결정되는 과정은 도 10의 현재 부호화 단위(1000 또는 1050)가 분할되는 과정을 통해 상술하였으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 복호화부(120)는 소정의 조건에 기초하여 미리 결정되는 일부 데이터 단위에 따라 기준 부호화 단위의 크기 및 형태를 결정하기 위하여, 기준 부호화 단위의 크기 및 형태를 식별하기 위한 인덱스를 이용할 수 있다. 즉, 비트스트림 획득부(110)는 비트스트림으로부터 상기 다양한 데이터 단위(예를 들면, 시퀀스, 픽쳐, 슬라이스, 슬라이스 세그먼트, 최대부호화단위 등) 중 소정의 조건(예를 들면 슬라이스 이하의 크기를 갖는 데이터 단위)을 만족하는 데이터 단위로서 슬라이스, 슬라이스 세그먼트, 최대부호화 단위 등 마다, 기준 부호화 단위의 크기 및 형태의 식별을 위한 인덱스만을 획득할 수 있다. 복호화부(120)는 인덱스를 이용함으로써 상기 소정의 조건을 만족하는 데이터 단위마다 기준 데이터 단위의 크기 및 형태를 결정할 수 있다. 기준 부호화 단위의 형태에 대한 정보 및 기준 부호화 단위의 크기에 대한 정보를 상대적으로 작은 크기의 데이터 단위마다 비트스트림으로부터 획득하여 이용하는 경우, 비트스트림의 이용 효율이 좋지 않을 수 있으므로, 기준 부호화 단위의 형태에 대한 정보 및 기준 부호화 단위의 크기에 대한 정보를 직접 획득하는 대신 상기 인덱스만을 획득하여 이용할 수 있다. 이 경우 기준 부호화 단위의 크기 및 형태를 나타내는 인덱스와 관련된기준 부호화 단위의 크기 및 형태 중 적어도 하나는 미리 결정되어 있을 수 있다. 즉, 복호화부(120)는 미리 결정된 기준 부호화 단위의 크기 및 형태 중 적어도 하나를 인덱스에 따라 선택함으로써, 인덱스 획득의 기준이 되는 데이터 단위에 포함되는 기준 부호화 단위의 크기 및 형태 중 적어도 하나를 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 하나의 최대 부호화 단위에 포함하는 적어도 하나의 기준 부호화 단위를 이용할 수 있다. 즉, 영상을 분할하는 최대 부호화 단위에는 적어도 하나의 기준 부호화 단위가 포함될 수 있고, 각각의 기준 부호화 단위의 재귀적인 분할 과정을 통해 부호화 단위가 결정될 수 있다. 일 실시예에 따라 최대 부호화 단위의 너비 및 높이 중 적어도 하나는 기준 부호화 단위의 너비 및 높이 중 적어도 하나의 정수배에 해당할 수 있다. 일 실시예에 따라 기준 부호화 단위의 크기는 최대부호화단위를 쿼드 트리 구조에 따라 n번 분할한 크기일 수 있다. 즉, 복호화부(120)는 최대부호화단위를 쿼드 트리 구조에 따라 n 번 분할하여 기준 부호화 단위를 결정할 수 있고, 다양한 실시예들에 따라 기준 부호화 단위를 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 분할할 수 있다.
도 22은 일 실시예에 따라 픽쳐(2200)에 포함되는 기준 부호화 단위의 결정 순서를 결정하는 기준이 되는 프로세싱 블록을 도시한다.
일 실시예에 따라 복호화부(120)는 픽쳐를 분할하는 적어도 하나의 프로세싱 블록을 결정할 수 있다. 프로세싱 블록이란, 영상을 분할하는 적어도 하나의 기준 부호화 단위를 포함하는 데이터 단위로서, 프로세싱 블록에 포함되는 적어도 하나의 기준 부호화 단위는 특정 순서대로 결정될 수 있다. 즉, 각각의 프로세싱 블록에서 결정되는 적어도 하나의 기준 부호화 단위의 결정 순서는 기준 부호화 단위가 결정될 수 있는 다양한 순서의 종류 중 하나에 해당할 수 있으며, 각각의 프로세싱 블록에서 결정되는 기준 부호화 단위 결정 순서는 프로세싱 블록마다 상이할 수 있다. 프로세싱 블록마다 결정되는 기준 부호화 단위의 결정 순서는 래스터 스캔(raster scan), Z 스캔(Z-scan), N 스캔(N-scan), 우상향 대각 스캔(up-right diagonal scan), 수평적 스캔(horizontal scan), 수직적 스캔(vertical scan) 등 다양한 순서 중 하나일 수 있으나, 결정될 수 있는 순서는 상기 스캔 순서들에 한정하여 해석되어서는 안 된다.
일 실시예에 따라 복호화부(120)는 프로세싱 블록의 크기에 대한 정보를 획득하여 영상에 포함되는 적어도 하나의 프로세싱 블록의 크기를 결정할 수 있다. 복호화부(120)는 프로세싱 블록의 크기에 대한 정보를 비트스트림으로부터 획득하여 영상에 포함되는 적어도 하나의 프로세싱 블록의 크기를 결정할 수 있다. 이러한 프로세싱 블록의 크기는 프로세싱 블록의 크기에 대한 정보가 나타내는 데이터 단위의 소정의 크기일 수 있다.
일 실시예에 따라 영상 복호화 장치(100)의 비트스트림 획득부(110)는 비트스트림으로부터 프로세싱 블록의 크기에 대한 정보를 특정의 데이터 단위마다 획득할 수 있다. 예를 들면 프로세싱 블록의 크기에 대한 정보는 영상, 시퀀스, 픽쳐, 슬라이스, 슬라이스 세그먼트 등의 데이터 단위로 비트스트림으로부터 획득될 수 있다. 즉 비트스트림 획득부(110)는 상기 여러 데이터 단위마다 비트스트림으로부터 프로세싱 블록의 크기에 대한 정보를 획득할 수 있고 복호화부(120)는 획득된 프로세싱 블록의 크기에 대한 정보를 이용하여 픽쳐를 분할하는 적어도 하나의 프로세싱 블록의 크기를 결정할 수 있으며, 이러한 프로세싱 블록의 크기는 기준 부호화 단위의 정수배의 크기일 수 있다.
일 실시예에 따라 복호화부(120)는 픽쳐(2200)에 포함되는 프로세싱 블록(2202, 2212)의 크기를 결정할 수 있다. 예를 들면, 복호화부(120)는 비트스트림으로부터 획득된 프로세싱 블록의 크기에 대한 정보에 기초하여 프로세싱 블록의 크기를 결정할 수 있다. 도 22을 참조하면, 복호화부(120)는 일 실시예에 따라 프로세싱 블록(2202, 2212)의 가로크기를 기준 부호화 단위 가로크기의 4배, 세로크기를 기준 부호화 단위의 세로크기의 4배로 결정할 수 있다. 복호화부(120)는 적어도 하나의 프로세싱 블록 내에서 적어도 하나의 기준 부호화 단위가 결정되는 순서를 결정할 수 있다.
일 실시예에 따라, 복호화부(120)는 프로세싱 블록의 크기에 기초하여 픽쳐(2200)에 포함되는 각각의 프로세싱 블록(2202, 2212)을 결정할 수 있고, 기준 부호화 단위 결정부(12)는 프로세싱 블록(2202, 2212)에 포함되는 적어도 하나의 기준 부호화 단위의 결정 순서를 결정할 수 있다. 일 실시예에 따라 기준 부호화 단위의 결정은 기준 부호화 단위의 크기의 결정을 포함할 수 있다.
일 실시예에 따라 복호화부(120)는 비트스트림으로부터 적어도 하나의 프로세싱 블록에 포함되는 적어도 하나의 기준 부호화 단위의 결정 순서에 대한 정보를 획득할 수 있고, 획득한 결정 순서에 대한 정보에 기초하여 적어도 하나의 기준 부호화 단위가 결정되는 순서를 결정할 수 있다. 결정 순서에 대한 정보는 프로세싱 블록 내에서 기준 부호화 단위들이 결정되는 순서 또는 방향으로 정의될 수 있다. 즉, 기준 부호화 단위들이 결정되는 순서는 각각의 프로세싱 블록마다 독립적으로 결정될 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 특정 데이터 단위마다 기준 부호화 단위의 결정 순서에 대한 정보를 비트스트림으로부터 획득할 수 있다. 예를 들면, 비트스트림 획득부(110)는 기준 부호화 단위의 결정 순서에 대한 정보를 영상, 시퀀스, 픽쳐, 슬라이스, 슬라이스 세그먼트, 프로세싱 블록 등의 데이터 단위로마다 비트스트림으로부터 획득할 수 있다. 기준 부호화 단위의 결정 순서에 대한 정보는 프로세싱 블록 내에서의 기준 부호화 단위 결정 순서를 나타내므로, 결정 순서에 대한 정보는 정수개의 프로세싱 블록을 포함하는 특정 데이터 단위 마다 획득될 수 있다.
영상 복호화 장치(100)는 일 실시예에 따라 결정된 순서에 기초하여 적어도 하나의 기준 부호화 단위를 결정할 수 있다.
일 실시예에 따라 비트스트림 획득부(110)는 비트스트림으로부터 프로세싱 블록(2202, 2212)과 관련된 정보로서, 기준 부호화 단위 결정 순서에 대한 정보를 획득할 수 있고, 복호화부(120)는 상기 프로세싱 블록(2202, 2212)에 포함된 적어도 하나의 기준 부호화 단위를 결정하는 순서를 결정하고 부호화 단위의 결정 순서에 따라 픽쳐(2200)에 포함되는 적어도 하나의 기준 부호화 단위를 결정할 수 있다. 도 22을 참조하면, 복호화부(120)는 각각의 프로세싱 블록(2202, 2212)과 관련된 적어도 하나의 기준 부호화 단위의 결정 순서(2204, 2214)를 결정할 수 있다. 예를 들면, 기준 부호화 단위의 결정 순서에 대한 정보가 프로세싱 블록마다 획득되는 경우, 각각의 프로세싱 블록(2202, 2212)과 관련된 기준 부호화 단위 결정 순서는 프로세싱 블록마다 상이할 수 있다. 프로세싱 블록(2202)과 관련된 기준 부호화 단위 결정 순서(2204)가 래스터 스캔(raster scan)순서인 경우, 프로세싱 블록(2202)에 포함되는 기준 부호화 단위는 래스터 스캔 순서에 따라 결정될 수 있다. 이에 반해 다른 프로세싱 블록(2212)과 관련된 기준 부호화 단위 결정 순서(2214)가 래스터 스캔 순서의 역순인 경우, 프로세싱 블록(2212)에 포함되는 기준 부호화 단위는 래스터 스캔 순서의 역순에 따라 결정될 수 있다.
복호화부(120)는 일 실시예에 따라, 결정된 적어도 하나의 기준 부호화 단위를 복호화할 수 있다. 복호화부(120)는 상술한 실시예를 통해 결정된 기준 부호화 단위에 기초하여 영상을 복호화 할 수 있다. 기준 부호화 단위를 복호화 하는 방법은 영상을 복호화 하는 다양한 방법들을 포함할 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 현재 부호화 단위의 형태를 나타내는 블록 형태 정보 또는 현재 부호화 단위를 분할하는 방법을 나타내는 분할 형태 정보를 비트스트림으로부터 획득하여 이용할 수 있다. 블록 형태 정보 또는 분할 형태 정보는 다양한 데이터 단위와 관련된 비트스트림에 포함될 수 있다. 예를 들면, 영상 복호화 장치(100)는 시퀀스 파라미터 세트(sequence parameter set), 픽쳐 파라미터 세트(picture parameter set), 비디오 파라미터 세트(video parameter set), 슬라이스 헤더(slice header), 슬라이스 세그먼트 헤더(slice segment header)에 포함된 블록 형태 정보 또는 분할 형태 정보를 이용할 수 있다. 나아가, 영상 복호화 장치(100)는 최대 부호화 단위, 기준 부호화 단위, 프로세싱 블록마다 비트스트림으로부터 블록 형태 정보 또는 분할 형태 정보와 관련된 신택스를 비트스트림으로부터 획득하여 이용할 수 있다.
일 실시예에 따라 복호화부(120)는 부호화 단위가 분할될 수 있는 분할 형태의 종류를 소정의 데이터 단위마다 다르게 결정할 수 있다. 영상 복호화 장치(100)의 복호화부(120)는 일 실시예에 따라 소정의 데이터 단위(예를 들면, 시퀀스, 픽쳐, 슬라이스 등)마다 부호화 단위가 분할될 수 있는 형태들의 조합을 다르게 결정할 수 있다.
도 23은 일 실시예에 따라 부호화 단위가 분할될 수 있는 형태의 조합이 픽쳐마다 서로 다른 경우, 각각의 픽쳐마다 결정될 수 있는 부호화 단위들을 도시한다.
도 23을 참조하면, 복호화부(120)는 픽쳐마다 부호화 단위가 분할될 수 있는 분할 형태들의 조합을 다르게 결정할 수 있다. 예를 들면, 복호화부(120)는 영상에 포함되는 적어도 하나의 픽쳐들 중 4개의 부호화 단위로 분할될 수 있는 픽쳐(2300), 2개 또는 4개의 부호화 단위로 분할될 수 있는 픽쳐(2310) 및 2개, 3개 또는 4개의 부호화 단위로 분할될 수 있는 픽쳐(2320)를 이용하여 영상을 복호화 할 수 있다. 복호화부(120)는 픽쳐(2300)를 복수개의 부호화 단위로 분할하기 위하여, 4개의 정사각형의 부호화 단위로 분할됨을 나타내는 분할 형태 정보만을 이용할 수 있다. 복호화부(120)는 픽쳐(2310)를 분할하기 위하여, 2개 또는 4개의 부호화 단위로 분할됨을 나타내는 분할 형태 정보만을 이용할 수 있다. 복호화부(120)는 픽쳐(2320)를 분할하기 위하여, 2개, 3개 또는 4개의 부호화 단위로 분할됨을 나타내는 분할 형태 정보만을 이용할 수 있다. 상술한 분할 형태의 조합은 영상 복호화 장치(100)의 동작을 설명하기 위한 실시예에 불과하므로 상술한 분할 형태의 조합은 상기 실시예에 한정하여 해석되어서는 안되며 소정의 데이터 단위마다 다양한 형태의 분할 형태의 조합이 이용될 수 있는 것으로 해석되어야 한다.
일 실시예에 따라 영상 복호화 장치(100)의 비트스트림 획득부(110)는 분할 형태 정보의 조합을 나타내는 인덱스를 소정의 데이터 단위 단위(예를 들면, 시퀀스, 픽쳐, 슬라이스 등)마다 비트스트림으로부터 획득할 수 있다. 예를 들면, 비트스트림 획득부(110)는 시퀀스 파라미터 세트(Sequence Parameter Set), 픽쳐 파라미터 세트(Picture Parameter Set) 또는 슬라이스 헤더(Slice Header)에서 분할 형태 정보의 조합을 나타내는 인덱스를 비트스트림으로부터 획득할 수 있다. 영상 복호화 장치(100)의 복호화부(120)는 획득한 인덱스를 이용하여 소정의 데이터 단위마다 부호화 단위가 분할될 수 있는 분할 형태의 조합을 결정할 수 있으며, 이에 따라 소정의 데이터 단위마다 서로 다른 분할 형태의 조합을 이용할 수 있다.
도 24는 일 실시예에 따라 바이너리(binary)코드로 표현될 수 있는 분할 형태 정보에 기초하여 결정될 수 있는 부호화 단위의 다양한 형태를 도시한다.
일 실시예에 따라 영상 복호화 장치(100)는 비트스트림 획득부(110)를 통해 획득한 블록 형태 정보 및 분할 형태 정보를 이용하여 부호화 단위를 다양한 형태로 분할할 수 있다. 분할될 수 있는 부호화 단위의 형태는 상술한 실시예들을 통해 설명한 형태들을 포함하는 다양한 형태에 해당할 수 있다.
도 24를 참조하면, 복호화부(120)는 분할 형태 정보에 기초하여 정사각형 형태의 부호화 단위를 수평 방향 및 수직 방향 중 적어도 하나의 방향으로 분할할 수 있고, 비-정사각형 형태의 부호화 단위를 수평 방향 또는 수직 방향으로 분할할 수 있다.
일 실시예에 따라 복호화부(120)가 정사각형 형태의 부호화 단위를 수평 방향 및 수직 방향으로 분할하여 4개의 정사각형의 부호화 단위로 분할할 수 있는 경우, 정사각형의 부호화 단위에 대한 분할 형태 정보가 나타낼 수 있는 분할 형태는 4가지일 수 있다. 일 실시예에 따라 분할 형태 정보는 2자리의 바이너리 코드로써 표현될 수 있으며, 각각의 분할 형태마다 바이너리 코드가 할당될 수 있다. 예를 들면 부호화 단위가 분할되지 않는 경우 분할 형태 정보는 (00)b로 표현될 수 있고, 부호화 단위가 수평 방향 및 수직 방향으로 분할되는 경우 분할 형태 정보는 (01)b로 표현될 수 있고, 부호화 단위가 수평 방향으로 분할되는 경우 분할 형태 정보는 (10)b로 표현될 수 있고 부호화 단위가 수직 방향으로 분할되는 경우 분할 형태 정보는 (11)b로 표현될 수 있다.
일 실시예에 따라 복호화부(120)는 비-정사각형 형태의 부호화 단위를 수평 방향 또는 수직 방향으로 분할하는 경우 분할 형태 정보가 나타낼 수 있는 분할 형태의 종류는 몇 개의 부호화 단위로 분할하는지에 따라 결정될 수 있다. 도 24를 참조하면, 복호화부(120)는 일 실시예에 따라 비-정사각형 형태의 부호화 단위를 3개까지 분할할 수 있다. 복호화부(120)는 부호화 단위를 두 개의 부호화 단위로 분할할 수 있으며, 이 경우 분할 형태 정보는 (10)b로 표현될 수 있다. 복호화부(120)는 부호화 단위를 세 개의 부호화 단위로 분할할 수 있으며, 이 경우 분할 형태 정보는 (11)b로 표현될 수 있다. 복호화부(120)는 부호화 단위를 분할하지 않는 것으로 결정할 수 있으며, 이 경우 분할 형태 정보는 (0)b로 표현될 수 있다. 즉, 복호화부(120)는 분할 형태 정보를 나타내는 바이너리 코드를 이용하기 위하여 고정길이 코딩(FLC: Fixed Length Coding)이 아니라 가변길이 코딩(VLC: Varaible Length Coding)을 이용할 수 있다.`
일 실시예에 따라 도 24를 참조하면, 부호화 단위가 분할되지 않는 것을 나타내는 분할 형태 정보의 바이너리 코드는 (0)b로 표현될 수 있다. 만일 부호화 단위가 분할되지 않음을 나타내는 분할 형태 정보의 바이너리 코드가 (00)b로 설정된 경우라면, (01)b로 설정된 분할 형태 정보가 없음에도 불구하고 2비트의 분할 형태 정보의 바이너리 코드를 모두 이용하여야 한다. 하지만 도 24에서 도시하는 바와 같이, 비-정사각형 형태의 부호화 단위에 대한 3가지의 분할 형태를 이용하는 경우라면, 복호화부(120)는 분할 형태 정보로서 1비트의 바이너리 코드(0)b를 이용하더라도 부호화 단위가 분할되지 않는 것을 결정할 수 있으므로, 비트스트림을 효율적으로 이용할 수 있다. 다만 분할 형태 정보가 나타내는 비-정사각형 형태의 부호화 단위의 분할 형태는 단지 도 24에서 도시하는 3가지 형태만으로 국한되어 해석되어서는 안되고, 상술한 실시예들을 포함하는 다양한 형태로 해석되어야 한다.
도 25는 일 실시예에 따라 바이너리 코드로 표현될 수 있는 분할 형태 정보에 기초하여 결정될 수 있는 부호화 단위의 또 다른 형태를 도시한다.
도 25를 참조하면 복호화부(120)는 분할 형태 정보에 기초하여 정사각형 형태의 부호화 단위를 수평 방향 또는 수직 방향으로 분할할 수 있고, 비-정사각형 형태의 부호화 단위를 수평 방향 또는 수직 방향으로 분할할 수 있다. 즉, 분할 형태 정보는 정사각형 형태의 부호화 단위를 한쪽 방향으로 분할되는 것을 나타낼 수 있다. 이러한 경우 정사각형 형태의 부호화 단위가 분할되지 않는 것을 나타내는 분할 형태 정보의 바이너리 코드는 (0)b로 표현될 수 있다. 만일 부호화 단위가 분할되지 않음을 나타내는 분할 형태 정보의 바이너리 코드가 (00)b로 설정된 경우라면, (01)b로 설정된 분할 형태 정보가 없음에도 불구하고 2비트의 분할 형태 정보의 바이너리 코드를 모두 이용하여야 한다. 하지만 도 25에서 도시하는 바와 같이, 정사각형 형태의 부호화 단위에 대한 3가지의 분할 형태를 이용하는 경우라면, 복호화부(120)는 분할 형태 정보로서 1비트의 바이너리 코드(0)b를 이용하더라도 부호화 단위가 분할되지 않는 것을 결정할 수 있으므로, 비트스트림을 효율적으로 이용할 수 있다. 다만 분할 형태 정보가 나타내는 정사각형 형태의 부호화 단위의 분할 형태는 단지 도 25에서 도시하는 3가지 형태만으로 국한되어 해석되어서는 안되고, 상술한 실시예들을 포함하는 다양한 형태로 해석되어야 한다.
일 실시예에 따라 블록 형태 정보 또는 분할 형태 정보는 바이너리 코드를 이용하여 표현될 수 있고, 이러한 정보가 곧바로 비트스트림으로 생성될 수 있다. 또한 바이너리 코드로 표현될 수 있는 블록 형태 정보 또는 분할 형태 정보는 바로 비트스트림으로 생성되지 않고 CABAC(context adaptive binary arithmetic coding)에서 입력되는 바이너리 코드로서 이용될 수도 있다.
일 실시예에 따라 영상 복호화 장치(100)는 CABAC을 통해 블록 형태 정보 또는 분할 형태 정보에 대한 신택스를 획득하는 과정을 설명한다. 비트스트림 획득부(110)를 통해 상기 신택스에 대한 바이너리 코드를 포함하는 비트스트림으로부터 획득할 수 있다. 복호화부(120)는 획득한 비트스트림에 포함되는 빈 스트링(bin string)을 역 이진화하여 블록 형태 정보 또는 분할 형태 정보를 나타내는 신택스 요소(syntax element)를 검출할 수 있다. 일 실시예에 따라 복호화부(120)는 복호화할 신택스 요소에 해당하는 바이너리 빈 스트링의 집합을 구하고, 확률 정보를 이용하여 각각의 빈을 복호화할 수 있고, 복호화부(120)는 이러한 복호화된 빈으로 구성되는 빈 스트링이 이전에 구한 빈 스트링들 중 하나와 같아질 때까지 반복할수 있다. 복호화부(120)는 빈 스트링의 역 이진화를 수행하여 신택스 요소를 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 적응적 이진 산술 코딩(adaptive binary arithmetic coding)의 복호화 과정을 수행하여 빈 스트링에 대한 신택스를 결정할 수 있고, 복호화부(120)는 비트스트림 획득부(110)를 통해 획득한 빈들에 대한 확률 모델을 갱신할 수 있다. 도 24를 참조하면, 영상 복호화 장치(100)의 비트스트림 획득부(110)는 일 실시예에 따라 분할 형태 정보를 나타내는 바이너리 코드를 나타내는 비트스트림으로부터 획득할 수 있다. 획득한 1비트 또는 2비트의 크기를 가지는 바이너리 코드를 이용하여 복호화부(120)는 분할 형태 정보에 대한 신택스를 결정할 수 있다. 복호화부(120)는 분할 형태 정보에 대한 신택스를 결정하기 위하여, 2비트의 바이너리 코드 중 각각의 비트에 대한 확률을 갱신할 수 있다. 즉, 복호화부(120)는 2비트의 바이너리 코드 중 첫번째 빈의 값이 0 또는 1 중 어떤 값이냐에 따라, 다음 빈을 복호화 할 때 0 또는 1의 값을 가질 확률을 갱신할 수 있다.
일 실시예에 따라 복호화부(120)는 신택스를 결정하는 과정에서, 신택스에 대한 빈 스트링의 빈들을 복호화 하는 과정에서 이용되는 빈들에 대한 확률을 갱신할 수 있으며, 복호화부(120)는 상기 빈 스트링 중 특정 비트에서는 확률을 갱신하지 않고 동일한 확률을 가지는 것으로 결정할 수 있다.
도 24를 참조하면, 비-정사각형 형태의 부호화 단위에 대한 분할 형태 정보를 나타내는 빈 스트링을 이용하여 신택스를 결정하는 과정에서, 복호화부(120)는 비-정사각형 형태의 부호화 단위를 분할하지 않는 경우에는 0의 값을 가지는 하나의 빈을 이용하여 분할 형태 정보에 대한 신택스를 결정할 수 있다. 즉, 블록 형태 정보가 현재 부호화 단위는 비-정사각형 형태임을 나타내는 경우, 분할 형태 정보에 대한 빈 스트링의 첫번째 빈은, 비-정사각형 형태의 부호화 단위가 분할되지 않는 경우 0이고, 2개 또는 3개의 부호화 단위로 분할되는 경우 1일 수 있다. 이에 따라 비-정사각형의 부호화 단위에 대한 분할 형태 정보의 빈 스트링의 첫번째 빈이 0일 확률은 1/3, 1일 확률은 2/3일 수 있다. 상술하였듯이 복호화부(120)는 비-정사각형 형태의 부호화 단위가 분할되지 않는 것을 나타내는 분할 형태 정보는 0의 값을 가지는 1비트의 빈 스트링만을 표현될 수 있으므로, 복호화부(120)는 분할 형태 정보의 첫번째 빈이 1인 경우에만 두 번째 빈이 0인지 1인지 판단하여 분할 형태 정보에 대한 신택스를 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 분할 형태 정보에 대한 첫번째 빈이 1인 경우, 두 번째 빈이 0 또는 1일 확률은 서로 동일한 확률인 것으로 보고 빈을 복호화 할 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 분할 형태 정보에 대한 빈 스트링의 빈을 결정하는 과정에서 각각의 빈에 대한 다양한 확률을 이용할 수 있다. 일 실시예에 따라 복호화부(120)는 비-정사각형 블록의 방향에 따라 분할 형태 정보에 대한 빈의 확률을 다르게 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 현재 부호화 단위의 넓이 또는 긴 변의 길이에 따라 분할 형태 정보에 대한 빈의 확률을 다르게 결정할 수 있다. 일 실시예에 따라 복호화부(120)는 현재 부호화 단위의 형태 및 긴 변의 길이 중 적어도 하나에 따라 분할 형태 정보에 대한 빈의 확률을 다르게 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 소정 크기 이상의 부호화 단위들에 대하여는 분할 형태 정보에 대한 빈의 확률을 동일한 것으로 결정할 수 있다. 예를 들면, 부호화 단위의 긴 변의 길이를 기준으로 64샘플 이상의 크기의 부호화 단위들에 대하여는 분할 형태 정보에 대한 빈의 확률이 동일한 것으로 결정할 수 있다.
일 실시예에 따라 복호화부(120)는 분할 형태 정보의 빈 스트링을 구성하는 빈들에 대한 초기 확률은 슬라이스 타입(예를 들면, I 슬라이스, P 슬라이스 또는 B 슬라이스…)에 기초하여 결정될 수 있다.
도 26는 루프 필터링을 수행하는 영상 부호화 및 복호화 시스템의 블록도를 나타낸 도면이다.
영상 부호화 및 복호화 시스템(2600)의 부호화단(2610)은 영상의 부호화된 비트스트림을 전송하고, 복호화단(2650)은 비트스트림을 수신하여 복호화함으로써 복원 영상을 출력한다. 여기서 부호화단(2610)은 후술할 영상 부호화 장치(260)에 유사한 구성일 수 있고, 복호화단(2650)은 영상 복호화 장치(100)에 유사한 구성일 수 있다.
부호화단(2610)에서, 예측 부호화부(2615)는 인터 예측 및 인트라 예측을 통해 참조 영상을 출력하고, 변환 및 양자화부(2620)는 참조 영상과 현재 입력 영상 간의 레지듀얼 데이터를 양자화된 변환 계수로 양자화하여 출력한다. 엔트로피 부호화부(2625)는 양자화된 변환 계수를 부호화하여 변환하고 비트스트림으로 출력한다. 양자화된 변환 계수는 역양자화 및 역변환부(2630)을 거쳐 공간 영역의 데이터로 복원되고, 복원된 공간 영역의 데이터는 디블로킹 필터링부(2635) 및 루프 필터링부(2640)를 거쳐 복원 영상으로 출력된다. 복원 영상은 예측 부호화부(2615)를 거쳐 다음 입력 영상의 참조 영상으로 사용될 수 있다.
복호화단(2650)으로 수신된 비트스트림 중 부호화된 영상 데이터는, 엔트로피 복호화부(2655) 및 역양자화 및 역변환부(2660)를 거쳐 공간 영역의 레지듀얼 데이터로 복원된다. 예측 복호화부(2675)로부터 출력된 참조 영상 및 레지듀얼 데이터가 조합되어 공간 영역의 영상 데이터가 구성되고, 디블로킹 필터링부(2665) 및 루프 필터링부(2670)는 공간 영역의 영상 데이터에 대해 필터링을 수행하여 현재 원본 영상에 대한 복원 영상을 출력할 수 있다. 복원 영상은 예측 복호화부(2675)에 의해 다음 원본 영상에 대한 참조 영상으로서 이용될 수 있다.
부호화단(2610)의 루프 필터링부(2640)는 사용자 입력 또는 시스템 설정에 따라 입력된 필터 정보를 이용하여 루프 필터링을 수행한다. 루프 필터링부(2640)에 의해 사용된 필터 정보는 엔트로피 부호화부(2610)로 출력되어, 부호화된 영상 데이터와 함께 복호화단(2650)으로 전송된다. 복호화단(2650)의 루프 필터링부(2670)는 복호화단(2650)으로부터 입력된 필터 정보에 기초하여 루프 필터링을 수행할 수 있다.
도 27은 일 실시예에 따른 최대 부호화 단위에 포함되는 필터링 단위들의 일례와 필터링 단위의 필터링 수행 정보를 나타낸 도면이다.
부호화단(2010)의 루프 필터링부(2040) 및 복호화단(2050)의 루프 필터링부(2070)의 필터링 단위가, 도 9 내지 도 11을 통해 전술한 일 실시예에 따른 부호화 단위와 유사한 데이터 단위로 구성된다면, 필터 정보는 필터링 단위를 나타내기 위한 데이터 단위의 블록 형태 정보 및 분할 형태 정보, 그리고 필터링 단위에 대한 루프 필터링 수행 여부를 나타내는 루프 필터링 수행 정보를 포함할 수 있다.
일 실시예에 따른 최대 부호화 단위(2700)에 포함된 필터링 단위들은 최대 부호화 단위(2700)에 포함된 부호화 단위들과 동일한 블록 형태 및 분할 형태를 가질 수 있다. 또한, 일 실시예에 따른 최대 부호화 단위(2700)에 포함된 필터링 단위들은 최대 부호화 단위(2700)에 포함된 부호화 단위들의 크기를 기준으로 분할될 수 있다. 도 27을 참조하여 예를 들면, 필터링 단위들은 심도 D의 정사각형 형태의 필터링 단위(2740), 심도 D의 비-정사각형 형태의 필터링 단위(2732, 2734), 심도 D+1의 정사각형 형태의 필터링 단위(2712, 2714, 2716, 2752, 2754, 2764), 심도 D+1의 비-정사각형 형태의 필터링 단위(2762, 2766), 심도 D+2의 정사각형 형태의 필터링 단위(2722, 2724, 2726, 2728)를 포함할 수 있다.
최대 부호화 단위(2700)에 포함된 필터링 단위들의 블록 형태 정보, 분할 형태 정보(심도) 및 루프 필터링 수행 정보는 아래 표 1과 같이 부호화될 수 있다.
Figure PCTKR2016011299-appb-T000001
일 실시예에 따른 블록 형태 정보 및 블록 분할 정보에 따라 부호화 단위가 재귀적으로 분할되어 복수개의 부호화 단위가 결정되는 과정은, 도 19를 통해 전술한 바와 같다. 일 실시예에 따른 필터링 단위들의 루프 필터링 수행 정보는, 플래그 값이 1인 경우 해당 필터링 단위에 대해 루프 필터링이 수행됨을 나타내며, 0인 경우 루프 필터링이 수행되지 않음을 나타낸다. 표 1을 참조하면, 루프 필터링부(2640, 2670)에 의해 필터링의 대상이 되는 필터링 단위를 결정하기 위한 데이터 단위의 정보들은 필터 정보로서 모두 부호화되어 전송될 수 있다.
일 실시예에 따라 구성된 부호화 단위들은, 원본 영상과의 오차를 최소화하는 형태로 구성된 부호화 단위이므로, 부호화 단위 내에서 공간적 상관도가 높다고 예상된다. 따라서, 일 실시예에 따른 부호화 단위에 기반하여 필터링 단위가 결정됨으로써, 부호화 단위의 결정과 별도로 필터링 단위를 결정하는 동작이 생략될 수도 있다. 또한 이에 따라, 일 실시예에 따른 부호화 단위에 기반하여 필터링 단위를 결정함으로써 필터링 단위의 분할 형태를 결정하기 위한 정보를 생략할 수 있으므로 필터 정보의 전송 비트레이트를 절약할 수 있다.
전술한 실시예에서는 필터링 단위가 일 실시예에 따른 부호화 단위에 기반하여 결정되는 것으로 설명하였지만, 부호화 단위에 기반하여 필터링 단위의 분할을 수행하다가 임의의 심도에서 더 이상 분할하지 않고 해당 심도까지만 필터링 단위의 형태가 결정될 수도 있다.
전술한 실시예에 개시된 필터링 단위의 결정은 루프 필터링 뿐만 아니라, 디블로킹 필터링, 적응적 루프 필터링 등 다양한 실시예에도 적용될 수 있다.
일 실시예에 따라 영상 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 이용하여 현재 부호화 단위를 분할할 수 있으며, 블록 형태 정보는 정사각형 형태만을 이용하는 것으로 미리 결정되고, 분할 형태 정보는 분할하지 않거나 또는 4개의 정사각형 형태의 부호화 단위로 분할됨을 나타낼 수 있는 것으로 미리 결정될 수 있다. 즉, 현재 부호화 단위는 상기 블록 형태 정보에 따르면 부호화 단위는 항상 정사각형 형태를 가지고, 상기 분할 형태 정보에 기초하여 분할되지 않거나 4개의 정사각형 형태의 부호화 단위들로 분할될 수 있다. 영상 복호화 장치(100)는 이러한 블록 형태 및 분할 형태만을 이용하는 것으로 미리 결정된 소정의 부호화 방법을 이용하여 생성된 비트스트림을 비트스트림 획득부(110)를 통해 획득할 수 있고, 복호화부(120)는 미리 결정된 블록 형태 및 분할 형태만을 이용할 수 있다. 이러한 경우 영상 복호화 장치(100)는 상술한 소정의 부호화 방법과 유사한 소정의 복호화 방법을 이용함으로써 소정의 부호화 방법과의 호환성 문제를 해결할 수 있다. 일 실시예에 따라 영상 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보가 나타낼 수 있는 다양한 형태들 중 미리 결정된 블록 형태 및 분할 형태만을 이용하는 상술한 소정의 복호화 방법을 이용하는 경우, 블록 형태 정보는 정사각형 형태만을 나타내게 되므로 영상 복호화 장치(100)는 비트스트림으로부터 블록 형태 정보를 획득하는 과정을 생략할 수 있다. 상술한 소정의 복호화 방법을 이용할 것인지 여부를 나타내는 신택스가 이용될 수 있고, 이러한 신택스는 시퀀스, 픽쳐, 슬라이스 단위, 최대부호화단위 등 복수개의 부호화 단위를 포함할 수 있는 다양한 형태의 데이터 단위마다 비트스트림으로부터 획득될 수 있다. 즉, 비트스트림 획득부(110)는 소정의 복호화 방법의 사용 여부를 나타내는 신택스에 기초하여 블록 형태 정보를 나타내는 신택스를 비트스트림으로부터 획득하는지 여부를 결정할 수 있다.
도 29는 일 실시예에 따른 부호화 단위의 Z 스캔 순서에 따른 인덱스를 도시한다.
일 실시예에 따른 영상 복호화 장치(100)는, 상위 데이터 단위에 포함된 하위 데이터 단위들을 Z 스캔 순서에 따라 스캔할 수 있다. 또한, 일 실시예에 따른 영상 복호화 장치(100)는 최대 부호화 단위 또는 프로세싱 블록에 포함되는 부호화 단위 내의 Z 스캔 인덱스에 따라 데이터를 순차적으로 액세스할 수 있다.
일 실시예에 따른 영상 복호화 장치(100)가 기준 부호화 단위를 적어도 하나의 부호화 단위로 분할할 수 있음은 도 9 내지 도 10를 참조하여 전술한 바와 같다. 이 때, 기준 부호화 단위 내에는 정사각형 형태의 부호화 단위들과 비-정사각형 형태의 부호화 단위들이 혼재할 수 있다. 일 실시예에 따른 영상 복호화 장치(100)는, 기준 부호화 단위 내의 각 부호화 단위에 포함된 Z 스캔 인덱스에 따라 데이터 액세스를 수행할 수 있다. 이 때, 기준 부호화 단위 내에 비-정사각형 형태의 부호화 단위가 존재하는지 여부에 따라 Z 스캔 인덱스를 적용하는 방식이 상이해질 수 있다.
일 실시예에 따라, 기준 부호화 단위 내에 비-정사각형 형태의 부호화 단위가 존재하지 않는 경우, 기준 부호화 단위 내의 하위 심도의 부호화 단위들끼리는 연속된 Z 스캔 인덱스를 가질 수 있다. 예를 들어, 일 실시예에 따라 상위 심도의 부호화 단위는 하위 심도의 부호화 단위 4 개를 포함할 수 있다. 여기서, 4 개의 하위 심도의 부호화 단위들은 서로 인접하는 경계가 연속적일 수 있으며, 각각의 하위 심도의 부호화 단위들은 Z 스캔 순서를 나타내는 인덱스에 따라 Z 스캔 순서로 스캔될 수 있다. 일 실시예에 따른 Z 스캔 순서를 나타내는 인덱스는 각 부호화 단위에 대해 Z 스캔 순서에 따라 증가하는 수로 설정될 수 있다. 이 경우, 동일한 심도의 심도별 부호화 단위들끼리 Z 스캔 순서에 따라 스캔이 가능하다.
일 실시예에 따라, 기준 부호화 단위 내에 비-정사각형 형태의 부호화 단위가 적어도 하나 이상 존재하는 경우, 영상 복호화 장치(100)는 기준 부호화 단위 내의 부호화 단위들을 각각 서브 블록들로 분할하여, 분할된 서브 블록들에 대해 Z 스캔 순서에 따른 스캔을 수행할 수 있다. 예를 들어, 기준 부호화 단위 내에 수직 방향 또는 수평 방향의 비-정사각형 형태의 부호화 단위가 존재하는 경우 분할된 서브 블록들을 이용하여 Z 스캔을 수행할 수 있다. 또한, 예를 들어, 기준 부호화 단위 내에서 홀수 개의 부호화 단위들로 분할이 수행된 경우 서브 블록들을 이용하여 Z 스캔을 수행할 수 있다. 서브 블록은, 더 이상 분할되지 않는 부호화 단위 또는 임의의 부호화 단위가 분할된 것으로서, 정사각형 형태일 수 있다. 예를 들어, 정사각형 형태의 부호화 단위로부터 4개의 정사각형 형태의 서브 블록들이 분할될 수 있다. 또한, 예를 들어, 비-정사각형 형태의 부호화 단위로부터는 2 개의 정사각형 형태의 서브 블록들이 분할될 수 있다.
도 29를 참조하여 예를 들면, 일 실시예에 따른 영상 복호화 장치(100)는, 부호화 단위(2900) 내에서 하위 심도의 부호화 단위들(2902, 2904, 2906, 2908, 2910)을 Z 스캔 순서에 따라 스캔할 수 있다. 부호화 단위(2900) 및 부호화 단위(2902, 2904, 2906, 2908, 2910)는, 각각 상대적으로 상위 부호화 단위 및 하위 부호화 단위이다. 부호화 단위(2900)는 수평 방향의 비-정사각형 형태의 부호화 단위(2906, 2910)를 포함한다. 이들 비-정사각형 형태의 부호화 단위들(2906, 2910)은 인접한 정사각형 형태의 부호화 단위(2902, 2904)와의 경계가 불연속적이다. 또한, 부호화 단위(2908)는 정사각형 형태이며, 비-정사각형 형태의 부호화 단위가 홀수 개로 분할 시 중간에 위치한 부호화 단위이다. 비-정사각형 형태의 부호화 단위들(2906, 2910)과 마찬가지로, 부호화 단위(2908)는 인접한 정사각형 형태의 부호화 단위(2902, 2904)와의 경계가 불연속적이다. 부호화 단위(2900) 내에 비-정사각형 형태의 부호화 단위(2906, 2910)가 포함되거나 비-정사각형 형태의 부호화 단위가 홀수 개로 분할 시 중간에 위치한 부호화 단위(2908)가 포함된 경우, 부호화 단위들 간에 인접하는 경계가 불연속적이기 때문에 연속적인 Z 스캔 인덱스가 설정될 수 없다. 따라서, 영상 복호화 장치(100)는 부호화 단위들을 서브 블록들로 분할함으로써 Z 스캔 인덱스를 연속적으로 설정할 수 있다. 또한, 영상 복호화 장치(100)는, 비-정사각형 형태의 부호화 단위(2906, 2910) 또는 홀수 개로 분할된 비-정사각형 형태의 부호화 단위의 중간에 위치한 부호화 단위(2908)에 대해 연속된 Z 스캔을 수행할 수 있다.
도 29에 도시된 부호화 단위(2920)는 부호화 단위(2900) 내의 부호화 단위들(2902, 2904, 2906, 2908, 2910)을 서브 블록들로 분할한 것이다. 서브 블록들 각각에 대해 Z 스캔 인덱스가 설정될 수 있고, 서브 블록들 간의 인접하는 경계는 연속적이므로, 서브 블록들끼리 Z 스캔 순서에 따라 스캔이 가능하다. 예를 들어, 일 실시예에 따른 복호화 장치에서, 부호화 단위(2908)는 서브 블록들(2922, 2924, 2926, 2928)로 분할될 수 있다. 이 때, 서브 블록(2922, 2924)은 서브 블록(2930)에 대한 데이터 처리 이후에 스캔될 수 있으며, 서브 블록(2926, 2928)은 서브 블록(2932)에 대한 데이터 처리 이후에 스캔될 수 있다. 또한, 각각의 서브 블록들끼리 Z 스캔 순서에 따라 스캔될 수 있다.
전술한 실시예에서, 데이터 단위들에 대해 Z 스캔 순서에 따라 스캔하는 것은, 데이터 저장, 데이터 로딩, 데이터 액세스 등을 위한 것일 수 있다.
또한, 전술한 실시예에서는, 데이터 단위들을 Z 스캔 순서에 따라 스캔할 수 있음을 설명하였지만, 데이터 단위들의 스캔 순서는 래스터 스캔, N 스캔, 우상향 대각 스캔, 수평적 스캔, 수직적 스캔 등 다양한 스캔 순서로 수행될 수 있고, Z 스캔 순서에 한정하여 해석되는 것은 아니다.
또한, 전술한 실시예에서는, 기준 부호화 단위 내의 부호화 단위들에 대해 스캔을 수행하는 것으로 설명하였지만, 이에 한정하여 해석되어서는 안되며, 스캔 수행의 대상은 최대 부호화 단위 또는 프로세싱 블록 내의 임의의 블록일 수 있다.
또한, 전술한 실시예에서는, 비-정사각형 형태의 블록이 적어도 하나 이상 존재하는 경우에만 서브 블록들로 분할하여 Z 스캔 순서에 따른 스캔을 수행하는 것으로 설명하였지만, 단순화된 구현을 위해 비-정사각형 형태의 블록이 존재하지 않는 경우에도 서브 블록들을 분할하여 Z 스캔 순서에 따른 스캔을 수행할 수도 있다.
일 실시예에 따른 영상 복호화 장치(100)는, 부호화 단위에 대한 인터 예측 또는 인트라 예측을 수행하여 예측 데이터를 생성하고, 현재 부호화 단위에 포함된 변환 단위에 대해 역변환을 수행하여 레지듀얼 데이터를 생성하며, 생성된 예측 데이터와 레지듀얼 데이터를 이용하여 현재 부호화 단위를 복원할 수 있다.
일 실시예에 따른 부호화 단위의 예측 모드는 인트라 모드, 인터 모드 및 스킵 모드 중 적어도 하나일 수 있다. 일 실시예에 따라, 부호화 단위 마다 독립적으로 예측 모드가 선택될 수 있다.
일 실시예에 따른 2Nx2N 형태의 부호화 단위가 분할하여 두 개의 2NxN 또는 두 개의 Nx2N 형태의 부호화 단위들로 분할된 경우, 이들 각각의 부호화 단위에 대해서 인터 모드 예측 및 인트라 모드 예측이 별개로 수행될 수도 있다. 또한, 일 실시예에 따른 2NxN 또는 Nx2N 형태의 부호화 단위에 대해서는 스킵 모드가 적용될 수도 있다.
한편, 일 실시예에 따른 영상 복호화 장치(100)는, 8x4 또는 4x8 형태의 부호화 단위의 스킵 모드에서 양방향 예측(bi-prediction)의 수행이 허용될 수도 있다. 스킵 모드에서는 부호화 단위에 대해 스킵 모드 정보만을 전송받기 때문에 해당 부호화 단위에 대한 레지듀얼 데이터의 이용이 생략된다. 따라서, 이 경우 역양자화 및 역변환에 대한 오버헤드(overhead)를 절약할 수 있다. 그 대신, 일 실시예에 따른 영상 복호화 장치(100)는 스킵 모드가 적용되는 부호화 단위에 대해 양방향 예측을 허용하여 복호화 효율을 높일 수 있다. 또한, 일 실시예에 따른 영상 복호화 장치(100)는 8x4 또는 4x8 형태의 부호화 단위에 대해 양방향 예측을 허용하되, 움직임 보상 단계에서 보간 탭(interpolation tap) 수를 상대적으로 적게 설정하여 메모리 대역폭을 효율적으로 사용할 수 있다. 일 예로, 8-탭의 보간 필터를 사용하는 대신 8 미만의 탭 수의 보간 필터(예를 들어, 2-탭 보간 필터)를 사용할 수도 있다.
또한, 일 실시예에 따른 영상 복호화 장치(100)는 현재 부호화 단위에 포함된 영역을 미리설정된 형태로 분할(예를 들어, 사선 기반 분할)하여 분할된 각 영역에 대한 인트라 또는 인터 예측 정보를 시그널링할 수도 있다.
일 실시예에 따른 영상 복호화 장치(100)는 인트라 모드를 이용하여 현재 부호화 단위의 예측 샘플을 현재 부호화 단위의 주변 샘플을 이용하여 획득할 수 있다. 이 때, 인트라 예측은 주변의 이미 재구성된 샘플들을 사용하여 예측을 수행하는데 이러한 샘플들을 참조 샘플이라고 한다.
도 30은 일 실시예에 따른 부호화 단위의 인트라 예측을 위한 참조 샘플을 나타내는 도면이다. 도 30을 참조하면, 블록 형태가 비-사각형 형태이고 수평 방향의 길이가 w, 수직 방향의 길이가 h인 현재 부호화 단위(3000)에 대하여, 상단의 참조 샘플(3002)이 w+h 개, 좌측의 참조 샘플(3004)이 w+h 개, 좌측 상단의 참조 샘플(3006)에 한 개로 총 2(w+h)+1 개의 참조 샘플이 필요하다. 참조 샘플의 준비를 위해, 참조 샘플이 존재하지 않는 부분에 대해 패딩을 수행하는 단계를 거치며, 재구성된 참조 샘플에 포함된 양자화 에러를 줄이기 위한 예측 모드별 참조 샘플 필터링 과정을 거칠 수도 있다.
전술한 실시예에서는 현재 부호화 단위의 블록 형태가 비-사각형 형태인 경우의 참조 샘플의 개수를 설명하였으나, 이러한 참조 샘플의 개수는 현재 부호화 단위가 사각형 형태의 블록 형태인 경우에도 동일하게 적용된다.
상술한 다양한 실시예들은 영상 복호화 장치(100)이 수행하는 영상 복호화 방법과 관련된 동작을 설명한 것이다. 이하에서는 이러한 영상 복호화 방법에 역순의 과정에 해당하는 영상 부호화 방법을 수행하는 영상 부호화 장치(200)의 동작을 다양한 실시예를 통해 설명하도록 한다.
일 실시예에 따라 부호화부(220)는 영상을 분할하는 적어도 하나의 부호화 단위를 결정할 수 있고, 비트스트림 생성부(210)는 적어도 하나의 부호화 단위의 결정과정에서 분할 형태 정보, 블록 형태 정보 등과 같은 소정의 정보를 포함하는 비트스트림을 생성하기 위한 상기 소정의 정보를 이용하여 영상을 부호화 하기 위한 부호화부(220)를 포함할 수 있다. 일 실시예에 따라 영상 부호화 장치(200)의 부호화부(220)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 영상을 분할하는 적어도 하나의 부호화 단위를 결정할 수 있고, 영상 부호화 장치(200)의 비트스트림 생성부(210)에서 이러한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 포함하는 비트스트림을 생성할 수 있다. 여기서 블록 형태 정보는 부호화 단위의 형태를 나타내는 정보 또는 신택스를 의미할 수 있고, 분할 형태 정보는 부호화 단위가 분할되는 형태를 나타내는 정보 또는 신택스를 의미할 수 있다.
일 실시예에 따라 영상 부호화 장치(200)의 부호화부(220)는 부호화 단위의 형태를 결정할 수 있다. 예를 들면 부호화 단위가 정사각형인지 또는 비-정사각형의 형태를 가질 수 있고, 이러한 형태를 나타내는 정보는 블록 형태 정보에 포함될 수 있다
일 실시예에 따라 부호화부(220)는 부호화 단위가 어떤 형태로 분할될지를 결정할 수 있다. 부호화부(220)는부호화 단위에 포함되는 적어도 하나의 부호화 단위의 형태를 결정할 수 있고 비트스트림 생성부(210)는 이러한 부호화 단위의 형태에 대한 정보를 포함하는 분할 형태 정보를 포함하는 비트스트림을 생성할 수 있다.
일 실시예에 따라 부호화부(220)는 부호화 단위가 분할되는지 분할되지 않는지 여부를 결정할 수 있다. 부호화부(220)가 부호화 단위에 하나의 부호화 단위만이 포함되거나 또는 부호화 단위가 분할되지 않는 것으로 결정하는 경우비트스트림 생성부(210)는 부호화 단위가 분할되지 않음을 나타내는 분할 형태 정보를 포함하는 비트스트림을 생성할 수 있다. 또한 부호화부(220)는 부호화 단위에 포함되는 복수개의 부호화 단위로 분할할 수 있고, 비트스트림 생성부(210)는 부호화 단위는 복수개의 부호화 단위로 분할됨을 나타내는 분할 형태 정보를 포함하는 비트스트림을 생성할 수 있다.
일 실시예에 따라 부호화 단위를 몇 개의 부호화 단위로 분할할 지를 나타내거나 어느 방향으로 분할할지를 나타내는 정보가 분할 형태 정보에 포함될 수 있다. 예를 들면 분할 형태 정보는 수직 방향 및 수평 방향 중 적어도 하나의 방향으로 분할하는 것을 나타내거나 또는 분할하지 않는 것을 나타낼 수 있다.
도 9는 일 실시예에 따라 영상 부호화 장치(200)가 현재 부호화 단위를 분할하여 적어도 하나의 부호화 단위를 결정하는 과정을 도시한다.
일 실시예에 따라 부호화부(220)는 부호화 단위의 형태를 결정할 수 있다. 예를 들면, 부호화부(220)는 RD(rate distortion) cost를 고려하여 최적의 RD-cost를 갖는 부호화 단위의 형태를 결정할 수 있다.
일 실시예에 따라, 부호화부(220)는 현재 부호화 단위가 정사각형 형태임을결정할 수 있고, 이에 따라 정사각형 형태의 부호화 단위가 분할되는 형태를 결정할 수 있다. 예를 들어 부호화부(220)는 정사각형의 부호화 단위를 분할하지 않을지, 수직으로 분할할지, 수평으로 분할할지, 4개의 부호화 단위로 분할할지 등을 결정할 수 있다. 도 9를 참조하면, 부호화부(220)는 현재 부호화 단위(900)와 동일한 크기를 가지는 부호화 단위(910a)를 분할하지 않거나, 소정의 분할방법을 나타내는 분할 형태 정보에 기초하여 분할된 부호화 단위(910b, 910c, 910d 등)를 결정할 수 있다.
도 9를 참조하면 부호화부(220)는 일 실시예에 따라 현재 부호화 단위(900)를 수직방향으로 분할한 두개의 부호화 단위(910b)를 결정할 수 있다. 부호화부(220)는 현재 부호화 단위(900)를 수평방향으로 분할한 두개의 부호화 단위(910c)를 결정할 수 있다. 부호화부(220)는 현재 부호화 단위(900)를 수직방향 및 수평방향으로 분할한 네개의 부호화 단위(910d)를 결정할 수 있다. 다만 정사각형의 부호화 단위가 분할될 수 있는 분할 형태는 상술한 형태로 한정하여 해석되어서는 안되고, 분할 형태 정보가 나타낼 수 있는 다양한 형태가 포함될 수 있다. 정사각형의 부호화 단위가 분할되는 소정의 분할 형태들은 이하에서 다양한 실시예를 통해 구체적으로 설명하도록 한다.
일 실시예에 따라 영상 부호화 장치(200)의 비트스트림 생성부(210)는 현재 부호화 단위(900)가 부호화부(220)에 의해 분할된 형태를 나타내는 분할 형태 정보를 포함하는 비트스트림을 생성할 수 있다.
도 10는 일 실시예에 따라 영상 부호화 장치(200)가 비-정사각형의 형태인 부호화 단위를 분할하여 적어도 하나의 부호화 단위를 결정하는 과정을 도시한다.
일 실시예에 따라 부호화부(220)는 비-정사각형의 현재 부호화 단위를 분할하지 않을지 소정의 방법으로 분할할지 여부를 결정할 수 있다. 도 10를 참조하면, 현재 부호화 단위(1000 또는 1050)의 부호화부(220)는 현재 부호화 단위(1000 또는 1050)와 동일한 크기를 가지는 부호화 단위(1010 또는 1060)를 분할하지 않거나, 소정의 분할방법에 따라 분할된 부호화 단위(1020a, 1020b, 1030a, 1030b, 1030c, 1070a, 1070b, 1080a, 1080b, 1080c)를 결정할 수 있다. 영상 부호화 장치(200)의 비트스트림 생성부(210)는 이러한 분할 형태를 나타내는 분할 형태 정보를 포함하는 비트스트림을 생성할 수 있다. 비-정사각형의 부호화 단위가 분할되는 소정의 분할 방법은 이하에서 다양한 실시예를 통해 구체적으로 설명하도록 한다.
일 실시예에 따라 부호화부(220)는 부호화 단위가 분할되는 형태를 결정할 수 있다. 도 10를 참조하면 부호화부(220)는 현재 부호화 단위(1000 또는 1050)를 분할하여 현재 부호화 단위에 포함되는 두개의 부호화 단위(1020a, 1020b, 또는 1070a, 1070b)를 결정할 수 있고, 비트스트림 생성부(210)는 이러한 분할 형태를 나타내는 분할 형태 정보를 포함하는 비트스트림을 생성할 수 있다.
일 실시예에 따라 부호화부(220)가 비-정사각형의 형태의 현재 부호화 단위(1000 또는 1050)를 분할하는 경우, 비-정사각형의 현재 부호화 단위(1000 또는 1050)의 긴 변의 위치를 고려하여 현재 부호화 단위를 분할할 수 있다. 예를 들면, 부호화부(220)는 현재 부호화 단위(1000 또는 1050)의 형태를 고려하여 현재 부호화 단위(1000 또는 1050)의 긴 변을 분할하는 방향으로 현재 부호화 단위(1000 또는 1050)를 분할하여 복수개의 부호화 단위를 결정할 수 있고, 비트스트림 생성부(210)는 이러한 분할 형태를 나타내는 분할 형태 정보를 포함하는 비트스트림을 생성할 수 있다.
일 실시예에 따라, 부호화부(220)는 현재 부호화 단위(1000 또는 1050)에 포함되는 홀수개의 부호화 단위를 결정할 수 있다. 예를 들면, 부호화부(220)는 현재 부호화 단위(1000 또는 1050)를 3개의 부호화 단위(1030a, 1030b, 1030c, 1080a, 1080b, 1080c)로 분할할 수 있다. 일 실시예에 따라 부호화부(220)는 현재 부호화 단위(1000 또는 1050)에 포함되는 홀수개의 부호화 단위를 결정할 수 있으며, 결정된 부호화 단위들의 크기 모두가 동일하지는 않을 수 있다. 예를 들면, 결정된 홀수개의 부호화 단위(1030a, 1030b, 1030c, 1080a, 1080b, 1080c) 중 소정의 부호화 단위(1030b 또는 1080b)의 크기는 다른 부호화 단위(1030a, 1030c, 1080a, 1080c)들과는 다른 크기를 가질 수도 있다. 즉, 현재 부호화 단위(1000 또는 1050)가 분할되어 결정될 수 있는 부호화 단위는 복수의 종류의 크기를 가질 수 있고, 경우에 따라서는 홀수개의 부호화 단위(1030a, 1030b, 1030c, 1080a, 1080b, 1080c)가 각각 서로 다른 크기를 가질 수도 있다.
일 실시예에 따라 부호화부(220)는 현재 부호화 단위(1000 또는 1050)에 포함되는 홀수개의 부호화 단위를 결정할 수 있고, 나아가 부호화부(220)는 분할하여 생성되는 홀수개의 부호화 단위들 중 적어도 하나의 부호화 단위에 대하여 소정의 제한을 둘 수 있다. 도 10를 참조하면 부호화부(220)는 현재 부호화 단위(1000 또는 1050)가 분할되어 생성된 3개의 부호화 단위(1030a, 1030b, 1030c, 1080a, 1080b, 1080c)들 중 중앙에 위치하는 부호화 단위(1030b, 1080b)에 대한 복호화 과정을 다른 부호화 단위(1030a, 1030c, 1080a, 1080c)와 다르게 할 수 있다. 예를 들면, 부호화부(220)는 중앙에 위치하는 부호화 단위(1030b, 1080b)에 대하여는 다른 부호화 단위(1030a, 1030c, 1080a, 1080c)와 달리 더 이상 분할되지 않도록 제한하거나, 소정의 횟수만큼만 분할되도록 제한할 수 있다.
도 11은 일 실시예에 따라 영상 부호화 장치(200)가 부호화 단위를 분할하는 과정을 도시한다.
일 실시예에 따라 부호화부(220)는 정사각형 형태의 제1 부호화 단위(1100)를 부호화 단위들로 분할하거나 분할하지 않는 것으로 결정할 수 있다. 일 실시예에 따라 부호화부(220)는 제1 부호화 단위(1100)를 수평 방향으로 분할하여 제2 부호화 단위(1110)를 결정할 수 있고, 비트스트림 일 실시예에 따라 이용되는 제1 부호화 단위, 제2 부호화 단위, 제3 부호화 단위는 부호화 단위 간의 분할 전후 관계를 이해하기 위해 이용된 용어이다. 예를 들면, 제1 부호화 단위를 분할하면 제2 부호화 단위가 결정될 수 있고, 제2 부호화 단위가 분할되면 제3 부호화 단위가 결정될 수 있다. 이하에서는 이용되는 제1 부호화 단위, 제2 부호화 단위 및 제3 부호화 단위의 관계는 상술한 특징에 따르는 것으로 이해될 수 있다.
일 실시예에 따라 영상 부호화 장치(200)는 결정된 제2 부호화 단위(1110)를 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 부호화 단위들로 분할하거나 분할하지 않는 것으로 결정할 수 있다. 도 11을 참조하면 부호화부(220)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1100)를 분할하여 결정된 비-정사각형의 형태의 제2 부호화 단위(1110)를 적어도 하나의 제3 부호화 단위(1120a, 1120b, 1120c, 1120d 등)로 분할하거나 제2 부호화 단위(1110)를 분할하지 않을 수 있다. 영상 부호화 장치(200)의 비트스트림 생성부(210)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 포함하는 비트스트림을 생성할 수 있고 부호화부(220)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1100)를 분할하여 다양한 형태의 복수개의 제2 부호화 단위(예를 들면, 1110)를 분할할 수 있으며, 제2 부호화 단위(1110)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1100)가 분할된 방식에 따라 분할될 수 있다. 일 실시예에 따라, 제1 부호화 단위(1100)가 제1 부호화 단위(1100)에 대한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제2 부호화 단위(1110)로 분할된 경우, 제2 부호화 단위(1110) 역시 제2 부호화 단위(1110)에 대한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제3 부호화 단위(예를 들면, 1120a, 1120b, 1120c, 1120d 등)으로 분할될 수 있다. 따라서 비-정사각형 형태의 부호화 단위에서 정사각형의 부호화 단위가 결정될 수 있고, 이러한 정사각형 형태의 부호화 단위가 재귀적으로 분할되어 비-정사각형 형태의 부호화 단위가 결정될 수도 있다. 도 11을 참조하면, 비-정사각형 형태의 제2 부호화 단위(1110)가 분할되어 결정되는 홀수개의 제3 부호화 단위(1120b, 1120c, 1120d) 중 소정의 부호화 단위(예를 들면, 가운데에 위치하는 부호화 단위 또는 정사각형 형태의 부호화 단위)는 재귀적으로 분할될 수 있다. 일 실시예에 따라 홀수개의 제3 부호화 단위(1120b, 1120c, 1120d) 중 하나인 정사각형 형태의 제3 부호화 단위(1120c)는 수평 방향으로 분할되어 복수개의 제4 부호화 단위로 분할될 수 있다. 복수개의 제4 부호화 단위 중 하나인 비-정사각형 형태의 제4 부호화 단위(1140)는 다시 복수개의 부호화 단위들로 분할될 수 있다. 예를 들면, 비-정사각형 형태의 제4 부호화 단위(1140)는 홀수개의 부호화 단위(1150a, 1150b, 1150c)로 다시 분할될 수도 있다.
부호화 단위는 부호화 단위 각각에 관련된 분할 형태 정보 및 블록 형태 정보 중 적어도 하나에 기초하여 재귀적으로 분할될 수 있다. 부호화 단위의 재귀적 분할에 이용될 수 있는 방법에 대하여는 다양한 실시예를 통해 후술하도록 한다.
일 실시예에 따라 부호화부(220)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제3 부호화 단위(1120a, 1120b, 1120c, 1120d 등) 각각을 부호화 단위들로 분할하거나 제2 부호화 단위(1110)를 분할하지 않는 것으로 결정할 수 있다. 부호화부(220)는 일 실시예에 따라 비-정사각형 형태의 제2 부호화 단위(1110)를 홀수개의 제3 부호화 단위(1120b, 1120c, 1120d)로 분할할 수 있다. 영상 부호화 장치(200)는 홀수개의 제3 부호화 단위(1120b, 1120c, 1120d) 중 소정의 제3 부호화 단위에 대하여 소정의 제한을 둘 수 있다. 예를 들면 영상 부호화 장치(200)는 홀수개의 제3 부호화 단위(1120b, 1120c, 1120d) 중 가운데에 위치하는 부호화 단위(1120c)에 대하여는 더 이상 분할되지 않는 것으로 제한하거나 또는 설정 가능한 횟수로 분할되어야 하는 것으로 제한할 수 있다. 도 11을 참조하면, 영상 부호화 장치(200)는 비-정사각형 형태의 제2 부호화 단위(1110)에 포함되는 홀수개의 제3 부호화 단위(1120b, 1120c, 1120d)들 중 가운데에 위치하는 부호화 단위(1120c)는 더 이상 분할되지 않거나, 소정의 분할 형태로 분할(예를 들면 4개의 부호화 단위로만 분할하거나 제2 부호화 단위(1110)가 분할된 형태에 대응하는 형태로 분할)되는 것으로 제한하거나, 소정의 횟수로만 분할(예를 들면 n회만 분할, n>0)하는 것으로 제한할 수 있다. 다만 가운데에 위치한 부호화 단위(1120c)에 대한 상기 제한은 단순한 실시예들에 불과하므로 상술한 실시예들로 제한되어 해석되어서는 안되고, 가운데에 위치한 부호화 단위(1120c)가 다른 부호화 단위(1120b, 1120d)와 다르게 복호화 될 수 있는 다양한 제한들을 포함하는 것으로 해석되어야 한다.
일 실시예에 따라 영상 부호화 장치(200)의 비트스트림 생성부(210)는 현재 부호화 단위 내의 소정의 위치의 샘플과 관련한 비트스트림과 함께, 현재 부호화 단위를 분할하기 위해 사용된 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 포함하는 비트스트림을 생성할 수 있다.
도 12는 일 실시예에 따라 부호화부(220)가 홀수개의 부호화 단위들 중 소정의 부호화 단위를 결정하기 위한 방법을 도시한다. 영상 부호화 장치(200)의 부호화부(220)는 현재 부호화 단위를 다양한 형태 및 크기의 부호화 단위들로 분할하거나 분할하지 않는 것으로 결정할 수 있다. 도 12를 참조하면, 비트스트림 생성부(210)는 현재 부호화 단위(1200)에 포함되는 복수개의 샘플 중 소정 위치의 샘플(예를 들면, 가운데에 위치하는 샘플(1240))과 관련된 비트스트림과 함께, 현재 부호화 단위(1200)의 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 포함하는 비트스트림을 생성할 수 있다. 다만 이러한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나와 관련된 현재 부호화 단위(1200) 내의 소정 위치가 도 12에서 도시하는 가운데 위치로 한정하여 해석되어서는 안되고, 소정 위치에는 현재 부호화 단위(1200)내에 포함될 수 있는 다양한 위치(예를 들면, 최상단, 최하단, 좌측, 우측, 좌측상단, 좌측하단, 우측상단 또는 우측하단 등)가 포함될 수 있는 것으로 해석되어야 한다.
일 실시예에 따라 영상 부호화 장치(200)는 현재 부호화 단위가 소정의 개수의 부호화 단위들로 분할된 경우 그 중 하나의 부호화 단위를 선택할 수 있다. 복수개의 부호화 단위들 중 하나를 선택하기 위한 방법은 다양할 수 있으며, 이러한 방법들에 대한 설명은 이하의 다양한 실시예를 통해 후술하도록 한다.
일 실시예에 따라 영상 부호화 장치(200)의 부호화부(220)는 현재 부호화 단위를 복수개의 부호화 단위들로 분할하고, 소정 위치의 부호화 단위를 결정할 수 있다.
도 12는 일 실시예에 따라 영상 부호화 장치(200)가 홀수개의 부호화 단위들 중 소정 위치의 부호화 단위를 결정하기 위한 방법을 도시한다.
일 실시예에 따라 부호화부(220)는 홀수개의 부호화 단위들 중 가운데에 위치하는 부호화 단위를 결정하기 위하여 홀수개의 부호화 단위들 각각의 위치를 나타내는 정보를 이용할 수 있다. 도 12를 참조하면, 부호화부(220)는 현재 부호화 단위(1200)를 분할하여 홀수개의 부호화 단위들(1220a, 1220b, 1220c)을 결정할 수 있다. 부호화부(220)는 홀수개의 부호화 단위들(1220a, 1220b, 1220c)의 위치에 대한 정보를 이용하여 가운데 부호화 단위(1220b)를 결정할 수 있다. 예를 들면 부호화부(220)는 부호화 단위들(1220a, 1220b, 1220c)에 포함되는 소정의 샘플의 위치를 나타내는 정보에 기초하여 부호화 단위들(1220a, 1220b, 1220c)의 위치를 결정함으로써 가운데에 위치하는 부호화 단위(1220b)를 결정할 수 있다. 구체적으로, 부호화부(220)는 부호화 단위들(1220a, 1220b, 1220c)의 좌측 상단의 샘플(1230a, 1230b, 1230c)의 위치를 나타내는 정보에 기초하여 부호화 단위(1220a, 1220b, 1220c)의 위치를 결정함으로써 가운데에 위치하는 부호화 단위(1220b)를 결정할 수 있다.
일 실시예에 따라 부호화 단위(1220a, 1220b, 1220c)에 각각 포함되는 좌측 상단의 샘플(1230a, 1230b, 1230c)의 위치를 나타내는 정보는 부호화 단위(1220a, 1220b, 1220c)의 픽쳐 내에서의 위치 또는 좌표에 대한 정보를 포함할 수 있다. 일 실시예에 따라 부호화 단위(1220a, 1220b, 1220c)에 각각 포함되는 좌측 상단의 샘플(1230a, 1230b, 1230c)의 위치를 나타내는 정보는 현재 부호화 단위(1200)에 포함되는 부호화단위(1220a, 1220b, 1220c)들의 너비 또는 높이를 나타내는 정보를 포함할 수 있고, 이러한 너비 또는 높이는 부호화 단위(1220a, 1220b, 1220c)의 픽쳐 내에서의 좌표 간의 차이를 나타내는 정보에 해당할 수 있다. 즉, 영상 부호화 장치(200)는 부호화 단위(1220a, 1220b, 1220c)의 픽쳐 내에서의 위치 또는 좌표에 대한 정보를 직접이용하거나 좌표간의 차이값을 나타내는 부호화 단위의 너비 또는 높이에 대한 정보를 이용함으로써 가운데에 위치하는 부호화 단위(1220b)를 결정할 수 있다.
일 실시예에 따라, 상단 부호화 단위(1220a)의 좌측 상단의 샘플(1230a)의 위치를 나타내는 정보는 (xa, ya) 좌표를 나타낼 수 있고, 가운데 부호화 단위(1220b)의 좌측 상단의 샘플(1230b)의 위치를 나타내는 정보는 (xb, yb) 좌표를 나타낼 수 있고, 하단 부호화 단위(1220c)의 좌측 상단의 샘플(1230c)의 위치를 나타내는 정보는 (xc, yc) 좌표를 나타낼 수 있다. 영상 부호화 장치(200)는 부호화 단위(1220a, 1220b, 1220c)에 각각 포함되는 좌측 상단의 샘플(1230a, 1230b, 1230c)의 좌표를 이용하여 가운데 부호화 단위(1220b)를 결정할 수 있다. 예를 들면, 좌측 상단의 샘플(1230a, 1230b, 1230c)의 좌표를 오름차순 또는 내림차순으로 정렬하였을 때, 가운데에 위치하는 샘플(1230b)의 좌표인 (xb, yb)를 포함하는 부호화 단위(1220b)를 현재 부호화 단위(1200)가 분할되어 결정된 부호화 단위(1220a, 1220b, 1220c) 중 가운데에 위치하는 부호화 단위로 결정할 수 있다. 다만 좌측 상단의 샘플(1230a, 1230b, 1230c)의 위치를 나타내는 좌표는 픽쳐 내에서의 절대적인 위치를 나타내는 좌표를 나타낼 수 있고, 나아가 상단 부호화 단위(1220a)의 좌측 상단의 샘플(1230a)의 위치를 기준으로, 가운데 부호화 단위(1220b)의 좌측 상단의 샘플(1230b)의 상대적 위치를 나타내는 정보인 (dxb, dyb)좌표, 하단 부호화 단위(1220c)의 좌측 상단의 샘플(1230c)의 상대적 위치를 나타내는 정보인 (dxc, dyc)좌표를 이용할 수도 있다. 또한 부호화 단위에 포함되는 샘플의 위치를 나타내는 정보로서 해당 샘플의 좌표를 이용함으로써 소정 위치의 부호화 단위를 결정하는 방법이 상술한 방법으로 한정하여 해석되어서는 안되고, 샘플의 좌표를 이용할 수 있는 다양한 산술적 방법으로 해석되어야 한다.
일 실시예에 따라 영상 부호화 장치(200)는 현재 부호화 단위(1200)를 복수개의 부호화 단위(1220a, 1220b, 1220c)로 분할할 수 있고, 부호화 단위(1220a, 1220b, 1220c)들 중 소정의 기준에 따라 부호화 단위를 선택할 수 있다. 예를 들면, 부호화부(220)는 부호화 단위(1220a, 1220b, 1220c) 중 크기가 다른 부호화 단위(1220b)를 선택할 수 있다.
일 실시예에 따라 영상 부호화 장치(200)는 상단 부호화 단위(1220a)의 좌측 상단의 샘플(1230a)의 위치를 나타내는 정보인 (xa, ya) 좌표, 가운데 부호화 단위(1220b)의 좌측 상단의 샘플(1230b)의 위치를 나타내는 정보인 (xb, yb) 좌표, 하단 부호화 단위(1220c)의 좌측 상단의 샘플(1230c)의 위치를 나타내는 정보인 (xc, yc) 좌표를 이용하여 부호화 단위(1220a, 1220b, 1220c) 각각의 너비 또는 높이를 결정할 수 있다. 영상 부호화 장치(200)는 부호화 단위(1220a, 1220b, 1220c)의 위치를 나타내는 좌표인 (xa, ya), (xb, yb), (xc, yc)를 이용하여 부호화 단위(1220a, 1220b, 1220c) 각각의 크기를 결정할 수 있다.
일 실시예에 따라, 영상 부호화 장치(200)는 상단 부호화 단위(1220a)의 너비를 xb-xa로 결정할 수 있고 높이를 yb-ya로 결정할 수 있다. 일 실시예에 따라 부호화부(220)는 가운데 부호화 단위(1220b)의 너비를 xc-xb로 결정할 수 있고 높이를 yc-yb로 결정할 수 있다. 일 실시예에 따라 부호화부(220)는 하단 부호화 단위의 너비 또는 높이는 현재 부호화 단위의 너비 또는 높이와 상단 부호화 단위(1220a) 및 가운데 부호화 단위(1220b)의 너비 및 높이를 이용하여 결정할 수 있다. 부호화부(220)는 결정된 부호화 단위(1220a, 1220b, 1220c)의 너비 및 높이에 기초하여 다른 부호화 단위와 다른 크기를 갖는 부호화 단위를 결정할 수 있다. 도 12를 참조하면, 영상 부호화 장치(200)는 상단 부호화 단위(1220a) 및 하단 부호화 단위(1220c)의 크기와 다른 크기를 가지는 가운데 부호화 단위(1220b)를 소정 위치의 부호화 단위로 결정할 수 있다. 다만 상술한 영상 부호화 장치(200)가 다른 부호화 단위와 다른 크기를 갖는 부호화 단위를 결정하는 과정은 샘플 좌표에 기초하여 결정되는 부호화 단위의 크기를 이용하여 소정 위치의 부호화 단위를 결정하는 일 실시예에 불과하므로, 소정의 샘플 좌표에 따라 결정되는 부호화 단위의 크기를 비교하여 소정 위치의 부호화 단위를 결정하는 다양한 과정이 이용될 수 있다.
다만 부호화 단위의 위치를 결정하기 위하여 고려하는 샘플의 위치는 상술한 좌측 상단으로 한정하여 해석되어서는 안되고 부호화 단위에 포함되는 임의의 샘플의 위치에 대한 정보가 이용될 수 있는 것으로 해석될 수 있다.
일 실시예에 따라 영상 부호화 장치(200)는 현재 부호화 단위의 형태를 고려하여, 현재 부호화 단위가 분할되어 결정되는 홀수개의 부호화 단위들 중 소정 위치의 부호화 단위를 선택할 수 있다. 예를 들면, 현재 부호화 단위가 너비가 높이보다 긴 비-정사각형 형태라면 부호화부(220)는 수평 방향에 따라 소정 위치의 부호화 단위를 결정할 수 있다. 즉, 부호화부(220)는 수평 방향으로 위치를 달리 하는 부호화 단위들 중 하나를 결정하여 해당 부호화 단위에 대한 제한을 둘 수 있다. 현재 부호화 단위가 높이가 너비보다 긴 비-정사각형 형태라면 부호화부(220)는 수직 방향에 따라 소정 위치의 부호화 단위를 결정할 수 있다. 즉, 부호화부(220)는 수직 방향으로 위치를 달리 하는 부호화 단위들 중 하나를 결정하여 해당 부호화 단위에 대한 제한을 둘 수 있다.
일 실시예에 따라 영상 부호화 장치(200)는 짝수개의 부호화 단위들 중 소정 위치의 부호화 단위를 결정하기 위하여 짝수개의 부호화 단위들 각각의 위치를 나타내는 정보를 이용할 수 있다. 부호화부(220)는 현재 부호화 단위를 분할하여 짝수개의 부호화 단위들을 결정할 수 있고 짝수개의 부호화 단위들의 위치에 대한 정보를 이용하여 소정 위치의 부호화 단위를 결정할 수 있다. 이에 대한 구체적인 과정은 도 12에서 상술한 홀수개의 부호화 단위들 중 소정 위치(예를 들면, 가운데 위치)의 부호화 단위를 결정하는 과정과 유사한 과정일 수 있으므로 생략하도록 한다.
일 실시예에 따라, 비-정사각형 형태의 현재 부호화 단위를 복수개의 부호화 단위로 분할한 경우, 복수개의 부호화 단위들 중 소정 위치의 부호화 단위를 결정하기 위하여 현재 부호화 단위의 분할 과정에서 이용된 소정의 정보를 이용할 수 있다. 예를 들면 영상 부호화 장치(200)의 부호화부(220)는 현재 부호화 단위가 복수개로 분할된 부호화 단위들 중 가운데에 위치하는 부호화 단위를 결정하기 위하여 현재 부호화 단위의 분할 과정에서 이용된 소정의 정보로서 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 이용할 수 있고, 이러한 정보는 다.
도 12를 참조하면 영상 부호화 장치(200)의 부호화부(220)는 현재 부호화 단위(1200)를 복수개의 부호화 단위들(1220a, 1220b, 1220c)로 분할할 수 있으며, 복수개의 부호화 단위들(1220a, 1220b, 1220c) 중 가운데에 위치하는 부호화 단위(1220b)를 결정할 수 있고, 비트스트림 생성부(210)는 현재 부호화 단위(1200)의 분할 과정에서 이용된 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 포함하는 비트스트림을 생성할 수 있다. 부호화부(220)는 현재 부호화 단위(1200)의 분할 과정에서 이용된 블록 형태 정보 및 분할 형태 정보 중 적어도 하나의 비트스트림과 관련된 샘플의 위치를 고려하여, 가운데에 위치하는 부호화 단위(1220b)를 결정할 수 있다. 즉, 현재 부호화 단위(1200)의 가운데에 위치하는 샘플(1240)과 관련된 비트스트림과 함께 현재 부호화 단위(1200)의 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 포함하는 비트스트림이 생성될 수 있고, 이 경우 부호화부(220)는 상기 샘플(1240)을 포함하는 부호화 단위(1220)b를 복수개의 부호화 단위들(1220a, 1220b, 1220c) 중 가운데에 위치하는 부호화 단위로 결정할 수 있다. 다만 현재 부호화 단위가 분할되어 결정된 복수개의 부호화 단위 중 가운데에 위치하는 부호화 단위로 결정하기 위해 이용되는 정보가, 현재 부호화 단위의 분할 과정에서 이용되었던 블록 형태 정보 및 분할 형태 정보 중 적어도 하나로 한정하여 해석되어서는 안되고, 다양한 종류의 정보가 이용될 수 있다. 이와 관련하여 영상 부호화 장치(200)가 소정 위치의 부호화 단위를 결정하는 과정은, 영상 복호화 장치(100)가 현재 부호화 단위로부터 결정된 복수개의 부호화 단위들 중 소정 위치의 부호화 단위를 결정하는 과정에 반대되는 과정일 수 있으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 영상 부호화 장치(200)는 현재 부호화 단위를 분할하여 적어도 하나의 부호화 단위를 결정할 수 있고, 이러한 적어도 하나의 부호화 단위가 복호화되는 순서를 소정의 블록(예를 들면, 현재 부호화 단위)에 따라 결정할 수 있다.
도 13은 일 실시예에 따라 영상 부호화 장치(200)가 현재 부호화 단위를 분할하여 복수개의 부호화 단위들을 결정하는 경우, 복수개의 부호화 단위들이 처리되는 순서를 도시한다. 도 13과 관련한 영상 부호화 장치(200)가 복수개의 부호화 단위들을 처리하는 과정은, 도 13과 관련하여 상술한 영상 복호화 장치(100)의 동작과 유사한 과정일 수 있으므로 자세한 설명은 생략하도록 한다.
도 14는 일 실시예에 따라 영상 부호화 장치(200)가 소정의 순서로 부호화 단위가 처리될 수 없는 경우, 현재 부호화 단위가 홀수개의 부호화 단위로 분할되는 것임을 결정하는 과정을 도시한다.
일 실시예에 따라 영상 부호화 장치(200)의 부호화부(220)는 현재 부호화 단위가 홀수개의 부호화 단위들로 분할되는 것을 결정할 수 있고, 비트스트림 생성부(210)는 현재 부호화 단위의 형태를 나타내는 블록 형태 정보 및 현재 부호화 단위의 분할 형태(홀수개로 분할됨)를 나타내는 분할 형태 정보를 포함하는 비트스트림을 생성할 수 있다. 도 14를 참조하면 정사각형 형태의 제1 부호화 단위(1400)가 비-정사각형 형태의 제2 부호화 단위(1410a, 1410b)로 분할될 수 있고, 제2 부호화 단위(1410a, 1410b)는 각각 독립적으로 제3 부호화 단위(1420a, 1420b, 1420c, 1420d, 1420e)로 분할될 수 있다. 일 실시예에 따라 부호화부(220)는 제2 부호화 단위 중 좌측 부호화 단위(1410a)는 수평 방향으로 분할하여 복수개의 제3 부호화 단위(1420a, 1420b)를 결정할 수 있고, 우측 부호화 단위(1410b)는 홀수개의 제3 부호화 단위(1420c, 1420d, 1420e)로 분할할 수 있다. 도 14과 관련한 영상 부호화 장치(200)가 현재 부호화 단위가 홀수개의 부호화 단위로 분할되는 것임을 결정하는 과정은, 도 14과 관련하여 상술한 영상 복호화 장치(100)의 동작에 반대되는 과정일 수 있으므로 자세한 설명은 생략하도록 한다.
도 15는 일 실시예에 따라 영상 부호화 장치(200)가 제1 부호화 단위(1500)를 분할하여 적어도 하나의 부호화 단위를 결정하는 것을 도시한다. 일 실시예에 따라 부호화부(220)는 제1 부호화 단위(1500)를 분할할 수 있고, 비트스트림 생성부(210)는 제1 부호화 단위(1500)의 형태를 나타내는 블록 형태 정보 및 제1 부호화 단위(1500)가 분할되는 형태를 나타내는 분할 형태 정보 중 적어도 하나를 포함하는 비트스트림을 생성할 수 있다. 정사각형 형태의 제1 부호화 단위(1500)는 4개의 정사각형 형태를 가지는 부호화 단위로 분할되거나 또는 비-정사각형 형태의 복수개의 부호화 단위로 분할할 수 있다. 예를 들면 도 15를 참조하면, 부호화부(220)는 제1 부호화 단위(1500)를 복수개의 비-정사각형의 부호화 단위들로 분할할 수 있고, 이 경우 비트스트림 생성부(210)는 제1 부호화 단위(1500)는 정사각형임을 나타내는 블록 형태 정보 및 제1 부호화 단위(1500)가 비-정사각형의 부호화 단위로 분할됨을 나타내는 분할 형태 정보를 포함하는 비트스트림을 생성할 수 있다. 구체적으로, 부호화부(220)는 정사각형 형태의 제1 부호화 단위(1500)을 홀수개의 부호화 단위들로서 수직 방향으로 분할되어 결정된 제2 부호화 단위(1510a, 1510b, 1510c) 또는 수평 방향으로 분할되어 결정된 제2 부호화 단위(1520a, 1520b, 1520c)로 분할할 수 있고, 이 경우 비트스트림 생성부(210)는 제1 부호화 단위(1500)를 수평 방향 또는 수직 방향으로 분할하여 홀수개의 부호화 단위를 결정하는 것을 나타내는 분할 형태 정보를 포함하는 비트스트림을 생성할 수 있다. 도 15와 관련한 영상 부호화 장치(200)가 제1 부호화 단위(1500)를 분할하여 적어도 하나의 부호화 단위를 결정하는 과정은, 도 15와 관련하여 상술한 영상 복호화 장치(100)의 동작에 반대되는 과정일 수 있으므로 자세한 설명은 생략하도록 한다.
도 16은 일 실시예에 따라 영상 부호화 장치(200)가 제1 부호화 단위(1600)가 분할되어 결정된 비-정사각형 형태의 제2 부호화 단위가 소정의 조건을 만족하는 경우 제2 부호화 단위가 분할될 수 있는 형태가 제한되는 것을 도시한다.
일 실시예에 따라 부호화부(220) 정사각형 형태의 제1 부호화 단위(1600)를 비-정사각형 형태의 제2 부호화 단위(1610a, 1610b, 1620a, 1620b)로 분할하는 것으로 결정할 수 있다. 제2 부호화 단위(1610a, 1610b, 1620a, 1620b)는 독립적으로 분할될 수 있다. 이에 따라 부호화부(220)는 제2 부호화 단위(1610a, 1610b, 1620a, 1620b) 각각을 복수개의 부호화 단위로 분할하거나 분할하지 않는 것을 결정할 수 있다. 도 16과 관련한 영상 부호화 장치(200)가 비-정사각형 형태의 제2 부호화 단위가 소정의 조건을 만족 시 분할될 수 있는 형태가 제한하는 동작은, 도 16과 관련하여 상술한 영상 복호화 장치(100)의 동작에 반대되는 것일 수 있으므로 자세한 설명은 생략하도록 한다.
도 17은 일 실시예에 따라 분할 형태 정보가 4개의 정사각형 형태의 부호화 단위로 분할하는 것을 나타낼 수 없는 경우, 영상 부호화 장치(200)가 정사각형 형태의 부호화 단위를 분할하는 과정을 도시한다. 이와 관련한 영상 부호화 장치(200)의 동작은, 도 17과 관련하여 상술한 영상 복호화 장치(100)의 동작에 반대되는 것일 수 있으므로 자세한 설명은 생략하도록 한다.
도 18은 일 실시예에 따라 복수개의 부호화 단위들 간의 처리 순서가 부호화 단위의 분할 과정에 따라 달라질 수 있음을 도시한 것이다.
일 실시예에 따라 부호화부(220)는 정사각형 형태의 제1 부호화 단위(1800)를 수평 방향 및 수직 방향 중 적어도 하나의 방향으로 분할할 수 있다. 일 실시예에 따라 비트스트림 생성부(210)는 제1 부호화 단위(1800)가 정사각형 형태임을 나타내는 블록 형태 정보 및 제1 부호화 단위(1800)가 수평 방향 및 수직 방향 중 적어도 하나의 방향으로 분할됨을 나타내는 분할 형태 정보를 포함하는 비트스트림을 생성할 수 있다.
일 실시예에 따라 부호화부(220)는 제1 부호화 단위(1800)를 분할하여 제2 부호화 단위(예를 들면, 1810a, 1810b, 1820a, 1820b, 1830a, 1830b, 1830c, 1830d 등)를 결정할 수 있다. 도 18을 참조하면 제1 부호화 단위1800)가 수평 방향 또는 수직 방향만으로 분할되어 결정된 비-정사각형 형태의 제2 부호화 단위(1810a, 1810b, 1820a, 1820b)는 독립적으로 분할될 수 있다. 예를 들면 부호화부(220)는 제1 부호화 단위(1800)가 수직 방향으로 분할되어 생성된 제2 부호화 단위(1810a, 1810b)를 수평 방향으로 각각 분할하여 제3 부호화 단위(1816a, 1816b, 1816c, 1816d)를 결정할 수 있고, 제1 부호화 단위(1800)가 수평 방향으로 분할되어 생성된 제2 부호화 단위(1820a, 1820b)를 수평 방향으로 각각 분할하여 제3 부호화 단위(1826a, 1826b, 1826c, 1826d)를 결정할 수 있다. 도 16과 관련한 영상 부호화 장치(200)의 동작은, 도 16과 관련하여 상술한 영상 복호화 장치(100)의 동작에 반대되는 것일 수 있으므로 자세한 설명은 생략하도록 한다.
도 19는 일 실시예에 따라 부호화 단위가 재귀적으로 분할되어 복수개의 부호화 단위가 결정되는 경우, 부호화 단위의 형태 및 크기가 변함에 따라 부호화 단위의 심도가 결정되는 과정을 도시한다. 영상 부호화 장치(200)의 부호화부(220)가 부호화 단위의 심도를 결정하는 과정은, 도 19과 관련하여 상술한 영상 복호화 장치(100)의 복호화부(120)가 부호화 단위의 심도를 결정하는 과정에 반대되는 것일 수 있으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 영상 부호화 장치(200)는 현재 부호화 단위로부터 분할되어 결정된 복수개의 부호화 단위들을 구분하기 위한 인덱스의 값에 기초하여 특정 분할 형태로 분할된 것인지를 결정할 수 있다. 도 20을 참조하면 영상 부호화 장치(200)는 높이가 너비보다 긴 직사각형 형태의 제1 부호화 단위(2010)를 분할하여 짝수개의 부호화 단위(2012a, 2012b)를 결정하거나 홀수개의 부호화 단위(2014a, 2014b, 2014c)를 결정할 수 있다. 영상 부호화 장치(200)는 복수개의 부호화 단위 각각을 구분하기 위하여 각 부호화 단위를 나타내는 인덱스(PID)를 이용할 수 있다. 일 실시예에 따라 PID는 각각의 부호화 단위의 소정 위치의 샘플(예를 들면, 좌측 상단 샘플)에서 획득될 수 있다. 도 20와 관련된 영상 부호화 장치(200)의 동작은, 도 20와 관련하여 상술한 영상 복호화 장치(100)의 동작에 반대되는 것일 수 있으므로 자세한 설명은 생략하도록 한다.
도 21은 일 실시예에 따라 픽쳐에 포함되는 복수개의 소정의 데이터 단위에 따라 복수개의 부호화 단위들이 결정된 것을 도시한다. 일 실시예에 따라 부호화부(220)는 부호화 단위의 재귀적인 분할이 시작되는 소정의 데이터 단위로서 상술한 기준 부호화 단위를 이용할 수 있다. 도 21와 관련하여 영상 부호화 장치(200)가 기준 부호화 단위를 이용하는 동작은, 도 21와 관련하여 상술한 영상 복호화 장치(100)가 기준 부호화 단위를 이용하는 동작에 반대되는 것일 수 있으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 영상 부호화 장치(200)의 비트스트림 생성부(210)는 기준 부호화 단위의 형태에 대한 정보 및 기준 부호화 단위의 크기에 대한 정보 중 적어도 하나를 포함하는 비트스트림을 상기 다양한 데이터 단위마다 생성할 수 있다. 정사각형 형태의 기준 부호화 단위(2100)에 포함되는 적어도 하나의 부호화 단위가 결정되는 과정은 도 9의 현재 부호화 단위(300)가 분할되는 과정을 통해 상술하였고, 비-정사각형 형태의 기준 부호화 단위(2100)에 포함되는 적어도 하나의 부호화 단위가 결정되는 과정은 도 10의 현재 부호화 단위(400 또는 450)가 분할되는 과정을 통해 상술하였으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 부호화부(220)는 소정의 조건에 기초하여 미리 결정되는 일부 데이터 단위에 따라 기준 부호화 단위의 크기 및 형태를 결정하기 위하여, 기준 부호화 단위의 크기 및 형태를 식별하기 위한 인덱스를 이용할 수 있다. 즉, 비트스트림 생성부(210)는 상기 다양한 데이터 단위(예를 들면, 시퀀스, 픽쳐, 슬라이스, 슬라이스 세그먼트, 최대부호화단위 등) 중 소정의 조건(예를 들면 슬라이스 이하의 크기를 갖는 데이터 단위)을 만족하는 데이터 단위마다, 기준 부호화 단위의 크기 및 형태의 식별을 위한 인덱스를 포함하는 비트스트림을 생성할 수 있다. 부호화부(220)는 인덱스를 이용함으로써 상기 소정의 조건을 만족하는 데이터 단위마다 기준 데이터 단위의 크기 및 형태를 결정할 수 있다.일 실시예에 따라 기준 부호화 단위의 크기 및 형태를 나타내는 인덱스와 관련된 기준 부호화 단위의 크기 및 형태 중 적어도 하나는 미리 결정되어 있을 수 있다. 즉, 부호화부(220)는 미리 결정된 기준 부호화 단위의 크기 및 형태 중 적어도 하나를 인덱스에 따라 선택함으로써, 인덱스 획득의 기준이 되는 데이터 단위에 포함되는 기준 부호화 단위의 크기 및 형태 중 적어도 하나를 결정할 수 있다. 기준 부호화 단위의 크기 및 형태를 식별하기 위한 인덱스를 이용하는 부호화부(220)의 동작은, 상술한 복호화부(120)의 동작과 유사한 것일 수 있으므로 자세한 설명은 생략하도록 한다.
도 22은 일 실시예에 따라 픽쳐(2200)에 포함되는 기준 부호화 단위의 결정 순서를 결정하는 기준이 되는 프로세싱 블록을 도시한다.
일 실시예에 따라 부호화부(220)는 프로세싱 블록의 크기에 대한 정보를 획득하여 영상에 포함되는 적어도 하나의 프로세싱 블록의 크기를 결정할 수 있다. 부호화부(220)는 영상에 포함되는 적어도 하나의 프로세싱 블록의 크기를 결정할 수 있고, 비트스트림 생성부(210)는 프로세싱 블록의 크기에 대한 정보를 포함하는 비트스트림을 생성할 수 있다. 이러한 프로세싱 블록의 크기는 프로세싱 블록의 크기에 대한 정보가 나타내는 데이터 단위의 소정의 크기일 수 있다.
일 실시예에 따라 영상 부호화 장치(200)의 비트스트림 생성부(210)는 프로세싱 블록의 크기에 대한 정보를 포함하는 비트스트림을 특정의 데이터 단위마다 생성할 수 있다. 예를 들면 영상, 시퀀스, 픽쳐, 슬라이스, 슬라이스 세그먼트 등의 데이터 단위마다 프로세싱 블록의 크기에 대한 정보를 포함하는 비트스트림을 생성할 수 있다. 즉, 비트스트림 생성부(210)는 상기 여러 데이터 단위마다 프로세싱 블록의 크기에 대한 정보를 포함하는 비트스트림을 생성할 수 있고, 부호화부(220)는 상기 프로세싱 블록의 크기에 대한 정보를 이용하여 픽쳐를 분할하는 적어도 하나의 프로세싱 블록의 크기를 결정할 수 있으며, 이러한 프로세싱 블록의 크기는 기준 부호화 단위의 정수배의 크기일 수 있다.
일 실시예에 따라 부호화부(220)는 픽쳐(2200)에 포함되는 프로세싱 블록(2202, 2212)의 크기를 결정할 수 있다. 예를 들면, 부호화부(220)는 프로세싱 블록의 크기에 대한 정보에 기초하여 프로세싱 블록의 크기를 결정할 수 있다. 도 22을 참조하면, 부호화부(220)는 일 실시예에 따라 프로세싱 블록(2202, 2212)의 가로크기를 기준 부호화 단위 가로크기의 4배, 세로크기를 기준 부호화 단위의 세로크기의 4배로 결정할 수 있다. 부호화부(220)는 적어도 하나의 프로세싱 블록 내에서 적어도 하나의 기준 부호화 단위가 결정되는 순서를 결정할 수 있다. 프로세싱 블록과 관련된 부호화부(220)의 동작은, 도 22과 관련하여 상술한 복호화부(120)의 동작과 유사한 것일 수 있으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 영상 부호화 장치(200)의 비트스트림 생성부(210)는 현재 부호화 단위의 형태를 나타내는 블록 형태 정보 또는 현재 부호화 단위를 분할하는 방법을 나타내는 분할 형태 정보를 포함하는 비트스트림을 생성할 수 있다. 블록 형태 정보 또는 분할 형태 정보는 다양한 데이터 단위와 관련된 비트스트림에 포함될 수 있다. 예를 들면, 영상 부호화 장치(200)의 비트스트림 생성부(210)는 시퀀스 파라미터 세트(sequence parameter set), 픽쳐 파라미터 세트(picture parameter set), 비디오 파라미터 세트(video parameter set), 슬라이스 헤더(slice header), 슬라이스 세그먼트 헤더(slice segment header)에 포함된 블록 형태 정보 또는 분할 형태 정보를 이용할 수 있다. 나아가, 영상 부호화 장치(200)의 비트스트림 생성부(210)는 블록 형태 정보 또는 분할 형태 정보를 나타내는 신택스를 포함하는 비트스트림을 최대 부호화 단위, 기준 부호화 단위, 프로세싱 블록마다 생성할 수 있다.
일 실시예에 따라 부호화부(220)는 부호화 단위가 분할될 수 있는 분할 형태의 종류를 소정의 데이터 단위마다 다르게 결정할 수 있다. 영상 부호화 장치(200)의 부호화부(220)는 일 실시예에 따라 소정의 데이터 단위(예를 들면, 시퀀스, 픽쳐, 슬라이스 등)마다 부호화 단위가 분할될 수 있는 형태들의 조합을 다르게 결정할 수 있다.
도 23은 일 실시예에 따라 부호화 단위가 분할될 수 있는 형태의 조합이 픽쳐마다 서로 다른 경우, 각각의 픽쳐마다 결정될 수 있는 부호화 단위들을 도시한다.
도 23을 참조하면, 부호화부(220)는 픽쳐마다 부호화 단위가 분할될 수 있는 분할 형태들의 조합을 다르게 결정할 수 있다. 예를 들면, 부호화부(220)는 영상에 포함되는 적어도 하나의 픽쳐들 중 4개의 부호화 단위로 분할될 수 있는 픽쳐(2300), 2개 또는 4개의 부호화 단위로 분할될 수 있는 픽쳐(2310) 및 2개, 3개 또는 4개의 부호화 단위로 분할될 수 있는 픽쳐(2320)를 이용하여 영상을 복호화 할 수 있다. 부호화부(220)는 픽쳐(2300)를 4개의 정사각형의 부호화 단위로 분할할 수 있다. 부호화부(220)는 픽쳐(2310)를 2개 또는 4개의 부호화 단위로 분할할 수 있다. 부호화부(220)는 픽쳐(2320)를 2개, 3개 또는 4개의 부호화 단위로 분할할 수 있다. 상술한 분할 형태의 조합은 영상 부호화 장치(200)의 동작을 설명하기 위한 실시예에 불과하므로 상술한 분할 형태의 조합은 상기 실시예에 한정하여 해석되어서는 안되며 소정의 데이터 단위마다 다양한 형태의 분할 형태의 조합이 이용될 수 있는 것으로 해석되어야 한다.
일 실시예에 따라 영상 부호화 장치(200)의 부호화부(220)는 분할 형태 정보의 조합을 나타내는 인덱스를 이용하여 소정의 데이터 단위마다 부호화 단위가 분할될 수 있는 분할 형태의 조합을 결정할 수 있으며, 이에 따라 소정의 데이터 단위마다 서로 다른 분할 형태의 조합을 이용할 수 있다. 나아가 영상 부호화 장치(200)의 비트스트림 생성부(210)는 분할 형태 정보의 조합을 나타내는 인덱스를 포함하는 비트스트림을 소정의 데이터 단위 단위(예를 들면, 시퀀스, 픽쳐, 슬라이스 등)마다 생성할 수 있다. 예를 들면, 비트스트림 생성부(210)는 분할 형태 정보의 조합을 나타내는 인덱스를 포함하는 시퀀스 파라미터 세트(Sequence Parameter Set), 픽쳐 파라미터 세트(Picture Parameter Set) 또는 슬라이스 헤더(Slice Header)에 대한 비트스트림을 생성할 수 있다.
도 24, 도 25는 일 실시예에 따라 바이너리(binary)코드로 표현될 수 있는 분할 형태 정보에 기초하여 결정될 수 있는 부호화 단위의 다양한 형태를 도시한다.
일 실시예에 따라 영상 부호화 장치(200)의 부호화부(220)는 부호화 단위를 다양한 형태로 분할할 수 있고, 비트스트림 생성부(210)를 통해 블록 형태 정보 및 분할 형태 정보를 포함하는 비트스트림을 생성할 수 있다. 분할될 수 있는 부호화 단위의 형태는 상술한 실시예들을 통해 설명한 형태들을 포함하는 다양한 형태에 해당할 수 있다. 도 24를 참조하면, 부호화부(220)는 분할 형태 정보에 기초하여 정사각형 형태의 부호화 단위를 수평 방향 및 수직 방향 중 적어도 하나의 방향으로 분할할 수 있고, 비-정사각형 형태의 부호화 단위를 수평 방향 또는 수직 방향으로 분할할 수 있다. 영상 부호화 장치(200)가 이용할 수 있는 분할 형태 정보의 바이너리 코드에 대한 특징은 도 24 및 도 25를 통해 상술한 영상 복호화 장치(100)의 특징에 해당할 수 있으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따른 영상 부호화 장치(200)는, 부호화 단위에 대한 인터 예측 또는 인트라 예측을 수행하여 예측 데이터를 생성하고, 현재 부호화 단위에 포함된 변환 단위에 대해 역변환을 수행하여 레지듀얼 데이터를 생성하며, 생성된 예측 데이터와 레지듀얼 데이터를 이용하여 현재 부호화 단위를 부호화할 수 있다.
일 실시예에 따른 부호화 단위의 예측 모드는 인트라 모드, 인터 모드 및 스킵 모드 중 적어도 하나일 수 있다. 일 실시예에 따라, 부호화 단위 마다 독립적으로 예측이 수행되어 오차가 가장 작은 예측 모드가 선택될 수 있다.
일 실시예에 따른 2Nx2N 형태의 부호화 단위가 분할하여 두 개의 2NxN 또는 두 개의 Nx2N 형태의 부호화 단위들로 분할된 경우, 이들 각각의 부호화 단위에 대해서 인터 모드 예측 및 인트라 모드 예측이 별개로 수행될 수도 있다. 또한, 일 실시예에 따라 영상 부호화 장치(200)의 부호화부(220)는 부호화 단위가 정사각형 형태인 경우뿐만 아니라, 비-정사각형 형태인 경우에도 CU 스킵 모드(skip mode)를 이용하여 부호화 단위를 부호화할 수 있다. 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 결정될 수 있는 정사각형 형태의 부호화 단위뿐만 아니라 비-정사각형 형태의 부호화 단위의 경우에도 CU 스킵 모드를 이용하여 영상을 복호화 할 수 있음에 따라 상대적으로 더 적응적인 스킵 모드의 이용이 가능하게 됨으로써 영상 부/복호화 효율이 향상될 수 있다. 이러한 비-정사각형 형태의 부호화 단위에서 스킵모드를 이용하는 영상 부호화 장치(200)의 특징은 영상 부호화 장치(200)의 스킵모드 이용과 관련하여 상술한 특징과 유사한 것일 수 있으므로 자세한 설명은 생략하도록 한다.
도 28은 일 실시예에 따라 소정의 부호화 방법에 따라 결정된 부호화 단위들 간의 병합(merge) 또는 분할(split)이 수행되는 과정을 도시한다.
일 실시예에 따라 영상 부호화 장치(200)는 상술한 소정의 부호화 방법을 이용하여, 픽쳐를 분할하는 부호화 단위들을 결정할 수 있다. 예를 들면 영상 부호화 장치(200)는 부호화 단위의 분할 정보에 기초하여 현재 심도의 부호화 단위를 결정하거나 또는 하위 심도의 4개의 부호화 단위들로 분할할 수 있다. 상술한바와 같이 영상 부호화 장치(200)는 일 실시예에 따라 현재 부호화 단위는 항상 정사각형 형태를 가지는 것을 나타내는 블록 형태 정보, 현재 부호화 단위는 분할되지 않음을 나타내거나 4개의 정사각형 형태의 부호화 단위들로 분할되는 것을 나타낼 수 있는 분할 형태 정보를 이용하여 부호화 단위를 결정할 수 있다. 도 28을 참조하면, 상술한 소정의 부호화 방법에 따라 결정된 정사각형의 부호화 단위에 따라 픽쳐(2800, 2820)가 분할될 수 있다.
다만, 상술한 소정의 복호화 단위에 따르는 경우, 현재 부호화 단위가 분할될지 여부는 현재 부호화 단위 내에 포함되는 상대적으로 작은 오브젝트(object)가 표현되기에 적합한지 여부에 따라 결정되기 때문에, 픽쳐 내의 큰 오브젝트와 작은 오브젝트가 하나의 부호화 단위를 통해 부호화 되는 것은 불가능할 수 있다. 여기서 오브젝트란, 픽쳐에 포함된 샘플들의 집합으로서, 유사한 샘플값을 가짐으로써 다른 영역과 구분될 수 있는 샘플들의 영역을 의미할 수 있다. 도 28을 참조하면, 영상 부호화 장치(200)는 작은 오브젝트(2821)를 복원하기 위하여 제1 부호화 단위(2822)를 4개의 하위 심도의 부호화 단위로 분할함으로써 작은 오브젝트(2821)의 복호화를 위한 부호화 단위를 결정할 수 있다. 하지만, 큰 오브젝트(2823)가 현재 부호화 단위(2822)에 포함되지 않으므로 큰 오브젝트(2823)가 현재 부호화 단위(2822)를 이용하여 복호화 되기에는 부적합하며, 나아가 작은 오브젝트(2821)를 복호화 하기 위해 현재 부호화 단위(2822)가 분할되었기 때문에 결국 큰 오브젝트(2823)의 복호화를 위해 불필요한 부호화 단위의 분할 과정이 수행되어야 하므로 비효율적이다. 즉, 영상 부호화 장치(200)가 큰 오브젝트(2823)에 대한 부분을 부호화 하기 위하여 하나의 부호화 단위를 이용할 수 있다면 영상 부호화를 효율적으로 수행할 수 있다.
일 실시예에 따라 영상 부호화 장치(200)의 부호화부(220)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 이용하여 현재 부호화 단위를 분할할 수 있으며, 블록 형태 정보는 정사각형 형태만을 이용하는 것으로 미리 결정되고, 분할 형태 정보는 분할하지 않거나 또는 4개의 정사각형 형태의 부호화 단위로 분할됨을 나타낼 수 있는 것으로 미리 결정될 수 있다. 이는 다양한 실시예를 통해 상술한 소정의 부호화 방법에서 이용되는 부호화 단위 결정 과정에 해당할 수 있다. 이 경우 부호화부(220)는 상기 소정의 부호화 방법을 이용하여 결정된 부호화 단위들을 서로 병합(merge)하거나 결정된 부호화 단위를 분할(split)하기 위하여, 픽쳐에 포함되는 샘플값을 이용할 수 있다. 예를 들면, 부호화부(220)는 유사한 샘플값을 가지는 부분을 검토하여 픽쳐에 포함되는 다양한 오브젝트들을 검출할 수 있으며, 이렇게 검출된 오브젝트들에 대한 부분에 기초하여 부호화 단위들의 병합/분할 과정을 수행할 수 있다.
도 28을 참조하면 일 실시예에 따라 부호화부(220)는 상술한 소정의 부호화 방법을 이용하여 픽쳐(2800)를 분할하는 복수개의 부호화 단위를 결정할 수 있다. 다만, 픽쳐에 포함된 유사한 샘플값을 가지는 부분(2801)이 존재함에도 불구하고, 유사 영역을 하나의 부호화 단위가 아닌 복수개의 부호화 단위로 분할하는 과정이 수행되는 경우가 있을 수 있다. 이 경우 부호화부(220)는 소정의 부호화 방법을 통해 부호화 단위가 결정되었더라도, 이러한 부호화 단위들을 하나의 부호화 단위(2802)로 병합하여 하나의 부호화 단위로서 부호화 할 수 있다. 도 28을 참조하면, 또 다른 실시예로서 부호화부(220)는 상술한 소정의 부호화 방법을 이용하여, 작은 오브젝트(2821)의 부호화를 위한 부호화 단위(2822)를 4개의 부호화 단위로 분할할 수 있다. 이렇게 분할된 부호화 단위들의 경우 검출된 큰 오브젝트(2823)가 모두 포함될 수 없으므로, 부호화부(220)는 유사한 샘플값을 가지는 부분을 포함하는 하나의 부호화 단위로 부호화 단위들을 병합(2825)할 수 있다.
일 실시예에 따라 부호화부(220)는 부호화 단위의 분할 정보를 이용하여 부호화 단위를 분할하지 않거나 4개의 부호화 단위로 분할하는 소정의 부호화 방법을 이용하여 부호화 단위를 결정한 다음, 픽쳐에 포함되는 샘플들의 샘플값을 고려하여 부호화 단위를 다시 분할할 수 있다. 즉, 부호화부(120)는 오브젝트 별로 부호화 단위를 결정하기 위하여, 부호화 단위 간의 병합뿐만 아니라 이미 결정된 부호화 단위를 분할할 수 있다. 도 28을 참조하면, 부호화부(120)는 오브젝트(2823)를 위해 부호화 단위를 병합할 수 있고, 오브젝트(2823)를 위해 최적화된 부호화 단위를 결정하기 위하여 오브젝트(2823)을 위해 병합된 부호화 단위를 다시 분할(2826)할 수 있다. 즉 부호화부(220)는 분할(2826)과정을 통해 오브젝트(2823)가 포함되지 않는 부분을 오브젝트(2823)와는 별개의 부호화 단위(2827)로 결정할 수 있다.
상술한 영상 부호화 장치(200)의 동작을 통해 소정의 부호화 방법에 따라 결정된 부호화 단위들 간의 병합(merge) 또는 분할(split)을 수행한 후 영상에 대한 비트스트림을 생성한 경우, 영상 복호화 장치(100)로서는 이러한 비트스트림으로부터 획득한 후 상술한 영상 부호화 방법의 역순의 동작에 해당하는 영상 복호화 방법을 수행함으로써 영상을 복호화 할 수 있다.
도 29는 일 실시예에 따른 부호화 단위의 Z 스캔 순서에 따른 인덱스를 도시한다.
일 실시예에 따른 영상 부호화 장치(200)의 부호화부(220)는, 상위 데이터 단위에 포함된 하위 데이터 단위들을 Z 스캔 순서에 따라 스캔할 수 있다. 또한, 일 실시예에 따른 영상 부호화 장치(200)는 최대 부호화 단위 또는 프로세싱 블록에 포함되는 부호화 단위 내의 Z 스캔 인덱스에 따라 데이터를 순차적으로 액세스할 수 있다. 일 실시예에 따른 영상 부호화 장치(200)의 부호화부(220)가 기준 부호화 단위를 적어도 하나의 부호화 단위로 분할할 수 있음은 도 9 내지 도 10를 참조하여 전술한 바와 같다. 이 때, 기준 부호화 단위 내에는 정사각형 형태의 부호화 단위들과 비-정사각형 형태의 부호화 단위들이 혼재할 수 있다. 영상 부호화 장치(200)가 부호화 단위의 Z 스캔 순서에 따른 인덱스에 대한 특징은 도 29를 통해 상술한 영상 복호화 장치(100)의 특징과 유사한 특징일 수 있으므로 자세한 설명은 생략하도록 한다.
이제까지 다양한 실시예들을 중심으로 살펴보았다. 본 발명이 속하는 기술 분야에서 통상의 지식을 가진 자는 본 발명이 본 발명의 본질적인 특성에서 벗어나지 않는 범위에서 변형된 형태로 구현될 수 있음을 이해할 수 있을 것이다. 그러므로 개시된 실시예들은 한정적인 관점이 아니라 설명적인 관점에서 고려되어야 한다. 본 발명의 범위는 전술한 설명이 아니라 특허청구범위에 나타나 있으며, 그와 동등한 범위 내에 있는 모든 차이점은 본 발명에 포함된 것으로 해석되어야 할 것이다.
한편, 상술한 본 발명의 실시예들은 컴퓨터에서 실행될 수 있는 프로그램으로 작성가능하고, 컴퓨터로 읽을 수 있는 기록매체를 이용하여 상기 프로그램을 동작시키는 범용 디지털 컴퓨터에서 구현될 수 있다. 상기 컴퓨터로 읽을 수 있는 기록매체는 마그네틱 저장매체(예를 들면, 롬, 플로피 디스크, 하드디스크 등), 광학적 판독 매체(예를 들면, 시디롬, 디브이디 등)와 같은 저장매체를 포함한다.

Claims (15)

  1. 영상을 복호화 하는 방법에 있어서,
    현재 부호화 단위의 블록 형태 정보에 기초하여 상기 영상을 분할하는 적어도 하나의 부호화 단위를 결정하는 단계;
    상기 적어도 하나의 부호화 단위에 포함되는 현재 부호화 단위의 형태에 기초하여, 적어도 하나의 변환 단위를 결정하는 단계; 및
    상기 적어도 하나의 변환 단위에 기초하여 역변환을 수행함으로써 상기 영상을 복호화 하는 단계를 포함하고,
    상기 블록 형태 정보는 상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 것을 특징으로 하는 영상 복호화 방법.
  2. 제 1 항에 있어서, 상기 적어도 하나의 변환 단위를 결정하는 단계는
    현재 변환 단위를 분할할지 여부를 나타내는 정보인 변환 단위의 분할 정보를 비트스트림으로부터 획득하는 단계; 및
    상기 획득한 변환 단위의 분할 정보가, 상기 현재 변환 단위는 복수개의 변환 단위로 분할됨을 나타내는 경우, 상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지에 기초하여 상기 현재 부호화 단위에 포함되는 복수개의 변환 단위를 결정하는 단계를 포함하는 영상 복호화 방법.
  3. 제 2 항에 있어서, 상기 복수개의 변환 단위를 결정하는 단계는
    상기 현재 부호화 단위가 정사각형 형태인 경우, 정사각형 형태의 복수개의 변환 단위를 결정하는 단계; 및
    상기 현재 부호화 단위가 비-정사각형 형태인 경우, 상기 현재 부호화 단위를 수직 방향 또는 수평 방향으로 분할하여 복수개의 변환 단위를 결정하는 단계를 포함하는 영상 복호화 방법.
  4. 제 1 항에 있어서, 상기 적어도 하나의 변환 단위를 결정하는 단계는
    변환 단위의 최대 크기보다 상기 현재 부호화 단위의 크기가 큰 경우, 상기 현재 부호화 단위에 포함되는 복수개의 상기 최대 크기의 변환 단위를 결정하는 단계를 더 포함하는 영상 복호화 방법.
  5. 제 1 항에 있어서, 상기 영상 복호화 방법은
    변환 단위의 최대 크기에 대한 정보 및 최소 크기에 대한 정보 중 적어도 하나를 비트스트림으로부터 획득하는 단계를 더 포함하는 영상 복호화 방법.
  6. 제 1 항에 있어서, 상기 영상 복호화 방법은
    상기 적어도 하나의 변환 단위가 가질 수 있는 블록 형태에 대한 정보를 비트스트림으로부터 획득하는 단계를 더 포함하는 영상 복호화 방법.
  7. 제 1 항에 있어서, 상기 적어도 하나의 변환 단위를 결정하는 단계는
    상기 영상의 색차(chroma) 샘플을 복호화 하기 위한 상기 현재 부호화 단위의 크기가 상기 적어도 하나의 변환 단위의 최소 크기보다 작은 경우, 상기 최소 크기 이상의 크기를 갖는 상기 적어도 하나의 변환 단위를 결정하는 단계를 더 포함하는 영상 복호화 방법.
  8. 제 1 항에 있어서, 상기 영상 복호화 방법은,
    상기 적어도 하나의 변환 단위의 심도는 상기 적어도 하나의 변환 단위의 긴 변의 길이에 기초하여 심도가 결정되는 것을 특징으로 하는 영상 복호화 방법.
  9. 제 1 항에 있어서,
    상기 적어도 하나의 변환 단위를 결정하는 단계는 변환 단위의 분할 과정에서 결정되는 현재 심도의 변환 단위 내에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 단계를 더 포함하고,
    상기 영상을 복호화 하는 단계는, 상기 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 이용하여 상기 영상을 복호화 하는 단계를 포함하는 영상 복호화 방법.
  10. 제 9 항에 있어서, 상기 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 단계는,
    상기 현재 부호화 단위의 형태, 상기 현재 부호화 단위에 상기 영상의 색차 성분이 포함되는지 여부, 상기 현재 부호화 단위에서 이용되는 인트라 예측이 수행되는지 여부 및 상기 현재 부호화 단위에 포함되는 변환 단위의 개수 중 적어도 하나에 기초하여 상기 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 단계를 포함하는 영상 복호화 방법.
  11. 제 10 항에 있어서, 상기 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 단계는,
    상기 현재 부호화 단위의 형태가 비-정사각형인 경우, 상기 현재 심도의 변환 단위가 더 이상 분할되지 않을 때에 한해 상기 현재 심도의 변환 단위 내에 0이 아닌 변환 계수가 포함되는지를 나타내는 정보를 비트스트림으로부터 획득하는 단계를 포함하는 영상 복호화 방법.
  12. 제 1 항에 있어서, 상기 영상을 복호화 하는 단계는,
    상기 적어도 하나의 변환 단위의 형태에 기초하여 컨텍스트 인덱스를 결정하는 단계; 및
    상기 결정된 컨텍스트 인덱스에 기초하여 상기 영상을 복호화 하는 단계를 포함하는 영상 복호화 방법.
  13. 영상을 복호화 하는 장치에 있어서,
    현재 부호화 단위의 블록 형태 정보를 획득하는 비트스트림 획득부; 및
    상기 블록 형태 정보에 기초하여 상기 영상을 분할하는 적어도 하나의 부호화 단위를 결정하고, 상기 적어도 하나의 부호화 단위에 포함되는 현재 부호화 단위의 형태에 기초하여, 적어도 하나의 변환 단위를 결정하고, 상기 적어도 하나의 변환 단위에 기초하여 역변환을 수행함으로써 상기 영상을 복호화 하는 복호화부를 포함하고,
    상기 블록 형태 정보는 상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 것을 특징으로 하는 영상 복호화 장치.
  14. 영상을 부호화 하는 방법에 있어서,
    상기 영상을 분할하는 적어도 하나의 부호화 단위를 결정하는 단계;
    상기 적어도 하나의 부호화 단위에 포함되는 현재 부호화 단위의 형태에 기초하여, 적어도 하나의 변환 단위를 결정하는 단계;
    상기 적어도 하나의 변환 단위에 기초하여 변환을 수행함으로써 상기 영상을 부호화 하는 단계; 및
    상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 블록 형태 정보 및 상기 부호화된 영상을 포함하는 비트스트림을 생성하는 단계를 포함하는 영상 부호화 방법.
  15. 영상을 부호화 하는 장치에 있어서,
    상기 영상을 분할하는 적어도 하나의 부호화 단위를 결정하고, 상기 적어도 하나의 부호화 단위에 포함되는 현재 부호화 단위의 형태에 기초하여, 적어도 하나의 변환 단위를 결정하고, 상기 적어도 하나의 변환 단위에 기초하여 변환을 수행함으로써 상기 영상을 부호화 하는 부호화부; 및
    상기 현재 부호화 단위가 정사각형 형태인지 비-정사각형 형태인지를 나타내는 블록 형태 정보 및 상기 부호화된 영상을 포함하는 비트스트림을 생성하는 비트스트림 생성부를 포함하는 영상 부호화 장치.
PCT/KR2016/011299 2016-10-10 2016-10-10 영상을 부호화/복호화 하는 방법 및 그 장치 WO2018070552A1 (ko)

Priority Applications (17)

Application Number Priority Date Filing Date Title
KR1020227005817A KR102568900B1 (ko) 2016-10-10 2016-10-10 영상을 부호화/복호화 하는 방법 및 그 장치
CA3039663A CA3039663C (en) 2016-10-10 2016-10-10 Method and apparatus for encoding/decoding image
CA3239143A CA3239143A1 (en) 2016-10-10 2016-10-10 Method and apparatus for encoding/decoding image
PCT/KR2016/011299 WO2018070552A1 (ko) 2016-10-10 2016-10-10 영상을 부호화/복호화 하는 방법 및 그 장치
CA3114825A CA3114825A1 (en) 2016-10-10 2016-10-10 Method and apparatus for encoding/decoding image
KR1020237027322A KR20230125329A (ko) 2016-10-10 2016-10-10 영상을 부호화/복호화 하는 방법 및 그 장치
KR1020217033063A KR102367136B1 (ko) 2016-10-10 2016-10-10 영상을 부호화/복호화 하는 방법 및 그 장치
CN201680091481.9A CN110063058B (zh) 2016-10-10 2016-10-10 用于对图像进行编码/解码的方法和设备
CN202211629080.8A CN115802036A (zh) 2016-10-10 2016-10-10 用于对图像进行编码/解码的方法和设备
CN202211629119.6A CN115802037A (zh) 2016-10-10 2016-10-10 用于对图像进行编码/解码的方法和设备
KR1020197007991A KR102315926B1 (ko) 2016-10-10 2016-10-10 영상을 부호화/복호화 하는 방법 및 그 장치
EP16918754.9A EP3506631A4 (en) 2016-10-10 2016-10-10 METHOD AND DEVICE FOR CODING / DECODING AN IMAGE
CN202211629079.5A CN115802035A (zh) 2016-10-10 2016-10-10 用于对图像进行编码/解码的方法和设备
CN202211587859.8A CN115883826A (zh) 2016-10-10 2016-10-10 用于对图像进行编码/解码的方法和设备
US16/339,574 US10904537B2 (en) 2016-10-10 2016-10-10 Method and apparatus for encoding/decoding image
US17/115,423 US11178408B2 (en) 2016-10-10 2020-12-08 Method and apparatus for encoding/decoding image
US17/115,402 US11653006B2 (en) 2016-10-10 2020-12-08 Method and apparatus for encoding/decoding image

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
PCT/KR2016/011299 WO2018070552A1 (ko) 2016-10-10 2016-10-10 영상을 부호화/복호화 하는 방법 및 그 장치

Related Child Applications (3)

Application Number Title Priority Date Filing Date
US16/339,574 A-371-Of-International US10904537B2 (en) 2016-10-10 2016-10-10 Method and apparatus for encoding/decoding image
US17/115,402 Continuation US11653006B2 (en) 2016-10-10 2020-12-08 Method and apparatus for encoding/decoding image
US17/115,423 Continuation US11178408B2 (en) 2016-10-10 2020-12-08 Method and apparatus for encoding/decoding image

Publications (1)

Publication Number Publication Date
WO2018070552A1 true WO2018070552A1 (ko) 2018-04-19

Family

ID=61905715

Family Applications (1)

Application Number Title Priority Date Filing Date
PCT/KR2016/011299 WO2018070552A1 (ko) 2016-10-10 2016-10-10 영상을 부호화/복호화 하는 방법 및 그 장치

Country Status (6)

Country Link
US (3) US10904537B2 (ko)
EP (1) EP3506631A4 (ko)
KR (4) KR20230125329A (ko)
CN (5) CN115802035A (ko)
CA (3) CA3039663C (ko)
WO (1) WO2018070552A1 (ko)

Cited By (1)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
CN112585971A (zh) * 2018-08-17 2021-03-30 佳能株式会社 对视频样本的变换块编码和解码的方法、设备和系统

Families Citing this family (11)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
KR20230125329A (ko) * 2016-10-10 2023-08-29 삼성전자주식회사 영상을 부호화/복호화 하는 방법 및 그 장치
WO2018174617A1 (ko) * 2017-03-22 2018-09-27 한국전자통신연구원 블록 형태에 기반한 예측 방법 및 장치
US10893286B2 (en) * 2018-10-09 2021-01-12 Tencent America LLC Methods and apparatus for low-complexity MTS
JP2022068379A (ja) * 2019-03-08 2022-05-10 シャープ株式会社 画像復号装置
US20220248029A1 (en) * 2019-06-19 2022-08-04 Electronics And Telecommunications Research Institute Image encoding/decoding method and device, and recording medium for storing bitstream
CN114026862A (zh) * 2019-06-21 2022-02-08 松下电器(美国)知识产权公司 用于视频译码的系统和方法
US11949870B2 (en) * 2019-06-21 2024-04-02 Qualcomm Incorporated Context modeling for low-frequency non-separable transformation signaling for video coding
US11470313B2 (en) 2019-06-22 2022-10-11 Xris Corporation Image signal encoding/decoding method and device therefor
KR20220032566A (ko) * 2019-07-19 2022-03-15 주식회사 윌러스표준기술연구소 비디오 신호 처리 방법 및 장치
WO2021050166A1 (en) * 2019-09-13 2021-03-18 Alibaba Group Holding Limited Method and apparatus for signaling sub-block transform information
BR112022009810A2 (pt) 2019-11-20 2022-08-09 Xris Corp Método para codificação/decodificação de sinal de imagem, e dispositivo para o mesmo

Citations (5)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
KR20140139562A (ko) * 2012-04-12 2014-12-05 미디어텍 싱가폴 피티이. 엘티디. 크로마 서브샘플링 포맷들의 블록 파티션을 위한 방법 및 장치
KR20150003324A (ko) * 2012-04-16 2015-01-08 퀄컴 인코포레이티드 비디오 코딩을 위한 단순화된 비-정사각형 쿼드트리 변환들
WO2015194922A1 (ko) * 2014-06-20 2015-12-23 삼성전자 주식회사 비디오 부호화 방법 및 장치, 비디오 복호화 방법 및 장치
KR20160077027A (ko) * 2016-06-22 2016-07-01 삼성전자주식회사 큰 크기의 변환 단위를 이용한 영상 부호화, 복호화 방법 및 장치
KR20160078318A (ko) * 2016-06-23 2016-07-04 에스케이텔레콤 주식회사 영상 부호화/복호화 방법 및 장치

Family Cites Families (12)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
KR101495724B1 (ko) 2010-02-02 2015-02-25 삼성전자주식회사 계층적 데이터 단위의 스캔 순서에 기반한 비디오 부호화 방법과 그 장치, 및 비디오 복호화 방법과 그 장치
KR101955374B1 (ko) 2011-06-30 2019-05-31 에스케이 텔레콤주식회사 고속 코딩 단위(Coding Unit) 모드 결정을 통한 부호화/복호화 방법 및 장치
US9807426B2 (en) * 2011-07-01 2017-10-31 Qualcomm Incorporated Applying non-square transforms to video data
MX2013001709A (es) * 2011-07-29 2013-03-06 Panasonic Corp Metodo de codificacion de imagenes en movimiento, metodo de decodificacion de imagenes en movimiento, aparato de codificacion de imagenes en movimiento, aparato de decodificacion de imágenes en movimiento, y aparato de codificacion y decodificacion de imagenes en movimiento.
WO2013105622A1 (ja) * 2012-01-13 2013-07-18 シャープ株式会社 画像復号装置、画像符号化装置、および符号化データのデータ構造
US9749645B2 (en) * 2012-06-22 2017-08-29 Microsoft Technology Licensing, Llc Coded-block-flag coding and derivation
US9300964B2 (en) * 2013-01-24 2016-03-29 Sharp Kabushiki Kaisha Image decoding apparatus and image coding apparatus
JP2018050091A (ja) * 2015-02-02 2018-03-29 シャープ株式会社 画像復号装置、画像符号化装置および予測ベクトル導出装置
WO2017008263A1 (en) * 2015-07-15 2017-01-19 Mediatek Singapore Pte. Ltd. Conditional binary tree block partitioning structure
US10218975B2 (en) * 2015-09-29 2019-02-26 Qualcomm Incorporated Transform precision manipulation in video coding
KR20180136555A (ko) * 2016-06-03 2018-12-24 엘지전자 주식회사 영상 코딩 시스템에서 인트라 예측 방법 및 장치
KR20230125329A (ko) 2016-10-10 2023-08-29 삼성전자주식회사 영상을 부호화/복호화 하는 방법 및 그 장치

Patent Citations (5)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
KR20140139562A (ko) * 2012-04-12 2014-12-05 미디어텍 싱가폴 피티이. 엘티디. 크로마 서브샘플링 포맷들의 블록 파티션을 위한 방법 및 장치
KR20150003324A (ko) * 2012-04-16 2015-01-08 퀄컴 인코포레이티드 비디오 코딩을 위한 단순화된 비-정사각형 쿼드트리 변환들
WO2015194922A1 (ko) * 2014-06-20 2015-12-23 삼성전자 주식회사 비디오 부호화 방법 및 장치, 비디오 복호화 방법 및 장치
KR20160077027A (ko) * 2016-06-22 2016-07-01 삼성전자주식회사 큰 크기의 변환 단위를 이용한 영상 부호화, 복호화 방법 및 장치
KR20160078318A (ko) * 2016-06-23 2016-07-04 에스케이텔레콤 주식회사 영상 부호화/복호화 방법 및 장치

Cited By (1)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
CN112585971A (zh) * 2018-08-17 2021-03-30 佳能株式会社 对视频样本的变换块编码和解码的方法、设备和系统

Also Published As

Publication number Publication date
EP3506631A1 (en) 2019-07-03
US11653006B2 (en) 2023-05-16
CN110063058B (zh) 2022-12-27
KR20230125329A (ko) 2023-08-29
CN115883826A (zh) 2023-03-31
CA3039663C (en) 2022-02-15
US20210092410A1 (en) 2021-03-25
US11178408B2 (en) 2021-11-16
KR20190039790A (ko) 2019-04-15
CN115802037A (zh) 2023-03-14
KR102367136B1 (ko) 2022-02-24
US20200053363A1 (en) 2020-02-13
KR102315926B1 (ko) 2021-10-21
KR20220028164A (ko) 2022-03-08
CN115802035A (zh) 2023-03-14
CA3039663A1 (en) 2018-04-19
EP3506631A4 (en) 2019-08-07
US20210092409A1 (en) 2021-03-25
US10904537B2 (en) 2021-01-26
CA3239143A1 (en) 2018-04-19
CA3114825A1 (en) 2018-04-19
KR102568900B1 (ko) 2023-08-21
CN110063058A (zh) 2019-07-26
CN115802036A (zh) 2023-03-14
KR20210128507A (ko) 2021-10-26

Similar Documents

Publication Publication Date Title
WO2018070552A1 (ko) 영상을 부호화/복호화 하는 방법 및 그 장치
WO2017176030A1 (ko) 비디오 신호 처리 방법 및 장치
WO2018097693A2 (ko) 영상 부호화/복호화 방법, 장치 및 비트스트림을 저장한 기록 매체
WO2017135759A1 (ko) 크로마 다중 변환에 의한 비디오 복호화 방법 및 장치, 크로마 다중 변환에 의한 비디오 부호화 방법 및 장치
WO2017171370A1 (ko) 비디오 신호 처리 방법 및 장치
WO2018016823A1 (ko) 영상 부호화/복호화 방법, 장치 및 비트스트림을 저장한 기록 매체
WO2017138791A1 (ko) 영상 부호화 방법 및 장치, 영상 복호화 방법 및 장치
WO2011096741A2 (en) Method and apparatus for encoding video based on scanning order of hierarchical data units, and method and apparatus for decoding video based on scanning order of hierarchical data units
WO2018097692A2 (ko) 영상 부호화/복호화 방법, 장치 및 비트스트림을 저장한 기록 매체
WO2012005520A2 (en) Method and apparatus for encoding video by using block merging, and method and apparatus for decoding video by using block merging
WO2017142335A1 (ko) 비디오 복호화 방법 및 그 장치 및 비디오 부호화 방법 및 그 장치
WO2011126273A2 (en) Method and apparatus for encoding video by compensating for pixel value according to pixel groups, and method and apparatus for decoding video by the same
WO2020040626A1 (ko) 부호화 방법 및 그 장치, 복호화 방법 및 그 장치
WO2019093598A1 (ko) 움직임 정보의 부호화 장치 및 방법, 및 복호화 장치 및 방법
WO2020235951A1 (ko) 영상 부호화 방법 및 장치, 영상 복호화 방법 및 장치
WO2012044104A2 (ko) 계층적 구조의 심볼을 부호화하는 비디오 부호화 방법 및 그 장치, 계층적 구조의 심볼을 복호화하는 비디오 복호화 방법 및 그 장치
WO2017090968A1 (ko) 영상을 부호화/복호화 하는 방법 및 그 장치
WO2018124627A1 (ko) 부호화 방법 및 그 장치, 복호화 방법 및 그 장치
WO2019216716A2 (ko) 부호화 방법 및 그 장치, 복호화 방법 및 그 장치
WO2020004978A1 (ko) 비디오 신호 처리 방법 및 장치
WO2018101700A1 (ko) 영상 부호화/복호화 방법, 장치 및 비트스트림을 저장한 기록 매체
WO2019199127A1 (ko) 부호화 방법 및 그 장치, 복호화 방법 및 그 장치
WO2016190627A1 (ko) 비디오 신호 처리 방법 및 장치
WO2020130714A1 (ko) 영상 신호 부호화/복호화 방법 및 이를 위한 장치
WO2020256468A1 (ko) 주변 움직임 정보를 이용하여 움직임 정보를 부호화 및 복호화하는 장치, 및 방법

Legal Events

Date Code Title Description
121 Ep: the epo has been informed by wipo that ep was designated in this application

Ref document number: 16918754

Country of ref document: EP

Kind code of ref document: A1

ENP Entry into the national phase

Ref document number: 20197007991

Country of ref document: KR

Kind code of ref document: A

ENP Entry into the national phase

Ref document number: 2016918754

Country of ref document: EP

Effective date: 20190328

Ref document number: 3039663

Country of ref document: CA

NENP Non-entry into the national phase

Ref country code: DE