WO2022075808A1

WO2022075808A1 - Crispr/cas12f1 시스템 효율화를 위한 u-rich tail을 포함하는 엔지니어링 된 가이드 rna 및 그 용도

Info

Publication number: WO2022075808A1
Application number: PCT/KR2021/013898
Authority: WO
Inventors: 김용삼; 김도연
Original assignee: 주식회사 진코어
Priority date: 2020-10-08
Filing date: 2021-10-08
Publication date: 2022-04-14
Also published as: CA3198422A1; US20230374500A1; AU2021357283A1; JP2023545079A; EP4227408A1

Abstract

본 명세서에서는 종래 기술의 한계점을 극복하여, CRISPR/Cas12f1 시스템의 세포 내 유전자 편집 활성을 높이기 위한, 엔지니어링 된 Cas12f1 가이드 RNA를 제공한다. 상기 엔지니어링 된 Cas12f1 가이드 RNA는 자연계에서 발견되는 가이드 RNA에 새로운 구성을 추가하고, 또한 그 구조 일부를 변형한 것이다. 상기 엔지니어링 된 Cas12f1 가이드 RNA는 그 구성의 3'말단에 새로운 구성인 U-rich tail을 포함하는 것을 특징으로 한다. 또한, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 그 구성 중 Cas12f1 단백질과 상호작용하는 역할을 하는 스캐폴드 영역의 적어도 일부가 변형된 것을 특징으로 한다.

Description

CRISPR/CAS12F1 시스템 효율화를 위한 U-RICH TAIL을 포함하는 엔지니어링 된 가이드 RNA 및 그 용도

[관련출원]

본 출원은, 2020년10월 8일자로 출원된 대한민국 특허출원 제10-2020-0129937호 및 2021년 4월 16일자로 출원된 대한민국 특허출원 제10-2021-0050093호에 대한 우선권을 주장하고, 이들 출원 각각의 내용은 그 전체가 참조에 의해 본 명세서에 포함된다.

[기술 분야]

본 명세서에서는 CRISPR/Cas 시스템, 특히 CRISPR/Cas12f1 시스템을 유전자 편집에 사용하는 분야에 대한 기술을 개시한다.

CRISPR/Cas12f1 시스템은 Class 2, Type V로 분류되는 CRISPR/Cas 시스템이다. 선행연구(Harrington et al., Programmed DNA destruction by miniature CRISPR-Cas14 enzymes, Science 362, 839-842 (2018))에서 최초로 고균 유래의 CRISPR/Cas 시스템인 CRISPR/Cas14a 시스템에 대해 밝혀졌다. 그 후 후속 연구(Karvelis et al., Nucleic Acids Research, Vol. 48, No.　9 5017 (2020))에서 상기 CRISPR/Cas14 시스템을 CRISPR/Cas12f 시스템으로 분류하였다. CRISPR/Cas12f1 시스템은 상기 Class 2, Type V로 분류되는 CRISPR/Cas 시스템 중 하나의 Subtype인 V-F1 시스템에 속하며, 이는 Cas14a를 이펙터 단백질(effector protein)로 가지는 CRISPR/Cas14a 시스템을 포함한다. 상기 CRISPR/Cas12f1 시스템은 CRISPR/Cas9 시스템에 비하여 이펙터 단백질의 크기가 현저히 작다는 특징이 있다. 다만, 선행 연구(Harington et al., Programmed DNA destruction by miniature CRISPR-Cas14 enzymes, Science 362, 839-842 (2018), US 2020/0190494 A1)에서 밝혀진 바로는, 상기 CRISPR/Cas12f1 시스템, 특히 CRISPR/Cas14a 시스템은 단일가닥 DNA의 절단 능력은 보이나, 이중가닥 DNA에 대해서는 절단 활성이 없거나, 극히 낮아 유전자 편집 기술에 응용하는 데 한계가 있었다.

최근 선행문헌(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021))에서는 CRISPR/Cas12f1 시스템에서 Cas12f1 단백질이 이량체(dimer)를 형성한다는 사실, 및 가이드 RNA의 구조에 대해 밝혔다. 상기 선행문헌에 의해 가이드 RNA 부분 중 Cas12f1 단백질과 직접적으로 상호작용하지 않는, 이른바 disordered region이 있다는 것이 밝혀졌으며, 또 다른 선행문헌(Xiao et al., Structural basis for the dimerization-dependent CRISPR-Cas12f nuclease, bioRxiv (2020))에서는 상기 disordered region 부분을 제거하고 in vitro에서 이중가닥 DNA 절단 효율을 살핀 바 있다.

하지만, 상기 선행 연구들은 세포 내 유전자 편집 활성(예를 들어, indel 발생 효율)을 보이거나, 이를 높이는 방안에 대한 연구는 아니며, disordered region을 제거한 실험은 있지만, 오히려 절단 활성이 낮아지는 것으로 보고하였다. 더욱이, 상기 연구에서 수행한 실험은 in vitro에서 진행한 실험으로, 세포 내 유전자 편집 활성을 나타내거나, 효율을 높이기 위한 변형이 무엇인지 밝히는데는 실패하였다.

본 명세서에서는 CRISPR/Cas12f1 시스템에 사용되어 유전자 편집 효율을 증가시킬 수 있는 엔지니어링 된 Cas12f1 가이드 RNA를 제공하고자 한다.

본 명세서에서는 상기 엔지니어링 된 Cas12f1 가이드 RNA에 포함된, 유전자 편집 효율을 증가시킬 수 있는 엔지니어링 된 스캐폴드 영역 및 U-rich tail을 제공하고자 한다.

본 명세서에서는 유전자 편집 효율이 증가된 엔지니어링 된 CRISPR/Cas12f1 복합체를 제공하고자 한다.

본 명세서에서는 유전자 편집 효율이 증가된 엔지니어링 된 CRISPR/Cas12f1 시스템을 제공하고자 한다.

본 명세서에서는 상기 엔지니어링 된 CRISPR/Cas12f1 시스템의 각 구성요소를 암호화하는 핵산을 가지는 벡터를 제공하고자 한다.

본 명세서에서는 상기 엔지니어링 된 CRISPR/Cas12f1 시스템을 사용한 유전자 편집 방법을 제공하고자 한다.

본 명세서에서는 상기 엔지니어링 된 CRISPR/Cas12f1 시스템의 용도를 제공하고자 한다.

일 실시예로, 본 명세서에서는 다음을 포함하는, CRISPR/Cas12f1 시스템을 위한 엔지니어링 된 가이드 RNA를 제공한다:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

이때, 상기 엔지니어링 된 가이드 RNA는 5'말단에서 3'말단 방향으로, 엔지니어링 된 스캐폴드 영역, 스페이서, 및 U-rich tail이 순서대로 연결되어 있고,

상기 스페이서는 10개 이상 50개 이하의 뉴클레오타이드를 포함하며, 표적 서열과 상보적인 서열을 가지고,

상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현되며, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이고, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상이고, c는 1 이상 10 이하이고,

상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACCAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 7)과 상이한 것을 특징으로 하며,

상기 엔지니어링 된 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것임:

5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27), 및 5'-CUUCACUGAUAAAGUGGAGAA-3'(서열번호 10)로 이루어진 군에서 선택된 서열;

5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362), 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 서열;

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 434), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUUCGAAAGUAACCCUCGA-3'(서열번호 435), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUCGAAGUAACCCUCGA-3'(서열번호 436), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUCUUCGGAGUAACCCUCGA-3'(서열번호 437), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCGAGUAACCCUCGA-3'(서열번호 438), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUCGGUAACCCUCGA-3'(서열번호 439), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGUUCGUAACCCUCGA-3'(서열번호 440), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUUCGAACCCUCGA-3'(서열번호 441), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGACCCUCGA-3'(서열번호 442), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGCCCUCGA-3'(서열번호 443), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCCUCGA-3'(서열번호 444), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCUCGA-3'(서열번호 445), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAUUCGCCUCGA-3'(서열번호 446), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGUUCGCUCGA-3'(서열번호 447), 및 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12)로 이루어진 군에서 선택된 서열;

5'-AACAAAGAAAGGA-3'(서열번호 111), 5'-AACAAAUGAAAAGGA-3'(서열번호 112), 5'-AACAAAUUGAAAAAGGA-3'(서열번호 113), 5'-AACAAAUUCGAAAGAAGGA-3'(서열번호 114), 5'-AACAAAUUCAGAAAUGAAGGA-3'(서열번호 115), 5'-AACAAAUUCAUGAAAAUGAAGGA-3'(서열번호 116), 5'-AACAAAUUCAUUGAAAAAUGAAGGA-3'(서열번호 117), 및 5'-AACAAAUUCAUUUGAAAGAAUGAAGGA-3'(서열번호 118)에서 선택된 서열; 및

5'-AUGCAAC-3'.

엔지니어링 된 스캐폴드;

스페이서; 및

U-rich tail,

상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현되며, 이때, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이고, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상이며, c는 1 이상 10 이하이고,

5'-GCUGCUUGCAUCAGCCUAAUGUCGAG-3'(서열번호 475)로 표현되는 제1 서열;

5'-UUCG-3'로 표현되는 제2 서열;

5'-CUCGA-3'로 표현되는 제3 서열;

5'-AACAAA-3'로 표현되는 제4 서열;

링커;

5'-GGA-3'로 표현되는 제5 서열; 및

5'-AUGCAAC-3'로 표현되는 제6 서열.

일 실시예로, 본 명세서에서는 다음을 포함하는 CRISPR/Cas12f1 시스템을 위한 엔지니어링 된 가이드 RNA를 제공한다:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

이때, 상기 스페이서는 10개 이상 50개 이하의 뉴클레오타이드를 포함하며, 표적 서열과 상보적인 서열을 가지고,

상기 엔지니어링 된 스캐폴드 영역은 다음을 포함함:

5'말단에서 3'말단 방향으로,

5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27), 및 5'-CUUCACUGAUAAAGUGGAGAA-3'(서열번호 10)로 이루어진 군에서 선택된 제1 서열,

5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362), 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 제2 서열,

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 434), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUUCGAAAGUAACCCUCGA-3'(서열번호 435), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUCGAAGUAACCCUCGA-3'(서열번호 436), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUCUUCGGAGUAACCCUCGA-3'(서열번호 437), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCGAGUAACCCUCGA-3'(서열번호 438), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUCGGUAACCCUCGA-3'(서열번호 439), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGUUCGUAACCCUCGA-3'(서열번호 440), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUUCGAACCCUCGA-3'(서열번호 441), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGACCCUCGA-3'(서열번호 442), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGCCCUCGA-3'(서열번호 443), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCCUCGA-3'(서열번호 444), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCUCGA-3'(서열번호 445), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAUUCGCCUCGA-3'(서열번호 446), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGUUCGCUCGA-3'(서열번호 447), 및 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12)로 이루어진 군에서 선택된 제3 서열,

5'-AACAAA-3', 5'-AACAAAU-3', 5'-AACAAAUU-3', 5'-AACAAAUUC-3', 5'-AACAAAUUCA-3'(서열번호 67), 5'-AACAAAUUCAU-3'(서열번호 68), 5'-AACAAAUUCAUU-3'(서열번호 69), 및 5'-AACAAAUUCAUUU-3'(서열번호 13)로 이루어진 군에서 선택된 제4 서열이 연결된 엔지니어링 된 tracrRNA; 및

5'-GGA-3', 5'-AGGA-3', 5'-AAGGA-3', 5'-GAAGGA-3', 5'-UGAAGGA-3', 5'-AUGAAGGA-3', 5'-AAUGAAGGA-3', 및 5'-GAAUGAAGGA-3'(서열번호 15)으로 이루어진 군에서 선택된 제5 서열, 및

5'-AUGCAAC-3'로 표현되는 제6 서열이 연결된 엔지니어링 된 crRNA 반복 서열 부분,

이때, 상기 엔지니어링 된 crRNA 반복 서열 부분의 3'말단은 상기 스페이서의 5'말단과 연결 되어 있고,

상기 엔지니어링 된 tracrRNA의 서열은 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 1)와 동일하고, 상기 엔지니어링 된 crRNA 반복 서열은 5'-GAAUGAAGGAAUGCAAC-3'(서열번호 3)과 동일한 경우를 포함하지 않는 것을 특징으로 한다.

일 실시예로, 본 명세서에서는 다음을 포함하는, 엔지니어링 된 CRISPR/Cas12f1 복합체를 제공한다:

Cas12f1 단백질; 및

엔지니어링 된 가이드 RNA,

이때, 상기 엔지니어링 된 가이드 RNA는 다음을 포함함:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

상기 스페이서는 10개 이상 50개 이하의 뉴클레오타이드를 포함하며, 상기 표적 서열과 상보적인 서열을 가지고,

5'-AUGCAAC-3'.

일 실시예로, 본 명세서에서는 다음을 포함하는, CRISPR/Cas12f1 시스템의 각 구성요소를 발현할 수 있는 벡터를 제공한다:

Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 제1 서열;

상기 제1 서열과 작동 가능하게 연결된 제1 프로모터 서열;

엔지니어링 된 가이드 RNA를 암호화하는 핵산 서열을 포함하는 제2 서열; 및

상기 제2 서열과 작동 가능하게 연결된 제2 프로모터 서열,

이때, 상기 엔지니어링 된 가이드 RNA는 다음을 포함함:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

여기서, 상기 엔지니어링 된 가이드 RNA는 5'말단에서 3'말단 방향으로, 엔지니어링 된 스캐폴드 영역, 스페이서, 및 U-rich tail이 순서대로 연결되어 있고,

5'-AUGCAAC-3'.

일 실시예로, 본 명세서에서는 다음을 포함하는, 세포 내에서 표적 핵산을 편집하는 방법 또는 표적 핵산을 타겟팅하는 방법을 제공한다:

Cas12f1 단백질 또는 이를 암호화하는 핵산, 및 엔지니어링 된 가이드 RNA 또는 이름 암호화하는 핵산을 세포 내로 도입하는 것,

이로 인해 상기 세포 내에서 CRISPR/Cas12f1 복합체가 형성될 수 있으며,

이로 인해 상기 표적 핵산이 CRISPR/Cas12f1 복합체에 의해 편집되거나 또는 타겟팅될 수 있고,

상기 엔지니어링 된 가이드 RNA는 다음을 포함하는 것을 특징으로 함:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

5'-AUGCAAC-3'.

일 실시예로, 본 명세서에서는 엔지니어링 된 Cas12f1 가이드 RNA의 유전자 편집 용도를 제공한다.

본 명세서에서 제공하는 엔지니어링 된 스캐폴드 영역 및 U-rich tail을 가지는 엔지니어링 된 Cas12f1 가이드 RNA를 포함하는 CRISPR/Cas12f1 시스템을 유전자 편집에 사용하는 경우, 자연계에서 발견되는 CRISPR/Cas12f1 시스템을 사용할 때와 비교해 높은 유전자 편집 효율을 나타낸다.

도 1은 본 명세서에서 개시하는 엔지니어링 된 Cas12f1 가이드 RNA를 예시적으로 나타낸 모식도이다.

도 2는 실험예 2에 개시된 실시예 중, DY2를 표적으로 하는 Example 1.1.1 내지 Example 1.1.3에 대한 평균 indel 효율을 나타낸 그래프이다. 이때, Ex 는 Example, Comp는 Comparative Example을 나타내는 약어이며, Control은 음성 대조군을 나타낸다.

도 3은 실험예 2에 개시된 실시예 중, DY2를 표적으로 하는 Example 1.1.4 내지 Example 1.1.6에 대한 평균 indel 효율을 나타낸 그래프이다. 이때, Ex 는 Example, Comp는 Comparative Example을 나타내는 약어이며, Control은 음성 대조군을 나타낸다.

도 4는 실험예 2에 개시된 실시예 중, DY2를 표적으로 하는 Example 1.1.7 내지 Example 1.1.9에 대한 평균 indel 효율을 나타낸 그래프이다. 이때, Ex 는 Example, Comp는 Comparative Example을 나타내는 약어이며, Control은 음성 대조군을 나타낸다.

도 5는 실험예 2에 개시된 실시예 중, DY2를 표적으로 하는 Example 1.1.10 내지 Example 1.1.13에 대한 평균 indel 효율을 나타낸 그래프이다. 이때, Ex 는 Example, Comp는 Comparative Example을 나타내는 약어이며, Control은 음성 대조군을 나타낸다.

도 6은 실험예 2에 개시된 실시예 중, DY10을 표적으로 하는 Example 1.2.1 내지 Example 1.2.3에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex 는 Example, Comp는 Comparative Example을 나타내는 약어이며, Control은 음성 대조군을 나타낸다.

도 7은 실험예 2에 개시된 실시예 중, DY10을 표적으로 하는 Example 1.2.4 내지 Example 1.2.6에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex 는 Example, Comp는 Comparative Example을 나타내는 약어이며, Control은 음성 대조군을 나타낸다.

도 8은 실험예 2에 개시된 실시예 중, DY10을 표적으로 하는 Example 1.2.7 내지 Example 1.2.9에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex 는 Example, Comp는 Comparative Example을 나타내는 약어이며, Control은 음성 대조군을 나타낸다.

도 9는 실험예 2에 개시된 실시예 중, DY10을 표적으로 하는 Example 1.2.10 내지 Example 1.2.13에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex 는 Example, Comp는 Comparative Example을 나타내는 약어이며, Control은 음성 대조군을 나타낸다.

도 10은 실험예 2에 개시된 실시예 중, Intergenic22를 표적으로 하는 Example 1.3.1 내지 Example 1.3.3에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex 는 Example, Comp는 Comparative Example을 나타내는 약어이며, Control은 음성 대조군을 나타낸다.

도 11은 실험예 2에 개시된 실시예 중, Intergenic22를 표적으로 하는 Example 1.3.4 내지 Example 1.3.6에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex 는 Example, Comp는 Comparative Example을 나타내는 약어이며, Control은 음성 대조군을 나타낸다.

도 12는 실험예 2에 개시된 실시예 중, Intergenic22를 표적으로 하는 Example 1.3.7 내지 Example 1.3.9에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex 는 Example, Comp는 Comparative Example을 나타내는 약어이며, Control은 음성 대조군을 나타낸다.

도 13은 실험예 2에 개시된 실시예 중, Intergenic22를 표적으로 하는 Example 1.3.10 내지 Example 1.3.13에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex 는 Example, Comp는 Comparative Example을 나타내는 약어이며, Control은 음성 대조군을 나타낸다.

도 14는 실험예 2에 개시된 실시예 중, DY2를 표적으로 하는 Comparative Example 1.1.1, 및 Control의 Indel 효율을 나타낸 그래프이다.

도 15는 실험예 2에 개시된 실시예 중, DY10을 표적으로 하는 Comparative Example 1.2.1, 및 Control의 Indel 효율을 나타낸 그래프이다.

도 16은 실험예 3.1에 개시된 실시예 중 DY2를 표적으로 하는 Example 2.1.1 내지 Example 2.1.7에 대한 평균 indel 효율을 나타낸 그래프이다. 이때, Ex는 Example을 나타내는 약어이다.

도 17은 실험예 3.1에 개시된 실시예 중 DY2를 표적으로 하는 Example 2.1.8 내지 Example 2.1.15에 대한 평균 indel 효율을 나타낸 그래프이다. 이때, Ex는 Example을 나타내는 약어이다.

도 18은 실험예 3.1에 개시된 실시예 중, DY10을 표적으로 하는 Example 2.2.1 내지 Example 2.2.7에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex는 Example을 나타내는 약어이다.

도 19는 실험예 3.1에 개시된 실시예 중, DY10을 표적으로 하는 Example 2.2.8 내지 Example 2.2.15에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex는 Example을 나타내는 약어이다.

도 20은 실험예 3.2에 개시된 실시예 중 DY2를 표적으로 하는 Example 3.1.1 내지 Example 3.1.6에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex는 Example을 나타내는 약어이다.

도 21은 실험예 3.2에 개시된 실시예 중 DY2를 표적으로 하는 Example 3.1.7 내지 Example 3.1.12에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex는 Example을 나타내는 약어이다.

도 22는 실험예 3.2에 개시된 실시예 중, DY10을 표적으로 하는 Example 3.2.1 내지 Example 3.2.6에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex는 Example을 나타내는 약어이다.

도 23은 실험예 3.2에 개시된 실시예 중, DY10을 표적으로 하는 Example 3.2.7 내지 Example 3.2.12에 대한 indel 효율의 평균값을 나타낸 그래프이다. 이때, Ex는 Example을 나타내는 약어이다.

도 24는 실험예 4.1에 개시된 각각의 실시예에 대한 평균 indel 효율을 나타낸 그래프이다. FUS를 표적으로 하는 Example 4.4.1 내지 Example 4.4.4에 대한 indel 효율의 평균값이 각각 도시되어 있다. 이때, Ex는 Example을 나타내는 약어이다.

도 25는 실험예 4.1에 개시된 각각의 실시예에 대한 평균 indel 효율을 나타낸 그래프이다. GAK를 표적으로 하는 Example 4.5.1 내지 Example 4.5.2에 대한 indel 효율의 평균값이 각각 도시되어 있다. 이때, Ex는 Example을 나타내는 약어이다.

도 26은 실험예 4.1에 개시된 각각의 실시예에 대한 평균 indel 효율을 나타낸 그래프이다. MLH를 표적으로 하는 Example 4.6.1에 대한 indel 효율의 평균값이 각각 도시되어 있다. 이때, Ex는 Example을 나타내는 약어이다.

도 27은 실험예 5의 Large scale validation 실험 결과를 나타낸 것이다.

도 28은 실험예 6의 in vitro cleavage assay 결과를 나타낸 것이다.

용어의 정의

약

본 명세서에서 사용되는 "약"이라는 용어는 참조 양, 수준, 값, 수, 빈도, 퍼센트, 치수, 크기, 양, 중량 또는 길이에 대해 30, 25, 20, 25, 10, 9, 8, 7, 6, 5, 4, 3, 2 또는 1% 정도로 변하는 양, 수준, 값, 수, 빈도, 퍼센트, 치수, 크기, 양, 중량 또는 길이를 의미한다.

A,T,C,G, 및 U

본 명세서에서 사용되는 A, T, C, G 및 U 기호는 당업계 통상의 기술자가 이해하는 의미로 해석된다. 문맥 및 기술에 따라 DNA 또는 RNA 상에서 염기, 뉴클레오사이드 또는 뉴클레오타이드로 적절히 해석될 수 있다. 예를 들어, 염기를 의미하는 경우는 각각 아데닌(A), 티민(T), 시토신(C), 구아닌(G) 또는 우라실(U) 자체로 해석될 수 있고, 뉴클레오사이드를 의미하는 경우는 각각 아데노신(A), 티미딘(T), 시티딘(C), 구아노신(G) 또는 유리딘(U)으로 해석될 수 있으며, 서열에서 뉴클레오타이드를 의미하는 경우는 상기 각각의 뉴클레오사이드를 포함하는 뉴클레오타이드를 의미하는 것으로 해석된다.

작동 가능하게 연결된(operably linked)

본 명세서에서 사용되는 "작동 가능하게 연결된"이라는 용어는 유전자 발현에 있어서, 특정 구성이 다른 구성과 연결되어 의도된 방식대로 기능할 수 있도록 연결되어 있는 것을 의미한다. 예를 들어, 프로모터 서열이 암호화 서열과 작동 가능하게 연결되었다고 할 때, 상기 프로모터가 상기 암호화 서열의 세포 내에서의 전사 및/또는 발현에 영향을 미칠 수 있도록 연결된 것을 의미한다. 또한, 상기 용어는 당업계 통상의 기술자가 이해할 수 있는 의미를 모두 포함하며, 문맥에 따라 적절히 해석될 수 있다.

표적 유전자 또는 표적 핵산

본 명세서에서 사용되는 "표적 유전자(target gene)" 또는 "표적 핵산(target nucleic acids)"은 기본적으로, 유전자 편집의 대상이 되는 세포 내 유전자 또는 핵산을 의미한다. 상기 표적 유전자 또는 표적 핵산은 혼용되어 사용될 수 있으며, 서로 동일한 대상을 지칭할 수 있다. 상기 표적 유전자 또는 표적 핵산은 달리 기재되지 않은 한, 대상 세포가 가진 고유한 유전자 또는 핵산, 혹은 외부 유래의 유전자 또는 핵산 모두를 의미할 수 있으며, 편집의 대상이 될 수 있다면 특별히 제한되지 않는다. 상기 표적 유전자 또는 표적 핵산은 표적 서열 또는 표적 서열의 인접 부위를 포함할 수 있다. 상기 표적 유전자 또는 표적 핵산은 단일가닥 DNA, 이중가닥 DNA, 및/또는 RNA일 수 있다. 또한, 상기 용어는 당업계 통상의 기술자가 이해할 수 있는 의미를 모두 포함하며, 문맥에 따라 적절히 해석될 수 있다.

표적 서열 또는 인식 서열

본 명세서에서 사용되는 "표적 서열(target sequence)" 또는 "인식 서열(recognition sequence)"은 CRISPR/Cas 복합체가 표적 유전자 또는 표적 핵산을 절단하기 위해 인식하는 특정 서열을 의미한다. 상기 표적 서열은 그 목적에 따라 적절히 선택될 수 있다. 구체적으로, "표적 서열"은 상기 전술한 표적 유전자 또는 표적 핵산 내에 포함된 서열일 수 있고, 본 명세서에서 제공하는 가이드 RNA, 또는 엔지니어링 된 가이드 RNA에 포함된 스페이서 서열과 상보성을 가지는 서열을 의미한다. 일반적으로, 상기 스페이서 서열은 표적 유전자 또는 표적 핵산의 서열 및 CRISPR/Cas 시스템의 이펙터 단백질이 인식하는 PAM 서열을 고려하여 결정된다. 본 명세서에서, 상기 표적 서열은 CRISPR/Cas 복합체의 가이드 RNA와 상보적으로 결합하는 특정 가닥만을 지칭할 수 있으며, 상기 특정 가닥 부분을 포함하는 표적 이중 가닥 전체를 지칭할 수도 있으며, 이는 문맥에 따라 적절히 해석된다. 또한, 상기 용어는 당업계 통상의 기술자가 이해할 수 있는 의미를 모두 포함하며, 문맥에 따라 적절히 해석될 수 있다.

벡터

본 명세서에서 사용되는 "벡터"는 달리 특정되지 않는 한, 유전 물질을 세포 내로 운반할 수 있는 모든 물질을 통틀어 일컫는다. 예를 들어, 벡터는 대상이 되는 유전 물질, 예를 들어 CRISPR/Cas 시스템의 이펙터 단백질을 암호화하는 핵산, 및/또는 가이드 RNA를 암호화하는 핵산을 포함하는 DNA 분자일 수 있으나, 이에 제한되는 것은 아니다. 상기 용어는 당업계 통상의 기술자가 이해할 수 있는 의미를 모두 포함하며, 문맥에 따라 적절히 해석될 수 있다.

자연계에서 발견되는

본 명세서에서 "자연계에서 발견되는(occurred in nature)" 이라는 용어는, 자연계에서 발견되는, 인위적으로 변형되지 않은 대상을 의미하며, 인위적인 변형이 가해진 "엔지니어링 된 대상"과 구분하기 위해 사용된다. 상기 "자연계에서 발견되는" 유전자, 핵산, DNA, RNA 등은 야생형(wild type, original form) 및 mature form (active form)의 유전자, 핵산, DNA, RNA를 모두 포괄하는 개념으로 사용된다. 상기 용어는 그 외 통상의 기술자가 이해할 수 있는 의미를 모두 포함하며, 문맥에 따라 적절히 해석되어야 한다.

엔지니어링 된

본 명세서에서 사용되는 "엔지니어링 된(engineered)"이란 용어는 자연계에 이미 존재하는 구성을 가진 물질, 분자 등과 구분하기 위해 사용하는 용어로, 상기 물질, 분자 등에 인위적인 변형이 가해진 것을 의미한다. 예를 들어, "엔지니어링 된 가이드 RNA"의 경우, 자연계에 존재하는 가이드 RNA의 구성에 인위적인 변경이 가해진 가이드 RNA를 의미한다. 또한, 상기 용어는 당업계 통상의 기술자가 이해할 수 있는 의미를 모두 포함하며, 문맥에 따라 적절히 해석될 수 있다.

NLS(Nuclear Localization Sequence, or Signal)

본 명세서에서 "NLS"라 함은, 핵 수송(nuclear transport) 작용으로 세포 핵 외부의 물질을 핵 내부로 수송할 때, 수송 대상인 단백질에 붙어 일종의 "태그"역할을 하는 일정 길이의 펩타이드, 또는 그 서열을 의미한다. 구체적으로, 상기 NLS는 아미노산 서열 PKKKRKV(서열번호 278)을 갖는 SV40 바이러스 대형 T-항원의 NLS; 뉴클레오플라스민(nucleoplasmin)으로부터의 NLS(예를 들어, 서열 KRPAATKKAGQAKKKK(서열번호 279)를 갖는 뉴클레오플라스민 이분(bipartite) NLS); 아미노산 서열 PAAKRVKLD(서열번호 280) 또는 RQRRNELKRSP(서열번호 281)를 갖는 c-myc NLS; 서열 NQSSNFGPMKGGNFGGRSSGPYGGGGQYFAKPRNQGGY(서열번호 282)를 갖는 hRNPA1 M9 NLS; 임포틴-알파로부 터의 IBB 도메인의 서열 RMRIZFKNKGKDTAELRRRRVEVSVELRKAKKDEQILKRRNV(서열번호 283); 마이오 마(myoma) T 단백질의 서열 VSRKRPRP(서열번호 284) 및 PPKKARED(서열번호 285); 인간 p53의 서열 PQPKKKPL(서열번호 286); 마우스 c-abl IV의 서열 SALIKKKKKMAP(서열번호 287); 인플루엔자 바이러스 NS1의 서열 DRLRR(서열번호 288) 및 PKQKKRK(서열번호 289); 간염 바이러스 델타 항원의 서열 RKLKKKIKKL(서열번호 290); 마우스 Mx1 단백질의 서열 REKKKFLKRR(서열번호 291); 인간 폴리(ADP-리보스) 중합효소의 서열 KRKGDEVDGVDEVAKKKSKK(서열번호 292); 또는 스테로이드 호르몬 수용체(인간) 글루코코르티코이드의 서열 RKCLQAGMNLEARKTKK(서열번호 293)로부터 유래된 NLS 서열일 수 있으나, 이에 제한되지 않는다. 본 명세서에서 사용되는 "NLS"라는 용어는 통상의 기술자가 이해할 수 있는 의미를 모두 포함하며, 문맥에 따라 적절하게 해석될 수 있다.

NES(Nuclear Export Sequence, or Signal)

본 명세서에서 "NES"라 함은, 핵 수송(nuclear transport) 작용으로 세포 핵 내부의 물질을 핵 외부로 수송할 때, 수송 대상인 단백질에 붙어 일종의 "태그"역할을 하는 일정 길이의 펩타이드, 또는 그 서열을 의미한다. 본 명세서에서 사용되는 "NES"라는 용어는 통상의 기술자가 이해할 수 있는 의미를 모두 포함하며, 문맥에 따라 적절하게 해석될 수 있다.

태그

본 명세서에서 "태그"라 함은, 펩타이드, 또는 단백질의 수송, 추적 및/또는 분리정제를 쉽게 하기 위하여 부가되는 기능적 도메인을 통틀어 일컫는다. 구체적으로, 상기 태그는 히스티딘(His) 태그, V5 태그, FLAG 태그, 인플루엔자 헤마글루 티닌(HA) 태그, Myc 태그, VSV-G 태그 및 티오레독신(Trx) 태그 등의 태그 단백질, 녹색 형광 단백질(GFP), 황색 형광 단백질(YFP), 청록색 형광 단백질(CFP), 청색 형광 단백질(BFP), HcRED, DsRed 등의 자가형광 단백질, 및 글루타티온-S-트랜스 퍼라제(GST), 호스라디시(horseradish) 과산화효소(HRP), 클로람페니콜 아세틸트랜스퍼라제(CAT) 베타-갈락토시다제, 베타 -글루쿠로니다제, 루시퍼라제 등의 리포터 유전자를 포함하나, 이에 제한되는 것은 아니다. 본 명세서에서 사용되는 "태그"라는 용어는 통상의 기술자가 이해할 수 있는 의미를 모두 포함하며, 문맥에 따라 적절하게 해석될 수 있다.

배경기술 - CRISPR/Cas12f1 복합체의 구조

CRISPR/Cas12f 시스템

CRISPR/Cas12f 시스템은 type V CRISPR/Cas 시스템 중 V-F 서브타입에 속하고, 이는 다시 V-F1 내지 V-F3의 베리언트로 나뉜다. CRISPR/Cas12f 시스템은 선행연구(Harrington et al., Programmed DNA destruction by miniature CRISPR-Cas14 enzymes, Science 362, 839-842 (2018))에서 Cas14로 명명된 이펙터 단백질 중, Cas14a, Cas14b, 및 Cas14c 변이체를 포함하는 CRISPR/Cas14 시스템을 포함한다. 이 중, Cas14a 이펙터 단백질을 포함하는 CRISPR/Cas14a 시스템은 CRISPR/Cas12f1 시스템으로 분류된다(Makarova et al., Nature Reviews, Microbiology volume 18, 67 (2020)). 최근 선행 연구(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021), Xiao et al., Structural basis for the dimerization-dependent CRISPR-Cas12f nuclease, bioRxiv (2020)) 등을 통해 상기 CRISPR/Cas12f1 복합체의 구조가 밝혀진 바, 이하 이에 대해 간략히 서술한다.

CRISPR/Cas12f1 복합체의 구조

CRISPR/Cas12f1 복합체 내에서, Cas12f1 단백질은 두 개의 분자가 이량체 형태로 가이드 RNA와 결합하여 복합체를 이루고 있음이 밝혀졌다. 상기 Cas12f1 단백질은 amino-terminal domain (NTD) 및 carboxy-terminal domin(CTD)로 나뉘며, 상기 두 도메인이 링커 루프(linker loop)를 통해 연결되어 있는 구조이다. 상기 NTD는 wedge (WED), recognition (REC), 및 zinc finger (ZF) 도메인으로 구성되며, 상기 CTD는 또 다른 ZF 도메인 및 RuvC 도메인으로 구성된다. Cas12f1 단백질 이량체의 구조는 크게 REC 로브(REC lobe) 및 nuclease 로브(NUC lobe)로 나눌 수 있다. 상기 REC 로브는, 이량체를 구성하는 하나의 Cas12f1 단백질의 WED 도메인, ZF 도메인, 및 REC 도메인과; 이량체를 구성하는 다른 하나의 Cas12f1 단백질의 WED 도메인, ZF 도메인, 및 REC 도메인으로 구성된다. 상기 nuclease 로브는, 이량체를 구성하는 하나의 Cas12f1 단백질의 RuvC 도메인 및 TNB 도메인과; 이량체를 구성하는 다른 하나의 Cas12f1 단백질의 RuvC 도메인 및 TNB 도메인으로 구성된다. 상기 Cas12f1 단백질의 각 도메인의 전부 또는 일부는 각각 Cas12f1 가이드 RNA의 스캐폴드 영역의 특정 부분을 인식하며, CRISPR/Cas12f1 복합체를 이룬다.

Cas12f1 가이드 RNA의 구조

본 명세서에서, Cas12f1 가이드 RNA는 크게 기능적으로 스페이서, 및 스캐폴드 영역으로 나눌 수 있다. 상기 스캐폴드 영역은 다섯개의 Stem (Stem 1 내지 Stem 5로 명명) 및 하나의 pseudoknot (PK)로 구성된다.

통상적으로, 자연계에서 발견되는 Cas12f1 가이드 RNA는 tracrRNA 및 crRNA로 나뉘며, 상기 crRNA는 다시 crRNA 반복 서열 부분 및 스페이서로 나눌 수 있다는 것이 통상의 기술자에게 잘 알려져 있다. 상기 기준과는 별개로, 본 명세서에서는 상기 Cas12f1 가이드 RNA 중 Cas12f1 단백질과 상호작용하는 부분을 통틀어 스캐폴드 영역이라 지칭한다. 상기 스캐폴드 영역은 tracrRNA 및 crRNA의 일부를 포함하는 영역으로, Cas12f1 단백질과 상호작용하는 기능을 한다. 이에 대한 구체적인 설명은 이하 해당 단락에서 기술한다.

상기 Cas12f1 가이드 RNA는 tracrRNA의 일부(tracrRNA anti-repeat), 및 crRNA 반복 부분(crRNA repeat)의 일부가 상보적으로 결합하여 듀플렉스(duplex)를 이루고 있는 구조를 2개 포함하며, 이를 편의상 crRNA repeat-tracrRNA anti-repeat(R:AR) 부분으로 명명한다. 상기 Stem 5(R:AR2), 및 PK(R:AR1)는 이러한 crRNA repeat-tracrRNA anti-repeat 듀플렉스 구조를 이루고 있다. CRISPR/Cas12f1 복합체에서, 상기 Cas12f1 가이드 RNA 중 Stem 1 부분, Stem 2 중 일부, 및 Stem 5(R:AR2) 부분은 상기 Cas12f1 이량체와 상호작용하지 않는 부분임이 밝혀졌으며, 이를 disordered region이라 한다.

배경기술 - CRISPR/Cas 시스템 발현 벡터 설계

벡터 설계 개괄

CRISPR/Cas 시스템을 유전자 편집에 사용하기 위해서, 상기 CRISPR/Cas 시스템의 각 구성을 암호화하는 뉴클레오타이드 서열을 가지는 벡터를 세포 내에 도입시켜, 세포 내에서 상기 CRISPR/Cas 시스템의 각 구성이 발현되도록 하는 방법이 널리 이용되고 있다. 이하, CRISPR/Cas 시스템이 세포 내에서 발현되도록 하는 벡터의 구성 요소에 대해 설명한다.

CRISPR/Cas 시스템 구성 요소를 암호화하는 핵산

상기 벡터의 목적은 CRISPR/Cas 시스템 각 구성요소를 세포 내에서 발현되도록 하는 것이므로, 상기 벡터의 서열은 CRISPR/Cas 시스템의 각 구성요소를 암호화하는 핵산 중 하나 이상을 포함할 수 있다. 구체적으로, 상기 벡터의 서열은 발현하고자 하는 CRISPR/Cas 시스템에 포함된 가이드 RNA, 및/또는 Cas 단백질을 암호화하는 핵산을 포함한다. 이때, 상기 벡터의 뉴클레오티드 서열은 야생형의 가이드 RNA 및 야생형의 Cas 단백질을 암호화하는 핵산뿐 아니라 그 목적에 따라 엔지니어링 된 Cas12f1 가이드 RNA 및 코돈 최적화된 Cas 단백질을 암호화하는 핵산 또는 엔지니어링 된 Cas 단백질을 암호화하는 핵산을 포함할 수 있다. 이때, 상기 각 구성요소를 암호화하는 핵산 서열은 DNA 서열일 수 있다.

조절/제어 요소

상기 구성요소를 세포 내에서 발현시키기 위해서, 상기 벡터는 하나 이상의 조절/제어 요소를 포함해야 한다. 구체적으로, 상기 조절/제어 구성요소는 프로모터, 인핸서, 인트론, 폴리아데닐화 신호, 코작 공통(Kozak consensus) 서열, 내부 리보솜 유입 부위(IRES, Internal Ribosome Entry Site), 스플라이스 억셉터, 2A 서열 및/또는 복제원점(replication origin)을 포함할 수 있으나, 이에 제한되는 것은 아니다. 이때, 상기 복제원점은 f1 복제원점, SV40 복제원점, pMB1 복제원점, 아데노 복제원점, AAV 복제원점, 및/또는 BBV 복제원점일 수 있으나, 이에 제한되는 것은 아니다.

프로모터

상기 벡터의 발현 대상을 세포 내에서 발현시키려면, 각 구성 요소를 암호화하는 서열에 프로모터 서열을 작동적으로 연결시켜 세포 내에서 전사 인자가 활성화될 수 있도록 해야 한다. 상기 프로모터 서열은 대응하는 전사 인자, 또는 발현 환경에 따라 달리 설계할 수 있으며, CRISPR/Cas 시스템의 구성 요소를 세포 내에서 적절히 발현시킬 수 있는 것이라면 제한되지 않는다. 상기 프로모터 서열은 RNA 중합효소(예를 들어,RNA Pol I, Pol II, 또는 Pol III)의 활성을 촉진시키는 프로모터일 수 있다. 예를 들어, 상기 프로모터는 SV40 초기 프로모터, mouse mammary tumor virus long terminal repeat(LTR) 프로모터, adenovirus major late 프로모터 (Ad MLP), herpes simplex virus (HSV) 프로모터, CMV immediate early promoter region (CMVIE)와 같은 cytomegalovirus (CMV) 프로모터, rous sarcoma virus (RSV) 프로모터, human U6 small nuclear 프로모터 (U6) (Miyagishi et al., Nature Biotechnology 20, 497 - 500 (2002)), enhanced U6 프로모터 (e.g., Xia et al., Nucleic Acids Res. 2003 Sep 1;31(17)), human H1 프로모터 (H1), 및 7SK 중 하나 일 수 있으나, 이에 제한되는 것은 아니다.

종결 신호

상기 전사 인자의 전사 활동의 종결을 유도하는 서열을 종결 신호라고 일컫는다. 상기 종결 신호는, 프로모터 서열의 종류에 따라 달라질 수 있다. 예를 들어, 상기 프로모터가 U6, 또는 H1 프로모터일 경우, 상기 프로모터는 티미딘 연속 서열(예를 들어, TTTTTT (T6) 서열)을 종결 신호로 인식한다.

부가 발현 요소

상기 벡터는 야생형의 CRISPR/Cas 시스템 구성, 및/또는 엔지니어링 된 CRISPR/Cas 시스템 외 통상의 기술자가 필요에 의해 발현시키고자 하는 부가 발현 요소를 암호화하는 핵산 서열을 포함하고 있을 수 있다. 예를 들어, 상기 부가 발현 요소는, "태그" 단락에서 설명된 태그 중 하나일 수 있으나, 이에 제한되는 것은 아니다. 예를 들어, 상기 부가 발현 요소는, 선별을 위한 selection 유전자, 예를 들어, 글리포세이트(glyphosate), 글루포시네이트암모늄 (glufosinate ammonium) 또는 포스피노트리신(phosphinothricin)과 같은 제초제 저항성 유전자, 암피실린(ampicillin), 카나마이신(kanamycin), G418, 블레오마이신 (Bleomycin), 하이그로마이신(hygromycin), 클로람페니콜(chloramphenicol)과 같은 항생제 내성 유전자일 수 있으나, 이에 제한되는 것은 아니다.

발현 벡터의 형태

상기 발현 벡터는 선형, 또는 원형 벡터 형태로 설계될 수 있다.

종래 기술의 한계점

CRISPR/Cas12f1 시스템은 상대적으로 크기가 작기 때문에, 유전자 편집 기술에 적용하기 매력적인 시스템으로, 최초로 보고된 이후(Harrington et al., Programmed DNA destruction by miniature CRISPR-Cas14 enzymes, Science 362, 839-842 (2018)), 이에 대한 몇몇 연구가 진행되고 있다 (Harrington et al., Programmed DNA destruction by miniature CRISPR-Cas14 enzymes, Science 362, 839-842 (2018), US 2020/0190494 A1). 하지만, 세포(예를 들어, 진핵 세포) 내에서 유전자 편집 활성이 나타나지 않거나, 지나치게 낮아 이를 활용하는 데 걸림돌이 되고 있다.

계속된 연구로 최근 선행문헌(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021))에서는 CRISPR/Cas12f1 시스템에서 Cas12f1 단백질이 이량체(dimer)를 형성한다는 사실, 및 가이드 RNA의 구조에 대해 밝혀졌다. 상기 선행문헌에 의해 가이드 RNA 부분 중 Cas12f1 단백질과 직접적으로 상호작용하지 않는, 이른바 disordered region이 있다는 것이 밝혀졌으며, 또 다른 선행문헌(Xiao et al., Structural basis for the dimerization-dependent CRISPR-Cas12f nuclease, bioRxiv (2020))에서는 상기 disordered region 부분을 제거하고 in vitro에서 이중가닥 DNA 절단 효율을 살핀 바 있다. 하지만, 상기 선행 연구들은 세포 내 유전자 편집 활성(예를 들어, indel 발생 효율)을 보이거나, 이를 높이는 방안에 대한 연구는 아니며, disordered region을 제거한 실험은 있지만, 오히려 절단 활성이 낮아지는 것으로 보고하고 있다. 더욱이, 상기 연구에서의 실험은 in vitro에서 진행한 실험으로, 세포 내 유전자 편집 활성을 나타내거나, 효율을 높이기 위한 변형이 무엇인지 밝히는데는 실패하였다.

따라서 여전히, CRISPR/Cas12f1 시스템의 세포 내 유전자 편집 활성을 높이는 것이 중요한 과제로 남아 있다.

엔지니어링 된 Cas12f1 가이드 RNA의 특징

엔지니어링 된 Cas12f1 가이드 RNA 개괄

본 명세서에서는 종래 기술의 한계점을 극복하여, CRISPR/Cas12f1 시스템의 세포 내 유전자 편집 활성을 높이기 위한, 엔지니어링 된 Cas12f1 가이드 RNA를 제공한다. 상기 엔지니어링 된 Cas12f1 가이드 RNA는 자연계에서 발견되는 가이드 RNA에 새로운 구성을 추가하고, 또한 그 구조 일부를 변형한 것이다. 상기 엔지니어링 된 Cas12f1 가이드 RNA는 3'말단에 새로운 구성인 U-rich tail을 포함하는 것을 특징으로 한다. 또한, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 Cas12f1 단백질과 상호작용하는 역할을 하는 스캐폴드 영역의 적어도 일부가 변형된 것을 특징으로 한다.

일 구현예로, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 엔지니어링 된 스캐폴드 영역, 스페이서, 및 U-rich tail을 포함할 수 있다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 가이드 RNA의 스캐폴드 영역과는 다른 것을 특징으로 한다.

엔지니어링 된 Cas12f1 가이드 RNA의 특징 1 - U-rich tail 포함

본 명세서에서 제공하는 엔지니어링 된 Cas12f1 가이드 RNA는 자연계에서 발견되는 가이드 RNA에 U-rich tail이 추가된 것을 특징으로 한다. 상기 U-rich tail은 상기 엔지니어링 된 Cas12f1 가이드 RNA의 3'말단 부분에 위치하며, 유리딘이 풍부하게 포함된 부분이다.

일 구현예로, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 3'말단 부분에 유리딘이 풍부하게 포함된 U-rich tail을 포함할 수 있다. 일 구현예로, 상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현될 수 있다. 이때, 상기 N은 A, U, C, 또는 G 중 하나이고, 상기 a, b, c는 정수이며, 상기 a는 1 이상 5 이하이고, b는 0 이상 2 이하이며, c는 1 이상 10 이하일 수 있다.

엔지니어링 된 Cas12f1 가이드 RNA의 특징 2 - 스캐폴드 영역(scaffold region) 중 하나 이상의 부분(part)이 변형됨

본 명세서에서 제공하는 엔지니어링 된 Cas12f1 가이드 RNA는 자연계에서 발견되는 가이드 RNA와 비교하여, 그 스캐폴드 영역의 일부가 변형된 것을 특징으로 한다. 스캐폴드 영역은 tracrRNA 및 crRNA의 일부를 포함하는 영역으로, Cas12f1 단백질과 상호작용하는 기능을 한다. 상기 스캐폴드 영역에 대해서는 이하 더 자세히 설명할 것이다.

일 구현예로, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 엔지니어링 된 스캐폴드 영역을 포함할 수 있다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 가이드 RNA의 스캐폴드 영역이 변형된 것이다. 따라서, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 가이드 RNA의 스캐폴드 영역과는 상이한 서열을 가진다. 일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 가이드 RNA의 스캐폴드 영역 중 일부 영역이 제거된 것일 수 있다. 일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 가이드 RNA의 스캐폴드 영역에 포함된 특정 부분에서, 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다.

엔지니어링 된 Cas12f1 가이드 RNA의 효과

본 명세서에서 제공하는 엔지니어링 된 Cas12f1 가이드 RNA를 CRISPR/Cas12f1 시스템에 사용하는 경우, 자연계에서 발견되는 가이드 RNA를 사용하는 경우에 비해 세포 내에서 유전자 편집 활성이 극적으로 향상되는 효과가 나타난다. 본 발명자들은 실험을 통해, 자연계에서 발견되는 가이드 RNA에 어떤 구성을 추가해야 하는지, 혹은 그 스캐폴드 영역에 어떤 변형을 가해야 유전자 편집 효율이 향상되는지 상세하게 밝혔다. 상기 엔지니어링 된 Cas12f1 가이드 RNA를 사용하면, 전술한 종래 기술의 한계점을 극복하여 세포 내에서 높은 효율로 유전자를 편집할 수 있다. 또한, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 자연계에서 발견되는 가이드 RNA와 길이가 동등하거나, 더 짧은 길이를 가져 유전자 편집 기술 분야에서 응용 가능성이 높다. 본 출원의 엔지니어링 된 Cas12f1 가이드 RNA는 CRISPR/Cas12f1 시스템의 장점 (예를 들어, 크기가 매우 작다는 장점)을 충분히 유전자 편집 기술에 활용할 수 있게 한다.

엔지니어링 된 Cas12f1 가이드 RNA의 용도

본 명세서에서 제공하는 엔지니어링 된 Cas12f1 가이드 RNA는 Cas12f1 단백질과 함께 유전자 편집 및/또는 유전자 치료제 용도로 사용될 수 있다. 또한, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 유전자 편집용 조성물을 제조하기 위한 용도로 사용할 수 있다.

U-rich tail

U-rich tail 개괄

본 명세서에서는 CRISPR/Cas12f1 시스템의 유전자 편집 효율 향상을 위해 도입할 수 있는 U-rich tail을 제공한다. 상기 U-rich tail 서열은 엔지니어링 된 Cas12f1 가이드 RNA 중 crRNA의 스페이서의 3'말단에 연결되어 있는 것을 특징으로 하며, 엔지니어링 된 Cas12f1 가이드 RNA가 사용된 CRISPR/Cas12f1 시스템의 표적 핵산에 대한 절단 효율을 높이는 역할을 한다. 상기 U-rich tail 서열은 기본적으로 하나 이상의 유리딘을 포함한다. 상기 U-rich tail 서열은 엔지니어링 된 CRISPR/Cas12f1 시스템의 실제 사용 환경 및 발현 환경(예를 들어, 진핵 세포 또는 원핵 세포 내부 환경)에 따라 유리딘 외 추가적인 뉴클레오타이드를 더 포함할 수 있다.

상기 U-rich tail 서열은 PCT/KR2020/014961출원에 개시된 U-rich tail 서열일 수 있다. 이하 본 명세서에서 U-rich tail 서열을 지칭할 때, PCT/KR2020/014961출원에 개시된 상기 U-rich tail 서열에 대한 내용 및 실험 결과를 모두 포함하는 것으로 이해해야 하고, 상기 출원의 내용은 그 전체가 참조에 의해 본 명세서에 포함된다.

U-rich tail 서열 구조 1 - 유리딘 연속 서열

U-rich tail 서열을 설계하는 데 있어서, U-rich tail은 유리딘이 하나 이상 연속된 서열을 풍부하게 포함할 수 있다. 본 발명자들은 실험을 통해 U-rich tail 서열을 CRISPR/Cas12f1 시스템에 도입한 경우, 상기 CRISPR/Cas12f1 복합체의 유전자 편집 효율이 향상되는 것을 발견했다. 따라서, 본 명세서에서 제공하는 U-rich tail 서열은 유리딘이 하나 이상 연속된 서열을 포함한다.

일 구현예로, 상기 U-rich tail 서열은 1개, 2개, 3개, 4개, 5개, 6개, 7개, 8개, 9개, 10개, 11개, 12개, 13개, 14개, 15개, 16개, 17개, 18개, 19개, 또는 20개의 유리딘이 연속된 서열을 포함할 수 있다.

U-rich tail 서열 구조 2 - 변형된 유리딘 연속 서열

본 명세서에서 제공하는 U-rich tail 서열은 유리딘이 1개 내지 5개 반복될 때마다, 유리딘이 아닌 다른 리보뉴클레오사이드(A, C, G)가 적어도 하나 이상 포함된 '변형된 유리딘 반복 서열'을 포함할 수 있다. 상기 변형된 유리딘 연속 서열은 특히 엔지니어링 된 crRNA를 발현하는 벡터를 설계할 때 유용하다.

일 구현예로, 상기 U-rich tail 서열은 UV, UUV, UUUV, UUUUV, 및/또는 UUUUUV가 하나 이상 반복된 서열을 포함할 수 있다. 이때, 상기 V는 아데노신(A), 사이티딘(C), 구아노신(G) 중 하나이다.

U-rich tail 서열 - 구현예

일 구현예로, 상기 U-rich tail 서열은 (U_aN)_bU_c로 표현될 수 있다. 이때, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이다. 이때, 상기 a, b, c는 정수이고, a는 1 이상 5 이하이며, b는 0 이상이다. 일 구현예로, 상기 b는 0 이상 2 이하일 수 있다. 일 구현예로, 상기 c는 0, 1, 2, 3, 4, 5, 6, 7, 8, 9, 또는 10일 수 있다. 일 구현예로, 상기 c는 바로 이전 문장에서 선택된 두 수치범위 내의 정수일 수 있다. 예를 들어, 상기 c는 1 이상 6 이하일 수 있다.

U-rich tail 서열 예시

일 구현예로, 상기 U-rich tail의 서열은 5'-U-3', 5'-UU-3', 5'-UUU-3', 5'-UUUU-3', 5'-UUUUU-3', 5'-UUUUUU-3', 5'-UUURUUU-3', 5'-UUURUUURUUU-3'(서열번호 646), 5'-UUUURU-3', 5'-UUUURUU-3', 5'-UUUURUUU-3', 5'-UUUURUUUU-3', 5'-UUUURUUUUU-3'(서열번호 647), 또는 5'-UUUURUUUUUU-3'(서열번호 648)일 수 있다. 일 구현예로, 상기 U-rich tail의 서열은 5'-U-3', 5'-UU-3', 5'-UUU-3', 5'-UUUU-3', 5'-UUUUU-3', 5'-UUUUUU-3', 5'-UUUAUUU-3', 5'-UUUAUUUAUUU-3'(서열번호 254), 5'-UUUUAU-3', 5'-UUUUAUU-3', 5'-UUUUAUUU-3', 5'-UUUUAUUUU-3', 5'-UUUUAUUUUU-3'(서열번호 255), 5'-UUUUAUUUUUU-3'(서열번호 256), 5'-UUUGUUU-3', 5'-UUUGUUUGUUU-3'(서열번호 257), 5'-UUUUGU-3', 5'-UUUUGUU-3', 5'-UUUUGUUU-3', 5'-UUUUGUUUU-3', 5'-UUUUGUUUUU-3'(서열번호 258), 또는 5'-UUUUGUUUUUU-3'(서열번호 259)일 수 있다.

일 구현예로, 상기 U-rich tail의 서열은 5'-UUUUUU-3', 5'-UUUUAUUUUUU-3'(서열번호 256), 또는 5'-UUUUGUUUUUU-3'(서열번호 259) 일 수 있다. 일 구현예로, 상기 U-rich tail의 서열은 5'-UUUUAUUUU-3'일 수 있다.

용어의 설명 - Cas12f1 가이드 RNA의 부분을 지칭하는 용어

Cas12f1 가이드 RNA의 부분 - 개괄

자연계에서 발견되는 Cas12f1 가이드 RNA는 tracrRNA 및 crRNA로 나뉘며, 상기 crRNA는 다시 crRNA 반복 서열 부분 및 스페이서로 나눌 수 있다는 것이 통상의 기술자에게 잘 알려져 있다.

상기 기준과는 별개로, 본 명세서에서는 상기 Cas12f1 가이드 RNA 중 Cas12f1 단백질과 상호작용하는 부분을 통틀어 스캐폴드 영역이라 지칭한다. 상기 스캐폴드 영역은 tracrRNA 및 crRNA의 일부를 포함하며, 한 분자의 RNA를 지칭하는 것은 아닐 수 있다. 도 1을 참조하면, 상기 스캐폴드 영역은 다시 제1 영역, 제2 영역, 제3 영역, 제4 영역, 제5 영역, 및 제6 영역으로 세분화될 수 있다. 상기 세분화된 영역을 tracrRNA, crRNA 관점에서 서술하면, 상기 제1 영역 내지 제4 영역은 tracrRNA에 포함되고, 상기 제5 영역 내지 상기 제6 영역은 crRNA, 구체적으로 crRNA 반복 서열 부분에 포함된다.

이하 서술되는 "제n 영역", 또는 "자연계에서 발견되는 제n 영역" (n은 1 이상 6이하의 정수)은 기본적으로 자연계에서 발견되는 Cas12f1 가이드 RNA의 각 부분을 지칭한다. 구체적으로, 상기 "제 n 영역"은 원핵세포 내에서 전사된 가이드 RNA의 구조, 및/또는 원핵세포 시스템에서 실제 작동하는 가이드 RNA(원핵세포 내에서 전사된 형태가 아닌, 활성화된 형태)의 구조에 대응하여 각 영역을 지칭할 수 있다. 엔지니어링 된 Cas12f1 가이드 RNA 내 상기 분류 기준과 대응되는 영역은 일반적으로 "변형된 제n 영역" 내지 "엔지니어링 된 스캐폴드 영역의 제n 영역"으로 서술된다.

다만, 엔지니어링 된 스캐폴드 영역에 포함된 제n 영역일지라도, 달리 변형되지 않아 자연계에서 발견되는 제n 영역과 동일한 경우가 있을 수 있는데, 그 때에 한해 "제n 영역"이라는 용어는 혼용될 수 있다. 이때, 상기 "제n 영역"이 지칭하는 대상(예를 들어, 엔지니어링 된 Cas12f1 가이드 RNA에 포함된 영역인지, 자연계에서 발견되는 가이드 RNA에 포함된 영역인지 여부)은 문맥에 따라 적절히 해석되어야 한다.

tracrRNA, crRNA

본 명세서에서 "tracrRNA", "crRNA"라고 쓰는 경우, CRISPR/Cas 기술 분야에서 통상의 기술자가 인식할 수 있는 의미를 모두 포함한다. 이는, 자연계에서 발견되는 듀얼 가이드 RNA의 각 분자를 지칭하는 용어로 사용되는 것이 일반적이지만, 상기 tracrRNA 및 crRNA를 링커로 연결한 싱글 가이드 RNA의 각 해당 부분을 지칭하는데도 사용될 수 있다. 달리 서술하지 않는 한, tracrRNA 및 crRNA라고만 기재하는 경우 CRISPR/Cas12f1 시스템을 구성하는 tracrRNA 및 crRNA를 의미한다.

일 구현예로, tracrRNA의 서열은 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3' (서열번호 1) 또는 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUUUCCUCUCCAAUUCUGCACAA-3' (서열번호 2)일 수 있다. 일 구현예로, 상기 tracrRNA는 제1 영역, 제2 영역, 제3 영역, 및 제4 영역을 포함한다. 일 구현예로, 상기 tracrRNA는 5'말단에서 3'말단 방향으로, 제1 영역, 제2 영역, 제3 영역, 및 제4 영역이 순서대로 연결된 것이다.

일 구현예로, crRNA의 서열은 crRNA 반복 서열 및 스페이서 서열을 포함한다. 이때, 상기 crRNA 반복 서열은 5'-GAAUGAAGGAAUGCAAC-3' (서열번호 3) 또는 5'-GUUGCAGAACCCGAAUAGACGAAUGAAGGAAUGCAAC-3' (서열번호 4일) 수 있다. 상기 crRNA 반복 서열은 제5 영역, 및 제6 영역을 포함한다. 상기 스페이서 서열은 표적 서열에 따라 달라질 수 있으며, 일반적으로 10 내지 50개의 뉴클레오타이드를 포함한다. 일 구현예로, 상기 crRNA는 5'말단에서 3'말단 방향으로, 제5 영역, 제6 영역, 및 스페이서가 순서대로 연결된 것이다.

스캐폴드 영역 - 개괄

본 명세서에서 "스캐폴드 영역"이라고 쓰는 경우, 자연계에서 발견되는 가이드 RNA의 부분 중 스페이서를 제외한 나머지 부분을 통틀어 지칭한다. 구체적으로, 상기 스캐폴드 영역은 tracrRNA, 및 crRNA의 일부를 포함한다. 구체적으로, 상기 crRNA의 일부는 crRNA 반복 서열 부분일 수 있다. 상기 스캐폴드 영역은 일반적으로 Cas 단백질과 상호작용할 수 있는 부분으로 알려져있다. 본 명세서에서는 상기 스캐폴드 영역을 제1 영역 내지 제6 영역으로 나누어 서술하며, 각 영역에 대해서는 이하 더 자세히 설명한다.

스캐폴드 영역 1 - 제1 영역

본 명세서에서 "제1 영역"이라고 쓰는 경우, tracrRNA의 5'말단을 포함하는 영역을 지칭한다. 상기 제1 영역은 CRISPR/Cas12f1 복합체 내에서 Stem 구조를 형성하는 뉴클레오타이드를 포함하고, 이와 인접한 뉴클레오타이드를 포함할 수 있다.

상기 제1 영역은 Stem 1 부분(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021))을 포함한다. 상기 제1 영역은 상기 Stem 1 부분과 인접한 하나 이상의 뉴클레오타이드를 포함할 수 있다.

상기 제1 영역은 CRISPR/Cas12f1 복합체에서, Cas12f1 단백질과 상호작용하지 않는 disordered region을 포함한다.

일 구현예로, 상기 제1 영역은, 서열번호 1 또는 2로 표현되는 tracrRNA의 5'말단으로부터 1번째 뉴클레오타이드부터 11번째 뉴클레오타이드까지를 의미할 수 있다. 일 구현예로, 상기 제1 영역의 서열은 5'-CUUCACUGAUAAAGUGGAGAA-3' (서열번호 10)일 수 있다.

스캐폴드 영역 2 - 제2 영역

본 명세서에서 "제2 영역"이라고 쓰는 경우, tracrRNA 내 상기 제1 영역의 3'말단 방향에 위치한 영역을 지칭한다. 상기 제2 영역은 CRISPR/Cas12f1 복합체 내에서 Stem 구조를 형성하는 뉴클레오타이드를 포함하고, 이와 인접한 뉴클레오타이드를 포함할 수 있다. 이때, 상기 Stem 구조는 상기 제1 영역에 포함된 Stem과는 다른 것이다.

상기 제2 영역은 Stem 2 부분(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021))을 포함한다. 상기 제2 영역은 상기 Stem 2 부분과 인접한 하나 이상의 뉴클레오타이드를 포함할 수 있다.

상기 제2 영역은 CRISPR/Cas12f1 복합체에서, 이량체를 이루는 하나의 Cas12f1 단백질의 RuvC 도메인, 및/또는 이량체 이루는 다른 하나의 Cas12f1 단백질의 RuvC 도메인과 상호작용하는 하나 이상의 뉴클레오타이드를 포함할 수 있다. 상기 제2 영역은 CRISPR/Cas12f1 복합체에서, Cas12f1 단백질과 상호작용하지 않는 disordered region을 포함한다.

일 구현예로, 상기 제2 영역은 서열번호 1 또는 2로 표현되는 tracrRNA의 5'말단으로부터 22번째 뉴클레오타이드부터 72번째 뉴클레오타이드까지를 의미할 수 있다. 일 구현예로, 상기 제2 영역의 서열은 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3' (서열번호 11일) 수 있다.

스캐폴드 영역 3 - 제3 영역

본 명세서에서 "제3 영역"이라고 쓰는 경우, tracrRNA 내 상기 제2 영역의 3'말단 방향에 위치한 영역을 지칭한다. 상기 제3 영역은 CRISPR/Cas12f1 복합체 내에서 Stem 구조를 형성하는 뉴클레오타이드, 및 crRNA에 포함된 일부 뉴클레오타이드와 상보적인 결합을 형성하고 있는 뉴클레오타이드를 포함하고, 이와 인접한 뉴클레오타이드를 포함할 수 있다.

상기 제3 영역은 Stem 4 부분(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021)) 및 Stem 3-PK (R:AR-1) 부분 중 tracrRNA에 속한 뉴클레오타이드(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021))를 포함한다. 상기 제3 영역은 상기 Stem 4 부분 및/또는 Stem 3-PK (R:AR-1) 부분 중 tracrRNA에 속한 뉴클레오타이드와 인접한 하나 이상의 뉴클레오타이드를 포함할 수 있다.

상기 제3 영역은 CRISPR/Cas12f1 복합체에서, 이량체를 이루는 하나의 Cas12f1 단백질의 WED 도메인, 및/또는 RuvC 도메인과 상호작용하는 하나 이상의 뉴클레오타이드를 포함한다. 이때, 상기 뉴클레오타이드는 Stem 3-PK (R:AR-1) 부분 중 tracrRNA에 속한 뉴클레오타이드일 수 있다.

상기 제3 영역은 CRISPR/Cas12f1 복합체에서, 이량체를 이루는 하나의 Cas12f1 단백질의 RuvC 도메인 및/또는 이량체를 이루는 다른 하나의 Cas12f1 단백질의 REC 도메인과 상호작용하는 하나 이상의 뉴클레오타이드를 포함한다. 이때, 상기 뉴클레오타이드는 Stem 4 부분에 포함된 뉴클레오타이드일 수 있다.

상기 제3 영역은 crRNA의 제6 영역에 포함된 하나 이상의 뉴클레오타이드와 상보적으로 결합하는 하나 이상의 뉴클레오타이드를 포함한다.

일 구현예로, 상기 제3 영역은 서열번호 1 또는 2로 표현되는 tracrRNA의 5'말단으로부터 73번째 뉴클레오타이드부터 127번째 뉴클레오타이드까지를 의미할 수 있다. 일 구현예로, 상기 제3 영역의 서열은 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3' (서열번호 12일) 수 있다.

스캐폴드 영역 4 - 제4 영역

본 명세서에서 "제4 영역"이라고 쓰는 경우, tracrRNA의 제3 영역의 3'말단 방향에 위치한 영역을 지칭한다. 상기 제4 영역은 CRISPR/Cas12f1 복합체 내에서 crRNA에 포함된 일부 뉴클레오타이드와 상보적인 결합을 형성할 수 있는 뉴클레오타이드를 포함하고, 이와 인접한 뉴클레오타이드를 포함할 수 있다.

상기 제4 영역은 Stem 5 (R:AR-2) 중 tracrRNA에 속한 뉴클레오타이드를 포함한다(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021)). 상기 제4 영역은 상기 Stem 5 (R:AR-2) 중 tracrRNA에 속한 뉴클레오타이드와 인접한 하나 이상의 뉴클레오타이드를 포함할 수 있다.

상기 제4 영역은 CRISPR/Cas12f1 복합체에서, 이량체를 이루는 하나의 Cas12f1 단백질의 WED 도메인, 및/또는 ZF 도메인과 상호작용하는 하나 이상의 뉴클레오타이드를 포함할 수 있다. 이때 상기 뉴클레오타이드는 Stem 5 (R:AR-2) 중 tracrRNA에 속한 뉴클레오타이드일 수 있다.

상기 제4 영역은 crRNA의 제5 영역에 포함된 하나 이상의 뉴클레오타이드와 상보적으로 결합하는 하나 이상의 뉴클레오타이드를 포함할 수 있다. 상기 제4 영역은 CRISPR/Cas12f1 복합체에서, Cas12f1 단백질과 상호작용하지 않는 disordered region을 포함한다.

일 구현예로, 상기 제4 영역은 서열번호 1으로 표현되는 tracrRNA의 5'말단으로부터 128번째 뉴클레오타이드부터 140번째 뉴클레오타이드까지를 의미할 수 있다. 일 구현예로, 상기 제4 영역은 서열번호 2으로 표현되는 tracrRNA의 5'말단으로부터 128번째 뉴클레오타이드부터 162번째 뉴클레오타이드까지를 의미할 수 있다.

일 구현예로, 상기 제4 영역의 서열은 5'-AACAAAUUCAUUU-3' (서열번호 13) 또는 5'-AACAAAUUCAUUUUUCCUCUCCAAUUCUGCACAA-3' (서열번호 14일) 수 있다.

스캐폴드 영역 5 - 제5 영역

본 명세서에서 "제5 영역"이라고 쓰는 경우, crRNA 5'말단을 포함하는 영역을 지칭한다. 상기 제5 영역은 CRISPR/Cas12f1 복합체 내에서 상기 제4 영역의 하나 이상의 뉴클레오타이드와 상보적인 결합을 형성하는 뉴클레오타이드를 포함하며, 이와 인접한 임의의 뉴클레오타이드를 포함할 수 있다.

상기 제5 영역은 Stem 5 (R:AR-2) 부분 중 crRNA에 속한 뉴클레오타이드를 포함한다(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021)). 상기 제5 영역은 상기 Stem 5 (R:AR-2) 부분 중 crRNA에 속한 뉴클레오타이드와 인접한 하나 이상의 임의의 뉴클레오타이드를 포함할 수 있다.

상기 제5 영역은 CRISPR/Cas12f1 복합체에서, 이량체를 이루는 하나의 Cas12f1 단백질의 WED 도메인, REC 도메인 및/또는 ZF 도메인과 상호작용하는 하나 이상의 뉴클레오타이드를 포함할 수 있다. 이때 상기 뉴클레오타이드는 Stem 5 (R:AR-2) 중 crRNA에 속한 뉴클레오타이드일 수 있다.

상기 제5 영역은 상기 제4 영역에 포함된 하나 이상의 뉴클레오타이드와 상보적으로 결합하는 하나 이상의 뉴클레오타이드를 포함할 수 있다. 상기 제5 영역은 CRISPR/Cas12f1 복합체에서, Cas12f1 단백질과 상호작용하지 않는 disordered region을 포함한다.

일 구현예로, 상기 제5 영역은 서열번호 3로 표현되는 crRNA의 5'말단으로부터 1번째 뉴클레오타이드부터 10번째 뉴클레오타이드까지를 의미할 수 있다. 일 구현예로, 상기 제5 영역은 서열번호 4로 표현되는 crRNA의 5'말단으로부터 1번째 뉴클레오타이드부터 30번째 뉴클레오타이드까지를 의미할 수 있다. 일 구현예로, 상기 제5 영역의 서열은 5'-GAAUGAAGGA-3' (서열번호 15) 또는 5'-GUUGCAGAACCCGAAUAGACGAAUGAAGGA-3' (서열번호 16)일 수 있다.

스캐폴드 영역 6 - 제6 영역

본 명세서에서 "제6 영역"이라고 쓰는 경우, crRNA 내 상기 제5 영역의 3'말단 방향에 위치한 영역을 지칭한다. 상기 제6 영역은 CRISPR/Cas12f1 복합체 내에서 상기 제3 영역의 하나 이상의 뉴클레오타이드와 상보적인 결합을 형성하는 뉴클레오타이드를 포함하며, 이와 인접한 임의의 뉴클레오타이드를 포함할 수 있다.

상기 제6 영역은 PK (R:AR-1) 부분 중 crRNA에 속한 뉴클레오타이드를 포함한다(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021)). 상기 제6 영역은 상기 PK (R:AR-1) 부분 중 crRNA에 속한 뉴클레오타이드와 인접한 하나 이상의 임의의 뉴클레오타이드를 포함할 수 있다.

상기 제6 영역은 CRISPR/Cas12f1 복합체에서, 이량체를 이루는 하나의 Cas12f1 단백질의 WED 도메인, ZF 도메인 및/또는 RuvC 도메인과 상호작용하는 하나 이상의 뉴클레오타이드를 포함한다. 이때, 상기 뉴클레오타이드는 Stem 3-PK (R:AR-1) 부분 중 crRNA에 속한 뉴클레오타이드일 수 있다.

일 구현예로, 상기 제6 영역은 서열번호 3로 표현되는 crRNA의 5'말단으로부터 11번째 뉴클레오타이드부터 17번째 뉴클레오타이드까지를 의미할 수 있다. 일 구현예로, 상기 제6 영역은 서열번호 4로 표현되는 crRNA의 5'말단으로부터 31번째 뉴클레오타이드부터 37번째 뉴클레오타이드까지를 의미할 수 있다. 일 구현예로, 상기 제6 영역의 서열은 5'-AUGCAAC-3'일 수 있다.

스페이서

본 명세서에서 "스페이서"라 쓰는 경우, CRISPR/Cas12f1 시스템에서 표적 서열 부분과 혼성화되는 하나 이상의 뉴클레오타이드를 지칭한다. 상기 스페이서는, CRISPR/Cas12f1 시스템에서 가이드 RNA의 crRNA의 3'말단 부근의 10개 내지 50개의 연속된 뉴클레오타이드를 지칭한다. 상기 스페이서는 CRISPR/Cas12f1 시스템을 사용하여 편집하고자 하는 표적 핵산의 표적 서열에 대응하여 설계된다. 달리 표현하면, 상기 스페이서는 표적 핵산의 표적 서열에 따라 다양한 서열을 가질 수 있다.

엔지니어링 된 스캐폴드 영역 - 개괄

엔지니어링 된 스캐폴드 영역 개괄

본 명세서에서는 CRISPR/Cas12f1 시스템의 유전자 편집 효율 향상을 위해 도입할 수 있는 엔지니어링 된 스캐폴드 영역을 제공한다. 상기 엔지니어링 된 스캐폴드 영역은 전술한 U-rich tail과 시너지를 일으켜, 엔지니어링 된 Cas12f1 가이드 RNA가 사용된 CRISPR/Cas12f1 시스템의 유전자 편집 효율을 향상시킨다. 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 Cas12f1 가이드 RNA의 스캐폴드 영역(이하, 자연계에서 발견되는 스캐폴드 영역)에서 한 군데 이상이 변형되어, 이와는 다른 서열 및/또는 구조를 가지게 된 것이 특징이다.

이때, 상기 엔지니어링 된 스캐폴드 영역의 기능은 자연계에서 발견되는 스캐폴드 영역과 동일하거나, 유사한 기능을 가진다. 구체적으로, 상기 엔지니어링 된 스캐폴드 영역은 CRISPR/Cas12f1 복합체의 Cas12f1 단백질 이량체와 상호작용하는 기능을 가진다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 각 부분에 대응하는 영역을 포함한다. 구체적으로, 상기 엔지니어링 된 스캐폴드 영역은 제1 영역, 제2 영역, 제3 영역, 제4 영역, 제5 영역, 및 제6 영역을 포함하며, 이는 자연계에서 발견되는 스캐폴드 영역에 포함된 제1 영역 내지 제6 영역에 각각 대응된다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역 중 제1 영역 및/또는 제2 영역에 대응되는 영역을 포함하지 않을 수 있다.

싱글 가이드 RNA를 만들기 위한 변형

본 명세서에서 제공하는 엔지니어링 된 Cas12f1 가이드 RNA는 한 분자의 싱글 가이드 RNA일 수 있다. 따라서, 본 명세서에서 제공하는 엔지니어링 된 스캐폴드 영역은 각 영역 중 하나 이상이 변형된 것이고, 추가적으로 tracrRNA 제4 영역의 3'말단 및 crRNA 제5 영역의 5' 말단이 링커를 통해 연결된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역에서 한 군데 이상이 변형되고, 상기 제4 영역의 3'말단 및 상기 제5 영역의 5'말단이 링커를 통해 연결된 것일 수 있다. 예를 들어, 상기 링커는 5'-GAAA-3'일 수 있다.

엔지니어링 된 스캐폴드 영역 1 - 제1 영역 변형

제1 영역 변형 개괄

본 명세서에서 제공하는 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역에서 제1 영역이 변형된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 '변형된 제1 영역'을 포함할 수 있다. 이때, 상기 변형된 제1 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역에서 하나 이상의 뉴클레오타이드가 제거된 것이다. 이때, 상기 제거된 뉴클레오타이드는 CRISPR/Cas12f1 복합체에서 Stem 구조를 형성하는 영역에서 선택된 뉴클레오타이드이다.

일 구현예로, 상기 엔지니어링 된 Cas12f1 가이드 RNA에 포함된 엔지니어링 된 스캐폴드 영역은, 자연계에서 발견되는 스캐폴드 영역과 비교하여, 자연계에서 발견되는 제1 영역의 하나 이상의 뉴클레오타이드가 제거된 것일 수 있으며, 선택적으로, 상기 제1 영역 외 다른 부분도 변형된 것일 수 있다. 일 구현예로, 상기 제거된 뉴클레오타이드는 상기 자연계에서 발견되는 제1 영역 중 CRISPR/Cas12f1 복합체에서 Stem 구조를 형성하는 부분에 포함된 뉴클레오타이드일 수 있다. 일 구현예로, 상기 제거된 뉴클레오타이드는 상기 자연계에서 발견되는 제1 영역 중 Stem 1 (Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021))에 속하는 뉴클레오타이드일 수 있다. 일 구현예로, 상기 제거된 뉴클레오타이드는 상기 자연계에서 발견되는 제1 영역 중 CRISPR/Cas12f1 복합체에서 Cas12f1 단백질과 상호작용하지 않는 뉴클레오타이드일 수 있다.

일 구현예로, 상기 변형된 제1 영역은 3'말단 방향에 5'-A-3' 서열을 포함하는 것을 특징으로 한다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역 중 제1 영역이 제거된 것일 수 있다. 달리 표현해, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역 중 제1 영역과 대응되는 영역을 포함하지 않을 수 있다.

제1 영역 변형 내용 1 - 일부 뉴클레오타이드 제거

상기 엔지니어링 된 스캐폴드 영역의 제1 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역에서 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역의 변형된 제1 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역에서 5'말단의 1개 내지 20개의 뉴클레오타이드가 제거된 것일 수 있다. 일 구현예로, 상기 변형된 제1 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역에서 5'말단의 1개, 2개, 3개, 4개, 5개, 6개, 7개, 8개, 9개, 10개, 11개, 12개, 13개, 14개, 15개, 16개, 17개, 18개, 19개, 또는 20개의 연속된 뉴클레오타이드가 제거된 것일 수 있다. 일 구현예로, 상기 변형된 제1 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역에서 5'말단에서, 바로 이전 문장에서 선택된 두 개의 수치범위 내 연속된 뉴클레오타이드가 제거된 것일 수 있다. 예를 들어, 자연계에서 발견되는 스캐폴드 영역의 제1 영역에서 5'말단의 1개 내지 3개의 연속된 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제1 영역은 적어도 하나의 뉴클레오타이드를 포함하며, 이는 5'-A-3'일 수 있다.

제1 영역 변형 내용 2 - 제1 영역 제거

본 명세서에서 제공하는 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역 중 제1 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역과 대응되는 영역을 포함하지 않을 수 있다.

제1 영역이 변형된 엔지니어링 된 스캐폴드 서열 예시

일 구현예로, 상기 변형된 제1 영역의 서열은 5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 및 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27)에서 선택된 것일 수 있다.

일 구현예로, 제1 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 서열번호 17 내지 27으로 이루어진 군에서 선택된 서열,

서열번호 11,

서열번호 12, 및

서열번호 13이 연결된 서열; 및

5'말단에서 3'말단 방향으로, 서열번호 15 및 5'-AUGCAAC-3'가 연결된 서열.

5'-ACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 119), 5'-AACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 120), 5'-GAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 121), 5'-AGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 122), 5'-GAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 123), 5'-GGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 124), 5'-UGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 125), 5'-GUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 126), 5'-AGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 127), 5'-AAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 128), 5'-AAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 129), 5'-UAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 130), 5'-AUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 131), 5'-GAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 132), 5'-UGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 133), 5'-CUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 134), 5'-ACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 135), 5'-CACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 136), 5'-UCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 137), 및 5'-UUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 138)로 이루어진 군에서 선택된 서열; 및

5'-GAAUGAAGGAAUGCAAC-3'(서열번호 3).

5'말단에서 3'말단 방향으로,

5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 및 서열번호 17 내지 27으로 이루어진 군에서 선택된 서열,

서열번호 11,

서열번호 12, 및

서열번호 14가 연결된 서열; 및

5'말단에서 3'말단 방향으로, 서열번호 16 및 5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제1 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'에서 3'말단 방향으로,

5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 및 서열번호 17 내지 27로 이루어진 군에서 선택된 서열,

서열번호 11,

서열번호 12,

서열번호 13,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

일 구현예로, 제1 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'-ACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 168), 5'-AACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 169), 5'-GAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 170), 5'-AGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 171), 5'-GAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 172), 5'-GGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 173), 5'-UGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 174), 5'-GUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 175), 5'-AGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 176), 5'-AAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 177), 5'-AAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 178), 5'-UAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 179), 5'-AUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 180), 5'-GAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 181), 5'-UGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 182), 5'-CUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 183), 5'-ACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 184), 5'-CACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 185), 5'-UCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 186), 및 5'-UUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 187)에서 선택된 서열일 수 있다.

제1 영역이 제거된 엔지니어링 된 스캐폴드 서열 예시

일 구현예로, 제1 영역이 제거된 엔지니어링 된 스캐폴드 영역의 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 11,

서열번호 12, 및

서열번호 13이 연결된 서열; 및

5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 379); 및

서열번호 3.

5'말단에서 3'말단 방향으로,

서열번호 11,

서열번호 12, 및

서열번호 14가 연결된 서열; 및

일 구현예로, 제1 영역이 제거된 엔지니어링 된 스캐폴드 영역의 서열은 5'에서 3'말단 방향으로,

서열번호 11,

서열번호 12,

서열번호 13,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

일 구현예로, 제1 영역이 제거된 엔지니어링 된 스캐폴드 영역의 서열은 5'CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 487)일 수 있다.

엔지니어링 된 스캐폴드 영역 2 - 제2 영역 변형

제2 영역 변형 개괄

본 명세서에서 제공하는 엔지니어링 돤 가이드 RNA에 포함된 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역에서 제2 영역이 변형된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 '변형된 제2 영역'을 포함할 수 있다. 이때, 상기 변형된 제2 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서 하나 이상의 뉴클레오타이드가 제거된 것이다. 이때, 상기 제거된 뉴클레오타이드는 CRISPR/Cas12f1 복합체에서 Stem 구조를 형성하는 영역에서 선택된 뉴클레오타이드이다.

일 구현예로, 상기 엔지니어링 된 Cas12f1 가이드 RNA에 포함된 엔지니어링 된 스캐폴드 영역은, 자연계에서 발견되는 스캐폴드 영역과 비교하여, 자연계에서 발견되는 제2 영역의 하나 이상의 뉴클레오타이드가 제거된 것일 수 있으며, 선택적으로, 상기 제2 영역 외 다른 부분도 변형된 것일 수 있다. 일 구현예로, 상기 뉴클레오타이드의 제거는 상기 자연계에서 발견되는 제2 영역 중 Stem 구조를 형성하는 부분에서 일어난 것이고, 뉴클레오타이드가 상보적인 페어 단위로 제거된 것일 수 있다. 일 구현예로, 상기 제거된 뉴클레오타이드는 상기 자연계에서 발견되는 제2 영역 중 CRISPR/Cas12f1 복합체에서 Stem 구조를 형성하는 부분에 포함된 뉴클레오타이드일 수 있다.

일 구현예로, 상기 제거된 뉴클레오타이드는 상기 자연계에서 발견되는 제2 영역 중 Stem 2 (Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021))에 속하는 뉴클레오타이드일 수 있다. 일 구현예로, 상기 제거된 뉴클레오타이드는 상기 자연계에서 발견되는 제2 영역 중 CRISPR/Cas12f1 복합체에서 Cas12f1 단백질과 상호작용하지 않는 뉴클레오타이드일 수 있다.

일 구현예로, 상기 변형된 제2 영역은 3'말단 방향에 5'-G-3' 서열을 가지는 것을 특징으로 한다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역을 자연계에서 발견되는 스캐폴드 영역 중 제2 영역이 제거된 것일 수 있다. 달리 표현해, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역 중 제2 영역과 대응되는 영역을 포함하지 않을 수 있다.

제2 영역 변형 내용 1 - 일부 뉴클레오타이드 제거

상기 엔지니어링 된 스캐폴드 영역의 제2 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역의 변형된 제2 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서 연속 또는 비연속적으로1개, 2개, 3개, 4개, 5 개, 6 개, 7 개, 8 개, 9 개, 10 개, 11 개, 12 개, 13 개, 14 개, 15 개, 16 개, 17 개, 18 개, 19 개, 20 개, 21 개, 22 개, 23 개, 24 개, 25 개, 26 개, 27 개, 28 개, 29 개, 30 개, 31 개, 32 개, 33 개, 34 개, 35 개, 36 개, 37 개, 38 개, 39 개, 40 개, 41 개, 42 개, 43 개, 44 개, 45 개, 46 개, 47 개, 48 개, 49 개, 50 개 또는 51개의 뉴클레오타이드가 제거된 것일 수 있다. 일 구현예로, 상기 변형된 제2 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서, 서열번호 11 서열 기준으로, 5'말단으로부터 1번째 내지 22번째 뉴클레오타이드, 및/또는 27번째 내지 51번째 뉴클레오타이드 중 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다. 일 구현예로, 상기 변형된 제2 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서, 서열번호 11 서열 기준으로, 5'말단으로부터 1번째 내지 22번째 뉴클레오타이드, 및/또는 27번째 내지 51번째 뉴클레오타이드 중 하나 이상의 뉴클레오타이드가 제거되고, 23번째 내지 26번째 뉴클레오타이드가 다른 것으로 치환된 것일 수 있다. 일 구현예로, 상기 변형된 제2 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서, 서열번호 11 서열 기준으로, 5'말단으로부터 1번째 내지 22번째 뉴클레오타이드 중 1개, 2개, 3개, 4개, 5개, 6개, 7개, 8개, 9개, 10개, 11개, 12개, 13개, 14개, 15개, 16개, 17개, 18개, 19개, 20개, 21개, 또는 22개의 연속된 뉴클레오타이드가 제거된 것일 수 있다. 일 구현예로, 상기 변형된 제2 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서, 서열번호 11 서열 기준으로, 5'말단으로부터 27번째 내지 51번째 뉴클레오타이드 중 1개, 2개, 3개, 4개, 5개, 6개, 7개, 8개, 9개, 10개, 11개, 12개, 13개, 14개, 15개, 16개, 17개, 18개, 19개, 20개, 21개, 22개, 23개, 24개, 또는 25개의 연속된 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제2 영역의 서열은 적어도 5'-G-3'을 포함하는 것을 특징으로 한다.

제2 영역 변형 내용 2 - 상보적인 페어(complementary pair) 단위 제거

상기 제2 영역의 변형은 Stem 구조를 형성하는 부분에 포함된 서로 상보적인 결합을 하는 한 쌍 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제2 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서, 서열번호 11 서열 기준으로, 5'말단으로부터 1번째 내지 22번째 뉴클레오타이드, 및 27번째 내지 50번째 뉴클레오타이드 중 CRISPR/Cas12f1 복합체에서 상보적인 페어를 이루는 1쌍 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제2 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서, 서열번호 11 서열 기준으로, 5'말단으로부터 1번째 내지 22번째 뉴클레오타이드, 및 27번째 내지 50번째 뉴클레오타이드 중 CRISPR/Cas12f1 복합체에서 상보적인 페어를 이루는 1쌍 이상의 뉴클레오타이드 및/또는 상보적인 페어를 이루지 않는 1개 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제2 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서, 서열번호 11 서열 기준으로, 5'말단으로부터 1번째 내지 22번째 뉴클레오타이드, 및 27번째 내지 50번째 뉴클레오타이드 중 CRISPR/Cas12f1 복합체에서 상보적인 페어를 이루는 1쌍 이상의 뉴클레오타이드 및/또는 미스매치인 1쌍 이상의 뉴클레오타이드가 제거된 것일 수 있다.

제2 영역 변형 내용 3 - 제2 영역 제거

본 명세서에서 제공하는 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역 중 제2 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역과 대응되는 영역이 없는 것일 수 있다.

제2 영역이 변형된 엔지니어링 된 스캐폴드 서열 예시

일 구현예로, 상기 변형된 제2 영역의 서열은 5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361) 및 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362)로 이루어진 군에서 선택된 서열일 수 있다.

일 구현예로, 제2 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 10,

5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 및 서열번호 342 내지 362로 이루어진 군에서 선택된 서열,

서열번호 12, 및

서열번호 13이 연결된 서열; 및

5'-CUUCACUGAUAAAGUGGAGAAGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 381), 5'-CUUCACUGAUAAAGUGGAGAAUUAGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 382), 5'-CUUCACUGAUAAAGUGGAGAACUUAGGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 383), 5'-CUUCACUGAUAAAGUGGAGAACUUAGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 384), 5'-CUUCACUGAUAAAGUGGAGAACCUUAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 385), 5'-CUUCACUGAUAAAGUGGAGAACCGUUAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 386), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUAGGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 387), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUUAGAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 388), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUUUAGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 389), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCUUAGGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 390), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCAUUAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 391), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACUUAGGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 392), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACUUAGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 393), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCUUAGGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 394), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAUUAGUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 395), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAUUAGUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 396), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAUUAGCUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 397), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 398), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 399), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 400), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 401), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 402), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 403), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 404), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 405), 및 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCUUAGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 406)로 이루어진 군에서 선택된 서열; 및

서열번호 3.

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 12,

서열번호 14가 연결된 서열; 및

일 구현예로, 제2 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로, 서열번호 10, 5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 및 서열번호 342 내지 362로 이루어진 군에서 선택된 서열, 서열번호 12, 서열번호 13, 링커, 서열번호 15, 및 5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

일 구현예로, 제2 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'-CUUCACUGAUAAAGUGGAGAAGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 408), 5'-CUUCACUGAUAAAGUGGAGAAUUAGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 409), 5'-CUUCACUGAUAAAGUGGAGAACUUAGGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 410), 5'-CUUCACUGAUAAAGUGGAGAACUUAGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 411), 5'-CUUCACUGAUAAAGUGGAGAACCUUAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 412), 5'-CUUCACUGAUAAAGUGGAGAACCGUUAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 413), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUAGGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 414), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUUAGAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 415), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUUUAGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 416), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCUUAGGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 417), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCAUUAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 418), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACUUAGGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 419), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACUUAGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 420), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCUUAGGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 421), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAUUAGUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 422), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAUUAGUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 423), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAUUAGCUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 424), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 425), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 426), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 427), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 428), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 429), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 430), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 431), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 432), 및 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCUUAGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 433)로 이루어진 군에서 선택된 서열일 수 있다.

제2 영역이 제거된 엔지니어링 된 스캐폴드 서열 예시

일 구현예로, 제2 영역이 제거된 엔지니어링 된 스캐폴드 영역의 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 12, 및

서열번호 13이 연결된 서열; 및

5'-CUUCACUGAUAAAGUGGAGAAGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호380); 및

서열번호 3.

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 12,

서열번호 14이 연결된 서열; 및

일 구현예로, 제2 영역이 제거된 엔지니어링 된 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로, 서열번호 10, 서열번호 12, 서열번호 13, 링커, 서열번호 15, 및 5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

일 구현예로, 제2 영역이 제거된 엔지니어링 된 스캐폴드 영역의 서열은 5'-CUUCACUGAUAAAGUGGAGAAGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 380)일 수 있다.

엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형

제3 영역 변형 개괄

본 명세서에서 제공하는 엔지니어링 돤 가이드 RNA에 포함된 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역에서 제3 영역이 변형된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역을 포함할 수 있다. 이때, 상기 변형된 제3 영역은 자연계에서 발견되는 스캐폴드 영역의 제3 영역에서 하나 이상의 뉴클레오타이드가 제거된 것이다. 이때, 상기 제거된 뉴클레오타이드는 CRISPR/Cas12f1 복합체에서 Stem 구조를 형성하는 영역에서 선택된 뉴클레오타이드이다.

일 구현예로, 상기 엔지니어링 된 Cas12f1 가이드 RNA에 포함된 엔지니어링 된 스캐폴드 영역은, 자연계에서 발견되는 스캐폴드 영역 중 제3 영역에 포함된 하나 이상의 뉴클레오타이드가 제거된 것을 포함할 수 있다. 일 구현예로, 상기 뉴클레오타이드의 제거는 상기 자연계에서 발견되는 제3 영역 중 Stem 구조를 형성하는 부분에서 일어난 것이고, 뉴클레오타이드가 베이스 페어 단위로 제거된 것일 수 있다. 일 구현예로, 상기 제거된 뉴클레오타이드는 상기 자연계에서 발견되는 제3 영역 중 CRISPR/Cas12f1 복합체에서 Stem 구조를 형성하는 부분에 포함된 뉴클레오타이드일 수 있다.

일 구현예로, 상기 제거된 뉴클레오타이드는 상기 자연계에서 발견되는 제3 영역 중 Stem 4 (Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021))에 속하는 뉴클레오타이드일 수 있다.

일 구현예로, 상기 변형된 제3 영역은 5'-GCUGCUUGCAUCAGCCUAAUGUCGAG-3', 5'-UUCG-3', 및 5'-CUCGA-3' 서열을 가지는 것을 특징으로 한다.

제3 영역 변형 내용 1 - 일부 뉴클레오타이드 제거

상기 엔지니어링 된 스캐폴드 영역의 제3 영역은 자연계에서 발견되는 스캐폴드 영역의 제3 영역에서 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역의 변형된 제3 영역은 자연계에서 발견되는 스캐폴드 영역의 제3 영역에서 연속적으로 또는 비연속적으로1개, 2개, 3개, 4개, 5개, 6개, 7개, 8개, 9개, 10개, 11개, 12개, 13개, 14개, 15개, 16개, 17개, 18개, 19개 또는 20개의 뉴클레오타이드가 제거된 것일 수 있다. 일 구현예로, 상기 변형된 제3 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제3 영역에서, 서열번호 12 서열 기준, 5'말단으로부터 27번째 내지 36번째 뉴클레오타이드, 및/또는 41번째 내지 50번째 뉴클레오타이드 중 적어도 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다. 일 구현예로, 상기 변형된 제2 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서, 서열번호 12 서열 기준, 5'말단으로부터 27번째 내지 36번째 뉴클레오타이드 중 1개, 2개, 3개, 4개, 5개, 6개, 7개, 8개, 9개, 또는 10개의 연속된 뉴클레오타이드가 제거된 것일 수 있다. 일 구현예로, 상기 변형된 제2 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서, 서열번호 12 서열 기준, 5'말단으로부터 41번째 내지 50번째 뉴클레오타이드 중 1개, 2개, 3개, 4개, 5개, 6개, 7개, 8개, 9개, 또는 10개의 연속된 뉴클레오타이드가 제거된 것일 수 있다.

제3 영역 변형 내용 2 - 상보적인 페어 단위 제거

상기 제3 영역의 변형은 Stem 구조를 형성하는 부분에 포함된 서로 상보적인 결합을 하는 한 쌍 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제3 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제3 영역에서, 서열번호 12 서열 기준, 5'말단으로부터 27번째 내지 36번째 뉴클레오타이드, 및 41번째 내지 50번째 뉴클레오타이드 중 CRISPR/Cas12f1 복합체에서 상보적인 페어를 이루는 1쌍 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제3 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제3 영역에서, 서열번호 12 서열 기준, 5'말단으로부터 27번째 내지 36번째 뉴클레오타이드, 및 41번째 내지 50번째 뉴클레오타이드 중 CRISPR/Cas12f1 복합체에서 상보적인 페어를 이루는 1쌍 이상의 뉴클레오타이드 및/또는 상보적인 페어를 이루지 않는 1개 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제3 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제3 영역에서, 서열번호 12 서열 기준, 5'말단으로부터 27번째 내지 36번째 뉴클레오타이드, 및 41번째 내지 50번째 뉴클레오타이드 중 CRISPR/Cas12f1 복합체에서 상보적인 페어를 이루는 1쌍 이상의 뉴클레오타이드 및/또는 미스매치인 1쌍 이상의 뉴클레오타이드가 제거된 것일 수 있다.

제3 영역이 변형된 엔지니어링 된 스캐폴드 서열 예시

일 구현예로, 상기 변형된 제3 영역의 서열은 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 434), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUUCGAAAGUAACCCUCGA-3'(서열번호 435), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUCGAAGUAACCCUCGA-3'(서열번호 436), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUCUUCGGAGUAACCCUCGA-3'(서열번호 437), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCGAGUAACCCUCGA-3'(서열번호 438), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUCGGUAACCCUCGA-3'(서열번호 439), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGUUCGUAACCCUCGA-3'(서열번호 440), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUUCGAACCCUCGA-3'(서열번호 441), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGACCCUCGA-3'(서열번호 442), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGCCCUCGA-3'(서열번호 443), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCCUCGA-3'(서열번호 444), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCUCGA-3'(서열번호 445), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAUUCGCCUCGA-3'(서열번호 446), 및 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGUUCGCUCGA-3'(서열번호 447)로 이루어진 군에서 선택된 서열일 수 있다.

일 구현예로, 제3 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 11,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 13이 연결된 서열; 및

5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUUCGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 448), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUCGAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 449), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUCUUCGGAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 450), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCGAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 451), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUCGGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 452), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGUUCGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 453), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUUCGAACCCUCGAAACAAAUUCAUUU-3'(서열번호 454), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGACCCUCGAAACAAAUUCAUUU-3'(서열번호 455), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGCCCUCGAAACAAAUUCAUUU-3'(서열번호 456), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCCUCGAAACAAAUUCAUUU-3'(서열번호 457), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCUCGAAACAAAUUCAUUU-3'(서열번호 458), 및 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAUUCGCCUCGAAACAAAUUCAUUU-3'(서열번호 459), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGUUCGCUCGAAACAAAUUCAUUU-3'(서열번호 460)로 이루어진 군에서 선택된 서열; 및

서열번호 3.

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 11,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 14가 연결된 서열; 및

일 구현예로, 제2 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로, 서열번호 10, 서열번호 11, 서열번호 12, 서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 링커, 서열번호 15, 및 5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

일 구현예로, 제3 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUUCGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 462), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUCGAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 463), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUCUUCGGAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 464), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCGAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 465), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUCGGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 466), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGUUCGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 467), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUUCGAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 468), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 469), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGCCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 470), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 471), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 472), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAUUCGCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 473), 및 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGUUCGCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 474)로 이루어진 군에서 선택된 서열일 수 있다.

엔지니어링 된 스캐폴드 영역 4 - 제4 영역 및 제5 영역 변형

제4 영역 및 제5 영역 변형 개괄

본 명세서에서 제공하는 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역에서 제4 영역 및 제5 영역이 변형된 것일 수 있다. 상기 제4 영역 및 제5 영역은, 각각 tracrRNA의 일부 및 crRNA의 일부에 해당하는 영역으로, CRISPR/Cas12f1 복합체 내에서 서로 혼성화되어 Stem을 구성하는 부분을 포함하므로, 해당 부분이 같이 변형되어 엔지니어링 된 스캐폴드 영역을 구성할 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제4 영역 및/또는 변형된 제5 영역을 포함할 수 있다.

변형된 제4 영역은 자연계에서 발견되는 스캐폴드 영역의 제4 영역에서 하나 이상의 뉴클레오타이드가 제거된 것을 특징으로 한다. 변형된 제5 영역은 자연계에서 발견되는 스캐폴드 영역의 제5 영역에서 하나 이상의 뉴클레오타이드가 제거된 것을 특징으로 한다.

일 구현예로, 상기 엔지니어링 된 Cas12f1 가이드 RNA에 포함된 엔지니어링 된 스캐폴드 영역은, 자연계에서 발견되는 스캐폴드 영역 중 제4 영역 및/또는 제5 영역의 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제4 영역은 5'말단 방향에 5'-AACAAA-3' 서열을 가진다. 일 구현예로, 상기 변형된 제5 영역은 3'말단 방향에 5'-GGA-3' 서열을 가진다.

제4 영역 및 제5 영역 변형 내용 1 - 일부 뉴클레오타이드 제거

상기 엔지니어링 된 스캐폴드 영역의 제4 영역은 자연계에서 발견되는 스캐폴드 영역 중 제4 영역에서 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다. 상기 엔지니어링 된 스캐폴드 영역의 제5 영역은 자연계에서 발견되는 스캐폴드 영역 중 제5 영역에서 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역의 변형된 제4 영역은 자연계에서 발견되는 스캐폴드 영역의 제4 영역에서 연속 또는 비연속적으로1개,2 개,3 개,4 개,5 개,6 개,7 개,8 개,9 개,10 개,11 개,12 개,13 개,14 개,15 개,16 개,17 개,18 개,19 개,20 개,21 개,22 개,23 개,24 개,25 개,26 개,27 개 또는 28개의 뉴클레오타이드가 제거된 것일 수 있다. 일 구현예로, 상기 변형된 제4 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제4 영역에서, 서열번호 13 서열 기준, 5'말단으로부터 7번째 내지 13번째 뉴클레오타이드 중 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다. 일 구현예로, 상기 변형된 제4 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제4 영역에서, 서열번호 14 서열 기준, 5'말단으로부터 7번째 내지 34번째 뉴클레오타이드 중 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제4 영역의 서열은 적어도 5'-AACAAA-3'을 포함하는 것을 특징으로 한다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역의 변형된 제5 영역은 자연계에서 발견되는 스캐폴드 영역의 제5 영역에서 1개 내지 7개의 뉴클레오타이드가 제거된 것일 수 있다. 일 구현예로, 상기 엔지니어링 된 스캐폴드 영역의 변형된 제5 영역은 자연계에서 발견되는 스캐폴드 영역의 제5 영역에서 연속 또는 비연속적으로 1개, 2개, 3개, 4개, 5개, 6개, 7개, 8개, 9개, 10개, 11개, 12개, 13개, 14개, 15개, 16개, 17개, 18개, 19개, 20개, 21개, 22개, 23개, 24개, 25개, 26개 또는 27개의 뉴클레오타이드가 제거된 것일 수 있다. 일 구현예로, 상기 변형된 제5 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제5 영역에서, 서열번호 15 서열 기준, 5'말단으로부터 1번째 내지 7번째 뉴클레오타이드 중 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다. 일 구현예로, 상기 변형된 제5 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제5 영역에서, 서열번호 16 서열 기준, 5'말단으로부터 1번째 내지 27번째 뉴클레오타이드 중 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제5 영역의 서열은 적어도 5'-GGA-3'을 포함하는 것을 특징으로 한다.

제4 영역 및 제5 영역 변형 내용 3 - 상보적인 페어 단위 제거

상기 제4 영역 및 제5 영역은 CRISPR/Cas12 복합체 내에서 서로 상보적으로 결합하여 Stem을 이루는 것으로 알려져 있다. 전술한 제4 영역 및 제5 영역의 변형은 이러한 Stem을 구성하는 하나 이상의 뉴클레오타이드를 대상으로 하므로, 상기 제4 영역 및 제5 영역의 변형은 Stem을 구성하는 뉴클레오타이드들을 상보적인 페어 단위로 제거하는 것일 수 있다.

일 구현예로, 상기 변형된 제4 영역 및 제5 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제4 영역 및 제5 영역에서, 서열번호 13 서열 기준, 7번째 내지 13번째 뉴클레오타이드 및, 서열번호 15 서열 기준, 1번째 내지 7번째 뉴클레오타이드 중 CRISPR/Cas12f1 복합체에서 상보적인 페어를 이루는 1쌍 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제4 영역 및 제5 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제4 영역 및 제5 영역에서, 서열번호 13 서열 기준, 7번째 내지 13번째 뉴클레오타이드 및, 서열번호 15 서열 기준, 1번째 내지 7번째 뉴클레오타이드 중 CRISPR/Cas12f1 복합체에서 상보적인 페어를 이루는 1쌍 이상의 뉴클레오타이드 및/또는 상보적인 페어를 이루지 않는 1개 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제4 영역 및 제5 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제4 영역 및 제5 영역에서, 서열번호 13 서열 기준, 7번째 내지 13번째 뉴클레오타이드 및, 서열번호 15 서열 기준, 1번째 내지 7번째 뉴클레오타이드 중 CRISPR/Cas12f1 복합체에서 상보적인 페어를 이루는 1쌍 이상의 뉴클레오타이드 및/또는 미스매치인 1쌍 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제4 영역 및 제5 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제4 영역 및 제5 영역에서, 서열번호 14 서열 기준, 7번째 내지 34번째 뉴클레오타이드 및, 서열번호 16 서열 기준, 1번째 내지 27번째 뉴클레오타이드 중 CRISPR/Cas12f1 복합체에서 상보적인 페어를 이루는 1쌍 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제4 영역 및 제5 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제4 영역 및 제5 영역에서, 서열번호 14 서열 기준, 7번째 내지 34번째 뉴클레오타이드 및, 서열번호 16 서열 기준, 1번째 내지 27번째 뉴클레오타이드 중 CRISPR/Cas12f1 복합체에서 상보적인 페어를 이루는 1쌍 이상의 뉴클레오타이드 및/또는 상보적인 페어를 이루지 않는 1개 이상의 뉴클레오타이드가 제거된 것일 수 있다.

일 구현예로, 상기 변형된 제4 영역 및 제5 영역은 상기 자연계에서 발견되는 스캐폴드 영역의 제4 영역 및 제5 영역에서, 서열번호 14 서열 기준, 7번째 내지 34번째 뉴클레오타이드 및, 서열번호 16 서열 기준, 1번째 내지 27번째 뉴클레오타이드 중 CRISPR/Cas12f1 복합체에서 상보적인 페어를 이루는 1쌍 이상의 뉴클레오타이드 및/또는 미스매치인 1쌍 이상의 뉴클레오타이드가 제거된 것일 수 있다.

변형된 제4 영역 및 제5 영역 서열 예시

일 구현예로, 상기 변형된 제4 영역의 서열은 5'-AACAAA-3', 5'-AACAAAU-3', 5'-AACAAAUU-3', 5'-AACAAAUUC-3', 5'-AACAAAUUCA-3'(서열번호 67), 5'-AACAAAUUCAU-3'(서열번호 68), 및 5'-AACAAAUUCAUU-3'(서열번호 69)로 이루어진 군에서 선택된 것일 수 있다.

일 구현예로, 상기 변형된 제4 영역의 서열은 5'-AACAAA-3', 5'-AACAAAU-3', 5'-AACAAAUU-3', 5'-AACAAAUUC-3', 5'-AACAAAUUCA-3'(서열번호 67), 5'-AACAAAUUCAU-3'(서열번호 68), 5'-AACAAAUUCAUU-3'(서열번호 69), 5'-AACAAAUUCAUUU-3'(서열번호 70), 5'-AACAAAUUCAUUUU-3'(서열번호 71), 5'-AACAAAUUCAUUUUU-3'(서열번호 72), 5'-AACAAAUUCAUUUUUC-3'(서열번호 73), 5'-AACAAAUUCAUUUUUCC-3'(서열번호 74), 5'-AACAAAUUCAUUUUUCCU-3'(서열번호 75), 5'-AACAAAUUCAUUUUUCCUC-3'(서열번호 76), 5'-AACAAAUUCAUUUUUCCUCU-3'(서열번호 77), 5'-AACAAAUUCAUUUUUCCUCUC-3'(서열번호 78), 5'-AACAAAUUCAUUUUUCCUCUCC-3'(서열번호 79), 5'-AACAAAUUCAUUUUUCCUCUCCA-3'(서열번호 80), 5'-AACAAAUUCAUUUUUCCUCUCCAA-3'(서열번호 81), 5'-AACAAAUUCAUUUUUCCUCUCCAAU-3'(서열번호 82), 5'-AACAAAUUCAUUUUUCCUCUCCAAUU-3'(서열번호 83), 5'-AACAAAUUCAUUUUUCCUCUCCAAUUC-3'(서열번호 84), 5'-AACAAAUUCAUUUUUCCUCUCCAAUUCU-3'(서열번호 85), 5'-AACAAAUUCAUUUUUCCUCUCCAAUUCUG-3'(서열번호 86), 5'-AACAAAUUCAUUUUUCCUCUCCAAUUCUGC-3'(서열번호 87), 5'-AACAAAUUCAUUUUUCCUCUCCAAUUCUGCA-3'(서열번호 88), 5'-AAACAAAUUCAUUUUUCCUCUCCAAUUCUGCAC-3'(서열번호 89), 및 5'-AACAAAUUCAUUUUUCCUCUCCAAUUCUGCACA-3'(서열번호 90)로 이루어진 군에서 선택된 것일 수 있다.

일 구현예로, 상기 변형된 제5 영역의 서열은 5'-GGA-3', 5'-AGGA-3', 5'-AAGGA-3', 5'-GAAGGA-3', 5'-UGAAGGA-3', 5'-AUGAAGGA-3', 및 5'-AAUGAAGGA-3'에서 선택된 것일 수 있다.

일 구현예로, 상기 변형된 제5 영역의 서열은 5'-GGA-3', 5'-AGGA-3', 5'-AAGGA-3', 5'-GAAGGA-3', 5'-UGAAGGA-3', 5'-AUGAAGGA-3', 5'-AAUGAAGGA-3', 5'-GAAUGAAGGA-3'(서열번호 91), 5'-CGAAUGAAGGA-3'(서열번호 92), 5'-ACGAAUGAAGGA-3'(서열번호 93), 5'-GACGAAUGAAGGA-3'(서열번호 94), 5'-AGACGAAUGAAGGA-3'(서열번호 95), 5'-UAGACGAAUGAAGGA-3'(서열번호 96), 5'-AUAGACGAAUGAAGGA-3'(서열번호 97), 5'-AAUAGACGAAUGAAGGA-3'(서열번호 98), 5'-GAAUAGACGAAUGAAGGA-3'(서열번호 99), 5'-CGAAUAGACGAAUGAAGGA-3'(서열번호 100), 5'-CCGAAUAGACGAAUGAAGGA-3'(서열번호 101), 5'-CCCGAAUAGACGAAUGAAGGA-3'(서열번호 102), 5'-ACCCGAAUAGACGAAUGAAGGA-3'(서열번호 103), 5'-AACCCGAAUAGACGAAUGAAGGA-3'(서열번호 104), 5'-GAACCCGAAUAGACGAAUGAAGGA-3'(서열번호 105), 5'-AGAACCCGAAUAGACGAAUGAAGGA-3'(서열번호 106), 5'-CAGAACCCGAAUAGACGAAUGAAGGA-3'(서열번호 107), 5'-GCAGAACCCGAAUAGACGAAUGAAGGA-3'(서열번호 108), 5'-UGCAGAACCCGAAUAGACGAAUGAAGGA-3'(서열번호 109), 및 5'-UUGCAGAACCCGAAUAGACGAAUGAAGGA-3'(서열번호 110)로 이루어진 군에서 선택된 것일 수 있다.

일 구현예로, 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 11,

서열번호 12, 및

5'-AACAAA-3', 5'-AACAAAU-3', 5'-AACAAAUU-3', 5'-AACAAAUUC-3',서열번호 67 내지 69로 이루어진 군에서 선택된 서열이 연결된 서열; 및

5'말단에서 3'말단 방향으로,

5'-GGA-3', 5'-AGGA-3', 5'-AAGGA-3', 5'-GAAGGA-3', 5'-UGAAGGA-3', 5'-AUGAAGGA-3', 및 5'-AAUGAAGGA-3'로 이루어진 군에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 서열.

5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAA-3'(서열번호 150), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAU-3'(서열번호 151), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUU-3'(서열번호 152), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUC-3'(서열번호 153), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCA-3'(서열번호 154), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAU-3'(서열번호 155), 및 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUU-3'(서열번호 156)로 이루어진 군에서 선택된 서열; 및

5'-GGAAUGCAAC-3', 5'-AGGAAUGCAAC-3', 5'-AAGGAAUGCAAC-3', 5'-GAAGGAAUGCAAC-3', 5'-UGAAGGAAUGCAAC-3', 5'-AUGAAGGAAUGCAAC-3', 및 5'-AAUGAAGGAAUGCAAC-3'로 이루어진 군에서 선택된 서열.

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 11,

서열번호 12, 및

5'-AACAAA-3', 5'-AACAAAU-3', 5'-AACAAAUU-3', 5'-AACAAAUUC-3', 서열번호 67 내지 90으로 이루어진 군에서 선택된 서열이 연결된 서열; 및

5'말단에서 3'말단 방향으로,

5'-GGA-3', 5'-AGGA-3', 5'-AAGGA-3', 5'-GAAGGA-3', 5'-UGAAGGA-3', 5'-AUGAAGGA-3', 5'-AAUGAAGGA-3', 서열번호 91 내지 110으로 이루어진 군에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 11,

서열번호 12, 및

5'-AACAAAGAAAGGA-3'(서열번호 111), 5'-AACAAAUGAAAAGGA-3'(서열번호 112), 5'-AACAAAUUGAAAAAGGA-3'(서열번호 113), 5'-AACAAAUUCGAAAGAAGGA-3'(서열번호 114), 5'-AACAAAUUCAGAAAUGAAGGA-3'(서열번호 115), 5'-AACAAAUUCAUGAAAAUGAAGGA-3'(서열번호 116), 및 5'-AACAAAUUCAUUGAAAAAUGAAGGA-3'(서열번호 117)에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

일 구현예로, 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAGAAAGGAAUGCAAC-3'(서열번호 200), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUGAAAAGGAAUGCAAC-3'(서열번호 201), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUGAAAAAGGAAUGCAAC-3'(서열번호 202), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCGAAAGAAGGAAUGCAAC-3'(서열번호 203), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAGAAAUGAAGGAAUGCAAC-3'(서열번호 204), 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUGAAAAUGAAGGAAUGCAAC-3'(서열번호 205), 및 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUGAAAAAUGAAGGAAUGCAAC-3'(서열번호 206)로 이루어진 군에서 선택된 것일 수 있다.

엔지니어링 된 스캐폴드 영역 5 - 제6 영역 변형

본 명세서에서 제공하는 엔지니어링 된 스캐폴드에서 제6 영역은 PK (R:AR-1) 부분 중 crRNA에 속한 뉴클레오타이드를 포함하는 영역이다. 전술한 바, 상기 제6 영역은 CRISPR/Cas12f1 복합체에서, 이량체를 이루는 하나의 Cas12f1 단백질의 WED 도메인, ZF 도메인 및/또는 RuvC 도메인과 상호작용하는 하나 이상의 뉴클레오타이드를 포함한다. 상기 엔지니어링 된 스캐폴드의 제6 영역은 자연계에서 발견되는 스캐폴드의 제6 영역과 동일하거나, 상기 제6 영역의 기능이 손상되지 않는 한도 내에서 변형된 것일 수 있다.

엔지니어링 된 스캐폴드 영역 6 - 각 변형의 조합

각 변형의 조합 개괄

본 명세서에서 제공하는 엔지니어링 된 Cas12f1 가이드 RNA에 포함된 엔지니어링 된 스캐폴드 영역은, 자연계에서 발견되는 스캐폴드 영역에 전술한 각 영역 별 변형이 하나 이상 조합된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 및 변형된 제2 영역을 포함할 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역을 포함하고, 제1 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역을 포함하고, 제2 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 제1 영역 및 제2 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 및 변형된 제3 영역을 포함할 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역을 포함하고, 제1 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 몇 변형된 제4 영역 및 제5 영역을 포함할 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제4 영역 및 제5 영역을 포함하고, 제1 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역 및 변형된 제3 영역을 포함할 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역을 포함하고, 제2 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역 및 변형된 제4 영역 및 제5 영역을 포함할 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제4 영역 및 제5 영역을 포함하고, 제2 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역 및 변형된 제4 영역 및 제5 영역을 포함할 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 변형된 제2 영역, 및 변형된 제3 영역을 포함할 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역 및 변형된 제3 영역을 포함하고, 제1 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역 및 변형된 제3 영역을 포함하고, 제2 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역을 포함하고, 제1 영역 및 제2 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 변형된 제2 영역, 및 변형된 제4 영역 및 제5 영역을 포함할 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역 및 변형된 제4 영역 및 제5 영역을 포함하고, 제1 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역 및 변형된 제4 영역 및 제5 영역을 포함하고, 제2 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제4 영역 및 제5 영역을 포함하고, 제1 영역 및 제2 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 변형된 제3 영역, 및 변형된 제4 영역 및 제5 영역을 포함할 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역 및 변형된 제4 영역 및 제5 영역을 포함하고, 제1 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역, 변형된 제3 영역, 및 변형된 제4 영역 및 제5 영역을 포함할 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역 및 변형된 제4 영역 및 제5 영역을 포함하고, 제2 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 변형된 제2 영역, 변형된 제3 영역, 및 변형된 제4 영역 및 제5 영역을 포함할 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역, 변형된 제3 영역, 및 변형된 제4 영역 및 제5 영역을 포함하고, 제1 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 변형된 제3 영역, 및 변형된 제4 영역 및 제5 영역을 포함하고, 제2 영역이 제거된 것일 수 있다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역 및 변형된 제4 영역 및 제5 영역을 포함하고, 제1 영역 및 제2 영역이 제거된 것일 수 있다.

이때, 상기 변형된 영역은 전술한 각 영역의 변형 단락에서 설명된 바와 같다.

각 변형의 조합 1 - 제1 영역 변형 및 제2 영역 변형

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역 및 변형된 제2 영역을 포함한다. 이때, 상기 변형된 제1 영역은 "엔지니어링 된 스캐폴드 영역 1 - 제1 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제2 영역은 "엔지니어링 된 스캐폴드 영역 2 - 제2 영역 변형" 단락에서 설명된 변형을 모두 포함한다.

일 구현예로, 제1 영역 및 제2 영역이 변형된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 12, 및

서열번호 13이 연결된 서열; 및

5'말단에서 3'말단 방향으로,

5'-ACCGCUUCACCAUUAGUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 157); 및

5'-GAAUGAAGGAAUGCAAC-3'(서열번호 3).

일 구현예로, 제1 영역 및 제2 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'에서 3'말단 방향으로,

서열번호 12,

서열번호 13,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

일 구현예로, 제1 영역 및 제2 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'-ACCGCUUCACCAUUAGUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 207)일 수 있다.

각 변형의 조합 2 - 제2 영역 변형 및 제1 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역을 포함하고, 제1 영역이 제거된 것이다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역과 대응되는 영역을 포함하지 않는다. 이때, 상기 변형된 제2 영역은 "엔지니어링 된 스캐폴드 영역 2 - 제2 영역 변형" 단락에서 설명된 변형을 모두 포함한다.

일 구현예로, 제2 영역이 변형되고, 제1 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 12, 및

서열번호 13이 연결된 서열; 및

일 구현예로, 제2 영역이 변형되고, 제1 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'에서 3'말단 방향으로,

서열번호 12,

서열번호 13,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

각 변형의 조합 3 - 제1 영역 변형 및 제2 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역을 포함하고, 제2 영역이 제거된 것이다. 이때, 상기 변형된 제1 영역은 "엔지니어링 된 스캐폴드 영역 1 - 제1 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제1 영역이 변형되고, 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 12, 및

서열번호 13이 연결된 서열; 및

일 구현예로, 제1 영역이 변형되고, 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 12,

서열번호 13,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

각 변형의 조합 4 - 제1 영역 제거 및 제2 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 제1 영역 및 제2 영역이 제거된 것이다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역과 대응되는 영역을 포함하지 않는다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 상기 제1 영역 및 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 12, 및

서열번호 13이 연결된 서열; 및

일 구현예로, 제1 영역 및 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'에서 3'말단 방향으로,

서열번호 12,

서열번호 13,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

각 변형의 조합 5 - 제1 영역 변형 및 제3 영역 변형

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역 및 변형된 제3 영역을 포함한다. 이때, 상기 변형된 제1 영역은 "엔지니어링 된 스캐폴드 영역 1 - 제1 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다.

일 구현예로, 제1 영역 및 제3 영역이 변형된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 11,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 13이 연결된 서열; 및

일 구현예로, 제1 영역 및 제3 영역이 변형된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 11,

서열번호 12,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

각 변형의 조합 6 - 제3 영역 변형 및 제1 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역을 포함하고, 제1 영역이 제거된 것이다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제3 영역이 변형되고 제1 영역이 제거된 엔지니어링 된 스캐폴드 영역은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 11,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 13이 연결된 서열; 및

일 구현예로, 제3 영역이 변형되고 제1 영역이 제거된 엔지니어링 된 스캐폴드 영역은 5'말단에서 3'말단 방향으로,

서열번호 11,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

각 변형의 조합 7 - 제1 영역 변형 및 제4 영역 및 제5 영역 변형

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 및 변형된 제4 영역 및 제5 영역을 포함한다. 이때, 상기 변형된 제1 영역은 "엔지니어링 된 스캐폴드 영역 1 - 제1 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다.

일 구현예로, 제1 영역, 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 11,

서열번호 12, 및

5'-AACAAA-3', 5'-AACAAAU-3', 5'-AACAAAUU-3', 5'-AACAAAUUC-3', 서열번호 67 내지 69로 이루어진 군에서 선택된 서열이 연결된 서열; 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

5'말단에서 3'말단 방향으로,

5'-ACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAA-3'(서열번호 158); 및

5'-GGAAUGCAAC-3'(서열번호 161).

일 구현예로, 제1 영역 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'에서 3'말단 방향으로,

서열번호 11,

서열번호 12,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

일 구현예로, 제1 영역 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'-ACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAGAAAGGAAUGCAAC-3'(서열번호 208)일 수 있다.

각 변형의 조합 8 - 제4 영역 및 제5 영역 변형 및 제1 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제4 영역 및 제5 영역을 포함하고, 제1 영역이 제거된 것이다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제4 영역 및 제5 영역이 변형되고, 제1 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 11,

서열번호 12, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제4 영역 및 제5 영역이 변형되고, 제1 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 11,

서열번호 12,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 9 - 제2 영역 변형 및 제3 영역 변형

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역 및 변형된 제3 영역을 포함한다. 이때, 상기 변형된 제2 영역은 "엔지니어링 된 스캐폴드 영역 2 - 제2 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다.

일 구현예로, 제2 영역 및 제3 영역이 변형된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 13이 연결된 서열; 및

일 구현예로, 제2 영역 및 제3 영역이 변형된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

각 변형의 조합 10 - 제3 영역 변형 및 제2 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역을 포함하고, 제2 영역이 제거된 것이다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제3 영역이 변형되고 제2 영역이 제거된 엔지니어링 된 스캐폴드 영역은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 13이 연결된 서열; 및

일 구현예로, 제3 영역이 변형되고 제2 영역이 제거된 엔지니어링 된 스캐폴드 영역은 5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

각 변형의 조합 11 - 제2 영역 변형 및 제4 영역 및 제5 영역 변형

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역 및 변형된 제4 영역 및 제5 영역을 포함한다. 이때, 상기 변형된 제2 영역은 "엔지니어링 된 스캐폴드 영역 2 - 제2 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 4 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다.

일 구현예로, 제2 영역, 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 12, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

5'말단에서 3'말단 방향으로,

5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAUUAGUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAA-3'(서열번호 159); 및

5'-GGAAUGCAAC-3'(서열번호 161).

일 구현예로, 제2 영역 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'에서 3'말단 방향으로,

서열번호 10,

서열번호 12,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

일 구현예로, 제2 영역 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACUUAGAGUGAAGGUGGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAGAAAGGAAUGCAAC-3'(서열번호 209)일 수 있다.

각 변형의 조합 12 - 제4 영역 및 제5 영역 변형, 및 제2 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제4 영역 및 제5 영역을 포함하고, 제2 영역이 제거된 것이다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제4 영역 및 제5 영역이 변형되고, 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 12, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

서열번호 10,

서열번호 12,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 13 - 제3 영역 변형, 및 제4 영역 및 제5 영역 변형

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역 및 변형된 제4 영역 및 제5 영역을 포함한다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 4 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다.

일 구현예로, 제3 영역, 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 11,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제3 영역 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'에서 3'말단 방향으로,

서열번호 10,

서열번호 11,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 14 - 제1 영역 변형, 제2 영역 변형, 및 제3 영역 변형

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 변형된 제2 영역, 및 변형된 제3 영역을 포함한다. 이때, 상기 변형된 제1 영역은 "엔지니어링 된 스캐폴드 영역 1 - 제1 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제2 영역은 "엔지니어링 된 스캐폴드 영역 2 - 제2 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다.

일 구현예로, 제1 영역, 제2 영역, 및 제3 영역이 변형된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 13이 연결된 서열; 및

일 구현예로, 제1 영역, 제2 영역, 및 제3 영역이 변형된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 13,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

각 변형의 조합 15 - 제2 영역 변형, 제3 영역 변형, 및 제1 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역, 변형된 제3 영역을 포함하고, 제1 영역이 제거된 것이다. 이때, 상기 변형된 제2 영역은 "엔지니어링 된 스캐폴드 영역 2 - 제2 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제2 영역, 및 제3 영역이 변형되고, 제1 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 13이 연결된 서열; 및

일 구현예로, 제2 영역, 및 제3 영역이 변형되고, 제1 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 13,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

각 변형의 조합 16 - 제1 영역 변형, 제3 영역 변형, 및 제2 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 변형된 제3 영역을 포함하고, 제2 영역이 제거된 것이다. 이때, 상기 변형된 제1 영역은 "엔지니어링 된 스캐폴드 영역 1 - 제1 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제1 영역, 및 제3 영역이 변형되고, 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 13이 연결된 서열; 및

일 구현예로, 제1 영역, 및 제3 영역이 변형되고, 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 13,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

각 변형의 조합 17 - 제3 영역 변형, 제1 영역 제거, 및 제2 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역을 포함하고, 제1 영역 및 제2 영역이 제거된 것이다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역과 대응되는 영역을 포함하지 않는다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제3 영역이 변형되고, 제1 영역 및 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다.

5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 13이 연결된 서열; 및

일 구현예로, 제3 영역이 변형되고, 제1 영역 및 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

서열번호 13,

링커,

서열번호 15, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

이때, 상기 링커는 5'-GAAA-3'일 수 있다.

각 변형의 조합 18 - 제1 영역 변형, 제2 영역 변형, 및 제4 영역 및 제5 영역 변형

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 변형된 제2 영역 및 변형된 제4 영역 및 제5 영역을 포함한다. 이때, 상기 변형된 제1 영역은 "엔지니어링 된 스캐폴드 영역 1 - 제1 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제2 영역은 "엔지니어링 된 스캐폴드 영역 2 - 제2 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 4 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다.

일 구현예로, 제1 영역, 제2 영역, 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 12, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

5'말단에서 3'말단 방향으로,

5'-ACCGCUUCACCAUUAGUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAA-3'(서열번호 160); 및

5'-GGAAUGCAAC-3'(서열번호 161).

일 구현예로, 제1 영역, 제2 영역 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'에서 3'말단 방향으로,

서열번호 12,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

일 구현예로, 제1 영역, 제2 영역 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 영역의 서열은 5'-ACCGCUUCACUUAGAGUGAAGGUGGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAGAAAGGAAUGCAAC-3'(서열번호 210)일 수 있다.

각 변형의 조합 19 - 제2 영역 변형, 제4 영역 및 제5 영역 변형, 및 제1 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역, 변형된 제4 영역 및 제5 영역을 포함하고, 제1 영역이 제거된 것이다. 이때, 상기 변형된 제2 영역은 "엔지니어링 된 스캐폴드 영역 2 - 제2 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제2 영역, 및 제4 영역 및 제5 영역이 변형되고, 제1 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 12, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제2 영역, 및 제4 영역 및 제5 영역이 변형되고, 제1 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 12,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 20 - 제1 영역 변형, 제4 영역 및 제5 영역 변형, 및 제2 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 변형된 제4 영역 및 제5 영역을 포함하고, 제2 영역이 제거된 것이다. 이때, 상기 변형된 제1 영역은 "엔지니어링 된 스캐폴드 영역 1 - 제1 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제1 영역, 제4 영역 및 제5 영역이 변형되고, 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 12, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제1 영역, 제4 영역 및 제5 영역이 변형되고, 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 12,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 21 - 제4 영역 및 제5 영역 변형, 제1 영역 제거, 및 제2 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제4 영역 및 제5 영역을 포함하고, 제1 영역 및 제2 영역이 제거된 것이다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역과 대응되는 영역을 포함하지 않는다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제4 영역 및 제5 영역이 변형되고, 제1 영역 및 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 12, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제4 영역 및 제5 영역이 변형되고, 제1 영역 및 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 12,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 22 - 제1 영역 변형, 제3 영역 변형, 및 제4 영역 및 제5 영역 변형

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 변형된 제3 영역 및 변형된 제4 영역 및 제5 영역을 포함한다. 이때, 상기 변형된 제1 영역은 "엔지니어링 된 스캐폴드 영역 1 - 제1 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 4 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다.

일 구현예로, 제1 영역, 제3 영역, 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 11,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제1 영역, 제3 영역, 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 11,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 23 - 제3 영역 변형, 제4 영역 및 제5 영역 변형, 및 제1 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역, 및 변형된 제4 영역 및 제5 영역을 포함하고, 제1 영역이 제거된 것이다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제3 영역, 및 제4 영역 및 제5 영역이 변형되고, 제1 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

서열번호 11,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제3 영역, 및 제4 영역 및 제5 영역이 변형되고, 제1 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 11,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 24 - 제2 영역 변형, 제3 영역 변형, 및 제4 영역 및 제5 영역 변형

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역, 변형된 제3 영역 및 변형된 제4 영역 및 제5 영역을 포함한다. 이때, 상기 변형된 제1 영역은 "엔지니어링 된 스캐폴드 영역 2 - 제2 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 4 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다.

일 구현예로, 제2 영역, 제3 영역, 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제2 영역, 제3 영역, 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 25 - 제3 영역 변형, 제4 영역 및 제5 영역 변형, 및 제2 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역, 및 변형된 제4 영역 및 제5 영역을 포함하고, 제2 영역이 제거된 것이다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제3 영역, 및 제4 영역 및 제5 영역이 변형되고, 제2 영역이 제거된 엔지니어린 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제3 영역, 및 제4 영역 및 제5 영역이 변형되고, 제2 영역이 제거된 엔지니어린 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 10,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 26 - 제1 영역 변형, 제2 영역 변형, 제3 영역 변형, 및 제4 영역 및 제5 영역 변형

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 변형된 제2 영역, 변형된 제3 영역 및 변형된 제4 영역 및 제5 영역을 포함한다. 이때, 상기 변형된 제1 영역은 "엔지니어링 된 스캐폴드 영역 1 - 제1 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제2 영역은 "엔지니어링 된 스캐폴드 영역 2 - 제2 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 4 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다.

일 구현예로, 제1 영역, 제2 영역, 제3 영역, 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제1 영역, 제2 영역, 제3 영역, 및 제4 영역 및 제5 영역이 변형된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 27 - 제2 영역 변형, 제3 영역 변형, 제4 영역 및 제5 영역 변형, 및 제1 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제2 영역, 변형된 제3 영역 및 변형된 제4 영역 및 제5 영역을 포함하고, 제1 영역이 제거된 것이다. 이때, 상기 변형된 제2 영역은 "엔지니어링 된 스캐폴드 영역 2 - 제2 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 4 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제2 영역, 제3 영역, 및 제4 영역 및 제5 영역이 변형되고, 제1 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제2 영역, 제3 영역, 및 제4 영역 및 제5 영역이 변형되고, 제1 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 28 - 제1 영역 변형, 제3 영역 변형, 제4 영역 및 제5 영역 변형, 및 제2 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제1 영역, 변형된 제3 영역 및 변형된 제4 영역 및 제5 영역을 포함하고, 제2 영역이 제거된 것이다. 이때, 상기 변형된 제1 영역은 "엔지니어링 된 스캐폴드 영역 1 - 제1 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 4 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제1 영역, 제3 영역, 및 제4 영역 및 제5 영역이 변형되고, 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제1 영역, 제3 영역, 및 제4 영역 및 제5 영역이 변형되고, 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 29 - 제3 영역 변형, 제4 영역 변형, 제1 영역 제거, 및 제2 영역 제거

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역은 변형된 제3 영역 및 변형된 제4 영역 및 제5 영역을 포함하고, 제1 영역 및 제2 영역이 제거된 것이다. 이때, 상기 변형된 제3 영역은 "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 변형된 제4 영역 및 제5 영역은 "엔지니어링 된 스캐폴드 영역 4 - 제4 영역 및 제5 영역 변형" 단락에서 설명된 변형을 모두 포함한다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역과 대응되는 영역을 포함하지 않는다. 이때, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역과 대응되는 영역을 포함하지 않는다.

일 구현예로, 제3 영역, 및 제4 영역 및 제5 영역이 변형되고, 제1 영역 및 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 다음을 포함할 수 있다:

서열번호 434 내지 447로 이루어진 군에서 선택된 서열, 및

5'말단에서 3'말단 방향으로,

5'-AUGCAAC-3'가 연결된 서열.

일 구현예로, 제3 영역, 및 제4 영역 및 제5 영역이 변형되고, 제1 영역 및 제2 영역이 제거된 엔지니어링 된 스캐폴드 서열은 5'말단에서 3'말단 방향으로,

서열번호 434 내지 447로 이루어진 군에서 선택된 서열,

서열번호 111 내지 117에서 선택된 서열, 및

5'-AUGCAAC-3'가 연결된 것일 수 있다.

각 변형의 조합 30 - 제6 영역의 추가적인 변형

전술한 바, 제6 영역 또한 그 기능이 손상되지 않는 범위 내에서 변형될 수 있으므로, 본 명세서에서 제공하는 엔지니어링 된 스캐폴드 영역은 전술한 제1 영역, 제2 영역, 제3 영역, 제4 영역, 및/또는 제5 영역의 변형 내지 제1 영역 및/또는 제2 영역의 제거 외, 제6 영역이 추가적으로 변형된 것일 수 있다.

엔지니어링 된 스캐폴드 영역 7 - 동일성을 가지는 있는 서열 포함

본 명세서에서 제공하는 엔지니어링 된 스캐폴드 영역은 "엔지니어링 된 스캐폴드 영역 1 - 제1 영역 변형", "엔지니어링 된 스캐폴드 영역 2 - 제2 영역 변형", "엔지니어링 된 스캐폴드 영역 3 - 제3 영역 변형", "엔지니어링 된 스캐폴드 영역 4 - 제4 영역 및 제5 영역 변형", 및 "엔지니어링 된 스캐폴드 영역 5 - 각 변형의 조합" 단락에서 서술된 엔지니어링 된 스캐폴드 영역(이하, 전술한 엔지니어링 된 스캐폴드 영역)의 서열과 동일성(identity)을 가지는 서열을 포함한다.

일 구현예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 전술한 엔지니어링 된 스캐폴드 영역의 서열 중 어느 하나와 100%, 99%, 98%, 97%, 96%, 95%, 94%, 93%, 92%, 91%, 90%, 89%, 88%, 87%, 86%, 85%, 84%, 83%, 82%, 81%, 80%, 79%, 78%, 77%, 76%, 75%, 74%, 73%, 72%, 71%, 70%, 69%, 68%, 67%, 66%, 65%, 64%, 63%, 62%, 61%, 60%, 59%, 58%, 57%, 56%, 55%, 54%, 53%, 52%, 51%, 또는 50% 의 서열 동일성(sequence identity), 또는 서열 상동성(sequence homology)을 가지는 서열일 수 있다. 일 구현예로, 상기 스캐폴드 서열은 전술한 엔지니어링 된 스캐폴드 영역의 서열 중 어느 하나와 바로 이전 문장에서 선택된 두 수치 범위 내의 %로 일치하는 서열일 수 있다. 예를 들어, 상기 스캐폴드 서열은 전술한 엔지니어링 된 스캐폴드 영역의 서열 중 어느 하나와 90% 내지 100% 일치하는 서열일 수 있다.

엔지니어링 된 Cas12f1 가이드 RNA

엔지니어링 된 Cas12f1 가이드 RNA 개괄

본 명세서에서는 CRISPR/Cas12f1 시스템의 세포 내 유전자 편집 효율을 높이기 위한, 엔지니어링 된 Cas12f1 가이드 RNA를 제공한다. 상기 엔지니어링 된 Cas12f1 가이드 RNA는 엔지니어링 된 스캐폴드, 스페이서, 및 U-rich tail을 포함한다. 이때, 상기 엔지니어링 된 스캐폴드는 전술한 "엔지니어링 된 스캐폴드 영역"에서 설명된 것 중 어느 하나일 수 있다. 이때, 상기 U-rich tail은 "U-rich tail" 단락에서 설명된 것 중 어느 하나일 수 있다.

싱글 가이드 RNA 또는 듀얼 가이드 RNA

상기 엔지니어링 된 Cas12f1 가이드 RNA는 싱글 가이드 RNA 또는 듀얼 가이드 RNA일 수 있다. 상기 듀얼 가이드 RNA는, 가이드 RNA가 tracrRNA 및 crRNA의 독립적인 두 분자 RNA로 구성된 것을 의미한다. 상기 싱글 가이드 RNA는 (엔지니어링 된) tracrRNA의 3'말단 및 (엔지니어링 된) crRNA의 5' 말단이 링커를 통해 연결되어 하나의 분자를 형성한 것을 의미한다. 달리 표현하면, 상기 듀얼 가이드 RNA에서, 엔지니어링 된 스캐폴드에 포함된 제4 영역의 3'말단 및 제5 영역의 5'말단이 링커를 통해 연결된 것을 의미한다. 이때, 엔지니어링 된 스캐폴드의 각 영역은 "엔지니어링 된 스캐폴드 영역" 단락들에서 설명된 변형, 및 그 구체적인 서열을 모두 포함할 수 있다.

엔지니어링 된 싱글 가이드 RNA 예시 1

일 구현예로, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 5'말단에서 3'말단 방향으로, 엔지니어링 된 스캐폴드 영역, 스페이서, 및 U-rich tail이 순서대로 연결된 것일 수 있다.

상기 스페이서는 10 내지 50 뉴클레오타이드 길이를 가지며, 표적 서열과 상보적인 서열을 가진다.

상기 U-rich tail의 서열은 유리딘 연속 서열, 또는 변형된 유리딘 연속 서열을 포함할 수 있다. 일 예로, 상기 U-rich tail 서열은 1개, 2개, 3개, 4개, 5개, 6개, 7개, 8개, 9개, 10개, 11개, 12개, 13개, 14개, 15개, 16개, 17개, 18개, 19개, 또는 20개의 유리딘이 연속된 서열을 포함할 수 있다. 또 다른 예로, 상기 U-rich tail 서열은 UV, UUV, UUUV, UUUUV, 및/또는 UUUUUV가 하나 이상 반복된 서열을 포함할 수 있다. 이때, 상기 V는 아데노신(A), 사이티딘(C), 구아노신(G) 중 하나이다.

상기 엔지니어링 된 스캐폴드 영역은 5'말단에서 3'말단 방향으로, 자연계에서 발견되는 스캐폴드 영역과 대응되는 제1 영역, 제2 영역, 제3 영역, 제4 영역, 링커, 제5 영역, 제6 영역이 순서대로 연결된 것이며, 자연계에서 발견되는 스캐폴드 영역과 비교해 제1 영역, 제2 영역, 제4 영역, 및 제5 영역에서 선택된 하나 이상의 영역이 변형된 것이다.

일 예로, 상기 엔지니어링 된 스캐폴드 영역의 제1 영역이 변형된 경우, 상기 변형된 제1 영역은 자연계에서 발견되는 스캐폴드 영역의 제1 영역에서 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다. 이때, 상기 제거된 뉴클레오타이드는 상기 제1 영역 중 Stem 1 (Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021))에 속하는 뉴클레오타이드일 수 있다. 이때, 상기 변형된 제1 영역의 서열은 5'-A-3'을 포함하는 것을 특징으로 한다.

또 다른 예로, 상기 엔지니어링 된 스캐폴드 영역의 제2 영역이 변형된 경우, 상기 변형된 제2 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다. 이때, 상기 뉴클레오타이드의 제거는 상기 제2 영역 중 Stem 2 구조(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021))를 형성하는 부분에서 일어난 것이고, 서로 상보적인 페어를 이루는 뉴클레오타이드가 쌍 단위로 제거된 것일 수 있다. 이때, 상기 변형된 제2 영역의 서열은 적어도 5'-CCGCUUCACCA-3'(서열번호 51) 및 5'-UGAGUGAAGGUG-3'(서열번호 52)을 포함하는 것을 특징으로 한다. 더 구체적으로, 상기 변형된 제2 영역의 서열은 5'말단에서 3'말단 방향으로 5'-CCGCUUCACCA-3'(서열번호 51) 및 5'-UGAGUGAAGGUG-3'(서열번호 52)가 순서대로 연결되어 있을 수 있으며, 적절한 중간 서열을 통해 연결되어 있을 수 있다. 일 예로, 상기 중간 서열은 5'-UUAG-3', 5'-AUUAGU-3', 5'-AAUUAGCU-3', 5'-AAAUUAGACU-3'(서열번호 58), 5'-AAAGUUAGAACU-3'(서열번호 59), 5'-AAAGCUUAGGAACU-3'(서열번호 60), 5'-AAAGCUUUAGAGAACU-3'(서열번호 61), 5'-AAAGCUGUUAGUUAGAACU-3'(서열번호 62), 5'-AAAGCUGUUAGUAGAACU-3'(서열번호 63), 5'-AAAGCUGUUUAGAUUAGAACU-3'(서열번호 64), 5'-AAAGCUGUCUUAGGAUUAGAACU-3'(서열번호 65), 및 5'-AAAGCUGUCCUUAGGGAUUAGAACU-3'(서열번호 66)로 이루어진 군에서 선택된 것일 수 있다.

또 다른 예로, 상기 엔지니어링 된 스캐폴드 영역의 제4 영역 및 제5 영역이 변형된 경우, 상기 변형된 제4 영역 및 제5 영역은 자연계에서 발견되는 스캐폴드 영역 중 제4 영역 및/또는 제5 영역의 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다. 이때, 상기 뉴클레오타이드의 제거는 상기 제4 영역 및 제5 영역 중 Stem 5 (R:AR-2) 구조(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021))를 형성하는 부분에서 일어난 것이고, 서로 상보적인 페어를 이루는 뉴클레오타이드가 쌍 단위로 제거된 것일 수 있다. 이때, 상기 변형된 제4 영역의 서열은 적어도 5'-AACAAA-3'을 포함하는 것을 특징으로 한다. 이때, 상기 변형된 제5 영역의 서열은 적어도 5'-GGA-3'을 포함하는 것을 특징으로 한다.

엔지니어링 된 싱글 가이드 RNA 예시 2

상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현될 수 있다. 이때, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이고, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상이고, c는 1 내지 10이다. 일 예로, 상기 U-rich tail의 서열은 5'-UUUUAUUUU-3'일 수 있다. 일 예로, 상기 U-rich tail의 서열은 5'-UUUUGUUUU-3'일 수 있다.

상기 엔지니어링 된 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것이다:

5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 39), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 40), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 41), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 42), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 43), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 44), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 45), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 46), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 47), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 48), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 49), 5'-CCGCUUCACCAAAAGCUGUCCUUAGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 50), 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 서열;

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12);

5'-AUGCAAC-3',

이때, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 7)과 상이한 것을 특징으로 한다.

엔지니어링 된 싱글 가이드 RNA 예시 3

상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현될 수 있다. 이때, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이다. 이때, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상이고, c는 1 내지 10이다. 일 예로, 상기 U-rich tail의 서열은 5'-UUUUAUUUU-3'일 수 있다. 일 예로, 상기 U-rich tail의 서열은 5'-UUUUGUUUU-3'일 수 있다.

5'-A-3'로 표현되는 제1 서열;

5'-CCGCUUCACCA-3'(서열번호 51)로 표현되는 제2 서열;

5'-UUAG-3'로 표현되는 제3 서열;

5'-UGAGUGAAGGUG-3'(서열번호 52)로 표현되는 제4 서열;

5'-GGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12)로 표현되는 제5 서열;

5'-AACAAA-3'로 표현되는 제6 서열;

링커;

5'-GGA-3'로 표현되는 제7 서열; 및

5'-AUGCAAC-3'로 표현되는 제8 서열.

일 예로, 상기 링커는 5'-GAAA-3'일 수 있다.

또 다른 예로, 상기 링커는 5'-GAAA-3', 5'-UGAAAA-3', 5'-UUGAAAAA-3', 5'-UUCGAAAGAA-3'(서열번호 642), 5'-UUCAGAAAUGAA-3'(서열번호 643), 5'-UUCAUGAAAAUGAA-3'(서열번호 644), 및 5'-UUCAUUGAAAAAUGAA-3'(서열번호 645)로 이루어진 군에서 선택된 것일 수 있다.

상기 구현예의 일 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-GA-3', 5'-AGA-3', 5'-GAGA-3', 5'-GGAGA-3', 5'-UGGAGA-3', 5'-GUGGAGA-3', 5'-AGUGGAGA-3', 5'-AAGUGGAGA-3', 5'-AAAGUGGAGA-3'(서열번호 28), 5'-UAAAGUGGAGA-3'(서열번호 29), 5'-AUAAAGUGGAGA-3'(서열번호 30), 5'-GAUAAAGUGGAGA-3'(서열번호 31), 5'-UGAUAAAGUGGAGA-3'(서열번호 32), 5'-CUGAUAAAGUGGAGA-3'(서열번호 33), 5'-ACUGAUAAAGUGGAGA-3'(서열번호 34), 5'-CACUGAUAAAGUGGAGA-3'(서열번호 35), 5'-UCACUGAUAAAGUGGAGA-3'(서열번호 36), 5'-UUCACUGAUAAAGUGGAGA-3'(서열번호 37), 및 5'-CUUCACUGAUAAAGUGGAGA-3'(서열번호 38)로 이루어진 군에서 선택된 제9 서열을 추가적으로 포함할 수 있다. 이때, 상기 제9 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있을 수 있다.

상기 구현예의 또 다른 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-AAA-3', 5'-AAAG-3', 5'-AAAGC-3', 5'-AAAGCU-3', 5'-AAAGCUG-3', 5'-AAAGCUGU-3', 5'-AAAGCUGUC-3', 5'-AAAGCUGUCC-3'(서열번호 53), 및 5'-AAAGCUGUCCC-3'(서열번호 54)로 이루어진 군에서 선택된 제10 서열을 추가적으로 포함할 수 있다. 이때, 상기 제2 서열의 3'말단 및 상기 제3 서열의 5'말단은 상기 제10 서열을 통해 연결되어 있을 수 있다.

상기 구현예의 또 다른 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-U-3', 5'-CU-3', 5'-ACU-3', 5'-AACU-3', 5'-GAACU-3', 5'-AGAACU-3', 5'-UAGAACU-3', 5'-UUAGAACU-3', 5'-AUUAGAACU-3', 5'-GAUUAGAACU-3'(서열번호 55), 5'-GGAUUAGAACU-3'(서열번호 56), 및 5'-GGGAUUAGAACU-3'(서열번호 57)로 이루어진 군에서 선택된 제11 서열을 추가적으로 포함할 수 있다. 이때, 상기 제3 서열의 3'말단 및 상기 제4 서열의 5'말단은 상기 제11 서열을 통해 연결되어 있을 수 있다.

상기 구현예의 또 다른 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-AAA-3', 5'-AAAG-3', 5'-AAAGC-3', 5'-AAAGCU-3', 5'-AAAGCUG-3', 5'-AAAGCUGU-3', 5'-AAAGCUGUC-3', 5'-AAAGCUGUCC-3'(서열번호 53), 및 5'-AAAGCUGUCCC-3'(서열번호 54)로 이루어진 군에서 선택된 제10 서열 및 5'-U-3', 5'-CU-3', 5'-ACU-3', 5'-AACU-3', 5'-GAACU-3', 5'-AGAACU-3', 5'-UAGAACU-3', 5'-UUAGAACU-3', 5'-AUUAGAACU-3', 5'-GAUUAGAACU-3'(서열번호 55), 5'-GGAUUAGAACU-3'(서열번호 56), 및 5'-GGGAUUAGAACU-3'(서열번호 57)로 이루어진 군에서 선택된 제11 서열을 추가적으로 포함할 수 있다. 이때, 상기 제2 서열의 3'말단 및 상기 제3 서열의 5'말단은 상기 제10 서열을 통해 연결되어 있고, 상기 제3 서열의 3'말단 및 상기 제4 서열의 5'말단은 상기 제11 서열을 통해 연결되어 있을 수 있다.

일 예로, 상기 제10 서열이 5'-A-3'인 경우, 상기 제11 서열은 5'-U-3'일 수 있다. 또 다른 예로, 상기 제10 서열이 5'-AA-3'인 경우, 상기 제11 서열은 5'-CU-3'일 수 있다. 또 다른 예로, 상기 제10 서열이 5'-AAA-3'인 경우, 상기 제11 서열은 5'-ACU-3'일 수 있다. 또 다른 예로, 상기 제10 서열이 5'-AAAG-3'인 경우, 상기 제11 서열은 5'-AACU-3'일 수 있다. 또 다른 예로, 상기 제10 서열이 5'-AAAGC-3'인 경우, 상기 제11 서열은 5'-GAACU-3'일 수 있다. 또 다른 예로, 상기 제10 서열이 5'-AAAGCU-3'인 경우, 상기 제11 서열은 5'-AGAACU-3'일 수 있다. 또 다른 예로, 상기 제10 서열이 5'-AAAGCUG-3'인 경우, 상기 제11 서열은 5'-UAGAACU-3' 또는 5'-UUAGAACU-3' 일 수 있다. 또 다른 예로, 상기 제10 서열이 5'-AAAGCUGU-3'인 경우, 상기 제11 서열은 5'-AUUAGAACU-3' 일 수 있다. 또 다른 예로, 상기 제10 서열이 5'-AAAGCUGUC-3'인 경우, 상기 제11 서열은 5'-GAUUAGAACU-3'(서열번호 55) 일 수 있다. 또 다른 예로, 상기 제10 서열이 5'-AAAGCUGUCC-3'(서열번호 53)인 경우, 상기 제11 서열은 5'-GGAUUAGAACU-3'(서열번호 56) 일 수 있다. 또 다른 예로, 상기 제10 서열이 5'-AAAGCUGUCCC-3'(서열번호 54)인 경우, 상기 제11 서열은 5'-GGGAUUAGAACU-3'(서열번호 57) 일 수 있다.

상기 구현예의 또 다른 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-U-3', 5'-UU-3', 5'-UUC-3', 5'-UUCA-3', 5'-UUCAU-3', 5'-UUCAUU-3', 및 5'-UUCAUUU-3'로 이루어진 군에서 선택된 제 12서열을 추가적으로 포함할 수 있다. 이때, 상기 제6 서열의 3'말단 및 상기 링커의 5'말단은 상기 제12 서열을 통해 연결되어 있을 수 있다.

상기 구현예의 또 다른 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-UGAA-3', 5'-AUGAA-3', 5'-AAUGAA-3', 및 5'-GAAUGAA-3'로 이루어진 군에서 선택된 제 13서열을 추가적으로 포함할 수 있다. 이때, 상기 링커의 3'말단 및 상기 제7 서열의 5'말단은 상기 제13 서열을 통해 연결되어 있을 수 있다.

상기 구현예의 또 다른 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-U-3', 5'-UU-3', 5'-UUC-3', 5'-UUCA-3', 5'-UUCAU-3', 5'-UUCAUU-3', 및 5'-UUCAUUU-3'로 이루어진 군에서 선택된 제 12서열, 및 5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-UGAA-3', 5'-AUGAA-3', 5'-AAUGAA-3', 및 5'-GAAUGAA-3'로 이루어진 군에서 선택된 제 13서열을 추가적으로 포함할 수 있다. 이때, 상기 제6 서열의 3'말단 및 상기 링커의 5'말단은 상기 제12 서열을 통해 연결되고, 상기 링커의 3'말단 및 상기 제7 서열의 5'말단은 상기 제13 서열을 통해 연결되어 있을 수 있다.

일 예로, 상기 제12 서열이 5'-U-3'인 경우, 상기 제13 서열은 5'-A-3'일 수 있다. 또 다른 예로, 상기 제12 서열이 5'-UU-3'인 경우, 상기 제13 서열은 5'-AA-3'일 수 있다. 또 다른 예로, 상기 제12 서열이 5'-UUC-3'인 경우, 상기 제13 서열은 5'-GAA-3'일 수 있다. 또 다른 예로, 상기 제12 서열이 5'-UUCA-3'인 경우, 상기 제13 서열은 5'-UGAA-3'일 수 있다. 또 다른 예로, 상기 제12 서열이 5'-UUCAU-3'인 경우, 상기 제13 서열은 5'-AUGAA-3'일 수 있다. 또 다른 예로, 상기 제12 서열이 5'-UUCAUU-3'인 경우, 상기 제13 서열은 5'-AAUGAA-3'일 수 있다. 또 다른 예로, 상기 제12 서열이 5'-UUCAUUU-3'인 경우, 상기 제13 서열은 5'-GAAUGAA-3'일 수 있다.

엔지니어링 된 싱글 가이드 RNA 예시 4

상기 U-rich tail의 서열은 유리딘 연속 서열, 또는 변형된 유리딘 연속 서열일 수 있다. 일 예로, 상기 U-rich tail 서열은 1개, 2개, 3개, 4개, 5개, 6개, 7개, 8개, 9개, 10개, 11개, 12개, 13개, 14개, 15개, 16개, 17개, 18개, 19개, 또는 20개의 유리딘이 연속된 서열을 포함할 수 있다. 또 다른 예로, 상기 U-rich tail 서열은 UV, UUV, UUUV, UUUUV, 및/또는 UUUUUV가 하나 이상 반복된 서열을 포함할 수 있다. 이때, 상기 V는 아데노신(A), 사이티딘(C), 구아노신(G) 중 하나이다.

상기 엔지니어링 된 스캐폴드 영역은 5'말단에서 3'말단 방향으로, 자연계에서 발견되는 스캐폴드 영역과 대응되는 제1 영역, 제2 영역, 제3 영역, 제4 영역, 링커, 제5 영역, 제6 영역이 순서대로 연결된 것이며, 자연계에서 발견되는 스캐폴드 영역과 비교해 제1 영역, 제2 영역, 제3 영역, 제4 영역, 및 제5 영역에서 선택된 하나 이상의 영역이 변형된 것일 수 있다. 더 나아가, 상기 엔지니어링 된 스캐폴드 영역은 자연계에서 발견되는 스캐폴드 영역과 대응되는 제1 영역 및/또는 제2 영역이 제거된 것일 수 있다.

또 다른 예로, 상기 엔지니어링 된 스캐폴드 영역의 제2 영역이 변형된 경우, 상기 변형된 제2 영역은 자연계에서 발견되는 스캐폴드 영역의 제2 영역에서 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다. 이때, 상기 뉴클레오타이드의 제거는 상기 제2 영역 중 Stem 2 구조(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021))를 형성하는 부분에서 일어난 것이고, 서로 상보적인 페어를 이루는 뉴클레오타이드가 쌍 단위로 제거된 것일 수 있다. 이때, 상기 변형된 제2 영역의 서열은 적어도 5'-G-3'을 포함하는 것을 특징으로 한다.

또 다른 예로, 상기 엔지니어링 된 스캐폴드 영역의 제3 영역이 변형된 경우, 상기 변형된 제3 영역은 자연계에서 발견되는 스캐폴드 영역의 제3 영역에서 하나 이상의 뉴클레오타이드가 제거된 것일 수 있다. 이때, 상기 뉴클레오타이드의 제거는 상기 제3 영역 중 Stem 4 구조(Takeda et al., Structure of the miniature type V-F CRISPR-Cas effector enzyme, Molecular Cell 81, 1-13 (2021))를 형성하는 부분에서 일어난 것이고, 서로 상보적인 페어를 이루는 뉴클레오타이드가 쌍 단위로 제거된 것일 수 있다. 이때, 상기 변형된 제3 영역의 서열은 적어도 5'-GCUGCUUGCAUCAGCCUAAUGUCGAG-3'(서열번호 475), 및 5'-CUCGA-3'을 포함하는 것을 특징으로 한다. 더 구체적으로, 상기 변형된 제3 영역의 서열은 5'말단에서 3'말단 방향으로 5'-GCUGCUUGCAUCAGCCUAAUGUCGAG-3'(서열번호 475) 및 5'-CUCGA-3'가 순서대로 연결되어 있을 수 있으며, 적절한 중간 서열을 통해 연결되어 있을 수 있다. 일 예로, 상기 중간 서열은 5'-UUCG-3', 5'-AUUCGC-3', 5'-AAUUCGC-3', 5'-AAUUCGCC-3', 5'-AAGUUCGCC-3', 5'-AAGUUCGACC-3'(서열번호 476), 5'-AAGUUUCGAACC-3'(서열번호 477), 5'-AAGUGUUCGUAACC-3'(서열번호 478), 5'-AAGUGCUUCGGUAACC-3'(서열번호 479), 5'-AAGUGCUUUCGAGUAACC-3'(서열번호 480), 5'-AAGUGCUCUUCGGAGUAACC-3'(서열번호 481), 5'-AAGUGCUUUUCGAAGUAACC-3'(서열번호 482), 5'-AAGUGCUUUUUCGAAAGUAACC-3'(서열번호 483), 및 5'-AAGUGCUUUCUUCGGAAAGUAACC-3'(서열번호 484)로 이루어진 군에서 선택된 것일 수 있다.

엔지니어링 된 싱글 가이드 RNA 예시 5

상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현될 수 있다. 이때, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이고, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상이고, c는 0 내지 10이다. 일 예로, 상기 U-rich tail의 서열은 5'-UUUUAUUUU-3'일 수 있다. 일 예로, 상기 U-rich tail의 서열은 5'-UUUUGUUUU-3'일 수 있다.

5'-AUGCAAC-3',

엔지니어링 된 싱글 가이드 RNA 예시 6

5'-GCUGCUUGCAUCAGCCUAAUGUCGAG-3'(서열번호 475)로 표현되는 제1 서열;

5'-UUCG-3'로 표현되는 제2 서열;

5'-CUCGA-3'로 표현되는 제3 서열;

5'-AACAAA-3'로 표현되는 제4 서열;

링커;

5'-GGA-3'로 표현되는 제5 서열; 및

5'-AUGCAAC-3'로 표현되는 제6 서열.

일 예로, 상기 링커는 5'-GAAA-3'일 수 있다.

상기 구현예의 일 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27), 및 5'-CUUCACUGAUAAAGUGGAGAA-3'(서열번호 10)로 이루어진 군에서 선택된 제7 서열을 추가적으로 포함할 수 있다. 이때 상기 제7 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있을 수 있다.

상기 구현예의 일 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362) 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 제8 서열을 추가적으로 포함할 수 있다. 이때 상기 제8 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있을 수 있다.

상기 구현예의 일 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27), 및 5'-CUUCACUGAUAAAGUGGAGAA-3'(서열번호 10)로 이루어진 군에서 선택된 제7 서열을 추가적으로 포함하고, 5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362), 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 제8 서열을 추가적으로 포함할 수 있다. 이때 상기 제8 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있고, 상기 제7 서열의 3'말단은 상기 제8 서열의 5'말단과 연결되어 있을 수 있다.

상기 구현예의 일 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-AAG-3', 5'-AAGU-3', 5'-AAGUG-3', 5'-AAGUGC-3', 5'-AAGUGCU-3', 5'-AAGUGCUU-3', 5'-AAGUGCUUU-3', 5'-AAGUGCUUUC-3'(서열번호 485)로 이루어진 군에서 선택된 제9 서열을 추가적으로 포함할 수 있다. 이때, 상기 제1 서열의 3'말단 및 상기 제2 서열의 5'말단은 상기 제9 서열을 통해 연결되어 있을 수 있다.

상기 구현예의 일 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-C-3', 5'-CC-3', 5'-ACC-3', 5'-AACC-3', 5'-UAACC-3', 5'-GUAACC-3', 5'-AGUAACC-3', 5'-AAGUAACC-3', 5'-AAAGUAACC-3', 5'-GAAAGUAACC-3'(서열번호 486)로 이루어진 군에서 선택된 제10 서열을 추가적으로 포함할 수 있다. 이때, 상기 제2 서열의 3'말단 및 상기 제3 서열의 5'말단은 상기 제10 서열을 통해 연결되어 있을 수 있다.

상기 구현예의 일 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-AAG-3', 5'-AAGU-3', 5'-AAGUG-3', 5'-AAGUGC-3', 5'-AAGUGCU-3', 5'-AAGUGCUU-3', 5'-AAGUGCUUU-3', 5'-AAGUGCUUUC-3'(서열번호 485)로 이루어진 군에서 선택된 제9 서열을 추가적으로 포함하고, 5'-C-3', 5'-CC-3', 5'-ACC-3', 5'-AACC-3', 5'-UAACC-3', 5'-GUAACC-3', 5'-AGUAACC-3', 5'-AAGUAACC-3', 5'-AAAGUAACC-3', 5'-GAAAGUAACC-3'(서열번호 486)로 이루어진 군에서 선택된 제10 서열을 추가적으로 포함할 수 있다. 이때, 상기 제1 서열의 3'말단 및 상기 제2 서열의 5'말단은 상기 제9 서열을 통해 연결되어 있고, 상기 제2 서열의 3'말단 및 상기 제3 서열의 5'말단은 상기 제10 서열을 통해 연결되어 있을 수 있다.

일 예로, 상기 제9 서열이 5'-A-3'인 경우, 상기 제10 서열은 5'-C-3'일 수 있다. 또 다른 예로, 상기 제9 서열이 5'-AA-3'인 경우, 상기 제10 서열은 5'-C-3', 또는 5'-CC-3'일 수 있다. 또 다른 예로, 상기 제9 서열이 5'-AAG-3'인 경우, 상기 제10 서열은 5'-CC-3', 또는 5'-ACC-3'일 수 있다. 또 다른 예로, 상기 제9 서열이 5'-AAGU-3'인 경우, 상기 제10 서열은 5'-AACC-3'일 수 있다. 또 다른 예로, 상기 제9 서열이 5'-AAGUG-3'인 경우, 상기 제10 서열은 5'-UAACC-3'일 수 있다. 또 다른 예로, 상기 제9 서열이 5'-AAGUGC-3'인 경우, 상기 제10 서열은 5'-GUAACC-3'일 수 있다. 또 다른 예로, 상기 제9 서열이 5'-AAGUGCU-3'인 경우, 상기 제10 서열은 5'-AGUAACC-3'일 수 있다. 또 다른 예로, 상기 제9 서열이 5'-AAGUGCUC-3'인 경우, 상기 제10 서열은 5'-GAGUAACC-3'일 수 있다. 또 다른 예로, 상기 제9 서열이 5'-AAGUGCUU-3'인 경우, 상기 제10 서열은 5'-AAGUAACC-3'일 수 있다. 또 다른 예로, 상기 제9 서열이 5'-AAGUGCUUU-3'인 경우, 상기 제10 서열은 5'-AAAGUAACC-3'일 수 있다. 또 다른 예로, 상기 제9 서열이 5'-AAGUGCUUUC-3'(서열번호 485)인 경우, 상기 제10 서열은 5'-GAAAGUAACC-3'(서열번호 486)일 수 있다.

상기 구현예의 또 다른 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-U-3', 5'-UU-3', 5'-UUC-3', 5'-UUCA-3', 5'-UUCAU-3', 5'-UUCAUU-3', 및 5'-UUCAUUU-3'로 이루어진 군에서 선택된 제 11서열을 추가적으로 포함할 수 있다. 이때, 상기 제4 서열의 3'말단 및 상기 링커의 5'말단은 상기 제11 서열을 통해 연결되어 있을 수 있다.

상기 구현예의 또 다른 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-UGAA-3', 5'-AUGAA-3', 5'-AAUGAA-3', 및 5'-GAAUGAA-3'로 이루어진 군에서 선택된 제 12서열을 추가적으로 포함할 수 있다. 이때, 상기 링커의 3'말단 및 상기 제5 서열의 5'말단은 상기 제12 서열을 통해 연결되어 있을 수 있다.

상기 구현예의 또 다른 구체예로, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-U-3', 5'-UU-3', 5'-UUC-3', 5'-UUCA-3', 5'-UUCAU-3', 5'-UUCAUU-3', 및 5'-UUCAUUU-3'로 이루어진 군에서 선택된 제 11서열, 및 5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-UGAA-3', 5'-AUGAA-3', 5'-AAUGAA-3', 및 5'-GAAUGAA-3'로 이루어진 군에서 선택된 제 12서열을 추가적으로 포함할 수 있다. 이때, 상기 제4 서열의 3'말단 및 상기 링커의 5'말단은 상기 제11 서열을 통해 연결되고, 상기 링커의 3'말단 및 상기 제5 서열의 5'말단은 상기 제12 서열을 통해 연결되어 있을 수 있다.

일 예로, 상기 제11 서열이 5'-U-3'인 경우, 상기 제12 서열은 5'-A-3'일 수 있다. 또 다른 예로, 상기 제11 서열이 5'-UU-3'인 경우, 상기 제12 서열은 5'-AA-3'일 수 있다. 또 다른 예로, 상기 제11 서열이 5'-UUC-3'인 경우, 상기 제12 서열은 5'-GAA-3'일 수 있다. 또 다른 예로, 상기 제11 서열이 5'-UUCA-3'인 경우, 상기 제12 서열은 5'-UGAA-3'일 수 있다. 또 다른 예로, 상기 제11 서열이 5'-UUCAU-3'인 경우, 상기 제12 서열은 5'-AUGAA-3'일 수 있다. 또 다른 예로, 상기 제11 서열이 5'-UUCAUU-3'인 경우, 상기 제12 서열은 5'-AAUGAA-3'일 수 있다. 또 다른 예로, 상기 제11 서열이 5'-UUCAUUU-3'인 경우, 상기 제12 서열은 5'-GAAUGAA-3'일 수 있다.

엔지니어링 된 싱글 가이드 RNA 서열 예시

일 구현예로, 상기 엔지니어링 된 싱글 가이드 RNA는 서열번호 211 내지 서열번호 253, 서열번호 296 내지 서열번호 308, 서열번호 311 내지 서열번호 323, 서열번호 326 내지 서열번호 338, 서열번호 488 내지 서열번호 541, 및 서열번호 545 내지 서열번호 551 에서 선택된 서열을 가질 수 있다.

엔지니어링 된 듀얼 가이드 RNA 예시

일 구현예로, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 엔지니어링 된 스캐폴드 영역, 스페이서, 및 U-rich tail을 포함한다.

상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현될 수 있다. 이때, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이다. 이때, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상이다.

일 예로, 상기 U-rich tail의 서열은 5'-UUUUAUUUU-3'일 수 있다.

상기 엔지니어링 된 스캐폴드 영역의 서열은 다음 서열을 포함한다:

5'말단에서 3'말단 방향으로,

이때, 상기 엔지니어링 된 crRNA 반복 서열 부분의 3'말단은 상기 스페이서의 5'말단과 연결 되어 있다.

이때, 상기 엔지니어링 된 tracrRNA의 서열은 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 1)과 상이하고, 및/또는 상기 엔지니어링 된 crRNA 반복 서열 부분은 5'-GAAUGAAGGAAUGCAAC-3'(서열번호 3)과 상이하다.

일 예로, 상기 엔지니어링 된 tracrRNA의 서열은 서열번호 1과 동일하고, 상기 엔지니어링 된 crRNA 반복 서열 부분은 서열번호 3과 상이할 수 있다. 또 다른 일 예로, 상기 엔지니어링 된 tracrRNA의 서열은 서열번호 1과 상이하고, 상기 엔지니어링 된 crRNA 반복 서열 부분은 서열번호 3과 동일할 수 있다. 또 다른 일 예로, 상기 엔지니어링 된 tracrRNA의 서열은 서열번호 1과 상이하고, 상기 엔지니어링 된 crRNA 반복 서열 부분은 서열번호 3과 상이할 수 있다.

일 예로, 상기 엔지니어링 된 tracrRNA의 서열은 상기 제1 서열 및/또는 제2 서열을 포함하지 않을 수 있다.

구체적으로, 상기 엔지니어링 된 tracrRNA의 서열은 다음으로 이루어진 군에서 선택된 것일 수 있다:

5'말단에서 3'말단 방향으로, 상기 제2 서열, 상기 제3 서열, 및 상기 제4 서열이 연결된 서열,

5'말단에서 3'말단 방향으로, 상기 제1 서열, 상기 제3 서열, 및 상기 제4 서열이 연결된 서열, 및

5'말단에서 3'말단 방향으로, 상기 제3 서열, 및 상기 제4 서열이 연결된 서열.

일 예로, 상기 엔지니어링 된 tracrRNA가 5'-AACAAA-3'를 포함하는 경우, 상기 엔지니어링 된 crRNA는 5'-GGA-3'를 포함할 수 있다. 또 다른 예로, 상기 엔지니어링 된 tracrRNA가 5'-AACAAAU-3'를 포함하는 경우, 상기 엔지니어링 된 crRNA는 5'-AGGA-3'를 포함할 수 있다. 또 다른 예로, 상기 엔지니어링 된 tracrRNA가 5'-AACAAAUU-3'를 포함하는 경우, 상기 엔지니어링 된 crRNA는 5'-AAGGA-3'를 포함할 수 있다. 또 다른 예로, 상기 엔지니어링 된 tracrRNA가 5'-AACAAAUUC-3'를 포함하는 경우, 상기 엔지니어링 된 crRNA는 5'-GAAGGA-3'를 포함할 수 있다. 또 다른 예로, 상기 엔지니어링 된 tracrRNA가 5'-AACAAAUUCA-3'를 포함하는 경우, 상기 엔지니어링 된 crRNA는 5'-UGAAGGA-3'를 포함할 수 있다. 또 다른 예로, 상기 엔지니어링 된 tracrRNA가 5'-AACAAAUUCAU-3'를 포함하는 경우, 상기 엔지니어링 된 crRNA는 5'-AUGAAGGA-3'를 포함할 수 있다. 또 다른 예로, 상기 엔지니어링 된 tracrRNA가 5'-AACAAAUUCAUU-3'를 포함하는 경우, 상기 엔지니어링 된 crRNA는 5'-AAUGAAGGA-3'를 포함할 수 있다. 또 다른 예로, 상기 엔지니어링 된 tracrRNA가 5'-AACAAAUUCAUUU-3'를 포함하는 경우, 상기 엔지니어링 된 crRNA는 5'-GAAUGAAGGA-3'를 포함할 수 있다.

엔지니어링 된 CRISPR/Cas12f1 복합체

CRISPR/Cas12f1 복합체 개괄

본 명세서에서는 엔지니어링 된 CRISPR/Cas12f1 복합체를 제공한다. 상기 엔지니어링 된 CRISPR/Cas12f1 복합체는 Cas12f1 단백질 및 엔지니어링 된 Cas12f1 가이드 RNA를 포함한다. 이때, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 "엔지니어링 된 Cas12f1 가이드 RNA" 단락에서 설명된 것이다.

일 구현예로, 본 명세서에서는 Cas12f1 단백질 및 엔지니어링 된 Cas12f1 가이드 RNA를 포함하는, 표적 서열을 포함하는 핵산을 편집할 수 있는 엔지니어링 된 CRISPR/Cas12f1 복합체를 제공한다. 이때, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 "엔지니어링 된 Cas12f1 가이드 RNA" 단락에서 설명된 것 중 어느 하나일 수 있다.

Cas12f1 단백질 - 개괄

본 명세서에서 제공하는 엔지니어링 된 CRISPR/Cas12f1 복합체는 Cas12f1 단백질이 포함된다. 기본적으로, 상기 Cas12f1 단백질은 자연계에 존재하는 야생형 Cas12f1 단백질일 수 있다. 상기 Cas12f1 단백질을 암호화하는 서열은 야생형 Cas12f1 단백질에 대해 인간 코돈-최적화된 Cas12f1 서열일 수 있다. 또한, 상기 Cas12f1 단백질은 자연계에 존재하는 야생형 Cas12f1 단백질과 동일한 기능을 가질 수 있다. 하지만, 특별히 한정하지 않는 한, 본 명세서에서 "Cas12f1 단백질"이라고 할 때, 이는 야생형, 또는 코돈 최적화된 Cas12f1 단백질 뿐 아니라, 변형된 Cas12f1 단백질 내지 Cas12f1 융합 단백질도 포괄하여 의미할 수 있다. 또한, 자연계에 존재하는 야생형 Cas12f1 단백질과 동일한 기능을 가지는 것 뿐 아니라, 상기 기능의 전부 또는 일부가 변형된 것, 상기 기능의 전부 또는 일부가 상실된 것, 및/또는 추가적인 기능이 부가된 것을 통틀어 일컬을 수 있다. Cas12f1 단백질의 의미는 문맥에 따라 적절히 해석될 수 있고, 특별한 경우가 아닌 한 가장 넓은 의미로 해석된다. 이하 Cas12f1 단백질의 구성, 또는 기능에 대해 자세히 설명한다.

Cas12f1 단백질 - 야생형 Cas12f1 단백질

본 명세서에서 제공하는 엔지니어링 된 CRISPR/Cas12f1 복합체는 Cas12f1 단백질을 포함할 수 있다.

일 구현예로, 상기 Cas12f1 단백질은 야생형의 Cas12f1 단백질일 수 있다. 일 구현예로, 상기 Cas12f1 단백질은 Cas14 패밀리(Harrington et al., Programmed DNA destruction by miniature CRISPR-Cas14 enzymes, Science 362, 839-842 (2018))에서 유래한 것일 수 있다. 일 구현예로, 상기 Cas12f1 단백질은 Uncultured archaeon 유래의 Cas14a 단백질(Harrington et al., Programmed DNA destruction by miniature CRISPR-Cas14 enzymes, Science 362, 839-842 (2018))일 수 있다. 일 구현예로, 상기 Cas12f1 단백질은 Cas14a1 단백질일 수 있다.

Cas12f1 단백질 - 변형된 Cas12f1 단백질

본 명세서에서 제공하는 엔지니어링 된 CRISPR/Cas12f1 복합체는 변형된 Cas12f1 단백질을 포함할 수 있다. 상기 변형된 Cas12f1은 야생형, 또는 코돈 최적화된 Cas12f1 단백질 서열에서 적어도 일부 서열이 변형된 것을 의미한다. 상기 Cas12f1 단백질 변형은 개별 아미노산 단위로 이루어진 것일 수 있고, 단백질의 기능적 도메인 단위로 이루어진 것일 수 있다.

일 구현예로, 상기 단백질의 변형은 야생형, 또는 코돈 최적화된 Cas12f1 단백질 서열에서 하나 이상의 아미노산, 펩타이드, 폴리펩타이드, 단백질, 및/또는 도메인이 개별적으로 치환, 제거, 및/또는 부가된 것일 수 있다. 일 구현예로, 상기 Cas12f1 단백질은 야생형 Cas12f1 단백질에 포함된 RuvC 도메인 내 하나 이상의 아미노산, 펩타이드, 및/또는 폴리펩타이드가 치환, 제거, 및/또는 부가된 것일 수 있다.

Cas12f1 단백질 - Cas12f1 융합 단백질

본 명세서에서 제공하는 엔지니어링 된 CRISPR/Cas12f1 복합체는 Cas12f1 융합 단백질을 포함할 수 있다. 이때, 상기 Cas12f1 융합 단백질은 야생형, 또는 변형된 Cas12f1 단백질에 추가적인 아미노산, 펩타이드, 폴리펩타이드, 단백질, 및/또는 도메인이 융합된 단백질을 의미한다.

일 구현예로, Cas12f1 단백질은 야생형의 Cas12f1 단백질에 베이스 에디터, 및/또는 역전사 효소(reverse transcriptase)가 융합된 것일 수 있다. 일 구현예로, 상기 베이스 에디터는 adenosine deaminase, 및/또는 cytidine deaminase일 수 있다. 일 구현예로, 상기 역전사 효소는 Moloney Murine Leukemia Virus(M-MLV) 역전사 효소, 및/또는 그 변이체일 수 있다. 이때, 상기 역전사 효소가 융합된 Cas12f1 단백질은 프라임 에디터로 기능할 수 있다.

일 구현예로 , Cas12f1 단백질은 야생형의 Cas12f1 단백질에, 세포 내의 유전자 발현 과정에 관여할 수 있는 다양한 효소가 융합된 것일 수 있다. 이때, 상기 효소가 융합된 Cas12f1 단백질은 세포 내 유전자 발현에 다양한 양적, 질적 변화를 초래할 수 있다. 일 구현예로, 상기 효소는 VP64, DNMT, TET, KRAB, DHAC, LSD, 및/또는 p300일 수 있다.

Cas12f1 단백질 - 기능의 변경

본 명세서에서 제공하는 엔지니어링 된 CRISPR/Cas12f1 복합체에 포함된 Cas12f1 단백질은 야생형의 Cas12f1 단백질과 동일한 기능을 가질 수 있다. 본 명세서에서 제공하는 엔지니어링 된 CRISPR/Cas12f1 복합체에 포함된 Cas12f1 단백질은 야생형의 Cas12f1 단백질과 비교할 때, 기능이 변경된 것일 수 있다. 구체적으로, 상기 변경은 전부 또는 일부 기능의 변형, 전부 또는 일부 기능의 상실, 및/또는 부가적인 기능의 추가일 수 있다. 일 구현예로, 상기 Cas12f1 단백질은 당업계 통상의 기술자가 CRISPR/Cas 시스템의 Cas 단백질에 적용할 수 있는 변경이라면, 특별히 제한되지 않는다. 이때 상기 변경은 공지의 기술을 이용한 것일 수 있다.

일 구현예로, 상기 Cas12f1 단백질은 표적 핵산의 이중가닥 중 하나의 가닥만 절단하도록 변경된 것일 수 있다. 더 나아가, 상기 Cas12f1 단백질은 표적 핵산의 이중가닥 중 하나의 가닥만 절단할 수 있고, 절단하지 않는 가닥에 대해 베이스 에디팅(Base editing) 또는 프라임 에디팅(Prime editing)을 할 수 있도록 변경된 것일 수 있다. 일 구현예로, 상기 Cas12f1 단백질은 표적 핵산의 이중가닥 전부를 절단할 수 없도록 변경된 것일 수 있다. 더 나아가, 상기 Cas12f1 단백질은 표적 핵산의 이중가닥 전부를 절단할 수 없고, 표적 핵산에 대해 베이스 에디팅(Base editing), 프라임 에디팅(Prime editing), 또는 유전자 발현 조절 기능을 할 수 있도록 변경된 것일 수 있다.

Cas12f1 단백질 - 기타 변형 예시

일 구현예로, 상기 Cas12f1 단백질은 NLS(Nuclear Localization Sequence), 또는 NES(Nuclear Export Sequence)를 포함할 수 있다. 구체적으로, 상기 NLS는 "용어의 정의" 중 NLS 단락에 예시된 것 중 어느 하나일 수 있으나, 이에 제한되는 것은 아니다. 일 구현예로, 상기 Cas12f1 단백질은 태그를 포함할 수 있다. 구체적으로, 상기 태그는 "용어의 정의" 중 태그 단락에 예시된 것 중 어느 하나일 수 있으나, 이에 제한되는 것은 아니다.

Cas12f1 단백질 - PAM 서열

CRISPR/Cas12f1 복합체가 표적 유전자, 또는 표적 핵산을 절단하기 위해서는 두 가지 조건이 필요하다.

첫째, 표적 유전자, 또는 표적 핵산 내에 Cas12f1 단백질이 인식할 수 있는 일정 길이의 염기 서열(뉴클레오타이드 서열)이 있어야 한다. 이때, 상기 Cas12f1 단백질에 의해 인식되는 일정 길이의 염기 서열(뉴클레오타이드 서열)을 Protospacer Adjacent Motif(PAM) 서열이라 한다. 상기 PAM 서열은 상기 Cas12f1 단백질에 따라 정해지는 고유한 서열이다, 둘째, 상기 일정 길이의 PAM 서열 주변에 가이드 RNA에 포함된 스페이서 서열과 상보적으로 결합할 수 있는 서열이 있어야 한다.

이러한 두 가지 조건이 만족되어 1) Cas12f1 단백질이 상기 일정 길이의 PAM 서열을 인식하고, 2) 상기 스페이서 서열 부분이 상기 PAM 서열 주변 서열 부분과 상보적으로 결합하는 경우, Cas12f1 단백질/가이드 RNA 복합체(CRISPR/Cas12f1 복합체)는 표적 유전자, 또는 표적 핵산을 절단한다. 따라서, 상기 CRISPR/Cas12f1 복합체의 표적 서열을 결정할 때, 상기 PAM 서열과 인접한 서열 내에서 상기 표적 서열을 결정해야 한다는 제약이 따른다.

Cas12f1 단백질 - PAM 서열 예시

일 구현예로, 상기 Cas12f1 단백질의 PAM 서열은 T-rich 서열일 수 있다.

일 구현예로, 상기 Cas12f1 단백질의 PAM 서열은 5'말단에서 3'말단 순서로, THTN일 수 있다. 이때, 상기 N은 디옥시티미딘(T), 디옥시아데노신(A), 디옥시사이티딘(C), 또는 디옥시구아노신(G) 중 하나이며, 상기 H는 디옥시티미딘(T), 디옥시아데노신(A), 및 디옥시사이티딘(C) 중 하나이다. 일 구현예로, 상기 Cas12f1 단백질의 PAM 서열은 5'말단에서 3'말단 순서로, TTTN일 수 있다. 이때, 상기 N은 디옥시티미딘(T), 디옥시아데노신(A), 디옥시사이티딘(C), 또는 디옥시구아노신(G) 중 하나이다. 일 구현예로, 상기 Cas12f1 단백질의 PAM 서열은 5'말단에서 3'말단 순서로, TTTA, TTTT, TTTC, 또는 TTTG일 수 있다. 일 구현예로, 상기 Cas12f1 단백질의 PAM 서열은 5'말단에서 3'말단 순서로, TATA, TATT, TATC, 또는 TATG일 수 있다. 일 구현예로, 상기 Cas12f1 단백질의 PAM 서열은 5'말단에서 3'말단 순서로, TCTA, TCTT, TCTC, 또는 TCTG일 수 있다. 일 구현예로, 상기 Cas12f1 단백질의 PAM 서열은 5' 말단에서 3' 말단 순서로, TTTA 또는 TTTG일 수 있다. 일 구현예로, 상기 Cas12f1 단백질의 PAM 서열은 야생형 Cas12f1 단백질의 PAM 서열과는 다른 것일 수 있다.

Cas12f1 단백질 - 서열 예시

일 구현예로, 상기 Cas12f1 단백질은 서열번호 260 내지 267로 이루어진 군에서 선택된 아미노산 서열을 가질 수 있다.

일 구현예로, 상기 Cas12f1 단백질을 암호화하는 DNA 서열은 인간 코돈-최적화된 서열일 수 있다.

일 구현예로, 상기 Cas12f1 단백질을 암호화하는 DNA 서열은 서열번호 268 내지 277로 이루어진 군에서 선택된 DNA 서열일 수 있다.

엔지니어링 된 Cas12f1 가이드 RNA

본 명세서에서 제공되는 CRISPR/Cas12f1 복합체를 구성하는 엔지니어링 된 Cas12f1 가이드 RNA는 "엔지니어링 된 Cas12f1 가이드 RNA" 단락에서 설명된 것과 동일한 특징 및 구조를 가진다.

CRISPR/Cas12f1 복합체 - 구성 예시

일 구현예로, 상기 Cas12f1 단백질은 서열번호 260의 아미노산 서열을 가지고, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 서열번호 211 내지 서열번호 253, 서열번호 296 내지 서열번호 308, 서열번호 311 내지 서열번호 323, 서열번호 326 내지 서열번호 338, 서열번호 488 내지 서열번호 541, 및 서열번호 545 내지 서열번호 551로 이루어진 군에서 선택된 아미노산 서열을 가진다. 이 때, 상기 Cas12f1 단백질 및 상기 엔지니어링 된 Cas12f1 가이드 RNA가 결합하여 CRISPR/Cas12f1 복합체를 이루고 있을 수 있다.

일 구현예로, 상기 Cas12f1 단백질은 서열번호 264 내지 267 로 이루어진 군에서 선택된 아미노산 서열을 가지고, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 서열번호 211 내지 서열번호 253, 서열번호 296 내지 서열번호 308, 서열번호 311 내지 서열번호 323, 서열번호 326 내지 서열번호 338, 서열번호 488 내지 서열번호 541, 및 서열번호 545 내지 서열번호 551로 이루어진 군에서 선택된 서열을 가진다. 이 때, 상기 Cas12f1 단백질 및 상기 엔지니어링 된 Cas12f1 가이드 RNA가 결합하여 이루어진 CRISPR/Cas12f1 복합체는 베이스 에디팅 기능을 가질 수 있다.

CRISPR/Cas12f1 시스템의 각 구성요소를 발현시키기 위한 벡터

벡터 개괄

본 명세서에서는 CRISPR/Cas12f1 시스템의 구성 요소를 발현시키기 위한 벡터를 제공한다. 상기 벡터는 Cas12f1 단백질, 및/또는 엔지니어링 된 Cas12f1 가이드 RNA를 발현시키도록 구성된다. 상기 벡터의 서열은 상기 CRISPR/Cas12f1 시스템의 구성요소 중 하나를 암호화하는 핵산 서열을 포함하거나, 둘 이상의 구성요소를 암호화하는 핵산 서열을 포함할 수 있다. 상기 벡터의 서열은 Cas12f1 단백질을 암호화하는 핵산 서열 및/또는 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열을 포함한다. 상기 벡터의 서열은 하나 이상의 프로모터 서열을 포함한다. 상기 프로모터는 Cas12f1 단백질을 암호화하는 핵산 서열 및/또는 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열과 작동적으로 연결되어, 세포 내에서 상기 핵산 서열의 전사가 촉진될 수 있도록 한다. 상기 Cas12f1 단백질은 "엔지니어링 된 CRISPR/Cas12f1 복합체" 단락에서 설명된 Cas12f1 단백질, 변형된 Cas12f1 단백질, 및/또는 Cas12f1 융합 단백질과 동일한 특징 및 구성을 가진다. 상기 엔지니어링 된 Cas12f1 가이드 RNA는 "엔지니어링 된 Cas12f1 가이드 RNA" 단락에서 설명된 엔지니어링 된 Cas12f1 가이드 RNA와 동일한 특징 및 구성을 가진다.

상기 벡터의 서열은 Cas12f1 단백질을 암호화하는 핵산 서열 및 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열을 포함할 수 있다. 일 구현예로, 상기 벡터의 서열은 Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 제1 서열, 및 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열을 포함하는 제2 서열을 포함할 수 있다. 상기 벡터의 서열은 Cas12f1 단백질을 암호화하는 핵산 서열을 세포 내에서 발현시키기 위한 프로모터 서열, 및 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열을 세포 내에서 발현시키기 위한 프로모터 서열을 포함하고, 상기 프로모터들은 각 발현 대상과 작동적으로 연결(operably linked)되어 있다. 일 구현예로, 상기 벡터의 서열은 상기 제1 서열과 작동 가능하게 연결된 제1 프로모터 서열, 및 상기 제2 서열과 작동 가능하게 연결된 제2 프로모터 서열을 포함할 수 있다.

상기 벡터의 서열은 Cas12f1 단백질을 암호화하는 핵산 서열 및 둘 이상의 서로 다른 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열을 포함할 수 있다. 일 구현예로, 상기 벡터의 서열은 Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 제1 서열, 제1 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열을 포함하는 제2 서열, 제2 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열을 포함하는 제3 서열을 포함할 수 있다. 더 나아가, 상기 벡터의 서열은 상기 제1 서열과 작동 가능하게 연결된 제1 프로모터 서열, 상기 제2 서열과 작동 가능하게 연결된 제2 프로모터 서열, 상기 제3 서열과 작동 가능하게 연결된 제3 프로모터 서열을 포함할 수 있다.

상기 벡터에서, 각 구성요소를 암호화하는 핵산 서열은 DNA 서열일 수 있다.

발현 대상 - Cas12f1 단백질

상기 벡터는 Cas12f1 단백질을 발현하도록 구성된 것일 수 있다. 이때, 상기 Cas12f1 단백질은 "엔지니어링 된 CRISPR/Cas12f1 복합체" 단락에서 설명된 것과 동일한 구성 및 특징을 가진다.

일 구현예로, 상기 벡터는 야생형의 Cas12f1 단백질을 발현하도록 구성된 것일 수 있다. 이때, 상기 야생형의 Cas12f1 단백질은 Cas14a1일 수 있다. 일 구현예로, 상기 벡터는 표적 핵산의 이중가닥 중 하나의 가닥만 절단하도록 변경된 Cas12f1 단백질을 발현하도록 구성된 것일 수 있다. 더 나아가, 상기 변경된 Cas12f1 단백질은 표적 핵산의 이중가닥 중 하나의 가닥만 절단할 수 있고, 절단하지 않는 가닥에 대해 베이스 에디팅(Base editing) 또는 프라임 에디팅(Prime editing)을 할 수 있도록 변경된 것일 수 있다. 일 구현예로, 상기 Cas12f1 단백질은 표적 핵산의 이중가닥 전부를 절단할 수 없도록 변경된 것일 수 있다. 더 나아가, 상기 Cas12f1 단백질은 표적 핵산의 이중가닥 전부를 절단할 수 없고, 표적 핵산에 대해 베이스 에디팅(Base editing), 프라임 에디팅(Prime editing), 또는 유전자 발현 조절 기능을 할 수 있도록 변경된 것일 수 있다.

발현 대상 - 엔지니어링 된 Cas12f1 가이드 RNA

상기 벡터는 엔지니어링 된 Cas12f1 가이드 RNA를 발현하도록 구성된 것일 수 있다. 상기 엔지니어링 된 Cas12f1 가이드 RNA는 "엔지니어링 된 Cas12f1 가이드 RNA" 단락에서 설명한 엔지니어링 된 Cas12f1 가이드 RNA와 동일한 특징 및 구성을 가진다. 상기 벡터는 둘 이상의 서로 다른 엔지니어링 된 Cas12f1 가이드 RNA를 발현하도록 구성된 것일 수 있다.

발현 대상 - 부가 구성 요소

상기 벡터는 전술한 발현 대상 외, NLS, 태그 단백질 등의 부가 구성 요소를 발현하도록 구성된 것일 수 있다. 일 구현예로, 상기 부가 구성 요소는 상기 Cas12f1, 변형된 Cas12f1, 및/또는 엔지니어링 된 Cas12f1 가이드 RNA와는 독립적으로 발현될 수 있다. 또 다른 구현예로, 상기 부가 구성 요소는 상기 Cas12f1, 변형된 Cas12f1, 및/또는 엔지니어링 된 Cas12f1 가이드 RNA와 연결되어 발현될 수 있다. 이때, 상기 부가 구성 요소는 CRISPR/Cas 시스템을 발현시키고자 할 때 일반적으로 발현시키는 구성 요소일 수 있으며, 공지기술을 참조할 수 있다. 상기 부가 구성 요소는 "배경기술 - CRISPR/Cas 시스템 발현 벡터 설계" 섹션에서 설명된 구성 요소 중 하나 이상일 수 있다.

벡터 구성 - Cas12f1 단백질 발현 서열

상기 벡터 서열은 상기 Cas12f1 단백질을 암호화하는 핵산 서열을 포함할 수 있다. 이때, 상기 Cas12f1 단백질은 "엔지니어링 된 CRISPR/Cas12f1 복합체" 단락에서 설명된 것과 동일한 구성 및 특징을 가진다.

일 구현예로, 상기 벡터의 서열은 야생형의 Cas12f1 단백질을 암호화하는 서열을 포함할 수 있다. 이때, 상기 야생형의 Cas12f1 단백질은 Cas14a1일 수 있다. 일 구현예로, 상기 벡터의 서열은 Cas12f1 단백질을 암호화하는 인간 코돈 최적화된 핵산 서열을 포함할 수 있다. 이때, 상기 Cas12f1 단백질을 암호화하는 인간 코돈 최적화된 핵산 서열은 Cas14a1 단백질을 암호화하는 인간 코돈 최적화된 핵산 서열일 수 있다. 일 구현예로, 상기 벡터의 서열은 변형된 Cas12f1 단백질 또는 Cas12f1 융합 단백질을 암호화하는 서열을 포함할 수 있다. 일 구현예로, 상기 벡터의 서열은 표적 핵산의 이중가닥 중 하나의 가닥만 절단할 수 있고, 절단하지 않는 가닥에 대해 베이스 에디팅(Base editing) 또는 프라임 에디팅(Prime editing)을 할 수 있도록 변경된 Cas12f1 단백질을 암호화하는 서열을 포함할 수 있다. 일 구현예로, 상기 Cas12f1 단백질은 표적 핵산의 이중가닥 전부를 절단할 수 없고, 표적 핵산에 대해 베이스 에디팅(Base editing), 프라임 에디팅(Prime editing), 또는 유전자 발현 조절 기능을 할 수 있도록 변경된 Cas12f1 단백질을 암호화하는 서열을 포함할 수 있다.

벡터 구성 - 엔지니어링 된 Cas12f1 가이드 RNA 발현 서열

일 구현예로, 상기 벡터의 서열은 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 서열을 포함할 수 있다. 예를 들어, 상기 벡터의 서열은 서열번호 211 내지 서열번호 253, 서열번호 296 내지 서열번호 308, 서열번호 311 내지 서열번호 323, 서열번호 326 내지 서열번호 338, 서열번호 488 내지 서열번호 541, 및 서열번호 545 내지 서열번호 551로 이루어진 군에서 선택된 서열을 포함할 수 있다.

일 구현예로, 상기 벡터의 서열은 둘 이상의 서로 다른 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 서열을 포함할 수 있다. 예를 들어, 상기 벡터의 서열은 서열번호 211 내지 서열번호 253, 서열번호 296 내지 서열번호 308, 서열번호 311 내지 서열번호 323, 서열번호 326 내지 서열번호 338, 서열번호 488 내지 서열번호 541, 및 서열번호 545 내지 서열번호 551로 이루어진 군에서 각각 선택된 제1 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 서열, 및 제2 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 서열을 포함할 수 있다.

벡터 구성 - 프로모터 서열

상기 벡터 서열은 각 구성요소를 암호화하는 서열에 작동 가능하게 연결된 프로모터 서열을 포함한다. 구체적으로, 상기 프로모터 서열은 "배경기술 - CRISPR/Cas 시스템 발현 벡터 설계" 섹션 중 프로모터 부분에 개시된 프로모터 중 하나일 수 있으나, 이에 제한되지 않는다.

일 구현예로, 상기 벡터 서열은 Cas12f1 단백질을 암호화하는 서열, 및 프로모터 서열을 포함할 수 있다. 이때, 상기 프로모터 서열은 상기 Cas12f1 단백질을 암호화하는 서열과 작동 가능하게 연결된이다. 일 구현예로, 상기 벡터 서열은 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 서열, 및 프로모터 서열을 포함할 수 있다. 이때, 상기 프로모터 서열은 상기 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 서열과 작동 가능하게 연결된이다. 일 구현예로, 상기 벡터 서열은 Cas12f1 단백질을 암호화하는 서열, 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 서열, 및 프로모터 서열을 포함할 수 있다. 이때, 상기 프로모터 서열은 상기 Cas12f1 단백질을 암호화하는 서열, 및 상기 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 서열과 작동적으로 연결되며, 상기 프로모터 서열로 인해 활성화된 전사 인자가 상기 Cas12f1 단백질 및 상기 엔지니어링 된 Cas12f1 가이드 RNA를 발현시킨다.

벡터 구성 - 둘 이상의 프로모터 서열 포함 가능

일 구현예로, 상기 벡터 서열은 Cas12f1 단백질을 암호화하는 제1 서열, 제1 프로모터 서열, 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 제2 서열, 및 제2 프로모터 서열을 포함할 수 있다. 이때, 상기 제1 프로모터 서열은 상기 제1 서열과 작동적으로 연결되고, 상기 제2 프로모터 서열은 상지 제2 서열과 작동적으로 연결되며, 상기 제1 프로모터 서열에 의해 상기 제1 서열의 전사가 유도되고, 상기 제2 프로모터 서열에 의해 상기 제2 서열의 전사가 유도된다. 이때, 상기 제1 프로모터 및 상기 제2 프로모터는 동일한 종류의 프로모터일 수 있다. 이때, 상기 제1 프로모터 및 상기 제2 프로모터는 상이한 종류의 프로모터일 수 있다.

일 구현예로, 상기 벡터 서열은 Cas12f1 단백질을 암호화하는 제1 서열, 제1 프로모터 서열, 제1 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 제2 서열, 제2 프로모터 서열, 제2 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 제3 서열, 및 제3 프로모터 서열 을 포함할 수 있다. 이때, 상기 제1 프로모터 서열은 상기 제1 서열과 작동적으로 연결되고, 상기 제2 프로모터 서열은 상기 제2 서열과 작동적으로 연결되고, 상기 제3 프로모터 서열은 상기 제3 서열과 작동적으로 연결되며, 상기 제1 프로모터 서열에 의해 상기 제1 서열의 전사가 유도되고, 상기 제2 프로모터 서열에 의해 상기 제2 서열의 전사가 유도되며, 상기 제3 프로모터 서열에 의해 상기 제3 서열의 전사가 유도된다. 이때, 상기 제2 프로모터 및 상기 제3 프로모터는 동일한 종류의 프로모터일 수 있다. 구체적으로, 상기 제2 프로모터 서열 및 상기 제3 프로모터 서열은 U6 프로모터 서열일 수 있으나, 이에 제한되는 것은 아니다. 이때, 상기 제2 프로모터 및 상기 제3 프로모터는 상이한 종류의 프로모터일 수 있다. 구체적으로, 상기 제2 프로모터는 U6 프로모터 서열, 상기 제3 프로모터는 H1 프로모터 서열일 수 있으나, 이에 제한되는 것은 아니다.

벡터 구성 - 종결 신호

상기 벡터는 상기 프로모터 서열과 작동 가능하게 연결된 종결 신호를 포함할 수 있다. 이때, 상기 종결 신호는 "배경기술 - CRISPR/Cas 시스템 발현 벡터 설계" 섹션의 종결 신호 부분에서 개시된 종결 신호 중 하나일 수 있으나, 이에 제한되지 않는다. 상기 종결 신호는, 프로모터 서열의 종류에 따라 달라질 수 있다.

일 구현예로, 상기 벡터 서열이 U6 프로모터 서열을 포함하는 경우, 상기 U6 프로모터 서열과 작동 가능하게 연결된, 티미딘 연속 서열이 종결 신호로 작용할 수 있다. 일 구현예로, 상기 티미딘 연속 서열은 5개 이상의 티미딘이 연속으로 연결된 서열일 수 있다. 일 구현예로, 상기 벡터 서열이 H1 프로모터 서열을 포함하는 경우, 상기 H1 프로모터 서열과 작동 가능하게 연결된, 티미딘 연속 서열이 종결 신호로 작용할 수 있다. 일 구현예로, 상기 티미딘 연속 서열은 5개 이상의 티미딘이 연속으로 연결된 서열일 수 있다.

벡터 구성 - 기타 구성

상기 벡터 서열은 상기 구성 외, 목적에 따라 필요한 구성요소를 포함할 수 있다.

일 구현예로, 상기 벡터 서열은 조절/제어 구성요소 서열, 및/또는 부가 구성 요소 서열을 포함할 수 있다. 일 구현예로, 상기 부가 구성 요소는 형질주입된 세포를 비형질주입 세포로부터 구별하기 위한 목적으로 부가된 것일 수 있다. 이때, 상기 조절/제어 구성요소 서열 및 부가 구성 요소는 "배경기술 - CRISPR/Cas 시스템 발현 벡터 설계" 섹션에 개시된 것 중 하나일 수 있으나, 이에 제한되는 것은 아니다.

벡터 종류 - 바이러스 벡터

상기 벡터는 바이러스 벡터일 수 있다.

일 구현예로, 상기 바이러스 벡터는 레트로바이러스, 렌티바이러스, 아데노바이러스, 아데노-연관 바이러스, 백시니아바이러스, 폭스바이러스 및 단순포진 바이러스로 구성된 군에서 선택되는 하나 이상일 수 있다. 일 구현예로, 상기 바이러스 벡터는 아데노-연관 바이러스일 수 있다.

벡터 종류 - 비바이러스 벡터

상기 벡터는 비바이러스 벡터일 수 있다. 일 구현예로, 상기 비바이러스 벡터는 플라스미드, 파지, 네이키드 DNA, DNA 복합체, 및 mRNA로 구성된 군에서 선택되는 1 이상일 수 있다. 일 구현예로, 상기 플라스미드는 pcDNA 시리즈, pS456, pG1806, pACYC177, ColE1, pKT230, pME290, pBR322, pUC8/9, pUC6, pBD9, pHC79, pIJ61, pLAFR1, pHV14, pGEX 시리즈, pET 시리즈, 및 pUC19으로 이루어진 군에서 선택된 것일 수 있다. 일 구현예로, 상기 파지는 λgt4λB, λ-Charon, λΔz1, 및 M13으로 이루어진 군에서 선택된 것일 수 있다. 일 구현예로, 상기 벡터는 PCR 앰플리콘(amplicon)일 수 있다.

벡터 형태 - 원형 또는 선형 벡터

상기 벡터는 원형 또는 선형 형태일 수 있다. 상기 벡터가 선형 벡터인 경우, 상기 선형 벡터 서열이 종결 신호를 따로 포함하지 않더라도, 그 3'말단에서 RNA 전사가 종결된다. 이와 비교하여, 상기 벡터가 원형 벡터인 경우, 상기 원형 벡터 서열이 종결 신호를 따로 포함하지 않는다면, RNA 전사가 종결되지 않게 된다. 따라서, 상기 벡터로 원형 벡터를 사용하는 경우, 의도한 대상을 발현하기 위해서는 각 프로모터 서열과 관련된 전사 인자에 대응하는 종결 신호가 포함되어야 한다.

일 구현예로, 상기 벡터는 선형 벡터일 수 있다. 일 구현예로, 상기 벡터는 선형의 앰플리콘일 수 있다. 일 구현예로, 상기 벡터는 서열번호 211 내지 서열번호 253, 서열번호 296 내지 서열번호 308, 서열번호 311 내지 서열번호 323, 서열번호 326 내지 서열번호 338, 서열번호 488 내지 서열번호 541, 및 서열번호 545 내지 서열번호 551로 이루어진 군에서 선택된 서열을 포함하는 선형의 앰플리콘일 수 있다. 일 구현예로, 상기 벡터는 원형 벡터일 수 있다. 일 구현예로, 상기 벡터는 서열번호 211 내지 서열번호 253, 서열번호 296 내지 서열번호 308, 서열번호 311 내지 서열번호 323, 서열번호 326 내지 서열번호 338, 서열번호 488 내지 서열번호 541, 및 서열번호 545 내지 서열번호 551로 이루어진 군에서 선택된 서열을 포함하는 원형 벡터일 수 있다.

벡터 - 서열 예시

일 구현예로, 상기 벡터의 서열은 서열번호 211 내지 서열번호 253, 서열번호 296 내지 서열번호 308, 서열번호 311 내지 서열번호 323, 서열번호 326 내지 서열번호 338, 서열번호 488 내지 서열번호 541, 및 서열번호 545 내지 서열번호 551로 이루어진 군에서 선택된 서열을 포함할 수 있다.

엔지니어링 된 CRISPR/Cas12f1 시스템의 각 구성요소를 포함하는 유전자 편집용 조성물

본 명세서에서는, CRISPR/Cas12f1 시스템의 각 구성요소를 포함하는 유전자 편집용 조성물을 개시한다. 일 구현예로, 본 명세서에서는 다음을 포함하는 유전자 편집용 조성물을 개시한다: Cas12f1 단백질 또는 이를 암호화하는 핵산; 및 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산. 이때, 상기 Cas12f1 단백질은 "엔지니어링 된 CRISPR/Cas12f1 복합체" 단락에서 개시된 것일 수 있다. 이때, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 "엔지니어링 된 Cas12f1 가이드 RNA" 단락에 개시된 것일 수 있다.

상기 유전자 편집용 조성물은 상기 CRISPR/Cas12f1 시스템의 각 구성요소 외 유전자 편집 용도에 필요한 적절한 물질을 추가로 포함할 수 있다.

핵산의 화학적인 변형

본 명세서에서는 엔지니어링 된 crRNA 또는 이를 암호화하는 핵산, 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화 하는 핵산, 및/또는 CRISPR/Cas12f1 시스템의 구성 요소를 발현시키기 위한 벡터 등 핵산을 포함하거나, 핵산으로 이루어진 구성 요소를 제공한다. 이때, 상기 구성 요소에서 "핵산"이라 함은, 자연계에 존재하는 DNA, 또는 RNA일 수 있고, 상기 구성 핵산의 일부 또는 전부에 화학적 변형이 일어난, 변형된 핵산일 수 있다. 일 구현예로, 상기 구성 핵산은 자연계에 존재하는 DNA, 및/또는 RNA일 수 있다. 일 구현예로, 상기 구성 핵산은 하나 이상의 뉴클레오타이드가 화학적으로 변형된 것일 수 있다. 이때, 상기 화학적 변형은 당업자에게 알려진 핵산의 변형을 모두 포함한다. 구체적으로, 상기 화학적 변형은 (WO 2019/089820 A1)에 기재된 핵산의 변형을 모두 포함할 수 있으나, 이에 제한되는 것은 아니다.

엔지니어링 된 Cas12f1 가이드 RNA를 이용한 유전자 편집 방법

유전자 편집 방법 개괄

본 명세서에서는 엔지니어링 된 crRNA를 이용하여 대상 세포 내의 표적 유전자, 또는 표적 핵산을 편집하는 방법을 제공한다. 상기 표적 유전자, 또는 표적 핵산은 표적 서열을 포함한다. 상기 표적 핵산은 단일가닥 DNA, 이중가닥 DNA, 및/또는 RNA일 수 있다. 상기 유전자 편집 방법은, 엔지니어링 된 Cas12f1 가이드 RNA, 및 Cas12f1 단백질, 또는 각각을 암호화하는 핵산을 표적 유전자, 또는 표적 핵산을 포함하고 있는 대상 세포 내에 전달하는 것을 포함한다. 그 결과, 상기 대상 세포 내에 엔지니어링 된 CRISPR/Cas12f1 복합체가 주입되거나, 엔지니어링 된 CRISPR/Cas12f1 복합체의 형성이 유도되며, 상기 엔지니어링 된 CRISPR/Cas12f1 복합체에 의해 표적 유전자가 편집된다. 상기 엔지니어링 된 Cas12f1 가이드 RNA는 "엔지니어링 된 Cas12f1 가이드 RNA" 단락에서 설명된 것과 동일한 특징 및 구조를 가진다. 상기 Cas12f1 단백질은 "엔지니어링 된 CRISPR/Cas12f1 복합체" 섹션에서 설명된 Cas12f1 단백질, 및/또는 변형된 Cas12f1 단백질과 동일한 특징 및 구성을 가진다.

일 구현예로, 상기 유전자 편집 방법은 Cas12f1 단백질 또는 이를 암호화하는 핵산, 및 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산을 대상 세포 내로 전달하는 것을 포함할 수 있다.

이때, 상기 엔지니어링 된 Cas12f1 가이드 RNA는 엔지니어링 된 스캐폴드 영역, 스페이서, 및 U-rich tail을 포함한다.

이때, 상기 엔지니어링 된 스캐폴드 영역은 전술한 "엔지니어링 된 스캐폴드 영역" 단락 중 어느 하나에서 서술된 것과 동일한 특징 및 구조를 가진다. 일 예로, 상기 엔지니어링 된 스캐폴드 영역은 서열번호 168 내지 187으로 이루어진 군에서 선택된 서열로 표현될 수 있다. 또 다른 예로, 상기 엔지니어링 된 스캐폴드 영역은 서열번호 188 내지 199으로 이루어진 군에서 선택된 서열로 표현될 수 있다. 또 다른 예로, 상기 엔지니어링 된 스캐폴드 영역은 서열번호 200 내지 206으로 이루어진 군에서 선택된 서열로 표현될 수 있다. 또 다른 예로, 상기 엔지니어링 된 스캐폴드 영역은 서열번호 207 내지 210으로 이루어진 군에서 선택된 서열로 표현될 수 있다.

이때, 상기 스페이서 서열은 상기 대상 세포 내에 포함된 표적 유전자, 또는 표적 핵산과 상보적으로 결합할 수 있다.

이때, 상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현되며, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이고, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상고, c는 1 내지 10이다. 일 예로, 상기 U-rich tail의 서열은 5'-UUUUAUUUU-3'일 수 있다. 일 예로, 상기 U-rich tail의 서열은 5'-UUUUGUUUU-3'일 수 있다.

대상 세포

일 구현예로, 상기 대상 세포는 원핵 세포일 수 있다. 일 구현예로, 상기 대상 세포는 진핵 세포일 수 있다. 구체적으로, 상기 진핵 세포는 식물 세포, 동물 세포, 및/또는 인간 세포일 수 있으나, 이에 제한되지 않는다.

표적 서열 결정

CRISPR/Cas12f1 복합체로 편집하고자 하는 표적 유전자, 또는 표적 핵산, 및 표적 서열은 유전자 편집의 목적, 대상 세포 환경, Cas12f1 단백질이 인식하는 PAM 서열, 및/또는 기타 변수를 고려하여 결정할 수 있다. 이때, 적절한 길이의 표적 서열을 결정할 수 있다면, 그 방법은 특별히 제한되지 않으며, 공지된 기술을 활용할 수 있다.

표적 서열에 따른 스페이서 서열 결정

상기 표적 서열이 결정되고 나면, 이에 대응하는 스페이서 서열을 설계한다. 상기 스페이서 서열은 상기 표적 서열과 상보적으로 결합할 수 있는 서열로 설계된다. 일 구현예로, 상기 스페이서 서열은 상기 표적 유전자와 상보적으로 결합할 수 있는 서열로 설계된다. 일 구현예로, 상기 스페이서 서열은 상기 표적 핵산과 상보적으로 결합할 수 있도록 설계된다. 일 구현예로, 상기 스페이서 서열은 상기 표적 핵산의 표적 가닥 서열에 포함된 표적 서열과 상보적인 서열로 설계된다. 일 구현예로, 상기 스페이서 서열은 상기 표적 핵산의 비표적 가닥 서열에 포함된 프로토스페이서의 DNA 서열에 상응하는 RNA 서열로 설계된다. 구체적으로, 상기 스페이서 서열은, 상기 프로토스페이서 서열과 동일한 뉴클레오티드 서열을 가지되, 상기 뉴클레오티드 서열에 포함된 티미딘 각각이 모두 유리딘으로 치환된 서열로 설계된다.

일 구현예에서, 상기 스페이서는 10 내지 50 뉴클레오타이드 길이를 가진다. 예를 들어, 10개, 11개 , 12개, 13개, 14 개, 15 개, 16 개, 17 개, 18 개, 19 개, 20 개, 21 개, 22 개, 23 개, 24 개, 25 개, 26 개, 27 개, 28 개, 29 개, 30 개, 31 개, 32 개, 33 개, 34 개, 35 개, 36 개, 37 개, 38 개, 39 개, 40 개, 41 개, 42 개, 43 개, 44 개, 45 개, 46 개, 47 개, 48 개, 49 개 또는 50개의 뉴클레오타이드 길이를 가진다. 바람직하게는 17 개, 18 개, 19 개, 20 개, 21 개, 22 개, 23 개, 24 개 또는 25개의 뉴클레오타이드 길이를 가진다.

표적 서열과 스페이서 서열의 상보성

일 구현예로, 상기 스페이서 서열은 상기 표적 서열과 60%, 61%, 62%, 63%, 64%, 65%, 66%, 67%, 68%, 69%, 70%, 71%, 72%, 73%, 74%, 75%, 76%, 77%, 78%, 79%, 80%, 81%, 82%, 83%, 84%, 85%, 86%, 87%, 88%, 89%, 90%, 91%, 92%, 93%, 94%, 95%, 96%, 97%, 98%, 99%, 또는 100% 상보적인 서열일 수 있다. 일 구현예로, 상기 스페이서 서열은 상기 표적 서열과 바로 이전 문장에서 선택된 수치 범위 내 상보적인 서열일 수 있다. 예를 들어, 상기 스페이서 서열은 상기 표적 서열과 60% 내지 90% 상보적인 서열일 수 있다. 또 다른 예를 들어, 상기 스페이서 서열은 상기 표적 서열과 90% 내지 100% 상보적인 서열일 수 있다.

표적 서열과 스페이서 서열 간 미스매치 개수

일 구현예로, 상기 스페이서 서열은 상기 표적 서열과 0개, 1개, 2개, 3개, 4개, 5개, 6개, 7개, 8개, 9개, 또는 10개의 미스매치를 가지는 상보적인 서열일 수 있다. 일 구현예로, 상기 스페이서 서열은 바로 이전 문장에서 선택된 수치 범위 내의 미스매치를 가질 수 있다. 예를 들어, 상기 스페이서 서열은 상기 표적 서열과 0 개, 1 개, 2 개, 3 개, 4 개,또는 5개의 미스매치를 가질 수 있다. 또 다른 예를 들어, 상기 스페이서 서열은 상기 표적 서열과 6개 내지 10개의 미스매치를 기질 수 있다.

CRISPR/Cas12f1 복합체 이용

본 명세서에서 제공하는 유전자 편집 방법은 엔지니어링 된 CRISPR/Cas12f1 복합체가 표적 특이적으로 유전자, 또는 핵산을 절단하는 활성을 가지는 점을 이용한다. 상기 엔지니어링 된 CRISPR/Cas12f1 복합체는 "엔지니어링 된 CRISPR/Cas12f1 복합체" 섹션에서 설명된 엔지니어링 된 CRISPR/Cas12f1 복합체와 동일한 특징 및 구성을 가진다.

CRISRP/Cas12f1 복합체 각 구성 요소의 세포 내 전달

본 명세서에서 제공하는 유전자 편집 방법은 대상 세포 내에서 엔지니어링 된 CRISPR/Cas12f1 복합체가 표적 유전자 또는 표적 핵산과 접촉하는 것을 포함로 한다. 따라서, 상기 엔지니어링 된 CRISPR/Cas12f1 복합체가 상기 표적 유전자, 또는 표적 핵산과 접촉하는 것을 유도하기 위해, 상기 유전자 편집 방법은 상기 엔지니어링 된 CRISPR/Cas12f1 복합체의 각 구성요소를 대상 세포 내에 전달하는 것을 포함한다.

일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산 및 Cas12f1 단백질 또는 이를 암호화하는 핵산을 대상 세포 내에 전달하는 것을 포함할 수 있다. 일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA 및 Cas12f1 단백질을 대상 세포 내에 전달하는 것을 포함할 수 있다. 일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 및 Cas12f1 단백질을 대상 세포 내에 전달하는 것을 포함할 수 있다. 일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA 및 Cas12f1 단백질을 암호화하는 핵산을 대상 세포 내에 전달하는 것을 포함할 수 있다. 일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 및 Cas12f1 단백질을 암호화하는 핵산을 대상 세포 내에 전달하는 것을 포함할 수 있다.

엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산, 및 Cas12f1 단백질 또는 이를 암호화하는 핵산은 다양한 전달 형태로, 다양한 전달 방법을 이용하여 대상 세포 내에 전달될 수 있다.

전달 형태 - RNP

상기 전달 형태로, 엔지니어링 된 Cas12f1 가이드 RNA 및 Cas12f1 단백질이 결합한 리보뉴클레오프로틴 입자(Ribonucleoprotein particle, RNP)를 이용할 수 있다. 일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA 및 Cas12f1 단백질이 결합한 CRISPR/Cas12f1 복합체를 대상 세포 내에 주입하는 것을 포함할 수 있다.

전달 형태 - 비바이러스 벡터

또 다른 전달 형태로, 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열 및 Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 비바이러스 벡터를 이용할 수 있다. 일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열 및 Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 비바이러스 벡터를 대상 세포 내에 주입하는 것을 포함할 수 있다. 구체적으로, 상기 비바이러스 벡터는 플라스미드, 네이키드 DNA, DNA 복합체, 또는 mRNA일 수 있으나, 이에 제한되는 것은 아니다. 또 다른 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열을 포함하는 제1 비바이러스 벡터, 및 Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 제2 비바이러스 벡터를 대상 세포 내에 주입하는 것을 포함할 수 있다. 구체적으로, 상기 제1 비바이러스 벡터 및 상기 제2 비바이러스 벡터는 각각 플라스미드, 네이키드 DNA, DNA 복합체, 및 mRNA로 이루어진 군에서 선택된 하나일 수 있으나, 이에 제한되는 것은 아니다.

전달 형태 - 바이러스 벡터

또 다른 전달 형태로, 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열 및 Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 바이러스 벡터를 이용할 수 있다. 일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열 및 Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 바이러스 벡터를 대상 세포 내에 주입하는 것을 포함할 수 있다. 구체적으로, 상기 바이러스 벡터는 레트로바이러스, 렌티바이러스, 아데노바이러스, 아데노-연관 바이러스, 백시니아바이러스, 폭스바이러스 및 단순포진 바이러스로 구성된 군에서 선택된 하나일 수 있으나, 이에 제한되는 것은 아니다. 일 구현예로, 상기 바이러스 벡터는 아데노-연관 바이러스일 수 있다.

또 다른 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열을 포함하는 제1 바이러스 벡터, 및 Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 제2 바이러스 벡터를 대상 세포 내에 주입하는 것을 포함할 수 있다. 구체적으로, 상기 제1 바이러스 벡터 및 제2 바이러스 벡터는 각각 레트로바이러스, 렌티바이러스, 아데노바이러스, 아데노-연관 바이러스, 백시니아바이러스, 폭스바이러스 및 단순포진 바이러스로 구성된 군에서 선택된 하나일 수 있으나, 이에 제한되는 것은 아니다.

전달 방법 - 일반적인 전달 수단

상기 전달 방법은, 세포 내로 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산, 및 Cas12f1 단백질 또는 이를 암호화하는 핵산을 적절한 전달 형태로 세포 내로 전달할 수 있는 것이라면 특별히 제한되지 않는다. 일 구현예로, 상기 전달 방법은 전기천공법, 유전자총, 초음파천공법, 자기주입법(magnetofection), 및/또는 일시적인 세포 압축 또는 스퀴징일 수 있다.

전달 방법 - 나노파티클

상기 전달 방법은, 상기 CRISPR/Cas12f1 시스템에 포함된 적어도 하나의 구성요소를 나노파티클을 이용하여 전달하는 것일 수 있다. 이때, 상기 전달 방법은 당업계 통상의 기술자가 적절히 선택할 수 있는 공지된 방법일 수 있다. 예를 들어, 상기 나노파티클 전달 방법은 (WO 2019/089820 A1)에 개시된 방법일 수 있으나, 이에 제한되는 것은 아니다.

일 구현예로, 상기 전달 방법은 Cas12f1 단백질 또는 이를 암호화하는 핵산 및/또는 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산을 나노파티클을 이용하여 전달하는 것일 수 있다. 일 구현예로, 상기 전달 방법은 Cas12f1 단백질 또는 이를 암호화하는 핵산, 제1 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산, 및/또는 제2 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산을 나노파티클을 이용하여 전달하는 것일 수 있다. 이때, 상기 전달 방법은 양이온성 리포좀법, 초산 리튬-DMSO, 지질-매개 형질감염(transfection), 인산칼슘 침전법(precipitation), lipofection, PEI(Polyethyleneimine)-매개 형질감염, DEAE-dextran 매개 형질감염, 및/또는 나노파티클-매개 핵산 전달(Panyam et., al Adv Drug Deliv Rev.　2012 Sep 13. pii: S0169-409X(12)00283-9. doi: 10.1016/j.addr.2012.09.023 참조)일 수 있으나, 이에 제한되는 것은 아니다. 이때, 상기 CRISPR/Cas12f1 시스템의 구성 요소는 RNP, 비바이러스 벡터, 및/또는 바이러스 벡터 형태일 수 있다. 예를 들어, 상기 CRISPR/Cas12f1 시스템의 구성 요소는 각 구성요소를 암호화하는 mRNA 형태일 수 있으나, 이에 제한되는 것은 아니다.

전달 형태 및 방법 - 조합 가능

상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산, 및 Cas12f1 단백질 또는 이를 암호화하는 핵산을 세포 내 전달하는 것을 포함하는데, 이때 상기 구성의 전달 형태 및/또는 전달 방법은 서로 동일하거나 상이할 수 있다. 일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산은 제1 전달 형태로 전달하고, Cas12f1 단백질 또는 이를 암호화하는 핵산은 제2 전달 형태로 전달하는 것을 포함할 수 있다. 이때, 상기 제1 전달 형태 및 상기 제2 전달 형태는 각각 전술한 전달 형태 중 어느 하나일 수 있다. 일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산은 제1 전달 방법으로 전달하고, Cas12f1 단백질 또는 이를 암호화하는 핵산은 제2 전달 방법으로 전달하는 것을 포함할 수 있다. 이때, 상기 제1 전달 방법 및 상기 제2 전달 방법은 각각 전술한 전달 방법 중 어느 하나일 수 있다.

전달 순서

상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산, 및 Cas12f1 단백질 또는 이를 암호화하는 핵산을 세포 내 전달하는 것을 포함하는데, 이때 상기 구성이 세포 내에 동시에 전달되거나 또는 시간차를 두고 순차적으로 전달될 수 있다.

일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산, 및 Cas12f1 단백질 또는 이를 암호화하는 핵산을 동시에 전달하는 것을 포함할 수 있다. 일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산을 세포 내로 전달한 후, Cas12f1 단백질 또는 이를 암호화하는 핵산을 세포 내로 전달하는 것을 포함할 수 있다. 일 구현예로, 상기 유전자 편집 방법은 Cas12f1 단백질 또는 이를 암호화하는 핵산을 세포 내로 전달한 후, 엔지니어링 된 Cas12f1 가이드 RNA를 세포 내로 전달하는 것을 포함할 수 있다. 일 구현예로, 상기 유전자 편집 방법은 Cas12f1 단백질을 암호화하는 핵산을 세포 내로 전달한 후, 엔지니어링 된 Cas12f1 가이드 RNA를 세포 내로 전달하는 것을 포함할 수 있다.

복수의 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산 전달

본 명세서에서 제공하는 유전자 편집 방법은 대상 세포 내에 Cas12f1 단백질 또는 이를 암호화하는 핵산, 및 둘 이상의 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산을 전달하는 것을 포함할 수 있다. 상기 방법을 통해, 서로 다른 서열을 표적하는 둘 이상의 CRISPR/Cas12f1 복합체가 대상 세포 내에 도입되거나, 대상 세포 내에서 형성될 수 있다. 그 결과, 세포 내에 포함된 서로 다른 둘 이상의 표적 유전자 또는 표적 핵산이 편집될 수 있다. 일 구현예로, 상기 유전자 편집 방법은 Cas12f1 단백질 또는 이를 암호화하는 핵산, 제1 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산, 및 제2 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산을 표적 유전자 또는 표적 핵산을 포함하고 있는 대상 세포 내에 전달하는 것을 포함한다. 이때, 상기 각 구성요소는 전술한 전달 형태 및 전달 방법 중 하나 이상을 사용하여 세포 내로 전달될 수 있다. 이때, 둘 이상의 구성요소가 세포 내에 동시에 전달될 수 있고,또는 순차적으로 전달될 수 있다.

CRISPR/Cas12f1 복합체가 표적 핵산과 접촉

본 명세서에서 제공하는 유전자 편집 방법에서, 표적 유전자, 또는 표적 핵산의 편집은 대상 세포 내에서 엔지니어링 된 CRISPR/Cas12f1 복합체가 표적 유전자 또는 표적 핵산과 접촉하면서 이루어진이다. 따라서, 상기 유전자 편집 방법은 엔지니어링 된 CRISPR/Cas12f1 복합체가 대상 세포 내에서 접촉하도록 하거나, 접촉을 유도하는 것을 포함할 수 있다.

일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 CRISPR/Cas12f1 복합체가 대상 세포 내에서 표적 핵산과 접촉하는 것을 포함할 수 있다. 일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 CRISPR/Cas12f1 복합체가 대상 세포 내에서 표적 핵산과 접촉하도록 유도하는 것을 포함할 수 있다. 이때, 상기 유도는 상기 엔지니어링 된 CRISPR/Cas12f1 복합체가 세포 내에서 표적 핵산과 접촉하도록 하는 방법이라면 특별히 제한되지 않는다. 일 구현예로, 상기 유도는 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산, 및 Cas12f1 단백질 또는 이를 암호화하는 핵산을 세포 내에 전달하는 것일 수 있다.

유전자 편집 결과 - 인델(indel)

본 명세서에서 제공하는 유전자 편집 방법의 수행 결과로, 표적 유전자 또는 표적 핵산에 인델이 발생할 수 있다. 이때, 상기 인델은 표적 서열 부분 및/또는 프로토스페이서 서열 부분의 내부 및/또는 외부에서 일어날 수 있다. 상기 인델은, 유전자 편집 전 핵산의 뉴클레오타이드 배열에서 일부 뉴클레오타이드가 중간에 결실되거나, 임의의 뉴클레오타이드가 삽입되거나, 및/또는 상기 삽입과 결실이 혼입된 변이를 일컫는다. 일반적으로, 표적 유전자 또는 표적 핵산 서열 내 인델이 일어나면, 해당 유전자 또는 핵산이 불활성화된다. 일 구현예로, 상기 유전자 편집 방법의 수행 결과, 표적 유전자 또는 표적 핵산 내 하나 이상의 뉴클레오타이드가 결실 및/또는 추가될 수 있다.

유전자 편집 결과 - 베이스 에디팅(base editing)

본 명세서에서 제공하는 유전자 편집 방법의 수행 결과로, 표적 유전자 또는 표적 핵산 내 베이스 에디팅이 일어날 수 있다. 이는 표적 유전자 또는 표적 핵산 내 임의의 뉴클레오타이드가 결실, 또는 추가되는 인델과는 달리, 핵산 내 하나 이상의 특정 뉴클레오타이드를 의도한 대로 변경하는 것을 의미한다. 달리 표현하면, 표적 유전자 또는 표적 핵산 내 특정 위치에서, 미리 의도한 점 돌연변이(point mutation)를 일으키는 것이다. 일 구현예로, 상기 유전자 편집 방법의 수행 결과, 표적 유전자 또는 표적 핵산 내 하나 이상의 뉴클레오타이드가 다른 뉴클레오타이드로 치환될 수 있다.

유전자 편집 결과 - 삽입(insertion)

본 명세서에서 제공하는 유전자 편집 방법의 수행 결과로, 표적 유전자 또는 표적 핵산 내 넉인이 발생할 수 있다. 상기 넉인은 표적 유전자 또는 표적 핵산 서열 내에 추가적인 핵산 서열을 삽입하는 것을 의미한다. 상기 넉인이 일어나려면, CRISPR/Cas12f1 복합체 외에 상기 추가적인 핵산 서열을 포함하는 도너가 더 필요하다. 세포 내에서 CRISPR/Cas12f1 복합체가 표적 유전자 또는 표적 핵산을 절단하는 경우, 상기 절단된 표적 유전자 또는 표적 핵산의 수복이 일어나게 된다. 이때, 상기 도너가 상기 수복 과정에 관여하여 상기 추가적인 핵산 서열이 표적 유전자 또는 표적 핵산 내에 삽입될 수 있도록 한다. 일 구현예로, 상기 유전자 편집 방법은 대상 세포 내로 도너를 도입하는 것을 추가적으로 포함할 수 있다. 예를 들어, 상기 도너는 세포 내 게놈에 삽입하기 위한 외래 DNA 서열(exogeneous DNA sequence)을 포함하며, 상기 도너에 의해 상기 표적 유전자 또는 상기 표적 핵산 내 상기 외래 DNA 서열 의 삽입이 유도된다. 이때, 상기 도너를 대상 세포 내로 전달할 때, 전술한 전달 형태 및/또는 전달 방법이 사용될 수 있다.

유전자 편집 결과 - 제거(deletion)

본 명세서에서 제공하는 유전자 편집 방법의 수행 결과로, 표적 유전자 또는 표적 핵산 서열의 전부 또는 일부를 제거할 수 있다. 상기 제거는 상기 표적 유전자 또는 상기 표적 핵산 내 일부 염기 서열(뉴클레오타이드 서열)을 일정 길이 이상 제거하는 것을 의미한다. 상기 제거는 전술한 인델 효과와 비교하여, 유전자의 특정 영역, 예를 들어, 제1 엑손 영역을 전체적으로 제거(removal)할 수 있는 효과를 의미한다.

일 구현예로, 상기 유전자 편집 방법은 Cas12f1 단백질 또는 이를 암호화하는 핵산, 제1 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산, 및 제2 엔지니어링 된 Cas12f1 가이드 RNA 또는 이를 암호화하는 핵산을 표적 유전자 또는 표적 핵산을 포함하는 세포내에 도입하는 것을 포함한다. 이로 인해, 상기 유전자 편집 결과 표적 유전자 또는 표적 핵산 내에 특정 서열 부분의 제거가 일어난다.

유전자 편집 방법 예시

일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA 및 Cas12f1 단백질이 결합한 리보뉴클레오프로틴 입자 형태의 CRISPR/Cas12f1 복합체를 진핵 세포 내에 전달하는 것을 포함할 수 있다. 이때, 상기 전달은 전기천공법, 또는 lipofection을 이용한 것일 수 있다.

일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 및 Cas12f1 단백질을 암호화하는 핵산을 진핵 세포 내에 전달하는 것을 포함할 수 있다. 이때, 상기 전달은 전기천공법, 또는 lipofection을 이용한 것일 수 있다.

일 구현예로, 상기 유전자 편집 방법은 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열 및 Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 아데노-연관 바이러스(AAV) 벡터를 진핵세포 내에 전달하는 것을 포함할 수 있다.

일 구현예로, 상기 유전자 편집 방법은 제1 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열, 제2 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 핵산 서열, 및 Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 아데노-연관 바이러스(AAV) 벡터를 진핵세포 내에 전달하는 것을 포함할 수 있다.

발명의 가능한 실시예

실시예 1, sgRNA ver.A

다음을 포함하는, CRISPR/Cas12f1 시스템을 위한 엔지니어링 된 가이드 RNA:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

상기 U-rich tail의 서열은 (UaN)bUc로 표현되며, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이고, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상이고,

5'-AUGCAAC-3'.

실시예 2, sgRNA ver.A, U-rich tail

실시예 1에 있어서, 상기 U-rich tail의 서열은 5'-UUUURUUUU-3'로 표현되는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.

실시예 3, sgRNA ver.A, v4.0

실시예 1에 있어서, 상기 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것을 특징으로 하는 엔지니어링 된 가이드 RNA:

5'-A-3';

5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11);

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12);

5'-AACCAAAGAAAGGA-3'(서열번호 111); 및

5'-AUGCAAC-3'.

실시예 4, sgRNA ver.A, v4.1

5'-A-3';

5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350);

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12);

5'-AACCAAAGAAAGGA-3'(서열번호 111); 및

5'-AUGCAAC-3'.

실시예 5, sgRNA ver.A, DNA

실시예 1 내지 실시예 4 중 어느 하나의 엔지니어링 된 가이드 RNA를 암호화하는 DNA.

실시예 6, sgRNA ver.B

엔지니어링 된 스캐폴드;

스페이서; 및

U-rich tail,

상기 U-rich tail의 서열은 (UaN)bUc로 표현되며, 이때, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이고, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상이며,

5'-GCUGCUUGCAUCAGCCUAAUGUCGAG-3'(서열번호 475)로 표현되는 제1 서열;

5'-UUCG-3'로 표현되는 제2 서열;

5'-CUCGA-3'로 표현되는 제3 서열;

5'-AACCAAA-3'로 표현되는 제4 서열;

링커;

5'-GGA-3'로 표현되는 제5 서열; 및

5'-AUGCAAC-3'로 표현되는 제6 서열.

실시예 7, sgRNA ver.B, Linker

실시예 6에 있어서, 상기 링커는 5'-GAAA-3'인 것을 특징으로 하는 엔지니어링 된 가이드 RNA.

실시예 8, sgRNA ver.B, Linker variation

실시예 6에 있어서, 상기 링커는 5'-GAAA-3', 5'-UGAAAA-3', 5'-UUGAAAAA-3', 5'-UUCGAAAGAA-3'(서열번호 642), 5'-UUCAGAAAUGAA-3'(서열번호 643), 5'-UUCAUGAAAAUGAA-3'(서열번호 644), 및 5'-UUCAUUGAAAAAUGAA-3'(서열번호 645)로 이루어진 군에서 선택된 것을 특징으로 하는 엔지니어링 된 가이드 RNA.

실시예 9, sgRNA ver.B, + 1st region

실시예 6에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27), 및 5'-CUUCACUGAUAAAGUGGAGAA-3'(서열번호 10)로 이루어진 군에서 선택된 제7 서열을 추가적으로 포함하며, 상기 제7 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.

실시예 10, sgRNA ver.B, U-rich tail

실시예 6에 있어서, 상기 U-rich tail의 서열은 5'-UUUURUUUU-3'로 표현되는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.

실시예 11, sgRNA ver.B, + 2nd region

실시예 6에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362) 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 제8 서열을 추가적으로 포함하고, 상기 제8 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.

실시예 12, sgRNA ver.B, + 1st region + 2nd region

실시예 6에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27), 및 5'-CUUCACUGAUAAAGUGGAGAA-3'(서열번호 10)로 이루어진 군에서 선택된 제7 서열을 추가적으로 포함하고, 5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362), 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 제8 서열을 추가적으로 포함하며, 상기 제8 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있고, 상기 제7 서열의 3'말단은 상기 제8 서열의 5'말단과 연결되어 있는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.

실시예 13, sgRNA ver.B, additional sequence of 3rd region

실시예 6에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-AAG-3', 5'-AAGU-3', 5'-AAGUG-3', 5'-AAGUGC-3', 5'-AAGUGCU-3', 5'-AAGUGCUU-3', 5'-AAGUGCUUU-3', 5'-AAGUGCUUUC-3'(서열번호 485)로 이루어진 군에서 선택된 제9 서열을 추가적으로 포함하고, 5'-C-3', 5'-CC-3', 5'-ACC-3', 5'-AACC-3', 5'-UAACC-3', 5'-GUAACC-3', 5'-AGUAACC-3', 5'-AAGUAACC-3', 5'-AAAGUAACC-3', 5'-GAAAGUAACC-3'(서열번호 486)로 이루어진 군에서 선택된 제10 서열을 추가적으로 포함하며, 상기 제1 서열의 3'말단 및 상기 제2 서열의 5'말단은 상기 제9 서열을 통해 연결되어 있고, 상기 제2 서열의 3'말단 및 상기 제3 서열의 5'말단은 상기 제10 서열을 통해 연결되어 있는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.

실시예 14, sgRNA ver.B, experimental examples of 3rd region

실시예 13에 있어서,

상기 제9 서열이 5'-A-3'인 경우, 상기 제10 서열은 5'-C-3'이고,

상기 제9 서열이 5'-AA-3'인 경우, 상기 제10 서열은 5'-C-3', 또는 5'-CC-3'이고,

상기 제9 서열이 5'-AAG-3'인 경우, 상기 제10 서열은 5'-CC-3', 또는 5'-ACC-3'이고,

상기 제9 서열이 5'-AAGU-3'인 경우, 상기 제10 서열은 5'-AACC-3'이고,

상기 제9 서열이 5'-AAGUG-3'인 경우, 상기 제10 서열은 5'-UAACC-3'이고,

상기 제9 서열이 5'-AAGUGC-3'인 경우, 상기 제10 서열은 5'-GUAACC-3'이고,

상기 제9 서열이 5'-AAGUGCU-3'인 경우, 상기 제10 서열은 5'-AGUAACC-3'이고,

상기 제9 서열이 5'-AAGUGCUC-3'인 경우, 상기 제10 서열은 5'-GAGUAACC-3'이고,

상기 제9 서열이 5'-AAGUGCUU-3'인 경우, 상기 제10 서열은 5'-AAGUAACC-3'이고,

상기 제9 서열이 5'-AAGUGCUUU-3'인 경우, 상기 제10 서열은 5'-AAAGUAACC-3'이고,

상기 제9 서열이 5'-AAGUGCUUUC-3'(서열번호 485)인 경우, 상기 제10 서열은 5'-GAAAGUAACC-3'(서열번호 486)인 엔지니어링 된 가이드 RNA.

실시예 15, sgRNA ver.B, additional sequence of 4th region

실시예 6에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-U-3', 5'-UU-3', 5'-UUC-3', 5'-UUCA-3', 5'-UUCAU-3', 5'-UUCAUU-3', 및 5'-UUCAUUU-3'로 이루어진 군에서 선택된 제 11서열, 및 5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-UGAA-3', 5'-AUGAA-3', 5'-AAUGAA-3', 및 5'-GAAUGAA-3'로 이루어진 군에서 선택된 제 12서열을 추가적으로 포함하며, 상기 제4 서열의 3'말단 및 상기 링커의 5'말단은 상기 제11 서열을 통해 연결되고, 상기 링커의 3'말단 및 상기 제5 서열의 5'말단은 상기 제12 서열을 통해 연결된 것을 특징으로 하는 엔지니어링 된 가이드 RNA.

실시예 16, sgRNA ver.B, experimental example of 4th region

실시예 15에 있어서,

상기 제11 서열이 5'-U-3'인 경우, 상기 제12 서열은 5'-A-3'이고,

상기 제11 서열이 5'-UU-3'인 경우, 상기 제12 서열은 5'-AA-3'이고,

상기 제11 서열이 5'-UUC-3'인 경우, 상기 제12 서열은 5'-GAA-3'이고,

상기 제11 서열이 5'-UUCA-3'인 경우, 상기 제12 서열은 5'-UGAA-3'이고,

상기 제11 서열이 5'-UUCAU-3'인 경우, 상기 제12 서열은 5'-AUGAA-3'이고,

상기 제11 서열이 5'-UUCAUU-3'인 경우, 상기 제12 서열은 5'-AAUGAA-3'이고,

상기 제11 서열이 5'-UUCAUUU-3'인 경우, 상기 제12 서열은 5'-GAAUGAA-3'인 엔지니어링 된 가이드 RNA.

실시예 17, sgRNA ver.B, v4.0

실시예 6에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3'로 표현되는 제7 서열, 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 표현되는 제8 서열, 5'-AAGUGCUUUC-3'(서열번호 485)로 표현되는 제9 서열, 및 5'-GAAAGUAACC-3'(서열번호 486)로 표현되는 제10 서열을 추가적으로 포함하고, 상기 제8 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있고, 상기 제7 서열의 3'말단은 상기 제8 서열의 5'말단과 연결되어 있고, 상기 제1 서열의 3'말단 및 상기 제2 서열의 5'말단은 상기 제9 서열을 통해 연결되어 있으며, 상기 제2 서열의 3'말단 및 상기 제3 서열의 5'말단은 상기 제10 서열을 통해 연결되어 있는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.

실시예 18, sgRNA ver.B, v4.1

실시예 6에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3'로 표현되는 제7 서열, 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350)로 표현되는 제8 서열, 5'-AAGUGCUUUC-3'(서열번호 485)로 표현되는 제9 서열, 및 5'-GAAAGUAACC-3'(서열번호 486)로 표현되는 제10 서열을 추가적으로 포함하고, 상기 제8 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있고, 상기 제7 서열의 3'말단은 상기 제8 서열의 5'말단과 연결되어 있고, 상기 제1 서열의 3'말단 및 상기 제2 서열의 5'말단은 상기 제9 서열을 통해 연결되어 있으며, 상기 제2 서열의 3'말단 및 상기 제3 서열의 5'말단은 상기 제10 서열을 통해 연결되어 있는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.

실시예 19, sgRNA ver.B, DNA

실시예 6 내지 실시예 18 중 어느 하나의 엔지니어링 된 가이드 RNA를 암호화하는 DNA.

실시예 20, dual gRNA

다음을 포함하는 CRISPR/Cas12f1 시스템을 위한 엔지니어링 된 가이드 RNA:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

상기 엔지니어링 된 스캐폴드 영역은 다음을 포함함:

5'말단에서 3'말단 방향으로,

상기 엔지니어링 된 tracrRNA의 서열이 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 1)와 동일하고, 상기 엔지니어링 된 crRNA 반복 서열이 5'-GAAUGAAGGAAUGCAAC-3'(서열번호 3)과 동일한 경우는 포함하지 않는 것을 특징으로 한다.

실시예 21, dual gRNA, DNA

실시예 20의 엔지니어링 된 가이드 RNA를 암호화하는 DNA.

실시예 22, complex, ver.A

다음을 포함하는, 표적 서열을 포함하는 핵산을 편집할 수 있는 엔지니어링 된 CRISPR/Cas12f1 복합체:

Cas12f1 단백질; 및

엔지니어링 된 가이드 RNA,

이때, 상기 엔지니어링 된 가이드 RNA는 다음을 포함함:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

5'-AUGCAAC-3'.

실시예 23, complex, ver.A, U-rich tail

제22 항에 있어서, 상기 U-rich tail의 서열은 5'-UUUURUUUU-3'로 표현되는 것을 특징으로 하는 엔지니어링 된 CRISPR/Cas12f1 복합체.

실시예 24, complex, ver.A, v4.0

제22 항에 있어서, 상기 엔지니어링 된 가이드 RNA에 포함된 상기 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것을 특징으로 하는 엔지니어링 된 CRISPR/Cas12f1 복합체:

5'-A-3';

5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11);

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12);

5'-AACCAAAGAAAGGA-3'(서열번호 111); 및

5'-AUGCAAC-3'.

실시예 25, complex, ver.A, v4.1

5'-A-3';

5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350);

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12);

5'-AACCAAAGAAAGGA-3'(서열번호 111); 및

5'-AUGCAAC-3'.

실시예 26, complex, ver.B

Cas12f1 단백질; 및

실시예 6 내지 실시예 18 중 어느 한 항에 따른 엔지니어링 된 가이드 RNA.

실시예 27, vector, ver.A

다음을 포함하는, CRISPR/Cas12f1 시스템의 각 구성요소를 발현할 수 있는 벡터:

Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 제1 서열;

상기 제1 서열과 작동 가능하게 연결된 제1 프로모터 서열;

상기 제2 서열과 작동 가능하게 연결된 제2 프로모터 서열,

이때, 상기 엔지니어링 된 가이드 RNA는 다음을 포함함:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

5'-AACAAAGAAAGGA-3'(서열번호 111), 5'-AACAAAUGAAAAGGA-3'(서열번호 112), 5'-AACAAAUUGAAAAAGGA-3'(서열번호 113), 5'-AACAAAUUCGAAAGAAGGA-3'(서열번호 114), 5'-AACAAAUUCAGAAAUGAAGGA-3'(서열번호 115), 5'-AACAAAUUCAUGAAAAUGAAGGA-3'(서열번호 116), 5'-AACAAAUUCAUUGAAAAAUGAAGGA-3'(서열번호 117), 및 5'-AACAAAUUCAUUUGAAAGAAUGAAGGA-3'(서열번호 118)에서 선택된 서열; 및 5'-AUGCAAC-3'.

실시예 28, vector, ver.A, v4.0

실시예 27에 있어서, 상기 엔지니어링 된 가이드 RNA에 포함된 상기 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것을 특징으로 하는 벡터:

5'-A-3';

5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11);

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12);

5'-AACCAAAGAAAGGA-3'(서열번호 111); 및

5'-AUGCAAC-3'.

실시예 29, vector, ver.A, v4.1

5'-A-3';

5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350);

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12);

5'-AACCAAAGAAAGGA-3'(서열번호 111); 및

5'-AUGCAAC-3'.

실시예 30, vector, ver.A, U6 promoter

실시예 27에 있어서, 상기 제2 프로모터 서열은 U6 프로모터 서열인 벡터.

실시예 31, vector, ver.A, viral or plasmid

실시예 27에 있어서, 상기 벡터는 플라스미드, 레트로바이러스, 렌티바이러스, 아데노바이러스, 아데노-연관 바이러스, 백시니아바이러스, 폭스바이러스 및 단순포진 바이러스로 구성된 군에서 선택되는 하나 이상인 것을 특징으로 하는 벡터.

실시예 32, vector, ver.B

Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 제1 서열;

상기 제1 서열과 작동 가능하게 연결된 제1 프로모터 서열;

실시예 6 내지 실시예 18 중 어느 한 항에 따른 엔지니어링 된 가이드 RNA를 암호화하는 핵산 서열을 포함하는 제2 서열; 및

상기 제2 서열과 작동 가능하게 연결된 제2 프로모터 서열.

실시예 33, editing method, ver.A

다음을 포함하는, 세포 내에서 표적 서열을 포함하는 핵산을 편집하는 방법:

Cas12f1 단백질 또는 이를 암호화하는 핵산, 및 엔지니어링 된 가이드 RNA 또는 이름 암호화하는 핵산을 세포 내로 전달하는 것,

이로 인해 상기 표적 서열을 포함하는 핵산이 CRISPR/Cas12f1 복합체에 의해 편집될 수 있고,

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

5'-AUGCAAC-3'.

실시예 34, editing method, ver.A, introducing RNP

실시예 33에 있어서, 상기 전달은 상기 Cas12f1 단백질 및 상기 엔지니어링 된 가이드 RNA를 CRISPR/Cas12f1 복합체로써 세포 내에 주입하는 것인 방법.

실시예 35, editing method, ver.A, introducing vector

실시예 33에 있어서, 상기 전달은 상기 Cas12f1 단백질을 암호화하는 핵산 및 상기 엔지니어링 된 가이드 RNA를 암호화하는 핵산을 포함하는 벡터를 세포 내에 주입하는 것인 방법.

실시예 36, editing method, ver.A, vector limitation

실시예 35에 있어서, 상기 벡터는 플라스미드, 레트로바이러스, 렌티바이러스, 아데노바이러스, 아데노-연관 바이러스, 백시니아바이러스, 폭스바이러스 및 단순포진 바이러스로 구성된 군에서 선택되는 하나 이상인 것을 특징으로 하는 벡터.

실시예 37, editing method, ver.A, editing eukaryotic cell

실시예 33에 있어서, 상기 세포는 진핵세포인 것을 특징으로 하는 방법.

실시예 38, editing method, ver.B

Cas12f1 단백질 또는 이를 암호화하는 핵산, 및 실시예 6 내지 실시예 18 중 어느 한 항에 따른 엔지니어링 된 가이드 RNA 또는 이름 암호화하는 핵산을 세포 내로 전달하는 것,

이로 인해 상기 표적 서열을 포함하는 핵산이 CRISPR/Cas12f1 복합체에 의해 편집될 수 있음.

이하, 실험예 및 실시예를 통해 본 명세서가 제공하는 발명에 대해 더욱 상세히 설명한다. 이들 실시예는 오로지 본 명세서에 의해 개시되는 내용을 예시하기 위한 것으로, 본 명세서에 의해 개시되는 내용의 범위가 이들 실시예에 의해 제한되는 것으로 해석되지 않는 것은 당업계에서 통상의 지식을 가진 자에게 있어서 자명할 것이다.

실험예 1 실험 재료 준비

실험예 1.1 플라스미드 벡터 설계 및 제조

인간 세포에서 발현하기 위해, Cas12f1 유전자를 코돈-최적화 시켰으며, 상기 최적화된 서열이 벡터 제조를 위해 합성되었다. 최종적으로 Cas12f1 단백질을 암호화하는 서열에는 chicken β-actin 프로모터, 5'- 및 3'-말단의 핵 위치 신호 서열(nuclear localization signal sequence), 자가 절단 T2A 펩타이드로 연결된 eGFP를 인코딩하는 서열이 부가되었다. 상기 Cas12f1 단백질의 아미노산 서열 및 이를 암호화하는 DNA 서열을 [표01]에 나타냈다.

[표01]

(엔지니어링 된) Cas12f1 가이드 RNA를 암호화하는 주형 DNA가 합성되었고, pTwist Amp plasmid vector (Twist Bioscience)에 클로닝되었다. 필요한 경우, 상기 벡터는 U6-상보적 forward primer 및 protospacer-상보적 reverse primer를 사용하여, 상기 가이드 RNA 암호화 서열의 증폭을 위한 주형으로 사용되었다. Gibson assembly를 사용하여, 상기 코돈-최적화 된 Cas12f1 유전자를 포함하는 벡터에 엔지니어링 된 Cas12f1 가이드 RNA를 암호화하는 올리고뉴클레오타이드를 클로닝함으로써, 엔지니어링 된 CRISPR/Cas12f1 시스템에 대한 벡터를 제조하였다.

실험예 1.2 Cas12f1 가이드 RNA 엔지니어링

엔지니어링 된 Cas12f1 가이드 RNA 3'말단에 대한 U-rich tail 연결은, 서열-변형된 primer 및 Cas12f1 가이드 RNA 플라스미드 벡터의 존재 하, Pfu PCR Master Mix5 (Biofact)를 사용하여 수행되었다. 상기 PCR 앰플리콘은 HiGeneTM Gel&PCR Purification System (Biofact)을 사용하여 정제되었다. 상기 엔지니어링 된 Cas12f1 가이드 RNA의 엔지니어링 된 스캐폴드 영역 중 제2 영역, 제4 영역 및 제5 영역의 변형은 ApoI 및 BamHI 제한 효소를 사용하여 선형화된 가이드 RNA-암호화 벡터에 변형된 서열 (Macrogen)을 전달하는 합성 올리고뉴클레오타이드를 클로닝하여 수행되었다. 상기 엔지니어링 된 Cas12f1 가이드 RNA의 엔지니어링 된 스캐폴드 영역 중 제1 영역의 변형은, tracrRNA의 5'말단 부분을 표적으로 하는 forward primer 및 U6 프로모터 영역을 표적으로 하는 reverse primer를 사용하여 캐노니컬(canonical), 또는 엔지니어링 된 주형 플라스미드 벡터의 PCR 증폭에 의해 수행되었다. 상기 PCR 증폭은 Q5 Hot Start high-fidelity DNA polymerase (NEB)에 의해 수행되었으며, PCR 산물은 KLD Enzyme Mix (NEB)를 사용하여 결찰되었다(ligated). 상기 결찰된(ligated) PCR 산물은 DH5α E.coli 세포로 형질도입(transformed)되었다. Sanger 시퀀싱 분석에 의해 Mutagenesis가 확인되었다. 변형된 플라스미드 벡터는 NucleoBond ® Xtra Midi EF kit (MN)를 사용하여 정제되었다. 정제된 플라스미드 1 마이크로그램이 T7 RNA polymerase (NEB) 및 NTPs (Jena Bioscience)를 사용한 mRNA 합성의 주형으로 사용되었다. 상기 제조된 엔지니어링 된 Cas12f1 가이드 RNA를 Monarch® RNA cleanup kit (NEB)를 사용하여 정제하고, 극저온 바이알(cryogenic vials)에 분취하여 액체 질소에 보관하였다.

실험예 1.3 세포 배양 및 형질도입(transfection)

HEK293 T 세포(LentX-293T, Takara)가 10%의 열-불활성화 된 fetal bovine serum (FBS) 혈청(Corning) 및 페니실린/스트렙토마이신이 보충된 Dulbecco's Modified Eagle Medium (DMEM) 배지에서, 5% CO₂ 조건 하 배양되었다. 세포 형질주입은 전기천공법(electroporation) 또는 lipofection으로 수행되었다. 전기천공법의 경우, 실험예1.2 에서 제조된 Cas12f1 단백질을 암호화하는 플라스미드 벡터및 가이드 RNA(및 엔지니어링 된 가이드 RNA)를 암호화하는 DNA 각 2-5 μg를 Neon transfection system (Invitrogen)을 사용해 4X10⁵ HEK-293 T세포에 형질주입(transfection) 하였다. 상기 전기천공법은 1300V, 10 mA, 3 pulse 조건 하 수행하였다. lipofection을 위해, 6-15 μL FuGene 시약을 (Promega) 2-5 μg의 Cas12f1 단백질을 암호화하는 플라스미드 벡터 및 1.5-5 μg의 PCR 앰플리콘과 15분동안 혼합하였다. 상기 혼합물(300 μL)이 형질주입 1일 전에 1X10⁶개의 세포가 플레이팅 된 1.5 ml DMEM 배지에 첨가되었다. 상기 세포들을 상기 혼합물의 존재 하 1 내지 10일 간 배양시켰다. 배양 후, 상기 세포들이 수집되었고, 상기 세포의 게놈 DNA가 PureHelixTM genomic DNA preparation kit (NanoHelix)를 사용하거나, Maxwell RSC Cultured cells DNA Kit (Promega)를 사용하여 수작업으로 분리되었다.

실험예 1.4 세포 내 인델 효율 측정

HEK-293 T세포로부터 분리된 게놈 DNA 중, 프로토스페이서를 포함하는 영역을 표적-특이적 프라이머를 사용하여 KAPA HiFi HotStart DNA polymerase (Roche)의 존재 하 PCR을 수행하였다. 상기 증폭 방법은 제조사의 지시를 따랐다. Illumina TruSeq HT dual indexes를 포함하는 상기 증폭의 결과물인 PCR 앰플리콘을 Illumina iSeq 100를 사용하여 150-bp 페어 엔드 시퀀싱을 수행하였다. 인델 빈도는 MAUND를 사용하여 계산되었다. 상기 MAUND는 https://github.com/ibscge/maund 에서 제공된다.

실험예 1.5 Quantitave real-time PCR

HEK293 T세포에 RNeasy Miniprep kit (Qiagen) 또는 Maxwell RSC miRNA Tissue Kit (Promega)또는 DNeasy Blood & Tissue Kit(Qiagen)를 사용하여 가이드 RNA(또는 엔지니어링 된 가이드 RNA) 또는 게놈 DNA를 각각 추출하였다. 가이드 RNA를 정량화하기 위해서, RNA특이적 프라이머를 ligation 하고, crRNA-특이적 프라이머를 사용해 cDNA를 합성하였다. 상기 cDNA는 주형으로써 정량적 real-time PCR에 사용되었다. real-time PCR은 KAFA SYBR FAST qPCR Master Mix(2X) Kit (KAPAbiosystems)를 사용하여 분석되었다.

실험예 1.6 통계 분석

각 실험예 별 실험은 3번씩 수행하였으며, 각 값의 평균값을 분석에 사용하였다.

실험예 2 엔지니어링 된 CRISPR/Cas12f1 시스템의 인델 효율 비교 1

엔지니어링 된 Cas12f1 가이드 RNA를 사용한 엔지니어링 된 CRISPR/Cas12f1 시스템의 인델 효율을 측정하기 위해, 실험예 1.1 내지 1.2에 의해 각 실시예를 제조하였다. 실험에 사용한 표적 서열은 다음 [표02]에 나타냈다.

[표02]

각 실시예 별 엔지니어링 된 Cas12f1 가이드 RNA의 서열은 다음 [표03] 내지 [표08]에 나타냈다.

[표03]

[표04]

[표05]

[표06]

[표07]

[표08]

이때, 각 표적 서열 별로,

1) Comparative Example 1.n.1은 자연계에서 발견되는 Cas12f1 tracrRNA 및 자연계에서 발견되는 Cas12f1 crRNA를 5'-GAAA-3'로 연결시킨 싱글 가이드 RNA,

2) Comparative Example 1.n.2는 자연계에서 발견되는 스캐폴드 영역, 스페이서, 및 5'-UUUUAUUUU-3'로 표현되는 U-rich tail을 가지는 싱글 가이드 RNA,

3) Example 1.n.1 내지 1.n.3은 변형된 제1 영역을 가지는 엔지니어링 된 스캐폴드 영역, 스페이서, 및 5'-UUUUAUUUU-3'로 표현되는 U-rich tail을 가지는 엔지니어링 된 Cas12f1 가이드 RNA,

4) Example 1.n.4 내지 1.n.6는 변형된 제2 영역을 가지는 엔지니어링 된 스캐폴드 영역, 스페이서, 및 5'-UUUUAUUUU-3'로 표현되는 U-rich tail을 가지는 엔지니어링 된 Cas12f1 가이드 RNA,

5) Example 1.n.7 내지 1.n.9는 변형된 제4 영역 및 제5 영역을 가지는 엔지니어링 된 스캐폴드 영역, 스페이서, 및 5'-UUUUAUUUU-3'로 표현되는 U-rich tail을 가지는 엔지니어링 된 Cas12f1 가이드 RNA,

6) Example 1.n.10은 변형된 제1 영역 및 제2 영역을 가지는 엔지니어링 된 스캐폴드 영역, 스페이서, 및 5'-UUUUAUUUU-3'로 표현되는 U-rich tail을 가지는 엔지니어링 된 Cas12f1 가이드 RNA,

7) Example 1.n.11은 변형된 제1 영역 및 제4 영역 및 제5 영역을 가지는 엔지니어링 된 스캐폴드 영역, 스페이서, 및 5'-UUUUAUUUU-3'로 표현되는 U-rich tail을 가지는 엔지니어링 된 Cas12f1 가이드 RNA,

8) Example 1.n.12는 변형된 제2 영역 및 제4 영역 및 제5 영역을 가지는 엔지니어링 된 스캐폴드 영역, 스페이서, 및 5'-UUUUAUUUU-3'로 표현되는 U-rich tail을 가지는 엔지니어링 된 Cas12f1 가이드 RNA,

9) Example 1.n.13은 변형된 제1 영역, 제2 영역, 및 제4 영역 및 제5 영역을 가지는 엔지니어링 된 스캐폴드 영역, 스페이서, 및 5'-UUUUAUUUU-3'로 표현되는 U-rich tail을 가지는 엔지니어링 된 Cas12f1 가이드 RNA를 나타낸다.

이때, n은 표적 서열 별로, 1, 2, 또는 3이며, n이 1인 경우 Target 1(DY2), n이 2인 경우, Target 2(DY10), n이 3인 경우, Target3(Intergenic-22)를 나타낸다.

상기 실시예 별 제조된 벡터를 실험예 1.3에 의해 HEK293 T세포에 형질도입(transfection)하고, 실험예 1.4 내지 1.5에 의해 인델 발생 효율을 측정하였다. 이를 실험예 1.6에 의해 분석한 결과가 도 2 내지 도 13에 나타나있다.

실험예 3 엔지니어링 된 CRISPR/Cas12f1 시스템의 인델 효율 비교 2

실험예 3.1 엔지니어링 된 CRISPR/Cas12f1 시스템의 인델 효율 비교 2-1

엔지니어링 된 Cas12f1 가이드 RNA를 사용한 엔지니어링 된 CRISPR/Cas12f1 시스템의 인델 효율을 측정하기 위해, 실험예 1.1 내지 1.2에 의해 각 실시예를 제조하였다. 실험에 사용한 표적 서열은 다음 [표09]에 나타냈다.

[표09]

각 실시예 별 엔지니어링 된 Cas12f1 가이드 RNA의 서열은 다음 [표10] 내지 [표13]에 나타냈다.

[표10]

[표11]

[표12]

[표13]

상기 실시예 별 제조된 벡터를 실험예 1.3에 의해 HEK293 T세포에 형질도입(transfection)하고, 실험예 1.4 내지 1.5에 의해 인델 발생 효율을 측정하였다. 이를 실험예 1.6에 의해 분석한 결과가 도 16 내지 도 19에 나타나있다.

실험예 3.2 엔지니어링 된 CRISPR/Cas12f1 시스템의 인델 효율 비교 2-2

엔지니어링 된 Cas12f1 가이드 RNA를 사용한 엔지니어링 된 CRISPR/Cas12f1 시스템의 인델 효율을 측정하기 위해, 실험예 1.1 내지 1.2에 의해 각 실시예를 제조하였다. 실험에 사용한 표적 서열은 [표09]에 나타낸 바와 같다.

각 실시예 별 엔지니어링 된 Cas12f1 가이드 RNA의 서열은 다음 [표14] 내지 [표17]에 나타냈다.

[표14]

[표15]

[표16]

[표17]

상기 실시예 별 제조된 벡터를 실험예 1.3에 의해 HEK293 T세포에 형질도입(transfection)하고, 실험예 1.4 내지 1.5에 의해 인델 발생 효율을 측정하였다. 이를 실험예 1.6에 의해 분석한 결과가 도 20 내지 도 23에 나타나있다.

실험예 3.3 실험 결과

상기 실험 결과를 동일 표적에 대한 이전 실험 데이터와 비교해 보면(도 14 및 도 15 참조), 자연계에서 발견되는 tracrRNA 및 crRNA를 링커로 연결한 Cas12f1 싱글 가이드 RNA보다 실험예 3.1, 실험예 3.2의 엔지니어링 된 Cas12f1 가이드 RNA를 포함하는, 엔지니어링 된 CRISPR/Cas12f1 시스템의 유전자 편집 효율이 더 높은 것을 알 수 있다. 이러한 결과에 따라, 실험예 3.2, 실험예 3.3의 실시예에 나타난 가이드 RNA의 변형이 유전자 편집 효율을 향상시키는 것을 유추할 수 있다. 또한, 실험예 2 및 실험예 3에서 얻어진 실험 결과를 참조하면, 변형된 제1 영역, 및/또는 변형된 제2 영역을 포함하는 엔지니어링된 Cas12f1 가이드 RNA를 포함하는, 엔지니어링 된 CRISPR/Cas12f1 시스템이, 자연계에서 발견되는 CRISPR/Cas12f1 시스템, 및 자연계에서 발견되는 tracrRNA 및 crRNA를 링커로 연결한 Cas12f1 싱글 가이드 RNA를 포함하는 CRISPR/Cas12f1 시스템보다 유전자 편집 효율이 더 높을 것이라 유추할 수 있다.

실험예 4 엔지니어링 된 CRISPR/Cas12f1 시스템의 인델 효율 비교 4

실험예 4.1 엔지니어링 된 CRISPR/Cas12f1 시스템의 인델 효율 비교 4-1

엔지니어링 된 Cas12f1 가이드 RNA를 사용한 엔지니어링 된 CRISPR/Cas12f1 시스템의 인델 효율을 측정하기 위해, 실험예 1.1 내지 1.2에 의해 각 실시예를 제조하였다. 실험에 사용한 표적 서열은 다음 [표18]에 나타냈다.

[표18]

각 실시예 별 엔지니어링 된 Cas12f1 가이드 RNA의 서열은 다음 [표19]에 나타냈다.

[표19]

상기 실시예 별 제조된 벡터를 실험예 1.3에 의해 HEK293 T세포에 형질도입(transfection)하고, 실험예 1.4 내지 1.5에 의해 인델 발생 효율을 측정하였다. 이를 실험예 1.6에 의해 분석한 결과가 도 24 내지 도 26에 나타나있다.

실험예 4.2 실험 결과

상기 실험 결과, 변형된 제3 영역을 가지는 엔지니어링 된 Cas12f1 가이드 RNA를 포함하는, 엔지니어링 된 CRISPR/Cas12f1 시스템의 유전자 편집 효율이 자연계에서 발견되는 스캐폴드를 가지는 CRISPR/Cas12f1 시스템, 및 자연계에서 발견되는 tracrRNA 및 crRNA를 링커로 연결한 Cas12f1 싱글 가이드 RNA를 포함하는 CRISPR/Cas12f1 시스템보다 유전자 편집 효율이 더 높을 것이라 유추할 수 있다.

실험예 5 Large scale validation

상기 실험예 2 내지 실험예 4는 몇 개의 내인성 표적에 대해서만 인델 효율을 측정한 결과이다. 상기 결과를 보충하기 위해, 더 광범위한 표적에 대해 유전자 편집이 가능한 지 여부를 실험하였다.

1) in silico로, 5'-TTTR-N₂₀-NGG-3' 서열을 가지는 내인성 타겟을 검색하여, 88개의 표적을 무작위로 선택하였다 (표20 내지 표22). 이는, Cas9, Cas12a, 및 Cas12f1 모두로 편집이 가능한 서열이므로, 각 CRISPR/Cas 시스템의 유전자 편집 효율을 비교할 수 있는 표적이다.

[표20]

[표21]

[표22]

2) CRISPR/SpCas9 시스템, CRISPR/AsCas12a 시스템, 자연계에서 발견되는 CRISPR/Cas12f1 시스템 또는 엔지니어링 된 CRISPR/Cas12f1 시스템의 각 구성을 HEK293-T 세포에 형질 감염(transfection) 시켰다. 이때, 엔지니어링 된 CRISPR/Cas12f1 시스템에 사용된 엔지니어링 된 Cas12f1 가이드 RNA는 다음 [표23]에 정리되어 있다.

[표23]

이때, 상기 서열 중 5'-NNNNNNNNNNNNNNNNNNNN-3' 부분은 스페이서 서열로, 상기 [표20] 내지 [표22]에 나타난 프로토스페이서 서열에 대응되는 스페이서 서열로 각각 설계되었다.

3) 형질 감염 후, 상기 88개의 표적에 대한 유전자 편집 효율은 도 27 및 표24에 나타내었다.

[표24]

실험 결과, 본 명세서에서 개시하고 있는 엔지니어링 된 CRISPR/Cas12f1 시스템은 1) 자연계에서 발견되는 CRISPR/Cas12f1 시스템에 비해 유전자 편집 효율이 월등히 높으며, 2) 진핵 세포 내 임의의 표적에 대해 CRISPR/SpCas9 시스템 및 CRISPR/AsCas12a 시스템과 견줄 수 있는 유전자 편집 효율을 보이고, 3) 일부 표적에 대해서는 타 CRISPR/Cas 시스템보다 더 높은 유전자 편집 효율을 보일 수 있음을 알 수 있었다.

실험예 6 in vitro cleavage assay

본 명세서에서 개시하고 있는 엔지니어링 된 CRISPR/Cas12f1 시스템의 유전자 절단 양상을 보충적으로 관찰하기 위하여, in vitro cleavage assay를 진행하였다. 실험예 6에서 사용한 표적 protospacer 서열은 5'-TTTAAGAACACATACCCCTGGGCC-3'(서열번호 341, 이하 Intergenic-22)로, 상기 표적의 PAM 서열은 5'-TTTA-3'이다.

실험예 6에서 사용한 (엔지니어링 된) Cas12f1 가이드 RNA는 다음 [표25]에 나타나있다.

[표25]

실험 방법은 다음과 같다.

1) Recombinant Cas14 (2.5 μg)와 Canonical, MS2/MS3/MS4, 및 MS2/MS3/MS4/MS5의 sgRNA를 각각 2μg을 인큐베이션하여 RNA complex를 형성시켰다.

2) 이를 표적 서열(Intergenic-22)을 포함하고 있는 플라스미드 벡터 (5 μg)와 37℃에서 3 시간 동안 반응시켜 In vitro cleavage assay를 진행하였다.

3) Positive control로써 Apa1 restriction enzyme cut을 진행하였다.

4) Cleavage가 된 DNA를 Ultrasonicator인 Covaris (M220)를 가지고 다음의 조건에서 DNA shearing을 진행하였다.

Peak incident power: 50W, Duty factor: 20%, Cycles per Burst: 200 cpb, Treatment time: 110 sec.

5) 조각난 DNA를 DNA purification kit를 이용하여 정제하였다.

6) 정제된 DNA를 T4 ligase를 이용하여 End-filling을 수행하였다.

7) 그 후 NEBNext® Ultra쪠 II DNA Library Prep Kit for Illumina® (NEB, # E7103) kit와 NEBNext® Multiplex Oligos for Illumina® (Dual Index Primers Set 1) (NEB, # E7600) kit를 이용하여 DNA library를 제작하였다.

8) qPCR을 수행하여 각 샘플의 농도를 동일하게 조절하였다.

9) 제작된 library를 Illumina iSeq 100을 사용하여 150-bp paired-end sequencing 하였다.

10) 분석된 서열은 IGV 프로그램으로 alignment하였다.

상기 실험 결과를 도 28에 도시하였다.

실험 결과, 본 명세서에서 개시하는 엔지니어링 된 가이드 RNA를 포함하는, 엔지니어링 된 CRISPR/Cas12f1 시스템은 자연계에서 발견되는 CRISPR/Cas12f1 시스템과 비교하여 비표적 가닥(Non-target strand, NTS)에 대한 절단 활성이 더 높은 것으로 나타났다. 상기 결과는 본 명세서에서 개시하는 엔지니어링 된 CRISPR/Cas12f1 시스템의 향상된 유전자 편집 활성에 영향을 미치는 요인으로 판단된다.

본 명세서에서는 유전자 편집 기술에 사용할 수 있는 CRISPR/Cas12f1 시스템을 제공하며, 특히, U-rich tail 및 엔지니어링 된 스캐폴드 영역을 도입하여 유전자 편집 효율을 향상시킨 엔지니어링 된 CRISPR/Cas12f1 시스템을 제공한다. 본 명세서에서 제공하는 엔지니어링 된 CRISPR/Cas12f1 시스템을 유전자 편집에 사용하는 경우, 자연계에서 발견되는 CRISPR/Cas12f1 시스템을 사용하는 것과 비교해 높은 유전자 편집 효율을 나타내며, 진핵세포 유전자를 편집하는 용도로 사용할 수 있다.

Claims

다음을 포함하는, CRISPR/Cas12f1 시스템을 위한 엔지니어링 된 가이드 RNA:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

이때, 상기 엔지니어링 된 가이드 RNA는 5'말단에서 3'말단 방향으로, 엔지니어링 된 스캐폴드 영역, 스페이서, 및 U-rich tail이 순서대로 연결되어 있고,

상기 스페이서는 10개 이상 50개 이하의 뉴클레오타이드를 포함하며, 표적 서열과 상보적인 서열을 가지고,

상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현되며, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이고, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상이고,

상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACCAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 7)과 상이한 것을 특징으로 하며,

상기 엔지니어링 된 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것임:

5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27), 및 5'-CUUCACUGAUAAAGUGGAGAA-3'(서열번호 10)로 이루어진 군에서 선택된 서열;

5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362), 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 서열;

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 434), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUUCGAAAGUAACCCUCGA-3'(서열번호 435), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUCGAAGUAACCCUCGA-3'(서열번호 436), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUCUUCGGAGUAACCCUCGA-3'(서열번호 437), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCGAGUAACCCUCGA-3'(서열번호 438), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUCGGUAACCCUCGA-3'(서열번호 439), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGUUCGUAACCCUCGA-3'(서열번호 440), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUUCGAACCCUCGA-3'(서열번호 441), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGACCCUCGA-3'(서열번호 442), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGCCCUCGA-3'(서열번호 443), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCCUCGA-3'(서열번호 444), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCUCGA-3'(서열번호 445), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAUUCGCCUCGA-3'(서열번호 446), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGUUCGCUCGA-3'(서열번호 447), 및 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12)로 이루어진 군에서 선택된 서열;

5'-AACAAAGAAAGGA-3'(서열번호 111), 5'-AACAAAUGAAAAGGA-3'(서열번호 112), 5'-AACAAAUUGAAAAAGGA-3'(서열번호 113), 5'-AACAAAUUCGAAAGAAGGA-3'(서열번호 114), 5'-AACAAAUUCAGAAAUGAAGGA-3'(서열번호 115), 5'-AACAAAUUCAUGAAAAUGAAGGA-3'(서열번호 116), 5'-AACAAAUUCAUUGAAAAAUGAAGGA-3'(서열번호 117), 및 5'-AACAAAUUCAUUUGAAAGAAUGAAGGA-3'(서열번호 118)에서 선택된 서열; 및

5'-AUGCAAC-3'.
제1항에 있어서, 상기 U-rich tail의 서열은 5'-UUUURUUUU-3'로 표현되는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.
제1항에 있어서, 상기 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것을 특징으로 하는 엔지니어링 된 가이드 RNA:

5'-A-3';

5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11);

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12);

5'-AACCAAAGAAAGGA-3'(서열번호 111); 및

5'-AUGCAAC-3'.
제1항에 있어서, 상기 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것을 특징으로 하는 엔지니어링 된 가이드 RNA:

5'-A-3';

5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350);

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12);

5'-AACCAAAGAAAGGA-3'(서열번호 111); 및

5'-AUGCAAC-3'.
제1항 내지 제4항 중 어느 한 항의 엔지니어링 된 가이드 RNA를 암호화하는 DNA.
다음을 포함하는, CRISPR/Cas12f1 시스템을 위한 엔지니어링 된 가이드 RNA:

엔지니어링 된 스캐폴드;

스페이서; 및

U-rich tail,

이때, 상기 엔지니어링 된 가이드 RNA는 5'말단에서 3'말단 방향으로, 엔지니어링 된 스캐폴드 영역, 스페이서, 및 U-rich tail이 순서대로 연결되어 있고,

상기 스페이서는 10개 이상 50개 이하의 뉴클레오타이드를 포함하며, 표적 서열과 상보적인 서열을 가지고,

상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현되며, 이때, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이고, 상기 a, b, c는 정수이며, a는 1 이상 5 이하이고, b는 0 이상이며,

상기 엔지니어링 된 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것임:

5'-GCUGCUUGCAUCAGCCUAAUGUCGAG-3'(서열번호 475)로 표현되는 제1 서열;

5'-UUCG-3'로 표현되는 제2 서열;

5'-CUCGA-3'로 표현되는 제3 서열;

5'-AACCAAA-3'로 표현되는 제4 서열;

링커;

5'-GGA-3'로 표현되는 제5 서열; 및

5'-AUGCAAC-3'로 표현되는 제6 서열.
제6항에 있어서, 상기 링커는 5'-GAAA-3'인 것을 특징으로 하는 엔지니어링 된 가이드 RNA.
제6항에 있어서, 상기 링커는 5'-GAAA-3', 5'-UGAAAA-3', 5'-UUGAAAAA-3', 5'-UUCGAAAGAA-3'(서열번호 642), 5'-UUCAGAAAUGAA-3'(서열번호 643), 5'-UUCAUGAAAAUGAA-3'(서열번호 644), 및 5'-UUCAUUGAAAAAUGAA-3'(서열번호 645)로 이루어진 군에서 선택된 것을 특징으로 하는 엔지니어링 된 가이드 RNA.
제6항에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27), 및 5'-CUUCACUGAUAAAGUGGAGAA-3'(서열번호 10)로 이루어진 군에서 선택된 제7 서열을 추가적으로 포함하며, 상기 제7 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.
제6항에 있어서, 상기 U-rich tail의 서열은 5'-UUUURUUUU-3'로 표현되는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.
제6항에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362) 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 제8 서열을 추가적으로 포함하고, 상기 제8 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.
제6항에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27), 및 5'-CUUCACUGAUAAAGUGGAGAA-3'(서열번호 10)로 이루어진 군에서 선택된 제7 서열을 추가적으로 포함하고, 5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362), 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 제8 서열을 추가적으로 포함하며, 상기 제8 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있고, 상기 제7 서열의 3'말단은 상기 제8 서열의 5'말단과 연결되어 있는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.
제6항에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3', 5'-AA-3', 5'-AAG-3', 5'-AAGU-3', 5'-AAGUG-3', 5'-AAGUGC-3', 5'-AAGUGCU-3', 5'-AAGUGCUU-3', 5'-AAGUGCUUU-3', 5'-AAGUGCUUUC-3'(서열번호 485)로 이루어진 군에서 선택된 제9 서열을 추가적으로 포함하고, 5'-C-3', 5'-CC-3', 5'-ACC-3', 5'-AACC-3', 5'-UAACC-3', 5'-GUAACC-3', 5'-AGUAACC-3', 5'-AAGUAACC-3', 5'-AAAGUAACC-3', 5'-GAAAGUAACC-3'(서열번호 486)로 이루어진 군에서 선택된 제10 서열을 추가적으로 포함하며, 상기 제1 서열의 3'말단 및 상기 제2 서열의 5'말단은 상기 제9 서열을 통해 연결되어 있고, 상기 제2 서열의 3'말단 및 상기 제3 서열의 5'말단은 상기 제10 서열을 통해 연결되어 있는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.
제13항에 있어서,

상기 제9 서열이 5'-A-3'인 경우, 상기 제10 서열은 5'-C-3'이고,

상기 제9 서열이 5'-AA-3'인 경우, 상기 제10 서열은 5'-C-3', 또는 5'-CC-3'이고,

상기 제9 서열이 5'-AAG-3'인 경우, 상기 제10 서열은 5'-CC-3', 또는 5'-ACC-3'이고,

상기 제9 서열이 5'-AAGU-3'인 경우, 상기 제10 서열은 5'-AACC-3'이고,

상기 제9 서열이 5'-AAGUG-3'인 경우, 상기 제10 서열은 5'-UAACC-3'이고,

상기 제9 서열이 5'-AAGUGC-3'인 경우, 상기 제10 서열은 5'-GUAACC-3'이고,

상기 제9 서열이 5'-AAGUGCU-3'인 경우, 상기 제10 서열은 5'-AGUAACC-3'이고,

상기 제9 서열이 5'-AAGUGCUC-3'인 경우, 상기 제10 서열은 5'-GAGUAACC-3'이고,

상기 제9 서열이 5'-AAGUGCUU-3'인 경우, 상기 제10 서열은 5'-AAGUAACC-3'이고,

상기 제9 서열이 5'-AAGUGCUUU-3'인 경우, 상기 제10 서열은 5'-AAAGUAACC-3'이고,

상기 제9 서열이 5'-AAGUGCUUUC-3'(서열번호 485)인 경우, 상기 제10 서열은 5'-GAAAGUAACC-3'(서열번호 486)인 엔지니어링 된 가이드 RNA.
제6항에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-U-3', 5'-UU-3', 5'-UUC-3', 5'-UUCA-3', 5'-UUCAU-3', 5'-UUCAUU-3', 및 5'-UUCAUUU-3'로 이루어진 군에서 선택된 제 11서열, 및 5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-UGAA-3', 5'-AUGAA-3', 5'-AAUGAA-3', 및 5'-GAAUGAA-3'로 이루어진 군에서 선택된 제 12서열을 추가적으로 포함하며, 상기 제4 서열의 3'말단 및 상기 링커의 5'말단은 상기 제11 서열을 통해 연결되고, 상기 링커의 3'말단 및 상기 제5 서열의 5'말단은 상기 제12 서열을 통해 연결된 것을 특징으로 하는 엔지니어링 된 가이드 RNA.
제15항에 있어서,

상기 제11 서열이 5'-U-3'인 경우, 상기 제12 서열은 5'-A-3'이고,

상기 제11 서열이 5'-UU-3'인 경우, 상기 제12 서열은 5'-AA-3'이고,

상기 제11 서열이 5'-UUC-3'인 경우, 상기 제12 서열은 5'-GAA-3'이고,

상기 제11 서열이 5'-UUCA-3'인 경우, 상기 제12 서열은 5'-UGAA-3'이고,

상기 제11 서열이 5'-UUCAU-3'인 경우, 상기 제12 서열은 5'-AUGAA-3'이고,

상기 제11 서열이 5'-UUCAUU-3'인 경우, 상기 제12 서열은 5'-AAUGAA-3'이고,

상기 제11 서열이 5'-UUCAUUU-3'인 경우, 상기 제12 서열은 5'-GAAUGAA-3'인 엔지니어링 된 가이드 RNA.
제6항에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3'로 표현되는 제7 서열, 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 표현되는 제8 서열, 5'-AAGUGCUUUC-3'(서열번호 485)로 표현되는 제9 서열, 및 5'-GAAAGUAACC-3'(서열번호 486)로 표현되는 제10 서열을 추가적으로 포함하고, 상기 제8 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있고, 상기 제7 서열의 3'말단은 상기 제8 서열의 5'말단과 연결되어 있고, 상기 제1 서열의 3'말단 및 상기 제2 서열의 5'말단은 상기 제9 서열을 통해 연결되어 있으며, 상기 제2 서열의 3'말단 및 상기 제3 서열의 5'말단은 상기 제10 서열을 통해 연결되어 있는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.
제6항에 있어서, 상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-A-3'로 표현되는 제7 서열, 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350)로 표현되는 제8 서열, 5'-AAGUGCUUUC-3'(서열번호 485)로 표현되는 제9 서열, 및 5'-GAAAGUAACC-3'(서열번호 486)로 표현되는 제10 서열을 추가적으로 포함하고, 상기 제8 서열의 3'말단은 상기 제1 서열의 5'말단과 연결되어 있고, 상기 제7 서열의 3'말단은 상기 제8 서열의 5'말단과 연결되어 있고, 상기 제1 서열의 3'말단 및 상기 제2 서열의 5'말단은 상기 제9 서열을 통해 연결되어 있으며, 상기 제2 서열의 3'말단 및 상기 제3 서열의 5'말단은 상기 제10 서열을 통해 연결되어 있는 것을 특징으로 하는 엔지니어링 된 가이드 RNA.
제6항 내지 제18항 중 어느 한 항의 엔지니어링 된 가이드 RNA를 암호화하는 DNA.
다음을 포함하는 CRISPR/Cas12f1 시스템을 위한 엔지니어링 된 가이드 RNA:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

이때, 상기 스페이서는 10개 이상 50개 이하의 뉴클레오타이드를 포함하며, 표적 서열과 상보적인 서열을 가지고,

상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현되며, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이고, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상이고,

상기 엔지니어링 된 스캐폴드 영역은 다음을 포함함:

5'말단에서 3'말단 방향으로,

5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27), 및 5'-CUUCACUGAUAAAGUGGAGAA-3'(서열번호 10)로 이루어진 군에서 선택된 제1 서열,

5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362), 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 제2 서열,

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 434), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUUCGAAAGUAACCCUCGA-3'(서열번호 435), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUCGAAGUAACCCUCGA-3'(서열번호 436), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUCUUCGGAGUAACCCUCGA-3'(서열번호 437), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCGAGUAACCCUCGA-3'(서열번호 438), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUCGGUAACCCUCGA-3'(서열번호 439), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGUUCGUAACCCUCGA-3'(서열번호 440), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUUCGAACCCUCGA-3'(서열번호 441), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGACCCUCGA-3'(서열번호 442), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGCCCUCGA-3'(서열번호 443), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCCUCGA-3'(서열번호 444), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCUCGA-3'(서열번호 445), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAUUCGCCUCGA-3'(서열번호 446), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGUUCGCUCGA-3'(서열번호 447), 및 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12)로 이루어진 군에서 선택된 제3 서열,

5'-AACAAA-3', 5'-AACAAAU-3', 5'-AACAAAUU-3', 5'-AACAAAUUC-3', 5'-AACAAAUUCA-3'(서열번호 67), 5'-AACAAAUUCAU-3'(서열번호 68), 5'-AACAAAUUCAUU-3'(서열번호 69), 및 5'-AACAAAUUCAUUU-3'(서열번호 13)로 이루어진 군에서 선택된 제4 서열이 연결된 엔지니어링 된 tracrRNA; 및

5'-GGA-3', 5'-AGGA-3', 5'-AAGGA-3', 5'-GAAGGA-3', 5'-UGAAGGA-3', 5'-AUGAAGGA-3', 5'-AAUGAAGGA-3', 및 5'-GAAUGAAGGA-3'(서열번호 15)으로 이루어진 군에서 선택된 제5 서열, 및

5'-AUGCAAC-3'로 표현되는 제6 서열이 연결된 엔지니어링 된 crRNA 반복 서열 부분,

이때, 상기 엔지니어링 된 crRNA 반복 서열 부분의 3'말단은 상기 스페이서의 5'말단과 연결 되어 있고,

상기 엔지니어링 된 tracrRNA의 서열이 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACAAAUUCAUUU-3'(서열번호 1)와 동일하고, 상기 엔지니어링 된 crRNA 반복 서열이 5'-GAAUGAAGGAAUGCAAC-3'(서열번호 3)과 동일한 경우는 포함하지 않는 것을 특징으로 한다.
제20항의 엔지니어링 된 가이드 RNA를 암호화하는 DNA.
다음을 포함하는, 엔지니어링 된 CRISPR/Cas12f1 복합체:

Cas12f1 단백질; 및

엔지니어링 된 가이드 RNA,

이때, 상기 엔지니어링 된 가이드 RNA는 다음을 포함함:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

이때, 상기 엔지니어링 된 가이드 RNA는 5'말단에서 3'말단 방향으로, 엔지니어링 된 스캐폴드 영역, 스페이서, 및 U-rich tail이 순서대로 연결되어 있고,

상기 스페이서는 10개 이상 50개 이하의 뉴클레오타이드를 포함하며, 상기 표적 서열과 상보적인 서열을 가지고,

상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현되며, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이고, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상이고,

상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACCAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 7)과 상이한 것을 특징으로 하며,

상기 엔지니어링 된 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것임:

5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27), 및 5'-CUUCACUGAUAAAGUGGAGAA-3'(서열번호 10)로 이루어진 군에서 선택된 서열;

5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362), 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 서열;

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 434), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUUCGAAAGUAACCCUCGA-3'(서열번호 435), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUCGAAGUAACCCUCGA-3'(서열번호 436), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUCUUCGGAGUAACCCUCGA-3'(서열번호 437), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCGAGUAACCCUCGA-3'(서열번호 438), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUCGGUAACCCUCGA-3'(서열번호 439), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGUUCGUAACCCUCGA-3'(서열번호 440), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUUCGAACCCUCGA-3'(서열번호 441), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGACCCUCGA-3'(서열번호 442), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGCCCUCGA-3'(서열번호 443), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCCUCGA-3'(서열번호 444), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCUCGA-3'(서열번호 445), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAUUCGCCUCGA-3'(서열번호 446), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGUUCGCUCGA-3'(서열번호 447), 및 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12)로 이루어진 군에서 선택된 서열;

5'-AACAAAGAAAGGA-3'(서열번호 111), 5'-AACAAAUGAAAAGGA-3'(서열번호 112), 5'-AACAAAUUGAAAAAGGA-3'(서열번호 113), 5'-AACAAAUUCGAAAGAAGGA-3'(서열번호 114), 5'-AACAAAUUCAGAAAUGAAGGA-3'(서열번호 115), 5'-AACAAAUUCAUGAAAAUGAAGGA-3'(서열번호 116), 5'-AACAAAUUCAUUGAAAAAUGAAGGA-3'(서열번호 117), 및 5'-AACAAAUUCAUUUGAAAGAAUGAAGGA-3'(서열번호 118)에서 선택된 서열; 및

5'-AUGCAAC-3'.
제22 항에 있어서, 상기 U-rich tail의 서열은 5'-UUUURUUUU-3'로 표현되는 것을 특징으로 하는 엔지니어링 된 CRISPR/Cas12f1 복합체.
제22 항에 있어서, 상기 엔지니어링 된 가이드 RNA에 포함된 상기 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것을 특징으로 하는 엔지니어링 된 CRISPR/Cas12f1 복합체:

5'-A-3';

5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11);

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12);

5'-AACCAAAGAAAGGA-3'(서열번호 111); 및

5'-AUGCAAC-3'.
제22 항에 있어서, 상기 엔지니어링 된 가이드 RNA에 포함된 상기 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것을 특징으로 하는 엔지니어링 된 CRISPR/Cas12f1 복합체:

5'-A-3';

5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350);

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12);

5'-AACCAAAGAAAGGA-3'(서열번호 111); 및

5'-AUGCAAC-3'.
다음을 포함하는, 엔지니어링 된 CRISPR/Cas12f1 복합체:

Cas12f1 단백질; 및

제6항 내지 제18항 중 어느 한 항에 따른 엔지니어링 된 가이드 RNA.
다음을 포함하는, CRISPR/Cas12f1 시스템의 각 구성요소를 발현할 수 있는 벡터:

Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 제1 서열;

상기 제1 서열과 작동 가능하게 연결된 제1 프로모터 서열;

엔지니어링 된 가이드 RNA를 암호화하는 핵산 서열을 포함하는 제2 서열; 및

상기 제2 서열과 작동 가능하게 연결된 제2 프로모터 서열,

이때, 상기 엔지니어링 된 가이드 RNA는 다음을 포함함:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

여기서, 상기 엔지니어링 된 가이드 RNA는 5'말단에서 3'말단 방향으로, 엔지니어링 된 스캐폴드 영역, 스페이서, 및 U-rich tail이 순서대로 연결되어 있고,

상기 스페이서는 10개 이상 50개 이하의 뉴클레오타이드를 포함하며, 표적 서열과 상보적인 서열을 가지고,

상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현되며, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이고, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상이고,

상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACCAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 7)과 상이한 것을 특징으로 하며,

상기 엔지니어링 된 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것임:

5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27), 및 5'-CUUCACUGAUAAAGUGGAGAA-3'(서열번호 10)로 이루어진 군에서 선택된 서열;

5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362), 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 서열;

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 434), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUUCGAAAGUAACCCUCGA-3'(서열번호 435), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUCGAAGUAACCCUCGA-3'(서열번호 436), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUCUUCGGAGUAACCCUCGA-3'(서열번호 437), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCGAGUAACCCUCGA-3'(서열번호 438), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUCGGUAACCCUCGA-3'(서열번호 439), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGUUCGUAACCCUCGA-3'(서열번호 440), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUUCGAACCCUCGA-3'(서열번호 441), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGACCCUCGA-3'(서열번호 442), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGCCCUCGA-3'(서열번호 443), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCCUCGA-3'(서열번호 444), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCUCGA-3'(서열번호 445), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAUUCGCCUCGA-3'(서열번호 446), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGUUCGCUCGA-3'(서열번호 447), 및 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12)로 이루어진 군에서 선택된 서열;

5'-AACAAAGAAAGGA-3'(서열번호 111), 5'-AACAAAUGAAAAGGA-3'(서열번호 112), 5'-AACAAAUUGAAAAAGGA-3'(서열번호 113), 5'-AACAAAUUCGAAAGAAGGA-3'(서열번호 114), 5'-AACAAAUUCAGAAAUGAAGGA-3'(서열번호 115), 5'-AACAAAUUCAUGAAAAUGAAGGA-3'(서열번호 116), 5'-AACAAAUUCAUUGAAAAAUGAAGGA-3'(서열번호 117), 및 5'-AACAAAUUCAUUUGAAAGAAUGAAGGA-3'(서열번호 118)에서 선택된 서열; 및

5'-AUGCAAC-3'.
제27항에 있어서, 상기 엔지니어링 된 가이드 RNA에 포함된 상기 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것을 특징으로 하는 벡터:

5'-A-3';

5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11);

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12);

5'-AACCAAAGAAAGGA-3'(서열번호 111); 및

5'-AUGCAAC-3'.
제27항에 있어서, 상기 엔지니어링 된 가이드 RNA에 포함된 상기 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것을 특징으로 하는 벡터:

5'-A-3';

5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350);

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12);

5'-AACCAAAGAAAGGA-3'(서열번호 111); 및

5'-AUGCAAC-3'.
제27항에 있어서, 상기 제2 프로모터 서열은 U6 프로모터 서열인 벡터.
제27항에 있어서, 상기 벡터는 플라스미드, 레트로바이러스, 렌티바이러스, 아데노바이러스, 아데노-연관 바이러스, 백시니아바이러스, 폭스바이러스 및 단순포진 바이러스로 구성된 군에서 선택되는 하나 이상인 것을 특징으로 하는 벡터.
다음을 포함하는, CRISPR/Cas12f1 시스템의 각 구성요소를 발현할 수 있는 벡터:

Cas12f1 단백질을 암호화하는 핵산 서열을 포함하는 제1 서열;

상기 제1 서열과 작동 가능하게 연결된 제1 프로모터 서열;

제6항 내지 제18항 중 어느 한 항에 따른 엔지니어링 된 가이드 RNA를 암호화하는 핵산 서열을 포함하는 제2 서열; 및

상기 제2 서열과 작동 가능하게 연결된 제2 프로모터 서열.
다음을 포함하는, 세포 내에서 표적 핵산을 편집하는 방법:

Cas12f1 단백질 또는 이를 암호화하는 핵산, 및 엔지니어링 된 가이드 RNA 또는 이름 암호화하는 핵산을 세포 내로 전달하는 것,

이로 인해 상기 세포 내에서 CRISPR/Cas12f1 복합체가 형성될 수 있으며,

이로 인해 상기 표적 핵산이 CRISPR/Cas12f1 복합체에 의해 편집될 수 있고,

상기 엔지니어링 된 가이드 RNA는 다음을 포함하는 것을 특징으로 함:

엔지니어링 된 스캐폴드 영역;

스페이서; 및

U-rich tail,

이때, 상기 엔지니어링 된 가이드 RNA는 5'말단에서 3'말단 방향으로, 엔지니어링 된 스캐폴드 영역, 스페이서, 및 U-rich tail이 순서대로 연결되어 있고,

상기 스페이서는 10개 이상 50개 이하의 뉴클레오타이드를 포함하며, 표적 서열과 상보적인 서열을 가지고,

상기 U-rich tail의 서열은 (U_aN)_bU_c로 표현되며, 상기 N은 아데노신(A), 유리딘(U), 사이티딘(C), 구아노신(G) 중 하나이고, 상기 a, b, c는 정수이고, a는 1 이상 5 이하, b는 0 이상이고,

상기 엔지니어링 된 스캐폴드 영역의 서열은 5'-CUUCACUGAUAAAGUGGAGAACCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGGGCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGAAACCAAAUUCAUUUGAAAGAAUGAAGGAAUGCAAC-3'(서열번호 7)과 상이한 것을 특징으로 하며,

상기 엔지니어링 된 스캐폴드 영역의 서열은 5'말단에서 3'말단 방향으로 다음 서열이 순서대로 연결된 것임:

5'-A-3', 5'-AA-3', 5'-GAA-3', 5'-AGAA-3', 5'-GAGAA-3', 5'-GGAGAA-3', 5'-UGGAGAA-3', 5'-GUGGAGAA-3', 5'-AGUGGAGAA-3', 5'-AAGUGGAGAA-3'(서열번호 17), 5'-AAAGUGGAGAA-3'(서열번호 18), 5'-UAAAGUGGAGAA-3'(서열번호 19), 5'-AUAAAGUGGAGAA-3'(서열번호 20), 5'-GAUAAAGUGGAGAA-3'(서열번호 21), 5'-UGAUAAAGUGGAGAA-3'(서열번호 22), 5'-CUGAUAAAGUGGAGAA-3'(서열번호 23), 5'-ACUGAUAAAGUGGAGAA-3'(서열번호 24), 5'-CACUGAUAAAGUGGAGAA-3'(서열번호 25), 5'-UCACUGAUAAAGUGGAGAA-3'(서열번호 26), 5'-UUCACUGAUAAAGUGGAGAA-3'(서열번호 27), 및 5'-CUUCACUGAUAAAGUGGAGAA-3'(서열번호 10)로 이루어진 군에서 선택된 서열;

5'-G-3', 5'-UUAGG-3', 5'-CUUAGGG-3', 5'-CUUAGUGG-3', 5'-CCUUAGGUGG-3'(서열번호 342), 5'-CCGUUAGGUGG-3'(서열번호 343), 5'-CCGCUUAGGGUGG-3'(서열번호 344), 5'-CCGCUUUAGAGGUGG-3'(서열번호 345), 5'-CCGCUUUUAGAAGGUGG-3'(서열번호 346), 5'-CCGCUUCUUAGGAAGGUGG-3'(서열번호 347), 5'-CCGCUUCAUUAGUGAAGGUGG-3'(서열번호 348), 5'-CCGCUUCACUUAGGUGAAGGUGG-3'(서열번호 349), 5'-CCGCUUCACUUAGAGUGAAGGUGG-3'(서열번호 350), 5'-CCGCUUCACCUUAGGAGUGAAGGUGG-3'(서열번호 351), 5'-CCGCUUCACCAUUAGUGAGUGAAGGUGG-3'(서열번호 352), 5'-CCGCUUCACCAAUUAGUUGAGUGAAGGUGG-3'(서열번호 353), 5'-CCGCUUCACCAAAUUAGCUUGAGUGAAGGUGG-3'(서열번호 354), 5'-CCGCUUCACCAAAAUUAGACUUGAGUGAAGGUGG-3'(서열번호 355), 5'-CCGCUUCACCAAAAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 356), 5'-CCGCUUCACCAAAAGCUUAGGAACUUGAGUGAAGGUGG-3'(서열번호 357), 5'-CCGCUUCACCAAAAGCUUUAGAGAACUUGAGUGAAGGUGG-3'(서열번호 358), 5'-CCGCUUCACCAAAAGCUGUUAGUAGAACUUGAGUGAAGGUGG-3'(서열번호 359), 5'-CCGCUUCACCAAAAGCUGUUAGUUAGAACUUGAGUGAAGGUGG-3'(서열번호 360), 5'-CCGCUUCACCAAAAGCUGUUUAGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 361), 5'-CCGCUUCACCAAAAGCUGUCUUAGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 362), 및 5'-CCGCUUCACCAAAAGCUGUCCCUUAGGGGAUUAGAACUUGAGUGAAGGUGG-3'(서열번호 11)로 이루어진 군에서 선택된 서열;

5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 434), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUUCGAAAGUAACCCUCGA-3'(서열번호 435), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUUCGAAGUAACCCUCGA-3'(서열번호 436), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUCUUCGGAGUAACCCUCGA-3'(서열번호 437), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCGAGUAACCCUCGA-3'(서열번호 438), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUCGGUAACCCUCGA-3'(서열번호 439), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGUUCGUAACCCUCGA-3'(서열번호 440), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUUCGAACCCUCGA-3'(서열번호 441), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGACCCUCGA-3'(서열번호 442), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUUCGCCCUCGA-3'(서열번호 443), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCCUCGA-3'(서열번호 444), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAUUCGCCUCGA-3'(서열번호 445), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAUUCGCCUCGA-3'(서열번호 446), 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGUUCGCUCGA-3'(서열번호 447), 및 5'-GCUGCUUGCAUCAGCCUAAUGUCGAGAAGUGCUUUCUUCGGAAAGUAACCCUCGA-3'(서열번호 12)로 이루어진 군에서 선택된 서열;

5'-AACAAAGAAAGGA-3'(서열번호 111), 5'-AACAAAUGAAAAGGA-3'(서열번호 112), 5'-AACAAAUUGAAAAAGGA-3'(서열번호 113), 5'-AACAAAUUCGAAAGAAGGA-3'(서열번호 114), 5'-AACAAAUUCAGAAAUGAAGGA-3'(서열번호 115), 5'-AACAAAUUCAUGAAAAUGAAGGA-3'(서열번호 116), 5'-AACAAAUUCAUUGAAAAAUGAAGGA-3'(서열번호 117), 및 5'-AACAAAUUCAUUUGAAAGAAUGAAGGA-3'(서열번호 118)에서 선택된 서열; 및

5'-AUGCAAC-3'.
제33항에 있어서, 상기 전달은 상기 Cas12f1 단백질 및 상기 엔지니어링 된 가이드 RNA를 CRISPR/Cas12f1 복합체로써 세포 내에 주입하는 것인 방법.
제33항에 있어서, 상기 전달은 상기 Cas12f1 단백질을 암호화하는 핵산 및 상기 엔지니어링 된 가이드 RNA를 암호화하는 핵산을 포함하는 벡터를 세포 내에 주입하는 것인 방법.
제35항에 있어서, 상기 벡터는 플라스미드, 레트로바이러스, 렌티바이러스, 아데노바이러스, 아데노-연관 바이러스, 백시니아바이러스, 폭스바이러스 및 단순포진 바이러스로 구성된 군에서 선택되는 하나 이상인 것을 특징으로 하는 벡터.
제33항에 있어서, 상기 세포는 진핵세포인 것을 특징으로 하는 방법.
다음을 포함하는, 세포 내에서 표적 핵산을 편집하는 방법:

Cas12f1 단백질 또는 이를 암호화하는 핵산, 및 제6항 내지 제18항 중 어느 한 항에 따른 엔지니어링 된 가이드 RNA 또는 이름 암호화하는 핵산을 세포 내로 전달하는 것,

이로 인해 상기 세포 내에서 CRISPR/Cas12f1 복합체가 형성될 수 있으며,

이로 인해 상기 표적 핵산이 CRISPR/Cas12f1 복합체에 의해 편집될 수 있음.