KR102458395B1 - 프로그램가능한 dna 결합 단백질을 사용한, 표적화된 게놈 변형의 개선 - Google Patents
프로그램가능한 dna 결합 단백질을 사용한, 표적화된 게놈 변형의 개선 Download PDFInfo
- Publication number
- KR102458395B1 KR102458395B1 KR1020187037407A KR20187037407A KR102458395B1 KR 102458395 B1 KR102458395 B1 KR 102458395B1 KR 1020187037407 A KR1020187037407 A KR 1020187037407A KR 20187037407 A KR20187037407 A KR 20187037407A KR 102458395 B1 KR102458395 B1 KR 102458395B1
- Authority
- KR
- South Korea
- Prior art keywords
- protein
- crispr
- programmable dna
- dna binding
- sequence
- Prior art date
Links
- 102000052510 DNA-Binding Proteins Human genes 0.000 title claims abstract description 184
- 238000010362 genome editing Methods 0.000 title claims abstract description 30
- 108700020911 DNA-Binding Proteins Proteins 0.000 title abstract description 31
- 238000000034 method Methods 0.000 claims abstract description 121
- 239000000203 mixture Substances 0.000 claims abstract description 53
- 210000003527 eukaryotic cell Anatomy 0.000 claims abstract description 32
- 108090000623 proteins and genes Proteins 0.000 claims description 284
- 102000004169 proteins and genes Human genes 0.000 claims description 269
- 108020004414 DNA Proteins 0.000 claims description 246
- 230000000694 effects Effects 0.000 claims description 192
- 230000000051 modifying effect Effects 0.000 claims description 163
- 101710163270 Nuclease Proteins 0.000 claims description 154
- 101710096438 DNA-binding protein Proteins 0.000 claims description 153
- 230000002759 chromosomal effect Effects 0.000 claims description 128
- 108020005004 Guide RNA Proteins 0.000 claims description 86
- 150000007523 nucleic acids Chemical class 0.000 claims description 80
- 102000039446 nucleic acids Human genes 0.000 claims description 72
- 108020004707 nucleic acids Proteins 0.000 claims description 72
- 230000027455 binding Effects 0.000 claims description 55
- 230000035772 mutation Effects 0.000 claims description 31
- 241000282414 Homo sapiens Species 0.000 claims description 27
- 230000001965 increasing effect Effects 0.000 claims description 22
- 102000040430 polynucleotide Human genes 0.000 claims description 21
- 108091033319 polynucleotide Proteins 0.000 claims description 21
- 239000002157 polynucleotide Substances 0.000 claims description 21
- 108091033409 CRISPR Proteins 0.000 claims description 18
- 210000005260 human cell Anatomy 0.000 claims description 17
- 210000004962 mammalian cell Anatomy 0.000 claims description 14
- 239000013598 vector Substances 0.000 claims description 14
- 108020004999 messenger RNA Proteins 0.000 claims description 12
- 239000013600 plasmid vector Substances 0.000 claims description 12
- 239000013603 viral vector Substances 0.000 claims description 10
- 238000000338 in vitro Methods 0.000 claims description 9
- 238000010356 CRISPR-Cas9 genome editing Methods 0.000 claims description 8
- 241000589599 Francisella tularensis subsp. novicida Species 0.000 claims description 8
- 241000589875 Campylobacter jejuni Species 0.000 claims description 5
- 241000193996 Streptococcus pyogenes Species 0.000 claims description 5
- 230000008569 process Effects 0.000 claims description 5
- 230000000306 recurrent effect Effects 0.000 claims description 5
- 102220605874 Cytosolic arginine sensor for mTORC1 subunit 2_D10A_mutation Human genes 0.000 claims description 4
- 230000002068 genetic effect Effects 0.000 claims description 2
- 210000002257 embryonic structure Anatomy 0.000 claims 1
- 210000004602 germ cell Anatomy 0.000 claims 1
- 238000001514 detection method Methods 0.000 abstract description 21
- 238000010453 CRISPR/Cas method Methods 0.000 description 179
- 210000004027 cell Anatomy 0.000 description 128
- 125000003729 nucleotide group Chemical group 0.000 description 58
- 239000002773 nucleotide Substances 0.000 description 56
- 108010008532 Deoxyribonuclease I Proteins 0.000 description 53
- 102000007260 Deoxyribonuclease I Human genes 0.000 description 53
- 239000003550 marker Substances 0.000 description 51
- 230000004568 DNA-binding Effects 0.000 description 40
- 108020001507 fusion proteins Proteins 0.000 description 31
- 102000037865 fusion proteins Human genes 0.000 description 31
- 102000004533 Endonucleases Human genes 0.000 description 28
- 108010042407 Endonucleases Proteins 0.000 description 28
- 230000002103 transcriptional effect Effects 0.000 description 28
- 238000003776 cleavage reaction Methods 0.000 description 27
- 230000007017 scission Effects 0.000 description 27
- 108010017070 Zinc Finger Nucleases Proteins 0.000 description 26
- 239000012636 effector Substances 0.000 description 24
- 238000011144 upstream manufacturing Methods 0.000 description 24
- 230000010354 integration Effects 0.000 description 21
- 108010077544 Chromatin Proteins 0.000 description 20
- 210000003483 chromatin Anatomy 0.000 description 20
- 239000013612 plasmid Substances 0.000 description 20
- 108010033040 Histones Proteins 0.000 description 18
- 230000004048 modification Effects 0.000 description 18
- 238000012986 modification Methods 0.000 description 18
- 238000001890 transfection Methods 0.000 description 18
- 108091028043 Nucleic acid sequence Proteins 0.000 description 17
- 108091032973 (ribonucleotides)n+m Proteins 0.000 description 15
- 101710185494 Zinc finger protein Proteins 0.000 description 15
- 102100023597 Zinc finger protein 816 Human genes 0.000 description 15
- 230000014509 gene expression Effects 0.000 description 15
- 208000037265 diseases, disorders, signs and symptoms Diseases 0.000 description 14
- 230000004049 epigenetic modification Effects 0.000 description 14
- 108700036482 Francisella novicida Cas9 Proteins 0.000 description 13
- 102100025169 Max-binding protein MNT Human genes 0.000 description 12
- 108060004795 Methyltransferase Proteins 0.000 description 12
- 238000012217 deletion Methods 0.000 description 12
- 230000037430 deletion Effects 0.000 description 12
- 230000029279 positive regulation of transcription, DNA-dependent Effects 0.000 description 12
- 108091006107 transcriptional repressors Proteins 0.000 description 12
- 108010061979 CEL I nuclease Proteins 0.000 description 11
- 108010077850 Nuclear Localization Signals Proteins 0.000 description 11
- 108091028113 Trans-activating crRNA Proteins 0.000 description 11
- 239000013611 chromosomal DNA Substances 0.000 description 11
- 102000053602 DNA Human genes 0.000 description 10
- 230000004913 activation Effects 0.000 description 10
- 201000010099 disease Diseases 0.000 description 10
- HCHKCACWOHOZIP-UHFFFAOYSA-N Zinc Chemical compound [Zn] HCHKCACWOHOZIP-UHFFFAOYSA-N 0.000 description 9
- 238000003556 assay Methods 0.000 description 9
- 230000001105 regulatory effect Effects 0.000 description 9
- 229910052725 zinc Inorganic materials 0.000 description 9
- 239000011701 zinc Substances 0.000 description 9
- 102000000311 Cytosine Deaminase Human genes 0.000 description 8
- 108010080611 Cytosine Deaminase Proteins 0.000 description 8
- 101000860092 Francisella tularensis subsp. novicida (strain U112) CRISPR-associated endonuclease Cas12a Proteins 0.000 description 8
- 102100021519 Hemoglobin subunit beta Human genes 0.000 description 8
- 108090000246 Histone acetyltransferases Proteins 0.000 description 8
- 102000003893 Histone acetyltransferases Human genes 0.000 description 8
- 108091006047 fluorescent proteins Proteins 0.000 description 8
- 102000034287 fluorescent proteins Human genes 0.000 description 8
- 102000016397 Methyltransferase Human genes 0.000 description 7
- 108091027544 Subgenomic mRNA Proteins 0.000 description 7
- 150000001413 amino acids Chemical class 0.000 description 7
- 230000029087 digestion Effects 0.000 description 7
- 230000008685 targeting Effects 0.000 description 7
- 241001529936 Murinae Species 0.000 description 6
- 230000006154 adenylylation Effects 0.000 description 6
- 238000005576 amination reaction Methods 0.000 description 6
- 238000002487 chromatin immunoprecipitation Methods 0.000 description 6
- 238000005520 cutting process Methods 0.000 description 6
- 230000001973 epigenetic effect Effects 0.000 description 6
- 229920002401 polyacrylamide Polymers 0.000 description 6
- 125000002652 ribonucleotide group Chemical group 0.000 description 6
- 108091026890 Coding region Proteins 0.000 description 5
- -1 EYFP Proteins 0.000 description 5
- 102000004190 Enzymes Human genes 0.000 description 5
- 108090000790 Enzymes Proteins 0.000 description 5
- 101000615488 Homo sapiens Methyl-CpG-binding domain protein 2 Proteins 0.000 description 5
- 102100021299 Methyl-CpG-binding domain protein 2 Human genes 0.000 description 5
- 102000004160 Phosphoric Monoester Hydrolases Human genes 0.000 description 5
- 108090000608 Phosphoric Monoester Hydrolases Proteins 0.000 description 5
- 108091000080 Phosphotransferase Proteins 0.000 description 5
- 108010083111 Ubiquitin-Protein Ligases Proteins 0.000 description 5
- 102000006275 Ubiquitin-Protein Ligases Human genes 0.000 description 5
- 230000029936 alkylation Effects 0.000 description 5
- 238000005804 alkylation reaction Methods 0.000 description 5
- 108010062796 arginyllysine Proteins 0.000 description 5
- 230000000295 complement effect Effects 0.000 description 5
- OPTASPLRGRRNAP-UHFFFAOYSA-N cytosine Chemical compound NC=1C=CNC(=O)N=1 OPTASPLRGRRNAP-UHFFFAOYSA-N 0.000 description 5
- 230000020335 dealkylation Effects 0.000 description 5
- 238000006900 dealkylation reaction Methods 0.000 description 5
- 230000009615 deamination Effects 0.000 description 5
- 238000006481 deamination reaction Methods 0.000 description 5
- 230000006114 demyristoylation Effects 0.000 description 5
- 238000013461 design Methods 0.000 description 5
- 230000009504 deubiquitination Effects 0.000 description 5
- 230000004927 fusion Effects 0.000 description 5
- 210000003734 kidney Anatomy 0.000 description 5
- 108010054155 lysyllysine Proteins 0.000 description 5
- 230000001404 mediated effect Effects 0.000 description 5
- 230000007498 myristoylation Effects 0.000 description 5
- 102000020233 phosphotransferase Human genes 0.000 description 5
- 210000000130 stem cell Anatomy 0.000 description 5
- 239000000126 substance Substances 0.000 description 5
- 238000006467 substitution reaction Methods 0.000 description 5
- YBJHBAHKTGYVGT-ZKWXMUAHSA-N (+)-Biotin Chemical compound N1C(=O)N[C@@H]2[C@H](CCCCC(=O)O)SC[C@@H]21 YBJHBAHKTGYVGT-ZKWXMUAHSA-N 0.000 description 4
- VCSABYLVNWQYQE-UHFFFAOYSA-N Ala-Lys-Lys Natural products NCCCCC(NC(=O)C(N)C)C(=O)NC(CCCCN)C(O)=O VCSABYLVNWQYQE-UHFFFAOYSA-N 0.000 description 4
- 101100512078 Caenorhabditis elegans lys-1 gene Proteins 0.000 description 4
- 101100342977 Neurospora crassa (strain ATCC 24698 / 74-OR23-1A / CBS 708.71 / DSM 1257 / FGSC 987) leu-1 gene Proteins 0.000 description 4
- 108010047956 Nucleosomes Proteins 0.000 description 4
- 108091034117 Oligonucleotide Proteins 0.000 description 4
- 102000005421 acetyltransferase Human genes 0.000 description 4
- 108020002494 acetyltransferase Proteins 0.000 description 4
- 230000008859 change Effects 0.000 description 4
- 230000018044 dehydration Effects 0.000 description 4
- 238000006297 dehydration reaction Methods 0.000 description 4
- 208000035475 disorder Diseases 0.000 description 4
- 230000034431 double-strand break repair via homologous recombination Effects 0.000 description 4
- 238000010166 immunofluorescence Methods 0.000 description 4
- 238000003780 insertion Methods 0.000 description 4
- 230000037431 insertion Effects 0.000 description 4
- 230000006780 non-homologous end joining Effects 0.000 description 4
- 210000001623 nucleosome Anatomy 0.000 description 4
- 230000022532 regulation of transcription, DNA-dependent Effects 0.000 description 4
- 108091023037 Aptamer Proteins 0.000 description 3
- 108020004705 Codon Proteins 0.000 description 3
- 230000008836 DNA modification Effects 0.000 description 3
- WSFSSNUMVMOOMR-UHFFFAOYSA-N Formaldehyde Chemical compound O=C WSFSSNUMVMOOMR-UHFFFAOYSA-N 0.000 description 3
- 102100038885 Histone acetyltransferase p300 Human genes 0.000 description 3
- 101000882390 Homo sapiens Histone acetyltransferase p300 Proteins 0.000 description 3
- 101001000998 Homo sapiens Protein phosphatase 1 regulatory subunit 12C Proteins 0.000 description 3
- 108700003968 Human immunodeficiency virus 1 tat peptide (49-57) Proteins 0.000 description 3
- KWTVLKBOQATPHJ-SRVKXCTJSA-N Leu-Ala-Lys Chemical compound C[C@@H](C(=O)N[C@@H](CCCCN)C(=O)O)NC(=O)[C@H](CC(C)C)N KWTVLKBOQATPHJ-SRVKXCTJSA-N 0.000 description 3
- 206010025323 Lymphomas Diseases 0.000 description 3
- KCXUCYYZNZFGLL-SRVKXCTJSA-N Lys-Ala-Leu Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](C)C(=O)N[C@@H](CC(C)C)C(O)=O KCXUCYYZNZFGLL-SRVKXCTJSA-N 0.000 description 3
- ZJWIXBZTAAJERF-IHRRRGAJSA-N Lys-Lys-Arg Chemical compound NCCCC[C@H](N)C(=O)N[C@@H](CCCCN)C(=O)N[C@H](C(O)=O)CCCN=C(N)N ZJWIXBZTAAJERF-IHRRRGAJSA-N 0.000 description 3
- WBSCNDJQPKSPII-KKUMJFAQSA-N Lys-Lys-Lys Chemical compound NCCCC[C@H](N)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCCCN)C(O)=O WBSCNDJQPKSPII-KKUMJFAQSA-N 0.000 description 3
- 241001465754 Metazoa Species 0.000 description 3
- SITLTJHOQZFJGG-UHFFFAOYSA-N N-L-alpha-glutamyl-L-valine Natural products CC(C)C(C(O)=O)NC(=O)C(N)CCC(O)=O SITLTJHOQZFJGG-UHFFFAOYSA-N 0.000 description 3
- 206010035226 Plasma cell myeloma Diseases 0.000 description 3
- 102100035620 Protein phosphatase 1 regulatory subunit 12C Human genes 0.000 description 3
- 108091028664 Ribonucleotide Proteins 0.000 description 3
- 125000000539 amino acid group Chemical group 0.000 description 3
- 238000004458 analytical method Methods 0.000 description 3
- 108010068380 arginylarginine Proteins 0.000 description 3
- 238000006243 chemical reaction Methods 0.000 description 3
- 239000003153 chemical reaction reagent Substances 0.000 description 3
- 238000004624 confocal microscopy Methods 0.000 description 3
- 230000001419 dependent effect Effects 0.000 description 3
- 238000000799 fluorescence microscopy Methods 0.000 description 3
- 238000009396 hybridization Methods 0.000 description 3
- 210000001822 immobilized cell Anatomy 0.000 description 3
- 238000001727 in vivo Methods 0.000 description 3
- 238000010859 live-cell imaging Methods 0.000 description 3
- 210000001161 mammalian embryo Anatomy 0.000 description 3
- 239000011159 matrix material Substances 0.000 description 3
- 201000000050 myeloid neoplasm Diseases 0.000 description 3
- 230000001590 oxidative effect Effects 0.000 description 3
- 230000008488 polyadenylation Effects 0.000 description 3
- 229920000642 polymer Polymers 0.000 description 3
- 108010054624 red fluorescent protein Proteins 0.000 description 3
- 230000008439 repair process Effects 0.000 description 3
- 230000010076 replication Effects 0.000 description 3
- 108091008146 restriction endonucleases Proteins 0.000 description 3
- 239000002336 ribonucleotide Substances 0.000 description 3
- 230000035939 shock Effects 0.000 description 3
- 241000894007 species Species 0.000 description 3
- 230000035897 transcription Effects 0.000 description 3
- 238000013518 transcription Methods 0.000 description 3
- 230000005030 transcription termination Effects 0.000 description 3
- VGIRNWJSIRVFRT-UHFFFAOYSA-N 2',7'-difluorofluorescein Chemical compound OC(=O)C1=CC=CC=C1C1=C2C=C(F)C(=O)C=C2OC2=CC(O)=C(F)C=C21 VGIRNWJSIRVFRT-UHFFFAOYSA-N 0.000 description 2
- 101710169336 5'-deoxyadenosine deaminase Proteins 0.000 description 2
- KDCGOANMDULRCW-UHFFFAOYSA-N 7H-purine Chemical compound N1=CNC2=NC=NC2=C1 KDCGOANMDULRCW-UHFFFAOYSA-N 0.000 description 2
- 241000604451 Acidaminococcus Species 0.000 description 2
- RLMISHABBKUNFO-WHFBIAKZSA-N Ala-Ala-Gly Chemical compound C[C@H](N)C(=O)N[C@@H](C)C(=O)NCC(O)=O RLMISHABBKUNFO-WHFBIAKZSA-N 0.000 description 2
- QUIGLPSHIFPEOV-CIUDSAMLSA-N Ala-Lys-Ala Chemical compound [H]N[C@@H](C)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](C)C(O)=O QUIGLPSHIFPEOV-CIUDSAMLSA-N 0.000 description 2
- 241000203069 Archaea Species 0.000 description 2
- 241000193830 Bacillus <bacterium> Species 0.000 description 2
- 241000894006 Bacteria Species 0.000 description 2
- 102100021277 Beta-secretase 2 Human genes 0.000 description 2
- 101710150190 Beta-secretase 2 Proteins 0.000 description 2
- 241000282465 Canis Species 0.000 description 2
- 241000282693 Cercopithecidae Species 0.000 description 2
- 102000005636 Cyclic AMP Response Element-Binding Protein Human genes 0.000 description 2
- 108010045171 Cyclic AMP Response Element-Binding Protein Proteins 0.000 description 2
- 108090000626 DNA-directed RNA polymerases Proteins 0.000 description 2
- 102000004163 DNA-directed RNA polymerases Human genes 0.000 description 2
- SHIBSTMRCDJXLN-UHFFFAOYSA-N Digoxigenin Natural products C1CC(C2C(C3(C)CCC(O)CC3CC2)CC2O)(O)C2(C)C1C1=CC(=O)OC1 SHIBSTMRCDJXLN-UHFFFAOYSA-N 0.000 description 2
- 241000206602 Eukaryota Species 0.000 description 2
- 108700028146 Genetic Enhancer Elements Proteins 0.000 description 2
- 206010056740 Genital discharge Diseases 0.000 description 2
- MFORDNZDKAVNSR-SRVKXCTJSA-N Gln-Pro-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@@H]1CCCN1C(=O)[C@@H](N)CCC(N)=O MFORDNZDKAVNSR-SRVKXCTJSA-N 0.000 description 2
- VSVZIEVNUYDAFR-YUMQZZPRSA-N Gly-Ala-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)[C@H](C)NC(=O)CN VSVZIEVNUYDAFR-YUMQZZPRSA-N 0.000 description 2
- DHMQDGOQFOQNFH-UHFFFAOYSA-N Glycine Chemical compound NCC(O)=O DHMQDGOQFOQNFH-UHFFFAOYSA-N 0.000 description 2
- NYHBQMYGNKIUIF-UUOKFMHZSA-N Guanosine Chemical compound C1=NC=2C(=O)NC(N)=NC=2N1[C@@H]1O[C@H](CO)[C@@H](O)[C@H]1O NYHBQMYGNKIUIF-UUOKFMHZSA-N 0.000 description 2
- 108010068250 Herpes Simplex Virus Protein Vmw65 Proteins 0.000 description 2
- 241000238631 Hexapoda Species 0.000 description 2
- 108700000788 Human immunodeficiency virus 1 tat peptide (47-57) Proteins 0.000 description 2
- GVNNAHIRSDRIII-AJNGGQMLSA-N Ile-Lys-Lys Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCCCN)C(=O)O)N GVNNAHIRSDRIII-AJNGGQMLSA-N 0.000 description 2
- KFKWRHQBZQICHA-STQMWFEESA-N L-leucyl-L-phenylalanine Natural products CC(C)C[C@H](N)C(=O)N[C@H](C(O)=O)CC1=CC=CC=C1 KFKWRHQBZQICHA-STQMWFEESA-N 0.000 description 2
- JLWZLIQRYCTYBD-IHRRRGAJSA-N Leu-Lys-Arg Chemical compound [H]N[C@@H](CC(C)C)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCCNC(N)=N)C(O)=O JLWZLIQRYCTYBD-IHRRRGAJSA-N 0.000 description 2
- SJNZALDHDUYDBU-IHRRRGAJSA-N Lys-Arg-Lys Chemical compound NCCCC[C@H](N)C(=O)N[C@@H](CCCN=C(N)N)C(=O)N[C@@H](CCCCN)C(O)=O SJNZALDHDUYDBU-IHRRRGAJSA-N 0.000 description 2
- FUKDBQGFSJUXGX-RWMBFGLXSA-N Lys-Arg-Pro Chemical compound C1C[C@@H](N(C1)C(=O)[C@H](CCCN=C(N)N)NC(=O)[C@H](CCCCN)N)C(=O)O FUKDBQGFSJUXGX-RWMBFGLXSA-N 0.000 description 2
- YBAFDPFAUTYYRW-UHFFFAOYSA-N N-L-alpha-glutamyl-L-leucine Natural products CC(C)CC(C(O)=O)NC(=O)C(N)CCC(O)=O YBAFDPFAUTYYRW-UHFFFAOYSA-N 0.000 description 2
- 230000010718 Oxidation Activity Effects 0.000 description 2
- 108091093037 Peptide nucleic acid Proteins 0.000 description 2
- 229930185560 Pseudouridine Natural products 0.000 description 2
- PTJWIQPHWPFNBW-UHFFFAOYSA-N Pseudouridine C Natural products OC1C(O)C(CO)OC1C1=CNC(=O)NC1=O PTJWIQPHWPFNBW-UHFFFAOYSA-N 0.000 description 2
- 102000014450 RNA Polymerase III Human genes 0.000 description 2
- 108010078067 RNA Polymerase III Proteins 0.000 description 2
- UYLKOSODXYSWMQ-XGEHTFHBSA-N Ser-Thr-Met Chemical compound C[C@H]([C@@H](C(=O)N[C@@H](CCSC)C(=O)O)NC(=O)[C@H](CO)N)O UYLKOSODXYSWMQ-XGEHTFHBSA-N 0.000 description 2
- 101100166147 Streptococcus thermophilus cas9 gene Proteins 0.000 description 2
- IQFYYKKMVGJFEH-XLPZGREQSA-N Thymidine Chemical compound O=C1NC(=O)C(C)=CN1[C@@H]1O[C@H](CO)[C@@H](O)C1 IQFYYKKMVGJFEH-XLPZGREQSA-N 0.000 description 2
- DRTQHJPVMGBUCF-XVFCMESISA-N Uridine Chemical compound O[C@@H]1[C@H](O)[C@@H](CO)O[C@H]1N1C(=O)NC(=O)C=C1 DRTQHJPVMGBUCF-XVFCMESISA-N 0.000 description 2
- 241000700605 Viruses Species 0.000 description 2
- OIRDTQYFTABQOQ-KQYNXXCUSA-N adenosine Chemical compound C1=NC=2C(N)=NC=NC=2N1[C@@H]1O[C@H](CO)[C@@H](O)[C@H]1O OIRDTQYFTABQOQ-KQYNXXCUSA-N 0.000 description 2
- 108010024078 alanyl-glycyl-serine Proteins 0.000 description 2
- 108010047495 alanylglycine Proteins 0.000 description 2
- 230000003321 amplification Effects 0.000 description 2
- 230000001580 bacterial effect Effects 0.000 description 2
- WGDUUQDYDIIBKT-UHFFFAOYSA-N beta-Pseudouridine Natural products OC1OC(CN2C=CC(=O)NC2=O)C(O)C1O WGDUUQDYDIIBKT-UHFFFAOYSA-N 0.000 description 2
- 230000003115 biocidal effect Effects 0.000 description 2
- 230000031018 biological processes and functions Effects 0.000 description 2
- 229960002685 biotin Drugs 0.000 description 2
- 235000020958 biotin Nutrition 0.000 description 2
- 239000011616 biotin Substances 0.000 description 2
- 108010006025 bovine growth hormone Proteins 0.000 description 2
- 210000004899 c-terminal region Anatomy 0.000 description 2
- 102100029387 cAMP-responsive element modulator Human genes 0.000 description 2
- 101710152311 cAMP-responsive element modulator Proteins 0.000 description 2
- 230000003197 catalytic effect Effects 0.000 description 2
- 239000003795 chemical substances by application Substances 0.000 description 2
- 229940104302 cytosine Drugs 0.000 description 2
- 238000004925 denaturation Methods 0.000 description 2
- 230000036425 denaturation Effects 0.000 description 2
- 239000005547 deoxyribonucleotide Substances 0.000 description 2
- 125000002637 deoxyribonucleotide group Chemical group 0.000 description 2
- 238000002405 diagnostic procedure Methods 0.000 description 2
- 238000010586 diagram Methods 0.000 description 2
- QONQRTHLHBTMGP-UHFFFAOYSA-N digitoxigenin Natural products CC12CCC(C3(CCC(O)CC3CC3)C)C3C11OC1CC2C1=CC(=O)OC1 QONQRTHLHBTMGP-UHFFFAOYSA-N 0.000 description 2
- SHIBSTMRCDJXLN-KCZCNTNESA-N digoxigenin Chemical compound C1([C@@H]2[C@@]3([C@@](CC2)(O)[C@H]2[C@@H]([C@@]4(C)CC[C@H](O)C[C@H]4CC2)C[C@H]3O)C)=CC(=O)OC1 SHIBSTMRCDJXLN-KCZCNTNESA-N 0.000 description 2
- 238000006471 dimerization reaction Methods 0.000 description 2
- 230000005782 double-strand break Effects 0.000 description 2
- 238000011304 droplet digital PCR Methods 0.000 description 2
- 230000009977 dual effect Effects 0.000 description 2
- 210000001671 embryonic stem cell Anatomy 0.000 description 2
- 239000003623 enhancer Substances 0.000 description 2
- 210000002950 fibroblast Anatomy 0.000 description 2
- 108010021843 fluorescent protein 583 Proteins 0.000 description 2
- VPZXBVLAVMBEQI-UHFFFAOYSA-N glycyl-DL-alpha-alanine Natural products OC(=O)C(C)NC(=O)CN VPZXBVLAVMBEQI-UHFFFAOYSA-N 0.000 description 2
- 108010000434 glycyl-alanyl-leucine Proteins 0.000 description 2
- PCHJSUWPFVWCPO-UHFFFAOYSA-N gold Chemical compound [Au] PCHJSUWPFVWCPO-UHFFFAOYSA-N 0.000 description 2
- 239000010931 gold Substances 0.000 description 2
- 229910052737 gold Inorganic materials 0.000 description 2
- 125000005843 halogen group Chemical group 0.000 description 2
- 230000006195 histone acetylation Effects 0.000 description 2
- 229910052739 hydrogen Inorganic materials 0.000 description 2
- 239000001257 hydrogen Substances 0.000 description 2
- 230000005764 inhibitory process Effects 0.000 description 2
- 230000003993 interaction Effects 0.000 description 2
- 210000003292 kidney cell Anatomy 0.000 description 2
- 201000007270 liver cancer Diseases 0.000 description 2
- 208000014018 liver neoplasm Diseases 0.000 description 2
- 238000004519 manufacturing process Methods 0.000 description 2
- 239000000463 material Substances 0.000 description 2
- 239000002609 medium Substances 0.000 description 2
- 201000001441 melanoma Diseases 0.000 description 2
- 108010005942 methionylglycine Proteins 0.000 description 2
- 238000010369 molecular cloning Methods 0.000 description 2
- 239000000178 monomer Substances 0.000 description 2
- 238000002703 mutagenesis Methods 0.000 description 2
- 231100000350 mutagenesis Toxicity 0.000 description 2
- 238000003199 nucleic acid amplification method Methods 0.000 description 2
- 230000003287 optical effect Effects 0.000 description 2
- 238000005457 optimization Methods 0.000 description 2
- 201000008968 osteosarcoma Diseases 0.000 description 2
- 239000002245 particle Substances 0.000 description 2
- 229920001184 polypeptide Polymers 0.000 description 2
- 108090000765 processed proteins & peptides Proteins 0.000 description 2
- 102000004196 processed proteins & peptides Human genes 0.000 description 2
- 238000012545 processing Methods 0.000 description 2
- PTJWIQPHWPFNBW-GBNDHIKLSA-N pseudouridine Chemical compound O[C@@H]1[C@H](O)[C@@H](CO)O[C@H]1C1=CNC(=O)NC1=O PTJWIQPHWPFNBW-GBNDHIKLSA-N 0.000 description 2
- 239000002096 quantum dot Substances 0.000 description 2
- 238000011160 research Methods 0.000 description 2
- 229910052594 sapphire Inorganic materials 0.000 description 2
- 239000010980 sapphire Substances 0.000 description 2
- 208000007056 sickle cell anemia Diseases 0.000 description 2
- 108700029760 synthetic LTSP Proteins 0.000 description 2
- MPLHNVLQVRSVEE-UHFFFAOYSA-N texas red Chemical compound [O-]S(=O)(=O)C1=CC(S(Cl)(=O)=O)=CC=C1C(C1=CC=2CCCN3CCCC(C=23)=C1O1)=C2C1=C(CCC1)C3=[N+]1CCCC3=C2 MPLHNVLQVRSVEE-UHFFFAOYSA-N 0.000 description 2
- 210000001519 tissue Anatomy 0.000 description 2
- 238000003151 transfection method Methods 0.000 description 2
- 238000013519 translation Methods 0.000 description 2
- 241000701161 unidentified adenovirus Species 0.000 description 2
- 108091005957 yellow fluorescent proteins Proteins 0.000 description 2
- QVVDVENEPNODSI-BTNSXGMBSA-N (2s)-2-[[(2s)-2-[[(2s)-2-[[(2s)-2-[[(2s)-2-[[(2s)-2-amino-5-(diaminomethylideneamino)pentanoyl]amino]-5-(diaminomethylideneamino)pentanoyl]amino]-5-(diaminomethylideneamino)pentanoyl]amino]-5-(diaminomethylideneamino)pentanoyl]amino]-5-(diaminomethylidene Chemical compound NC(N)=NCCC[C@H](N)C(=O)N[C@@H](CCCN=C(N)N)C(=O)N[C@@H](CCCN=C(N)N)C(=O)N[C@@H](CCCN=C(N)N)C(=O)N[C@@H](CCCN=C(N)N)C(=O)N[C@@H](CCCN=C(N)N)C(O)=O QVVDVENEPNODSI-BTNSXGMBSA-N 0.000 description 1
- RAVVEEJGALCVIN-AGVBWZICSA-N (2s)-2-[[(2s)-2-[[(2s)-2-[[(2s)-5-amino-2-[[(2s)-2-[[(2s)-2-[[(2s)-6-amino-2-[[(2s)-6-amino-2-[[(2s)-2-[[2-[[(2s)-2-amino-3-(4-hydroxyphenyl)propanoyl]amino]acetyl]amino]-5-(diaminomethylideneamino)pentanoyl]amino]hexanoyl]amino]hexanoyl]amino]-5-(diamino Chemical compound NC(N)=NCCC[C@@H](C(O)=O)NC(=O)[C@H](CCCN=C(N)N)NC(=O)[C@H](CCCN=C(N)N)NC(=O)[C@H](CCC(N)=O)NC(=O)[C@H](CCCN=C(N)N)NC(=O)[C@H](CCCN=C(N)N)NC(=O)[C@H](CCCCN)NC(=O)[C@H](CCCCN)NC(=O)[C@H](CCCN=C(N)N)NC(=O)CNC(=O)[C@@H](N)CC1=CC=C(O)C=C1 RAVVEEJGALCVIN-AGVBWZICSA-N 0.000 description 1
- RRBGTUQJDFBWNN-MUGJNUQGSA-N (2s)-6-amino-2-[[(2s)-6-amino-2-[[(2s)-6-amino-2-[[(2s)-2,6-diaminohexanoyl]amino]hexanoyl]amino]hexanoyl]amino]hexanoic acid Chemical compound NCCCC[C@H](N)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCCCN)C(O)=O RRBGTUQJDFBWNN-MUGJNUQGSA-N 0.000 description 1
- UHDGCWIWMRVCDJ-UHFFFAOYSA-N 1-beta-D-Xylofuranosyl-NH-Cytosine Natural products O=C1N=C(N)C=CN1C1C(O)C(O)C(CO)O1 UHDGCWIWMRVCDJ-UHFFFAOYSA-N 0.000 description 1
- YMHOBZXQZVXHBM-UHFFFAOYSA-N 2,5-dimethoxy-4-bromophenethylamine Chemical compound COC1=CC(CCN)=C(OC)C=C1Br YMHOBZXQZVXHBM-UHFFFAOYSA-N 0.000 description 1
- GXPCCSYVSYFRDU-LJWNLINESA-N 2-[[(2s)-2-[[(2s)-2-[[2-[[(2s)-2-[[(2s)-2-amino-3-phenylpropanoyl]amino]-4-methylpentanoyl]amino]acetyl]amino]-3-phenylpropanoyl]amino]-4-methylpentanoyl]amino]acetic acid Chemical compound C([C@H](N)C(=O)N[C@@H](CC(C)C)C(=O)NCC(=O)N[C@@H](CC=1C=CC=CC=1)C(=O)N[C@@H](CC(C)C)C(=O)NCC(O)=O)C1=CC=CC=C1 GXPCCSYVSYFRDU-LJWNLINESA-N 0.000 description 1
- QMOQBVOBWVNSNO-UHFFFAOYSA-N 2-[[2-[[2-[(2-azaniumylacetyl)amino]acetyl]amino]acetyl]amino]acetate Chemical compound NCC(=O)NCC(=O)NCC(=O)NCC(O)=O QMOQBVOBWVNSNO-UHFFFAOYSA-N 0.000 description 1
- 108010079649 APOBEC-1 Deaminase Proteins 0.000 description 1
- 102000012758 APOBEC-1 Deaminase Human genes 0.000 description 1
- 241000007909 Acaryochloris Species 0.000 description 1
- 241001135190 Acetohalobium Species 0.000 description 1
- 241000093740 Acidaminococcus sp. Species 0.000 description 1
- 101000860090 Acidaminococcus sp. (strain BV3L6) CRISPR-associated endonuclease Cas12a Proteins 0.000 description 1
- 241000266272 Acidithiobacillus Species 0.000 description 1
- 102000007469 Actins Human genes 0.000 description 1
- 108010085238 Actins Proteins 0.000 description 1
- 102000055025 Adenosine deaminases Human genes 0.000 description 1
- HHGYNJRJIINWAK-FXQIFTODSA-N Ala-Ala-Arg Chemical compound C[C@H](N)C(=O)N[C@@H](C)C(=O)N[C@H](C(O)=O)CCCN=C(N)N HHGYNJRJIINWAK-FXQIFTODSA-N 0.000 description 1
- JBVSSSZFNTXJDX-YTLHQDLWSA-N Ala-Ala-Thr Chemical compound C[C@@H](O)[C@@H](C(O)=O)NC(=O)[C@H](C)NC(=O)[C@H](C)N JBVSSSZFNTXJDX-YTLHQDLWSA-N 0.000 description 1
- NIZKGBJVCMRDKO-KWQFWETISA-N Ala-Gly-Tyr Chemical compound C[C@H](N)C(=O)NCC(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 NIZKGBJVCMRDKO-KWQFWETISA-N 0.000 description 1
- PMQXMXAASGFUDX-SRVKXCTJSA-N Ala-Lys-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)[C@@H](NC(=O)[C@H](C)N)CCCCN PMQXMXAASGFUDX-SRVKXCTJSA-N 0.000 description 1
- CHFFHQUVXHEGBY-GARJFASQSA-N Ala-Lys-Pro Chemical compound C[C@@H](C(=O)N[C@@H](CCCCN)C(=O)N1CCC[C@@H]1C(=O)O)N CHFFHQUVXHEGBY-GARJFASQSA-N 0.000 description 1
- BTRULDJUUVGRNE-DCAQKATOSA-N Ala-Pro-Lys Chemical compound C[C@H](N)C(=O)N1CCC[C@H]1C(=O)N[C@@H](CCCCN)C(O)=O BTRULDJUUVGRNE-DCAQKATOSA-N 0.000 description 1
- PXAFZDXYEIIUTF-LKTVYLICSA-N Ala-Trp-Glu Chemical compound [H]N[C@@H](C)C(=O)N[C@@H](CC1=CNC2=C1C=CC=C2)C(=O)N[C@@H](CCC(O)=O)C(O)=O PXAFZDXYEIIUTF-LKTVYLICSA-N 0.000 description 1
- TVUFMYKTYXTRPY-HERUPUMHSA-N Ala-Trp-Ser Chemical compound [H]N[C@@H](C)C(=O)N[C@@H](CC1=CNC2=C1C=CC=C2)C(=O)N[C@@H](CO)C(O)=O TVUFMYKTYXTRPY-HERUPUMHSA-N 0.000 description 1
- 241001147780 Alicyclobacillus Species 0.000 description 1
- 101000935845 Aliivibrio fischeri Blue fluorescence protein Proteins 0.000 description 1
- 241001655243 Allochromatium Species 0.000 description 1
- 241000147157 Ammonifex Species 0.000 description 1
- 241000192542 Anabaena Species 0.000 description 1
- VWVPYNGMOCSSGK-GUBZILKMSA-N Arg-Arg-Asn Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CC(N)=O)C(O)=O VWVPYNGMOCSSGK-GUBZILKMSA-N 0.000 description 1
- MUXONAMCEUBVGA-DCAQKATOSA-N Arg-Arg-Gln Chemical compound NC(N)=NCCC[C@H](N)C(=O)N[C@@H](CCCN=C(N)N)C(=O)N[C@@H](CCC(N)=O)C(O)=O MUXONAMCEUBVGA-DCAQKATOSA-N 0.000 description 1
- NABSCJGZKWSNHX-RCWTZXSCSA-N Arg-Arg-Thr Chemical compound NC(N)=NCCC[C@@H](C(=O)N[C@@H]([C@H](O)C)C(O)=O)NC(=O)[C@@H](N)CCCN=C(N)N NABSCJGZKWSNHX-RCWTZXSCSA-N 0.000 description 1
- CPSHGRGUPZBMOK-CIUDSAMLSA-N Arg-Asn-Gln Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@@H](CCC(N)=O)C(O)=O CPSHGRGUPZBMOK-CIUDSAMLSA-N 0.000 description 1
- RVDVDRUZWZIBJQ-CIUDSAMLSA-N Arg-Asn-Glu Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@@H](CCC(O)=O)C(O)=O RVDVDRUZWZIBJQ-CIUDSAMLSA-N 0.000 description 1
- GIVWETPOBCRTND-DCAQKATOSA-N Arg-Gln-Arg Chemical compound NC(N)=NCCC[C@H](N)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](CCCN=C(N)N)C(O)=O GIVWETPOBCRTND-DCAQKATOSA-N 0.000 description 1
- JCAISGGAOQXEHJ-ZPFDUUQYSA-N Arg-Gln-Ile Chemical compound CC[C@H](C)[C@@H](C(=O)O)NC(=O)[C@H](CCC(=O)N)NC(=O)[C@H](CCCN=C(N)N)N JCAISGGAOQXEHJ-ZPFDUUQYSA-N 0.000 description 1
- OGUPCHKBOKJFMA-SRVKXCTJSA-N Arg-Glu-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@H](CCC(O)=O)NC(=O)[C@@H](N)CCCN=C(N)N OGUPCHKBOKJFMA-SRVKXCTJSA-N 0.000 description 1
- GIMTZGADWZTZGV-DCAQKATOSA-N Arg-Lys-Cys Chemical compound C(CCN)C[C@@H](C(=O)N[C@@H](CS)C(=O)O)NC(=O)[C@H](CCCN=C(N)N)N GIMTZGADWZTZGV-DCAQKATOSA-N 0.000 description 1
- CLICCYPMVFGUOF-IHRRRGAJSA-N Arg-Lys-Leu Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CC(C)C)C(O)=O CLICCYPMVFGUOF-IHRRRGAJSA-N 0.000 description 1
- RIQBRKVTFBWEDY-RHYQMDGZSA-N Arg-Lys-Thr Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H]([C@@H](C)O)C(O)=O RIQBRKVTFBWEDY-RHYQMDGZSA-N 0.000 description 1
- PAPSMOYMQDWIOR-AVGNSLFASA-N Arg-Lys-Val Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](C(C)C)C(O)=O PAPSMOYMQDWIOR-AVGNSLFASA-N 0.000 description 1
- OMKZPCPZEFMBIT-SRVKXCTJSA-N Arg-Met-Arg Chemical compound NC(=N)NCCC[C@H](N)C(=O)N[C@@H](CCSC)C(=O)N[C@@H](CCCNC(N)=N)C(O)=O OMKZPCPZEFMBIT-SRVKXCTJSA-N 0.000 description 1
- NYDIVDKTULRINZ-AVGNSLFASA-N Arg-Met-Lys Chemical compound CSCC[C@@H](C(=O)N[C@@H](CCCCN)C(=O)O)NC(=O)[C@H](CCCN=C(N)N)N NYDIVDKTULRINZ-AVGNSLFASA-N 0.000 description 1
- YCYXHLZRUSJITQ-SRVKXCTJSA-N Arg-Pro-Pro Chemical compound NC(=N)NCCC[C@H](N)C(=O)N1CCC[C@H]1C(=O)N1[C@H](C(O)=O)CCC1 YCYXHLZRUSJITQ-SRVKXCTJSA-N 0.000 description 1
- FRBAHXABMQXSJQ-FXQIFTODSA-N Arg-Ser-Ser Chemical compound [H]N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](CO)C(=O)N[C@@H](CO)C(O)=O FRBAHXABMQXSJQ-FXQIFTODSA-N 0.000 description 1
- ULBHWNVWSCJLCO-NHCYSSNCSA-N Arg-Val-Glu Chemical compound OC(=O)CC[C@@H](C(O)=O)NC(=O)[C@H](C(C)C)NC(=O)[C@@H](N)CCCN=C(N)N ULBHWNVWSCJLCO-NHCYSSNCSA-N 0.000 description 1
- 241001495180 Arthrospira Species 0.000 description 1
- KUYKVGODHGHFDI-ACZMJKKPSA-N Asn-Gln-Ser Chemical compound [H]N[C@@H](CC(N)=O)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](CO)C(O)=O KUYKVGODHGHFDI-ACZMJKKPSA-N 0.000 description 1
- PPCORQFLAZWUNO-QWRGUYRKSA-N Asn-Phe-Gly Chemical compound C1=CC=C(C=C1)C[C@@H](C(=O)NCC(=O)O)NC(=O)[C@H](CC(=O)N)N PPCORQFLAZWUNO-QWRGUYRKSA-N 0.000 description 1
- HSWYMWGDMPLTTH-FXQIFTODSA-N Asp-Glu-Gln Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](CCC(N)=O)C(O)=O HSWYMWGDMPLTTH-FXQIFTODSA-N 0.000 description 1
- MNQMTYSEKZHIDF-GCJQMDKQSA-N Asp-Thr-Ala Chemical compound [H]N[C@@H](CC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(=O)N[C@@H](C)C(O)=O MNQMTYSEKZHIDF-GCJQMDKQSA-N 0.000 description 1
- 108091005950 Azurite Proteins 0.000 description 1
- DWRXFEITVBNRMK-UHFFFAOYSA-N Beta-D-1-Arabinofuranosylthymine Natural products O=C1NC(=O)C(C)=CN1C1C(O)C(O)C(CO)O1 DWRXFEITVBNRMK-UHFFFAOYSA-N 0.000 description 1
- 241000283690 Bos taurus Species 0.000 description 1
- 102100029895 Bromodomain-containing protein 4 Human genes 0.000 description 1
- 241001600148 Burkholderiales Species 0.000 description 1
- 239000002126 C01EB10 - Adenosine Substances 0.000 description 1
- 101100381481 Caenorhabditis elegans baz-2 gene Proteins 0.000 description 1
- 241000589876 Campylobacter Species 0.000 description 1
- 201000009030 Carcinoma Diseases 0.000 description 1
- 102100025064 Cellular tumor antigen p53 Human genes 0.000 description 1
- 108091005944 Cerulean Proteins 0.000 description 1
- 241000282552 Chlorocebus aethiops Species 0.000 description 1
- 241000579895 Chlorostilbon Species 0.000 description 1
- 102100035371 Chymotrypsin-like elastase family member 1 Human genes 0.000 description 1
- 101710138848 Chymotrypsin-like elastase family member 1 Proteins 0.000 description 1
- 108091005960 Citrine Proteins 0.000 description 1
- 241000193403 Clostridium Species 0.000 description 1
- 241000699800 Cricetinae Species 0.000 description 1
- 241000699802 Cricetulus griseus Species 0.000 description 1
- 241000065719 Crocosphaera Species 0.000 description 1
- MIKUYHXYGGJMLM-GIMIYPNGSA-N Crotonoside Natural products C1=NC2=C(N)NC(=O)N=C2N1[C@H]1O[C@@H](CO)[C@H](O)[C@@H]1O MIKUYHXYGGJMLM-GIMIYPNGSA-N 0.000 description 1
- 108091005943 CyPet Proteins 0.000 description 1
- 241000159506 Cyanothece Species 0.000 description 1
- UHDGCWIWMRVCDJ-PSQAKQOGSA-N Cytidine Natural products O=C1N=C(N)C=CN1[C@@H]1[C@@H](O)[C@@H](O)[C@H](CO)O1 UHDGCWIWMRVCDJ-PSQAKQOGSA-N 0.000 description 1
- 102100032218 Cytokine-inducible SH2-containing protein Human genes 0.000 description 1
- 241000701022 Cytomegalovirus Species 0.000 description 1
- NYHBQMYGNKIUIF-UHFFFAOYSA-N D-guanosine Natural products C1=2NC(N)=NC(=O)C=2N=CN1C1OC(CO)C(O)C1O NYHBQMYGNKIUIF-UHFFFAOYSA-N 0.000 description 1
- 230000006463 DNA deamination Effects 0.000 description 1
- 102000003844 DNA helicases Human genes 0.000 description 1
- 108090000133 DNA helicases Proteins 0.000 description 1
- 230000007067 DNA methylation Effects 0.000 description 1
- 230000033616 DNA repair Effects 0.000 description 1
- 230000007018 DNA scission Effects 0.000 description 1
- 208000016192 Demyelinating disease Diseases 0.000 description 1
- 206010012305 Demyelination Diseases 0.000 description 1
- 102100036912 Desmin Human genes 0.000 description 1
- 108010044052 Desmin Proteins 0.000 description 1
- 229920002307 Dextran Polymers 0.000 description 1
- 206010059866 Drug resistance Diseases 0.000 description 1
- 108091005941 EBFP Proteins 0.000 description 1
- 108091005947 EBFP2 Proteins 0.000 description 1
- 108091005942 ECFP Proteins 0.000 description 1
- 101710099240 Elastase-1 Proteins 0.000 description 1
- 102000011750 Endodeoxyribonucleases Human genes 0.000 description 1
- 108010037179 Endodeoxyribonucleases Proteins 0.000 description 1
- 102100037241 Endoglin Human genes 0.000 description 1
- 108010036395 Endoglin Proteins 0.000 description 1
- 101000889900 Enterobacteria phage T4 Intron-associated endonuclease 1 Proteins 0.000 description 1
- 241000283073 Equus caballus Species 0.000 description 1
- 241000588724 Escherichia coli Species 0.000 description 1
- 101000935842 Escherichia coli O127:H6 (strain E2348/69 / EPEC) Major structural subunit of bundle-forming pilus Proteins 0.000 description 1
- LFQSCWFLJHTTHZ-UHFFFAOYSA-N Ethanol Chemical compound CCO LFQSCWFLJHTTHZ-UHFFFAOYSA-N 0.000 description 1
- 241001468125 Exiguobacterium Species 0.000 description 1
- 108700024394 Exon Proteins 0.000 description 1
- 108060002716 Exonuclease Proteins 0.000 description 1
- 241000282326 Felis catus Species 0.000 description 1
- 102000008946 Fibrinogen Human genes 0.000 description 1
- 108010049003 Fibrinogen Proteins 0.000 description 1
- 241001617393 Finegoldia Species 0.000 description 1
- 241000589601 Francisella Species 0.000 description 1
- 206010064571 Gene mutation Diseases 0.000 description 1
- 102100039289 Glial fibrillary acidic protein Human genes 0.000 description 1
- 101710193519 Glial fibrillary acidic protein Proteins 0.000 description 1
- INKFLNZBTSNFON-CIUDSAMLSA-N Gln-Ala-Arg Chemical compound NC(=O)CC[C@H](N)C(=O)N[C@@H](C)C(=O)N[C@@H](CCCN=C(N)N)C(O)=O INKFLNZBTSNFON-CIUDSAMLSA-N 0.000 description 1
- QXQDADBVIBLBHN-FHWLQOOXSA-N Gln-Tyr-Phe Chemical compound [H]N[C@@H](CCC(N)=O)C(=O)N[C@@H](CC1=CC=C(O)C=C1)C(=O)N[C@@H](CC1=CC=CC=C1)C(O)=O QXQDADBVIBLBHN-FHWLQOOXSA-N 0.000 description 1
- VSRCAOIHMGCIJK-SRVKXCTJSA-N Glu-Leu-Arg Chemical compound OC(=O)CC[C@H](N)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CCCN=C(N)N)C(O)=O VSRCAOIHMGCIJK-SRVKXCTJSA-N 0.000 description 1
- KFMBRBPXHVMDFN-UWVGGRQHSA-N Gly-Arg-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@@H](NC(=O)CN)CCCNC(N)=N KFMBRBPXHVMDFN-UWVGGRQHSA-N 0.000 description 1
- QSTLUOIOYLYLLF-WDSKDSINSA-N Gly-Asp-Glu Chemical compound [H]NCC(=O)N[C@@H](CC(O)=O)C(=O)N[C@@H](CCC(O)=O)C(O)=O QSTLUOIOYLYLLF-WDSKDSINSA-N 0.000 description 1
- LXXLEUBUOMCAMR-NKWVEPMBSA-N Gly-Asp-Pro Chemical compound C1C[C@@H](N(C1)C(=O)[C@H](CC(=O)O)NC(=O)CN)C(=O)O LXXLEUBUOMCAMR-NKWVEPMBSA-N 0.000 description 1
- CQZDZKRHFWJXDF-WDSKDSINSA-N Gly-Gln-Ala Chemical compound OC(=O)[C@H](C)NC(=O)[C@H](CCC(N)=O)NC(=O)CN CQZDZKRHFWJXDF-WDSKDSINSA-N 0.000 description 1
- HQRHFUYMGCHHJS-LURJTMIESA-N Gly-Gly-Arg Chemical compound NCC(=O)NCC(=O)N[C@H](C(O)=O)CCCN=C(N)N HQRHFUYMGCHHJS-LURJTMIESA-N 0.000 description 1
- INLIXXRWNUKVCF-JTQLQIEISA-N Gly-Gly-Tyr Chemical compound NCC(=O)NCC(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 INLIXXRWNUKVCF-JTQLQIEISA-N 0.000 description 1
- ICUTTWWCDIIIEE-BQBZGAKWSA-N Gly-Met-Asn Chemical compound CSCC[C@@H](C(=O)N[C@@H](CC(=O)N)C(=O)O)NC(=O)CN ICUTTWWCDIIIEE-BQBZGAKWSA-N 0.000 description 1
- OCPPBNKYGYSLOE-IUCAKERBSA-N Gly-Pro-Met Chemical compound CSCC[C@@H](C(O)=O)NC(=O)[C@@H]1CCCN1C(=O)CN OCPPBNKYGYSLOE-IUCAKERBSA-N 0.000 description 1
- JNGHLWWFPGIJER-STQMWFEESA-N Gly-Pro-Tyr Chemical compound NCC(=O)N1CCC[C@H]1C(=O)N[C@H](C(O)=O)CC1=CC=C(O)C=C1 JNGHLWWFPGIJER-STQMWFEESA-N 0.000 description 1
- UMBDRSMLCUYIRI-DVJZZOLTSA-N Gly-Trp-Thr Chemical compound C[C@H]([C@@H](C(=O)O)NC(=O)[C@H](CC1=CNC2=CC=CC=C21)NC(=O)CN)O UMBDRSMLCUYIRI-DVJZZOLTSA-N 0.000 description 1
- 239000004471 Glycine Substances 0.000 description 1
- 108010043121 Green Fluorescent Proteins Proteins 0.000 description 1
- 102000004144 Green Fluorescent Proteins Human genes 0.000 description 1
- 108010012029 Guanine Deaminase Proteins 0.000 description 1
- 102000013587 Guanine deaminase Human genes 0.000 description 1
- 108091005904 Hemoglobin subunit beta Proteins 0.000 description 1
- 108010034791 Heterochromatin Proteins 0.000 description 1
- VYUXYMRNGALHEA-DLOVCJGASA-N His-Leu-Ala Chemical compound [H]N[C@@H](CC1=CNC=N1)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](C)C(O)=O VYUXYMRNGALHEA-DLOVCJGASA-N 0.000 description 1
- 102100039869 Histone H2B type F-S Human genes 0.000 description 1
- 102000011787 Histone Methyltransferases Human genes 0.000 description 1
- 108010036115 Histone Methyltransferases Proteins 0.000 description 1
- 102000003964 Histone deacetylase Human genes 0.000 description 1
- 108090000353 Histone deacetylase Proteins 0.000 description 1
- 102000006947 Histones Human genes 0.000 description 1
- 241000282412 Homo Species 0.000 description 1
- 101000794024 Homo sapiens Bromodomain-containing protein 4 Proteins 0.000 description 1
- 101000721661 Homo sapiens Cellular tumor antigen p53 Proteins 0.000 description 1
- 101000943420 Homo sapiens Cytokine-inducible SH2-containing protein Proteins 0.000 description 1
- 101100230565 Homo sapiens HBB gene Proteins 0.000 description 1
- 101100506314 Homo sapiens HBD gene Proteins 0.000 description 1
- 101001035372 Homo sapiens Histone H2B type F-S Proteins 0.000 description 1
- 101000608935 Homo sapiens Leukosialin Proteins 0.000 description 1
- 101000934372 Homo sapiens Macrosialin Proteins 0.000 description 1
- 101000653360 Homo sapiens Methylcytosine dioxygenase TET1 Proteins 0.000 description 1
- 101000946889 Homo sapiens Monocyte differentiation antigen CD14 Proteins 0.000 description 1
- 101001079872 Homo sapiens RING finger protein 112 Proteins 0.000 description 1
- 101001012157 Homo sapiens Receptor tyrosine-protein kinase erbB-2 Proteins 0.000 description 1
- 101000738771 Homo sapiens Receptor-type tyrosine-protein phosphatase C Proteins 0.000 description 1
- 101000821100 Homo sapiens Synapsin-1 Proteins 0.000 description 1
- 101000801209 Homo sapiens Transducin-like enhancer protein 4 Proteins 0.000 description 1
- 208000023105 Huntington disease Diseases 0.000 description 1
- XQFRJNBWHJMXHO-RRKCRQDMSA-N IDUR Chemical compound C1[C@H](O)[C@@H](CO)O[C@H]1N1C(=O)NC(=O)C(I)=C1 XQFRJNBWHJMXHO-RRKCRQDMSA-N 0.000 description 1
- TVYWVSJGSHQWMT-AJNGGQMLSA-N Ile-Leu-Lys Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CCCCN)C(=O)O)N TVYWVSJGSHQWMT-AJNGGQMLSA-N 0.000 description 1
- 108060003951 Immunoglobulin Proteins 0.000 description 1
- 229930010555 Inosine Natural products 0.000 description 1
- UGQMRVRMYYASKQ-KQYNXXCUSA-N Inosine Chemical compound O[C@@H]1[C@H](O)[C@@H](CO)O[C@H]1N1C2=NC=NC(O)=C2N=C1 UGQMRVRMYYASKQ-KQYNXXCUSA-N 0.000 description 1
- 108010065920 Insulin Lispro Proteins 0.000 description 1
- 102100025306 Integrin alpha-IIb Human genes 0.000 description 1
- 101710149643 Integrin alpha-IIb Proteins 0.000 description 1
- 102100037872 Intercellular adhesion molecule 2 Human genes 0.000 description 1
- 101710148794 Intercellular adhesion molecule 2 Proteins 0.000 description 1
- 108020004684 Internal Ribosome Entry Sites Proteins 0.000 description 1
- 108091092195 Intron Proteins 0.000 description 1
- 241001430082 Ktedonobacter Species 0.000 description 1
- SITWEMZOJNKJCH-UHFFFAOYSA-N L-alanine-L-arginine Natural products CC(N)C(=O)NC(C(O)=O)CCCNC(N)=N SITWEMZOJNKJCH-UHFFFAOYSA-N 0.000 description 1
- 241001112693 Lachnospiraceae Species 0.000 description 1
- 241000689670 Lachnospiraceae bacterium ND2006 Species 0.000 description 1
- 241000186660 Lactobacillus Species 0.000 description 1
- OGCQGUIWMSBHRZ-CIUDSAMLSA-N Leu-Asn-Ser Chemical compound [H]N[C@@H](CC(C)C)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@@H](CO)C(O)=O OGCQGUIWMSBHRZ-CIUDSAMLSA-N 0.000 description 1
- VQPPIMUZCZCOIL-GUBZILKMSA-N Leu-Gln-Ala Chemical compound CC(C)C[C@H](N)C(=O)N[C@@H](CCC(N)=O)C(=O)N[C@@H](C)C(O)=O VQPPIMUZCZCOIL-GUBZILKMSA-N 0.000 description 1
- DZQMXBALGUHGJT-GUBZILKMSA-N Leu-Glu-Ala Chemical compound [H]N[C@@H](CC(C)C)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H](C)C(O)=O DZQMXBALGUHGJT-GUBZILKMSA-N 0.000 description 1
- YOKVEHGYYQEQOP-QWRGUYRKSA-N Leu-Leu-Gly Chemical compound CC(C)C[C@H](N)C(=O)N[C@@H](CC(C)C)C(=O)NCC(O)=O YOKVEHGYYQEQOP-QWRGUYRKSA-N 0.000 description 1
- DCGXHWINSHEPIR-SRVKXCTJSA-N Leu-Lys-Cys Chemical compound CC(C)C[C@@H](C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CS)C(=O)O)N DCGXHWINSHEPIR-SRVKXCTJSA-N 0.000 description 1
- QMKFDEUJGYNFMC-AVGNSLFASA-N Leu-Pro-Arg Chemical compound CC(C)C[C@H](N)C(=O)N1CCC[C@H]1C(=O)N[C@@H](CCCN=C(N)N)C(O)=O QMKFDEUJGYNFMC-AVGNSLFASA-N 0.000 description 1
- 102100039564 Leukosialin Human genes 0.000 description 1
- 241001134698 Lyngbya Species 0.000 description 1
- RVOMPSJXSRPFJT-DCAQKATOSA-N Lys-Ala-Arg Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](C)C(=O)N[C@@H](CCCNC(N)=N)C(O)=O RVOMPSJXSRPFJT-DCAQKATOSA-N 0.000 description 1
- WSXTWLJHTLRFLW-SRVKXCTJSA-N Lys-Ala-Lys Chemical compound NCCCC[C@H](N)C(=O)N[C@@H](C)C(=O)N[C@@H](CCCCN)C(O)=O WSXTWLJHTLRFLW-SRVKXCTJSA-N 0.000 description 1
- CLBGMWIYPYAZPR-AVGNSLFASA-N Lys-Arg-Arg Chemical compound NCCCC[C@H](N)C(=O)N[C@@H](CCCN=C(N)N)C(=O)N[C@@H](CCCN=C(N)N)C(O)=O CLBGMWIYPYAZPR-AVGNSLFASA-N 0.000 description 1
- NTSPQIONFJUMJV-AVGNSLFASA-N Lys-Arg-Val Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H](C(C)C)C(O)=O NTSPQIONFJUMJV-AVGNSLFASA-N 0.000 description 1
- WGLAORUKDGRINI-WDCWCFNPSA-N Lys-Glu-Thr Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](CCC(O)=O)C(=O)N[C@@H]([C@@H](C)O)C(O)=O WGLAORUKDGRINI-WDCWCFNPSA-N 0.000 description 1
- ISHNZELVUVPCHY-ZETCQYMHSA-N Lys-Gly-Gly Chemical compound NCCCC[C@H](N)C(=O)NCC(=O)NCC(O)=O ISHNZELVUVPCHY-ZETCQYMHSA-N 0.000 description 1
- NKKFVJRLCCUJNA-QWRGUYRKSA-N Lys-Gly-Lys Chemical compound NCCCC[C@H](N)C(=O)NCC(=O)N[C@H](C(O)=O)CCCCN NKKFVJRLCCUJNA-QWRGUYRKSA-N 0.000 description 1
- KYNNSEJZFVCDIV-ZPFDUUQYSA-N Lys-Ile-Asn Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@@H](CC(N)=O)C(O)=O KYNNSEJZFVCDIV-ZPFDUUQYSA-N 0.000 description 1
- ZXFRGTAIIZHNHG-AJNGGQMLSA-N Lys-Ile-Leu Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CC(C)C)C(=O)O)NC(=O)[C@H](CCCCN)N ZXFRGTAIIZHNHG-AJNGGQMLSA-N 0.000 description 1
- GFWLIJDQILOEPP-HSCHXYMDSA-N Lys-Ile-Trp Chemical compound CC[C@H](C)[C@@H](C(=O)N[C@@H](CC1=CNC2=CC=CC=C21)C(=O)O)NC(=O)[C@H](CCCCN)N GFWLIJDQILOEPP-HSCHXYMDSA-N 0.000 description 1
- MUXNCRWTWBMNHX-SRVKXCTJSA-N Lys-Leu-Asp Chemical compound [H]N[C@@H](CCCCN)C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CC(O)=O)C(O)=O MUXNCRWTWBMNHX-SRVKXCTJSA-N 0.000 description 1
- XOQMURBBIXRRCR-SRVKXCTJSA-N Lys-Lys-Ala Chemical compound OC(=O)[C@H](C)NC(=O)[C@H](CCCCN)NC(=O)[C@@H](N)CCCCN XOQMURBBIXRRCR-SRVKXCTJSA-N 0.000 description 1
- KJIXWRWPOCKYLD-IHRRRGAJSA-N Lys-Lys-Met Chemical compound CSCC[C@@H](C(=O)O)NC(=O)[C@H](CCCCN)NC(=O)[C@H](CCCCN)N KJIXWRWPOCKYLD-IHRRRGAJSA-N 0.000 description 1
- ATNKHRAIZCMCCN-BZSNNMDCSA-N Lys-Lys-Phe Chemical compound C1=CC=C(C=C1)C[C@@H](C(=O)O)NC(=O)[C@H](CCCCN)NC(=O)[C@H](CCCCN)N ATNKHRAIZCMCCN-BZSNNMDCSA-N 0.000 description 1
- ZUGVARDEGWMMLK-SRVKXCTJSA-N Lys-Ser-Lys Chemical compound NCCCC[C@H](N)C(=O)N[C@@H](CO)C(=O)N[C@H](C(O)=O)CCCCN ZUGVARDEGWMMLK-SRVKXCTJSA-N 0.000 description 1
- 102100025136 Macrosialin Human genes 0.000 description 1
- 241000206589 Marinobacter Species 0.000 description 1
- BEZJTLKUMFMITF-AVGNSLFASA-N Met-Lys-Arg Chemical compound CSCC[C@H](N)C(=O)N[C@@H](CCCCN)C(=O)N[C@H](C(O)=O)CCCNC(N)=N BEZJTLKUMFMITF-AVGNSLFASA-N 0.000 description 1
- 241000204639 Methanohalobium Species 0.000 description 1
- 102000006890 Methyl-CpG-Binding Protein 2 Human genes 0.000 description 1
- 108010072388 Methyl-CpG-Binding Protein 2 Proteins 0.000 description 1
- 102100030819 Methylcytosine dioxygenase TET1 Human genes 0.000 description 1
- 241000179980 Microcoleus Species 0.000 description 1
- 241000192701 Microcystis Species 0.000 description 1
- 241000190905 Microscilla Species 0.000 description 1
- 102100035877 Monocyte differentiation antigen CD14 Human genes 0.000 description 1
- 241000713333 Mouse mammary tumor virus Species 0.000 description 1
- 101000981253 Mus musculus GPI-linked NAD(P)(+)-arginine ADP-ribosyltransferase 1 Proteins 0.000 description 1
- 101000978776 Mus musculus Neurogenic locus notch homolog protein 1 Proteins 0.000 description 1
- AJHCSUXXECOXOY-UHFFFAOYSA-N N-glycyl-L-tryptophan Natural products C1=CC=C2C(CC(NC(=O)CN)C(O)=O)=CNC2=C1 AJHCSUXXECOXOY-UHFFFAOYSA-N 0.000 description 1
- 108010079364 N-glycylalanine Proteins 0.000 description 1
- 241000167284 Natranaerobius Species 0.000 description 1
- 241000588653 Neisseria Species 0.000 description 1
- 241000588654 Neisseria cinerea Species 0.000 description 1
- 206010028980 Neoplasm Diseases 0.000 description 1
- 208000009869 Neu-Laxova syndrome Diseases 0.000 description 1
- 206010029260 Neuroblastoma Diseases 0.000 description 1
- 101100462611 Neurospora crassa (strain ATCC 24698 / 74-OR23-1A / CBS 708.71 / DSM 1257 / FGSC 987) prr-1 gene Proteins 0.000 description 1
- 241000192147 Nitrosococcus Species 0.000 description 1
- 241000203622 Nocardiopsis Species 0.000 description 1
- 241000059630 Nodularia <Cyanobacteria> Species 0.000 description 1
- 241000192656 Nostoc Species 0.000 description 1
- 108020004711 Nucleic Acid Probes Proteins 0.000 description 1
- TYBWABJIIOVYOR-UHFFFAOYSA-N OCC(C(O)=O)OP(=O)=O Chemical compound OCC(C(O)=O)OP(=O)=O TYBWABJIIOVYOR-UHFFFAOYSA-N 0.000 description 1
- 241000283973 Oryctolagus cuniculus Species 0.000 description 1
- 241000192497 Oscillatoria Species 0.000 description 1
- 241001494479 Pecora Species 0.000 description 1
- 241001425545 Pelotomaculum Species 0.000 description 1
- 102000002508 Peptide Elongation Factors Human genes 0.000 description 1
- 108010068204 Peptide Elongation Factors Proteins 0.000 description 1
- 241000009328 Perro Species 0.000 description 1
- 241001135648 Petrotoga Species 0.000 description 1
- UMKYAYXCMYYNHI-AVGNSLFASA-N Phe-Gln-Asn Chemical compound C1=CC=C(C=C1)C[C@@H](C(=O)N[C@@H](CCC(=O)N)C(=O)N[C@@H](CC(=O)N)C(=O)O)N UMKYAYXCMYYNHI-AVGNSLFASA-N 0.000 description 1
- SMFGCTXUBWEPKM-KBPBESRZSA-N Phe-Leu-Gly Chemical compound OC(=O)CNC(=O)[C@H](CC(C)C)NC(=O)[C@@H](N)CC1=CC=CC=C1 SMFGCTXUBWEPKM-KBPBESRZSA-N 0.000 description 1
- RMKGXGPQIPLTFC-KKUMJFAQSA-N Phe-Lys-Asn Chemical compound [H]N[C@@H](CC1=CC=CC=C1)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CC(N)=O)C(O)=O RMKGXGPQIPLTFC-KKUMJFAQSA-N 0.000 description 1
- 241000512220 Polaromonas Species 0.000 description 1
- 229920002873 Polyethylenimine Polymers 0.000 description 1
- 241000605861 Prevotella Species 0.000 description 1
- 241000288906 Primates Species 0.000 description 1
- DZZCICYRSZASNF-FXQIFTODSA-N Pro-Ala-Ala Chemical compound OC(=O)[C@H](C)NC(=O)[C@H](C)NC(=O)[C@@H]1CCCN1 DZZCICYRSZASNF-FXQIFTODSA-N 0.000 description 1
- SKICPQLTOXGWGO-GARJFASQSA-N Pro-Gln-Pro Chemical compound C1C[C@H](NC1)C(=O)N[C@@H](CCC(=O)N)C(=O)N2CCC[C@@H]2C(=O)O SKICPQLTOXGWGO-GARJFASQSA-N 0.000 description 1
- FKYKZHOKDOPHSA-DCAQKATOSA-N Pro-Leu-Ser Chemical compound [H]N1CCC[C@H]1C(=O)N[C@@H](CC(C)C)C(=O)N[C@@H](CO)C(O)=O FKYKZHOKDOPHSA-DCAQKATOSA-N 0.000 description 1
- INDVYIOKMXFQFM-SRVKXCTJSA-N Pro-Lys-Gln Chemical compound C1C[C@H](NC1)C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCC(=O)N)C(=O)O INDVYIOKMXFQFM-SRVKXCTJSA-N 0.000 description 1
- DWGFLKQSGRUQTI-IHRRRGAJSA-N Pro-Lys-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@H](CCCCN)NC(=O)[C@@H]1CCCN1 DWGFLKQSGRUQTI-IHRRRGAJSA-N 0.000 description 1
- PCWLNNZTBJTZRN-AVGNSLFASA-N Pro-Pro-Lys Chemical compound NCCCC[C@@H](C(O)=O)NC(=O)[C@@H]1CCCN1C(=O)[C@H]1NCCC1 PCWLNNZTBJTZRN-AVGNSLFASA-N 0.000 description 1
- 108010043400 Protamine Kinase Proteins 0.000 description 1
- 241000519590 Pseudoalteromonas Species 0.000 description 1
- 241000709748 Pseudomonas phage PRR1 Species 0.000 description 1
- CZPWVGJYEJSRLH-UHFFFAOYSA-N Pyrimidine Chemical compound C1=CN=CN=C1 CZPWVGJYEJSRLH-UHFFFAOYSA-N 0.000 description 1
- 230000004570 RNA-binding Effects 0.000 description 1
- 241000700159 Rattus Species 0.000 description 1
- 241000700157 Rattus norvegicus Species 0.000 description 1
- 101100372762 Rattus norvegicus Flt1 gene Proteins 0.000 description 1
- 101000702488 Rattus norvegicus High affinity cationic amino acid transporter 1 Proteins 0.000 description 1
- 102100030086 Receptor tyrosine-protein kinase erbB-2 Human genes 0.000 description 1
- 102100037422 Receptor-type tyrosine-protein phosphatase C Human genes 0.000 description 1
- 201000007737 Retinal degeneration Diseases 0.000 description 1
- 108090000820 Rhodopsin Proteins 0.000 description 1
- 241000283984 Rodentia Species 0.000 description 1
- 240000004808 Saccharomyces cerevisiae Species 0.000 description 1
- 206010039491 Sarcoma Diseases 0.000 description 1
- HRNQLKCLPVKZNE-CIUDSAMLSA-N Ser-Ala-Leu Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](C)C(=O)N[C@@H](CC(C)C)C(O)=O HRNQLKCLPVKZNE-CIUDSAMLSA-N 0.000 description 1
- KYKKKSWGEPFUMR-NAKRPEOUSA-N Ser-Arg-Ile Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H](CCCNC(N)=N)C(=O)N[C@@H]([C@@H](C)CC)C(O)=O KYKKKSWGEPFUMR-NAKRPEOUSA-N 0.000 description 1
- KAAPNMOKUUPKOE-SRVKXCTJSA-N Ser-Asn-Phe Chemical compound OC[C@H](N)C(=O)N[C@@H](CC(N)=O)C(=O)N[C@H](C(O)=O)CC1=CC=CC=C1 KAAPNMOKUUPKOE-SRVKXCTJSA-N 0.000 description 1
- BQWCDDAISCPDQV-XHNCKOQMSA-N Ser-Gln-Pro Chemical compound C1C[C@@H](N(C1)C(=O)[C@H](CCC(=O)N)NC(=O)[C@H](CO)N)C(=O)O BQWCDDAISCPDQV-XHNCKOQMSA-N 0.000 description 1
- LWMQRHDTXHQQOV-MXAVVETBSA-N Ser-Ile-Phe Chemical compound [H]N[C@@H](CO)C(=O)N[C@@H]([C@@H](C)CC)C(=O)N[C@@H](CC1=CC=CC=C1)C(O)=O LWMQRHDTXHQQOV-MXAVVETBSA-N 0.000 description 1
- XUDRHBPSPAPDJP-SRVKXCTJSA-N Ser-Lys-Leu Chemical compound CC(C)C[C@@H](C(O)=O)NC(=O)[C@H](CCCCN)NC(=O)[C@@H](N)CO XUDRHBPSPAPDJP-SRVKXCTJSA-N 0.000 description 1
- 108091061750 Signal recognition particle RNA Proteins 0.000 description 1
- 241000700584 Simplexvirus Species 0.000 description 1
- 108020004682 Single-Stranded DNA Proteins 0.000 description 1
- 241000191940 Staphylococcus Species 0.000 description 1
- 241000194017 Streptococcus Species 0.000 description 1
- 241000187747 Streptomyces Species 0.000 description 1
- 241000203590 Streptosporangium Species 0.000 description 1
- 241000282887 Suidae Species 0.000 description 1
- 241000282898 Sus scrofa Species 0.000 description 1
- 102100021905 Synapsin-1 Human genes 0.000 description 1
- 241000192707 Synechococcus Species 0.000 description 1
- 210000001744 T-lymphocyte Anatomy 0.000 description 1
- 238000010459 TALEN Methods 0.000 description 1
- 206010043395 Thalassaemia sickle cell Diseases 0.000 description 1
- 241000204315 Thermosipho <sea snail> Species 0.000 description 1
- VULNJDORNLBPNG-SWRJLBSHSA-N Thr-Glu-Trp Chemical compound C[C@H]([C@@H](C(=O)N[C@@H](CCC(=O)O)C(=O)N[C@@H](CC1=CNC2=CC=CC=C21)C(=O)O)N)O VULNJDORNLBPNG-SWRJLBSHSA-N 0.000 description 1
- NQVDGKYAUHTCME-QTKMDUPCSA-N Thr-His-Arg Chemical compound C[C@H]([C@@H](C(=O)N[C@@H](CC1=CN=CN1)C(=O)N[C@@H](CCCN=C(N)N)C(=O)O)N)O NQVDGKYAUHTCME-QTKMDUPCSA-N 0.000 description 1
- BGHVVGPELPHRCI-HZTRNQAASA-N Thr-Trp-Trp Chemical compound C[C@H]([C@@H](C(=O)N[C@@H](CC1=CNC2=CC=CC=C21)C(=O)N[C@@H](CC3=CNC4=CC=CC=C43)C(=O)O)N)O BGHVVGPELPHRCI-HZTRNQAASA-N 0.000 description 1
- 102000005747 Transcription Factor RelA Human genes 0.000 description 1
- 108010031154 Transcription Factor RelA Proteins 0.000 description 1
- 102100038313 Transcription factor E2-alpha Human genes 0.000 description 1
- 102100035100 Transcription factor p65 Human genes 0.000 description 1
- 102100033763 Transducin-like enhancer protein 4 Human genes 0.000 description 1
- UJRIVCPPPMYCNA-HOCLYGCPSA-N Trp-Leu-Gly Chemical compound CC(C)C[C@@H](C(=O)NCC(=O)O)NC(=O)[C@H](CC1=CNC2=CC=CC=C21)N UJRIVCPPPMYCNA-HOCLYGCPSA-N 0.000 description 1
- UUIYFDAWNBSWPG-IHPCNDPISA-N Trp-Lys-Lys Chemical compound C1=CC=C2C(=C1)C(=CN2)C[C@@H](C(=O)N[C@@H](CCCCN)C(=O)N[C@@H](CCCCN)C(=O)O)N UUIYFDAWNBSWPG-IHPCNDPISA-N 0.000 description 1
- IYHRKILQAQWODS-VJBMBRPKSA-N Trp-Trp-Glu Chemical compound C1=CC=C2C(=C1)C(=CN2)C[C@@H](C(=O)N[C@@H](CC3=CNC4=CC=CC=C43)C(=O)N[C@@H](CCC(=O)O)C(=O)O)N IYHRKILQAQWODS-VJBMBRPKSA-N 0.000 description 1
- 102000004243 Tubulin Human genes 0.000 description 1
- 108090000704 Tubulin Proteins 0.000 description 1
- NIHNMOSRSAYZIT-BPNCWPANSA-N Tyr-Ala-Arg Chemical compound NC(=N)NCCC[C@@H](C(O)=O)NC(=O)[C@H](C)NC(=O)[C@@H](N)CC1=CC=C(O)C=C1 NIHNMOSRSAYZIT-BPNCWPANSA-N 0.000 description 1
- 102000044159 Ubiquitin Human genes 0.000 description 1
- 108090000848 Ubiquitin Proteins 0.000 description 1
- ISAKRJDGNUQOIC-UHFFFAOYSA-N Uracil Chemical group O=C1C=CNC(=O)N1 ISAKRJDGNUQOIC-UHFFFAOYSA-N 0.000 description 1
- RUCNAYOMFXRIKJ-DCAQKATOSA-N Val-Ala-Lys Chemical compound CC(C)[C@H](N)C(=O)N[C@@H](C)C(=O)N[C@H](C(O)=O)CCCCN RUCNAYOMFXRIKJ-DCAQKATOSA-N 0.000 description 1
- VLOYGOZDPGYWFO-LAEOZQHASA-N Val-Asp-Glu Chemical compound CC(C)[C@H](N)C(=O)N[C@@H](CC(O)=O)C(=O)N[C@@H](CCC(O)=O)C(O)=O VLOYGOZDPGYWFO-LAEOZQHASA-N 0.000 description 1
- QHDXUYOYTPWCSK-RCOVLWMOSA-N Val-Asp-Gly Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CC(=O)O)C(=O)NCC(=O)O)N QHDXUYOYTPWCSK-RCOVLWMOSA-N 0.000 description 1
- AJNUKMZFHXUBMK-GUBZILKMSA-N Val-Ser-Arg Chemical compound CC(C)[C@@H](C(=O)N[C@@H](CO)C(=O)N[C@@H](CCCN=C(N)N)C(=O)O)N AJNUKMZFHXUBMK-GUBZILKMSA-N 0.000 description 1
- NZYNRRGJJVSSTJ-GUBZILKMSA-N Val-Ser-Val Chemical compound CC(C)[C@H](N)C(=O)N[C@@H](CO)C(=O)N[C@@H](C(C)C)C(O)=O NZYNRRGJJVSSTJ-GUBZILKMSA-N 0.000 description 1
- 241000545067 Venus Species 0.000 description 1
- 241001261005 Verrucomicrobia Species 0.000 description 1
- 241000251539 Vertebrata <Metazoa> Species 0.000 description 1
- 241000589634 Xanthomonas Species 0.000 description 1
- 208000020329 Zika virus infectious disease Diseases 0.000 description 1
- JLCPHMBAVCMARE-UHFFFAOYSA-N [3-[[3-[[3-[[3-[[3-[[3-[[3-[[3-[[3-[[3-[[3-[[5-(2-amino-6-oxo-1H-purin-9-yl)-3-[[3-[[3-[[3-[[3-[[3-[[5-(2-amino-6-oxo-1H-purin-9-yl)-3-[[5-(2-amino-6-oxo-1H-purin-9-yl)-3-hydroxyoxolan-2-yl]methoxy-hydroxyphosphoryl]oxyoxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(5-methyl-2,4-dioxopyrimidin-1-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(6-aminopurin-9-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(6-aminopurin-9-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(6-aminopurin-9-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(6-aminopurin-9-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxyoxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(5-methyl-2,4-dioxopyrimidin-1-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(4-amino-2-oxopyrimidin-1-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(5-methyl-2,4-dioxopyrimidin-1-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(5-methyl-2,4-dioxopyrimidin-1-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(6-aminopurin-9-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(6-aminopurin-9-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(4-amino-2-oxopyrimidin-1-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(4-amino-2-oxopyrimidin-1-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(4-amino-2-oxopyrimidin-1-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(6-aminopurin-9-yl)oxolan-2-yl]methoxy-hydroxyphosphoryl]oxy-5-(4-amino-2-oxopyrimidin-1-yl)oxolan-2-yl]methyl [5-(6-aminopurin-9-yl)-2-(hydroxymethyl)oxolan-3-yl] hydrogen phosphate Polymers Cc1cn(C2CC(OP(O)(=O)OCC3OC(CC3OP(O)(=O)OCC3OC(CC3O)n3cnc4c3nc(N)[nH]c4=O)n3cnc4c3nc(N)[nH]c4=O)C(COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3COP(O)(=O)OC3CC(OC3CO)n3cnc4c(N)ncnc34)n3ccc(N)nc3=O)n3cnc4c(N)ncnc34)n3ccc(N)nc3=O)n3ccc(N)nc3=O)n3ccc(N)nc3=O)n3cnc4c(N)ncnc34)n3cnc4c(N)ncnc34)n3cc(C)c(=O)[nH]c3=O)n3cc(C)c(=O)[nH]c3=O)n3ccc(N)nc3=O)n3cc(C)c(=O)[nH]c3=O)n3cnc4c3nc(N)[nH]c4=O)n3cnc4c(N)ncnc34)n3cnc4c(N)ncnc34)n3cnc4c(N)ncnc34)n3cnc4c(N)ncnc34)O2)c(=O)[nH]c1=O JLCPHMBAVCMARE-UHFFFAOYSA-N 0.000 description 1
- 125000002777 acetyl group Chemical group [H]C([H])([H])C(*)=O 0.000 description 1
- 239000002253 acid Substances 0.000 description 1
- 150000007513 acids Chemical class 0.000 description 1
- 229960005305 adenosine Drugs 0.000 description 1
- 210000004504 adult stem cell Anatomy 0.000 description 1
- 230000003679 aging effect Effects 0.000 description 1
- 108010005233 alanylglutamic acid Proteins 0.000 description 1
- 108010087924 alanylproline Proteins 0.000 description 1
- 125000003277 amino group Chemical group 0.000 description 1
- 239000003242 anti bacterial agent Substances 0.000 description 1
- 229940088710 antibiotic agent Drugs 0.000 description 1
- 101150010487 are gene Proteins 0.000 description 1
- 108010013835 arginine glutamate Proteins 0.000 description 1
- 108010008355 arginyl-glutamine Proteins 0.000 description 1
- 108010060035 arginylproline Proteins 0.000 description 1
- 238000003491 array Methods 0.000 description 1
- 125000004429 atom Chemical group 0.000 description 1
- 230000004888 barrier function Effects 0.000 description 1
- 230000008901 benefit Effects 0.000 description 1
- IQFYYKKMVGJFEH-UHFFFAOYSA-N beta-L-thymidine Natural products O=C1NC(=O)C(C)=CN1C1OC(CO)C(O)C1 IQFYYKKMVGJFEH-UHFFFAOYSA-N 0.000 description 1
- DRTQHJPVMGBUCF-PSQAKQOGSA-N beta-L-uridine Natural products O[C@H]1[C@@H](O)[C@H](CO)O[C@@H]1N1C(=O)NC(=O)C=C1 DRTQHJPVMGBUCF-PSQAKQOGSA-N 0.000 description 1
- 230000033228 biological regulation Effects 0.000 description 1
- 230000015572 biosynthetic process Effects 0.000 description 1
- 108091005948 blue fluorescent proteins Proteins 0.000 description 1
- 239000000872 buffer Substances 0.000 description 1
- 229910000389 calcium phosphate Inorganic materials 0.000 description 1
- 239000001506 calcium phosphate Substances 0.000 description 1
- 235000011010 calcium phosphates Nutrition 0.000 description 1
- 201000011510 cancer Diseases 0.000 description 1
- 125000002680 canonical nucleotide group Chemical group 0.000 description 1
- 229910052799 carbon Inorganic materials 0.000 description 1
- 125000004432 carbon atom Chemical group C* 0.000 description 1
- 125000003178 carboxy group Chemical group [H]OC(*)=O 0.000 description 1
- 125000002057 carboxymethyl group Chemical group [H]OC(=O)C([H])([H])[*] 0.000 description 1
- 125000002091 cationic group Chemical group 0.000 description 1
- 229920006317 cationic polymer Polymers 0.000 description 1
- 238000004113 cell culture Methods 0.000 description 1
- 230000010261 cell growth Effects 0.000 description 1
- 108091092356 cellular DNA Proteins 0.000 description 1
- 230000033077 cellular process Effects 0.000 description 1
- 208000019065 cervical carcinoma Diseases 0.000 description 1
- 210000000349 chromosome Anatomy 0.000 description 1
- 239000011035 citrine Substances 0.000 description 1
- 238000004891 communication Methods 0.000 description 1
- 239000002299 complementary DNA Substances 0.000 description 1
- 230000000536 complexating effect Effects 0.000 description 1
- 150000001875 compounds Chemical class 0.000 description 1
- 238000007596 consolidation process Methods 0.000 description 1
- 238000010276 construction Methods 0.000 description 1
- 244000038559 crop plants Species 0.000 description 1
- 238000012258 culturing Methods 0.000 description 1
- 108010082025 cyan fluorescent protein Proteins 0.000 description 1
- 125000004122 cyclic group Chemical group 0.000 description 1
- UHDGCWIWMRVCDJ-ZAKLUEHWSA-N cytidine Chemical compound O=C1N=C(N)C=CN1[C@H]1[C@H](O)[C@@H](O)[C@H](CO)O1 UHDGCWIWMRVCDJ-ZAKLUEHWSA-N 0.000 description 1
- 210000000805 cytoplasm Anatomy 0.000 description 1
- 230000003247 decreasing effect Effects 0.000 description 1
- 230000017858 demethylation Effects 0.000 description 1
- 238000010520 demethylation reaction Methods 0.000 description 1
- 239000000412 dendrimer Substances 0.000 description 1
- 229920000736 dendritic polymer Polymers 0.000 description 1
- 210000005045 desmin Anatomy 0.000 description 1
- 230000010460 detection of virus Effects 0.000 description 1
- 238000011161 development Methods 0.000 description 1
- 230000018109 developmental process Effects 0.000 description 1
- 239000005546 dideoxynucleotide Substances 0.000 description 1
- 239000000539 dimer Substances 0.000 description 1
- 239000003814 drug Substances 0.000 description 1
- 239000000975 dye Substances 0.000 description 1
- 230000001094 effect on targets Effects 0.000 description 1
- 238000004520 electroporation Methods 0.000 description 1
- 230000008030 elimination Effects 0.000 description 1
- 238000003379 elimination reaction Methods 0.000 description 1
- 239000010976 emerald Substances 0.000 description 1
- 229910052876 emerald Inorganic materials 0.000 description 1
- 238000005516 engineering process Methods 0.000 description 1
- 230000002708 enhancing effect Effects 0.000 description 1
- 230000006353 environmental stress Effects 0.000 description 1
- 102000052116 epidermal growth factor receptor activity proteins Human genes 0.000 description 1
- 108700015053 epidermal growth factor receptor activity proteins Proteins 0.000 description 1
- 102000013165 exonuclease Human genes 0.000 description 1
- 238000002474 experimental method Methods 0.000 description 1
- 239000013604 expression vector Substances 0.000 description 1
- 210000000604 fetal stem cell Anatomy 0.000 description 1
- 239000000835 fiber Substances 0.000 description 1
- 229940012952 fibrinogen Drugs 0.000 description 1
- 239000007850 fluorescent dye Substances 0.000 description 1
- 239000012634 fragment Substances 0.000 description 1
- 238000003198 gene knock in Methods 0.000 description 1
- 238000003209 gene knockout Methods 0.000 description 1
- 238000001415 gene therapy Methods 0.000 description 1
- 210000005046 glial fibrillary acidic protein Anatomy 0.000 description 1
- 208000005017 glioblastoma Diseases 0.000 description 1
- 102000018146 globin Human genes 0.000 description 1
- 108060003196 globin Proteins 0.000 description 1
- 108010078144 glutaminyl-glycine Proteins 0.000 description 1
- 108010049041 glutamylalanine Proteins 0.000 description 1
- 108010062266 glycyl-glycyl-argininal Proteins 0.000 description 1
- 108010010147 glycylglutamine Proteins 0.000 description 1
- 239000001963 growth medium Substances 0.000 description 1
- 229940029575 guanosine Drugs 0.000 description 1
- 208000006454 hepatitis Diseases 0.000 description 1
- 231100000283 hepatitis Toxicity 0.000 description 1
- 210000004458 heterochromatin Anatomy 0.000 description 1
- 230000006801 homologous recombination Effects 0.000 description 1
- 238000002744 homologous recombination Methods 0.000 description 1
- 125000002887 hydroxy group Chemical group [H]O* 0.000 description 1
- 208000026278 immune system disease Diseases 0.000 description 1
- 102000018358 immunoglobulin Human genes 0.000 description 1
- 238000000530 impalefection Methods 0.000 description 1
- 230000000977 initiatory effect Effects 0.000 description 1
- 229960003786 inosine Drugs 0.000 description 1
- 239000012212 insulator Substances 0.000 description 1
- 230000003834 intracellular effect Effects 0.000 description 1
- 238000005304 joining Methods 0.000 description 1
- 229940039696 lactobacillus Drugs 0.000 description 1
- 108010034529 leucyl-lysine Proteins 0.000 description 1
- 150000002632 lipids Chemical class 0.000 description 1
- 238000001638 lipofection Methods 0.000 description 1
- 210000004185 liver Anatomy 0.000 description 1
- 210000005229 liver cell Anatomy 0.000 description 1
- 230000033001 locomotion Effects 0.000 description 1
- 210000005265 lung cell Anatomy 0.000 description 1
- 108010003700 lysyl aspartic acid Proteins 0.000 description 1
- 108010043322 lysyl-tryptophyl-alpha-lysine Proteins 0.000 description 1
- 108091005949 mKalama1 Proteins 0.000 description 1
- 210000002540 macrophage Anatomy 0.000 description 1
- 229910052751 metal Inorganic materials 0.000 description 1
- 239000002184 metal Substances 0.000 description 1
- 150000002739 metals Chemical class 0.000 description 1
- 125000002496 methyl group Chemical group [H]C([H])([H])* 0.000 description 1
- 230000011987 methylation Effects 0.000 description 1
- 238000007069 methylation reaction Methods 0.000 description 1
- 238000000520 microinjection Methods 0.000 description 1
- 210000001616 monocyte Anatomy 0.000 description 1
- 125000004573 morpholin-4-yl group Chemical group N1(CCOCC1)* 0.000 description 1
- 210000003098 myoblast Anatomy 0.000 description 1
- 230000002107 myocardial effect Effects 0.000 description 1
- YOHYSYJDKVYCJI-UHFFFAOYSA-N n-[3-[[6-[3-(trifluoromethyl)anilino]pyrimidin-4-yl]amino]phenyl]cyclopropanecarboxamide Chemical compound FC(F)(F)C1=CC=CC(NC=2N=CN=C(NC=3C=C(NC(=O)C4CC4)C=CC=3)C=2)=C1 YOHYSYJDKVYCJI-UHFFFAOYSA-N 0.000 description 1
- 125000004433 nitrogen atom Chemical group N* 0.000 description 1
- 239000002853 nucleic acid probe Substances 0.000 description 1
- 238000001821 nucleic acid purification Methods 0.000 description 1
- 210000004940 nucleus Anatomy 0.000 description 1
- 210000001672 ovary Anatomy 0.000 description 1
- 239000005022 packaging material Substances 0.000 description 1
- 238000004806 packaging method and process Methods 0.000 description 1
- 108010091617 pentalysine Proteins 0.000 description 1
- 108010074082 phenylalanyl-alanyl-lysine Proteins 0.000 description 1
- 108010070409 phenylalanyl-glycyl-glycine Proteins 0.000 description 1
- 108010051242 phenylalanylserine Proteins 0.000 description 1
- 125000002467 phosphate group Chemical group [H]OP(=O)(O[H])O[*] 0.000 description 1
- 150000008300 phosphoramidites Chemical class 0.000 description 1
- 230000026731 phosphorylation Effects 0.000 description 1
- 238000006366 phosphorylation reaction Methods 0.000 description 1
- 244000000003 plant pathogen Species 0.000 description 1
- 125000002924 primary amino group Chemical group [H]N([H])* 0.000 description 1
- 210000002307 prostate Anatomy 0.000 description 1
- 238000000159 protein binding assay Methods 0.000 description 1
- 108091011138 protein binding proteins Proteins 0.000 description 1
- 239000012474 protein marker Substances 0.000 description 1
- 230000020978 protein processing Effects 0.000 description 1
- 238000001742 protein purification Methods 0.000 description 1
- 230000004850 protein–protein interaction Effects 0.000 description 1
- 238000010384 proximity ligation assay Methods 0.000 description 1
- 150000003212 purines Chemical class 0.000 description 1
- 230000001172 regenerating effect Effects 0.000 description 1
- 125000000548 ribosyl group Chemical group C1([C@H](O)[C@H](O)[C@H](O1)CO)* 0.000 description 1
- 108010026333 seryl-proline Proteins 0.000 description 1
- 230000003007 single stranded DNA break Effects 0.000 description 1
- 238000010532 solid phase synthesis reaction Methods 0.000 description 1
- 150000003431 steroids Chemical class 0.000 description 1
- 238000003860 storage Methods 0.000 description 1
- 230000002195 synergetic effect Effects 0.000 description 1
- 238000003786 synthesis reaction Methods 0.000 description 1
- 230000001225 therapeutic effect Effects 0.000 description 1
- 125000003396 thiol group Chemical group [H]S* 0.000 description 1
- RYYWUUFWQRZTIU-UHFFFAOYSA-K thiophosphate Chemical group [O-]P([O-])([O-])=S RYYWUUFWQRZTIU-UHFFFAOYSA-K 0.000 description 1
- 108010072986 threonyl-seryl-lysine Proteins 0.000 description 1
- 229940104230 thymidine Drugs 0.000 description 1
- 108091006106 transcriptional activators Proteins 0.000 description 1
- 238000010361 transduction Methods 0.000 description 1
- 230000026683 transduction Effects 0.000 description 1
- 239000012096 transfection reagent Substances 0.000 description 1
- 230000009466 transformation Effects 0.000 description 1
- 230000009261 transgenic effect Effects 0.000 description 1
- QORWJWZARLRLPR-UHFFFAOYSA-H tricalcium bis(phosphate) Chemical compound [Ca+2].[Ca+2].[Ca+2].[O-]P([O-])([O-])=O.[O-]P([O-])([O-])=O QORWJWZARLRLPR-UHFFFAOYSA-H 0.000 description 1
- GWBUNZLLLLDXMD-UHFFFAOYSA-H tricopper;dicarbonate;dihydroxide Chemical compound [OH-].[OH-].[Cu+2].[Cu+2].[Cu+2].[O-]C([O-])=O.[O-]C([O-])=O GWBUNZLLLLDXMD-UHFFFAOYSA-H 0.000 description 1
- 108010017949 tyrosyl-glycyl-glycine Proteins 0.000 description 1
- 108010078580 tyrosylleucine Proteins 0.000 description 1
- DRTQHJPVMGBUCF-UHFFFAOYSA-N uracil arabinoside Natural products OC1C(O)C(CO)OC1N1C(=O)NC(=O)C=C1 DRTQHJPVMGBUCF-UHFFFAOYSA-N 0.000 description 1
- 229940045145 uridine Drugs 0.000 description 1
- 108010073969 valyllysine Proteins 0.000 description 1
- 210000002845 virion Anatomy 0.000 description 1
- 230000003612 virological effect Effects 0.000 description 1
- 239000000277 virosome Substances 0.000 description 1
- 108010000998 wheylin-2 peptide Proteins 0.000 description 1
- 238000002689 xenotransplantation Methods 0.000 description 1
- 210000005253 yeast cell Anatomy 0.000 description 1
Images
Classifications
-
- A—HUMAN NECESSITIES
- A61—MEDICAL OR VETERINARY SCIENCE; HYGIENE
- A61K—PREPARATIONS FOR MEDICAL, DENTAL OR TOILETRY PURPOSES
- A61K48/00—Medicinal preparations containing genetic material which is inserted into cells of the living body to treat genetic diseases; Gene therapy
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N15/00—Mutation or genetic engineering; DNA or RNA concerning genetic engineering, vectors, e.g. plasmids, or their isolation, preparation or purification; Use of hosts therefor
- C12N15/09—Recombinant DNA-technology
- C12N15/10—Processes for the isolation, preparation or purification of DNA or RNA
- C12N15/102—Mutagenizing nucleic acids
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N15/00—Mutation or genetic engineering; DNA or RNA concerning genetic engineering, vectors, e.g. plasmids, or their isolation, preparation or purification; Use of hosts therefor
- C12N15/09—Recombinant DNA-technology
- C12N15/87—Introduction of foreign genetic material using processes not otherwise provided for, e.g. co-transformation
- C12N15/90—Stable introduction of foreign DNA into chromosome
- C12N15/902—Stable introduction of foreign DNA into chromosome using homologous recombination
- C12N15/907—Stable introduction of foreign DNA into chromosome using homologous recombination in mammalian cells
-
- A—HUMAN NECESSITIES
- A61—MEDICAL OR VETERINARY SCIENCE; HYGIENE
- A61P—SPECIFIC THERAPEUTIC ACTIVITY OF CHEMICAL COMPOUNDS OR MEDICINAL PREPARATIONS
- A61P25/00—Drugs for disorders of the nervous system
- A61P25/14—Drugs for disorders of the nervous system for treating abnormal movements, e.g. chorea, dyskinesia
-
- A—HUMAN NECESSITIES
- A61—MEDICAL OR VETERINARY SCIENCE; HYGIENE
- A61P—SPECIFIC THERAPEUTIC ACTIVITY OF CHEMICAL COMPOUNDS OR MEDICINAL PREPARATIONS
- A61P27/00—Drugs for disorders of the senses
- A61P27/02—Ophthalmic agents
-
- A—HUMAN NECESSITIES
- A61—MEDICAL OR VETERINARY SCIENCE; HYGIENE
- A61P—SPECIFIC THERAPEUTIC ACTIVITY OF CHEMICAL COMPOUNDS OR MEDICINAL PREPARATIONS
- A61P37/00—Drugs for immunological or allergic disorders
- A61P37/02—Immunomodulators
- A61P37/04—Immunostimulants
-
- A—HUMAN NECESSITIES
- A61—MEDICAL OR VETERINARY SCIENCE; HYGIENE
- A61P—SPECIFIC THERAPEUTIC ACTIVITY OF CHEMICAL COMPOUNDS OR MEDICINAL PREPARATIONS
- A61P7/00—Drugs for disorders of the blood or the extracellular fluid
- A61P7/06—Antianaemics
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N15/00—Mutation or genetic engineering; DNA or RNA concerning genetic engineering, vectors, e.g. plasmids, or their isolation, preparation or purification; Use of hosts therefor
- C12N15/09—Recombinant DNA-technology
- C12N15/10—Processes for the isolation, preparation or purification of DNA or RNA
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N15/00—Mutation or genetic engineering; DNA or RNA concerning genetic engineering, vectors, e.g. plasmids, or their isolation, preparation or purification; Use of hosts therefor
- C12N15/09—Recombinant DNA-technology
- C12N15/11—DNA or RNA fragments; Modified forms thereof; Non-coding nucleic acids having a biological activity
- C12N15/113—Non-coding nucleic acids modulating the expression of genes, e.g. antisense oligonucleotides; Antisense DNA or RNA; Triplex- forming oligonucleotides; Catalytic nucleic acids, e.g. ribozymes; Nucleic acids used in co-suppression or gene silencing
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N15/00—Mutation or genetic engineering; DNA or RNA concerning genetic engineering, vectors, e.g. plasmids, or their isolation, preparation or purification; Use of hosts therefor
- C12N15/09—Recombinant DNA-technology
- C12N15/11—DNA or RNA fragments; Modified forms thereof; Non-coding nucleic acids having a biological activity
- C12N15/62—DNA sequences coding for fusion proteins
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N9/00—Enzymes; Proenzymes; Compositions thereof; Processes for preparing, activating, inhibiting, separating or purifying enzymes
- C12N9/10—Transferases (2.)
- C12N9/1025—Acyltransferases (2.3)
- C12N9/1029—Acyltransferases (2.3) transferring groups other than amino-acyl groups (2.3.1)
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N9/00—Enzymes; Proenzymes; Compositions thereof; Processes for preparing, activating, inhibiting, separating or purifying enzymes
- C12N9/14—Hydrolases (3)
- C12N9/16—Hydrolases (3) acting on ester bonds (3.1)
- C12N9/22—Ribonucleases RNAses, DNAses
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N9/00—Enzymes; Proenzymes; Compositions thereof; Processes for preparing, activating, inhibiting, separating or purifying enzymes
- C12N9/14—Hydrolases (3)
- C12N9/78—Hydrolases (3) acting on carbon to nitrogen bonds other than peptide bonds (3.5)
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N2310/00—Structure or type of the nucleic acid
- C12N2310/10—Type of nucleic acid
- C12N2310/20—Type of nucleic acid involving clustered regularly interspaced short palindromic repeats [CRISPRs]
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N2320/00—Applications; Uses
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12N—MICROORGANISMS OR ENZYMES; COMPOSITIONS THEREOF; PROPAGATING, PRESERVING, OR MAINTAINING MICROORGANISMS; MUTATION OR GENETIC ENGINEERING; CULTURE MEDIA
- C12N2320/00—Applications; Uses
- C12N2320/30—Special therapeutic applications
- C12N2320/32—Special delivery means, e.g. tissue-specific
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12Y—ENZYMES
- C12Y203/00—Acyltransferases (2.3)
- C12Y203/01—Acyltransferases (2.3) transferring groups other than amino-acyl groups (2.3.1)
- C12Y203/01048—Histone acetyltransferase (2.3.1.48)
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12Y—ENZYMES
- C12Y301/00—Hydrolases acting on ester bonds (3.1)
-
- C—CHEMISTRY; METALLURGY
- C12—BIOCHEMISTRY; BEER; SPIRITS; WINE; VINEGAR; MICROBIOLOGY; ENZYMOLOGY; MUTATION OR GENETIC ENGINEERING
- C12Y—ENZYMES
- C12Y305/00—Hydrolases acting on carbon-nitrogen bonds, other than peptide bonds (3.5)
- C12Y305/04—Hydrolases acting on carbon-nitrogen bonds, other than peptide bonds (3.5) in cyclic amidines (3.5.4)
- C12Y305/04001—Cytosine deaminase (3.5.4.1)
Landscapes
- Health & Medical Sciences (AREA)
- Life Sciences & Earth Sciences (AREA)
- Genetics & Genomics (AREA)
- Engineering & Computer Science (AREA)
- Chemical & Material Sciences (AREA)
- Organic Chemistry (AREA)
- Bioinformatics & Cheminformatics (AREA)
- Wood Science & Technology (AREA)
- Zoology (AREA)
- Biomedical Technology (AREA)
- General Engineering & Computer Science (AREA)
- Biotechnology (AREA)
- Molecular Biology (AREA)
- General Health & Medical Sciences (AREA)
- Biochemistry (AREA)
- Microbiology (AREA)
- Medicinal Chemistry (AREA)
- Plant Pathology (AREA)
- Biophysics (AREA)
- Physics & Mathematics (AREA)
- Public Health (AREA)
- Veterinary Medicine (AREA)
- Pharmacology & Pharmacy (AREA)
- Animal Behavior & Ethology (AREA)
- Chemical Kinetics & Catalysis (AREA)
- General Chemical & Material Sciences (AREA)
- Nuclear Medicine, Radiotherapy & Molecular Imaging (AREA)
- Crystallography & Structural Chemistry (AREA)
- Immunology (AREA)
- Mycology (AREA)
- Cell Biology (AREA)
- Epidemiology (AREA)
- Diabetes (AREA)
- Hematology (AREA)
- Ophthalmology & Optometry (AREA)
- Neurosurgery (AREA)
- Neurology (AREA)
- Psychology (AREA)
- Enzymes And Modification Thereof (AREA)
- Peptides Or Proteins (AREA)
Abstract
표적화된 유전체 변형의 효율 및/또는 특이성을 증가시키거나 또는 진핵 세포에서 특정한 유전체 좌위의 검출을 용이하게 하기 위해, 프로그램가능 DNA 결합 단백질을 이용하기 위한 조성물 및 방법.
Description
분야
본 발명은 표적화된 유전체 변형의 효율 및/또는 특이성을 증가시키기 위한 조성물 및 방법에 관계한다.
배경
프로그램가능 엔도뉴클레아제는 진핵생물에서 표적화된 유전체 가공 또는 변형을 위한 점점 더 중요한 도구가 되고 있다. 최근에, RNA-안내된 군집된 규칙적으로 산재된 짧은 회귀성 반복 (CRISPR)/CRISPR-연관된 (Cas) (CRISPR/Cas) 시스템이 새로운 세대의 유전체 변형 도구로서 부상하였다. 이들 새로운 프로그램가능 엔도뉴클레아제는 이전 세대의 뉴클레아제, 예를 들면, 아연 핑거 뉴클레아제 (ZFNs) 및 전사 활성인자-유사 작동체 뉴클레아제 (TALENs)와 비교하여 유전체 편집 능력이 크게 향상되었다.
하지만, 모든 유전체학 표적이 이들 프로그램가능 엔도뉴클레아제에 의한 효율적인 변형을 위한 접근을 허용하는 것은 아니다. 실제로, 일부 CRISPR-Cas 엔도뉴클레아제는 인간 세포에서 활성이 거의 또는 전혀 없는 것처럼 보인다. 그 중에서도 특히, 염색질 구조는 이들 프로그램가능 엔도뉴클레아제에 대한 장벽이 되고 이들이 표적 서열에 결합하는 것을 방해할 수 있다. 따라서, 표적 서열에 대한 이들 프로그램가능 엔도뉴클레아제의 접근성을 향상시키고 및/또는 표적화된 유전체 변형의 효율을 향상시키는 것이 요구된다. 게다가, 부정확한 효과를 감소시킴으로써, 표적화된 유전체 변형에 대한 특이성을 증가시키는 것이 요구된다.
요약
본 발명의 다양한 양상 중에는 (a) 프로그램가능 DNA 변형 단백질 또는 상기 프로그램가능 DNA 변형 단백질을 인코딩하는 핵산 및 (b) 최소한 하나의 프로그램가능 DNA 결합 단백질 또는 상기 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산을 포함하는 조성물이 있다. 일반적으로, 프로그램가능 DNA 변형 단백질은 뉴클레아제 활성 (다시 말하면, 이중 가닥 서열의 양쪽 가닥을 개열한다) 또는 비-뉴클레아제 활성 (가령, 후성 변형 활성 또는 전사 조절 활성)을 갖고, 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질은 뉴클레아제 활성을 결여한다.
프로그램가능 DNA 변형 단백질이 뉴클레아제 활성을 갖는 구체예에서, 예로서, 상기 프로그램가능 DNA 변형 단백질은 RNA-안내된 군집된 규칙적으로 산재된 짧은 회귀성 반복 (CRISPR)/CRISPR-연관된 (Cas) (CRISPR/Cas) 뉴클레아제 시스템, CRISPR/Cas 이중 틈내기효소 시스템, 아연 핑거 뉴클레아제 (ZFN), 전사 활성인자-유사 작동체 뉴클레아제 (TALEN), 메가뉴클레아제, 뉴클레아제 도메인에 연결된 프로그램가능 DNA 결합 도메인을 포함하는 융합 단백질 (다시 말하면, 이중 가닥 DNA 절단을 산출한다), 그리고 이들의 조합에서 선택될 수 있다.
프로그램가능 DNA 변형 단백질이 비-뉴클레아제 활성을 갖는 구체예에서, 예로서, 상기 프로그램가능 DNA 변형 단백질은 비-뉴클레아제 변형 도메인에 연결된 프로그램가능 DNA 결합 도메인을 포함하는 융합 단백질 일 수 있다. 일정한 구체예에서, 융합 단백질의 프로그램가능 DNA 결합 도메인은 촉매적으로 비활성 CRISPR/Cas 시스템, 촉매적으로 비활성 메가뉴클레아제, 아연 핑거 단백질, 또는 전사 활성인자-유사 작동체일 수 있고, 그리고 융합 단백질의 비-뉴클레아제 변형 도메인은 아세틸전달효소 활성, 탈아세틸화효소 활성, 메틸전달효소 활성, 탈메틸효소 활성, 키나아제 활성, 포스파타아제 활성, 유비퀴틴 리가아제 활성, 탈유비퀴틴화 활성, 아데닐화 활성, 탈아데닐화 활성, 수모화 활성, 탈수모화 활성, 리보실화 활성, 탈리보실화 활성, 미리스토일화 활성, 탈미리스토일화 활성, 시트룰린화 활성, 헬리카아제 활성, 아미노화 활성, 탈아미노화 활성, 알킬화 활성, 탈알킬화 활성, 산화 활성, 전사 활성화 활성, 또는 전사 억제인자 활성을 가질 수 있다. 특정한 구체예에서, 융합 단백질의 비-뉴클레아제 변형 도메인은 시토신 탈아미노효소 활성, 히스톤 아세틸전달효소 활성, 전사 활성화 활성, 또는 전사 억제인자 활성을 갖는다.
본원에서 개시된 조성물의 일정한 구체예에 따라서, 최소한 하나의 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 시스템, 촉매적으로 비활성 메가뉴클레아제, 아연 핑거 단백질, 전사 활성인자-유사 작동체, CRISPR/Cas 틈내기효소, ZFN 틈내기효소, TALEN 틈내기효소, 또는 메가뉴클레아제 틈내기효소일 수 있다.
일반적으로, 프로그램가능 DNA 변형 단백질 및/또는 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산은 mRNA 또는 DNA이다. 일부 구체예에서, 프로그램가능 DNA 변형 단백질 및/또는 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산은 벡터, 예를 들면, 예로서, 플라스미드 벡터, 렌티바이러스 벡터, 아데노 연관된 바이러스 벡터, 또는 아데노바이러스 벡터의 일부이다.
특정한 구체예에서, 프로그램가능 DNA 변형 단백질은 CRISPR/Cas 뉴클레아제 시스템, CRISPR/Cas 이중 틈내기효소 시스템, 또는 비-뉴클레아제 도메인에 연결된 촉매적으로 비활성 CRISPR/Cas 시스템을 포함하고, 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 시스템을 포함하고, 여기서 각 CRISPR/Cas 시스템은 CRISPR/Cas 단백질 및 안내 RNA를 포함한다. 다양한 구체예에서, 각 CRISPR/Cas 뉴클레아제 시스템은 I형 CRISPR/Cas 시스템, II형 CRISPR/Cas 시스템, III형 CRISPR/Cas 시스템, 또는 V형 CRISPR/Cas 시스템일 수 있다. 일부 구체예에서, 각 안내 RNA는 최소한 부분적으로, 화학적으로 합성될 수 있다. 다른 구체예에서, 각 안내 RNA는 효소적으로 합성될 수 있다. 추가 구체예에서, 각 CRISPR/Cas 단백질을 인코딩하는 핵산은 mRNA일 수 있고, 그리고 각 안내 RNA를 인코딩하는 핵산은 DNA일 수 있다. 또 다른 구체예에서, 각 CRISPR/Cas 단백질을 인코딩하는 핵산은 mRNA일 수 있고, 그리고 각 안내 RNA를 인코딩하는 핵산은 DNA일 수 있다. 일정한 양상에서, CRISPR/Cas 단백질을 인코딩하는 핵산 및/또는 안내 RNA를 인코딩하는 핵산은 벡터, 예를 들면, 플라스미드 벡터, 렌티바이러스 벡터, 아데노 연관된 바이러스 벡터, 또는 아데노바이러스 벡터의 부분일 수 있다.
본 발명의 다른 양상은 상기 상술된 조성물 중에서 한 가지 또는 그 이상을 포함하는 키트를 포괄한다.
본 발명의 또 다른 양상은 진핵 세포에서 표적화된 유전체 변형 효율 및/또는 특이성을 증가시키기 위한 방법을 제공한다. 이들 방법은 (a) 프로그램가능 DNA 변형 단백질 또는 상기 프로그램가능 DNA 변형 단백질을 인코딩하는 핵산 및 (b) 최소한 하나의 프로그램가능 DNA 결합 단백질 또는 상기 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산을 진핵 세포 내로 도입하는 것을 수반한다. 프로그램가능 DNA 변형 단백질은 표적 염색체 서열에 표적화되고, 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질 각각은 표적 염색체 서열의 근위 부위에 표적화된다. 표적 염색체 서열의 근위 부위에 최소한 하나의 프로그램가능 DNA 결합 단백질의 결합은 표적 염색체 서열에 대한 프로그램가능 DNA 변형 단백질의 접근성을 증가시키고, 따라서 표적화된 유전체 변형 효율 및/또는 특이성을 증가시킨다. 최소한 하나의 프로그램가능 DNA 결합 단백질 각각에 의해 결합된 근위 부위는 예로서, 표적 염색체 서열의 어느 한쪽 측면 상에 약 250개 염기쌍 이내에 위치된다. 일부 구체예에서, 근위 결합 부위(들)는 표적 염색체 서열의 어느 한쪽 측면 상에 약 200 bp 이내에 또는 약 100 bp 이내에 위치된다.
상기 방법에서 이용되는 프로그램가능 DNA 변형 단백질은 CRISPR/Cas 뉴클레아제 시스템, CRISPR/Cas 이중 틈내기효소 시스템, 아연 핑거 뉴클레아제 (ZFN), 전사 활성인자-유사 작동체 뉴클레아제 (TALEN), 메가뉴클레아제, 뉴클레아제 도메인에 연결된 프로그램가능 DNA 결합 도메인을 포함하는 융합 단백질, 또는 비-뉴클레아제 도메인에 연결된 프로그램가능 DNA 결합 도메인을 포함하는 융합 단백질일 수 있다. 융합 단백질의 프로그램가능 DNA 결합 도메인은 촉매적으로 비활성 CRISPR/Cas 시스템, 촉매적으로 비활성 메가뉴클레아제, 아연 핑거 단백질, 또는 전사 활성인자-유사 작동체일 수 있고, 그리고 융합 단백질의 비-뉴클레아제 변형 도메인은 아세틸전달효소 활성, 탈아세틸화효소 활성, 메틸전달효소 활성, 탈메틸효소 활성, 키나아제 활성, 포스파타아제 활성, 유비퀴틴 리가아제 활성, 탈유비퀴틴화 활성, 아데닐화 활성, 탈아데닐화 활성, 수모화 활성, 탈수모화 활성, 리보실화 활성, 탈리보실화 활성, 미리스토일화 활성, 탈미리스토일화 활성, 시트룰린화 활성, 헬리카아제 활성, 아미노화 활성, 탈아미노화 활성, 알킬화 활성, 탈알킬화 활성, 산화 활성, 전사 활성화 활성, 또는 전사 억제인자 활성을 가질 수 있다. 특정한 구체예에서, 융합 단백질의 비-뉴클레아제 변형 도메인은 시토신 탈아미노효소 활성, 히스톤 아세틸전달효소 활성, 전사 활성화 활성, 또는 전사 억제인자 활성을 갖는다.
상기 방법에서 이용되는 최소한 하나의 프로그램가능 DNA 결합 단백질은 DNA에 결합하지만 뉴클레아제 활성 (다시 말하면, 이중 가닥 개열 활성)을 결여한다. 일정한 구체예에서, 최소한 하나의 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 시스템, 촉매적으로 비활성 메가뉴클레아제, 아연 핑거 단백질, 전사 활성인자-유사 작동체, CRISPR/Cas 틈내기효소, ZFN 틈내기효소, TALEN 틈내기효소, 또는 메가뉴클레아제 틈내기효소일 수 있다.
특정한 구체예에서, 프로그램가능 DNA 변형 단백질은 CRISPR/Cas 뉴클레아제 시스템, CRISPR/Cas 이중 틈내기효소 시스템, 또는 비-뉴클레아제 도메인에 연결된 촉매적으로 비활성 CRISPR/Cas 시스템을 포함하고, 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 시스템을 포함하고, 여기서 각 CRISPR/Cas 시스템은 CRISPR/Cas 단백질 및 안내 RNA를 포함한다.
다양한 구체예에서, 최소한 2개, 최소한 3개, 또는 3개보다 많은 프로그램가능 DNA 결합 단백질이 진핵 세포 내로 도입된다. 특정한 구체예에서, 진핵 세포는 포유류 세포, 또는 인간 세포이다.
본 발명의 추가 양상은 진핵 세포에서 염색체 서열 또는 유전체 좌위를 검출하기 위한 방법을 포괄한다. 이들 방법은 (a) 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질 또는 최소한 하나의 검출가능한 마커 도메인을 포함하는 상기 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산 및 (b) 최소한 하나의 프로그램가능 DNA 결합 단백질 또는 상기 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산을 진핵 세포 내로 도입하는 것을 수반하고, 여기서 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질은 표적 염색체 서열에 표적화되고, 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질 각각은 표적 염색체 서열의 근위 부위에 표적화되고, 여기서 표적 염색체 서열의 근위 부위에 최소한 하나의 프로그램가능 DNA 결합 단백질의 결합은 표적 염색체 서열에 대한 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질의 접근성을 증가시킨다. 이들 방법은 표적 염색체 서열에 결합된 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질을 검출하는 것을 더욱 수반할 수 있다. 검출하는 단계는 생존 세포 또는 고정된 세포에서 이루어질 수 있고, 그리고 예로서, 동적 생존 세포 영상화, 형광 현미경검사, 공초점 현미경검사, 면역형광, 면역검출, RNA-단백질 결합, 또는 단백질-단백질 결합을 수반할 수 있다.
검출 방법에서 이용되는 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질은 프로그램가능 DNA 결합 도메인을 포함하는데, 이것은 촉매적으로 비활성 CRISPR/Cas 시스템, 촉매적으로 비활성 메가뉴클레아제, 아연 핑거 단백질, 또는 전사 활성인자-유사 작동체일 수 있다. 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질의 최소한 하나의 검출가능한 마커 도메인은 예로서, 형광 단백질, 형광 태그, 에피토프 태그, 또는 프로그램가능 DNA 결합 단백질 내에 자연발생 에피토프일 수 있다. 일부 구체예에서, 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질은 비-뉴클레아제 변형을 더욱 포함할 수 있다. 최소한 하나의 프로그램가능 DNA 결합 단백질은 DNA에 결합하지만 뉴클레아제 활성 (다시 말하면, 이중 가닥 개열 활성)을 결여한다. 일부 구체예에서, 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 시스템, 촉매적으로 비활성 메가뉴클레아제, 아연 핑거 단백질, 전사 활성인자-유사 작동체, CRISPR/Cas 틈내기효소, ZFN 틈내기효소, TALEN 틈내기효소, 또는 메가뉴클레아제 틈내기효소일 수 있다. 특정한 구체예에서, 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질은 최소한 하나의 검출가능한 마커 도메인에 연결된 촉매적으로 비활성 CRISPR/Cas 시스템일 수 있고, 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 시스템일 수 있다.
본 발명의 다른 양상 및 특질은 아래에 상술된다.
도면의 간단한 설명
도면 1은 본원에서 개시된 방법의 한 구체예의 다이어그램을 제공한다. 프로그램가능 DNA 결합 단백질(들)의 근위 결합은 프로그램가능 뉴클레아제에 대한 표적 부위의 접근성을 증가시키고, 따라서 표적 부위에서 개열의 효율을 증가시킨다.
도면 2는 근위 부위(들)에 촉매적으로 비활성 SpCas9 (SpdCas9)의 결합이 FnCas9에 의한 개열의 효율을 증가시킨다는 것을 도해한다. 위쪽에서 제시된 서열은 POR 좌위 내에 FnCas9 표적 부위 및 SpdCas9의 결합 부위의 상대적 위치를 보여준다. Cel-I 뉴클레아제 검정의 결과는 아래쪽에서 도시된다.
도면 3a는 촉매적으로 비활성 SpCas9 (SpdCas9)의 결합이 POR 좌위에서 이전에 접근불가능했던 부위에 대한 에피토프-태깅된 (다시 말하면, FLAG®-태깅된) 촉매적으로 비활성 CjCas9 (CjdCas9)의 접근성 및 결합을 증가시키는 지를 결정하기 위한 실험의 설계를 도해한다.
도면 3b는 POR 및 AAVS1 좌위에서 표적 부위에 에피토프-태깅된 CjdCas9의 결합을 검출하는데 이용되는 염색질 면역침전 결합 검정의 다이어그램을 제공한다.
도면 3c는 근위 부위에 SpdCas9의 결합이 POR 좌위에서 이전에 접근불가능했던 부위에 에피토프-태깅된 CjCas9의 결합을 증가시킨다는 것을 도해한다.
도면 4는 근위 부위(들)에 촉매적으로 비활성 SpCas9 (SpdCas9)의 결합이 CjCas9에 의한 개열의 효율을 증가시킨다는 것을 도해한다. 위쪽에서 제시된 서열은 POR 좌위 내에 CjCas9 표적 부위 및 SpdCas9의 결합 부위의 상대적 위치를 보여준다. Cel-I 뉴클레아제 검정의 결과는 아래쪽에서 도시된다.
도면 5는 근위 부위(들)에 촉매적으로 비활성 SpCas9 (SpdCas9)의 결합이 FnCpf1에 의한 개열의 효율을 증가시킨다는 것을 도해한다. POR 좌위 내에 FnCpf1 표적 부위 및 SpdCas9 결합 부위의 상대적 위치는 위쪽에서 도해되고, 그리고 Cel-I 뉴클레아제 검정의 결과는 아래쪽에서 도시된다.
도면 6은 근위 부위(들)에 촉매적으로 비활성 SpCas9 (SpdCas9)의 결합이 CjCas9에 의한 특정한 개열을 증가시킨다는 것을 도해한다. HBD 및 HBB 좌위 내에 CjCas9의 표적 부위뿐만 아니라 HBB 좌위 내에 SpdCas9의 결합 부위는 위쪽에서 도시된다. Cel-I 뉴클레아제 검정의 결과는 아래쪽에서 도시된다.
도면 7은 근위 부위(들)에 촉매적으로 비활성 FnCas9 (FndCas9)의 결합이 SpCas9에 의한 특정한 개열을 증가시킨다는 것을 도해한다. POR 좌위 내에 SpCas9 표적 부위 및 FndCas9 결합 부위의 상대적 위치는 위쪽에서 표시된다. Cel-I 뉴클레아제 검정의 결과는 아래쪽에서 도시된다.
도면 8은 ssDNA 올리고-매개된 유전자 편집의 증강을 도해한다. POR 좌위 내에 표적 부위 및 ssDNA 올리고의 서열의 상대적 위치는 위쪽에서 도시된다. EcoRI 부위 표적화된 통합의 결과는 아래쪽에서 도시된다. EcoRI 부위 통합 효율 (%)은 ImageJ에 의해 결정되었다. M: 넓은-범위 DNA 마커. ND: 결정되지 않음.
도면 1은 본원에서 개시된 방법의 한 구체예의 다이어그램을 제공한다. 프로그램가능 DNA 결합 단백질(들)의 근위 결합은 프로그램가능 뉴클레아제에 대한 표적 부위의 접근성을 증가시키고, 따라서 표적 부위에서 개열의 효율을 증가시킨다.
도면 2는 근위 부위(들)에 촉매적으로 비활성 SpCas9 (SpdCas9)의 결합이 FnCas9에 의한 개열의 효율을 증가시킨다는 것을 도해한다. 위쪽에서 제시된 서열은 POR 좌위 내에 FnCas9 표적 부위 및 SpdCas9의 결합 부위의 상대적 위치를 보여준다. Cel-I 뉴클레아제 검정의 결과는 아래쪽에서 도시된다.
도면 3a는 촉매적으로 비활성 SpCas9 (SpdCas9)의 결합이 POR 좌위에서 이전에 접근불가능했던 부위에 대한 에피토프-태깅된 (다시 말하면, FLAG®-태깅된) 촉매적으로 비활성 CjCas9 (CjdCas9)의 접근성 및 결합을 증가시키는 지를 결정하기 위한 실험의 설계를 도해한다.
도면 3b는 POR 및 AAVS1 좌위에서 표적 부위에 에피토프-태깅된 CjdCas9의 결합을 검출하는데 이용되는 염색질 면역침전 결합 검정의 다이어그램을 제공한다.
도면 3c는 근위 부위에 SpdCas9의 결합이 POR 좌위에서 이전에 접근불가능했던 부위에 에피토프-태깅된 CjCas9의 결합을 증가시킨다는 것을 도해한다.
도면 4는 근위 부위(들)에 촉매적으로 비활성 SpCas9 (SpdCas9)의 결합이 CjCas9에 의한 개열의 효율을 증가시킨다는 것을 도해한다. 위쪽에서 제시된 서열은 POR 좌위 내에 CjCas9 표적 부위 및 SpdCas9의 결합 부위의 상대적 위치를 보여준다. Cel-I 뉴클레아제 검정의 결과는 아래쪽에서 도시된다.
도면 5는 근위 부위(들)에 촉매적으로 비활성 SpCas9 (SpdCas9)의 결합이 FnCpf1에 의한 개열의 효율을 증가시킨다는 것을 도해한다. POR 좌위 내에 FnCpf1 표적 부위 및 SpdCas9 결합 부위의 상대적 위치는 위쪽에서 도해되고, 그리고 Cel-I 뉴클레아제 검정의 결과는 아래쪽에서 도시된다.
도면 6은 근위 부위(들)에 촉매적으로 비활성 SpCas9 (SpdCas9)의 결합이 CjCas9에 의한 특정한 개열을 증가시킨다는 것을 도해한다. HBD 및 HBB 좌위 내에 CjCas9의 표적 부위뿐만 아니라 HBB 좌위 내에 SpdCas9의 결합 부위는 위쪽에서 도시된다. Cel-I 뉴클레아제 검정의 결과는 아래쪽에서 도시된다.
도면 7은 근위 부위(들)에 촉매적으로 비활성 FnCas9 (FndCas9)의 결합이 SpCas9에 의한 특정한 개열을 증가시킨다는 것을 도해한다. POR 좌위 내에 SpCas9 표적 부위 및 FndCas9 결합 부위의 상대적 위치는 위쪽에서 표시된다. Cel-I 뉴클레아제 검정의 결과는 아래쪽에서 도시된다.
도면 8은 ssDNA 올리고-매개된 유전자 편집의 증강을 도해한다. POR 좌위 내에 표적 부위 및 ssDNA 올리고의 서열의 상대적 위치는 위쪽에서 도시된다. EcoRI 부위 표적화된 통합의 결과는 아래쪽에서 도시된다. EcoRI 부위 통합 효율 (%)은 ImageJ에 의해 결정되었다. M: 넓은-범위 DNA 마커. ND: 결정되지 않음.
상세한 설명
본 발명은 표적화 엔도뉴클레아제 및 다른 프로그램가능 DNA 변형 단백질에 대한 염색체 DNA의 접근성을 증가시키기 위한 조성물 및 방법을 제공하는데, 여기서 증가된 접근성은 표적화된 유전체 변형 또는 후성 변형의 증가된 효율 및/또는 특이성을 야기한다. 일부 CRISPR/Cas 엔도뉴클레아제는 인간 세포에서 감소된 활성을 갖거나 또는 활성이 없는 것으로 밝혀졌다. 뉴클레오솜 점유, 위치설정, 그리고 DNA 서열이 히스톤 옥타머 주변에서 어떻게 싸여지는 지가 상기 서열이 DNA 결합 단백질에 어떻게 접근가능한 지를 결정할 가능성 있다 (Chereji et al., Briefing Functional Genomics, 2014, 14:506-60). 따라서, 국부 염색질 형상에 의해 부과된 방해가 인간 세포에서 많은 CRISPR/Cas 엔도뉴클레아제의 명백한 무활동에서 일정한 역할을 수행할 가능성이 있다. 본원에서 상술된 바와 같이, 표적화 DNA 변형 단백질의 표적 부위의 근위에 (다시 말하면, 약 250개 염기쌍 이내에) 위치된 부위에 DNA 결합 단백질의 결합은 표적 부위에 대한 표적화 DNA 변형 단백질의 접근성을 증가시키고, 따라서 표적화된 유전체 변형 또는 표적화된 후성 변형의 효율 및/또는 특이성을 증가시키는 것으로 밝혀졌다. 본원에서 개시된 조성물 및 방법은 이런 이유로, 인간 세포에서 비활성인 것으로 이전에 생각되었던 CRISPR/Cas 엔도뉴클레아제를 이용한 효율적인 표적화된 유전체 변형/후성 변형을 할 수 있게 한다. 게다가, 본원에서 개시된 조성물 및 방법은 또한, 거의 동일한 표적 부위 사이에서 선택적 유전체 변형을 향상시키고, 따라서 부정확한 효과를 감소시킨다.
(l) 조성물
본 발명의 한 가지 양상은 (a) 프로그램가능 DNA 변형 단백질 또는 상기 프로그램가능 DNA 변형 단백질을 인코딩하는 핵산 및 (b) 최소한 하나의 프로그램가능 DNA 결합 단백질 또는 상기 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산을 포함하는 조성물을 제공한다. 프로그램가능 DNA 변형 단백질은 아래의 섹션 (I)(a)에서 상술되고, 프로그램가능 DNA 결합 단백질은 아래의 섹션 (I)(b)에서 상술되고, 그리고 이들 단백질을 인코딩하는 핵산은 아래의 섹션 (I)(c)에서 상술된다.
(a) 프로그램가능 DNA 변형 단백질
프로그램가능 DNA 변형 단백질은 염색체 DNA 내에 특정한 표적 서열에 결합하고, 그리고 표적 서열에서 또는 표적 서열 인근에서 상기 DNA 또는 상기 DNA와 연관된 단백질을 변형하는 단백질이다. 따라서, 프로그램가능 DNA 변형 단백질은 DNA 결합 도메인 및 촉매적으로 활성 변형 도메인을 포함한다.
DNA 결합 도메인은 이것이 상이한 DNA 서열을 인식하고 이들에 결합하도록 설계되거나 또는 가공될 수 있다는 점에서 프로그램가능하다. 일부 구체예에서, 예로서, DNA 결합은 단백질 및 표적 DNA 사이의 상호작용에 의해 매개된다. 따라서, DNA 결합 도메인은 단백질 가공에 의해 관심되는 DNA 서열에 결합하도록 프로그램될 수 있다. 다른 구체예에서, 예로서, DNA 결합은 단백질의 프로그램가능 DNA 결합 도메인 및 표적 DNA와 상호작용하는 안내 RNA에 의해 매개된다. 이런 경우에, 프로그램가능 DNA 결합 도메인은 적절한 안내 RNA를 설계함으로써 관심되는 DNA 서열에 표적화될 수 있다.
다양한 변형 도메인이 프로그램가능 DNA 변형 단백질 내에 포함될 수 있다. 일부 구체예에서, 변형 도메인은 뉴클레아제 도메인인데, 이것은 뉴클레아제 활성을 갖고, 그리고 이중 가닥 DNA 서열의 양쪽 가닥을 개열한다 (다시 말하면, 이중 가닥 절단을 산출한다). 이중 가닥 절단은 이후, 세포 DNA 수복 과정, 예를 들면, 비상동성 말단 연결 (NHEJ) 또는 상동성-지향된 수복 (HDR)에 의해 수복될 수 있다. 결과로서, DNA 서열은 예로서, 수천 개의 염기쌍까지 최소한 하나의 염기쌍의 결실, 삽입 및/또는 치환에 의해 변형될 수 있다. 뉴클레아제 도메인을 포함하는 프로그램가능 DNA 변형 단백질의 실례는 제한 없이, CRISPR/Cas 뉴클레아제 시스템, CRISPR/Cas 이중 틈내기효소 시스템, 아연 핑거 뉴클레아제, 전사 활성인자-유사 작동체 뉴클레아제, 메가뉴클레아제, 프로그램가능 DNA 결합 도메인에 연결된 뉴클레아제 도메인을 포함하는 융합 단백질, 그리고 이들의 조합을 포함한다. 뉴클레아제 도메인을 포함하는 프로그램가능 DNA 변형 단백질은 아래의 섹션 (I)(a)(i)-(vi)에서 상술된다.
다른 구체예에서, 프로그램가능 DNA 변형 단백질의 변형 도메인은 프로그램가능 DNA 변형 단백질이 DNA 및/또는 상기 DNA와 연관된 단백질(들)의 구조 및/또는 활성을 변형하도록, 비-뉴클레아제 활성 (가령, 후성 변형 활성 또는 전사 조절 활성)을 갖는다. 따라서, 프로그램가능 DNA 변형 단백질은 프로그램가능 DNA 결합 도메인에 연결된 비-뉴클레아제 변형 도메인을 포함하는 융합 단백질이다. 이런 단백질은 아래의 섹션 (I)(a)(vii)에서 상술된다.
프로그램가능 DNA 변형 단백질은 야생형 또는 자연발생 DNA 결합 및/또는 변형 도메인, 자연발생 DNA 결합 및/또는 변형 도메인의 변형된 버전, 합성 또는 인공 DNA 결합 및/또는 변형 도메인, 그리고 이들의 조합을 포함할 수 있다.
(i) CRISPR/Cas 뉴클레아제 시스템
일부 구체예에서, 프로그램가능 DNA 변형 단백질은 RNA-안내된 CRISPR/Cas 뉴클레아제 시스템일 수 있는데, 이것은 DNA 내에 이중 가닥 절단을 도입한다. CRISPR/Cas 뉴클레아제 시스템은 CRISPR/Cas 뉴클레아제 및 안내 RNA를 포함한다.
CRISPR/Cas 뉴클레아제 . 일정한 구체예에서, CRISPR/Cas 뉴클레아제는 다양한 세균 및 고세균류 내에 존재하는 I형 (다시 말하면, IA, IB, IC, ID, IE 또는 IF), II형 (다시 말하면, IIA, IIB 또는 IIC), III형 (다시 말하면, IIIA 또는 IIIB), 또는 V형 CRISPR 시스템으로부터 유래될 수 있다. 가령, CRISPR/Cas 시스템은 스트렙토코쿠스 (Streptococcus) 종 (가령, 스트렙토코쿠스 피오게네스 (Streptococcus pyogenes)), 캄필로박터 (Campylobacter) 종 (가령, 캄필로박터 제주니 (Campylobacter jejuni)), 프란시셀라 (Francisella) 종 (가령, 프란시셀라 노비시다 (Francisella novicida)), 아카리오클로리스 (Acaryochloris) 종, 아세토할로비움 (Acetohalobium) 종, 아시다미노코쿠스 (Acidaminococcus) 종, 아시디티오바실루스 (Acidithiobacillus) 종, 알리시클로바실루스 (Alicyclobacillus) 종, 알로크로마티움 (Allochromatium) 종, 암모니펙스 (Ammonifex) 종, 아나바에나 (Anabaena) 종, 아르트로스피라 (Arthrospira) 종, 바실루스 (Bacillus) 종, 부르크홀데리알레스 (Burkholderiales) 종, 칼디셀룰로시럽토 (Caldicelulosiruptor) 종, 칸디다투스 (Candidatus) 종, 클로스트리디움 (Clostridium) 종, 크로코스파에라 (Crocosphaera) 종, 시아노테세 (Cyanothece) 종, 엑시구오박테리움 (Exiguobacterium) 종, 피네골디아 (Finegoldia) 종, 크테도노박터 (Ktedonobacter) 종, 라크노스피라세애 (Lachnospiraceae) 종, 락토바실루스 (Lactobacillus) 종, 린그비아 (Lyngbya) 종, 마리노박터 (Marinobacter) 종, 메타노할로비움 (Methanohalobium) 종, 마이크로스킬라 (Microscilla) 종, 마이크로콜레우스 (Microcoleus) 종, 마이크로시스티스 (Microcystis) 종, 나트라나에로비우스 (Natranaerobius) 종, 나이세리아 (Neisseria) 종, 니트로소코쿠스 (Nitrosococcus) 종, 노카르디옵시스 (Nocardiopsis) 종, 노둘라리아 (Nodularia) 종, 노스톡 (Nostoc) 종, 오실라토리아 (Oscillatoria) 종, 폴라로모나스 (Polaromonas) 종, 펠로토마쿨룸 (Pelotomaculum) 종, 슈도알테로모나스 (Pseudoalteromonas) 종, 페트로토가 (Petrotoga) 종, 프레보텔라 (Prevotella) 종, 스타필로코쿠스 (Staphylococcus) 종, 스트렙토미세스 (Streptomyces) 종, 스트렙토스포란기움 (Streptosporangium) 종, 시네코코쿠스 (Synechococcus) 종, 써모시포 (Thermosipho) 종, 또는 우미균류 (Verrucomicrobia) 종으로부터 유래될 수 있다. 또 다른 구체예에서, CRISPR/Cas 뉴클레아제는 고세균류 CRISPR 시스템, CRISPR-CasX 시스템, 또는 CRISPR-CasY 시스템으로부터 유래될 수 있다 (Burstein et al., Nature, 2017, 542(7640):237-241).
특정한 구체예에서, CRISPR/Cas 뉴클레아제는 I형 CRISPR/Cas 시스템으로부터 유래될 수 있다. 다른 특정한 구체예에서, CRISPR/Cas 뉴클레아제는 II형 CRISPR/Cas 시스템으로부터 유래될 수 있다. 다른 특정한 구체예에서, CRISPR/Cas 뉴클레아제는 III형 CRISPR/Cas 시스템으로부터 유래될 수 있다. 다른 특정한 구체예에서, CRISPR/Cas 뉴클레아제는 V형 CRISPR/Cas 시스템으로부터 유래될 수 있다.
적합한 CRISPR 단백질의 무제한적 실례는 Cas 단백질, Cpf 단백질, C2c 단백질 (가령, C2c1, C2c2, Cdc3), Cmr 단백질, Csa 단백질, Csb 단백질, Csc 단백질, Cse 단백질, Csf 단백질, Csm 단백질, Csn 단백질, Csx 단백질, Csy 단백질, Csz 단백질, 그리고 이들의 유도체 또는 변이체를 포함한다. 특정한 구체예에서, CRISPR/Cas 뉴클레아제는 II형 Cas9 단백질, V형 Cpf1 단백질, 또는 이들의 유도체일 수 있다.
일부 구체예에서, CRISPR/Cas 뉴클레아제는 스트렙토코쿠스 피오게네스 (Streptococcus pyogenes) Cas9 (SpCas9) 또는 스트렙토코쿠스 써모필루스 (Streptococcus thermophilus) Cas9 (StCas9)일 수 있다. 다른 구체예에서, CRISPR/Cas 뉴클레아제는 캄필로박터 제주니 (Campylobacter jejuni) Cas9 (CjCas9)일 수 있다. 대안적 구체예에서, CRISPR/Cas 뉴클레아제는 프란시셀라 노비시다 (Francisella novicida) Cas9 (FnCas9)일 수 있다. 또 다른 구체예에서, CRISPR/Cas 뉴클레아제는 나이세리아 시네레아 (Neisseria cinerea) Cas9 (NcCas9)일 수 있다. 추가 구체예에서, CRISPR/Cas 뉴클레아제는 프란시셀라 노비시다 (Francisella novicida) Cpf1 (FnCpf1), 아시다미노코쿠스 (Acidaminococcus) 종 Cpf1 (AsCpf1), 또는 라크노스피라세애 (Lachnospiraceae) 세균 ND2006 Cpf1 (LbCpf1)일 수 있다.
일반적으로, CRISPR/Cas 뉴클레아제는 RNA 인식 및/또는 RNA 결합 도메인을 포함하는데, 이것은 안내 RNA와 상호작용한다. CRISPR/Cas 뉴클레아제는 또한, 엔도뉴클레아제 활성을 갖는 최소한 하나의 뉴클레아제 도메인을 포함한다. 가령, Cas9 단백질은 RuvC-유사 뉴클레아제 도메인 및 HNH-유사 뉴클레아제 도메인을 포함하고, 그리고 Cpf1 단백질은 RuvC-유사 도메인을 포함한다. CRISPR/Cas 뉴클레아제는 또한, DNA 결합 도메인, 헬리카아제 도메인, RNA분해효소 도메인, 단백질-단백질 상호작용 도메인, 이합체화 도메인뿐만 아니라 다른 도메인을 포함할 수 있다.
CRISPR/Cas 뉴클레아제는 최소한 하나의 핵 국부화 신호, 세포-투과성 도메인 및/또는 마커 도메인을 더욱 포함할 수 있다. 핵 국부화 신호의 무제한적 실례는 PKKKRKV (서열 번호:1), PKKKRRV (서열 번호:2), KRPAATKKAGQAKKKK (서열 번호:3), YGRKKRRQRRR (서열 번호:28), RKKRRQRRR (서열 번호:29), PAAKRVKLD (서열 번호:30), RQRRNELKRSP (서열 번호:31), VSRKRPRP (서열 번호:32), PPKKARED (서열 번호:33), PQPKKKPL (서열 번호:34), SALIKKKKKMAP (서열 번호:35), PKQKKRK (서열 번호:36), RKLKKKIKKL (서열 번호:37), REKKKFLKRR (서열 번호:38), KRKGDEVDGVDEVAKKKSKK (서열 번호:39), RKCLQAGMNLEARKTKK (서열 번호:40), NQSSNFGPMKGGNFGGRSSGPYGGGGQYFAKPRNQGGY (서열 번호:41) 및 RMRIZFKNKGKDTAELRRRRVEVSVELRKAKKDEQILKRRNV (서열 번호:42)를 포함한다. 적합한 세포-투과성 도메인의 실례는 제한 없이, GRKKRRQRRRPPQPKKKRKV (서열 번호:4), PLSSIFSRIGDPPKKKRKV (서열 번호:5), GALFLGWLGAAGSTMGAPKKKRKV (서열 번호:6), GALFLGFLGAAGSTMGAWSQPKKKRKV (서열 번호: 7), KETWWETWWTEWSQPKKKRKV (서열 번호: 8), YARAAARQARA (서열 번호:43), THRLPRRRRRR (서열 번호:44), GGRRARRRRRR (서열 번호:45), RRQRRTSKLMKR (서열 번호:46), GWTLNSAGYLLGKINLKALAALAKKIL (서열 번호:47), KALAWEAKLAKALAKALAKHLAKALAKALKCEA (서열 번호:48) 및 RQIKIWFQNRRMKWKK (서열 번호:49)를 포함한다. 마커 도메인은 형광 단백질 및 정제 또는 에피토프 태그를 포함한다. 적합한 형광 단백질은 제한 없이, 녹색 형광 단백질 (가령, GFP, eGFP, GFP-2, tagGFP, turboGFP, Emerald, Azami Green, 단위체성 Azami Green, CopGFP, AceGFP, ZsGreen1), 황색 형광 단백질 (가령, YFP, EYFP, Citrine, Venus, YPet, PhiYFP, ZsYellow1), 청색 형광 단백질 (가령, BFP, EBFP, EBFP2, Azurite, mKalama1, GFPuv, Sapphire, T-sapphire), 시안색 형광 단백질 (가령, ECFP, Cerulean, CyPet, AmCyan1, Midoriishi-Cyan), 적색 형광 단백질 (가령, mKate, mKate2, mPlum, DsRed 단위체, mCherry, mRFP1, DsRed-Express, DsRed2, DsRed-단위체, HcRed-탠덤, HcRed1, AsRed2, eqFP611, mRasberry, mStrawberry, Jred), 그리고 오렌지색 형광 단백질 (가령, mOrange, mKO, Kusabira-Orange, 단위체성 Kusabira-Orange, mTangerine, tdTomato)을 포함한다. 적합한 정제 또는 에피토프 태그의 무제한적 실례는 6xHis, FLAG®, HA, GST, Myc 등을 포함한다.
핵 국부화 신호, 세포-투과성 도메인 및/또는 마커 도메인은 단백질의 N 말단에서, C 말단에서, 또는 내부 위치에서 위치될 수 있다. 일부 구체예에서, CRISPR/Cas 뉴클레아제는 최소한 하나의 검출가능한 표지를 더욱 포함할 수 있다. 검출가능한 표지는 형광단 (가령, FAM, TMR, Cy3, Cy5, 텍사스 레드, 오레건 그린, Alexa Fluors, 할로 태그, 또는 적합한 형광 태그/염료), 발색단 (가령, 비오틴, 다이곡시제닌 등), 양자점, 또는 금 입자일 수 있다. 검출가능한 표지는 전통적인 수단을 통해 단백질의 임의의 아미노산에 부착될 수 있다.
안내 RNA . CRISPR/Cas 뉴클레아제 시스템은 또한, 안내 RNA (gRNA)를 포함한다. 안내 RNA는 CRISPR/Cas 뉴클레아제 및 표적 부위와 상호작용하여 상기 CRISPR/Cas 뉴클레아제를 염색체 서열 내에 표적 부위로 안내한다. 표적 부위는 상기 서열이 프로토스페이서 인접 모티프 (PAM)와 접한다는 점을 제외하고, 서열 제한이 없다. 가령, Cas9 단백질에 대한 PAM 서열은 3'-NGG, 3'-NGGNG, 3'-NNAGAAW 및 3'-ACAY를 포함하고, 그리고 Cpf1에 대한 PAM 서열은 5'-TTN (여기서 N은 임의의 뉴클레오티드로서 규정되고, W는 A 또는 T로서 규정되고, 그리고 Y는 C 또는 T로서 규정된다)을 포함한다.
각 안내 RNA는 3가지 영역을 포함할 수 있다: 염색체 DNA 서열 내에 표적 부위에 상보성을 갖는 5' 단부에서 첫 번째 영역, 내부에 있고 스템 루프 구조를 형성하는 두 번째 영역, 그리고 본질적으로 단일 가닥 상태로 남아있는 3' 단부에서 세 번째 영역. 두 번째와 세 번째 영역은 CRISPR/Cas 단백질과 상호작용하는 이차 구조를 형성한다. 각 안내 RNA의 첫 번째 영역은 상이하다 (다시 말하면, 서열 특이적이다). 두 번째와 세 번째 영역은 특정 CRISPR/Cas 단백질과 복합체를 형성하는 안내 RNA에서 동일할 수 있다.
안내 RNA의 첫 번째 영역은 안내 RNA의 첫 번째 영역이 표적 서열과 염기쌍을 이룰 수 있도록, 표적 부위에서 서열 (다시 말하면, 프로토스페이서 서열)에 상보성을 갖는다. 가령, SpCas9 안내 RNA의 첫 번째 영역은 GN17-20GG를 포함할 수 있다. 일반적으로, 안내 RNA의 첫 번째 영역 (다시 말하면, crRNA) 및 표적 서열 사이에 상보성은 최소한 80%, 최소한 85%, 최소한 90%, 최소한 95%, 또는 그 이상이다. 다양한 구체예에서, 안내 RNA의 첫 번째 영역은 약 10개 뉴클레오티드 내지 약 25개 뉴클레오티드 이상을 포함할 수 있다. 가령, 안내 RNA의 첫 번째 영역 및 cDNA 서열 내에 표적 부위 사이에 염기 대합의 영역은 길이에서 약 10, 11, 12, 13, 14, 15, 16, 17, 18, 19, 20, 22, 23, 24, 25, 또는 25개보다 많은 뉴클레오티드일 수 있다. 한 예시적인 구체예에서, 안내 RNA의 첫 번째 영역은 길이에서 약 19, 20 또는 21개 뉴클레오티드이다.
안내 RNA는 또한, 이차 구조를 형성하는 두 번째 영역을 포함한다. 일부 구체예에서, 이차 구조는 최소한 하나의 스템 (또는 헤어핀) 및 루프를 포함한다. 각 루프 및 스템의 길이는 변할 수 있다. 가령, 루프는 길이에서 약 3 내지 약 10개 뉴클레오티드의 범위에서 변할 수 있고, 그리고 스템은 길이에서 약 6 내지 약 20개 염기쌍의 범위에서 변할 수 있다. 스템은 1 내지 약 10개 뉴클레오티드의 하나 또는 그 이상의 돌출을 포함할 수 있다. 따라서, 두 번째 영역의 전체 길이는 길이에서 약 16 내지 약 60개 뉴클레오티드의 범위에서 변할 수 있다. 안내 RNA는 또한, 본질적으로 단일 가닥 상태로 남아있는 3' 단부에서 세 번째 영역을 포함한다. 따라서, 세 번째 영역은 관심되는 세포에서 임의의 핵산 서열에 상보성을 갖지 않고, 그리고 안내 RNA의 나머지 부분에 상보성을 갖지 않는다. 세 번째 영역의 길이는 변할 수 있다. 일반적으로, 세 번째 영역은 길이에서 약 4개 뉴클레오티드 이상이다. 가령, 세 번째 영역의 길이는 길이에서 약 5 내지 약 60개 뉴클레오티드의 범위에서 변할 수 있다.
안내 RNA의 두 번째와 세 번째 영역 (보편적인 또는 골격 영역으로 또한 불림)의 조합된 길이는 길이에서 약 30 내지 약 120개 뉴클레오티드의 범위에서 변할 수 있다. 한 양상에서, 안내 RNA의 두 번째와 세 번째 영역의 조합된 길이는 길이에서 약 70 내지 약 100개 뉴클레오티드의 범위에서 변한다.
또 다른 구체예에서, 안내 RNA의 두 번째와 세 번째 영역은 하나 또는 그 이상의 추가 스템 루프 영역을 포함할 수 있는데, 여기서 스템 루프 영역은 앱타머 서열을 포함한다 (Konermann et al., Nature3, 2015, 517(7536):583-588; Zalatan et al., Cell, 2015, 160(1-2):339-50). 적합한 앱타머 서열은 MS2, PP7, COM, Qβ, F2, GA, fr, JP501, M12, R17, BZ13, JP34, JP500, KU1, M11, MX1, TW18, VK, SP, FI, ID2, NL95, TW19, AP205, ΦCb5, ΦCb8r, ΦCb12r, ΦCb23r, 7s, PRR1, HSF1, AID, APOBEC1, p300, TET1/2/3, VP64, GFP, Rta, p65, MyoD1, 또는 VP160에서 선택되는 어댑터 단백질에 결합하는 것들을 포함한다. 이런 구체예에서, 안내 RNA의 두 번째와 세 번째 영역의 전체 길이는 약 125개 뉴클레오티드까지, 약 150개 뉴클레오티드까지, 약 175개 뉴클레오티드까지, 약 200개 뉴클레오티드까지, 약 225개 뉴클레오티드까지, 약 250개 뉴클레오티드까지, 약 275개 뉴클레오티드까지, 또는 약 300개 뉴클레오티드까지의 범위에서 변할 수 있다.
일부 구체예에서, 안내 RNA는 3가지 영역 모두를 포함하는 단일 분자일 수 있다. 다른 구체예에서, 안내 RNA는 2개의 별개 분자를 포함할 수 있다. 첫 번째 RNA 분자 (다시 말하면, crRNA)는 안내 RNA의 첫 번째 영역 및 안내 RNA의 두 번째 영역의 "스템"의 절반을 포함할 수 있다. 두 번째 RNA 분자 (다시 말하면, tracrRNA)는 안내 RNA의 두 번째 영역의 "스템"의 다른 절반 및 안내 RNA의 세 번째 영역을 포함할 수 있다. 따라서, 이러한 구체예에서, 첫 번째와 두 번째 RNA 분자는 각각, 서로에 상보적인 뉴클레오티드의 서열을 내포한다. 가령, 한 구체예에서, crRNA 및 tracrRNA RNA 분자는 각각, 다른 서열과 염기쌍을 이루어 기능적 안내 RNA를 형성하는 서열 (약 6 내지 약 20개 뉴클레오티드의)을 포함한다. 가령, II형 CRISPR/Cas 시스템의 안내 RNA는 crRNA 및 tracrRNA를 포함할 수 있다. 일부 양상에서, II형 CRISPR/Cas 시스템을 위한 crRNA는 화학적으로 합성될 수 있고, 그리고 tracrRNA II형 CRISPR/Cas 시스템은 시험관내에서 합성될 수 있다 (아래의 섹션 (I)(c)를 참조한다). 다른 구체예에서, V형 CRISPR/Cas 시스템의 안내 RNA는 단지 crRNA만을 포함할 수 있다.
안내 RNA는 표준 리보뉴클레오티드, 변형된 리보뉴클레오티드 (가령, 슈도우리딘), 리보뉴클레오티드 이성질체 및/또는 리보뉴클레오티드 유사체를 포함할 수 있다. 일부 구체예에서, 안내 RNA는 최소한 하나의 검출가능한 표지를 더욱 포함할 수 있다. 검출가능한 표지는 형광단 (가령, FAM, TMR, Cy3, Cy5, 텍사스 레드, 오레건 그린, Alexa Fluors, 할로 태그, 또는 적합한 형광 염료), 발색단 (가령, 비오틴, 다이곡시제닌 등), 양자점, 또는 금 입자 일 수 있다. 당업자는 gRNA 설계 및 구성에 익숙하다, 예를 들면, gRNA 설계 도구는 인터넷에서 또는 상업적인 공급원으로부터 가용하다.
안내 RNA는 화학적으로 합성되거나, 효소적으로 합성되거나, 또는 이들의 조합일 수 있다. 가령, 안내 RNA는 표준 포스포라미디트-기초된 고체상 합성 방법을 이용하여 합성될 수 있다. 대안으로, 안내 RNA는 안내 RNA를 인코딩하는 DNA를 파지 RNA 중합효소에 의해 인식되는 프로모터 제어 서열에 작동가능하게 연결함으로써 시험관내에서 합성될 수 있다. 적합한 파지 프로모터 서열의 실례는 T7, T3, SP6 프로모터 서열, 또는 이들의 변이를 포함한다. 안내 RNA가 2개의 별개 분자 (다시 말하면, crRNA 및 tracrRNA)를 포함하는 구체예에서, crRNA는 화학적으로 합성될 수 있고, 그리고 tracrRNA는 효소적으로 합성될 수 있다. 안내 RNA를 인코딩하는 핵산은 플라스미드 벡터의 부분일 수 있는데, 상기 벡터는 추가 발현 제어 서열 (가령, 인핸서 서열, 코자크 서열, 폴리아데닐화 서열, 전사 종결 서열 등), 선별가능 마커 서열 (가령, 항생제 내성 유전자), 복제 기점, 기타 등등을 더욱 포함할 수 있다. 아래의 섹션 (I)(c)에서 상술된 바와 같이, 안내 RNA를 인코딩하는 핵산은 진핵 세포에서 발현을 위해 RNA 중합효소 III (Pol III)에 의해 인식되는 프로모터 제어 서열에 작동가능하게 연결될 수 있다.
(ii) CRISPR/Cas 이중 틈내기효소 시스템
다른 구체예에서, 프로그램가능 DNA 변형 단백질은 CRISPR/Cas 이중 틈내기효소 시스템일 수 있다. CRISPR/Cas 이중 틈내기효소 시스템은 CRISPR/Cas 뉴클레아제가 DNA의 단지 하나의 가닥만을 개열하도록 변형된다는 점을 제외하고, 상기 섹션 (I)(a)(i)에서 설명된 CRISPR/Cas 뉴클레아제 시스템과 유사하다. 따라서, 단일 CRISPR/Cas 틈내기효소 시스템은 이중 가닥 DNA 내에 단일 가닥 절단 또는 틈을 창출하고, 그리고 대합된 오프셋 안내 RNA를 포함하는 대합된 CRISPR/Cas 이중 틈내기효소 시스템은 상기 DNA 내에 이중 가닥 절단을 창출한다.
CRISPR/Cas 뉴클레아제는 하나 또는 그 이상의 돌연변이 및/또는 결실에 의해 틈내기효소로 전환될 수 있다. 가령, Cas9 틈내기효소는 뉴클레아제 도메인 (가령, RuvC-유사 도메인 또는 HNH-유사 도메인) 중에서 한 가지에서 하나 또는 그 이상의 돌연변이를 포함할 수 있다. 가령, 하나 또는 그 이상의 돌연변이는 RuvC-유사 도메인에서 D10A, D8A, E762A 및/또는 D986A일 수 있고, 또는 하나 또는 그 이상의 돌연변이는 HNH-유사 도메인에서 H840A, H559A, N854A, N856A 및/또는 N863A일 수 있다.
(iii) 아연 핑거 뉴클레아제
또 다른 구체예에서, 프로그램가능 DNA 변형 단백질은 아연 핑거 뉴클레아제 (ZFN)일 수 있다. ZFN은 DNA 결합 아연 핑거 영역 및 뉴클레아제 도메인을 포함한다. 아연 핑거 영역은 약 2개 내지 7개 아연 핑거, 예를 들면, 약 4개 내지 6개 아연 핑거를 포함할 수 있는데, 여기서 각 아연 핑거는 3개의 뉴클레오티드에 결합한다. 아연 핑거 영역은 임의의 DNA 서열을 인식하고 이것에 결합하도록 가공될 수 있다. 아연 핑거 설계 도구 또는 알고리즘은 인터넷에서 또는 상업적인 공급원으로부터 가용하다. 아연 핑거는 적합한 링커 서열을 이용하여 함께 연결될 수 있다.
ZFN은 또한, 뉴클레아제 도메인을 포함하는데, 이것은 임의의 엔도뉴클레아제 또는 엑소뉴클레아제로부터 획득될 수 있다. 뉴클레아제 도메인이 유래될 수 있는 엔도뉴클레아제의 무제한적 실례는 제한 엔도뉴클레아제 및 귀소 엔도뉴클레아제를 포함하지만 이들에 한정되지 않는다. 일부 구체예에서, 뉴클레아제 도메인은 II형-S 제한 엔도뉴클레아제로부터 유래될 수 있다. II형-S 엔도뉴클레아제는 전형적으로, 인식/결합 부위로부터 여러 염기쌍 떨어져 있고, 그리고 그와 같이, 분리가능한 결합 및 개열 도메인을 갖는 부위에서 DNA를 개열한다. 이들 효소는 일반적으로, 엇갈린 위치에서 DNA의 각 가닥을 개열하기 위해, 일시적으로 연관하여 이합체를 형성하는 단위체이다. 적합한 II형-S 엔도뉴클레아제의 무제한적 실례는 BfiI, BpmI, BsaI, BsgI, BsmBI, BsmI, BspMI, FokI, MboII 및 SapI을 포함한다. 일부 구체예에서, 뉴클레아제 도메인은 FokI 뉴클레아제 도메인 또는 이의 유도체일 수 있다. II형-S 뉴클레아제 도메인은 2개의 상이한 뉴클레아제 도메인의 이합체화를 용이하게 하도록 변형될 수 있다. 가령, FokI의 개열 도메인은 일정한 아미노산 잔기를 돌연변이시킴으로써 변형될 수 있다. 무제한적 실례로서, FokI 뉴클레아제 도메인의 위치 446, 447, 479, 483, 484, 486, 487, 490, 491, 496, 498, 499, 500, 531, 534, 537 및 538에서 아미노산 잔기가 변형을 위한 표적이다. 가령, 하나의 변형된 FokI 도메인은 Q486E, I499L 및/또는 N496D 돌연변이를 포함할 수 있고, 그리고 다른 변형된 FokI 도메인은 E490K, I538K 및/또는 H537R 돌연변이를 포함할 수 있다.
ZFN은 최소한 하나의 핵 국부화 신호, 세포-투과성 도메인 및/또는 마커 도메인을 더욱 포함할 수 있는데, 이들은 섹션 (I)(a)(i)에서 전술된다.
(iv) 전사 활성인자-유사 작동체 뉴클레아제
대안적 구체예에서, 프로그램가능 DNA 변형 단백질은 전사 활성인자-유사 작동체 뉴클레아제 (TALEN)일 수 있다. TALEN은 뉴클레아제 도메인에 연결되는 전사 활성인자-유사 작동체 (TALE)로부터 유래되는 고도로 보존된 반복으로 구성된 DNA 결합 도메인을 포함한다. TALE는 숙주 식물 세포에서 유전자의 전사를 변경하기 위해 식물 병원체 잔토모나스 (Xanthomonas)에 의해 분비되는 단백질이다. TALE 반복 어레이는 관심되는 임의의 DNA 서열을 표적으로 하기 위한 모듈식 단백질 설계를 통해 가공될 수 있다. TALEN의 뉴클레아제 도메인은 상기 섹션 (I)(a)(iii)에서 설명된 바와 같은 임의의 뉴클레아제 도메인일 수 있다. 특정한 구체예에서, 뉴클레아제 도메인은 FokI로부터 유래된다 (Sanjana et al., 2012, Nat Protoc, 7(1):171-192).
TALEN은 또한, 최소한 하나의 핵 국부화 신호, 세포-투과성 도메인, 마커 도메인 및/또는 검출가능한 표지를 포함할 수 있는데, 이들은 섹션 (I)(a)(i)에서 전술된다.
(v) 메가뉴클레아제 또는 희귀-절단 엔도뉴클레아제
또 다른 구체예에서, 프로그램가능 DNA 변형 단백질은 메가뉴클레아제 또는 이의 유도체일 수 있다. 메가뉴클레아제는 긴 인식 서열에 의해 특징되는 엔도데옥시리보뉴클레아제이다, 다시 말하면, 상기 인식 서열은 일반적으로, 약 12개 염기쌍 내지 약 45개 염기쌍의 범위에서 변한다. 이러한 요건의 결과로서, 상기 인식 서열은 일반적으로, 소정의 유전체에서 단지 한 번만 발생한다. 메가뉴클레아제 중에서, LAGLIDADG로 명명된 귀소 엔도뉴클레아제의 패밀리가 유전체 및 유전체 가공의 연구를 위한 귀중한 도구가 되었다. 일부 구체예에서, 메가뉴클레아제는 I-SceI, I-TevI, 또는 이들의 변이체일 수 있다. 메가뉴클레아제는 당업자에게 널리 공지된 기술을 이용하여 인식 서열을 변형함으로써, 특정한 염색체 서열에 표적화될 수 있다.
대안적 구체예에서, 프로그램가능 DNA 변형 단백질은 희귀-절단 엔도뉴클레아제 또는 이의 유도체일 수 있다. 희귀-절단 엔도뉴클레아제는 인식 서열이 유전체 내에서 드물게, 바람직하게는 유전체 내에서 단지 한 번만 발생하는 부위 특이적 엔도뉴클레아제이다. 희귀-절단 엔도뉴클레아제는 7-뉴클레오티드 서열, 8-뉴클레오티드 서열, 또는 더욱 긴 인식 서열을 인식할 수 있다. 희귀-절단 엔도뉴클레아제의 무제한적 실례는 NotI, AscI, PacI, AsiSI, SbfI 및 FseI을 포함한다.
메가뉴클레아제 또는 희귀-절단 엔도뉴클레아제는 또한, 최소한 하나의 핵 국부화 신호, 세포-투과성 도메인, 마커 도메인 및/또는 검출가능한 표지를 포함할 수 있는데, 이들은 섹션 (I)(a)(i)에서 전술된다.
(vi) 뉴클레아제 도메인을 포함하는 프로그램가능 융합 단백질
다른 추가 구체예에서, 프로그램가능 DNA 변형 단백질은 (이중 가닥 개열) 뉴클레아제 도메인에 연결된 프로그램가능 DNA 결합 도메인을 포함하는 융합 단백질일 수 있다. 융합 단백질의 뉴클레아제 도메인은 상기 섹션 (I)(a)(iii)에서 설명된 것들, CRISPR/Cas 뉴클레아제로부터 유래된 뉴클레아제 도메인 (가령, Cas9의 RuvC-유사 또는 HNH-유사 뉴클레아제 도메인, 또는 Cpf1의 뉴클레아제 도메인), 또는 메가뉴클레아제 또는 희귀-절단 엔도뉴클레아제로부터 유래된 뉴클레아제 도메인 중에서 한 가지일 수 있다.
융합 단백질의 프로그램가능 DNA 결합 도메인은 모든 뉴클레아제 활성을 결여하도록 변형된 프로그램가능 엔도뉴클레아제 (다시 말하면, CRISPR/CAS 뉴클레아제, 또는 메가뉴클레아제)일 수 있다. 따라서, 융합 단백질의 DNA 결합 도메인은 촉매적으로 비활성 CRISPR/Cas 시스템 또는 촉매적으로 비활성 메가뉴클레아제일 수 있다. 대안으로, 융합 단백질의 프로그램가능 DNA 결합 도메인은 프로그램가능 DNA 결합 단백질, 예를 들면, 예로서 아연 핑거 단백질 또는 전사 활성인자-유사 작동체일 수 있다. 일부 구체예에서, 프로그램가능 DNA 결합 도메인은 뉴클레아제 활성이 돌연변이 및/또는 결실에 의해 제거된 촉매적으로 비활성 CRISPR/Cas 뉴클레아제일 수 있다. 가령, 촉매적으로 비활성 CRISPR/Cas 단백질은 촉매적으로 비활성 (죽은) Cas9 (dCas9)일 수 있는데, 여기서 RuvC-유사 도메인은 D10A, D8A, E762A 및/또는 D986A 돌연변이를 포함하고, 그리고 HNH-유사 도메인은 H840A, H559A, N854A, N865A 및/또는 N863A 돌연변이를 포함한다. 대안으로, 촉매적으로 비활성 CRISPR/Cas 단백질은 뉴클레아제 도메인에서 필적하는 돌연변이를 포함하는 촉매적으로 비활성 (죽은) Cpf1 단백질일 수 있다. 또 다른 구체예에서, 프로그램가능 DNA 결합 도메인은 뉴클레아제 활성이 돌연변이 및/또는 결실에 의해 제거된 촉매적으로 비활성 메가뉴클레아제일 수 있다, 가령, 촉매적으로 비활성 메가뉴클레아제는 C 말단 절두를 포함할 수 있다.
뉴클레아제 활성을 포함하는 융합 단백질은 또한, 최소한 하나의 핵 국부화 신호, 세포-투과성 도메인, 마커 도메인 및/또는 검출가능한 표지를 포함할 수 있는데, 이들은 섹션 (I)(a)(i)에서 전술된다.
(vii) 비-뉴클레아제 도메인을 포함하는 프로그램가능 융합 단백질/복합체
대안적 구체예에서, 프로그램가능 DNA 변형 단백질은 비-뉴클레아제 변형 도메인에 연결된 프로그램가능 DNA 결합 도메인을 포함하는 융합 단백질일 수 있다. 적합한 프로그램가능 DNA 결합 도메인은 섹션 (I)(a)(vi)에서 전술된다.
일부 구체예에서, 비-뉴클레아제 변형 도메인은 후성 변형 도메인일 수 있는데, 이것은 DNA 또는 염색질 구조를 변경한다 (그리고, DNA 서열을 변경할 수 있거나 또는 변경할 수 없다). 적합한 후성 변형 도메인의 무제한적 실례는 DNA 메틸전달효소 활성 (가령, 시토신 메틸전달효소), DNA 탈메틸효소 활성, DNA 탈아미노화 (가령, 시토신 탈아미노효소, 아데노신 탈아미노효소, 구아닌 탈아미노효소), DNA 아미노화, DNA 헬리카아제 활성, 히스톤 아세틸전달효소 (HAT) 활성 (가령, E1A 결합 단백질 p300으로부터 유래된 HAT 도메인), 히스톤 탈아세틸화효소 활성, 히스톤 메틸전달효소 활성, 히스톤 탈메틸효소 활성, 히스톤 키나아제 활성, 히스톤 포스파타아제 활성, 히스톤 유비퀴틴 리가아제 활성, 히스톤 탈유비퀴틴화 활성, 히스톤 아데닐화 활성, 히스톤 탈아데닐화 활성, 히스톤 수모화 활성, 히스톤 탈수모화 활성, 히스톤 리보실화 활성, 히스톤 탈리보실화 활성, 히스톤 미리스토일화 활성, 히스톤 탈미리스토일화 활성, 히스톤 시트룰린화 활성, 히스톤 알킬화 활성, 히스톤 탈알킬화 활성, 또는 히스톤 산화 활성을 갖는 것들을 포함한다. 특정한 구체예에서, 후성 변형 도메인은 시토신 탈아미노효소 활성, 히스톤 아세틸전달효소 활성, 또는 DNA 메틸전달효소 활성을 포함할 수 있다.
다른 구체예에서, 비-뉴클레아제 변형 도메인은 전사 활성화 도메인 또는 전사 억제인자 도메인일 수 있다. 적합한 전사 활성화 도메인은 제한 없이, 단순 헤르페스 바이러스 VP16 도메인, VP64 (이것은 VP16의 사합체성 유도체이다), VP160, NFκB p65 활성화 도메인, p53 활성화 도메인 1 및 2, CREB (cAMP 반응 요소 결합 단백질) 활성화 도메인, E2A 활성화 도메인, 인간 열 충격 인자 1 (HSF1)로부터 활성화 도메인, 또는 NFAT (활성화된 T-세포의 핵 인자) 활성화 도메인을 포함한다. 적합한 전사 억제인자 도메인의 무제한적 실례는 유도성 cAMP 초기 억제인자 (ICER) 도메인, 크루펠-연관된 상자 A (KRAB-A) 억제인자 도메인, YY1 글리신 풍부한 억제인자 도메인, Sp1-유사 억제인자, E(spl) 억제인자, IκB 억제인자, 또는 MeCP2를 포함한다. 전사 활성화 또는 전사 억제인자 도메인은 DNA 결합 단백질에 유전적으로 융합되거나, 또는 비공유 단백질-단백질, 단백질-RNA 또는 단백질-DNA 상호작용을 통해 결합될 수 있다.
프로그램가능 DNA 변형 단백질이 CRISPR/Cas 시스템을 포함하는 구체예에서, CRISPR/Cas 시스템의 안내 RNA는 전사 활성인자, 전사 억제인자, 또는 후성 변형 단백질에 결합하는 앱타머 서열을 포함할 수 있다 (Konermann et al., Nature, 2015, 517(7536):583-588; Zalatan et al., Cell, 2015, 160(1-2):339-50).
비-뉴클레아제 활성을 포함하는 융합 단백질은 또한, 최소한 하나의 핵 국부화 신호, 세포-투과성 도메인, 마커 도메인 및/또는 검출가능한 표지를 포함할 수 있는데, 이들은 섹션 (I)(a)(i)에서 전술된다.
(b) 프로그램가능 DNA 결합 단백질
조성물은 또한, 최소한 하나의 프로그램가능 DNA 결합 단백질을 포함한다. 프로그램가능 DNA 결합 단백질은 특정한 DNA 서열에 결합하지만, 상기 DNA 또는 상기 DNA와 연관된 단백질(들)을 변형하지 않는 단백질이다.
일부 구체예에서, 최소한 하나의 프로그램가능 DNA 결합 단백질은 뉴클레아제 활성을 결여하도록 변형된 CRISPR/Cas 뉴클레아제일 수 있다. 가령, 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 시스템일 수 있다. 이를 위해, CRISPR/Cas 뉴클레아제는 모든 뉴클레아제 활성을 제거하기 위해 돌연변이 및/또는 결실에 의해 변형될 수 있다. 한 구체예에서, RuvC-유사 도메인 및 HNH-유사 도메인 둘 모두 뉴클레아제 활성을 제거하기 위한 하나 또는 그 이상의 돌연변이 및/또는 결실을 포함한다. 가령, 촉매적으로 비활성 CRISPR/Cas 단백질은 촉매적으로 비활성 (죽은) Cas9 (dCas9)일 수 있는데, 여기서 RuvC-유사 도메인은 D10A, D8A, E762A 및/또는 D986A 돌연변이를 포함하고, 그리고 HNH-유사 도메인은 H840A, H559A, N854A, N856A 및/또는 N863A 돌연변이를 포함한다. 대안으로, 촉매적으로 비활성 CRISPR/Cas 단백질은 뉴클레아제 도메인에서 필적하는 돌연변이를 포함하는 촉매적으로 비활성 (죽은) Cpf1 단백질일 수 있다. 다른 양상에서, 프로그램가능 DNA 결합 단백질은 상기 섹션 (I)(a)(ii)에서 상술된 바와 같은, 이중 가닥 서열 중에서 한쪽 가닥의 틈내기를 하도록 변형된 CRISPR/Cas 단백질 (다시 말하면, 틈내기효소)일 수 있다.
다른 구체예에서, 최소한 하나의 프로그램가능 DNA 결합 단백질은 뉴클레아제 활성이 돌연변이 및/또는 결실에 의해 제거된 촉매적으로 비활성 메가뉴클레아제일 수 있다, 가령, 촉매적으로 비활성 메가뉴클레아제는 C 말단 절두를 포함할 수 있다. 또 다른 구체예에서, 최소한 하나의 프로그램가능 DNA 결합 단백질은 아연 핑거 단백질 또는 전사 활성인자-유사 작동체 (TALE)일 수 있다. 추가 구체예에서, 최소한 하나의 프로그램가능 DNA 결합 단백질은 CRISPR/Cas 틈내기효소, ZFN 틈내기효소, TALEN 틈내기효소, 또는 메가뉴클레아제 틈내기효소일 수 있다. ZFN, TALEN 및 메가뉴클레아제 틈내기효소는 이러한 틈내기효소가 이중 가닥 서열 중에서 단지 하나의 가닥만을 개열하도록, 뉴클레아제 도메인 또는 절반 도메인 중에서 한 가지에서 돌연변이 및/또는 결실을 포함한다.
프로그램가능 DNA 결합 단백질은 또한, 최소한 하나의 핵 국부화 신호, 세포-투과성 도메인, 마커 도메인 및/또는 검출가능한 표지를 포함할 수 있는데, 이들은 상기 섹션 (I)(a)(i)에서 상술된다.
(c) 프로그램가능 DNA 변형 단백질 또는 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산
섹션 (I)(a)에서 전술된 프로그램가능 DNA 변형 단백질, 또는 섹션 (I)(b)에서 전술된 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산은 DNA 또는 RNA, 선형 또는 환상, 단일 가닥 또는 이중 가닥일 수 있다. RNA 또는 DNA는 관심되는 진핵 세포에서 단백질로의 효율적인 번역을 위해 코돈 최적화될 수 있다. 코돈 최적화 프로그램은 프리웨어로서 또는 상업적인 공급원으로부터 가용하다.
일부 구체예에서, 프로그램가능 DNA 변형 단백질 또는 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산은 mRNA일 수 있다. mRNA는 시험관내에서 합성될 수 있다. 이를 위해, DNA 변형 단백질 또는 최소한 하나의 DNA 결합 단백질을 인코딩하는 DNA는 mRNA의 시험관내 합성을 위해 파지 RNA 중합효소에 의해 인식되는 프로모터 서열에 작동가능하게 연결될 수 있다. 가령, 프로모터 서열은 T7, T3 또는 SP6 프로모터 서열, 또는 T7, T3 또는 SP6 프로모터 서열의 변이일 수 있다. 이런 구체예에서, 시험관내-전사된 RNA는 정제되고, 캡핑되고 및/또는 폴리아데닐화될 수 있다. 아래에 상술된 바와 같이, DNA 변형 단백질 또는 DNA 결합 단백질을 인코딩하는 DNA는 벡터의 부분일 수 있다.
다른 구체예에서, 프로그램가능 DNA 변형 단백질 또는 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산은 DNA일 수 있다. 프로그램가능 DNA 변형 단백질 또는 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 DNA 서열은 관심되는 세포에서 발현을 위해 최소한 하나의 프로모터 제어 서열에 작동가능하게 연결될 수 있다. 일부 구체예에서, DNA 코딩 서열은 또한, 폴리아데닐화 신호 (가령, SV40 폴리A 신호, 소 성장 호르몬 (BGH) 폴리A 신호 등) 및/또는 최소한 하나의 전사 종결 서열에 연결될 수 있다.
일정한 구체예에서, DNA 코딩 서열은 세균 (가령, 대장균 (E. coli)) 세포 또는 진핵 (가령, 효모, 곤충 또는 포유류) 세포에서 DNA 변형 단백질 또는 DNA 결합 단백질의 발현을 위해 프로모터 서열에 작동가능하게 연결될 수 있다. 적합한 세균 프로모터는 제한 없이, T7 프로모터, lac 오페론 프로모터, trp 프로모터, tac 프로모터 (이들은 trp 및 lac 프로모터의 하이브리드이다), 전술한 것들 중에서 한 가지의 변이, 그리고 전술한 것들의 임의의 조합을 포함한다. 적합한 진핵 프로모터의 무제한적 실례는 구조성, 조절된, 또는 세포- 또는 조직-특이적 프로모터를 포함한다. 적합한 진핵 구조성 프로모터 제어 서열은 시토메갈로바이러스 극초기 프로모터 (CMV), 유인원 바이러스 (SV40) 프로모터, 아데노바이러스 주요 후기 프로모터, 라우스 육종 바이러스 (RSV) 프로모터, 생쥐 유방 종양 바이러스 (MMTV) 프로모터, 포스포글리세린산 키나아제 (PGK) 프로모터, 연장 인자 (ED1)-알파 프로모터, 유비퀴틴 프로모터, 액틴 프로모터, 튜불린 프로모터, 면역글로불린 프로모터, 이들의 단편, 또는 전술한 것들의 임의의 조합을 포함하지만 이들에 한정되지 않는다. 적합한 진핵 조절된 프로모터 제어 서열의 실례는 제한 없이, 열 충격, 금속, 스테로이드, 항생제, 또는 알코올에 의해 조절되는 것들을 포함한다. 조직 특이적 프로모터의 무제한적 실례는 B29 프로모터, CD14 프로모터, CD43 프로모터, CD45 프로모터, CD68 프로모터, 데스민 프로모터, 엘라스타아제-1 프로모터, 엔도글린 프로모터, 섬유결합소 프로모터, Flt-1 프로모터, GFAP 프로모터, GPIIb 프로모터, ICAM-2 프로모터, INF-β 프로모터, Mb 프로모터, NphsI 프로모터, OG-2 프로모터, SP-B 프로모터, SYN1 프로모터, 그리고 WASP 프로모터를 포함한다. 프로모터 서열은 야생형일 수 있거나, 또는 이것은 더욱 효율적인 또는 유효한 발현을 위해 변형될 수 있다.
다양한 구체예에서, 프로그램가능 DNA 변형 단백질 및/또는 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산은 벡터 내에 존재할 수 있다. 적합한 벡터는 플라스미드 벡터, 파지미드, 코스미드, 인공/꼬마염색체, 트랜스포손, 그리고 바이러스 벡터 (가령, 렌티바이러스 벡터, 아데노 연관된 바이러스 벡터, 아데노바이러스 벡터 등)를 포함한다. 한 구체예에서, 프로그램가능 DNA 변형 단백질 및/또는 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 DNA는 플라스미드 벡터 내에 존재할 수 있다. 적합한 플라스미드 벡터의 무제한적 실례는 pUC, pBR322, pET, pBluescript, 그리고 이들의 변이체를 포함한다. 다른 구체예에서, 프로그램가능 DNA 변형 단백질 및/또는 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산은 바이러스 벡터 내에 존재할 수 있다. 플라스미드 또는 바이러스 벡터는 추가 발현 제어 서열 (가령, 인핸서 서열, 코자크 서열, 폴리아데닐화 서열, 전사 종결 서열 등), 선별가능 마커 서열 (가령, 항생제 내성 유전자), 복제 기점, 기타 등등을 더욱 포함할 수 있다. 추가 정보는 "Current Protocols in Molecular Biology" Ausubel et al., John Wiley & Sons, New York, 2003 또는 "Molecular Cloning: A Laboratory Manual" Sambrook & Russell, Cold Spring Harbor Press, Cold Spring Harbor, NY, 3rd edition, 2001에서 발견될 수 있다.
프로그램가능 DNA 변형 단백질 및/또는 최소한 하나의 프로그램가능 DNA 결합 단백질이 CRISPR/Cas 단백질 또는 이의 변이체를 포함하는 구체예에서, 상기 프로그램가능 DNA 변형 단백질 및/또는 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산을 포함하는 발현 벡터는 하나 또는 그 이상의 안내 RNA를 인코딩하는 서열을 더욱 포함할 수 있다. 안내 RNA를 인코딩하는 서열은 일반적으로, 관심되는 진핵 세포에서 안내 RNA의 발현을 위해 최소한 하나의 전사 제어 서열에 작동가능하게 연결된다. 가령, 안내 RNA를 인코딩하는 핵산은 RNA 중합효소 III (Pol III)에 의해 인식되는 프로모터 서열에 작동가능하게 연결될 수 있다. 적합한 Pol III 프로모터의 실례는 포유류 U6, U3, H1 및 7SL RNA 프로모터를 포함하지만 이들에 한정되지 않는다.
(d) 특정한 조성물
일부 구체예에서, 프로그램가능 DNA 변형 단백질 및 하나 또는 그 이상의 프로그램가능 DNA 결합 단백질은 단백질로서 (또는, 일부 경우에, 단백질-RNA 복합체로서) 제공된다. 프로그램가능 DNA 변형 단백질 및 프로그램가능 DNA 결합 단백질은 세균 또는 진핵 세포에서 발현될 수 있고, 그리고 당해 분야에서 널리 공지된 수단을 이용하여 정제될 수 있다. 다른 구체예에서, 프로그램가능 DNA 변형 단백질 및 하나 또는 그 이상의 프로그램가능 DNA 결합 단백질은 인코딩 핵산으로서 제공된다.
일부 구체예에서, 조성물은 하나의 프로그램가능 DNA 결합 단백질/시스템 또는 인코딩 핵산을 포함할 수 있다. 다른 구체예에서, 조성물은 2개의 프로그램가능 DNA 결합 단백질/시스템 또는 인코딩 핵산을 포함할 수 있다. 또 다른 구체예에서, 조성물은 3개의 프로그램가능 DNA 결합 단백질/시스템 또는 인코딩 핵산을 포함할 수 있다. 추가 구체예에서, 조성물은 4개의 프로그램가능 DNA 결합 단백질/시스템 또는 인코딩 핵산을 포함할 수 있다. 또 다른 구체예에서, 조성물은 5개 또는 그 이상의 프로그램가능 DNA 결합 단백질/시스템 또는 인코딩 핵산을 포함할 수 있다.
특정한 구체예에서, 프로그램가능 DNA 변형 단백질은 CRISPR/Cas 시스템 (가령, 비-뉴클레아제 변형 도메인에 연결된 CRISPR/Cas 뉴클레아제, CRISPR/Cas 이중 틈내기효소, 또는 촉매적으로 비활성 (죽은) CRISPR/Cas 단백질)을 포함할 수 있고, 그리고 프로그램가능 DNA 결합 단백질은 뉴클레아제 활성을 결여하는 CRISPR/Cas 시스템일 수 있다. 가령, 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 시스템일 수 있다. 일반적으로, 각 CRISPR/Cas 단백질은 최소한 하나의 핵 국부화 신호를 포함한다. 일부 반복에서, 조성물은 CRISPR/Cas 단백질 및 안내 RNA로서 CRISPR/Cas 시스템을 포함할 수 있는데, 여기서 상기 단백질 및 RNA는 별개의 실체일 수 있거나, 또는 상기 단백질 및 RNA는 함께 복합화될 수 있다. 안내 RNA는 최소한 부분적으로, 화학적으로 합성될 수 있다. 안내 RNA는 효소적으로 합성될 수 있다. 다른 반복에서, 조성물은 CRISPR/Cas 단백질 및 안내 RNA를 인코딩하는 DNA를 포함할 수 있다. 또 다른 반복에서, 조성물은 CRISPR/Cas 단백질을 인코딩하는 mRNA 및 안내 RNA를 인코딩하는 DNA를 포함할 수 있다. 또 다른 반복에서, 조성물은 CRISPR/Cas 단백질 및/또는 안내 RNA를 인코딩하는 플라스미드 또는 바이러스 벡터를 포함할 수 있다. 일정한 구체예에서, 촉매적으로 활성 CRISPR/Cas 단백질 및 촉매적으로 비활성 (죽은) CRISPR/Cas 단백질은 Cas9 단백질이다. CRISPR/Cas 단백질을 인코딩하는 핵산은 일반적으로, 관심되는 진핵 세포에서 최적 발현을 위해 코돈 최적화된다.
(II) 키트
본 발명의 추가 양상은 상기 섹션 (I)에서 상술된 조성물을 포함하는 키트를 제공한다. 키트는 상기 상술된 바와 같이, 프로그램가능 DNA 변형 단백질 및 최소한 하나의 프로그램가능 DNA 결합 단백질을 단백질로서, 단백질-RNA 복합체로서, 또는 다양한 성분을 인코딩하는 핵산으로서 제공할 수 있다. 키트는 형질감염 시약, 세포 성장 배지, 선별 배지, 시험관내 전사 시약, 핵산 정제 시약, 단백질 정제 시약, 완충액, 기타 등등을 더욱 포함할 수 있다. 본원에서 제공된 키트는 일반적으로, 아래에 상술된 방법을 실행하기 위한 사용설명서를 포함한다. 키트 내에 포함되는 사용설명서는 포장 재료에 부착될 수 있거나, 또는 포장 삽입물로서 포함될 수 있다. 사용설명서는 전형적으로 서면 또는 인쇄된 자료이지만, 이런 것들에 한정되지 않는다. 이런 사용설명서를 저장하고 이들을 최종 사용자에게 통신할 수 있는 임의의 매체가 본 발명에 의해 예기된다. 이런 매체는 전자 저장 매체 (가령, 자성 디스크, 테이프, 카트리지, 칩), 광학 매체 (가령, CD ROM), 기타 등등을 포함하지만 이들에 한정되지 않는다. 본원에서 이용된 바와 같이, 용어 "사용설명서"는 사용설명서를 제공하는 인터넷 사이트의 주소를 포함할 수 있다.
일부 구체예에서, 키트의 프로그램가능 DNA 변형 단백질 및/또는 최소한 하나의 프로그램가능 DNA 결합 단백질은 II형 CRISPR/Cas 시스템을 포함할 수 있다. 일정한 구체예에서, II형 CRISPR/Cas 시스템의 안내 RNA는 crRNA 및 tracrRNA를 포함할 수 있다. 키트는 이런 이유로, 보편적인 tracrRNA(들)를 제공할 수 있고, 그리고 키트의 최종 사용자는 서열-특이적 crRNA(들)를 제공할 수 있다. 일부 양상에서, 키트는 II형 CRISPR/Cas 단백질(들) 및 tracrRNA(들)를 포함할 수 있다. 다른 양상에서, 키트는 II형 CRISPR/Cas 단백질(들)을 인코딩하는 mRNA 또는 DNA 및 tracrRNA(들)를 인코딩하는 DNA를 포함할 수 있다.
또 다른 구체예에서, 키트의 프로그램가능 DNA 변형 단백질 및/또는 최소한 하나의 프로그램가능 DNA 결합 단백질은 V형 CRISPR/Cas 시스템을 포함할 수 있다. 상기 상술된 바와 같이, V형 CRISPR/Cas 시스템의 안내 RNA는 단지 crRNA만을 포함한다. 일부 양상에서, 키트는 V형 CRISPR/Cas 단백질(들) 및 crRNA(들)를 포함할 수 있고, 또는 키트는 V형 CRISPR/Cas 단백질(들)을 인코딩하는 mRNA 또는 DNA 및 crRNA(들)를 인코딩하는 DNA를 포함할 수 있다, 다른 양상에서, 키트는 단지 V형 CRISPR/Cas 단백질(들) 또는 V형 CRISPR/Cas 단백질(들)을 인코딩하는 핵산만을 포함할 수 있는데, 여기서 키트의 최종 사용자가 crRNA(들)를 제공한다.
(III) 표적화된 염색체 부위에 접근성을 증가시키기 위한 방법
본 발명의 다른 양상은 염색체 DNA 내에 표적 서열에 대한 프로그램가능 DNA 변형 단백질의 접근성을 증가시킴으로써 진핵 세포에서 표적화된 유전체/후성 변형의 효율 및/또는 특이성을 증가시키기 위한 방법을 포괄한다. 이들 방법은 (a) 프로그램가능 DNA 변형 단백질 또는 상기 프로그램가능 DNA 변형 단백질을 인코딩하는 핵산 및 (b) 최소한 하나의 프로그램가능 DNA 결합 단백질 또는 상기 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산을 관심되는 진핵 세포 내로 도입하는 것을 포함한다. 프로그램가능 DNA 변형 단백질은 염색체 DNA 내에 표적 서열을 인식하고 이것에 결합하도록 가공되는데, 상기 부위에서 DNA 변형 단백질은 DNA 또는 연관된 단백질(들)을 변형할 수 있다. 하나 또는 그 이상의 프로그램가능 DNA 결합 단백질 각각은 DNA 변형 단백질의 표적 염색체 서열의 근위 서열을 인식하고 이것에 결합하도록 가공된다. 프로그램가능 DNA 변형 단백질 및 프로그램가능 DNA 결합 단백질은 상기 섹션 (I)에서 상술된다.
일반적으로, 표적 염색체 서열의 근위 서열은 표적 염색체 서열의 어느 한쪽 측면 상에서 (다시 말하면, 상류 또는 하류에서) 약 250개 염기쌍 내에 위치된다. 근위 부위(들)는 이중나선 DNA의 어느 한쪽 가닥 상에 위치될 수 있다. 일부 구체예에서, 표적 염색체 서열의 근위 서열은 DNA 변형 단백질의 표적 염색체 서열로부터 약 250개 bp 이내에, 약 200개 bp 이내에, 약 150개 bp 이내에, 약 100개 bp 이내에, 약 75개 bp 이내에, 약 50개 bp 이내에, 약 25개 bp 이내에, 약 20개 bp 이내에, 약 15개 bp 이내에, 약 10개 bp 이내에, 또는 약 5개 bp 이내에 위치될 수 있다. 일정한 구체예에서, 표적 염색체 서열의 근위 서열은 표적 염색체 서열의 어느 한쪽 측면 상에서 약 1 bp 내지 약 10 bp, 약 11 bp 내지 약 20 bp, 약 21 bp 내지 약 30 bp, 약 31 bp 내지 약 40 bp, 약 41 bp 내지 약 50 bp, 약 51 bp 내지 약 60 bp, 약 61 bp 내지 약 70 bp, 약 71 bp 내지 약 80 bp, 약 81 bp 내지 약 90 bp, 약 91 bp 내지 약 100 bp, 약 101 bp 내지 약 150 bp, 약 151 bp 내지 약 200 bp, 또는 약 201 bp 내지 약 250 bp에 위치될 수 있다. 다른 구체예에서, 표적 염색체 서열의 근위 서열은 표적 염색체 서열의 어느 한쪽 측면 상에서 약 5 bp 내지 약 75 bp, 약 10 bp 내지 약 50 bp, 또는 약 15 bp 내지 약 25 bp에 위치될 수 있다.
일부 구체예에서, 상기 방법은 결합 서열이 표적 염색체 서열의 상류 또는 하류에 위치되는 최소한 하나의 프로그램가능 DNA 결합 단백질을 세포 내로 도입하는 것을 포함한다. 다른 구체예에서, 상기 방법은 최소한 2개의 프로그램가능 DNA 결합 단백질을 세포 내로 도입하는 것을 포함하는데, 여기서 하나의 결합 서열은 표적 염색체 서열의 상류에 위치되고, 그리고 다른 하나의 결합 서열은 표적 염색체 서열의 하류에 위치된다. 추가 구체예에서, 상기 방법은 결합 서열이 표적 염색체 서열의 상류 또는 하류에 위치되는 최소한 3개의 프로그램가능 DNA 결합 단백질을 세포 내로 도입하는 것을 포함한다. 추가 구체예에서, 상기 방법은 결합 서열이 표적 염색체 서열의 상류 또는 하류에 위치되는 4개 또는 그 이상의 프로그램가능 DNA 결합 단백질을 세포 내로 도입하는 것을 포함한다. 이들 구체예에서, 예로서, 상기 방법은 결합 서열이 표적 염색체 서열의 어느 한쪽 측면 상에서 (다시 말하면, 상류 또는 하류에서) 약 250개 bp 내에 위치되는 1개, 2개, 3개, 4개, 5개, 6개, 7개, 8개, 9개, 10개 또는 10개보다 많은 프로그램가능 DNA 결합 단백질을 도입하는 것을 포함할 수 있다.
표적 염색체 서열의 근위 부위에 하나 또는 그 이상의 프로그램가능 DNA 결합 단백질 각각의 결합은 국부 염색질 형상을 변화시켜, (이전에 접근불가능했던) 표적 염색체 서열에 대한 프로그램가능 DNA 변형 단백질의 증가된 접근성을 야기한다 (도면 1을 참조한다). 결과로서, DNA 변형 단백질에 의한 변형의 효율이 증가된다 (가령, 실시예 1-3을 참조한다). 달리 말하면, DNA 변형 단백질에 의한 변형의 효율은 DNA 변형 단백질이 단독으로 세포 내로 도입될 때와 비교하여, DNA 변형 단백질이 하나 또는 그 이상의 프로그램가능 DNA 결합 단백질과 조합으로 세포 내로 도입될 때 증가된다.
게다가, 본원에서 개시된 방법은 표적화된 유전체 변형의 특이성을 증가시킨다. 비록 프로그램가능 DNA 변형 단백질이 특정한 염색체 좌위 내에 표적 서열을 인식하고 이것에 결합하도록 가공되긴 하지만, 동일한 또는 거의 동일한 서열이 다른 염색체 위치에서 존재할 수 있다 (부정확한 효과를 유발). 표적 염색체 서열에 프로그램가능 DNA 변형 단백질의 결합이 표적 염색체 서열의 근위 서열에 하나 또는 그 이상의 프로그램가능 DNA 결합 단백질의 결합에 주로 의존하는 구체예에서, 관심되는 염색체 좌위 내에 표적 서열의 근위 부위(들)에 하나 또는 그 이상의 프로그램가능 DNA 결합 단백질의 결합은 하지만, 변형 사건에 추가적인 특이성을 제공한다 (실시예 4를 참조한다).
따라서, 본원에서 개시된 방법은 표적화된 유전체 편집 (가령, 유전자 교정, 유전자 녹아웃, 유전자 녹인 등), 표적화된 후성 변형, 그리고 표적화된 전사 조절의 효율 및/또는 특이성을 증가시킬 수 있다.
(a) 세포 내로 도입
설명된 바와 같이, 상기 방법은 (a) 프로그램가능 DNA 변형 단백질 또는 상기 프로그램가능 DNA 변형 단백질을 인코딩하는 핵산 및 (b) 최소한 하나의 프로그램가능 DNA 결합 단백질 또는 상기 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산을 세포 내로 도입하는 것을 포함한다. 프로그램가능 DNA 변형 단백질은 상기 섹션 (I)(a)에서 상술되고, 프로그램가능 DNA 결합 단백질은 상기 섹션 (I)(b)에서 상술되고, 그리고 DNA 변형 단백질 또는 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산은 섹션 (I)(c)에서 전술된다.
프로그램가능 DNA 변형 단백질 또는 상기 프로그램가능 DNA 변형 단백질을 인코딩하는 핵산 및 최소한 하나의 프로그램가능 DNA 결합 단백질 또는 상기 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산은 다양한 수단에 의해 관심되는 세포 내로 도입될 수 있다.
일부 구체예에서, 세포는 적절한 분자 (다시 말하면, 단백질, DNA 및/또는 RNA)로 형질감염될 수 있다. 적합한 형질감염 방법은 뉴클레오펙션 (또는 전기천공), 인산칼슘-매개된 형질감염, 양이온성 중합체 형질감염 (가령, DEAE-덱스트란 또는 폴리에틸렌이민), 바이러스 형질도입, 비로솜 형질감염, 비리온 형질감염, 리포솜 형질감염, 양이온성 리포솜 형질감염, 면역리포솜 형질감염, 비리포솜 지질 형질감염, 덴드리머 형질감염, 열 충격 형질감염, 마그네토펙션, 리포펙션, 유전자 총 전달, 임팔레펙션, 소노포레이션, 광학적 형질감염, 그리고 핵산의 독점 작용제-증강된 흡수를 포함한다. 형질감염 방법은 당해 분야에서 널리 공지된다 (가령, "Current Protocols in Molecular Biology" Ausubel et al., John Wiley & Sons, New York, 2003 또는 "Molecular Cloning: A Laboratory Manual" Sambrook & Russell, Cold Spring Harbor Press, Cold Spring Harbor, NY, 3rd edition, 2001을 참조한다). 다른 구체예에서, 이들 분자는 미량주사에 의해 세포 내로 도입될 수 있다. 가령, 이들 분자는 관심되는 세포의 세포질 또는 핵 내로 주사될 수 있다. 세포 내로 도입되는 각 분자의 양은 변할 수 있지만, 당업자는 적절한 양을 결정하기 위한 수단에 익숙하다.
다양한 분자가 세포 내로 동시에 또는 순차적으로 도입될 수 있다. 가령, 프로그램가능 DNA 변형 단백질 (또는 이의 인코딩 핵산) 및 최소한 하나의 프로그램가능 DNA 결합 단백질 (또는 인코딩 핵산)이 동시에 도입될 수 있다. 대안으로, 하나가 먼저 세포 내로 도입될 수 있고, 그리고 이후, 다른 하나가 추후 세포 내로 도입될 수 있다.
일반적으로, 세포는 세포 성장 및/또는 유지에 적합한 조건 하에 유지된다. 적합한 세포 배양 조건은 당해 분야에서 널리 공지되고, 그리고 가령, Santiago et al., Proc. Natl. Acad. Sci. USA, 2008, 105:5809-5814; Moehle et al. Proc. Natl. Acad. Sci. USA, 2007, 104:3055-3060; Urnov et al., Nature, 2005, 435:646-651; 및 Lombardo et al., Nat. Biotechnol., 2007, 25:1298-1306에서 설명된다. 당업자는 세포를 배양하기 위한 방법이 당해 분야에서 공지되고, 그리고 세포 유형에 따라 변할 수 있고 변할 것이라는 것을 인지한다. 특정 세포 유형에 대한 최적 기술을 결정하기 위해, 모든 사례에서, 일과적인 최적화가 이용될 수 있다.
(b) 표적화된 유전체 변형
표적 염색체 서열의 근위 서열(들)에 하나 또는 그 이상의 프로그램가능 DNA 결합 단백질의 결합은 국부 염색질 형상을 변화시킨다, 예를 들면, 뉴클레오솜 구조가 변경될 수 있고 및/또는 히스톤이 이동될 수 있다. 결과로서, 프로그램가능 DNA 변형 단백질은 프로그램가능 DNA 변형 단백질이 단독으로 이용될 때와 비교하여, 표적 염색체 서열에 더욱 잘 접근할 수 있다. 증가된 접근성은 표적화된 유전체 변형의 증가된 효율 및/또는 특이성을 유발한다. 표적화된 유전체/후성 변형은 뉴클레아제 활성 또는 비-뉴클레아제 활성을 갖는 DNA 변형 단백질에 의해 매개될 수 있다.
프로그램가능 DNA 변형 단백질이 뉴클레아제 활성을 갖는 구체예에서, DNA 변형 단백질은 표적화된 염색체 서열에서 이중 가닥 절단을 도입할 수 있다. 염색체 서열에서 이중 가닥 절단은 비상동성 말단 연결 (NHEJ) 수복 과정에 의해 수복될 수 있다. NHEJ가 오류가 발생하기 쉽기 때문에, 최소한 하나의 뉴클레오티드의 결실, 최소한 하나의 뉴클레오티드의 삽입, 최소한 하나의 뉴클레오티드의 치환, 또는 이들의 조합이 절단의 수복 동안 발생할 수 있다. 따라서, 표적화된 염색체 서열은 변형되거나 또는 비활성화될 수 있다. 가령, 코딩 서열의 해독틀에서 이동 동안 결실, 삽입 또는 치환은 변경된 단백질 산물, 또는 단백질 산물 없음 (이것은 "녹아웃"으로 명명된다)을 야기할 수 있다. 일부 반복에서, 상기 방법은 상동성 지향된 수복 과정 (HDR)에 의한 이중 가닥 절단의 수복 동안 공여자 폴리뉴클레오티드 내에 공여자 서열이 표적 염색체 서열에서 염색체 서열과 교체되거나 또는 이것 내로 통합될 수 있도록, 표적 염색체 서열의 어느 한쪽 측면 상에 위치된 서열에 실제적인 서열 동일성을 갖는 서열과 측면에서 접하는 공여자 서열을 포함하는 공여자 폴리뉴클레오티드 (하기를 참조한다)를 세포 내로 도입하는 것을 더욱 포함할 수 있다. 외인성 서열의 통합은 "녹인"으로 명명된다. 상기 상술된 바와 같이, 본원에서 개시된 방법은 또한, 부정확한 효과를 감소시키고, 따라서 표적화된 유전체 변형의 특이성을 증가시킨다.
다양한 반복에서, 이런 이유로, 표적화된 유전체 변형의 효율 및/또는 특이성은 뉴클레아제 활성을 갖는 프로그램가능 DNA 변형 단백질이 단독으로 이용될 때에 비하여, 최소한 약 0.1-배, 최소한 약 0.5-배, 최소한 약 1-배, 최소한 약 2-배, 최소한 약 5-배, 최소한 약 10-배, 또는 최소한 약 20-배, 최소한 약 50-배, 최소한 약 100-배, 또는 약 100-배보다 많이 증가될 수 있다. 가령, 뉴클레아제 활성을 갖는 프로그램가능 DNA 변형 단백질은 단독으로 이용될 때, 검출가능한 삽입-결실 또는 통합 사건이 없을 수 있다. 하지만, 뉴클레아제 활성을 갖는 프로그램가능 DNA 변형 단백질이 최소한 하나의 프로그램가능 DNA 결합 단백질과 조합으로 이용될 때, 삽입-결실 및 통합 사건이 검출될 수 있다 (가령, 최소한 약 1% 삽입-결실/통합, 최소한 약 5% 삽입-결실/통합, 최소한 약 10% 삽입-결실/통합, 최소한 약 20% 삽입-결실/통합, 최소한 약 30% 삽입-결실/통합, 최소한 약 40% 삽입-결실/통합, 최소한 약 50% 삽입-결실/통합, 또는 약 50%보다 많은 삽입-결실/통합).
프로그램가능 DNA 변형 단백질이 비-뉴클레아제 활성을 갖는 구체예에서, DNA 변형 단백질은 표적 염색체 서열에서 DNA 또는 연관된 단백질을 변형하거나 또는 표적 염색체 서열의 발현을 변형할 수 있다. 가령, 프로그램가능 DNA 변형 단백질이 후성 변형 활성을 포함할 때, 히스톤 아세틸화, 메틸화, 인산화, 아데닐화 등의 상태가 변경될 수 있거나, 또는 DNA 메틸화, 아미노화 등의 상태가 변경될 수 있다. 실례로서, 프로그램가능 DNA 변형 단백질이 시토신 탈아미노효소 활성을 포함하는 구체예에서, 표적 염색체 서열에서 하나 또는 그 이상의 시토신 잔기가 우라실 잔기로 전환될 수 있다. 대안으로, 프로그램가능 DNA 변형 단백질이 전사 활성화 또는 억제인자 활성을 포함할 때, 표적 염색체 서열에서 전사가 증가되거나 또는 감소될 수 있다. 비-뉴클레아제 활성을 갖는 프로그램가능 DNA 변형 단백질이 단독으로 이용될 때에 비하여, 결과의 후성 변형 또는 전사 조절이 약 0.1-배, 최소한 약 0.5-배, 최소한 약 1-배, 최소한 약 2-배, 최소한 약 5-배, 최소한 약 10-배, 또는 최소한 약 20-배, 최소한 약 50-배, 최소한 약 100-배, 또는 약 100-배보다 많이 증가될 수 있다.
상기 상술된 표적화된 유전체 변형/후성 변형은 단독적으로 수행되거나 또는 다중화될 수 있다 (다시 말하면, 2개 또는 그 이상의 염색체 서열이 동시에 표적화될 수 있다).
(c) 임의선택적 공여자 폴리뉴클레오티드
프로그램가능 DNA 변형 단백질이 뉴클레아제 활성을 포함하는 구체예에서, 상기 방법은 최소한 하나의 공여자 폴리뉴클레오티드를 세포 내로 도입하는 것을 더욱 포함할 수 있다. 공여자 폴리뉴클레오티드는 단일 가닥 또는 이중 가닥, 선형 또는 환상 및/또는 RNA 또는 DNA일 수 있다. 일부 구체예에서, 공여자 폴리뉴클레오티드는 벡터, 예를 들면, 플라스미드 벡터일 수 있다.
공여자 폴리뉴클레오티드는 최소한 하나의 공여자 서열을 포함한다. 일부 양상에서, 공여자 폴리뉴클레오티드의 공여자 서열은 내인성 또는 선천적 염색체 서열의 변형된 버전일 수 있다. 가령, 공여자 서열은 DNA 변형 단백질에 의해 표적화된 서열에서 또는 이와 가깝게 염색체 서열의 부분과 본질적으로 동일할 수 있지만, 최소한 하나의 뉴클레오티드 변화를 포함한다. 따라서, 선천적 서열과의 통합 또는 교체 시에, 표적화된 염색체 위치에서 서열은 최소한 하나의 뉴클레오티드 변화를 포함한다. 가령, 변화는 하나 또는 그 이상의 뉴클레오티드의 삽입, 하나 또는 그 이상의 뉴클레오티드의 결실, 하나 또는 그 이상의 뉴클레오티드의 치환, 또는 이들의 조합일 수 있다. 변형된 서열의 "유전자 교정" 통합의 결과로서, 세포는 표적화된 염색체 서열로부터 변경된 유전자 산물을 생산할 수 있다.
다른 양상에서, 공여자 폴리뉴클레오티드의 공여자 서열은 외인성 서열일 수 있다. 본원에서 이용된 바와 같이, "외인성" 서열은 세포에 선천적이지 않은 서열, 또는 선천적 위치가 세포의 유전체 내에 상이한 위치에 있는 서열을 지칭한다. 가령, 외인성 서열은 단백질 코딩 서열을 포함할 수 있는데, 이것은 유전체 내로 통합 시에 세포가 통합된 서열에 의해 코딩된 단백질을 발현할 수 있도록, 외인성 프로모터 제어 서열에 작동가능하게 연결될 수 있다. 대안으로, 외인성 서열은 이의 발현이 내인성 프로모터 제어 서열에 의해 조절되도록, 염색체 서열 내로 통합될 수 있다. 다른 반복에서, 외인성 서열은 전사 제어 서열, 다른 발현 제어 서열, RNA 코딩 서열, 기타 등등일 수 있다. 전술한 바와 같이, 염색체 서열 내로 외인성 서열의 통합은 "녹인"으로 명명된다.
당업자에 의해 인지될 수 있는 바와 같이, 공여자 서열의 길이는 변할 수 있고 변할 것이다. 가령, 공여자 서열은 길이에서 몇몇 뉴클레오티드로부터 수백 개의 뉴클레오티드 내지 수십만 개의 뉴클레오티드까지 변할 수 있다.
전형적으로, 공여자 폴리뉴클레오티드에서 공여자 서열은 상류 서열 및 하류 서열과 측면에서 접하는데, 이들 서열은 각각, 프로그램가능 DNA 변형 단백질에 의해 표적화된 서열의 상류 및 하류에 위치된 서열과 실제적인 서열 동일성을 갖는다. 이들 서열 유사성 때문에, 공여자 폴리뉴클레오티드의 상류 및 하류 서열은 공여자 서열이 염색체 서열 내로 통합 (또는 염색체 서열과 교체)될 수 있도록, 공여자 폴리뉴클레오티드 및 표적화된 염색체 서열 사이에 상동성 재조합을 허용한다.
상류 서열은 본원에서 이용된 바와 같이, 프로그램가능 DNA 변형 단백질에 의해 표적화된 서열의 상류에 염색체 서열과 실제적인 서열 동일성을 공유하는 핵산 서열을 지칭한다. 유사하게, 하류 서열은 프로그램가능 DNA 변형 단백질에 의해 표적화된 서열의 하류에 염색체 서열과 실제적인 서열 동일성을 공유하는 핵산 서열을 지칭한다. 본원에서 이용된 바와 같이, 관용구 "실제적인 서열 동일성"은 최소한 약 75% 서열 동일성을 갖는 서열을 지칭한다. 따라서, 공여자 폴리뉴클레오티드에서 상류 및 하류 서열은 표적 서열의 상류 또는 하류에 서열과 약 75%, 76%, 77%, 78%, 79%, 80%, 81%, 82%, 83%, 84%, 85%, 86%, 87%, 88%, 89%, 90%, 91%, 92%, 93%, 94%, 95%, 96%, 97%, 98%, 또는 99% 서열 동일성을 가질 수 있다. 한 예시적인 구체예에서, 공여자 폴리뉴클레오티드에서 상류 및 하류 서열은 프로그램가능 DNA 변형 단백질에 의해 표적화된 서열의 상류 또는 하류에 염색체 서열과 약 95% 또는 100% 서열 동일성을 가질 수 있다.
일부 구체예에서, 상류 서열은 프로그램가능 DNA 변형 단백질에 의해 표적화된 서열의 즉시 상류에 위치된 염색체 서열과 실제적인 서열 동일성을 공유한다. 다른 구체예에서, 상류 서열은 표적 서열로부터 상류에 약 100개 뉴클레오티드 내에 위치되는 염색체 서열과 실제적인 서열 동일성을 공유한다. 따라서, 예로서, 상류 서열은 표적 서열로부터 상류에 약 1 내지 약 20개, 약 21 내지 약 40개, 약 41 내지 약 60개, 약 61 내지 약 80개, 또는 약 81 내지 약 100개 뉴클레오티드에 위치되는 염색체 서열과 실제적인 서열 동일성을 공유할 수 있다. 일부 구체예에서, 하류 서열은 프로그램가능 DNA 변형 단백질에 의해 표적화된 서열의 즉시 하류에 위치된 염색체 서열과 실제적인 서열 동일성을 공유한다. 다른 구체예에서, 하류 서열은 표적 서열로부터 하류에 약 100개 뉴클레오티드 내에 위치되는 염색체 서열과 실제적인 서열 동일성을 공유한다. 따라서, 예로서, 하류 서열은 표적 서열로부터 하류에 약 1 내지 약 20개, 약 21 내지 약 40개, 약 41 내지 약 60개, 약 61 내지 약 80개, 또는 약 81 내지 약 100개 뉴클레오티드에 위치되는 염색체 서열과 실제적인 서열 동일성을 공유할 수 있다.
각 상류 또는 하류 서열은 길이에서 약 20개 뉴클레오티드 내지 약 5000개 뉴클레오티드의 범위에서 변할 수 있다. 일부 구체예에서, 상류 및 하류 서열은 약 50, 100, 200, 300, 400, 500, 600, 700, 800, 900, 1000, 1100, 1200, 1300, 1400, 1500, 1600, 1700, 1800, 1900, 2000, 2100, 2200, 2300, 2400, 2500, 2600, 2800, 3000, 3200, 3400, 3600, 3800, 4000, 4200, 4400, 4600, 4800, 또는 5000개 뉴클레오티드를 포함할 수 있다. 특정한 구체예에서, 상류 및 하류 서열은 길이에서 약 50 내지 약 1500개 뉴클레오티드의 범위에서 변할 수 있다.
(e) 세포 유형
다양한 세포가 본원에서 개시된 방법에서 이용에 적합하다. 일반적으로, 세포는 진핵 세포이다. 가령, 세포는 인간 포유류 세포, 비인간 포유류 세포, 비포유류 척추동물 세포, 무척추동물 세포, 곤충 세포, 식물 세포, 효모 세포, 또는 단일 세포 진핵 생물체일 수 있다. 일부 구체예에서, 세포는 또한, 단세포 배아, 예를 들면, 쥐, 햄스터, 설치류, 토끼, 고양이, 개, 양, 돼지, 소, 말 및 영장류 배아를 비롯한 비인간 포유류 배아일 수 있다. 또 다른 구체예에서, 세포는 줄기 세포, 예를 들면, 배아 줄기 세포, ES-유사 줄기 세포, 태아 줄기 세포, 성체 줄기 세포 등일 수 있다. 한 구체예에서, 줄기 세포는 인간 배아 줄기 세포가 아니다. 게다가, 줄기 세포는 본원에 전체적으로 참조로서 편입되는 WO2003/046141, 또는 Chung et al. (Cell Stem Cell, 2008, 2:113-117)에서 개시된 기술에 의해 만들어진 것들을 포함할 수 있다. 세포는 시험관내 또는 생체내 (다시 말하면, 생물체 내에)일 수 있다. 예시적인 구체예에서, 세포는 포유류 세포이다. 특정한 구체예에서, 세포는 인간 세포이다.
적합한 포유류 세포의 무제한적 실례는 인간 배아 신장 세포 (HEK293, HEK293T); 인간 경부 암종 세포 (HELA); 인간 폐 세포 (W138); 인간 간 세포 (Hep G2); 인간 U2-OS 골육종 세포, 인간 A549 세포, 인간 A-431 세포 및 인간 K562 세포; 중국 햄스터 난소 (CHO) 세포, 아기 햄스터 신장 (BHK) 세포; 생쥐 골수종 NS0 세포, 생쥐 배아 섬유모세포 3T3 세포 (NIH3T3), 생쥐 B 림프종 A20 세포; 생쥐 흑색종 B16 세포; 생쥐 근모세포 C2C12 세포; 생쥐 골수종 SP2/0 세포; 생쥐 배아 중간엽 C3H-10T1/2 세포; 생쥐 암종 CT26 세포, 생쥐 전립선 DuCuP 세포; 생쥐 가슴 EMT6 세포; 생쥐 간암 Hepa1c1c7 세포; 생쥐 골수종 J5582 세포; 생쥐 상피 MTD-1A 세포; 생쥐 심근 MyEnd 세포; 생쥐 신장 RenCa 세포; 생쥐 췌장 RIN-5F 세포; 생쥐 흑색종 X64 세포; 생쥐 림프종 YAC-1 세포; 쥐 교모세포종 9L 세포; 쥐 B 림프종 RBL 세포; 쥐 신경모세포종 B35 세포; 쥐 간암 세포 (HTC); 버팔로 쥐 간 BRL 3A 세포; 개 신장 세포 (MDCK); 개 유방 (CMT) 세포; 쥐 골육종 D17 세포; 쥐 단핵구/대식세포 DH82 세포; 원숭이 신장 SV-40 형질전환된 섬유모세포 (COS7) 세포; 원숭이 신장 CVI-76 세포; 아프리카 녹색 원숭이 신장 (VERO-76) 세포를 포함한다. 포유류 세포주의 광범위한 목록은 American Type Culture Collection 카탈로그 (ATCC, Manassas, VA)에서 발견될 수 있다.
(IV) 특정한 유전체 좌위를 검출하기 위한 방법
진핵 세포에서 특정한 유전체 좌위를 검출하거나 또는 가시화하기 위한 방법 역시 본원에서 제공된다. 하나 또는 그 이상의 프로그램가능 DNA 결합 단백질(들)의 근위 결합이 염색질 구조를 변경하고, 그리고 이전에 접근불가능했던 염색체 좌위에 대한 프로그램가능 DNA 변형 단백질의 접근을 증가시키기 때문에, 섹션 (III)에서 전술된 방법은 특정한 유전체 좌위 또는 표적화된 염색체 서열의 검출을 증강하도록 변형될 수 있다. 상기 방법은 (a) 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질 또는 최소한 하나의 검출가능한 마커 도메인을 포함하는 상기 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산 및 (b) 최소한 하나의 프로그램가능 DNA 결합 단백질 또는 상기 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산을 진핵 세포 내로 도입하는 것을 포함하고, 여기서 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질은 표적 염색체 서열에 표적화되고, 그리고 하나 또는 그 이상의 프로그램가능 DNA 결합 단백질 각각은 표적 염색체 서열의 근위 부위에 표적화된다. 표적 염색체 서열의 근위 부위에 최소한 하나의 프로그램가능 DNA 결합 단백질의 결합은 표적 염색체 서열에 대한 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질의 접근성을 증가시킨다. 상기 방법은 표적 염색체 서열에 결합된 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질을 검출하는 것을 더욱 포함한다.
최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질은 프로그램가능 DNA 결합 도메인을 포함한다. 적합한 프로그램가능 DNA 결합 도메인은 섹션 (I)(a)(vi)에서 전술된다. 특정한 구체예에서, 프로그램가능 DNA 결합 도메인은 촉매적으로 비활성 CRISPR/Cas 시스템, 촉매적으로 비활성 메가뉴클레아제, 아연 핑거 단백질, 또는 전사 활성인자-유사 작동체일 수 있다. 프로그램가능 DNA 결합 단백질의 최소한 하나의 검출가능한 마커 도메인은 형광 단백질 (가령, GFP, eGFP, RFP 등), 형광 태그, 또는 에피토프 태그일 수 있다 (이들은 섹션 (I)(a)(i)에서 전술된다). 일정한 구체예에서, 프로그램가능 DNA 결합 단백질의 최소한 하나의 검출가능한 마커 도메인은 프로그램가능 DNA 결합 단백질이 프로그램가능 DNA 결합 단백질에 대한 항체에 의해 검출될 수 있도록, 프로그램가능 DNA 결합 단백질 내에 자연발생 에피토프일 수 있다. 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질은 섹션 (I)(a)(i)에서 전술된 바와 같이, 최소한 하나의 핵 국부화 신호 및/또는 세포-투과성 도메인을 더욱 포함할 수 있다. 일부 구체예에서, 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질은 비-뉴클레아제 변형 도메인을 더욱 포함할 수 있다 (상기 섹션 (I)(a)(vi)에서 전술된 바와 같이).
하나 또는 그 이상의 프로그램가능 DNA 결합 단백질은 섹션 (I)(b)에서 전술된다. 일반적으로, 최소한 하나의 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 단백질, 촉매적으로 비활성 메가뉴클레아제, 아연 핑거 단백질, 전사 활성인자-유사 작동체, CRISPR/Cas 틈내기효소, ZFN 틈내기효소, TALEN 틈내기효소, 또는 메가뉴클레아제 틈내기효소일 수 있다.
상기 방법은 표적 염색체 서열에 결합되는 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질을 검출하는 것을 더욱 포함하는데, 여기서 검출은 동적 생존 세포 영상화, 형광 현미경검사, 공초점 현미경검사, 면역형광, 면역검출, RNA-단백질 결합, 단백질-단백질 결합, 기타 등등을 통해 이루어질 수 있다. 검출 단계는 생존 세포 또는 고정된 세포에서 수행될 수 있다.
상기 방법이 생존 세포에서 염색질 구조 동역학을 검출하는 것을 포함하는 구체예에서, 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질 및 하나 또는 그 이상의 프로그램가능 DNA 결합 단백질은 본질적으로 섹션 (III)(a)에서 전술된 바와 같이, 단백질 또는 핵산으로서 세포 내로 도입될 수 있다. 상기 방법이 고정된 세포 내에서 표적화된 염색체 서열을 검출하는 것을 포함하는 구체예에서, 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질 및 최소한 하나의 프로그램가능 DNA 결합 단백질은 단백질 (또는 RNA-단백질 복합체)로서 세포 내로 도입될 수 있다. 세포를 고정시키고 투과하기 위한 수단은 당해 분야에서 널리 공지된다. 일부 구체예에서, 고정된 세포는 이중 가닥 염색체 DNA를 단일 가닥 DNA로 전환하기 위한 화학적 및/또는 열 변성 과정에 종속될 수 있다. 다른 구체예에서, 고정된 세포는 화학적 및/또는 열 변성 과정에 종속되지 않는다.
특정한 구체예에서, 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 (또는 죽은) CRISPR/Cas 단백질 및 형광 단백질 마커 도메인을 포함하는 융합 단백질이고, 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 (또는 죽은) CRISPR/Cas 단백질이다.
프로그램가능 DNA 변형 또는 DNA 결합 단백질 중에서 최소한 하나가 CRISPR/Cas 단백질을 포함하는 구체예에서, 안내 RNA는 원지 검출을 위한 검출가능한 표지 (가령, FISH 또는 CISH)를 더욱 포함할 수 있다. 검출가능한 표지는 상기 섹션 (I)(a)(i)에서 상술된다. 일부 구체예에서, 프로그램가능 DNA 변형 및 DNA 결합 단백질 각각은 CRISPR/Cas 단백질을 포함하고, 그리고 각 안내 RNA는 최소한 하나의 검출가능한 표지를 포함하고, 따라서 검출되는 신호의 양 또는 강도를 증가시킨다.
또 다른 구체예에서, 근위에 결합된 프로그램가능 DNA 변형 단백질 및 하나 또는 그 이상의 프로그램가능 DNA 결합 단백질은 근위 결찰 검정을 통해 검출될 수 있다. 가령, 프로그램가능 DNA 변형 단백질은 첫 번째 항체에 의해 결합될 수 있고, 그리고 프로그램가능 DNA 결합 단백질 중에서 최소한 하나는 두 번째 항체에 의해 결합될 수 있고, 이들은 각각, 단일 가닥 근접 검출 올리고뉴클레오티드에 직접적으로 또는 간접적으로 (가령, 이차 항체를 통해) 연결된다. 다른 구체예에서, 단일 가닥 근접 검출 올리고뉴클레오티드(들)는 안내 RNA(들)에 직접적으로 또는 간접적으로 연결될 수 있다. 또 다른 구체예에서, 단일 가닥 근접 검출 올리고뉴클레오티드(들)는 프로그램가능 DNA 변형 또는 프로그램가능 DNA 결합 단백질에 직접적으로 또는 간접적으로 연결될 수 있다. 근위 위치된, 염색체-결합된 단백질과 복합화되는 근접 검출 올리고뉴클레오티드는 원지 근접-의존성 증폭 반응을 통해 검출될 수 있다. 원지 근접-의존성 증폭 반응은 근접 결찰 검정 (PLA, Soderberg, et al., Nature Methods, 2006, 3(12):995-1000을 참조한다) 또는 혼성화 연쇄 반응의 근접-의존성 개시 (proxHCR, Koos et al., Nature Communications, 2015, 6:7294, 10 pp.를 참조한다)일 수 있다.
(V) 적용
본원에서 개시된 조성물 및 방법은 다양한 치료적, 진단적, 산업적 및 연구 적용에서 이용될 수 있다. 일부 구체예에서, 본 발명은 유전자의 기능을 모형화 및/또는 연구하거나, 관심되는 유전적 또는 후성적 상태를 연구하거나, 또는 다양한 질환 또는 장애에 관련된 생화학적 경로를 연구하기 위해, 세포, 동물 또는 식물에서 관심되는 임의의 염색체 서열을 변형하는데 이용될 수 있다. 가령, 질환 또는 장애를 모형화하는 유전자도입 생물체가 창출될 수 있는데, 여기서 질환 또는 장애와 연관된 하나 또는 그 이상의 핵산 서열의 발현이 변경된다. 상기 질환 모형은 생물체에서 돌연변이의 효과를 연구하고, 질환의 발달 및/또는 진행을 연구하고, 질환에 대한 제약학적으로 활성 화합물의 효과를 연구하고 및/또는 가능성 있는 유전자 요법 전략의 효력을 사정하는데 이용될 수 있다.
다른 구체예에서, 이들 조성물 및 방법은 효율적이고 비용 효과적인 기능적 유전체 스크린을 수행하는데 이용될 수 있는데, 이들은 특정 생물학적 과정에 관련된 유전자의 기능을 연구하고 유전자 발현에서 임의의 변화가 생물학적 과정에 어떻게 영향을 줄 수 있는 지를 연구하는데 이용될 수 있고, 또는 세포 표현형과 함께 유전체 좌위의 포화 또는 깊은 스캐닝 돌연변이유발을 수행하는데 이용될 수 있다. 포화 또는 깊은 스캐닝 돌연변이유발은 예로서, 유전자 발현, 약제 내성 및 질환의 반전을 위해 필요한 결정적인 최소 특질 및 기능적 요소의 구별된 취약성을 결정하는데 이용될 수 있다.
추가 구체예에서, 본원에서 개시된 조성물 및 방법은 질환 또는 장애의 존재를 확립하기 위한 진단 검사에서 및/또는 치료 옵션을 결정하는데 이용될 수 있다. 적합한 진단 검사의 실례는 암 세포에서 특정한 돌연변이 (가령, EGFR, HER2 등에서 특정한 돌연변이)의 검출, 특정 질환과 연관된 특정한 돌연변이 (가령, 트리뉴클레오티드 반복, 겸상 적혈구병과 연관된 β-글로빈에서 돌연변이, 특정한 SNPs 등)의 검출, 간염의 검출, 바이러스 (가령, 지카)의 검출, 기타 등등을 포함한다.
추가 구체예에서, 본원에서 개시된 조성물 및 방법은 특정 질환 또는 장애와 연관된 유전적 돌연변이를 교정하는데 이용될 수 있다, 예를 들면, 예로서 겸상 적혈구병 또는 지중해빈혈과 연관된 글로빈 유전자 돌연변이를 교정하거나, 중증 복합형 면역 부전증 (SCID)과 연관된 아데노신 탈아미노효소 유전자에서 돌연변이를 교정하거나, 헌팅턴병의 질환 유발 유전자인 HTT의 발현을 감소시키거나, 또는 망막 색소변성의 치료를 위해 로돕신 유전자에서 돌연변이를 교정하는데 이용될 수 있다. 이런 변형은 탈체에서 세포 내에서 만들어질 수 있다.
또 다른 구체예에서, 본원에서 개시된 조성물 및 방법은 향상된 특성 또는 환경 스트레스에 대한 증가된 내성을 갖는 작물 식물을 산출하는데 이용될 수 있다. 본 발명은 또한, 향상된 특성을 갖는 경작용 동물 또는 생산 동물을 산출하는데 이용될 수 있다. 가령, 돼지는 특히 재생 약제 또는 이종이식에서, 그들을 생물의학 모형으로서 매력적으로 만드는 많은 특질을 갖는다.
정의
달리 정의되지 않으면, 본원에서 이용된 모든 기술 용어와 과학 용어는 본 발명이 속하는 당해 분야의 평균적 기술자에 의해 통상적으로 이해되는 바와 동일한 의미를 갖는다. 다음의 참고문헌은 본 발명에서 이용된 많은 용어의 일반적인 정의를 당업자에게 제공한다: Singleton et al., Dictionary of Microbiology and Molecular Biology (2nd ed. 1994); The Cambridge Dictionary of Science and Technology (Walker ed., 1988); The Glossary of Genetics, 5th Ed., R. Rieger et al. (eds.), Springer Verlag (1991); 그리고 Hale & Marham, The Harper Collins Dictionary of Biology (1991). 본원에서 이용된 바와 같이, 다음의 용어는 달리 명시되지 않으면, 그들에 생득된 의미를 갖는다.
본 발명의 원소 또는 이들의 바람직한 구체예(들)를 소개할 때, 단수 관사 ("a", "an", "the")와 "상기"는 이들 원소 중에서 하나 또는 그 이상이 있다는 것을 의미하는 것으로 의도된다. 용어 "포함하는", "내포하는" 및 "갖는"은 포괄적인 것으로 의도되고, 그리고 열거된 원소 이외에 추가 원소가 있을 수 있다는 것을 의미한다.
수치 값, x와 관련하여 이용될 때 용어 "약"은 예로서, x ± 5%를 의미한다.
본원에서 이용된 바와 같이, 용어 "상보적" 또는 "상보성"은 특정한 수소 결합을 통한 염기 대합에 의한 이중 가닥 핵산의 연관을 지칭한다. 염기 대합은 표준 왓슨 크릭 염기 대합 (가령, 5'-A G T C-3'은 상보성 서열 3'-T C A G-5'와 대합을 이룬다)일 수 있다. 염기 대합은 또한, 후그스탄형 또는 반전된 후그스탄형 수소 결합일 수 있다. 상보성은 전형적으로, 이중나선 영역에 대하여 계측되고, 그리고 따라서, 예로서 오버행을 배제한다. 이중나선 영역의 2개의 가닥 사이에 상보성은 부분적일 수 있고, 그리고 염기 중에서 단지 일부 (가령, 70%)만 상보적이면, 백분율 (가령, 70%)로서 표현된다. 상보적이지 않은 염기는 "부정합"된다. 상보성은 또한, 이중나선 영역 내에 모든 염기가 상보적이면, 완전할 수 있다 (다시 말하면, 100%).
본원에서 이용된 바와 같이, 용어 "CRISPR/Cas 시스템"은 CRISPR/Cas 단백질 (다시 말하면, 뉴클레아제, 틈내기효소, 또는 촉매 활성이 없는 단백질) 및 안내 RNA를 포함하는 복합체를 지칭한다.
본원에서 이용된 바와 같이, 용어 "내인성 서열"은 세포에 선천적인 염색체 서열을 지칭한다.
본원에서 이용된 바와 같이, 용어 "외인성"은 세포에 선천적이지 않은 서열, 또는 세포의 유전체 내에 선천적 위치가 상이한 염색체 위치에 있는 염색체 서열을 지칭한다.
본원에서 이용된 바와 같이, "유전자"는 유전자 산물을 인코딩하는 DNA 영역 (엑손 및 인트론 포함)뿐만 아니라 유전자 산물의 생산을 조절하는 모든 DNA 영역을 지칭하고, 이런 조절 서열이 코딩 및/또는 전사된 서열에 인접하는 지의 여부는 상관이 없다. 따라서, 유전자는 프로모터 서열, 종결인자, 번역 조절 서열, 예를 들면, 리보솜 결합 부위 및 내부 리보솜 유입 부위, 인핸서, 사일런서, 인슐레이터, 경계 요소, 복제 기점, 매트릭스 부착 부위 및 좌위 제어 영역을 포함하지만 이들에 반드시 한정되지는 않는다.
용어 "이종성"은 관심되는 세포에 내인성이거나 또는 선천적이지 않은 실체를 지칭한다. 가령, 이종성 단백질은 외인성 공급원, 예를 들면, 외인성으로 도입된 핵산 서열로부터 유래되거나 또는 이것으로부터 최초 유래되었던 단백질을 지칭한다. 일부 경우에, 이종성 단백질은 관심되는 세포에 의해 정상적으로 생산되지 않는다.
본원에서 이용된 바와 같이, 용어 "국부 염색질 구조" 또는 "국부 염색질 형상"은 뉴클레오솜 구조 및/또는 히스톤 단백질 스페이싱을 지칭하고, 그리고 일반적으로, 뉴클레오솜의 염색질 섬유 및 이질염색질로의 압밀을 지칭하지 않는다.
용어 "틈내기효소"는 이중 가닥 핵산 서열 중에서 한쪽 가닥을 개열하는 (다시 말하면, 이중 가닥 서열의 틈내기를 하는) 효소를 지칭한다. 가령, 이중 가닥 개열 활성을 갖는 뉴클레아제는 틈내기효소로서 기능하고 이중 가닥 서열 중에서 단지 한쪽 가닥만을 개열하기 위해 돌연변이 및/또는 결실에 의해 변형될 수 있다.
본원에서 이용된 바와 같이, 용어 "뉴클레아제"는 이중 가닥 핵산 서열의 양쪽 가닥을 개열하는 효소를 지칭한다.
용어 "핵산" 및 "폴리뉴클레오티드"는 선형 또는 환상 입체형태에서, 그리고 단일- 또는 이중 가닥 형태에서 데옥시리보뉴클레오티드 또는 리보뉴클레오티드 중합체를 지칭한다. 본 발명의 목적으로, 이들 용어는 중합체의 길이에 대하여 한정하는 것으로 해석되지 않는다. 이들 용어는 자연 뉴클레오티드의 공지된 유사체뿐만 아니라 염기, 당 및/또는 인산염 모이어티 (가령, 포스포로티오에이트 중추)에서 변형되는 뉴클레오티드를 포괄할 수 있다. 일반적으로, 특정 뉴클레오티드의 유사체는 동일한 염기 대합 특이성을 갖는다; 다시 말하면, A의 유사체는 T와 염기쌍을 이룰 것이다.
용어 "뉴클레오티드"는 데옥시리보뉴클레오티드 또는 리보뉴클레오티드를 지칭한다. 뉴클레오티드는 표준 뉴클레오티드 (다시 말하면, 아데노신, 구아노신, 시티딘, 티미딘 및 우리딘), 뉴클레오티드 이성질체, 또는 뉴클레오티드 유사체일 수 있다. 뉴클레오티드 유사체는 변형된 퓨린 또는 피리미딘 염기 또는 변형된 리보오스 모이어티를 갖는 뉴클레오티드를 지칭한다. 뉴클레오티드 유사체는 자연발생 뉴클레오티드 (가령, 이노신, 슈도우리딘 등) 또는 비자연발생 뉴클레오티드일 수 있다. 뉴클레오티드의 당 또는 염기 모이어티에서 변형의 무제한적 실례는 아세틸 기, 아미노 기, 카르복실 기, 카르복시메틸 기, 히드록실 기, 메틸 기, 포스포릴 기 및 티올 기의 부가 (또는 제거)뿐만 아니라 다른 원자로 염기의 탄소 및 질소 원자의 치환 (가령, 7-데아자 퓨린)을 포함한다. 뉴클레오티드 유사체는 또한, 디데옥시 뉴클레오티드, 2'-O-메틸 뉴클레오티드, 잠금된 핵산 (LNA), 펩티드 핵산 (PNA) 및 모르폴리노를 포함한다.
용어 "폴리펩티드" 및 "단백질"은 아미노산 잔기의 중합체를 지칭하기 위해 교체가능하게 이용된다.
본원에서 이용된 바와 같이, 용어 "근위 부위"는 염색체 DNA 내에 표적 서열의 어느 한쪽 측면 상에서 약 250개 염기쌍 내에 위치되는 결합 부위 또는 뉴클레오티드 서열을 지칭한다.
본원에서 이용된 바와 같이, 용어 "프로그램가능 DNA 변형 단백질"은 염색체 DNA 내에 특정한 표적 서열에 결합하도록 가공되고, 그리고 표적 서열에서 또는 표적 서열 인근에서 상기 DNA 또는 상기 DNA와 연관된 단백질(들)을 변형하는 단백질을 지칭한다.
본원에서 이용된 바와 같이, 용어 "프로그램가능 DNA 결합 단백질"은 염색체 DNA 내에 특정한 표적 서열에 결합하도록 가공되는 단백질을 지칭하지만, 상기 단백질은 표적 서열에서 또는 표적 서열 인근에서 상기 DNA 또는 상기 DNA와 연관된 단백질(들)을 변형하지 않는다.
용어 "표적 서열," "표적 염색체 서열" 및 "표적 부위"는 프로그램가능 DNA 변형 단백질이 표적화되는 염색체 DNA 내에 특정한 서열, 그리고 프로그램가능 DNA 변형 단백질이 상기 DNA 또는 상기 DNA와 연관된 단백질(들)을 변형하는 부위를 지칭하기 위해 교체가능하게 이용된다.
핵산 및 아미노산 서열 동일성을 결정하기 위한 기술은 당해 분야에서 공지된다. 전형적으로, 이런 기술은 유전자에 대한 mRNA의 뉴클레오티드 서열을 결정하고 및/또는 그에 따라서 인코딩된 아미노산 서열을 결정하고, 그리고 이들 서열을 두 번째 뉴클레오티드 또는 아미노산 서열과 비교하는 것을 포함한다. 유전체 서열 역시 이러한 방식으로 결정되고 비교될 수 있다. 일반적으로, 동일성은 2개의 폴리뉴클레오티드 또는 폴리펩티드 서열 각각의 정확한 뉴클레오티드-대-뉴클레오티드 또는 아미노산-대-아미노산 상응을 지칭한다. 2개 또는 그 이상의 서열 (폴리뉴클레오티드 또는 아미노산)은 그들의 동일성 퍼센트를 결정함으로써 비교될 수 있다. 핵산 또는 아미노산 서열인 지에 상관없이, 두 서열의 동일성 퍼센트는 더욱 짧은 서열의 길이에 의해 나눗셈되고 100에 의해 곱셈된, 2개의 정렬된 서열 사이에 정확한 정합의 숫자이다. 핵산 서열에 대한 근사 정렬은 Smith and Waterman, Advances in Applied Mathematics 2:482-489 (1981)의 국부 상동성 알고리즘에 의해 제공된다. 이러한 알고리즘은 Dayhoff, Atlas of Protein Sequences and Structure, M. O. Dayhoff ed., 5 suppl. 3:353-358, National Biomedical Research Foundation, Washington, D.C., USA에 의해 개발되고, 그리고 Gribskov, Nucl. Acids Res. 14(6):6745-6763 (1986)에 의해 정규화된 채점 매트릭스를 이용함으로써 아미노산 서열에 적용될 수 있다. 서열의 동일성 퍼센트를 결정하기 위한 이러한 알고리즘의 예시적인 실행은 Genetics Computer Group (Madison, Wis.)에 의해 "BestFit" 유틸리티 응용프로그램에서 제공된다. 서열 사이에 동일성 또는 유사성 퍼센트를 계산하기 위한 다른 적합한 프로그램은 당해 분야에서 전반적으로 공지되어 있다, 예를 들면, 다른 정렬 프로그램은 디폴트 파라미터에서 이용된 BLAST이다. 가령, BLASTN 및 BLASTP가 다음의 디폴트 파라미터에서 이용될 수 있다: 유전자 코드 = 표준; 필터 = 없음; 가닥 = 양쪽; 컷오프 = 60; 기대 = 10; 매트릭스 = BLOSUM62; 설명 = 50 서열; 분류 = 높은 점수; 데이터베이스 = 비다중, GenBank+EMBL+DDBJ+PDB+GenBank CDS 번역+Swiss 단백질+Spupdate+PIR. 이들 프로그램의 상세는 GenBank 웹사이트에서 발견될 수 있다.
전술한 세포와 방법에서 다양한 변화가 발명의 범위로부터 벗어나지 않으면서 만들어질 수 있기 때문에, 상기 설명에서 내포되고 아래의 실시예에서 제공된 모든 물질은 제한하는 의미가 아닌 예시적인 것으로 해석되어야 하는 것으로 의도된다.
열거된 구체예
다음의 열거된 구체예는 본 발명의 일정한 양상을 예시하기 위해 제시되고, 그리고 이의 범위를 한정하는 것으로 의도되지 않는다.
1. (a) 프로그램가능 DNA 변형 단백질 또는 상기 프로그램가능 DNA 변형 단백질을 인코딩하는 핵산 및 (b) 최소한 하나의 프로그램가능 DNA 결합 단백질 또는 상기 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산을 포함하는 조성물.
2. 구체예 1의 조성물, 여기서 프로그램가능 DNA 변형 단백질은 RNA-안내된 군집된 규칙적으로 산재된 짧은 회귀성 반복 (CRISPR)/CRISPR-연관된 (Cas) (CRISPR/Cas) 뉴클레아제 시스템, CRISPR/Cas 이중 틈내기효소 시스템, 아연 핑거 뉴클레아제 (ZFN), 전사 활성인자-유사 작동체 뉴클레아제 (TALEN), 메가뉴클레아제, 뉴클레아제 도메인에 연결된 프로그램가능 DNA 결합 도메인을 포함하는 융합 단백질, 또는 비-뉴클레아제 도메인에 연결된 프로그램가능 DNA 결합 도메인을 포함하는 융합 단백질이다.
3. 구체예 2의 조성물, 여기서 융합 단백질의 프로그램가능 DNA 결합 도메인은 촉매적으로 비활성 CRISPR/Cas 시스템, 촉매적으로 비활성 메가뉴클레아제, 아연 핑거 단백질, 또는 전사 활성인자-유사 작동체이다.
4. 구체예 2 또는 3의 조성물, 여기서 융합 단백질의 비-뉴클레아제 도메인은 아세틸전달효소 활성, 탈아세틸화효소 활성, 메틸전달효소 활성, 탈메틸효소 활성, 키나아제 활성, 포스파타아제 활성, 유비퀴틴 리가아제 활성, 탈유비퀴틴화 활성, 아데닐화 활성, 탈아데닐화 활성, 수모화 활성, 탈수모화 활성, 리보실화 활성, 탈리보실화 활성, 미리스토일화 활성, 탈미리스토일화 활성, 시트룰린화 활성, 헬리카아제 활성, 아미노화 활성, 탈아미노화 활성, 알킬화 활성, 탈알킬화 활성, 산화 활성, 전사 활성화 활성, 또는 전사 억제인자 활성을 갖는다.
5. 구체예 4의 조성물, 여기서 융합 단백질의 비-뉴클레아제 도메인은 시토신 탈아미노효소 활성, 히스톤 아세틸전달효소 활성, 전사 활성화 활성, 또는 전사 억제인자 활성을 갖는다.
6. 구체예 1 내지 5 중에서 한 가지의 조성물, 여기서 최소한 하나의 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 단백질, 촉매적으로 비활성 메가뉴클레아제, 아연 핑거 단백질, 전사 활성인자-유사 작동체, CRISPR/Cas 틈내기효소, ZFN 틈내기효소, TALEN 틈내기효소, 또는 메가뉴클레아제 틈내기효소이다.
7. 구체예 1 내지 6 중에서 한 가지의 조성물, 여기서 프로그램가능 DNA 변형 단백질 및 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산은 RNA 또는 DNA이고 및/또는 여기서 상기 핵산은 플라스미드 벡터 또는 바이러스 벡터의 일부이다.
8. 구체예 1 내지 6 중에서 한 가지의 조성물, 여기서 프로그램가능 DNA 변형 단백질은 CRISPR/Cas 뉴클레아제 시스템, CRISPR/Cas 이중 틈내기효소 시스템, 또는 비-뉴클레아제 도메인에 연결된 촉매적으로 비활성 CRISPR/Cas 시스템이고, 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 시스템이고, 여기서 각 CRISPR/Cas 시스템은 CRISPR/Cas 단백질 및 안내 RNA를 포함한다.
9. 구체예 8의 조성물, 여기서 각 CRISPR/Cas 뉴클레아제 시스템은 I형 CRISPR/Cas 시스템, II형 CRISPR/Cas 시스템, III형 CRISPR/Cas 시스템, 또는 V형 CRISPR/Cas 시스템이다.
10. 구체예 9의 조성물, 여기서 각 CRISPR/Cas 뉴클레아제 시스템은 II형 CRISPR/Cas 시스템 또는 V형 CRISPR/Cas 시스템이다.
11. 구체예 8 내지 10 중에서 한 가지의 조성물, 여기서 각 CRISPR/Cas 단백질을 인코딩하는 핵산은 mRNA 또는 DNA이다.
12. 구체예 8 내지 11 중에서 한 가지의 조성물, 여기서 각 CRISPR/Cas 단백질을 인코딩하는 핵산 및/또는 각 안내 RNA를 인코딩하는 핵산은 플라스미드 벡터 또는 바이러스 벡터의 일부이다.
13. 구체예 8 내지 11 중에서 한 가지의 조성물, 여기서 각 CRISPR/Cas 시스템의 안내 RNA는 효소적으로 합성된다.
14. 구체예 8 내지 11 중에서 한 가지의 조성물, 여기서 각 CRISPR/Cas 시스템의 안내 RNA는 최소한 부분적으로 화학적으로 합성된다.
15. 구체예 1 내지 14 중에서 한 가지의 조성물을 포함하는 키트.
16. 진핵 세포에서 표적화된 유전체 변형 효율 및/또는 특이성을 증가시키기 위한 방법, 상기 방법은
(a) 프로그램가능 DNA 변형 단백질 또는 상기 프로그램가능 DNA 변형 단백질을 인코딩하는 핵산 및;
(b) 최소한 하나의 프로그램가능 DNA 결합 단백질 또는 상기 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산을 진핵 세포 내로 도입하는 것을 포함하고;
여기서 프로그램가능 DNA 변형 단백질은 표적 염색체 서열에 표적화되고, 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질 각각은 표적 염색체 서열의 근위 부위에 표적화되고, 그리고 표적 염색체 서열의 근위 부위에 최소한 하나의 프로그램가능 DNA 결합 단백질의 결합은 표적 염색체 서열에 대한 프로그램가능 DNA 변형 단백질의 접근성을 증가시키고, 따라서 표적화된 유전체 변형 효율 및/또는 특이성을 증가시킨다.
17. 구체예 16의 방법, 여기서 표적 염색체 서열의 근위 부위는 표적 염색체 서열의 어느 한쪽 측면 상에서 약 250개 염기쌍 내에 위치된다.
18. 구체예 17의 방법, 여기서 표적 염색체 서열의 근위 부위는 표적 염색체 서열의 어느 한쪽 측면 상에서 약 100개 염기쌍 내에 위치된다.
19. 구체예 18의 방법, 여기서 표적 염색체 서열의 근위 부위는 표적 염색체 서열의 어느 한쪽 측면 상에서 약 75개 염기쌍 내에 위치된다.
20. 구체예 19의 방법, 여기서 표적 염색체 서열의 근위 부위는 표적 염색체 서열의 어느 한쪽 측면 상에서 약 50개 염기쌍 내에 위치된다.
21. 구체예 20의 방법, 여기서 표적 염색체 서열의 근위 부위는 표적 염색체 서열의 어느 한쪽 측면 상에서 약 25개 염기쌍 내에 위치된다.
22. 구체예 16 내지 21 중에서 한 가지의 방법, 여기서 프로그램가능 DNA 변형 단백질은 CRISPR/Cas 뉴클레아제 시스템, CRISPR/Cas 이중 틈내기효소 시스템, 아연 핑거 뉴클레아제 (ZFN), 전사 활성인자-유사 작동체 뉴클레아제 (TALEN), 메가뉴클레아제, 뉴클레아제 도메인에 연결된 프로그램가능 DNA 결합 도메인을 포함하는 융합 단백질, 또는 비-뉴클레아제 도메인에 연결된 프로그램가능 DNA 결합 도메인을 포함하는 융합 단백질이다.
23. 구체예 22의 방법, 여기서 융합 단백질의 프로그램가능 DNA 결합 도메인은 촉매적으로 비활성 CRISPR/Cas 시스템, 촉매적으로 비활성 메가뉴클레아제, 아연 핑거 단백질, 또는 전사 활성인자-유사 작동체이다.
24. 구체예 22 또는 23의 방법, 여기서 융합 단백질의 비-뉴클레아제 변형 도메인은 아세틸전달효소 활성, 탈아세틸화효소 활성, 메틸전달효소 활성, 탈메틸효소 활성, 키나아제 활성, 포스파타아제 활성, 유비퀴틴 리가아제 활성, 탈유비퀴틴화 활성, 아데닐화 활성, 탈아데닐화 활성, 수모화 활성, 탈수모화 활성, 리보실화 활성, 탈리보실화 활성, 미리스토일화 활성, 탈미리스토일화 활성, 시트룰린화 활성, 헬리카아제 활성, 아미노화 활성, 탈아미노화 활성, 알킬화 활성, 탈알킬화 활성, 산화 활성, 전사 활성화 활성, 또는 전사 억제인자 활성을 갖는다.
25. 구체예 24의 방법, 여기서 융합 단백질의 비-뉴클레아제 도메인은 시토신 탈아미노효소 활성, 히스톤 아세틸전달효소 활성, 전사 활성화 활성, 또는 전사 억제인자 활성을 갖는다.
26. 구체예 16 내지 25 중에서 한 가지의 방법, 여기서 최소한 하나의 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 시스템, 촉매적으로 비활성 메가뉴클레아제, 아연 핑거 단백질, 전사 활성인자-유사 작동체, CRISPR/Cas 틈내기효소, ZFN 틈내기효소, TALEN 틈내기효소, 또는 메가뉴클레아제 틈내기효소이다.
27. 구체예 16 내지 26 중에서 한 가지의 방법, 여기서 프로그램가능 DNA 변형 단백질은 CRISPR/Cas 뉴클레아제 시스템, CRISPR/Cas 이중 틈내기효소 시스템, 또는 비-뉴클레아제 도메인에 연결된 촉매적으로 비활성 CRISPR/Cas 시스템이고, 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 시스템이고, 여기서 각 CRISPR/Cas 시스템은 CRISPR/Cas 단백질 및 안내 RNA를 포함한다.
28. 구체예 27의 방법, 여기서 각 CRISPR/Cas 시스템의 안내 RNA는 최소한 부분적으로 화학적으로 합성된다.
29. 구체예 27의 방법, 여기서 각 CRISPR/Cas 시스템의 안내 RNA는 효소적으로 합성된다.
30. 구체예 16 내지 29 중에서 한 가지의 방법, 여기서 진핵 세포는 시험관내이다.
31. 구체예 16 내지 29 중에서 한 가지의 방법, 여기서 진핵 세포는 생체내이다.
32. 구체예 16 내지 31 중에서 한 가지의 방법, 여기서 진핵 세포는 포유류 세포이다.
33. 구체예 32의 방법, 여기서 포유류 세포는 인간 세포이다.
34. 구체예 32의 방법, 여기서 포유류 세포는 비인간 세포이다.
35. 진핵 세포에서 염색체 서열을 검출하기 위한 방법, 상기 방법은 다음 단계를 포함한다:
I. (a) 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질 또는 최소한 하나의 검출가능한 마커 도메인을 포함하는 상기 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산 및 (b) 최소한 하나의 프로그램가능 DNA 결합 단백질 또는 상기 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산을 진핵 세포 내로 도입하고, 여기서 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질은 표적 염색체 서열에 표적화되고, 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질 각각은 표적 염색체 서열의 근위 부위에 표적화되고, 그리고 표적 염색체 서열의 근위 부위에 최소한 하나의 프로그램가능 DNA 결합 단백질의 결합은 표적 염색체 서열에 대한 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질의 접근성을 증가시키고; 그리고
II. 표적 염색체 서열에 결합된 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질을 검출한다.
36. 구체예 35의 방법, 여기서 표적 염색체 서열의 근위 부위는 표적 염색체 서열의 어느 한쪽 측면 상에서 약 250개 염기쌍 내에 위치된다.
37. 구체예 36의 방법, 여기서 표적 염색체 서열의 근위 부위는 표적 염색체 서열의 어느 한쪽 측면 상에서 약 100개 염기쌍 내에 위치된다.
38. 구체예 37의 방법, 여기서 표적 염색체 서열의 근위 부위는 표적 염색체 서열의 어느 한쪽 측면 상에서 약 75개 염기쌍 내에 위치된다.
39. 구체예 38의 방법, 여기서 표적 염색체 서열의 근위 부위는 표적 염색체 서열의 어느 한쪽 측면 상에서 약 50개 염기쌍 내에 위치된다.
40. 구체예 39의 방법, 여기서 표적 염색체 서열의 근위 부위는 표적 염색체 서열의 어느 한쪽 측면 상에서 약 25개 염기쌍 내에 위치된다.
41. 구체예 35 내지 40 중에서 한 가지의 방법, 여기서 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질의 최소한 하나의 검출가능한 마커 도메인은 형광 단백질, 형광 태그, 에피토프 태그, 또는 프로그램가능 DNA 결합 단백질 내에 자연발생 에피토프이다.
42. 구체예 35 내지 41 중에서 한 가지의 방법, 여기서 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질은 최소한 하나의 검출가능한 마커 도메인에 연결된 촉매적으로 비활성 CRISPR/Cas 시스템, 최소한 하나의 검출가능한 마커 도메인에 연결된 촉매적으로 비활성 메가뉴클레아제, 최소한 하나의 검출가능한 마커 도메인에 연결된 아연 핑거 단백질, 또는 최소한 하나의 검출가능한 마커 도메인에 연결된 전사 활성인자-유사 작동체이다.
43. 구체예 35 내지 42 중에서 한 가지의 방법, 여기서 최소한 하나의 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 시스템, 촉매적으로 비활성 메가뉴클레아제, 아연 핑거 단백질, 전사 활성인자-유사 작동체, CRISPR/Cas 틈내기효소, ZFN 틈내기효소, TALEN 틈내기효소, 또는 메가뉴클레아제 틈내기효소이다.
44. 구체예 35 내지 43 중에서 한 가지의 방법, 여기서 최소한 하나의 검출가능한 마커 도메인을 포함하는 프로그램가능 DNA 결합 단백질은 최소한 하나의 검출가능한 마커 도메인에 연결된 촉매적으로 비활성 CRISPR/Cas 시스템이고, 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질은 촉매적으로 비활성 CRISPR/Cas 시스템이고, 여기서 각 CRISPR/Cas 시스템은 CRISPR/Cas 단백질 및 안내 RNA를 포함한다.
45. 구체예 44의 방법, 여기서 각 CRISPR/Cas 시스템의 안내 RNA는 최소한 부분적으로 화학적으로 합성된다.
46. 구체예 44의 방법, 여기서 각 CRISPR/Cas 시스템의 안내 RNA는 효소적으로 합성된다.
47. 구체예 35 내지 46 중에서 한 가지의 방법, 여기서 진핵 세포는 포유류 세포이다.
48. 구체예 47의 방법, 여기서 포유류 세포는 인간 세포이다.
49. 구체예 47의 방법, 여기서 포유류 세포는 비인간 세포이다.
50. 구체예 35 내지 49 중에서 한 가지의 방법, 여기서 진핵 세포는 살아있거나 또는 고정된다.
51. 구체예 35 내지 50 중에서 한 가지의 방법, 여기서 검출은 동적 생존 세포 영상화, 형광 현미경검사, 공초점 현미경검사, 면역형광, 면역검출, RNA-단백질 결합, 또는 단백질-단백질 결합을 포함한다.
실시예
다음 실시예는 본 발명의 일정한 양상을 예시한다.
실시예 1. 프란시엘라 노비시다
(Francisella novicida
)
CRISPR-Cas9 (FnCas9) 유전자 편집 증강
FnCas9는 IIB형 CRISPR-Cas9이다. 이것은 널리 이용되는 SpCas9보다 더욱 높은 고유한 특이성을 전시하긴 하지만, 인간 세포에서 SpCas9보다 덜 견실한 것으로 밝혀졌다. 근위 부위에 프로그램가능 DNA 결합 단백질의 결합이 상기 뉴클레아제가 인간 세포에서 만약 그렇지 않으면 접근불가능했던 표적 (다시 말하면, POR 좌위)을 개열할 수 있게 할 수 있는 지를 결정하기 위해, K562 세포가 1백만 개의 세포당 5.6 μg의 FnCas9 플라스미드 DNA, 5 μg의 촉매 활성이 없는 SpCas9 (SpdCas9) 플라스미드 DNA, 그리고 각 sgRNA의 3 μg의 플라스미드 DNA로 형질감염되었다 (도면 2를 참조한다). 유전체 DNA가 형질감염 후 3 일에 수확되었고, 그리고 표적 영역이 전방 프라이머 5'-CTCCCCTGCTTCTTGTCGTAT-3' (서열 번호:9) 및 후방 프라이머 5'-ACAGGTCGTGGACACTCACA-3' (서열 번호:10)을 이용한 PCR에 의해 증폭되었다. 표적 상에서 FnCas9에 의한 표적화된 삽입/결실 (삽입-결실)은 Cel-I 뉴클레아제 소화 및 폴리아크릴아미드 겔 분석에 의해 결정되었다.
도면 2에서 보여 지는 바와 같이, FnCas9는 단독으로 형질감염될 때 표적을 개열할 수 없었다. 하지만, 국부 염색질 형상을 파괴하는데 도움을 주는 SpdCas9와 조합으로 형질감염될 때, FnCas9는 견실한 수준에서 표적을 개열할 수 있었는데, SpdCas9가 하나의 근위 부위에 결합하는데 이용될 때 10-11%의 삽입-결실이 달성되었다. SpdCas9가 2개의 근위 부위에 결합하는데 이용될 때, FnCas9 활성은 28%의 삽입-결실까지 더욱 증가하였다. 이들 결과는 본원에서 개시된 방법은 엔도뉴클레아제가 만약 그렇지 않으면 접근불가능했던 표적을 효율적으로 개열하게 할 수 있게 하고, 그리고 국부 염색질 형상을 파괴하는데 있어서 이용된 두 부위 사이에 상승 효과가 있다는 것을 증명한다.
실시예 2. 캄필로박터 제주니 (
Campylobacter jejuni
) CRISPR-Cas9 (CjCas9) 유전자 편집 증강
CjCas9는 IIC형 CRISPR-Cas9이다. 이것은 지금까지 특징이 확인된 가장 작은 Cas9이고, 그리고 독특한 ACAY PAM 요건을 갖는다. 하지만, 상기 뉴클레아제는 인간 세포에서 대부분의 표적에서 비활성인 것으로 밝혀졌다. 본원에서 개시된 방법이 CjCas9 단백질이 인간 세포에서 접근불가능했던 표적에 결합할 수 있게 할 수 있는 지를 결정하기 위해, K562 세포가 1백만 개의 세포당 4.2 μg의 Flag-태깅된 촉매 활성이 없는 CjCas9 (CjdCas9) 플라스미드 DNA, 5 μg의 촉매 활성이 없는 SpCas9 (SpdCas9) 플라스미드 DNA, 그리고 각 sgRNA의 3 μg의 플라스미드 DNA로 형질감염되었다 (도면 3a를 참조한다). 세포는 형질감염 후 16 시간에 포름알데히드에서 고정되었고, 그리고 염색질 면역침전 (ChIP)이 항-플래그 항체를 이용하여 실행되었다. Flag-CjdCas9에 의한 표적 결합은 비말 디지털 PCR (ddPCR)에 의해 결정되었다.
도면 3c에서 보여 지는 바와 같이, Flag-CjdCas9는 단독으로 형질감염될 때, AAVS1 좌위 내에 이전에 공지되었던 접근가능한 표적에는 결합할 수 있었지만, POR 좌위 내에 접근불가능했던 표적에는 결합할 수 없었다. 하지만, Flag-CjdCas9는 국부 염색질 형상을 파괴하는 SpdCas9와 조합으로 형질감염될 때, AAVS1 표적에 결합보다 훨씬 효율적으로 POR 표적에 결합할 수 있었다.
표적 DNA 개열에 대한 효과를 조사하기 위해, K562 세포가 1백만 개의 세포당 4.2 μg의 CjCas9 플라스미드 DNA, 5 μg의 SpdCas9 플라스미드 DNA, 그리고 각 sgRNA의 3 μg의 플라스미드 DNA로 형질감염되었다. 유전체 DNA가 형질감염 후 3 일에 수확되었고, 그리고 표적 영역이 전방 프라이머 5'-CTCCCCTGCTTCTTGTCGTAT-3' (서열 번호:9) 및 후방 프라이머 5'-ACAGGTCGTGGACACTCACA-3' (서열 번호:10)을 이용한 PCR에 의해 증폭되었다. POR 표적에서 CjCas9 개열 활성은 Cel-I 뉴클레아제 소화 및 폴리아크릴아미드 겔 분석에 의해 결정되었다. 도면 4에서 보여 지는 바와 같이, CjCas9는 SpdCas9 없이 표적을 개열할 수 없었다. 하지만, CjCas9는 SpdCas9와 조합으로 형질감염될 때, 34.1-37.9%의 삽입-결실로 표적을 효율적으로 개열할 수 있었다. 이들 결과는 본원에서 개시된 방법은 뉴클레아제가 만약 그렇지 않으면 접근불가능했던 표적에 결합하고 이를 효율적으로 개열할 수 있게 할 수 있다는 것을 증명한다.
실시예 3. 프란시엘라 노비시다 (
Francisella novicida
) Cpf1 (FnCpf1) 유전자 편집 증강
FnCpf1은 V형 CRISPR-Cas 시스템이다. Cpf1 시스템은 II형 CRISPR-Cas9 시스템과 유의미하게 다르다. Cas9 시스템과 달리, Cpf1 시스템은 tracrRNA 없이, 표적화를 위해 5' T 풍부한 PAM 및 단일 RNA 안내를 이용한다 (Zetsche et al., Cell, 2015, 163:1-13). 이들 "더욱 새로운" CRISPR 시스템은 유전자 편집 실시를 훨씬 단순하게 만드는 잠재력이 있긴 하지만, 많은 Cpf1 시스템은 인간 세포에서 비활성인 것으로 밝혀졌다. 본원에서 개시된 방법이 분기한 "비활성" Cpf1 뉴클레아제가 인간 세포에서 내인성 표적을 개열할 수 있게 할 수 있는 지를 결정하기 위해, K562 세포가 1백만 개의 세포당 5 μg의 FnCpf1 플라스미드 DNA, 5 μg의 SpdCas9 플라스미드 DNA, 그리고 각 sgRNA의 3 μg의 플라스미드 DNA로 형질감염되었다 (도면 5를 참조한다). 유전체 DNA가 형질감염 후 3 일에 수확되었고, 그리고 표적 영역이 전방 프라이머 5'-CTCCCCTGCTTCTTGTCGTAT-3' (서열 번호:9) 및 후방 프라이머 5'-ACAGGTCGTGGACACTCACA-3' (서열 번호:10)을 이용한 PCR에 의해 증폭되었다. POR 표적에서 FnCpf1 개열 활성은 Cel-I 뉴클레아제 소화 및 폴리아크릴아미드 겔 분석에 의해 결정되었다.
도면 5에서 보여 지는 바와 같이, FnCpf1은 단독으로 형질감염될 때 표적을 개열할 수 없었지만, SpdCas9와 조합으로 형질감염될 때 표적을 효율적으로 개열할 수 있었다. 이들 결과는 본원에서 개시된 방법이 분기한 V형 CRISPR-Cas 시스템에 적용가능하다는 것을 증명한다.
실시예 4. 인간 HBB 및 HBD에서 동일한 표적 사이에 선택적 편집
본원에서 개시된 방법이 상이한 유전자에서 동일한 부위 사이에 선택적 편집을 용이하게 할 수 있는 지를 결정하기 위해, 인간에서 2개의 동일한 표적 (다시 말하면, HBB 및 HBD)이 이용되었다. K562 세포가 1백만 개의 세포당 4.2 μg의 CjCas9 플라스미드 DNA, 5 μg의 SpdCas9 플라스미드 DNA, 그리고 각 sgRNA의 3 μg의 플라스미드 DNA로 형질감염되었다 (도면 6을 참조한다). 유전체 DNA가 형질감염 후 3 일에 수확되었고, 그리고 이들 2개 표적 영역이 HBB의 경우에 전방 프라이머 5'-CGGCTGTCATCACTTAGACCTCA-3' (서열 번호:11) 및 후방 프라이머 5'-GCAGCCTAAGGGTGGGAAAATAGA-3' (서열 번호:12), 그리고 HBD의 경우에 전방 프라이머 5'-AGGGCAAGTTAAGGGAATAGTGGAA-3' (서열 번호:13) 및 후방 프라이머 5'-CCAAGGGTAGACCACCAGTAATCTG-3' (서열 번호:14)을 이용한 PCR에 의해 증폭되었다. HBB 및 HBD 표적에서 CjCas9 개열 활성은 Cel-I 뉴클레아제 소화 및 폴리아크릴아미드 겔 분석에 의해 결정되었다.
도면 6에서 보여 지는 바와 같이, CjCas9는 단독으로 형질감염될 때, 어느 표적도 개열할 수 없었다. 하지만, CjCas9는 HBB의 근위 부위에 표적화된 SpdCas9와 조합으로 형질감염될 때, HBB 표적을 효율적으로 개열하지만 동일한 HBD 표적을 여전히 개열할 수 없었다. 첫 2개 레인에서 2개의 Cel-I 뉴클레아제 소화 띠는 K562 세포 개체군에서 존재하는 SNPs에 의해 유발되었다. 이들 결과는 유전자 편집 선택성을 향상시키는 개시된 방법의 독특한 능력을 증명한다.
실시예 5. 스트렙토코쿠스 피오게네스 (
Streptococcus pyogenes
) CRISPR-Cas9 (SpCas9) 유전자 편집 증강
SpCas9는 IIA형 CRISPR-Cas9이고, 그리고 진핵 세포에서 견실한 활성으로 인해 유전체 변형에서 폭넓게 이용되었다. 하지만, 이의 활성 역시 표적마다 폭넓게 변할 수 있다. 본원에서 개시된 방법이 이러한 뉴클레아제를 또한 증강할 수 있는 지를 결정하기 위해, K562 세포가 1백만 개의 세포당 5 μg의 SpCas9 플라스미드 DNA, 5.6 μg의 촉매 활성이 없는 FnCas9 (FndCas9), 그리고 각 sgRNA의 3 μg의 플라스미드 DNA로 형질감염되었다 (도면 7을 참조한다). 유전체 DNA가 형질감염 후 3 일에 수확되었고, 그리고 표적 영역이 전방 프라이머 5'- CTCCCCTGCTTCTTGTCGTAT-3' (서열 번호:9) 및 후방 프라이머 5'- ACAGGTCGTGGACACTCACA-3' (서열 번호:10)을 이용한 PCR에 의해 증폭되었다. POR 표적에서 SpCas9 개열 활성은 Cel-I 뉴클레아제 소화 및 폴리아크릴아미드 겔 분석에 의해 결정되었다.
도면 7에서 보여 지는 바와 같이, SpCas9 개열 활성은 이것이 단독으로 형질감염될 때와 비교하여, 이것이 FndCas9와 조합으로 형질감염될 때 유의미하게 증가하였다. 이들 결과는 본원에서 개시된 방법이 견실한 엔도뉴클레아제에도 적용될 수 있다는 것을 보여준다.
실시예 6. ssDNA 올리고 공여자를 이용한 유전자 편집의 증강
K562 세포가 1백만 개의 세포당 4.2 μg의 CjCas9 플라스미드 DNA, 5 μg의 SpdCas9 플라스미드 DNA, 각 sgRNA의 3 μg의 플라스미드 DNA, 그리고 EcoRI 제한 부위의 표적화된 통합을 위한 300 pmol의 88-nt ssDNA 올리고 공여자로 형질감염되었다. 유전체 DNA가 형질감염 후 3 일에 수확되었고, 그리고 표적 영역이 전방 프라이머 5'-CTCCCCTGCTTCTTGTCGTAT-3' (서열 번호:9) 및 후방 프라이머 5'-ACAGGTCGTGGACACTCACA-3' (서열 번호:10)을 이용한 PCR에 의해 증폭되었다. EcoRI 제한 부위의 표적화된 통합은 EcoRI 제한 효소로 소화 및 폴리아크릴아미드 겔 분석에 의해 결정되었다. 도면 8에서 보여 지는 바와 같이, 제한 부위는 ssDNA 올리고 공여자가 CjCas9 및 SpdCas9와 협력하여 형질감염될 때 POR 좌위 내에 효율적으로 (28-37%) 통합되었고, 반면 상기 올리고 공여자가 단독으로, 또는 SpdCas9 없이 CjCas9와 조합으로 형질감염될 때에는 어떤 통합도 검출되지 않았다. 이들 결과는 본원에서 개시된 방법이 만약 그렇지 않으면 접근불가능했던 표적에서 ssDNA 올리고 공여자를 이용한 효율적인 유전자 편집을 용이하게 할 수 있다는 것을 증명한다.
실시예 7. 살아있는 세포 및 고정된 세포에서 서열 특이적 유전체 DNA 검출의 증강
형광 단백질에 Cas9 단백질의 융합은 생존 세포에서 염색체 동역학의 검출을 가능하게 하였다 (Chen et al., Cell, 2013, 155:1479-91). 이런 이유로, 염색질 구조 동역학은 다양한 유전체 좌위에 접근하는 CRISPR/Cas 시스템 복합체의 능력에 영향을 줄 것으로 생각된다. 따라서, dCas9-GFP를 품는 것들의 근위에 CRISPR (dCas9) 복합체의 배치는 염색질 면역침전에 대해 실시예 2에서 관찰된 것과 유사한 정도까지, 염색체 동역학의 검출을 증강하는 것으로 생각된다. 가령, CjdCas9는 GFP에 융합되고, 그리고 CjdCas9-GFP의 검출가능한 결합을 방해하는 염색질 상태를 갖는 영역에 표적화될 수 있다. SpdCas9-기초된 시스템은 이후, 검출가능한 신호가 발생하도록 CjdCas9-GFP 표적에 근접하게 설계될 수 있다. SpdCas9-GFP의 결합 및 검출에 저항하는 염색질 영역의 경우에, 근위 FndCas9 분자가 SpCas9와 FndCas9 근위 표적화 및 이중 가닥 절단 활성의 증강에 대해 실시예 5에서 도시된 것과 유사한 정도까지, 검출을 증강하는데 이용될 수 있다. 게다가, 이전 연구 (Wu et al., Nature Biotechnology, 2014, 32(7): 670-6)에서 CRISPR 안내 RNA 및 유전체 DNA 사이에 혼성화 요건의 정도가 이중 가닥 개열에 대해서 보다 결합에 대해 더욱 적을 수 있는 것으로 지시되었다는 점을 고려하면, 근위 CRISPR 결합의 이용은 세포에서 유전체 DNA의 검출에 대한 신호 대 잡음 비율을 증가시키는 것으로 생각된다.
유사한 CRISPR-기초된 검출 방법이 고정된 세포에 적용되었다 (Deng et al., Proc. Natl. Acad, Sci. USA, 2015, 112(38):11870-75). 따라서, 근위 CRISPR 표적화는 생존 세포에 대해 전술된 방식과 유사한 방식으로, 고정된 DNA의 검출을 증강할 것으로 생각된다. 고정된 세포 내에 유전체 DNA 가닥이 화학적으로 교차연결되기 때문에, 핵산 프로브의 혼성화에 의한 서열 정보의 규문은 전형적으로, 가닥을 충분히 분리하기 위해 열 또는 화학적 처리를 이용한 선처리 단계를 필요로 한다. 이런 이유로, 근위 CRISPR 표적화는 고정된 DNA가 더욱 접근가능하게 만들고, 그리고 고정된 세포의 열 또는 화학적 처리에 대한 정도 (또는 요건)을 감소시키는 것이 가능하다. 열 또는 화학적 처리의 제거는 생존 세포 생물학을 더욱 잘 반영하는 세포내 분자 구조의 진단적 프로토콜 단순화와 유지에서 이점을 제공하고, 그리고 이런 이유로, 더욱 많은 정보에 입각한 진단적 결과를 제공할 것이다.
실시예 8. 진핵 세포에서 CRISPR-기초된 유전자 활성화 및 억제의 증강
전사 조절 도메인에 Cas9 단백질의 융합은 표적화된 유전자 활성화 및 억제를 가능하게 하였다 (Konermann et al., Nature, 2014; 517(7536):583-8; Gilbert et al., Cell, 2014, 159(3):547-661). 염색질 구조 동역학은 다양한 유전체 좌위에 접근하고 활성화 또는 억제를 유도하는 CRISPR 복합체의 능력에 영향을 줄 것으로 생각된다. 따라서, 전사 조절 도메인에 융합된 dCas9를 품는 것들의 근위에 CRISPR (dCas9) 복합체의 배치는 염색질 면역침전에 대해 실시예 2에서 관찰된 것과 유사한 정도까지, 표적화된 유전자 조절을 증강하는 것으로 생각된다. SpdCas9-전사-조절인자에 의한 결합 및 변형에 저항하는 염색질 영역의 경우에, 근위 FndCas9 분자는 SpCas9와 FndCas9 근위 표적화 및 이중 가닥 절단 활성의 증강에 대해 실시예 5에서 도시된 것과 유사한 정도까지, 유전자 활성화 또는 억제를 증강하는데 이용될 수 있다.
실시예 9. 진핵 세포에서 CRISPR-기초된 후성 변형의 증강
후성 변형 도메인에 Cas9 단백질의 융합은 표적화된 후성적 염색체 변형, 예를 들면, p300에 의한 히스톤 아세틸화 또는 시토신 탈아미노효소에 의한 시토신 탈아미노화를 가능하게 하였다 (Hilton et al., Nat. Biotechnol; 2015, 33(5):510-7; Komor et al., Nature, 2016, 533(7603):420-4). 염색질 구조 동역학은 다양한 유전체 좌위에 접근하는 CRISPR 복합체의 능력에 영향을 줄 것으로 생각된다. 따라서, 후성적 조절제에 융합된 dCas9를 품는 것들의 근위에 CRISPR (dCas9) 복합체의 배치는 염색질 면역침전에 대해 실시예 2에서 관찰된 것과 유사한 정도까지, 염색체 DNA, 국부 단백질 또는 국부 RNA의 표적화된 후성 변형을 증강할 것이다. SpdCas9-epi-조절제에 의한 결합 및 변형에 저항하는 염색질 영역의 경우에, 근위 FndCas9 분자는 SpCas9와 FndCas9 근위 표적화 및 이중 가닥 절단 활성의 증강에 대해 실시예 5에서 도시된 것과 유사한 정도까지, 검출을 증강하는데 이용될 수 있다.
SEQUENCE LISTING
<110> SIGMA-ALDRICH CO. LLC
CHEN, Fuqiang
<120> USING PROGRAMMABLE DNA BINDING PROTEINS TO ENHANCE TARGETED
GENOME MODIFICATION
<130> 047497-561365
<150> US 62/358,415
<151> 2016-07-05
<150> US 62/344,858
<151> 2016-06-02
<160> 49
<170> PatentIn version 3.5
<210> 1
<211> 7
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 1
Pro Lys Lys Lys Arg Lys Val
1 5
<210> 2
<211> 7
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 2
Pro Lys Lys Lys Arg Arg Val
1 5
<210> 3
<211> 16
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 3
Lys Arg Pro Ala Ala Thr Lys Lys Ala Gly Gln Ala Lys Lys Lys Lys
1 5 10 15
<210> 4
<211> 20
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 4
Gly Arg Lys Lys Arg Arg Gln Arg Arg Arg Pro Pro Gln Pro Lys Lys
1 5 10 15
Lys Arg Lys Val
20
<210> 5
<211> 19
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 5
Pro Leu Ser Ser Ile Phe Ser Arg Ile Gly Asp Pro Pro Lys Lys Lys
1 5 10 15
Arg Lys Val
<210> 6
<211> 24
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 6
Gly Ala Leu Phe Leu Gly Trp Leu Gly Ala Ala Gly Ser Thr Met Gly
1 5 10 15
Ala Pro Lys Lys Lys Arg Lys Val
20
<210> 7
<211> 27
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 7
Gly Ala Leu Phe Leu Gly Phe Leu Gly Ala Ala Gly Ser Thr Met Gly
1 5 10 15
Ala Trp Ser Gln Pro Lys Lys Lys Arg Lys Val
20 25
<210> 8
<211> 21
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 8
Lys Glu Thr Trp Trp Glu Thr Trp Trp Thr Glu Trp Ser Gln Pro Lys
1 5 10 15
Lys Lys Arg Lys Val
20
<210> 9
<211> 21
<212> DNA
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 9
ctcccctgct tcttgtcgta t 21
<210> 10
<211> 20
<212> DNA
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 10
acaggtcgtg gacactcaca 20
<210> 11
<211> 23
<212> DNA
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 11
cggctgtcat cacttagacc tca 23
<210> 12
<211> 24
<212> DNA
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 12
gcagcctaag ggtgggaaaa taga 24
<210> 13
<211> 25
<212> DNA
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 13
agggcaagtt aagggaatag tggaa 25
<210> 14
<211> 25
<212> DNA
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 14
ccaagggtag accaccagta atctg 25
<210> 15
<211> 101
<212> DNA
<213> Homo sapiens
<400> 15
cctttccagc attcgccagt acgagcttgt ggtccacacc gacatagatg cggccaaggt 60
gtacatgggg gagatgggcc ggctgaagag ctacgagaac c 101
<210> 16
<211> 101
<212> DNA
<213> Homo sapiens
<400> 16
ggttctcgta gctcttcagc cggcccatct cccccatgta caccttggcc gcatctatgt 60
cggtgtggac cacaagctcg tactggcgaa tgctggaaag g 101
<210> 17
<211> 105
<212> DNA
<213> Homo sapiens
<400> 17
ccgcttcccg gcctcaccct tggtctcccc tttccagcat tcgccagtac gagcttgtgg 60
tccacaccga catagatgcg gccaaggtgt acatggggga gatgg 105
<210> 18
<211> 105
<212> DNA
<213> Homo sapiens
<400> 18
ccatctcccc catgtacacc ttggccgcat ctatgtcggt gtggaccaca agctcgtact 60
ggcgaatgct ggaaagggga gaccaagggt gaggccggga agcgg 105
<210> 19
<211> 110
<212> DNA
<213> Homo sapiens
<400> 19
ccgcttcccg gcctcaccct tggtctcccc tttccagcat tcgccagtac gagcttgtgg 60
tccacaccga catagatgcg gccaaggtgt acatggggga gatgggccgg 110
<210> 20
<211> 110
<212> DNA
<213> Homo sapiens
<400> 20
ccggcccatc tcccccatgt acaccttggc cgcatctatg tcggtgtgga ccacaagctc 60
gtactggcga atgctggaaa ggggagacca agggtgaggc cgggaagcgg 110
<210> 21
<211> 117
<212> DNA
<213> Homo sapiens
<400> 21
tcgactgttg cttacacttt cttctgacat aacagtgttc actagcaacc tcaaacagac 60
accatggtgc atctgactcc tgaggagaag actgctgtca atgccctgtg gggcaaa 117
<210> 22
<211> 117
<212> DNA
<213> Homo sapiens
<400> 22
gaacggggtg tcccgtcatt gccgtctgaa gaggagtcct cagtctacgt ggtaccacag 60
acaaactcca acgatcactt gtgtcaacac agtcttcgtt tacattcgtt atctacc 117
<210> 23
<211> 142
<212> DNA
<213> Homo sapiens
<220>
<221> misc_feature
<222> (74)..(113)
<223> n is a, c, g, or t
<400> 23
tgtacatggg ggagatgggc cggctgaaga gctacgagaa ccagaagccg tgagtggagg 60
gagcgtggct tggnnnnnnn nnnnnnnnnn nnnnnnnnnn nnnnnnnnnn nnntctgccg 120
tgtatcccca tatccccaca gg 142
<210> 24
<211> 142
<212> DNA
<213> Homo sapiens
<220>
<221> misc_feature
<222> (30)..(69)
<223> n is a, c, g, or t
<400> 24
cctgtgggga tatggggata cacggcagan nnnnnnnnnn nnnnnnnnnn nnnnnnnnnn 60
nnnnnnnnnc caagccacgc tccctccact cacggcttct ggttctcgta gctcttcagc 120
cggcccatct cccccatgta ca 142
<210> 25
<211> 47
<212> DNA
<213> Homo sapiens
<400> 25
cagggatcct gtgtccccga gctgggacca ccttatattc ccagggc 47
<210> 26
<211> 47
<212> DNA
<213> Homo sapiens
<400> 26
gccctggcaa tataaggtgg tcccagctcg gggacacagg atccctg 47
<210> 27
<211> 88
<212> DNA
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 27
cacccttggt ctcccctttc cagcattcgc cagtacgagc gaattcttgt ggtccacacc 60
gacatagatg cggccaaggt gtacatgg 88
<210> 28
<211> 11
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 28
Tyr Gly Arg Lys Lys Arg Arg Gln Arg Arg Arg
1 5 10
<210> 29
<211> 9
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 29
Arg Lys Lys Arg Arg Gln Arg Arg Arg
1 5
<210> 30
<211> 9
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 30
Pro Ala Ala Lys Arg Val Lys Leu Asp
1 5
<210> 31
<211> 11
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 31
Arg Gln Arg Arg Asn Glu Leu Lys Arg Ser Pro
1 5 10
<210> 32
<211> 8
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 32
Val Ser Arg Lys Arg Pro Arg Pro
1 5
<210> 33
<211> 8
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 33
Pro Pro Lys Lys Ala Arg Glu Asp
1 5
<210> 34
<211> 8
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 34
Pro Gln Pro Lys Lys Lys Pro Leu
1 5
<210> 35
<211> 12
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 35
Ser Ala Leu Ile Lys Lys Lys Lys Lys Met Ala Pro
1 5 10
<210> 36
<211> 7
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 36
Pro Lys Gln Lys Lys Arg Lys
1 5
<210> 37
<211> 10
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 37
Arg Lys Leu Lys Lys Lys Ile Lys Lys Leu
1 5 10
<210> 38
<211> 10
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 38
Arg Glu Lys Lys Lys Phe Leu Lys Arg Arg
1 5 10
<210> 39
<211> 20
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 39
Lys Arg Lys Gly Asp Glu Val Asp Gly Val Asp Glu Val Ala Lys Lys
1 5 10 15
Lys Ser Lys Lys
20
<210> 40
<211> 17
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 40
Arg Lys Cys Leu Gln Ala Gly Met Asn Leu Glu Ala Arg Lys Thr Lys
1 5 10 15
Lys
<210> 41
<211> 38
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 41
Asn Gln Ser Ser Asn Phe Gly Pro Met Lys Gly Gly Asn Phe Gly Gly
1 5 10 15
Arg Ser Ser Gly Pro Tyr Gly Gly Gly Gly Gln Tyr Phe Ala Lys Pro
20 25 30
Arg Asn Gln Gly Gly Tyr
35
<210> 42
<211> 42
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 42
Arg Met Arg Ile Glx Phe Lys Asn Lys Gly Lys Asp Thr Ala Glu Leu
1 5 10 15
Arg Arg Arg Arg Val Glu Val Ser Val Glu Leu Arg Lys Ala Lys Lys
20 25 30
Asp Glu Gln Ile Leu Lys Arg Arg Asn Val
35 40
<210> 43
<211> 11
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 43
Tyr Ala Arg Ala Ala Ala Arg Gln Ala Arg Ala
1 5 10
<210> 44
<211> 11
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 44
Thr His Arg Leu Pro Arg Arg Arg Arg Arg Arg
1 5 10
<210> 45
<211> 11
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHEISZED
<400> 45
Gly Gly Arg Arg Ala Arg Arg Arg Arg Arg Arg
1 5 10
<210> 46
<211> 12
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 46
Arg Arg Gln Arg Arg Thr Ser Lys Leu Met Lys Arg
1 5 10
<210> 47
<211> 27
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 47
Gly Trp Thr Leu Asn Ser Ala Gly Tyr Leu Leu Gly Lys Ile Asn Leu
1 5 10 15
Lys Ala Leu Ala Ala Leu Ala Lys Lys Ile Leu
20 25
<210> 48
<211> 33
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 48
Lys Ala Leu Ala Trp Glu Ala Lys Leu Ala Lys Ala Leu Ala Lys Ala
1 5 10 15
Leu Ala Lys His Leu Ala Lys Ala Leu Ala Lys Ala Leu Lys Cys Glu
20 25 30
Ala
<210> 49
<211> 16
<212> PRT
<213> Artificial Sequence
<220>
<223> SYNTHESIZED
<400> 49
Arg Gln Ile Lys Ile Trp Phe Gln Asn Arg Arg Met Lys Trp Lys Lys
1 5 10 15
Claims (51)
- 다음을 포함하는 조성물:
(a) 프로그램가능 DNA 변형 단백질 또는 이러한 프로그램가능 DNA 변형 단백질을 인코딩하는 핵산, 이때 프로그램가능 DNA 변형 단백질은 RNA-안내된 군집된 규칙적으로 산재된 짧은 회귀성 반복 (CRISPR) 뉴클레아제 시스템이고;
(b) 최소한 하나의 프로그램가능 DNA 결합 단백질 또는 이러한 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산, 이때 최소한 하나의 프로그램가능 DNA 결합 단백질은 뉴클레아제 활성을 결여한 CRISPR 시스템이고; 및
(c) 공여자 서열을 포함하는 공여자 폴리뉴클레오티드,
이때 각 CRISPR 시스템은 CRISPR 단백질 및 안내 RNA를 포함하고;
상기 프로그램가능 DNA 변형 단백질은 표적 염색체 서열에 표적화되고 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질 각각은 표적 염색체 서열의 어느 한쪽 측면 상의 250개 염기쌍 내 부위에 표적화되고; 그리고
각 CRISPR 단백질은 II형 CRISPR 단백질 또는 V형 CRISPR 단백질임. - 청구항 1에 있어서, 상기 최소한 하나의 프로그램가능 DNA 결합 단백질은 표적 염색체 서열의 어느 한쪽 측면 상의 100개 염기쌍 내 부위에 표적화되는, 조성물.
- 청구항 2에 있어서, 상기 최소한 하나의 프로그램가능 DNA 결합 단백질은 표적 염색체 서열의 어느 한쪽 측면 상의 75개 염기쌍 내 부위에 표적화되는, 조성물.
- 청구항 3에 있어서, 상기 최소한 하나의 프로그램가능 DNA 결합 단백질은 표적 염색체 서열의 어느 한쪽 측면 상의 50개 염기쌍 내 부위에 표적화되는, 조성물.
- 청구항 4에 있어서, 상기 최소한 하나의 프로그램가능 DNA 결합 단백질은 표적 염색체 서열의 어느 한쪽 측면 상의 25개 염기쌍 내 부위에 표적화되는, 조성물.
- 청구항 1 내지 5 중 어느 한 항에 있어서, 뉴클레아제 활성이 결여된 CRISPR 시스템은 촉매적으로 비활성 CRISPR 단백질인, 조성물.
- 청구항 1 내지 5 중 어느 한 항에 있어서, 각 CRISPR 단백질을 인코딩하는 핵산은 mRNA 또는 DNA인, 조성물.
- 청구항 1 내지 5 중 어느 한 항에 있어서, 각 CRISPR 단백질을 인코딩하는 핵산 및/또는 각 안내 RNA를 인코딩하는 핵산은 플라스미드 벡터 또는 바이러스 벡터의 일부인, 조성물.
- 청구항 1 내지 5 중 어느 한 항에 있어서, 각 CRISPR 시스템의 안내 RNA는 최소한 부분적으로 화학적으로 합성되는, 조성물.
- 청구항 1 내지 5 중 어느 한 항에 있어서, 각 CRISPR 시스템의 안내 RNA는 효소적으로 합성되는, 조성물.
- 청구항 1 내지 5 중 어느 한 항의 조성물을 포함하는 키트.
- 진핵 세포에 다음을 도입하는 단계를 포함하는, 진핵 세포에서 표적화된 유전체 변형을 위한 시험관내 또는 생체외 방법:
(a) 프로그램가능 DNA 변형 단백질 또는 이러한 프로그램가능 DNA 변형 단백질을 인코딩하는 핵산, 이때 프로그램가능 DNA 변형 단백질은 RNA-안내된 군집된 규칙적으로 산재된 짧은 회귀성 반복 (CRISPR) 뉴클레아제 시스템이고;
(b) 최소한 하나의 프로그램가능 DNA 결합 단백질 또는 상기 최소한 하나의 프로그램가능 DNA 결합 단백질을 인코딩하는 핵산, 이때 최소한 하나의 프로그램가능 DNA 결합 단백질은 뉴클레아제 활성을 결여한 CRISPR 시스템이고; 및
(c) 공여자 서열을 포함하는 공여자 폴리뉴클레오티드;
이때 각 CRISPR 시스템은 CRISPR 단백질 및 안내 RNA를 포함하고;
상기 프로그램가능 DNA 변형 단백질은 표적 염색체 서열에 표적화되고 그리고 최소한 하나의 프로그램가능 DNA 결합 단백질 각각은 표적 염색체 서열의 근위 부위에 표적화되고;
표적 염색체 서열의 근위 부위에 대한 최소한 하나의 프로그램가능 DNA 결합 단백질의 결합은 표적 염색체 서열에 대한 프로그램가능 DNA 변형 단백질의 접근성을 증가시키고, 이에 따라 표적화된 유전체 변형 효율 및/또는 특이성을 증가시키고;
각 CRISPR 단백질은 II형 CRISPR 단백질 또는 V형 CRISPR 단백질이고; 그리고
상기 표적 염색체 서열의 근위 부위는 표적 염색체 서열의 어느 한쪽 측면 상의 250개 염기쌍 내에 위치되고,
이 방법은 인간의 생식계열 유전자 동일성을 변형시키는 과정, 또는 인간 배아를 산업적 또는 상업적 목적으로 사용하는 것을 포함하지 않는, 방법. - 청구항 12에 있어서, 표적 염색체 서열의 근위 부위는 표적 염색체 서열의 어느 한쪽 측면 상의 100, 75, 50, 또는 25개 염기쌍 내에 위치되는, 방법.
- 청구항 12 또는 청구항 13에 있어서, 뉴클레아제 활성이 결여된 CRISPR 시스템은 촉매적으로 비활성 CRISPR 단백질인, 방법.
- 청구항 12 또는 청구항 13에 있어서, 진핵 세포는 시험관내 존재하는, 방법.
- 청구항 12 또는 청구항 13에 있어서, 진핵 세포는 포유류 세포인, 방법.
- 청구항 16에 있어서, 포유류 세포는 인간 세포인, 방법.
- 청구항 12 또는 청구항 13에 있어서, 프로그램가능 DNA 변형 단백질 및 최소한 하나의 프로그램가능 DNA 결합 단백질은 서로 상이한 CRISPR 단백질 유형 또는 하위유형인, 방법.
- 청구항 12에 있어서,
(i) 프로그램가능 DNA 변형 단백질은 II형 CRISPR 단백질이고 최소한 하나의 프로그램가능 DNA 결합 단백질은 V형 CRISPR 단백질이고,
(ii) 프로그램가능 DNA 변형 단백질은 V형 CRISPR 단백질이고 최소한 하나의 프로그램가능 DNA 결합 단백질은 II형 CRISPR 단백질이고, 또는
(iii) 프로그램가능 DNA 변형 단백질은 V형 CRISPR 단백질이고 최소한 하나의 프로그램가능 DNA 결합 단백질은 V형 CRISPR 단백질인, 방법. - 청구항 12에 있어서,
(i) 프로그램가능 DNA 변형 단백질은 IIA형 CRISPR 단백질이고 최소한 하나의 프로그램가능 DNA 결합 단백질은 IIB형 CRISPR 단백질이고,
(ii) 프로그램가능 DNA 변형 단백질은 IIB형 CRISPR 단백질이고 최소한 하나의 프로그램가능 DNA 결합 단백질은 IIA형 CRISPR 단백질이고,
(iii) 프로그램가능 DNA 변형 단백질은 IIC형 CRISPR 단백질이고 최소한 하나의 프로그램가능 DNA 결합 단백질은 IIA형 CRISPR 단백질이고, 또는
(iv) 프로그램가능 DNA 변형 단백질은 V형 CRISPR 단백질이고 최소한 하나의 프로그램가능 DNA 결합 단백질은 IIA형 CRISPR 단백질인, 방법. - 청구항 19 또는 청구항 20에 있어서, (i) II형 CRISPR 단백질은 프란시셀라 노비시다 (Francisella novicida) CRISPR-Cas9 (FnCas9), 캄필로박터 제주니 (Campylobacter jejuni) CRISPR-Cas9 (CjCas9) 및 스트렙토코쿠스 피오게네스 (Streptococcus pyogenes) CRISPR-Cas9 (SpCas9)에서 선택되고; 및/또는 (ii) V형 CRISPR 단백질은 프란시셀라 노비시다 (Francisella novicida) CRISPR-Cpf1 (FnCpf1)인, 방법.
- 청구항 19 또는 청구항 20에 있어서, 최소한 하나의 프로그램가능 DNA 결합 단백질은 Cas9 II형 CRISPR 단백질이고, 이때 Cas9 단백질은 RuvC-유사 도메인 및 HNH-유사 도메인 각각에 하나 이상의 돌연변이를 가지는, 방법.
- 청구항 22에 있어서, (i) RuvC-유사 도메인의 하나 이상의 돌연변이는 D10A, DSA, E762A, 및/또는 D986A이고; 및/또는 (ii) HNH-유사 도메인의 하나 이상의 돌연변이는 H840A, H559A, N854A, N856A, 및/또는 N863A인, 방법.
- 청구항 12 또는 청구항 13에 있어서, 공여자 서열은 외인성 서열인, 방법.
- 청구항 12 또는 청구항 13에 있어서, 공여자 폴리뉴클레오티드는 벡터인, 방법.
- 청구항 12 또는 청구항 13에 있어서, 공여자 폴리뉴클레오티드는 선형 서열인 방법.
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
Priority Applications (1)
Application Number | Priority Date | Filing Date | Title |
---|---|---|---|
KR1020227036504A KR20220147710A (ko) | 2016-06-02 | 2017-02-20 | 프로그램가능한 dna 결합 단백질을 사용한, 표적화된 게놈 변형의 개선 |
Applications Claiming Priority (5)
Application Number | Priority Date | Filing Date | Title |
---|---|---|---|
US201662344858P | 2016-06-02 | 2016-06-02 | |
US62/344,858 | 2016-06-02 | ||
US201662358415P | 2016-07-05 | 2016-07-05 | |
US62/358,415 | 2016-07-05 | ||
PCT/US2017/018589 WO2017209809A1 (en) | 2016-06-02 | 2017-02-20 | Using programmable dna binding proteins to enhance targeted genome modification |
Related Child Applications (1)
Application Number | Title | Priority Date | Filing Date |
---|---|---|---|
KR1020227036504A Division KR20220147710A (ko) | 2016-06-02 | 2017-02-20 | 프로그램가능한 dna 결합 단백질을 사용한, 표적화된 게놈 변형의 개선 |
Publications (2)
Publication Number | Publication Date |
---|---|
KR20190025565A KR20190025565A (ko) | 2019-03-11 |
KR102458395B1 true KR102458395B1 (ko) | 2022-10-25 |
Family
ID=58108457
Family Applications (2)
Application Number | Title | Priority Date | Filing Date |
---|---|---|---|
KR1020187037407A KR102458395B1 (ko) | 2016-06-02 | 2017-02-20 | 프로그램가능한 dna 결합 단백질을 사용한, 표적화된 게놈 변형의 개선 |
KR1020227036504A KR20220147710A (ko) | 2016-06-02 | 2017-02-20 | 프로그램가능한 dna 결합 단백질을 사용한, 표적화된 게놈 변형의 개선 |
Family Applications After (1)
Application Number | Title | Priority Date | Filing Date |
---|---|---|---|
KR1020227036504A KR20220147710A (ko) | 2016-06-02 | 2017-02-20 | 프로그램가능한 dna 결합 단백질을 사용한, 표적화된 게놈 변형의 개선 |
Country Status (17)
Country | Link |
---|---|
US (3) | US10266851B2 (ko) |
EP (3) | EP3907286A1 (ko) |
JP (3) | JP6878468B2 (ko) |
KR (2) | KR102458395B1 (ko) |
CN (2) | CN116064529A (ko) |
AU (4) | AU2017274145B2 (ko) |
BR (1) | BR112018074531B1 (ko) |
CA (2) | CA3026321C (ko) |
DK (2) | DK3272867T3 (ko) |
ES (2) | ES2760477T3 (ko) |
GB (3) | GB2582731B8 (ko) |
IL (5) | IL289989B (ko) |
LT (1) | LT3604527T (ko) |
PL (2) | PL3604527T3 (ko) |
PT (2) | PT3272867T (ko) |
SG (1) | SG11201810003UA (ko) |
WO (1) | WO2017209809A1 (ko) |
Families Citing this family (82)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
CA2853829C (en) | 2011-07-22 | 2023-09-26 | President And Fellows Of Harvard College | Evaluation and improvement of nuclease cleavage specificity |
US20150044192A1 (en) | 2013-08-09 | 2015-02-12 | President And Fellows Of Harvard College | Methods for identifying a target site of a cas9 nuclease |
US9359599B2 (en) | 2013-08-22 | 2016-06-07 | President And Fellows Of Harvard College | Engineered transcription activator-like effector (TALE) domains and uses thereof |
US9737604B2 (en) | 2013-09-06 | 2017-08-22 | President And Fellows Of Harvard College | Use of cationic lipids to deliver CAS9 |
US9228207B2 (en) | 2013-09-06 | 2016-01-05 | President And Fellows Of Harvard College | Switchable gRNAs comprising aptamers |
US9388430B2 (en) | 2013-09-06 | 2016-07-12 | President And Fellows Of Harvard College | Cas9-recombinase fusion proteins and uses thereof |
US11053481B2 (en) | 2013-12-12 | 2021-07-06 | President And Fellows Of Harvard College | Fusions of Cas9 domains and nucleic acid-editing domains |
US10077453B2 (en) | 2014-07-30 | 2018-09-18 | President And Fellows Of Harvard College | CAS9 proteins including ligand-dependent inteins |
IL294014B2 (en) | 2015-10-23 | 2024-07-01 | Harvard College | Nucleobase editors and their uses |
EP3907286A1 (en) | 2016-06-02 | 2021-11-10 | Sigma-Aldrich Co., LLC | Using programmable dna binding proteins to enhance targeted genome modification |
US11293021B1 (en) | 2016-06-23 | 2022-04-05 | Inscripta, Inc. | Automated cell processing methods, modules, instruments, and systems |
US10253316B2 (en) | 2017-06-30 | 2019-04-09 | Inscripta, Inc. | Automated cell processing methods, modules, instruments, and systems |
US11078481B1 (en) | 2016-08-03 | 2021-08-03 | KSQ Therapeutics, Inc. | Methods for screening for cancer targets |
IL308426A (en) | 2016-08-03 | 2024-01-01 | Harvard College | Adenosine nuclear base editors and their uses |
US11661590B2 (en) | 2016-08-09 | 2023-05-30 | President And Fellows Of Harvard College | Programmable CAS9-recombinase fusion proteins and uses thereof |
US11542509B2 (en) | 2016-08-24 | 2023-01-03 | President And Fellows Of Harvard College | Incorporation of unnatural amino acids into proteins using base editing |
US11078483B1 (en) | 2016-09-02 | 2021-08-03 | KSQ Therapeutics, Inc. | Methods for measuring and improving CRISPR reagent function |
SG11201903089RA (en) | 2016-10-14 | 2019-05-30 | Harvard College | Aav delivery of nucleobase editors |
WO2018119359A1 (en) | 2016-12-23 | 2018-06-28 | President And Fellows Of Harvard College | Editing of ccr5 receptor gene to protect against hiv infection |
US11898179B2 (en) | 2017-03-09 | 2024-02-13 | President And Fellows Of Harvard College | Suppression of pain by gene editing |
EP3592777A1 (en) | 2017-03-10 | 2020-01-15 | President and Fellows of Harvard College | Cytosine to guanine base editor |
JP7191388B2 (ja) | 2017-03-23 | 2022-12-19 | プレジデント アンド フェローズ オブ ハーバード カレッジ | 核酸によってプログラム可能なdna結合蛋白質を含む核酸塩基編集因子 |
US11560566B2 (en) | 2017-05-12 | 2023-01-24 | President And Fellows Of Harvard College | Aptazyme-embedded guide RNAs for use with CRISPR-Cas9 in genome editing and transcriptional activation |
US10011849B1 (en) | 2017-06-23 | 2018-07-03 | Inscripta, Inc. | Nucleic acid-guided nucleases |
US9982279B1 (en) | 2017-06-23 | 2018-05-29 | Inscripta, Inc. | Nucleic acid-guided nucleases |
CN111801345A (zh) | 2017-07-28 | 2020-10-20 | 哈佛大学的校长及成员们 | 使用噬菌体辅助连续进化(pace)的进化碱基编辑器的方法和组合物 |
KR20200017479A (ko) * | 2017-07-31 | 2020-02-18 | 시그마-알드리치 컴퍼니., 엘엘씨 | Crispr/cas 활성제 시스템용 합성 유도 rna |
US11319532B2 (en) | 2017-08-30 | 2022-05-03 | President And Fellows Of Harvard College | High efficiency base editors comprising Gam |
US11709156B2 (en) | 2017-09-18 | 2023-07-25 | Waters Technologies Corporation | Use of vapor deposition coated flow paths for improved analytical analysis |
US11709155B2 (en) | 2017-09-18 | 2023-07-25 | Waters Technologies Corporation | Use of vapor deposition coated flow paths for improved chromatography of metal interacting analytes |
CN111757937A (zh) | 2017-10-16 | 2020-10-09 | 布罗德研究所股份有限公司 | 腺苷碱基编辑器的用途 |
WO2019126716A1 (en) * | 2017-12-22 | 2019-06-27 | The Broad Institute, Inc. | Cas12b systems, methods, and compositions for targeted rna base editing |
US20230193242A1 (en) * | 2017-12-22 | 2023-06-22 | The Broad Institute, Inc. | Cas12b systems, methods, and compositions for targeted dna base editing |
KR102465067B1 (ko) * | 2018-02-15 | 2022-11-10 | 시그마-알드리치 컴퍼니., 엘엘씨 | 진핵 게놈 변형을 위한 조작된 cas9 시스템 |
WO2019200004A1 (en) | 2018-04-13 | 2019-10-17 | Inscripta, Inc. | Automated cell processing instruments comprising reagent cartridges |
US10858761B2 (en) | 2018-04-24 | 2020-12-08 | Inscripta, Inc. | Nucleic acid-guided editing of exogenous polynucleotides in heterologous cells |
US10557216B2 (en) | 2018-04-24 | 2020-02-11 | Inscripta, Inc. | Automated instrumentation for production of T-cell receptor peptide libraries |
US10508273B2 (en) | 2018-04-24 | 2019-12-17 | Inscripta, Inc. | Methods for identifying selective binding pairs |
CA3108767A1 (en) | 2018-06-30 | 2020-01-02 | Inscripta, Inc. | Instruments, modules, and methods for improved detection of edited sequences in live cells |
EP4442836A2 (en) | 2018-08-01 | 2024-10-09 | Mammoth Biosciences, Inc. | Programmable nuclease compositions and methods of use thereof |
US10532324B1 (en) | 2018-08-14 | 2020-01-14 | Inscripta, Inc. | Instruments, modules, and methods for improved detection of edited sequences in live cells |
US11142740B2 (en) | 2018-08-14 | 2021-10-12 | Inscripta, Inc. | Detection of nuclease edited sequences in automated modules and instruments |
WO2020041313A1 (en) * | 2018-08-21 | 2020-02-27 | Sigma-Aldrich Co. Llc | Down-regulation of the cytosolic dna sensor pathway |
AU2019326408A1 (en) * | 2018-08-23 | 2021-03-11 | Sangamo Therapeutics, Inc. | Engineered target specific base editors |
WO2020081149A2 (en) | 2018-08-30 | 2020-04-23 | Inscripta, Inc. | Improved detection of nuclease edited sequences in automated modules and instruments |
US11214781B2 (en) | 2018-10-22 | 2022-01-04 | Inscripta, Inc. | Engineered enzyme |
EP3870697A4 (en) | 2018-10-22 | 2022-11-09 | Inscripta, Inc. | MODIFIED ENZYMES |
EP3931313A2 (en) | 2019-01-04 | 2022-01-05 | Mammoth Biosciences, Inc. | Programmable nuclease improvements and compositions and methods for nucleic acid amplification and detection |
CN110804628B (zh) * | 2019-02-28 | 2023-05-12 | 中国科学院脑科学与智能技术卓越创新中心 | 高特异性无脱靶单碱基基因编辑工具 |
WO2020191243A1 (en) | 2019-03-19 | 2020-09-24 | The Broad Institute, Inc. | Methods and compositions for editing nucleotide sequences |
AU2020247900A1 (en) | 2019-03-25 | 2021-11-04 | Inscripta, Inc. | Simultaneous multiplex genome editing in yeast |
US11001831B2 (en) | 2019-03-25 | 2021-05-11 | Inscripta, Inc. | Simultaneous multiplex genome editing in yeast |
AU2020288623A1 (en) | 2019-06-06 | 2022-01-06 | Inscripta, Inc. | Curing for recursive nucleic acid-guided cell editing |
EP3986909A4 (en) | 2019-06-21 | 2023-08-02 | Inscripta, Inc. | GENOME-WIDE RATIONAL DESIGNED MUTATIONS LEADING TO INCREASED LYSINE PRODUCTION IN E. COLI |
US10927385B2 (en) | 2019-06-25 | 2021-02-23 | Inscripta, Inc. | Increased nucleic-acid guided cell editing in yeast |
EP3783104A1 (en) * | 2019-08-20 | 2021-02-24 | Kemijski Institut | Coiled-coil mediated tethering of crispr-cas and exonucleases for enhanced genome editing |
MX2022002642A (es) * | 2019-09-05 | 2022-06-14 | Benson Hill Inc | Composiciones y metodos para modificar genomas. |
WO2021102059A1 (en) | 2019-11-19 | 2021-05-27 | Inscripta, Inc. | Methods for increasing observed editing in bacteria |
EP4069837A4 (en) | 2019-12-10 | 2024-03-13 | Inscripta, Inc. | NEW MAD NUCLEASES |
US10704033B1 (en) | 2019-12-13 | 2020-07-07 | Inscripta, Inc. | Nucleic acid-guided nucleases |
AU2020405289A1 (en) * | 2019-12-17 | 2022-07-21 | Aridis Pharmaceuticals, Inc. | Methods of enhancing and expediting expression of antibodies |
US11008557B1 (en) | 2019-12-18 | 2021-05-18 | Inscripta, Inc. | Cascade/dCas3 complementation assays for in vivo detection of nucleic acid-guided nuclease edited cells |
EP4081260A4 (en) * | 2019-12-23 | 2024-01-17 | The Broad Institute Inc. | PROGRAMMABLE DNA NUCLEASE-ASSOCIATED LIGASE AND METHODS OF USE THEREOF |
US10689669B1 (en) | 2020-01-11 | 2020-06-23 | Inscripta, Inc. | Automated multi-module cell processing methods, instruments, and systems |
US11918936B2 (en) | 2020-01-17 | 2024-03-05 | Waters Technologies Corporation | Performance and dynamic range for oligonucleotide bioanalysis through reduction of non specific binding |
CA3157061A1 (en) | 2020-01-27 | 2021-08-05 | Christian SILTANEN | Electroporation modules and instrumentation |
CA3180807A1 (en) * | 2020-04-20 | 2021-10-28 | Integrated Dna Technologies, Inc. | Optimized protein fusions and linkers |
US20210332388A1 (en) | 2020-04-24 | 2021-10-28 | Inscripta, Inc. | Compositions, methods, modules and instruments for automated nucleic acid-guided nuclease editing in mammalian cells |
DE112021002672T5 (de) | 2020-05-08 | 2023-04-13 | President And Fellows Of Harvard College | Vefahren und zusammensetzungen zum gleichzeitigen editieren beider stränge einer doppelsträngigen nukleotid-zielsequenz |
US11787841B2 (en) | 2020-05-19 | 2023-10-17 | Inscripta, Inc. | Rationally-designed mutations to the thrA gene for enhanced lysine production in E. coli |
EP4214314A4 (en) | 2020-09-15 | 2024-10-16 | Inscripta Inc | CRISPR EDITING TO EMBED NUCLEIC ACID LANDING PADS INTO LIVING CELL GENOMES |
JP2023541990A (ja) * | 2020-09-18 | 2023-10-04 | インスティチュート フォー ベーシック サイエンス | 標的化された脱アミノ酵素およびそれを用いた塩基編集 |
US11512297B2 (en) | 2020-11-09 | 2022-11-29 | Inscripta, Inc. | Affinity tag for recombination protein recruitment |
EP4271802A1 (en) | 2021-01-04 | 2023-11-08 | Inscripta, Inc. | Mad nucleases |
US11332742B1 (en) | 2021-01-07 | 2022-05-17 | Inscripta, Inc. | Mad nucleases |
WO2022163770A1 (ja) * | 2021-01-28 | 2022-08-04 | 国立研究開発法人理化学研究所 | ゲノム編集ツールの評価方法 |
US11884924B2 (en) | 2021-02-16 | 2024-01-30 | Inscripta, Inc. | Dual strand nucleic acid-guided nickase editing |
CN115261359B (zh) * | 2021-05-21 | 2023-06-30 | 山东舜丰生物科技有限公司 | 一种新型crispr酶和系统以及应用 |
CN114250172B (zh) * | 2021-12-09 | 2023-05-23 | 中国科学院海洋研究所 | 一种海运海杆菌及其应用 |
CN114507689B (zh) * | 2022-01-27 | 2024-01-16 | 山东大学 | 一种提高真核生物基因编辑效率的方法及其应用 |
CN114606251B (zh) * | 2022-03-30 | 2023-02-28 | 呈诺再生医学科技(珠海横琴新区)有限公司 | 以外泌体为载体的dna递送系统 |
KR20240041835A (ko) * | 2022-09-21 | 2024-04-01 | 기초과학연구원 | 식물세포 소기관 dna의 염기 교정 |
Citations (1)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
WO2014191518A1 (en) | 2013-05-29 | 2014-12-04 | Cellectis | A method for producing precise dna cleavage using cas9 nickase activity |
Family Cites Families (66)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
JPS501B1 (ko) | 1970-05-19 | 1975-01-06 | ||
GB1506509A (en) | 1975-12-19 | 1978-04-05 | Nissan Motor | Apparatus for mounting instruments on the instrument panel of a motor vehicle |
JP2610720B2 (ja) | 1991-06-24 | 1997-05-14 | 株式会社クボタ | 作業機のローリング制御装置 |
US6534261B1 (en) * | 1999-01-12 | 2003-03-18 | Sangamo Biosciences, Inc. | Regulation of endogenous gene expression in cells using zinc finger proteins |
GB9915126D0 (en) | 1999-06-30 | 1999-09-01 | Imp College Innovations Ltd | Control of gene expression |
EP1276865B1 (en) | 2000-04-28 | 2014-05-21 | Sangamo BioSciences, Inc. | Methods for binding an exogenous molecule to cellular chromatin |
US20030232430A1 (en) | 2001-11-26 | 2003-12-18 | Advanced Cell Technology | Methods for making and using reprogrammed human somatic cell nuclei and autologous and isogenic human stem cells |
CA2534296C (en) * | 2003-08-08 | 2013-03-26 | Sangamo Biosciences, Inc. | Methods and compositions for targeted cleavage and recombination |
US20070134796A1 (en) | 2005-07-26 | 2007-06-14 | Sangamo Biosciences, Inc. | Targeted integration and expression of exogenous nucleic acid sequences |
US7972854B2 (en) | 2004-02-05 | 2011-07-05 | Sangamo Biosciences, Inc. | Methods and compositions for targeted cleavage and recombination |
US20050220796A1 (en) | 2004-03-31 | 2005-10-06 | Dynan William S | Compositions and methods for modulating DNA repair |
JP5156953B2 (ja) * | 2006-03-08 | 2013-03-06 | 国立大学法人京都大学 | 核酸切断剤 |
EP2518155B1 (en) | 2006-08-04 | 2014-07-23 | Georgia State University Research Foundation, Inc. | Enzyme sensors, methods for preparing and using such sensors, and methods of detecting protease activity |
TR201905633T4 (tr) | 2007-03-02 | 2019-05-21 | Dupont Nutrition Biosci Aps | İyileştirilmiş faj direnci olan kültürler. |
GB0806086D0 (en) | 2008-04-04 | 2008-05-14 | Ulive Entpr Ltd | Dendrimer polymer hybrids |
US8546553B2 (en) | 2008-07-25 | 2013-10-01 | University Of Georgia Research Foundation, Inc. | Prokaryotic RNAi-like system and methods of use |
US20100076057A1 (en) | 2008-09-23 | 2010-03-25 | Northwestern University | TARGET DNA INTERFERENCE WITH crRNA |
WO2010054108A2 (en) | 2008-11-06 | 2010-05-14 | University Of Georgia Research Foundation, Inc. | Cas6 polypeptides and methods of use |
WO2010075424A2 (en) | 2008-12-22 | 2010-07-01 | The Regents Of University Of California | Compositions and methods for downregulating prokaryotic genes |
US20120192298A1 (en) | 2009-07-24 | 2012-07-26 | Sigma Aldrich Co. Llc | Method for genome editing |
JP2013518602A (ja) | 2010-02-09 | 2013-05-23 | サンガモ バイオサイエンシーズ, インコーポレイテッド | 部分的に一本鎖のドナー分子による標的化ゲノム改変 |
US10087431B2 (en) | 2010-03-10 | 2018-10-02 | The Regents Of The University Of California | Methods of generating nucleic acid fragments |
BR112012028805A2 (pt) | 2010-05-10 | 2019-09-24 | The Regents Of The Univ Of California E Nereus Pharmaceuticals Inc | composições de endorribonuclease e métodos de uso das mesmas. |
EP3156062A1 (en) | 2010-05-17 | 2017-04-19 | Sangamo BioSciences, Inc. | Novel dna-binding proteins and uses thereof |
KR20180121665A (ko) | 2010-07-23 | 2018-11-07 | 시그마-알드리치 컴퍼니., 엘엘씨 | 표적화 엔도뉴클레아제 및 단일-가닥 핵산을 사용하는 게놈 편집 |
JP6049633B2 (ja) | 2010-12-29 | 2016-12-21 | パルマスカンド アクチボラグ | ガス拡散電極 |
US20140113376A1 (en) | 2011-06-01 | 2014-04-24 | Rotem Sorek | Compositions and methods for downregulating prokaryotic genes |
EP2780460B1 (en) | 2011-11-16 | 2018-07-11 | Sangamo Therapeutics, Inc. | Modified dna-binding proteins and uses thereof |
GB201122458D0 (en) | 2011-12-30 | 2012-02-08 | Univ Wageningen | Modified cascade ribonucleoproteins and uses thereof |
US9637739B2 (en) | 2012-03-20 | 2017-05-02 | Vilnius University | RNA-directed DNA cleavage by the Cas9-crRNA complex |
WO2013141680A1 (en) | 2012-03-20 | 2013-09-26 | Vilnius University | RNA-DIRECTED DNA CLEAVAGE BY THE Cas9-crRNA COMPLEX |
CN104471067B (zh) | 2012-05-07 | 2020-08-14 | 桑格摩生物治疗股份有限公司 | 用于核酸酶介导的转基因靶向整合的方法和组合物 |
DK2800811T3 (en) * | 2012-05-25 | 2017-07-17 | Univ Vienna | METHODS AND COMPOSITIONS FOR RNA DIRECTIVE TARGET DNA MODIFICATION AND FOR RNA DIRECTIVE MODULATION OF TRANSCRIPTION |
SG11201503059XA (en) | 2012-10-23 | 2015-06-29 | Toolgen Inc | Composition for cleaving a target dna comprising a guide rna specific for the target dna and cas protein-encoding nucleic acid or cas protein, and use thereof |
KR102243092B1 (ko) | 2012-12-06 | 2021-04-22 | 시그마-알드리치 컴퍼니., 엘엘씨 | Crispr-기초된 유전체 변형과 조절 |
WO2014093655A2 (en) | 2012-12-12 | 2014-06-19 | The Broad Institute, Inc. | Engineering and optimization of systems, methods and compositions for sequence manipulation with functional domains |
US8697359B1 (en) | 2012-12-12 | 2014-04-15 | The Broad Institute, Inc. | CRISPR-Cas systems and methods for altering expression of gene products |
CN105121641A (zh) | 2012-12-17 | 2015-12-02 | 哈佛大学校长及研究员协会 | Rna-引导的人类基因组工程化 |
CN103233028B (zh) | 2013-01-25 | 2015-05-13 | 南京徇齐生物技术有限公司 | 一种无物种限制无生物安全性问题的真核生物基因打靶方法及螺旋结构dna序列 |
EP2971167B1 (en) | 2013-03-14 | 2019-07-31 | Caribou Biosciences, Inc. | Compositions and methods of nucleic acid-targeting nucleic acids |
US20140273230A1 (en) | 2013-03-15 | 2014-09-18 | Sigma-Aldrich Co., Llc | Crispr-based genome modification and regulation |
IL289396B2 (en) | 2013-03-15 | 2023-12-01 | The General Hospital Coporation | Using tru-grnas to increase the specificity of RNA-guided genome editing |
EP3603679B1 (en) * | 2013-06-04 | 2022-08-10 | President and Fellows of Harvard College | Rna-guided transcriptional regulation |
EP3004370B1 (en) * | 2013-06-05 | 2024-08-21 | Duke University | Rna-guided gene editing and gene regulation |
CN103343120B (zh) | 2013-07-04 | 2015-03-04 | 中国科学院遗传与发育生物学研究所 | 一种小麦基因组定点改造方法 |
CN103388006B (zh) | 2013-07-26 | 2015-10-28 | 华东师范大学 | 一种基因定点突变的构建方法 |
WO2015021426A1 (en) | 2013-08-09 | 2015-02-12 | Sage Labs, Inc. | A crispr/cas system-based novel fusion protein and its application in genome editing |
US9388430B2 (en) * | 2013-09-06 | 2016-07-12 | President And Fellows Of Harvard College | Cas9-recombinase fusion proteins and uses thereof |
AU2015218576B2 (en) * | 2014-02-24 | 2020-02-27 | Sangamo Therapeutics, Inc. | Methods and compositions for nuclease-mediated targeted integration |
EP3155102B1 (en) | 2014-06-11 | 2022-11-02 | Duke University | Compositions and methods for rapid and dynamic flux control using synthetic metabolic valves |
US20170198268A1 (en) * | 2014-07-09 | 2017-07-13 | Gen9, Inc. | Compositions and Methods for Site-Directed DNA Nicking and Cleaving |
US10077453B2 (en) * | 2014-07-30 | 2018-09-18 | President And Fellows Of Harvard College | CAS9 proteins including ligand-dependent inteins |
EP3180426B1 (en) | 2014-08-17 | 2019-12-25 | The Broad Institute, Inc. | Genome editing using cas9 nickases |
ES2730378T3 (es) * | 2014-08-27 | 2019-11-11 | Caribou Biosciences Inc | Procedimientos para incrementar la eficiencia de la modificación mediada por Cas9 |
EP3188763B1 (en) * | 2014-09-02 | 2020-05-13 | The Regents of The University of California | Methods and compositions for rna-directed target dna modification |
US20170306306A1 (en) * | 2014-10-24 | 2017-10-26 | Life Technologies Corporation | Compositions and Methods for Enhancing Homologous Recombination |
CA2963820A1 (en) | 2014-11-07 | 2016-05-12 | Editas Medicine, Inc. | Methods for improving crispr/cas-mediated genome-editing |
US10190106B2 (en) * | 2014-12-22 | 2019-01-29 | Univesity Of Massachusetts | Cas9-DNA targeting unit chimeras |
GB201506509D0 (en) * | 2015-04-16 | 2015-06-03 | Univ Wageningen | Nuclease-mediated genome editing |
US9790490B2 (en) * | 2015-06-18 | 2017-10-17 | The Broad Institute Inc. | CRISPR enzymes and systems |
CN107922949A (zh) * | 2015-08-31 | 2018-04-17 | 安捷伦科技有限公司 | 用于通过同源重组的基于crispr/cas的基因组编辑的化合物和方法 |
EP3350327B1 (en) * | 2015-10-23 | 2018-09-26 | Caribou Biosciences, Inc. | Engineered crispr class 2 cross-type nucleic-acid targeting nucleic acids |
ES2735773T3 (es) | 2015-12-04 | 2019-12-20 | Caribou Biosciences Inc | Acidos nucleicos manipulados dirigidos a ácidos nucleicos |
EP3448407A4 (en) * | 2016-04-29 | 2019-10-16 | Bio-Rad Laboratories, Inc. | DIMERE PROTEINS FOR SPECIFIC TARGETING OF NUCLEIC ACID SEQUENCES |
EP3464587B1 (en) * | 2016-05-27 | 2020-12-16 | Life Technologies Corporation | Compositions and methods for enhancing homologous recombination |
EP3907286A1 (en) | 2016-06-02 | 2021-11-10 | Sigma-Aldrich Co., LLC | Using programmable dna binding proteins to enhance targeted genome modification |
-
2017
- 2017-02-20 EP EP21160880.7A patent/EP3907286A1/en active Pending
- 2017-02-20 ES ES17157024T patent/ES2760477T3/es active Active
- 2017-02-20 DK DK17157024T patent/DK3272867T3/da active
- 2017-02-20 PT PT171570245T patent/PT3272867T/pt unknown
- 2017-02-20 WO PCT/US2017/018589 patent/WO2017209809A1/en active Application Filing
- 2017-02-20 CA CA3026321A patent/CA3026321C/en active Active
- 2017-02-20 EP EP19186629.2A patent/EP3604527B1/en active Active
- 2017-02-20 CN CN202211060110.8A patent/CN116064529A/zh active Pending
- 2017-02-20 EP EP17157024.5A patent/EP3272867B1/en active Active
- 2017-02-20 GB GB2010846.0A patent/GB2582731B8/en not_active Expired - Fee Related
- 2017-02-20 IL IL289989A patent/IL289989B/en unknown
- 2017-02-20 US US15/437,148 patent/US10266851B2/en active Active
- 2017-02-20 PL PL19186629T patent/PL3604527T3/pl unknown
- 2017-02-20 ES ES19186629T patent/ES2881355T3/es active Active
- 2017-02-20 CN CN201780048469.4A patent/CN109983124B/zh active Active
- 2017-02-20 AU AU2017274145A patent/AU2017274145B2/en active Active
- 2017-02-20 SG SG11201810003UA patent/SG11201810003UA/en unknown
- 2017-02-20 DK DK19186629.2T patent/DK3604527T3/da active
- 2017-02-20 PL PL17157024T patent/PL3272867T3/pl unknown
- 2017-02-20 IL IL295358A patent/IL295358B2/en unknown
- 2017-02-20 IL IL302238A patent/IL302238B1/en unknown
- 2017-02-20 GB GB1702743.4A patent/GB2552861B/en active Active
- 2017-02-20 PT PT191866292T patent/PT3604527T/pt unknown
- 2017-02-20 KR KR1020187037407A patent/KR102458395B1/ko active IP Right Grant
- 2017-02-20 GB GB1904166.4A patent/GB2578802B8/en active Active
- 2017-02-20 CA CA3209273A patent/CA3209273A1/en active Pending
- 2017-02-20 KR KR1020227036504A patent/KR20220147710A/ko not_active Application Discontinuation
- 2017-02-20 BR BR112018074531-6A patent/BR112018074531B1/pt active IP Right Grant
- 2017-02-20 JP JP2018562948A patent/JP6878468B2/ja active Active
- 2017-02-20 LT LTEP19186629.2T patent/LT3604527T/lt unknown
-
2018
- 2018-11-07 IL IL262854A patent/IL262854B/en active IP Right Grant
-
2019
- 2019-02-15 US US16/277,638 patent/US20190169651A1/en active Pending
- 2019-02-15 US US16/277,614 patent/US12084675B2/en active Active
-
2020
- 2020-06-09 IL IL275244A patent/IL275244B/en unknown
- 2020-09-30 AU AU2020244497A patent/AU2020244497B2/en active Active
-
2021
- 2021-02-01 AU AU2021200636A patent/AU2021200636B2/en active Active
- 2021-04-28 JP JP2021076124A patent/JP7220737B2/ja active Active
-
2023
- 2023-01-31 JP JP2023012725A patent/JP7535142B2/ja active Active
- 2023-05-31 AU AU2023203391A patent/AU2023203391A1/en active Pending
Patent Citations (1)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
WO2014191518A1 (en) | 2013-05-29 | 2014-12-04 | Cellectis | A method for producing precise dna cleavage using cas9 nickase activity |
Non-Patent Citations (1)
Title |
---|
비특허1 |
Also Published As
Similar Documents
Publication | Publication Date | Title |
---|---|---|
KR102458395B1 (ko) | 프로그램가능한 dna 결합 단백질을 사용한, 표적화된 게놈 변형의 개선 | |
KR102655021B1 (ko) | 표적된 게놈 변형을 개선하기 위한 뉴클레오솜 상호작용 단백질 도메인 사용 | |
KR20200017479A (ko) | Crispr/cas 활성제 시스템용 합성 유도 rna | |
US11965184B2 (en) | CRISPR/Cas fusion proteins and systems |
Legal Events
Date | Code | Title | Description |
---|---|---|---|
A201 | Request for examination | ||
A302 | Request for accelerated examination | ||
E902 | Notification of reason for refusal | ||
E701 | Decision to grant or registration of patent right | ||
A107 | Divisional application of patent | ||
GRNT | Written decision to grant |