Summary
Resource Type
mRNA
Organism
Persea americana-Anise
Name
Chr01.g00907.m1
Identifier
Chr01.g00907.m1
Protein Sequence
MPISRYQLRSEYSLADPELYRAADRDDPEALLEGVAMAGLVGVLRQLGDL
AEFAAEIFHELHEEVMATASRGHGLVIRVQQLEAEIPSIEKALLSQTSHS
HLTDGSGIEWHANLRMDQNLITRGDLPRFVMDSYEECRGPPRLFLLDKFD
VAGAGACLKRYSDPSFYKTELASTEMKKAKREKKSRKIKKREARLKKGDA
LEIFSTSQFSSRLHQLASDEKNMPVNVPTSGIRLKRGHLNSASFNSRTGR
SYMEHILELRPFEKRTAFDNSFHTTHLKAESSDVSVSGREIYEISVEDPI
NKFMRRKGTAVLSPKRRVPKLTADELGEDISKGGNLESFPEQISNFELDS
SATFHREGKKYEEIGGGSKPEASMDGCRSDDLGAEKIPTTFHEEHYASDG
SSTKSSVDRSRSKSDIFGTEKIPAALPQMDQSNELLEGNLKQEVGPDNYT
SVELEVEKTTTTSHVVYQKDLLVDSESKTEANADGSSSDKLVVENIPATF
YNVGEKKDALVDDGTKKDAALDGYNHDNFKAETTILRRLGQKDEFVGGES
EIDDNANGYMPVDFEVDKKPSIGSDDSGIQAVVDGYRSDEFEVEKTPSTI
NYLDRKGASVNDEIMGKVGADGYMSDDAASEMDNYMDALTTMESEMETDT
ESRAKRERGLFNVVSHEKDSEINKGQDLHGHCSDTHSIEGFSTTCGSNSL
FKKERSSYSSDSLSNLADVQSPKGNGATSVDVPGIFQSSFTSKDAFAGPV
PDNSCFGSSAKPSYSTDGDAETEVNLSSKMCLAEIHDLSSELLTDDGNIL
KTKSSDCIAPTEFGNEESDSYHKDLVSTFIHLTPSASSNEGQLARSEQTE
ISSLYVEDSAEEIGKHSGNDLQHALETSRLKLQMTEVPLTEFSESCPGES
LNGEIHNPPLHTLPNSSDIADMPGGTKDNDVLEVLAPDVTTEGSSDYLQV
IEVCDPPTQTVQDSTLELVPTGDVEDCASAADNVMNRILDLPDSITASVE
NQLCISTVQDPPYAFLDGQSPPECLPVSPPTDSIDTQANNLIVGVENGVD
PSSYSENLKPADDLREMSEFTVHEHIKPNARILPLESECCCCGEPCNCHV
GDLAEVLSPCSGSETLLSEKIEVLSYTLELEEREKSLPEGIHPNSSILMG
NTSEVADFPSVSVVSNALQHKLTDEDHMGSDDLVSGSLPVTTGCNDGSHG
PIGSPVDTSEAVNLPSISVASNAPNKLTNEDPTLSDDLVSGCFCVATSCN
DKSPEPSGSLESPLNRIQLQEEYLSESASNLYESEISESPNHETQLESDA
QEIHTVAHSENDEALPESTLPDSSESLDYFRHLAPLKDVQTQVPVMNDPE
GHVSLSLGDQESELKSGEDNQLSILKSDHHSYPHENATHTVSLEQAIELE
AVGRNSVPSSHEEEENCESFDVLIQRAETDPPHIDLQQPSEHEKRIDSCA
VYDANLTNGLKTSSSAITIPTSLDPEACIPVRPAQSLEISKSPLSSCSLS
VPSTSSPFIPSFGLLAPETANQRSSGAEECCSLQPDHTQKSSEFPITDSN
SSLPSIPAPVVTSFGLFASDSMHQGALEPELSRSSGSAFPVSHDPPTNLE
DMPPPLPPLPPLEWRMGKVRLASLTFGGEITHSPDSFSPLLTTKDEKSWH
GSSLQGDASWPLNPFAPLPSMENEKPQYGSPSLREEMVQPSNFLVQLPPL
GGERPSLALEGQISQPPRLSMPLSVVEDENDHHAMLTLEGVTQQPLGPFL
QLQTVEEEMPKVNLDVGGNKPKDPLIERGEKPSLALEGRMPQPPPSSYMP
VPVVEDEYPRDVMHTSEGVNQPLDPFPQLHTEEDEKPKGNFHLGPNQPKD
PLIEAIASHDRSMLRKTSECIQTVTKPKSDERNSLLEQIRTKSFNLKPAV
AAKPIIHGPNTNLNVVAILEKANAIRQAFAGSDEDDDSDSWSDS*
Properties
Coding Sequence (CDS)
ATGCCCATTTCGAGATACCAGTTAAGGAGTGAGTACAGCTTAGCAGATCC
AGAGCTCTATCGAGCTGCGGATCGAGATGATCCAGAAGCGCTCCTTGAAG
GGGTCGCCATGGCAGGCCTGGTCGGTGTCCTGCGCCAGCTGGGTGACCTT
GCCGAGTTTGCTGCTGAGATCTTCCATGAATTGCATGAAGAAGTGATGGC
TACTGCTTCTAGAGGTCATGGTCTGGTGATTCGAGTTCAACAACTAGAAG
CAGAGATCCCATCAATTGAAAAGGCTCTTCTTTCTCAGACTAGTCATTCA
CATTTGACTGACGGTTCAGGTATTGAATGGCATGCAAATCTAAGAATGGA
CCAGAATTTGATCACTCGAGGAGATTTACCTCGCTTTGTTATGGATTCCT
ATGAAGAATGCCGTGGCCCGCCTCGGTTATTCCTGTTGGACAAGTTTGAT
GTTGCCGGTGCTGGCGCTTGCTTGAAGAGATACTCTGATCCATCATTTTA
TAAGACAGAATTAGCCTCCACCGAGATGAAGAAAGCAAAAAGAGAAAAGA
AGTCGCGAAAAATTAAGAAGAGAGAAGCACGTTTAAAAAAAGGAGATGCC
CTGGAGATTTTCTCAACATCACAATTTAGTTCAAGGCTGCACCAGTTGGC
TTCAGACGAAAAAAACATGCCTGTAAATGTTCCTACAAGTGGTATAAGGT
TGAAGAGAGGGCACTTAAATAGTGCCTCTTTCAATTCAAGGACTGGAAGA
AGCTACATGGAGCATATTCTCGAACTGCGTCCATTTGAGAAGAGAACTGC
ATTTGACAACTCATTCCACACTACTCACTTGAAGGCGGAATCAAGTGATG
TTAGTGTATCAGGACGTGAAATATATGAGATCAGCGTAGAAGATCCAATT
AATAAATTTATGAGGCGTAAGGGAACCGCAGTCTTGTCTCCTAAAAGACG
GGTACCCAAACTAACTGCAGATGAATTGGGTGAGGATATCAGTAAGGGAG
GTAACTTGGAATCCTTTCCTGAGCAGATATCCAACTTTGAACTAGACAGT
TCTGCTACGTTTCACAGGGAGGGTAAAAAGTACGAGGAAATTGGTGGCGG
AAGCAAGCCAGAAGCCAGTATGGATGGATGCAGGTCTGATGACTTAGGAG
CAGAGAAAATTCCAACCACTTTTCATGAAGAGCACTACGCCTCTGATGGA
AGCAGCACAAAATCAAGTGTTGATAGGTCCAGGTCCAAGTCTGATATATT
TGGAACAGAGAAAATTCCAGCTGCCTTGCCCCAGATGGATCAAAGTAATG
AGTTACTTGAAGGCAACCTTAAGCAAGAGGTTGGCCCTGACAATTACACG
TCTGTTGAATTGGAAGTGGAGAAAACTACCACTACTTCTCATGTGGTGTA
TCAGAAGGATTTGCTGGTTGATAGTGAAAGCAAGACAGAAGCCAATGCTG
ATGGTTCCAGTTCTGACAAACTTGTTGTAGAGAACATTCCCGCCACCTTT
TATAACGTGGGTGAGAAGAAGGATGCATTGGTTGATGATGGAACAAAGAA
AGATGCTGCTCTTGATGGTTATAACCATGATAATTTCAAAGCAGAAACTA
CTATCTTGCGCCGCCTGGGTCAAAAGGATGAGTTTGTTGGCGGTGAGAGT
GAGATAGATGACAATGCTAATGGATACATGCCTGTTGACTTTGAAGTAGA
TAAAAAACCTTCTATTGGTTCTGATGACAGTGGGATCCAAGCTGTTGTTG
ATGGGTATAGGTCTGATGAGTTTGAAGTGGAAAAAACTCCCTCCACCATC
AATTATTTGGACCGAAAGGGTGCATCGGTCAATGATGAAATCATGGGAAA
GGTTGGTGCTGATGGGTACATGTCCGATGACGCTGCTAGTGAGATGGATA
ATTACATGGATGCCCTTACTACCATGGAATCAGAAATGGAAACAGATACT
GAGAGCAGAGCTAAGCGTGAGAGGGGCTTATTCAATGTTGTGAGTCATGA
GAAGGATTCTGAAATAAATAAAGGACAGGATTTGCATGGTCATTGCTCAG
ACACCCACTCCATTGAAGGTTTTAGTACCACATGCGGTTCAAACAGTTTG
TTCAAGAAAGAAAGATCCAGTTATTCTTCTGACTCACTAAGCAATTTGGC
CGATGTGCAGTCACCTAAGGGTAATGGAGCAACATCTGTGGATGTGCCTG
GAATCTTTCAAAGTTCTTTCACATCCAAGGATGCCTTTGCTGGACCAGTG
CCTGACAATTCATGTTTTGGGTCTTCTGCAAAACCCTCATATTCAACAGA
TGGTGATGCAGAAACTGAAGTAAATCTTTCTTCTAAAATGTGCCTGGCTG
AAATACATGATTTATCATCTGAATTGCTCACAGATGATGGCAACATTTTA
AAAACTAAATCATCGGACTGTATTGCGCCCACAGAATTTGGTAATGAAGA
ATCTGATTCTTACCACAAGGATCTGGTGTCTACTTTCATCCATCTGACTC
CCAGTGCAAGCTCAAACGAAGGTCAACTGGCTAGATCAGAACAGACTGAG
ATTTCGTCCCTTTATGTTGAAGACTCTGCTGAAGAAATTGGTAAACATTC
AGGTAATGACTTACAGCATGCACTCGAAACCTCTCGCCTTAAATTGCAAA
TGACAGAGGTGCCTCTTACAGAATTTTCTGAAAGCTGTCCTGGTGAATCA
TTAAATGGTGAAATCCATAATCCTCCATTACATACTTTGCCGAATTCATC
AGATATTGCAGATATGCCAGGGGGAACAAAAGACAATGATGTTCTTGAAG
TCCTTGCTCCAGATGTAACCACTGAGGGCTCATCTGATTACTTGCAAGTG
ATTGAAGTCTGTGATCCACCTACCCAAACAGTACAAGATTCTACTCTTGA
GCTAGTTCCTACTGGAGATGTGGAAGATTGTGCATCTGCTGCTGACAATG
TGATGAACAGAATTCTTGATTTGCCAGACTCAATTACTGCTTCCGTGGAA
AACCAGCTTTGCATCTCAACAGTGCAAGACCCTCCTTATGCTTTTTTGGA
TGGGCAATCACCACCTGAATGTTTGCCTGTTTCTCCTCCCACCGATTCAA
TTGATACACAAGCCAATAACTTAATCGTGGGAGTGGAAAATGGTGTTGAT
CCAAGCAGTTATTCAGAAAACTTGAAACCAGCAGATGACCTTAGAGAGAT
GAGCGAATTCACAGTTCATGAACATATTAAACCAAATGCTCGCATCTTGC
CGCTTGAGTCAGAGTGCTGCTGTTGTGGAGAACCATGCAATTGTCATGTT
GGGGACTTGGCAGAAGTTCTCTCTCCATGTTCTGGATCAGAAACATTGTT
ATCTGAAAAAATTGAAGTATTGTCTTATACATTGGAGCTTGAGGAGAGAG
AGAAGTCTCTGCCTGAAGGAATTCATCCAAACTCCTCAATCTTGATGGGA
AACACTTCTGAGGTTGCTGACTTTCCATCTGTGTCTGTTGTATCTAATGC
TTTGCAGCACAAGTTGACCGATGAGGATCACATGGGGTCAGATGATTTAG
TATCTGGAAGCCTTCCTGTAACAACCGGCTGTAATGACGGCTCTCATGGA
CCAATTGGTTCTCCGGTAGACACTTCTGAGGCTGTCAACTTGCCATCTAT
TTCTGTTGCATCTAATGCCCCCAACAAGTTGACCAATGAGGATCCTACAC
TGTCAGATGATTTAGTATCTGGGTGCTTTTGCGTAGCAACCAGTTGTAAT
GACAAGTCTCCTGAACCAAGTGGTTCTCTAGAATCGCCTCTCAATCGCAT
ACAATTGCAGGAGGAATACCTTAGTGAGTCAGCCTCCAACTTGTATGAAT
CGGAGATCAGTGAGTCACCTAATCATGAGACTCAACTAGAATCAGATGCT
CAAGAAATCCATACAGTTGCCCATTCTGAAAATGATGAGGCTCTACCAGA
ATCCACCCTTCCTGACTCTTCGGAATCCCTTGATTATTTTCGTCATCTGG
CTCCATTGAAGGATGTGCAAACTCAAGTACCAGTCATGAATGACCCCGAA
GGCCATGTATCTTTGAGTTTAGGTGATCAAGAGTCAGAATTGAAATCAGG
TGAAGACAATCAACTCTCTATTTTAAAATCTGATCATCATAGCTATCCTC
ATGAAAATGCTACACATACGGTTTCTTTAGAACAAGCCATTGAATTAGAA
GCTGTCGGTCGAAACAGTGTGCCATCTTCACATGAGGAGGAAGAGAATTG
TGAATCTTTTGATGTTCTAATTCAAAGAGCAGAAACAGATCCTCCACATA
TTGACCTTCAGCAACCATCAGAACACGAGAAGCGGATAGATTCTTGTGCA
GTTTATGATGCCAACCTCACTAATGGGCTGAAGACATCTTCATCAGCCAT
TACCATCCCCACCTCGTTGGATCCAGAAGCATGTATACCTGTTCGACCTG
CTCAGAGTCTTGAGATTTCCAAATCTCCCCTATCCTCATGTAGTTTGAGT
GTCCCATCGACATCATCACCATTCATCCCCAGCTTTGGCCTGCTTGCCCC
TGAGACGGCCAACCAAAGATCATCAGGGGCAGAAGAATGTTGTTCGCTTC
AGCCTGATCATACTCAAAAGAGTTCTGAATTTCCCATAACTGATTCCAAT
TCAAGTCTTCCTTCTATACCAGCACCAGTGGTTACCAGCTTTGGCCTGTT
TGCCTCTGATTCGATGCACCAAGGAGCATTGGAGCCAGAGCTAAGTAGAT
CATCAGGCTCTGCATTTCCTGTTTCTCATGACCCACCAACCAATTTGGAG
GATATGCCACCACCACTTCCACCTCTTCCTCCTCTTGAATGGAGAATGGG
AAAGGTTCGACTTGCTTCCCTAACTTTTGGGGGAGAAATTACACACTCGC
CCGATTCATTCTCACCATTACTAACTACCAAAGATGAGAAATCTTGGCAT
GGTTCCTCTCTTCAAGGAGACGCTTCATGGCCTTTGAACCCTTTTGCACC
ATTACCTAGCATGGAAAATGAGAAGCCTCAATATGGTTCCCCATCTCTGA
GGGAAGAAATGGTGCAGCCTTCTAACTTTCTGGTTCAACTGCCGCCTCTA
GGAGGTGAGAGGCCTTCCCTAGCTTTAGAGGGACAGATTTCGCAGCCTCC
AAGATTGTCCATGCCCCTATCAGTTGTTGAAGATGAGAATGATCATCATG
CGATGCTTACATTGGAGGGAGTTACACAACAGCCACTGGGTCCATTCCTG
CAGCTACAAACTGTAGAAGAAGAGATGCCAAAAGTCAATCTCGACGTGGG
AGGTAACAAACCAAAAGATCCCCTGATTGAAAGAGGTGAGAAGCCATCCC
TAGCTTTAGAGGGACGGATGCCACAGCCGCCTCCAAGCTCATACATGCCC
GTCCCAGTTGTAGAAGACGAGTATCCTCGTGATGTGATGCATACATCGGA
GGGAGTCAACCAGCCACTGGATCCATTCCCGCAGCTGCATACGGAAGAAG
ATGAGAAGCCAAAAGGCAATTTTCACTTGGGGCCTAACCAACCAAAAGAT
CCCCTGATTGAGGCTATCGCTTCTCATGACAGAAGCATGTTGAGAAAGAC
ATCAGAGTGCATTCAAACTGTGACCAAGCCAAAGTCGGACGAAAGAAATT
CACTGCTAGAACAAATAAGAACAAAGTCTTTCAACCTGAAGCCAGCAGTT
GCGGCGAAACCCATCATTCATGGTCCCAATACAAACTTAAATGTTGTTGC
CATTTTGGAGAAAGCAAATGCCATTCGCCAGGCATTTGCTGGAAGTGATG
AAGATGATGACTCTGATAGTTGGAGTGATTCTTGA
Sequences
Sequence
CACACAGCAAAATTGTGAAAAAAATGCGTGTACTTCACCCCTACCATAAA
TCAAGAAGCAAAGGAAGAGCTCCCTCCCCTTAATTCATTCCATCTCCATC
ATTAAATATCAACCCCTCCCCCCGTCTCTCCTCCTCCTATACATATTCAT
CTTTATTCAAATACAAATCCCCCAACACTCAAAATTTAACATTCATAGCA
CTCTCTCTCTCTCTCTCTCTCTCTCTCTCTCTCTCTCTCAGGCCTCTAAT
GGCGGAGAATTAGCAGACGCGTCGCAGCAGAATCAAAAACCCATCTCAGA
TATTGGAGTCTACATCTAGTACAGAAATGCCCATTTCGAGATACCAGTTA
AGGAGTGAGTACAGCTTAGCAGATCCAGAGCTCTATCGAGCTGCGGATCG
AGATGATCCAGAAGCGCTCCTTGAAGGGGTCGCCATGGCAGGCCTGGTCG
GTGTCCTGCGCCAGCTGGGTGACCTTGCCGAGTTTGCTGCTGAGATCTTC
CATGAATTGCATGAAGAAGTGATGGCTACTGCTTCTAGAGGTCATGGTCT
GGTGATTCGAGTTCAACAACTAGAAGCAGAGATCCCATCAATTGAAAAGG
CTCTTCTTTCTCAGACTAGTCATTCACATTTGACTGACGGTTCAGGTATT
GAATGGCATGCAAATCTAAGAATGGACCAGAATTTGATCACTCGAGGAGA
TTTACCTCGCTTTGTTATGGATTCCTATGAAGAATGCCGTGGCCCGCCTC
GGTTATTCCTGTTGGACAAGTTTGATGTTGCCGGTGCTGGCGCTTGCTTG
AAGAGATACTCTGATCCATCATTTTATAAGACAGAATTAGCCTCCACCGA
GATGAAGAAAGCAAAAAGAGAAAAGAAGTCGCGAAAAATTAAGAAGAGAG
AAGCACGTTTAAAAAAAGGAGATGCCCTGGAGATTTTCTCAACATCACAA
TTTAGTTCAAGGCTGCACCAGTTGGCTTCAGACGAAAAAAACATGCCTGT
AAATGTTCCTACAAGTGGTATAAGGTTGAAGAGAGGGCACTTAAATAGTG
CCTCTTTCAATTCAAGGACTGGAAGAAGCTACATGGAGCATATTCTCGAA
CTGCGTCCATTTGAGAAGAGAACTGCATTTGACAACTCATTCCACACTAC
TCACTTGAAGGCGGAATCAAGTGATGTTAGTGTATCAGGACGTGAAATAT
ATGAGATCAGCGTAGAAGATCCAATTAATAAATTTATGAGGCGTAAGGGA
ACCGCAGTCTTGTCTCCTAAAAGACGGGTACCCAAACTAACTGCAGATGA
ATTGGGTGAGGATATCAGTAAGGGAGGTAACTTGGAATCCTTTCCTGAGC
AGATATCCAACTTTGAACTAGACAGTTCTGCTACGTTTCACAGGGAGGGT
AAAAAGTACGAGGAAATTGGTGGCGGAAGCAAGCCAGAAGCCAGTATGGA
TGGATGCAGGTCTGATGACTTAGGAGCAGAGAAAATTCCAACCACTTTTC
ATGAAGAGCACTACGCCTCTGATGGAAGCAGCACAAAATCAAGTGTTGAT
AGGTCCAGGTCCAAGTCTGATATATTTGGAACAGAGAAAATTCCAGCTGC
CTTGCCCCAGATGGATCAAAGTAATGAGTTACTTGAAGGCAACCTTAAGC
AAGAGGTTGGCCCTGACAATTACACGTCTGTTGAATTGGAAGTGGAGAAA
ACTACCACTACTTCTCATGTGGTGTATCAGAAGGATTTGCTGGTTGATAG
TGAAAGCAAGACAGAAGCCAATGCTGATGGTTCCAGTTCTGACAAACTTG
TTGTAGAGAACATTCCCGCCACCTTTTATAACGTGGGTGAGAAGAAGGAT
GCATTGGTTGATGATGGAACAAAGAAAGATGCTGCTCTTGATGGTTATAA
CCATGATAATTTCAAAGCAGAAACTACTATCTTGCGCCGCCTGGGTCAAA
AGGATGAGTTTGTTGGCGGTGAGAGTGAGATAGATGACAATGCTAATGGA
TACATGCCTGTTGACTTTGAAGTAGATAAAAAACCTTCTATTGGTTCTGA
TGACAGTGGGATCCAAGCTGTTGTTGATGGGTATAGGTCTGATGAGTTTG
AAGTGGAAAAAACTCCCTCCACCATCAATTATTTGGACCGAAAGGGTGCA
TCGGTCAATGATGAAATCATGGGAAAGGTTGGTGCTGATGGGTACATGTC
CGATGACGCTGCTAGTGAGATGGATAATTACATGGATGCCCTTACTACCA
TGGAATCAGAAATGGAAACAGATACTGAGAGCAGAGCTAAGCGTGAGAGG
GGCTTATTCAATGTTGTGAGTCATGAGAAGGATTCTGAAATAAATAAAGG
ACAGGATTTGCATGGTCATTGCTCAGACACCCACTCCATTGAAGGTTTTA
GTACCACATGCGGTTCAAACAGTTTGTTCAAGAAAGAAAGATCCAGTTAT
TCTTCTGACTCACTAAGCAATTTGGCCGATGTGCAGTCACCTAAGGGTAA
TGGAGCAACATCTGTGGATGTGCCTGGAATCTTTCAAAGTTCTTTCACAT
CCAAGGATGCCTTTGCTGGACCAGTGCCTGACAATTCATGTTTTGGGTCT
TCTGCAAAACCCTCATATTCAACAGATGGTGATGCAGAAACTGAAGTAAA
TCTTTCTTCTAAAATGTGCCTGGCTGAAATACATGATTTATCATCTGAAT
TGCTCACAGATGATGGCAACATTTTAAAAACTAAATCATCGGACTGTATT
GCGCCCACAGAATTTGGTAATGAAGAATCTGATTCTTACCACAAGGATCT
GGTGTCTACTTTCATCCATCTGACTCCCAGTGCAAGCTCAAACGAAGGTC
AACTGGCTAGATCAGAACAGACTGAGATTTCGTCCCTTTATGTTGAAGAC
TCTGCTGAAGAAATTGGTAAACATTCAGGTAATGACTTACAGCATGCACT
CGAAACCTCTCGCCTTAAATTGCAAATGACAGAGGTGCCTCTTACAGAAT
TTTCTGAAAGCTGTCCTGGTGAATCATTAAATGGTGAAATCCATAATCCT
CCATTACATACTTTGCCGAATTCATCAGATATTGCAGATATGCCAGGGGG
AACAAAAGACAATGATGTTCTTGAAGTCCTTGCTCCAGATGTAACCACTG
AGGGCTCATCTGATTACTTGCAAGTGATTGAAGTCTGTGATCCACCTACC
CAAACAGTACAAGATTCTACTCTTGAGCTAGTTCCTACTGGAGATGTGGA
AGATTGTGCATCTGCTGCTGACAATGTGATGAACAGAATTCTTGATTTGC
CAGACTCAATTACTGCTTCCGTGGAAAACCAGCTTTGCATCTCAACAGTG
CAAGACCCTCCTTATGCTTTTTTGGATGGGCAATCACCACCTGAATGTTT
GCCTGTTTCTCCTCCCACCGATTCAATTGATACACAAGCCAATAACTTAA
TCGTGGGAGTGGAAAATGGTGTTGATCCAAGCAGTTATTCAGAAAACTTG
AAACCAGCAGATGACCTTAGAGAGATGAGCGAATTCACAGTTCATGAACA
TATTAAACCAAATGCTCGCATCTTGCCGCTTGAGTCAGAGTGCTGCTGTT
GTGGAGAACCATGCAATTGTCATGTTGGGGACTTGGCAGAAGTTCTCTCT
CCATGTTCTGGATCAGAAACATTGTTATCTGAAAAAATTGAAGTATTGTC
TTATACATTGGAGCTTGAGGAGAGAGAGAAGTCTCTGCCTGAAGGAATTC
ATCCAAACTCCTCAATCTTGATGGGAAACACTTCTGAGGTTGCTGACTTT
CCATCTGTGTCTGTTGTATCTAATGCTTTGCAGCACAAGTTGACCGATGA
GGATCACATGGGGTCAGATGATTTAGTATCTGGAAGCCTTCCTGTAACAA
CCGGCTGTAATGACGGCTCTCATGGACCAATTGGTTCTCCGGTAGACACT
TCTGAGGCTGTCAACTTGCCATCTATTTCTGTTGCATCTAATGCCCCCAA
CAAGTTGACCAATGAGGATCCTACACTGTCAGATGATTTAGTATCTGGGT
GCTTTTGCGTAGCAACCAGTTGTAATGACAAGTCTCCTGAACCAAGTGGT
TCTCTAGAATCGCCTCTCAATCGCATACAATTGCAGGAGGAATACCTTAG
TGAGTCAGCCTCCAACTTGTATGAATCGGAGATCAGTGAGTCACCTAATC
ATGAGACTCAACTAGAATCAGATGCTCAAGAAATCCATACAGTTGCCCAT
TCTGAAAATGATGAGGCTCTACCAGAATCCACCCTTCCTGACTCTTCGGA
ATCCCTTGATTATTTTCGTCATCTGGCTCCATTGAAGGATGTGCAAACTC
AAGTACCAGTCATGAATGACCCCGAAGGCCATGTATCTTTGAGTTTAGGT
GATCAAGAGTCAGAATTGAAATCAGGTGAAGACAATCAACTCTCTATTTT
AAAATCTGATCATCATAGCTATCCTCATGAAAATGCTACACATACGGTTT
CTTTAGAACAAGCCATTGAATTAGAAGCTGTCGGTCGAAACAGTGTGCCA
TCTTCACATGAGGAGGAAGAGAATTGTGAATCTTTTGATGTTCTAATTCA
AAGAGCAGAAACAGATCCTCCACATATTGACCTTCAGCAACCATCAGAAC
ACGAGAAGCGGATAGATTCTTGTGCAGTTTATGATGCCAACCTCACTAAT
GGGCTGAAGACATCTTCATCAGCCATTACCATCCCCACCTCGTTGGATCC
AGAAGCATGTATACCTGTTCGACCTGCTCAGAGTCTTGAGATTTCCAAAT
CTCCCCTATCCTCATGTAGTTTGAGTGTCCCATCGACATCATCACCATTC
ATCCCCAGCTTTGGCCTGCTTGCCCCTGAGACGGCCAACCAAAGATCATC
AGGGGCAGAAGAATGTTGTTCGCTTCAGCCTGATCATACTCAAAAGAGTT
CTGAATTTCCCATAACTGATTCCAATTCAAGTCTTCCTTCTATACCAGCA
CCAGTGGTTACCAGCTTTGGCCTGTTTGCCTCTGATTCGATGCACCAAGG
AGCATTGGAGCCAGAGCTAAGTAGATCATCAGGCTCTGCATTTCCTGTTT
CTCATGACCCACCAACCAATTTGGAGGATATGCCACCACCACTTCCACCT
CTTCCTCCTCTTGAATGGAGAATGGGAAAGGTTCGACTTGCTTCCCTAAC
TTTTGGGGGAGAAATTACACACTCGCCCGATTCATTCTCACCATTACTAA
CTACCAAAGATGAGAAATCTTGGCATGGTTCCTCTCTTCAAGGAGACGCT
TCATGGCCTTTGAACCCTTTTGCACCATTACCTAGCATGGAAAATGAGAA
GCCTCAATATGGTTCCCCATCTCTGAGGGAAGAAATGGTGCAGCCTTCTA
ACTTTCTGGTTCAACTGCCGCCTCTAGGAGGTGAGAGGCCTTCCCTAGCT
TTAGAGGGACAGATTTCGCAGCCTCCAAGATTGTCCATGCCCCTATCAGT
TGTTGAAGATGAGAATGATCATCATGCGATGCTTACATTGGAGGGAGTTA
CACAACAGCCACTGGGTCCATTCCTGCAGCTACAAACTGTAGAAGAAGAG
ATGCCAAAAGTCAATCTCGACGTGGGAGGTAACAAACCAAAAGATCCCCT
GATTGAAAGAGGTGAGAAGCCATCCCTAGCTTTAGAGGGACGGATGCCAC
AGCCGCCTCCAAGCTCATACATGCCCGTCCCAGTTGTAGAAGACGAGTAT
CCTCGTGATGTGATGCATACATCGGAGGGAGTCAACCAGCCACTGGATCC
ATTCCCGCAGCTGCATACGGAAGAAGATGAGAAGCCAAAAGGCAATTTTC
ACTTGGGGCCTAACCAACCAAAAGATCCCCTGATTGAGGCTATCGCTTCT
CATGACAGAAGCATGTTGAGAAAGACATCAGAGTGCATTCAAACTGTGAC
CAAGCCAAAGTCGGACGAAAGAAATTCACTGCTAGAACAAATAAGAACAA
AGTCTTTCAACCTGAAGCCAGCAGTTGCGGCGAAACCCATCATTCATGGT
CCCAATACAAACTTAAATGTTGTTGCCATTTTGGAGAAAGCAAATGCCAT
TCGCCAGGCATTTGCTGGAAGTGATGAAGATGATGACTCTGATAGTTGGA
GTGATTCTTGAACTGCGATTGTTAAAGTATGTCGGAAGTATCATGGTAGA
TCTTAGCCATCCTGCTGCTCGAGTTTCTTCAGGGCATTTTGACTGGGCAT
ATCATCAAATTCAAAGGGAACTTAGAAGGCCCAAATGAGCATCCCGCTGG
GCCAGTAAGTGCAATGCTTACTGACATCCTTTGCTGTATGTTCATGTTTA
ATTTTTCATTGATCGAAATTGTATCATAATGTGAGTTTGTATCATACTAG
CAAAAATGTGAATGTGTAGTTCGGTTGAATGTAAAATTGGTTGCGTTGGC
CACCAACTATTAGTGTTGTTTCGAGCTCCTATGCATTCTGGGATGTAAAT
TGCGTCTAAATCCAACGGGCATCTTGAAATCTAGTATGCATGCTTCTCTT
CTGAATCCTGATTTTTTCTTTTTCCCATTATTAATGCATTTGTATGTGAA
CT
Sequence Length
6602