Summary
Resource Type
mRNA
Organism
Persea americana-Anise
Name
Chr01.g00123.m1
Identifier
Chr01.g00123.m1
Protein Sequence
MAGVGGIIRDHGGVLMAAYSGTMKATHPLEPPQTKILSPPLKVELQALLQ
ASAVEDRQLGSSVNTLAARQIGQQLTSSAPQFGSSADRSAAYKLSTTVRQ
LGIGVSPVLGVQHSPFQGVLPRFHPNLSRCRFYRLQFGAVCGKLNKKLVN
TMPPKTRNGEGPSRGKALSLQPPLAQNLPPPPPQQRRSGGRSPTVQTASQ
SRGVTMLSLRDVPPPEQPHHSHKRPVQGDKLVTKPHEKSARAGSQSQHQA
SLERNEDPRLEDIRAQNLLIQEQRELIERLTQQLEGKKGQSPPPRRPGHG
QDLRHVLNSKRRDRDQREEGSSSRHIHEGPKKQCQGLEDDELKKWIDQQV
KQTIRQNLETAGIDRDQYATFEAEDTGASPFSREIRRYTLPEKFSVPRFT
LYDGTSDPAAHLRHYVQRMSVWGDDDSLNCRVFSSSLADLPLRWFCSLPE
NSISSWQQLRTSFLGKFQAHRVIPKTDADLMALRMQENENVTQFARRFWT
VYSQIECASEELAVRSFQLALQPGIPLRAQLVMYPVTTMKELMTRANRFI
LAEEDEARGRENFGLTKKSQPAKGDSRSSRREDRRRDPSPDRRKARSSEQ
RRTPSASTSGSRSSRRSGHEPTSYVAVNTIFKEPIYRLLNKIKAQPFFKW
PRPMTTDPSSRDQTRFCAYHKQNGHRTDECKSFKFHLEDLVKEGHLREYI
KQEGRGDGRPPRREADNQDSEPEGVIHVIHLAAPPKKSSQARAEARRASH
QKQMLTAAPEQAAKKAKTEGVRIWFSDKDLEGVELPHNDALVLTLKLQNF
LVQRALVDPGSSSEVLYYDCFKKLGLKDEDLQAARTPLVGFSSKPVYPKG
KISLRVQVGGACRQVDFLVVDVPSPYNVIMGRTWLHSMEAAPSTQHQKLK
FPLENRSGRAEVITVRGDQHMARQCLLAVLSDEAGPSQVNVTELDREAEL
GDVGRAPAQKSIEDLTKVNIDPADPDRFFLVGSQLPETEKTELLNLLEEN
KAVFAWTPYEMPGIDPAVICHELKVDPNHKPVLQKPRRTGVPQTKAVAEE
VQKLLEAGAIREVHYPQWLANTVVVKKKTGKWRVCVDFTDLNKACPKDSF
PLPKIDQLIDATAGYDRMSFLDAYRGYHQIPLYAADQEKTAFITPRGTYC
YKVMPFGLKNAGATYQRLVTKMFQDQLGKTVEVYIDDMVVKSKRSQDHLT
DLRQIFDILHHFQLKLNASKCAFGVGSGKFLGSLVTRRGIEANPDQITAI
QDLQCPTSAKQVQRLTRMAAALNRFISRASDKCRPFFQLLRKGSKFQWTS
ECSQALQQLKHYLSSPPLLSTPTSGEVLFLYLSVSDHAVSSVLIREDNGQ
QRPIYYTSKTLLDAETRYLQLEKLALALLSASQKLSHYFQTFTIVVVTEY
PLKALFRKADFSGRISKWAVELGQYDIRYQPRTAIKAQVLADFIVEFTPQ
SSAPTALDTELGGDRGTEVVTETEQEQSWRELLDSSWKVFVDGSSTSKRA
GAGVVLQSPEGLVIEQAVTLGFKASNNEAEYEALIAGLNSAKILEARSVV
VFSDSQLVTSQLSGDYQARDDRMAAYLAHARGLLSQFERAEVRQIGRECN
SHADALANLASAVEAGERRTIEVETLQDPSINLQQPRQLMCLDLGPSWMN
PLIAYLKDDQLPEDRTEARKTRLKASRFWLSPDGKLYRKSFTGPYLQCVH
PSKVDDFLYEIHEGVCGSHIGGRSLAYRAISQGYWWPYMQKDAQLYARKC
EKCQKFSHSLHQPAQDLSPLSSPWPFAQWGLDIVGPLHRTPGNKRWLIVA
TDYFTKWVEAEPLSSITELDTKNFVWKNIITRFGIPRTLISDNRTQFDSN
LFKSFCQEYGIRNIYSTPAYPQSNGQAEISNKVLLDGIKKRLDRAKGRWA
EELPSVLWAYRTTPRRSTSATPFSLAYGMEAVIPLEVGLPTLRSELCDQG
LNDLNVARELDLAEERREAAAIRLAAYQQQLARGYNPKVKERRFAIGELV
LKKTLPGDRDSNEGKLAPNWQGPFRITSTAGRSAYRLEDMEGKPLPRPWN
AAHLKKFYF*
Properties
Coding Sequence (CDS)
ATGGCTGGTGTTGGAGGTATTATTCGGGACCACGGAGGAGTTTTGATGGC
AGCTTATTCAGGAACTATGAAGGCCACTCACCCTCTTGAACCCCCTCAAA
CAAAAATCCTAAGTCCACCACTGAAAGTAGAGCTTCAGGCCCTTCTTCAA
GCCTCTGCGGTAGAAGATCGTCAGCTCGGCAGCTCGGTCAATACTTTGGC
AGCTCGGCAGATCGGTCAGCAGCTTACAAGCTCAGCACCACAGTTTGGCA
GCTCGGCAGATCGGTCAGCAGCTTACAAGCTCAGCACCACAGTTCGGCAG
CTCGGTATAGGCGTCAGCCCGGTTCTTGGAGTTCAGCATTCCCCGTTCCA
AGGAGTTTTACCTCGATTTCATCCTAATCTAAGTAGGTGTCGTTTTTACC
GCCTACAGTTTGGCGCCGTCTGTGGGAAACTGAACAAAAAGCTTGTAAAC
ACCATGCCTCCGAAAACCAGAAATGGCGAAGGACCCTCCAGGGGCAAGGC
TTTGTCCCTACAGCCTCCGCTGGCGCAGAATCTTCCACCTCCTCCCCCTC
AGCAAAGGAGGTCTGGCGGGAGGTCTCCCACAGTCCAAACAGCGTCACAG
TCCAGGGGAGTAACCATGCTCTCCCTTCGTGACGTTCCACCTCCAGAACA
ACCCCACCATAGCCATAAGCGGCCCGTGCAAGGTGACAAGTTAGTCACCA
AGCCACACGAGAAGTCAGCGCGGGCTGGATCACAGTCCCAGCATCAGGCC
AGCCTTGAGCGCAACGAAGACCCCCGCCTGGAGGACATCAGAGCACAAAA
CCTCCTCATCCAAGAACAGCGTGAGCTTATCGAACGGCTCACGCAACAGC
TCGAAGGCAAGAAGGGTCAGAGCCCGCCGCCCAGGCGTCCGGGCCACGGA
CAAGACCTGAGGCACGTCCTCAACAGTAAGAGGCGTGACCGGGACCAAAG
AGAGGAAGGCTCTAGCAGCAGGCACATACATGAAGGGCCAAAGAAGCAAT
GCCAGGGGTTGGAGGACGATGAACTGAAGAAGTGGATCGACCAGCAGGTG
AAGCAGACTATCCGCCAGAATTTGGAGACTGCTGGTATCGACCGGGACCA
GTATGCCACCTTTGAAGCTGAAGATACTGGCGCGTCTCCTTTCTCTAGGG
AGATAAGAAGATACACGCTGCCCGAGAAGTTCAGCGTCCCAAGGTTCACC
CTATATGACGGGACCTCGGATCCTGCTGCTCACCTCCGACATTACGTCCA
AAGGATGTCGGTCTGGGGGGATGACGATTCCCTGAACTGTCGAGTCTTTT
CCTCCAGTTTGGCGGATCTCCCCCTACGGTGGTTCTGTTCGCTTCCCGAA
AATTCCATCTCCAGTTGGCAACAGCTTCGGACCTCCTTCCTGGGGAAATT
CCAGGCCCATCGCGTCATCCCAAAGACCGATGCCGACCTGATGGCCCTCC
GGATGCAGGAGAATGAGAACGTCACCCAGTTCGCCCGACGATTCTGGACT
GTCTACAGCCAGATCGAGTGCGCTTCTGAGGAGCTAGCGGTGAGGTCTTT
CCAGCTGGCCCTGCAGCCAGGTATCCCACTTCGGGCGCAGCTGGTCATGT
ATCCCGTGACCACCATGAAGGAGCTGATGACCCGGGCCAACCGGTTCATC
TTGGCGGAAGAAGACGAGGCGCGAGGTCGGGAGAACTTTGGCCTCACCAA
GAAGAGCCAACCGGCCAAGGGAGACAGCAGGTCCTCCAGGAGGGAGGATC
GTCGAAGGGACCCATCCCCGGATCGGCGCAAAGCCCGGTCCTCGGAGCAG
CGCCGAACCCCCTCCGCCTCGACGTCGGGATCACGGAGCAGCAGAAGGTC
CGGCCACGAGCCGACCTCCTACGTGGCAGTGAACACCATCTTCAAGGAGC
CAATCTATAGGCTCCTCAACAAAATAAAGGCGCAGCCGTTTTTCAAATGG
CCGCGGCCAATGACGACCGACCCCTCCTCCCGGGATCAGACCAGGTTCTG
TGCCTACCACAAGCAGAACGGGCACAGGACCGACGAATGTAAGAGCTTCA
AGTTCCACCTGGAAGACCTTGTGAAGGAGGGGCACCTACGGGAGTATATC
AAGCAGGAGGGCCGAGGTGATGGCCGACCTCCGCGGCGGGAAGCTGATAA
CCAGGACAGCGAGCCGGAAGGCGTCATCCACGTCATCCACCTCGCCGCCC
CACCTAAGAAGAGCTCTCAGGCTCGAGCCGAGGCCAGGCGCGCCTCCCAT
CAAAAACAGATGCTGACCGCGGCACCAGAGCAGGCCGCGAAGAAGGCCAA
AACAGAGGGGGTCAGAATATGGTTCTCTGACAAAGACCTGGAAGGCGTCG
AGCTACCGCACAACGACGCTCTAGTACTCACCTTGAAGCTACAAAACTTC
TTGGTTCAGAGAGCCCTCGTCGACCCTGGCAGCTCATCCGAGGTCCTCTA
CTACGACTGCTTCAAGAAGTTGGGACTAAAAGACGAGGACCTCCAGGCAG
CCCGCACCCCTCTGGTAGGCTTCAGCTCTAAACCTGTCTATCCCAAGGGC
AAAATCTCCCTTCGAGTCCAAGTAGGTGGCGCCTGCAGGCAGGTCGACTT
CCTAGTGGTCGATGTCCCTTCCCCGTACAATGTAATAATGGGGAGGACAT
GGCTGCATAGCATGGAGGCGGCGCCCTCCACCCAGCATCAAAAACTCAAG
TTCCCTTTGGAGAATCGATCGGGACGAGCGGAGGTGATCACTGTAAGAGG
TGACCAGCACATGGCCAGGCAATGCCTGCTGGCCGTGCTTTCTGACGAGG
CTGGGCCCTCCCAAGTCAATGTAACCGAGCTGGATAGAGAGGCCGAGCTC
GGGGACGTCGGCAGGGCTCCGGCGCAAAAGAGCATCGAAGACCTCACCAA
GGTCAATATTGATCCCGCTGACCCCGACAGGTTCTTTCTCGTGGGAAGCC
AGCTCCCCGAGACCGAGAAGACAGAGTTGCTCAACCTCCTCGAGGAAAAT
AAGGCGGTCTTTGCCTGGACACCCTATGAGATGCCTGGCATTGACCCCGC
AGTCATCTGCCACGAACTGAAGGTGGATCCCAACCATAAGCCCGTGCTCC
AAAAACCGCGCCGGACTGGGGTCCCGCAAACTAAGGCCGTGGCTGAGGAA
GTTCAGAAACTCCTCGAGGCAGGTGCAATAAGAGAGGTCCACTATCCGCA
GTGGCTAGCTAACACCGTGGTGGTCAAAAAGAAGACGGGAAAATGGAGGG
TCTGCGTGGACTTCACCGACCTCAATAAAGCCTGTCCAAAGGACAGCTTC
CCTCTTCCAAAAATCGACCAGCTTATCGACGCCACTGCCGGATACGACCG
GATGAGCTTCCTGGATGCCTACCGGGGGTACCATCAGATCCCCCTGTACG
CGGCAGACCAGGAAAAGACTGCTTTCATCACTCCCCGGGGCACCTATTGT
TACAAGGTGATGCCCTTCGGACTGAAGAACGCCGGAGCGACATACCAACG
GTTGGTGACGAAGATGTTCCAGGACCAACTCGGCAAAACGGTGGAGGTCT
ACATCGATGATATGGTCGTCAAGTCCAAGAGGTCGCAGGACCACCTGACC
GACCTCCGCCAAATTTTCGACATCCTTCACCACTTCCAGTTGAAGCTGAA
TGCGTCCAAGTGCGCCTTTGGGGTCGGTTCCGGCAAGTTTCTGGGAAGCC
TGGTCACAAGAAGGGGGATCGAAGCGAACCCTGACCAGATCACCGCGATC
CAGGACCTCCAGTGTCCGACCTCGGCGAAACAAGTTCAGCGGCTGACCAG
AATGGCTGCCGCCCTGAACCGATTTATCAGCCGCGCCTCGGACAAGTGCA
GACCCTTCTTCCAACTCTTGAGAAAGGGCTCCAAGTTCCAGTGGACATCG
GAATGTTCTCAGGCGCTGCAACAGCTAAAACATTATCTTTCCTCTCCACC
ACTGCTGTCAACCCCGACTTCTGGAGAGGTACTGTTCTTGTACCTGTCGG
TCTCGGACCATGCAGTGAGCTCGGTACTCATCAGAGAGGACAACGGCCAG
CAAAGGCCCATCTATTACACGAGCAAGACCCTGCTGGACGCCGAGACCCG
GTACTTACAACTCGAGAAGCTCGCCTTGGCGCTCCTCAGCGCCTCTCAGA
AGCTCTCCCACTACTTCCAAACCTTCACGATAGTGGTCGTAACCGAATAC
CCACTGAAGGCTCTCTTCCGGAAGGCGGATTTCTCCGGACGGATCTCCAA
ATGGGCTGTCGAACTGGGGCAATATGACATCAGGTATCAGCCCAGAACAG
CCATCAAAGCCCAAGTCCTAGCGGACTTCATTGTGGAATTTACCCCTCAG
AGTTCGGCACCGACCGCGCTCGACACCGAACTGGGGGGCGATAGGGGTAC
GGAGGTCGTCACCGAAACGGAGCAGGAGCAATCCTGGAGAGAGCTCCTAG
ACTCGTCCTGGAAAGTCTTTGTTGACGGATCCTCGACATCCAAGCGAGCT
GGCGCTGGCGTAGTTCTTCAGTCTCCCGAGGGCCTCGTCATCGAGCAAGC
TGTGACACTTGGTTTCAAGGCATCTAACAACGAGGCCGAATATGAAGCGC
TCATTGCCGGACTCAACAGCGCCAAAATCCTGGAAGCCCGGTCCGTGGTG
GTTTTCAGCGATTCCCAACTAGTGACGAGCCAGCTCAGCGGAGACTACCA
GGCTCGGGATGACAGGATGGCCGCCTACCTTGCCCATGCCCGGGGACTTC
TCTCCCAGTTCGAAAGGGCCGAGGTCCGGCAGATCGGTAGAGAATGCAAC
TCCCATGCAGACGCCCTCGCTAACCTCGCCTCGGCTGTGGAAGCCGGTGA
AAGAAGAACTATTGAAGTAGAAACGTTGCAGGATCCCAGCATCAACCTCC
AGCAACCCCGGCAACTCATGTGCCTGGATCTCGGCCCGAGCTGGATGAAC
CCCCTCATCGCCTACCTGAAGGACGACCAGCTACCCGAGGACAGGACTGA
AGCGCGAAAGACCAGATTGAAGGCGTCCCGGTTCTGGCTGTCCCCAGACG
GCAAGCTCTACAGGAAGTCATTCACAGGGCCCTACCTCCAGTGCGTTCAC
CCCAGCAAGGTCGACGATTTCCTCTACGAGATTCACGAAGGAGTCTGCGG
CAGTCACATAGGAGGTCGGTCACTTGCGTACCGGGCTATCAGCCAGGGAT
ACTGGTGGCCTTACATGCAGAAGGATGCCCAGCTTTACGCCAGGAAATGC
GAGAAGTGCCAGAAGTTCTCTCACTCTCTCCACCAGCCGGCCCAAGACCT
GAGTCCCCTCTCCAGTCCATGGCCTTTCGCCCAGTGGGGCCTCGACATCG
TCGGACCACTTCACCGAACTCCAGGGAACAAAAGATGGTTGATTGTGGCC
ACGGATTACTTCACGAAGTGGGTCGAAGCTGAACCTTTGTCCTCCATCAC
CGAGCTAGACACGAAGAACTTTGTGTGGAAGAATATCATCACCAGATTTG
GAATTCCCCGCACTCTCATTTCGGACAACAGGACGCAGTTCGATTCCAAC
CTCTTCAAGAGCTTCTGCCAGGAGTACGGCATTCGAAACATCTACTCCAC
CCCGGCGTATCCCCAGAGCAACGGTCAGGCCGAGATCTCGAACAAAGTAC
TGCTCGACGGAATCAAAAAGAGACTCGACCGAGCCAAAGGTCGATGGGCA
GAGGAGCTGCCAAGCGTTCTATGGGCCTACCGAACTACCCCAAGGCGTTC
CACCTCGGCTACCCCGTTCTCCCTTGCCTACGGCATGGAAGCAGTTATTC
CCCTTGAGGTCGGCCTCCCGACCTTGAGGTCGGAACTCTGTGACCAGGGT
CTGAACGATCTGAATGTAGCGCGGGAGCTGGACTTGGCTGAAGAACGAAG
AGAGGCGGCAGCTATCCGCCTGGCCGCCTACCAACAGCAGTTGGCCAGGG
GATACAACCCGAAGGTCAAAGAAAGAAGATTCGCGATAGGAGAGTTGGTC
TTGAAGAAAACACTGCCCGGCGACCGAGATTCCAACGAAGGCAAGCTGGC
ACCCAACTGGCAGGGACCGTTCAGAATAACTTCTACAGCCGGGAGATCTG
CCTACCGACTCGAAGATATGGAAGGGAAGCCGCTCCCGCGACCATGGAAC
GCGGCGCATCTCAAAAAATTCTACTTCTGA
Sequences
Sequence
ATGGCTGGTGTTGGAGGTATTATTCGGGACCACGGAGGAGTTTTGATGGC
AGCTTATTCAGGAACTATGAAGGCCACTCACCCTCTTGAACCCCCTCAAA
CAAAAATCCTAAGTCCACCACTGAAAGTAGAGCTTCAGGCCCTTCTTCAA
GCCTCTGCGGTAGAAGATCGTCAGCTCGGCAGCTCGGTCAATACTTTGGC
AGCTCGGCAGATCGGTCAGCAGCTTACAAGCTCAGCACCACAGTTTGGCA
GCTCGGCAGATCGGTCAGCAGCTTACAAGCTCAGCACCACAGTTCGGCAG
CTCGGTATAGGCGTCAGCCCGGTTCTTGGAGTTCAGCATTCCCCGTTCCA
AGGAGTTTTACCTCGATTTCATCCTAATCTAAGTAGGTGTCGTTTTTACC
GCCTACAGTTTGGCGCCGTCTGTGGGAAACTGAACAAAAAGCTTGTAAAC
ACCATGCCTCCGAAAACCAGAAATGGCGAAGGACCCTCCAGGGGCAAGGC
TTTGTCCCTACAGCCTCCGCTGGCGCAGAATCTTCCACCTCCTCCCCCTC
AGCAAAGGAGGTCTGGCGGGAGGTCTCCCACAGTCCAAACAGCGTCACAG
TCCAGGGGAGTAACCATGCTCTCCCTTCGTGACGTTCCACCTCCAGAACA
ACCCCACCATAGCCATAAGCGGCCCGTGCAAGGTGACAAGTTAGTCACCA
AGCCACACGAGAAGTCAGCGCGGGCTGGATCACAGTCCCAGCATCAGGCC
AGCCTTGAGCGCAACGAAGACCCCCGCCTGGAGGACATCAGAGCACAAAA
CCTCCTCATCCAAGAACAGCGTGAGCTTATCGAACGGCTCACGCAACAGC
TCGAAGGCAAGAAGGGTCAGAGCCCGCCGCCCAGGCGTCCGGGCCACGGA
CAAGACCTGAGGCACGTCCTCAACAGTAAGAGGCGTGACCGGGACCAAAG
AGAGGAAGGCTCTAGCAGCAGGCACATACATGAAGGGCCAAAGAAGCAAT
GCCAGGGGTTGGAGGACGATGAACTGAAGAAGTGGATCGACCAGCAGGTG
AAGCAGACTATCCGCCAGAATTTGGAGACTGCTGGTATCGACCGGGACCA
GTATGCCACCTTTGAAGCTGAAGATACTGGCGCGTCTCCTTTCTCTAGGG
AGATAAGAAGATACACGCTGCCCGAGAAGTTCAGCGTCCCAAGGTTCACC
CTATATGACGGGACCTCGGATCCTGCTGCTCACCTCCGACATTACGTCCA
AAGGATGTCGGTCTGGGGGGATGACGATTCCCTGAACTGTCGAGTCTTTT
CCTCCAGTTTGGCGGATCTCCCCCTACGGTGGTTCTGTTCGCTTCCCGAA
AATTCCATCTCCAGTTGGCAACAGCTTCGGACCTCCTTCCTGGGGAAATT
CCAGGCCCATCGCGTCATCCCAAAGACCGATGCCGACCTGATGGCCCTCC
GGATGCAGGAGAATGAGAACGTCACCCAGTTCGCCCGACGATTCTGGACT
GTCTACAGCCAGATCGAGTGCGCTTCTGAGGAGCTAGCGGTGAGGTCTTT
CCAGCTGGCCCTGCAGCCAGGTATCCCACTTCGGGCGCAGCTGGTCATGT
ATCCCGTGACCACCATGAAGGAGCTGATGACCCGGGCCAACCGGTTCATC
TTGGCGGAAGAAGACGAGGCGCGAGGTCGGGAGAACTTTGGCCTCACCAA
GAAGAGCCAACCGGCCAAGGGAGACAGCAGGTCCTCCAGGAGGGAGGATC
GTCGAAGGGACCCATCCCCGGATCGGCGCAAAGCCCGGTCCTCGGAGCAG
CGCCGAACCCCCTCCGCCTCGACGTCGGGATCACGGAGCAGCAGAAGGTC
CGGCCACGAGCCGACCTCCTACGTGGCAGTGAACACCATCTTCAAGGAGC
CAATCTATAGGCTCCTCAACAAAATAAAGGCGCAGCCGTTTTTCAAATGG
CCGCGGCCAATGACGACCGACCCCTCCTCCCGGGATCAGACCAGGTTCTG
TGCCTACCACAAGCAGAACGGGCACAGGACCGACGAATGTAAGAGCTTCA
AGTTCCACCTGGAAGACCTTGTGAAGGAGGGGCACCTACGGGAGTATATC
AAGCAGGAGGGCCGAGGTGATGGCCGACCTCCGCGGCGGGAAGCTGATAA
CCAGGACAGCGAGCCGGAAGGCGTCATCCACGTCATCCACCTCGCCGCCC
CACCTAAGAAGAGCTCTCAGGCTCGAGCCGAGGCCAGGCGCGCCTCCCAT
CAAAAACAGATGCTGACCGCGGCACCAGAGCAGGCCGCGAAGAAGGCCAA
AACAGAGGGGGTCAGAATATGGTTCTCTGACAAAGACCTGGAAGGCGTCG
AGCTACCGCACAACGACGCTCTAGTACTCACCTTGAAGCTACAAAACTTC
TTGGTTCAGAGAGCCCTCGTCGACCCTGGCAGCTCATCCGAGGTCCTCTA
CTACGACTGCTTCAAGAAGTTGGGACTAAAAGACGAGGACCTCCAGGCAG
CCCGCACCCCTCTGGTAGGCTTCAGCTCTAAACCTGTCTATCCCAAGGGC
AAAATCTCCCTTCGAGTCCAAGTAGGTGGCGCCTGCAGGCAGGTCGACTT
CCTAGTGGTCGATGTCCCTTCCCCGTACAATGTAATAATGGGGAGGACAT
GGCTGCATAGCATGGAGGCGGCGCCCTCCACCCAGCATCAAAAACTCAAG
TTCCCTTTGGAGAATCGATCGGGACGAGCGGAGGTGATCACTGTAAGAGG
TGACCAGCACATGGCCAGGCAATGCCTGCTGGCCGTGCTTTCTGACGAGG
CTGGGCCCTCCCAAGTCAATGTAACCGAGCTGGATAGAGAGGCCGAGCTC
GGGGACGTCGGCAGGGCTCCGGCGCAAAAGAGCATCGAAGACCTCACCAA
GGTCAATATTGATCCCGCTGACCCCGACAGGTTCTTTCTCGTGGGAAGCC
AGCTCCCCGAGACCGAGAAGACAGAGTTGCTCAACCTCCTCGAGGAAAAT
AAGGCGGTCTTTGCCTGGACACCCTATGAGATGCCTGGCATTGACCCCGC
AGTCATCTGCCACGAACTGAAGGTGGATCCCAACCATAAGCCCGTGCTCC
AAAAACCGCGCCGGACTGGGGTCCCGCAAACTAAGGCCGTGGCTGAGGAA
GTTCAGAAACTCCTCGAGGCAGGTGCAATAAGAGAGGTCCACTATCCGCA
GTGGCTAGCTAACACCGTGGTGGTCAAAAAGAAGACGGGAAAATGGAGGG
TCTGCGTGGACTTCACCGACCTCAATAAAGCCTGTCCAAAGGACAGCTTC
CCTCTTCCAAAAATCGACCAGCTTATCGACGCCACTGCCGGATACGACCG
GATGAGCTTCCTGGATGCCTACCGGGGGTACCATCAGATCCCCCTGTACG
CGGCAGACCAGGAAAAGACTGCTTTCATCACTCCCCGGGGCACCTATTGT
TACAAGGTGATGCCCTTCGGACTGAAGAACGCCGGAGCGACATACCAACG
GTTGGTGACGAAGATGTTCCAGGACCAACTCGGCAAAACGGTGGAGGTCT
ACATCGATGATATGGTCGTCAAGTCCAAGAGGTCGCAGGACCACCTGACC
GACCTCCGCCAAATTTTCGACATCCTTCACCACTTCCAGTTGAAGCTGAA
TGCGTCCAAGTGCGCCTTTGGGGTCGGTTCCGGCAAGTTTCTGGGAAGCC
TGGTCACAAGAAGGGGGATCGAAGCGAACCCTGACCAGATCACCGCGATC
CAGGACCTCCAGTGTCCGACCTCGGCGAAACAAGTTCAGCGGCTGACCAG
AATGGCTGCCGCCCTGAACCGATTTATCAGCCGCGCCTCGGACAAGTGCA
GACCCTTCTTCCAACTCTTGAGAAAGGGCTCCAAGTTCCAGTGGACATCG
GAATGTTCTCAGGCGCTGCAACAGCTAAAACATTATCTTTCCTCTCCACC
ACTGCTGTCAACCCCGACTTCTGGAGAGGTACTGTTCTTGTACCTGTCGG
TCTCGGACCATGCAGTGAGCTCGGTACTCATCAGAGAGGACAACGGCCAG
CAAAGGCCCATCTATTACACGAGCAAGACCCTGCTGGACGCCGAGACCCG
GTACTTACAACTCGAGAAGCTCGCCTTGGCGCTCCTCAGCGCCTCTCAGA
AGCTCTCCCACTACTTCCAAACCTTCACGATAGTGGTCGTAACCGAATAC
CCACTGAAGGCTCTCTTCCGGAAGGCGGATTTCTCCGGACGGATCTCCAA
ATGGGCTGTCGAACTGGGGCAATATGACATCAGGTATCAGCCCAGAACAG
CCATCAAAGCCCAAGTCCTAGCGGACTTCATTGTGGAATTTACCCCTCAG
AGTTCGGCACCGACCGCGCTCGACACCGAACTGGGGGGCGATAGGGGTAC
GGAGGTCGTCACCGAAACGGAGCAGGAGCAATCCTGGAGAGAGCTCCTAG
ACTCGTCCTGGAAAGTCTTTGTTGACGGATCCTCGACATCCAAGCGAGCT
GGCGCTGGCGTAGTTCTTCAGTCTCCCGAGGGCCTCGTCATCGAGCAAGC
TGTGACACTTGGTTTCAAGGCATCTAACAACGAGGCCGAATATGAAGCGC
TCATTGCCGGACTCAACAGCGCCAAAATCCTGGAAGCCCGGTCCGTGGTG
GTTTTCAGCGATTCCCAACTAGTGACGAGCCAGCTCAGCGGAGACTACCA
GGCTCGGGATGACAGGATGGCCGCCTACCTTGCCCATGCCCGGGGACTTC
TCTCCCAGTTCGAAAGGGCCGAGGTCCGGCAGATCGGTAGAGAATGCAAC
TCCCATGCAGACGCCCTCGCTAACCTCGCCTCGGCTGTGGAAGCCGGTGA
AAGAAGAACTATTGAAGTAGAAACGTTGCAGGATCCCAGCATCAACCTCC
AGCAACCCCGGCAACTCATGTGCCTGGATCTCGGCCCGAGCTGGATGAAC
CCCCTCATCGCCTACCTGAAGGACGACCAGCTACCCGAGGACAGGACTGA
AGCGCGAAAGACCAGATTGAAGGCGTCCCGGTTCTGGCTGTCCCCAGACG
GCAAGCTCTACAGGAAGTCATTCACAGGGCCCTACCTCCAGTGCGTTCAC
CCCAGCAAGGTCGACGATTTCCTCTACGAGATTCACGAAGGAGTCTGCGG
CAGTCACATAGGAGGTCGGTCACTTGCGTACCGGGCTATCAGCCAGGGAT
ACTGGTGGCCTTACATGCAGAAGGATGCCCAGCTTTACGCCAGGAAATGC
GAGAAGTGCCAGAAGTTCTCTCACTCTCTCCACCAGCCGGCCCAAGACCT
GAGTCCCCTCTCCAGTCCATGGCCTTTCGCCCAGTGGGGCCTCGACATCG
TCGGACCACTTCACCGAACTCCAGGGAACAAAAGATGGTTGATTGTGGCC
ACGGATTACTTCACGAAGTGGGTCGAAGCTGAACCTTTGTCCTCCATCAC
CGAGCTAGACACGAAGAACTTTGTGTGGAAGAATATCATCACCAGATTTG
GAATTCCCCGCACTCTCATTTCGGACAACAGGACGCAGTTCGATTCCAAC
CTCTTCAAGAGCTTCTGCCAGGAGTACGGCATTCGAAACATCTACTCCAC
CCCGGCGTATCCCCAGAGCAACGGTCAGGCCGAGATCTCGAACAAAGTAC
TGCTCGACGGAATCAAAAAGAGACTCGACCGAGCCAAAGGTCGATGGGCA
GAGGAGCTGCCAAGCGTTCTATGGGCCTACCGAACTACCCCAAGGCGTTC
CACCTCGGCTACCCCGTTCTCCCTTGCCTACGGCATGGAAGCAGTTATTC
CCCTTGAGGTCGGCCTCCCGACCTTGAGGTCGGAACTCTGTGACCAGGGT
CTGAACGATCTGAATGTAGCGCGGGAGCTGGACTTGGCTGAAGAACGAAG
AGAGGCGGCAGCTATCCGCCTGGCCGCCTACCAACAGCAGTTGGCCAGGG
GATACAACCCGAAGGTCAAAGAAAGAAGATTCGCGATAGGAGAGTTGGTC
TTGAAGAAAACACTGCCCGGCGACCGAGATTCCAACGAAGGCAAGCTGGC
ACCCAACTGGCAGGGACCGTTCAGAATAACTTCTACAGCCGGGAGATCTG
CCTACCGACTCGAAGATATGGAAGGGAAGCCGCTCCCGCGACCATGGAAC
GCGGCGCATCTCAAAAAATTCTACTTCTGA
Sequence Length
6180