Summary
Resource Type
mRNA
Organism
Persea americana-Anise
Name
Chr01.g00877.m1
Identifier
Chr01.g00877.m1
Protein Sequence
MNEDVELGSSVTARSARSQLGIDASSVQRRTTAKPSLVPGVQHFPVLSIL
PRSHPNLSRCRFYRLQFGAVCGELNKKPVITMPPKTRNGEGPSKGRASSI
QPTLAQNLPPPPPQQRRSGGRSPTVQTASQSRGVTMPSLRDVPPPEQPRH
SHGRGRQGDKSVTKPPKKSVRAGSQSHHQASLERDEDPRLADIRAQNLLI
QEQRELIERLTQQLEGKKDQSPPPRRPGHGQDLRHVLNSKRRDRDQREEG
SSSSHIHKEPKKQCQGLEDDELKKWINQQVKQTIRQNLETAGIDRDQYAT
LEAEDTGASPFSREIRRYTLPEKFSVPRFTLYDGTSDPAAHLRHYVQRMS
VWGDDDSLNCRVFSSSLADLPLRWFCSLPENSISSWRQLRASFLGKFQAH
RVIPKTDADLMALRMQENENVTQFARRFWTVYSQIESASEELAVKSFQLA
LQPGIPLRAQLVMYPVTTMKELMTKANRFILAEEDETRGRENFGLTKKSQ
PAKGDNRSSRREDRRRDPSPDRRKARSSEQRRTPSASTSGSRSSRRSGHE
PSSYVAMNTIFKEPIYRLLSKIKAQPFFKWPRPMTADPSTRDQSRFCAYH
KQNGHRTDECKSFKFHLEDLVKEGHLREYIKQEGRGDDRPPRRDADNHDS
EPEGIINVIHLAAPPKKSSQARAEARRASHQKQVLTAAPEPAAKKARSEG
VRIWFSDKDLEDVELPHNDALVLTLKLQNFLVQRALVDPGSSSEVLYYDC
FRKLGLKDEDLQSARTPLVGFSSKPVYPKGKISLRVQVGGACRQVDFLVV
DVPSPYNVIMGRTWLHSMEAVPSTRHQKLKFPLESQSGRTDVITVRGDQH
MARQCLLAVLPDEAEPSQVNMAELDREAELGDVGRAPAQKSIEDLTKVNI
DPADPDRFFLVGSQLPETEKTELLNLLEENKAVFAWTPYEMPGIDPAVIC
HELKVDPNHRPVLQKPRRTGVPQTEAVVEEVQKLLEADAIKEVHYPEWLA
NTVVVKKKTGKWRVCVDFTNLNKACPKDSFPLPKIDQLIDATAGHDRMSF
LDAYRGYHQIPLYAADQEKTTFITPRGTYCYKVMPFGLKNAGATYQRLVT
KMFQAQLGKTVEVYIDDMVVKSKRSQDHLTDLRQIFDILRQFQLKLNASK
CAFGVGSGKFLGSLVTRRGIEANPDQITALQELQCPTSAKQVQRLTGMAA
ALNRFISRASDKCRPFFQLLRKGSKFQWTSDCAQALQQLKQYLSSPPLLS
TPTSGEALFLLSVSDHAVSSVLIREDDGQQRPVYYTSKTLLDAETRYLRL
EKLALALVSASRKLSHYFQTFTIVVVREYPLKALLRKADFSGRISKWAVE
LGQYDISYKPRTAIKAQVLADFIVEFTPPSSAPTALDTELGGDRGAEVVT
ETEEEQSWRELLDSSWKVFVDGSSTSKRAGAGIVLQSPEGLVIEQAVTLG
FKASNNEAEYEALIAGLNSAKILEARTVVVFSDSQLVTSQLSGDYQARDD
RMAAYLAHARGLLSQFERAEVRQIGRESNSHADALASLASAVEAGEKRTV
EVETQQEPSINLQRPRQLMCLDLGPSWMDPIVAYLKDDQLPEDKTEARKI
RLKATRFWLSPDSKLYRKSFTGPYLQCVHPGKVDDFLYEIHEGVCGSHIG
GRSLAYRAISQGYWWPYMQKDAQLYARKCEKCQKFSHSLHQPAQDLSSLS
SPWPFAQWGLDIVGPLHRTPGNKRWLIVATDYFTKWVEAEPLSSITELDT
KNFVWRNIITRFGIPRTLISDNGTQFDSNFFKSFCQEYGIRNIYSTPAYP
QSNGQAEISNKVLLDGIKKRLDRAKGRWAEELPSVLWAYRTTPRRSTSAT
PFSLAYGMEAVIPLEVGLPTLRSELCDQGLNDQNVARELDFAEERREAAA
IRLAAYQQQLARGYNQKVKERRFTIGELVLKKTLPGDRDPNEGKLAPNWQ
GPFRITSTAGRSAYRLEDMEGKALPRPWNATHLKKFYF*
Properties
Coding Sequence (CDS)
ATGAACGAGGACGTCGAGCTCGGCAGCTCGGTCACAGCTCGGTCAGCCCG
GTCTCAGCTCGGCATAGATGCCAGCTCGGTGCAAAGGCGCACCACGGCCA
AGCCATCCTTGGTTCCAGGCGTTCAGCATTTCCCTGTCCTAAGCATTCTA
CCCCGATCTCATCCTAATCTAAGTAGGTGTCGTTTTTACCGCCTACAGTT
TGGCGCCGTCTGTGGGGAACTGAACAAAAAGCCTGTAATCACCATGCCTC
CAAAAACCAGGAACGGCGAAGGACCCTCCAAAGGCAGGGCTTCATCCATA
CAGCCTACACTGGCGCAGAATCTTCCGCCTCCTCCCCCTCAGCAAAGGAG
GTCTGGCGGGAGGTCTCCCACGGTCCAAACAGCGTCACAGTCCAGGGGAG
TAACCATGCCCTCCCTTCGCGACGTCCCACCTCCTGAACAGCCCCGCCAT
AGCCATGGGCGGGGCAGGCAAGGTGACAAATCAGTCACCAAACCACCCAA
GAAGTCAGTAAGGGCTGGATCGCAGTCTCATCATCAGGCCAGCCTTGAGC
GCGATGAAGACCCCCGCCTGGCGGACATCAGAGCACAAAACCTCCTCATT
CAGGAACAGCGTGAGCTTATCGAACGGCTCACGCAACAGCTCGAAGGCAA
GAAGGATCAAAGCCCGCCGCCCAGACGTCCGGGCCACGGGCAAGACCTGA
GGCACGTCCTCAACAGCAAGAGGCGTGACCGGGACCAAAGAGAGGAAGGC
TCTAGCAGCAGCCACATACATAAAGAGCCAAAGAAGCAATGCCAGGGGTT
GGAGGACGATGAACTGAAGAAGTGGATCAACCAGCAGGTAAAGCAGACCA
TCCGCCAGAACTTAGAAACTGCTGGTATCGACCGGGACCAGTATGCCACT
CTTGAAGCTGAAGATACTGGCGCGTCTCCTTTCTCTAGGGAGATAAGAAG
ATACACGCTGCCCGAGAAGTTCAGCGTCCCAAGGTTCACCCTATATGACG
GGACCTCGGATCCTGCCGCGCACCTCCGACATTACGTCCAAAGGATGTCG
GTCTGGGGGGATGACGATTCCCTGAACTGTCGAGTGTTCTCCTCCAGTTT
GGCGGATCTACCCCTACGGTGGTTCTGTTCGCTTCCCGAAAATTCCATCT
CCAGCTGGCGTCAGCTCCGGGCCTCCTTCCTGGGAAAGTTCCAAGCTCAT
CGTGTCATCCCAAAGACCGATGCCGATCTGATGGCCCTCCGGATGCAGGA
GAACGAGAACGTCACCCAGTTCGCTCGTCGATTCTGGACTGTCTACAGCC
AGATCGAGAGCGCTTCTGAGGAGCTGGCAGTGAAATCCTTCCAGCTGGCT
CTGCAGCCAGGTATCCCACTTCGGGCGCAGCTGGTCATGTATCCCGTGAC
CACCATGAAGGAACTGATGACCAAAGCAAACCGGTTCATCTTGGCGGAGG
AAGATGAGACGCGAGGTCGGGAGAACTTTGGCCTCACCAAGAAGAGCCAA
CCGGCCAAGGGAGACAACAGGTCCTCCAGAAGGGAGGATCGTCGCAGAGA
CCCATCCCCGGATCGGCGCAAAGCCCGGTCCTCGGAGCAGCGCCGAACCC
CCTCCGCCTCGACGTCGGGATCACGGAGCAGCAGGAGATCCGGCCACGAA
CCATCCTCATACGTGGCAATGAACACCATCTTCAAGGAGCCGATCTATAG
GCTCCTCAGCAAAATAAAGGCGCAGCCGTTCTTCAAATGGCCGCGACCAA
TGACAGCCGACCCCTCCACCCGGGACCAGAGTAGGTTCTGTGCCTACCAC
AAGCAGAACGGGCACAGGACCGACGAATGTAAGAGCTTCAAGTTCCACCT
GGAGGACCTAGTGAAGGAGGGGCATCTTCGGGAGTATATCAAGCAGGAGG
GCCGAGGTGATGACCGACCTCCGCGGCGGGACGCTGATAACCACGACAGC
GAGCCGGAGGGTATCATCAACGTCATTCACCTCGCCGCCCCACCAAAGAA
GAGCTCTCAGGCCCGCGCCGAGGCCAGGCGCGCCTCACACCAAAAGCAGG
TGCTGACCGCGGCACCAGAGCCGGCCGCGAAGAAGGCCAGATCGGAGGGG
GTCAGAATATGGTTCTCTGATAAAGACTTGGAAGACGTCGAGCTCCCGCA
CAACGACGCTCTCGTTCTCACCTTGAAGCTGCAAAACTTCTTGGTTCAGA
GAGCCCTTGTCGACCCTGGCAGTTCGTCCGAGGTCCTCTACTACGACTGC
TTCAGGAAGTTGGGCCTAAAGGACGAAGACCTCCAGTCTGCCCGAACCCC
TCTGGTCGGTTTCAGCTCCAAGCCTGTCTATCCCAAGGGCAAGATCTCCC
TTAGAGTCCAAGTCGGAGGCGCCTGCAGGCAAGTCGACTTCCTAGTGGTC
GATGTCCCTTCCCCGTACAATGTCATAATGGGGAGGACGTGGCTGCACAG
CATGGAGGCGGTACCCTCCACCCGGCATCAGAAGCTTAAATTCCCTTTGG
AAAGCCAGTCGGGTCGGACGGACGTGATCACCGTCAGAGGCGACCAACAC
ATGGCCAGGCAATGCCTGCTGGCCGTGCTACCTGACGAGGCTGAGCCGTC
CCAAGTCAATATGGCCGAGCTGGATAGGGAGGCCGAGCTCGGTGACGTCG
GCAGGGCTCCGGCGCAGAAGAGCATCGAGGACCTCACCAAGGTCAACATC
GATCCCGCCGACCCCGACAGATTCTTTCTCGTGGGAAGCCAGCTCCCCGA
GACCGAGAAGACAGAGCTGCTCAATCTCCTCGAAGAAAATAAGGCGGTCT
TTGCCTGGACACCATATGAGATGCCCGGCATTGACCCGGCCGTCATCTGC
CATGAGCTAAAGGTGGATCCCAACCATAGGCCCGTACTTCAAAAGCCGCG
CCGGACTGGGGTCCCGCAGACTGAGGCCGTGGTTGAGGAAGTTCAGAAAC
TTCTCGAGGCAGATGCAATAAAAGAGGTCCACTATCCGGAGTGGTTAGCT
AACACCGTGGTGGTGAAGAAGAAGACAGGAAAATGGAGGGTTTGCGTGGA
CTTCACCAACCTCAATAAGGCCTGTCCCAAGGACAGCTTCCCTCTTCCGA
AGATCGACCAACTCATCGACGCCACTGCCGGACACGACCGGATGAGCTTC
CTGGATGCCTACCGGGGGTACCATCAGATCCCCTTGTACGCGGCAGACCA
GGAGAAGACAACTTTCATCACTCCCAGGGGCACCTATTGTTACAAGGTGA
TGCCCTTCGGGTTAAAAAATGCCGGAGCAACATACCAGCGCTTGGTGACC
AAAATGTTCCAGGCTCAGCTCGGCAAGACGGTGGAGGTCTACATCGATGA
TATGGTTGTCAAGTCCAAGAGGTCGCAGGACCATCTGACCGACCTCCGCC
AGATTTTTGACATCCTCCGCCAGTTCCAGCTGAAGCTCAATGCGTCCAAG
TGCGCCTTTGGGGTCGGTTCCGGCAAGTTCCTAGGGAGCCTGGTCACAAG
AAGGGGGATCGAAGCGAACCCTGATCAGATCACCGCGCTCCAGGAGCTCC
AGTGTCCGACCTCGGCGAAACAAGTTCAGCGGCTGACCGGAATGGCTGCC
GCCCTGAACCGCTTCATCAGCCGCGCTTCGGACAAGTGCAGACCCTTCTT
CCAACTACTGCGAAAGGGCTCCAAGTTCCAGTGGACGTCGGATTGCGCTC
AGGCGCTGCAACAGCTAAAACAGTACCTTTCTTCTCCACCACTGCTGTCG
ACCCCGACTTCCGGAGAGGCACTGTTCTTGCTGTCGGTCTCGGACCACGC
AGTGAGCTCGGTGCTCATCAGAGAGGACGACGGCCAGCAAAGGCCCGTCT
ATTACACAAGCAAGACCCTGCTGGACGCCGAGACCAGGTATTTGCGGCTC
GAAAAGCTCGCCTTGGCACTGGTTAGCGCCTCCCGAAAGCTCTCCCACTA
CTTCCAAACCTTCACAATAGTGGTCGTCAGAGAGTACCCACTGAAGGCTC
TCCTCCGGAAGGCAGATTTCTCCGGACGGATCTCCAAATGGGCTGTCGAA
CTGGGGCAATATGATATCAGCTATAAGCCCAGGACGGCCATCAAAGCTCA
AGTCTTAGCTGACTTCATTGTGGAATTTACTCCACCGAGTTCGGCACCGA
CCGCGCTCGACACCGAACTGGGGGGCGATAGGGGTGCAGAGGTTGTCACC
GAGACTGAGGAAGAACAGTCCTGGAGAGAACTCCTAGACTCGTCCTGGAA
AGTCTTCGTCGACGGATCCTCAACATCCAAGAGAGCTGGCGCTGGCATAG
TTCTCCAGTCTCCCGAAGGCCTCGTCATCGAGCAAGCTGTGACACTTGGT
TTCAAGGCATCCAACAACGAGGCCGAATATGAAGCGCTCATTGCCGGACT
GAACAGTGCCAAAATCTTGGAAGCCCGGACCGTTGTGGTTTTCAGCGATT
CCCAACTGGTGACGAGCCAGCTCAGCGGGGATTACCAGGCCCGGGATGAC
AGGATGGCAGCATACCTCGCCCACGCCAGGGGACTTCTCTCCCAGTTCGA
GAGGGCCGAGGTTCGGCAGATCGGCAGAGAATCCAACTCCCATGCAGACG
CCCTCGCCAGCCTCGCCTCGGCAGTGGAAGCCGGTGAAAAGAGAACAGTT
GAAGTAGAAACGCAGCAGGAGCCCAGCATCAACCTCCAGCGACCCCGGCA
GCTCATGTGCCTTGATCTCGGCCCGAGCTGGATGGACCCCATCGTTGCTT
ACCTGAAGGACGACCAGCTACCCGAGGACAAGACTGAAGCTCGAAAGATC
AGATTGAAGGCGACCCGGTTCTGGCTGTCCCCAGACAGCAAGCTCTATAG
GAAGTCATTCACAGGGCCCTACCTCCAGTGCGTTCACCCCGGCAAAGTCG
ACGATTTCCTCTACGAGATTCACGAGGGAGTCTGCGGCAGTCACATAGGA
GGTCGGTCACTTGCATACCGGGCTATCAGCCAGGGTTACTGGTGGCCCTA
CATGCAGAAGGACGCCCAGCTCTACGCCAGGAAGTGCGAGAAGTGCCAAA
AGTTCTCCCACTCTCTCCACCAGCCAGCCCAGGACCTGAGTTCCCTCTCC
AGCCCATGGCCTTTCGCCCAGTGGGGCCTGGACATCGTCGGACCACTTCA
CCGAACTCCGGGGAACAAAAGATGGTTGATTGTGGCCACTGACTACTTCA
CGAAATGGGTCGAAGCGGAACCATTATCCTCCATCACCGAATTAGACACG
AAGAACTTTGTGTGGAGGAACATCATCACCAGATTTGGAATTCCCCGCAC
CCTCATTTCCGACAACGGTACCCAGTTCGACTCGAACTTCTTCAAAAGCT
TCTGCCAAGAGTACGGCATTCGCAACATCTACTCCACCCCGGCGTACCCC
CAGAGCAACGGCCAGGCCGAGATCTCAAACAAAGTACTTCTCGACGGAAT
TAAAAAGAGACTCGACCGAGCCAAAGGTCGGTGGGCAGAGGAGCTGCCAA
GTGTTCTATGGGCCTACCGGACTACTCCGAGGCGTTCCACCTCGGCGACC
CCGTTCTCCCTCGCCTACGGCATGGAAGCAGTCATTCCCCTTGAAGTCGG
CCTCCCGACCTTGAGGTCGGAACTCTGCGACCAGGGCCTGAACGATCAGA
ACGTGGCACGAGAGCTGGACTTTGCTGAAGAACGAAGAGAGGCGGCAGCT
ATCCGCCTGGCCGCCTATCAGCAGCAGTTGGCCAGGGGATACAACCAGAA
GGTCAAGGAAAGAAGATTCACGATAGGAGAGTTGGTCTTGAAGAAAACAC
TTCCTGGCGACCGAGATCCTAACGAGGGCAAGCTGGCGCCCAACTGGCAG
GGACCGTTCAGAATAACGTCAACGGCCGGGAGATCTGCCTACCGACTTGA
AGATATGGAGGGGAAGGCACTCCCGCGACCATGGAATGCGACGCATCTCA
AAAAATTCTACTTCTGA
Sequences
Sequence
ATGAACGAGGACGTCGAGCTCGGCAGCTCGGTCACAGCTCGGTCAGCCCG
GTCTCAGCTCGGCATAGATGCCAGCTCGGTGCAAAGGCGCACCACGGCCA
AGCCATCCTTGGTTCCAGGCGTTCAGCATTTCCCTGTCCTAAGCATTCTA
CCCCGATCTCATCCTAATCTAAGTAGGTGTCGTTTTTACCGCCTACAGTT
TGGCGCCGTCTGTGGGGAACTGAACAAAAAGCCTGTAATCACCATGCCTC
CAAAAACCAGGAACGGCGAAGGACCCTCCAAAGGCAGGGCTTCATCCATA
CAGCCTACACTGGCGCAGAATCTTCCGCCTCCTCCCCCTCAGCAAAGGAG
GTCTGGCGGGAGGTCTCCCACGGTCCAAACAGCGTCACAGTCCAGGGGAG
TAACCATGCCCTCCCTTCGCGACGTCCCACCTCCTGAACAGCCCCGCCAT
AGCCATGGGCGGGGCAGGCAAGGTGACAAATCAGTCACCAAACCACCCAA
GAAGTCAGTAAGGGCTGGATCGCAGTCTCATCATCAGGCCAGCCTTGAGC
GCGATGAAGACCCCCGCCTGGCGGACATCAGAGCACAAAACCTCCTCATT
CAGGAACAGCGTGAGCTTATCGAACGGCTCACGCAACAGCTCGAAGGCAA
GAAGGATCAAAGCCCGCCGCCCAGACGTCCGGGCCACGGGCAAGACCTGA
GGCACGTCCTCAACAGCAAGAGGCGTGACCGGGACCAAAGAGAGGAAGGC
TCTAGCAGCAGCCACATACATAAAGAGCCAAAGAAGCAATGCCAGGGGTT
GGAGGACGATGAACTGAAGAAGTGGATCAACCAGCAGGTAAAGCAGACCA
TCCGCCAGAACTTAGAAACTGCTGGTATCGACCGGGACCAGTATGCCACT
CTTGAAGCTGAAGATACTGGCGCGTCTCCTTTCTCTAGGGAGATAAGAAG
ATACACGCTGCCCGAGAAGTTCAGCGTCCCAAGGTTCACCCTATATGACG
GGACCTCGGATCCTGCCGCGCACCTCCGACATTACGTCCAAAGGATGTCG
GTCTGGGGGGATGACGATTCCCTGAACTGTCGAGTGTTCTCCTCCAGTTT
GGCGGATCTACCCCTACGGTGGTTCTGTTCGCTTCCCGAAAATTCCATCT
CCAGCTGGCGTCAGCTCCGGGCCTCCTTCCTGGGAAAGTTCCAAGCTCAT
CGTGTCATCCCAAAGACCGATGCCGATCTGATGGCCCTCCGGATGCAGGA
GAACGAGAACGTCACCCAGTTCGCTCGTCGATTCTGGACTGTCTACAGCC
AGATCGAGAGCGCTTCTGAGGAGCTGGCAGTGAAATCCTTCCAGCTGGCT
CTGCAGCCAGGTATCCCACTTCGGGCGCAGCTGGTCATGTATCCCGTGAC
CACCATGAAGGAACTGATGACCAAAGCAAACCGGTTCATCTTGGCGGAGG
AAGATGAGACGCGAGGTCGGGAGAACTTTGGCCTCACCAAGAAGAGCCAA
CCGGCCAAGGGAGACAACAGGTCCTCCAGAAGGGAGGATCGTCGCAGAGA
CCCATCCCCGGATCGGCGCAAAGCCCGGTCCTCGGAGCAGCGCCGAACCC
CCTCCGCCTCGACGTCGGGATCACGGAGCAGCAGGAGATCCGGCCACGAA
CCATCCTCATACGTGGCAATGAACACCATCTTCAAGGAGCCGATCTATAG
GCTCCTCAGCAAAATAAAGGCGCAGCCGTTCTTCAAATGGCCGCGACCAA
TGACAGCCGACCCCTCCACCCGGGACCAGAGTAGGTTCTGTGCCTACCAC
AAGCAGAACGGGCACAGGACCGACGAATGTAAGAGCTTCAAGTTCCACCT
GGAGGACCTAGTGAAGGAGGGGCATCTTCGGGAGTATATCAAGCAGGAGG
GCCGAGGTGATGACCGACCTCCGCGGCGGGACGCTGATAACCACGACAGC
GAGCCGGAGGGTATCATCAACGTCATTCACCTCGCCGCCCCACCAAAGAA
GAGCTCTCAGGCCCGCGCCGAGGCCAGGCGCGCCTCACACCAAAAGCAGG
TGCTGACCGCGGCACCAGAGCCGGCCGCGAAGAAGGCCAGATCGGAGGGG
GTCAGAATATGGTTCTCTGATAAAGACTTGGAAGACGTCGAGCTCCCGCA
CAACGACGCTCTCGTTCTCACCTTGAAGCTGCAAAACTTCTTGGTTCAGA
GAGCCCTTGTCGACCCTGGCAGTTCGTCCGAGGTCCTCTACTACGACTGC
TTCAGGAAGTTGGGCCTAAAGGACGAAGACCTCCAGTCTGCCCGAACCCC
TCTGGTCGGTTTCAGCTCCAAGCCTGTCTATCCCAAGGGCAAGATCTCCC
TTAGAGTCCAAGTCGGAGGCGCCTGCAGGCAAGTCGACTTCCTAGTGGTC
GATGTCCCTTCCCCGTACAATGTCATAATGGGGAGGACGTGGCTGCACAG
CATGGAGGCGGTACCCTCCACCCGGCATCAGAAGCTTAAATTCCCTTTGG
AAAGCCAGTCGGGTCGGACGGACGTGATCACCGTCAGAGGCGACCAACAC
ATGGCCAGGCAATGCCTGCTGGCCGTGCTACCTGACGAGGCTGAGCCGTC
CCAAGTCAATATGGCCGAGCTGGATAGGGAGGCCGAGCTCGGTGACGTCG
GCAGGGCTCCGGCGCAGAAGAGCATCGAGGACCTCACCAAGGTCAACATC
GATCCCGCCGACCCCGACAGATTCTTTCTCGTGGGAAGCCAGCTCCCCGA
GACCGAGAAGACAGAGCTGCTCAATCTCCTCGAAGAAAATAAGGCGGTCT
TTGCCTGGACACCATATGAGATGCCCGGCATTGACCCGGCCGTCATCTGC
CATGAGCTAAAGGTGGATCCCAACCATAGGCCCGTACTTCAAAAGCCGCG
CCGGACTGGGGTCCCGCAGACTGAGGCCGTGGTTGAGGAAGTTCAGAAAC
TTCTCGAGGCAGATGCAATAAAAGAGGTCCACTATCCGGAGTGGTTAGCT
AACACCGTGGTGGTGAAGAAGAAGACAGGAAAATGGAGGGTTTGCGTGGA
CTTCACCAACCTCAATAAGGCCTGTCCCAAGGACAGCTTCCCTCTTCCGA
AGATCGACCAACTCATCGACGCCACTGCCGGACACGACCGGATGAGCTTC
CTGGATGCCTACCGGGGGTACCATCAGATCCCCTTGTACGCGGCAGACCA
GGAGAAGACAACTTTCATCACTCCCAGGGGCACCTATTGTTACAAGGTGA
TGCCCTTCGGGTTAAAAAATGCCGGAGCAACATACCAGCGCTTGGTGACC
AAAATGTTCCAGGCTCAGCTCGGCAAGACGGTGGAGGTCTACATCGATGA
TATGGTTGTCAAGTCCAAGAGGTCGCAGGACCATCTGACCGACCTCCGCC
AGATTTTTGACATCCTCCGCCAGTTCCAGCTGAAGCTCAATGCGTCCAAG
TGCGCCTTTGGGGTCGGTTCCGGCAAGTTCCTAGGGAGCCTGGTCACAAG
AAGGGGGATCGAAGCGAACCCTGATCAGATCACCGCGCTCCAGGAGCTCC
AGTGTCCGACCTCGGCGAAACAAGTTCAGCGGCTGACCGGAATGGCTGCC
GCCCTGAACCGCTTCATCAGCCGCGCTTCGGACAAGTGCAGACCCTTCTT
CCAACTACTGCGAAAGGGCTCCAAGTTCCAGTGGACGTCGGATTGCGCTC
AGGCGCTGCAACAGCTAAAACAGTACCTTTCTTCTCCACCACTGCTGTCG
ACCCCGACTTCCGGAGAGGCACTGTTCTTGCTGTCGGTCTCGGACCACGC
AGTGAGCTCGGTGCTCATCAGAGAGGACGACGGCCAGCAAAGGCCCGTCT
ATTACACAAGCAAGACCCTGCTGGACGCCGAGACCAGGTATTTGCGGCTC
GAAAAGCTCGCCTTGGCACTGGTTAGCGCCTCCCGAAAGCTCTCCCACTA
CTTCCAAACCTTCACAATAGTGGTCGTCAGAGAGTACCCACTGAAGGCTC
TCCTCCGGAAGGCAGATTTCTCCGGACGGATCTCCAAATGGGCTGTCGAA
CTGGGGCAATATGATATCAGCTATAAGCCCAGGACGGCCATCAAAGCTCA
AGTCTTAGCTGACTTCATTGTGGAATTTACTCCACCGAGTTCGGCACCGA
CCGCGCTCGACACCGAACTGGGGGGCGATAGGGGTGCAGAGGTTGTCACC
GAGACTGAGGAAGAACAGTCCTGGAGAGAACTCCTAGACTCGTCCTGGAA
AGTCTTCGTCGACGGATCCTCAACATCCAAGAGAGCTGGCGCTGGCATAG
TTCTCCAGTCTCCCGAAGGCCTCGTCATCGAGCAAGCTGTGACACTTGGT
TTCAAGGCATCCAACAACGAGGCCGAATATGAAGCGCTCATTGCCGGACT
GAACAGTGCCAAAATCTTGGAAGCCCGGACCGTTGTGGTTTTCAGCGATT
CCCAACTGGTGACGAGCCAGCTCAGCGGGGATTACCAGGCCCGGGATGAC
AGGATGGCAGCATACCTCGCCCACGCCAGGGGACTTCTCTCCCAGTTCGA
GAGGGCCGAGGTTCGGCAGATCGGCAGAGAATCCAACTCCCATGCAGACG
CCCTCGCCAGCCTCGCCTCGGCAGTGGAAGCCGGTGAAAAGAGAACAGTT
GAAGTAGAAACGCAGCAGGAGCCCAGCATCAACCTCCAGCGACCCCGGCA
GCTCATGTGCCTTGATCTCGGCCCGAGCTGGATGGACCCCATCGTTGCTT
ACCTGAAGGACGACCAGCTACCCGAGGACAAGACTGAAGCTCGAAAGATC
AGATTGAAGGCGACCCGGTTCTGGCTGTCCCCAGACAGCAAGCTCTATAG
GAAGTCATTCACAGGGCCCTACCTCCAGTGCGTTCACCCCGGCAAAGTCG
ACGATTTCCTCTACGAGATTCACGAGGGAGTCTGCGGCAGTCACATAGGA
GGTCGGTCACTTGCATACCGGGCTATCAGCCAGGGTTACTGGTGGCCCTA
CATGCAGAAGGACGCCCAGCTCTACGCCAGGAAGTGCGAGAAGTGCCAAA
AGTTCTCCCACTCTCTCCACCAGCCAGCCCAGGACCTGAGTTCCCTCTCC
AGCCCATGGCCTTTCGCCCAGTGGGGCCTGGACATCGTCGGACCACTTCA
CCGAACTCCGGGGAACAAAAGATGGTTGATTGTGGCCACTGACTACTTCA
CGAAATGGGTCGAAGCGGAACCATTATCCTCCATCACCGAATTAGACACG
AAGAACTTTGTGTGGAGGAACATCATCACCAGATTTGGAATTCCCCGCAC
CCTCATTTCCGACAACGGTACCCAGTTCGACTCGAACTTCTTCAAAAGCT
TCTGCCAAGAGTACGGCATTCGCAACATCTACTCCACCCCGGCGTACCCC
CAGAGCAACGGCCAGGCCGAGATCTCAAACAAAGTACTTCTCGACGGAAT
TAAAAAGAGACTCGACCGAGCCAAAGGTCGGTGGGCAGAGGAGCTGCCAA
GTGTTCTATGGGCCTACCGGACTACTCCGAGGCGTTCCACCTCGGCGACC
CCGTTCTCCCTCGCCTACGGCATGGAAGCAGTCATTCCCCTTGAAGTCGG
CCTCCCGACCTTGAGGTCGGAACTCTGCGACCAGGGCCTGAACGATCAGA
ACGTGGCACGAGAGCTGGACTTTGCTGAAGAACGAAGAGAGGCGGCAGCT
ATCCGCCTGGCCGCCTATCAGCAGCAGTTGGCCAGGGGATACAACCAGAA
GGTCAAGGAAAGAAGATTCACGATAGGAGAGTTGGTCTTGAAGAAAACAC
TTCCTGGCGACCGAGATCCTAACGAGGGCAAGCTGGCGCCCAACTGGCAG
GGACCGTTCAGAATAACGTCAACGGCCGGGAGATCTGCCTACCGACTTGA
AGATATGGAGGGGAAGGCACTCCCGCGACCATGGAATGCGACGCATCTCA
AAAAATTCTACTTCTGA
Sequence Length
5967