Summary
Resource Type
mRNA
Organism
Persea americana-Anise
Name
Chr01.g00668.m1
Identifier
Chr01.g00668.m1
Protein Sequence
MKSEDGMLPTLPTAARQGKGRWDLTSPTPTHRENEHATLAYIYAWDWSHE
RHRSAFGSQQPGALTLAFLLPFQVPGVQHFPVLSILPRSHLNLSRCRFYR
LQFGAVCGKLNKKLVHTMPPKTRNGEGPSKGKALSIQPTLAQNLPPPPPQ
QRRSGGRSPTVQTQSQSREVTMLSLRDVPPPEQPRHSHGRGRQGDKSVTK
PHEKSARAGSLSHHQTGLDRNEDPRLEDIRAQNLLIQEQRELIERLTQQL
EGKKDQSPPPRRPGHGQDLRHVLNSKRRDRDQREEGSSSSHIHEGPKKQC
QGLEDDELKKWIDQQVKQTIRQNLETAGIDRDQYATLEAEDTGASPFSRE
IRRYTLPEKFSVPRFTLYDGTSDPAAHLRHYVQRMSVWGDDDSLNCRVFS
SSLADLPLRWFCSLPENSISSWRQLRASFLGKFQAHRVIPKTDADLMALR
MQENENVTQFARRFWTVYSQIESASEELAVRSFQLALQPGIPLRAQLVMY
PVTTMKELMTRANRFILAEEDETRGRENFGLTKKSQPAKGDSRSSRREDR
RRDPSPDQRKARSSEQRRTPSASTSGSRSSRGSGHEPSSYVAVNTIFKEP
IYRLLKKIKAQPFFKWPRPMTADPSTRDQSRFCAYHKQNGHRTDECKSFK
FHLEDLVKEGHLREYIKQEGRGDGRPPRREAENQDSEPEGVIHVIHLAAP
PKKSSQARAEARRASHQKQVLTAAPEPAAKKARTEGVRIWFSDEDLEDVE
LPHNDALVLTLKLQNFLVQRALVDPGSSSEVLYYDCFKKLGLKDEDLQAA
RTLWQVNFLVVDVPSPYNVIMGRTWLHSMEAVPSTRHQKLKFPLESPTGR
TDVITVRGDQHMARQCLLAVLADEAEPSQVNMAELDREAELGDVGRAPAQ
KSIEDLTKVNIDPADPDRFFLVGSQLPETEKTELLNLLEENKAVFAWTPY
EMPGIDPAVICHELKVDPNHRPVLQKPRRTGVPQTEAVVEEVQKLLEADA
IREVHYPEWLANTVVVKKKTGKWRVCVDFTDLNKACPKDSFPLPKIDQLI
DATAGHDRMSFLDAYRGYHQIPLYAADQEKTAFITPRGTYCYKVMPFGLK
NAGATYQRLVTKMFQAQLGKTVEVYIDDMVVKSKRSQDHLTDLRQIFDIL
RQFQLKLNASKCAFGVGSGKFLGSLVTRRGIEANPDQITAIQELQCPTSA
KQVQRLTGMAAALNRFISRASDKCRPFFQLLRKGSKFQWTSDCAQALQQL
KQYLSSPPLLSTPTFGEALFLYLSVSDHAVSSVLIREDNGQQRPIYYTSK
TLLDAETRYLQLEKLALALALLRKADFSGRISKWAVELGQYDISYKPRTA
IKAQVLADFIVEFTPPSSAPTALDTELGGDRGTEVVTETEQEQSWRELLD
SSWKVFVDGSSTSKRAGAGIVLQSPEGLVIEQAVTLGFKASNNEAEYEAL
IAGLNSAKILEARSVVVFSDSQLVTSQLSGDYQARDDRMAAYLAHARGLL
SQFERAEVRQIGRESNSHADALASLASAVEAGEKRTVEVETQQEPSIDLQ
QPRQLMCLELGPSWMDPIVAYLKDDQLPEDKTEARKIRLKATRFWLSPDS
KLYRKSFTGPYLQCVHPGKVDDFLYEIHEGVCGSHIGGRSLAYRAISQGY
WWPYMQKDAQLYARKCEKCQKFSHSLHQPAQDLSSLSSPWPFAQWGLDIV
GPLHRTPGNKRWLIVATDYFTKWVEAEPLSSITELDTKNFVWRNIITRFG
IPRTLISDNGTQFDSNFFKSFCQEYGIRNIYSTPAYPQSNGQAEISNKVL
LDGIKKRLDRAKGRWAEELPSVLWAYRTTPRRSTSATPFSLAYGMEAVIP
LEVGLPTLRSELCDQGLNDQNVARELDLAEERREAAAIRLAAYQQQLARG
YNQKVKERRFTIGELVLKKTLPGDRDPNEGKLAPNWQGPFRITVRYQYHP
RGSAPLFRGPTVLSSVPSPALAAQPYANQGPVTVPPSRLGASVQRANRSE
LGAFTSSGGTAICKSGSGNSTTLAARRLCSEGQPS*
Properties
Coding Sequence (CDS)
ATGAAAAGTGAGGATGGGATGTTGCCCACTCTACCTACTGCAGCCCGCCA
GGGTAAGGGTCGATGGGACCTCACCTCACCTACCCCCACTCACAGAGAGA
ATGAACATGCAACGCTCGCTTATATATACGCATGGGATTGGTCCCATGAA
AGGCATCGGAGTGCCTTCGGCTCACAGCAGCCAGGGGCTCTGACGTTAGC
CTTTCTCCTTCCGTTTCAGGTTCCAGGCGTTCAGCATTTCCCTGTCCTAA
GCATTCTACCCCGATCTCATCTCAATCTAAGTAGGTGTCGTTTTTACCGC
CTACAGTTTGGCGCCGTCTGTGGGAAACTGAACAAAAAGCTTGTACACAC
TATGCCTCCAAAAACCAGAAACGGCGAAGGACCCTCCAAAGGCAAGGCTT
TGTCCATACAGCCTACACTGGCGCAGAATCTTCCGCCTCCTCCCCCTCAG
CAAAGGAGGTCTGGCGGGAGGTCTCCCACGGTCCAGACACAGTCGCAGTC
TAGGGAAGTGACCATGCTCTCCCTTCGCGACGTCCCACCTCCTGAACAGC
CCCGCCATAGCCATGGGCGGGGCAGGCAAGGCGACAAGTCAGTCACCAAG
CCACACGAGAAGTCAGCCCGGGCTGGATCGCTGTCACACCATCAGACCGG
CCTCGATCGGAACGAAGATCCCCGCCTGGAGGACATCAGAGCACAGAACC
TCCTCATCCAGGAACAGCGTGAGCTTATCGAACGGCTCACGCAACAGCTC
GAAGGCAAGAAGGATCAGAGCCCGCCGCCCAGGCGTCCGGGCCACGGGCA
AGACCTGAGGCACGTCCTCAACAGCAAGAGGCGTGACCGGGACCAAAGAG
AGGAAGGCTCTAGCAGCAGCCACATACATGAAGGGCCAAAGAAGCAATGC
CAGGGGTTGGAGGACGATGAACTGAAGAAGTGGATCGACCAGCAGGTAAA
GCAGACTATCCGCCAGAACTTAGAGACTGCTGGTATCGACCGGGACCAGT
ATGCCACTCTTGAAGCTGAAGATACTGGCGCGTCTCCTTTCTCTAGGGAG
ATAAGAAGATACACGCTGCCCGAGAAGTTCAGCGTCCCAAGGTTCACCCT
ATATGACGGGACCTCGGATCCTGCCGCACACCTCCGACATTACGTCCAAA
GGATGTCGGTCTGGGGGGACGACGATTCCCTGAACTGTCGAGTCTTTTCC
TCCAGTTTGGCGGATCTCCCCCTACGGTGGTTCTGTTCGCTTCCCGAAAA
TTCCATCTCTAGCTGGCGTCAGCTCCGGGCCTCCTTCCTAGGAAAGTTCC
AAGCTCATCGTGTCATCCCAAAGACCGATGCCGATCTGATGGCCCTCCGG
ATGCAGGAGAACGAGAACGTCACCCAGTTCGCTCGTCGATTCTGGACTGT
CTACAGCCAGATCGAGAGCGCTTCTGAGGAGCTGGCAGTGAGATCCTTCC
AGCTGGCTTTGCAGCCAGGTATCCCACTTCGGGCGCAGCTGGTCATGTAT
CCCGTGACCACCATGAAGGAACTGATGACCCGAGCAAACCGGTTCATCTT
GGCGGAAGAAGACGAGACGCGAGGTCGGGAGAACTTTGGCCTCACCAAGA
AGAGCCAACCGGCCAAGGGAGACAGCAGGTCCTCCAGGAGGGAGGATCGT
CGAAGGGACCCATCCCCGGATCAGCGCAAAGCCCGGTCCTCGGAGCAGCG
CCGAACCCCCTCCGCCTCGACGTCGGGATCACGGAGCAGCAGGGGATCCG
GCCACGAACCATCCTCATACGTGGCAGTGAACACCATCTTCAAGGAGCCG
ATCTATAGGCTCCTCAAGAAAATAAAGGCGCAGCCGTTCTTCAAATGGCC
GCGACCAATGACAGCCGACCCCTCCACCCGGGACCAGAGTAGGTTCTGTG
CCTACCACAAGCAGAACGGGCACAGGACCGACGAATGTAAGAGCTTCAAG
TTCCACCTGGAGGACCTAGTGAAGGAGGGGCATCTTCGGGAGTATATCAA
GCAGGAGGGCCGAGGTGATGGCCGACCCCCACGGCGGGAAGCTGAGAACC
AGGATAGCGAGCCGGAGGGCGTCATCCACGTCATCCACCTCGCCGCCCCA
CCTAAGAAGAGCTCCCAGGCTCGAGCTGAGGCCAGGCGCGCCTCCCATCA
AAAACAGGTGCTGACCGCGGCGCCAGAGCCGGCCGCGAAGAAAGCCAGAA
CAGAGGGGGTCAGAATATGGTTTTCTGATGAAGACCTAGAAGACGTCGAG
CTACCGCACAACGACGCCCTAGTGCTCACCTTGAAGCTTCAAAACTTCTT
GGTTCAGAGAGCCCTCGTCGACCCTGGCAGCTCATCCGAGGTCCTCTACT
ACGACTGCTTCAAAAAGTTGGGACTAAAAGACGAGGACCTCCAGGCAGCC
CGTACCCTCTGGCAGGTGAACTTCCTAGTGGTCGATGTCCCTTCCCCGTA
CAATGTAATAATGGGGAGGACATGGCTGCATAGCATGGAGGCGGTGCCCT
CCACCCGGCATCAGAAGCTTAAATTCCCTTTGGAAAGCCCGACGGGTCGG
ACGGACGTGATCACCGTCAGAGGCGACCAGCACATGGCCAGGCAGTGCCT
GCTGGCCGTGCTAGCTGACGAGGCTGAGCCATCCCAAGTCAATATGGCCG
AGCTGGATAGAGAGGCCGAGCTCGGTGACGTCGGCAGGGCTCCGGCACAG
AAAAGCATCGAGGACCTCACCAAGGTCAACATCGATCCCGCCGACCCCGA
CAGATTCTTTCTCGTGGGAAGCCAACTCCCCGAGACCGAGAAGACAGAGC
TGCTCAATCTCCTCGAAGAAAATAAGGCGGTCTTTGCCTGGACACCATAT
GAGATGCCCGGCATTGACCCGGCAGTCATCTGCCATGAGCTAAAGGTGGA
TCCCAACCATAGGCCCGTACTTCAAAAGCCGCGCCGGACTGGGGTCCCGC
AGACTGAGGCCGTGGTTGAGGAGGTTCAGAAACTTCTCGAGGCAGATGCA
ATAAGAGAGGTCCACTATCCGGAGTGGTTAGCTAACACCGTGGTGGTGAA
GAAGAAGACGGGAAAATGGAGGGTTTGCGTGGACTTCACCGACCTCAATA
AGGCCTGTCCCAAGGACAGCTTCCCTCTTCCGAAGATCGACCAACTCATC
GACGCCACTGCCGGACACGACCGGATGAGCTTCCTGGATGCCTACCGGGG
GTACCATCAGATCCCCTTGTACGCGGCAGACCAGGAGAAGACAGCTTTCA
TCACTCCCAGGGGCACCTATTGTTACAAGGTGATGCCCTTCGGGTTAAAA
AATGCCGGAGCAACATACCAGCGCTTGGTGACCAAGATGTTCCAGGCCCA
GCTCGGCAAGACGGTGGAGGTCTACATCGATGATATGGTCGTCAAATCCA
AGAGGTCGCAGGACCATCTGACCGACCTCCGCCAGATTTTTGACATCCTC
CGCCAGTTCCAGCTGAAGCTTAATGCGTCCAAGTGCGCCTTTGGGGTCGG
TTCCGGCAAGTTCCTAGGGAGCCTGGTCACAAGAAGGGGGATCGAAGCGA
ACCCTGATCAGATCACCGCGATCCAGGAGCTCCAGTGTCCGACCTCGGCG
AAACAAGTTCAGCGGCTGACCGGAATGGCTGCCGCCCTGAACCGCTTTAT
CAGCCGCGCTTCGGACAAGTGCAGACCCTTCTTCCAACTATTGCGAAAGG
GCTCCAAGTTCCAGTGGACATCGGATTGCGCTCAGGCGCTGCAACAGCTA
AAACAGTACCTTTCTTCTCCACCACTGCTATCAACCCCGACTTTCGGAGA
GGCACTGTTCTTGTACTTGTCGGTCTCGGACCATGCAGTGAGCTCGGTGC
TCATCAGAGAGGACAACGGCCAGCAGAGGCCCATCTATTACACGAGCAAG
ACCCTGCTGGACGCCGAGACCCGGTATTTGCAGCTCGAAAAGCTCGCCTT
GGCACTCGCTCTCCTCCGGAAGGCAGATTTCTCCGGACGGATCTCCAAAT
GGGCTGTCGAACTGGGGCAATATGATATCAGCTATAAGCCCAGGACGGCC
ATCAAAGCTCAAGTCTTAGCTGACTTCATTGTGGAATTTACTCCTCCGAG
TTCGGCACCGACCGCGCTCGACACCGAACTGGGGGGCGACAGGGGTACAG
AGGTTGTCACCGAGACTGAGCAAGAACAGTCCTGGAGAGAACTCCTAGAC
TCGTCCTGGAAAGTCTTCGTCGACGGATCCTCAACATCCAAGAGAGCTGG
CGCTGGCATAGTTCTCCAGTCTCCCGAAGGCCTCGTCATCGAGCAAGCTG
TGACACTTGGTTTCAAGGCTTCTAACAACGAGGCCGAATATGAAGCGCTC
ATTGCCGGACTGAACAGTGCCAAAATCTTGGAAGCCCGGTCCGTCGTGGT
TTTCAGCGATTCCCAATTGGTGACGAGCCAGCTCAGCGGGGATTACCAGG
CCCGGGATGACAGGATGGCAGCATACCTCGCCCACGCCAGGGGACTTCTC
TCCCAGTTCGAGAGGGCCGAGGTCCGGCAGATCGGCAGAGAATCCAACTC
CCATGCAGACGCCCTCGCCAGCCTCGCCTCGGCAGTGGAAGCCGGTGAAA
AAAGAACAGTGGAAGTAGAAACGCAGCAGGAGCCCAGCATCGACCTCCAG
CAACCACGGCAGCTCATGTGCCTTGAGCTCGGCCCGAGCTGGATGGACCC
TATCGTTGCTTACCTGAAGGATGACCAGCTACCCGAGGACAAGACTGAAG
CTCGAAAGATCAGATTGAAGGCGACCCGGTTCTGGCTGTCCCCAGACAGC
AAGCTCTATAGGAAGTCATTCACAGGGCCCTACCTCCAGTGCGTTCACCC
CGGCAAAGTCGACGATTTCCTCTACGAGATTCACGAGGGAGTCTGCGGCA
GTCACATAGGAGGTCGGTCACTTGCATACCGGGCTATCAGCCAGGGTTAC
TGGTGGCCCTACATGCAGAAGGACGCCCAGCTTTACGCCAGGAAGTGCGA
GAAGTGCCAGAAGTTCTCCCACTCTCTCCACCAGCCAGCCCAGGACCTGA
GTTCCCTCTCCAGCCCATGGCCTTTCGCCCAGTGGGGCCTGGACATCGTC
GGACCACTTCACCGAACTCCGGGGAACAAAAGATGGTTGATTGTGGCCAC
GGACTACTTCACAAAATGGGTCGAAGCTGAACCATTGTCCTCCATCACCG
AATTAGACACGAAGAACTTTGTGTGGAGGAACATCATCACCAGATTTGGA
ATTCCCCGCACTCTCATCTCCGACAACGGTACGCAATTCGATTCCAACTT
CTTCAAAAGCTTCTGCCAGGAGTACGGCATTCGCAACATCTACTCCACCC
CGGCTTATCCACAGAGCAACGGCCAGGCCGAGATCTCAAACAAAGTGCTT
CTCGACGGAATTAAAAAGAGACTCGACCGAGCCAAAGGTCGATGGGCAGA
GGAGCTGCCGAGTGTTCTATGGGCCTACCGAACTACTCCGAGGCGTTCCA
CCTCGGCGACCCCGTTCTCCCTCGCCTACGGCATGGAAGCAGTCATTCCC
CTTGAAGTCGGCCTCCCGACCTTGAGGTCGGAACTCTGTGACCAGGGCCT
GAACGATCAGAACGTGGCACGAGAGCTGGACTTGGCTGAAGAACGAAGAG
AGGCGGCAGCTATCCGCCTGGCCGCCTATCAGCAGCAGTTGGCCAGGGGA
TACAACCAGAAGGTCAAGGAAAGAAGATTCACGATAGGAGAGTTGGTCTT
GAAGAAAACACTTCCTGGCGACCGAGATCCTAACGAGGGCAAGCTGGCAC
CCAACTGGCAGGGACCGTTCAGAATAACGGTCCGGTATCAGTACCACCCT
CGCGGCTCGGCGCCTCTGTTCAGAGGGCCAACCGTCCTGAGCTCGGTGCC
TTCACCAGCTCTGGCGGCACAGCCATATGCAAATCAGGGTCCGGTAACAG
TACCACCCTCGCGGCTCGGCGCCTCTGTTCAGAGGGCCAACCGTTCTGAG
CTCGGTGCCTTCACCAGCTCTGGCGGCACAGCCATATGCAAATCAGGGTC
CGGTAACAGTACCACCCTCGCGGCTCGGCGCCTCTGTTCAGAGGGCCAAC
CGTCCTGA
Sequences
Sequence
ATGAAAAGTGAGGATGGGATGTTGCCCACTCTACCTACTGCAGCCCGCCA
GGGTAAGGGTCGATGGGACCTCACCTCACCTACCCCCACTCACAGAGAGA
ATGAACATGCAACGCTCGCTTATATATACGCATGGGATTGGTCCCATGAA
AGGCATCGGAGTGCCTTCGGCTCACAGCAGCCAGGGGCTCTGACGTTAGC
CTTTCTCCTTCCGTTTCAGGTTCCAGGCGTTCAGCATTTCCCTGTCCTAA
GCATTCTACCCCGATCTCATCTCAATCTAAGTAGGTGTCGTTTTTACCGC
CTACAGTTTGGCGCCGTCTGTGGGAAACTGAACAAAAAGCTTGTACACAC
TATGCCTCCAAAAACCAGAAACGGCGAAGGACCCTCCAAAGGCAAGGCTT
TGTCCATACAGCCTACACTGGCGCAGAATCTTCCGCCTCCTCCCCCTCAG
CAAAGGAGGTCTGGCGGGAGGTCTCCCACGGTCCAGACACAGTCGCAGTC
TAGGGAAGTGACCATGCTCTCCCTTCGCGACGTCCCACCTCCTGAACAGC
CCCGCCATAGCCATGGGCGGGGCAGGCAAGGCGACAAGTCAGTCACCAAG
CCACACGAGAAGTCAGCCCGGGCTGGATCGCTGTCACACCATCAGACCGG
CCTCGATCGGAACGAAGATCCCCGCCTGGAGGACATCAGAGCACAGAACC
TCCTCATCCAGGAACAGCGTGAGCTTATCGAACGGCTCACGCAACAGCTC
GAAGGCAAGAAGGATCAGAGCCCGCCGCCCAGGCGTCCGGGCCACGGGCA
AGACCTGAGGCACGTCCTCAACAGCAAGAGGCGTGACCGGGACCAAAGAG
AGGAAGGCTCTAGCAGCAGCCACATACATGAAGGGCCAAAGAAGCAATGC
CAGGGGTTGGAGGACGATGAACTGAAGAAGTGGATCGACCAGCAGGTAAA
GCAGACTATCCGCCAGAACTTAGAGACTGCTGGTATCGACCGGGACCAGT
ATGCCACTCTTGAAGCTGAAGATACTGGCGCGTCTCCTTTCTCTAGGGAG
ATAAGAAGATACACGCTGCCCGAGAAGTTCAGCGTCCCAAGGTTCACCCT
ATATGACGGGACCTCGGATCCTGCCGCACACCTCCGACATTACGTCCAAA
GGATGTCGGTCTGGGGGGACGACGATTCCCTGAACTGTCGAGTCTTTTCC
TCCAGTTTGGCGGATCTCCCCCTACGGTGGTTCTGTTCGCTTCCCGAAAA
TTCCATCTCTAGCTGGCGTCAGCTCCGGGCCTCCTTCCTAGGAAAGTTCC
AAGCTCATCGTGTCATCCCAAAGACCGATGCCGATCTGATGGCCCTCCGG
ATGCAGGAGAACGAGAACGTCACCCAGTTCGCTCGTCGATTCTGGACTGT
CTACAGCCAGATCGAGAGCGCTTCTGAGGAGCTGGCAGTGAGATCCTTCC
AGCTGGCTTTGCAGCCAGGTATCCCACTTCGGGCGCAGCTGGTCATGTAT
CCCGTGACCACCATGAAGGAACTGATGACCCGAGCAAACCGGTTCATCTT
GGCGGAAGAAGACGAGACGCGAGGTCGGGAGAACTTTGGCCTCACCAAGA
AGAGCCAACCGGCCAAGGGAGACAGCAGGTCCTCCAGGAGGGAGGATCGT
CGAAGGGACCCATCCCCGGATCAGCGCAAAGCCCGGTCCTCGGAGCAGCG
CCGAACCCCCTCCGCCTCGACGTCGGGATCACGGAGCAGCAGGGGATCCG
GCCACGAACCATCCTCATACGTGGCAGTGAACACCATCTTCAAGGAGCCG
ATCTATAGGCTCCTCAAGAAAATAAAGGCGCAGCCGTTCTTCAAATGGCC
GCGACCAATGACAGCCGACCCCTCCACCCGGGACCAGAGTAGGTTCTGTG
CCTACCACAAGCAGAACGGGCACAGGACCGACGAATGTAAGAGCTTCAAG
TTCCACCTGGAGGACCTAGTGAAGGAGGGGCATCTTCGGGAGTATATCAA
GCAGGAGGGCCGAGGTGATGGCCGACCCCCACGGCGGGAAGCTGAGAACC
AGGATAGCGAGCCGGAGGGCGTCATCCACGTCATCCACCTCGCCGCCCCA
CCTAAGAAGAGCTCCCAGGCTCGAGCTGAGGCCAGGCGCGCCTCCCATCA
AAAACAGGTGCTGACCGCGGCGCCAGAGCCGGCCGCGAAGAAAGCCAGAA
CAGAGGGGGTCAGAATATGGTTTTCTGATGAAGACCTAGAAGACGTCGAG
CTACCGCACAACGACGCCCTAGTGCTCACCTTGAAGCTTCAAAACTTCTT
GGTTCAGAGAGCCCTCGTCGACCCTGGCAGCTCATCCGAGGTCCTCTACT
ACGACTGCTTCAAAAAGTTGGGACTAAAAGACGAGGACCTCCAGGCAGCC
CGTACCCTCTGGCAGGTGAACTTCCTAGTGGTCGATGTCCCTTCCCCGTA
CAATGTAATAATGGGGAGGACATGGCTGCATAGCATGGAGGCGGTGCCCT
CCACCCGGCATCAGAAGCTTAAATTCCCTTTGGAAAGCCCGACGGGTCGG
ACGGACGTGATCACCGTCAGAGGCGACCAGCACATGGCCAGGCAGTGCCT
GCTGGCCGTGCTAGCTGACGAGGCTGAGCCATCCCAAGTCAATATGGCCG
AGCTGGATAGAGAGGCCGAGCTCGGTGACGTCGGCAGGGCTCCGGCACAG
AAAAGCATCGAGGACCTCACCAAGGTCAACATCGATCCCGCCGACCCCGA
CAGATTCTTTCTCGTGGGAAGCCAACTCCCCGAGACCGAGAAGACAGAGC
TGCTCAATCTCCTCGAAGAAAATAAGGCGGTCTTTGCCTGGACACCATAT
GAGATGCCCGGCATTGACCCGGCAGTCATCTGCCATGAGCTAAAGGTGGA
TCCCAACCATAGGCCCGTACTTCAAAAGCCGCGCCGGACTGGGGTCCCGC
AGACTGAGGCCGTGGTTGAGGAGGTTCAGAAACTTCTCGAGGCAGATGCA
ATAAGAGAGGTCCACTATCCGGAGTGGTTAGCTAACACCGTGGTGGTGAA
GAAGAAGACGGGAAAATGGAGGGTTTGCGTGGACTTCACCGACCTCAATA
AGGCCTGTCCCAAGGACAGCTTCCCTCTTCCGAAGATCGACCAACTCATC
GACGCCACTGCCGGACACGACCGGATGAGCTTCCTGGATGCCTACCGGGG
GTACCATCAGATCCCCTTGTACGCGGCAGACCAGGAGAAGACAGCTTTCA
TCACTCCCAGGGGCACCTATTGTTACAAGGTGATGCCCTTCGGGTTAAAA
AATGCCGGAGCAACATACCAGCGCTTGGTGACCAAGATGTTCCAGGCCCA
GCTCGGCAAGACGGTGGAGGTCTACATCGATGATATGGTCGTCAAATCCA
AGAGGTCGCAGGACCATCTGACCGACCTCCGCCAGATTTTTGACATCCTC
CGCCAGTTCCAGCTGAAGCTTAATGCGTCCAAGTGCGCCTTTGGGGTCGG
TTCCGGCAAGTTCCTAGGGAGCCTGGTCACAAGAAGGGGGATCGAAGCGA
ACCCTGATCAGATCACCGCGATCCAGGAGCTCCAGTGTCCGACCTCGGCG
AAACAAGTTCAGCGGCTGACCGGAATGGCTGCCGCCCTGAACCGCTTTAT
CAGCCGCGCTTCGGACAAGTGCAGACCCTTCTTCCAACTATTGCGAAAGG
GCTCCAAGTTCCAGTGGACATCGGATTGCGCTCAGGCGCTGCAACAGCTA
AAACAGTACCTTTCTTCTCCACCACTGCTATCAACCCCGACTTTCGGAGA
GGCACTGTTCTTGTACTTGTCGGTCTCGGACCATGCAGTGAGCTCGGTGC
TCATCAGAGAGGACAACGGCCAGCAGAGGCCCATCTATTACACGAGCAAG
ACCCTGCTGGACGCCGAGACCCGGTATTTGCAGCTCGAAAAGCTCGCCTT
GGCACTCGCTCTCCTCCGGAAGGCAGATTTCTCCGGACGGATCTCCAAAT
GGGCTGTCGAACTGGGGCAATATGATATCAGCTATAAGCCCAGGACGGCC
ATCAAAGCTCAAGTCTTAGCTGACTTCATTGTGGAATTTACTCCTCCGAG
TTCGGCACCGACCGCGCTCGACACCGAACTGGGGGGCGACAGGGGTACAG
AGGTTGTCACCGAGACTGAGCAAGAACAGTCCTGGAGAGAACTCCTAGAC
TCGTCCTGGAAAGTCTTCGTCGACGGATCCTCAACATCCAAGAGAGCTGG
CGCTGGCATAGTTCTCCAGTCTCCCGAAGGCCTCGTCATCGAGCAAGCTG
TGACACTTGGTTTCAAGGCTTCTAACAACGAGGCCGAATATGAAGCGCTC
ATTGCCGGACTGAACAGTGCCAAAATCTTGGAAGCCCGGTCCGTCGTGGT
TTTCAGCGATTCCCAATTGGTGACGAGCCAGCTCAGCGGGGATTACCAGG
CCCGGGATGACAGGATGGCAGCATACCTCGCCCACGCCAGGGGACTTCTC
TCCCAGTTCGAGAGGGCCGAGGTCCGGCAGATCGGCAGAGAATCCAACTC
CCATGCAGACGCCCTCGCCAGCCTCGCCTCGGCAGTGGAAGCCGGTGAAA
AAAGAACAGTGGAAGTAGAAACGCAGCAGGAGCCCAGCATCGACCTCCAG
CAACCACGGCAGCTCATGTGCCTTGAGCTCGGCCCGAGCTGGATGGACCC
TATCGTTGCTTACCTGAAGGATGACCAGCTACCCGAGGACAAGACTGAAG
CTCGAAAGATCAGATTGAAGGCGACCCGGTTCTGGCTGTCCCCAGACAGC
AAGCTCTATAGGAAGTCATTCACAGGGCCCTACCTCCAGTGCGTTCACCC
CGGCAAAGTCGACGATTTCCTCTACGAGATTCACGAGGGAGTCTGCGGCA
GTCACATAGGAGGTCGGTCACTTGCATACCGGGCTATCAGCCAGGGTTAC
TGGTGGCCCTACATGCAGAAGGACGCCCAGCTTTACGCCAGGAAGTGCGA
GAAGTGCCAGAAGTTCTCCCACTCTCTCCACCAGCCAGCCCAGGACCTGA
GTTCCCTCTCCAGCCCATGGCCTTTCGCCCAGTGGGGCCTGGACATCGTC
GGACCACTTCACCGAACTCCGGGGAACAAAAGATGGTTGATTGTGGCCAC
GGACTACTTCACAAAATGGGTCGAAGCTGAACCATTGTCCTCCATCACCG
AATTAGACACGAAGAACTTTGTGTGGAGGAACATCATCACCAGATTTGGA
ATTCCCCGCACTCTCATCTCCGACAACGGTACGCAATTCGATTCCAACTT
CTTCAAAAGCTTCTGCCAGGAGTACGGCATTCGCAACATCTACTCCACCC
CGGCTTATCCACAGAGCAACGGCCAGGCCGAGATCTCAAACAAAGTGCTT
CTCGACGGAATTAAAAAGAGACTCGACCGAGCCAAAGGTCGATGGGCAGA
GGAGCTGCCGAGTGTTCTATGGGCCTACCGAACTACTCCGAGGCGTTCCA
CCTCGGCGACCCCGTTCTCCCTCGCCTACGGCATGGAAGCAGTCATTCCC
CTTGAAGTCGGCCTCCCGACCTTGAGGTCGGAACTCTGTGACCAGGGCCT
GAACGATCAGAACGTGGCACGAGAGCTGGACTTGGCTGAAGAACGAAGAG
AGGCGGCAGCTATCCGCCTGGCCGCCTATCAGCAGCAGTTGGCCAGGGGA
TACAACCAGAAGGTCAAGGAAAGAAGATTCACGATAGGAGAGTTGGTCTT
GAAGAAAACACTTCCTGGCGACCGAGATCCTAACGAGGGCAAGCTGGCAC
CCAACTGGCAGGGACCGTTCAGAATAACGGTCCGGTATCAGTACCACCCT
CGCGGCTCGGCGCCTCTGTTCAGAGGGCCAACCGTCCTGAGCTCGGTGCC
TTCACCAGCTCTGGCGGCACAGCCATATGCAAATCAGGGTCCGGTAACAG
TACCACCCTCGCGGCTCGGCGCCTCTGTTCAGAGGGCCAACCGTTCTGAG
CTCGGTGCCTTCACCAGCTCTGGCGGCACAGCCATATGCAAATCAGGGTC
CGGTAACAGTACCACCCTCGCGGCTCGGCGCCTCTGTTCAGAGGGCCAAC
CGTCCTGA
Sequence Length
6108