Summary
Resource Type
mRNA
Organism
Persea americana-Anise
Name
Chr01.g00544.m1
Identifier
Chr01.g00544.m1
Protein Sequence
MALILHAGSTNKNAFKTLITAEYTGVKVELAQNFEMGVTNKTPQYLKLNP
IGKVPVLETPDGPIFESNAIARYVARLKEDNSVFGSSLIEYALVEQWIDF
ASLEIDANILRWFVPRMGFGVYLPPAEEAAIAALKRALTALNTHLATNTY
LVGHSVTLADIVMTCNLYLGFIRVMTKSFTSEFPHVERYFWTMVNQPNFS
KIMGEVKQVESVPPVQSAKKPAPPKESAKPKEVAKKEAKKEPAKPKVEAN
DEEEEAPKPKPKNPLDLLPPSTMILDEWKRLYSNTKTNFREVAIKGFWDM
YDPEGYSLWFCDYKYNDENTVSYVTLNKVGGFLQRMDLARKYAFGKMLVI
GSEAPYKVKGLWLFRGKEIPQFVMDECYDMELYEWTKVDISDEAQKERVN
AMIEDQEPFEGEALLDAKCFK*
Properties
Coding Sequence (CDS)
ATGGCTCTGATCTTGCATGCAGGAAGCACAAATAAAAATGCTTTCAAGAC
ACTTATCACTGCAGAGTATACTGGGGTCAAAGTTGAATTGGCCCAGAATT
TTGAGATGGGAGTTACAAATAAAACTCCTCAATATCTTAAGTTGAATCCC
ATTGGAAAGGTTCCAGTGTTAGAAACACCCGATGGCCCCATATTTGAGAG
CAATGCTATTGCACGCTATGTTGCCCGCTTGAAGGAAGACAATTCTGTTT
TTGGATCATCCTTGATTGAATATGCTCTTGTTGAGCAATGGATTGATTTT
GCTTCACTGGAGATTGATGCAAACATTTTGCGATGGTTTGTACCAAGAAT
GGGGTTTGGTGTGTACCTTCCTCCGGCTGAGGAGGCTGCCATTGCTGCTT
TGAAGAGGGCGCTGACCGCTTTGAATACACATCTCGCCACAAACACTTAC
CTGGTGGGACATTCTGTAACACTTGCTGACATTGTAATGACATGTAACTT
GTACTTGGGATTCATTCGTGTCATGACAAAGAGCTTTACCTCCGAGTTTC
CCCATGTTGAGAGATACTTCTGGACCATGGTTAACCAACCAAACTTTAGC
AAGATTATGGGTGAGGTGAAACAGGTAGAATCTGTTCCACCTGTTCAGTC
TGCAAAGAAGCCTGCTCCACCAAAGGAGTCTGCAAAGCCAAAGGAGGTAG
CAAAGAAAGAAGCCAAGAAAGAACCCGCAAAACCTAAAGTGGAGGCTAAT
GACGAGGAAGAAGAGGCACCCAAACCAAAGCCGAAGAATCCTCTTGATCT
TCTGCCTCCAAGTACGATGATTCTGGATGAGTGGAAGAGGCTCTATTCAA
ATACTAAGACCAACTTCCGTGAGGTTGCGATCAAAGGATTTTGGGATATG
TACGATCCTGAAGGTTACTCGCTATGGTTTTGTGACTATAAATACAATGA
TGAGAACACTGTCTCATATGTCACTCTGAACAAGGTGGGTGGATTCCTGC
AGCGGATGGATTTGGCACGCAAGTATGCATTTGGAAAGATGCTGGTGATC
GGATCAGAGGCACCATATAAGGTGAAGGGGCTATGGCTCTTCCGTGGAAA
GGAGATACCTCAGTTTGTAATGGACGAGTGCTATGACATGGAACTCTACG
AGTGGACAAAAGTAGACATTTCTGATGAAGCTCAGAAGGAGCGTGTTAAT
GCCATGATTGAAGATCAAGAGCCTTTTGAGGGTGAGGCCCTACTGGATGC
TAAGTGTTTCAAGTGA
Sequences
Sequence
GCTACGCTCTCTATATATATCTGATCCCATTGGCAGCATTTGGATATTCT
CTCTTGCTGCTCTCTGAACCCTAGCGACTGCTCCAAATCTAGGGTTTTTT
GTATTCGAAGGGCTCCCGTCCGCTCTCATCTTCTGTTGAATCACACACCT
TTCCATCAATGGCTCTGATCTTGCATGCAGGAAGCACAAATAAAAATGCT
TTCAAGACACTTATCACTGCAGAGTATACTGGGGTCAAAGTTGAATTGGC
CCAGAATTTTGAGATGGGAGTTACAAATAAAACTCCTCAATATCTTAAGT
TGAATCCCATTGGAAAGGTTCCAGTGTTAGAAACACCCGATGGCCCCATA
TTTGAGAGCAATGCTATTGCACGCTATGTTGCCCGCTTGAAGGAAGACAA
TTCTGTTTTTGGATCATCCTTGATTGAATATGCTCTTGTTGAGCAATGGA
TTGATTTTGCTTCACTGGAGATTGATGCAAACATTTTGCGATGGTTTGTA
CCAAGAATGGGGTTTGGTGTGTACCTTCCTCCGGCTGAGGAGGCTGCCAT
TGCTGCTTTGAAGAGGGCGCTGACCGCTTTGAATACACATCTCGCCACAA
ACACTTACCTGGTGGGACATTCTGTAACACTTGCTGACATTGTAATGACA
TGTAACTTGTACTTGGGATTCATTCGTGTCATGACAAAGAGCTTTACCTC
CGAGTTTCCCCATGTTGAGAGATACTTCTGGACCATGGTTAACCAACCAA
ACTTTAGCAAGATTATGGGTGAGGTGAAACAGGTAGAATCTGTTCCACCT
GTTCAGTCTGCAAAGAAGCCTGCTCCACCAAAGGAGTCTGCAAAGCCAAA
GGAGGTAGCAAAGAAAGAAGCCAAGAAAGAACCCGCAAAACCTAAAGTGG
AGGCTAATGACGAGGAAGAAGAGGCACCCAAACCAAAGCCGAAGAATCCT
CTTGATCTTCTGCCTCCAAGTACGATGATTCTGGATGAGTGGAAGAGGCT
CTATTCAAATACTAAGACCAACTTCCGTGAGGTTGCGATCAAAGGATTTT
GGGATATGTACGATCCTGAAGGTTACTCGCTATGGTTTTGTGACTATAAA
TACAATGATGAGAACACTGTCTCATATGTCACTCTGAACAAGGTGGGTGG
ATTCCTGCAGCGGATGGATTTGGCACGCAAGTATGCATTTGGAAAGATGC
TGGTGATCGGATCAGAGGCACCATATAAGGTGAAGGGGCTATGGCTCTTC
CGTGGAAAGGAGATACCTCAGTTTGTAATGGACGAGTGCTATGACATGGA
ACTCTACGAGTGGACAAAAGTAGACATTTCTGATGAAGCTCAGAAGGAGC
GTGTTAATGCCATGATTGAAGATCAAGAGCCTTTTGAGGGTGAGGCCCTA
CTGGATGCTAAGTGTTTCAAGTGA
Sequence Length
1424