Summary
Resource Type
mRNA
Organism
Persea americana-Anise
Name
Chr05.g41059.m1
Identifier
Chr05.g41059.m1
Protein Sequence
MGMKQILAVYLRRPKPTSLLHPRRSFSHSSAAIAAAESPDSAPILPPTML
YDHLADAVKSKIRRLDNPDHRFLRRASPHPALSDHTQILSAPSTRVTTLP
NGLRVATESSLAARTATVGVWIDAGSRFESDETNGTAHFLEHMIFKGTER
RSVRVLEEEIENMGGHLNAYTSREQTTYYAKVMDKDVPKALDILADILQN
SCFKEDQMGRERGVILREMEEVEGQVEEVIFDHLHATAFQYTPLGRTILG
PAQNIKTITKAHLQNYISTHYTAPRMVIVATGAVKHEDIVEQVKKLFTKL
SSDPTTVSELVAKEPAVFTGSEVRIIDDDVPLAQFAVAFSGASWTDPDSI
ALMVMQSMLGSWNKNVGGGKHMASELVQRVGINEIAESMTAFNTNYKDTG
LFGVYAIAQPDCLDDLAYAIMYEISKLSYRVSEADVARARNQLKSSLLLH
IDGTSPVAEDIGRQLLTYGRRIPFAELFARIDAVDASTVKRVANRFIFDR
EIAIAAMGPIQSLPDYNWFRRRTYWLRY*
Properties
Coding Sequence (CDS)
ATGGGGATGAAACAAATCCTAGCCGTCTATCTCCGCCGCCCAAAACCCAC
CTCTCTCCTCCACCCTCGCCGCTCCTTCTCCCACTCCTCCGCCGCGATCG
CCGCCGCAGAATCTCCGGACTCCGCCCCCATCCTGCCACCGACGATGCTC
TACGATCACCTCGCCGACGCCGTCAAATCCAAGATCCGCCGCCTCGACAA
CCCCGACCACCGCTTCCTCCGCCGCGCCTCGCCGCACCCCGCCCTCTCCG
ACCACACGCAGATCCTCTCCGCCCCTTCCACCCGCGTCACCACCCTCCCC
AACGGCCTCCGAGTCGCCACCGAGTCCTCACTCGCCGCCCGCACTGCCAC
CGTCGGCGTCTGGATCGACGCTGGCAGCCGGTTCGAGAGCGACGAGACGA
ACGGCACCGCGCATTTCCTCGAGCACATGATCTTCAAGGGGACGGAGAGG
CGTTCCGTGCGGGTGCTGGAGGAGGAGATCGAGAACATGGGGGGCCACCT
GAATGCGTATACCTCCAGGGAGCAGACGACGTACTACGCGAAGGTCATGG
ATAAGGACGTGCCCAAGGCGCTCGACATTCTTGCAGATATACTCCAGAAT
TCCTGCTTCAAGGAGGATCAGATGGGTCGCGAGCGCGGCGTCATACTGAG
AGAGATGGAAGAGGTGGAGGGGCAAGTGGAAGAAGTTATTTTTGACCATT
TGCATGCAACTGCGTTTCAGTACACCCCTTTGGGTAGAACCATATTGGGA
CCTGCTCAAAATATTAAGACAATCACCAAAGCTCATCTTCAAAACTATAT
TTCAACTCATTATACAGCTCCCAGAATGGTGATAGTTGCCACTGGTGCAG
TTAAACATGAAGATATAGTTGAGCAAGTGAAGAAGCTATTCACAAAGCTG
TCATCTGATCCTACTACAGTTTCTGAGTTGGTTGCAAAAGAGCCAGCTGT
TTTTACTGGTTCTGAGGTTCGTATAATTGATGATGATGTTCCACTTGCGC
AATTTGCAGTTGCATTTAGTGGAGCATCTTGGACAGATCCGGATTCAATT
GCTTTGATGGTTATGCAATCTATGCTAGGTTCTTGGAATAAGAATGTGGG
TGGTGGGAAGCACATGGCGTCAGAGTTGGTACAGAGAGTTGGGATTAATG
AAATAGCGGAGAGCATGACGGCTTTTAACACCAACTACAAAGACACTGGC
CTCTTTGGTGTCTATGCCATTGCGCAGCCAGATTGCCTGGATGATTTGGC
ATATGCAATCATGTACGAGATCAGCAAGTTGTCATACCGCGTTTCAGAAG
CTGATGTTGCTCGTGCTCGCAATCAGTTGAAATCATCTTTGCTACTTCAC
ATTGATGGAACCAGTCCAGTTGCAGAAGACATTGGCCGCCAGCTACTTAC
ATATGGCCGCAGGATCCCATTCGCTGAACTGTTTGCTAGGATCGATGCAG
TCGATGCAAGCACTGTCAAACGAGTAGCAAACCGATTTATATTTGACAGG
GAGATTGCAATTGCTGCAATGGGACCCATTCAGAGTCTTCCTGACTACAA
CTGGTTCAGGCGCCGCACATACTGGCTCCGATATTAG
Sequences
Sequence
TCTCCATGACAATATACATAATTGGGAATGAACTCTAATCCAACCTGCTA
TCATGTCTCATGGTTGACCCTTTTTCAATGAAATTTGAATCCGATGAGGC
TTTATCCCATGATGACCATGAGTGGACCTATCATTGTCCGCCACATCACC
ACAGACAGCTTGCGTGCATGCTGGTATCCTGCTCCGGTCCAAGGCAGGGG
CTGCCCATGGTGGCTTCACAGACCGTGATTGGTCTGATCAAAGTCACTGT
GGGTAGGATCCCCATTCTGATAAATGGGATGAATTTACGTTGAATATGAA
CAAACTACCCATGGGCCATGGTTCTCAACTCAGGCATGACCCAACCCGAC
CCGACTGACCCACCGGAAGTTATAATCCCCTCTTATTTAGCCGGGCTTGT
GGACCCTACACGCACGTGTCACACTTGCCCAGTCCACGCACGTGTCACAC
GCAGGATCCTGTTTCTTCTCCAAACGAAATCACAAATCCCTTTCTTCTTC
TCCGAACCCTAAACCCTGCAATTCTTTCCAAACCCTAGAAATCTGGAGAA
GTAGAAAAGATGGGGATGAAACAAATCCTAGCCGTCTATCTCCGCCGCCC
AAAACCCACCTCTCTCCTCCACCCTCGCCGCTCCTTCTCCCACTCCTCCG
CCGCGATCGCCGCCGCAGAATCTCCGGACTCCGCCCCCATCCTGCCACCG
ACGATGCTCTACGATCACCTCGCCGACGCCGTCAAATCCAAGATCCGCCG
CCTCGACAACCCCGACCACCGCTTCCTCCGCCGCGCCTCGCCGCACCCCG
CCCTCTCCGACCACACGCAGATCCTCTCCGCCCCTTCCACCCGCGTCACC
ACCCTCCCCAACGGCCTCCGAGTCGCCACCGAGTCCTCACTCGCCGCCCG
CACTGCCACCGTCGGCGTCTGGATCGACGCTGGCAGCCGGTTCGAGAGCG
ACGAGACGAACGGCACCGCGCATTTCCTCGAGCACATGATCTTCAAGGGG
ACGGAGAGGCGTTCCGTGCGGGTGCTGGAGGAGGAGATCGAGAACATGGG
GGGCCACCTGAATGCGTATACCTCCAGGGAGCAGACGACGTACTACGCGA
AGGTCATGGATAAGGACGTGCCCAAGGCGCTCGACATTCTTGCAGATATA
CTCCAGAATTCCTGCTTCAAGGAGGATCAGATGGGTCGCGAGCGCGGCGT
CATACTGAGAGAGATGGAAGAGGTGGAGGGGCAAGTGGAAGAAGTTATTT
TTGACCATTTGCATGCAACTGCGTTTCAGTACACCCCTTTGGGTAGAACC
ATATTGGGACCTGCTCAAAATATTAAGACAATCACCAAAGCTCATCTTCA
AAACTATATTTCAACTCATTATACAGCTCCCAGAATGGTGATAGTTGCCA
CTGGTGCAGTTAAACATGAAGATATAGTTGAGCAAGTGAAGAAGCTATTC
ACAAAGCTGTCATCTGATCCTACTACAGTTTCTGAGTTGGTTGCAAAAGA
GCCAGCTGTTTTTACTGGTTCTGAGGTTCGTATAATTGATGATGATGTTC
CACTTGCGCAATTTGCAGTTGCATTTAGTGGAGCATCTTGGACAGATCCG
GATTCAATTGCTTTGATGGTTATGCAATCTATGCTAGGTTCTTGGAATAA
GAATGTGGGTGGTGGGAAGCACATGGCGTCAGAGTTGGTACAGAGAGTTG
GGATTAATGAAATAGCGGAGAGCATGACGGCTTTTAACACCAACTACAAA
GACACTGGCCTCTTTGGTGTCTATGCCATTGCGCAGCCAGATTGCCTGGA
TGATTTGGCATATGCAATCATGTACGAGATCAGCAAGTTGTCATACCGCG
TTTCAGAAGCTGATGTTGCTCGTGCTCGCAATCAGTTGAAATCATCTTTG
CTACTTCACATTGATGGAACCAGTCCAGTTGCAGAAGACATTGGCCGCCA
GCTACTTACATATGGCCGCAGGATCCCATTCGCTGAACTGTTTGCTAGGA
TCGATGCAGTCGATGCAAGCACTGTCAAACGAGTAGCAAACCGATTTATA
TTTGACAGGGAGATTGCAATTGCTGCAATGGGACCCATTCAGAGTCTTCC
TGACTACAACTGGTTCAGGCGCCGCACATACTGGCTCCGATATTAGGTAT
CCCATTATTTATCAACGGCCTCAGAAATTTAATCAACCGAA
Sequence Length
2191