Summary
Resource Type
mRNA
Organism
Persea americana-Anise
Name
Chr02.g16256.m1
Identifier
Chr02.g16256.m1
Protein Sequence
MAQILLHGTLNVTIFEAEALSNPNRASGTAPKFLRKLVENIEETVGIGKG
MTRVYATIDLEKARVGRTRIIQNEPVNPRWYESFHIYCAHIAAYVIFTIK
EDNPIGATLIGRAYIPVKEILNGEVVDRWVEICNDNRRPIGGGSRIHVKL
QYFDITGELNWSRGIRSPKFPGVPYTFFSQRQGCRVSLYQDSHVPDDFIQ
RIPLADGKYYEPHRCWEDIFDAITNAKHLIYITGWSVYTETTLIRDSRRQ
KPGGDVTLGELLKRKAIEGVRVLMLVWDDRTSVGLLNKAGLMATHDEETA
NYFYGTDVHCVLCPRNPDNGGSVVQNLQISTMFTHHQKIVVVDSEMPNKR
SQKRRIVSFVGGIDLCDGRYDTQFHSLFRTLDTAHHTDFHQPNFLGSSIT
KGGPREPWHDIHCRLEGPVAWDVLFNFEQRWRKQGGQDLLVHLKDLAHII
IPPSPVMFPEDRETWNVQLFRSIDGGAAFGFPEKPEGAARAGLVSGKDNI
IDRSIQDAYINAIRRAKDFIYIENQYFLGSSFCWAAEGIKVEDIGALHLV
PKELSLKIISKIEAGHRFTVYVVVPMWPEGEPESASVQAILDWQRRTMEM
MYSDIALALRVKGLDVNPKEYLTFFCLANREVKKSGEYSPQEQPEPNSDY
SRAQQARRFMIYVHSKMMIVDDEYIIIGSANINQRSMDGSRDSEIAMGAY
QPYHLATRQPARGQIHGFRMALWYEHLGMIDNSFLQPESLECVRKVNKIA
DKYWDLYTSETMEHDLPGHLLSYPIGVANDGHVSQLPGTEFFPDTKARIL
GTKSDYLPPILTT*
Properties
Coding Sequence (CDS)
ATGGCGCAGATTCTACTCCACGGGACTCTCAACGTCACCATCTTTGAGGC
CGAAGCCCTGTCGAATCCTAACAGAGCTAGTGGCACTGCGCCGAAATTCC
TTAGAAAGCTTGTGGAAAACATTGAGGAGACTGTTGGCATTGGGAAAGGA
ATGACGAGAGTATATGCGACTATTGATTTAGAGAAGGCTAGAGTCGGGCG
AACACGCATAATTCAAAATGAGCCTGTTAACCCTCGTTGGTATGAGTCTT
TTCATATCTATTGTGCCCATATCGCTGCTTATGTCATTTTCACAATCAAA
GAAGATAATCCTATTGGGGCAACGCTGATTGGAAGAGCTTACATACCTGT
CAAGGAAATCCTGAATGGTGAGGTGGTGGATAGATGGGTCGAGATATGCA
ATGATAACCGTCGGCCTATTGGTGGGGGTTCCAGGATCCATGTGAAACTG
CAATATTTTGATATTACAGGAGAACTCAACTGGTCGAGGGGCATCAGAAG
TCCTAAATTCCCTGGTGTTCCTTATACATTCTTCTCGCAGAGACAGGGAT
GCAGAGTCTCACTGTACCAAGATTCCCATGTGCCTGACGACTTCATTCAA
AGAATCCCTCTTGCTGATGGGAAGTATTATGAGCCACATAGATGTTGGGA
GGATATCTTTGATGCAATTACAAATGCAAAGCACCTTATTTACATCACTG
GATGGTCTGTATACACTGAGACCACCTTGATAAGGGACTCAAGAAGGCAG
AAACCAGGAGGAGATGTGACTCTTGGAGAGCTTCTCAAGAGGAAGGCAAT
AGAGGGTGTTAGAGTTTTGATGCTTGTTTGGGATGACAGAACCTCTGTGG
GTTTACTGAACAAGGCTGGATTGATGGCTACCCATGATGAAGAAACTGCA
AACTACTTTTATGGCACGGATGTGCACTGTGTTTTGTGCCCCCGTAATCC
AGACAATGGAGGAAGTGTAGTTCAGAACCTGCAGATCTCTACCATGTTCA
CTCATCATCAAAAGATTGTAGTGGTTGATAGTGAGATGCCTAACAAGCGG
TCACAAAAGAGGAGGATTGTGAGTTTTGTTGGAGGCATTGATCTTTGTGA
TGGGAGATATGACACACAGTTTCACTCTCTTTTCAGAACTTTGGACACTG
CTCACCACACTGATTTCCATCAACCTAATTTCCTTGGTTCTTCAATTACA
AAAGGTGGCCCAAGAGAGCCTTGGCATGACATTCATTGCCGGCTAGAAGG
ACCCGTTGCTTGGGATGTGCTGTTCAATTTTGAACAGAGATGGAGGAAGC
AAGGTGGGCAGGATCTGCTTGTTCATCTAAAAGATCTTGCTCATATCATC
ATCCCCCCTTCTCCTGTTATGTTCCCAGAAGATAGAGAAACATGGAATGT
CCAACTTTTCCGTTCTATTGATGGAGGGGCTGCTTTTGGCTTCCCTGAGA
AACCTGAGGGTGCTGCTCGAGCAGGCCTTGTCAGTGGGAAAGATAACATC
ATTGATAGGAGCATTCAAGATGCTTACATAAATGCCATTCGCCGAGCAAA
GGATTTTATCTACATCGAAAACCAGTATTTTCTTGGTAGCTCATTTTGCT
GGGCAGCAGAAGGCATTAAGGTCGAGGACATTGGTGCATTACATCTTGTC
CCAAAGGAGCTGTCATTGAAGATTATCAGTAAAATTGAAGCTGGTCATCG
GTTTACTGTCTATGTGGTGGTTCCAATGTGGCCGGAAGGGGAGCCAGAAT
CTGCATCTGTGCAAGCAATACTGGATTGGCAGCGGAGAACCATGGAGATG
ATGTATTCTGACATTGCCTTGGCCCTGCGTGTAAAAGGTCTTGATGTGAA
TCCTAAAGAATACCTGACATTTTTCTGTCTAGCGAATCGAGAAGTAAAGA
AAAGCGGGGAGTATTCACCTCAGGAGCAACCGGAGCCTAATTCAGATTAT
AGTAGAGCCCAGCAGGCCAGGCGCTTCATGATCTATGTTCATTCCAAGAT
GATGATTGTTGACGATGAGTACATAATCATCGGGTCAGCAAACATCAACC
AGAGATCAATGGATGGCTCAAGGGATTCTGAGATAGCCATGGGAGCGTAT
CAGCCATATCACCTAGCAACCAGGCAGCCGGCACGCGGACAGATTCATGG
CTTCCGGATGGCACTGTGGTATGAGCATCTCGGCATGATTGACAACTCCT
TCCTCCAGCCAGAGAGTTTGGAATGTGTCCGCAAGGTGAACAAGATTGCT
GATAAGTACTGGGATCTCTACACAAGTGAGACAATGGAGCATGATCTCCC
AGGGCACCTGCTCAGCTATCCCATTGGAGTTGCTAATGACGGCCATGTGT
CACAGCTGCCAGGAACAGAGTTCTTCCCTGACACCAAGGCTCGCATTCTT
GGCACCAAGTCTGACTACCTACCACCTATACTCACCACCTGA
Sequences
Sequence
AAATCGAGTGGCAGGCTACTTGGGTTTTCTACCAACGTGGGATGAATTGG
TTGGTCCACTCATGCTGAGCTTAGGTCATGCGCGGCGGAGGATCCGGAGC
TATCCTCTTCTAGAAAGCAACGCCGTTGCAGACAGCCTTGTCAGTCCCAT
TTCAAACTTGGAGTAAAGAAAACCTGACAAAAAAAAAATAAAAAACCGCC
TGCAATTCGGACTTTTAGCGTGTTCTCCTCGTCATTCATGTGAACATTAC
AATTCCCATAAATCCTTTTCGTCTTCTCTGCGTTTTCTCCTCTAAACATT
AGAAAGAAATCTCTATTTCTCCTCCTCACCCATCTGATCTCTATTTTCTT
TCTCCCATATCTTAGCATTCCTTCCATTCGGCTCCAAAACACCGAATCTC
TTGCAGAGACTTCTCCTCTCTGCTTAGAGATTTTGTTATTTCAAGAGCTC
TATTACTTTGAAGCTCGATCTTCCATCTCAAAGCTCTTGCATTTCTCTCT
AAAAAGCTCTGATTGCCGTTGATTTTTTTTTTATTGTATCTATATTATTG
GTTTGGATCTTGTTCTTGGGGTATTTGTTCGAGCAGATGGCGCAGATTCT
ACTCCACGGGACTCTCAACGTCACCATCTTTGAGGCCGAAGCCCTGTCGA
ATCCTAACAGAGCTAGTGGCACTGCGCCGAAATTCCTTAGAAAGCTTGTG
GAAAACATTGAGGAGACTGTTGGCATTGGGAAAGGAATGACGAGAGTATA
TGCGACTATTGATTTAGAGAAGGCTAGAGTCGGGCGAACACGCATAATTC
AAAATGAGCCTGTTAACCCTCGTTGGTATGAGTCTTTTCATATCTATTGT
GCCCATATCGCTGCTTATGTCATTTTCACAATCAAAGAAGATAATCCTAT
TGGGGCAACGCTGATTGGAAGAGCTTACATACCTGTCAAGGAAATCCTGA
ATGGTGAGGTGGTGGATAGATGGGTCGAGATATGCAATGATAACCGTCGG
CCTATTGGTGGGGGTTCCAGGATCCATGTGAAACTGCAATATTTTGATAT
TACAGGAGAACTCAACTGGTCGAGGGGCATCAGAAGTCCTAAATTCCCTG
GTGTTCCTTATACATTCTTCTCGCAGAGACAGGGATGCAGAGTCTCACTG
TACCAAGATTCCCATGTGCCTGACGACTTCATTCAAAGAATCCCTCTTGC
TGATGGGAAGTATTATGAGCCACATAGATGTTGGGAGGATATCTTTGATG
CAATTACAAATGCAAAGCACCTTATTTACATCACTGGATGGTCTGTATAC
ACTGAGACCACCTTGATAAGGGACTCAAGAAGGCAGAAACCAGGAGGAGA
TGTGACTCTTGGAGAGCTTCTCAAGAGGAAGGCAATAGAGGGTGTTAGAG
TTTTGATGCTTGTTTGGGATGACAGAACCTCTGTGGGTTTACTGAACAAG
GCTGGATTGATGGCTACCCATGATGAAGAAACTGCAAACTACTTTTATGG
CACGGATGTGCACTGTGTTTTGTGCCCCCGTAATCCAGACAATGGAGGAA
GTGTAGTTCAGAACCTGCAGATCTCTACCATGTTCACTCATCATCAAAAG
ATTGTAGTGGTTGATAGTGAGATGCCTAACAAGCGGTCACAAAAGAGGAG
GATTGTGAGTTTTGTTGGAGGCATTGATCTTTGTGATGGGAGATATGACA
CACAGTTTCACTCTCTTTTCAGAACTTTGGACACTGCTCACCACACTGAT
TTCCATCAACCTAATTTCCTTGGTTCTTCAATTACAAAAGGTGGCCCAAG
AGAGCCTTGGCATGACATTCATTGCCGGCTAGAAGGACCCGTTGCTTGGG
ATGTGCTGTTCAATTTTGAACAGAGATGGAGGAAGCAAGGTGGGCAGGAT
CTGCTTGTTCATCTAAAAGATCTTGCTCATATCATCATCCCCCCTTCTCC
TGTTATGTTCCCAGAAGATAGAGAAACATGGAATGTCCAACTTTTCCGTT
CTATTGATGGAGGGGCTGCTTTTGGCTTCCCTGAGAAACCTGAGGGTGCT
GCTCGAGCAGGCCTTGTCAGTGGGAAAGATAACATCATTGATAGGAGCAT
TCAAGATGCTTACATAAATGCCATTCGCCGAGCAAAGGATTTTATCTACA
TCGAAAACCAGTATTTTCTTGGTAGCTCATTTTGCTGGGCAGCAGAAGGC
ATTAAGGTCGAGGACATTGGTGCATTACATCTTGTCCCAAAGGAGCTGTC
ATTGAAGATTATCAGTAAAATTGAAGCTGGTCATCGGTTTACTGTCTATG
TGGTGGTTCCAATGTGGCCGGAAGGGGAGCCAGAATCTGCATCTGTGCAA
GCAATACTGGATTGGCAGCGGAGAACCATGGAGATGATGTATTCTGACAT
TGCCTTGGCCCTGCGTGTAAAAGGTCTTGATGTGAATCCTAAAGAATACC
TGACATTTTTCTGTCTAGCGAATCGAGAAGTAAAGAAAAGCGGGGAGTAT
TCACCTCAGGAGCAACCGGAGCCTAATTCAGATTATAGTAGAGCCCAGCA
GGCCAGGCGCTTCATGATCTATGTTCATTCCAAGATGATGATTGTTGACG
ATGAGTACATAATCATCGGGTCAGCAAACATCAACCAGAGATCAATGGAT
GGCTCAAGGGATTCTGAGATAGCCATGGGAGCGTATCAGCCATATCACCT
AGCAACCAGGCAGCCGGCACGCGGACAGATTCATGGCTTCCGGATGGCAC
TGTGGTATGAGCATCTCGGCATGATTGACAACTCCTTCCTCCAGCCAGAG
AGTTTGGAATGTGTCCGCAAGGTGAACAAGATTGCTGATAAGTACTGGGA
TCTCTACACAAGTGAGACAATGGAGCATGATCTCCCAGGGCACCTGCTCA
GCTATCCCATTGGAGTTGCTAATGACGGCCATGTGTCACAGCTGCCAGGA
ACAGAGTTCTTCCCTGACACCAAGGCTCGCATTCTTGGCACCAAGTCTGA
CTACCTACCACCTATACTCACCACCTGACTGCAGGTGACAATCAGTAATG
TGATCAATCCTTTGTCA
Sequence Length
3067