Summary
Resource Type
mRNA
Organism
Persea americana-Anise
Name
Chr01.g00037.m1
Identifier
Chr01.g00037.m1
Protein Sequence
MGVWVKHRNDEIKQGSRLNSPACGRRSSARQLGQYLGSSATRPIACKLST
TVRQLGISASPVQRRATAKPSLVPDRSTRVRVGRHLPPGNTAPPDRYGRS
FMAIGLLIYGDKRCALSPLYASWLKAWKVRCHFYRLQFGAVCGKLNKKLV
NTMPPKTRNGEGPSRGKALSLQPPLAQNLPPPPPQQRRALPPVRSPQQSR
RFPLRNSRRNLRQSYWRSVTRIPGYQPGLLVAVHAKGRPAVCQEMREVPE
VLSLSPPASPRPESPLQSMAFRPVGPGHCRTTSPNSREQKMVDCGHGLLH
EMGRSRTFVLHHRIRHEELVWKNIITRFGIPRTLILDNGTQFDYNLFKSF
CQEYGIRNIYSTPAYPQSNGQAEISNKVRLNGIKKRLDRAKGRWAEELPS
ILWAYRTTPRRSTSATPFSLAYGMEAVIPLEVGLPTLRSELCDQGLNNLN
VARELDLAEKRREAAAIRLAAYQQQLARGYNPKVKERRFAIGELVLKKTL
PGDRDPNEGKLAPNWQGPFRITSTAGRSAYRLEDMEGKPLLRPWNATHLK
KFYF*
Properties
Coding Sequence (CDS)
ATGGGTGTGTGGGTAAAACACCGTAATGACGAAATTAAACAAGGATCACG
GCTAAACTCACCAGCCTGTGGTAGAAGATCGTCAGCTCGGCAGCTCGGTC
AATACCTTGGCAGCTCGGCAACTCGGCCAATAGCTTGCAAGCTCAGCACC
ACAGTTCGGCAGCTCGGTATAAGCGCCAGCCCGGTGCAAAGGCGCGCCAC
GGCCAAGCCATCCTTGGTCCCAGATCGCAGCACTAGAGTCAGAGTAGGCC
GCCACCTTCCTCCTGGAAATACGGCGCCCCCTGACAGATATGGGCGGTCA
TTTATGGCGATAGGATTGCTCATTTATGGTGATAAGAGGTGTGCTTTATC
ACCCCTGTACGCCAGCTGGCTGAAGGCGTGGAAAGTGAGGTGTCATTTTT
ACCGCCTACAGTTTGGCGCCGTCTGTGGGAAACTGAACAAAAAGCTTGTA
AACACCATGCCTCCGAAAACCAGAAATGGCGAAGGACCCTCCAGGGGCAA
GGCTTTGTCCCTACAGCCTCCGCTGGCGCAGAATCTTCCACCTCCTCCCC
CTCAGCAAAGGAGGGCCCTACCTCCAGTGCGTTCACCCCAGCAAAGTCGA
CGATTTCCTCTACGAAATTCACGAAGGAATCTGCGGCAATCATATTGGAG
GTCGGTCACTCGCATACCGGGCTATCAGCCAGGGTTACTGGTGGCCGTAC
ATGCAAAAGGACGCCCAGCTGTATGCCAGGAAATGCGAGAAGTGCCAGAA
GTTCTCTCACTCTCTCCACCAGCCAGCCCAAGACCAGAGTCCCCTCTCCA
GTCCATGGCCTTTCGCCCAGTGGGGCCTGGACATTGTCGGACCACTTCAC
CGAACTCCAGGGAACAGAAGATGGTTGATTGTGGCCACGGACTACTTCAC
GAAATGGGTCGAAGCCGAACCTTTGTCCTCCATCACCGAATTAGACACGA
AGAACTTGTATGGAAGAATATCATCACCAGGTTTGGAATTCCCCGCACTC
TCATTTTGGACAACGGAACGCAGTTCGATTACAACCTCTTCAAGAGCTTC
TGCCAGGAGTACGGCATTCGCAACATCTACTCCACCCCGGCATATCCCCA
GAGCAACGGTCAGGCCGAGATCTCGAACAAAGTACGGCTCAACGGAATCA
AAAAGAGACTCGACCGAGCCAAAGGTCGATGGGCAGAGGAGCTGCCAAGC
ATTCTATGGGCCTACCGAACTACCCCAAGGCGTTCCACCTCGGCTACCCC
GTTCTCCCTTGCCTACGGCATGGAAGCAGTTATTCCCCTTGAGGTCGGCC
TCCCGACCTTGAGGTCAGAACTCTGTGACCAGGGTCTGAACAATCTGAAC
GTAGCGCGGGAGCTGGACTTGGCTGAAAAACGAAGAGAGGCGGCAGCTAT
CCGCCTGGCCGCCTACCAACAGCAGTTGGCCAGGGGATACAACCCGAAGG
TCAAAGAAAGAAGATTCGCGATAGGAGAGTTGGTCTTGAAGAAAACACTT
CCTGGCGACCGAGATCCCAACGAAGGCAAGCTGGCGCCCAACTGGCAGGG
ACCGTTCAGAATAACTTCTACAGCCGGGAGATCTGCCTACCGACTCGAAG
ATATGGAAGGGAAGCCGCTCCTGCGACCATGGAACGCGACTCATCTCAAA
AAATTCTACTTCTAA
Sequences
Sequence
ATGGGTGTGTGGGTAAAACACCGTAATGACGAAATTAAACAAGGATCACG
GCTAAACTCACCAGCCTGTGGTAGAAGATCGTCAGCTCGGCAGCTCGGTC
AATACCTTGGCAGCTCGGCAACTCGGCCAATAGCTTGCAAGCTCAGCACC
ACAGTTCGGCAGCTCGGTATAAGCGCCAGCCCGGTGCAAAGGCGCGCCAC
GGCCAAGCCATCCTTGGTCCCAGATCGCAGCACTAGAGTCAGAGTAGGCC
GCCACCTTCCTCCTGGAAATACGGCGCCCCCTGACAGATATGGGCGGTCA
TTTATGGCGATAGGATTGCTCATTTATGGTGATAAGAGGTGTGCTTTATC
ACCCCTGTACGCCAGCTGGCTGAAGGCGTGGAAAGTGAGGTGTCATTTTT
ACCGCCTACAGTTTGGCGCCGTCTGTGGGAAACTGAACAAAAAGCTTGTA
AACACCATGCCTCCGAAAACCAGAAATGGCGAAGGACCCTCCAGGGGCAA
GGCTTTGTCCCTACAGCCTCCGCTGGCGCAGAATCTTCCACCTCCTCCCC
CTCAGCAAAGGAGGGCCCTACCTCCAGTGCGTTCACCCCAGCAAAGTCGA
CGATTTCCTCTACGAAATTCACGAAGGAATCTGCGGCAATCATATTGGAG
GTCGGTCACTCGCATACCGGGCTATCAGCCAGGGTTACTGGTGGCCGTAC
ATGCAAAAGGACGCCCAGCTGTATGCCAGGAAATGCGAGAAGTGCCAGAA
GTTCTCTCACTCTCTCCACCAGCCAGCCCAAGACCAGAGTCCCCTCTCCA
GTCCATGGCCTTTCGCCCAGTGGGGCCTGGACATTGTCGGACCACTTCAC
CGAACTCCAGGGAACAGAAGATGGTTGATTGTGGCCACGGACTACTTCAC
GAAATGGGTCGAAGCCGAACCTTTGTCCTCCATCACCGAATTAGACACGA
AGAACTTGTATGGAAGAATATCATCACCAGGTTTGGAATTCCCCGCACTC
TCATTTTGGACAACGGAACGCAGTTCGATTACAACCTCTTCAAGAGCTTC
TGCCAGGAGTACGGCATTCGCAACATCTACTCCACCCCGGCATATCCCCA
GAGCAACGGTCAGGCCGAGATCTCGAACAAAGTACGGCTCAACGGAATCA
AAAAGAGACTCGACCGAGCCAAAGGTCGATGGGCAGAGGAGCTGCCAAGC
ATTCTATGGGCCTACCGAACTACCCCAAGGCGTTCCACCTCGGCTACCCC
GTTCTCCCTTGCCTACGGCATGGAAGCAGTTATTCCCCTTGAGGTCGGCC
TCCCGACCTTGAGGTCAGAACTCTGTGACCAGGGTCTGAACAATCTGAAC
GTAGCGCGGGAGCTGGACTTGGCTGAAAAACGAAGAGAGGCGGCAGCTAT
CCGCCTGGCCGCCTACCAACAGCAGTTGGCCAGGGGATACAACCCGAAGG
TCAAAGAAAGAAGATTCGCGATAGGAGAGTTGGTCTTGAAGAAAACACTT
CCTGGCGACCGAGATCCCAACGAAGGCAAGCTGGCGCCCAACTGGCAGGG
ACCGTTCAGAATAACTTCTACAGCCGGGAGATCTGCCTACCGACTCGAAG
ATATGGAAGGGAAGCCGCTCCTGCGACCATGGAACGCGACTCATCTCAAA
AAATTCTACTTCTAA
Sequence Length
1665