YALI0F12639g

Overview

Description similar to uniprot|P08566 Saccharomyces cerevisiae YDR127W ARO1 Pentafunctional arom protein, catalyzes steps 2 through 6 in the biosynthesis of chorismate, which is a precursor to aromatic amino acids
Locus type CDS
Locus tag YALI0F12639g

Location

Species Yarrowia lipolytica Positions 1694177..1699151
Strain CLIB 122 Strand Antisense
Chromosome YALI0F Total length 4975 (nuc.)
Previous locus YALI0F12617g Next locus YALI0F12661g

Structure and hierarchy

Here is a representation of the structure of the locus YALI0F12639g oriented from its 5' end (left) to its 3' end (right). In accordance with the decomposition of feature levels, this locus consists of :

  • The whole locus region.
  • Transcribed regions (translated part).
  • Transcribed regions (untranslated part).
  • Intronic regions.
  • Coding regions (CDS).

By clicking on the different fragments, you can show/hide the nucleotide sequence that corresponds to the selected region/feature.


YALI0F12639gYALI0F12639g_mRNA-001YALI0F12639g_CDS-001

Nucleotide sequence

 

>YALI0F12639g
ATGTTTGCCGAGGGTCAGATCCAAAAGGTCCCGATTCTGGGCAAGGAGTCCATCCACATT
GGCTACAAGATGCAGGACCACATTGTGTCTGAAATCGTGGCCAACATCAAGTCGTCCACC
TACATTCTGGTAACCGACACCAACATTGAGGATCTGGGCTACGTTGAGTCTCTTAAGACG
AAATTCGAGGCTGCGTTTGCCAAGGACGGCATCAAGAGCCGACTGCTGACCTACACCGTT
GCGCCCGGAGAAACCTCCAAGTCCAGAGCCACCAAGGCCGCCATTGAAGACTGGATGCTG
TCCAAGGGCTGCACCCGAGATACGGTGATCCTGGCTGTGGGAGGCGGAGTGATCGGAGAC
ATGATCGGCTACGTGGCCGCCACCTTCATGCGAGGAGTGCGGTTTGTCCAGATCCCCACC
ACTCTGCTTGCCATGGTTGACTCGTCCATTGGAGGCAAGACCGCCATTGATACCCCTCTG
GGCAAGAATCTGGTCGGCGCCTTCTGGCAGCCCGTCAACATTTTCATCGACACTTCTTTC
CTCGAGACTCTGCCCGTTCGAGAGTTCATTAACGGTATGGCGGAGGTCATTAAGGTGAGT
ATAGAATCAACCGCATGCAGTGCAGATTGGCAGTTAGGTGCGATGTGTGATAGTTGCTTT
GATTCGACAGTTGGTTGGTGCTGTTTGGGTTGTTCTACAGGTCTGTGGTTGAATAATCGA
CTGGTATAATTTCCCGATCGGATCTACACTTTTACAAGTACTATCTACAGCTGCTGATCT
AATCACAATACTGTACAGCAGCACCCACTGTACTCCTCTTTTCTCTAGCTAACACAGACT
GCGGCATTCTACGACGCCGAAGAGTTCACACGGCTCGAGTCCGCGTCGGAAATCTTCCTG
TCCACTATCAAGAAGCGAGACGCCAAGGACCCCCGACGAGTCGATCTGTCCCCCATCACC
GACACCATTGGCCGAATTGTTCTCGGTTCTGCTAGAATCAAGGCCGCCGTTGTCTCTGCC
GACGAGCGAGAGGGCGGTTTGCGAAACCTGCTCAACTTTGGCCACTCCATTGGCCACGCC
TACGAGGCCATTCTCACTCCTTACATTCTGCACGGCGAGTGTGTGGCTATCGGTATGGTC
AAGGAGGCCGAGCTGTCTCGATACCTGGGAATTCTCTCTCCCGTTGCTGTGGCTCGTCTG
GCCAAGTGCATCAAGGCCTACGAGCTGCCCGTGTCTCTGGACGACGCTACAGTCAAGGCC
CGAAGCCACGGCAAGAAGTGCCCCGTTGATGATCTGCTTCGAATCATGGGCGTCGACAAG
AAGAACGACGGCTCCACTAAGAAGATTGTCATTCTGAGCGCCATTGGCAAGACCCACGAG
CAGAAGGCGTCTTCTGTGGCAGACAAGGACATTAGATTCGTTCTTTCCGAGGAGGTCATT
GTCGGAGAGGCTCCTGTTGGCGACAAAAAGTCCTACACCGTCACTCCACCTGGATCCAAG
TCCATTTCCAACCGAGCCTTTGTTCTGACTGCCCTGGGTAAGGGTCCTTGCAAGCTGCGA
AACCTGCTGCATTCGGACGACACCCAGCACATGCTCGAGGCCATTGAGCTGCTTGGTGGC
GCATCGTTCGAGTGGGAGGCCGACGGTGAGACTCTGCTTGTCACCGGAAATGGCGGCAAG
CTCACTGCTCCCGCCCAGGAGTTGTACCTAGGAAACGCCGGTACTGCTTCTCGATTCCTT
ACCACCGCTGCTACTCTGGTTCAGAAGGGAGACAAGGACCACGTGATCCTTACCGGAAAC
AAGCGAATGCAGGAGCGGCCCATTGGGCCTCTTGTGGACGCTCTTCGATCCAACGGAGCC
GACATTGCTTTCCAGAACGCCGAAGGCTCTCTCCCCCTCAAGATCGAGGCCGGTGTTGGA
CTCAAGGGTGGCTTGATTGAGGTGGCTGCTACTGTTTCTTCTCAGTATGTCTCTTCTCTA
CTTATGTGTGCCCCCTACGCACAGACACCCGTCACTCTGTCTCTGGTTGGAGGCAAGCCC
ATCTCGCAGTTCTACATTGACATGACCATTGCCATGATGGCCGACTTCGGTGTGGTTGTC
ACCAAGGACGAGACCAAGGAGCACACCTACCACATTCCTCAGGGTGTGTACACCAACCCT
GAGGAGTACGTGGTGGAGTCGGATGCTTCTTCAGCCACCTACCCTCTTGCTTACGCTGCC
ATGACTGGCCACACCGTCACTGTTCCCAACATTGGCAGCAAGTCTCTGCAGGGAGACGCC
CGATTTGCCATTGATGTTCTCAAGGCTATGGGCTGCACCGTTGAGCAGACCGCTACCTCG
ACCACTGTTACTGGTGTGCCCAACCTCAAGGCTATCGCTGTTGATATGGAGCCTATGACT
GACGCCTTCCTCACCGCCTGTGTCGTTGCCGCTGTGTCCGAGGGCACCACCGTCATCACC
GGCATTGCCAACCAGCGAGTAAAGGAGTGCAACCGAATCGAGGCCATGCGAGTGCAACTG
GCCAAGTACGGCGTCGTTTGCCGAGAGCTTGAGGACGGCATTGAGGTCGACGGAATTTCC
CGATCAGATCTCAAGACCCCCGTCTCTGTGCACTCTTACGATGACCACCGAGTTGCTATG
TCTTTCTCGCTGCTCTCTTCTATCATGGCTGCTCCCGTGGCTATTGAGGAGCGACGATGT
GTCGAAAAGACCTGGCCGGGATGGTGGGACGTGCTCTCCGGCGTGTTCAACGTTCCTCTG
GAGGGCGTAACGCTGGCCAAGACCGTTTCCAAGGCCGAGTCCGGACTTTCCAAGCCCTCC
ATCTTCATTGTGGGCATGCGAGGTGCCGGAAAGACCCATCTGGGCGCCCAGGCCGCCAAC
CATCTTGGCTACGAGTTCATTGATCTCGACCAGCTACTCGAAAAGGATCTGGATACCACC
ATTCCTCAGCTGATTGCGGACAAGGGCTGGGACCATTTCCGTGCCGAGGAGCTGCGTCTG
CTCAAGCAGTGTCTCAATGACAAGTCCGAGGGCTACGTCATTTCCTGCGGTGGCGGAGTT
GTTGAGACTCCTGCTGCTCGAGACGCTCTTCAGACCTTCAAGGGTGTTGGTGGTATTGTT
CTGCATGTCCACCGACCCGTTTCCAGAATCCTCGAGTACCTCAACAAGGACCAGTCTCGA
CCTGCATTTGTGGACGATCTGGAGGCGGTGTGGCAGCGACGAAAGGAGCTGTACCGATCT
GTCTCTTCCAATGTCTTCTTTGCTCCTCACTGCGACTCTGCCGAGGCCACTGCCAAGGTG
CAGCAGATGCTGGGCGCCTTCCTGGACCGAGTCACCGGCAAGTCCGAGTTTGTGATTCCC
CACAAGGACCAATTCACTTCCTTCCTGTCGCTAACCTTCCCCGACGTGTCTATTGCCGCA
ACCATGCTCCCCTCGCTGTCTGAGGGTTGTTCTGCTCTGGAGCTGCGAGTCGATCTGCTC
AATGAGAATGACGAGGCCATTCCCTCCGAAGAGTACGTTCTCTCTCAGTTGGCGATTCTG
CGACAGAATGTCGACCTCCCCATTCTTTACACGGTGCGAACCAAGGCTCAGGGAGGCCGT
TTCCCCGACGACAAACCTGTGGAGCTGGCCAACCTGGTCAACCTGGGTCTCAAGACCGCC
GTTGAGCTGCTGGACGTTGAGCTGACCTACCCTGCCGAGCTTGTTTCGTCCGTCGGAGCT
TCCAGAGGCTACACCAAGCTGCTGGGCTCTCACCACGACTTTCCCGGCGCTCTCAACTGG
TCTTCTCTCGAGTGGGAGAACATGTACGCCCGAGCCGAGGCTGTGCCTGTGGACGTGGTC
AAGCTCGTCGGTATGGCCAAGTCTTTCTCCGACAACTTTGCTCTGGAGAACTTCCGAGAG
GCCCACACCTCTTCTCCTCTTCTGGCTATCAACATGGGCTCCCATGGTCAGCTGTCTCGA
GTCACCAACACTCTGCTGACTCCCGTGACTCACGCTGACTTGCCTGTGGCTGCTGCTCCT
GGCCAGCTTTCCGTGGAGGAGATCAACCAGACCCGGTCGACCATCGGCATGTTCAACAAG
AACCTGTCCTTCTTCATTGTCGGCACTCCCATCGGCCACTCCAAGTCGCCCATTTTGCAC
AACACCATGTTCAAGAAGCTGGGTCTGCCCTACGAGTACTCGCGGTTCAAGACTGATGAT
GCTGCTGCCGTCAACGCTAAGGCCCGTGCTCTGCTTGCCCAGGGCAACCTTGGAGGTATC
AGTGTGACCATTCCTCTCAAGCAGGACATTATTCCTTTCCTTGACGAGGTGTCTCCCCTC
GCTCAGCAGATTGGAGCCGTCAACACCATCATTCCTGGACCTAACGGGACTCTCAAGGGC
GACAACACCGATATTCTCGGTCTGGTGAACGCTCTGACTCGGTTTGGAGCCAACTCGCTG
GACAAGAAGACTGCTCTGATTGTCGGAGCCGGTGGCACATCTCTGGCTGCCGTGCACGGA
CTGCGATCGCTCGGCTTCGCCAAGATTCTCATTGCCAACCGAACTCTGTCCAAGGCCGAG
GCCATTGCTGACAAGTTTGATAACGTGGAGGCCGTGACTTTGGACTCGTTTGTGGCCAAC
AAGTACACTCCGTCTGTGATTGTGTCTTGCGTGCCAGCCACCACTTTCTCGATGCTGGAT
GAGTCCAACAAGCTGGTGTCTGCCGCTCTGGCTGCTTCTCCCAAGGGTCTGGTTCTTGAG
GCTGCCTATTCTGCCGAGGCCACTCCTCTGCTCAAGCAGGTGATGGACGTCGAGGGCTGG
GAGTTCATCTCCGGGCTCTACATGCTCACCGAGCAGGGCTTTGAGCAGTTCCGGCTGTGG
ACCGGAATTCCCGCCCCCAAGGAGGTTGGAGAGAAGGCTGTTCTTGGTAACTAACCGAGA
CATCAAAATGATTGTATAAACTAAAATGTGTATTGACTGAACGTGTATGTACTGT

Legend

Locus sequence
Up/downstream sequence

Edit sequence


Translation(s)

YALI0F12639g_CDS-001

Protein length: 1557 aa.
Product: Pentafunctional arom protein, putative

>YALI0F12639g_CDS-001 MFAEGQIQKVPILGKESIHIGYKMQDHIVSEIVANIKSSTYILVTDTNIEDLGYVESLKT
KFEAAFAKDGIKSRLLTYTVAPGETSKSRATKAAIEDWMLSKGCTRDTVILAVGGGVIGD
MIGYVAATFMRGVRFVQIPTTLLAMVDSSIGGKTAIDTPLGKNLVGAFWQPVNIFIDTSF
LETLPVREFINGMAEVIKTAAFYDAEEFTRLESASEIFLSTIKKRDAKDPRRVDLSPITD
TIGRIVLGSARIKAAVVSADEREGGLRNLLNFGHSIGHAYEAILTPYILHGECVAIGMVK
EAELSRYLGILSPVAVARLAKCIKAYELPVSLDDATVKARSHGKKCPVDDLLRIMGVDKK
NDGSTKKIVILSAIGKTHEQKASSVADKDIRFVLSEEVIVGEAPVGDKKSYTVTPPGSKS
ISNRAFVLTALGKGPCKLRNLLHSDDTQHMLEAIELLGGASFEWEADGETLLVTGNGGKL
TAPAQELYLGNAGTASRFLTTAATLVQKGDKDHVILTGNKRMQERPIGPLVDALRSNGAD
IAFQNAEGSLPLKIEAGVGLKGGLIEVAATVSSQYVSSLLMCAPYAQTPVTLSLVGGKPI
SQFYIDMTIAMMADFGVVVTKDETKEHTYHIPQGVYTNPEEYVVESDASSATYPLAYAAM
TGHTVTVPNIGSKSLQGDARFAIDVLKAMGCTVEQTATSTTVTGVPNLKAIAVDMEPMTD
AFLTACVVAAVSEGTTVITGIANQRVKECNRIEAMRVQLAKYGVVCRELEDGIEVDGISR
SDLKTPVSVHSYDDHRVAMSFSLLSSIMAAPVAIEERRCVEKTWPGWWDVLSGVFNVPLE
GVTLAKTVSKAESGLSKPSIFIVGMRGAGKTHLGAQAANHLGYEFIDLDQLLEKDLDTTI
PQLIADKGWDHFRAEELRLLKQCLNDKSEGYVISCGGGVVETPAARDALQTFKGVGGIVL
HVHRPVSRILEYLNKDQSRPAFVDDLEAVWQRRKELYRSVSSNVFFAPHCDSAEATAKVQ
QMLGAFLDRVTGKSEFVIPHKDQFTSFLSLTFPDVSIAATMLPSLSEGCSALELRVDLLN
ENDEAIPSEEYVLSQLAILRQNVDLPILYTVRTKAQGGRFPDDKPVELANLVNLGLKTAV
ELLDVELTYPAELVSSVGASRGYTKLLGSHHDFPGALNWSSLEWENMYARAEAVPVDVVK
LVGMAKSFSDNFALENFREAHTSSPLLAINMGSHGQLSRVTNTLLTPVTHADLPVAAAPG
QLSVEEINQTRSTIGMFNKNLSFFIVGTPIGHSKSPILHNTMFKKLGLPYEYSRFKTDDA
AAVNAKARALLAQGNLGGISVTIPLKQDIIPFLDEVSPLAQQIGAVNTIIPGPNGTLKGD
NTDILGLVNALTRFGANSLDKKTALIVGAGGTSLAAVHGLRSLGFAKILIANRTLSKAEA
IADKFDNVEAVTLDSFVANKYTPSVIVSCVPATTFSMLDESNKLVSAALAASPKGLVLEA
AYSAEATPLLKQVMDVEGWEFISGLYMLTEQGFEQFRLWTGIPAPKEVGEKAVLGN*


Neighborhood

Browse the locus neighborhood with JBrowse:


References

There are no reference.

ATG