Gene NATL1_15241 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	NATL1_15241
Symbol	guaB
ID	4780696
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Prochlorococcus marinus str. NATL1A
Kingdom	Bacteria
Replicon accession	NC_008819
Strand	+
Start bp	1241379
End bp	1242542
Gene Length	1164 bp
Protein Length	387 aa
Translation table	11
GC content	41%
IMG OID	640084806
Product	inosine 5-monophosphate dehydrogenase
Protein accession	YP_001015346
Protein GI	124026230
COG category	[F] Nucleotide transport and metabolism
COG ID	[COG0516] IMP dehydrogenase/GMP reductase
TIGRFAM ID	[TIGR01304] IMP dehydrogenase family protein

Plasmid Coverage information

Num covering plasmid clones	16
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	21
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGAATATTC AACTAGGACG CACCAAAATT GTTCGAAGAG CCTACGGGAT TGATGAGATT 
GCATTAGTTC CTGGAAGAAG AACAGTTGAC CCTGGCATCA CAAAAACCAA TTGGGAAATC 
GGTGGAATTG AAAGGGATAT TCCCATAATC GCAAGCGCGA TGGATGGTGT TGTAGATGTA 
AACATGGCCG TAGCCTTGTC AAAATTAGGA GCCCTAGGTG TTTTAAATCT AGAAGGAGTA 
CAAACTAGAT ATGAAGATCC CAAAGAAGTT CTAACGAAAA TCCAATCGAT CGGGAAAGAG 
GAATTTGTTC CCCTAATGCA AGAAATCTAT AATAAGCCGA TCAAAGAAAA GTTAATTTTA 
AAAAGAATTC AAGAAATCAA AGATAGTGGG GGTATTGCTG CTGTAAGCGG GACACCATTA 
GCAGCAATTA AATATAAAAA TCTAGTCAAA GACTCAGGTG CAGACTTATT TTTCCTTCAG 
GCGACTGTAG TTTCAACAGA ACATCTGGGT AAAGAGGGTA GTCAAAATCT TGATCTTTAT 
GATCTTTGCG AAAACATTGG CATACCGGTT GCTGTGGGTA ATTGCGTTAC TTATGAAGTG 
TCTTTAAAGC TTATGAAAGC AGGCGCTGCC GCAGTGATGG TTGGTATTGG ACCTGGAGCC 
GCATGCACCT CCAGAGGAGT ATTAGGGGTT GGAATTCCTC AAGCAACTGC TATTTCTGAT 
TGCGCTGCTG CAAGGGATGA TTTTCAAAAA GAAAGTGGGA AATATGTCCC AATTATTGCT 
GATGGAGGAA TTATCACTGG TGGGGATATT TGCAAATGCA TAGCATGTGG TGCTGATTCA 
GTGATGATTG GTTCCCCTAT CGCAAGATCT CAGGAGGCTC CAGGTAAAGG TTTCCATTGG 
GGTATGGCAA CACCAAGTCC TGTTCTACCA AGAGGTACAA GGATTCAAGT TGGAACAACC 
GGTAGTTTAA AAAGTATTCT TTGTGGACCA GCAATTCTTG ATGATGGAAC CCACAATTTA 
TTAGGAGCAA TAAAAACCTC AATGGGAACT CTAGGCGCAA CTAATATCAA GGAAATGCAA 
AATGTTGAGG TAGTTATCGC ACCTTCTTTG TTAACAGAAG GAAAGGTTTA CCAAAAAGCG 
CAACAGCTTG GAATGGGAAA GTAA

Protein sequence

MNIQLGRTKI VRRAYGIDEI ALVPGRRTVD PGITKTNWEI GGIERDIPII ASAMDGVVDV 
NMAVALSKLG ALGVLNLEGV QTRYEDPKEV LTKIQSIGKE EFVPLMQEIY NKPIKEKLIL 
KRIQEIKDSG GIAAVSGTPL AAIKYKNLVK DSGADLFFLQ ATVVSTEHLG KEGSQNLDLY 
DLCENIGIPV AVGNCVTYEV SLKLMKAGAA AVMVGIGPGA ACTSRGVLGV GIPQATAISD 
CAAARDDFQK ESGKYVPIIA DGGIITGGDI CKCIACGADS VMIGSPIARS QEAPGKGFHW 
GMATPSPVLP RGTRIQVGTT GSLKSILCGP AILDDGTHNL LGAIKTSMGT LGATNIKEMQ 
NVEVVIAPSL LTEGKVYQKA QQLGMGK