Gene NATL1_08201 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	NATL1_08201
Symbol
ID	4779987
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Prochlorococcus marinus str. NATL1A
Kingdom	Bacteria
Replicon accession	NC_008819
Strand	-
Start bp	754079
End bp	755146
Gene Length	1068 bp
Protein Length	355 aa
Translation table	11
GC content	42%
IMG OID	640084095
Product	fructose-1,6-bisphosphate aldolase
Protein accession	YP_001014643
Protein GI	124025527
COG category	[G] Carbohydrate transport and metabolism
COG ID	[COG3588] Fructose-1,6-bisphosphate aldolase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	13
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	17
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGGCACTCT CGTACTACGC AGAAGAACTA AAGAAGACCG CAAGTGCCAT AGCCCAGCCA 
GGCAAAGGGA TTCTTGCTGT TGACGAGTCA ACGAAAACAG TAGGTAAAAG GCTTGCTTCA 
ATAGGTGTTG AGAACACTGA GGACAACAGA AAAGCATATA GAGGTATGCT TTTCACCACA 
GAAGGTCTTG GAAACTTCAT AAGCGGAGCG ATTCTTTTTG AAGAAACTCT TTTCCAGAAC 
CATCCAGATG GTGAGCCAAT GGTTAAAAAG CTTGAGAAGC TAGGCATAAT TCCAGGAATC 
AAAGTTGACA AAGGTCTAAG ACCATTAGCC GGTGGACATG ATGTAGAAAC TTTTTGTTCA 
GGTTTAGACG GTCTTGTTGA AAGAGCTGCT GATTATTACG AGCAAGGTGC AAGATTTGCC 
AAGTGGAGAG CAGTACTTCA AATAACAGAC GATGGTTGTC CTTCTAAACT TTCTATTAGA 
GAAAATGCTT GGGGTTTAGC AAGATACGCT AGATCAGTTC AAGAATCTGG CTTGGTTCCA 
ATTATTGAAC CAGAAATCTT AATGGATGGT TCACATTCAA TTGAAAAGAC AGCAGCAGTT 
CAAGAAGAAG TAATTAAAGA AGTTTACTTA GCTTGCCAGG TAAATGGAGT ACTTCTAGAG 
GGAACTCTTC TGAAGCCATC AATGACTGTT CAAGGTGCTG ACAGCTCAAC AAAAGCTGAT 
CCTCAGCAAG TAGCTGAAAT GACAATCCGT ACAATGGAAC GCTGTGTACC TGCAAGTGTC 
CCTGGTATTA CTTTCCTTTC AGGTGGATTG AGCGAGGAAG CTGCATCAGT TTATCTAAAT 
CTGATGAATA AGATCGACAG AAAGGCTAAG TGGAATGTTT CATTCTCATA TGGTCGTGCT 
TTACAACATT CATGTCTAAA AGCATGGAAA GGCTCGAACA CTTCTGATGG ACAAAAAGCA 
CTCATAGCTA GAGCTCAGGC AAACTCTGAG GCATCAAAAG GATTGTATGT TGCTGGTTCT 
CAGCCTTCTT CTGATGAGCA ATTATTTGTA GCTGGATACA AGTACTAA

Protein sequence

MALSYYAEEL KKTASAIAQP GKGILAVDES TKTVGKRLAS IGVENTEDNR KAYRGMLFTT 
EGLGNFISGA ILFEETLFQN HPDGEPMVKK LEKLGIIPGI KVDKGLRPLA GGHDVETFCS 
GLDGLVERAA DYYEQGARFA KWRAVLQITD DGCPSKLSIR ENAWGLARYA RSVQESGLVP 
IIEPEILMDG SHSIEKTAAV QEEVIKEVYL ACQVNGVLLE GTLLKPSMTV QGADSSTKAD 
PQQVAEMTIR TMERCVPASV PGITFLSGGL SEEAASVYLN LMNKIDRKAK WNVSFSYGRA 
LQHSCLKAWK GSNTSDGQKA LIARAQANSE ASKGLYVAGS QPSSDEQLFV AGYKY