Gene Mlg_2402 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Mlg_2402
Symbol
ID	4269989
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Alkalilimnicola ehrlichii MLHE-1
Kingdom	Bacteria
Replicon accession	NC_008340
Strand	-
Start bp	2730272
End bp	2731258
Gene Length	987 bp
Protein Length	328 aa
Translation table	11
GC content	73%
IMG OID	638127160
Product	general secretion pathway protein C
Protein accession	YP_743232
Protein GI	114321549
COG category	[U] Intracellular trafficking, secretion, and vesicular transport
COG ID	[COG3031] Type II secretory pathway, component PulC
TIGRFAM ID	[TIGR01713] general secretion pathway protein C

Plasmid Coverage information

Num covering plasmid clones	12
Plasmid unclonability p-value	0.237406
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	22
Fosmid unclonability p-value	0.00100026
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGGCGGCCG AATCAGGATA CAGAGGGCTG GGTATTGCCG GGGTCGAGCG GTTGGGCGCC 
TTTGCCGGCG GCCTGCTGAC CGGGCGTGGC GGGCACTGGC TGCGCTGGCT GCTGGCGGTG 
CTGCTGGTGA TTCTGCTGGC GCAGGGGGGT GCCCGCCTGA CCTGGTGGCT GCTCGGTTAC 
GGCCCGGCCC AGGAGGTGCC TGCCGCGGCG TGGTCCGGGC CGGAGGAGCC TGCCGCGCCT 
GGCGGCGATG AGGCCGATGC CGGCGAGACG CGCCTGGCGG CGGTGGCCCG CCTGCACCTG 
TTGGGGCAGG CCGAGGACGA CGACGAGCTG GACGCCGTCC TGGCCACCGA GGAACTCCCG 
GAGACCCGGC TCAACCTGGA GCTGAAAGGG GTGCTGGCCC GTGGCGGCCA GGGCCAGGGC 
GCGGCGCTGA TCGCCAGCCG GGGCCGCACT GAGGTCTTCC GGGTATCGGA CGAGGTGCCG 
GGTGGCGCCA CCCTGGTCCA GGTCCACACC GACCGGGTGG TGCTGCGCCG TGACGGCCGC 
CACGAGCTGC TGCGCCTGCC CCGGAAAGTG GCCGAACTGC TCGCGAGCGC CGACTTCGAT 
GTGCCCGGGA CCCAGGCCGG GCGTGGGTCG GATGCCGCCC GGGTGCTCCC GGCGGCCGCG 
CGGGGCGATG TGGACCGCGA GGCCCTGTCC GACCTGCGCG GTGAACTCAC GCGCAACCCG 
GAACGGCTGT GGGATATCGT CAACGTCCGG CCGGTGATGG AGGGCGGACG ACTGCAGGGC 
TACCGGCTGC AGCCCGTCCA GCACCAGGCG CTGTTCCGTC AGGCCGGACT GCGGGATGAT 
GACGTGGTGA CGGCGGTCAA CGGCGTGGGT CTGGATAACC CGGCGCGGAT GGGGGAACTC 
ATGGGCAGCC TGGCGACCGC CGACCGGATA ACCCTGGATG TCCGCCGGGA CGGGCGGATG 
GAAACCGTGA TAGTGGAGCT GCAATGA

Protein sequence

MAAESGYRGL GIAGVERLGA FAGGLLTGRG GHWLRWLLAV LLVILLAQGG ARLTWWLLGY 
GPAQEVPAAA WSGPEEPAAP GGDEADAGET RLAAVARLHL LGQAEDDDEL DAVLATEELP 
ETRLNLELKG VLARGGQGQG AALIASRGRT EVFRVSDEVP GGATLVQVHT DRVVLRRDGR 
HELLRLPRKV AELLASADFD VPGTQAGRGS DAARVLPAAA RGDVDREALS DLRGELTRNP 
ERLWDIVNVR PVMEGGRLQG YRLQPVQHQA LFRQAGLRDD DVVTAVNGVG LDNPARMGEL 
MGSLATADRI TLDVRRDGRM ETVIVELQ