Gene GSU1957 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	GSU1957
Symbol
ID	2688286
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Geobacter sulfurreducens PCA
Kingdom	Bacteria
Replicon accession	NC_002939
Strand	-
Start bp	2146106
End bp	2147206
Gene Length	1101 bp
Protein Length	366 aa
Translation table	11
GC content	50%
IMG OID	637126648
Product	glycosyl transferase, group 1 family protein
Protein accession	NP_953006
Protein GI	39997055
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0438] Glycosyltransferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	8
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGAAAATTG CGTATGTTAT AGATTACTTG TACAGCGTAA ACGGAGGGAC TGAACGACAG 
CTCTATATGC TCATAGAGGG TATGGTGTCC CGTGGACATA CTGTTGATCT TTATGTGTTC 
AGAGATACGG AATTTACTAA AAATCTGCCG GATTTTCCCT GCCCGGTTCA TTGCTTGAAT 
GTTGAGTCGG TTCTGTCGCC AGGCGGGCTT ATTCGACTGA TTCAGTTCAG AAAGCGGATC 
ATCGCCGATA ACGTTGATGT TCTGCATGGT TTTTTCAATG ATGTTGCCCT GTCATTACCG 
CCGTTGATGC TGGGTTCAAA CGTAAAGACT TTCACCTCGC GAAGAGACAT GGGGATATGG 
TATTCCCCGG CCAAGTTGCT GTTTTTAAGA CTTTTCAGGT TTTCAAGCAT CCGGTTGATC 
TGCAATAGCA TTGCGGTGGC GAAGTTTACG TTCGAGCAGG AATGGAAGGC CAAGGAGTCG 
ATACGGGTGA TATACAACGG CATGAATCGC TTCAATGTCG ACCCTTCGTC CTGCTCCTGT 
GACTGGGCTC CGGAGAAAGG AAAGAACATC AACATCATCC TCGTCGCCAA CGTGCGGCCC 
GTCAAGCGTG TAGAAGATCT CATCAGGGCG GCGAGCCTGA TCGTCGAGCA TGGCTACCAT 
CCTCAGTACT ATGTCGTCGG GCATCTGCAG AGTGACGGTT ACACAGACTC TCTCCGAGAG 
TTGCTGAAAC GGCATCACCT TGAAGCGGAT TTCCATTTTA CCGGTCCCGT ATCTGAGCCA 
CGGGGAGCTT TGGAAAGATT TGATATCGGG GTGCTGACCT CAGCCTCTGA GGGGTTCTCC 
AATACACTGA TGGAATATCT CGACGCCGGC TTGCCGGTCG TAGCTTCAAA GGTCGGAGGC 
AATCCGGAAT TGGTGGACGA CGGAGAGACC GGTTTTCTGT ACGAAGCCGG AGATGTGAAT 
GCCCTGGCCG ACTGCATTCT CAAGCTTATT GCAGATGACC GGACGAGGAA CCTGTTTGCC 
GCCAATGCGA AACAGATGAT AACCCGCTTT GACCGGGCAA CGATGATTGA GTCCCACGAA 
AAGGAATATC TGCGTGCTTA G

Protein sequence

MKIAYVIDYL YSVNGGTERQ LYMLIEGMVS RGHTVDLYVF RDTEFTKNLP DFPCPVHCLN 
VESVLSPGGL IRLIQFRKRI IADNVDVLHG FFNDVALSLP PLMLGSNVKT FTSRRDMGIW 
YSPAKLLFLR LFRFSSIRLI CNSIAVAKFT FEQEWKAKES IRVIYNGMNR FNVDPSSCSC 
DWAPEKGKNI NIILVANVRP VKRVEDLIRA ASLIVEHGYH PQYYVVGHLQ SDGYTDSLRE 
LLKRHHLEAD FHFTGPVSEP RGALERFDIG VLTSASEGFS NTLMEYLDAG LPVVASKVGG 
NPELVDDGET GFLYEAGDVN ALADCILKLI ADDRTRNLFA ANAKQMITRF DRATMIESHE 
KEYLRA