Gene GSU1083 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	GSU1083
Symbol
ID	2688626
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Geobacter sulfurreducens PCA
Kingdom	Bacteria
Replicon accession	NC_002939
Strand	+
Start bp	1168841
End bp	1169917
Gene Length	1077 bp
Protein Length	358 aa
Translation table	11
GC content	65%
IMG OID	637125752
Product	hypothetical protein
Protein accession	NP_952136
Protein GI	39996185
COG category	[S] Function unknown
COG ID	[COG4260] Putative virion core protein (lumpy skin disease virus)
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	8
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGCGAACGG AGGGCCCCGT GGCGATCAAC AGCATGAATA CGGTATTTCT TGAGGTAGTC 
GAGTGGTTTG ACGACAGCGG CCGGGAGATG GTGCGCCGCA TCCCCCCCGA GGGGTCCGCC 
GAGATCAAAT TGGGCGCCCA GCTGGTGGTG CGGGAGAGTC AGCGGGCGGT CTTCTTCAGG 
GACGGCAAGG CCGCCGACTG CTTTGGCCCC GGTAGGCATA CCCTGACCAG CGCCAACCTG 
CCGATCCTGA CTAAGCTCCT GTCGCTCCCC TGGGGAGGCA CCTCTCCCTT CCGCTGCGAA 
GTCTGTTTCG TGGGAATACA GACCTTCACC GACCTGCGCT GGGGAACCAA GGAACCCGTT 
GCCTTCCGGG ACAGCCGCTT TGGCATGGTA CGGCTGCGGG CCTTCGGCAC CTACACCCTG 
CGGGTGGTCG ACCCGCAGCT CCTGGTGAAC GCTCTGGTGG GAACCCGGGG GCTTTACACC 
AGCAGCGAGC TGGAGGAACT GTTCCGCGAC ATCATCGTGG CGCGGCTCAA CGACTACCTG 
GGCGAAACCA TCGACTCGGT TCTGGATCTG CCCGCCCGCT ACGATGAGAC TTCTGCTGCG 
CTCAAGGAAC GCCTGGCAGG AGACTTCGGA GGATTCGGCA TCGAACTGGC CGAACTTTAC 
GTGAACGCGA TCACTCCCCC GCCGGAGGTC CAGAAGGCAA TCGACGAGCG CACCTCCATG 
GAGGCGGCCG GCGATGTGGA TCGCTACCTG AAGTTCAAGG CGGCCCGAAG CCTGGAAGCG 
GCGGCCTCGG CCGAGGGGGG CGGCGAGGCT GCCCAGGGGA TGGGGATCGG GGTCGGTGCC 
GGTCTCGGCA TGATTCTCCC CGGTATGGTG GCGAATGCCA TGGCACAGGG AGCTGATGCG 
TCCGCTCCTG TCGGCACGGG TAGCTGTCCC CGCTGTATGG CGCCGTTGGT GGCGGGTGGA 
AATTTTTGCC ATCAGTGCGG CGCCCCGGTA GAGTCCGGCT TTTGCTCCGG CTGCGGCAAG 
CCGCTGCCGA CAGAAGCTCG CTTCTGCCCC GGCTGCGGAC GGCAGGCCGG AGCATAG

Protein sequence

MRTEGPVAIN SMNTVFLEVV EWFDDSGREM VRRIPPEGSA EIKLGAQLVV RESQRAVFFR 
DGKAADCFGP GRHTLTSANL PILTKLLSLP WGGTSPFRCE VCFVGIQTFT DLRWGTKEPV 
AFRDSRFGMV RLRAFGTYTL RVVDPQLLVN ALVGTRGLYT SSELEELFRD IIVARLNDYL 
GETIDSVLDL PARYDETSAA LKERLAGDFG GFGIELAELY VNAITPPPEV QKAIDERTSM 
EAAGDVDRYL KFKAARSLEA AASAEGGGEA AQGMGIGVGA GLGMILPGMV ANAMAQGADA 
SAPVGTGSCP RCMAPLVAGG NFCHQCGAPV ESGFCSGCGK PLPTEARFCP GCGRQAGA