Gene Sare_2749 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Sare_2749
Symbol
ID	5708351
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Salinispora arenicola CNS-205
Kingdom	Bacteria
Replicon accession	NC_009953
Strand	-
Start bp	3130789
End bp	3131823
Gene Length	1035 bp
Protein Length	344 aa
Translation table	11
GC content	76%
IMG OID	641272205
Product	glycosyl transferase group 1
Protein accession	YP_001537575
Protein GI	159038322
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0438] Glycosyltransferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	17
Plasmid unclonability p-value	0.611394
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	6
Fosmid unclonability p-value	0.00344637
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

GTGACCCGTA CCCTGCACGC GGTGCTGCCG GGAGACGTCG ACGATCCGGA CAGTCCAAGC 
GGCGGCAACC GGTATGACCG ACGGGTGCTC GACGGCCTGT CCGCCGCCGG CTGGTCGGTC 
CACGAGCACC CCGTTGCCGG GGACTGGCCG CACCCGGCGC CCGCGAACCG TGCCGCGCTC 
GCCGGCATGC TCGGCGCGCT GCCCTCCGGG TCGCTTGTCC TGCTCGACGG GCTCGTCGCC 
GGCGCGGTAC CGGAGATCCT GGCCCCGAAC GCCGGGCGGC TACGCCTGGT GGTGCTCGTG 
CACCTGCCGC TGGGCGGCGG TGCGGAACGT GCGGCCCTGC GCCACGCGAC AGTGGTCGTG 
GCCACCAGTA CGTGGACCCG TCGGTGGCTG CTCGACCGGT ACCGGCTGCC CGCCGACCGG 
GTGCGGGTCG CGGTACCCGG GGTCGACCGT GCCGCCGCCG TGCCCGGTTC TCCGGCGGGT 
GGGCGACTGC TCTGCGTGGC CGCGGTCACC CCACACAAGG GACACGACAC ACTCGTCGCC 
GCCCTCGCGG CGGTCGGTGA GCTGGACTGG CGCTGCGACT GCCTCGGGCC GCTCGGCCGG 
GATCCCGGCT TCGTCGAGCG GCTGCGGCGG CACATCGCCG CACTCGGACT CGCCCAGCGG 
GTGCGCCTCG TCGGACCGCG CACCGGTCCT GCCCTGGCCG CCGGATACGC CACCGCCGAC 
CTGCTGGTGC TGGCCTCACG CGTCGAGACG TACGGGATGG TGGTGACGGA GGCTCTCGCC 
CGGGGCGTCC CGGTGCTGAC CACCACCGCA GGTGGGTTAC CGGCCACCCT CGGTCGCGCC 
CCGGACGGCG CCGCGCCGGG ACTGCTGGTG CCCCCGGATG ACCCGGCGGC CCTCGCCGGA 
GCGCTACGCC GCTGGCTCAC CGACCCGACC CTGCGGAACC GGCTGCGTCG CGCCGCGCGC 
GACCGCCGGG AGACCCTCAC CGACTGGACC ACCACCACCA TGTCGCTCGC GGCGGCGCTG 
GAAGGAACGG AGTGA

Protein sequence

MTRTLHAVLP GDVDDPDSPS GGNRYDRRVL DGLSAAGWSV HEHPVAGDWP HPAPANRAAL 
AGMLGALPSG SLVLLDGLVA GAVPEILAPN AGRLRLVVLV HLPLGGGAER AALRHATVVV 
ATSTWTRRWL LDRYRLPADR VRVAVPGVDR AAAVPGSPAG GRLLCVAAVT PHKGHDTLVA 
ALAAVGELDW RCDCLGPLGR DPGFVERLRR HIAALGLAQR VRLVGPRTGP ALAAGYATAD 
LLVLASRVET YGMVVTEALA RGVPVLTTTA GGLPATLGRA PDGAAPGLLV PPDDPAALAG 
ALRRWLTDPT LRNRLRRAAR DRRETLTDWT TTTMSLAAAL EGTE