Gene TM1040_0722 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	TM1040_0722
Symbol
ID	4076999
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Ruegeria sp. TM1040
Kingdom	Bacteria
Replicon accession	NC_008044
Strand	-
Start bp	779020
End bp	780093
Gene Length	1074 bp
Protein Length	357 aa
Translation table	11
GC content	61%
IMG OID	638006019
Product	glycosyl transferase, group 1
Protein accession	YP_612717
Protein GI	99080563
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0438] Glycosyltransferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	17
Plasmid unclonability p-value	0.261837
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	20
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAGCCAGA TCGACCTCAA CCAGATCGAC GTGATCGCGC CGAACTTTAA GAAACGCTAT 
TCTGGTGTGA CTTCTACCGT GATCCGGCTC GTGCCCATCC AGGCACGCGA GATCGCCATC 
TGCGCCGCTG CACCGGACTT GCCCGCCGAG GTGCCACAGG TCAAACCCGG CGCGCTCTGG 
ACCATGGCGC GCAAGGGGCC ATCCGGGGCG CGGGTCTGGC ACGCCCGACG CAACAATGAA 
ATGGTGGCTG GGCTTTTGCT CAAATACCTT TTGGGGAAGC GGCTGAAACT CCTGTTCACC 
TCGGCTGCGC AACGCCGACA CACGGGGTTT ACCCGCTGGC TGATCCGGCG CATGGACGCG 
GTGATTGCCA CCTCTTCGAG GTCTGCAAGT TATCTGGAAC GCAATGCAAC CGTCATCCGT 
CACGGTATCG ACTGCGACCT GTTCCAACCG GTCGCGGATC GCGCCGCCTT GCGACGCGCG 
CTTGATCTTC CCGAGGATGG GCTGCTGGTC GGTTGTTTTG GGCGTATCCG CCCGCAAAAA 
GGCAATGATC TTTTTGTCAA AGCGATGATC GCTGCCTGCC GCGCCAATCC AGAGGTGCGT 
GGCCTGATGA TGGGGCGGGC GACAGCGGAC AACGCAGAGT TCCTGCAGGG CCTCAAGGAT 
GAGGTGGCTG CGGCGAGCCT CTCGGATCGC ATCCTGTTCC GCGATGAGGT GGCTGTCGAA 
GATGTGCCGC GCCATTTCCA GGCGCTTGAT CTCTATGTTG CACCACAACG CTGGGAAGGC 
TTTGGGCTCA CACCGCTTGA GGCAATGTCC TGCGGCGTGC CCGCAGTTGC CACCCGCGTC 
GGGGCTTTTG AAGAGTTGGT CATTCCGGGC GAGACCGGCA CGCTCTGCGA CATAGAGGAT 
GTCGACAAGA TCACGGCTGA TGTCATTGCT CTGCTCTCGG ATCGAGACCG GTTGAATGAG 
ATGGCCACAG CGGCACGTGA GCATGTGGCC GGGACTTTCC GCCTCGAAGG CGAGGCAGCT 
GCCATCATCG CGATCTATCG CAAGCTGCTC GGCCAAAACG GCGCGGGCGC CTAA

Protein sequence

MSQIDLNQID VIAPNFKKRY SGVTSTVIRL VPIQAREIAI CAAAPDLPAE VPQVKPGALW 
TMARKGPSGA RVWHARRNNE MVAGLLLKYL LGKRLKLLFT SAAQRRHTGF TRWLIRRMDA 
VIATSSRSAS YLERNATVIR HGIDCDLFQP VADRAALRRA LDLPEDGLLV GCFGRIRPQK 
GNDLFVKAMI AACRANPEVR GLMMGRATAD NAEFLQGLKD EVAAASLSDR ILFRDEVAVE 
DVPRHFQALD LYVAPQRWEG FGLTPLEAMS CGVPAVATRV GAFEELVIPG ETGTLCDIED 
VDKITADVIA LLSDRDRLNE MATAAREHVA GTFRLEGEAA AIIAIYRKLL GQNGAGA