Gene Dtox_4143 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Dtox_4143
Symbol
ID	8431157
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Desulfotomaculum acetoxidans DSM 771
Kingdom	Bacteria
Replicon accession	NC_013216
Strand	-
Start bp	4314153
End bp	4315190
Gene Length	1038 bp
Protein Length	345 aa
Translation table	11
GC content	38%
IMG OID	645036336
Product	glycosyl transferase family 2
Protein accession	YP_003193434
Protein GI	258517212
COG category	[R] General function prediction only
COG ID	[COG1216] Predicted glycosyltransferases
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	43
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	4
Fosmid unclonability p-value	0.00000205364
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGTTAAGAA AAGATATCAT AAATCCAAAT GTTAGCTTAA TAATTGTAAC GTATAACGCA 
GAAAAATTTA TTGCAGATTG TTTGCTTTCA GTCAATAAGC AAAATTATAC TTGTTTTGAA 
ACTATCGTAG TGGATAATGC CTCAAATGAT AACACTGTTA ACCTGATAAA AACCGGTTTT 
AGTTGGGCTA GGCTAGTTGA GTCCCAACAA AATTTAGGTT TTACAGGTGG GGTTCATCTT 
GGCTATTCTA TTGCGAAAGG AAAATATATA GCGCTGCTTA ACCCGGATAC TAGAGCGGAT 
AAAGAATGGC TGGGCAACCT TTTAACAGTT ATGGAACGTG ATGATGAATG TGGTATTTGC 
GCTTCCCTAA TGCTGAAGTG GGGAACTCAA CTGATAGATA CCGCCGGTGA CGGCTGTACC 
AGGGCAGGCA AGGGTTTTAA AATAGGGAAT GATCAACCGG CAAAATTTTA TCAGGAAACC 
AGGGAGGTTT TCGCCGCTTG TGGAGGAGCT GTTTTGTACA GGCGGAAAAT GATTGAGGAG 
ATAGGATTTT TTGATAATAG CTTTTTTCTG CTGCATGAGG ATACCGATTT GTGTTTTCGG 
GCCAGGCTTG CCGGGTGGAA ATGCATGTAT GTTCATAATG CTATGGTAGA GCATAAAGTT 
AGCTCCTCAA TAGGCTATAA AACACCTTTG GCCGTATATC ATTCAGTCAA AAATTCGGAT 
ATGGTTTGGC TAAAGAATAT GCCCGGTCAT TTTTTATTTC TTACGATTCC GGAGAAAGTA 
ATAAGCGATC TGGCTTCTCT TATTTATCTG GGAATAATTC ACCACAGGCT TAAAGACTAT 
TTAAAAGCTA AATGGTATAT TGTTAGAAAT TTAAAAAATA TTATCACTGC GCGAAGTGAA 
ATGCAAAAGA AGATAAACAA ACATGGAAAA CTGGTATTTC AACAGCTCAC GCCCTTTTTA 
TCAAATAAGT TTATAATATC CCTATGGAAG AGCAAGTATA AAGAACTGAG ATATTTTCTT 
AATCTTCCCA GGGGGTGA

Protein sequence

MLRKDIINPN VSLIIVTYNA EKFIADCLLS VNKQNYTCFE TIVVDNASND NTVNLIKTGF 
SWARLVESQQ NLGFTGGVHL GYSIAKGKYI ALLNPDTRAD KEWLGNLLTV MERDDECGIC 
ASLMLKWGTQ LIDTAGDGCT RAGKGFKIGN DQPAKFYQET REVFAACGGA VLYRRKMIEE 
IGFFDNSFFL LHEDTDLCFR ARLAGWKCMY VHNAMVEHKV SSSIGYKTPL AVYHSVKNSD 
MVWLKNMPGH FLFLTIPEKV ISDLASLIYL GIIHHRLKDY LKAKWYIVRN LKNIITARSE 
MQKKINKHGK LVFQQLTPFL SNKFIISLWK SKYKELRYFL NLPRG