Gene Slin_4368 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Slin_4368
Symbol
ID	8728128
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Spirosoma linguale DSM 74
Kingdom	Bacteria
Replicon accession	NC_013730
Strand	+
Start bp	5296947
End bp	5298209
Gene Length	1263 bp
Protein Length	420 aa
Translation table	11
GC content	55%
IMG OID
Product	glycosyl transferase group 1
Protein accession	YP_003389148
Protein GI	284039218
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	11
Plasmid unclonability p-value	0.0158935
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	29
Fosmid unclonability p-value	0.395097
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAAAAAAG TACTTATCTC TGCCTACTCC TGCATTCCCG ACCGAGGGTC GGAGGAGGGG 
AACGGCTGGT TCTACTCCTC GCTGGTCAGC CAGCAGGGGT ATCAGGTCTG GTGCCTGACC 
AGAGACATTG GCAAAGCCGA AATCGAACAA AAACTACGAC AGTGCGACTA CCCTAACCTG 
CATTTTGAAT TCGTCACGCT GCCCCGCTGG GCCAACAAAG CCGGTTCCTT AGGTTTGCTG 
GGCATGTATT TTCATTACCT CTACTGGCAA TGGACCGCCT TGCAGTCAGC CCGAAAACTA 
GCTAGGACGC ACCAGTTCGA CTTGGTGCAC CATGTGAGTT ATACCAGTCT GCAACTCGGC 
AGCTACCTCT ATAAACTCGG CCTGCCCTTT ATCTACGGGC CGGTTGGTGG TGGTCAGGAG 
GCCCCTGCCA ATATGCGCCA CTATTTCAAA TCATACTGGC TGAAAGAAAA GATGCGGTCG 
TGGGTAAGCG ACCTTATGCT TCATTTCAAT CCCGGCTGTT ACCAGTCGGT TCGCCGGGCC 
GACTACGTGC TGGCCTGGAA CGAAGACACC CGCCGGATGA TTGCCTCGAT GGGCCGAACC 
CAGGGTGTTG AGAAAGAATT CGGTGGTGTT GGAGCCAGCT TCATCCCCTC GAAACCCATC 
CACCGCCCGG CTCATGATTC TCTGGAACTG GTTTGGGTTG GGCGGCTGAT GCCCCGTAAA 
GCACTTGAGC TTTCCCTGCA CGGCATGAGC AAAGTGGACC CTCGGCTGCC CATTCATCTA 
ACCATTGTCG GCGATGGCGA AATGGGGCAG TATGTCCCTG AATACATGGC GAAATACAAC 
CTCGACAAAC GGGTTACGTG GGTTGGTAAA GTCAATTATG AGCAGGTGAA GGAATACTAC 
CGCAAGGCCG ATGCCTTTCT GTTTACAAGC CTGCGCGACA CTGGCCCCGC TCAGTTAATG 
GAGGCCATGG GTTACTCATT ACCGGTGGTG ACGCTGAATT TACACGGCCA GGCCGAACTG 
GTGGACGATT CGACGGGTAT CCGGGTGCCC GTTACAACCC CCGAAGCCGT GGCGCAGGGG 
TTGGCCGAAG CAATTACCTG GATGTATGAC AATGAACAGA AGCGGATTGA TATGGGCTTC 
AATGCCTTTC AGTTTGCCCA ACGACAACGG TGGGAGCTGA AAGTAGCCCA CGTTGTTCAC 
CGATACTATA CCGCCCTGAT AGGCCAGGCC GCCAGCGTGG CAATGGCCTT GAATCAGGAG 
TAA

Protein sequence

MKKVLISAYS CIPDRGSEEG NGWFYSSLVS QQGYQVWCLT RDIGKAEIEQ KLRQCDYPNL 
HFEFVTLPRW ANKAGSLGLL GMYFHYLYWQ WTALQSARKL ARTHQFDLVH HVSYTSLQLG 
SYLYKLGLPF IYGPVGGGQE APANMRHYFK SYWLKEKMRS WVSDLMLHFN PGCYQSVRRA 
DYVLAWNEDT RRMIASMGRT QGVEKEFGGV GASFIPSKPI HRPAHDSLEL VWVGRLMPRK 
ALELSLHGMS KVDPRLPIHL TIVGDGEMGQ YVPEYMAKYN LDKRVTWVGK VNYEQVKEYY 
RKADAFLFTS LRDTGPAQLM EAMGYSLPVV TLNLHGQAEL VDDSTGIRVP VTTPEAVAQG 
LAEAITWMYD NEQKRIDMGF NAFQFAQRQR WELKVAHVVH RYYTALIGQA ASVAMALNQE