Gene Sfum_0074 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Sfum_0074
Symbol
ID	4461164
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Syntrophobacter fumaroxidans MPOB
Kingdom	Bacteria
Replicon accession	NC_008554
Strand	-
Start bp	90604
End bp	92307
Gene Length	1704 bp
Protein Length	567 aa
Translation table	11
GC content	57%
IMG OID	639700826
Product	TPR repeat-containing protein
Protein accession	YP_844212
Protein GI	116747525
COG category	[G] Carbohydrate transport and metabolism
COG ID	[COG2956] Predicted N-acetylglucosaminyl transferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	12
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	3
Fosmid unclonability p-value	0.00635622
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGATTCTGC GATACCTTCT CATCATTGCA GTGCTTTCCG TGTGCAGTTG CACCCAGCTT 
AAACCGTACG CGGCGACATC TTCCACCCCC AAAGCCCCGG CAGCCCGCTC CGAGTCGGGC 
TCACGCGCCG ACTTGTACTT CGAGTACCTG CTCGCCCAAT ATTATGTCAG CGTGAAAGAA 
ATCGACAAGG CCATTGAAGC ATACCACGAA GCCCTGAAAA AGGATCCCCG ATCGCCGATG 
CTGCTCACCG AGTTGGCCGC TCTCTTGATC CGGCAGGGCA AGATCGAACA GGCCCTCAAG 
CTCACCGAAG ACGCCACGAG CTTTGACCGC ACCTACGAGC CCGCCTACAT GCTCCTCGGA 
CAGCTGTATG CCGGAATCGG GCAGAATGCC AGGGCCATCG ATGCATATAG CCGGGCCATC 
GAGATCAATC CTTCCAACGA GGATGCGCAC CTCCTTCTGG GCGCGCTCTA CGCCCAGGAG 
AAGAAATACG ATGAGGCGAT GGAGGCATTC GACCACCTCA AGGCCCTGCT CCCGGACAAC 
CCTGTGGCAC TGTACTACAA GGCACGGGTT TTCCTGGACA TGAAACTTTA CAAACAGGCC 
GAAAAGATCT ACCTCGACGT TCTTGCGATC GAACCCGCAT TTGAAAACGC CTCTCTCGAC 
CTGGCATACG TTTACGAGGT GACCGAACGG CTGAAGGACG CCGAGCAGAC CTATCTGCAG 
ATCCTGTCGG CGAATCCGGC CAATGTAAAC GCCCGCACGC GGCTGGGCAA CCTTTACATG 
CGCCAGGACA GGCCCGCGGA GGCCTTACGG CATTTCTCCC ATCTTCTGAA GCTCAACCGC 
AAGGATGTCG AGAGCCGTTT GAAAGTGGGC ATCATCCACC TTCAACAGAA GGATTACGAG 
GAGGCCATCA AGGATTTCAC CTACCTGTTG AAGGACGAGC CGCAGTACGA CCAGGCTTTG 
TACTACCTGG CCAGCACCTA TGCGGAAAAA CAGGACTTCG AGCAGGCCAT CCGCAACTTC 
CGGCTGATCG CACGGAGCAG CCCGCTCTGG CCCATGGCCC AGACCCGCCT CGCCTTGATT 
TTCTCCAAGC AGAAGGACTT CCAGAACGGT GCGGCGGTCC TCAAGGAGGC GATCGACGCC 
CAACCGGAAG TGGCCGATCT GTATCTCTAT CTCGGCATCA TCTATGAAGA AGCGAAACAA 
TACGAGGATG GCGTCGCGGC GGTGGACAGG GGTCTGGTCA AGACTCCGCG AGACACCGAT 
CTCCTGTTCC GAAAAGGGGT CATTCTCGAC AAGATGTCCC GAAGGGATGA CGCCATCGCC 
GTGATGAAAC GGATCCTCGA GATCGAGCCT CAGAACGCCA ATGCCTTGAA CTACATCGGG 
TACACGTATG CGGAGATGGG AATCAACCTC AACGAAGCCC GCCAGATGAT CAAGGCGGCC 
CTGGCCACCG CTCCCGATGA TGGTTACATC ATGGACAGCC TCGCCTGGGT CTACTACAAG 
CTGGGGCAAC ACAAGAAGGC TTTGGAGACC ATTCTGGAGG CATTGAAGCG CGTTCCGCAG 
GACCCCGTCA TCCACGAGCA TCTCGGGGAC ATTTACTTGA GTCTCGGAAA GAAGAACGAA 
GCCATCGAGG CCTATGAGAA AGCGCTGGAG TACAGCCACA CGGAGCCCGA GAAGATCCGG 
GAGAAGCTGG ACCGGCTCAA GTAG

Protein sequence

MILRYLLIIA VLSVCSCTQL KPYAATSSTP KAPAARSESG SRADLYFEYL LAQYYVSVKE 
IDKAIEAYHE ALKKDPRSPM LLTELAALLI RQGKIEQALK LTEDATSFDR TYEPAYMLLG 
QLYAGIGQNA RAIDAYSRAI EINPSNEDAH LLLGALYAQE KKYDEAMEAF DHLKALLPDN 
PVALYYKARV FLDMKLYKQA EKIYLDVLAI EPAFENASLD LAYVYEVTER LKDAEQTYLQ 
ILSANPANVN ARTRLGNLYM RQDRPAEALR HFSHLLKLNR KDVESRLKVG IIHLQQKDYE 
EAIKDFTYLL KDEPQYDQAL YYLASTYAEK QDFEQAIRNF RLIARSSPLW PMAQTRLALI 
FSKQKDFQNG AAVLKEAIDA QPEVADLYLY LGIIYEEAKQ YEDGVAAVDR GLVKTPRDTD 
LLFRKGVILD KMSRRDDAIA VMKRILEIEP QNANALNYIG YTYAEMGINL NEARQMIKAA 
LATAPDDGYI MDSLAWVYYK LGQHKKALET ILEALKRVPQ DPVIHEHLGD IYLSLGKKNE 
AIEAYEKALE YSHTEPEKIR EKLDRLK