Gene Rcas_2666 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_2666
Symbol
ID	5540148
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	+
Start bp	3437135
End bp	3438253
Gene Length	1119 bp
Protein Length	372 aa
Translation table	11
GC content	58%
IMG OID	640894788
Product	ABC-type sugar transport system periplasmic component-like protein
Protein accession	YP_001432755
Protein GI	156742626
COG category	[G] Carbohydrate transport and metabolism
COG ID	[COG1879] ABC-type sugar transport system, periplasmic component
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	8
Plasmid unclonability p-value	0.157111
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	26
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAAACGCC GACAATTCGC ACTGTTTGCG ATCACGCTCA TGCTCGCCAC CCTGATTGCG 
GCATGCGGCG GAACGCCCAC CACCACCGCA CCGACCGCTG CGCCAGCGCC ACAACCCACG 
ACGGCGCCAG CGCCCGAGGG CAGAAAGTTC ACAATCGGCA TCTCCAACCC GTTCATCAGC 
AGCGAATACC GCACCCAGAT GATCCAGTCG TTGATCGAGG TCAATAAGGA ATACATGGAA 
CGGGGGATCA CCAACGAACT CGTGATCGAG AGCGCCGATA CCGATGTCGC CGGTCAGATC 
CAGCAATTGC AGAATCTCAT TAACAAAGGG GTCGATGCCA TCCTGGTGAA CCCCAGCGAT 
GTCAATGGTC TTAACGACAC GCTTCAGGAA GCGATCAACA AGGGGATCAT CGTCATCTCG 
GTCGATCAGG AACTGAACAC CCCCGGCGTC TACAACGTCG GCATCGATCA GAAGGAATGG 
GCGAAGATTT CAGCCCGCTG GCTGGCGGAG AAGCTTGGCG GACAGGGAAA TATTGTGCTG 
ATCGAGGGCT TCCCCGGGCA TCCGGCGAAC GTTGCGCGCA TGGAGGGCGT CGAGGAAGTG 
CTGAAGGAGT ATCCCAATAT CAAGGTGCTA GGGCGTGAAA CCGGCAAGTG GGACGAAGCC 
ACCGGTCAGC AGGTGATGTC GAACTTCCTG GCGTCGTTCC CCAATCTCGA CGGCTACTGG 
ACGCAGGATG GCATGGCGAT TGGCGCGATG CAGGCGGTGA TGGCCGCCAA CCCGTCGAAG 
TGGCCCGTGC TCGTCGGCGA GGGGCGCTGC CAGTTCTTGC AGTTGTGGGA TCAGCGCCTG 
AAGGAAGACC CCAACTTCGA GACGATTGCC GTCGCCAATC CGCCCGGCGT ATCGCCAACC 
GGTCTGCGCA TTGCCATCAA TATGCTTCAG GGCAAGCAGG TGGACAAGAG TAAACTTGGA 
GGGGCGAATG GACTGTCGTT CGTCATTCCG GTGCCGGTGA TTGTGACGAA AGACAATTTC 
CAAGAGGTGT TCACCACAGT GTGCAAGGAT AAGCCGGCCA CCTACCTGCT CGACGGCATT 
ATGACCGACG AGGAAGTGCA GCAGTTCTTC GTGAAGTAG

Protein sequence

MKRRQFALFA ITLMLATLIA ACGGTPTTTA PTAAPAPQPT TAPAPEGRKF TIGISNPFIS 
SEYRTQMIQS LIEVNKEYME RGITNELVIE SADTDVAGQI QQLQNLINKG VDAILVNPSD 
VNGLNDTLQE AINKGIIVIS VDQELNTPGV YNVGIDQKEW AKISARWLAE KLGGQGNIVL 
IEGFPGHPAN VARMEGVEEV LKEYPNIKVL GRETGKWDEA TGQQVMSNFL ASFPNLDGYW 
TQDGMAIGAM QAVMAANPSK WPVLVGEGRC QFLQLWDQRL KEDPNFETIA VANPPGVSPT 
GLRIAINMLQ GKQVDKSKLG GANGLSFVIP VPVIVTKDNF QEVFTTVCKD KPATYLLDGI 
MTDEEVQQFF VK