Gene Rcas_4417 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_4417
Symbol
ID	5541930
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	+
Start bp	5671757
End bp	5672803
Gene Length	1047 bp
Protein Length	348 aa
Translation table	11
GC content	60%
IMG OID	640896515
Product	TRAP transporter solute receptor TAXI family protein
Protein accession	YP_001434451
Protein GI	156744322
COG category	[R] General function prediction only
COG ID	[COG2358] TRAP-type uncharacterized transport system, periplasmic component
TIGRFAM ID	[TIGR02122] TRAP transporter solute receptor, TAXI family

Plasmid Coverage information

Num covering plasmid clones	18
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	13
Fosmid unclonability p-value	0.0674202
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGGTCAAAC GAACGCTGGT CGTCTTCTGG TCAATTATGG CGCTAGTACT GGCTGCGTGT 
GGACAGCCGA CCCCCGCAGC GCCAACAACC GCCCCTTCAG CCCCCACCAC CGCGCCTTCC 
GGCGAACAAC CCACAACAGC GCCCGCCGCG CCCAGCGGGG AAAAACTGCG CTTGATCATC 
GGCACCGGCG GCACCGGCGG CGTGTTCTTC CCCTATGGCG GCGGTCTGGC GCGTATTCTT 
ACCGAAAAGA TGCCCAACAC GGAAGCGACG GCGCAGGAAA CCGGCGGCTC CGTCGATAAT 
ATGAAACTGC TCCAGAATTC GGAAGCGCAA ATCGGCTTCA CCACCGCAGA TTCGGCATAC 
GATGGCATTA ATGGCGTGGC AGCATACCAG GCGACCGGTC CGGTTCCCGC CGCAACCATT 
GCCGTGCTCT ATCAGAGTTT CATCCATGTG GTCGCGCGCG CCGATTCGGG TATCACAAGC 
GTCGCCGATA TGAAAGGGCG ACCTGTCTCG ATTGGATCGG CGGGCAGCAG CACGGAAACC 
GCGGCTATCC GCCTGCTCGA AGCCGCAGGG CTGAAGCCGG AAGATGTGGT CCGCGAAAAC 
CTGGGGGTGG CCGACTCGGT GGCTGCCATG AAGGATAAGA AGATCGATGC CTTCTTCTGG 
ATCGGCGGTC TGCCGACGGC TGCGGTGACC GACCTGGTTA CGACCGAGTC GGTGGTCTTT 
ATCGACACCA GTTCGCTGCT GAAGCCGATG GTGGATAAGT ATGGTCCAAT CTACGCCGCT 
ACCGTGCTGC CTGGCGGCAC CTACAAAGGG ACGGACCAGG ATGTGCCGGG GATTGGCGTT 
GCCAACCTGC TCGTGGTGCG CGAGGATATG CCCGCTGACC AGGTAAAAGG CATTCTGACC 
ACAATTTTCG ACAATCTCGA AGAAGTGCAT CAGATCCATC CCGCAGCGCG CACCCTGTCG 
CTTGAATCGG CAGTCACCGG TTCATCGATA CCGTTCCATC CGGCTGCAAT CGAGTTCTAC 
AAGGAACGTG GCGTTTGGAA GGAGTGA

Protein sequence

MVKRTLVVFW SIMALVLAAC GQPTPAAPTT APSAPTTAPS GEQPTTAPAA PSGEKLRLII 
GTGGTGGVFF PYGGGLARIL TEKMPNTEAT AQETGGSVDN MKLLQNSEAQ IGFTTADSAY 
DGINGVAAYQ ATGPVPAATI AVLYQSFIHV VARADSGITS VADMKGRPVS IGSAGSSTET 
AAIRLLEAAG LKPEDVVREN LGVADSVAAM KDKKIDAFFW IGGLPTAAVT DLVTTESVVF 
IDTSSLLKPM VDKYGPIYAA TVLPGGTYKG TDQDVPGIGV ANLLVVREDM PADQVKGILT 
TIFDNLEEVH QIHPAARTLS LESAVTGSSI PFHPAAIEFY KERGVWKE