Gene Rcas_2166 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_2166
Symbol
ID	5539646
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	-
Start bp	2782816
End bp	2783976
Gene Length	1161 bp
Protein Length	386 aa
Translation table	11
GC content	62%
IMG OID	640894299
Product	radical SAM domain-containing protein
Protein accession	YP_001432268
Protein GI	156742139
COG category	[R] General function prediction only
COG ID	[COG4277] Predicted DNA-binding protein with the Helix-hairpin-helix motif
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	12
Plasmid unclonability p-value	0.978798
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	4
Fosmid unclonability p-value	0.00000549931
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGAGTCCTC TGATCTTTGT CGAACCAGAC ACGCAGCAGA AACTCTCGAT CCTGAGCGCA 
GAAGCCGGAT TCGAAGCCAC AACGGTTCCA GCCGTCGAAC GGGTACAGCA GGGGATGCGC 
CATCCCGCCG GTTTTCTCTA TACTGCCAGG AAAGAAGGCG GGGGGACAGC GCGCCTCTTC 
AAAGTGCTCC AGACGAACGC CTGCCGCTAC GCCTGCCGCT ACTGCTTCAC CTCGTGCGCA 
GTGCGACGTT CCCGCACGAC GTTTAAGCCC GACGAACTGG CAACAACCTT CATTGCGCTG 
CATCGTTCCC GGCAGGTCGA TGGGCTGTTC CTCTCCTCCG GGATTGTCCC CGACGCCAAT 
GCAACGATGG AGAAGATGCT GGCGACAGTC GAACGATTGC GACTGAAAGA AGGATACACG 
GGCTATATCC ACCTGAAGTT GATCCCCGGC GCGGCATTCG AGTATATCGA GCGCGCCGTT 
GAACTGGCAG ACCGCGTTTC GTTGAACCTG GAAGCGCCTA ATGCCGAACG CCTGGCGATG 
CTTGCGCCGG AGAAAGAGTT TGCCGGCAGC ATGTGGGGGC GCATGGCATG GGCTGCCGGG 
TTGATCCGCC GGGCGCGCGC CGCCGGGCGC CCCGCTGCCC GCAGCCTTAC GACGCAGTTC 
GTCGTTGGTC CGGCGGGCGA AAGCGACCGT GAGTTGCTCG AAACGGCGGC GCGCACCCAC 
CGCGACCTCG ACCTGCGCCG CGCATTCTTC AGCGCCTTTC ACCCCATCGA ACGCACACCG 
TTCGCCGATA TGCCCGCCGA AGACCCACTG CGCGAACTGC GGCTCTATCA GGCGGATTTT 
ATGCTGCGTG ATTATGGTTT CACCGTTGAC GAATTGCCAT TCGATGAGCG TGGCCTGCTG 
CCACGCACCA TCACTCCGAA ACAGGCCTGG GCGGAACGCC ATCTTGTTGA GCCGATCGAC 
GTGAATGTTG CGCCGCGACG CCTGCTGCTT CGCATCCCCG GCATCGGTCC ACGATCCGCC 
GACCGGATCA TTGCTATGCG ACGCGAGATG CACCTGCGTG ATATGGCGCA TCTCGCGCGG 
CTTGGCGTGG TGGTCAATTG GGCGGCGCCC TATGTGCTGC TCGATGGAAG ACGCCCGCCG 
GAACAGGGGC GTTTGTGGTA A

Protein sequence

MSPLIFVEPD TQQKLSILSA EAGFEATTVP AVERVQQGMR HPAGFLYTAR KEGGGTARLF 
KVLQTNACRY ACRYCFTSCA VRRSRTTFKP DELATTFIAL HRSRQVDGLF LSSGIVPDAN 
ATMEKMLATV ERLRLKEGYT GYIHLKLIPG AAFEYIERAV ELADRVSLNL EAPNAERLAM 
LAPEKEFAGS MWGRMAWAAG LIRRARAAGR PAARSLTTQF VVGPAGESDR ELLETAARTH 
RDLDLRRAFF SAFHPIERTP FADMPAEDPL RELRLYQADF MLRDYGFTVD ELPFDERGLL 
PRTITPKQAW AERHLVEPID VNVAPRRLLL RIPGIGPRSA DRIIAMRREM HLRDMAHLAR 
LGVVVNWAAP YVLLDGRRPP EQGRLW