Gene Rcas_4042 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_4042
Symbol
ID	5541553
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	-
Start bp	5243148
End bp	5244089
Gene Length	942 bp
Protein Length	313 aa
Translation table	11
GC content	62%
IMG OID	640896155
Product	radical SAM domain-containing protein
Protein accession	YP_001434093
Protein GI	156743964
COG category	[R] General function prediction only
COG ID	[COG0535] Predicted Fe-S oxidoreductases
TIGRFAM ID	[TIGR01290] nitrogenase cofactor biosynthesis protein NifB

Plasmid Coverage information

Num covering plasmid clones	13
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	10
Fosmid unclonability p-value	0.00822978
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGGACGCTT CATCCGCCGG ATCGTGCCAG GGCGTCTGTT TTCCCAAGGT TGATCTGAGC 
ACGCATCCGT GTTATAGCCG GGCAGCGCAT TTCCGCTTCG GACGCATCCA CGTGCCGGTG 
GCGCCCCGTT GCAACATCCA GTGCAACTAT TGCATTCGCA AATACGCATG CCCAAACGAA 
AATCGTCCCG GCGTCACCAT GCGGGTCATG TCGCCCGACG AGGCGCTCCA CACCGTCCGC 
CACGCCATCG CCCACGACCT GCGCCTCCGC GTCCTTGGCG TGGCCGGTCC AGGCGATGCG 
CTGGCAAATC AGGCGACGCT CACTACGTTC GAGCGCGCGC GCGCTGAGTT TCCGCACCTG 
ATCCGCTGCC TCTCGACCAA CGGCTTGCTG CTGCCGGATC AGATCGACGC CATCGAGCGG 
GCCGGGATCA CCACGCTGAC GATCACGATC AATGCGGTCG ATCCGGCAAT TGGCAAGCAG 
ATATACGCCC ATGTGCGCTA TCGGGGCAAA ACCTACCGCG GGCGCGAGGC AAGCACACTG 
CTCCTGCACA ATCAGTTGAT CGGACTGCGC GAAGCGGCAC TGCGCGGTAT AGTGGTTAAG 
GTGAACTCAG TGCTCATTCC CGGTATCAAC GATCATCACC TGATCGACGT CGCGTGCGTC 
GTCAAAGATC ACGGCGCCTC CATCATGAAC ATCATCCCGC TCATACCCCT GGCGAAGTTT 
GCGCACCTGC CGGAACCCTC ACCCGAACTG CTCAACCGGG TGCGCGACGA GTGCGCGACC 
GTCATCGAAC AGTTTCGCCA CTGCCAGCGA TGCCGCGCCG ATGCCATCGG CGTTCCCGGC 
GAGGAGGGGT GCGGTACGGG CGAACGAGTC TGTATTCCCA GATTTTTGGC ACAGCGGAAG 
GAGCACACCC ATGCAGTTCA AGTGCAATCA GACCCTGCCT GA

Protein sequence

MDASSAGSCQ GVCFPKVDLS THPCYSRAAH FRFGRIHVPV APRCNIQCNY CIRKYACPNE 
NRPGVTMRVM SPDEALHTVR HAIAHDLRLR VLGVAGPGDA LANQATLTTF ERARAEFPHL 
IRCLSTNGLL LPDQIDAIER AGITTLTITI NAVDPAIGKQ IYAHVRYRGK TYRGREASTL 
LLHNQLIGLR EAALRGIVVK VNSVLIPGIN DHHLIDVACV VKDHGASIMN IIPLIPLAKF 
AHLPEPSPEL LNRVRDECAT VIEQFRHCQR CRADAIGVPG EEGCGTGERV CIPRFLAQRK 
EHTHAVQVQS DPA