Gene Rcas_0411 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_0411
Symbol
ID	5537873
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	-
Start bp	518610
End bp	519761
Gene Length	1152 bp
Protein Length	383 aa
Translation table	11
GC content	60%
IMG OID	640892573
Product	transposase IS4 family protein
Protein accession	YP_001430560
Protein GI	156740431
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	8
Plasmid unclonability p-value	0.215728
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	21
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAGCGCCT GTGATGAATT GCACTCGAAA ATGGAAGAAC CCATTCGTCC GCTTGTCGAC 
GTCAAACACG CCCATCACCT CTCGAATTGG TTGTGGATCG TCTGCGGGAT TCTGCTCAGT 
GGTTCGGTCG CATTAAGCAA GATTGCCCTT TACTTGCCCC TCACGGCGCA AGCGGAAGGG 
CGGATTGCTC GCATTCGCCG TTGGTTGAAG AATGTGTACG TCGATGTCTG GCAATTCTAC 
CGTCCCCTGC TGGAGAAGGT GTTGCAAGGA TGGCAAGCCG CAGAGGCGGC GGTGATCCTG 
GACGGCGTCA TGGTCTTCGG CGACCGCTTG CAGATTTTCC GTCTCTCCTT GCGACATGGC 
AGTCGTGCCA TCCCTTTGTC CTGGGTGGTC GTGCCGGGCA AAGGGCTGAC CAGCGTCGAA 
CGGTTGCGTC CATTGATCCA GCGGGCCGCA GAGTTCCTGG CCCCACGCGT CGGCGCCGTT 
GTGTTTCCGG CCGATCGCGG CTTTCGCGAT GTAGAATGGG CCGCTCTGTG TCTGGAAGTC 
GGTTGGCATT ATGTCATCCG ACTGGCCAAC AACACCCTCA TCACTCTGGA GGATGGCCGC 
CGCCTGTCCA TCGCGGCGCC GGGTGTGCCG CCTGGGGAAG CCTGCTATTG GCGGAACGCG 
GCCATCACCC AGTCGCAGGA CTGGCCTGCC AACCTCTCTG TAACCTGGAC CAAAGGCGCA 
CGCGGTCAGG CGCCGGAATT GCTGGCCGTG ATGAGCGATC GGCGCGCCTG CAACCAGCGG 
TTGCGTGAAT ATGGTTGGCG TATGAGCATT GAAGAGAGTT TCCGCGATGA CAAATCGGGC 
GGCTTTGACC TGGAACATAC ACGCCTCCAA GACCCGCAAC GGCTAGAACG CCTGTTGTTG 
GCGGTCGCAA TCGCCACACT TTGGCGTCAC GAATTGGGCG AGCAGGCGCT CCACGATCAC 
AGCGTCCAGG CCGAACTCGA CCCAGGCGGC AAGCGCCGCG AACTCAGCAT CTTCCAACTA 
GGCCTGCGAT TCCTCAGGCG GTGTTTGTTA GCGCTTACCA CCGCGCGCTT ACCCAAATTG 
CGGTTGGTTT TGTCCAACTT GGCGCTCGAG CCCCTCTCAC CAAGACACCT GGCCAAGGAG 
AAATGTCAGT GA

Protein sequence

MSACDELHSK MEEPIRPLVD VKHAHHLSNW LWIVCGILLS GSVALSKIAL YLPLTAQAEG 
RIARIRRWLK NVYVDVWQFY RPLLEKVLQG WQAAEAAVIL DGVMVFGDRL QIFRLSLRHG 
SRAIPLSWVV VPGKGLTSVE RLRPLIQRAA EFLAPRVGAV VFPADRGFRD VEWAALCLEV 
GWHYVIRLAN NTLITLEDGR RLSIAAPGVP PGEACYWRNA AITQSQDWPA NLSVTWTKGA 
RGQAPELLAV MSDRRACNQR LREYGWRMSI EESFRDDKSG GFDLEHTRLQ DPQRLERLLL 
AVAIATLWRH ELGEQALHDH SVQAELDPGG KRRELSIFQL GLRFLRRCLL ALTTARLPKL 
RLVLSNLALE PLSPRHLAKE KCQ