Gene Rcas_2034 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_2034
Symbol
ID	5539512
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	+
Start bp	2607419
End bp	2608534
Gene Length	1116 bp
Protein Length	371 aa
Translation table	11
GC content	63%
IMG OID	640894169
Product	hypothetical protein
Protein accession	YP_001432140
Protein GI	156742011
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	16
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	22
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGTGTCTGT ATTTCGCTCC CCTGTCTCAC CGCATAGACG CATGCAGAGG TGTGCTCCAT 
GTTCGGAGAA AGGAAGTGCA GGTTATGACG CCGGTCTATC GGTTCGTGTC GGTTGTGGTG 
ATGGTCGTGG TCATCTGGTT CGCCTCTGCA TCGTTTGGTC CGGCGCGCGC GAGTGCGCCA 
TTGAACGAAG ACCTGGGATT GACAGCATCA GCCTATGTGC TGACAACACA GGTCACGGAT 
GTGGAGCGTG AACCGGCGCT GGCGCCGGTT GCGCAGGCGG GATGGAGCGC CTGGGAAGCG 
GTTCCCGGCG CAGTGCTGGC GACATCAGCG CCTTCCGTGA CAACCTGGGG TCGGGATCGC 
CTGGAAGTTT TCGTCCGTAG CGATGGTGGG GCGCTCTTAT GGCAGACGTT CGCCAGCGGG 
CGCTGGTCGG GCTGGCGCAA CCTCGGCGGC GGGCTGGCAT CGGCGCCATC GTGCGCCGCA 
TGGGGGCAGG ATCGCATGAG TTGCTTTGCG CTGCGCCAGG GGAGCAGCGC CGTCTGGCAC 
ACCTGGTGGA ATGGCGAGCG CTGGAGCGAA TGGCAGAACC TGGGAGGCGT TGCCACCTCT 
GCGCCTGCCG CCGTCTCGTG GGGTGCGCAG CGAGTCGGTG TTTTCGTGCG CGGCAGCGAT 
AACAAGATGT ATCAGGCGTA TTACGACGGT CAGCGCTGGA TCAGTTGGAT CAACCACGAA 
GGAACGCTCA CCTCGGCGCC TGCCTGCACG TCGCCGGGTG ATAATCAGGT GCAGTGTTTT 
GTGCGCGGCA GCAACAACAA ACTCTACCGC CGCGTCTGGA ATAGCGTTCA GTGGACTATC 
TGGGAGGACC TGGGAGTCGG CGGAACGTCG GCGCCGTCTG CCGCATCCTG GGGACCCAAC 
CGGGTCAGTC TGTTCGTGCG GGGCGACAAT GGCAATCTGT TGCACCGTTA CTGGGATGGA 
TCGCGCTGGA TCGGCTGGGA AGACCTCGGC GGCAATATTG CTTCCTCACC GGCCTGCGTC 
TCATGGGGCG CCAATAGCCT CGACTGCTTT GCCCAGACGG TTGATCCGGT CTTCAATACC 
GATCAGGGGC TGATCCGTCG GTTCTGGCGA GGATGA

Protein sequence

MCLYFAPLSH RIDACRGVLH VRRKEVQVMT PVYRFVSVVV MVVVIWFASA SFGPARASAP 
LNEDLGLTAS AYVLTTQVTD VEREPALAPV AQAGWSAWEA VPGAVLATSA PSVTTWGRDR 
LEVFVRSDGG ALLWQTFASG RWSGWRNLGG GLASAPSCAA WGQDRMSCFA LRQGSSAVWH 
TWWNGERWSE WQNLGGVATS APAAVSWGAQ RVGVFVRGSD NKMYQAYYDG QRWISWINHE 
GTLTSAPACT SPGDNQVQCF VRGSNNKLYR RVWNSVQWTI WEDLGVGGTS APSAASWGPN 
RVSLFVRGDN GNLLHRYWDG SRWIGWEDLG GNIASSPACV SWGANSLDCF AQTVDPVFNT 
DQGLIRRFWR G