Gene Rcas_1631 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_1631
Symbol
ID	5539107
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	+
Start bp	2107875
End bp	2108945
Gene Length	1071 bp
Protein Length	356 aa
Translation table	11
GC content	60%
IMG OID	640893768
Product	basic membrane lipoprotein
Protein accession	YP_001431741
Protein GI	156741612
COG category	[R] General function prediction only
COG ID	[COG1744] Uncharacterized ABC-type transport system, periplasmic component/surface lipoprotein
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	19
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	11
Fosmid unclonability p-value	0.0120157
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAAACGGC CGGTTTCTCT CATCATCCTG CTGCTCGTCT CGGTGTTGAT TGCCGCATGT 
GGCGGGCAGC AGACAGTCAC CCCAACGACC GCCCCCACCG GCGCAACTGC CGCGCCGGCC 
AGACCCACTG AAGCAGATTG CCCCAAACCC GAAGTTCTGT GTGTCGGTCT CGTGACCGAC 
GTGGGCGAGA TCGACGACAA GAGCTTCAAC CAGTCCGCCT GGGAAGGGGT CAAGCGCGCC 
GAAGCCGAAT TGGGCGCGAT CGTCAACTAT GTCGAGACAA AAGACGCCAA GGATTATGAT 
GCGAACATCG CGTTGTTCAC CGAGAAGGGG TACGATGTGA TCGTTACCGT TGGCTTTGCG 
CTCGGCGAAG CGACGGCGAA GGCTGCGGCG GAGAATCCGA ATGTGAAGTT CATTGGCGTC 
GATCAGTTCC AGGCAACGGA AATTCCGAAT GTTGCGGGCC TGATCTTCGC TGAGGACAAG 
GCGGGTTTCC TGGCGGGCGT GCTTGCAGCG GAAATGTCGA AGAGCAACAA GATCGCCGCT 
GTGCTCGGCA CCAACCTGGT TCCGCCGGTT GTCGCCTTCA AGGAAGGGTA CGAGAATGGC 
GCGAAGTATG TCAAGCCCGA TATCCAGGTG ATCTCGACCT ACCATCCGGG TGGTCTCGAT 
ACGGCGTTCA CCGACCCGAA GTGGGGCGCC GACCAGGCAA AACTGGCGAT TGACCAGGGC 
GCCGATGTGA TCTTCGGCGC TGGCGGCAAG ACTGGCAACG GCGCGCTGAT CGAGACGGCA 
GCCAACCAGG GGGTGTACTG CATCGGTGTC GATACCGATC AGTGGGAGAC GGTGCCGGAG 
GCTCGCCCGT GCCTGATCTC GAGCGCAATG AAACTGATTA CGCCGGGTGT GTTCGACCTG 
ATCAAGAAGG CGCAGGAAGG CGCGTTCCCT TCTGGCAATT ATGTCGGTGA AGTCGGGCTG 
GCGCCGTTCC ACGACTTCGA TGCCCAGATC CCGGCTGAGG TGAAAGCGAA GATCGCCGAG 
ATCGACAAAG GCCTGCGCGA TGGTTCAATT TCGACGGGAT ATACTCCGTA G

Protein sequence

MKRPVSLIIL LLVSVLIAAC GGQQTVTPTT APTGATAAPA RPTEADCPKP EVLCVGLVTD 
VGEIDDKSFN QSAWEGVKRA EAELGAIVNY VETKDAKDYD ANIALFTEKG YDVIVTVGFA 
LGEATAKAAA ENPNVKFIGV DQFQATEIPN VAGLIFAEDK AGFLAGVLAA EMSKSNKIAA 
VLGTNLVPPV VAFKEGYENG AKYVKPDIQV ISTYHPGGLD TAFTDPKWGA DQAKLAIDQG 
ADVIFGAGGK TGNGALIETA ANQGVYCIGV DTDQWETVPE ARPCLISSAM KLITPGVFDL 
IKKAQEGAFP SGNYVGEVGL APFHDFDAQI PAEVKAKIAE IDKGLRDGSI STGYTP