Gene Rcas_0014 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_0014
Symbol
ID	5537471
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	-
Start bp	13696
End bp	14769
Gene Length	1074 bp
Protein Length	357 aa
Translation table	11
GC content	60%
IMG OID	640892179
Product	glycosyl transferase family protein
Protein accession	YP_001430171
Protein GI	156740042
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0463] Glycosyltransferases involved in cell wall biogenesis
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	3
Plasmid unclonability p-value	0.00192438
Plasmid hitchhiking	Yes
Plasmid clonability	hitchhiker

Fosmid Coverage information

Num covering fosmid clones	6
Fosmid unclonability p-value	0.0000617059
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGAAACTGA TTGTCCAAAT CCCCGTGCTC AACGAGGCTG AGTCGATTGC GCGCGTTCTC 
GCCGACATTC CGCGCGCCAT CCCTGGCGTT GAGAGCGTCG AGGTGTTGAT CATCGACGAT 
GGTTGCACCG ATGATACCAT TGCTGTGGCC CTGGCGCACG GCGCCGATCA TGTGGTGCGC 
CATACCAGTC GCAAAGGGCT GGCAGCCGCC TATCAGACCG GCATCGATGC GGCGCTGCGC 
CTCGGCGCCG ATATTATTGT CAATACCGAT GGAGACAATC AGTACCCAGG GCGCGAGATT 
CCTCGATTGA TCGCGCCGAT CCTGGCAGGA CGGGCGGATA TGGTGATCGG CGACCGTCAG 
ATCGAGAGTA ATGTGCATTT TTCGCCGCTC AAGAAAATGT TGCAGGCGGT TGGCAGCAGT 
GTGGTGCGCT GGGCTTCGGG CACGAACGTG CCGGATACGG TGAGCGGCTT TCGCGCGCTC 
TCGCGTGAAG CAGCGCTGCG CACGTTTGTG ACGAGTGATT TTTCGTACAC GGTGGAAAAC 
CTGATCCAGG CGGGCAAACG GCGTCTGACG ATCCAGACGG TGCCGATTTC GACCAATCCG 
GTGCGCCGGG CGTCGCGGTT ACACACCGGA AACTGGAACT TCATCAAACG GCAGGCGTCA 
ACGATTGTGC GCACCTATAC CGCATATGAG CCACTTAAGA CGTTCACCTA TATTGCGCTT 
CCGTTTCTGA TCGCCGGTTT TCTCTTTCTG GGGCGCGCGC TGTATGTCTA CCTGATGCGC 
CAGTTGGTCG ATAATTTCCC GCAGGACAAC GCACAATCGC TGGCGGTCGG CAGTACGGCG 
CTCATTCTTG GGTTCATCAT CTTTCTCATT GGCCTCCTGG CAGATCGGAT CGGTGGGACG 
CGACGCCTTA TGGAAGAGGT GCTTTACCGC GTTCGCGCTC AGGAGATTGC CGACCTCGCC 
TGGCGGCGCG AGGTGCAGAC GCGCCTGGAC CGCCTCGAGC AACGCCTGGC GGAGAGCCAG 
GATGTGAAAG CGGGCGAGAG GAGCGAGGAT GAGGGGTTAG GGGTGAGGGG TTAG

Protein sequence

MKLIVQIPVL NEAESIARVL ADIPRAIPGV ESVEVLIIDD GCTDDTIAVA LAHGADHVVR 
HTSRKGLAAA YQTGIDAALR LGADIIVNTD GDNQYPGREI PRLIAPILAG RADMVIGDRQ 
IESNVHFSPL KKMLQAVGSS VVRWASGTNV PDTVSGFRAL SREAALRTFV TSDFSYTVEN 
LIQAGKRRLT IQTVPISTNP VRRASRLHTG NWNFIKRQAS TIVRTYTAYE PLKTFTYIAL 
PFLIAGFLFL GRALYVYLMR QLVDNFPQDN AQSLAVGSTA LILGFIIFLI GLLADRIGGT 
RRLMEEVLYR VRAQEIADLA WRREVQTRLD RLEQRLAESQ DVKAGERSED EGLGVRG