Gene Rcas_4137 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_4137
Symbol
ID	5541648
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	-
Start bp	5355178
End bp	5356473
Gene Length	1296 bp
Protein Length	431 aa
Translation table	11
GC content	62%
IMG OID	640896248
Product	glycosyl transferase group 1
Protein accession	YP_001434186
Protein GI	156744057
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0438] Glycosyltransferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	18
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	6
Fosmid unclonability p-value	0.0000953773
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGCACATCG GCGTTGACAT TTCGCTCCTG CGAATTGCTC AGGCAGGCGT GCTGACCTAT 
CATCGGTCGC TGCTCGACCA TCTGGTGCGA GCCGGGCGTG ATTGCCATTT TACGCTGATC 
GATGTGCTGC CGCTCAACCC TGGCCGTTCG ATGCTGTGGC TGGCAGCCCT CGACTCGCCG 
AATGTGCGGG TCGTGCGTTG CCCCGGCGTT CGGCGTGGCT ACCTGAGCGC GCTTCCTGCG 
TTTCGTGATG GAGTGGCGCA TCCGATTGCG GCGCGGATCG ACCGCATCCT CGATCCAATC 
TGGTCGCAAC TGGCGGTCGC CGAGATGGGG CTGGAACTCA GGGGCGCCAC GAGGTTCGTT 
GAGGTCTTTC ATGCTTCCGA TCAATTGCCT TATGCACCGC CTGGCGCTGC AACCGTGCTG 
ACCATTCACG ATCTGACCAC CCGGCGCTTC CCCGATATGC ATGTGGCGGA GAACGTTGCG 
TTGCATGCAG CCAAGGAGCG ATTTGCCCGC GACCGCGCCG ACCGGATTAT TGCCGTGTCG 
GAAGCGACCC GCCGTGATAT TGTGTGCGAA CTGGGCATTC CGCCTGAGCG GATCAGTGTG 
GTGTATGAAG CCGCAGATGT GCGCTTTCGT CCACGCGCGC CGGATGAAAC GTGTTCGGTT 
CTGGCGCGAT ACGATATAGC GCATGGCGCG TATGTGCTGA GTGTTGGCAC GCTCGAGCCG 
CGCAAGAACT ACATCCGTTT GATCGAAGCG TATGCCGTGT TGTGTGCGCG GTATGCCGCA 
GATGCGCGTC GTTTGCCGCC GTTGATTATT GCCGGCGGCT ACGGCTGGAA GCACGACGCG 
ATCCTCGCCG CGCCGGAACG CGCCGGAGTT GCCGGACAGG TCCGATTTAT CGGGCGCATT 
CCCGATGACG ACCTGCCTGC ACTGGTTGCC GGGGCGCGCC TGTTTGTGTA TCCTTCACTG 
TACGAAGGGT TTGGTCTTCC GCCGCTGGAG GCGCTTGCTT CAGGAACGCC GGTGGTGGTG 
GCAAACACCT CATCGCTGCC GGAGGTGGTT GGCGATGCCG GATTGTACTG CGATCCGTAT 
CAGGTGAGCG ATATTGCGCG CCAGATCGCT GCACTCCTGG ACAGCGAGGA CCTGGCGTTG 
CGGTTACGGC ACGCTGGAAT TGAACGCGCA AAGCAGTTCT CGTGGGAGCG CGCTGCCCGT 
GAAACGCTTG CAGTCTATGC GCAGGCGCGC GCTGAACGCT GTGCGAGGCG ACGATGGCAA 
TTTACTGGGT TCATTCCGAC AGCGATGACG CGCTGA

Protein sequence

MHIGVDISLL RIAQAGVLTY HRSLLDHLVR AGRDCHFTLI DVLPLNPGRS MLWLAALDSP 
NVRVVRCPGV RRGYLSALPA FRDGVAHPIA ARIDRILDPI WSQLAVAEMG LELRGATRFV 
EVFHASDQLP YAPPGAATVL TIHDLTTRRF PDMHVAENVA LHAAKERFAR DRADRIIAVS 
EATRRDIVCE LGIPPERISV VYEAADVRFR PRAPDETCSV LARYDIAHGA YVLSVGTLEP 
RKNYIRLIEA YAVLCARYAA DARRLPPLII AGGYGWKHDA ILAAPERAGV AGQVRFIGRI 
PDDDLPALVA GARLFVYPSL YEGFGLPPLE ALASGTPVVV ANTSSLPEVV GDAGLYCDPY 
QVSDIARQIA ALLDSEDLAL RLRHAGIERA KQFSWERAAR ETLAVYAQAR AERCARRRWQ 
FTGFIPTAMT R