Gene Rcas_1160 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_1160
Symbol
ID	5538626
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	-
Start bp	1503436
End bp	1504506
Gene Length	1071 bp
Protein Length	356 aa
Translation table	11
GC content	58%
IMG OID	640893292
Product	myo-inositol-1-phosphate synthase
Protein accession	YP_001431275
Protein GI	156741146
COG category	[I] Lipid transport and metabolism
COG ID	[COG1260] Myo-inositol-1-phosphate synthase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	17
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	22
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGTCGAAGA AAGTTCGTGT TGCAATCATC GGTGTCGGCA ACTGCGCCTC GTCACTGGTG 
CAGGGAGTCG AGTACTATCG CAACGCCCGA ACCGATGAGT TCGTTCCAGG TTTGATGCAC 
GTCAACCTCG GCGGCTATCA CATTGGCGAT ATCGAGTTTT CAGCAGCATT CGACATCGCC 
GATACGAAAG TCGGCAAAGA CCTCTCGGAG GCAATCTTCG CGCCGCCGAA CAATACATAC 
CGCTTCGCGC ATGTGCCACA CCTCGGCGTG CCGGTACATC GCGGGATGAC CCACGACGGT 
CTGGGAAAAT TTCTGAGCCA GAAGGTGCAT AAAGCGCCGG GGGCGACTGA TGACATCGTC 
AATATTCTGC GCTCCACCCG CACCGATGTC GTCGTGTCGT ATCTGCCGGT TGGCAGCGAA 
ATGGCGACGA AGTGGTATGT CGAGCAGATC CTGGATGCCG GGTGCGGCTT CGTCAACTGT 
GTGCCGGTGT TCATCGCCAG CCAGGCGTAC TGGCGCAAAC GCTTCGAGGA GCGCGGATTG 
CCGATCATCG GTGATGACAT TAAGAGCCAG GTTGGCGCCA CCATCACGCA TCGTGTGTTG 
ACGGCGCTAT TCCGCGATCG CGGCGTGCGC CTCGACCGCA CCTACCAGTT GAACTTCGGC 
GGCAATACCG ATTTTTACAA CATGCTCGAA CGGGAGCGCC TGGAGAGCAA GAAGATCAGC 
AAAACCAACG CCGTCACCAG CCAACTCGAT TACGATTTGC CCGACGACGC GGTGCATGTT 
GGTCCGAGTG ATTATGTGCC CTGGCTGGAA GATCGCAAAT GGTGTTACAT TCGCATGGAG 
GGCACCACGT TCGGGAATGT GCCGATCAAT CTCGAATTGA AACTGGAAGT CTGGGATTCG 
CCCAATTCGG CTGGTGTTGT CATCGATGCC GTGCGCTGCG TCAAACTGGC GCTCGACCGC 
AACATTGCCG GCGCGCTGGT CGGACCGAGC GCCTATTTTA TGAAGACGCC GCCGCAACAG 
ATGACCGACA ATGAGGCGCG TCGGTTGACG GAAGAGTTCA TCGCCGGGTG A

Protein sequence

MSKKVRVAII GVGNCASSLV QGVEYYRNAR TDEFVPGLMH VNLGGYHIGD IEFSAAFDIA 
DTKVGKDLSE AIFAPPNNTY RFAHVPHLGV PVHRGMTHDG LGKFLSQKVH KAPGATDDIV 
NILRSTRTDV VVSYLPVGSE MATKWYVEQI LDAGCGFVNC VPVFIASQAY WRKRFEERGL 
PIIGDDIKSQ VGATITHRVL TALFRDRGVR LDRTYQLNFG GNTDFYNMLE RERLESKKIS 
KTNAVTSQLD YDLPDDAVHV GPSDYVPWLE DRKWCYIRME GTTFGNVPIN LELKLEVWDS 
PNSAGVVIDA VRCVKLALDR NIAGALVGPS AYFMKTPPQQ MTDNEARRLT EEFIAG