Gene Sros_5272 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Sros_5272
Symbol
ID	8668566
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Streptosporangium roseum DSM 43021
Kingdom	Bacteria
Replicon accession	NC_013595
Strand	+
Start bp	5789757
End bp	5790866
Gene Length	1110 bp
Protein Length	369 aa
Translation table	11
GC content	72%
IMG OID
Product	O-succinylbenzoate synthase
Protein accession	YP_003340784
Protein GI	271966588
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	12
Plasmid unclonability p-value	0.132905
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	18
Fosmid unclonability p-value	0.154235
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGAAGCTCG ACGCCGTCGA ACTGCGCGAG GTCGCGCTGC CGCTGGTCAG CCCGTTCCGT 
ACCTCGCTCG GCACCCAGAC GGTACGCACC GCGCTGCTCG TGCGAGTGCT CAGCGACGAG 
GGCGAGGGCT GGGGCGAGTG CGCGGCCGAG GACGAGCCGA CATACTGTCC CGAATACCTC 
GCCGGGGCGG CCGACGTGAT CAAGCGGTTC ATGCTCCCGG CGCTGGCTCC GCTCGACCTG 
GAACCGGCGG CGGTCGGCCC CGCGCTGCGG CACCTGCGCG GGCACCCGAT GGCCAGGGCG 
GCCGTGGAGA CGGCGGTGCT GGACTGCTGG CTGCGGGCAC GACGCACGAG CCTGGCCGCT 
CACCTGGGAG GGGTACGGCG GCGCGTGCGC GTGGGCGTTT CCGTGGGCAT CACCGAGACT 
GTCGACGCGC TGCTGGACAC GGTCGACCGG CATCTGACCG CCGGCTACGC CAGGATCAAG 
CTGAAGATCG AGCCCGGCTG GGACCTCGAA CCGGTCAGGG CGGTGCGCGA GACGTTCGGC 
GCCGGCGTGA TGCTCACCGT CGACGCCAAC ACCGCCTACC AGCCCGGTGA CCTCAGGCAC 
CTGGCGAAAC TCGACGCGTA CGGGCTCGCC CTGGTCGAGC AGCCCTTCGC CCCCGACGAC 
CTGCACGCGC ACGCCGCGCT CGCCGCCCGC ATGGACACGC CCGTCTGCCT GGACGAGAGC 
ATCACCAGCG CGCGCGACGC GGCCGAGGCC ATCAGCCGGG GTGCCTGCTC GATCATCAAC 
ATCAAGCCCG GCCGCGTCGG CGGCTACCTG GAGGCGCGCC GCATTCACGA CCTGGCTCAG 
GCGAACGGCG TGCCGGTCTG GTGCGGCGGC ATGCTGGAGA CCGGCCTCGG CCGGGCCGCC 
AACCTGGCGC TGGCCAGCTT GCCCGGCTTC ACGCTGCCGG GCGACATCTC CGCCACCGAG 
CGGTACTACC ACCGCGACAT CACCCGCCCG TTCGTGCTCG ACGGCGGCGA GCTGCCGGTT 
CCGGTCGAGC CCGGCCTCGG CGTACTGCCC GAGGAAGCGG ACCTGCAGGC ATGCACGACG 
GCGGTGGAGA CGGTGAGCTG CACATTCTGA

Protein sequence

MKLDAVELRE VALPLVSPFR TSLGTQTVRT ALLVRVLSDE GEGWGECAAE DEPTYCPEYL 
AGAADVIKRF MLPALAPLDL EPAAVGPALR HLRGHPMARA AVETAVLDCW LRARRTSLAA 
HLGGVRRRVR VGVSVGITET VDALLDTVDR HLTAGYARIK LKIEPGWDLE PVRAVRETFG 
AGVMLTVDAN TAYQPGDLRH LAKLDAYGLA LVEQPFAPDD LHAHAALAAR MDTPVCLDES 
ITSARDAAEA ISRGACSIIN IKPGRVGGYL EARRIHDLAQ ANGVPVWCGG MLETGLGRAA 
NLALASLPGF TLPGDISATE RYYHRDITRP FVLDGGELPV PVEPGLGVLP EEADLQACTT 
AVETVSCTF