Gene Sros_4879 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Sros_4879
Symbol
ID	8668173
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Streptosporangium roseum DSM 43021
Kingdom	Bacteria
Replicon accession	NC_013595
Strand	-
Start bp	5402660
End bp	5404030
Gene Length	1371 bp
Protein Length	456 aa
Translation table	11
GC content	75%
IMG OID
Product	Carboxylesterase
Protein accession	YP_003340439
Protein GI	271966243
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	18
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	13
Fosmid unclonability p-value	0.0135743
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGGCGCCGC GCATGATCGT GCGAACCACT GCCGGGCTGG TCGAGGGCAG GGCCGAGGAG 
GGCGTGCTCG CCTTCCTCGG CGTGCCGTAC GCCGCCCCGC CCTTCGGCGA GCACCGCTTC 
GGCGCGCCCG TCCCGCCACC CGCGTGGGAC GGCGTACGGC CCGCCGTCAC GCGGGGCCCT 
GCCGCCCCGC AGGCGGCCGG TGAGGACATC GGCCTGTACG CGCCCGACGT CTTCGAGGTC 
GGCGAGGACT GCCTCAACCT CGACGTGCGC ACCCCTGAGA CCGGCCGGGC CGGGCTGCCC 
GTCCTGGTCT GGATCCACGG CGGCGCGTTC TCCATCGGCG GCAACGGGGC GGCCTGGCAC 
CAGGGCTCCC GCTTCGCCCG CGACGGCGTG GTCTGCGTGG CCATCAACTA CCGGCTCGGC 
TTCGAGGGCT TCCTGGCCCT GGAGGACGCC CCGCTCAACC GGGGCGTCCT CGACTGGCTG 
GCCGCGCTGG AATGGGTGCG CGACAACATC GCGGCCTTCG GCGGCGACCC CGGCAACGTG 
ACGATCGCCG GGCAGTCGGC GGGCGCCGCC GCCGTCGCCA CCCTGCTGAC GATGCCCCGT 
GCCGAAGGGC TGTTCCGGCG CGCGATCGTG ATGAGCGGCT CGGCCAACCT GGTCGCCACC 
GAGCAGGAGG CGCGCGACTA CGCCAAGACG CTCGCCACCC GGCTGGGGAT CGACCCGACC 
AGGTCCTCGT TCGCCGGGCT GCCCCCCGAG GCGCTCGTCG CCGAACAGCC GCCGCCGCTG 
ACCGGCGACG CCGGCGGGCT GAACGAGTCG GTGCCGGTCA AGCCGGTCGT CGACGGCGAC 
CTGATCCCGG CCGTCCCGCT GGCCGCCCTG CGCGCAGGCG CGAGCGGGCA CCTTCCACTG 
CTGGTCGGCT GCACCTCCCA GGAGGCCGAC GTGTTCGTCC GCCGCCTGGC CGCCGACCTC 
GACGAGGCCG CCGCGCAGGC CGCGCTCGAC CATCTCGGCG TCCAGGTCGA CGGACCCGGC 
CTCACGCCCG CCGAACGCGT CGGACGCGCC TTCACCCAGC ACCTGTTCAC CCGCGAGACG 
CGCTGGATCC GCGAGGCCAG GCCCGCCTAC GCCTACGAGT TCCGGTGGGA GTCGCCCGTC 
GAGAGCCCGG TCGGCGGCGG ACGCGTGGGC GCGGTGCACA ACCTCGACCT GCCCTTCGTC 
TTCGACGTGC TCGACGCGCC CGGCGTCGAA CGCACCGCAG GACCGGGCGC GCCGCAGGCC 
GTGGCCGACG CGATGCACGC CGCCTGGGTG CGTTTCGCCC GCACCGGCGA TCCCGGCTGG 
CCACTCGGGC ACACCATGGT CTTCAATGAA CCCATCGACC GGAGGTTGTG A

Protein sequence

MAPRMIVRTT AGLVEGRAEE GVLAFLGVPY AAPPFGEHRF GAPVPPPAWD GVRPAVTRGP 
AAPQAAGEDI GLYAPDVFEV GEDCLNLDVR TPETGRAGLP VLVWIHGGAF SIGGNGAAWH 
QGSRFARDGV VCVAINYRLG FEGFLALEDA PLNRGVLDWL AALEWVRDNI AAFGGDPGNV 
TIAGQSAGAA AVATLLTMPR AEGLFRRAIV MSGSANLVAT EQEARDYAKT LATRLGIDPT 
RSSFAGLPPE ALVAEQPPPL TGDAGGLNES VPVKPVVDGD LIPAVPLAAL RAGASGHLPL 
LVGCTSQEAD VFVRRLAADL DEAAAQAALD HLGVQVDGPG LTPAERVGRA FTQHLFTRET 
RWIREARPAY AYEFRWESPV ESPVGGGRVG AVHNLDLPFV FDVLDAPGVE RTAGPGAPQA 
VADAMHAAWV RFARTGDPGW PLGHTMVFNE PIDRRL