Gene Sros_4050 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Sros_4050
Symbol
ID	8667344
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Streptosporangium roseum DSM 43021
Kingdom	Bacteria
Replicon accession	NC_013595
Strand	+
Start bp	4509094
End bp	4510218
Gene Length	1125 bp
Protein Length	374 aa
Translation table	11
GC content	75%
IMG OID
Product	Histidine kinase
Protein accession	YP_003339701
Protein GI	271965505
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	13
Plasmid unclonability p-value	0.313821
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	12
Fosmid unclonability p-value	0.00550271
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGAACATGC CGACAAGGGC CCTCCGGTCG CTGGCCGGAC TCGCGCTGGG CGTCCCCACG 
GCCCTCGTCG AGCTGGTCTT CCTCCTGGTC ACGGCCCCGC TCCTGGCCTT CCCCCGGGCG 
CGGCGGCACG TGCTCGCCGC GGCCACGCTG CTGGCCGACG TCGAGGTCCG GCGGCTGGGC 
CTGCTCGGCG GGGCCGAGGT CTCCGGCTAC GACGGGCGGC GGGCGCTGCG TTACGCGGCA 
TGGCGCTGGC CGGTGGGGGT GCTGGGCGGC CTGGTGCTCG CGCTGCTGGT CATCGGAGCC 
GGTGCCGGAG GACGGCTCGC CTGGCAATGG GGGCGGGGCG AGCGGTTCGA CGGCATGGAG 
CCGACCACGC TGCTCGTGCT CTACATGCTG GTCCTCGGGC TGGTCCTGCT CTTCCTGGAG 
ATCATGGGGC TCGTCGGGCT GGTCGCCCTT GAGCGGCGGG TGGCCCGGTG GGCGCTCGGG 
CCCAGCGCCA CCGAGCTGCT CGAACGCCGC ATCACCGAGC TGGCCGAGAC CCGCTCGGGC 
ATCGTGGTGG CCGTCGACCA GGAACGCAGG CGCATCGAGC GCGACCTCCA CGACGGCGTG 
CAGCAGCGCC TGGTCGCGCT GGCGATGCTG ATCGGCCGGG CCCGCCGGGG CCGCGCGCCG 
GAACTGCTCG ACGAGCTGCT CCGCCAGGCC CACGAGGAGG CCCGGGGGGC GCTGGGCGAC 
CTGCGGGAGG TGGCCTGGCG GGTCTACCCG ACCGGCCTGG ACTCCCTCGG CCTCAGAGAC 
GCCCTCGCCA CCGTCGCCGA GCGTGCCGGG GTGCCGGTCA CGGTCCACTA CGCTCTTGAC 
GAGCGTCCCG TCGGGCAGGT GGAGACGGCG GCGTACTTCG TGGTCTGCGA GGCCGTCACC 
AACGCGGCCA AGCACGCGGC GGCCGGTGCG GTCACCGTCG AGATCTTCAA GGAAGGCACG 
GTGGTCGTCG TGCGGGCACA GGACGACGGG CGCGGCGGCG CCGACCCCTC CGGTGGAGGG 
CTCTCCGGCC TCGCCCGCCG GGTGGCCGCC CTGGACGGGC GCTTCCACGT CGACAGCCCG 
TACGGCGGGC CCACCACGAT CACCGCGGAG CTCCCATGCG GGTGA

Protein sequence

MNMPTRALRS LAGLALGVPT ALVELVFLLV TAPLLAFPRA RRHVLAAATL LADVEVRRLG 
LLGGAEVSGY DGRRALRYAA WRWPVGVLGG LVLALLVIGA GAGGRLAWQW GRGERFDGME 
PTTLLVLYML VLGLVLLFLE IMGLVGLVAL ERRVARWALG PSATELLERR ITELAETRSG 
IVVAVDQERR RIERDLHDGV QQRLVALAML IGRARRGRAP ELLDELLRQA HEEARGALGD 
LREVAWRVYP TGLDSLGLRD ALATVAERAG VPVTVHYALD ERPVGQVETA AYFVVCEAVT 
NAAKHAAAGA VTVEIFKEGT VVVVRAQDDG RGGADPSGGG LSGLARRVAA LDGRFHVDSP 
YGGPTTITAE LPCG