Gene Sros_4647 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Sros_4647
Symbol
ID	8667941
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Streptosporangium roseum DSM 43021
Kingdom	Bacteria
Replicon accession	NC_013595
Strand	-
Start bp	5169602
End bp	5170927
Gene Length	1326 bp
Protein Length	441 aa
Translation table	11
GC content	73%
IMG OID
Product	hypothetical protein
Protein accession	YP_003340247
Protein GI	271966051
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	14
Plasmid unclonability p-value	0.394865
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	17
Fosmid unclonability p-value	0.107362
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGGCAACCA CCACCAAGAT CCGGCCGCGC GCCCTCGTCC GTGCCTCCGG AGGCCCCCGC 
TATGCCGTCG CCCTGGCCGT GGACGCGCTC GGCACCGGCC TGCTGCGGCC CTTTCTGCTG 
CTCTACGGGG TGATGGTGCT GAGGCTGTCC GCGCCGGCCA CCGGCATCGC CATGACGGTC 
GGCGCCGTCG TGGGTCTGGT GTGCATGCCC GCGGTCGGCC GATGGCTGGA CCGGGGCGCA 
CGCAGCACGG TCGTGGCAGC GTCGATGCTG GTGCGGGTGC TGGGCGTGGC GCTGCTGCTG 
GCCACCCCGA CGGGGAACGT CTGGCTGTTC GCGACGGCGG CACTCTTCCT CGGCATCGGC 
AACCAGGCAT GGCCGGCCGC CCACGCCGCC CTCGTGGCCA CGGTCGCCCA CGGCCGCGAA 
CGCGACGCCG CCCTCGCGGC AGGCCGCGCC CTGCGCAACG CCGGCCTGGG CGCGGGCGCC 
CTCCTCGCCA CCGCATGCCT GGCCGGCGGC ACCACCGCAT TGCAGGCGCT GGCAGCCGTC 
ACCGGGCTCA CCTATCTCGC CGCGGCGGTC TTGGCGTGGT CGGTCCACGT GCACGCTCAT 
CCGGCCGCTG CCGCGGCCAA GGACAGGGAC GACGAGCCCG CACCCCGGAT GCGCGCGCTG 
CTGGCCGCCA ACGTGGTCTA CGTCTTCTGT CTCAACGTCC CCGAAATCGC ACTCCCCCTG 
GTCCTGGTGA CACAGATGCA CGCATCCCCG GTGTGGTCGG CAGCCATCTT CGTGGCCAAC 
ACGGTGCTGG TGGTCACCCT GCAGGTTCCG ATCACGGTCC TGATGTCCCG CTTCTCCCGG 
CGGACCGTGC TGGCTCTCGC CGGCGTGGTC CTCACCGCGT CCTACCTCGG CTTCCTCGCG 
GCTACCTCAC TGGGACACGG CTGGGGTGCC CCGGCCATCC TCGCGGTGTC CGTGGTCTGC 
ACCATCGGCG AGATCATCTA TGCCGGCAGC GCCACCGCGC TCGTCACCGT CCTCGCCCCG 
GCCCATCTCC TGGGACGCGC CCTCGCCCGC TTCCAGCTGT CCACGGGCTT CGGCCTCGCC 
GTCTCCCCGG TGGTCATCAC CGCTCTCGCA CCCCACGGCC CGGCCGCCCT CTGGGGCAGC 
CTCGCCACCG CGACGCTCCT GTCCGCCTCC GCCGTCGCCA CCGAGAAGGA TCAAGGAACG 
CGGCTCGGCG GCGGCCGCCT TTCTCGCGTG CTCGCGGCCC GACTTCCAGG AGGGGCAGTT 
CCAGCCGCTG TCGCCGAACA CGCGGCGGCC GCCGCAGTGG GTGAGGGGAA GCGTCGCGAC 
GGGTAG

Protein sequence

MATTTKIRPR ALVRASGGPR YAVALAVDAL GTGLLRPFLL LYGVMVLRLS APATGIAMTV 
GAVVGLVCMP AVGRWLDRGA RSTVVAASML VRVLGVALLL ATPTGNVWLF ATAALFLGIG 
NQAWPAAHAA LVATVAHGRE RDAALAAGRA LRNAGLGAGA LLATACLAGG TTALQALAAV 
TGLTYLAAAV LAWSVHVHAH PAAAAAKDRD DEPAPRMRAL LAANVVYVFC LNVPEIALPL 
VLVTQMHASP VWSAAIFVAN TVLVVTLQVP ITVLMSRFSR RTVLALAGVV LTASYLGFLA 
ATSLGHGWGA PAILAVSVVC TIGEIIYAGS ATALVTVLAP AHLLGRALAR FQLSTGFGLA 
VSPVVITALA PHGPAALWGS LATATLLSAS AVATEKDQGT RLGGGRLSRV LAARLPGGAV 
PAAVAEHAAA AAVGEGKRRD G