Gene Sare_2811 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Sare_2811
Symbol
ID	5707003
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Salinispora arenicola CNS-205
Kingdom	Bacteria
Replicon accession	NC_009953
Strand	-
Start bp	3193200
End bp	3194426
Gene Length	1227 bp
Protein Length	408 aa
Translation table	11
GC content	66%
IMG OID	641272267
Product	cytochrome P450
Protein accession	YP_001537637
Protein GI	159038384
COG category	[Q] Secondary metabolites biosynthesis, transport and catabolism
COG ID	[COG2124] Cytochrome P450
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	23
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	5
Fosmid unclonability p-value	0.000999119
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGACTGAGC CGCGTATTCC GGCGGGATTC GACTTCACCG ATCCCGAGGT CCTGGCGCAC 
CGAGTGCCCC GGGAGGAGTT CGCCGAGCTT CGCCGGACCG CTCCGGTCTG GTGGAACGCC 
CAACCGAGGG GCTCGGCCGG CTTCGACGAC GACGGGTACT GGGTGGTGAC CCGCTACGCC 
GACGTGATGA CGGTGTCCCG GGACAGCGAC ACGTACTCGA CGCGGGAGAA CACCGCGATA 
GCCCGGCTCC GGCCGGACAC CACCCGCGAG GACATCGAGA TGCAGCGGGT CATCATGCTC 
AACGTCGACC CGCCGGAGCA CACCAAGCTG CGTGCCATCG TGTCCCGTGG CTTCACGCCC 
AGAGCAATCA ACGCACTACG CGGATCATTG GCGGAGCGGG CCGAGCACAT CGTGCGTGAC 
GCAGCCGTGC GTGGTGTCGG TGACTTTGTC ACCGACGTCG CTTGCGAGTT GCCACTGCAG 
GCGATCGCGG AACTGATCGG GGTTCCGCAA CACCACCGAC GCAAGGTCTT CGACTGGTCG 
AACCAGCTGA TCGGATACGA CGATCCCGCC TACGGAACGG ATCCACTGAC CGCCTCGGCC 
GAGCTACTCG CGTACGCCAT GGAGATGGCG GAGGAGCGGC AGCGCAGTCC GAGCGACGAT 
CTGGTGACCA AACTGGTCAA TGCGCAGATC GACGGTGAGC ACCTGACGAC CGACGAGTTC 
GGCTTCTTCG TGATGCTCCT GGCGGTCGCG GGCAACGAGA CGACCCGGAA CGCGATCACC 
CATGGCATGG TGGCCTTCCT CGACAACCCA GAACAGTGGG AGCTGTTCAA GGCCGAGCGC 
CCCAAGAGTG CGGTCGAGGA GATCATCCGC TGGGCCACCC CGGTGAACGT GTTCCAACGT 
ACCGCGTTGG TCGACACCGT GCTGGGGGGA CAGGCCATCT CCGCCGGCCA ACGGGTAGCG 
CTCTTCTACG GTTCGGCGAA CTTCGACGAG GCGGTGTTCG AGGATCCCGA ACGGTTCGAC 
ATCACCCGTA GCCCCAACCC GCACCTCGGG TTCGGCGGCA GCGGCGCGCA CTTCTGCCTG 
GGCGCGAACC TCGCCCGCCT GGAGATTGAG CTGATCTTCA ACTCGATCGC CGACCACCTG 
CCGGACATCC GCAAGGTGGC CGCACCGCAG CGGCTGCGGT CGGGCTGGAT CAACGGCATC 
CGGCAGATGC CGGTGCGGTA CCGCTGA

Protein sequence

MTEPRIPAGF DFTDPEVLAH RVPREEFAEL RRTAPVWWNA QPRGSAGFDD DGYWVVTRYA 
DVMTVSRDSD TYSTRENTAI ARLRPDTTRE DIEMQRVIML NVDPPEHTKL RAIVSRGFTP 
RAINALRGSL AERAEHIVRD AAVRGVGDFV TDVACELPLQ AIAELIGVPQ HHRRKVFDWS 
NQLIGYDDPA YGTDPLTASA ELLAYAMEMA EERQRSPSDD LVTKLVNAQI DGEHLTTDEF 
GFFVMLLAVA GNETTRNAIT HGMVAFLDNP EQWELFKAER PKSAVEEIIR WATPVNVFQR 
TALVDTVLGG QAISAGQRVA LFYGSANFDE AVFEDPERFD ITRSPNPHLG FGGSGAHFCL 
GANLARLEIE LIFNSIADHL PDIRKVAAPQ RLRSGWINGI RQMPVRYR