Gene BCG9842_B3476 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	BCG9842_B3476
Symbol
ID	7184240
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Bacillus cereus G9842
Kingdom	Bacteria
Replicon accession	NC_011772
Strand	+
Start bp	1727314
End bp	1728621
Gene Length	1308 bp
Protein Length	435 aa
Translation table	11
GC content	38%
IMG OID	643549576
Product	chlorohydrolase
Protein accession	YP_002445246
Protein GI	218896835
COG category	[F] Nucleotide transport and metabolism [R] General function prediction only
COG ID	[COG0402] Cytosine deaminase and related metal-dependent hydrolases
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	24
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	35
Fosmid unclonability p-value	0.00153187
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

TTGAAAACAA CTTATGTAAA CGCTACAATT GTAACGATGA ATGAACAAAA CGAAGTGATA 
GAAAATGGAT ATATCATTGT AGAAAATGAT CAAATTATAG ATGTAAAGAG CGGAGAATTT 
GCAAATGATT TTGAAGTAGA TGAAGTAATT GACATGAAAG GAAAGTGGGT TTTACCAGGG 
CTTGTAAATA CACATACACA CGTTGTAATG AGTCTCCTAA GAGGTATTGG AGATGATATG 
TTATTACAGC CATGGCTTGA GACGAGAATT TGGCCACTGG AAAGTCAGTT TACTCCAGAG 
CTTGCGGTTG CTAGTACGGA ATTAGGATTA CTTGAAATGG TGAAAAGTGG TACAACATCA 
TTCTCTGACA TGTTTAATCC AATTGGAGTA GATCAAGATG CAATTATGGA AACGGTATCA 
AGGAGCGGGA TGCGAGCTGC TGTTTCAAGG ACTTTATTTA GCTTCGGAAC GAAAGACGAT 
GAAAAGAAAG CGATTGAAGA AGCTGAGAAA TATGTGAAGC GTTATTATAA AGAAAGTGGC 
ATGTTAACTA CGATGGTTGC ACCACATAGT CCATATACAT GTAGTACAGA ACTGTTAGAA 
GAGTGCGCTC GTATTGCAGT AGAAAATCAA ACAATGGTTC ATATCCACCT TTCTGAAACA 
GAGCGTGAAG TACGTGATAT TGAAGCACAG TACGGAAAAC GTCCAGTAGA ATATGCAGCG 
AGCTGCGGGT TGTTTAAACG CCCAACAGTT ATTGCACACG GTGTAGTATT AAATGAAAAT 
GAACGTGCAT TTTTAGCAGA ACATGACGTT CGAGTAGCAC ATAATCCGAA TAGTAATTTA 
AAACTAGGAT CTGGTATAGC GAATGTAAAA GCGATGCTAG AAGCAGGAAT GAAAGTAGGA 
ATTGCAACAG ATAGTGTGGC ATCAAACAAC AATTTAGATA TGTTTGAAGA AATGCGTATA 
GCGACTTTAC TACAAAAAGG TATTCACCAA GATGCAACAG CTTTACCGGT TGAAACTGCT 
CTTACACTTG CGACTAAAGG AGCTGCTGAA GTAATCGGGA TGAAACAAAC AGGATCACTT 
GAGGTTGGAA AGTGTGCTGA TTTTATTACG ATTGACCCAT CTAATAAGCC GCATTTACAA 
CCAGCAGATG AAGTGTTATC GCACCTGGTA TATGCAGCTA GTGGAAAAGA TATAAGCGAT 
GTAATTATTA ACGGAAAGCG TGTCGTTTGG AATGGCGAAT GTAAAACGTT AGATGAAGAG 
CGTATTATAT TTGAAGCGAG TCGTTATAAA CGAGGTTTAC AAAGATAG

Protein sequence

MKTTYVNATI VTMNEQNEVI ENGYIIVEND QIIDVKSGEF ANDFEVDEVI DMKGKWVLPG 
LVNTHTHVVM SLLRGIGDDM LLQPWLETRI WPLESQFTPE LAVASTELGL LEMVKSGTTS 
FSDMFNPIGV DQDAIMETVS RSGMRAAVSR TLFSFGTKDD EKKAIEEAEK YVKRYYKESG 
MLTTMVAPHS PYTCSTELLE ECARIAVENQ TMVHIHLSET EREVRDIEAQ YGKRPVEYAA 
SCGLFKRPTV IAHGVVLNEN ERAFLAEHDV RVAHNPNSNL KLGSGIANVK AMLEAGMKVG 
IATDSVASNN NLDMFEEMRI ATLLQKGIHQ DATALPVETA LTLATKGAAE VIGMKQTGSL 
EVGKCADFIT IDPSNKPHLQ PADEVLSHLV YAASGKDISD VIINGKRVVW NGECKTLDEE 
RIIFEASRYK RGLQR