Gene Bind_2573 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Bind_2573
Symbol
ID	6201032
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Beijerinckia indica subsp. indica ATCC 9039
Kingdom	Bacteria
Replicon accession	NC_010581
Strand	+
Start bp	2937112
End bp	2938152
Gene Length	1041 bp
Protein Length	346 aa
Translation table	11
GC content	55%
IMG OID	641706546
Product	cytochrome-c peroxidase
Protein accession	YP_001833660
Protein GI	182679514
COG category	[P] Inorganic ion transport and metabolism
COG ID	[COG1858] Cytochrome c peroxidase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	25
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	45
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGCAAATAC GTTTCCTAAC ATACATGTCG ATCGTAGCCT TATTGTTTTC AAGTACGACA 
CTTACGGCGG ATCCTTTACG CAATCACGTC AAAGACAAGT TCGCTGTTAT CCCCCACGAA 
CCGCCCAATT TGCCCGGCAA TCCGACGACG CCGCAAAAAC TGGCATTGGG CGAAATGCTG 
TTTTTCGATC CGCGCCTTTC GGTCAGTCAT TCCATAAGCT GCGCGAGTTG TCATAATCTG 
AGCCTCGCCG GCACGGATAA TCGCTCGCGC TCTTTGGGTA CAGCCTGGCA GCAAGGCGGT 
CGGAATGCAC CGACGGTTCT GAATTCGGTC TATAATTTCG TCCAGTTCTG GGATGGACGT 
GCCGCTGATC TCGCCCAGCA GGCTGGAGGG CCGATCCAGA ACCCGGTGGA AATGGGGTCG 
ACAGAGCAGA AGACCGTGGA TGTCCTGAAA GGTATTCCTG GCTATGTCGA TGCGTTCAAA 
GCCGCTTTTC CGGATCGGGA CGATGTCATC ACCTTCGACA ATGTCGAGAA GGCCATAGCC 
GTATTCGAGA CCATTCTCAC CACCCCCGAT GCACCTTTCG ATCGCTGGTT GCGCGGCGAT 
GACCGGGCTT TGACTCAAGA CCAGAAAGAA GGTTTGCGGC TCTTCGTCGA CAAGGGCTGT 
TCCAATTGTC ATAATGGCGT CAATATTGGT GGTGGGACCT ATGATCGTTT CGGTGTGGTG 
AAAGCGCCTT CCTCGGACAT TCGGCCCCCG GATGATCTCG GACGTGGCGC GATCACGCAT 
TCGGTAAGCG ATAATTATGT CTTCAAGGTT CCGACGCTGC GGAATATCGC CTTGACGGCT 
CCCTATTTCC ACAGCGGTCA GGTCTGGGAT CTGCGGCAAG CCGTCAAGAT CATGAGTGAC 
GTTCAGCTCG GGGTACAATT GACCGATACG GAAGCCAATC AGATCGTTGC TTTCCTGAAT 
TCCCTTACGG GCCGGCCTCC CTTCGTCCCC GCACCCGACC TGCCGCCGAC AGTTACAACG 
ACGCCCCGCC CCGTTCCTTA G

Protein sequence

MQIRFLTYMS IVALLFSSTT LTADPLRNHV KDKFAVIPHE PPNLPGNPTT PQKLALGEML 
FFDPRLSVSH SISCASCHNL SLAGTDNRSR SLGTAWQQGG RNAPTVLNSV YNFVQFWDGR 
AADLAQQAGG PIQNPVEMGS TEQKTVDVLK GIPGYVDAFK AAFPDRDDVI TFDNVEKAIA 
VFETILTTPD APFDRWLRGD DRALTQDQKE GLRLFVDKGC SNCHNGVNIG GGTYDRFGVV 
KAPSSDIRPP DDLGRGAITH SVSDNYVFKV PTLRNIALTA PYFHSGQVWD LRQAVKIMSD 
VQLGVQLTDT EANQIVAFLN SLTGRPPFVP APDLPPTVTT TPRPVP