Gene A9601_11991 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	A9601_11991
Symbol	bioB
ID	4717913
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Prochlorococcus marinus str. AS9601
Kingdom	Bacteria
Replicon accession	NC_008816
Strand	+
Start bp	1015926
End bp	1016933
Gene Length	1008 bp
Protein Length	335 aa
Translation table	11
GC content	35%
IMG OID	640078915
Product	biotin synthase
Protein accession	YP_001009590
Protein GI	123968732
COG category	[H] Coenzyme transport and metabolism
COG ID	[COG0502] Biotin synthase and related enzymes
TIGRFAM ID	[TIGR00433] biotin synthetase

Plasmid Coverage information

Num covering plasmid clones	10
Plasmid unclonability p-value	0.496147
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGATAAATT CGAATAATCA GGTCTTAAGT GAAATTAGGT TCGATTGGAA TAAAAAGGAG 
ATATTAGAAA TTCTTAATAT GCCTCTGATC GATTTAATGT GGGAATCACA AATCGTTCAC 
AGGAAATTCA ACAGCTATAA CATTCAATTA GCATCATTGT TCAGCGTAAA AACTGGTGGA 
TGTGAGGAAA ATTGTTCATA TTGTAGCCAA TCAATTTATA GTGCTAGCGA AATAAAAAGT 
CATCCACAAT TTCAAGTTGA AGAGGTTTTA GCAAGAGCTA AAATAGCAAA AAATGAGGGT 
GCAGATAGGT TTTGTATGGG TTGGGCATGG AGAGAAATTA GAGATGGAAA ATCTTTTAAT 
GCAATGTTAG AGATGGTTAG CGGTGTAAGA GATTTAGGAA TGGAAGCATG CGTTACTGCT 
GGGATGCTTA CAGAAGAACA AGCTTCCCGA CTGGCTGATG CAGGTTTAAC AGCGTACAAC 
CACAATCTTG ATACTAGCCC TGAGCATTAT AAAAATATTA TTACGACAAG AACTTATCAA 
GACAGACTAG ATACTATCAA AAGAGTGAGA AATGCAGGAA TAAATGTTTG TTGTGGAGGA 
ATAATAGGCT TGGGTGAGAC TAATGGCGAT AGAGCATCTC TTTTGGAAGT GCTTTCAAAC 
ATGAATCCAC ACCCTGAAAG TGTTCCAATA AATTCATTAG TAGCTATTGA AGGTACTGGT 
TTAGAAGATA ATCAAGAAAT TGATTCTATT GAGATGATAA GGATGATAGC TACAGCCAGA 
ATTCTTATGC CTAAAAGTAA AATAAGATTA AGTGCAGGAA GAGAAAAGCT CTCAAAAGAA 
GCCCAAATCT TATGTTTTCA ATGCGGTGCA AATTCCATTT TTTACGGAGA TGAGTTACTC 
ACTACTTCAA ATCCATCTTT TCAGTCAGAC AGAAAACTTC TCAAAGAGGT TGGAGTATCA 
TTTAACAAAG ATTTTGAAAC TTGTGAAAAA ACATTATCTT CTTTATGA

Protein sequence

MINSNNQVLS EIRFDWNKKE ILEILNMPLI DLMWESQIVH RKFNSYNIQL ASLFSVKTGG 
CEENCSYCSQ SIYSASEIKS HPQFQVEEVL ARAKIAKNEG ADRFCMGWAW REIRDGKSFN 
AMLEMVSGVR DLGMEACVTA GMLTEEQASR LADAGLTAYN HNLDTSPEHY KNIITTRTYQ 
DRLDTIKRVR NAGINVCCGG IIGLGETNGD RASLLEVLSN MNPHPESVPI NSLVAIEGTG 
LEDNQEIDSI EMIRMIATAR ILMPKSKIRL SAGREKLSKE AQILCFQCGA NSIFYGDELL 
TTSNPSFQSD RKLLKEVGVS FNKDFETCEK TLSSL