Gene A9601_03471 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	A9601_03471
Symbol
ID	4717036
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Prochlorococcus marinus str. AS9601
Kingdom	Bacteria
Replicon accession	NC_008816
Strand	-
Start bp	317130
End bp	318386
Gene Length	1257 bp
Protein Length	418 aa
Translation table	11
GC content	29%
IMG OID	640078051
Product	HD superfamily phosphohydrolase
Protein accession	YP_001008742
Protein GI	123967884
COG category	[R] General function prediction only
COG ID	[COG1078] HD superfamily phosphohydrolases
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	11
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGAGTATTA AAAGAATTTT TCATGACCCA ATTCATAAAG AAATAGTATT TGATGCAGGA 
AAGCCAGAAG AATTAATGAT TTTGGAATTA ATTGATACAG TCGCTTTTCA AAGACTAAGA 
AGAATAAAAC AACTTGGAGC GGCATCATTA CTTTTTCATG GTGCAGAATC GAGTAGATTT 
ACTCACTCAA TTGGTGTTTT TTGTATAGCT AGAAAAATTT ATAAGAGATT AATTGAAAAT 
AAATCTTCTT TTAGTGAAAA TAAATTTGTT CTTTATGGAG CAGCTCTGCT ACATGATTTA 
GGTCATGGAC CTTTAAGCCA TACCAGTGAA ACAATATTCA TGCATGATCA CGAACAATGG 
TCTGAAAACT TAGTGACAAA TTATTCTCCA ATAACTTCAA TCCTCAAAAA GTATGACAAC 
GAATTACCCA GAAAAATTGG TGAATTATTT CAATCAAAAC AACTATTTTC AAAACCTTTA 
AGAACATTGA TAAGTAGTGA GATAGATTGT GATCGTCTTG ATTATCTTTT ACGCGATAGT 
TACAACACAG GGACTAATTA TGGCTTAGTA GATTTAGAAA GAATAATTTC AGCTCTTACC 
TTTTTACCTG ATGGAAATAT CGGAATCAAA CCAAAAGGAG TGATTGCCAT TGAGCATTTC 
CTTGTACTTA GAAACTTGAT GTATAGAACA ATCTACAATC ACAAGATAAA CGAAATATCA 
ACATGGATTC TGGGGAAAAT ATTACACACA ATAAAACATA ATTATGAAAA TAATATTTGG 
TTAGATAATT CTCTACATAA ATGGATTTTT TCACCATCAA AAGTTGATTT TGATGATTTC 
ATAAGAAATG ATGATGTAAC CTTTTATTAT CATTTAATCA GATGGAAAGA TGAATCTTTT 
GAACCACTTT CTACACTATG CAAAATGTTT ATTGACAGGG ATTTATTAAA GGCATCAGAC 
ATTAGTTTTT TAAGTAAGAT CAATAGATTA AAAATCCTTG CATTTGCCAC AAAATTATGT 
GAAAAGAATG GTTATGATTC AGAAATATTT TGTGGGATTA AGGAAAGGTC TTTCAAAGGT 
TTTGAATCTA ATAATGCTCT AAAAATATGG GACGGCACTT ATCAAAGCGC ATTAGAAAAT 
AGTTCCGCAT TAATAAAAAC TTTAATGAGA TCCGATGAAA GCTCTTTTAT TATTTATCCA 
GATATGATCA AAAATGAAAT CAAAAATGAA ATTTCATCGA TAAAAAACAA TTTCTAG

Protein sequence

MSIKRIFHDP IHKEIVFDAG KPEELMILEL IDTVAFQRLR RIKQLGAASL LFHGAESSRF 
THSIGVFCIA RKIYKRLIEN KSSFSENKFV LYGAALLHDL GHGPLSHTSE TIFMHDHEQW 
SENLVTNYSP ITSILKKYDN ELPRKIGELF QSKQLFSKPL RTLISSEIDC DRLDYLLRDS 
YNTGTNYGLV DLERIISALT FLPDGNIGIK PKGVIAIEHF LVLRNLMYRT IYNHKINEIS 
TWILGKILHT IKHNYENNIW LDNSLHKWIF SPSKVDFDDF IRNDDVTFYY HLIRWKDESF 
EPLSTLCKMF IDRDLLKASD ISFLSKINRL KILAFATKLC EKNGYDSEIF CGIKERSFKG 
FESNNALKIW DGTYQSALEN SSALIKTLMR SDESSFIIYP DMIKNEIKNE ISSIKNNF