Gene A9601_14051 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	A9601_14051
Symbol
ID	4718126
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Prochlorococcus marinus str. AS9601
Kingdom	Bacteria
Replicon accession	NC_008816
Strand	-
Start bp	1176105
End bp	1177313
Gene Length	1209 bp
Protein Length	402 aa
Translation table	11
GC content	32%
IMG OID	640079126
Product	hypothetical protein
Protein accession	YP_001009796
Protein GI	123968938
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	18
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGAATCTTA AATGTAGACA TTGTGGAAAA ACTCTAAATC ATGAAGTTAT TGATTTGGGC 
AACCAGCCTC CAAGTAATGC ATATTTGGAT AAAAATCAAA TATTGAGACC TGAAATTACG 
TATCCCTTAA AAGTCTATGC ATGTGAACAT TGTTGGTTAA TTCAACTTCC TGAACATGCC 
ACATCAGAGG AATTGTTCAC GCCAGATTAT GCTTATTTTT CAAGTACATC AACTAGTTGG 
TGTGCTCATG CTGAGAAATT TGTAAATGAA GCTGTCTCAG ATCATAATCT TTCGCAAAAA 
AGTTTTGTTG TTGAATTAGC AAGCAACGAT GGATATTTAT TGCAATATTT GAAATCTAGG 
GGAATACCTT GTTTAGGTGT TGAACCAACT AGAGCTGCTG CTGAAATCGC AAGATCTAAG 
GGGATTAATA CAATAGAAAG CTTCTTTGGC TTAGAAATGG CTAAGGATAT GGATAAGGCA 
GATCTTGTTA TAGCTAATAA TGTTTTAGCT CATGTACCTG ATATTAACGA TTTCATGGGG 
GGTATACATG AAGTTTTAAA GCCAAAAGGA AAAGCATCAA TTGAATTTCC CCACTTATTA 
AGAATGATAA AGGGGAAACA ATTCGATACT ATTTATCATG AACATTTTAG TTATCTAAGT 
CTTAGAACAG TTCAAAGAAT AGCTTCATCT GTTGGACTGG AAATATTCAA AGTTTCCGAA 
TTAAGTACTC ATGGAGGTAG TTTAAGGGTA TGGCTTTCCA AAAAAAATAA TTTTGAGATT 
GATTCTTCTG TTGAGAGAAT ACTAAATTTA GAGGTTCAAG AGGAATTAGA GTCTCTAAAA 
ATTTTTGAAG AATTTCGCGC GAGCGCCTTA AAAGCTAAAT ATCAATTCTT AGATTTTCTT 
ATAAAAGCTA AAAATAAAAA TAAAAAAATA ATGGCATATG GAGCCGCTGC AAAAGGTAAT 
ACTTTTTTAA ATTTTGCTGG AATAAAATCT GATTTAATAT CTTTGGTAGC AGATAAATCT 
ATTAGTAAAC AAAATAAGTT TATGCCTGGT AGTTTGATAC CAATTGTTTC ACCTAAAACT 
CTATTGAATG AGAAACCTGA TTCAATAATA GTTTTACCTT GGAATATTAT TTCAGAAATC 
AGATCTCAAT TAAAAAACCA TCAGCTTGTT ACTGCTATTC CGAATTTAAA GGTTTGGAAT 
AATTTATAA

Protein sequence

MNLKCRHCGK TLNHEVIDLG NQPPSNAYLD KNQILRPEIT YPLKVYACEH CWLIQLPEHA 
TSEELFTPDY AYFSSTSTSW CAHAEKFVNE AVSDHNLSQK SFVVELASND GYLLQYLKSR 
GIPCLGVEPT RAAAEIARSK GINTIESFFG LEMAKDMDKA DLVIANNVLA HVPDINDFMG 
GIHEVLKPKG KASIEFPHLL RMIKGKQFDT IYHEHFSYLS LRTVQRIASS VGLEIFKVSE 
LSTHGGSLRV WLSKKNNFEI DSSVERILNL EVQEELESLK IFEEFRASAL KAKYQFLDFL 
IKAKNKNKKI MAYGAAAKGN TFLNFAGIKS DLISLVADKS ISKQNKFMPG SLIPIVSPKT 
LLNEKPDSII VLPWNIISEI RSQLKNHQLV TAIPNLKVWN NL