Gene A9601_12251 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	A9601_12251
Symbol
ID	4717940
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Prochlorococcus marinus str. AS9601
Kingdom	Bacteria
Replicon accession	NC_008816
Strand	-
Start bp	1042760
End bp	1043869
Gene Length	1110 bp
Protein Length	369 aa
Translation table	11
GC content	39%
IMG OID	640078942
Product	porin
Protein accession	YP_001009616
Protein GI	123968758
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	10
Plasmid unclonability p-value	0.624505
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGAAGCTTT TTAAAAGCTT GTTAGTAGCT CCAGCAACTA TTGGTCTACT AGCTCCATTA 
TCTACGTTTG CTGGCGAGGC AGACCTAAAT AATATCTCAA AATACTCTGA TCTAGAGCAT 
ATTGATCTAG CCAATGCTTT TGTAAATGAT GAACTAAATC ATGACTCTTT ACTTGCAGGT 
GGAGAAGGTT TAGTTGATGA TCATAGTCAT GATGGCAGTT TCTCAGAAAC AACTTCTGCA 
TCCTTCAGCG TTGATGCTGT TTTAGGTGCT ATCGACGGTG CAACTAGCGA AACAACAAGT 
CTTGACTACC AATTCAACAT TGGTTTATCA ACAAGTTTTA CAGGTGAAGA TTCACTAGAT 
ATTACTATTG ACAGTGGTAA TTCAGCAGCA TCAGTTCTAA GTAAAGCAAT GGGCTTCGAC 
GAAGGAACTA AATTAAATGT TGATGGTGTA ACTTACACAT TCCCTGTTGG TGGAGCAACA 
ATGATCGTTG GTGATGCAAC TGACATCAGT GCTTCATTTA CAGGAGCTTG TCTTTACAGT 
GCATTTACTG ATTACACCCC AGACGACTGT GGAACAGGTA ATTCTCTAGG TGTAACTGGT 
AAAGCTGTTA CAGCATCTAT AAGTTATGCA TTTGATAATG GTTTCTCAGT AGCTGGTGGA 
ATTTCTTCTC CTGAAGATGA AATCTTAGGT GATTCATCTG ACATATACGG TCTTAATGCT 
GCTTATACAA CAGACACTTA CGGATTAGCT GTTGGATATT CTACTGATGA TGGTGGAACA 
GGCGCTGAGA CAACAACTTG GGGTTTCCAA GGTTACTACA GTTTTGATTT AGCAGACTTA 
AGTGTTGGTT ACGAAACTCA AGATGATGGT TCAGATGATA AAACTGGATA CTTCGTTGGT 
TTAACTTTCT CTGACGTTGG CCCTGGTACA GTAAACGTTG CTGCTGCAAC TACAGGACTC 
TTTAAAGATA CTGAGTCTGA GAAAATGATC TATGAAGCAT CTTACTCTTA TCCAGTAAAT 
GATGGCATGA CTATTACACC TGGTGTATTT ATCGTAGAAG ATACTACTGA TGACACAGGC 
GTAGCTGTTA AAGCATCATT CTCTTTCTAA

Protein sequence

MKLFKSLLVA PATIGLLAPL STFAGEADLN NISKYSDLEH IDLANAFVND ELNHDSLLAG 
GEGLVDDHSH DGSFSETTSA SFSVDAVLGA IDGATSETTS LDYQFNIGLS TSFTGEDSLD 
ITIDSGNSAA SVLSKAMGFD EGTKLNVDGV TYTFPVGGAT MIVGDATDIS ASFTGACLYS 
AFTDYTPDDC GTGNSLGVTG KAVTASISYA FDNGFSVAGG ISSPEDEILG DSSDIYGLNA 
AYTTDTYGLA VGYSTDDGGT GAETTTWGFQ GYYSFDLADL SVGYETQDDG SDDKTGYFVG 
LTFSDVGPGT VNVAAATTGL FKDTESEKMI YEASYSYPVN DGMTITPGVF IVEDTTDDTG 
VAVKASFSF