Gene Noc_1575 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Noc_1575
Symbol
ID	3705794
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Nitrosococcus oceani ATCC 19707
Kingdom	Bacteria
Replicon accession	NC_007484
Strand	-
Start bp	1748846
End bp	1750342
Gene Length	1497 bp
Protein Length	498 aa
Translation table	11
GC content	54%
IMG OID	637738055
Product	Sodium/proline symporter
Protein accession	YP_343584
Protein GI	77165059
COG category	[E] Amino acid transport and metabolism [R] General function prediction only
COG ID	[COG0591] Na+/proline symporter
TIGRFAM ID	[TIGR00813] transporter, SSS family [TIGR02121] sodium/proline symporter

Plasmid Coverage information

Num covering plasmid clones	14
Plasmid unclonability p-value	0.0675536
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGATAGTCA CTTTTATCAT TTACCTCGCC GTCATGCTGC TGCTTGGCCT GCTGGCCTAC 
GTCCGGACCC GGGATTTATC CGACTATATC CTTGGGGGCC GCAAGCTCGG AAGTTGGACC 
ACTGCCTTGA GTGCAGGGGC TTCTGACATG AGTGGTTGGC TCCTTTTGGG ACTACCTGGC 
TACGCTTATC TTCATGGCTT GGAAGCTGGC TGGATTGCCC TCGGTTTATG GTTGGGCACC 
TATGGCAACT GGCGCCTGGT GGCTGCCCGG TTGCGGGCCT ATTCCACGGC TGCTGGAGAT 
TCACTCACCT TGCCGGAATT TTTGGCTCAG CGCTTTCATG ATCATCGCCA TCTGCTACGC 
TGCGTTGCGG CAGCTTTCAT TCTGATTTTT TTCTTGTTTT ATACCAGTGC AGGCTTGGTG 
GCGGGGGGAA AACTGTTCAA CGCCGTCTTC GGTCTACCCT ATACGTGGGC CGTAACCGCC 
GGTACCCTGG CCATTATGAG CTATACTTTC GTCGGGGGAT TTCTCGCCGT CTCCTGGACC 
GACCTGGTGC AGGGCCTATT GATGCTGCTC GCCCTGCTCG CCGTTCCTGT GGTCGCCATT 
CTCCACCTGG GGGGCTGGCA GGCCACCTTG GCCGGCATTG ATGCTGAACG GCTCTACCTG 
TTTGTAGCGA CGACCGATGA GCCCCTAGGG GCTATCGCTA TTCTCTCCCT GCTAGGATGG 
GGGTTAGGGT ATTTCGGCCA ACCTCATATT CAGGTTCGTT TCATGGCCAT TCATTCCCTT 
AACGCCGTGC CCCAGGCGCG GCGGATCGCC ATGGGTTGGG TGACCCTGAC CTTAATCGGC 
GCCCTCTTGG TGGGAATTAC GGGAGCCTCC TTCTTACATC CACCCCTTTC CACGGCTGAC 
AGCGAAAAAG TATTCATTGA AATGGTCAGT ATCCTCTTCC ACCCCTTGCC TGCCGGAGTC 
CTACTAGCCG CTATCCTGGC AGCTATAATG AGCACCACCG ATTCCCAACT ATTGGTCTGC 
TCGGCGGTAT TTACCGATGA CTTTTATAAA GCCCTCCTGC GCCATCAAGC AAGTGCTCGG 
GAATTGGTCT ATGTGAGCCG GGCCACCGTC GTCATCATTG CTTCCCTGGC ATTATGGCTA 
GCCCTCGATC CGGAAAGCCA AGTTTTGGAA CTAGTGGCCT ATGCCTGGGC TGGGTTTGGC 
GCTGCTTTTG GCCCCACCCT CCTCATGGCC CTTTACTGGA AACGAATGAC CCGACAAGGA 
GCACTAGCTG GAATTATCGT GGGAGGAATG ACGATTTTAT TATGGAAGCA GTTAAACGGG 
GGAATTTTTG ACCTCTACGA ACTGGTGCCC GGCTTTATTT TCTCAGCTAT CGCCATTGTC 
GGCGCTAGTT TGCTAAGCAC CGCCCCTGGA ATCGAGATCG AACGGCAATT TAATGCGATT 
GCTAACAATA CCAAGCCTTT TAATACAAAC AATAATACTG AGGATCGCCA AACCTAA

Protein sequence

MIVTFIIYLA VMLLLGLLAY VRTRDLSDYI LGGRKLGSWT TALSAGASDM SGWLLLGLPG 
YAYLHGLEAG WIALGLWLGT YGNWRLVAAR LRAYSTAAGD SLTLPEFLAQ RFHDHRHLLR 
CVAAAFILIF FLFYTSAGLV AGGKLFNAVF GLPYTWAVTA GTLAIMSYTF VGGFLAVSWT 
DLVQGLLMLL ALLAVPVVAI LHLGGWQATL AGIDAERLYL FVATTDEPLG AIAILSLLGW 
GLGYFGQPHI QVRFMAIHSL NAVPQARRIA MGWVTLTLIG ALLVGITGAS FLHPPLSTAD 
SEKVFIEMVS ILFHPLPAGV LLAAILAAIM STTDSQLLVC SAVFTDDFYK ALLRHQASAR 
ELVYVSRATV VIIASLALWL ALDPESQVLE LVAYAWAGFG AAFGPTLLMA LYWKRMTRQG 
ALAGIIVGGM TILLWKQLNG GIFDLYELVP GFIFSAIAIV GASLLSTAPG IEIERQFNAI 
ANNTKPFNTN NNTEDRQT