Gene Sare_0383 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Sare_0383
Symbol
ID	5705078
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Salinispora arenicola CNS-205
Kingdom	Bacteria
Replicon accession	NC_009953
Strand	-
Start bp	443179
End bp	444660
Gene Length	1482 bp
Protein Length	493 aa
Translation table	11
GC content	66%
IMG OID	641269908
Product	hypothetical protein
Protein accession	YP_001535303
Protein GI	159036050
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	19
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	9
Fosmid unclonability p-value	0.0788229
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAACCACC GGTACCACAC CCACGAACCC GACCGCCCCG ATCGGAACCT GGCAACGTCA 
CGGCGGCGGT GGTGGGTCGC GGGGCTGGCC GGCACGACCG GCTTGGCCCT CGCCACCACC 
ATCGCCCCCG CCCCCACCCC CGCCTCTGCC GCCTCCGCCT CCGCCGCAGC CGCCTCCGCC 
GCAGCCGCCT CCGCCGCAGC CGCTGCCGCT GCCGCTGCCG CTGCCGCTGC CGAACGCACG 
ATCCCCGTCC CCTTCACCGT GGCCGACAGC CGGACCGCGA AACCCCCCGC CGACAGCTAC 
CGCGGCGAAG CCAAGCACGA CGACAAGGGC AAGGGCACCA AGGGCCAGGC CGGCAAGGGC 
AAGGAAAGCA CCAGAGCAGT TCTCGTCCCC TGCGATGCGG ACCGGTTGAT CACCGCGATC 
ACCCTCGCCA ACGCCCGCGG CGGTGCCGTG CTCAACCTCG CCAAGAAGTG CGCCTACACC 
CTCACCGCCG ACCTCGGCGG CGCCGGCCTA CCCGCCATCA CCGCCCCCAT CACCCTCAAC 
GGCGGTACAC ACACCACCAT CACCCGCGCC GCCGCCGCGC CCCAGTTCCG CATCATCACC 
GTCGACACCG GCGGCGACCT CACCCTCAAC CACCTGACCA TCACCGGCGG ACAGACCACC 
GACGACGGTG GGGGAATCCT CGTCAACCAG GGTGGAGCGT TGACCACCAA CCACAGCACC 
ATCACCCGCA ACATCACCAG TAACAACGGC GGCGGGATCA GCTCCAACGG CACCGTCCAC 
ATGAAAACCT CTACTGTTAG TCACAACACC GCGGATTCGA TCGCCGCGGG AATCCTGAGC 
CTCGGCATCC TCGACATCAG CAAATCCCAG GTACATGCCA ACACTGCCGT CGCCGGCGGA 
GCCGGAGTTA TCGCCTTCGG CGCAACCCGA ATCAAGCACA GTAGTATCAC CGCCAACCAC 
GGCCAGAACG GAACCGTCGG TGGCCTCTTC GTCAGCGGCA CCGGCACCGT TACGGACAGC 
AATATTTCGG GTAACACGGC CCTTGAGGCT GCCGGCGTAC TCACCGACAC CAGCACGCAG 
CTGACACTCC GATCCGTCAC CCTCGCTGAC AACACCGCCG TGGCAGGCGT AGGGGGCGGT 
CTGGCAATAA ACCCAGGTTC CTCCGTCGTC ACCGAAGGCG GCATCATCGC GAACAACACC 
GCCACCACCG AAGGCGGCGG CATCTTCAAC CTTGGCGAGC TGGTGTCGCG AAACACCAAG 
GTCATAGGCA ATCGATCCGA CCTGGGCGGC GGCATCTCCA ATGCCTCCAA TACCGCAACG 
GCCAACCTAT TCGGCACACA GGTGATCAAG AACATCGCCA TCACCGACGG GGGAGGCATC 
GTCAACAATG GCGGCACGGT CGAGCTGAAC ACCGCGACCG GGACCATCGT GGTCAAGAAC 
CGACCCAACA ACTGCGTCGG CGTTCCAGAA TGCTCCGGTT AG

Protein sequence

MNHRYHTHEP DRPDRNLATS RRRWWVAGLA GTTGLALATT IAPAPTPASA ASASAAAASA 
AAASAAAAAA AAAAAAAERT IPVPFTVADS RTAKPPADSY RGEAKHDDKG KGTKGQAGKG 
KESTRAVLVP CDADRLITAI TLANARGGAV LNLAKKCAYT LTADLGGAGL PAITAPITLN 
GGTHTTITRA AAAPQFRIIT VDTGGDLTLN HLTITGGQTT DDGGGILVNQ GGALTTNHST 
ITRNITSNNG GGISSNGTVH MKTSTVSHNT ADSIAAGILS LGILDISKSQ VHANTAVAGG 
AGVIAFGATR IKHSSITANH GQNGTVGGLF VSGTGTVTDS NISGNTALEA AGVLTDTSTQ 
LTLRSVTLAD NTAVAGVGGG LAINPGSSVV TEGGIIANNT ATTEGGGIFN LGELVSRNTK 
VIGNRSDLGG GISNASNTAT ANLFGTQVIK NIAITDGGGI VNNGGTVELN TATGTIVVKN 
RPNNCVGVPE CSG