Gene Rsph17029_1044 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rsph17029_1044
Symbol
ID	4895528
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Rhodobacter sphaeroides ATCC 17029
Kingdom	Bacteria
Replicon accession	NC_009049
Strand	-
Start bp	1078119
End bp	1079228
Gene Length	1110 bp
Protein Length	369 aa
Translation table	11
GC content	70%
IMG OID	640111631
Product	hypothetical protein
Protein accession	YP_001042927
Protein GI	126461813
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	9
Plasmid unclonability p-value	0.0461825
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	19
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAATGCCG ACAAGATCGA ACGTGAAGTG GAAGAGAACC GCGCGCGAGT CGAAAGCACT 
CTCGACGCGC TGAAGGAGCG GATGTCCGTC AATCAGGTCG TCGACGATCT CGCGAATTTC 
GTGGGCGTCG AGGATCTGCG GGGCGTGATG CATTCCGCCG GCCGGCAGGT GCGCGACAAT 
CCGGTTGCTC TGGGCCTCAT CGGAGTGGGT CTGGCGTGGC TCGCTTTCGG CGGCTCCTCG 
AGCCGCTCGC GCCATGTCAG CGCCTACGAC CGCGAGGAAT ATTACCGGAG CGACTACGGC 
CCCGCCGGCC GGTCCTACGA GCCCTATGGC GGCGGCGCCT CCTATCGTTC GGACCGGGGC 
GAGGGCGTGG TCTCGCGCGT CAAACATGCG GTGAGCGACG CCGCCGACAG CGTGAGCCGC 
GCGGCCCATT CCGCGACGGA CAAGGTTGCC GAAACTTTCG GCGACGCGCG TGACCGCGCG 
GGCAGCCTGC GCGACGATGT CTACGACCGC GCCGGCCGGA TGCGCGAGGA TGCCTATGAT 
CGTGCCGGCC ACTGGCGCGA CGATCTCGGC GAGCGGTCGT CGCACCTGCG CGACCGTGCC 
GGGCATCTGC GCGACCGCGC GTCCCACGGG GCGCATCAGA TGCGCGACAG CATGAGCCAC 
GGCATGGAGC AGCAGCCCCT GCTCGTGGGT GCCGCGGCCG TGGCGCTCGG CGCCGTGATC 
GGGGCCGCGC TTCCCCGGAC GCGCACCGAG GACGAGTGGA TGGGCCGCAG CAGCGACGAG 
CTCTGGGACG AGGCGAAGGC TTCGTCGTGG GAGCTGCGCG AGCGGGCGAT GAAGGCCGCG 
CGCGAGACCT ACGACGCCAC CATCGCCGCG GCGCGCGACG AGGGTCTGGT GCCCGAAAAG 
GGCGAGACGC TGGCCTCGAA GGTGGGACGC GTCGCGGATG CGGCGGCCAG CGAGGCGAAG 
GCTCAGGTGG AGCCCGTGCT GCACGGCAAG GACGAGGACA AATCCTCGAC CGGCATGTCC 
TCGGCTGGCG CGGGTTCGAC AGGCTCGACC GACTCCACGA CCAAGGGTCC CGGCACGTCC 
GGCCCCAAGG TTGCAGGCTC GGGCTTCTGA

Protein sequence

MNADKIEREV EENRARVEST LDALKERMSV NQVVDDLANF VGVEDLRGVM HSAGRQVRDN 
PVALGLIGVG LAWLAFGGSS SRSRHVSAYD REEYYRSDYG PAGRSYEPYG GGASYRSDRG 
EGVVSRVKHA VSDAADSVSR AAHSATDKVA ETFGDARDRA GSLRDDVYDR AGRMREDAYD 
RAGHWRDDLG ERSSHLRDRA GHLRDRASHG AHQMRDSMSH GMEQQPLLVG AAAVALGAVI 
GAALPRTRTE DEWMGRSSDE LWDEAKASSW ELRERAMKAA RETYDATIAA ARDEGLVPEK 
GETLASKVGR VADAAASEAK AQVEPVLHGK DEDKSSTGMS SAGAGSTGST DSTTKGPGTS 
GPKVAGSGF