Gene SeD_A2369 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	SeD_A2369
Symbol	cobD
ID	6875148
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Salmonella enterica subsp. enterica serovar Dublin str. CT_02021853
Kingdom	Bacteria
Replicon accession	NC_011205
Strand	-
Start bp	2241889
End bp	2242848
Gene Length	960 bp
Protein Length	319 aa
Translation table	11
GC content	60%
IMG OID	642785461
Product	cobalamin biosynthesis protein
Protein accession	YP_002216119
Protein GI	198246159
COG category	[H] Coenzyme transport and metabolism
COG ID	[COG1270] Cobalamin biosynthesis protein CobD/CbiB
TIGRFAM ID	[TIGR00380] cobalamin biosynthesis protein CobD

Plasmid Coverage information

Num covering plasmid clones	18
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	78
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGACGATCC TTGCCTGGTG TATCGCCTGG GTGCTGGATT TTATCATCGG CGACCCTCAA 
CACTGGCCCC ATCCGGTACG CTGGATAGGC CGTTTAATCA CGTTTGTGCA GCGTATTGTG 
CGTCGCTATT GTCCCGGCGA TAAAGCGCTG CGGATTGGCG GCGGCGTAAT GTGGGTTGTG 
GTTGTCGGGG CGACCTGGGG CGTGGCATGG GGCGTACTGG CGCTGGCGCA GCGGATTCAC 
CCCTGGTTTG GCTGGAGCGT CGAAGTCTGG ATGATCTTTA CCACGCTGGC CGGACGCTCT 
CTGGCCCGCG CCGCACAGGA GGTTGAACGA CCGTTGCGGG AGAACGACCT TGCGGAAAGC 
CGAATAAAAC TCTCCTGGAT CGTCGGGCGC GATACGTCGC AACTTCAGCC AGCGCAGATC 
AATCGCGCTG TGGTGGAAAC GGTTGCAGAA AACACCGTTG ACGGCATTAT CGCGCCGCTC 
TTTTTCCTCT TTCTCGGCGG CGCGCCGCTG GCGATGGCCT ACAAAGCCGT CAATACCCTG 
GATTCAATGG TGGGCTACAA ACATGAAAAA TACCGGGCGA TTGGTATGGT CAGCGCCCGT 
ATGGACGACG TAGCGAACTA TCTTCCCGCC CGACTGAGCT GGCTGTTGCT GGGCATTGCG 
GCAGGACTGT GTCGCCTGAG TGGTTGGCGG GCGCTGCGTA TTGGCTGGCG TGACCGTTAT 
AACCACAGTA GCCCAAATTG CGCCTGGTCG GAAGCGTGTG TGGCCGGCGC CTTAGGTATC 
CAGCTCGGCG GCCCAAATAA CTACTTTGGC GAGCGTGTGG ACAAGCCCTG GATCGGCGAC 
GCGCAGCGCG ATATTTCCGT AGACGATATT TCCCGAACGA TTCGATTGAT GTGGGTCGCT 
TCAACCCTGG CGCTGGCGCT GTTTATTGCG GCGCGGTGCG GGTTATCTGG CGTGGCCTGA

Protein sequence

MTILAWCIAW VLDFIIGDPQ HWPHPVRWIG RLITFVQRIV RRYCPGDKAL RIGGGVMWVV 
VVGATWGVAW GVLALAQRIH PWFGWSVEVW MIFTTLAGRS LARAAQEVER PLRENDLAES 
RIKLSWIVGR DTSQLQPAQI NRAVVETVAE NTVDGIIAPL FFLFLGGAPL AMAYKAVNTL 
DSMVGYKHEK YRAIGMVSAR MDDVANYLPA RLSWLLLGIA AGLCRLSGWR ALRIGWRDRY 
NHSSPNCAWS EACVAGALGI QLGGPNNYFG ERVDKPWIGD AQRDISVDDI SRTIRLMWVA 
STLALALFIA ARCGLSGVA