Gene Francci3_3244 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Francci3_3244
Symbol
ID	3904415
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Frankia sp. CcI3
Kingdom	Bacteria
Replicon accession	NC_007777
Strand	+
Start bp	3838808
End bp	3839875
Gene Length	1068 bp
Protein Length	355 aa
Translation table	11
GC content	69%
IMG OID	637880569
Product	protein-L-isoaspartate(D-aspartate) O-methyltransferase
Protein accession	YP_482330
Protein GI	86741930
COG category	[O] Posttranslational modification, protein turnover, chaperones
COG ID	[COG2518] Protein-L-isoaspartate carboxylmethyltransferase
TIGRFAM ID	[TIGR00080] protein-L-isoaspartate(D-aspartate) O-methyltransferase

Plasmid Coverage information

Num covering plasmid clones	23
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	12
Fosmid unclonability p-value	0.618843
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGAGCGTCC GCCGGGTGAA CCGCGAGGAT TTCATCCCGG ATGAGATCTG GGTCCGGGAC 
GAGGACGGGT TCTTCCTGGT CCCGCTCCGG CGCCAGGATG ATCCACAGCG GTGGTCGGAG 
CTGTGCCGCG GCGACGACGG GATCACGACG CAGGTCGACG ACGGGACGGG CAGGTACGAC 
GGTAGGGGCG TCATACCGAC CAGTTCCAGC AGCGCGCCGT GGGTCATGGC CCGGATGCTC 
GACCTCCTCG ATGTGCGGGA CGGGATGAAC GTCCTCGAGA TCGGTACCGG GACCGGCTAT 
AACGCGGCGC TGCTCGCCGA GCGGACCCCG ACCGGCCAGG TCACCACCAT CGAGATCGAT 
CCGGGAATCG CGGGGCACGC CCGCGCGGCC CTCGCCAGAA TCGGCCGTCC GGTGACGGTG 
GTCGTCGGGG ACGGCGCGGC GGGGTTTCCC GATCGGGCTC CCTACGACCG GATCATCGCC 
ACGGCGTCGG TGGTTACCGT TCCCTACCCC TGGATCACGC AGACCCGGCC GGGCGGGCGG 
ATCGTGCTGC CGTTCACGAG CGAGTTCGGT GGGGCGCTGC TGTCATTGAC CGTCGCGGAC 
GGCACCGCCT CGGGCCATTT TCATGATGAT GCGGGTTTCA TGCGGCTGCG CGGCCAACGG 
GCCGACAGAC CCGTCTGGTG GCTCGGCGAG GACGACGCCG ACGTCAGAAC AACCTGCCGG 
TATCTGGATG AGCCCTTCGC GGACGCCGCG GCCGGATTCG CGGTCGGCCT GTGGCTGCCC 
GGCTGCACCA CCGGGCAGAT CGAGGAAGGC GGCCCGGCGA GAACACTTCT GCTGTCCCAC 
GCGGCGTCAC ATTCGTGGGC GTCACTGACC GCCGGGTCGG ACGGGCAGTC GGACGGGCAC 
GAGGTCACCC AGTATGGGCC ACGACGGTTG TGGGACGAAC TCGAAATGGC CTACGACTGG 
TGGGTGAACG CAGGGCGGCC GTCCTGCGCC CGCTTCGGGC TCACCGTCAC CCCCGACGGT 
CAGACATCCT GGCTGGACTA CCCGGAGCGG GTCATCCCGG CCTCGTGA

Protein sequence

MSVRRVNRED FIPDEIWVRD EDGFFLVPLR RQDDPQRWSE LCRGDDGITT QVDDGTGRYD 
GRGVIPTSSS SAPWVMARML DLLDVRDGMN VLEIGTGTGY NAALLAERTP TGQVTTIEID 
PGIAGHARAA LARIGRPVTV VVGDGAAGFP DRAPYDRIIA TASVVTVPYP WITQTRPGGR 
IVLPFTSEFG GALLSLTVAD GTASGHFHDD AGFMRLRGQR ADRPVWWLGE DDADVRTTCR 
YLDEPFADAA AGFAVGLWLP GCTTGQIEEG GPARTLLLSH AASHSWASLT AGSDGQSDGH 
EVTQYGPRRL WDELEMAYDW WVNAGRPSCA RFGLTVTPDG QTSWLDYPER VIPAS