Gene Franean1_1960 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Franean1_1960
Symbol
ID	5670361
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Frankia sp. EAN1pec
Kingdom	Bacteria
Replicon accession	NC_009921
Strand	-
Start bp	2356374
End bp	2357567
Gene Length	1194 bp
Protein Length	397 aa
Translation table	11
GC content	72%
IMG OID	641240881
Product	acetyl-CoA acetyltransferase
Protein accession	YP_001506303
Protein GI	158313795
COG category	[I] Lipid transport and metabolism
COG ID	[COG0183] Acetyl-CoA acetyltransferase
TIGRFAM ID	[TIGR01930] acetyl-CoA acetyltransferases

Plasmid Coverage information

Num covering plasmid clones	10
Plasmid unclonability p-value	0.201942
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	13
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGGAGAACG CAGTCATCGT CGACGTCGTG CGCACCCCCT CAGGGCGGGG CAAGCCGGGC 
GGCGCGCTGT CCGAGACCCA CCCCGTGGAG CTTCTCGCCA CGACGCTGAA GGCGCTGACC 
AGCCGGAACG ACTTCGACCC GGCGCTCATT GACGACGTCA TCGCCGGGTG CGTCGGCCAG 
GCCGGTGAGC AGTCGGCGAA CATCGGCCGC AGTGCGGTGC TCTCCGCCGG CTACCCCGAG 
TCGGTGCCGG CGACCACCGT CGACCGGCAG TGCGGCTCCA GCCAGCAGGC GCTGCACTTC 
GCCGCGCAGG GCGTGATGGC CGGTGCCTAC GACGTCGTGG TGGCCTGTGG CGTCGAGTCG 
ATGAGCCGGG TCCCGATGCG CTTCGCGGCG GCGGGGAAGG ACCCACGCGG GCCGGGCATG 
ATCGCCCGCT ACCCCGAGGG CCTGGCCAAC CAGGGCATCG GCGCCGAGCT GATCGCCGCC 
CGCTGGAAGC TGACCCGCGA GGAGCTCGAC GAGTTCTCCG CGCTGTCGCA CCAGCGGGCC 
GCGGCGACGG CCGAGGCCGG CGGCTTCGAC AACGAGATCG TCCCCGTCGA GGCGCTCGCG 
CCGGACGGCA GCACGTTCAC GCACACCGTC GACCAGACCG TCCGGCCGAC CACCACGGCC 
GAGGGTCTCG CGGCCCTCAA GCCGTCCTTC TACACCGAGC AGTTCGCGCA GCGGTTCCCG 
GAGATCGGCT GGCACATCAC CCCGGGCAAC TCCTCCCCGC TGACCGACGG CGCGTCCGCC 
GCTCTGATCA TGAGCGAGTC GAAGGCCGTC GAGCTCGGGC TGCGCCCGCG GGCCCGCTTC 
CACGCCTTCG CCCTCGCCGG TAGCGAGCCG CTGATCATGC TGACCGGCCC GGCCCCGGCC 
ACCCGCAAGA TCCTCGCCCG GTCCGGCCTG CGGATCGACG ACATCGACGC CTACGAGGTC 
AACGAGGCGT TCGCGTCCGT CCCGCTGTTC TGGGCGAAGG AGTTCGACGC CGACCCGGCC 
AGGCTCAACC CACGCGGTGG TGCGATCGCG CTGGGCCATC CGCTGGGCGG CTCGGGCGTC 
CGTCTGATGG CGACGATGGT CAACTACCTG GAGGCCACCG GCGGGCGCTA CGGCCTGCAG 
ACCATGTGTG AAGGTGGCGG CATGGCCAAC GCCACCATCA TCGAACGCCT CTGA

Protein sequence

MENAVIVDVV RTPSGRGKPG GALSETHPVE LLATTLKALT SRNDFDPALI DDVIAGCVGQ 
AGEQSANIGR SAVLSAGYPE SVPATTVDRQ CGSSQQALHF AAQGVMAGAY DVVVACGVES 
MSRVPMRFAA AGKDPRGPGM IARYPEGLAN QGIGAELIAA RWKLTREELD EFSALSHQRA 
AATAEAGGFD NEIVPVEALA PDGSTFTHTV DQTVRPTTTA EGLAALKPSF YTEQFAQRFP 
EIGWHITPGN SSPLTDGASA ALIMSESKAV ELGLRPRARF HAFALAGSEP LIMLTGPAPA 
TRKILARSGL RIDDIDAYEV NEAFASVPLF WAKEFDADPA RLNPRGGAIA LGHPLGGSGV 
RLMATMVNYL EATGGRYGLQ TMCEGGGMAN ATIIERL