Gene Franean1_5014 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Franean1_5014
Symbol
ID	5673352
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Frankia sp. EAN1pec
Kingdom	Bacteria
Replicon accession	NC_009921
Strand	-
Start bp	6008808
End bp	6010115
Gene Length	1308 bp
Protein Length	435 aa
Translation table	11
GC content	70%
IMG OID	641243868
Product	putative branched-chain amino acid transport system
Protein accession	YP_001509283
Protein GI	158316775
COG category	[E] Amino acid transport and metabolism
COG ID	[COG0683] ABC-type branched-chain amino acid transport systems, periplasmic component
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	19
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	15
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGCCGAATA CAGAGAATGT GGCCGCCGGG ATGCCCCGCA GGCGGTCGCG GCGACGCTCG 
GTGTCCACCC GCCTGGGCGT CCTGGCGGTG GCGGCGAGCC TGCTGCTCGC CGCCGGATGC 
GGCGGCGGCA GCGCGGACCC GTCGACGGAC GACAGCACCC CCAGCAGGGA CATCTCCGCC 
GTCCTCGGGC CGATCGCCGA GGCCAAGGGC GCGCCGGTGC GGATCGGGAT GATCTCGGAC 
GGCAAGGGTC CGGTGTCGGA CCTCTCCGTC GAGTTCGACA TGGCCAAAGC CACCGTCGGG 
TACCTGAACG AGCGCCGTTC CGGCATCGCG GGCCGGCCGA TCGAGCTGGT GACGTGCGAG 
GCCCTGGCCG ACCCGGCCAA GGGCACCGAC TGCGCGAACC GGATGGTCGA GGAAGATGTC 
GTCGCCGTCG TCGTCGGCTC CTCGTCGATC GTGGAGAGCA TCTGGCGGCC TCTGCACGAC 
GCTCGCGTGC CGGTGATGTT CCACTCCGCG AACGGCGCCC CGCTGCGGGA CAGCGAGTCG 
ACCTTCGCCA TCACCGACTC CGCCTTCTCG CTGATCAACT TCCCGATCCA GCTGGCGAAG 
GAGAAGGGCG CCGGGAAGGT GACAGCGGTC ACGATCGACG TGCCGTCCGC GACGGGCATC 
TACCGGACCG CCGCTCCGTC GGCGTTCGAC GAGGCCGGCA TCGAACTCTC GGTCGTGCCG 
ATCCCCCCGG GCACGGCCGA CATGATTCCG CAGATGCAGA ACATCGCCTC CGGCGACCCC 
GGCATCGTCG AGGTGACCGG AAACGACGCG TTCTGCATCG CCGCGTTCAA CGGTCTGCGG 
GCGGTCGGAT TCACCGGGAC GGTCACGGGC GTCTCGCAGT GCATCACTGA CAGGACCCGC 
AAGGCGGTGC CGGGCGATTT CCTGGAGGAC ATGCCCGTCC CCGCGACGGT GCCGCTCGGC 
ACGGACAACC CGGCGACCCA GCTGATCAAC GCGGTCGCGA CCACCTACGG CAAGGACGTC 
GACACCGGCC GCACGGCTGC GATGGCCATG TTCACGGTGT TCGCCGCCTT CCAGTCCGCG 
ACCGGGGAGA TCTCCGGCGA GGTCTCCCCG GAGACCATCA TCGCCGCGAT CAAGGGGATG 
CCGGAGAAGG AGCTGCCGGC CGCCGGGGGG CTGCGGTTCC GCTGCAACGG CAAGGCCGAC 
CCGGACCTGC CGGCGGTCTG CGTCCGCGGC GGGCTGGTGA CGACCCTCGA CGAGGAGGGC 
CAGCCCACCG AGTACGAGGT GATCGGCAGC ACCCCCATCG AGGACTAG

Protein sequence

MPNTENVAAG MPRRRSRRRS VSTRLGVLAV AASLLLAAGC GGGSADPSTD DSTPSRDISA 
VLGPIAEAKG APVRIGMISD GKGPVSDLSV EFDMAKATVG YLNERRSGIA GRPIELVTCE 
ALADPAKGTD CANRMVEEDV VAVVVGSSSI VESIWRPLHD ARVPVMFHSA NGAPLRDSES 
TFAITDSAFS LINFPIQLAK EKGAGKVTAV TIDVPSATGI YRTAAPSAFD EAGIELSVVP 
IPPGTADMIP QMQNIASGDP GIVEVTGNDA FCIAAFNGLR AVGFTGTVTG VSQCITDRTR 
KAVPGDFLED MPVPATVPLG TDNPATQLIN AVATTYGKDV DTGRTAAMAM FTVFAAFQSA 
TGEISGEVSP ETIIAAIKGM PEKELPAAGG LRFRCNGKAD PDLPAVCVRG GLVTTLDEEG 
QPTEYEVIGS TPIED