Gene Franean1_2301 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Franean1_2301
Symbol
ID	5670700
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Frankia sp. EAN1pec
Kingdom	Bacteria
Replicon accession	NC_009921
Strand	-
Start bp	2750963
End bp	2752060
Gene Length	1098 bp
Protein Length	365 aa
Translation table	11
GC content	72%
IMG OID	641241221
Product	Pectate lyase
Protein accession	YP_001506642
Protein GI	158314134
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	12
Plasmid unclonability p-value	0.452858
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	13
Fosmid unclonability p-value	0.747236
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGGCACGCC GAACAAGCAC CAGACACACG TACCGGGGGG AATCGACCTC GAGCGGGGAG 
GCGGCACCGG CCGGCCCGGC ACGCAGAGCA CGTCCACGGG CCGGGTGGGG CGTCCCCGTC 
CTGATGGCGA CGCTGGCCCT CGGGGCCGGC ACACTGTTCG CCGGGTGCCA GCCGTTCGAC 
GGCACCCCGG TGGGTGGCGG GGGCGCTCCG GCACCGACGT CCTCGCCGAC CGCGGGCCCG 
ACCGCTCCGG TCACGCAGAC ACCGACAGCC GGGCCGGGTA GCCCGTCGCC GGCGGCGCCG 
CCGGTCACCG CGACGCCGAG CGCCGGAACG TCTGCTCCCG CGAGCCCGAC CACGGCACCG 
ACCGCAGGGC CGACGACCTC CGCGAGCCCG GGCGCGCCCG CGTCGCAGGG GCCGCTGCCG 
AGCTGGCCGC GCGCCACCGC GGACGTGGAC GTCAGCAGCA CCATCTCGGT GGCGGGCACG 
TTCGACGGCG GCCTCAAGCG TTACTCCGGC GTCAGCGACA GCGGCCAGGA GGAGGGCCAG 
GACCCGATCT TCGAGGTGGC CGACGGCGGA ACGGTCCAGA ACGTGATCAT CGGGTCACCG 
GCTGCGGACG GCATCCACTG CAAGGGCACC TGCACCCTGC GCAACGTGTG GTGGGAGGAC 
GTCGGCGAGG ACGCGGCGAC GTTCAAGGGC ACGTCCGCGG CACAGACCAT GACCATCGAC 
GGCGGCGGGG CCCGCGGCGC CTCGGACAAG GTGTTCCAGC ACAACGGGCC CGGCACGATG 
GTCATCCAGA ACTTCCAGGT GCAGGACTTC GGCAAGCTGT ACCGGTCGTG CGGGAACTGC 
TCGAAGCAGT ACGCCCGGCA CGTCGTCGTC CGCAACGTCA CCGTGACGGC GCCGGGCAAG 
ACGCTGGTCG GCGTCAACAC GAACTACGGG GACTCCGCCC AGCTGTCCGG CGTCACCATC 
GTCGGCGACA GCAGCCGGAA GATCAGTATC TGCGACCGCT ACACCGGCAA CAGCAGCGGC 
TCCGAGCCGA CGAAGACGGG CAGCGGGGCG GACGGGACGT ACTGCCGCTA CACGCCGTCC 
GACATCACCT ACCGGTAG

Protein sequence

MARRTSTRHT YRGESTSSGE AAPAGPARRA RPRAGWGVPV LMATLALGAG TLFAGCQPFD 
GTPVGGGGAP APTSSPTAGP TAPVTQTPTA GPGSPSPAAP PVTATPSAGT SAPASPTTAP 
TAGPTTSASP GAPASQGPLP SWPRATADVD VSSTISVAGT FDGGLKRYSG VSDSGQEEGQ 
DPIFEVADGG TVQNVIIGSP AADGIHCKGT CTLRNVWWED VGEDAATFKG TSAAQTMTID 
GGGARGASDK VFQHNGPGTM VIQNFQVQDF GKLYRSCGNC SKQYARHVVV RNVTVTAPGK 
TLVGVNTNYG DSAQLSGVTI VGDSSRKISI CDRYTGNSSG SEPTKTGSGA DGTYCRYTPS 
DITYR