Gene Rleg_2172 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rleg_2172
Symbol
ID	8013185
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Rhizobium leguminosarum bv. trifolii WSM1325
Kingdom	Bacteria
Replicon accession	NC_012850
Strand	-
Start bp	2164767
End bp	2165975
Gene Length	1209 bp
Protein Length	402 aa
Translation table	11
GC content	68%
IMG OID	644824758
Product	Integrase catalytic region
Protein accession	YP_002975988
Protein GI	241204892
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	11
Plasmid unclonability p-value	0.0104319
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	16
Fosmid unclonability p-value	0.0206375
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGGTTTGGA GAGAGACTGG CATCATGGAC GAGCGGCTGC GCTTTGTTGG GGAATGTCTT 
GCGGGCGAGG AGACGATGAC GGCGCTGTGT GCGGCCTACG GGATATCGCG CAAGACGGGC 
TACAAATGGT TGGAGCGGTA TCGGGCGCTC GGCCCTGCGG GGCTTATCGA CCTGCCGCGG 
GCGCCGCTTG AGCACGGGCG GGCAACGGCG GCGGAGCTGG TGGCGCGGAT CGTGGCGGAG 
AAGGAGGCGA ATCCGCAGTG GGGGCCGAAG AAGGTGCTGG CGCGGCTGAA GCGGTCGGCG 
CCGCAGCTTT GCTGGCCGGC GGCCTCGACG ATAGGCGAGA TCCTGAAGCG ACACGGGCTG 
GTCGGGCGCC GGCGGCATCG CTGGCGGGCG GCTGGTTGCG GCCCGTTCGC GCCGGCCAAC 
GGGCCCAATG CGGTGTGGAG CGCCGATTAC AAGGGCTGGT TCAGGACCCG CGATGGGCGG 
CGCTGCGAGC CACTGACGGT GATGGATACG GCGAGCCGCT TTCTGCTGGC GCTGGAAGCC 
TGCGCGACGC CGGCCGAGGT AGAGGCCTGG CCGGTGTTCG AGCGGCTGTT TGCCGAGCAC 
GGACTGCCGG AGCGCTTTCG CAGCGACAAC GGTTCGCCCT TCGCGGCGAT CGGCGTCACC 
GGGCTGACGA CGCTTGCTGT ACGGTTCATC AAGCTCGGCA TCGGCCTGGA GCGCATCCAG 
CCGGGCAAAC CGCAGCAGAA CGGCCGCCAC GAACGCTTCC ATCTGACGAT GCTGCCGCTG 
GCCATGGCGC CGGAGGTCGA CCATGCCGCG CAGCAGGCGG TCTTTGACGC ATTTCGCCAG 
AATTACAACG CCGAGCGTCC ACACGAGGCG CTCGCTATGG ACGTGCCTGC TGATCATTAC 
CGACCGTCAC TGCGGCGCCT GCCCGACCGC CTGCCTGAAC CGGACTATCC GGCCGAGGCG 
GCGGTGCGCC GGGTGCGCTC CAATGGCGAG ATCAAATGGA ACGGTGACCT CGTCTATGTC 
GCAGCAGCGC TGGCCGGCGA GGTCGTGGCG ATCGAGGAGA GTGAAGCGGG CATCTGGACG 
CTACGCTTCC ATGCCCATCC GCTCGGCATC ATCGACAAGA AGACCAAGCG GCTTGTCCGC 
CCCAGCGCCC TGCAACCCCG ACCAGCCGGC GCAGGGGCGG ACACTGGTCT ACAAGGGGGA 
GAACTGTAA

Protein sequence

MVWRETGIMD ERLRFVGECL AGEETMTALC AAYGISRKTG YKWLERYRAL GPAGLIDLPR 
APLEHGRATA AELVARIVAE KEANPQWGPK KVLARLKRSA PQLCWPAAST IGEILKRHGL 
VGRRRHRWRA AGCGPFAPAN GPNAVWSADY KGWFRTRDGR RCEPLTVMDT ASRFLLALEA 
CATPAEVEAW PVFERLFAEH GLPERFRSDN GSPFAAIGVT GLTTLAVRFI KLGIGLERIQ 
PGKPQQNGRH ERFHLTMLPL AMAPEVDHAA QQAVFDAFRQ NYNAERPHEA LAMDVPADHY 
RPSLRRLPDR LPEPDYPAEA AVRRVRSNGE IKWNGDLVYV AAALAGEVVA IEESEAGIWT 
LRFHAHPLGI IDKKTKRLVR PSALQPRPAG AGADTGLQGG EL