Gene Saro_2211 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Saro_2211
Symbol
ID	3916527
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Novosphingobium aromaticivorans DSM 12444
Kingdom	Bacteria
Replicon accession	NC_007794
Strand	-
Start bp	2354601
End bp	2355872
Gene Length	1272 bp
Protein Length	423 aa
Translation table	11
GC content	58%
IMG OID	640444966
Product	phage integrase
Protein accession	YP_497483
Protein GI	87200226
COG category	[L] Replication, recombination and repair
COG ID	[COG4974] Site-specific recombinase XerD
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	23
Plasmid unclonability p-value	0.684899
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGGCGAACA AAGTAGGTTT GACGGATGCA AAGATCGCAG GGCTGAAGGC GCCTGCTGCG 
GGTCAGATTG AGCTCGCCGA TGGCATCGTA CCCGGTCTTA GGCTCCGCAT GGGCGCCAGT 
GGTATCAAGA CGTACATTCT GCGCAAGCGG GTTCAGGGCA AATGGCTGAA TGTGACAATC 
GGACGTCATG GGCCAAGCTT TACACTGGCC CATGCTCGCA AGAAGGCGCG CGATCTGCTC 
GTGGATGTCG AGCAGGGCAA GAGCATCGCT AGAAAAGCGG GCGCAAAGAG GAAGGGATCA 
AAAGGCGTCG GGACAGTCGC GGAGCTCTAC GAGACGTACC TCGCTCAGCA GATCGAGGGC 
AAAAAGCGGA GCGCGAGGGA GTTCGATCGA GTGTTCCGAA AATACATCGA GCCCGAGATT 
GGAGACCGGC TCGCGGACTC CATAACCCGA AGTGACGTGA GCCGCTTCGT TGAGAAAATT 
GCGTTCGAGC GGGGCAAGGA AACCCTGACG ATGGCGCGGA TCGTGTATCG CCACCTTTCA 
ACTTTCTACA CTTGGGCCCT CACCAGATTG GAGCATATGC CCGCCAATCC TTGCCGGGAT 
GCATGGCGGC CGAAGCGGAA TGAGCCTCGC GACCGTGTAC TCAGCGACCG TGAGCTTGCT 
GCGCTGTGGC AATCTGCGGT CGAGGATGGC TATCCGTTCG GCCATCTCGT GCAGATGCTA 
ATCCTTACGG CTCAACGCAG AGGTGAAGTG CTTGATGCCG CGTGCGACGA GTTCGACTTC 
AAAGCCAAGG TCTGGACCGT CCCAGGTGAT CGAGCAAAAA ACGGCAAGGC CAATGTGGTG 
CCAATATCCG CTCAGGCTCT TGGAGTGATC ACCGAGATAT TCCGGGCTGC CGGGATTGAC 
CCCGATGACG CCCACAAACA ATCCCAGATC CTGTTGGCTT CGAAGGTCAC CAATACGAAC 
AGTGTCAGCG GACTATCCAA GGCCTGGAAG CGGATCAGAG CAAGCGTGGA CGAGAAGCTC 
GGCTACGAAG CCGGACACTT CACAATGCAT GATATTCGAC GGACGGTGGC GACCGGCCTC 
CAGCGTCTTG GCATACCGTT GGTGGTTTCT GAGGCGGTCC TGAATCACCA ATCAGGATCA 
GCTATGGCTG GCGTCGCTGG GGTCTATCAC CGTCACCAGT ATACCAACGA GAAACGGGAG 
GCGTTGGCGC TGTGGGGTAA GGAGGTAATG CAGATTGCAG CCAAGTACCC AGTCGAAGTC 
AAAGACGGCT GA

Protein sequence

MANKVGLTDA KIAGLKAPAA GQIELADGIV PGLRLRMGAS GIKTYILRKR VQGKWLNVTI 
GRHGPSFTLA HARKKARDLL VDVEQGKSIA RKAGAKRKGS KGVGTVAELY ETYLAQQIEG 
KKRSAREFDR VFRKYIEPEI GDRLADSITR SDVSRFVEKI AFERGKETLT MARIVYRHLS 
TFYTWALTRL EHMPANPCRD AWRPKRNEPR DRVLSDRELA ALWQSAVEDG YPFGHLVQML 
ILTAQRRGEV LDAACDEFDF KAKVWTVPGD RAKNGKANVV PISAQALGVI TEIFRAAGID 
PDDAHKQSQI LLASKVTNTN SVSGLSKAWK RIRASVDEKL GYEAGHFTMH DIRRTVATGL 
QRLGIPLVVS EAVLNHQSGS AMAGVAGVYH RHQYTNEKRE ALALWGKEVM QIAAKYPVEV 
KDG