Gene Cagg_3297 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Cagg_3297
Symbol
ID	7267771
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Chloroflexus aggregans DSM 9485
Kingdom	Bacteria
Replicon accession	NC_011831
Strand	-
Start bp	3995534
End bp	3996826
Gene Length	1293 bp
Protein Length	430 aa
Translation table	11
GC content	57%
IMG OID	643568109
Product	restriction modification system DNA specificity subunit
Protein accession	YP_002464582
Protein GI	219850149
COG category	[V] Defense mechanisms
COG ID	[COG0732] Restriction endonuclease S subunits
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	14
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	5
Fosmid unclonability p-value	0.000489204
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGGCGGGTG AGTGGCGAAA GGCACGGTTG GGAGAAGTGG TACGTATCAA TCCCGATGCC 
CTTGGGAGCG ACTGGCCATT TTCTTACATT AAGTACGTTG ATATTTCGAG TGTTGGCGAA 
GGTTCAATCG TAGAACCCCC GCGGATCCTA CGTTTGGATG AAGCGCCAAG CCGAGCAAAG 
AGACTTGTCC GAGAGGGGGA CACGGTTCTT TCAACGGTTC GGCCTGGTAG ACGATCAATG 
TTTTTCGTAA AAGAGCCAGA GCCTGAATGG GTGGTTTCCA CCGGCTTTGC TGTTTTGCGA 
CCTTGTAGGG AATACATAGA ACCTCGCTAC CTCTACGCTT GTGTCTTTGA CCGAGGTCTC 
ACTGAATTTC TCATCAAAAG GGAGAAGGGC GCTGCTTATC CGGCGGTCCT GCCAGAAGAC 
ATAGCGGATG CGATTATCAA ACTCCCTCCC CTCCCCGAAC AACGCGCCAT CGCCCACATC 
CTCGGCACGC TGGACGACAA GATCGAGCTG AACCGGCGGA TGAGCGAGAC GCTGGAGCAG 
ATGGCGCAGG CGCTGTTCAA GGCGTGGTTC GTTGATTTCG ATCCCGTGCG CGCCAAATGT 
AGGGGCGGGT TTGAAACCCG CCCCTACACC GACCTATTCC CCGACCGGCT GATGGACTCT 
GAACTGGGGA AGATTCCGGA GGGGTGGGAT GTAGTCACGC TGCCTAAGCT GGTCGAAATC 
AACCCGGGCC GTCCGCTACG CAAGGGCGAG ATCGCACCCT ACTTGGACAT GGCGAACATG 
CCAACACGGG GCCACGCCCC GGACCAAGTG GCCCACCGCC CATTCACCTC GGGGACGCGA 
TTTATCAATG GGGATACCCT GGTCGCTCGG ATCACCCCAT GTCTTGAAAA CGGCAAGACG 
GCATTCGTGG ATTTTCTGGA GGAAGGGCAA GTCGGTTGGG GCTCTACCGA GTACATCGTG 
CTTCATCCGA AACCGCCTCT CCCTGAAGAG TTCGGTTACT GCCTAGCAAG AAGCGATGCT 
TTCCGCGAGT TCGCTATTCA AAGCATGACG GGAACAAGCG GTCGGCAGCG CGTACAGGCA 
GACTCAATAG GCCATTTCAA GTTGCCACGT CCGCCCGATT CGGTCGCAGT AGCGTTTGGG 
AGACTAGTTA AGCCGCTGTT TGCCCGATCA TCGGACGCCG TCCGTGAATC CCGCACCCTC 
GCCGCCCTGC GCGACGCGCT GCTGACCAAG CTCATCTCCG GCGAGCTGCG GGTGAAGGAC 
GCGGAGAAGT TTCTACGAGA GTGTGGATTA TGA

Protein sequence

MAGEWRKARL GEVVRINPDA LGSDWPFSYI KYVDISSVGE GSIVEPPRIL RLDEAPSRAK 
RLVREGDTVL STVRPGRRSM FFVKEPEPEW VVSTGFAVLR PCREYIEPRY LYACVFDRGL 
TEFLIKREKG AAYPAVLPED IADAIIKLPP LPEQRAIAHI LGTLDDKIEL NRRMSETLEQ 
MAQALFKAWF VDFDPVRAKC RGGFETRPYT DLFPDRLMDS ELGKIPEGWD VVTLPKLVEI 
NPGRPLRKGE IAPYLDMANM PTRGHAPDQV AHRPFTSGTR FINGDTLVAR ITPCLENGKT 
AFVDFLEEGQ VGWGSTEYIV LHPKPPLPEE FGYCLARSDA FREFAIQSMT GTSGRQRVQA 
DSIGHFKLPR PPDSVAVAFG RLVKPLFARS SDAVRESRTL AALRDALLTK LISGELRVKD 
AEKFLRECGL