Gene Caci_3601 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Caci_3601
Symbol
ID	8334954
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Catenulispora acidiphila DSM 44928
Kingdom	Bacteria
Replicon accession	NC_013131
Strand	+
Start bp	4020795
End bp	4021871
Gene Length	1077 bp
Protein Length	358 aa
Translation table	11
GC content	70%
IMG OID	644956743
Product	transcriptional regulator, LacI family
Protein accession	YP_003114346
Protein GI	256392782
COG category	[K] Transcription
COG ID	[COG1609] Transcriptional regulators
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	10
Plasmid unclonability p-value	0.0229751
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	40
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGGACATCG GAGAGATCGC GCGTCGTGCG GGGGTGGCGC GCAGCACCGT GTCGTATGCG 
CTCAGTGGGA AACGGCCGGT CTCGGTGGAG ACGCGGCGGC GGATTCAGCA GGTCATTGAC 
GAGCTGGACT ATCGCCCCAA TGCTTCGGCG CGCGCGTTGA AGGAGGGGCG GACTCGCACG 
GTCGGGCTGG TGATCCCGCC GGCCGGGCCG CGGTTGACGT CCATGCAGTT GGATTTCGTC 
GGCAGCGTCG TGGAGGCTGC GGCGCGGGTC GATCTTGATG TGCTGCTCTC GCCGTCCGGT 
GGCGACCGTG ACCGCTCGCT CGAGCGTCTG ATCAGCGGTC GGCGGGTGGA TGGCGTGATT 
TTGATGGAGA TCCTCATGGA GGATTCCCGG GTGGCCAGGG TCGCGCAGAG CGGGGTGCCG 
TTCGTGACGA TCGGACGCGT CCGCGACCCT GACGCGACGT GGTGGGTGGA CATGGATTAC 
GCGGCGCTGG TCGGCCGCTG CGTCGATCAT CTCGCCGACC TCGGTCACCG GCATGTCGCG 
CTCGTCAACC GCTCGCCCGC GCTGATGGCC GCCGGCTACA GTCCCGGCCA TCGCGCCCGC 
GACGGGTTCG CCGAGGCGGT CGCTCGGCGC GGAGTCAGCG GATCAGAGTT CTGCTGTGAG 
GACGACGTCG CCGGTGGCGA GCGCTGCGTG GCGGAGATAC TGGCGACGCG CCCCAGCACG 
ACCGCGATCG TCACTGTGAA TGAGGCGGCG CTGCCGGGTG TGCAGCGCGC GCTGGAGCGC 
GCGGGCCATG AGATCCCGAG GACGTTCTCC GTCGCCGGGA TCGCCGCACA TCAGTGGGCT 
GAGGAGTTCC ATCCGCCGCT CACGGCTGCC GACGTCCCGT CGCTGGCGAT GGGTACCGTC 
GCGGTGGAAC TGCTCGCCGA GCACATCGCC GATCCGGACG CGCCCGCCGG GCATCGCCTG 
TTCATGCCGC CGATCTCGTT GCGGGACAGC ACCGGATCGG TGCCGCGGCC TTCGGCGCGG 
CCGGCGTTTT TCAGTCCGGC CGCGCCGAGG CGGTTCAGGG AAGCAGACGC GGATTGA

Protein sequence

MDIGEIARRA GVARSTVSYA LSGKRPVSVE TRRRIQQVID ELDYRPNASA RALKEGRTRT 
VGLVIPPAGP RLTSMQLDFV GSVVEAAARV DLDVLLSPSG GDRDRSLERL ISGRRVDGVI 
LMEILMEDSR VARVAQSGVP FVTIGRVRDP DATWWVDMDY AALVGRCVDH LADLGHRHVA 
LVNRSPALMA AGYSPGHRAR DGFAEAVARR GVSGSEFCCE DDVAGGERCV AEILATRPST 
TAIVTVNEAA LPGVQRALER AGHEIPRTFS VAGIAAHQWA EEFHPPLTAA DVPSLAMGTV 
AVELLAEHIA DPDAPAGHRL FMPPISLRDS TGSVPRPSAR PAFFSPAAPR RFREADAD