Gene Cagg_1964 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Cagg_1964
Symbol
ID	7268880
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Chloroflexus aggregans DSM 9485
Kingdom	Bacteria
Replicon accession	NC_011831
Strand	-
Start bp	2399438
End bp	2400595
Gene Length	1158 bp
Protein Length	385 aa
Translation table	11
GC content	51%
IMG OID	643566801
Product	glycosyl transferase group 1
Protein accession	YP_002463294
Protein GI	219848861
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0438] Glycosyltransferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	18
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	6
Fosmid unclonability p-value	0.0014923
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGCATCGTA GGATTCTCAT CTTGGCCAGC TGGTATCCAA ACGCGACGTC GCCAGTGGGT 
GGCGTATTCA TCAAAGAACA GGCGCAAATT CTGGCAGAAC ACTTTGAGGT AACTGTTCTG 
GCAGTACAGA CGACAGGATT GCGCGCTACA TTACGCAATC ACTCTTACCA TGGTATCGAG 
CGCGACGGAA ATCTCACCAT CTATCGTGTA TATGCACCAA CCCTGCCGTA TGTGCCTCAC 
CTGAGTCTCC TGAGCAGCGC CTATTTTGCC TGGCAGGGAT TGCGACAATA TATTCACCAC 
CACGGTCGTC CTGATCTTAT TCACGCCCAC GTTGTGCTAC CGTGTGGTTG GATCGCGGCA 
CGCGCTGCGC AAGCGTGGGG TGTTCCGGCA ATTCTGACAG AACATACCAG TCCTTTTACC 
GTTCATCTAT ACACGAGATT GCAGCGGTAT TTGGTGCGTG AGACAATAAT ACATCTTCCC 
GTGTTGGCAA TTAGTCCGTC GCTCAGACAG CGCATTCTTG AATTTGTGCC AACTACCGAT 
GTGCGAGTGC TGGGTGAAGT CATCAAAACG CGCTTCTTTA CACCCTCGGA AACAGATGCC 
GAACCCACTC AATCCAAAAA GCGATTTCTA ACCGTTGCTC TTTTGACCGA ACAAAAGGGG 
GTCGATCATC TTTTACAAGC TGCTGCCTTA CTCCGTCAAC AGATTGATTG CCCGTTCGAG 
CTGGTCATCG GCGGCGATGG GCCAGCGCGC CCACGATTGG AACAGTTGGC TCGCCAATTC 
GGTCTGAAAG ATATCTGTCG TTTTGTCGGT CTCCTCAATC GGACACAGGT GCGTGATTGG 
ATGCGCTGGT GCGATGTGTT CATTCTGCCG AGCATTCACG AAACGTTTGG TGTCGTACTA 
GGTGAAGCAA TGGCATGCGG AAAACCGGTC ATTGCCACGC GTTGTGGCGG ACCGGAGTTT 
GTCGTTGAAG ATGGATGCGG TTTGCTCGTG CCCATTGCCG ACCCATATGC GCTTGCTGAC 
GCAATGAAGC AGTTTTTGCA GGACCGGGTG CAGTACGATC CATCTCTTAT TCGAGAAAGC 
GTTTGTCAAC GTTTTGGCGA AGAAGCGTTT TTACGAAACA TTGAGACAAT CTACAACGAA 
ATATGGTCAA AATCATGA

Protein sequence

MHRRILILAS WYPNATSPVG GVFIKEQAQI LAEHFEVTVL AVQTTGLRAT LRNHSYHGIE 
RDGNLTIYRV YAPTLPYVPH LSLLSSAYFA WQGLRQYIHH HGRPDLIHAH VVLPCGWIAA 
RAAQAWGVPA ILTEHTSPFT VHLYTRLQRY LVRETIIHLP VLAISPSLRQ RILEFVPTTD 
VRVLGEVIKT RFFTPSETDA EPTQSKKRFL TVALLTEQKG VDHLLQAAAL LRQQIDCPFE 
LVIGGDGPAR PRLEQLARQF GLKDICRFVG LLNRTQVRDW MRWCDVFILP SIHETFGVVL 
GEAMACGKPV IATRCGGPEF VVEDGCGLLV PIADPYALAD AMKQFLQDRV QYDPSLIRES 
VCQRFGEEAF LRNIETIYNE IWSKS