Gene RoseRS_3131 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	RoseRS_3131
Symbol
ID	5210101
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus sp. RS-1
Kingdom	Bacteria
Replicon accession	NC_009523
Strand	-
Start bp	3931908
End bp	3933107
Gene Length	1200 bp
Protein Length	399 aa
Translation table	11
GC content	62%
IMG OID	640596723
Product	NB-ARC domain-containing protein
Protein accession	YP_001277443
Protein GI	148657238
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	25
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	2
Fosmid unclonability p-value	0.00106243
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGGACAGTG ATCAGCCACA GCAGAACCAG GATATCAGCG GCGCAGGCGC TGCTGGCGTG 
GTCGGTGACG CGACGAATAG CCCAATCACC ACCGGCAACA ACAACACCAT TATTCAGTCT 
GGCCGCGATA CTGTACTGTA TACCAATCTC CCGCCACCCC CTGCGCCTGG CAGCGTCCCA 
CTGAAGCCTG CCCTCATCAT CGGGCGCGAC AATGATCTCC AGGCGCTGAA GCAACGGGTT 
GGCATCTCGG CCAAAGGCGA AAGTCCTGCC CCGTTGAAGG TGCTGACCGC AATACGCGGC 
TGGCCGGGTG TCGGCAAGAC CACCCTGGCG GCTGCGCTCG CACACGATCC GGATATCAAC 
GCGCGTTTCC CTGATGGAGT GCTGTGGGCC TCGCTTGGCC AACAGCCAGG ACTCTTCGGT 
GAACTGGCCG CCTGGGGACG TGCCCTTGGT GTGCCGGATC TTAACCAGGC GCATACCGTT 
GAAGAAGCAT CTAACCTGCT GCGCGGCCTG CTGCGCAACA AGCGCTACCT TCTGATTGTC 
GATGACGCCT GGCAGGCTGA GCACGTGGTA CCCTTCAATG TCGGCGGCAG TGGTTGCGCG 
TTGCTCATCA CCACGCGCCT GCCAGAAGTG GCCCGCGCAA TCGCCCCAAC GCCCGATGAT 
GTCTATGTGC TCGGTGTGTT GAGCGAGACC GATGCGCTGG CGCTGCTGCG CACCTTAGCG 
CCGACGGTAG TTGCAGAGAA CGAGGCGACC AGCCGCGAAC TGGTCAAGGA TCTGGAAGGT 
CTGCCGCTGG CTATTCAGGT GGCCGGTCGG CTGCTCCACA CTGAAGCAAG CTATGGCTTT 
GGCGTCGAGC AATTATTGGT CGATATCCGC GAGGGCGCAA GGCTGATCCA GGCTCAGGCG 
CCAGCTGATC GCGCCGAAGT TGCCAGAGAG ACAACGCCCA CCGTTGCGGC GCTCCTGAAA 
AAGAGCACCG ATCTGCTGGA TGCCCACACG CTCGACTGCT TCGCCTACCT TGGCGCCTTC 
GCGCCGAAAC CGGCCACCTT TGACGCTGCG GCGATGCAAG CCGTGTGGGA GGTTGACGAC 
CCAAGGCCGA TCATCCGCAC CCTGGTTGAC CGCGGCCTGC TAGAGCCCTC AGGCCAGGGC 
CGCTTCTGGA TGCACGCGGT ACTCGTATCT CATGCAAAGT CGTTCTTGAC AGAGGAGTGA

Protein sequence

MDSDQPQQNQ DISGAGAAGV VGDATNSPIT TGNNNTIIQS GRDTVLYTNL PPPPAPGSVP 
LKPALIIGRD NDLQALKQRV GISAKGESPA PLKVLTAIRG WPGVGKTTLA AALAHDPDIN 
ARFPDGVLWA SLGQQPGLFG ELAAWGRALG VPDLNQAHTV EEASNLLRGL LRNKRYLLIV 
DDAWQAEHVV PFNVGGSGCA LLITTRLPEV ARAIAPTPDD VYVLGVLSET DALALLRTLA 
PTVVAENEAT SRELVKDLEG LPLAIQVAGR LLHTEASYGF GVEQLLVDIR EGARLIQAQA 
PADRAEVARE TTPTVAALLK KSTDLLDAHT LDCFAYLGAF APKPATFDAA AMQAVWEVDD 
PRPIIRTLVD RGLLEPSGQG RFWMHAVLVS HAKSFLTEE