Gene Information

Name : CLH_1388 (CLH_1388)
Accession : YP_001920780.1
Strain : Clostridium botulinum Alaska E43
Genome accession: NC_010723
Putative virulence/resistance : Virulence
Product : acetaldehyde dehydrogenase
Function : -
COG functional category : C : Energy production and conversion
COG ID : COG1012
EC number : 1.2.1.10
Position : 1483506 - 1485065 bp
Length : 1560 bp
Strand : +
Note : identified by match to protein family HMM TIGR02518

DNA sequence :
ATGGAGAATTTTGATAGAGATTTGTGTTCAATACAAGAAGCAAGAAACCTTGCTCGCTTAGGAAAAGTTGCAGCAGAAAA
AATTGCTGATTATACTGAAGAACAAATTGATAAAATTTTATGCAACATGGTTAAGGTTGCAGAAGCAAATGCTGTTTGCT
TAGCACAAATGGCAGTAGAAGAAACTGGTTTCGGTAAGGTTGAAGATAAAACTTATAAGAATCATATGGCATCTACTATA
TTATATGATTCAATTAAAGATATGAAAACTATTGGTATTATAAAAGAAGATGAGGCTAATAAGTTAATAGAACTTGCTGA
ACCTGTTGGATTAGTAATGGGAATAGTACCTTCAACAAATCCAACGTCTACAGCTATTTTTAAAGCAATGATTGCTATAA
AATCTCGTAATGCAATAGTATTTTCACCACATCCATCAGCAGCACAATGTACAATAAAAGCAGCTAAATTGATGAATGAG
GCAGCTATAGAAGCTGGGGCTCCAGAAAACATTATTGGTTGTGTTTCTACTCCAACAATTGGAGCTACAAATGAATTAAT
GAAGAGCAAAGAAGTTGCTATAATAATAGCAACAGGCGGTCCAGGAATGGTAAAAGCTGCTTATAGTTCAGGAAAACCAG
CACTTGGAGTAGGGGCAGGAAACTCTCCAGCATATATAGAAAGAAGTGCAAATGTTGAAAAAGCTATAAGAAATATTATT
GCAAGTAAAACATTTGATAATGGTACAATCTGTGCATCAGAGCAATCTATTATATGTGAAGAATGTAATCATGATGAAGT
AGTTGCAGAATTAAAGAAACAAGGCGGATATTTCATGACAGCAGAAGAAACCGATAAAGTTTGTAATCTGTTATTTAAGA
ATGGGCATAGCATGAATGCTAAATTTGTAGGTAGATCTCCACAAGTTATAGCGAGTTCAGCAGGAATTTCTATTCCACAA
GATACAAAGGTACTTATAGGAGAACAAAAGGGTGTTGGTGAAGGTTATCCATTATCTTTTGAAAAACTTACAACAGTACT
TGCATTTTATACAGTAAAAGATTGGCATGAAGCATGTGAATTAAGTATTGAATTACTTCAAAATGGAATAGGACATACAA
TGAGTATTCATACTGAAGATAGAGATATAGTAATGAAATTTGCTAGAAAGCCAGCATCACGTATTTTAGTTAATACTGGT
GGTAGCCAAGGTGGAACAGGTGCAAGCACAGGACTTATACCATCATTTACATTAGGTTGTGGTACTTGGGGCGGTAGTTC
AGTTTCTGAAAATGTTACCCCAATGCACTTGATTAACATCAAGAGAGTTGCTTATGGTTTAAAAGATTGTGCAACATTAG
CTTCTAACGATACAACGTTCAATCATATTAAAACAGAAAATAATTGTCACCATACACAAAATCAATGTGGAAGCTTAAGT
CCTGATCAGTATGCAGCTGCATCAAAGTGCATCAATACTGATGATATTAAAAATGCTAACAATGAAGAACTTTTGGATAT
GATTAATAAGTTAGTTAAGGTGATGAAGGGGGAAGCATAG

Protein sequence :
MENFDRDLCSIQEARNLARLGKVAAEKIADYTEEQIDKILCNMVKVAEANAVCLAQMAVEETGFGKVEDKTYKNHMASTI
LYDSIKDMKTIGIIKEDEANKLIELAEPVGLVMGIVPSTNPTSTAIFKAMIAIKSRNAIVFSPHPSAAQCTIKAAKLMNE
AAIEAGAPENIIGCVSTPTIGATNELMKSKEVAIIIATGGPGMVKAAYSSGKPALGVGAGNSPAYIERSANVEKAIRNII
ASKTFDNGTICASEQSIICEECNHDEVVAELKKQGGYFMTAEETDKVCNLLFKNGHSMNAKFVGRSPQVIASSAGISIPQ
DTKVLIGEQKGVGEGYPLSFEKLTTVLAFYTVKDWHEACELSIELLQNGIGHTMSIHTEDRDIVMKFARKPASRILVNTG
GSQGGTGASTGLIPSFTLGCGTWGGSSVSENVTPMHLINIKRVAYGLKDCATLASNDTTFNHIKTENNCHHTQNQCGSLS
PDQYAAASKCINTDDIKNANNEELLDMINKLVKVMKGEA

• Homologs from PAI DB

GeneGenBank Accn Product Virulance or Resistance PAI or REI Alignment Type E-val Identity
unnamed CAD42076.1 hypothetical protein Not tested PAI II 536 Protein 2e-95 49

• Homologs from VFDB (virulence genes)

GeneGenBank Accn Product ID of source DB Alignment Type E-val Identity
CLH_1388 YP_001920780.1 acetaldehyde dehydrogenase VFG1595 Protein 9e-96 49