>fig|6666666.67449.peg.69 fig|196627.4.peg.954 Cadmium resistance protein gi|372109441|gb|CP003213.1|_64837_65100,gi|372109441|gb|CP003213.1|_65100_65450 MILTSVLQAIGLFAATNIDDIIVLSLFFARGAGQRGTTARILAGQYLGFAGILVAAILVTTGAGAFLPPAAIPYFGLIPLGLGLWASxxWAVWEAWRGDGDDDDEAKVAGKKVGVGAVAGVTFANGGDNIGVYTPVFLSVEPLAVVAYCVIFLALVAVLVALARFVATRPPIAEVLERFEHILFPIVLIGLGIVILVSGGAFGL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGATCCTCACCTCGGTCTTGCAGGCGATAGGCCTGTTCGCAGCTACCAACATCGACGAC M I L T S V L Q A I G L F A A T N I D D M I L T S V L Q A I G L F A A T N I D D ATCATCGTGCTCTCCCTCTTCTTCGCGCGAGGGGCAGGCCAGCGCGGCACCACCGCCCGC I I V L S L F F A R G A G Q R G T T A R I I V L S L F F A R G A G Q R G T T A R ATTCTGGCCGGCCAGTACCTCGGATTCGCGGGCATCCTCGTCGCCGCGATCCTTGTGACC I L A G Q Y L G F A G I L V A A I L V T I L A G Q Y L G F A G I L V A A I L V T ACCGGCGCCGGAGCATTTCTGCCCCCGGCAGCCATTCCATACTTTGGTCTCATCCCTCTG T G A G A F L P P A A I P Y F G L I P L T G A G A F L P P A A I P Y F G L I P L GGCCTCGGCCTCTGGGCCTCG*GC*CTCTGGGCCGTATGGGAGGCCTGGCGCGGAGACGG G L G L W A S L W A V W E A W R G D G G L G L W A S *X** X W A V W E A W R G D G TGACGACGATGACGAGGCCAAGGTTGCCGGCAAGAAGGTCGGCGTGGGGGCGGTCGCAGG D D D D E A K V A G K K V G V G A V A G D D D D E A K V A G K K V G V G A V A G CGTCACCTTTGCCAACGGTGGCGACAATATCGGCGTCTACACCCCTGTATTCCTCAGCGT V T F A N G G D N I G V Y T P V F L S V V T F A N G G D N I G V Y T P V F L S V GGAGCCTCTCGCAGTAGTCGCCTACTGCGTTATCTTCCTCGCGCTCGTTGCGGTCCTGGT E P L A V V A Y C V I F L A L V A V L V E P L A V V A Y C V I F L A L V A V L V GGCCCTGGCAAGGTTCGTCGCAACCCGCCCCCCGATCGCGGAAGTGCTCGAACGCTTTGA A L A R F V A T R P P I A E V L E R F E A L A R F V A T R P P I A E V L E R F E GCACATCCTCTTTCCCATCGTTCTCATCGGCCTCGGTATCGTGATCCTCGTCAGCGGCGG H I L F P I V L I G L G I V I L V S G G H I L F P I V L I G L G I V I L V S G G AGCCTTCGGGCTCTGA A F G L A F G L --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.954): ATGATCCTCACCTCGGTCTTGCAGGCGATAGGCCTGTTCGCAGCTACCAACATCGACGAC I L T S V L Q A I G L F A A T N I D D --- M A T G L L S A I G L F I A T N I D D ATCATCGTGCTCTCCCTCTTCTTCGCGCGAGGGGCAGGCCAGCGCGGCACCACCGCCCGC I I V L S L F F A R G A G Q R G T T A R I I V L S L F F A R G A G Q K G T T L R ATTCTGGCCGGCCAGTACCTCGGATTCGCGGGCATCCTCGTCGCCGCGATCCTTGTGACC I L A G Q Y L G F A G I L V A A I L V T I L A G Q Y L G F M G I L A A A V L V T ACCGGCGCCGGAGCATTTCTGCCCCCGGCAGCCATTCCATACTTTGGTCTCATCCCTCTG T G A G A F L P P A A I P Y F G L I P L L G A G A F L P A E A I P Y F G L I P L GGCCTCGGCCTCTGGGCCTCGGCCTCTGGGCCGTATGGGAGGCCTGGCGCGGAGACGGTG G L G L W A S W E A W R G D G A L G L W A A -------------- W Q A W R S D D ACGACGATGACGAGGCCAAGGTTGCCGGCAAGAAGGTCGGCGTGGGGGCGGTCGCAGGCG D D D D E A K V A G K K V G V G A V A G D D D D D A E I A G K K V G V L T V A G TCACCTTTGCCAACGGTGGCGACAATATCGGCGTCTACACCCCTGTATTCCTCAGCGTGG V T F A N G G D N I G V Y T P V F L S V V T F A N G G D N I G V Y V P V F L N V AGCCTCTCGCAGTAGTCGCCTACTGCGTTATCTTCCTCGCGCTCGTTGCGGTCCTGGTGG E P L A V V A Y C V I F L A L V A V L V D T A A V I I Y C I V F L V L V A G L V CCCTGGCAAGGTTCGTCGCAACCCGCCCCCCGATCGCGGAAGTGCTCGAACGCTTTGAGC A L A R F V A T R P P I A E V L E R F E L L A K F V A T R P P I A E V L E R W E ACATCCTCTTTCCCATCGTTCTCATCGGCCTCGGTATCGTGATCCTCGTCAGCGGCGGAG H I L F P I V L I G L G I V I L V S G G H V L F P I V L I G L G I F I L V S G G CCTTCGGGCTCTGA A F G L A F G L --- // >fig|6666666.67449.peg.753 fig|257309.1.peg.1998 Putative transposase for insertion element gi|372109441|gb|CP003213.1|_734122_733376,gi|372109441|gb|CP003213.1|_733376_732915 MTYDYVIGMDACKYFHHACVLDIDGTQVLSKRINQNEQSLRALFSAFSAYDHKVLVVVDQPNNIGRLTVAVAQDIGIDVRYLPGLAMRQLSRIHAGNAKTDIRDAYIIAHAAKNLPESLRSVDRVEEAFLQLKVLNGIDEDLARSYTRLINQIRSALVGCYPQFEQALRGQIIHRKWVLHLLARYGGPTKIKRLGKAKAAAFARRYKARNPEPVLDAIFAAISEQTVTIAGAHYAEMGVAMSAKDALLxxEHRQQIEKEVIELINDIPHTQFLLSMPGIGPKTAAQILMTAGDMSDFPSAGHLASYAGLSPRTNQSGTSIMSNSLNRAGNKKLKNALWQSSFASIRFHERSRQFYERKRREGKRHNAAVVALARRRLNVLYAMMRNHEHYHDPAPSQEDLAA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACCTACGACTATGTCATCGGCATGGACGCCTGCAAATACTTTCACCACGCTTGCGTC M T Y D Y V I G M D A C K Y F H H A C V M T Y D Y V I G M D A C K Y F H H A C V TTAGATATCGACGGCACCCAGGTGCTATCTAAGCGCATCAATCAAAATGAACAATCCCTG L D I D G T Q V L S K R I N Q N E Q S L L D I D G T Q V L S K R I N Q N E Q S L CGCGCACTGTTTTCAGCGTTCAGCGCATACGACCACAAGGTCCTTGTCGTCGTGGACCAG R A L F S A F S A Y D H K V L V V V D Q R A L F S A F S A Y D H K V L V V V D Q CCCAATAACATTGGGCGACTAACTGTCGCAGTTGCCCAAGATATCGGAATCGACGTGCGC P N N I G R L T V A V A Q D I G I D V R P N N I G R L T V A V A Q D I G I D V R TACCTTCCAGGTTTGGCTATGCGTCAACTCTCGCGCATCCACGCTGGTAATGCCAAAACT Y L P G L A M R Q L S R I H A G N A K T Y L P G L A M R Q L S R I H A G N A K T GATATCCGGGATGCATATATCATCGCCCACGCTGCAAAGAACCTTCCGGAATCCCTCCGC D I R D A Y I I A H A A K N L P E S L R D I R D A Y I I A H A A K N L P E S L R AGTGTCGACCGCGTCGAAGAAGCCTTCCTCCAGTTGAAAGTCCTCAACGGCATCGACGAA S V D R V E E A F L Q L K V L N G I D E S V D R V E E A F L Q L K V L N G I D E GACTTAGCGCGCTCCTACACCAGGCTCATCAATCAGATTCGAAGTGCATTAGTTGGCTGT D L A R S Y T R L I N Q I R S A L V G C D L A R S Y T R L I N Q I R S A L V G C TACCCGCAATTCGAACAAGCCCTTCGCGGCCAGATAATCCACCGCAAGTGGGTTCTGCAC Y P Q F E Q A L R G Q I I H R K W V L H Y P Q F E Q A L R G Q I I H R K W V L H CTACTTGCACGCTACGGCGGGCCCACCAAGATAAAGCGCTTAGGTAAGGCCAAGGCAGCC L L A R Y G G P T K I K R L G K A K A A L L A R Y G G P T K I K R L G K A K A A GCCTTTGCTCGACGATATAAGGCACGAAATCCCGAACCTGTCCTCGATGCCATATTCGCT A F A R R Y K A R N P E P V L D A I F A A F A R R Y K A R N P E P V L D A I F A GCCATCTCTGAGCAAACAGTCACTATTGCAGGTGCACACTATGCCGAAATGGGCGTAGCA A I S E Q T V T I A G A H Y A E M G V A A I S E Q T V T I A G A H Y A E M G V A ATGTCGGCGAAGGACGCACTTTTA*AG*CTCGAGCACCGCCAACAAATCGAAAAGGAAGT M S A K D A L L L E H R Q Q I E K E V M S A K D A L L *X** X E H R Q Q I E K E V CATCGAGCTCATCAACGACATCCCCCACACCCAATTCCTGCTATCCATGCCGGGAATCGG I E L I N D I P H T Q F L L S M P G I G I E L I N D I P H T Q F L L S M P G I G GCCAAAGACGGCTGCCCAAATTCTTATGACCGCGGGCGATATGTCCGACTTTCCGTCAGC P K T A A Q I L M T A G D M S D F P S A P K T A A Q I L M T A G D M S D F P S A TGGGCACCTAGCCTCCTACGCTGGCTTATCGCCCCGAACGAATCAGTCCGGAACCTCAAT G H L A S Y A G L S P R T N Q S G T S I G H L A S Y A G L S P R T N Q S G T S I CATGTCGAACTCACTGAACCGAGCCGGCAATAAAAAATTAAAGAACGCCCTATGGCAATC M S N S L N R A G N K K L K N A L W Q S M S N S L N R A G N K K L K N A L W Q S ATCTTTTGCATCCATCAGATTCCACGAGCGTTCTCGGCAATTCTATGAACGAAAGCGCCG S F A S I R F H E R S R Q F Y E R K R R S F A S I R F H E R S R Q F Y E R K R R TGAAGGCAAAAGGCACAACGCCGCAGTAGTAGCACTAGCCCGCAGACGACTCAACGTCCT E G K R H N A A V V A L A R R R L N V L E G K R H N A A V V A L A R R R L N V L CTACGCCATGATGCGCAACCACGAGCACTACCACGATCCCGCACCATCACAGGAAGACCT Y A M M R N H E H Y H D P A P S Q E D L Y A M M R N H E H Y H D P A P S Q E D L AGCAGCCTAG A A A A --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1998): ATGACCTACGACTATGTCATCGGCATGGACGCCTGCAAATACTTTCACCACGCTTGCGTC M T Y D Y V I G M D A C K Y F H H A C V M T Y D Y V I G M D A C K Y F H H A C V TTAGATATCGACGGCACCCAGGTGCTATCTAAGCGCATCAATCAAAATGAACAATCCCTG L D I D G T Q V L S K R I N Q N E Q S L L D I D G T Q V L S K R I N Q N E Q S L CGCGCACTGTTTTCAGCGTTCAGCGCATACGACCACAAGGTCCTTGTCGTCGTGGACCAG R A L F S A F S A Y D H K V L V V V D Q R A L F S A F S A Y D H K V L V V V D Q CCCAATAACATTGGGCGACTAACTGTCGCAGTTGCCCAAGATATCGGAATCGACGTGCGC P N N I G R L T V A V A Q D I G I D V R P N N I G R L T V A V A Q D I G I D V R TACCTTCCAGGTTTGGCTATGCGTCAACTCTCGCGCATCCACGCTGGTAATGCCAAAACT Y L P G L A M R Q L S R I H A G N A K T Y L P G L A M R Q L S R I H A G N A K T GATATCCGGGATGCATATATCATCGCCCACGCTGCAAAGAACCTTCCGGAATCCCTCCGC D I R D A Y I I A H A A K N L P E S L R D I R D A Y I I A H A A K N L P E S L R AGTGTCGACCGCGTCGAAGAAGCCTTCCTCCAGTTGAAAGTCCTCAACGGCATCGACGAA S V D R V E E A F L Q L K V L N G I D E S V D R V E E A F L Q L K V L N G I D E GACTTAGCGCGCTCCTACACCAGGCTCATCAATCAGATTCGAAGTGCATTAGTTGGCTGT D L A R S Y T R L I N Q I R S A L V G C D L A R S Y T R L I N Q I R S A L V G C TACCCGCAATTCGAACAAGCCCTTCGCGGCCAGATAATCCACCGCAAGTGGGTTCTGCAC Y P Q F E Q A L R G Q I I H R K W V L H Y P Q F E Q A L R G Q I I H R K W V L H CTACTTGCACGCTACGGCGGGCCCACCAAGATAAAGCGCTTAGGTAAGGCCAAGGCAGCC L L A R Y G G P T K I K R L G K A K A A L L A R Y G G P T K I K R L G K A K A A GCCTTTGCTCGACGATATAAGGCACGAAATCCCGAACCTGTCCTCGATGCCATATTCGCT A F A R R Y K A R N P E P V L D A I F A A F A R R Y K A R N P E P V L D A I F A GCCATCTCTGAGCAAACAGTCACTATTGCAGGTGCACACTATGCCGAAATGGGCGTAGCA A I S E Q T V T I A G A H Y A E M G V A A I S E Q T V T I A G A H Y A E M G V A ATGTCGGCGAAGGACGCACTT*TT*AAGCTCGAGCACCGCCAACAAATCGAAAAGGAAGT M S A K D A L K L E H R Q Q I E K E V M S A K D A L *L** K L E H R Q Q I E K E V CATCGAGCTCATCAACGACATCCCCCACACCCAATTCCTGCTATCCATGCCGGGAATCGG I E L I N D I P H T Q F L L S M P G I G I E L I N D I P H T Q F L L S M P G I G GCCAAAGACGGCTGCCCAAATTCTTATGACCGCGGGCGATATGTCCGACTTTCCGTCAGC P K T A A Q I L M T A G D M S D F P S A P K T A A Q I L M T A G D M S D F P S A TGGGCACCTAGCCTCCTACGCTGGCTTATCGCCCCGAACGAATCAGTCCGGAACCTCAAT G H L A S Y A G L S P R T N Q S G T S I G H L A S Y A G L S P R T N Q S G T S I CATGTCGAACTCACTGAACCGAGCCGGCAATAAAAAATTAAAGAACGCCCTATGGCAATC M S N S L N R A G N K K L K N A L W Q S M S N S L N R A G N K K L K N A L W Q S ATCTTTTGCATCCATCAGATTCCACGAGCGTTCTCGGCAATTCTATGAACGAAAGCGCCG S F A S I R F H E R S R Q F Y E R K R R S F A S I R F H E R S R Q F Y E R K R R TGAAGGCAAAAGGCACAACGCCGCAGTAGTAGCACTAGCCCGCAGACGACTCAACGTCCT E G K R H N A A V V A L A R R R L N V L E G K R H N A A V V A L A R R R L N V L CTACGCCATGATGCGCAACCACGAGCACTACCACGATCCCGCACCATCACAGGAAGACCT Y A M M R N H E H Y H D P A P S Q E D L Y A M M R N H E H Y H D P A P S Q E D L AGCAGCCTAG A A A A --- // >fig|6666666.67449.peg.276 fig|257309.1.peg.274 No significant database matches gi|372109441|gb|CP003213.1|_255578_255087,gi|372109441|gb|CP003213.1|_255085_254687 MNVWGDKIRVIDTLRMSHTEYAQWITNQQHKHFNIHAELWADSEEWEALNPWTRDWARILAVGTRARTGVICGRSAVRLWGLGILGYEEPVVVVLPGTKTAPRNTKRWIHYRSARIPSNKITEHKGIRFTTMERSIGDLCRWGTFAEGLVAVKSYLRQEDAQPFLLEQELEEFGRIPGVRKFRRVLQVADSKSESVAESWAKAKLIEAKITFEQQVQINNRRADFLVGSVVVEIDGDIKFHDDEPRAVLKERKRDRELQNAGYVVAHFDWESLNSGTFIPSLLRLLESTNTKTQGR We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAACGTCTGGGGGGACAAAATTCGAGTAATCGATACGCTGCGTATGTCTCATACCGAG M N V W G D K I R V I D T L R M S H T E M N V W G D K I R V I D T L R M S H T E TACGCACAATGGATCACGAATCAACAACATAAACACTTCAATATTCATGCTGAACTTTGG Y A Q W I T N Q Q H K H F N I H A E L W Y A Q W I T N Q Q H K H F N I H A E L W GCAGATTCGGAAGAATGGGAAGCACTCAATCCGTGGACTCGCGATTGGGCACGAATTCTG A D S E E W E A L N P W T R D W A R I L A D S E E W E A L N P W T R D W A R I L GCCGTTGGCACGCGAGCACGTACTGGCGTGATTTGCGGCCGGTCTGCAGTCCGCCTGTGG A V G T R A R T G V I C G R S A V R L W A V G T R A R T G V I C G R S A V R L W GGACTAGGAATTCTAGGATATGAAGAACCAGTGGTCGTGGTGCTACCAGGTACAAAAACT G L G I L G Y E E P V V V V L P G T K T G L G I L G Y E E P V V V V L P G T K T GCTCCACGCAACACAAAGAGGTGGATTCATTACCGCTCTGCGCGAATCCCGTCAAACAAA A P R N T K R W I H Y R S A R I P S N K A P R N T K R W I H Y R S A R I P S N K ATCACGGAGCATAAGGGGATTCGCTTCACCACAATGGAACGCTCTATTGGAGATCTCTGC I T E H K G I R F T T M E R S I G D L C I T E H K G I R F T T M E R S I G D L C CGATGGGGAACGTTCGCAGAGGGGCTTGTCGCTGTGAAATCCTATTTGCGCCAAGAGGAT R W G T F A E G L V A V K S Y L R Q E D R W G T F A E G L V A V K S Y L R Q E D GCCCAGCCGTTTTTTGCTGGAACAGGAGTTAGAAGAGTTTGGACGAATTCCAGGGGTGCG A Q P F L L E Q E L E E F G R I P G V R A Q P F - L L E Q E L E E F G R I P G V R TAAATTCCGTCGGGTATTGCAAGTGGCTGATTCCAAGTCGGAAAGTGTCGCCGAGTCGTG K F R R V L Q V A D S K S E S V A E S W K F R R V L Q V A D S K S E S V A E S W GGCAAAAGCGAAGCTCATCGAAGCAAAAATCACGTTCGAGCAGCAGGTGCAGATCAATAA A K A K L I E A K I T F E Q Q V Q I N N A K A K L I E A K I T F E Q Q V Q I N N TCGTCGTGCCGACTTTCTCGTCGGAAGCGTTGTCGTAGAAATCGATGGAGACATCAAGTT R R A D F L V G S V V V E I D G D I K F R R A D F L V G S V V V E I D G D I K F CCATGACGACGAACCGAGGGCAGTGCTCAAGGAGCGGAAACGCGACCGCGAACTTCAAAA H D D E P R A V L K E R K R D R E L Q N H D D E P R A V L K E R K R D R E L Q N TGCCGGCTATGTGGTGGCGCATTTTGACTGGGAGTCACTGAACTCGGGAACTTTCATCCC A G Y V V A H F D W E S L N S G T F I P A G Y V V A H F D W E S L N S G T F I P CTCGCTTCTCCGCCTCCTCGAATCCACGAACACAAAAACCCAAGGACGCTGA S L L R L L E S T N T K T Q G R S L L R L L E S T N T K T Q G R --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.274): ATGAACGTCTGGGGGGACAAAATTCGAGTAATCGATACGCTGCGTATGTCTCATACCGAG M N V W G D K I R V I D T L R M S H T E M N V W G D K I R V I D T L R M S H T E TACGCACAATGGATCACGAATCAACAACATAAACACTTCAATATTCATGCTGAACTTTGG Y A Q W I T N Q Q H K H F N I H A E L W Y A Q W I T N Q Q H K H F N I H A E L W GCAGATTCGGAAGAATGGGAAGCACTCAATCCGTGGACTCGCGATTGGGCACGAATTCTG A D S E E W E A L N P W T R D W A R I L A D S E E W E A L N P W T R D W A R I L GCCGTTGGCACGCGAGCACGTACTGGCGTGATTTGCGGCCGGTCTGCAGTCCGCCTGTGG A V G T R A R T G V I C G R S A V R L W A V G K R A R T G V I C G R S A V R L W GGACTAGGAATTCTAGGATATGAAGAACCAGTGGTCGTGGTGCTACCAGGTACAAAAACT G L G I L G Y E E P V V V V L P G T K T R L G I L G Y E E P V V V V L P G T K T GCTCCACGCAACACAAAGAGGTGGATTCATTACCGCTCTGCGCGAATCCCGTCAAACAAA A P R N T K R W I H Y R S A R I P S N K A P R N T K R W I H Y R S A R I P S N K ATCACGGAGCATAAGGGGATTCGCTTCACCACAATGGAACGCTCTATTGGAGATCTCTGC I T E H K G I R F T T M E R S I G D L C I T E H K G I R F T T M E R S I G D L C CGATGGGGAACGTTCGCAGAGGGGCTTGTCGCTGTGAAATCCTATTTGCGCCAAGAGGAT R W G T F A E G L V A V K S Y L R Q E D R W G T F A E G L V A V E S Y L R Q E D GCCCAGCCGTTTTTTGCTGGAACAGGAGTTAGAAGAGTTTGGACGAATTCCAGGGGTGCG A Q P F L L E Q E L E E F G R I P G V R A Q P F - L L E Q E L E E F G R I P G V R TAAATTCCGTCGGGTATTGCAAGTGGCTGATTCCAAGTCGGAAAGTGTCGCCGAGTCGTG K F R R V L Q V A D S K S E S V A E S W K F R R V L Q V A D S K S E S V A E S W GGCAAAAGCGAAGCTCATCGAAGCAAAAATCACGTTCGAGCAGCAGGTGCAGATCAATAA A K A K L I E A K I T F E Q Q V Q I N N A K A Q L I E A K I T F E Q Q V Q I N N TCGTCGTGCCGACTTTCTCGTCGGAAGCGTTGTCGTAGAAATCGATGGAGACATCAAGTT R R A D F L V G S V V V E I D G D I K F R R A D F L V G R V V I E I D G D I K F CCATGACGACGAACCGAGGGCAGTGCTCAAGGAGCGGAAACGCGACCGCGAACTTCAAAA H D D E P R A V L K E R K R D R E L Q N H D D E S R A V L K E R K R D R E L Q N TGCCGGCTATGTGGTGGCGCATTTTGACTGGGAGTCACTGAACTCGGGAACTTTCATCCC A G Y V V A H F D W E S L N S G T F I P A G Y V V A H F D W E S L N S G T F I P CTCGCTTCTCCGCCTCCTCGAATCCACGAACACAAAAACCCAAGGACGCTGA S L L R L L E S T N T K T Q G R S L L R L L E F T N T K T Q G R --- // >fig|6666666.67449.peg.202 fig|257309.1.peg.213 Putative membrane protein gi|372109441|gb|CP003213.1|_176139_175993,gi|372109441|gb|CP003213.1|_175989_175972 MDPSEEKIFEESTVVWQWWMWAIAAAAALVLILLAWWLRKNSRKAQRSNxIQRSN We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGACCCCTCAGAAGAAAAGATCTTCGAAGAGTCCACAGTGGTATGGCAATGGTGGATG M D P S E E K I F E E S T V V W Q W W M M D P S E E K I F E E S T V V W Q W W M TGGGCCATCGCCGCCGCAGCCGCGCTCGTACTGATCCTGCTCGCCTGGTGGCTACGCAAG W A I A A A A A L V L I L L A W W L R K W A I A A A A A L V L I L L A W W L R K AACAGTCGCAAAGCACAGCGCAGCAACTAGATACAGCGCAGCAACTAG N S R K A Q R S N * I Q R S N N S R K A Q R S N X I Q R S N --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.213): ATGGACCCCTCAGAAGAAAAGATCTTCGAAGAGTCCACAGTGGTATGGCAATGGTGGATG M D P S E E K I F E E S T V V W Q W W M M D R S E E K V F E E S T V V W Q W W M TGGGCCATCGCCGCCGCAGCCGCGCTCGTACTGATCCTGCTCGCCTGGTGGCTACGCAAG W A I A A A A A L V L I L L A W W L R K W A I V A A A A L V L I L L A W W L R K AACAGTCGCAAAGCACAGCGCAGCAACTAGATACAGCGCAGCAACTAG N S R K A Q R S N * I Q R S N N S R K A Q R S N L T Q R S N --- // >fig|6666666.67449.peg.1591 fig|257309.1.peg.1555 putative secreted protein FIG066009 gi|372109441|gb|CP003213.1|_1621285_1621139,gi|372109441|gb|CP003213.1|_1621139_1620522 MYFRNLIETLKLSPNDGPHDLHNLKRSIPPMVLESLEGPLKGRPRRLGxxSVAKHRRNDNSTARKAVATSAAVVGAAATLSAPAQAAEVVVPNTGIRFEVPGIENVPGIANVPGADQWIPSLAGQGAPANYSALVGAPAASNGQAVVDAARSRIGSPYVWGAAGPNAFDCSGLTSWAYAQVGKSIPRTSYAQAAGGMQVSRESLQPGDIIAFYSGASHVGIYTGNGTVIHALTEGTPLSETPIDYMPFYNAVRY We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. TTGTACTTTCGTAACCTAATCGAGACATTGAAATTGAGCCCGAACGATGGGCCGCACGAC L Y F R N L I E T L K L S P N D G P H D M Y F R N L I E T L K L S P N D G P H D TTACATAATTTGAAAAGGTCAATACCTCCGATGGTTTTAGAATCGTTGGAGGGTCCGCTA L H N L K R S I P P M V L E S L E G P L L H N L K R S I P P M V L E S L E G P L AAAGGACGACCTCGAAGATTGGGA*GA*ATCTCCGTGGCTAAGCATCGCCGTAACGACAA K G R P R R L G I S V A K H R R N D N K G R P R R L G *X** X S V A K H R R N D N CTCAACCGCACGCAAGGCAGTGGCTACTTCCGCTGCAGTTGTAGGCGCCGCAGCTACGCT S T A R K A V A T S A A V V G A A A T L S T A R K A V A T S A A V V G A A A T L TTCAGCGCCTGCTCAAGCAGCTGAGGTTGTTGTTCCAAACACCGGTATCCGTTTTGAGGT S A P A Q A A E V V V P N T G I R F E V S A P A Q A A E V V V P N T G I R F E V TCCTGGTATCGAAAACGTTCCTGGAATTGCAAACGTTCCTGGTGCTGATCAGTGGATCCC P G I E N V P G I A N V P G A D Q W I P P G I E N V P G I A N V P G A D Q W I P ATCCTTGGCTGGTCAGGGTGCGCCTGCTAACTACTCGGCGCTCGTCGGAGCTCCAGCGGC S L A G Q G A P A N Y S A L V G A P A A S L A G Q G A P A N Y S A L V G A P A A AAGCAATGGTCAAGCAGTTGTGGATGCTGCTCGCTCTCGCATCGGCAGCCCGTACGTTTG S N G Q A V V D A A R S R I G S P Y V W S N G Q A V V D A A R S R I G S P Y V W GGGCGCGGCTGGCCCTAACGCTTTTGACTGCTCCGGTTTGACCTCGTGGGCTTATGCTCA G A A G P N A F D C S G L T S W A Y A Q G A A G P N A F D C S G L T S W A Y A Q GGTTGGTAAGAGCATTCCTCGTACCTCCTACGCACAGGCTGCTGGTGGTATGCAGGTTTC V G K S I P R T S Y A Q A A G G M Q V S V G K S I P R T S Y A Q A A G G M Q V S TCGTGAAAGCCTTCAGCCAGGTGACATTATCGCTTTCTACTCTGGCGCATCCCATGTGGG R E S L Q P G D I I A F Y S G A S H V G R E S L Q P G D I I A F Y S G A S H V G AATCTACACCGGTAATGGAACTGTTATCCATGCGTTAACGGAGGGTACTCCTTTGTCGGA I Y T G N G T V I H A L T E G T P L S E I Y T G N G T V I H A L T E G T P L S E AACCCCAATCGATTACATGCCTTTCTATAACGCAGTGCGTTACTAA T P I D Y M P F Y N A V R Y T P I D Y M P F Y N A V R Y --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1555): TTGTACTTTCGTAACCTAATCGAGACATTGAAATTGAGCCCGAACGATGGGCCGCACGAC L Y F R N L I E T L K L S P N D G P H D M Y F R N L I E T L K L S P N D G P H D TTACATAATTTGAAAAGGTCAATACCTCCGATGGTTTTAGAATCGTTGGAGGGTCCG*CT L H N L K R S I P P M V L E S L E G P L H N L K R S I P P M V L E S L E G P *L* *AAAAGGACGACCTCGAAGATTGGGAGAATCTCCGTGGCTAAGCATCGCCGTAACGACAA K R T T S K I G R I S V A K H R R N D N * K R T T S K I G R I S V A K H R R N D N CTCAACCGCACGCAAGGCAGTGGCTACTTCCGCTGCAGTTGTAGGCGCCGCAGCTACGCT S T A R K A V A T S A A V V G A A A T L S T A R K A V A T S A A V V G A A A T L TTCAGCGCCTGCTCAAGCAGCTGAGGTTGTTGTTCCAAACACCGGTATCCGTTTTGAGGT S A P A Q A A E V V V P N T G I R F E V S A P A Q A A E V V V P N T G I R F E V TCCTGGTATCGAAAACGTTCCTGGAATTGCAAACGTTCCTGGTGCTGATCAGTGGATCCC P G I E N V P G I A N V P G A D Q W I P P G I E N V P G I A N V P G A D Q W I P ATCCTTGGCTGGTCAGGGTGCGCCTGCTAACTACTCGGCGCTCGTCGGAGCTCCAGCGGC S L A G Q G A P A N Y S A L V G A P A A S L A G Q G A P V N Y S A L V G A P V A AAGCAATGGTCAAGCAGTTGTGGATGCTGCTCGCTCTCGCATCGGCAGCCCGTACGTTTG S N G Q A V V D A A R S R I G S P Y V W S N G Q A V V D A A R S R I G S P Y V W GGGCGCGGCTGGCCCTAACGCTTTTGACTGCTCCGGTTTGACCTCGTGGGCTTATGCTCA G A A G P N A F D C S G L T S W A Y A Q G A A G P N A F D C S G L T S W A Y A Q GGTTGGTAAGAGCATTCCTCGTACCTCCTACGCACAGGCTGCTGGTGGTATGCAGGTTTC V G K S I P R T S Y A Q A A G G M Q V S V G K S I P R T S Y A Q A A G G M Q V S TCGTGAAAGCCTTCAGCCAGGTGACATTATCGCTTTCTACTCTGGCGCATCCCATGTGGG R E S L Q P G D I I A F Y S G A S H V G R E S L Q P G D I I A F Y S G A S H V G AATCTACACCGGTAATGGAACTGTTATCCATGCGTTAACGGAGGGTACTCCTTTGTCGGA I Y T G N G T V I H A L T E G T P L S E I Y T G N G T V I H A L T E G T P L S E AACCCCAATCGATTACATGCCTTTCTATAACGCAGTGCGTTACTAA T P I D Y M P F Y N A V R Y T P I D Y M P F Y N A V R Y --- // >fig|6666666.67449.peg.57 fig|257309.1.peg.54 Lead, cadmium, zinc and mercury transporting ATPase (EC 3.6.3.3) (EC 3.6.3.5); Copper-translocating P-type ATPase (EC 3.6.3.4) FIG025203 gi|372109441|gb|CP003213.1|_58286_56865,gi|372109441|gb|CP003213.1|_56865_56062 MSTPHHSGDHPAPETDHTHHPDHASHEHHADPDTHGQAMPHDHPHSALDEDHHVHGHGEHAGHSTAMFRDRFWWSLILSIPVVIFSPMVAHLLGYHLPAFPGSTWIPPVLGTIIFVYGGTPFLKGGWKELKSRQPGMMLLIAMAITVAFVASWVTTLGLGGFELDFWWELALLVTIMLLGHWLEMSALGAASSALDALAALLPDEAEKVIDGTTRTVAISELVVDDVVLVRAGARVPADGTILDGAAEFDEAMITGESRPVFRDTGDKVVAGTVATDNTVRIRVEATGGDTALAGIQRMVADAQESSSRAQALADRAAALLFWFALISALITAVVWTIIGSPDDAVVRTVTVLVIACPHALGLAIPLVIAISSERAAKSGVLIKDRMALERMRTIDVVLFDKTGTLTEGAHAVTGVAAAVGVTEGELLALAAAAEADSEHPVARAIVAAAAAHPEASRRQIRATGFSAASGRGxxRATVDGAEILVGGPNMLREFNLTTPAELTDTTSAWTGRGAGVLHIVRDGQIIGAVAVEDKIRPESRAAVKALQDRGVKVAMITGDAQQVAQAVGQDLGIDEVFAEVLPQDKDTKVTQLQDRGLSVAMVGDGVNDAPALTRADVGIAIGAGTDVAMESAGVVLASDDPRAVLSMIELSQASYRKMIQNLIWASGYNILAVPLAAGVLASIGFVLSPAVGAILMSASTIVVALNAQLLRRIDLDPAHPAPTESKEEHTTPTPASTAVH We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGCACTCCCCACCATTCCGGTGATCACCCCGCTCCGGAAACAGACCACACCCACCAC M S T P H H S G D H P A P E T D H T H H M S T P H H S G D H P A P E T D H T H H CCAGATCATGCCAGCCACGAACACCACGCAGATCCCGACACCCACGGCCAGGCGATGCCC P D H A S H E H H A D P D T H G Q A M P P D H A S H E H H A D P D T H G Q A M P CACGATCACCCGCACTCCGCCCTGGACGAAGACCACCACGTGCATGGTCACGGCGAACAC H D H P H S A L D E D H H V H G H G E H H D H P H S A L D E D H H V H G H G E H GCCGGACACAGCACCGCAATGTTTCGGGACCGCTTCTGGTGGTCTCTGATTCTGTCCATT A G H S T A M F R D R F W W S L I L S I A G H S T A M F R D R F W W S L I L S I CCCGTCGTTATTTTCAGCCCCATGGTCGCCCACCTGCTCGGCTACCACCTCCCGGCATTC P V V I F S P M V A H L L G Y H L P A F P V V I F S P M V A H L L G Y H L P A F CCCGGATCCACCTGGATCCCCCCGGTGCTAGGCACGATCATCTTCGTCTACGGCGGAACG P G S T W I P P V L G T I I F V Y G G T P G S T W I P P V L G T I I F V Y G G T CCTTTCCTCAAGGGCGGATGGAAAGAACTGAAATCCCGCCAACCCGGGATGATGCTCCTG P F L K G G W K E L K S R Q P G M M L L P F L K G G W K E L K S R Q P G M M L L ATCGCCATGGCCATCACCGTGGCGTTTGTCGCCTCCTGGGTCACCACTCTGGGGCTGGGC I A M A I T V A F V A S W V T T L G L G I A M A I T V A F V A S W V T T L G L G GGTTTTGAGCTGGACTTCTGGTGGGAGCTGGCCCTGCTGGTGACCATCATGCTGCTGGGC G F E L D F W W E L A L L V T I M L L G G F E L D F W W E L A L L V T I M L L G CACTGGCTGGAGATGTCCGCTCTCGGGGCCGCGTCCTCCGCGCTTGATGCGCTGGCTGCC H W L E M S A L G A A S S A L D A L A A H W L E M S A L G A A S S A L D A L A A CTGCTGCCGGATGAGGCCGAGAAAGTCATCGACGGGACCACCCGCACCGTGGCCATCTCC L L P D E A E K V I D G T T R T V A I S L L P D E A E K V I D G T T R T V A I S GAGCTGGTCGTCGACGACGTCGTGCTGGTGAGGGCCGGTGCCCGGGTGCCGGCCGACGGA E L V V D D V V L V R A G A R V P A D G E L V V D D V V L V R A G A R V P A D G ACCATCCTCGACGGAGCCGCCGAATTCGATGAGGCGATGATCACCGGCGAATCCCGTCCC T I L D G A A E F D E A M I T G E S R P T I L D G A A E F D E A M I T G E S R P GTCTTCCGCGACACCGGTGACAAGGTGGTCGCCGGTACCGTGGCCACCGACAACACCGTC V F R D T G D K V V A G T V A T D N T V V F R D T G D K V V A G T V A T D N T V CGCATCCGGGTGGAGGCTACCGGCGGGGACACCGCCCTGGCCGGGATCCAACGCATGGTT R I R V E A T G G D T A L A G I Q R M V R I R V E A T G G D T A L A G I Q R M V GCCGACGCCCAGGAGTCCTCCTCCCGGGCCCAGGCCCTGGCGGATCGGGCGGCGGCGTTG A D A Q E S S S R A Q A L A D R A A A L A D A Q E S S S R A Q A L A D R A A A L TTGTTCTGGTTCGCGCTGATCTCCGCTCTGATCACCGCGGTGGTGTGGACCATCATCGGC L F W F A L I S A L I T A V V W T I I G L F W F A L I S A L I T A V V W T I I G AGCCCGGACGATGCCGTGGTGCGCACAGTCACGGTGCTGGTCATCGCCTGCCCGCACGCC S P D D A V V R T V T V L V I A C P H A S P D D A V V R T V T V L V I A C P H A CTGGGCCTGGCGATTCCGCTGGTCATTGCGATCTCCAGCGAGCGGGCTGCGAAATCCGGG L G L A I P L V I A I S S E R A A K S G L G L A I P L V I A I S S E R A A K S G GTGCTCATCAAGGACCGGATGGCGCTCGAGCGGATGCGCACCATCGACGTGGTGCTCTTC V L I K D R M A L E R M R T I D V V L F V L I K D R M A L E R M R T I D V V L F GACAAAACCGGCACCCTGACCGAGGGTGCGCACGCGGTCACCGGTGTCGCGGCAGCTGTC D K T G T L T E G A H A V T G V A A A V D K T G T L T E G A H A V T G V A A A V GGCGTCACCGAGGGCGAGCTGCTGGCCCTAGCCGCCGCCGCGGAGGCCGACAGCGAGCAC G V T E G E L L A L A A A A E A D S E H G V T E G E L L A L A A A A E A D S E H CCCGTGGCCCGCGCCATCGTGGCGGCCGCGGCCGCCCATCCCGAGGCCTCCCGTCGGCAA P V A R A I V A A A A A H P E A S R R Q P V A R A I V A A A A A H P E A S R R Q ATCCGTGCAACTGGTTTCAGCGCCGCCTCCGGCCGGGGG*GG*GTTCGGGCCACTGTCGA I R A T G F S A A S G R G V R A T V D I R A T G F S A A S G R G *X** X R A T V D TGGCGCTGAGATCCTCGTGGGCGGGCCGAACATGCTGCGCGAGTTCAACCTCACCACCCC G A E I L V G G P N M L R E F N L T T P G A E I L V G G P N M L R E F N L T T P GGCCGAGCTCACCGACACCACCAGCGCCTGGACCGGGCGTGGGGCCGGTGTGCTCCATAT A E L T D T T S A W T G R G A G V L H I A E L T D T T S A W T G R G A G V L H I TGTCCGCGACGGTCAGATCATCGGTGCGGTGGCCGTCGAGGACAAGATCCGCCCCGAATC V R D G Q I I G A V A V E D K I R P E S V R D G Q I I G A V A V E D K I R P E S CCGCGCCGCCGTGAAAGCCCTGCAGGACCGCGGGGTGAAGGTCGCGATGATCACCGGCGA R A A V K A L Q D R G V K V A M I T G D R A A V K A L Q D R G V K V A M I T G D CGCGCAGCAGGTGGCCCAGGCGGTTGGTCAGGACCTAGGCATTGATGAGGTCTTCGCCGA A Q Q V A Q A V G Q D L G I D E V F A E A Q Q V A Q A V G Q D L G I D E V F A E GGTCCTGCCCCAGGACAAAGACACCAAGGTCACGCAGCTGCAGGACCGGGGTTTGAGCGT V L P Q D K D T K V T Q L Q D R G L S V V L P Q D K D T K V T Q L Q D R G L S V GGCCATGGTCGGTGACGGTGTCAATGACGCCCCCGCTCTGACCCGCGCGGACGTCGGTAT A M V G D G V N D A P A L T R A D V G I A M V G D G V N D A P A L T R A D V G I CGCCATCGGTGCCGGCACGGATGTGGCCATGGAATCTGCCGGGGTGGTCCTAGCCAGTGA A I G A G T D V A M E S A G V V L A S D A I G A G T D V A M E S A G V V L A S D TGACCCGCGGGCAGTGCTGTCGATGATTGAGCTGTCCCAGGCCAGCTACCGCAAGATGAT D P R A V L S M I E L S Q A S Y R K M I D P R A V L S M I E L S Q A S Y R K M I CCAGAACCTGATCTGGGCCTCTGGCTACAACATCCTCGCCGTGCCGTTGGCCGCCGGAGT Q N L I W A S G Y N I L A V P L A A G V Q N L I W A S G Y N I L A V P L A A G V GCTCGCCTCGATCGGGTTCGTGCTGTCCCCGGCCGTGGGCGCGATCTTAATGTCTGCCTC L A S I G F V L S P A V G A I L M S A S L A S I G F V L S P A V G A I L M S A S GACCATCGTGGTGGCCCTGAACGCCCAGCTGTTACGCCGCATTGATCTGGATCCGGCTCA T I V V A L N A Q L L R R I D L D P A H T I V V A L N A Q L L R R I D L D P A H CCCGGCTCCGACCGAGTCGAAAGAGGAACACACCACGCCTACTCCGGCATCCACCGCCGT P A P T E S K E E H T T P T P A S T A V P A P T E S K E E H T T P T P A S T A V CCACTGA H H --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.54): ATGAGCACTCCCCACCATTCCGGTGATCAC----CCCGCTCCGGAAACAGACCACACCCA M S T P H H S G D H P A P E T D H T H M N T P N H S G D H HGDH P A P E T D H T Y CCACCCAGATCATGCCAGCCACGAACACCACGCAGATCCCGACACCCACGGCCAGGCGAT H P D H A S H E H H A D P D T H G Q A M H P D H A S H E H H A D A D T H G H A K GCCCCACGATCACCCGCACTCCGCCCTGGACGAAGACCACCACGTGCATGGTCACGGCGA P H D H P H S A L D E D H H V H G H G E P H D H P H S A L D E D H H V H G H G E ACACGCCGGACACAGCACCGCAATGTTTCGGGACCGCTTCTGGTGGTCTCTGATTCTGTC H A G H S T A M F R D R F W W S L I L S H A G H S T A M F R E R F W W S L I L S CATTCCCGTCGTTATTTTCAGCCCCATGGTCGCCCACCTGCTCGGCTACCACCTCCCGGC I P V V I F S P M V A H L L G Y H L P A I P V V I F S P M V A H L L G Y H L P A ATTCCCCGGATCCACCTGGATCCCCCCGGTGCTAGGCACGATCATCTTCGTCTACGGCGG F P G S T W I P P V L G T I I F V Y G G F P G S T W I P P V L G T I I F V Y G G AACGCCTTTCCTCAAGGGCGGATGGAAAGAACTGAAATCCCGCCAACCCGGGATGATGCT T P F L K G G W K E L K S R Q P G M M L T P F L K G G W N E L K S R Q P G M M L CCTGATCGCCATGGCCATCACCGTGGCGTTTGTCGCCTCCTGGGTCACCACTCTGGGGCT L I A M A I T V A F V A S W V T T L G L L I A M A I T V A F V A S W V T T L G L GGGCGGTTTTGAGCTGGACTTCTGGTGGGAGCTGGCCCTGCTGGTGACCATCATGCTGCT G G F E L D F W W E L A L L V T I M L L G G F E L D F W W E L A L L V T I M L L GGGCCACTGGCTGGAGATGTCCGCTCTCGGGGCCGCGTCCTCCGCGCTTGATGCGCTGGC G H W L E M S A L G A A S S A L D A L A G H W L E M S A L G A A S S A L D A L A TGCCCTGCTGCCGGATGAGGCCGAGAAAGTCATCGACGGGACCACCCGCACCGTGGCCAT A L L P D E A E K V I D G T T R T V A I A L L P D E A E K V I D G T T R T V A I CTCCGAGCTGGTCGTCGACGACGTCGTGCTGGTGAGGGCCGGTGCCCGGGTGCCGGCCGA S E L V V D D V V L V R A G A R V P A D S E L I V D D V V L V R A G A R V P A D CGGAACCATCCTCGACGGAGCCGCCGAATTCGATGAGGCGATGATCACCGGCGAATCCCG G T I L D G A A E F D E A M I T G E S R G T I L D G A A E F D E A M I T G E S R TCCCGTCTTCCGCGACACCGGTGACAAGGTGGTCGCCGGTACCGTGGCCACCGACAACAC P V F R D T G D K V V A G T V A T D N T P V F R D T G D K V V A G T V A T D N T CGTCCGCATCCGGGTGGAGGCTACCGGCGGGGACACCGCCCTGGCCGGGATCCAACGCAT V R I R V E A T G G D T A L A G I Q R M V R I R V E A T G G D T A L A G I Q R M GGTTGCCGACGCCCAGGAGTCCTCCTCCCGGGCCCAGGCCCTGGCGGATCGGGCGGCGGC V A D A Q E S S S R A Q A L A D R A A A V A D A Q E S S S R A Q A L A D R A A A GTTGTTGTTCTGGTTCGCGCTGATCTCCGCTCTGATCACCGCGGTGGTGTGGACCATCAT L L F W F A L I S A L I T A V V W T I I L L F W F A L I S A L I T A V V W T I I CGGCAGCCCGGACGATGCCGTGGTGCGCACAGTCACGGTGCTGGTCATCGCCTGCCCGCA G S P D D A V V R T V T V L V I A C P H G S P D D A V V R T V T V L V I A C P H CGCCCTGGGCCTGGCGATTCCGCTGGTCATTGCGATCTCCAGCGAGCGGGCTGCGAAATC A L G L A I P L V I A I S S E R A A K S A L G L A I P L V I A I S S E R A A K S CGGGGTGCTCATCAAGGACCGGATGGCGCTCGAGCGGATGCGCACCATCGACGTGGTGCT G V L I K D R M A L E R M R T I D V V L G V L I K D R M A L E R M R T I D V V L CTTCGACAAAACCGGCACCCTGACCGAGGGTGCGCACGCGGTCACCGGTGTCGCGGCAGC F D K T G T L T E G A H A V T G V A A A F D K T G T L T E G A H A V T G V A A A TGTCGGCGTCACCGAGGGCGAGCTGCTGGCCCTAGCCGCCGCCGCGGAGGCCGACAGCGA V G V T E G E L L A L A A A A E A D S E V G V T E G E L L A L A A A A E A D S E GCACCCCGTGGCCCGCGCCATCGTGGCGGCCGCGGCCGCCCATCCCGAGGCCTCCCGTCG H P V A R A I V A A A A A H P E A S R R H P V A R A I V A A A A A H P E A S R R GCAAATCCGTGCAACTGGTTTCAGCGCCGCCTCCGGCCGGGGGGGGTTCGGGCCACTGTC Q I R A T G F S A A S G R G V R A T V Q I R A T G F S A A S G R G -- V R A T V GATGGCGCTGAGATCCTCGTGGGCGGGCCGAACATGCTGCGCGAGTTCAACCTCACCACC D G A E I L V G G P N M L R E F N L T T D G A E I L V G G P N M L R E F N L T T CCGGCCGAGCTCACCGACACCACCAGCGCCTGGACCGGGCGTGGGGCCGGTGTGCTCCAT P A E L T D T T S A W T G R G A G V L H P A E L T D T T S A W T G R G A G V L H ATTGTCCGCGACGGTCAGATCATCGGTGCGGTGGCCGTCGAGGACAAGATCCGCCCCGAA I V R D G Q I I G A V A V E D K I R P E I V R D G Q I I G A V A V E D K I R P E TCCCGCGCCGCCGTGAAAGCCCTGCAGGACCGCGGGGTGAAGGTCGCGATGATCACCGGC S R A A V K A L Q D R G V K V A M I T G S R A A V K A L Q D R G V K V A M I T G GACGCGCAGCAGGTGGCCCAGGCGGTTGGTCAGGACCTAGGCATTGATGAGGTCTTCGCC D A Q Q V A Q A V G Q D L G I D E V F A D A Q Q V A Q A V G Q D L G I D E V F A GAGGTCCTGCCCCAGGACAAAGACACCAAGGTCACGCAGCTGCAGGACCGGGGTTTGAGC E V L P Q D K D T K V T Q L Q D R G L S E V L P Q D K D T K V T Q L Q D R G L S GTGGCCATGGTCGGTGACGGTGTCAATGACGCCCCCGCTCTGACCCGCGCGGACGTCGGT V A M V G D G V N D A P A L T R A D V G V A M V G D G V N D A P A L T R A D V G ATCGCCATCGGTGCCGGCACGGATGTGGCCATGGAATCTGCCGGGGTGGTCCTAGCCAGT I A I G A G T D V A M E S A G V V L A S I A I G A G T D V A M E S A G V V L A S GATGACCCGCGGGCAGTGCTGTCGATGATTGAGCTGTCCCAGGCCAGCTACCGCAAGATG D D P R A V L S M I E L S Q A S Y R K M D D P R A V L S M I E L S Q A S Y R K M ATCCAGAACCTGATCTGGGCCTCTGGCTACAACATCCTCGCCGTGCCGTTGGCCGCCGGA I Q N L I W A S G Y N I L A V P L A A G I Q N L I W A S G Y N I L A V P L A A G GTGCTCGCCTCGATCGGGTTCGTGCTGTCCCCGGCCGTGGGCGCGATCTTAATGTCTGCC V L A S I G F V L S P A V G A I L M S A V L A S I G F V L S P A V G A I L M S A TCGACCATCGTGGTGGCCCTGAACGCCCAGCTGTTACGCCGCATTGATCTGGATCCGGCT S T I V V A L N A Q L L R R I D L D P A S T I V V A L N A Q L L R R I D L D P A CACCCGGCTCCGACCGAGTCGAAAGAGGAACACACCACGCCTACTCCGGCATCCACCGCC H P A P T E S K E E H T T P T P A S T A H L A P T E S K E E H T T P T P A S T A GTCCACTGA V H V H --- // >fig|6666666.67449.peg.1410 fig|257309.1.peg.2310 PTS system, fructose-specific IIA component (EC 2.7.1.69) FIG001487 gi|372109441|gb|CP003213.1|_1426872_1427117,gi|372109441|gb|CP003213.1|_1427117_1427248 MFLVLGKPLSLLLLSLQNWLAGLSGSSAIILGAVLGLMMCFDLGGPVNKAAYLFVTAGLSTNEPAALHIMAAVMVAGMLPPxxALSLATIMDKKVFTDTERENGKSAWLLGLSFISEGAIPFYRR We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGTTCTTAGTTTTAGGCAAACCCCTTTCATTGTTGCTGTTATCCCTCCAAAACTGGCTG M F L V L G K P L S L L L L S L Q N W L M F L V L G K P L S L L L L S L Q N W L GCAGGACTATCGGGTTCTTCAGCCATCATTCTTGGGGCAGTGCTGGGACTTATGATGTGT A G L S G S S A I I L G A V L G L M M C A G L S G S S A I I L G A V L G L M M C TTCGACCTCGGTGGCCCTGTAAATAAAGCAGCATATTTATTTGTTACCGCAGGCCTGTCC F D L G G P V N K A A Y L F V T A G L S F D L G G P V N K A A Y L F V T A G L S ACCAATGAACCTGCTGCGCTTCATATTATGGCGGCAGTCATGGTCGCAGGTATGCTCCCC T N E P A A L H I M A A V M V A G M L P T N E P A A L H I M A A V M V A G M L P CCC*CG*ATTGCACTTTCTTTAGCCACCATTATGGATAAAAAAGTGTTTACAGATACCGA P I A L S L A T I M D K K V F T D T E P *X** X A L S L A T I M D K K V F T D T E ACGAGAAAACGGAAAATCAGCGTGGCTTTTAGGACTTTCCTTCATTTCTGAAGGAGCGAT R E N G K S A W L L G L S F I S E G A I R E N G K S A W L L G L S F I S E G A I CCCTTTTTACCGCAGGTGA P F Y R R P F Y R R --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2310): ATGTTCTTAGTTTTAGGCAAACCCCTTTCATTGTTGCTGTTATCCCTCCAAAACTGGCTG M F L V L G K P L S L L L L S L Q N W L M F L V L G K P L S L L L L S L Q N W L GCAGGACTATCGGGTTCTTCAGCCATCATTCTTGGGGCAGTGCTGGGACTTATGATGTGT A G L S G S S A I I L G A V L G L M M C A G L S G S S A I I L G A V L G L M M C TTCGACCTCGGTGGCCCTGTAAATAAAGCAGCATATTTATTTGTTACCGCAGGCCTGTCC F D L G G P V N K A A Y L F V T A G L S F D L G G P V N K A A Y L F V T A G L S ACCAATGAACCTGCTGCGCTTCATATTATGGCGGCAGTCATGGTCGCAGGTATGCTCCCC T N E P A A L H I M A A V M V A G M L P T N E P A A L H I M A A V M V A G M L P CCCCGATTGCACTTTCTTTAGCCACCATTATGGATAAAAAAGTGTTTACAGATACCGAAC P I A L S L A T I M D K K V F T D T E P -- I A L S L A T I M D K K V F T D T E GAGAAAACGGAAAATCAGCGTGGCTTTTAGGACTTTCCTTCATTTCTGAAGGAGCGATCC R E N G K S A W L L G L S F I S E G A I R E N G K S A W L L G L S F I S E G A I CTTTTTACCGCAGGTGA P F Y R R P F Y R R --- // >fig|6666666.67449.peg.1984 fig|257309.1.peg.1910 Transposase gi|372109441|gb|CP003213.1|_2013929_2014528,gi|372109441|gb|CP003213.1|_2014530_2014895 MAYDFVIGMDVGKYFHHACVLDPQGRQVLSQRINQHEGSLRKIFGKFLANDAEVLVVVDQPNNIGRLTVTVAQTIGADVRYLPRLAMRQLSRIHVGNSKTDVRDAYVIAHAGLNLPDALRSVDRVEDVFLQLKVPNGIDENLARAYTDLGFPVVIACVDDGVAVSLGSACRDSLSAAAVAALNEAWAFYPERQRVRSAGAIRSVLDHANQVSLPEWTTPIDRLFGADQPPRRCSKAEDSVTPSALAALIDAGFDPIRINTTLAEVQEYGLTAVTVVVPGLVPIDFGWDRQRAQFMERPAQLCSQATGGIINPLETTCHPFA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCCTATGACTTCGTCATTGGCATGGACGTCGGCAAATACTTCCACCACGCCTGCGTC M A Y D F V I G M D V G K Y F H H A C V M A Y D F V I G M D V G K Y F H H A C V CTCGATCCCCAAGGCAGACAAGTCCTATCCCAACGCATCAACCAGCACGAAGGATCGCTA L D P Q G R Q V L S Q R I N Q H E G S L L D P Q G R Q V L S Q R I N Q H E G S L CGCAAGATCTTCGGCAAATTCCTAGCCAATGACGCCGAAGTCCTTGTCGTCGTCGATCAG R K I F G K F L A N D A E V L V V V D Q R K I F G K F L A N D A E V L V V V D Q CCCAACAACATCGGCCGACTCACCGTCACAGTCGCCCAAACAATCGGAGCCGACGTTCGC P N N I G R L T V T V A Q T I G A D V R P N N I G R L T V T V A Q T I G A D V R TACCTCCCCAGACTTGCCATGCGACAGCTTTCACGCATCCACGTCGGCAACTCCAAGACC Y L P R L A M R Q L S R I H V G N S K T Y L P R L A M R Q L S R I H V G N S K T GATGTACGCGACGCCTACGTCATCGCCCATGCCGGCCTCAACCTTCCGGATGCCCTGCGT D V R D A Y V I A H A G L N L P D A L R D V R D A Y V I A H A G L N L P D A L R AGTGTCGACCGCGTGGAGGACGTCTTCCTCCAGCTGAAAGTCCCCAACGGAATCGACGAA S V D R V E D V F L Q L K V P N G I D E S V D R V E D V F L Q L K V P N G I D E AACCTCGCCCGCGCCTATACCGATCTCGGATTCCCCGTGGTTATCGCCTGCGTCGACGAC N L A R A Y T D L G F P V V I A C V D D N L A R A Y T D L G F P V V I A C V D D GGCGTGGCAGTGTCTTTAGGATCGGCCTGCCGCGATTCGCTTAGTGCTGCAGCCGTCGCA G V A V S L G S A C R D S L S A A A V A G V A V S L G S A C R D S L S A A A V A GCCCTCAACGAAGCTTGGGCTTTTTACCCCGAGCGGCAGCGCGTTCGCAGTGCCGGAGCA A L N E A W A F Y P E R Q R V R S A G A A L N E A W A F Y P E R Q R V R S A G A TATTCGTTCTGTCCTTGACCACGCTAATCAGGTGTCACTCCCAGAGTGGACAACCCCCAT I R S V L D H A N Q V S L P E W T T P I - I R S V L D H A N Q V S L P E W T T P I CGACAGGCTATTCGGCGCAGATCAACCACCGCGTCGGTGCAGCAAGGCTGAAGACTCAGT D R L F G A D Q P P R R C S K A E D S V D R L F G A D Q P P R R C S K A E D S V TACCCCGTCTGCTCTCGCAGCGCTTATCGACGCCGGCTTTGACCCCATCCGCATAAACAC T P S A L A A L I D A G F D P I R I N T T P S A L A A L I D A G F D P I R I N T CACGCTGGCCGAGGTCCAGGAATATGGCCTCACAGCCGTGACCGTGGTCGTCCCAGGCCT T L A E V Q E Y G L T A V T V V V P G L T L A E V Q E Y G L T A V T V V V P G L CGTCCCTATCGACTTTGGTTGGGACCGCCAACGAGCACAGTTTATGGAGCGACCCGCCCA V P I D F G W D R Q R A Q F M E R P A Q V P I D F G W D R Q R A Q F M E R P A Q GCTTTGCAGCCAAGCAACCGGTGGCATCATAAACCCATTAGAAACGACGTGCCACCCCTT L C S Q A T G G I I N P L E T T C H P F L C S Q A T G G I I N P L E T T C H P F TGCGTAA A A --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1910): ATGGCCTATGACTTCGTCATTGGCATGGACGTCGGCAAATACTTCCACCACGCCTGCGTC M A Y D F V I G M D V G K Y F H H A C V M A Y D F V I G M D V G K Y F H H A C V CTCGATCCCCAAGGCAGACAAGTCCTATCCCAACGCATCAACCAGCACGAAGGATCGCTA L D P Q G R Q V L S Q R I N Q H E G S L L D P Q S R Q V L S Q R I N Q H E G S L CGCAAGATCTTCGGCAAATTCCTAGCCAATGACGCCGAAGTCCTTGTCGTCGTCGATCAG R K I F G K F L A N D A E V L V V V D Q R K L F G K F L A N N V E V L V V V D Q CCCAACAACATCGGCCGACTCACCGTCACAGTCGCCCAAACAATCGGAGCCGACGTTCGC P N N I G R L T V T V A Q T I G A D V R P N N I G R L T V T V A Q T I G A D V R TACCTCCCCAGACTTGCCATGCGACAGCTTTCACGCATCCACGTCGGCAACTCCAAGACC Y L P R L A M R Q L S R I H V G N S K T Y L P R L A M R Q L S R I H V G N S K T GATGTACGCGACGCCTACGTCATCGCCCATGCCGGCCTCAACCTTCCGGATGCCCTGCGT D V R D A Y V I A H A G L N L P D A L R D V R D A Y V I A H A G L N L P D A L R AGTGTCGACCGCGTGGAGGACGTCTTCCTCCAGCTGAAAGTCCCCAACGGAATCGACGAA S V D R V E D V F L Q L K V P N G I D E S V D R V E D V F L Q L K V P N G I D E AACCTCGCCCGCGCCTATACCGATCTCGGATTCCCCGTGGTTATCGCCTGCGTCGACGAC N L A R A Y T D L G F P V V I A C V D D N L A R A Y T D L G F P V V I A C V D D GGCGTGGCAGTGTCTTTAGGATCGGCCTGCCGCGATTCGCTTAGTGCTGCAGCCGTCGCA G V A V S L G S A C R D S L S A A A V A G V A V S L G S A C R D S L S A A A V A GCCCTCAACGAAGCTTGGGCTTTTTACCCCGAGCGGCAGCGCGTTCGCAGT*G*----CC A L N E A W A F Y P E R Q R V R S P A L N E A W A F Y P E R Q R V R S *A*GSAV P GGAGCATATTCGTTCTGTCCTTGACCACGCTAATCAGGTGTCACTCCCAGAGTGGACAAC E H I R S V L D H A N Q V S L P E W T T E H I R S V L D H A N Q V S L P E W T T CCCCATCGACAGGCTATTCGGCGCAGATCAACCACCGCGTCGGTGCAGCAAGGCTGAAGA P I D R L F G A D Q P P R R C S K A E D P I D R L L G A D Q P P R R C S K A E D CTCAGTTACCCCGTCTGCTCTCGCAGCGCTTATCGACGCCGGCTTTGACCCCATCCGCAT S V T P S A L A A L I D A G F D P I R I S V T P S A L A A L I D A G F D P I R I AAACACCACGCTGGCCGAGGTCCAGGAATATGGCCTCACAGCCGTGACCGTGGTCGTCCC N T T L A E V Q E Y G L T A V T V V V P N T T L A E V Q E Y G L T A V T V V V P AGGCCTCGTCCCTATCGACTTTGGTTGGGACCGCCAACGAGCACAGTTTATGGAGCGACC G L V P I D F G W D R Q R A Q F M E R P G L V P I D F G W D R Q R A Q F M E R P CGCCCAGCTTTGCAGCCAAGCAACCGGTGGCATCATAAACCCATTAGAAACGACGTGCCA A Q L C S Q A T G G I I N P L E T T C H A Q L C S Q A T G G I I N P L E T T C H CCCCTTTGCGTAA P F A P F A --- // >fig|6666666.67449.peg.1338 fig|196164.1.peg.1764 hypothetical FIG152347 gi|372109441|gb|CP003213.1|_1355065_1354472,gi|372109441|gb|CP003213.1|_1354468_1354421 MLSEESEGRRYASVIDPGLRAKELIDQYCEENRVEVVQVLLTHGHIDHCRDAAALANGWGVALQIHRYDEFFLDKGNGMSEDSRLLFHADAMNLPDSVSYLGDGDEVELGGQRFVVRHAPGHSPGCVLFVGKDFCFSGDVLFKGSIGRTDLAHSDPHAMANSIKSVVLGLEDSLTILPGHGPATTMRAEKASNPYLRVxHSNCFVATAKLYRRE We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCTGTCGGAGGAATCTGAGGGGCGTCGATACGCAAGCGTGATAGACCCTGGGCTCCGC V L S E E S E G R R Y A S V I D P G L R M L S E E S E G R R Y A S V I D P G L R GCGAAAGAGCTAATTGATCAGTACTGTGAAGAAAACCGCGTCGAAGTAGTGCAAGTTTTG A K E L I D Q Y C E E N R V E V V Q V L A K E L I D Q Y C E E N R V E V V Q V L CTCACTCATGGCCATATTGATCACTGCAGGGATGCTGCTGCTCTTGCTAATGGTTGGGGA L T H G H I D H C R D A A A L A N G W G L T H G H I D H C R D A A A L A N G W G GTGGCGTTGCAGATTCATCGCTACGATGAATTCTTTTTGGACAAGGGAAATGGAATGTCG V A L Q I H R Y D E F F L D K G N G M S V A L Q I H R Y D E F F L D K G N G M S GAGGACTCGAGATTACTTTTCCACGCCGATGCGATGAATCTCCCAGATTCAGTGAGCTAT E D S R L L F H A D A M N L P D S V S Y E D S R L L F H A D A M N L P D S V S Y TTAGGCGATGGCGATGAAGTTGAACTTGGTGGTCAACGATTCGTTGTTCGTCATGCGCCT L G D G D E V E L G G Q R F V V R H A P L G D G D E V E L G G Q R F V V R H A P GGTCATTCACCTGGGTGCGTCTTGTTCGTTGGTAAAGACTTCTGTTTTTCAGGTGATGTG G H S P G C V L F V G K D F C F S G D V G H S P G C V L F V G K D F C F S G D V CTTTTCAAAGGATCGATAGGACGGACTGATCTTGCGCACTCTGATCCACATGCTATGGCG L F K G S I G R T D L A H S D P H A M A L F K G S I G R T D L A H S D P H A M A AACAGTATAAAAAGTGTAGTTCTGGGGTTAGAGGATTCATTGACAATATTGCCTGGGCAT N S I K S V V L G L E D S L T I L P G H N S I K S V V L G L E D S L T I L P G H GGTCCAGCTACCACGATGCGAGCTGAGAAGGCTTCAAATCCGTATTTAAGGGTGTAGCAC G P A T T M R A E K A S N P Y L R V * H G P A T T M R A E K A S N P Y L R V X H TCGAATTGTTTTGTTGCTACCGCTAAGCTGTATCGACGTGAGTAA S N C F V A T A K L Y R R E S N C F V A T A K L Y R R E --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.1764): ----------------GTGCTGTCGGAGGAATCTGAGGGGCGTCGATACGCAAGCGTGAT V L S E E S E A S V I MEILGFAAGPYKTNCY V V V G D G E ------------ V A I I AGACCCTGGGCTCCGCGCGAAAGAGCTAATTGATCAGTACTGTGAAGAAAACCGCGTCGA D P G L R A K E L I D Q Y C E E N R V E D P G M H T H D D L V E Y I T T N K L T AGTAGTGCAAGTTTTGCTCACTCATGGCCATATTGATCACTGCAGGGATGCTGCTGCTCT V V Q V L L T H G H I D H C R D A A A L V D K I V L T H G H I D H T R D A G V V TGCTAATGGTTGGGGAGTGGCGTTGCAGATTCATCGCTACGATGAATTCTTTTTGGACAA A N G W G V A L Q I H R Y D E F F L D K A R R F N A P V Y I H P D D V F F L E A GGGAAATGGAATGTCGGAGGACTCGAGATTACTTTTCCACGCCGATGCGATGAATCTCCC G N G M S E D S R L L F H A D A M N L P Y K G S G T R T A M L F D A D N M L S P AGATTCAGTGAGCTATTTAGGCGATGGCGATGAAGTTGAACTTGGTGGTCAACGATTCGT D S V S Y L G D G D E V E L G G Q R F V E S T I D L V D G E T I T L A G E E F T TGTTCGTCATGCGCCTGGTCATTCACCTGGGTGCGTCTTGTTCGTTGGTAAAGACTTCTG V R H A P G H S P G C V L F V G K D F C L R H A P G H S P G C T M L V G R E Y C TTTTTCAGGTGATGTGCTTTTCAAAGGATCGATAGGACGGACTGATCTTGCGCACTCTGA F S G D V L F K G S I G R T D L A H S D F S G D V L F K G S I G R T D F E F A D TCCACATGCTATGGCGAACAGTATAAAAAGTGTAGTTCTGGGGTTAGAGGATTCATTGAC P H A M A N S I K S V V L G L E D S L T E E A M T R S L R T V V L G L D D A L Q AATATTGCCTGGGCATGGTCCAGCTACCACGATGCGAGCTGAGAAGGCTTCAAATCCGTA I L P G H G P A T T M R A E K A S N P Y I L P G H G P T T T M R A E R M G N P F TTTAAGGGTGTAGCACTCGAATTGTTTTGTTGCTACCGCTAAGCTGTATCGACGTGAGTA L R V * H S N L R A L R P N -------------------------------------- A - // >fig|6666666.67449.peg.58 fig|196627.4.peg.2859 Lead, cadmium, zinc and mercury transporting ATPase (EC 3.6.3.3) (EC 3.6.3.5); Copper-translocating P-type ATPase (EC 3.6.3.4) FIG025203 gi|372109441|gb|CP003213.1|_58286_56865,gi|372109441|gb|CP003213.1|_56865_56062 MSTPHHSGDHPAPETDHTHHPDHASHEHHADPDTHGQAMPHDHPHSALDEDHHVHGHGEHAGHSTAMFRDRFWWSLILSIPVVIFSPMVAHLLGYHLPAFPGSTWIPPVLGTIIFVYGGTPFLKGGWKELKSRQPGMMLLIAMAITVAFVASWVTTLGLGGFELDFWWELALLVTIMLLGHWLEMSALGAASSALDALAALLPDEAEKVIDGTTRTVAISELVVDDVVLVRAGARVPADGTILDGAAEFDEAMITGESRPVFRDTGDKVVAGTVATDNTVRIRVEATGGDTALAGIQRMVADAQESSSRAQALADRAAALLFWFALISALITAVVWTIIGSPDDAVVRTVTVLVIACPHALGLAIPLVIAISSERAAKSGVLIKDRMALERMRTIDVVLFDKTGTLTEGAHAVTGVAAAVGVTEGELLALAAAAEADSEHPVARAIVAAAAAHPEASRRQIRATGFSAASGRGxxRATVDGAEILVGGPNMLREFNLTTPAELTDTTSAWTGRGAGVLHIVRDGQIIGAVAVEDKIRPESRAAVKALQDRGVKVAMITGDAQQVAQAVGQDLGIDEVFAEVLPQDKDTKVTQLQDRGLSVAMVGDGVNDAPALTRADVGIAIGAGTDVAMESAGVVLASDDPRAVLSMIELSQASYRKMIQNLIWASGYNILAVPLAAGVLASIGFVLSPAVGAILMSASTIVVALNAQLLRRIDLDPAHPAPTESKEEHTTPTPASTAVH We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGCACTCCCCACCATTCCGGTGATCACCCCGCTCCGGAAACAGACCACACCCACCAC M S T P H H S G D H P A P E T D H T H H M S T P H H S G D H P A P E T D H T H H CCAGATCATGCCAGCCACGAACACCACGCAGATCCCGACACCCACGGCCAGGCGATGCCC P D H A S H E H H A D P D T H G Q A M P P D H A S H E H H A D P D T H G Q A M P CACGATCACCCGCACTCCGCCCTGGACGAAGACCACCACGTGCATGGTCACGGCGAACAC H D H P H S A L D E D H H V H G H G E H H D H P H S A L D E D H H V H G H G E H GCCGGACACAGCACCGCAATGTTTCGGGACCGCTTCTGGTGGTCTCTGATTCTGTCCATT A G H S T A M F R D R F W W S L I L S I A G H S T A M F R D R F W W S L I L S I CCCGTCGTTATTTTCAGCCCCATGGTCGCCCACCTGCTCGGCTACCACCTCCCGGCATTC P V V I F S P M V A H L L G Y H L P A F P V V I F S P M V A H L L G Y H L P A F CCCGGATCCACCTGGATCCCCCCGGTGCTAGGCACGATCATCTTCGTCTACGGCGGAACG P G S T W I P P V L G T I I F V Y G G T P G S T W I P P V L G T I I F V Y G G T CCTTTCCTCAAGGGCGGATGGAAAGAACTGAAATCCCGCCAACCCGGGATGATGCTCCTG P F L K G G W K E L K S R Q P G M M L L P F L K G G W K E L K S R Q P G M M L L ATCGCCATGGCCATCACCGTGGCGTTTGTCGCCTCCTGGGTCACCACTCTGGGGCTGGGC I A M A I T V A F V A S W V T T L G L G I A M A I T V A F V A S W V T T L G L G GGTTTTGAGCTGGACTTCTGGTGGGAGCTGGCCCTGCTGGTGACCATCATGCTGCTGGGC G F E L D F W W E L A L L V T I M L L G G F E L D F W W E L A L L V T I M L L G CACTGGCTGGAGATGTCCGCTCTCGGGGCCGCGTCCTCCGCGCTTGATGCGCTGGCTGCC H W L E M S A L G A A S S A L D A L A A H W L E M S A L G A A S S A L D A L A A CTGCTGCCGGATGAGGCCGAGAAAGTCATCGACGGGACCACCCGCACCGTGGCCATCTCC L L P D E A E K V I D G T T R T V A I S L L P D E A E K V I D G T T R T V A I S GAGCTGGTCGTCGACGACGTCGTGCTGGTGAGGGCCGGTGCCCGGGTGCCGGCCGACGGA E L V V D D V V L V R A G A R V P A D G E L V V D D V V L V R A G A R V P A D G ACCATCCTCGACGGAGCCGCCGAATTCGATGAGGCGATGATCACCGGCGAATCCCGTCCC T I L D G A A E F D E A M I T G E S R P T I L D G A A E F D E A M I T G E S R P GTCTTCCGCGACACCGGTGACAAGGTGGTCGCCGGTACCGTGGCCACCGACAACACCGTC V F R D T G D K V V A G T V A T D N T V V F R D T G D K V V A G T V A T D N T V CGCATCCGGGTGGAGGCTACCGGCGGGGACACCGCCCTGGCCGGGATCCAACGCATGGTT R I R V E A T G G D T A L A G I Q R M V R I R V E A T G G D T A L A G I Q R M V GCCGACGCCCAGGAGTCCTCCTCCCGGGCCCAGGCCCTGGCGGATCGGGCGGCGGCGTTG A D A Q E S S S R A Q A L A D R A A A L A D A Q E S S S R A Q A L A D R A A A L TTGTTCTGGTTCGCGCTGATCTCCGCTCTGATCACCGCGGTGGTGTGGACCATCATCGGC L F W F A L I S A L I T A V V W T I I G L F W F A L I S A L I T A V V W T I I G AGCCCGGACGATGCCGTGGTGCGCACAGTCACGGTGCTGGTCATCGCCTGCCCGCACGCC S P D D A V V R T V T V L V I A C P H A S P D D A V V R T V T V L V I A C P H A CTGGGCCTGGCGATTCCGCTGGTCATTGCGATCTCCAGCGAGCGGGCTGCGAAATCCGGG L G L A I P L V I A I S S E R A A K S G L G L A I P L V I A I S S E R A A K S G GTGCTCATCAAGGACCGGATGGCGCTCGAGCGGATGCGCACCATCGACGTGGTGCTCTTC V L I K D R M A L E R M R T I D V V L F V L I K D R M A L E R M R T I D V V L F GACAAAACCGGCACCCTGACCGAGGGTGCGCACGCGGTCACCGGTGTCGCGGCAGCTGTC D K T G T L T E G A H A V T G V A A A V D K T G T L T E G A H A V T G V A A A V GGCGTCACCGAGGGCGAGCTGCTGGCCCTAGCCGCCGCCGCGGAGGCCGACAGCGAGCAC G V T E G E L L A L A A A A E A D S E H G V T E G E L L A L A A A A E A D S E H CCCGTGGCCCGCGCCATCGTGGCGGCCGCGGCCGCCCATCCCGAGGCCTCCCGTCGGCAA P V A R A I V A A A A A H P E A S R R Q P V A R A I V A A A A A H P E A S R R Q ATCCGTGCAACTGGTTTCAGCGCCGCCTCCGGCCGGGGG*GG*GTTCGGGCCACTGTCGA I R A T G F S A A S G R G V R A T V D I R A T G F S A A S G R G *X** X R A T V D TGGCGCTGAGATCCTCGTGGGCGGGCCGAACATGCTGCGCGAGTTCAACCTCACCACCCC G A E I L V G G P N M L R E F N L T T P G A E I L V G G P N M L R E F N L T T P GGCCGAGCTCACCGACACCACCAGCGCCTGGACCGGGCGTGGGGCCGGTGTGCTCCATAT A E L T D T T S A W T G R G A G V L H I A E L T D T T S A W T G R G A G V L H I TGTCCGCGACGGTCAGATCATCGGTGCGGTGGCCGTCGAGGACAAGATCCGCCCCGAATC V R D G Q I I G A V A V E D K I R P E S V R D G Q I I G A V A V E D K I R P E S CCGCGCCGCCGTGAAAGCCCTGCAGGACCGCGGGGTGAAGGTCGCGATGATCACCGGCGA R A A V K A L Q D R G V K V A M I T G D R A A V K A L Q D R G V K V A M I T G D CGCGCAGCAGGTGGCCCAGGCGGTTGGTCAGGACCTAGGCATTGATGAGGTCTTCGCCGA A Q Q V A Q A V G Q D L G I D E V F A E A Q Q V A Q A V G Q D L G I D E V F A E GGTCCTGCCCCAGGACAAAGACACCAAGGTCACGCAGCTGCAGGACCGGGGTTTGAGCGT V L P Q D K D T K V T Q L Q D R G L S V V L P Q D K D T K V T Q L Q D R G L S V GGCCATGGTCGGTGACGGTGTCAATGACGCCCCCGCTCTGACCCGCGCGGACGTCGGTAT A M V G D G V N D A P A L T R A D V G I A M V G D G V N D A P A L T R A D V G I CGCCATCGGTGCCGGCACGGATGTGGCCATGGAATCTGCCGGGGTGGTCCTAGCCAGTGA A I G A G T D V A M E S A G V V L A S D A I G A G T D V A M E S A G V V L A S D TGACCCGCGGGCAGTGCTGTCGATGATTGAGCTGTCCCAGGCCAGCTACCGCAAGATGAT D P R A V L S M I E L S Q A S Y R K M I D P R A V L S M I E L S Q A S Y R K M I CCAGAACCTGATCTGGGCCTCTGGCTACAACATCCTCGCCGTGCCGTTGGCCGCCGGAGT Q N L I W A S G Y N I L A V P L A A G V Q N L I W A S G Y N I L A V P L A A G V GCTCGCCTCGATCGGGTTCGTGCTGTCCCCGGCCGTGGGCGCGATCTTAATGTCTGCCTC L A S I G F V L S P A V G A I L M S A S L A S I G F V L S P A V G A I L M S A S GACCATCGTGGTGGCCCTGAACGCCCAGCTGTTACGCCGCATTGATCTGGATCCGGCTCA T I V V A L N A Q L L R R I D L D P A H T I V V A L N A Q L L R R I D L D P A H CCCGGCTCCGACCGAGTCGAAAGAGGAACACACCACGCCTACTCCGGCATCCACCGCCGT P A P T E S K E E H T T P T P A S T A V P A P T E S K E E H T T P T P A S T A V CCACTGA H H --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.2859): ATGAGCACTCCCCACCATTCCGGTGATCACCCCGCTCCGGAAACAGACCACACCCACCAC M S T P H H S G D H P A P E T D H T H H M S T P H H H G D H P A P E T D H T H H CCAGATCATGCCAGCCACGAACACCACGCAGATCCCGACACCCACGGCCAGGCGATGCCC P D H A S H E H H A D P D T H G Q A M P P N H A G H E H H A D A A T H G Q A M P CACGATCACCCGCACTCCGCCCTGGACGAAGACCACCACGTGCATGGTCACGGCGAACAC H D H P H S A L D E D H H V H G H G E H H D H P H S T V D E E H Q V H S H G E H GCCGGACACAGCACCGCAATGTTTCGGGACCGCTTCTGGTGGTCTCTGATTCTGTCCATT A G H S T A M F R D R F W W S L I L S I A G H S A A M F R D R F W W S L I L S V CCCGTCGTTATTTTCAGCCCCATGGTCGCCCACCTGCTCGGCTACCACCTCCCGGCATTC P V V I F S P M V A H L L G Y H L P A F P V V F F S P M F A D L L G Y N I P E I CCCGGATCCACCTGGATCCCCCCGGTGCTAGGCACGATCATCTTCGTCTACGGCGGAACG P G S T W I P P V L G T I I F V Y G G T P G A Y W I P P V L G T I I F L Y G G T CCTTTCCTCAAGGGCGGATGGAAAGAACTGAAATCCCGCCAACCCGGGATGATGCTCCTG P F L K G G W K E L K S R Q P G M M L L P F L K G A M T E L K S R Q P G M M L L ATCGCCATGGCCATCACCGTGGCGTTTGTCGCCTCCTGGGTCACCACTCTGGGGCTGGGC I A M A I T V A F V A S W V T T L G L G I A M A I T V A F I A S W V T T L G L G GGTTTTGAGCTGGACTTCTGGTGGGAGCTGGCCCTGCTGGTGACCATCATGCTGCTGGGC G F E L D F W W E L A L L V T I M L L G G F H L D F W W E L A L L V T I M L L G CACTGGCTGGAGATGTCCGCTCTCGGGGCCGCGTCCTCCGCGCTTGATGCGCTGGCTGCC H W L E M S A L G A A S S A L D A L A A H W L E M R A L G A A S S A L D A L A A CTGCTGCCGGATGAGGCCGAGAAAGTCATCGACGGGACCACCCGCACCGTGGCCATCTCC L L P D E A E K V I D G T T R T V A I S L L P D E A E K V V D G T T R T V A I S GAGCTGGTCGTCGACGACGTCGTGCTGGTGAGGGCCGGTGCCCGGGTGCCGGCCGACGGA E L V V D D V V L V R A G A R V P A D G E L A V D D V V L V R A G A R V P A D G ACCATCCTCGACGGAGCCGCCGAATTCGATGAGGCGATGATCACCGGCGAATCCCGTCCC T I L D G A A E F D E A M I T G E S R P T I I D G A A E F D E A M I T G E S R P GTCTTCCGCGACACCGGTGACAAGGTGGTCGCCGGTACCGTGGCCACCGACAACACCGTC V F R D T G D K V V A G T V A T D N T V V Y R D T G E T V V A G T V A T D N T V CGCATCCGGGTGGAGGCTACCGGCGGGGACACCGCCCTGGCCGGGATCCAACGCATGGTT R I R V E A T G G D T A L A G I Q R M V R I R V E A T G G D T A L A G I Q R M V GCCGACGCCCAGGAGTCCTCCTCCCGGGCCCAGGCCCTGGCGGATCGGGCGGCGGCGTTG A D A Q E S S S R A Q A L A D R A A A L A D A Q A S S S R A Q A L A D R A A A F TTGTTCTGGTTCGCGCTGATCTCCGCTCTGATCACCGCGGTGGTGTGGACCATCATCGGC L F W F A L I S A L I T A V V W T I I G L F W F A L I T A L I T A V V W T I I G AGCCCGGACGATGCCGTGGTGCGCACAGTCACGGTGCTGGTCATCGCCTGCCCGCACGCC S P D D A V V R T V T V L V I A C P H A S P D D A V V R A V T V L I I A C P H A CTGGGCCTGGCGATTCCGCTGGTCATTGCGATCTCCAGCGAGCGGGCTGCGAAATCCGGG L G L A I P L V I A I S S E R A A K S G L G L A I P L V I A I S S E R A A K S G GTGCTCATCAAGGACCGGATGGCGCTCGAGCGGATGCGCACCATCGACGTGGTGCTCTTC V L I K D R M A L E R M R T I D V V L F V L I K D R M A L E H M R T I D V V L F GACAAAACCGGCACCCTGACCGAGGGTGCGCACGCGGTCACCGGTGTCGCGGCAGCTGTC D K T G T L T E G A H A V T G V A A A V D K T G T L T E G A H A V T G V A P A T GGCGTCACCGAGGGCGAGCTGCTGGCCCTAGCCGCCGCCGCGGAGGCCGACAGCGAGCAC G V T E G E L L A L A A A A E A D S E H G I A E G E L L A L A A A A E A D S E H CCCGTGGCCCGCGCCATCGTGGCGGCCGCGGCCGCCCATCCCGAGGCCTCCCGTCGGCAA P V A R A I V A A A A A H P E A S R R Q P V A R A I V T A A A A H P E A S Q R Q ATCCGTGCAACTGGTTTCAGCGCCGCCTCCGGCCGGGGGGGGTTCGGGCCACTGTCGATG I R A T G F S A A S G R G V R A T V D L R A T G F T A A S G R G -- I R A T V D GCGCTGAGATCCTCGTGGGCGGGCCGAACATGCTGCGCGAGTTCAACCTCACCACCCCGG G A E I L V G G P N M L R E F N L T T P G A E I L V G G P N M L R E F N L T T P CCGAGCTCACCGACACCACCAGCGCCTGGACCGGGCGTGGGGCCGGTGTGCTCCATATTG A E L T D T T S A W T G R G A G V L H I G E L A D I T G S W A Q R G A G V L H V TCCGCGACGGTCAGATCATCGGTGCGGTGGCCGTCGAGGACAAGATCCGCCCCGAATCCC V R D G Q I I G A V A V E D K I R P E S V R D G E I I G A V A V E D K I R P E S GCGCCGCCGTGAAAGCCCTGCAGGACCGCGGGGTGAAGGTCGCGATGATCACCGGCGACG R A A V K A L Q D R G V K V A M I T G D R A A V R A L Q A R G V K V A M I T G D CGCAGCAGGTGGCCCAGGCGGTTGGTCAGGACCTAGGCATTGATGAGGTCTTCGCCGAGG A Q Q V A Q A V G Q D L G I D E V F A E A T Q V A Q A V G K D L G I D E V F A E TCCTGCCCCAGGACAAAGACACCAAGGTCACGCAGCTGCAGGACCGGGGTTTGAGCGTGG V L P Q D K D T K V T Q L Q D R G L S V V L P Q D K D T K V T Q L Q E R G L S V CCATGGTCGGTGACGGTGTCAATGACGCCCCCGCTCTGACCCGCGCGGACGTCGGTATCG A M V G D G V N D A P A L T R A D V G I A M V G D G V N D A P A L A R A E V G I CCATCGGTGCCGGCACGGATGTGGCCATGGAATCTGCCGGGGTGGTCCTAGCCAGTGATG A I G A G T D V A M E S A G V V L A S D A I G A G T D V A M E S A G V V L A S D ACCCGCGGGCAGTGCTGTCGATGATTGAGCTGTCCCAGGCCAGCTACCGCAAGATGATCC D P R A V L S M I E L S Q A S Y R K M I D P R A V L S M I E L S H A S Y R K M V AGAACCTGATCTGGGCCTCTGGCTACAACATCCTCGCCGTGCCGTTGGCCGCCGGAGTGC Q N L I W A S G Y N I L A V P L A A G V Q N L V W A T G Y N I V A V P L A A G V TCGCCTCGATCGGGTTCGTGCTGTCCCCGGCCGTGGGCGCGATCTTAATGTCTGCCTCGA L A S I G F V L S P A V G A I L M S A S L A P I G V L L P P A A A A I L M S L S CCATCGTGGTGGCCCTGAACGCCCAGCTGTTACGCCGCATTGATCTGGATCCGGCTCACC T I V V A L N A Q L L R R I D L D P A H T I I V A L N A Q L L R R I D L D P A H CGGCTCCGACCGAGTCGAAAGAGGAACACACCACGCCTACTCCGGCATCCACCGCCGTCC P A P T E S K E E H T T P T P A S T A V L A P T D G K E E K A A V S S A A P V R - ACTGA ----- // >fig|6666666.67449.peg.1408 fig|257309.1.peg.2309 PTS system, fructose-specific IIA component (EC 2.7.1.69) / PTS system, fructose-specific IIB component (EC 2.7.1.69) / PTS system, fructose-specific IIC component (EC 2.7.1.69) FIG001234 gi|372109441|gb|CP003213.1|_1426051_1426251,gi|372109441|gb|CP003213.1|_1426253_1426684 MAADALTSAAKARGDVSLLVETQGTSDNSVLREKEIASADVVIFAADVGVRDHERFKGKRILECSPRTLSAAIALKNSSRNTTVRPNATHRVAATAYDLERKMRHAAMTGVSYMVPFVAAGGLLLALGFLLGGYDIAAGWQAIAIQHSFTDLPSHDVVIDIATGQSYHFSALAFCFILALWLLLSTQCQCNLLWLHFQDTLRLLSLDAQE We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCAGCGGATGCACTTACTTCGGCCGCGAAAGCACGTGGCGACGTCTCATTGTTAGTA M A A D A L T S A A K A R G D V S L L V M A A D A L T S A A K A R G D V S L L V GAAACTCAAGGCACTTCTGACAACTCAGTATTAAGAGAAAAAGAGATCGCTTCAGCTGAT E T Q G T S D N S V L R E K E I A S A D E T Q G T S D N S V L R E K E I A S A D GTTGTTATCTTTGCAGCCGATGTGGGAGTGCGTGACCATGAGCGATTCAAAGGAAAACGA V V I F A A D V G V R D H E R F K G K R V V I F A A D V G V R D H E R F K G K R ATCCTTGAATGCAGCCCACGACACCCTTAGCGCCGCAATCGCACTCAAGAATTCTTCAAG I L E C S P R T L S A A I A L K N S S R I L E C S P R - T L S A A I A L K N S S R AAATACGACAGTTCGACCAAATGCAACTCATCGTGTAGCAGCAACAGCCTACGATTTAGA N T T V R P N A T H R V A A T A Y D L E N T T V R P N A T H R V A A T A Y D L E ACGAAAAATGCGCCACGCTGCGATGACTGGTGTTTCCTACATGGTTCCGTTCGTAGCAGC R K M R H A A M T G V S Y M V P F V A A R K M R H A A M T G V S Y M V P F V A A CGGCGGATTACTGTTAGCCCTCGGATTTCTTTTGGGAGGCTACGACATAGCTGCTGGATG G G L L L A L G F L L G G Y D I A A G W G G L L L A L G F L L G G Y D I A A G W GCAGGCAATTGCCATTCAGCATTCGTTCACTGATCTGCCCAGCCACGATGTGGTCATCGA Q A I A I Q H S F T D L P S H D V V I D Q A I A I Q H S F T D L P S H D V V I D TATAGCAACAGGACAGTCGTATCATTTCAGCGCTCTGGCCTTTTGCTTTATCTTGGCGCT I A T G Q S Y H F S A L A F C F I L A L I A T G Q S Y H F S A L A F C F I L A L GTGGCTTTTGCTATCGACTCAATGTCAATGCAATTTATTGTGGCTGCACTTTCAGGATAC W L L L S T Q C Q C N L L W L H F Q D T W L L L S T Q C Q C N L L W L H F Q D T ATTGCGTTTGCTATCGCTGGACGCTCAGGAATAG L R L L S L D A Q E L R L L S L D A Q E --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2309): ATGGCAGCGGATGCACTTACTTCGGCCGCGAAAGCACGTGGCGACGTCTCATTGTTAGTA M A A D A L T S A A K A R G D V S L L V M A A D A L T S A A K A R G D A S L L V GAAACTCAAGGCACTTCTGACAACTCAGTATTAAGAGAAAAAGAGATCGCTTCAGCTGAT E T Q G T S D N S V L R E K E I A S A D E T Q G T S D N S V L S E K E I A S A D GTTGTTATCTTTGCAGCCGATGTGGGAGTGCGTGACCATGAGCGATTCAAAGGAAAACGA V V I F A A D V G V R D H E R F K G K R V V I F A A D V G V R D H E R F K G K R ATCCTTGAATGCAGCCCA*C*-------GACACCCTTAGCGCCGCAATCGCACTCAAGAA I L E C S P D T L S A A I A L K N I L E C S P *R*QAIRDPN D T L S A A I A L K N TTCTTCAAGAAATACGACAGTTCGACCAAATGCAACTCATCGTGTAGCAGCAACAGCCTA S S R N T T V R P N A T H R V A A T A Y S S R N T T V R P H A T H R V A A T A Y CGATTTAGAACGAAAAATGCGCCACGCTGCGATGACTGGTGTTTCCTACATGGTTCCGTT D L E R K M R H A A M T G V S Y M V P F D L E R K M R H A A M T G V S Y M V P F CGTAGCAGCCGGCGGATTACTGTTAGCCCTCGGATTTCTTTTGGGAGGCTACGACATAGC V A A G G L L L A L G F L L G G Y D I A V A A G G L L L A L G F L L G G Y D I A TGCTGGATGGCAGGCAATTGCCATTCAGCATTCGTTCACTGATCTGCCCAGCCACGATGT A G W Q A I A I Q H S F T D L P S H D V A G W Q A I A I Q H S F T D L P S H D V GGTCATCGATATAGCAACAGGACAGTCGTATCATTTCAGCGCTCTGGCCTTTTGCTTTAT V I D I A T G Q S Y H F S A L A F C F I V I D I A T G Q S Y H F S A L A F C F I CTTGGCGCTGTGGCTTTTGCTATCGACTCAATGTCAATGCAATTTATTGTGGCTGCACTT L A L W L L L S T Q C Q C N L L W L H F L A L W L L L S T Q C Q C N L L W L H F TCAGGATACATTGCGTTTGCTATCGCTGGACGCTCAGGAATAG Q D T L R L L S L D A Q E Q D T L R L L S L D A Q E --- // >fig|6666666.67449.peg.1709 fig|257309.1.peg.1677 Putative pyridine nucleotide-disulphide oxidoreductase gi|372109441|gb|CP003213.1|_1741750_1742532,gi|372109441|gb|CP003213.1|_1742536_1743363 MTTTIIVGGVAGGMSTAARLRRRDEDMTILVFEASHHVSFANCGLPYHVSGVIPERSSLLLQTPESLAARFNIDVRVDHLVTAINREAGSVSVKNLVTGEVSDHHYDHLVLSPGARPILPPLPGIEKALTLRTVEDVDTIIERVAGASSSAIIGGGFIGIELAENLAHRGIATTIIERGPQILGPLDIEMAAFVEQRLRDNGISVRTNANAAAISDTGVELADGSVTADVVVAAVGVAPASDLARAAGLAVGERGGIVVDDxLRTNDPQIFALGDAAEKRDAISGADTLVPLAQTANRHGRLVADIITGRDVKRTSTLGTAIVGVFGLAAASVGWSEKRAVAAGKNIRVIHTHPASHAGYYPGAAQLHLKLVVDADTDAILGAQAVGEDGADKRIDVIATTMRAGLSATDLADLELAYSPQYGSAKDPVNLIGMVNDNIRSGERSVQWHELDAQIADGWTLVDVRTAGEFAAGNIPGAINIPVDELREHLDELQGKNVLVHCQVGLRGHVAATLLTNSGINAANLDGGYLTWKTATS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACCACCACAATCATCGTCGGCGGCGTTGCCGGCGGCATGTCCACCGCAGCACGTCTA M T T T I I V G G V A G G M S T A A R L M T T T I I V G G V A G G M S T A A R L CGTCGGCGCGACGAGGACATGACCATCCTCGTATTCGAAGCTTCACACCACGTATCCTTC R R R D E D M T I L V F E A S H H V S F R R R D E D M T I L V F E A S H H V S F GCCAACTGTGGCCTTCCCTACCACGTCAGTGGCGTAATCCCCGAGCGTTCCTCACTTCTG A N C G L P Y H V S G V I P E R S S L L A N C G L P Y H V S G V I P E R S S L L CTGCAAACCCCCGAGTCACTTGCAGCTAGGTTCAACATCGATGTGCGCGTCGATCATCTA L Q T P E S L A A R F N I D V R V D H L L Q T P E S L A A R F N I D V R V D H L GTTACCGCAATCAACCGCGAAGCTGGCAGCGTCTCCGTGAAAAACCTCGTCACCGGCGAG V T A I N R E A G S V S V K N L V T G E V T A I N R E A G S V S V K N L V T G E GTGAGCGATCACCATTACGATCATCTCGTGCTTTCTCCCGGCGCGCGCCCGATCTTGCCA V S D H H Y D H L V L S P G A R P I L P V S D H H Y D H L V L S P G A R P I L P CCGCTTCCTGGCATCGAAAAAGCTCTGACGCTCCGCACCGTCGAAGACGTAGATACCATC P L P G I E K A L T L R T V E D V D T I P L P G I E K A L T L R T V E D V D T I ATCGAACGCGTTGCTGGCGCTTCTTCATCAGCCATCATCGGCGGCGGTTTTATTGGCATC I E R V A G A S S S A I I G G G F I G I I E R V A G A S S S A I I G G G F I G I GAGCTGGCGGAAAACTTGGCACACCGGGGTATCGCCACCACGATCATCGAGCGTGGTCCA E L A E N L A H R G I A T T I I E R G P E L A E N L A H R G I A T T I I E R G P CAGATCCTTGGCCCCCTCGACATTGAGATGGCAGCGTTTGTGGAGCAGCGCCTTCGTGAC Q I L G P L D I E M A A F V E Q R L R D Q I L G P L D I E M A A F V E Q R L R D AATGGAATCAGCGTGCGTACTAACGCCAACGCTGCGGCGATCTCAGACACCGGCGTTGAG N G I S V R T N A N A A A I S D T G V E N G I S V R T N A N A A A I S D T G V E CTTGCCGACGGCTCCGTCACCGCCGATGTTGTCGTTGCGGCAGTTGGCGTAGCACCGGCA L A D G S V T A D V V V A A V G V A P A L A D G S V T A D V V V A A V G V A P A AGCGACCTTGCCCGTGCGGCAGGTCTAGCTGTTGGGGAACGCGGCGGTATCGTTGTCGAT S D L A R A A G L A V G E R G G I V V D S D L A R A A G L A V G E R G G I V V D GACTAGCTGCGGACTAACGACCCTCAGATCTTTGCGCTTGGCGATGCTGCTGAAAAACGC D * L R T N D P Q I F A L G D A A E K R D X L R T N D P Q I F A L G D A A E K R GATGCTATTTCCGGCGCCGATACTCTCGTACCACTCGCACAAACCGCTAACCGTCATGGC D A I S G A D T L V P L A Q T A N R H G D A I S G A D T L V P L A Q T A N R H G CGCTTGGTAGCGGACATCATCACTGGACGCGATGTGAAGCGCACCTCTACTTTGGGCACC R L V A D I I T G R D V K R T S T L G T R L V A D I I T G R D V K R T S T L G T GCCATCGTTGGGGTTTTCGGATTGGCAGCTGCCAGTGTTGGGTGGAGCGAAAAGCGTGCG A I V G V F G L A A A S V G W S E K R A A I V G V F G L A A A S V G W S E K R A GTAGCTGCGGGCAAGAACATTCGTGTTATTCACACGCACCCCGCAAGTCATGCCGGTTAC V A A G K N I R V I H T H P A S H A G Y V A A G K N I R V I H T H P A S H A G Y TATCCTGGCGCAGCACAACTGCACCTCAAGCTGGTCGTCGACGCTGATACCGACGCTATT Y P G A A Q L H L K L V V D A D T D A I Y P G A A Q L H L K L V V D A D T D A I CTCGGCGCTCAGGCCGTTGGTGAAGACGGCGCGGACAAGCGTATCGACGTCATCGCCACG L G A Q A V G E D G A D K R I D V I A T L G A Q A V G E D G A D K R I D V I A T ACCATGCGTGCTGGTCTCAGCGCTACCGATCTCGCAGATCTCGAGCTGGCCTACTCCCCA T M R A G L S A T D L A D L E L A Y S P T M R A G L S A T D L A D L E L A Y S P CAGTATGGTTCGGCAAAAGACCCTGTGAACCTCATTGGCATGGTTAACGACAATATCCGC Q Y G S A K D P V N L I G M V N D N I R Q Y G S A K D P V N L I G M V N D N I R TCCGGTGAGCGCAGTGTGCAATGGCATGAGCTTGATGCTCAGATTGCCGATGGCTGGACC S G E R S V Q W H E L D A Q I A D G W T S G E R S V Q W H E L D A Q I A D G W T TTGGTAGATGTTCGCACCGCCGGTGAATTCGCCGCCGGCAATATTCCAGGTGCCATCAAT L V D V R T A G E F A A G N I P G A I N L V D V R T A G E F A A G N I P G A I N ATTCCTGTCGATGAGTTACGTGAGCACCTCGATGAGCTACAGGGCAAGAATGTGCTGGTA I P V D E L R E H L D E L Q G K N V L V I P V D E L R E H L D E L Q G K N V L V CATTGTCAGGTTGGCCTAAGGGGCCACGTTGCCGCTACTCTTTTGACTAATAGCGGTATC H C Q V G L R G H V A A T L L T N S G I H C Q V G L R G H V A A T L L T N S G I AACGCCGCCAACCTCGACGGTGGTTATCTCACATGGAAAACTGCCACCTCTTAA N A A N L D G G Y L T W K T A T S N A A N L D G G Y L T W K T A T S --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1677): ATGACCACCACAATCATCGTCGGCGGCGTTGCCGGCGGCATGTCCACCGCAGCACGTCTA M T T T I I V G G V A G G M S T A A R L M T T T I I V G G V A G G M S T A A R L CGTCGGCGCGACGAGGACATGACCATCCTCGTATTCGAAGCTTCACACCACGTATCCTTC R R R D E D M T I L V F E A S H H V S F R R R D E D M T I L V F E A S N H V S F GCCAACTGTGGCCTTCCCTACCACGTCAGTGGCGTAATCCCCGAGCGTTCCTCACTTCTG A N C G L P Y H V S G V I P E R S S L L A N C G L P Y H V S G V I P E R S S L L CTGCAAACCCCCGAGTCACTTGCAGCTAGGTTCAACATCGATGTGCGCGTCGATCATCTA L Q T P E S L A A R F N I D V R V D H L L Q T P E S L A A R F N I D V R V D H L GTTACCGCAATCAACCGCGAAGCTGGCAGCGTCTCCGTGAAAAACCTCGTCACCGGCGAG V T A I N R E A G S V S V K N L V T G E V T A I N R E A G S V S V K N L A T G E GTGAGCGATCACCATTACGATCATCTCGTGCTTTCTCCCGGCGCGCGCCCGATCTTGCCA V S D H H Y D H L V L S P G A R P I L P V S E H H Y D H L V L S P G A R P I L P CCGCTTCCTGGCATCGAAAAAGCTCTGACGCTCCGCACCGTCGAAGACGTAGATACCATC P L P G I E K A L T L R T V E D V D T I P L P G I E K A L T L R T V E D V D T I ATCGAACGCGTTGCTGGCGCTTCTTCATCAGCCATCATCGGCGGCGGTTTTATTGGCATC I E R V A G A S S S A I I G G G F I G I I E R V A G A S S S A I I G G G F I G I GAGCTGGCGGAAAACTTGGCACACCGGGGTATCGCCACCACGATCATCGAGCGTGGTCCA E L A E N L A H R G I A T T I I E R G P E L A E N L A H R G I A T T I I E R G P CAGATCCTTGGCCCCCTCGACATTGAGATGGCAGCGTTTGTGGAGCAGCGCCTTCGTGAC Q I L G P L D I E M A A F V E Q R L R D Q I L G P L D I E M A A F V E Q R L R D AATGGAATCAGCGTGCGTACTAACGCCAACGCTGCGGCGATCTCAGACACCGGCGTTGAG N G I S V R T N A N A A A I S D T G V E N G I S V R T N A N A A A I S D T G V E CTTGCCGACGGCTCCGTCACCGCCGATGTTGTCGTTGCGGCAGTTGGCGTAGCACCGGCA L A D G S V T A D V V V A A V G V A P A L A D G S V T A D V V V A A V G V A P A AGCGACCTTGCCCGTGCGGCAGGTCTAGCTGTTGGGGAACGCGGCGGTATCGTTGTCGAT S D L A R A A G L A V G E R G G I V V D S D L A R A A G L A V G E R G G I V V D GACTAGCTGCGGACTAACGACCCTCAGATCTTTGCGCTTGGCGATGCTGCTGAAAAACGC D * L R T N D P Q I F A L G D A A E K R D Q L R T N D P Q I F A L G D A A E K R GATGCTATTTCCGGCGCCGATACTCTCGTACCACTCGCACAAACCGCTAACCGTCATGGC D A I S G A D T L V P L A Q T A N R H G D A I S G A D T L V P L A Q T A N R H G CGCTTGGTAGCGGACATCATCACTGGACGCGATGTGAAGCGCACCTCTACTTTGGGCACC R L V A D I I T G R D V K R T S T L G T R L V A D I I T G R D V K R T S T L G T GCCATCGTTGGGGTTTTCGGATTGGCAGCTGCCAGTGTTGGGTGGAGCGAAAAGCGTGCG A I V G V F G L A A A S V G W S E K R A A I V G V F G L A A A S V G W S E K R A GTAGCTGCGGGCAAGAACATTCGTGTTATTCACACGCACCCCGCAAGTCATGCCGGTTAC V A A G K N I R V I H T H P A S H A G Y V A A G K N I R V I H T H P A S H A G Y TATCCTGGCGCAGCACAACTGCACCTCAAGCTGGTCGTCGACGCTGATACCGACGCTATT Y P G A A Q L H L K L V V D A D T D A I Y P G A A Q L H L K L V V D A D T D A I CTCGGCGCTCAGGCCGTTGGTGAAGACGGCGCGGACAAGCGTATCGACGTCATCGCCACG L G A Q A V G E D G A D K R I D V I A T L G A Q A V G E D G A D K R I D V I A T ACCATGCGTGCTGGTCTCAGCGCTACCGATCTCGCAGATCTCGAGCTGGCCTACTCCCCA T M R A G L S A T D L A D L E L A Y S P A M R A G L S A T D L A D L E L A Y S P CAGTATGGTTCGGCAAAAGACCCTGTGAACCTCATTGGCATGGTTAACGACAATATCCGC Q Y G S A K D P V N L I G M V N D N I R Q Y G S A K D P V N L I G M V N D N I R TCCGGTGAGCGCAGTGTGCAATGGCATGAGCTTGATGCTCAGATTGCCGATGGCTGGACC S G E R S V Q W H E L D A Q I A D G W T S G E R S V Q W H E L D A Q I A D G W T TTGGTAGATGTTCGCACCGCCGGTGAATTCGCCGCCGGCAATATTCCAGGTGCCATCAAT L V D V R T A G E F A A G N I P G A I N L V D V R T A G E F A A G N I P G A I N ATTCCTGTCGATGAGTTACGTGAGCACCTCGATGAGCTACAGGGCAAGAATGTGCTGGTA I P V D E L R E H L D E L Q G K N V L V I P V D E L R E H L D E L Q G K N V L V CATTGTCAGGTTGGCCTAAGGGGCCACGTTGCCGCTACTCTTTTGACTAATAGCGGTATC H C Q V G L R G H V A A T L L T N S G I H C Q V G L R G H V A A T L L T N S G I AACGCCGCCAACCTCGACGGTGGTTATCTCACATGGAAAACTGCCACCTCTTAA N A A N L D G G Y L T W K T A T S N A A N L D G G Y L T W K T A T S --- // >fig|6666666.67449.peg.1511 fig|257309.1.peg.1475 Putative amino acid carrier protein gi|372109441|gb|CP003213.1|_1534607_1533708,gi|372109441|gb|CP003213.1|_1533704_1533687,gi|372109441|gb|CP003213.1|_1533685_1533119 MPVLFHSMESLQTFITDDINDNYWKIIPFLLIAAGFYFAWRTILVQIRMIPEMFRAVVEKNDTPESHTDAEGISAFKAFTISAASRVGTGNVAGVAVAITLGGPGAVFWMWMIALLGGATAFVESTLAQLWKTKTDDGTHRGGPAFYMTRGLNAKWLAVIFGVAITVTYGFVYNSIQSNSIAEAVGESLGTSDNQFKIIVGAVLALLTGVIIFGGVQRIANFTQIVVPLMALAYMAIGIIVLVLNIEKIPGMFGDIISHALGFHEIAGATVGAAFMNGMRRGLFSNEAGQGSAPNAAGTAxCSAPSKQGLVQTLGVYFDTILVCSITAFIILLSDPEYGADVKGATLTQQALSGEVGAWGTHFITVILFFLAFSSVIGNTFLAQSNIEFFTQSKITMTIFRLIVVACVFGGAIGPLPLVWALGDTFAATMVVINLIAIVPLGGVAVALLKNYNQQKAKGLDPVFHRDMLPNVRNVECWDGSDPVTRRDHKIVREV We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCCAGTACTATTTCACTCTATGGAAAGCCTGCAGACGTTCATCACAGATGACATTAAC V P V L F H S M E S L Q T F I T D D I N M P V L F H S M E S L Q T F I T D D I N GATAATTATTGGAAGATCATTCCATTTCTTCTAATAGCAGCCGGTTTTTATTTCGCGTGG D N Y W K I I P F L L I A A G F Y F A W D N Y W K I I P F L L I A A G F Y F A W CGCACGATCCTCGTCCAAATTCGGATGATTCCGGAGATGTTCCGAGCAGTCGTGGAAAAG R T I L V Q I R M I P E M F R A V V E K R T I L V Q I R M I P E M F R A V V E K AACGACACCCCAGAATCTCATACTGACGCAGAAGGTATCTCTGCATTCAAGGCGTTTACA N D T P E S H T D A E G I S A F K A F T N D T P E S H T D A E G I S A F K A F T ATTTCTGCTGCTTCACGCGTGGGAACCGGAAATGTTGCAGGTGTTGCAGTGGCAATCACC I S A A S R V G T G N V A G V A V A I T I S A A S R V G T G N V A G V A V A I T CTAGGCGGTCCTGGTGCCGTGTTCTGGATGTGGATGATTGCTCTGCTGGGTGGTGCAACT L G G P G A V F W M W M I A L L G G A T L G G P G A V F W M W M I A L L G G A T GCATTCGTGGAATCAACACTGGCACAGCTGTGGAAAACTAAAACTGATGACGGCACCCAT A F V E S T L A Q L W K T K T D D G T H A F V E S T L A Q L W K T K T D D G T H CGTGGCGGCCCTGCGTTTTATATGACGCGTGGTCTGAACGCGAAATGGTTGGCCGTCATT R G G P A F Y M T R G L N A K W L A V I R G G P A F Y M T R G L N A K W L A V I TTTGGTGTAGCGATTACTGTTACTTACGGCTTTGTGTATAACTCGATTCAGTCGAACTCT F G V A I T V T Y G F V Y N S I Q S N S F G V A I T V T Y G F V Y N S I Q S N S ATTGCTGAGGCTGTAGGAGAATCGCTGGGTACGAGCGATAATCAATTCAAGATTATCGTT I A E A V G E S L G T S D N Q F K I I V I A E A V G E S L G T S D N Q F K I I V GGCGCAGTATTGGCATTGCTGACTGGTGTCATTATTTTTGGCGGCGTGCAGCGCATTGCG G A V L A L L T G V I I F G G V Q R I A G A V L A L L T G V I I F G G V Q R I A AACTTCACCCAAATTGTGGTTCCTCTCATGGCGCTGGCTTACATGGCCATCGGTATTATT N F T Q I V V P L M A L A Y M A I G I I N F T Q I V V P L M A L A Y M A I G I I GTGCTGGTACTTAACATCGAAAAGATTCCTGGCATGTTCGGAGACATTATTTCGCATGCT V L V L N I E K I P G M F G D I I S H A V L V L N I E K I P G M F G D I I S H A TTGGGTTTCCATGAGATCGCAGGTGCCACTGTTGGAGCGGCTTTCATGAACGGAATGCGT L G F H E I A G A T V G A A F M N G M R L G F H E I A G A T V G A A F M N G M R CGTGGTTTGTTCTCTAATGAAGCAGGACAAGGCTCTGCTCCCAATGCAGCAGGTACTGCT R G L F S N E A G Q G S A P N A A G T A R G L F S N E A G Q G S A P N A A G T A TAATGTTCCGCACCCAGTAAAGCAAGGACTGGTGCAAACTTTGGGCGTTTACTTTGACAC * C S A P S K Q G L V Q T L G V Y F D T X C S A P S K - Q G L V Q T L G V Y F D T CATTCTCGTGTGCTCGATTACCGCGTTTATCATTTTGCTGAGCGATCCAGAATATGGTGC I L V C S I T A F I I L L S D P E Y G A I L V C S I T A F I I L L S D P E Y G A AGACGTTAAAGGTGCCACGCTTACCCAGCAGGCATTGAGCGGAGAAGTCGGTGCGTGGGG D V K G A T L T Q Q A L S G E V G A W G D V K G A T L T Q Q A L S G E V G A W G TACACACTTCATCACTGTTATTTTGTTCTTCTTGGCGTTCTCATCGGTTATCGGTAATAC T H F I T V I L F F L A F S S V I G N T T H F I T V I L F F L A F S S V I G N T ATTCTTGGCACAGTCCAATATTGAGTTCTTTACGCAATCGAAGATCACTATGACGATTTT F L A Q S N I E F F T Q S K I T M T I F F L A Q S N I E F F T Q S K I T M T I F CCGATTGATCGTTGTCGCTTGTGTATTTGGTGGCGCAATTGGTCCATTGCCGTTGGTCTG R L I V V A C V F G G A I G P L P L V W R L I V V A C V F G G A I G P L P L V W GGCTTTGGGCGATACATTCGCTGCAACCATGGTGGTTATTAACCTGATCGCTATCGTGCC A L G D T F A A T M V V I N L I A I V P A L G D T F A A T M V V I N L I A I V P TCTGGGGGGCGTTGCGGTTGCTCTGCTAAAGAACTACAACCAGCAAAAAGCTAAGGGACT L G G V A V A L L K N Y N Q Q K A K G L L G G V A V A L L K N Y N Q Q K A K G L TGATCCGGTATTCCACCGCGATATGCTTCCGAATGTTCGTAACGTCGAATGCTGGGACGG D P V F H R D M L P N V R N V E C W D G D P V F H R D M L P N V R N V E C W D G GTCTGATCCGGTCACGCGTCGCGATCACAAGATTGTGCGCGAAGTCTAA S D P V T R R D H K I V R E V S D P V T R R D H K I V R E V --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1475): GTGCCAGTACTATTTCACTCTATGGAAAGCCTGCAGACGTTCATCACAGATGACATTAAC V P V L F H S M E S L Q T F I T D D I N M P V L F H S M E S L Q T F I T D E I N GATAATTATTGGAAGATCATTCCATTTCTTCTAATAGCAGCCGGTTTTTATTTCGCGTGG D N Y W K I I P F L L I A A G F Y F A W D N Y W K I I P F L L I A A G L Y F A W CGCACGATCCTCGTCCAAATTCGGATGATTCCGGAGATGTTCCGAGCAGTCGTGGAAAAG R T I L V Q I R M I P E M F R A V V E K R T I L V Q I R M I P D M F R A V V E K AACGACACCCCAGAATCTCATACTGACGCAGAAGGTATCTCTGCATTCAAGGCGTTTACA N D T P E S H T D A E G I S A F K A F T N D T P E S H T D A E D I S A F K A F T ATTTCTGCTGCTTCACGCGTGGGAACCGGAAATGTTGCAGGTGTTGCAGTGGCAATCACC I S A A S R V G T G N V A G V A V A I T I S A A S R V G T G N V A G V A V A I T CTAGGCGGTCCTGGTGCCGTGTTCTGGATGTGGATGATTGCTCTGCTGGGTGGTGCAACT L G G P G A V F W M W M I A L L G G A T L G G P G A V F W M W M I A L L G G A T GCATTCGTGGAATCAACACTGGCACAGCTGTGGAAAACTAAAACTGATGACGGCACCCAT A F V E S T L A Q L W K T K T D D G T H A F V E S T L A Q L W K T K T G D G T Y CGTGGCGGCCCTGCGTTTTATATGACGCGTGGTCTGAACGCGAAATGGTTGGCCGTCATT R G G P A F Y M T R G L N A K W L A V I R G G P A F Y M T R G L N A K W L A V I TTTGGTGTAGCGATTACTGTTACTTACGGCTTTGTGTATAACTCGATTCAGTCGAACTCT F G V A I T V T Y G F V Y N S I Q S N S F G V A I T V T Y G F V Y N S I Q S N S ATTGCTGAGGCTGTAGGAGAATCGCTGGGTACGAGCGATAATCAATTCAAGATTATCGTT I A E A V G E S L G T S D N Q F K I I V I A E A V G Q S L G T S D N Q F K I I V GGCGCAGTATTGGCATTGCTGACTGGTGTCATTATTTTTGGCGGCGTGCAGCGCATTGCG G A V L A L L T G V I I F G G V Q R I A G A V L A L L T G V I I F G G V Q R I A AACTTCACCCAAATTGTGGTTCCTCTCATGGCGCTGGCTTACATGGCCATCGGTATTATT N F T Q I V V P L M A L A Y M A I G I I N F T Q I V V P L M A L A Y M A I G I I GTGCTGGTACTTAACATCGAAAAGATTCCTGGCATGTTCGGAGACATTATTTCGCATGCT V L V L N I E K I P G M F G D I I S H A V L V L N I E K I P G M F G D I I S H A TTGGGTTTCCATGAGATCGCAGGTGCCACTGTTGGAGCGGCTTTCATGAACGGAATGCGT L G F H E I A G A T V G A A F M N G M R L G F Q E I A G A T V G A A F M N G M R CGTGGTTTGTTCTCTAATGAAGCAGGACAAGGCTCTGCTCCCAATGCAGCAGGTACTGCT R G L F S N E A G Q G S A P N A A G T A R G L F S N E A G Q G S A P N A A G T A TAATGTTCCGCACCCAGTAAAGCAAGGACTGGTGCAAACTTTGGGCGTTTACTTTGACAC N V P H P V K Q G L V Q T L G V Y F D T - N V P H P V K Q G L V Q T L G V Y F D T CATTCTCGTGTGCTCGATTACCGCGTTTATCATTTTGCTGAGCGATCCAGAATATGGTGC I L V C S I T A F I I L L S D P E Y G A I L V C S I T A F I I L L S D P E Y G A AGACGTTAAAGGTGCCACGCTTACCCAGCAGGCATTGAGCGGAGAAGTCGGTGCGTGGGG D V K G A T L T Q Q A L S G E V G A W G D V K G A T L T Q Q A L S G E V G A W G TACACACTTCATCACTGTTATTTTGTTCTTCTTGGCGTTCTCATCGGTTATCGGTAATAC T H F I T V I L F F L A F S S V I G N T T H F I T V I L F F L A F S S V I G N T ATTCTTGGCACAGTCCAATATTGAGTTCTTTACGCAATCGAAGATCACTATGACGATTTT F L A Q S N I E F F T Q S K I T M T I F F L A Q S N I E F F T Q S K I T M T I F CCGATTGATCGTTGTCGCTTGTGTATTTGGTGGCGCAATTGGTCCATTGCCGTTGGTCTG R L I V V A C V F G G A I G P L P L V W R L I V V A C V F G G A I G P L P L V W GGCTTTGGGCGATACATTCGCTGCAACCATGGTGGTTATTAACCTGATCGCTATCGTGCC A L G D T F A A T M V V I N L I A I V P A L G D T F A A T M V V I N L I A I V P TCTGGGGGGCGTTGCGGTTGCTCTGCTAAAGAACTACAACCAGCAAAAAGCTAAGGGACT L G G V A V A L L K N Y N Q Q K A K G L L G G V A V A L L K N Y N Q Q K A K G L TGATCCGGTATTCCACCGCGATATGCTTCCGAATGTTCGTAACGTCGAATGCTGGGACGG D P V F H R D M L P N V R N V E C W D G D P V F H R D M L P N V R N V E C W D G GTCTGATCCGGTCACGCGTCGCGATCACAAGATTGTGCGCGAAGTCTAA S D P V T R R D H K I V R E V S D P V T R R D H K I V R E V --- // >fig|6666666.67449.peg.867 fig|257309.1.peg.856 Pullulanase (EC 3.2.1.41) gi|372109441|gb|CP003213.1|_841524_841372,gi|372109441|gb|CP003213.1|_841368_839710 MTTTNSYTGQLGAFLTPHGDTCFRVWSPDAATADLLIENHTVSMHPIGDGVxEAKLDGDRHGQRYSYRLSLRGETIESVDPYARAVTANGTHGVVVTQSTPVPRMPAFTAPTDAIIYEAHVRDLSIAPNSGIHNKGRFLGLTERDTHTTAGNPSGLDYILSLGVTHIQLLPIFDFGSVDETGDLSYNAQYNWGYDPMNYNAPEGSYSSNPNDPFTRIDELKHTIRTLHDAGLRVIMDVVYNHVYDTTTSPLERTAPGHYFRITDDGTFHDGTFCGNETASENPMMRKFIIDSVTHWATEYGLDGFRFDLMGIHDVDTMNAIRTALDAIDPSIIILGEGWNLGNHPPHILPANQRNAAHMPRIAHFNDSLRDTLKGSTFHSNSRGLLTGDHNPKHMWTLFNNIKGAQHLPGLNFTSANHTVNYIEAHDNHTLYDRLHLLLPDAPHDELIRRCQLATTIQYLACGITFIHAGQEFARTKNNTENSYNSPDHINAIDYDRAAQHPHSVQLLRGLNRFRNTHTELFPTEYDDINELYEATLVSGDFLTYSVGKQTTVAINFSTQPRSIPTEGCFAVLLDDHMFPTDKQIETNSWTVAPLSVSILQQVS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACCACAACCAACTCCTACACCGGCCAACTCGGCGCCTTCCTCACTCCCCACGGGGAC M T T T N S Y T G Q L G A F L T P H G D M T T T N S Y T G Q L G A F L T P H G D ACCTGTTTTCGAGTCTGGTCTCCCGACGCCGCAACCGCCGACCTCCTCATCGAAAACCAC T C F R V W S P D A A T A D L L I E N H T C F R V W S P D A A T A D L L I E N H ACCGTGAGCATGCACCCCATCGGCGATGGGGTGTGAGAAGCAAAACTTGATGGTGATCGA T V S M H P I G D G V * E A K L D G D R T V S M H P I G D G V X E A K L D G D R CACGGTCAACGCTATAGTTACCGTCTTTCCCTCCGTGGGGAAACGATAGAATCAGTAGAC H G Q R Y S Y R L S L R G E T I E S V D H G Q R Y S Y R L S L R G E T I E S V D CCCTATGCTCGGGCGGTCACGGCTAACGGAACGCATGGGGTCGTCGTCACGCAATCCACC P Y A R A V T A N G T H G V V V T Q S T P Y A R A V T A N G T H G V V V T Q S T CCTGTGCCCCGCATGCCAGCCTTCACCGCGCCCACCGACGCCATTATTTACGAAGCACAC P V P R M P A F T A P T D A I I Y E A H P V P R M P A F T A P T D A I I Y E A H GTACGCGACCTGAGCATCGCCCCCAACAGCGGAATCCACAACAAAGGCCGCTTCCTAGGA V R D L S I A P N S G I H N K G R F L G V R D L S I A P N S G I H N K G R F L G CTCACCGAACGCGACACCCACACCACCGCTGGCAACCCCAGCGGCCTCGACTACATCCTA L T E R D T H T T A G N P S G L D Y I L L T E R D T H T T A G N P S G L D Y I L AGCCTCGGGGTCACCCACATCCAGCTCCTGCCGATTTTCGACTTCGGCTCCGTCGACGAA S L G V T H I Q L L P I F D F G S V D E S L G V T H I Q L L P I F D F G S V D E ACCGGCGACCTTAGCTACAACGCCCAATACAACTGGGGCTACGACCCCATGAATTACAAC T G D L S Y N A Q Y N W G Y D P M N Y N T G D L S Y N A Q Y N W G Y D P M N Y N GCGCCCGAAGGCTCCTACTCCAGCAACCCCAACGACCCCTTCACGCGCATCGACGAACTC A P E G S Y S S N P N D P F T R I D E L A P E G S Y S S N P N D P F T R I D E L AAACACACCATCCGCACGCTTCACGACGCAGGCCTGCGCGTCATCATGGACGTCGTCTAC K H T I R T L H D A G L R V I M D V V Y K H T I R T L H D A G L R V I M D V V Y AACCACGTCTACGACACCACCACCTCCCCACTCGAACGCACCGCCCCCGGTCACTACTTC N H V Y D T T T S P L E R T A P G H Y F N H V Y D T T T S P L E R T A P G H Y F CGCATTACCGACGACGGCACCTTCCACGACGGCACCTTCTGCGGCAACGAAACCGCCTCC R I T D D G T F H D G T F C G N E T A S R I T D D G T F H D G T F C G N E T A S GAAAACCCCATGATGCGCAAATTCATCATCGACTCCGTCACCCACTGGGCCACCGAATAC E N P M M R K F I I D S V T H W A T E Y E N P M M R K F I I D S V T H W A T E Y GGCCTCGACGGCTTCCGATTCGACCTCATGGGCATCCACGACGTCGACACCATGAACGCC G L D G F R F D L M G I H D V D T M N A G L D G F R F D L M G I H D V D T M N A ATCCGCACAGCCCTCGACGCCATCGACCCCTCCATCATCATCCTCGGCGAAGGCTGGAAC I R T A L D A I D P S I I I L G E G W N I R T A L D A I D P S I I I L G E G W N CTCGGCAACCACCCACCACACATCCTCCCAGCCAACCAACGCAACGCCGCCCACATGCCA L G N H P P H I L P A N Q R N A A H M P L G N H P P H I L P A N Q R N A A H M P CGCATCGCCCACTTCAACGACTCCCTCCGCGACACCCTCAAAGGAAGCACATTCCACTCC R I A H F N D S L R D T L K G S T F H S R I A H F N D S L R D T L K G S T F H S AACTCCCGCGGACTACTCACCGGCGACCACAACCCCAAACACATGTGGACCCTCTTCAAC N S R G L L T G D H N P K H M W T L F N N S R G L L T G D H N P K H M W T L F N AACATCAAAGGCGCCCAACACCTCCCAGGACTCAACTTCACCAGCGCCAACCACACCGTC N I K G A Q H L P G L N F T S A N H T V N I K G A Q H L P G L N F T S A N H T V AACTACATCGAAGCCCACGACAACCACACCCTCTACGACCGCCTCCACCTCCTCCTACCC N Y I E A H D N H T L Y D R L H L L L P N Y I E A H D N H T L Y D R L H L L L P GACGCGCCTCACGACGAGCTCATCCGACGCTGCCAACTCGCCACCACCATCCAATACCTC D A P H D E L I R R C Q L A T T I Q Y L D A P H D E L I R R C Q L A T T I Q Y L GCCTGCGGAATCACCTTCATCCACGCAGGACAAGAATTCGCACGCACAAAAAACAACACC A C G I T F I H A G Q E F A R T K N N T A C G I T F I H A G Q E F A R T K N N T GAAAACTCCTACAACTCACCCGACCACATCAACGCCATCGACTACGACCGCGCCGCACAA E N S Y N S P D H I N A I D Y D R A A Q E N S Y N S P D H I N A I D Y D R A A Q CACCCCCACAGCGTCCAACTCCTTCGCGGCCTCAACCGCTTCAGAAATACCCACACCGAG H P H S V Q L L R G L N R F R N T H T E H P H S V Q L L R G L N R F R N T H T E CTATTCCCCACCGAATACGACGACATCAACGAGCTCTACGAAGCAACGCTCGTGAGCGGT L F P T E Y D D I N E L Y E A T L V S G L F P T E Y D D I N E L Y E A T L V S G GACTTCCTCACCTACTCCGTGGGGAAACAAACAACAGTCGCCATTAACTTTTCAACGCAA D F L T Y S V G K Q T T V A I N F S T Q D F L T Y S V G K Q T T V A I N F S T Q CCACGCTCGATCCCCACGGAGGGATGCTTCGCAGTGCTTCTCGACGACCACATGTTCCCC P R S I P T E G C F A V L L D D H M F P P R S I P T E G C F A V L L D D H M F P ACGGACAAACAGATTGAAACGAACTCGTGGACGGTCGCGCCTCTCTCCGTGAGCATCCTC T D K Q I E T N S W T V A P L S V S I L T D K Q I E T N S W T V A P L S V S I L CAACAAGTTAGTTGA Q Q V S Q Q V S --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.856): ATGACCACAACCAACTCCTACACCGGCCAACTCGGCGCCTTCCTCACTCCCCACGGGGAC M T T T N S Y T G Q L G A F L T P H G D M T T T N S Y T G Q L G A F L T P H G D ACCTGTTTTCGAGTCTGGTCTCCCGACGCCGCAACCGCCGACCTCCTCATCGAAAACCAC T C F R V W S P D A A T A D L L I E N H T C F R V W S P D A A T A D L L I E N H ACCGTGAGCATGCACCCCATCGGCGATGGGGTGTGAGAAGCAAAACTTGATGGTGATCGA T V S M H P I G D G V * E A K L D G D R T V S M H P I G D G V W E A K L D G D R CACGGTCAACGCTATAGTTACCGTCTTTCCCTCCGTGGGGAAACGATAGAATCAGTAGAC H G Q R Y S Y R L S L R G E T I E S V D H G Q R Y S Y R L S L R G E T I E S V D CCCTATGCTCGGGCGGTCACGGCTAACGGAACGCATGGGGTCGTCGTCACGCAATCCACC P Y A R A V T A N G T H G V V V T Q S T P Y A R A V T A N G T H G V V V T Q S T CCTGTGCCCCGCATGCCAGCCTTCACCGCGCCCACCGACGCCATTATTTACGAAGCACAC P V P R M P A F T A P T D A I I Y E A H P V P R M P A F T A P T D A I I Y E A H GTACGCGACCTGAGCATCGCCCCCAACAGCGGAATCCACAACAAAGGCCGCTTCCTAGGA V R D L S I A P N S G I H N K G R F L G V R D L S I A P N S G I H N K G R F L G CTCACCGAACGCGACACCCACACCACCGCTGGCAACCCCAGCGGCCTCGACTACATCCTA L T E R D T H T T A G N P S G L D Y I L L T E R D T H T T A G N P S G L D Y I L AGCCTCGGGGTCACCCACATCCAGCTCCTGCCGATTTTCGACTTCGGCTCCGTCGACGAA S L G V T H I Q L L P I F D F G S V D E S L G V T H I Q L L P I F D F G S V D E ACCGGCGACCTTAGCTACAACGCCCAATACAACTGGGGCTACGACCCCATGAATTACAAC T G D L S Y N A Q Y N W G Y D P M N Y N T G D L S Y N A Q Y N W G Y D P M N Y N GCGCCCGAAGGCTCCTACTCCAGCAACCCCAACGACCCCTTCACGCGCATCGACGAACTC A P E G S Y S S N P N D P F T R I D E L A P E G S Y S S N P N D P F T R I D E L AAACACACCATCCGCACGCTTCACGACGCAGGCCTGCGCGTCATCATGGACGTCGTCTAC K H T I R T L H D A G L R V I M D V V Y K H T I R T L H D A G L R V I M D V V Y AACCACGTCTACGACACCACCACCTCCCCACTCGAACGCACCGCCCCCGGTCACTACTTC N H V Y D T T T S P L E R T A P G H Y F N H V Y D T T T S P L E R T A P G H Y F CGCATTACCGACGACGGCACCTTCCACGACGGCACCTTCTGCGGCAACGAAACCGCCTCC R I T D D G T F H D G T F C G N E T A S R M T D D G T F H D G T F C G N E T A S GAAAACCCCATGATGCGCAAATTCATCATCGACTCCGTCACCCACTGGGCCACCGAATAC E N P M M R K F I I D S V T H W A T E Y E N P M M R K F I I D S V T H W A T E Y GGCCTCGACGGCTTCCGATTCGACCTCATGGGCATCCACGACGTCGACACCATGAACGCC G L D G F R F D L M G I H D V D T M N A G L D G F R F D L M G I H D V D T M N A ATCCGCACAGCCCTCGACGCCATCGACCCCTCCATCATCATCCTCGGCGAAGGCTGGAAC I R T A L D A I D P S I I I L G E G W N I R T A L D A I D P S I I I L G E G W N CTCGGCAACCACCCACCACACATCCTCCCAGCCAACCAACGCAACGCCGCCCACATGCCA L G N H P P H I L P A N Q R N A A H M P L G N H P P H I L P A N Q H N A A H M P CGCATCGCCCACTTCAACGACTCCCTCCGCGACACCCTCAAAGGAAGCACATTCCACTCC R I A H F N D S L R D T L K G S T F H S R I A H F N D S L R D T L K G S T F H S AACTCCCGCGGACTACTCACCGGCGACCACAACCCCAAACACATGTGGACCCTCTTCAAC N S R G L L T G D H N P K H M W T L F N N S R G L L T G D H N P K H M W T L F N AACATCAAAGGCGCCCAACACCTCCCAGGACTCAACTTCACCAGCGCCAACCACACCGTC N I K G A Q H L P G L N F T S A N H T V N I K G A Q H L P G L N F T S A N H T V AACTACATCGAAGCCCACGACAACCACACCCTCTACGACCGCCTCCACCTCCTCCTACCC N Y I E A H D N H T L Y D R L H L L L P N Y I E A H D N H T L Y D R L H L L L P GACGCGCCTCACGACGAGCTCATCCGACGCTGCCAACTCGCCACCACCATCCAATACCTC D A P H D E L I R R C Q L A T T I Q Y L D A P H D E L I R R C Q L A T T I Q Y L GCCTGCGGAATCACCTTCATCCACGCAGGACAAGAATTCGCACGCACAAAAAACAACACC A C G I T F I H A G Q E F A R T K N N T A C G I T F I H A G Q E F A R T K N N T GAAAACTCCTACAACTCACCCGACCACATCAACGCCATCGACTACGACCGCGCCGCACAA E N S Y N S P D H I N A I D Y D R A A Q E N S Y N S P D H I N A I D Y D R A A Q CACCCCCACAGCGTCCAACTCCTTCGCGGCCTCAACCGCTTCAGAAATACCCACACCGAG H P H S V Q L L R G L N R F R N T H T E H P H S V Q L L R D L N N F R K T H T E CTATTCCCCACCGAATACGACGACATCAACGAGCTCTACGAAGCAACGCTCGTGAGCGGT L F P T E Y D D I N E L Y E A T L V S G L F P T E Y D D I N E L Y E A T L V S G GACTTCCTCACCTACTCCGTGGGGAAACAAACAACAGTCGCCATTAACTTTTCAACGCAA D F L T Y S V G K Q T T V A I N F S T Q D F L T Y S V G K Q T T V A I N F S T Q CCACGCTCGATCCCCACGGAGGGATGCTTCGCAGTGCTTCTCGACGACCACATGTTCCCC P R S I P T E G C F A V L L D D H M F P P R S I P T E G Y F A V L L D D H V F P ACGGACAAACAGATTGAAACGAACTCGTGGACGGTCGCGCCTCTCTCCGTGAGCATCCTC T D K Q I E T N S W T V A P L S V S I L T D K Q I E T N S W T V A P L S V S I L CAACAAGTTAGTTGA Q Q V S Q Q V S --- // >fig|6666666.67449.peg.942 fig|257309.1.peg.928 Putative RNA pseudouridylate synthase family protein gi|372109441|gb|CP003213.1|_915762_915986,gi|372109441|gb|CP003213.1|_915988_916446 MAAPAGDSPFSPRTPLAPVTLLEKPIPAWFWPGVPEEPSIPFDYTVIARTPDLLVVNKPCFLPATSNGRIVAETVHRLDRLTTGILLCSTNPETRAAYQQLFQRKAITKRYIAHVEGPIPFGPQWTEIELGMRKMGSRVVVDPTGTPTRTRVRRLGEGVVELQPATGHTHQLRVLLAWVGCPIIGDETYPVDRRRRIYDFSKKLELYATSLEFVDPVSNVTRRFARG We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGGCGGCGCCGGCAGGCGATAGTCCCTTTAGCCCAAGGACCCCGCTTGCCCCTGTCACC V A A P A G D S P F S P R T P L A P V T M A A P A G D S P F S P R T P L A P V T CTCCTAGAGAAACCCATCCCCGCATGGTTCTGGCCAGGAGTTCCGGAGGAGCCGTCAATC L L E K P I P A W F W P G V P E E P S I L L E K P I P A W F W P G V P E E P S I CCGTTCGACTACACGGTTATTGCGCGCACCCCTGACCTCCTAGTGGTGAATAAGCCATGT P F D Y T V I A R T P D L L V V N K P C P F D Y T V I A R T P D L L V V N K P C TTTCTGCCGGCAACCTCTAATGGGCGAATCGTTGCAGAGACGGTTGCATCGTCTCGACCG F L P A T S N G R I V A E T V H R L D R F L P A T S N G R I V A E T V - H R L D R CCTTACCACCGGCATTCTTTTATGCTCAACCAATCCCGAGACACGAGCCGCTTACCAGCA L T T G I L L C S T N P E T R A A Y Q Q L T T G I L L C S T N P E T R A A Y Q Q GCTTTTCCAGCGCAAAGCAATCACCAAGCGCTATATCGCCCACGTCGAGGGCCCGATCCC L F Q R K A I T K R Y I A H V E G P I P L F Q R K A I T K R Y I A H V E G P I P GTTCGGTCCACAATGGACAGAGATCGAACTAGGAATGCGCAAAATGGGGTCGCGGGTCGT F G P Q W T E I E L G M R K M G S R V V F G P Q W T E I E L G M R K M G S R V V CGTCGACCCCACAGGCACTCCTACTCGCACGAGGGTGCGTCGACTAGGAGAGGGGGTCGT V D P T G T P T R T R V R R L G E G V V V D P T G T P T R T R V R R L G E G V V TGAGCTCCAGCCGGCCACAGGCCATACTCATCAGCTTCGCGTCCTCCTAGCGTGGGTAGG E L Q P A T G H T H Q L R V L L A W V G E L Q P A T G H T H Q L R V L L A W V G TTGTCCGATCATTGGCGACGAAACATATCCCGTCGATCGGCGGCGCAGAATTTACGATTT C P I I G D E T Y P V D R R R R I Y D F C P I I G D E T Y P V D R R R R I Y D F TTCCAAGAAATTAGAATTATACGCCACGTCTTTGGAGTTCGTTGATCCCGTGTCCAATGT S K K L E L Y A T S L E F V D P V S N V S K K L E L Y A T S L E F V D P V S N V GACTAGGCGATTCGCTAGAGGATAA T R R F A R G T R R F A R G --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.928): GTGGCGGCGCCGGCAGGCGATAGTCCCTTTAGCCCAAGGACCCCGCTTGCCCCTGTCACC V A A P A G D S P F S P R T P L A P V T M A A S A G D S P F S P G T P L A P G T CTCCTAGAGAAACCCATCCCCGCATGGTTCTGGCCAGGAGTTCCGGAGGAGCCGTCAATC L L E K P I P A W F W P G V P E E P S I L L E K P I P A W F W L G V P E E P S I CCGTTCGACTACACGGTTATTGCGCGCACCCCTGACCTCCTAGTGGTGAATAAGCCATGT P F D Y T V I A R T P D L L V V N K P C P F D Y T V I A R T P D L L V V D K P C TTTCTGCCGGCAACCTCTAATGGGCGAATCGTTGCAGAGACGGTTG-------------- F L P A T S N G R I V A E T V F L P A T S N G R I V A E T V -QTRARIRENNPHIV --CATCGTCTCGACCGCCTTACCACCGGCATTCTTTTATGCTCAACCAATCCCGAGACAC H R L D R L T T G I L L C S T N P E T PL H R L D R L T T G I L L C S T N P E T GAGCCGCTTACCAGCAGCTTTTCCAGCGCAAAGCAATCACCAAGCGCTATATCGCCCACG R A A Y Q Q L F Q R K A I T K R Y I A H R A T Y Q Q L F Q H R A I T K R Y I A H TCGAGGGCCCGATCCCGTTCGGTCCACAATGGACAGAGATCGAACTAGGAATGCGCAAAA V E G P I P F G P Q W T E I E L G M R K V A G P I P F G P Q W T E I A L G M R K TGGGGTCGCGGGTCGTCGTCGACCCCACAGGCACTCCTACTCGCACGAGGGTGCGTCGAC M G S R V V V D P T G T P T R T R V R R M G P R V V V D P T G T L T R T R V R R TAGGAGAGGGGGTCGTTGAGCTCCAGCCGGCCACAGGCCATACTCATCAGCTTCGCGTCC L G E G V V E L Q P A T G H T H Q L R V L E E G V V E L Q P A T G H T H Q L R V TCCTAGCGTGGGTAGGTTGTCCGATCATTGGCGACGAAACATATCCCGTCGATCGGCGGC L L A W V G C P I I G D E T Y P V D R R L L A W V G C P I I G D D T Y P V D R R GCAGAATTTACGATTTTTCCAAGAAATTAGAATTATACGCCACGTCTTTGGAGTTCGTTG R R I Y D F S K K L E L Y A T S L E F V R R I Y D F S K K L E L Y A T S L E F V ATCCCGTGTCCAATGTGACTAGGCGATTCGCTAGAGGATAA D P V S N V T R R F A R G D P V S N V T R R F A R G --- // >fig|6666666.67449.peg.319 fig|257309.1.peg.165 Putative phage integrase gi|372109441|gb|CP003213.1|_298843_298637,gi|372109441|gb|CP003213.1|_298633_298478,gi|372109441|gb|CP003213.1|_298474_297644 MAFVRDLWTKPNPNATSRTKRIRSARWGKGKRWQAVWVENGKHVTTSCHAKDEAELHIARASVGQADGTxITKDKLDVTLQDMWDVWIASKQGRTESTKAGYIAAWKHIQPVFGNTACWKIExAKIAAWIPTVTTTKSSKHNQPRVIGSGSQRKIGIVIKALLDQAEELDIINKNKIRCTDIPRQGKAERRYLTIRGIDRLLAAAIPMNEVALMRNVLLFTGLRPREAKGLKVKDLDPLRGRLSIRRDVDDLGNPDETKTRNHRGVPIGGDLLFDLDDQAEGKQPHDWLLTDETGHVWTSTKWRRQWATICTHAHISGLTTYELRHTAASLAIAAGADVKTVQLMLGHASAATTLDTYAHLWETGLDSVPGAMSAHLQRERERLALRERRRVECELQVI We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCATTCGTGCGCGACCTCTGGACAAAACCCAACCCCAACGCAACATCGAGAACCAAA M A F V R D L W T K P N P N A T S R T K M A F V R D L W T K P N P N A T S R T K AGAATACGCTCTGCTCGATGGGGAAAAGGCAAACGCTGGCAAGCTGTCTGGGTAGAAAAC R I R S A R W G K G K R W Q A V W V E N R I R S A R W G K G K R W Q A V W V E N GGCAAACACGTCACCACCTCATGCCACGCCAAAGACGAAGCTGAACTTCACATCGCACGC G K H V T T S C H A K D E A E L H I A R G K H V T T S C H A K D E A E L H I A R GCATCCGTTGGCCAAGCCGATGGCACCTAGATTACTAAAGACAAACTCGATGTCACACTC A S V G Q A D G T * I T K D K L D V T L A S V G Q A D G T X I T K D K L D V T L CAAGACATGTGGGATGTATGGATCGCGTCAAAACAAGGACGCACAGAAAGCACCAAAGCT Q D M W D V W I A S K Q G R T E S T K A Q D M W D V W I A S K Q G R T E S T K A GGTTACATTGCTGCGTGGAAACACATCCAACCCGTCTTCGGAAACACCGCATGTTGGAAA G Y I A A W K H I Q P V F G N T A C W K G Y I A A W K H I Q P V F G N T A C W K ATTGAATGAGCAAAAATAGCAGCCTGGATCCCTACCGTCACCACCACCAAAAGCAGCAAG I E * A K I A A W I P T V T T T K S S K I E X A K I A A W I P T V T T T K S S K CATAACCAACCCCGTGTGATCGGCTCCGGCTCGCAACGCAAAATCGGAATCGTCATCAAA H N Q P R V I G S G S Q R K I G I V I K H N Q P R V I G S G S Q R K I G I V I K GCACTCCTCGACCAAGCCGAAGAACTCGACATCATTAACAAAAACAAAATCCGTTGCACC A L L D Q A E E L D I I N K N K I R C T A L L D Q A E E L D I I N K N K I R C T GATATCCCCCGCCAAGGAAAAGCAGAACGCCGCTACCTCACCATCCGAGGAATCGACCGC D I P R Q G K A E R R Y L T I R G I D R D I P R Q G K A E R R Y L T I R G I D R CTTTTAGCAGCTGCAATACCCATGAACGAAGTAGCACTCATGCGCAACGTTTTGTTATTC L L A A A I P M N E V A L M R N V L L F L L A A A I P M N E V A L M R N V L L F ACCGGTCTTCGCCCAAGGGAAGCAAAAGGATTGAAAGTCAAAGACCTCGACCCCCTGCGC T G L R P R E A K G L K V K D L D P L R T G L R P R E A K G L K V K D L D P L R GGTAGGCTGTCCATCCGTCGTGACGTCGACGATCTCGGAAACCCCGATGAAACAAAAACC G R L S I R R D V D D L G N P D E T K T G R L S I R R D V D D L G N P D E T K T AGAAACCACCGCGGCGTCCCCATCGGTGGTGACCTCCTTTTCGATCTCGACGACCAAGCA R N H R G V P I G G D L L F D L D D Q A R N H R G V P I G G D L L F D L D D Q A GAAGGAAAACAACCACATGACTGGCTCCTCACCGATGAAACCGGCCATGTGTGGACATCC E G K Q P H D W L L T D E T G H V W T S E G K Q P H D W L L T D E T G H V W T S ACAAAATGGCGCAGGCAGTGGGCAACCATCTGCACTCATGCACACATATCAGGCCTGACA T K W R R Q W A T I C T H A H I S G L T T K W R R Q W A T I C T H A H I S G L T ACCTACGAGCTACGACACACAGCAGCATCATTGGCGATTGCAGCCGGTGCTGACGTGAAA T Y E L R H T A A S L A I A A G A D V K T Y E L R H T A A S L A I A A G A D V K ACCGTTCAACTTATGCTTGGACACGCAAGTGCTGCCACGACCCTTGACACCTACGCACAC T V Q L M L G H A S A A T T L D T Y A H T V Q L M L G H A S A A T T L D T Y A H TTGTGGGAAACCGGACTAGATTCCGTTCCCGGCGCGATGAGTGCTCATTTGCAGCGTGAG L W E T G L D S V P G A M S A H L Q R E L W E T G L D S V P G A M S A H L Q R E CGTGAGAGGTTAGCGTTGCGTGAGCGTAGGCGTGTTGAGTGTGAGTTACAGGTTATTTAG R E R L A L R E R R R V E C E L Q V I R E R L A L R E R R R V E C E L Q V I --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.165): ATGGCATTCGTGCGCGACCTCTGGACAAAACCCAACCCCAACGCAACATCGAGAACCAAA M A F V R D L W T K P N P N A T S R T K M A T V R D L W T K R N P N T T S K T K AGAATACGCTCTGCTCGATGGGGAAAAGGCAAACGCTGGCAAGCTGTCTGGGTAGAAAAC R I R S A R W G K G K R W Q A V W V E N R I R S A R W G V G K R W Q A V W I E N GGCAAACACGTCACCACCTCATGCCACGCCAAAGACGAAGCTGAACTTCACATCGCACGC G K H V T T S C H A K D E A E L H I A R G R E A T K T F E T R D E A E L W A A R GCATCCGTTGGCCAAGCCGATGGCACCTAGATTACTAAAGACAAACTCGATGTCACACTC A S V G Q A D G T * I T K D K L D V T L A E V G K A D G T W I T K D K V D I T L CAAGACATGTGGGATGTATGGATCGCGTCAAAACAAGGACGCACAGAAAGCACCAAAGCT Q D M W D V W I A S K Q G R T E S T K A S D L W E P W I A S K G N I S D K T K R GGTTACATTGCTGCGTGGAAA-CACATCCAACCCGTCTTCGGAAACACCGCATGTTGGAA G Y I A A W K H I Q P V F G N T A C W K D Y L S Y W N V H I R P Q W G Q T P C A H AATTGAATGAGCAAAAATAGCAGCCTGGATCCCTACCGTCACCACCACCAAAAGCAGCAA I E * A K I A A W I P T V T T T K S S K I Q R S V I N A W I P T L S T M K G V P GCATAACCAACCC-CGTGTGATCGGCTCCGGCTCGCAACGCAAAATCGGAATCGTCATCA H N Q P R V I G S G S Q R K I G I V I A S Q P P R P L S E S A M R K V G L I I AAGCACTCCTCGACCAAGCCGAAGAACTCGACATCATTAACAAAAACAAAATCCGTTGCA K A L L D Q A E E L D I I N K N K I R C H G I L D L A V E L G V I H Q N P I R T CCGATATCCCCCGCCAAGGAAAAGCAGAACGCCGCTACCTCACCATCCGAGGAATCGACC T D I P R Q G K A E R R Y L T I R G I D G D L P K Q K K S E R R Y L K I T E V D GCCTTTTAGCAGCTGCAATACCCATGAACGAAGTAGCACTCATGCGCAACGTTTTGTTAT R L L A A A P M N E V A L M R N V L L E L I R Q A --- P T E Q A K L L L R V L I TCACCGGTCTTCGCCCAAGGGAAGCAAAAGGATTGAAAGTCAAAGACCTCGACCCCCTGC F T G L R P R E A K G L K V K D L D P L M T G L R P G E A K G L K V K D L D P V GCGGTAGGCTGTCCATCCGTCGTGACGTCGACGATCTCGGAAACCCCGATGAAACAAAAA R G R L S I R R D V D D L G N P D E T K R G R L M I R R D V D D L G H E D S T K CCAGAAACCACCGCGGCGTCCCCATCGGTGGTGACCTCCTTTTCGATCTCGACGACCAAG T R N H R G V P I G G D L L F D L D D Q T R N H R D V P I G G E I L L L L D R Y CAGAAGGAAAACAACCACATGACTGGCTCCTCACCGATGAAACCGGCCATGTGTGGACAT A E G K Q P H D W L L T D E T G H V W T A Q G K D P D S W L I P D E R G K V W T CCACAAAATGGCGCAGGCAGTGGGCAACCATCTGCACTCATGCACACATATCAGGCCTGA S T K W R R Q W A T I C T H A H I S G L T S R W R V V W K N L C I W T G I G D L CAACCTACGAGCTACGACACACAGCAGCATCATTGGCGATTGCAGCCGGTGCTGACGTGA T T Y E L R H T A A S L A I A A G A D V D T Y E L R H T A A S I A I A A G A D V AAACCGTTCAACTTATGCTTGGACACGCAAGTGCTGCCACGACCCTTGACACCTACGCAC K T V Q L M L G H A S A A T T L D T Y A K T V Q L M L G H S S A A M T L D I Y A ACTTGTGGGAAACCGGACTAGATTCCGTTCCCGGCGCGATGAGTGCTCATTTGCAGCGTG H L W E T G L D S V P G A M S A H L Q R H L W E E G L D A I P G A M E A H M E S AGCGTGAGAGGTTA---------GCGTTGCGTGAGCGTAGGCGTGTTGAGTGT*GA*GTT E R E R L A L R E R R R V E C V E R K R A EEASTVHEA S E A E R R R A Q F *K** V ACAGGTTATTTAG T G I G ------- // >fig|6666666.67449.peg.234 fig|257309.1.peg.246 Putative nitroreductase gi|372109441|gb|CP003213.1|_211106_210597,gi|372109441|gb|CP003213.1|_210593_210342 MKASMNETIRTQLNHRTIREFTTEQVSEEIMEQLFAVAGRTATSLGMQSTSIIRVTDPQLRARLAEIGAQEYVGRAPIYLLFIVDCHRNAGILQELGADPAGVATARNFVQGFTDTCLTAQNVCIAAESMGLGVNFLGNVHNDAAAVIELLQLPELTFPVVGMTLGWPNQxPQLKPRMATPLRTMENGYHAPDSWLEALSDYDQEMTTYYDLRDANRRVDSFTRQVLAKNPAAGADSDKRNYTFAIARDQGFNL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAAGGCAAGTATGAATGAGACGATTCGCACCCAGCTTAACCACCGCACTATCCGTGAG M K A S M N E T I R T Q L N H R T I R E M K A S M N E T I R T Q L N H R T I R E TTCACCACCGAGCAAGTATCGGAGGAGATCATGGAGCAGCTGTTTGCGGTGGCGGGGCGG F T T E Q V S E E I M E Q L F A V A G R F T T E Q V S E E I M E Q L F A V A G R ACTGCCACCTCGTTGGGAATGCAAAGCACCAGCATTATCCGTGTAACTGACCCCCAGTTA T A T S L G M Q S T S I I R V T D P Q L T A T S L G M Q S T S I I R V T D P Q L CGGGCACGCTTAGCCGAAATCGGCGCCCAGGAATATGTTGGCCGTGCCCCCATCTACCTG R A R L A E I G A Q E Y V G R A P I Y L R A R L A E I G A Q E Y V G R A P I Y L CTGTTTATTGTCGATTGCCACCGCAACGCAGGTATCCTCCAAGAGCTAGGCGCGGACCCT L F I V D C H R N A G I L Q E L G A D P L F I V D C H R N A G I L Q E L G A D P GCCGGTGTTGCGACAGCCCGCAACTTTGTCCAAGGGTTCACCGATACCTGCCTCACGGCA A G V A T A R N F V Q G F T D T C L T A A G V A T A R N F V Q G F T D T C L T A CAAAACGTGTGCATCGCTGCGGAATCGATGGGCTTAGGTGTGAACTTCCTCGGCAACGTC Q N V C I A A E S M G L G V N F L G N V Q N V C I A A E S M G L G V N F L G N V CACAACGATGCTGCGGCTGTGATCGAACTGCTGCAACTACCTGAGCTCACTTTCCCAGTT H N D A A A V I E L L Q L P E L T F P V H N D A A A V I E L L Q L P E L T F P V GTGGGCATGACACTGGGCTGGCCTAATCAATAGCCGCAGCTTAAACCACGTATGGCCACC V G M T L G W P N Q * P Q L K P R M A T V G M T L G W P N Q X P Q L K P R M A T CCATTGCGCACAATGGAAAATGGTTACCATGCGCCCGACTCGTGGCTAGAAGCGCTTAGT P L R T M E N G Y H A P D S W L E A L S P L R T M E N G Y H A P D S W L E A L S GACTACGACCAAGAGATGACCACCTACTACGATCTTCGGGATGCCAACCGGCGCGTAGAT D Y D Q E M T T Y Y D L R D A N R R V D D Y D Q E M T T Y Y D L R D A N R R V D AGTTTCACCCGTCAGGTGCTCGCGAAAAATCCTGCTGCCGGAGCCGACTCCGATAAACGC S F T R Q V L A K N P A A G A D S D K R S F T R Q V L A K N P A A G A D S D K R AATTACACCTTCGCGATCGCCCGCGACCAAGGGTTTAACCTCTAG N Y T F A I A R D Q G F N L N Y T F A I A R D Q G F N L --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.246): ATGAAGGCAAGTATGAATGAGACGATTCGCACCCAGCTTAACCACCGCACTATCCGTGAG M K A S M N E T I R T Q L N H R T I R E M K A S M N E T I R T Q L N H R T I R E TTCACCACCGAGCAAGTATCGGAGGAGATCATGGAGCAGCTGTTTGCGGTGGCGGGGCGG F T T E Q V S E E I M E Q L F A V A G R F S T E Q V S E E I M E Q L F A V A G R ACTGCCACCTCGTTGGGAATGCAAAGCACCAGCATTATCCGTGTAACTGACCCCCAGTTA T A T S L G M Q S T S I I R V T D P Q L T A T S L G M Q S T S I I R V T D P Q L CGGGCACGCTTAGCCGAAATCGGCGCCCAGGAATATGTTGGCCGTGCCCCCATCTACCTG R A R L A E I G A Q E Y V G R A P I Y L R V R L A E I G A Q E Y V G R A P I Y L CTGTTTATTGTCGATTGCCACCGCAACGCAGGTATCCTCCAAGAGCTAGGCGCGGACCCT L F I V D C H R N A G I L Q E L G A D P L F I V D C H R N A G I L Q E L G A D P GCCGGTGTTGCGACAGCCCGCAACTTTGTCCAAGGGTTCACCGATACCTGCCTCACGGCA A G V A T A R N F V Q G F T D T C L T A A G A A T A R N F V Q G F T D A C L T A CAAAACGTGTGCATCGCTGCGGAATCGATGGGCTTAGGTGTGAACTTCCTCGGCAACGTC Q N V C I A A E S M G L G V N F L G N V Q N V C I A A E S M G L G V N F L G N V CACAACGATGCTGCGGCTGTGATCGAACTGCTGCAACTACCTGAGCTCACTTTCCCAGTT H N D A A A V I E L L Q L P E L T F P V H N D A A A V I E L L Q L P E L T F P V GTGGGCATGACACTGGGCTGGCCTAATCAATAGCCGCAGCTTAAACCACGTATGGCCACC V G M T L G W P N Q * P Q L K P R M A T V G M T L G W P N Q E P Q L K P R M A T CCATTGCGCACAATGGAAAATGGTTACCATGCGCCCGACTCGTGGCTAGAAGCGCTTAGT P L R T M E N G Y H A P D S W L E A L S P L R T M E N G Y H A P D S W L E A L S GACTACGACCAAGAGATGACCACCTACTACGATCTTCGGGATGCCAACCGGCGCGTAGAT D Y D Q E M T T Y Y D L R D A N R R V D D Y D Q E M T T Y Y D L R D A N R R V D AGTTTCACCCGTCAGGTGCTCGCGAAAAATCCTGCTGCCGGAGCCGACTCCGATAAACGC S F T R Q V L A K N P A A G A D S D K R S F T R Q V L A K N P A A G A D S D K R AATTACACCTTCGCGATCGCCCGCGACCAAGGGTTTAACCTCTAG N Y T F A I A R D Q G F N L N H T F A I A R D Q G F N L --- // >fig|6666666.67449.peg.926 fig|257309.1.peg.911 Dipeptide transport system permease protein DppB (TC 3.A.1.5.2) gi|372109441|gb|CP003213.1|_898971_899276,gi|372109441|gb|CP003213.1|_899278_899898 MLRYIGRRLLQMIPVFFGATLLLYALVFLMPGDPVAALGGDRGLTEAARARISAEYNLDKPFLVQYLLYIKGIFQLDFGTTFSGRPVAEAMAHAFPVDYQVSVMALIFEAVFGVIFGVIAGMRRGGIFDSTVLVLSLLVIAVPSFVIGFVFQFFVGVKWGLLPVTVGSNVSVKSLLMPAIVLGALSFAYVVRLTRQSVSENLTADYVRTARAKGLKGSTVTMRHVLRNSLIPVATYLGADLGALMAGAIVTEGIFGINGVGGTMYHAILKGEPTTVVSFTTVLVIVYIIANLVVDLIYALLDPRIRYA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGTTGCGTTATATCGGGCGCCGATTGCTCCAAATGATCCCCGTGTTCTTTGGTGCAACC M L R Y I G R R L L Q M I P V F F G A T M L R Y I G R R L L Q M I P V F F G A T CTTTTGCTCTACGCACTCGTCTTCTTGATGCCTGGCGATCCAGTGGCCGCCCTCGGCGGC L L L Y A L V F L M P G D P V A A L G G L L L Y A L V F L M P G D P V A A L G G GACAGAGGCCTAACCGAAGCAGCCCGCGCTCGCATCTCTGCCGAGTACAACTTGGACAAA D R G L T E A A R A R I S A E Y N L D K D R G L T E A A R A R I S A E Y N L D K CCCTTCCTCGTTCAATACTTGCTCTACATCAAGGGTATTTTTCAGCTGGACTTTGGTACC P F L V Q Y L L Y I K G I F Q L D F G T P F L V Q Y L L Y I K G I F Q L D F G T ACATTTTCCGGCCGCCCAGTGGCAGAAGCAATGGCTCATGCATTTCCTGTTGACTATCAA T F S G R P V A E A M A H A F P V D Y Q T F S G R P V A E A M A H A F P V D Y Q GTTAGCTGTCATGGCACTGATCTTTGAAGCTGTGTTCGGTGTTATTTTTGGTGTGATCGC V S V M A L I F E A V F G V I F G V I A V S - V M A L I F E A V F G V I F G V I A CGGTATGCGTCGCGGTGGCATATTTGACTCCACCGTTTTGGTCCTCTCGCTTCTTGTTAT G M R R G G I F D S T V L V L S L L V I G M R R G G I F D S T V L V L S L L V I TGCAGTGCCTTCCTTCGTGATTGGCTTTGTTTTCCAGTTCTTTGTGGGAGTGAAGTGGGG A V P S F V I G F V F Q F F V G V K W G A V P S F V I G F V F Q F F V G V K W G ATTACTCCCTGTAACTGTTGGTTCAAATGTCTCGGTGAAGTCGCTTCTTATGCCCGCCAT L L P V T V G S N V S V K S L L M P A I L L P V T V G S N V S V K S L L M P A I CGTATTGGGTGCGTTGTCTTTTGCTTATGTTGTTCGTTTGACTAGGCAGTCCGTATCGGA V L G A L S F A Y V V R L T R Q S V S E V L G A L S F A Y V V R L T R Q S V S E AAATCTCACTGCTGATTATGTTCGCACTGCGCGAGCTAAAGGCTTGAAGGGGTCGACCGT N L T A D Y V R T A R A K G L K G S T V N L T A D Y V R T A R A K G L K G S T V GACGATGCGCCATGTGCTGCGTAACTCGTTGATTCCAGTGGCCACATATTTGGGTGCTGA T M R H V L R N S L I P V A T Y L G A D T M R H V L R N S L I P V A T Y L G A D CCTAGGCGCCTTGATGGCCGGTGCGATCGTGACTGAGGGCATATTCGGCATTAACGGTGT L G A L M A G A I V T E G I F G I N G V L G A L M A G A I V T E G I F G I N G V TGGTGGAACTATGTACCACGCCATTTTGAAGGGCGAACCTACCACGGTGGTGTCATTTAC G G T M Y H A I L K G E P T T V V S F T G G T M Y H A I L K G E P T T V V S F T CACCGTTCTCGTGATCGTCTACATCATTGCCAACTTGGTCGTGGACTTAATCTACGCCCT T V L V I V Y I I A N L V V D L I Y A L T V L V I V Y I I A N L V V D L I Y A L GCTTGACCCAAGGATCCGCTATGCATAA L D P R I R Y A L D P R I R Y A --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.911): ATGTTGCGTTATATCGGGCGCCGATTGCTCCAAATGATCCCCGTGTTCTTTGGTGCAACC M L R Y I G R R L L Q M I P V F F G A T M L R Y I G R R L L Q M I P V F F G A T CTTTTGCTCTACGCACTCGTCTTCTTGATGCCTGGCGATCCAGTGGCCGCCCTCGGCGGC L L L Y A L V F L M P G D P V A A L G G L L L Y A L V F L M P G D P V A A L G G GACAGAGGCCTAACCGAAGCAGCCCGCGCTCGCATCTCTGCCGAGTACAACTTGGACAAA D R G L T E A A R A R I S A E Y N L D K D R G L T E A A R A R I S A E Y N L D K CCCTTCCTCGTTCAATACTTGCTCTACATCAAGGGTATTTTTCAGCTGGACTTTGGTACC P F L V Q Y L L Y I K G I F Q L D F G T P F L V Q Y L L Y I K G I F Q L D F G T ACATTTTCCGGCCGCCCAGTGGCAGAAGCAATGGCTCATGCATTTCCTGTTGACTATCAA T F S G R P V A E A M A H A F P V T I K T F S G R P V A E A M A H A F P V - T I K GTTAGCTGTCATGGCACTGATCTTTGAAGCTGTGTTCGGTGTTATTTTTGGTGTGATCGC L A V M A L I F E A V F G V I F G V I A L A V M A L I F E A V F G V I F G V I A CGGTATGCGTCGCGGTGGCATATTTGACTCCACCGTTTTGGTCCTCTCGCTTCTTGTTAT G M R R G G I F D S T V L V L S L L V I G M R R G G I F D S T V L V L S L L V I TGCAGTGCCTTCCTTCGTGATTGGCTTTGTTTTCCAGTTCTTTGTGGGAGTGAAGTGGGG A V P S F V I G F V F Q F F V G V K W G A V P S F V I G F V F Q F F V G V K W G ATTACTCCCTGTAACTGTTGGTTCAAATGTCTCGGTGAAGTCGCTTCTTATGCCCGCCAT L L P V T V G S N V S V K S L L M P A I L L P V T V G S N V S V K S L L M P A I CGTATTGGGTGCGTTGTCTTTTGCTTATGTTGTTCGTTTGACTAGGCAGTCCGTATCGGA V L G A L S F A Y V V R L T R Q S V S E V L G A L S F A Y V V R L T R Q S V S E AAATCTCACTGCTGATTATGTTCGCACTGCGCGAGCTAAAGGCTTGAAGGGGTCGACCGT N L T A D Y V R T A R A K G L K G S T V N L T A D Y V R T A R A K G L K G S T V GACGATGCGCCATGTGCTGCGTAACTCGTTGATTCCAGTGGCCACATATTTGGGTGCTGA T M R H V L R N S L I P V A T Y L G A D T M R H V L R N S L I P V A T Y L G A D CCTAGGCGCCTTGATGGCCGGTGCGATCGTGACTGAGGGCATATTCGGCATTAACGGTGT L G A L M A G A I V T E G I F G I N G V L G A L M A G A I V T E G I F G I N G V TGGTGGAACTATGTACCACGCCATTTTGAAGGGCGAACCTACCACGGTGGTGTCATTTAC G G T M Y H A I L K G E P T T V V S F T G G T M Y H A I L K G E P T T V V S F T CACCGTTCTCGTGATCGTCTACATCATTGCCAACTTGGTCGTGGACTTAATCTACGCCCT T V L V I V Y I I A N L V V D L I Y A L T V L V I V Y I I A N L V V D L I Y A L GCTTGACCCAAGGATCCGCTATGCATAA L D P R I R Y A L D P R I R Y A --- // >fig|6666666.67449.peg.1985 fig|257309.1.peg.1910 Transposase gi|372109441|gb|CP003213.1|_2013929_2014528,gi|372109441|gb|CP003213.1|_2014530_2014895 MAYDFVIGMDVGKYFHHACVLDPQGRQVLSQRINQHEGSLRKIFGKFLANDAEVLVVVDQPNNIGRLTVTVAQTIGADVRYLPRLAMRQLSRIHVGNSKTDVRDAYVIAHAGLNLPDALRSVDRVEDVFLQLKVPNGIDENLARAYTDLGFPVVIACVDDGVAVSLGSACRDSLSAAAVAALNEAWAFYPERQRVRSAGAIRSVLDHANQVSLPEWTTPIDRLFGADQPPRRCSKAEDSVTPSALAALIDAGFDPIRINTTLAEVQEYGLTAVTVVVPGLVPIDFGWDRQRAQFMERPAQLCSQATGGIINPLETTCHPFA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCCTATGACTTCGTCATTGGCATGGACGTCGGCAAATACTTCCACCACGCCTGCGTC M A Y D F V I G M D V G K Y F H H A C V M A Y D F V I G M D V G K Y F H H A C V CTCGATCCCCAAGGCAGACAAGTCCTATCCCAACGCATCAACCAGCACGAAGGATCGCTA L D P Q G R Q V L S Q R I N Q H E G S L L D P Q G R Q V L S Q R I N Q H E G S L CGCAAGATCTTCGGCAAATTCCTAGCCAATGACGCCGAAGTCCTTGTCGTCGTCGATCAG R K I F G K F L A N D A E V L V V V D Q R K I F G K F L A N D A E V L V V V D Q CCCAACAACATCGGCCGACTCACCGTCACAGTCGCCCAAACAATCGGAGCCGACGTTCGC P N N I G R L T V T V A Q T I G A D V R P N N I G R L T V T V A Q T I G A D V R TACCTCCCCAGACTTGCCATGCGACAGCTTTCACGCATCCACGTCGGCAACTCCAAGACC Y L P R L A M R Q L S R I H V G N S K T Y L P R L A M R Q L S R I H V G N S K T GATGTACGCGACGCCTACGTCATCGCCCATGCCGGCCTCAACCTTCCGGATGCCCTGCGT D V R D A Y V I A H A G L N L P D A L R D V R D A Y V I A H A G L N L P D A L R AGTGTCGACCGCGTGGAGGACGTCTTCCTCCAGCTGAAAGTCCCCAACGGAATCGACGAA S V D R V E D V F L Q L K V P N G I D E S V D R V E D V F L Q L K V P N G I D E AACCTCGCCCGCGCCTATACCGATCTCGGATTCCCCGTGGTTATCGCCTGCGTCGACGAC N L A R A Y T D L G F P V V I A C V D D N L A R A Y T D L G F P V V I A C V D D GGCGTGGCAGTGTCTTTAGGATCGGCCTGCCGCGATTCGCTTAGTGCTGCAGCCGTCGCA G V A V S L G S A C R D S L S A A A V A G V A V S L G S A C R D S L S A A A V A GCCCTCAACGAAGCTTGGGCTTTTTACCCCGAGCGGCAGCGCGTTCGCAGTGCCGGAGCA A L N E A W A F Y P E R Q R V R S A G A A L N E A W A F Y P E R Q R V R S A G A TATTCGTTCTGTCCTTGACCACGCTAATCAGGTGTCACTCCCAGAGTGGACAACCCCCAT I R S V L D H A N Q V S L P E W T T P I - I R S V L D H A N Q V S L P E W T T P I CGACAGGCTATTCGGCGCAGATCAACCACCGCGTCGGTGCAGCAAGGCTGAAGACTCAGT D R L F G A D Q P P R R C S K A E D S V D R L F G A D Q P P R R C S K A E D S V TACCCCGTCTGCTCTCGCAGCGCTTATCGACGCCGGCTTTGACCCCATCCGCATAAACAC T P S A L A A L I D A G F D P I R I N T T P S A L A A L I D A G F D P I R I N T CACGCTGGCCGAGGTCCAGGAATATGGCCTCACAGCCGTGACCGTGGTCGTCCCAGGCCT T L A E V Q E Y G L T A V T V V V P G L T L A E V Q E Y G L T A V T V V V P G L CGTCCCTATCGACTTTGGTTGGGACCGCCAACGAGCACAGTTTATGGAGCGACCCGCCCA V P I D F G W D R Q R A Q F M E R P A Q V P I D F G W D R Q R A Q F M E R P A Q GCTTTGCAGCCAAGCAACCGGTGGCATCATAAACCCATTAGAAACGACGTGCCACCCCTT L C S Q A T G G I I N P L E T T C H P F L C S Q A T G G I I N P L E T T C H P F TGCGTAA A A --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1910): ATGGCCTATGACTTCGTCATTGGCATGGACGTCGGCAAATACTTCCACCACGCCTGCGTC M A Y D F V I G M D V G K Y F H H A C V M A Y D F V I G M D V G K Y F H H A C V CTCGATCCCCAAGGCAGACAAGTCCTATCCCAACGCATCAACCAGCACGAAGGATCGCTA L D P Q G R Q V L S Q R I N Q H E G S L L D P Q S R Q V L S Q R I N Q H E G S L CGCAAGATCTTCGGCAAATTCCTAGCCAATGACGCCGAAGTCCTTGTCGTCGTCGATCAG R K I F G K F L A N D A E V L V V V D Q R K L F G K F L A N N V E V L V V V D Q CCCAACAACATCGGCCGACTCACCGTCACAGTCGCCCAAACAATCGGAGCCGACGTTCGC P N N I G R L T V T V A Q T I G A D V R P N N I G R L T V T V A Q T I G A D V R TACCTCCCCAGACTTGCCATGCGACAGCTTTCACGCATCCACGTCGGCAACTCCAAGACC Y L P R L A M R Q L S R I H V G N S K T Y L P R L A M R Q L S R I H V G N S K T GATGTACGCGACGCCTACGTCATCGCCCATGCCGGCCTCAACCTTCCGGATGCCCTGCGT D V R D A Y V I A H A G L N L P D A L R D V R D A Y V I A H A G L N L P D A L R AGTGTCGACCGCGTGGAGGACGTCTTCCTCCAGCTGAAAGTCCCCAACGGAATCGACGAA S V D R V E D V F L Q L K V P N G I D E S V D R V E D V F L Q L K V P N G I D E AACCTCGCCCGCGCCTATACCGATCTCGGATTCCCCGTGGTTATCGCCTGCGTCGACGAC N L A R A Y T D L G F P V V I A C V D D N L A R A Y T D L G F P V V I A C V D D GGCGTGGCAGTGTCTTTAGGATCGGCCTGCCGCGATTCGCTTAGTGCTGCAGCCGTCGCA G V A V S L G S A C R D S L S A A A V A G V A V S L G S A C R D S L S A A A V A GCCCTCAACGAAGCTTGGGCTTTTTACCCCGAGCGGCAGCGCGTTCGCAGT*G*----CC A L N E A W A F Y P E R Q R V R S P A L N E A W A F Y P E R Q R V R S *A*GSAV P GGAGCATATTCGTTCTGTCCTTGACCACGCTAATCAGGTGTCACTCCCAGAGTGGACAAC E H I R S V L D H A N Q V S L P E W T T E H I R S V L D H A N Q V S L P E W T T CCCCATCGACAGGCTATTCGGCGCAGATCAACCACCGCGTCGGTGCAGCAAGGCTGAAGA P I D R L F G A D Q P P R R C S K A E D P I D R L L G A D Q P P R R C S K A E D CTCAGTTACCCCGTCTGCTCTCGCAGCGCTTATCGACGCCGGCTTTGACCCCATCCGCAT S V T P S A L A A L I D A G F D P I R I S V T P S A L A A L I D A G F D P I R I AAACACCACGCTGGCCGAGGTCCAGGAATATGGCCTCACAGCCGTGACCGTGGTCGTCCC N T T L A E V Q E Y G L T A V T V V V P N T T L A E V Q E Y G L T A V T V V V P AGGCCTCGTCCCTATCGACTTTGGTTGGGACCGCCAACGAGCACAGTTTATGGAGCGACC G L V P I D F G W D R Q R A Q F M E R P G L V P I D F G W D R Q R A Q F M E R P CGCCCAGCTTTGCAGCCAAGCAACCGGTGGCATCATAAACCCATTAGAAACGACGTGCCA A Q L C S Q A T G G I I N P L E T T C H A Q L C S Q A T G G I I N P L E T T C H CCCCTTTGCGTAA P F A P F A --- // >fig|6666666.67449.peg.606 fig|196164.1.peg.240 Mobile element protein gi|372109441|gb|CP003213.1|_572066_572902,gi|372109441|gb|CP003213.1|_572905_573414 MTTVSPRKGHDPNRVNEISAKLMENPEIAELIGELSTSTDDASDLVKGLLQASINAGLQAEMDAHLGYAHSDRTAKAQLGTPDGGNHRNGSYTKTVNSGYGTFDVTMPRDRAGTFTPRMLPKGTRRLTELDDMIISLYAGGMTVRDIQHHLATTLGVDMSPDTISTITDAVLEEVMIWQNRQLDEFYPVIFLDALRVKIRDGHRVVNKSCYMAVGVDMDGIKHILGLWIADNEGASFWASVCADLANRGVQDVFIVCCDGLKGLPEAVEATWPNSMVQTxIVHLVRAANRWVSYQDRKPVSSALREVYTAPTEDTARAALDAFEASELGRKYPQSVKVWRDAWDRFAPFLQFPPAARRVLYTTNSIESLNAELRKATRNRGQFPNDTAALKTLWLMICNIEDKRAAQRAKKAKRAIECNGYIEGAKATGWKQAINQLAVAYPDRFADYL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACTACCGTGTCACCGAGGAAAGGTCATGACCCGAACAGGGTCAACGAGATCAGCGCT M T T V S P R K G H D P N R V N E I S A M T T V S P R K G H D P N R V N E I S A AAGCTGATGGAAAATCCGGAAATCGCCGAACTGATCGGCGAGTTGTCGACTTCCACCGAT K L M E N P E I A E L I G E L S T S T D K L M E N P E I A E L I G E L S T S T D GATGCCAGCGACCTGGTCAAAGGTCTTTTGCAGGCATCGATCAACGCTGGTCTGCAGGCT D A S D L V K G L L Q A S I N A G L Q A D A S D L V K G L L Q A S I N A G L Q A GAAATGGACGCGCATCTAGGATACGCGCACTCTGATCGTACGGCGAAAGCCCAGCTGGGC E M D A H L G Y A H S D R T A K A Q L G E M D A H L G Y A H S D R T A K A Q L G ACCCCGGATGGTGGCAATCACCGCAACGGGTCGTACACCAAAACCGTCAACTCTGGCTAC T P D G G N H R N G S Y T K T V N S G Y T P D G G N H R N G S Y T K T V N S G Y GGCACCTTTGATGTGACTATGCCCCGGGATCGAGCTGGCACGTTTACGCCGCGGATGCTG G T F D V T M P R D R A G T F T P R M L G T F D V T M P R D R A G T F T P R M L CCTAAAGGCACCCGCCGTCTGACGGAGCTTGATGACATGATCATCTCCCTGTACGCCGGT P K G T R R L T E L D D M I I S L Y A G P K G T R R L T E L D D M I I S L Y A G GGGATGACCGTGCGCGATATTCAGCACCACCTCGCCACCACCCTCGGGGTGGATATGAGC G M T V R D I Q H H L A T T L G V D M S G M T V R D I Q H H L A T T L G V D M S CCAGATACGATCAGCACCATTACCGACGCGGTGTTAGAAGAGGTCATGATCTGGCAAAAC P D T I S T I T D A V L E E V M I W Q N P D T I S T I T D A V L E E V M I W Q N CGCCAGCTCGACGAGTTCTACCCAGTGATCTTCCTCGACGCGCTGCGAGTGAAGATCCGC R Q L D E F Y P V I F L D A L R V K I R R Q L D E F Y P V I F L D A L R V K I R GATGGCCACCGCGTGGTCAACAAGTCTTGCTACATGGCGGTAGGCGTCGACATGGACGGC D G H R V V N K S C Y M A V G V D M D G D G H R V V N K S C Y M A V G V D M D G ATCAAGCACATCCTGGGATTGTGGATCGCAGACAATGAAGGCGCCAGTTTTTGGGCATCC I K H I L G L W I A D N E G A S F W A S I K H I L G L W I A D N E G A S F W A S GTGTGCGCTGACCTTGCCAACCGTGGGGTCCAAGACGTGTTCATCGTCTGCTGCGACGGG V C A D L A N R G V Q D V F I V C C D G V C A D L A N R G V Q D V F I V C C D G CTCAAAGGCCTGCCGGAAGCCGTGGAGGCAACTTGGCCGAATTCCATGGTGCAGACC*TG L K G L P E A V E A T W P N S M V Q T L K G L P E A V E A T W P N S M V Q T *X* *ATCGTGCACCTGGTCCGGGCGGCCAACAGGTGGGTGTCCTACCAAGACCGCAAACCCGT I V H L V R A A N R W V S Y Q D R K P V * I V H L V R A A N R W V S Y Q D R K P V ATCAAGTGCGCTACGGGAGGTCTACACCGCACCGACCGAGGACACCGCCCGCGCCGCCCT S S A L R E V Y T A P T E D T A R A A L S S A L R E V Y T A P T E D T A R A A L GGACGCATTCGAGGCCAGTGAACTGGGCCGTAAATACCCGCAATCGGTCAAAGTCTGGCG D A F E A S E L G R K Y P Q S V K V W R D A F E A S E L G R K Y P Q S V K V W R CGACGCCTGGGACCGGTTTGCGCCATTTTTGCAGTTCCCGCCTGCGGCACGGCGGGTACT D A W D R F A P F L Q F P P A A R R V L D A W D R F A P F L Q F P P A A R R V L CTACACCACGAATTCGATCGAATCGCTGAATGCTGAGCTGCGGAAAGCCACCCGCAACCG Y T T N S I E S L N A E L R K A T R N R Y T T N S I E S L N A E L R K A T R N R CGGCCAGTTCCCGAACGATACCGCGGCGCTGAAAACGCTGTGGCTGATGATCTGCAACAT G Q F P N D T A A L K T L W L M I C N I G Q F P N D T A A L K T L W L M I C N I CGAGGACAAGCGCGCTGCCCAGCGAGCGAAGAAAGCGAAGCGCGCCATCGAATGCAACGG E D K R A A Q R A K K A K R A I E C N G E D K R A A Q R A K K A K R A I E C N G CTATATTGAAGGAGCGAAAGCCACCGGGTGGAAACAAGCCATCAACCAACTAGCCGTGGC Y I E G A K A T G W K Q A I N Q L A V A Y I E G A K A T G W K Q A I N Q L A V A TTACCCCGACCGATTCGCGGACTACTTGTAA Y P D R F A D Y L Y P D R F A D Y L --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.240): ATGACTACCGTGTCACCGAGGAAAGGTCATGACCCGAACAGGGTCAACGAGATCAGCGCT M T T V S P R K G H D P N R V N E I S A M T T V A K Q D P A D S A R I K A I E E AAGCTGATGGAAAATCCGGAAATCGCCGAACTGATCGGCGAGTTGTCGACTTCCACCGAT K L M E N P E I A E L I G E L S T S T D K L L A N P E M A K L I D E L G T S T T GATGCCAGCGACCTGGTCAAAGGTCTTTTGCAGGCATCGATCAACGCTGGTCTGCAGGCT D A S D L V K G L L Q A S I N A G L Q A D A N D L V R G L L Q A S I N R G L N A GAAATGGACGCGCATCTAGGATACGCGCACTCTGATCGT*AC*GGCGAAAGCCCAGCTGG E M D A H L G Y A H S D R G E S P A G E M D A H L G Y G H S D R *D** G K T A A G GCACCCCGGATGGTGGCAATCACCGCAACGGGTCGTACACCAAAACCGTCAACTCTGGCT H G N H R N G S Y T K T V N S G Q ---------- G N H R N G Y Y P K R V D S N ACGGCACCTTTGATGTGACTATGCCCCGGGATCGAGCTGGCACGTTTACGCCGCGGATGC Y G T F D V T M P R D R A G T F T P R M Y G P I D V A V P R D R N G S F L P T M TGCCTAAAGGCACCCGCCGTCTGACGGAGCTTGATGACATGATCATCTCCCTGTACGCCG L P K G T R R L T E L D D M I I S L Y A V P K G S R R L T D V D D M I I S L Y A GTGGGATGACCGTGCGCGATATTCAGCACCACCTCGCCACCACCCTCGGGGTGGATATGA G G M T V R D I Q H H L A T T L G V D M G G M T V R D I Q H H M I T S M G V D I GCCCAGATACGATCAGCACCATTACCGACGCGGTGTTAGAAGAGGTCATGATCTGGCAAA S P D T I S T I T D A V L E E V M I W Q S H E T I S A I T D A V L D E V M I W Q ACCGCCAGCTCGACGAGTTCTACCCAGTGATCTTCCTCGACGCGCTGCGAGTGAAGATCC N R Q L D E F Y P V I F L D A L R V K I N R Q L D D F Y P V I F L D A L R I K V GCGATGGCCACCGCGTGGTCAACAAGTCTTGCTACATGGCGGTAGGCGTCGACATGGACG R D G H R V V N K S C Y M A V G V D M D R D G G R V V N K S V Y L A I G V D M D GCATCAAGCACATCCTGGGATTGTGGATCGCAGACAATGAAGGCGCCAGTTTTTGGGCAT G I K H I L G L W I A D N E G A S F W A G I K H I L G I W L A K E E G A S F W A CCGTGTGCGCTGACCTTGCCAACCGTGGGGTCCAAGACGTGTTCATCGTCTGCTGCGACG S V C A D L A N R G V Q D V F I V C C D N V C A N L A T R G V Q D V F I V C C D GGCTCAAAGGCCTGCCGGAAGCCGTGGAGGCAACTTGGCCGAATTCCATGGTGCAGACC* G L K G L P E A V E A T W P N S M V Q T G L K G L P Q A V E A T W P D S M V Q T * TG*ATCGTGCACCTGGTCCGGGCGGCCAACAGGTGGGTGTCCTACCAAGACCGCAAACCC I V H L V R A A N R W V S Y Q D R K P C** V V H L I R A A N R W V A Y G D R K A GTATCAAGTGCGCTACGGGAGGTCTACACCGCACCGACCGAGGACACCGCCCGCGCCGCC V S S A L R E V Y T A P T E D T A R A A V S A Q L R K I Y T A P T E D T A I A A CTGGACGCATTCGAGGCCAGTGAACTGGGCCGTAAATACCCGCAATCGGTCAAAGTCTGG L D A F E A S E L G R K Y P Q S V K V W L E E F E A S E L G V K Y P Q S A K V W CGCGACGCCTGGGACCGGTTTGCGCCATTTTTGCAGTTCCCGCCTGCGGCACGGCGGGTA R D A W D R F A P F L Q F P P A A R R V R D A W D R F I P F L Q F P P M A R K V CTCTACACCACGAATTCGATCGAATCGCTGAATGCTGAGCTGCGGAAAGCCACCCGCAAC L Y T T N S I E S L N A E L R K A T R N I Y T T N S I E S M N N E L R K A T R N CGCGGCCAGTTCCCGAACGATACCGCGGCGCTGAAAACGCTGTGGCTGATGATCTGCAAC R G Q F P N D T A A L K T L W L M I C N R V Q F T N D E S A I K T L W L M I C N ATCGAGGACAAGCGCGCTGCCCAGCGAGCGAAGAAAGCGAAGCGCGCCATCGAATGCAAC I E D K R A A Q R A K K A K R A I E C N I E D K R A A K R A K Q G K R V A A S S GGCTAT-ATTGAAGGAGCGAAAGCCACCGGGTGGAAACAAGCCATCAACCAACTAGCCGT G Y I E G A K A T G W K Q A I N Q L A V G R L I E G R K V A N W K Q A I N Q M A V GGCTTACCCCGACCGATTCGCGGACTACTTGTAA A Y P D R F A D Y L A F P D R F E A Y L --- // >fig|6666666.67449.peg.233 fig|257309.1.peg.246 Putative nitroreductase gi|372109441|gb|CP003213.1|_211106_210597,gi|372109441|gb|CP003213.1|_210593_210342 MKASMNETIRTQLNHRTIREFTTEQVSEEIMEQLFAVAGRTATSLGMQSTSIIRVTDPQLRARLAEIGAQEYVGRAPIYLLFIVDCHRNAGILQELGADPAGVATARNFVQGFTDTCLTAQNVCIAAESMGLGVNFLGNVHNDAAAVIELLQLPELTFPVVGMTLGWPNQxPQLKPRMATPLRTMENGYHAPDSWLEALSDYDQEMTTYYDLRDANRRVDSFTRQVLAKNPAAGADSDKRNYTFAIARDQGFNL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAAGGCAAGTATGAATGAGACGATTCGCACCCAGCTTAACCACCGCACTATCCGTGAG M K A S M N E T I R T Q L N H R T I R E M K A S M N E T I R T Q L N H R T I R E TTCACCACCGAGCAAGTATCGGAGGAGATCATGGAGCAGCTGTTTGCGGTGGCGGGGCGG F T T E Q V S E E I M E Q L F A V A G R F T T E Q V S E E I M E Q L F A V A G R ACTGCCACCTCGTTGGGAATGCAAAGCACCAGCATTATCCGTGTAACTGACCCCCAGTTA T A T S L G M Q S T S I I R V T D P Q L T A T S L G M Q S T S I I R V T D P Q L CGGGCACGCTTAGCCGAAATCGGCGCCCAGGAATATGTTGGCCGTGCCCCCATCTACCTG R A R L A E I G A Q E Y V G R A P I Y L R A R L A E I G A Q E Y V G R A P I Y L CTGTTTATTGTCGATTGCCACCGCAACGCAGGTATCCTCCAAGAGCTAGGCGCGGACCCT L F I V D C H R N A G I L Q E L G A D P L F I V D C H R N A G I L Q E L G A D P GCCGGTGTTGCGACAGCCCGCAACTTTGTCCAAGGGTTCACCGATACCTGCCTCACGGCA A G V A T A R N F V Q G F T D T C L T A A G V A T A R N F V Q G F T D T C L T A CAAAACGTGTGCATCGCTGCGGAATCGATGGGCTTAGGTGTGAACTTCCTCGGCAACGTC Q N V C I A A E S M G L G V N F L G N V Q N V C I A A E S M G L G V N F L G N V CACAACGATGCTGCGGCTGTGATCGAACTGCTGCAACTACCTGAGCTCACTTTCCCAGTT H N D A A A V I E L L Q L P E L T F P V H N D A A A V I E L L Q L P E L T F P V GTGGGCATGACACTGGGCTGGCCTAATCAATAGCCGCAGCTTAAACCACGTATGGCCACC V G M T L G W P N Q * P Q L K P R M A T V G M T L G W P N Q X P Q L K P R M A T CCATTGCGCACAATGGAAAATGGTTACCATGCGCCCGACTCGTGGCTAGAAGCGCTTAGT P L R T M E N G Y H A P D S W L E A L S P L R T M E N G Y H A P D S W L E A L S GACTACGACCAAGAGATGACCACCTACTACGATCTTCGGGATGCCAACCGGCGCGTAGAT D Y D Q E M T T Y Y D L R D A N R R V D D Y D Q E M T T Y Y D L R D A N R R V D AGTTTCACCCGTCAGGTGCTCGCGAAAAATCCTGCTGCCGGAGCCGACTCCGATAAACGC S F T R Q V L A K N P A A G A D S D K R S F T R Q V L A K N P A A G A D S D K R AATTACACCTTCGCGATCGCCCGCGACCAAGGGTTTAACCTCTAG N Y T F A I A R D Q G F N L N Y T F A I A R D Q G F N L --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.246): ATGAAGGCAAGTATGAATGAGACGATTCGCACCCAGCTTAACCACCGCACTATCCGTGAG M K A S M N E T I R T Q L N H R T I R E M K A S M N E T I R T Q L N H R T I R E TTCACCACCGAGCAAGTATCGGAGGAGATCATGGAGCAGCTGTTTGCGGTGGCGGGGCGG F T T E Q V S E E I M E Q L F A V A G R F S T E Q V S E E I M E Q L F A V A G R ACTGCCACCTCGTTGGGAATGCAAAGCACCAGCATTATCCGTGTAACTGACCCCCAGTTA T A T S L G M Q S T S I I R V T D P Q L T A T S L G M Q S T S I I R V T D P Q L CGGGCACGCTTAGCCGAAATCGGCGCCCAGGAATATGTTGGCCGTGCCCCCATCTACCTG R A R L A E I G A Q E Y V G R A P I Y L R V R L A E I G A Q E Y V G R A P I Y L CTGTTTATTGTCGATTGCCACCGCAACGCAGGTATCCTCCAAGAGCTAGGCGCGGACCCT L F I V D C H R N A G I L Q E L G A D P L F I V D C H R N A G I L Q E L G A D P GCCGGTGTTGCGACAGCCCGCAACTTTGTCCAAGGGTTCACCGATACCTGCCTCACGGCA A G V A T A R N F V Q G F T D T C L T A A G A A T A R N F V Q G F T D A C L T A CAAAACGTGTGCATCGCTGCGGAATCGATGGGCTTAGGTGTGAACTTCCTCGGCAACGTC Q N V C I A A E S M G L G V N F L G N V Q N V C I A A E S M G L G V N F L G N V CACAACGATGCTGCGGCTGTGATCGAACTGCTGCAACTACCTGAGCTCACTTTCCCAGTT H N D A A A V I E L L Q L P E L T F P V H N D A A A V I E L L Q L P E L T F P V GTGGGCATGACACTGGGCTGGCCTAATCAATAGCCGCAGCTTAAACCACGTATGGCCACC V G M T L G W P N Q * P Q L K P R M A T V G M T L G W P N Q E P Q L K P R M A T CCATTGCGCACAATGGAAAATGGTTACCATGCGCCCGACTCGTGGCTAGAAGCGCTTAGT P L R T M E N G Y H A P D S W L E A L S P L R T M E N G Y H A P D S W L E A L S GACTACGACCAAGAGATGACCACCTACTACGATCTTCGGGATGCCAACCGGCGCGTAGAT D Y D Q E M T T Y Y D L R D A N R R V D D Y D Q E M T T Y Y D L R D A N R R V D AGTTTCACCCGTCAGGTGCTCGCGAAAAATCCTGCTGCCGGAGCCGACTCCGATAAACGC S F T R Q V L A K N P A A G A D S D K R S F T R Q V L A K N P A A G A D S D K R AATTACACCTTCGCGATCGCCCGCGACCAAGGGTTTAACCTCTAG N Y T F A I A R D Q G F N L N H T F A I A R D Q G F N L --- // >fig|6666666.67449.peg.1774 fig|257309.1.peg.1686 Putative Mrr restriction system protein gi|372109441|gb|CP003213.1|_1800961_1801743,gi|372109441|gb|CP003213.1|_1801745_1801852 MSESIPVQGMPTHLELVPYLLRSLVQLGGTGKNSEIEDTVIDIFPNTEQLLNVHYPNKPTVSVFKKRLAWARSTAYLSGAASRPSRGVYMINDVGESLLKKNDHAIVQWCTEFERKYNKRKRLEKQQNESTDPALDEPSFEIIEDQQDENQSTHDWKSLLLNRLHQMSPTAFEKYVIFLLKQYGLELSHVAGPGDEGVDAIGTAPLSPVLSSRVAVQIKRYDPVNNIVSREAIALFQNDARVKGAERAIFVTLSSFTAPAKGLPAKHYPMWNSSMVTASASLFAIVVLLGFGWNPW We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGCGAATCAATCCCCGTACAAGGAATGCCTACGCATCTCGAGCTCGTTCCATATCTG M S E S I P V Q G M P T H L E L V P Y L M S E S I P V Q G M P T H L E L V P Y L TTACGATCACTTGTCCAACTCGGAGGCACCGGAAAAAATTCCGAAATTGAAGACACAGTA L R S L V Q L G G T G K N S E I E D T V L R S L V Q L G G T G K N S E I E D T V ATAGACATATTTCCAAATACCGAGCAATTACTAAACGTCCACTACCCCAACAAACCAACT I D I F P N T E Q L L N V H Y P N K P T I D I F P N T E Q L L N V H Y P N K P T GTATCGGTGTTCAAAAAACGCTTAGCATGGGCACGTAGCACCGCATACCTCAGCGGTGCC V S V F K K R L A W A R S T A Y L S G A V S V F K K R L A W A R S T A Y L S G A GCAAGTCGCCCTTCACGAGGCGTCTACATGATCAATGATGTGGGCGAATCCCTTCTCAAG A S R P S R G V Y M I N D V G E S L L K A S R P S R G V Y M I N D V G E S L L K AAAAATGACCACGCGATTGTCCAGTGGTGCACTGAGTTCGAACGCAAATACAACAAAAGG K N D H A I V Q W C T E F E R K Y N K R K N D H A I V Q W C T E F E R K Y N K R AAGCGGCTCGAAAAGCAGCAAAATGAATCAACGGACCCTGCACTAGATGAACCCAGTTTC K R L E K Q Q N E S T D P A L D E P S F K R L E K Q Q N E S T D P A L D E P S F GAAATAATTGAAGACCAACAAGACGAAAACCAATCAACCCATGATTGGAAAAGCCTGCTG E I I E D Q Q D E N Q S T H D W K S L L E I I E D Q Q D E N Q S T H D W K S L L CTCAACCGACTGCATCAAATGTCCCCTACTGCGTTCGAAAAGTACGTCATCTTCTTACTC L N R L H Q M S P T A F E K Y V I F L L L N R L H Q M S P T A F E K Y V I F L L AAGCAATATGGGCTTGAGCTTAGCCACGTTGCAGGTCCTGGCGACGAGGGAGTCGACGCC K Q Y G L E L S H V A G P G D E G V D A K Q Y G L E L S H V A G P G D E G V D A ATTGGCACCGCTCCTCTGAGCCCTGTCTTGTCTTCACGGGTCGCCGTACAGATCAAGCGT I G T A P L S P V L S S R V A V Q I K R I G T A P L S P V L S S R V A V Q I K R TACGATCCGGTTAACAACATAGTTAGCCGCGAGGCAATTGCACTTTTCCAAAACGATGCA Y D P V N N I V S R E A I A L F Q N D A Y D P V N N I V S R E A I A L F Q N D A CGAGTTAAAGGTGCCGAACGTGCAATTTTTGTCACCTTGAGTAGCTTCACAGCTCCTGCA R V K G A E R A I F V T L S S F T A P A R V K G A E R A I F V T L S S F T A P A AAAAGGACTGCCCGCCAAGCATTACCCAATGTGGAACTCATCAATGGTGACCGCCTCTGC K G L P A K H Y P M W N S S M V T A S A K - G L P A K H Y P M W N S S M V T A S A GAGCTTATTCGCGATTGTGGTGCTGCTGGGGTTCGGATGGAACCCGTGGTAA S L F A I V V L L G F G W N P W S L F A I V V L L G F G W N P W --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1686): ATGAGCGAATCAATCCCCGTACAAGGAATGCCTACGCATCTCGAGCTCGTTCCATATCTG M S E S I P V Q G M P T H L E L V P Y L M S E S I P V Q G M P T H L E L V P Y L TTACGATCACTTGTCCAACTCGGAGGCACCGGAAAAAATTCCGAAATTGAAGACACAGTA L R S L V Q L G G T G K N S E I E D T V L R S L V Q L G G T G K N S E I E D T V ATAGACATATTTCCAAATACCGAGCAATTACTAAACGTCCACTACCCCAACAAACCAACT I D I F P N T E Q L L N V H Y P N K P T I D I F P N T E Q L L N V H Y P N K P T GTATCGGTGTTCAAAAAACGCTTAGCATGGGCACGTAGCACCGCATACCTCAGCGGTGCC V S V F K K R L A W A R S T A Y L S G A V S V F K K R L A W A R S T A Y L S G A GCAAGTCGCCCTTCACGAGGCGTCTACATGATCAATGATGTGGGCGAATCCCTTCTCAAG A S R P S R G V Y M I N D V G E S L L K A S R P S R G V Y M I N D V G E S L L K AAAAATGACCACGCGATTGTCCAGTGGTGCACTGAGTTCGAACGCAAATACAACAAAAGG K N D H A I V Q W C T E F E R K Y N K R K N D H A I V Q W C T E F E R K Y N K R AAGCGGCTCGAAAAGCAGCAAAATGAATCAACGGACCCTGCACTAGATGAACCCAGTTTC K R L E K Q Q N E S T D P A L D E P S F K R L E K Q Q N E S T D P A L D E P S F GAAATAATTGAAGACCAACAAGACGAAAACCAATCAACCCATGATTGGAAAAGCCTGCTG E I I E D Q Q D E N Q S T H D W K S L L E I I E D Q Q D E N Q S T H D W K S L L CTCAACCGACTGCATCAAATGTCCCCTACTGCGTTCGAAAAGTACGTCATCTTCTTACTC L N R L H Q M S P T A F E K Y V I F L L L N R L H Q M S P T A F E K Y V I F L L AAGCAATATGGGCTTGAGCTTAGCCACGTTGCAGGTCCTGGCGACGAGGGAGTCGACGCC K Q Y G L E L S H V A G P G D E G V D A K Q Y G L E L S H V A G P G D E G V D A ATTGGCACCGCTCCTCTGAGCCCTGTCTTGTCTTCACGGGTCGCCGTACAGATCAAGCGT I G T A P L S P V L S S R V A V Q I K R I G T A P L S P V L S S R V A V Q I K R TACGATCCGGTTAACAACATAGTTAGCCGCGAGGCAATTGCACTTTTCCAAAACGATGCA Y D P V N N I V S R E A I A L F Q N D A Y D P V N N I V S R E A I A L F Q N D A CGAGTTAAAGGTGCCGAACGTGCAATTTTTGTCACCTTGAGTAGCTTCACAGCTCCTGCA R V K G A E R A I F V T L S S F T A P A R V K G A E R A I F V T L S S F T A P A AAAAGGACTGCCCGCCAAGCATTACCCAATGTGGAACTCATCAATGGTGACCGCCTCTGC K G L P A K H Y P M W N S S M V T A S A K - G L P A K H Y P M W N S S T V T A S A GAGCTTATTCGCGATTGTGGTGCTGCTGGGGTTCGGATGGAACCCGTGGTAA S L F A I V V L L G F G W N P W S L F A I V V L L G F G W N P W --- // >fig|6666666.67449.peg.252 fig|257309.1.peg.1878 Putative insertion element DNA-binding protein gi|372109441|gb|CP003213.1|_229722_229769,gi|372109441|gb|CP003213.1|_229773_229790,gi|372109441|gb|CP003213.1|_229794_229850,gi|372109441|gb|CP003213.1|_229850_230092 MNCLSRGWVIRQRLIGxELALIRxEGLSIDSSFMAGYVLWRNxxRQQYSFEVKKEIVDRFNAGQSMMELASEFGLSSDQLVKDWVRAWRAGGDEALRPKLKGRPKGSSPAKLLTEKKIGCAAK We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. TTGAATTGTTTGAGCAGGGGCTGGGTTATAAGGCAGCGGCTCATCGGTTAGGAGTTGGCC L N C L S R G W V I R Q R L I G * E L A M N C L S R G W V I R Q R L I G X E L A CTTATCCGGTAAGAAGGCTTGAGTATCGATTCAAGCTTCATGGCAGGCTATGTCTTGTGG L I R * E G L S I D S S F M A G Y V L W L I R X E G L S I D S S F M A G Y V L W AGAAAC*CA*ACCAGGCAGCAGTATTCCTTCGAGGTGAAGAAGGAAATCGTCGACCGGTT R N T R Q Q Y S F E V K K E I V D R F R N *X** X R Q Q Y S F E V K K E I V D R F CAACGCTGGCCAGTCCATGATGGAACTGGCCAGTGAATTTGGTTTGTCTTCGGATCAATT N A G Q S M M E L A S E F G L S S D Q L N A G Q S M M E L A S E F G L S S D Q L GGTCAAGGATTGGGTTCGTGCGTGGCGTGCCGGTGGTGATGAGGCATTGCGGCCGAAGTT V K D W V R A W R A G G D E A L R P K L V K D W V R A W R A G G D E A L R P K L GAAGGGACGACCGAAAGGTAGTTCACCTGCGAAACTGTTAACTGAAAAAAAGATTGGTTG K G R P K G S S P A K L L T E K K I G C K G R P K G S S P A K L L T E K K I G C CGCCGCGAAATAG A A K A A K --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1878): TTGAATTGTTTGAGCAGGGGCTGGGTTATAAGGCAGCGGCTCATCGGTTAGGAGTTGGCC L N C L S R G W V I R Q R L I G * E L A M T C L S R D W A T A Q R L V E W A L A CTTATCCGGTAAGAAGGCTTGAGTATCGATTCAAGCTTCATGGCAGGC*TA*TGTCTTGT L I R * E G L S I D S S F M A G C L V S T R C E C F N V D S N F M A G *L** C L V GGAGAAACCAACCAGGCAGCAGTATTCCTTCGAGGTGAAGAAGGAAATCGTCGACCGGTT E K P T R Q Q Y S F E V K K E I V D R F E N P T K Q H Y S F E V R K Q V V D R F CAACGCTGGCCAGTCCATGATGGAACTGGCCAGTGAATTTGGTTTGTCTTCGGATCAATT N A G Q S M M E L A S E F G L S S D Q L N A G Q S K M D L A R E F G L S S D Q L GGTCAAGGATTGGGTTCGTGCGTGGCGTGCCGGTGGTGATGAGGCATTGCGGCCGAAGTT V K D W V R A W R A G G D E A L R P K L V S S W V R A W R A G G D E A L R P K P GAAGGGACGACCGAAAGGTAGTTCACCTGCGAAACTGTTAACTGAAAAAAAGATTGGTTG K G R P K G S S P A K L L T E K D W L K G R P K G S A S S K P L T E E -- D R L CGCCGCGAAATAG---------------------- R R E I R R E V -EKLRAENAYLKKLRDLRNQRRS // >fig|6666666.67449.peg.717 fig|257309.1.peg.698 Putative membrane protein gi|372109441|gb|CP003213.1|_694473_694024,gi|372109441|gb|CP003213.1|_694024_693905 MILFASLFNTPDWFGIILSVGFVSGFGVAAAVGGALDSAGMNEAAVAVLSAIVGGVIFARWGSKKRHTNELPALDKLPEDMRTGIISLPGQRPSVGCATTSPYSFESIALHVAALAVTLFLANILTNWVNDAFPALSFPLFAMDFLVAVxxASIVPAVVWLFGRVALIGGLALLIPPMIMLKKSKTRAS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGATTCTTTTCGCCTCGCTGTTCAATACTCCGGACTGGTTCGGCATCATACTGTCCGTC V I L F A S L F N T P D W F G I I L S V M I L F A S L F N T P D W F G I I L S V GGCTTCGTCAGCGGTTTCGGTGTGGCAGCAGCAGTTGGTGGCGCACTGGACTCGGCCGGC G F V S G F G V A A A V G G A L D S A G G F V S G F G V A A A V G G A L D S A G ATGAACGAGGCCGCGGTGGCCGTGCTTTCCGCAATTGTCGGTGGCGTTATCTTTGCCCGC M N E A A V A V L S A I V G G V I F A R M N E A A V A V L S A I V G G V I F A R TGGGGTTCAAAGAAGAGGCACACCAACGAGCTGCCCGCCTTGGATAAACTGCCGGAGGAC W G S K K R H T N E L P A L D K L P E D W G S K K R H T N E L P A L D K L P E D ATGCGAACCGGCATCATCTCTCTTCCCGGCCAGCGACCAAGCGTGGGATGCGCGACCACG M R T G I I S L P G Q R P S V G C A T T M R T G I I S L P G Q R P S V G C A T T AGCCCGTACTCATTTGAGTCGATCGCGCTGCACGTGGCGGCACTGGCGGTGACGCTCTTC S P Y S F E S I A L H V A A L A V T L F S P Y S F E S I A L H V A A L A V T L F CTGGCGAATATCCTGACTAACTGGGTCAATGACGCTTTCCCAGCTTTGAGCTTCCCGCTA L A N I L T N W V N D A F P A L S F P L L A N I L T N W V N D A F P A L S F P L TTCGCGATGGACTTCCTGGTTGCAGTG*GC*ATCGCGTCAATTGTGCCGGCAGTGGTGTG F A M D F L V A V I A S I V P A V V W F A M D F L V A V *X** X A S I V P A V V W GCTATTCGGTAGAGTCGCGCTTATCGGTGGCCTAGCTCTGCTGATTCCGCCGATGATTAT L F G R V A L I G G L A L L I P P M I M L F G R V A L I G G L A L L I P P M I M GCTGAAGAAATCGAAAACCAGGGCTTCGTAA L K K S K T R A S L K K S K T R A S --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.698): GTGATTCTTTTCGCCTCGCTGTTCAATACTCCGGACTGGTTCGGCATCATACTGTCCGTC V I L F A S L F N T P D W F G I I L S V M I L F A S L F N T P D W F G I I L S V GGCTTCGTCAGCGGTTTCGGTGTGGCAGCAGCAGTTGGTGGCGCACTGGACTCGGCCGGC G F V S G F G V A A A V G G A L D S A G G F V S G F G V A A A V G G A L D S A G ATGAACGAGGCCGCGGTGGCCGTGCTTTCCGCAATTGTCGGTGGCGTTATCTTTGCCCGC M N E A A V A V L S A I V G G V I F A R M N E A A V A V L S A I V G G V I F A R TGGGGTTCAAAGAAGAGGCACACCAACGAGCTGCCCGCCTTGGATAAACTGCCGGAGGAC W G S K K R H T N E L P A L D K L P E D W G S K K R H T N E L P A L D K L P E D ATGCGAACCGGCATCATCTCTCTTCCCGGCCAGCGACCAAGCGTGGGATGCGCGACCACG M R T G I I S L P G Q R P S V G C A T T M R T G I I S L P G Q R P S V G C A T T AGCCCGTACTCATTTGAGTCGATCGCGCTGCACGTGGCGGCACTGGCGGTGACGCTCTTC S P Y S F E S I A L H V A A L A V T L F S P Y S F E S I A L H V A A L A V T L F CTGGCGAATATCCTGACTAACTGGGTCAATGACGCTTTCCCAGCTTTGAGCTTCCCGCTA L A N I L T N W V N D A F P A L S F P L L A N I L T N W V N D A F P A L S F P L TTCGCGATGGACTTCCTGGTTGCA*GT*GGCATCGCGTCAATTGTGCCGGCAGTGGTGTG F A M D F L V A G I A S I V P A V V W F A M D F L V A *V** G I A S I V P A V V W GCTATTCGGTAGAGTCGCGCTTATCGGTGGCCTAGCTCTGCTGATTCCGCCGATGATTAT L F G R V A L I G G L A L L I P P M I M L F G R V A L I G G L A L L I P P M I M GCTGAAGAAATCGAAAACCAGGGCTTCGTAA L K K S K T R A S L K K S K T R A S --- // >fig|6666666.67449.peg.2056 fig|257309.1.peg.2275 gi|372109441|gb|CP003213.1|_2087816_2087775,gi|372109441|gb|CP003213.1|_2087771_2087565 MFNNELCKATCNRVxFTSDESALKTLWLMICNIEDKRLAKRAKEGRRVAASAGRLVEDGKVSGWKQAINPMAVAYPDRFDQYL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. TTGTTTAACAACGAGCTGTGTAAAGCTACCTGCAACCGCGTCTAATTTACTAGCGATGAG L F N N E L C K A T C N R V * F T S D E M F N N E L C K A T C N R V X F T S D E TCGGCGTTGAAGACGTTGTGGTTGATGATCTGCAATATCGAAGATAAACGCTTAGCTAAA S A L K T L W L M I C N I E D K R L A K S A L K T L W L M I C N I E D K R L A K CGCGCCAAGGAAGGCCGGCGAGTTGCTGCCTCAGCCGGCCGCCTTGTCGAAGACGGGAAA R A K E G R R V A A S A G R L V E D G K R A K E G R R V A A S A G R L V E D G K GTATCTGGGTGGAAACAAGCCATCAACCCAATGGCCGTCGCCTACCCGGACCGCTTCGAC V S G W K Q A I N P M A V A Y P D R F D V S G W K Q A I N P M A V A Y P D R F D CAATACCTCTAG Q Y L Q Y L --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2275): -----------------------TTGTTTAACAACGAGCTGTGTAAAGCTACCTGCAACC L F N N E L C K A T C N MAHSILQFPPAARKVIYTTNSIE S F N N E L R K D I C N GCGTCTAATTTACTAGCGATGAGTCGGCGTTGAAGACGTTGTGGTTGATGATCTGCAATA R V * F T S D E S A L K T L W L M I C N R V Q F T N D E S A L N T L W L L I C N TCGAAGATAAACGCTTAGCTAAACGCGCCAAGGAAGGCCGGCGAGTTGCTGCCTCAGCCG I E D K R L A K R A K E G R R V A A S A I E D K R L A K R A K E G R R V A A S A GCCGCCTTGTCGAAGACGGGAAAGTATCTGGGTGGAAACAAGCCATCAACCCAATGGCCG G R L V E D G K V S G W K Q A I N P M A G R L V E G G K V S G W K Q A I N Q M A TCGCCTACCCGGACCGCTTCGACCAATACCTCTAG V A Y P D R F D Q Y L V A Y P D R F D E Y L --- // >fig|6666666.67449.peg.44 fig|257309.1.peg.1877 Putative transposase gi|372109441|gb|CP003213.1|_42877_42671,gi|372109441|gb|CP003213.1|_42671_42057 MADLLAAADTPRATFFYHQTRLDKPDKHAAVKHAILESFEANKHRYGYRRVVLDLRNKGWVVNHKLVYxxMHQMGLRAKIRQRRPYNSYTGTINRIADNKLARKFTPDKPNTVFVSDVTELRVAGRKVYLSPVMDLFDRCIVAHSVATSPSIAFTADSLTKAIAACAPKSGWMMHTDQGFQYQHSTWRNLIHDNGGVQSMSRKANCYDNAVIENFFGHLKTEMYHGEVFGTVEEFTQAVEDYIQWYNTERIQQRLKGLTPMHYRNQTLEPLTT We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. TTGGCAGATCTCCTCGCGGCGGCAGATACGCCGCGGGCGACATTCTTCTACCATCAAACC L A D L L A A A D T P R A T F F Y H Q T M A D L L A A A D T P R A T F F Y H Q T CGACTCGATAAGCCGGATAAACATGCTGCGGTAAAGCACGCAATCCTAGAAAGTTTCGAA R L D K P D K H A A V K H A I L E S F E R L D K P D K H A A V K H A I L E S F E GCCAACAAGCATCGCTACGGCTACCGGCGAGTGGTGCTGGACTTGCGCAACAAGGGCTGG A N K H R Y G Y R R V V L D L R N K G W A N K H R Y G Y R R V V L D L R N K G W GTGGTCAACCACAAACTCGTCTAC*AA*CTCATGCACCAGATGGGTCTTCGGGCTAAAAT V V N H K L V Y L M H Q M G L R A K I V V N H K L V Y *X** X M H Q M G L R A K I CCGTCAGCGCAGGCCCTATAATTCCTACACAGGAACTATCAATCGCATTGCTGACAATAA R Q R R P Y N S Y T G T I N R I A D N K R Q R R P Y N S Y T G T I N R I A D N K GCTTGCCCGTAAATTCACTCCAGACAAGCCCAACACCGTCTTTGTCAGCGACGTTACCGA L A R K F T P D K P N T V F V S D V T E L A R K F T P D K P N T V F V S D V T E ATTGAGGGTTGCAGGCCGCAAAGTGTATTTATCACCGGTAATGGATCTCTTCGACCGCTG L R V A G R K V Y L S P V M D L F D R C L R V A G R K V Y L S P V M D L F D R C TATTGTCGCTCACTCCGTGGCTACATCACCGTCGATAGCATTTACCGCCGATTCCCTCAC I V A H S V A T S P S I A F T A D S L T I V A H S V A T S P S I A F T A D S L T AAAGGCGATTGCAGCCTGTGCGCCGAAGTCTGGATGGATGATGCACACCGATCAAGGCTT K A I A A C A P K S G W M M H T D Q G F K A I A A C A P K S G W M M H T D Q G F CCAGTACCAGCATTCAACTTGGCGTAATCTAATCCACGACAACGGCGGTGTTCAGTCAAT Q Y Q H S T W R N L I H D N G G V Q S M Q Y Q H S T W R N L I H D N G G V Q S M GTCGCGTAAAGCTAATTGTTACGACAACGCAGTAATAGAGAACTTCTTCGGACACTTAAA S R K A N C Y D N A V I E N F F G H L K S R K A N C Y D N A V I E N F F G H L K AACCGAGATGTACCACGGAGAAGTTTTTGGAACCGTCGAGGAATTCACCCAAGCTGTCGA T E M Y H G E V F G T V E E F T Q A V E T E M Y H G E V F G T V E E F T Q A V E AGACTACATCCAGTGGTATAACACCGAACGCATCCAACAACGACTCAAGGGCCTGACCCC D Y I Q W Y N T E R I Q Q R L K G L T P D Y I Q W Y N T E R I Q Q R L K G L T P GATGCACTATCGGAATCAGACCCTTGAACCCCTAACCACCTAG M H Y R N Q T L E P L T T M H Y R N Q T L E P L T T --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1877): TTGGCAGATCTCCTCGCGGCGGCAGATACGCCGCGGGCGACATTCTTCTACCATCAAACC L A A A D T P R A T F F Y H Q T ------------ M D A A G L A R S T F F Y H Q Q CGACTCGATAAGCCGGATAAACATGCTGCGGTAAAGCACGCAATCCTAGAAAGTTTCGAA R L D K P D K H A A V K H A I L E S F E R L N V P D K H I D L K E A I V E V F T GCCAACAAGCATCGCTACGGCTACCGGCGAGTGGTGCTGGACTTGCGCAACAAGGGCTGG A N K H R Y G Y R R V V L D L R N K G W R T N R R Y G Y R R I H A H L R Q D G W GTGGTCAACCACAAACTCGTCTAC*AA*CTCATGCACCAGATGGGTCTTCGGGCTAAAAT V V N H K L V Y L M H Q M G L R A K I N V N H K L V Y *K** L M D E L G L K S K V CCGTCAGCGCAGGCCCTATAATTCCTACACAGGAACTATCAATCGCATTGCTGACAATAA R Q R R P Y N S Y T G T I N R I A D N K R A K K R Y N A Y Q G T V S H I A E N V GCTTGCCCGTAAATTCACTCCAGACAAGCCCAACACCGTCTTTGTCAGCGACGTTACCGA L A R K F T P D K P N T V F V S D V T E L D R C F T P D K P N T V W T S D V T E ATTGAGGGTTGCAGGCCGCAAAGTGTATTTATCACCGGTAATGGATCTCTTCGACCGCTG L R V A G R K V Y L S P V M D L F D R C F R I A G T K V Y L S P I M D L Y D R S TATTGTCGCTCACTCCGTGGCTACATCACCGTCGATAGCATTTACCGCCGATTCCCTCAC I V A H S V A T S P S I A F T A D S L T I V S Y S V S T S P N T A F T S R S L K AAAGGCGATTGCAGCCTGTGCGCCGAAGTCTGGATGGATGATGCACACCGATCAAGGCTT K A I A A C A P K S G W M M H T D Q G F D A I T S Q S P G S G L L V H T D Q G I CCAGTACCAGCATTCAACTTGGCGTAATCTAATCCACGACAACGGCGGTGTTCAGTCAAT Q Y Q H S T W R N L I H D N G G V Q S M Q Y Q H S S W R D L I T S I D G I Q S M GTCGCGTAAAGCTAATTGTTACGACAACGCAGTAATAGAGAACTTCTTCGGACACTTAAA S R K A N C Y D N A V I E N F F G H L K S R K G N C Y D N A V M E N F F G H L K AACCGAGATGTACCACGGAGAAGTTTTTGGAACCGTCGAGGAATTCACCCAAGCTGTCGA T E M Y H G E V F G T V E E F T Q A V E S E M H H G E S F D G L E H F R Q A L D AGACTACATCCAGTGGTATAACACCGAACGCATCCAACAACGACTCAAGGGCCTGACCCC D Y I Q W Y N T E R I Q Q R L K G L T P G Y I H W Y N H E R I Q K R L K G L A P GATGCACTATCGGAATCAGACCCTTGAACCCCTAACCACCTAG M H Y R N Q T L E P L T T M Q Y R N Q T L E P L T A --- // >fig|6666666.67449.peg.1400 fig|196164.1.peg.1820 Ribonucleotide reductase transcriptional regulator NrdR FIG000382 gi|372109441|gb|CP003213.1|_1418990_1418538,gi|372109441|gb|CP003213.1|_1418534_1418487 MYCPFCHNDQSRVIDSRVIDSGSAIRRRRECTQCKNRFTTVEKAQLLVVKRNGLTEPFSREKVIVGVRRACQGRDVSDDALKRLAQQVEERVRLHGSSQIHANEIGLAILEPLRELDEVAYLRFASVYKSFESADDFESEIRLMRRRDRSNxPQENKKWFLLSALQE We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGTACTGTCCTTTTTGTCATAATGATCAGTCTCGTGTGATCGACTCTCGTGTGATTGAT V Y C P F C H N D Q S R V I D S R V I D M Y C P F C H N D Q S R V I D S R V I D TCAGGTTCGGCGATTAGAAGACGTCGCGAATGTACACAGTGTAAGAACCGGTTTACTACA S G S A I R R R R E C T Q C K N R F T T S G S A I R R R R E C T Q C K N R F T T GTTGAAAAAGCACAACTCTTAGTGGTCAAACGCAATGGGCTTACCGAGCCTTTTAGTAGG V E K A Q L L V V K R N G L T E P F S R V E K A Q L L V V K R N G L T E P F S R GAAAAGGTTATCGTAGGTGTCCGTCGTGCATGCCAAGGCCGAGATGTAAGTGATGATGCA E K V I V G V R R A C Q G R D V S D D A E K V I V G V R R A C Q G R D V S D D A TTGAAACGGCTTGCGCAACAAGTAGAAGAGCGAGTTCGTTTGCATGGCAGCTCACAGATT L K R L A Q Q V E E R V R L H G S S Q I L K R L A Q Q V E E R V R L H G S S Q I CACGCTAACGAGATAGGTCTTGCCATTTTGGAGCCACTGCGGGAACTAGATGAAGTAGCT H A N E I G L A I L E P L R E L D E V A H A N E I G L A I L E P L R E L D E V A TATCTGCGGTTTGCATCAGTATATAAATCGTTTGAAAGCGCTGATGATTTCGAATCTGAG Y L R F A S V Y K S F E S A D D F E S E Y L R F A S V Y K S F E S A D D F E S E ATTCGGTTGATGCGACGGCGGGATAGGTCGAATTAGCCTCAAGAAAATAAGAAGTGGTTC I R L M R R R D R S N * P Q E N K K W F I R L M R R R D R S N X P Q E N K K W F CTACTCTCTGCTCTACAAGAGTAG L L S A L Q E L L S A L Q E --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.1820): ------------------GTGTACTGTCCTTTTTGTCATAATGATCAGTCTCGTGTGATC V Y C P F C H N D Q S R V I MSVPLHRGVGDAEGRITR M Y C P F C Q H G H S R V I GACTCTCGTGTGATTGATTCAGGTTCGGCGATTAGAAGACGTCGCGAATGTACACAGTGT D S R V I D S G S A I R R R R E C T Q C D S R V I E A G S A I R R R R E C S Q C AAGAACCGGTTTACTACAGTTGAAAAAGCACAACTCTTAGTGGTCAAACGCAATGGGCTT K N R F T T V E K A Q L L V V K R N G L Q G R F T T I E K A V L L V L K R N G V ACCGAGCCTTTTAGTAGGGAAAAGGTTATCGTAGGTGTCCGTCGTGCATGCCAAGGCCGA T E P F S R E K V I V G V R R A C Q G R T E P F S R E K V V T G V R R A C Q G R GATGTAAGTGATGATGCATTGAAACGGCTTGCGCAACAAGTAGAAGAGCGAGTTCGTTTG D V S D D A L K R L A Q Q V E E R V R L D V S D D S L K R L A Q Q V E E T V R S CATGGCAGCTCACAGATTCACGCTAACGAGATAGGTCTTGCCATTTTGGAGCCACTGCGG H G S S Q I H A N E I G L A I L E P L R S G S S Q V R A N D I G L A I L D P L R GAACTAGATGAAGTAGCTTATCTGCGGTTTGCATCAGTATATAAATCGTTTGAAAGCGCT E L D E V A Y L R F A S V Y K S F E S A E L D E V A Y L R F A S V Y K S F E S A GATGATTTCGAATCTGAGATTCGGTTGATGCGACGGCGGGATAGGTCGAATTAGCCTCAA D D F E S E I R L M R R R D R S K D D F E K E I R L M R R Q S R E ---------- K GAAAATAAGAAGTGGTTCCTACTCTCTGCTCTACAAGAGTAG K I R S G Q V Q Q G -------------------------- // >fig|6666666.67449.peg.2039 fig|196164.1.peg.915 putative transposase gi|372109441|gb|CP003213.1|_2074020_2074853,gi|372109441|gb|CP003213.1|_2074853_2075233 MSQEHSIDIFLGLDVGKSEHHACALDRDGNKVFDKPLPQLESDLASVFHQLQEHGTVLVVVDQPNTIGALPIAVARACGCEVGYLPGLAMRKAADLYPGRAKTDKRDAFIIADTARTMPHTLRAVDRNNEVLSALKMLSGFDDDIARDCTRTVNRLRSILTQIYPSLERVLAGSTLTRTPILDMLIHYKGPQGLKRAGYHRVLNWMIKHTRKDPTPLVDEIFAALKAQTVTVPGSDAAELVIPQLAANIKALKEQRDTIAEQVEGMLDDFPLCEVLDxxMPGVGIKTATQILLAIGDGSDFDSAGHLAAYAGIAPVTRRSGSSIRGEFPARSGNKRLKNALFYSAFAAIRSHEPSRQYYERKRAEGKRHNAAVICLARRRCNVIYAMLKNKEFFREIPPRPVAA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGTCGCAGGAACACTCCATCGACATATTCCTCGGCCTAGACGTCGGCAAATCTGAACAC M S Q E H S I D I F L G L D V G K S E H M S Q E H S I D I F L G L D V G K S E H CACGCCTGCGCTCTCGACCGCGACGGCAACAAAGTATTCGACAAACCATTGCCTCAACTC H A C A L D R D G N K V F D K P L P Q L H A C A L D R D G N K V F D K P L P Q L GAGTCCGATCTAGCAAGCGTTTTCCACCAGCTTCAAGAGCATGGCACGGTGCTCGTGGTC E S D L A S V F H Q L Q E H G T V L V V E S D L A S V F H Q L Q E H G T V L V V GTCGATCAACCCAATACCATCGGCGCACTACCGATTGCTGTAGCCCGTGCCTGCGGATGC V D Q P N T I G A L P I A V A R A C G C V D Q P N T I G A L P I A V A R A C G C GAAGTCGGATACCTACCAGGCCTAGCCATGCGCAAAGCTGCAGATCTCTATCCAGGCCGT E V G Y L P G L A M R K A A D L Y P G R E V G Y L P G L A M R K A A D L Y P G R GCGAAAACAGACAAACGCGACGCCTTCATCATCGCCGACACCGCCCGAACAATGCCTCAC A K T D K R D A F I I A D T A R T M P H A K T D K R D A F I I A D T A R T M P H ACGCTGCGTGCCGTCGACCGAAACAACGAAGTTCTATCAGCATTGAAAATGCTCTCCGGC T L R A V D R N N E V L S A L K M L S G T L R A V D R N N E V L S A L K M L S G TTCGATGACGACATCGCCCGCGATTGCACCCGCACCGTCAACCGACTACGCAGCATCCTT F D D D I A R D C T R T V N R L R S I L F D D D I A R D C T R T V N R L R S I L ACCCAGATCTACCCCAGCCTGGAACGAGTTCTTGCTGGCAGCACCCTAACTCGCACCCCA T Q I Y P S L E R V L A G S T L T R T P T Q I Y P S L E R V L A G S T L T R T P ATCCTGGACATGCTGATCCACTACAAAGGGCCACAAGGGCTGAAACGAGCCGGATACCAT I L D M L I H Y K G P Q G L K R A G Y H I L D M L I H Y K G P Q G L K R A G Y H CGGGTGCTGAACTGGATGATCAAGCACACACGAAAAGACCCTACCCCGCTGGTAGACGAG R V L N W M I K H T R K D P T P L V D E R V L N W M I K H T R K D P T P L V D E ATTTTTGCAGCACTAAAAGCGCAAACAGTCACCGTACCAGGAAGCGATGCCGCCGAGCTC I F A A L K A Q T V T V P G S D A A E L I F A A L K A Q T V T V P G S D A A E L GTCATTCCCCAACTAGCTGCAAACATCAAGGCGTTAAAAGAGCAGCGCGACACCATTGCT V I P Q L A A N I K A L K E Q R D T I A V I P Q L A A N I K A L K E Q R D T I A GAACAGGTTGAGGGGATGCTTGATGATTTCCCTCTTTGTGAGGTCTTGGAT*AG*AGCAT E Q V E G M L D D F P L C E V L D S M E Q V E G M L D D F P L C E V L D *X** X M GCCCGGAGTCGGCATCAAGACCGCAACACAGATCCTCCTGGCGATCGGTGACGGCTCCGA P G V G I K T A T Q I L L A I G D G S D P G V G I K T A T Q I L L A I G D G S D CTTCGATAGCGCCGGCCACCTGGCCGCTTACGCGGGCATCGCACCAGTGACACGACGATC F D S A G H L A A Y A G I A P V T R R S F D S A G H L A A Y A G I A P V T R R S AGGATCATCAATCAGAGGCGAATTCCCAGCACGATCAGGCAATAAGCGACTGAAAAACGC G S S I R G E F P A R S G N K R L K N A G S S I R G E F P A R S G N K R L K N A TTTGTTCTACTCCGCATTTGCCGCGATCCGCAGCCACGAACCGTCACGACAGTACTACGA L F Y S A F A A I R S H E P S R Q Y Y E L F Y S A F A A I R S H E P S R Q Y Y E GCGTAAACGCGCCGAAGGTAAACGCCATAACGCGGCAGTTATCTGCCTGGCACGACGCCG R K R A E G K R H N A A V I C L A R R R R K R A E G K R H N A A V I C L A R R R ATGCAACGTCATCTACGCAATGCTGAAAAACAAAGAGTTCTTCCGAGAAATCCCACCACG C N V I Y A M L K N K E F F R E I P P R C N V I Y A M L K N K E F F R E I P P R CCCAGTCGCCGCATAA P V A A P V A A --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.915): --------------------------ATGTCG*CA*GGAACACTCCATCGACATATTCCT M S G T I D I F L MPASDVKTPATQFDRHCCYDTTRRPA M T *T** G T ---- I D V T I CGGCCTAGACGTCGGCAAATCTGAACACCACGCCTGCGCTCTCGACCGCGACGGCAACAA G L D V G K S E H H A C A L D R D G N K G L D V G K T A H H A C A M T P A G E I AGTATTCGACAAACCATTGCCTCAACTCGAGTCCGATCTAGCAAGCGTTTTCCACCAGCT V F D K P L P Q L E S D L A S V F H Q L I Y D K P L P Q D E N Q L R K V F T E L TCAAGAGCATGGCACGGTGCTCGTGGTCGTCGATCAACCCAATACCATCGGCGCACTACC Q E H G T V L V V V D Q P N T I G A L P Q T H G T V L V V V D Q P N T I G A L P GATTGCTGTAGCCCGTGCCTGCGGATGCGAAGTCGGATACCTACCAGGCCTAGCCATGCG I A V A R A C G C E V G Y L P G L A M R I A V A R D A G C L V G Y L P G L A M R CAAAGCTGCAGATCTCTATCCAGGCCGTGCGAAAACAGACAAACGCGACGCCTTCATCAT K A A D L Y P G R A K T D K R D A F I I K A A D L Y P G R S K T D R R D A F I I CGCCGACACCGCCCGAACAATGCCTCACACGCTGCGTGCCGTCGACCGAAACAACGAAGT A D T A R T M P H T L R A V D R N N E V A D T A R T M P H T L R A V D R D N E I TCTATCAGCATTGAAAATGCTCTCCGGCTTCGATGACGACATCGCCCGCGATTGCACCCG L S A L K M L S G F D D D I A R D C T R L S A L K M L S G F D D D I A K D C T R CACCGTCAACCGACTACGCAGCATCCTTACCCAGATCTACCCCAGCCTGGAACGAGTTCT T V N R L R S I L T Q I Y P S L E R V L T I N R L R S V L T Q I Y P S F E R A L TGCTGGCAGCACCCTAACTCGCACCCCAATCCTGGACATGCTGATCCACTACAAAGGGCC A G S T L T R T P I L D M L I H Y K G P A G D I I T R P L V L D M L I H Y G G P ACAAGGGCTGAAACGAGCCGGATACCATCGGGTGCTGAACTGGATGATCAAGCACACACG Q G L K R A G Y H R V L N W M I K H T R T K M K K A G Y H R V L A W M S K R A K AAAAGACCCTACCCCGCTGGTAGACGAGATTTTTGCAGCACTAAAAGCGCAAACAGTCAC K D P T P L V D E I F A A L K A Q T V T K D P T T L V D A I F D G L K A Q T V T CGTACCAGGAAGCGATGCCGCCGAGCTCGTCATTCCCCAACTAGCTGCAAACATCAAGGC V P G S D A A E L V I P Q L A A N I K A V P G T T A A E I V I P Q L A T N I K A GTTAAAAGAGCAGCGCGACACCATTGCTGAACAGGTTGAGGGGATGCTTGATGATTTCCC L K E Q R D T I A E Q V E G M L D D F P L L E Q R K T I A E Q V E E L L E E F P TCTTTGTGAGGTCTTGGATAGAGCATGCCCGGAGTCGGCATCAAGACCGCAACACAGATC L C E V L D S M P G V G I K T A T Q I L H Q V L M -- S M P G V G I K T A A N I CTCCTGGCGATCGGTGACGGCTCCGACTTCGATAGCGCCGGCCACCTGGCCGCTTACGCG L L A I G D G S D F D S A G H L A A Y A L L A V G D C S D F R S A G H L A A Y A GGCATCGCACCAGTGACACGACGATCAGGATCATCAATCAGAGGCGAATTCCCAGCACGA G I A P V T R R S G S S I R G E F P A R G I A P V T R R S G T S I R G E F P A R TCAGGCAATAAGCGACTGAAAAACGCTTTGTTCTACTCCGCATTTGCCGCGATCCGCAGC S G N K R L K N A L F Y S A F A A I R S S G N K R L K N A L F Y S A F A S I R F CACGAACCGTCACGACAGTACTACGAGCGTAAACGCGCCGAAGGTAAACGCCATAACGCG H E P S R Q Y Y E R K R A E G K R H N A H E P S K T Y Y E R K R A E G K R H N A GCAGTTATCTGCCTGGCACGACGCCGATGCAACGTCATCTACGCAATGCTGAAAAACAAA A V I C L A R R R C N V I Y A M L K N K A I M C L A R R R C N V I Y A M L T R A GAGTTCTTCCGAGAAATCCCACCACGCCCAGTCGCCGCATAA E F F R E I P P R P V A E F F R E V P A R A A A ------ // >fig|6666666.67449.peg.218 fig|257309.1.peg.2324 gi|372109441|gb|CP003213.1|_195234_195374,gi|372109441|gb|CP003213.1|_195378_195395 MAWLGLAGRLPPFTPEKTGLHTKSSQTAGLEAIWCEVPRKILRNTPVxWCFRF We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCTTGGTTGGGATTGGCTGGCAGGTTACCCCCGTTCACCCCCGAAAAGACGGGACTT M A W L G L A G R L P P F T P E K T G L M A W L G L A G R L P P F T P E K T G L CACACCAAATCCAGCCAAACGGCCGGTTTGGAAGCGATTTGGTGTGAAGTGCCAAGAAAA H T K S S Q T A G L E A I W C E V P R K H T K S S Q T A G L E A I W C E V P R K ATCCTTCGAAATACCCCCGTTTAGTGGTGCTTCCGGTTTTAG I L R N T P V * W C F R F I L R N T P V X W C F R F --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2324): -----------------ATGGCTTGGTTGGGATTGGCTGGCAGGTTACCCCCGTTCACCC M A W L G L A G R L P P F T MISSLGVRAWLALVGAG G C W W V L V G A P P P L T CCGAAAAGACGGGACTTCACACCAAATCCAGCCAAACGGCCGGTTTGGAAGCGATTTGGT P E K T G L H T K S S Q T A G L E A I W P E K T A L H T K S S Q T A G L E A I W GTGAAGTGCCAAGAAAAATCCTTCGAAATACCCCCGTTTAGTGGTGCTTCCGGTTTT*AG C E V P R K I L R N T P V * W C S G F C E V S R K I L R N T P V W W L - S G F *G* *-- *AR // >fig|6666666.67449.peg.1853 fig|196164.1.peg.2389 Holo-[acyl-carrier protein] synthase (EC 2.7.8.7) FIG000540 gi|372109441|gb|CP003213.1|_1874613_1874233,gi|372109441|gb|CP003213.1|_1874229_1874206 MIVIGTDIVCIPSFAQQLDQPGTQFDRVFSAQELRVAARYQGRRRAEHLAGRWAAKEAFVKAWSQSLYGKPPVLEHVDWAEIEVQPDAWGRVLVVPRGEVARACGIECAQVSISHDGNYAMAQCVLGxAVATAKR We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGATTGTTATTGGAACCGACATCGTGTGCATTCCCTCTTTTGCGCAGCAATTAGATCAG M I V I G T D I V C I P S F A Q Q L D Q M I V I G T D I V C I P S F A Q Q L D Q CCTGGTACGCAGTTTGACCGGGTGTTTTCGGCCCAAGAGTTACGTGTTGCGGCACGCTAT P G T Q F D R V F S A Q E L R V A A R Y P G T Q F D R V F S A Q E L R V A A R Y CAGGGGCGGCGGCGTGCCGAGCATTTGGCGGGGCGGTGGGCTGCTAAGGAGGCGTTTGTT Q G R R R A E H L A G R W A A K E A F V Q G R R R A E H L A G R W A A K E A F V AAGGCGTGGTCGCAGTCGCTGTATGGCAAGCCGCCGGTGTTGGAGCACGTCGATTGGGCT K A W S Q S L Y G K P P V L E H V D W A K A W S Q S L Y G K P P V L E H V D W A GAGATCGAGGTGCAGCCGGACGCGTGGGGGCGGGTGCTGGTGGTGCCGCGTGGGGAGGTA E I E V Q P D A W G R V L V V P R G E V E I E V Q P D A W G R V L V V P R G E V GCGCGTGCTTGCGGAATTGAGTGCGCGCAGGTGAGTATCAGCCATGACGGAAATTACGCC A R A C G I E C A Q V S I S H D G N Y A A R A C G I E C A Q V S I S H D G N Y A ATGGCGCAGTGCGTGCTGGGCTAAGCGGTGGCGACGGCGAAGAGGTAG M A Q C V L G * A V A T A K R M A Q C V L G X A V A T A K R --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2389): ATGATTGTTATTGGAACCGACATCGTGTGCATTCCCTCTTTTGCGCAGCAATTAGATCAG M I V I G T D I V C I P S F A Q Q L D Q M I S I G T D L V H I P A F A D Q L A Q CCTGGTACGCAGTTTGACCGGGTGTTTTCGGCCCAAGAGTTACGTGTTGCGGCACGCTAT P G T Q F D R V F S A Q E L R V A A R Y P G S S F M D V F G A G E R R L A S R R CAGGGGCGGCGGCGTGCCGAGCATTTGGCGGGGCGGTGGGCTGCTAAGGAGGCGTTTGTT Q G R R R A E H L A G R W A A K E A F V A G N R N A E H L A G R W A A K E A F I AAGGCGTGGTCGCAGTCGCTGTATGGCAAGCCGCCGGTGTTG--GAGCACGTCGATTGGG K A W S Q S L Y G K P P V L E H V D W K A W S Q A I Y G Q P P V I PE E D V Q W CTGAGATCGAGGTGCAGCCGGACGCGTGGGGGCGGGTGCTG--GTGGTGCCGCGT--GGG A E I E V Q P D A W G R V L V V P R G A L I E V R A D R W G R V A LD I A P S LD T GAGGTAGCGCGTGCTTGCGGAATTGAGTGCGCGCAGGTGAGTATCAGCCATGACGGAAAT E V A R A C G I E C A Q V S I S H D G N Q V R E S I G D Y T T S L S I S H D G D TACGCCATGGCGCAGTGCGTGCTGGGCTAAGCGGTGGCGACGGCGAAGAGGTAG Y A M A Q C V L G * A V A T A K R Y A T A V C V L S Y A V A T E N R --- // >fig|6666666.67449.peg.1512 fig|257309.1.peg.1475 Putative amino acid carrier protein gi|372109441|gb|CP003213.1|_1534607_1533708,gi|372109441|gb|CP003213.1|_1533704_1533687,gi|372109441|gb|CP003213.1|_1533685_1533119 MPVLFHSMESLQTFITDDINDNYWKIIPFLLIAAGFYFAWRTILVQIRMIPEMFRAVVEKNDTPESHTDAEGISAFKAFTISAASRVGTGNVAGVAVAITLGGPGAVFWMWMIALLGGATAFVESTLAQLWKTKTDDGTHRGGPAFYMTRGLNAKWLAVIFGVAITVTYGFVYNSIQSNSIAEAVGESLGTSDNQFKIIVGAVLALLTGVIIFGGVQRIANFTQIVVPLMALAYMAIGIIVLVLNIEKIPGMFGDIISHALGFHEIAGATVGAAFMNGMRRGLFSNEAGQGSAPNAAGTAxCSAPSKQGLVQTLGVYFDTILVCSITAFIILLSDPEYGADVKGATLTQQALSGEVGAWGTHFITVILFFLAFSSVIGNTFLAQSNIEFFTQSKITMTIFRLIVVACVFGGAIGPLPLVWALGDTFAATMVVINLIAIVPLGGVAVALLKNYNQQKAKGLDPVFHRDMLPNVRNVECWDGSDPVTRRDHKIVREV We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCCAGTACTATTTCACTCTATGGAAAGCCTGCAGACGTTCATCACAGATGACATTAAC V P V L F H S M E S L Q T F I T D D I N M P V L F H S M E S L Q T F I T D D I N GATAATTATTGGAAGATCATTCCATTTCTTCTAATAGCAGCCGGTTTTTATTTCGCGTGG D N Y W K I I P F L L I A A G F Y F A W D N Y W K I I P F L L I A A G F Y F A W CGCACGATCCTCGTCCAAATTCGGATGATTCCGGAGATGTTCCGAGCAGTCGTGGAAAAG R T I L V Q I R M I P E M F R A V V E K R T I L V Q I R M I P E M F R A V V E K AACGACACCCCAGAATCTCATACTGACGCAGAAGGTATCTCTGCATTCAAGGCGTTTACA N D T P E S H T D A E G I S A F K A F T N D T P E S H T D A E G I S A F K A F T ATTTCTGCTGCTTCACGCGTGGGAACCGGAAATGTTGCAGGTGTTGCAGTGGCAATCACC I S A A S R V G T G N V A G V A V A I T I S A A S R V G T G N V A G V A V A I T CTAGGCGGTCCTGGTGCCGTGTTCTGGATGTGGATGATTGCTCTGCTGGGTGGTGCAACT L G G P G A V F W M W M I A L L G G A T L G G P G A V F W M W M I A L L G G A T GCATTCGTGGAATCAACACTGGCACAGCTGTGGAAAACTAAAACTGATGACGGCACCCAT A F V E S T L A Q L W K T K T D D G T H A F V E S T L A Q L W K T K T D D G T H CGTGGCGGCCCTGCGTTTTATATGACGCGTGGTCTGAACGCGAAATGGTTGGCCGTCATT R G G P A F Y M T R G L N A K W L A V I R G G P A F Y M T R G L N A K W L A V I TTTGGTGTAGCGATTACTGTTACTTACGGCTTTGTGTATAACTCGATTCAGTCGAACTCT F G V A I T V T Y G F V Y N S I Q S N S F G V A I T V T Y G F V Y N S I Q S N S ATTGCTGAGGCTGTAGGAGAATCGCTGGGTACGAGCGATAATCAATTCAAGATTATCGTT I A E A V G E S L G T S D N Q F K I I V I A E A V G E S L G T S D N Q F K I I V GGCGCAGTATTGGCATTGCTGACTGGTGTCATTATTTTTGGCGGCGTGCAGCGCATTGCG G A V L A L L T G V I I F G G V Q R I A G A V L A L L T G V I I F G G V Q R I A AACTTCACCCAAATTGTGGTTCCTCTCATGGCGCTGGCTTACATGGCCATCGGTATTATT N F T Q I V V P L M A L A Y M A I G I I N F T Q I V V P L M A L A Y M A I G I I GTGCTGGTACTTAACATCGAAAAGATTCCTGGCATGTTCGGAGACATTATTTCGCATGCT V L V L N I E K I P G M F G D I I S H A V L V L N I E K I P G M F G D I I S H A TTGGGTTTCCATGAGATCGCAGGTGCCACTGTTGGAGCGGCTTTCATGAACGGAATGCGT L G F H E I A G A T V G A A F M N G M R L G F H E I A G A T V G A A F M N G M R CGTGGTTTGTTCTCTAATGAAGCAGGACAAGGCTCTGCTCCCAATGCAGCAGGTACTGCT R G L F S N E A G Q G S A P N A A G T A R G L F S N E A G Q G S A P N A A G T A TAATGTTCCGCACCCAGTAAAGCAAGGACTGGTGCAAACTTTGGGCGTTTACTTTGACAC * C S A P S K Q G L V Q T L G V Y F D T X C S A P S K - Q G L V Q T L G V Y F D T CATTCTCGTGTGCTCGATTACCGCGTTTATCATTTTGCTGAGCGATCCAGAATATGGTGC I L V C S I T A F I I L L S D P E Y G A I L V C S I T A F I I L L S D P E Y G A AGACGTTAAAGGTGCCACGCTTACCCAGCAGGCATTGAGCGGAGAAGTCGGTGCGTGGGG D V K G A T L T Q Q A L S G E V G A W G D V K G A T L T Q Q A L S G E V G A W G TACACACTTCATCACTGTTATTTTGTTCTTCTTGGCGTTCTCATCGGTTATCGGTAATAC T H F I T V I L F F L A F S S V I G N T T H F I T V I L F F L A F S S V I G N T ATTCTTGGCACAGTCCAATATTGAGTTCTTTACGCAATCGAAGATCACTATGACGATTTT F L A Q S N I E F F T Q S K I T M T I F F L A Q S N I E F F T Q S K I T M T I F CCGATTGATCGTTGTCGCTTGTGTATTTGGTGGCGCAATTGGTCCATTGCCGTTGGTCTG R L I V V A C V F G G A I G P L P L V W R L I V V A C V F G G A I G P L P L V W GGCTTTGGGCGATACATTCGCTGCAACCATGGTGGTTATTAACCTGATCGCTATCGTGCC A L G D T F A A T M V V I N L I A I V P A L G D T F A A T M V V I N L I A I V P TCTGGGGGGCGTTGCGGTTGCTCTGCTAAAGAACTACAACCAGCAAAAAGCTAAGGGACT L G G V A V A L L K N Y N Q Q K A K G L L G G V A V A L L K N Y N Q Q K A K G L TGATCCGGTATTCCACCGCGATATGCTTCCGAATGTTCGTAACGTCGAATGCTGGGACGG D P V F H R D M L P N V R N V E C W D G D P V F H R D M L P N V R N V E C W D G GTCTGATCCGGTCACGCGTCGCGATCACAAGATTGTGCGCGAAGTCTAA S D P V T R R D H K I V R E V S D P V T R R D H K I V R E V --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1475): GTGCCAGTACTATTTCACTCTATGGAAAGCCTGCAGACGTTCATCACAGATGACATTAAC V P V L F H S M E S L Q T F I T D D I N M P V L F H S M E S L Q T F I T D E I N GATAATTATTGGAAGATCATTCCATTTCTTCTAATAGCAGCCGGTTTTTATTTCGCGTGG D N Y W K I I P F L L I A A G F Y F A W D N Y W K I I P F L L I A A G L Y F A W CGCACGATCCTCGTCCAAATTCGGATGATTCCGGAGATGTTCCGAGCAGTCGTGGAAAAG R T I L V Q I R M I P E M F R A V V E K R T I L V Q I R M I P D M F R A V V E K AACGACACCCCAGAATCTCATACTGACGCAGAAGGTATCTCTGCATTCAAGGCGTTTACA N D T P E S H T D A E G I S A F K A F T N D T P E S H T D A E D I S A F K A F T ATTTCTGCTGCTTCACGCGTGGGAACCGGAAATGTTGCAGGTGTTGCAGTGGCAATCACC I S A A S R V G T G N V A G V A V A I T I S A A S R V G T G N V A G V A V A I T CTAGGCGGTCCTGGTGCCGTGTTCTGGATGTGGATGATTGCTCTGCTGGGTGGTGCAACT L G G P G A V F W M W M I A L L G G A T L G G P G A V F W M W M I A L L G G A T GCATTCGTGGAATCAACACTGGCACAGCTGTGGAAAACTAAAACTGATGACGGCACCCAT A F V E S T L A Q L W K T K T D D G T H A F V E S T L A Q L W K T K T G D G T Y CGTGGCGGCCCTGCGTTTTATATGACGCGTGGTCTGAACGCGAAATGGTTGGCCGTCATT R G G P A F Y M T R G L N A K W L A V I R G G P A F Y M T R G L N A K W L A V I TTTGGTGTAGCGATTACTGTTACTTACGGCTTTGTGTATAACTCGATTCAGTCGAACTCT F G V A I T V T Y G F V Y N S I Q S N S F G V A I T V T Y G F V Y N S I Q S N S ATTGCTGAGGCTGTAGGAGAATCGCTGGGTACGAGCGATAATCAATTCAAGATTATCGTT I A E A V G E S L G T S D N Q F K I I V I A E A V G Q S L G T S D N Q F K I I V GGCGCAGTATTGGCATTGCTGACTGGTGTCATTATTTTTGGCGGCGTGCAGCGCATTGCG G A V L A L L T G V I I F G G V Q R I A G A V L A L L T G V I I F G G V Q R I A AACTTCACCCAAATTGTGGTTCCTCTCATGGCGCTGGCTTACATGGCCATCGGTATTATT N F T Q I V V P L M A L A Y M A I G I I N F T Q I V V P L M A L A Y M A I G I I GTGCTGGTACTTAACATCGAAAAGATTCCTGGCATGTTCGGAGACATTATTTCGCATGCT V L V L N I E K I P G M F G D I I S H A V L V L N I E K I P G M F G D I I S H A TTGGGTTTCCATGAGATCGCAGGTGCCACTGTTGGAGCGGCTTTCATGAACGGAATGCGT L G F H E I A G A T V G A A F M N G M R L G F Q E I A G A T V G A A F M N G M R CGTGGTTTGTTCTCTAATGAAGCAGGACAAGGCTCTGCTCCCAATGCAGCAGGTACTGCT R G L F S N E A G Q G S A P N A A G T A R G L F S N E A G Q G S A P N A A G T A TAATGTTCCGCACCCAGTAAAGCAAGGACTGGTGCAAACTTTGGGCGTTTACTTTGACAC N V P H P V K Q G L V Q T L G V Y F D T - N V P H P V K Q G L V Q T L G V Y F D T CATTCTCGTGTGCTCGATTACCGCGTTTATCATTTTGCTGAGCGATCCAGAATATGGTGC I L V C S I T A F I I L L S D P E Y G A I L V C S I T A F I I L L S D P E Y G A AGACGTTAAAGGTGCCACGCTTACCCAGCAGGCATTGAGCGGAGAAGTCGGTGCGTGGGG D V K G A T L T Q Q A L S G E V G A W G D V K G A T L T Q Q A L S G E V G A W G TACACACTTCATCACTGTTATTTTGTTCTTCTTGGCGTTCTCATCGGTTATCGGTAATAC T H F I T V I L F F L A F S S V I G N T T H F I T V I L F F L A F S S V I G N T ATTCTTGGCACAGTCCAATATTGAGTTCTTTACGCAATCGAAGATCACTATGACGATTTT F L A Q S N I E F F T Q S K I T M T I F F L A Q S N I E F F T Q S K I T M T I F CCGATTGATCGTTGTCGCTTGTGTATTTGGTGGCGCAATTGGTCCATTGCCGTTGGTCTG R L I V V A C V F G G A I G P L P L V W R L I V V A C V F G G A I G P L P L V W GGCTTTGGGCGATACATTCGCTGCAACCATGGTGGTTATTAACCTGATCGCTATCGTGCC A L G D T F A A T M V V I N L I A I V P A L G D T F A A T M V V I N L I A I V P TCTGGGGGGCGTTGCGGTTGCTCTGCTAAAGAACTACAACCAGCAAAAAGCTAAGGGACT L G G V A V A L L K N Y N Q Q K A K G L L G G V A V A L L K N Y N Q Q K A K G L TGATCCGGTATTCCACCGCGATATGCTTCCGAATGTTCGTAACGTCGAATGCTGGGACGG D P V F H R D M L P N V R N V E C W D G D P V F H R D M L P N V R N V E C W D G GTCTGATCCGGTCACGCGTCGCGATCACAAGATTGTGCGCGAAGTCTAA S D P V T R R D H K I V R E V S D P V T R R D H K I V R E V --- // >fig|6666666.67449.peg.925 fig|257309.1.peg.911 Dipeptide transport system permease protein DppB (TC 3.A.1.5.2) gi|372109441|gb|CP003213.1|_898971_899276,gi|372109441|gb|CP003213.1|_899278_899898 MLRYIGRRLLQMIPVFFGATLLLYALVFLMPGDPVAALGGDRGLTEAARARISAEYNLDKPFLVQYLLYIKGIFQLDFGTTFSGRPVAEAMAHAFPVDYQVSVMALIFEAVFGVIFGVIAGMRRGGIFDSTVLVLSLLVIAVPSFVIGFVFQFFVGVKWGLLPVTVGSNVSVKSLLMPAIVLGALSFAYVVRLTRQSVSENLTADYVRTARAKGLKGSTVTMRHVLRNSLIPVATYLGADLGALMAGAIVTEGIFGINGVGGTMYHAILKGEPTTVVSFTTVLVIVYIIANLVVDLIYALLDPRIRYA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGTTGCGTTATATCGGGCGCCGATTGCTCCAAATGATCCCCGTGTTCTTTGGTGCAACC M L R Y I G R R L L Q M I P V F F G A T M L R Y I G R R L L Q M I P V F F G A T CTTTTGCTCTACGCACTCGTCTTCTTGATGCCTGGCGATCCAGTGGCCGCCCTCGGCGGC L L L Y A L V F L M P G D P V A A L G G L L L Y A L V F L M P G D P V A A L G G GACAGAGGCCTAACCGAAGCAGCCCGCGCTCGCATCTCTGCCGAGTACAACTTGGACAAA D R G L T E A A R A R I S A E Y N L D K D R G L T E A A R A R I S A E Y N L D K CCCTTCCTCGTTCAATACTTGCTCTACATCAAGGGTATTTTTCAGCTGGACTTTGGTACC P F L V Q Y L L Y I K G I F Q L D F G T P F L V Q Y L L Y I K G I F Q L D F G T ACATTTTCCGGCCGCCCAGTGGCAGAAGCAATGGCTCATGCATTTCCTGTTGACTATCAA T F S G R P V A E A M A H A F P V D Y Q T F S G R P V A E A M A H A F P V D Y Q GTTAGCTGTCATGGCACTGATCTTTGAAGCTGTGTTCGGTGTTATTTTTGGTGTGATCGC V S V M A L I F E A V F G V I F G V I A V S - V M A L I F E A V F G V I F G V I A CGGTATGCGTCGCGGTGGCATATTTGACTCCACCGTTTTGGTCCTCTCGCTTCTTGTTAT G M R R G G I F D S T V L V L S L L V I G M R R G G I F D S T V L V L S L L V I TGCAGTGCCTTCCTTCGTGATTGGCTTTGTTTTCCAGTTCTTTGTGGGAGTGAAGTGGGG A V P S F V I G F V F Q F F V G V K W G A V P S F V I G F V F Q F F V G V K W G ATTACTCCCTGTAACTGTTGGTTCAAATGTCTCGGTGAAGTCGCTTCTTATGCCCGCCAT L L P V T V G S N V S V K S L L M P A I L L P V T V G S N V S V K S L L M P A I CGTATTGGGTGCGTTGTCTTTTGCTTATGTTGTTCGTTTGACTAGGCAGTCCGTATCGGA V L G A L S F A Y V V R L T R Q S V S E V L G A L S F A Y V V R L T R Q S V S E AAATCTCACTGCTGATTATGTTCGCACTGCGCGAGCTAAAGGCTTGAAGGGGTCGACCGT N L T A D Y V R T A R A K G L K G S T V N L T A D Y V R T A R A K G L K G S T V GACGATGCGCCATGTGCTGCGTAACTCGTTGATTCCAGTGGCCACATATTTGGGTGCTGA T M R H V L R N S L I P V A T Y L G A D T M R H V L R N S L I P V A T Y L G A D CCTAGGCGCCTTGATGGCCGGTGCGATCGTGACTGAGGGCATATTCGGCATTAACGGTGT L G A L M A G A I V T E G I F G I N G V L G A L M A G A I V T E G I F G I N G V TGGTGGAACTATGTACCACGCCATTTTGAAGGGCGAACCTACCACGGTGGTGTCATTTAC G G T M Y H A I L K G E P T T V V S F T G G T M Y H A I L K G E P T T V V S F T CACCGTTCTCGTGATCGTCTACATCATTGCCAACTTGGTCGTGGACTTAATCTACGCCCT T V L V I V Y I I A N L V V D L I Y A L T V L V I V Y I I A N L V V D L I Y A L GCTTGACCCAAGGATCCGCTATGCATAA L D P R I R Y A L D P R I R Y A --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.911): ATGTTGCGTTATATCGGGCGCCGATTGCTCCAAATGATCCCCGTGTTCTTTGGTGCAACC M L R Y I G R R L L Q M I P V F F G A T M L R Y I G R R L L Q M I P V F F G A T CTTTTGCTCTACGCACTCGTCTTCTTGATGCCTGGCGATCCAGTGGCCGCCCTCGGCGGC L L L Y A L V F L M P G D P V A A L G G L L L Y A L V F L M P G D P V A A L G G GACAGAGGCCTAACCGAAGCAGCCCGCGCTCGCATCTCTGCCGAGTACAACTTGGACAAA D R G L T E A A R A R I S A E Y N L D K D R G L T E A A R A R I S A E Y N L D K CCCTTCCTCGTTCAATACTTGCTCTACATCAAGGGTATTTTTCAGCTGGACTTTGGTACC P F L V Q Y L L Y I K G I F Q L D F G T P F L V Q Y L L Y I K G I F Q L D F G T ACATTTTCCGGCCGCCCAGTGGCAGAAGCAATGGCTCATGCATTTCCTGTTGACTATCAA T F S G R P V A E A M A H A F P V T I K T F S G R P V A E A M A H A F P V - T I K GTTAGCTGTCATGGCACTGATCTTTGAAGCTGTGTTCGGTGTTATTTTTGGTGTGATCGC L A V M A L I F E A V F G V I F G V I A L A V M A L I F E A V F G V I F G V I A CGGTATGCGTCGCGGTGGCATATTTGACTCCACCGTTTTGGTCCTCTCGCTTCTTGTTAT G M R R G G I F D S T V L V L S L L V I G M R R G G I F D S T V L V L S L L V I TGCAGTGCCTTCCTTCGTGATTGGCTTTGTTTTCCAGTTCTTTGTGGGAGTGAAGTGGGG A V P S F V I G F V F Q F F V G V K W G A V P S F V I G F V F Q F F V G V K W G ATTACTCCCTGTAACTGTTGGTTCAAATGTCTCGGTGAAGTCGCTTCTTATGCCCGCCAT L L P V T V G S N V S V K S L L M P A I L L P V T V G S N V S V K S L L M P A I CGTATTGGGTGCGTTGTCTTTTGCTTATGTTGTTCGTTTGACTAGGCAGTCCGTATCGGA V L G A L S F A Y V V R L T R Q S V S E V L G A L S F A Y V V R L T R Q S V S E AAATCTCACTGCTGATTATGTTCGCACTGCGCGAGCTAAAGGCTTGAAGGGGTCGACCGT N L T A D Y V R T A R A K G L K G S T V N L T A D Y V R T A R A K G L K G S T V GACGATGCGCCATGTGCTGCGTAACTCGTTGATTCCAGTGGCCACATATTTGGGTGCTGA T M R H V L R N S L I P V A T Y L G A D T M R H V L R N S L I P V A T Y L G A D CCTAGGCGCCTTGATGGCCGGTGCGATCGTGACTGAGGGCATATTCGGCATTAACGGTGT L G A L M A G A I V T E G I F G I N G V L G A L M A G A I V T E G I F G I N G V TGGTGGAACTATGTACCACGCCATTTTGAAGGGCGAACCTACCACGGTGGTGTCATTTAC G G T M Y H A I L K G E P T T V V S F T G G T M Y H A I L K G E P T T V V S F T CACCGTTCTCGTGATCGTCTACATCATTGCCAACTTGGTCGTGGACTTAATCTACGCCCT T V L V I V Y I I A N L V V D L I Y A L T V L V I V Y I I A N L V V D L I Y A L GCTTGACCCAAGGATCCGCTATGCATAA L D P R I R Y A L D P R I R Y A --- // >fig|6666666.67449.peg.2048 fig|257309.1.peg.459 Serine transporter FIG033877 gi|372109441|gb|CP003213.1|_2082383_2083402,gi|372109441|gb|CP003213.1|_2083402_2083656 MADKREIRRTRRAPAPDGSAWSWAITLFGTAVGAGILFLPIDAGSFGFWPLLLATILVGPMVFFSHRMYSRIVSASPVKGLDVLQVITSLAGRKRGLATALMYWLAIYPIVLIYGISVTNTMDSFIVNQMGGPHVDRWLLATICVGVMTGAYALGKKATLWFANLLVYPLIVALAAVSLYLIPYWDLDSFMAYKSDVSLWKAMLFVLPVLVFSFSHMAAVSQSALDVQKSHDGDVAGTEKEVSKIELITCTLLVGFTMFFVWSCTLALGSDGMAVVREENIPVLSYFANTTNAPFMAVVTPVSRCARLRRRTSGTCLARRRVRSICCARLRRRLRRSGIxxVVRAGIYLFVFLSTVAVAIFNPSILSLISVVGGIFITLLVYIVPMLLFRHATAFRHYAKQPEAIFVFGLGIVIICVTVWQMVA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGGCGGATAAGCGCGAGATCCGGCGCACGCGGCGCGCCCCGGCGCCGGACGGAAGTGCC V A D K R E I R R T R R A P A P D G S A M A D K R E I R R T R R A P A P D G S A TGGTCGTGGGCGATTACGCTGTTTGGCACCGCCGTCGGCGCCGGTATCCTCTTTCTGCCT W S W A I T L F G T A V G A G I L F L P W S W A I T L F G T A V G A G I L F L P ATCGACGCAGGCTCCTTCGGCTTCTGGCCTCTCCTGCTTGCGACGATCCTGGTTGGCCCA I D A G S F G F W P L L L A T I L V G P I D A G S F G F W P L L L A T I L V G P ATGGTGTTCTTCTCGCACCGGATGTATTCGAGGATCGTGTCGGCGTCGCCGGTCAAGGGT M V F F S H R M Y S R I V S A S P V K G M V F F S H R M Y S R I V S A S P V K G CTGGACGTGCTGCAGGTCATCACTTCTCTGGCCGGGCGGAAGCGTGGCCTGGCTACGGCG L D V L Q V I T S L A G R K R G L A T A L D V L Q V I T S L A G R K R G L A T A TTGATGTATTGGCTGGCGATTTACCCGATTGTGCTGATTTACGGCATTTCGGTGACGAAT L M Y W L A I Y P I V L I Y G I S V T N L M Y W L A I Y P I V L I Y G I S V T N ACGATGGACAGTTTCATTGTGAACCAGATGGGCGGCCCGCACGTGGACCGTTGGCTGCTG T M D S F I V N Q M G G P H V D R W L L T M D S F I V N Q M G G P H V D R W L L GCCACGATTTGCGTCGGCGTGATGACGGGCGCCTATGCCCTTGGCAAGAAGGCGACGCTG A T I C V G V M T G A Y A L G K K A T L A T I C V G V M T G A Y A L G K K A T L TGGTTTGCAAACCTGCTGGTCTATCCCCTGATTGTGGCGCTTGCTGCGGTGTCGTTGTAT W F A N L L V Y P L I V A L A A V S L Y W F A N L L V Y P L I V A L A A V S L Y TTGATTCCGTATTGGGATTTGGACAGTTTTATGGCGTATAAGTCGGATGTGTCGCTGTGG L I P Y W D L D S F M A Y K S D V S L W L I P Y W D L D S F M A Y K S D V S L W AAGGCGATGCTGTTTGTATTGCCTGTGCTGGTGTTTTCCTTTTCGCATATGGCGGCGGTG K A M L F V L P V L V F S F S H M A A V K A M L F V L P V L V F S F S H M A A V TCGCAGTCTGCGTTGGATGTGCAGAAGTCGCATGACGGTGATGTTGCTGGTACGGAAAAG S Q S A L D V Q K S H D G D V A G T E K S Q S A L D V Q K S H D G D V A G T E K GAGGTGTCGAAGATTGAGCTGATCACCTGTACTCTCCTGGTCGGCTTCACGATGTTCTTT E V S K I E L I T C T L L V G F T M F F E V S K I E L I T C T L L V G F T M F F GTTTGGTCTTGCACGCTCGCCCTCGGTTCGGATGGCATGGCTGTTGTGCGCGAGGAGAAC V W S C T L A L G S D G M A V V R E E N V W S C T L A L G S D G M A V V R E E N ATCCCGGTCCTTTCCTACTTCGCGAACACGACGAATGCCCCGTTCATGGCGGTGGTGACT I P V L S Y F A N T T N A P F M A V V T I P V L S Y F A N T T N A P F M A V V T CCGGTGTCGCGTTGTGCGCGATTGCGTCGTCGTACTTCGGGCACATGCTTGGCACGGAGG P V S R C A R L R R R T S G T C L A R R P V S R C A R L R R R T S G T C L A R R AGGGTACGCAGTATTTGCTGCGCGCGGTTGCGCCGAAGGCTTCGGAGAAGTGGAATC*CG R V R S I C C A R L R R R L R R S G I R V R S I C C A R L R R R L R R S G I *X* *CGTGTGGTCCGCGCGGGCATCTATCTCTTCGTCTTCTTATCGACGGTCGCTGTCGCCAT R V V R A G I Y L F V F L S T V A V A I * X V V R A G I Y L F V F L S T V A V A I CTTCAACCCGTCAATCCTGAGTTTGATCTCGGTCGTCGGCGGTATTTTCATTACGTTGCT F N P S I L S L I S V V G G I F I T L L F N P S I L S L I S V V G G I F I T L L GGTGTACATCGTGCCGATGCTCCTGTTCCGCCATGCGACCGCTTTCCGTCACTACGCGAA V Y I V P M L L F R H A T A F R H Y A K V Y I V P M L L F R H A T A F R H Y A K GCAGCCGGAGGCCATCTTCGTGTTCGGCCTGGGTATTGTGATCATTTGCGTCACGGTGTG Q P E A I F V F G L G I V I I C V T V W Q P E A I F V F G L G I V I I C V T V W GCAGATGGTGGCGTAA Q M V A Q M V A --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.459): ----GTGGCGGATAAGCGCGAGATCCGGCGCACGC-GGC*GC*GCCCCGGCG--CCGGAC V A D S A R S G A R G A P A P D MSQI V S H - S A S A G V R D G *V** A P S ES P A GGAAGTGCC---TGGTCG-----TGGGCGATTACGCTGTTTGGCACCGCCGTCGGCGCCG G S A W S W A I T L F G T A V G A S S S APS W R KTDTV W S L S L F G T A I G A GTATCCTCTTTCTGCCTATCGACGCAGGCTCCTTCGGCTTCTGGCCTCTCCTGCTTGCGA G I L F L P I D A G S F G F W P L L L A G V L F L P I N A G I G G I I P M L V M CGATCCTGGTTGGCCCAATGGTGTTCTTCTCGCACCGGATGTATTCGAGGATCGTGTCGG T I L V G P M V F F S H R M Y S R I V S A V V A Y P M A H W A H R G L T R F I L CGTCGCCGGTCAAGGGTCTGGACGTGCTGCAGGTCATCACTTCTCTGGCCGGGCGGAAGC A S P V K G L D V L Q V I T S L A G R K S A S K E D A D L T D V V D E H F G H K GTGGCCTGGCTACGGCGTTGATGTATTGGCTGGCGATTTACCCGATTGTGCTGATTTACG R G L A T A L M Y W L A I Y P I V L I Y A G A F I T V L Y F L S V Y P I L L V Y GCATTTCGGTGACGAATACGATGGACAGTTTCATTGTGAACCAGATGGGCGGCCCGCACG G I S V T N T M D S F I V N Q M G G P H S V T I T N T V N S F L E N Q L G I T P TGGACCGTTGGCTGCTGGCCACGATTTGCGTCGGCGTGATGACGGGCGCCTATGCCCTTG V D R W L L A T I C V G V M T G A Y A L L P R W L M S L I L V G G L I F V V S L GCAAGAAGGCGACGCTGTGGTTTGCAAACCTGCTGGTCTATCCCCTGATTGTGGCGCTTG G K K A T L W F A N L L V Y P L I V A L G R T V I V K A M S V L V F P F I A I L CTGCGGTGTCGTTGTATTTGATTCCGTATTGGGATTTGGACAGTTTTATGGCGTATAAG- A A V S L Y L I P Y W D L D S F M A Y K V V L S V Y L I P K W N T A L F Q T F D L ------TCGGATGTGTCGCTGTGGAAGGCGATGCTGTTTGTATTGCCTGTGCTGGTGTTT S D V S L W K A M L F V L P V L V F RTSAEA S G H S I W V T L L L L V P V M V F TCCTTTTCGCATATGGCGGCGGTGTCGCAGTCTGCGTTGGATGTGCAGAAGTCGCATGAC S F S H M A A V S Q S A L D Q K S H D S F N H S P I I S S F A Q E --- K R A E Y GGTGATGTTGCT*GG*TACGGAAAAGGAGGTGTCGAAGATTGAGCTGATCACCTGTACTC G D V A Y G K G R R L S * S P V L G Q W A *D** Y K T G ----- R I L S A A Q I L TCCTGGTCGGCTTCACGATGTTCTTTGTTTGGTCTTGCACGCTCGCCCTCGGTTCGGATG L V G F T M F F V W S C T L A L G S D -- M V V V V M F F V F S C A L S L S P A GCATGGCTGTTGTGCGCGAGGAGAACATCCCGGTCCTTTCCTACTTCGCGAACACGACGA G M A V V R E E N I P V L S Y F A N T T D L A A A K E Q N I T I L S Y L A N H F ATGCCCCGTTCATGGCGGTGGTGACTCCG*GT*GTCGCGTTGTGCGCGATTGCGTCGTCG N A P F M A V V T P V A L C A I A S S D N P V I Q W A A P *I** I A M I A V A K S TACTTCGGGCACATGCTTGGCACGGAGGAGGGTACGCAGTATTTGCTGCGCGCGGTTGCG Y F G H M L G T E E G T Q Y L L R A V A F L G H Y L G A A E G F Q G L I A S G A CCGAAGGCTTCGGAGAAGTGGAATCCG--CGTGTGGTCCGCGCGGGCATCTATCTCTTCG P K A S E K W N P R V V R A G I Y L F A S K G K T V D T QS R A L V L G T L A F TCTTCTTATCGACGGTCGCTGTCGCCATCTTCAACCCGTCAATCCTGAGTTTGATCTCGG V F L S T V A V A I F N P S I L S L I S M L I S S W L V A W L N P S I L G M I E TCGTCGGCGGTATTTTCATTACGTTGCTGGTGTACATCGTGCCGATGCTCCTGTTCCGCC V V G G I F I T L L V Y I V P M L L F R T M C G P T I A I L L F L M P M Y A I H ATGCGACCGCTTTCCGTCACTACGCGAAGCAGCCGGAGGCCATCTTCGTGTTCGGCCTGG H A T A F R H Y A K Q P E A I F V F G L K V P A L A K Y R G R I S N Y L V F G M GTATTGTGATCATTTGCGTCACGGTGTGGCAGATGGTGGCGTAA- G I V I I C V T V W Q M V A * G L L A L C T I V Y S I V Q A F // >fig|6666666.67449.peg.2112 fig|257309.1.peg.2331 gi|372109441|gb|CP003213.1|_2140693_2140070,gi|372109441|gb|CP003213.1|_2140068_2139940 MRQALLNACDFDWSKIDVSVFGSLFQLVKSKEARRGDGEHYTSKTNIMKTIGPLFLDELRAQADKLVSSPATPVAKLEAFRDSLAELVFCDPACGAGNFLLTVYKELRKIETDLIVAIRQRRGETGMSLNIEWEQKLSIGQFYGFELNWWPAKIAETAMFLVDHQANKELANAVGRPPQRLPITITAHIVHGNALALDWAEVLPVAAGVFLYRLSTSRVEKSGADSLCGVVWTGLFSGMTASRLGFYPVG We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGCGACAAGCCCTGCTCAACGCCTGCGACTTCGACTGGTCAAAAATCGATGTGTCTGTC M R Q A L L N A C D F D W S K I D V S V M R Q A L L N A C D F D W S K I D V S V TTTGGTTCACTGTTCCAGTTGGTCAAGTCCAAGGAAGCCCGTCGTGGCGATGGTGAGCAC F G S L F Q L V K S K E A R R G D G E H F G S L F Q L V K S K E A R R G D G E H TACACTTCGAAGACCAACATCATGAAGACTATCGGCCCGCTCTTTTTGGACGAGTTGCGT Y T S K T N I M K T I G P L F L D E L R Y T S K T N I M K T I G P L F L D E L R GCCCAGGCTGACAAGCTGGTTTCCAGCCCCGCCACGCCAGTGGCCAAGCTAGAAGCGTTC A Q A D K L V S S P A T P V A K L E A F A Q A D K L V S S P A T P V A K L E A F CGTGACTCCCTTGCTGAGCTGGTGTTCTGCGACCCGGCGTGTGGGGCGGGAAACTTCCTG R D S L A E L V F C D P A C G A G N F L R D S L A E L V F C D P A C G A G N F L CTCACCGTCTATAAAGAGCTGCGAAAAATTGAAACGGACCTTATTGTGGCTATCCGTCAG L T V Y K E L R K I E T D L I V A I R Q L T V Y K E L R K I E T D L I V A I R Q CGTCGCGGCGAGACGGGCATGTCGCTGAATATTGAGTGGGAGCAGAAACTGTCGATTGGG R R G E T G M S L N I E W E Q K L S I G R R G E T G M S L N I E W E Q K L S I G CAGTTCTACGGCTTCGAGTTGAACTGGTGGCCGGCAAAGATTGCCGAGACGGCGATGTTT Q F Y G F E L N W W P A K I A E T A M F Q F Y G F E L N W W P A K I A E T A M F TTGGTGGATCATCAGGCGAATAAGGAGTTGGCGAATGCGGTGGGGCGTCCGCCGCAGCGT L V D H Q A N K E L A N A V G R P P Q R L V D H Q A N K E L A N A V G R P P Q R TTGCCTATTACGATTACCGCCCACATTGTCCACGGAAACGCTCTCGCCCTGGACTGGGCA L P I T I T A H I V H G N A L A L D W A L P I T I T A H I V H G N A L A L D W A GAAGTGCTGCCCGTGGCGGCGGGGGGTGTTCCTATATAGGTTGTCAACCTCGCGGGTGGA E V L P V A A G V F L Y R L S T S R V E E V L P V A A G - V F L Y R L S T S R V E GAAATCGGGGGCGGATTCTCTCTGTGGGGTTGTGTGGACGGGTTTGTTTTCGGGCATGAC K S G A D S L C G V V W T G L F S G M T K S G A D S L C G V V W T G L F S G M T AGCTAGCCGACTGGGATTTTACCCGGTCGGCTAG A S R L G F Y P V G A S R L G F Y P V G --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2331): ATGCGACAAGCCCTGCTCAACGCCTGCGACTTCGACTGGTCAAAAATCGATGTGTCTGTC M R Q A L L N A C D F D W S K I D V S V M R Q A L L N A C D F D W S K I D V S V TTTGGTTCACTGTTCCAGTTGGTCAAGTCCAAGGAAGCCCGTCGTGGCGATGGTGAGCAC F G S L F Q L V K S K E A R R G D G E H F G S L F Q L V K S K E A R R G D G E H TACACTTCGAAGACCAACATCATGAAGACTATCGGCCCGCTCTTTTTGGACGAGTTGCGT Y T S K T N I M K T I G P L F L D E L R Y T S K T N I M K T I G P L F L D E L R GCCCAGGCTGACAAGCTGGTTTCCAGCCCCGCCACGCCAGTGGCCAAGCTAGAAGCGTTC A Q A D K L V S S P A T P V A K L E A F A Q A D K L V S S P A T P V A K L E A F CGTGACTCCCTTGCTGAGCTGGTGTTCTGCGACCCGGCGTGTGGGGCGGGAAACTTCCTG R D S L A E L V F C D P A C G A G N F L R D S L A E L V F C D P A C G A G N F L CTCACCGTCTATAAAGAGCTGCGAAAAATTGAAACGGACCTTATTGTGGCTATCCGTCAG L T V Y K E L R K I E T D L I V A I R Q L T V Y K E L R K I E T D L I V A I R Q CGTCGCGGCGAGACGGGCATGTCGCTGAATATTGAGTGGGAGCAGAAACTGTCGATTGGG R R G E T G M S L N I E W E Q K L S I G R R G E T G M S L N I E W E Q K L S I G CAGTTCTACGGCTTCGAGTTGAACTGGTGGCCGGCAAAGATTGCCGAGACGGCGATGTTT Q F Y G F E L N W W P A K I A E T A M F Q F Y G F E L N W W P A K I A E T A M F TTGGTGGATCATCAGGCGAATAAGGAGTTGGCGAATGCGGTGGGGCGTCCGCCGCAGCGT L V D H Q A N K E L A N A V G R P P Q R L V D H Q A N K E L A N A V G R P P Q R TTGCCTATTACGATTACCGCCCACATTGTCCACGGAAACGCTCTCGCCCTGGACTGGGCA L P I T I T A H I V H G N A L A L D W A L P I T I T A H I V H G N A L A L D W A GAAGTGCTGCCCGTGGCGGCGGGGGGTGTTCCTATATAGGTTGTCAACCTCGCGGGTGGA E V L P V A A G V F L Y R L S T S R V E E V L P V A A G - V F L Y R L S T S R V E GAAATCGGGGGCGGATTCTCTCTGTGGGGTTGTGTGGACGGGTTTGTTTTCGGGCATGAC K S G A D S L C G V V W T G L F S G M T K S G A D S L C G V V W T G L F S G M T AGCTAGCCGACTGGGATTTTACCCGGTCGGCTAG A S R L G F Y P V G A S R L G F Y P V G --- // >fig|6666666.67449.peg.98 fig|196627.4.peg.1764 Phenazine biosynthesis protein PhzF like FIG004618 gi|372109441|gb|CP003213.1|_88250_87924,gi|372109441|gb|CP003213.1|_87920_87903,gi|372109441|gb|CP003213.1|_87903_87430 MGHIKLPFIQVDVFSTGSFTGNPLVVVGNADNLSTTQMQNIARWLNLSETTFLSAPTTTDADYRVRIFTRTEELPLAGHPTLGSARAWLEFGGNHKDMMFSYKNAPLASxQSEMIxxTFSFSAPPLTCNAPLTTSEIQEVAESLGISVHNIATAVWGVNGPRWQLIQLADIDLLPTLTPTALSIGKRLGVIAIADRTHVHVRAFVGTGEDPVTGSLNAAIAQWLRKQNKVDHEYEASQGKFVGAAGKITILDDASGIWVGGETQVQINGSIDI We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGGACACATAAAACTCCCTTTTATCCAAGTAGACGTATTTTCCACTGGTTCTTTCACA M G H I K L P F I Q V D V F S T G S F T M G H I K L P F I Q V D V F S T G S F T GGTAATCCACTTGTCGTCGTCGGTAACGCAGATAATCTGTCCACTACCCAGATGCAGAAT G N P L V V V G N A D N L S T T Q M Q N G N P L V V V G N A D N L S T T Q M Q N ATTGCACGGTGGCTAAATCTCTCCGAAACTACTTTCTTATCAGCTCCGACAACAACCGAT I A R W L N L S E T T F L S A P T T T D I A R W L N L S E T T F L S A P T T T D GCAGATTACCGTGTACGTATCTTCACTCGTACCGAAGAACTGCCGCTCGCCGGCCACCCA A D Y R V R I F T R T E E L P L A G H P A D Y R V R I F T R T E E L P L A G H P ACATTAGGTTCTGCACGTGCTTGGCTTGAATTTGGTGGAAACCACAAAGACATGATGTTC T L G S A R A W L E F G G N H K D M M F T L G S A R A W L E F G G N H K D M M F TCGTACAAGAATGCGCCGCTGGCCTCATAACAATCCGAAATGATAACT*CG*ACCTTTTC S Y K N A P L A S * Q S E M I T T F S S Y K N A P L A S X Q S E M I X *X** T F S TTTTTCAGCACCACCCCTCACATGCAACGCCCCTCTGACTACCAGCGAGATCCAAGAAGT F S A P P L T C N A P L T T S E I Q E V F S A P P L T C N A P L T T S E I Q E V CGCCGAATCTCTAGGAATTTCTGTTCATAACATCGCCACTGCCGTCTGGGGAGTAAACGG A E S L G I S V H N I A T A V W G V N G A E S L G I S V H N I A T A V W G V N G TCCACGTTGGCAACTTATTCAACTAGCCGATATAGACCTTCTTCCCACCCTTACCCCGAC P R W Q L I Q L A D I D L L P T L T P T P R W Q L I Q L A D I D L L P T L T P T GGCACTTTCCATAGGAAAGCGTCTTGGGGTCATTGCGATAGCCGACCGCACTCACGTCCA A L S I G K R L G V I A I A D R T H V H A L S I G K R L G V I A I A D R T H V H TGTACGCGCATTTGTAGGTACTGGAGAGGATCCAGTCACAGGTTCATTGAATGCCGCCAT V R A F V G T G E D P V T G S L N A A I V R A F V G T G E D P V T G S L N A A I CGCTCAATGGCTACGCAAACAAAACAAGGTGGACCACGAATACGAAGCATCCCAAGGAAA A Q W L R K Q N K V D H E Y E A S Q G K A Q W L R K Q N K V D H E Y E A S Q G K GTTTGTGGGCGCAGCTGGAAAAATCACCATCCTTGATGATGCCTCAGGCATCTGGGTAGG F V G A A G K I T I L D D A S G I W V G F V G A A G K I T I L D D A S G I W V G TGGCGAAACACAGGTCCAGATAAACGGGAGCATAGACATATAA G E T Q V Q I N G S I D I G E T Q V Q I N G S I D I --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.1764): -ATGGGACACATAAAACTCCCTTTTATCCAAGTAGACGTATTTTCCACTGGTTCTTTCAC M G H I K L P F I Q V D V F S T G S F T M P S K I S R P Y Y Q V D V F S S E P F M AGGTAATCCACTTGTCGTCGTCGGTAACGCAGATAATCTGTCCACTACCCAGATGCAGAA G N P L V V V G N A D N L S T T Q M Q N G N P L A V I A D A D D L S A E Q M A R TATTGCACGGTGGCTAAATCTCTCCGAAACTACTTTCTTATCAGCTCCGACAACAACCGA I A R W L N L S E T T F L S A P T T T D I A R W T N L S E T T F L L K P T Q E G TGCAGATTACCGTGTACGTATCTTCACTCGTACCGAAGAACTGCCGCTCGCCGGCCACCC A D Y R V R I F T R T E E L P L A G H P A D Y R V R I F T P T G E L P F A G H P AACATTAGGTTCTGCACGTGCTTGGCTTGAATTTGGTGGAAACCACAAAGACATGATGTT T L G S A R A W L E F G G N H K D M T L G T A H V F R E L H G E Q G T Q ----- CTCGTACAAGAATGCGCCGCTGGCCTCATAACAATCCGA---AATGATAACTCGACCTTT L V Q E C A A G L I T I R N D N S T F L V Q E C V A G L V A V R AID G P A S G L TCTTTTTCAGCACCACCCCTCACATGCAACGCCCCTCTGACTACCAGCGAGATCCAAGAA S F S A P P L T C N A P L T T S E I Q E A F Q A P P T L K D G P L D A S D L D A GTCGCCGAATCTCTAGGAATTTCTGTTCATAACATCGCCACTGCCGTCTGGGGAGTAAAC V A E S L G I S V H N I A T A V W G V N A C E A L G I S P D F I R A H Q W V D N GGTCCACGTTGGCAACTTATTCAACTAGCCGAT----ATAGACCTTCTTCCCACCCTTAC G P R W Q L I Q L A D I D L L P T L T G P G W A V V E L P S AQHV L D L E P D F S C--CCGACGGCACTTTCCATAGGAAAGCGTCTTGGGGTCATTG*C*GATAGCCGACCGCA P T L S I G V L G S L D S R P H AH P T --- L K L G ---- V I G A Y *P* E G A P H CTCACGTCCATGTACGCGCATTTGTA-GGTACTGGAGAGGATCCAGTCACAGGTTCATTG S V H V R A F V G T G E D P V T G S L A - F E V R A F A Q G I G E D P V T G S L AATGCCGCCATCGCTCAATGGCTACGCAAACAAAACAAGGTGGACCACGAATACGAAGCA N A A I A Q W L R K Q N K V D H E Y E A N A S I A Q W L H R D G R A G E G Y L A TCCCAAGGAAAGTTTGTGGGCGCAGCTGGAAAAATCACCATCCTTGATGATGCCTCAGGC S Q G K F V G A A G K I T I L D D A S G S Q G T A I G R A G E I H I S I E S H A ATCTGGGTAGGTGGCGAAACACAGGTCCAGATAAACGGGAGCATAGACATATAA I W V G G E T Q V Q I N G S I D I I W V G G S V T T I F Q G T A E F --- // >fig|6666666.67449.peg.1407 fig|196164.1.peg.1829 PTS system, IIA component gi|372109441|gb|CP003213.1|_1425509_1425556,gi|372109441|gb|CP003213.1|_1425560_1425985,gi|372109441|gb|CP003213.1|_1425985_1426257,gi|372109441|gb|CP003213.1|_1426261_1426350,gi|372109441|gb|CP003213.1|_1426352_1426546,gi|372109441|gb|CP003213.1|_1426546_1426863,gi|372109441|gb|CP003213.1|_1426863_1427117,gi|372109441|gb|CP003213.1|_1427117_1427245,gi|372109441|gb|CP003213.1|_1427249_1427500 MPSRLIDNSLIALAPAxDSDKTSIIKELYHVMKTAGVTDDVDTLIADTLTREESGSTALPQGVAIPHCRTSAVAHPVIAFASLSKQVLFDGSQNPVDLVFLIVVPLDAKRAHLKILSTLARALINQSAEASLRAATTPAQVETIISASLDSQTAMRKIxxPSSPIRIAATTACPTGIAHTYMAADALTSAAKARGDVSLLVETQGTSDNSVLREKEIASADVVIFAADVGVRDHERFKGKRILECSPRHPxRRNRTQEFFKKYDSSTKCNSSCSSNSLRFRRKMRHAAMTGVSYMVPFVAAGGLLLALGFLLGGYDIAAGWQAIAIQHSFTDLPSHDVVIDIATGxxVSFQRSGLLLYLGAVAFAIDSMSMQFIVAALSGYIAFAIAGRSGIAPGYIGGAVSVFVGAGFLGGLVTGLLSGTLAWWLSTRRVPALISSLMPVVIVPLISSLLxxLIMFLVLGKPLSLLLLSLQNWLAGLSGSSAIILGAVLGLMMCFDLGGPVNKAAYLFVTAGLSTNEPAALHIMAAVMVAGMLPPxxALSLATIMDKKVFTDTERENGKSAWLLGLSFISEGAIPFYRRxSIRVIPSLMIGGASAGAISMGTTTGSHAPHGGIFVLFAISPAWTFLLALLIGVKVSALIVILLKRMWPVPISTTSYSKDSTAA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGCCTTCTAGGCTTATCGACAATTCACTCATCGCCCTCGCCCCTGCTTAGGATAGCGAT M P S R L I D N S L I A L A P A * D S D M P S R L I D N S L I A L A P A X D S D AAAACATCAATCATCAAGGAGCTTTATCATGTAATGAAAACAGCTGGAGTTACGGATGAC K T S I I K E L Y H V M K T A G V T D D K T S I I K E L Y H V M K T A G V T D D GTCGACACGCTGATTGCCGATACCCTCACTCGCGAAGAATCTGGCAGCACCGCACTCCCC V D T L I A D T L T R E E S G S T A L P V D T L I A D T L T R E E S G S T A L P CAAGGCGTTGCGATTCCGCATTGCAGAACGTCAGCCGTAGCACATCCTGTGATCGCTTTT Q G V A I P H C R T S A V A H P V I A F Q G V A I P H C R T S A V A H P V I A F GCATCACTAAGCAAACAAGTGCTTTTCGACGGTTCCCAAAATCCTGTGGATTTAGTCTTT A S L S K Q V L F D G S Q N P V D L V F A S L S K Q V L F D G S Q N P V D L V F CTCATTGTAGTTCCACTCGATGCGAAAAGAGCTCACCTCAAAATTCTTTCAACCTTGGCG L I V V P L D A K R A H L K I L S T L A L I V V P L D A K R A H L K I L S T L A CGAGCATTGATCAATCAATCAGCCGAAGCATCCTTGCGTGCTGCGACTACTCCAGCACAG R A L I N Q S A E A S L R A A T T P A Q R A L I N Q S A E A S L R A A T T P A Q GTAGAAACAATTATTTCTGCATCGCTAGATTCACAAACGGCAATGCGGAAAATA*AT*GC V E T I I S A S L D S Q T A M R K I A V E T I I S A S L D S Q T A M R K I *X** X ACCGAGTTCTCCTATAAGGATTGCGGCAACAACCGCATGTCCTACTGGGATCGCCCATAC P S S P I R I A A T T A C P T G I A H T P S S P I R I A A T T A C P T G I A H T CTATATGGCAGCGGATGCACTTACTTCGGCCGCGAAAGCACGTGGCGACGTCTCATTGTT Y M A A D A L T S A A K A R G D V S L L Y M A A D A L T S A A K A R G D V S L L AGTAGAAACTCAAGGCACTTCTGACAACTCAGTATTAAGAGAAAAAGAGATCGCTTCAGC V E T Q G T S D N S V L R E K E I A S A V E T Q G T S D N S V L R E K E I A S A TGATGTTGTTATCTTTGCAGCCGATGTGGGAGTGCGTGACCATGAGCGATTCAAAGGAAA D V V I F A A D V G V R D H E R F K G K D V V I F A A D V G V R D H E R F K G K ACGAATCCTTGAATGCAGCCCACGACACCCTTAGCGCCGCAATCGCACTCAAGAATTCTT R I L E C S P R H P * R R N R T Q E F F R I L E C S P R H P X R R N R T Q E F F CAAGAAATACGACAGTTCGACCAAATGCAACTCATCGTGTAGCAGCAACAGCCTACGATT K K Y D S S T K C N S S C S S N S L R F K K Y D S S T K C N S S C S S N S L R F TAGAACGAAAAATGCGCCACGCTGCGATGACTGGTGTTTCCTACATGGTTCCGTTCGTAG R R K M R H A A M T G V S Y M V P F V R - R K M R H A A M T G V S Y M V P F V CAGCCGGCGGATTACTGTTAGCCCTCGGATTTCTTTTGGGAGGCTACGACATAGCTGCTG A A G G L L L A L G F L L G G Y D I A A A A G G L L L A L G F L L G G Y D I A A GATGGCAGGCAATTGCCATTCAGCATTCGTTCACTGATCTGCCCAGCCACGATGTGGTCA G W Q A I A I Q H S F T D L P S H D V V G W Q A I A I Q H S F T D L P S H D V V TCGATATAGCAACAGGA*CA*GTCGTATCATTTCAGCGCTCTGGCCTTTTGCTTTATCTT I D I A T G V V S F Q R S G L L L Y L I D I A T G *X** X V S F Q R S G L L L Y L GGCGCTGTGGCTTTTGCTATCGACTCAATGTCAATGCAATTTATTGTGGCTGCACTTTCA G A V A F A I D S M S M Q F I V A A L S G A V A F A I D S M S M Q F I V A A L S GGATACATTGCGTTTGCTATCGCTGGACGCTCAGGAATAGCTCCAGGTTATATCGGCGGT G Y I A F A I A G R S G I A P G Y I G G G Y I A F A I A G R S G I A P G Y I G G GCGGTATCAGTCTTCGTTGGCGCAGGCTTTTTGGGCGGATTAGTCACCGGGCTACTGTCT A V S V F V G A G F L G G L V T G L L S A V S V F V G A G F L G G L V T G L L S GGAACGCTTGCATGGTGGCTTTCTACGAGGCGGGTTCCCGCACTTATCTCGTCGCTTATG G T L A W W L S T R R V P A L I S S L M G T L A W W L S T R R V P A L I S S L M CCCGTAGTAATTGTTCCGCTCATTTCCAGTCTTTTG*TG*GGTTTGATCATGTTCTTAGT P V V I V P L I S S L L G L I M F L V P V V I V P L I S S L L *X** X L I M F L V TTTAGGCAAACCCCTTTCATTGTTGCTGTTATCCCTCCAAAACTGGCTGGCAGGACTATC L G K P L S L L L L S L Q N W L A G L S L G K P L S L L L L S L Q N W L A G L S GGGTTCTTCAGCCATCATTCTTGGGGCAGTGCTGGGACTTATGATGTGTTTCGACCTCGG G S S A I I L G A V L G L M M C F D L G G S S A I I L G A V L G L M M C F D L G TGGCCCTGTAAATAAAGCAGCATATTTATTTGTTACCGCAGGCCTGTCCACCAATGAACC G P V N K A A Y L F V T A G L S T N E P G P V N K A A Y L F V T A G L S T N E P TGCTGCGCTTCATATTATGGCGGCAGTCATGGTCGCAGGTATGCTCCCCCCC*CG*ATTG A A L H I M A A V M V A G M L P P I A A L H I M A A V M V A G M L P P *X** X CACTTTCTTTAGCCACCATTATGGATAAAAAAGTGTTTACAGATACCGAACGAGAAAACG A L S L A T I M D K K V F T D T E R E N A L S L A T I M D K K V F T D T E R E N GAAAATCAGCGTGGCTTTTAGGACTTTCCTTCATTTCTGAAGGAGCGATCCCTTTTTACC G K S A W L L G L S F I S E G A I P F Y G K S A W L L G L S F I S E G A I P F Y GCAGGTGATCGATTAGGGTGATACCATCATTGATGATTGGAGGCGCATCAGCTGGCGCAA R R * S I R V I P S L M I G G A S A G A R R X S I R V I P S L M I G G A S A G A TTTCCATGGGGACCACGACTGGCTCGCATGCTCCGCATGGCGGAATTTTTGTACTCTTTG I S M G T T T G S H A P H G G I F V L F I S M G T T T G S H A P H G G I F V L F CGATTTCTCCAGCGTGGACATTCCTCTTAGCTTTACTCATTGGCGTGAAGGTTTCCGCGC A I S P A W T F L L A L L I G V K V S A A I S P A W T F L L A L L I G V K V S A TCATTGTCATTCTCTTAAAGCGTATGTGGCCCGTTCCAATCTCCACGACTTCGTACAGTA L I V I L L K R M W P V P I S T T S Y S L I V I L L K R M W P V P I S T T S Y S AAGACAGTACGGCGGCCTAA K D S T A A K D S T A A --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.1829): ATGCCTTCTAGGCTTATCGACAATTCACTCATCGCCCTCGCCCCTGCTTAGGATAGCGAT P S R L I D N S L I A L A P A * D S D --- M N N V I N T S L V R L D V D F G A T AAAACATCAATCATCAAGGAGCTTTATCATGTAATGAAAACAGCTGGAGTTACGGATGAC K T S I I K E L Y H V M K T A G V T D D A T E V I N N L A S V V H S A G R A G S GTCGACACGCTGATTGCCGATACCCTCACTCGCGAAGAATCTGGCAGCACCGCACTCCCC V D T L I A D T L T R E E S G S T A L P A E A L A A D A L E R E A K S G T G V P CAAGGCGTTGCGATTCCGCATTGCAGAACGTCAGCCGTAGCACATCCTGTGATCGCTTTT Q G V A I P H C R T S A V A H P V I A F G G V A I P H C R S E S V E T A T L A F GCATCACTAAGCAAACAAGTGCTTTTCGACGGTTCCCAAAATCCTGTGGATTTAGTCTTT A S L S K Q V L F D G S Q N P V D L V F A R L S R P V D F S G P D G D A N I V F CTCATTGTAGTTCCACTCGATGCGAAAAGAGCTCACCTCAAAATTCTTTCAACCTTGGCG L I V V P L D A K R A H L K I L S T L A L I A A P A G G G K E H L K I L S K L A CGAGCATTGATCAATCAATCAGCCGAAGCATCCTTGCGTGCTGCGACTACTCCAGCACAG R A L I N Q S A E A S L R A A T T P A Q R N L V K K D F I D A L N T A R T E E E GTAGAAACAATTATTTCTGCATCGCTAGATTCACAAACGGCAATGCGGAAAATAATGCAC V E T I I S A S L N N A I V E L V D A V L ----------------------- N P A CG--AGTTCTCCTATAAGG-------------ATTGCGGCAACAACCGCATGTCCTACTG P S S P I R I A A T T A C P T P KE T A P V R ESVATEASTSITR I V A V T A C P T GGATCGCCCATACCTATATGGCAGCGGATGCACTTACTTCGGCCGCGAAAGCACGTGGCG G I A H T Y M A A D A L T S A A K A R G G I A H T Y M A A D A L K Q H A D G R D ACGTCTCATTGTTAGTAGAAACTCAAGGCACTTCTGACAACTCAGTATTAAGAGAAAAAG D V S L L V E T Q G T S D N S V L R E K D V D L H V E T Q G S S A V T P L D P A AGATCGCTTCAGCTGATGTTGTTATCTTTGCAGCCGATGTGGGAGTGCGTGACCATGAGC E I A S A D V V I F A A D V G V R D H E I I E A A D A V I F A T D V G V K D R E GATTCAAAGGAAAACGAATCCTTGAATGCAGCCCACGA*C*ACCCTTAGCGCCGCAATCG R F K G K R I L E C S P R T L S A A I R F A G K P V I E S G V K *R* A I N E P A CACTCAAGAATTCTTCAAGAAATACGACAGTTCGACCAAATGCAACTCATCGTGTAGCA- A L K N S S R N T T V R P N A H R V A V M I D E A I T A A R N P N A --- R R V S G ---GCAACAGCCTACGATTTAGAA--------CGAAAAATGCGCCACGCTGCGATGACTG A T A Y D L E R K M R H A A M T AKT A T T P G E E TGAQLGWG K R I Q Q A V M T GTGTTTCCTACATGGTTCCGTTCGTAGCAGCCGGCGGATTACTGTTAGCCCTCGGATTTC G V S Y M V P F V A A G G L L L A L G F G V S Y M V P F V A A G G L L L A L G F TTTTGGGAGGCTACGACATAGCTGCTGGATGGCAGGCAATTGCCATTCAGCATTCGTTCA L L G G Y D I A A G W Q A I A I Q H S F L F G G Y D M A N G W S A I A T N H S L CTGATCTGCCCAGCCACGATGTGGTCATCGATATAGCAACAGGACAG*TC*GTATCATTT T D L P S H D V V I D G Q V S F T N L P G N T V E V D --------- G E *M** M E F CAGCGCTCTGGCCTTTTGCTTTATCTTGGCGCTGTGGCTTTTGCTATCGACTCAATGTCA Q R S G L L L Y L G A V A F A I D S M S A R S G F L L Y L G A V L F A T G Q G A ATGCAATTTATTGTGGCTGCACTTTCAGGATACATTGCGTTTGCTATCGCTGGACGCTCA M Q F I V A A L S G Y I A F A I A G R S M G F I V A A L S G Y T A Y A L A G R P GGAATAGCTCCAGGTTATATCGGCGGTGCGGTATCAGTCTTCGTTGGCGCAGGCTTTTTG G I A P G Y I G G A V S V F V G A G F L G I A P G F V G G A I S V A I G A G F I GGCGGATTAGTCACCGGGCTACTGTCTGGAACGCTTGCATGGTGGCTTTCTACGAGGCGG G G L V T G L L S G T L A W W L S T R R G G L V T G I L A G L I A A W I G S W K GTTCCCGCACTTATCTCGTCGCTTATGCCCGTAGTAATTGTTCCGCTCATTTCCAGTCTT V P A L I S S L M P V V I V P L I S S L V P R V V Q S L M P V V I I P L L T S L *TT*GTGGGTTTGATCATGTTCTTAGTTTTAGGCAAACCCCTTTCATTGTTGCTGTTATC V G L I M F L V L G K P L S L L L L S *V** V G L V M Y L L L G R P L A W I M T S CCTCCAAAACTGGCTGGCAGGACTATCGGGTTCTTCAGCCATCATTCTTGGGGCAGTGCT L Q N W L A G L S G S S A I I L G A V L L Q D W L G S M S G S S A V V L G I I L GGGACTTATGATGTGTTTCGACCTCGGTGGCCCTGTAAATAAAGCAGCATATTTATTTGT G L M M C F D L G G P V N K A A Y L F V G L M M C F D L G G P V N K A A Y L F A TACCGCAGGCCTGTCCACCAATGAACCTGCTGCGCTTCATATTATGGCGGCAGTCATGGT T A G L S T N E P A A L H I M A A V M V T A G L S T G D E A S L Q I M A T V M A CGCAGGTATGCTCCCCCCCCGATTGCACTTTCTTTAGCCACCATTATGGATAAAAAAGTG A G M L P P I A L S L A T I M D K K V A G M V P P -- I A M S L A T I L R A R L TTTACAGATACCGAACGAGAAAACGGAAAATCAGCGTGGCTTTTAGGACTTTCCTTCATT F T D T E R E N G K S A W L L G L S F I F T P A E Q E N G K S S W L L G L A F I TCTGAAGGAGCGATCCCTTTTTACCGCAGGTGAT*CG*ATTAGGGTGATACCATCATTGA S E G A I P F T A G D I R V I P S L S E G A I P F - A A A D *P** L R V I P S M TGATTGGAGGCGCATCAGCTGGCGCAATTTCCATGGGGACCACGACTGGCTCGCATGCTC M I G G A S A G A I S M G T T T G S H A M L G G A T T G A I S M A L G V G S R A CGCATGGCGGAATTTTTGTACTCTTTGCGATTTCTCCAGCGTGGACATTCCTCTTAGCTT P H G G I F V L F A I S P A W T F L L A P H G G I F V I W A I E P W W G W L I A TACTCATTGGCGTGAAGGTTTCCGCGCTCATTGTCATTCTCTTAAAGCGTATGTGGCCC- L L I G V K V S A L I V I L L K R M W P L I A G T A V S T I A V V A L K Q F W P N ---------------GTTCCAATCTCCACGACTTCGTACAGTAAAGACAGTACGGCGGCC V P I S T T S Y S KAVEAAAAAAATQTG A P G S T P A T A ------------------ TAA --- // >fig|6666666.67449.peg.2109 fig|196164.1.peg.2845 D-amino acid dehydrogenase small subunit (EC 1.4.99.1) FIG054875 gi|372109441|gb|CP003213.1|_2138282_2138106,gi|372109441|gb|CP003213.1|_2138104_2137076 MANHSIVIGAGMVGLSTTWFLRKAGHEVTVIDRDGVAAGSSWGNAGWLSPGQGHPAGKPELWRYTPQTFLDPDAALHVPLVPDLKVVDFGVRFMANANQRAWDRTMKALDAYDELVEGGVESWNKDSPFIIAFKNEAEAAGFIEEVEGAVRHGQEVPFEEISNPRDFVPHLSDSVNLVFKLGNQRYFEPSPFCHKLADALRSRGVEIRTGASVVDVQSTRKPVVELSTGERLQADNVVIATGAWLPKLARRLGVRTRVQAGRGYSFSVDTGENSIDYPVYLPAQRLACTPYQGCFRIAGTMEFRDADAPFDPKRVQSMIKYASEMFTGIVFDERQDEWVGSRPVTPDGLPLIGATKAPNVYVAGGHGMWGAVLGPASGRALAHLIETGETLPEIRDFDPLR We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGGCAAATCATTCAATCGTTATCGGCGCGGGCATGGTGGGTTTGTCCACCACCTGGTTC V A N H S I V I G A G M V G L S T T W F M A N H S I V I G A G M V G L S T T W F CTGCGTAAAGCTGGACACGAGGTCACGGTCATTGACCGCGACGGCGTGGCAGCCGGCTCC L R K A G H E V T V I D R D G V A A G S L R K A G H E V T V I D R D G V A A G S TCGTGGGGCAACGCCGGTTGGTTGAGCCCAGGGCAAGGCCATCCCGCTGGCAAACCACGA S W G N A G W L S P G Q G H P A G K P E S W G N A G W L S P G Q G H P A G K P - E GCTGTGGCGCTACACCCCTCAGACATTCCTCGACCCGGACGCAGCACTGCACGTGCCGCT L W R Y T P Q T F L D P D A A L H V P L L W R Y T P Q T F L D P D A A L H V P L GGTTCCGGACCTCAAGGTCGTGGACTTCGGTGTACGTTTCATGGCGAACGCGAACCAGCG V P D L K V V D F G V R F M A N A N Q R V P D L K V V D F G V R F M A N A N Q R CGCCTGGGACCGCACCATGAAGGCGCTGGACGCATACGACGAGCTCGTTGAGGGCGGCGT A W D R T M K A L D A Y D E L V E G G V A W D R T M K A L D A Y D E L V E G G V GGAATCCTGGAACAAGGACAGTCCATTTATCATCGCCTTCAAAAACGAGGCAGAGGCCGC E S W N K D S P F I I A F K N E A E A A E S W N K D S P F I I A F K N E A E A A CGGATTCATCGAAGAGGTCGAAGGCGCCGTACGCCACGGCCAAGAAGTGCCTTTCGAGGA G F I E E V E G A V R H G Q E V P F E E G F I E E V E G A V R H G Q E V P F E E AATTTCCAATCCTCGCGACTTCGTCCCACACCTGTCTGACTCGGTGAACCTCGTATTCAA I S N P R D F V P H L S D S V N L V F K I S N P R D F V P H L S D S V N L V F K GCTGGGCAACCAGCGCTACTTTGAGCCGAGCCCCTTCTGCCACAAGCTTGCCGACGCCCT L G N Q R Y F E P S P F C H K L A D A L L G N Q R Y F E P S P F C H K L A D A L CCGCTCCCGCGGCGTCGAAATCCGCACCGGCGCTTCCGTGGTGGATGTCCAGTCCACCCG R S R G V E I R T G A S V V D V Q S T R R S R G V E I R T G A S V V D V Q S T R CAAGCCAGTAGTTGAGCTCTCTACGGGTGAGCGCCTGCAGGCGGACAACGTGGTTATCGC K P V V E L S T G E R L Q A D N V V I A K P V V E L S T G E R L Q A D N V V I A AACTGGTGCGTGGCTGCCGAAGCTAGCTCGCCGCCTTGGCGTTCGTACCCGCGTACAAGC T G A W L P K L A R R L G V R T R V Q A T G A W L P K L A R R L G V R T R V Q A AGGCCGCGGTTATTCCTTCAGCGTCGACACCGGCGAGAATTCCATCGACTATCCGGTCTA G R G Y S F S V D T G E N S I D Y P V Y G R G Y S F S V D T G E N S I D Y P V Y CCTGCCAGCCCAGCGTCTCGCCTGCACCCCGTACCAGGGCTGTTTCCGCATCGCCGGAAC L P A Q R L A C T P Y Q G C F R I A G T L P A Q R L A C T P Y Q G C F R I A G T CATGGAGTTCCGGGACGCGGATGCGCCATTCGATCCAAAGCGCGTGCAGTCCATGATCAA M E F R D A D A P F D P K R V Q S M I K M E F R D A D A P F D P K R V Q S M I K GTACGCGAGTGAGATGTTCACCGGCATCGTCTTCGACGAGCGTCAGGACGAGTGGGTGGG Y A S E M F T G I V F D E R Q D E W V G Y A S E M F T G I V F D E R Q D E W V G CAGCCGCCCAGTCACCCCAGACGGCCTGCCCCTCATCGGTGCTACCAAGGCGCCGAACGT S R P V T P D G L P L I G A T K A P N V S R P V T P D G L P L I G A T K A P N V TTACGTCGCCGGCGGCCATGGCATGTGGGGCGCTGTCCTCGGCCCAGCTTCCGGCCGCGC Y V A G G H G M W G A V L G P A S G R A Y V A G G H G M W G A V L G P A S G R A ACTGGCACACCTCATTGAGACAGGGGAGACGCTGCCGGAAATTCGGGATTTCGACCCGCT L A H L I E T G E T L P E I R D F D P L L A H L I E T G E T L P E I R D F D P L GCGTTAG R R --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2845): GTGGCAAATCATTCAATCGTTATCGGCGCGGGCATGGTGGGTTTGTCCACCACCTGGTTC V A N H S I V I G A G M V G L S T T W F M M S R V I V I G A G M V G L A T A W H CTGCGTAAAGCTGGACACGAGGTCACGGTCATTGACCGCGACGGCGTGGCAGCCGGCTCC L R K A G H E V T V I D R D G V A A G S L Q E R G Y E V T V L D R E G V A A G S TCGTGGGGCAACGCCGGTTGGTTGAGCCCAGGGCAAGGCCATCCCGCTGGCAAACCACGA S W G N A G W L S P G K A I P L A N H E S W G N A G W L T P A - K T L P L A D P V GCTGTGGCGCTACACCCCTCAGACATTCCTCGACCCGGACGCAGCACTGCACGTGCCGCT L W R Y T P Q T F L D P D A A L H V P L L W K Y G P R T L F D P D S P L H M P F GGTTCCGGACCTCAAGGTCGTGGACTTCGGTGTACGTTTCATGGCGAACGCGAACCAGCG V P D L K V V D F G V R F M A N A N Q R R V D P K L W L F L A R F M A N A T T N CGCCTGGGACCGCACCATGAAGGCGCTG--------GACGCATACGACGAGCTCGTTGAG A W D R T M K A L D A Y D E L V E R W D D A L R A L TPISMVAL E A F D E L G Q GGCGGCGTGGAATCCTGGAACAAGGACAGTCCATTTATCATCGCCTTCAAAAACGAGGCA G G V E S W N K D S P F I I A F K N E A G G V D G L T Y K K P F I I G F E N E D GAGGCCGCCGGATTCATCGAAGAGGTCGAAGGCGCCGTACGCCACGGCCAAGAAGTGCCT E A A G F I E E V E G A V R H G Q E V P Q S A G F L R E V E A V R R H G Q D V E TTCGAGGAAATTTCCAATCCTCGCGACTTCGTCCCACACCTGTCTGACTCGGTGAACCTC F E E I S N P R D F V P H L S D S V N L M T R L D N P Q D F A P M L N D Q V P V GTATTCAAGCTGGGCAACCAGCGCTACTTTGAGCCGAGCCCCTTCTGCCACAAGCTTGCC V F K L G N Q R Y F E P S P F C H K L A A Y S M E G Q R F I E P G P Y M E S L A GACGCCCTCCGCTCCCGCGGCGTCGAAATCCGCACCGGCGCTTCCGTGGTGGATGTCCAG D A L R S R G V E I R T G A S V V D V Q R S V E Q R G G E I R T G V E V T R V A TCCACCCGCAAGCCAGTAGTTGAGCTCTCTACGGGTGAGCGCCTGCAGGCGGACAACGTG S T R K P V V E L S T G E R L Q A D N V A G D R P A V L F R D G S R H E A D K V GTTATCGCAACTGGTGCGTGGCTGCCGAAGCTAGCTCGCCGCCTTGGCGTTCGTACCCGC V I A T G A W L P K L A R R L G V R T R V I A T G A W L P A L A R D Y G V K T I GTACAAGCAGGCCGCGGTTATTCCTTCAGCGTCGACACCGGCGAGAATTCCATCGACTAT V Q A G R G Y S F S V D T E N S I D Y V Q A G R G Y S F S V A T --- E H P A E H CCGGTCTACCTGCCAGCCCAGCGTCTCGCCTGCACCCCGTACCAGGGCTGTTTCCGCATC P V Y L P A Q R L A C T P Y Q G C F R I S L Y L P H H R M A C T P Y Q G R F R I GCCGGAACCATGGAGTTCCGGGACGCGGATGCGCCATTCGATCCAAAGCGCGTGCAGTCC A G T M E F R D A D A P F D P K R V Q S A G T M E F R G P D E P L D P H R I Q A ATGATCAAGTACGCGAGTGAGATGTTCACCGGCATCGTCTTCGACGAGCGTCAGGACGAG M I K Y A S E M F T G I V F D E R Q D E I V N Q A S R L M R G I D F D D R R D E TGGGTGGGCAGCCGCCCAGTCACCCCAGACGGCCTGCCCCTCATCGGTGCTACCAAGGCG W V G S R P V T P D G L P L I G A T K A W V G S R P V S T D G K P L V G Q T N A CCGAACGTTTACGTCGCCGGCGGCCATGGCATGTGGGGCGCTGTCCTCGGCCCAGCTTCC P N V Y V A G G H G M W G A V L G P A S R D I Y V A G G H G M W G I V L G P A T GGCCGCGCACTGGCACACCTCATTGAGACAGGGGAGACGCTGCCGGAAATTCGGGATTTC G R A L A H L I E T G E T L P E I R D F G K Y L A E L M D T G I T H P V I A P F GACCCGCTGCGTTAG D P L R D P L R --- // >fig|6666666.67449.peg.757 fig|257309.1.peg.728 Putative membrane protein gi|372109441|gb|CP003213.1|_736872_736471,gi|372109441|gb|CP003213.1|_736467_736225 MAHFSFPIDADFAAKNNELLKDTKRLQISAGLFGIIQILIGVGLYFWLGGAFGIICLAVFAIMALISFAMIFVVPKQVGNAQHLYDNYDLVPAMIAEVNPRDMVVMALVNTNVNPTLPPRWALATRNITAIPGIxGDTRKVGTRIPAVAVTGQRSVGNQDSWDQISPMPIAWATPDSSVIARAESTIPSEQWTTLSKNLNKLDQVRETKFDLLEL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCACACTTCTCCTTCCCCATCGACGCCGACTTCGCCGCAAAAAACAACGAGCTGCTC M A H F S F P I D A D F A A K N N E L L M A H F S F P I D A D F A A K N N E L L AAAGACACCAAACGTCTCCAGATCTCCGCTGGTCTATTTGGAATCATTCAGATCCTCATC K D T K R L Q I S A G L F G I I Q I L I K D T K R L Q I S A G L F G I I Q I L I GGCGTTGGCCTTTACTTCTGGCTCGGCGGTGCATTCGGCATCATCTGTCTTGCAGTATTC G V G L Y F W L G G A F G I I C L A V F G V G L Y F W L G G A F G I I C L A V F GCCATCATGGCACTGATTAGCTTCGCCATGATCTTCGTTGTGCCCAAACAAGTAGGAAAC A I M A L I S F A M I F V V P K Q V G N A I M A L I S F A M I F V V P K Q V G N GCACAACACCTCTACGACAACTACGACCTCGTCCCCGCCATGATCGCCGAAGTCAACCCC A Q H L Y D N Y D L V P A M I A E V N P A Q H L Y D N Y D L V P A M I A E V N P CGCGACATGGTTGTCATGGCCCTAGTCAACACCAACGTCAACCCCACCCTTCCACCCCGA R D M V V M A L V N T N V N P T L P P R R D M V V M A L V N T N V N P T L P P R TGGGCTCTTGCAACGCGCAACATCACCGCAATCCCAGGCATCTAAGGCGACACCCGAAAA W A L A T R N I T A I P G I * G D T R K W A L A T R N I T A I P G I X G D T R K GTAGGCACCCGCATCCCAGCAGTCGCTGTCACAGGCCAACGCTCCGTGGGGAACCAAGAC V G T R I P A V A V T G Q R S V G N Q D V G T R I P A V A V T G Q R S V G N Q D TCATGGGACCAAATTTCCCCCATGCCCATTGCATGGGCTACTCCAGATTCTTCAGTGATT S W D Q I S P M P I A W A T P D S S V I S W D Q I S P M P I A W A T P D S S V I GCTCGGGCAGAATCGACGATTCCTTCCGAACAATGGACCACATTGAGCAAGAACCTGAAT A R A E S T I P S E Q W T T L S K N L N A R A E S T I P S E Q W T T L S K N L N AAGCTAGATCAAGTACGCGAAACAAAATTTGATCTACTGGAGTTGTAA K L D Q V R E T K F D L L E L K L D Q V R E T K F D L L E L --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.728): ATGGCACACTTCTCCTTCCCCATCGACGCCGACTTCGCCGCAAAAAACAACGAGCTGCTC M A H F S F P I D A D F A A K N N E L L M A H F S F P I D A D F A A K N N E L L AAAGACACCAAACGTCTCCAGATCTCCGCTGGTCTATTTGGAATCATTCAGATCCTCATC K D T K R L Q I S A G L F G I I Q I L I K D T K R L Q L S A G L F G I I Q I L I GGCGTTGGCCTTTACTTCTGGCTCGGCGGTGCATTCGGCATCATCTGTCTTGCAGTATTC G V G L Y F W L G G A F G I I C L A V F G V G L Y F W L G G A F G I I C L A V F GCCATCATGGCACTGATTAGCTTCGCCATGATCTTCGTTGTGCCCAAACAAGTAGGAAAC A I M A L I S F A M I F V V P K Q V G N A I M A L I S F A M I F V V P K Q V G N GCACAACACCTCTACGACAACTACGACCTCGTCCCCGCCATGATCGCCGAAGTCAACCCC A Q H L Y D N Y D L V P A M I A E V N P A Q H L Y D N Y D L V P A M I A E V N P CGCGACATGGTTGTCATGGCCCTAGTCAACACCAACGTCAACCCCACCCTTCCACCCCGA R D M V V M A L V N T N V N P T L P P R R D M V V M A L V N T N V D P T L P P R TGGGCTCTTGCAACGCGCAACATCACCGCAATCCCAGGCATCTAAGGCGACACCCGAAAA W A L A T R N I T A I P G I * G D T R K W A L A T R N I T A I P G I E G D T R K GTAGGCACCCGCATCCCAGCAGTCGCTGTCACAGGCCAACGCTCCGTGGGGAACCAAGAC V G T R I P A V A V T G Q R S V G N Q D V G T R I P A V A V T G Q R S V G N Q D TCATGGGACCAAATTTCCCCCATGCCCATTGCATGGGCTACTCCAGATTCTTCAGTGATT S W D Q I S P M P I A W A T P D S S V I S W D Q I S P M P I A W A T P D S S V I GCTCGGGCAGAATCGACGATTCCTTCCGAACAATGGACCACATTGAGCAAGAACCTGAAT A R A E S T I P S E Q W T T L S K N L N A R A E S T I P S E Q W T T L S K N L N AAGCTAGATCAAGTACGCGAAACAAAATTTGATCTACTGGAGTTGTAA K L D Q V R E T K F D L L E L K L D Q V R E T K F D L L E L --- // >fig|6666666.67449.peg.1851 fig|196164.1.peg.2387 Thiol peroxidase, Bcp-type (EC 1.11.1.15) FIG132548 gi|372109441|gb|CP003213.1|_1873004_1873069,gi|372109441|gb|CP003213.1|_1873073_1873588 MSLISRATVKLLEVLLNSPPTLxPQIILSCRAGILETMTENIRLAVGDTAPSFSLPNDTGTTTSLSDYSGQRVLVYFYPRANTPGCTKEACDFRDSLAQLNDLGIAVVGISPDKVDKLAAFRDDYDLTFPLLSDATKEVMTAYGAFGEKKNYGKIVQGVIRSTFVIGADGRIELALYNVRATGHVARVVKELTK We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGTCGTTAATATCGCGTGCCACGGTAAAACTCCTTGAGGTTTTGTTGAATAGTCCCCCT M S L I S R A T V K L L E V L L N S P P M S L I S R A T V K L L E V L L N S P P ACACTTTAGCCCCAAATCATTCTTTCGTGTCGAGCCGGTATCCTCGAAACCATGACTGAG T L * P Q I I L S C R A G I L E T M T E T L X P Q I I L S C R A G I L E T M T E AACATTCGTCTTGCCGTCGGCGACACCGCGCCAAGTTTTTCTTTACCCAACGATACAGGC N I R L A V G D T A P S F S L P N D T G N I R L A V G D T A P S F S L P N D T G ACCACCACCAGCCTGAGCGACTACTCCGGTCAGCGCGTACTGGTCTACTTCTACCCACGC T T T S L S D Y S G Q R V L V Y F Y P R T T T S L S D Y S G Q R V L V Y F Y P R GCCAACACCCCAGGCTGCACCAAGGAAGCCTGCGACTTCCGCGACAGCCTCGCCCAGCTC A N T P G C T K E A C D F R D S L A Q L A N T P G C T K E A C D F R D S L A Q L AACGACCTCGGAATCGCCGTGGTAGGTATCTCCCCCGACAAGGTAGATAAGCTCGCCGCC N D L G I A V V G I S P D K V D K L A A N D L G I A V V G I S P D K V D K L A A TTCCGCGACGACTACGATCTCACCTTCCCGCTGCTCTCCGATGCCACCAAGGAAGTCATG F R D D Y D L T F P L L S D A T K E V M F R D D Y D L T F P L L S D A T K E V M ACCGCCTACGGTGCTTTTGGTGAGAAGAAAAACTACGGCAAAATTGTTCAAGGAGTCATC T A Y G A F G E K K N Y G K I V Q G V I T A Y G A F G E K K N Y G K I V Q G V I CGCTCCACCTTTGTGATCGGTGCCGACGGTCGCATAGAACTCGCCCTCTACAATGTGCGT R S T F V I G A D G R I E L A L Y N V R R S T F V I G A D G R I E L A L Y N V R GCTACCGGACACGTGGCCCGCGTGGTTAAAGAACTGACCAAGTAA A T G H V A R V V K E L T K A T G H V A R V V K E L T K --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2387): ATGTCGTTAATATCGCGTGCCACGGTAAAACT----CCTTGAGGTTTTGTTGAATAGTCC G K T P V L L N S P ----------------------- M K T RYCG P ---- I L L N S S CCCTACACTTTAGCCCCAAATCATTCTTTCGTGTCGAGCCGGTATCCTCGAAACCATGAC P T L * P Q I I L S C R A G I L E T M T P E R T P I P E N T T A P A I V E V M T TGAGAACATTCGTCTTGCCGTCGGCGACACCGCGCCAAGTTTTTCTTTACCCAACGATAC E N I R L A V G D T A P S F S L P N D T D A R R L D V G D T P P A F T L P N D S AGGCACCACCACCAGCCTGAGCGACTACTCCGGTCAGCGCGTACTGGTCTACTTCTACCC G T T T S L S D Y S G Q R V L V Y F Y P G S T T S L S D F A G E R V V V Y F Y P ACGCGCCAACACCCCAGGCTGCACCAAGGAAGCCTGCGACTTCCGCGACAGCCTCGCCCA R A N T P G C T K E A C D F R D S L A Q K A N T P G C T K E A C D F R D S L A Q GCTCAACGACCTCGGAATCGCCGTGGTAGGTATCTCCCCCGACAAGGTAGATAAGCTCGC L N D L G I A V V G I S P D K V D K L A L N D L G V K V I G I S P D P V D K L V CGCCTTCCGCGACGACTACGATCTCACCTTCCCGCTGCTCTCCGATGCCACCAAGGAAGT A F R D D Y D L T F P L L S D A T K E V K F R E D H D L N F P L L S D E D K A V CATGACCGCCTACGGTGCTTTTGGTGAGAAGAAAAACTACGGCAAAATTGTTCAAGGAGT M T A Y G A F G E K K N Y G K I V Q G V M T A W G A F G E K K N Y G K I V Q G V CATCCGCTCCACCTTTGTGATCGGTGCCGACGGTCGCATAGAACTCGCCCTCTACAATGT I R S T F V I G A D G R I E L A L Y N V I R S T F V I E P D G T V G L A K Y N V GCGTGCTACCGGACACGTGGCCCGCGTGGTTAAAGAACTGACCAAGTAA R A T G H V A R V V K E L T K * R A T G H V A R I L R D L E A A // >fig|6666666.67449.peg.758 fig|257309.1.peg.728 Putative membrane protein gi|372109441|gb|CP003213.1|_736872_736471,gi|372109441|gb|CP003213.1|_736467_736225 MAHFSFPIDADFAAKNNELLKDTKRLQISAGLFGIIQILIGVGLYFWLGGAFGIICLAVFAIMALISFAMIFVVPKQVGNAQHLYDNYDLVPAMIAEVNPRDMVVMALVNTNVNPTLPPRWALATRNITAIPGIxGDTRKVGTRIPAVAVTGQRSVGNQDSWDQISPMPIAWATPDSSVIARAESTIPSEQWTTLSKNLNKLDQVRETKFDLLEL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCACACTTCTCCTTCCCCATCGACGCCGACTTCGCCGCAAAAAACAACGAGCTGCTC M A H F S F P I D A D F A A K N N E L L M A H F S F P I D A D F A A K N N E L L AAAGACACCAAACGTCTCCAGATCTCCGCTGGTCTATTTGGAATCATTCAGATCCTCATC K D T K R L Q I S A G L F G I I Q I L I K D T K R L Q I S A G L F G I I Q I L I GGCGTTGGCCTTTACTTCTGGCTCGGCGGTGCATTCGGCATCATCTGTCTTGCAGTATTC G V G L Y F W L G G A F G I I C L A V F G V G L Y F W L G G A F G I I C L A V F GCCATCATGGCACTGATTAGCTTCGCCATGATCTTCGTTGTGCCCAAACAAGTAGGAAAC A I M A L I S F A M I F V V P K Q V G N A I M A L I S F A M I F V V P K Q V G N GCACAACACCTCTACGACAACTACGACCTCGTCCCCGCCATGATCGCCGAAGTCAACCCC A Q H L Y D N Y D L V P A M I A E V N P A Q H L Y D N Y D L V P A M I A E V N P CGCGACATGGTTGTCATGGCCCTAGTCAACACCAACGTCAACCCCACCCTTCCACCCCGA R D M V V M A L V N T N V N P T L P P R R D M V V M A L V N T N V N P T L P P R TGGGCTCTTGCAACGCGCAACATCACCGCAATCCCAGGCATCTAAGGCGACACCCGAAAA W A L A T R N I T A I P G I * G D T R K W A L A T R N I T A I P G I X G D T R K GTAGGCACCCGCATCCCAGCAGTCGCTGTCACAGGCCAACGCTCCGTGGGGAACCAAGAC V G T R I P A V A V T G Q R S V G N Q D V G T R I P A V A V T G Q R S V G N Q D TCATGGGACCAAATTTCCCCCATGCCCATTGCATGGGCTACTCCAGATTCTTCAGTGATT S W D Q I S P M P I A W A T P D S S V I S W D Q I S P M P I A W A T P D S S V I GCTCGGGCAGAATCGACGATTCCTTCCGAACAATGGACCACATTGAGCAAGAACCTGAAT A R A E S T I P S E Q W T T L S K N L N A R A E S T I P S E Q W T T L S K N L N AAGCTAGATCAAGTACGCGAAACAAAATTTGATCTACTGGAGTTGTAA K L D Q V R E T K F D L L E L K L D Q V R E T K F D L L E L --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.728): ATGGCACACTTCTCCTTCCCCATCGACGCCGACTTCGCCGCAAAAAACAACGAGCTGCTC M A H F S F P I D A D F A A K N N E L L M A H F S F P I D A D F A A K N N E L L AAAGACACCAAACGTCTCCAGATCTCCGCTGGTCTATTTGGAATCATTCAGATCCTCATC K D T K R L Q I S A G L F G I I Q I L I K D T K R L Q L S A G L F G I I Q I L I GGCGTTGGCCTTTACTTCTGGCTCGGCGGTGCATTCGGCATCATCTGTCTTGCAGTATTC G V G L Y F W L G G A F G I I C L A V F G V G L Y F W L G G A F G I I C L A V F GCCATCATGGCACTGATTAGCTTCGCCATGATCTTCGTTGTGCCCAAACAAGTAGGAAAC A I M A L I S F A M I F V V P K Q V G N A I M A L I S F A M I F V V P K Q V G N GCACAACACCTCTACGACAACTACGACCTCGTCCCCGCCATGATCGCCGAAGTCAACCCC A Q H L Y D N Y D L V P A M I A E V N P A Q H L Y D N Y D L V P A M I A E V N P CGCGACATGGTTGTCATGGCCCTAGTCAACACCAACGTCAACCCCACCCTTCCACCCCGA R D M V V M A L V N T N V N P T L P P R R D M V V M A L V N T N V D P T L P P R TGGGCTCTTGCAACGCGCAACATCACCGCAATCCCAGGCATCTAAGGCGACACCCGAAAA W A L A T R N I T A I P G I * G D T R K W A L A T R N I T A I P G I E G D T R K GTAGGCACCCGCATCCCAGCAGTCGCTGTCACAGGCCAACGCTCCGTGGGGAACCAAGAC V G T R I P A V A V T G Q R S V G N Q D V G T R I P A V A V T G Q R S V G N Q D TCATGGGACCAAATTTCCCCCATGCCCATTGCATGGGCTACTCCAGATTCTTCAGTGATT S W D Q I S P M P I A W A T P D S S V I S W D Q I S P M P I A W A T P D S S V I GCTCGGGCAGAATCGACGATTCCTTCCGAACAATGGACCACATTGAGCAAGAACCTGAAT A R A E S T I P S E Q W T T L S K N L N A R A E S T I P S E Q W T T L S K N L N AAGCTAGATCAAGTACGCGAAACAAAATTTGATCTACTGGAGTTGTAA K L D Q V R E T K F D L L E L K L D Q V R E T K F D L L E L --- // >fig|6666666.67449.peg.2040 fig|196627.4.peg.994 Transposase gi|372109441|gb|CP003213.1|_2074020_2074853,gi|372109441|gb|CP003213.1|_2074853_2075233 MSQEHSIDIFLGLDVGKSEHHACALDRDGNKVFDKPLPQLESDLASVFHQLQEHGTVLVVVDQPNTIGALPIAVARACGCEVGYLPGLAMRKAADLYPGRAKTDKRDAFIIADTARTMPHTLRAVDRNNEVLSALKMLSGFDDDIARDCTRTVNRLRSILTQIYPSLERVLAGSTLTRTPILDMLIHYKGPQGLKRAGYHRVLNWMIKHTRKDPTPLVDEIFAALKAQTVTVPGSDAAELVIPQLAANIKALKEQRDTIAEQVEGMLDDFPLCEVLDxxMPGVGIKTATQILLAIGDGSDFDSAGHLAAYAGIAPVTRRSGSSIRGEFPARSGNKRLKNALFYSAFAAIRSHEPSRQYYERKRAEGKRHNAAVICLARRRCNVIYAMLKNKEFFREIPPRPVAA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGTCGCAGGAACACTCCATCGACATATTCCTCGGCCTAGACGTCGGCAAATCTGAACAC M S Q E H S I D I F L G L D V G K S E H M S Q E H S I D I F L G L D V G K S E H CACGCCTGCGCTCTCGACCGCGACGGCAACAAAGTATTCGACAAACCATTGCCTCAACTC H A C A L D R D G N K V F D K P L P Q L H A C A L D R D G N K V F D K P L P Q L GAGTCCGATCTAGCAAGCGTTTTCCACCAGCTTCAAGAGCATGGCACGGTGCTCGTGGTC E S D L A S V F H Q L Q E H G T V L V V E S D L A S V F H Q L Q E H G T V L V V GTCGATCAACCCAATACCATCGGCGCACTACCGATTGCTGTAGCCCGTGCCTGCGGATGC V D Q P N T I G A L P I A V A R A C G C V D Q P N T I G A L P I A V A R A C G C GAAGTCGGATACCTACCAGGCCTAGCCATGCGCAAAGCTGCAGATCTCTATCCAGGCCGT E V G Y L P G L A M R K A A D L Y P G R E V G Y L P G L A M R K A A D L Y P G R GCGAAAACAGACAAACGCGACGCCTTCATCATCGCCGACACCGCCCGAACAATGCCTCAC A K T D K R D A F I I A D T A R T M P H A K T D K R D A F I I A D T A R T M P H ACGCTGCGTGCCGTCGACCGAAACAACGAAGTTCTATCAGCATTGAAAATGCTCTCCGGC T L R A V D R N N E V L S A L K M L S G T L R A V D R N N E V L S A L K M L S G TTCGATGACGACATCGCCCGCGATTGCACCCGCACCGTCAACCGACTACGCAGCATCCTT F D D D I A R D C T R T V N R L R S I L F D D D I A R D C T R T V N R L R S I L ACCCAGATCTACCCCAGCCTGGAACGAGTTCTTGCTGGCAGCACCCTAACTCGCACCCCA T Q I Y P S L E R V L A G S T L T R T P T Q I Y P S L E R V L A G S T L T R T P ATCCTGGACATGCTGATCCACTACAAAGGGCCACAAGGGCTGAAACGAGCCGGATACCAT I L D M L I H Y K G P Q G L K R A G Y H I L D M L I H Y K G P Q G L K R A G Y H CGGGTGCTGAACTGGATGATCAAGCACACACGAAAAGACCCTACCCCGCTGGTAGACGAG R V L N W M I K H T R K D P T P L V D E R V L N W M I K H T R K D P T P L V D E ATTTTTGCAGCACTAAAAGCGCAAACAGTCACCGTACCAGGAAGCGATGCCGCCGAGCTC I F A A L K A Q T V T V P G S D A A E L I F A A L K A Q T V T V P G S D A A E L GTCATTCCCCAACTAGCTGCAAACATCAAGGCGTTAAAAGAGCAGCGCGACACCATTGCT V I P Q L A A N I K A L K E Q R D T I A V I P Q L A A N I K A L K E Q R D T I A GAACAGGTTGAGGGGATGCTTGATGATTTCCCTCTTTGTGAGGTCTTGGAT*AG*AGCAT E Q V E G M L D D F P L C E V L D S M E Q V E G M L D D F P L C E V L D *X** X M GCCCGGAGTCGGCATCAAGACCGCAACACAGATCCTCCTGGCGATCGGTGACGGCTCCGA P G V G I K T A T Q I L L A I G D G S D P G V G I K T A T Q I L L A I G D G S D CTTCGATAGCGCCGGCCACCTGGCCGCTTACGCGGGCATCGCACCAGTGACACGACGATC F D S A G H L A A Y A G I A P V T R R S F D S A G H L A A Y A G I A P V T R R S AGGATCATCAATCAGAGGCGAATTCCCAGCACGATCAGGCAATAAGCGACTGAAAAACGC G S S I R G E F P A R S G N K R L K N A G S S I R G E F P A R S G N K R L K N A TTTGTTCTACTCCGCATTTGCCGCGATCCGCAGCCACGAACCGTCACGACAGTACTACGA L F Y S A F A A I R S H E P S R Q Y Y E L F Y S A F A A I R S H E P S R Q Y Y E GCGTAAACGCGCCGAAGGTAAACGCCATAACGCGGCAGTTATCTGCCTGGCACGACGCCG R K R A E G K R H N A A V I C L A R R R R K R A E G K R H N A A V I C L A R R R ATGCAACGTCATCTACGCAATGCTGAAAAACAAAGAGTTCTTCCGAGAAATCCCACCACG C N V I Y A M L K N K E F F R E I P P R C N V I Y A M L K N K E F F R E I P P R CCCAGTCGCCGCATAA P V A A P V A A --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.994): ATGTCGCAGGAACACTCCATCGACATATTCCTCGGCCTAGACGTCGGCAAATCTGAACAC H S I D I F L G L D V G K S E H ------------ M A Y D F V I G M D V G K Y F H CACGCCTGCGCTCTCGACCGCGACGGCAACAAAGTATTCGACAAACCATTGCCTCAACTC H A C A L D R D G N K V F D K P L P Q L H A C V L D P Q G R Q V L S K R I N Q H GAGTCCGATCTAGCAAGCGTTTTCCACCAG-CTTCAAGAGCATGGCACGGTGCTCGTGGT E S D L A S V F H Q L Q E H G T V L V V E G S L R K L F D K F L A N D A E V L V V CGTCGATCAACCCAATACCATCGGCGCACTACCGATTGCTGTAGCCCGTGCCTGCGGATG V D Q P N T I G A L P I A V A R A C G C V D Q P N N I G R L T V A V A Q A M G A CGAAGTCGGATACCTACCAGGCCTAGCCATGCGCAAAGCTGCAGATCTCTATCCAGGCCG E V G Y L P G L A M R K A A D L Y P G R D V R Y L P G L A M R Q L S R I H V G N TGCGAAAACAGACAAACGCGACGCCTTCATCATCGCCGACACCGCCCGAACAATGCCTCA A K T D K R D A F I I A D T A R T M P H S K T D V R D A Y V I A H A G L N L P D CACGCTGCGTGCCGTCGACCGAAACAACGAAGTTCTATCAGCATTGAAAATGCTCTCCGG T L R A V D R N N E V L S A L K M L S G A L R S V D R V E E V F L Q L K V L N G CTTCGATGACGACATCGCCCGCGATTGCACCCGCACCGTCAACCGACTACGCAGCATCCT F D D D I A R D C T R T V N R L R S I L I D E D L A R A Y T R L I N Q M Q S A L TACCCAGATCTACCCCAGCCTGGAACGAGTTCTTGCTGGCAGCACCCTAACTCGCACCCC T Q I Y P S L E R V L A G S T L T R T P V G T Y P A F E H V L R G Q M I H R K W AATCCTGGACATGCTGATCCACTACAAAGGGCCACAAGGGCTGAAACGAGCCGGATACCA I L D M L I H Y K G P Q G L K R A G Y H I L H L L A K Y G G P T K I R R V G K A TCGGGTGCTGAACTGGATGATCAAGCACACACGAAAAGACCCTACCCCGCTGGTAGACGA R V L N W M I K H T R K D P T P L V D E R L A A F A R G H R A R N P E P V I D A GATTTTTGCAGCACTAAAAGCGCAAACAGTCACCGTACCAGGAAGCGATGCCGCCGAGCT I F A A L K A Q T V T V P G S D A A E L M L A A I H G Q T V S I A G A E Y A E L CGTCATTCCCCAACTAGCTGCAAACATCAAGGCGTTAAAAGAGCAGCGCGACACCATTGC V I P Q L A A N I K A L K E Q R D T I A G V A M S A K D A L A K L E H R K E I E TGAACAGGTTGAGGGGATGCTTGATGATTTCCCTCTTTGTGAGGTCTTGGATAGAGCATG E Q V E G M L D D F P L C E V L D S M G Q V L E L I Q D I P Q T E I L L -- S M CCCGGAGTCGGCATCAAGACCGCAACACAGATCCTCCTGGCGATCGGTGACGGCTCCGAC P G V G I K T A T Q I L L A I G D G S D P G I G P R S A A Q I L M T V G D M S D TTCGATAGCGCCGGCCACCTGGCCGCTTACGCGGGCATCGCACCAGTGACACGACGATCA F D S A G H L A A Y A G I A P V T R R S F P D A A H L A S Y A G L S P Q T N Q S GGATCATCAATCAGAGGCGAATTCCCAGCACGATCAGGCAATAAGCGACTGAAAAACGCT G S S I R G E F P A R S G N K R L K N A G T S I M S N S P N R A G N K K L K N A TTGTTCTACTCCGCATTTGCCGCGATCCGCAGCCACGAACCGTCACGACAGTACTACGAG L F Y S A F A A I R S H E P S R Q Y Y E L W Q S S F A S I R F H E R S R Q F Y E CGTAAACGCGCCGAAGGTAAACGCCATAACGCGGCAGTTATCTGCCTGGCACGACGCCGA R K R A E G K R H N A A V I C L A R R R R K R N E G K R H N A A V V A L A R R R TGCAACGTCATCTACGCAATGCTGAAAAACAAAGAGTTCTTCCGAGAAATCCCACCACGC C N V I Y A M L K N K E F F R E I P P R L N V L F A M M R S G E L Y R D I P T A CCAGTCGCCGCATAA- P V A A * Q E A A A A // >fig|6666666.67449.peg.2352 fig|257309.1.peg.2323 gi|372109441|gb|CP003213.1|_2420084_2420347,gi|372109441|gb|CP003213.1|_2420351_2420413,gi|372109441|gb|CP003213.1|_2420417_2420431 MLVGGGARVGGPLGIVLVLLVGLAVFALGWFSQVKLVQGNWDPTPWRGGSTTAGAAGPAGAAAGSAQGLTRTYPKVLPPKGAPVPPSRxTGVFRRIFLGTSHQIASKPAVxADLV We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGCTCGTCGGCGGCGGCGCTCGCGTAGGTGGTCCGCTCGGCATCGTCCTAGTACTCTTA M L V G G G A R V G G P L G I V L V L L M L V G G G A R V G G P L G I V L V L L GTTGGTCTTGCAGTCTTCGCCTTAGGCTGGTTCTCGCAGGTCAAGCTGGTGCAGGGTAAC V G L A V F A L G W F S Q V K L V Q G N V G L A V F A L G W F S Q V K L V Q G N TGGGATCCGACACCGTGGCGTGGCGGCTCTACTACAGCGGGTGCTGCTGGTCCTGCTGGT W D P T P W R G G S T T A G A A G P A G W D P T P W R G G S T T A G A A G P A G GCTGCTGCGGGTTCGGCCCAGGGTTTGACCCGTACATACCCGAAGGTCTTGCCACCGAAG A A A G S A Q G L T R T Y P K V L P P K A A A G S A Q G L T R T Y P K V L P P K GGCGCTCCGGTTCCACCGAGCCGCTAAACGGGGGTATTTCGAAGGATTTTTCTTGGCACT G A P V P P S R * T G V F R R I F L G T G A P V P P S R X T G V F R R I F L G T TCACACCAAATCGCTTCCAAACCGGCCGTTTGAGCAGATTTGGTGTGA S H Q I A S K P A V * A D L V S H Q I A S K P A V X A D L V --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2323): ATGCTCGTCGGCGGCGGCGCTCGCGTAGGTGGTCCGCTCGGCATCGTCCTAGTACTCTTA M L V G G G A R V G G P L G I V L V L L M L V G G G A R V G G R L G I V L V I L GTTGGTCTTGCAGTCTTCGCCTTAGGCTGGTTCTCGCAGGTCAAGCTGGTGCAGGGTAAC V G L A V F A L G W F S Q V K L V Q G N V G L A V F A L G W F S Q V K L V Q G N TGGGATCCGACACCGTGGCGTGGCGGCTCTACTACAGCGGGTGCTGCTGGTCCTGCTGGT W D P T P W R G G S T T A G A A G P A W D P T P W R G G F A T A G A A G P A --- GCTGCTGCGGGTTCGGCCCAGGGTTTGACCCGTACATACCCGAAGGTCTTGCCACCGAAG A A G S A Q G L T R T Y P K V L P P K --- A G V P A Q G L T R T Y P K V L P P K GGCGCTCCGGTTCCACCGAGCCGCTAAACGGGGGTATTTCGAAGGATTTTTCTTGGCACT G A P V P P S R * T G V F R R I F L G T G A P V P P S H H S G V F R R I F L G T TCACACCAAATCGCTTCCAAACCGGCCGTTTGAGCAGATTTGGTGTGA S H Q I A S K P A V * A D L V S H Q I A S K P A V W A D L V --- // >fig|6666666.67449.peg.1575 fig|196627.4.peg.1974 rRNA small subunit methyltransferase H # 16S rRNA m(4) C1402 methyltransferase FIG000172 gi|372109441|gb|CP003213.1|_1604825_1603809,gi|372109441|gb|CP003213.1|_1603805_1603752 MTHGEPQEFSFDVEENHGHVPVLRARMAELIAPKVTAMGSDAVIIDGTLGAGGHSKYFLESFPEARVIGLDRDTNSLASARERLKEFGDRFLGIHTRFDRFAPKLEELAQSGNPIAATALEQGISGALFDLGVSSMQLDQAERGFAYRVDAPLDMRMDNTIGITAADVLNTYSHGELARILKTYGDERFAGKIASAIVREREKEPFDTSARLVELLYATIPAATRRTGGHPAKRTFQALRIEVNRELESLENVLPEITQRLTTGGRAVFMSYQSLEDKIVKRYFVDISTSKTPPGLPMELPEYAPKFKVVTRGAEKATDAEIEENPRAASVRVRAIEALxRNQKRNDTNKRSSFGVT We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACTCACGGTGAGCCGCAAGAGTTTTCGTTCGATGTTGAGGAAAACCATGGTCACGTC M T H G E P Q E F S F D V E E N H G H V M T H G E P Q E F S F D V E E N H G H V CCAGTTCTTCGAGCCAGAATGGCTGAGCTGATTGCGCCTAAGGTTACAGCGATGGGGTCA P V L R A R M A E L I A P K V T A M G S P V L R A R M A E L I A P K V T A M G S GATGCTGTCATTATTGATGGCACTCTTGGCGCTGGTGGGCACAGCAAGTATTTTCTTGAA D A V I I D G T L G A G G H S K Y F L E D A V I I D G T L G A G G H S K Y F L E AGCTTCCCCGAAGCTCGAGTTATAGGCCTCGATCGTGATACTAACTCTTTAGCTTCGGCG S F P E A R V I G L D R D T N S L A S A S F P E A R V I G L D R D T N S L A S A CGCGAACGACTAAAAGAATTTGGTGATCGATTCCTCGGTATTCACACCCGTTTCGATCGA R E R L K E F G D R F L G I H T R F D R R E R L K E F G D R F L G I H T R F D R TTTGCCCCGAAATTAGAGGAACTGGCTCAATCTGGAAACCCCATTGCAGCTACTGCATTG F A P K L E E L A Q S G N P I A A T A L F A P K L E E L A Q S G N P I A A T A L GAGCAAGGTATCAGCGGTGCACTTTTCGACCTCGGGGTTTCATCAATGCAGCTTGATCAA E Q G I S G A L F D L G V S S M Q L D Q E Q G I S G A L F D L G V S S M Q L D Q GCAGAGCGAGGATTTGCCTACCGTGTTGATGCGCCACTAGATATGCGCATGGATAACACG A E R G F A Y R V D A P L D M R M D N T A E R G F A Y R V D A P L D M R M D N T ATCGGGATCACTGCAGCTGATGTGTTGAATACCTATAGCCATGGCGAGCTAGCGCGCATC I G I T A A D V L N T Y S H G E L A R I I G I T A A D V L N T Y S H G E L A R I CTTAAAACCTATGGTGACGAGCGTTTCGCAGGAAAAATTGCAAGTGCAATAGTCCGAGAG L K T Y G D E R F A G K I A S A I V R E L K T Y G D E R F A G K I A S A I V R E CGTGAAAAAGAACCATTTGACACTTCGGCTCGTCTAGTTGAGCTGCTTTACGCGACGATT R E K E P F D T S A R L V E L L Y A T I R E K E P F D T S A R L V E L L Y A T I CCTGCAGCTACGCGTCGTACTGGTGGGCATCCAGCCAAGCGAACATTCCAAGCGCTTCGG P A A T R R T G G H P A K R T F Q A L R P A A T R R T G G H P A K R T F Q A L R ATCGAAGTCAATCGAGAATTGGAATCTCTAGAGAATGTACTTCCTGAGATTACGCAGCGT I E V N R E L E S L E N V L P E I T Q R I E V N R E L E S L E N V L P E I T Q R TTGACTACAGGTGGACGAGCAGTGTTCATGTCGTACCAGTCGTTGGAAGACAAAATTGTC L T T G G R A V F M S Y Q S L E D K I V L T T G G R A V F M S Y Q S L E D K I V AAACGTTACTTCGTAGACATTTCTACTTCGAAAACGCCGCCGGGGCTTCCCATGGAGCTA K R Y F V D I S T S K T P P G L P M E L K R Y F V D I S T S K T P P G L P M E L CCGGAATATGCGCCCAAATTCAAAGTAGTGACCCGTGGTGCAGAAAAAGCTACTGACGCG P E Y A P K F K V V T R G A E K A T D A P E Y A P K F K V V T R G A E K A T D A GAAATCGAGGAAAATCCTCGCGCTGCATCAGTAAGAGTTCGAGCAATCGAAGCTCTGTAG E I E E N P R A A S V R V R A I E A L * E I E E N P R A A S V R V R A I E A L X AGAAATCAAAAACGCAATGACACAAACAAACGCAGTAGTTTTGGGGTGACCTAG R N Q K R N D T N K R S S F G V T R N Q K R N D T N K R S S F G V T --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.1974): ATGACTCACGGTGAGCCGCAAGAGTTTTCGTTCGATGTTGAGGAAAACCATGGTCACGTC P Q E F S F D G N H G H V --------------- M E D F S L D ----- G - N H G H V CCAGTTCTTCGAGCCAGAATGGCTGAGCTGATTGCGCCTAAGGTTACAGCGATGGGGTCA P V L R A R M A E L I A P K V T A M G S P V M R D R M A A L I A E H V E A L G E GATGCTGTCATTATTGATGGCACTCTTGGCGCTGGTGGGCACAGCAAGTATTTTCTTGAA D A V I I D G T L G A G G H S K Y F L E N A V I V D A T L G A G G H A E F F L N AGCTTCCCCGAAGCTCGAGTTATAGGCCTCGATCGTGATACTAACTCTTTAGCTTCGGCG S F P E A R V I G L D R D T N S L A S A T F P K A R L I G L D R D Q N A L R D A CGCGAACGACTAAAAGAATTTGGTGATCGATTCCTCGGTATTCACACCCGTTTCGATCGA R E R L K E F G D R F L G I H T R F D R R A R L A P F G E R F I G V Q T R F D G TTTGCCCCGAAATTAGAGGAACTGGCTCAATCTGGAAACCCCATTGCAGCTACTGCATTG F A P K L E E L A G N I A A T A L L R E V L E S V E ------ G D --- I I D L A R GAGCAAGGTATCAGCGGTGCACTTTTCGACCTCGGGGTTTCATCAATGCAGCTTGATCAA E Q G I S G A L F D L G V S S M Q L D Q E H G I A G A L F D L G V S S M Q L D Q GCAGAGCGAGGATTTGCCTACCGTGTTGATGCGCCACTAGATATGCGCATGGATAACACG A E R G F A Y R V D A P L D M R M D N T V E R G F A Y R T D A P L D M R M D A T ATCGGGATCACTGCAGCTGATGTGTTGAATACCTATAGCCATGGCGAGCTAGCGCGCATC I G I T A A D V L N T Y S H G E L A R I Q G I T A A D I L N T Y S H G D I A R I CTTAAAACCTATGGTGACGAGCGTTTCGCAGGAAAAATTGCAAGTGCAATAGTCCGAGAG L K T Y G D E R F A G K I A S A I V R E L K T Y G D E R F A G K I A S A V L K E CGTGAAAAAGAACCATTTGACACTTCGGCTCGTCTAGTTGAGCTGCTTTACGCGACGATT R E K E P F D T S A R L V E L L Y A T I R E K E P F T T S A R L V E L L Y D A I CCTGCAGCTACGCGTCGTACTGGTGGGCATCCAGCCAAGCGAACATTCCAAGCGCTTCGG P A A T R R T G G H P A K R T F Q A L R P A A T R R T G G H P A K R T F Q A L R ATCGAAGTCAATCGAGAATTGGAATCTCTAGAGAATGTACTTCCTGAGATTACGCAGCGT I E V N R E L E S L E N V L P E I T Q R V E V N N E L D S L K N V L P Q I T D A TTGACTACAGGTGGACGAGCAGTGTTCATGTCGTACCAGTCGTTGGAAGACAAAATTGTC L T T G G R A V F M S Y Q S L E D K I V L N V G G R A V F M S Y Q S H E D K L V AAACGTTACTTCGTAGACATTTCTACTTCGAAAACGCCGCCGGGGCTTCCCATGGAGCTA K R Y F V D I S T S K T P P G L P M E L K K F F T D L T T S K T P P G L P V D L CCGGAATATGCGCCCAAATTCAAAGTAGTGACCCGTGGTGCAGAAAAAGCTACTGACGCG P E Y A P K F K V V T R G A E K A T D A P G T A P Q F K Q V T R G A E T A S E A GAAATCGAGGAAAATCCTCGCGCTGCATCAGTAAGAGTTCGAGCAATCGAAGCTCTGTAG E I E E N P R A A S V R V R A I E A L * E I E E N P R A A P V K V R A I E R I G AGAAATCAAAAACGCAATGACACAAACAAACGCAGTAGTTTTGGGGTGACCTAG R N Q K R N D N N S G D L S --------------------------------- // >fig|6666666.67449.peg.1923 fig|257309.1.peg.1841 Aminodeoxychorismate lyase (EC 4.1.3.38) # PabAc FIG000708 gi|372109441|gb|CP003213.1|_1955694_1955224,gi|372109441|gb|CP003213.1|_1955222_1954797 MATDTSSPKHEPIIIAVEPYGGSVRDHSPLLPLVYWDDAAVTRGDGVFETILFRHGRACNLERHAQRFRESAVLLDLPEPRLDHWVHATSMAVEKWFQQSESDAKCVWTYTRGRASTGHPSAWLTITAVPDCVIEQREQGVRVMTTSRGYHIDTSNLVPWVVIGAKTLNYASNMAALRWAKKEGFDDVIFTEQDRILEGATSTVVTFRGNKIRSPFPGGDVLPGTTQAALFDYATNLGWNCKLKDMDEVYLTEKADSVWLISSVRGATRVRRINDTKLPRPDNESEIRELIEAALTAL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCGACAGACACGTCTTCACCTAAGCATGAGCCCATCATCATTGCCGTTGAGCCCTAT M A T D T S S P K H E P I I I A V E P Y M A T D T S S P K H E P I I I A V E P Y GGGGGATCGGTGCGCGATCACAGCCCCCTTCTGCCCTTAGTGTACTGGGATGATGCGGCC G G S V R D H S P L L P L V Y W D D A A G G S V R D H S P L L P L V Y W D D A A GTAACGCGTGGAGACGGCGTATTTGAAACGATCCTGTTTCGGCACGGTCGAGCATGCAAC V T R G D G V F E T I L F R H G R A C N V T R G D G V F E T I L F R H G R A C N CTAGAACGCCATGCGCAGCGCTTCCGTGAATCTGCAGTCCTGCTGGATCTACCGGAGCCT L E R H A Q R F R E S A V L L D L P E P L E R H A Q R F R E S A V L L D L P E P CGACTGGACCACTGGGTGCATGCGACGTCGATGGCAGTGGAGAAGTGGTTTCAGCAGAGC R L D H W V H A T S M A V E K W F Q Q S R L D H W V H A T S M A V E K W F Q Q S GAGAGCGACGCAAAATGCGTGTGGACGTACACCCGTGGGCGTGCCAGCACCGGACATCCC E S D A K C V W T Y T R G R A S T G H P E S D A K C V W T Y T R G R A S T G H P TCGGCATGGCTCACTATTACAGCAGTGCCTGATTGCGTCATCGAACAGCGGGAACAAGGT S A W L T I T A V P D C V I E Q R E Q G S A W L T I T A V P D C V I E Q R E Q G GTGCGGGTGATGACAACCTCCCGTGGTTACCATATTGACACCAGTAACCTGTGTGCCTTG V R V M T T S R G Y H I D T S N L V P W V R V M T T S R G Y H I D T S N L - V P W GGTGGTCATCGGGGCTAAGACACTCAACTATGCGTCCAATATGGCCGCCTTACGCTGGGC V V I G A K T L N Y A S N M A A L R W A V V I G A K T L N Y A S N M A A L R W A GAAAAAAGAAGGCTTTGACGACGTCATCTTCACCGAACAAGATCGTATTCTTGAAGGTGC K K E G F D D V I F T E Q D R I L E G A K K E G F D D V I F T E Q D R I L E G A CACCTCAACTGTGGTGACCTTCCGCGGAAATAAAATCCGCAGCCCTTTCCCAGGTGGCGA T S T V V T F R G N K I R S P F P G G D T S T V V T F R G N K I R S P F P G G D CGTGTTGCCAGGCACCACCCAAGCGGCGCTTTTTGATTATGCAACGAACCTAGGCTGGAA V L P G T T Q A A L F D Y A T N L G W N V L P G T T Q A A L F D Y A T N L G W N CTGCAAACTCAAAGACATGGACGAGGTGTACCTCACGGAAAAGGCGGACAGCGTGTGGCT C K L K D M D E V Y L T E K A D S V W L C K L K D M D E V Y L T E K A D S V W L GATCAGCTCCGTTCGAGGTGCCACTCGAGTGCGGCGGATTAATGACACAAAACTGCCCCG I S S V R G A T R V R R I N D T K L P R I S S V R G A T R V R R I N D T K L P R ACCAGACAACGAATCCGAGATCCGTGAGCTGATCGAGGCAGCACTGACAGCACTGTAG P D N E S E I R E L I E A A L T A L P D N E S E I R E L I E A A L T A L --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1841): ATGGCGACAGACACGTCTTCACCTAAGCATGAGCCCATCATCATTGCCGTTGAGCCCTAT M A T D T S S P K H E P I I I A V E P Y M A T D T S S P K H E P I I I A V E P Y GGGGGATCGGTGCGCGATCACAGCCCCCTTCTGCCCTTAGTGTACTGGGATGATGCGGCC G G S V R D H S P L L P L V Y W D D A A G G S V R D H S P L L P L V Y W D D A A GTAACGCGTGGAGACGGCGTATTTGAAACGATCCTGTTTCGGCACGGTCGAGCATGCAAC V T R G D G V F E T I L F R H G R A C N V T R G D G V F E T I L F R H G R A C N CTAGAACGCCATGCGCAGCGCTTCCGTGAATCTGCAGTCCTGCTGGATCTACCGGAGCCT L E R H A Q R F R E S A V L L D L P E P L E R H A Q R F R E S A V L L D L P E P CGACTGGACCACTGGGTGCATGCGACGTCGATGGCAGTGGAGAAGTGGTTTCAGCAGAGC R L D H W V H A T S M A V E K W F Q Q S R L D H W V H A T S M A V E K W F Q Q S GAGAGCGACGCAAAATGCGTGTGGACGTACACCCGTGGGCGTGCCAGCACCGGACATCCC E S D A K C V W T Y T R G R A S T G H P E S D A K C V W T Y T R G R A S T G H P TCGGCATGGCTCACTATTACAGCAGTGCCTGATTGCGTCATCGAACAGCGGGAACAAGGT S A W L T I T A V P D C V I E Q R E Q G S A W L T I T A V P D C V I E Q R E Q G GTGCGGGTGATGACAACCTCCCGTGGTTACCATATTGACACCAGTAACCTGTGTGCCTTG V R V M T T S R G Y H I D T S N C V P W V R V M T T P R G Y H I D T S N - S V P W GGTGGTCATCGGGGCTAAGACACTCAACTATGCGTCCAATATGGCCGCCTTACGCTGGGC V V I G A K T L N Y A S N M A A L R W A V V I G A K T L N Y A S N M A A L R W A GAAAAAAGAAGGCTTTGACGACGTCATCTTCACCGAACAAGATCGTATTCTTGAAGGTGC K K E G F D D V I F T E Q D R I L E G A K K E G F D D V I F T E Q D R I L E G A CACCTCAACTGTGGTGACCTTCCGCGGAAATAAAATCCGCAGCCCTTTCCCAGGTGGCGA T S T V V T F R G N K I R S P F P G G D T S T V V T F R G N K I R S P F P G G D CGTGTTGCCAGGCACCACCCAAGCGGCGCTTTTTGATTATGCAACGAACCTAGGCTGGAA V L P G T T Q A A L F D Y A T N L G W N V L P G T T Q A A L F D Y A T N L G W N CTGCAAACTCAAAGACATGGACGAGGTGTACCTCACGGAAAAGGCGGACAGCGTGTGGCT C K L K D M D E V Y L T E K A D S V W L C K L K D M D E V Y L T E K A D S V W L GATCAGCTCCGTTCGAGGTGCCACTCGAGTGCGGCGGATTAATGACACAAAACTGCCCCG I S S V R G A T R V R R I N D T K L P R I S S V R G A T R V R R I N D T K L P R ACCAGACAACGAATCCGAGATCCGTGAGCTGATCGAGGCAGCACTGACAGCACTGTAG P D N E S E I R E L I E A A L T A L P D N E S E I R E L I E A A L T A L --- // >fig|6666666.67449.peg.275 fig|257309.1.peg.274 No significant database matches gi|372109441|gb|CP003213.1|_255578_255087,gi|372109441|gb|CP003213.1|_255085_254687 MNVWGDKIRVIDTLRMSHTEYAQWITNQQHKHFNIHAELWADSEEWEALNPWTRDWARILAVGTRARTGVICGRSAVRLWGLGILGYEEPVVVVLPGTKTAPRNTKRWIHYRSARIPSNKITEHKGIRFTTMERSIGDLCRWGTFAEGLVAVKSYLRQEDAQPFLLEQELEEFGRIPGVRKFRRVLQVADSKSESVAESWAKAKLIEAKITFEQQVQINNRRADFLVGSVVVEIDGDIKFHDDEPRAVLKERKRDRELQNAGYVVAHFDWESLNSGTFIPSLLRLLESTNTKTQGR We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAACGTCTGGGGGGACAAAATTCGAGTAATCGATACGCTGCGTATGTCTCATACCGAG M N V W G D K I R V I D T L R M S H T E M N V W G D K I R V I D T L R M S H T E TACGCACAATGGATCACGAATCAACAACATAAACACTTCAATATTCATGCTGAACTTTGG Y A Q W I T N Q Q H K H F N I H A E L W Y A Q W I T N Q Q H K H F N I H A E L W GCAGATTCGGAAGAATGGGAAGCACTCAATCCGTGGACTCGCGATTGGGCACGAATTCTG A D S E E W E A L N P W T R D W A R I L A D S E E W E A L N P W T R D W A R I L GCCGTTGGCACGCGAGCACGTACTGGCGTGATTTGCGGCCGGTCTGCAGTCCGCCTGTGG A V G T R A R T G V I C G R S A V R L W A V G T R A R T G V I C G R S A V R L W GGACTAGGAATTCTAGGATATGAAGAACCAGTGGTCGTGGTGCTACCAGGTACAAAAACT G L G I L G Y E E P V V V V L P G T K T G L G I L G Y E E P V V V V L P G T K T GCTCCACGCAACACAAAGAGGTGGATTCATTACCGCTCTGCGCGAATCCCGTCAAACAAA A P R N T K R W I H Y R S A R I P S N K A P R N T K R W I H Y R S A R I P S N K ATCACGGAGCATAAGGGGATTCGCTTCACCACAATGGAACGCTCTATTGGAGATCTCTGC I T E H K G I R F T T M E R S I G D L C I T E H K G I R F T T M E R S I G D L C CGATGGGGAACGTTCGCAGAGGGGCTTGTCGCTGTGAAATCCTATTTGCGCCAAGAGGAT R W G T F A E G L V A V K S Y L R Q E D R W G T F A E G L V A V K S Y L R Q E D GCCCAGCCGTTTTTTGCTGGAACAGGAGTTAGAAGAGTTTGGACGAATTCCAGGGGTGCG A Q P F L L E Q E L E E F G R I P G V R A Q P F - L L E Q E L E E F G R I P G V R TAAATTCCGTCGGGTATTGCAAGTGGCTGATTCCAAGTCGGAAAGTGTCGCCGAGTCGTG K F R R V L Q V A D S K S E S V A E S W K F R R V L Q V A D S K S E S V A E S W GGCAAAAGCGAAGCTCATCGAAGCAAAAATCACGTTCGAGCAGCAGGTGCAGATCAATAA A K A K L I E A K I T F E Q Q V Q I N N A K A K L I E A K I T F E Q Q V Q I N N TCGTCGTGCCGACTTTCTCGTCGGAAGCGTTGTCGTAGAAATCGATGGAGACATCAAGTT R R A D F L V G S V V V E I D G D I K F R R A D F L V G S V V V E I D G D I K F CCATGACGACGAACCGAGGGCAGTGCTCAAGGAGCGGAAACGCGACCGCGAACTTCAAAA H D D E P R A V L K E R K R D R E L Q N H D D E P R A V L K E R K R D R E L Q N TGCCGGCTATGTGGTGGCGCATTTTGACTGGGAGTCACTGAACTCGGGAACTTTCATCCC A G Y V V A H F D W E S L N S G T F I P A G Y V V A H F D W E S L N S G T F I P CTCGCTTCTCCGCCTCCTCGAATCCACGAACACAAAAACCCAAGGACGCTGA S L L R L L E S T N T K T Q G R S L L R L L E S T N T K T Q G R --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.274): ATGAACGTCTGGGGGGACAAAATTCGAGTAATCGATACGCTGCGTATGTCTCATACCGAG M N V W G D K I R V I D T L R M S H T E M N V W G D K I R V I D T L R M S H T E TACGCACAATGGATCACGAATCAACAACATAAACACTTCAATATTCATGCTGAACTTTGG Y A Q W I T N Q Q H K H F N I H A E L W Y A Q W I T N Q Q H K H F N I H A E L W GCAGATTCGGAAGAATGGGAAGCACTCAATCCGTGGACTCGCGATTGGGCACGAATTCTG A D S E E W E A L N P W T R D W A R I L A D S E E W E A L N P W T R D W A R I L GCCGTTGGCACGCGAGCACGTACTGGCGTGATTTGCGGCCGGTCTGCAGTCCGCCTGTGG A V G T R A R T G V I C G R S A V R L W A V G K R A R T G V I C G R S A V R L W GGACTAGGAATTCTAGGATATGAAGAACCAGTGGTCGTGGTGCTACCAGGTACAAAAACT G L G I L G Y E E P V V V V L P G T K T R L G I L G Y E E P V V V V L P G T K T GCTCCACGCAACACAAAGAGGTGGATTCATTACCGCTCTGCGCGAATCCCGTCAAACAAA A P R N T K R W I H Y R S A R I P S N K A P R N T K R W I H Y R S A R I P S N K ATCACGGAGCATAAGGGGATTCGCTTCACCACAATGGAACGCTCTATTGGAGATCTCTGC I T E H K G I R F T T M E R S I G D L C I T E H K G I R F T T M E R S I G D L C CGATGGGGAACGTTCGCAGAGGGGCTTGTCGCTGTGAAATCCTATTTGCGCCAAGAGGAT R W G T F A E G L V A V K S Y L R Q E D R W G T F A E G L V A V E S Y L R Q E D GCCCAGCCGTTTTTTGCTGGAACAGGAGTTAGAAGAGTTTGGACGAATTCCAGGGGTGCG A Q P F L L E Q E L E E F G R I P G V R A Q P F - L L E Q E L E E F G R I P G V R TAAATTCCGTCGGGTATTGCAAGTGGCTGATTCCAAGTCGGAAAGTGTCGCCGAGTCGTG K F R R V L Q V A D S K S E S V A E S W K F R R V L Q V A D S K S E S V A E S W GGCAAAAGCGAAGCTCATCGAAGCAAAAATCACGTTCGAGCAGCAGGTGCAGATCAATAA A K A K L I E A K I T F E Q Q V Q I N N A K A Q L I E A K I T F E Q Q V Q I N N TCGTCGTGCCGACTTTCTCGTCGGAAGCGTTGTCGTAGAAATCGATGGAGACATCAAGTT R R A D F L V G S V V V E I D G D I K F R R A D F L V G R V V I E I D G D I K F CCATGACGACGAACCGAGGGCAGTGCTCAAGGAGCGGAAACGCGACCGCGAACTTCAAAA H D D E P R A V L K E R K R D R E L Q N H D D E S R A V L K E R K R D R E L Q N TGCCGGCTATGTGGTGGCGCATTTTGACTGGGAGTCACTGAACTCGGGAACTTTCATCCC A G Y V V A H F D W E S L N S G T F I P A G Y V V A H F D W E S L N S G T F I P CTCGCTTCTCCGCCTCCTCGAATCCACGAACACAAAAACCCAAGGACGCTGA S L L R L L E S T N T K T Q G R S L L R L L E F T N T K T Q G R --- // >fig|6666666.67449.peg.2110 fig|196627.4.peg.2909 D-amino acid dehydrogenase small subunit (EC 1.4.99.1) FIG054875 gi|372109441|gb|CP003213.1|_2138282_2138067,gi|372109441|gb|CP003213.1|_2138065_2137076 MANHSIVIGAGMVGLSTTWFLRKAGHEVTVIDRDGVAAGSSWGNAGWLSPGQGHPAGKPRAVALHPSDIPRPDAALHVPLVPDLKVVDFGVRFMANANQRAWDRTMKALDAYDELVEGGVESWNKDSPFIIAFKNEAEAAGFIEEVEGAVRHGQEVPFEEISNPRDFVPHLSDSVNLVFKLGNQRYFEPSPFCHKLADALRSRGVEIRTGASVVDVQSTRKPVVELSTGERLQADNVVIATGAWLPKLARRLGVRTRVQAGRGYSFSVDTGENSIDYPVYLPAQRLACTPYQGCFRIAGTMEFRDADAPFDPKRVQSMIKYASEMFTGIVFDERQDEWVGSRPVTPDGLPLIGATKAPNVYVAGGHGMWGAVLGPASGRALAHLIETGETLPEIRDFDPLR We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGGCAAATCATTCAATCGTTATCGGCGCGGGCATGGTGGGTTTGTCCACCACCTGGTTC V A N H S I V I G A G M V G L S T T W F M A N H S I V I G A G M V G L S T T W F CTGCGTAAAGCTGGACACGAGGTCACGGTCATTGACCGCGACGGCGTGGCAGCCGGCTCC L R K A G H E V T V I D R D G V A A G S L R K A G H E V T V I D R D G V A A G S TCGTGGGGCAACGCCGGTTGGTTGAGCCCAGGGCAAGGCCATCCCGCTGGCAAACCACGA S W G N A G W L S P G Q G H P A G K P R S W G N A G W L S P G Q G H P A G K P R GCTGTGGCGCTACACCCCTCAGACATTCCTCGACCCGGACGCAGCACTGCACGTGCCGCT A V A L H P S D I P R P D A A L H V P L A V A L H P S D I P R P - D A A L H V P L GGTTCCGGACCTCAAGGTCGTGGACTTCGGTGTACGTTTCATGGCGAACGCGAACCAGCG V P D L K V V D F G V R F M A N A N Q R V P D L K V V D F G V R F M A N A N Q R CGCCTGGGACCGCACCATGAAGGCGCTGGACGCATACGACGAGCTCGTTGAGGGCGGCGT A W D R T M K A L D A Y D E L V E G G V A W D R T M K A L D A Y D E L V E G G V GGAATCCTGGAACAAGGACAGTCCATTTATCATCGCCTTCAAAAACGAGGCAGAGGCCGC E S W N K D S P F I I A F K N E A E A A E S W N K D S P F I I A F K N E A E A A CGGATTCATCGAAGAGGTCGAAGGCGCCGTACGCCACGGCCAAGAAGTGCCTTTCGAGGA G F I E E V E G A V R H G Q E V P F E E G F I E E V E G A V R H G Q E V P F E E AATTTCCAATCCTCGCGACTTCGTCCCACACCTGTCTGACTCGGTGAACCTCGTATTCAA I S N P R D F V P H L S D S V N L V F K I S N P R D F V P H L S D S V N L V F K GCTGGGCAACCAGCGCTACTTTGAGCCGAGCCCCTTCTGCCACAAGCTTGCCGACGCCCT L G N Q R Y F E P S P F C H K L A D A L L G N Q R Y F E P S P F C H K L A D A L CCGCTCCCGCGGCGTCGAAATCCGCACCGGCGCTTCCGTGGTGGATGTCCAGTCCACCCG R S R G V E I R T G A S V V D V Q S T R R S R G V E I R T G A S V V D V Q S T R CAAGCCAGTAGTTGAGCTCTCTACGGGTGAGCGCCTGCAGGCGGACAACGTGGTTATCGC K P V V E L S T G E R L Q A D N V V I A K P V V E L S T G E R L Q A D N V V I A AACTGGTGCGTGGCTGCCGAAGCTAGCTCGCCGCCTTGGCGTTCGTACCCGCGTACAAGC T G A W L P K L A R R L G V R T R V Q A T G A W L P K L A R R L G V R T R V Q A AGGCCGCGGTTATTCCTTCAGCGTCGACACCGGCGAGAATTCCATCGACTATCCGGTCTA G R G Y S F S V D T G E N S I D Y P V Y G R G Y S F S V D T G E N S I D Y P V Y CCTGCCAGCCCAGCGTCTCGCCTGCACCCCGTACCAGGGCTGTTTCCGCATCGCCGGAAC L P A Q R L A C T P Y Q G C F R I A G T L P A Q R L A C T P Y Q G C F R I A G T CATGGAGTTCCGGGACGCGGATGCGCCATTCGATCCAAAGCGCGTGCAGTCCATGATCAA M E F R D A D A P F D P K R V Q S M I K M E F R D A D A P F D P K R V Q S M I K GTACGCGAGTGAGATGTTCACCGGCATCGTCTTCGACGAGCGTCAGGACGAGTGGGTGGG Y A S E M F T G I V F D E R Q D E W V G Y A S E M F T G I V F D E R Q D E W V G CAGCCGCCCAGTCACCCCAGACGGCCTGCCCCTCATCGGTGCTACCAAGGCGCCGAACGT S R P V T P D G L P L I G A T K A P N V S R P V T P D G L P L I G A T K A P N V TTACGTCGCCGGCGGCCATGGCATGTGGGGCGCTGTCCTCGGCCCAGCTTCCGGCCGCGC Y V A G G H G M W G A V L G P A S G R A Y V A G G H G M W G A V L G P A S G R A ACTGGCACACCTCATTGAGACAGGGGAGACGCTGCCGGAAATTCGGGATTTCGACCCGCT L A H L I E T G E T L P E I R D F D P L L A H L I E T G E T L P E I R D F D P L GCGTTAG R R --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.2909): --GTGGCAAATCATTCAATCGTTATCGGCGCGGGCATGGTGGGTTTGTCCACCACCTGGT V A N H S I V I G A G M V G L S T T W MS S S G K V I V V G A G I V G L A T A W TCCTGCGTAAAGCTGGACACGAGGTCACGGTCATTGACCGCGACGGCGTGGCAGCCGGCT F L R K A G H E V T V I D R D G V A A G H L Q E H G F E V S V L D R D G V A A G CCTCGTGGGGCAACGCCGGTTGGTTGAGCCCAGGGCAAGGCCATCCCGCTGGCAAACCAC S S W G N A G W L S P G K A I P L A N H S S W G N A G W L A P A - K T I P L S E P GAGCTGTGGCGCTACACCCCTCAGACATTCCTCGACCCGGACGCAGCACTGCACGTGCCG E L W R Y T P Q T F L D P D A A L H V P G L W T Y G P K E L F N P V S P M H M P CTGGTTCCGGACCTCAAGGTCGTGGACTTCGGTGTACGTTTCATGGCGAACGCGAACCAG L V P D L K V V D F G V R F M A N A N Q L R V D P K L W L F L A Q F M A Q A F Q CGCGCCTGGGACCGCACCATGAAG--------GCGCTGGACGCATACGACGAGCTCGTTG R A W D R T M K A L D A Y D E L V R K W D S T M A DLTEIDKV A L E A F D E L S AGGGCGGCGTGGAATCCTGGAACAAGGACAGTCCATTTATCATCGCCTTCAAAAACGAGG E G G V E S W N K D S P F I I A F K N E I G G V E G L T H E G P F V I G F E E E CAGAGGCCGCCGGATTCATCGAAGAGGTCGAAGGCGCCGTACGCCACGGCCAAGAAGTGC A E A A G F I E E V E G A V R H G Q E V R Q S A G F R K E I D G V S R H G Q K V CTTTCGAGGAAATTTCCAATCCTCGCGACTTCGTCCCACACCTGTCTGACTCGGTGAACC P F E E I S N P R D F V P H L S D S V N E M S R L E N P Q E L A P M L N E Q I Q TCGTATTCAAGCTGGGCAACCAGCGCTACTTTGAGCCGAGCCCCTTCTGCCACAAGCTTG L V F K L G N Q R Y F E P S P F C H K L V A Y R L E G Q R F I E P G P Y V Q S L CCGACGCCCTCCGCTCCCGCGGCGTCGAAATCCGCACCGGCGCTTCCGTGGTGGATGTCC A D A L R S R G V E I R T G A S V V D V A D A V V K R G G V I R A G A E V V H V AGTCCACCCGCAAGCCAGTAGTTGAGCTCTCTACGGGTGAGCGCCTGCAGGCGGACAACG Q S T R K P V V E L S T G E R L Q A D N A K G D R P A V I L A D G S R E E A D K TGGTTATCGCAACTGGTGCGTGGCTGCCGAAGCTAGCTCGCCGCCTTGGCGTTCGTACCC V V I A T G A W L P K L A R R L G V R T V V V A T G A W L P G L T R E Y G V K T GCGTACAAGCAGGCCGCGGTTATTCCTTCAGCGTCGACACCGGCGAGAATTCCATCG*AC R V Q A G R G Y S F S V D T G I P S L V Q A G R G Y S F S V A T D ---- I P A *K* *TATCCGGTCTACCTGCCAGCCCAGCGTCTCGCCTGCACCCCGTACCAGGGCTGTTTCCG Y P V Y L P A Q R L A C T P Y Q G C F R * H S V Y L P H H R M A C T P Y E G R F R CATCGCCGGAACCATGGAGTTCCGGGACGCGGATGCGCCATTCGATCCAAAGCGCGTGCA I A G T M E F R D A D A P F D P K R V Q I A G T M E F R G P D E P F Q Q G R V D GTCCATGATCAAGTACGCGAGTGAGATGTTCACCGGCATCGTCTTCGACGAGCGTCAGGA S M I K Y A S E M F T G I V F D E R Q D A I V S Q A K K V M R G I D F N D R Q D CGAGTGGGTGGGCAGCCGCCCAGTCACCCCAGACGGCCTGCCCCTCATCGGTGCTACCAA E W V G S R P V T P D G L P L I G A T K E W V G S R P V T P D G R P L I G Q T K GGCGCCGAACGTTTACGTCGCCGGCGGCCATGGCATGTGGGGCGCTGTCCTCGGCCCAGC A P N V Y V A G G H G M W G A V L G P A A E N I Y V A G G H G M W G V V L G P A TTCCGGCCGCGCACTGGCACACCTCATTGAGACAGGGGAGACGCTGCCGGAAATTCGGGA S G R A L A H L I E T G E T L P E I R D T G K Y L A E L M A T G N T N P I I K P TTTCGACCCGCTGCGTTAG F D P L R F D P L R --- // >fig|6666666.67449.peg.87 fig|196627.4.peg.2275 site-specific recombinase gi|372109441|gb|CP003213.1|_80744_81007,gi|372109441|gb|CP003213.1|_81011_81280 MSSKDQNLERQTAALKKEKCFRIFEDTVSGSSTNRPGVDGALNYVRPGDQLVVTSMDRLERSLIDLHRLVDDLTARDISVKFLKEGQTxSLNSTPIAKLMLGLLGSVAEFERSIIRERQTEGIARAKARGVYQGHAKALSDEQLAQAREWVGDGVRKAEVARRLGIGRTTLYNYLKSQ We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGAGTTCTAAAGACCAGAATTTAGAGCGGCAAACCGCAGCGTTGAAGAAAGAAAAGTGC V S S K D Q N L E R Q T A A L K K E K C M S S K D Q N L E R Q T A A L K K E K C TTTCGCATATTCGAGGATACCGTCAGCGGTTCGTCCACCAACCGTCCTGGGGTGGACGGA F R I F E D T V S G S S T N R P G V D G F R I F E D T V S G S S T N R P G V D G GCGTTGAACTATGTGCGTCCTGGTGACCAACTTGTGGTCACCAGTATGGATCGGTTGGAA A L N Y V R P G D Q L V V T S M D R L E A L N Y V R P G D Q L V V T S M D R L E CGGTCGCTTATTGATTTACACCGCCTGGTCGATGACCTCACTGCCCGGGATATTTCGGTG R S L I D L H R L V D D L T A R D I S V R S L I D L H R L V D D L T A R D I S V AAGTTCCTGAAAGAGGGTCAAACGTAATCGTTGAATTCGACGCCGATTGCCAAGCTCATG K F L K E G Q T * S L N S T P I A K L M K F L K E G Q T X S L N S T P I A K L M CTTGGGTTGCTTGGCTCGGTGGCGGAGTTTGAACGCTCGATTATTCGTGAGCGGCAGACG L G L L G S V A E F E R S I I R E R Q T L G L L G S V A E F E R S I I R E R Q T GAGGGGATTGCGCGGGCGAAAGCCCGCGGGGTTTATCAAGGTCACGCGAAAGCGCTGTCT E G I A R A K A R G V Y Q G H A K A L S E G I A R A K A R G V Y Q G H A K A L S GATGAGCAGCTTGCCCAGGCGCGCGAGTGGGTGGGCGATGGTGTTCGGAAAGCGGAAGTT D E Q L A Q A R E W V G D G V R K A E V D E Q L A Q A R E W V G D G V R K A E V GCTCGCAGGCTCGGCATCGGTAGGACAACGCTCTATAACTACTTAAAGAGCCAATAA A R R L G I G R T T L Y N Y L K S Q A R R L G I G R T T L Y N Y L K S Q --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.2275): ----------------------GTGAGTTCTAAAGACCAGAATTTAGAGCGGCAAACCGC V S S K D Q N L E R Q T A MFGSSFKEQTTNPRSQRVSYLR V S S T D Q N L A R Q R E AGCGTTGAAGAAAGAAAAGTGCTTT-CGCATATTCGAGGATACCGTCAGCGGTTCGTCC- A L K K E K C F R I F E D T V S G S S A V N H S G H I D R E F T D E L S G G A K ACCAACCGTCCTGGGGTGGACGGAGCGTTGAACTATGTGCGTCCTGGTGACCAACTTGTG T N R P G V D G A L N Y V R P G D Q L V S H R P G L E D C I N Y L R E D D V L V GTCACCAGTATGGATCGGTTGGAACGGTCGCTTATTGATTTACACCGCCTGGTCGATGAC V T S M D R L E R S L I D L H R L V D D V A S I D R L A R S L V D L R V I I D R CTCACTGCCCGGGATATTTCGGTGAAGTTCCTGAAAGAGGGTCAAACGTAATCGTTGAAT L T A R D I S V K F L K E G Q T * S L N I T D K G A S V I F L K E N L T F A A G -TCGACGCCGATTGCCAAGCTCATGCTTGGGTTGCTTGGCTCGGTGGCGGAGTTTGAACG S T P I A K L M L G L L G S V A E F E R R D D P R A N L M L G I L G S F A E F E R CTCGATTATTCGTGAGCGGCAGACGGAGGGGATTGCGCGGGCGAAAGCCCGCGGGGTTTA S I I R E R Q T E G I A R A K A R G V Y S I I R E R Q A E G I A L A K K A G K Y TCAAGGTCACGCGAAAGCGCTGTCTGATGAGCAGCTTGCCCAGGCGCGCGAGTGGGTGGG Q G H A K A L S D E Q L A Q A R E W V G A G R P K A L D K E Q I Q E A K D M I A CGATGGTGTTCGGAAAGCGGAAGTTGCTCGCAGGCTCGGCATCGGTAGGACAACGCTCTA D G V R K A E V A R R L G I G R T T L Y Q G E T K S A V A K H F G I N R S T L Y TAACTACTTAAAG*AG*CCAATAA N Y L K P I E Y L K *N** P D - // >fig|6666666.67449.peg.321 fig|257309.1.peg.165 Putative phage integrase gi|372109441|gb|CP003213.1|_298843_298637,gi|372109441|gb|CP003213.1|_298633_298478,gi|372109441|gb|CP003213.1|_298474_297644 MAFVRDLWTKPNPNATSRTKRIRSARWGKGKRWQAVWVENGKHVTTSCHAKDEAELHIARASVGQADGTxITKDKLDVTLQDMWDVWIASKQGRTESTKAGYIAAWKHIQPVFGNTACWKIExAKIAAWIPTVTTTKSSKHNQPRVIGSGSQRKIGIVIKALLDQAEELDIINKNKIRCTDIPRQGKAERRYLTIRGIDRLLAAAIPMNEVALMRNVLLFTGLRPREAKGLKVKDLDPLRGRLSIRRDVDDLGNPDETKTRNHRGVPIGGDLLFDLDDQAEGKQPHDWLLTDETGHVWTSTKWRRQWATICTHAHISGLTTYELRHTAASLAIAAGADVKTVQLMLGHASAATTLDTYAHLWETGLDSVPGAMSAHLQRERERLALRERRRVECELQVI We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCATTCGTGCGCGACCTCTGGACAAAACCCAACCCCAACGCAACATCGAGAACCAAA M A F V R D L W T K P N P N A T S R T K M A F V R D L W T K P N P N A T S R T K AGAATACGCTCTGCTCGATGGGGAAAAGGCAAACGCTGGCAAGCTGTCTGGGTAGAAAAC R I R S A R W G K G K R W Q A V W V E N R I R S A R W G K G K R W Q A V W V E N GGCAAACACGTCACCACCTCATGCCACGCCAAAGACGAAGCTGAACTTCACATCGCACGC G K H V T T S C H A K D E A E L H I A R G K H V T T S C H A K D E A E L H I A R GCATCCGTTGGCCAAGCCGATGGCACCTAGATTACTAAAGACAAACTCGATGTCACACTC A S V G Q A D G T * I T K D K L D V T L A S V G Q A D G T X I T K D K L D V T L CAAGACATGTGGGATGTATGGATCGCGTCAAAACAAGGACGCACAGAAAGCACCAAAGCT Q D M W D V W I A S K Q G R T E S T K A Q D M W D V W I A S K Q G R T E S T K A GGTTACATTGCTGCGTGGAAACACATCCAACCCGTCTTCGGAAACACCGCATGTTGGAAA G Y I A A W K H I Q P V F G N T A C W K G Y I A A W K H I Q P V F G N T A C W K ATTGAATGAGCAAAAATAGCAGCCTGGATCCCTACCGTCACCACCACCAAAAGCAGCAAG I E * A K I A A W I P T V T T T K S S K I E X A K I A A W I P T V T T T K S S K CATAACCAACCCCGTGTGATCGGCTCCGGCTCGCAACGCAAAATCGGAATCGTCATCAAA H N Q P R V I G S G S Q R K I G I V I K H N Q P R V I G S G S Q R K I G I V I K GCACTCCTCGACCAAGCCGAAGAACTCGACATCATTAACAAAAACAAAATCCGTTGCACC A L L D Q A E E L D I I N K N K I R C T A L L D Q A E E L D I I N K N K I R C T GATATCCCCCGCCAAGGAAAAGCAGAACGCCGCTACCTCACCATCCGAGGAATCGACCGC D I P R Q G K A E R R Y L T I R G I D R D I P R Q G K A E R R Y L T I R G I D R CTTTTAGCAGCTGCAATACCCATGAACGAAGTAGCACTCATGCGCAACGTTTTGTTATTC L L A A A I P M N E V A L M R N V L L F L L A A A I P M N E V A L M R N V L L F ACCGGTCTTCGCCCAAGGGAAGCAAAAGGATTGAAAGTCAAAGACCTCGACCCCCTGCGC T G L R P R E A K G L K V K D L D P L R T G L R P R E A K G L K V K D L D P L R GGTAGGCTGTCCATCCGTCGTGACGTCGACGATCTCGGAAACCCCGATGAAACAAAAACC G R L S I R R D V D D L G N P D E T K T G R L S I R R D V D D L G N P D E T K T AGAAACCACCGCGGCGTCCCCATCGGTGGTGACCTCCTTTTCGATCTCGACGACCAAGCA R N H R G V P I G G D L L F D L D D Q A R N H R G V P I G G D L L F D L D D Q A GAAGGAAAACAACCACATGACTGGCTCCTCACCGATGAAACCGGCCATGTGTGGACATCC E G K Q P H D W L L T D E T G H V W T S E G K Q P H D W L L T D E T G H V W T S ACAAAATGGCGCAGGCAGTGGGCAACCATCTGCACTCATGCACACATATCAGGCCTGACA T K W R R Q W A T I C T H A H I S G L T T K W R R Q W A T I C T H A H I S G L T ACCTACGAGCTACGACACACAGCAGCATCATTGGCGATTGCAGCCGGTGCTGACGTGAAA T Y E L R H T A A S L A I A A G A D V K T Y E L R H T A A S L A I A A G A D V K ACCGTTCAACTTATGCTTGGACACGCAAGTGCTGCCACGACCCTTGACACCTACGCACAC T V Q L M L G H A S A A T T L D T Y A H T V Q L M L G H A S A A T T L D T Y A H TTGTGGGAAACCGGACTAGATTCCGTTCCCGGCGCGATGAGTGCTCATTTGCAGCGTGAG L W E T G L D S V P G A M S A H L Q R E L W E T G L D S V P G A M S A H L Q R E CGTGAGAGGTTAGCGTTGCGTGAGCGTAGGCGTGTTGAGTGTGAGTTACAGGTTATTTAG R E R L A L R E R R R V E C E L Q V I R E R L A L R E R R R V E C E L Q V I --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.165): ATGGCATTCGTGCGCGACCTCTGGACAAAACCCAACCCCAACGCAACATCGAGAACCAAA M A F V R D L W T K P N P N A T S R T K M A T V R D L W T K R N P N T T S K T K AGAATACGCTCTGCTCGATGGGGAAAAGGCAAACGCTGGCAAGCTGTCTGGGTAGAAAAC R I R S A R W G K G K R W Q A V W V E N R I R S A R W G V G K R W Q A V W I E N GGCAAACACGTCACCACCTCATGCCACGCCAAAGACGAAGCTGAACTTCACATCGCACGC G K H V T T S C H A K D E A E L H I A R G R E A T K T F E T R D E A E L W A A R GCATCCGTTGGCCAAGCCGATGGCACCTAGATTACTAAAGACAAACTCGATGTCACACTC A S V G Q A D G T * I T K D K L D V T L A E V G K A D G T W I T K D K V D I T L CAAGACATGTGGGATGTATGGATCGCGTCAAAACAAGGACGCACAGAAAGCACCAAAGCT Q D M W D V W I A S K Q G R T E S T K A S D L W E P W I A S K G N I S D K T K R GGTTACATTGCTGCGTGGAAA-CACATCCAACCCGTCTTCGGAAACACCGCATGTTGGAA G Y I A A W K H I Q P V F G N T A C W K D Y L S Y W N V H I R P Q W G Q T P C A H AATTGAATGAGCAAAAATAGCAGCCTGGATCCCTACCGTCACCACCACCAAAAGCAGCAA I E * A K I A A W I P T V T T T K S S K I Q R S V I N A W I P T L S T M K G V P GCATAACCAACCC-CGTGTGATCGGCTCCGGCTCGCAACGCAAAATCGGAATCGTCATCA H N Q P R V I G S G S Q R K I G I V I A S Q P P R P L S E S A M R K V G L I I AAGCACTCCTCGACCAAGCCGAAGAACTCGACATCATTAACAAAAACAAAATCCGTTGCA K A L L D Q A E E L D I I N K N K I R C H G I L D L A V E L G V I H Q N P I R T CCGATATCCCCCGCCAAGGAAAAGCAGAACGCCGCTACCTCACCATCCGAGGAATCGACC T D I P R Q G K A E R R Y L T I R G I D G D L P K Q K K S E R R Y L K I T E V D GCCTTTTAGCAGCTGCAATACCCATGAACGAAGTAGCACTCATGCGCAACGTTTTGTTAT R L L A A A P M N E V A L M R N V L L E L I R Q A --- P T E Q A K L L L R V L I TCACCGGTCTTCGCCCAAGGGAAGCAAAAGGATTGAAAGTCAAAGACCTCGACCCCCTGC F T G L R P R E A K G L K V K D L D P L M T G L R P G E A K G L K V K D L D P V GCGGTAGGCTGTCCATCCGTCGTGACGTCGACGATCTCGGAAACCCCGATGAAACAAAAA R G R L S I R R D V D D L G N P D E T K R G R L M I R R D V D D L G H E D S T K CCAGAAACCACCGCGGCGTCCCCATCGGTGGTGACCTCCTTTTCGATCTCGACGACCAAG T R N H R G V P I G G D L L F D L D D Q T R N H R D V P I G G E I L L L L D R Y CAGAAGGAAAACAACCACATGACTGGCTCCTCACCGATGAAACCGGCCATGTGTGGACAT A E G K Q P H D W L L T D E T G H V W T A Q G K D P D S W L I P D E R G K V W T CCACAAAATGGCGCAGGCAGTGGGCAACCATCTGCACTCATGCACACATATCAGGCCTGA S T K W R R Q W A T I C T H A H I S G L T S R W R V V W K N L C I W T G I G D L CAACCTACGAGCTACGACACACAGCAGCATCATTGGCGATTGCAGCCGGTGCTGACGTGA T T Y E L R H T A A S L A I A A G A D V D T Y E L R H T A A S I A I A A G A D V AAACCGTTCAACTTATGCTTGGACACGCAAGTGCTGCCACGACCCTTGACACCTACGCAC K T V Q L M L G H A S A A T T L D T Y A K T V Q L M L G H S S A A M T L D I Y A ACTTGTGGGAAACCGGACTAGATTCCGTTCCCGGCGCGATGAGTGCTCATTTGCAGCGTG H L W E T G L D S V P G A M S A H L Q R H L W E E G L D A I P G A M E A H M E S AGCGTGAGAGGTTA---------GCGTTGCGTGAGCGTAGGCGTGTTGAGTGT*GA*GTT E R E R L A L R E R R R V E C V E R K R A EEASTVHEA S E A E R R R A Q F *K** V ACAGGTTATTTAG T G I G ------- // >fig|6666666.67449.peg.868 fig|257309.1.peg.856 Pullulanase (EC 3.2.1.41) gi|372109441|gb|CP003213.1|_841524_841372,gi|372109441|gb|CP003213.1|_841368_839710 MTTTNSYTGQLGAFLTPHGDTCFRVWSPDAATADLLIENHTVSMHPIGDGVxEAKLDGDRHGQRYSYRLSLRGETIESVDPYARAVTANGTHGVVVTQSTPVPRMPAFTAPTDAIIYEAHVRDLSIAPNSGIHNKGRFLGLTERDTHTTAGNPSGLDYILSLGVTHIQLLPIFDFGSVDETGDLSYNAQYNWGYDPMNYNAPEGSYSSNPNDPFTRIDELKHTIRTLHDAGLRVIMDVVYNHVYDTTTSPLERTAPGHYFRITDDGTFHDGTFCGNETASENPMMRKFIIDSVTHWATEYGLDGFRFDLMGIHDVDTMNAIRTALDAIDPSIIILGEGWNLGNHPPHILPANQRNAAHMPRIAHFNDSLRDTLKGSTFHSNSRGLLTGDHNPKHMWTLFNNIKGAQHLPGLNFTSANHTVNYIEAHDNHTLYDRLHLLLPDAPHDELIRRCQLATTIQYLACGITFIHAGQEFARTKNNTENSYNSPDHINAIDYDRAAQHPHSVQLLRGLNRFRNTHTELFPTEYDDINELYEATLVSGDFLTYSVGKQTTVAINFSTQPRSIPTEGCFAVLLDDHMFPTDKQIETNSWTVAPLSVSILQQVS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACCACAACCAACTCCTACACCGGCCAACTCGGCGCCTTCCTCACTCCCCACGGGGAC M T T T N S Y T G Q L G A F L T P H G D M T T T N S Y T G Q L G A F L T P H G D ACCTGTTTTCGAGTCTGGTCTCCCGACGCCGCAACCGCCGACCTCCTCATCGAAAACCAC T C F R V W S P D A A T A D L L I E N H T C F R V W S P D A A T A D L L I E N H ACCGTGAGCATGCACCCCATCGGCGATGGGGTGTGAGAAGCAAAACTTGATGGTGATCGA T V S M H P I G D G V * E A K L D G D R T V S M H P I G D G V X E A K L D G D R CACGGTCAACGCTATAGTTACCGTCTTTCCCTCCGTGGGGAAACGATAGAATCAGTAGAC H G Q R Y S Y R L S L R G E T I E S V D H G Q R Y S Y R L S L R G E T I E S V D CCCTATGCTCGGGCGGTCACGGCTAACGGAACGCATGGGGTCGTCGTCACGCAATCCACC P Y A R A V T A N G T H G V V V T Q S T P Y A R A V T A N G T H G V V V T Q S T CCTGTGCCCCGCATGCCAGCCTTCACCGCGCCCACCGACGCCATTATTTACGAAGCACAC P V P R M P A F T A P T D A I I Y E A H P V P R M P A F T A P T D A I I Y E A H GTACGCGACCTGAGCATCGCCCCCAACAGCGGAATCCACAACAAAGGCCGCTTCCTAGGA V R D L S I A P N S G I H N K G R F L G V R D L S I A P N S G I H N K G R F L G CTCACCGAACGCGACACCCACACCACCGCTGGCAACCCCAGCGGCCTCGACTACATCCTA L T E R D T H T T A G N P S G L D Y I L L T E R D T H T T A G N P S G L D Y I L AGCCTCGGGGTCACCCACATCCAGCTCCTGCCGATTTTCGACTTCGGCTCCGTCGACGAA S L G V T H I Q L L P I F D F G S V D E S L G V T H I Q L L P I F D F G S V D E ACCGGCGACCTTAGCTACAACGCCCAATACAACTGGGGCTACGACCCCATGAATTACAAC T G D L S Y N A Q Y N W G Y D P M N Y N T G D L S Y N A Q Y N W G Y D P M N Y N GCGCCCGAAGGCTCCTACTCCAGCAACCCCAACGACCCCTTCACGCGCATCGACGAACTC A P E G S Y S S N P N D P F T R I D E L A P E G S Y S S N P N D P F T R I D E L AAACACACCATCCGCACGCTTCACGACGCAGGCCTGCGCGTCATCATGGACGTCGTCTAC K H T I R T L H D A G L R V I M D V V Y K H T I R T L H D A G L R V I M D V V Y AACCACGTCTACGACACCACCACCTCCCCACTCGAACGCACCGCCCCCGGTCACTACTTC N H V Y D T T T S P L E R T A P G H Y F N H V Y D T T T S P L E R T A P G H Y F CGCATTACCGACGACGGCACCTTCCACGACGGCACCTTCTGCGGCAACGAAACCGCCTCC R I T D D G T F H D G T F C G N E T A S R I T D D G T F H D G T F C G N E T A S GAAAACCCCATGATGCGCAAATTCATCATCGACTCCGTCACCCACTGGGCCACCGAATAC E N P M M R K F I I D S V T H W A T E Y E N P M M R K F I I D S V T H W A T E Y GGCCTCGACGGCTTCCGATTCGACCTCATGGGCATCCACGACGTCGACACCATGAACGCC G L D G F R F D L M G I H D V D T M N A G L D G F R F D L M G I H D V D T M N A ATCCGCACAGCCCTCGACGCCATCGACCCCTCCATCATCATCCTCGGCGAAGGCTGGAAC I R T A L D A I D P S I I I L G E G W N I R T A L D A I D P S I I I L G E G W N CTCGGCAACCACCCACCACACATCCTCCCAGCCAACCAACGCAACGCCGCCCACATGCCA L G N H P P H I L P A N Q R N A A H M P L G N H P P H I L P A N Q R N A A H M P CGCATCGCCCACTTCAACGACTCCCTCCGCGACACCCTCAAAGGAAGCACATTCCACTCC R I A H F N D S L R D T L K G S T F H S R I A H F N D S L R D T L K G S T F H S AACTCCCGCGGACTACTCACCGGCGACCACAACCCCAAACACATGTGGACCCTCTTCAAC N S R G L L T G D H N P K H M W T L F N N S R G L L T G D H N P K H M W T L F N AACATCAAAGGCGCCCAACACCTCCCAGGACTCAACTTCACCAGCGCCAACCACACCGTC N I K G A Q H L P G L N F T S A N H T V N I K G A Q H L P G L N F T S A N H T V AACTACATCGAAGCCCACGACAACCACACCCTCTACGACCGCCTCCACCTCCTCCTACCC N Y I E A H D N H T L Y D R L H L L L P N Y I E A H D N H T L Y D R L H L L L P GACGCGCCTCACGACGAGCTCATCCGACGCTGCCAACTCGCCACCACCATCCAATACCTC D A P H D E L I R R C Q L A T T I Q Y L D A P H D E L I R R C Q L A T T I Q Y L GCCTGCGGAATCACCTTCATCCACGCAGGACAAGAATTCGCACGCACAAAAAACAACACC A C G I T F I H A G Q E F A R T K N N T A C G I T F I H A G Q E F A R T K N N T GAAAACTCCTACAACTCACCCGACCACATCAACGCCATCGACTACGACCGCGCCGCACAA E N S Y N S P D H I N A I D Y D R A A Q E N S Y N S P D H I N A I D Y D R A A Q CACCCCCACAGCGTCCAACTCCTTCGCGGCCTCAACCGCTTCAGAAATACCCACACCGAG H P H S V Q L L R G L N R F R N T H T E H P H S V Q L L R G L N R F R N T H T E CTATTCCCCACCGAATACGACGACATCAACGAGCTCTACGAAGCAACGCTCGTGAGCGGT L F P T E Y D D I N E L Y E A T L V S G L F P T E Y D D I N E L Y E A T L V S G GACTTCCTCACCTACTCCGTGGGGAAACAAACAACAGTCGCCATTAACTTTTCAACGCAA D F L T Y S V G K Q T T V A I N F S T Q D F L T Y S V G K Q T T V A I N F S T Q CCACGCTCGATCCCCACGGAGGGATGCTTCGCAGTGCTTCTCGACGACCACATGTTCCCC P R S I P T E G C F A V L L D D H M F P P R S I P T E G C F A V L L D D H M F P ACGGACAAACAGATTGAAACGAACTCGTGGACGGTCGCGCCTCTCTCCGTGAGCATCCTC T D K Q I E T N S W T V A P L S V S I L T D K Q I E T N S W T V A P L S V S I L CAACAAGTTAGTTGA Q Q V S Q Q V S --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.856): ATGACCACAACCAACTCCTACACCGGCCAACTCGGCGCCTTCCTCACTCCCCACGGGGAC M T T T N S Y T G Q L G A F L T P H G D M T T T N S Y T G Q L G A F L T P H G D ACCTGTTTTCGAGTCTGGTCTCCCGACGCCGCAACCGCCGACCTCCTCATCGAAAACCAC T C F R V W S P D A A T A D L L I E N H T C F R V W S P D A A T A D L L I E N H ACCGTGAGCATGCACCCCATCGGCGATGGGGTGTGAGAAGCAAAACTTGATGGTGATCGA T V S M H P I G D G V * E A K L D G D R T V S M H P I G D G V W E A K L D G D R CACGGTCAACGCTATAGTTACCGTCTTTCCCTCCGTGGGGAAACGATAGAATCAGTAGAC H G Q R Y S Y R L S L R G E T I E S V D H G Q R Y S Y R L S L R G E T I E S V D CCCTATGCTCGGGCGGTCACGGCTAACGGAACGCATGGGGTCGTCGTCACGCAATCCACC P Y A R A V T A N G T H G V V V T Q S T P Y A R A V T A N G T H G V V V T Q S T CCTGTGCCCCGCATGCCAGCCTTCACCGCGCCCACCGACGCCATTATTTACGAAGCACAC P V P R M P A F T A P T D A I I Y E A H P V P R M P A F T A P T D A I I Y E A H GTACGCGACCTGAGCATCGCCCCCAACAGCGGAATCCACAACAAAGGCCGCTTCCTAGGA V R D L S I A P N S G I H N K G R F L G V R D L S I A P N S G I H N K G R F L G CTCACCGAACGCGACACCCACACCACCGCTGGCAACCCCAGCGGCCTCGACTACATCCTA L T E R D T H T T A G N P S G L D Y I L L T E R D T H T T A G N P S G L D Y I L AGCCTCGGGGTCACCCACATCCAGCTCCTGCCGATTTTCGACTTCGGCTCCGTCGACGAA S L G V T H I Q L L P I F D F G S V D E S L G V T H I Q L L P I F D F G S V D E ACCGGCGACCTTAGCTACAACGCCCAATACAACTGGGGCTACGACCCCATGAATTACAAC T G D L S Y N A Q Y N W G Y D P M N Y N T G D L S Y N A Q Y N W G Y D P M N Y N GCGCCCGAAGGCTCCTACTCCAGCAACCCCAACGACCCCTTCACGCGCATCGACGAACTC A P E G S Y S S N P N D P F T R I D E L A P E G S Y S S N P N D P F T R I D E L AAACACACCATCCGCACGCTTCACGACGCAGGCCTGCGCGTCATCATGGACGTCGTCTAC K H T I R T L H D A G L R V I M D V V Y K H T I R T L H D A G L R V I M D V V Y AACCACGTCTACGACACCACCACCTCCCCACTCGAACGCACCGCCCCCGGTCACTACTTC N H V Y D T T T S P L E R T A P G H Y F N H V Y D T T T S P L E R T A P G H Y F CGCATTACCGACGACGGCACCTTCCACGACGGCACCTTCTGCGGCAACGAAACCGCCTCC R I T D D G T F H D G T F C G N E T A S R M T D D G T F H D G T F C G N E T A S GAAAACCCCATGATGCGCAAATTCATCATCGACTCCGTCACCCACTGGGCCACCGAATAC E N P M M R K F I I D S V T H W A T E Y E N P M M R K F I I D S V T H W A T E Y GGCCTCGACGGCTTCCGATTCGACCTCATGGGCATCCACGACGTCGACACCATGAACGCC G L D G F R F D L M G I H D V D T M N A G L D G F R F D L M G I H D V D T M N A ATCCGCACAGCCCTCGACGCCATCGACCCCTCCATCATCATCCTCGGCGAAGGCTGGAAC I R T A L D A I D P S I I I L G E G W N I R T A L D A I D P S I I I L G E G W N CTCGGCAACCACCCACCACACATCCTCCCAGCCAACCAACGCAACGCCGCCCACATGCCA L G N H P P H I L P A N Q R N A A H M P L G N H P P H I L P A N Q H N A A H M P CGCATCGCCCACTTCAACGACTCCCTCCGCGACACCCTCAAAGGAAGCACATTCCACTCC R I A H F N D S L R D T L K G S T F H S R I A H F N D S L R D T L K G S T F H S AACTCCCGCGGACTACTCACCGGCGACCACAACCCCAAACACATGTGGACCCTCTTCAAC N S R G L L T G D H N P K H M W T L F N N S R G L L T G D H N P K H M W T L F N AACATCAAAGGCGCCCAACACCTCCCAGGACTCAACTTCACCAGCGCCAACCACACCGTC N I K G A Q H L P G L N F T S A N H T V N I K G A Q H L P G L N F T S A N H T V AACTACATCGAAGCCCACGACAACCACACCCTCTACGACCGCCTCCACCTCCTCCTACCC N Y I E A H D N H T L Y D R L H L L L P N Y I E A H D N H T L Y D R L H L L L P GACGCGCCTCACGACGAGCTCATCCGACGCTGCCAACTCGCCACCACCATCCAATACCTC D A P H D E L I R R C Q L A T T I Q Y L D A P H D E L I R R C Q L A T T I Q Y L GCCTGCGGAATCACCTTCATCCACGCAGGACAAGAATTCGCACGCACAAAAAACAACACC A C G I T F I H A G Q E F A R T K N N T A C G I T F I H A G Q E F A R T K N N T GAAAACTCCTACAACTCACCCGACCACATCAACGCCATCGACTACGACCGCGCCGCACAA E N S Y N S P D H I N A I D Y D R A A Q E N S Y N S P D H I N A I D Y D R A A Q CACCCCCACAGCGTCCAACTCCTTCGCGGCCTCAACCGCTTCAGAAATACCCACACCGAG H P H S V Q L L R G L N R F R N T H T E H P H S V Q L L R D L N N F R K T H T E CTATTCCCCACCGAATACGACGACATCAACGAGCTCTACGAAGCAACGCTCGTGAGCGGT L F P T E Y D D I N E L Y E A T L V S G L F P T E Y D D I N E L Y E A T L V S G GACTTCCTCACCTACTCCGTGGGGAAACAAACAACAGTCGCCATTAACTTTTCAACGCAA D F L T Y S V G K Q T T V A I N F S T Q D F L T Y S V G K Q T T V A I N F S T Q CCACGCTCGATCCCCACGGAGGGATGCTTCGCAGTGCTTCTCGACGACCACATGTTCCCC P R S I P T E G C F A V L L D D H M F P P R S I P T E G Y F A V L L D D H V F P ACGGACAAACAGATTGAAACGAACTCGTGGACGGTCGCGCCTCTCTCCGTGAGCATCCTC T D K Q I E T N S W T V A P L S V S I L T D K Q I E T N S W T V A P L S V S I L CAACAAGTTAGTTGA Q Q V S Q Q V S --- // >fig|6666666.67449.peg.204 fig|257309.1.peg.218 Sortase A, LPXTG specific FIG007328 gi|372109441|gb|CP003213.1|_178750_177809,gi|372109441|gb|CP003213.1|_177805_177761 MTNQPPTPNTTDATPPRQDKKLNTNAIIAVVLILAGLGVLLYPVLATQWNNYQQSRAAEAYSQLEKGVPPEVLNKAWEEAQQYNANLGDIDPGDAWTSSDDESSPAYQRYLKYLSVLNETEAMGRIVLPSIKSDLPIFHGTSDRVLARGVGHLYGTDLPVGAPGELGEDGTIPPAPPEGRLSALSAHTGLQNATLWDNLNQIKKGDPVYVAAAGEKLKYEVRDIEVVTPDKTSLLRRTPNKDLVTLITCTPYGINTHRLIITAERVPMDPQEESVFDGQGTTWQWWMWAILAAAAIIVLLLIRWWWKNFRKQEGxEGPATSGAVDTTES We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACAAACCAACCTCCAACGCCGAACACGACGGACGCGACCCCGCCCCGCCAAGACAAG M T N Q P P T P N T T D A T P P R Q D K M T N Q P P T P N T T D A T P P R Q D K AAACTGAACACCAACGCGATCATTGCCGTCGTCCTCATCCTCGCCGGCCTGGGCGTATTG K L N T N A I I A V V L I L A G L G V L K L N T N A I I A V V L I L A G L G V L CTATACCCGGTGCTCGCCACCCAGTGGAATAACTACCAGCAGTCCCGCGCCGCCGAGGCC L Y P V L A T Q W N N Y Q Q S R A A E A L Y P V L A T Q W N N Y Q Q S R A A E A TACTCTCAGCTGGAAAAGGGCGTGCCCCCAGAGGTCCTCAATAAGGCCTGGGAGGAGGCG Y S Q L E K G V P P E V L N K A W E E A Y S Q L E K G V P P E V L N K A W E E A CAGCAATACAACGCCAACCTCGGGGATATCGACCCCGGCGATGCGTGGACCAGCTCCGAC Q Q Y N A N L G D I D P G D A W T S S D Q Q Y N A N L G D I D P G D A W T S S D GACGAGAGCTCCCCAGCGTATCAGCGCTACCTGAAGTACCTCTCCGTCCTGAACGAGACC D E S S P A Y Q R Y L K Y L S V L N E T D E S S P A Y Q R Y L K Y L S V L N E T GAGGCCATGGGCCGCATTGTACTGCCCTCCATCAAGTCCGACCTGCCAATCTTCCACGGC E A M G R I V L P S I K S D L P I F H G E A M G R I V L P S I K S D L P I F H G ACCTCCGACCGCGTGCTGGCCCGCGGGGTCGGCCACCTTTACGGCACGGACCTGCCTGTT T S D R V L A R G V G H L Y G T D L P V T S D R V L A R G V G H L Y G T D L P V GGCGCACCCGGCGAGCTCGGCGAGGATGGCACTATCCCGCCCGCCCCACCAGAGGGCCGA G A P G E L G E D G T I P P A P P E G R G A P G E L G E D G T I P P A P P E G R CTCTCCGCACTTTCTGCCCATACCGGCCTGCAGAACGCCACCCTGTGGGACAACCTCAAC L S A L S A H T G L Q N A T L W D N L N L S A L S A H T G L Q N A T L W D N L N CAGATCAAGAAGGGCGACCCGGTCTACGTCGCCGCGGCGGGCGAGAAGCTGAAGTACGAG Q I K K G D P V Y V A A A G E K L K Y E Q I K K G D P V Y V A A A G E K L K Y E GTCCGGGACATCGAGGTCGTCACCCCGGATAAGACCAGCCTGCTACGCCGCACGCCGAAT V R D I E V V T P D K T S L L R R T P N V R D I E V V T P D K T S L L R R T P N AAGGACCTGGTCACGCTCATCACCTGCACCCCCTATGGCATCAACACCCACCGGCTGATC K D L V T L I T C T P Y G I N T H R L I K D L V T L I T C T P Y G I N T H R L I ATCACCGCCGAGCGCGTGCCGATGGACCCGCAGGAAGAGTCCGTCTTCGACGGGCAGGGC I T A E R V P M D P Q E E S V F D G Q G I T A E R V P M D P Q E E S V F D G Q G ACCACCTGGCAGTGGTGGATGTGGGCCATCCTCGCTGCCGCGGCGATCATCGTGCTGCTG T T W Q W W M W A I L A A A A I I V L L T T W Q W W M W A I L A A A A I I V L L CTGATCCGCTGGTGGTGGAAGAACTTCCGCAAGCAAGAAGGCTAGGAGGGCCCCGCAACC L I R W W W K N F R K Q E G * E G P A T L I R W W W K N F R K Q E G X E G P A T TCCGGCGCTGTGGACACCACGGAGAGTTAA S G A V D T T E S S G A V D T T E S --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.218): ATGACAAACCAACCTCCAACGCCGA*AC*ACGACGGACGCGACCCCGCCCCGCCAAGACA L Q R R T T D A T P P R Q D ------------- M D H T *L** S T D V E P E K E P AGAAACTGAAC---ACCAACGCGATCATTGCCGTCGTCCTCATCCTCGCCGGCCTGGGCG K K L N T N A I I A V V L I L A G L G R R A N SAK T S P V L A A V L V I L G V L TATTGCTATACCCGGTGCTCGCCACCCAGTGGAATAACTACCAGCAGTCCCGCGCCGCCG V L L Y P V L A T Q W N N Y Q Q S R A A V M L Y P V T S T L W N N H L A T K A A AGGCCTACTCTCAGCTGGAAAAGGGCGTGCCCCCAGAGGTCCTCAATAAGGCCTGGGAGG E A Y S Q L E K G V P P E V L N K A W E Q E Y A K L E K N A P Q E V K N T Q W E AGGCGCAGCAATACAACGCCAACCTCGGGGATATCGACCC*C*GGCGATGCGTGGACCAG E A Q Q Y N A N R G Y R P G D A W T S R A H E Y N E N -- R T T G P *I* F D P W L A CTCCGACGACGAGAGCTCCCCAGCGTATCAGCGCTACCTGAAGTACCTCTCCGTCCTGAA S D D E S S P A Y Q R Y L K Y L N R F D E N N S D Y Q E Y L D Q L --------- D CGAGACCGAGGCCATGGGCCGCATTGTACTGCCCTCCATCAAGTCCGACCTGCCAATCTT E T E A M G R I V L P S I K S D L P I F A N D A M A R L I F P K I K A D L P I F CCACGGCACCTCCGACCGCGTGCTGGCCCGCGGGGTCGGCCACCTTTACGGCACGGACCT H G T S D R V L A R G V G H L Y G T D L H G T D N D T L Q K G L G H L F G S D L GCCTGTTGGCGCACCCGGCGAGCTCGGCGAGGATGGCACTATCCCGCCCGCCCCACCAGA P V G A E P V G G --------------------------------------------- K GGGCCGACTCTCCGCACTTTCTGCCCATACCGGCCTGCAGAACGCCACCCTGTGGGACAA G R L S A L S A H T G L Q N A T L W D N G M H S V I T G H T G L A N S T M F D H CCTCAACCAGATCAAGAAGGGCGACCCGGTCTACGTCGCCGCGGCGGGCGAGAAGCTGAA L N Q I K K G D P V Y V A A A G E K L K L N K A E K G D T F Y V Q V S G E K L K GTACGAGGTCCGGGACATCGAGGTCGTCACCCCGGATAAGACCAGCCTGCTACGCCGCAC Y E V R D I E V V T P D K T S L L R R T Y V V D Q I K V V L P T E T E D L R P E GCCGAATAAGGACCTGGTCACGCTCATCACCTGCACCCCCTATGGCATCAACACCCACCG P N K D L V T L I T C T P Y G I N T H R Q G K D Y I T L I T C T P Y G I N T H R GCTGATCATCACCGCCGAGCGCGTGCCGATGGACCCGCAGGAAGAGTCCGTCTTCGAC-G L I I T A E R V P M D P Q E E S V F D L M V R G H Q V P L A P E D H E V F D K GGCAGGGCACCACCTGGCAGTGGTGGATGTGGGCCATCCTCGCTGCCGCGGCGATCATCG G Q G T T W Q W W M W A I L A A A A I I N H G A G W Q W W M Y T L L A A A A V V TGCTGCTGCTGATCCGCTGGTGGTGGAAGAACTTCCGCAAGCAAGAAGGCTAGGAG---- V L L L I R W W W K N F R K Q E G * E L L L L L R W L L K N K R D G E S Q E TTEM -GGCCCCGCAACCTCCGGCGCTGTGGACACCACGGAGAGTTAA G P A T S G A V D M N D E G A G A D D --------------- // >fig|6666666.67449.peg.605 fig|196164.1.peg.240 Mobile element protein gi|372109441|gb|CP003213.1|_572066_572902,gi|372109441|gb|CP003213.1|_572905_573414 MTTVSPRKGHDPNRVNEISAKLMENPEIAELIGELSTSTDDASDLVKGLLQASINAGLQAEMDAHLGYAHSDRTAKAQLGTPDGGNHRNGSYTKTVNSGYGTFDVTMPRDRAGTFTPRMLPKGTRRLTELDDMIISLYAGGMTVRDIQHHLATTLGVDMSPDTISTITDAVLEEVMIWQNRQLDEFYPVIFLDALRVKIRDGHRVVNKSCYMAVGVDMDGIKHILGLWIADNEGASFWASVCADLANRGVQDVFIVCCDGLKGLPEAVEATWPNSMVQTxIVHLVRAANRWVSYQDRKPVSSALREVYTAPTEDTARAALDAFEASELGRKYPQSVKVWRDAWDRFAPFLQFPPAARRVLYTTNSIESLNAELRKATRNRGQFPNDTAALKTLWLMICNIEDKRAAQRAKKAKRAIECNGYIEGAKATGWKQAINQLAVAYPDRFADYL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACTACCGTGTCACCGAGGAAAGGTCATGACCCGAACAGGGTCAACGAGATCAGCGCT M T T V S P R K G H D P N R V N E I S A M T T V S P R K G H D P N R V N E I S A AAGCTGATGGAAAATCCGGAAATCGCCGAACTGATCGGCGAGTTGTCGACTTCCACCGAT K L M E N P E I A E L I G E L S T S T D K L M E N P E I A E L I G E L S T S T D GATGCCAGCGACCTGGTCAAAGGTCTTTTGCAGGCATCGATCAACGCTGGTCTGCAGGCT D A S D L V K G L L Q A S I N A G L Q A D A S D L V K G L L Q A S I N A G L Q A GAAATGGACGCGCATCTAGGATACGCGCACTCTGATCGTACGGCGAAAGCCCAGCTGGGC E M D A H L G Y A H S D R T A K A Q L G E M D A H L G Y A H S D R T A K A Q L G ACCCCGGATGGTGGCAATCACCGCAACGGGTCGTACACCAAAACCGTCAACTCTGGCTAC T P D G G N H R N G S Y T K T V N S G Y T P D G G N H R N G S Y T K T V N S G Y GGCACCTTTGATGTGACTATGCCCCGGGATCGAGCTGGCACGTTTACGCCGCGGATGCTG G T F D V T M P R D R A G T F T P R M L G T F D V T M P R D R A G T F T P R M L CCTAAAGGCACCCGCCGTCTGACGGAGCTTGATGACATGATCATCTCCCTGTACGCCGGT P K G T R R L T E L D D M I I S L Y A G P K G T R R L T E L D D M I I S L Y A G GGGATGACCGTGCGCGATATTCAGCACCACCTCGCCACCACCCTCGGGGTGGATATGAGC G M T V R D I Q H H L A T T L G V D M S G M T V R D I Q H H L A T T L G V D M S CCAGATACGATCAGCACCATTACCGACGCGGTGTTAGAAGAGGTCATGATCTGGCAAAAC P D T I S T I T D A V L E E V M I W Q N P D T I S T I T D A V L E E V M I W Q N CGCCAGCTCGACGAGTTCTACCCAGTGATCTTCCTCGACGCGCTGCGAGTGAAGATCCGC R Q L D E F Y P V I F L D A L R V K I R R Q L D E F Y P V I F L D A L R V K I R GATGGCCACCGCGTGGTCAACAAGTCTTGCTACATGGCGGTAGGCGTCGACATGGACGGC D G H R V V N K S C Y M A V G V D M D G D G H R V V N K S C Y M A V G V D M D G ATCAAGCACATCCTGGGATTGTGGATCGCAGACAATGAAGGCGCCAGTTTTTGGGCATCC I K H I L G L W I A D N E G A S F W A S I K H I L G L W I A D N E G A S F W A S GTGTGCGCTGACCTTGCCAACCGTGGGGTCCAAGACGTGTTCATCGTCTGCTGCGACGGG V C A D L A N R G V Q D V F I V C C D G V C A D L A N R G V Q D V F I V C C D G CTCAAAGGCCTGCCGGAAGCCGTGGAGGCAACTTGGCCGAATTCCATGGTGCAGACC*TG L K G L P E A V E A T W P N S M V Q T L K G L P E A V E A T W P N S M V Q T *X* *ATCGTGCACCTGGTCCGGGCGGCCAACAGGTGGGTGTCCTACCAAGACCGCAAACCCGT I V H L V R A A N R W V S Y Q D R K P V * I V H L V R A A N R W V S Y Q D R K P V ATCAAGTGCGCTACGGGAGGTCTACACCGCACCGACCGAGGACACCGCCCGCGCCGCCCT S S A L R E V Y T A P T E D T A R A A L S S A L R E V Y T A P T E D T A R A A L GGACGCATTCGAGGCCAGTGAACTGGGCCGTAAATACCCGCAATCGGTCAAAGTCTGGCG D A F E A S E L G R K Y P Q S V K V W R D A F E A S E L G R K Y P Q S V K V W R CGACGCCTGGGACCGGTTTGCGCCATTTTTGCAGTTCCCGCCTGCGGCACGGCGGGTACT D A W D R F A P F L Q F P P A A R R V L D A W D R F A P F L Q F P P A A R R V L CTACACCACGAATTCGATCGAATCGCTGAATGCTGAGCTGCGGAAAGCCACCCGCAACCG Y T T N S I E S L N A E L R K A T R N R Y T T N S I E S L N A E L R K A T R N R CGGCCAGTTCCCGAACGATACCGCGGCGCTGAAAACGCTGTGGCTGATGATCTGCAACAT G Q F P N D T A A L K T L W L M I C N I G Q F P N D T A A L K T L W L M I C N I CGAGGACAAGCGCGCTGCCCAGCGAGCGAAGAAAGCGAAGCGCGCCATCGAATGCAACGG E D K R A A Q R A K K A K R A I E C N G E D K R A A Q R A K K A K R A I E C N G CTATATTGAAGGAGCGAAAGCCACCGGGTGGAAACAAGCCATCAACCAACTAGCCGTGGC Y I E G A K A T G W K Q A I N Q L A V A Y I E G A K A T G W K Q A I N Q L A V A TTACCCCGACCGATTCGCGGACTACTTGTAA Y P D R F A D Y L Y P D R F A D Y L --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.240): ATGACTACCGTGTCACCGAGGAAAGGTCATGACCCGAACAGGGTCAACGAGATCAGCGCT M T T V S P R K G H D P N R V N E I S A M T T V A K Q D P A D S A R I K A I E E AAGCTGATGGAAAATCCGGAAATCGCCGAACTGATCGGCGAGTTGTCGACTTCCACCGAT K L M E N P E I A E L I G E L S T S T D K L L A N P E M A K L I D E L G T S T T GATGCCAGCGACCTGGTCAAAGGTCTTTTGCAGGCATCGATCAACGCTGGTCTGCAGGCT D A S D L V K G L L Q A S I N A G L Q A D A N D L V R G L L Q A S I N R G L N A GAAATGGACGCGCATCTAGGATACGCGCACTCTGATCGT*AC*GGCGAAAGCCCAGCTGG E M D A H L G Y A H S D R G E S P A G E M D A H L G Y G H S D R *D** G K T A A G GCACCCCGGATGGTGGCAATCACCGCAACGGGTCGTACACCAAAACCGTCAACTCTGGCT H G N H R N G S Y T K T V N S G Q ---------- G N H R N G Y Y P K R V D S N ACGGCACCTTTGATGTGACTATGCCCCGGGATCGAGCTGGCACGTTTACGCCGCGGATGC Y G T F D V T M P R D R A G T F T P R M Y G P I D V A V P R D R N G S F L P T M TGCCTAAAGGCACCCGCCGTCTGACGGAGCTTGATGACATGATCATCTCCCTGTACGCCG L P K G T R R L T E L D D M I I S L Y A V P K G S R R L T D V D D M I I S L Y A GTGGGATGACCGTGCGCGATATTCAGCACCACCTCGCCACCACCCTCGGGGTGGATATGA G G M T V R D I Q H H L A T T L G V D M G G M T V R D I Q H H M I T S M G V D I GCCCAGATACGATCAGCACCATTACCGACGCGGTGTTAGAAGAGGTCATGATCTGGCAAA S P D T I S T I T D A V L E E V M I W Q S H E T I S A I T D A V L D E V M I W Q ACCGCCAGCTCGACGAGTTCTACCCAGTGATCTTCCTCGACGCGCTGCGAGTGAAGATCC N R Q L D E F Y P V I F L D A L R V K I N R Q L D D F Y P V I F L D A L R I K V GCGATGGCCACCGCGTGGTCAACAAGTCTTGCTACATGGCGGTAGGCGTCGACATGGACG R D G H R V V N K S C Y M A V G V D M D R D G G R V V N K S V Y L A I G V D M D GCATCAAGCACATCCTGGGATTGTGGATCGCAGACAATGAAGGCGCCAGTTTTTGGGCAT G I K H I L G L W I A D N E G A S F W A G I K H I L G I W L A K E E G A S F W A CCGTGTGCGCTGACCTTGCCAACCGTGGGGTCCAAGACGTGTTCATCGTCTGCTGCGACG S V C A D L A N R G V Q D V F I V C C D N V C A N L A T R G V Q D V F I V C C D GGCTCAAAGGCCTGCCGGAAGCCGTGGAGGCAACTTGGCCGAATTCCATGGTGCAGACC* G L K G L P E A V E A T W P N S M V Q T G L K G L P Q A V E A T W P D S M V Q T * TG*ATCGTGCACCTGGTCCGGGCGGCCAACAGGTGGGTGTCCTACCAAGACCGCAAACCC I V H L V R A A N R W V S Y Q D R K P C** V V H L I R A A N R W V A Y G D R K A GTATCAAGTGCGCTACGGGAGGTCTACACCGCACCGACCGAGGACACCGCCCGCGCCGCC V S S A L R E V Y T A P T E D T A R A A V S A Q L R K I Y T A P T E D T A I A A CTGGACGCATTCGAGGCCAGTGAACTGGGCCGTAAATACCCGCAATCGGTCAAAGTCTGG L D A F E A S E L G R K Y P Q S V K V W L E E F E A S E L G V K Y P Q S A K V W CGCGACGCCTGGGACCGGTTTGCGCCATTTTTGCAGTTCCCGCCTGCGGCACGGCGGGTA R D A W D R F A P F L Q F P P A A R R V R D A W D R F I P F L Q F P P M A R K V CTCTACACCACGAATTCGATCGAATCGCTGAATGCTGAGCTGCGGAAAGCCACCCGCAAC L Y T T N S I E S L N A E L R K A T R N I Y T T N S I E S M N N E L R K A T R N CGCGGCCAGTTCCCGAACGATACCGCGGCGCTGAAAACGCTGTGGCTGATGATCTGCAAC R G Q F P N D T A A L K T L W L M I C N R V Q F T N D E S A I K T L W L M I C N ATCGAGGACAAGCGCGCTGCCCAGCGAGCGAAGAAAGCGAAGCGCGCCATCGAATGCAAC I E D K R A A Q R A K K A K R A I E C N I E D K R A A K R A K Q G K R V A A S S GGCTAT-ATTGAAGGAGCGAAAGCCACCGGGTGGAAACAAGCCATCAACCAACTAGCCGT G Y I E G A K A T G W K Q A I N Q L A V G R L I E G R K V A N W K Q A I N Q M A V GGCTTACCCCGACCGATTCGCGGACTACTTGTAA A Y P D R F A D Y L A F P D R F E A Y L --- // >fig|6666666.67449.peg.1710 fig|257309.1.peg.1677 Putative pyridine nucleotide-disulphide oxidoreductase gi|372109441|gb|CP003213.1|_1741750_1742532,gi|372109441|gb|CP003213.1|_1742536_1743363 MTTTIIVGGVAGGMSTAARLRRRDEDMTILVFEASHHVSFANCGLPYHVSGVIPERSSLLLQTPESLAARFNIDVRVDHLVTAINREAGSVSVKNLVTGEVSDHHYDHLVLSPGARPILPPLPGIEKALTLRTVEDVDTIIERVAGASSSAIIGGGFIGIELAENLAHRGIATTIIERGPQILGPLDIEMAAFVEQRLRDNGISVRTNANAAAISDTGVELADGSVTADVVVAAVGVAPASDLARAAGLAVGERGGIVVDDxLRTNDPQIFALGDAAEKRDAISGADTLVPLAQTANRHGRLVADIITGRDVKRTSTLGTAIVGVFGLAAASVGWSEKRAVAAGKNIRVIHTHPASHAGYYPGAAQLHLKLVVDADTDAILGAQAVGEDGADKRIDVIATTMRAGLSATDLADLELAYSPQYGSAKDPVNLIGMVNDNIRSGERSVQWHELDAQIADGWTLVDVRTAGEFAAGNIPGAINIPVDELREHLDELQGKNVLVHCQVGLRGHVAATLLTNSGINAANLDGGYLTWKTATS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACCACCACAATCATCGTCGGCGGCGTTGCCGGCGGCATGTCCACCGCAGCACGTCTA M T T T I I V G G V A G G M S T A A R L M T T T I I V G G V A G G M S T A A R L CGTCGGCGCGACGAGGACATGACCATCCTCGTATTCGAAGCTTCACACCACGTATCCTTC R R R D E D M T I L V F E A S H H V S F R R R D E D M T I L V F E A S H H V S F GCCAACTGTGGCCTTCCCTACCACGTCAGTGGCGTAATCCCCGAGCGTTCCTCACTTCTG A N C G L P Y H V S G V I P E R S S L L A N C G L P Y H V S G V I P E R S S L L CTGCAAACCCCCGAGTCACTTGCAGCTAGGTTCAACATCGATGTGCGCGTCGATCATCTA L Q T P E S L A A R F N I D V R V D H L L Q T P E S L A A R F N I D V R V D H L GTTACCGCAATCAACCGCGAAGCTGGCAGCGTCTCCGTGAAAAACCTCGTCACCGGCGAG V T A I N R E A G S V S V K N L V T G E V T A I N R E A G S V S V K N L V T G E GTGAGCGATCACCATTACGATCATCTCGTGCTTTCTCCCGGCGCGCGCCCGATCTTGCCA V S D H H Y D H L V L S P G A R P I L P V S D H H Y D H L V L S P G A R P I L P CCGCTTCCTGGCATCGAAAAAGCTCTGACGCTCCGCACCGTCGAAGACGTAGATACCATC P L P G I E K A L T L R T V E D V D T I P L P G I E K A L T L R T V E D V D T I ATCGAACGCGTTGCTGGCGCTTCTTCATCAGCCATCATCGGCGGCGGTTTTATTGGCATC I E R V A G A S S S A I I G G G F I G I I E R V A G A S S S A I I G G G F I G I GAGCTGGCGGAAAACTTGGCACACCGGGGTATCGCCACCACGATCATCGAGCGTGGTCCA E L A E N L A H R G I A T T I I E R G P E L A E N L A H R G I A T T I I E R G P CAGATCCTTGGCCCCCTCGACATTGAGATGGCAGCGTTTGTGGAGCAGCGCCTTCGTGAC Q I L G P L D I E M A A F V E Q R L R D Q I L G P L D I E M A A F V E Q R L R D AATGGAATCAGCGTGCGTACTAACGCCAACGCTGCGGCGATCTCAGACACCGGCGTTGAG N G I S V R T N A N A A A I S D T G V E N G I S V R T N A N A A A I S D T G V E CTTGCCGACGGCTCCGTCACCGCCGATGTTGTCGTTGCGGCAGTTGGCGTAGCACCGGCA L A D G S V T A D V V V A A V G V A P A L A D G S V T A D V V V A A V G V A P A AGCGACCTTGCCCGTGCGGCAGGTCTAGCTGTTGGGGAACGCGGCGGTATCGTTGTCGAT S D L A R A A G L A V G E R G G I V V D S D L A R A A G L A V G E R G G I V V D GACTAGCTGCGGACTAACGACCCTCAGATCTTTGCGCTTGGCGATGCTGCTGAAAAACGC D * L R T N D P Q I F A L G D A A E K R D X L R T N D P Q I F A L G D A A E K R GATGCTATTTCCGGCGCCGATACTCTCGTACCACTCGCACAAACCGCTAACCGTCATGGC D A I S G A D T L V P L A Q T A N R H G D A I S G A D T L V P L A Q T A N R H G CGCTTGGTAGCGGACATCATCACTGGACGCGATGTGAAGCGCACCTCTACTTTGGGCACC R L V A D I I T G R D V K R T S T L G T R L V A D I I T G R D V K R T S T L G T GCCATCGTTGGGGTTTTCGGATTGGCAGCTGCCAGTGTTGGGTGGAGCGAAAAGCGTGCG A I V G V F G L A A A S V G W S E K R A A I V G V F G L A A A S V G W S E K R A GTAGCTGCGGGCAAGAACATTCGTGTTATTCACACGCACCCCGCAAGTCATGCCGGTTAC V A A G K N I R V I H T H P A S H A G Y V A A G K N I R V I H T H P A S H A G Y TATCCTGGCGCAGCACAACTGCACCTCAAGCTGGTCGTCGACGCTGATACCGACGCTATT Y P G A A Q L H L K L V V D A D T D A I Y P G A A Q L H L K L V V D A D T D A I CTCGGCGCTCAGGCCGTTGGTGAAGACGGCGCGGACAAGCGTATCGACGTCATCGCCACG L G A Q A V G E D G A D K R I D V I A T L G A Q A V G E D G A D K R I D V I A T ACCATGCGTGCTGGTCTCAGCGCTACCGATCTCGCAGATCTCGAGCTGGCCTACTCCCCA T M R A G L S A T D L A D L E L A Y S P T M R A G L S A T D L A D L E L A Y S P CAGTATGGTTCGGCAAAAGACCCTGTGAACCTCATTGGCATGGTTAACGACAATATCCGC Q Y G S A K D P V N L I G M V N D N I R Q Y G S A K D P V N L I G M V N D N I R TCCGGTGAGCGCAGTGTGCAATGGCATGAGCTTGATGCTCAGATTGCCGATGGCTGGACC S G E R S V Q W H E L D A Q I A D G W T S G E R S V Q W H E L D A Q I A D G W T TTGGTAGATGTTCGCACCGCCGGTGAATTCGCCGCCGGCAATATTCCAGGTGCCATCAAT L V D V R T A G E F A A G N I P G A I N L V D V R T A G E F A A G N I P G A I N ATTCCTGTCGATGAGTTACGTGAGCACCTCGATGAGCTACAGGGCAAGAATGTGCTGGTA I P V D E L R E H L D E L Q G K N V L V I P V D E L R E H L D E L Q G K N V L V CATTGTCAGGTTGGCCTAAGGGGCCACGTTGCCGCTACTCTTTTGACTAATAGCGGTATC H C Q V G L R G H V A A T L L T N S G I H C Q V G L R G H V A A T L L T N S G I AACGCCGCCAACCTCGACGGTGGTTATCTCACATGGAAAACTGCCACCTCTTAA N A A N L D G G Y L T W K T A T S N A A N L D G G Y L T W K T A T S --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1677): ATGACCACCACAATCATCGTCGGCGGCGTTGCCGGCGGCATGTCCACCGCAGCACGTCTA M T T T I I V G G V A G G M S T A A R L M T T T I I V G G V A G G M S T A A R L CGTCGGCGCGACGAGGACATGACCATCCTCGTATTCGAAGCTTCACACCACGTATCCTTC R R R D E D M T I L V F E A S H H V S F R R R D E D M T I L V F E A S N H V S F GCCAACTGTGGCCTTCCCTACCACGTCAGTGGCGTAATCCCCGAGCGTTCCTCACTTCTG A N C G L P Y H V S G V I P E R S S L L A N C G L P Y H V S G V I P E R S S L L CTGCAAACCCCCGAGTCACTTGCAGCTAGGTTCAACATCGATGTGCGCGTCGATCATCTA L Q T P E S L A A R F N I D V R V D H L L Q T P E S L A A R F N I D V R V D H L GTTACCGCAATCAACCGCGAAGCTGGCAGCGTCTCCGTGAAAAACCTCGTCACCGGCGAG V T A I N R E A G S V S V K N L V T G E V T A I N R E A G S V S V K N L A T G E GTGAGCGATCACCATTACGATCATCTCGTGCTTTCTCCCGGCGCGCGCCCGATCTTGCCA V S D H H Y D H L V L S P G A R P I L P V S E H H Y D H L V L S P G A R P I L P CCGCTTCCTGGCATCGAAAAAGCTCTGACGCTCCGCACCGTCGAAGACGTAGATACCATC P L P G I E K A L T L R T V E D V D T I P L P G I E K A L T L R T V E D V D T I ATCGAACGCGTTGCTGGCGCTTCTTCATCAGCCATCATCGGCGGCGGTTTTATTGGCATC I E R V A G A S S S A I I G G G F I G I I E R V A G A S S S A I I G G G F I G I GAGCTGGCGGAAAACTTGGCACACCGGGGTATCGCCACCACGATCATCGAGCGTGGTCCA E L A E N L A H R G I A T T I I E R G P E L A E N L A H R G I A T T I I E R G P CAGATCCTTGGCCCCCTCGACATTGAGATGGCAGCGTTTGTGGAGCAGCGCCTTCGTGAC Q I L G P L D I E M A A F V E Q R L R D Q I L G P L D I E M A A F V E Q R L R D AATGGAATCAGCGTGCGTACTAACGCCAACGCTGCGGCGATCTCAGACACCGGCGTTGAG N G I S V R T N A N A A A I S D T G V E N G I S V R T N A N A A A I S D T G V E CTTGCCGACGGCTCCGTCACCGCCGATGTTGTCGTTGCGGCAGTTGGCGTAGCACCGGCA L A D G S V T A D V V V A A V G V A P A L A D G S V T A D V V V A A V G V A P A AGCGACCTTGCCCGTGCGGCAGGTCTAGCTGTTGGGGAACGCGGCGGTATCGTTGTCGAT S D L A R A A G L A V G E R G G I V V D S D L A R A A G L A V G E R G G I V V D GACTAGCTGCGGACTAACGACCCTCAGATCTTTGCGCTTGGCGATGCTGCTGAAAAACGC D * L R T N D P Q I F A L G D A A E K R D Q L R T N D P Q I F A L G D A A E K R GATGCTATTTCCGGCGCCGATACTCTCGTACCACTCGCACAAACCGCTAACCGTCATGGC D A I S G A D T L V P L A Q T A N R H G D A I S G A D T L V P L A Q T A N R H G CGCTTGGTAGCGGACATCATCACTGGACGCGATGTGAAGCGCACCTCTACTTTGGGCACC R L V A D I I T G R D V K R T S T L G T R L V A D I I T G R D V K R T S T L G T GCCATCGTTGGGGTTTTCGGATTGGCAGCTGCCAGTGTTGGGTGGAGCGAAAAGCGTGCG A I V G V F G L A A A S V G W S E K R A A I V G V F G L A A A S V G W S E K R A GTAGCTGCGGGCAAGAACATTCGTGTTATTCACACGCACCCCGCAAGTCATGCCGGTTAC V A A G K N I R V I H T H P A S H A G Y V A A G K N I R V I H T H P A S H A G Y TATCCTGGCGCAGCACAACTGCACCTCAAGCTGGTCGTCGACGCTGATACCGACGCTATT Y P G A A Q L H L K L V V D A D T D A I Y P G A A Q L H L K L V V D A D T D A I CTCGGCGCTCAGGCCGTTGGTGAAGACGGCGCGGACAAGCGTATCGACGTCATCGCCACG L G A Q A V G E D G A D K R I D V I A T L G A Q A V G E D G A D K R I D V I A T ACCATGCGTGCTGGTCTCAGCGCTACCGATCTCGCAGATCTCGAGCTGGCCTACTCCCCA T M R A G L S A T D L A D L E L A Y S P A M R A G L S A T D L A D L E L A Y S P CAGTATGGTTCGGCAAAAGACCCTGTGAACCTCATTGGCATGGTTAACGACAATATCCGC Q Y G S A K D P V N L I G M V N D N I R Q Y G S A K D P V N L I G M V N D N I R TCCGGTGAGCGCAGTGTGCAATGGCATGAGCTTGATGCTCAGATTGCCGATGGCTGGACC S G E R S V Q W H E L D A Q I A D G W T S G E R S V Q W H E L D A Q I A D G W T TTGGTAGATGTTCGCACCGCCGGTGAATTCGCCGCCGGCAATATTCCAGGTGCCATCAAT L V D V R T A G E F A A G N I P G A I N L V D V R T A G E F A A G N I P G A I N ATTCCTGTCGATGAGTTACGTGAGCACCTCGATGAGCTACAGGGCAAGAATGTGCTGGTA I P V D E L R E H L D E L Q G K N V L V I P V D E L R E H L D E L Q G K N V L V CATTGTCAGGTTGGCCTAAGGGGCCACGTTGCCGCTACTCTTTTGACTAATAGCGGTATC H C Q V G L R G H V A A T L L T N S G I H C Q V G L R G H V A A T L L T N S G I AACGCCGCCAACCTCGACGGTGGTTATCTCACATGGAAAACTGCCACCTCTTAA N A A N L D G G Y L T W K T A T S N A A N L D G G Y L T W K T A T S --- // >fig|6666666.67449.peg.196 fig|257309.1.peg.162 Putative membrane protein gi|372109441|gb|CP003213.1|_169618_171021,gi|372109441|gb|CP003213.1|_171021_171116 MSTPITHESSSHALAEDAEVHGKNENRRQFTGLFAGLILAVLIYLVFPESSVDMVQGVDPDGEYSYNALRITAAIAVLMGVWWMTEAIPLAATALVPLVAFPVLQVIPFAKISAPYASPTIFLFMGGFILALGMQRWNLHRRLALSVVLLVGTKPKQLIAGFMLATGFLSMWVSNTATAVVMLPIGVSVLQLTAESVGGMKAQKKFATALMLAIAYSASIGSLGTIIGTPPNALMVAYMAENHDIHIGFGTWMLVGVPLAIVYMAIAWLVLVSVFKPEVDSIPGGREMIKSELAKMGSMKFGEAATAVIFTGAALSWVFVPLLIDVFQWKVEIADAAIGLIASMLLFMIPADRKTGVRLMDWKTANELPWDVLLLFGGGLALSKMFSDSGLSLWIGEIAKGLGSLPLILLIAAIAALVLLLTEFTSNTATAATFLPIMAGVAVGIGLNANGDQNILLLTIPVALSATxxKGGVWLNLIGVVLVTLATYFLAIPVFNIVL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGAGTACACCGATTACACATGAGTCTTCGTCTCATGCTCTTGCTGAGGATGCAGAGGTC V S T P I T H E S S S H A L A E D A E V M S T P I T H E S S S H A L A E D A E V CATGGGAAGAATGAGAACCGTCGGCAGTTTACGGGTTTGTTCGCTGGTTTGATTCTTGCC H G K N E N R R Q F T G L F A G L I L A H G K N E N R R Q F T G L F A G L I L A GTTTTGATTTATTTGGTGTTCCCTGAGTCGTCTGTGGACATGGTTCAGGGTGTGGATCCG V L I Y L V F P E S S V D M V Q G V D P V L I Y L V F P E S S V D M V Q G V D P GATGGGGAGTATAGCTATAACGCGTTGCGTATTACTGCTGCTATTGCGGTGTTGATGGGT D G E Y S Y N A L R I T A A I A V L M G D G E Y S Y N A L R I T A A I A V L M G GTGTGGTGGATGACGGAGGCTATTCCGTTGGCTGCGACGGCGTTGGTGCCGTTGGTGGCG V W W M T E A I P L A A T A L V P L V A V W W M T E A I P L A A T A L V P L V A TTTCCTGTTCTTCAGGTGATTCCGTTTGCGAAGATTTCTGCGCCGTATGCGTCGCCGACG F P V L Q V I P F A K I S A P Y A S P T F P V L Q V I P F A K I S A P Y A S P T ATTTTCCTTTTTATGGGTGGTTTTATTTTGGCGTTGGGTATGCAGCGTTGGAATTTGCAT I F L F M G G F I L A L G M Q R W N L H I F L F M G G F I L A L G M Q R W N L H CGTCGGTTGGCGTTGAGTGTGGTGTTGTTGGTTGGTACGAAGCCTAAGCAGTTGATTGCT R R L A L S V V L L V G T K P K Q L I A R R L A L S V V L L V G T K P K Q L I A GGGTTTATGCTGGCTACGGGCTTTTTGTCGATGTGGGTGTCTAATACTGCGACGGCTGTT G F M L A T G F L S M W V S N T A T A V G F M L A T G F L S M W V S N T A T A V GTGATGCTTCCGATTGGTGTTTCGGTGTTGCAGCTGACTGCTGAGTCGGTGGGTGGCATG V M L P I G V S V L Q L T A E S V G G M V M L P I G V S V L Q L T A E S V G G M AAGGCGCAGAAGAAGTTTGCGACTGCGTTGATGTTGGCGATTGCGTATTCGGCGTCGATT K A Q K K F A T A L M L A I A Y S A S I K A Q K K F A T A L M L A I A Y S A S I GGTTCTTTGGGCACGATTATTGGTACGCCTCCTAATGCGTTGATGGTGGCGTATATGGCG G S L G T I I G T P P N A L M V A Y M A G S L G T I I G T P P N A L M V A Y M A GAGAATCATGACATCCATATTGGTTTTGGTACGTGGATGCTGGTTGGTGTGCCGTTGGCG E N H D I H I G F G T W M L V G V P L A E N H D I H I G F G T W M L V G V P L A ATTGTTTATATGGCGATTGCTTGGTTGGTGCTGGTGTCTGTGTTTAAGCCTGAGGTGGAT I V Y M A I A W L V L V S V F K P E V D I V Y M A I A W L V L V S V F K P E V D TCGATTCCTGGTGGCCGCGAGATGATTAAGTCGGAGTTGGCCAAGATGGGGTCGATGAAG S I P G G R E M I K S E L A K M G S M K S I P G G R E M I K S E L A K M G S M K TTCGGTGAGGCTGCTACTGCGGTGATTTTTACGGGTGCGGCGTTGTCGTGGGTGTTTGTT F G E A A T A V I F T G A A L S W V F V F G E A A T A V I F T G A A L S W V F V CCGCTGCTTATCGACGTTTTCCAGTGGAAGGTTGAGATTGCGGATGCGGCTATTGGTCTG P L L I D V F Q W K V E I A D A A I G L P L L I D V F Q W K V E I A D A A I G L ATTGCTTCGATGTTGCTGTTTATGATCCCTGCGGATCGTAAGACTGGTGTGCGTTTGATG I A S M L L F M I P A D R K T G V R L M I A S M L L F M I P A D R K T G V R L M GATTGGAAGACGGCGAATGAGTTGCCGTGGGATGTGTTGTTGCTGTTCGGCGGCGGTTTG D W K T A N E L P W D V L L L F G G G L D W K T A N E L P W D V L L L F G G G L GCATTGTCTAAGATGTTCTCTGATTCTGGCTTGTCCTTGTGGATTGGTGAGATCGCCAAG A L S K M F S D S G L S L W I G E I A K A L S K M F S D S G L S L W I G E I A K GGCCTGGGCTCGCTGCCGCTGATTCTGCTGATCGCTGCGATTGCGGCGCTGGTTTTGCTG G L G S L P L I L L I A A I A A L V L L G L G S L P L I L L I A A I A A L V L L TTGACGGAGTTCACGTCGAATACTGCGACGGCTGCGACGTTCTTGCCGATCATGGCCGGT L T E F T S N T A T A A T F L P I M A G L T E F T S N T A T A A T F L P I M A G GTGGCTGTGGGTATCGGTCTGAACGCTAATGGTGACCAGAACATCTTGTTGCTGACCATC V A V G I G L N A N G D Q N I L L L T I V A V G I G L N A N G D Q N I L L L T I CCAGTGGCACTGTCGGCTACC*TG*GTCAAGGGCGGCGTGTGGCTCAACTTGATCGGTGT P V A L S A T V K G G V W L N L I G V P V A L S A T *X** X K G G V W L N L I G V GGTGCTCGTAACCCTTGCGACATACTTCCTTGCCATTCCAGTATTCAACATCGTCCTCTA V L V T L A T Y F L A I P V F N I V L V L V T L A T Y F L A I P V F N I V L -- G - ========== Now we show an alignment against a similar protein (fig|257309.1.peg.162): GTGAGTACACCGATTACACATGAGTCTTCGTCTCATGCTCTTGCTGAGGATGCAGAGGTC V S T P I T H E S S S H A L A E D A E V M S T P I T H E S S S H A L A E D A E V CATGGGAAGAATGAGAACCGTCGGCAGTTTACGGGTTTGTTCGCTGGTTTGATTCTTGCC H G K N E N R R Q F T G L F A G L I L A H G K N E N R R Q F T G L F A G L I L A GTTTTGATTTATTTGGTGTTCCCTGAGTCGTCTGTGGACATGGTTCAGGGTGTGGATCCG V L I Y L V F P E S S V D M V Q G V D P V L I Y L V F P E S S V D M V Q G V D P GATGGGGAGTATAGCTATAACGCGTTGCGTATTACTGCTGCTATTGCGGTGTTGATGGGT D G E Y S Y N A L R I T A A I A V L M G D G E Y S Y N A L R I T A A I A V L M G GTGTGGTGGATGACGGAGGCTATTCCGTTGGCTGCGACGGCGTTGGTGCCGTTGGTGGCG V W W M T E A I P L A A T A L V P L V A A W W M T E A I P L A A T A L V P L V A TTTCCTGTTCTTCAGGTGATTCCGTTTGCGAAGATTTCTGCGCCGTATGCGTCGCCGACG F P V L Q V I P F A K I S A P Y A S P T F P V L Q V I P F A K I S A P Y A S P T ATTTTCCTTTTTATGGGTGGTTTTATTTTGGCGTTGGGTATGCAGCGTTGGAATTTGCAT I F L F M G G F I L A L G M Q R W N L H I F L F M G G F I L A L G M Q R W N L H CGTCGGTTGGCGTTGAGTGTGGTGTTGTTGGTTGGTACGAAGCCTAAGCAGTTGATTGCT R R L A L S V V L L V G T K P K Q L I A R R L A L S V V L L V G T K P K Q L I A GGGTTTATGCTGGCTACGGGCTTTTTGTCGATGTGGGTGTCTAATACTGCGACGGCTGTT G F M L A T G F L S M W V S N T A T A V G F M L A T G F L S M W V S N T A T A V GTGATGCTTCCGATTGGTGTTTCGGTGTTGCAGCTGACTGCTGAGTCGGTGGGTGGCATG V M L P I G V S V L Q L T A E S V G G M V M L P I G V S V L Q L T A E S V G G M AAGGCGCAGAAGAAGTTTGCGACTGCGTTGATGTTGGCGATTGCGTATTCGGCGTCGATT K A Q K K F A T A L M L A I A Y S A S I K A Q K K F A T A L M L A I A Y S A S I GGTTCTTTGGGCACGATTATTGGTACGCCTCCTAATGCGTTGATGGTGGCGTATATGGCG G S L G T I I G T P P N A L M V A Y M A G S L G T I I G T P P N A L M V A Y M A GAGAATCATGACATCCATATTGGTTTTGGTACGTGGATGCTGGTTGGTGTGCCGTTGGCG E N H D I H I G F G T W M L V G V P L A E N H D I H I G F G T W M L V G V P L A ATTGTTTATATGGCGATTGCTTGGTTGGTGCTGGTGTCTGTGTTTAAGCCTGAGGTGGAT I V Y M A I A W L V L V S V F K P E V D I V Y M A I A W L V L V S V F K P E V D TCGATTCCTGGTGGCCGCGAGATGATTAAGTCGGAGTTGGCCAAGATGGGGTCGATGAAG S I P G G R E M I K S E L A K M G S M K S I P G G R E M I K S E L A K M G S M K TTCGGTGAGGCTGCTACTGCGGTGATTTTTACGGGTGCGGCGTTGTCGTGGGTGTTTGTT F G E A A T A V I F T G A A L S W V F V F G E A A T A V I F T G A A L S W V F V CCGCTGCTTATCGACGTTTTCCAGTGGAAGGTTGAGATTGCGGATGCGGCTATTGGTCTG P L L I D V F Q W K V E I A D A A I G L P L L I D V F Q W K V E I A D A A I G L ATTGCTTCGATGTTGCTGTTTATGATCCCTGCGGATCGTAAGACTGGTGTGCGTTTGATG I A S M L L F M I P A D R K T G V R L M I A S M L L F M I P A D R K T G V R L T GATTGGAAGACGGCGAATGAGTTGCCGTGGGATGTGTTGTTGCTGTTCGGCGGCGGTTTG D W K T A N E L P W D V L L L F G G G L D W K T A N E L P W D V L L L F G G G L GCATTGTCTAAGATGTTCTCTGATTCTGGCTTGTCCTTGTGGATTGGTGAGATCGCCAAG A L S K M F S D S G L S L W I G E I A K A L S K M F S D S G L S L W I G E I A K GGCCTGGGCTCGCTGCCGCTGATTCTGCTGATCGCTGCGATTGCGGCGCTGGTTTTGCTG G L G S L P L I L L I A A I A A L V L L G L V S L P L I L L I A A I A A L V L L TTGACGGAGTTCACGTCGAATACTGCGACGGCTGCGACGTTCTTGCCGATCATGGCCGGT L T E F T S N T A T A A T F L P I M A G L T E F T S N T A T A A T F L P I M A G GTGGCTGTGGGTATCGGTCTGAACGCTAATGGTGACCAGAACATCTTGTTGCTGACCATC V A V G I G L N A N G D Q N I L L L T I V A V G I G L N A N G D Q N I L L L T I CCAGTGGCACTGTCGGCTACC*TG*-------------------------GTCAAGGGCG P V A L S A T V K G P V A L S A T *C**AFMLPVATPPNAIAYGSGHVRIGDM V K G GCGTGTGGCTCAACTTGATCGGTGTGGTGCTCGTAACCCTTGCGACATACTTCCTTGCCA G V W L N L I G V V L V T L A T Y F L A G V W L N L I G V V L V T L A T Y F L A TTCCAGTATTCAACATCGTCCTCTAG I P V F N I V L I P V F N I V L --- // >fig|6666666.67449.peg.1409 fig|196627.4.peg.1346 PTS system, fructose-specific IIA component (EC 2.7.1.69) / PTS system, fructose-specific IIB component (EC 2.7.1.69) / PTS system, fructose-specific IIC component (EC 2.7.1.69) FIG001234 gi|372109441|gb|CP003213.1|_1425509_1425556,gi|372109441|gb|CP003213.1|_1425560_1425985,gi|372109441|gb|CP003213.1|_1425985_1426257,gi|372109441|gb|CP003213.1|_1426261_1426350,gi|372109441|gb|CP003213.1|_1426352_1426549,gi|372109441|gb|CP003213.1|_1426549_1426863,gi|372109441|gb|CP003213.1|_1426863_1427117,gi|372109441|gb|CP003213.1|_1427117_1427245,gi|372109441|gb|CP003213.1|_1427249_1427500 MPSRLIDNSLIALAPAxDSDKTSIIKELYHVMKTAGVTDDVDTLIADTLTREESGSTALPQGVAIPHCRTSAVAHPVIAFASLSKQVLFDGSQNPVDLVFLIVVPLDAKRAHLKILSTLARALINQSAEASLRAATTPAQVETIISASLDSQTAMRKIxxPSSPIRIAATTACPTGIAHTYMAADALTSAAKARGDVSLLVETQGTSDNSVLREKEIASADVVIFAADVGVRDHERFKGKRILECSPRHPxRRNRTQEFFKKYDSSTKCNSSCSSNSLRFRRKMRHAAMTGVSYMVPFVAAGGLLLALGFLLGGYDIAAGWQAIAIQHSFTDLPSHDVVIDIATGQxxSFQRSGLLLYLGAVAFAIDSMSMQFIVAALSGYIAFAIAGRSGIAPGYIGGAVSVFVGAGFLGGLVTGLLSGTLAWWLSTRRVPALISSLMPVVIVPLISSLLxxLIMFLVLGKPLSLLLLSLQNWLAGLSGSSAIILGAVLGLMMCFDLGGPVNKAAYLFVTAGLSTNEPAALHIMAAVMVAGMLPPxxALSLATIMDKKVFTDTERENGKSAWLLGLSFISEGAIPFYRRxSIRVIPSLMIGGASAGAISMGTTTGSHAPHGGIFVLFAISPAWTFLLALLIGVKVSALIVILLKRMWPVPISTTSYSKDSTAA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGCCTTCTAGGCTTATCGACAATTCACTCATCGCCCTCGCCCCTGCTTAGGATAGCGAT M P S R L I D N S L I A L A P A * D S D M P S R L I D N S L I A L A P A X D S D AAAACATCAATCATCAAGGAGCTTTATCATGTAATGAAAACAGCTGGAGTTACGGATGAC K T S I I K E L Y H V M K T A G V T D D K T S I I K E L Y H V M K T A G V T D D GTCGACACGCTGATTGCCGATACCCTCACTCGCGAAGAATCTGGCAGCACCGCACTCCCC V D T L I A D T L T R E E S G S T A L P V D T L I A D T L T R E E S G S T A L P CAAGGCGTTGCGATTCCGCATTGCAGAACGTCAGCCGTAGCACATCCTGTGATCGCTTTT Q G V A I P H C R T S A V A H P V I A F Q G V A I P H C R T S A V A H P V I A F GCATCACTAAGCAAACAAGTGCTTTTCGACGGTTCCCAAAATCCTGTGGATTTAGTCTTT A S L S K Q V L F D G S Q N P V D L V F A S L S K Q V L F D G S Q N P V D L V F CTCATTGTAGTTCCACTCGATGCGAAAAGAGCTCACCTCAAAATTCTTTCAACCTTGGCG L I V V P L D A K R A H L K I L S T L A L I V V P L D A K R A H L K I L S T L A CGAGCATTGATCAATCAATCAGCCGAAGCATCCTTGCGTGCTGCGACTACTCCAGCACAG R A L I N Q S A E A S L R A A T T P A Q R A L I N Q S A E A S L R A A T T P A Q GTAGAAACAATTATTTCTGCATCGCTAGATTCACAAACGGCAATGCGGAAAATA*AT*GC V E T I I S A S L D S Q T A M R K I A V E T I I S A S L D S Q T A M R K I *X** X ACCGAGTTCTCCTATAAGGATTGCGGCAACAACCGCATGTCCTACTGGGATCGCCCATAC P S S P I R I A A T T A C P T G I A H T P S S P I R I A A T T A C P T G I A H T CTATATGGCAGCGGATGCACTTACTTCGGCCGCGAAAGCACGTGGCGACGTCTCATTGTT Y M A A D A L T S A A K A R G D V S L L Y M A A D A L T S A A K A R G D V S L L AGTAGAAACTCAAGGCACTTCTGACAACTCAGTATTAAGAGAAAAAGAGATCGCTTCAGC V E T Q G T S D N S V L R E K E I A S A V E T Q G T S D N S V L R E K E I A S A TGATGTTGTTATCTTTGCAGCCGATGTGGGAGTGCGTGACCATGAGCGATTCAAAGGAAA D V V I F A A D V G V R D H E R F K G K D V V I F A A D V G V R D H E R F K G K ACGAATCCTTGAATGCAGCCCACGACACCCTTAGCGCCGCAATCGCACTCAAGAATTCTT R I L E C S P R H P * R R N R T Q E F F R I L E C S P R H P X R R N R T Q E F F CAAGAAATACGACAGTTCGACCAAATGCAACTCATCGTGTAGCAGCAACAGCCTACGATT K K Y D S S T K C N S S C S S N S L R F K K Y D S S T K C N S S C S S N S L R F TAGAACGAAAAATGCGCCACGCTGCGATGACTGGTGTTTCCTACATGGTTCCGTTCGTAG R R K M R H A A M T G V S Y M V P F V R - R K M R H A A M T G V S Y M V P F V CAGCCGGCGGATTACTGTTAGCCCTCGGATTTCTTTTGGGAGGCTACGACATAGCTGCTG A A G G L L L A L G F L L G G Y D I A A A A G G L L L A L G F L L G G Y D I A A GATGGCAGGCAATTGCCATTCAGCATTCGTTCACTGATCTGCCCAGCCACGATGTGGTCA G W Q A I A I Q H S F T D L P S H D V V G W Q A I A I Q H S F T D L P S H D V V TCGATATAGCAACAGGACAG*TC*GTATCATTTCAGCGCTCTGGCCTTTTGCTTTATCTT I D I A T G Q V S F Q R S G L L L Y L I D I A T G Q *X** X S F Q R S G L L L Y L GGCGCTGTGGCTTTTGCTATCGACTCAATGTCAATGCAATTTATTGTGGCTGCACTTTCA G A V A F A I D S M S M Q F I V A A L S G A V A F A I D S M S M Q F I V A A L S GGATACATTGCGTTTGCTATCGCTGGACGCTCAGGAATAGCTCCAGGTTATATCGGCGGT G Y I A F A I A G R S G I A P G Y I G G G Y I A F A I A G R S G I A P G Y I G G GCGGTATCAGTCTTCGTTGGCGCAGGCTTTTTGGGCGGATTAGTCACCGGGCTACTGTCT A V S V F V G A G F L G G L V T G L L S A V S V F V G A G F L G G L V T G L L S GGAACGCTTGCATGGTGGCTTTCTACGAGGCGGGTTCCCGCACTTATCTCGTCGCTTATG G T L A W W L S T R R V P A L I S S L M G T L A W W L S T R R V P A L I S S L M CCCGTAGTAATTGTTCCGCTCATTTCCAGTCTTTTG*TG*GGTTTGATCATGTTCTTAGT P V V I V P L I S S L L G L I M F L V P V V I V P L I S S L L *X** X L I M F L V TTTAGGCAAACCCCTTTCATTGTTGCTGTTATCCCTCCAAAACTGGCTGGCAGGACTATC L G K P L S L L L L S L Q N W L A G L S L G K P L S L L L L S L Q N W L A G L S GGGTTCTTCAGCCATCATTCTTGGGGCAGTGCTGGGACTTATGATGTGTTTCGACCTCGG G S S A I I L G A V L G L M M C F D L G G S S A I I L G A V L G L M M C F D L G TGGCCCTGTAAATAAAGCAGCATATTTATTTGTTACCGCAGGCCTGTCCACCAATGAACC G P V N K A A Y L F V T A G L S T N E P G P V N K A A Y L F V T A G L S T N E P TGCTGCGCTTCATATTATGGCGGCAGTCATGGTCGCAGGTATGCTCCCCCCC*CG*ATTG A A L H I M A A V M V A G M L P P I A A L H I M A A V M V A G M L P P *X** X CACTTTCTTTAGCCACCATTATGGATAAAAAAGTGTTTACAGATACCGAACGAGAAAACG A L S L A T I M D K K V F T D T E R E N A L S L A T I M D K K V F T D T E R E N GAAAATCAGCGTGGCTTTTAGGACTTTCCTTCATTTCTGAAGGAGCGATCCCTTTTTACC G K S A W L L G L S F I S E G A I P F Y G K S A W L L G L S F I S E G A I P F Y GCAGGTGATCGATTAGGGTGATACCATCATTGATGATTGGAGGCGCATCAGCTGGCGCAA R R * S I R V I P S L M I G G A S A G A R R X S I R V I P S L M I G G A S A G A TTTCCATGGGGACCACGACTGGCTCGCATGCTCCGCATGGCGGAATTTTTGTACTCTTTG I S M G T T T G S H A P H G G I F V L F I S M G T T T G S H A P H G G I F V L F CGATTTCTCCAGCGTGGACATTCCTCTTAGCTTTACTCATTGGCGTGAAGGTTTCCGCGC A I S P A W T F L L A L L I G V K V S A A I S P A W T F L L A L L I G V K V S A TCATTGTCATTCTCTTAAAGCGTATGTGGCCCGTTCCAATCTCCACGACTTCGTACAGTA L I V I L L K R M W P V P I S T T S Y S L I V I L L K R M W P V P I S T T S Y S AAGACAGTACGGCGGCCTAA K D S T A A K D S T A A --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.1346): ATGCCTTCTAGGCTTATCGACAATTCACTCATCGCCCTCGCCCCTGCTTAGGATAGCGAT M P S L I D N S L I A L A P A * D S D M N S --- V N N S S L V R L D V D F G D S AAAACATCAATCATCAAGGAGCTTTATCATGTAATGAAAACAGCTGGAGTTACGGATGAC K T S I I K E L Y H V M K T A G V T D D T T D V I N N L A T V I F D A G R A S S GTCGACACGCTGATTGCCGATACCCTCACTCGCGAAGAATCTGGCAGCACCGCACTCCCC V D T L I A D T L T R E E S G S T A L P A D A L A K D A L D R E A K S G T G V P CAAGGCGTTGCGATTCCGCATTGCAGAACGTCAGCCGTAGCACATCCTGTGATCGCTTTT Q G V A I P H C R T S A V A H P V I A F G Q V A I P H C R S E A V S V P T L G F GCATCACTAAGCAAACAAGTGCTTTTCGACGGTTCCCAAAATCCTGTGGATTTAGTCTTT A S L S K Q V L F D G S Q N P V D L V F A R L S K G V D F S G P D G D A N L V F CTCATTGTAGTTCCACTCGATGCGAAAAGAGCTCACCTCAAAATTCTTTCAACCTTGGCG L I V V P L D A K R A H L K I L S T L A L I A A P A G G G K E H L K I L S K L A CGAGCATTGATCAATCAATCAGCCGAAGCATCCTTGCGTGCTGCGACTACTCCAGCACAG R A L I N Q S A E A S L R A A T T P A Q R S L V K K D F I K A L Q E A T T E Q E GTAGAAACAATTATTTCTGCATCGCTAGAT------------TCACAAACGGCA*AT*GC V E T I I S A S L D S Q T A A I V D V V D A V L N PAPKTTEPAAAP A A A A *V** A GGAAAATAATGCACCGAGTTCTCCTATA-AGGATTGCGGCAACAACCGCATGTCCTACTG E N N A P S S P I R I A A T T A C P T E S G A A S T S V T R I V A I T A C P T GGATCGCCCATACCTATATGGCAGCGGATGCACTTACTTCGGCCGCGAAAGCACGTGGCG G I A H T Y M A A D A L T S A A K A R G G I A H T Y M A A D S L T Q N A E G R D ACGTCTCATTGTTAGTAGAAACTCAAGGCACTTCTGACAACTCAGTATTAAGAGAAAAAG D V S L L V E T Q G T S D N S V L R E K D V E L V V E T Q G S S A V T P V D P K AGATCGCTTCAGCTGATGTTGTTATCTTTGCAGCCGATGTGGGAGTGCGTGACCATGAGC E I A S A D V V I F A A D V G V R D H E I I E A A D A V I F A T D V G V K D R E GATTCAAAGGAAAACGAATCCTTGAATGCAGC-------CCA*C*GACACCCTTAGCGCC R F K G K R I L E C S P D T L S A R F A G K P V I E S G VKRAINE P *A* K M I D E GCAATCGCACTCAAGAATTCTTCAAGAAATACGACAGTTCGACCAAATGCAACTCATCGT A I A S S R N T T V R P N A T H R A I A --------- A S K N P N A R K V S G S G GTAGCAGCAACAGCCTACGATTTAGAACGAAAAATG------CGCCACGCTGCGATGACT V A A T A Y D L E R K M R H A A M T V A A S A E T T G E K L GWGKRI Q Q A V M T GGTGTTTCCTACATGGTTCCGTTCGTAGCAGCCGGCGGATTACTGTTAGCCCTCGGATTT G V S Y M V P F V A A G G L L L A L G F G V S Y M V P F V A A G G L L L A L G F CTTTTGGGAGGCTACGACATAGCTGCTGGATGGCAGGCAATTGCCATTCAGCATTCGTTC L L G G Y D I A A G W Q A I A I Q H S F A F G G Y D M A N G W Q A I A T Q F S L ACTGATCTGCCCAGCCACGATGTGGTCATCGAT-ATAGCAACAGGACAGTCGTATCATTT T D L P S H D V V I D I A V S F T N L P G N T V D V D G V A ----------- M T F CAGCGCTCTGGCCTTTTGCTTTATCTTGGCGCTGTGGCTTTTGCTATCGACTCAATGTCA Q R S G L L L Y L G A V A F A I D S M S E R S G F L L Y F G A V L F A T G Q A A ATGCAATTTATTGTGGCTGCACTTTCAGGATACATTGCGTTTGCTATCGCTGGACGCTCA M Q F I V A A L S G Y I A F A I A G R S M G F I V A A L S G Y T A Y A L A G R P GGAATAGCTCCAGGTTATATCGGCGGTGCGGTATCAGTCTTCGTTGGCGCAGGCTTTTTG G I A P G Y I G G A V S V F V G A G F L G I A P G F V G G A I S V T I G A G F I GGCGGATTAGTCACCGGGCTACTGTCTGGAACGCTTGCATGGTGGCTTTCTACGAGGCGG G G L V T G L L S G T L A W W L S T R R G G L V T G I L A G L I A L W I G S W K GTTCCCGCACTTATCTCGTCGCTTATGCCCGTAGTAATTGTTCCGCTCATTTCCAGTCTT V P A L I S S L M P V V I V P L I S S L V P R V V Q S L M P V V I I P L L T S V *TT*GTGGGTTTGATCATGTTCTTAGTTTTAGGCAAACCCCTTTCATTGTTGCTGTTATC V G L I M F L V L G K P L S L L L L S *V** V G L V M Y L L L G R P L A S I M T G CCTCCAAAACTGGCTGGCAGGACTATCGGGTTCTTCAGCCATCATTCTTGGGGCAGTGCT L Q N W L A G L S G S S A I I L G A V L L Q D W L S S M S G S S A I L L G I I L GGGACTTATGATGTGTTTCGACCTCGGTGGCCCTGTAAATAAAGCAGCATATTTATTTGT G L M M C F D L G G P V N K A A Y L F V G L M M C F D L G G P V N K A A Y L F G TACCGCAGGCCTGTCCACCAATGAACCTGCTGCGCTTCATATTATGGCGGCAGTCATGGT T A G L S T N E P A A L H I M A A V M V T A G L S T G D Q A S M E I M A A I M A CGCAGGTATGCTCCCCCCCCGATTGCACTTTCTTTAGCCACCATTATGGATAAAAAAGTG A G M L P P I A L S L A T I M D K K V A G M V P P -- I A L S I A T L L R K K L TTTACAGATACCGAACGAGAAAACGGAAAATCAGCGTGGCTTTTAGGACTTTCCTTCATT F T D T E R E N G K S A W L L G L S F I F T P A E Q E N G K S S W L L G L A F V TCTGAAGGAGCGATCCCTTTTTACCGCAGGTGAT*CG*ATTAGGGTGATACCATCATTGA S E G A I P F T A G D I R V I P S L S E G A I P F - A A A D *P** F R V I P A M TGATTGGAGGCGCATCAGCTGGCGCAATTTCCATGGGGACCACGACTGGCTCGCATGCTC M I G G A S A G A I S M G T T T G S H A M A G G A T T G A I S M A L G V G S R A CGCATGGCGGAATTTTTGTACTCTTTGCGATTTCTCCAGCGTGGACATTCCTCTTAGCTT P H G G I F V L F A I S P A W T F L L A P H G G I F V V W A I E P W W G W L I A TACTCATTGGCGTGAAGGTTTCCGCGCTCATTGTCATTCTCTTAAAGCGTATGTGGCCCG L L I G V K V S A L I V I L L K R M W P L A A G T I V S T I V V I A L K Q F W P TTCCAATCTCCACGACTTCGTACAGTAAAGACAGTACGGCGGCCTAA---- V P I S T T S Y S K D S T A A * N K A V A A E V A K Q E A Q Q A AVNA // >fig|6666666.67449.peg.752 fig|257309.1.peg.1998 Putative transposase for insertion element gi|372109441|gb|CP003213.1|_734122_733376,gi|372109441|gb|CP003213.1|_733376_732915 MTYDYVIGMDACKYFHHACVLDIDGTQVLSKRINQNEQSLRALFSAFSAYDHKVLVVVDQPNNIGRLTVAVAQDIGIDVRYLPGLAMRQLSRIHAGNAKTDIRDAYIIAHAAKNLPESLRSVDRVEEAFLQLKVLNGIDEDLARSYTRLINQIRSALVGCYPQFEQALRGQIIHRKWVLHLLARYGGPTKIKRLGKAKAAAFARRYKARNPEPVLDAIFAAISEQTVTIAGAHYAEMGVAMSAKDALLxxEHRQQIEKEVIELINDIPHTQFLLSMPGIGPKTAAQILMTAGDMSDFPSAGHLASYAGLSPRTNQSGTSIMSNSLNRAGNKKLKNALWQSSFASIRFHERSRQFYERKRREGKRHNAAVVALARRRLNVLYAMMRNHEHYHDPAPSQEDLAA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACCTACGACTATGTCATCGGCATGGACGCCTGCAAATACTTTCACCACGCTTGCGTC M T Y D Y V I G M D A C K Y F H H A C V M T Y D Y V I G M D A C K Y F H H A C V TTAGATATCGACGGCACCCAGGTGCTATCTAAGCGCATCAATCAAAATGAACAATCCCTG L D I D G T Q V L S K R I N Q N E Q S L L D I D G T Q V L S K R I N Q N E Q S L CGCGCACTGTTTTCAGCGTTCAGCGCATACGACCACAAGGTCCTTGTCGTCGTGGACCAG R A L F S A F S A Y D H K V L V V V D Q R A L F S A F S A Y D H K V L V V V D Q CCCAATAACATTGGGCGACTAACTGTCGCAGTTGCCCAAGATATCGGAATCGACGTGCGC P N N I G R L T V A V A Q D I G I D V R P N N I G R L T V A V A Q D I G I D V R TACCTTCCAGGTTTGGCTATGCGTCAACTCTCGCGCATCCACGCTGGTAATGCCAAAACT Y L P G L A M R Q L S R I H A G N A K T Y L P G L A M R Q L S R I H A G N A K T GATATCCGGGATGCATATATCATCGCCCACGCTGCAAAGAACCTTCCGGAATCCCTCCGC D I R D A Y I I A H A A K N L P E S L R D I R D A Y I I A H A A K N L P E S L R AGTGTCGACCGCGTCGAAGAAGCCTTCCTCCAGTTGAAAGTCCTCAACGGCATCGACGAA S V D R V E E A F L Q L K V L N G I D E S V D R V E E A F L Q L K V L N G I D E GACTTAGCGCGCTCCTACACCAGGCTCATCAATCAGATTCGAAGTGCATTAGTTGGCTGT D L A R S Y T R L I N Q I R S A L V G C D L A R S Y T R L I N Q I R S A L V G C TACCCGCAATTCGAACAAGCCCTTCGCGGCCAGATAATCCACCGCAAGTGGGTTCTGCAC Y P Q F E Q A L R G Q I I H R K W V L H Y P Q F E Q A L R G Q I I H R K W V L H CTACTTGCACGCTACGGCGGGCCCACCAAGATAAAGCGCTTAGGTAAGGCCAAGGCAGCC L L A R Y G G P T K I K R L G K A K A A L L A R Y G G P T K I K R L G K A K A A GCCTTTGCTCGACGATATAAGGCACGAAATCCCGAACCTGTCCTCGATGCCATATTCGCT A F A R R Y K A R N P E P V L D A I F A A F A R R Y K A R N P E P V L D A I F A GCCATCTCTGAGCAAACAGTCACTATTGCAGGTGCACACTATGCCGAAATGGGCGTAGCA A I S E Q T V T I A G A H Y A E M G V A A I S E Q T V T I A G A H Y A E M G V A ATGTCGGCGAAGGACGCACTTTTA*AG*CTCGAGCACCGCCAACAAATCGAAAAGGAAGT M S A K D A L L L E H R Q Q I E K E V M S A K D A L L *X** X E H R Q Q I E K E V CATCGAGCTCATCAACGACATCCCCCACACCCAATTCCTGCTATCCATGCCGGGAATCGG I E L I N D I P H T Q F L L S M P G I G I E L I N D I P H T Q F L L S M P G I G GCCAAAGACGGCTGCCCAAATTCTTATGACCGCGGGCGATATGTCCGACTTTCCGTCAGC P K T A A Q I L M T A G D M S D F P S A P K T A A Q I L M T A G D M S D F P S A TGGGCACCTAGCCTCCTACGCTGGCTTATCGCCCCGAACGAATCAGTCCGGAACCTCAAT G H L A S Y A G L S P R T N Q S G T S I G H L A S Y A G L S P R T N Q S G T S I CATGTCGAACTCACTGAACCGAGCCGGCAATAAAAAATTAAAGAACGCCCTATGGCAATC M S N S L N R A G N K K L K N A L W Q S M S N S L N R A G N K K L K N A L W Q S ATCTTTTGCATCCATCAGATTCCACGAGCGTTCTCGGCAATTCTATGAACGAAAGCGCCG S F A S I R F H E R S R Q F Y E R K R R S F A S I R F H E R S R Q F Y E R K R R TGAAGGCAAAAGGCACAACGCCGCAGTAGTAGCACTAGCCCGCAGACGACTCAACGTCCT E G K R H N A A V V A L A R R R L N V L E G K R H N A A V V A L A R R R L N V L CTACGCCATGATGCGCAACCACGAGCACTACCACGATCCCGCACCATCACAGGAAGACCT Y A M M R N H E H Y H D P A P S Q E D L Y A M M R N H E H Y H D P A P S Q E D L AGCAGCCTAG A A A A --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1998): ATGACCTACGACTATGTCATCGGCATGGACGCCTGCAAATACTTTCACCACGCTTGCGTC M T Y D Y V I G M D A C K Y F H H A C V M T Y D Y V I G M D A C K Y F H H A C V TTAGATATCGACGGCACCCAGGTGCTATCTAAGCGCATCAATCAAAATGAACAATCCCTG L D I D G T Q V L S K R I N Q N E Q S L L D I D G T Q V L S K R I N Q N E Q S L CGCGCACTGTTTTCAGCGTTCAGCGCATACGACCACAAGGTCCTTGTCGTCGTGGACCAG R A L F S A F S A Y D H K V L V V V D Q R A L F S A F S A Y D H K V L V V V D Q CCCAATAACATTGGGCGACTAACTGTCGCAGTTGCCCAAGATATCGGAATCGACGTGCGC P N N I G R L T V A V A Q D I G I D V R P N N I G R L T V A V A Q D I G I D V R TACCTTCCAGGTTTGGCTATGCGTCAACTCTCGCGCATCCACGCTGGTAATGCCAAAACT Y L P G L A M R Q L S R I H A G N A K T Y L P G L A M R Q L S R I H A G N A K T GATATCCGGGATGCATATATCATCGCCCACGCTGCAAAGAACCTTCCGGAATCCCTCCGC D I R D A Y I I A H A A K N L P E S L R D I R D A Y I I A H A A K N L P E S L R AGTGTCGACCGCGTCGAAGAAGCCTTCCTCCAGTTGAAAGTCCTCAACGGCATCGACGAA S V D R V E E A F L Q L K V L N G I D E S V D R V E E A F L Q L K V L N G I D E GACTTAGCGCGCTCCTACACCAGGCTCATCAATCAGATTCGAAGTGCATTAGTTGGCTGT D L A R S Y T R L I N Q I R S A L V G C D L A R S Y T R L I N Q I R S A L V G C TACCCGCAATTCGAACAAGCCCTTCGCGGCCAGATAATCCACCGCAAGTGGGTTCTGCAC Y P Q F E Q A L R G Q I I H R K W V L H Y P Q F E Q A L R G Q I I H R K W V L H CTACTTGCACGCTACGGCGGGCCCACCAAGATAAAGCGCTTAGGTAAGGCCAAGGCAGCC L L A R Y G G P T K I K R L G K A K A A L L A R Y G G P T K I K R L G K A K A A GCCTTTGCTCGACGATATAAGGCACGAAATCCCGAACCTGTCCTCGATGCCATATTCGCT A F A R R Y K A R N P E P V L D A I F A A F A R R Y K A R N P E P V L D A I F A GCCATCTCTGAGCAAACAGTCACTATTGCAGGTGCACACTATGCCGAAATGGGCGTAGCA A I S E Q T V T I A G A H Y A E M G V A A I S E Q T V T I A G A H Y A E M G V A ATGTCGGCGAAGGACGCACTT*TT*AAGCTCGAGCACCGCCAACAAATCGAAAAGGAAGT M S A K D A L K L E H R Q Q I E K E V M S A K D A L *L** K L E H R Q Q I E K E V CATCGAGCTCATCAACGACATCCCCCACACCCAATTCCTGCTATCCATGCCGGGAATCGG I E L I N D I P H T Q F L L S M P G I G I E L I N D I P H T Q F L L S M P G I G GCCAAAGACGGCTGCCCAAATTCTTATGACCGCGGGCGATATGTCCGACTTTCCGTCAGC P K T A A Q I L M T A G D M S D F P S A P K T A A Q I L M T A G D M S D F P S A TGGGCACCTAGCCTCCTACGCTGGCTTATCGCCCCGAACGAATCAGTCCGGAACCTCAAT G H L A S Y A G L S P R T N Q S G T S I G H L A S Y A G L S P R T N Q S G T S I CATGTCGAACTCACTGAACCGAGCCGGCAATAAAAAATTAAAGAACGCCCTATGGCAATC M S N S L N R A G N K K L K N A L W Q S M S N S L N R A G N K K L K N A L W Q S ATCTTTTGCATCCATCAGATTCCACGAGCGTTCTCGGCAATTCTATGAACGAAAGCGCCG S F A S I R F H E R S R Q F Y E R K R R S F A S I R F H E R S R Q F Y E R K R R TGAAGGCAAAAGGCACAACGCCGCAGTAGTAGCACTAGCCCGCAGACGACTCAACGTCCT E G K R H N A A V V A L A R R R L N V L E G K R H N A A V V A L A R R R L N V L CTACGCCATGATGCGCAACCACGAGCACTACCACGATCCCGCACCATCACAGGAAGACCT Y A M M R N H E H Y H D P A P S Q E D L Y A M M R N H E H Y H D P A P S Q E D L AGCAGCCTAG A A A A --- // >fig|6666666.67449.peg.33 fig|196164.1.peg.1407 Thiamin biosynthesis protein ThiC FIG000581 gi|372109441|gb|CP003213.1|_30085_30141,gi|372109441|gb|CP003213.1|_30145_32022 MLGACSRLVSVPRGRPSTGxDCADAVQAPFEPVWLTPAKEERSASLVSAASANSVTNPSAWENSEIHPKHSYSPIVSGDLEVPETEIQLDDSPTGPNDPVRIYRTRGPECDPTVGLKPLRAQWIDSREDTEEYAGRERNLADDGRSAQRRGAASLEWKGVKPTPRRAKQGKRVTQMHYARQGIITKEMEFVALREHMDPEFVRSEIARGRAIIPNNINHPESEPMIIGRKFLTKINANIGNSAVTSSIEEEVSKLRWATRWGADTVMDLSTGDDIHTTREWIIRNSPVPIGTVPIYQALEKVNGVAEDLTWEIFRDTVIEQCEQGVDYMTIHAGVLLAYIPLTTKRVTGIVSRGGSIMAGWCLAHHKESFLYEHFDELCEIFAQYDVAFSLGDGLRPGSVADANDAAQFAELKTIGELARRAWEYDVQVMIEGPGHVPLNMVQENNELEQKWAHDAPFYTLGPLVTDIAPGYDHITSAIGAAHIAMGGTAMLCYVTPKEHLGLPNRDDVKTGVITYKLAAHAADVAKGHPGARAWDDAMSKARFEFRWHDQFALSLDPDTAIAYHDETLPAEPAKTAHFCSMCGPKFCSMRISQDIRDMFADKIADLGIPQVGGDAEAGMAAKSEEFVAQGSQLYSEVRDNAAHA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGTTGGGTGCGTGTTCTAGGTTAGTGAGTGTCCCCCGCGGGCGCCCGAGCACGGGCTGA M L G A C S R L V S V P R G R P S T G * M L G A C S R L V S V P R G R P S T G X GATTGCGCTGATGCTGTGCAAGCACCGTTTGAACCTGTCTGGTTAACACCAGCGAAGGAA D C A D A V Q A P F E P V W L T P A K E D C A D A V Q A P F E P V W L T P A K E GAGAGGAGCGCGAGCCTAGTGTCGGCAGCCTCAGCTAATTCAGTAACCAATCCATCTGCT E R S A S L V S A A S A N S V T N P S A E R S A S L V S A A S A N S V T N P S A TGGGAAAACTCCGAGATCCATCCGAAGCACTCGTATTCGCCGATCGTTTCCGGTGACCTT W E N S E I H P K H S Y S P I V S G D L W E N S E I H P K H S Y S P I V S G D L GAGGTCCCAGAAACAGAGATTCAGCTTGACGATTCTCCTACCGGCCCCAATGATCCAGTT E V P E T E I Q L D D S P T G P N D P V E V P E T E I Q L D D S P T G P N D P V CGGATCTATCGCACCCGTGGCCCTGAGTGTGATCCCACGGTGGGATTGAAGCCACTGCGC R I Y R T R G P E C D P T V G L K P L R R I Y R T R G P E C D P T V G L K P L R GCACAGTGGATTGATAGCCGTGAGGACACGGAAGAATATGCTGGCCGTGAGCGGAATTTG A Q W I D S R E D T E E Y A G R E R N L A Q W I D S R E D T E E Y A G R E R N L GCTGATGATGGCCGCTCCGCGCAGCGTCGTGGCGCAGCGTCGCTGGAGTGGAAAGGTGTG A D D G R S A Q R R G A A S L E W K G V A D D G R S A Q R R G A A S L E W K G V AAACCCACACCGCGACGCGCCAAGCAGGGCAAGCGCGTGACTCAGATGCACTATGCACGC K P T P R R A K Q G K R V T Q M H Y A R K P T P R R A K Q G K R V T Q M H Y A R CAGGGCATTATTACGAAGGAAATGGAGTTCGTGGCGCTGCGCGAGCACATGGACCCAGAG Q G I I T K E M E F V A L R E H M D P E Q G I I T K E M E F V A L R E H M D P E TTTGTGCGCAGCGAGATCGCCCGCGGCCGTGCGATCATTCCGAACAACATTAACCACCCA F V R S E I A R G R A I I P N N I N H P F V R S E I A R G R A I I P N N I N H P GAATCGGAGCCCATGATTATTGGTCGAAAGTTTTTGACCAAGATCAACGCCAATATCGGT E S E P M I I G R K F L T K I N A N I G E S E P M I I G R K F L T K I N A N I G AACTCCGCTGTGACCTCCAGTATTGAGGAAGAAGTATCCAAGCTGCGGTGGGCTACCCGC N S A V T S S I E E E V S K L R W A T R N S A V T S S I E E E V S K L R W A T R TGGGGTGCAGATACCGTGATGGATTTGTCCACCGGCGATGATATTCACACCACCCGCGAA W G A D T V M D L S T G D D I H T T R E W G A D T V M D L S T G D D I H T T R E TGGATTATCCGCAACTCCCCAGTACCAATCGGTACGGTGCCGATCTACCAAGCGCTGGAA W I I R N S P V P I G T V P I Y Q A L E W I I R N S P V P I G T V P I Y Q A L E AAAGTAAATGGTGTAGCAGAAGACCTTACGTGGGAGATTTTCCGCGATACCGTCATTGAA K V N G V A E D L T W E I F R D T V I E K V N G V A E D L T W E I F R D T V I E CAGTGTGAACAAGGTGTGGACTACATGACCATTCACGCCGGTGTGTTGCTCGCCTACATT Q C E Q G V D Y M T I H A G V L L A Y I Q C E Q G V D Y M T I H A G V L L A Y I CCACTGACCACCAAACGCGTGACCGGAATTGTATCCCGTGGTGGATCCATCATGGCGGGT P L T T K R V T G I V S R G G S I M A G P L T T K R V T G I V S R G G S I M A G TGGTGCCTGGCTCACCATAAGGAGTCCTTCCTTTACGAGCACTTTGATGAGCTGTGCGAG W C L A H H K E S F L Y E H F D E L C E W C L A H H K E S F L Y E H F D E L C E ATTTTCGCGCAGTACGACGTCGCCTTCTCGCTGGGTGATGGCCTGCGCCCTGGTTCTGTT I F A Q Y D V A F S L G D G L R P G S V I F A Q Y D V A F S L G D G L R P G S V GCCGATGCGAATGATGCGGCCCAGTTCGCGGAGCTGAAAACCATTGGTGAGCTGGCTCGT A D A N D A A Q F A E L K T I G E L A R A D A N D A A Q F A E L K T I G E L A R CGTGCGTGGGAATACGATGTGCAGGTCATGATCGAGGGCCCAGGTCACGTTCCGCTGAAC R A W E Y D V Q V M I E G P G H V P L N R A W E Y D V Q V M I E G P G H V P L N ATGGTGCAGGAAAACAATGAGCTGGAGCAAAAGTGGGCTCACGATGCGCCTTTCTACACT M V Q E N N E L E Q K W A H D A P F Y T M V Q E N N E L E Q K W A H D A P F Y T CTTGGCCCATTGGTGACCGATATTGCGCCAGGCTATGACCACATCACCTCTGCAATTGGA L G P L V T D I A P G Y D H I T S A I G L G P L V T D I A P G Y D H I T S A I G GCTGCTCATATCGCTATGGGTGGTACGGCGATGCTGTGTTATGTGACCCCCAAGGAGCAC A A H I A M G G T A M L C Y V T P K E H A A H I A M G G T A M L C Y V T P K E H TTGGGTCTGCCCAACCGTGATGACGTAAAAACCGGTGTGATTACTTATAAACTTGCAGCT L G L P N R D D V K T G V I T Y K L A A L G L P N R D D V K T G V I T Y K L A A CACGCGGCTGATGTGGCTAAGGGGCACCCCGGTGCTCGTGCGTGGGATGACGCGATGAGC H A A D V A K G H P G A R A W D D A M S H A A D V A K G H P G A R A W D D A M S AAGGCACGTTTTGAGTTCCGTTGGCACGATCAGTTCGCGTTGTCGCTTGATCCAGATACC K A R F E F R W H D Q F A L S L D P D T K A R F E F R W H D Q F A L S L D P D T GCGATTGCTTACCATGACGAAACGCTTCCGGCGGAGCCGGCAAAGACTGCGCACTTCTGT A I A Y H D E T L P A E P A K T A H F C A I A Y H D E T L P A E P A K T A H F C TCCATGTGTGGTCCGAAGTTCTGCTCCATGCGCATTAGCCAAGATATTCGTGACATGTTC S M C G P K F C S M R I S Q D I R D M F S M C G P K F C S M R I S Q D I R D M F GCAGATAAGATCGCCGACTTGGGTATCCCGCAGGTTGGCGGCGACGCAGAAGCTGGCATG A D K I A D L G I P Q V G G D A E A G M A D K I A D L G I P Q V G G D A E A G M GCGGCAAAGTCTGAGGAGTTTGTGGCCCAAGGATCGCAGCTTTATAGCGAGGTGCGTGAC A A K S E E F V A Q G S Q L Y S E V R D A A K S E E F V A Q G S Q L Y S E V R D AATGCTGCCCACGCCTAG N A A H A N A A H A --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.1407): -------------------------ATGTTGGGTGCGTGTTCTAGGTTAGTGAGTGTCCC M L G A C S R L V S V P MQAHRHRHSSKSPLPQPPHGGNFHA H A G N A L V L T A V P CCGCGGGCGCCCGAGCACGGGCTGAGATTGCGCTG*AT*GCTGTGCAAGCACCGTTTGAA A G A R A R A E I A L A V Q A P F E - T G A R A R A E I A L *I** A A R A P F E CCTGTCTGGTTAACACCAGCGAAGGAAGAGAGGAGCGCGAGCCTAGTGTCGGCAGCCTCA P V W L T P A K E E R S A S L V S A P V R L V P A K E E R N G A M T P T ------ GCTAATTCAGTAACCAATCCATCTGCTTGGGAAAACTCCGAGATCCATCCGAAGCACTCG N S E I H P K H S --------------------------------- Q N E I H P K H S TATTCGCCGATCGTTTCCGGTGACCTTGAGGTCCCAGAAACAGAGATTCAGCTTGACGAT Y S P I V S G D L E V P E T E I Q L D D Y S P I R K H G L E V P E T E I A L D D TCTCCTACCGGCCCCAATGATCCAGTTCGGATCTATCGCACCCGTGGCCCTGAGTGTGAT S P T G P N D P V R I Y R T R G P E C D S P S G P N E P F R I Y R T R G P E T D CCCACGGTGGGATTGAAGCCACTGCGCGCACAGTGGATTGATAGCCGTGAGGACACGGAA P T V G L K P L R A Q W I D S R E D T E P T L G L P R L R T P W I T A R G D V T GAATATGCTGGCCGTGAGCGGAATTTGGCTGATGATGGCCGCTCCGCGCAGCGTCGTGGC E Y A G R E R N L A D D G R S A Q R R G E Y T G R E R L L I D D G R S A M R R G GCAGCGTCGCTGGAGTGGAAAGGTGTGAAACCCACACCGCGACGCGCCAAGCAGGGCAAG A A S L E W K G V K P T P R R A K Q G K Q A S A E W K G Q K P A P L K A L P G K CGCGTGACTCAGATGCACTATGCACGCCAGGGCATTATTACGAAGGAAATGGAGTTCGTG R V T Q M H Y A R Q G I I T K E M E F V R V T Q M A Y A R A G E I T R E M E F V GCGCTGCGCGAGCACATGGACCCAGAGTTTGTGCGCAGCGAGATCGCCCGCGGCCGTGCG A L R E H M D P E F V R S E I A R G R A A L R E H V D P E F V R S E V A R G R A ATCATTCCGAACAACATTAACCACCCAGAATCGGAGCCCATGATTATTGGTCGAAAGTTT I I P N N I N H P E S E P M I I G R K F I I P N N V N H P E S E P M I I G R K F TTGACCAAGATCAACGCCAATATCGGTAACTCCGCTGTGACCTCCAGTATTGAGGAAGAA L T K I N A N I G N S A V T S S I E E E L T K I N A N I G N S A V T S S I E E E GTATCCAAGCTGCGGTGGGCTACCCGCTGGGGTGCAGATACCGTGATGGATTTGTCCACC V S K L R W A T R W G A D T V M D L S T V S K L Q W A T R W G A D T V M D L S T GGCGATGATATTCACACCACCCGCGAATGGATTATCCGCAACTCCCCAGTACCAATCGGT G D D I H T T R E W I I R N S P V P I G G D D I H T T R E W I I R N S P V P I G ACGGTGCCGATCTACCAAGCGCTGGAAAAAGTAAATGGTGTAGCAGAAGACCTTACGTGG T V P I Y Q A L E K V N G V A E D L T W T V P I Y Q A L E K V N G V A A D L S W GAGATTTTCCGCGATACCGTCATTGAACAGTGTGAACAAGGTGTGGACTACATGACCATT E I F R D T V I E Q C E Q G V D Y M T I E V F R D T V I E Q C E Q G V D Y M T I CACGCCGGTGTGTTGCTCGCCTACATTCCACTGACCACCAAACGCGTGACCGGAATTGTA H A G V L L A Y I P L T T K R V T G I V H A G V L L A Y I P L T T R R V T G I V TCCCGTGGTGGATCCATCATGGCGGGTTGGTGCCTGGCTCACCATAAGGAGTCCTTCCTT S R G G S I M A G W C L A H H K E S F L S R G G S I M A G W C L A H H R E S F L TACGAGCACTTTGATGAGCTGTGCGAGATTTTCGCGCAGTACGACGTCGCCTTCTCGCTG Y E H F D E L C E I F A Q Y D V A F S L F E H F D E L C E I F A Q Y D V A F S L GGTGATGGCCTGCGCCCTGGTTCTGTTGCCGATGCGAATGATGCGGCCCAGTTCGCGGAG G D G L R P G S V A D A N D A A Q F A E G D G L R P G S L A D A N D A A Q F A E CTGAAAACCATTGGTGAGCTGGCTCGTCGTGCGTGGGAATACGATGTGCAGGTCATGATC L K T I G E L A R R A W E Y D V Q V M I L K T I G E L T Q R A W E Y D V Q V M V GAGGGCCCAGGTCACGTTCCGCTGAACATGGTGCAGGAAAACAATGAGCTGGAGCAAAAG E G P G H V P L N M V Q E N N E L E Q K E G P G H V P L N M I Q E N N E L E Q K TGGGCTCACGATGCGCCTTTCTACACTCTTGGCCCATTGGTGACCGATATTGCGCCAGGC W A H D A P F Y T L G P L V T D I A P G W A A D A P F Y T L G P L V T D I A P G TATGACCACATCACCTCTGCAATTGGAGCTGCTCATATCGCTATGGGTGGTACGGCGATG Y D H I T S A I G A A H I A M G G T A M Y D H I T S A I G A A H I A M G G T A M CTGTGTTATGTGACCCCCAAGGAGCACTTGGGTCTGCCCAACCGTGATGACGTAAAAACC L C Y V T P K E H L G L P N R D D V K T L C Y V T P K E H L G L P N R N D V K T GGTGTGATTACTTATAAACTTGCAGCTCACGCGGCTGATGTGGCTAAGGGGCACCCCGGT G V I T Y K L A A H A A D V A K G H P G G V I T Y K L A A H A A D V A K G H P G GCTCGTGCGTGGGATGACGCGATGAGCAAGGCACGTTTTGAGTTCCGTTGGCACGATCAG A R A W D D A M S K A R F E F R W H D Q A R A W D D A M S K A R F E F R W N D Q TTCGCGTTGTCGCTTGATCCAGATACCGCGATTGCTTACCATGACGAAACGCTTCCGGCG F A L S L D P D T A I A Y H D E T L P A F A L S L D P D T A I A Y H D E T L P A GAGCCGGCAAAGACTGCGCACTTCTGTTCCATGTGTGGTCCGAAGTTCTGCTCCATGCGC E P A K T A H F C S M C G P K F C S M R E P A K T A H F C S M C G P K F C S M R ATTAGCCAAGATATTCGTGACATGTTCGCAGATAAGATCGCCGACTTGGGTATCCCGCAG I S Q D I R D M F A D K I A D L G I P Q I S Q D I R D M F G E Q I A E L G M P G GTTGGCGGC-GACGCAGAAGCTGGCATGGCGGCAAAGTCTGAGGAGTTTGTGGCCCAAGG V G G D A E A G M A A K S E E F V A Q G V G A S D S T E G M K E K S R E F V A G G ATCGCAGCTTTATAGCGAGGTGCGTGACAATGCTGCCCACGCCTAG S Q L Y S E G E V Y R E --------------------------- // >fig|6666666.67449.peg.2218 fig|196164.1.peg.2713 FIG008913: Membrane-associated phospholipid phosphatase gi|372109441|gb|CP003213.1|_2279012_2278992,gi|372109441|gb|CP003213.1|_2278988_2278971,gi|372109441|gb|CP003213.1|_2278967_2278680,gi|372109441|gb|CP003213.1|_2278676_2278581,gi|372109441|gb|CP003213.1|_2278579_2278124 MCQRCTTxVVRWLLxRRLAGCSRALSTPCLRRIRSTTMCRRLTWLRLTLVGLACRVSTAPRCRLPMVAVLSTANVTVLRPRNFCRSRTACKKRLLRTSIVCVRSTVRLTRSxPAVRRGRRFSRNHKGLRSPSERSRHTCRGAKTLATPGVLATARGLSHFGEHALGWMGMGALGALIDAPRRAQWVRLVAAAFVSHAISVVVKRIVRRKRPHDPRITIGVGTPSKLSFPSSHATSTSAALVSLARITRNPLPLLGIPVMMVSRMVLGVHYPTDVATGALVGAVTAEAIARTGKVK We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGTGCCAACGGTGTACAACCTGAGTGGTCCGCTGGCTCCTGTGAAGAAGGTTGGCTGGT V C Q R C T T * V V R W L L * R R L A G M C Q R C T T X V V R W L L X R R L A G TGCTCAAGGGCATTAAGCACACCTTGTCTAAGGAGAATCCGCAGCACCACGATGTGCCGC C S R A L S T P C L R R I R S T T M C R C S R A L S T P C L R R I R S T T M C R AGGCTAACTTGGCTCCGATTAACGCTCGTTGGTTTAGCTTGTCGCGTCTCGACGGCGCCA R L T W L R L T L V G L A C R V S T A P R L T W L R L T L V G L A C R V S T A P CGGTGTCGACTGCCGATGGTCGCGGTGTTGTCTACCGCAAACGTGACCGTGCTCAGGCCA R C R L P M V A V L S T A N V T V L R P R C R L P M V A V L S T A N V T V L R P AGGAACTTTTGCAGGAGTCGTACCGCCTGCAAAAAGAGGTTGCTGCGAACTTCGATCGTC R N F C R S R T A C K K R L L R T S I V R N F C R S R T A C K K R L L R T S I V TGCGTGAGGAGTACCGTGCGGCTCACAAGGAGCTGACCAGCCGTGAGGCGTGGGCGAAGA C V R S T V R L T R S * P A V R R G R R C V R S T V R L T R S X P A V R R G R R TTTTCGAGGAACCACAAGGGGCTGAGGAGTCCTAGTGAAAGAAGCAGACATACTTGTAGA F S R N H K G L R S P S E R S R H T C R F S R N H K G L R S P S E R S R H T C R GGTGCAAAAACACCTTGCTACTCCGGGCGTGTTGGCCACGGCTCGCGGTTTGAGTCATTT G A K T L A T P G V L A T A R G L S H F G A K T - L A T P G V L A T A R G L S H F TGGTGAGCACGCCTTGGGGTGGATGGGCATGGGTGCGCTGGGCGCGCTTATCGACGCTCC G E H A L G W M G M G A L G A L I D A P G E H A L G W M G M G A L G A L I D A P CCGTCGTGCGCAGTGGGTTCGTCTCGTTGCAGCTGCCTTTGTGAGCCACGCCATAAGTGT R R A Q W V R L V A A A F V S H A I S V R R A Q W V R L V A A A F V S H A I S V AGTGGTGAAGCGAATCGTGAGACGTAAACGCCCTCATGATCCACGCATCACAATCGGTGT V V K R I V R R K R P H D P R I T I G V V V K R I V R R K R P H D P R I T I G V CGGAACCCCGTCCAAGCTGAGTTTTCCCAGCTCACATGCGACGTCGACAAGCGCTGCGCT G T P S K L S F P S S H A T S T S A A L G T P S K L S F P S S H A T S T S A A L GGTGAGCCTCGCACGGATCACCCGCAACCCGCTGCCGCTGCTGGGTATCCCTGTGATGAT V S L A R I T R N P L P L L G I P V M M V S L A R I T R N P L P L L G I P V M M GGTGTCGCGTATGGTTCTCGGAGTACATTATCCGACCGACGTGGCCACCGGCGCTCTCGT V S R M V L G V H Y P T D V A T G A L V V S R M V L G V H Y P T D V A T G A L V AGGTGCGGTCACTGCAGAAGCAATTGCACGAACTGGGAAGGTGAAATGA G A V T A E A I A R T G K V K G A V T A E A I A R T G K V K --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2713): GTGTGCCAACGGTGTACA------------------ACCTGAGTGGTCCGCTGGCTCCTG V P T C T T * V V R W L L -- M P S - C C PAPPSCPAPPARRVYPPR T S V A A W P L TGAAGAAGGTTGGCTGGTTGCTCAAGGGCATTAAGCACACCTTGTCTAAGGAGAATCCGC * R R L A G C S R A L S T P C L R R I R S R R L C G W P R G S S T P C P G R T R AGCACCACGATGTGCCGCAGGCTAACTTGGCTCCGATTAACGCTCGTTGGTTTAGCTTGT S T T M C R R L T W L R L T L V G L A C P T T R C P R P T S R R S R P A G S A S CGCGTCTCGACGGCGCCACGGTGTCGACTGCCGATGGTCGCGGTGTTGTCTACCGCAAAC R V S T A P R C R L P M V A V L S T A N R V S T A P P S P P P T A A G W S T A S GTGACCGTGCTCAGGCCAAGGAACTTTTGCAGGAGTCGTACCGCCTGCAAAAAGAGGTTG V T V L R P R N F C R S R T A C K K R L A T A N R P R S W A G R P C A C R S R W CTGCGAACTTCGATCGTCTGCGTGAGGAGTACCGTGCGGCTCACAAGGAGCTGACCAGCC L R T S I V C V R S T V R L T R S * P A Q S V S T N C A P A T A T H I P G W S A GTGAGGCGTGGGCGAAGATTTTCGAGGAACCACAAGGGGCTGAGGAGTCCTAGTGAAAGA V R R G R R F S R N H K E A N H G A R C S M S S R ---------------------- E AGCAGACATACTTGTAGAGGTGCAAAAACACCTT-GCTACTCCGGGCGTGTTGGCCACGG A D I L V E V Q K H L A T P G V L A T V E I L L G I Q K A L L P V P G V V K T CTCGCGGTTTGAGTCATTTTGGTGAGCACGCCTTGGGGTGGATGGGCATGGGTGCGCTGG A R G L S H F G E H A L G W M G M G A L A T S L S L L G E H A A G W L T L G A A GCGCGCTTATCGACGCTCCCCGTCGTGCGCAGTGGGTTCGTCTCGTTGCAGCTGCCTTTG G A L I D A P R R A Q W V R L V A A A F G V V V D K R R R R S W G G L F V A A L TGAGCCACGCCATAAGTGTAGTGGTGAAGCGAATCGTGAGACGTAAACGCCCTCATGATC V S H A I S V V V K R I V R R K R P H D T S H A A S V I I K R I V R R K R P H D CACGCATCACAATCGGTGTCGGAACCCCGTCCAAGCTGAGTTTTCCCAGCTCACATGCGA P R I T I G V G T P S K L S F P S S H A A L I Q I G V G T P S K L S F P S S H A CGTCGACAAGCGCTGCGCTGGTGAGCCTCGCACGGATCACCCGCAACCCGCTGCCGCTGC T S T S A A L V S L A R I T R N P L P L T S T T A T M V Y L A R I T R S P L P L TGGGTATCCCTGTGATGATGGTGTCGCGTATGGTTCTCGGAGTACATTATCCGACCGACG L G I P V M M V S R M V L G V H Y P T D L G I P V M A L S R M V L G V H Y P T D TGGCCACCGGCGCTCTCGTAGGTGCGGTCACTGCAGAAGCAATTGCACGAACTGGGAAGG V A T G A L V G A V T A E A I A R T G K V L A G T I L G A A T A E A V H K I E R TGAAATGA V K * A T A //