>fig|6666666.67496.peg.424 fig|196164.1.peg.2646 hypothetical protein gi|512068193|gb|ATBY01000017.1|_436667_435738,gi|512068193|gb|ATBY01000017.1|_435734_435684 MTFGEEFIFTTRLSSWERQQVSHRNLAGRLVKLACGIYYPRDSFERLRPGEQALTRSLALGISGKTLVGKSAAAMWHLPEVDLYHYVPEVRGRQYCTNPGVIARHVTALGTTEYEWNGYPMRLTSPALTVVDIARWHGLARGVCEGESFVRRKFTDAVELERALALRTHCTGEKVACEAVGLIDGGSESYREAEVKVRLYQLGFGGFYQQAEIYSADMVWVARVDFFFPDQSVVVEYDGKGKIHGEFNVDAITAVNDERDRERRLVSLGIRVVRITAKSFRTEEWVENLQAALKQNEGHVYPSELWRKQDxGSPLECDTQGGSSWSG We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACATTCGGGGAGGAATTCATTTTTACGACACGGCTATCGTCATGGGAACGGCAGCAA M T F G E E F I F T T R L S S W E R Q Q M T F G E E F I F T T R L S S W E R Q Q GTTTCTCACCGGAACCTGGCGGGGCGGCTGGTGAAGCTCGCGTGCGGGATCTACTATCCG V S H R N L A G R L V K L A C G I Y Y P V S H R N L A G R L V K L A C G I Y Y P CGTGATAGTTTTGAAAGGCTGCGGCCCGGCGAGCAGGCGTTGACCCGGTCACTTGCACTG R D S F E R L R P G E Q A L T R S L A L R D S F E R L R P G E Q A L T R S L A L GGGATATCTGGTAAGACCCTGGTGGGGAAGTCGGCGGCGGCGATGTGGCATCTTCCGGAG G I S G K T L V G K S A A A M W H L P E G I S G K T L V G K S A A A M W H L P E GTAGACCTTTACCATTACGTGCCGGAAGTAAGAGGCCGGCAGTACTGCACGAATCCGGGG V D L Y H Y V P E V R G R Q Y C T N P G V D L Y H Y V P E V R G R Q Y C T N P G GTTATTGCACGGCATGTCACAGCCCTCGGCACTACCGAGTACGAGTGGAACGGCTACCCG V I A R H V T A L G T T E Y E W N G Y P V I A R H V T A L G T T E Y E W N G Y P ATGAGGCTCACTTCGCCTGCGCTGACGGTGGTGGATATCGCCCGTTGGCATGGTTTGGCA M R L T S P A L T V V D I A R W H G L A M R L T S P A L T V V D I A R W H G L A CGTGGCGTGTGTGAGGGGGAGAGCTTTGTTCGTCGCAAGTTCACGGATGCGGTGGAGCTG R G V C E G E S F V R R K F T D A V E L R G V C E G E S F V R R K F T D A V E L GAGCGCGCGTTGGCACTGAGAACACACTGCACGGGAGAAAAAGTGGCATGTGAGGCGGTG E R A L A L R T H C T G E K V A C E A V E R A L A L R T H C T G E K V A C E A V GGGCTCATTGATGGGGGATCCGAAAGCTACCGCGAGGCGGAGGTGAAGGTGCGGCTGTAC G L I D G G S E S Y R E A E V K V R L Y G L I D G G S E S Y R E A E V K V R L Y CAGCTGGGGTTTGGCGGGTTTTACCAACAGGCGGAGATTTACTCGGCCGATATGGTGTGG Q L G F G G F Y Q Q A E I Y S A D M V W Q L G F G G F Y Q Q A E I Y S A D M V W GTGGCACGGGTGGATTTCTTTTTCCCTGATCAATCCGTGGTGGTGGAATATGATGGAAAG V A R V D F F F P D Q S V V V E Y D G K V A R V D F F F P D Q S V V V E Y D G K GGTAAGATCCACGGCGAGTTCAACGTTGATGCGATTACCGCCGTTAATGACGAGCGGGAC G K I H G E F N V D A I T A V N D E R D G K I H G E F N V D A I T A V N D E R D AGAGAACGGCGCCTCGTCAGTTTGGGGATCCGCGTGGTGCGGATAACGGCGAAGAGCTTC R E R R L V S L G I R V V R I T A K S F R E R R L V S L G I R V V R I T A K S F CGAACCGAGGAATGGGTAGAAAACTTGCAAGCTGCGCTCAAACAAAACGAGGGCCATGTG R T E E W V E N L Q A A L K Q N E G H V R T E E W V E N L Q A A L K Q N E G H V TACCCGTCTGAGCTCTGGCGGAAGCAGGATTGAGGAAGCCCCCTTGAGTGTGACACTCAA Y P S E L W R K Q D * G S P L E C D T Q Y P S E L W R K Q D X G S P L E C D T Q GGGGGCTCGTCTTGGTCGGGATAA G G S S W S G G G S S W S G --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2646): ATGACATTCGGGGAGGAATTCATTTTTACGACACGGCTATCGTCATGGGAACGGCAGCAA L S S W E R Q Q ------------------------------------ M P T T K R R N GTTTCTCACCGGAACCTGGCGGGGCGGCTGGTGAAGCTCGCGTGCGGGATCTACTATCCG V S H R N L A G R L V K L A C G I Y Y P I Y R R H R D G Q V S K L A P G I F V P CGTGATAGTTTTGAAAGGCTGCGGCCCGGCGAGCAGGCGTTGACCCGGTCACTTGCACTG R D S F E R L R P G E Q A L T R S L A L R A T F D S L E P W D R F Q L R C A A T GGGATATCTGGTAAG--ACCCTGGTGGGGAAGTCGGCGGCGGCGATGTGGCATCTTCCGG G I S G K T L V G K S A A A M W H L P G Y G Y P KY T L V G K A A A A I W G I P AGGTAGACCTTTACCATTACGTGCCGGAAGTAAGAGG*CC*GGCAGTACTGCACGAATCC E V D L P L R A G S K R G S T A R I Y G D I -- P G R V E L A R *L** N G H G G L GGGGGTTATTGCACGGCATGTCACAGCCCTCGGCACTACCGAGTACGAGTGGAACGGCTA R G L L H G M S Q P S A L P G Y R T D L V S M R R L A S I P -------------- G Q CCCGATGAGGCTC------ACTTCGCCTGCGCTGACGGTGGTGGATATCGCCCGTTGGCA P M R L T S P A L T V V D I A R W H P P Q L HRGVSV T T P L Q T V L D L G R W H TGGTTTGGCACGTGGCGTGTGTGAGGGGGAGAGCTTTGTTCGTCGCAAGTTCACGGATGC G L A R G V C E G E S F V R R K F T D A P L A D A V T A A D H C L H H G L F T L GGTGGAGCTG-GAGCGCGCGTTGGCACTGAGAACACACTGCACGGGAGAAAAAGTGGCAT V E L E R A T H C T G T Q L S E H A ------------ T H L T G ------------ GTGAGGCGGTGGGG-------CTCATTGATGGGGGATCCGAAAGCTACCGCGAGGCGGAG C E A V G L I D G G S E S Y R E A E C K G V G NLKDLLL L V H G A S E S P R E S A GTGAAGGTGCGGCTGTACCAGCTGGGGTTTGGCGGGTTTTACCAACAGGCGGAGATTTAC V K V R L Y Q L G F G G F Y Q Q A E I Y L R V A M W E N G F P A P H L Q A S I I TCGGCCGATATGGTGTGGGTGGCACGGGTGGATTTCTTTTTCCCTGATCAATCCGTGGTG S A D M V W V A R V D F F F P D Q S V V D E S G R F L G R A D A L F A D S S V L GTGGAATATGATGGAAAGGGTAAGATCCACGGCGAGTTCAACGTTGATGCGATTACCGCC V E Y D G K G K I H G E F N V D A I T A V E Y D G R G K Y R C S P D Q T T E Q A GTTAATGACGAGCGGGACAGAGAACGGCGCCTCGTCAGTTTGGGGATCCGCGTGGTGCGG V N D E R D R E R R L V S L G I R V V R L M E E R R R E K D L L N L G T R M I R ATAACGGCGAAGAGCTTCCGAACCGAGGAATGGGTAGAAAACTTGCAAGCTGCGCTCAAA I T A K S F R T E E W V E N L Q A A L K V T A E T F T S G R W I H D L R R E L D CAAAACGAGGGCCATGTGTACCCGTCTGAGCTCTGGCGGAAGCAGGATTGAGGAAGCCCC Q N E G H V Y P S E L W R K Q D * G S P L G K G R P L D Q R L W T S Q G L G W G CTTGAGTGTGACACTCAAGGGGGCTCGTCTTGGTCGGGATAA--- L E C D T Q G G S S W S G * R A Q D K Q P S G S L Y P R YPV // >fig|6666666.67496.peg.1512 fig|196164.1.peg.245 hypothetical protein gi|512070514|gb|ATBY01000010.1|_19509_19724,gi|512070514|gb|ATBY01000010.1|_19726_20016,gi|512070514|gb|ATBY01000010.1|_20018_20212,gi|512070514|gb|ATBY01000010.1|_20214_20399 MIRFRFVDDHRTEYSVKRMCAVLTIHRSSYNAWRSRRERRDHKALSDALLGVRITEVFRQENGCYGAKRITAKLNDDPGSTPLNHKRVARIMKNVGLYGYTRRRRVKTTVRAKGRNVFADLVRRKFYADRLNKLYVGDITYLPIADGSNMYLATVLDCCSRRLVGFAFQDHMRSLLVIEALNNACATRRSLAGSVFHSDHGSVYTSDVFKKTCSDLGVTQSMGSVGTSADNAFAQSFNSTLKREVLQDRKTFANPLECRREVFRWCARYNTSRRHSWCGYQAPNTFEEKQMYRVA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGATCCGCTTCCGGTTTGTTGATGACCACCGCACCGAATACTCGGTCAAGCGGATGTGT V I R F R F V D D H R T E Y S V K R M C M I R F R F V D D H R T E Y S V K R M C GCCGTTTTGACAATCCACCGCAGTAGCTACAACGCCTGGCGTAGTAGACGCGAAAGGCGG A V L T I H R S S Y N A W R S R R E R R A V L T I H R S S Y N A W R S R R E R R GATCACAAGGCTTTGTCAGATGCACTTCTTGGGGTGCGTATCACGGAGGTCTTCCGGCAA D H K A L S D A L L G V R I T E V F R Q D H K A L S D A L L G V R I T E V F R Q GAAAACGGCTGCTACGGTGCAAAACGCATCACGGCTTAAACTTAATGATGATCCAGGTTC E N G C Y G A K R I T A K L N D D P G S E N G C Y G A K R I T A - K L N D D P G S TACTCCCCTAAACCACAAGCGTGTGGCCAGGATCATGAAGAATGTAGGCCTTTACGGGTA T P L N H K R V A R I M K N V G L Y G Y T P L N H K R V A R I M K N V G L Y G Y TACCAGGCGACGAAGAGTAAAAACCACCGTGCGAGCCAAAGGCCGAAACGTGTTTGCTGA T R R R R V K T T V R A K G R N V F A D T R R R R V K T T V R A K G R N V F A D CCTTGTACGCCGCAAGTTCTACGCCGATAGACTCAACAAACTTTATGTTGGGGACATCAC L V R R K F Y A D R L N K L Y V G D I T L V R R K F Y A D R L N K L Y V G D I T CTACCTGCCTATCGCTGACGGGTCGAACATGTATCTGGCGACAGTATTGGATTGTTGTTC Y L P I A D G S N M Y L A T V L D C C S Y L P I A D G S N M Y L A T V L D C C S TCGCAGGCTTGTAGGCTTTGCTTTTCAATGACCACATGCGGAGCTTGCTTGTGATTGAGG R R L V G F A F Q D H M R S L L V I E R R L V G F A F Q - D H M R S L L V I E CCTTGAACAATGCATGCGCCACCCGTAGAAGCCTTGCAGGATCGGTGTTTCATTCCGACC A L N N A C A T R R S L A G S V F H S D A L N N A C A T R R S L A G S V F H S D ACGGCAGTGTGTACACCTCGGATGTGTTTAAGAAAACCTGCAGTGACCTTGGTGTCACCC H G S V Y T S D V F K K T C S D L G V T H G S V Y T S D V F K K T C S D L G V T AATCGATGGGGTCTGTGGGAACCAGTGCTGATAACGCGTTTGCTTCAGTCGTTTAACTCC Q S M G S V G T S A D N A F A Q S F N S Q S M G S V G T S A D N A F A - Q S F N S ACGTTGAAAAGAGAGGTACTTCAGGATCGGAAAACCTTCGCAAACCCGCTTGAATGCCGT T L K R E V L Q D R K T F A N P L E C R T L K R E V L Q D R K T F A N P L E C R AGGGAAGTGTTCCGGTGGTGTGCCCGTTACAACACATCCAGGCGCCACAGTTGGTGTGGC R E V F R W C A R Y N T S R R H S W C G R E V F R W C A R Y N T S R R H S W C G TATCAAGCCCCGAACACTTTCGAGGAGAAACAGATGTACCGTGTCGCCTAA Y Q A P N T F E E K Q M Y R V A Y Q A P N T F E E K Q M Y R V A --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.245): GTGATCCGCTTCCGGTTTGTTGATGACCACCGCACCGAATACTCGGTCAAGCGGATGTGT V I R F R F V D D H R T E Y S V K R M C M I R F R F V D D A Q K N H S V K R L C GCCGTTTTGACAATCCACCGCAGTAGCTACAACGCCTGGCGTAGTAGACGCGAAAGGCGG A V L T I H R S S Y N A W R S R R E R R E V L K L N R S S Y Y K W K N S S S A R GATCACAAGGCTTTGTCAGATGCACTTCTTGGGGTGCGTATCACGGAGGTCTTCCGGCAA D H K A L S D A L L G V R I T E V F R Q R K R L I S D A L L G A R V K T V F T A GAAAACGGCTGCTACGGTGCAAAACGCATCACGGCTTAAACTTAATGATGATCCAGGTTC E N G C Y G A K R I T A K L N D D P G S E K G C Y G A K R I T A - E L K D Q A D Q TACTCCCCTAAACCACAAGCGTGTGGCCAGGATCATGAAGAATGTAGGCCTTTACGGGTA T P L N H K R V A R I M K N V G L Y G Y T P V N H K R V A R V M R E L K L F G Y TACCAGGCGACGAAGAGTAAAAACCACCGTGCGAGCCAAAGGCCGAAACGTGTTTGCTGA T R R R R V K T T V R A K G R N V F A D T K K R K V T T T V S D Q K K P V F P D CCTTGTACGCCGCAAGTTCTACGCCGATAGACTCAACAAACTTTATGTTGGGGACATCAC L V R R K F Y A D R L N K L Y V G D I T L V G R K F T A D K P N Q L Y V G D I T CTACCTGCCTATCGCTGACGGGTCGAACATGTATCTGGCGACAGTATTGGATTGTTGTTC Y L P I A D G S N M Y L A T V L D C C S Y L P I A D G S N M Y L A T V I D C Y S TCGCAGGCTTGTAGGCTTTGCTTTTCAATGACCACATGCGGAGCTTGCTTGTGATTGAGG R R L V G F A F Q D H M R S L L V I E R R L V G F S I A - D H M R T S L V Q D CCTTGAACAATGCATGCGCCACCCGTAGAAGCCTTGCAGGATCGGTGTTTCATTCCGACC A L N N A C A T R R S L A G S V F H S D A L T M A K G Q R G D L K G A I F H S D ACGGCAGTGTGTACACCTCGGATGTGTTTAAGAAAACCTGCAGTGACCTTGGTGTCACCC H G S V Y T S D V F K K T C S D L G V T H G S V Y T S H A F Q G A C K D L G I R AATCGATGGGGTCTGTGGGAACCAGTGCTGATAACGCGTTTGCTTCAGTCGTTTAACTCC Q S M G S V G T S A D N A F A Q S F N S Q S M G S I G T S A D N A L A - E S F N A ACGTTGAAAAGAGAGGTACTTCAGGATCGGAAAACCTTCGCAAACCCGCTTGAATGCCGT T L K R E V L Q D R K T F A N P L E C R A M K R E V L Q D S K T F I N Q L I C R AGGGAAGTGTTCCGGTGGTGTGCCCGTTACAACACATCCAGGCGCCACAGTTGGTGTGGC R E V F R W C A R Y N T S R R H S W C G R D V F R W C T R Y N T V R R H S W C K TATCAAGCCCCGAACACTTTCGAGGAGAAA--CAGATGTACCGTGTCGCCTAA Y Q A P N T F E E K Q M Y R V A * Y L A P A V F E E R GP A I L K S A S // >fig|6666666.67496.peg.2223 fig|504474.3.peg.636 hypothetical protein gi|512071492|gb|ATBY01000002.1|_103831_103307,gi|512071492|gb|ATBY01000002.1|_103303_102539 MILSEEDHFPATSAPAFSLASPQVLFRANNVLSTISNRQFKSGKYYKATDESAKLLQHRTSSGPVPGVLRRSDLGLADNQSRFFKHISFQEVKFSPAMASTAAGIAAQAAIEAAIAEIKEYLEVIDEKLDTLLRQRKVDALALLGGIQYTIEEADELYRRSSSVSATTWSKVDHLxSALNGIESYAIEQLDDAVDQLRKQKNNSKKLDTFLAGLKGDLPLWLGVAARSIYLHDRMYVLEIAHVNEFEPRQLDSHREGIHDARKDRLESTTRRLLEMDTAIRETAKLSNQVWVTNPIRARHITAHANEIHDIISAFAQHLRMTVEDAERLHVQGWRQSVVSLAGDTIDAANRARQSAVGQAQKATEKIRDMNDDRLLAKAAEIEARRERGGAKSARVDRRRRSICDRNPHNATRFTFPSRREESIEVFSTR We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGATCCTTAGCGAGGAAGATCACTTCCCCGCCACTTCCGCACCCGCATTTTCGCTTGCA V I L S E E D H F P A T S A P A F S L A M I L S E E D H F P A T S A P A F S L A TCACCGCAAGTGCTTTTCCGCGCTAACAATGTGTTGAGCACGATTTCCAACCGGCAGTTC S P Q V L F R A N N V L S T I S N R Q F S P Q V L F R A N N V L S T I S N R Q F AAATCCGGAAAGTATTACAAGGCAACGGACGAAAGTGCGAAGCTGCTCCAGCATCGCACG K S G K Y Y K A T D E S A K L L Q H R T K S G K Y Y K A T D E S A K L L Q H R T TCGTCTGGACCGGTTCCTGGAGTCCTACGCCGAAGCGATCTTGGGCTCGCCGACAATCAA S S G P V P G V L R R S D L G L A D N Q S S G P V P G V L R R S D L G L A D N Q AGTCGATTCTTCAAACACATCTCGTTTCAAGAGGTGAAGTTTTCGCCCGCCATGGCTTCG S R F F K H I S F Q E V K F S P A M A S S R F F K H I S F Q E V K F S P A M A S ACCGCCGCTGGCATCGCAGCTCAGGCCGCAATTGAGGCAGCAATTGCTGAAATCAAGGAG T A A G I A A Q A A I E A A I A E I K E T A A G I A A Q A A I E A A I A E I K E TATCTAGAGGTCATCGATGAGAAGCTCGATACTCTCCTCCGGCAGCGCAAGGTTGATGCA Y L E V I D E K L D T L L R Q R K V D A Y L E V I D E K L D T L L R Q R K V D A CTGGCACTGCTTGGGGGTATCCAGTACACGATTGAAGAAGCGGACGAACTTTACCGGCGC L A L L G G I Q Y T I E E A D E L Y R R L A L L G G I Q Y T I E E A D E L Y R R AGCAGTAGCGTCTCCGCAACTACTTGGTCGAAGGTCGACCACCTCTGATCAGCACTCAAC S S S V S A T T W S K V D H L * S A L N S S S V S A T T W S K V D H L X S A L N GGCATCGAGTCTTACGCCATCGAACAACTCGATGATGCCGTTGATCAGCTCCGGAAACAG G I E S Y A I E Q L D D A V D Q L R K Q G I E S Y A I E Q L D D A V D Q L R K Q AAGAACAACTCCAAGAAACTTGATACTTTCTTAGCTGGGCTGAAAGGCGATCTGCCGCTT K N N S K K L D T F L A G L K G D L P L K N N S K K L D T F L A G L K G D L P L TGGCTGGGTGTGGCCGCTCGGAGCATCTACCTCCACGATCGGATGTATGTCCTGGAGATC W L G V A A R S I Y L H D R M Y V L E I W L G V A A R S I Y L H D R M Y V L E I GCCCACGTGAATGAGTTTGAGCCTCGCCAGCTGGATTCTCACCGTGAGGGAATCCACGAC A H V N E F E P R Q L D S H R E G I H D A H V N E F E P R Q L D S H R E G I H D GCGCGCAAGGATCGATTGGAATCGACCACCCGACGTCTGCTCGAGATGGATACAGCCATC A R K D R L E S T T R R L L E M D T A I A R K D R L E S T T R R L L E M D T A I CGTGAGACAGCCAAGTTGAGCAATCAGGTCTGGGTGACAAACCCGATTCGTGCTCGCCAT R E T A K L S N Q V W V T N P I R A R H R E T A K L S N Q V W V T N P I R A R H ATCACCGCGCACGCGAACGAAATTCACGACATTATTAGTGCGTTTGCTCAGCATTTGCGG I T A H A N E I H D I I S A F A Q H L R I T A H A N E I H D I I S A F A Q H L R ATGACCGTGGAGGACGCAGAGCGTCTCCACGTCCAAGGATGGCGTCAATCTGTGGTGTCG M T V E D A E R L H V Q G W R Q S V V S M T V E D A E R L H V Q G W R Q S V V S CTAGCGGGCGACACCATCGATGCCGCGAACCGCGCACGCCAATCGGCGGTGGGTCAAGCG L A G D T I D A A N R A R Q S A V G Q A L A G D T I D A A N R A R Q S A V G Q A CAAAAAGCCACCGAGAAAATTCGCGACATGAACGACGACCGGCTGCTTGCAAAGGCCGCA Q K A T E K I R D M N D D R L L A K A A Q K A T E K I R D M N D D R L L A K A A GAAATCGAAGCGCGACGGGAGCGGGGGGGAGCAAAAAGCGCTCGAGTCGACCGGCGACGA E I E A R R E R G G A K S A R V D R R R E I E A R R E R G G A K S A R V D R R R AGATCAATCTGCGACAGAAACCCGCACAACGCGACGCGGTTTACGTTTCCGTCGAGACGA R S I C D R N P H N A T R F T F P S R R R S I C D R N P H N A T R F T F P S R R GAAGAAAGCATAGAGGTTTTCTCCACGAGATAG E E S I E V F S T R E E S I E V F S T R --- ========== Now we show an alignment against a similar protein (fig|504474.3.peg.636): -------------------GTGATCCTTAGCGAGGAAGATCACTTC--CCCGCCACTTCC V I L S E E D H F P A T S MTSANNALSFVVDSDGKGL L L L G E E A D F AT P Q S G GCACCCGCATT-TTCGCTTGCATCACC*G*CAAGTGCTTTTCCGCGCTAACAATGTGTTG T R I F A C I T Q V L F R A N N V L -- N R L E F G N V T *S* Q A L I H A T E I V AGCACGATTTCCAACCGGCAGTTCAAATCCGGAAAGTATTACAAGGCAACGGACGAAAGT S T I S N R Q F K S G K Y Y K A T D E S G S V M G R H A D S G R Y L K L D K E S GCGAAGCTGCTCCAGCATCGCACGTCGTCTGGACCGGTTCCTGGAGTCCTACGCCGAAGC A K L L Q H R T S S G P V P G V L R R S A E L L K H F K G T G P I T G V I R K G GATCTTGGGCTCGCCGACAATCAAAGTCGATTCTTCAAACACATCTCGTTTCAAGAGGTG D L G L A D N Q S R F F K H I S F Q E V D L R I A G N P G E I I K H L K F E K T AAGTTTTCGCCCGCCATGGCTTCGACCGCCGCTGGCATCGCAGCTCAGGCCGCAATTGAG K F S P A M A S T A A G I A A Q A A I E S F K P G M A A G V A G L M T Q I A L E GCAGCAATTGCTGAAATCAAGGAGTATCTAGAGGTCATCGATGAGAAGCTCGATACTCTC A A I A E I K E Y L E V I D E K L D T L A A L A E I K N Y L V A I D E K V D L L CTCCGGCAGCGCAAGGTTGATGCACTGGCACTGCTTGGGGGTATCCAGTACACGATTGAA L R Q R K V D A L A L L G G I Q Y T I E L R Q R R H E E L A K L R G T Q H A I E GAAGCGGACGAACTTTACCGGCGCAGCAGTAGCGTCTCCGCAACTACTTGGTCGAAGGTC E A D E L Y R R S S S V S A T T W S K V E A D E L Y R R S G T V S D T T W S K I GACCACCTCTGATCAGCACTCAACGGCATCGAGTCTTACGCCATCGAACAACTCGATGAT D H L * S A L N G I E S Y A I E Q L D D S H L G G H L N E I A A F A L E Q I E D GCCGTTGATCAGCTCCGGAAACAGAAGAACAACTCCAAGAAACTTGATACTTTCTTAGCT A V D Q L R K Q K N N S K K L D T F L A T V N Q V Q G K K V K I K Q A S I Q L D GGGCTGAAAGGCGATCTGCCGCTTTGGCTGGGTGTGGCCGCTCGGAGCATCTACCTCCAC G L K G D L P L W L G V A A R S I Y L H K L N R E L P A W L G I L A T S V Y L H GATCGGATGTATGTCCTGGAGATCGCCCACGTGAATGAGTTTGAGCCTCGCCAGCTGGAT D R M Y V L E I A H V N E F E P R Q L D D S L Y V L E L A R V R D H E P S H L A TCTCACCGTGAGGGAATCCACGACGCGCGCAAGGATCGATTGGAATCGACCACCCGACGT S H R E G I H D A R K D R L E S T T R R S H R E G I T Q A R A K R L S D I A Q R CTGCTCGAGATGGATACAGCCATCCGTGAGACAGCCAAGTTGAGCAATCAGGTCTGGGTG L L E M D T A I R E T A K L S N Q V W V L Y T F K Q T T R S A G D L D V A R R V ACAAACCCGATTCGTGCTCGCCATATCACCGCGCACGCGAACGAAATTCACGACATTATT T N P I R A R H I T A H A N E I H D I I R A P R K T P Q I Q Q N A N S A L H H I AGTGCGTTTGCTCAGCATTTGCGGATGACCGTGGAGGACGCAGAGCGTCTCCACGTCCAA S A F A Q H L R M T V E D A E R L H V Q E E L E G Y L E L E N A A V G R L D Q Q GGATGGCGTCAATCTGTGGTGTCGCTAGCGGGCGACACCATCGATGCCGCGAACCGCGCA G W R Q S V V S L A G D T I D P W L D S A K E F G G N T W E --------------- CGCCAATCGGCGGTGGGTCAA-GCGCAAAAAGCC----ACCGAGAAA*AT*TCGCGACAT R Q S A V G Q A Q K A T E K S R H R I S D T G Q K A Q K A VGTV T E N *M** T K K GAACGACGACCGGCTGCTTGCAAAGGCCGCAGAAATCGAAGCGCGACGGGAGCGGGGGGG E R R P A A C K G R R N E A R R E R K A K P G P S K P S K N - E G E R K R ----- AGCAAAAAGCGCTCGAGTCGACCGGCGACGAAGATCAATCTG-CGACAGAAACCCGCACA T K I N L R Q K P A Q --------------------------- P K I P L P R Q G K L K ACGCGACGCGGTTTACGTTTCCGTCGAGACGAGAAGAAAGCATAGAGGTTTTCTCCACGA R D A D ----------------------------------------------------- GATAG ----- // >fig|6666666.67496.peg.1263 fig|504474.3.peg.1366 acyl-CoA synthetase gi|512069927|gb|ATBY01000013.1|_114171_115559,gi|512069927|gb|ATBY01000013.1|_115563_115628 MTSLTYPEETLPELVFTHQNDAQATAMIDLNRSISFGDLAAEITHVAAGLRAVGIAPGDVVGVRLANSIDFAAAFHACIVAGAIVMPIGGVVPEDPRPAYIVDSSNYEELRACPERIEIGSVAVDLDGPCCYPVSSGTTGTPKVVVLTHRNLVANTIQFGAKVPVPCGSVCQSVLPFSHIYGLTALLNVPLYLGATVLAWPFEAERFITAHEKYGVHTTFIAPPLATLLARHPLVDKTDFSALKYMIVGAAALNVADGERAAERTGSRMLQGYGMTEASPVTHLTTASTTPLSSIGHPLPDTEQRIVDPSTITDVAPGEVGELWVAGPQVMAGYYHNPVATDATLVGRWLRTGDLARELPGGEVEIVDRLKDVIKYHGYQVSPIKLEALITSCPGVTDAAVVREIHEDEEIPAAYVVGTATSEQVMAFVAERVPGYEKVRAVHHVDTIPRSAAGKILRRELRSxPPAPLFSRPRLPRHGTGRVPR We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACATCCCTCACCTACCCGGAAGAAACACTGCCTGAACTGGTCTTTACCCATCAAAAT M T S L T Y P E E T L P E L V F T H Q N M T S L T Y P E E T L P E L V F T H Q N GACGCACAGGCAACCGCCATGATCGACCTCAATCGCTCCATCAGCTTTGGCGATCTCGCA D A Q A T A M I D L N R S I S F G D L A D A Q A T A M I D L N R S I S F G D L A GCGGAAATCACCCACGTGGCCGCGGGGCTGCGCGCGGTGGGCATCGCCCCCGGCGATGTG A E I T H V A A G L R A V G I A P G D V A E I T H V A A G L R A V G I A P G D V GTGGGCGTGCGCCTCGCCAACTCCATCGACTTCGCCGCCGCGTTCCACGCCTGCATCGTC V G V R L A N S I D F A A A F H A C I V V G V R L A N S I D F A A A F H A C I V GCCGGCGCCATCGTCATGCCCATCGGCGGGGTGGTCCCCGAGGATCCGCGCCCGGCCTAC A G A I V M P I G G V V P E D P R P A Y A G A I V M P I G G V V P E D P R P A Y ATCGTCGACTCCTCCAACTACGAAGAGCTACGCGCCTGCCCCGAGCGGATCGAGATCGGC I V D S S N Y E E L R A C P E R I E I G I V D S S N Y E E L R A C P E R I E I G TCCGTCGCCGTCGACCTTGACGGGCCATGCTGCTACCCCGTCTCCTCCGGCACGACAGGC S V A V D L D G P C C Y P V S S G T T G S V A V D L D G P C C Y P V S S G T T G ACCCCCAAGGTGGTTGTACTCACCCACCGCAACCTGGTGGCCAACACCATCCAGTTTGGC T P K V V V L T H R N L V A N T I Q F G T P K V V V L T H R N L V A N T I Q F G GCCAAGGTGCCCGTTCCCTGCGGCTCGGTGTGCCAATCCGTACTGCCGTTTAGCCACATC A K V P V P C G S V C Q S V L P F S H I A K V P V P C G S V C Q S V L P F S H I TACGGTCTCACCGCGCTCCTCAACGTGCCGCTCTACCTCGGCGCCACCGTTCTCGCGTGG Y G L T A L L N V P L Y L G A T V L A W Y G L T A L L N V P L Y L G A T V L A W CCGTTCGAGGCCGAGCGGTTCATCACCGCCCACGAAAAGTACGGCGTCCACACCACATTC P F E A E R F I T A H E K Y G V H T T F P F E A E R F I T A H E K Y G V H T T F ATCGCCCCGCCTCTGGCCACGCTTTTGGCCCGCCACCCCCTGGTGGACAAGACGGACTTC I A P P L A T L L A R H P L V D K T D F I A P P L A T L L A R H P L V D K T D F TCCGCCCTCAAGTACATGATCGTCGGCGCCGCAGCCCTCAACGTTGCCGACGGCGAGCGT S A L K Y M I V G A A A L N V A D G E R S A L K Y M I V G A A A L N V A D G E R GCCGCCGAGCGCACCGGCTCGCGGATGCTGCAGGGCTACGGGATGACGGAGGCGTCGCCA A A E R T G S R M L Q G Y G M T E A S P A A E R T G S R M L Q G Y G M T E A S P GTCACCCACCTCACCACAGCATCGACCACACCACTGAGTTCGATAGGCCACCCACTGCCC V T H L T T A S T T P L S S I G H P L P V T H L T T A S T T P L S S I G H P L P GACACGGAGCAGCGGATAGTCGACCCGTCCACCATCACGGATGTGGCACCCGGCGAGGTG D T E Q R I V D P S T I T D V A P G E V D T E Q R I V D P S T I T D V A P G E V GGTGAGCTGTGGGTCGCCGGTCCACAGGTGATGGCGGGCTACTACCACAATCCCGTGGCC G E L W V A G P Q V M A G Y Y H N P V A G E L W V A G P Q V M A G Y Y H N P V A ACGGATGCGACGCTTGTGGGACGCTGGCTGCGCACGGGTGACCTGGCGCGAGAGCTGCCC T D A T L V G R W L R T G D L A R E L P T D A T L V G R W L R T G D L A R E L P GGTGGCGAGGTCGAGATTGTCGATCGCCTGAAAGATGTGATCAAGTATCACGGGTACCAG G G E V E I V D R L K D V I K Y H G Y Q G G E V E I V D R L K D V I K Y H G Y Q GTATCCCCCATCAAGTTGGAGGCGCTCATCACCTCGTGCCCCGGTGTCACCGATGCCGCG V S P I K L E A L I T S C P G V T D A A V S P I K L E A L I T S C P G V T D A A GTAGTGAGGGAAATCCACGAAGACGAAGAGATCCCCGCCGCCTATGTTGTGGGCACCGCC V V R E I H E D E E I P A A Y V V G T A V V R E I H E D E E I P A A Y V V G T A ACCTCGGAGCAGGTCATGGCGTTTGTGGCGGAACGGGTGCCGGGCTATGAGAAGGTTCGC T S E Q V M A F V A E R V P G Y E K V R T S E Q V M A F V A E R V P G Y E K V R GCCGTCCACCACGTGGATACAATTCCGCGTTCTGCGGCCGGCAAGATTCTGCGCCGCGAA A V H H V D T I P R S A A G K I L R R E A V H H V D T I P R S A A G K I L R R E CTGCGCTCTTAGCCGCCCGCGCCTCTCTTTAGTCGCCCGCGTCTTCCTCGCCACGGGACA L R S * P P A P L F S R P R L P R H G T L R S X P P A P L F S R P R L P R H G T GGAAGAGTCCCGCGGTGA G R V P R G R V P R --- ========== Now we show an alignment against a similar protein (fig|504474.3.peg.1366): ---------ATGACATCCCTCACCTACCCGGAAGAAACACTGCCTGAACTGGTCTTTACC M T S L T Y P E E T L P E L V F T MAPRIYSSP Y P S L D Y P S T D V F D L I F G CATCAAAATGACGCACAGGCAACC--GCCATGATCGACCTCAATCGC--TCCATCAGCTT H Q N D A Q A T A M I D L N R S I S F D L T E E E A A LP A I T E L S T QS T A T Y TGGCGATCTCGCAGCGGAAATCACCCACGTGGCCGCGGGGCTGCGCGCGGTGGGCATCGC G D L A A E I T H V A A G L R A V G I A G E L K E F S E T I A A E L A S R G I G CCCCGGCGATGTGGTGGGCGTGCGCCTCGCCAACTCCATCGACTTCGCCGCCGCGTTCCA P G D V V G V R L A N S I D F A A A F H E G D V V T L Q V P N S I N F A A S L L CGCCTGCATCGTCGCCGGCGCCATCGTCATGCCCATCGGCGGGGTGGTCCCCGAG----- A C I V A G A I V M P I G G V V P E G I L R A G A I V N P I G M L M N Q ADVEH --------------------------------GATCCGCGCCCGGCCTACATCGTCGACT D P R P A Y I V D IVEAAGAKLFIGPTNMEQLPQIFSMELASLQG S P K P A P E V D - CCTCCAACTACGAAGAGCTACGCGCCTGCCCCGAGCGGATCGAGATCGGCTCCGTCGCCG ----------------------------------------------------------- TCGACCTTGACGGGCCATGCTGCTACCCCGTCTCCTCCGGCACGACAGGCACCCCCAAGG V D L D G P C C Y P V S S G T T G T P K I D P D S V A A V P F S S G T T G L P K TGGTTGTACTCACCCACCGCAACCTGGTGGCCAACACCATCCAGTTTGGCGCCAAGGTGC V V V L T H R N L V A N T I Q F G A K V G V Q L T H R N L T S N L I H V R E M I CC---GTTCCCTGCGGCTCGGTGTGCCAATCCGTACTGCCGTTTAGCCACATCTACGGTC P V P C G S V C Q S V L P F S H I Y G E RSG I E A R S N T L S V L P F S H I Y G TCACCGCGCTCCTCAACGTGCCGCTCTAC*CT*CGGCGCCACCGTTCTCGCGTGGCCG-T L T A L L N V P L Y R R H V L A W P M T V L L L G P L L *H** R H H - I F T M P K TCGAGGCCGAGCGGTTCATCACCGCCCACGAAAAGTACGGCGTCCACACCACATTCATCG F E A E R F I T A H E K Y G V H T T F I F D I E Q F L R A H A E R S I E F T F I CCCCGCCTCTGGCCACGCTTTTGGCCCGCCACCCCCTGGTGGACAAGACGGACTTCTCCG A P P L A T L L A R H P L V D K T D F S A P P M A I A M A K G P E I D P S W F S CCCTCAAGTACATGATCGTCGGCGCCGCAGCCCTCAACGTTGCCGACGGCGAGCGTGCCG A L K Y M I V G A A A L N V A D G E R A A S K L M V S S A A P I D A P I M R A V CCGAGCGCACCGGCTCGCGGATGCTGCAGGGCTACGGGATGACGGAGGCGTCGCCAGTCA A E R T G S R M L Q G Y G M T E A S P V E E R L D T K V V Q G W G M T E A S P L CCCACCTCACCACAGCATCGACCACACCACTGAGTTCGATAGGCCACCCACTGCCCGACA T H L T T A S T T P L S S I G H P L P D V A L N L H G D A D H S S V G K P V A D CGGAGCAGCGGATAGTCGACCCGTCCACCATCACGGATGTGGCACCCGGCGAGGTGGGTG T E Q R I V D P S T I T D V A P G E V G T E I R L V D I D T L E D V P E G E A G AGCTGTGGGTCGCCGGTCCACAGGTGATGGCGGGCTACTACCACAATCCCGTGGCCACGG E L W V A G P Q V M A G Y Y H N P V A T E V L V R G P Q V M K G Y L N N E E A N ATGCGACGCTTGTG-GGACGCTGGCTGCGCACGGGTGACCTGGCGCGAGAGCTGCCCGGT D A T L V G R W L R T G D L A R E L P G A E T L I E G G W L R T G D I A H F G E D GGCGAGGTCGAGATTGTCGATCGCCTGAAAGATGTGATCAAGTATCACGGGTACCAGGTA G E V E I V D R L K D V I K Y H G Y Q V G G L R I V D R A K E V I K Y K G Y Q V TCCCCCATCAAGTTGGAGGCGCTCATCACCTCGTGCCCCGGTGTCACCGATGCCGCGGTA S P I K L E A L I T S C P G V T D A A V A P A E L E S L L L S H P D I A D V G V GTGAGGGAAATCCACGAAGACGAAGAGATCCCCGCCGCCTATGTTGTG---GGCACCGCC V R E I H E D E E I P A A Y V V G T A V G A E R D G L E I P R A F V V LQE G A E ACCTCGGAG-CAGGTCATGGCGTTTGTGGCGGAACGGGTGCCGGGCTATGAGAAGGTTCG T S E Q V M A F V A E R V P G Y E K V R L T E D E I M D W V A E R V T P Y K K V R CGCCGTCCACCACGTGGATACAATTCCGCGTTCTGCGGCCGGCAAGATTCTGCGCCGCGA A V H H V D T I P R S A A G K I L R R E A V T F L D E I P K N P T G K I L R K D ACTGCGCTCTTAGCCGCCCGCGCCTCTCTTTAGTCGCCCGCGTCTTCCTCGCCACGGGAC L R S * P P A P L R L I P L A G ----------------------------------- AGGAAGAGTCCCGCGGTGA ------------------- // >fig|6666666.67496.peg.40 fig|196627.4.peg.2859 Lead, cadmium, zinc and mercury transporting ATPase (EC 3.6.3.3) (EC 3.6.3.5); Copper-translocating P-type ATPase (EC 3.6.3.4) FIG025203 gi|512068193|gb|ATBY01000017.1|_43386_41953,gi|512068193|gb|ATBY01000017.1|_41953_41153 MSTPHHSGDHHGDHPAPETDHTYHPDHASHEHRADADTHGQAMPHDHPHSALDEDHHVHGHGEHAGHSTAMFRDRFWWSLILSIPVVIFSPMVAHLLGYHLPAFPGSTWIPPVVGTIIFAYGGTPFLKGGWKELKSRQPGMMLLIAMAITVAFVASWATTLGLGGFDLDFWWELALLVAIMLLGHWLEMRALGAASSALDALAALLPDEAEKVIDGTTRTVAISELVVDDVVLVRAGARVPADGTILDGAAEFDEAMITGESRPVFRDTGDKVVAGTVATDNTVRIRVEATGGDTALAGIQRMVADAQESSSRAQALADRAAALLFWFALISALITAVVWTIIGSPDDAVVRTVTVLVIACPHALGLAIPLVIAISSERAAKSGVLIKDRMALERMRTIDVVLFDKTGTLTEGAHAVTGVAAAVGVTEGELLALAAAAEADSEHPVARAIVAAAAAHPEASRRQIRATGFSAASGRGxxATVDGAEILVGGPNMLREFNLTTPAELTDTTSAWTGRGAGVLHIVRDGQIIGAVAVEDKIRPESRAAVKALQDRGVKVAMITGDAQQVAHAVGQDLGIDEVFAEVLPQDKDTKVTQLQDRGLSVAMVGDGVNDAPALTRAEVGIAIGAGTDVAMESAGVILASDDPRAVLSMIELSQASYRKMIQNLIWASGYNILAVPLAAGVLASIGFVLSPAVGAILMSASTIVVALNAQLLRRIDLDPAHLAPTESKEEHTRPTPASTAVH We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGCACTCCCCACCATTCCGGCGATCACCATGGTGATCACCCCGCTCCGGAAACAGAC M S T P H H S G D H H G D H P A P E T D M S T P H H S G D H H G D H P A P E T D CACACCTACCACCCGGATCATGCCAGCCACGAACACCGCGCAGATGCCGACACCCACGGC H T Y H P D H A S H E H R A D A D T H G H T Y H P D H A S H E H R A D A D T H G CAGGCGATGCCCCACGATCATCCGCATTCCGCCCTGGACGAAGATCACCACGTTCATGGT Q A M P H D H P H S A L D E D H H V H G Q A M P H D H P H S A L D E D H H V H G CACGGCGAACACGCCGGACACAGCACCGCAATGTTTCGGGACCGCTTCTGGTGGTCGCTG H G E H A G H S T A M F R D R F W W S L H G E H A G H S T A M F R D R F W W S L ATTTTGTCCATTCCCGTCGTTATTTTCAGCCCCATGGTCGCCCACCTGCTCGGCTACCAC I L S I P V V I F S P M V A H L L G Y H I L S I P V V I F S P M V A H L L G Y H CTCCCGGCATTCCCCGGATCCACCTGGATCCCCCCGGTGGTGGGCACGATCATCTTCGCC L P A F P G S T W I P P V V G T I I F A L P A F P G S T W I P P V V G T I I F A TACGGCGGAACGCCTTTCCTCAAGGGCGGATGGAAAGAACTGAAATCCCGCCAACCCGGG Y G G T P F L K G G W K E L K S R Q P G Y G G T P F L K G G W K E L K S R Q P G ATGATGCTCCTGATCGCCATGGCCATCACCGTGGCGTTTGTCGCCTCCTGGGCCACCACT M M L L I A M A I T V A F V A S W A T T M M L L I A M A I T V A F V A S W A T T CTGGGGCTGGGCGGTTTTGACCTGGACTTCTGGTGGGAGCTGGCCCTGCTGGTAGCCATC L G L G G F D L D F W W E L A L L V A I L G L G G F D L D F W W E L A L L V A I ATGCTGCTGGGCCACTGGCTGGAGATGCGCGCTCTCGGGGCCGCGTCCTCCGCGCTTGAC M L L G H W L E M R A L G A A S S A L D M L L G H W L E M R A L G A A S S A L D GCGCTGGCTGCCCTGCTGCCGGATGAGGCCGAGAAAGTCATCGACGGGACCACCCGCACC A L A A L L P D E A E K V I D G T T R T A L A A L L P D E A E K V I D G T T R T GTGGCCATCTCCGAGCTGGTCGTCGACGACGTCGTGCTGGTGAGGGCCGGTGCCCGGGTG V A I S E L V V D D V V L V R A G A R V V A I S E L V V D D V V L V R A G A R V CCGGCCGACGGAACCATCCTCGACGGAGCCGCCGAATTCGATGAGGCGATGATCACCGGC P A D G T I L D G A A E F D E A M I T G P A D G T I L D G A A E F D E A M I T G GAATCCCGTCCCGTCTTCCGCGACACCGGTGACAAGGTGGTCGCCGGTACCGTGGCCACC E S R P V F R D T G D K V V A G T V A T E S R P V F R D T G D K V V A G T V A T GACAACACCGTCCGCATCCGGGTGGAGGCTACCGGCGGGGACACCGCCCTGGCCGGGATC D N T V R I R V E A T G G D T A L A G I D N T V R I R V E A T G G D T A L A G I CAACGCATGGTTGCCGACGCCCAGGAGTCCTCCTCCCGGGCCCAGGCCCTGGCGGATCGG Q R M V A D A Q E S S S R A Q A L A D R Q R M V A D A Q E S S S R A Q A L A D R GCGGCGGCGTTGTTGTTCTGGTTCGCGCTGATCTCCGCTCTGATCACCGCGGTGGTGTGG A A A L L F W F A L I S A L I T A V V W A A A L L F W F A L I S A L I T A V V W ACCATTATCGGCAGCCCGGACGATGCCGTGGTGCGCACGGTCACGGTGCTGGTCATCGCC T I I G S P D D A V V R T V T V L V I A T I I G S P D D A V V R T V T V L V I A TGCCCGCATGCCCTGGGCCTGGCGATTCCGCTGGTCATTGCGATCTCCAGCGAGCGGGCC C P H A L G L A I P L V I A I S S E R A C P H A L G L A I P L V I A I S S E R A GCGAAATCCGGGGTGCTCATCAAGGACCGAATGGCGCTCGAGCGGATGCGCACCATCGAC A K S G V L I K D R M A L E R M R T I D A K S G V L I K D R M A L E R M R T I D GTGGTGCTCTTCGACAAAACCGGCACCCTGACCGAGGGTGCGCACGCGGTCACCGGTGTC V V L F D K T G T L T E G A H A V T G V V V L F D K T G T L T E G A H A V T G V GCGGCAGCTGTCGGCGTCACCGAGGGCGAGCTGCTGGCCCTGGCCGCCGCCGCGGAGGCC A A A V G V T E G E L L A L A A A A E A A A A V G V T E G E L L A L A A A A E A GACAGCGAGCACCCCGTGGCCCGCGCCATCGTGGCGGCCGCGGCCGCCCATCCCGAGGCC D S E H P V A R A I V A A A A A H P E A D S E H P V A R A I V A A A A A H P E A TCCCGTCGGCAAATCCGTGCAACTGGTTTCAGCGCCGCCTCCGGCCGGGGG*TC*CGGGC S R R Q I R A T G F S A A S G R G R A S R R Q I R A T G F S A A S G R G *X** X A CACTGTCGATGGCGCTGAGATCCTCGTGGGCGGGCCGAACATGCTGCGCGAGTTCAACCT T V D G A E I L V G G P N M L R E F N L T V D G A E I L V G G P N M L R E F N L CACCACCCCGGCCGAGCTCACCGACACCACCAGCGCCTGGACCGGGCGTGGGGCTGGTGT T T P A E L T D T T S A W T G R G A G V T T P A E L T D T T S A W T G R G A G V GCTCCATATTGTCCGCGACGGTCAGATCATCGGTGCGGTGGCCGTCGAGGACAAGATCCG L H I V R D G Q I I G A V A V E D K I R L H I V R D G Q I I G A V A V E D K I R CCCCGAATCCCGCGCCGCCGTGAAAGCCCTGCAGGACCGCGGGGTGAAAGTCGCGATGAT P E S R A A V K A L Q D R G V K V A M I P E S R A A V K A L Q D R G V K V A M I CACCGGCGACGCCCAGCAGGTGGCCCACGCTGTCGGTCAGGACTTAGGCATTGATGAGGT T G D A Q Q V A H A V G Q D L G I D E V T G D A Q Q V A H A V G Q D L G I D E V CTTCGCCGAGGTACTGCCCCAGGACAAAGACACCAAGGTCACGCAGCTGCAGGACCGAGG F A E V L P Q D K D T K V T Q L Q D R G F A E V L P Q D K D T K V T Q L Q D R G TCTGAGCGTGGCCATGGTCGGTGACGGTGTCAATGACGCCCCCGCTCTGACCCGTGCGGA L S V A M V G D G V N D A P A L T R A E L S V A M V G D G V N D A P A L T R A E GGTCGGTATCGCCATCGGTGCTGGCACGGATGTGGCCATGGAATCTGCCGGGGTGATCCT V G I A I G A G T D V A M E S A G V I L V G I A I G A G T D V A M E S A G V I L AGCCAGTGATGACCCGCGGGCAGTGCTGTCGATGATTGAGCTGTCCCAGGCCAGCTACCG A S D D P R A V L S M I E L S Q A S Y R A S D D P R A V L S M I E L S Q A S Y R CAAGATGATCCAGAACCTGATCTGGGCCTCTGGCTACAACATCCTCGCCGTGCCGCTGGC K M I Q N L I W A S G Y N I L A V P L A K M I Q N L I W A S G Y N I L A V P L A CGCCGGAGTGCTCGCCTCGATCGGGTTCGTGCTGTCCCCGGCCGTGGGCGCGATCTTGAT A G V L A S I G F V L S P A V G A I L M A G V L A S I G F V L S P A V G A I L M GTCTGCCTCGACCATCGTGGTGGCCCTGAACGCCCAGCTGTTGCGCCGTATTGATCTGGA S A S T I V V A L N A Q L L R R I D L D S A S T I V V A L N A Q L L R R I D L D TCCGGCCCACCTGGCTCCGACCGAGTCGAAGGAGGAACACACCAGGCCTACTCCGGCATC P A H L A P T E S K E E H T R P T P A S P A H L A P T E S K E E H T R P T P A S CACCGCCGTCCACTGA T A V H T A V H --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.2859): ATGAGCACTCCCCACCATTCCGGCGATCACCATGGTGATCACCCCGCTCCGGAAACAGAC M S T P H H H G D H P A P E T D M S T P H H ------------ H G D H P A P E T D CACACCTACCACCCGGATCATGCCAGCCACGAACACCGCGCAGATGCCGACACCCACGGC H T Y H P D H A S H E H R A D A D T H G H T H H P N H A G H E H H A D A A T H G CAGGCGATGCCCCACGATCATCCGCATTCCGCCCTGGACGAAGATCACCACGTTCATGGT Q A M P H D H P H S A L D E D H H V H G Q A M P H D H P H S T V D E E H Q V H S CACGGCGAACACGCCGGACACAGCACCGCAATGTTTCGGGACCGCTTCTGGTGGTCGCTG H G E H A G H S T A M F R D R F W W S L H G E H A G H S A A M F R D R F W W S L ATTTTGTCCATTCCCGTCGTTATTTTCAGCCCCATGGTCGCCCACCTGCTCGGCTACCAC I L S I P V V I F S P M V A H L L G Y H I L S V P V V F F S P M F A D L L G Y N CTCCCGGCATTCCCCGGATCCACCTGGATCCCCCCGGTGGTGGGCACGATCATCTTCGCC L P A F P G S T W I P P V V G T I I F A I P E I P G A Y W I P P V L G T I I F L TACGGCGGAACGCCTTTCCTCAAGGGCGGATGGAAAGAACTGAAATCCCGCCAACCCGGG Y G G T P F L K G G W K E L K S R Q P G Y G G T P F L K G A M T E L K S R Q P G ATGATGCTCCTGATCGCCATGGCCATCACCGTGGCGTTTGTCGCCTCCTGGGCCACCACT M M L L I A M A I T V A F V A S W A T T M M L L I A M A I T V A F I A S W V T T CTGGGGCTGGGCGGTTTTGACCTGGACTTCTGGTGGGAGCTGGCCCTGCTGGTAGCCATC L G L G G F D L D F W W E L A L L V A I L G L G G F H L D F W W E L A L L V T I ATGCTGCTGGGCCACTGGCTGGAGATGCGCGCTCTCGGGGCCGCGTCCTCCGCGCTTGAC M L L G H W L E M R A L G A A S S A L D M L L G H W L E M R A L G A A S S A L D GCGCTGGCTGCCCTGCTGCCGGATGAGGCCGAGAAAGTCATCGACGGGACCACCCGCACC A L A A L L P D E A E K V I D G T T R T A L A A L L P D E A E K V V D G T T R T GTGGCCATCTCCGAGCTGGTCGTCGACGACGTCGTGCTGGTGAGGGCCGGTGCCCGGGTG V A I S E L V V D D V V L V R A G A R V V A I S E L A V D D V V L V R A G A R V CCGGCCGACGGAACCATCCTCGACGGAGCCGCCGAATTCGATGAGGCGATGATCACCGGC P A D G T I L D G A A E F D E A M I T G P A D G T I I D G A A E F D E A M I T G GAATCCCGTCCCGTCTTCCGCGACACCGGTGACAAGGTGGTCGCCGGTACCGTGGCCACC E S R P V F R D T G D K V V A G T V A T E S R P V Y R D T G E T V V A G T V A T GACAACACCGTCCGCATCCGGGTGGAGGCTACCGGCGGGGACACCGCCCTGGCCGGGATC D N T V R I R V E A T G G D T A L A G I D N T V R I R V E A T G G D T A L A G I CAACGCATGGTTGCCGACGCCCAGGAGTCCTCCTCCCGGGCCCAGGCCCTGGCGGATCGG Q R M V A D A Q E S S S R A Q A L A D R Q R M V A D A Q A S S S R A Q A L A D R GCGGCGGCGTTGTTGTTCTGGTTCGCGCTGATCTCCGCTCTGATCACCGCGGTGGTGTGG A A A L L F W F A L I S A L I T A V V W A A A F L F W F A L I T A L I T A V V W ACCATTATCGGCAGCCCGGACGATGCCGTGGTGCGCACGGTCACGGTGCTGGTCATCGCC T I I G S P D D A V V R T V T V L V I A T I I G S P D D A V V R A V T V L I I A TGCCCGCATGCCCTGGGCCTGGCGATTCCGCTGGTCATTGCGATCTCCAGCGAGCGGGCC C P H A L G L A I P L V I A I S S E R A C P H A L G L A I P L V I A I S S E R A GCGAAATCCGGGGTGCTCATCAAGGACCGAATGGCGCTCGAGCGGATGCGCACCATCGAC A K S G V L I K D R M A L E R M R T I D A K S G V L I K D R M A L E H M R T I D GTGGTGCTCTTCGACAAAACCGGCACCCTGACCGAGGGTGCGCACGCGGTCACCGGTGTC V V L F D K T G T L T E G A H A V T G V V V L F D K T G T L T E G A H A V T G V GCGGCAGCTGTCGGCGTCACCGAGGGCGAGCTGCTGGCCCTGGCCGCCGCCGCGGAGGCC A A A V G V T E G E L L A L A A A A E A A P A T G I A E G E L L A L A A A A E A GACAGCGAGCACCCCGTGGCCCGCGCCATCGTGGCGGCCGCGGCCGCCCATCCCGAGGCC D S E H P V A R A I V A A A A A H P E A D S E H P V A R A I V T A A A A H P E A TCCCGTCGGCAAATCCGTGCAACTGGTTTCAGCGCCGCCTCCGGCCGGGGG*TC*CGGGC S R R Q I R A T G F S A A S G R G R A S Q R Q L R A T G F T A A S G R G *I** R A CACTGTCGATGGCGCTGAGATCCTCGTGGGCGGGCCGAACATGCTGCGCGAGTTCAACCT T V D G A E I L V G G P N M L R E F N L T V D G A E I L V G G P N M L R E F N L CACCACCCCGGCCGAGCTCACCGACACCACCAGCGCCTGGACCGGGCGTGGGGCTGGTGT T T P A E L T D T T S A W T G R G A G V T T P G E L A D I T G S W A Q R G A G V GCTCCATATTGTCCGCGACGGTCAGATCATCGGTGCGGTGGCCGTCGAGGACAAGATCCG L H I V R D G Q I I G A V A V E D K I R L H V V R D G E I I G A V A V E D K I R CCCCGAATCCCGCGCCGCCGTGAAAGCCCTGCAGGACCGCGGGGTGAAAGTCGCGATGAT P E S R A A V K A L Q D R G V K V A M I P E S R A A V R A L Q A R G V K V A M I CACCGGCGACGCCCAGCAGGTGGCCCACGCTGTCGGTCAGGACTTAGGCATTGATGAGGT T G D A Q Q V A H A V G Q D L G I D E V T G D A T Q V A Q A V G K D L G I D E V CTTCGCCGAGGTACTGCCCCAGGACAAAGACACCAAGGTCACGCAGCTGCAGGACCGAGG F A E V L P Q D K D T K V T Q L Q D R G F A E V L P Q D K D T K V T Q L Q E R G TCTGAGCGTGGCCATGGTCGGTGACGGTGTCAATGACGCCCCCGCTCTGACCCGTGCGGA L S V A M V G D G V N D A P A L T R A E L S V A M V G D G V N D A P A L A R A E GGTCGGTATCGCCATCGGTGCTGGCACGGATGTGGCCATGGAATCTGCCGGGGTGATCCT V G I A I G A G T D V A M E S A G V I L V G I A I G A G T D V A M E S A G V V L AGCCAGTGATGACCCGCGGGCAGTGCTGTCGATGATTGAGCTGTCCCAGGCCAGCTACCG A S D D P R A V L S M I E L S Q A S Y R A S D D P R A V L S M I E L S H A S Y R CAAGATGATCCAGAACCTGATCTGGGCCTCTGGCTACAACATCCTCGCCGTGCCGCTGGC K M I Q N L I W A S G Y N I L A V P L A K M V Q N L V W A T G Y N I V A V P L A CGCCGGAGTGCTCGCCTCGATCGGGTTCGTGCTGTCCCCGGCCGTGGGCGCGATCTTGAT A G V L A S I G F V L S P A V G A I L M A G V L A P I G V L L P P A A A A I L M GTCTGCCTCGACCATCGTGGTGGCCCTGAACGCCCAGCTGTTGCGCCGTATTGATCTGGA S A S T I V V A L N A Q L L R R I D L D S L S T I I V A L N A Q L L R R I D L D TCCGGCCCACCTGGCTCCGACCGAGTCGAAGGAGGAACACACCAGGCCTACTCCGGCATC P A H L A P T E S K E E H T R P T P A S P A H L A P T D G K E E K A A V S S A A CACCGCCGTCCACTGA T A V P V R ------ // >fig|6666666.67496.peg.2320 fig|196627.4.peg.186 hypothetical protein gi|512071492|gb|ATBY01000002.1|_215564_216061,gi|512071492|gb|ATBY01000002.1|_216063_216461 MALSVLPTASAVSLDPGAVPSRTQITVRLDSGVAFSTLNGAESRPALSLAKLYLGYWVLYHGAPEDQARVENMIRYSEDSTATYLDRKYRQAIPAIIGEWNLHETHYSGYWGGMTTSTEDVARFTSAIQYDPVATPIMNGMREAAPIARDGYAQNYGTSRLPRCVGTKFGWSDNRTINASVSLAPGFTVAAHTYGTADTLTDDVLTAVHNDPQPSQSSQLPTMSADLVSPEQALLNVSRKTDRIHQQVATQADQATRNVQAQFAEAQRVATEQAATAQRDTCNALNSAASQAGLAPVC We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCGCTCTCCGTCCTCCCCACGGCGAGCGCGGTAAGCCTGGACCCCGGGGCGGTTCCA M A L S V L P T A S A V S L D P G A V P M A L S V L P T A S A V S L D P G A V P TCGCGAACGCAGATTACGGTACGGCTTGATTCGGGTGTGGCGTTTTCTACCCTCAACGGC S R T Q I T V R L D S G V A F S T L N G S R T Q I T V R L D S G V A F S T L N G GCCGAATCCCGCCCGGCGCTGTCTCTGGCGAAGCTGTACCTCGGGTATTGGGTGCTGTAC A E S R P A L S L A K L Y L G Y W V L Y A E S R P A L S L A K L Y L G Y W V L Y CACGGCGCGCCGGAAGATCAGGCGCGGGTGGAAAACATGATTCGGTACAGCGAGGATTCC H G A P E D Q A R V E N M I R Y S E D S H G A P E D Q A R V E N M I R Y S E D S ACCGCTACCTATTTGGATCGCAAGTACAGGCAGGCCATCCCTGCGATCATCGGAGAGTGG T A T Y L D R K Y R Q A I P A I I G E W T A T Y L D R K Y R Q A I P A I I G E W AACCTGCACGAGACTCACTATTCGGGCTATTGGGGAGGCATGACAACATCTACCGAGGAC N L H E T H Y S G Y W G G M T T S T E D N L H E T H Y S G Y W G G M T T S T E D GTGGCGCGGTTCACGTCGGCTATTCAGTACGATCCGGTGGCCACTCCGATCATGAATGGG V A R F T S A I Q Y D P V A T P I M N G V A R F T S A I Q Y D P V A T P I M N G ATGCGAGAAGCGGCACCGATCGCACGGGATGGGTACGCACAGAACTACGGCACCTCGCGT M R E A A P I A R D G Y A Q N Y G T S R M R E A A P I A R D G Y A Q N Y G T S R CTTCCCCGGTGTGTGGGGCACCAAGTTTGGGTGGTCAGATAACCGCACAATCAATGCCTC L P R C V G T K F G W S D N R T I N A S L P R C V G - T K F G W S D N R T I N A S GGTTTCGCTGGCACCAGGATTCACGGTGGCAGCCCACACTTATGGCACGGCAGATACGCT V S L A P G F T V A A H T Y G T A D T L V S L A P G F T V A A H T Y G T A D T L CACCGACGACGTTCTCACGGCTGTTCACAACGATCCGCAGCCGAGCCAGTCGTCACAGTT T D D V L T A V H N D P Q P S Q S S Q L T D D V L T A V H N D P Q P S Q S S Q L ACCCACCATGAGCGCTGACCTAGTATCCCCAGAGCAAGCTCTCCTCAATGTGTCGAGGAA P T M S A D L V S P E Q A L L N V S R K P T M S A D L V S P E Q A L L N V S R K AACGGACCGAATTCACCAGCAGGTTGCGACACAGGCAGATCAAGCAACCCGTAACGTGCA T D R I H Q Q V A T Q A D Q A T R N V Q T D R I H Q Q V A T Q A D Q A T R N V Q AGCTCAATTTGCTGAGGCGCAACGTGTGGCCACCGAGCAGGCAGCCACCGCACAACGAGA A Q F A E A Q R V A T E Q A A T A Q R D A Q F A E A Q R V A T E Q A A T A Q R D CACGTGCAATGCGCTCAATTCCGCTGCTTCCCAAGCGGGCCTTGCCCCCGTCTGCTAG T C N A L N S A A S Q A G L A P V C T C N A L N S A A S Q A G L A P V C --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.186): -------------------ATGGCGCTCTCCGTCCTCCCCACGGCGAGCGCGGTAAGCCT M A L S V L P T A S A V S L MKTPRLLKILSAMVAVTGL L I P T V V P M A A A D A A GGAC-CCCGGGGCGGTTCCATCGCGAACGCAGATTACGGTACGGCTTGATTCGGGTGTGG D P G A V P S R T Q I T V R L D S G V E L S D N V P D R T Q I A I I N P D G S CGTTTTCTACCCTCAACGGCGCCGAATCCCGCCCGGCGCTGTCTCTGGCGAAGCTGTACC A F S T L N G A E S R P A L S L A K L Y V Q E S D N A E E S R P A L S L A K L Y TCGGGTATTGGGTGCTGTACCACGGCGCGCCGGAAGATCAGGCGCGGGTGGAAAACATGA L G Y W V L Y H G A P E D Q A R V E N M L G Y Y V L A Q G A E E D I E L V P D M TTCGGTACAGCGAGGATTCCACCGCTACCTATTTGGATCGCAAGTACAGGCAGGCCATCC I R Y S E D S T A T Y L D R K Y R Q A I I R Y S D D F T A D Y L E S E Y P E A I CTGCGATCATCGGAGAGTGGAACCTGCACGAGACTCACTATTCGGGCTATTGGGGAGGCA P A I I G E W N L H E T H Y S G Y W G G P E V I D A F D L E D T E W A G F W G N TGACAACATCTACCGAGGACGTGGCGCGGTTCACGTCGGCTATTCAGTACGATCCGGTGG M T T S T E D V A R F T S A I Q Y D P V A T T S A V D I A T F V A A L I D D P T CCACTCCGATCATGAATGGGATGCGAGAAGCGGCACCGATCGCACGGGATGGGTACGCAC A T P I M N G M R E A A P I A R D G Y A A Q P L L D A M S D T A E Y A A D G Y A AGAACTACGGCACCTCGCGTCTTCCCCGGTGTGTGGGGCACCAAGTTTGGGTGGTCAGAT Q N Y G T S R L P G V W G T K F G W S D Q N F G T F T L S - D V T G T K F G W S D AACCGCACAATCAATGCCTCGGTTTCGCTGGCACCAGGATTCACGGTGGCAGCCCACACT N R T I N A S V S L A P G F T V A A H T S L D V H S S V S F G P G F V I A A N T TATGGCACGGCAGATACGCTCACCGACGACGTTCTCACGGCTGTTCACAACGATCCGCAG Y G T A D T L T D D V Q Y G D A E T L T E D V ------------------------ Q CCGAGCCAGTCGTCACAGTTACCCACCATGAGCGCTGACCTAGTATCCCCAGAGCAAGCT P S Q S S Q L P D S V S S L Y P ------------------------------------ CTCCTCAATGTGTCGAGGAAAACGGACCGAATTCACCAGCAGGTTGCGACACAGGCAGAT D R I H Q Q V A T Q A D ------------------------ E E V T T A I E E Q V D CAAGCAACCCGTAACGTGCAAGCTCAATTTGCTGAGGCGCAACGTGTGGCCACCGAGCAG Q I C * G A T C G H R A Q ----------------------- L C E C A A E T T H L GCAGCCACCGC*AC*AACGAGACACGTGCAATG-------CGCTCAATTCCGCTGCTTCC G S H R N E T R A M R S I P L L P G M H T *G** A E L K A Q LEGTIYG K T L S F L P C*A*AGCGGGCCTTGCCCCCGTCTGCTAG------ S G P C P R L L *N* S A P A P A F I -YNLLAH // >fig|6666666.67496.peg.2015 fig|196164.1.peg.2013 Vitamin B12 ABC transporter, B12-binding component BtuF FIG016684 gi|512071173|gb|ATBY01000007.1|_19318_20271,gi|512071173|gb|ATBY01000007.1|_20275_20310 MRLETTRQRGVLLAALFAFLAVVALVVSGCSGSASEGSSAAETSAPSETAGAFPLTVASDDGRTLTLDKKPERIVSLSASSTESLYAIGAGDAVVAADKYSTYPEEAPNDENLSARATNAEALLTYNPDLVVVSWNAEELIGGLDAVGVPVLVMLPPTTVDGAYEQIERLGQATGHAEEATGVTSDMRQQIEKTVAASNHKGEGKSYFHEVTIDYYTVSNDTFLGDVYSLFGLSSIAPEDASGYPQLTEEAIIAANPDYIFLVDHTSEKLTPQQVADRPGWSAITAVQEGRIIPLDEDLASRWGPRLPQLVEQIAENLxFRITTPTRTRR We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGGCTGGAAACTACGCGGCAGCGAGGGGTTCTTCTTGCCGCGCTTTTTGCGTTTTTG M R L E T T R Q R G V L L A A L F A F L M R L E T T R Q R G V L L A A L F A F L GCAGTGGTGGCCCTCGTAGTAAGCGGGTGTTCGGGCAGCGCATCGGAGGGCTCGTCGGCC A V V A L V V S G C S G S A S E G S S A A V V A L V V S G C S G S A S E G S S A GCCGAGACCTCGGCACCGAGCGAAACTGCCGGCGCGTTTCCGCTCACCGTGGCCAGTGAT A E T S A P S E T A G A F P L T V A S D A E T S A P S E T A G A F P L T V A S D GACGGGCGCACGCTGACCTTAGATAAAAAACCCGAGCGGATCGTTTCTCTTTCCGCGAGC D G R T L T L D K K P E R I V S L S A S D G R T L T L D K K P E R I V S L S A S TCCACGGAATCCCTCTACGCCATCGGTGCGGGAGATGCCGTGGTTGCCGCCGATAAGTAC S T E S L Y A I G A G D A V V A A D K Y S T E S L Y A I G A G D A V V A A D K Y TCCACCTACCCGGAGGAGGCACCCAATGATGAAAACCTCAGTGCTCGCGCAACCAACGCC S T Y P E E A P N D E N L S A R A T N A S T Y P E E A P N D E N L S A R A T N A GAGGCGCTGCTGACATACAACCCGGATCTCGTAGTGGTGTCCTGGAATGCCGAGGAACTG E A L L T Y N P D L V V V S W N A E E L E A L L T Y N P D L V V V S W N A E E L ATCGGCGGGCTCGATGCCGTGGGCGTTCCGGTACTCGTGATGCTCCCGCCGACCACGGTG I G G L D A V G V P V L V M L P P T T V I G G L D A V G V P V L V M L P P T T V GACGGAGCCTACGAGCAGATCGAGAGGCTCGGCCAGGCTACCGGGCACGCCGAGGAAGCT D G A Y E Q I E R L G Q A T G H A E E A D G A Y E Q I E R L G Q A T G H A E E A ACCGGTGTGACTAGCGATATGAGGCAGCAGATCGAGAAAACGGTGGCGGCTTCCAATCAC T G V T S D M R Q Q I E K T V A A S N H T G V T S D M R Q Q I E K T V A A S N H AAGGGGGAGGGCAAGTCGTACTTCCATGAGGTGACCATCGACTACTACACCGTCTCCAAC K G E G K S Y F H E V T I D Y Y T V S N K G E G K S Y F H E V T I D Y Y T V S N GACACGTTCCTCGGCGATGTGTACAGTCTGTTTGGGCTTTCGTCCATTGCTCCCGAGGAT D T F L G D V Y S L F G L S S I A P E D D T F L G D V Y S L F G L S S I A P E D GCCTCCGGCTATCCGCAGCTCACCGAGGAGGCGATCATCGCCGCTAACCCGGATTACATC A S G Y P Q L T E E A I I A A N P D Y I A S G Y P Q L T E E A I I A A N P D Y I TTCCTCGTGGACCACACCTCGGAGAAGCTGACCCCGCAGCAGGTGGCAGACCGCCCCGGC F L V D H T S E K L T P Q Q V A D R P G F L V D H T S E K L T P Q Q V A D R P G TGGTCTGCGATCACCGCCGTGCAAGAGGGCCGCATCATTCCCCTCGACGAGGACCTCGCC W S A I T A V Q E G R I I P L D E D L A W S A I T A V Q E G R I I P L D E D L A AGCCGCTGGGGGCCGCGCCTGCCCCAACTAGTGGAGCAGATCGCGGAGAACCTGTAGTTC S R W G P R L P Q L V E Q I A E N L * F S R W G P R L P Q L V E Q I A E N L X F CGCATAACAACCCCCACGCGGACGCGCCGGTAA R I T T P T R T R R R I T T P T R T R R --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2013): --------ATGAGGCTGGAAACTACGCGGCAGCGAGGGGTTCTTCTTGCCGCGCTTTTT- M R L E T T R Q R G V L L A A L F MAPHTIPG T R I P R S R R R R S L P A L V A S GCGTTTTTGGCAGTGGTGGCCCTCGTAGTAAGCGGGTGTTCGGGCAGCGCATCGGAGGGC A F L A V V A L V G C S G S A S E G A L L A A T A L V ------ G C G S E Q E T G TCGTCGGCCGCCGAGACCTCGGCACCGAGCGAAACTGCCGGCGCGTTTCCGCTCACCGTG S S A A E T S A P S E T A G A F P L T V E S A D G T D A T T T T A E G F P V T I GCCAGTGATGACGGGCGCACGCTGACCTTAGATAAAAAACCCGAGCGGATCGTTTCTCTT A S D D G R T L T L D K K P E R I V S L T A I P N G P V V I G D Q P E R I V S L TCCGCGAGCTCCACGGAATCCCTCTACGCCATCGGTGCGGGAGATGCCGTGGTTGCCGCC S A S S T E S L Y A I G A G D A V V A A S P T S T E M L F A I G S G D Q V I A A GATAAGTACTCCACCTACCCGGAGGAGGCACCCAATGATGAAAACCTCAGTGCTCGCGCA D K Y S T Y P E E A P N D E N L S A R A D E Y S N Y P E E A P R V D G L S G Y T ACCAACGCCGAGGCGCTGCTGACATACAACCCGGATCTCGTAGTGGTGTCCTGGAATGCC T N A E A L L T Y N P D L V V V S W N A P N V E A V L E Y D P D L V V L T P T G GAGGAACTGATCGGCGGGCTCGATGCCGTGGGCGTTCCGGTACTCGTGATGCTCCCGCCG E E L I G G L D A V G V P V L V M L P P E G I I D G L T A A G V P T L M L D A S ACCACGGTGGACGGAGCCTACGAGCAGATCGAGAGGCTCGGCCAGGCTACCGGGCACGCC T T V D G A Y E Q I E R L G Q A T G H A E V L E D T Y E Q I E L L G E A T G N R GAGGAAGCTACCGGTGTGACTAGCGATATGAGGCAGCAGATCGAGAAAACGGTGGCGGCT E E A T G V T S D M R Q Q I E K T V A A E N A T E L V D D M Q T T I D E A I A T --TCCAATCACAAGGGGGAGGGCAAGTCGTACTTCCATGAGGTGACCATCGACTACTACA S N H K G E G K S Y F H E V T I D Y Y VP Q D L K D A G L T Y Y H E L S S S Y H CCGTCTCCAACGACACGTTCCTCGGCGATGTGTACAGTCTGTTTGGGCTTTCGTCCATTG T V S N D T F L G D V Y S L F G L S S I S I S D R T Y L G Q I Y A A F G L S S I CTCCCGAGGATGCCTCCGGCTATCCGCAGCTCACCGAGGAGGCGATCATCGCCGCTAACC A P D A S G Y P Q L T E E A I I A A N A P --- D T D D Y P Q L T S E A V V A A N CGGATTACATCTTCCTCGTGGACCACACCTCGGAGAAGCTGACCCCGCAGCAGGTGGCAG P D Y I F L V D H T S E K L T P Q Q V A P D I I F L A N T K A E G M D P E T V A ACCGCCCCGGCTGGTCTGCGATCACCGCCGTGCAAGAGGGCCGCATCATTCCCCTCGACG D R P G W S A I T A V Q E G R I I P L D S R P G W E T I D A V R E D Q V I S L D AGGACCTCGCCAGCCGCTGGGGGCCGCGCCTGCCCCAACTAGTGGAGCAGATCGCGGAGA E D L A S R W G P R L P Q L V E Q I A E D D L A S R W G P R V S E L V E E I A R ACCTGTAGTTCCGCATAACAACCCCCACGCGGACGCGCCGGT*AA*---- N L * F R I T P P R G R A G Q L N E R V V - P A M G N A A *A**PAAA // >fig|6666666.67496.peg.108 fig|196164.1.peg.760 hypothetical protein FIG019921 gi|512068193|gb|ATBY01000017.1|_115403_115537,gi|512068193|gb|ATBY01000017.1|_115541_116017 MRVRRGRQRSEVRGGFRVRVGQRGDSRSSASGATAASKSIHGVPVxTTAQLELGPMVATSRHGRSKRGPRGPLLPHDVPRARTRSQQFDANVLEAYAPFLHRYYEELSLIDVAVDTVPRMQLNPDAAAVDSDIVADGPVPLGRIVPAGLDASGRPTKPRIVIFRGPVQERARDTLEELDLLTSILTELISGYLGIDPEDLETDE We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCGGGTTAGACGTGGGCGCCAGCGGTCCGAGGTACGCGGTGGATTCCGAGTACGCGTA V R V R R G R Q R S E V R G G F R V R V M R V R R G R Q R S E V R G G F R V R V GGACAGCGTGGCGACAGCAGGTCTTCCGCATCCGGGGCGACAGCAGCGTCGAAAAGTATT G Q R G D S R S S A S G A T A A S K S I G Q R G D S R S S A S G A T A A S K S I CACGGTGTACCAGTCTAGACTACGGCGCAACTAGAATTGGGACCCATGGTGGCTACATCA H G V P V * T T A Q L E L G P M V A T S H G V P V X T T A Q L E L G P M V A T S CGACACGGACGATCAAAACGCGGCCCGCGCGGCCCGCTTCTCCCCCACGACGTTCCGCGC R H G R S K R G P R G P L L P H D V P R R H G R S K R G P R G P L L P H D V P R GCGCGGACCCGCAGCCAGCAGTTCGACGCCAACGTGCTGGAGGCGTACGCCCCGTTCCTC A R T R S Q Q F D A N V L E A Y A P F L A R T R S Q Q F D A N V L E A Y A P F L CACCGCTACTACGAGGAGCTGTCGCTCATCGACGTCGCCGTCGACACCGTCCCGCGGATG H R Y Y E E L S L I D V A V D T V P R M H R Y Y E E L S L I D V A V D T V P R M CAGCTCAACCCCGACGCCGCCGCCGTTGATTCTGACATTGTTGCCGACGGCCCAGTCCCC Q L N P D A A A V D S D I V A D G P V P Q L N P D A A A V D S D I V A D G P V P CTGGGCAGGATCGTACCCGCCGGCCTCGATGCCTCCGGCCGCCCTACCAAGCCGCGCATC L G R I V P A G L D A S G R P T K P R I L G R I V P A G L D A S G R P T K P R I GTCATCTTCCGCGGCCCCGTCCAGGAGCGCGCCCGCGACACGCTGGAGGAGCTCGACCTG V I F R G P V Q E R A R D T L E E L D L V I F R G P V Q E R A R D T L E E L D L TTGACCTCCATCCTCACCGAGCTCATCTCCGGCTACCTGGGCATTGACCCCGAGGACCTG L T S I L T E L I S G Y L G I D P E D L L T S I L T E L I S G Y L G I D P E D L GAGACCGACGAATAG E T D E E T D E --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.760): GTGCGGGTTAGACGTGGGCGCCAGCGGTCCGAGGTACGCGGTGGATTCCGAGTACGCGTA L D V G A S G P R ------- M N S H A P P P R -------------------------- GGACAGCGTGGCGACAGCAGGTCTTCCG-----CATCCGGGGCGACAGCAGCGTCGAAAA V A T A G L P H P G R Q Q ------- V V P L G A P TPLCC S P G L E S --------- GTATTCACGGTGTACCAGTCTAGACTACGGCGCAACTAGAATTGGGACCCATGGTGGCTA T V Y Q S R L R R N ------ T L M H S R T F R D ------------------------ CATCACGACACGGACGATCAAAACGCGGCCCGCGCGGCCCGCTTCTCCCCCACGACGTTC R H G R G P R G P L L P H D V ----- R H G R --------- G L R G P L L P T A V CGCGCGCGCGGACCCGCAGCCAGCAGTTCGACGCCAACGTGCTGGAGGCGTACGCCCCGT P R A R T R S Q Q F D A N V L E A Y A P P R H A S R R K A F D R A V L E A Y G P TCCTCCACCGCTACTACGAGGAGCTGTCGCTCATCGACGTCGCCGTCGACACCGTCCCGC F L H R Y Y E E L S L I D V A V D T V P L Y A A Y R K E L A N L D V A V D T V P GGATGCAGCTCAACCCCGACGCCGCCGCCGTTGATTCTGACATTGTTGCCGACGGCCCAG R M Q L N P D A A A V D S D I V A D G P R M R L S A D M T I L P D E I T A D G P TCCCCCTGGGCAGGATCGTACCCGCCGGCCTCGATGCCTCCGGCCGCCCTACCAAGCCGC V P L G R I V P A G L D A S G R P T K P V P L G R V I P P A I D P Q G N P T R A GCATCGTCATCTTCCGCGGCCCCGTCCAGGAGCGCGCCCGCGACACGCTGGAGGAGCTCG R I V I F R G P V Q E R A R D T L E E L R I V I F R M P I E Q R V T N K A E R H ACCTGTTGACCTCCATCCTCACCGAGCTCATCTCCGGCTACCTGGGCATTGACCCCGAGG D L L T S I L T E L I S G Y L G I D P E E L L T H V L T S L V A N Y L N V E P H ACCTGGAGACCGACGAATAG- D L E T D E * D I D P G F Q Y // >fig|6666666.67496.peg.1818 fig|306537.3.peg.576 FIG002813: LPPG:FO 2-phospho-L-lactate transferase like, CofD-like FIG002813 gi|512070728|gb|ATBY01000009.1|_188211_188200,gi|512070728|gb|ATBY01000009.1|_188196_187219 MRKGxHVANIVCLGGGHGLFQTLTALRRQGEKDITAVVSVADDGGSSGRIRKELEQIPPGDLRMAIAALIPDNAGSSPVGWEELLQHRFGGHGALAGHAVGNLLIAAVTEITGSSVTALDTVVRASGAVGRVLPVSCQPLQIEADVSGLDPTNIGNIYPVRGQVAVASTTGSVQRVRLIPANPRPSEETLDAISQADLITLGPGSWFTSVIPDVLIPGVEQAINASLATTVVVLNLSAEPGETAGFTAERHLYMLKRHSQRLHVDYFLVDKNMVNSEKEQRELVISASDFGAQVLFRDLCEKDQFGTPTDRHDPALLGAALMEIKDHVAS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGAGGAAAGGGTGACACGTGGCGAACATTGTGTGTCTCGGTGGGGGCCATGGACTATTT V R K G * H V A N I V C L G G G H G L F M R K G X H V A N I V C L G G G H G L F CAAACTCTCACGGCCCTGAGAAGGCAGGGGGAGAAAGATATCACCGCTGTCGTCTCCGTG Q T L T A L R R Q G E K D I T A V V S V Q T L T A L R R Q G E K D I T A V V S V GCTGATGATGGCGGGTCATCCGGGCGGATTAGGAAAGAACTGGAGCAGATTCCACCGGGA A D D G G S S G R I R K E L E Q I P P G A D D G G S S G R I R K E L E Q I P P G GACTTGCGGATGGCTATTGCAGCTCTCATTCCCGATAACGCCGGCAGCTCACCCGTCGGT D L R M A I A A L I P D N A G S S P V G D L R M A I A A L I P D N A G S S P V G TGGGAGGAGCTTCTCCAACATCGCTTTGGCGGCCACGGCGCACTCGCCGGCCACGCGGTG W E E L L Q H R F G G H G A L A G H A V W E E L L Q H R F G G H G A L A G H A V GGAAACCTGCTCATCGCCGCGGTGACGGAGATCACGGGGAGCTCGGTAACAGCCTTGGAC G N L L I A A V T E I T G S S V T A L D G N L L I A A V T E I T G S S V T A L D ACAGTGGTGCGTGCATCCGGCGCAGTGGGCCGGGTTCTCCCCGTCAGCTGCCAACCTCTG T V V R A S G A V G R V L P V S C Q P L T V V R A S G A V G R V L P V S C Q P L CAAATAGAGGCGGACGTATCCGGCCTCGATCCCACCAACATTGGCAATATTTACCCCGTG Q I E A D V S G L D P T N I G N I Y P V Q I E A D V S G L D P T N I G N I Y P V CGAGGCCAGGTGGCGGTTGCCTCAACAACCGGCTCTGTGCAGAGAGTGCGCCTTATCCCG R G Q V A V A S T T G S V Q R V R L I P R G Q V A V A S T T G S V Q R V R L I P GCGAACCCACGGCCCAGCGAGGAGACGTTGGACGCAATCTCCCAGGCCGACCTCATCACC A N P R P S E E T L D A I S Q A D L I T A N P R P S E E T L D A I S Q A D L I T CTTGGGCCCGGTTCCTGGTTCACATCCGTGATCCCCGATGTTCTCATCCCCGGGGTGGAG L G P G S W F T S V I P D V L I P G V E L G P G S W F T S V I P D V L I P G V E CAGGCGATCAACGCATCGTTGGCGACCACGGTGGTGGTGCTCAACCTGTCCGCTGAGCCG Q A I N A S L A T T V V V L N L S A E P Q A I N A S L A T T V V V L N L S A E P GGGGAGACCGCCGGTTTTACCGCGGAGCGGCACCTGTATATGCTCAAGCGGCATTCGCAG G E T A G F T A E R H L Y M L K R H S Q G E T A G F T A E R H L Y M L K R H S Q CGCCTCCACGTTGATTACTTCCTCGTGGATAAGAACATGGTGAATTCAGAAAAGGAACAG R L H V D Y F L V D K N M V N S E K E Q R L H V D Y F L V D K N M V N S E K E Q CGCGAGCTCGTCATTTCTGCATCAGATTTTGGGGCCCAGGTGTTGTTCCGAGACCTGTGC R E L V I S A S D F G A Q V L F R D L C R E L V I S A S D F G A Q V L F R D L C GAAAAGGATCAGTTTGGTACCCCAACCGATAGGCATGACCCTGCCTTGCTCGGTGCCGCG E K D Q F G T P T D R H D P A L L G A A E K D Q F G T P T D R H D P A L L G A A CTGATGGAAATCAAGGATCACGTGGCTTCCTAA L M E I K D H V A S L M E I K D H V A S --- ========== Now we show an alignment against a similar protein (fig|306537.3.peg.576): ----GTGAGGAAAGGGTGACACGTGGCGAACATTGTGTGTCTCGGTGGGGGCCATGGACT V R K G * H V A N I V C L G G G H G L MSTS E K P G K P I A N I A C L G G G H G L ATTTCAAACTCTCACGGCCCTGAGAAGGCAGGGGGAGAAAGATATCACCGCTGTCGTCTC F Q T L T A L R R Q G E K I T A V V S F N T L R S A R T I A D Y --- V S A I V T CGTGGCTGATGATGGCGGGTCATCCGGGCGGATTAGGAAAGAACTGGAGCAGATTCCACC V A D D G G S S G R I R K E L E Q I P P V A D D G G S S G R I R R E L G S L P P GGGAGACTTGCGGATGGCTATTGCAGCTCTCATTCCCGATAACGCCGGCAGCTCACCCGT G D L R M A I A A L I P D N A G S S P G D L R M A L A A L T R D N E R G R M -- CGGTTGGGAGGAGCTTCTCCAACATCGCTTTGGCGGCCACGGCGCACTCGCCGGCCACGC W E E L L Q H R F G G H G A L A G H A ---- W E E V L Q H R F G G S G A L K G H A GGTGGGAAACCTGCTCATCGCCGCGGTGACGGAGATCACGGGGAGCTCGGTAACAGCCTT V G N L L I A A V T E I T G S S V T A L L G N F L I T G L A Q V M G S E M E A L GGACACAGTGGTGCGTGCATCCGGCGCAGTGGGCCGGGTTCTCCCCGTCAGCTGCCAACC D T V V R A S G A V G R V L P V S C Q P D E I G R L L G I E G R V I P M S N E P TCTGCAAATAGAGGCGGACGTATCCGGCCTC--GATCCCACCAACATTGGCAATATTTAC L Q I E A D V S G L D P T N I Y L D L E A E V L G L EE D P R E V --------- V CCCGTGCGAGGCCAGGTGGCGGTTGCCTCAACAACCGGCTCTGTGCAGAGAGTGCGCCTT P V R G Q V A V A S T T G S V Q R V R L A V R G Q V A V A S T L G E V R R V K L ATCCCGGCGAACCCACGGCCCAGCGAGGAGACGTTGGACGCAATCTCCCAGGCCGACCTC I P A N P R P S E E T L D A I S Q A D L Y P E N P P A S K E A V E A I R N A D L ATCACCCTTGGGCCCGGTTCCTGGTTCACATCCGTGATCCCCGATGTTCTCATCCCCGGG I T L G P G S W F T S V I P D V L I P G V S M G P G S W F S S V I P H L L V P E GTGGAGCAGGCGATCAACGCATCGTTGGCGACCACGGTGGTGGTGCTCAACCTGTCCGCT V E Q A I N A S L A T T V V V L N L S A I V D A L N Q T K A V K A L V L N L V P GAGCCGGGGGAGACCGCCGGTTTTACCGCGGAGCGGCACCTGTATATGCTCAAGCGGCAT E P G E T A G F T A E R H L Y M L K R H E P G E T A G M S L E H H I H M V R Q H TCGCAGCGCCTCCACGTTGATTACTTCCTCGTGGATAAGAACATGGTGAATTCAGAAAAG S Q R L H V D Y F L V D K N M V N S E K C P S L Q I D V V I V D L S T M P V A S GAACAGCGCGAGCTCGTCATTTCTGCATCAGATTTTGGGGCCCAGGTGTTGTTCCGAGAC E Q R E L V I S A S D F G A Q V L F R D T R R H I D R A A A A L G A K V I Y R D CTGTGCGAAAAGGATCAGTTTGGTACCCCAACCGATAGGCATGACCCTGCCTTGCTCGGT L C E K D Q F G T P T D R H D P A L L G V R E D D N R G R W T D R H N P A K L A GCCGCGCTGATGGAAATCAAGGATCACGTGGCTTCCTAA---- A A L M E I K D H V A S * A V L Q E V S G G V K D L PERE // >fig|6666666.67496.peg.629 fig|306537.3.peg.378 Coenzyme F420-dependent N5,N10-methylene tetrahydromethanopterin reductase and related flavin-dependent oxidoreductases (EC 1.14.14.3) gi|512068965|gb|ATBY01000015.1|_20621_21160,gi|512068965|gb|ATBY01000015.1|_21160_21660 MKKFGFLSFGHYAIGHQCGITAADSLKQSLDFAQAADNLGVNGAYFRVHHFAPQAASPIPIMSAIAGSTKHIEVGTGVIDMRYENPYYLAEEAAALDLLSDGRVALGVSRGSPEPAKDGWRAFGYDAEQKNGSDMARRKFLQLLSAVRGEAVAEADTLERQYPQMYQPGTPLPIFPHSPxxDRRIWWGSGTNATAVQAAKDGVNLMSSTLVSEADGSSLGDIQAEQIRQYREAWDHDWTPRVSVSRTVFPIVDDETRRLFALHGESHDQIGSLGEGRQVTFGKTYADEPDRIVEKLEKDKAVMDADTLMLTIPNTMGVDVNVKILAAFAEHVAPALGWEPSNLPGA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. TTGAAGAAATTTGGATTCTTAAGCTTCGGACACTACGCCATCGGCCACCAGTGCGGAATA L K K F G F L S F G H Y A I G H Q C G I M K K F G F L S F G H Y A I G H Q C G I ACCGCCGCCGACTCCCTGAAACAATCTCTCGACTTCGCCCAGGCCGCCGACAACCTCGGC T A A D S L K Q S L D F A Q A A D N L G T A A D S L K Q S L D F A Q A A D N L G GTGAACGGCGCCTACTTCCGCGTGCACCACTTCGCGCCGCAGGCCGCCTCCCCCATCCCG V N G A Y F R V H H F A P Q A A S P I P V N G A Y F R V H H F A P Q A A S P I P ATCATGAGCGCCATCGCCGGCTCCACCAAACACATCGAGGTGGGCACCGGCGTCATCGAC I M S A I A G S T K H I E V G T G V I D I M S A I A G S T K H I E V G T G V I D ATGCGCTACGAAAACCCCTACTACCTCGCCGAAGAGGCCGCAGCCCTCGACTTGCTTTCC M R Y E N P Y Y L A E E A A A L D L L S M R Y E N P Y Y L A E E A A A L D L L S GACGGGCGCGTCGCCCTCGGTGTCTCGCGCGGATCACCGGAGCCCGCCAAGGACGGGTGG D G R V A L G V S R G S P E P A K D G W D G R V A L G V S R G S P E P A K D G W CGCGCCTTTGGCTATGACGCCGAGCAGAAAAACGGCTCCGACATGGCTCGCCGCAAGTTC R A F G Y D A E Q K N G S D M A R R K F R A F G Y D A E Q K N G S D M A R R K F CTCCAGCTGCTCTCCGCCGTCCGCGGCGAGGCCGTCGCCGAGGCCGATACCCTGGAGCGC L Q L L S A V R G E A V A E A D T L E R L Q L L S A V R G E A V A E A D T L E R CAGTACCCGCAGATGTACCAGCCAGGCACGCCGCTGCCCATCTTCCCCCACTCCCCG*GC Q Y P Q M Y Q P G T P L P I F P H S P Q Y P Q M Y Q P G T P L P I F P H S P *X* *CTCGACCGGCGGATTTGGTGGGGCTCCGGCACCAACGCCACCGCCGTGCAGGCCGCCAA L D R R I W W G S G T N A T A V Q A A K * X D R R I W W G S G T N A T A V Q A A K GGACGGCGTCAACCTCATGAGCTCCACGCTTGTCAGCGAGGCCGACGGCTCCTCGCTCGG D G V N L M S S T L V S E A D G S S L G D G V N L M S S T L V S E A D G S S L G CGATATTCAGGCCGAGCAGATCCGCCAGTACCGTGAGGCCTGGGATCACGACTGGACTCC D I Q A E Q I R Q Y R E A W D H D W T P D I Q A E Q I R Q Y R E A W D H D W T P GCGCGTCTCCGTCTCGCGCACCGTGTTCCCCATCGTGGACGACGAGACCCGTCGCCTGTT R V S V S R T V F P I V D D E T R R L F R V S V S R T V F P I V D D E T R R L F TGCCCTCCACGGTGAGAGCCACGATCAGATCGGTTCGCTGGGTGAGGGACGGCAGGTCAC A L H G E S H D Q I G S L G E G R Q V T A L H G E S H D Q I G S L G E G R Q V T GTTTGGGAAGACGTATGCCGATGAGCCTGATCGGATCGTCGAAAAGCTAGAGAAAGACAA F G K T Y A D E P D R I V E K L E K D K F G K T Y A D E P D R I V E K L E K D K AGCGGTGATGGACGCGGACACCCTCATGCTCACCATCCCCAACACCATGGGCGTGGACGT A V M D A D T L M L T I P N T M G V D V A V M D A D T L M L T I P N T M G V D V GAACGTGAAGATCCTTGCAGCCTTCGCCGAGCACGTCGCGCCCGCGCTGGGGTGGGAACC N V K I L A A F A E H V A P A L G W E P N V K I L A A F A E H V A P A L G W E P TAGTAATCTTCCCGGCGCTTAA S N L P G A S N L P G A --- ========== Now we show an alignment against a similar protein (fig|306537.3.peg.378): TTGAAGAAATTTGGATTCTTAAGCTTCGGACACTACGCCATCGGC----CACCAGTGCGG L K K F G F L S F G H Y A I G H Q C G M K A F G F L S F G H Y S L N PQPA H P H M AATAACCGCCGCCGACTCCCTGAAACAATCTCTCGACTTCGCCCAGGCCGCCGACAACCT I T A A D S L K Q S L D F A Q A A D N L L S A R D M L H Q S I E L A V E A D H L CGGCGTGAACGGCGCCTACTTCCGCGTGCACCACTTCGCGCCGCAGGCCGCCTCCCCCAT G V N G A Y F R V H H F A P Q A A S P I G V N G A Y F R V H H F A P Q Q A A P M CCCGATCATGAGCGCCATCGCCGGCTCCACCAAACACATCGAGGTGGGCACCGGCGTCAT P I M S A I A G S T K H I E V G T G V I P L L A A I A A R T Q N I E V G T G V I CGACATGCGCTACGAAAACCCCTACTACCTCGCCGAAGAGGCCGCAGCCCTCGACTTGCT D M R Y E N P Y Y L A E E A A A L D L L D M R Y E N P L H L A E E S A A L D L I TTCCGACGGGCGCGTCGCCCTCGGTGTCTCGCGCGGATCACCGGAGCCCGCCAAGGACGG S D G R V A L G V S R G S P E P A K D G A D G R I A L G V S R G A P E A V E R G GTGGCGCGCCTTTGGCTATGAC-GCCGAGCAGAAAAACGGCTCCGACATGGCTCGCCGCA W R A F G Y D A E Q K N G S D M A R R W E T F G H T G S T D P R G A D I A R E AGTTCCTCCAGCTGCTCTCCGCCGTCCGCGGCGAGGCCGTCGCCGAGGCCGATACCCTGG K F L Q L L S A V R G E A V A E A D T L H F L R Y L A A I R G V G M A T A P S A AGCGCCAGTACCCGCAGATGTACCAGCCAGGCACGCCGCTGCCCATCTTCCCCCACTCCC E R Q Y P Q M Y Q P G T P L P I F P H S E K Q Y P H M Y Q P G A S I P V L P H S CG*GC*CTCGACCGGCGGATTTGGTGGGGCTCCGGCACCAACGCCACCGCCGTGCAGGCC P L D R R I W W G S G T N A T A V Q A P *N** L D R R V W W G A G T R E T A K W A GCCAAGGACGGCGTCAACCTCATGAGCTCCACGCTTGTCAGCGAGGCCGACGGCTCCTCG A K D G V N L M S S T L V S E A D G S S G Q V G V N L M S S T L L T E S N G D S CTCGGCGATATTCAGGCCGAGCAGATCCGCCAGTACCGTGAGGCCTGG---GATCACGAC L G D I Q A E Q I R Q Y R E A W D H D F G D L Q A Q Q L Q V F K E S F ASS G H G TGGACTCCGCGCGTCTCCGTCTCGCGCACCGTGTTCCCCATCGTGGACGACGAGACCCGT W T P R V S V S R T V F P I V D D E T R W T P R T S V S R S I F P I T S A E D R CGCCTGTTTGCCCTCCACGGTGAGAGCCACGATCAGATCGGTTCGCTGGGTGAGGGACGG R L F A L H G E S H D Q I G S L E G R A I V G T H G M T R D H F G V I --- D G Y CAGGTCACGTTTGGGAAGACGTATGCCGATGAGCCTGATCGGATCGTCGAAAAGCTAGAG Q V T F G K T Y A D E P D R I V E K L E R S T F G R T Y I G E P D Q L I E E L L AAAGACAAAGCGGTGATGGACGCGGACACCCTCATGCTCACCATCCCCAACACCATGGGC K D K A V M D A D T L M L T I P N T M G N D A A V A E A D T L M L T I P N Q L G GTGGACGTGAACGTGAAGATCCTTGCAGCCTTCGCCGAGCACGTCGCGCCCGCGCTGGGG V D V N V K I L A A F A E H V A P A L G V E A N V R L L K S F A T H V A P A L G TGGGAACCTAGTAATCTTCCCGGCGCTTAA-- W E P S N L P G A * W Q P S T S E D S R LA // >fig|6666666.67496.peg.2331 fig|196164.1.peg.2678 putative mercury resistance operon regulator MerR gi|512071492|gb|ATBY01000002.1|_227215_226922,gi|512071492|gb|ATBY01000002.1|_226918_226865 MSDTVDIVSWSNTFKILGDPTRLTLLSAIHYAGQNELTVSELAETTGVRVATASAALRAMENNGTVKSTRDGRKIYYAIASEDIHQLLHWIGAGHKHNxRVRTQKQTSKGAHKMRT We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGTCAGACACCGTTGATATTGTTAGTTGGTCGAACACCTTCAAAATTCTTGGTGACCCC M S D T V D I V S W S N T F K I L G D P M S D T V D I V S W S N T F K I L G D P ACCCGGCTAACCCTGCTGTCCGCCATCCACTACGCGGGGCAAAACGAACTGACCGTGAGC T R L T L L S A I H Y A G Q N E L T V S T R L T L L S A I H Y A G Q N E L T V S GAGCTCGCTGAGACGACAGGCGTACGAGTTGCTACAGCCTCCGCGGCACTACGCGCCATG E L A E T T G V R V A T A S A A L R A M E L A E T T G V R V A T A S A A L R A M GAGAACAACGGCACGGTGAAGAGCACCCGCGACGGTCGAAAGATCTACTACGCCATCGCA E N N G T V K S T R D G R K I Y Y A I A E N N G T V K S T R D G R K I Y Y A I A AGCGAGGACATCCACCAGCTCCTCCACTGGATCGGTGCCGGCCACAAACACAATTAGCGG S E D I H Q L L H W I G A G H K H N * R S E D I H Q L L H W I G A G H K H N X R GTGCGCACGCAAAAGCAAACGTCGAAAGGTGCGCATAAAATGCGCACGTAG V R T Q K Q T S K G A H K M R T V R T Q K Q T S K G A H K M R T --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2678): ---------------ATGTCAGACACCGTTGATATTGTTAGT----------TGGTCGAA M S D T V D I V S W S N MLTLNHPFDYGTARE A K D T V V T P T HEPPVHLADE W A P CACCTTCAAAATTCTTGGTGACCCCACCCGGCTAACCCTGCTGTCCGCCATCCACTACGC T F K I L G D P T R L T L L S A I H Y A A F K I L G D P T R L R L L L A M H Y C GGGGCAAAACGAACTGACCGTGAGCGAGCTCGCTGAGACGACAGGCGTACGAGTTGCTAC G Q N E L T V S E L A E T T G V R V A T G P G V A T V S E L A E A A G V R V P T AGCCTCCGCGGCACTACGCGCCATGGAGAACAACGGCACGGTGAAGAGCACCCGCGACGG A S A A L R A M E N N G T V K S T R D G A S A A L I H L T D A G T V T R T K V G TCGAAAGATCTACTACGCCATCGCAAGCGAGGACATCCACCAGCTCCTCCACTGGATCGG R K I Y Y A I A S E D I H Q L L H W I G R E V R Y S L T D P R T H S L L H H L G TGCCGGCCACAAACACAATTAGCGGGTGCGCACGCAAAAGCAAACGTCGAAAGGTGCGCA A G H K H N * R G T H V H D H R ----------------------------------- TAAAATGCGCACGTAG ---------------- // >fig|6666666.67496.peg.1212 fig|306537.3.peg.168 Mobile element protein gi|512069927|gb|ATBY01000013.1|_66319_65522,gi|512069927|gb|ATBY01000013.1|_65522_65121 MSYDNPNLAIVKAITEQHLTVSEASVRFKRSRQWIYTLLRRYEEGGPEAVKPRSTAPKTHPTKVSEEVIKQIIKIRRELASKGADNGPETIAWVLEQRGFHAPAESTIRRILTKNGMVTPQPKKRPKAYLRRFEATLPNECWQADVTSTRLLNGQVVEILDFLDDHSRFLLYLGAYKRVAGPTVVTAAETITKKYGFPQSTLTDNGLVFTARLAGAKGGKNGFEKFLEKHSILQKNGRAGHPQTQGKIERFHQTLKKWLRARPPAxxVKDMQKLLDEFRHWYNHERPHRALGRQTPHQAYTTLPKASPQPLVTEDNRVRHDKVDKAGRITLRFAGHMRYLGIGRAHEATPTLTVIHGTHAVTSNAETGEIIAEHHIDTGRRYQPNQIKNTQQRKNRKNK We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGCTACGACAACCCCAACCTCGCCATCGTCAAAGCAATCACCGAACAACACCTCACC M S Y D N P N L A I V K A I T E Q H L T M S Y D N P N L A I V K A I T E Q H L T GTCAGCGAAGCCTCCGTTCGATTCAAGAGATCCCGGCAATGGATCTACACCCTGCTAAGG V S E A S V R F K R S R Q W I Y T L L R V S E A S V R F K R S R Q W I Y T L L R CGATACGAAGAAGGCGGCCCAGAGGCTGTTAAACCGCGATCCACAGCACCGAAAACACAC R Y E E G G P E A V K P R S T A P K T H R Y E E G G P E A V K P R S T A P K T H CCCACCAAGGTCAGCGAGGAGGTGATCAAACAGATCATCAAAATCCGCAGAGAACTCGCC P T K V S E E V I K Q I I K I R R E L A P T K V S E E V I K Q I I K I R R E L A TCCAAAGGTGCAGACAACGGACCTGAAACCATCGCCTGGGTACTCGAGCAACGAGGTTTT S K G A D N G P E T I A W V L E Q R G F S K G A D N G P E T I A W V L E Q R G F CATGCGCCTGCAGAATCAACCATCCGGCGAATCCTCACCAAAAACGGCATGGTCACACCA H A P A E S T I R R I L T K N G M V T P H A P A E S T I R R I L T K N G M V T P CAACCCAAAAAACGCCCGAAAGCCTATCTACGACGCTTTGAAGCAACCCTGCCCAACGAA Q P K K R P K A Y L R R F E A T L P N E Q P K K R P K A Y L R R F E A T L P N E TGCTGGCAAGCAGATGTCACCTCCACCAGACTGCTCAATGGACAGGTTGTGGAGATCCTC C W Q A D V T S T R L L N G Q V V E I L C W Q A D V T S T R L L N G Q V V E I L GACTTCCTCGATGACCACAGTCGCTTCCTGCTATACCTAGGCGCCTATAAGCGTGTAGCT D F L D D H S R F L L Y L G A Y K R V A D F L D D H S R F L L Y L G A Y K R V A GGCCCCACCGTGGTCACAGCCGCCGAAACCATCACCAAAAAATACGGCTTCCCCCAATCC G P T V V T A A E T I T K K Y G F P Q S G P T V V T A A E T I T K K Y G F P Q S ACCCTCACCGATAACGGCCTTGTCTTCACCGCCCGACTAGCCGGTGCCAAGGGAGGTAAA T L T D N G L V F T A R L A G A K G G K T L T D N G L V F T A R L A G A K G G K AACGGTTTTGAAAAATTCCTTGAAAAACACAGCATCCTGCAGAAAAACGGACGCGCAGGA N G F E K F L E K H S I L Q K N G R A G N G F E K F L E K H S I L Q K N G R A G CACCCCCAAACCCAAGGAAAAATTGAACGCTTCCACCAAACACTAAAAAAATGGCTCCGC H P Q T Q G K I E R F H Q T L K K W L R H P Q T Q G K I E R F H Q T L K K W L R GCACGACCACCCGCA*AA*ACCGTCAAAGACATGCAAAAACTCCTCGACGAATTCCGCCA A R P P A T V K D M Q K L L D E F R H A R P P A *X** X V K D M Q K L L D E F R H CTGGTACAACCACGAACGACCCCACAGGGCACTCGGACGACAAACACCCCACCAGGCATA W Y N H E R P H R A L G R Q T P H Q A Y W Y N H E R P H R A L G R Q T P H Q A Y CACAACACTACCCAAAGCCAGCCCACAACCACTGGTCACAGAAGACAACCGCGTCAGACA T T L P K A S P Q P L V T E D N R V R H T T L P K A S P Q P L V T E D N R V R H CGACAAAGTAGACAAAGCAGGAAGAATCACCCTCCGATTCGCAGGCCACATGCGCTACCT D K V D K A G R I T L R F A G H M R Y L D K V D K A G R I T L R F A G H M R Y L AGGCATAGGACGCGCACACGAAGCAACCCCCACACTCACCGTCATCCACGGCACCCACGC G I G R A H E A T P T L T V I H G T H A G I G R A H E A T P T L T V I H G T H A CGTAACCTCCAACGCCGAAACCGGAGAAATCATCGCCGAACACCACATCGACACCGGCCG V T S N A E T G E I I A E H H I D T G R V T S N A E T G E I I A E H H I D T G R CCGCTACCAACCCAACCAAATCAAGAACACCCAACAACGAAAAAACAGAAAAAACAAGTA R Y Q P N Q I K N T Q Q R K N R K N K R Y Q P N Q I K N T Q Q R K N R K N K -- A - ========== Now we show an alignment against a similar protein (fig|306537.3.peg.168): ATGAGCTACGACAACCCCAACCTCGCCATCGTCAAAGCAATCACCGAACAACACCTCACC M S Y D N P N L A I V K A I T E Q H L T M N S P N R N L A I V K A V R E Q G E P GTCAGCGAAGCCTCCGTTCGATTCAAGAGATCCCGGCAATGGATCTACACCCTGCTAAGG V S E A S V R F K R S R Q W I Y T L L R V T K V A K R F R I S R Q R I Y K I L S CGATACGAAGAAGGCGGCCCAGAGGCTGTTAAACCGCGATCCACAGCACCGAAAACACAC R Y E E G G P E A V K P R S T A P K T H Q F D A G G A D A I A P K S R A P H T H CCCACCAAGGTCAGCGAGGAGGTGATCAAACAGATCATCAAAATCCGCAGAGAACTCGCC P T K V S E E V I K Q I I K I R R E L A P Q A V P T S L R N Q I I D M R K Q L V TCCAAAGGTGCAGACAACGGACCTGAAACCATCGCCTGGGTACTCGAGCAACGAGGTTTT S K G A D N G P E T I A W V L E Q R G F R S G L D A G P E T I A F H L H R Q G L CATGCGCCTGCAGAATCAACCATCCGGCGAATCCTCACCAAAAACGGCATGGTCACACCA H A P A E S T I R R I L T K N G M V T P R V P S T S T I R R I I T N A G L V T P CAACCCAAAAAACGCCCGAAAGCCTATCTACGACGCTTTGAAGCAACCCTGCCCAACGAA Q P K K R P K A Y L R R F E A T L P N E Q P Q K K P R S S F I R F E A A M P N E TGCTGGCAAGCAGATGTCACCTCCACCAGACTGCTCAATGGACAGGTTGTGGAGATCCTC C W Q A D V T S T R L L N G Q V V E I L C W Q A D I T H L H L L D G T R L E V L GACTTCCTCGATGACCACAGTCGCTTCCTGCTATACCTAGGCGCCTATAAGCGTGTAGCT D F L D D H S R F L L Y L G A Y K R V A D F I D D H S R Y L L S I T A A A S F S GGCCCCACCGTGGTCACAGCCGCCGAAACCATCACCAAAAAATACGGCTTCCCCCAATCC G P T V V T A A E T I T K K Y G F P Q S G P A V A A E L Q R L I A T Y G P P A S ACCCTCACCGATAACGGCCTTGTCTTCACCGCCCGACTAGCCGGTGCCAAGGGAGGTAAA T L T D N G L V F T A R L A G A K G G K T L T D N G L V F T A R L A G A R G G R AACGGTTTTGAAAAATTCCTTGAAAAACACAGCATCCTGCAGAAAAACGGACGCGCAGGA N G F E K F L E K H S I L Q K N G R A G N A F E K T L N K Y R I Q Q K N G R P G CACCCCCAAACCCAAGGAAAAATTGAACGCTTCCACCAAACACTAAAAAAATGGCTCCGC H P Q T Q G K I E R F H Q T L K K W L R H P Q T Q G K I E R F H Q T L K K W I A GCACGACCACCCGCA*AA*ACCGTCAAAGACATGCAAAAACTCCTCGACGAATTCCGCCA A R P P A T V K D M Q K L L D E F R H A Q S P A *I** T L V E L Q R Q L D T F A D CTGGTACAACCACGAACGACCCCACAGGGCACTCGGACGACAAACACCCCACCAGGCATA W Y N H E R P H R A L G R Q T P H Q A Y Y Y N T V R P H R A L G R R T P H E V Y CACAACACTACCCAAAGCCAGCCCACAACCACTGGTCACAGAAGACAACCGCGTCAGACA T T L P K A S P Q P L V T E D N R V R H T T G P K A E P N D K P E E E W R V R N CGACAAAGTAGACAAAGCAGGAAGAATCACCCTCCGATTCGCAGGCCACATGCGCTACCT D K V D K A G R I T L R F A G H M R Y L D V V T P N G K V T V R Y A S R L Y Q L AGGCATAGGACGCGCACACGAAGCAACCCCCACACTCACCGTCATCCACGGCACCCACGC G I G R A H E A T P T L T V I H G T H A G I G R K Y T G E T I L M V I T D N H V CGTAACCTCCAACGCCGAAACCGGAGAAATCATCGCCGAACACCACATCGACACCGGCCG V T S N A E T G E I I A E H H I D T G R T T S L K E T G E I I T E H Y I D T S R CCGCTACCAACCCAACCAAATCAAGAACACCCAACAA--------------CGAAAAAAC R Y Q P N Q I K N T Q Q R N Y Q K P Y W K K G Q P PLVLSRGECATSTG R ------ AGAAAAAACAAGTAA --------------- // >fig|6666666.67496.peg.38 fig|196627.4.peg.2858 putative lipoprotein gi|512068193|gb|ATBY01000017.1|_41104_40769,gi|512068193|gb|ATBY01000017.1|_40765_40427 MRRTLVLSALAVASTLALAACGEATESGNTDTTTSATSTATTTAETTETTTATTEADGEISADHNDADIMFAQMMIPHHQQAVEMSEMLLAKEGIPAQVVEFAQGVIDAQGPxIDRMNAMLKAWGQQPVTDSAGMGTMDEMGGMDHGEMGGMSGMMSQEDMTALEEAQGTQAACLYLEQMTAHHEGAVDMACDEVADGQNRHAITLAEQIINDQEAEIAQMLTDL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGGCGCACCCTTGTTCTTTCCGCTCTCGCCGTGGCCTCCACCCTGGCGCTAGCCGCC M R R T L V L S A L A V A S T L A L A A M R R T L V L S A L A V A S T L A L A A TGCGGTGAGGCCACCGAGTCAGGCAACACCGACACCACCACCTCGGCCACCAGCACAGCG C G E A T E S G N T D T T T S A T S T A C G E A T E S G N T D T T T S A T S T A ACGACTACCGCTGAGACGACCGAGACCACCACGGCGACGACTGAGGCGGACGGGGAGATC T T T A E T T E T T T A T T E A D G E I T T T A E T T E T T T A T T E A D G E I TCCGCCGATCACAATGACGCGGACATCATGTTTGCCCAGATGATGATCCCCCATCACCAG S A D H N D A D I M F A Q M M I P H H Q S A D H N D A D I M F A Q M M I P H H Q CAGGCCGTGGAGATGAGTGAGATGCTCCTGGCCAAGGAGGGTATCCCCGCCCAGGTTGTG Q A V E M S E M L L A K E G I P A Q V V Q A V E M S E M L L A K E G I P A Q V V GAGTTTGCCCAGGGGGTTATTGACGCCCAGGGACCGTAGATTGACCGGATGAACGCTATG E F A Q G V I D A Q G P * I D R M N A M E F A Q G V I D A Q G P X I D R M N A M CTCAAGGCCTGGGGCCAGCAGCCGGTCACCGACTCTGCGGGCATGGGGACCATGGACGAG L K A W G Q Q P V T D S A G M G T M D E L K A W G Q Q P V T D S A G M G T M D E ATGGGTGGAATGGATCACGGCGAGATGGGTGGCATGAGCGGGATGATGAGCCAGGAGGAC M G G M D H G E M G G M S G M M S Q E D M G G M D H G E M G G M S G M M S Q E D ATGACAGCCCTTGAGGAAGCCCAGGGCACCCAGGCTGCCTGCCTCTACCTGGAGCAGATG M T A L E E A Q G T Q A A C L Y L E Q M M T A L E E A Q G T Q A A C L Y L E Q M ACCGCCCACCACGAAGGTGCGGTCGACATGGCCTGTGACGAGGTTGCTGACGGCCAGAAT T A H H E G A V D M A C D E V A D G Q N T A H H E G A V D M A C D E V A D G Q N CGCCATGCGATCACCCTGGCCGAACAAATTATCAACGACCAGGAGGCCGAGATCGCCCAG R H A I T L A E Q I I N D Q E A E I A Q R H A I T L A E Q I I N D Q E A E I A Q ATGCTCACTGACCTATGA M L T D L M L T D L --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.2858): ATGAGGCGCACCCTTGTTCTTTCCGCTCTCGCCGTGGCCTCCACCCTGGCGCTAGCCGCC M R R T L V L S A L A V A S T L A L A A M K R T I T I A A L A L T S T L V L S A TGCGGTGAGGCCACCGAGTCAGGCAACACCGACACCACCACCTCGGCCACCAGCACAGCG C G E A T E S G N T D T T T S A T S T A C A D N T E G E N T D T T T I A T T S A ACGACTACCGCTGAGACGACCGAGACCACCACG---GCGACGACTGAGGCGGACGGGGAG T T T A E T T E T T T A T T E A D G E P D T T E T T G A T T DPE T E T G A A G E ATCTCCGCCGATCACAATGACGCGGACATCATGTTTGCCCAGATGATGATCCCCCATCAC I S A D H N D A D I M F A Q M M I P H H V S A E H N D A D I M F A Q M M I P H H CAGCAGGCCGTGGAGATGAGTGAGATGCTCCTGGCCAAGGAGGGTATCCCCGCCCAGGTT Q Q A V E M S E M L L A K E G I P A Q V Q Q A V E M S E I L L A K D D I P A E V GTGGAGTTTGCCCAGGGGGTTATTGACGCCCAGGGACCGTAGATTGACCGGATGAACGCT V E F A Q G V I D A Q G P * I D R M N A I E F T Q G V I D A Q G P E I D R M N T ATGCTCAAGGCCTGGGGCCAGCAGCCGGTCACCGACTCTGCGGGCATGGGGACCATGGAC M L K A W G Q Q P V T D M L E T W E E D P V T G ------------------------ GAGATGGGTGGAATGGATCACGGCGAGATGGGTGGCATGAGCGGGATGATGAGCCAGGAG E M G G M D H G G M S G M M S Q E D M G E M D H G --------- G M S G M M S E E GACATGACAGCCCTTGAGGAAGCCCAGGGCACCCAGGCTGCCTGCCTCTACCTGGAGCAG D M T A L E E A Q G T Q A A C L Y L E Q D M T A L E D A Q G T E A A R L Y L E Q ATGACCGCCCACCACGAAGGTGCGGTCGACATGGCCTGTGACGAGGTTGCTGACGGCCAG M T A H H E G A V D M A C D E V A D G Q M T A H H E G A V D M A R D E V T D G Q AATCGCCATGCGATCACCCTGGCCGAACAAATTATCAACGACCAGGAGGCCGAGATCGCC N R H A I T L A E Q I I N D Q E A E I A N P Q A I A L A E Q V I E D Q E A E I A ---CAGATGCTCACTGACCTATGA Q M L T D L EME Q M L N E L --- // >fig|6666666.67496.peg.468 fig|306537.3.peg.168 Mobile element protein gi|512068193|gb|ATBY01000017.1|_494008_494805,gi|512068193|gb|ATBY01000017.1|_494805_495206 MSYDNPNLAIVKAITEQHLTVSEASVRFKRSRQWIYTLLRRYEEGGPEAVKPRSTAPKTHPTKVSEEVIKQIIKIRRELASKGADNGPETIAWVLEQRGFHAPAESTIRRILTKNGMVTPQPKKRPKAYLRRFEATLPNECWQADVTSTRLLNGQVVEILDFLDDHSRFLLYLGAYKRVAGPTVVTAAETITKKYGFPQSTLTDNGLVFTARLAGAKGGKNGFEKFLEKHSILQKNGRAGHPQTQGKIERFHQTLKKWLRARPPAxxVKDMQKLLDEFRHWYNHERPHRALGRQTPHQAYTTLPKASPQPLVTEDNRVRHDKVDKAGRITLRFAGHMRYLGIGRAHEATPTLTVIHGTHAVTSNAETGEIIAEHHIDTGRRYQPNQIKNTQQRKNRKNK We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGCTACGACAACCCCAACCTCGCCATCGTCAAAGCAATCACCGAACAACACCTCACC M S Y D N P N L A I V K A I T E Q H L T M S Y D N P N L A I V K A I T E Q H L T GTCAGCGAAGCCTCCGTTCGATTCAAGAGATCCCGGCAATGGATCTACACCCTGCTAAGG V S E A S V R F K R S R Q W I Y T L L R V S E A S V R F K R S R Q W I Y T L L R CGATACGAAGAAGGCGGCCCAGAGGCTGTTAAACCGCGATCCACAGCACCGAAAACACAC R Y E E G G P E A V K P R S T A P K T H R Y E E G G P E A V K P R S T A P K T H CCCACCAAGGTCAGCGAGGAGGTGATCAAACAGATCATCAAAATCCGCAGAGAACTCGCC P T K V S E E V I K Q I I K I R R E L A P T K V S E E V I K Q I I K I R R E L A TCCAAAGGTGCAGACAACGGACCTGAAACCATCGCCTGGGTACTCGAGCAACGAGGTTTT S K G A D N G P E T I A W V L E Q R G F S K G A D N G P E T I A W V L E Q R G F CATGCGCCTGCAGAATCAACCATCCGGCGAATCCTCACCAAAAACGGCATGGTCACACCA H A P A E S T I R R I L T K N G M V T P H A P A E S T I R R I L T K N G M V T P CAACCCAAAAAACGCCCGAAAGCCTATCTACGACGCTTTGAAGCAACCCTGCCCAACGAA Q P K K R P K A Y L R R F E A T L P N E Q P K K R P K A Y L R R F E A T L P N E TGCTGGCAAGCAGATGTCACCTCCACCAGACTGCTCAATGGACAGGTTGTGGAGATCCTC C W Q A D V T S T R L L N G Q V V E I L C W Q A D V T S T R L L N G Q V V E I L GACTTCCTCGATGACCACAGTCGCTTCCTGCTATACCTAGGCGCCTATAAGCGTGTAGCT D F L D D H S R F L L Y L G A Y K R V A D F L D D H S R F L L Y L G A Y K R V A GGCCCCACCGTGGTCACAGCCGCCGAAACCATCACCAAAAAATACGGCTTCCCCCAATCC G P T V V T A A E T I T K K Y G F P Q S G P T V V T A A E T I T K K Y G F P Q S ACCCTCACCGATAACGGCCTTGTCTTCACCGCCCGACTAGCCGGTGCCAAGGGAGGTAAA T L T D N G L V F T A R L A G A K G G K T L T D N G L V F T A R L A G A K G G K AACGGTTTTGAAAAATTCCTTGAAAAACACAGCATCCTGCAGAAAAACGGACGCGCAGGA N G F E K F L E K H S I L Q K N G R A G N G F E K F L E K H S I L Q K N G R A G CACCCCCAAACCCAAGGAAAAATTGAACGCTTCCACCAAACACTAAAAAAATGGCTCCGC H P Q T Q G K I E R F H Q T L K K W L R H P Q T Q G K I E R F H Q T L K K W L R GCACGACCACCCGCA*AA*ACCGTCAAAGACATGCAAAAACTCCTCGACGAATTCCGCCA A R P P A T V K D M Q K L L D E F R H A R P P A *X** X V K D M Q K L L D E F R H CTGGTACAACCACGAACGACCCCACAGGGCACTCGGACGACAAACACCCCACCAGGCATA W Y N H E R P H R A L G R Q T P H Q A Y W Y N H E R P H R A L G R Q T P H Q A Y CACAACACTACCCAAAGCCAGCCCACAACCACTGGTCACAGAAGACAACCGCGTCAGACA T T L P K A S P Q P L V T E D N R V R H T T L P K A S P Q P L V T E D N R V R H CGACAAAGTAGACAAAGCAGGAAGAATCACCCTCCGATTCGCAGGCCACATGCGCTACCT D K V D K A G R I T L R F A G H M R Y L D K V D K A G R I T L R F A G H M R Y L AGGCATAGGACGCGCACACGAAGCAACCCCCACACTCACCGTCATCCACGGCACCCACGC G I G R A H E A T P T L T V I H G T H A G I G R A H E A T P T L T V I H G T H A CGTAACCTCCAACGCCGAAACCGGAGAAATCATCGCCGAACACCACATCGACACCGGCCG V T S N A E T G E I I A E H H I D T G R V T S N A E T G E I I A E H H I D T G R CCGCTACCAACCCAACCAAATCAAGAACACCCAACAACGAAAAAACAGAAAAAACAAGTA R Y Q P N Q I K N T Q Q R K N R K N K R Y Q P N Q I K N T Q Q R K N R K N K -- A - ========== Now we show an alignment against a similar protein (fig|306537.3.peg.168): ATGAGCTACGACAACCCCAACCTCGCCATCGTCAAAGCAATCACCGAACAACACCTCACC M S Y D N P N L A I V K A I T E Q H L T M N S P N R N L A I V K A V R E Q G E P GTCAGCGAAGCCTCCGTTCGATTCAAGAGATCCCGGCAATGGATCTACACCCTGCTAAGG V S E A S V R F K R S R Q W I Y T L L R V T K V A K R F R I S R Q R I Y K I L S CGATACGAAGAAGGCGGCCCAGAGGCTGTTAAACCGCGATCCACAGCACCGAAAACACAC R Y E E G G P E A V K P R S T A P K T H Q F D A G G A D A I A P K S R A P H T H CCCACCAAGGTCAGCGAGGAGGTGATCAAACAGATCATCAAAATCCGCAGAGAACTCGCC P T K V S E E V I K Q I I K I R R E L A P Q A V P T S L R N Q I I D M R K Q L V TCCAAAGGTGCAGACAACGGACCTGAAACCATCGCCTGGGTACTCGAGCAACGAGGTTTT S K G A D N G P E T I A W V L E Q R G F R S G L D A G P E T I A F H L H R Q G L CATGCGCCTGCAGAATCAACCATCCGGCGAATCCTCACCAAAAACGGCATGGTCACACCA H A P A E S T I R R I L T K N G M V T P R V P S T S T I R R I I T N A G L V T P CAACCCAAAAAACGCCCGAAAGCCTATCTACGACGCTTTGAAGCAACCCTGCCCAACGAA Q P K K R P K A Y L R R F E A T L P N E Q P Q K K P R S S F I R F E A A M P N E TGCTGGCAAGCAGATGTCACCTCCACCAGACTGCTCAATGGACAGGTTGTGGAGATCCTC C W Q A D V T S T R L L N G Q V V E I L C W Q A D I T H L H L L D G T R L E V L GACTTCCTCGATGACCACAGTCGCTTCCTGCTATACCTAGGCGCCTATAAGCGTGTAGCT D F L D D H S R F L L Y L G A Y K R V A D F I D D H S R Y L L S I T A A A S F S GGCCCCACCGTGGTCACAGCCGCCGAAACCATCACCAAAAAATACGGCTTCCCCCAATCC G P T V V T A A E T I T K K Y G F P Q S G P A V A A E L Q R L I A T Y G P P A S ACCCTCACCGATAACGGCCTTGTCTTCACCGCCCGACTAGCCGGTGCCAAGGGAGGTAAA T L T D N G L V F T A R L A G A K G G K T L T D N G L V F T A R L A G A R G G R AACGGTTTTGAAAAATTCCTTGAAAAACACAGCATCCTGCAGAAAAACGGACGCGCAGGA N G F E K F L E K H S I L Q K N G R A G N A F E K T L N K Y R I Q Q K N G R P G CACCCCCAAACCCAAGGAAAAATTGAACGCTTCCACCAAACACTAAAAAAATGGCTCCGC H P Q T Q G K I E R F H Q T L K K W L R H P Q T Q G K I E R F H Q T L K K W I A GCACGACCACCCGCA*AA*ACCGTCAAAGACATGCAAAAACTCCTCGACGAATTCCGCCA A R P P A T V K D M Q K L L D E F R H A Q S P A *I** T L V E L Q R Q L D T F A D CTGGTACAACCACGAACGACCCCACAGGGCACTCGGACGACAAACACCCCACCAGGCATA W Y N H E R P H R A L G R Q T P H Q A Y Y Y N T V R P H R A L G R R T P H E V Y CACAACACTACCCAAAGCCAGCCCACAACCACTGGTCACAGAAGACAACCGCGTCAGACA T T L P K A S P Q P L V T E D N R V R H T T G P K A E P N D K P E E E W R V R N CGACAAAGTAGACAAAGCAGGAAGAATCACCCTCCGATTCGCAGGCCACATGCGCTACCT D K V D K A G R I T L R F A G H M R Y L D V V T P N G K V T V R Y A S R L Y Q L AGGCATAGGACGCGCACACGAAGCAACCCCCACACTCACCGTCATCCACGGCACCCACGC G I G R A H E A T P T L T V I H G T H A G I G R K Y T G E T I L M V I T D N H V CGTAACCTCCAACGCCGAAACCGGAGAAATCATCGCCGAACACCACATCGACACCGGCCG V T S N A E T G E I I A E H H I D T G R T T S L K E T G E I I T E H Y I D T S R CCGCTACCAACCCAACCAAATCAAGAACACCCAACAA--------------CGAAAAAAC R Y Q P N Q I K N T Q Q R N Y Q K P Y W K K G Q P PLVLSRGECATSTG R ------ AGAAAAAACAAGTAA --------------- // >fig|6666666.67496.peg.2213 fig|306537.3.peg.590 Exodeoxyribonuclease VII large subunit (EC 3.1.11.6) FIG000323 gi|512071492|gb|ATBY01000002.1|_90802_89570,gi|512071492|gb|ATBY01000002.1|_89566_89495 MARQSTSPEHPFSVSTINDLVGDWIGRLGSAWVEGELIQISMKRNWAFSYLYLKDLNDDVSMELTCPTKIAMSAEISNGDRVLVHGQPRLYKRNGRYSLMVSEIRHVGIGEELARIEKLRHDLATEGLFNADRKQPLPVLPNCVGLITGRDSAAERDVLKVTHDRWPAVQFRIINTAVQGQRAEPEIIAALKRLDADPEVDVIIIARGGGSVEDLFPFSREQLIRAVAAASTPVISAIGHEPDHPILDNVADFAAKTPTDAGKNVVPDATQEALMIQEMRSRAAAALRGWVKREEEGLHNLRSRPVLSDPYTIVTEQEDHLHDAVQRIRRCATSLLTQEDREIVNLRARVTSLGPAATLRRGYSVVQVVPRDGTETHVVTSIEETPPGSQLRIRVTDGSITAATMSATPADxGHRVILPTHAAVAWNHATAGQFT We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCACGGCAGAGCACGAGCCCCGAACACCCGTTTTCTGTGTCCACAATCAATGATCTT M A R Q S T S P E H P F S V S T I N D L M A R Q S T S P E H P F S V S T I N D L GTGGGCGATTGGATCGGCCGACTTGGGTCGGCCTGGGTAGAAGGCGAACTCATCCAGATC V G D W I G R L G S A W V E G E L I Q I V G D W I G R L G S A W V E G E L I Q I AGCATGAAGCGCAACTGGGCGTTCTCCTACCTGTATCTCAAGGACTTGAACGATGACGTT S M K R N W A F S Y L Y L K D L N D D V S M K R N W A F S Y L Y L K D L N D D V TCCATGGAGCTCACGTGCCCCACGAAGATCGCCATGTCCGCCGAGATTTCCAACGGCGAT S M E L T C P T K I A M S A E I S N G D S M E L T C P T K I A M S A E I S N G D CGTGTGCTCGTTCATGGGCAGCCACGCCTGTACAAGCGCAACGGGCGCTACTCCCTCATG R V L V H G Q P R L Y K R N G R Y S L M R V L V H G Q P R L Y K R N G R Y S L M GTGAGCGAAATCCGCCACGTGGGAATCGGCGAGGAGCTAGCCCGAATTGAAAAACTTCGC V S E I R H V G I G E E L A R I E K L R V S E I R H V G I G E E L A R I E K L R CACGATCTCGCCACTGAGGGATTGTTCAATGCAGACAGGAAGCAACCGCTGCCCGTGCTG H D L A T E G L F N A D R K Q P L P V L H D L A T E G L F N A D R K Q P L P V L CCCAACTGCGTGGGGCTCATCACGGGGCGGGACTCTGCTGCGGAACGGGATGTGCTCAAG P N C V G L I T G R D S A A E R D V L K P N C V G L I T G R D S A A E R D V L K GTGACCCACGACAGGTGGCCCGCAGTTCAATTCCGCATCATCAACACCGCGGTGCAAGGT V T H D R W P A V Q F R I I N T A V Q G V T H D R W P A V Q F R I I N T A V Q G CAGCGCGCCGAGCCGGAAATAATCGCCGCGCTCAAGAGGCTGGATGCCGACCCTGAGGTC Q R A E P E I I A A L K R L D A D P E V Q R A E P E I I A A L K R L D A D P E V GATGTCATCATCATCGCCCGCGGCGGCGGCTCAGTAGAGGACCTGTTCCCCTTTTCTAGA D V I I I A R G G G S V E D L F P F S R D V I I I A R G G G S V E D L F P F S R GAACAACTCATTCGCGCCGTGGCTGCCGCGTCCACTCCCGTCATCTCCGCCATCGGGCAC E Q L I R A V A A A S T P V I S A I G H E Q L I R A V A A A S T P V I S A I G H GAACCCGACCACCCCATCCTGGACAATGTCGCCGATTTCGCGGCGAAGACGCCGACGGAC E P D H P I L D N V A D F A A K T P T D E P D H P I L D N V A D F A A K T P T D GCGGGAAAGAACGTCGTACCGGATGCTACCCAGGAAGCGCTCATGATCCAGGAGATGCGC A G K N V V P D A T Q E A L M I Q E M R A G K N V V P D A T Q E A L M I Q E M R TCCCGCGCGGCGGCCGCGCTGCGTGGCTGGGTGAAACGGGAGGAAGAGGGGCTTCACAAT S R A A A A L R G W V K R E E E G L H N S R A A A A L R G W V K R E E E G L H N CTTCGTTCCCGGCCGGTGCTCAGCGATCCGTACACGATCGTCACCGAGCAAGAGGACCAC L R S R P V L S D P Y T I V T E Q E D H L R S R P V L S D P Y T I V T E Q E D H CTCCACGATGCCGTGCAACGCATCCGCAGGTGTGCAACATCGCTCCTCACACAGGAGGAT L H D A V Q R I R R C A T S L L T Q E D L H D A V Q R I R R C A T S L L T Q E D CGGGAGATCGTTAATCTGCGTGCGCGGGTGACCTCTCTGGGCCCCGCAGCAACCCTGAGG R E I V N L R A R V T S L G P A A T L R R E I V N L R A R V T S L G P A A T L R CGCGGGTATTCCGTGGTACAGGTTGTTCCTCGCGATGGGACCGAGACTCATGTTGTGACG R G Y S V V Q V V P R D G T E T H V V T R G Y S V V Q V V P R D G T E T H V V T AGCATTGAAGAGACTCCGCCCGGCAGTCAGCTGAGGATCAGGGTCACAGACGGATCCATC S I E E T P P G S Q L R I R V T D G S I S I E E T P P G S Q L R I R V T D G S I ACCGCGGCAACGATGAGCGCTACACCCGCAGATTAGGGGCACCGTGTGATTCTTCCAACG T A A T M S A T P A D * G H R V I L P T T A A T M S A T P A D X G H R V I L P T CACGCCGCAGTGGCCTGGAACCACGCAACAGCTGGACAATTCACGTAA H A A V A W N H A T A G Q F T H A A V A W N H A T A G Q F T --- ========== Now we show an alignment against a similar protein (fig|306537.3.peg.590): ATGGCACGGCAGAGCACGAGCCCCGAACACCCGTTTTCTGTGTCCACAATCAATGATCTT A R Q S T S P E H P F S V S T I N D L --- M S V P N S P E A P W A V G Q L N D Q GTGGGCGATTGGATCGGCCGACTTGGGTCGGCCTGGGTAGAAGGCGAACTCATCCAGATC V G D W I G R L G S A W V E G E L I Q I V K N W I Q R L G F I W V E G Q V T Q V AGCATGAAGCGCAACTGGGCGTTCTCCTACCTGTATCTCAAGGACTTGAACGATGACGTT S M K R N W A F S Y L Y L K D L N D D V N M K S T W R F S Y I T L R D V N L E A TCCATGGAGCTCACGTGCCCCACGAAGATC--GCCATGTCCGCCGAGATTTCCAACGGCG S M E L T C P T K I A M S A E I S N G S V S L T V E T S A LK N L A T P V K D G ATCGTGTGCTCGTTCATGGGCAGCCACGCCTGTACAAGCGCAACGGGCGCTACTCCCTCA D R V L V H G Q P R L Y K R N G R Y S L D R I V V H G K P S F Y S K R G S F S L TGGTGAGCGAAATCCGCCACGTGGGAATCGGCGAGGAGCTAGCCCGAATTGAAAAACTTC M V S E I R H V G I G E E L A R I E K L W V T E I R Q V G I G Q L L A Q I E Q L GCCACGATCTCGCCACTGAGGGATTGTTCAATGCAGACAGGAAGCAACCGCTGCCCGTGC R H D L A T E G L F N A D R K Q P L P V K K A M F A E G L F D P R L K T P L P F TGCCCAACTGCGTGGGGCTCATCACGGGGCGGGACTCTGCTGCGGAACGGGATGTGCTCA L P N C V G L I T G R D S A A E R D V L L P T T V G L I T G R G S A A E R D V M AGGTGACCCACGACAGGTGGCCCGCAGTTCAATTCCGCATCATCAACACCGCGGTGCAAG K V T H D R W P A V Q F R I I N T A V Q E V A K R R W P A V R F R V I N T A V Q GTCAGCGCGCCGAGCCGGAAATAATCGCCGCGCTCAAGAGGCTGGATGCCGACCCTGAGG G Q R A E P E I I A A L K R L D A D P E G P K T V P Q V V D A L Q E L E R D S A TCGATGTCATCATCATCGCCCGCGGCGGCGGCTCAGTAGAGGACCTGTTCCCCTTTTCTA V D V I I I A R G G G S V E D L F P F S V D V I I V A R G G G S V E D L L P F S GAGAACAACTCATTCGCGCCGTGGCTGCCGCGTCCACTCCCGTCATCTCCGCCATCGGGC R E Q L I R A V A A A S T P V I S A I G E E T L V R E V S R L R T P V V S A I G ACGAACCCGACCACCCCATCCTGGACAATGTCGCCGATTTCGCGGCGAAGACGCCGACGG H E P D H P I L D N V A D F A A K T P T H E P D N P L L D Y V A D V R A A T P T ACGCGGGAAAGAACGTCGTACCGGATGCTACCCAGGAAGCGCTCATGATCCAGGAGATGC D A G K N V V P D A T Q E A L M I Q E M D A A K T V V P D V V Q E L R I I S E A GCTCCCGCGCGGCGGCCGCGCTGCGTGGCTGGGTGAAACGGGAGGAAGAGGGGCTTCACA R S R A A A A L R G W V K R E E E G L H R Q R G A G A L R N W V A H E R K G L A ATCTTCGTTCCCGGCCGGTGCTCAGCGATCCGTACACGATCGTCACCGAGCAAGAGGACC N L R S R P V L S D P Y T I V T E Q E D Q I R T R P V M A D P S L P V A R Q Q D ACCTCCACGATGCCGTGCAACGCATCCGCAGGTGTGCAACATCGCTCCTCACACAGGAGG H L H D A V Q R I R R C A T S L L T Q E I I A E A L Q R K D R A L G V H V R S L ATCGGGAGATCGTTAATCTGCGTGCGCGGGTGACCTCTCTGGGCCCCGCAGCAACCCTGA D R E I V N L R A R V T S L G P A A T L R S S I E S L K A Q V N A L G P S Q T L GGCGCGGGTATTCCGTGGTACAGGTTGTTCCTCGCGATGGGACCGAGACTCATGTTGTGA R R G Y S V V Q V V P R D G T E T H V V A R G Y S I V Q V I P R D K S G A Q V V CGAGCATTGAAGAGACTCCGCCCGGCAGTCAGCTGAGGATCAGGGTCACAGACGGATCCA T S I E E T P P G S Q L R I R V T D G S T T V D Q V T P G S Q L R I R V P D G S TCACCGCGGCAACGATGAGCGCTACACCCGCAGAT*TA*GGGGCACCGTGTGATTCTTCC I T A A T M S A T P A D G A P C D S S I T A A A M G V Q A A P *G** G V M N K N S AACGCACGCCGCAGTGGCCTGGAACCACGCAAC*A*GCTGGACAATTCACGTAA N A R R S G L E P R N A G Q F N T T D S T D N T E N *G* T G E A ------ // >fig|6666666.67496.peg.2289 fig|196164.1.peg.1262 Sodium/proline symporter FIG010198 gi|512071492|gb|ATBY01000002.1|_175733_174831,gi|512071492|gb|ATBY01000002.1|_174831_174202 MTDHTWFIVAIILYMLLMLAIGYWSYRQTDRYDEYMLAGRSLGPVVAALSAGAADMSGWLLMGLPGALFVTGLSESWIAVGLCIGAAINWRLVAPRLRAYTEVAGNSITIPSFLENRLHDSSHVLRIIASLVILVFFTFYVSSGMVSGGKYFESTFGGSYLDGMLIIAIVTVAYTFIGGFLAVSYTDAVQGIIMFGALVIVPVGAYIVVHGDYDVFSYATSNVYGPHPNGNPTYFSLFSGISAAAIIGNLAWGLGYFGQPHIIVRFMALRSPKEARAGMFVTVFWMVICALGLPLRRLWAxxYFGAYPERSITDQTSYETIFLDMGRMLFHPLIGGLVLTAVLAAIMSTMASQLLVVSSALIEDLYKIITKKQLSDGVLMNLSRTAVVVVAVIAALLAVSPRDSILSLVAFAWAGFGSAFGPVILASLFWRRLTAPGAIAAMVSGTVIVFAWGNSPLGDWLYEMVPGFLGATIVLIVVSLLTKAPSARLVEEFDQAQHLAVTGEYAHTTK We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACAGACCACACCTGGTTCATTGTCGCCATCATTTTGTACATGCTCCTCATGCTCGCT M T D H T W F I V A I I L Y M L L M L A M T D H T W F I V A I I L Y M L L M L A ATTGGCTATTGGAGCTACCGGCAAACTGATCGTTACGACGAGTACATGCTCGCTGGCCGT I G Y W S Y R Q T D R Y D E Y M L A G R I G Y W S Y R Q T D R Y D E Y M L A G R TCGCTGGGGCCGGTGGTTGCCGCCCTGTCGGCCGGTGCCGCGGATATGAGTGGTTGGCTT S L G P V V A A L S A G A A D M S G W L S L G P V V A A L S A G A A D M S G W L CTCATGGGGCTGCCCGGCGCGCTGTTTGTCACGGGGCTGTCAGAATCGTGGATCGCCGTG L M G L P G A L F V T G L S E S W I A V L M G L P G A L F V T G L S E S W I A V GGCCTGTGCATCGGCGCGGCGATCAACTGGCGCCTTGTCGCCCCGCGGCTGCGCGCCTAC G L C I G A A I N W R L V A P R L R A Y G L C I G A A I N W R L V A P R L R A Y ACGGAGGTGGCCGGCAACTCGATCACGATCCCCAGCTTCTTGGAAAACCGCCTCCACGAT T E V A G N S I T I P S F L E N R L H D T E V A G N S I T I P S F L E N R L H D TCTTCCCACGTCCTGCGCATCATCGCTTCCCTGGTGATTCTGGTGTTCTTCACCTTCTAT S S H V L R I I A S L V I L V F F T F Y S S H V L R I I A S L V I L V F F T F Y GTCTCCAGTGGCATGGTTTCCGGCGGCAAGTACTTCGAGTCCACCTTCGGCGGTTCGTAC V S S G M V S G G K Y F E S T F G G S Y V S S G M V S G G K Y F E S T F G G S Y CTGGATGGCATGCTTATCATTGCGATTGTCACCGTCGCCTACACGTTCATCGGTGGCTTC L D G M L I I A I V T V A Y T F I G G F L D G M L I I A I V T V A Y T F I G G F CTGGCGGTCAGCTACACGGACGCGGTGCAGGGAATCATCATGTTTGGGGCTCTGGTCATC L A V S Y T D A V Q G I I M F G A L V I L A V S Y T D A V Q G I I M F G A L V I GTCCCGGTGGGTGCCTACATCGTGGTCCATGGCGATTACGATGTCTTCAGCTACGCCACC V P V G A Y I V V H G D Y D V F S Y A T V P V G A Y I V V H G D Y D V F S Y A T TCCAATGTGTACGGCCCGCACCCGAACGGCAACCCCACCTACTTCTCCCTGTTCAGCGGG S N V Y G P H P N G N P T Y F S L F S G S N V Y G P H P N G N P T Y F S L F S G ATTTCCGCGGCTGCGATCATCGGCAACCTGGCGTGGGGGTTGGGGTATTTCGGCCAGCCA I S A A A I I G N L A W G L G Y F G Q P I S A A A I I G N L A W G L G Y F G Q P CACATCATCGTGCGCTTCATGGCACTGCGCTCTCCCAAAGAGGCACGCGCCGGCATGTTT H I I V R F M A L R S P K E A R A G M F H I I V R F M A L R S P K E A R A G M F GTCACCGTGTTCTGGATGGTCATTTGCGCACTGGGGCTGCCGCTACGGCGCTTATGGGCA V T V F W M V I C A L G L P L R R L W A V T V F W M V I C A L G L P L R R L W A *CG*GTGTACTTCGGTGCTTACCCGGAGCGTTCCATCACCGACCAGACCTCCTACGAGAC V Y F G A Y P E R S I T D Q T S Y E T *X** X Y F G A Y P E R S I T D Q T S Y E T GATCTTCTTGGACATGGGGCGGATGTTGTTCCACCCGCTGATCGGCGGTCTTGTCCTGAC I F L D M G R M L F H P L I G G L V L T I F L D M G R M L F H P L I G G L V L T GGCGGTGCTTGCGGCGATCATGTCCACCATGGCTTCTCAGCTGCTCGTGGTGTCCTCCGC A V L A A I M S T M A S Q L L V V S S A A V L A A I M S T M A S Q L L V V S S A GCTCATTGAGGATTTGTACAAGATCATCACCAAGAAGCAGCTGTCCGACGGGGTGCTCAT L I E D L Y K I I T K K Q L S D G V L M L I E D L Y K I I T K K Q L S D G V L M GAACTTGTCGCGCACCGCCGTGGTGGTGGTTGCGGTGATTGCCGCGCTCCTTGCGGTCTC N L S R T A V V V V A V I A A L L A V S N L S R T A V V V V A V I A A L L A V S CCCGCGGGATTCAATCCTCAGCCTTGTGGCCTTCGCCTGGGCCGGTTTCGGCTCGGCCTT P R D S I L S L V A F A W A G F G S A F P R D S I L S L V A F A W A G F G S A F CGGGCCGGTCATTCTCGCCTCGTTGTTCTGGCGTCGCCTGACGGCGCCGGGGGCGATCGC G P V I L A S L F W R R L T A P G A I A G P V I L A S L F W R R L T A P G A I A CGCCATGGTTTCTGGCACGGTCATCGTGTTCGCCTGGGGCAACTCGCCTCTGGGGGATTG A M V S G T V I V F A W G N S P L G D W A M V S G T V I V F A W G N S P L G D W GTTGTACGAGATGGTTCCTGGTTTCCTCGGCGCGACGATCGTTCTCATTGTTGTGTCGCT L Y E M V P G F L G A T I V L I V V S L L Y E M V P G F L G A T I V L I V V S L TTTAACCAAGGCTCCCTCGGCCCGGCTTGTGGAGGAGTTTGACCAAGCCCAGCACCTCGC L T K A P S A R L V E E F D Q A Q H L A L T K A P S A R L V E E F D Q A Q H L A TGTCACCGGTGAGTACGCCCACACGACCAAGTAG V T G E Y A H T T K V T G E Y A H T T K --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.1262): ----------ATGACAGACCACACCTGGTTCATTGTCGCCATCATTTTGTACATGCTCCT M T D H T W F I V A I I L Y M L L MYNNPLKENL V S D N T W F I I A I I I Y M L V CATGCTCGCTATTGGCTATTGGAGCTACCGGCAAACTGATCGTTACGACGAGTACATGCT M L A I G Y W S Y R Q T D R Y D E Y M L M V L I G F W S Y R K T A K Y D E Y M L CGCTGGCCGTTCGCTGGGGCCGGTGGTTGCCGCCCTGTCGGCCGGTGCCGCGGATATGAG A G R S L G P V V A A L S A G A A D M S G G R G L N P F V A A M S A G A S D M S TGGTTGGCTTCTCATGGGGCTGCCCGGCGCGCTGTTTGTCACGGGGCTGTCAGAATCGTG G W L L M G L P G A L F V T G L S E S W G W L L M G L P G A L Y V T G M S E L W GATCGCCGTGGGCCTGTGCATCGGCGCGGCGATCAACTGGCGCCTTGTCGCCCCGCGGCT I A V G L C I G A A I N W R L V A P R L I A I G L T V G A W A N W M W V A P R L GCGCGCCTACACGGAGGTGGCCGGCAACTCGATCACGATCCCCAGCTTCTTGGAAAACCG R A Y T E V A G N S I T I P S F L E N R R S Y T E V S R N S I T L P S F F E N R CCTCCACGATTCTTCCCACGTCCTGCGCATCATCGCTTCCCTGGTGATTCTGGTGTTCTT L H D S S H V L R I I A S L V I L V F F L R D N S R F L R I V A A L I I I V F F CACCTTCTATGTCTCCAGTGGCATGGTTTCCGGCGGCAAGTACTTCGAGTCCACCTTCGG T F Y V S S G M V S G G K Y F E S T F G T F Y I S S G M V A G G V Y W E S T F G CGGTTCGTACCTGGATGGCATGCTTATCATTGCGATTGTCACCGTCGCCTACACGTTCAT G S Y L D G M L I I A I V T V A Y T F I G D Y L T G M I I V A S V T V L Y T F I CGGTGGCTTCCTGGCGGTCAGCTACACGGACGCGGTGCAGGGAATCATCATGTTTGGGGC G G F L A V S Y T D A V Q G I I M F G A G G F L A V S Y T D A V Q G T I M F F S TCTGGTCATCGTCCCGGTGGGTGCCTACATCGTGGTCCATGGCGATTACGATGTCTTCAG L V I V P V G A Y I V V H G D Y D V F S L I I V P V F A I L A L N N P G D I F S CTACGCCACCTCCAATGTGTACGGCCCGCACCCGAACGGC--AACCCCACCTACTTCTCC Y A T S N V Y G P H P N G N P T Y F S F A A S N D Y G P Y T D G VG N P T Y F S CTGTTCAGCGGGATTTCCGCGGCTGCGATCATCGGCAACCTGGCGTGGGGGTTGGGGTAT L F S G I S A A A I I G N L A W G L G Y M I T G V S V A A I I G N I A W G L G Y TTCGGCCAGCCACACATCATCGTGCGCTTCATGGCACTGCGCTCTCCCAAAGAGGCACGC F G Q P H I I V R F M A L R S P K E A R F G Q P H I V V R F M A L R S P A E A K GCCGGCATGTTTGTCACCGTGTTCTGGATGGTCATTTGC*GC*ACTGGGGCTGCCGCTAC A G M F V T V F W M V I C T G A A A T Q G R R I G I S W M I L C *L** T G A T F T GGCGCTTATGGGCACGGTGTACTTCGGTGCTTACCCGGAGCGTTCCATCACCGACCAGAC A L M G T V Y F G A Y P E R S I T D Q T A L A A T V F F A Q N P D Y S V T D T R CTCCTACGAGACGATCTTCTTGGACATGGGGCGGATGTTGTTCCACCCGCTGATCGGCGG S Y E T I F L D M G R M L F H P L I G G A Y E S V F L D L A R V L F H P L I A G TCTTGTCCTGACGGCGGTGCTTGCGGCGATCATGTCCACCATGGCTTCTCAGCTGCTCGT L V L T A V L A A I M S T M A S Q L L V L V L T A V L A A I M S T M S S Q L L V GGTGTCCTCCGCGCTCATTGAGGATTTGTACAAGATCATCACCAAGAAGCAGCTGTCCGA V S S A L I E D L Y K I I T K K Q L S D T A S S L I E D L L Q V V K K D G L S Q CGGGGTGCTCATGAACTTGTCGCGCACCGCCGTGGTGGTGGTTGCGGTGATTGCCGCGCT G V L M N L S R T A V V V V A V I A A L K T L L A L S R A T V I I L A I I A G A CCTTGCGGTCTCCCCGCGGGATTCAATCCTCAGCCTTGTGGCCTTCGCCTGGGCCGGTTT L A V S P R D S I L S L V A F A W A G F M A V N P S D S I L G L V G F A W A G F CGGCTCGGCCTTCGGGCCGGTCATTCTCGCCTCGTTGTTCTGGCGTCGCCTGACGGCGCC G S A F G P V I L A S L F W R R L T A P G S A F G P I I L A M L Y W K R L N A P GGGGGCGATCGCCGCCATGGTTTCTGGCACGGTCATCGTGTTCGCCTGGGGCAACTCGCC G A I A A M V S G T V I V F A W G N S P G A I A G M I T G A V V S I V W G S T A TCTGGGGGATTGGTTGTACGAGATGGTTCCTGGTTTCCTCGGCGCGACGATCGTTCTCAT L G D W L Y E M V P G F L G A T I V L I L G D I I Y E I V P G F A L A T I V M V TGTTGTGTCGCTTTTAACCAAGGCTCCCTCGGCCCGGCTTGTGGAGGAGTTTGACCAAGC V V S L L T K A P S A R L V E E F D Q A I V S L A T K A P S R E I T D E F D T A CCAGCACCTCGCTGTCACCGGTGAGTACGCCCACACGACCAAGTAG-------------- Q H L A H T T K * V R L S ------------------ H A T S M TDEDVDFSEVAQEI ---- KKGR // >fig|6666666.67496.peg.1513 fig|196164.1.peg.245 hypothetical protein gi|512070514|gb|ATBY01000010.1|_19509_19724,gi|512070514|gb|ATBY01000010.1|_19726_20016,gi|512070514|gb|ATBY01000010.1|_20018_20212,gi|512070514|gb|ATBY01000010.1|_20214_20399 MIRFRFVDDHRTEYSVKRMCAVLTIHRSSYNAWRSRRERRDHKALSDALLGVRITEVFRQENGCYGAKRITAKLNDDPGSTPLNHKRVARIMKNVGLYGYTRRRRVKTTVRAKGRNVFADLVRRKFYADRLNKLYVGDITYLPIADGSNMYLATVLDCCSRRLVGFAFQDHMRSLLVIEALNNACATRRSLAGSVFHSDHGSVYTSDVFKKTCSDLGVTQSMGSVGTSADNAFAQSFNSTLKREVLQDRKTFANPLECRREVFRWCARYNTSRRHSWCGYQAPNTFEEKQMYRVA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGATCCGCTTCCGGTTTGTTGATGACCACCGCACCGAATACTCGGTCAAGCGGATGTGT V I R F R F V D D H R T E Y S V K R M C M I R F R F V D D H R T E Y S V K R M C GCCGTTTTGACAATCCACCGCAGTAGCTACAACGCCTGGCGTAGTAGACGCGAAAGGCGG A V L T I H R S S Y N A W R S R R E R R A V L T I H R S S Y N A W R S R R E R R GATCACAAGGCTTTGTCAGATGCACTTCTTGGGGTGCGTATCACGGAGGTCTTCCGGCAA D H K A L S D A L L G V R I T E V F R Q D H K A L S D A L L G V R I T E V F R Q GAAAACGGCTGCTACGGTGCAAAACGCATCACGGCTTAAACTTAATGATGATCCAGGTTC E N G C Y G A K R I T A K L N D D P G S E N G C Y G A K R I T A - K L N D D P G S TACTCCCCTAAACCACAAGCGTGTGGCCAGGATCATGAAGAATGTAGGCCTTTACGGGTA T P L N H K R V A R I M K N V G L Y G Y T P L N H K R V A R I M K N V G L Y G Y TACCAGGCGACGAAGAGTAAAAACCACCGTGCGAGCCAAAGGCCGAAACGTGTTTGCTGA T R R R R V K T T V R A K G R N V F A D T R R R R V K T T V R A K G R N V F A D CCTTGTACGCCGCAAGTTCTACGCCGATAGACTCAACAAACTTTATGTTGGGGACATCAC L V R R K F Y A D R L N K L Y V G D I T L V R R K F Y A D R L N K L Y V G D I T CTACCTGCCTATCGCTGACGGGTCGAACATGTATCTGGCGACAGTATTGGATTGTTGTTC Y L P I A D G S N M Y L A T V L D C C S Y L P I A D G S N M Y L A T V L D C C S TCGCAGGCTTGTAGGCTTTGCTTTTCAATGACCACATGCGGAGCTTGCTTGTGATTGAGG R R L V G F A F Q D H M R S L L V I E R R L V G F A F Q - D H M R S L L V I E CCTTGAACAATGCATGCGCCACCCGTAGAAGCCTTGCAGGATCGGTGTTTCATTCCGACC A L N N A C A T R R S L A G S V F H S D A L N N A C A T R R S L A G S V F H S D ACGGCAGTGTGTACACCTCGGATGTGTTTAAGAAAACCTGCAGTGACCTTGGTGTCACCC H G S V Y T S D V F K K T C S D L G V T H G S V Y T S D V F K K T C S D L G V T AATCGATGGGGTCTGTGGGAACCAGTGCTGATAACGCGTTTGCTTCAGTCGTTTAACTCC Q S M G S V G T S A D N A F A Q S F N S Q S M G S V G T S A D N A F A - Q S F N S ACGTTGAAAAGAGAGGTACTTCAGGATCGGAAAACCTTCGCAAACCCGCTTGAATGCCGT T L K R E V L Q D R K T F A N P L E C R T L K R E V L Q D R K T F A N P L E C R AGGGAAGTGTTCCGGTGGTGTGCCCGTTACAACACATCCAGGCGCCACAGTTGGTGTGGC R E V F R W C A R Y N T S R R H S W C G R E V F R W C A R Y N T S R R H S W C G TATCAAGCCCCGAACACTTTCGAGGAGAAACAGATGTACCGTGTCGCCTAA Y Q A P N T F E E K Q M Y R V A Y Q A P N T F E E K Q M Y R V A --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.245): GTGATCCGCTTCCGGTTTGTTGATGACCACCGCACCGAATACTCGGTCAAGCGGATGTGT V I R F R F V D D H R T E Y S V K R M C M I R F R F V D D A Q K N H S V K R L C GCCGTTTTGACAATCCACCGCAGTAGCTACAACGCCTGGCGTAGTAGACGCGAAAGGCGG A V L T I H R S S Y N A W R S R R E R R E V L K L N R S S Y Y K W K N S S S A R GATCACAAGGCTTTGTCAGATGCACTTCTTGGGGTGCGTATCACGGAGGTCTTCCGGCAA D H K A L S D A L L G V R I T E V F R Q R K R L I S D A L L G A R V K T V F T A GAAAACGGCTGCTACGGTGCAAAACGCATCACGGCTTAAACTTAATGATGATCCAGGTTC E N G C Y G A K R I T A K L N D D P G S E K G C Y G A K R I T A - E L K D Q A D Q TACTCCCCTAAACCACAAGCGTGTGGCCAGGATCATGAAGAATGTAGGCCTTTACGGGTA T P L N H K R V A R I M K N V G L Y G Y T P V N H K R V A R V M R E L K L F G Y TACCAGGCGACGAAGAGTAAAAACCACCGTGCGAGCCAAAGGCCGAAACGTGTTTGCTGA T R R R R V K T T V R A K G R N V F A D T K K R K V T T T V S D Q K K P V F P D CCTTGTACGCCGCAAGTTCTACGCCGATAGACTCAACAAACTTTATGTTGGGGACATCAC L V R R K F Y A D R L N K L Y V G D I T L V G R K F T A D K P N Q L Y V G D I T CTACCTGCCTATCGCTGACGGGTCGAACATGTATCTGGCGACAGTATTGGATTGTTGTTC Y L P I A D G S N M Y L A T V L D C C S Y L P I A D G S N M Y L A T V I D C Y S TCGCAGGCTTGTAGGCTTTGCTTTTCAATGACCACATGCGGAGCTTGCTTGTGATTGAGG R R L V G F A F Q D H M R S L L V I E R R L V G F S I A - D H M R T S L V Q D CCTTGAACAATGCATGCGCCACCCGTAGAAGCCTTGCAGGATCGGTGTTTCATTCCGACC A L N N A C A T R R S L A G S V F H S D A L T M A K G Q R G D L K G A I F H S D ACGGCAGTGTGTACACCTCGGATGTGTTTAAGAAAACCTGCAGTGACCTTGGTGTCACCC H G S V Y T S D V F K K T C S D L G V T H G S V Y T S H A F Q G A C K D L G I R AATCGATGGGGTCTGTGGGAACCAGTGCTGATAACGCGTTTGCTTCAGTCGTTTAACTCC Q S M G S V G T S A D N A F A Q S F N S Q S M G S I G T S A D N A L A - E S F N A ACGTTGAAAAGAGAGGTACTTCAGGATCGGAAAACCTTCGCAAACCCGCTTGAATGCCGT T L K R E V L Q D R K T F A N P L E C R A M K R E V L Q D S K T F I N Q L I C R AGGGAAGTGTTCCGGTGGTGTGCCCGTTACAACACATCCAGGCGCCACAGTTGGTGTGGC R E V F R W C A R Y N T S R R H S W C G R D V F R W C T R Y N T V R R H S W C K TATCAAGCCCCGAACACTTTCGAGGAGAAA--CAGATGTACCGTGTCGCCTAA Y Q A P N T F E E K Q M Y R V A * Y L A P A V F E E R GP A I L K S A S // >fig|6666666.67496.peg.1644 fig|196164.1.peg.2045 FIG055075: Possibly a cell division protein, antigen 84 in Mycobacteria FIG340323 gi|512070514|gb|ATBY01000010.1|_173625_172726,gi|512070514|gb|ATBY01000010.1|_172722_172609 MPLTPADVHNIAFSKPPIGKRGYNEDEVDQFLDLVEDELARLQDENDALRQRVEDLQKERGSAGGSSVAAVSRVDEDAIRREVAKEYEAKLADANKQLATAREDADKARREAASARSQQQTSRVASATAPAEGQASAETHMQAARVLGLAQEMADRLTNDARSESQSMLDEARAAAESTISDANSSSQRTLADAKQRSDKMVREAEEKAERLIADANTKSQQQLQQAQDKANALQADAERKHTEIMATVKSQQAALENRIEELRTFEREYRTRLKTLLESQLEELNSRGSSAPRNPQGTKxPGPPSRSWMRELRGICPVALLAFKHPGGRLCPRSHCG We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGCCGCTGACTCCAGCTGACGTGCACAATATAGCCTTTAGCAAGCCGCCGATTGGAAAG M P L T P A D V H N I A F S K P P I G K M P L T P A D V H N I A F S K P P I G K CGCGGCTACAACGAAGACGAGGTGGATCAGTTCCTCGACCTCGTCGAGGACGAACTTGCC R G Y N E D E V D Q F L D L V E D E L A R G Y N E D E V D Q F L D L V E D E L A CGCTTGCAAGATGAAAATGACGCTCTGCGTCAGCGGGTAGAGGATCTGCAGAAGGAGCGT R L Q D E N D A L R Q R V E D L Q K E R R L Q D E N D A L R Q R V E D L Q K E R GGCTCCGCCGGCGGTTCCTCCGTCGCCGCCGTCTCCCGTGTGGATGAAGATGCGATCCGT G S A G G S S V A A V S R V D E D A I R G S A G G S S V A A V S R V D E D A I R CGCGAGGTTGCCAAGGAATACGAGGCCAAGCTCGCCGATGCCAACAAGCAGCTCGCCACC R E V A K E Y E A K L A D A N K Q L A T R E V A K E Y E A K L A D A N K Q L A T GCCCGCGAGGACGCAGACAAGGCCCGCCGCGAGGCGGCCTCCGCCCGCAGTCAGCAGCAG A R E D A D K A R R E A A S A R S Q Q Q A R E D A D K A R R E A A S A R S Q Q Q ACCTCCCGCGTTGCCAGCGCCACCGCCCCCGCCGAGGGTCAGGCCTCTGCAGAAACGCAC T S R V A S A T A P A E G Q A S A E T H T S R V A S A T A P A E G Q A S A E T H ATGCAGGCCGCCCGCGTGCTCGGGTTGGCACAGGAGATGGCCGACAGGCTCACCAACGAC M Q A A R V L G L A Q E M A D R L T N D M Q A A R V L G L A Q E M A D R L T N D GCCCGCTCCGAGAGCCAGTCCATGCTGGACGAGGCCCGCGCAGCAGCAGAGTCCACCATT A R S E S Q S M L D E A R A A A E S T I A R S E S Q S M L D E A R A A A E S T I TCCGACGCGAACTCCTCCTCGCAGCGCACGCTTGCTGATGCCAAGCAGCGCTCCGACAAG S D A N S S S Q R T L A D A K Q R S D K S D A N S S S Q R T L A D A K Q R S D K ATGGTGCGCGAGGCGGAGGAGAAGGCCGAGCGTCTCATCGCAGATGCAAACACCAAGTCC M V R E A E E K A E R L I A D A N T K S M V R E A E E K A E R L I A D A N T K S CAGCAGCAGTTGCAGCAGGCCCAAGACAAGGCAAACGCCCTGCAGGCGGATGCCGAGCGC Q Q Q L Q Q A Q D K A N A L Q A D A E R Q Q Q L Q Q A Q D K A N A L Q A D A E R AAGCACACCGAGATCATGGCCACCGTCAAGAGCCAGCAGGCCGCCTTGGAGAACCGTATC K H T E I M A T V K S Q Q A A L E N R I K H T E I M A T V K S Q Q A A L E N R I GAGGAGCTGCGCACCTTCGAGCGCGAGTACCGTACACGCCTCAAGACCCTGCTGGAGTCC E E L R T F E R E Y R T R L K T L L E S E E L R T F E R E Y R T R L K T L L E S CAGCTGGAAGAGCTGAACAGCCGCGGTTCCTCCGCTCCGCGTAACCCGCAGGGCACCAAG Q L E E L N S R G S S A P R N P Q G T K Q L E E L N S R G S S A P R N P Q G T K TAACCCGGACCCCCGTCGCGGTCGTGGATGCGCGAGCTACGGGGCATCTGCCCGGTAGCT * P G P P S R S W M R E L R G I C P V A X P G P P S R S W M R E L R G I C P V A CTGCTCGCATTCAAGCATCCCGGTGGCAGGTTGTGCCCACGCAGTCACTGCGGTTAA L L A F K H P G G R L C P R S H C G L L A F K H P G G R L C P R S H C G --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2045): ATGCCGCTGACTCCAGCTGACGTGCACAATATAGCCTTTAGCAAGCCGCCGATTGGAAAG M P L T P A D V H N I A F S K P P I G K M P L T P A D V H N V A F S K P P I G K CGCGGCTACAACGAAGACGAGGTGGATCAGTTCCTCGACCTCGTCGAGGACGAACTTGCC R G Y N E D E V D Q F L D L V E D E L A R G Y N E D E V D Q F L D L V E D T L A CGCTTGCAAGATGAAAATGACGCTCTGCGTCAGCGGGTAGAGGATCTG--CAGAAGGAGC R L Q D E N D A L R Q R V E D L Q K E Q L Q E E N D D L T Q R V E E L ET Q L K GTGGCTCCGCCGGCGGTTCCTCCGTCGCCGCCGTCTCC--CGTGTGGATGAAGATGCGAT R G S A G G S S V A A V S R V D E D A I D G S P A G A G G A G S G SP R V D E S A L CCGTCGCGAGGTTGCCAAG----GAATACGAGGCCAAGCTCGCCGATGCCAACAAG---- R R E V A K E Y E A K L A D A N K R R E I E E KLRA E Y K T K L D E A Q K TATK ----------CAGCTCGCCACCGCCCGCGAGGACGCAGACAAGGCCCGCCGCGAGGCGGC Q L A T A R E D A D K A R R E A A AQNDAKAAQD Q L Q K A Q A D A K A A R E E A E CTCCGCCCGCAGTCAGCAGCAGACCTCC-CGCGTT-GCCAGCGCCACCGCCCCC-GCCGA S A R S Q Q Q T S R V A S A T A P A E K A K A N A G S G G R T P A A A A A P E A S GGGTCAGGCCTCTGCAGAAACGCACATGCAGGCCGCCCGCGTGCTCGGGTTGGCACAGGA G Q A S A E T H M Q A A R V L G L A Q E G G A T V D T H M Q A A K V L G L A Q E GATGGCCGACAGGCTCACCAACGACGCCCGCTCCGAGAGCCAGTCCATGCTGGACGAGGC M A D R L T N D A R S E S Q S M L D E A M A D R L T S D A R A E A K S M L D D A CCGCGCAGCAGCAGAGTCCACCATTTCCGACGCGAACTCCTCCTCGCAGCGCACGCTTGC R A A A E S T I S D A N S S S Q R T L A R E A A E K Q I S E A N T S S N R T L E TGATGCCAAGCAGCGCTCCGACAAGATGGTGCGCGAGGCGGAGGAGAAGGCCGAGCGTCT D A K Q R S D K M V R E A E E K A E R L D A R Q R A E K Q I A D A E A R A K N L CATC----------------------GCAGATGCAAACACCAAGTCCCAGCAGCAGTTGC I A D A N T K S Q Q Q L V DEAEARAKNLVDEAEKKSAATL A D S T A R A E A Q I AGCAGGCCCAAGACAAGGCAAACGCCCTGCAGGCGGATGCCGAGCGCAAGCACACCGAGA Q Q A Q D K A N A L Q A D A E R K H T E R Q A E D K A N A L Q A D A E R K H T E TCATGGCCACCGTCAAGAGCCAGCAGGCCGCCTTGGAGAACCGTATCGAGGAGCTGCGCA I M A T V K S Q Q A A L E N R I E E L R T M A A V K E Q Q N A L E T R I A E L Q CCTTCGAGCGCGAGTACCGTACACGCCTCAAGACCCTGCTGGAGTCCCAGCTGGAAGAGC T F E R E Y R T R L K T L L E S Q L E E V F E R E Y R T R L K S L L E G Q L E E TGAACAGCCGCGGTTCCTCCGCTCCGCGTAACCCGCAGGGCACCAAGTAACCCGGACCCC L N S R G S S A P L N A R G S S A P ---------------------------------- CGTCGCGGTCGTGGATGCGCGAGCTACGGGGCATCTGCCCGGTAGCTCTGCTCGCATTCA A R A T G H L P G S S A R ---------------- A G N T G N N P G G Q N S ----- AGCATCCCGGTGGCAGGTTGTGCCCACGCAGTCACTGCGGTTAA -------------------------------------------- // >fig|6666666.67496.peg.1901 fig|306537.3.peg.1003 PROBABLE CONSERVED INTEGRAL MEMBRANE ALANINE AND LEUCINE RICH PROTEIN FIG023681 gi|512070728|gb|ATBY01000009.1|_285779_285069,gi|512070728|gb|ATBY01000009.1|_285065_285048 MDDKGELTAAIGQQERVDAQPADSEASTPSLLDQMGGLSGLVATTLPIVVYVPANSFFGLQAAIVSALVVAALVFVWRLVRKETLQPAVSGFLGVLLCAFIAWIIGDAKGFFLYGIWMSLLYAVVFVISIAVRWPAVGVIWKGIKGDGFGWHRYPRARRYYDVATLAWSLVFIARFVVQNHLYNADSTTALGVVKILMGWPLTGLVLLVTVWAIRKADGIISQQEDSNAESDGNAHExQRQPH We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGGATGATAAAGGCGAACTGACCGCCGCCATCGGGCAGCAGGAGCGAGTCGATGCGCAG V D D K G E L T A A I G Q Q E R V D A Q M D D K G E L T A A I G Q Q E R V D A Q CCAGCTGATAGCGAGGCATCAACCCCCAGCCTCCTAGACCAGATGGGCGGCCTGTCCGGG P A D S E A S T P S L L D Q M G G L S G P A D S E A S T P S L L D Q M G G L S G CTGGTTGCTACCACACTGCCGATTGTGGTCTACGTGCCCGCGAACTCATTTTTCGGCCTA L V A T T L P I V V Y V P A N S F F G L L V A T T L P I V V Y V P A N S F F G L CAGGCGGCGATTGTCTCAGCCCTCGTCGTTGCCGCCCTTGTCTTCGTGTGGCGCCTGGTC Q A A I V S A L V V A A L V F V W R L V Q A A I V S A L V V A A L V F V W R L V CGCAAAGAGACGCTCCAGCCGGCGGTGTCCGGGTTCCTGGGTGTGCTCTTGTGCGCGTTC R K E T L Q P A V S G F L G V L L C A F R K E T L Q P A V S G F L G V L L C A F ATCGCCTGGATAATCGGCGATGCGAAAGGGTTCTTCCTCTATGGAATCTGGATGTCGCTC I A W I I G D A K G F F L Y G I W M S L I A W I I G D A K G F F L Y G I W M S L CTGTATGCGGTCGTATTCGTGATTTCCATCGCGGTGCGATGGCCTGCGGTGGGAGTTATC L Y A V V F V I S I A V R W P A V G V I L Y A V V F V I S I A V R W P A V G V I TGGAAAGGAATTAAGGGCGACGGGTTCGGTTGGCACCGTTACCCGCGGGCCCGAAGGTAC W K G I K G D G F G W H R Y P R A R R Y W K G I K G D G F G W H R Y P R A R R Y TACGATGTGGCAACACTTGCGTGGTCACTCGTTTTCATCGCTCGCTTCGTGGTTCAGAAT Y D V A T L A W S L V F I A R F V V Q N Y D V A T L A W S L V F I A R F V V Q N CACCTCTATAACGCAGACTCCACCACGGCCTTGGGTGTGGTCAAGATCCTCATGGGCTGG H L Y N A D S T T A L G V V K I L M G W H L Y N A D S T T A L G V V K I L M G W CCCCTGACCGGATTGGTGCTACTCGTAACGGTGTGGGCGATCCGCAAGGCGGACGGAATT P L T G L V L L V T V W A I R K A D G I P L T G L V L L V T V W A I R K A D G I ATCTCTCAGCAAGAAGATAGCAATGCAGAAAGTGACGGGAACGCTCATGAGTGACAACGG I S Q Q E D S N A E S D G N A H E * Q R I S Q Q E D S N A E S D G N A H E X Q R CAACCACACTGA Q P H Q P H --- ========== Now we show an alignment against a similar protein (fig|306537.3.peg.1003): GTGGATGATAAAGGCGAACTGACCGCCGCCATCGGGCAGCAGGAGCGAGTCGATGCGCAG R V D A Q --------------------------------------------- M A D T A CCAGCTGATAGCGAGGCA-TCAACCCCCAGCCTCCTAGACCAGATGGGCGGCCTGTCCGG P A D S E A S T P S L L D Q M G G L S G A N S T D A E S K E T L L E Q M G G L S G GCTGGTTGCTACCACACTGCCGATTGTGGTCTACGTGCCCGCGAACTCATTTTTCGGCCT L V A T T L P I V V Y V P A N S F F G L L V S S T L P V L V L V P V N S K W G L ACAGGCGGCGATTGTCTCAGCCCTCGTCGTTGCCGCCCTTGTCTTCGTGTGGCGCCTGGT Q A A I V S A L V V A A L V F V W R L V G P A L I S A L A V A V L I L V W R L T CCGCAAAGAGACGCTCCAGCCGGCGGTGTCCGGGTTCCTGGGTGTGCTCTTGTGCGCGTT R K E T L Q P A V S G F L G V L L C A F R K E N L Q P A I S G F L A V A L C A A CATCGCCTGGATAATCGGCGATGCGAAAGGGTTCTTCCTCTATGGAATCTGGATGTCGCT I A W I I G D A K G F F L Y G I W M S L I A W I M G D A K G Y F A Y G I W Y S L CCTGTATGCGGTCGTATTCGTGATTTCCATCGCGGTGCGATGGCCTGCGGTGGGAGTTAT L Y A V V F V I S I A V R W P A V G V I A A G I A S I I S I F V R W P L V G A V CTGGAAAGGAATTAAGGGCGACGGGTTCGGTTGGCACCGTTACCCGCGGGCCCGAAGGTA W K G I K G D G F G W H R Y P R A R R Y W R G I N G D D H R W R T N R R A V R A CTACGATGTGGCAACACTTGCGTGGTCACTCGTTTTCATCGCTCGCTTCGTGGTTCAGAA Y D V A T L A W S L V F I A R F V V Q N F N I A T L A W A L V F F A R F A V Q Q TCACCTCTATAACGCAGACTCCACCACGGCCTTGGGTGTGGTCAAGATCCTCATGGGCTG H L Y N A D S T T A L G V V K I L M G W W L Y A A D K T D A L G Y T R I A M G W GCCCCTGACCGGATTGGTGCTACTCGTAACGGTGTGGGCGATCCGC---AAGGCGGACGG P L T G L V L L V T V W A I R K A D G P L T L V A V A V T V W A V K AAN H A E G A--ATTATCTCTCAGCAAGAAGATAGCAATGCAGAAAGTGACGGGAACGCTCATGAGTGA I I S Q Q E D S N A E S D G N A H E * RH L D K S E E D S Q E P N D T Q A P G D CAACGGCAACCACACTGA------------------- Q R Q P H * P E G P E V LEAGSAEGNNDEVGTDGRQ // >fig|6666666.67496.peg.796 fig|196164.1.peg.2787 Inner membrane protein translocase component YidC, Corynebacterium paraloge FIG175903 gi|512068965|gb|ATBY01000015.1|_210804_211862,gi|512068965|gb|ATBY01000015.1|_211866_211943 MDALIYLVSAVLKLWHTFLHGGLGVNENLAWMLSFVGLILTVRSLIAPLAWGMYVNARKTTIMRPHMASLKEDYRGKLDEESQKEFSDKSKQLMAEHGVNPMAGCLPMMVQMPVILGLYQMIRRIARPEGGLGNLPYPPVGFLSSNDVASFLETRAFGLPIAAYASMPEETLKTLGTSGDHLVHAITPVVIAAAAFMTLNMILSTVRSFETMDWRSSFAVNMSFSMVAFAFYMPFTILTIAFTGPIPVAIIFYWFVNNFWTLSQLIVLWTMLTIKYPLPREFKEFRDDGRRKRYEPMGLRWRALKARMKGEDPAEYVEKRRQLRAEAKDRKREDKEFKKEKKRLQKAKKAEAKxSSPPRARRGAAWSVCGRGREARASL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGATGCACTCATTTACCTCGTGTCTGCCGTGCTCAAGCTGTGGCACACCTTCTTGCAC M D A L I Y L V S A V L K L W H T F L H M D A L I Y L V S A V L K L W H T F L H GGAGGCCTGGGTGTAAACGAGAACCTCGCATGGATGCTCTCCTTCGTGGGCCTCATCCTC G G L G V N E N L A W M L S F V G L I L G G L G V N E N L A W M L S F V G L I L ACCGTGCGCAGCCTCATCGCGCCGCTGGCGTGGGGAATGTACGTCAACGCGCGCAAAACC T V R S L I A P L A W G M Y V N A R K T T V R S L I A P L A W G M Y V N A R K T ACCATCATGCGCCCGCACATGGCCTCACTTAAGGAGGACTACCGCGGCAAGCTAGACGAG T I M R P H M A S L K E D Y R G K L D E T I M R P H M A S L K E D Y R G K L D E GAAAGCCAGAAGGAATTTTCCGACAAGTCGAAGCAGCTCATGGCCGAGCACGGGGTCAAC E S Q K E F S D K S K Q L M A E H G V N E S Q K E F S D K S K Q L M A E H G V N CCCATGGCGGGGTGCCTCCCCATGATGGTGCAGATGCCGGTCATTTTGGGTTTGTATCAA P M A G C L P M M V Q M P V I L G L Y Q P M A G C L P M M V Q M P V I L G L Y Q ATGATTCGCAGAATAGCGAGACCAGAAGGGGGACTGGGGAACCTACCGTACCCACCGGTG M I R R I A R P E G G L G N L P Y P P V M I R R I A R P E G G L G N L P Y P P V GGGTTCTTGAGCTCCAACGACGTCGCATCGTTCCTGGAAACCAGGGCGTTCGGGCTGCCC G F L S S N D V A S F L E T R A F G L P G F L S S N D V A S F L E T R A F G L P ATCGCCGCGTACGCCTCCATGCCCGAGGAGACGCTTAAGACCCTGGGGACGAGCGGCGAC I A A Y A S M P E E T L K T L G T S G D I A A Y A S M P E E T L K T L G T S G D CACCTCGTGCACGCCATCACGCCCGTGGTCATCGCGGCGGCGGCGTTCATGACCCTCAAC H L V H A I T P V V I A A A A F M T L N H L V H A I T P V V I A A A A F M T L N ATGATCCTGTCCACCGTCCGCTCCTTTGAAACGATGGATTGGCGCAGCTCGTTCGCCGTC M I L S T V R S F E T M D W R S S F A V M I L S T V R S F E T M D W R S S F A V AACATGAGCTTCTCCATGGTGGCGTTCGCGTTCTACATGCCGTTTACCATCCTCACCATC N M S F S M V A F A F Y M P F T I L T I N M S F S M V A F A F Y M P F T I L T I GCGTTTACCGGCCCCATCCCCGTGGCCATCATCTTCTACTGGTTTGTCAACAACTTCTGG A F T G P I P V A I I F Y W F V N N F W A F T G P I P V A I I F Y W F V N N F W ACGCTCTCCCAGCTCATCGTCTTGTGGACCATGCTCACCATCAAGTATCCCTTGCCCCGC T L S Q L I V L W T M L T I K Y P L P R T L S Q L I V L W T M L T I K Y P L P R GAGTTCAAGGAGTTTCGCGACGACGGGCGACGCAAGCGCTACGAGCCCATGGGGCTGAGG E F K E F R D D G R R K R Y E P M G L R E F K E F R D D G R R K R Y E P M G L R TGGCGGGCGCTCAAGGCCCGCATGAAGGGCGAGGACCCCGCCGAATACGTGGAAAAGCGC W R A L K A R M K G E D P A E Y V E K R W R A L K A R M K G E D P A E Y V E K R AGGCAGCTGCGCGCCGAGGCGAAGGACCGCAAGCGGGAGGACAAGGAGTTTAAGAAGGAA R Q L R A E A K D R K R E D K E F K K E R Q L R A E A K D R K R E D K E F K K E AAGAAGCGGTTGCAGAAAGCCAAGAAGGCGGAGGCTAAATAGAGTAGTCCGCCGCGGGCT K K R L Q K A K K A E A K * S S P P R A K K R L Q K A K K A E A K X S S P P R A CGCCGAGGAGCTGCTTGGTCAGTGTGCGGGCGAGGTCGAGAGGCTCGCGCGAGTTTGTGA R R G A A W S V C G R G R E A R A S L R R G A A W S V C G R G R E A R A S L --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2787): -ATGGATGCACTCATTTACCTCGTGTCTGCCGTGCTCAAGCTGTGGCACACCTTCTTGCA M D A L I Y L V S A V L K L W H T F L H M L D F L I Y P V S G V M K L W H L L L H CGGAGGCCTGGGTGTAAACGAGAACCTCGCATGGATGCTCTCCTTCGTGGGCCTCATCCT G G L G V N E N L A W M L S F V G L I L N G L G L D D S L A W F I S L F G L V I CACCGTGCGCAGCCTCATCGCGCCGCTGGCGTGGGGAATGTACGTCAACGCGCGCAAAAC T V R S L I A P L A W G M Y V N A R K T T V R A I I A P F T W K M Y K S G R L T CACCATCATGCGCCCGCACATGGCCTCACTTAAGGAGGACTACCGCGGCAAGCTAGACGA T I M R P H M A S L K E D Y R G K L D E A Q I R P K R V A I A E E F K G R H D E GGAAAGCCAGAAGGAATTTTCCGACAAGTCGAAGCAGCTCATGGCCGAGCACGGGGTCAA E S Q K E F S D K S K Q L M A E H G V N D S I R E M Q Q K Y K D L N K E Y G I N CCCCATGGCGGGGTGCCTCCCCATGATGGTGCAGATGCCGGTCATTTTGGGTTTGTATCA P M A G C L P M M V Q M P V I L G L Y Q P F A G C V P T L I Q I P V I L G L Y Q AATGATTCGCAGAATAGCGAGACCAGAAGGGGGACTGGGGAACCTACCGTACCCA-CCGG M I R R I A R P E G G L G N P Y P P V L L L M A R P E G G L E N --- P V P R S TGGGGTTCTTGAGCTCCAACGACGTCGCATCGTTCCTGGAAACCAGGGCGTTCGGGCTGC V G F L S S N D V A S F L E T R A F G L I G F L S A E E V Q S F L Q G R V F N V CCATCGCCGCGTACGCCTCCATGCCCGAGGAGACGCTTAAGACCCTGGGGACGAGCGGCG P I A A Y A S M P E E T L K T L G T S G P L P A Y V T M P A E Q L T F L G T T R ACCACCTCGTGCACGCCATCACGCCCGTGGTCATCGCGGCGGCGGCGTTCATGACCCTCA D H L V H A I T P V V I A A A A F M T L E D V L S F V L P L F I V A A V F T A F ACATGATCCTGTCCACCGTCCGCTCCTTTGAAACGATGGATTGGCGCAGCTCGTTCGCCG N M I L S T V R S F E T M D W R S S F A N M A L S T Y R N I Q T N D Y A S N I S TCAACATGAGCTTCTCCATGGTGGCGTTCGCGTTCTACATGCCGTTTACCATCCTCACCA V N M S F S M V A F A F Y M P F T I L T N G M F K A F L W L A V L A P L F P L V TCGCGTTTACCGGCCCCATCCCCGTGGCCATCATCTTCTACTGGTTTGTCAACAACTTCT I A F T G P I P V A I I F Y W F V N N F L G L T G P F P T A I A L Y W V A N N L GGACGCTCTCCCAGCTCATCGTCTTGTGGACCATGCTCACCATCAAGTATCCCTTGCCCC W T L S Q L I V L W T M L T I K Y P L P W T F G Q T A I M H Y I I E R N Y P L T GCGAGTTCAAGGAG--------TTTCGCGACGACGGGCGACGCAAGCGCTACGAGCCCAT R E F K E F R D D G R R K R E E F K E HHAAQRAT Y R E Q Q R K K R ----------- GGGGCTGAGGTGGCGGGCGCTCAAGGCCCGCATG---------------AAGGGCGAGGA G L R W R A L K A R M K G E D - A F L W T R R K N R L MMILTPHRAAELHAQ N A E M CCCCGCCGAATACGTGGAAAAGCGCAGGCAGCTGCGCGCCGAGGCGAAGGAC--CGCAAG P A E Y V E K R R Q L R A E A K D R K T R E R T E R I R A E K A T K K E IA T K CGGGAGGACAAGGAGTTTAAGAAGGAAAAGAAGCGGTTGCAGAAAGCCAAGAAGGCGGAG R E D K E F K K E K K R L Q K A R R R R R R A A E R K I N Q Q K M E E A - R R R R GCTAAATAGAGTAGTC---CGCCGCGGG*C*TCGCCGAGGAGC*T*GCTTGGTCAGTGTG L N R V V R R G S P R S A W S V C Q A R R A GDK S N G *E* Q P E T *D* A T D P S CGGGCGAGGTCGAGAGGCTCGCGCGAGTTTGTGA G R G K --------------------------- // >fig|6666666.67496.peg.39 fig|257309.1.peg.54 Lead, cadmium, zinc and mercury transporting ATPase (EC 3.6.3.3) (EC 3.6.3.5); Copper-translocating P-type ATPase (EC 3.6.3.4) FIG025203 gi|512068193|gb|ATBY01000017.1|_43386_41953,gi|512068193|gb|ATBY01000017.1|_41953_41153 MSTPHHSGDHHGDHPAPETDHTYHPDHASHEHRADADTHGQAMPHDHPHSALDEDHHVHGHGEHAGHSTAMFRDRFWWSLILSIPVVIFSPMVAHLLGYHLPAFPGSTWIPPVVGTIIFAYGGTPFLKGGWKELKSRQPGMMLLIAMAITVAFVASWATTLGLGGFDLDFWWELALLVAIMLLGHWLEMRALGAASSALDALAALLPDEAEKVIDGTTRTVAISELVVDDVVLVRAGARVPADGTILDGAAEFDEAMITGESRPVFRDTGDKVVAGTVATDNTVRIRVEATGGDTALAGIQRMVADAQESSSRAQALADRAAALLFWFALISALITAVVWTIIGSPDDAVVRTVTVLVIACPHALGLAIPLVIAISSERAAKSGVLIKDRMALERMRTIDVVLFDKTGTLTEGAHAVTGVAAAVGVTEGELLALAAAAEADSEHPVARAIVAAAAAHPEASRRQIRATGFSAASGRGxxATVDGAEILVGGPNMLREFNLTTPAELTDTTSAWTGRGAGVLHIVRDGQIIGAVAVEDKIRPESRAAVKALQDRGVKVAMITGDAQQVAHAVGQDLGIDEVFAEVLPQDKDTKVTQLQDRGLSVAMVGDGVNDAPALTRAEVGIAIGAGTDVAMESAGVILASDDPRAVLSMIELSQASYRKMIQNLIWASGYNILAVPLAAGVLASIGFVLSPAVGAILMSASTIVVALNAQLLRRIDLDPAHLAPTESKEEHTRPTPASTAVH We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGCACTCCCCACCATTCCGGCGATCACCATGGTGATCACCCCGCTCCGGAAACAGAC M S T P H H S G D H H G D H P A P E T D M S T P H H S G D H H G D H P A P E T D CACACCTACCACCCGGATCATGCCAGCCACGAACACCGCGCAGATGCCGACACCCACGGC H T Y H P D H A S H E H R A D A D T H G H T Y H P D H A S H E H R A D A D T H G CAGGCGATGCCCCACGATCATCCGCATTCCGCCCTGGACGAAGATCACCACGTTCATGGT Q A M P H D H P H S A L D E D H H V H G Q A M P H D H P H S A L D E D H H V H G CACGGCGAACACGCCGGACACAGCACCGCAATGTTTCGGGACCGCTTCTGGTGGTCGCTG H G E H A G H S T A M F R D R F W W S L H G E H A G H S T A M F R D R F W W S L ATTTTGTCCATTCCCGTCGTTATTTTCAGCCCCATGGTCGCCCACCTGCTCGGCTACCAC I L S I P V V I F S P M V A H L L G Y H I L S I P V V I F S P M V A H L L G Y H CTCCCGGCATTCCCCGGATCCACCTGGATCCCCCCGGTGGTGGGCACGATCATCTTCGCC L P A F P G S T W I P P V V G T I I F A L P A F P G S T W I P P V V G T I I F A TACGGCGGAACGCCTTTCCTCAAGGGCGGATGGAAAGAACTGAAATCCCGCCAACCCGGG Y G G T P F L K G G W K E L K S R Q P G Y G G T P F L K G G W K E L K S R Q P G ATGATGCTCCTGATCGCCATGGCCATCACCGTGGCGTTTGTCGCCTCCTGGGCCACCACT M M L L I A M A I T V A F V A S W A T T M M L L I A M A I T V A F V A S W A T T CTGGGGCTGGGCGGTTTTGACCTGGACTTCTGGTGGGAGCTGGCCCTGCTGGTAGCCATC L G L G G F D L D F W W E L A L L V A I L G L G G F D L D F W W E L A L L V A I ATGCTGCTGGGCCACTGGCTGGAGATGCGCGCTCTCGGGGCCGCGTCCTCCGCGCTTGAC M L L G H W L E M R A L G A A S S A L D M L L G H W L E M R A L G A A S S A L D GCGCTGGCTGCCCTGCTGCCGGATGAGGCCGAGAAAGTCATCGACGGGACCACCCGCACC A L A A L L P D E A E K V I D G T T R T A L A A L L P D E A E K V I D G T T R T GTGGCCATCTCCGAGCTGGTCGTCGACGACGTCGTGCTGGTGAGGGCCGGTGCCCGGGTG V A I S E L V V D D V V L V R A G A R V V A I S E L V V D D V V L V R A G A R V CCGGCCGACGGAACCATCCTCGACGGAGCCGCCGAATTCGATGAGGCGATGATCACCGGC P A D G T I L D G A A E F D E A M I T G P A D G T I L D G A A E F D E A M I T G GAATCCCGTCCCGTCTTCCGCGACACCGGTGACAAGGTGGTCGCCGGTACCGTGGCCACC E S R P V F R D T G D K V V A G T V A T E S R P V F R D T G D K V V A G T V A T GACAACACCGTCCGCATCCGGGTGGAGGCTACCGGCGGGGACACCGCCCTGGCCGGGATC D N T V R I R V E A T G G D T A L A G I D N T V R I R V E A T G G D T A L A G I CAACGCATGGTTGCCGACGCCCAGGAGTCCTCCTCCCGGGCCCAGGCCCTGGCGGATCGG Q R M V A D A Q E S S S R A Q A L A D R Q R M V A D A Q E S S S R A Q A L A D R GCGGCGGCGTTGTTGTTCTGGTTCGCGCTGATCTCCGCTCTGATCACCGCGGTGGTGTGG A A A L L F W F A L I S A L I T A V V W A A A L L F W F A L I S A L I T A V V W ACCATTATCGGCAGCCCGGACGATGCCGTGGTGCGCACGGTCACGGTGCTGGTCATCGCC T I I G S P D D A V V R T V T V L V I A T I I G S P D D A V V R T V T V L V I A TGCCCGCATGCCCTGGGCCTGGCGATTCCGCTGGTCATTGCGATCTCCAGCGAGCGGGCC C P H A L G L A I P L V I A I S S E R A C P H A L G L A I P L V I A I S S E R A GCGAAATCCGGGGTGCTCATCAAGGACCGAATGGCGCTCGAGCGGATGCGCACCATCGAC A K S G V L I K D R M A L E R M R T I D A K S G V L I K D R M A L E R M R T I D GTGGTGCTCTTCGACAAAACCGGCACCCTGACCGAGGGTGCGCACGCGGTCACCGGTGTC V V L F D K T G T L T E G A H A V T G V V V L F D K T G T L T E G A H A V T G V GCGGCAGCTGTCGGCGTCACCGAGGGCGAGCTGCTGGCCCTGGCCGCCGCCGCGGAGGCC A A A V G V T E G E L L A L A A A A E A A A A V G V T E G E L L A L A A A A E A GACAGCGAGCACCCCGTGGCCCGCGCCATCGTGGCGGCCGCGGCCGCCCATCCCGAGGCC D S E H P V A R A I V A A A A A H P E A D S E H P V A R A I V A A A A A H P E A TCCCGTCGGCAAATCCGTGCAACTGGTTTCAGCGCCGCCTCCGGCCGGGGG*TC*CGGGC S R R Q I R A T G F S A A S G R G R A S R R Q I R A T G F S A A S G R G *X** X A CACTGTCGATGGCGCTGAGATCCTCGTGGGCGGGCCGAACATGCTGCGCGAGTTCAACCT T V D G A E I L V G G P N M L R E F N L T V D G A E I L V G G P N M L R E F N L CACCACCCCGGCCGAGCTCACCGACACCACCAGCGCCTGGACCGGGCGTGGGGCTGGTGT T T P A E L T D T T S A W T G R G A G V T T P A E L T D T T S A W T G R G A G V GCTCCATATTGTCCGCGACGGTCAGATCATCGGTGCGGTGGCCGTCGAGGACAAGATCCG L H I V R D G Q I I G A V A V E D K I R L H I V R D G Q I I G A V A V E D K I R CCCCGAATCCCGCGCCGCCGTGAAAGCCCTGCAGGACCGCGGGGTGAAAGTCGCGATGAT P E S R A A V K A L Q D R G V K V A M I P E S R A A V K A L Q D R G V K V A M I CACCGGCGACGCCCAGCAGGTGGCCCACGCTGTCGGTCAGGACTTAGGCATTGATGAGGT T G D A Q Q V A H A V G Q D L G I D E V T G D A Q Q V A H A V G Q D L G I D E V CTTCGCCGAGGTACTGCCCCAGGACAAAGACACCAAGGTCACGCAGCTGCAGGACCGAGG F A E V L P Q D K D T K V T Q L Q D R G F A E V L P Q D K D T K V T Q L Q D R G TCTGAGCGTGGCCATGGTCGGTGACGGTGTCAATGACGCCCCCGCTCTGACCCGTGCGGA L S V A M V G D G V N D A P A L T R A E L S V A M V G D G V N D A P A L T R A E GGTCGGTATCGCCATCGGTGCTGGCACGGATGTGGCCATGGAATCTGCCGGGGTGATCCT V G I A I G A G T D V A M E S A G V I L V G I A I G A G T D V A M E S A G V I L AGCCAGTGATGACCCGCGGGCAGTGCTGTCGATGATTGAGCTGTCCCAGGCCAGCTACCG A S D D P R A V L S M I E L S Q A S Y R A S D D P R A V L S M I E L S Q A S Y R CAAGATGATCCAGAACCTGATCTGGGCCTCTGGCTACAACATCCTCGCCGTGCCGCTGGC K M I Q N L I W A S G Y N I L A V P L A K M I Q N L I W A S G Y N I L A V P L A CGCCGGAGTGCTCGCCTCGATCGGGTTCGTGCTGTCCCCGGCCGTGGGCGCGATCTTGAT A G V L A S I G F V L S P A V G A I L M A G V L A S I G F V L S P A V G A I L M GTCTGCCTCGACCATCGTGGTGGCCCTGAACGCCCAGCTGTTGCGCCGTATTGATCTGGA S A S T I V V A L N A Q L L R R I D L D S A S T I V V A L N A Q L L R R I D L D TCCGGCCCACCTGGCTCCGACCGAGTCGAAGGAGGAACACACCAGGCCTACTCCGGCATC P A H L A P T E S K E E H T R P T P A S P A H L A P T E S K E E H T R P T P A S CACCGCCGTCCACTGA T A V H T A V H --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.54): ATGAGCACTCCCCACCATTCCGGCGATCACCATGGTGATCACCCCGCTCCGGAAACAGAC M S T P H H S G D H H G D H P A P E T D M N T P N H S G D H H G D H P A P E T D CACACCTACCACCCGGATCATGCCAGCCACGAACACCGCGCAGATGCCGACACCCACGGC H T Y H P D H A S H E H R A D A D T H G H T Y H P D H A S H E H H A D A D T H G CAGGCGATGCCCCACGATCATCCGCATTCCGCCCTGGACGAAGATCACCACGTTCATGGT Q A M P H D H P H S A L D E D H H V H G H A K P H D H P H S A L D E D H H V H G CACGGCGAACACGCCGGACACAGCACCGCAATGTTTCGGGACCGCTTCTGGTGGTCGCTG H G E H A G H S T A M F R D R F W W S L H G E H A G H S T A M F R E R F W W S L ATTTTGTCCATTCCCGTCGTTATTTTCAGCCCCATGGTCGCCCACCTGCTCGGCTACCAC I L S I P V V I F S P M V A H L L G Y H I L S I P V V I F S P M V A H L L G Y H CTCCCGGCATTCCCCGGATCCACCTGGATCCCCCCGGTGGTGGGCACGATCATCTTCGCC L P A F P G S T W I P P V V G T I I F A L P A F P G S T W I P P V L G T I I F V TACGGCGGAACGCCTTTCCTCAAGGGCGGATGGAAAGAACTGAAATCCCGCCAACCCGGG Y G G T P F L K G G W K E L K S R Q P G Y G G T P F L K G G W N E L K S R Q P G ATGATGCTCCTGATCGCCATGGCCATCACCGTGGCGTTTGTCGCCTCCTGGGCCACCACT M M L L I A M A I T V A F V A S W A T T M M L L I A M A I T V A F V A S W V T T CTGGGGCTGGGCGGTTTTGACCTGGACTTCTGGTGGGAGCTGGCCCTGCTGGTAGCCATC L G L G G F D L D F W W E L A L L V A I L G L G G F E L D F W W E L A L L V T I ATGCTGCTGGGCCACTGGCTGGAGATGCGCGCTCTCGGGGCCGCGTCCTCCGCGCTTGAC M L L G H W L E M R A L G A A S S A L D M L L G H W L E M S A L G A A S S A L D GCGCTGGCTGCCCTGCTGCCGGATGAGGCCGAGAAAGTCATCGACGGGACCACCCGCACC A L A A L L P D E A E K V I D G T T R T A L A A L L P D E A E K V I D G T T R T GTGGCCATCTCCGAGCTGGTCGTCGACGACGTCGTGCTGGTGAGGGCCGGTGCCCGGGTG V A I S E L V V D D V V L V R A G A R V V A I S E L I V D D V V L V R A G A R V CCGGCCGACGGAACCATCCTCGACGGAGCCGCCGAATTCGATGAGGCGATGATCACCGGC P A D G T I L D G A A E F D E A M I T G P A D G T I L D G A A E F D E A M I T G GAATCCCGTCCCGTCTTCCGCGACACCGGTGACAAGGTGGTCGCCGGTACCGTGGCCACC E S R P V F R D T G D K V V A G T V A T E S R P V F R D T G D K V V A G T V A T GACAACACCGTCCGCATCCGGGTGGAGGCTACCGGCGGGGACACCGCCCTGGCCGGGATC D N T V R I R V E A T G G D T A L A G I D N T V R I R V E A T G G D T A L A G I CAACGCATGGTTGCCGACGCCCAGGAGTCCTCCTCCCGGGCCCAGGCCCTGGCGGATCGG Q R M V A D A Q E S S S R A Q A L A D R Q R M V A D A Q E S S S R A Q A L A D R GCGGCGGCGTTGTTGTTCTGGTTCGCGCTGATCTCCGCTCTGATCACCGCGGTGGTGTGG A A A L L F W F A L I S A L I T A V V W A A A L L F W F A L I S A L I T A V V W ACCATTATCGGCAGCCCGGACGATGCCGTGGTGCGCACGGTCACGGTGCTGGTCATCGCC T I I G S P D D A V V R T V T V L V I A T I I G S P D D A V V R T V T V L V I A TGCCCGCATGCCCTGGGCCTGGCGATTCCGCTGGTCATTGCGATCTCCAGCGAGCGGGCC C P H A L G L A I P L V I A I S S E R A C P H A L G L A I P L V I A I S S E R A GCGAAATCCGGGGTGCTCATCAAGGACCGAATGGCGCTCGAGCGGATGCGCACCATCGAC A K S G V L I K D R M A L E R M R T I D A K S G V L I K D R M A L E R M R T I D GTGGTGCTCTTCGACAAAACCGGCACCCTGACCGAGGGTGCGCACGCGGTCACCGGTGTC V V L F D K T G T L T E G A H A V T G V V V L F D K T G T L T E G A H A V T G V GCGGCAGCTGTCGGCGTCACCGAGGGCGAGCTGCTGGCCCTGGCCGCCGCCGCGGAGGCC A A A V G V T E G E L L A L A A A A E A A A A V G V T E G E L L A L A A A A E A GACAGCGAGCACCCCGTGGCCCGCGCCATCGTGGCGGCCGCGGCCGCCCATCCCGAGGCC D S E H P V A R A I V A A A A A H P E A D S E H P V A R A I V A A A A A H P E A TCCCGTCGGCAAATCCGTGCAACTGGTTTCAGCGCCGCCTCCGGCCGGGGG*TC*CGGGC S R R Q I R A T G F S A A S G R G R A S R R Q I R A T G F S A A S G R G *V** R A CACTGTCGATGGCGCTGAGATCCTCGTGGGCGGGCCGAACATGCTGCGCGAGTTCAACCT T V D G A E I L V G G P N M L R E F N L T V D G A E I L V G G P N M L R E F N L CACCACCCCGGCCGAGCTCACCGACACCACCAGCGCCTGGACCGGGCGTGGGGCTGGTGT T T P A E L T D T T S A W T G R G A G V T T P A E L T D T T S A W T G R G A G V GCTCCATATTGTCCGCGACGGTCAGATCATCGGTGCGGTGGCCGTCGAGGACAAGATCCG L H I V R D G Q I I G A V A V E D K I R L H I V R D G Q I I G A V A V E D K I R CCCCGAATCCCGCGCCGCCGTGAAAGCCCTGCAGGACCGCGGGGTGAAAGTCGCGATGAT P E S R A A V K A L Q D R G V K V A M I P E S R A A V K A L Q D R G V K V A M I CACCGGCGACGCCCAGCAGGTGGCCCACGCTGTCGGTCAGGACTTAGGCATTGATGAGGT T G D A Q Q V A H A V G Q D L G I D E V T G D A Q Q V A Q A V G Q D L G I D E V CTTCGCCGAGGTACTGCCCCAGGACAAAGACACCAAGGTCACGCAGCTGCAGGACCGAGG F A E V L P Q D K D T K V T Q L Q D R G F A E V L P Q D K D T K V T Q L Q D R G TCTGAGCGTGGCCATGGTCGGTGACGGTGTCAATGACGCCCCCGCTCTGACCCGTGCGGA L S V A M V G D G V N D A P A L T R A E L S V A M V G D G V N D A P A L T R A D GGTCGGTATCGCCATCGGTGCTGGCACGGATGTGGCCATGGAATCTGCCGGGGTGATCCT V G I A I G A G T D V A M E S A G V I L V G I A I G A G T D V A M E S A G V V L AGCCAGTGATGACCCGCGGGCAGTGCTGTCGATGATTGAGCTGTCCCAGGCCAGCTACCG A S D D P R A V L S M I E L S Q A S Y R A S D D P R A V L S M I E L S Q A S Y R CAAGATGATCCAGAACCTGATCTGGGCCTCTGGCTACAACATCCTCGCCGTGCCGCTGGC K M I Q N L I W A S G Y N I L A V P L A K M I Q N L I W A S G Y N I L A V P L A CGCCGGAGTGCTCGCCTCGATCGGGTTCGTGCTGTCCCCGGCCGTGGGCGCGATCTTGAT A G V L A S I G F V L S P A V G A I L M A G V L A S I G F V L S P A V G A I L M GTCTGCCTCGACCATCGTGGTGGCCCTGAACGCCCAGCTGTTGCGCCGTATTGATCTGGA S A S T I V V A L N A Q L L R R I D L D S A S T I V V A L N A Q L L R R I D L D TCCGGCCCACCTGGCTCCGACCGAGTCGAAGGAGGAACACACCAGGCCTACTCCGGCATC P A H L A P T E S K E E H T R P T P A S P A H L A P T E S K E E H T T P T P A S CACCGCCGTCCACTGA T A V H T A V H --- // >fig|6666666.67496.peg.2245 fig|196164.1.peg.11 hypothetical protein gi|512071492|gb|ATBY01000002.1|_122425_122649,gi|512071492|gb|ATBY01000002.1|_122653_123069 MRRYLLGAVGLSLMASGIALSIIAELGTSPISSFPYVSSLMSSFTVGTGTIAMNAAFMVLQMILLRKHYDPRQLVxLPAAIVMGLLCDVFLHLLRGLGYSNYTEQWLLCALGILLVAFGVSVAVTSRVIVMAGDGLALAISVTLNRAFGPRRWREFGTCKIAVDTSLVIIASVLSLAVLGSLEGVREGTLAAALLVGFFAKYFVRWLEPVQKWL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCGTCGATATTTACTAGGAGCTGTTGGATTATCACTGATGGCGAGCGGTATTGCACTG V R R Y L L G A V G L S L M A S G I A L M R R Y L L G A V G L S L M A S G I A L TCCATCATCGCGGAGCTGGGGACATCACCGATCTCCAGCTTTCCGTACGTTTCGAGCCTC S I I A E L G T S P I S S F P Y V S S L S I I A E L G T S P I S S F P Y V S S L ATGAGCTCGTTTACAGTGGGGACGGGGACCATCGCGATGAACGCGGCGTTCATGGTCTTG M S S F T V G T G T I A M N A A F M V L M S S F T V G T G T I A M N A A F M V L CAGATGATCCTCTTGCGAAAGCACTACGATCCAAGGCAACTCGTTTAGCTTCCGGCGGCC Q M I L L R K H Y D P R Q L V * L P A A Q M I L L R K H Y D P R Q L V X L P A A ATCGTCATGGGGCTGTTGTGCGACGTGTTCCTGCATCTCCTGCGGGGCCTTGGGTATTCC I V M G L L C D V F L H L L R G L G Y S I V M G L L C D V F L H L L R G L G Y S AACTACACCGAGCAGTGGCTCCTGTGTGCGCTGGGGATTCTCCTCGTCGCTTTCGGCGTG N Y T E Q W L L C A L G I L L V A F G V N Y T E Q W L L C A L G I L L V A F G V TCTGTAGCTGTGACGAGTCGGGTGATCGTGATGGCGGGCGATGGGCTCGCCCTTGCCATC S V A V T S R V I V M A G D G L A L A I S V A V T S R V I V M A G D G L A L A I TCCGTTACCCTGAACCGTGCCTTCGGGCCGCGGCGGTGGAGGGAGTTTGGTACGTGCAAG S V T L N R A F G P R R W R E F G T C K S V T L N R A F G P R R W R E F G T C K ATCGCGGTAGACACGTCCCTCGTCATCATCGCGTCGGTGCTGTCGCTGGCGGTATTGGGG I A V D T S L V I I A S V L S L A V L G I A V D T S L V I I A S V L S L A V L G AGCCTCGAGGGCGTTCGTGAGGGGACACTGGCCGCGGCGCTTCTCGTCGGGTTCTTTGCC S L E G V R E G T L A A A L L V G F F A S L E G V R E G T L A A A L L V G F F A AAGTACTTCGTGCGCTGGCTCGAGCCGGTGCAAAAATGGCTCTAG K Y F V R W L E P V Q K W L K Y F V R W L E P V Q K W L --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.11): -------------GTGCGTCGATATTTACTAGGAGCTGTTGGATTATCACTGATGGCGAG V R R Y L L G A V G L S L M A S MATSLNPAQRYSL P T R W M L F L A G M F I L S L CGGTATTGCACTGTCCATCATCGCGGAGCTGGGGACATCACCGATCTCCAGCTTTCCGTA G I A L S I I A E L G T S P I S S F P Y G V A I T V H A G L G T T T I S S P P A CGTTTCGAGCCTCATGAGCTCGTTTACAGTGGGGACGGGGACCATCGCGATGAACGCGGC V S S L M S S F T V G T G T I A M N A A V L A A A T S Y S L G T W T V V V N V I GTTCATGGTCTTGCAGATGATCCTCTTGCGAAAGCACTACGATCCAAGGCAACTCGTTTA F M V L Q M I L L R K H Y D P R Q L V * I M I I T A L I L G R N Y R A T M L W Q GCTTCCGGCGGCCATCGTCATGGGGCTGTTGTGCGACGTGTTCCTGCATCTCCTGCGGGG L P A A I V M G L L C D V F L H L L R G L P I S I L F G V M C D V S L W L T R W CCTTGGGTATTCCAACTACACCGAGCAGTGGCTCCTGTGTGCGCTGGGGATTCTCCTCGT L G Y S N Y T E Q W L L C A L G I L L V V D P Q N Y L V A W V L V V L G T M M V CGCTTTCGGCGTGTCTGTAGCTGTGACGAGTCGGGTGATCGTGATGGCGGGCGATGGGCT A F G V S V A V T S R V I V M A G D G L A L G I V M Q L L G Q I A F M P G E A I CGCCCTTGCCATCTCCGTTACCCTGAACCGTGCCTTCGGGCCGCGGCGGTGGAGGGAGTT A L A I S V T L N R A E F V Q A L N T K L T T L --------------------- D F TGGTACGTGCAAGATCGCGGTAGACACGTCCCTCGTCATCATCGCGTCGGTGCTGTCGCT G T C K I A V D T S L V I I A S V L S L G A C K Q I V D W T L V G I A V I I S L GGCGGTATTGGGGAGCCTCGAGGGCGTTCGTGAGGGGACACTGGCCGCGGCGCTTCTCGT A V L G S L E G V R E G T L A A A L L V V T M G G L V G V R E G T V F A A F G I CGGGTTCTTTGCCAAGTACTTCGTGCGC-TGGCTCGAGCCGGTGCAAAAATGGCTCTAG G F F A K Y F V R W L E P V Q K W G F F V R L W Q N L Y L K G I R K D ------ // >fig|6666666.67496.peg.417 fig|196164.1.peg.286 FIG146518: Zn-dependent hydrolases, including glyoxylases FIG013561 gi|512068193|gb|ATBY01000017.1|_430651_430613,gi|512068193|gb|ATBY01000017.1|_430609_429797 MDAPVEIELIVEFxGSTMQHPAYSLLRPVTENIGVVLCPNAGYSSLEGTNSWVVRAPGDPNSIVIDPGPHDEGHLNVLQSKADHVALILLTHRHQDHAGGAERFAQMTGAPVRSLDPRYCVDGSPLVDEEIIDIDGVTPRVEVVATPGHTAHSTCFFVHGTDDKVEGIITGDTIVGRHTSMISETDGDLAQYLQSLHMLVERGKGIPLLPGHGPDHPDTADLAARYIERREYRLKQVREALKVLGPDAKVRDIVDRVYDNVDPVLRDNAEQSTRVTLRYIHEHD We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGACGCGCCCGTTGAAATCGAACTCATCGTGGAATTTTAAGGGTCAACGATGCAACAT M D A P V E I E L I V E F * G S T M Q H M D A P V E I E L I V E F X G S T M Q H CCTGCTTACAGTCTGCTTCGCCCGGTGACGGAAAACATCGGCGTAGTCCTGTGCCCCAAC P A Y S L L R P V T E N I G V V L C P N P A Y S L L R P V T E N I G V V L C P N GCCGGGTACTCCTCCCTGGAAGGCACGAACTCGTGGGTGGTACGCGCGCCGGGTGACCCG A G Y S S L E G T N S W V V R A P G D P A G Y S S L E G T N S W V V R A P G D P AACTCCATCGTCATCGATCCTGGCCCACATGACGAGGGCCACCTCAACGTCCTGCAATCC N S I V I D P G P H D E G H L N V L Q S N S I V I D P G P H D E G H L N V L Q S AAGGCGGACCACGTGGCGCTCATCCTGCTCACCCACCGTCACCAGGACCACGCCGGCGGC K A D H V A L I L L T H R H Q D H A G G K A D H V A L I L L T H R H Q D H A G G GCGGAGCGCTTCGCCCAGATGACTGGGGCCCCGGTTCGCTCTCTGGACCCCCGTTACTGT A E R F A Q M T G A P V R S L D P R Y C A E R F A Q M T G A P V R S L D P R Y C GTCGACGGTTCTCCGCTTGTCGACGAAGAGATCATCGACATCGACGGAGTCACCCCGCGC V D G S P L V D E E I I D I D G V T P R V D G S P L V D E E I I D I D G V T P R GTGGAAGTGGTTGCCACCCCGGGCCATACCGCGCACTCGACGTGCTTCTTCGTCCACGGC V E V V A T P G H T A H S T C F F V H G V E V V A T P G H T A H S T C F F V H G ACGGATGACAAGGTGGAGGGCATCATCACCGGCGACACGATCGTCGGCCGCCACACCTCG T D D K V E G I I T G D T I V G R H T S T D D K V E G I I T G D T I V G R H T S ATGATCTCCGAGACGGACGGCGACTTGGCCCAGTACCTTCAGTCGCTGCACATGCTCGTC M I S E T D G D L A Q Y L Q S L H M L V M I S E T D G D L A Q Y L Q S L H M L V GAGCGAGGCAAGGGCATTCCCCTGCTGCCCGGCCACGGCCCGGATCACCCGGACACCGCC E R G K G I P L L P G H G P D H P D T A E R G K G I P L L P G H G P D H P D T A GATCTTGCGGCGCGCTACATTGAGCGGCGCGAGTATCGCCTCAAGCAGGTCCGCGAGGCC D L A A R Y I E R R E Y R L K Q V R E A D L A A R Y I E R R E Y R L K Q V R E A CTGAAGGTTCTCGGCCCGGATGCGAAGGTACGCGACATCGTGGATCGTGTGTACGACAAC L K V L G P D A K V R D I V D R V Y D N L K V L G P D A K V R D I V D R V Y D N GTCGACCCGGTGCTCCGCGATAACGCCGAGCAGTCCACCCGCGTGACGCTGCGTTACATT V D P V L R D N A E Q S T R V T L R Y I V D P V L R D N A E Q S T R V T L R Y I CATGAGCACGATTAG H E H D H E H D --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.286): ATGGACGCGCCCGTTGAAATCGAACTCATCGTGGAATTTTAAGGGTCAACGATGCAACAT M D A P V E I E L I V E F * G S T M Q H M S L P G S T K V I M G A K L N L M E H CCTGCTTACAGTCTGCTTCGCCCGGTGACGGAAAACATCGGCGTAGTCCTGTGCCCCAAC P A Y S L L R P V T E N I G V V L C P N P A Y S Q L R P V T P S A S V V L C P N GCCGGGTACTCCTCCCTGGAAGGCACGAACTCGTGGGTGGTACGCGCGCCGGGTGACCCG A G Y S S L E G T N S W V V R A P G D P P G Y S S L E G T N S W I I R A S E D S AACTCCATCGTCATCGATCCTGGCCCACATGACGAGGGCCACCTCAACGTCCTGCAATCC N S I V I D P G P H D E G H L N V L Q S R S I V I D P G P E D E G H L N V L N A AAGGCGGACCACGTGGCGCTCATCCTGCTCACCCACCGTCACCAGGACCACGCCGGCGGC K A D H V A L I L L T H R H Q D H A G G K G E E V G L I L L T H R H H D H A D G GCGGAGCGCTTCGCCCAGATGACTGGGGCCCCGGTTCGCTCTCTGGACCCCCGTTACTGT A E R F A Q M T G A P V R S L D P R Y C A T R F R Q L T G A P I R A F D P S Y C GTCGACGGTTCTCCGCTTGTCGACGAAGAGATCATCGACATCGACGGAGTCACCCCGCGC V D G S P L V D E E I I D I D G V T P R E K A G E L V D G E I I T I D G V T P Q GTGGAAGTGGTTGCCACCCCGGGCCATACCGCGCACTCGACGTGCTTCTTCGTC-CACGG V E V V A T P G H T A H S T C F F V H G I E V V A T P G H T R D S V S F F I W S G CACG--GATGACAAGGTGGAGGGCATCATCACCGGCGACACGATCGTCGGCCGCCACACC T D D K V E G I I T G D T I V G R H T T PH E S T L E G I V T G D T I A G R H T TCGATGATCTCCGAGACGGACGGCGACTTGGCCCAGTACCTTCAGTCGCTGCACATGCTC S M I S E T D G D L A Q Y L Q S L H M L T M I S E T D G D L G Q Y L E S L A I L GTCGAGCGAGGCAAGGGCATTCCCCTGCTGCCCGGCCACGGCCCGGATCACCCGGACACC V E R G K G I P L L P G H G P D H P D T E E R G K D I T L L P G H G P E G D D V GCCGATCTTGCGGCGCGCTACATTGAGCGGCGCGAGTATCGCCTCAAGCAGGTCCGCGAG A D L A A R Y I E R R E Y R L K Q V R E S W F A R K Y I D R R E Q R L E Q I R G GCCCTGAAGGTTCTCGGCCCGGATGCGAAGGTACGCGACATCGTGGATCGTGTGTACGAC A L K V L G P D A K V R D I V D R V Y D V W A T Q G R E V S M K D L I D A I Y D AACGTCGACCCGGTGCTCCGCGATAACGCCGAGCAGTCCACCCGCGTGACGCTGCGTTAC N V D P V L R D N A E Q S T R V T L R Y D V D P V L R G A A E Q S T H V A I R Y ATTCATGAGCACGATTAG-------------- I H E H D * L L A Q E R EESGRNSAVDTGQI // >fig|6666666.67496.peg.902 fig|196627.4.peg.2964 putative helicase gi|512068965|gb|ATBY01000015.1|_343415_344104,gi|512068965|gb|ATBY01000015.1|_344104_348345 MSTFREALAQLRENQPKAKYGIGFEKLMVNFLKTDPLLSSEYDEVFRWTDWRYANGPDTGIDLVARRREDHSWTAIQCKFYEEKTYLQKSAIDSFFEDSGRSFETENGKEHFKNRLIIATTDRWSHNAEDALKDQLIPCQRIGLNDIAQSPLDWDVVFPGSQMRVNLTRKEPFTPRKHQQEAIDKTLQGFESHDRGKLIMACGTGKTFTSLRLAEAYANRRGGAALVCYxxVPSISLLSQTLKEWTAQSTVELRSYAVCSDAKVGKKAEDIAAYDVEIPVSTNGEEIAACLNAGGKRASGLHVVFSTYQSLPAVHSAQEHGLDPFDLVICDEAHRTTGVTLAGEDASNFVRIHDASYIKANKRLYMTATPRLFDDHVKGKAAEHSAELASMDDEAIYGPEFHRLGFGEAVEKGLLTDYKVLVMTVDEDVAAEVMGRGGTEGINLTLASSMIGAWNGLAKRSGREQGKKYGFDEAAEPMHRAVAFAKDIKTSKAIAEQYPALIHHYQDTLREAAALNDVDLLNVDLDIEVDHVDGTMNAMERAEKLTWLQSAQDAQDTEVTRVLTNARCLSEGVDVPALDSVIFFHPRNSMVDVVQSVGRVMRKAEGKDYGYIILPVAVPPNMSPSAALNDNTRFKVVWQILNALRAHDDRFNAKVNSIALNGGNVEKLPIETGHVGDPRKELDKTDTKSPEAYLDTDNTAQQIALFSLEKWEEALYVKLVDKVGTRTYWEDWAGDVASIAQAQITRINALLETANPTLRREFDAFVEGLRGNLNDSITEQQAVEMLSQHLITAPVFNALFTEYDFAAHNPVAQVMQRMADALSDANLESETDSLEKFYESVRVRAAEVSSASGKQQVIKELYERFFQKAFKRDADKLGIVYTPVEIVDFILRAANDVSVTHFGKGLTDEGVCILDPFAGTSTFMVRLLQSGLIKPDDMARKYAGELFATEIMLLAYYVSAVNIETTYNALRAAEAQRNGDPEPDYVPFDGIALADTFQIHEKGDTPDLGFFVDNNDRIERQKKARINVIVGNPPYSVGQTSANDNNANMKYKTLDSRIAATYAAKSTGTNKNSLYDSYLRAFRWATDRIKDQGVVAFVSNNGWLDGNTSDGVRLSLAEDFTDVYVYNFRGNSRMAGEQAKREGGNIFDIRVGVAVFIGVKDPNQSGFTLHYAQTPDYQKREEKLEAAEKTSIEQIEWQTITPNKHGDWLNKRSDEFATWPVIGEKKDKVTRFFATHSRGLSTARDAWAYNSSKEKLLSNIDIHITNYNEAQVLLKNSGTGVDELFTSHPELVDSKKGSWSVNLKQELARGTEVTKRPERVYTSLYRPFFKQRGYFAKEFNDRRYQLPSMFPTRQHPNIGFMQPTVGAVKPYCVFATRILPDLNFYGSEGTQFFTRFTWKLVESTDGGLFAEGATVGEGETSIYGQVGEVVDGYVREDNITPDIKKLYWDALGADITGDDIFHFVYGKLHDPAYREMYKADLKKMLPHIETPGSRKEFDKFARAGKKLMDLHVGYEDVDPFPLNIQVKGDESDRETWRVVKMKWAKKKDPETGKNVNDVTKLIYNKRVTICGIPAEADEYMLGARSAVAWLIDRYQVKKDKASGIVNDPNDWAEEVGNPRYIVDLIGKVVRVAMETVRIVEGLR We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGTCCACGTTTAGAGAAGCCCTTGCCCAACTCCGCGAGAATCAGCCGAAGGCCAAGTAT M S T F R E A L A Q L R E N Q P K A K Y M S T F R E A L A Q L R E N Q P K A K Y GGCATCGGTTTTGAGAAGTTGATGGTGAACTTCCTCAAGACGGATCCGTTGCTGTCGTCG G I G F E K L M V N F L K T D P L L S S G I G F E K L M V N F L K T D P L L S S GAGTATGACGAGGTCTTCCGTTGGACCGATTGGCGTTACGCGAACGGCCCGGACACCGGC E Y D E V F R W T D W R Y A N G P D T G E Y D E V F R W T D W R Y A N G P D T G ATTGACCTGGTTGCTCGCCGCCGCGAGGACCACTCGTGGACGGCGATCCAGTGCAAGTTC I D L V A R R R E D H S W T A I Q C K F I D L V A R R R E D H S W T A I Q C K F TACGAGGAGAAAACCTACCTCCAAAAGAGCGCGATCGATTCTTTCTTCGAGGATTCGGGC Y E E K T Y L Q K S A I D S F F E D S G Y E E K T Y L Q K S A I D S F F E D S G CGCAGCTTCGAAACCGAAAACGGCAAGGAGCATTTCAAAAATCGCCTGATCATCGCCACG R S F E T E N G K E H F K N R L I I A T R S F E T E N G K E H F K N R L I I A T ACGGATCGCTGGTCCCACAACGCCGAGGATGCCTTAAAAGATCAGCTCATCCCGTGCCAG T D R W S H N A E D A L K D Q L I P C Q T D R W S H N A E D A L K D Q L I P C Q CGCATTGGCCTGAATGATATTGCGCAGTCGCCGCTGGATTGGGATGTTGTCTTCCCTGGG R I G L N D I A Q S P L D W D V V F P G R I G L N D I A Q S P L D W D V V F P G TCACAGATGCGTGTGAACCTCACCCGCAAGGAGCCGTTCACTCCGCGCAAGCATCAACAG S Q M R V N L T R K E P F T P R K H Q Q S Q M R V N L T R K E P F T P R K H Q Q GAGGCGATCGATAAGACGCTGCAGGGCTTCGAATCCCATGATCGCGGCAAGCTGATCATG E A I D K T L Q G F E S H D R G K L I M E A I D K T L Q G F E S H D R G K L I M GCGTGTGGCACGGGTAAGACGTTTACGTCCCTGCGTCTTGCAGAAGCCTACGCAAATCGG A C G T G K T F T S L R L A E A Y A N R A C G T G K T F T S L R L A E A Y A N R CGGGGGGGGGCCGCGCTCGTGTGCTAT*TC*CTCGTCCCGTCCATTTCTCTCCTTTCGCA R G G A A L V C Y L V P S I S L L S Q R G G A A L V C Y *X** X V P S I S L L S Q AACACTGAAGGAGTGGACGGCGCAGTCCACTGTTGAGCTTCGTTCCTATGCGGTGTGTTC T L K E W T A Q S T V E L R S Y A V C S T L K E W T A Q S T V E L R S Y A V C S GGATGCGAAGGTCGGCAAGAAGGCGGAGGATATCGCTGCCTATGATGTGGAGATTCCTGT D A K V G K K A E D I A A Y D V E I P V D A K V G K K A E D I A A Y D V E I P V TTCCACTAATGGTGAGGAGATCGCCGCGTGCCTGAACGCTGGCGGCAAGCGCGCCTCTGG S T N G E E I A A C L N A G G K R A S G S T N G E E I A A C L N A G G K R A S G CCTGCACGTTGTCTTTTCCACCTACCAGTCGCTGCCCGCGGTCCACAGCGCCCAGGAGCA L H V V F S T Y Q S L P A V H S A Q E H L H V V F S T Y Q S L P A V H S A Q E H CGGTCTCGACCCCTTTGATCTGGTTATTTGTGATGAGGCGCACCGTACCACGGGTGTCAC G L D P F D L V I C D E A H R T T G V T G L D P F D L V I C D E A H R T T G V T GCTGGCGGGGGAGGATGCGTCCAACTTCGTCCGTATCCACGATGCTAGCTATATCAAGGC L A G E D A S N F V R I H D A S Y I K A L A G E D A S N F V R I H D A S Y I K A CAACAAGCGCCTGTACATGACGGCTACTCCTCGGCTTTTCGACGACCACGTGAAGGGCAA N K R L Y M T A T P R L F D D H V K G K N K R L Y M T A T P R L F D D H V K G K AGCTGCAGAACACTCGGCAGAGCTCGCCTCCATGGATGACGAGGCCATCTACGGCCCAGA A A E H S A E L A S M D D E A I Y G P E A A E H S A E L A S M D D E A I Y G P E GTTCCACCGCCTGGGCTTCGGCGAGGCGGTGGAAAAGGGTCTGCTCACCGATTACAAGGT F H R L G F G E A V E K G L L T D Y K V F H R L G F G E A V E K G L L T D Y K V CCTCGTCATGACGGTGGATGAGGATGTTGCCGCTGAGGTCATGGGCCGTGGTGGCACGGA L V M T V D E D V A A E V M G R G G T E L V M T V D E D V A A E V M G R G G T E GGGCATTAATCTCACTCTTGCCTCGTCCATGATCGGTGCGTGGAATGGTCTCGCCAAGCG G I N L T L A S S M I G A W N G L A K R G I N L T L A S S M I G A W N G L A K R CTCGGGCAGGGAGCAGGGCAAGAAATACGGTTTCGACGAAGCAGCAGAGCCGATGCACCG S G R E Q G K K Y G F D E A A E P M H R S G R E Q G K K Y G F D E A A E P M H R CGCCGTGGCTTTCGCCAAGGACATTAAGACGTCGAAGGCGATTGCGGAGCAGTATCCGGC A V A F A K D I K T S K A I A E Q Y P A A V A F A K D I K T S K A I A E Q Y P A GCTCATCCACCATTACCAGGACACCCTCCGCGAGGCAGCAGCTCTTAACGATGTCGACCT L I H H Y Q D T L R E A A A L N D V D L L I H H Y Q D T L R E A A A L N D V D L TCTCAACGTCGATCTGGACATCGAGGTCGACCACGTCGACGGCACAATGAACGCCATGGA L N V D L D I E V D H V D G T M N A M E L N V D L D I E V D H V D G T M N A M E GCGCGCCGAGAAGCTCACCTGGCTCCAGTCCGCCCAGGATGCACAGGATACGGAGGTCAC R A E K L T W L Q S A Q D A Q D T E V T R A E K L T W L Q S A Q D A Q D T E V T CCGCGTCCTCACTAACGCCCGCTGCCTTTCCGAGGGCGTCGACGTTCCCGCCCTGGATTC R V L T N A R C L S E G V D V P A L D S R V L T N A R C L S E G V D V P A L D S GGTGATTTTCTTCCATCCGCGTAACTCCATGGTTGACGTGGTCCAATCCGTCGGCCGTGT V I F F H P R N S M V D V V Q S V G R V V I F F H P R N S M V D V V Q S V G R V GATGCGTAAGGCGGAGGGCAAGGATTACGGCTACATCATCCTCCCGGTGGCGGTTCCGCC M R K A E G K D Y G Y I I L P V A V P P M R K A E G K D Y G Y I I L P V A V P P GAATATGTCCCCGTCGGCAGCCTTGAACGATAACACGCGTTTCAAGGTTGTCTGGCAGAT N M S P S A A L N D N T R F K V V W Q I N M S P S A A L N D N T R F K V V W Q I CCTCAACGCGCTGCGCGCCCACGACGATCGTTTCAACGCGAAGGTCAACTCCATCGCCCT L N A L R A H D D R F N A K V N S I A L L N A L R A H D D R F N A K V N S I A L TAACGGCGGCAACGTTGAGAAGCTCCCGATCGAGACCGGCCACGTCGGTGACCCGCGCAA N G G N V E K L P I E T G H V G D P R K N G G N V E K L P I E T G H V G D P R K GGAGCTTGACAAGACGGATACGAAGAGTCCGGAGGCGTACCTGGACACTGATAACACCGC E L D K T D T K S P E A Y L D T D N T A E L D K T D T K S P E A Y L D T D N T A CCAGCAGATCGCCCTCTTCTCCCTGGAAAAGTGGGAGGAGGCCCTCTACGTCAAGCTCGT Q Q I A L F S L E K W E E A L Y V K L V Q Q I A L F S L E K W E E A L Y V K L V CGACAAGGTCGGTACCCGCACGTATTGGGAGGATTGGGCAGGCGATGTCGCCTCGATCGC D K V G T R T Y W E D W A G D V A S I A D K V G T R T Y W E D W A G D V A S I A GCAGGCGCAGATCACCCGTATCAACGCCCTCCTGGAAACCGCAAACCCAACACTCCGTCG Q A Q I T R I N A L L E T A N P T L R R Q A Q I T R I N A L L E T A N P T L R R CGAGTTCGACGCCTTTGTCGAGGGCCTGCGTGGCAACCTCAATGATTCGATCACGGAGCA E F D A F V E G L R G N L N D S I T E Q E F D A F V E G L R G N L N D S I T E Q GCAGGCAGTGGAGATGCTCTCTCAGCACCTCATCACCGCCCCGGTCTTTAATGCTCTGTT Q A V E M L S Q H L I T A P V F N A L F Q A V E M L S Q H L I T A P V F N A L F CACGGAGTACGATTTCGCCGCGCACAACCCGGTTGCTCAGGTCATGCAGCGCATGGCCGA T E Y D F A A H N P V A Q V M Q R M A D T E Y D F A A H N P V A Q V M Q R M A D CGCCCTCTCGGATGCGAACCTCGAGTCCGAGACCGATTCCCTCGAGAAGTTCTACGAGTC A L S D A N L E S E T D S L E K F Y E S A L S D A N L E S E T D S L E K F Y E S GGTCCGCGTCCGCGCCGCCGAAGTCTCGAGCGCCTCCGGTAAACAGCAGGTCATCAAGGA V R V R A A E V S S A S G K Q Q V I K E V R V R A A E V S S A S G K Q Q V I K E GCTATACGAGCGCTTCTTCCAAAAGGCCTTCAAACGCGATGCGGATAAGCTCGGTATCGT L Y E R F F Q K A F K R D A D K L G I V L Y E R F F Q K A F K R D A D K L G I V CTACACCCCGGTAGAAATCGTTGATTTCATCCTCCGCGCCGCCAACGACGTCTCGGTCAC Y T P V E I V D F I L R A A N D V S V T Y T P V E I V D F I L R A A N D V S V T CCACTTCGGTAAGGGGCTAACCGACGAAGGGGTCTGCATCCTTGACCCGTTCGCCGGCAC H F G K G L T D E G V C I L D P F A G T H F G K G L T D E G V C I L D P F A G T CTCCACGTTCATGGTTCGTTTGCTCCAGTCTGGCCTCATCAAACCGGACGACATGGCCCG S T F M V R L L Q S G L I K P D D M A R S T F M V R L L Q S G L I K P D D M A R CAAGTACGCCGGCGAGCTCTTCGCCACGGAAATCATGCTCCTCGCGTACTACGTCTCCGC K Y A G E L F A T E I M L L A Y Y V S A K Y A G E L F A T E I M L L A Y Y V S A CGTCAACATCGAGACCACCTACAACGCCCTCCGCGCCGCCGAAGCCCAGCGCAACGGCGA V N I E T T Y N A L R A A E A Q R N G D V N I E T T Y N A L R A A E A Q R N G D CCCCGAACCGGACTACGTCCCCTTTGATGGCATCGCCCTTGCCGATACTTTCCAGATCCA P E P D Y V P F D G I A L A D T F Q I H P E P D Y V P F D G I A L A D T F Q I H CGAAAAAGGCGACACGCCTGATCTCGGCTTCTTCGTCGACAATAATGATCGCATAGAACG E K G D T P D L G F F V D N N D R I E R E K G D T P D L G F F V D N N D R I E R GCAAAAGAAAGCCAGGATCAACGTCATTGTCGGCAACCCGCCTTACTCGGTGGGACAGAC Q K K A R I N V I V G N P P Y S V G Q T Q K K A R I N V I V G N P P Y S V G Q T CAGTGCGAATGACAACAATGCGAACATGAAGTACAAGACGTTGGATTCCCGCATTGCTGC S A N D N N A N M K Y K T L D S R I A A S A N D N N A N M K Y K T L D S R I A A AACCTACGCTGCGAAATCTACAGGTACGAACAAGAATTCACTCTATGATTCGTATCTTCG T Y A A K S T G T N K N S L Y D S Y L R T Y A A K S T G T N K N S L Y D S Y L R CGCCTTCCGGTGGGCCACGGACCGCATCAAGGACCAGGGCGTGGTGGCTTTTGTCTCAAA A F R W A T D R I K D Q G V V A F V S N A F R W A T D R I K D Q G V V A F V S N TAATGGTTGGTTGGACGGCAATACGAGTGACGGTGTGCGTCTTTCACTAGCTGAGGATTT N G W L D G N T S D G V R L S L A E D F N G W L D G N T S D G V R L S L A E D F TACTGACGTTTACGTCTACAATTTCCGAGGCAATTCCCGCATGGCAGGGGAGCAGGCGAA T D V Y V Y N F R G N S R M A G E Q A K T D V Y V Y N F R G N S R M A G E Q A K GCGGGAAGGCGGAAACATTTTCGATATTCGCGTCGGAGTTGCCGTATTCATCGGTGTGAA R E G G N I F D I R V G V A V F I G V K R E G G N I F D I R V G V A V F I G V K GGATCCGAACCAATCCGGGTTCACGTTGCACTACGCCCAAACACCGGACTATCAAAAGCG D P N Q S G F T L H Y A Q T P D Y Q K R D P N Q S G F T L H Y A Q T P D Y Q K R AGAGGAGAAACTCGAAGCTGCTGAGAAAACCAGCATCGAGCAAATCGAGTGGCAGACGAT E E K L E A A E K T S I E Q I E W Q T I E E K L E A A E K T S I E Q I E W Q T I CACCCCGAATAAACACGGTGATTGGTTAAATAAGCGCAGTGACGAGTTCGCCACGTGGCC T P N K H G D W L N K R S D E F A T W P T P N K H G D W L N K R S D E F A T W P AGTCATAGGGGAGAAGAAGGATAAGGTAACCAGGTTCTTTGCAACGCATTCTCGTGGTTT V I G E K K D K V T R F F A T H S R G L V I G E K K D K V T R F F A T H S R G L ATCTACCGCTCGCGATGCTTGGGCTTACAACTCTTCAAAGGAAAAACTCCTCTCTAATAT S T A R D A W A Y N S S K E K L L S N I S T A R D A W A Y N S S K E K L L S N I CGATATCCACATCACAAACTACAACGAGGCGCAGGTATTACTGAAAAATTCCGGAACAGG D I H I T N Y N E A Q V L L K N S G T G D I H I T N Y N E A Q V L L K N S G T G TGTGGATGAACTCTTTACGTCTCACCCGGAGCTGGTCGATTCTAAAAAGGGGTCGTGGAG V D E L F T S H P E L V D S K K G S W S V D E L F T S H P E L V D S K K G S W S TGTGAATCTGAAACAAGAATTGGCTCGTGGTACCGAAGTCACTAAAAGACCAGAGCGTGT V N L K Q E L A R G T E V T K R P E R V V N L K Q E L A R G T E V T K R P E R V CTACACTTCGCTTTATCGCCCGTTCTTCAAGCAACGTGGTTATTTCGCAAAAGAATTCAA Y T S L Y R P F F K Q R G Y F A K E F N Y T S L Y R P F F K Q R G Y F A K E F N CGATAGGAGATATCAGCTGCCGTCGATGTTTCCAACTCGACAGCATCCCAACATTGGTTT D R R Y Q L P S M F P T R Q H P N I G F D R R Y Q L P S M F P T R Q H P N I G F CATGCAACCAACTGTAGGGGCAGTTAAGCCTTATTGTGTTTTCGCGACAAGGATTCTGCC M Q P T V G A V K P Y C V F A T R I L P M Q P T V G A V K P Y C V F A T R I L P AGACCTGAATTTTTATGGATCGGAGGGCACACAATTCTTCACCCGCTTCACATGGAAGCT D L N F Y G S E G T Q F F T R F T W K L D L N F Y G S E G T Q F F T R F T W K L TGTCGAGTCCACCGATGGTGGCCTCTTCGCCGAAGGCGCGACGGTAGGGGAGGGGGAGAC V E S T D G G L F A E G A T V G E G E T V E S T D G G L F A E G A T V G E G E T CTCCATCTACGGCCAGGTTGGTGAGGTTGTTGACGGGTATGTCCGTGAGGACAACATTAC S I Y G Q V G E V V D G Y V R E D N I T S I Y G Q V G E V V D G Y V R E D N I T GCCAGATATCAAAAAGCTGTACTGGGATGCGCTTGGTGCGGATATCACGGGCGATGACAT P D I K K L Y W D A L G A D I T G D D I P D I K K L Y W D A L G A D I T G D D I CTTCCACTTTGTGTACGGCAAGCTGCACGATCCGGCGTACCGGGAGATGTACAAGGCGGA F H F V Y G K L H D P A Y R E M Y K A D F H F V Y G K L H D P A Y R E M Y K A D TCTGAAGAAGATGCTGCCACACATTGAAACACCTGGTTCTCGCAAAGAGTTCGACAAGTT L K K M L P H I E T P G S R K E F D K F L K K M L P H I E T P G S R K E F D K F TGCGCGTGCGGGTAAGAAACTGATGGATCTGCACGTCGGCTATGAGGACGTGGATCCGTT A R A G K K L M D L H V G Y E D V D P F A R A G K K L M D L H V G Y E D V D P F CCCGCTGAATATCCAGGTCAAGGGTGACGAGTCCGATCGGGAGACGTGGCGCGTCGTCAA P L N I Q V K G D E S D R E T W R V V K P L N I Q V K G D E S D R E T W R V V K GATGAAGTGGGCGAAGAAGAAGGATCCGGAGACGGGTAAGAACGTAAACGATGTGACGAA M K W A K K K D P E T G K N V N D V T K M K W A K K K D P E T G K N V N D V T K GCTGATTTACAACAAGCGCGTGACAATCTGTGGTATTCCTGCGGAGGCCGACGAGTACAT L I Y N K R V T I C G I P A E A D E Y M L I Y N K R V T I C G I P A E A D E Y M GCTGGGTGCACGCTCTGCTGTGGCCTGGCTTATCGATCGTTACCAGGTCAAAAAGGACAA L G A R S A V A W L I D R Y Q V K K D K L G A R S A V A W L I D R Y Q V K K D K GGCTTCCGGAATCGTCAACGACCCGAACGATTGGGCAGAAGAGGTTGGCAACCCGCGCTA A S G I V N D P N D W A E E V G N P R Y A S G I V N D P N D W A E E V G N P R Y CATCGTGGACCTTATCGGAAAGGTTGTGCGCGTAGCTATGGAGACCGTGCGAATCGTTGA I V D L I G K V V R V A M E T V R I V E I V D L I G K V V R V A M E T V R I V E AGGGTTGAGGTAG G L R G L R --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.2964): ATGTCCACGTTTAGAGAAGCCCTTGCCCAACTCCGCGAGAATCAGCCGAAGGCCAAGTAT M S T F R E A L A Q L R E N Q P K A K Y M S T I T D A V S A L R T L P S Q S A Q GGCATCGGTTTTGAGAAGTTGATGGTGAACTTCCTCAAGACGGATCCGTTGCTGTCGTCG G I G F E K L M V N F L K T D P L L S S G L A F E K L M V N F I K S D P T L S T GAGTATGACGAGGTCTTCCGTTGGACCGATTGGCGTTACGCGAACGGCCCG-GACACCGG E Y D E V F R W T D W R Y A N G P D T G E F D E V H R W V D W P Y N G G T M D T G CATTGACCTGGTTGCTCGCCGCCGCGAGGACCACTCGTGGACGGCGATCCAGTGCAAGTT I D L V A R R R E D H S W T A I Q C K F I D L V A Y N K D D D A Y T A I Q C K F CTACGAGGAGAAAACCTACCTCCAAAAGAGCGCGATCGATTCTTTCTTCGAGGATTCGGG Y E E K T Y L Q K S A I D S F F E D S G Y L P T T S L A K G Q L D S F F E A S G CCGCAGCTTCGAAACCGAAAACGGCAAGGAGCATTTCAAAAATCGCCTGATCATCGCCAC R S F E T E N G K E H F K N R L I I A T R T F E T P E G T R S F S N R L V I S T GACGGATCGCTGGTCCCACAACGCCGAGGATGCCTTAAAAGATCAGCTCATCCCGTGCCA T D R W S H N A E D A L K D Q L I P C Q T D K W S S N A E K M L E N Q T I P T N GCGCATTGGCCTGAATGATATTGCGCAGTCGCCGCTGGATTGGGATGTTGTCTTCCCTGG R I G L N D I A Q S P L D W D V V F P G R I G L S A I A E S P I D W D I A Y P G GTCACAGATGCGTGTGAACCTCACCCGCAAGGAGCCGTTCACTCCGCGCAAGCATCAACA S Q M R V N L T R K E P F T P R K H Q Q S E L T I N L Q L K E P Y S P R P H Q Q GGAGGCGATCGATAAGACGCTGCAGGGCTTCGAATCCCATGATCGCGGCAAGCTGATCAT E A I D K T L Q G F E S H D R G K L I M T A I E K A I E G F Q T H D R G K L I M GGCGTGTGGCACGGGTAAGACGTTTACGTCCCTGCGTCTTGCAGAAGCCTACGCAAATCG A C G T G K T F T S L R L A E A Y A N A C G T G K T F T A L R L S E E V A R -- GCGGGGGGGGGCCGCGCTCGTGTGCTATTCCTCGTCCCGTCCATTTCTCTCCTTTCGCAA A G G G R A R V L F L V P S I S L L S Q L N G N K A R I L F L V P S I S L L S Q ACACTGAAGGAGTGGACGGCGCAGTCCACTGTTGAGCTTCGTTCCTATGCGGTGTGTTCG T L K E W T A Q S T V E L R S Y A V C S T L K E W T A Q K T M D L R P V A V C S GATGCGAAGGTCGGCAAGAAGGCGGAGGATATCGCTGCCTATGATGTGGAGATTCCTGTT D A K V G K K A E D I A A Y D V E I P V D S K V S K A A E D I A A Y D L E V P V TCCACTAATGGTGAGGAGATCGCCGCGTGCCTGAACGCTGGCGGCAAGCGCGCCTCTGGC S T N G E E I A A C L N A G K R A S G S T D G A L I A E K L E H R --- K R A A G CTGCACGTTGTCTTTTCCACCTACCAGTCGCTGCCCGCGGTCCACAGCGCCCAGGAGCAC L H V V F S T Y Q S L P A V H S A Q E H L T V V F S T Y Q S L P A V H A A Q E A GGTCTCGACCCCTTTGATCTGGTTATTTGTGATGAGGCGCACCGTACCACGGGTGTCACG G L D P F D L V I C D E A H R T T G V T G A E P F D L V I C D E A H R T T G I T CTGGCGGGGGAGGATGCGTCCAACTTCGTCCGTATCCACGATGCTAGCTATATCAAGGCC L A G E D A S N F V R I H D A S Y I K A L A G E D P S N F T R I H D A S Y I K A AACAAGCGCCTGTACATGACGGCTACTCCTCGGCTTTTCGACGACCACGTGAAGGGCAAA N K R L Y M T A T P R L F D D H V K G K A K R L Y M T A T P R L F D D S V K G K GCTGCAGAACACTCGGCAGAGCTCGCCTCCATGGATGACGAGGCCATCTACGGCCCAGAG A A E H S A E L A S M D D E A I Y G P E A A D H S A E V S S M D D E A I Y G P E TTCCACCGCCTGGGCTTCGGCGAGGCGGTGGAAAAGGGTCTGCTCACCGATTACAAGGTC F H R L G F G E A V E K G L L T D Y K V F H R L G F G E A V E K G L L T D Y K V CTCGTCATGACGGTGGATGAGGATGTTGCCGCTGAG---GTCATGGGCCGTGGTGGCACG L V M T V D E D V A A E V M G R G G T V V M T V D E Q V A A S ALT V L G S T P G GAGGGCATTAATCTCACTCTTGCCTCGTCCATGATCGGTGCGTGGAATGGTCTCGCCAAG E G I N L T L A S S M I G A W N G L A K E E L T L D M T S A I I G A W N G L A K CGCTCGGGCAGGGAGCAGGGCAAGAAATACGGTTTCGACGAAGCAGCAGAGCCGATGCAC R S G R E Q G K K Y G F D E A A E P M H R S G K E Q D T K T G F S S S D A A M E CGCGCCGTGGCTTTCGCCAAGGACATTAAGACGTCGAAGGCGATTGCGGAGCAGTATCCG R A V A F A K D I K T S K A I A E Q Y P R A V A F A R D I K T S Q Q I A E S F P GCGCTCATCCACCATTACCAGGACACCCTCCGCGAGGCAGCAGCTCTTAACGATGTCGAC A L I H H Y Q D T L R E A A N D V D R V V N A Y T T E L E V K N ------ D D V D CTTCTCAACGTCGATCTGGACATCGAGGTCGACCACGTCGACGGCACAATGAACGCCATG L L N V D L D I E V D H V D G T M N A M E H N L N L S V A C Q H V D G S M N A L GAGCGCGCCGAGAAGCTCACCTGGCTCCAGTCCGCCCAGGATGCACAGGATACGGAGGTC E R A E K L T W L Q S P A Q D T E E R N S R L T W L K A - P ----- T Q S M E --- ACCCGCGTCCTCACTAACGCCCGCTGCCTTTCCGAGGGCGTCGACGTTCCCGCCCTGGAT T R V L T N A R C L S E G V D V P A L D T K I L T N A R C L S E G V D V P A L D TCGGTGATTTTCTTCCATCCGCGTAACTCCATGGTTGACGTGGTCCAATCCGTCGGCCGT S V I F F H P R N S M V D V V Q S V G R S V I F F N P R N S M V D V V Q S V G R GTGATGCGTAAGGCGGAGGGCAAGGATTACGGCTACATCATCCTCCCGGTGGCGGTTCCG V M R K A E G K D Y G Y I I L P V A V P V M R K S P G K N Y G Y I I L P V A V P CCGAATATGTCCCCGTCGGCAGCCTTGAACGATAACACGCGTTTCAAGGTTGTCTGGCAG P N M S P S A A L N D N T R F K V V W Q P G V A P S A A L N D S R R F K V V W Q ATCCTCAACGCGCTGCGCGCCCACGACGATCGTTTCAACGCGAAGGTCAACTCCATCGCC I L N A L R A H D D R F N A K V N S I A V L N A L R A H D D R F N A M V N S I A CTTAACGGCGGCAACGTTGAGAAGCTCCCGATCGAGACCGGCCACGTCGGTGACCCGCGC L N G G N V E K L P I E T G H V G D P R L N E G N I K D L P V E T E H T G P T S AAGGAGCTTGACAAGACGGATACGAAGAGTCCGGAGGCGTACCTGGACACTGATAACACC K E L D K A Y L D T D N T K D R D N --------------------- A P Y D S A E S GCCCAGCAGATCGCCCTCTTCTCCCTGGAAAAGTGGGAGGAGGCCCTCTACGTCAAGCTC A Q Q I A L F S L E K W E E A L Y V K L A T Q Y V L F S L E Q W Q E A I Y T K L GTCGACAAGGTCGGTACCCGCACGTATTGGGAGGATTGGGCAGGCGATGTCGCCTCGATC V D K V G T R T Y W E D W A G D V A S I V D K V G T R T Y W E D W A D D V A D I GCGCAGGCGCAGATCACCCGTATCAACGCCCTCCTGGAAACCGCAAACCCAACACTCCGT A Q A Q I T R I N A L L E T A N P T L R A Q A Q I T R I K A L L D N A S P T I K CGCGAGTTCGACGCCTTTGTCGAGGGCCTGCGTGGCAACCTCAATGATTCGATCACGGAG R E F D A F V E G L R G N L N D S I T E E E F E R F V E G L R G N L N E S I S D CAGCAGGCAGTGGAGATGCTCTCTCAGCACCTCATCACCGCCCCGGTCTTTAATGCTCTG Q Q A V E M L S Q H L I T A P V F N A L D E A I S M L S Q H L I T A P V F D A L TTCACGGAGTACGATTTCGCCGCGCACAACCCGGTTGCTCAGGTCATGCAGCGCATGGCC F T E Y D F A A H N P V A Q V M Q R M A F A E S S F A K Q N P V S Q V M Q R M A GACGCCCTCTCGGATGCGAACCTCGAGTCCGAGACCGATTCCCTCGAGAAGTTCTACGAG D A L S D A N L E S E T D S L E K F Y E D A L N S A E L N S E T E K L E K F Y D TCGGTCCGCGTCCGCGCCGCCGAAGTCTCGAGCGCCTCCGGTAAACAGCAGGTCATCAAG S V R V R A A E V S S A S G K Q Q V I K S V R I R A A E V S S A A G K Q A V I K GAGCTATACGAGCGCTTCTTCCAAAAGGCCTTCAAACGCGATGCGGATAAGCTCGGTATC E L Y E R F F Q K A F K R D A D K L G I D L Y E R F F K K A F K K Q S E A L G I GTCTACACCCCGGTAGAAATCGTTGATTTCATCCTCCGCGCCGCCAACGACGTCTCGGTC V Y T P V E I V D F I L R A A N D V S V V Y T P V E I V D F I L R A A D D V S K ACCCACTTCGGTAAGGGGCTAACCGACGAAGGGGTCTGCATCCTTGACCCGTTCGCCGGC T H F G K G L T D E G V C I L D P F A G K H F G R G L S D K D V H V L D P F T G ACCTCCACGTTCATGGTTCGTTTGCTCCAGTCTGGCCTCATCAAACCGGACGACATGGCC T S T F M V R L L Q S G L I K P D D M A T G T F M V R L L Q S G L I K P E D L A CGCAAGTACGCCGGCGAGCTCTTCGCCACGGAAATCATGCTCCTCGCGTACTACGTCTCC R K Y A G E L F A T E I M L L A Y Y V S R K Y A N E L H A T E I M L L A Y Y V A GCCGTCAACATCGAGACCACCTACAACGCCCTCCGCGCCGCCGAAGCCCAGCGCAACGGC A V N I E T T Y N A L R A A E A Q R N G A V N I E T T Y F G L E G E R A L R N G GACCCCGAACCGGACTACGTCCCCTTTGATGGCATCGCCCTTGCCGATACTTTCCAGATC D P E P D Y V P F D G I A L A D T F Q I E D A P V Y E P F D G I V L G D T F Q M CACGAAAAAGGCGACACGCCTGATCTCGGCTTCTTCGTCGACAATAATGATCGCATAGAA H E K G D T P D L G F F V D N N D R I E Y E D D D K L D L D V F T A N N D R M E CGGCAAAAGAAAGCCAGGATCAACGTCATTGTCGGCAACCCGCCTTACTCGGTGGGACAG R Q K K A R I N V I V G N P P Y S V G Q R Q R L T P V Q V I V G N P P Y S V G Q ACCAGTGCGAATGACAACAATGCGAACATGAAGTACAAGACGTTGGATTCCCGCATTGCT T S A N D N N A N M K Y K T L D S R I A S S A N D N N A N L K Y P T L D R R I E GCAACCTACGCTGCGAAATCTACAGGTACGAACAAGAATTCACTCTATGATTCGTATCTT A T Y A A K S T G T N K N S L Y D S Y L D S Y A K Y S T A T N K N S L Y D S Y L CGCGCCTTCCGGTGGGCCACGGACCGCATCAAGGACCAGGGCGTGGTGGCTTTTGTCTCA R A F R W A T D R I K D Q G V V A F V S R A F R W A T D R I H T Q G V V A F V S AATAATGGTTGGTTGGACGGCAATACGAGTGACGGTGTGCGTCTTTCACTAGCTGAGGAT N N G W L D G N T S D G V R L S L A E D N N G W V D G N T A D G V R L S L A Q D TTTACTGACGTTTACGTCTACAATTTCCGAGGCAATTCCCGCATGGCAGGGGAGCAGGCG F T D V Y V Y N F R G N S R M A G E Q A F S E I Y V F N L R G N S R T G G D L A AAGCGGGAAGGCGGAAACATTTTCGATATTCGCGTCGGAGTTGCCGTATTCATCGGTGTG K R E G G N I F D I R V G V A V F I G V K R E G G N V F N V R V G T Q I I V A V AAGGATCCGAACCAATCCGGGTTCACGTTGCACTACGCCCAAACACCGGACTATCAAAAG K D P N Q S G F T L H Y A Q T P D Y Q K K N P Q L S G C R I L Y K D I G D N L S CGAGAGGAGAAACTCGAAGCTGCTGAGAAAACCAGCATCGAGCAAATCGAGTGGCAGACG R E E K L E A A E K T S I E Q I E W Q T A D A K L N E I A V A T I E G A E W Q T ATCACCCCGAATAAACACGGTGATTGGTTAAATAAGCGCAGTGACGAGTTCGCCACGTGG I T P N K H G D W L N K R S D E F A T W I S P N E Y G D W I S Q R S V D F D T W CCAGTCATAGGGGAGAAGAAGGATAAG-GTAACCAGGTTCTTTGCAACGCATTCTCGTGG P V I G E K K D K V T R F F A T H S R G P V L G D K K N K S A L K V F Q T F S A G TTTATCTACCGCTCGCGATGCTTGGGCTTACAACTCTTCAAAGGAAAAACTCCTCTCTAA L S T A R D A W A Y N S S K E K L L S N L K T G R D A W C Y G P T S A Q V K T N TATCGATATCCACATCACAAACTACAACGAGGCGCAGGTA-----TTACTGAAAAATTCC I D I H I T N Y N E A Q V L L K N S I T R L L E T Y E Q A Q Q RFNSW V V D N G GGAACAGGT-----GTGGATGAACTCTTTACGTCTCACCCGGAGCTGGTCGATTCTAAAA G T G V D E L F T S H P E L V D S K V T S PKEAD V N Q F L K Q N P D L A D S K AGGGGTCGTGGAGTGTGAATCTGAAACAAGAATTGGCTCGTGGTACCGAAGTCACTAAAA K G S W S V N L K Q E L A R G T E V T K K I S W D S N L K M S L S R G D T F S F GACCAGAGCGTGTCTACACTTCGCTTTATCGCCCGTTCTTCAAGCAACGTGGTTATTTCG R P E R V Y T S L Y R P F F K Q R G Y F D P S S I Q M S L Y R P F F P Q Q T Y F CAAAAGAATTCAACGATAGGAGATATCAGCTGCCGTCGATGTTTCCAACTCGACAGCATC A K E F N D R R Y Q L P S M F P T R Q H H V S L N Q R R Y Q L P S M F P T P E H CCAACATTGGTTTCATGCAACCAACTGTAGGGGCAGTTAAGCCTTATTGTGTTTTCGCGA P N I G F M Q P T V G A V K P Y C V F A D N Q G F Y I V N P G S A K P F S T L A CAAGGATTCTGCCAGACCTGAATTTTTATGGATCGGAGGGCACACAATTCTTCACCCGCT T R I L P D L N F Y G S E G T Q F F T R T N L L P D L A M W G S N A G Q F F T R TCACATGGAAGCTTGTCGAGTCCACCGATGGT------GGCCTCTTCGCCGAAGGCGCGA F T W K L V E S T D G G L F A E W T W E P I E T R E G ELDFGN G L F S T ------- CGGTAGGGGAGGGGGAGACCTCCATCTACGGCCAGGTTGGTGAGGTTGTTGACGGGTATG T S I Y G Q V G E V V D G Y ----------------- T P K K G V E G E I L D G Y TCCGTGAGGACAACATTACGCCAGATATCAAAAAGCTGTACTGGGATGCGCTTGGTGCGG V R E D N I T P D I K K L Y W D A L G A R R V D N I T D E I L K L Y Q S S L G E ATATCACGGGCGATGACATCTTCCACTTTGTGTACGGCAAGCTGCACGATCCGGCGTACC D I T G D D I F H F V Y G K L H D P A Y D V T K D D I F Y F V Y A Q L H D P A Y GGGAGATGTACAAGGCGGATCTGAAGAAGATGCTGCCACACATTGAAACACCTGGTTCTC R E M Y K A D L K K M L P H I E T P G S R E A Y A A D L K K M L P H I E T P T D GCAAAGAGTTCGACAAGTTTGCGCGTGCGGGTAAGAAACTGATGGATCTGCACGTCGGCT R K E F D K F A R A G K K L M D L H V G R A R F D H F V T A G K E L M D L H I N ATGAGGACGTGGATCCGTTCCCGCTGAATATCCAGGTCAAG--GGTGACGAGTCCGATCG Y E D V D P F P L N I Q V K G D E S D R Y E D V E P W D V E V K V K EK A D P T D R GGAGACGTGGCGCGTCGTCAAGATGAAGTGGGCGAAGAAGAAGGATCCGGAGACGGGTAA E T W R V V K M K W A K K K D P E T G K E T W R V T K M K W A K V R D P E T K K GAACGTAAACGATGTGACGAAGCTGATTTACAACAAGCGCGTGACAATCTGTGGTATTCC N V N D V T K L I Y N K R V T I C G I P L V E D H T T L I Y N S S I T I S G I P TGCGGAGGCCGACGAGTACATGCTGGGTGCACGCTCTGCTGTGGCCTGGCTTATCGATCG A E A D E Y M L G A R S A V A W L I D R E E A E N Y Q L G S R S A I A W L I D R TTACCAGGTCAAAAAGGACAAGGCTTCCGGAATCGTCAACGACCCGAACGATTGGGCAGA Y Q V K K D K A S G I V N D P N D W A E Y Q V K K D K A S G I V N D P N D W A D AGAGGTTGGCAACCCGCGCTACATCGTGGACCTTATCGGAAAGGTTGTGCGCGTAGCTAT E V G N P R Y I V D L I G K V V R V A M E V G N P R Y I V E L I A K V T R V A V GGAGACCGTGCGAATCGTTGAAGGGTTGAGGTAG E T V R I V E G L E T M R I V E E L ------ // >fig|6666666.67496.peg.2288 fig|196627.4.peg.1117 Sodium/proline symporter FIG010198 gi|512071492|gb|ATBY01000002.1|_175733_174855,gi|512071492|gb|ATBY01000002.1|_174855_174202 MTDHTWFIVAIILYMLLMLAIGYWSYRQTDRYDEYMLAGRSLGPVVAALSAGAADMSGWLLMGLPGALFVTGLSESWIAVGLCIGAAINWRLVAPRLRAYTEVAGNSITIPSFLENRLHDSSHVLRIIASLVILVFFTFYVSSGMVSGGKYFESTFGGSYLDGMLIIAIVTVAYTFIGGFLAVSYTDAVQGIIMFGALVIVPVGAYIVVHGDYDVFSYATSNVYGPHPNGNPTYFSLFSGISAAAIIGNLAWGLGYFGQPHIIVRFMALRSPKEARAGMFVTVFWMVICALGxxATALMGTVYFGAYPERSITDQTSYETIFLDMGRMLFHPLIGGLVLTAVLAAIMSTMASQLLVVSSALIEDLYKIITKKQLSDGVLMNLSRTAVVVVAVIAALLAVSPRDSILSLVAFAWAGFGSAFGPVILASLFWRRLTAPGAIAAMVSGTVIVFAWGNSPLGDWLYEMVPGFLGATIVLIVVSLLTKAPSARLVEEFDQAQHLAVTGEYAHTTK We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACAGACCACACCTGGTTCATTGTCGCCATCATTTTGTACATGCTCCTCATGCTCGCT M T D H T W F I V A I I L Y M L L M L A M T D H T W F I V A I I L Y M L L M L A ATTGGCTATTGGAGCTACCGGCAAACTGATCGTTACGACGAGTACATGCTCGCTGGCCGT I G Y W S Y R Q T D R Y D E Y M L A G R I G Y W S Y R Q T D R Y D E Y M L A G R TCGCTGGGGCCGGTGGTTGCCGCCCTGTCGGCCGGTGCCGCGGATATGAGTGGTTGGCTT S L G P V V A A L S A G A A D M S G W L S L G P V V A A L S A G A A D M S G W L CTCATGGGGCTGCCCGGCGCGCTGTTTGTCACGGGGCTGTCAGAATCGTGGATCGCCGTG L M G L P G A L F V T G L S E S W I A V L M G L P G A L F V T G L S E S W I A V GGCCTGTGCATCGGCGCGGCGATCAACTGGCGCCTTGTCGCCCCGCGGCTGCGCGCCTAC G L C I G A A I N W R L V A P R L R A Y G L C I G A A I N W R L V A P R L R A Y ACGGAGGTGGCCGGCAACTCGATCACGATCCCCAGCTTCTTGGAAAACCGCCTCCACGAT T E V A G N S I T I P S F L E N R L H D T E V A G N S I T I P S F L E N R L H D TCTTCCCACGTCCTGCGCATCATCGCTTCCCTGGTGATTCTGGTGTTCTTCACCTTCTAT S S H V L R I I A S L V I L V F F T F Y S S H V L R I I A S L V I L V F F T F Y GTCTCCAGTGGCATGGTTTCCGGCGGCAAGTACTTCGAGTCCACCTTCGGCGGTTCGTAC V S S G M V S G G K Y F E S T F G G S Y V S S G M V S G G K Y F E S T F G G S Y CTGGATGGCATGCTTATCATTGCGATTGTCACCGTCGCCTACACGTTCATCGGTGGCTTC L D G M L I I A I V T V A Y T F I G G F L D G M L I I A I V T V A Y T F I G G F CTGGCGGTCAGCTACACGGACGCGGTGCAGGGAATCATCATGTTTGGGGCTCTGGTCATC L A V S Y T D A V Q G I I M F G A L V I L A V S Y T D A V Q G I I M F G A L V I GTCCCGGTGGGTGCCTACATCGTGGTCCATGGCGATTACGATGTCTTCAGCTACGCCACC V P V G A Y I V V H G D Y D V F S Y A T V P V G A Y I V V H G D Y D V F S Y A T TCCAATGTGTACGGCCCGCACCCGAACGGCAACCCCACCTACTTCTCCCTGTTCAGCGGG S N V Y G P H P N G N P T Y F S L F S G S N V Y G P H P N G N P T Y F S L F S G ATTTCCGCGGCTGCGATCATCGGCAACCTGGCGTGGGGGTTGGGGTATTTCGGCCAGCCA I S A A A I I G N L A W G L G Y F G Q P I S A A A I I G N L A W G L G Y F G Q P CACATCATCGTGCGCTTCATGGCACTGCGCTCTCCCAAAGAGGCACGCGCCGGCATGTTT H I I V R F M A L R S P K E A R A G M F H I I V R F M A L R S P K E A R A G M F GTCACCGTGTTCTGGATGGTCATTTGCGCACTGGGG*CT*GCCGCTACGGCGCTTATGGG V T V F W M V I C A L G A A T A L M G V T V F W M V I C A L G *X** X A T A L M G CACGGTGTACTTCGGTGCTTACCCGGAGCGTTCCATCACCGACCAGACCTCCTACGAGAC T V Y F G A Y P E R S I T D Q T S Y E T T V Y F G A Y P E R S I T D Q T S Y E T GATCTTCTTGGACATGGGGCGGATGTTGTTCCACCCGCTGATCGGCGGTCTTGTCCTGAC I F L D M G R M L F H P L I G G L V L T I F L D M G R M L F H P L I G G L V L T GGCGGTGCTTGCGGCGATCATGTCCACCATGGCTTCTCAGCTGCTCGTGGTGTCCTCCGC A V L A A I M S T M A S Q L L V V S S A A V L A A I M S T M A S Q L L V V S S A GCTCATTGAGGATTTGTACAAGATCATCACCAAGAAGCAGCTGTCCGACGGGGTGCTCAT L I E D L Y K I I T K K Q L S D G V L M L I E D L Y K I I T K K Q L S D G V L M GAACTTGTCGCGCACCGCCGTGGTGGTGGTTGCGGTGATTGCCGCGCTCCTTGCGGTCTC N L S R T A V V V V A V I A A L L A V S N L S R T A V V V V A V I A A L L A V S CCCGCGGGATTCAATCCTCAGCCTTGTGGCCTTCGCCTGGGCCGGTTTCGGCTCGGCCTT P R D S I L S L V A F A W A G F G S A F P R D S I L S L V A F A W A G F G S A F CGGGCCGGTCATTCTCGCCTCGTTGTTCTGGCGTCGCCTGACGGCGCCGGGGGCGATCGC G P V I L A S L F W R R L T A P G A I A G P V I L A S L F W R R L T A P G A I A CGCCATGGTTTCTGGCACGGTCATCGTGTTCGCCTGGGGCAACTCGCCTCTGGGGGATTG A M V S G T V I V F A W G N S P L G D W A M V S G T V I V F A W G N S P L G D W GTTGTACGAGATGGTTCCTGGTTTCCTCGGCGCGACGATCGTTCTCATTGTTGTGTCGCT L Y E M V P G F L G A T I V L I V V S L L Y E M V P G F L G A T I V L I V V S L TTTAACCAAGGCTCCCTCGGCCCGGCTTGTGGAGGAGTTTGACCAAGCCCAGCACCTCGC L T K A P S A R L V E E F D Q A Q H L A L T K A P S A R L V E E F D Q A Q H L A TGTCACCGGTGAGTACGCCCACACGACCAAGTAG V T G E Y A H T T K V T G E Y A H T T K --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.1117): ATGACAGACCACACCTGGTTCATTGTCGCCATCATTTTGTACATGCTCCTCATGCTCGCT M T D H T W F I V A I I L Y M L L M L A M S D N T W F I I A I V I Y M L V M V L ATTGGCTATTGGAGCTACCGGCAAACTGATCGTTACGACGAGTACATGCTCGCTGGCCGT I G Y W S Y R Q T D R Y D E Y M L A G R I G Y W S Y R K T E K Y D D Y M L A G R TCGCTGGGGCCGGTGGTTGCCGCCCTGTCGGCCGGTGCCGCGGATATGAGTGGTTGGCTT S L G P V V A A L S A G A A D M S G W L G L N P F V A A M S A G A S D M S G W L CTCATGGGGCTGCCCGGCGCGCTGTTTGTCACGGGGCTGTCAGAATCGTGGATCGCCGTG L M G L P G A L F V T G L S E S W I A V L M G L P G A L F V T G M S E L W I A V GGCCTGTGCATCGGCGCGGCGATCAACTGGCGCCTTGTCGCCCCGCGGCTGCGCGCCTAC G L C I G A A I N W R L V A P R L R A Y G L T I G A W A N W M W V A P R L R S Y ACGGAGGTGGCCGGCAACTCGATCACGATCCCCAGCTTCTTGGAAAACCGCCTCCACGAT T E V A G N S I T I P S F L E N R L H D S E I S A N S I T L P S F F E N R L R D TCTTCCCACGTCCTGCGCATCATCGCTTCCCTGGTGATTCTGGTGTTCTTCACCTTCTAT S S H V L R I I A S L V I L V F F T F Y K S R A L R I I A A L I I I V F F T F Y GTCTCCAGTGGCATGGTTTCCGGCGGCAAGTACTTCGAGTCCACCTTCGGCGGTTCGTAC V S S G M V S G G K Y F E S T F G G S Y I S S G M V A G G V Y W E S T F G G D Y CTGGATGGCATGCTTATCATTGCGATTGTCACCGTCGCCTACACGTTCATCGGTGGCTTC L D G M L I I A I V T V A Y T F I G G F L L G M A I V A G V T V L Y T F I G G F CTGGCGGTCAGCTACACGGACGCGGTGCAGGGAATCATCATGTTTGGGGCTCTGGTCATC L A V S Y T D A V Q G I I M F G A L V I L A V S Y T D A V Q G T I M F F S L I I GTCCCGGTGGGTGCCTACATCGTGGTCCATGGCGATTACGATGTCTTCAGCTACGCCACC V P V G A Y I V V H G D Y D V F S Y A T V P V M A Y F A L A N P M D I W S F A N TCCAATGTGTACGGCCCGCACCCGAACGGC--AACCCCACCTACTTCTCCCTGTTCAGCG S N V Y G P H P N G N P T Y F S L F S S N D Y G P H T D G IG N P T Y F S M I S GGATTTCCGCGGCTGCGATCATCGGCAACCTGGCGTGGGGGTTGGGGTATTTCGGCCAGC G I S A A A I I G N L A W G L G Y F G Q G I S A A A I I G N L G W G L G Y F G Q CACACATCATCGTGCGCTTCATGGCACTGCGCTCTCCCAAAGAGGCACGCGCCGGCATGT P H I I V R F M A L R S P K E A R A G M P H I V V R F M A L R T P A E A K Q G R TTGTCACCGTGTTCTGGATGGTCATTTGC*GC*ACTGGGGCTGCCGCTACGGCGCTTATG F V T V F W M V I C T G A A A T A L M R I G I S W M I I C *L** I G A T F T A I I GGCACGGTGTACTTCGGTGCTTACCCGGAGCGTTCCATCACCGACCAGACCTCCTACGAG G T V Y F G A Y P E R S I T D Q T S Y E S T V F F A Q N P D A N I T D T R A Y E ACGATCTTCTTGGACATGGGGCGGATGTTGTTCCACCCGCTGATCGGCGGTCTTGTCCTG T I F L D M G R M L F H P L I G G L V L S I F L D L A R M L F H P L I A G L I L ACGGCGGTGCTTGCGGCGATCATGTCCACCATGGCTTCTCAGCTGCTCGTGGTGTCCTCC T A V L A A I M S T M A S Q L L V V S S T A V L A A I M S T M S S Q L L V T A S GCGCTCATTGAGGATTTGTACAAGATCATCACCAAGAAGCAGCTGTCCGACGGGGTGCTC A L I E D L Y K I I T K K Q L S D G V L S L I E D L L K V V K K D S L S E R T L ATGAACTTGTCGCGCACCGCCGTGGTGGTGGTTGCGGTGATTGCCGCGCTCCTTGCGGTC M N L S R T A V V V V A V I A A L L A V I M L S R A T V I I L A I I A A A M A I TCCCCGCGGGATTCAATCCTCAGCCTTGTGGCCTTCGCCTGGGCCGGTTTCGGCTCGGCC S P R D S I L S L V A F A W A G F G S A N P S D S I L G L V G F A W A G F G S A TTCGGGCCGGTCATTCTCGCCTCGTTGTTCTGGCGTCGCCTGACGGCGCCGGGGGCGATC F G P V I L A S L F W R R L T A P G A I F G P I I L A S L Y W K R L N A A G A I GCCGCCATGGTTTCTGGCACGGTCATCGTGTTCGCCTGGGGCAACTCGCCTCTGGGGGAT A A M V S G T V I V F A W G N S P L G D S G M I T G A I V S I A W G M S P L S D TGGTTGTACGAGATGGTTCCTGGTTTCCTCGGCGCGACGATCGTTCTCATTGTTGTGTCG W L Y E M V P G F L G A T I V L I V V S T L Y E I I P G F A L A T I V M V V V S CTTTTAACCAAGGCTCCCTCGGCCCGGCTTGTGGAGGAGTTTGACCAAGCCCAGCACCTC L L T K A P S A R L V E E F D Q A Q H L L L T K E P S E E I L N E F E T A K D L GCTGTCACCGGTGAGTACGCCCACACGACCAAGTAG----------- A V T G E Y A H T T K * A A A V E S N E D V D F ADAAQKLSKES // >fig|6666666.67496.peg.2285 fig|196164.1.peg.980 hypothetical protein gi|512071492|gb|ATBY01000002.1|_172481_172374,gi|512071492|gb|ATBY01000002.1|_172370_171552 MTYPSVGSPRHSLRSRARTVALIDSPFTWTMSRQTTxTTERNAVPFRLVALDMDGTLLTPEGAIPADFPELAHELIGKGVTIVPASGRQLATLRAQFEGITDSFIAENGAVVAVRGRIIATHTIPVEYTTRLLRAVEQIDDPNFGLVLCHPDTAYVTRSDEEFLAECSKYYRSLELAPELDRYATEKVIKIAVYDFSSAEDNTTPLMSEILPELTVVTSGQHWTDIMTPGVHKGIAISDLCDSLKINRDSVLAFGDYLNDYELLAAAGTSYAMENAHQDVKDIAAHIAPSNADNGVVTVLRQLIDEGEL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACGTATCCGTCTGTCGGCTCTCCACGCCACAGTTTGCGTTCACGCGCGCGGACCGTC M T Y P S V G S P R H S L R S R A R T V M T Y P S V G S P R H S L R S R A R T V GCGTTGATAGATTCACCATTTACGTGGACAATGAGCAGGCAGACCACTTGAACAACAGAA A L I D S P F T W T M S R Q T T * T T E A L I D S P F T W T M S R Q T T X T T E AGGAATGCGGTGCCTTTTCGCCTCGTCGCTTTGGACATGGACGGCACACTGTTGACCCCC R N A V P F R L V A L D M D G T L L T P R N A V P F R L V A L D M D G T L L T P GAGGGTGCCATCCCCGCCGATTTTCCTGAGCTCGCCCACGAGCTCATCGGGAAAGGAGTG E G A I P A D F P E L A H E L I G K G V E G A I P A D F P E L A H E L I G K G V ACCATCGTCCCCGCATCCGGACGTCAGCTCGCCACCCTCCGCGCACAATTCGAGGGAATC T I V P A S G R Q L A T L R A Q F E G I T I V P A S G R Q L A T L R A Q F E G I ACCGATTCCTTCATCGCGGAGAACGGCGCCGTCGTCGCTGTTCGTGGACGCATCATCGCC T D S F I A E N G A V V A V R G R I I A T D S F I A E N G A V V A V R G R I I A ACCCACACCATTCCCGTGGAGTACACCACCCGCCTGCTGCGCGCGGTGGAGCAGATCGAT T H T I P V E Y T T R L L R A V E Q I D T H T I P V E Y T T R L L R A V E Q I D GATCCCAACTTCGGGCTTGTACTGTGCCACCCGGACACGGCGTATGTCACACGCAGCGAC D P N F G L V L C H P D T A Y V T R S D D P N F G L V L C H P D T A Y V T R S D GAAGAATTCTTGGCCGAGTGCTCCAAGTACTACCGTTCTCTGGAGCTCGCGCCCGAGCTT E E F L A E C S K Y Y R S L E L A P E L E E F L A E C S K Y Y R S L E L A P E L GATCGCTACGCCACAGAGAAAGTGATCAAGATTGCTGTCTATGACTTTTCCTCCGCCGAG D R Y A T E K V I K I A V Y D F S S A E D R Y A T E K V I K I A V Y D F S S A E GACAACACCACACCCCTCATGTCCGAGATTCTCCCGGAACTCACCGTGGTCACCTCCGGC D N T T P L M S E I L P E L T V V T S G D N T T P L M S E I L P E L T V V T S G CAACACTGGACAGACATCATGACCCCTGGCGTGCACAAGGGAATCGCTATCTCCGATCTG Q H W T D I M T P G V H K G I A I S D L Q H W T D I M T P G V H K G I A I S D L TGCGACAGCCTCAAAATCAACAGGGATTCCGTCCTCGCATTTGGGGACTATCTCAACGAT C D S L K I N R D S V L A F G D Y L N D C D S L K I N R D S V L A F G D Y L N D TACGAGCTCCTCGCTGCGGCGGGAACGTCCTACGCCATGGAAAACGCACACCAGGATGTC Y E L L A A A G T S Y A M E N A H Q D V Y E L L A A A G T S Y A M E N A H Q D V AAGGACATCGCCGCGCACATCGCCCCGTCCAATGCGGACAATGGCGTTGTCACGGTGTTA K D I A A H I A P S N A D N G V V T V L K D I A A H I A P S N A D N G V V T V L CGGCAGCTCATAGACGAGGGTGAACTGTGA R Q L I D E G E L R Q L I D E G E L --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.980): ATGACGTATCCGTCTGTCGGCTCTCCACGCCACAGTTTGCGTTCACGCGCGCGGACCGTC ----------------------------------------------------------- GCGTTGATAGATTCACCATTTACGTGGACAATGAGCAGGCAGACCACTTGAACAACAGAA R V D R F T I Y D N E Q A D H L N N E M A G Q L K V W --- D N E K Q D I I R K - E AGGAATGCGGTGCCTTTTCGCCTCGTCGCTTTGGACATGGACGGCACACTGTTGACCCCC R N A V P F R L V A L D M D G T L L T P T N Q M D F R L V V T D M D G T L L N P GAGGGTGCCATCCCCGCCGATTTTCCTGAGCTCGCCCACGAGCTCATCGGGAAAGGAGTG E G A I P A D F P E L A H E L I G K G V E G D I P E G F W S L L D D L R G R G V ACCATCGTCCCCGCATCCGGACGTCAGCTCGCCACCCTCCGCGCACAATTCGAG--GGAA T I V P A S G R Q L A T L R A Q F E G A F A P A S G R Q L A T L R H Q F E RA G TCACCGATTCCTTCATCGCGGAGAACGGCGCCGTCGTCGCTGTTCGTGGACGCATCATCG I T D S F I A E N G A V V A V R G R I I E P M S Y I A E N G T V V V H D G E I I CCACCCACACCATTC-CCGTGGAGTACACCACCCG--CCTGCTGCGCGCGGTGGAGCAGA A T T P F P G V H H P P A A R G G S M - T P I D P - G A V H A II T A A R D S ----- TCGATGATCCCAACTTCGGGCTTGTACTGTGCCACCCGGACACGGCGTATGTCACACGCA D P N F G L V L C H P D T A Y V T R ----- D I D M G V V V C R P E R A Y V E R GCGACGAAGAATTCTTGGCCGAGTGCTCCAAGTACTACCGTTCTCTGGAGCTCGCGCCCG S D E E F L A E C S K Y Y R S L E L A P N D E A F R A E G S K Y Y L A L D E V E AGCTTGATCGCTACGCCACAGAGAAAGTGATCAAGATTGCTGTCTATGACTTTTCCTCCG E L D R Y A T E K V I K I A V Y D F S S D L H E V V T D D V I K V A V F T F E D CCGAGGACAACACCACACCCCTCATGTCCGAGATTCTCCCGGAACTCACCGTGGTCACCT A E D N T T P L M S E I L P E L T V V T A E T M A A P I L R G A A P D N K V V V CCGGCCAACACTGGACAGACATCATGACCCCTGGCGTGCACAAGGGAATCGCTATCTCCG S G Q H W T D I M T P G V H K G I A I S S G K H W V D I M D Q S A D K G R A L V ATCTGTGCGACAGCCTCAAAATCAACAGGGATTCCGTCCTCGCATTTGGGGACTATCTCA D L C D S L K I N R D S V L A F G D Y L S L C R A M D I P V S G S V A F G D Y L ACGATTACGAGCTCCTCGCTGCGGCGGGAACGTCCTACGCCATGGAAAACGCACACCAGG N D Y E L L A A A G T S Y A M E N A H Q N D M E L L K A A G T S Y A M D N A H P ATGTCAAGGACATCGCCGCGCACATCGCCCCGTCCAATGCGGACAATGGCGTTGTCACGG D V K D I A A H I A P S N A D N G V V T D I M A I A D R R A P S N V E D G V L Q TGTTACGGCAGCTCATAGACGAGGGTGAACTGTGA V L R Q L I D E G E V L G E M L K E T N ------ // >fig|6666666.67496.peg.1023 fig|196627.4.peg.2578 Chromosome segregation ATPases gi|512069751|gb|ATBY01000014.1|_49705_48488,gi|512069751|gb|ATBY01000014.1|_48484_48458 MPEKMEISGTALAPALLQLPWELPLDEWPENVLTALPRGISRHTVRFVSIPDGSSTRVIAVKEIGERVAHHEYQMLRELNRLGAPSVTPLAVITGRRDRQGEELTACLVTSHLPFSLPYRAVFSQKLRPEVAGKLIDSLAVLLVRLHLLGFFWGDVSLSNTLFRRDADAFSGYLVDAETGELAATLSETRRMYDVDVARVNIIGELMDLEAGGLMDESMDPIAIGSAITQRYGQLWEELTGEEAIAADETWRVSDRIRRLNKLGFDVGELKVVKDEAGETVTIRPQVVDSGHHNRLLMRLTGLDVQEKQARRMLNSMHTFQALRFPDLPLEQVAHKWLLDVFLPTVRSVPPALARKLEPAQIFHEILEHRWYMTEEREGDVSLEEATQSYIKSILPSHRDEETLLExPPERGTVT We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGCCGGAGAAAATGGAAATCTCCGGCACTGCCCTGGCCCCCGCGCTGCTGCAGTTGCCG M P E K M E I S G T A L A P A L L Q L P M P E K M E I S G T A L A P A L L Q L P TGGGAGCTGCCGTTGGACGAGTGGCCGGAGAACGTGCTCACTGCGCTGCCGCGCGGGATT W E L P L D E W P E N V L T A L P R G I W E L P L D E W P E N V L T A L P R G I AGTAGGCACACGGTGCGGTTTGTGTCGATTCCCGATGGTTCGTCGACGCGGGTGATCGCG S R H T V R F V S I P D G S S T R V I A S R H T V R F V S I P D G S S T R V I A GTGAAGGAGATCGGCGAGCGGGTTGCTCACCACGAATACCAGATGTTGCGGGAGCTGAAT V K E I G E R V A H H E Y Q M L R E L N V K E I G E R V A H H E Y Q M L R E L N CGGCTTGGTGCACCGTCGGTGACACCGCTGGCGGTGATCACGGGGCGCAGGGATCGGCAG R L G A P S V T P L A V I T G R R D R Q R L G A P S V T P L A V I T G R R D R Q GGGGAGGAGTTGACGGCGTGTCTGGTCACCTCCCACCTACCGTTTTCGCTGCCTTACCGG G E E L T A C L V T S H L P F S L P Y R G E E L T A C L V T S H L P F S L P Y R GCGGTTTTCTCGCAAAAGTTGCGTCCGGAGGTGGCGGGCAAGCTCATTGATTCGTTGGCG A V F S Q K L R P E V A G K L I D S L A A V F S Q K L R P E V A G K L I D S L A GTGCTGCTGGTGCGGCTGCACCTGCTGGGCTTCTTCTGGGGCGACGTGAGCCTGTCTAAC V L L V R L H L L G F F W G D V S L S N V L L V R L H L L G F F W G D V S L S N ACACTGTTTCGCAGGGATGCGGACGCGTTTAGCGGTTACCTGGTGGACGCCGAGACGGGT T L F R R D A D A F S G Y L V D A E T G T L F R R D A D A F S G Y L V D A E T G GAACTGGCGGCCACGTTGTCGGAGACGCGGCGGATGTATGACGTGGACGTGGCGCGGGTG E L A A T L S E T R R M Y D V D V A R V E L A A T L S E T R R M Y D V D V A R V AACATCATCGGCGAGCTCATGGATCTGGAGGCCGGCGGCCTCATGGATGAGTCGATGGAT N I I G E L M D L E A G G L M D E S M D N I I G E L M D L E A G G L M D E S M D CCGATCGCCATCGGCAGCGCGATTACGCAGCGGTATGGGCAGTTGTGGGAGGAGTTGACG P I A I G S A I T Q R Y G Q L W E E L T P I A I G S A I T Q R Y G Q L W E E L T GGCGAGGAGGCGATCGCCGCGGATGAGACGTGGCGGGTGAGCGACCGCATTCGCCGGCTC G E E A I A A D E T W R V S D R I R R L G E E A I A A D E T W R V S D R I R R L AACAAGCTGGGGTTCGACGTCGGGGAGCTGAAGGTGGTCAAGGACGAGGCGGGCGAGACG N K L G F D V G E L K V V K D E A G E T N K L G F D V G E L K V V K D E A G E T GTGACGATCCGCCCCCAGGTGGTTGATTCCGGTCACCACAACCGGCTGCTCATGCGCCTG V T I R P Q V V D S G H H N R L L M R L V T I R P Q V V D S G H H N R L L M R L ACTGGGCTCGACGTGCAGGAGAAGCAGGCCCGACGGATGCTCAATTCGATGCACACGTTC T G L D V Q E K Q A R R M L N S M H T F T G L D V Q E K Q A R R M L N S M H T F CAGGCCCTCCGGTTCCCCGATCTCCCGCTCGAGCAGGTGGCTCACAAGTGGCTTCTCGAC Q A L R F P D L P L E Q V A H K W L L D Q A L R F P D L P L E Q V A H K W L L D GTCTTTCTCCCGACCGTTCGTTCGGTTCCTCCCGCGTTAGCTCGCAAGCTGGAGCCGGCA V F L P T V R S V P P A L A R K L E P A V F L P T V R S V P P A L A R K L E P A CAGATCTTCCACGAGATATTGGAGCACCGGTGGTACATGACGGAGGAACGGGAAGGGGAC Q I F H E I L E H R W Y M T E E R E G D Q I F H E I L E H R W Y M T E E R E G D GTGTCGCTGGAGGAGGCGACCCAGTCATACATCAAATCCATCCTGCCGTCCCACCGGGAT V S L E E A T Q S Y I K S I L P S H R D V S L E E A T Q S Y I K S I L P S H R D GAAGAAACCCTCCTGGAGTAGCCCCCCGAAAGGGGGACTGTTACGTAG E E T L L E * P P E R G T V T E E T L L E X P P E R G T V T --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.2578): ATGCCGGAGAAAATGGAAATCTCCGGCACTGCCCTGGCCCCCGCGCTGCTGCAGTTGCCG M P E K M E I S G T A L A P A L L Q L P M K E S M S I T S S T Y A S A L L T L P TGGGAGCTGCCGTTGGACGAGTGGCCGGAGAACGTGCTCACTGCGCTGCCGCGCGGGATT W E L P L D E W P E N V L T A L P R G I W G T P L E Q W P D N L I A A L P R G I AGTAGGCACACGGTGCGGTTTGTGTCGATTCCCGATGGTTCGTCGACGCGGGTGATCGCG S R H T V R F V S I P D G V I A S R H I V R F V G I N R G ------------ I V A GTGAAGGAGATCGGCGAGCGGGTTGCTCACCACGAATACCAGATGTTGCGGGAGCTGAAT V K E I G E R V A H H E Y Q M L R E L N V K E I G A R T A H H E Y K M L R E L Q CGGCTTGGTGCACCGTCGGTGACACCGCTGGCGGTGATCACGGGGCGCAGGGATCGGCAG R L G A P S V T P L A V I T G R R D R Q R L G A P S V R P V A V I T G R H P A E GGGGAG--GAGTTGACGGCGTGTCTGGTCACCTCCCACCTACCGTTTTCGCTGCCTTACC G E E L T A C L V T S H L P F S L P Y E D YG E L T A A L V T E H L E F S L P Y GGGCGGTTTTCTCGCAAAAGTTGCGTCCGGAGGTGGCGGGCAAGCTCATTGATTCGTTGG R A V F S Q K L R P E V A G K L I D S L R E I F S R H L T V V E S E K L I R A L CGGTGCTGCTGGTGCGGCTGCACCTGCTGGGCTTCTTCTGGGGCGACGTGAGCCTGTCTA A V L L V R L H L L G F F W G D V S L S S V L L V R M H L L N F Y W G D V S L S ACACACTGTTTCGCAGGGATGCGGACGCGTTTAGCGGTTACCTGGTGGACGCCGAGACGG N T L F R R D A D A F S G Y L V D A E T N T L F R R D A E T Y S A Y L V D A E T GTGAACTGGCGGCCACGTTGTCGGAGACGCGGCGGATGTATGACGTGGACGTGGCGCGGG G E L A A T L S E T R R M Y D V D V A R G E F Q P N L S E S R R L Y D V D I A R TGAACATCATCGGCGAGCTCATGGATCTGGAGGCCGGCGGCCTCATGGATGAGTCGATGG V N I I G E L M D L E A G G L M D E S M V N I I G E L M D L Q A G E C L D K S I ATCCGATCGCCATCGGCAGCGCGATTACGCAGCGGTATGGGCAGTTGTGGGAGGAGTTGA D P I A I G S A I T Q R Y G Q L W E E L D V I A L G G L V E S S Y L E L W T E L CGGGCGAGGAGGCGATCGCCGCGGATGAGACGTGGCGGGTGAGCGACCGCATTCGCCGGC T G E E A I A A D E T W R V S D R I R R T A E E S V D A S E Y W R L S E R I D R TCAACAAGCTGGGGTTCGACGTCGGGGAGCTGAAGGTGGTCAAGGACGAGGCGGGCGAGA L N K L G F D V G E L K V V K D E A G E L N Q L G F D V G E L K V T K D D S R Q CGGTGACGATCCGCCCCCAGGTGGTTGATTCCGGTCACCACAACCGGCTGCTCATGCGCC T V T I R P Q V V D S G H H N R L L M R V V R I R P V V V D P G H Y R A E L L S TGACTGGGCTCGACGTGCAGGAGAAGCAGGCCCGACGGATGCTCAATTCGATGCACACGT L T G L D V Q E K Q A R R M L N S M H T L T G L S V E E H Q A Q R L L G S I Q A TCCAGGCCCTCCGGTTC-CCCGATCTCCCGCTCGAGCAGGTGGCTCACAAGTGGCTTCTC F Q A L R F P D L P L E Q V A H K W L L Y Q A V E C G P H V G L T Q A A H L W M T GACGTCTTTCTCCCGACCGTTCGTTCGGTTCCTCCCGCGTTAGCTCGCAAGCTGGAGCCG D V F L P T V R S V P P A L A R K L E P N E Y E P T I A A V P V E M L D K L E P GCACAGATCTTCCACGAGATATTGGAGCACCGGTGGTACATGACGGAGGAACGGGAAGGG A Q I F H E I L E H R W Y M T E E R E G A Q I F H E I V D H R W F L A Q E R G G GACGTGTCGCTGGAGGAGGCGACCCAGTCATACATCAAATCCATCCTGCCGTCCCACCGG D V S L E E A T Q S Y I K S I L P S H R A V T L P E A T A S Y L E S V L P A R R GATGAAGAAACCCTCCTGGAGTAGCCCCCCGAAAGGGGGACTGTTACGTAG D E E T L L S S P P K G G L L R D E A R L L - S T N P S D E D L S -- // >fig|6666666.67496.peg.628 fig|306537.3.peg.378 Coenzyme F420-dependent N5,N10-methylene tetrahydromethanopterin reductase and related flavin-dependent oxidoreductases (EC 1.14.14.3) gi|512068965|gb|ATBY01000015.1|_20621_21160,gi|512068965|gb|ATBY01000015.1|_21160_21660 MKKFGFLSFGHYAIGHQCGITAADSLKQSLDFAQAADNLGVNGAYFRVHHFAPQAASPIPIMSAIAGSTKHIEVGTGVIDMRYENPYYLAEEAAALDLLSDGRVALGVSRGSPEPAKDGWRAFGYDAEQKNGSDMARRKFLQLLSAVRGEAVAEADTLERQYPQMYQPGTPLPIFPHSPxxDRRIWWGSGTNATAVQAAKDGVNLMSSTLVSEADGSSLGDIQAEQIRQYREAWDHDWTPRVSVSRTVFPIVDDETRRLFALHGESHDQIGSLGEGRQVTFGKTYADEPDRIVEKLEKDKAVMDADTLMLTIPNTMGVDVNVKILAAFAEHVAPALGWEPSNLPGA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. TTGAAGAAATTTGGATTCTTAAGCTTCGGACACTACGCCATCGGCCACCAGTGCGGAATA L K K F G F L S F G H Y A I G H Q C G I M K K F G F L S F G H Y A I G H Q C G I ACCGCCGCCGACTCCCTGAAACAATCTCTCGACTTCGCCCAGGCCGCCGACAACCTCGGC T A A D S L K Q S L D F A Q A A D N L G T A A D S L K Q S L D F A Q A A D N L G GTGAACGGCGCCTACTTCCGCGTGCACCACTTCGCGCCGCAGGCCGCCTCCCCCATCCCG V N G A Y F R V H H F A P Q A A S P I P V N G A Y F R V H H F A P Q A A S P I P ATCATGAGCGCCATCGCCGGCTCCACCAAACACATCGAGGTGGGCACCGGCGTCATCGAC I M S A I A G S T K H I E V G T G V I D I M S A I A G S T K H I E V G T G V I D ATGCGCTACGAAAACCCCTACTACCTCGCCGAAGAGGCCGCAGCCCTCGACTTGCTTTCC M R Y E N P Y Y L A E E A A A L D L L S M R Y E N P Y Y L A E E A A A L D L L S GACGGGCGCGTCGCCCTCGGTGTCTCGCGCGGATCACCGGAGCCCGCCAAGGACGGGTGG D G R V A L G V S R G S P E P A K D G W D G R V A L G V S R G S P E P A K D G W CGCGCCTTTGGCTATGACGCCGAGCAGAAAAACGGCTCCGACATGGCTCGCCGCAAGTTC R A F G Y D A E Q K N G S D M A R R K F R A F G Y D A E Q K N G S D M A R R K F CTCCAGCTGCTCTCCGCCGTCCGCGGCGAGGCCGTCGCCGAGGCCGATACCCTGGAGCGC L Q L L S A V R G E A V A E A D T L E R L Q L L S A V R G E A V A E A D T L E R CAGTACCCGCAGATGTACCAGCCAGGCACGCCGCTGCCCATCTTCCCCCACTCCCCG*GC Q Y P Q M Y Q P G T P L P I F P H S P Q Y P Q M Y Q P G T P L P I F P H S P *X* *CTCGACCGGCGGATTTGGTGGGGCTCCGGCACCAACGCCACCGCCGTGCAGGCCGCCAA L D R R I W W G S G T N A T A V Q A A K * X D R R I W W G S G T N A T A V Q A A K GGACGGCGTCAACCTCATGAGCTCCACGCTTGTCAGCGAGGCCGACGGCTCCTCGCTCGG D G V N L M S S T L V S E A D G S S L G D G V N L M S S T L V S E A D G S S L G CGATATTCAGGCCGAGCAGATCCGCCAGTACCGTGAGGCCTGGGATCACGACTGGACTCC D I Q A E Q I R Q Y R E A W D H D W T P D I Q A E Q I R Q Y R E A W D H D W T P GCGCGTCTCCGTCTCGCGCACCGTGTTCCCCATCGTGGACGACGAGACCCGTCGCCTGTT R V S V S R T V F P I V D D E T R R L F R V S V S R T V F P I V D D E T R R L F TGCCCTCCACGGTGAGAGCCACGATCAGATCGGTTCGCTGGGTGAGGGACGGCAGGTCAC A L H G E S H D Q I G S L G E G R Q V T A L H G E S H D Q I G S L G E G R Q V T GTTTGGGAAGACGTATGCCGATGAGCCTGATCGGATCGTCGAAAAGCTAGAGAAAGACAA F G K T Y A D E P D R I V E K L E K D K F G K T Y A D E P D R I V E K L E K D K AGCGGTGATGGACGCGGACACCCTCATGCTCACCATCCCCAACACCATGGGCGTGGACGT A V M D A D T L M L T I P N T M G V D V A V M D A D T L M L T I P N T M G V D V GAACGTGAAGATCCTTGCAGCCTTCGCCGAGCACGTCGCGCCCGCGCTGGGGTGGGAACC N V K I L A A F A E H V A P A L G W E P N V K I L A A F A E H V A P A L G W E P TAGTAATCTTCCCGGCGCTTAA S N L P G A S N L P G A --- ========== Now we show an alignment against a similar protein (fig|306537.3.peg.378): TTGAAGAAATTTGGATTCTTAAGCTTCGGACACTACGCCATCGGC----CACCAGTGCGG L K K F G F L S F G H Y A I G H Q C G M K A F G F L S F G H Y S L N PQPA H P H M AATAACCGCCGCCGACTCCCTGAAACAATCTCTCGACTTCGCCCAGGCCGCCGACAACCT I T A A D S L K Q S L D F A Q A A D N L L S A R D M L H Q S I E L A V E A D H L CGGCGTGAACGGCGCCTACTTCCGCGTGCACCACTTCGCGCCGCAGGCCGCCTCCCCCAT G V N G A Y F R V H H F A P Q A A S P I G V N G A Y F R V H H F A P Q Q A A P M CCCGATCATGAGCGCCATCGCCGGCTCCACCAAACACATCGAGGTGGGCACCGGCGTCAT P I M S A I A G S T K H I E V G T G V I P L L A A I A A R T Q N I E V G T G V I CGACATGCGCTACGAAAACCCCTACTACCTCGCCGAAGAGGCCGCAGCCCTCGACTTGCT D M R Y E N P Y Y L A E E A A A L D L L D M R Y E N P L H L A E E S A A L D L I TTCCGACGGGCGCGTCGCCCTCGGTGTCTCGCGCGGATCACCGGAGCCCGCCAAGGACGG S D G R V A L G V S R G S P E P A K D G A D G R I A L G V S R G A P E A V E R G GTGGCGCGCCTTTGGCTATGAC-GCCGAGCAGAAAAACGGCTCCGACATGGCTCGCCGCA W R A F G Y D A E Q K N G S D M A R R W E T F G H T G S T D P R G A D I A R E AGTTCCTCCAGCTGCTCTCCGCCGTCCGCGGCGAGGCCGTCGCCGAGGCCGATACCCTGG K F L Q L L S A V R G E A V A E A D T L H F L R Y L A A I R G V G M A T A P S A AGCGCCAGTACCCGCAGATGTACCAGCCAGGCACGCCGCTGCCCATCTTCCCCCACTCCC E R Q Y P Q M Y Q P G T P L P I F P H S E K Q Y P H M Y Q P G A S I P V L P H S CG*GC*CTCGACCGGCGGATTTGGTGGGGCTCCGGCACCAACGCCACCGCCGTGCAGGCC P L D R R I W W G S G T N A T A V Q A P *N** L D R R V W W G A G T R E T A K W A GCCAAGGACGGCGTCAACCTCATGAGCTCCACGCTTGTCAGCGAGGCCGACGGCTCCTCG A K D G V N L M S S T L V S E A D G S S G Q V G V N L M S S T L L T E S N G D S CTCGGCGATATTCAGGCCGAGCAGATCCGCCAGTACCGTGAGGCCTGG---GATCACGAC L G D I Q A E Q I R Q Y R E A W D H D F G D L Q A Q Q L Q V F K E S F ASS G H G TGGACTCCGCGCGTCTCCGTCTCGCGCACCGTGTTCCCCATCGTGGACGACGAGACCCGT W T P R V S V S R T V F P I V D D E T R W T P R T S V S R S I F P I T S A E D R CGCCTGTTTGCCCTCCACGGTGAGAGCCACGATCAGATCGGTTCGCTGGGTGAGGGACGG R L F A L H G E S H D Q I G S L E G R A I V G T H G M T R D H F G V I --- D G Y CAGGTCACGTTTGGGAAGACGTATGCCGATGAGCCTGATCGGATCGTCGAAAAGCTAGAG Q V T F G K T Y A D E P D R I V E K L E R S T F G R T Y I G E P D Q L I E E L L AAAGACAAAGCGGTGATGGACGCGGACACCCTCATGCTCACCATCCCCAACACCATGGGC K D K A V M D A D T L M L T I P N T M G N D A A V A E A D T L M L T I P N Q L G GTGGACGTGAACGTGAAGATCCTTGCAGCCTTCGCCGAGCACGTCGCGCCCGCGCTGGGG V D V N V K I L A A F A E H V A P A L G V E A N V R L L K S F A T H V A P A L G TGGGAACCTAGTAATCTTCCCGGCGCTTAA-- W E P S N L P G A * W Q P S T S E D S R LA // >fig|6666666.67496.peg.35 fig|196164.1.peg.1405 hypothetical protein gi|512068193|gb|ATBY01000017.1|_39271_39726,gi|512068193|gb|ATBY01000017.1|_39726_40130 MKRLCQVLDLNRSSFYRWWAGRDARAARRDVDKALVKRMREYHQEFDGTIGVRRMTIELNKKTVQPINHKRVERLMRTHNIIGVNLRKPNKTTVKDQGARVVDDFLKRKFRAEAPNQVYVGDITYPPCGQGQFLYLATVIDVCSRRLVVWSxxSIADHMRTSLVEDALENAARARGSLAGAVFHSDHGRQYTSSAFQTTCRRLGVRQSIGRIGSSADNAIAESFNASLKRETLQSARGWDSAEVCRREVFRWVTRYNTRRRNSALDCRSPLAFETATTAATVGLVA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGAAGCGGTTGTGCCAGGTACTCGACCTGAACCGGTCGAGCTTCTACAGATGGTGGGCC V K R L C Q V L D L N R S S F Y R W W A M K R L C Q V L D L N R S S F Y R W W A GGACGCGACGCCCGCGCCGCCCGCCGAGACGTCGACAAAGCGCTGGTTAAGCGCATGCGC G R D A R A A R R D V D K A L V K R M R G R D A R A A R R D V D K A L V K R M R GAGTACCACCAGGAATTCGACGGCACCATCGGAGTCAGGAGAATGACCATCGAACTCAAT E Y H Q E F D G T I G V R R M T I E L N E Y H Q E F D G T I G V R R M T I E L N AAGAAAACAGTTCAGCCGATCAACCACAAACGCGTGGAACGGCTGATGCGCACCCACAAC K K T V Q P I N H K R V E R L M R T H N K K T V Q P I N H K R V E R L M R T H N ATCATCGGTGTGAACCTACGTAAACCGAACAAGACCACGGTCAAGGACCAGGGCGCACGC I I G V N L R K P N K T T V K D Q G A R I I G V N L R K P N K T T V K D Q G A R GTTGTCGATGACTTCCTCAAACGCAAGTTCCGGGCTGAGGCACCGAATCAAGTCTACGTC V V D D F L K R K F R A E A P N Q V Y V V V D D F L K R K F R A E A P N Q V Y V GGCGACATCACCTACCCGCCCTGTGGCCAGGGGCAATTCCTCTATCTGGCCACCGTCATC G D I T Y P P C G Q G Q F L Y L A T V I G D I T Y P P C G Q G Q F L Y L A T V I GACGTGTGCTCCCGGCGTCTGGTCGTCTGGTCGGCT*GG*TCGATCGCCGACCACATGCG D V C S R R L V V W S A S I A D H M R D V C S R R L V V W S X *X** S I A D H M R CACCAGTCTCGTCGAAGACGCCCTGGAAAACGCGGCCCGGGCGCGGGGCTCGTTGGCCGG T S L V E D A L E N A A R A R G S L A G T S L V E D A L E N A A R A R G S L A G GGCCGTATTCCACTCCGACCACGGACGGCAATACACCTCCTCAGCCTTCCAGACCACCTG A V F H S D H G R Q Y T S S A F Q T T C A V F H S D H G R Q Y T S S A F Q T T C TCGGCGGCTGGGAGTACGCCAGTCGATAGGCCGGATCGGCTCGAGTGCGGATAATGCGAT R R L G V R Q S I G R I G S S A D N A I R R L G V R Q S I G R I G S S A D N A I AGCCGAGTCGTTCAACGCCTCCCTCAAGCGAGAAACTCTCCAAAGTGCTCGTGGGTGGGA A E S F N A S L K R E T L Q S A R G W D A E S F N A S L K R E T L Q S A R G W D CTCTGCCGAGGTGTGCCGTCGCGAGGTCTTCCGGTGGGTCACCCGCTACAACACTCGCCG S A E V C R R E V F R W V T R Y N T R R S A E V C R R E V F R W V T R Y N T R R ACGCAACTCAGCCCTGGACTGCCGCTCGCCCCTTGCCTTCGAGACCGCGACGACGGCTGC R N S A L D C R S P L A F E T A T T A A R N S A L D C R S P L A F E T A T T A A TACCGTAGGCCTCGTTGCCTAA T V G L V A T V G L V A --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.1405): GTGAAGCGGTTGTGCCAGGTACTCGACCT*G*AACCGGTCGAGCTTCTACAGATGGTGGG V P G T R P N R S S F Y R W W ----------- M T T T P P *P* T R S S F Y K W R CCGGACGCGACGCCCGCGCCGCCCGCCGAGACGTCGACAAAGCGCTGGTTAAGCGCATGC A G R D A R A A R R D V D K A L V K R M D G K P A R R Q R Q H A D E V L V A Q M GCGAGTACCACCAGGAATTCGACGGCACCATCGGAGTCAGGAGAATGACCATCGAACTCA R E Y H Q E F D G T I G V R R M T I E L R D Y H E E F D A T I G V R R M T A E I ATAAGAAAACAGTTCAGCCGATCAACCACAAACGCGTGGAACGGCTGATGCGCACCCACA N K K T V Q P I N H K R V E R L M R T H N D T A P T R V N H K R I E R L M R Q H ACATCATCGGTGTGAACCTACGTAAACCGAACAAGACCACGGTCAAGGACCAGGGCGCAC N I I G V N L R K P N K T T V K D Q G A Q I A G V N L R K K K R T T I P D Q D A GCGTTGTCGATGACTTCCTCAAACGCAAGTTCCGGGCTGAGGCACCGAATCAAGTCTACG R V V D D F L K R K F R A E A P N Q V Y R V F D D L V G R D F T A E D C N Q L Y TCGGCGACATCACCTACCCGCCCTGTGGCCAGGGGCAATTCCTCTATCTGGCCACCGTCA V G D I T Y P P C G Q G Q F L Y L A T V I G D I T Y L P C G K G E F M Y L A T V TCGACGTGTGCTCCCGGCGTCTGGTCGTCTGGTCGGCTGGTCGATCGCCGACCACATGCG I D V C S R R L V G W S I A D H M R I D V C S R R L V -------- G Y S L A D Y M R CACCAGTCTCGTCGAAGACGCCCTGGAAAACGCGGCCCGGGCGCGGGGCTCGTTGGCCGG T S L V E D A L E N A A R A R G S L A G T S L V Q D A I E D A A R T R G S L D G GGCCGTATTCCACTCCGACCACGGACGGCAATACACCTCCTCAGCCTTCCAGACCACCTG A V F H S D H G R Q Y T S S A F Q T T C A I F H S D H G S V Y T S S A L Q T T C TCGGCGGCTGGGAGTACGCCAGTCGATAGGCCGGATCGGCTCGAGTGCGGATAATGCGAT R R L G V R Q S I G R I G S S A D N A I R R L G I R Q S M G R I G S S A D N A M AGCCGAGTCGTTCAACGCCTCCCTCAAGCGAGAAACTCTCCAAAGTGCTCGTGGGTGGGA A E S F N A S L K R E T L Q S A R G W D A E S F N A S L K R E T L Q G S G S W A CTCTGCCGAGGTGTGCCGTCGCGAGGTCTTCCGGTGGGTCACCCGCTACAACACTCGCCG S A E V C R R E V F R W V T R Y N T R R S P V Q C R R E V F R W I T R Y N T R R ACGCAACTCAGCCCTGGACTGCCGCTCGCCCCTTGCCTTCGAGACCGCGACGACGGCTGC R N S A L D C R S P L A F E T A T T A A R H S G I S Y L S P R A F E D A A S A V TACCGTAGGCCTCGTTGCCTAA T V G L V A T V A P A A --- // >fig|6666666.67496.peg.1259 fig|257309.1.peg.799 No significant database matches gi|512069927|gb|ATBY01000013.1|_110507_110860,gi|512069927|gb|ATBY01000013.1|_110864_110959 MPAQVTRPGFTVFGQTQWSVDSQARFAAALPSLAGAAPVLELMGEVSPEQSYGLGTLPGCAFKGGWGPDESGMYLARQLGVLADGSGVALIAIPADGSYATAQQMLTAMATELAGAGSxSPSPSAREATSRTTITLWKLSPVRCTRICTS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCCGGCGCAGGTCACCCGCCCCGGATTCACCGTTTTCGGGCAAACCCAGTGGTCGGTG V P A Q V T R P G F T V F G Q T Q W S V M P A Q V T R P G F T V F G Q T Q W S V GATTCCCAAGCACGGTTTGCCGCTGCACTACCCTCGCTCGCGGGTGCTGCCCCCGTCCTT D S Q A R F A A A L P S L A G A A P V L D S Q A R F A A A L P S L A G A A P V L GAGCTCATGGGGGAAGTCTCCCCCGAGCAGAGCTACGGGCTCGGGACACTGCCCGGGTGC E L M G E V S P E Q S Y G L G T L P G C E L M G E V S P E Q S Y G L G T L P G C GCGTTCAAGGGTGGCTGGGGGCCCGACGAGTCCGGCATGTATCTGGCCAGGCAGCTGGGG A F K G G W G P D E S G M Y L A R Q L G A F K G G W G P D E S G M Y L A R Q L G GTGCTTGCCGACGGCTCCGGGGTCGCCCTCATCGCCATCCCCGCCGACGGCTCCTACGCC V L A D G S G V A L I A I P A D G S Y A V L A D G S G V A L I A I P A D G S Y A ACCGCCCAACAGATGCTCACCGCCATGGCCACGGAGCTAGCGGGCGCGGGCAGCTAGTCC T A Q Q M L T A M A T E L A G A G S * S T A Q Q M L T A M A T E L A G A G S X S CCCTCACCCTCGGCCCGCGAAGCAACCTCCCGGACTACCATAACCTTATGGAAACTAAGT P S P S A R E A T S R T T I T L W K L S P S P S A R E A T S R T T I T L W K L S CCAGTGCGCTGTACACGGATATGTACGAGTTGA P V R C T R I C T S P V R C T R I C T S --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.799): -----GTGCCGGCGCAGGTC--ACCCGCCCCGGATTCACCGTTTTCGGGCAAACCCAGTG V P A Q V T R P G F T V F G Q T Q W MESSK I P S A S PP V R P E F S V F G Q T Q W GTCGGTGGATTCCCAAGCACGGTTTGCCGCTGCACTACCCTCGCTCGCGGGTGCTGCCCC S V D S Q A R F A A A L P S L A G A A P A L G P Q A M F A R H M G C V A G S G P CGTCCTTGAGCTCATGGGGGAAGTCTCCCCCGAGCAGAGCTACGGGCTCGGGACACTGCC V L E L M G E V S P E Q S Y G L G T L P V L D A M S E I V S S Q R Y G L G S I P CGGGTGCGCGTTCAAGGGTGGCTGGGGGCCCGACGAGTCCGGCATGTATCTGGCCAGGCA G C A F K G G W G P D E S G M Y L A R Q G A R F K G G W G P N L S G S Y D V R Q GCTGGGGGTGCTTGCCGACGGCTCCGGGGTCGCCCTCATCGCCATCCCCGCC---GACGG L G V L A D G S G V A L I A I P A D G F G L V P I G G V I V P V A V T A QAS D G CTCCTACGCCACCGCCCAACAGATGCTCACCGCCATGGCCACGGAGCTAGCGGGCGCGGG S Y A T A Q Q M L T A M A T E L A G A G S Y E S G Q Q L L T R M A T K L A S F N CAGCTAGTCCCCCTCACCCTCGGCCCGCGAAGCAACCTCCCGGACTACCATAACCTTATG S * S P S G N V P S -------------------------------------------- GAAACTAAGTCCAGTGCGCTGTACACGGATATGTACGAGTTGA V Q C A -------- A E C V ----------------------- // >fig|6666666.67496.peg.1678 fig|257309.1.peg.248 Deoxyribonucleoside regulator DeoR (transcriptional repressor) FIG011057 gi|512070728|gb|ATBY01000009.1|_17671_17790,gi|512070728|gb|ATBY01000009.1|_17794_18777 MAFPARDSWPGSGSCLRVCWCSAWCSFGPKRGLALVATQRxRRLKPMDSRAALAIDTAKLYYIEGLSQSEVAHALGVSRPTVSKLLTLARDSGYVRIEIDDPRTSSSILARRLEEWFGLTSARVIPAVGSGTGRRIKESNSLLLTELGKIGAEVLDELVTDDDLIGVSWGNTLHSIANQLHRKTVTGVHIVQLKGGLSHSARSTNDFDTITKFSEAFYAPAHLLPLPAVFQSAEVKRLVEGEPFITQLTQLARESTIAVFTVGAAKPDSTLLQLGYFSDEDVRQILEHAVGDICSRWITSDGEIAVPEIDERSVGISLADLKQVPTRLLVAGGLDKAEPLRVALEGGMATHLVTDSTVAEHILAGNED We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGGCTTTCCCGGCACGAGACTCGTGGCCAGGCTCCGGGTCGTGCCTGCGTGTTTGTTGG V A F P A R D S W P G S G S C L R V C W M A F P A R D S W P G S G S C L R V C W TGTTCGGCGTGGTGCTCTTTCGGGCCAAAGCGTGGGCTAGCGCTAGTGGCAACTCAGCGA C S A W C S F G P K R G L A L V A T Q R C S A W C S F G P K R G L A L V A T Q R TAGCGTAGGCTTAAACCCATGGATTCACGGGCTGCGCTGGCAATTGATACCGCTAAGCTC * R R L K P M D S R A A L A I D T A K L X R R L K P M D S R A A L A I D T A K L TACTACATTGAGGGCTTATCGCAATCCGAGGTAGCACACGCTCTGGGGGTGTCGCGCCCG Y Y I E G L S Q S E V A H A L G V S R P Y Y I E G L S Q S E V A H A L G V S R P ACAGTGTCGAAGCTGCTCACCCTCGCACGCGATTCCGGTTACGTGAGGATCGAAATCGAT T V S K L L T L A R D S G Y V R I E I D T V S K L L T L A R D S G Y V R I E I D GATCCGCGGACCTCGAGCTCCATCCTTGCCCGCCGCCTGGAAGAATGGTTCGGCCTTACC D P R T S S S I L A R R L E E W F G L T D P R T S S S I L A R R L E E W F G L T TCGGCGAGGGTCATTCCCGCGGTTGGCTCGGGGACAGGTCGCCGCATCAAAGAGTCCAAC S A R V I P A V G S G T G R R I K E S N S A R V I P A V G S G T G R R I K E S N TCGCTACTGCTCACCGAGCTGGGCAAGATCGGCGCCGAGGTCCTGGATGAGTTGGTCACG S L L L T E L G K I G A E V L D E L V T S L L L T E L G K I G A E V L D E L V T GACGACGATCTCATCGGCGTGAGTTGGGGGAACACTCTCCACTCCATTGCCAACCAGTTG D D D L I G V S W G N T L H S I A N Q L D D D L I G V S W G N T L H S I A N Q L CACCGTAAAACTGTCACCGGCGTGCACATCGTGCAGCTGAAGGGCGGGCTATCCCACTCG H R K T V T G V H I V Q L K G G L S H S H R K T V T G V H I V Q L K G G L S H S GCCAGGAGCACCAACGATTTCGACACCATAACGAAGTTCTCCGAGGCCTTCTATGCCCCG A R S T N D F D T I T K F S E A F Y A P A R S T N D F D T I T K F S E A F Y A P GCGCATCTGCTGCCACTTCCAGCGGTGTTCCAGTCGGCAGAGGTGAAGCGGCTGGTGGAG A H L L P L P A V F Q S A E V K R L V E A H L L P L P A V F Q S A E V K R L V E GGCGAGCCTTTCATCACACAACTCACCCAGCTGGCGCGGGAGTCCACCATCGCGGTGTTC G E P F I T Q L T Q L A R E S T I A V F G E P F I T Q L T Q L A R E S T I A V F ACGGTGGGCGCTGCAAAGCCGGATTCCACCCTTTTGCAGCTGGGCTACTTCAGCGATGAG T V G A A K P D S T L L Q L G Y F S D E T V G A A K P D S T L L Q L G Y F S D E GATGTTCGACAGATTCTCGAACACGCGGTGGGGGACATCTGCTCGCGCTGGATCACCTCG D V R Q I L E H A V G D I C S R W I T S D V R Q I L E H A V G D I C S R W I T S GACGGTGAGATCGCGGTACCGGAAATCGACGAGCGGTCTGTGGGAATCTCCCTCGCCGAT D G E I A V P E I D E R S V G I S L A D D G E I A V P E I D E R S V G I S L A D CTCAAGCAGGTGCCCACTCGCCTCCTCGTAGCGGGCGGTTTGGACAAGGCGGAGCCACTA L K Q V P T R L L V A G G L D K A E P L L K Q V P T R L L V A G G L D K A E P L CGCGTCGCGCTTGAAGGTGGAATGGCGACGCACCTGGTCACCGACTCGACAGTGGCGGAG R V A L E G G M A T H L V T D S T V A E R V A L E G G M A T H L V T D S T V A E CACATCCTCGCCGGCAACGAGGACTAG H I L A G N E D H I L A G N E D --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.248): GTGGCTTTCCCGGCACGAGACTCGTGGCCAGGCTCCG*GG*TCGTGCCTGCGT--GTTTG Q A P S C L R V C ---------------------------- M N P *V** S C A R YP T M TTGGTGTTCGGCGTGGTGCTCTTTCGGGCCAAAGCGTGGGCTAGCGCTAGTGGCAACTCA W C S A W G L A L V A T Q W N M L W --------------------- G V S W L G V E GCGATAGCGTAGGCTTAAACCCATGGATTCACGGGCTGCGCTGGCAATTGATACCGCTAA R * R R L K P M D S R A A L A I D T A K W G K N V H M I D A R D C L A L D A A K GCTCTACTACATTGAGGGCTTATCGCAATCCGAGGTAGCACACGCTCTGGGGGTGTCGCG L Y Y I E G L S Q S E V A H A L G V S R L Y Y V T G L G Q A Q V A K E L G I S R CCCGACAGTGTCGAAGCTGCTCACCCTCGCACGCGATTCCGGTTACGTGAGGATCGAAAT P T V S K L L T L A R D S G Y V R I E I P T V S K L L S H A R D K G F V T I S L CGATGATCCGCGGACCTCGAGCTCCATCCTTGCCCGCCGCCTGGAAGAATGGTTCGGCCT D D P R T S S S I L A R R L E E W F G L N D P R E V A G G Y V E K L C A R Y G L TACCTCGGCGAGGGTCATT--CCCGCGGTTGGCTCGGGG-ACAGGTCGCCGCATCAAAGA T S A R V I P A V G S G T G A D V R V V QS P A M G R G L T G -------------- GTCCAACTCGCTACTGCTCACCGAGCTGGGCAAGATCGGCGCCGAGGTCCTGGATGAGTT E L G K I G A E V L D E L ---------------------- E L G N A G A A L L E E V GGTCACGGACGACGATCTCATCGGCGTGAGTTGGGGGAACACTCTCCACTCCATTGCCAA V T D D D L I G V S W G N T L H S I A N V K D G M T V G V S W G D T M L A V S E CCAGTTGCACCGTAAAACTGTCACCGGCGTGCACATCGTGCAGCTGAAGGGCGGGCTATC Q L H R K T V T G V H I V Q L K G G L S H L R T L P L V D V K V V Q L K G G H S CCACTCGGCCAGGAGCACCAACGATTTCGACACCATAACGAAGTTCTCCGAGGCCTTCTA H S A R S T N D F D T I T K F S E A F Y H T A R N T N D M V T L T R F S R A L N TGCCCCGGCGCATCTGCTGCCACTTCCAGCGGTGTTCCAGTCGGCAGAGGTGAAGCGGCT A P A H L L P L P A V F Q S A E V K R L A E M M M L P L P V I L D S K E A K E L GGTGGAGGGCGAGCCTTTCATCACACAACTCACCCAGCTGGCGCGGGAGTCCACCATCGC V E G E P F I T Q L T Q L A R E S T I A V V K D R H I A S M L N L G A H C D V A GGTGTTCACGGTGGGCGCTGCAAAGCCGGATTCCACCCTTTTGCAGCTGGGCTACTTCAG V F T V G A A K P D S T L L Q L G Y F S V F T V G A V K S E S L L L N L G Y L S CGATGAGGATGTTCGACAGATTCTCGAACACGCGGTGGGGGACATCTGCTCGCGCTGGAT D E D V R Q I L E H A V G D I C S R W I P S E Q A R L M E H A V G D V C S R F Y CACCTCGGACGGTGAGATCGCGGTACCGGAAATCGACGAGCGGTCTGTGGGAATCTCCCT T S D G E I A V P E I D E R S V G I S L D A Q G E V A D P D I D A R T V G I S L CGCCGATCTCAAGCAGGTGCCCACTCGCCTCCTCGTAGCGGGCGGTTTGGACAAGGCGGA A D L K Q V P T R L L V A G G L D K A E A D L K K R P V R V L V A G G L E K A P GCCACTACGCGTCGCGCTTGAAGGTGGAATGGCGACGCACCTGGTCACCGACTCGACAGT P L R V A L E G G M A T H L V T D S T V A I E A A L R T G V A T H V V I D H A T GGCGGAGCACATC--CTCGCCGGCAACGAGGACTAG A E H I L A A Q R V VE M A --------------- // >fig|6666666.67496.peg.37 fig|196627.4.peg.2858 putative lipoprotein gi|512068193|gb|ATBY01000017.1|_41104_40769,gi|512068193|gb|ATBY01000017.1|_40765_40427 MRRTLVLSALAVASTLALAACGEATESGNTDTTTSATSTATTTAETTETTTATTEADGEISADHNDADIMFAQMMIPHHQQAVEMSEMLLAKEGIPAQVVEFAQGVIDAQGPxIDRMNAMLKAWGQQPVTDSAGMGTMDEMGGMDHGEMGGMSGMMSQEDMTALEEAQGTQAACLYLEQMTAHHEGAVDMACDEVADGQNRHAITLAEQIINDQEAEIAQMLTDL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGGCGCACCCTTGTTCTTTCCGCTCTCGCCGTGGCCTCCACCCTGGCGCTAGCCGCC M R R T L V L S A L A V A S T L A L A A M R R T L V L S A L A V A S T L A L A A TGCGGTGAGGCCACCGAGTCAGGCAACACCGACACCACCACCTCGGCCACCAGCACAGCG C G E A T E S G N T D T T T S A T S T A C G E A T E S G N T D T T T S A T S T A ACGACTACCGCTGAGACGACCGAGACCACCACGGCGACGACTGAGGCGGACGGGGAGATC T T T A E T T E T T T A T T E A D G E I T T T A E T T E T T T A T T E A D G E I TCCGCCGATCACAATGACGCGGACATCATGTTTGCCCAGATGATGATCCCCCATCACCAG S A D H N D A D I M F A Q M M I P H H Q S A D H N D A D I M F A Q M M I P H H Q CAGGCCGTGGAGATGAGTGAGATGCTCCTGGCCAAGGAGGGTATCCCCGCCCAGGTTGTG Q A V E M S E M L L A K E G I P A Q V V Q A V E M S E M L L A K E G I P A Q V V GAGTTTGCCCAGGGGGTTATTGACGCCCAGGGACCGTAGATTGACCGGATGAACGCTATG E F A Q G V I D A Q G P * I D R M N A M E F A Q G V I D A Q G P X I D R M N A M CTCAAGGCCTGGGGCCAGCAGCCGGTCACCGACTCTGCGGGCATGGGGACCATGGACGAG L K A W G Q Q P V T D S A G M G T M D E L K A W G Q Q P V T D S A G M G T M D E ATGGGTGGAATGGATCACGGCGAGATGGGTGGCATGAGCGGGATGATGAGCCAGGAGGAC M G G M D H G E M G G M S G M M S Q E D M G G M D H G E M G G M S G M M S Q E D ATGACAGCCCTTGAGGAAGCCCAGGGCACCCAGGCTGCCTGCCTCTACCTGGAGCAGATG M T A L E E A Q G T Q A A C L Y L E Q M M T A L E E A Q G T Q A A C L Y L E Q M ACCGCCCACCACGAAGGTGCGGTCGACATGGCCTGTGACGAGGTTGCTGACGGCCAGAAT T A H H E G A V D M A C D E V A D G Q N T A H H E G A V D M A C D E V A D G Q N CGCCATGCGATCACCCTGGCCGAACAAATTATCAACGACCAGGAGGCCGAGATCGCCCAG R H A I T L A E Q I I N D Q E A E I A Q R H A I T L A E Q I I N D Q E A E I A Q ATGCTCACTGACCTATGA M L T D L M L T D L --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.2858): ATGAGGCGCACCCTTGTTCTTTCCGCTCTCGCCGTGGCCTCCACCCTGGCGCTAGCCGCC M R R T L V L S A L A V A S T L A L A A M K R T I T I A A L A L T S T L V L S A TGCGGTGAGGCCACCGAGTCAGGCAACACCGACACCACCACCTCGGCCACCAGCACAGCG C G E A T E S G N T D T T T S A T S T A C A D N T E G E N T D T T T I A T T S A ACGACTACCGCTGAGACGACCGAGACCACCACG---GCGACGACTGAGGCGGACGGGGAG T T T A E T T E T T T A T T E A D G E P D T T E T T G A T T DPE T E T G A A G E ATCTCCGCCGATCACAATGACGCGGACATCATGTTTGCCCAGATGATGATCCCCCATCAC I S A D H N D A D I M F A Q M M I P H H V S A E H N D A D I M F A Q M M I P H H CAGCAGGCCGTGGAGATGAGTGAGATGCTCCTGGCCAAGGAGGGTATCCCCGCCCAGGTT Q Q A V E M S E M L L A K E G I P A Q V Q Q A V E M S E I L L A K D D I P A E V GTGGAGTTTGCCCAGGGGGTTATTGACGCCCAGGGACCGTAGATTGACCGGATGAACGCT V E F A Q G V I D A Q G P * I D R M N A I E F T Q G V I D A Q G P E I D R M N T ATGCTCAAGGCCTGGGGCCAGCAGCCGGTCACCGACTCTGCGGGCATGGGGACCATGGAC M L K A W G Q Q P V T D M L E T W E E D P V T G ------------------------ GAGATGGGTGGAATGGATCACGGCGAGATGGGTGGCATGAGCGGGATGATGAGCCAGGAG E M G G M D H G G M S G M M S Q E D M G E M D H G --------- G M S G M M S E E GACATGACAGCCCTTGAGGAAGCCCAGGGCACCCAGGCTGCCTGCCTCTACCTGGAGCAG D M T A L E E A Q G T Q A A C L Y L E Q D M T A L E D A Q G T E A A R L Y L E Q ATGACCGCCCACCACGAAGGTGCGGTCGACATGGCCTGTGACGAGGTTGCTGACGGCCAG M T A H H E G A V D M A C D E V A D G Q M T A H H E G A V D M A R D E V T D G Q AATCGCCATGCGATCACCCTGGCCGAACAAATTATCAACGACCAGGAGGCCGAGATCGCC N R H A I T L A E Q I I N D Q E A E I A N P Q A I A L A E Q V I E D Q E A E I A ---CAGATGCTCACTGACCTATGA Q M L T D L EME Q M L N E L --- //