>fig|6666666.67454.peg.1808 fig|257309.1.peg.1803 hypothetical protein gi|372118535|gb|CP003217.1|_1846927_1846748,gi|372118535|gb|CP003217.1|_1846748_1846620 MKNLSILRRNTVMSLPISEKKGGCGCGHHNETPTLDARDLSPAIRHGAILGAIGQLQSGxxMDLIAPHNPLPLLEQVYELFGASVEITYVSEDPWTLNFAKS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. TTGAAAAATTTATCTATTTTGAGGAGGAATACAGTAATGTCACTACCAATTTCGGAAAAG L K N L S I L R R N T V M S L P I S E K M K N L S I L R R N T V M S L P I S E K AAAGGTGGCTGCGGCTGCGGTCACCATAACGAGACTCCAACTCTTGATGCTCGCGATCTG K G G C G C G H H N E T P T L D A R D L K G G C G C G H H N E T P T L D A R D L TCACCGGCTATCCGGCACGGTGCAATTTTAGGTGCAATTGGCCAGCTGCAGTCGGGT*CT S P A I R H G A I L G A I G Q L Q S G S P A I R H G A I L G A I G Q L Q S G *X* *TCAATGGATCTCATAGCGCCTCATAATCCACTTCCACTTCTCGAACAGGTCTACGAACT S M D L I A P H N P L P L L E Q V Y E L * X M D L I A P H N P L P L L E Q V Y E L ATTTGGTGCATCCGTGGAAATTACATACGTGAGTGAGGATCCGTGGACGTTGAACTTCGC F G A S V E I T Y V S E D P W T L N F A F G A S V E I T Y V S E D P W T L N F A CAAGTCCTAG K S K S --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1803): TTGAAAAATTTATCTATTTTGAGGAGGAATACAGTAATGTCACTACCAATTTCGGAAAAG L K N L S I L R R N T V M S L P I S E K M K N L S I L R R N T V M S L P I S E K AAAGGTGGCTGCGGCTGCGGTCACCATAACGAGACTCCAACTCTTGATGCTCGCGATCTG K G G C G C G H H N E T P T L D A R D L K G G C G C G H H N E T P T L D A R D L TCACCGGCTATCCGGCACGGTGCAATTTTAGGTGCAATTGGCCAGCTGCAG*TC*GGGTC S P A I R H G A I L G A I G Q L Q G S S P A I R H G A I L G A I G Q L Q *S** G S TTCAATGGATCTCATAGCGCCTCATAATCCACTTCCACTTCTCGAACAGGTCTACGAACT S M D L I A P H N P L P L L E Q V Y E L S M D L I A P H N P L P L L E Q V Y E L ATTTGGTGCATCCGTGGAAATTACATACGTGAGTGAGGATCCGTGGACGTTGAACTTCGC F G A S V E I T Y V S E D P W T L N F A F G A S V E I T Y V S E D P W T L N F A CAAGTCCTAG K S K S --- // >fig|6666666.67454.peg.252 fig|257309.1.peg.165 Putative phage integrase gi|372118535|gb|CP003217.1|_251791_251585,gi|372118535|gb|CP003217.1|_251581_251426,gi|372118535|gb|CP003217.1|_251422_251408,gi|372118535|gb|CP003217.1|_251404_250901,gi|372118535|gb|CP003217.1|_250897_250592 MAFVRDLWTKPNPNATSRTKRIRSARWGKGKRWQAVWVKNGKHVTTSCHAKDEAELHIARASVGQADGTxITKDKLDVTLQDMWDVWIASKQGRTESTKAGYIAAWKHIQPVFGNTACWKIExAKIAAxIPTVTTTKSSKHNQPRVIGSGSQRKIGIVIKALLDQAEELDIINKNKIRCTDIPRQGKAERRYLTIRGIDRLLAAAIPMNEVALMRNVLLFTGLRPREAKGLKVKDLDPMRGRLSIRRDVDDLGNPDETKTRNHRGVPIGGDLLFDLDDQAEGKQPHDWLLTDETGHVxTSTKWRRQWATICTHAHISGLTTYELRHTAASLAIAAGADVKTVQLMLGHASAATTLDTYAHLWETGLDSVPGAMSAHLQRERERLALRERRRVECELQVI We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCATTCGTGCGCGACCTCTGGACAAAACCCAACCCCAACGCAACATCGAGAACCAAA M A F V R D L W T K P N P N A T S R T K M A F V R D L W T K P N P N A T S R T K AGAATACGCTCTGCTCGATGGGGAAAAGGCAAACGCTGGCAAGCTGTCTGGGTAAAAAAC R I R S A R W G K G K R W Q A V W V K N R I R S A R W G K G K R W Q A V W V K N GGCAAACACGTCACCACCTCATGCCACGCCAAAGACGAAGCTGAACTTCACATCGCACGC G K H V T T S C H A K D E A E L H I A R G K H V T T S C H A K D E A E L H I A R GCATCCGTTGGCCAAGCCGATGGCACCTAGATTACTAAAGACAAACTCGATGTCACACTC A S V G Q A D G T * I T K D K L D V T L A S V G Q A D G T X I T K D K L D V T L CAAGACATGTGGGATGTATGGATCGCGTCAAAACAAGGACGCACAGAAAGCACCAAAGCT Q D M W D V W I A S K Q G R T E S T K A Q D M W D V W I A S K Q G R T E S T K A GGTTACATTGCTGCGTGGAAACACATCCAACCCGTCTTCGGAAACACCGCATGTTGGAAA G Y I A A W K H I Q P V F G N T A C W K G Y I A A W K H I Q P V F G N T A C W K ATTGAATGAGCAAAAATAGCAGCCTAGATCCCTACCGTCACCACCACCAAAAGCAGCAAG I E * A K I A A * I P T V T T T K S S K I E X A K I A A X I P T V T T T K S S K CATAACCAACCCCGTGTGATCGGCTCCGGCTCGCAACGCAAAATCGGAATCGTCATCAAA H N Q P R V I G S G S Q R K I G I V I K H N Q P R V I G S G S Q R K I G I V I K GCACTCCTCGACCAAGCCGAAGAACTCGACATCATTAACAAAAACAAAATCCGTTGCACC A L L D Q A E E L D I I N K N K I R C T A L L D Q A E E L D I I N K N K I R C T GATATCCCCCGCCAAGGAAAAGCAGAACGCCGCTACCTCACCATCCGAGGAATCGACCGC D I P R Q G K A E R R Y L T I R G I D R D I P R Q G K A E R R Y L T I R G I D R CTTTTAGCAGCTGCAATACCCATGAACGAAGTAGCACTCATGCGCAACGTTTTGTTATTC L L A A A I P M N E V A L M R N V L L F L L A A A I P M N E V A L M R N V L L F ACCGGTCTTCGCCCAAGGGAAGCAAAAGGATTGAAAGTCAAAGACCTCGACCCCATGCGC T G L R P R E A K G L K V K D L D P M R T G L R P R E A K G L K V K D L D P M R GGTAGGCTGTCCATCCGTCGTGACGTCGACGATCTCGGAAACCCCGATGAAACAAAAACC G R L S I R R D V D D L G N P D E T K T G R L S I R R D V D D L G N P D E T K T AGAAACCACCGCGGCGTCCCCATCGGTGGTGACCTCCTTTTCGATCTCGACGACCAAGCA R N H R G V P I G G D L L F D L D D Q A R N H R G V P I G G D L L F D L D D Q A GAAGGAAAACAACCACATGACTGGCTCCTCACCGATGAAACCGGCCATGTGTGAACATCC E G K Q P H D W L L T D E T G H V * T S E G K Q P H D W L L T D E T G H V X T S ACAAAATGGCGCAGGCAGTGGGCAACCATCTGCACTCATGCACACATATCAGGCCTGACA T K W R R Q W A T I C T H A H I S G L T T K W R R Q W A T I C T H A H I S G L T ACCTACGAGCTACGACACACAGCAGCATCATTGGCGATTGCAGCCGGTGCTGACGTGAAA T Y E L R H T A A S L A I A A G A D V K T Y E L R H T A A S L A I A A G A D V K ACCGTTCAACTTATGCTTGGACACGCAAGTGCTGCCACGACCCTTGACACCTACGCACAC T V Q L M L G H A S A A T T L D T Y A H T V Q L M L G H A S A A T T L D T Y A H TTGTGGGAAACCGGACTAGATTCCGTTCCCGGCGCGATGAGTGCTCATTTGCAGCGTGAG L W E T G L D S V P G A M S A H L Q R E L W E T G L D S V P G A M S A H L Q R E CGTGAGAGGTTAGCGTTGCGTGAGCGTAGGCGTGTTGAGTGTGAGTTACAGGTTATTTAG R E R L A L R E R R R V E C E L Q V I R E R L A L R E R R R V E C E L Q V I --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.165): ATGGCATTCGTGCGCGACCTCTGGACAAAACCCAACCCCAACGCAACATCGAGAACCAAA M A F V R D L W T K P N P N A T S R T K M A T V R D L W T K R N P N T T S K T K AGAATACGCTCTGCTCGATGGGGAAAAGGCAAACGCTGGCAAGCTGTCTGGGTAAAAAAC R I R S A R W G K G K R W Q A V W V K N R I R S A R W G V G K R W Q A V W I E N GGCAAACACGTCACCACCTCATGCCACGCCAAAGACGAAGCTGAACTTCACATCGCACGC G K H V T T S C H A K D E A E L H I A R G R E A T K T F E T R D E A E L W A A R GCATCCGTTGGCCAAGCCGATGGCACCTAGATTACTAAAGACAAACTCGATGTCACACTC A S V G Q A D G T * I T K D K L D V T L A E V G K A D G T W I T K D K V D I T L CAAGACATGTGGGATGTATGGATCGCGTCAAAACAAGGACGCACAGAAAGCACCAAAGCT Q D M W D V W I A S K Q G R T E S T K A S D L W E P W I A S K G N I S D K T K R GGTTACATTGCTGCGTGGAAA-CACATCCAACCCGTCTTCGGAAACACCGCATGTTGGAA G Y I A A W K H I Q P V F G N T A C W K D Y L S Y W N V H I R P Q W G Q T P C A H AATTGAATGAGCAAAAATAGCAGCCTAGATCCCTACCGTCACCACCACCAAAAGCAGCAA I E * A K I A A * I P T V T T T K S S K I Q R S V I N A W I P T L S T M K G V P GCATAACCAACCC-CGTGTGATCGGCTCCGGCTCGCAACGCAAAATCGGAATCGTCATCA H N Q P R V I G S G S Q R K I G I V I A S Q P P R P L S E S A M R K V G L I I AAGCACTCCTCGACCAAGCCGAAGAACTCGACATCATTAACAAAAACAAAATCCGTTGCA K A L L D Q A E E L D I I N K N K I R C H G I L D L A V E L G V I H Q N P I R T CCGATATCCCCCGCCAAGGAAAAGCAGAACGCCGCTACCTCACCATCCGAGGAATCGACC T D I P R Q G K A E R R Y L T I R G I D G D L P K Q K K S E R R Y L K I T E V D GCCTTTTAGCAGCTGCAATACCCATGAACGAAGTAGCACTCATGCGCAACGTTTTGTTAT R L L A A A P M N E V A L M R N V L L E L I R Q A --- P T E Q A K L L L R V L I TCACCGGTCTTCGCCCAAGGGAAGCAAAAGGATTGAAAGTCAAAGACCTCGACCCCATGC F T G L R P R E A K G L K V K D L D P M M T G L R P G E A K G L K V K D L D P V GCGGTAGGCTGTCCATCCGTCGTGACGTCGACGATCTCGGAAACCCCGATGAAACAAAAA R G R L S I R R D V D D L G N P D E T K R G R L M I R R D V D D L G H E D S T K CCAGAAACCACCGCGGCGTCCCCATCGGTGGTGACCTCCTTTTCGATCTCGACGACCAAG T R N H R G V P I G G D L L F D L D D Q T R N H R D V P I G G E I L L L L D R Y CAGAAGGAAAACAACCACATGACTGGCTCCTCACCGATGAAACCGGCCATGTGTGAACAT A E G K Q P H D W L L T D E T G H V * T A Q G K D P D S W L I P D E R G K V W T CCACAAAATGGCGCAGGCAGTGGGCAACCATCTGCACTCATGCACACATATCAGGCCTGA S T K W R R Q W A T I C T H A H I S G L T S R W R V V W K N L C I W T G I G D L CAACCTACGAGCTACGACACACAGCAGCATCATTGGCGATTGCAGCCGGTGCTGACGTGA T T Y E L R H T A A S L A I A A G A D V D T Y E L R H T A A S I A I A A G A D V AAACCGTTCAACTTATGCTTGGACACGCAAGTGCTGCCACGACCCTTGACACCTACGCAC K T V Q L M L G H A S A A T T L D T Y A K T V Q L M L G H S S A A M T L D I Y A ACTTGTGGGAAACCGGACTAGATTCCGTTCCCGGCGCGATGAGTGCTCATTTGCAGCGTG H L W E T G L D S V P G A M S A H L Q R H L W E E G L D A I P G A M E A H M E S AGCGTGAGAGGTTA---------GCGTTGCGTGAGCGTAGGCGTGTTGAGTGT*GA*GTT E R E R L A L R E R R R V E C V E R K R A EEASTVHEA S E A E R R R A Q F *K** V ACAGGTTATTTAG T G I G ------- // >fig|6666666.67454.peg.1386 fig|196627.4.peg.1346 PTS system, fructose-specific IIA component (EC 2.7.1.69) / PTS system, fructose-specific IIB component (EC 2.7.1.69) / PTS system, fructose-specific IIC component (EC 2.7.1.69) FIG001234 gi|372118535|gb|CP003217.1|_1408365_1408841,gi|372118535|gb|CP003217.1|_1408841_1409113,gi|372118535|gb|CP003217.1|_1409117_1409404,gi|372118535|gb|CP003217.1|_1409404_1409982,gi|372118535|gb|CP003217.1|_1409986_1410000,gi|372118535|gb|CP003217.1|_1410002_1410043,gi|372118535|gb|CP003217.1|_1410047_1410202,gi|372118535|gb|CP003217.1|_1410202_1410351 MPSRLIDNLLIALTPAWDSDKTSIITELCYVMKTAGVTDDVDTLIADTLTREESGSPALPQGVAIPHCRTSVVAHPVIAFASLNKQVLFDGSQNSVDIVFLIVVQLDAKRAHLKVLSTLARAPINETFAASLRAAATPTQVEAIISASLDSQTAMRKIxxPSSPTRIAATTACPTGIAHTYMAADALTSAAKARGDVSLLVETQGASDNSVLSEKEIASADVVIFATDVGVRDRERFKGKRILECSPRHPxRRNRTQEFFKKYDSSTTCNSSCSSNSLRFRTKNAHAAMTGVAYMVPFVAAGGLLLALGFLLGGYDIAAGWQAIAIQHSFTDLPSHDVVIDIATGQxxSFQRSGLLLYLGAVAFAIDSMSMQFIVAALSGYIAFAIAGRSGIAPGYIGGAVSVFVGAGFLGGLVTGLLSGTLAWWLSTRRGPALISSLIPVVIVPLISSLLVGLIMFLVLGKPLSLLLLSLQNWLAGLSGFSAIILGAVLGLMMGFDLGGPVNKAAYLFATAGLSTNEPAALHIMAAVLVAGMLPRLNFLxPPLWIKVFTDTERENGKSAxLLGLSFISEGAIPFAAGDPLRVIPSLMIGGASAGAISMGTATGSHAPHGGIxxLFANSPAWTFLLALLIGVIVSALIVILLKRMWPVPISMTSYSKDSTAA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGCCTTCTAGGCTTATCGACAATTTACTCATCGCTCTCACCCCTGCTTGGGATAGCGAT M P S R L I D N L L I A L T P A W D S D M P S R L I D N L L I A L T P A W D S D AAAACATCAATCATCACGGAGCTTTGTTATGTAATGAAAACAGCTGGAGTTACGGATGAC K T S I I T E L C Y V M K T A G V T D D K T S I I T E L C Y V M K T A G V T D D GTCGACACGCTGATTGCCGATACCCTCACTCGCGAAGAATCTGGCAGCCCCGCACTCCCC V D T L I A D T L T R E E S G S P A L P V D T L I A D T L T R E E S G S P A L P CAAGGCGTTGCGATTCCGCACTGCAGAACGTCAGTCGTAGCACATCCTGTGATCGCTTTT Q G V A I P H C R T S V V A H P V I A F Q G V A I P H C R T S V V A H P V I A F GCATCACTAAACAAACAAGTGCTTTTCGACGGTTCCCAAAATTCTGTGGATATAGTCTTT A S L N K Q V L F D G S Q N S V D I V F A S L N K Q V L F D G S Q N S V D I V F CTCATTGTAGTTCAACTCGATGCGAAAAGAGCTCACCTCAAAGTTCTTTCAACCCTGGCG L I V V Q L D A K R A H L K V L S T L A L I V V Q L D A K R A H L K V L S T L A CGAGCACCGATCAATGAAACGTTCGCAGCATCCTTGCGTGCTGCGGCTACTCCAACACAG R A P I N E T F A A S L R A A A T P T Q R A P I N E T F A A S L R A A A T P T Q GTAGAAGCAATTATTTCTGCATCGCTAGATTCACAAACGGCAATGCGGAAAATA*AT*GC V E A I I S A S L D S Q T A M R K I A V E A I I S A S L D S Q T A M R K I *X** X ACCGAGTTCTCCTACAAGGATTGCGGCAACAACCGCATGTCCTACTGGGATCGCCCATAC P S S P T R I A A T T A C P T G I A H T P S S P T R I A A T T A C P T G I A H T CTATATGGCAGCGGATGCACTTACTTCGGCCGCGAAAGCACGTGGCGACGTCTCATTGTT Y M A A D A L T S A A K A R G D V S L L Y M A A D A L T S A A K A R G D V S L L AGTAGAAACTCAAGGCGCTTCTGACAACTCAGTATTAAGTGAAAAAGAGATCGCTTCAGC V E T Q G A S D N S V L S E K E I A S A V E T Q G A S D N S V L S E K E I A S A TGATGTTGTTATCTTTGCAACCGATGTGGGAGTGCGTGACCGTGAGCGATTCAAAGGGAA D V V I F A T D V G V R D R E R F K G K D V V I F A T D V G V R D R E R F K G K ACGAATCCTTGAATGCAGCCCACGACACCCTTAGCGCCGCAATCGCACTCAAGAATTCTT R I L E C S P R H P * R R N R T Q E F F R I L E C S P R H P X R R N R T Q E F F CAAGAAATACGACAGTTCGACCACATGCAACTCATCGTGTAGCAGCAACAGCCTACGATT K K Y D S S T T C N S S C S S N S L R F K K Y D S S T T C N S S C S S N S L R F TAGAACGAAAAATGCGCACGCTGCGATGACAGGTGTTGCCTACATGGTTCCGTTCGTAGC R T K N A H A A M T G V A Y M V P F V A R T K N A H A A M T G V A Y M V P F V A AGCCGGAGGATTACTGTTAGCCCTCGGATTTCTTTTGGGAGGCTACGACATAGCTGCTGG A G G L L L A L G F L L G G Y D I A A G A G G L L L A L G F L L G G Y D I A A G ATGGCAGGCAATTGCTATTCAGCATTCGTTCACTGATCTGCCCAGCCACGATGTGGTCAT W Q A I A I Q H S F T D L P S H D V V I W Q A I A I Q H S F T D L P S H D V V I CGATATAGCAACAGGACAG*TC*GTATCATTTCAGCGCTCTGGCCTTTTGCTTTATCTTG D I A T G Q V S F Q R S G L L L Y L D I A T G Q *X** X S F Q R S G L L L Y L GCGCTGTGGCTTTTGCTATCGACTCAATGTCAATGCAATTTATTGTGGCTGCACTTTCAG G A V A F A I D S M S M Q F I V A A L S G A V A F A I D S M S M Q F I V A A L S GATACATTGCGTTTGCTATCGCTGGACGCTCAGGAATAGCTCCAGGTTATATCGGCGGTG G Y I A F A I A G R S G I A P G Y I G G G Y I A F A I A G R S G I A P G Y I G G CGGTATCAGTCTTCGTTGGCGCAGGATTTTTGGGCGGATTAGTCACCGGGCTACTGTCTG A V S V F V G A G F L G G L V T G L L S A V S V F V G A G F L G G L V T G L L S GAACGCTTGCATGGTGGCTTTCTACGAGGCGGGGTCCCGCACTTATCTCGTCGCTTATAC G T L A W W L S T R R G P A L I S S L I G T L A W W L S T R R G P A L I S S L I CCGTAGTAATTGTTCCGCTCATTTCCAGCCTTCTTGTGGGTTTGATCATGTTCTTAGTTT P V V I V P L I S S L L V G L I M F L V P V V I V P L I S S L L V G L I M F L V TGGGCAAACCCCTTTCATTGTTGCTTCTATCCCTCCAAAACTGGCTGGCAGGACTATCGG L G K P L S L L L L S L Q N W L A G L S L G K P L S L L L L S L Q N W L A G L S GTTTTTCAGCCATCATTCTTGGGGCAGTGCTGGGACTTATGATGGGTTTCGACCTCGGTG G F S A I I L G A V L G L M M G F D L G G F S A I I L G A V L G L M M G F D L G GTCCTGTAAATAAAGCAGCATATTTATTTGCTACCGCAGGCCTGTCCACCAATGAACCTG G P V N K A A Y L F A T A G L S T N E P G P V N K A A Y L F A T A G L S T N E P CTGCGCTTCATATTATGGCGGCAGTCTTGGTCGCAGGTATGCTCCCCCGGTTAAACTTTC A A L H I M A A V L V A G M L P R L N F A A L H I M A A V L V A G M L P R L N F TTTAGCCACCATTATGGATAAAAAGTGTTTACAGATACAGAACGGGAAAACGGAAAATCA L * P P L W I K V F T D T E R E N G K S L X P P L W I K - V F T D T E R E N G K S GCCTAGCTTTTAGGACTTTCCTTCATTTCTGAAGGAGCGATCCCTTTTGCCGCAGGTGAT A * L L G L S F I S E G A I P F A A G D A X L L G L S F I S E G A I P F A A G D CCATTAAGGGTGATACCGTCATTGATGATTGGAGGCGCATCAGCTGGCGCAATTTCCATG P L R V I P S L M I G G A S A G A I S M P L R V I P S L M I G G A S A G A I S M GGGACCGCGACCGGCTCGCATGCTCCGCATGGCGGAATT*TT*GTACTCTTTGCGAATTC G T A T G S H A P H G G I V L F A N S G T A T G S H A P H G G I *X** X L F A N S TCCAGCGTGGACATTCCTCTTAGCTTTACTCATTGGCGTGATTGTTTCCGCGCTCATTGT P A W T F L L A L L I G V I V S A L I V P A W T F L L A L L I G V I V S A L I V CATTCTCTTAAAGCGTATGTGGCCCGTTCCAATCTCCATGACTTCGTACAGTAAAGACAG I L L K R M W P V P I S M T S Y S K D S I L L K R M W P V P I S M T S Y S K D S TACGGCGGCTTAA T A A T A A --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.1346): ATGCCTTCTAGGCTTATCGACAATTTACTCATCGCTCTCACCCCTGCTTGGGATAGCGAT M P S L I D N L L I A L T P A W D S D M N S --- V N N S S L V R L D V D F G D S AAAACATCAATCATCACGGAGCTTTGTTATGTAATGAAAACAGCTGGAGTTACGGATGAC K T S I I T E L C Y V M K T A G V T D D T T D V I N N L A T V I F D A G R A S S GTCGACACGCTGATTGCCGATACCCTCACTCGCGAAGAATCTGGCAGCCCCGCACTCCCC V D T L I A D T L T R E E S G S P A L P A D A L A K D A L D R E A K S G T G V P CAAGGCGTTGCGATTCCGCACTGCAGAACGTCAGTCGTAGCACATCCTGTGATCGCTTTT Q G V A I P H C R T S V V A H P V I A F G Q V A I P H C R S E A V S V P T L G F GCATCACTAAACAAACAAGTGCTTTTCGACGGTTCCCAAAATTCTGTGGATATAGTCTTT A S L N K Q V L F D G S Q N S V D I V F A R L S K G V D F S G P D G D A N L V F CTCATTGTAGTTCAACTCGATGCGAAAAGAGCTCACCTCAAAGTTCTTTCAACCCTGGCG L I V V Q L D A K R A H L K V L S T L A L I A A P A G G G K E H L K I L S K L A CGAGCACCGATCAATGAAACGTTCGCAGCATCCTTGCGTGCTGCGGCTACTCCAACACAG R A P I N E T F A A S L R A A A T P T Q R S L V K K D F I K A L Q E A T T E Q E GTAGAAGCAATTATTTCTGCATCGCTAGAT------------TCACAAACGGCA*AT*GC V E A I I S A S L D S Q T A A I V D V V D A V L N PAPKTTEPAAAP A A A A *V** A GGAAAATAATGCACCGAGT-TCTCCTACAAGGATTGCGGCAACAACCGCATGTCCTACTG E N N A P S S P T R I A A T T A C P T E S G A A S T S V T R I V A I T A C P T GGATCGCCCATACCTATATGGCAGCGGATGCACTTACTTCGGCCGCGAAAGCACGTGGCG G I A H T Y M A A D A L T S A A K A R G G I A H T Y M A A D S L T Q N A E G R D ACGTCTCATTGTTAGTAGAAACTCAAGGCGCTTCTGACAACTCAGTATTAAGTGAAAAAG D V S L L V E T Q G A S D N S V L S E K D V E L V V E T Q G S S A V T P V D P K AGATCGCTTCAGCTGATGTTGTTATCTTTGCAACCGATGTGGGAGTGCGTGACCGTGAGC E I A S A D V V I F A T D V G V R D R E I I E A A D A V I F A T D V G V K D R E GATTCAAAGGGAAACGAATCCTTGAATGCAGC-------CCA*C*GACACCCTTAGCGCC R F K G K R I L E C S P D T L S A R F A G K P V I E S G VKRAINE P *A* K M I D E GCAATCGCACTCAAGAATTCTTCAAGAAATACGACAGTTCGACCACATGCAACTCATCGT A I A S S R N T T V R P H A T H R A I A --------- A S K N P N A R K V S G S G GTAGCAGCAACAGCCTACGATTTAGAACGAAAAATG*CG*------CACGCTGCGATGAC V A A T A Y D L E R K M H A A M T V A A S A E T T G E K L *G**WGKRIQ Q A V M T AGGTGTTGCCTACATGGTTCCGTTCGTAGCAGCCGGAGGATTACTGTTAGCCCTCGGATT G V A Y M V P F V A A G G L L L A L G F G V S Y M V P F V A A G G L L L A L G F TCTTTTGGGAGGCTACGACATAGCTGCTGGATGGCAGGCAATTGCTATTCAGCATTCGTT L L G G Y D I A A G W Q A I A I Q H S F A F G G Y D M A N G W Q A I A T Q F S L CACTGATCTGCCCAGCCACGATGTGGTCATCGAT-ATAGCAACAGGACAGTCGTATCATT T D L P S H D V V I D I A V S F T N L P G N T V D V D G V A ----------- M T F TCAGCGCTCTGGCCTTTTGCTTTATCTTGGCGCTGTGGCTTTTGCTATCGACTCAATGTC Q R S G L L L Y L G A V A F A I D S M S E R S G F L L Y F G A V L F A T G Q A A AATGCAATTTATTGTGGCTGCACTTTCAGGATACATTGCGTTTGCTATCGCTGGACGCTC M Q F I V A A L S G Y I A F A I A G R S M G F I V A A L S G Y T A Y A L A G R P AGGAATAGCTCCAGGTTATATCGGCGGTGCGGTATCAGTCTTCGTTGGCGCAGGATTTTT G I A P G Y I G G A V S V F V G A G F L G I A P G F V G G A I S V T I G A G F I GGGCGGATTAGTCACCGGGCTACTGTCTGGAACGCTTGCATGGTGGCTTTCTACGAGGCG G G L V T G L L S G T L A W W L S T R R G G L V T G I L A G L I A L W I G S W K GGGTCCCGCACTTATCTCGTCGCTTATACCCGTAGTAATTGTTCCGCTCATTTCCAGCCT G P A L I S S L I P V V I V P L I S S L V P R V V Q S L M P V V I I P L L T S V TCTTGTGGGTTTGATCATGTTCTTAGTTTTGGGCAAACCCCTTTCATTGTTGCTTCTATC L V G L I M F L V L G K P L S L L L L S V V G L V M Y L L L G R P L A S I M T G CCTCCAAAACTGGCTGGCAGGACTATCGGGTTTTTCAGCCATCATTCTTGGGGCAGTGCT L Q N W L A G L S G F S A I I L G A V L L Q D W L S S M S G S S A I L L G I I L GGGACTTATGATGGGTTTCGACCTCGGTGGTCCTGTAAATAAAGCAGCATATTTATTTGC G L M M G F D L G G P V N K A A Y L F A G L M M C F D L G G P V N K A A Y L F G TACCGCAGGCCTGTCCACCAATGAACCTGCTGCGCTTCATATTATGGCGGCAGTCTTGGT T A G L S T N E P A A L H I M A A V L V T A G L S T G D Q A S M E I M A A I M A CGCAGGTATG*CT*CCCCCGGTTAAACTTTCTTTAGCCACCATTATGGATAAAAAG*TG* A G M P P V K L S L A T I M D K K A G M *V** P P I A L S I A T L L R K K *L** TTTACAGATACAGAACGGGAAAACGGAAAATCAGCCTAGCTTTTAGGACTTTCCTTCATT F T D T E R E N G K S A * L L G L S F I F T P A E Q E N G K S S W L L G L A F V TCTGAAGGAGCGATCCCTTTTGCCGCAGGTGATCCATTAAGGGTGATACCGTCATTGATG S E G A I P F A A G D P L R V I P S L M S E G A I P F A A A D P F R V I P A M M ATTGGAGGCGCATCAGCTGGCGCAATTTCCATGGGGACCGCGACCGGCTCGCATGCTCCG I G G A S A G A I S M G T A T G S H A P A G G A T T G A I S M A L G V G S R A P CATGGCGGA*AT*TTTGTACTCTTTGCGAATTCTCCAGCGTGGACATTCCTCTTAGCTTT H G G F V L F A N S P A W T F L L A L H G G *I** F V V W A I E P W W G W L I A L ACTCATTGGCGTGATTGTTTCCGCGCTCATTGTCATTCTCTTAAAGCGTATGTGGCCCGT L I G V I V S A L I V I L L K R M W P V A A G T I V S T I V V I A L K Q F W P N TCCAATCTCCATGACTTCGTACAGTAAAGACAGTACGGCGGCTTAA---- P I S M T S Y S K D S T A A * K A V A A E V A K Q E A Q Q A AVNA // >fig|6666666.67454.peg.1734 fig|257309.1.peg.726 Putative transposase gi|372118535|gb|CP003217.1|_1769865_1770302,gi|372118535|gb|CP003217.1|_1770302_1771177 MQRQFWGLIATGITTAQAALQVGVSVPVGTRWFRHAGGMRPLALDEPSGRYLSFTEREEIAILWEKQTGVREIARRIGRNPATISRELRRNTATRGGKQIYRAGVAQWKAQEAAKRPKQAKLVDNPRLRDYVQERLAGTVRDETGxxMAGPDTPAWKGRSKPHRADRRWLTAWSPEQISQRLRIDFPDDESMRISHEAIYQALYIEGRGALKRELVAALRTGRALRKPRARSKSKPKGHLTADVVISNRPPEASDRAVPGHWEGDLIIGTGRSAIGTVVERYSRSILLVHLPRLDGWGEQPRTKNGPALGGYGAEAMNTALQTVMKDLPLQLRQTLTWDRGTELADHAAFTLATGTKVFFADPHSPWQRPTNENSNGLLRQYFPKGTDLSRWTAQDLAAIAYTLNNRPRKVLGFRTPAEVFNEQLQSIQNNSVATTD We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCAACGCCAGTTCTGGGGTCTGATCGCGACGGGAATCACCACTGCGCAGGCCGCCCTT V Q R Q F W G L I A T G I T T A Q A A L M Q R Q F W G L I A T G I T T A Q A A L CAGGTGGGGGTGTCCGTACCGGTGGGAACGAGGTGGTTCCGTCATGCTGGTGGAATGAGA Q V G V S V P V G T R W F R H A G G M R Q V G V S V P V G T R W F R H A G G M R CCGTTAGCTTTGGACGAGCCCTCGGGGCGGTATCTATCGTTTACTGAACGAGAGGAAATC P L A L D E P S G R Y L S F T E R E E I P L A L D E P S G R Y L S F T E R E E I GCGATCCTGTGGGAGAAACAGACGGGTGTGCGTGAGATCGCTCGACGGATTGGCCGCAAT A I L W E K Q T G V R E I A R R I G R N A I L W E K Q T G V R E I A R R I G R N CCGGCGACGATTTCTCGTGAGCTACGGCGTAATACTGCCACCCGTGGTGGCAAGCAGATT P A T I S R E L R R N T A T R G G K Q I P A T I S R E L R R N T A T R G G K Q I TATCGGGCAGGGGTGGCCCAGTGGAAAGCTCAGGAAGCCGCTAAGCGTCCCAAACAAGCA Y R A G V A Q W K A Q E A A K R P K Q A Y R A G V A Q W K A Q E A A K R P K Q A AAACTCGTGGATAATCCGCGCCTGCGGGACTATGTTCAGGAGCGTCTTGCTGGGACGGTC K L V D N P R L R D Y V Q E R L A G T V K L V D N P R L R D Y V Q E R L A G T V CGAGATGAAACGGGG*TC*GTCATGGCGGGGCCTGATACGCCTGCGTGGAAGGGCCGGAG R D E T G V M A G P D T P A W K G R S R D E T G *X** X M A G P D T P A W K G R S CAAACCTCACAGGGCAGACCGACGGTGGTTGACCGCGTGGAGCCCGGAGCAGATATCGCA K P H R A D R R W L T A W S P E Q I S Q K P H R A D R R W L T A W S P E Q I S Q GCGGTTAAGGATCGACTTCCCTGATGATGAGAGTATGAGAATCTCCCATGAAGCGATCTA R L R I D F P D D E S M R I S H E A I Y R L R I D F P D D E S M R I S H E A I Y CCAGGCGCTCTATATTGAGGGGCGCGGGGCGCTGAAGCGTGAACTCGTGGCCGCACTGCG Q A L Y I E G R G A L K R E L V A A L R Q A L Y I E G R G A L K R E L V A A L R GACTGGGCGGGCCCTGCGTAAACCCCGCGCCCGGTCCAAGAGCAAGCCTAAAGGTCATCT T G R A L R K P R A R S K S K P K G H L T G R A L R K P R A R S K S K P K G H L CACCGCCGATGTTGTCATCTCTAACCGGCCCCCGGAAGCCTCGGATCGGGCGGTGCCCGG T A D V V I S N R P P E A S D R A V P G T A D V V I S N R P P E A S D R A V P G GCATTGGGAAGGAGACTTGATCATCGGTACCGGCAGGTCAGCGATCGGGACCGTGGTCGA H W E G D L I I G T G R S A I G T V V E H W E G D L I I G T G R S A I G T V V E ACGCTACAGCCGGTCGATCCTGCTGGTGCACCTGCCCCGGTTGGACGGCTGGGGTGAACA R Y S R S I L L V H L P R L D G W G E Q R Y S R S I L L V H L P R L D G W G E Q ACCAAGGACGAAGAACGGACCTGCCTTGGGTGGGTACGGTGCTGAAGCGATGAACACCGC P R T K N G P A L G G Y G A E A M N T A P R T K N G P A L G G Y G A E A M N T A CCTACAAACCGTGATGAAAGATCTACCGTTACAACTGCGTCAAACGTTGACCTGGGACCG L Q T V M K D L P L Q L R Q T L T W D R L Q T V M K D L P L Q L R Q T L T W D R CGGAACCGAGCTCGCTGACCATGCCGCTTTCACTCTAGCCACGGGCACGAAAGTGTTCTT G T E L A D H A A F T L A T G T K V F F G T E L A D H A A F T L A T G T K V F F CGCGGACCCACACTCGCCATGGCAACGTCCCACGAATGAGAACAGCAACGGACTCCTACG A D P H S P W Q R P T N E N S N G L L R A D P H S P W Q R P T N E N S N G L L R CCAGTACTTTCCCAAGGGTACCGACCTGTCTCGATGGACAGCCCAAGACCTCGCCGCCAT Q Y F P K G T D L S R W T A Q D L A A I Q Y F P K G T D L S R W T A Q D L A A I CGCCTACACGCTCAACAACAGACCAAGAAAAGTCCTTGGATTTCGAACCCCAGCCGAAGT A Y T L N N R P R K V L G F R T P A E V A Y T L N N R P R K V L G F R T P A E V CTTCAATGAACAACTACAATCAATTCAAAACAACAGTGTTGCAACCACCGATTGA F N E Q L Q S I Q N N S V A T T D F N E Q L Q S I Q N N S V A T T D --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.726): GTGCAACGCCAGTTCTGGGGTCTGATCGCGACGGGAATCACCACTGCGCAGGCCGCCCTT V Q R Q F W G L I A T G I T T A Q A A L M Q R Q F W G L I A T G I T T A Q A A L CAGGTGGGGGTGTCCGTACCGGTGGGAACGAGGTGGTTCCGTCATGCTGGTGGAATGAGA Q V G V S V P V G T R W F R H A G G M R Q V G V S V P V G T R W F R H A G G M R CCGTTAGCTTTGGACGAGCCCTCGGGGCGGTATCTATCGTTTACTGAACGAGAGGAAATC P L A L D E P S G R Y L S F T E R E E I P L A L D E P S G R Y L S F A E R E E I GCGATCCTGTGGGAGAAACAGACGGGTGTGCGTGAGATCGCTCGACGGATTGGCCGCAAT A I L W E K Q T G V R E I A R R I G R N A I L W E K Q T G V R E I A R R I G R N CCGGCGACGATTTCTCGTGAGCTACGGCGTAATACTGCCACCCGTGGTGGCAAGCAGATT P A T I S R E L R R N T A T R G G K Q I P A T I S R E L R R N A A T R G G K Q I TATCGGGCAGGGGTGGCCCAGTGGAAAGCTCAGGAAGCCGCTAAGCGTCCCAAACAAGCA Y R A G V A Q W K A Q E A A K R P K Q A Y R V G V A Q W K A Q E A A K R P K Q A AAACTCGTGGATAATCCGCGCCTGCGGGACTATGTTCAGGAGCGTCTTGCTGGGACGGTC K L V D N P R L R D Y V Q E R L A G T V K L V D N P R L R D Y V Q E R L A G T V CGAGAT*GA*AACGGGGTCGTCATGGCGGGGCCTGATACGCCTGCGTGGAAGGGCCGGAG R D N G V V M A G P D T P A W K G R S R D *E** N G V V M A G P D T P A W K G R S CAAACCTCACAGGGCAGACCGACGGTGGTTGACCGCGTGGAGCCCGGAGCAGATATCGCA K P H R A D R R W L T A W S P E Q I S Q K P H R A D R R W L T A W S P E Q I S Q GCGGTTAAGGATCGACTTCCCTGATGATGAGAGTATGAGAATCTCCCATGAAGCGATCTA R L R I D F P D D E S M R I S H E A I Y R L R I D F P D D E S M R I S H E A I Y CCAGGCGCTCTATATTGAGGGGCGCGGGGCGCTGAAGCGTGAACTCGTGGCCGCACTGCG Q A L Y I E G R G A L K R E L V A A L R Q A L Y I E G R G A L K R E L V A A L R GACTGGGCGGGCCCTGCGTAAACCCCGCGCCCGGTCCAAGAGCAAGCCTAAAGGTCATCT T G R A L R K P R A R S K S K P K G H L T G R A L R K P R A R S K S K P K G H V CACCGCCGATGTTGTCATCTCTAACCGGCCCCCGGAAGCCTCGGATCGGGCGGTGCCCGG T A D V V I S N R P P E A S D R A V P G T A D V V I S N R P P E A S D R A V P G GCATTGGGAAGGAGACTTGATCATCGGTACCGGCAGGTCAGCGATCGGGACCGTGGTCGA H W E G D L I I G T G R S A I G T V V E H W E G D L I I G T G R S A I G T V V E ACGCTACAGCCGGTCGATCCTGCTGGTGCACCTGCCCCGGTTGGACGGCTGGGGTGAACA R Y S R S I L L V H L P R L D G W G E Q R Y S R S I L L V H L P R L D G W G E Q ACCAAGGACGAAGAACGGACCTGCCTTGGGTGGGTACGGTGCTGAAGCGATGAACACCGC P R T K N G P A L G G Y G A E A M N T A P R T K N G P A L G G Y G A E A M N T A CCTACAAACCGTGATGAAAGATCTACCGTTACAACTGCGTCAAACGTTGACCTGGGACCG L Q T V M K D L P L Q L R Q T L T W D R L Q T V M K D L P L Q L R Q T L T W D R CGGAACCGAGCTCGCTGACCATGCCGCTTTCACTCTAGCCACGGGCACGAAAGTGTTCTT G T E L A D H A A F T L A T G T K V F F G T E L A D H A A F T L A T G T K V F F CGCGGACCCACACTCGCCATGGCAACGTCCCACGAATGAGAACAGCAACGGACTCCTACG A D P H S P W Q R P T N E N S N G L L R A D P H S P W Q R P T N E N S N G L L R CCAGTACTTTCCCAAGGGTACCGACCTGTCTCGATGGACAGCCCAAGACCTCGCCGCCAT Q Y F P K G T D L S R W T A Q D L A A I Q Y F P K G T D L S R W T A Q D L A A I CGCCTACACGCTCAACAACAGACCAAGAAAAGTCCTTGGATTTCGAACCCCAGCCGAAGT A Y T L N N R P R K V L G F R T P A E V A Y T L N N R P R K V L G F R T P A E V CTTCAATGAACAACTACAATCAATTCAAAACAACAGTGTTGCAACCACCGATTGA F N E Q L Q S I Q N N S V A T T D F N E Q L Q S I Q N N S V A T T D --- // >fig|6666666.67454.peg.685 fig|257309.1.peg.726 Putative transposase gi|372118535|gb|CP003217.1|_679178_678741,gi|372118535|gb|CP003217.1|_678741_677866 MQRQFWGLIATGITTAQAALQVGVSVPVGTRWFRHAGGMRPLALDEPSGRYLSFTEREEIAILWEKQTGVREIARRIGRNPATISRELRRNTATRGGKQIYRAGVAQWKAQEAAKRPKQAKLVDNPRLRDYVQERLAGTVRDETGxxMAGPDTPAWKGRSKPHRADRRWLTAWSPEQISQRLRIDFPDDESMRISHEAIYQALYIEGRGALKRELVAALRTGRALRKPRARSKSKPKGHLTADVVISNRPPEASDRAVPGHWEGDLIIGTGRSAIGTVVERYSRSILLVHLPRLDGWGEQPRTKNGPALGGYGAEAMNTALQTVMKDLPLQLRQTLTWDRGTELADHAAFTLATGTKVFFADPHSPWQRPTNENSNGLLRQYFPKGTDLSRWTAQDLAAIAYTLNNRPRKVLGFRTPAEVFNEQLQSIQNNSVATTD We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCAACGCCAGTTCTGGGGTCTGATCGCGACGGGAATCACCACTGCGCAGGCCGCCCTT V Q R Q F W G L I A T G I T T A Q A A L M Q R Q F W G L I A T G I T T A Q A A L CAGGTGGGGGTGTCCGTACCGGTGGGAACGAGGTGGTTCCGTCATGCTGGTGGAATGAGA Q V G V S V P V G T R W F R H A G G M R Q V G V S V P V G T R W F R H A G G M R CCGTTAGCTTTGGACGAGCCCTCGGGGCGGTATCTATCGTTTACTGAACGAGAGGAAATC P L A L D E P S G R Y L S F T E R E E I P L A L D E P S G R Y L S F T E R E E I GCGATCCTGTGGGAGAAACAGACGGGTGTGCGTGAGATCGCTCGACGGATTGGCCGCAAT A I L W E K Q T G V R E I A R R I G R N A I L W E K Q T G V R E I A R R I G R N CCGGCGACGATTTCTCGTGAGCTACGGCGTAATACTGCCACCCGTGGTGGCAAGCAGATT P A T I S R E L R R N T A T R G G K Q I P A T I S R E L R R N T A T R G G K Q I TATCGGGCAGGGGTGGCCCAGTGGAAAGCTCAGGAAGCCGCTAAGCGTCCCAAACAAGCA Y R A G V A Q W K A Q E A A K R P K Q A Y R A G V A Q W K A Q E A A K R P K Q A AAACTCGTGGATAATCCGCGCCTGCGGGACTATGTTCAGGAGCGTCTTGCTGGGACGGTC K L V D N P R L R D Y V Q E R L A G T V K L V D N P R L R D Y V Q E R L A G T V CGAGATGAAACGGGG*TC*GTCATGGCGGGGCCTGATACGCCTGCGTGGAAGGGCCGGAG R D E T G V M A G P D T P A W K G R S R D E T G *X** X M A G P D T P A W K G R S CAAACCTCACAGGGCAGACCGACGGTGGTTGACCGCGTGGAGCCCGGAGCAGATATCGCA K P H R A D R R W L T A W S P E Q I S Q K P H R A D R R W L T A W S P E Q I S Q GCGGTTAAGGATCGACTTCCCTGATGATGAGAGTATGAGAATCTCCCATGAAGCGATCTA R L R I D F P D D E S M R I S H E A I Y R L R I D F P D D E S M R I S H E A I Y CCAGGCGCTCTATATTGAGGGGCGCGGGGCGCTGAAGCGTGAACTCGTGGCCGCACTGCG Q A L Y I E G R G A L K R E L V A A L R Q A L Y I E G R G A L K R E L V A A L R GACTGGGCGGGCCCTGCGTAAACCCCGCGCCCGGTCCAAGAGCAAGCCTAAAGGTCATCT T G R A L R K P R A R S K S K P K G H L T G R A L R K P R A R S K S K P K G H L CACCGCCGATGTTGTCATCTCTAACCGGCCCCCGGAAGCCTCGGATCGGGCGGTGCCCGG T A D V V I S N R P P E A S D R A V P G T A D V V I S N R P P E A S D R A V P G GCATTGGGAAGGAGACTTGATCATCGGTACCGGCAGGTCAGCGATCGGGACCGTGGTCGA H W E G D L I I G T G R S A I G T V V E H W E G D L I I G T G R S A I G T V V E ACGCTACAGCCGGTCGATCCTGCTGGTGCACCTGCCCCGGTTGGACGGCTGGGGTGAACA R Y S R S I L L V H L P R L D G W G E Q R Y S R S I L L V H L P R L D G W G E Q ACCAAGGACGAAGAACGGACCTGCCTTGGGTGGGTACGGTGCTGAAGCGATGAACACCGC P R T K N G P A L G G Y G A E A M N T A P R T K N G P A L G G Y G A E A M N T A CCTACAAACCGTGATGAAAGATCTACCGTTACAACTGCGTCAAACGTTGACCTGGGACCG L Q T V M K D L P L Q L R Q T L T W D R L Q T V M K D L P L Q L R Q T L T W D R CGGAACCGAGCTCGCTGACCATGCCGCTTTCACTCTAGCCACGGGCACGAAAGTGTTCTT G T E L A D H A A F T L A T G T K V F F G T E L A D H A A F T L A T G T K V F F CGCGGACCCACACTCGCCATGGCAACGTCCCACGAATGAGAACAGCAACGGACTCCTACG A D P H S P W Q R P T N E N S N G L L R A D P H S P W Q R P T N E N S N G L L R CCAGTACTTTCCCAAGGGTACCGACCTGTCTCGATGGACAGCCCAAGACCTCGCCGCCAT Q Y F P K G T D L S R W T A Q D L A A I Q Y F P K G T D L S R W T A Q D L A A I CGCCTACACGCTCAACAACAGACCAAGAAAAGTCCTTGGATTTCGAACCCCAGCCGAAGT A Y T L N N R P R K V L G F R T P A E V A Y T L N N R P R K V L G F R T P A E V CTTCAATGAACAACTACAATCAATTCAAAACAACAGTGTTGCAACCACCGATTGA F N E Q L Q S I Q N N S V A T T D F N E Q L Q S I Q N N S V A T T D --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.726): GTGCAACGCCAGTTCTGGGGTCTGATCGCGACGGGAATCACCACTGCGCAGGCCGCCCTT V Q R Q F W G L I A T G I T T A Q A A L M Q R Q F W G L I A T G I T T A Q A A L CAGGTGGGGGTGTCCGTACCGGTGGGAACGAGGTGGTTCCGTCATGCTGGTGGAATGAGA Q V G V S V P V G T R W F R H A G G M R Q V G V S V P V G T R W F R H A G G M R CCGTTAGCTTTGGACGAGCCCTCGGGGCGGTATCTATCGTTTACTGAACGAGAGGAAATC P L A L D E P S G R Y L S F T E R E E I P L A L D E P S G R Y L S F A E R E E I GCGATCCTGTGGGAGAAACAGACGGGTGTGCGTGAGATCGCTCGACGGATTGGCCGCAAT A I L W E K Q T G V R E I A R R I G R N A I L W E K Q T G V R E I A R R I G R N CCGGCGACGATTTCTCGTGAGCTACGGCGTAATACTGCCACCCGTGGTGGCAAGCAGATT P A T I S R E L R R N T A T R G G K Q I P A T I S R E L R R N A A T R G G K Q I TATCGGGCAGGGGTGGCCCAGTGGAAAGCTCAGGAAGCCGCTAAGCGTCCCAAACAAGCA Y R A G V A Q W K A Q E A A K R P K Q A Y R V G V A Q W K A Q E A A K R P K Q A AAACTCGTGGATAATCCGCGCCTGCGGGACTATGTTCAGGAGCGTCTTGCTGGGACGGTC K L V D N P R L R D Y V Q E R L A G T V K L V D N P R L R D Y V Q E R L A G T V CGAGAT*GA*AACGGGGTCGTCATGGCGGGGCCTGATACGCCTGCGTGGAAGGGCCGGAG R D N G V V M A G P D T P A W K G R S R D *E** N G V V M A G P D T P A W K G R S CAAACCTCACAGGGCAGACCGACGGTGGTTGACCGCGTGGAGCCCGGAGCAGATATCGCA K P H R A D R R W L T A W S P E Q I S Q K P H R A D R R W L T A W S P E Q I S Q GCGGTTAAGGATCGACTTCCCTGATGATGAGAGTATGAGAATCTCCCATGAAGCGATCTA R L R I D F P D D E S M R I S H E A I Y R L R I D F P D D E S M R I S H E A I Y CCAGGCGCTCTATATTGAGGGGCGCGGGGCGCTGAAGCGTGAACTCGTGGCCGCACTGCG Q A L Y I E G R G A L K R E L V A A L R Q A L Y I E G R G A L K R E L V A A L R GACTGGGCGGGCCCTGCGTAAACCCCGCGCCCGGTCCAAGAGCAAGCCTAAAGGTCATCT T G R A L R K P R A R S K S K P K G H L T G R A L R K P R A R S K S K P K G H V CACCGCCGATGTTGTCATCTCTAACCGGCCCCCGGAAGCCTCGGATCGGGCGGTGCCCGG T A D V V I S N R P P E A S D R A V P G T A D V V I S N R P P E A S D R A V P G GCATTGGGAAGGAGACTTGATCATCGGTACCGGCAGGTCAGCGATCGGGACCGTGGTCGA H W E G D L I I G T G R S A I G T V V E H W E G D L I I G T G R S A I G T V V E ACGCTACAGCCGGTCGATCCTGCTGGTGCACCTGCCCCGGTTGGACGGCTGGGGTGAACA R Y S R S I L L V H L P R L D G W G E Q R Y S R S I L L V H L P R L D G W G E Q ACCAAGGACGAAGAACGGACCTGCCTTGGGTGGGTACGGTGCTGAAGCGATGAACACCGC P R T K N G P A L G G Y G A E A M N T A P R T K N G P A L G G Y G A E A M N T A CCTACAAACCGTGATGAAAGATCTACCGTTACAACTGCGTCAAACGTTGACCTGGGACCG L Q T V M K D L P L Q L R Q T L T W D R L Q T V M K D L P L Q L R Q T L T W D R CGGAACCGAGCTCGCTGACCATGCCGCTTTCACTCTAGCCACGGGCACGAAAGTGTTCTT G T E L A D H A A F T L A T G T K V F F G T E L A D H A A F T L A T G T K V F F CGCGGACCCACACTCGCCATGGCAACGTCCCACGAATGAGAACAGCAACGGACTCCTACG A D P H S P W Q R P T N E N S N G L L R A D P H S P W Q R P T N E N S N G L L R CCAGTACTTTCCCAAGGGTACCGACCTGTCTCGATGGACAGCCCAAGACCTCGCCGCCAT Q Y F P K G T D L S R W T A Q D L A A I Q Y F P K G T D L S R W T A Q D L A A I CGCCTACACGCTCAACAACAGACCAAGAAAAGTCCTTGGATTTCGAACCCCAGCCGAAGT A Y T L N N R P R K V L G F R T P A E V A Y T L N N R P R K V L G F R T P A E V CTTCAATGAACAACTACAATCAATTCAAAACAACAGTGTTGCAACCACCGATTGA F N E Q L Q S I Q N N S V A T T D F N E Q L Q S I Q N N S V A T T D --- // >fig|6666666.67454.peg.1966 fig|257309.1.peg.1949 Excinuclease ABC subunit A paralog of unknown function FIG133034 gi|372118535|gb|CP003217.1|_2002702_2004948,gi|372118535|gb|CP003217.1|_2004948_2005373 MSYLHERITDKETHIQPDVRVMGARQNNLQNVDLSVPRDALVVFTGVSGSGKSSLAFGTLYAESQRRYLESVAPYARRLIDQAGVPEVDSITGMPPAVALQQQRGGQNSRSTVGSITTISSLVRMLYSRAGQYPEHQSMLYAEDFSANTPQGACPKCHGIGRVYEVEENQMVPDPTKTIRERAIASWPTAWHGHQLRDVLVALGYDVDVPWKDLPEKDRDWILYTEETPHVPVYSRMTLAEAQAAKKTGAEPSYSGTYVGAKRYVLDTFANTKSASMKRKVAQFLTSIPCPSCHGKRIKAEALSVTFAGVDIADFSQLPLHELVNLLDEEVQHASKKLALDADGLETLGHDLDEENRKKSADQRIEAGGAPHEAAPDVRRTPNHSVEKLATTARLGAGLVERLRPIIDLGLGYLSLDRMTPTLSGGELQRLRLATQLSSELFGVVYVLDEPSAGLHPQDIHALLGVLDGLKARGNSLFVVEHSIEVMQHADWIVDVGPGAGERGGKILYSGQVEGLAKVTDSVTRGYLFGDSGLPQHTPRKPSQWMKLSGVTRNNLHNVDIEIPLGALTAVTGVSGSGKSSLVSQALPQLVGNRLGKNMSGDETDLEADDLLRAEQTPAVSGNIVGDFSGIHRVVAIDQKPIGRTPRSNIATYTGLFDHLRRRFAETVEAKRRRYKPGRFSFNVAGGRCPTCEGEGSVMVELLFLPSVYTKCPDCHGTRYQSSTLEILWRGKNVSEVLDLNVNEALDFxxGEFDIMRSLTALRDVGLGYLRLGQPATELSGGEAQRVKLATELQRAQRGDTLYVLDEPTTGLHCSDADRLISHLQTLVDSGNTVVMVELDMRIIAAADYVIDMGPGAGEEGGQIVAAGTPAEVATSEESVSAPFLAAALR We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGCTATTTACATGAACGCATCACAGACAAGGAAACTCATATTCAACCAGATGTTCGA M S Y L H E R I T D K E T H I Q P D V R M S Y L H E R I T D K E T H I Q P D V R GTAATGGGAGCACGCCAGAACAACCTGCAAAACGTTGATCTTTCTGTGCCCCGCGATGCT V M G A R Q N N L Q N V D L S V P R D A V M G A R Q N N L Q N V D L S V P R D A CTCGTCGTCTTCACTGGTGTTTCAGGATCAGGGAAATCCTCTCTTGCCTTTGGAACCCTC L V V F T G V S G S G K S S L A F G T L L V V F T G V S G S G K S S L A F G T L TATGCAGAATCACAGCGGCGTTATCTCGAGTCGGTGGCTCCTTACGCCCGCCGTCTTATC Y A E S Q R R Y L E S V A P Y A R R L I Y A E S Q R R Y L E S V A P Y A R R L I GATCAAGCCGGAGTGCCCGAGGTTGATTCCATTACAGGGATGCCTCCCGCTGTTGCCTTG D Q A G V P E V D S I T G M P P A V A L D Q A G V P E V D S I T G M P P A V A L CAACAACAGCGAGGCGGACAAAATTCACGATCAACCGTTGGCAGTATCACCACCATCTCA Q Q Q R G G Q N S R S T V G S I T T I S Q Q Q R G G Q N S R S T V G S I T T I S AGTCTGGTTCGTATGTTGTATTCACGCGCCGGTCAGTATCCTGAGCACCAGAGCATGCTC S L V R M L Y S R A G Q Y P E H Q S M L S L V R M L Y S R A G Q Y P E H Q S M L TACGCCGAGGATTTCTCCGCCAATACACCCCAAGGTGCATGCCCGAAATGCCATGGGATT Y A E D F S A N T P Q G A C P K C H G I Y A E D F S A N T P Q G A C P K C H G I GGCAGGGTGTATGAAGTGGAAGAAAACCAGATGGTACCCGATCCCACCAAGACCATCCGT G R V Y E V E E N Q M V P D P T K T I R G R V Y E V E E N Q M V P D P T K T I R GAACGAGCGATAGCTTCCTGGCCTACCGCCTGGCACGGTCACCAGCTTCGAGATGTCTTA E R A I A S W P T A W H G H Q L R D V L E R A I A S W P T A W H G H Q L R D V L GTGGCTCTGGGCTACGACGTGGATGTGCCTTGGAAAGATCTTCCGGAAAAAGACCGCGAC V A L G Y D V D V P W K D L P E K D R D V A L G Y D V D V P W K D L P E K D R D TGGATTCTTTACACTGAAGAAACACCGCACGTACCGGTCTACTCTCGAATGACGCTTGCT W I L Y T E E T P H V P V Y S R M T L A W I L Y T E E T P H V P V Y S R M T L A GAAGCTCAAGCAGCCAAAAAAACAGGTGCTGAGCCCTCTTACAGCGGCACCTATGTGGGC E A Q A A K K T G A E P S Y S G T Y V G E A Q A A K K T G A E P S Y S G T Y V G GCAAAACGCTATGTGCTTGATACCTTTGCCAACACTAAGAGTGCCTCTATGAAACGCAAG A K R Y V L D T F A N T K S A S M K R K A K R Y V L D T F A N T K S A S M K R K GTAGCACAGTTTCTCACATCCATCCCCTGCCCATCCTGTCACGGCAAACGCATCAAGGCA V A Q F L T S I P C P S C H G K R I K A V A Q F L T S I P C P S C H G K R I K A GAGGCGCTTTCGGTAACTTTTGCAGGAGTAGATATTGCTGATTTCTCTCAGCTACCTCTG E A L S V T F A G V D I A D F S Q L P L E A L S V T F A G V D I A D F S Q L P L CACGAGTTAGTAAACTTATTGGACGAAGAAGTTCAGCATGCTTCGAAGAAACTCGCCCTC H E L V N L L D E E V Q H A S K K L A L H E L V N L L D E E V Q H A S K K L A L GATGCTGATGGATTAGAAACGCTGGGGCATGACTTAGACGAGGAAAATCGCAAAAAATCG D A D G L E T L G H D L D E E N R K K S D A D G L E T L G H D L D E E N R K K S GCAGACCAACGAATCGAAGCCGGTGGAGCTCCCCATGAAGCCGCACCAGATGTTCGCAGA A D Q R I E A G G A P H E A A P D V R R A D Q R I E A G G A P H E A A P D V R R ACACCCAATCATTCTGTGGAGAAACTTGCCACTACTGCTCGACTAGGAGCAGGACTCGTT T P N H S V E K L A T T A R L G A G L V T P N H S V E K L A T T A R L G A G L V GAGCGCTTACGCCCCATCATAGACCTCGGGCTAGGCTACCTTTCACTCGATCGAATGACC E R L R P I I D L G L G Y L S L D R M T E R L R P I I D L G L G Y L S L D R M T CCCACTCTTTCCGGTGGTGAACTGCAGCGTTTGCGCCTAGCTACTCAGTTATCATCTGAA P T L S G G E L Q R L R L A T Q L S S E P T L S G G E L Q R L R L A T Q L S S E CTTTTCGGTGTGGTCTATGTATTAGATGAGCCTTCTGCAGGTCTGCATCCTCAAGATATT L F G V V Y V L D E P S A G L H P Q D I L F G V V Y V L D E P S A G L H P Q D I CATGCGCTTCTCGGTGTGCTTGATGGTCTCAAAGCGCGGGGAAACAGCCTTTTTGTTGTG H A L L G V L D G L K A R G N S L F V V H A L L G V L D G L K A R G N S L F V V GAGCATTCTATTGAAGTAATGCAACATGCTGACTGGATTGTAGACGTGGGACCAGGAGCA E H S I E V M Q H A D W I V D V G P G A E H S I E V M Q H A D W I V D V G P G A GGTGAACGGGGCGGCAAGATTCTATACAGTGGCCAGGTAGAGGGCTTGGCTAAAGTCACG G E R G G K I L Y S G Q V E G L A K V T G E R G G K I L Y S G Q V E G L A K V T GATTCTGTCACCCGAGGCTATCTTTTTGGTGACAGTGGGCTGCCACAGCATACTCCTCGA D S V T R G Y L F G D S G L P Q H T P R D S V T R G Y L F G D S G L P Q H T P R AAGCCCAGTCAGTGGATGAAACTTTCGGGAGTTACCCGAAATAACCTCCATAATGTGGAT K P S Q W M K L S G V T R N N L H N V D K P S Q W M K L S G V T R N N L H N V D ATAGAGATTCCCCTCGGGGCTCTTACCGCGGTCACCGGCGTCTCAGGTTCAGGTAAGTCC I E I P L G A L T A V T G V S G S G K S I E I P L G A L T A V T G V S G S G K S AGTTTGGTGAGCCAGGCCCTGCCACAACTGGTAGGAAACCGTCTGGGTAAGAATATGTCA S L V S Q A L P Q L V G N R L G K N M S S L V S Q A L P Q L V G N R L G K N M S GGAGATGAAACCGACTTAGAGGCAGATGATCTCTTAAGAGCCGAGCAGACTCCCGCAGTC G D E T D L E A D D L L R A E Q T P A V G D E T D L E A D D L L R A E Q T P A V AGCGGAAACATTGTGGGAGATTTCAGCGGTATCCACCGAGTTGTTGCAATCGATCAGAAA S G N I V G D F S G I H R V V A I D Q K S G N I V G D F S G I H R V V A I D Q K CCTATTGGGCGAACCCCTCGCTCAAATATTGCAACCTACACCGGGCTTTTCGATCATTTG P I G R T P R S N I A T Y T G L F D H L P I G R T P R S N I A T Y T G L F D H L CGACGTCGTTTTGCGGAAACCGTAGAAGCCAAGCGTCGCCGCTATAAACCGGGCAGATTC R R R F A E T V E A K R R R Y K P G R F R R R F A E T V E A K R R R Y K P G R F TCGTTCAACGTCGCTGGCGGCAGATGCCCCACGTGCGAGGGAGAAGGGTCCGTTATGGTT S F N V A G G R C P T C E G E G S V M V S F N V A G G R C P T C E G E G S V M V GAGCTGCTTTTCTTACCATCGGTCTATACAAAATGCCCTGATTGCCACGGCACTCGTTAT E L L F L P S V Y T K C P D C H G T R Y E L L F L P S V Y T K C P D C H G T R Y CAGTCAAGCACTTTGGAAATTCTGTGGCGAGGTAAGAACGTGTCAGAAGTTTTGGATTTG Q S S T L E I L W R G K N V S E V L D L Q S S T L E I L W R G K N V S E V L D L AATGTCAACGAAGCCTTGGACTTT*TT*GAGGGAGAGTTCGATATTATGCGTTCGTTGAC N V N E A L D F E G E F D I M R S L T N V N E A L D F *X** X G E F D I M R S L T TGCACTGAGGGATGTTGGATTGGGTTATCTACGTTTGGGGCAGCCTGCTACAGAGTTATC A L R D V G L G Y L R L G Q P A T E L S A L R D V G L G Y L R L G Q P A T E L S AGGTGGTGAGGCTCAACGAGTCAAACTTGCCACCGAATTGCAGAGGGCTCAACGGGGTGA G G E A Q R V K L A T E L Q R A Q R G D G G E A Q R V K L A T E L Q R A Q R G D CACTCTCTATGTGCTAGATGAGCCCACTACAGGTTTACATTGCTCAGATGCGGACCGTTT T L Y V L D E P T T G L H C S D A D R L T L Y V L D E P T T G L H C S D A D R L GATATCTCATCTTCAGACTTTGGTGGATTCAGGTAACACGGTAGTGATGGTTGAACTTGA I S H L Q T L V D S G N T V V M V E L D I S H L Q T L V D S G N T V V M V E L D TATGCGAATTATTGCAGCGGCGGATTATGTGATTGATATGGGCCCCGGCGCAGGAGAAGA M R I I A A A D Y V I D M G P G A G E E M R I I A A A D Y V I D M G P G A G E E AGGTGGGCAAATCGTGGCCGCTGGGACCCCAGCGGAGGTTGCGACTTCAGAAGAAAGTGT G G Q I V A A G T P A E V A T S E E S V G G Q I V A A G T P A E V A T S E E S V TTCTGCACCATTTTTAGCGGCGGCTTTGAGGTGA S A P F L A A A L R S A P F L A A A L R --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1949): ATGAGCTATTTACATGAACGCATCACAGACAAGGAAACTCATATTCAACCAGATGTTCGA M S Y L H E R I T D K E T H I Q P D V R M S Y L H E R I T D K E T H I Q P N V R GTAATGGGAGCACGCCAGAACAACCTGCAAAACGTTGATCTTTCTGTGCCCCGCGATGCT V M G A R Q N N L Q N V D L S V P R D A V M G A R Q N N L Q N V D L S V P R D A CTCGTCGTCTTCACTGGTGTTTCAGGATCAGGGAAATCCTCTCTTGCCTTTGGAACCCTC L V V F T G V S G S G K S S L A F G T L L V V F T G V S G S G K S S L A F G T L TATGCAGAATCACAGCGGCGTTATCTCGAGTCGGTGGCTCCTTACGCCCGCCGTCTTATC Y A E S Q R R Y L E S V A P Y A R R L I Y A E S Q R R Y L E S V A P Y A R R L I GATCAAGCCGGAGTGCCCGAGGTTGATTCCATTACAGGGATGCCTCCCGCTGTTGCCTTG D Q A G V P E V D S I T G M P P A V A L D Q A G V P E V D S I T G M P P A V A L CAACAACAGCGAGGCGGACAAAATTCACGATCAACCGTTGGCAGTATCACCACCATCTCA Q Q Q R G G Q N S R S T V G S I T T I S Q Q Q R G G Q N S R S T V G S I T T I S AGTCTGGTTCGTATGTTGTATTCACGCGCCGGTCAGTATCCTGAGCACCAGAGCATGCTC S L V R M L Y S R A G Q Y P E H Q S M L S L V R M L Y S R A G Q Y P E H Q S M L TACGCCGAGGATTTCTCCGCCAATACACCCCAAGGTGCATGCCCGAAATGCCATGGGATT Y A E D F S A N T P Q G A C P K C H G I Y A E D F S A N T P Q G A C P K C H G I GGCAGGGTGTATGAAGTGGAAGAAAACCAGATGGTACCCGATCCCACCAAGACCATCCGT G R V Y E V E E N Q M V P D P T K T I R G R V Y E V E E N Q M V P D P T K T I R GAACGAGCGATAGCTTCCTGGCCTACCGCCTGGCACGGTCACCAGCTTCGAGATGTCTTA E R A I A S W P T A W H G H Q L R D V L E R A I A S W P T A W H G H Q L R D V L GTGGCTCTGGGCTACGACGTGGATGTGCCTTGGAAAGATCTTCCGGAAAAAGACCGCGAC V A L G Y D V D V P W K D L P E K D R D V A L G Y D V D V P W K D L P K K D R D TGGATTCTTTACACTGAAGAAACACCGCACGTACCGGTCTACTCTCGAATGACGCTTGCT W I L Y T E E T P H V P V Y S R M T L A W I L Y T E E T P H V P V Y S R M T L A GAAGCTCAAGCAGCCAAAAAAACAGGTGCTGAGCCCTCTTACAGCGGCACCTATGTGGGC E A Q A A K K T G A E P S Y S G T Y V G E A Q A A K K A G A E P S Y N G T Y V G GCAAAACGCTATGTGCTTGATACCTTTGCCAACACTAAGAGTGCCTCTATGAAACGCAAG A K R Y V L D T F A N T K S A S M K R K A K R Y V L D T F A K T K S A S M K R K GTAGCACAGTTTCTCACATCCATCCCCTGCCCATCCTGTCACGGCAAACGCATCAAGGCA V A Q F L T S I P C P S C H G K R I K A V A Q F L T S I P C P S C H G K R I K A GAGGCGCTTTCGGTAACTTTTGCAGGAGTAGATATTGCTGATTTCTCTCAGCTACCTCTG E A L S V T F A G V D I A D F S Q L P L E A L S V T F A G V D I A D F S Q L P L CACGAGTTAGTAAACTTATTGGACGAAGAAGTTCAGCATGCTTCGAAGAAACTCGCCCTC H E L V N L L D E E V Q H A S K K L A L H E L V N L L D E E V Q H A S K K L A L GATGCTGATGGATTAGAAACGCTGGGGCATGACTTAGACGAGGAAAATCGCAAAAAATCG D A D G D A D G ------------------------------------------------ GCAGACCAACGAATCGAAGCCGGTGGAGCTCCCCATGAAGCCGCACCAGATGTTCGCAGA A P H E A A P D V R R --------------------------- T T H E A A P D G H R ACACCCAATCATTCTGTGGAGAAACTTGCCACTACTGCTCGACTAGGAGCAGGACTCGTT T P N H S V E K L A T T A R L G A G L V T P N H S V E K L A T T A R L G A G L V GAGCGCTTACGCCCCATCATAGACCTCGGGCTAGGCTACCTTTCACTCGATCGAATGACC E R L R P I I D L G L G Y L S L D R M T E R L R P I I D L G L G Y L S L D R M T CCCACTCTTTCCGGTGGTGAACTGCAGCGTTTGCGCCTAGCTACTCAGTTATCATCTGAA P T L S G G E L Q R L R L A T Q L S S E P T L S G G E L Q R L R L A T Q L S S E CTTTTCGGTGTGGTCTATGTATTAGATGAGCCTTCTGCAGGTCTGCATCCTCAAGATATT L F G V V Y V L D E P S A G L H P Q D I L F G V V Y V L D E P S A G L H P Q D I CATGCGCTTCTCGGTGTGCTTGATGGTCTCAAAGCGCGGGGAAACAGCCTTTTTGTTGTG H A L L G V L D G L K A R G N S L F V V H A L L G V L D G L K A R G N S L F V V GAGCATTCTATTGAAGTAATGCAACATGCTGACTGGATTGTAGACGTGGGACCAGGAGCA E H S I E V M Q H A D W I V D V G P G A E H S I E V M H H A D W I V D V G P G A GGTGAACGGGGCGGCAAGATTCTATACAGTGGCCAGGTAGAGGGCTTGGCTAAAGTCACG G E R G G K I L Y S G Q V E G L A K V T G E Q G G K V L Y S G Q V E G L A K V T GATTCTGTCACCCGAGGCTATCTTTTTGGTGACAGTGGGCTGCCACAGCATACTCCTCGA D S V T R G Y L F G D S G L P Q H T P R D S V T R G Y L F G D S G L P Q H T P R AAGCCCAGTCAGTGGATGAAACTTTCGGGAGTTACCCGAAATAACCTCCATAATGTGGAT K P S Q W M K L S G V T R N N L H N V D K P S Q W M K L S G V T R N N L H N V D ATAGAGATTCCCCTCGGGGCTCTTACCGCGGTCACCGGCGTCTCAGGTTCAGGTAAGTCC I E I P L G A L T A V T G V S G S G K S I E I P L G V L T A V T G V S G S G K S AGTTTGGTGAGCCAGGCCCTGCCACAACTGGTAGGAAACCGTCTGGGTAAGAATATGTCA S L V S Q A L P Q L V G N R L G K N M S S L V S Q A L P Q L V G N R L G K N M S GGAGATGAAACCGACTTAGAGGCAGATGATCTCTTAAGAGCCGAGCAGACTCCCGCAGTC G D E T D L E A D D L L R A E Q T P A V G D E T D L E A D D L L R A E Q T P A V AGCGGAAACATTGTGGGAGATTTCAGCGGTATCCACCGAGTTGTTGCAATCGATCAGAAA S G N I V G D F S G I H R V V A I D Q K S G N I V G D F S S I H R V V A I D Q K CCTATTGGGCGAACCCCTCGCTCAAATATTGCAACCTACACCGGGCTTTTCGATCATTTG P I G R T P R S N I A T Y T G L F D H L P I G R T P R S N I A T Y T G L F D H V CGACGTCGTTTTGCGGAAACCGTAGAAGCCAAGCGTCGCCGCTATAAACCGGGCAGATTC R R R F A E T V E A K R R R Y K P G R F R R R F A E T V E A K R R R Y K P G R F TCGTTCAACGTCGCTGGCGGCAGATGCCCCACGTGCGAGGGAGAAGGGTCCGTTATGGTT S F N V A G G R C P T C E G E G S V M V S F N V A G G R C P T C E G E G S V M V GAGCTGCTTTTCTTACCATCGGTCTATACAAAATGCCCTGATTGCCACGGCACTCGTTAT E L L F L P S V Y T K C P D C H G T R Y E L L F L P S V Y T K C P D C H G T R Y CAGTCAAGCACTTTGGAAATTCTGTGGCGAGGTAAGAACGTGTCAGAAGTTTTGGATTTG Q S S T L E I L W R G K N V S E V L D L Q S S T L E I L W R G K N V S E V L D L AATGTCAACGAAGCCTTGGAC*TT*TTTGAGGGAGAGTTCGATATTATGCGTTCGTTGAC N V N E A L D F E G E F D I M R S L T N V N E A L D *F** F E G E F D I M R S L T TGCACTGAGGGATGTTGGATTGGGTTATCTACGTTTGGGGCAGCCTGCTACAGAGTTATC A L R D V G L G Y L R L G Q P A T E L S A L R D V G L G Y L R L G Q P A T E L S AGGTGGTGAGGCTCAACGAGTCAAACTTGCCACCGAATTGCAGAGGGCTCAACGGGGTGA G G E A Q R V K L A T E L Q R A Q R G D G G E A Q R V K L A T E L Q R A Q R G D CACTCTCTATGTGCTAGATGAGCCCACTACAGGTTTACATTGCTCAGATGCGGACCGTTT T L Y V L D E P T T G L H C S D A D R L T L Y V L D E P T T G L H C S D A D R L GATATCTCATCTTCAGACTTTGGTGGATTCAGGTAACACGGTAGTGATGGTTGAACTTGA I S H L Q T L V D S G N T V V M V E L D I S H L Q T L V D S G N T V V M V E L D TATGCGAATTATTGCAGCGGCGGATTATGTGATTGATATGGGCCCCGGCGCAGGAGAAGA M R I I A A A D Y V I D M G P G A G E E M R I I A A A D Y V I D M G P G A G E E AGGTGGGCAAATCGTGGCCGCTGGGACCCCAGCGGAGGTTGCGACTTCAGAAGAAAGTGT G G Q I V A A G T P A E V A T S E E S V G G Q I V A A G T P A E V A T S E E S V TTCTGCACCATTTTTAGCGGCGGCTTTGAGGTGA S A P F L A A A S A P F L A A L --------- // >fig|6666666.67454.peg.1285 fig|257309.1.peg.1299 COG0553: Superfamily II DNA/RNA helicases, SNF2 family FIG175904 gi|372118535|gb|CP003217.1|_1313949_1312963,gi|372118535|gb|CP003217.1|_1312959_1311295 MSTLRSQGTYLREVAQRAQLLLNSLLEPHEPARFNTHGKISDVWVVPQTAISWPPHLFTHEEFSEDHIEVTEILEKFIESTAGIVDLLHKTKIGVWSTLTRRVSSTANQQFESAATELENLLANPELQVQLSRVTEYLRRYDRAESAYKSGVHHFLVENQDSPYGKAVRSSLASAMQLPEVCIDNLSKEYVRPAILLCEQLRAHPLSPWTLQRKALQAENKIIQWRALALLSSLSIDSLSQVTSERVSVTAIKRQGITSVAEIISRSVEDLEQIPGVGQQTAKRVKAAAQTLYSEALAQPLSTLGSEQSTELEALLNILYHYGRSREALxDELDRIDRLERYLQPVITHEKALWRSIPPAYFVIYSKGSNGHNTAYLQFIDDISWANLALFIPNLLSEGQGSVDIWKDYCERPAHYQSLWSAIRGNDQTPYSQSGLSSETLERIRALKLNTSLLRDAFLRGYQSFGAKFVIVQRKVILGDEMGLGKTVQAIAAAAHVTAEKSSENPVKILIIVPASLMTNWAREWEKFCNIPVQIAHGENKQKAVAQWNDTAGALIVTYDGARTMQLLGATVVIVDEAHYIKNPEAKRSRAVSRIIAESEYVLLLSGTPLENRIEEFCTLVSYLDSHCAISAPRLASAFKAHIAHLYLRRNQGDVLDELPEKIDHTEWVELSAEDEHLYRQAVHERNWMLMRRVAMLAARPDCAKMERLIDIVKEAESVGKNVIIFSYFRSVLERIEKDLGEYVAGSITGDVPPERRQQLIDELGNTGRHVLLLQIVAGGVGLNIQKASVVIFTEAQVKPTLVDQAIARTHRMGQRDPVTVYRLFGADTVDERLTELLEHKRAVFDNYARDAEAAEVFDAVDVSEGALARNIIELEHDRLQIDN We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGCACGCTGCGCTCCCAAGGAACGTACCTTAGGGAAGTCGCACAGCGTGCTCAATTA M S T L R S Q G T Y L R E V A Q R A Q L M S T L R S Q G T Y L R E V A Q R A Q L CTTCTGAACTCGCTACTAGAACCACATGAACCAGCAAGGTTCAACACTCATGGAAAAATC L L N S L L E P H E P A R F N T H G K I L L N S L L E P H E P A R F N T H G K I AGCGATGTATGGGTCGTACCTCAAACCGCTATATCTTGGCCCCCGCATCTATTCACCCAC S D V W V V P Q T A I S W P P H L F T H S D V W V V P Q T A I S W P P H L F T H GAAGAATTCTCCGAAGATCATATTGAAGTTACGGAAATCCTTGAAAAATTTATCGAGTCA E E F S E D H I E V T E I L E K F I E S E E F S E D H I E V T E I L E K F I E S ACGGCAGGAATCGTAGACCTTCTACACAAAACTAAAATTGGTGTATGGAGCACACTTACG T A G I V D L L H K T K I G V W S T L T T A G I V D L L H K T K I G V W S T L T CGCCGTGTTTCTTCCACCGCGAATCAGCAATTCGAATCGGCTGCAACAGAGCTTGAAAAC R R V S S T A N Q Q F E S A A T E L E N R R V S S T A N Q Q F E S A A T E L E N CTACTCGCGAATCCTGAACTTCAAGTGCAGCTATCTCGTGTCACTGAATATCTGCGCCGA L L A N P E L Q V Q L S R V T E Y L R R L L A N P E L Q V Q L S R V T E Y L R R TATGATAGGGCTGAATCAGCTTATAAATCAGGAGTTCATCATTTTCTGGTAGAAAACCAA Y D R A E S A Y K S G V H H F L V E N Q Y D R A E S A Y K S G V H H F L V E N Q GACTCTCCCTACGGCAAAGCTGTGCGATCAAGCCTTGCGTCTGCAATGCAGCTTCCGGAA D S P Y G K A V R S S L A S A M Q L P E D S P Y G K A V R S S L A S A M Q L P E GTCTGTATTGATAATCTGAGCAAAGAATACGTAAGGCCTGCAATTCTCCTGTGCGAACAA V C I D N L S K E Y V R P A I L L C E Q V C I D N L S K E Y V R P A I L L C E Q CTACGGGCGCACCCGCTTTCACCGTGGACGCTACAACGCAAAGCGCTTCAAGCAGAAAAC L R A H P L S P W T L Q R K A L Q A E N L R A H P L S P W T L Q R K A L Q A E N AAAATTATTCAATGGCGTGCGCTCGCACTTCTCAGTAGCCTTAGCATCGATTCTCTAAGC K I I Q W R A L A L L S S L S I D S L S K I I Q W R A L A L L S S L S I D S L S CAAGTGACCAGCGAACGCGTCAGTGTCACTGCGATAAAGCGTCAGGGAATAACTTCTGTG Q V T S E R V S V T A I K R Q G I T S V Q V T S E R V S V T A I K R Q G I T S V GCAGAAATAATTTCTCGTTCAGTTGAAGACTTGGAACAAATTCCAGGCGTCGGACAACAA A E I I S R S V E D L E Q I P G V G Q Q A E I I S R S V E D L E Q I P G V G Q Q ACCGCAAAGCGGGTAAAAGCTGCAGCTCAGACACTCTACTCGGAGGCGTTAGCCCAACCG T A K R V K A A A Q T L Y S E A L A Q P T A K R V K A A A Q T L Y S E A L A Q P CTTTCCACTTTAGGTTCAGAGCAGAGCACGGAACTCGAGGCGCTTCTTAATATTCTCTAT L S T L G S E Q S T E L E A L L N I L Y L S T L G S E Q S T E L E A L L N I L Y CACTATGGTCGGAGTAGGGAAGCGCTATAAGACGAATTGGATCGCATTGATCGCCTTGAA H Y G R S R E A L * D E L D R I D R L E H Y G R S R E A L X D E L D R I D R L E CGGTACTTGCAACCAGTAATCACACATGAAAAAGCGTTATGGAGGTCTATTCCACCGGCG R Y L Q P V I T H E K A L W R S I P P A R Y L Q P V I T H E K A L W R S I P P A TATTTTGTGATCTACAGCAAGGGGTCAAATGGGCACAACACTGCATATTTGCAGTTTATT Y F V I Y S K G S N G H N T A Y L Q F I Y F V I Y S K G S N G H N T A Y L Q F I GATGATATTTCTTGGGCAAACTTAGCTTTATTTATTCCAAACTTACTCTCTGAGGGGCAA D D I S W A N L A L F I P N L L S E G Q D D I S W A N L A L F I P N L L S E G Q GGCTCGGTAGACATTTGGAAGGATTACTGTGAACGCCCAGCGCATTACCAGTCGCTATGG G S V D I W K D Y C E R P A H Y Q S L W G S V D I W K D Y C E R P A H Y Q S L W TCTGCCATTCGTGGAAATGACCAAACGCCCTATAGTCAGAGCGGTTTATCGTCCGAAACG S A I R G N D Q T P Y S Q S G L S S E T S A I R G N D Q T P Y S Q S G L S S E T TTAGAACGTATTCGCGCACTAAAGCTCAATACTTCTTTACTACGAGACGCCTTTCTGCGT L E R I R A L K L N T S L L R D A F L R L E R I R A L K L N T S L L R D A F L R GGTTATCAAAGTTTCGGCGCAAAATTCGTTATAGTTCAGCGCAAAGTAATTCTTGGCGAT G Y Q S F G A K F V I V Q R K V I L G D G Y Q S F G A K F V I V Q R K V I L G D GAGATGGGCCTTGGTAAAACTGTGCAAGCTATCGCAGCAGCTGCCCATGTTACTGCTGAA E M G L G K T V Q A I A A A A H V T A E E M G L G K T V Q A I A A A A H V T A E AAATCTTCTGAAAACCCAGTAAAGATATTGATAATTGTCCCAGCGTCACTGATGACTAAC K S S E N P V K I L I I V P A S L M T N K S S E N P V K I L I I V P A S L M T N TGGGCTCGAGAATGGGAAAAATTCTGCAACATTCCTGTTCAGATTGCGCATGGAGAAAAC W A R E W E K F C N I P V Q I A H G E N W A R E W E K F C N I P V Q I A H G E N AAACAAAAAGCAGTTGCGCAATGGAATGATACCGCTGGGGCGCTTATCGTTACATATGAT K Q K A V A Q W N D T A G A L I V T Y D K Q K A V A Q W N D T A G A L I V T Y D GGCGCGAGAACCATGCAGCTTCTAGGGGCCACGGTTGTCATCGTCGATGAGGCTCACTAC G A R T M Q L L G A T V V I V D E A H Y G A R T M Q L L G A T V V I V D E A H Y ATAAAAAATCCTGAGGCTAAACGATCGCGAGCGGTCTCGCGGATTATTGCAGAATCGGAA I K N P E A K R S R A V S R I I A E S E I K N P E A K R S R A V S R I I A E S E TATGTGCTTCTTCTCAGCGGTACTCCATTGGAAAATAGAATAGAAGAATTTTGTACGTTA Y V L L L S G T P L E N R I E E F C T L Y V L L L S G T P L E N R I E E F C T L GTTTCATATCTTGATTCGCATTGTGCAATAAGCGCACCGCGATTAGCCTCAGCATTTAAA V S Y L D S H C A I S A P R L A S A F K V S Y L D S H C A I S A P R L A S A F K GCTCATATCGCGCATCTTTATCTCCGGAGAAATCAAGGGGATGTCCTTGACGAGCTTCCT A H I A H L Y L R R N Q G D V L D E L P A H I A H L Y L R R N Q G D V L D E L P GAAAAAATCGATCACACAGAATGGGTCGAGCTCAGTGCGGAGGATGAACATCTATACAGA E K I D H T E W V E L S A E D E H L Y R E K I D H T E W V E L S A E D E H L Y R CAAGCAGTACATGAACGTAATTGGATGCTGATGCGAAGAGTAGCAATGCTAGCAGCTCGG Q A V H E R N W M L M R R V A M L A A R Q A V H E R N W M L M R R V A M L A A R CCGGATTGTGCGAAAATGGAACGCTTAATCGACATTGTGAAAGAGGCAGAAAGTGTTGGA P D C A K M E R L I D I V K E A E S V G P D C A K M E R L I D I V K E A E S V G AAGAACGTAATTATATTTAGCTACTTTCGCAGTGTGCTCGAGCGTATTGAAAAAGATTTG K N V I I F S Y F R S V L E R I E K D L K N V I I F S Y F R S V L E R I E K D L GGTGAATACGTTGCGGGGTCAATCACAGGAGATGTGCCGCCTGAACGACGACAACAGCTG G E Y V A G S I T G D V P P E R R Q Q L G E Y V A G S I T G D V P P E R R Q Q L ATTGATGAGTTGGGAAACACTGGAAGACATGTGTTATTGCTGCAAATTGTTGCAGGAGGT I D E L G N T G R H V L L L Q I V A G G I D E L G N T G R H V L L L Q I V A G G GTAGGGCTAAATATTCAAAAAGCCAGTGTGGTTATATTTACGGAAGCGCAAGTTAAGCCC V G L N I Q K A S V V I F T E A Q V K P V G L N I Q K A S V V I F T E A Q V K P ACGCTGGTAGATCAAGCTATTGCACGCACACACCGAATGGGCCAACGAGATCCTGTCACA T L V D Q A I A R T H R M G Q R D P V T T L V D Q A I A R T H R M G Q R D P V T GTTTATCGACTTTTTGGCGCCGATACTGTCGACGAAAGACTTACCGAATTATTGGAGCAT V Y R L F G A D T V D E R L T E L L E H V Y R L F G A D T V D E R L T E L L E H AAGAGGGCAGTATTTGATAACTATGCTCGGGATGCTGAAGCAGCAGAGGTTTTTGACGCC K R A V F D N Y A R D A E A A E V F D A K R A V F D N Y A R D A E A A E V F D A GTAGATGTCTCAGAAGGAGCGCTAGCCCGTAATATTATTGAGCTAGAGCACGATCGCTTA V D V S E G A L A R N I I E L E H D R L V D V S E G A L A R N I I E L E H D R L CAGATTGATAACTAA Q I D N Q I D N --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1299): ATGAGCACGCTGCGCTCCCAAGGAACGTACCTTAGGGAAGTCGCACAGCGTGCTCAATTA M S T L R S Q G T Y L R E V A Q R A Q L M S T L R S Q G T Y L R E V A Q R A Q L CTTCTGAACTCGCTACTAGAACCACATGAACCAGCAAGGTTCAACACTCATGGAAAAATC L L N S L L E P H E P A R F N T H G K I L L N S L L E P H E P A R F N T H G K I AGCGATGTATGGGTCGTACCTCAAACCGCTATATCTTGGCCCCCGCATCTATTCACCCAC S D V W V V P Q T A I S W P P H L F T H S D V W V V P Q T A I S W P P H L F T H GAAGAATTCTCCGAAGATCATATTGAAGTTACGGAAATCCTTGAAAAATTTATCGAGTCA E E F S E D H I E V T E I L E K F I E S E E F S K D H I E V A E I L E K F I E S ACGGCAGGAATCGTAGACCTTCTACACAAAACTAAAATTGGTGTATGGAGCACACTTACG T A G I V D L L H K T K I G V W S T L T T S G I V D L L H K T K I G V W S T L T CGCCGTGTTTCTTCCACCGCGAATCAGCAATTCGAATCGGCTGCAACAGAGCTTGAAAAC R R V S S T A N Q Q F E S A A T E L E N R R V S S T A N Q Q F E S A A T E L E N CTACTCGCGAATCCTGAACTTCAAGTGCAGCTATCTCGTGTCACTGAATATCTGCGCCGA L L A N P E L Q V Q L S R V T E Y L R R L L A N P E L Q V Q L S R V T E Y L R R TATGATAGGGCTGAATCAGCTTATAAATCAGGAGTTCATCATTTTCTGGTAGAAAACCAA Y D R A E S A Y K S G V H H F L V E N Q Y D R A E S A Y K S G V H H F L V E N Q GACTCTCCCTACGGCAAAGCTGTGCGATCAAGCCTTGCGTCTGCAATGCAGCTTCCGGAA D S P Y G K A V R S S L A S A M Q L P E D S P Y G K A V R S S L A S A M Q L P E GTCTGTATTGATAATCTGAGCAAAGAATACGTAAGGCCTGCAATTCTCCTGTGCGAACAA V C I D N L S K E Y V R P A I L L C E Q V C I D N L S K E Y V R P A I L L C E Q CTACGGGCGCACCCGCTTTCACCGTGGACGCTACAACGCAAAGCGCTTCAAGCAGAAAAC L R A H P L S P W T L Q R K A L Q A E N L R A H P L S P W T L Q R K A L Q A E N AAAATTATTCAATGGCGTGCGCTCGCACTTCTCAGTAGCCTTAGCATCGATTCTCTAAGC K I I Q W R A L A L L S S L S I D S L S K I I Q C R A L A L L S S L S I D S L S CAAGTGACCAGCGAACGCGTCAGTGTCACTGCGATAAAGCGTCAGGGAATAACTTCTGTG Q V T S E R V S V T A I K R Q G I T S V Q V T S E R V S V T A I K R Q G I T S V GCAGAAATAATTTCTCGTTCAGTTGAAGACTTGGAACAAATTCCAGGCGTCGGACAACAA A E I I S R S V E D L E Q I P G V G Q Q A E I I S R S V E D L E Q I P G V G Q Q ACCGCAAAGCGGGTAAAAGCTGCAGCTCAGACACTCTACTCGGAGGCGTTAGCCCAACCG T A K R V K A A A Q T L Y S E A L A Q P T A K R V K A A A Q T L Y S E A L A Q P CTTTCCACTTTAGGTTCAGAGCAGAGCACGGAACTCGAGGCGCTTCTTAATATTCTCTAT L S T L G S E Q S T E L E A L L N I L Y L S T L G S E Q S T E L E A L L N I L Y CACTATGGTCGGAGTAGGGAAGCGCTATAAGACGAATTGGATCGCATTGATCGCCTTGAA H Y G R S R E A L * D E L D R I D R L E H Y G R S R E A L S D E L D R I D R L E CGGTACTTGCAACCAGTAATCACACATGAAAAAGCGTTATGGAGGTCTATTCCACCGGCG R Y L Q P V I T H E K A L W R S I P P A W Y L Q P V I T H E K A L W R S I P P A TATTTTGTGATCTACAGCAAGGGGTCAAATGGGCACAACACTGCATATTTGCAGTTTATT Y F V I Y S K G S N G H N T A Y L Q F I Y F V I Y S K G S G G H N T A Y L Q F I GATGATATTTCTTGGGCAAACTTAGCTTTATTTATTCCAAACTTACTCTCTGAGGGGCAA D D I S W A N L A L F I P N L L S E G Q D D I S W A N I A L S I P D L L S E G Q GGCTCGGTAGACATTTGGAAGGATTACTGTGAACGCCCAGCGCATTACCAGTCGCTATGG G S V D I W K D Y C E R P A H Y Q S L W G S V D I W K D Y C E R P A H Y Q S L W TCTGCCATTCGTGGAAATGACCAAACGCCCTATAGTCAGAGCGGTTTATCGTCCGAAACG S A I R G N D Q T P Y S Q S G L S S E T S A I R G N D Q T P Y S Q S G L S S E T TTAGAACGTATTCGCGCACTAAAGCTCAATACTTCTTTACTACGAGACGCCTTTCTGCGT L E R I R A L K L N T S L L R D A F L R L E R I R A L K L N T S L L R D V F L R GGTTATCAAAGTTTCGGCGCAAAATTCGTTATAGTTCAGCGCAAAGTAATTCTTGGCGAT G Y Q S F G A K F V I V Q R K V I L G D G Y Q S F G A K F V I V Q R K V I L G D GAGATGGGCCTTGGTAAAACTGTGCAAGCTATCGCAGCAGCTGCCCATGTTACTGCTGAA E M G L G K T V Q A I A A A A H V T A E E M G L G K T V Q A I A A A A H V T A E AAATCTTCTGAAAACCCAGTAAAGATATTGATAATTGTCCCAGCGTCACTGATGACTAAC K S S E N P V K I L I I V P A S L M T N K S F E N R I K I L I I V P A S L M T N TGGGCTCGAGAATGGGAAAAATTCTGCAACATTCCTGTTCAGATTGCGCATGGAGAAAAC W A R E W E K F C N I P V Q I A H G E N W A R E W E K F C N I P V Q I A H G E N AAACAAAAAGCAGTTGCGCAATGGAATGATACCGCTGGGGCGCTTATCGTTACATATGAT K Q K A V A Q W N D T A G A L I V T Y D K Q K A V A Q W N D T A G A L I V T Y D GGCGCGAGAACCATGCAGCTTCTAGGGGCCACGGTTGTCATCGTCGATGAGGCTCACTAC G A R T M Q L L G A T V V I V D E A H Y G A R T M R L L G A T V V I I D E A H Y ATAAAAAATCCTGAGGCTAAACGATCGCGAGCGGTCTCGCGGATTATTGCAGAATCGGAA I K N P E A K R S R A V S R I I A E S E I K N P E A K R S R A V S R I I A E S E TATGTGCTTCTTCTCAGCGGTACTCCATTGGAAAATAGAATAGAAGAATTTTGTACGTTA Y V L L L S G T P L E N R I E E F C T L Y A L L L S G T P L E N R I E E F C T L GTTTCATATCTTGATTCGCATTGTGCAATAAGCGCACCGCGATTAGCCTCAGCATTTAAA V S Y L D S H C A I S A P R L A S A F K V S Y L D S H C A I S A P R L A S A F K GCTCATATCGCGCATCTTTATCTCCGGAGAAATCAAGGGGATGTCCTTGACGAGCTTCCT A H I A H L Y L R R N Q G D V L D E L P A H I A H L Y L R R N Q G D V L D E L P GAAAAAATCGATCACACAGAATGGGTCGAGCTCAGTGCGGAGGATGAACATCTATACAGA E K I D H T E W V E L S A E D E H L Y R E K I D H T E W V E L S A E D E H L Y R CAAGCAGTACATGAACGTAATTGGATGCTGATGCGAAGAGTAGCAATGCTAGCAGCTCGG Q A V H E R N W M L M R R V A M L A A R Q A V H E R N W M L M R R V A M L A A R CCGGATTGTGCGAAAATGGAACGCTTAATCGACATTGTGAAAGAGGCAGAAAGTGTTGGA P D C A K M E R L I D I V K E A E S V G P D C A K M E R L I D I V K E A E S A G AAGAACGTAATTATATTTAGCTACTTTCGCAGTGTGCTCGAGCGTATTGAAAAAGATTTG K N V I I F S Y F R S V L E R I E K D L K N V I I F S Y F R S V L E R I E K D L GGTGAATACGTTGCGGGGTCAATCACAGGAGATGTGCCGCCTGAACGACGACAACAGCTG G E Y V A G S I T G D V P P E R R Q Q L G E Y V A G S I T A D V P P Q R R Q Q L ATTGATGAGTTGGGAAACACTGGAAGACATGTGTTATTGCTGCAAATTGTTGCAGGAGGT I D E L G N T G R H V L L L Q I V A G G I D E L G N T G R H V L L L Q I V A G G GTAGGGCTAAATATTCAAAAAGCCAGTGTGGTTATATTTACGGAAGCGCAAGTTAAGCCC V G L N I Q K A S V V I F T E A Q V K P V G L N I Q K A S V V I F T E A Q V K P ACGCTGGTAGATCAAGCTATTGCACGCACACACCGAATGGGCCAACGAGATCCTGTCACA T L V D Q A I A R T H R M G Q R D P V T T L V D Q A I A R A H R M G Q R D P V T GTTTATCGACTTTTTGGCGCCGATACTGTCGACGAAAGACTTACCGAATTATTGGAGCAT V Y R L F G A D T V D E R L T E L L E H V Y R L F G A D T V D E R L T A L L E H AAGAGGGCAGTATTTGATAACTATGCTCGGGATGCTGAAGCAGCAGAGGTTTTTGACGCC K R A V F D N Y A R D A E A A E V F D A K R A V F D N Y A R D A E A A E V F D A GTAGATGTCTCAGAAGGAGCGCTAGCCCGTAATATTATTGAGCTAGAGCACGATCGCTTA V D V S E G A L A R N I I E L E H D R L V D V S E G E L A R N I I E L E H D R L CAGATTGATAACTAA Q I D N Q I D N --- // >fig|6666666.67454.peg.30 fig|196164.1.peg.1407 Thiamin biosynthesis protein ThiC FIG000581 gi|372118535|gb|CP003217.1|_27380_27436,gi|372118535|gb|CP003217.1|_27440_29317 MLGACSRLVSVPRGRPSTGxDCADAVQAPFEPVWLTPAKEERSASLVSAASANSVTNPSAWENSEIHPKHSYSPIVSGDLEVPETEIQLDDSPTGPNDPVRIYRTRGPECDPTVGLKPLRAQWIDSREDTEEYAGRERNLADDGRSAQRRGAASLEWKGVKPTPRRAKQGKRVTQMHYARQGIITKEMEFVALREHMDPEFVRSEIARGRAIIPNNINHPESEPMIIGRKFLTKINANIGNSAVTSSIEEEVSKLRWATRWGADTVMDLSTGDDIHTTREWIIRNSPVPIGTVPIYQALEKVNGVAEDLTWEIFRDTVIEQCEQGVDYMTIHAGVLLAYIPLTTKRITGIVSRGGSIMAGWCLAHHKESFLYEHFDELCEIFAQYDVAFSLGDGLRPGSVADANDAAQFAELKTIGELARRAWEYDVQVMIEGPGHVPLNMVQENNELEQKWAHDAPFYTLGPLVTDIAPGYDHITSAIGAAHIAMGGTAMLCYVTPKEHLGLPNRDDVKTGVITYKLAAHAADVAKGHPGARAWDDAMSKARFEFRWHDQFALSLDPDTAIAYHDETLPAEPAKTAHFCSMCGPKFCSMRISQDIRDMFADKIADLGIPQVGGDAEAGMAAKSEEFVAQGSQLYSEVRDNAAHA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGTTGGGTGCGTGTTCTAGGTTAGTGAGTGTCCCCCGCGGGCGCCCGAGCACGGGCTGA M L G A C S R L V S V P R G R P S T G * M L G A C S R L V S V P R G R P S T G X GATTGCGCTGATGCTGTGCAAGCACCGTTTGAACCTGTCTGGTTAACACCAGCGAAGGAA D C A D A V Q A P F E P V W L T P A K E D C A D A V Q A P F E P V W L T P A K E GAGAGGAGCGCGAGCCTAGTGTCGGCAGCCTCAGCTAATTCAGTAACCAATCCATCTGCT E R S A S L V S A A S A N S V T N P S A E R S A S L V S A A S A N S V T N P S A TGGGAAAACTCCGAGATCCATCCGAAGCACTCGTATTCGCCGATCGTTTCCGGTGACCTT W E N S E I H P K H S Y S P I V S G D L W E N S E I H P K H S Y S P I V S G D L GAGGTCCCAGAAACAGAGATTCAGCTTGACGATTCTCCTACCGGCCCCAATGATCCAGTT E V P E T E I Q L D D S P T G P N D P V E V P E T E I Q L D D S P T G P N D P V CGGATCTATCGCACCCGTGGCCCTGAGTGTGATCCCACGGTGGGATTGAAGCCACTGCGC R I Y R T R G P E C D P T V G L K P L R R I Y R T R G P E C D P T V G L K P L R GCACAGTGGATTGATAGCCGTGAGGACACGGAAGAATATGCTGGCCGTGAGCGGAATTTG A Q W I D S R E D T E E Y A G R E R N L A Q W I D S R E D T E E Y A G R E R N L GCTGATGATGGCCGCTCCGCGCAGCGTCGTGGCGCAGCGTCGCTGGAGTGGAAAGGTGTG A D D G R S A Q R R G A A S L E W K G V A D D G R S A Q R R G A A S L E W K G V AAACCCACACCGCGACGCGCCAAGCAGGGCAAGCGCGTGACTCAGATGCACTATGCACGC K P T P R R A K Q G K R V T Q M H Y A R K P T P R R A K Q G K R V T Q M H Y A R CAGGGCATTATTACGAAGGAAATGGAGTTCGTGGCGCTGCGCGAGCACATGGACCCAGAG Q G I I T K E M E F V A L R E H M D P E Q G I I T K E M E F V A L R E H M D P E TTTGTGCGCAGCGAGATCGCCCGTGGCCGTGCGATCATTCCGAACAACATTAACCACCCA F V R S E I A R G R A I I P N N I N H P F V R S E I A R G R A I I P N N I N H P GAATCGGAGCCCATGATTATTGGTCGAAAGTTTTTGACCAAGATCAACGCCAATATCGGT E S E P M I I G R K F L T K I N A N I G E S E P M I I G R K F L T K I N A N I G AACTCCGCAGTGACCTCCAGTATTGAGGAAGAAGTATCCAAGCTGCGGTGGGCTACCCGC N S A V T S S I E E E V S K L R W A T R N S A V T S S I E E E V S K L R W A T R TGGGGTGCAGATACCGTGATGGATTTGTCCACCGGCGATGATATTCACACCACCCGCGAA W G A D T V M D L S T G D D I H T T R E W G A D T V M D L S T G D D I H T T R E TGGATTATCCGCAACTCCCCAGTACCAATCGGTACGGTGCCGATCTATCAAGCGCTGGAA W I I R N S P V P I G T V P I Y Q A L E W I I R N S P V P I G T V P I Y Q A L E AAAGTCAATGGTGTAGCAGAAGACCTTACGTGGGAGATTTTCCGCGATACCGTCATTGAG K V N G V A E D L T W E I F R D T V I E K V N G V A E D L T W E I F R D T V I E CAGTGTGAACAAGGTGTGGACTACATGACCATTCATGCCGGTGTGTTGCTCGCCTACATT Q C E Q G V D Y M T I H A G V L L A Y I Q C E Q G V D Y M T I H A G V L L A Y I CCACTGACCACCAAACGCATAACCGGAATTGTATCCCGTGGTGGATCCATCATGGCGGGT P L T T K R I T G I V S R G G S I M A G P L T T K R I T G I V S R G G S I M A G TGGTGCCTAGCTCACCATAAGGAGTCCTTCCTTTACGAGCACTTTGATGAGCTGTGCGAG W C L A H H K E S F L Y E H F D E L C E W C L A H H K E S F L Y E H F D E L C E ATTTTCGCGCAGTACGACGTCGCCTTCTCGCTGGGTGATGGTCTGCGCCCTGGTTCTGTT I F A Q Y D V A F S L G D G L R P G S V I F A Q Y D V A F S L G D G L R P G S V GCCGATGCGAATGATGCGGCCCAGTTCGCGGAGCTGAAAACCATTGGTGAGCTGGCTCGT A D A N D A A Q F A E L K T I G E L A R A D A N D A A Q F A E L K T I G E L A R CGTGCGTGGGAATACGATGTGCAGGTCATGATCGAGGGCCCAGGTCACGTTCCGCTGAAC R A W E Y D V Q V M I E G P G H V P L N R A W E Y D V Q V M I E G P G H V P L N ATGGTGCAGGAAAACAATGAGCTGGAGCAAAAGTGGGCTCACGATGCGCCTTTCTACACT M V Q E N N E L E Q K W A H D A P F Y T M V Q E N N E L E Q K W A H D A P F Y T CTTGGCCCATTGGTGACCGATATTGCGCCAGGCTATGACCACATCACCTCGGCAATTGGA L G P L V T D I A P G Y D H I T S A I G L G P L V T D I A P G Y D H I T S A I G GCTGCTCATATCGCTATGGGTGGTACGGCGATGCTGTGTTATGTGACCCCCAAGGAGCAC A A H I A M G G T A M L C Y V T P K E H A A H I A M G G T A M L C Y V T P K E H TTGGGTCTGCCCAACCGTGACGATGTAAAAACCGGTGTGATTACTTATAAACTCGCAGCT L G L P N R D D V K T G V I T Y K L A A L G L P N R D D V K T G V I T Y K L A A CACGCGGCCGATGTGGCTAAGGGGCATCCTGGTGCTCGTGCGTGGGATGACGCGATGAGC H A A D V A K G H P G A R A W D D A M S H A A D V A K G H P G A R A W D D A M S AAGGCGCGTTTTGAGTTCCGTTGGCATGATCAGTTCGCGTTGTCGCTTGATCCAGATACC K A R F E F R W H D Q F A L S L D P D T K A R F E F R W H D Q F A L S L D P D T GCGATTGCTTACCATGACGAAACGCTTCCGGCGGAGCCGGCAAAGACTGCGCACTTCTGT A I A Y H D E T L P A E P A K T A H F C A I A Y H D E T L P A E P A K T A H F C TCCATGTGTGGTCCGAAGTTCTGCTCCATGCGCATTAGCCAAGATATTCGTGACATGTTC S M C G P K F C S M R I S Q D I R D M F S M C G P K F C S M R I S Q D I R D M F GCAGATAAGATCGCCGACTTGGGTATCCCGCAGGTTGGCGGCGACGCAGAAGCTGGTATG A D K I A D L G I P Q V G G D A E A G M A D K I A D L G I P Q V G G D A E A G M GCGGCAAAGTCTGAGGAGTTTGTGGCCCAAGGATCGCAGCTTTATAGCGAGGTGCGTGAC A A K S E E F V A Q G S Q L Y S E V R D A A K S E E F V A Q G S Q L Y S E V R D AATGCTGCCCACGCCTAG N A A H A N A A H A --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.1407): -------------------------ATGTTGGGTGCGTGTTCTAGGTTAGTGAGTGTCCC M L G A C S R L V S V P MQAHRHRHSSKSPLPQPPHGGNFHA H A G N A L V L T A V P CCGCGGGCGCCCGAGCACGGGCTGAGATTGCGCTG*AT*GCTGTGCAAGCACCGTTTGAA A G A R A R A E I A L A V Q A P F E - T G A R A R A E I A L *I** A A R A P F E CCTGTCTGGTTAACACCAGCGAAGGAAGAGAGGAGCGCGAGCCTAGTGTCGGCAGCCTCA P V W L T P A K E E R S A S L V S A P V R L V P A K E E R N G A M T P T ------ GCTAATTCAGTAACCAATCCATCTGCTTGGGAAAACTCCGAGATCCATCCGAAGCACTCG N S E I H P K H S --------------------------------- Q N E I H P K H S TATTCGCCGATCGTTTCCGGTGACCTTGAGGTCCCAGAAACAGAGATTCAGCTTGACGAT Y S P I V S G D L E V P E T E I Q L D D Y S P I R K H G L E V P E T E I A L D D TCTCCTACCGGCCCCAATGATCCAGTTCGGATCTATCGCACCCGTGGCCCTGAGTGTGAT S P T G P N D P V R I Y R T R G P E C D S P S G P N E P F R I Y R T R G P E T D CCCACGGTGGGATTGAAGCCACTGCGCGCACAGTGGATTGATAGCCGTGAGGACACGGAA P T V G L K P L R A Q W I D S R E D T E P T L G L P R L R T P W I T A R G D V T GAATATGCTGGCCGTGAGCGGAATTTGGCTGATGATGGCCGCTCCGCGCAGCGTCGTGGC E Y A G R E R N L A D D G R S A Q R R G E Y T G R E R L L I D D G R S A M R R G GCAGCGTCGCTGGAGTGGAAAGGTGTGAAACCCACACCGCGACGCGCCAAGCAGGGCAAG A A S L E W K G V K P T P R R A K Q G K Q A S A E W K G Q K P A P L K A L P G K CGCGTGACTCAGATGCACTATGCACGCCAGGGCATTATTACGAAGGAAATGGAGTTCGTG R V T Q M H Y A R Q G I I T K E M E F V R V T Q M A Y A R A G E I T R E M E F V GCGCTGCGCGAGCACATGGACCCAGAGTTTGTGCGCAGCGAGATCGCCCGTGGCCGTGCG A L R E H M D P E F V R S E I A R G R A A L R E H V D P E F V R S E V A R G R A ATCATTCCGAACAACATTAACCACCCAGAATCGGAGCCCATGATTATTGGTCGAAAGTTT I I P N N I N H P E S E P M I I G R K F I I P N N V N H P E S E P M I I G R K F TTGACCAAGATCAACGCCAATATCGGTAACTCCGCAGTGACCTCCAGTATTGAGGAAGAA L T K I N A N I G N S A V T S S I E E E L T K I N A N I G N S A V T S S I E E E GTATCCAAGCTGCGGTGGGCTACCCGCTGGGGTGCAGATACCGTGATGGATTTGTCCACC V S K L R W A T R W G A D T V M D L S T V S K L Q W A T R W G A D T V M D L S T GGCGATGATATTCACACCACCCGCGAATGGATTATCCGCAACTCCCCAGTACCAATCGGT G D D I H T T R E W I I R N S P V P I G G D D I H T T R E W I I R N S P V P I G ACGGTGCCGATCTATCAAGCGCTGGAAAAAGTCAATGGTGTAGCAGAAGACCTTACGTGG T V P I Y Q A L E K V N G V A E D L T W T V P I Y Q A L E K V N G V A A D L S W GAGATTTTCCGCGATACCGTCATTGAGCAGTGTGAACAAGGTGTGGACTACATGACCATT E I F R D T V I E Q C E Q G V D Y M T I E V F R D T V I E Q C E Q G V D Y M T I CATGCCGGTGTGTTGCTCGCCTACATTCCACTGACCACCAAACGCATAACCGGAATTGTA H A G V L L A Y I P L T T K R I T G I V H A G V L L A Y I P L T T R R V T G I V TCCCGTGGTGGATCCATCATGGCGGGTTGGTGCCTAGCTCACCATAAGGAGTCCTTCCTT S R G G S I M A G W C L A H H K E S F L S R G G S I M A G W C L A H H R E S F L TACGAGCACTTTGATGAGCTGTGCGAGATTTTCGCGCAGTACGACGTCGCCTTCTCGCTG Y E H F D E L C E I F A Q Y D V A F S L F E H F D E L C E I F A Q Y D V A F S L GGTGATGGTCTGCGCCCTGGTTCTGTTGCCGATGCGAATGATGCGGCCCAGTTCGCGGAG G D G L R P G S V A D A N D A A Q F A E G D G L R P G S L A D A N D A A Q F A E CTGAAAACCATTGGTGAGCTGGCTCGTCGTGCGTGGGAATACGATGTGCAGGTCATGATC L K T I G E L A R R A W E Y D V Q V M I L K T I G E L T Q R A W E Y D V Q V M V GAGGGCCCAGGTCACGTTCCGCTGAACATGGTGCAGGAAAACAATGAGCTGGAGCAAAAG E G P G H V P L N M V Q E N N E L E Q K E G P G H V P L N M I Q E N N E L E Q K TGGGCTCACGATGCGCCTTTCTACACTCTTGGCCCATTGGTGACCGATATTGCGCCAGGC W A H D A P F Y T L G P L V T D I A P G W A A D A P F Y T L G P L V T D I A P G TATGACCACATCACCTCGGCAATTGGAGCTGCTCATATCGCTATGGGTGGTACGGCGATG Y D H I T S A I G A A H I A M G G T A M Y D H I T S A I G A A H I A M G G T A M CTGTGTTATGTGACCCCCAAGGAGCACTTGGGTCTGCCCAACCGTGACGATGTAAAAACC L C Y V T P K E H L G L P N R D D V K T L C Y V T P K E H L G L P N R N D V K T GGTGTGATTACTTATAAACTCGCAGCTCACGCGGCCGATGTGGCTAAGGGGCATCCTGGT G V I T Y K L A A H A A D V A K G H P G G V I T Y K L A A H A A D V A K G H P G GCTCGTGCGTGGGATGACGCGATGAGCAAGGCGCGTTTTGAGTTCCGTTGGCATGATCAG A R A W D D A M S K A R F E F R W H D Q A R A W D D A M S K A R F E F R W N D Q TTCGCGTTGTCGCTTGATCCAGATACCGCGATTGCTTACCATGACGAAACGCTTCCGGCG F A L S L D P D T A I A Y H D E T L P A F A L S L D P D T A I A Y H D E T L P A GAGCCGGCAAAGACTGCGCACTTCTGTTCCATGTGTGGTCCGAAGTTCTGCTCCATGCGC E P A K T A H F C S M C G P K F C S M R E P A K T A H F C S M C G P K F C S M R ATTAGCCAAGATATTCGTGACATGTTCGCAGATAAGATCGCCGACTTGGGTATCCCGCAG I S Q D I R D M F A D K I A D L G I P Q I S Q D I R D M F G E Q I A E L G M P G GTTGGCGGC-GACGCAGAAGCTGGTATGGCGGCAAAGTCTGAGGAGTTTGTGGCCCAAGG V G G D A E A G M A A K S E E F V A Q G V G A S D S T E G M K E K S R E F V A G G ATCGCAGCTTTATAGCGAGGTGCGTGACAATGCTGCCCACGCCTAG S Q L Y S E G E V Y R E --------------------------- // >fig|6666666.67454.peg.674 fig|257309.1.peg.716 Mobile element protein gi|372118535|gb|CP003217.1|_663757_663942,gi|372118535|gb|CP003217.1|_663944_664981,gi|372118535|gb|CP003217.1|_664981_665136 MNRSYTNTQKRTALRVYKRTQSVTKTVRELGYPGRWTLYKWLREPKTPPQPRKQAKTLTHYPYEVKLRAVELFHNGWRPADIAQECCLHTHASVYAWAQRYREEGQWGLMSKKERAGHGRIPTKAALEKSLPDNPTQLKQQMATLLVEKAVLEKELEIIKKDVSVIPGQLSNKHKTDVVDALRSTFPLAMLLAASGLAASSFYYHLKKRRMPDKHAAIRSMVHRISSDSHNTYGYRRIWWQLRHLGITISEKVVRRLMREEAITVRFPKRKVKYSSYQGEISPAPPNLVNRCFHATAANTLWLTDISVFAANEGRVYLSVIIDCFDGKVVAAKTSVNPTMELAESTLQAAIDAEGLPPDGSLVIHSDRGVHYRGRSWHSLTAKYGIVRSMSKKGCSPDNAACEGFSGxxKNEMYYGKRWQTIQELDDAIAAYIEFYNNHRIKVSLNGMSIARYRMAAVA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGC Y P Y E V K L R A V E L F H N G W R P A Y P - Y E V K L R A V E L F H N G W R P A TGATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACG D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R CTACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCG Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R CATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACA I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q GCAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGA K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D CGCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S CAGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAG S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S CATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W GCAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E AGAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E AATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATAC I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T GTTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGT L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V GATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTAT I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GGAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGG E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TTCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCT S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L GACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGC T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GGCATGCGAGGGTTTTTCGGGC*GG*ATGAAAAATGAGATGTATTACGGCAAGAGGTGGC A C E G F S G M K N E M Y Y G K R W A C E G F S G *X** X K N E M Y Y G K R W AGACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATC Q T I Q E L D D A I A A Y I E F Y N N H Q T I Q E L D D A I A A Y I E F Y N N H GCATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGT R I K V S L N G M S I A R Y R M A A V A R I K V S L N G M S I A R Y R M A A V A - GA -- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.716): ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGC Y P Y E V K L R A V E L F H N G W R P A Y P - Y E V K L R A V E L F H N G W R P A TGATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACG D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R CTACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCG Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R CATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACA I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q GCAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGA K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D CGCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S CAGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAG S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S CATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W GCAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E AGAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E AATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATAC I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T GTTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGT L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V GATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTAT I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GGAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGG E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TTCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCT S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L GACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGC T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GGCATGC*GA*GGGTTTTTCGGGCGGATGAAAAATGAGATGTATTACGGCAAGAGGTGGC A C G F F G R M K N E M Y Y G K R W A C *E** G F F G R M K N E M Y Y G K R W AGACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATC Q T I Q E L D D A I A A Y I E F Y N N H Q T I Q E L D D A I A A Y I E F Y N N H GCATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGT R I K V S L N G M S I A R Y R M A A V A R I K V S L N G M S I A R Y R M A A V A - GA -- // >fig|6666666.67454.peg.1861 fig|257309.1.peg.1847 COG1272: Predicted membrane protein hemolysin III homolog FIG021953 gi|372118535|gb|CP003217.1|_1903327_1903172,gi|372118535|gb|CP003217.1|_1903170_1902538 MLGHGAETYAVVGFGFKYIHHLNATRGMPMTTTPPSPMVEYRRWIYDRGPPPITRGWFHLVASWCALVSGSVLSTYAFIYRPWPQALGVLTYAIGVVALFGVSAAYHRGRWKTPEAVAWWRRADHATIGVFIASTYTPLCLIALPQSLWVLYLAWAGAAGALILSMVWITHPRWLAASIYIALGWLITPLIPALWRAEGAAVVWLLFIGGIVYSAGAIVYAMRWPGRNATIMGYHEIFHAATIVAAIIHLVAVWMVVVPNAS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGCTTGGGCATGGCGCGGAAACCTACGCAGTGGTAGGTTTTGGGTTCAAATACATTCAC M L G H G A E T Y A V V G F G F K Y I H M L G H G A E T Y A V V G F G F K Y I H CATCTCAACGCCACGAGAGGAATGCCCATGACCACAACGCCACCATCCCCCATGGTCGAA H L N A T R G M P M T T T P P S P M V E H L N A T R G M P M T T T P P S P M V E TACCGCCGATGGATCTACGACCGCGGCCCCCCGCCCCATCACCCGCGGCTGGTTCCACCT Y R R W I Y D R G P P P I T R G W F H L Y R R W I Y D R G P P P - I T R G W F H L CGTGGCCTCGTGGTGCGCACTCGTCTCCGGCTCCGTGCTCTCCACCTACGCCTTCATCTA V A S W C A L V S G S V L S T Y A F I Y V A S W C A L V S G S V L S T Y A F I Y CCGCCCCTGGCCACAAGCACTCGGAGTTCTCACCTACGCCATCGGTGTAGTCGCCCTCTT R P W P Q A L G V L T Y A I G V V A L F R P W P Q A L G V L T Y A I G V V A L F CGGAGTCTCCGCAGCCTACCACCGCGGCCGCTGGAAAACCCCCGAAGCAGTCGCATGGTG G V S A A Y H R G R W K T P E A V A W W G V S A A Y H R G R W K T P E A V A W W GCGCCGCGCCGACCACGCCACCATCGGAGTATTTATCGCCTCGACCTACACCCCCTTATG R R A D H A T I G V F I A S T Y T P L C R R A D H A T I G V F I A S T Y T P L C CCTGATTGCCCTGCCACAATCACTCTGGGTGCTCTACCTCGCATGGGCAGGAGCCGCAGG L I A L P Q S L W V L Y L A W A G A A G L I A L P Q S L W V L Y L A W A G A A G CGCACTCATCCTCAGCATGGTGTGGATCACTCACCCGCGCTGGCTAGCCGCAAGCATATA A L I L S M V W I T H P R W L A A S I Y A L I L S M V W I T H P R W L A A S I Y TATTGCGCTGGGATGGCTCATCACCCCACTGATCCCCGCACTATGGCGGGCTGAAGGGGC I A L G W L I T P L I P A L W R A E G A I A L G W L I T P L I P A L W R A E G A AGCCGTTGTGTGGCTGCTTTTTATAGGCGGAATCGTCTACTCCGCAGGCGCTATCGTGTA A V V W L L F I G G I V Y S A G A I V Y A V V W L L F I G G I V Y S A G A I V Y CGCCATGCGCTGGCCAGGTAGAAACGCCACCATCATGGGCTACCATGAGATTTTTCACGC A M R W P G R N A T I M G Y H E I F H A A M R W P G R N A T I M G Y H E I F H A CGCCACAATCGTGGCAGCAATTATTCACCTCGTAGCCGTATGGATGGTGGTCGTCCCCAA A T I V A A I I H L V A V W M V V V P N A T I V A A I I H L V A V W M V V V P N TGCTTCATAG A S A S --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1847): ATGCTTGGGCATGGCGCGGAAACCTACGCAGTGGTAGGTTTTGGGTTCAAATACATTCAC M L G H G A E T Y A V V G F G F K Y I H M L G H G A E T Y A V V G F G F K Y I H CATCTCAACGCCACGAGAGGAATGCCCATGACCACAACGCCACCATCCCCCATGGTCGAA H L N A T R G M P M T T T P P S P M V E H L N A T R G M P M T T T P P S P M V E TACCGCCGATGGATCTACGACCGCGGCCCCCCGCCCCATCACCCGCGGCTGGTTCCACCT Y R R W I Y D R G P R P I T R G W F H L Y R R W I Y D R G P - R P I T R G W F H L CGTGGCCTCGTGGTGCGCACTCGTCTCCGGCTCCGTGCTCTCCACCTACGCCTTCATCTA V A S W C A L V S G S V L S T Y A F I Y V A S W C A L V S G S V L S T Y A F I Y CCGCCCCTGGCCACAAGCACTCGGAGTTCTCACCTACGCCATCGGTGTAGTCGCCCTCTT R P W P Q A L G V L T Y A I G V V A L F R P W P Q A L G V L T Y A I G V V A L F CGGAGTCTCCGCAGCCTACCACCGCGGCCGCTGGAAAACCCCCGAAGCAGTCGCATGGTG G V S A A Y H R G R W K T P E A V A W W G V S A A Y H R G R W K T P E A V A W W GCGCCGCGCCGACCACGCCACCATCGGAGTATTTATCGCCTCGACCTACACCCCCTTATG R R A D H A T I G V F I A S T Y T P L C R R A D H A T I G V F I A S T Y T P L C CCTGATTGCCCTGCCACAATCACTCTGGGTGCTCTACCTCGCATGGGCAGGAGCCGCAGG L I A L P Q S L W V L Y L A W A G A A G L I A L P Q S L W V L Y L A W A G A A G CGCACTCATCCTCAGCATGGTGTGGATCACTCACCCGCGCTGGCTAGCCGCAAGCATATA A L I L S M V W I T H P R W L A A S I Y A L I L S M V W I T H P R W L A A S I Y TATTGCGCTGGGATGGCTCATCACCCCACTGATCCCCGCACTATGGCGGGCTGAAGGGGC I A L G W L I T P L I P A L W R A E G A I A L G W L I T P L I P A L W R A E G A AGCCGTTGTGTGGCTGCTTTTTATAGGCGGAATCGTCTACTCCGCAGGCGCTATCGTGTA A V V W L L F I G G I V Y S A G A I V Y A V V W L L F I G G I V Y S A G A I V Y CGCCATGCGCTGGCCAGGTAGAAACGCCACCATCATGGGCTACCATGAGATTTTTCACGC A M R W P G R N A T I M G Y H E I F H A A M R W P G R N A T I M G Y H E I F H A CGCCACAATCGTGGCAGCAATTATTCACCTCGTAGCCGTATGGATGGTGGTCGTCCCCAA A T I V A A I I H L V A V W M V V V P N A T I V A A I I H L V A V W M V V V P N TGCTTCATAG A S A S --- // >fig|6666666.67454.peg.2083 fig|257309.1.peg.2057 Putative DNA-binding bacteriophage protein gi|372118535|gb|CP003217.1|_2122876_2122601,gi|372118535|gb|CP003217.1|_2122597_2122157 MGNIIQTFTNDVFGTIRTITTDGQMLFCGKDVATALGYVNASKAVQDHYKRVLFRYPLETAGGIQQVRFIAEGDLYRLIISSKLSAAQKFEAxVFATAIPTKHETSSIAKPTSANHRSARVNCRRFRHAGALRRPLLIQAIYLLRRMRRWRVCEQDPLLARHQVARLRPWRVGRERLIRTRRGSGIDLPPTGRSRPLDRVHVGDHDGNRRRSRDGLRLIESTRHRQAHACASVRVSGVG We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGGCAACATCATTCAAACATTTACCAACGACGTGTTCGGCACCATCCGCACCATCACT M G N I I Q T F T N D V F G T I R T I T M G N I I Q T F T N D V F G T I R T I T ACTGATGGCCAGATGCTGTTTTGTGGGAAGGACGTCGCCACTGCGCTCGGCTACGTTAAC T D G Q M L F C G K D V A T A L G Y V N T D G Q M L F C G K D V A T A L G Y V N GCCAGCAAGGCGGTCCAAGATCATTACAAGAGGGTTCTATTTCGTTACCCCCTTGAGACC A S K A V Q D H Y K R V L F R Y P L E T A S K A V Q D H Y K R V L F R Y P L E T GCTGGCGGAATCCAGCAGGTCCGCTTCATTGCTGAAGGCGACCTCTACCGCCTGATCATC A G G I Q Q V R F I A E G D L Y R L I I A G G I Q Q V R F I A E G D L Y R L I I TCTTCCAAACTCTCGGCAGCGCAGAAGTTCGAAGCCTAGGTGTTCGCTACGGCGATACCG S S K L S A A Q K F E A * V F A T A I P S S K L S A A Q K F E A X V F A T A I P ACCAAGCACGAGACCTCTTCGATCGCAAAGCCAACCTCTGCGAACCACCGCTCAGCGAGG T K H E T S S I A K P T S A N H R S A R T K H E T S S I A K P T S A N H R S A R GTGAATTGCAGACGATTTCGGCATGCAGGGGCGCTTCGAAGGCCGCTGCTGATTCAGGCT V N C R R F R H A G A L R R P L L I Q A V N C R R F R H A G A L R R P L L I Q A ATTTACCTCCTGAGGCGTATGAGGCGTTGGCGAGTATGCGAACAAGATCCGCTACTCGCT I Y L L R R M R R W R V C E Q D P L L A I Y L L R R M R R W R V C E Q D P L L A CGCCACCAAGTGGCTCGTCTACGACCATGGCGTGTGGGACGAGAACGACTTATCCGCACA R H Q V A R L R P W R V G R E R L I R T R H Q V A R L R P W R V G R E R L I R T AGGCGTGGTTCAGGAATTGACCTCCCGCCAACTGGAAGAAGCCGACCGCTTGATCGCGTC R R G S G I D L P P T G R S R P L D R V R R G S G I D L P P T G R S R P L D R V CACGTGGGAGACCATGACGGAAACCGGCGCAGATCTCGTGATGGCCTTCGCCTCATCGAA H V G D H D G N R R R S R D G L R L I E H V G D H D G N R R R S R D G L R L I E AGCACGCGGCATCGCCAAGCTCACGCCTGTGCAAGCGTCCGCGTTTCGGGCGTGGGATGA S T R H R Q A H A C A S V R V S G V G S T R H R Q A H A C A S V R V S G V G --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2057): ATGGGCAACATCATTCAAACATTTACCAACGACGTGTTCGGCACCATCCGCACCATCACT M G N I I Q T F T N D V F G T I R T I T M G N I I Q T F T N D V F G T I R T I T ACTGATGGCCAGATGCTGTTTTGTGGGAAGGACGTCGCCACTGCGCTCGGCTACGTTAAC T D G Q M L F C G K D V A T A L G Y V N T D V Q M P F C G K D V A T A L G Y V N GCCAGCAAGGCGGTCCAAGATCATTACAAGAGGGTTCTATTTCGTTACCCCCTTGAGACC A S K A V Q D H Y K R V L F R Y P L E T A S K A V Q D H Y K R V L F R Y P L E T GCTGGCGGAATCCAGCAGGTCCGCTTCATTGCTGAAGGCGACCTCTACCGCCTGATCATC A G G I Q Q V R F I A E G D L Y R L I I A G G I Q Q V R F I T E G D L Y R L I I TCTTCCAAACTCTCGGCAGCGCAGAAGTTCGAAGCCTAGGTGTTCGCTACGGCGATACCG S S K L S A A Q K F E A * V F A T A I P S S K L S A A Q K F E A W V F D E V L P ACC--AAGCACGAGACCTCTTCGATCGCAAAGCCAACCTCTGCGAACCACCGCTCAGCGA T K H D L F D R K A N L C E P P L S E T IR R H -- G V Y A Y D D L L A D D E F L E GGGTGAATTGCAGACGATTTCGGCATGCAGGGGCGCTTCGAAGGCCGCTGCTGATTCAGG G E L Q T I S A C R G A S K A A A D S G H A I A T L R A E Q A L L E A A P K V S CTATTTACCTCCTGAGGCGTATGAGGCGTTGGCGAGTATGCGAACAAGATCCGCTACTCG Y Y L L V C E Q D P L L Y - Y D L --------------------- V L Q S D S L L CTCGCCACCAAGTGGCTCGTCTACGACCATGGCGTGTGGGACGAGAACGACTTATCCGCA A R H Q V A R D H G V G R E R L I R T T T A I A K ---- D Y G L -- S A K K L N R CAAGGCGTGGTTCAGGAATTGACCTCCCGCCAACTGGAAGA------------------- T R R G S G I D L P P T G R I L R D A H V Q F H Q S S R WFLYAKFAEQGYTQSKTHE -------AGCCGACCGCTTGATCGCGTCCACGTG*G*GAGACCATGACGGAAACCGGCGC S R P L D R V H V E T M T E T G A YGEGQTR T R N L G L H Y V *R* E G A S D A G Q AGATCTCGTGATGGCCTTCGCCTCATCGAAAGCACGCGGCATCGCCAAGCTCACGCCTGT D L V M A F P H R K H A A S P S S L T S V P A L - P P R L P R A H P R T --- L GCAAGCGTCCGCGTTTCGGGCGTGGGATGA------- C K R P R F G R G M L R R P G Q G R G R -PVSEVSA // >fig|6666666.67454.peg.1791 fig|257309.1.peg.249 No significant database matches gi|372118535|gb|CP003217.1|_1832243_1832656,gi|372118535|gb|CP003217.1|_1832656_1833342 MNTTGETTQPFYSHCDMNDPLCRAERLRIQFDYYRWHSLQPDDNDDVDTYTADIATRIGKTQRYVCDHLDAIYYLTQLPQLHALYQQLWHLDDTRLITITRIISALPTTYYDAIDTHLTRWLTPTQPAQTIPSTRPLxxFLRKTITHLGFHLDNTRKPEQYVYIYDAGHGLAGIDALIHAGVAELLETTLRSIKKTHSCDDSTALQLLLEDKTSVVINLYDTGTGITYTPQGTALPQVPEHPVIRVLGDADVAVSTGYRFTEAMRRFIQGRDGVCRFPGCGVPAQWCDIDHVEEYDLGGVTGAVNAQCLCRHHHNVKTSRRVDCEIGAGGVVTWQIGDRKVVTTPEGVLAGQTFRQRREKKIKKAA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAACACCACAGGGGAGACCACACAACCGTTCTACAGTCACTGCGACATGAACGACCCA M N T T G E T T Q P F Y S H C D M N D P M N T T G E T T Q P F Y S H C D M N D P CTTTGCCGCGCCGAACGACTACGCATCCAATTCGACTACTACCGCTGGCACAGCCTACAA L C R A E R L R I Q F D Y Y R W H S L Q L C R A E R L R I Q F D Y Y R W H S L Q CCCGATGACAACGACGATGTTGACACCTACACCGCAGACATCGCCACCCGCATCGGCAAA P D D N D D V D T Y T A D I A T R I G K P D D N D D V D T Y T A D I A T R I G K ACCCAACGCTACGTCTGCGACCACCTCGACGCCATCTACTACCTCACCCAACTCCCACAA T Q R Y V C D H L D A I Y Y L T Q L P Q T Q R Y V C D H L D A I Y Y L T Q L P Q CTCCACGCCCTCTACCAACAACTCTGGCACCTCGACGACACCCGACTTATCACCATCACC L H A L Y Q Q L W H L D D T R L I T I T L H A L Y Q Q L W H L D D T R L I T I T AGAATCATCTCCGCACTACCTACCACCTACTATGACGCCATCGACACCCACCTGACACGC R I I S A L P T T Y Y D A I D T H L T R R I I S A L P T T Y Y D A I D T H L T R TGGCTCACGCCCACCCAACCAGCACAAACCATCCCCAGTACCAGGCCATTA*CC*CGATT W L T P T Q P A Q T I P S T R P L R F W L T P T Q P A Q T I P S T R P L *X** X F CCTACGCAAAACCATCACCCACCTCGGCTTTCATCTCGACAACACCCGAAAACCAGAACA L R K T I T H L G F H L D N T R K P E Q L R K T I T H L G F H L D N T R K P E Q ATACGTCTACATCTACGACGCTGGACACGGACTCGCAGGCATCGACGCCCTCATCCACGC Y V Y I Y D A G H G L A G I D A L I H A Y V Y I Y D A G H G L A G I D A L I H A CGGTGTCGCAGAACTACTCGAGACCACCTTGCGTAGCATCAAAAAGACCCATAGCTGTGA G V A E L L E T T L R S I K K T H S C D G V A E L L E T T L R S I K K T H S C D TGACTCCACAGCCCTGCAACTACTGTTAGAAGATAAAACCAGTGTGGTGATCAACCTCTA D S T A L Q L L L E D K T S V V I N L Y D S T A L Q L L L E D K T S V V I N L Y TGACACCGGCACCGGGATCACCTACACCCCGCAGGGAACAGCTCTGCCTCAGGTGCCTGA D T G T G I T Y T P Q G T A L P Q V P E D T G T G I T Y T P Q G T A L P Q V P E GCATCCTGTTATTCGTGTGCTCGGTGACGCTGATGTGGCTGTGTCGACTGGTTATCGGTT H P V I R V L G D A D V A V S T G Y R F H P V I R V L G D A D V A V S T G Y R F TACAGAGGCAATGCGTAGGTTTATTCAAGGCCGTGATGGGGTGTGTCGTTTCCCTGGTTG T E A M R R F I Q G R D G V C R F P G C T E A M R R F I Q G R D G V C R F P G C TGGGGTGCCAGCACAGTGGTGCGATATTGACCATGTTGAAGAATATGATCTCGGTGGGGT G V P A Q W C D I D H V E E Y D L G G V G V P A Q W C D I D H V E E Y D L G G V TACCGGTGCGGTTAACGCTCAGTGTTTATGTCGGCATCATCACAATGTGAAAACGTCTCG T G A V N A Q C L C R H H H N V K T S R T G A V N A Q C L C R H H H N V K T S R TCGGGTCGATTGTGAGATTGGTGCCGGTGGTGTGGTGACGTGGCAGATCGGTGATCGTAA R V D C E I G A G G V V T W Q I G D R K R V D C E I G A G G V V T W Q I G D R K GGTGGTTACCACACCGGAAGGGGTGCTAGCGGGGCAAACGTTTAGGCAACGCAGAGAAAA V V T T P E G V L A G Q T F R Q R R E K V V T T P E G V L A G Q T F R Q R R E K GAAAATCAAAAAAGCGGCATAG K I K K A A K I K K A A --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.249): ATGAACACCACAGGGGAGACCACACAACCGTTCTACAGTCACTGCGACATGAACGACCCA M N T T G E T T Q P F Y S H C D M N D P M N T T G E T T Q P F Y S H C D M N D P CTTTGCCGCGCCGAACGACTACGCATCCAATTCGACTACTACCGCTGGCACAGCCTACAA L C R A E R L R I Q F D Y Y R W H S L Q L C R A E R L R I Q F D Y Y R W H S L Q CCCGATGACAACGACGATGTTGACACCTACACCGCAGACATCGCCACCCGCATCGGCAAA P D D N D D V D T Y T A D I A T R I G K P D D N D D V D T Y T A D I A T R I G K ACCCAACGCTACGTCTGCGACCACCTCGACGCCATCTACTACCTCACCCAACTCCCACAA T Q R Y V C D H L D A I Y Y L T Q L P Q T Q R Y V C D H L D A I Y Y L T Q L P Q CTCCACGCCCTCTACCAACAACTCTGGCACCTCGACGACACCCGACTTATCACCATCACC L H A L Y Q Q L W H L D D T R L I T I T L H T V Y Q Q L W H L D D T R L I T I T AGAATCATCTCCGCACTACCTACCACCTACTATGACGCCATCGACACCCACCTGACACGC R I I S A L P T T Y Y D A I D T H L T R R I I S A L P T T Y Y D A I D T H L T R TGGCTCACGCCCACCCAACCAGCACAAACCATCCCCAGTACCAGG*CC*ATTACCCGATT W L T P T Q P A Q T I P S T R I T R F W L T P T Q P A Q T I P S T R *A** I T R F CCTACGCAAAACCATCACCCACCTCGGCTTTCATCTCGACAACACCCGAAAACCAGAACA L R K T I T H L G F H L D N T R K P E Q L R K T I T H L G F H L D N T R K P E Q ATACGTCTACATCTACGACGCTGGACACGGACTCGCAGGCATCGACGCCCTCATCCACGC Y V Y I Y D A G H G L A G I D A L I H A Y V Y I Y D A G H G L A G I D A L I H A CGGTGTCGCAGAACTACTCGAGACCACCTTGCGTAGCATCAAAAAGACCCATAGCTGTGA G V A E L L E T T L R S I K K T H S C D G V A E L L E T T L R S I K K T H S C D TGACTCCACAGCCCTGCAACTACTGTTAGAAGATAAAACCAGTGTGGTGATCAACCTCTA D S T A L Q L L L E D K T S V V I N L Y D S T A L Q L L L E D K T S V V I N L Y TGACACCGGCACCGGGATCACCTACACCCCGCAGGGAACAGCTCTGCCTCAGGTGCCTGA D T G T G I T Y T P Q G T A L P Q V P E D T G T G I T Y T P Q G T A L P Q V P E GCATCCTGTTATTCGTGTGCTCGGTGACGCTGATGTGGCTGTGTCGACTGGTTATCGGTT H P V I R V L G D A D V A V S T G Y R F H L V I R V L G D A D V A V S T G Y R F TACAGAGGCAATGCGTAGGTTTATTCAAGGCCGTGATGGGGTGTGTCGTTTCCCTGGTTG T E A M R R F I Q G R D G V C R F P G C T E A M R R F I Q G R D G V C R F P G C TGGGGTGCCAGCACAGTGGTGCGATATTGACCATGTTGAAGAATATGATCTCGGTGGGGT G V P A Q W C D I D H V E E Y D L G G V G V P A Q W C D I D H V E E Y D L G G V TACCGGTGCGGTTAACGCTCAGTGTTTATGTCGGCATCATCACAATGTGAAAACGTCTCG T G A V N A Q C L C R H H H N V K T S R T G A V N A Q C L C R H H H N V K T S R TCGGGTCGATTGTGAGATTGGTGCCGGTGGTGTGGTGACGTGGCAGATCGGTGATCGTAA R V D C E I G A G G V V T W Q I G D R K R V D C E I G A G G V V T W Q I G D R R GGTGGTTACCACACCGGAAGGGGTGCTAGCGGGGCAAACGTTTAGGCAACGCAGAGAAAA V V T T P E G V L A G Q T F R Q R R E K V V T T P E G V L A G Q T F R Q R R E K GAAAATCAAAAAAGCGGCATAG K I K K A A K I K K A A --- // >fig|6666666.67454.peg.1317 fig|257309.1.peg.726 Putative transposase gi|372118535|gb|CP003217.1|_1343387_1343824,gi|372118535|gb|CP003217.1|_1343824_1344699 MQRQFWGLIATGITTAQAALQVGVSVPVGTRWFRHAGGMRPLALDEPSGRYLSFTEREEIAILWEKQTGVREIARRIGRNPATISRELRRNTATRGGKQIYRAGVAQWKAQEAAKRPKQAKLVDNPRLRDYVQERLAGTVRDETGxxMAGPDTPAWKGRSKPHRADRRWLTAWSPEQISQRLRIDFPDDESMRISHEAIYQALYIEGRGALKRELVAALRTGRALRKPRARSKSKPKGHLTADVVISNRPPEASDRAVPGHWEGDLIIGTGRSAIGTVVERYSRSILLVHLPRLDGWGEQPRTKNGPALGGYGAEAMNTALQTVMKDLPLQLRQTLTWDRGTELADHAAFTLATGTKVFFADPHSPWQRPTNENSNGLLRQYFPKGTDLSRWTAQDLAAIAYTLNNRPRKVLGFRTPAEVFNEQLQSIQNNSVATTD We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCAACGCCAGTTCTGGGGTCTGATCGCGACGGGAATCACCACTGCGCAGGCCGCCCTT V Q R Q F W G L I A T G I T T A Q A A L M Q R Q F W G L I A T G I T T A Q A A L CAGGTGGGGGTGTCCGTACCGGTGGGAACGAGGTGGTTCCGTCATGCTGGTGGAATGAGA Q V G V S V P V G T R W F R H A G G M R Q V G V S V P V G T R W F R H A G G M R CCGTTAGCTTTGGACGAGCCCTCGGGGCGGTATCTATCGTTTACTGAACGAGAGGAAATC P L A L D E P S G R Y L S F T E R E E I P L A L D E P S G R Y L S F T E R E E I GCGATCCTGTGGGAGAAACAGACGGGTGTGCGTGAGATCGCTCGACGGATTGGCCGCAAT A I L W E K Q T G V R E I A R R I G R N A I L W E K Q T G V R E I A R R I G R N CCGGCGACGATTTCTCGTGAGCTACGGCGTAATACTGCCACCCGTGGTGGCAAGCAGATT P A T I S R E L R R N T A T R G G K Q I P A T I S R E L R R N T A T R G G K Q I TATCGGGCAGGGGTGGCCCAGTGGAAAGCTCAGGAAGCCGCTAAGCGTCCCAAACAAGCA Y R A G V A Q W K A Q E A A K R P K Q A Y R A G V A Q W K A Q E A A K R P K Q A AAACTCGTGGATAATCCGCGCCTGCGGGACTATGTTCAGGAGCGTCTTGCTGGGACGGTC K L V D N P R L R D Y V Q E R L A G T V K L V D N P R L R D Y V Q E R L A G T V CGAGATGAAACGGGG*TC*GTCATGGCGGGGCCTGATACGCCTGCGTGGAAGGGCCGGAG R D E T G V M A G P D T P A W K G R S R D E T G *X** X M A G P D T P A W K G R S CAAACCTCACAGGGCAGACCGACGGTGGTTGACCGCGTGGAGCCCGGAGCAGATATCGCA K P H R A D R R W L T A W S P E Q I S Q K P H R A D R R W L T A W S P E Q I S Q GCGGTTAAGGATCGACTTCCCTGATGATGAGAGTATGAGAATCTCCCATGAAGCGATCTA R L R I D F P D D E S M R I S H E A I Y R L R I D F P D D E S M R I S H E A I Y CCAGGCGCTCTATATTGAGGGGCGCGGGGCGCTGAAGCGTGAACTCGTGGCCGCACTGCG Q A L Y I E G R G A L K R E L V A A L R Q A L Y I E G R G A L K R E L V A A L R GACTGGGCGGGCCCTGCGTAAACCCCGCGCCCGGTCCAAGAGCAAGCCTAAAGGTCATCT T G R A L R K P R A R S K S K P K G H L T G R A L R K P R A R S K S K P K G H L CACCGCCGATGTTGTCATCTCTAACCGGCCCCCGGAAGCCTCGGATCGGGCGGTGCCCGG T A D V V I S N R P P E A S D R A V P G T A D V V I S N R P P E A S D R A V P G GCATTGGGAAGGAGACTTGATCATCGGTACCGGCAGGTCAGCGATCGGGACCGTGGTCGA H W E G D L I I G T G R S A I G T V V E H W E G D L I I G T G R S A I G T V V E ACGCTACAGCCGGTCGATCCTGCTGGTGCACCTGCCCCGGTTGGACGGCTGGGGTGAACA R Y S R S I L L V H L P R L D G W G E Q R Y S R S I L L V H L P R L D G W G E Q ACCAAGGACGAAGAACGGACCTGCCTTGGGTGGGTACGGTGCTGAAGCGATGAACACCGC P R T K N G P A L G G Y G A E A M N T A P R T K N G P A L G G Y G A E A M N T A CCTACAAACCGTGATGAAAGATCTACCGTTACAACTGCGTCAAACGTTGACCTGGGACCG L Q T V M K D L P L Q L R Q T L T W D R L Q T V M K D L P L Q L R Q T L T W D R CGGAACCGAGCTCGCTGACCATGCCGCTTTCACTCTAGCCACGGGCACGAAAGTGTTCTT G T E L A D H A A F T L A T G T K V F F G T E L A D H A A F T L A T G T K V F F CGCGGACCCACACTCGCCATGGCAACGTCCCACGAATGAGAACAGCAACGGACTCCTACG A D P H S P W Q R P T N E N S N G L L R A D P H S P W Q R P T N E N S N G L L R CCAGTACTTTCCCAAGGGTACCGACCTGTCTCGATGGACAGCCCAAGACCTCGCCGCCAT Q Y F P K G T D L S R W T A Q D L A A I Q Y F P K G T D L S R W T A Q D L A A I CGCCTACACGCTCAACAACAGACCAAGAAAAGTCCTTGGATTTCGAACCCCAGCCGAAGT A Y T L N N R P R K V L G F R T P A E V A Y T L N N R P R K V L G F R T P A E V CTTCAATGAACAACTACAATCAATTCAAAACAACAGTGTTGCAACCACCGATTGA F N E Q L Q S I Q N N S V A T T D F N E Q L Q S I Q N N S V A T T D --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.726): GTGCAACGCCAGTTCTGGGGTCTGATCGCGACGGGAATCACCACTGCGCAGGCCGCCCTT V Q R Q F W G L I A T G I T T A Q A A L M Q R Q F W G L I A T G I T T A Q A A L CAGGTGGGGGTGTCCGTACCGGTGGGAACGAGGTGGTTCCGTCATGCTGGTGGAATGAGA Q V G V S V P V G T R W F R H A G G M R Q V G V S V P V G T R W F R H A G G M R CCGTTAGCTTTGGACGAGCCCTCGGGGCGGTATCTATCGTTTACTGAACGAGAGGAAATC P L A L D E P S G R Y L S F T E R E E I P L A L D E P S G R Y L S F A E R E E I GCGATCCTGTGGGAGAAACAGACGGGTGTGCGTGAGATCGCTCGACGGATTGGCCGCAAT A I L W E K Q T G V R E I A R R I G R N A I L W E K Q T G V R E I A R R I G R N CCGGCGACGATTTCTCGTGAGCTACGGCGTAATACTGCCACCCGTGGTGGCAAGCAGATT P A T I S R E L R R N T A T R G G K Q I P A T I S R E L R R N A A T R G G K Q I TATCGGGCAGGGGTGGCCCAGTGGAAAGCTCAGGAAGCCGCTAAGCGTCCCAAACAAGCA Y R A G V A Q W K A Q E A A K R P K Q A Y R V G V A Q W K A Q E A A K R P K Q A AAACTCGTGGATAATCCGCGCCTGCGGGACTATGTTCAGGAGCGTCTTGCTGGGACGGTC K L V D N P R L R D Y V Q E R L A G T V K L V D N P R L R D Y V Q E R L A G T V CGAGAT*GA*AACGGGGTCGTCATGGCGGGGCCTGATACGCCTGCGTGGAAGGGCCGGAG R D N G V V M A G P D T P A W K G R S R D *E** N G V V M A G P D T P A W K G R S CAAACCTCACAGGGCAGACCGACGGTGGTTGACCGCGTGGAGCCCGGAGCAGATATCGCA K P H R A D R R W L T A W S P E Q I S Q K P H R A D R R W L T A W S P E Q I S Q GCGGTTAAGGATCGACTTCCCTGATGATGAGAGTATGAGAATCTCCCATGAAGCGATCTA R L R I D F P D D E S M R I S H E A I Y R L R I D F P D D E S M R I S H E A I Y CCAGGCGCTCTATATTGAGGGGCGCGGGGCGCTGAAGCGTGAACTCGTGGCCGCACTGCG Q A L Y I E G R G A L K R E L V A A L R Q A L Y I E G R G A L K R E L V A A L R GACTGGGCGGGCCCTGCGTAAACCCCGCGCCCGGTCCAAGAGCAAGCCTAAAGGTCATCT T G R A L R K P R A R S K S K P K G H L T G R A L R K P R A R S K S K P K G H V CACCGCCGATGTTGTCATCTCTAACCGGCCCCCGGAAGCCTCGGATCGGGCGGTGCCCGG T A D V V I S N R P P E A S D R A V P G T A D V V I S N R P P E A S D R A V P G GCATTGGGAAGGAGACTTGATCATCGGTACCGGCAGGTCAGCGATCGGGACCGTGGTCGA H W E G D L I I G T G R S A I G T V V E H W E G D L I I G T G R S A I G T V V E ACGCTACAGCCGGTCGATCCTGCTGGTGCACCTGCCCCGGTTGGACGGCTGGGGTGAACA R Y S R S I L L V H L P R L D G W G E Q R Y S R S I L L V H L P R L D G W G E Q ACCAAGGACGAAGAACGGACCTGCCTTGGGTGGGTACGGTGCTGAAGCGATGAACACCGC P R T K N G P A L G G Y G A E A M N T A P R T K N G P A L G G Y G A E A M N T A CCTACAAACCGTGATGAAAGATCTACCGTTACAACTGCGTCAAACGTTGACCTGGGACCG L Q T V M K D L P L Q L R Q T L T W D R L Q T V M K D L P L Q L R Q T L T W D R CGGAACCGAGCTCGCTGACCATGCCGCTTTCACTCTAGCCACGGGCACGAAAGTGTTCTT G T E L A D H A A F T L A T G T K V F F G T E L A D H A A F T L A T G T K V F F CGCGGACCCACACTCGCCATGGCAACGTCCCACGAATGAGAACAGCAACGGACTCCTACG A D P H S P W Q R P T N E N S N G L L R A D P H S P W Q R P T N E N S N G L L R CCAGTACTTTCCCAAGGGTACCGACCTGTCTCGATGGACAGCCCAAGACCTCGCCGCCAT Q Y F P K G T D L S R W T A Q D L A A I Q Y F P K G T D L S R W T A Q D L A A I CGCCTACACGCTCAACAACAGACCAAGAAAAGTCCTTGGATTTCGAACCCCAGCCGAAGT A Y T L N N R P R K V L G F R T P A E V A Y T L N N R P R K V L G F R T P A E V CTTCAATGAACAACTACAATCAATTCAAAACAACAGTGTTGCAACCACCGATTGA F N E Q L Q S I Q N N S V A T T D F N E Q L Q S I Q N N S V A T T D --- // >fig|6666666.67454.peg.328 fig|257309.1.peg.387 Putative ArsR family regulatory protein gi|372118535|gb|CP003217.1|_326370_326230,gi|372118535|gb|CP003217.1|_326230_326102 MQTVKAAALFKVLSDPTRLQLLYLVAENPERLCCVDLSEALAVSAPxxTHHMKKLADANLVTRHKRGKWAYYEIVNDEFARVHELIRTL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGCAAACCGTTAAGGCGGCCGCCCTTTTTAAGGTGCTCTCAGATCCAACGCGCCTCCAA M Q T V K A A A L F K V L S D P T R L Q M Q T V K A A A L F K V L S D P T R L Q CTGCTCTACCTGGTAGCAGAAAATCCCGAACGACTCTGCTGTGTCGATCTCTCAGAGGCA L L Y L V A E N P E R L C C V D L S E A L L Y L V A E N P E R L C C V D L S E A CTTGCCGTCTCGGCCCCA*CG*GTCACACACCACATGAAAAAACTCGCCGATGCCAACCT L A V S A P V T H H M K K L A D A N L L A V S A P *X** X T H H M K K L A D A N L CGTCACCCGCCACAAACGTGGCAAATGGGCATATTACGAGATAGTCAACGACGAGTTCGC V T R H K R G K W A Y Y E I V N D E F A V T R H K R G K W A Y Y E I V N D E F A CCGCGTACACGAGCTCATCCGGACGCTCTAA R V H E L I R T L R V H E L I R T L --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.387): ATGCAAACCGTTAAGGCGGCCGCCCTTTTTAAGGTGCTCTCAGATCCAACGCGCCTCCAA M Q T V K A A A L F K V L S D P T R L Q M Q T V K A A A L F K V L S D P T R L Q CTGCTCTACCTGGTAGCAGAAAATCCCGAACGACTCTGCTGTGTCGATCTCTCAGAGGCA L L Y L V A E N P E R L C C V D L S E A L L Y L V A E N P E R L C C V D L S E A CTTGCCGTCTCG*GC*CCCACGGTCACACACCACATGAAAAAACTCGCCGATGCCAACCT L A V S P T V T H H M K K L A D A N L L A V S *A** P T V T H H M K K L A D A N L CGTCACCCGCCACAAACGTGGCAAATGGGCATATTACGAGATAGTCAACGACGAGTTCGC V T R H K R G K W A Y Y E I V N D E F A V T R H K R G K W A Y Y E I V N D E F A CCGCGTACACGAGCTCATCCGGACGCTCTAA R V H E L I R T L R V H E L I R T L --- // >fig|6666666.67454.peg.293 fig|257309.1.peg.354 Uncharacterized protein SCO4203 FIG003217 gi|372118535|gb|CP003217.1|_293626_293015,gi|372118535|gb|CP003217.1|_293013_292804 MADHAHNLRATFGHGRPIGVITRGTTGFNRLRRCDRWMAHHPLIQQALRRTSDPIALDVGYGASFTTTVEWARWLRTMRNDVRVTGLEIDPERVLPPRDGVTFELGGFELAGYQPTLVRAFNVLRQYDADQVVDAWEMVTSRLQPGGFFVEGTCDELGRRSTWVLLNHTGPQSLTLCWDPLDVERPSDIAERLPKILIHRNVAGVAGEKIHDVLLRADEAWDRCAPWASYGPRVRWRAARAMLMDMGIPMSIIRRPVRDNQLTVPWSIVDPTT We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCTGATCATGCCCATAATTTGCGCGCCACTTTTGGGCATGGTCGTCCCATTGGTGTG M A D H A H N L R A T F G H G R P I G V M A D H A H N L R A T F G H G R P I G V ATTACTCGGGGGACCACTGGGTTTAATCGCCTCCGGCGTTGTGACCGCTGGATGGCTCAT I T R G T T G F N R L R R C D R W M A H I T R G T T G F N R L R R C D R W M A H CATCCGCTGATCCAGCAGGCGCTGCGCCGCACCAGCGACCCTATCGCTCTTGACGTGGGG H P L I Q Q A L R R T S D P I A L D V G H P L I Q Q A L R R T S D P I A L D V G TACGGGGCAAGTTTTACCACCACGGTCGAGTGGGCTCGTTGGTTGCGCACCATGCGTAAC Y G A S F T T T V E W A R W L R T M R N Y G A S F T T T V E W A R W L R T M R N GACGTCCGCGTCACCGGCTTAGAAATAGACCCAGAACGGGTCCTGCCGCCGCGCGATGGT D V R V T G L E I D P E R V L P P R D G D V R V T G L E I D P E R V L P P R D G GTGACCTTTGAACTTGGGGGTTTTGAATTAGCGGGTTACCAGCCCACCTTAGTGCGCGCT V T F E L G G F E L A G Y Q P T L V R A V T F E L G G F E L A G Y Q P T L V R A TTTAACGTGCTGCGCCAATATGATGCGGACCAAGTCGTGGATGCTTGGGAGATGGTGACC F N V L R Q Y D A D Q V V D A W E M V T F N V L R Q Y D A D Q V V D A W E M V T TCGCGCCTACAACCTGGCGGATTTTTTGTGGAAGGCACCTGTGATGAGTTGGGGCGGCGG S R L Q P G G F F V E G T C D E L G R R S R L Q P G G F F V E G T C D E L G R R TCAACGTGGGTGTTGTTGAATCATACTGGCCCGCAGTCGCTGACGCTGTGCTGGGATCCA S T W V L L N H T G P Q S L T L C W D P S T W V L L N H T G P Q S L T L C W D P CTTGATGTAGAGCGCCCTTCCGATATTGCGGAGCGGTTGCCTAAGATTTTGATCCACCGC L D V E R P S D I A E R L P K I L I H R L D V E R P S D I A E R L P K I L I H R AATGTTGCGGGATGTTGCGGGCGAAAAAATTCATGATGTGTTGCTTCGTGCCGACGAAGC N V A G V A G E K I H D V L L R A D E A N V A G - V A G E K I H D V L L R A D E A GTGGGATCGCTGCGCCCCGTGGGCCTCGTATGGCCCTCGCGTTCGGTGGCGGGCGGCCCG W D R C A P W A S Y G P R V R W R A A R W D R C A P W A S Y G P R V R W R A A R AGCGATGCTTATGGATATGGGAATTCCGATGAGCATTATTCGCCGTCCGGTGCGCGATAA A M L M D M G I P M S I I R R P V R D N A M L M D M G I P M S I I R R P V R D N TCAGCTCACGGTGCCGTGGTCGATCGTCGATCCAACCACCTAG Q L T V P W S I V D P T T Q L T V P W S I V D P T T --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.354): ATGGCTGATCATGCCCATAATTTGCGCGCCACTTTTGGGCATGGTCGTCCCATTGGTGTG M A D H A H N L R A T F G H G R P I G V M A D H A H N L R A T F G H G R P I G V ATTACTCGGGGGACCACTGGGTTTAATCGCCTCCGGCGTTGTGACCGCTGGATGGCTCAT I T R G T T G F N R L R R C D R W M A H I T R G T T G F N R L R R C D R W M A H CATCCGCTGATCCAGCAGGCGCTGCGCCGCACCAGCGACCCTATCGCTCTTGACGTGGGG H P L I Q Q A L R R T S D P I A L D V G H P L I Q Q A L R R T S D P I A L D V G TACGGGGCAAGTTTTACCACCACGGTCGAGTGGGCTCGTTGGTTGCGCACCATGCGTAAC Y G A S F T T T V E W A R W L R T M R N Y G A S F T T T V E W A R W L R T M R D GACGTCCGCGTCACCGGCTTAGAAATAGACCCAGAACGGGTCCTGCCGCCGCGCGATGGT D V R V T G L E I D P E R V L P P R D G D V R V T G L E I D P E R V L P P R D G GTGACCTTTGAACTTGGGGGTTTTGAATTAGCGGGTTACCAGCCCACCTTAGTGCGCGCT V T F E L G G F E L A G Y Q P T L V R A V T F E L G G F E L A G Y Q P T L V R A TTTAACGTGCTGCGCCAATATGATGCGGACCAAGTCGTGGATGCTTGGGAGATGGTGACC F N V L R Q Y D A D Q V V D A W E M V T F N V L R Q Y D V D Q V M D A W E M V T TCGCGCCTACAACCTGGCGGATTTTTTGTGGAAGGCACCTGTGATGAGTTGGGGCGGCGG S R L Q P G G F F V E G T C D E L G R R S R L Q P G G F F V E G T C D E L G R R TCAACGTGGGTGTTGTTGAATCATACTGGCCCGCAGTCGCTGACGCTGTGCTGGGATCCA S T W V L L N H T G P Q S L T L C W D P S T W V L L N H A G P Q S L T L C W D P CTTGATGTAGAGCGCCCTTCCGATATTGCGGAGCGGTTGCCTAAGATTTTGATCCACCGC L D V E R P S D I A E R L P K I L I H R F D V E R P S D I A E R L P K I L I H R AATGTTGCGGGATGTTGCGGGCGAAAAAATTCATGATGTGTTGCTTCGTGCCGACGAAGC N V A G E K I H D V L L R A D E A N V A G ---------- E K I H D V L L R T D E A GTGGGATCGCTGCGCCCCGTGGGCCTCGTATGGCCCTCGCGTTCGGTGGCGGGCGGCCCG W D R C A P W A S Y G P R V R W R A A R W D R C A P W A S Y G P R V R W R A A R AGCGATGCTTATGGATATGGGAATTCCGATGAGCATTATTCGCCGTCCGGTGCGCGATAA A M L M D M G I P M S I I R R P V R D N A M L M D M G I P M S I I R R P V R D N TCAGCTCACGGTGCCGTGGTCGATCGTCGATCCAACCACCTAG Q L T V P W S I V D P T T Q L T V P W S I V D P T T --- // >fig|6666666.67454.peg.1775 fig|196164.1.peg.2389 Holo-[acyl-carrier protein] synthase (EC 2.7.8.7) FIG000540 gi|372118535|gb|CP003217.1|_1812268_1811888,gi|372118535|gb|CP003217.1|_1811884_1811861 MIVIGTDIVCIPSFAQQLDQPGTQFDRVFSAQELRVAARYQGRRRAEHLAGRWAAKEAFVKAWSQSLYGKPPVLEHVDWAEIEVQPDAWGRVLVVPRGEVARACGIECAQVSISHDGNYAMAQCVLGxAVATAKR We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGATTGTTATTGGAACCGACATCGTGTGCATTCCCTCTTTTGCGCAGCAATTAGATCAG M I V I G T D I V C I P S F A Q Q L D Q M I V I G T D I V C I P S F A Q Q L D Q CCTGGTACGCAGTTTGACCGGGTGTTTTCGGCCCAAGAGTTACGTGTTGCGGCACGCTAT P G T Q F D R V F S A Q E L R V A A R Y P G T Q F D R V F S A Q E L R V A A R Y CAGGGGCGGCGGCGTGCCGAGCATTTGGCGGGGCGGTGGGCTGCTAAGGAAGCGTTTGTT Q G R R R A E H L A G R W A A K E A F V Q G R R R A E H L A G R W A A K E A F V AAGGCGTGGTCGCAGTCGCTGTATGGCAAGCCGCCGGTGTTGGAGCACGTCGATTGGGCT K A W S Q S L Y G K P P V L E H V D W A K A W S Q S L Y G K P P V L E H V D W A GAGATCGAGGTGCAGCCGGACGCGTGGGGGCGGGTGCTGGTGGTGCCGCGTGGGGAGGTA E I E V Q P D A W G R V L V V P R G E V E I E V Q P D A W G R V L V V P R G E V GCGCGTGCTTGCGGAATTGAGTGCGCGCAGGTGAGTATCAGCCATGACGGAAATTACGCC A R A C G I E C A Q V S I S H D G N Y A A R A C G I E C A Q V S I S H D G N Y A ATGGCGCAGTGCGTGCTGGGCTAAGCGGTGGCGACGGCGAAGAGGTAG M A Q C V L G * A V A T A K R M A Q C V L G X A V A T A K R --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2389): ATGATTGTTATTGGAACCGACATCGTGTGCATTCCCTCTTTTGCGCAGCAATTAGATCAG M I V I G T D I V C I P S F A Q Q L D Q M I S I G T D L V H I P A F A D Q L A Q CCTGGTACGCAGTTTGACCGGGTGTTTTCGGCCCAAGAGTTACGTGTTGCGGCACGCTAT P G T Q F D R V F S A Q E L R V A A R Y P G S S F M D V F G A G E R R L A S R R CAGGGGCGGCGGCGTGCCGAGCATTTGGCGGGGCGGTGGGCTGCTAAGGAAGCGTTTGTT Q G R R R A E H L A G R W A A K E A F V A G N R N A E H L A G R W A A K E A F I AAGGCGTGGTCGCAGTCGCTGTATGGCAAGCCGCCGGTGTTG--GAGCACGTCGATTGGG K A W S Q S L Y G K P P V L E H V D W K A W S Q A I Y G Q P P V I PE E D V Q W CTGAGATCGAGGTGCAGCCGGACGCGTGGGGGCGGGTGCTG--GTGGTGCCGCGT--GGG A E I E V Q P D A W G R V L V V P R G A L I E V R A D R W G R V A LD I A P S LD T GAGGTAGCGCGTGCTTGCGGAATTGAGTGCGCGCAGGTGAGTATCAGCCATGACGGAAAT E V A R A C G I E C A Q V S I S H D G N Q V R E S I G D Y T T S L S I S H D G D TACGCCATGGCGCAGTGCGTGCTGGGCTAAGCGGTGGCGACGGCGAAGAGGTAG Y A M A Q C V L G * A V A T A K R Y A T A V C V L S Y A V A T E N R --- // >fig|6666666.67454.peg.1868 fig|257309.1.peg.2324 gi|372118535|gb|CP003217.1|_1906160_1905981,gi|372118535|gb|CP003217.1|_1905977_1905960 MGRFHNHSLAGIGWHWWVLVGAPPPLTPEKTALHTKSAQTAGLEAIWCEVSRKILRNTPVxWLFWF We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGGGACGTTTTCACAACCATAGCCTGGCTGGGATTGGCTGGCATTGGTGGGTGTTGGTG V G R F H N H S L A G I G W H W W V L V M G R F H N H S L A G I G W H W W V L V GGCGCGCCACCCCCGCTCACCCCCGAAAAGACGGCACTTCACACCAAATCTGCTCAAACG G A P P P L T P E K T A L H T K S A Q T G A P P P L T P E K T A L H T K S A Q T GCCGGTTTGGAAGCGATTTGGTGTGAAGTGTCGAGAAAAATCCTTCGAAATACCCCCGTT A G L E A I W C E V S R K I L R N T P V A G L E A I W C E V S R K I L R N T P V TAGTGGCTCTTCTGGTTTTAG * W L F W F X W L F W F --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2324): GTGGGACGTTTTCACAACCATA---GCCTGGCTGGGATTGGCTGGCATTGGTGGGTGTTG V F T T I A W L G L A G I G G C W ------- M I S S L GVR A W L A L V G A G G C W GTGG*GC*---GCGCCACCCCCGCTCACCCCCGAAAAGACGGCACTTCACACCAAATCTG W A P P P L T P E K T A L H T K S W *V**LVG A P P P L T P E K T A L H T K S CTCAAACGGCCGGTTTGGAAGCGATTTGGTGTGAAGTGTCGAGAAAAATCCTTCGAAATA A Q T A G L E A I W C E V S R K I L R N S Q T A G L E A I W C E V S R K I L R N CCCCCGTTTAGTGGCTCTTCTGGTTTT*AG*-- T P V * W L S G F T P V W W L - S G F *G**AR // >fig|6666666.67454.peg.192 fig|257309.1.peg.257 Putative surface-anchored membrane protein gi|372118535|gb|CP003217.1|_186462_186914,gi|372118535|gb|CP003217.1|_186914_189703 MVDSRFYEPLGFRRSPIRRLITLLMVVVVCVGLVVSPRVPSAGAAECKGEISNVQWKNDTNIKDGVFVGSYGQGADVQFDWKVDPGAKAGDQFTLKLPNELSRLGNKDLTLTAPSGEEVAKGTWDDVAKTWTFTLTDYANSHGDISGSAFxxVQWDRSVAQSNTQYPLTFSGCKGAGTLNGKTPEEGVGGTAQATSKTGLYDSKTDSARWNIYVETADTDIYTPVVVKDIGNTQLLFRCSDVKVFDRTPYPHTEIRDTPIDPNRWKCEEKDGGIIVSMVPDEHGRYLTAGQSLTIGFETPINDDTSRFITNKAIVEISPNKIENVEYSVDRGDAGGVGQGFQGKIKIQKEVVGETAPVQGNKFDFEYKCGETTQNISVAAGQTSDIFTQRSSSTCSITEKNVAEGVTVDFEVIDEETGKPAYVVPIDNGVTVKFNKNSSTTLNVKVTNTYPNKPEAKKGKFVIKKTVNGLDAGQKDKAFKFNYTCKAPDGDAYTEPQLAEVTAGRTWQSGNYPEGTICTIEEDLESAKVPGYSLISAQPKGDVTIKAEGTEGSPVEFAATNSYTKDLGSFSVQKKIEASAEAMPLLKDQEFGFKYTCGADKGEFKLKNGETKKVERIATGTKCTVEESDAKVPNGFMWTGKIEGTDLDPNDFTIVKDKTLAFTATNTYKQQYGGFTLSKNVTGDATNLEELQKRSYTFNYTCTAPTGTVLKDKVEITEETPKAIGNIPAASTCKVTEVEAPAKDTDWTVDLSVNGTWVGETAEFKVPAEGEPSISILAKNNYRQHKGSFTIEKIVDASEGIVTPKEFTFTWQCGEDKGAETVRVTNGKGRVEIDRAFPVGTKCSVKELEAEAEDARLITSWENQEFTIDKDKQHVIVSATNTYRYAESKVKIVKKLEGPAKDKAKDKTFTFDYSCVVNNEAIEGSVNITGEGATEIPESFPAGTKCTITERDASISGTTWTHRIAEDGQITIQSPAKVYQVGVTNAYSKPGFPWFIPLIPLVIIPFLPLFPHPTPAPQPAPQPTPQKPSEQQPSPKAPEKKPQKEKKVLARTGANVWMFIVIAVLLVLLGAFLRRRGNNS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGTTGATTCGCGTTTTTATGAACCCCTTGGGTTCAGACGCTCCCCAATCCGCAGGCTG M V D S R F Y E P L G F R R S P I R R L M V D S R F Y E P L G F R R S P I R R L ATCACCCTGCTAATGGTGGTCGTTGTTTGCGTAGGTCTAGTGGTTTCCCCTCGTGTTCCT I T L L M V V V V C V G L V V S P R V P I T L L M V V V V C V G L V V S P R V P TCTGCTGGTGCGGCAGAGTGTAAGGGGGAGATTAGTAATGTGCAGTGGAAGAACGACACA S A G A A E C K G E I S N V Q W K N D T S A G A A E C K G E I S N V Q W K N D T AATATCAAAGATGGAGTATTTGTTGGTAGCTATGGGCAGGGGGCAGACGTTCAGTTCGAC N I K D G V F V G S Y G Q G A D V Q F D N I K D G V F V G S Y G Q G A D V Q F D TGGAAAGTTGATCCAGGCGCGAAAGCTGGCGATCAATTCACTTTGAAACTCCCTAACGAG W K V D P G A K A G D Q F T L K L P N E W K V D P G A K A G D Q F T L K L P N E CTTTCTCGATTGGGGAATAAAGATCTAACGCTTACTGCTCCTAGTGGAGAAGAAGTAGCC L S R L G N K D L T L T A P S G E E V A L S R L G N K D L T L T A P S G E E V A AAGGGAACGTGGGATGACGTAGCAAAAACGTGGACTTTTACGCTCACTGATTATGCGAAT K G T W D D V A K T W T F T L T D Y A N K G T W D D V A K T W T F T L T D Y A N AGTCATGGTGATATTTCAGGTAGTGCTTTT*TC*ACAGTTCAGTGGGATAGATCAGTTGC S H G D I S G S A F T V Q W D R S V A S H G D I S G S A F *X** X V Q W D R S V A ACAATCGAATACCCAGTATCCATTAACTTTTTCAGGATGTAAAGGGGCCGGAACCCTTAA Q S N T Q Y P L T F S G C K G A G T L N Q S N T Q Y P L T F S G C K G A G T L N TGGAAAAACGCCTGAAGAAGGTGTAGGGGGTACTGCTCAAGCAACATCAAAGACGGGCCT G K T P E E G V G G T A Q A T S K T G L G K T P E E G V G G T A Q A T S K T G L CTATGACTCCAAAACTGATTCTGCACGATGGAACATCTATGTCGAAACAGCGGATACTGA Y D S K T D S A R W N I Y V E T A D T D Y D S K T D S A R W N I Y V E T A D T D TATCTATACCCCCGTTGTTGTCAAAGATATTGGAAATACCCAGCTGCTGTTTAGGTGTTC I Y T P V V V K D I G N T Q L L F R C S I Y T P V V V K D I G N T Q L L F R C S TGATGTCAAGGTTTTTGATCGCACCCCTTACCCTCATACGGAGATCCGCGATACACCCAT D V K V F D R T P Y P H T E I R D T P I D V K V F D R T P Y P H T E I R D T P I TGATCCAAATCGATGGAAGTGCGAGGAAAAAGATGGCGGAATAATTGTCAGCATGGTGCC D P N R W K C E E K D G G I I V S M V P D P N R W K C E E K D G G I I V S M V P GGATGAGCACGGAAGGTATCTGACAGCTGGACAATCGCTGACCATCGGGTTTGAGACACC D E H G R Y L T A G Q S L T I G F E T P D E H G R Y L T A G Q S L T I G F E T P TATCAATGATGATACTTCTCGCTTTATTACGAATAAGGCGATTGTTGAAATCAGTCCTAA I N D D T S R F I T N K A I V E I S P N I N D D T S R F I T N K A I V E I S P N TAAAATCGAGAATGTGGAATACTCGGTAGACCGCGGCGACGCTGGTGGGGTGGGCCAAGG K I E N V E Y S V D R G D A G G V G Q G K I E N V E Y S V D R G D A G G V G Q G TTTTCAAGGCAAGATCAAGATTCAAAAGGAAGTAGTCGGGGAAACTGCACCTGTACAGGG F Q G K I K I Q K E V V G E T A P V Q G F Q G K I K I Q K E V V G E T A P V Q G AAACAAATTTGATTTCGAGTATAAATGTGGTGAAACAACGCAGAATATTTCCGTTGCTGC N K F D F E Y K C G E T T Q N I S V A A N K F D F E Y K C G E T T Q N I S V A A CGGACAAACCTCGGATATCTTTACCCAACGCTCTTCTTCTACATGCTCTATTACCGAAAA G Q T S D I F T Q R S S S T C S I T E K G Q T S D I F T Q R S S S T C S I T E K GAACGTTGCTGAAGGCGTTACAGTCGACTTTGAAGTAATAGATGAAGAAACGGGTAAACC N V A E G V T V D F E V I D E E T G K P N V A E G V T V D F E V I D E E T G K P AGCCTACGTTGTTCCGATCGACAATGGCGTAACGGTAAAGTTCAACAAGAACAGTTCCAC A Y V V P I D N G V T V K F N K N S S T A Y V V P I D N G V T V K F N K N S S T GACGCTAAACGTAAAGGTCACAAACACCTACCCCAATAAGCCAGAAGCTAAGAAGGGCAA T L N V K V T N T Y P N K P E A K K G K T L N V K V T N T Y P N K P E A K K G K GTTTGTTATCAAGAAGACGGTTAACGGCCTTGATGCTGGCCAGAAAGATAAAGCCTTCAA F V I K K T V N G L D A G Q K D K A F K F V I K K T V N G L D A G Q K D K A F K GTTCAATTACACCTGTAAAGCGCCAGATGGTGATGCCTACACGGAGCCTCAGCTAGCAGA F N Y T C K A P D G D A Y T E P Q L A E F N Y T C K A P D G D A Y T E P Q L A E GGTAACTGCAGGAAGAACCTGGCAATCGGGAAACTATCCTGAGGGAACAATCTGTACGAT V T A G R T W Q S G N Y P E G T I C T I V T A G R T W Q S G N Y P E G T I C T I AGAGGAAGACCTTGAGAGTGCAAAGGTTCCTGGTTACTCACTGATTTCTGCCCAACCTAA E E D L E S A K V P G Y S L I S A Q P K E E D L E S A K V P G Y S L I S A Q P K GGGAGATGTCACGATCAAAGCCGAGGGCACTGAAGGCTCCCCAGTAGAGTTCGCTGCAAC G D V T I K A E G T E G S P V E F A A T G D V T I K A E G T E G S P V E F A A T CAACTCTTATACCAAGGATCTTGGTAGCTTCTCCGTCCAGAAGAAGATCGAGGCATCGGC N S Y T K D L G S F S V Q K K I E A S A N S Y T K D L G S F S V Q K K I E A S A TGAGGCAATGCCGCTGCTCAAAGATCAAGAATTTGGCTTTAAGTACACCTGTGGAGCTGA E A M P L L K D Q E F G F K Y T C G A D E A M P L L K D Q E F G F K Y T C G A D CAAAGGCGAGTTTAAGCTCAAAAACGGCGAAACAAAGAAGGTTGAAAGGATTGCTACTGG K G E F K L K N G E T K K V E R I A T G K G E F K L K N G E T K K V E R I A T G CACAAAATGCACCGTCGAGGAGTCGGATGCCAAGGTGCCAAACGGCTTTATGTGGACTGG T K C T V E E S D A K V P N G F M W T G T K C T V E E S D A K V P N G F M W T G GAAGATCGAGGGCACAGATCTTGATCCTAACGACTTCACGATTGTGAAGGATAAAACCCT K I E G T D L D P N D F T I V K D K T L K I E G T D L D P N D F T I V K D K T L AGCCTTTACTGCCACCAACACCTATAAGCAACAGTATGGTGGCTTCACACTGTCCAAGAA A F T A T N T Y K Q Q Y G G F T L S K N A F T A T N T Y K Q Q Y G G F T L S K N CGTTACCGGTGACGCAACCAACCTAGAAGAATTGCAGAAGCGTTCTTACACGTTTAACTA V T G D A T N L E E L Q K R S Y T F N Y V T G D A T N L E E L Q K R S Y T F N Y CACCTGCACCGCACCAACTGGCACTGTCCTAAAAGACAAGGTTGAGATCACTGAGGAAAC T C T A P T G T V L K D K V E I T E E T T C T A P T G T V L K D K V E I T E E T CCCGAAGGCAATCGGCAACATTCCAGCAGCCTCTACCTGTAAGGTCACGGAAGTCGAGGC P K A I G N I P A A S T C K V T E V E A P K A I G N I P A A S T C K V T E V E A CCCTGCTAAAGACACTGACTGGACTGTTGACTTAAGCGTTAATGGAACGTGGGTAGGAGA P A K D T D W T V D L S V N G T W V G E P A K D T D W T V D L S V N G T W V G E AACCGCGGAGTTTAAGGTTCCTGCTGAAGGTGAGCCGTCGATAAGCATTCTTGCAAAGAA T A E F K V P A E G E P S I S I L A K N T A E F K V P A E G E P S I S I L A K N CAACTACCGCCAGCACAAGGGAAGCTTCACGATTGAAAAGATTGTGGATGCATCGGAAGG N Y R Q H K G S F T I E K I V D A S E G N Y R Q H K G S F T I E K I V D A S E G TATCGTCACGCCGAAGGAATTTACGTTCACGTGGCAGTGCGGCGAGGATAAAGGAGCTGA I V T P K E F T F T W Q C G E D K G A E I V T P K E F T F T W Q C G E D K G A E GACCGTCCGGGTTACCAATGGCAAGGGCCGTGTAGAAATTGACCGCGCATTCCCAGTGGG T V R V T N G K G R V E I D R A F P V G T V R V T N G K G R V E I D R A F P V G CACCAAATGTTCAGTGAAAGAGCTGGAGGCCGAGGCTGAAGACGCAAGGCTCATTACAAG T K C S V K E L E A E A E D A R L I T S T K C S V K E L E A E A E D A R L I T S CTGGGAAAACCAGGAATTCACGATCGACAAAGATAAGCAACACGTGATTGTTTCTGCGAC W E N Q E F T I D K D K Q H V I V S A T W E N Q E F T I D K D K Q H V I V S A T GAATACCTACAGGTACGCAGAAAGCAAGGTCAAGATTGTGAAGAAGCTTGAAGGTCCGGC N T Y R Y A E S K V K I V K K L E G P A N T Y R Y A E S K V K I V K K L E G P A AAAGGATAAGGCAAAAGACAAGACCTTTACTTTCGATTACAGCTGCGTTGTTAATAACGA K D K A K D K T F T F D Y S C V V N N E K D K A K D K T F T F D Y S C V V N N E GGCTATTGAAGGTTCTGTGAACATCACTGGTGAGGGTGCAACTGAGATTCCTGAGTCCTT A I E G S V N I T G E G A T E I P E S F A I E G S V N I T G E G A T E I P E S F CCCTGCAGGTACCAAGTGCACCATTACTGAGCGGGATGCAAGTATCTCTGGAACCACGTG P A G T K C T I T E R D A S I S G T T W P A G T K C T I T E R D A S I S G T T W GACACATCGGATTGCAGAGGATGGTCAGATCACCATTCAGAGTCCGGCTAAGGTGTATCA T H R I A E D G Q I T I Q S P A K V Y Q T H R I A E D G Q I T I Q S P A K V Y Q AGTCGGTGTAACCAATGCTTACTCCAAGCCTGGTTTCCCTTGGTTCATCCCGCTGATTCC V G V T N A Y S K P G F P W F I P L I P V G V T N A Y S K P G F P W F I P L I P GCTTGTGATCATTCCGTTCCTACCGTTGTTCCCGCATCCAACTCCTGCACCGCAGCCAGC L V I I P F L P L F P H P T P A P Q P A L V I I P F L P L F P H P T P A P Q P A TCCACAGCCGACACCGCAGAAACCGTCGGAACAGCAGCCTTCCCCCAAGGCTCCTGAAAA P Q P T P Q K P S E Q Q P S P K A P E K P Q P T P Q K P S E Q Q P S P K A P E K GAAGCCACAGAAGGAGAAGAAGGTTCTGGCACGCACTGGCGCTAACGTATGGATGTTTAT K P Q K E K K V L A R T G A N V W M F I K P Q K E K K V L A R T G A N V W M F I TGTTATCGCTGTACTCCTTGTGCTGTTGGGAGCATTCCTCCGCAGGCGCGGTAACAACTC V I A V L L V L L G A F L R R R G N N S V I A V L L V L L G A F L R R R G N N S ATAG --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.257): ATGGTTGATTCGCGTTTTTATGAACCCCTTGGGTTCAGACGCTCCCCAATCCGCAGGCTG M V D S R F Y E P L G F R R S P I R R L M V D S R F Y E P L G F R R S P I R R L ATCACCCTGCTAATGGTGGTCGTTGTTTGCGTAGGTCTAGTGGTTTCCCCTCGTGTTCCT I T L L M V V V V C V G L V V S P R V P I T L L M V V V V C V G L V V S P R V P TCTGCTGGTGCGGCAGAGTGTAAGGGGGAGATTAGTAATGTGCAGTGGAAGAACGACACA S A G A A E C K G E I S N V Q W K N D T S A G A A E C K G E I S N V Q W K N D T AATATCAAAGATGGAGTATTTGTTGGTAGCTATGGGCAGGGGGCAGACGTTCAGTTCGAC N I K D G V F V G S Y G Q G A D V Q F D N I K D G V F V G S Y G Q G A D V Q F D TGGAAAGTTGATCCAGGCGCGAAAGCTGGCGATCAATTCACTTTGAAACTCCCTAACGAG W K V D P G A K A G D Q F T L K L P N E W K V D P G A K A G D Q F T L K L P N E CTTTCTCGATTGGGGAATAAAGATCTAACGCTTACTGCTCCTAGTGGAGAAGAAGTAGCC L S R L G N K D L T L T A P S G E E V A L S R L G N K D L T L T A P S G E E V A AAGGGAACGTGGGATGACGTAGCAAAAACGTGGACTTTTACGCTCACTGATTATGCGAAT K G T W D D V A K T W T F T L T D Y A N K G T W D D V A K T W T F T L T D Y A N AGTCATGGTGATATTTCAGGTAGT*GC*TTTTTCACAGTTCAGTGGGATAGATCAGTTGC S H G D I S G S F F T V Q W D R S V A S H G D I S G S *A** F F T V Q W D R S V A ACAATCGAATACCCAGTATCCATTAACTTTTTCAGGATGTAAAGGGGCCGGAACCCTTAA Q S N T Q Y P L T F S G C K G A G T L N Q S N T Q Y P L T F S G C K G A G T L N TGGAAAAACGCCTGAAGAAGGTGTAGGGGGTACTGCTCAAGCAACATCAAAGACGGGCCT G K T P E E G V G G T A Q A T S K T G L G K T P E E G V G G T A Q A T S K T G L CTATGACTCCAAAACTGATTCTGCACGATGGAACATCTATGTCGAAACAGCGGATACTGA Y D S K T D S A R W N I Y V E T A D T D Y D S K T D S A R W N I Y V E T A D T D TATCTATACCCCCGTTGTTGTCAAAGATATTGGAAATACCCAGCTGCTGTTTAGGTGTTC I Y T P V V V K D I G N T Q L L F R C S I Y T P V V V K D I G N T Q L L F R C S TGATGTCAAGGTTTTTGATCGCACCCCTTACCCTCATACGGAGATCCGCGATACACCCAT D V K V F D R T P Y P H T E I R D T P I D V K V F D R T P Y P H T K I R D T P I TGATCCAAATCGATGGAAGTGCGAGGAAAAAGATGGCGGAATAATTGTCAGCATGGTGCC D P N R W K C E E K D G G I I V S M V P D P N R W K C E E K D G G I I V S M V P GGATGAGCACGGAAGGTATCTGACAGCTGGACAATCGCTGACCATCGGGTTTGAGACACC D E H G R Y L T A G Q S L T I G F E T P D E H G R Y L T A G Q S L T I G F E T P TATCAATGATGATACTTCTCGCTTTATTACGAATAAGGCGATTGTTGAAATCAGTCCTAA I N D D T S R F I T N K A I V E I S P N I N D D T S R F I T N K A I V E I S P N TAAAATCGAGAATGTGGAATACTCGGTAGACCGCGGCGACGCTGGTGGGGTGGGCCAAGG K I E N V E Y S V D R G D A G G V G Q G K I E N V E Y S V D R G D A G G V G Q G TTTTCAAGGCAAGATCAAGATTCAAAAGGAAGTAGTCGGGGAAACTGCACCTGTACAGGG F Q G K I K I Q K E V V G E T A P V Q G F Q G K I K I Q K E V V G E T A P V Q G AAACAAATTTGATTTCGAGTATAAATGTGGTGAAACAACGCAGAATATTTCCGTTGCTGC N K F D F E Y K C G E T T Q N I S V A A N K F D F E Y K C G E T T Q N I S V A A CGGACAAACCTCGGATATCTTTACCCAACGCTCTTCTTCTACATGCTCTATTACCGAAAA G Q T S D I F T Q R S S S T C S I T E K G Q T S D I F T Q R S S S T C S I T E K GAACGTTGCTGAAGGCGTTACAGTCGACTTTGAAGTAATAGATGAAGAAACGGGTAAACC N V A E G V T V D F E V I D E E T G K P N V A E G V T V D F E V I D E E T G K P AGCCTACGTTGTTCCGATCGACAATGGCGTAACGGTAAAGTTCAACAAGAACAGTTCCAC A Y V V P I D N G V T V K F N K N S S T A Y V V P I D N G V T V K F N K N S S T GACGCTAAACGTAAAGGTCACAAACACCTACCCCAATAAGCCAGAAGCTAAGAAGGGCAA T L N V K V T N T Y P N K P E A K K G K T L N V K V T N T Y P N K P E A K K G K GTTTGTTATCAAGAAGACGGTTAACGGCCTTGATGCTGGCCAGAAAGATAAAGCCTTCAA F V I K K T V N G L D A G Q K D K A F K F V I K K T V N G L D A G Q K D K A F K GTTCAATTACACCTGTAAAGCGCCAGATGGTGATGCCTACACGGAGCCTCAGCTAGCAGA F N Y T C K A P D G D A Y T E P Q L A E F N Y T C K A P D G D A Y T E P Q L A E GGTAACTGCAGGAAGAACCTGGCAATCGGGAAACTATCCTGAGGGAACAATCTGTACGAT V T A G R T W Q S G N Y P E G T I C T I V T A G R T W Q S G N Y P E G T I C T I AGAGGAAGACCTTGAGAGTGCAAAGGTTCCTGGTTACTCACTGATTTCTGCCCAACCTAA E E D L E S A K V P G Y S L I S A Q P K E E D L E S A K V P G Y S L I S A Q P K GGGAGATGTCACGATCAAAGCCGAGGGCACTGAAGGCTCCCCAGTAGAGTTCGCTGCAAC G D V T I K A E G T E G S P V E F A A T G D V T I K A E G T E G S P V E F A A T CAACTCTTATACCAAGGATCTTGGTAGCTTCTCCGTCCAGAAGAAGATCGAGGCATCGGC N S Y T K D L G S F S V Q K K I E A S A N S Y T K D L G S F S V Q K K I E A S A TGAGGCAATGCCGCTGCTCAAAGATCAAGAATTTGGCTTTAAGTACACCTGTGGAGCTGA E A M P L L K D Q E F G F K Y T C G A D E A M P L L K D Q E F G F K Y T C G A D CAAAGGCGAGTTTAAGCTCAAAAACGGCGAAACAAAGAAGGTTGAAAGGATTGCTACTGG K G E F K L K N G E T K K V E R I A T G K G E F K L K N G E T K K V E R I A T G CACAAAATGCACCGTCGAGGAGTCGGATGCCAAGGTGCCAAACGGCTTTATGTGGACTGG T K C T V E E S D A K V P N G F M W T G T K C T V E E S D A K V P N G F M W T G GAAGATCGAGGGCACAGATCTTGATCCTAACGACTTCACGATTGTGAAGGATAAAACCCT K I E G T D L D P N D F T I V K D K T L K I E G T D L D P N D F T I V K D K T L AGCCTTTACTGCCACCAACACCTATAAGCAACAGTATGGTGGCTTCACACTGTCCAAGAA A F T A T N T Y K Q Q Y G G F T L S K N A F T A T N T Y K Q Q Y G G F T L S K N CGTTACCGGTGACGCAACCAACCTAGAAGAATTGCAGAAGCGTTCTTACACGTTTAACTA V T G D A T N L E E L Q K R S Y T F N Y V T G D A T N L E E L Q K R S Y T F N Y CACCTGCACCGCACCAACTGGCACTGTCCTAAAAGACAAGGTTGAGATCACTGAGGAAAC T C T A P T G T V L K D K V E I T E E T T C T A P T G T V L K D K V E I T E E T CCCGAAGGCAATCGGCAACATTCCAGCAGCCTCTACCTGTAAGGTCACGGAAGTCGAGGC P K A I G N I P A A S T C K V T E V E A P K A I G N I P A A S T C K V T E V E A CCCTGCTAAAGACACTGACTGGACTGTTGACTTAAGCGTTAATGGAACGTGGGTAGGAGA P A K D T D W T V D L S V N G T W V G E P A K D T D W T V D L S V N G T W V G E AACCGCGGAGTTTAAGGTTCCTGCTGAAGGTGAGCCGTCGATAAGCATTCTTGCAAAGAA T A E F K V P A E G E P S I S I L A K N T A E F K V P A E G E P S I S I L A K N CAACTACCGCCAGCACAAGGGAAGCTTCACGATTGAAAAGATTGTGGATGCATCGGAAGG N Y R Q H K G S F T I E K I V D A S E G N Y R Q H K G S F T I E K I V D A S E G TATCGTCACGCCGAAGGAATTTACGTTCACGTGGCAGTGCGGCGAGGATAAAGGAGCTGA I V T P K E F T F T W Q C G E D K G A E I V T P K E F T F T W Q C G E D K G A E GACCGTCCGGGTTACCAATGGCAAGGGCCGTGTAGAAATTGACCGCGCATTCCCAGTGGG T V R V T N G K G R V E I D R A F P V G T V R V T N G K G R V E I D R A F P V G CACCAAATGTTCAGTGAAAGAGCTGGAGGCCGAGGCTGAAGACGCAAGGCTCATTACAAG T K C S V K E L E A E A E D A R L I T S T K C S V K E L E A E A E D A R L I T S CTGGGAAAACCAGGAATTCACGATCGACAAAGATAAGCAACACGTGATTGTTTCTGCGAC W E N Q E F T I D K D K Q H V I V S A T W E N Q E F T I D K D K Q H V I V S A T GAATACCTACAGGTACGCAGAAAGCAAGGTCAAGATTGTGAAGAAGCTTGAAGGTCCGGC N T Y R Y A E S K V K I V K K L E G P A N T Y R Y A E S K V K I V K K L E G P A AAAGGATAAGGCAAAAGACAAGACCTTTACTTTCGATTACAGCTGCGTTGTTAATAACGA K D K A K D K T F T F D Y S C V V N N E K D K A K D K T F T F D Y S C V V N N E GGCTATTGAAGGTTCTGTGAACATCACTGGTGAGGGTGCAACTGAGATTCCTGAGTCCTT A I E G S V N I T G E G A T E I P E S F A I E G S V N I T G E G A T E I P E S F CCCTGCAGGTACCAAGTGCACCATTACTGAGCGGGATGCAAGTATCTCTGGAACCACGTG P A G T K C T I T E R D A S I S G T T W P A G T K C T I T E R D A S I S G T T W GACACATCGGATTGCAGAGGATGGTCAGATCACCATTCAGAGTCCGGCTAAGGTGTATCA T H R I A E D G Q I T I Q S P A K V Y Q T H R I A E D G Q I T I Q S P A K V Y Q AGTCGGTGTAACCAATGCTTACTCCAAGCCTGGTTTCCCTTGGTTCATCCCGCTGATTCC V G V T N A Y S K P G F P W F I P L I P V G V T N A Y S K P G F P W F I P L I P GCTTGTGATCATTCCGTTCCTACCGTTGTTCCCGCATCCAACTCCTGCACCGCAGCCAGC L V I I P F L P L F P H P T P A P Q P A L V I I P F L P L F P H P T P A P Q P A TCCACAGCCGACACCGCAGAAACCGTCGGAACAGCAGCCTTCCCCCAAGGCTCCTGAAAA P Q P T P Q K P S E Q Q P S P K A P E K P Q P T P Q K P S E Q Q P S P K A P E K GAAGCCACAGAAGGAGAAGAAGGTTCTGGCACGCACTGGCGCTAACGTATGGATGTTTAT K P Q K E K K V L A R T G A N V W M F I K P Q K E K K V L A R T G A N V W M F I TGTTATCGCTGTACTCCTTGTGCTGTTGGGAGCATTCCTCCGCAGGCGCGGTAACAACTC V I A V L L V L L G A F L R R R G N N S V I A V L L V L L G A F L R R R G N N S ATAG --- // >fig|6666666.67454.peg.1792 fig|257309.1.peg.249 No significant database matches gi|372118535|gb|CP003217.1|_1832243_1832656,gi|372118535|gb|CP003217.1|_1832656_1833342 MNTTGETTQPFYSHCDMNDPLCRAERLRIQFDYYRWHSLQPDDNDDVDTYTADIATRIGKTQRYVCDHLDAIYYLTQLPQLHALYQQLWHLDDTRLITITRIISALPTTYYDAIDTHLTRWLTPTQPAQTIPSTRPLxxFLRKTITHLGFHLDNTRKPEQYVYIYDAGHGLAGIDALIHAGVAELLETTLRSIKKTHSCDDSTALQLLLEDKTSVVINLYDTGTGITYTPQGTALPQVPEHPVIRVLGDADVAVSTGYRFTEAMRRFIQGRDGVCRFPGCGVPAQWCDIDHVEEYDLGGVTGAVNAQCLCRHHHNVKTSRRVDCEIGAGGVVTWQIGDRKVVTTPEGVLAGQTFRQRREKKIKKAA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAACACCACAGGGGAGACCACACAACCGTTCTACAGTCACTGCGACATGAACGACCCA M N T T G E T T Q P F Y S H C D M N D P M N T T G E T T Q P F Y S H C D M N D P CTTTGCCGCGCCGAACGACTACGCATCCAATTCGACTACTACCGCTGGCACAGCCTACAA L C R A E R L R I Q F D Y Y R W H S L Q L C R A E R L R I Q F D Y Y R W H S L Q CCCGATGACAACGACGATGTTGACACCTACACCGCAGACATCGCCACCCGCATCGGCAAA P D D N D D V D T Y T A D I A T R I G K P D D N D D V D T Y T A D I A T R I G K ACCCAACGCTACGTCTGCGACCACCTCGACGCCATCTACTACCTCACCCAACTCCCACAA T Q R Y V C D H L D A I Y Y L T Q L P Q T Q R Y V C D H L D A I Y Y L T Q L P Q CTCCACGCCCTCTACCAACAACTCTGGCACCTCGACGACACCCGACTTATCACCATCACC L H A L Y Q Q L W H L D D T R L I T I T L H A L Y Q Q L W H L D D T R L I T I T AGAATCATCTCCGCACTACCTACCACCTACTATGACGCCATCGACACCCACCTGACACGC R I I S A L P T T Y Y D A I D T H L T R R I I S A L P T T Y Y D A I D T H L T R TGGCTCACGCCCACCCAACCAGCACAAACCATCCCCAGTACCAGGCCATTA*CC*CGATT W L T P T Q P A Q T I P S T R P L R F W L T P T Q P A Q T I P S T R P L *X** X F CCTACGCAAAACCATCACCCACCTCGGCTTTCATCTCGACAACACCCGAAAACCAGAACA L R K T I T H L G F H L D N T R K P E Q L R K T I T H L G F H L D N T R K P E Q ATACGTCTACATCTACGACGCTGGACACGGACTCGCAGGCATCGACGCCCTCATCCACGC Y V Y I Y D A G H G L A G I D A L I H A Y V Y I Y D A G H G L A G I D A L I H A CGGTGTCGCAGAACTACTCGAGACCACCTTGCGTAGCATCAAAAAGACCCATAGCTGTGA G V A E L L E T T L R S I K K T H S C D G V A E L L E T T L R S I K K T H S C D TGACTCCACAGCCCTGCAACTACTGTTAGAAGATAAAACCAGTGTGGTGATCAACCTCTA D S T A L Q L L L E D K T S V V I N L Y D S T A L Q L L L E D K T S V V I N L Y TGACACCGGCACCGGGATCACCTACACCCCGCAGGGAACAGCTCTGCCTCAGGTGCCTGA D T G T G I T Y T P Q G T A L P Q V P E D T G T G I T Y T P Q G T A L P Q V P E GCATCCTGTTATTCGTGTGCTCGGTGACGCTGATGTGGCTGTGTCGACTGGTTATCGGTT H P V I R V L G D A D V A V S T G Y R F H P V I R V L G D A D V A V S T G Y R F TACAGAGGCAATGCGTAGGTTTATTCAAGGCCGTGATGGGGTGTGTCGTTTCCCTGGTTG T E A M R R F I Q G R D G V C R F P G C T E A M R R F I Q G R D G V C R F P G C TGGGGTGCCAGCACAGTGGTGCGATATTGACCATGTTGAAGAATATGATCTCGGTGGGGT G V P A Q W C D I D H V E E Y D L G G V G V P A Q W C D I D H V E E Y D L G G V TACCGGTGCGGTTAACGCTCAGTGTTTATGTCGGCATCATCACAATGTGAAAACGTCTCG T G A V N A Q C L C R H H H N V K T S R T G A V N A Q C L C R H H H N V K T S R TCGGGTCGATTGTGAGATTGGTGCCGGTGGTGTGGTGACGTGGCAGATCGGTGATCGTAA R V D C E I G A G G V V T W Q I G D R K R V D C E I G A G G V V T W Q I G D R K GGTGGTTACCACACCGGAAGGGGTGCTAGCGGGGCAAACGTTTAGGCAACGCAGAGAAAA V V T T P E G V L A G Q T F R Q R R E K V V T T P E G V L A G Q T F R Q R R E K GAAAATCAAAAAAGCGGCATAG K I K K A A K I K K A A --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.249): ATGAACACCACAGGGGAGACCACACAACCGTTCTACAGTCACTGCGACATGAACGACCCA M N T T G E T T Q P F Y S H C D M N D P M N T T G E T T Q P F Y S H C D M N D P CTTTGCCGCGCCGAACGACTACGCATCCAATTCGACTACTACCGCTGGCACAGCCTACAA L C R A E R L R I Q F D Y Y R W H S L Q L C R A E R L R I Q F D Y Y R W H S L Q CCCGATGACAACGACGATGTTGACACCTACACCGCAGACATCGCCACCCGCATCGGCAAA P D D N D D V D T Y T A D I A T R I G K P D D N D D V D T Y T A D I A T R I G K ACCCAACGCTACGTCTGCGACCACCTCGACGCCATCTACTACCTCACCCAACTCCCACAA T Q R Y V C D H L D A I Y Y L T Q L P Q T Q R Y V C D H L D A I Y Y L T Q L P Q CTCCACGCCCTCTACCAACAACTCTGGCACCTCGACGACACCCGACTTATCACCATCACC L H A L Y Q Q L W H L D D T R L I T I T L H T V Y Q Q L W H L D D T R L I T I T AGAATCATCTCCGCACTACCTACCACCTACTATGACGCCATCGACACCCACCTGACACGC R I I S A L P T T Y Y D A I D T H L T R R I I S A L P T T Y Y D A I D T H L T R TGGCTCACGCCCACCCAACCAGCACAAACCATCCCCAGTACCAGG*CC*ATTACCCGATT W L T P T Q P A Q T I P S T R I T R F W L T P T Q P A Q T I P S T R *A** I T R F CCTACGCAAAACCATCACCCACCTCGGCTTTCATCTCGACAACACCCGAAAACCAGAACA L R K T I T H L G F H L D N T R K P E Q L R K T I T H L G F H L D N T R K P E Q ATACGTCTACATCTACGACGCTGGACACGGACTCGCAGGCATCGACGCCCTCATCCACGC Y V Y I Y D A G H G L A G I D A L I H A Y V Y I Y D A G H G L A G I D A L I H A CGGTGTCGCAGAACTACTCGAGACCACCTTGCGTAGCATCAAAAAGACCCATAGCTGTGA G V A E L L E T T L R S I K K T H S C D G V A E L L E T T L R S I K K T H S C D TGACTCCACAGCCCTGCAACTACTGTTAGAAGATAAAACCAGTGTGGTGATCAACCTCTA D S T A L Q L L L E D K T S V V I N L Y D S T A L Q L L L E D K T S V V I N L Y TGACACCGGCACCGGGATCACCTACACCCCGCAGGGAACAGCTCTGCCTCAGGTGCCTGA D T G T G I T Y T P Q G T A L P Q V P E D T G T G I T Y T P Q G T A L P Q V P E GCATCCTGTTATTCGTGTGCTCGGTGACGCTGATGTGGCTGTGTCGACTGGTTATCGGTT H P V I R V L G D A D V A V S T G Y R F H L V I R V L G D A D V A V S T G Y R F TACAGAGGCAATGCGTAGGTTTATTCAAGGCCGTGATGGGGTGTGTCGTTTCCCTGGTTG T E A M R R F I Q G R D G V C R F P G C T E A M R R F I Q G R D G V C R F P G C TGGGGTGCCAGCACAGTGGTGCGATATTGACCATGTTGAAGAATATGATCTCGGTGGGGT G V P A Q W C D I D H V E E Y D L G G V G V P A Q W C D I D H V E E Y D L G G V TACCGGTGCGGTTAACGCTCAGTGTTTATGTCGGCATCATCACAATGTGAAAACGTCTCG T G A V N A Q C L C R H H H N V K T S R T G A V N A Q C L C R H H H N V K T S R TCGGGTCGATTGTGAGATTGGTGCCGGTGGTGTGGTGACGTGGCAGATCGGTGATCGTAA R V D C E I G A G G V V T W Q I G D R K R V D C E I G A G G V V T W Q I G D R R GGTGGTTACCACACCGGAAGGGGTGCTAGCGGGGCAAACGTTTAGGCAACGCAGAGAAAA V V T T P E G V L A G Q T F R Q R R E K V V T T P E G V L A G Q T F R Q R R E K GAAAATCAAAAAAGCGGCATAG K I K K A A K I K K A A --- // >fig|6666666.67454.peg.1196 fig|257309.1.peg.716 Mobile element protein gi|372118535|gb|CP003217.1|_1215408_1214185,gi|372118535|gb|CP003217.1|_1214185_1214030 MNRSYTNTQKRTALRVYKRTQSVTKTVRELGYPGRWTLYKWLREPKTPPQPRKQAKTLTHYPYEVKLRAVELFHNGWRPADIAQECCLHTHASVYAWAQRYREEGQWGLMSKKERAGHGRIPTKAALEKSLPDNPTQLKQQMATLLVEKAVLEKELEIIKKDVSVIPGQLSNKHKTDVVDALRSTFPLAMLLAASGLAASSFYYHLKKRRMPDKHAAIRSMVHRISSDSHNTYGYRRIWWQLRHLGITISEKVVRRLMREEAITVRFPKRKVKYSSYQGEISPAPPNLVNRCFHATAANTLWLTDISVFAANEGRVYLSVIIDCFDGKVVAAKTSVNPTMELAESTLQAAIDAEGLPPDGSLVIHSDRGVHYRGRSWHSLTAKYGIVRSMSKKGCSPDNAACEGFSGxxKNEMYYGKRWQTIQELDDAIAAYIEFYNNHRIKVSLNGMSIARYRMAAVA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGCT Y P Y E V K L R A V E L F H N G W R P A Y P Y E V K L R A V E L F H N G W R P A GATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACGC D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R TACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCGC Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R ATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACAG I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q CAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGAC K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D GCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATCC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S AGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAGC S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S ATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTGG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W CAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGAA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E GAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGAA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E ATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATACG I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T TTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGTG L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V ATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTATG I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGGT E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCTG S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L ACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGCG T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GCATGCGAGGGTTTTTCGGGC*GG*ATGAAAAATGAGATGTATTACGGCAAGAGGTGGCA A C E G F S G M K N E M Y Y G K R W Q A C E G F S G *X** X K N E M Y Y G K R W Q GACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATCG T I Q E L D D A I A A Y I E F Y N N H R T I Q E L D D A I A A Y I E F Y N N H R CATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGTG I K V S L N G M S I A R Y R M A A V A I K V S L N G M S I A R Y R M A A V A -- A - ========== Now we show an alignment against a similar protein (fig|257309.1.peg.716): ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGCT Y P Y E V K L R A V E L F H N G W R P A Y P Y E V K L R A V E L F H N G W R P A GATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACGC D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R TACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCGC Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R ATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACAG I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q CAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGAC K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D GCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATCC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S AGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAGC S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S ATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTGG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W CAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGAA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E GAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGAA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E ATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATACG I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T TTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGTG L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V ATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTATG I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGGT E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCTG S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L ACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGCG T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GCATGC*GA*GGGTTTTTCGGGCGGATGAAAAATGAGATGTATTACGGCAAGAGGTGGCA A C G F F G R M K N E M Y Y G K R W Q A C *E** G F F G R M K N E M Y Y G K R W Q GACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATCG T I Q E L D D A I A A Y I E F Y N N H R T I Q E L D D A I A A Y I E F Y N N H R CATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGTG I K V S L N G M S I A R Y R M A A V A I K V S L N G M S I A R Y R M A A V A -- A - // >fig|6666666.67454.peg.672 fig|257309.1.peg.716 Mobile element protein gi|372118535|gb|CP003217.1|_663757_663942,gi|372118535|gb|CP003217.1|_663944_664981,gi|372118535|gb|CP003217.1|_664981_665136 MNRSYTNTQKRTALRVYKRTQSVTKTVRELGYPGRWTLYKWLREPKTPPQPRKQAKTLTHYPYEVKLRAVELFHNGWRPADIAQECCLHTHASVYAWAQRYREEGQWGLMSKKERAGHGRIPTKAALEKSLPDNPTQLKQQMATLLVEKAVLEKELEIIKKDVSVIPGQLSNKHKTDVVDALRSTFPLAMLLAASGLAASSFYYHLKKRRMPDKHAAIRSMVHRISSDSHNTYGYRRIWWQLRHLGITISEKVVRRLMREEAITVRFPKRKVKYSSYQGEISPAPPNLVNRCFHATAANTLWLTDISVFAANEGRVYLSVIIDCFDGKVVAAKTSVNPTMELAESTLQAAIDAEGLPPDGSLVIHSDRGVHYRGRSWHSLTAKYGIVRSMSKKGCSPDNAACEGFSGxxKNEMYYGKRWQTIQELDDAIAAYIEFYNNHRIKVSLNGMSIARYRMAAVA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGC Y P Y E V K L R A V E L F H N G W R P A Y P - Y E V K L R A V E L F H N G W R P A TGATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACG D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R CTACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCG Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R CATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACA I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q GCAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGA K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D CGCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S CAGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAG S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S CATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W GCAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E AGAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E AATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATAC I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T GTTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGT L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V GATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTAT I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GGAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGG E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TTCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCT S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L GACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGC T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GGCATGCGAGGGTTTTTCGGGC*GG*ATGAAAAATGAGATGTATTACGGCAAGAGGTGGC A C E G F S G M K N E M Y Y G K R W A C E G F S G *X** X K N E M Y Y G K R W AGACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATC Q T I Q E L D D A I A A Y I E F Y N N H Q T I Q E L D D A I A A Y I E F Y N N H GCATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGT R I K V S L N G M S I A R Y R M A A V A R I K V S L N G M S I A R Y R M A A V A - GA -- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.716): ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGC Y P Y E V K L R A V E L F H N G W R P A Y P - Y E V K L R A V E L F H N G W R P A TGATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACG D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R CTACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCG Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R CATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACA I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q GCAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGA K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D CGCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S CAGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAG S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S CATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W GCAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E AGAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E AATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATAC I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T GTTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGT L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V GATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTAT I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GGAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGG E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TTCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCT S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L GACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGC T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GGCATGC*GA*GGGTTTTTCGGGCGGATGAAAAATGAGATGTATTACGGCAAGAGGTGGC A C G F F G R M K N E M Y Y G K R W A C *E** G F F G R M K N E M Y Y G K R W AGACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATC Q T I Q E L D D A I A A Y I E F Y N N H Q T I Q E L D D A I A A Y I E F Y N N H GCATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGT R I K V S L N G M S I A R Y R M A A V A R I K V S L N G M S I A R Y R M A A V A - GA -- // >fig|6666666.67454.peg.1297 fig|257309.1.peg.716 Mobile element protein gi|372118535|gb|CP003217.1|_1327487_1326264,gi|372118535|gb|CP003217.1|_1326264_1326109 MNRSYTNTQKRTALRVYKRTQSVTKTVRELGYPGRWTLYKWLREPKTPPQPRKQAKTLTHYPYEVKLRAVELFHNGWRPADIAQECCLHTHASVYAWAQRYREEGQWGLMSKKERAGHGRIPTKAALEKSLPDNPTQLKQQMATLLVEKAVLEKELEIIKKDVSVIPGQLSNKHKTDVVDALRSTFPLAMLLAASGLAASSFYYHLKKRRMPDKHAAIRSMVHRISSDSHNTYGYRRIWWQLRHLGITISEKVVRRLMREEAITVRFPKRKVKYSSYQGEISPAPPNLVNRCFHATAANTLWLTDISVFAANEGRVYLSVIIDCFDGKVVAAKTSVNPTMELAESTLQAAIDAEGLPPDGSLVIHSDRGVHYRGRSWHSLTAKYGIVRSMSKKGCSPDNAACEGFSGxxKNEMYYGKRWQTIQELDDAIAAYIEFYNNHRIKVSLNGMSIARYRMAAVA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGCT Y P Y E V K L R A V E L F H N G W R P A Y P Y E V K L R A V E L F H N G W R P A GATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACGC D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R TACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCGC Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R ATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACAG I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q CAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGAC K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D GCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATCC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S AGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAGC S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S ATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTGG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W CAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGAA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E GAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGAA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E ATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATACG I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T TTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGTG L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V ATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTATG I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGGT E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCTG S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L ACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGCG T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GCATGCGAGGGTTTTTCGGGC*GG*ATGAAAAATGAGATGTATTACGGCAAGAGGTGGCA A C E G F S G M K N E M Y Y G K R W Q A C E G F S G *X** X K N E M Y Y G K R W Q GACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATCG T I Q E L D D A I A A Y I E F Y N N H R T I Q E L D D A I A A Y I E F Y N N H R CATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGTG I K V S L N G M S I A R Y R M A A V A I K V S L N G M S I A R Y R M A A V A -- A - ========== Now we show an alignment against a similar protein (fig|257309.1.peg.716): ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGCT Y P Y E V K L R A V E L F H N G W R P A Y P Y E V K L R A V E L F H N G W R P A GATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACGC D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R TACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCGC Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R ATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACAG I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q CAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGAC K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D GCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATCC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S AGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAGC S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S ATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTGG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W CAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGAA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E GAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGAA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E ATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATACG I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T TTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGTG L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V ATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTATG I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGGT E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCTG S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L ACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGCG T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GCATGC*GA*GGGTTTTTCGGGCGGATGAAAAATGAGATGTATTACGGCAAGAGGTGGCA A C G F F G R M K N E M Y Y G K R W Q A C *E** G F F G R M K N E M Y Y G K R W Q GACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATCG T I Q E L D D A I A A Y I E F Y N N H R T I Q E L D D A I A A Y I E F Y N N H R CATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGTG I K V S L N G M S I A R Y R M A A V A I K V S L N G M S I A R Y R M A A V A -- A - // >fig|6666666.67454.peg.2130 fig|196164.1.peg.2713 FIG008913: Membrane-associated phospholipid phosphatase gi|372118535|gb|CP003217.1|_2193600_2193580,gi|372118535|gb|CP003217.1|_2193576_2193559,gi|372118535|gb|CP003217.1|_2193555_2193472,gi|372118535|gb|CP003217.1|_2193468_2193268,gi|372118535|gb|CP003217.1|_2193264_2193169,gi|372118535|gb|CP003217.1|_2193167_2192712 MCQRCTTxVVRWLLxRRSAGCSRALSTPCLRRIRSTTMCRRLTxLRLTLVGLACRVSTAPRCRPPMVAVLSTANVTVLRPRNFCRSRTACKRRSLRTSIACVRSTVRLTRSxPAVRRGRRFSRNHKGLRSPSERSRHTCRGAKTLATPGVLATARGLSHFGEHALGWMGMGALGALIDAPRRAQWVRLVAAAFVSHAISVVVKRIVRRKRPHDPRIKIGVGTPSKLSFPSSHATSTSAALVSLARITRNPLPLLGIPVMMVSRMVLGVHYPTDVATGALVGAVTAEAIARTGKVK We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGTGCCAACGGTGTACAACCTGAGTGGTCCGCTGGCTCCTGTGAAGAAGGTCGGCTGGT V C Q R C T T * V V R W L L * R R S A G M C Q R C T T X V V R W L L X R R S A G TGCTCAAGGGCATTAAGCACACCTTGTCTAAGGAGAATCCGCAGCACCACGATGTGCCGC C S R A L S T P C L R R I R S T T M C R C S R A L S T P C L R R I R S T T M C R AGGCTAACTTAGCTCCGATTAACGCTCGTTGGTTTAGCTTGTCGCGTCTCGACGGCGCCA R L T * L R L T L V G L A C R V S T A P R L T X L R L T L V G L A C R V S T A P CGGTGTCGACCGCCGATGGTCGCGGTGTTGTCTACCGCAAACGTGACCGTGCTCAGGCCA R C R P P M V A V L S T A N V T V L R P R C R P P M V A V L S T A N V T V L R P AGGAACTTTTGCAGGAGTCGTACCGCCTGCAAAAGGAGGTCGCTACGAACTTCGATCGCC R N F C R S R T A C K R R S L R T S I A R N F C R S R T A C K R R S L R T S I A TGCGTGAGGAGTACCGTGCGGCTCACAAGGAGCTGACCAGCCGTGAGGCGTGGGCGAAGA C V R S T V R L T R S * P A V R R G R R C V R S T V R L T R S X P A V R R G R R TTTTCGAGGAACCACAAGGGGCTGAGGAGTCCTAGTGAAAGAAGCAGACATACTTGTAGA F S R N H K G L R S P S E R S R H T C R F S R N H K G L R S P S E R S R H T C R GGTGCAAAAACACCTTGCTACTCCGGGCGTTTTGGCCACGGCTCGCGGTTTGAGTCATTT G A K T L A T P G V L A T A R G L S H F G A K T - L A T P G V L A T A R G L S H F TGGTGAGCACGCCTTGGGGTGGATGGGCATGGGTGCGCTGGGCGCGCTTATCGACGCTCC G E H A L G W M G M G A L G A L I D A P G E H A L G W M G M G A L G A L I D A P CCGTCGTGCGCAGTGGGTTCGTCTCGTTGCAGCTGCCTTTGTGAGCCACGCCATAAGTGT R R A Q W V R L V A A A F V S H A I S V R R A Q W V R L V A A A F V S H A I S V AGTGGTGAAGCGAATCGTGAGACGTAAACGCCCTCACGATCCACGCATCAAAATCGGTGT V V K R I V R R K R P H D P R I K I G V V V K R I V R R K R P H D P R I K I G V CGGAACCCCGTCCAAGCTGAGTTTTCCCAGCTCACATGCGACGTCGACAAGCGCTGCGCT G T P S K L S F P S S H A T S T S A A L G T P S K L S F P S S H A T S T S A A L GGTGAGCCTCGCACGGATCACCCGCAACCCGCTGCCGCTGCTGGGTATCCCCGTGATGAT V S L A R I T R N P L P L L G I P V M M V S L A R I T R N P L P L L G I P V M M GGTGTCGCGTATGGTTCTCGGAGTACATTATCCGACCGACGTGGCCACCGGCGCTCTCGT V S R M V L G V H Y P T D V A T G A L V V S R M V L G V H Y P T D V A T G A L V AGGTGCGGTCACTGCAGAAGCAATTGCACGAACTGGGAAGGTGAAATGA G A V T A E A I A R T G K V K G A V T A E A I A R T G K V K --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2713): GTGTGCCAACG*G*TGT*A*CAACCT*G*AGTGGTCCGCTGGCTCCTGTGAAGAAGGTC- V P T C Q P S G P L A P V K K V -- M P S *C* C *P* A P *P* S C P A P P A R R V Y ----------------GGCTGGTTGCTCAAGGGCATTAAGCACACCTTGTCTAAGGAGAA G W S R A L S T P C L R R PPRTSVAAWPLSRRLC G W ---- P R G S S T P C P G R TCCGCAGCACCACGATGTGCCGCAGGCTAACTTAGCTCCGATTAACGCTCGTTGGTTTAG I R S T T M C R R L T * L R L T L V G L T R P T T R C P R P T S R R S R P A G S CTTGTCGCGTCTCGACGGCGCCACGGTGTCGACCGCCGATGGTCGCGGTGTTGTCTACCG A C R V S T A P R C R P P M V A V L S T A S R V S T A P P S P P P T A A G W S T CAAACGTGACCGTGCTCAGGCCAAGGAACTTTTGCAGGAGTCGTACCGCCTGCAAAAGGA A N V T V L R P R N F C R S R T A C K R A S A T A N R P R S W A G R P C A C R S GGTCGCTACGAACTTCGATCGCCTGCGTGAGGAGTACCGTGCGGCTCACAAGGAGCTGAC R S L R T S I A C V R S T V R L T R S * R W Q S V S T N C A P A T A T H I P G W CAGCCGTGAGGCGTGGGCGAAGATTTTCGAGGAACCACAAGGGGCTGAGGAGTCCTAGTG P A V R R G R R F S R N H K S A A N H G A R C S M S S R ------------------- AAAGAAGCAGACATACTTGTAGAGGTGCAAAAACACCTT-GCTACTCCGGGCGTTTTGGC E A D I L V E V Q K H L A T P G V L A --- E V E I L L G I Q K A L L P V P G V V K CACGGCTCGCGGTTTGAGTCATTTTGGTGAGCACGCCTTGGGGTGGATGGGCATGGGTGC T A R G L S H F G E H A L G W M G M G A T A T S L S L L G E H A A G W L T L G A GCTGGGCGCGCTTATCGACGCTCCCCGTCGTGCGCAGTGGGTTCGTCTCGTTGCAGCTGC L G A L I D A P R R A Q W V R L V A A A A G V V V D K R R R R S W G G L F V A A CTTTGTGAGCCACGCCATAAGTGTAGTGGTGAAGCGAATCGTGAGACGTAAACGCCCTCA F V S H A I S V V V K R I V R R K R P H L T S H A A S V I I K R I V R R K R P H CGATCCACGCATCAAAATCGGTGTCGGAACCCCGTCCAAGCTGAGTTTTCCCAGCTCACA D P R I K I G V G T P S K L S F P S S H D A L I Q I G V G T P S K L S F P S S H TGCGACGTCGACAAGCGCTGCGCTGGTGAGCCTCGCACGGATCACCCGCAACCCGCTGCC A T S T S A A L V S L A R I T R N P L P A T S T T A T M V Y L A R I T R S P L P GCTGCTGGGTATCCCCGTGATGATGGTGTCGCGTATGGTTCTCGGAGTACATTATCCGAC L L G I P V M M V S R M V L G V H Y P T L L G I P V M A L S R M V L G V H Y P T CGACGTGGCCACCGGCGCTCTCGTAGGTGCGGTCACTGCAGAAGCAATTGCACGAACTGG D V A T G A L V G A V T A E A I A R T G D V L A G T I L G A A T A E A V H K I E GAAGGTGAAATGA K V K * R A T A // >fig|6666666.67454.peg.1384 fig|257309.1.peg.2309 PTS system, fructose-specific IIA component (EC 2.7.1.69) / PTS system, fructose-specific IIB component (EC 2.7.1.69) / PTS system, fructose-specific IIC component (EC 2.7.1.69) FIG001234 gi|372118535|gb|CP003217.1|_1408907_1409107,gi|372118535|gb|CP003217.1|_1409109_1409222,gi|372118535|gb|CP003217.1|_1409222_1409539 MAADALTSAAKARGDVSLLVETQGASDNSVLSEKEIASADVVIFATDVGVRDRERFKGKRILECSPRTLSAAIALKNSSRNTTVRPHATHRVAATAYDLERKMRxxAMTGVAYMVPFVAAGGLLLALGFLLGGYDIAAGWQAIAIQHSFTDLPSHDVVIDIATGQSYHFSALAFCFILALWLLLSTQCQCNLLWLHFQDTLRLLSLDAQE We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCAGCGGATGCACTTACTTCGGCCGCGAAAGCACGTGGCGACGTCTCATTGTTAGTA M A A D A L T S A A K A R G D V S L L V M A A D A L T S A A K A R G D V S L L V GAAACTCAAGGCGCTTCTGACAACTCAGTATTAAGTGAAAAAGAGATCGCTTCAGCTGAT E T Q G A S D N S V L S E K E I A S A D E T Q G A S D N S V L S E K E I A S A D GTTGTTATCTTTGCAACCGATGTGGGAGTGCGTGACCGTGAGCGATTCAAAGGGAAACGA V V I F A T D V G V R D R E R F K G K R V V I F A T D V G V R D R E R F K G K R ATCCTTGAATGCAGCCCACGACACCCTTAGCGCCGCAATCGCACTCAAGAATTCTTCAAG I L E C S P R T L S A A I A L K N S S R I L E C S P R - T L S A A I A L K N S S R AAATACGACAGTTCGACCACATGCAACTCATCGTGTAGCAGCAACAGCCTACGATTTAGA N T T V R P H A T H R V A A T A Y D L E N T T V R P H A T H R V A A T A Y D L E ACGAAAAATGCGCACG*CT*GCGATGACAGGTGTTGCCTACATGGTTCCGTTCGTAGCAG R K M R T A M T G V A Y M V P F V A R K M R X *X** A M T G V A Y M V P F V A CCGGAGGATTACTGTTAGCCCTCGGATTTCTTTTGGGAGGCTACGACATAGCTGCTGGAT A G G L L L A L G F L L G G Y D I A A G A G G L L L A L G F L L G G Y D I A A G GGCAGGCAATTGCTATTCAGCATTCGTTCACTGATCTGCCCAGCCACGATGTGGTCATCG W Q A I A I Q H S F T D L P S H D V V I W Q A I A I Q H S F T D L P S H D V V I ATATAGCAACAGGACAGTCGTATCATTTCAGCGCTCTGGCCTTTTGCTTTATCTTGGCGC D I A T G Q S Y H F S A L A F C F I L A D I A T G Q S Y H F S A L A F C F I L A TGTGGCTTTTGCTATCGACTCAATGTCAATGCAATTTATTGTGGCTGCACTTTCAGGATA L W L L L S T Q C Q C N L L W L H F Q D L W L L L S T Q C Q C N L L W L H F Q D CATTGCGTTTGCTATCGCTGGACGCTCAGGAATAG T L R L L S L D A Q E T L R L L S L D A Q E --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2309): ATGGCAGCGGATGCACTTACTTCGGCCGCGAAAGCACGTGGCGACGTCTCATTGTTAGTA M A A D A L T S A A K A R G D V S L L V M A A D A L T S A A K A R G D A S L L V GAAACTCAAGGCGCTTCTGACAACTCAGTATTAAGTGAAAAAGAGATCGCTTCAGCTGAT E T Q G A S D N S V L S E K E I A S A D E T Q G T S D N S V L S E K E I A S A D GTTGTTATCTTTGCAACCGATGTGGGAGTGCGTGACCGTGAGCGATTCAAAGGGAAACGA V V I F A T D V G V R D R E R F K G K R V V I F A A D V G V R D H E R F K G K R ATCCTTGAATGCAGCCCA*C*-------GACACCCTTAGCGCCGCAATCGCACTCAAGAA I L E C S P D T L S A A I A L K N I L E C S P *R*QAIRDPN D T L S A A I A L K N TTCTTCAAGAAATACGACAGTTCGACCACATGCAACTCATCGTGTAGCAGCAACAGCCTA S S R N T T V R P H A T H R V A A T A Y S S R N T T V R P H A T H R V A A T A Y CGATTTAGAACGAAAAATG*CG*CACGCTGCGATGACAGGTGTTGCCTACATGGTTCCGT D L E R K M H A A M T G V A Y M V P D L E R K M *R** H A A M T G V S Y M V P TCGTAGCAGCCGGAGGATTACTGTTAGCCCTCGGATTTCTTTTGGGAGGCTACGACATAG F V A A G G L L L A L G F L L G G Y D I F V A A G G L L L A L G F L L G G Y D I CTGCTGGATGGCAGGCAATTGCTATTCAGCATTCGTTCACTGATCTGCCCAGCCACGATG A A G W Q A I A I Q H S F T D L P S H D A A G W Q A I A I Q H S F T D L P S H D TGGTCATCGATATAGCAACAGGACAGTCGTATCATTTCAGCGCTCTGGCCTTTTGCTTTA V V I D I A T G Q S Y H F S A L A F C F V V I D I A T G Q S Y H F S A L A F C F TCTTGGCGCTGTGGCTTTTGCTATCGACTCAATGTCAATGCAATTTATTGTGGCTGCACT I L A L W L L L S T Q C Q C N L L W L H I L A L W L L L S T Q C Q C N L L W L H TTCAGGATACATTGCGTTTGCTATCGCTGGACGCTCAGGAATAG F Q D T L R L L S L D A Q E F Q D T L R L L S L D A Q E --- // >fig|6666666.67454.peg.1883 fig|257309.1.peg.1862 Putative exported protein gi|372118535|gb|CP003217.1|_1919945_1920385,gi|372118535|gb|CP003217.1|_1920389_1920484,gi|372118535|gb|CP003217.1|_1920488_1920574 MPQINRFSSRWIIAIITAISTAMMFAISAPQASAKEYVTTTGLSPDGNQYSIGWEVPSTQEPARRSKRSTKDYAFETNQLENGMQTLIHIENSEAPTEYRFPLSLPQEAEVIPFSEGSEDAMGVFLNGSLIATIATPWAIDANGAPLxTSLHIENKTLVQIVEHNSDMAFSVTGDPQIDWxWEKRKQLEQQGGATQFEHTVTESVLGSL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGCCACAAATAAACAGATTTTCCAGCCGCTGGATAATCGCCATCATCACTGCGATCTCT M P Q I N R F S S R W I I A I I T A I S M P Q I N R F S S R W I I A I I T A I S ACTGCAATGATGTTCGCCATCAGTGCACCTCAGGCGTCTGCGAAAGAATACGTAACCACG T A M M F A I S A P Q A S A K E Y V T T T A M M F A I S A P Q A S A K E Y V T T ACTGGACTGTCGCCAGATGGCAATCAATACAGCATTGGCTGGGAAGTGCCCTCCACCCAA T G L S P D G N Q Y S I G W E V P S T Q T G L S P D G N Q Y S I G W E V P S T Q GAACCAGCAAGACGTTCTAAGCGCTCCACAAAGGACTACGCCTTCGAAACGAACCAACTC E P A R R S K R S T K D Y A F E T N Q L E P A R R S K R S T K D Y A F E T N Q L GAAAACGGAATGCAGACGCTTATCCATATCGAGAATTCAGAGGCACCTACCGAGTACCGC E N G M Q T L I H I E N S E A P T E Y R E N G M Q T L I H I E N S E A P T E Y R TTCCCGCTCAGCCTCCCGCAAGAAGCTGAAGTCATCCCCTTTAGCGAAGGAAGCGAAGAC F P L S L P Q E A E V I P F S E G S E D F P L S L P Q E A E V I P F S E G S E D GCTATGGGAGTTTTCCTAAACGGAAGCTTGATCGCAACGATCGCCACCCCTTGGGCTATC A M G V F L N G S L I A T I A T P W A I A M G V F L N G S L I A T I A T P W A I GACGCTAACGGCGCTCCCCTCTAGACCTCCCTTCATATTGAGAATAAAACCCTCGTGCAG D A N G A P L * T S L H I E N K T L V Q D A N G A P L X T S L H I E N K T L V Q ATTGTTGAGCACAACTCTGACATGGCTTTCTCGGTCACTGGAGATCCACAGATCGATTGG I V E H N S D M A F S V T G D P Q I D W I V E H N S D M A F S V T G D P Q I D W TGATGGGAGAAACGCAAGCAACTGGAGCAACAGGGGGGTGCGACGCAATTCGAGCACACC * W E K R K Q L E Q Q G G A T Q F E H T X W E K R K Q L E Q Q G G A T Q F E H T GTAACGGAAAGTGTCTTGGGATCGTTGTGA V T E S V L G S L V T E S V L G S L --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1862): ATGCCACAAATAAACAGATTTTCCAGCCGCTGGATAATCGCCATCATCACTGCGATCTCT M P Q I N R F S S R W I I A I I T A I S M P Q I N R F S S R W I I A I I T A I S ACTGCAATGATGTTCGCCATCAGTGCACCTCAGGCGTCTGCGAAAGAATACGTAACCACG T A M M F A I S A P Q A S A K E Y V T T T A M M F A I S V P Q A S A K E Y V T T ACTGGACTGTCGCCAGATGGCAATCAATACAGCATTGGCTGGGAAGTGCCCTCCACCCAA T G L S P D G N Q Y S I G W E V P S T Q T G L S P D G N Q Y S I G W E V P S T Q GAACCAGCAAGACGTTCTAAGCGCTCCACAAAGGACTACGCCTTCGAAACGAACCAACTC E P A R R S K R S T K D Y A F E T N Q L E P A R R S K R S T K D Y A F E T N Q L GAAAACGGAATGCAGACGCTTATCCATATCGAGAATTCAGAGGCACCTACCGAGTACCGC E N G M Q T L I H I E N S E A P T E Y R E N G M Q T L I H I E N S E A P T E Y R TTCCCGCTCAGCCTCCCGCAAGAAGCTGAAGTCATCCCCTTTAGCGAAGGAAGCGAAGAC F P L S L P Q E A E V I P F S E G S E D F P L S L P Q E A E V I P F S E G S E D GCTATGGGAGTTTTCCTAAACGGAAGCTTGATCGCAACGATCGCCACCCCTTGGGCTATC A M G V F L N G S L I A T I A T P W A I A M G V F L N G S L I A T I A T P W A I GACGCTAACGGCGCTCCCCTCTAGACCTCCCTTCATATTGAGAATAAAACCCTCGTGCAG D A N G A P L * T S L H I E N K T L V Q D A N G T P L Q T S L H I E N G T L V Q ATTGTTGAGCACAACTCTGACATGGCTTTCTCGGTCACTGGAGATCCACAGATCGATTGG I V E H N S D M A F S V T G D P Q I D W I V E H N S A T A F P V T A D P Q I D W TGATGGGAGAAA*C*GCAAGCAACTGGAGCAACAGGGGGGTGCGACGCAATTCGAGCACA * W E K A S N G W E K *P* P S S ------------------------------------ CCGTAACGGAAAGTGTCTTGGGATCGTTGTGA -------------------------------- // >fig|6666666.67454.peg.741 fig|196164.1.peg.240 Mobile element protein gi|372118535|gb|CP003217.1|_733581_733793,gi|372118535|gb|CP003217.1|_733797_734852 MTTVSPRKGHDPNRVNEISAKLMENPEIAELIGELSTSTDDASDLVKGLLQASINAGLQAEMDAHLGIRALxSYGESPAGHPGWWQSPQRVVPTKTVNSGYGTFDVTMPRDRAGTFTPRMLPKGTRRLTELDDMIISLYAGGMTVRDIQHHLATTLGVDMSPDTISTITDAVLEEVMIWQNRQLDEFYPVIFLDALRVKIRDGHRVVNKSCYMAVGVDMDGIKHILGLWIADNEGASFWASVCADLANRGVQDVFIVCCDGLKGLPETVEATWPNSMVQTCIVHLIRAANRWVSYQDRKPVSSALREVYTAPTEDTARAALDAFEASELGRKYPQSVKVWRDAWDRFVPFLQFPPAARRVLYTTNSIESLNAELRKATRNRGQFPNDTAALKTLWLTDLQHRGQARCPASEESEARHRMQRLY We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACTACCGTGTCACCGAGGAAAGGTCATGACCCGAACAGGGTCAACGAGATCAGCGCT M T T V S P R K G H D P N R V N E I S A M T T V S P R K G H D P N R V N E I S A AAGCTGATGGAAAATCCGGAAATCGCCGAACTGATCGGCGAGTTGTCGACTTCCACCGAT K L M E N P E I A E L I G E L S T S T D K L M E N P E I A E L I G E L S T S T D GATGCCAGCGACCTGGTCAAAGGTCTTTTGCAGGCATCGATCAACGCTGGTCTGCAGGCT D A S D L V K G L L Q A S I N A G L Q A D A S D L V K G L L Q A S I N A G L Q A GAAATGGACGCGCATCTGGGGATACGCGCACTCTGATCGTACGGCGAAAGCCCAGCTGGG E M D A H L G I R A L * S Y G E S P A G E M D A H L G I R A L X S Y G E S P A G CACCCCGGATGGTGGCAATCACCGCAACGGGTCGTACCGACCAAAACCGTCAACTCTGGC H P G W W Q S P Q R V V P T K T V N S G H P G W W Q S P Q R V V P T K T V N S G TACGGCACCTTTGATGTGACTATGCCCCGGGATCGAGCTGGCACGTTTACGCCGCGGATG Y G T F D V T M P R D R A G T F T P R M Y G T F D V T M P R D R A G T F T P R M CTGCCTAAAGGCACCCGCCGTCTGACGGAGCTTGATGACATGATCATCTCCCTGTACGCC L P K G T R R L T E L D D M I I S L Y A L P K G T R R L T E L D D M I I S L Y A GGTGGGATGACCGTGCGCGATATTCAGCACCACCTCGCCACCACCCTCGGGGTGGATATG G G M T V R D I Q H H L A T T L G V D M G G M T V R D I Q H H L A T T L G V D M AGCCCAGATACGATCAGCACCATTACCGACGCGGTGTTAGAAGAGGTCATGATCTGGCAA S P D T I S T I T D A V L E E V M I W Q S P D T I S T I T D A V L E E V M I W Q AACCGCCAGCTCGACGAGTTCTACCCAGTGATCTTCCTCGACGCGCTGCGAGTGAAGATC N R Q L D E F Y P V I F L D A L R V K I N R Q L D E F Y P V I F L D A L R V K I CGCGATGGCCACCGCGTGGTCAACAAGTCTTGCTACATGGCGGTAGGCGTCGACATGGAC R D G H R V V N K S C Y M A V G V D M D R D G H R V V N K S C Y M A V G V D M D GGCATCAAGCACATCCTGGGATTGTGGATCGCAGACAATGAAGGCGCCAGTTTTTGGGCA G I K H I L G L W I A D N E G A S F W A G I K H I L G L W I A D N E G A S F W A TCCGTGTGCGCTGACCTTGCCAACCGTGGGGTCCAAGACGTGTTCATCGTCTGCTGCGAC S V C A D L A N R G V Q D V F I V C C D S V C A D L A N R G V Q D V F I V C C D GGGCTCAAAGGCCTGCCGGAAACCGTGGAGGCAACCTGGCCGAATTCCATGGTGCAGACC G L K G L P E T V E A T W P N S M V Q T G L K G L P E T V E A T W P N S M V Q T TGTATAGTGCACCTGATCCGGGCGGCCAACAGGTGGGTGTCCTACCAAGACCGCAAACCC C I V H L I R A A N R W V S Y Q D R K P C I V H L I R A A N R W V S Y Q D R K P GTATCAAGTGCGCTACGGGAGGTCTACACCGCACCGACCGAGGACACCGCCCGCGCCGCC V S S A L R E V Y T A P T E D T A R A A V S S A L R E V Y T A P T E D T A R A A CTGGACGCATTCGAGGCCAGTGAACTGGGCCGTAAATACCCGCAATCGGTCAAAGTCTGG L D A F E A S E L G R K Y P Q S V K V W L D A F E A S E L G R K Y P Q S V K V W CGCGACGCCTGGGACCGGTTTGTGCCATTTTTGCAGTTCCCACCTGCGGCACGGCGGGTA R D A W D R F V P F L Q F P P A A R R V R D A W D R F V P F L Q F P P A A R R V CTCTACACCACGAATTCGATCGAATCGCTGAATGCTGAGCTGCGGAAAGCCACCCGCAAC L Y T T N S I E S L N A E L R K A T R N L Y T T N S I E S L N A E L R K A T R N CGCGGCCAGTTCCCGAACGATACCGCGGCGCTGAAAACGCTGTGGCTGACTGATCTGCAA R G Q F P N D T A A L K T L W L T D L Q R G Q F P N D T A A L K T L W L T D L Q CATCGAGGACAAGCGCGCTGCCCAGCGAGCGAAGAAAGCGAAGCGCGCCATCGAATGCAA H R G Q A R C P A S E E S E A R H R M Q H R G Q A R C P A S E E S E A R H R M Q CGGCTATATTGA R L Y R L Y --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.240): ATGACTACCGTGTCACCGAGGAAAGGTCATGACCCGAACAGGGTCAACGAGATCAGCGCT M T T V S P R K G H D P N R V N E I S A M T T V A K Q D P A D S A R I K A I E E AAGCTGATGGAAAATCCGGAAATCGCCGAACTGATCGGCGAGTTGTCGACTTCCACCGAT K L M E N P E I A E L I G E L S T S T D K L L A N P E M A K L I D E L G T S T T GATGCCAGCGACCTGGTCAAAGGTCTTTTGCAGGCATCGATCAACGCTGGTCTGCAGGCT D A S D L V K G L L Q A S I N A G L Q A D A N D L V R G L L Q A S I N R G L N A GAAATGGACGCGCATCTGGGGATACGCGCACTCTGATCGT*AC*GGCGAAAGCCCAGCTG E M D A H L G Y A H S D R G E S P A E M D A H L G - Y G H S D R *D** G K T A A GGCACCCCGGATGGTGGCAATCACCGCAACGGGTCGTACCGACCAAAA*CC*GTCAACTC G H G N H R N G Y R P K V N S G Q ---------- G N H R N G --- Y Y P K *R** V D S TGGCTACGGCACCTTTGATGTGACTATGCCCCGGGATCGAGCTGGCACGTTTACGCCGCG G Y G T F D V T M P R D R A G T F T P R N Y G P I D V A V P R D R N G S F L P T GATGCTGCCTAAAGGCACCCGCCGTCTGACGGAGCTTGATGACATGATCATCTCCCTGTA M L P K G T R R L T E L D D M I I S L Y M V P K G S R R L T D V D D M I I S L Y CGCCGGTGGGATGACCGTGCGCGATATTCAGCACCACCTCGCCACCACCCTCGGGGTGGA A G G M T V R D I Q H H L A T T L G V D A G G M T V R D I Q H H M I T S M G V D TATGAGCCCAGATACGATCAGCACCATTACCGACGCGGTGTTAGAAGAGGTCATGATCTG M S P D T I S T I T D A V L E E V M I W I S H E T I S A I T D A V L D E V M I W GCAAAACCGCCAGCTCGACGAGTTCTACCCAGTGATCTTCCTCGACGCGCTGCGAGTGAA Q N R Q L D E F Y P V I F L D A L R V K Q N R Q L D D F Y P V I F L D A L R I K GATCCGCGATGGCCACCGCGTGGTCAACAAGTCTTGCTACATGGCGGTAGGCGTCGACAT I R D G H R V V N K S C Y M A V G V D M V R D G G R V V N K S V Y L A I G V D M GGACGGCATCAAGCACATCCTGGGATTGTGGATCGCAGACAATGAAGGCGCCAGTTTTTG D G I K H I L G L W I A D N E G A S F W D G I K H I L G I W L A K E E G A S F W GGCATCCGTGTGCGCTGACCTTGCCAACCGTGGGGTCCAAGACGTGTTCATCGTCTGCTG A S V C A D L A N R G V Q D V F I V C C A N V C A N L A T R G V Q D V F I V C C CGACGGGCTCAAAGGCCTGCCGGAAACCGTGGAGGCAACCTGGCCGAATTCCATGGTGCA D G L K G L P E T V E A T W P N S M V Q D G L K G L P Q A V E A T W P D S M V Q GACCTGTATAGTGCACCTGATCCGGGCGGCCAACAGGTGGGTGTCCTACCAAGACCGCAA T C I V H L I R A A N R W V S Y Q D R K T C V V H L I R A A N R W V A Y G D R K ACCCGTATCAAGTGCGCTACGGGAGGTCTACACCGCACCGACCGAGGACACCGCCCGCGC P V S S A L R E V Y T A P T E D T A R A A V S A Q L R K I Y T A P T E D T A I A CGCCCTGGACGCATTCGAGGCCAGTGAACTGGGCCGTAAATACCCGCAATCGGTCAAAGT A L D A F E A S E L G R K Y P Q S V K V A L E E F E A S E L G V K Y P Q S A K V CTGGCGCGACGCCTGGGACCGGTTTGTGCCATTTTTGCAGTTCCCACCTGCGGCACGGCG W R D A W D R F V P F L Q F P P A A R R W R D A W D R F I P F L Q F P P M A R K GGTACTCTACACCACGAATTCGATCGAATCGCTGAATGCTGAGCTGCGGAAAGCCACCCG V L Y T T N S I E S L N A E L R K A T R V I Y T T N S I E S M N N E L R K A T R CAACCGCGGCCAGTTCCCGAACGATACCGCGGCGCTGAAAACGCTGTGGCTGACTGATCT N R G Q F P N D T A A L K T L W L L I N R V Q F T N D E S A I K T L W L - M I GCAACATCGAGGACAAGCGCGCTGCCCAGCGAGCGAAGAAAGCGAAGCGCGCCATCGAAT C N I E D K R A A Q R A K K A K R A I E C N I E D K R A A K R A K Q G K R V A A GCAACGGC----------------------------TATATTGA C N G Y I S S G RLIEGRKVANWKQAINQMAVAFPDRFEA Y L -- // >fig|6666666.67454.peg.520 fig|257309.1.peg.568 No significant database matches FIG165996 gi|372118535|gb|CP003217.1|_506766_507017,gi|372118535|gb|CP003217.1|_507020_507535 MTGCSHRFYYNHMIQTSIRSFGVGEDLASMAVDERISLLRSRMQSIFKSGDFSLDYNCKTADKNIIPLSDPLSHVLPWGGLPRGxIVESTIAPLLAILFIAQVSGSGGRVGVVGWPDLNYAGVLGYGGCYERIFAVSQQERTSLRVVTALAHGCDLVITRAGPTPRTYTPLQTQRFRNSLRSDAGCVIMMGDHVVSPAARLASAVVGYHGIGKGTGRIKAVEITVTGIAKGFYRTSRVIVGKHIAPAAEKTTMKVV We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. TTGACGGGGTGTTCACATAGGTTCTATTATAACCACATGATTCAAACGAGTATTCGATCT L T G C S H R F Y Y N H M I Q T S I R S M T G C S H R F Y Y N H M I Q T S I R S TTTGGGGTGGGGGAGGATCTTGCCTCCATGGCTGTTGATGAGCGGATTTCTTTACTTCGT F G V G E D L A S M A V D E R I S L L R F G V G E D L A S M A V D E R I S L L R TCGCGCATGCAATCCATATTCAAAAGTGGGGATTTTTCTTTAGATTATAATTGTAAAACT S R M Q S I F K S G D F S L D Y N C K T S R M Q S I F K S G D F S L D Y N C K T GCAGATAAAAACATTATTCCGTTATCTGATCCACTGTCCCACGTGTTGCCGTGGGGTGGG A D K N I I P L S D P L S H V L P W G G A D K N I I P L S D P L S H V L P W G G CTGCCTCGGGGG*TG*ATTGTAGAGTCTACTATTGCCCCATTACTTGCTATTTTATTTAT L P R G I V E S T I A P L L A I L F I L P R G *X** I V E S T I A P L L A I L F I CGCACAAGTGAGCGGTTCTGGTGGGAGGGTGGGTGTTGTGGGTTGGCCAGATCTTAACTA A Q V S G S G G R V G V V G W P D L N Y A Q V S G S G G R V G V V G W P D L N Y TGCGGGTGTGCTGGGATACGGAGGTTGCTATGAGCGGATTTTTGCTGTTTCCCAGCAAGA A G V L G Y G G C Y E R I F A V S Q Q E A G V L G Y G G C Y E R I F A V S Q Q E ACGCACCTCATTACGTGTTGTTACAGCCCTTGCACACGGATGCGATCTTGTGATCACACG R T S L R V V T A L A H G C D L V I T R R T S L R V V T A L A H G C D L V I T R TGCAGGGCCTACTCCTAGGACGTACACGCCGCTCCAAACTCAACGATTTCGTAATTCTTT A G P T P R T Y T P L Q T Q R F R N S L A G P T P R T Y T P L Q T Q R F R N S L ACGATCAGATGCTGGCTGCGTGATCATGATGGGAGATCATGTCGTTTCACCTGCAGCGCG R S D A G C V I M M G D H V V S P A A R R S D A G C V I M M G D H V V S P A A R TTTAGCTTCCGCGGTGGTGGGATACCACGGGATTGGGAAAGGGACGGGGCGTATTAAGGC L A S A V V G Y H G I G K G T G R I K A L A S A V V G Y H G I G K G T G R I K A TGTAGAAATCACCGTAACTGGCATAGCCAAGGGTTTTTATCGAACTTCGAGAGTCATAGT V E I T V T G I A K G F Y R T S R V I V V E I T V T G I A K G F Y R T S R V I V CGGCAAGCACATAGCTCCTGCTGCTGAGAAAACAACGATGAAAGTGGTCTAA G K H I A P A A E K T T M K V V G K H I A P A A E K T T M K V V --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.568): TTGACGGGGTGTTCACATAGGTTCTATTATAACCACATGATTCAAACGAGTATTCGATCT L T G C S H R F Y Y N H M I Q T S I R S M T G C S H R F Y Y S H M I Q T S V R S TTTGGGGTGGGGGAGGATCTTGCCTCCATGGCTGTTGATGAGCGGATTTCTTTACTTCGT F G V G E D L A S M A V D E R I S L L R F E V G E D L A S M A V D E R I S L L R TCGCGCATGCAATCCATATTCAAAAGTGGGGATTTTTCTTTAGATTATAATTGTAAAACT S R M Q S I F K S G D F S L D Y N C K T S R M Q S I S K S G D F S L D Y N C K T GCAGATAAAAACATTATTCCGTTATCTGATCCACTGTCCCACGTGTTGCCGTGGGGTGGG A D K N I I P L S D P L S H V L P W G G A D K N I I P L S D P L S H V L P W G G CTGCCTCGGGGG*TG*ATTGTAGAGTCTACTATTGCCCCATTACTTGCTATTTTATTTAT L P R G I V E S T I A P L L A I L F I L P R G *M** I V E S T I T P L L A I L F I CGCACAAGTGAGCGGTTCTGGTGGGAGGGTGGGTGTTGTGGGTTGGCCAGATCTTAACTA A Q V S G S G G R V G V V G W P D L N Y A Q V S G S G R R V G V V G W P D L N Y TGCGGGTGTGCTGGGATACGGAGGTTGCTATGAGCGGATTTTTGCTGTTTCCCAGCAAGA A G V L G Y G G C Y E R I F A V S Q Q E A G V L G Y G G C Y E R I F A V P Q Q E ACGCACCTCATTACGTGTTGTTACAGCCCTTGCACACGGATGCGATCTTGTGATCACACG R T S L R V V T A L A H G C D L V I T R R T S L R V V T A L A H G C D L V I T R TGCAGGGCCTACTCCTAGGACGTACACGCCGCTCCAAACTCAACGATTTCGTAATTCTTT A G P T P R T Y T P L Q T Q R F R N S L A G P T P R T Y T P L Q T Q R F R N S L ACGATCAGATGCTGGCTGCGTGATCATGATGGGAGATCATGTCGTTTCACCTGCAGCGCG R S D A G C V I M M G D H V V S P A A R R S D A G C V I M M G D H V V S P A A R TTTAGCTTCCGCGGTGGTGGGATACCACGGGATTGGGAAAGGGACGGGGCGTATTAAGGC L A S A V V G Y H G I G K G T G R I K A L A S A V V G Y H G I G K G T G R I K A TGTAGAAATCACCGTAACTGGCATAGCCAAGGGTTTTTATCGAACTTCGAGAGTCATAGT V E I T V T G I A K G F Y R T S R V I V V E I T V T G I A K G F Y R T S R V I V CGGCAAGCACATAGCTCCTGCTGCTGAGAAAACAACGATGAAAGTGGTCTAA G K H I A P A A E K T T M K V V G K H I A P A A E K T T M K V V --- // >fig|6666666.67454.peg.1773 fig|196164.1.peg.2387 Thiol peroxidase, Bcp-type (EC 1.11.1.15) FIG132548 gi|372118535|gb|CP003217.1|_1810659_1810724,gi|372118535|gb|CP003217.1|_1810728_1811243 MSLISRATVKLLEVLLNSPPTLxPQIILSCRAGILETMTENIRLAVGDTAPSFSLPNDTGTTTSLSDYSGQRVLVYFYPRANTPGCTKEACDFRDSLAQLNDLGIAVVGISPDKVDKLAAFRDDYDLTFPLLSDATKEVMTAYGAFGEKKNYGKIVQGVIRSTFVIGADGRIELALYNVRATGHVARVVKELTK We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGTCGTTAATATCGCGTGCCACGGTAAAACTCCTTGAGGTTTTGTTGAATAGTCCCCCT M S L I S R A T V K L L E V L L N S P P M S L I S R A T V K L L E V L L N S P P ACACTTTAGCCCCAAATCATTCTTTCGTGTCGAGCCGGTATCCTCGAAACCATGACTGAG T L * P Q I I L S C R A G I L E T M T E T L X P Q I I L S C R A G I L E T M T E AACATTCGTCTTGCCGTCGGCGACACCGCGCCAAGTTTTTCTTTACCCAACGATACAGGC N I R L A V G D T A P S F S L P N D T G N I R L A V G D T A P S F S L P N D T G ACCACCACCAGCCTGAGCGACTACTCCGGTCAGCGCGTACTGGTCTACTTCTACCCACGC T T T S L S D Y S G Q R V L V Y F Y P R T T T S L S D Y S G Q R V L V Y F Y P R GCCAACACCCCAGGCTGCACCAAGGAAGCCTGCGACTTCCGCGACAGCCTCGCCCAGCTC A N T P G C T K E A C D F R D S L A Q L A N T P G C T K E A C D F R D S L A Q L AACGACCTCGGAATCGCCGTGGTAGGTATCTCCCCCGACAAGGTAGATAAGCTCGCCGCC N D L G I A V V G I S P D K V D K L A A N D L G I A V V G I S P D K V D K L A A TTCCGCGACGACTACGATCTCACCTTCCCGCTGCTCTCCGATGCCACCAAGGAAGTCATG F R D D Y D L T F P L L S D A T K E V M F R D D Y D L T F P L L S D A T K E V M ACCGCCTACGGTGCTTTTGGTGAGAAGAAAAACTACGGCAAAATTGTTCAAGGAGTCATC T A Y G A F G E K K N Y G K I V Q G V I T A Y G A F G E K K N Y G K I V Q G V I CGCTCTACCTTTGTGATCGGTGCCGACGGTCGCATAGAACTCGCCCTCTACAATGTGCGT R S T F V I G A D G R I E L A L Y N V R R S T F V I G A D G R I E L A L Y N V R GCTACCGGACACGTGGCCCGCGTGGTTAAAGAACTGACCAAGTAA A T G H V A R V V K E L T K A T G H V A R V V K E L T K --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2387): ATGTCGTTAATATCGCGTGCCACGGTAAAACT----CCTTGAGGTTTTGTTGAATAGTCC G K T P V L L N S P ----------------------- M K T RYCG P ---- I L L N S S CCCTACACTTTAGCCCCAAATCATTCTTTCGTGTCGAGCCGGTATCCTCGAAACCATGAC P T L * P Q I I L S C R A G I L E T M T P E R T P I P E N T T A P A I V E V M T TGAGAACATTCGTCTTGCCGTCGGCGACACCGCGCCAAGTTTTTCTTTACCCAACGATAC E N I R L A V G D T A P S F S L P N D T D A R R L D V G D T P P A F T L P N D S AGGCACCACCACCAGCCTGAGCGACTACTCCGGTCAGCGCGTACTGGTCTACTTCTACCC G T T T S L S D Y S G Q R V L V Y F Y P G S T T S L S D F A G E R V V V Y F Y P ACGCGCCAACACCCCAGGCTGCACCAAGGAAGCCTGCGACTTCCGCGACAGCCTCGCCCA R A N T P G C T K E A C D F R D S L A Q K A N T P G C T K E A C D F R D S L A Q GCTCAACGACCTCGGAATCGCCGTGGTAGGTATCTCCCCCGACAAGGTAGATAAGCTCGC L N D L G I A V V G I S P D K V D K L A L N D L G V K V I G I S P D P V D K L V CGCCTTCCGCGACGACTACGATCTCACCTTCCCGCTGCTCTCCGATGCCACCAAGGAAGT A F R D D Y D L T F P L L S D A T K E V K F R E D H D L N F P L L S D E D K A V CATGACCGCCTACGGTGCTTTTGGTGAGAAGAAAAACTACGGCAAAATTGTTCAAGGAGT M T A Y G A F G E K K N Y G K I V Q G V M T A W G A F G E K K N Y G K I V Q G V CATCCGCTCTACCTTTGTGATCGGTGCCGACGGTCGCATAGAACTCGCCCTCTACAATGT I R S T F V I G A D G R I E L A L Y N V I R S T F V I E P D G T V G L A K Y N V GCGTGCTACCGGACACGTGGCCCGCGTGGTTAAAGAACTGACCAAGTAA R A T G H V A R V V K E L T K * R A T G H V A R I L R D L E A A // >fig|6666666.67454.peg.1580 fig|257309.1.peg.1563 Asparagine synthetase [glutamine-hydrolyzing] (EC 6.3.5.4) FIG035175 gi|372118535|gb|CP003217.1|_1616645_1616782,gi|372118535|gb|CP003217.1|_1616782_1618566 MCGLLGMLSSTGQASKYVDAIESALPCMHHRGPDEAGTWHDDHAVxxFNRLSIIDLEHSHQPLRWGPEGEPDRYAMTFNGEIYNYVELRKKLQDLGYTFNTSGDGETIAVGFHHWGADVVLHLRGMFGIAIWDTKEQRLFLARDQFGIKPLYFATTEAGTVFASEKKCILDMADAIGLDLGLDQRAIEHYIDLQYVPEPESLHQHIRRLESGCFAFVSVGGNVDQTRYFRPQFPAQEFPKDKEQDLFDRIAKALEDSVEKHMRADVTVGSFLSGGIDSTAIATLAKRHNPNLLTFTTGFEREGYSEVDVAAESAAAIGVEHIVKIVSPEEYANAIPQIMWYLDDPVADPSLVPLFFVAQEARKHVKVVLSGEGADELFGGYTIYKEPLSLAPFEKIPSPLRRGLGKVAEVFPDGMRGKSLLQRGSMTMEERYYGNARSFNFDQMKRVIPWAKKEWDHREVTAPIYAQSEHMDPVARMQHLDLFTWMRGDILVKADKINMAHSLELRVPFLDKEVFEVAETIPYDLKIANGTTKYALRKAMEQIVPPHVLHRKKLGFPVPMRHWLAGDELFGWAQDTINESMTDQYFDKAAVLAMLNEHKNGVSDHSRRLWTVLAFMIWHGIFVEHRIDPGIEKRDYPVYL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGTGTGGACTTCTAGGCATGCTCTCCAGCACAGGACAGGCCAGTAAGTATGTAGATGCT M C G L L G M L S S T G Q A S K Y V D A M C G L L G M L S S T G Q A S K Y V D A ATAGAAAGTGCTTTGCCGTGCATGCACCACCGAGGCCCTGACGAAGCAGGTACTTGGCAT I E S A L P C M H H R G P D E A G T W H I E S A L P C M H H R G P D E A G T W H GACGACCATGCAGTTTTG*GC*TTTAATCGCCTATCGATTATCGATCTCGAGCATTCTCA D D H A V L F N R L S I I D L E H S H D D H A V X *X** F N R L S I I D L E H S H CCAGCCCTTGCGATGGGGGCCTGAAGGCGAGCCCGACCGCTATGCCATGACTTTTAATGG Q P L R W G P E G E P D R Y A M T F N G Q P L R W G P E G E P D R Y A M T F N G CGAGATCTACAACTATGTAGAGCTACGAAAAAAACTTCAAGACCTCGGCTACACCTTTAA E I Y N Y V E L R K K L Q D L G Y T F N E I Y N Y V E L R K K L Q D L G Y T F N CACTTCAGGCGACGGCGAAACTATTGCTGTCGGTTTCCACCACTGGGGTGCAGATGTAGT T S G D G E T I A V G F H H W G A D V V T S G D G E T I A V G F H H W G A D V V GCTTCACTTGCGCGGAATGTTTGGCATAGCCATTTGGGACACCAAGGAACAACGTCTTTT L H L R G M F G I A I W D T K E Q R L F L H L R G M F G I A I W D T K E Q R L F CTTGGCCCGCGATCAATTTGGTATCAAGCCGTTGTACTTTGCTACCACCGAAGCTGGCAC L A R D Q F G I K P L Y F A T T E A G T L A R D Q F G I K P L Y F A T T E A G T CGTTTTCGCCTCCGAGAAAAAGTGCATCTTGGATATGGCAGATGCTATTGGTCTAGATTT V F A S E K K C I L D M A D A I G L D L V F A S E K K C I L D M A D A I G L D L GGGGCTTGACCAACGTGCTATCGAGCACTACATCGATCTTCAATACGTTCCAGAGCCTGA G L D Q R A I E H Y I D L Q Y V P E P E G L D Q R A I E H Y I D L Q Y V P E P E AAGTCTTCATCAGCACATTCGACGCCTAGAGTCTGGCTGCTTTGCTTTCGTTTCTGTGGG S L H Q H I R R L E S G C F A F V S V G S L H Q H I R R L E S G C F A F V S V G AGGCAATGTCGATCAGACTCGTTACTTCCGTCCTCAGTTCCCCGCACAAGAATTCCCAAA G N V D Q T R Y F R P Q F P A Q E F P K G N V D Q T R Y F R P Q F P A Q E F P K GGACAAGGAACAGGATCTCTTCGATCGAATCGCCAAGGCCCTAGAAGATAGCGTCGAAAA D K E Q D L F D R I A K A L E D S V E K D K E Q D L F D R I A K A L E D S V E K GCACATGCGTGCCGACGTCACTGTCGGTTCTTTCCTGTCTGGCGGCATCGACTCCACTGC H M R A D V T V G S F L S G G I D S T A H M R A D V T V G S F L S G G I D S T A GATTGCAACTTTGGCAAAACGCCATAATCCGAATCTGTTGACATTCACTACAGGATTTGA I A T L A K R H N P N L L T F T T G F E I A T L A K R H N P N L L T F T T G F E ACGCGAAGGATATTCGGAAGTCGATGTGGCTGCAGAATCCGCTGCTGCCATTGGAGTAGA R E G Y S E V D V A A E S A A A I G V E R E G Y S E V D V A A E S A A A I G V E ACATATCGTCAAGATTGTCTCTCCCGAGGAATATGCCAATGCCATTCCTCAAATCATGTG H I V K I V S P E E Y A N A I P Q I M W H I V K I V S P E E Y A N A I P Q I M W GTACTTGGATGACCCAGTAGCTGATCCCTCCCTAGTCCCACTATTCTTCGTTGCTCAAGA Y L D D P V A D P S L V P L F F V A Q E Y L D D P V A D P S L V P L F F V A Q E AGCCCGCAAGCATGTCAAAGTGGTGTTGTCAGGCGAAGGAGCAGACGAACTATTTGGTGG A R K H V K V V L S G E G A D E L F G G A R K H V K V V L S G E G A D E L F G G TTACACCATTTACAAAGAGCCGCTTTCTCTTGCTCCATTTGAAAAGATTCCTTCCCCGCT Y T I Y K E P L S L A P F E K I P S P L Y T I Y K E P L S L A P F E K I P S P L ACGTCGCGGTCTTGGCAAAGTAGCCGAAGTTTTCCCTGACGGAATGCGTGGTAAATCCTT R R G L G K V A E V F P D G M R G K S L R R G L G K V A E V F P D G M R G K S L GCTCCAACGCGGTTCAATGACGATGGAAGAGCGTTATTACGGAAATGCTCGTTCCTTCAA L Q R G S M T M E E R Y Y G N A R S F N L Q R G S M T M E E R Y Y G N A R S F N TTTTGATCAAATGAAGCGCGTTATCCCATGGGCCAAGAAGGAATGGGATCACCGCGAAGT F D Q M K R V I P W A K K E W D H R E V F D Q M K R V I P W A K K E W D H R E V CACCGCACCGATCTACGCCCAGTCTGAGCACATGGACCCCGTTGCGCGAATGCAGCATTT T A P I Y A Q S E H M D P V A R M Q H L T A P I Y A Q S E H M D P V A R M Q H L GGATCTTTTCACGTGGATGCGCGGCGATATCCTCGTCAAGGCCGACAAGATCAACATGGC D L F T W M R G D I L V K A D K I N M A D L F T W M R G D I L V K A D K I N M A TCACTCCTTGGAACTTCGCGTCCCGTTCTTGGATAAGGAAGTATTTGAGGTTGCTGAAAC H S L E L R V P F L D K E V F E V A E T H S L E L R V P F L D K E V F E V A E T CATTCCTTATGACCTCAAGATTGCTAACGGAACGACCAAATATGCGTTGCGTAAGGCCAT I P Y D L K I A N G T T K Y A L R K A M I P Y D L K I A N G T T K Y A L R K A M GGAACAAATCGTTCCGCCGCACGTGCTGCACCGCAAGAAACTCGGATTCCCAGTGCCTAT E Q I V P P H V L H R K K L G F P V P M E Q I V P P H V L H R K K L G F P V P M GCGACACTGGCTAGCTGGCGATGAGCTGTTCGGTTGGGCTCAAGACACCATTAATGAGTC R H W L A G D E L F G W A Q D T I N E S R H W L A G D E L F G W A Q D T I N E S GATGACCGACCAATACTTTGACAAGGCAGCAGTCTTAGCAATGCTCAATGAACACAAGAA M T D Q Y F D K A A V L A M L N E H K N M T D Q Y F D K A A V L A M L N E H K N TGGTGTATCTGATCATTCCCGCAGGCTATGGACAGTCCTCGCCTTTATGATTTGGCACGG G V S D H S R R L W T V L A F M I W H G G V S D H S R R L W T V L A F M I W H G AATTTTCGTCGAGCACCGCATTGATCCAGGCATCGAGAAACGCGATTATCCTGTGTACCT I F V E H R I D P G I E K R D Y P V Y L I F V E H R I D P G I E K R D Y P V Y L ATAG --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1563): ATGTGTGGACTTCTAGGCATGCTCTCCAGCACAGGACAGGCCAGTAAGTATGTAGATGCT M C G L L G M L S S T G Q A S K Y V D A M C G L L G M L S S T G Q A S K Y A A A ATAGAAAGTGCTTTGCCGTGCATGCACCACCGAGGCCCTGACGAAGCAGGTACTTGGCAT I E S A L P C M H H R G P D E A G T W H I E S A L P C M H H R G P D E A G T W H GACGACCATGCA*GT*TTTGGCTTTAATCGCCTATCGATTATCGATCTCGAGCATTCTCA D D H A F G F N R L S I I D L E H S H D D H A *V** F G F N R L S I I D L E H S H CCAGCCCTTGCGATGGGGGCCTGAAGGCGAGCCCGACCGCTATGCCATGACTTTTAATGG Q P L R W G P E G E P D R Y A M T F N G Q P L R W G P E G E P D R Y A M T F N G CGAGATCTACAACTATGTAGAGCTACGAAAAAAACTTCAAGACCTCGGCTACACCTTTAA E I Y N Y V E L R K K L Q D L G Y T F N E I Y N Y V E L R K K L Q D L G Y T F N CACTTCAGGCGACGGCGAAACTATTGCTGTCGGTTTCCACCACTGGGGTGCAGATGTAGT T S G D G E T I A V G F H H W G A D V V T S G D G E T I A V G F H H W G A D V V GCTTCACTTGCGCGGAATGTTTGGCATAGCCATTTGGGACACCAAGGAACAACGTCTTTT L H L R G M F G I A I W D T K E Q R L F L H L R G M F G I A I W D T K E Q R L F CTTGGCCCGCGATCAATTTGGTATCAAGCCGTTGTACTTTGCTACCACCGAAGCTGGCAC L A R D Q F G I K P L Y F A T T E A G T L A R D Q F G I K P L Y F A T T E A G T CGTTTTCGCCTCCGAGAAAAAGTGCATCTTGGATATGGCAGATGCTATTGGTCTAGATTT V F A S E K K C I L D M A D A I G L D L V F A S E K K C I L G M A D A I G L D L GGGGCTTGACCAACGTGCTATCGAGCACTACATCGATCTTCAATACGTTCCAGAGCCTGA G L D Q R A I E H Y I D L Q Y V P E P E G L D Q R A I E H Y I D L Q Y V P E P E AAGTCTTCATCAGCACATTCGACGCCTAGAGTCTGGCTGCTTTGCTTTCGTTTCTGTGGG S L H Q H I R R L E S G C F A F V S V G S L H Q H I R R L E S G C F A F V S V G AGGCAATGTCGATCAGACTCGTTACTTCCGTCCTCAGTTCCCCGCACAAGAATTCCCAAA G N V D Q T R Y F R P Q F P A Q E F P K G N V E Q T R Y F R P Q F P A Q E F P K GGACAAGGAACAGGATCTCTTCGATCGAATCGCCAAGGCCCTAGAAGATAGCGTCGAAAA D K E Q D L F D R I A K A L E D S V E K D K E Q D L F D R I A K A L E D S V E K GCACATGCGTGCCGACGTCACTGTCGGTTCTTTCCTGTCTGGCGGCATCGACTCCACTGC H M R A D V T V G S F L S G G I D S T A H M R A D V T V G S F L S G G I D S T A GATTGCAACTTTGGCAAAACGCCATAATCCGAATCTGTTGACATTCACTACAGGATTTGA I A T L A K R H N P N L L T F T T G F E I A T L A K R H N P N L L T F T T G F E ACGCGAAGGATATTCGGAAGTCGATGTGGCTGCAGAATCCGCTGCTGCCATTGGAGTAGA R E G Y S E V D V A A E S A A A I G V E R E G Y S E V D V A A E S A A A I G V E ACATATCGTCAAGATTGTCTCTCCCGAGGAATATGCCAATGCCATTCCTCAAATCATGTG H I V K I V S P E E Y A N A I P Q I M W H I V K I V S P E E Y A N A I P Q I M W GTACTTGGATGACCCAGTAGCTGATCCCTCCCTAGTCCCACTATTCTTCGTTGCTCAAGA Y L D D P V A D P S L V P L F F V A Q E Y L D D P V A D P S L V P L F F V A Q E AGCCCGCAAGCATGTCAAAGTGGTGTTGTCAGGCGAAGGAGCAGACGAACTATTTGGTGG A R K H V K V V L S G E G A D E L F G G A R K H V K V V L S G E G A D E L F G G TTACACCATTTACAAAGAGCCGCTTTCTCTTGCTCCATTTGAAAAGATTCCTTCCCCGCT Y T I Y K E P L S L A P F E K I P S P L Y T I Y K E P L S L A P F E K I P S P L ACGTCGCGGTCTTGGCAAAGTAGCCGAAGTTTTCCCTGACGGAATGCGTGGTAAATCCTT R R G L G K V A E V F P D G M R G K S L R R G L G K V A E V F P D G M R G K S L GCTCCAACGCGGTTCAATGACGATGGAAGAGCGTTATTACGGAAATGCTCGTTCCTTCAA L Q R G S M T M E E R Y Y G N A R S F N L Q R G S M T M E E R Y Y G N A R S F N TTTTGATCAAATGAAGCGCGTTATCCCATGGGCCAAGAAGGAATGGGATCACCGCGAAGT F D Q M K R V I P W A K K E W D H R E V F D Q M K R V I P W A K K E W D H R E V CACCGCACCGATCTACGCCCAGTCTGAGCACATGGACCCCGTTGCGCGAATGCAGCATTT T A P I Y A Q S E H M D P V A R M Q H L T A P I Y A Q S E H M D P V A R M Q H L GGATCTTTTCACGTGGATGCGCGGCGATATCCTCGTCAAGGCCGACAAGATCAACATGGC D L F T W M R G D I L V K A D K I N M A D L F T W M R G D I L V K A D K I N M A TCACTCCTTGGAACTTCGCGTCCCGTTCTTGGATAAGGAAGTATTTGAGGTTGCTGAAAC H S L E L R V P F L D K E V F E V A E T H S L E L R V P F L D K E V F E V A E T CATTCCTTATGACCTCAAGATTGCTAACGGAACGACCAAATATGCGTTGCGTAAGGCCAT I P Y D L K I A N G T T K Y A L R K A M I P Y D L K I A N G T T K Y A L R K A M GGAACAAATCGTTCCGCCGCACGTGCTGCACCGCAAGAAACTCGGATTCCCAGTGCCTAT E Q I V P P H V L H R K K L G F P V P M E Q I V P P H V L H R K K L G F P V P M GCGACACTGGCTAGCTGGCGATGAGCTGTTCGGTTGGGCTCAAGACACCATTAATGAGTC R H W L A G D E L F G W A Q D T I N E S R H W L A G D E L F G W A Q D T I N E S GATGACCGACCAATACTTTGACAAGGCAGCAGTCTTAGCAATGCTCAATGAACACAAGAA M T D Q Y F D K A A V L A M L N E H K N M T D Q Y F D K A A V L A M L N E H K N TGGTGTATCTGATCATTCCCGCAGGCTATGGACAGTCCTCGCCTTTATGATTTGGCACGG G V S D H S R R L W T V L A F M I W H G G V S D H S R R L W T V L A F M I W H G AATTTTCGTCGAGCACCGCATTGATCCAGGCATCGAGAAACGCGATTATCCTGTGTACCT I F V E H R I D P G I E K R D Y P V Y L I F V E H R I D P G I E K R D Y P V Y L ATAG --- // >fig|6666666.67454.peg.2244 fig|196164.1.peg.2684 hypothetical protein gi|372118535|gb|CP003217.1|_2307202_2306744,gi|372118535|gb|CP003217.1|_2306742_2305681 MDENRDFEVVGVADAAALEEALISQTRNSVKPAPMIECETFTLEGKQVLVAQVNPVPLQNRPAHYRGVAYLRQSDGDYGMNDADLALVEIQKLSHSENFQFDVVPVLNSSTRDLDSVRVKSFLEAARAGSRILSKKIDDQELLETLNIVTVKGELTLAGIYALGEYPQGKAPQLRITAAVQLPREGGSVRTRNMQDFEGPLPDLLESALTWVKQNAPTQNVYDSSGHMRKESVYPLPAVRELIANALVHRDLSPNSDGKWVEIRLCDDRLVISNPGGLRGVSVKQLESATLSKNAVNPRLYDIAKRVRTEGAGIQEVLRQTCQALLAKPQLIDTGVQFTAILYGASVFSEAELEWLRSIGGDGLTAVEKHLLVGLRKGESWHLSRILNEFSPITVAEAEKLMHGLKKRGFIESDNKTFTLGAHSENQAPRVEKEETTLAKITKNAPTIAHALELKPEQSFEELLRTTGLSQGQLRFALDKLQAVGLVVREGGWGVHGTTYHWSAQT We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGGATGAAAACCGTGACTTTGAAGTCGTCGGCGTTGCGGATGCGGCAGCGCTTGAAGAA V D E N R D F E V V G V A D A A A L E E M D E N R D F E V V G V A D A A A L E E GCGCTCATTAGTCAGACTCGTAACAGTGTGAAACCGGCCCCTATGATCGAGTGTGAGACT A L I S Q T R N S V K P A P M I E C E T A L I S Q T R N S V K P A P M I E C E T TTCACTCTAGAAGGCAAGCAGGTGCTTGTGGCACAGGTCAATCCAGTGCCGTTGCAAAAC F T L E G K Q V L V A Q V N P V P L Q N F T L E G K Q V L V A Q V N P V P L Q N CGTCCGGCGCACTACCGAGGTGTTGCCTACCTGCGGCAATCCGATGGAGACTACGGAATG R P A H Y R G V A Y L R Q S D G D Y G M R P A H Y R G V A Y L R Q S D G D Y G M AACGATGCTGATCTCGCACTCGTTGAGATCCAGAAGCTTTCTCATTCTGAGAACTTCCAG N D A D L A L V E I Q K L S H S E N F Q N D A D L A L V E I Q K L S H S E N F Q TTCGATGTAGTCCCAGTCTTGAACTCTTCAACCCGAGACTTAGACTCTGTTCGGGTAAAG F D V V P V L N S S T R D L D S V R V K F D V V P V L N S S T R D L D S V R V K AGTTTCCTCGAGGCTGCGCGCGCGGGAAGCCGCATCCTGTCCAAGAAAATTGATGACCAA S F L E A A R A G S R I L S K K I D D Q S F L E A A R A G S R I L S K K I D D Q GAACTGCTTGAAACTCTCAATATCGTGACGGTAAAAGGGTGAACTCACGCTGGCCGGAAT E L L E T L N I V T V K G E L T L A G I E L L E T L N I V T V K G - E L T L A G I CTACGCCCTGGGTGAGTATCCGCAGGGTAAGGCTCCACAGCTACGCATTACAGCGGCAGT Y A L G E Y P Q G K A P Q L R I T A A V Y A L G E Y P Q G K A P Q L R I T A A V GCAACTGCCACGCGAAGGCGGCAGTGTGCGTACTAGGAATATGCAGGACTTTGAAGGCCC Q L P R E G G S V R T R N M Q D F E G P Q L P R E G G S V R T R N M Q D F E G P TCTTCCTGACCTGCTCGAATCCGCACTGACGTGGGTAAAACAGAATGCGCCGACGCAGAA L P D L L E S A L T W V K Q N A P T Q N L P D L L E S A L T W V K Q N A P T Q N TGTTTACGACTCCAGTGGACACATGCGCAAGGAGAGCGTCTACCCGTTGCCTGCCGTCCG V Y D S S G H M R K E S V Y P L P A V R V Y D S S G H M R K E S V Y P L P A V R CGAACTGATCGCAAATGCCTTGGTGCACCGCGATCTAAGCCCCAATTCTGATGGAAAATG E L I A N A L V H R D L S P N S D G K W E L I A N A L V H R D L S P N S D G K W GGTGGAGATTAGGCTTTGCGACGATCGCCTCGTCATCTCTAATCCGGGTGGACTTCGGGG V E I R L C D D R L V I S N P G G L R G V E I R L C D D R L V I S N P G G L R G AGTCTCAGTCAAACAGCTAGAGAGTGCAACTCTTTCCAAGAACGCAGTAAATCCCCGCCT V S V K Q L E S A T L S K N A V N P R L V S V K Q L E S A T L S K N A V N P R L TTATGACATTGCTAAACGAGTCCGCACCGAAGGCGCTGGTATCCAAGAAGTATTGAGGCA Y D I A K R V R T E G A G I Q E V L R Q Y D I A K R V R T E G A G I Q E V L R Q AACCTGTCAGGCACTGTTGGCAAAACCTCAACTCATTGATACTGGTGTGCAGTTCACTGC T C Q A L L A K P Q L I D T G V Q F T A T C Q A L L A K P Q L I D T G V Q F T A GATCCTCTATGGTGCCTCAGTTTTCAGCGAAGCAGAGTTGGAGTGGCTGCGCAGCATTGG I L Y G A S V F S E A E L E W L R S I G I L Y G A S V F S E A E L E W L R S I G AGGAGATGGCCTTACCGCCGTCGAAAAGCACCTGCTAGTAGGGCTACGAAAAGGGGAAAG G D G L T A V E K H L L V G L R K G E S G D G L T A V E K H L L V G L R K G E S CTGGCATTTGTCTAGGATCCTCAATGAGTTTTCGCCCATAACCGTGGCCGAGGCGGAAAA W H L S R I L N E F S P I T V A E A E K W H L S R I L N E F S P I T V A E A E K ACTCATGCATGGTTTGAAGAAGCGTGGCTTCATTGAGAGTGATAATAAGACTTTCACTCT L M H G L K K R G F I E S D N K T F T L L M H G L K K R G F I E S D N K T F T L AGGAGCACACAGTGAGAATCAAGCGCCCCGCGTGGAAAAAGAGGAAACAACTCTGGCAAA G A H S E N Q A P R V E K E E T T L A K G A H S E N Q A P R V E K E E T T L A K GATCACCAAGAATGCGCCAACAATAGCCCACGCACTAGAACTCAAGCCAGAACAGAGCTT I T K N A P T I A H A L E L K P E Q S F I T K N A P T I A H A L E L K P E Q S F TGAAGAACTGCTGCGCACCACAGGTTTGAGCCAGGGGCAGCTGAGATTTGCGCTCGATAA E E L L R T T G L S Q G Q L R F A L D K E E L L R T T G L S Q G Q L R F A L D K ACTGCAAGCTGTCGGGCTAGTTGTGCGCGAAGGAGGCTGGGGCGTTCACGGAACCACCTA L Q A V G L V V R E G G W G V H G T T Y L Q A V G L V V R E G G W G V H G T T Y TCACTGGAGTGCGCAAACCTAA H W S A Q T H W S A Q T --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2684): GTGGATGAAAACCGTGACTTTGAAGTCGTCGGCGTTGCGGATGCGGCAGCGCTTGAAGAA V A D A A A L E E --------------------------------- M T D P A E M I Q GCGCTCATTAGTCAGACTCGTAACAGTGTGAAACCGGCCCCTATGATCGAGTGTGAGACT A L I S Q T R N S V K P A P M I E C E T A V V A Q T R Q A V D P A P E I N P Y T TTCACTCTAGAAGGCAAGCAGGTGCTTGTGGCACAGGTCAATCCAGTGCCGTTGCAAAAC F T L E G K Q V L V A Q V N P V P L Q N I E I D G K S V V V A E V V P L L P N L CGTCCGGCGCACTACCGAGGTGTTGCCTACCTGCGGCAATCCGATGGAGACTACGGAATG R P A H Y R G V A Y L R Q S D G D Y G M K P A T Y Q G R A Y L R Q A D G D Y V M AACGATGCTGATCTCGCACTCGTTGAGATCCAGAAGCTTTCTCATTCTGAGAACTTCCAG N D A D L A L V E I Q K L S H S E N F Q N A N D L H M V Q V A G L H H S Q H H R TTCGATGTAGTCCCAGTCTTGAACTCTTCAACCCGAGACTTAGACTCTGTTCGGGTAAAG F D V V P V L N S S T R D L D S V R V K Y D L I P V E G T G I G D L D D T L V Q AGTTTCCTCGAGGCTGCGCGCGCGGGAAGCCGCATCCTGTCCAAGAAAATTGATGACCAA S F L E A A R A G S R I L S K K I D D Q Q Y L T R V R A T S S R L R S V E D D A GAACTGCTTGAAACTCTCAATATCGTGACGGTAAAAGGGTGAACTCACGCTGGCCGGAAT E L L E T L N I V T V K G * T T L A G I D L L R L T G I I D H D G V A - T V A G L CTACGCCCTGGGTGAGTATCCGCAGGGTAAGGCTCCACAGCTACGCATTACAGCGGCAGT Y A L G E Y P Q G K A P Q L R I T A A V Y G L G F Y P Q G R L P A L G V T A A V GCAACTGCCACGCGAAGGCGGCAGTGTGCGTACTAGGAATATGCAGGACTTTGAAGGCCC Q L P R E G G S V R T R N M Q D F E G P R L P R D G S G V R T Q N L E H F D G P TCTTCCTGACCTGCTCGAATCCGCACTGACGTGGGTAAAACAGAATGCGCCGACGCAGAA L P D L L E S A L T W V K Q N A P T Q N L P A L L E S V V E W V S R N I S M S Q TGTTTACGACTCCAGTGGACACATGCGCAAGGAGAGCGTCTACCCGTTGCCTGCCGTCCG V Y D S S G H M R K E S V Y P L P A V R V Y R P D G N M E K R P E F P L N A V R CGAACTGATCGCAAATGCCTTGGTGCACCGCGATCTAAGCCCCAATTCTGATGGA--AAA E L I A N A L V H R D L S P N S D G K E I V A N A L V H R D L G P D S L G VG K TGGGTGGAGATTAGGCTTTGCGACGATCGCCTCGTCATCTCTAATCCGGGTGGACTTCGG W V E I R L C D D R L V I S N P G G L R K V E I R L S P E A L V V V N P G G L R GGAGTCTCAGTCAAACAGCTAGAGAGTGCAACTCTTTCCAAGAACGCAGTAAATCCCCGC G V S V K Q L E S A T L S K N A V N P R G V S V D Q L T S A E L S K A A V N Q R CTTTATGACATTGCTAAACGAGTCCGCACC-------GAAGGCGCTGGTATCCAAGAAGT L Y D I A K R V R T E G A G I Q E V L Y E A S K F L T T QDGASVI E G E G I R E T ATTGAGGCAAACCTGTCAGGCACTGTTGGCAAAACCTCAACTCATTGATACTGGTGTGCA L R Q T C Q A L L A K P Q L I D T G V Q L A S M R D A D L H R P R F I D T G V Q GTTCACTGCGATCCTCTATGGTGCCTCAGTTTTCAGCGAAGCAGAGTTGGAGTGGCTGCG F T A I L Y G A S V F S E A E L E W L R F K V I L R R G P V F T P E D R A H L N CAGCATTGGA-GGAGATGGCCTTACCGCCGTCGAAAAGCACCTGCTAGTAGGGCTACGAA S I G G D G L T A V E K H L L V G L R A L A Q G E V L T H M Q K V L V L G L A AAGGGGAAAGCTGGCATTTGTCTAGGATCCTCAATGAGTTTTCGCCCATAACCGTGGCCG K G E S W H L S R I L N E F S P I T V A R D E E W T I T R M C S E F S P L T R S AGGCGGAAAAACTCATGCATGGTTTGAAGAAGCGTGGCTTCATT--GAGAGTGATAATAA E A E K L M H G L K K R G F I E S D N K E A L A Q V D G L T A R G L V KV E S D H L GACTTTCACTCTAGGAGCACACAGTGAGAATCAAGCGCCC----CGCGTGGAAAAAGAGG T F T L G A H S E N Q A P R V E K E T W T G R R R T D N P T P NPDE R G R E N AAACAACTCTG----------GCAAAGATCACCAAGAATGCGCCAACAATAGCCCACGCA E T T L A K I T K N A P T I A H A Q T Q L RGLPGSSQRS T R V T K N G P V I L D A CTAGAACTCAAGCCAGAACAGAGCTTTGAAGAACTGCTGCGCACCACAGGTTTGAGCCAG L E L K P E Q S F E E L L R T T G L S Q L R H A G N Q T V G E L V S R T A L T D GGGCAGCTGAGATTTGCGCTCGATAAACTGCAAGCTGTCGGGCTAGTTGTGCGCGAAGGA G Q L R F A L D K L Q A V G L V V R E G G Q V R Y A L A V L V D A G S V V M H G GGCTGGGGCGTTCACGGAACCACCTATCACTGGAGTGCGCAAACCTAA G W G V H G T T Y H W S A Q Q G S H A T T Y S V P D --------- // >fig|6666666.67454.peg.1699 fig|257309.1.peg.1686 Putative Mrr restriction system protein gi|372118535|gb|CP003217.1|_1740130_1740912,gi|372118535|gb|CP003217.1|_1740914_1741021 MSESIPVQGMPTHLELVPYLLRSLVQLGGTGKNSEIEDTVIDIFPNTEQLLNVHYPNKPTVSVFKKRLAWARSTAYLSGAASRPSRGVYMINDVGESLLKKNDHAIVQWCTEFERKYNKRKRLEKQQNESTAPAPDEPSFEIIEDQQDENQSTHDWKSLLLNRLHQMSPTAFEKYVIFLLKQYGLELSHVAGPGDEGVDAIGTAPLSPVLSSRVAVQIKRYDPVNNIVSREAIALFQNDARVKGAERAIFVTLSSFTAPAKGLPAKHYPMWNSSMVTASASLFAIVVLLGFGWNPW We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGCGAATCAATCCCCGTACAAGGAATGCCTACGCATCTCGAGCTCGTTCCATATCTG M S E S I P V Q G M P T H L E L V P Y L M S E S I P V Q G M P T H L E L V P Y L TTACGATCACTTGTCCAACTCGGAGGCACTGGAAAAAATTCCGAAATTGAAGACACAGTA L R S L V Q L G G T G K N S E I E D T V L R S L V Q L G G T G K N S E I E D T V ATAGACATATTTCCAAATACCGAGCAATTACTAAACGTCCACTACCCCAACAAACCAACT I D I F P N T E Q L L N V H Y P N K P T I D I F P N T E Q L L N V H Y P N K P T GTATCGGTGTTCAAAAAACGCTTAGCATGGGCACGTAGCACCGCATACCTCAGCGGTGCC V S V F K K R L A W A R S T A Y L S G A V S V F K K R L A W A R S T A Y L S G A GCAAGTCGCCCTTCACGAGGCGTCTACATGATCAATGATGTGGGCGAATCCCTTCTCAAG A S R P S R G V Y M I N D V G E S L L K A S R P S R G V Y M I N D V G E S L L K AAAAATGACCACGCGATTGTCCAGTGGTGCACTGAGTTCGAACGCAAATACAACAAAAGG K N D H A I V Q W C T E F E R K Y N K R K N D H A I V Q W C T E F E R K Y N K R AAGCGGCTCGAAAAACAGCAGAATGAATCAACAGCCCCTGCACCAGATGAGCCCAGTTTC K R L E K Q Q N E S T A P A P D E P S F K R L E K Q Q N E S T A P A P D E P S F GAAATAATTGAAGACCAACAAGACGAAAACCAATCAACCCATGATTGGAAAAGCCTGCTA E I I E D Q Q D E N Q S T H D W K S L L E I I E D Q Q D E N Q S T H D W K S L L CTCAACCGACTACATCAAATGTCCCCTACTGCGTTCGAAAAGTACGTCATCTTCTTGCTC L N R L H Q M S P T A F E K Y V I F L L L N R L H Q M S P T A F E K Y V I F L L AAGCAATATGGGCTTGAGCTTAGCCACGTTGCAGGTCCTGGCGACGAAGGAGTCGACGCC K Q Y G L E L S H V A G P G D E G V D A K Q Y G L E L S H V A G P G D E G V D A ATTGGCACCGCTCCCCTGAGCCCTGTCTTGTCTTCACGGGTCGCCGTACAGATCAAGCGT I G T A P L S P V L S S R V A V Q I K R I G T A P L S P V L S S R V A V Q I K R TACGATCCGGTTAACAACATAGTGAGCCGCGAGGCAATTGCACTTTTCCAAAACGATGCA Y D P V N N I V S R E A I A L F Q N D A Y D P V N N I V S R E A I A L F Q N D A CGAGTTAAAGGTGCCGAACGTGCAATTTTTGTCACCTTGAGTAGCTTCACAGCTCCTGCA R V K G A E R A I F V T L S S F T A P A R V K G A E R A I F V T L S S F T A P A AAAAGGACTGCCCGCCAAGCATTACCCAATGTGGAACTCATCAATGGTGACCGCCTCTGC K G L P A K H Y P M W N S S M V T A S A K - G L P A K H Y P M W N S S M V T A S A GAGCTTATTCGCGATTGTGGTGCTGCTGGGGTTCGGATGGAACCCGTGGTAA S L F A I V V L L G F G W N P W S L F A I V V L L G F G W N P W --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1686): ATGAGCGAATCAATCCCCGTACAAGGAATGCCTACGCATCTCGAGCTCGTTCCATATCTG M S E S I P V Q G M P T H L E L V P Y L M S E S I P V Q G M P T H L E L V P Y L TTACGATCACTTGTCCAACTCGGAGGCACTGGAAAAAATTCCGAAATTGAAGACACAGTA L R S L V Q L G G T G K N S E I E D T V L R S L V Q L G G T G K N S E I E D T V ATAGACATATTTCCAAATACCGAGCAATTACTAAACGTCCACTACCCCAACAAACCAACT I D I F P N T E Q L L N V H Y P N K P T I D I F P N T E Q L L N V H Y P N K P T GTATCGGTGTTCAAAAAACGCTTAGCATGGGCACGTAGCACCGCATACCTCAGCGGTGCC V S V F K K R L A W A R S T A Y L S G A V S V F K K R L A W A R S T A Y L S G A GCAAGTCGCCCTTCACGAGGCGTCTACATGATCAATGATGTGGGCGAATCCCTTCTCAAG A S R P S R G V Y M I N D V G E S L L K A S R P S R G V Y M I N D V G E S L L K AAAAATGACCACGCGATTGTCCAGTGGTGCACTGAGTTCGAACGCAAATACAACAAAAGG K N D H A I V Q W C T E F E R K Y N K R K N D H A I V Q W C T E F E R K Y N K R AAGCGGCTCGAAAAACAGCAGAATGAATCAACAGCCCCTGCACCAGATGAGCCCAGTTTC K R L E K Q Q N E S T A P A P D E P S F K R L E K Q Q N E S T D P A L D E P S F GAAATAATTGAAGACCAACAAGACGAAAACCAATCAACCCATGATTGGAAAAGCCTGCTA E I I E D Q Q D E N Q S T H D W K S L L E I I E D Q Q D E N Q S T H D W K S L L CTCAACCGACTACATCAAATGTCCCCTACTGCGTTCGAAAAGTACGTCATCTTCTTGCTC L N R L H Q M S P T A F E K Y V I F L L L N R L H Q M S P T A F E K Y V I F L L AAGCAATATGGGCTTGAGCTTAGCCACGTTGCAGGTCCTGGCGACGAAGGAGTCGACGCC K Q Y G L E L S H V A G P G D E G V D A K Q Y G L E L S H V A G P G D E G V D A ATTGGCACCGCTCCCCTGAGCCCTGTCTTGTCTTCACGGGTCGCCGTACAGATCAAGCGT I G T A P L S P V L S S R V A V Q I K R I G T A P L S P V L S S R V A V Q I K R TACGATCCGGTTAACAACATAGTGAGCCGCGAGGCAATTGCACTTTTCCAAAACGATGCA Y D P V N N I V S R E A I A L F Q N D A Y D P V N N I V S R E A I A L F Q N D A CGAGTTAAAGGTGCCGAACGTGCAATTTTTGTCACCTTGAGTAGCTTCACAGCTCCTGCA R V K G A E R A I F V T L S S F T A P A R V K G A E R A I F V T L S S F T A P A AAAAGGACTGCCCGCCAAGCATTACCCAATGTGGAACTCATCAATGGTGACCGCCTCTGC K G L P A K H Y P M W N S S M V T A S A K - G L P A K H Y P M W N S S T V T A S A GAGCTTATTCGCGATTGTGGTGCTGCTGGGGTTCGGATGGAACCCGTGGTAA S L F A I V V L L G F G W N P W S L F A I V V L L G F G W N P W --- // >fig|6666666.67454.peg.2283 fig|257309.1.peg.2323 gi|372118535|gb|CP003217.1|_2351754_2352026,gi|372118535|gb|CP003217.1|_2352030_2352092,gi|372118535|gb|CP003217.1|_2352096_2352110 MLVGGGARVGGPLGIVLVLLVGLAVFALGWFSQVKLVQGNWDPTPWRGGSTTAGAAGPAGAAGAAAGSAQGLTRTYPKVLPPKGAPVPPSRxTGVFRGILHRTSHQIASKPAVxTDLV We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGCTCGTCGGCGGCGGCGCTCGCGTAGGTGGTCCGCTCGGCATCGTCCTAGTACTCTTG M L V G G G A R V G G P L G I V L V L L M L V G G G A R V G G P L G I V L V L L GTTGGTCTTGCAGTCTTCGCCTTGGGCTGGTTCTCTCAGGTCAAGCTGGTGCAGGGTAAC V G L A V F A L G W F S Q V K L V Q G N V G L A V F A L G W F S Q V K L V Q G N TGGGATCCGACACCGTGGCGTGGCGGCTCTACTACAGCGGGTGCTGCTGGTCCTGCTGGT W D P T P W R G G S T T A G A A G P A G W D P T P W R G G S T T A G A A G P A G GCTGCTGGTGCTGCTGCGGGTTCGGCCCAGGGTTTGACCCGTACATACCCGAAGGTCTTG A A G A A A G S A Q G L T R T Y P K V L A A G A A A G S A Q G L T R T Y P K V L CCACCGAAGGGCGCTCCGGTTCCACCGAGCCGCTAAACGGGGGTATTCCGAGGCATTTTG P P K G A P V P P S R * T G V F R G I L P P K G A P V P P S R X T G V F R G I L CACAGAACTTCACACCAAATCGCTTCCAAACCGGCCGTTTGAACAGATTTGGTGTGA H R T S H Q I A S K P A V * T D L V H R T S H Q I A S K P A V X T D L V --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2323): ATGCTCGTCGGCGGCGGCGCTCGCGTAGGTGGTCCGCTCGGCATCGTCCTAGTACTCTTG M L V G G G A R V G G P L G I V L V L L M L V G G G A R V G G R L G I V L V I L GTTGGTCTTGCAGTCTTCGCCTTGGGCTGGTTCTCTCAGGTCAAGCTGGTGCAGGGTAAC V G L A V F A L G W F S Q V K L V Q G N V G L A V F A L G W F S Q V K L V Q G N TGGGATCCGACACCGTGGCGTGGCGGCTCTACTACAGCGGGTGCTGCTGGTCCTGCTGGT W D P T P W R G G S T T A G A A G P A W D P T P W R G G F A T A G A A G P A --- GCTGCTGGTGCTGCTGCGGGT-TCGGCCCAGGGTTTGACCCGTACATACCCGAAGGTCTT A G S A Q G L T R T Y P K V L --------------- A G V P A Q G L T R T Y P K V L GCCACCGAAGGGCGCTCCGGTTCCACCGAGCCGCTAAACGGGGGTATTCCGAGGCATTTT P P K G A P V P P S R * T G V F R G I L P P K G A P V P P S H H S G V F R R I F GCACAGAACTTCACACCAAATCGCTTCCAAACCGGCCGTTTGAACAGATTTGGTGTGA H R T S H Q I A S K P A V * T D L V L G T S H Q I A S K P A V W A D L V --- // >fig|6666666.67454.peg.1318 fig|257309.1.peg.726 Putative transposase gi|372118535|gb|CP003217.1|_1343387_1343824,gi|372118535|gb|CP003217.1|_1343824_1344699 MQRQFWGLIATGITTAQAALQVGVSVPVGTRWFRHAGGMRPLALDEPSGRYLSFTEREEIAILWEKQTGVREIARRIGRNPATISRELRRNTATRGGKQIYRAGVAQWKAQEAAKRPKQAKLVDNPRLRDYVQERLAGTVRDETGxxMAGPDTPAWKGRSKPHRADRRWLTAWSPEQISQRLRIDFPDDESMRISHEAIYQALYIEGRGALKRELVAALRTGRALRKPRARSKSKPKGHLTADVVISNRPPEASDRAVPGHWEGDLIIGTGRSAIGTVVERYSRSILLVHLPRLDGWGEQPRTKNGPALGGYGAEAMNTALQTVMKDLPLQLRQTLTWDRGTELADHAAFTLATGTKVFFADPHSPWQRPTNENSNGLLRQYFPKGTDLSRWTAQDLAAIAYTLNNRPRKVLGFRTPAEVFNEQLQSIQNNSVATTD We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCAACGCCAGTTCTGGGGTCTGATCGCGACGGGAATCACCACTGCGCAGGCCGCCCTT V Q R Q F W G L I A T G I T T A Q A A L M Q R Q F W G L I A T G I T T A Q A A L CAGGTGGGGGTGTCCGTACCGGTGGGAACGAGGTGGTTCCGTCATGCTGGTGGAATGAGA Q V G V S V P V G T R W F R H A G G M R Q V G V S V P V G T R W F R H A G G M R CCGTTAGCTTTGGACGAGCCCTCGGGGCGGTATCTATCGTTTACTGAACGAGAGGAAATC P L A L D E P S G R Y L S F T E R E E I P L A L D E P S G R Y L S F T E R E E I GCGATCCTGTGGGAGAAACAGACGGGTGTGCGTGAGATCGCTCGACGGATTGGCCGCAAT A I L W E K Q T G V R E I A R R I G R N A I L W E K Q T G V R E I A R R I G R N CCGGCGACGATTTCTCGTGAGCTACGGCGTAATACTGCCACCCGTGGTGGCAAGCAGATT P A T I S R E L R R N T A T R G G K Q I P A T I S R E L R R N T A T R G G K Q I TATCGGGCAGGGGTGGCCCAGTGGAAAGCTCAGGAAGCCGCTAAGCGTCCCAAACAAGCA Y R A G V A Q W K A Q E A A K R P K Q A Y R A G V A Q W K A Q E A A K R P K Q A AAACTCGTGGATAATCCGCGCCTGCGGGACTATGTTCAGGAGCGTCTTGCTGGGACGGTC K L V D N P R L R D Y V Q E R L A G T V K L V D N P R L R D Y V Q E R L A G T V CGAGATGAAACGGGG*TC*GTCATGGCGGGGCCTGATACGCCTGCGTGGAAGGGCCGGAG R D E T G V M A G P D T P A W K G R S R D E T G *X** X M A G P D T P A W K G R S CAAACCTCACAGGGCAGACCGACGGTGGTTGACCGCGTGGAGCCCGGAGCAGATATCGCA K P H R A D R R W L T A W S P E Q I S Q K P H R A D R R W L T A W S P E Q I S Q GCGGTTAAGGATCGACTTCCCTGATGATGAGAGTATGAGAATCTCCCATGAAGCGATCTA R L R I D F P D D E S M R I S H E A I Y R L R I D F P D D E S M R I S H E A I Y CCAGGCGCTCTATATTGAGGGGCGCGGGGCGCTGAAGCGTGAACTCGTGGCCGCACTGCG Q A L Y I E G R G A L K R E L V A A L R Q A L Y I E G R G A L K R E L V A A L R GACTGGGCGGGCCCTGCGTAAACCCCGCGCCCGGTCCAAGAGCAAGCCTAAAGGTCATCT T G R A L R K P R A R S K S K P K G H L T G R A L R K P R A R S K S K P K G H L CACCGCCGATGTTGTCATCTCTAACCGGCCCCCGGAAGCCTCGGATCGGGCGGTGCCCGG T A D V V I S N R P P E A S D R A V P G T A D V V I S N R P P E A S D R A V P G GCATTGGGAAGGAGACTTGATCATCGGTACCGGCAGGTCAGCGATCGGGACCGTGGTCGA H W E G D L I I G T G R S A I G T V V E H W E G D L I I G T G R S A I G T V V E ACGCTACAGCCGGTCGATCCTGCTGGTGCACCTGCCCCGGTTGGACGGCTGGGGTGAACA R Y S R S I L L V H L P R L D G W G E Q R Y S R S I L L V H L P R L D G W G E Q ACCAAGGACGAAGAACGGACCTGCCTTGGGTGGGTACGGTGCTGAAGCGATGAACACCGC P R T K N G P A L G G Y G A E A M N T A P R T K N G P A L G G Y G A E A M N T A CCTACAAACCGTGATGAAAGATCTACCGTTACAACTGCGTCAAACGTTGACCTGGGACCG L Q T V M K D L P L Q L R Q T L T W D R L Q T V M K D L P L Q L R Q T L T W D R CGGAACCGAGCTCGCTGACCATGCCGCTTTCACTCTAGCCACGGGCACGAAAGTGTTCTT G T E L A D H A A F T L A T G T K V F F G T E L A D H A A F T L A T G T K V F F CGCGGACCCACACTCGCCATGGCAACGTCCCACGAATGAGAACAGCAACGGACTCCTACG A D P H S P W Q R P T N E N S N G L L R A D P H S P W Q R P T N E N S N G L L R CCAGTACTTTCCCAAGGGTACCGACCTGTCTCGATGGACAGCCCAAGACCTCGCCGCCAT Q Y F P K G T D L S R W T A Q D L A A I Q Y F P K G T D L S R W T A Q D L A A I CGCCTACACGCTCAACAACAGACCAAGAAAAGTCCTTGGATTTCGAACCCCAGCCGAAGT A Y T L N N R P R K V L G F R T P A E V A Y T L N N R P R K V L G F R T P A E V CTTCAATGAACAACTACAATCAATTCAAAACAACAGTGTTGCAACCACCGATTGA F N E Q L Q S I Q N N S V A T T D F N E Q L Q S I Q N N S V A T T D --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.726): GTGCAACGCCAGTTCTGGGGTCTGATCGCGACGGGAATCACCACTGCGCAGGCCGCCCTT V Q R Q F W G L I A T G I T T A Q A A L M Q R Q F W G L I A T G I T T A Q A A L CAGGTGGGGGTGTCCGTACCGGTGGGAACGAGGTGGTTCCGTCATGCTGGTGGAATGAGA Q V G V S V P V G T R W F R H A G G M R Q V G V S V P V G T R W F R H A G G M R CCGTTAGCTTTGGACGAGCCCTCGGGGCGGTATCTATCGTTTACTGAACGAGAGGAAATC P L A L D E P S G R Y L S F T E R E E I P L A L D E P S G R Y L S F A E R E E I GCGATCCTGTGGGAGAAACAGACGGGTGTGCGTGAGATCGCTCGACGGATTGGCCGCAAT A I L W E K Q T G V R E I A R R I G R N A I L W E K Q T G V R E I A R R I G R N CCGGCGACGATTTCTCGTGAGCTACGGCGTAATACTGCCACCCGTGGTGGCAAGCAGATT P A T I S R E L R R N T A T R G G K Q I P A T I S R E L R R N A A T R G G K Q I TATCGGGCAGGGGTGGCCCAGTGGAAAGCTCAGGAAGCCGCTAAGCGTCCCAAACAAGCA Y R A G V A Q W K A Q E A A K R P K Q A Y R V G V A Q W K A Q E A A K R P K Q A AAACTCGTGGATAATCCGCGCCTGCGGGACTATGTTCAGGAGCGTCTTGCTGGGACGGTC K L V D N P R L R D Y V Q E R L A G T V K L V D N P R L R D Y V Q E R L A G T V CGAGAT*GA*AACGGGGTCGTCATGGCGGGGCCTGATACGCCTGCGTGGAAGGGCCGGAG R D N G V V M A G P D T P A W K G R S R D *E** N G V V M A G P D T P A W K G R S CAAACCTCACAGGGCAGACCGACGGTGGTTGACCGCGTGGAGCCCGGAGCAGATATCGCA K P H R A D R R W L T A W S P E Q I S Q K P H R A D R R W L T A W S P E Q I S Q GCGGTTAAGGATCGACTTCCCTGATGATGAGAGTATGAGAATCTCCCATGAAGCGATCTA R L R I D F P D D E S M R I S H E A I Y R L R I D F P D D E S M R I S H E A I Y CCAGGCGCTCTATATTGAGGGGCGCGGGGCGCTGAAGCGTGAACTCGTGGCCGCACTGCG Q A L Y I E G R G A L K R E L V A A L R Q A L Y I E G R G A L K R E L V A A L R GACTGGGCGGGCCCTGCGTAAACCCCGCGCCCGGTCCAAGAGCAAGCCTAAAGGTCATCT T G R A L R K P R A R S K S K P K G H L T G R A L R K P R A R S K S K P K G H V CACCGCCGATGTTGTCATCTCTAACCGGCCCCCGGAAGCCTCGGATCGGGCGGTGCCCGG T A D V V I S N R P P E A S D R A V P G T A D V V I S N R P P E A S D R A V P G GCATTGGGAAGGAGACTTGATCATCGGTACCGGCAGGTCAGCGATCGGGACCGTGGTCGA H W E G D L I I G T G R S A I G T V V E H W E G D L I I G T G R S A I G T V V E ACGCTACAGCCGGTCGATCCTGCTGGTGCACCTGCCCCGGTTGGACGGCTGGGGTGAACA R Y S R S I L L V H L P R L D G W G E Q R Y S R S I L L V H L P R L D G W G E Q ACCAAGGACGAAGAACGGACCTGCCTTGGGTGGGTACGGTGCTGAAGCGATGAACACCGC P R T K N G P A L G G Y G A E A M N T A P R T K N G P A L G G Y G A E A M N T A CCTACAAACCGTGATGAAAGATCTACCGTTACAACTGCGTCAAACGTTGACCTGGGACCG L Q T V M K D L P L Q L R Q T L T W D R L Q T V M K D L P L Q L R Q T L T W D R CGGAACCGAGCTCGCTGACCATGCCGCTTTCACTCTAGCCACGGGCACGAAAGTGTTCTT G T E L A D H A A F T L A T G T K V F F G T E L A D H A A F T L A T G T K V F F CGCGGACCCACACTCGCCATGGCAACGTCCCACGAATGAGAACAGCAACGGACTCCTACG A D P H S P W Q R P T N E N S N G L L R A D P H S P W Q R P T N E N S N G L L R CCAGTACTTTCCCAAGGGTACCGACCTGTCTCGATGGACAGCCCAAGACCTCGCCGCCAT Q Y F P K G T D L S R W T A Q D L A A I Q Y F P K G T D L S R W T A Q D L A A I CGCCTACACGCTCAACAACAGACCAAGAAAAGTCCTTGGATTTCGAACCCCAGCCGAAGT A Y T L N N R P R K V L G F R T P A E V A Y T L N N R P R K V L G F R T P A E V CTTCAATGAACAACTACAATCAATTCAAAACAACAGTGTTGCAACCACCGATTGA F N E Q L Q S I Q N N S V A T T D F N E Q L Q S I Q N N S V A T T D --- // >fig|6666666.67454.peg.927 fig|196164.1.peg.1199 hypothetical protein FIG175938 gi|372118535|gb|CP003217.1|_922800_922862,gi|372118535|gb|CP003217.1|_922866_923678 MLLRRAFNDRLGAGIEHLRKGxHTMSFFEDLATALDNEGIESRVHDDVLFVPITSDLEIQFVEIDSVVPAANVYIAAAGVDEDDDEFEAALVSVVFSVEDAVRTVAEHVATDQVVTVLRDLLEGTDDRIAELEFFQDPHDPHMVHAEVAENSELQVVVDVVDGEALATVTFVAFGESFDDLVDQAIDELWSDQSNDSLSDEDRDRLFYDVAAELTEEAGEVLQLGSYSDCDKLFDVLSVALENADDWEEQLAPLESAEADLESEGTSFESGDLLEDDDDLEFDDLDDDDEDA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. TTGCTGCTTCGGAGAGCTTTTAACGATAGGCTAGGGGCCGGCATTGAGCACCTCAGAAAG L L L R R A F N D R L G A G I E H L R K M L L R R A F N D R L G A G I E H L R K GGTTGACACACAATGAGCTTCTTTGAAGATTTGGCTACGGCGCTTGATAACGAGGGTATC G * H T M S F F E D L A T A L D N E G I G X H T M S F F E D L A T A L D N E G I GAGTCTCGTGTACATGATGACGTGTTGTTTGTTCCTATTACTTCTGATCTTGAGATTCAG E S R V H D D V L F V P I T S D L E I Q E S R V H D D V L F V P I T S D L E I Q TTTGTGGAGATCGACTCGGTGGTGCCAGCAGCAAATGTGTATATCGCTGCCGCCGGTGTA F V E I D S V V P A A N V Y I A A A G V F V E I D S V V P A A N V Y I A A A G V GACGAAGACGACGATGAGTTTGAGGCGGCACTGGTTAGTGTTGTGTTCTCGGTTGAGGAT D E D D D E F E A A L V S V V F S V E D D E D D D E F E A A L V S V V F S V E D GCTGTGCGCACGGTTGCCGAGCATGTGGCCACTGACCAAGTAGTTACGGTGCTGCGCGAT A V R T V A E H V A T D Q V V T V L R D A V R T V A E H V A T D Q V V T V L R D TTGTTGGAAGGCACTGATGATCGCATTGCGGAGCTGGAGTTTTTCCAGGATCCACATGAT L L E G T D D R I A E L E F F Q D P H D L L E G T D D R I A E L E F F Q D P H D CCACATATGGTGCATGCTGAAGTCGCTGAAAACTCGGAGCTGCAGGTCGTTGTTGACGTT P H M V H A E V A E N S E L Q V V V D V P H M V H A E V A E N S E L Q V V V D V GTCGATGGCGAGGCGCTTGCTACCGTTACTTTTGTAGCGTTTGGCGAGAGTTTTGACGAT V D G E A L A T V T F V A F G E S F D D V D G E A L A T V T F V A F G E S F D D CTGGTGGACCAAGCAATCGATGAGCTGTGGAGTGATCAGTCCAATGATTCACTCAGCGAC L V D Q A I D E L W S D Q S N D S L S D L V D Q A I D E L W S D Q S N D S L S D GAAGATCGCGATCGCCTGTTTTATGATGTTGCAGCTGAACTAACAGAAGAGGCTGGGGAA E D R D R L F Y D V A A E L T E E A G E E D R D R L F Y D V A A E L T E E A G E GTTCTGCAGCTCGGTTCCTATTCTGATTGTGACAAGTTGTTTGATGTCCTCTCCGTTGCT V L Q L G S Y S D C D K L F D V L S V A V L Q L G S Y S D C D K L F D V L S V A CTTGAAAATGCTGATGATTGGGAAGAACAGCTGGCTCCGTTGGAATCTGCAGAGGCTGAT L E N A D D W E E Q L A P L E S A E A D L E N A D D W E E Q L A P L E S A E A D CTTGAGTCCGAGGGAACCAGCTTTGAATCTGGGGACTTGTTAGAGGATGATGACGACCTC L E S E G T S F E S G D L L E D D D D L L E S E G T S F E S G D L L E D D D D L GAATTTGATGATCTCGATGACGATGACGAGGATGCATAG E F D D L D D D D E D A E F D D L D D D D E D A --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.1199): TTGCTGCTTCGGAGAGCTTTTAACGATAGGCTAGGGGCCGGCATTGAGCACCTCAGAAAG R K ------------------------------------------------------ M E GGTTGACACACAATGAGCTTCTTTGAAGATTTGGCTACGGCGCTTGATAACGAGGGTATC G * H T M S F F E D L A T A L D N E G I G H P N M S F F E D I A A A L D R D G I GAGTCTCGTGTACATGATGACGTGTTGTTTGTTCCTATTACTTCTGATCTTGAGATTCAG E S R V H D D V L F V P I T S D L E I Q E S R V N G D T M F V P I T S D L E I Q TTTGTGGAGATCGACTCGGTGGTGCCAGCAGCAAATGTGTATATCGCTGCCGCCGGTGTA F V E I D S V V P A A N V Y I A A A G V F V E I D S L L P A A N V Y I A A A N V GACGAAGACGACGATGAGTTTGAGGCGGCACTGGTTAGTGTTGTGTTCTCGGTTGAGGAT D E D D D E F E A A L V S V V F S V E D D E D D E D F E A V L V S V V F S I D D GCTGTGCGCACGGTTGCCGAGCATGTGGCCACTGACCAAGTAGTTACGGTGCTGCGCGAT A V R T V A E H V A T D Q V V T V L R D A V V A V A K H V A T D Q V V T V L R D TTGTTGGAAGGCACTGATGATCGCATTGCGGAGCTGGAGTTTTTCCAGGATCCACATGAT L L E G T D D R I A E L E F F Q D P H D L L E G T D E R I Q D L E F Y Q D A V N CCACATATGGTGCATGCTGAAGTCGCTGAAAACTCGGAGCTGCAGGTCGTTGTTGACGTT P H M V H A E V A E N S E L Q V V V D V A N L V R A E V G Q N S E L Q V L V E V GTCGATGGCGAGGCGCTTGCTACCGTTACTTTTGTAGCGTTTGGCGAGAGTTTTGACGAT V D G E A L A T V T F V A F G E S F D D E D G V P T A T V S F V A I G E T F E D CTGGTGGACCAAGCAATCGATGAGCTGTGGAGTGATCAGTCCAATGATTCACTCAGCGAC L V D Q A I D E L W S D Q S N D S L S D L V D Q A I E E L W E S D G D A V L S E GAAGATCGCGATCGCCTGTTTTATGATGTTGCAGCTGAACTAACAGAAGAGGCTGGGGAA E D R D R L F Y D V A A E L T E E A G E E D R Q R M F A D L T G E L E F A T D E GTTCTGCAGCTCGGTTCCTATTCTGATTGTGACAAGTTGTTTGATGTCCTCTCCGTTGCT V L Q L G S Y S D C D K L F D V L S V A V L D L G T F T D F D R L F D V L S L A CTTGAAAATGCTGATGATTGGGAAGAACAGCTGGCTCCGTTGGAATCTGCAGAGGCTGAT L E N A D D W E E Q L A P L E S A E A D D D H A E D W E E Q L V P F D D E E F D CTTGAGTCCGAGGGAACCAGCTTTGAATCTGGGGACTTGTTAGAGGATGAT---GACGAC E P A L N D L L E D D D D ------------- E P D V Y ----- D L F V D D SDE D D CTCGAATTTGATGATCTCGATGACGATGACGAGGATGCATAG--------- L E F D D L D D D D E D A * F E D D D D E D D D E E D D EDDDDPASK // >fig|6666666.67454.peg.1291 fig|196164.1.peg.1764 hypothetical FIG152347 gi|372118535|gb|CP003217.1|_1320968_1320375,gi|372118535|gb|CP003217.1|_1320371_1320324 MLSEESEGRRYASVVDPGLRAKELIDQYCEENRVEVVQVLLTHGHIDHCRDAVALANAWGVALQIHRDDEFFLEKGNGMSEDSRLLFHADAMNLPDSVSYLGDGDEVELGGQRFVVRHAPGHSPGCVLFVGKDFCFSGDVLFKGSIGRTDLAHSDPHAMANSIKSVVLGLEDSLTILPGHGPATTMRAEKASNPYLRVxHSNCFVATAKLYRRE We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCTGTCGGAGGAATCTGAGGGGCGTCGATACGCAAGCGTGGTAGATCCTGGGCTCCGT V L S E E S E G R R Y A S V V D P G L R M L S E E S E G R R Y A S V V D P G L R GCGAAAGAGCTAATTGATCAGTACTGTGAAGAAAACCGCGTCGAAGTAGTGCAAGTTTTG A K E L I D Q Y C E E N R V E V V Q V L A K E L I D Q Y C E E N R V E V V Q V L CTTACTCATGGCCATATTGATCACTGCAGGGATGCTGTTGCTCTTGCTAATGCTTGGGGA L T H G H I D H C R D A V A L A N A W G L T H G H I D H C R D A V A L A N A W G GTCGCGTTGCAGATTCATCGCGACGATGAATTCTTTCTGGAAAAGGGAAATGGAATGTCG V A L Q I H R D D E F F L E K G N G M S V A L Q I H R D D E F F L E K G N G M S GAGGACTCGAGATTACTTTTCCACGCCGATGCGATGAATCTCCCAGATTCAGTGAGCTAT E D S R L L F H A D A M N L P D S V S Y E D S R L L F H A D A M N L P D S V S Y TTAGGCGATGGCGATGAAGTTGAACTTGGTGGTCAACGATTCGTTGTTCGTCATGCGCCT L G D G D E V E L G G Q R F V V R H A P L G D G D E V E L G G Q R F V V R H A P GGTCATTCACCTGGGTGCGTCTTGTTCGTTGGTAAAGACTTCTGTTTTTCAGGTGATGTG G H S P G C V L F V G K D F C F S G D V G H S P G C V L F V G K D F C F S G D V CTTTTCAAAGGATCGATAGGACGGACTGATCTTGCGCACTCTGATCCACATGCTATGGCG L F K G S I G R T D L A H S D P H A M A L F K G S I G R T D L A H S D P H A M A AACAGTATAAAAAGTGTAGTTCTGGGGTTAGAGGATTCATTGACAATATTGCCTGGGCAT N S I K S V V L G L E D S L T I L P G H N S I K S V V L G L E D S L T I L P G H GGTCCAGCTACCACGATGCGAGCTGAGAAGGCTTCAAATCCGTATTTGAGGGTGTAGCAC G P A T T M R A E K A S N P Y L R V * H G P A T T M R A E K A S N P Y L R V X H TCGAATTGTTTTGTTGCTACCGCTAAGCTGTATCGACGTGAGTAA S N C F V A T A K L Y R R E S N C F V A T A K L Y R R E --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.1764): ----------------GTGCTGTCGGAGGAATCTGAGGGGCGTCGATACGCAAGCGTGGT V L S E E S E A S V V MEILGFAAGPYKTNCY V V V G D G E ------------ V A I I AGATCCTGGGCTCCGTGCGAAAGAGCTAATTGATCAGTACTGTGAAGAAAACCGCGTCGA D P G L R A K E L I D Q Y C E E N R V E D P G M H T H D D L V E Y I T T N K L T AGTAGTGCAAGTTTTGCTTACTCATGGCCATATTGATCACTGCAGGGATGCTGTTGCTCT V V Q V L L T H G H I D H C R D A V A L V D K I V L T H G H I D H T R D A G V V TGCTAATGCTTGGGGAGTCGCGTTGCAGATTCATCGCGACGATGAATTCTTTCTGGAAAA A N A W G V A L Q I H R D D E F F L E K A R R F N A P V Y I H P D D V F F L E A GGGAAATGGAATGTCGGAGGACTCGAGATTACTTTTCCACGCCGATGCGATGAATCTCCC G N G M S E D S R L L F H A D A M N L P Y K G S G T R T A M L F D A D N M L S P AGATTCAGTGAGCTATTTAGGCGATGGCGATGAAGTTGAACTTGGTGGTCAACGATTCGT D S V S Y L G D G D E V E L G G Q R F V E S T I D L V D G E T I T L A G E E F T TGTTCGTCATGCGCCTGGTCATTCACCTGGGTGCGTCTTGTTCGTTGGTAAAGACTTCTG V R H A P G H S P G C V L F V G K D F C L R H A P G H S P G C T M L V G R E Y C TTTTTCAGGTGATGTGCTTTTCAAAGGATCGATAGGACGGACTGATCTTGCGCACTCTGA F S G D V L F K G S I G R T D L A H S D F S G D V L F K G S I G R T D F E F A D TCCACATGCTATGGCGAACAGTATAAAAAGTGTAGTTCTGGGGTTAGAGGATTCATTGAC P H A M A N S I K S V V L G L E D S L T E E A M T R S L R T V V L G L D D A L Q AATATTGCCTGGGCATGGTCCAGCTACCACGATGCGAGCTGAGAAGGCTTCAAATCCGTA I L P G H G P A T T M R A E K A S N P Y I L P G H G P T T T M R A E R M G N P F TTTGAGGGTGTAGCACTCGAATTGTTTTGTTGCTACCGCTAAGCTGTATCGACGTGAGTA L R V * H S N L R A L R P N -------------------------------------- A - // >fig|6666666.67454.peg.1519 fig|257309.1.peg.2314 gi|372118535|gb|CP003217.1|_1549072_1548548,gi|372118535|gb|CP003217.1|_1548548_1548447 MRILDPSGRHGTLCLMRKTSTTSTAPYISENVDPLPEKQGSGVVTSRFRPWLHSVQWYSAIVVMVSLLFAGTGVVWAWFRPTYSAEIVEDNQVRVGTEVNVEFLSLAQFIVISGILSLAITYILARKVRSHNHQVRIMMWLLLWTLIGGLILATTGDMVASLIHHTTDADQLLPxxSHPFRAACCIRGQRSDVATFRCRVCFLAIAIH We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCGCATTCTTGATCCATCCGGCAGACACGGTACCCTGTGTCTCATGCGAAAAACTTCA V R I L D P S G R H G T L C L M R K T S M R I L D P S G R H G T L C L M R K T S ACCACCTCGACAGCTCCGTACATTTCGGAGAATGTTGATCCACTCCCAGAAAAACAAGGA T T S T A P Y I S E N V D P L P E K Q G T T S T A P Y I S E N V D P L P E K Q G AGTGGCGTGGTCACATCACGCTTTCGCCCGTGGCTTCATTCGGTGCAGTGGTATTCAGCG S G V V T S R F R P W L H S V Q W Y S A S G V V T S R F R P W L H S V Q W Y S A ATTGTCGTGATGGTGTCTTTGTTATTCGCCGGCACGGGAGTTGTATGGGCATGGTTTCGC I V V M V S L L F A G T G V V W A W F R I V V M V S L L F A G T G V V W A W F R CCCACATATTCAGCGGAAATCGTGGAAGATAACCAAGTGCGCGTTGGCACGGAAGTAAAC P T Y S A E I V E D N Q V R V G T E V N P T Y S A E I V E D N Q V R V G T E V N GTGGAGTTTCTTTCTCTCGCGCAATTTATTGTCATTTCGGGAATTCTTTCCCTAGCCATC V E F L S L A Q F I V I S G I L S L A I V E F L S L A Q F I V I S G I L S L A I ACGTATATCCTTGCGCGGAAAGTGCGTTCGCATAACCACCAAGTGCGCATCATGATGTGG T Y I L A R K V R S H N H Q V R I M M W T Y I L A R K V R S H N H Q V R I M M W CTCTTGTTATGGACACTTATCGGCGGATTGATCCTCGCCACCACCGGAGACATGGTTGCT L L L W T L I G G L I L A T T G D M V A L L L W T L I G G L I L A T T G D M V A TCGCTCATCCATCACACGACTGATGCTGATCAGCTCCTCCCC*GG*AACAGTCATCCGTT S L I H H T T D A D Q L L P N S H P F S L I H H T T D A D Q L L P *X** X S H P F TCGCGCCGCCTGTTGCATTAGGGGCCAACGCAGTGATGTGGCCACCTTTCGTTGCCGGGT R A A C C I R G Q R S D V A T F R C R V R A A C C I R G Q R S D V A T F R C R V GTGCTTTTTGGCTATCGCTATTCATTAA C F L A I A I H C F L A I A I H --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2314): ------------GTGCGCATTCTTGATCCATCCGGCAGACACGGTACCCTGTGTCTCATG V R I L D P S G R H G T L C L M MRALSPDWYRAR I H I L D R S G R H G T L C L M CGAAAAACTTCAACCACCTCGACAGCTCCGTACATTTCGGAGAATGTTGATCCACTCCCA R K T S T T S T A P Y I S E N V D P L P R K T S T T S T A P Y I S E N V D P L P GAAAAACAAGGAAGTGGCGTGGTCACATCACGCTTTCGCCCGTGGCTTCATTCGGTGCAG E K Q G S G V V T S R F R P W L H S V Q E K Q G S G V V T S R F R P W L H S V Q TGGTATTCAGCGATTGTCGTGATGGTGTCTTTGTTATTCGCCGGCACGGGAGTTGTATGG W Y S A I V V M V S L L F A G T G V V W W Y S A I V V M V S L L F A G T G V V W GCATGGTTTCGCCCCACATATTCAGCGGAAATCGTGGAAGATAACCAAGTGCGCGTTGGC A W F R P T Y S A E I V E D N Q V R V G A W F R P T Y S A E I V E D N Q V R V G ACGGAAGTAAACGTGGAGTTTCTTTCTCTCGCGCAATTTATTGTCATTTCGGGAATTCTT T E V N V E F L S L A Q F I V I S G I L T E V N V E F L S L A Q F I V I S G I L TCCCTAGCCATCACGTATATCCTTGCGCGGAAAGTGCGTTCGCATAACCACCAAGTGCGC S L A I T Y I L A R K V R S H N H Q V R S L A I T Y I L A R K V R S H N H Q V R ATCATGATGTGGCTCTTGTTATGGACACTTATCGGCGGATTGATCCTCGCCACCACCGGA I M M W L L L W T L I G G L I L A T T G I M M W L L L W T L I G G L I L A T T G GACATGGTTGCTTCGCTCATCCATCACACGACTGATGCTGATCAGCTC*CT*CCCCGGAA D M V A S L I H H T T D A D Q L P R N D M V A S L I H H T T D V D Q L *L** P R N CAGTCATCCGTTTCGCGCCGCCTGTTGCATTAGGGGCCAACGCAGTGATGTGGCCACCTT S H P F R A A C C I R G Q R S D V A T F S H P F R A A C C I R G Q R S D V A T F TCGTTGCCGGGTGTGCTTTTTGGCTATCGCTATTCATTAA R C R V C F L A I A I H R C R V C F L A I V I H --- // >fig|6666666.67454.peg.57 fig|196627.4.peg.1764 Phenazine biosynthesis protein PhzF like FIG004618 gi|372118535|gb|CP003217.1|_54228_53875,gi|372118535|gb|CP003217.1|_53875_53408 MGHIKLPFIQVDVFSTGSFTGNPLAIVGNADNLSTTQMQNIARWLNLSETAFLSAPTTTDGDYRVRIFTRTEELPFAGHPTLGSARAWLEFGGKPQRHDVLVQECAAGLITIQNDNSxxSFSAPPLTCNNPLTADEIQEVAESLGISVHNISAAAWGVNGPRWQLIQLADIDFLPALTPTELSLGKRLGVIAIADRTHVHVRAFVGAGEDPVTGSLNATIAQWLRKQNKVDNEYEAFQRQFIGAAGKITILDDASGIWIGGETQVQINGSIHI We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGGACATATAAAACTCCCTTTTATCCAAGTAGACGTATTTTCCACTGGTTCTTTCACA M G H I K L P F I Q V D V F S T G S F T M G H I K L P F I Q V D V F S T G S F T GGTAATCCGCTTGCCATCGTCGGTAACGCAGATAATCTGTCCACTACCCAGATGCAGAAT G N P L A I V G N A D N L S T T Q M Q N G N P L A I V G N A D N L S T T Q M Q N ATTGCACGGTGGTTAAATCTCTCCGAAACTGCCTTCTTATCAGCTCCGACAACAACCGAT I A R W L N L S E T A F L S A P T T T D I A R W L N L S E T A F L S A P T T T D GGAGATTACCGTGTACGCATTTTTACACGTACCGAAGAACTGCCGTTCGCCGGCCACCCA G D Y R V R I F T R T E E L P F A G H P G D Y R V R I F T R T E E L P F A G H P ACATTAGGTTCTGCACGTGCTTGGCTTGAATTTGGTGGAAAACCACAAAGGCATGATGTT T L G S A R A W L E F G G K P Q R H D V T L G S A R A W L E F G G K P Q R H D V CTCGTACAAGAATGCGCCGCTGGCCTCATAACAATCCAAAATGACAACTCGACC*TT*TC L V Q E C A A G L I T I Q N D N S T S L V Q E C A A G L I T I Q N D N S X *X** S CTTTTCAGCACCACCTCTCACATGCAACAATCCTCTGACCGCCGACGAGATCCAAGAAGT F S A P P L T C N N P L T A D E I Q E V F S A P P L T C N N P L T A D E I Q E V TGCTGAATCTTTGGGGATTTCTGTCCACAACATCTCCGCCGCCGCGTGGGGAGTGAATGG A E S L G I S V H N I S A A A W G V N G A E S L G I S V H N I S A A A W G V N G TCCACGTTGGCAACTTATTCAATTAGCCGATATAGACTTTCTTCCCGCCCTTACCCCTAC P R W Q L I Q L A D I D F L P A L T P T P R W Q L I Q L A D I D F L P A L T P T GGAACTTTCCCTAGGAAAGCGTCTTGGGGTCATTGCGATAGCCGACCGCACCCACGTCCA E L S L G K R L G V I A I A D R T H V H E L S L G K R L G V I A I A D R T H V H TGTACGCGCATTTGTAGGTGCTGGAGAGGATCCAGTCACAGGTTCATTGAATGCCACCAT V R A F V G A G E D P V T G S L N A T I V R A F V G A G E D P V T G S L N A T I CGCTCAATGGCTACGCAAACAAAACAAGGTGGACAACGAATACGAAGCATTCCAAAGGCA A Q W L R K Q N K V D N E Y E A F Q R Q A Q W L R K Q N K V D N E Y E A F Q R Q GTTTATAGGCGCAGCTGGAAAAATCACCATCCTTGATGATGCCTCAGGCATCTGGATAGG F I G A A G K I T I L D D A S G I W I G F I G A A G K I T I L D D A S G I W I G TGGCGAAACGCAGGTCCAGATAAACGGGAGCATACATATATAA G E T Q V Q I N G S I H I G E T Q V Q I N G S I H I --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.1764): -ATGGGACATATAAAACTCCCTTTTATCCAAGTAGACGTATTTTCCACTGGTTCTTTCAC M G H I K L P F I Q V D V F S T G S F T M P S K I S R P Y Y Q V D V F S S E P F M AGGTAATCCGCTTGCCATCGTCGGTAACGCAGATAATCTGTCCACTACCCAGATGCAGAA G N P L A I V G N A D N L S T T Q M Q N G N P L A V I A D A D D L S A E Q M A R TATTGCACGGTGGTTAAATCTCTCCGAAACTGCCTTCTTATCAGCTCCGACAACAACCGA I A R W L N L S E T A F L S A P T T T D I A R W T N L S E T T F L L K P T Q E G TGGAGATTACCGTGTACGCATTTTTACACGTACCGAAGAACTGCCGTTCGCCGGCCACCC G D Y R V R I F T R T E E L P F A G H P A D Y R V R I F T P T G E L P F A G H P AACATTAGGTTCTGCACGTGCTTGGCTTGAATTTGGTGGAAAACCACAAAGGCATGATGT T L G S A R A W L E F G G K K G M M T L G T A H V F R E L H G E ---- Q G T Q - TCTCGTACAAGAATGCGCCGCTGGCCTCATAACAATCCAAAATGACAACTCGAC-----C L V Q E C A A G L I T I Q N L D - L V Q E C V A G L V A V R A ----- I D GPASG TTTCCTTTTCAGCACCACCTCTCACATGCAACAATCCTCTGACCGCCGACGAGATCCAAG L S F S A P P L T C N N P L T A D E I Q L A F Q A P P T L K D G P L D A S D L D AAGTTGCTGAATCTTTGGGGATTTCTGTCCACAACATCTCCGCCGCCGCGTGGGGAGTGA E V A E S L G I S V H N I S A A A W G V A A C E A L G I S P D F I R A H Q W V D ATGGTCCACGTTGGCAACTTATTCAATTAGCCGAT----ATAGACTTTCTTCCCGCCCTT N G P R W Q L I Q L A D I D F L P A L N G P G W A V V E L P S AQHV L D L E P D F ACC--CCTACGGAACTTTCCCTAGGAAAGCGTCTTGGGGTCATTG*C*GATAGCCGACCG T P T L S L G V L G S L D S R P S AH P T --- L K L G ---- V I G A Y *P* E G A P CACCCACGTCCATGTACGCGCATTTGTA-GGTGCTGGAGAGGATCCAGTCACAGGTTCAT H P V H V R A F V G A G E D P V T G S H A - F E V R A F A Q G I G E D P V T G S TGAATGCCACCATCGCTCAATGGCTACGCAAACAAAACAAGGTGGACAACGAATACGAAG L N A T I A Q W L R K Q N K V D N E Y E L N A S I A Q W L H R D G R A G E G Y L CATTCCAAAGGCAGTTTATAGGCGCAGCTGGAAAAATCACCATCCTTGATGATGCCTCAG A F Q R Q F I G A A G K I T I L D D A S A S Q G T A I G R A G E I H I S I E S H GCATCTGGATAGGTGGCGAAACGCAGGTCCAGATAAACGGGAGCATACATATATAA G I W I G G E T Q V Q I N G S I H I A I W V G G S V T T I F Q G T A E F --- // >fig|6666666.67454.peg.255 fig|257309.1.peg.165 Putative phage integrase gi|372118535|gb|CP003217.1|_251791_251585,gi|372118535|gb|CP003217.1|_251581_251426,gi|372118535|gb|CP003217.1|_251422_251408,gi|372118535|gb|CP003217.1|_251404_250901,gi|372118535|gb|CP003217.1|_250897_250592 MAFVRDLWTKPNPNATSRTKRIRSARWGKGKRWQAVWVKNGKHVTTSCHAKDEAELHIARASVGQADGTxITKDKLDVTLQDMWDVWIASKQGRTESTKAGYIAAWKHIQPVFGNTACWKIExAKIAAxIPTVTTTKSSKHNQPRVIGSGSQRKIGIVIKALLDQAEELDIINKNKIRCTDIPRQGKAERRYLTIRGIDRLLAAAIPMNEVALMRNVLLFTGLRPREAKGLKVKDLDPMRGRLSIRRDVDDLGNPDETKTRNHRGVPIGGDLLFDLDDQAEGKQPHDWLLTDETGHVxTSTKWRRQWATICTHAHISGLTTYELRHTAASLAIAAGADVKTVQLMLGHASAATTLDTYAHLWETGLDSVPGAMSAHLQRERERLALRERRRVECELQVI We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCATTCGTGCGCGACCTCTGGACAAAACCCAACCCCAACGCAACATCGAGAACCAAA M A F V R D L W T K P N P N A T S R T K M A F V R D L W T K P N P N A T S R T K AGAATACGCTCTGCTCGATGGGGAAAAGGCAAACGCTGGCAAGCTGTCTGGGTAAAAAAC R I R S A R W G K G K R W Q A V W V K N R I R S A R W G K G K R W Q A V W V K N GGCAAACACGTCACCACCTCATGCCACGCCAAAGACGAAGCTGAACTTCACATCGCACGC G K H V T T S C H A K D E A E L H I A R G K H V T T S C H A K D E A E L H I A R GCATCCGTTGGCCAAGCCGATGGCACCTAGATTACTAAAGACAAACTCGATGTCACACTC A S V G Q A D G T * I T K D K L D V T L A S V G Q A D G T X I T K D K L D V T L CAAGACATGTGGGATGTATGGATCGCGTCAAAACAAGGACGCACAGAAAGCACCAAAGCT Q D M W D V W I A S K Q G R T E S T K A Q D M W D V W I A S K Q G R T E S T K A GGTTACATTGCTGCGTGGAAACACATCCAACCCGTCTTCGGAAACACCGCATGTTGGAAA G Y I A A W K H I Q P V F G N T A C W K G Y I A A W K H I Q P V F G N T A C W K ATTGAATGAGCAAAAATAGCAGCCTAGATCCCTACCGTCACCACCACCAAAAGCAGCAAG I E * A K I A A * I P T V T T T K S S K I E X A K I A A X I P T V T T T K S S K CATAACCAACCCCGTGTGATCGGCTCCGGCTCGCAACGCAAAATCGGAATCGTCATCAAA H N Q P R V I G S G S Q R K I G I V I K H N Q P R V I G S G S Q R K I G I V I K GCACTCCTCGACCAAGCCGAAGAACTCGACATCATTAACAAAAACAAAATCCGTTGCACC A L L D Q A E E L D I I N K N K I R C T A L L D Q A E E L D I I N K N K I R C T GATATCCCCCGCCAAGGAAAAGCAGAACGCCGCTACCTCACCATCCGAGGAATCGACCGC D I P R Q G K A E R R Y L T I R G I D R D I P R Q G K A E R R Y L T I R G I D R CTTTTAGCAGCTGCAATACCCATGAACGAAGTAGCACTCATGCGCAACGTTTTGTTATTC L L A A A I P M N E V A L M R N V L L F L L A A A I P M N E V A L M R N V L L F ACCGGTCTTCGCCCAAGGGAAGCAAAAGGATTGAAAGTCAAAGACCTCGACCCCATGCGC T G L R P R E A K G L K V K D L D P M R T G L R P R E A K G L K V K D L D P M R GGTAGGCTGTCCATCCGTCGTGACGTCGACGATCTCGGAAACCCCGATGAAACAAAAACC G R L S I R R D V D D L G N P D E T K T G R L S I R R D V D D L G N P D E T K T AGAAACCACCGCGGCGTCCCCATCGGTGGTGACCTCCTTTTCGATCTCGACGACCAAGCA R N H R G V P I G G D L L F D L D D Q A R N H R G V P I G G D L L F D L D D Q A GAAGGAAAACAACCACATGACTGGCTCCTCACCGATGAAACCGGCCATGTGTGAACATCC E G K Q P H D W L L T D E T G H V * T S E G K Q P H D W L L T D E T G H V X T S ACAAAATGGCGCAGGCAGTGGGCAACCATCTGCACTCATGCACACATATCAGGCCTGACA T K W R R Q W A T I C T H A H I S G L T T K W R R Q W A T I C T H A H I S G L T ACCTACGAGCTACGACACACAGCAGCATCATTGGCGATTGCAGCCGGTGCTGACGTGAAA T Y E L R H T A A S L A I A A G A D V K T Y E L R H T A A S L A I A A G A D V K ACCGTTCAACTTATGCTTGGACACGCAAGTGCTGCCACGACCCTTGACACCTACGCACAC T V Q L M L G H A S A A T T L D T Y A H T V Q L M L G H A S A A T T L D T Y A H TTGTGGGAAACCGGACTAGATTCCGTTCCCGGCGCGATGAGTGCTCATTTGCAGCGTGAG L W E T G L D S V P G A M S A H L Q R E L W E T G L D S V P G A M S A H L Q R E CGTGAGAGGTTAGCGTTGCGTGAGCGTAGGCGTGTTGAGTGTGAGTTACAGGTTATTTAG R E R L A L R E R R R V E C E L Q V I R E R L A L R E R R R V E C E L Q V I --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.165): ATGGCATTCGTGCGCGACCTCTGGACAAAACCCAACCCCAACGCAACATCGAGAACCAAA M A F V R D L W T K P N P N A T S R T K M A T V R D L W T K R N P N T T S K T K AGAATACGCTCTGCTCGATGGGGAAAAGGCAAACGCTGGCAAGCTGTCTGGGTAAAAAAC R I R S A R W G K G K R W Q A V W V K N R I R S A R W G V G K R W Q A V W I E N GGCAAACACGTCACCACCTCATGCCACGCCAAAGACGAAGCTGAACTTCACATCGCACGC G K H V T T S C H A K D E A E L H I A R G R E A T K T F E T R D E A E L W A A R GCATCCGTTGGCCAAGCCGATGGCACCTAGATTACTAAAGACAAACTCGATGTCACACTC A S V G Q A D G T * I T K D K L D V T L A E V G K A D G T W I T K D K V D I T L CAAGACATGTGGGATGTATGGATCGCGTCAAAACAAGGACGCACAGAAAGCACCAAAGCT Q D M W D V W I A S K Q G R T E S T K A S D L W E P W I A S K G N I S D K T K R GGTTACATTGCTGCGTGGAAA-CACATCCAACCCGTCTTCGGAAACACCGCATGTTGGAA G Y I A A W K H I Q P V F G N T A C W K D Y L S Y W N V H I R P Q W G Q T P C A H AATTGAATGAGCAAAAATAGCAGCCTAGATCCCTACCGTCACCACCACCAAAAGCAGCAA I E * A K I A A * I P T V T T T K S S K I Q R S V I N A W I P T L S T M K G V P GCATAACCAACCC-CGTGTGATCGGCTCCGGCTCGCAACGCAAAATCGGAATCGTCATCA H N Q P R V I G S G S Q R K I G I V I A S Q P P R P L S E S A M R K V G L I I AAGCACTCCTCGACCAAGCCGAAGAACTCGACATCATTAACAAAAACAAAATCCGTTGCA K A L L D Q A E E L D I I N K N K I R C H G I L D L A V E L G V I H Q N P I R T CCGATATCCCCCGCCAAGGAAAAGCAGAACGCCGCTACCTCACCATCCGAGGAATCGACC T D I P R Q G K A E R R Y L T I R G I D G D L P K Q K K S E R R Y L K I T E V D GCCTTTTAGCAGCTGCAATACCCATGAACGAAGTAGCACTCATGCGCAACGTTTTGTTAT R L L A A A P M N E V A L M R N V L L E L I R Q A --- P T E Q A K L L L R V L I TCACCGGTCTTCGCCCAAGGGAAGCAAAAGGATTGAAAGTCAAAGACCTCGACCCCATGC F T G L R P R E A K G L K V K D L D P M M T G L R P G E A K G L K V K D L D P V GCGGTAGGCTGTCCATCCGTCGTGACGTCGACGATCTCGGAAACCCCGATGAAACAAAAA R G R L S I R R D V D D L G N P D E T K R G R L M I R R D V D D L G H E D S T K CCAGAAACCACCGCGGCGTCCCCATCGGTGGTGACCTCCTTTTCGATCTCGACGACCAAG T R N H R G V P I G G D L L F D L D D Q T R N H R D V P I G G E I L L L L D R Y CAGAAGGAAAACAACCACATGACTGGCTCCTCACCGATGAAACCGGCCATGTGTGAACAT A E G K Q P H D W L L T D E T G H V * T A Q G K D P D S W L I P D E R G K V W T CCACAAAATGGCGCAGGCAGTGGGCAACCATCTGCACTCATGCACACATATCAGGCCTGA S T K W R R Q W A T I C T H A H I S G L T S R W R V V W K N L C I W T G I G D L CAACCTACGAGCTACGACACACAGCAGCATCATTGGCGATTGCAGCCGGTGCTGACGTGA T T Y E L R H T A A S L A I A A G A D V D T Y E L R H T A A S I A I A A G A D V AAACCGTTCAACTTATGCTTGGACACGCAAGTGCTGCCACGACCCTTGACACCTACGCAC K T V Q L M L G H A S A A T T L D T Y A K T V Q L M L G H S S A A M T L D I Y A ACTTGTGGGAAACCGGACTAGATTCCGTTCCCGGCGCGATGAGTGCTCATTTGCAGCGTG H L W E T G L D S V P G A M S A H L Q R H L W E E G L D A I P G A M E A H M E S AGCGTGAGAGGTTA---------GCGTTGCGTGAGCGTAGGCGTGTTGAGTGT*GA*GTT E R E R L A L R E R R R V E C V E R K R A EEASTVHEA S E A E R R R A Q F *K** V ACAGGTTATTTAG T G I G ------- // >fig|6666666.67454.peg.2299 fig|257309.1.peg.2244 Anthranilate synthase, aminase component (EC 4.1.3.27) # TrpAa FIG011663 gi|372118535|gb|CP003217.1|_2364828_2365400,gi|372118535|gb|CP003217.1|_2365400_2366383 MADFHVSARKVRYHEDAADIFHHLGGTSASDSVLLESADIDSKKNTTSMAVLQAAVRVTCMGQTVTATPLTSTGHAMVARLQEHFGTSGTEFSFHRSELHDERQRLLDTNNAEILRLLQCEAGYSGEQLPLLAGGFAFDYMETFEQLPSVPVGDNSYPDYQFVVAETVLVTDHLKRSAVIEGVSVDPAELxxRLDSLVATIDSHKTVEEGPATTATNEILTVRADISDVDFCQSVSALQDNIQAGDIYQAVPARSFSAPCESAYAAYRHLRTINPSPYMFYVRGITPISCNSNKTYELIGASPESNLKFDSRTREVQLYPIAGTRPRGLNPDGSINHELDIRAELDMRTNVKEIAEHTMLVDLARNDLARVSLPTTRRVAELLQVDRYSRVMHLVSRVVATLDPEFDAIDAYRACMNMGTLTGAPKLRAIELLRGIEAKRRGSYGGAVGYLQGDGSMDTCIVIRSAFIQDGVAVVQAGAGVVRDSIPQSEADETLHKAYAILHAIALAAGKDLEVIRS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCAGATTTCCATGTATCCGCCCGCAAGGTGCGCTATCACGAGGATGCCGCCGACATC M A D F H V S A R K V R Y H E D A A D I M A D F H V S A R K V R Y H E D A A D I TTCCATCATCTTGGCGGGACCTCGGCTAGCGATTCTGTTCTTTTAGAGTCTGCAGATATT F H H L G G T S A S D S V L L E S A D I F H H L G G T S A S D S V L L E S A D I GATTCTAAGAAGAACACCACATCCATGGCAGTACTTCAAGCAGCGGTTCGCGTGACATGC D S K K N T T S M A V L Q A A V R V T C D S K K N T T S M A V L Q A A V R V T C ATGGGGCAGACCGTGACAGCCACGCCCCTAACATCTACGGGCCATGCAATGGTGGCGCGC M G Q T V T A T P L T S T G H A M V A R M G Q T V T A T P L T S T G H A M V A R CTACAGGAGCACTTTGGCACGAGCGGCACGGAGTTCAGTTTTCATCGCTCCGAGCTTCAC L Q E H F G T S G T E F S F H R S E L H L Q E H F G T S G T E F S F H R S E L H GACGAACGCCAGCGCCTCCTTGACACCAATAATGCCGAGATTCTTCGCCTCCTACAGTGC D E R Q R L L D T N N A E I L R L L Q C D E R Q R L L D T N N A E I L R L L Q C GAGGCCGGCTATTCCGGTGAGCAGTTACCACTTCTTGCCGGCGGTTTCGCCTTTGATTAC E A G Y S G E Q L P L L A G G F A F D Y E A G Y S G E Q L P L L A G G F A F D Y ATGGAGACATTTGAGCAATTACCCTCTGTGCCAGTGGGGGATAATTCTTATCCCGATTAC M E T F E Q L P S V P V G D N S Y P D Y M E T F E Q L P S V P V G D N S Y P D Y CAGTTTGTGGTGGCAGAAACAGTGCTGGTCACCGATCATCTCAAGCGCAGCGCGGTCATC Q F V V A E T V L V T D H L K R S A V I Q F V V A E T V L V T D H L K R S A V I GAGGGCGTGTCCGTTGACCCTGCAGAGTTG*GG*GATCGACTAGATTCCCTTGTTGCCAC E G V S V D P A E L D R L D S L V A T E G V S V D P A E L *X** X R L D S L V A T GATTGACAGCCATAAAACAGTCGAGGAAGGTCCCGCGACCACGGCAACCAATGAGATATT I D S H K T V E E G P A T T A T N E I L I D S H K T V E E G P A T T A T N E I L GACTGTGCGTGCCGATATTTCTGATGTGGATTTTTGCCAAAGCGTAAGCGCACTGCAGGA T V R A D I S D V D F C Q S V S A L Q D T V R A D I S D V D F C Q S V S A L Q D CAATATCCAGGCGGGAGACATCTATCAGGCGGTTCCAGCACGCAGCTTTAGCGCGCCCTG N I Q A G D I Y Q A V P A R S F S A P C N I Q A G D I Y Q A V P A R S F S A P C TGAGAGTGCTTATGCAGCTTATAGACACTTGCGCACAATCAATCCCAGCCCCTATATGTT E S A Y A A Y R H L R T I N P S P Y M F E S A Y A A Y R H L R T I N P S P Y M F TTACGTGCGCGGCATTACCCCCATTTCATGCAATTCAAATAAAACATATGAGCTGATAGG Y V R G I T P I S C N S N K T Y E L I G Y V R G I T P I S C N S N K T Y E L I G AGCGTCGCCGGAGTCTAATCTCAAGTTCGATTCCAGAACACGCGAGGTACAATTGTATCC A S P E S N L K F D S R T R E V Q L Y P A S P E S N L K F D S R T R E V Q L Y P GATCGCCGGTACCCGGCCACGGGGACTTAACCCCGACGGGAGTATTAATCACGAACTCGA I A G T R P R G L N P D G S I N H E L D I A G T R P R G L N P D G S I N H E L D TATTCGTGCCGAGCTGGATATGCGAACTAACGTCAAGGAAATCGCCGAACATACTATGCT I R A E L D M R T N V K E I A E H T M L I R A E L D M R T N V K E I A E H T M L GGTTGATCTTGCGCGCAATGATCTTGCACGTGTTTCATTGCCCACAACACGTCGCGTTGC V D L A R N D L A R V S L P T T R R V A V D L A R N D L A R V S L P T T R R V A AGAGTTATTGCAGGTAGATCGCTACTCCCGAGTGATGCATCTCGTTAGCCGTGTGGTGGC E L L Q V D R Y S R V M H L V S R V V A E L L Q V D R Y S R V M H L V S R V V A TACGCTGGATCCAGAGTTCGATGCTATTGACGCCTACCGTGCCTGCATGAACATGGGAAC T L D P E F D A I D A Y R A C M N M G T T L D P E F D A I D A Y R A C M N M G T GCTAACCGGTGCACCAAAATTGCGCGCAATTGAATTACTGCGAGGGATAGAAGCTAAACG L T G A P K L R A I E L L R G I E A K R L T G A P K L R A I E L L R G I E A K R TCGCGGTTCCTATGGTGGTGCGGTTGGATACCTTCAAGGAGATGGCTCCATGGATACTTG R G S Y G G A V G Y L Q G D G S M D T C R G S Y G G A V G Y L Q G D G S M D T C CATTGTCATTCGTTCCGCTTTTATTCAGGATGGGGTAGCGGTGGTGCAGGCCGGTGCCGG I V I R S A F I Q D G V A V V Q A G A G I V I R S A F I Q D G V A V V Q A G A G AGTGGTGCGGGATTCTATTCCACAATCAGAGGCCGATGAAACACTCCATAAGGCCTATGC V V R D S I P Q S E A D E T L H K A Y A V V R D S I P Q S E A D E T L H K A Y A CATTTTGCATGCCATTGCGTTGGCGGCCGGAAAGGATCTGGAGGTGATTCGCTCATGA I L H A I A L A A G K D L E V I R S I L H A I A L A A G K D L E V I R S --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2244): ATGGCAGATTTCCATGTATCCGCCCGCAAGGTGCGCTATCACGAGGATGCCGCCGACATC M A D F H V S A R K V R Y H E D A A D I M A D F H A S A R E V R Y H E D A A D L TTCCATCATCTTGGCGGGACCTCGGCTAGCGATTCTGTTCTTTTAGAGTCTGCAGATATT F H H L G G T S A S D S V L L E S A D I F H H L G G T S A S D S V L L E S A D I GATTCTAAGAAGAACACCACATCCATGGCAGTACTTCAAGCAGCGGTTCGCGTGACATGC D S K K N T T S M A V L Q A A V R V T C K S K K N T T S M A V L Q S A V R V T C ATGGGGCAGACCGTGACAGCCACGCCCCTAACATCTACGGGCCATGCAATGGTGGCGCGC M G Q T V T A T P L T S T G H A M V A R M G Q T V T A T P L T S T G H T M V A R CTACAGGAGCACTTTGGCACGAGCGGCACGGAGTTCAGTTTTCATCGCTCCGAGCTTCAC L Q E H F G T S G T E F S F H R S E L H L Q E H F G T S G T K F S F R R S E L H GACGAACGCCAGCGCCTCCTTGACACCAATAATGCCGAGATTCTTCGCCTCCTACAGTGC D E R Q R L L D T N N A E I L R L L Q C D E R Q R L L D T N N A E I L R L L Q C GAGGCCGGCTATTCCGGTGAGCAGTTACCACTTCTTGCCGGCGGTTTCGCCTTTGATTAC E A G Y S G E Q L P L L A G G F A F D Y E A G Y S G E Q L P L L A G G F A F D Y ATGGAGACATTTGAGCAATTACCCTCTGTGCCAGTGGGGGATAATTCTTATCCCGATTAC M E T F E Q L P S V P V G D N S Y P D Y V E T F E Q L P P V P V G D N S Y P D Y CAGTTTGTGGTGGCAGAAACAGTGCTGGTCACCGATCATCTCAAGCGCAGCGCGGTCATC Q F V V A E T V L V T D H L K R S A V I Q F V V A E T V L V T D H L K R S A V I GAGGGCGTGTCCGTTGACCCTGCAGAGTTG*GG*GATCGACTAGATTCCCTTGTTGCCAC E G V S V D P A E L D R L D S L V A T E G V S I D P S E L *E** D R L D S L V A T GATTGACAGCCATAAAACAGTCGAGGAAGGTCCCGCGACCACGGCAACCAATGAGATATT I D S H K T V E E G P A T T A T N E I L I D S H E T V E E C P A T T A T N E I L GACTGTGCGTGCCGATATTTCTGATGTGGATTTTTGCCAAAGCGTAAGCGCACTGCAGGA T V R A D I S D V D F C Q S V S A L Q D T V R A D I S D V D F C Q S V S A L Q D CAATATCCAGGCGGGAGACATCTATCAGGCGGTTCCAGCACGCAGCTTTAGCGCGCCCTG N I Q A G D I Y Q A V P A R S F S A P C N I Q A G D I Y Q V V P A R S F S A P C TGAGAGTGCTTATGCAGCTTATAGACACTTGCGCACAATCAATCCCAGCCCCTATATGTT E S A Y A A Y R H L R T I N P S P Y M F E S A Y A A Y R H L R T I N P S P Y M F TTACGTGCGCGGCATTACCCCCATTTCATGCAATTCAAATAAAACATATGAGCTGATAGG Y V R G I T P I S C N S N K T Y E L I G Y V R G I T P I S C N S N K T Y E L I G AGCGTCGCCGGAGTCTAATCTCAAGTTCGATTCCAGAACACGCGAGGTACAATTGTATCC A S P E S N L K F D S R T R E V Q L Y P A S P E S N L K F D S R T R E I Q L Y P GATCGCCGGTACCCGGCCACGGGGACTTAACCCCGACGGGAGTATTAATCACGAACTCGA I A G T R P R G L N P D G S I N H E L D I A G T R P R G L N P D G S I N H E L D TATTCGTGCCGAGCTGGATATGCGAACTAACGTCAAGGAAATCGCCGAACATACTATGCT I R A E L D M R T N V K E I A E H T M L I R A E L D M R T N V K E I A E H T M L GGTTGATCTTGCGCGCAATGATCTTGCACGTGTTTCATTGCCCACAACACGTCGCGTTGC V D L A R N D L A R V S L P T T R R V A V D L A R N D L A R V S L P T T R R V A AGAGTTATTGCAGGTAGATCGCTACTCCCGAGTGATGCATCTCGTTAGCCGTGTGGTGGC E L L Q V D R Y S R V M H L V S R V V A E L L Q V D R Y S R V M H L V S R V V A TACGCTGGATCCAGAGTTCGATGCTATTGACGCCTACCGTGCCTGCATGAACATGGGAAC T L D P E F D A I D A Y R A C M N M G T T L D P E F D A I N A Y R A C M N M G T GCTAACCGGTGCACCAAAATTGCGCGCAATTGAATTACTGCGAGGGATAGAAGCTAAACG L T G A P K L R A I E L L R G I E A K R L T G A P K L R A I E L L R G V E A K R TCGCGGTTCCTATGGTGGTGCGGTTGGATACCTTCAAGGAGATGGCTCCATGGATACTTG R G S Y G G A V G Y L Q G D G S M D T C R G S Y G G A V G Y L Q G D G S M D T C CATTGTCATTCGTTCCGCTTTTATTCAGGATGGGGTAGCGGTGGTGCAGGCCGGTGCCGG I V I R S A F I Q D G V A V V Q A G A G I V I R S A F I Q D G V A V V Q A G A G AGTGGTGCGGGATTCTATTCCACAATCAGAGGCCGATGAAACACTCCATAAGGCCTATGC V V R D S I P Q S E A D E T L H K A Y A V V R D S I P Q S E A D E T L H K A Y A CATTTTGCATGCCATTGCGTTGGCGGCCGGAAAGGATCTGGAGGTGATTCGCTCATGA I L H A I A L A A G K D L E V I R V L H A I A L A A G K D L E V V R ------ // >fig|6666666.67454.peg.673 fig|257309.1.peg.716 Mobile element protein gi|372118535|gb|CP003217.1|_663757_663942,gi|372118535|gb|CP003217.1|_663944_664981,gi|372118535|gb|CP003217.1|_664981_665136 MNRSYTNTQKRTALRVYKRTQSVTKTVRELGYPGRWTLYKWLREPKTPPQPRKQAKTLTHYPYEVKLRAVELFHNGWRPADIAQECCLHTHASVYAWAQRYREEGQWGLMSKKERAGHGRIPTKAALEKSLPDNPTQLKQQMATLLVEKAVLEKELEIIKKDVSVIPGQLSNKHKTDVVDALRSTFPLAMLLAASGLAASSFYYHLKKRRMPDKHAAIRSMVHRISSDSHNTYGYRRIWWQLRHLGITISEKVVRRLMREEAITVRFPKRKVKYSSYQGEISPAPPNLVNRCFHATAANTLWLTDISVFAANEGRVYLSVIIDCFDGKVVAAKTSVNPTMELAESTLQAAIDAEGLPPDGSLVIHSDRGVHYRGRSWHSLTAKYGIVRSMSKKGCSPDNAACEGFSGxxKNEMYYGKRWQTIQELDDAIAAYIEFYNNHRIKVSLNGMSIARYRMAAVA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGC Y P Y E V K L R A V E L F H N G W R P A Y P - Y E V K L R A V E L F H N G W R P A TGATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACG D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R CTACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCG Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R CATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACA I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q GCAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGA K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D CGCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S CAGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAG S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S CATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W GCAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E AGAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E AATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATAC I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T GTTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGT L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V GATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTAT I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GGAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGG E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TTCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCT S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L GACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGC T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GGCATGCGAGGGTTTTTCGGGC*GG*ATGAAAAATGAGATGTATTACGGCAAGAGGTGGC A C E G F S G M K N E M Y Y G K R W A C E G F S G *X** X K N E M Y Y G K R W AGACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATC Q T I Q E L D D A I A A Y I E F Y N N H Q T I Q E L D D A I A A Y I E F Y N N H GCATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGT R I K V S L N G M S I A R Y R M A A V A R I K V S L N G M S I A R Y R M A A V A - GA -- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.716): ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGC Y P Y E V K L R A V E L F H N G W R P A Y P - Y E V K L R A V E L F H N G W R P A TGATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACG D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R CTACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCG Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R CATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACA I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q GCAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGA K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D CGCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S CAGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAG S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S CATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W GCAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E AGAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E AATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATAC I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T GTTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGT L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V GATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTAT I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GGAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGG E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TTCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCT S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L GACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGC T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GGCATGC*GA*GGGTTTTTCGGGCGGATGAAAAATGAGATGTATTACGGCAAGAGGTGGC A C G F F G R M K N E M Y Y G K R W A C *E** G F F G R M K N E M Y Y G K R W AGACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATC Q T I Q E L D D A I A A Y I E F Y N N H Q T I Q E L D D A I A A Y I E F Y N N H GCATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGT R I K V S L N G M S I A R Y R M A A V A R I K V S L N G M S I A R Y R M A A V A - GA -- // >fig|6666666.67454.peg.519 fig|257309.1.peg.568 No significant database matches FIG165996 gi|372118535|gb|CP003217.1|_506766_507017,gi|372118535|gb|CP003217.1|_507020_507535 MTGCSHRFYYNHMIQTSIRSFGVGEDLASMAVDERISLLRSRMQSIFKSGDFSLDYNCKTADKNIIPLSDPLSHVLPWGGLPRGxIVESTIAPLLAILFIAQVSGSGGRVGVVGWPDLNYAGVLGYGGCYERIFAVSQQERTSLRVVTALAHGCDLVITRAGPTPRTYTPLQTQRFRNSLRSDAGCVIMMGDHVVSPAARLASAVVGYHGIGKGTGRIKAVEITVTGIAKGFYRTSRVIVGKHIAPAAEKTTMKVV We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. TTGACGGGGTGTTCACATAGGTTCTATTATAACCACATGATTCAAACGAGTATTCGATCT L T G C S H R F Y Y N H M I Q T S I R S M T G C S H R F Y Y N H M I Q T S I R S TTTGGGGTGGGGGAGGATCTTGCCTCCATGGCTGTTGATGAGCGGATTTCTTTACTTCGT F G V G E D L A S M A V D E R I S L L R F G V G E D L A S M A V D E R I S L L R TCGCGCATGCAATCCATATTCAAAAGTGGGGATTTTTCTTTAGATTATAATTGTAAAACT S R M Q S I F K S G D F S L D Y N C K T S R M Q S I F K S G D F S L D Y N C K T GCAGATAAAAACATTATTCCGTTATCTGATCCACTGTCCCACGTGTTGCCGTGGGGTGGG A D K N I I P L S D P L S H V L P W G G A D K N I I P L S D P L S H V L P W G G CTGCCTCGGGGG*TG*ATTGTAGAGTCTACTATTGCCCCATTACTTGCTATTTTATTTAT L P R G I V E S T I A P L L A I L F I L P R G *X** I V E S T I A P L L A I L F I CGCACAAGTGAGCGGTTCTGGTGGGAGGGTGGGTGTTGTGGGTTGGCCAGATCTTAACTA A Q V S G S G G R V G V V G W P D L N Y A Q V S G S G G R V G V V G W P D L N Y TGCGGGTGTGCTGGGATACGGAGGTTGCTATGAGCGGATTTTTGCTGTTTCCCAGCAAGA A G V L G Y G G C Y E R I F A V S Q Q E A G V L G Y G G C Y E R I F A V S Q Q E ACGCACCTCATTACGTGTTGTTACAGCCCTTGCACACGGATGCGATCTTGTGATCACACG R T S L R V V T A L A H G C D L V I T R R T S L R V V T A L A H G C D L V I T R TGCAGGGCCTACTCCTAGGACGTACACGCCGCTCCAAACTCAACGATTTCGTAATTCTTT A G P T P R T Y T P L Q T Q R F R N S L A G P T P R T Y T P L Q T Q R F R N S L ACGATCAGATGCTGGCTGCGTGATCATGATGGGAGATCATGTCGTTTCACCTGCAGCGCG R S D A G C V I M M G D H V V S P A A R R S D A G C V I M M G D H V V S P A A R TTTAGCTTCCGCGGTGGTGGGATACCACGGGATTGGGAAAGGGACGGGGCGTATTAAGGC L A S A V V G Y H G I G K G T G R I K A L A S A V V G Y H G I G K G T G R I K A TGTAGAAATCACCGTAACTGGCATAGCCAAGGGTTTTTATCGAACTTCGAGAGTCATAGT V E I T V T G I A K G F Y R T S R V I V V E I T V T G I A K G F Y R T S R V I V CGGCAAGCACATAGCTCCTGCTGCTGAGAAAACAACGATGAAAGTGGTCTAA G K H I A P A A E K T T M K V V G K H I A P A A E K T T M K V V --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.568): TTGACGGGGTGTTCACATAGGTTCTATTATAACCACATGATTCAAACGAGTATTCGATCT L T G C S H R F Y Y N H M I Q T S I R S M T G C S H R F Y Y S H M I Q T S V R S TTTGGGGTGGGGGAGGATCTTGCCTCCATGGCTGTTGATGAGCGGATTTCTTTACTTCGT F G V G E D L A S M A V D E R I S L L R F E V G E D L A S M A V D E R I S L L R TCGCGCATGCAATCCATATTCAAAAGTGGGGATTTTTCTTTAGATTATAATTGTAAAACT S R M Q S I F K S G D F S L D Y N C K T S R M Q S I S K S G D F S L D Y N C K T GCAGATAAAAACATTATTCCGTTATCTGATCCACTGTCCCACGTGTTGCCGTGGGGTGGG A D K N I I P L S D P L S H V L P W G G A D K N I I P L S D P L S H V L P W G G CTGCCTCGGGGG*TG*ATTGTAGAGTCTACTATTGCCCCATTACTTGCTATTTTATTTAT L P R G I V E S T I A P L L A I L F I L P R G *M** I V E S T I T P L L A I L F I CGCACAAGTGAGCGGTTCTGGTGGGAGGGTGGGTGTTGTGGGTTGGCCAGATCTTAACTA A Q V S G S G G R V G V V G W P D L N Y A Q V S G S G R R V G V V G W P D L N Y TGCGGGTGTGCTGGGATACGGAGGTTGCTATGAGCGGATTTTTGCTGTTTCCCAGCAAGA A G V L G Y G G C Y E R I F A V S Q Q E A G V L G Y G G C Y E R I F A V P Q Q E ACGCACCTCATTACGTGTTGTTACAGCCCTTGCACACGGATGCGATCTTGTGATCACACG R T S L R V V T A L A H G C D L V I T R R T S L R V V T A L A H G C D L V I T R TGCAGGGCCTACTCCTAGGACGTACACGCCGCTCCAAACTCAACGATTTCGTAATTCTTT A G P T P R T Y T P L Q T Q R F R N S L A G P T P R T Y T P L Q T Q R F R N S L ACGATCAGATGCTGGCTGCGTGATCATGATGGGAGATCATGTCGTTTCACCTGCAGCGCG R S D A G C V I M M G D H V V S P A A R R S D A G C V I M M G D H V V S P A A R TTTAGCTTCCGCGGTGGTGGGATACCACGGGATTGGGAAAGGGACGGGGCGTATTAAGGC L A S A V V G Y H G I G K G T G R I K A L A S A V V G Y H G I G K G T G R I K A TGTAGAAATCACCGTAACTGGCATAGCCAAGGGTTTTTATCGAACTTCGAGAGTCATAGT V E I T V T G I A K G F Y R T S R V I V V E I T V T G I A K G F Y R T S R V I V CGGCAAGCACATAGCTCCTGCTGCTGAGAAAACAACGATGAAAGTGGTCTAA G K H I A P A A E K T T M K V V G K H I A P A A E K T T M K V V --- // >fig|6666666.67454.peg.1476 fig|257309.1.peg.205 Putative secreted protein gi|372118535|gb|CP003217.1|_1500735_1500616,gi|372118535|gb|CP003217.1|_1500612_1500361 MPFYDWSKRGKGSECCCCVVKWCGTSYNPIRWLRISVVKAxSDTQTVKGLRMDAMGECIDKMQADSGDERAKPRGVAVNNHRLYLALVTAVKHLEQLIRWADGGTKSPQPDDIDLDEIKDLLKE We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCCGTTCTATGATTGGAGCAAAAGAGGGAAAGGCTCTGAGTGTTGTTGCTGCGTTGTT V P F Y D W S K R G K G S E C C C C V V M P F Y D W S K R G K G S E C C C C V V AAGTGGTGTGGGACCTCTTATAACCCCATTAGGTGGTTGCGGATCAGTGTGGTGAAAGCT K W C G T S Y N P I R W L R I S V V K A K W C G T S Y N P I R W L R I S V V K A TGATCGGATACACAAACCGTGAAAGGTTTGCGCATGGATGCCATGGGGGAATGTATTGAT * S D T Q T V K G L R M D A M G E C I D X S D T Q T V K G L R M D A M G E C I D AAGATGCAGGCTGATTCGGGTGATGAGCGCGCTAAGCCTCGTGGTGTGGCGGTAAATAAT K M Q A D S G D E R A K P R G V A V N N K M Q A D S G D E R A K P R G V A V N N CACCGGCTGTACCTAGCGTTAGTGACTGCGGTGAAGCATTTAGAGCAGCTGATTCGGTGG H R L Y L A L V T A V K H L E Q L I R W H R L Y L A L V T A V K H L E Q L I R W GCCGATGGTGGTACTAAGTCGCCTCAGCCGGATGATATTGATCTAGATGAGATTAAAGAC A D G G T K S P Q P D D I D L D E I K D A D G G T K S P Q P D D I D L D E I K D TTACTCAAGGAATAA L L K E L L K E --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.205): GTGCCGTTCTATGATTGGAGCAAAAGAGGGAAAGGCTCTGAGTGTTGTTGCTGCGTTGTT L S V V A A L L ------------------------------------- M S V V A A F L AAGTGGTGTGGGACCTCTTATAACCCCATTAGGTGGTTGC*GG*ATCAGTGTGGTGAAAG S G V G P L I T P L G G C I S V V K S G V G A L V T A L G G V *L** I G V V K CTTGATCGGATACACAAACCGTGAAAGGTTTGCGCATGGATGCCATGGGGGAATGTATTG A * S D T Q T V K G L R M D A M G E C I A R S D T H T A K G S R M D V L E A R I ATAAGATGCAGGCTGATTCGGGTGATGAGCGCGCTAAGCCTCGTGGTGTGGCGGTAAATA D K M Q A D S G D E R A K P R G V A V N D K M Q A D L D D E R A R R R G V E V D ATCACCGGCTGTACCTAGCGTTAGTGACTGCGGTGAAGCATTTAGAGCAGCTGATTCGGT N H R L Y L A L V T A V K H L E Q L I R N H R L R M A L V T A V K H L E Q L I R GGGCCGATGGTGGTACTAAGTCGCCTCAGCCGGATGATATTGATCTAGATGAGATTAAAG W A D G G T K S P Q P D D I D L D E I K W A D G G A K P P R P D D I D L D E I K ACTTACTCAAGGAATAA D L L K E S L L K A --- // >fig|6666666.67454.peg.1733 fig|257309.1.peg.726 Putative transposase gi|372118535|gb|CP003217.1|_1769865_1770302,gi|372118535|gb|CP003217.1|_1770302_1771177 MQRQFWGLIATGITTAQAALQVGVSVPVGTRWFRHAGGMRPLALDEPSGRYLSFTEREEIAILWEKQTGVREIARRIGRNPATISRELRRNTATRGGKQIYRAGVAQWKAQEAAKRPKQAKLVDNPRLRDYVQERLAGTVRDETGxxMAGPDTPAWKGRSKPHRADRRWLTAWSPEQISQRLRIDFPDDESMRISHEAIYQALYIEGRGALKRELVAALRTGRALRKPRARSKSKPKGHLTADVVISNRPPEASDRAVPGHWEGDLIIGTGRSAIGTVVERYSRSILLVHLPRLDGWGEQPRTKNGPALGGYGAEAMNTALQTVMKDLPLQLRQTLTWDRGTELADHAAFTLATGTKVFFADPHSPWQRPTNENSNGLLRQYFPKGTDLSRWTAQDLAAIAYTLNNRPRKVLGFRTPAEVFNEQLQSIQNNSVATTD We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCAACGCCAGTTCTGGGGTCTGATCGCGACGGGAATCACCACTGCGCAGGCCGCCCTT V Q R Q F W G L I A T G I T T A Q A A L M Q R Q F W G L I A T G I T T A Q A A L CAGGTGGGGGTGTCCGTACCGGTGGGAACGAGGTGGTTCCGTCATGCTGGTGGAATGAGA Q V G V S V P V G T R W F R H A G G M R Q V G V S V P V G T R W F R H A G G M R CCGTTAGCTTTGGACGAGCCCTCGGGGCGGTATCTATCGTTTACTGAACGAGAGGAAATC P L A L D E P S G R Y L S F T E R E E I P L A L D E P S G R Y L S F T E R E E I GCGATCCTGTGGGAGAAACAGACGGGTGTGCGTGAGATCGCTCGACGGATTGGCCGCAAT A I L W E K Q T G V R E I A R R I G R N A I L W E K Q T G V R E I A R R I G R N CCGGCGACGATTTCTCGTGAGCTACGGCGTAATACTGCCACCCGTGGTGGCAAGCAGATT P A T I S R E L R R N T A T R G G K Q I P A T I S R E L R R N T A T R G G K Q I TATCGGGCAGGGGTGGCCCAGTGGAAAGCTCAGGAAGCCGCTAAGCGTCCCAAACAAGCA Y R A G V A Q W K A Q E A A K R P K Q A Y R A G V A Q W K A Q E A A K R P K Q A AAACTCGTGGATAATCCGCGCCTGCGGGACTATGTTCAGGAGCGTCTTGCTGGGACGGTC K L V D N P R L R D Y V Q E R L A G T V K L V D N P R L R D Y V Q E R L A G T V CGAGATGAAACGGGG*TC*GTCATGGCGGGGCCTGATACGCCTGCGTGGAAGGGCCGGAG R D E T G V M A G P D T P A W K G R S R D E T G *X** X M A G P D T P A W K G R S CAAACCTCACAGGGCAGACCGACGGTGGTTGACCGCGTGGAGCCCGGAGCAGATATCGCA K P H R A D R R W L T A W S P E Q I S Q K P H R A D R R W L T A W S P E Q I S Q GCGGTTAAGGATCGACTTCCCTGATGATGAGAGTATGAGAATCTCCCATGAAGCGATCTA R L R I D F P D D E S M R I S H E A I Y R L R I D F P D D E S M R I S H E A I Y CCAGGCGCTCTATATTGAGGGGCGCGGGGCGCTGAAGCGTGAACTCGTGGCCGCACTGCG Q A L Y I E G R G A L K R E L V A A L R Q A L Y I E G R G A L K R E L V A A L R GACTGGGCGGGCCCTGCGTAAACCCCGCGCCCGGTCCAAGAGCAAGCCTAAAGGTCATCT T G R A L R K P R A R S K S K P K G H L T G R A L R K P R A R S K S K P K G H L CACCGCCGATGTTGTCATCTCTAACCGGCCCCCGGAAGCCTCGGATCGGGCGGTGCCCGG T A D V V I S N R P P E A S D R A V P G T A D V V I S N R P P E A S D R A V P G GCATTGGGAAGGAGACTTGATCATCGGTACCGGCAGGTCAGCGATCGGGACCGTGGTCGA H W E G D L I I G T G R S A I G T V V E H W E G D L I I G T G R S A I G T V V E ACGCTACAGCCGGTCGATCCTGCTGGTGCACCTGCCCCGGTTGGACGGCTGGGGTGAACA R Y S R S I L L V H L P R L D G W G E Q R Y S R S I L L V H L P R L D G W G E Q ACCAAGGACGAAGAACGGACCTGCCTTGGGTGGGTACGGTGCTGAAGCGATGAACACCGC P R T K N G P A L G G Y G A E A M N T A P R T K N G P A L G G Y G A E A M N T A CCTACAAACCGTGATGAAAGATCTACCGTTACAACTGCGTCAAACGTTGACCTGGGACCG L Q T V M K D L P L Q L R Q T L T W D R L Q T V M K D L P L Q L R Q T L T W D R CGGAACCGAGCTCGCTGACCATGCCGCTTTCACTCTAGCCACGGGCACGAAAGTGTTCTT G T E L A D H A A F T L A T G T K V F F G T E L A D H A A F T L A T G T K V F F CGCGGACCCACACTCGCCATGGCAACGTCCCACGAATGAGAACAGCAACGGACTCCTACG A D P H S P W Q R P T N E N S N G L L R A D P H S P W Q R P T N E N S N G L L R CCAGTACTTTCCCAAGGGTACCGACCTGTCTCGATGGACAGCCCAAGACCTCGCCGCCAT Q Y F P K G T D L S R W T A Q D L A A I Q Y F P K G T D L S R W T A Q D L A A I CGCCTACACGCTCAACAACAGACCAAGAAAAGTCCTTGGATTTCGAACCCCAGCCGAAGT A Y T L N N R P R K V L G F R T P A E V A Y T L N N R P R K V L G F R T P A E V CTTCAATGAACAACTACAATCAATTCAAAACAACAGTGTTGCAACCACCGATTGA F N E Q L Q S I Q N N S V A T T D F N E Q L Q S I Q N N S V A T T D --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.726): GTGCAACGCCAGTTCTGGGGTCTGATCGCGACGGGAATCACCACTGCGCAGGCCGCCCTT V Q R Q F W G L I A T G I T T A Q A A L M Q R Q F W G L I A T G I T T A Q A A L CAGGTGGGGGTGTCCGTACCGGTGGGAACGAGGTGGTTCCGTCATGCTGGTGGAATGAGA Q V G V S V P V G T R W F R H A G G M R Q V G V S V P V G T R W F R H A G G M R CCGTTAGCTTTGGACGAGCCCTCGGGGCGGTATCTATCGTTTACTGAACGAGAGGAAATC P L A L D E P S G R Y L S F T E R E E I P L A L D E P S G R Y L S F A E R E E I GCGATCCTGTGGGAGAAACAGACGGGTGTGCGTGAGATCGCTCGACGGATTGGCCGCAAT A I L W E K Q T G V R E I A R R I G R N A I L W E K Q T G V R E I A R R I G R N CCGGCGACGATTTCTCGTGAGCTACGGCGTAATACTGCCACCCGTGGTGGCAAGCAGATT P A T I S R E L R R N T A T R G G K Q I P A T I S R E L R R N A A T R G G K Q I TATCGGGCAGGGGTGGCCCAGTGGAAAGCTCAGGAAGCCGCTAAGCGTCCCAAACAAGCA Y R A G V A Q W K A Q E A A K R P K Q A Y R V G V A Q W K A Q E A A K R P K Q A AAACTCGTGGATAATCCGCGCCTGCGGGACTATGTTCAGGAGCGTCTTGCTGGGACGGTC K L V D N P R L R D Y V Q E R L A G T V K L V D N P R L R D Y V Q E R L A G T V CGAGAT*GA*AACGGGGTCGTCATGGCGGGGCCTGATACGCCTGCGTGGAAGGGCCGGAG R D N G V V M A G P D T P A W K G R S R D *E** N G V V M A G P D T P A W K G R S CAAACCTCACAGGGCAGACCGACGGTGGTTGACCGCGTGGAGCCCGGAGCAGATATCGCA K P H R A D R R W L T A W S P E Q I S Q K P H R A D R R W L T A W S P E Q I S Q GCGGTTAAGGATCGACTTCCCTGATGATGAGAGTATGAGAATCTCCCATGAAGCGATCTA R L R I D F P D D E S M R I S H E A I Y R L R I D F P D D E S M R I S H E A I Y CCAGGCGCTCTATATTGAGGGGCGCGGGGCGCTGAAGCGTGAACTCGTGGCCGCACTGCG Q A L Y I E G R G A L K R E L V A A L R Q A L Y I E G R G A L K R E L V A A L R GACTGGGCGGGCCCTGCGTAAACCCCGCGCCCGGTCCAAGAGCAAGCCTAAAGGTCATCT T G R A L R K P R A R S K S K P K G H L T G R A L R K P R A R S K S K P K G H V CACCGCCGATGTTGTCATCTCTAACCGGCCCCCGGAAGCCTCGGATCGGGCGGTGCCCGG T A D V V I S N R P P E A S D R A V P G T A D V V I S N R P P E A S D R A V P G GCATTGGGAAGGAGACTTGATCATCGGTACCGGCAGGTCAGCGATCGGGACCGTGGTCGA H W E G D L I I G T G R S A I G T V V E H W E G D L I I G T G R S A I G T V V E ACGCTACAGCCGGTCGATCCTGCTGGTGCACCTGCCCCGGTTGGACGGCTGGGGTGAACA R Y S R S I L L V H L P R L D G W G E Q R Y S R S I L L V H L P R L D G W G E Q ACCAAGGACGAAGAACGGACCTGCCTTGGGTGGGTACGGTGCTGAAGCGATGAACACCGC P R T K N G P A L G G Y G A E A M N T A P R T K N G P A L G G Y G A E A M N T A CCTACAAACCGTGATGAAAGATCTACCGTTACAACTGCGTCAAACGTTGACCTGGGACCG L Q T V M K D L P L Q L R Q T L T W D R L Q T V M K D L P L Q L R Q T L T W D R CGGAACCGAGCTCGCTGACCATGCCGCTTTCACTCTAGCCACGGGCACGAAAGTGTTCTT G T E L A D H A A F T L A T G T K V F F G T E L A D H A A F T L A T G T K V F F CGCGGACCCACACTCGCCATGGCAACGTCCCACGAATGAGAACAGCAACGGACTCCTACG A D P H S P W Q R P T N E N S N G L L R A D P H S P W Q R P T N E N S N G L L R CCAGTACTTTCCCAAGGGTACCGACCTGTCTCGATGGACAGCCCAAGACCTCGCCGCCAT Q Y F P K G T D L S R W T A Q D L A A I Q Y F P K G T D L S R W T A Q D L A A I CGCCTACACGCTCAACAACAGACCAAGAAAAGTCCTTGGATTTCGAACCCCAGCCGAAGT A Y T L N N R P R K V L G F R T P A E V A Y T L N N R P R K V L G F R T P A E V CTTCAATGAACAACTACAATCAATTCAAAACAACAGTGTTGCAACCACCGATTGA F N E Q L Q S I Q N N S V A T T D F N E Q L Q S I Q N N S V A T T D --- // >fig|6666666.67454.peg.686 fig|257309.1.peg.726 Putative transposase gi|372118535|gb|CP003217.1|_679178_678741,gi|372118535|gb|CP003217.1|_678741_677866 MQRQFWGLIATGITTAQAALQVGVSVPVGTRWFRHAGGMRPLALDEPSGRYLSFTEREEIAILWEKQTGVREIARRIGRNPATISRELRRNTATRGGKQIYRAGVAQWKAQEAAKRPKQAKLVDNPRLRDYVQERLAGTVRDETGxxMAGPDTPAWKGRSKPHRADRRWLTAWSPEQISQRLRIDFPDDESMRISHEAIYQALYIEGRGALKRELVAALRTGRALRKPRARSKSKPKGHLTADVVISNRPPEASDRAVPGHWEGDLIIGTGRSAIGTVVERYSRSILLVHLPRLDGWGEQPRTKNGPALGGYGAEAMNTALQTVMKDLPLQLRQTLTWDRGTELADHAAFTLATGTKVFFADPHSPWQRPTNENSNGLLRQYFPKGTDLSRWTAQDLAAIAYTLNNRPRKVLGFRTPAEVFNEQLQSIQNNSVATTD We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGCAACGCCAGTTCTGGGGTCTGATCGCGACGGGAATCACCACTGCGCAGGCCGCCCTT V Q R Q F W G L I A T G I T T A Q A A L M Q R Q F W G L I A T G I T T A Q A A L CAGGTGGGGGTGTCCGTACCGGTGGGAACGAGGTGGTTCCGTCATGCTGGTGGAATGAGA Q V G V S V P V G T R W F R H A G G M R Q V G V S V P V G T R W F R H A G G M R CCGTTAGCTTTGGACGAGCCCTCGGGGCGGTATCTATCGTTTACTGAACGAGAGGAAATC P L A L D E P S G R Y L S F T E R E E I P L A L D E P S G R Y L S F T E R E E I GCGATCCTGTGGGAGAAACAGACGGGTGTGCGTGAGATCGCTCGACGGATTGGCCGCAAT A I L W E K Q T G V R E I A R R I G R N A I L W E K Q T G V R E I A R R I G R N CCGGCGACGATTTCTCGTGAGCTACGGCGTAATACTGCCACCCGTGGTGGCAAGCAGATT P A T I S R E L R R N T A T R G G K Q I P A T I S R E L R R N T A T R G G K Q I TATCGGGCAGGGGTGGCCCAGTGGAAAGCTCAGGAAGCCGCTAAGCGTCCCAAACAAGCA Y R A G V A Q W K A Q E A A K R P K Q A Y R A G V A Q W K A Q E A A K R P K Q A AAACTCGTGGATAATCCGCGCCTGCGGGACTATGTTCAGGAGCGTCTTGCTGGGACGGTC K L V D N P R L R D Y V Q E R L A G T V K L V D N P R L R D Y V Q E R L A G T V CGAGATGAAACGGGG*TC*GTCATGGCGGGGCCTGATACGCCTGCGTGGAAGGGCCGGAG R D E T G V M A G P D T P A W K G R S R D E T G *X** X M A G P D T P A W K G R S CAAACCTCACAGGGCAGACCGACGGTGGTTGACCGCGTGGAGCCCGGAGCAGATATCGCA K P H R A D R R W L T A W S P E Q I S Q K P H R A D R R W L T A W S P E Q I S Q GCGGTTAAGGATCGACTTCCCTGATGATGAGAGTATGAGAATCTCCCATGAAGCGATCTA R L R I D F P D D E S M R I S H E A I Y R L R I D F P D D E S M R I S H E A I Y CCAGGCGCTCTATATTGAGGGGCGCGGGGCGCTGAAGCGTGAACTCGTGGCCGCACTGCG Q A L Y I E G R G A L K R E L V A A L R Q A L Y I E G R G A L K R E L V A A L R GACTGGGCGGGCCCTGCGTAAACCCCGCGCCCGGTCCAAGAGCAAGCCTAAAGGTCATCT T G R A L R K P R A R S K S K P K G H L T G R A L R K P R A R S K S K P K G H L CACCGCCGATGTTGTCATCTCTAACCGGCCCCCGGAAGCCTCGGATCGGGCGGTGCCCGG T A D V V I S N R P P E A S D R A V P G T A D V V I S N R P P E A S D R A V P G GCATTGGGAAGGAGACTTGATCATCGGTACCGGCAGGTCAGCGATCGGGACCGTGGTCGA H W E G D L I I G T G R S A I G T V V E H W E G D L I I G T G R S A I G T V V E ACGCTACAGCCGGTCGATCCTGCTGGTGCACCTGCCCCGGTTGGACGGCTGGGGTGAACA R Y S R S I L L V H L P R L D G W G E Q R Y S R S I L L V H L P R L D G W G E Q ACCAAGGACGAAGAACGGACCTGCCTTGGGTGGGTACGGTGCTGAAGCGATGAACACCGC P R T K N G P A L G G Y G A E A M N T A P R T K N G P A L G G Y G A E A M N T A CCTACAAACCGTGATGAAAGATCTACCGTTACAACTGCGTCAAACGTTGACCTGGGACCG L Q T V M K D L P L Q L R Q T L T W D R L Q T V M K D L P L Q L R Q T L T W D R CGGAACCGAGCTCGCTGACCATGCCGCTTTCACTCTAGCCACGGGCACGAAAGTGTTCTT G T E L A D H A A F T L A T G T K V F F G T E L A D H A A F T L A T G T K V F F CGCGGACCCACACTCGCCATGGCAACGTCCCACGAATGAGAACAGCAACGGACTCCTACG A D P H S P W Q R P T N E N S N G L L R A D P H S P W Q R P T N E N S N G L L R CCAGTACTTTCCCAAGGGTACCGACCTGTCTCGATGGACAGCCCAAGACCTCGCCGCCAT Q Y F P K G T D L S R W T A Q D L A A I Q Y F P K G T D L S R W T A Q D L A A I CGCCTACACGCTCAACAACAGACCAAGAAAAGTCCTTGGATTTCGAACCCCAGCCGAAGT A Y T L N N R P R K V L G F R T P A E V A Y T L N N R P R K V L G F R T P A E V CTTCAATGAACAACTACAATCAATTCAAAACAACAGTGTTGCAACCACCGATTGA F N E Q L Q S I Q N N S V A T T D F N E Q L Q S I Q N N S V A T T D --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.726): GTGCAACGCCAGTTCTGGGGTCTGATCGCGACGGGAATCACCACTGCGCAGGCCGCCCTT V Q R Q F W G L I A T G I T T A Q A A L M Q R Q F W G L I A T G I T T A Q A A L CAGGTGGGGGTGTCCGTACCGGTGGGAACGAGGTGGTTCCGTCATGCTGGTGGAATGAGA Q V G V S V P V G T R W F R H A G G M R Q V G V S V P V G T R W F R H A G G M R CCGTTAGCTTTGGACGAGCCCTCGGGGCGGTATCTATCGTTTACTGAACGAGAGGAAATC P L A L D E P S G R Y L S F T E R E E I P L A L D E P S G R Y L S F A E R E E I GCGATCCTGTGGGAGAAACAGACGGGTGTGCGTGAGATCGCTCGACGGATTGGCCGCAAT A I L W E K Q T G V R E I A R R I G R N A I L W E K Q T G V R E I A R R I G R N CCGGCGACGATTTCTCGTGAGCTACGGCGTAATACTGCCACCCGTGGTGGCAAGCAGATT P A T I S R E L R R N T A T R G G K Q I P A T I S R E L R R N A A T R G G K Q I TATCGGGCAGGGGTGGCCCAGTGGAAAGCTCAGGAAGCCGCTAAGCGTCCCAAACAAGCA Y R A G V A Q W K A Q E A A K R P K Q A Y R V G V A Q W K A Q E A A K R P K Q A AAACTCGTGGATAATCCGCGCCTGCGGGACTATGTTCAGGAGCGTCTTGCTGGGACGGTC K L V D N P R L R D Y V Q E R L A G T V K L V D N P R L R D Y V Q E R L A G T V CGAGAT*GA*AACGGGGTCGTCATGGCGGGGCCTGATACGCCTGCGTGGAAGGGCCGGAG R D N G V V M A G P D T P A W K G R S R D *E** N G V V M A G P D T P A W K G R S CAAACCTCACAGGGCAGACCGACGGTGGTTGACCGCGTGGAGCCCGGAGCAGATATCGCA K P H R A D R R W L T A W S P E Q I S Q K P H R A D R R W L T A W S P E Q I S Q GCGGTTAAGGATCGACTTCCCTGATGATGAGAGTATGAGAATCTCCCATGAAGCGATCTA R L R I D F P D D E S M R I S H E A I Y R L R I D F P D D E S M R I S H E A I Y CCAGGCGCTCTATATTGAGGGGCGCGGGGCGCTGAAGCGTGAACTCGTGGCCGCACTGCG Q A L Y I E G R G A L K R E L V A A L R Q A L Y I E G R G A L K R E L V A A L R GACTGGGCGGGCCCTGCGTAAACCCCGCGCCCGGTCCAAGAGCAAGCCTAAAGGTCATCT T G R A L R K P R A R S K S K P K G H L T G R A L R K P R A R S K S K P K G H V CACCGCCGATGTTGTCATCTCTAACCGGCCCCCGGAAGCCTCGGATCGGGCGGTGCCCGG T A D V V I S N R P P E A S D R A V P G T A D V V I S N R P P E A S D R A V P G GCATTGGGAAGGAGACTTGATCATCGGTACCGGCAGGTCAGCGATCGGGACCGTGGTCGA H W E G D L I I G T G R S A I G T V V E H W E G D L I I G T G R S A I G T V V E ACGCTACAGCCGGTCGATCCTGCTGGTGCACCTGCCCCGGTTGGACGGCTGGGGTGAACA R Y S R S I L L V H L P R L D G W G E Q R Y S R S I L L V H L P R L D G W G E Q ACCAAGGACGAAGAACGGACCTGCCTTGGGTGGGTACGGTGCTGAAGCGATGAACACCGC P R T K N G P A L G G Y G A E A M N T A P R T K N G P A L G G Y G A E A M N T A CCTACAAACCGTGATGAAAGATCTACCGTTACAACTGCGTCAAACGTTGACCTGGGACCG L Q T V M K D L P L Q L R Q T L T W D R L Q T V M K D L P L Q L R Q T L T W D R CGGAACCGAGCTCGCTGACCATGCCGCTTTCACTCTAGCCACGGGCACGAAAGTGTTCTT G T E L A D H A A F T L A T G T K V F F G T E L A D H A A F T L A T G T K V F F CGCGGACCCACACTCGCCATGGCAACGTCCCACGAATGAGAACAGCAACGGACTCCTACG A D P H S P W Q R P T N E N S N G L L R A D P H S P W Q R P T N E N S N G L L R CCAGTACTTTCCCAAGGGTACCGACCTGTCTCGATGGACAGCCCAAGACCTCGCCGCCAT Q Y F P K G T D L S R W T A Q D L A A I Q Y F P K G T D L S R W T A Q D L A A I CGCCTACACGCTCAACAACAGACCAAGAAAAGTCCTTGGATTTCGAACCCCAGCCGAAGT A Y T L N N R P R K V L G F R T P A E V A Y T L N N R P R K V L G F R T P A E V CTTCAATGAACAACTACAATCAATTCAAAACAACAGTGTTGCAACCACCGATTGA F N E Q L Q S I Q N N S V A T T D F N E Q L Q S I Q N N S V A T T D --- // >fig|6666666.67454.peg.2141 fig|257309.1.peg.2104 Putative DNA-binding protein FIG141428 gi|372118535|gb|CP003217.1|_2204948_2204838,gi|372118535|gb|CP003217.1|_2204834_2203923 MTTMRTGSQIFMRSGRWNELWKEKKCSTAIYQPQHQFxWIGAEKAEIEVVDSQEKSLVTRNMQIIPWQHDIANLHLPKRDSLILMPCATRTVGRRLAARNIGLADTRGNCDISWPGVMIKIYGQQAVTSARSHQKTAVLFSVRRAQVAAMVLTYPWLLSEPVRVIARYSGVSVGTVSNALKIFQKAGYLAETMDGHRLVNAELFLSAWARAYPTGLGADLELLRGKAQQLPPYNLEHLGVKASESAVSDHISDGQSASLYLGEETFSPKVIKELRLVKNPAGTITLRRAFWNTIDVKEIPEAIVYADLLNSDDARLWDVAQVIKAIILKRARGDWLGDQDG We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACCACTATGCGAACTGGCTCGCAAATATTCATGCGCTCGGGGCGATGGAACGAGTTA M T T M R T G S Q I F M R S G R W N E L M T T M R T G S Q I F M R S G R W N E L TGGAAAGAAAAAAAATGTTCCACTGCGATTTACCAACCCCAACATCAGTTTTGATGGATC W K E K K C S T A I Y Q P Q H Q F * W I W K E K K C S T A I Y Q P Q H Q F X W I GGAGCGGAAAAAGCTGAAATTGAAGTAGTCGATTCACAAGAGAAAAGCCTTGTTACACGG G A E K A E I E V V D S Q E K S L V T R G A E K A E I E V V D S Q E K S L V T R AATATGCAGATCATTCCGTGGCAGCATGACATAGCGAATCTTCACCTGCCAAAAAGAGAT N M Q I I P W Q H D I A N L H L P K R D N M Q I I P W Q H D I A N L H L P K R D TCGCTCATACTAATGCCATGCGCCACTAGAACAGTAGGACGGCGGCTTGCGGCAAGAAAT S L I L M P C A T R T V G R R L A A R N S L I L M P C A T R T V G R R L A A R N ATCGGATTAGCTGACACACGTGGCAATTGCGATATTTCATGGCCAGGCGTGATGATTAAA I G L A D T R G N C D I S W P G V M I K I G L A D T R G N C D I S W P G V M I K ATCTATGGTCAGCAAGCTGTTACTAGTGCGCGATCCCACCAAAAAACCGCAGTGCTTTTT I Y G Q Q A V T S A R S H Q K T A V L F I Y G Q Q A V T S A R S H Q K T A V L F AGCGTGCGACGTGCCCAAGTCGCCGCGATGGTATTGACGTATCCATGGCTACTGTCGGAG S V R R A Q V A A M V L T Y P W L L S E S V R R A Q V A A M V L T Y P W L L S E CCAGTTCGAGTGATAGCCCGATACTCGGGAGTCTCCGTAGGCACCGTAAGCAACGCCCTC P V R V I A R Y S G V S V G T V S N A L P V R V I A R Y S G V S V G T V S N A L AAGATTTTCCAAAAAGCAGGTTATCTTGCCGAAACCATGGACGGGCACCGACTAGTCAAC K I F Q K A G Y L A E T M D G H R L V N K I F Q K A G Y L A E T M D G H R L V N GCGGAATTATTTCTTAGCGCTTGGGCCCGTGCGTATCCCACAGGGCTGGGAGCAGATCTA A E L F L S A W A R A Y P T G L G A D L A E L F L S A W A R A Y P T G L G A D L GAGTTGCTGCGCGGAAAAGCACAACAACTGCCTCCATATAACCTTGAACATTTGGGTGTT E L L R G K A Q Q L P P Y N L E H L G V E L L R G K A Q Q L P P Y N L E H L G V AAGGCAAGCGAAAGCGCAGTATCAGACCACATTTCTGATGGACAATCTGCTTCGCTATAC K A S E S A V S D H I S D G Q S A S L Y K A S E S A V S D H I S D G Q S A S L Y CTAGGAGAAGAAACCTTTTCACCCAAAGTGATCAAGGAACTTAGACTGGTAAAAAACCCA L G E E T F S P K V I K E L R L V K N P L G E E T F S P K V I K E L R L V K N P GCTGGAACAATAACTTTGCGACGAGCTTTTTGGAATACGATAGATGTCAAAGAGATTCCA A G T I T L R R A F W N T I D V K E I P A G T I T L R R A F W N T I D V K E I P GAGGCGATTGTGTACGCCGATCTTCTTAATTCTGACGATGCCCGCCTTTGGGATGTTGCT E A I V Y A D L L N S D D A R L W D V A E A I V Y A D L L N S D D A R L W D V A CAAGTAATAAAAGCCATTATCCTTAAACGCGCAAGGGGAGACTGGTTAGGGGACCAAGAT Q V I K A I I L K R A R G D W L G D Q D Q V I K A I I L K R A R G D W L G D Q D GGATGA G G --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2104): ATGACCACTATGCGAACTGGCTCGCAAATATTCATGCGCTCGGGGCGATGGAACGAGTTA M T T M R T G S Q I F M R S G R W N E L M T T M R T G S Q I F M R S G Q W N E L TGGAAAGAAAAAAAATGTTCCACTGCGATTTACCAACCCCAACATCAGTTTTGATGGATC W K E K N V P L R F T N P N I S F D G S W K E K - N V P L R F T N P N I S F D G S GGAGCGG*AA*AAAGCTGAAATTGAAGTAGTCGATTCACAAGAGAAAAGCCTTGTTACAC E R K A E I E V V D S Q E K S L V T E R *T** K A E I E V V D S Q E K S L V T GGAATATGCAGATCATTCCGTGGCAGCATGACATAGCGAATCTTCACCTGCCAAAAAGAG R N M Q I I P W Q H D I A N L H L P K R R N M Q I I P W Q H D I A N L H L P E R ATTCGCTCATACTAATGCCATGCGCCACTAGAACAGTAGGACGGCGGCTTGCGGCAAGAA D S L I L M P C A T R T V G R R L A A R D S L I L M P C A T R T V G R R L T A R ATATCGGATTAGCTGACACACGTGGCAATTGCGATATTTCATGGCCAGGCGTGATGATTA N I G L A D T R G N C D I S W P G V M I N I G L A D T R G N C D I S W P G V M I AAATCTATGGTCAGCAAGCTGTTACTAGTGCGCGATCCCACCAAAAAACCGCAGTGCTTT K I Y G Q Q A V T S A R S H Q K T A V L K I Y G Q Q A V T S A R S H Q K T A V L TTAGCGTGCGACGTGCCCAAGTCGCCGCGATGGTATTGACGTATCCATGGCTACTGTCGG F S V R R A Q V A A M V L T Y P W L L S F S V R R A Q V A A M I L T Y P W L L S AGCCAGTTCGAGTGATAGCCCGATACTCGGGAGTCTCCGTAGGCACCGTAAGCAACGCCC E P V R V I A R Y S G V S V G T V S N A E P V R V I A R Y S G V S V G T V S N A TCAAGATTTTCCAAAAAGCAGGTTATCTTGCCGAAACCATGGACGGGCACCGACTAGTCA L K I F Q K A G Y L A E T M D G H R L V L K I F Q K A G Y L A E T M D G H R L V ACGCGGAATTATTTCTTAGCGCTTGGGCCCGTGCGTATCCCACAGGGCTGGGAGCAGATC N A E L F L S A W A R A Y P T G L G A D N A E L F L S A W A R A Y P T G L G A D TAGAGTTGCTGCGCGGAAAAGCACAACAACTGCCTCCATATAACCTTGAACATTTGGGTG L E L L R G K A Q Q L P P Y N L E H L G L E L L R G K A Q Q L P P Y N L E H L G TTAAGGCAAGCGAAAGCGCAGTATCAGACCACATTTCTGATGGACAATCTGCTTCGCTAT V K A S E S A V S D H I S D G Q S A S L V K A S E S A V S D H I S D G Q S A S L ACCTAGGAGAAGAAACCTTTTCACCCAAAGTGATCAAGGAACTTAGACTGGTAAAAAACC Y L G E E T F S P K V I K E L R L V K N Y L G E E T F S P K V I K E L R L V K N CAGCTGGAACAATAACTTTGCGACGAGCTTTTTGGAATACGATAGATGTCAAAGAGATTC P A G T I T L R R A F W N T I D V K E I P A G T I T L R R A F W N T I D V K E I CAGAGGCGATTGTGTACGCCGATCTTCTTAATTCTGACGATGCCCGCCTTTGGGATGTTG P E A I V Y A D L L N S D D A R L W D V P E A I V Y A D L L N S D D A R L W D V CTCAAGTAATAAAAGCCATTATCCTTAAACGCGCAAGGGGAGACTGGTTAGGGGACCAAG A Q V I K A I I L K R A R G D W L G D Q A Q I I K A I I L K R A R G D W L G D Q ATGGATGA D G D G --- // >fig|6666666.67454.peg.1284 fig|257309.1.peg.1299 COG0553: Superfamily II DNA/RNA helicases, SNF2 family FIG175904 gi|372118535|gb|CP003217.1|_1313949_1312963,gi|372118535|gb|CP003217.1|_1312959_1311295 MSTLRSQGTYLREVAQRAQLLLNSLLEPHEPARFNTHGKISDVWVVPQTAISWPPHLFTHEEFSEDHIEVTEILEKFIESTAGIVDLLHKTKIGVWSTLTRRVSSTANQQFESAATELENLLANPELQVQLSRVTEYLRRYDRAESAYKSGVHHFLVENQDSPYGKAVRSSLASAMQLPEVCIDNLSKEYVRPAILLCEQLRAHPLSPWTLQRKALQAENKIIQWRALALLSSLSIDSLSQVTSERVSVTAIKRQGITSVAEIISRSVEDLEQIPGVGQQTAKRVKAAAQTLYSEALAQPLSTLGSEQSTELEALLNILYHYGRSREALxDELDRIDRLERYLQPVITHEKALWRSIPPAYFVIYSKGSNGHNTAYLQFIDDISWANLALFIPNLLSEGQGSVDIWKDYCERPAHYQSLWSAIRGNDQTPYSQSGLSSETLERIRALKLNTSLLRDAFLRGYQSFGAKFVIVQRKVILGDEMGLGKTVQAIAAAAHVTAEKSSENPVKILIIVPASLMTNWAREWEKFCNIPVQIAHGENKQKAVAQWNDTAGALIVTYDGARTMQLLGATVVIVDEAHYIKNPEAKRSRAVSRIIAESEYVLLLSGTPLENRIEEFCTLVSYLDSHCAISAPRLASAFKAHIAHLYLRRNQGDVLDELPEKIDHTEWVELSAEDEHLYRQAVHERNWMLMRRVAMLAARPDCAKMERLIDIVKEAESVGKNVIIFSYFRSVLERIEKDLGEYVAGSITGDVPPERRQQLIDELGNTGRHVLLLQIVAGGVGLNIQKASVVIFTEAQVKPTLVDQAIARTHRMGQRDPVTVYRLFGADTVDERLTELLEHKRAVFDNYARDAEAAEVFDAVDVSEGALARNIIELEHDRLQIDN We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAGCACGCTGCGCTCCCAAGGAACGTACCTTAGGGAAGTCGCACAGCGTGCTCAATTA M S T L R S Q G T Y L R E V A Q R A Q L M S T L R S Q G T Y L R E V A Q R A Q L CTTCTGAACTCGCTACTAGAACCACATGAACCAGCAAGGTTCAACACTCATGGAAAAATC L L N S L L E P H E P A R F N T H G K I L L N S L L E P H E P A R F N T H G K I AGCGATGTATGGGTCGTACCTCAAACCGCTATATCTTGGCCCCCGCATCTATTCACCCAC S D V W V V P Q T A I S W P P H L F T H S D V W V V P Q T A I S W P P H L F T H GAAGAATTCTCCGAAGATCATATTGAAGTTACGGAAATCCTTGAAAAATTTATCGAGTCA E E F S E D H I E V T E I L E K F I E S E E F S E D H I E V T E I L E K F I E S ACGGCAGGAATCGTAGACCTTCTACACAAAACTAAAATTGGTGTATGGAGCACACTTACG T A G I V D L L H K T K I G V W S T L T T A G I V D L L H K T K I G V W S T L T CGCCGTGTTTCTTCCACCGCGAATCAGCAATTCGAATCGGCTGCAACAGAGCTTGAAAAC R R V S S T A N Q Q F E S A A T E L E N R R V S S T A N Q Q F E S A A T E L E N CTACTCGCGAATCCTGAACTTCAAGTGCAGCTATCTCGTGTCACTGAATATCTGCGCCGA L L A N P E L Q V Q L S R V T E Y L R R L L A N P E L Q V Q L S R V T E Y L R R TATGATAGGGCTGAATCAGCTTATAAATCAGGAGTTCATCATTTTCTGGTAGAAAACCAA Y D R A E S A Y K S G V H H F L V E N Q Y D R A E S A Y K S G V H H F L V E N Q GACTCTCCCTACGGCAAAGCTGTGCGATCAAGCCTTGCGTCTGCAATGCAGCTTCCGGAA D S P Y G K A V R S S L A S A M Q L P E D S P Y G K A V R S S L A S A M Q L P E GTCTGTATTGATAATCTGAGCAAAGAATACGTAAGGCCTGCAATTCTCCTGTGCGAACAA V C I D N L S K E Y V R P A I L L C E Q V C I D N L S K E Y V R P A I L L C E Q CTACGGGCGCACCCGCTTTCACCGTGGACGCTACAACGCAAAGCGCTTCAAGCAGAAAAC L R A H P L S P W T L Q R K A L Q A E N L R A H P L S P W T L Q R K A L Q A E N AAAATTATTCAATGGCGTGCGCTCGCACTTCTCAGTAGCCTTAGCATCGATTCTCTAAGC K I I Q W R A L A L L S S L S I D S L S K I I Q W R A L A L L S S L S I D S L S CAAGTGACCAGCGAACGCGTCAGTGTCACTGCGATAAAGCGTCAGGGAATAACTTCTGTG Q V T S E R V S V T A I K R Q G I T S V Q V T S E R V S V T A I K R Q G I T S V GCAGAAATAATTTCTCGTTCAGTTGAAGACTTGGAACAAATTCCAGGCGTCGGACAACAA A E I I S R S V E D L E Q I P G V G Q Q A E I I S R S V E D L E Q I P G V G Q Q ACCGCAAAGCGGGTAAAAGCTGCAGCTCAGACACTCTACTCGGAGGCGTTAGCCCAACCG T A K R V K A A A Q T L Y S E A L A Q P T A K R V K A A A Q T L Y S E A L A Q P CTTTCCACTTTAGGTTCAGAGCAGAGCACGGAACTCGAGGCGCTTCTTAATATTCTCTAT L S T L G S E Q S T E L E A L L N I L Y L S T L G S E Q S T E L E A L L N I L Y CACTATGGTCGGAGTAGGGAAGCGCTATAAGACGAATTGGATCGCATTGATCGCCTTGAA H Y G R S R E A L * D E L D R I D R L E H Y G R S R E A L X D E L D R I D R L E CGGTACTTGCAACCAGTAATCACACATGAAAAAGCGTTATGGAGGTCTATTCCACCGGCG R Y L Q P V I T H E K A L W R S I P P A R Y L Q P V I T H E K A L W R S I P P A TATTTTGTGATCTACAGCAAGGGGTCAAATGGGCACAACACTGCATATTTGCAGTTTATT Y F V I Y S K G S N G H N T A Y L Q F I Y F V I Y S K G S N G H N T A Y L Q F I GATGATATTTCTTGGGCAAACTTAGCTTTATTTATTCCAAACTTACTCTCTGAGGGGCAA D D I S W A N L A L F I P N L L S E G Q D D I S W A N L A L F I P N L L S E G Q GGCTCGGTAGACATTTGGAAGGATTACTGTGAACGCCCAGCGCATTACCAGTCGCTATGG G S V D I W K D Y C E R P A H Y Q S L W G S V D I W K D Y C E R P A H Y Q S L W TCTGCCATTCGTGGAAATGACCAAACGCCCTATAGTCAGAGCGGTTTATCGTCCGAAACG S A I R G N D Q T P Y S Q S G L S S E T S A I R G N D Q T P Y S Q S G L S S E T TTAGAACGTATTCGCGCACTAAAGCTCAATACTTCTTTACTACGAGACGCCTTTCTGCGT L E R I R A L K L N T S L L R D A F L R L E R I R A L K L N T S L L R D A F L R GGTTATCAAAGTTTCGGCGCAAAATTCGTTATAGTTCAGCGCAAAGTAATTCTTGGCGAT G Y Q S F G A K F V I V Q R K V I L G D G Y Q S F G A K F V I V Q R K V I L G D GAGATGGGCCTTGGTAAAACTGTGCAAGCTATCGCAGCAGCTGCCCATGTTACTGCTGAA E M G L G K T V Q A I A A A A H V T A E E M G L G K T V Q A I A A A A H V T A E AAATCTTCTGAAAACCCAGTAAAGATATTGATAATTGTCCCAGCGTCACTGATGACTAAC K S S E N P V K I L I I V P A S L M T N K S S E N P V K I L I I V P A S L M T N TGGGCTCGAGAATGGGAAAAATTCTGCAACATTCCTGTTCAGATTGCGCATGGAGAAAAC W A R E W E K F C N I P V Q I A H G E N W A R E W E K F C N I P V Q I A H G E N AAACAAAAAGCAGTTGCGCAATGGAATGATACCGCTGGGGCGCTTATCGTTACATATGAT K Q K A V A Q W N D T A G A L I V T Y D K Q K A V A Q W N D T A G A L I V T Y D GGCGCGAGAACCATGCAGCTTCTAGGGGCCACGGTTGTCATCGTCGATGAGGCTCACTAC G A R T M Q L L G A T V V I V D E A H Y G A R T M Q L L G A T V V I V D E A H Y ATAAAAAATCCTGAGGCTAAACGATCGCGAGCGGTCTCGCGGATTATTGCAGAATCGGAA I K N P E A K R S R A V S R I I A E S E I K N P E A K R S R A V S R I I A E S E TATGTGCTTCTTCTCAGCGGTACTCCATTGGAAAATAGAATAGAAGAATTTTGTACGTTA Y V L L L S G T P L E N R I E E F C T L Y V L L L S G T P L E N R I E E F C T L GTTTCATATCTTGATTCGCATTGTGCAATAAGCGCACCGCGATTAGCCTCAGCATTTAAA V S Y L D S H C A I S A P R L A S A F K V S Y L D S H C A I S A P R L A S A F K GCTCATATCGCGCATCTTTATCTCCGGAGAAATCAAGGGGATGTCCTTGACGAGCTTCCT A H I A H L Y L R R N Q G D V L D E L P A H I A H L Y L R R N Q G D V L D E L P GAAAAAATCGATCACACAGAATGGGTCGAGCTCAGTGCGGAGGATGAACATCTATACAGA E K I D H T E W V E L S A E D E H L Y R E K I D H T E W V E L S A E D E H L Y R CAAGCAGTACATGAACGTAATTGGATGCTGATGCGAAGAGTAGCAATGCTAGCAGCTCGG Q A V H E R N W M L M R R V A M L A A R Q A V H E R N W M L M R R V A M L A A R CCGGATTGTGCGAAAATGGAACGCTTAATCGACATTGTGAAAGAGGCAGAAAGTGTTGGA P D C A K M E R L I D I V K E A E S V G P D C A K M E R L I D I V K E A E S V G AAGAACGTAATTATATTTAGCTACTTTCGCAGTGTGCTCGAGCGTATTGAAAAAGATTTG K N V I I F S Y F R S V L E R I E K D L K N V I I F S Y F R S V L E R I E K D L GGTGAATACGTTGCGGGGTCAATCACAGGAGATGTGCCGCCTGAACGACGACAACAGCTG G E Y V A G S I T G D V P P E R R Q Q L G E Y V A G S I T G D V P P E R R Q Q L ATTGATGAGTTGGGAAACACTGGAAGACATGTGTTATTGCTGCAAATTGTTGCAGGAGGT I D E L G N T G R H V L L L Q I V A G G I D E L G N T G R H V L L L Q I V A G G GTAGGGCTAAATATTCAAAAAGCCAGTGTGGTTATATTTACGGAAGCGCAAGTTAAGCCC V G L N I Q K A S V V I F T E A Q V K P V G L N I Q K A S V V I F T E A Q V K P ACGCTGGTAGATCAAGCTATTGCACGCACACACCGAATGGGCCAACGAGATCCTGTCACA T L V D Q A I A R T H R M G Q R D P V T T L V D Q A I A R T H R M G Q R D P V T GTTTATCGACTTTTTGGCGCCGATACTGTCGACGAAAGACTTACCGAATTATTGGAGCAT V Y R L F G A D T V D E R L T E L L E H V Y R L F G A D T V D E R L T E L L E H AAGAGGGCAGTATTTGATAACTATGCTCGGGATGCTGAAGCAGCAGAGGTTTTTGACGCC K R A V F D N Y A R D A E A A E V F D A K R A V F D N Y A R D A E A A E V F D A GTAGATGTCTCAGAAGGAGCGCTAGCCCGTAATATTATTGAGCTAGAGCACGATCGCTTA V D V S E G A L A R N I I E L E H D R L V D V S E G A L A R N I I E L E H D R L CAGATTGATAACTAA Q I D N Q I D N --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1299): ATGAGCACGCTGCGCTCCCAAGGAACGTACCTTAGGGAAGTCGCACAGCGTGCTCAATTA M S T L R S Q G T Y L R E V A Q R A Q L M S T L R S Q G T Y L R E V A Q R A Q L CTTCTGAACTCGCTACTAGAACCACATGAACCAGCAAGGTTCAACACTCATGGAAAAATC L L N S L L E P H E P A R F N T H G K I L L N S L L E P H E P A R F N T H G K I AGCGATGTATGGGTCGTACCTCAAACCGCTATATCTTGGCCCCCGCATCTATTCACCCAC S D V W V V P Q T A I S W P P H L F T H S D V W V V P Q T A I S W P P H L F T H GAAGAATTCTCCGAAGATCATATTGAAGTTACGGAAATCCTTGAAAAATTTATCGAGTCA E E F S E D H I E V T E I L E K F I E S E E F S K D H I E V A E I L E K F I E S ACGGCAGGAATCGTAGACCTTCTACACAAAACTAAAATTGGTGTATGGAGCACACTTACG T A G I V D L L H K T K I G V W S T L T T S G I V D L L H K T K I G V W S T L T CGCCGTGTTTCTTCCACCGCGAATCAGCAATTCGAATCGGCTGCAACAGAGCTTGAAAAC R R V S S T A N Q Q F E S A A T E L E N R R V S S T A N Q Q F E S A A T E L E N CTACTCGCGAATCCTGAACTTCAAGTGCAGCTATCTCGTGTCACTGAATATCTGCGCCGA L L A N P E L Q V Q L S R V T E Y L R R L L A N P E L Q V Q L S R V T E Y L R R TATGATAGGGCTGAATCAGCTTATAAATCAGGAGTTCATCATTTTCTGGTAGAAAACCAA Y D R A E S A Y K S G V H H F L V E N Q Y D R A E S A Y K S G V H H F L V E N Q GACTCTCCCTACGGCAAAGCTGTGCGATCAAGCCTTGCGTCTGCAATGCAGCTTCCGGAA D S P Y G K A V R S S L A S A M Q L P E D S P Y G K A V R S S L A S A M Q L P E GTCTGTATTGATAATCTGAGCAAAGAATACGTAAGGCCTGCAATTCTCCTGTGCGAACAA V C I D N L S K E Y V R P A I L L C E Q V C I D N L S K E Y V R P A I L L C E Q CTACGGGCGCACCCGCTTTCACCGTGGACGCTACAACGCAAAGCGCTTCAAGCAGAAAAC L R A H P L S P W T L Q R K A L Q A E N L R A H P L S P W T L Q R K A L Q A E N AAAATTATTCAATGGCGTGCGCTCGCACTTCTCAGTAGCCTTAGCATCGATTCTCTAAGC K I I Q W R A L A L L S S L S I D S L S K I I Q C R A L A L L S S L S I D S L S CAAGTGACCAGCGAACGCGTCAGTGTCACTGCGATAAAGCGTCAGGGAATAACTTCTGTG Q V T S E R V S V T A I K R Q G I T S V Q V T S E R V S V T A I K R Q G I T S V GCAGAAATAATTTCTCGTTCAGTTGAAGACTTGGAACAAATTCCAGGCGTCGGACAACAA A E I I S R S V E D L E Q I P G V G Q Q A E I I S R S V E D L E Q I P G V G Q Q ACCGCAAAGCGGGTAAAAGCTGCAGCTCAGACACTCTACTCGGAGGCGTTAGCCCAACCG T A K R V K A A A Q T L Y S E A L A Q P T A K R V K A A A Q T L Y S E A L A Q P CTTTCCACTTTAGGTTCAGAGCAGAGCACGGAACTCGAGGCGCTTCTTAATATTCTCTAT L S T L G S E Q S T E L E A L L N I L Y L S T L G S E Q S T E L E A L L N I L Y CACTATGGTCGGAGTAGGGAAGCGCTATAAGACGAATTGGATCGCATTGATCGCCTTGAA H Y G R S R E A L * D E L D R I D R L E H Y G R S R E A L S D E L D R I D R L E CGGTACTTGCAACCAGTAATCACACATGAAAAAGCGTTATGGAGGTCTATTCCACCGGCG R Y L Q P V I T H E K A L W R S I P P A W Y L Q P V I T H E K A L W R S I P P A TATTTTGTGATCTACAGCAAGGGGTCAAATGGGCACAACACTGCATATTTGCAGTTTATT Y F V I Y S K G S N G H N T A Y L Q F I Y F V I Y S K G S G G H N T A Y L Q F I GATGATATTTCTTGGGCAAACTTAGCTTTATTTATTCCAAACTTACTCTCTGAGGGGCAA D D I S W A N L A L F I P N L L S E G Q D D I S W A N I A L S I P D L L S E G Q GGCTCGGTAGACATTTGGAAGGATTACTGTGAACGCCCAGCGCATTACCAGTCGCTATGG G S V D I W K D Y C E R P A H Y Q S L W G S V D I W K D Y C E R P A H Y Q S L W TCTGCCATTCGTGGAAATGACCAAACGCCCTATAGTCAGAGCGGTTTATCGTCCGAAACG S A I R G N D Q T P Y S Q S G L S S E T S A I R G N D Q T P Y S Q S G L S S E T TTAGAACGTATTCGCGCACTAAAGCTCAATACTTCTTTACTACGAGACGCCTTTCTGCGT L E R I R A L K L N T S L L R D A F L R L E R I R A L K L N T S L L R D V F L R GGTTATCAAAGTTTCGGCGCAAAATTCGTTATAGTTCAGCGCAAAGTAATTCTTGGCGAT G Y Q S F G A K F V I V Q R K V I L G D G Y Q S F G A K F V I V Q R K V I L G D GAGATGGGCCTTGGTAAAACTGTGCAAGCTATCGCAGCAGCTGCCCATGTTACTGCTGAA E M G L G K T V Q A I A A A A H V T A E E M G L G K T V Q A I A A A A H V T A E AAATCTTCTGAAAACCCAGTAAAGATATTGATAATTGTCCCAGCGTCACTGATGACTAAC K S S E N P V K I L I I V P A S L M T N K S F E N R I K I L I I V P A S L M T N TGGGCTCGAGAATGGGAAAAATTCTGCAACATTCCTGTTCAGATTGCGCATGGAGAAAAC W A R E W E K F C N I P V Q I A H G E N W A R E W E K F C N I P V Q I A H G E N AAACAAAAAGCAGTTGCGCAATGGAATGATACCGCTGGGGCGCTTATCGTTACATATGAT K Q K A V A Q W N D T A G A L I V T Y D K Q K A V A Q W N D T A G A L I V T Y D GGCGCGAGAACCATGCAGCTTCTAGGGGCCACGGTTGTCATCGTCGATGAGGCTCACTAC G A R T M Q L L G A T V V I V D E A H Y G A R T M R L L G A T V V I I D E A H Y ATAAAAAATCCTGAGGCTAAACGATCGCGAGCGGTCTCGCGGATTATTGCAGAATCGGAA I K N P E A K R S R A V S R I I A E S E I K N P E A K R S R A V S R I I A E S E TATGTGCTTCTTCTCAGCGGTACTCCATTGGAAAATAGAATAGAAGAATTTTGTACGTTA Y V L L L S G T P L E N R I E E F C T L Y A L L L S G T P L E N R I E E F C T L GTTTCATATCTTGATTCGCATTGTGCAATAAGCGCACCGCGATTAGCCTCAGCATTTAAA V S Y L D S H C A I S A P R L A S A F K V S Y L D S H C A I S A P R L A S A F K GCTCATATCGCGCATCTTTATCTCCGGAGAAATCAAGGGGATGTCCTTGACGAGCTTCCT A H I A H L Y L R R N Q G D V L D E L P A H I A H L Y L R R N Q G D V L D E L P GAAAAAATCGATCACACAGAATGGGTCGAGCTCAGTGCGGAGGATGAACATCTATACAGA E K I D H T E W V E L S A E D E H L Y R E K I D H T E W V E L S A E D E H L Y R CAAGCAGTACATGAACGTAATTGGATGCTGATGCGAAGAGTAGCAATGCTAGCAGCTCGG Q A V H E R N W M L M R R V A M L A A R Q A V H E R N W M L M R R V A M L A A R CCGGATTGTGCGAAAATGGAACGCTTAATCGACATTGTGAAAGAGGCAGAAAGTGTTGGA P D C A K M E R L I D I V K E A E S V G P D C A K M E R L I D I V K E A E S A G AAGAACGTAATTATATTTAGCTACTTTCGCAGTGTGCTCGAGCGTATTGAAAAAGATTTG K N V I I F S Y F R S V L E R I E K D L K N V I I F S Y F R S V L E R I E K D L GGTGAATACGTTGCGGGGTCAATCACAGGAGATGTGCCGCCTGAACGACGACAACAGCTG G E Y V A G S I T G D V P P E R R Q Q L G E Y V A G S I T A D V P P Q R R Q Q L ATTGATGAGTTGGGAAACACTGGAAGACATGTGTTATTGCTGCAAATTGTTGCAGGAGGT I D E L G N T G R H V L L L Q I V A G G I D E L G N T G R H V L L L Q I V A G G GTAGGGCTAAATATTCAAAAAGCCAGTGTGGTTATATTTACGGAAGCGCAAGTTAAGCCC V G L N I Q K A S V V I F T E A Q V K P V G L N I Q K A S V V I F T E A Q V K P ACGCTGGTAGATCAAGCTATTGCACGCACACACCGAATGGGCCAACGAGATCCTGTCACA T L V D Q A I A R T H R M G Q R D P V T T L V D Q A I A R A H R M G Q R D P V T GTTTATCGACTTTTTGGCGCCGATACTGTCGACGAAAGACTTACCGAATTATTGGAGCAT V Y R L F G A D T V D E R L T E L L E H V Y R L F G A D T V D E R L T A L L E H AAGAGGGCAGTATTTGATAACTATGCTCGGGATGCTGAAGCAGCAGAGGTTTTTGACGCC K R A V F D N Y A R D A E A A E V F D A K R A V F D N Y A R D A E A A E V F D A GTAGATGTCTCAGAAGGAGCGCTAGCCCGTAATATTATTGAGCTAGAGCACGATCGCTTA V D V S E G A L A R N I I E L E H D R L V D V S E G E L A R N I I E L E H D R L CAGATTGATAACTAA Q I D N Q I D N --- // >fig|6666666.67454.peg.253 fig|257309.1.peg.165 Putative phage integrase gi|372118535|gb|CP003217.1|_251791_251585,gi|372118535|gb|CP003217.1|_251581_251426,gi|372118535|gb|CP003217.1|_251422_251408,gi|372118535|gb|CP003217.1|_251404_250901,gi|372118535|gb|CP003217.1|_250897_250592 MAFVRDLWTKPNPNATSRTKRIRSARWGKGKRWQAVWVKNGKHVTTSCHAKDEAELHIARASVGQADGTxITKDKLDVTLQDMWDVWIASKQGRTESTKAGYIAAWKHIQPVFGNTACWKIExAKIAAxIPTVTTTKSSKHNQPRVIGSGSQRKIGIVIKALLDQAEELDIINKNKIRCTDIPRQGKAERRYLTIRGIDRLLAAAIPMNEVALMRNVLLFTGLRPREAKGLKVKDLDPMRGRLSIRRDVDDLGNPDETKTRNHRGVPIGGDLLFDLDDQAEGKQPHDWLLTDETGHVxTSTKWRRQWATICTHAHISGLTTYELRHTAASLAIAAGADVKTVQLMLGHASAATTLDTYAHLWETGLDSVPGAMSAHLQRERERLALRERRRVECELQVI We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCATTCGTGCGCGACCTCTGGACAAAACCCAACCCCAACGCAACATCGAGAACCAAA M A F V R D L W T K P N P N A T S R T K M A F V R D L W T K P N P N A T S R T K AGAATACGCTCTGCTCGATGGGGAAAAGGCAAACGCTGGCAAGCTGTCTGGGTAAAAAAC R I R S A R W G K G K R W Q A V W V K N R I R S A R W G K G K R W Q A V W V K N GGCAAACACGTCACCACCTCATGCCACGCCAAAGACGAAGCTGAACTTCACATCGCACGC G K H V T T S C H A K D E A E L H I A R G K H V T T S C H A K D E A E L H I A R GCATCCGTTGGCCAAGCCGATGGCACCTAGATTACTAAAGACAAACTCGATGTCACACTC A S V G Q A D G T * I T K D K L D V T L A S V G Q A D G T X I T K D K L D V T L CAAGACATGTGGGATGTATGGATCGCGTCAAAACAAGGACGCACAGAAAGCACCAAAGCT Q D M W D V W I A S K Q G R T E S T K A Q D M W D V W I A S K Q G R T E S T K A GGTTACATTGCTGCGTGGAAACACATCCAACCCGTCTTCGGAAACACCGCATGTTGGAAA G Y I A A W K H I Q P V F G N T A C W K G Y I A A W K H I Q P V F G N T A C W K ATTGAATGAGCAAAAATAGCAGCCTAGATCCCTACCGTCACCACCACCAAAAGCAGCAAG I E * A K I A A * I P T V T T T K S S K I E X A K I A A X I P T V T T T K S S K CATAACCAACCCCGTGTGATCGGCTCCGGCTCGCAACGCAAAATCGGAATCGTCATCAAA H N Q P R V I G S G S Q R K I G I V I K H N Q P R V I G S G S Q R K I G I V I K GCACTCCTCGACCAAGCCGAAGAACTCGACATCATTAACAAAAACAAAATCCGTTGCACC A L L D Q A E E L D I I N K N K I R C T A L L D Q A E E L D I I N K N K I R C T GATATCCCCCGCCAAGGAAAAGCAGAACGCCGCTACCTCACCATCCGAGGAATCGACCGC D I P R Q G K A E R R Y L T I R G I D R D I P R Q G K A E R R Y L T I R G I D R CTTTTAGCAGCTGCAATACCCATGAACGAAGTAGCACTCATGCGCAACGTTTTGTTATTC L L A A A I P M N E V A L M R N V L L F L L A A A I P M N E V A L M R N V L L F ACCGGTCTTCGCCCAAGGGAAGCAAAAGGATTGAAAGTCAAAGACCTCGACCCCATGCGC T G L R P R E A K G L K V K D L D P M R T G L R P R E A K G L K V K D L D P M R GGTAGGCTGTCCATCCGTCGTGACGTCGACGATCTCGGAAACCCCGATGAAACAAAAACC G R L S I R R D V D D L G N P D E T K T G R L S I R R D V D D L G N P D E T K T AGAAACCACCGCGGCGTCCCCATCGGTGGTGACCTCCTTTTCGATCTCGACGACCAAGCA R N H R G V P I G G D L L F D L D D Q A R N H R G V P I G G D L L F D L D D Q A GAAGGAAAACAACCACATGACTGGCTCCTCACCGATGAAACCGGCCATGTGTGAACATCC E G K Q P H D W L L T D E T G H V * T S E G K Q P H D W L L T D E T G H V X T S ACAAAATGGCGCAGGCAGTGGGCAACCATCTGCACTCATGCACACATATCAGGCCTGACA T K W R R Q W A T I C T H A H I S G L T T K W R R Q W A T I C T H A H I S G L T ACCTACGAGCTACGACACACAGCAGCATCATTGGCGATTGCAGCCGGTGCTGACGTGAAA T Y E L R H T A A S L A I A A G A D V K T Y E L R H T A A S L A I A A G A D V K ACCGTTCAACTTATGCTTGGACACGCAAGTGCTGCCACGACCCTTGACACCTACGCACAC T V Q L M L G H A S A A T T L D T Y A H T V Q L M L G H A S A A T T L D T Y A H TTGTGGGAAACCGGACTAGATTCCGTTCCCGGCGCGATGAGTGCTCATTTGCAGCGTGAG L W E T G L D S V P G A M S A H L Q R E L W E T G L D S V P G A M S A H L Q R E CGTGAGAGGTTAGCGTTGCGTGAGCGTAGGCGTGTTGAGTGTGAGTTACAGGTTATTTAG R E R L A L R E R R R V E C E L Q V I R E R L A L R E R R R V E C E L Q V I --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.165): ATGGCATTCGTGCGCGACCTCTGGACAAAACCCAACCCCAACGCAACATCGAGAACCAAA M A F V R D L W T K P N P N A T S R T K M A T V R D L W T K R N P N T T S K T K AGAATACGCTCTGCTCGATGGGGAAAAGGCAAACGCTGGCAAGCTGTCTGGGTAAAAAAC R I R S A R W G K G K R W Q A V W V K N R I R S A R W G V G K R W Q A V W I E N GGCAAACACGTCACCACCTCATGCCACGCCAAAGACGAAGCTGAACTTCACATCGCACGC G K H V T T S C H A K D E A E L H I A R G R E A T K T F E T R D E A E L W A A R GCATCCGTTGGCCAAGCCGATGGCACCTAGATTACTAAAGACAAACTCGATGTCACACTC A S V G Q A D G T * I T K D K L D V T L A E V G K A D G T W I T K D K V D I T L CAAGACATGTGGGATGTATGGATCGCGTCAAAACAAGGACGCACAGAAAGCACCAAAGCT Q D M W D V W I A S K Q G R T E S T K A S D L W E P W I A S K G N I S D K T K R GGTTACATTGCTGCGTGGAAA-CACATCCAACCCGTCTTCGGAAACACCGCATGTTGGAA G Y I A A W K H I Q P V F G N T A C W K D Y L S Y W N V H I R P Q W G Q T P C A H AATTGAATGAGCAAAAATAGCAGCCTAGATCCCTACCGTCACCACCACCAAAAGCAGCAA I E * A K I A A * I P T V T T T K S S K I Q R S V I N A W I P T L S T M K G V P GCATAACCAACCC-CGTGTGATCGGCTCCGGCTCGCAACGCAAAATCGGAATCGTCATCA H N Q P R V I G S G S Q R K I G I V I A S Q P P R P L S E S A M R K V G L I I AAGCACTCCTCGACCAAGCCGAAGAACTCGACATCATTAACAAAAACAAAATCCGTTGCA K A L L D Q A E E L D I I N K N K I R C H G I L D L A V E L G V I H Q N P I R T CCGATATCCCCCGCCAAGGAAAAGCAGAACGCCGCTACCTCACCATCCGAGGAATCGACC T D I P R Q G K A E R R Y L T I R G I D G D L P K Q K K S E R R Y L K I T E V D GCCTTTTAGCAGCTGCAATACCCATGAACGAAGTAGCACTCATGCGCAACGTTTTGTTAT R L L A A A P M N E V A L M R N V L L E L I R Q A --- P T E Q A K L L L R V L I TCACCGGTCTTCGCCCAAGGGAAGCAAAAGGATTGAAAGTCAAAGACCTCGACCCCATGC F T G L R P R E A K G L K V K D L D P M M T G L R P G E A K G L K V K D L D P V GCGGTAGGCTGTCCATCCGTCGTGACGTCGACGATCTCGGAAACCCCGATGAAACAAAAA R G R L S I R R D V D D L G N P D E T K R G R L M I R R D V D D L G H E D S T K CCAGAAACCACCGCGGCGTCCCCATCGGTGGTGACCTCCTTTTCGATCTCGACGACCAAG T R N H R G V P I G G D L L F D L D D Q T R N H R D V P I G G E I L L L L D R Y CAGAAGGAAAACAACCACATGACTGGCTCCTCACCGATGAAACCGGCCATGTGTGAACAT A E G K Q P H D W L L T D E T G H V * T A Q G K D P D S W L I P D E R G K V W T CCACAAAATGGCGCAGGCAGTGGGCAACCATCTGCACTCATGCACACATATCAGGCCTGA S T K W R R Q W A T I C T H A H I S G L T S R W R V V W K N L C I W T G I G D L CAACCTACGAGCTACGACACACAGCAGCATCATTGGCGATTGCAGCCGGTGCTGACGTGA T T Y E L R H T A A S L A I A A G A D V D T Y E L R H T A A S I A I A A G A D V AAACCGTTCAACTTATGCTTGGACACGCAAGTGCTGCCACGACCCTTGACACCTACGCAC K T V Q L M L G H A S A A T T L D T Y A K T V Q L M L G H S S A A M T L D I Y A ACTTGTGGGAAACCGGACTAGATTCCGTTCCCGGCGCGATGAGTGCTCATTTGCAGCGTG H L W E T G L D S V P G A M S A H L Q R H L W E E G L D A I P G A M E A H M E S AGCGTGAGAGGTTA---------GCGTTGCGTGAGCGTAGGCGTGTTGAGTGT*GA*GTT E R E R L A L R E R R R V E C V E R K R A EEASTVHEA S E A E R R R A Q F *K** V ACAGGTTATTTAG T G I G ------- // >fig|6666666.67454.peg.38 fig|257309.1.peg.2324 gi|372118535|gb|CP003217.1|_34376_34251,gi|372118535|gb|CP003217.1|_34247_34230 MVGAPPPITPEKTALHTKSGQTAGLEAIWCEVLRKMLRNTPVxWPFRF We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. TTGGTGGGCGCACCACCCCCGATCACCCCCGAAAAGACGGCACTTCACACCAAATCTGGC L V G A P P P I T P E K T A L H T K S G M V G A P P P I T P E K T A L H T K S G CAAACGGCCGGTTTGGAAGCGATTTGGTGTGAAGTCCTGAGAAAAATGCTTCGAAATACC Q T A G L E A I W C E V L R K M L R N T Q T A G L E A I W C E V L R K M L R N T CCCGTTTAGTGGCCCTTCCGGTTTTAG P V * W P F R F P V X W P F R F --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2324): ----------------------TTGGTGGGCGCACCACCCCCGATCACCCCCGAAAAGAC L V G A P P P I T P E K T MISSLGVRAWLALVGAGGCWWV L V G A P P P L T P E K T GGCACTTCACACCAAATCTGGCCAAACGGCCGGTTTGGAAGCGATTTGGTGTGAAGTCCT A L H T K S G Q T A G L E A I W C E V L A L H T K S S Q T A G L E A I W C E V S GAGAAAAATGCTTCGAAATACCCCCGTTTAGTGGCCCTTCCGGTTTT*AG*-- R K M L R N T P V * W P S G F R K I L R N T P V W W L - S G F *G**AR // >fig|6666666.67454.peg.2117 fig|257309.1.peg.2324 gi|372118535|gb|CP003217.1|_2172006_2171866,gi|372118535|gb|CP003217.1|_2171862_2171845 MAWLGLAGRLPPFTPEKTALHTKSGQTAGLEAIWCEVPRKILRNTPVxWLFRF We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCTTGGCTGGGATTGGCTGGCAGGTTACCCCCGTTCACCCCCGAAAAGACGGCACTT M A W L G L A G R L P P F T P E K T A L M A W L G L A G R L P P F T P E K T A L CACACCAAATCTGGCCAAACGGCCGGTTTGGAAGCGATTTGGTGTGAAGTGCCGAGAAAA H T K S G Q T A G L E A I W C E V P R K H T K S G Q T A G L E A I W C E V P R K ATCCTTCGAAATACCCCCGTTTAGTGGCTCTTTCGGTTTTAG I L R N T P V * W L F R F I L R N T P V X W L F R F --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2324): -----------------ATGGCTTGGCTGGGATTGGCTGGCAGGTTACCCCCGTTCACCC M A W L G L A G R L P P F T MISSLGVRAWLALVGAG G C W W V L V G A P P P L T CCGAAAAGACGGCACTTCACACCAAATCTGGCCAAACGGCCGGTTTGGAAGCGATTTGGT P E K T A L H T K S G Q T A G L E A I W P E K T A L H T K S S Q T A G L E A I W GTGAAGTGCCGAGAAAAATCCTTCGAAATACCCCCGTTTAGTGGCTCTTTCGGTTTTAG- C E V P R K I L R N T P V * W L F R F * C E V S R K I L R N T P V W W L S G F G A - R // >fig|6666666.67454.peg.1557 fig|196627.4.peg.1974 rRNA small subunit methyltransferase H # 16S rRNA m(4) C1402 methyltransferase FIG000172 gi|372118535|gb|CP003217.1|_1592616_1591600,gi|372118535|gb|CP003217.1|_1591596_1591543 MTHGEPQEFSFDVEENHGHVPVLRARMAELIAPKVTAMGSDAVIIDGTLGAGGHSKYFLESFPEARVIGLDRDTNSLASARERLKEFGDRFLGIHTRFDRFAPKLEELAQSGNPIAATALEQGISGALFDLGVSSMQLDQAERGFAYRVDAPLDMRMDNTIGITAADVLNTYSHGELARILKTYGDERFAGKIASAIVREREKEPFDTSARLVELLYATIPAATRRTGGHPAKRTFQALRIEVNRELESLENVLPEITQRLTTGGRAVFMSYQSLEDKIVKRYFVDISTSKTPPGLPMELPEYAPKFKVVTRGAEKATDAEIEENPRAASVRVRAIEALxRNQKRNDTNKRSSFGVT We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACTCACGGTGAGCCGCAAGAGTTTTCGTTCGATGTTGAGGAAAACCATGGTCACGTC M T H G E P Q E F S F D V E E N H G H V M T H G E P Q E F S F D V E E N H G H V CCAGTTCTTCGAGCCAGAATGGCTGAGCTGATTGCGCCTAAGGTTACAGCGATGGGGTCA P V L R A R M A E L I A P K V T A M G S P V L R A R M A E L I A P K V T A M G S GATGCTGTCATTATTGATGGCACTCTTGGCGCTGGTGGGCACAGTAAGTATTTTCTTGAA D A V I I D G T L G A G G H S K Y F L E D A V I I D G T L G A G G H S K Y F L E AGCTTCCCCGAAGCTCGAGTTATAGGCCTCGATCGTGATACTAACTCTTTAGCTTCGGCG S F P E A R V I G L D R D T N S L A S A S F P E A R V I G L D R D T N S L A S A CGCGAACGACTAAAAGAATTTGGTGATCGATTCCTCGGTATTCACACCCGTTTCGATCGA R E R L K E F G D R F L G I H T R F D R R E R L K E F G D R F L G I H T R F D R TTTGCCCCGAAATTAGAGGAACTGGCTCAATCTGGAAACCCCATTGCAGCTACTGCATTG F A P K L E E L A Q S G N P I A A T A L F A P K L E E L A Q S G N P I A A T A L GAGCAAGGTATCAGCGGTGCACTTTTCGACCTCGGGGTTTCATCAATGCAGCTTGATCAA E Q G I S G A L F D L G V S S M Q L D Q E Q G I S G A L F D L G V S S M Q L D Q GCAGAGCGAGGATTTGCCTACCGTGTTGATGCGCCACTAGACATGCGCATGGATAACACG A E R G F A Y R V D A P L D M R M D N T A E R G F A Y R V D A P L D M R M D N T ATCGGGATCACTGCAGCTGATGTGTTGAATACCTATAGCCATGGCGAGCTAGCGCGCATC I G I T A A D V L N T Y S H G E L A R I I G I T A A D V L N T Y S H G E L A R I CTTAAAACCTATGGTGACGAGCGTTTCGCAGGAAAAATTGCAAGTGCAATAGTCCGAGAG L K T Y G D E R F A G K I A S A I V R E L K T Y G D E R F A G K I A S A I V R E CGTGAAAAAGAACCATTTGACACTTCGGCTCGTCTAGTTGAGCTGCTTTACGCGACGATT R E K E P F D T S A R L V E L L Y A T I R E K E P F D T S A R L V E L L Y A T I CCTGCAGCTACGCGTCGTACTGGGGGTCATCCAGCCAAGCGAACATTCCAAGCGCTTCGG P A A T R R T G G H P A K R T F Q A L R P A A T R R T G G H P A K R T F Q A L R ATCGAAGTCAATCGAGAATTGGAATCTCTAGAGAATGTACTTCCTGAGATTACGCAGCGT I E V N R E L E S L E N V L P E I T Q R I E V N R E L E S L E N V L P E I T Q R TTGACTACAGGTGGACGAGCAGTGTTCATGTCGTACCAGTCGTTGGAAGACAAAATTGTC L T T G G R A V F M S Y Q S L E D K I V L T T G G R A V F M S Y Q S L E D K I V AAACGTTACTTCGTAGACATTTCTACTTCGAAAACGCCGCCGGGGCTTCCCATGGAGCTA K R Y F V D I S T S K T P P G L P M E L K R Y F V D I S T S K T P P G L P M E L CCGGAATATGCGCCCAAATTCAAAGTAGTGACCCGTGGTGCAGAAAAAGCTACTGACGCG P E Y A P K F K V V T R G A E K A T D A P E Y A P K F K V V T R G A E K A T D A GAAATCGAGGAAAATCCTCGCGCTGCATCAGTAAGAGTTCGAGCAATCGAAGCTCTGTAG E I E E N P R A A S V R V R A I E A L * E I E E N P R A A S V R V R A I E A L X AGAAATCAAAAACGCAATGACACAAACAAACGCAGTAGTTTTGGGGTGACCTAG R N Q K R N D T N K R S S F G V T R N Q K R N D T N K R S S F G V T --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.1974): ATGACTCACGGTGAGCCGCAAGAGTTTTCGTTCGATGTTGAGGAAAACCATGGTCACGTC P Q E F S F D G N H G H V --------------- M E D F S L D ----- G - N H G H V CCAGTTCTTCGAGCCAGAATGGCTGAGCTGATTGCGCCTAAGGTTACAGCGATGGGGTCA P V L R A R M A E L I A P K V T A M G S P V M R D R M A A L I A E H V E A L G E GATGCTGTCATTATTGATGGCACTCTTGGCGCTGGTGGGCACAGTAAGTATTTTCTTGAA D A V I I D G T L G A G G H S K Y F L E N A V I V D A T L G A G G H A E F F L N AGCTTCCCCGAAGCTCGAGTTATAGGCCTCGATCGTGATACTAACTCTTTAGCTTCGGCG S F P E A R V I G L D R D T N S L A S A T F P K A R L I G L D R D Q N A L R D A CGCGAACGACTAAAAGAATTTGGTGATCGATTCCTCGGTATTCACACCCGTTTCGATCGA R E R L K E F G D R F L G I H T R F D R R A R L A P F G E R F I G V Q T R F D G TTTGCCCCGAAATTAGAGGAACTGGCTCAATCTGGAAACCCCATTGCAGCTACTGCATTG F A P K L E E L A G N I A A T A L L R E V L E S V E ------ G D --- I I D L A R GAGCAAGGTATCAGCGGTGCACTTTTCGACCTCGGGGTTTCATCAATGCAGCTTGATCAA E Q G I S G A L F D L G V S S M Q L D Q E H G I A G A L F D L G V S S M Q L D Q GCAGAGCGAGGATTTGCCTACCGTGTTGATGCGCCACTAGACATGCGCATGGATAACACG A E R G F A Y R V D A P L D M R M D N T V E R G F A Y R T D A P L D M R M D A T ATCGGGATCACTGCAGCTGATGTGTTGAATACCTATAGCCATGGCGAGCTAGCGCGCATC I G I T A A D V L N T Y S H G E L A R I Q G I T A A D I L N T Y S H G D I A R I CTTAAAACCTATGGTGACGAGCGTTTCGCAGGAAAAATTGCAAGTGCAATAGTCCGAGAG L K T Y G D E R F A G K I A S A I V R E L K T Y G D E R F A G K I A S A V L K E CGTGAAAAAGAACCATTTGACACTTCGGCTCGTCTAGTTGAGCTGCTTTACGCGACGATT R E K E P F D T S A R L V E L L Y A T I R E K E P F T T S A R L V E L L Y D A I CCTGCAGCTACGCGTCGTACTGGGGGTCATCCAGCCAAGCGAACATTCCAAGCGCTTCGG P A A T R R T G G H P A K R T F Q A L R P A A T R R T G G H P A K R T F Q A L R ATCGAAGTCAATCGAGAATTGGAATCTCTAGAGAATGTACTTCCTGAGATTACGCAGCGT I E V N R E L E S L E N V L P E I T Q R V E V N N E L D S L K N V L P Q I T D A TTGACTACAGGTGGACGAGCAGTGTTCATGTCGTACCAGTCGTTGGAAGACAAAATTGTC L T T G G R A V F M S Y Q S L E D K I V L N V G G R A V F M S Y Q S H E D K L V AAACGTTACTTCGTAGACATTTCTACTTCGAAAACGCCGCCGGGGCTTCCCATGGAGCTA K R Y F V D I S T S K T P P G L P M E L K K F F T D L T T S K T P P G L P V D L CCGGAATATGCGCCCAAATTCAAAGTAGTGACCCGTGGTGCAGAAAAAGCTACTGACGCG P E Y A P K F K V V T R G A E K A T D A P G T A P Q F K Q V T R G A E T A S E A GAAATCGAGGAAAATCCTCGCGCTGCATCAGTAAGAGTTCGAGCAATCGAAGCTCTGTAG E I E E N P R A A S V R V R A I E A L * E I E E N P R A A P V K V R A I E R I G AGAAATCAAAAACGCAATGACACAAACAAACGCAGTAGTTTTGGGGTGACCTAG R N Q K R N D N N S G D L S --------------------------------- // >fig|6666666.67454.peg.1700 fig|257309.1.peg.1687 Doubtful CDS. No significant database matches gi|372118535|gb|CP003217.1|_1741442_1741338,gi|372118535|gb|CP003217.1|_1741334_1741299,gi|372118535|gb|CP003217.1|_1741297_1741097 MSGGGAPTSAHQRQPSHGYGKRPTPRSATPEPPANxSMHSKTGRAEKPNQFKKIYPTLALVAYTLSLLDPENDWRNRLGALIEAFPAIKGLGPETMGFPSNWAELAIWRADDHS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGAGCGGGGGTGGCGCGCCCACCAGCGCCCACCAACGCCAGCCAAGCCATGGTTATGGA V S G G G A P T S A H Q R Q P S H G Y G M S G G G A P T S A H Q R Q P S H G Y G AAACGTCCTACTCCGCGTAGTGCCACGCCCGAACCCCCAGCGAACTAATCAATGCACTCT K R P T P R S A T P E P P A N * S M H S K R P T P R S A T P E P P A N X S M H S AAAACCGGAAGAGCCGAAAAACCCCAACCAGTTCAAGAAGATCTATCCAACACTTGCGTT K T G R A E K P N Q F K K I Y P T L A L K T G R A E K P - N Q F K K I Y P T L A L AGTCGCATATACGCTTTCGTTACTAGATCCTGAAAATGACTGGCGAAATCGATTGGGTGC V A Y T L S L L D P E N D W R N R L G A V A Y T L S L L D P E N D W R N R L G A ATTAATAGAAGCGTTTCCAGCAATTAAAGGACTCGGCCCTGAAACCATGGGTTTTCCTAG L I E A F P A I K G L G P E T M G F P S L I E A F P A I K G L G P E T M G F P S CAACTGGGCAGAACTGGCAATTTGGCGTGCTGACGACCATTCGTAA N W A E L A I W R A D D H S N W A E L A I W R A D D H S --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1687): GTGAGCGGGGGTGGCGCGCCCACC--AGCGCCCACCAACGCCAGCCAAGCCATGGTTATG G G G A P T S A H Q R Q P S H G Y ------ M A R A P T FT N A S Q S Q P S H G C GAAAACGTCCTACTCCGCGTAGTGCCACGCCCGAACCCCCAGCGAACTAATCAATGCACT G K R P T P R S A T P E P P A N * S M H G K R P T P H R S T P P T S D T K S M H CTAAAACCGGAAGAGCCGAAAAACCCCAACCAGTTCAAGAAGATCTATCCAACACTTGCG S K T G R A E N P N Q F K K I Y P T L A S R T G R A E - N P N Q F K K I Y P T L A TTAGTCGCATATACGCTTTCGTTACTAGATCCTGAAAATGACTGGCGAAATCGATTGGGT L V A Y T L S L L D P E N D W R N R L G L V A Y T L S F L D P E N D W R N R M G GCATTAATAGAAGCGTTTCCAGCAATTAAAGGACTCGGCCCTGAAACCATGGGTTTTCCT A L I E A F P A I K G L G P E T M G F P A L I E A F P A I K G L G P E T M G F P AGCAACTGGGCAGAACTGGCAATTTGGCGTGCTGACGACCATTCGTAA S N W A E L A I W R A D D H S S N W A E L A I W R A G D H S --- // >fig|6666666.67454.peg.2243 fig|196164.1.peg.2684 hypothetical protein gi|372118535|gb|CP003217.1|_2307202_2306744,gi|372118535|gb|CP003217.1|_2306742_2305681 MDENRDFEVVGVADAAALEEALISQTRNSVKPAPMIECETFTLEGKQVLVAQVNPVPLQNRPAHYRGVAYLRQSDGDYGMNDADLALVEIQKLSHSENFQFDVVPVLNSSTRDLDSVRVKSFLEAARAGSRILSKKIDDQELLETLNIVTVKGELTLAGIYALGEYPQGKAPQLRITAAVQLPREGGSVRTRNMQDFEGPLPDLLESALTWVKQNAPTQNVYDSSGHMRKESVYPLPAVRELIANALVHRDLSPNSDGKWVEIRLCDDRLVISNPGGLRGVSVKQLESATLSKNAVNPRLYDIAKRVRTEGAGIQEVLRQTCQALLAKPQLIDTGVQFTAILYGASVFSEAELEWLRSIGGDGLTAVEKHLLVGLRKGESWHLSRILNEFSPITVAEAEKLMHGLKKRGFIESDNKTFTLGAHSENQAPRVEKEETTLAKITKNAPTIAHALELKPEQSFEELLRTTGLSQGQLRFALDKLQAVGLVVREGGWGVHGTTYHWSAQT We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGGATGAAAACCGTGACTTTGAAGTCGTCGGCGTTGCGGATGCGGCAGCGCTTGAAGAA V D E N R D F E V V G V A D A A A L E E M D E N R D F E V V G V A D A A A L E E GCGCTCATTAGTCAGACTCGTAACAGTGTGAAACCGGCCCCTATGATCGAGTGTGAGACT A L I S Q T R N S V K P A P M I E C E T A L I S Q T R N S V K P A P M I E C E T TTCACTCTAGAAGGCAAGCAGGTGCTTGTGGCACAGGTCAATCCAGTGCCGTTGCAAAAC F T L E G K Q V L V A Q V N P V P L Q N F T L E G K Q V L V A Q V N P V P L Q N CGTCCGGCGCACTACCGAGGTGTTGCCTACCTGCGGCAATCCGATGGAGACTACGGAATG R P A H Y R G V A Y L R Q S D G D Y G M R P A H Y R G V A Y L R Q S D G D Y G M AACGATGCTGATCTCGCACTCGTTGAGATCCAGAAGCTTTCTCATTCTGAGAACTTCCAG N D A D L A L V E I Q K L S H S E N F Q N D A D L A L V E I Q K L S H S E N F Q TTCGATGTAGTCCCAGTCTTGAACTCTTCAACCCGAGACTTAGACTCTGTTCGGGTAAAG F D V V P V L N S S T R D L D S V R V K F D V V P V L N S S T R D L D S V R V K AGTTTCCTCGAGGCTGCGCGCGCGGGAAGCCGCATCCTGTCCAAGAAAATTGATGACCAA S F L E A A R A G S R I L S K K I D D Q S F L E A A R A G S R I L S K K I D D Q GAACTGCTTGAAACTCTCAATATCGTGACGGTAAAAGGGTGAACTCACGCTGGCCGGAAT E L L E T L N I V T V K G E L T L A G I E L L E T L N I V T V K G - E L T L A G I CTACGCCCTGGGTGAGTATCCGCAGGGTAAGGCTCCACAGCTACGCATTACAGCGGCAGT Y A L G E Y P Q G K A P Q L R I T A A V Y A L G E Y P Q G K A P Q L R I T A A V GCAACTGCCACGCGAAGGCGGCAGTGTGCGTACTAGGAATATGCAGGACTTTGAAGGCCC Q L P R E G G S V R T R N M Q D F E G P Q L P R E G G S V R T R N M Q D F E G P TCTTCCTGACCTGCTCGAATCCGCACTGACGTGGGTAAAACAGAATGCGCCGACGCAGAA L P D L L E S A L T W V K Q N A P T Q N L P D L L E S A L T W V K Q N A P T Q N TGTTTACGACTCCAGTGGACACATGCGCAAGGAGAGCGTCTACCCGTTGCCTGCCGTCCG V Y D S S G H M R K E S V Y P L P A V R V Y D S S G H M R K E S V Y P L P A V R CGAACTGATCGCAAATGCCTTGGTGCACCGCGATCTAAGCCCCAATTCTGATGGAAAATG E L I A N A L V H R D L S P N S D G K W E L I A N A L V H R D L S P N S D G K W GGTGGAGATTAGGCTTTGCGACGATCGCCTCGTCATCTCTAATCCGGGTGGACTTCGGGG V E I R L C D D R L V I S N P G G L R G V E I R L C D D R L V I S N P G G L R G AGTCTCAGTCAAACAGCTAGAGAGTGCAACTCTTTCCAAGAACGCAGTAAATCCCCGCCT V S V K Q L E S A T L S K N A V N P R L V S V K Q L E S A T L S K N A V N P R L TTATGACATTGCTAAACGAGTCCGCACCGAAGGCGCTGGTATCCAAGAAGTATTGAGGCA Y D I A K R V R T E G A G I Q E V L R Q Y D I A K R V R T E G A G I Q E V L R Q AACCTGTCAGGCACTGTTGGCAAAACCTCAACTCATTGATACTGGTGTGCAGTTCACTGC T C Q A L L A K P Q L I D T G V Q F T A T C Q A L L A K P Q L I D T G V Q F T A GATCCTCTATGGTGCCTCAGTTTTCAGCGAAGCAGAGTTGGAGTGGCTGCGCAGCATTGG I L Y G A S V F S E A E L E W L R S I G I L Y G A S V F S E A E L E W L R S I G AGGAGATGGCCTTACCGCCGTCGAAAAGCACCTGCTAGTAGGGCTACGAAAAGGGGAAAG G D G L T A V E K H L L V G L R K G E S G D G L T A V E K H L L V G L R K G E S CTGGCATTTGTCTAGGATCCTCAATGAGTTTTCGCCCATAACCGTGGCCGAGGCGGAAAA W H L S R I L N E F S P I T V A E A E K W H L S R I L N E F S P I T V A E A E K ACTCATGCATGGTTTGAAGAAGCGTGGCTTCATTGAGAGTGATAATAAGACTTTCACTCT L M H G L K K R G F I E S D N K T F T L L M H G L K K R G F I E S D N K T F T L AGGAGCACACAGTGAGAATCAAGCGCCCCGCGTGGAAAAAGAGGAAACAACTCTGGCAAA G A H S E N Q A P R V E K E E T T L A K G A H S E N Q A P R V E K E E T T L A K GATCACCAAGAATGCGCCAACAATAGCCCACGCACTAGAACTCAAGCCAGAACAGAGCTT I T K N A P T I A H A L E L K P E Q S F I T K N A P T I A H A L E L K P E Q S F TGAAGAACTGCTGCGCACCACAGGTTTGAGCCAGGGGCAGCTGAGATTTGCGCTCGATAA E E L L R T T G L S Q G Q L R F A L D K E E L L R T T G L S Q G Q L R F A L D K ACTGCAAGCTGTCGGGCTAGTTGTGCGCGAAGGAGGCTGGGGCGTTCACGGAACCACCTA L Q A V G L V V R E G G W G V H G T T Y L Q A V G L V V R E G G W G V H G T T Y TCACTGGAGTGCGCAAACCTAA H W S A Q T H W S A Q T --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.2684): GTGGATGAAAACCGTGACTTTGAAGTCGTCGGCGTTGCGGATGCGGCAGCGCTTGAAGAA V A D A A A L E E --------------------------------- M T D P A E M I Q GCGCTCATTAGTCAGACTCGTAACAGTGTGAAACCGGCCCCTATGATCGAGTGTGAGACT A L I S Q T R N S V K P A P M I E C E T A V V A Q T R Q A V D P A P E I N P Y T TTCACTCTAGAAGGCAAGCAGGTGCTTGTGGCACAGGTCAATCCAGTGCCGTTGCAAAAC F T L E G K Q V L V A Q V N P V P L Q N I E I D G K S V V V A E V V P L L P N L CGTCCGGCGCACTACCGAGGTGTTGCCTACCTGCGGCAATCCGATGGAGACTACGGAATG R P A H Y R G V A Y L R Q S D G D Y G M K P A T Y Q G R A Y L R Q A D G D Y V M AACGATGCTGATCTCGCACTCGTTGAGATCCAGAAGCTTTCTCATTCTGAGAACTTCCAG N D A D L A L V E I Q K L S H S E N F Q N A N D L H M V Q V A G L H H S Q H H R TTCGATGTAGTCCCAGTCTTGAACTCTTCAACCCGAGACTTAGACTCTGTTCGGGTAAAG F D V V P V L N S S T R D L D S V R V K Y D L I P V E G T G I G D L D D T L V Q AGTTTCCTCGAGGCTGCGCGCGCGGGAAGCCGCATCCTGTCCAAGAAAATTGATGACCAA S F L E A A R A G S R I L S K K I D D Q Q Y L T R V R A T S S R L R S V E D D A GAACTGCTTGAAACTCTCAATATCGTGACGGTAAAAGGGTGAACTCACGCTGGCCGGAAT E L L E T L N I V T V K G * T T L A G I D L L R L T G I I D H D G V A - T V A G L CTACGCCCTGGGTGAGTATCCGCAGGGTAAGGCTCCACAGCTACGCATTACAGCGGCAGT Y A L G E Y P Q G K A P Q L R I T A A V Y G L G F Y P Q G R L P A L G V T A A V GCAACTGCCACGCGAAGGCGGCAGTGTGCGTACTAGGAATATGCAGGACTTTGAAGGCCC Q L P R E G G S V R T R N M Q D F E G P R L P R D G S G V R T Q N L E H F D G P TCTTCCTGACCTGCTCGAATCCGCACTGACGTGGGTAAAACAGAATGCGCCGACGCAGAA L P D L L E S A L T W V K Q N A P T Q N L P A L L E S V V E W V S R N I S M S Q TGTTTACGACTCCAGTGGACACATGCGCAAGGAGAGCGTCTACCCGTTGCCTGCCGTCCG V Y D S S G H M R K E S V Y P L P A V R V Y R P D G N M E K R P E F P L N A V R CGAACTGATCGCAAATGCCTTGGTGCACCGCGATCTAAGCCCCAATTCTGATGGA--AAA E L I A N A L V H R D L S P N S D G K E I V A N A L V H R D L G P D S L G VG K TGGGTGGAGATTAGGCTTTGCGACGATCGCCTCGTCATCTCTAATCCGGGTGGACTTCGG W V E I R L C D D R L V I S N P G G L R K V E I R L S P E A L V V V N P G G L R GGAGTCTCAGTCAAACAGCTAGAGAGTGCAACTCTTTCCAAGAACGCAGTAAATCCCCGC G V S V K Q L E S A T L S K N A V N P R G V S V D Q L T S A E L S K A A V N Q R CTTTATGACATTGCTAAACGAGTCCGCACC-------GAAGGCGCTGGTATCCAAGAAGT L Y D I A K R V R T E G A G I Q E V L Y E A S K F L T T QDGASVI E G E G I R E T ATTGAGGCAAACCTGTCAGGCACTGTTGGCAAAACCTCAACTCATTGATACTGGTGTGCA L R Q T C Q A L L A K P Q L I D T G V Q L A S M R D A D L H R P R F I D T G V Q GTTCACTGCGATCCTCTATGGTGCCTCAGTTTTCAGCGAAGCAGAGTTGGAGTGGCTGCG F T A I L Y G A S V F S E A E L E W L R F K V I L R R G P V F T P E D R A H L N CAGCATTGGA-GGAGATGGCCTTACCGCCGTCGAAAAGCACCTGCTAGTAGGGCTACGAA S I G G D G L T A V E K H L L V G L R A L A Q G E V L T H M Q K V L V L G L A AAGGGGAAAGCTGGCATTTGTCTAGGATCCTCAATGAGTTTTCGCCCATAACCGTGGCCG K G E S W H L S R I L N E F S P I T V A R D E E W T I T R M C S E F S P L T R S AGGCGGAAAAACTCATGCATGGTTTGAAGAAGCGTGGCTTCATT--GAGAGTGATAATAA E A E K L M H G L K K R G F I E S D N K E A L A Q V D G L T A R G L V KV E S D H L GACTTTCACTCTAGGAGCACACAGTGAGAATCAAGCGCCC----CGCGTGGAAAAAGAGG T F T L G A H S E N Q A P R V E K E T W T G R R R T D N P T P NPDE R G R E N AAACAACTCTG----------GCAAAGATCACCAAGAATGCGCCAACAATAGCCCACGCA E T T L A K I T K N A P T I A H A Q T Q L RGLPGSSQRS T R V T K N G P V I L D A CTAGAACTCAAGCCAGAACAGAGCTTTGAAGAACTGCTGCGCACCACAGGTTTGAGCCAG L E L K P E Q S F E E L L R T T G L S Q L R H A G N Q T V G E L V S R T A L T D GGGCAGCTGAGATTTGCGCTCGATAAACTGCAAGCTGTCGGGCTAGTTGTGCGCGAAGGA G Q L R F A L D K L Q A V G L V V R E G G Q V R Y A L A V L V D A G S V V M H G GGCTGGGGCGTTCACGGAACCACCTATCACTGGAGTGCGCAAACCTAA G W G V H G T T Y H W S A Q Q G S H A T T Y S V P D --------- // >fig|6666666.67454.peg.184 fig|257309.1.peg.2305 gi|372118535|gb|CP003217.1|_178117_177956,gi|372118535|gb|CP003217.1|_177952_177935 MAWLGLADVGGRWWARHPRSPPKKTALHTKFSQTAGFLAIWCEVRRKILRNTPVxRCFQF We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCTTGGCTGGGATTGGCTGACGTTGGTGGGCGTTGGTGGGCGCGCCACCCCCGCTCA M A W L G L A D V G G R W W A R H P R S M A W L G L A D V G G R W W A R H P R S CCCCCGAAAAAGACGGCACTTCACACCAAATTCAGTCAAACGGCCGGTTTTCTTGCGATT P P K K T A L H T K F S Q T A G F L A I P P K K T A L H T K F S Q T A G F L A I TGGTGTGAAGTTCGGAGAAAAATCCTTCGAAATACCCCCGTTTAGCGGTGCTTCCAGTTT W C E V R R K I L R N T P V * R C F Q F W C E V R R K I L R N T P V X R C F Q F TAG --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2305): ATGGCTTGGCTGGGATTGGCT*GA*---CGTTGGTGGGCGTTGGTGGGCGCGCCACCCCC M A W L G L A R W W A L V G A P P P M A W L G L T *G**VGG R W W A L V G A P P P GCTCACCCCCGAAAAAGACGGCACTTCACACCAAATTCAGTCAAACGGCCGGTTTTCTTG L T P E K T A L H T K F S Q T A G F L L T P E K - T A L H T K S A Q T A G L E CGATTTGGTGTGAAGTTCGGAGAAAAATCCTTCGAAATACCCCCGTTTAGCGGTGCTTCC A I W C E V R R K I L R N T P V * R C F A I W C E V L R K I L R N T P E W W L F AGTTTTAG Q F R F --- // >fig|6666666.67454.peg.1330 fig|196164.1.peg.240 Mobile element protein gi|372118535|gb|CP003217.1|_1354767_1354495,gi|372118535|gb|CP003217.1|_1354493_1354344,gi|372118535|gb|CP003217.1|_1354340_1354227,gi|372118535|gb|CP003217.1|_1354223_1354218,gi|372118535|gb|CP003217.1|_1354216_1354106,gi|372118535|gb|CP003217.1|_1354102_1354091,gi|372118535|gb|CP003217.1|_1354091_1353411 MTSVARRDPADKTKIDAIEKKLLANPDIAKLIDKLGTSTTDANNLVWGMLQTSITRGLNAEMDAHLGYESGDRSAKATAGTNNHRNGSYPKYVDSHYGPVTVDVPRDRAGTFLPTMVPKGSRRLTDVDDMIVSLYAGGMTIxGYPASYGNCDACRLFPMRRSPQSPTPSSRRSWSGKTTSxTNEFYPVVFLDALRIKVRDGGRVINKSAYMAMGVDLDGIxAHFxxCGLPKKKALHFWAQVCANLSNRGVKDVFIVCCDGYKKGLPEAVEATWPNSMVQTCIVHLIRAANRWVAYGERRGVSAALRKIYTATDESTAQAVLDEFEASGLGEKYPRSVKVWWDAWARFVPFLQFPPAARKVIYTTNSIESFSNELRKATRNRVQFTNDESALKTLWLMICSIEDRRVAKRAKQGKCVSATAGRLMEGARVSGWKQAINQMVVAFPGRFDKYL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACTAGTGTGGCACGACGAGATCCGGCTGATAAAACCAAGATTGATGCGATTGAAAAG M T S V A R R D P A D K T K I D A I E K M T S V A R R D P A D K T K I D A I E K AAACTGCTTGCTAACCCTGACATCGCGAAACTCATTGACAAGCTAGGCACGTCCACCACG K L L A N P D I A K L I D K L G T S T T K L L A N P D I A K L I D K L G T S T T GATGCCAACAACCTGGTTTGGGGCATGTTGCAAACCTCGATCACTAGGGGTTTGAATGCT D A N N L V W G M L Q T S I T R G L N A D A N N L V W G M L Q T S I T R G L N A GAGATGGATGCCCACCTTGGCTACGAGTCTGGCGACAGGAGTGCTAAAGCTACTGCTGGG E M D A H L G Y E S G D R S A K A T A G E M D A H L G Y E S G D R S A K A T A G ACAAACAATCACCGTAACGGGTCGTATCCAAAGATACGTGGATTCTCACTACGGGCCGGT T N N H R N G S Y P K Y V D S H Y G P V T N N H R N G S Y P K - Y V D S H Y G P V TACGGTTGATGTGCCTAGGGATCGGGCTGGAACATTCTTGCCGACTATGGTCCCTAAAGG T V D V P R D R A G T F L P T M V P K G T V D V P R D R A G T F L P T M V P K G CTCGAGGAGATTGACCGACGTTGATGACATGATCGTCAGCTTGTATGCCGGTGGGATGAC S R R L T D V D D M I V S L Y A G G M T S R R L T D V D D M I V S L Y A G G M T GATTTAAGGATATCCAGCATCATATGGCAACTGCGATGCGTGTCGATTATTTCCCATGAG I * G Y P A S Y G N C D A C R L F P M R I X G Y P A S Y G N C D A C R L F P M R ACGATCTCCGCAGTCACCGACGCCGTCCTCGAGGCGGTCATGGTCTGGCAAAACCACCAG R S P Q S P T P S S R R S W S G K T T S R S P Q S P T P S S R R S W S G K T T S TTAGACGAATTGAATTCTACCCCGTAGTGTTTCTCGATGCACTGCGCATTAAAGTCCGCG * T N E F Y P V V F L D A L R I K V R X T N - E F Y P V V F L D A L R I K V R ACGGTGGCCGAGTGATCAACAAGTCCGCGTACATGGCAATGGGTGTGGATCTTGACGGTA D G G R V I N K S A Y M A M G V D L D G D G G R V I N K S A Y M A M G V D L D G TTTAAGCACATTTT*GG*GGTTGTGGATTGCCAAAGAAGAAGGCGCTTCATTTTTGGGCG I * A H F G C G L P K K K A L H F W A I X A H F *X** X C G L P K K K A L H F W A CAGGTATGTGCCAATCTTTCTAACCGTGGGGTCAAAGACGTTTTTATCGTCTGCTGTGAC Q V C A N L S N R G V K D V F I V C C D Q V C A N L S N R G V K D V F I V C C D GGGTATAAAAAAGGCCTGCCAGAAGCAGTCGAGGCAACCTGGCCGAACTCGATGGTGCAA G Y K K G L P E A V E A T W P N S M V Q G Y K K G L P E A V E A T W P N S M V Q ACCTGTATCGTGCACCTGATTCGCGCAGCTAACCGATGGGTAGCCTACGGGGAGCGCCGG T C I V H L I R A A N R W V A Y G E R R T C I V H L I R A A N R W V A Y G E R R GGCGTATCGGCCGCGTTGAGAAAGATTTACACCGCCACAGACGAATCCACAGCTCAGGCT G V S A A L R K I Y T A T D E S T A Q A G V S A A L R K I Y T A T D E S T A Q A GTTTTAGACGAATTTGAAGCCTCTGGATTGGGAGAAAAGTATCCCCGCTCAGTCAAGGTC V L D E F E A S G L G E K Y P R S V K V V L D E F E A S G L G E K Y P R S V K V TGGTGGGATGCTTGGGCGCGTTTCGTACCGTTTCTGCAGTTCCCGCCAGCAGCTAGGAAG W W D A W A R F V P F L Q F P P A A R K W W D A W A R F V P F L Q F P P A A R K GTCATCTATACGACGAATTCGATTGAATCATTCAGCAATGAGCTGCGTAAAGCTACTCGC V I Y T T N S I E S F S N E L R K A T R V I Y T T N S I E S F S N E L R K A T R AACAGGGTGCAGTTCACCAACGATGAATCAGCGCTGAAAACGCTGTGGTTGATGATCTGC N R V Q F T N D E S A L K T L W L M I C N R V Q F T N D E S A L K T L W L M I C AGTATTGAAGATAGACGAGTTGCCAAGAGGGCGAAGCAGGGCAAATGCGTTTCAGCGACA S I E D R R V A K R A K Q G K C V S A T S I E D R R V A K R A K Q G K C V S A T GCCGGCAGACTCATGGAAGGAGCCCGAGTTTCCGGCTGGAAACAAGCCATCAACCAAATG A G R L M E G A R V S G W K Q A I N Q M A G R L M E G A R V S G W K Q A I N Q M GTCGTGGCCTTTCCCGGCCGCTTCGATAAGTACCTATGA V V A F P G R F D K Y L V V A F P G R F D K Y L --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.240): ATGACTAGTGTGGCACGACGAGATCCGGCTGATAAAACCAAGATTGATGCGATTGAAAAG M T S V A R R D P A D K T K I D A I E K M T T V A K Q D P A D S A R I K A I E E AAACTGCTTGCTAACCCTGACATCGCGAAACTCATTGACAAGCTAGGCACGTCCACCACG K L L A N P D I A K L I D K L G T S T T K L L A N P E M A K L I D E L G T S T T GATGCCAACAACCTGGTTTGGGGCATGTTGCAAACCTCGATCACTAGGGGTTTGAATGCT D A N N L V W G M L Q T S I T R G L N A D A N D L V R G L L Q A S I N R G L N A GAGATGGATGCCCACCTTGGCTACGAGTCTGGCGACAGGAGTGCTAAAGCTACTGCTGGG E M D A H L G Y E S G D R S A K A T A G E M D A H L G Y G H S D R D G K T A A G ACAAACAATCACCGTAACGGGTCGTATCCAAAGATACGTGGATTCTCACTACGGGCCGGT T N N H R N G S Y P K Y V D S H Y G P V Q G N H R N G Y Y P K - R V D S N Y G P I TACGGTTGATGTGCCTAGGGATCGGGCTGGAACATTCTTGCCGACTATGGTCCCTAAAGG T V D V P R D R A G T F L P T M V P K G D V A V P R D R N G S F L P T M V P K G CTCGAGGAGATTGACCGACGTTGATGACATGATCGTCAGCTTGTATGCCGGTGGGATGAC S R R L T D V D D M I V S L Y A G G M T S R R L T D V D D M I I S L Y A G G M T GATTTAAGGATATCCAGCATCATATGGCAACTGCGATGCGTGTCGATTATTTCCCATGAG I K D I Q H H M A T A M R V D I S H E V - R D I Q H H M I T S M G V D - I S H E ACGATCTCCGCAGTCACCGACGCCGTCCTCGAGGCGGTCATGGTCTGGCAAAACCACCAG T I S A V T D A V L E A V M V W Q N H Q T I S A I T D A V L D E V M I W Q N R Q TTAGACGAATTGAATTCTACCCCGTAGTGTTTCTCGATGCACTGCGCATTAAAGTCCGCG L D E F Y P V V F L D A L R I K V R L D D ----- F Y P V I F L D A L R I K V R ACGGTGGCCGAGTGATCAACAAGTCCGCGTACATGGCAATGGGTGTGGATCTTGACGGTA D G G R V I N K S A Y M A M G V D L D G D G G R V V N K S V Y L A I G V D M D G TTTAAGCACATTTTGGGGTTGTGGATTGCCAAAGAAGAAGGCGCTTCATTTTTGGGCGCA I K H I L G L W I A K E E G A S F W A Q I - K H I L G I W L A K E E G A S F - W A N GGTATGTGCCAATCTTTCTAACCGTGGGGTCAAAGACGTTTTTATCGTCTGCTGTGACGG V C A N L S N R G V K D V F I V C C D G V C A N L A T R G V Q D V F I V C C D G GTATAAAAAAGGCCTGCCAGAAGCAGTCGAGGCAACCTGGCCGAACTCGATGGTGCAAAC Y K G L P E A V E A T W P N S M V Q T L K --- G L P Q A V E A T W P D S M V Q T CTGTATCGTGCACCTGATTCGCGCAGCTAACCGATGGGTAGCCTACGGGGAGCGCCGGGG C I V H L I R A A N R W V A Y G E R R G C V V H L I R A A N R W V A Y G D R K A CGTATCGGCCGCGTTGAGAAAGATTTACACCGCCACAGACGAATCCACAGCTCAGGCTGT V S A A L R K I Y T A T D E S T A Q A V V S A Q L R K I Y T A P T E D T A I A A TTTAGACGAATTTGAAGCCTCTGGATTGGGAGAAAAGTATCCCCGCTCAGTCAAGGTCTG L D E F E A S G L G E K Y P R S V K V W L E E F E A S E L G V K Y P Q S A K V W GTGGGATGCTTGGGCGCGTTTCGTACCGTTTCTGCAGTTCCCGCCAGCAGCTAGGAAGGT W D A W A R F V P F L Q F P P A A R K V R D A W D R F I P F L Q F P P M A R K V CATCTATACGACGAATTCGATTGAATCATTCAGCAATGAGCTGCGTAAAGCTACTCGCAA I Y T T N S I E S F S N E L R K A T R N I Y T T N S I E S M N N E L R K A T R N CAGGGTGCAGTTCACCAACGATGAATCAGCGCTGAAAACGCTGTGGTTGATGATCTGCAG R V Q F T N D E S A L K T L W L M I C S R V Q F T N D E S A I K T L W L M I C N TATTGAAGATAGACGAGTTGCCAAGAGGGCGAAGCAGGGCAAATGCGTTTCAGCGACAGC I E D R R V A K R A K Q G K C V S A T A I E D K R A A K R A K Q G K R V A A S S CGGCAGACTCATGGAAGGAGCCCGAGTTTCCGGCTGGAAACAAGCCATCAACCAAATGGT G R L M E G A R V S G W K Q A I N Q M V G R L I E G R K V A N W K Q A I N Q M A CGTGGCCTTTCCCGGCCGCTTCGATAAGTACCTATGA V A F P G R F D K Y L V A F P D R F E A Y L --- // >fig|6666666.67454.peg.2298 fig|257309.1.peg.2244 Anthranilate synthase, aminase component (EC 4.1.3.27) # TrpAa FIG011663 gi|372118535|gb|CP003217.1|_2364828_2365400,gi|372118535|gb|CP003217.1|_2365400_2366383 MADFHVSARKVRYHEDAADIFHHLGGTSASDSVLLESADIDSKKNTTSMAVLQAAVRVTCMGQTVTATPLTSTGHAMVARLQEHFGTSGTEFSFHRSELHDERQRLLDTNNAEILRLLQCEAGYSGEQLPLLAGGFAFDYMETFEQLPSVPVGDNSYPDYQFVVAETVLVTDHLKRSAVIEGVSVDPAELxxRLDSLVATIDSHKTVEEGPATTATNEILTVRADISDVDFCQSVSALQDNIQAGDIYQAVPARSFSAPCESAYAAYRHLRTINPSPYMFYVRGITPISCNSNKTYELIGASPESNLKFDSRTREVQLYPIAGTRPRGLNPDGSINHELDIRAELDMRTNVKEIAEHTMLVDLARNDLARVSLPTTRRVAELLQVDRYSRVMHLVSRVVATLDPEFDAIDAYRACMNMGTLTGAPKLRAIELLRGIEAKRRGSYGGAVGYLQGDGSMDTCIVIRSAFIQDGVAVVQAGAGVVRDSIPQSEADETLHKAYAILHAIALAAGKDLEVIRS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCAGATTTCCATGTATCCGCCCGCAAGGTGCGCTATCACGAGGATGCCGCCGACATC M A D F H V S A R K V R Y H E D A A D I M A D F H V S A R K V R Y H E D A A D I TTCCATCATCTTGGCGGGACCTCGGCTAGCGATTCTGTTCTTTTAGAGTCTGCAGATATT F H H L G G T S A S D S V L L E S A D I F H H L G G T S A S D S V L L E S A D I GATTCTAAGAAGAACACCACATCCATGGCAGTACTTCAAGCAGCGGTTCGCGTGACATGC D S K K N T T S M A V L Q A A V R V T C D S K K N T T S M A V L Q A A V R V T C ATGGGGCAGACCGTGACAGCCACGCCCCTAACATCTACGGGCCATGCAATGGTGGCGCGC M G Q T V T A T P L T S T G H A M V A R M G Q T V T A T P L T S T G H A M V A R CTACAGGAGCACTTTGGCACGAGCGGCACGGAGTTCAGTTTTCATCGCTCCGAGCTTCAC L Q E H F G T S G T E F S F H R S E L H L Q E H F G T S G T E F S F H R S E L H GACGAACGCCAGCGCCTCCTTGACACCAATAATGCCGAGATTCTTCGCCTCCTACAGTGC D E R Q R L L D T N N A E I L R L L Q C D E R Q R L L D T N N A E I L R L L Q C GAGGCCGGCTATTCCGGTGAGCAGTTACCACTTCTTGCCGGCGGTTTCGCCTTTGATTAC E A G Y S G E Q L P L L A G G F A F D Y E A G Y S G E Q L P L L A G G F A F D Y ATGGAGACATTTGAGCAATTACCCTCTGTGCCAGTGGGGGATAATTCTTATCCCGATTAC M E T F E Q L P S V P V G D N S Y P D Y M E T F E Q L P S V P V G D N S Y P D Y CAGTTTGTGGTGGCAGAAACAGTGCTGGTCACCGATCATCTCAAGCGCAGCGCGGTCATC Q F V V A E T V L V T D H L K R S A V I Q F V V A E T V L V T D H L K R S A V I GAGGGCGTGTCCGTTGACCCTGCAGAGTTG*GG*GATCGACTAGATTCCCTTGTTGCCAC E G V S V D P A E L D R L D S L V A T E G V S V D P A E L *X** X R L D S L V A T GATTGACAGCCATAAAACAGTCGAGGAAGGTCCCGCGACCACGGCAACCAATGAGATATT I D S H K T V E E G P A T T A T N E I L I D S H K T V E E G P A T T A T N E I L GACTGTGCGTGCCGATATTTCTGATGTGGATTTTTGCCAAAGCGTAAGCGCACTGCAGGA T V R A D I S D V D F C Q S V S A L Q D T V R A D I S D V D F C Q S V S A L Q D CAATATCCAGGCGGGAGACATCTATCAGGCGGTTCCAGCACGCAGCTTTAGCGCGCCCTG N I Q A G D I Y Q A V P A R S F S A P C N I Q A G D I Y Q A V P A R S F S A P C TGAGAGTGCTTATGCAGCTTATAGACACTTGCGCACAATCAATCCCAGCCCCTATATGTT E S A Y A A Y R H L R T I N P S P Y M F E S A Y A A Y R H L R T I N P S P Y M F TTACGTGCGCGGCATTACCCCCATTTCATGCAATTCAAATAAAACATATGAGCTGATAGG Y V R G I T P I S C N S N K T Y E L I G Y V R G I T P I S C N S N K T Y E L I G AGCGTCGCCGGAGTCTAATCTCAAGTTCGATTCCAGAACACGCGAGGTACAATTGTATCC A S P E S N L K F D S R T R E V Q L Y P A S P E S N L K F D S R T R E V Q L Y P GATCGCCGGTACCCGGCCACGGGGACTTAACCCCGACGGGAGTATTAATCACGAACTCGA I A G T R P R G L N P D G S I N H E L D I A G T R P R G L N P D G S I N H E L D TATTCGTGCCGAGCTGGATATGCGAACTAACGTCAAGGAAATCGCCGAACATACTATGCT I R A E L D M R T N V K E I A E H T M L I R A E L D M R T N V K E I A E H T M L GGTTGATCTTGCGCGCAATGATCTTGCACGTGTTTCATTGCCCACAACACGTCGCGTTGC V D L A R N D L A R V S L P T T R R V A V D L A R N D L A R V S L P T T R R V A AGAGTTATTGCAGGTAGATCGCTACTCCCGAGTGATGCATCTCGTTAGCCGTGTGGTGGC E L L Q V D R Y S R V M H L V S R V V A E L L Q V D R Y S R V M H L V S R V V A TACGCTGGATCCAGAGTTCGATGCTATTGACGCCTACCGTGCCTGCATGAACATGGGAAC T L D P E F D A I D A Y R A C M N M G T T L D P E F D A I D A Y R A C M N M G T GCTAACCGGTGCACCAAAATTGCGCGCAATTGAATTACTGCGAGGGATAGAAGCTAAACG L T G A P K L R A I E L L R G I E A K R L T G A P K L R A I E L L R G I E A K R TCGCGGTTCCTATGGTGGTGCGGTTGGATACCTTCAAGGAGATGGCTCCATGGATACTTG R G S Y G G A V G Y L Q G D G S M D T C R G S Y G G A V G Y L Q G D G S M D T C CATTGTCATTCGTTCCGCTTTTATTCAGGATGGGGTAGCGGTGGTGCAGGCCGGTGCCGG I V I R S A F I Q D G V A V V Q A G A G I V I R S A F I Q D G V A V V Q A G A G AGTGGTGCGGGATTCTATTCCACAATCAGAGGCCGATGAAACACTCCATAAGGCCTATGC V V R D S I P Q S E A D E T L H K A Y A V V R D S I P Q S E A D E T L H K A Y A CATTTTGCATGCCATTGCGTTGGCGGCCGGAAAGGATCTGGAGGTGATTCGCTCATGA I L H A I A L A A G K D L E V I R S I L H A I A L A A G K D L E V I R S --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.2244): ATGGCAGATTTCCATGTATCCGCCCGCAAGGTGCGCTATCACGAGGATGCCGCCGACATC M A D F H V S A R K V R Y H E D A A D I M A D F H A S A R E V R Y H E D A A D L TTCCATCATCTTGGCGGGACCTCGGCTAGCGATTCTGTTCTTTTAGAGTCTGCAGATATT F H H L G G T S A S D S V L L E S A D I F H H L G G T S A S D S V L L E S A D I GATTCTAAGAAGAACACCACATCCATGGCAGTACTTCAAGCAGCGGTTCGCGTGACATGC D S K K N T T S M A V L Q A A V R V T C K S K K N T T S M A V L Q S A V R V T C ATGGGGCAGACCGTGACAGCCACGCCCCTAACATCTACGGGCCATGCAATGGTGGCGCGC M G Q T V T A T P L T S T G H A M V A R M G Q T V T A T P L T S T G H T M V A R CTACAGGAGCACTTTGGCACGAGCGGCACGGAGTTCAGTTTTCATCGCTCCGAGCTTCAC L Q E H F G T S G T E F S F H R S E L H L Q E H F G T S G T K F S F R R S E L H GACGAACGCCAGCGCCTCCTTGACACCAATAATGCCGAGATTCTTCGCCTCCTACAGTGC D E R Q R L L D T N N A E I L R L L Q C D E R Q R L L D T N N A E I L R L L Q C GAGGCCGGCTATTCCGGTGAGCAGTTACCACTTCTTGCCGGCGGTTTCGCCTTTGATTAC E A G Y S G E Q L P L L A G G F A F D Y E A G Y S G E Q L P L L A G G F A F D Y ATGGAGACATTTGAGCAATTACCCTCTGTGCCAGTGGGGGATAATTCTTATCCCGATTAC M E T F E Q L P S V P V G D N S Y P D Y V E T F E Q L P P V P V G D N S Y P D Y CAGTTTGTGGTGGCAGAAACAGTGCTGGTCACCGATCATCTCAAGCGCAGCGCGGTCATC Q F V V A E T V L V T D H L K R S A V I Q F V V A E T V L V T D H L K R S A V I GAGGGCGTGTCCGTTGACCCTGCAGAGTTG*GG*GATCGACTAGATTCCCTTGTTGCCAC E G V S V D P A E L D R L D S L V A T E G V S I D P S E L *E** D R L D S L V A T GATTGACAGCCATAAAACAGTCGAGGAAGGTCCCGCGACCACGGCAACCAATGAGATATT I D S H K T V E E G P A T T A T N E I L I D S H E T V E E C P A T T A T N E I L GACTGTGCGTGCCGATATTTCTGATGTGGATTTTTGCCAAAGCGTAAGCGCACTGCAGGA T V R A D I S D V D F C Q S V S A L Q D T V R A D I S D V D F C Q S V S A L Q D CAATATCCAGGCGGGAGACATCTATCAGGCGGTTCCAGCACGCAGCTTTAGCGCGCCCTG N I Q A G D I Y Q A V P A R S F S A P C N I Q A G D I Y Q V V P A R S F S A P C TGAGAGTGCTTATGCAGCTTATAGACACTTGCGCACAATCAATCCCAGCCCCTATATGTT E S A Y A A Y R H L R T I N P S P Y M F E S A Y A A Y R H L R T I N P S P Y M F TTACGTGCGCGGCATTACCCCCATTTCATGCAATTCAAATAAAACATATGAGCTGATAGG Y V R G I T P I S C N S N K T Y E L I G Y V R G I T P I S C N S N K T Y E L I G AGCGTCGCCGGAGTCTAATCTCAAGTTCGATTCCAGAACACGCGAGGTACAATTGTATCC A S P E S N L K F D S R T R E V Q L Y P A S P E S N L K F D S R T R E I Q L Y P GATCGCCGGTACCCGGCCACGGGGACTTAACCCCGACGGGAGTATTAATCACGAACTCGA I A G T R P R G L N P D G S I N H E L D I A G T R P R G L N P D G S I N H E L D TATTCGTGCCGAGCTGGATATGCGAACTAACGTCAAGGAAATCGCCGAACATACTATGCT I R A E L D M R T N V K E I A E H T M L I R A E L D M R T N V K E I A E H T M L GGTTGATCTTGCGCGCAATGATCTTGCACGTGTTTCATTGCCCACAACACGTCGCGTTGC V D L A R N D L A R V S L P T T R R V A V D L A R N D L A R V S L P T T R R V A AGAGTTATTGCAGGTAGATCGCTACTCCCGAGTGATGCATCTCGTTAGCCGTGTGGTGGC E L L Q V D R Y S R V M H L V S R V V A E L L Q V D R Y S R V M H L V S R V V A TACGCTGGATCCAGAGTTCGATGCTATTGACGCCTACCGTGCCTGCATGAACATGGGAAC T L D P E F D A I D A Y R A C M N M G T T L D P E F D A I N A Y R A C M N M G T GCTAACCGGTGCACCAAAATTGCGCGCAATTGAATTACTGCGAGGGATAGAAGCTAAACG L T G A P K L R A I E L L R G I E A K R L T G A P K L R A I E L L R G V E A K R TCGCGGTTCCTATGGTGGTGCGGTTGGATACCTTCAAGGAGATGGCTCCATGGATACTTG R G S Y G G A V G Y L Q G D G S M D T C R G S Y G G A V G Y L Q G D G S M D T C CATTGTCATTCGTTCCGCTTTTATTCAGGATGGGGTAGCGGTGGTGCAGGCCGGTGCCGG I V I R S A F I Q D G V A V V Q A G A G I V I R S A F I Q D G V A V V Q A G A G AGTGGTGCGGGATTCTATTCCACAATCAGAGGCCGATGAAACACTCCATAAGGCCTATGC V V R D S I P Q S E A D E T L H K A Y A V V R D S I P Q S E A D E T L H K A Y A CATTTTGCATGCCATTGCGTTGGCGGCCGGAAAGGATCTGGAGGTGATTCGCTCATGA I L H A I A L A A G K D L E V I R V L H A I A L A A G K D L E V V R ------ // >fig|6666666.67454.peg.1328 fig|196627.4.peg.2275 site-specific recombinase gi|372118535|gb|CP003217.1|_1353210_1352746,gi|372118535|gb|CP003217.1|_1352746_1352618 MGNDSGSRGQRVGYIRVSTVEQNNQRQKELLNASGRIDRFFEDKISGRTKTARPGLGECMAYVRYCDELVVSSIDRLARSLTDLRGIVDELIGKGVTVTFLHENLAFVKDTTDPRADLMLGILGSFAEFERAIIRERQAEGITLAKKAGKYKGRxxALSTEQVAEIKRRTLAGESKAALARGFGVTRPTVYRALKGS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGGCAATGACTCTGGTTCGCGTGGGCAGCGGGTGGGCTATATCCGGGTTTCGACGGTG M G N D S G S R G Q R V G Y I R V S T V M G N D S G S R G Q R V G Y I R V S T V GAGCAGAATAATCAGCGCCAGAAAGAACTACTCAATGCTTCCGGCAGAATTGACCGGTTC E Q N N Q R Q K E L L N A S G R I D R F E Q N N Q R Q K E L L N A S G R I D R F TTTGAAGATAAGATTTCCGGCCGCACCAAGACTGCCCGCCCAGGGCTGGGGGAATGTATG F E D K I S G R T K T A R P G L G E C M F E D K I S G R T K T A R P G L G E C M GCGTATGTGCGCTACTGTGACGAACTCGTCGTCTCGTCGATCGACCGCCTCGCCCGATCG A Y V R Y C D E L V V S S I D R L A R S A Y V R Y C D E L V V S S I D R L A R S CTGACGGATCTTCGCGGCATTGTTGATGAACTTATCGGCAAAGGTGTGACTGTTACTTTT L T D L R G I V D E L I G K G V T V T F L T D L R G I V D E L I G K G V T V T F CTGCATGAGAATCTCGCGTTTGTGAAAGACACTACAGATCCGCGTGCGGATTTAATGCTG L H E N L A F V K D T T D P R A D L M L L H E N L A F V K D T T D P R A D L M L GGTATTTTAGGTTCGTTTGCGGAGTTTGAGCGGGCCATTATCCGCGAACGCCAAGCAGAG G I L G S F A E F E R A I I R E R Q A E G I L G S F A E F E R A I I R E R Q A E GGGATTACGTTGGCGAAAAAGGCCGGAAAGTACAAAGGCCGCTAC*CT*GCTCTAAGCAC G I T L A K K A G K Y K G R Y A L S T G I T L A K K A G K Y K G R X *X** A L S T AGAGCAGGTAGCGGAGATTAAGCGGCGCACACTGGCGGGGGAGTCGAAAGCAGCCTTGGC E Q V A E I K R R T L A G E S K A A L A E Q V A E I K R R T L A G E S K A A L A GCGGGGCTTCGGCGTTACCCGCCCTACGGTGTACCGGGCGTTGAAAGGCTCCTAA R G F G V T R P T V Y R A L K G S R G F G V T R P T V Y R A L K G S --- ========== Now we show an alignment against a similar protein (fig|196627.4.peg.2275): -ATGGGCAATGAC-----TCTGGTTCGCGTGGGCAGCGGGTGGGCTATATCCGGGTTTCG M G N D S G S R G Q R V G Y I R V S M F G S S FKEQT T N P R S Q R V S Y L R V S ACGGTGGAGCAGAATAATCAGCGCCAGAAAGAACTACTCAATGCTTCCGGCAGAATTGAC T V E Q N N Q R Q K E L L N A S G R I D S T D Q N L A R Q R E A V N H S G H I D CGGTTCTTTGAAGATAAGATTTCCGGCCGCACCAAGACTGCCCGCCCAGGGCTGGGGGAA R F F E D K I S G R T K T A R P G L G E R E F T D E L S G G A K S H R P G L E D TGTATGGCGTATGTGCGCTACTGTGACGAACTCGTCGTCTCGTCGATCGACCGCCTCGCC C M A Y V R Y C D E L V V S S I D R L A C I N Y L R E D D V L V V A S I D R L A CGATCGCTGACGGATCTTCGCGGCATTGTTGATGAACTTATCGGCAAAGGTGTGACTGTT R S L T D L R G I V D E L I G K G V T V R S L V D L R V I I D R I T D K G A S V ACTTTTCTGCATGAGAATCTCGCGTTTGTGAAAGACACTACAGATCCGCGTGCGGATTTA T F L H E N L A F V K D T T D P R A D L I F L K E N L T F A A G R D D P R A N L ATGCTGGGTATTTTAGGTTCGTTTGCGGAGTTTGAGCGGGCCATTATCCGCGAACGCCAA M L G I L G S F A E F E R A I I R E R Q M L G I L G S F A E F E R S I I R E R Q GCAGAGGGGATTACGTTGGCGAAAAAGGCCGGAAAGTACAAAGGCCGC*TA*CCTGCTCT A E G I T L A K K A G K Y K G R P A L A E G I A L A K K A G K Y A G R *P** K A L AAGCACAGAGCAGGTAGCGGAGATTAAGCGGCGCACACTGGCGGGGGAGTCGAAAGCAGC S T E Q V A E I K R R T L A G E S K A A D K E Q I Q E A K D M I A Q G E T K S A CTTGGCGCGGGGCTTCGGCGTTACCCGCCCTACGGTGTACCGGGCGTTGAAAGGCTCCTA L A R G F G V T R P T V Y R A L K G S * V A K H F G I N R S T L Y E Y L K N P D A // >fig|6666666.67454.peg.1376 fig|196164.1.peg.1820 Ribonucleotide reductase transcriptional regulator NrdR FIG000382 gi|372118535|gb|CP003217.1|_1401846_1401394,gi|372118535|gb|CP003217.1|_1401390_1401325 MYCPFCHNDQSRVIDSRVIDSGSAIRRRRECTQCKNRFTTVEKAQLLVVKRNGLTEPFSREKVIVGVRRACQGRDVSDDALKRLAQQVEERVRLHGSSQIHANEIGLAILEPLRELDEVAYLRFASVYKSFESADDFESEIRLMRRRDRSNxPQENKQWFLLSALQAVGTTAY We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. GTGTACTGTCCTTTTTGTCATAATGATCAGTCTCGTGTGATCGACTCTCGTGTGATTGAT V Y C P F C H N D Q S R V I D S R V I D M Y C P F C H N D Q S R V I D S R V I D TCAGGTTCGGCGATTAGAAGACGTCGCGAATGTACACAGTGTAAGAACCGGTTTACTACA S G S A I R R R R E C T Q C K N R F T T S G S A I R R R R E C T Q C K N R F T T GTTGAAAAAGCACAACTCTTAGTGGTCAAACGCAATGGGCTTACCGAGCCTTTTAGTAGG V E K A Q L L V V K R N G L T E P F S R V E K A Q L L V V K R N G L T E P F S R GAAAAGGTTATCGTAGGTGTCCGTCGTGCATGCCAAGGCCGAGATGTAAGTGATGATGCA E K V I V G V R R A C Q G R D V S D D A E K V I V G V R R A C Q G R D V S D D A TTGAAACGGCTTGCGCAACAAGTAGAAGAGCGAGTTCGTTTGCATGGCAGCTCACAGATT L K R L A Q Q V E E R V R L H G S S Q I L K R L A Q Q V E E R V R L H G S S Q I CACGCTAACGAGATAGGTCTTGCCATTTTGGAGCCACTGCGGGAACTAGATGAAGTAGCT H A N E I G L A I L E P L R E L D E V A H A N E I G L A I L E P L R E L D E V A TATCTGCGGTTTGCATCAGTATATAAATCGTTTGAAAGCGCTGATGATTTCGAATCTGAG Y L R F A S V Y K S F E S A D D F E S E Y L R F A S V Y K S F E S A D D F E S E ATTCGGTTGATGCGACGGCGGGATAGGTCGAATTAGCCTCAAGAAAATAAGCAGTGGTTC I R L M R R R D R S N * P Q E N K Q W F I R L M R R R D R S N X P Q E N K Q W F CTACTCTCTGCTCTACAAGCAGTAGGAACCACTGCTTATTAA L L S A L Q A V G T T A Y L L S A L Q A V G T T A Y --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.1820): ------------------GTGTACTGTCCTTTTTGTCATAATGATCAGTCTCGTGTGATC V Y C P F C H N D Q S R V I MSVPLHRGVGDAEGRITR M Y C P F C Q H G H S R V I GACTCTCGTGTGATTGATTCAGGTTCGGCGATTAGAAGACGTCGCGAATGTACACAGTGT D S R V I D S G S A I R R R R E C T Q C D S R V I E A G S A I R R R R E C S Q C AAGAACCGGTTTACTACAGTTGAAAAAGCACAACTCTTAGTGGTCAAACGCAATGGGCTT K N R F T T V E K A Q L L V V K R N G L Q G R F T T I E K A V L L V L K R N G V ACCGAGCCTTTTAGTAGGGAAAAGGTTATCGTAGGTGTCCGTCGTGCATGCCAAGGCCGA T E P F S R E K V I V G V R R A C Q G R T E P F S R E K V V T G V R R A C Q G R GATGTAAGTGATGATGCATTGAAACGGCTTGCGCAACAAGTAGAAGAGCGAGTTCGTTTG D V S D D A L K R L A Q Q V E E R V R L D V S D D S L K R L A Q Q V E E T V R S CATGGCAGCTCACAGATTCACGCTAACGAGATAGGTCTTGCCATTTTGGAGCCACTGCGG H G S S Q I H A N E I G L A I L E P L R S G S S Q V R A N D I G L A I L D P L R GAACTAGATGAAGTAGCTTATCTGCGGTTTGCATCAGTATATAAATCGTTTGAAAGCGCT E L D E V A Y L R F A S V Y K S F E S A E L D E V A Y L R F A S V Y K S F E S A GATGATTTCGAATCTGAGATTCGGTTGATGCGACGGCGGGATAGGTCGAATTAGCCTCAA D D F E S E I R L M R R R D R S N * P Q D D F E K E I R L M R R Q S R E K Q V Q GAAAATAAGCAGTGGTTCCTACTCTCTGCTCTACAAGCAGTAGGAACCACTGCTTATTAA E N Q G ------------------------------------------------------ // >fig|6666666.67454.peg.292 fig|257309.1.peg.354 Uncharacterized protein SCO4203 FIG003217 gi|372118535|gb|CP003217.1|_293626_293015,gi|372118535|gb|CP003217.1|_293013_292804 MADHAHNLRATFGHGRPIGVITRGTTGFNRLRRCDRWMAHHPLIQQALRRTSDPIALDVGYGASFTTTVEWARWLRTMRNDVRVTGLEIDPERVLPPRDGVTFELGGFELAGYQPTLVRAFNVLRQYDADQVVDAWEMVTSRLQPGGFFVEGTCDELGRRSTWVLLNHTGPQSLTLCWDPLDVERPSDIAERLPKILIHRNVAGVAGEKIHDVLLRADEAWDRCAPWASYGPRVRWRAARAMLMDMGIPMSIIRRPVRDNQLTVPWSIVDPTT We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGCTGATCATGCCCATAATTTGCGCGCCACTTTTGGGCATGGTCGTCCCATTGGTGTG M A D H A H N L R A T F G H G R P I G V M A D H A H N L R A T F G H G R P I G V ATTACTCGGGGGACCACTGGGTTTAATCGCCTCCGGCGTTGTGACCGCTGGATGGCTCAT I T R G T T G F N R L R R C D R W M A H I T R G T T G F N R L R R C D R W M A H CATCCGCTGATCCAGCAGGCGCTGCGCCGCACCAGCGACCCTATCGCTCTTGACGTGGGG H P L I Q Q A L R R T S D P I A L D V G H P L I Q Q A L R R T S D P I A L D V G TACGGGGCAAGTTTTACCACCACGGTCGAGTGGGCTCGTTGGTTGCGCACCATGCGTAAC Y G A S F T T T V E W A R W L R T M R N Y G A S F T T T V E W A R W L R T M R N GACGTCCGCGTCACCGGCTTAGAAATAGACCCAGAACGGGTCCTGCCGCCGCGCGATGGT D V R V T G L E I D P E R V L P P R D G D V R V T G L E I D P E R V L P P R D G GTGACCTTTGAACTTGGGGGTTTTGAATTAGCGGGTTACCAGCCCACCTTAGTGCGCGCT V T F E L G G F E L A G Y Q P T L V R A V T F E L G G F E L A G Y Q P T L V R A TTTAACGTGCTGCGCCAATATGATGCGGACCAAGTCGTGGATGCTTGGGAGATGGTGACC F N V L R Q Y D A D Q V V D A W E M V T F N V L R Q Y D A D Q V V D A W E M V T TCGCGCCTACAACCTGGCGGATTTTTTGTGGAAGGCACCTGTGATGAGTTGGGGCGGCGG S R L Q P G G F F V E G T C D E L G R R S R L Q P G G F F V E G T C D E L G R R TCAACGTGGGTGTTGTTGAATCATACTGGCCCGCAGTCGCTGACGCTGTGCTGGGATCCA S T W V L L N H T G P Q S L T L C W D P S T W V L L N H T G P Q S L T L C W D P CTTGATGTAGAGCGCCCTTCCGATATTGCGGAGCGGTTGCCTAAGATTTTGATCCACCGC L D V E R P S D I A E R L P K I L I H R L D V E R P S D I A E R L P K I L I H R AATGTTGCGGGATGTTGCGGGCGAAAAAATTCATGATGTGTTGCTTCGTGCCGACGAAGC N V A G V A G E K I H D V L L R A D E A N V A G - V A G E K I H D V L L R A D E A GTGGGATCGCTGCGCCCCGTGGGCCTCGTATGGCCCTCGCGTTCGGTGGCGGGCGGCCCG W D R C A P W A S Y G P R V R W R A A R W D R C A P W A S Y G P R V R W R A A R AGCGATGCTTATGGATATGGGAATTCCGATGAGCATTATTCGCCGTCCGGTGCGCGATAA A M L M D M G I P M S I I R R P V R D N A M L M D M G I P M S I I R R P V R D N TCAGCTCACGGTGCCGTGGTCGATCGTCGATCCAACCACCTAG Q L T V P W S I V D P T T Q L T V P W S I V D P T T --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.354): ATGGCTGATCATGCCCATAATTTGCGCGCCACTTTTGGGCATGGTCGTCCCATTGGTGTG M A D H A H N L R A T F G H G R P I G V M A D H A H N L R A T F G H G R P I G V ATTACTCGGGGGACCACTGGGTTTAATCGCCTCCGGCGTTGTGACCGCTGGATGGCTCAT I T R G T T G F N R L R R C D R W M A H I T R G T T G F N R L R R C D R W M A H CATCCGCTGATCCAGCAGGCGCTGCGCCGCACCAGCGACCCTATCGCTCTTGACGTGGGG H P L I Q Q A L R R T S D P I A L D V G H P L I Q Q A L R R T S D P I A L D V G TACGGGGCAAGTTTTACCACCACGGTCGAGTGGGCTCGTTGGTTGCGCACCATGCGTAAC Y G A S F T T T V E W A R W L R T M R N Y G A S F T T T V E W A R W L R T M R D GACGTCCGCGTCACCGGCTTAGAAATAGACCCAGAACGGGTCCTGCCGCCGCGCGATGGT D V R V T G L E I D P E R V L P P R D G D V R V T G L E I D P E R V L P P R D G GTGACCTTTGAACTTGGGGGTTTTGAATTAGCGGGTTACCAGCCCACCTTAGTGCGCGCT V T F E L G G F E L A G Y Q P T L V R A V T F E L G G F E L A G Y Q P T L V R A TTTAACGTGCTGCGCCAATATGATGCGGACCAAGTCGTGGATGCTTGGGAGATGGTGACC F N V L R Q Y D A D Q V V D A W E M V T F N V L R Q Y D V D Q V M D A W E M V T TCGCGCCTACAACCTGGCGGATTTTTTGTGGAAGGCACCTGTGATGAGTTGGGGCGGCGG S R L Q P G G F F V E G T C D E L G R R S R L Q P G G F F V E G T C D E L G R R TCAACGTGGGTGTTGTTGAATCATACTGGCCCGCAGTCGCTGACGCTGTGCTGGGATCCA S T W V L L N H T G P Q S L T L C W D P S T W V L L N H A G P Q S L T L C W D P CTTGATGTAGAGCGCCCTTCCGATATTGCGGAGCGGTTGCCTAAGATTTTGATCCACCGC L D V E R P S D I A E R L P K I L I H R F D V E R P S D I A E R L P K I L I H R AATGTTGCGGGATGTTGCGGGCGAAAAAATTCATGATGTGTTGCTTCGTGCCGACGAAGC N V A G E K I H D V L L R A D E A N V A G ---------- E K I H D V L L R T D E A GTGGGATCGCTGCGCCCCGTGGGCCTCGTATGGCCCTCGCGTTCGGTGGCGGGCGGCCCG W D R C A P W A S Y G P R V R W R A A R W D R C A P W A S Y G P R V R W R A A R AGCGATGCTTATGGATATGGGAATTCCGATGAGCATTATTCGCCGTCCGGTGCGCGATAA A M L M D M G I P M S I I R R P V R D N A M L M D M G I P M S I I R R P V R D N TCAGCTCACGGTGCCGTGGTCGATCGTCGATCCAACCACCTAG Q L T V P W S I V D P T T Q L T V P W S I V D P T T --- // >fig|6666666.67454.peg.1332 fig|196164.1.peg.240 Mobile element protein gi|372118535|gb|CP003217.1|_1354767_1354495,gi|372118535|gb|CP003217.1|_1354493_1354344,gi|372118535|gb|CP003217.1|_1354340_1354227,gi|372118535|gb|CP003217.1|_1354223_1354218,gi|372118535|gb|CP003217.1|_1354216_1354106,gi|372118535|gb|CP003217.1|_1354102_1354091,gi|372118535|gb|CP003217.1|_1354091_1353411 MTSVARRDPADKTKIDAIEKKLLANPDIAKLIDKLGTSTTDANNLVWGMLQTSITRGLNAEMDAHLGYESGDRSAKATAGTNNHRNGSYPKYVDSHYGPVTVDVPRDRAGTFLPTMVPKGSRRLTDVDDMIVSLYAGGMTIxGYPASYGNCDACRLFPMRRSPQSPTPSSRRSWSGKTTSxTNEFYPVVFLDALRIKVRDGGRVINKSAYMAMGVDLDGIxAHFxxCGLPKKKALHFWAQVCANLSNRGVKDVFIVCCDGYKKGLPEAVEATWPNSMVQTCIVHLIRAANRWVAYGERRGVSAALRKIYTATDESTAQAVLDEFEASGLGEKYPRSVKVWWDAWARFVPFLQFPPAARKVIYTTNSIESFSNELRKATRNRVQFTNDESALKTLWLMICSIEDRRVAKRAKQGKCVSATAGRLMEGARVSGWKQAINQMVVAFPGRFDKYL We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACTAGTGTGGCACGACGAGATCCGGCTGATAAAACCAAGATTGATGCGATTGAAAAG M T S V A R R D P A D K T K I D A I E K M T S V A R R D P A D K T K I D A I E K AAACTGCTTGCTAACCCTGACATCGCGAAACTCATTGACAAGCTAGGCACGTCCACCACG K L L A N P D I A K L I D K L G T S T T K L L A N P D I A K L I D K L G T S T T GATGCCAACAACCTGGTTTGGGGCATGTTGCAAACCTCGATCACTAGGGGTTTGAATGCT D A N N L V W G M L Q T S I T R G L N A D A N N L V W G M L Q T S I T R G L N A GAGATGGATGCCCACCTTGGCTACGAGTCTGGCGACAGGAGTGCTAAAGCTACTGCTGGG E M D A H L G Y E S G D R S A K A T A G E M D A H L G Y E S G D R S A K A T A G ACAAACAATCACCGTAACGGGTCGTATCCAAAGATACGTGGATTCTCACTACGGGCCGGT T N N H R N G S Y P K Y V D S H Y G P V T N N H R N G S Y P K - Y V D S H Y G P V TACGGTTGATGTGCCTAGGGATCGGGCTGGAACATTCTTGCCGACTATGGTCCCTAAAGG T V D V P R D R A G T F L P T M V P K G T V D V P R D R A G T F L P T M V P K G CTCGAGGAGATTGACCGACGTTGATGACATGATCGTCAGCTTGTATGCCGGTGGGATGAC S R R L T D V D D M I V S L Y A G G M T S R R L T D V D D M I V S L Y A G G M T GATTTAAGGATATCCAGCATCATATGGCAACTGCGATGCGTGTCGATTATTTCCCATGAG I * G Y P A S Y G N C D A C R L F P M R I X G Y P A S Y G N C D A C R L F P M R ACGATCTCCGCAGTCACCGACGCCGTCCTCGAGGCGGTCATGGTCTGGCAAAACCACCAG R S P Q S P T P S S R R S W S G K T T S R S P Q S P T P S S R R S W S G K T T S TTAGACGAATTGAATTCTACCCCGTAGTGTTTCTCGATGCACTGCGCATTAAAGTCCGCG * T N E F Y P V V F L D A L R I K V R X T N - E F Y P V V F L D A L R I K V R ACGGTGGCCGAGTGATCAACAAGTCCGCGTACATGGCAATGGGTGTGGATCTTGACGGTA D G G R V I N K S A Y M A M G V D L D G D G G R V I N K S A Y M A M G V D L D G TTTAAGCACATTTT*GG*GGTTGTGGATTGCCAAAGAAGAAGGCGCTTCATTTTTGGGCG I * A H F G C G L P K K K A L H F W A I X A H F *X** X C G L P K K K A L H F W A CAGGTATGTGCCAATCTTTCTAACCGTGGGGTCAAAGACGTTTTTATCGTCTGCTGTGAC Q V C A N L S N R G V K D V F I V C C D Q V C A N L S N R G V K D V F I V C C D GGGTATAAAAAAGGCCTGCCAGAAGCAGTCGAGGCAACCTGGCCGAACTCGATGGTGCAA G Y K K G L P E A V E A T W P N S M V Q G Y K K G L P E A V E A T W P N S M V Q ACCTGTATCGTGCACCTGATTCGCGCAGCTAACCGATGGGTAGCCTACGGGGAGCGCCGG T C I V H L I R A A N R W V A Y G E R R T C I V H L I R A A N R W V A Y G E R R GGCGTATCGGCCGCGTTGAGAAAGATTTACACCGCCACAGACGAATCCACAGCTCAGGCT G V S A A L R K I Y T A T D E S T A Q A G V S A A L R K I Y T A T D E S T A Q A GTTTTAGACGAATTTGAAGCCTCTGGATTGGGAGAAAAGTATCCCCGCTCAGTCAAGGTC V L D E F E A S G L G E K Y P R S V K V V L D E F E A S G L G E K Y P R S V K V TGGTGGGATGCTTGGGCGCGTTTCGTACCGTTTCTGCAGTTCCCGCCAGCAGCTAGGAAG W W D A W A R F V P F L Q F P P A A R K W W D A W A R F V P F L Q F P P A A R K GTCATCTATACGACGAATTCGATTGAATCATTCAGCAATGAGCTGCGTAAAGCTACTCGC V I Y T T N S I E S F S N E L R K A T R V I Y T T N S I E S F S N E L R K A T R AACAGGGTGCAGTTCACCAACGATGAATCAGCGCTGAAAACGCTGTGGTTGATGATCTGC N R V Q F T N D E S A L K T L W L M I C N R V Q F T N D E S A L K T L W L M I C AGTATTGAAGATAGACGAGTTGCCAAGAGGGCGAAGCAGGGCAAATGCGTTTCAGCGACA S I E D R R V A K R A K Q G K C V S A T S I E D R R V A K R A K Q G K C V S A T GCCGGCAGACTCATGGAAGGAGCCCGAGTTTCCGGCTGGAAACAAGCCATCAACCAAATG A G R L M E G A R V S G W K Q A I N Q M A G R L M E G A R V S G W K Q A I N Q M GTCGTGGCCTTTCCCGGCCGCTTCGATAAGTACCTATGA V V A F P G R F D K Y L V V A F P G R F D K Y L --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.240): ATGACTAGTGTGGCACGACGAGATCCGGCTGATAAAACCAAGATTGATGCGATTGAAAAG M T S V A R R D P A D K T K I D A I E K M T T V A K Q D P A D S A R I K A I E E AAACTGCTTGCTAACCCTGACATCGCGAAACTCATTGACAAGCTAGGCACGTCCACCACG K L L A N P D I A K L I D K L G T S T T K L L A N P E M A K L I D E L G T S T T GATGCCAACAACCTGGTTTGGGGCATGTTGCAAACCTCGATCACTAGGGGTTTGAATGCT D A N N L V W G M L Q T S I T R G L N A D A N D L V R G L L Q A S I N R G L N A GAGATGGATGCCCACCTTGGCTACGAGTCTGGCGACAGGAGTGCTAAAGCTACTGCTGGG E M D A H L G Y E S G D R S A K A T A G E M D A H L G Y G H S D R D G K T A A G ACAAACAATCACCGTAACGGGTCGTATCCAAAGATACGTGGATTCTCACTACGGGCCGGT T N N H R N G S Y P K Y V D S H Y G P V Q G N H R N G Y Y P K - R V D S N Y G P I TACGGTTGATGTGCCTAGGGATCGGGCTGGAACATTCTTGCCGACTATGGTCCCTAAAGG T V D V P R D R A G T F L P T M V P K G D V A V P R D R N G S F L P T M V P K G CTCGAGGAGATTGACCGACGTTGATGACATGATCGTCAGCTTGTATGCCGGTGGGATGAC S R R L T D V D D M I V S L Y A G G M T S R R L T D V D D M I I S L Y A G G M T GATTTAAGGATATCCAGCATCATATGGCAACTGCGATGCGTGTCGATTATTTCCCATGAG I K D I Q H H M A T A M R V D I S H E V - R D I Q H H M I T S M G V D - I S H E ACGATCTCCGCAGTCACCGACGCCGTCCTCGAGGCGGTCATGGTCTGGCAAAACCACCAG T I S A V T D A V L E A V M V W Q N H Q T I S A I T D A V L D E V M I W Q N R Q TTAGACGAATTGAATTCTACCCCGTAGTGTTTCTCGATGCACTGCGCATTAAAGTCCGCG L D E F Y P V V F L D A L R I K V R L D D ----- F Y P V I F L D A L R I K V R ACGGTGGCCGAGTGATCAACAAGTCCGCGTACATGGCAATGGGTGTGGATCTTGACGGTA D G G R V I N K S A Y M A M G V D L D G D G G R V V N K S V Y L A I G V D M D G TTTAAGCACATTTTGGGGTTGTGGATTGCCAAAGAAGAAGGCGCTTCATTTTTGGGCGCA I K H I L G L W I A K E E G A S F W A Q I - K H I L G I W L A K E E G A S F - W A N GGTATGTGCCAATCTTTCTAACCGTGGGGTCAAAGACGTTTTTATCGTCTGCTGTGACGG V C A N L S N R G V K D V F I V C C D G V C A N L A T R G V Q D V F I V C C D G GTATAAAAAAGGCCTGCCAGAAGCAGTCGAGGCAACCTGGCCGAACTCGATGGTGCAAAC Y K G L P E A V E A T W P N S M V Q T L K --- G L P Q A V E A T W P D S M V Q T CTGTATCGTGCACCTGATTCGCGCAGCTAACCGATGGGTAGCCTACGGGGAGCGCCGGGG C I V H L I R A A N R W V A Y G E R R G C V V H L I R A A N R W V A Y G D R K A CGTATCGGCCGCGTTGAGAAAGATTTACACCGCCACAGACGAATCCACAGCTCAGGCTGT V S A A L R K I Y T A T D E S T A Q A V V S A Q L R K I Y T A P T E D T A I A A TTTAGACGAATTTGAAGCCTCTGGATTGGGAGAAAAGTATCCCCGCTCAGTCAAGGTCTG L D E F E A S G L G E K Y P R S V K V W L E E F E A S E L G V K Y P Q S A K V W GTGGGATGCTTGGGCGCGTTTCGTACCGTTTCTGCAGTTCCCGCCAGCAGCTAGGAAGGT W D A W A R F V P F L Q F P P A A R K V R D A W D R F I P F L Q F P P M A R K V CATCTATACGACGAATTCGATTGAATCATTCAGCAATGAGCTGCGTAAAGCTACTCGCAA I Y T T N S I E S F S N E L R K A T R N I Y T T N S I E S M N N E L R K A T R N CAGGGTGCAGTTCACCAACGATGAATCAGCGCTGAAAACGCTGTGGTTGATGATCTGCAG R V Q F T N D E S A L K T L W L M I C S R V Q F T N D E S A I K T L W L M I C N TATTGAAGATAGACGAGTTGCCAAGAGGGCGAAGCAGGGCAAATGCGTTTCAGCGACAGC I E D R R V A K R A K Q G K C V S A T A I E D K R A A K R A K Q G K R V A A S S CGGCAGACTCATGGAAGGAGCCCGAGTTTCCGGCTGGAAACAAGCCATCAACCAAATGGT G R L M E G A R V S G W K Q A I N Q M V G R L I E G R K V A N W K Q A I N Q M A CGTGGCCTTTCCCGGCCGCTTCGATAAGTACCTATGA V A F P G R F D K Y L V A F P D R F E A Y L --- // >fig|6666666.67454.peg.1298 fig|257309.1.peg.716 Mobile element protein gi|372118535|gb|CP003217.1|_1327487_1326264,gi|372118535|gb|CP003217.1|_1326264_1326109 MNRSYTNTQKRTALRVYKRTQSVTKTVRELGYPGRWTLYKWLREPKTPPQPRKQAKTLTHYPYEVKLRAVELFHNGWRPADIAQECCLHTHASVYAWAQRYREEGQWGLMSKKERAGHGRIPTKAALEKSLPDNPTQLKQQMATLLVEKAVLEKELEIIKKDVSVIPGQLSNKHKTDVVDALRSTFPLAMLLAASGLAASSFYYHLKKRRMPDKHAAIRSMVHRISSDSHNTYGYRRIWWQLRHLGITISEKVVRRLMREEAITVRFPKRKVKYSSYQGEISPAPPNLVNRCFHATAANTLWLTDISVFAANEGRVYLSVIIDCFDGKVVAAKTSVNPTMELAESTLQAAIDAEGLPPDGSLVIHSDRGVHYRGRSWHSLTAKYGIVRSMSKKGCSPDNAACEGFSGxxKNEMYYGKRWQTIQELDDAIAAYIEFYNNHRIKVSLNGMSIARYRMAAVA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGCT Y P Y E V K L R A V E L F H N G W R P A Y P Y E V K L R A V E L F H N G W R P A GATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACGC D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R TACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCGC Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R ATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACAG I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q CAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGAC K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D GCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATCC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S AGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAGC S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S ATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTGG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W CAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGAA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E GAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGAA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E ATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATACG I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T TTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGTG L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V ATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTATG I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGGT E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCTG S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L ACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGCG T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GCATGCGAGGGTTTTTCGGGC*GG*ATGAAAAATGAGATGTATTACGGCAAGAGGTGGCA A C E G F S G M K N E M Y Y G K R W Q A C E G F S G *X** X K N E M Y Y G K R W Q GACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATCG T I Q E L D D A I A A Y I E F Y N N H R T I Q E L D D A I A A Y I E F Y N N H R CATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGTG I K V S L N G M S I A R Y R M A A V A I K V S L N G M S I A R Y R M A A V A -- A - ========== Now we show an alignment against a similar protein (fig|257309.1.peg.716): ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGCT Y P Y E V K L R A V E L F H N G W R P A Y P Y E V K L R A V E L F H N G W R P A GATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACGC D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R TACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCGC Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R ATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACAG I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q CAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGAC K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D GCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATCC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S AGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAGC S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S ATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTGG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W CAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGAA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E GAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGAA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E ATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATACG I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T TTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGTG L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V ATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTATG I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGGT E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCTG S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L ACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGCG T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GCATGC*GA*GGGTTTTTCGGGCGGATGAAAAATGAGATGTATTACGGCAAGAGGTGGCA A C G F F G R M K N E M Y Y G K R W Q A C *E** G F F G R M K N E M Y Y G K R W Q GACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATCG T I Q E L D D A I A A Y I E F Y N N H R T I Q E L D D A I A A Y I E F Y N N H R CATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGTG I K V S L N G M S I A R Y R M A A V A I K V S L N G M S I A R Y R M A A V A -- A - // >fig|6666666.67454.peg.1807 fig|257309.1.peg.1803 hypothetical protein gi|372118535|gb|CP003217.1|_1846927_1846748,gi|372118535|gb|CP003217.1|_1846748_1846620 MKNLSILRRNTVMSLPISEKKGGCGCGHHNETPTLDARDLSPAIRHGAILGAIGQLQSGxxMDLIAPHNPLPLLEQVYELFGASVEITYVSEDPWTLNFAKS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. TTGAAAAATTTATCTATTTTGAGGAGGAATACAGTAATGTCACTACCAATTTCGGAAAAG L K N L S I L R R N T V M S L P I S E K M K N L S I L R R N T V M S L P I S E K AAAGGTGGCTGCGGCTGCGGTCACCATAACGAGACTCCAACTCTTGATGCTCGCGATCTG K G G C G C G H H N E T P T L D A R D L K G G C G C G H H N E T P T L D A R D L TCACCGGCTATCCGGCACGGTGCAATTTTAGGTGCAATTGGCCAGCTGCAGTCGGGT*CT S P A I R H G A I L G A I G Q L Q S G S P A I R H G A I L G A I G Q L Q S G *X* *TCAATGGATCTCATAGCGCCTCATAATCCACTTCCACTTCTCGAACAGGTCTACGAACT S M D L I A P H N P L P L L E Q V Y E L * X M D L I A P H N P L P L L E Q V Y E L ATTTGGTGCATCCGTGGAAATTACATACGTGAGTGAGGATCCGTGGACGTTGAACTTCGC F G A S V E I T Y V S E D P W T L N F A F G A S V E I T Y V S E D P W T L N F A CAAGTCCTAG K S K S --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.1803): TTGAAAAATTTATCTATTTTGAGGAGGAATACAGTAATGTCACTACCAATTTCGGAAAAG L K N L S I L R R N T V M S L P I S E K M K N L S I L R R N T V M S L P I S E K AAAGGTGGCTGCGGCTGCGGTCACCATAACGAGACTCCAACTCTTGATGCTCGCGATCTG K G G C G C G H H N E T P T L D A R D L K G G C G C G H H N E T P T L D A R D L TCACCGGCTATCCGGCACGGTGCAATTTTAGGTGCAATTGGCCAGCTGCAG*TC*GGGTC S P A I R H G A I L G A I G Q L Q G S S P A I R H G A I L G A I G Q L Q *S** G S TTCAATGGATCTCATAGCGCCTCATAATCCACTTCCACTTCTCGAACAGGTCTACGAACT S M D L I A P H N P L P L L E Q V Y E L S M D L I A P H N P L P L L E Q V Y E L ATTTGGTGCATCCGTGGAAATTACATACGTGAGTGAGGATCCGTGGACGTTGAACTTCGC F G A S V E I T Y V S E D P W T L N F A F G A S V E I T Y V S E D P W T L N F A CAAGTCCTAG K S K S --- // >fig|6666666.67454.peg.1195 fig|257309.1.peg.716 Mobile element protein gi|372118535|gb|CP003217.1|_1215408_1214185,gi|372118535|gb|CP003217.1|_1214185_1214030 MNRSYTNTQKRTALRVYKRTQSVTKTVRELGYPGRWTLYKWLREPKTPPQPRKQAKTLTHYPYEVKLRAVELFHNGWRPADIAQECCLHTHASVYAWAQRYREEGQWGLMSKKERAGHGRIPTKAALEKSLPDNPTQLKQQMATLLVEKAVLEKELEIIKKDVSVIPGQLSNKHKTDVVDALRSTFPLAMLLAASGLAASSFYYHLKKRRMPDKHAAIRSMVHRISSDSHNTYGYRRIWWQLRHLGITISEKVVRRLMREEAITVRFPKRKVKYSSYQGEISPAPPNLVNRCFHATAANTLWLTDISVFAANEGRVYLSVIIDCFDGKVVAAKTSVNPTMELAESTLQAAIDAEGLPPDGSLVIHSDRGVHYRGRSWHSLTAKYGIVRSMSKKGCSPDNAACEGFSGxxKNEMYYGKRWQTIQELDDAIAAYIEFYNNHRIKVSLNGMSIARYRMAAVA We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGCT Y P Y E V K L R A V E L F H N G W R P A Y P Y E V K L R A V E L F H N G W R P A GATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACGC D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R TACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCGC Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R ATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACAG I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q CAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGAC K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D GCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATCC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S AGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAGC S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S ATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTGG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W CAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGAA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E GAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGAA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E ATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATACG I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T TTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGTG L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V ATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTATG I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGGT E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCTG S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L ACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGCG T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GCATGCGAGGGTTTTTCGGGC*GG*ATGAAAAATGAGATGTATTACGGCAAGAGGTGGCA A C E G F S G M K N E M Y Y G K R W Q A C E G F S G *X** X K N E M Y Y G K R W Q GACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATCG T I Q E L D D A I A A Y I E F Y N N H R T I Q E L D D A I A A Y I E F Y N N H R CATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGTG I K V S L N G M S I A R Y R M A A V A I K V S L N G M S I A R Y R M A A V A -- A - ========== Now we show an alignment against a similar protein (fig|257309.1.peg.716): ATGAACCGTTCCTACACCAACACGCAGAAGCGCACAGCACTGCGGGTCTACAAACGCACA M N R S Y T N T Q K R T A L R V Y K R T M N R S Y T N T Q K R T A L R V Y K R T CAATCAGTGACTAAAACAGTCCGCGAACTCGGCTACCCAGGCAGATGGACCCTGTATAAA Q S V T K T V R E L G Y P G R W T L Y K Q S V T K T V R E L G Y P G R W T L Y K TGGCTACGCGAGCCCAAAACCCCACCACAACCACGTAAACAAGCCAAAACCCTGACCCAC W L R E P K T P P Q P R K Q A K T L T H W L R E P K T P P Q P R K Q A K T L T H TACCCATACGAAGTCAAACTTCGCGCAGTAGAACTTTTCCACAATGGTTGGCGACCAGCT Y P Y E V K L R A V E L F H N G W R P A Y P Y E V K L R A V E L F H N G W R P A GATATTGCCCAGGAATGCTGCCTGCACACTCACGCCAGCGTCTATGCTTGGGCGCAACGC D I A Q E C C L H T H A S V Y A W A Q R D I A Q E C C L H T H A S V Y A W A Q R TACCGTGAGGAAGGACAATGGGGCTTGATGTCGAAAAAAGAACGCGCAGGCCATGGCCGC Y R E E G Q W G L M S K K E R A G H G R Y R E E G Q W G L M S K K E R A G H G R ATCCCTACTAAAGCAGCACTAGAAAAATCATTGCCGGATAATCCAACACAGTTAAAACAG I P T K A A L E K S L P D N P T Q L K Q I P T K A A L E K S L P D N P T Q L K Q CAGATGGCCACGCTGCTGGTAGAAAAAGCCGTGTTGGAAAAGGAGCTGGAAATTATAAAA Q M A T L L V E K A V L E K E L E I I K Q M A T L L V E K A V L E K E L E I I K AAAGACGTAAGCGTCATCCCCGGTCAGCTGAGTAATAAGCACAAAACCGACGTGGTTGAC K D V S V I P G Q L S N K H K T D V V D K D V S V I P G Q L S N K H K T D V V D GCTTTGCGTAGCACGTTTCCATTAGCAATGCTGCTCGCTGCTAGTGGTCTTGCTGCATCC A L R S T F P L A M L L A A S G L A A S A L R S T F P L A M L L A A S G L A A S AGTTTCTATTACCACCTGAAAAAACGACGCATGCCTGATAAGCACGCAGCTATTCGCAGC S F Y Y H L K K R R M P D K H A A I R S S F Y Y H L K K R R M P D K H A A I R S ATGGTGCACCGCATCAGTTCTGATTCACATAATACCTATGGTTATCGCCGTATCTGGTGG M V H R I S S D S H N T Y G Y R R I W W M V H R I S S D S H N T Y G Y R R I W W CAATTACGACATTTAGGCATAACTATCAGTGAAAAAGTAGTTCGCAGGCTCATGCGCGAA Q L R H L G I T I S E K V V R R L M R E Q L R H L G I T I S E K V V R R L M R E GAAGCAATTACGGTGCGGTTTCCGAAGCGGAAGGTGAAATATTCCAGTTATCAAGGAGAA E A I T V R F P K R K V K Y S S Y Q G E E A I T V R F P K R K V K Y S S Y Q G E ATTTCTCCGGCTCCGCCGAACCTGGTCAACCGTTGTTTTCATGCCACTGCTGCGAATACG I S P A P P N L V N R C F H A T A A N T I S P A P P N L V N R C F H A T A A N T TTGTGGCTGACTGATATTAGTGTTTTCGCTGCGAATGAGGGGCGGGTGTATTTGTCTGTG L W L T D I S V F A A N E G R V Y L S V L W L T D I S V F A A N E G R V Y L S V ATTATTGATTGTTTCGATGGCAAAGTCGTTGCTGCTAAGACGAGTGTGAATCCCACTATG I I D C F D G K V V A A K T S V N P T M I I D C F D G K V V A A K T S V N P T M GAGTTAGCAGAATCTACGCTGCAGGCCGCTATTGATGCTGAGGGTCTTCCACCGGATGGT E L A E S T L Q A A I D A E G L P P D G E L A E S T L Q A A I D A E G L P P D G TCATTAGTGATTCATTCAGATCGTGGTGTGCATTACCGTGGTCGGAGTTGGCATAGTCTG S L V I H S D R G V H Y R G R S W H S L S L V I H S D R G V H Y R G R S W H S L ACTGCGAAATATGGCATCGTTCGTTCGATGTCGAAAAAGGGGTGTAGTCCTGACAATGCG T A K Y G I V R S M S K K G C S P D N A T A K Y G I V R S M S K K G C S P D N A GCATGC*GA*GGGTTTTTCGGGCGGATGAAAAATGAGATGTATTACGGCAAGAGGTGGCA A C G F F G R M K N E M Y Y G K R W Q A C *E** G F F G R M K N E M Y Y G K R W Q GACAATCCAAGAGCTTGACGATGCCATTGCTGCTTATATCGAGTTTTATAACAATCATCG T I Q E L D D A I A A Y I E F Y N N H R T I Q E L D D A I A A Y I E F Y N N H R CATTAAAGTTAGTCTCAATGGTATGAGTATCGCGCGTTATCGCATGGCTGCGGTAGCGTG I K V S L N G M S I A R Y R M A A V A I K V S L N G M S I A R Y R M A A V A -- A - // >fig|6666666.67454.peg.742 fig|196164.1.peg.240 Mobile element protein gi|372118535|gb|CP003217.1|_733581_733793,gi|372118535|gb|CP003217.1|_733797_734852 MTTVSPRKGHDPNRVNEISAKLMENPEIAELIGELSTSTDDASDLVKGLLQASINAGLQAEMDAHLGIRALxSYGESPAGHPGWWQSPQRVVPTKTVNSGYGTFDVTMPRDRAGTFTPRMLPKGTRRLTELDDMIISLYAGGMTVRDIQHHLATTLGVDMSPDTISTITDAVLEEVMIWQNRQLDEFYPVIFLDALRVKIRDGHRVVNKSCYMAVGVDMDGIKHILGLWIADNEGASFWASVCADLANRGVQDVFIVCCDGLKGLPETVEATWPNSMVQTCIVHLIRAANRWVSYQDRKPVSSALREVYTAPTEDTARAALDAFEASELGRKYPQSVKVWRDAWDRFVPFLQFPPAARRVLYTTNSIESLNAELRKATRNRGQFPNDTAALKTLWLTDLQHRGQARCPASEESEARHRMQRLY We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGACTACCGTGTCACCGAGGAAAGGTCATGACCCGAACAGGGTCAACGAGATCAGCGCT M T T V S P R K G H D P N R V N E I S A M T T V S P R K G H D P N R V N E I S A AAGCTGATGGAAAATCCGGAAATCGCCGAACTGATCGGCGAGTTGTCGACTTCCACCGAT K L M E N P E I A E L I G E L S T S T D K L M E N P E I A E L I G E L S T S T D GATGCCAGCGACCTGGTCAAAGGTCTTTTGCAGGCATCGATCAACGCTGGTCTGCAGGCT D A S D L V K G L L Q A S I N A G L Q A D A S D L V K G L L Q A S I N A G L Q A GAAATGGACGCGCATCTGGGGATACGCGCACTCTGATCGTACGGCGAAAGCCCAGCTGGG E M D A H L G I R A L * S Y G E S P A G E M D A H L G I R A L X S Y G E S P A G CACCCCGGATGGTGGCAATCACCGCAACGGGTCGTACCGACCAAAACCGTCAACTCTGGC H P G W W Q S P Q R V V P T K T V N S G H P G W W Q S P Q R V V P T K T V N S G TACGGCACCTTTGATGTGACTATGCCCCGGGATCGAGCTGGCACGTTTACGCCGCGGATG Y G T F D V T M P R D R A G T F T P R M Y G T F D V T M P R D R A G T F T P R M CTGCCTAAAGGCACCCGCCGTCTGACGGAGCTTGATGACATGATCATCTCCCTGTACGCC L P K G T R R L T E L D D M I I S L Y A L P K G T R R L T E L D D M I I S L Y A GGTGGGATGACCGTGCGCGATATTCAGCACCACCTCGCCACCACCCTCGGGGTGGATATG G G M T V R D I Q H H L A T T L G V D M G G M T V R D I Q H H L A T T L G V D M AGCCCAGATACGATCAGCACCATTACCGACGCGGTGTTAGAAGAGGTCATGATCTGGCAA S P D T I S T I T D A V L E E V M I W Q S P D T I S T I T D A V L E E V M I W Q AACCGCCAGCTCGACGAGTTCTACCCAGTGATCTTCCTCGACGCGCTGCGAGTGAAGATC N R Q L D E F Y P V I F L D A L R V K I N R Q L D E F Y P V I F L D A L R V K I CGCGATGGCCACCGCGTGGTCAACAAGTCTTGCTACATGGCGGTAGGCGTCGACATGGAC R D G H R V V N K S C Y M A V G V D M D R D G H R V V N K S C Y M A V G V D M D GGCATCAAGCACATCCTGGGATTGTGGATCGCAGACAATGAAGGCGCCAGTTTTTGGGCA G I K H I L G L W I A D N E G A S F W A G I K H I L G L W I A D N E G A S F W A TCCGTGTGCGCTGACCTTGCCAACCGTGGGGTCCAAGACGTGTTCATCGTCTGCTGCGAC S V C A D L A N R G V Q D V F I V C C D S V C A D L A N R G V Q D V F I V C C D GGGCTCAAAGGCCTGCCGGAAACCGTGGAGGCAACCTGGCCGAATTCCATGGTGCAGACC G L K G L P E T V E A T W P N S M V Q T G L K G L P E T V E A T W P N S M V Q T TGTATAGTGCACCTGATCCGGGCGGCCAACAGGTGGGTGTCCTACCAAGACCGCAAACCC C I V H L I R A A N R W V S Y Q D R K P C I V H L I R A A N R W V S Y Q D R K P GTATCAAGTGCGCTACGGGAGGTCTACACCGCACCGACCGAGGACACCGCCCGCGCCGCC V S S A L R E V Y T A P T E D T A R A A V S S A L R E V Y T A P T E D T A R A A CTGGACGCATTCGAGGCCAGTGAACTGGGCCGTAAATACCCGCAATCGGTCAAAGTCTGG L D A F E A S E L G R K Y P Q S V K V W L D A F E A S E L G R K Y P Q S V K V W CGCGACGCCTGGGACCGGTTTGTGCCATTTTTGCAGTTCCCACCTGCGGCACGGCGGGTA R D A W D R F V P F L Q F P P A A R R V R D A W D R F V P F L Q F P P A A R R V CTCTACACCACGAATTCGATCGAATCGCTGAATGCTGAGCTGCGGAAAGCCACCCGCAAC L Y T T N S I E S L N A E L R K A T R N L Y T T N S I E S L N A E L R K A T R N CGCGGCCAGTTCCCGAACGATACCGCGGCGCTGAAAACGCTGTGGCTGACTGATCTGCAA R G Q F P N D T A A L K T L W L T D L Q R G Q F P N D T A A L K T L W L T D L Q CATCGAGGACAAGCGCGCTGCCCAGCGAGCGAAGAAAGCGAAGCGCGCCATCGAATGCAA H R G Q A R C P A S E E S E A R H R M Q H R G Q A R C P A S E E S E A R H R M Q CGGCTATATTGA R L Y R L Y --- ========== Now we show an alignment against a similar protein (fig|196164.1.peg.240): ATGACTACCGTGTCACCGAGGAAAGGTCATGACCCGAACAGGGTCAACGAGATCAGCGCT M T T V S P R K G H D P N R V N E I S A M T T V A K Q D P A D S A R I K A I E E AAGCTGATGGAAAATCCGGAAATCGCCGAACTGATCGGCGAGTTGTCGACTTCCACCGAT K L M E N P E I A E L I G E L S T S T D K L L A N P E M A K L I D E L G T S T T GATGCCAGCGACCTGGTCAAAGGTCTTTTGCAGGCATCGATCAACGCTGGTCTGCAGGCT D A S D L V K G L L Q A S I N A G L Q A D A N D L V R G L L Q A S I N R G L N A GAAATGGACGCGCATCTGGGGATACGCGCACTCTGATCGT*AC*GGCGAAAGCCCAGCTG E M D A H L G Y A H S D R G E S P A E M D A H L G - Y G H S D R *D** G K T A A GGCACCCCGGATGGTGGCAATCACCGCAACGGGTCGTACCGACCAAAA*CC*GTCAACTC G H G N H R N G Y R P K V N S G Q ---------- G N H R N G --- Y Y P K *R** V D S TGGCTACGGCACCTTTGATGTGACTATGCCCCGGGATCGAGCTGGCACGTTTACGCCGCG G Y G T F D V T M P R D R A G T F T P R N Y G P I D V A V P R D R N G S F L P T GATGCTGCCTAAAGGCACCCGCCGTCTGACGGAGCTTGATGACATGATCATCTCCCTGTA M L P K G T R R L T E L D D M I I S L Y M V P K G S R R L T D V D D M I I S L Y CGCCGGTGGGATGACCGTGCGCGATATTCAGCACCACCTCGCCACCACCCTCGGGGTGGA A G G M T V R D I Q H H L A T T L G V D A G G M T V R D I Q H H M I T S M G V D TATGAGCCCAGATACGATCAGCACCATTACCGACGCGGTGTTAGAAGAGGTCATGATCTG M S P D T I S T I T D A V L E E V M I W I S H E T I S A I T D A V L D E V M I W GCAAAACCGCCAGCTCGACGAGTTCTACCCAGTGATCTTCCTCGACGCGCTGCGAGTGAA Q N R Q L D E F Y P V I F L D A L R V K Q N R Q L D D F Y P V I F L D A L R I K GATCCGCGATGGCCACCGCGTGGTCAACAAGTCTTGCTACATGGCGGTAGGCGTCGACAT I R D G H R V V N K S C Y M A V G V D M V R D G G R V V N K S V Y L A I G V D M GGACGGCATCAAGCACATCCTGGGATTGTGGATCGCAGACAATGAAGGCGCCAGTTTTTG D G I K H I L G L W I A D N E G A S F W D G I K H I L G I W L A K E E G A S F W GGCATCCGTGTGCGCTGACCTTGCCAACCGTGGGGTCCAAGACGTGTTCATCGTCTGCTG A S V C A D L A N R G V Q D V F I V C C A N V C A N L A T R G V Q D V F I V C C CGACGGGCTCAAAGGCCTGCCGGAAACCGTGGAGGCAACCTGGCCGAATTCCATGGTGCA D G L K G L P E T V E A T W P N S M V Q D G L K G L P Q A V E A T W P D S M V Q GACCTGTATAGTGCACCTGATCCGGGCGGCCAACAGGTGGGTGTCCTACCAAGACCGCAA T C I V H L I R A A N R W V S Y Q D R K T C V V H L I R A A N R W V A Y G D R K ACCCGTATCAAGTGCGCTACGGGAGGTCTACACCGCACCGACCGAGGACACCGCCCGCGC P V S S A L R E V Y T A P T E D T A R A A V S A Q L R K I Y T A P T E D T A I A CGCCCTGGACGCATTCGAGGCCAGTGAACTGGGCCGTAAATACCCGCAATCGGTCAAAGT A L D A F E A S E L G R K Y P Q S V K V A L E E F E A S E L G V K Y P Q S A K V CTGGCGCGACGCCTGGGACCGGTTTGTGCCATTTTTGCAGTTCCCACCTGCGGCACGGCG W R D A W D R F V P F L Q F P P A A R R W R D A W D R F I P F L Q F P P M A R K GGTACTCTACACCACGAATTCGATCGAATCGCTGAATGCTGAGCTGCGGAAAGCCACCCG V L Y T T N S I E S L N A E L R K A T R V I Y T T N S I E S M N N E L R K A T R CAACCGCGGCCAGTTCCCGAACGATACCGCGGCGCTGAAAACGCTGTGGCTGACTGATCT N R G Q F P N D T A A L K T L W L L I N R V Q F T N D E S A I K T L W L - M I GCAACATCGAGGACAAGCGCGCTGCCCAGCGAGCGAAGAAAGCGAAGCGCGCCATCGAAT C N I E D K R A A Q R A K K A K R A I E C N I E D K R A A K R A K Q G K R V A A GCAACGGC----------------------------TATATTGA C N G Y I S S G RLIEGRKVANWKQAINQMAVAFPDRFEA Y L -- // >fig|6666666.67454.peg.193 fig|257309.1.peg.257 Putative surface-anchored membrane protein gi|372118535|gb|CP003217.1|_186462_186914,gi|372118535|gb|CP003217.1|_186914_189703 MVDSRFYEPLGFRRSPIRRLITLLMVVVVCVGLVVSPRVPSAGAAECKGEISNVQWKNDTNIKDGVFVGSYGQGADVQFDWKVDPGAKAGDQFTLKLPNELSRLGNKDLTLTAPSGEEVAKGTWDDVAKTWTFTLTDYANSHGDISGSAFxxVQWDRSVAQSNTQYPLTFSGCKGAGTLNGKTPEEGVGGTAQATSKTGLYDSKTDSARWNIYVETADTDIYTPVVVKDIGNTQLLFRCSDVKVFDRTPYPHTEIRDTPIDPNRWKCEEKDGGIIVSMVPDEHGRYLTAGQSLTIGFETPINDDTSRFITNKAIVEISPNKIENVEYSVDRGDAGGVGQGFQGKIKIQKEVVGETAPVQGNKFDFEYKCGETTQNISVAAGQTSDIFTQRSSSTCSITEKNVAEGVTVDFEVIDEETGKPAYVVPIDNGVTVKFNKNSSTTLNVKVTNTYPNKPEAKKGKFVIKKTVNGLDAGQKDKAFKFNYTCKAPDGDAYTEPQLAEVTAGRTWQSGNYPEGTICTIEEDLESAKVPGYSLISAQPKGDVTIKAEGTEGSPVEFAATNSYTKDLGSFSVQKKIEASAEAMPLLKDQEFGFKYTCGADKGEFKLKNGETKKVERIATGTKCTVEESDAKVPNGFMWTGKIEGTDLDPNDFTIVKDKTLAFTATNTYKQQYGGFTLSKNVTGDATNLEELQKRSYTFNYTCTAPTGTVLKDKVEITEETPKAIGNIPAASTCKVTEVEAPAKDTDWTVDLSVNGTWVGETAEFKVPAEGEPSISILAKNNYRQHKGSFTIEKIVDASEGIVTPKEFTFTWQCGEDKGAETVRVTNGKGRVEIDRAFPVGTKCSVKELEAEAEDARLITSWENQEFTIDKDKQHVIVSATNTYRYAESKVKIVKKLEGPAKDKAKDKTFTFDYSCVVNNEAIEGSVNITGEGATEIPESFPAGTKCTITERDASISGTTWTHRIAEDGQITIQSPAKVYQVGVTNAYSKPGFPWFIPLIPLVIIPFLPLFPHPTPAPQPAPQPTPQKPSEQQPSPKAPEKKPQKEKKVLARTGANVWMFIVIAVLLVLLGAFLRRRGNNS We believe that there may have been frameshifts and embedded stop codons, and we attempted to correct the translation. Hence, the translation does not agree perfectly with the corresponding region of DNA. ATGGTTGATTCGCGTTTTTATGAACCCCTTGGGTTCAGACGCTCCCCAATCCGCAGGCTG M V D S R F Y E P L G F R R S P I R R L M V D S R F Y E P L G F R R S P I R R L ATCACCCTGCTAATGGTGGTCGTTGTTTGCGTAGGTCTAGTGGTTTCCCCTCGTGTTCCT I T L L M V V V V C V G L V V S P R V P I T L L M V V V V C V G L V V S P R V P TCTGCTGGTGCGGCAGAGTGTAAGGGGGAGATTAGTAATGTGCAGTGGAAGAACGACACA S A G A A E C K G E I S N V Q W K N D T S A G A A E C K G E I S N V Q W K N D T AATATCAAAGATGGAGTATTTGTTGGTAGCTATGGGCAGGGGGCAGACGTTCAGTTCGAC N I K D G V F V G S Y G Q G A D V Q F D N I K D G V F V G S Y G Q G A D V Q F D TGGAAAGTTGATCCAGGCGCGAAAGCTGGCGATCAATTCACTTTGAAACTCCCTAACGAG W K V D P G A K A G D Q F T L K L P N E W K V D P G A K A G D Q F T L K L P N E CTTTCTCGATTGGGGAATAAAGATCTAACGCTTACTGCTCCTAGTGGAGAAGAAGTAGCC L S R L G N K D L T L T A P S G E E V A L S R L G N K D L T L T A P S G E E V A AAGGGAACGTGGGATGACGTAGCAAAAACGTGGACTTTTACGCTCACTGATTATGCGAAT K G T W D D V A K T W T F T L T D Y A N K G T W D D V A K T W T F T L T D Y A N AGTCATGGTGATATTTCAGGTAGTGCTTTT*TC*ACAGTTCAGTGGGATAGATCAGTTGC S H G D I S G S A F T V Q W D R S V A S H G D I S G S A F *X** X V Q W D R S V A ACAATCGAATACCCAGTATCCATTAACTTTTTCAGGATGTAAAGGGGCCGGAACCCTTAA Q S N T Q Y P L T F S G C K G A G T L N Q S N T Q Y P L T F S G C K G A G T L N TGGAAAAACGCCTGAAGAAGGTGTAGGGGGTACTGCTCAAGCAACATCAAAGACGGGCCT G K T P E E G V G G T A Q A T S K T G L G K T P E E G V G G T A Q A T S K T G L CTATGACTCCAAAACTGATTCTGCACGATGGAACATCTATGTCGAAACAGCGGATACTGA Y D S K T D S A R W N I Y V E T A D T D Y D S K T D S A R W N I Y V E T A D T D TATCTATACCCCCGTTGTTGTCAAAGATATTGGAAATACCCAGCTGCTGTTTAGGTGTTC I Y T P V V V K D I G N T Q L L F R C S I Y T P V V V K D I G N T Q L L F R C S TGATGTCAAGGTTTTTGATCGCACCCCTTACCCTCATACGGAGATCCGCGATACACCCAT D V K V F D R T P Y P H T E I R D T P I D V K V F D R T P Y P H T E I R D T P I TGATCCAAATCGATGGAAGTGCGAGGAAAAAGATGGCGGAATAATTGTCAGCATGGTGCC D P N R W K C E E K D G G I I V S M V P D P N R W K C E E K D G G I I V S M V P GGATGAGCACGGAAGGTATCTGACAGCTGGACAATCGCTGACCATCGGGTTTGAGACACC D E H G R Y L T A G Q S L T I G F E T P D E H G R Y L T A G Q S L T I G F E T P TATCAATGATGATACTTCTCGCTTTATTACGAATAAGGCGATTGTTGAAATCAGTCCTAA I N D D T S R F I T N K A I V E I S P N I N D D T S R F I T N K A I V E I S P N TAAAATCGAGAATGTGGAATACTCGGTAGACCGCGGCGACGCTGGTGGGGTGGGCCAAGG K I E N V E Y S V D R G D A G G V G Q G K I E N V E Y S V D R G D A G G V G Q G TTTTCAAGGCAAGATCAAGATTCAAAAGGAAGTAGTCGGGGAAACTGCACCTGTACAGGG F Q G K I K I Q K E V V G E T A P V Q G F Q G K I K I Q K E V V G E T A P V Q G AAACAAATTTGATTTCGAGTATAAATGTGGTGAAACAACGCAGAATATTTCCGTTGCTGC N K F D F E Y K C G E T T Q N I S V A A N K F D F E Y K C G E T T Q N I S V A A CGGACAAACCTCGGATATCTTTACCCAACGCTCTTCTTCTACATGCTCTATTACCGAAAA G Q T S D I F T Q R S S S T C S I T E K G Q T S D I F T Q R S S S T C S I T E K GAACGTTGCTGAAGGCGTTACAGTCGACTTTGAAGTAATAGATGAAGAAACGGGTAAACC N V A E G V T V D F E V I D E E T G K P N V A E G V T V D F E V I D E E T G K P AGCCTACGTTGTTCCGATCGACAATGGCGTAACGGTAAAGTTCAACAAGAACAGTTCCAC A Y V V P I D N G V T V K F N K N S S T A Y V V P I D N G V T V K F N K N S S T GACGCTAAACGTAAAGGTCACAAACACCTACCCCAATAAGCCAGAAGCTAAGAAGGGCAA T L N V K V T N T Y P N K P E A K K G K T L N V K V T N T Y P N K P E A K K G K GTTTGTTATCAAGAAGACGGTTAACGGCCTTGATGCTGGCCAGAAAGATAAAGCCTTCAA F V I K K T V N G L D A G Q K D K A F K F V I K K T V N G L D A G Q K D K A F K GTTCAATTACACCTGTAAAGCGCCAGATGGTGATGCCTACACGGAGCCTCAGCTAGCAGA F N Y T C K A P D G D A Y T E P Q L A E F N Y T C K A P D G D A Y T E P Q L A E GGTAACTGCAGGAAGAACCTGGCAATCGGGAAACTATCCTGAGGGAACAATCTGTACGAT V T A G R T W Q S G N Y P E G T I C T I V T A G R T W Q S G N Y P E G T I C T I AGAGGAAGACCTTGAGAGTGCAAAGGTTCCTGGTTACTCACTGATTTCTGCCCAACCTAA E E D L E S A K V P G Y S L I S A Q P K E E D L E S A K V P G Y S L I S A Q P K GGGAGATGTCACGATCAAAGCCGAGGGCACTGAAGGCTCCCCAGTAGAGTTCGCTGCAAC G D V T I K A E G T E G S P V E F A A T G D V T I K A E G T E G S P V E F A A T CAACTCTTATACCAAGGATCTTGGTAGCTTCTCCGTCCAGAAGAAGATCGAGGCATCGGC N S Y T K D L G S F S V Q K K I E A S A N S Y T K D L G S F S V Q K K I E A S A TGAGGCAATGCCGCTGCTCAAAGATCAAGAATTTGGCTTTAAGTACACCTGTGGAGCTGA E A M P L L K D Q E F G F K Y T C G A D E A M P L L K D Q E F G F K Y T C G A D CAAAGGCGAGTTTAAGCTCAAAAACGGCGAAACAAAGAAGGTTGAAAGGATTGCTACTGG K G E F K L K N G E T K K V E R I A T G K G E F K L K N G E T K K V E R I A T G CACAAAATGCACCGTCGAGGAGTCGGATGCCAAGGTGCCAAACGGCTTTATGTGGACTGG T K C T V E E S D A K V P N G F M W T G T K C T V E E S D A K V P N G F M W T G GAAGATCGAGGGCACAGATCTTGATCCTAACGACTTCACGATTGTGAAGGATAAAACCCT K I E G T D L D P N D F T I V K D K T L K I E G T D L D P N D F T I V K D K T L AGCCTTTACTGCCACCAACACCTATAAGCAACAGTATGGTGGCTTCACACTGTCCAAGAA A F T A T N T Y K Q Q Y G G F T L S K N A F T A T N T Y K Q Q Y G G F T L S K N CGTTACCGGTGACGCAACCAACCTAGAAGAATTGCAGAAGCGTTCTTACACGTTTAACTA V T G D A T N L E E L Q K R S Y T F N Y V T G D A T N L E E L Q K R S Y T F N Y CACCTGCACCGCACCAACTGGCACTGTCCTAAAAGACAAGGTTGAGATCACTGAGGAAAC T C T A P T G T V L K D K V E I T E E T T C T A P T G T V L K D K V E I T E E T CCCGAAGGCAATCGGCAACATTCCAGCAGCCTCTACCTGTAAGGTCACGGAAGTCGAGGC P K A I G N I P A A S T C K V T E V E A P K A I G N I P A A S T C K V T E V E A CCCTGCTAAAGACACTGACTGGACTGTTGACTTAAGCGTTAATGGAACGTGGGTAGGAGA P A K D T D W T V D L S V N G T W V G E P A K D T D W T V D L S V N G T W V G E AACCGCGGAGTTTAAGGTTCCTGCTGAAGGTGAGCCGTCGATAAGCATTCTTGCAAAGAA T A E F K V P A E G E P S I S I L A K N T A E F K V P A E G E P S I S I L A K N CAACTACCGCCAGCACAAGGGAAGCTTCACGATTGAAAAGATTGTGGATGCATCGGAAGG N Y R Q H K G S F T I E K I V D A S E G N Y R Q H K G S F T I E K I V D A S E G TATCGTCACGCCGAAGGAATTTACGTTCACGTGGCAGTGCGGCGAGGATAAAGGAGCTGA I V T P K E F T F T W Q C G E D K G A E I V T P K E F T F T W Q C G E D K G A E GACCGTCCGGGTTACCAATGGCAAGGGCCGTGTAGAAATTGACCGCGCATTCCCAGTGGG T V R V T N G K G R V E I D R A F P V G T V R V T N G K G R V E I D R A F P V G CACCAAATGTTCAGTGAAAGAGCTGGAGGCCGAGGCTGAAGACGCAAGGCTCATTACAAG T K C S V K E L E A E A E D A R L I T S T K C S V K E L E A E A E D A R L I T S CTGGGAAAACCAGGAATTCACGATCGACAAAGATAAGCAACACGTGATTGTTTCTGCGAC W E N Q E F T I D K D K Q H V I V S A T W E N Q E F T I D K D K Q H V I V S A T GAATACCTACAGGTACGCAGAAAGCAAGGTCAAGATTGTGAAGAAGCTTGAAGGTCCGGC N T Y R Y A E S K V K I V K K L E G P A N T Y R Y A E S K V K I V K K L E G P A AAAGGATAAGGCAAAAGACAAGACCTTTACTTTCGATTACAGCTGCGTTGTTAATAACGA K D K A K D K T F T F D Y S C V V N N E K D K A K D K T F T F D Y S C V V N N E GGCTATTGAAGGTTCTGTGAACATCACTGGTGAGGGTGCAACTGAGATTCCTGAGTCCTT A I E G S V N I T G E G A T E I P E S F A I E G S V N I T G E G A T E I P E S F CCCTGCAGGTACCAAGTGCACCATTACTGAGCGGGATGCAAGTATCTCTGGAACCACGTG P A G T K C T I T E R D A S I S G T T W P A G T K C T I T E R D A S I S G T T W GACACATCGGATTGCAGAGGATGGTCAGATCACCATTCAGAGTCCGGCTAAGGTGTATCA T H R I A E D G Q I T I Q S P A K V Y Q T H R I A E D G Q I T I Q S P A K V Y Q AGTCGGTGTAACCAATGCTTACTCCAAGCCTGGTTTCCCTTGGTTCATCCCGCTGATTCC V G V T N A Y S K P G F P W F I P L I P V G V T N A Y S K P G F P W F I P L I P GCTTGTGATCATTCCGTTCCTACCGTTGTTCCCGCATCCAACTCCTGCACCGCAGCCAGC L V I I P F L P L F P H P T P A P Q P A L V I I P F L P L F P H P T P A P Q P A TCCACAGCCGACACCGCAGAAACCGTCGGAACAGCAGCCTTCCCCCAAGGCTCCTGAAAA P Q P T P Q K P S E Q Q P S P K A P E K P Q P T P Q K P S E Q Q P S P K A P E K GAAGCCACAGAAGGAGAAGAAGGTTCTGGCACGCACTGGCGCTAACGTATGGATGTTTAT K P Q K E K K V L A R T G A N V W M F I K P Q K E K K V L A R T G A N V W M F I TGTTATCGCTGTACTCCTTGTGCTGTTGGGAGCATTCCTCCGCAGGCGCGGTAACAACTC V I A V L L V L L G A F L R R R G N N S V I A V L L V L L G A F L R R R G N N S ATAG --- ========== Now we show an alignment against a similar protein (fig|257309.1.peg.257): ATGGTTGATTCGCGTTTTTATGAACCCCTTGGGTTCAGACGCTCCCCAATCCGCAGGCTG M V D S R F Y E P L G F R R S P I R R L M V D S R F Y E P L G F R R S P I R R L ATCACCCTGCTAATGGTGGTCGTTGTTTGCGTAGGTCTAGTGGTTTCCCCTCGTGTTCCT I T L L M V V V V C V G L V V S P R V P I T L L M V V V V C V G L V V S P R V P TCTGCTGGTGCGGCAGAGTGTAAGGGGGAGATTAGTAATGTGCAGTGGAAGAACGACACA S A G A A E C K G E I S N V Q W K N D T S A G A A E C K G E I S N V Q W K N D T AATATCAAAGATGGAGTATTTGTTGGTAGCTATGGGCAGGGGGCAGACGTTCAGTTCGAC N I K D G V F V G S Y G Q G A D V Q F D N I K D G V F V G S Y G Q G A D V Q F D TGGAAAGTTGATCCAGGCGCGAAAGCTGGCGATCAATTCACTTTGAAACTCCCTAACGAG W K V D P G A K A G D Q F T L K L P N E W K V D P G A K A G D Q F T L K L P N E CTTTCTCGATTGGGGAATAAAGATCTAACGCTTACTGCTCCTAGTGGAGAAGAAGTAGCC L S R L G N K D L T L T A P S G E E V A L S R L G N K D L T L T A P S G E E V A AAGGGAACGTGGGATGACGTAGCAAAAACGTGGACTTTTACGCTCACTGATTATGCGAAT K G T W D D V A K T W T F T L T D Y A N K G T W D D V A K T W T F T L T D Y A N AGTCATGGTGATATTTCAGGTAGT*GC*TTTTTCACAGTTCAGTGGGATAGATCAGTTGC S H G D I S G S F F T V Q W D R S V A S H G D I S G S *A** F F T V Q W D R S V A ACAATCGAATACCCAGTATCCATTAACTTTTTCAGGATGTAAAGGGGCCGGAACCCTTAA Q S N T Q Y P L T F S G C K G A G T L N Q S N T Q Y P L T F S G C K G A G T L N TGGAAAAACGCCTGAAGAAGGTGTAGGGGGTACTGCTCAAGCAACATCAAAGACGGGCCT G K T P E E G V G G T A Q A T S K T G L G K T P E E G V G G T A Q A T S K T G L CTATGACTCCAAAACTGATTCTGCACGATGGAACATCTATGTCGAAACAGCGGATACTGA Y D S K T D S A R W N I Y V E T A D T D Y D S K T D S A R W N I Y V E T A D T D TATCTATACCCCCGTTGTTGTCAAAGATATTGGAAATACCCAGCTGCTGTTTAGGTGTTC I Y T P V V V K D I G N T Q L L F R C S I Y T P V V V K D I G N T Q L L F R C S TGATGTCAAGGTTTTTGATCGCACCCCTTACCCTCATACGGAGATCCGCGATACACCCAT D V K V F D R T P Y P H T E I R D T P I D V K V F D R T P Y P H T K I R D T P I TGATCCAAATCGATGGAAGTGCGAGGAAAAAGATGGCGGAATAATTGTCAGCATGGTGCC D P N R W K C E E K D G G I I V S M V P D P N R W K C E E K D G G I I V S M V P GGATGAGCACGGAAGGTATCTGACAGCTGGACAATCGCTGACCATCGGGTTTGAGACACC D E H G R Y L T A G Q S L T I G F E T P D E H G R Y L T A G Q S L T I G F E T P TATCAATGATGATACTTCTCGCTTTATTACGAATAAGGCGATTGTTGAAATCAGTCCTAA I N D D T S R F I T N K A I V E I S P N I N D D T S R F I T N K A I V E I S P N TAAAATCGAGAATGTGGAATACTCGGTAGACCGCGGCGACGCTGGTGGGGTGGGCCAAGG K I E N V E Y S V D R G D A G G V G Q G K I E N V E Y S V D R G D A G G V G Q G TTTTCAAGGCAAGATCAAGATTCAAAAGGAAGTAGTCGGGGAAACTGCACCTGTACAGGG F Q G K I K I Q K E V V G E T A P V Q G F Q G K I K I Q K E V V G E T A P V Q G AAACAAATTTGATTTCGAGTATAAATGTGGTGAAACAACGCAGAATATTTCCGTTGCTGC N K F D F E Y K C G E T T Q N I S V A A N K F D F E Y K C G E T T Q N I S V A A CGGACAAACCTCGGATATCTTTACCCAACGCTCTTCTTCTACATGCTCTATTACCGAAAA G Q T S D I F T Q R S S S T C S I T E K G Q T S D I F T Q R S S S T C S I T E K GAACGTTGCTGAAGGCGTTACAGTCGACTTTGAAGTAATAGATGAAGAAACGGGTAAACC N V A E G V T V D F E V I D E E T G K P N V A E G V T V D F E V I D E E T G K P AGCCTACGTTGTTCCGATCGACAATGGCGTAACGGTAAAGTTCAACAAGAACAGTTCCAC A Y V V P I D N G V T V K F N K N S S T A Y V V P I D N G V T V K F N K N S S T GACGCTAAACGTAAAGGTCACAAACACCTACCCCAATAAGCCAGAAGCTAAGAAGGGCAA T L N V K V T N T Y P N K P E A K K G K T L N V K V T N T Y P N K P E A K K G K GTTTGTTATCAAGAAGACGGTTAACGGCCTTGATGCTGGCCAGAAAGATAAAGCCTTCAA F V I K K T V N G L D A G Q K D K A F K F V I K K T V N G L D A G Q K D K A F K GTTCAATTACACCTGTAAAGCGCCAGATGGTGATGCCTACACGGAGCCTCAGCTAGCAGA F N Y T C K A P D G D A Y T E P Q L A E F N Y T C K A P D G D A Y T E P Q L A E GGTAACTGCAGGAAGAACCTGGCAATCGGGAAACTATCCTGAGGGAACAATCTGTACGAT V T A G R T W Q S G N Y P E G T I C T I V T A G R T W Q S G N Y P E G T I C T I AGAGGAAGACCTTGAGAGTGCAAAGGTTCCTGGTTACTCACTGATTTCTGCCCAACCTAA E E D L E S A K V P G Y S L I S A Q P K E E D L E S A K V P G Y S L I S A Q P K GGGAGATGTCACGATCAAAGCCGAGGGCACTGAAGGCTCCCCAGTAGAGTTCGCTGCAAC G D V T I K A E G T E G S P V E F A A T G D V T I K A E G T E G S P V E F A A T CAACTCTTATACCAAGGATCTTGGTAGCTTCTCCGTCCAGAAGAAGATCGAGGCATCGGC N S Y T K D L G S F S V Q K K I E A S A N S Y T K D L G S F S V Q K K I E A S A TGAGGCAATGCCGCTGCTCAAAGATCAAGAATTTGGCTTTAAGTACACCTGTGGAGCTGA E A M P L L K D Q E F G F K Y T C G A D E A M P L L K D Q E F G F K Y T C G A D CAAAGGCGAGTTTAAGCTCAAAAACGGCGAAACAAAGAAGGTTGAAAGGATTGCTACTGG K G E F K L K N G E T K K V E R I A T G K G E F K L K N G E T K K V E R I A T G CACAAAATGCACCGTCGAGGAGTCGGATGCCAAGGTGCCAAACGGCTTTATGTGGACTGG T K C T V E E S D A K V P N G F M W T G T K C T V E E S D A K V P N G F M W T G GAAGATCGAGGGCACAGATCTTGATCCTAACGACTTCACGATTGTGAAGGATAAAACCCT K I E G T D L D P N D F T I V K D K T L K I E G T D L D P N D F T I V K D K T L AGCCTTTACTGCCACCAACACCTATAAGCAACAGTATGGTGGCTTCACACTGTCCAAGAA A F T A T N T Y K Q Q Y G G F T L S K N A F T A T N T Y K Q Q Y G G F T L S K N CGTTACCGGTGACGCAACCAACCTAGAAGAATTGCAGAAGCGTTCTTACACGTTTAACTA V T G D A T N L E E L Q K R S Y T F N Y V T G D A T N L E E L Q K R S Y T F N Y CACCTGCACCGCACCAACTGGCACTGTCCTAAAAGACAAGGTTGAGATCACTGAGGAAAC T C T A P T G T V L K D K V E I T E E T T C T A P T G T V L K D K V E I T E E T CCCGAAGGCAATCGGCAACATTCCAGCAGCCTCTACCTGTAAGGTCACGGAAGTCGAGGC P K A I G N I P A A S T C K V T E V E A P K A I G N I P A A S T C K V T E V E A CCCTGCTAAAGACACTGACTGGACTGTTGACTTAAGCGTTAATGGAACGTGGGTAGGAGA P A K D T D W T V D L S V N G T W V G E P A K D T D W T V D L S V N G T W V G E AACCGCGGAGTTTAAGGTTCCTGCTGAAGGTGAGCCGTCGATAAGCATTCTTGCAAAGAA T A E F K V P A E G E P S I S I L A K N T A E F K V P A E G E P S I S I L A K N CAACTACCGCCAGCACAAGGGAAGCTTCACGATTGAAAAGATTGTGGATGCATCGGAAGG N Y R Q H K G S F T I E K I V D A S E G N Y R Q H K G S F T I E K I V D A S E G TATCGTCACGCCGAAGGAATTTACGTTCACGTGGCAGTGCGGCGAGGATAAAGGAGCTGA I V T P K E F T F T W Q C G E D K G A E I V T P K E F T F T W Q C G E D K G A E GACCGTCCGGGTTACCAATGGCAAGGGCCGTGTAGAAATTGACCGCGCATTCCCAGTGGG T V R V T N G K G R V E I D R A F P V G T V R V T N G K G R V E I D R A F P V G CACCAAATGTTCAGTGAAAGAGCTGGAGGCCGAGGCTGAAGACGCAAGGCTCATTACAAG T K C S V K E L E A E A E D A R L I T S T K C S V K E L E A E A E D A R L I T S CTGGGAAAACCAGGAATTCACGATCGACAAAGATAAGCAACACGTGATTGTTTCTGCGAC W E N Q E F T I D K D K Q H V I V S A T W E N Q E F T I D K D K Q H V I V S A T GAATACCTACAGGTACGCAGAAAGCAAGGTCAAGATTGTGAAGAAGCTTGAAGGTCCGGC N T Y R Y A E S K V K I V K K L E G P A N T Y R Y A E S K V K I V K K L E G P A AAAGGATAAGGCAAAAGACAAGACCTTTACTTTCGATTACAGCTGCGTTGTTAATAACGA K D K A K D K T F T F D Y S C V V N N E K D K A K D K T F T F D Y S C V V N N E GGCTATTGAAGGTTCTGTGAACATCACTGGTGAGGGTGCAACTGAGATTCCTGAGTCCTT A I E G S V N I T G E G A T E I P E S F A I E G S V N I T G E G A T E I P E S F CCCTGCAGGTACCAAGTGCACCATTACTGAGCGGGATGCAAGTATCTCTGGAACCACGTG P A G T K C T I T E R D A S I S G T T W P A G T K C T I T E R D A S I S G T T W GACACATCGGATTGCAGAGGATGGTCAGATCACCATTCAGAGTCCGGCTAAGGTGTATCA T H R I A E D G Q I T I Q S P A K V Y Q T H R I A E D G Q I T I Q S P A K V Y Q AGTCGGTGTAACCAATGCTTACTCCAAGCCTGGTTTCCCTTGGTTCATCCCGCTGATTCC V G V T N A Y S K P G F P W F I P L I P V G V T N A Y S K P G F P W F I P L I P GCTTGTGATCATTCCGTTCCTACCGTTGTTCCCGCATCCAACTCCTGCACCGCAGCCAGC L V I I P F L P L F P H P T P A P Q P A L V I I P F L P L F P H P T P A P Q P A TCCACAGCCGACACCGCAGAAACCGTCGGAACAGCAGCCTTCCCCCAAGGCTCCTGAAAA P Q P T P Q K P S E Q Q P S P K A P E K P Q P T P Q K P S E Q Q P S P K A P E K GAAGCCACAGAAGGAGAAGAAGGTTCTGGCACGCACTGGCGCTAACGTATGGATGTTTAT K P Q K E K K V L A R T G A N V W M F I K P Q K E K K V L A R T G A N V W M F I TGTTATCGCTGTACTCCTTGTGCTGTTGGGAGCATTCCTCCGCAGGCGCGGTAACAACTC V I A V L L V L L G A F L R R R G N N S V I A V L L V L L G A F L R R R G N N S ATAG --- //