core_seqid	core_source	core_type	core_start	core_end	core_bax_acc	core_contig_acc	core_bax_acc|contig_acc	core_bax_acc_contig_acc	cenote_input_name	cenote_contig	cenote_phage_region_id	cenote_gene_start	cenote_gene_stop	cenote_gene_name	original_cenote_gene_name	cenote_gene_orient	cenote_contig_length	cenote_dtr_seq	cenote_evidence_accession	cenote_evidence_description	cenote_translation	cenote_Evidence_source	cenote_vscore_category	cenote_chunk_name	cenote_chunk_length	cenote_chunk_start	cenote_chunk_stop	UNI_lookup_ID	pangenome_partition	pangenome_method	pangenome_confidence	pangenome_overlap_length	pangenome_overlap_fraction	pangenome_matching_locus_tag
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	454681	455460	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	1	780	GCA_016802425_1_1_440	GCA_016802425_1_1_440	+	2217364	.	PRK02101	peroxide stress protein YaaA. 	MFFVLSPAKNLNEKDPCPVSEFTQPDLLAESEILMRQLRELAPQQIAELMHVSDKIALLNAERNAAWHTPFTPENAKQAVFMFNGDVYEGMDANTLNTNQIQYLQGHVRLLSGLYGLLRPLDLIQPYRLEMGTSFANLRGKNLYEFWGGIITNLLNDTLAQAGSNTLVNLASQEYFKSVNTKKLRARLITPIFKDEKNGKYKIISFYAKRARGLMVRYAAEHNITDPEMLKNFNYEGYAFNDAASNESEWVFMRSEQIK*	mmseqs_cdd	nonviral_gene	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0001	persistent	direct	high	779	0.999	GCA_016802425.1_00464
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	455991	457184	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	1311	2504	GCA_016802425_1_1_441	GCA_016802425_1_1_441	+	2217364	.	PDB:1Z19_B	Integrase	MAKIITPLSANQVKNAKPRDKLYKLSDGGLALWVYPTGGRSWKLSFVQDGRQQTISLGRYPDFSLTDAREWREEVRRKRAHGENVVNKKVRADFAFEKVARDWFVRWSKGRSEKYAGQVMRNFERWVFPAIGNLDIRQVRTADVVGCLRVMEARGIVDTLRKTKNSLKMVFAFAVGSGMMEINPVAQIGSGVFERVKTKNMTALSPSELPRLIDFLEQRNEFAVYAGRVHIHPVTRFCIYWLLLTMTRIREAALMEWSELDGEVWRIPAERKKERRGHDVPLSRAMRWVLDQARGLNVNGRFVFESVNFQGHINKESPRVAMRRSGLDTTAHGLRSLARTYLREVLKVYNDVAEKLLAHSLGTRTQTAYNRSELWEERKDAPERWGNDVLRLADNGK*	common_virus_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0002	persistent	direct	high	1193	0.999	GCA_016802425.1_00467
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	457540	457809	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	2860	3129	GCA_016802425_1_1_442	GCA_016802425_1_1_442	-	2217364	.	.	hypothetical protein	MESSDVQGRMETLAFATAPKKGGIRKSGFGRVILIKSGHIVIHNADGDSFATGYGVIAADIVSPDLKTDFDIFFPPESLLRYKKIGKKK*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0003	persistent	direct	high	269	0.996	GCA_016802425.1_00468
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	457867	458007	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	3187	3327	GCA_016802425_1_1_443	GCA_016802425_1_1_443	-	2217364	.	.	hypothetical protein	MNRDGSGCGNFGGLGKGYAEYERRNCRMPSRKKAETRTNQNQRKED*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0004	cloud	direct	high	140	0.993	GCA_016802425.1_00469
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	458004	458687	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	3324	4007	GCA_016802425_1_1_444	GCA_016802425_1_1_444	-	2217364	.	PF10979.8	Protein of unknown function (DUF2786)	MDKEKVLDKIKKCLALGRSANEHEAAQALRQAQALMEKYKVNAEDIALSKVSEQKADRKMAFKLAGWQWGVANMIADIFGCKSYQRGKTMMFYGIGNRAETSAYAFDVVYRQISADRRKFLKTCRAGKPSHRTYLADRFCGGWIASAWETVKKFEMSDEEKAIMDGYKKKEYPDMAEARTRDAKSSILQGSKMEYEALTRGMESGKQVKLHYAVNGTGFVKQIGGQT*	hhsuite_tools	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0005	persistent	direct	high	683	0.999	GCA_016802425.1_00470
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	458698	459234	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	4018	4554	GCA_016802425_1_1_445	GCA_016802425_1_1_445	-	2217364	.	PFAM:PF02384.15	DNA-methyltransferase	MQTVATKPTAKQMLAAKRAAKESTRQERAVKRAGTVKNVDRNRLSARSKAQKENIARMLSGAKVSEDEALTCGIMMRLVAAKVRRYCGEHPGVFDGAAGSRQLERYIKPSEFHAVEIQPEACKALLQNYPAAAGNLGRRKQKKPRVRKRISPSRMARPNRKQSERRMGKGAKLKYRTN*	phrogs_hmm	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0006	persistent	direct	high	536	0.998	GCA_016802425.1_00471
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	459345	459560	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	4665	4880	GCA_016802425_1_1_446	GCA_016802425_1_1_446	-	2217364	.	.	hypothetical protein	MSYLEDVKNALRVIDNLCKEALKEPESLEGYIDEIRDKADEADTSLEFLKDVINYGISDLKNVIEVFEDCV*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0007	persistent	direct	high	215	0.995	GCA_016802425.1_00472
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	459612	460103	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	4932	5423	GCA_016802425_1_1_447	GCA_016802425_1_1_447	-	2217364	.	PFAM:PF05565.10	resistance-protein	MTALTLYRCAADVQAALDYYFDSETEREDTLEAVIGQFEVKAQSVIAYIKNQEITEKMLEEHIGRMTGKLKAAKARNQSLKDYLARNMQAAGITEIKADDGTFKASFRKSEAVVILDEAQIPAEFMREAVKTEPDKTAIRKAIESGRQVAGAKIEGRKNLQIR*	common_virus_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0008	persistent	direct	high	491	0.998	GCA_016802425.1_00473
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	460100	460282	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	5420	5602	GCA_016802425_1_1_448	GCA_016802425_1_1_448	-	2217364	.	.	hypothetical protein	MANIDLTQWDGKTIGAAANPEQGYINITIGSDDLFINIEQAYAIHAALGEAVAEYEGGAQ*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0009	persistent	direct	high	182	0.995	GCA_016802425.1_00474
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	460422	461108	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	5742	6428	GCA_016802425_1_1_449	GCA_016802425_1_1_449	-	2217364	.	.	hypothetical protein	MSLILSVKDESNFKPCPAGSHHATCIRIIDLGTQLVEYQNEQKRQHKILVQWEIDPEGDPEMLMPDGRPYLISRRYTASLHSKSQLATDLKSWRGRDFTPEERDNFDLRNILGKPCLLSIAHQESSDGKTTYANISAISNKMKSYTPKHPDNAVFAFDLSDPDWANYGLLNEKLREQIAKSPEYAEAVNGRQPPAPPQKQAQAAEGQTEYPQGNAAPAEDIEDDIPFN*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0010	persistent	direct	high	686	0.999	GCA_016802425.1_00475
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	461177	461338	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	6497	6658	GCA_016802425_1_1_450	GCA_016802425_1_1_450	-	2217364	.	.	hypothetical protein	MSFHPETAYNGGGETEPYGPSPEEIKYRQSPETAETRRMTEKQAEGHIKSIIR*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0011	persistent	direct	high	161	0.994	GCA_016802425.1_00476
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	461335	461613	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	6655	6933	GCA_016802425_1_1_451	GCA_016802425_1_1_451	-	2217364	.	.	hypothetical protein	MKTRNIAFKFAVLAAVLAAGYAFGFAKGGGSRTAKGKPAGIAAMRMALAQKQAEVAELSAEIWLEERHLNADEEEAGCRRVHGDAEVPGGKE*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0012	persistent	direct	high	278	0.996	GCA_016802425.1_00477
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	461766	462098	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	7086	7418	GCA_016802425_1_1_452	GCA_016802425_1_1_452	-	2217364	.	.	hypothetical protein	MKYYGTAAYGSPDWGMERYYAREDMRQALDGWEAENRILHESGLIEIAKKSAREFVRDADGEPYAQEDWETYLTEDASRIGKDTEAAMNYAIDEREWFALAENIGRLANS*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0013	persistent	direct	high	332	0.997	GCA_016802425.1_00478
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	462239	462514	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	7559	7834	GCA_016802425_1_1_453	GCA_016802425_1_1_453	-	2217364	.	.	hypothetical protein	MSYLDQPLKHGYGNGNGSGNGSGYGNGYGKGDGSGYGNGKGDGSGSGYGNGKGDGDGSGNGDGDGNGNGSGNGSGYGNGHGNGYSNGSGNG*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0014	persistent	direct	high	275	0.996	GCA_016802425.1_00479
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	462511	462987	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	7831	8307	GCA_016802425_1_1_454	GCA_016802425_1_1_454	-	2217364	.	.	hypothetical protein	MEANKFEVKSLSDLIKVFAGIAADFEAAMGVKRADISTEFDEPQHEPQPPVTVAEQKGINDFAIGKEVIIRTYSAGVWFGVLKQKAGNEVILTKARRMYSWWAKESISLSGVARHGIRQDGSQICGELDSVWLEAIEIIPVTGGAAESIRTALEVAQS*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0015	persistent	direct	high	476	0.998	GCA_016802425.1_00480
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	463020	463220	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	8340	8540	GCA_016802425_1_1_455	GCA_016802425_1_1_455	-	2217364	.	.	hypothetical protein	MNELISRINRFGTRAKDGQSLLLKVGEICRDAAATWTTRKSESINHTAFTFTVKKDGLKEKVMIVL*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0016	persistent	direct	high	200	0.995	GCA_016802425.1_00481
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	463418	463831	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	8738	9151	GCA_016802425_1_1_456	GCA_016802425_1_1_456	-	2217364	.	.	hypothetical protein	MIHLNVHYCDEIIRHAENDKYSLIGIFPDICHIPTPQAILGRLCLSVSFSAEGMDIQTMKTGQIFLEIVRNDDVISALEIPSYDGSDTEENVSFMLHQTISGLPVSDNDRIYVRMTTHNHILSESRPLSFSWLPYHS*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0017	persistent	direct	high	413	0.998	GCA_016802425.1_00482
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	463828	464328	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	9148	9648	GCA_016802425_1_1_457	GCA_016802425_1_1_457	-	2217364	.	PFAM:PF10078.8	transcriptional-regulator	MKNCTPTNGTWFKMGATLTVAVAACTVSTPTSAIPVTHIKCLRINGQIKCVKPISPNTTPAAEHIEHVRKNPRRKAAMDRAAARIADKIALKAGGETFVSLRMKKGFTQSELATAAGLPQPYLSRIENSKQSLQDKTVQKLANALGVSPLEVRAAFERRYEYMEQA*	phrogs_hmm	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0018	persistent	direct	high	500	0.998	GCA_016802425.1_00483
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	464306	464743	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	9626	10063	GCA_016802425_1_1_458	GCA_016802425_1_1_458	-	2217364	.	.	hypothetical protein	MELTVHFNAEQDLDRLFEKDEEAVGYLENVIAMIQADSAIFDGLYKNRYFREYGEPIGPIDLEVKPILSLWGKDIKVLRVRFDSEEAAGYRIIYAPCHEKQPNGTYIRRIDILAVVNKKTDEFDYQAEHPITKRIIKDYEELYSN*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0019	persistent	direct	high	437	0.998	GCA_016802425.1_00484
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	464856	465518	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	10176	10838	GCA_016802425_1_1_459	GCA_016802425_1_1_459	-	2217364	.	PDB:2FJR_A	Repressor-protein-CI	MFSGEQLGQAISEAIKRKNVSQKEVADHFGVKQPSVSGWIKNGRIDKKHLDKLIDYFSDVVTPSHFGIETFRVLKSNEQSSIRFPRLNAEATCGAGTINDHYIEVVDYVTVAAAWAREKLGGNLNKIQVITARGDSMEPTIENGDVMFVDTAVEAFDGDGLYLLWYIDGLKAKRLQSTVGGGLMIISDNSSYRTETVRGEDLNAVRIIGRIRGAWRLSQF*	common_virus_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0020	persistent	direct	high	662	0.998	GCA_016802425.1_00485
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	465647	465877	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	10967	11197	GCA_016802425_1_1_460	GCA_016802425_1_1_460	+	2217364	.	COG4197	DNA-binding transcriptional regulator YdaS, prophage-encoded, Cro superfamily [Transcription]. 	MSIQKAVDYFGNESRLARAIGVKQPTVWAWNKKGTPPPIIRCVQIEKLTGGAVNRKDLRPDDWHLIWPELAGDQPK*	mmseqs_cdd	nonviral_gene	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0021	persistent	direct	high	230	0.996	GCA_016802425.1_00486
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	465957	466112	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	11277	11432	GCA_016802425_1_1_461	GCA_016802425_1_1_461	+	2217364	.	.	hypothetical protein	MKKQDRNRLSKKDRRLIKKAMLKAAAKGCDEVYKIAPGLKDGFELLGKQPD*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0022	persistent	direct	high	155	0.994	GCA_016802425.1_00487
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	466089	466277	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	11409	11597	GCA_016802425_1_1_462	GCA_016802425_1_1_462	-	2217364	.	.	hypothetical protein	MPSDLSFILAKELIRSGSIRLSGSTAKGQAGELAVFIRTLHQKPEESEPNTDDEYLIGLLSK*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0023	persistent	direct	high	188	0.995	GCA_016802425.1_00488
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	466450	466677	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	11770	11997	GCA_016802425_1_1_463	GCA_016802425_1_1_463	+	2217364	.	pfam14090	Helix-turn-helix domain. This helix-turn-helix domain is often found in phage proteins and is likely to be DNA-binding.	MNQKQTQCKQIVDYIRNKGCITSLEAYQNLKVTQLAARITDLEGRGFVFAKPKYKVGNCKNPVAHYSIAKSGIEP*	mmseqs_cdd	nonviral_gene	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0024	persistent	direct	high	227	0.996	GCA_016802425.1_00489
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	466674	466811	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	11994	12131	GCA_016802425_1_1_464	GCA_016802425_1_1_464	+	2217364	.	.	hypothetical protein	MSREQRIRGARLPVSAYMQAEGAGKAREALDGRVEKVKGVDDEAV*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0025	persistent	direct	high	137	0.993	GCA_016802425.1_00490
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	466795	467859	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	12115	13179	GCA_016802425_1_1_465	GCA_016802425_1_1_465	+	2217364	.	PFAM:PF06970.10	replication-initiation-O-like	MMKPSESLRAAGRPIAYYPKLAKPLGGVNAAILFGHFFYWNDKTQYESGIYRTAEEIEIETGLSVQEQRTARAKLRERGVLIETEKRIEHRIYYKLNLDAFDDLMLQHSGGGESTAPKCNINSPELQNQHSGGGESTAPKCNINSPELQNQHSGSEESTAVIRTEDLTEDLAVYTPLPPNAGNGKGGLNADAFVSADAETCGRETGEPTSPKAESDSNGNGGLSGKPKNANVPRRRKTHGVPLQEIADLYNEVLGGRLPSVQVLNDTRKRAIANRWCEMLGTAAPNGKVRFGDKETGLAWFAGFFRKVAMNPFWMGENQTGFAVGFDWIFKAGNFVKILEWHPPKTNQAARGRA*	phrogs_hmm	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0026	persistent	direct	high	1064	0.999	GCA_016802425.1_00491
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	467856	469217	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	13176	14537	GCA_016802425_1_1_466	GCA_016802425_1_1_466	+	2217364	.	PDB:3BGW_F	DNAB-Like-Replicative-Helicase	MNRIEETEAVQSLASVGAEQNILGGILIEPTAIARCAILTPEKFYQAQHRIIFRALLDMAAANEPIDIITLNDKLEARGEAENAGGLAYLIDLNQNTPSAKNISRYVGIVNDRFVERGLLKASAAIEKIAVSKDGGTVAEKLSKAADELAAAGKDAVKRETKTFGQTVEDLIGGLDKRLDGVRFGLPTGLMKLDGMTGGLPDGNLIVIAARPSMGKTVLAENIARFALKQGKAVHFQSYEMSAVELARRGMAAECNIPMQNLKTGNLTQSDYANMPIYVSQAKEWKFDVNCDLLNVDELCFLAKEKKLTTGLDLLVVDHLHIMPRAGRDEVAELGNISRRLKNLAAELNIPVVLVAQLNRGNTKQADKRPNMADIRGSGAIEQDANIIIMPHRESYYDGNENPSIAELIIAKNRDGETGTVVCGWKGQFMKFEEEPDLAWQAPKHDEYDPYSV*	rep_hall_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0027	persistent	direct	high	1361	0.999	GCA_016802425.1_00492
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	469234	469479	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	14554	14799	GCA_016802425_1_1_467	GCA_016802425_1_1_467	+	2217364	.	.	hypothetical protein	MRETCFYCNHADFKTNTGTPVRGFAKCAKARNAEERAKHYPRINHCATGAFQTASGAAIAKRTAVLGEYPPQCAEFEREGG*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0028	persistent	direct	high	245	0.996	GCA_016802425.1_00493
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	469554	470048	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	14874	15368	GCA_016802425_1_1_468	GCA_016802425_1_1_468	+	2217364	.	PFAM:PF11753.7	nucelotide-kinase	MTVRNTQTETVRTEAAPQQGGNTNPGYYKNRAFECVGFAQYLNFNLGNAFKYIWRHKEKGGREDLEKALRYLERQRADAPKFKKLKHRRYEKMYAGLKDCGFDGGTEAALLAVISAAYYIRDGEDNFAWAAACVEDLLEKMPPEAGRAPHPESPMPPETAGGGI*	common_virus_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0029	persistent	direct	high	494	0.998	GCA_016802425.1_00494
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	470225	470374	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	15545	15694	GCA_016802425_1_1_469	GCA_016802425_1_1_469	+	2217364	.	.	hypothetical protein	MDTLLSIITALSFAGAATLAVWLLVEAADAVLRRKRDGKGEDDFDGFGY*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0030	persistent	direct	high	149	0.993	GCA_016802425.1_00495
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	470402	470683	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	15722	16003	GCA_016802425_1_1_470	GCA_016802425_1_1_470	+	2217364	.	PFAM:PF05766.11	HNH-endonuclease	MAEEMRTCKACGGTKPLEKGFNAVPRKEGGVYYYKSCKTCRNKAVRQKRAEKRAAAGAGAMTAARLHGYIRAAHAACPILGAGLWTQPAGECA*	phrogs_hmm	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0031	persistent	direct	high	281	0.996	GCA_016802425.1_00496
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	470815	471054	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	16135	16374	GCA_016802425_1_1_471	GCA_016802425_1_1_471	+	2217364	.	PFAM:PF05866.10	Endodeoxyribonuclease-Rus	MPSEGAVAVYVRLIPKANKDGGANKTVIDLDNALKVALDALQGVAYHNDRQVRRIAADYADEPVTGGGLAVEVGELDEK*	common_virus_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0032	persistent	direct	high	240	1.0	GCA_016802425.1_00497
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	471321	471728	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	16641	17048	GCA_016802425_1_1_472	GCA_016802425_1_1_472	+	2217364	.	.	hypothetical protein	MNQQEFEFMNDLARAFERRYRDTRSLNRCLSIEGRYMGEEACPHKPEIGLRYGEDAMFLTLQAWAKVDAPQQEAVRISFGIGAKSQAAYEERLQAEIRRRGEGPLHLQTDLGLAAWYRAIRQAAGNDFDLLFEKV*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0033	persistent	direct	high	407	0.998	GCA_016802425.1_00498
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	471819	472979	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	17139	18299	GCA_016802425_1_1_473	GCA_016802425_1_1_473	+	2217364	.	PFAM:PF13588.5	endonuclease	MNAAAVSAVFKERIASHAEHVKKVAHICTTEETTKQALILPLLDILGFSAFDPNKVRAEYQADFPGAKSGERVDYALFCNGAPVMFIEAKSYTENLSNHCPQLSRYFNATPEIAICAITNGREWRFFTDLSNKNIMDSEPFLTVDVTMLNENDMAQLYQFRHDKFQPDALRSLAEESIYLTAFTESITESLKEVDLDFVRYVAGRANIQRQFTQRYLESIRHIVKQAVQNTVSSMVVSGLSAPKVQEEAAPVEKEQEDPTAPIIDPENNKIVTTYSERRLFDLVKSILPDDASIEAKDTESYFGVLVDGKSNRWILRYFDNKQRPSVIFPIELEESDISNIERCGLEVSGNQVIIDTPENLLRVAWLVIDSYRFCCDDENFKRKPK*	phrogs_hmm	nonviral_gene	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0034	persistent	direct	high	1160	0.999	GCA_016802425.1_00499
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	473260	474129	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	18580	19449	GCA_016802425_1_1_474	GCA_016802425_1_1_474	+	2217364	.	PFAM:PF10547.8	P22_AR-repressor-domain-protein	MNVIQSFNFNTTSPVRAFEKDGLTWFVAADVCKALEIQNPTQALEKLDDDERSMFNIGRSEIHGGGGNVNIINESGLYILILRSRKAMEQGSTAWKFRKWVTSEVLPTIRKTGGYQVGQKTTADDRTGLRRAVAALVGRKGIDYSSAYSMVHQRFNVESVEDIPAGKLPEAVAYVHALTLHTGLTGEVLDREPLPAPQPALPISGNALYDLAVAVSYGARAIQMGRDVSLPLKQLGCRQAVTMWTVWAETRSRLKAAANALEALSAHADAEHAEKIRPILPEIRNLSAV*	common_virus_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0035	shell	direct	high	869	0.999	GCA_016802425.1_00501
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	474422	474871	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	19742	20191	GCA_016802425_1_1_475	GCA_016802425_1_1_475	+	2217364	.	PDB:4DZP_B	Small-Terminase	MSGTKRKLGRPTDYTKDMADKICEKIANGRSLRSICAEDGVPPMKTIYRWLEANEEFRHQYARAREKQADYFAEEIIEIADSAQAESAAVSKAKLQIDARKWAASKIAPKKYGDKTELDVKSGDGSMRAAVRLDAEEYRKIAEDVLRRV*	hallmark_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0036	persistent	direct	high	449	0.998	GCA_016802425.1_00502
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	474933	476354	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	20253	21674	GCA_016802425_1_1_476	GCA_016802425_1_1_476	+	2217364	.	PDB:8DGC_F	Large-Terminase	MALGQFDDVETSVIRSLSSASLYMFTRRMFYQRRGYVWQRANHHAPICNALERVFNGETKRLIINIPPRYSKTEIAVVNFIAWAMGRVPDCEFIHASYSAALAVNNSVQIRNLVQHEEYRAIFPDLALAGESGHHWKTTAGGVMYATGAGGTITGFGAGRHREGFGGCIIIDDPHKADEARSEVRRQNVIDWFQNTVESRKNSPDTPIILIMQRLHEKDLAGWLLDGGNGEEWEHLCLPAIQEDGTALWPEKHDIETLRRMEQAAPYVFAGQYLQKPAPPDGGTFKPDNLQFVKALPAGNIRWVRAWDLASTANGGDYTAGGRLGVTEDGRYIIANVVRGRYGADERDRILRNTAQKDGVKTKISIPQDPGQAGKSQTLYLTRQLAGFSVSAGPESGDKVTRAGPFAAQVNIGNVMVLDDGTWDTDALIAEMRMFPNGRHDDQIDCLGRAFGELLDTRTGMIDFLRSQVEAVK*	hallmark_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0037	persistent	direct	high	1421	0.999	GCA_016802425.1_00503
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	476351	478498	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	21671	23818	GCA_016802425_1_1_477	GCA_016802425_1_1_477	+	2217364	.	CDD:pfam04860	Portal-protein	MSKKTPLSQGFIARVAAGVRYAFTGNADGWFDAGEPPAPAAQQAEGRRFDYEPFYNVGHSKPREREAVGFAQLRALADNYDVLRLVIEARKDQMECLKWTIQKRDVESTEDDESQRKDRKVDEAVAFFRSPDKEHTWADWLRILLEDLFVIDAPCIYPRKTLGGGLYALEVMDGATIKRVLDNTGRMPLPPDTAYQQILHGMAAVDYTADELIYRSRNNRSYKVYGYSPVEQIIMTVNIALKRQVHALEYYTAGSVPDALVGVPETWSADDIRRFQEYWDLLLSGETAQRRKMRFVPGELSRNFRETKQPPLKDVYDEWLARVVCFAFSVEPTPFVAQVNRSVAETSREQSLSDGMGSLKNWVKALIDDVLARYMDMAAYEFVWKGEESLNPKEQAEIYAIYKNAGILTADEIRAELGKEPLPGQGQPEPDKQDGRKPEEPPNQGAEKLGKSESPMSEDESAALIEAYLLTRIDGLAEQIAALIEGAAVDWQAGDLAAELSRAAGVVANGLDFGDWSGLSDVVEPIIRRVAEDGAVAALLRVMPEPAAGMVTNIRSRAVKWAHERAAEMVGMKRAGGGLVRNPAAEWQITEGTREMIRAQVAEAMRNGDSVQELAGRLKESHAFGNARARTIARTETAMADGMGNLIGWEGTGLVAGKQWITAKDDKVSDVCNANGGMGVIGLHEPFSHGALTIPGHPNCRCAVVPVLAGDMPES*	hallmark_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0038	persistent	direct	high	2147	1.0	GCA_016802425.1_00504
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	478566	479723	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	23886	25043	GCA_016802425_1_1_478	GCA_016802425_1_1_478	+	2217364	.	PFAM:PF04586.16	prohead-serine-protease	MTKLYAQIAKTEAQDDGTVKVWGYASSEAVDSDGEVVAAEAMKAAIPDYMKFGAVREMHGSNAAGTAIEINVEDDGRTFFGAHIVDPVAVTKVKTGVYKGFSIGGRVTARDDLNKSQITGLKLTEISLVDRPANPDAVFTCFKADKPKDEAGAADKDGKPSDKPTEEEDENPKDGDKGPKTEDKGDKDAGKKDEAGKSASVNLSESEIAALKAVLAKADKPKGGTAAKSMYQVKSPADVLMSLKWLVEDASYDNIDEAVTAQIKESAAGLAESLKALAASEADKPADGLAAKAGKSGDLAKAESADELAKAQDALKKSNDALAKAQAEIESLKKQAVPPKGSTKAISKAEDNGEDPLKGFQPIVKNDGTLDDVATLIKAKQTGRL*	hallmark_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0039	persistent	direct	high	1157	0.999	GCA_016802425.1_00505
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	479764	481263	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	25084	26583	GCA_016802425_1_1_479	GCA_016802425_1_1_479	+	2217364	.	PFAM:PF17236.1	Major-Capsid-protein	MNVNQLTQETIELMKSAQAGGGPPDKGFTQPAGFTAGLQTYDLSAPSQKLYPVLTPLRNRIPRVGGGRTIGSNWKAVTNINVGNQRAGIGEGRRGGVINHETVERNAQFRAIGLENQVTFEADYAARGFEDVKALAVAQTLQATMVAEEMILLGGNTSLKAGVTPTPTAVVSADAAGKISVSTLSVICVALGLQAYWDVAGANNGATGQSPNIKTAQVPAKITRRNADGTTDTFGGGSARKSAAASVSGIEAGKKVTAVIPAVRGAVAYAWYWGAAGSEKLGAVTTAAKVEISADAEGTQTAASLPSEDNSTSILEFDGLLTQIALPDSGAFWSDNKGGGLTSDNAGGVYEFEEAFAHFFTRYRLSPDTVYVNARDLAALTKLIIGNSGAPLIKLNVDVNNTANIRAGVVVGSYMNKITGDDLNIVVHPNLPAGTYLFYSSRLPAYVQGVGNLLQVRTRQEYYQIEWPLRTRMYEYGVYADEVLQGMFMPAFGMITNVG*	hallmark_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0040	persistent	direct	high	1499	0.999	GCA_016802425.1_00506
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	481315	481623	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	26635	26943	GCA_016802425_1_1_480	GCA_016802425_1_1_480	+	2217364	.	.	hypothetical protein	MTVKLKAPEGFTDVSFGSQSYAADENGIVEVPSEAAEFLYQFGFGNVASEPAEGPEKAKRGRKPKTGQPAGQSEPAEPAEAEAEAAEPAEAEAEPAEAEKAE*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0041	persistent	direct	high	308	0.997	GCA_016802425.1_00507
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	481626	482156	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	26946	27476	GCA_016802425_1_1_481	GCA_016802425_1_1_481	+	2217364	.	CDD:cd08054	Head-Tail-Connector-Protein	MAAPVSLEEFKQRIGVEHDRRDDFFLSVIDGVSAAAEAYIGRSLLAADYVGRYDGNGKDRIVLDNYPVLSVSSVKINGADAGGWEFDNWLLMRPEGFARGLKNVEVSYRAGYERMPADIREAVMIIAVQRVNEIEGKGVRSKTLAGETVAFSTFGNSGGMPPSAFAILNEYKRKGV*	hallmark_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0042	persistent	direct	high	530	0.998	GCA_016802425.1_00508
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	482156	482638	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	27476	27958	GCA_016802425_1_1_482	GCA_016802425_1_1_482	+	2217364	.	PFAM:PF05521.10	tail-completion-or-Neck1-protein	MLKMEFIGGGILAAVFKAYAADVQDAVVKSVGRSALRLQSEVVLNRLSGRVLRVRTGNLRRSVHQRVNVSGNVVSGEVDTNVRYGIAHEYGFAGSVNVKASLRQVRQAFGKPLKPPRYVRVRAHTRDVKLPERSFLRSALRDLTPKFADDLQKSIGKVLK*	phrogs_hmm	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0043	persistent	direct	high	482	0.998	GCA_016802425.1_00509
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	482635	483063	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	27955	28383	GCA_016802425_1_1_483	GCA_016802425_1_1_483	+	2217364	.	.	hypothetical protein	MNREAVYSALWAKLDALDGFVTKSRKLVHWNDVKRYDQPALFMAQGDMQALTLTGRETKWILRADVYLYVQTAGQPPAPVMNPLIDAVCNAVNAVHPVTGKTDLTADGADIEYCRVEGTVETDEGTLGEQAVCIIPIVICAA*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0044	persistent	direct	high	428	0.998	GCA_016802425.1_00510
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	483089	483862	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	28409	29182	GCA_016802425_1_1_484	GCA_016802425_1_1_484	+	2217364	.	.	hypothetical protein	MQLTFGSGEVFAQMITDAYGNRVQNATPVRIMGLQEMSVDLSAELKEFYGQNRYPLAVAQGKVKVSGKMKGALINGLTLNTLFFGTEYATGTMKALWAETTGKVLDGDNYSYLQAAAPGGGKFAEDAGVMGQDGTAYIKVASSPKQGQYTVSDAGVYAFNSSDKGKTVYPSFTYTQTMPPAKKIELTNMATGNTPTFKMRYLTQFKGKKALLELESVTSGKLGLFSTKNDDFSVPEIDFTASTDEAGFKIGTLWIQE*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0045	persistent	direct	high	773	0.999	GCA_016802425.1_00511
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	483923	484252	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	29243	29572	GCA_016802425_1_1_485	GCA_016802425_1_1_485	+	2217364	.	PFAM:PF12363.7	tail-protein	MTVRIKGVTVELNGADYVIPPIALGALEQLQERIGSFDGNAADAGQISTVIDCAHAALKRNYPDLTREEAADLIDIGNMNEVFAAVMDVSGLKRREQEAAQAGEARAAD*	phrogs_hmm	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0046	persistent	direct	high	329	0.997	GCA_016802425.1_00512
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	484264	484530	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	29584	29850	GCA_016802425_1_1_486	GCA_016802425_1_1_486	+	2217364	.	.	hypothetical protein	MIAHVCASTGWTWDYVADNLDLPRIKHLNEYWREHPPVHILAASYMGVKPSSGSVQSEADEAEAVGMLGGGELSEDEFDALLKAKGII*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0047	persistent	direct	high	266	0.996	GCA_016802425.1_00513
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	484530	485129	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	29850	30449	GCA_016802425_1_1_487	GCA_016802425_1_1_487	+	2217364	.	PFAM:PF09343.9	glycoside-hydrolase	MGNAVFPEFPGLKWGRKKTAVWSTGTQKSASGREFRTAYYTYPQWRFSLSFEVLRTKASVNELEKLAGFFNARKGSFESFLYEDPADNAVTDQPVGNTVQGVARYQLVRSMGGFIEPVSAVKERPAVKVGGTALAYGRDYTVTDKGVLVFNTPQPPGRPITWTGGFYFRVRFTSDTVDFENVLGSLWAAKKIEFTSVKL*	phrogs_hmm	nonviral_gene	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0048	persistent	direct	high	599	0.998	GCA_016802425.1_00514
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	485126	485980	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	30446	31300	GCA_016802425_1_1_488	GCA_016802425_1_1_488	+	2217364	.	PFAM:PF05100.11	Minor-tail-protein	MKAATKELIGLLHGGDEFQMADLYTITLSGGRVLRHTGADMPVVWDGQAYGAHELVIKRGATRTAVGLEVDSNTLQISAAPDYRLEGLQWAEAALGGVLDGARVRIDRVFFDAGLRPVGAVNIFSGRVSDVSGGRSSVKVDVKSDIELLNVSSPRNIYQAGCMRTLYDDGCKVNREKFTVNGRVTENSRTGTVLKHNLTQPDGWFSQGVIKFAGGRNAGLSRTVKAHGGNTFELALRLPYPPQAGDAFKVYPGCDKRRDTCKDKFDNIVHFRGFPFIPSADTVV*	hallmark_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0049	persistent	direct	high	854	0.999	GCA_016802425.1_00515
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	485982	486413	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	31302	31733	GCA_016802425_1_1_489	GCA_016802425_1_1_489	+	2217364	.	TIGR02219	putative phage cell wall peptidase, NlpC/P60 family. Members of this family show sequence similarity to members of the NlpC/P60 family described by pfam00877 and by Anantharaman and Aravind (). The NlpC/P60 family includes a number of characterized bacterial cell wall hydrolases. Members of this related family are all found in prophage regions of bacterial genomes. [Mobile and extrachromosomal element functions, Prophage functions]	MPSETDLRARIVEEARSWLGTPYHHHAMVKGAGVDCAMLLVAVYGAVGLLPEGFDPRPYPQDWHLHRDCERYLGFVTQFCRETESPQAGDIAVWRFGRSFSHGGILAGGGKVIHSYIGRGVVSDDIGQAELIGRGVRFFTFSF*	mmseqs_cdd	nonviral_gene	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0050	persistent	direct	high	431	0.998	GCA_016802425.1_00516
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	486441	486857	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	31761	32177	GCA_016802425_1_1_490	GCA_016802425_1_1_490	-	2217364	.	COG5606	Predicted DNA-binding protein, XRE-type HTH domain [General function prediction only]. 	MDCLRQFPENAKQAAGYQLQEKPENRGRRFGIGGKTLQQIDSGKEIMESQTFASVFDALCDTPAQAANMRLRAGLMMHIADTVRENGWTQKQAAEHCGLTRPRINDLLNGKIDKFSLDALVNINAGLGQCISLSFAPA*	mmseqs_cdd	nonviral_gene	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0051	persistent	direct	high	416	0.998	GCA_016802425.1_00517
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	486959	491104	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	32279	36424	GCA_016802425_1_1_491	GCA_016802425_1_1_491	+	2217364	.	PFAM:PF13550.5	Putative-phage-tail-protein	MGGKSSTVTSAEERILSLQVQRSSQGLTLPVIYGRTRVAGNLIWYGDFVTIEHKTTTRRGGKGGGGVKQVGISYTYEAAVMLALCEGEIQGVGRVWRDKEKFDSPAQLRLTLMRGGDEQPLWTHLQQAKHQGQALNYSGTAYLCSPNYELTKSAQIYQHNFEVIGKSGYSGNIPDANPREIVLDLLTNQRYGCGFPSQNIGDTDRYSNYCRAVGIFLSPAYTEQGEAQRNISELLEQTNSAAVFSQGRLKIIPYGDGSHSGNGAVYVADNKAAYDLTDDDFIVSGAQDPVKAGRKTNADAFNQIQVEYLDRDNDYNVAIAEAKDQANIEQYGLRPKDAVRMHGICDAKVAQKVAQQLLQRALYVRNEYEFKLGWKYCLLEPMDIVTLTDAGLGLNKTPVRITEIEEDGEGVLSVKAEDCPAGVYTVSEYPTQPSSGYSADYNVSPGNAHVPVIFEAPLQLTGGEPQIWLATAGGGMWGGAEVWVSADGDSYTRVGAVNRKARFGALTADLPDGAVFDRTNTLGVEISAGQLTGGTEQDSRDLLTLCYVDGEFLAYADAELKGVGRYTLGNLTRGAYGSAVNAHAAGSRFARIDEALFKYAVPRNWIGRTVWVKLVSYNVFGGGIQDLAEVPAYSYTIEGAPLGQIQNLRLTSSWAYGKEAVIAWDKLDGADTYDVEIYAGGSRRRLRAVDGIVDNSYTYTQADMKADGGQVRGIVFKVRGRAVTGKTGNWAQIAAQNPQLQALQGISIDSGLRQAFFTCQKPDEEDFAGIIVWVCENAACPAADANKAYDGAETFITIAKCGGKPLEKGKTYYLRAAGYDSFGKDNLKISGSISFTVYDVSATDLSESSLNKALRDKINLIDGNGAGSVNERVEAVRSTADGNAAAVQTHARSINGLEAQYTVKVDANGKVAGFGLATTPKNGTPESKFIVNADRFGIGAAGKADVFPFVVDTQKNRVGINGELVVNGKAVVDKLNAGDIHGGKIAADTLDANRLKAGSVTAREIGAAAVTADKIGANAVTADKIQVADLSAVSSNLGSITGGSLNIGGGNFTVSSDGILTADNAVIRGRIEADSGYFNGTVRASSVEGDVLRAHRLRWTEGNVWVLDLDKDPLPRVLIPNFYVVSETFGNNRVQAKLLLNGGVLAPREVRETENYTNYIWRGRTFGRYEDLPPRAMGGGDYTQQSGSRYRTRLEYQIQVIPAGKPVSLKLSLASHESVFSPFVSVSYLAQSDYEYKQLLGRMVWRTFAESFRYDSKKQVYLGGDRRVHDYQNQMYKHWNAYGGLLQLPDDIYGISFEYRPFTNADWSTMLAFDRSDKFVVVKKYRGHAPQQYSLFQEEFNTAVPKSNLLFFVEHWWQYIELRNIRVLIPESRENEVWQVG*	hallmark_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0052	persistent	direct	high	4145	1.0	GCA_016802425.1_00518
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	491216	491521	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	36536	36841	GCA_016802425_1_1_492	GCA_016802425_1_1_492	+	2217364	.	.	hypothetical protein	MIEDKKIVALNFAVEDGMTGASAAYHVVEHIGADYRNGYVTATLNGYVSENAFKSGKRYLLARTLDFQETDITAPDPGWVYRKALEGAAGIPKDAQPVYAE*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0053	persistent	direct	high	305	0.997	GCA_016802425.1_00519
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	491607	492062	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	36927	37382	GCA_016802425_1_1_493	GCA_016802425_1_1_493	+	2217364	.	.	hypothetical protein	MNRRFLPAGFQAWLFGTATRVLEAVSGLGLSGYAAVFALAPDEIYAWRIYYKFQDIPEAWTVGVLAAAGLLQTALLFARGVRACVASAYLLLFSGFVWFLVSVAFWGAYPPLNTGMVVPPLLAFFCALAGNNALRFLFSAQKSRGLADEGS*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0054	persistent	direct	high	456	1.0	GCA_016802425.1_00520
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	492063	492395	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	37383	37715	GCA_016802425_1_1_494	GCA_016802425_1_1_494	+	2217364	.	.	hypothetical protein	MGFLQFGLLFAAAGGVLGAVWASLQERGRPVQAVLEAFISAIAAAAAAERFVPLDQAWTCAAAGVFAGMMTGHALDTVRALAPKVLRGYLGGLAEKLTGVKDGGSSDGKD*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0055	persistent	direct	high	332	0.997	GCA_016802425.1_00521
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	492766	493113	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	38086	38433	GCA_016802425_1_1_495	GCA_016802425_1_1_495	-	2217364	.	PRK09812	type II toxin-antitoxin system ChpB family toxin. 	MYIPERGDIFHLAFDPAAGTEMKGGHYAIALSPRAYNRATGLVYACPISQGRAAAARSGGMISTLLGAGTATQGNVHCHRMKALDWKIRRAAFRETVPDYVIEDVLARIGAVLFD*	mmseqs_cdd	nonviral_gene	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0056	persistent	direct	high	347	0.997	GCA_016802425.1_00523
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	493113	493349	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	38433	38669	GCA_016802425_1_1_496	GCA_016802425_1_1_496	-	2217364	.	COG2336	Antitoxin component of the MazEF toxin-antitoxin module [Signal transduction mechanisms]. 	MLRLQKWGNSAAVRLPARLLTALNAKIGDALETEIRNGELLIRPVKRYRLSDLLAETEAAPPRAEGWEEMPDVGQEGV*	mmseqs_cdd	nonviral_gene	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0057	persistent	direct	high	236	0.996	GCA_016802425.1_00524
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	493556	494095	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	38876	39415	GCA_016802425_1_1_497	GCA_016802425_1_1_497	+	2217364	.	PDB:1WTH_A	Tail-associated-lysozyme	MKELKWIEEARKYLGAHEKVNGKSNPVLLAMLQEMGNFNQEQKAWWKETDTPWCGLFVGHCLGKAGRAVIRDWYRAKAWAMSGLTKLEAPAYGCIAVKPRRGGGHVFFVVGKDAEGRILGLGGNQGNMVSIIPFDPADIDGYFWPSKLIGGKAVPSSPAEGRYRLTAAAATAKQGAGEA*	common_virus_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0058	persistent	direct	high	539	0.998	GCA_016802425.1_00525
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	494096	494440	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	39416	39760	GCA_016802425_1_1_498	GCA_016802425_1_1_498	+	2217364	.	PFAM:PF10828.7	Rz-like-spanin	MIGALLKNWKPLLILSAIAFFAVSWQLDRAAQYRRGYGAAVSEVSERLKAAAVEHAEHARKSSAAYQAQKAAREEKERVRYVQTLKIIEKPVYRNACFDADGVRELNAAVDDGG*	phrogs_hmm	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0059	persistent	direct	high	344	0.997	GCA_016802425.1_00526
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	494909	495058	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	40229	40378	GCA_016802425_1_1_499	GCA_016802425_1_1_499	+	2217364	.	.	hypothetical protein	MNAEGFCEKQTACRPDGRRNAGDRADLKAFEFAGRELANYREMLKRYAV*	.	hypothetical_protein	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0060	persistent	direct	high	149	0.993	GCA_016802425.1_00528
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	495088	498132	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	40408	43452	GCA_016802425_1_1_500	GCA_016802425_1_1_500	+	2217364	.	UniProtKB:I6NKY8_9CAUD	Tail-tape-measure-	MSDLEAKVRITVENHTKQGFDSAAADADKAAEKMRSSGDNAAKGFKAAIDSMHETMRNLHADVKAGFEAAGNQAQQASEKVRAEVGKIGSGLSGLTKLLAGLATADFAKSVLDTADAMQSINSQVRQVTSSETEYLAVQQQLLDTANRTSASLESTANLYVSTSRALKDYGYTQQEILKFTEATNNAMTIGGVGARQQAAALFQLSQALGSGVLQGDEFKSISESAPILLDTIAEYMGKSRDEIKKLGSEGKLTADVIFKAISGASEKFGEQAAKMPVTMGQALTVFSNNWQSMVSKLLNDSGTMSGIAAVIKLIADNLNLVVPIVAGFAVAVAAAVAPTLALNLALLANPFGIIAVAIGTVVGLIAKFGDEIDVFGGGWSNLSDVIRAVWQIITETVGEAVGTVKSWFDGLTGRLNEGAGGWPSLFGRVMSVISSAIGAYVNVYINIFATGWMLIKEAANDMPQFFANLGKAIGNVFISAIERMINKAVGMINSMIDFANKAASMAGISGIGKLNKVRMGRMDDGGLGERIHDSLTKDRAGAMANAVRERAADIHEADALKGRGGGGHAKTARKKPGANQGGGKGGKSRSGGPGAVKDPMQAWEGEIKARKLAHREMQRETLTHQEWDLAREAEYWRAKLATVDANGKTGVKIREKILTLEDQLSKQSTEAKMNQAAEWEKLDKHKLEMEKDAADQALADGRISQLERLDLEIEFENRRYRIAYDALQERIALAEQDPAYSQAAIGKLKAQMGELGRGHERTQAKNEGKRENQRRKDAPNVMEMLQDGGRNVWQEAQQQMGQAFTAMLARAQNFRQAMNGFFKSMGQTFIQEMVTKPLTGLMRRMVEESAIYKMIFGTKETLETAAAAKTAATKATETTAVVSSNAVQAASGAAASQAHIPYVGPILAVAAMAAMMSAVMGLMGGGGSQTTTTTTRIPSAAGGWDIPAGINPLTQLHENEMVLPAEHAQTIREMADQQGGGSTVIINSTGGDFIHKNDLAKLLKQMKRDFKFV*	hallmark_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0061	persistent	direct	high	3044	1.0	GCA_016802425.1_00529
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	498192	498671	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	43512	43991	GCA_016802425_1_1_501	GCA_016802425_1_1_501	-	2217364	.	PF15956.5	Domain of unknown function (DUF4760)	MTDNLIQIATPILTVIGVFVAAYGIMRNTENAKKRATIDMIMAERNNAALQEAITIVNGLAKTDGCILATYTSDTPDKKKDREAILTVLNQREFVCAGVLGGALHEKMYKDFEYSMLLRDWDNLSSFIFEIRRIRSAPTAFQEFEAVARKWKKKPLKTK*	hhsuite_tools	nonviral_gene	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0062	persistent	direct	high	479	0.998	GCA_016802425.1_00530
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	CDS	499013	500002	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	44333	45322	GCA_016802425_1_1_502	GCA_016802425_1_1_502	-	2217364	.	PDB:1Z19_B	Integrase	MATITQRNGKWRVQIRMKGVSRSATFERASDAKAWAARIESQIMDGIQGNAPRNTIFADLIRRYLSEVTPSKRGAREESYRIGRALKTPLAKVRLADLRPQDFADWRDQRLQEVSPTSVGRELTTLSAVCEHAMKEWGLLRENPVRKISKPKKSRARTRRPTEQEIADICAALLYRPNEKPKMAVQRVAVAVLFAIETAMRAGEICGLKWADVNMRRRIAHLPITKNGDSRDVPLSLRAAELIEQLRGIDDTWVFSLDAKSLDVLFRRARDNCGIQGLHFHDTRREALTRLSKKVPVEVLAKISGHRDLRILLNVYYRPDMADIAKMLD*	common_virus_hmm	common_virus	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_CDS_0063	persistent	direct	high	989	0.999	GCA_016802425.1_00531
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	723058	724071	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	1	1014	GCA_016802425_1_1_700	GCA_016802425_1_1_700	+	2217364	.	.	hypothetical protein	MKKNLPALALASMLILSGCDRLGIGNPFSGKEISCGSEETKEILVKLVRDNVEGETVKTFDDDAFKDQAFADIGISHIRRMVERLGITVDEVRTTEKTDTSSKLKCEAALKLDVPDDVVDYAVAANQSIGNSYKKTPDFFEPYYRKEGAYYVKTISYSVQPTDDKSKIFAELSQAHDIIHPLSELVSMALIKEPLDKAKQRNEKLEAAEATAQEAREAEEAAAQEALGREQEAARVSEWEERYKLSRSEFEQFWKGLPQTVQNKLQASQKTWKSGMDKICANNAKAEGETPNGIKVSELACKTAETEARLEELHNRKKALIDEMVREEDKKELPKRL*	.	hypothetical_protein	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0001	persistent	direct	high	1013	0.999	GCA_016802425.1_00731
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	724495	724743	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	1438	1686	GCA_016802425_1_1_701	GCA_016802425_1_1_701	+	2217364	.	pfam15919	HicB_like antitoxin of bacterial toxin-antitoxin system. This is a family of HicB-like antitoxins.	MFHLEGLLQENLPIPEAQSIEVNRDNPDYADAVLWTMVEADDAALTGQVRFNVSWPQHILNRVDACTAARHETRAVFWRKPP*	mmseqs_cdd	nonviral_gene	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0002	persistent	direct	high	248	0.996	GCA_016802425.1_00734
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	725203	726453	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	2146	3396	GCA_016802425_1_1_702	GCA_016802425_1_1_702	-	2217364	.	CDD:pfam07484	Tail-Collar-Domain	MEKTQFGRHPRRRDRVLSQSRPKPRRLSQSRRHDLCTKHLLDLYRALGNTNKLPDLTRTDIGITAWFPSDQIQTGWLAFDDIRERVTESAYPELYRLLTEKYGRIQNVPQAEDRFIRNAGNGLAVGTKQEDEIKRHVHKVFSHWANHPDAAAVGYEDRNERQRSALVSTWTDGDLNDNGFLTPRLDSKMATGGAENRPKALVLKLCIKAADTLGEAVFRIKSHGETANAGALDASRLAQGLQEKADRDHTHTTAQIQGLDEKISAAVAAQFTRQTIGGVDIVRFPDGTMIQTGSYRFARGGSPIGNEVVFPIAFADGNVKCFVSERHSGRVNGERQHNWLFIRAKNHAAAIITNWYESSCDWMAIGKSASGNAASPTPIVPEIPEIDEEPQRESGRSSTGLRNPRRHRGLDFPVGS*	common_virus_hmm	common_virus	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0003	persistent	direct	high	1250	0.999	GCA_016802425.1_00735
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	726885	727454	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	3828	4397	GCA_016802425_1_1_703	GCA_016802425_1_1_703	-	2217364	.	PFAM:PF12571.7	tail-fiber-protein	MANATEQNQFDQAVRLIEPGDSVVVGPGAPVNQPLQALANRTLLLKNQTEALQTASDTKAAASTAVNAGDGLTGGGSLAQSRTIALGAPGQITATSQNTVPKNGHTHAIDTARTDRAGIVRLDNAISEAEDTAATPKAVKTALDQARAAAATADLKVSLSDNQTVTGQKTFTAETQFQSGIRLSANPTH*	phrogs_hmm	hypothetical_protein	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0004	shell	direct	high	569	0.998	GCA_016802425.1_00736
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	727873	728928	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	4816	5871	GCA_016802425_1_1_704	GCA_016802425_1_1_704	-	2217364	.	CDD:PHA02568	baseplate-assembly-protein	MGNSRLSQLPAPAAIEETDFEGIFARKKAALTALCPESIRETVAQTLELESEPLTIDLQQQAYQELLVRNRINEAVKANLLAYAQGSDLDHIAAQYGLSRKTIRAADPDANPPVAAEYETDDAFRARVQAHPEKYAAGPRTAYEAHAIDAHPQITHARAVRRAIGTVEVYIKTQSGTPDETILTAAREYLPAETRRPLCDNVQVTAAQPKDAAVEYSAEYHPAANIQAERQTACEALDNLWRQNAHIGASVALSKIIGALDTPGVKKNHTAQPRRRHRMRQRRIHPNHVHARARINEQHRPREQQPPATRTGKADRTRNCRRLPPTRPRIFTLSRLRKKHRHGRGLGLCRN*	hallmark_hmm	common_virus	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0005	shell	direct	high	1055	0.999	GCA_016802425.1_00737
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	728949	729275	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	5892	6218	GCA_016802425_1_1_705	GCA_016802425_1_1_705	-	2217364	.	PDB:5IW9_B	Baseplate-wedge-protein	MTDAENGRGQDTLAHIAQSIRNILFTRIGTRLMREEYGSFIPDLIDMPAGHAAIALIHQAAVTALARWKPRITVRRIQADTADLAAGKIKLTLDVTLADGGERTYRIK*	hallmark_hmm	common_virus	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0006	persistent	direct	high	326	0.997	GCA_016802425.1_00738
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	729272	729466	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	6215	6409	GCA_016802425_1_1_706	GCA_016802425_1_1_706	-	2217364	.	PDB:4RU3_A	phage-baseplate	MELKAVTSLTIDTPQTTITGHLTVNQTTTAQGLLTYQNGMNGQGGSLSEHTHPDDSGGTTEKPQ*	common_virus_hmm	common_virus	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0007	shell	direct	high	194	0.995	GCA_016802425.1_00739
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	729957	730196	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	6900	7139	GCA_016802425_1_1_707	GCA_016802425_1_1_707	-	2217364	.	PFAM:PF10078.8	transcriptional-repressor	MRNKINRNDMELGYTPYNLRTLRNRCKLTQAELAQIVGVKHYIQVGRWEAEPDTETRRADMPLEKWRQFLDWIEKTNAV*	phrogs_hmm	hypothetical_protein	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0008	persistent	direct	high	239	0.996	GCA_016802425.1_00741
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	730301	730876	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	7244	7819	GCA_016802425_1_1_708	GCA_016802425_1_1_708	-	2217364	.	.	hypothetical protein	MKITHCKLKKEVQKEPLRSFVPEVTARSAADILGIHPDSAALFYRKIRTVANHRLALAADEVFGAPPGRAEAVSAYGVKADAVAARQEKRLSSAFRNATGGPIPLPRTMPSLKRCPLPSKRKSCRTVLFMPIARAAAASRTRAVLSVAASTVPRNLQTVGTTLTALGTFGIRQNAPCGNTTESTANLSRRS*	.	hypothetical_protein	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0009	shell	direct	high	575	0.998	GCA_016802425.1_00742
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	731219	731482	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	8162	8425	GCA_016802425_1_1_709	GCA_016802425_1_1_709	-	2217364	.	.	hypothetical protein	MADILPSDKRRQPPKTKGNPINIIEQETKRTELRKIDAEIAKIIADAHKINAESVKIAQESRWYPMMAATGLVTAIAAVLALIFKFA*	.	hypothetical_protein	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0010	persistent	direct	high	263	0.996	GCA_016802425.1_00744
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	731711	732781	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	8654	9724	GCA_016802425_1_1_710	GCA_016802425_1_1_710	-	2217364	.	PDB:1Z19_B	Integrase	MAAHNKLTQKQIEAAKADGKQSKLADGGGLYLLLHPNGSKYWRMRYRHGGCEKTLALGVYPAVSLKQARELARAARAQTAAGIDPVAEHHRTRPGSGRSLPEIARAWYGSRQGQRADNTLEGDRRSLAYLTDYYKDNTDINDITTAGVSKFIEHLNRINIPACARRTVQILAQIWDYAVQRGIITDERRNPATTARPLLNTSKPKPQPHIRPDELPDFYRALQTAHDLHPYARPLLLLAALTVPRPSALLSARWQDIDLTTRLWHIPAADMKTKHPFTVPLSDWAVEILRELHTQTGDNIHLFPGIRPRRKPAPHPDHISIKFAHNAIRRLGYDGSTPANPNTPCTDSATSSPTSA*	common_virus_hmm	common_virus	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0011	persistent	direct	high	1070	0.999	GCA_016802425.1_00746
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	732990	733769	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	9933	10712	GCA_016802425_1_1_711	GCA_016802425_1_1_711	-	2217364	.	cd06195	Ferredoxin-NADP+ (oxido)reductase is an FAD-containing enzyme that catalyzes the reversible electron transfer between NADP(H) and electron carrier proteins such as ferredoxin and flavodoxin. Isoforms of these flavoproteins (i.e. having a non-covalently bound FAD as a prosthetic group) are present in chloroplasts, mitochondria, and bacteria in which they participate in a wide variety of redox metabolic pathways. The C-terminal domain contains most of the NADP(H) binding residues and the N-terminal domain interacts non-covalently with the isoalloxazine rings of the flavin molecule which lies largely in a large gap betweed the two domains. Ferredoxin-NADP+ reductase first accepts one electron from reduced ferredoxin to form a flavin semiquinone intermediate. The enzyme then accepts a second electron to form FADH2 which then transfers two electrons and a proton to NADP+ to form NADPH.	MAASPEAKFTEEKILWVKHHTPKLITFAISRPESYRFKAGQFSRLGFYEGKGFIWRAYSVVSAEYADTLEYFAVLIQDGPMSALFAKMQQGDTILLDKNATGFLLPERFPDGKDLVMLCTGSGIAPFLSILEQPEIRQRFDTVNLIHSVSFPEELIFNDRLAALSEHPLVGEYGHSFRFVPVTTRAANPSGLSGKRIPELLKNNSIEQALHTKLTPESTRFMICGNPEMVKDTFQTLLDMGYAMHRNRIPGQIMMENGF*	mmseqs_cdd	nonviral_gene	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0012	persistent	direct	high	779	0.999	GCA_016802425.1_00747
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	734061	734357	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	11004	11300	GCA_016802425_1_1_712	GCA_016802425_1_1_712	-	2217364	.	.	hypothetical protein	MNKNIIYIFSLLITIVIFFIFEKNVISKISFDYNKKEFLISDITNFNWDHVKLYIINSDFQKIVFYDKGKIVFEELIELDRKGKVLPQYLFDSYLKNV*	.	hypothetical_protein	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0013	persistent	direct	high	296	0.997	GCA_016802425.1_00748
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	734669	735727	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	11612	12670	GCA_016802425_1_1_713	GCA_016802425_1_1_713	+	2217364	.	PRK02406	DNA polymerase IV; Validated	MSLRKIIHIDMDAFYASVELREQPHLKGRPVVVAWEGARSVICAASYEARQFGLHSAMSVATVKRLCPQAVYVPPHFDLYRQVSAQIHAVFRRYTDLIEPLSLDEAYLDVTRNFKNIPYAGEVAKEIRAAIFAETGLTASAGIAPNKFLAKIASDWRKPNGQFVLPPHKVMAFLETLPLGKIPGAGKVTLKKMQSLGMRTAGDLRRFERGELLNHFGRYGYRLYDLARGTDEHPVKAERERLQISTEITLPEDLPLGQAAGHLPHLAEDLWRQITRKNVEAQSVTLKLKTYDFRIITRTLTYSSVLPDCAALLQAAQMLMARVPPQTEDAFRLIGIGVGRLVPKNQQQDLWA*	mmseqs_cdd	nonviral_gene	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0014	persistent	direct	high	1058	0.999	GCA_016802425.1_00749
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	735797	737812	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	12740	14755	GCA_016802425_1_1_714	GCA_016802425_1_1_714	-	2217364	.	PDB:1UAA_B	Replicase	MMKLNAQQLEAVRYLGGPLFVLAGAGSGKTGVITQKIKHLIVNVGYLPHTVAAITFTNKAAAEMQERVAKMLPKPQTRGLTICTFHSLGMKILREEANHIGYKKNFSILDSTDSAKIIGELLGGTGKEAVFKAQHQISLWKNDLKTPEDVVQTASNVWEQQTARVYASYQETLQSYQAVDFDDLIRLPAVLLQQNSEVRNKWQRRLRYLLVDECQDTNTCQFALMKLLTGAEGMFTAVGDDDQSIYAWRGANMENLRKMQENYPQMKVIKLEQNYRSTARILKIANKVIENNPKLFTKKLWSQLGEGEPVKVVACQNEQHEADWVVSQIVKQKLIGGDKTRYADFAVLYRGKHQARIFEEALRGARIPYRLSGGQSFFDKAEIKDVLSYVRLLANPNDDPAFLRAVTTPKRGIGDVTLGKLNAYAHEHECSLYEAAQNEEALATLNNTNRQHLQAFMDMFGNYRAKAEIDEAGEFINSLLEEIDYENHLMQNEEGKAGEIKWRNVGELVSWFARKGERDGKNVIELAQTVALMTLLEGKDEEETDAVSLSTLHAAKGLEYPYVFLVGCEEGVLPHNDSIEEGNVEEERRLMYVGITRAKRQLTLTHCVKRKKQGIWQFPEPSRFIDEMPQEDLKILGRKGGEPIVSKEEGRRNLADIIGRIDNLKKSGPAD*	common_virus_hmm	common_virus	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0015	persistent	direct	high	2015	1.0	GCA_016802425.1_00750
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	737832	738596	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	14775	15539	GCA_016802425_1_1_715	GCA_016802425_1_1_715	-	2217364	.	PRK02412	type I 3-dehydroquinate dehydratase. 	MHTSLTVKNTVIGSGRTKIAVPLVARDAADLSSVLSQIKNLPFDIVEFRADFLECAGSIGEVLRHTQAVRDALPDKPLLFTFRRHCEGGSFPCSDDYYFELLDALIESRLPDIIDIELFSGETAVRRAVANAQKNGIAALLCNHEFHRTPPQEEIVCRLKQMEDCGADICKIAVMPQSSEDVLTLLSATLEAKRLVAKPVITMSMGQTGAVSRLAGQVFGSSITFGSGTQNSAPGQIGVSALRAALDCLESGAD*	mmseqs_cdd	nonviral_gene	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0016	persistent	direct	high	764	0.999	GCA_016802425.1_00751
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	738796	739842	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	15739	16785	GCA_016802425_1_1_716	GCA_016802425_1_1_716	+	2217364	.	PDB:3HR8_A	Protein-rec	MSDDKSKALAAALAQIEKSFGKGAIMKMDGSQQEENLEVISTGSLGLDLALGVGGLPRGRIVEIFGPESSGKTTLCLEAVAQCQKNGGVCAFVDAEHAFDPVYARKLGVKVEELYLSQPDTGEQALEICDTLVRSGGIDMVVVDSVAALVPKAEIEGDMGDSHVGLQARLMSQALRKLTGHIKKTNTLVVFINQIRMKIGVMFGSPETTTGGNALKFYSSVRLDIRRTGSIKKGEEVLGNETRVKVIKNKVAPPFRQAEFDILYGEGISWEGELIDIGVKNDIINKSGAWYSYNGAKIGQGKDNVRVWLKENPEISDEIDAKIRALNGVEMHITEGTQDETDGERPEE*	common_virus_hmm	common_virus	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0017	persistent	direct	high	1046	0.999	GCA_016802425.1_00752
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	740495	740830	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	17438	17773	GCA_016802425_1_1_717	GCA_016802425_1_1_717	-	2217364	.	COG0718	Conserved DNA-binding protein YbaB (function unknown) [General function prediction only]. 	MFGKAGLGGLMKQAQQMQENMKKAQAKLAETEIEGEAGNGLVKITMTCAHEVRKIDISPDLIQEAADDKEMLEDLILAALKSARGKAEETANKTMGAFTQDLPPGVGDFFR*	mmseqs_cdd	nonviral_gene	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0018	persistent	direct	high	335	0.997	GCA_016802425.1_00753
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	740911	743034	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	17854	19977	GCA_016802425_1_1_718	GCA_016802425_1_1_718	-	2217364	.	PDB:1XXI_H	DNA-polymerase-III	MAYQVLARKWRPKTFSDLVGQEHVVKALQNALDEGRLHHAYLLTGTRGVGKTTIARILAKSLNCENAQHGEPCGVCQSCTQIDAGRYVDLLEIDAASNTGIDNIREVLENAQYAPTAGKYKVYIIDEVHMLSKSAFNAMLKTLEEPPEHVKFILATTDPHKVPVTVLSRCLQFVLRNMTAQQVADHLAHVLDSEKIAYDPPALQLLGRAAAGSMRDALSLLDQAIALGSGKVAENDVRQMIGAVDKQYLYELLTGIVNQDGEALLAKAQEMAACAVGFDNALGELAILLQQLALIQAVPSALAHDDPDSDILHRLAQTISGEQIQLYYQIAVHGKRDLGLAPDEYAGFMMTLLRMLAFAPLAAASCDANAVIENTELQSPSAQTAEKETAAKKPQPRPEADAAQTPVQTASAAAMPSEGKTAGPVSHQENNDVPPWEDAPDKTETAAGTARTSAKSIQTASEAETPPENQVSKNKAADNETEASLSEVPSENPIQATPNDEAVETETFAHEAPAEPFYGFPDNDCPPEDGVEIPPPDWANVLPADTAGGGTDEEAEAGGIGGNNTPSAPPPEFSTENWAAIVRHFARKLGAAQMPAQHSAWTEYRSDTGLMVLAMTAEARATADKKRLDKIRDTLAQAYGLQLTLQTEDWRDEAGRETPAMQDKRVQAEDRQKAQALLEADPAAQKILQAFGAQWQPESLELAANRP*	common_virus_hmm	common_virus	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0019	persistent	direct	high	2123	1.0	GCA_016802425.1_00754
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	743129	745087	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	20072	22030	GCA_016802425_1_1_719	GCA_016802425_1_1_719	-	2217364	.	COG0323	DNA mismatch repair ATPase MutL [Replication, recombination and repair]. 	MPRIAALPDHLVNQIAAGEVVERPANALKEIVENSIDAGATAVDVELEGGGIRLIRVGDNGGGIHPDDIELALHRHATSKIKTLNDLEHVASMGFRGEGLASIASVSRLTLTSRQEDSSHATQVKAEDGKLSSPTAAAHPVGTTIEAAELFFNTPARRKFLKSENTEYAHCATMLERLALAHPHIAFSLKRDGKQVFKLPAQSLHERIAAIVGDDFQTASLEIDSGNSALRLYGAIAKPTFAKGKTDKQYCFVNHRFVRDKVMLHAVKQAYRDVLHNALAFVLFLELPPKAVDVNVHPTKTEIRFRDSRQVHQLVFHTLNKALADTRANLTESVSNAGEVLHDITGVTPAPMPSENDSENLFDSASNHPTGNKPDTRNAFGSSGKTAPMPYQAARAPQQHSLSLRESRAAMDTYAELYKKTDDIDLELSQFEQARFGNMPSESSTNNVSDGIGQASELPPLGFAIAQLLGIYILAQAEDSLLLIDMHAAAERVNYEKMKRQRQENGNLQSQHLLIPVTFAASHEECAALADHAETLAGFGLELSDMGGNTLAVRAAPVMLGKSDVVSLARDVLGELAQVGSSQTIASHENRILATMSCHGSIRAGRRLTLPEMNALLRDMENTPRSNQCNHGRPTWVKLTLKELDTLFLRGQ*	mmseqs_cdd	nonviral_gene	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0020	persistent	direct	high	1958	0.999	GCA_016802425.1_00756
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	745231	745416	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	22174	22359	GCA_016802425_1_1_720	GCA_016802425_1_1_720	+	2217364	.	pfam11943	Protein of unknown function (DUF3460). This family of proteins are functionally uncharacterized. This protein is found in bacteria. Proteins in this family are about 70 amino acids in length. This protein has a conserved WDK sequence motif.	MYHYQSEATQFLNRLIEEKPELAQERLKNRGLLWDVELNPEEQKNFESAKVAKKPYTYYQD*	mmseqs_cdd	nonviral_gene	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0021	persistent	direct	high	185	0.995	GCA_016802425.1_00757
GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote	cenote	CDS	745427	746095	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C68	22370	23038	GCA_016802425_1_1_721	GCA_016802425_1_1_721	+	2217364	.	pfam01596	O-methyltransferase. Members of this family are O-methyltransferases. The family includes catechol o-methyltransferase, caffeoyl-CoA O-methyltransferase and a family of bacterial O-methyltransferases that may be involved in antibiotic production.	MTTHLSNVAPDLQNYLNAIGEPEHPVLTRLREKAGHHRMGKMAIAREQAAVLVWLAKLIRAEKYLEIGVFTGYSSTALALALPEHGRITACDINVTFTDTARQVWNEAGVAHKISLHLQPALLTLDDLIAQGEAGSYDLALIDADKPPTPQYFERCLKLVRQGGIIAIDNILLNGRVMREAAFDAPPSVKILKDFNQNLPNDTRIVPITLPVGDGLTLLLKK*	mmseqs_cdd	nonviral_gene	C68	23038	723058	746096	GCA_016802425.1|CP048911.1@region_723059_746096@tool_cenote_CDS_0022	persistent	direct	high	668	0.999	GCA_016802425.1_00758
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1108079	1108381	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	1	303	GCA_016802425_1_1_1091	GCA_016802425_1_1_1091	+	2217364	.	PF17274.2	Family of unknown function (DUF5339)	MKTVPTILTGILLATALPASAHGMHKSKPLAMDELPPICQQYFKRTETCYNKAGNKADFARNNTKFLFQALPAADLGQRKQMCQIAMDSFAEKTRNLNCE*	hhsuite_tools	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0001	persistent	direct	high	302	0.997	GCA_016802425.1_01144
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1109340	1109507	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	1262	1429	GCA_016802425_1_1_1092	GCA_016802425_1_1_1092	+	2217364	.	.	hypothetical protein	MVNEKLAENRKRYEQKRVIKKVSFNAETEKELLEYAQNLDFSQWVKSIIKEKIKK*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0002	persistent	direct	high	167	0.994	GCA_016802425.1_01145
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1109667	1110512	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	1589	2434	GCA_016802425_1_1_1093	GCA_016802425_1_1_1093	+	2217364	.	PFAM:PF10547.8	P22_AR-repressor-domain-protein	MNAVQVLNFQQNSVRTVADNKGELWFLANDVCEILGYTNPRRTVDLHCKSRGVTKRYTPTTSGEQEMTYINEPNLYRLIIKSRKPAAEAFEEWVMETVLPAIRKTGGCQVGPKTTADDRTGLRQAVAALVGRKGIDYSSAYSMIHQRFNVESIEDLPAGKLPEAVAYVHALTLHTGLTGEVLDAPPKAEPKLPIDGNSLADIAAMVYYGTWMIESGKDISAPLKQLGCRQAVTMWTVWHETRPILKRSAAALEVLRGYADKDASDRIAACLEGIYGKATVR*	common_virus_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0003	persistent	direct	high	845	0.999	GCA_016802425.1_01146
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1110549	1110698	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	2471	2620	GCA_016802425_1_1_1094	GCA_016802425_1_1_1094	-	2217364	.	.	hypothetical protein	MSAEEFCRKQIAYWLNESRKASDNADLKAFEFAGREPADYREMLKRYAA*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0004	persistent	direct	high	149	0.993	GCA_016802425.1_01147
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1110701	1111285	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	2623	3207	GCA_016802425_1_1_1095	GCA_016802425_1_1_1095	-	2217364	.	PFAM:PF07030.11	head-to-tail-adaptor	MVERCGSRGVPARPAAAFGRCVCNGCGKRAAALCLCGRGFAAGYAYEIDSIRFVSDGKPVCLKLVSPEAADVCAPGWRDGAQTGLPVYAVQGDGKLTLAPAPDRDGRLFAGGYCLPRDMAGDGDEPEINSIHHRNLVYWALAEAFSIPDAETFDPQRSESARRRFELYFGLPADSDLRRITREDAPHLNRHFWI*	hallmark_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0005	persistent	direct	high	584	0.998	GCA_016802425.1_01148
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1111371	1111856	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	3293	3778	GCA_016802425_1_1_1096	GCA_016802425_1_1_1096	-	2217364	.	.	hypothetical protein	MKRRPGICLCGVAVFDNAVRTAAGGWMDKVFIKYIGGRAVWRDRIYHTGLVFEDGQVREVSAGAAAKLLRHGDVFAAVPGKRVEKADDTEALEKAGASELERETAAFDAVQDVILQINRMGKDELELYAKANYGQGLDKRKSAENLRGDVVRMVRQFGIAQ*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0006	persistent	direct	high	485	0.998	GCA_016802425.1_01149
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1111862	1112335	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	3784	4257	GCA_016802425_1_1_1097	GCA_016802425_1_1_1097	-	2217364	.	.	hypothetical protein	MAEIYVKNNGGNRFGGVPYGNLAAEHYRIVAKQDGAILGADASEPPKAGDVLALGVLEQGFRLDDAQIIVKTAMSSGITADVGFAYADGADDAKVPQDAAYFASGADFASAGRIRCQSAKLVTLPKQALLTVTLKGAENKKAADIDILIYGEKFGQL*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0007	persistent	direct	high	473	0.998	GCA_016802425.1_01150
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1112374	1113684	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	4296	5606	GCA_016802425_1_1_1098	GCA_016802425_1_1_1098	-	2217364	.	PFAM:PF13252.5	Major-Capsid-Protein	MAQKTNTAYGDPQAMMKQAAGLFAMHMQRNSTLNRLAGKMPAGTAGAEATLRKQTTQHMPVVRCQDLTRGMGDEIRFNLVNPVSALPIMGDNTAEGRGVGMSLSEAGLRVNQARFPVDGGGTMTNQRSPADYRALIRPAAQSLMDRYADQTLLVHMAGARGFHDNIEWGVPLAGDPKFNDYAVNPVKAPSKNRHFTASGDAVTGVGDNGGELKIASTDLFTMDTVDSMRTVLDQIPLPPPIVKFEGDKAAGDSPLRVWLLSPAQYNRFAADPKFRQLQASAIARASQANQNPLFLGDAGLWNGFILVKMPRPIRFYAGDEMKYCADKFSEAESGLKIPASFADKFAVDRSVILGGQAVLEAFANTGKHGGMPFFWSEKELDHGNRVETLVGTIRGVAKTRFAVDVGGARRKLPTTVSRLWIRWFLCTAVSADSNAA*	hallmark_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0008	persistent	direct	high	1310	0.999	GCA_016802425.1_01151
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1113705	1114217	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	5627	6139	GCA_016802425_1_1_1099	GCA_016802425_1_1_1099	-	2217364	.	.	hypothetical protein	METADGSDNSLFGDFSDEDVKKGVEKLIQEKLAGYEADMKRQEAAKAHYREIYTAHPDADSIVESRELEEWLAGQNPLVRKAFNDALKDGTAAEVIGAFDMFKAAKSAAEPEKPAEKPPAGKNTPNTLSDIPAGRDHTASDGPPDYLSGNALAEKLASMTEEQVEKFLNS*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0009	persistent	direct	high	512	0.998	GCA_016802425.1_01152
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1114310	1120414	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	6232	12336	GCA_016802425_1_1_1100	GCA_016802425_1_1_1100	-	2217364	.	PDB:2AR0_B	Type-I-restriction-enzyme	MRQFADRTKQEEAGRFFSGPADGNTPHAEELARGTEKQPDVSGIPSEDGAEFLDTGVMPDGLARQYADMAAKYRAKPSEAVGIDPDDGAVSAAAALAADSGAAVPSAVSDDMEARSVADDAPSGRSADADRGGVPSAYGNVRPGGAPRGAASVAPGGSAAAASGGIARVAPLPAGQYFDGLDTRGRKALAKEAGLDIKGVADFGQIAAPVRRKIEQAYHARIEADYQAASEAKQGYLPPPVRMADAVPVPKKGFSVPADALDKESRRRFDALPEWVRRHAQTVADYTADGIMRREAGMADMRGHYPEGLAESAGAVRAYRAQHPESADVLDRLNRAVYGYRRNNGWSVPLLSREGERLQGVRTALPDDGASEAVVGGGRGLTRALPTEDKGLAQDVRQDVRQGLTQGGRGLTPDAGADANAAALQGLPGSAVASGNAPARRQNLQVRARAEGAAPGLSASENLAGTDGGKRAPVAGKRPDTVLPVLNPQVAESAGRVSPKKRMADAAADFTRRLAADRRRPEKAGVPLGGGEYRFEHTDRRHIDALAGVPGRPGKGGMPEEFADMAGPSNSDGLVSDGRRYLKGREAETLRAGGLSEAVPSEPGRDYRPTQEARAPAKVMARPRDAAADGKPAGRAQPARAKDTPVAGKAAAAKNAATEKPSSDKVRNIEAGKSRFDGGKGKSAAAQGAATEKPSEKTGKAKPETFAKTASDNPEEARRKARVLQGGPVYTVKERQAPQGFKALREHAESIKKRLAESIGGLAERVDVAAVSETAPDKAQMLLSQRVEGWFDGRTGKITLVAENLTPERAVWAAWHELGHRGFAADGFAKYREELERADGNGLIRRIADAVQEGREGTGDAAASVRPAAVEEAVAELYAAQRTGGWAGIENRYGVKVGNGLKRGIAGVLARIGALLRRVLQRLAGKAGGAMSDADVFAMLADLHGNVEGARDAPWGGNHRAVMFARAEDGAAERSKSESLEKLRRAETIRISGREVPEGGNLREYKRNALEYGKSLRGPYVNKDTGREISLGRSGITEILRHDYKDAEHLQSIAAIPQIIENAVYIDTLPNEDLAKNGDIQGYEYYVSGLNVGGADYTVRAAVAVSRNGNRYYDHKLTKIEKGNLLSLLDRVSTTGASESKSPLSGIDDKRLLQILQDKDAGKGGIADFDTEAVRFSRAANIEAAIGRITGKKSDLRNALKDRWDASKGIQLQFLGRRQIEDIYGGVLDGLKEYGRLSELFGADANKAVTEADKVVREWGRLKEEDAKALADLMHDATLAKVDADPLMRKDAQKRLDGIRTALDIADGKIEKAEAAVASAGARIARADAAYNKAQRAADKAAYALEKAQEKHGREILADEADMRLRRLFYADSEAKRALRRAGADVAAESRAKTDAVRMLEQARADVKRLEKDEVGAQKALEGLALLNRRFAGLPDAAQRVYRKARDDYRAHFGQVRDALAERLARAGQDAETVRRLKERFDNELGGVYFPLARFGDYLVVVKDADGNSANVSRAETLSEAEKLRDALKADFGAGFKVSPVMKSRDYIRSRDAVGSGFMRELGEAVGMLDLDPAQRARLNDTLTQLYLNSLPDTSWAKHGIHRKGVPGFSDDARRAYAQNMGSGANYLAKLRYADRMAEQLDVMQDFVDGRKYEEGFDQRQLQRVADEMRKRHEAVMNPNPSKLAQALTGFGFLWMMGMSPASAVVNLSQTAMVAYPVMAAKWGYAGAARELLRASKQIGLRFGEKFNTIEDSLNGDEKAAFRKAADYGVIDLSQAHDLAGVANGDPGLAGSAWQKVMDKAAWLFHHAEKFNRQVTFVAAYRLAKRAGADSEAAFEQAKKATYDGHFDYAAQNRPRFMMGNAAKVVFLFKQYSQNILYALGRNAYLAFKGDKQARKTLAGLLVSHAMASGILGLPFVSTLLAVVSMLGSDDDDPWDAEAALRNMLADTFGDKAGEVLAKGFSRLTPLDVSGRLGLDQLVFPDIQDGLEGKKWAESLVVGSTGAVVGAGIGAADGVRTRSSVPRTANTLSLMKSW*	common_virus_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0010	persistent	direct	high	6104	1.0	GCA_016802425.1_01153
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1120446	1121660	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	12368	13582	GCA_016802425_1_1_1101	GCA_016802425_1_1_1101	-	2217364	.	.	hypothetical protein	MSDLVRYDPLEHGRLAGGLKEYRGFTQKDARAAADDTALTRGFKNSMRSARMGWNALTGDKEELGRLKAEDMDYRKIQEGRKSQARRELGEAWEKGGGVGDGLSNVWGELKKDWREKGLDGALEDVGEMGGAVLEQAPNALVPIATTTAGGILGALAGGNAAVGAYAGATLGNTLMEYGGQLDRAAEAAGVDPADKDAVMAFIGRGAPGALKNAAVKGAVVGAADMAAMKLGGSILNMGKKAAGKAALEKMGVAAADKAAVAAAKGTPEFAALAKESAKGGLGGAARHAAAYATESAGEFAGEYLGTGLANGEWDEKGAALEAFSSLGHSAVGFAGTKAYAAVTDPLRPPAGRKAGAQGGIGGNRKAGRPAPEGAQALRAAAQAAADGGTGGCGRRRGTGRRGF*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0011	persistent	direct	high	1214	0.999	GCA_016802425.1_01154
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1121657	1122853	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	13579	14775	GCA_016802425_1_1_1102	GCA_016802425_1_1_1102	-	2217364	.	.	hypothetical protein	MGLFEPSAGDFWEMKEKEEKEKARKGAEERERAAAQAHRADAVRRTVANYEAGPARYRNVMDLSRNNIEDGARRLRRAGAFERGADAGLGFSGGDKALSPDARAGADFARRDTRPTDAGGRTPPPLGFDGNVYRGGKPVRDFDAQRPLVSSKPDALSPEERELYKRATTPHAGALNGQLTAAQLNAARGIVAEHNKNAAVRELGRERLAAAAAENAANREAVLQKGRFDAAVKANEGALNREMAQRNADRAFDVQQAELGMKRQGFEMKREADALELEDRKRIADLTRAYGFAKSDGQRGEIARQIDALNGKFERQGEKGFDPNVFKTISYEVADPDTGLTAKREGIVDLRTGKPLDVEFAGEREKRYAQLGFKPNGQKTAGGKIIYENEKGEKRVEQ*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0012	persistent	direct	high	1196	0.999	GCA_016802425.1_01155
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1123099	1123923	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	15021	15845	GCA_016802425_1_1_1103	GCA_016802425_1_1_1103	-	2217364	.	pfam04383	KilA-N domain. The amino-terminal module of the D6R/N1R proteins defines a novel, conserved DNA-binding domain (the KilA-N domain) that is found in a wide range of proteins of large bacterial and eukaryotic DNA viruses. The KilA-N domain family also includes the previously defined APSES domain. The KilA-N and APSES domains may also share a common fold with the nucleic acid-binding modules of the LAGLIDADG nucleases and the amino-terminal domains of the tRNA endonuclease.	MNNSVQISNISIHQTEIGLFSLNDLHRASGGEDRHAPRRWLQNIQTNDLIKELEKDGKPSIQSKQRLGTFVCRELVIAYGMWISPKFALQVIQTFLAVSDGIKSAKTTADDRTGLRQAVAALVGRKGIDYSSAYSMIHQRFNVESVEDIPAGKLPEAVAYVHALTLHTGLTGEVLDAPPKAEPKLPIDGNALADIAAMVYYGTRMIESGKDVSAPLKQLGNRQAVTMWTVWHETRPILKRSAAALEVLRGYADKDTSGRIAACLEGIYGKATVR*	mmseqs_cdd	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0013	shell	direct	high	824	0.999	GCA_016802425.1_01156
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1124244	1124906	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	16166	16828	GCA_016802425_1_1_1104	GCA_016802425_1_1_1104	-	2217364	.	cd13209	PH-GRAM_MTMR3_MTMR4	MLKHIKALRFLRVISFVMSAIFFALSLAAKGGAVTNFFILFFVLLIAGSLMSKAINKLNEKEKEKEKIRLLFAQREKFYRILENPEQGFTPPTALLKSGETCFLIDYVNMGEVVTERVRTYTGTRLKLGSTPVYLGGGKSVANEKQKNVAYGELVLTNFRLIFVGNMRSIDLPLDKINSVECFQSSIRISQSGKNKPIFFNTVFNPQLWKEAILVLSDKK*	hhsuite_tools	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0014	shell	direct	high	662	0.998	GCA_016802425.1_01157
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1124978	1125385	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	16900	17307	GCA_016802425_1_1_1105	GCA_016802425_1_1_1105	-	2217364	.	.	hypothetical protein	MNQQEFEFMNDLARAFERRYRDTRSLNRCLSIEGRYMGEEACPHKPEIGLRYGEDAMFLTLQAWAKVDAPQQEAVRISFGIGAKSQAAYEERLQAEIRRRGEGPLHLQTDLGLAAWYRAIRQAAGNDFDLLFEKV*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0015	persistent	direct	high	407	0.998	GCA_016802425.1_01158
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1125652	1125891	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	17574	17813	GCA_016802425_1_1_1106	GCA_016802425_1_1_1106	-	2217364	.	PFAM:PF05866.10	Endodeoxyribonuclease-Rus	MPSEGAVAVYVRLIPKANKDGGANKTVIDLDNALKVALDALQGVAYHNDRQVRRIAADYADEPVTGGGLAVEVGELDEK*	common_virus_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0016	persistent	direct	high	239	0.996	GCA_016802425.1_01159
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1126023	1126304	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	17945	18226	GCA_016802425_1_1_1107	GCA_016802425_1_1_1107	-	2217364	.	PFAM:PF05766.11	HNH-endonuclease	MAEEMRTCKACGGTKPLEKGFNAVPRKEGGVYYYKSCKTCRNKAVRQKRAEKRAAAGAGAMTAARLHGYIRAAHAACPILGAGLWTQPAGECA*	phrogs_hmm	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0017	persistent	direct	high	281	0.996	GCA_016802425.1_01160
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1126333	1126482	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	18255	18404	GCA_016802425_1_1_1108	GCA_016802425_1_1_1108	-	2217364	.	.	hypothetical protein	MDTFLKIIATLSFAGAATLAVWLLVEAADAVLRRKRDGKGEDDFDGFGY*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0018	persistent	direct	high	149	0.993	GCA_016802425.1_01161
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1126504	1126959	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	18426	18881	GCA_016802425_1_1_1109	GCA_016802425_1_1_1109	-	2217364	.	PFAM:PF11753.7	nucelotide-kinase	MTVRNTQTETVRTEAAPQQGGNTNPGYYKNRAFECVGFAQYLNFNLGNAFKYIWRHKEKGGREDLEKALRYLERQRADAPKFKKLKHRRYEKMYAGLKDCGFDGGTEAALLAVISAAYYIRDGEDNFAWAAACVEDLLEKMPPEEQRLNNG*	common_virus_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0019	persistent	direct	high	455	0.998	GCA_016802425.1_01162
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1127051	1127281	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	18973	19203	GCA_016802425_1_1_1110	GCA_016802425_1_1_1110	-	2217364	.	.	hypothetical protein	MRETCFFCKHADFKTQPDTPVRGFAKCAKARDAEEKATYYPRTNPCAAGAFQTASGAAVAKRTAVLGEYPPAMRRI*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0020	persistent	ambiguous	low	7	0.03	GCA_016802425.1_01163
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1127274	1128056	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	19196	19978	GCA_016802425_1_1_1111	GCA_016802425_1_1_1111	-	2217364	.	PDB:4M4W_K	Replicative-helicase	MALRNASDFLGAYGGGVRVERRQCAEHGGYAAKSVLRGVWTGCPACRKLEAADEMAAYAETLRRGAMRDALEKRIGRSGIAPRFRNCRIENYAVSDSIPGMARAKAAAAEYAANFADVLQTGRSMIFSGRRGTGKNHLACGIAREVIAAGKSALVITVGDMLRTVKDSFGGGGGEAGAVGVFVKPDLLVLDEFGAGSLSETDGRILFSVVNARYERLMPMLVLTNLTAEAFRENTDARIRDRLRDGGGKLIPFDWESYRA*	rep_hall_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0021	persistent	direct	high	782	0.999	GCA_016802425.1_01163
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1128071	1129096	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	19993	21018	GCA_016802425_1_1_1112	GCA_016802425_1_1_1112	-	2217364	.	pfam13730	Helix-turn-helix domain. 	MSARLMGMAFKTGIPRGQRFVLVKLCDCANDEGLCYPSQETLAEDTGFAETAVRQHIKWLKDNNFIKSARRQRGRERKSDIYRINVALLEKCYAEAAKRKAARQAKMWEEPLDYEPSDYEPSDYEPSDFEPSDYEPSDYEPSDFDAKNHQILSGEPSDFALRTVRFCAKNHQILSGEPSDFDGSLYVEPSVEPSVEPSGSNARGARAPAGPHPAKPQTAPPETAPAAKAKKTGRHAAELALLAAYGITGQAAADFLQVRKAKRQPLTETAMRLIAADAEKCGMTALQAAEYAIASGWGSFRADWLQNKTFGRSGNRGGPTHNQTAAVPDAGSYGDMPTTDF*	mmseqs_cdd	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0022	persistent	direct	high	1025	0.999	GCA_016802425.1_01164
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1129093	1129320	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	21015	21242	GCA_016802425_1_1_1113	GCA_016802425_1_1_1113	-	2217364	.	pfam14090	Helix-turn-helix domain. This helix-turn-helix domain is often found in phage proteins and is likely to be DNA-binding.	MNQKQTQCKQIVDYIRNKGCITSLEAYQNLKVTQLAARITDLEGRGFVFAKPRMKAGGRGKPVTHYSIVKNGAEV*	mmseqs_cdd	nonviral_gene	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0023	persistent	direct	high	227	0.996	GCA_016802425.1_01165
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1129553	1129813	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	21475	21735	GCA_016802425_1_1_1114	GCA_016802425_1_1_1114	-	2217364	.	.	hypothetical protein	MKKQDRNRLSKKDRRLIKKAMLKAAAKGSDEVYKIAPGLKDGFELLGKQLNQIFVIGIWLRFFGFLMKCSDEYRQFSGLSFGRTAL*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0024	cloud	direct	high	260	0.996	GCA_016802425.1_01166
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1130236	1130940	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	22158	22862	GCA_016802425_1_1_1115	GCA_016802425_1_1_1115	+	2217364	.	PDB:2FJR_A	Repressor-protein-CI	MTNRDLKAIRIDNLKRFFENKKLPVKDKSLLSQLMSGKASFGEKVSRRLEEEYGMGSLYLDSVPSEPTPVLINPDLPHEVKDIHRPMMWSSNDPLPDDDYVFVPYLKESCFKGGAGAYEIPDYNGYRLPFGKSTLRRKGINPDNVFCCTLTGDSMEEKIAEDAAIAVDTGETAIRDGKIYAFAQDGMFRVKYLIRQPGNSVLIRSHNSGFYPDETAPLDSLSVIGRVFWWSVLD*	common_virus_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0025	persistent	direct	high	704	0.999	GCA_016802425.1_01167
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1131100	1131639	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	23022	23561	GCA_016802425_1_1_1116	GCA_016802425_1_1_1116	+	2217364	.	COG3600	Uncharacterized phage-associated protein  [Mobilome: prophages, transposons]. 	MLNAYDVADFFLSPFEEEDGEQISNLKLQKLLYYAQGYALAILNRPLFAENIEHWQHGPVVPCIYRTYKKYGGSPLPAAHIEPDKYADEELVVLNRVRKEQGCYTAWALRNKTHQEAPWIQTRQGEVIGIALMGEYFRHALPQTDYNFNLEKLKTAVEDSFVSVPHFNGADDLEKWLEQ*	mmseqs_cdd	nonviral_gene	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0026	persistent	direct	high	539	0.998	GCA_016802425.1_01168
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1131640	1131999	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	23562	23921	GCA_016802425_1_1_1117	GCA_016802425_1_1_1117	+	2217364	.	.	hypothetical protein	MQVLLGEDFKRALKNYPKEDRRKIAEFIAHVQQNGLSGLPGRNKSSDNVPADDPQWLEKVRFAQRHNLWHYHIGIPKYNGGRYGDLTSAYILHYTLCDGFIKIIGFDRHPPFILPDIPK*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0027	persistent	direct	high	359	0.997	GCA_016802425.1_01169
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1132016	1132234	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	23938	24156	GCA_016802425_1_1_1118	GCA_016802425_1_1_1118	-	2217364	.	.	hypothetical protein	MANSNSGHSKKLRAATAAAATKAKLASGEYRQFSVQGRAEDVELILAAVEKAGGSRVQALAKICRRYLEGLS*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0028	persistent	direct	high	218	0.995	GCA_016802425.1_01170
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1132718	1132918	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	24640	24840	GCA_016802425_1_1_1119	GCA_016802425_1_1_1119	+	2217364	.	.	hypothetical protein	MNELISRINRFGARAKDGQSLLLKVGEICRDAAATWTTRKSESINHTAFTFTVKKDGLKEKVMIVL*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0029	persistent	direct	high	200	0.995	GCA_016802425.1_01171
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1132951	1133427	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	24873	25349	GCA_016802425_1_1_1120	GCA_016802425_1_1_1120	+	2217364	.	.	hypothetical protein	MEANKFEVKSLSDLIKVFAGIAADFEAAMGVKRADISTEFDEPQHEPQPPVTVAEQKGINDFAIGKEVIIRTYSAGVWFGVLKQKAGNEVILTKARRMYSWWAKESISLSGVARHGIRQDGSQICGELDSVWLEAIEIIPVTGGAAESIRTALEVAQS*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0030	persistent	direct	high	476	0.998	GCA_016802425.1_01172
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1133424	1133699	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	25346	25621	GCA_016802425_1_1_1121	GCA_016802425_1_1_1121	+	2217364	.	.	hypothetical protein	MSYLDQPLKHGYGNGNGSGNGSGYGNGYGKGDGSGYGNGKGDGSGSGYGNGKGDGDGSGNGDGDGNGNGSGNGSGYGNGHGNGYSNGSGNG*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0031	persistent	direct	high	275	0.996	GCA_016802425.1_01173
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1133840	1134172	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	25762	26094	GCA_016802425_1_1_1122	GCA_016802425_1_1_1122	+	2217364	.	.	hypothetical protein	MKYYGTAAYGSPDWGMERYYAREDMRQALDGWEAENRILHESGLIEIAKKSAREFVRDADGEPYAQEDWETYLTEDASRIGKDTEAAMNYAIDEREWFALAENIGRLANS*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0032	persistent	direct	high	332	0.997	GCA_016802425.1_01174
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1134325	1134603	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	26247	26525	GCA_016802425_1_1_1123	GCA_016802425_1_1_1123	+	2217364	.	.	hypothetical protein	MKTRNIAFKFAVLAAVLAAGYAFGFAKGGGSRTAKGKPAGIAAMRMALAQKQAEVAELSAEIWLEERHLNADEEEAGCRRVHGDAEVPGGKE*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0033	persistent	direct	high	278	0.996	GCA_016802425.1_01175
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1134600	1134761	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	26522	26683	GCA_016802425_1_1_1124	GCA_016802425_1_1_1124	+	2217364	.	.	hypothetical protein	MSFHPETAYNGGGETEPYGPSPEEIKYRQSPETAETRRMTEKQAEGHIKSIIR*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0034	persistent	direct	high	161	0.994	GCA_016802425.1_01176
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1134830	1135516	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	26752	27438	GCA_016802425_1_1_1125	GCA_016802425_1_1_1125	+	2217364	.	.	hypothetical protein	MSLILSVKDESNFKPCPAGSHHATCIRIIDLGTQLVEYQNEQKRQHKILVQWEIDPEGDPEMLMPDGRPYLISRRYTASLHSKSQLATDLKSWRGRDFTPEERDNFDLRNILGKPCLLSIAHQESSDGKTTYANISAISNKMKSYTPKHPDNAVFAFDLSDPDWANYGLLNEKLREQIAKSPEYAEAVNGRQPPAPPQKQAQAAEGQTEYPQGNAAPAEDIEDDIPFN*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0035	persistent	direct	high	686	0.999	GCA_016802425.1_01177
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1135656	1135838	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	27578	27760	GCA_016802425_1_1_1126	GCA_016802425_1_1_1126	+	2217364	.	.	hypothetical protein	MANIDLTQWDGKTIGAAANPEQGYINITIGSDDLFINIEQAYAIHAALGEAVAEYEGGAQ*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0036	persistent	direct	high	182	0.995	GCA_016802425.1_01178
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1135835	1136326	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	27757	28248	GCA_016802425_1_1_1127	GCA_016802425_1_1_1127	+	2217364	.	PFAM:PF05565.10	resistance-protein	MTALTLYRCAADVQAALDYYFDSETEREDTLEAVIGQFEVKAQSVIAYIKNQEITEKMLEEHIGRMTGKLKAAKARNQSLKDYLARNMQAAGITEIKADDGTFKASFRKSEAVVILDEAQIPAEFMREAVKTEPDKTAIRKAIESGRQVAGAKIEGRKNLQIR*	common_virus_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0037	persistent	direct	high	491	0.998	GCA_016802425.1_01179
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1136378	1136593	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	28300	28515	GCA_016802425_1_1_1128	GCA_016802425_1_1_1128	+	2217364	.	.	hypothetical protein	MSYLEDVKNALRVIDNLCKEALKEPESLEGYIDEIRDKADEADTSLEFLKDVINYGISDLKNVIEVFEDCV*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0038	persistent	direct	high	215	0.995	GCA_016802425.1_01180
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1136704	1137690	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	28626	29612	GCA_016802425_1_1_1129	GCA_016802425_1_1_1129	+	2217364	.	.	hypothetical protein	MQTVATKPTAKQMLAAKRAAKESTRQERAVKRAGTVKNVDRNRLSARSKAQKENIARMLSGAKVSEDEALTCGIMMRLSLQDMRYACNQEELINFAEHIVKQVQRLGLYCNTDDPANGESVLFACREASQAVAQWTKDFDDLSPNQRQLVLRPLSNLFAAYEEFLKDAPARLIAEVSAYSLAVRVAKKAMAFLELDGGLISAVGKVVNGADSRAEARRLKMPYAEFTGRILHAANLLYDVGIQADKELSAMYGKPLNPVRPRRISDVRRPMMKMLVADKGGALVRAVKDSEDVIRHCDNGAGFSCFNWTEHFKRTANLISLMHREAAA*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0039	persistent	direct	high	986	0.999	GCA_016802425.1_01181
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1137889	1138101	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	29811	30023	GCA_016802425_1_1_1130	GCA_016802425_1_1_1130	+	2217364	.	.	hypothetical protein	MTFQGHNNRKKAGGYAEYITGGELRLLQQTACRFKAALETAAWKHYVRAIKESEPVPDAEARRKRKKQAA*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0040	shell	direct	high	212	0.995	GCA_016802425.1_01183
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1138127	1138321	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	30049	30243	GCA_016802425_1_1_1131	GCA_016802425_1_1_1131	+	2217364	.	COG3311	Predicted DNA-binding transcriptional regulator AlpA [Transcription, Mobilome: prophages, transposons]. 	MDSEYLDPQQCADILSVKKRTFLERYAPRPDFPARISVSKKRFWWKKEEVEGWLDRQKEKRPVM*	mmseqs_cdd	nonviral_gene	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0041	persistent	direct	high	194	0.995	GCA_016802425.1_01184
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1138612	1139286	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	30534	31208	GCA_016802425_1_1_1132	GCA_016802425_1_1_1132	+	2217364	.	.	hypothetical protein	MPAALIKDFLLTQGLKLPLDEVRAAYLTAQTVMDMGMASIDRSVLWCNDEGWKLADYLPCDDVREDALKRLFMALDSVFSRSTGVRSAAVYALMPSENAALRLVCLSQQGEGLENIWEQDGNITDVSLACRSAQSGWMNVASDVRRWLNLGELSGERNHASAAQISIPVCTESGGVLGVVHVEFECAECADTAAQAEWVALALALSEPLKQLLGITAAEGDENV*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0042	persistent	direct	high	674	0.999	GCA_016802425.1_01186
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1139279	1139872	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	31201	31794	GCA_016802425_1_1_1133	GCA_016802425_1_1_1133	+	2217364	.	PRK00393	GTP cyclohydrolase II RibA. 	MSELLDHVASCRLPTEWGVFTMHGFEEANGQEHVALTVGNCSDGNPVLTRIHSECLTGDALFSRKCDCGPQLEAAMRAVQAEGRGIIVYLRQEGRGIGLINKIRAYHLQEQGMDTVEANLALGLPVDARDFRLAQSIYEYLGIRSVKLLTNNPEKIQTLKDAGINVVERIPLHVGENLENERYLQTKADKLGHLMSE*	mmseqs_cdd	nonviral_gene	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0043	persistent	direct	high	593	0.998	GCA_016802425.1_01187
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1140225	1141187	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	32147	33109	GCA_016802425_1_1_1134	GCA_016802425_1_1_1134	+	2217364	.	PFAM:PF01548.16	Transposase	MRNAVGLDISKLTFDATAIVGNAEYSAKFDNDSKGLDQFSDRLKSLGCQNLHICMEATGNYYEEVADYFAQYYSVYVVNPLKISKYAESRFKRTKTGKQDAKLIAQYCRSAQESELVKRQKPTDEQYRLLRMTAAYAQIKSECAAMKNRHHAAKDEEAAKAYAQIIKAMNEQLEVLKEKIKEQTEKPNCKEGVKRLETIPAIGRMTAAVLFHHLTSSKFETSNKFAAFAGLSPQQKESGTSVRGKGKLTKFGNRKLRAVLFMPAMVAYRIRAFPGFIKRLEEKKKPKKVIIAALMRKLAVIAYHVHKKGGDYDPSRYKSA*	common_virus_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0044	persistent	direct	high	962	0.999	GCA_016802425.1_01189
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1141820	1142179	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	33742	34101	GCA_016802425_1_1_1135	GCA_016802425_1_1_1135	-	2217364	.	.	hypothetical protein	MIHKPRYIKIVDENGDFTRVLRLHKFPDTSKVFYFEPMFWLKDGRLARKDSLFEVDYIYGADGCGFLPSNLTEFRKYCRKKHQKFKDDEVLVNRYAVDFLGAKEPPYDDRHVTSVKYFV*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0045	persistent	direct	high	359	0.997	GCA_016802425.1_01190
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1142300	1143385	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	34222	35307	GCA_016802425_1_1_1136	GCA_016802425_1_1_1136	-	2217364	.	PFAM:PF05707.11	Zonular-occludens-toxin-(Zot)	MIYLFTGNMGAGKTPRVVSMILNNEDGLFKMELEDGTEADRPLYFCHIDGLDKRKFNARELAEGQIMSAPLRDVIPEGAVLIVGEAHYTYPVRAAGRPVPPYIQELTELRHHGHTVILMTRHPSQLDIFVRNLVSKHVHLERKAIGMKQYYWYKCVTSLDNPAGVSGVEAANWKPPKEAFKYYKSSSRHQKFKKKVPWAVWALIAVVGFVGWKSYGMFQVYSKATDSRIEQEAQKESVVQTMTEQTASSETAPFEHSDNLKPEDFVPTLPEKPESKPIYNTVRQVKTFEQIAGCIDGGKSDCTCYSNQGTPLKEITKIMCKEYVKNGLPFNPYKDERQRTEQAAQSAKADKPQVLVMGGKP*	hallmark_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0046	persistent	direct	high	1085	0.999	GCA_016802425.1_01191
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1143395	1143685	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	35317	35607	GCA_016802425_1_1_1137	GCA_016802425_1_1_1137	-	2217364	.	PFAM:PF10734.8	Minor-Head-Virion-Protein	MPLLSGLIPLLGILLKMLIVRIILATGLTFVTYAGYLAALEKFKGYTSNAINSMPSDILNLLLISGFGQGLGCLFGAFSFFIGMHAFKKLTFVFPG*	hallmark_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0047	persistent	direct	high	290	0.997	GCA_016802425.1_01192
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1143686	1145254	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	35608	37176	GCA_016802425_1_1_1138	GCA_016802425_1_1_1138	-	2217364	.	PFAM:PF05616.12	attachment-protein	MNSFIKSTPIVLILILCSSNSYSEPVRLEKSQIKFQSSNNLKSIGFKLDSSSNSFSKFTEAANFEHIPTGAKARINAKITASVSRAGVLSGVGKLVRQGAKFGTRAVPYVGTALLAHDVYQTFKEDIQARGCRYDPETDKFVKGYEYANCLWYEDERRINKTYGCYGVDSSIMRLMPDRSRFPEVKQLMESQMERIARPFWDKRKEEIPKDTALKWRLFPFSHCEFFWNGGGCFVRNGDNLIHRVYFKLERNPKYKEEMDAKKPEEILSLKVDADPDKYIKATGYPGYSEKVEVAPGTKVNMGPVTDRNGNPVQVAATFGRDAQGNTTADVQVIPRPDLTPASAEAPHAQPLPEVSPAENPANNPDPDENPGTRPNPEPDPDLNPDANPDTDGQPGTSPDSPAVPDRPNGRHRKERKQGEDGGLSCDYFPEILACQEMGKPSDRMFHDISIPQVTDDKTWSSHNFLPSNGVCPQPKTFHVFGRQYRASYEPLCVFAEKIRFAVLLAFIIMSAFVVFGSLGGE*	common_virus_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0048	persistent	direct	high	1568	0.999	GCA_016802425.1_01193
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1145196	1145513	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	37118	37435	GCA_016802425_1_1_1139	GCA_016802425_1_1_1139	-	2217364	.	PF06575.12	Protein of unknown function (DUF1132)	MNKPFITQAQLALYKYQPSSEYFGQSMAFIAQKEFEEFVNNVKEYDILESFSYFLNKRVAHNIWKIYFSDESVIFIRKSEENGKTVHEFVYQEYTDSSDFNSMFE*	hhsuite_tools	nonviral_gene	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0049	persistent	direct	high	317	0.997	GCA_016802425.1_01194
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1145926	1146144	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	37848	38066	GCA_016802425_1_1_1140	GCA_016802425_1_1_1140	-	2217364	.	CDD:pfam10389	filamentous-major-capsid-protein-B	MKFINTCRKYGAKLAVVTAAPLALAAQANAALPETAKNALEAAKADGMEAGWIVVGVFAALFVFSIVKRVMK*	hallmark_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0050	persistent	direct	high	218	0.995	GCA_016802425.1_01196
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1146218	1146415	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	38140	38337	GCA_016802425_1_1_1141	GCA_016802425_1_1_1141	-	2217364	.	.	hypothetical protein	MQKVYVVQSVSTGDFLYLSPETGDIGHTKLITNADYFYDFEEAVNAGLEEIGNQCEFVVFGFLKD*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0051	persistent	direct	high	197	0.995	GCA_016802425.1_01197
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1146420	1146710	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	38342	38632	GCA_016802425_1_1_1142	GCA_016802425_1_1_1142	-	2217364	.	PFAM:PF07459.10	RstB-protein	MNIQLQGHIVGVKKFNGQIEGKSFDYCRLIVATPLDSSQGNALGSSTTEYDFGGSANFEQFRNAQFPIEANLNVEIVTTGKTQKLKVIGFQLVKKG*	common_virus_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0052	persistent	direct	high	290	0.997	GCA_016802425.1_01198
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1146755	1147792	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	38677	39714	GCA_016802425_1_1_1143	GCA_016802425_1_1_1143	-	2217364	.	PFAM:PF02486.18	Replication-initiation-factor	MFDDDDFIRAASAKMEEIFGFGIIEKAKHSGGRFYEGCWLMGTENAQYGRVHYGGQRETMLVELTAVGCNAANIGWESRLFDFLTNAIRPKITRVDIAKDFFNGEYSPNQAREDRNKGLFTCHHVKPKGECLGSDWEEDDEAKMTKGKTYGIGSRESSKYVRVYEKGKQLGDKTSTWTRFEIEFKAKDIVIPFEVLQNPGEYFGGAYPICERFAQKATRIHAVKEDKVVSADRCLEWVKKQFGRAANGLKFIFPELDKAKLFELIEPSHHKLPKSLALEAYDCAFLKSQVIHEQPAFKPYNDPYYMYEYYENLEKQLEQQKHVNNEESYNNFIYDKFARLPISWA*	rep_hall_hmm	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0053	persistent	direct	high	1037	0.999	GCA_016802425.1_01199
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1147993	1148103	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	39915	40025	GCA_016802425_1_1_1144	GCA_016802425_1_1_1144	-	2217364	.	.	hypothetical protein	MEDKQGMTKEVAGVMTEAPADGRKPTTASNLPPPLI*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0054	.	unmatched_CDS	none	0	0	.
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1148242	1148664	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	40164	40586	GCA_016802425_1_1_1145	GCA_016802425_1_1_1145	-	2217364	.	COG3727	G:T-mismatch repair DNA endonuclease, very short patch repair protein [Replication, recombination and repair]. 	MTDIFTPSKRSFVMSKIHSKETKPEVLVRKFLFSQGFRYRKNDKRYAGKPDIVLPKYKTVVFIHGCFWHGHSCNKGHIPKSNMDFWLEKITKNRERDIKNETELEKIGFKVIVVWECELKNKAICRERLNRLVEEIKDAV*	mmseqs_cdd	nonviral_gene	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0055	persistent	direct	high	422	0.998	GCA_016802425.1_01200
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1148670	1149266	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	40592	41188	GCA_016802425_1_1_1146	GCA_016802425_1_1_1146	-	2217364	.	TIGR02391	TIGR02391 family protein. This family consists of a relatively rare (~ 8 occurrences per 200 genomes) prokaryotic protein family. Genes for members are appear to be associated variously with phage and plasmid regions, restriction system loci, transposons, and housekeeping genes. The function is unknown. [Hypothetical proteins, Domain]	MKGESGVDIENWKNKLPEKEREPVEVILNRLEDSELTNKEQAEVISALHSIIPEYPYYHWRHLHQDLHTACNDFYNEKKDYLSAAIEAVKVFEDKVQKQTGLHSIDGRELIEKAFGSKKSMLLLTNNKTQAEQNLEDGLEQLACGTWTGFRNPVQHELRANLSPSIFNDKDALDLISLVSYLLRKVEQTKKRAKPTSP*	mmseqs_cdd	nonviral_gene	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0056	persistent	direct	high	596	0.998	GCA_016802425.1_01201
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1149456	1150313	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	41378	42235	GCA_016802425_1_1_1147	GCA_016802425_1_1_1147	-	2217364	.	COG0326	Molecular chaperone, HSP90 family [Posttranslational modification, protein turnover, chaperones]. 	MSEEKLKMSFEPTVIEHLGVKMYSHTVPAIAELIANAYDACATEVEVRLFDKPEHKIVIKDNGIGMSFDEINDFYLRIGRNRREEKQASPCGRIPTGKKGLGKLALFRLGNKIEISTIQGNERVTFTLDYAEIKKSERIYQPEFQKESVKPNTENGTTITLTELTKKQGYPLDNYVGHLSRLFDFPAQDFKIKVSLNGSEPRIIDGNLKYNLVTPQFEWEYQDLATNISSLSSKFEQYEYSGLIQGKFITTEKPLKNNMKGITLFANGRMVNMPEFFTDSESSHF*	mmseqs_cdd	nonviral_gene	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0057	persistent	direct	high	857	0.999	GCA_016802425.1_01202
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1150327	1150656	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	42249	42578	GCA_016802425_1_1_1148	GCA_016802425_1_1_1148	-	2217364	.	COG0270	Site-specific DNA-cytosine methylase [Replication, recombination and repair]. 	MAFAHIPELQLECFIGKDNSFKDTFGRLWWDKPAPTITTKFFSISNGRFAHPEEDRALSLREGATLQSFPRNYVFKAGSRDKIARLIGNAVPPMYAEKIGRAIVDNIEC*	mmseqs_cdd	common_virus	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0058	persistent	direct	high	329	0.997	GCA_016802425.1_01203
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1151672	1151818	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	43594	43740	GCA_016802425_1_1_1149	GCA_016802425_1_1_1149	+	2217364	.	.	hypothetical protein	MSRIYLPLLFPPHIVERGLLYFQQDKVRDVQKISLGRYRAKVFDSENY*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0059	persistent	direct	high	146	0.993	GCA_016802425.1_01204
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1152195	1152644	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	44117	44566	GCA_016802425_1_1_1150	GCA_016802425_1_1_1150	-	2217364	.	COG4968	Tfp pilus assembly protein PilE  [Cell motility, Extracellular structures]. 	MTDNRGFTLVELISVVLILSVLALIVYPSYRNYVEKAKINAVRAALLENAHFMEKFYLQNGRFKQTSTKWPSLPIKEAEGFCIRLNGIARGALDSKFMLKAVAIDKDKNPFIIKMNENLVTFICKKSASSCSDGLDYFKGNDKDCKLLK*	mmseqs_cdd	nonviral_gene	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0060	persistent	direct	high	449	0.998	GCA_016802425.1_01206
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1152732	1153031	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	44654	44953	GCA_016802425_1_1_1151	GCA_016802425_1_1_1151	-	2217364	.	TIGR01259	comEA protein. This model describes the ComEA protein in bacteria. The com E locus is obligatory for bacterial cell competence - the process of internalizing the exogenous added DNA. Lesions in the loci has been variously described for the appearance of competence-related pheonotypes and impairment of competence, suggesting their intimate functional role in bacterial transformation. [Cellular processes, DNA transformation]	MKKMFVLFCMLFSCAFSLAAVNINAASQQELEALPGIGPAKAKAIAEYRAQNGAFKSVDDLIKVKGIGPAVLAKLKDQASVGAPAPKGPAKPVLPAVKK*	mmseqs_cdd	nonviral_gene	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0061	persistent	direct	high	299	0.997	GCA_016802425.1_01207
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	CDS	1153744	1154394	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	45666	46316	GCA_016802425_1_1_1152	GCA_016802425_1_1_1152	+	2217364	.	.	hypothetical protein	MLSALISSELSYPAMQLALQPVHQRFVHSGPLVLGAAPVKLPTPTADRDQTVSRRFKPSSRTTLNGEQPYPWDRLQPQDVMSRHRGAKLRRRYELLGGISLLSPEYLLSVERWPFHTEPPDHYVLLSHLPDLSVSQLSYLLPLHYQSDFRPDLGNLRTPPLRFGRRPPQSNCLPCTVPDPDDGSGLEPQRHQGGISRTTPQRLASLLPSLPPILHK*	.	hypothetical_protein	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_CDS_0062	.	unmatched_CDS	none	0	0	.
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1247866	1248549	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	1	684	GCA_016802425_1_1_1230	GCA_016802425_1_1_1230	-	2217364	.	PRK14118	2,3-diphosphoglycerate-dependent phosphoglycerate mutase. 	MELVFIRHGQSEWNAKNLFTGWRDVKLSEQGLAEAAAAGKKLKENGYEFDIAFTSVLTRAIKTCNIVLEESDQLFVPQIKTWRLNERHYGRLQGLDKKQTAEKYGDEQVRIWRRSYDTLPPLLDKDDAFSAHKDRRYAHLPADVVPDGENLKVTLERVLPFWEDQIAPAILSGKRVLVAAHGNSLRALAKHIEGISDEDIMGLEIPTGQPLVYKLDDNLKVIEKFYL*	mmseqs_cdd	nonviral_gene	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0001	persistent	direct	high	683	0.999	GCA_016802425.1_01295
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1248698	1251001	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	833	3136	GCA_016802425_1_1_1231	GCA_016802425_1_1_1231	+	2217364	.	PDB:4FM9_A	DNA-topoisomerase-2-alpha	MNTQPHASHTDSNTLMLGRYAERAYLEYAMSVVKGRALPEVSDGQKPVQRRILFAMRDMGLTAGAKPVKSARVVGEILGKYHPHGDCSAYEAMVRMAQDFTLRYPLIDGIGNFGSRDGDGAAAMRYTEARLTPIAELLLSEINQGTVDFMPNYDGAFDEPLHLPARLPMVLLNGASGIAVGMATEIPSHNLNEVTQAAIALLKKPTLETADLMQYIPAPDFAGGGQIITPADELRRIYETGKGSVRVRARYEIEKLARGQWRVIVTELPPNANSAKILAEIEEQTNPKPKAGKKQLNQDRLNTKKLMLDLIDRVRDESDGEHPVRLVFEPKSSRIDTDTFINTLMAQTSLEGNVSMNLVMMGLDNRPAQKNLKTILQEWLDFRVVTVTRRLKFRLNQVEKRLHILEGRLKVFLHIDEVIKVIRESDDPKADLMAVFGLTEIQAEDILEIRLRQLARLEGFKLEKELNELREEQGRLNIFLGDENEKRKLIIKEMQADMKQFGDARRTLVEEAGRAVLTQTAADEPITLILSEKGWIRSRAGHNLDLSQTAFKEGDRLKQTLEGRTVLPVVILDSSGRTYSIDAAEIPGGRGDGVPVSSLIELQNGAKPVAMLTGLPEQHYLLSSSGGYGFIAKLGDMVGRVKAGKVVMTADSGETVLPPVAVYASSFINPDCKIIAATSQNRALAFPIGELKIMAKGKGLQIIGLNAGESMTHTAVSSEPEILIESEGRRGAAHKDRLPVALIEAKRGKKGRLLPISGSLKQLSSPK*	common_virus_hmm	common_virus	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0002	persistent	direct	high	2303	1.0	GCA_016802425.1_01296
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1251021	1252739	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	3156	4874	GCA_016802425_1_1_1232	GCA_016802425_1_1_1232	+	2217364	.	COG3829	Transcriptional regulator containing PAS, AAA-type ATPase, and DNA-binding Fis domains [Transcription, Signal transduction mechanisms]. 	MVISNPRELEKLKDRIPNLINIIRVAIVFPLMIMHILGLETGSRANLHASWTAWAFYLWLAIACWLIFFSTLNPQWQWQALRIPSFSAVADITMIGVLTYLFGGIDSGFGILILPFVGSSCLLSYGRYPLLYASYASILLIFNALADSNINMYPLILDAKTVTNTFVVVAGSYFVAMIASLSVRYIDRAGKLAHENHVAYRRIRGLNQIVLNRVQEAVVVINVEHQTILFNKKAKDLLPMLEIGQHTSLFDPVAILWDKTSSRTFEHYIDTPELTARIRAVPMNKKQNKLLILYIRPQSEIQAEALSVKLAALGQLTANLAHEIRNPMSAIRHADGGTLFLDEVADLPLSMQVKLLRAIQEKAVRRIGDATEQPVDVRIVCATHNNLEALVESGAFRQDLYYRLNVVSLNMPSLREMRENLKLPTPYLLYKHSHNNRPYTLSPAAQQMLLNYSYPGNFRELENILERAVALCVGYTVQIDDLQIQDVHHKPVRTETAVPVADTLPSETAAAPSRLLPFDPDTMQIQDYLDKIERDIIGQVLKQTEGNRTQAAKRLGISFRSMRYRMERLNID*	mmseqs_cdd	nonviral_gene	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0003	persistent	direct	high	1718	0.999	GCA_016802425.1_01297
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1252839	1253591	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	4974	5726	GCA_016802425_1_1_1233	GCA_016802425_1_1_1233	+	2217364	.	pfam04445	Putative SAM-dependent methyltransferase. This is a family of putative SAM-dependent methyltransferases.	MTDILIDDTATEAVRTLIRAFPLVPVSQPPEQGSYLLAEHDTVSLRLVGEKSNVIVDFTSGAAQYRRTKGGGELIAKTVNHTAHPTVWDATAGLGRDSFVLASLGLTVTAFEQHPAVACLLSDGIRRALLNPETQDTAARINLHFGNAAEQMPALVKTQGKPDIVYLDPMYPERRKSAAVKKEMAYFHRLVGEAQDEVILLHTARQTAKKRVVVKRPRLGEHLAGQAPAYQYTGKSTRFDVYLPYGADKG*	mmseqs_cdd	nonviral_gene	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0004	persistent	direct	high	752	0.999	GCA_016802425.1_01298
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1254135	1255097	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	6270	7232	GCA_016802425_1_1_1234	GCA_016802425_1_1_1234	-	2217364	.	PFAM:PF01548.16	Transposase	MRNAVGLDISKLTFDASAMVGNAEYSAKFDNDSKGLDQFSDRLKSLGCQNLHICMEATGNYYEEVADYFAQYYSVYVVNPLKISKYAESRFKRTKTGKQDAKLIAQYCRSAQESELVKRQKPTDEQYRLLRMTAAYAQIKSECAAMKNRHHAAKDEEAAKAYAQIIKAMNEQLEVLKEKIKEQTEKPNCKEGVKRLETIPAIGRMTAAVLFHHLTSSKFETSNKFAAFAGLSPQQKESGTSVRGKGKLTKFGNRKLRAVLFMPAMVAYRIRAFPGFIKRLEEKKKPKKVIIAALMRKLAVIAYHVHKKGGDYDPSRYKSA*	common_virus_hmm	common_virus	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0005	persistent	direct	high	962	0.999	GCA_016802425.1_01299
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1255608	1255967	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	7743	8102	GCA_016802425_1_1_1235	GCA_016802425_1_1_1235	-	2217364	.	.	hypothetical protein	MIHKPRYIKIVDENGDFTRVLRLHKFPDTSKVFYFEPMFWLKDGRLARKDSLFEVDYIYGADGCGFLPSNLTEFRKYCRKKHQKFKDDEVLVNRYAVDFLGAKEPPYDDRHVTSVKYFV*	.	hypothetical_protein	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0006	persistent	direct	high	359	0.997	GCA_016802425.1_01300
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1256088	1257173	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	8223	9308	GCA_016802425_1_1_1236	GCA_016802425_1_1_1236	-	2217364	.	PFAM:PF05707.11	Zonular-occludens-toxin-(Zot)	MIYLFTGNMGAGKTPRVVSMILNNEDGLFKMELEDGTEADRPLYFCHIDGLDKRKFNARELAEGQIMSAPLRDVIPEGAVLIVGEAHYTYPVRAAGRPVPPYIQELTELRHHGHTVILMTRHPSQLDIFVRNLVSKHVHLERKAIGMKQYYWYKCVTSLDNPAGVSGVEAANWKPPKEAFKYYKSSSRHQKFKKKVPWAVWALIAVVGFVGWKSYGMFQVYSKATDSRIEQEAQKESVVQTMTEQTASSETAPFEHSDNLKPEDFVPTLPEKPESKPIYNTVRQVKTFEQIAGCIDGGKSDCTCYSNQGTPLKEITKIMCKEYVKNGLPFNPYKDERQRTEQAAQSAKADKPQVLVMGGKP*	hallmark_hmm	common_virus	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0007	persistent	direct	high	1085	0.999	GCA_016802425.1_01301
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1257183	1257473	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	9318	9608	GCA_016802425_1_1_1237	GCA_016802425_1_1_1237	-	2217364	.	PFAM:PF10734.8	Minor-Head-Virion-Protein	MPLLSGLIPLLGILLKMLIVRIILATGLTFVTYAGYLAALEKFKGYTSNAINSMPSDILNLLLISGFGQGLGCLFGAFSFFIGMHAFKKLTFVFPG*	hallmark_hmm	common_virus	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0008	persistent	direct	high	290	0.997	GCA_016802425.1_01302
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1257474	1259042	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	9609	11177	GCA_016802425_1_1_1238	GCA_016802425_1_1_1238	-	2217364	.	PFAM:PF05616.12	attachment-protein	MNSFIKSTPIVLILILCSSNSYSEPVRLEKSQIKFQSSNNLKSIGFKLDSSSNSFSKFTEAANFEHIPTGAKARINAKITASVSRAGVLSGVGKLVRQGAKFGTRAVPYVGTALLAHDVYQTFKEDIQARGCRYDPETDKFVKGYEYANCLWYEDERRINKTYGCYGVDSSIMRLMPDRSRFPEVKQLMESQMERIARPFWDKRKEEIPKDTALKWRLFPFSHCEFFWNGGGCFVRNGDNLIHRVYFKLERNPKYKEEMDAKKPEEILSLKVDADPDKYIKATGYPGYSEKVEVAPGTKVNMGPVTDRNGNPVQVAATFGRDAQGNTTADVQVIPRPDLTPASAEAPHAQPLPEVSPAENPANNPDPDENPGTRPNPEPDPDLNPDANPDTDGQPGTSPDSPAVPDRPNGRHRKERKQGEDGGLSCDYFPEILACQEMGKPSDRMFHDISIPQVTDDKTWSSHNFLPSNGVCPQPKTFHVFGRQYRASYEPLCVFAEKIRFAVLLAFIIMSAFVVFGSLGGE*	common_virus_hmm	common_virus	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0009	persistent	direct	high	1568	0.999	GCA_016802425.1_01303
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1258984	1259301	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	11119	11436	GCA_016802425_1_1_1239	GCA_016802425_1_1_1239	-	2217364	.	PF06575.12	Protein of unknown function (DUF1132)	MNKPFITQAQLALYKYQPSSEYFGQSMAFIAQKEFEEFVNNVKEYDILESFSYFLNKRVAHNIWKIYFSDESVIFIRKSEENGKTVHEFVYQEYTDSSDFNSMFE*	hhsuite_tools	nonviral_gene	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0010	persistent	direct	high	317	0.997	GCA_016802425.1_01304
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1259714	1259932	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	11849	12067	GCA_016802425_1_1_1240	GCA_016802425_1_1_1240	-	2217364	.	CDD:pfam10389	filamentous-major-capsid-protein-B	MKFINTCRKYGAKLAVVTAAPLALAAQANAALPETAKNALEAAKADGMEAGWIVVGVFAALFVFSIVKRVMK*	hallmark_hmm	common_virus	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0011	persistent	direct	high	218	0.995	GCA_016802425.1_01306
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1260006	1260203	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	12141	12338	GCA_016802425_1_1_1241	GCA_016802425_1_1_1241	-	2217364	.	.	hypothetical protein	MQKVYVVQSVSTGDFLYLSPETGDIGHTKLITNADYFYDFEEAVNAGLEEIGNQCEFVVFGFLKD*	.	hypothetical_protein	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0012	persistent	direct	high	197	0.995	GCA_016802425.1_01307
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1260208	1260498	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	12343	12633	GCA_016802425_1_1_1242	GCA_016802425_1_1_1242	-	2217364	.	PFAM:PF07459.10	RstB-protein	MNIQLQGHIVGVKKFNGQIEGKSFDYCRLIVATPLDSSQGNALGSSTTEYDFGGSANFEQFRNAQFPIEANLNVEIVTTGKTQKLKVIGFQLVKKG*	common_virus_hmm	common_virus	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0013	persistent	direct	high	290	0.997	GCA_016802425.1_01308
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1260543	1261871	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	12678	14006	GCA_016802425_1_1_1243	GCA_016802425_1_1_1243	-	2217364	.	PFAM:PF02486.18	Replication-initiation-factor	MEDKQGMTKEVAGVMTEAPADGRKPATASNLPPPYLTGGGTETETAGRVQEVFECYETYITDGKGNLLGVPLRRGVSDSAFIDQITFSIHEDTFFHVYGLSFDLFDDDDFIRAASAKMEEIFGFGIIEKAKHSGGRFYEGCWLMGTENAQYGRVHYGGQRETMLVELTAVGCNAANIGWESRLFDFLTNAIRPKITRVDIAKDFFNGEYSPNQAREDRNKGLFTCHHVKPKGECLGSDWEEEDDETKMTSGKTYGIGSRESSKYVRIYEKGKQLGDKTSTWTRFEIEFKAKDIVIPFEVLQTPGEYFGGAYPICERFTGSANRIEAVKSKIMIDFDTYIERLKKQIGRGINASKAVFPDKSKQELFEVLEPKHDFLPKKLSFENYDCSEAKLTPLHEIPSVLKFDQYGMWMDRYIQRQKTGEEQRYLEKMYDKYANLPISWA*	rep_hall_hmm	common_virus	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0014	persistent	direct	high	1328	0.999	GCA_016802425.1_01309
GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote	cenote	CDS	1262543	1262947	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C100	14678	15082	GCA_016802425_1_1_1244	GCA_016802425_1_1_1244	+	2217364	.	COG0537	Diadenosine tetraphosphate (Ap4A) hydrolase or other HIT family hydrolase [Nucleotide transport and metabolism, Carbohydrate transport and metabolism, General function prediction only]. 	MTAQPCPICTAQDEDILLQTPKLRVIAVHNDSGSPAFCRVIWHGHIAEITDLSAAERGELMEMVYKVEAAMRQVFRPAKINLASLGNVVPHLHWHIIARFENDATFPAPIWANPVRKHGMTLPQNWTEQLKKLL*	mmseqs_cdd	nonviral_gene	C100	15082	1247866	1262948	GCA_016802425.1|CP048911.1@region_1247867_1262948@tool_cenote_CDS_0015	persistent	direct	high	404	0.998	GCA_016802425.1_01310
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1622482	1623528	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	1	1047	GCA_016802425_1_1_1583	GCA_016802425_1_1_1583	-	2217364	.	PRK11815	tRNA dihydrouridine(20/20a) synthase DusA. 	MFELKECENLMINKELIEHKGKRRLCVAPMLDWTDRHYRYLARQITRNAWLYSEMVNAGAIVYGDKDRFLMFNEGEQPVALQLGGSDPSDLAKAAKAAEEYGYNEVNLNCGCPSPRVQKGAFGACLMNEVGLVADCLNAMHDAVGIPVTVKHRIGVDRQTEYQTVADFVGTLRDKTACKTFIVHARNAWLDGLSPKENRDVPPLKYDYVYRLKQEFPELEIIINGGITTNEAIAGHLQHVDGVMVGREAYHNPMVMREWDRLFYGDNRAPIEYADLVQRLYTYSQVQIQAGRGTILRHIVRHSLGLMHGLKGARTWRRMLSDATLLKDNDGGLIFEAWKEVERANTRE*	mmseqs_cdd	nonviral_gene	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0001	persistent	direct	high	1046	0.999	GCA_016802425.1_01663
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1623618	1624772	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	1137	2291	GCA_016802425_1_1_1584	GCA_016802425_1_1_1584	+	2217364	.	PDB:1Z19_B	Integrase	MATITKRRNPSGETVYRVQVRVGKKGYPAFNESRTFSKKALAVEWGKKREAEIEAGPELLFKRGKVKMMTLSEAMRKYLNETLGAGRSKKTGLRFLMEFPIGGIGIDKLKRSDFAEHVMQRRRGIPELDIAPIAASTALQELQYIRSVLKHAFYVWGLEIGWQELDFAANGLKRSNMVAKSAIRDRLPTTEELQTLTTYFLRQWQSRKSSIPMHLIMWLAIYTSRRQDEICRLLFDDWHKNDCTRPVRDLKNPNGSTGNNKEFDILPMALPVIDELPEESVRKRMLANKGIADSLVPCNGKSVSAAWTRACKVLRIKDLRFHDLRHEAATRMAEDGFTIPQMQRVTLHDGWNSLQRYVSVRKRSTRLDFKEAMMQAQSDIKSGK*	common_virus_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0002	persistent	direct	high	1154	0.999	GCA_016802425.1_01664
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1624822	1625088	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	2341	2607	GCA_016802425_1_1_1585	GCA_016802425_1_1_1585	-	2217364	.	pfam11112	Pyocin activator protein PrtN. PrtN is a transcriptional activator for pyocin synthesis genes. It activates the expression of various pyocin genes by interaction with the DNA sequences conserved in the 5' noncoding regions of the pyocin genes.	MNISKEQGLLIAYGGRPYIPPREVHKDFFAHIGFNAFKASGVRCELPFPIFRLSDSRKSEYFVSVRELAKAIADKEEKAKSEYRKFRS*	mmseqs_cdd	nonviral_gene	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0003	persistent	direct	high	266	0.996	GCA_016802425.1_01665
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1625196	1626143	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	2715	3662	GCA_016802425_1_1_1586	GCA_016802425_1_1_1586	-	2217364	.	PFAM:PF02384.15	DNA-methyltransferase	MTFQGHNNRKKAGGYAEYITGGSLRRLVAAKVRRYCGEHPGVFDGAAGSGQLEQYIEPSDFRAVEIQAEACKALLQNYPAAKVYNTSLFLYTDGEPQDCTVMNPPFSIKLKDLSEDEKSRIAQEYPWKKSGVADEIFVLKGLENARRFGFFILFPGIAYRKSEQRFREIIGNRLAELNRIQNAFEDTPIEVLLLVIDKDKTDGGCIRELYDCKTDTLLAADTWQIEPDLWQTVQEPAPPKEKEDPVLLEHECRDAAAKRIARELRFSKMVNEIEGWPHAEFDGFCDRLCNLIQAEKYGKKHYFPCSLPLFGGAAG*	phrogs_hmm	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0004	persistent	direct	high	947	0.999	GCA_016802425.1_01666
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1626342	1627328	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	3861	4847	GCA_016802425_1_1_1587	GCA_016802425_1_1_1587	-	2217364	.	.	hypothetical protein	MQTVATKPTAKQMLAAKRAAKESTRQERAVKRAGTVKNVDRNRLSARSKAQKENIARMLSGAKVSEDEALTCGIMMRLSLQDMRYACNQEELINFAEHIVKQVQRLGLYCNTDDPANGESVLFACREASQAVAQWTKDFDDLSPNQRQLVLRPLSNLFAAYEEFLKDAPARLIAEVSAYSLAVRVAKKAMAFLELDGGLISAVGKVVNGADSRAEARRLKMPYAEFTGRILHAANLLYDVGIQADKELSAMYGKPLNPVRPRRISDVRRPMMKMLVADKGGALVRAVKDSEDVIRHCDNGAGFSCFNWTEHFKRTANLISLMHREAAA*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0005	persistent	direct	high	986	0.999	GCA_016802425.1_01668
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1627439	1627654	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	4958	5173	GCA_016802425_1_1_1588	GCA_016802425_1_1_1588	-	2217364	.	.	hypothetical protein	MSYLEDVKNALRVIDNLCKEALKEPESLEGYIDEIRDKADEADTSLEFLKDVINYGISDLKNVIEVFEDCV*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0006	persistent	direct	high	215	0.995	GCA_016802425.1_01669
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1627706	1628197	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	5225	5716	GCA_016802425_1_1_1589	GCA_016802425_1_1_1589	-	2217364	.	PFAM:PF05565.10	resistance-protein	MTALTLYRCAADVQAALDYYFDSETEREDTLEAVIGQFEVKAQSVIAYIKNQEITEKMLEEHIGRMTGKLKAAKARNQSLKDYLARNMQAAGITEIKADDGTFKASFRKSEAVVILDEAQIPAEFMREAVKTEPDKTAIRKAIESGRQVAGAKIEGRKNLQIR*	common_virus_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0007	persistent	direct	high	491	0.998	GCA_016802425.1_01670
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1628194	1628376	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	5713	5895	GCA_016802425_1_1_1590	GCA_016802425_1_1_1590	-	2217364	.	.	hypothetical protein	MANIDLTQWDGKTIGAAANPEQGYINITIGSDDLFINIEQAYAIHAALGEAVAEYEGGAQ*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0008	persistent	direct	high	182	0.995	GCA_016802425.1_01671
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1628516	1629202	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	6035	6721	GCA_016802425_1_1_1591	GCA_016802425_1_1_1591	-	2217364	.	.	hypothetical protein	MSLILSVKDESNFKPCPAGSHHATCIRIIDLGTQLVEYQNEQKRQHKILVQWEIDPEGDPEMLMPDGRPYLISRRYTASLHSKSQLATDLKSWRGRDFTPEERDNFDLRNILGKPCLLSIAHQESSDGKTTYANISAISNKMKSYTPKHPDNAVFAFDLSDPDWANYGLLNEKLREQIAKSPEYAEAVNGRQPPAPPQKQAQAAEGQTEYPQGNAAPAEDIEDDIPFN*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0009	persistent	direct	high	686	0.999	GCA_016802425.1_01672
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1629271	1629432	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	6790	6951	GCA_016802425_1_1_1592	GCA_016802425_1_1_1592	-	2217364	.	.	hypothetical protein	MSFHPETAYNGGGETEPYGPSPEEIKYRQSPETAETRRMTEKQAEGHIKSIIR*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0010	persistent	direct	high	161	0.994	GCA_016802425.1_01673
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1629429	1629707	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	6948	7226	GCA_016802425_1_1_1593	GCA_016802425_1_1_1593	-	2217364	.	.	hypothetical protein	MKTRNIAFKFAVLAAVLAAGYAFGFAKGGGSRTAKGKPAGIAAMRMALAQKQAEVAELSAEIWLEERHLNADEEEAGCRRVHGDAEVPGGKE*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0011	persistent	direct	high	278	0.996	GCA_016802425.1_01674
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1629860	1630192	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	7379	7711	GCA_016802425_1_1_1594	GCA_016802425_1_1_1594	-	2217364	.	.	hypothetical protein	MKYYGTAAYGSPDWGMERYYAREDMRQALDGWEAENRILHESGLIEIAKKSAREFVRDADGEPYAQEDWETYLTEDASRIGKDTEAAMNYAIDEREWFALAENIGRLANS*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0012	persistent	direct	high	332	0.997	GCA_016802425.1_01675
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1630333	1630608	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	7852	8127	GCA_016802425_1_1_1595	GCA_016802425_1_1_1595	-	2217364	.	.	hypothetical protein	MSYLDQPLKHGYGNGNGSGNGSGYGNGYGKGDGSGYGNGKGDGSGSGYGNGKGDGDGSGNGDGDGNGNGSGNGSGYGNGHGNGYSNGSGNG*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0013	persistent	direct	high	275	0.996	GCA_016802425.1_01676
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1630605	1631081	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	8124	8600	GCA_016802425_1_1_1596	GCA_016802425_1_1_1596	-	2217364	.	.	hypothetical protein	MEANKFEVKSLSDLIKVFAGIAADFEAAMGVKRADISTEFDEPQHEPQPPVTVAEQKGINDFAIGKEVIIRTYSAGVWFGVLKQKAGNEVILTKARRMYSWWAKESISLSGVARHGIRQDGSQICGELDSVWLEAIEIIPVTGGAAESIRTALEVAQS*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0014	persistent	direct	high	476	0.998	GCA_016802425.1_01677
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1631114	1631314	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	8633	8833	GCA_016802425_1_1_1597	GCA_016802425_1_1_1597	-	2217364	.	.	hypothetical protein	MNELISRINRFGTRAKDGQSLLLKVGEICRDAAATWTTRKSESINHTAFTFTVKKDGLKEKVMIVL*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0015	persistent	direct	high	200	0.995	GCA_016802425.1_01678
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1631636	1632196	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	9155	9715	GCA_016802425_1_1_1598	GCA_016802425_1_1_1598	-	2217364	.	.	hypothetical protein	MDIKTEEAYRLSFQHIQSHDVLAACRTVANYELSQPRPRGLFSGISAQEYWESYPCNEDAEILKSILLDSPEILDGISGGDMEMARIMAAFNFIWGLSHFPKWLHRHEFASTPLDDSAVPAMLLFHAQSRQELKEYEEVELSCCPDGCEFCKSEDGKIYKSSDAPVLPHAHCTHEQGCRCCYLPVI*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0016	shell	direct	high	560	0.998	GCA_016802425.1_01679
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1632196	1632894	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	9715	10413	GCA_016802425_1_1_1599	GCA_016802425_1_1_1599	-	2217364	.	PDB:2FJR_A	Repressor-protein-CI	MNRVDRIKNLIADRFNGNQAEFSRAINKAPAQINQWLNGYRNIGDGVAAQIEIALGLPRGWVDGNDKPGIPVDSIKSNATVIGSVDAWDSKTPLSDDDCEVPFYKDVCLSAGNGFSDEIEDYNGYKLRFSKSTLRRHGINPDDVVCVSADGDSMEPVFPDGATLGINTADKMIKDGKIYAINHSGLLRTKILQKLPDNQVRIKSYNPEYKDETASLDSLTVIGRVFWWSVLD*	common_virus_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0017	shell	direct	high	698	0.999	GCA_016802425.1_01680
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1633341	1634240	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	10860	11759	GCA_016802425_1_1_1600	GCA_016802425_1_1_1600	+	2217364	.	PFAM:PF04492.12	Replication-protein-O	MKYIPNSFQIANAVVDDFLCRMSGNAWKCYAVIVRKTTGWQKEIDYISVSQFKNLTGIKTDVTVADALKELVELNLIASVKRHGQVTGYRINMPEPSPENGGTPPPENGGTATPKNWVHPKNGTTPKNWGVLPPENGGTTTPKNWGSTKHTTKPTNTKHSISASAAADAPLSAEPPESGKRAPAAKAKKTGRHETELSLLADYGITGQVAADFLQVRKAKRQPLTETAMRLIAADAEKCGMTALQAAEYAIASGWGSFRADWLQNKTFGRSGNRGGPTHNQTAAVPDAGSYGDMPTTDF*	rep_hall_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0018	shell	direct	high	899	0.999	GCA_016802425.1_01682
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1634255	1635037	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	11774	12556	GCA_016802425_1_1_1601	GCA_016802425_1_1_1601	+	2217364	.	PDB:4M4W_K	Replicative-helicase	MALRNASDFLGAYGGGVRVERRQCAEHGGYAAKSVLRGVWTGCPACRKLEAADEMAAYAETLRRGAMRDALEKRIGRSGIAPRFRNCRIENYAVSDSIPGMARAKAAAAEYAANFADVLQTGRSMIFSGRRGTGKNHLACGIAREVIAAGKSALVITVGDMLRTVKDSFGGGGGEAGAVGVFVKPDLLVLDEFGAGSLSETDGRILFSVVNARYERLMPMLVLTNLTAEAFRENTDARIRDRLRDGGGKLIPFDWESYRA*	rep_hall_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0019	persistent	direct	high	782	0.999	GCA_016802425.1_01683
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1635030	1635260	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	12549	12779	GCA_016802425_1_1_1602	GCA_016802425_1_1_1602	+	2217364	.	.	hypothetical protein	MRETCFFCKHADFKTQPDTPVRGFAKCAKARDAEEKATYYPRTNPCAAGAFQTASGAAVAKRTAVLGEYPPAMRRI*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0020	persistent	ambiguous	low	9	0.039	GCA_016802425.1_01683
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1635352	1635807	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	12871	13326	GCA_016802425_1_1_1603	GCA_016802425_1_1_1603	+	2217364	.	PFAM:PF11753.7	nucelotide-kinase	MTVRNTQTETVRTEAAPQQGGNTNPGYYKNRAFECVGFAQYLNFNLGNAFKYIWRHKEKGGREDLEKALRYLERQRADAPKFKKLKHRRYEKMYAGLKDCGFDGGTEAALLAVISAAYYIRDGEDNFAWAAACVEDLLEKMPPEEQRLNNG*	common_virus_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0021	persistent	direct	high	455	0.998	GCA_016802425.1_01684
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1635829	1635978	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	13348	13497	GCA_016802425_1_1_1604	GCA_016802425_1_1_1604	+	2217364	.	.	hypothetical protein	MDTFLKIIATLSFAGAATLAVWLLVEAADAVLRRKRDGKGEDDFDGFGY*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0022	persistent	direct	high	149	0.993	GCA_016802425.1_01685
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1636007	1636288	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	13526	13807	GCA_016802425_1_1_1605	GCA_016802425_1_1_1605	+	2217364	.	PFAM:PF05766.11	HNH-endonuclease	MAEEMRTCKACGGTKPLEKGFNAVPRKEGGVYYYKSCKTCRNKAVRQKRAEKRAAAGAGAMTAARLHGYIRAAHAACPILGAGLWTQPAGECA*	phrogs_hmm	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0023	persistent	direct	high	281	0.996	GCA_016802425.1_01686
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1636420	1636659	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	13939	14178	GCA_016802425_1_1_1606	GCA_016802425_1_1_1606	+	2217364	.	PFAM:PF05866.10	Endodeoxyribonuclease-Rus	MPSEGAVAVYVRLIPKANKDGGANKTVIDLDNALKVALDALQGVAYHNDRQVRRIAADYADEPVTGGGLAVEVGELDEK*	common_virus_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0024	persistent	direct	high	240	1.0	GCA_016802425.1_01687
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1636988	1637950	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	14507	15469	GCA_016802425_1_1_1607	GCA_016802425_1_1_1607	-	2217364	.	PFAM:PF01548.16	Transposase	MRNAVGLDISKLTFDASAMVGNAEYSAKFDNDSKGLDQFSDRLKSLGCQNLHICMEATGNYYEEVADYFAQYYSVYVVNPLKISKYAESRFKRTKTGKQDAKLIAQYCRSAQESELVKRQKPTDEQYRLLRMTAAYAQIKSECAAMKNRHHAAKDEEAAKAYAQIIKAMNEQLEVLKEKIKEQTEKPNCKEGVKRLETIPAIGRMTAAVLFHHLTSSKFETSNKFAAFAGLSPQQKESGTSVRGKGKLTKFGNRKLRAVLFMPAMVAYRIRAFPGFIKRLEEKKKPKKVIIAALMRKLAVIAYHVHKKGGDYDPSRYKSA*	common_virus_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0025	persistent	direct	high	962	0.999	GCA_016802425.1_01688
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1638461	1638820	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	15980	16339	GCA_016802425_1_1_1608	GCA_016802425_1_1_1608	-	2217364	.	.	hypothetical protein	MIHKPRYIKIVDENGDFTRVLRLHKFPDTSKVFYFEPMFWLKDGRLARKDSLFEVDYIYGADGCGFLPSNLTEFRKYCRKKHQKFKDDEVLVNRYAVDFLGAKEPPYDDRHVTSVKYFV*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0026	persistent	direct	high	359	0.997	GCA_016802425.1_01689
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1638941	1640026	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	16460	17545	GCA_016802425_1_1_1609	GCA_016802425_1_1_1609	-	2217364	.	PFAM:PF05707.11	Zonular-occludens-toxin-(Zot)	MIYLFTGNMGAGKTPRVVSMILNNEDGLFKMELEDGTEADRPLYFCHIDGLDKRKFNARELAEGQIMSAPLRDVIPEGAVLIVGEAHYTYPVRAAGRPVPPYIQELTELRHHGHTVILMTRHPSQLDIFVRNLVSKHVHLERKAIGMKQYYWYKCVTSLDNPAGVSGVEAANWKPPKEAFKYYKSSSRHQKFKKKVPWAVWALIAVVGFVGWKSYGMFQVYSKATDSRIEQEAQKESVVQTMTEQTASSETAPFEHSDNLKPEDFVPTLPEKPESKPIYNTVRQVKTFEQIAGCIDGGKSDCTCYSNQGTPLKEITKIMCKEYVKNGLPFNPYKDERQRTEQAAQSAKADKPQVLVMGGKP*	hallmark_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0027	persistent	direct	high	1085	0.999	GCA_016802425.1_01690
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1640036	1640326	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	17555	17845	GCA_016802425_1_1_1610	GCA_016802425_1_1_1610	-	2217364	.	PFAM:PF10734.8	Minor-Head-Virion-Protein	MPLLSGLIPLLGILLKMLIVRIILATGLTFVTYAGYLAALEKFKGYTSNAINSMPSDILNLLLISGFGQGLGCLFGAFSFFIGMHAFKKLTFVFPG*	hallmark_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0028	persistent	direct	high	290	0.997	GCA_016802425.1_01691
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1640327	1641895	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	17846	19414	GCA_016802425_1_1_1611	GCA_016802425_1_1_1611	-	2217364	.	PFAM:PF05616.12	attachment-protein	MNSFIKSTPIVLILILCSSNSYSEPVRLEKSQIKFQSSNNLKSIGFKLDSSSNSFSKFTEAANFEHIPTGAKARINAKITASVSRAGVLSGVGKLVRQGAKFGTRAVPYVGTALLAHDVYQTFKEDIQARGCRYDPETDKFVKGYEYANCLWYEDERRINKTYGCYGVDSSIMRLMPDRSRFPEVKQLMESQMERIARPFWDKRKEEIPKDTALKWRLFPFSHCEFFWNGGGCFVRNGDNLIHRVYFKLERNPKYKEEMDAKKPEEILSLKVDADPDKYIKATGYPGYSEKVEVAPGTKVNMGPVTDRNGNPVQVAATFGRDAQGNTTADVQVIPRPDLTPASAEAPHAQPLPEVSPAENPANNPDPDENPGTRPNPEPDPDLNPDANPDTDGQPGTSPDSPAVPDRPNGRHRKERKQGEDGGLSCDYFPEILACQEMGKPSDRMFHDISIPQVTDDKTWSSHNFLPSNGVCPQPKTFHVFGRQYRASYEPLCVFAEKIRFAVLLAFIIMSAFVVFGSLGGE*	common_virus_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0029	persistent	direct	high	1568	0.999	GCA_016802425.1_01692
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1641837	1642154	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	19356	19673	GCA_016802425_1_1_1612	GCA_016802425_1_1_1612	-	2217364	.	PF06575.12	Protein of unknown function (DUF1132)	MNKPFITQAQLALYKYQPSSEYFGQSMAFIAQKEFEEFVNNVKEYDILESFSYFLNKRVAHNIWKIYFSDESVIFIRKSEENGKTVHEFVYQEYTDSSDFNSMFE*	hhsuite_tools	nonviral_gene	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0030	persistent	direct	high	317	0.997	GCA_016802425.1_01693
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1642567	1642785	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	20086	20304	GCA_016802425_1_1_1613	GCA_016802425_1_1_1613	-	2217364	.	CDD:pfam10389	filamentous-major-capsid-protein-B	MKFINTCRKYGAKLAVVTAAPLALAAQANAALPETAKNALEAAKADGMEAGWIVVGVFAALFVFSIVKRVMK*	hallmark_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0031	persistent	direct	high	218	0.995	GCA_016802425.1_01695
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1642871	1643074	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	20390	20593	GCA_016802425_1_1_1614	GCA_016802425_1_1_1614	-	2217364	.	.	hypothetical protein	MSRYQQKFIVQELENHEFIYPDSFGDIGFTSNIKSAGKYDSYEDAFSSALEEIGGEFVIFGFYEKED*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0032	persistent	direct	high	203	0.995	GCA_016802425.1_01696
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1643088	1643399	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	20607	20918	GCA_016802425_1_1_1615	GCA_016802425_1_1_1615	-	2217364	.	PFAM:PF07459.10	RstB-protein	MFETSQVTTYTATLLGAKKFKGEIDGNKIDSCTVLVASPMPSNGNAVGFTSESMKFGDSHNFEKLKNLKFPCAVDLTVAMESTGKGLVQKLLDFQVKGAAPKA*	common_virus_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0033	persistent	direct	high	311	0.997	GCA_016802425.1_01697
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1643413	1644741	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	20932	22260	GCA_016802425_1_1_1616	GCA_016802425_1_1_1616	-	2217364	.	PFAM:PF02486.18	Replication-initiation-factor	MKAFEDKALAVSADMADALADGGAAATAVGCPPRLIGGEQNKTPNPKGAEKTENQEFQFEYFSHFVSDGKGRFIEIPLRRGRDDGAFIDQITFTIHENSMTKVTGKGLVSDTEFVVRYSELLEEILGFGITKKLPFKGKFFYQSCYQFGPDNVEYGKVHYGGQCETMLVELNGTGCMAALPGWENRLYEFLSKCVRPKITRIDVAHDFFNGEYTPDQAMLDHDNGHYDVHNMRPKSECRGTAWRNEDGSGKTFYIGKRGNSKFTRVYEKGRQLGDVDSPWVRFEGDIEIPLDVLLYSGSYLGGAYPICKEIFKTEAKRMEVKVKNVNLIFDVKLFHARNQVGKMVNFLRDIGWDDSRIVDELVKGVEGYPKGLQPEQYDCKNQTQKFQYIHEEQKAINALNIETLFDDLIEEREYAFPQDRERQHIKDIEYEERQISDFLNN*	rep_hall_hmm	common_virus	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0034	persistent	direct	high	1328	0.999	GCA_016802425.1_01698
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1644728	1644952	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	22247	22471	GCA_016802425_1_1_1617	GCA_016802425_1_1_1617	-	2217364	.	.	hypothetical protein	MFIFYTVNPEHVYFPKAYIMKVFKDKGYESQCITTVSFYICNPTLKQKTENEAYEYGRLFVKELMHKECNRESL*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0035	persistent	direct	high	224	0.996	GCA_016802425.1_01699
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1645348	1645554	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	22867	23073	GCA_016802425_1_1_1618	GCA_016802425_1_1_1618	-	2217364	.	pfam10981	Protein of unknown function (DUF2788). This bacterial family of proteins have no known function.	MDEAVFADWALKICLTGLIIFLGFIVWNLGKESKAGKFGIAVLFLVLGLGVFGFVFKELLIKFLVLPK*	mmseqs_cdd	nonviral_gene	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0036	persistent	direct	high	206	0.995	GCA_016802425.1_01700
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1645649	1646818	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	23168	24337	GCA_016802425_1_1_1619	GCA_016802425_1_1_1619	-	2217364	.	TIGR01325	O-succinylhomoserine sulfhydrylase. This model describes O-succinylhomoserine sulfhydrylase, one of several related pyridoxal phosphate-dependent enzymes of cysteine and methionine metabolism. This enzyme is part of an alternative pathway of homocysteine biosynthesis, a step in methionine biosynthesis. [Amino acid biosynthesis, Aspartate family]	MSKKLHPQTLAIRGGKEQTGYREHNQALFLTSSFMWDNAQHAADLFSKKIKGFTYTRTANPTIAAFEKRIAALEGAERAVATSTGMSAIQAAFFTFLQAGGHVVSSRSLFGTTVGFINNIVTKFGIGVSRVSPTDINEWKAAVKANTKLLFLETPSNPLGEVADLEALAELAHGIGALLVVDNSLLSPVGSQPLKHGADISVSSATKAIDGHGRVMGGVLAGSEELMAQVAVYCNSCGLAMSPFNAWQLLSGVETLSLRMEKQFDNALRIAQWLQEQPQVQAVYYTGLPDHPQAELIRKQQNGGGIVIGFEVADQAAAWKVVDGVELFSRTANLGDVRSTITNPWTTTHGRMQPEEKLAAGIRPGLVRLSVGLEYVGDLIDDLKQALAR*	mmseqs_cdd	nonviral_gene	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0037	persistent	direct	high	1169	0.999	GCA_016802425.1_01701
GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote	cenote	CDS	1646964	1647734	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C120	24483	25253	GCA_016802425_1_1_1620	GCA_016802425_1_1_1620	-	2217364	.	.	hypothetical protein	MDTNNQDKEPNWEKRLENLRQTRRMNTAPAYVPLTKPSEVGKEEPIPKLDDANRDRVLKAYLKKWQEEHNSAVADCGEEVETDPMIVLQENWLNAQASLQMPVSEKHIESRRRIRFDAKKDSAEFETAQIEGGENADAAESGTAADGVAENGEGGAEEALMPVQINILNPKAVNRREVFCLSEQELTERLIKRLRPHLTDTVNGMIRTAVQKQMALFTYQLQQMLHEQAGAVVEDVLEHDVRKILNDIKYELKYKR*	.	hypothetical_protein	C120	25253	1622482	1647735	GCA_016802425.1|CP048911.1@region_1622483_1647735@tool_cenote_CDS_0038	persistent	direct	high	770	0.999	GCA_016802425.1_01702
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1652768	1653226	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	1	459	GCA_016802425_1_1_1625	GCA_016802425_1_1_1625	-	2217364	.	7RI4_G	BAM, EspP, hybrid barrel, MEMBRANE	MPICFPPKPVGGWKNKTAAKTYRWQPEVQLSYWFTRGYGFPLSNGLSAETDNFRSLMGRFGFRAGVDGLDGGRLNIYGKLMYKREFIGTIRHRFNGSAVEEFKHRGGWLEYGLGVVRRNAGNGRQLYFEAQRSSMHTMRQNWQVNMGVRSMF*	hhsuite_tools	hypothetical_protein	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0001	persistent	direct	high	458	0.998	GCA_016802425.1_01707
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1653316	1654170	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	549	1403	GCA_016802425_1_1_1626	GCA_016802425_1_1_1626	-	2217364	.	cd01344	PL2_Passenger_AT	MSNGARWTVTNDSMLKELDLSEDAQVEFSDNNKFVKVSVSKLKGDGGVFKMYGDIVKGESDKLITRKGSEGTHIIEYMDDAKAKTTGREYLKLVENKGNQEDNKASNKASYKLNVRCTEQGGWCFALGESGASKKVNISTDGKRDFYLYPDTLTPGASSSVLFGEALYQLNAVSDETLVQRMGEIHADGTPQEDNNVWIKRVGGKFSGSRSDYRVGGYGNRYWGFAGGFNRTGFGDKWIHYKGLMLRHLQSSYASEDYVGSGKILRQGGRCLFRLAQPGKQGLL*	hhsuite_tools	hypothetical_protein	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0002	persistent	direct	high	854	0.999	GCA_016802425.1_01708
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1654503	1655156	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	1736	2389	GCA_016802425_1_1_1627	GCA_016802425_1_1_1627	+	2217364	.	COG3676	Transposase and inactivated derivatives  [Mobilome: prophages, transposons]. 	MKITHCKLKKEVQKEPLRSFVPEVTARSAADILGIHPDSAALFYRKIRTVANHRLALAADEVFEGPAGPGASCFGGRRKGRRGRGAAGKAVVFGIPKRNGRAYTVAEDDAEPETLPPAVKKKIMPDGIVYADSPGSRGKSDAGGFIRCRINRSKEFADRRNHINGIGNFWNQAKRALRKYNGIDRKPFPPLLRECEFRLNFGTPSRQLKILRDRCGI*	mmseqs_cdd	nonviral_gene	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0003	persistent	direct	high	653	0.998	GCA_016802425.1_01709
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1655124	1656386	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	2357	3619	GCA_016802425_1_1_1628	GCA_016802425_1_1_1628	-	2217364	.	.	hypothetical protein	MKQKKTVQCILLGFAAASMHAQGAAAANSGTIEKTDKYTLVLAKQGQENNYTLNGGTEVKPLNSLIIAANGGTNNITIKGKLADGPADAPPTIDNNSIERNINKNGYTYAWQNWSGAVMLVDQSYEGENKVTFENVTIAAHNAPAGILSDDRHKSSSLAPAMLAFKGRNTINMDADSNANSSNEGILLLNNGEKMGEYRLVSEEGSTLNINIKSGKDKGQGITANHYGNSDINFNKASPNITTMEFKGDVNIKIDRNGQEEAESNGFGFYSSRKLGNKKQIPEGSKMEAIFRGNVDIVATPVYDEQGRPKSIGSAFAIDGKYSKVEVVGGEGKVVKIKGDIFAYNGGSVSVNLANKDSYFEGEAHIGKRSFAKGKDMFALTVDADGYELTPDTKSIEKKKLNVRGCTRLSLNSTPIPQDF*	.	hypothetical_protein	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0004	persistent	direct	high	1262	0.999	GCA_016802425.1_01710
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1657086	1657892	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	4319	5125	GCA_016802425_1_1_1629	GCA_016802425_1_1_1629	+	2217364	.	PRK06427	bifunctional hydroxy-methylpyrimidine kinase/ hydroxy-phosphomethylpyrimidine kinase; Reviewed	MKGSFVQTLAIAGSDSGGGAGIQADLKTFQMRGVFGTCVITAVTAQNTLGVSAVHLVPTETITAQIQAIREDFDIRAYKIGMLGTAEIIECVADKLKHCSFGRRVLDPVMIAKGGAPLLQDSAVAALTRLLLPDTDILTPNLPEAEALTGVHIENRKDAERAAKILLDYGVKNVIIKGGHLNGSTSGRCTDWLFTQNETLELDSPRFPTAHTHGTGCTFSACITAELAKGLDVCKAVQTAKAYITAAISNPLEIGAGHGPVNHWAYRD*	mmseqs_cdd	nonviral_gene	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0005	persistent	direct	high	806	0.999	GCA_016802425.1_01712
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1657950	1658804	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	5183	6037	GCA_016802425_1_1_1630	GCA_016802425_1_1_1630	-	2217364	.	PRK12335	tellurite resistance protein TehB; Provisional	MGQSGELFCFGQMPVWKVENLPEVLLSGYSSEEGEWVCLNVLQGDVEVRAPDGAAEVWSAESGDCVFAPQQVFSVKPKTDDAEIRLSLYCAAADYFHKKYGMSATHSAVAAAQDTVPAGRALDMGCGQGRNALFLGLKGFDVTAADCNPAALANVAELAEAEGLNVRTLEYDLNAAALQGEFDYIVATVVLMFLMPQRVPDVIADMQAHTAAGGYNLIVSAMDTADFPCPMPFPFKFKEGELKDYYRDWELVEYKEELGAMHAKDENGNPIRFKFVTMLAKKPG*	mmseqs_cdd	nonviral_gene	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0006	persistent	direct	high	854	0.999	GCA_016802425.1_01713
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1658932	1659369	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	6165	6602	GCA_016802425_1_1_1631	GCA_016802425_1_1_1631	+	2217364	.	PDB:1JL1_A	RIBONUCLEASE-HI	MDTPVYLYTDGACKGNPGAGGWGVLMRYGSREKELFGGEAQTTNNRMELTAVIEGLKSLKRRCTVIICTDSQYVKNGMENWIHGWKRNGWKTAAKQPVKNDDLWQELDALVGQHQVSWTWVKGHAGHAENERADDLANRGAAQFS*	common_virus_hmm	common_virus	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0007	persistent	direct	high	438	1.0	GCA_016802425.1_01714
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1659700	1660662	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	6933	7895	GCA_016802425_1_1_1632	GCA_016802425_1_1_1632	-	2217364	.	PFAM:PF01548.16	Transposase	MRNAVGLDISKLTFDASAMVGKTEHSAKFDNDSKGLDQFSDRLKSLGCQNLHICMEATGNYYEEVADYFAQYYSVYVVNPLKISKYAESRFKRTKTGKQDAKLIAQYCRSAQESELVKRQKPTDEQYRLLRMTAAYAQIKSECAAMKNRHHAAKDEEAAKAYAQIIKAMNEQLEVLKEKIKEQTEKPNCKEGVKRLETIPAIGRMTAAVLFHHLTSSKFETSNKFAAFAGLSPQQKESGTSVRGKGKLTKFGNRKLRAVLFMPAMVAYRIRAFPGFIKRLEEKKKPKKVIIAALMRKLAVIAYHVHKKGGDYDPSRYKSA*	common_virus_hmm	common_virus	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0008	persistent	direct	high	962	0.999	GCA_016802425.1_01715
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1661175	1661534	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	8408	8767	GCA_016802425_1_1_1633	GCA_016802425_1_1_1633	-	2217364	.	.	hypothetical protein	MIHKPRYIKIVDENGDFTRVLRLHKFPDTSKVFYFEPMFWLKDGRLARKDSLFEVDYIYGADGCGFLPSNLTEFRKYCRKKHQKFKDDEVLVNRYAVDFLGAKEPPYDDRHVTSVKYFV*	.	hypothetical_protein	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0009	persistent	direct	high	359	0.997	GCA_016802425.1_01716
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1661655	1662740	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	8888	9973	GCA_016802425_1_1_1634	GCA_016802425_1_1_1634	-	2217364	.	PFAM:PF05707.11	Zonular-occludens-toxin-(Zot)	MIYLFTGNMGAGKTPRVVSMILNNEDGLFKMELEDGTEADRPLYFCHIDGLDKRKFNARELAEGQIMSAPLRDVIPEGAVLIVGEAHYTYPVRAAGRPVPPYIQELTELRHHGHTVILMTRHPSQLDIFVRNLVSKHVHLERKAIGMKQYYWYKCVTSLDNPAGVSGVEAANWKPPKEAFKYYKSSSRHQKFKKKVPWAVWALIAVVGFVGWKSYGMFQVYSKATDSRIEQEAQKESVVQTMTEQTASSETAPFEHSDNLKPEDFVPTLPEKPESKPIYNTVRQVKTFEQIAGCIDGGKSDCTCYSNQGTPLKEITKIMCKEYVKNGLPFNPYKDERQRTEQAAQSAKADKPQVLVMGGKP*	hallmark_hmm	common_virus	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0010	persistent	direct	high	1085	0.999	GCA_016802425.1_01717
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1662750	1663040	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	9983	10273	GCA_016802425_1_1_1635	GCA_016802425_1_1_1635	-	2217364	.	PFAM:PF10734.8	Minor-Head-Virion-Protein	MPLLSGLIPLLGILLKMLIVRIILATGLTFVTYAGYLAALEKFKGYTSNAINSMPSDILNLLLISGFGQGLGCLFGAFSFFIGMHAFKKLTFVFPG*	hallmark_hmm	common_virus	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0011	persistent	direct	high	290	0.997	GCA_016802425.1_01718
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1663041	1663835	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	10274	11068	GCA_016802425_1_1_1636	GCA_016802425_1_1_1636	-	2217364	.	PFAM:PF05616.12	attachment-protein	MDAKKPEEILSLKVDADPDKYIKATGYPGYSEKVEVAPGTKVNMGPVTDRNGNPVQVAATFGRDAQGNTTADVQVIPRPDLTPASAEAPHAQPLPEVSPAENPANNPDPDENPGTRPNPEPDPDLNPDANPDTDGQPGTSPDSPAVPDRPNGRHRKERKQGEDGGLSCDYFPEILACQEMGKPSDRMFHDISIPQVTDDKTWSSHNFLPSNGVCPQPKTFHVFGRQYRASYEPLCVFAEKIRFAVLLAFIIMSAFVVFGSLGGE*	common_virus_hmm	common_virus	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0012	persistent	direct	high	794	0.999	GCA_016802425.1_01719
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1664175	1664459	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	11408	11692	GCA_016802425_1_1_1637	GCA_016802425_1_1_1637	+	2217364	.	PFAM:PF10734.8	Minor-Head-Virion-Protein	MKLLAALIPLLMSVAGRILTALGLMAVTYAGVDRLAAHFQQAITHSITGAPQAMLQLFYISGGGTVLNILFGAIAFILSFKQMTKLATSIGKKK*	hallmark_hmm	common_virus	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0013	persistent	direct	high	284	0.996	GCA_016802425.1_01720
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1664460	1665647	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	11693	12880	GCA_016802425_1_1_1638	GCA_016802425_1_1_1638	+	2217364	.	PFAM:PF05707.11	Zonular-occludens-toxin-(Zot)	MAEICLITGTPGSGKTLKMVSMMANDEMFKPDENGVRRKVFTNIKGLKIPHTHIETDAKKLPKSTDEQLSAHDMYEWIKKPENVGAIVIVDEAQDVWPARSAGSKIPENVQWLNTHRHQGIDIFVLTQGPKLLDQNLRTLVKRHYHIAANKMGLRTLLEWKVCADDPVKMASSAFSSIYTLDKKVYDLYESAEIHTVNKVKRSKWFYALPVIILLIPLFVGLSYKMLGSYGKKQEEPAAQESAATEQQAVLPDKTEGESVNNGNLTADMFVPTLPEKPESKPIYNGVRQVRTFEYIAGCIEGGRTGCTCYSHQGTALKEVTELMCKDYVKNGLPFNPYKEESQGQEVQQSAQQHSDRAQVATLGGKPQQNLMYDNWEERGKPFEGIGGGVVGSAN*	hallmark_hmm	common_virus	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0014	persistent	direct	high	1187	0.999	GCA_016802425.1_01721
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1665862	1666806	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	13095	14039	GCA_016802425_1_1_1639	GCA_016802425_1_1_1639	+	2217364	.	CDD:cd08055	Head-Tail-Connector-Protein	MNIIGPDISKDTIDATLHKTNGSIHYIKFKNNDDGLKQFRLWIKGNRIRKVYIGMEATGIYYEKAADMLSSYYTVYVINPLKINDYGKSRFNRTKTDKADSNLIADYIKRHQDTLIPYQIPKNKALQKLINLKNQLQQQQKQIKNRLHSTEEDFIRNIHQDLIDTIQDKMEQVKIAISEQIKKQTDNNHYRNLQTIPSIGKDTASVLYAQLTEKHFKTANQFVSYAGLSPAIIQSGTSVRGRGRLSRYGNRRLKSTLYMPALCAYRFNAFPKLINNLKKAGKPKMVIIVAIMRKLAKPAYYIVKTGQPYDAERH*	hallmark_hmm	common_virus	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0015	persistent	direct	high	944	0.999	GCA_016802425.1_01722
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1667109	1667648	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	14342	14881	GCA_016802425_1_1_1640	GCA_016802425_1_1_1640	+	2217364	.	PDB:1WTH_A	Tail-associated-lysozyme	MTELPWIAEARRHIGLKEIPGAKHNPTIVQWLKETGGFPGAAKSWYFEDETPWCGLFVGHCLGKAGRAVIRDWYRAKAWSMSGLTKLEAPAYGCIAVKPRRGGGHVFFVVGKDAEGRILGLGGNQGNMVSIIPFDPADIDGYFWPSKLIGGKAVPSSPAEGRYRLTAAAATAKQGAGEA*	common_virus_hmm	common_virus	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0016	persistent	direct	high	539	0.998	GCA_016802425.1_01723
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1667649	1667993	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	14882	15226	GCA_016802425_1_1_1641	GCA_016802425_1_1_1641	+	2217364	.	PFAM:PF10828.7	Rz-like-spanin	MIGALLKNWKPLLILSAIAFFAVSWQLDRAAQYRRGYGAAVSEVSERLKAAAVEHAEHARKSSAAYQAQKAAREEKERVRYVQTLKIIEKPVYRNACFDADGVRELNAAVDDGG*	phrogs_hmm	hypothetical_protein	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0017	persistent	direct	high	344	0.997	GCA_016802425.1_01724
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1668336	1668890	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	15569	16123	GCA_016802425_1_1_1642	GCA_016802425_1_1_1642	+	2217364	.	PFAM:PF02452.16	MazF-like-growth-inhibitor	MPYRSGQQPMPHPAGRLRTLKGSGGIFIGRLFFATALHKAVFCVRTAITAACHRQERLMPLKFQPRERSVIMCDFRGYEEPEMVKKRPVVVIARNRHNGKLVTVVPLSSTEPVPLADCHHKMSENPLPDKPHIQCRAKCDMTATVGLARLDRYKPKGRDRCIPIISEEDFQAVKTAVAKAFKLY*	phrogs_hmm	nonviral_gene	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0018	persistent	direct	moderate	380	0.685	GCA_016802425.1_01726
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1669095	1669937	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	16328	17170	GCA_016802425_1_1_1643	GCA_016802425_1_1_1643	-	2217364	.	PFAM:PF10547.8	P22_AR-protein	MQNTISVFSFKSQNVRTQILGAEPWFCLGDVAEILQIQNARQLPLKDQGIQKSSVATKKGNQELLFINEPNLYRVIFRSRKAEAVKFQDWIFEEVIPQIRKTGGYQITPKTTADDRTGLRRAVAALAGCKGIDYSSAYSMIHQRFNVEAIEGIPADKLLEAVAYVHALTLHTGLAGEVPDREPLPAPQPALPISGNALADIAAMVYYGTWMIESGKDVSLPLKQLGCKQAVTMWTVWHETRPILKRSAAALEVLRGYADKDASGRIAACLEGIYGKAAVR*	common_virus_hmm	common_virus	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0019	persistent	direct	high	842	0.999	GCA_016802425.1_01727
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1670436	1670612	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	17669	17845	GCA_016802425_1_1_1644	GCA_016802425_1_1_1644	-	2217364	.	.	hypothetical protein	MNPTKQSKKSYESKRVLKHVSFNTEKEANLLEFSNNLDFSKWVKEKLKHELELEKLKK*	.	hypothetical_protein	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0020	persistent	direct	high	176	0.994	GCA_016802425.1_01728
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1670940	1671431	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	18173	18664	GCA_016802425_1_1_1645	GCA_016802425_1_1_1645	-	2217364	.	cd00563	D-Tyrosyl-tRNAtyr deacylases; a class of tRNA-dependent hydrolases which are capable of hydrolyzing the ester bond of D-Tyrosyl-tRNA reducing the level of cellular D-Tyrosine while recycling the peptidyl-tRNA; found in bacteria and in eukaryotes but not in archea; beta barrel-like fold structure; forms homodimers in which two surface cavities serve as the active site for tRNA binding	MRAVIQKTVGAKVDVVSEAGTETCGKIDGGFVVLLGVTHSDTEKDARYIADKIAHLRVFEDEAGKLNLSLKDVGGAVLLVSQFTLYADAASGRRPSFSQAAPAEQAQRLYLRTAELLRGHGIHVETGRFRTHMQVSLCNDGPVTILLDSFMTRISPKMKVVPD*	mmseqs_cdd	nonviral_gene	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0021	persistent	direct	high	491	0.998	GCA_016802425.1_01729
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1671505	1672263	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	18738	19496	GCA_016802425_1_1_1646	GCA_016802425_1_1_1646	-	2217364	.	6BHF_A	Putative peptidyl-prolyl cis-trans isomerase HP_0175	MKQKKTAAAVIAAMLAGFAAAKAPEIDPALVDTLVAQIMQQADRHAEQSQRPDGQAIRNDAVRRLQTLEVLKNRALKEGLDKDKDVQNRFKIAEASFYAEEYVRFLERSETVSESALRQFYERQIRMIKLQQVSFATEEEARQAQQLLLKGLSFEGLMKRYPNDEQAFDGFIMAQQLPEPLASQFAGMNRGDVTRNPVKLGERYYLFKLGAVGKNPDAQPFELVRNQLEQGLRQEKARLKIDALLEENGVKP*	hhsuite_tools	hypothetical_protein	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0022	persistent	direct	high	758	0.999	GCA_016802425.1_01730
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1672333	1673199	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	19566	20432	GCA_016802425_1_1_1647	GCA_016802425_1_1_1647	-	2217364	.	5EZ1_B	Putative peptidyl-prolyl cis-trans isomerase HP_0175	MKAKILTSVALLACSGSLFAQTLATVNGQKIDSSVIDAQVAAFRAENSRAEDTPQLRQSLLENEVVNTVVAQEVKRLKLDRSAEFKDALAKLRAEAKKSGDDKKPSFKTVWQAVKYGLNGEAYALHIAKTQPVSEQEVKAVYDNISGFYKGTQEVQLGEILTDKEENAKKAVADLKAKKGFDAVLKQYSLNDRTKRTGAPDGYVPLKDLEQGVPPLYQAIKDLKKGEFTATPLKNGDFYGVYYVNDSREVKVPSFDEMKGQIAGNLQAERIDRAVGALLGKANIKPAK*	hhsuite_tools	hypothetical_protein	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0023	persistent	direct	high	866	0.999	GCA_016802425.1_01731
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1673248	1673526	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	20481	20759	GCA_016802425_1_1_1648	GCA_016802425_1_1_1648	-	2217364	.	COG0271	Stress-induced morphogen (activity unknown) [Signal transduction mechanisms]. 	MPAVDLIRERLQTLDPLVLEIGDESHLHKGHAGNTGGGHYAVLVVSGRFEGLSRLNRQKTVKSLLKDLFSGGMIHALGIRAATPDEYFHTAD*	mmseqs_cdd	nonviral_gene	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0024	persistent	direct	high	278	0.996	GCA_016802425.1_01732
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1673526	1673816	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	20759	21049	GCA_016802425_1_1_1649	GCA_016802425_1_1_1649	-	2217364	.	PRK11370	YciI family protein. 	MEYFMLLATDGEDVHEARMAARPEHFKRLETLKSEGRLLTAGPNLLPDNPERVSGSLIVAQFESLDAAQAWAEDDPYVHAGVYSEVLIKPFKAVFK*	mmseqs_cdd	nonviral_gene	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0025	persistent	direct	high	290	0.997	GCA_016802425.1_01733
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1673819	1674349	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	21052	21582	GCA_016802425_1_1_1650	GCA_016802425_1_1_1650	-	2217364	.	TIGR00997	intracellular septation protein A. This partially characterized protein, whose absence can cause a cell division defect in an intracellularly replicating bacterium, is found only so far only in the Proteobacteria. [Cellular processes, Cell division]	MKFVSDLLSVILFFATYTVTKNMIAAAAVALVAGVVQAAFLYWKHKRLDTMQWVGLVLIVVFGGATIVLGDSRFIMWKPTVLFWCGALFLLGSHLAGKNGLKASIGREIQLPDAVWGKLTYMWVGFLIFMGIANWFVFTRFEAQWVNYKMFGSTALMLFFFIIQGIYLSTYLKKED*	mmseqs_cdd	nonviral_gene	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0026	persistent	direct	high	530	0.998	GCA_016802425.1_01734
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1674855	1676972	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	22088	24205	GCA_016802425_1_1_1651	GCA_016802425_1_1_1651	+	2217364	.	.	hypothetical protein	MDGKAVIAVSSAQAVRDPVLVFRIGAGAQVREYTAILDPVGCSPKTKSALSDGKTHRKTAPKAESQENQNAKALRKTDKKDSANSAVKPAHNGKTHTVRKGETLKQIAAAIRPKHLTLEQVADALLKANPNVSAHGRLRAGSVLHIPNLNRIKAAAPKKIKAEQPKPQTAKPKAETASMPSEPSKQATVEKPIEKPVEKPVEKPEAKVAAPEAKAEKPAVRPEPKPAVSETPASATERQPGPVPAANTAASETAAESAPQEAAASAIDTPTDETGNTVSEPVAETASEVAAEPVAEPVEQVSAEEETESGLFDGLFGGSYTLLLAGGGAALIALLLLLRLAQSKRARRTEESVPEEEPDLDDAADDGIKITFAEVETPATPEPAPKNDVNDTLALGGESEEELSAKQTFDVETDTPSNRIDLDFDSLAAAQNGILSGALTQDEETQKRADADWNAIESTDSVYEPETFNPYNPVEIVIDTPEPESVAQTAENKPETVDTDFYNNLFSNNHIGTEETASAKPAAPSGLAGFLKASSPETILEKTVAEVQTPEELHDFLKVYETDAVAETAPETPDFNAAADDLSALLQPAEAPAVEENAAEITLETPDSNTSEADALPDFLKDGEEETVDWSIYLSEENIPNNADTGFPSESVGSDAPSEAKYDLAEMYLEIGDRDAAAETVQKLLEEAEGDVLKRAQALAQELGI*	.	hypothetical_protein	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0027	persistent	direct	high	2117	1.0	GCA_016802425.1_01735
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	CDS	1677145	1677534	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	24378	24767	GCA_016802425_1_1_1652	GCA_016802425_1_1_1652	-	2217364	.	cd16358	Glyoxalase I that uses Ni(++) as cofactor. This family includes Escherichia coil and other prokaryotic glyoxalase I that uses nickel as cofactor. Glyoxalase I (also known as lactoylglutathione lyase; EC 4.4.1.5) is part of the glyoxalase system, a two-step system for detoxifying methylglyoxal, a side product of glycolysis. This system is responsible for the conversion of reactive, acyclic alpha-oxoaldehydes into the corresponding alpha-hydroxyacids and involves 2 enzymes, glyoxalase I and II. Glyoxalase I catalyses an intramolecular redox reaction of the hemithioacetal (formed from methylglyoxal and glutathione) to form the thioester, S-D-lactoylglutathione. This reaction involves the transfer of two hydrogen atoms from C1 to C2 of the methylglyoxal, and proceeds via an ene-diol intermediate. Glyoxalase I has a requirement for bound metal ions for catalysis. Eukaryotic glyoxalase I prefers the divalent cation zinc as cofactor, whereas Escherichia coil and other prokaryotic glyoxalase I uses nickel. However, eukaryotic Trypanosomatid parasites also use nickel as a cofactor, which could possibly be explained by acquiring their GLOI gene by horizontal gene transfer. Human glyoxalase I is a two-domain enzyme and  it has the structure of a domain-swapped dimer with two active sites located at the dimer interface. In yeast, in various plants, insects and Plasmodia, glyoxalase I is four-domain, possibly the result of a further gene duplication and an additional gene fusing event.	MGNLEKSLDSYQNVLGMKLLRRKDYPEGRFTLAFVGYGDETDSTVLELTHNWDTERYDLGDAYGHIAVEVDDAYEACERVKRQGGNVVREAGLMKHGTTVIAFVEDPDGCKIEFVQKKSGDDSVAYANT*	mmseqs_cdd	nonviral_gene	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_CDS_0028	persistent	direct	high	389	0.997	GCA_016802425.1_01736
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	tRNA	455543	455633	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	863	953	tRNA-Ser	tRNA-Ser	+	2217364	.	tRNAscan-SE score: 70.3	Ser	NA	tRNAscan-SE	.	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_tRNA_0001	.	.	.	.	.	.
GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote	cenote	tRNA	455711	455797	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C42	1031	1117	tRNA-Ser	tRNA-Ser	+	2217364	.	tRNAscan-SE score: 71.6	Ser	NA	tRNAscan-SE	.	C42	45322	454681	500003	GCA_016802425.1|CP048911.1@region_454682_500003@tool_cenote_tRNA_0002	.	.	.	.	.	.
GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote	cenote	tRNA	1138380	1138461	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C92	30302	30383	tRNA-Leu	tRNA-Leu	-	2217364	.	tRNAscan-SE score: 62.9	Leu	NA	tRNAscan-SE	.	C92	46316	1108079	1154395	GCA_016802425.1|CP048911.1@region_1108080_1154395@tool_cenote_tRNA_0001	.	.	.	.	.	.
GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote	cenote	tRNA	1656583	1656658	GCA_016802425.1	CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425.1_CP048911.1	GCA_016802425.1|CP048911.1	GCA_016802425_1_1	GCA_016802425_1_1@C122	3816	3891	tRNA-Glu	tRNA-Glu	+	2217364	.	tRNAscan-SE score: 54.8	Glu	NA	tRNAscan-SE	.	C122	24767	1652768	1677535	GCA_016802425.1|CP048911.1@region_1652769_1677535@tool_cenote_tRNA_0001	.	.	.	.	.	.
