core_seqid	core_source	core_type	core_start	core_end	core_bax_acc	core_contig_acc	core_bax_acc|contig_acc	core_bax_acc_contig_acc	cenote_input_name	cenote_contig	cenote_phage_region_id	cenote_gene_start	cenote_gene_stop	cenote_gene_name	original_cenote_gene_name	cenote_gene_orient	cenote_contig_length	cenote_dtr_seq	cenote_evidence_accession	cenote_evidence_description	cenote_translation	cenote_Evidence_source	cenote_vscore_category	cenote_chunk_name	cenote_chunk_length	cenote_chunk_start	cenote_chunk_stop	UNI_lookup_ID	pangenome_partition	pangenome_method	pangenome_confidence	pangenome_overlap_length	pangenome_overlap_fraction	pangenome_matching_locus_tag
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	26682	26885	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	1	204	GCA_001237185_1_11_29	GCA_001237185_1_11_29	-	82153	.	LOAD_cold	Cold Shock RNA binding domain of the OB fold.	MNNGTVKWFNAEKGFGFIEREDGSDVFVHFSGIAGEGYKTLEEGQKVDFDITEGQRGEQATNVVVMA*	mmseqs_cdd	nonviral_gene	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0001	persistent	direct	high	203	0.995	GCA_001237185.1_01521
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	27118	27981	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	437	1300	GCA_001237185_1_11_30	GCA_001237185_1_11_30	-	82153	.	PRK07251	FAD-containing oxidoreductase. 	MNISYQPKHLAIIGGGYIALEFASMFANFGSKVTVIEHGEHIMPREDQDVVAHAIKDLEDKEITFVTNAETLEFKNKNNQTTIVTSKGNFSADAVLIATGRIPNTDLALEQTDVELGERGEIKVNEHLQTSVEHIYAVGDVKGGLQFTYISLDDFRILKSTLYGDQSRTTLNRGTIPYTVFIDPPFSRVGLTAKEAQSQGYNYIENTLLVAQIPRHKINNDARGIFKVIIDKDTDLILGATLYGKESEEIINLIKLAIDQHIPYQVLRDTIYTHPTIVESFNDLFNI*	mmseqs_cdd	nonviral_gene	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0002	persistent	direct	high	863	0.999	GCA_001237185.1_01522
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	28337	29722	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	1656	3041	GCA_001237185_1_11_31	GCA_001237185_1_11_31	-	82153	.	PDB:4BQQ_A	Integrase	MKVAVYCRVSTLEQANGGHSIEEQERKLKSFCDINDWSIYDTYVDAGYSGAKRDRPELQRLMKDINKFDLVLVYKLDRLTRNVRDLLDLLEIFEKNDVSFRSATEVYDTTTAMGRLFVTLVGAMAEWERETIRERTQMGKLAALRKGIMLTTPPFYYDRVDNKFVPNKYKDVILWAYDEAMKGQSAKAIARKLNNSDIPPPNNTQWQGRTITHALRNPFTRGHFDWGGVHIENNHEPIITDEMYEKVKDRLNERVNTKKVKHTSIFRGKLVCPNCSARLTLNSHKKKSNSGYIFAKQYYCNNCKVTPNLKPVYIKEKEVIKVFYNYLKRFDLEKYEVTQKQNEPEITIDINKVMEQRKRYHKLYASGLMQEDELFDLIKETDQTIAEYEKQNENREVKQYDIEDIKQYKDLLLEMWDISSDEDKEDFIKMAIKNIYFEYIIGTGNTSQKNNSLKITSIEFY*	common_virus_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0003	cloud	direct	high	1385	0.999	GCA_001237185.1_01523
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	29888	30025	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	3207	3344	GCA_001237185_1_11_32	GCA_001237185_1_11_32	-	82153	.	.	hypothetical protein	MKGDSEQEPKHWDELVKVPVYSMKQLEYMVKNDIPLTENKDVYKD*	.	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0004	shell	direct	high	137	0.993	GCA_001237185.1_01524
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	30043	30717	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	3362	4036	GCA_001237185_1_11_33	GCA_001237185_1_11_33	-	82153	.	PDB:2FJR_A	Repressor-protein-CI	MTFGSRIKNLRKQKGMTLQQLSDDLHNQFPSKDRRNSFTKGKLSNWENDKSEPIAKTVSQLATYFGVSMDYLIGLEDDIVPIEKIDKYYQVPYYGQVSAGNFETVEVDTKELEVPDIAFNGRNPKECIALQVNGDSMNKVLSNGSYIIIHDYRRNQDYRLNNNDILVLRLGGEYTVKRVRRTETKLHLDPVSYSDEFKTNTYDIDNTDEIEVIGKVIYNYQIFE*	common_virus_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0005	cloud	direct	high	674	0.999	GCA_001237185.1_01525
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	30906	31145	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	4225	4464	GCA_001237185_1_11_34	GCA_001237185_1_11_34	+	82153	.	PFAM:PF13744.5	transcriptional-repressor	MKGYSKLKGLLKERGINHDELADLLDVHRVTVSNKLNRSHGADFTMTEVRKLCLYLEVSADIYFLNVSRENTTKEPQTT*	phrogs_hmm	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0006	cloud	direct	high	239	0.996	GCA_001237185.1_01526
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	31164	31934	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	4483	5253	GCA_001237185_1_11_35	GCA_001237185_1_11_35	+	82153	.	PFAM:PF10547.8	P22_AR-repressor-domain-protein	MNELQVFQNSQFGNLEILTFEGKEWFPAIQVAEILGYANPRDAISRHTKNKGVVNHDVLSNGGVQRKKFIDEGNLYRLITRSKLPQADEFEEWVFEDVLPSIRKHGLYATDNVIENTLNNPDYIINILTQYKKEKEHNLTLEQQIKDNKPKVLFADSVAGSDNSILVGELAKLLKQNGVDVGQNRLFKWLRNNGYLIKKSGESYNLPTQKSMDLEILDIKKRVINNPDGSSKITRTPKVTGKGQQYFINKFLTEEL*	common_virus_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0007	cloud	direct	high	770	0.999	GCA_001237185.1_01527
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	32056	32247	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	5375	5566	GCA_001237185_1_11_36	GCA_001237185_1_11_36	-	82153	.	.	hypothetical protein	MSELSIEQRAHDLALMRVKIEAEKELMENPSPTIDLVNDYTKYYYELKRNLDKLSNEFPDLFS*	.	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0008	cloud	direct	high	191	0.995	GCA_001237185.1_01528
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	32400	32570	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	5719	5889	GCA_001237185_1_11_37	GCA_001237185_1_11_37	+	82153	.	PF06900.11	Protein of unknown function (DUF1270)	MSIKDKATIIAGMMFNVAFFLSMMLNIFITNALAIGMVASTVTYIFFDCFYYETEE*	hhsuite_tools	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0009	cloud	direct	high	170	0.994	GCA_001237185.1_01530
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	32574	32861	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	5893	6180	GCA_001237185_1_11_38	GCA_001237185_1_11_38	+	82153	.	PFAM:PF10078.8	CI-like-repressor	MKLVEKVEEKRLKDGLTVRQIGYLLGFTGTYYVKMRNGSRRITEKQQVKFKRFLEGEFDHIEIPKYSTDKEEKAYNKGYKKAIKDLQEFIDTKKD*	phrogs_hmm	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0010	cloud	direct	high	287	0.997	GCA_001237185.1_01531
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	32948	33211	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	6267	6530	GCA_001237185_1_11_39	GCA_001237185_1_11_39	+	82153	.	.	hypothetical protein	MTKKFKPIQSIYLELVHEYFKSNQKCDLGLSRTFDGELIIEFLHYHDHYKTNNKLIQIFESKPESHERLKNLVIEVMRGQRKIKKGA*	.	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0011	cloud	direct	high	263	0.996	GCA_001237185.1_01532
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	33214	35163	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	6533	8482	GCA_001237185_1_11_40	GCA_001237185_1_11_40	+	82153	.	PDB:5H67_A	Chromosome-partition-protein-Smc	MNLTINKLTIENFAGFKKQTFEFNGQNARVYGANGTGKTTTATALQWLLFDKGLDGSTKSFNPVPLKENNEEDYELIPTVEVELNKDGKTLKIRKESHPKYTKNQSNNRKEYSRSRTKKQYINDESLKVKDFQSRIAELVDEDVFKLITNPAAFNDLEWKKQRELLFEIADQIDDEDIIKTNKDFEDLKDILGDHDIEVKTKILNDKIKQIRKDIEDIPVRINQTESNKQDVPEHDEERYNTVKQQIEQLGNERVDIQNGKAEIDLRNQLADKQAELKRLEDNHGANNEGRIHAATNELSVENGTVANLETTIRNNKQQIEYESKRRQALLSEYHHFKEKEEEVRARQFQPSTDNVCSCCGQALPPEQVEEVNKKALAKFNKQQSEDLENLKQKTDKILSDGKEIKPLIEMLESKNNDLQIKVNEAKEKVQRIQNRIDKLKAGNVDITQTDEYKAILNDINEINQKRKDIKTTISDKVAKIDEQISELIQEKVAFENAKAIESSNEHLDEVIKDLRNEEDQLLDKKEDYEHQLYILKEFTTTKVKMLTENINKKFKMANFKLFNHQVNGEIKETCVCTVDGVEYNGGLNNAARINVGLDIINTLSTHYGITAPIFIDNAESVTDIIPTEAQQIQLVVSGQDKTLRMETI*	common_virus_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0012	cloud	direct	high	1949	0.999	GCA_001237185.1_01533
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	35165	36100	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	8484	9419	GCA_001237185_1_11_41	GCA_001237185_1_11_41	+	82153	.	PFAM:PF03837.13	RecT-protein	MTNNQVQPTNLKIVQERIVNEKNVTDEVLNKINVYQAQGNLSLPAGYSAENALKEAWLVISQNSKLANCTKESMAQALLGMVTQGLNPAKNQCYFIPYGNKMQIQRSYHGNIMMLKRDAGAKDVVAQIIYKGDSFKQELDGTGRIKDIKHEQDFFNIDKDNIVGAYCTIVFDDGRDNYIEIMTMDQIKQAWMQSSMIRDEQALEKSKTHNNFKEEMAKKTVINRAAKRYINSSTDDNLLKFARESETRQRKEVLDAEVEEQANQEELDFEQPQQYEDAQFKEVEEPEPADVSNFEEVEQEAPKQESEKEPF*	common_virus_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0013	cloud	direct	high	935	0.999	GCA_001237185.1_01534
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	36313	36804	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	9632	10123	GCA_001237185_1_11_42	GCA_001237185_1_11_42	+	82153	.	PFAM:PF02112.14	metal-dependent-hydrolase	MTVGTQQAIPTESHRICTIKAKQELRIGTWSILPFDVEHDANEPVGFLLKSVHGYKVLYITDTKYLKYKFKGVTHMMLEVNYIYEQMQQNIKDEVIHNVLANRIMESHFSLEHAIGMLEANDLSKLEEIHLIHLSSNNANATHIKQSIQEVTGVPVYIGGHNQ*	phrogs_hmm	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0014	cloud	direct	high	491	0.998	GCA_001237185.1_01535
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	36801	37394	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	10120	10713	GCA_001237185_1_11_43	GCA_001237185_1_11_43	+	82153	.	.	hypothetical protein	MTNKFRITKKKDGTVSYHMEGSSDFINSISDKILNSKKASKTDLMKLHKPSEQHKPTDHHILNMPTTIKPTSPKKISLVKPEGETVYSESEPNTMAEALKQLDIKKENDDRPEQPEDTSYYYTGIKEKDGKKLYRCRYMCHSCSNVGNHYIPHLIDNVQCHNCSADLPVKSVADMTGYKKDLNANWYVAGRYLPKTK*	.	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0015	cloud	direct	high	593	0.998	GCA_001237185.1_01536
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	37406	37870	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	10725	11189	GCA_001237185_1_11_44	GCA_001237185_1_11_44	+	82153	.	PDB:1Z9F_A	Single-stranded-DNA-binding-protein	MINRVVLVGRLTKDPEFRTTQSGVDVATFTLAVNRNFTNAQGEREADFINIIVFRKQAHNVNNYLSKGKLAGVDGRIQSRSYENQEGRRIFVTEVVADSVQFLEPKNSNGSQQDTYQQQTQSQTQRSQNTKPQGQDPFANANGAIDISDDDLPF*	common_virus_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0016	cloud	direct	high	464	0.998	GCA_001237185.1_01537
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	37885	38079	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	11204	11398	GCA_001237185_1_11_45	GCA_001237185_1_11_45	+	82153	.	PRK09706	transcriptional repressor DicA; Reviewed	MTLVRKIKERRLKKGQTQTEYGKEFGAGKSLVCQWEKGINKPNCKRLKMIADDMNITVTELLKS*	mmseqs_cdd	nonviral_gene	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0017	cloud	direct	high	194	0.995	GCA_001237185.1_01538
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	38114	39001	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	11433	12320	GCA_001237185_1_11_46	GCA_001237185_1_11_46	+	82153	.	PFAM:PF09681.9	phage-replisome-organiser	MTGWISLHRSIQKHWLFEEKRKFSRFEAWIDILLMVNHSDNKIMHDGDLITVKRGQRITSLRQLGERWSWSITKVDKYLKTLESDGMLVVKKDTKKTVLTVVNYDDYQDEDLKKRHRKDSEKTEKKHRSNTEKTQKKTNNNDNKENNENNDNNDVVVGDDFATIYNLYQENIEQIPSPITTEKLTQDMDHYGKELVAYAIRKAALNNSHNYKFIDYLLKDWRKRNLTTIKAVEQYEQQRQEQKEQSYQPKVTHSREKTPEWLKNRNQEKETVNDDPEFEKLRLQFRKQLESDWDD*	rep_hall_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0018	cloud	direct	high	887	0.999	GCA_001237185.1_01539
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	38994	39218	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	12313	12537	GCA_001237185_1_11_47	GCA_001237185_1_11_47	+	82153	.	.	hypothetical protein	MIKKVCSKNKSIEVGQNNVISIELHKHETGGIDIFKTRNADGTLIGIEGFFVDQYQVIEDADTEQLDIFKLLEG*	.	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0019	cloud	direct	high	224	0.996	GCA_001237185.1_01540
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	39221	39448	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	12540	12767	GCA_001237185_1_11_48	GCA_001237185_1_11_48	+	82153	.	.	hypothetical protein	MEANKSKIIDLDKGDFIWFIPPNSQMSYYGYVKELKWNFEGVKESAVITIDDEIEVEIDDTYQIAIGRKYYEKYN*	.	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0020	cloud	direct	high	227	0.996	GCA_001237185.1_01541
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	39432	39653	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	12751	12972	GCA_001237185_1_11_49	GCA_001237185_1_11_49	+	82153	.	.	hypothetical protein	MKNIIKFVGKTIFRTVVTRVVKDLIAAYNYTEYVKHKLSKDEQSFFKACNRVGMSDIQALRLAQIIEEEMERK*	.	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0021	cloud	direct	high	221	0.995	GCA_001237185.1_01542
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	39653	40075	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	12972	13394	GCA_001237185_1_11_50	GCA_001237185_1_11_50	+	82153	.	PDB:5Y5P_D	dUTPase	MGILPIKLLSENAILPTRANPTDSGLDLYVAEDTTILAHSTVVVPTHIAIDLAYGYEAQVRPRSGKSKDTKLRVALGTIDHTYNKEIGIITDNIGDETIVVKAGTRLAQLVVTPVMLPEPTEVQEFDEVSERGAYGSTGE*	common_virus_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0022	shell	direct	high	422	0.998	GCA_001237185.1_01543
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	40124	40495	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	13443	13814	GCA_001237185_1_11_51	GCA_001237185_1_11_51	+	82153	.	PFAM:PF07509.10	secreted-protein	MKDLGFFEVIMGGFLSVVGIILLILLIGGPIFAIAEYNHKEIYTGKITDKYNKRGEEIDTFYIVLDNKKVIANTDLIFKGRFNSADVQATLHVGEKVRVKTIGYRIPIISSYPKMYEIEKVKE*	phrogs_hmm	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0023	cloud	direct	high	372	1.0	GCA_001237185.1_01544
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	40501	40653	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	13820	13972	GCA_001237185_1_11_52	GCA_001237185_1_11_52	+	82153	.	.	hypothetical protein	MKSSEEVVKKLKSVISDIEELKQEDSITLTYKSALEHVIEYIEHGDDVDV*	.	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0024	cloud	direct	high	152	0.993	GCA_001237185.1_01545
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	40646	40813	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	13965	14132	GCA_001237185_1_11_53	GCA_001237185_1_11_53	+	82153	.	PFAM:PF06116.11	Transcriptional-activator-RinB	MFKRILKIWFIITVYEISKYITNELIVILQSEDDIEAPQDFNEYDHTHLNDEVSD*	common_virus_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0025	shell	direct	high	167	0.994	GCA_001237185.1_01546
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	40813	41256	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	14132	14575	GCA_001237185_1_11_54	GCA_001237185_1_11_54	+	82153	.	.	hypothetical protein	MEWPLLIAIAILSIMWAISTYKWVRAEQKAKRYYDIMIKTWNENTRINNQLRNNRKTDLIDDRTHIQRKSVEMEDKDNKRSLGKYVVELKDEVYLAKKHINSYRDTYIITDNVFEALSYKNLGSAKEDARILGGKVLQHKPNLEVVE*	.	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0026	cloud	direct	high	443	0.998	GCA_001237185.1_01547
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	41332	41733	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	14651	15052	GCA_001237185_1_11_55	GCA_001237185_1_11_55	+	82153	.	.	hypothetical protein	MYSKEAILNMIDNYQMTCKYLVTVIPDCDSNSIAQYGIQATLPKPQGQNGSKVENTVIRRERMSKRHAQMLAEVEFINQSQQKLGHVDFIFLSHLKKGRRRDEIIKDMPNSRLNRTNFLARKDDLAEKIYLLQ*	.	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0027	cloud	direct	high	401	0.998	GCA_001237185.1_01548
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	41964	42416	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	15283	15735	GCA_001237185_1_11_56	GCA_001237185_1_11_56	+	82153	.	PFAM:PF03592.15	Terminase-small-subunit	MIYEMNELTLKQQRFADEYIRTGNAYKSAILAGYSKNYAKGQVNKLLENVGVKAYIDKRLEELKKKAIADQDEILQYLTSVMRGEITDQELIPIQVGRGEMEVEELEKRSDTNARTKAAELLGKRYRMWTDKVEAEVVTPTFVSDVPADD*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0028	cloud	direct	high	452	0.998	GCA_001237185.1_01549
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	42409	43701	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	15728	17020	GCA_001237185_1_11_57	GCA_001237185_1_11_57	+	82153	.	CDD:COG1783	Large-Terminase	MTDNKVSIAKTIGGGYNEFWHNKNFYRVVKGSRGSKKSKTTALNFIYRLMKYEWANLLVVRRFSNTNKQSTYTDLKWATNQLGVTHLFKFNDSLPEITYKPTGQKILFRGIDDPLKITSITVDKGILSWCWIEEAYQVETYDKFATLVESIRGSVDSPDFFKQITVTFNPWSERHWLKSTFFDEDTKLNNTFSYTTTYRVNEWLDEVDIARYEDLYRTNPRRARIVCDGDWGVAEGLVFDNFEVKEFDWLKVFKRTQEKAHGSDFGFTHDPTTLISTVVDIKNKELWIYDEHYEKGMLTDEIYQMYVDKGYKDALIVADSAEKRLIAEIKRKGIPNIKPSIKGQGSIMQGVQFIQGFKIYVYPTCVHTIEELNTYTFDQDKEGNWLNQPIDRNNHLLDALRYSLERFHLPHKQTKTNVRKNISTIKSMGL*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0029	cloud	direct	high	1292	0.999	GCA_001237185.1_01550
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	43715	45211	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	17034	18530	GCA_001237185_1_11_58	GCA_001237185_1_11_58	+	82153	.	PDB:5A20_A	Portal-Protein	MLKVNEFERDAEYRQHRDKIYRRDAVETYRYDGTLSEILDDYDFISECIGHHLEAQVPRLQMLDDYYQGLNYNIMRNRRRREKHLADNRAAHDFASYIADFINGYCFGHAIQVQSEDEDAQEKINGLHNLNDIDTHNRSIGLDLSIFGRAYEYIIRNQDDEVKLYKSDPRNTFVIYDNTIEQNSLVAVRYWQTSTREYDDTDIYNVDIITPNATNFFYANKSTNLSLQERRPSEPHSFGKVTITEFSNNEKRRGDFEKVIPLIDLYDNAQSDTANYMSDLNDAMLLVIGNMELDSNTAQLQKDANVFHLAPPEYTTMDEKTTEGNVDARYIYKEYDVSGVEAYKDRISRNIHMFTNTPDMTDENFGGNQSGEAMKYKLFGLEQRTAIKEGLFRKGLRRRYKLVGQIMSINRELNSDAIQDLTFTFTRNIPKSVKDEMDMYLQAGGQISQQSLMSLVSFIDNPQQEMERIENEEDIQLQKSDERMYNQEGIDNHIDNEE*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0030	shell	direct	high	1496	0.999	GCA_001237185.1_01551
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	45218	46168	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	18537	19487	GCA_001237185_1_11_59	GCA_001237185_1_11_59	+	82153	.	PFAM:PF06152.10	minor-capsid-protein	MTYWEDRAKEIIDEESKSDYEIAQEIQRIVDEMDADIEDEINRFYARYATREGITLSEAKKKIDAVDVQQFSQKAKEYVENKDFSEKANQELKVYNTKMYVSREKLLQAQLGLIVTYAYAQIEQSMYNYMESAYYRALKQQAGILGETLQVSINDVKTIVFTPFEGHKWSTRLWSDMETVRRHVQKTTRHVLLRGRHPYEFIKDMRKDTGATTYNMKRLLLTETARVQTLASKRHMLEEHGPESEYQFVAKMDSKTTKTCRSLNDKTFKVKDMVPGVNAPPLHPFCRSTVVPHIDENWRDKFFEERKGKYFGGVVK*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0031	shell	direct	high	950	0.999	GCA_001237185.1_01552
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	46165	46314	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	19484	19633	GCA_001237185_1_11_60	GCA_001237185_1_11_60	+	82153	.	.	hypothetical protein	MTSALERIADALEHIHVELKRLNDTNPSNQAQAKPKQDKKKSFDPKNFI*	.	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0032	cloud	direct	high	149	0.993	GCA_001237185.1_01553
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	46561	47169	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	19880	20488	GCA_001237185_1_11_61	GCA_001237185_1_11_61	+	82153	.	PDB:6B0X_d	capsid-scaffolding-protein	MIKDNFLKANLQFFAEGGDETERNNNEQSENDNAKSEEVTYTQSELDAKISKASEKNKRRLAEEYDKKLQEEIERVRREEQSYAKMTQKEKEEQELSKREKAIAEREKAQAFKELKSDVVDDLKEQELPTSFADALIKIEDNEEIKDVIRQIKKDFDSAVGEKVKEATRQATPTNQGSSFSRNQSRKEKGLGSIADEVRIIQ*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0033	cloud	direct	high	608	0.998	GCA_001237185.1_01554
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	47186	48184	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	20505	21503	GCA_001237185_1_11_62	GCA_001237185_1_11_62	+	82153	.	PDB:6B23_B	Major-Capsid-Protein	MNETNKLKLNLQHFANNDVTPATFNPDNVMMHEHKEGELLNNFTKPVLREVMETSKIMQLGKYQEMDGTEKDFVFWADKPGAYWVGEGQKIETSKATWLEAKMRAYKLGVILPVTKEFLNYTYSDFFEAMKPMIAEAFARKFDEAGILNVGDNPFNKSIEQSVQTAGNVINGEYNEDNLLDLEALIENNDYDPNAFISKRTNRRALSSIVDSVSNERLFEKGKGRNAIDTLDGLPVVNLKSPDYKENVIYTGDFNQLFYGIPQRIEYKIDDSSQLSTIKDGNGEPINLFERDMLALRATMHVAVHIADDKAFAKFEGVSTKPETVTPKPETV*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0034	cloud	direct	high	998	0.999	GCA_001237185.1_01555
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	48207	48476	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	21526	21795	GCA_001237185_1_11_63	GCA_001237185_1_11_63	+	82153	.	PFAM:PF08198.10	Arc-like-repressor	MTYSYEVVRPFVDAEDKKPYEVGDIYPTDITDERITQLLHADNKYNKQYIKLVVDSKNTKAELIEIAHKHGIEVSEKDTKADILDTLEG*	phrogs_hmm	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0035	shell	direct	high	269	0.996	GCA_001237185.1_01556
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	48478	48807	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	21797	22126	GCA_001237185_1_11_64	GCA_001237185_1_11_64	+	82153	.	PFAM:PF05135.12	head-tail-adaptor	MATLENVKLLLSINDNVQDDLLKRIIDNTEKRLISLLPIGSDEVPDRLEYIIEEVAVKRFNRVGAEGMTQESVDGRSNTFQANDFDEYMDVIDQYTPRNSDKRGTGIFY*	phrogs_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0036	shell	direct	high	329	0.997	GCA_001237185.1_01557
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	48804	49106	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	22123	22425	GCA_001237185_1_11_65	GCA_001237185_1_11_65	+	82153	.	PDB:5A21_F	head-closure-knob	MRYNKRVVFAKETKGQYNPKTSRTETYEKRYDEIPCNISPLSPQKTVVQYGDINKDINVIRLNGRFEPTVTHAYIKGSKYQITKRINYEHDTVFYVEEVK*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0037	shell	direct	high	302	0.997	GCA_001237185.1_01558
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	49106	49462	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	22425	22781	GCA_001237185_1_11_66	GCA_001237185_1_11_66	+	82153	.	PFAM:PF04883.11	type-I-neck-protein	MRFGGGDLDDLIRDFDRMNNTIDDDVDEVLHENAVKFSTDTVKTAKEVMNKGYWTGNLARMVEDAKEGHLKYGITSKAGYSGFLEYGTRYMEPETFMFPVYQEFTKKVRADLERLING*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0038	shell	direct	high	356	0.997	GCA_001237185.1_01559
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	49473	49862	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	22792	23181	GCA_001237185_1_11_67	GCA_001237185_1_11_67	+	82153	.	PDB:4ACV_B	Antigen-protein	MKQSVNLQLFNYLYTKFEELGVPIIRTSELNQTLPYPFIAIQSIRDDIHRSTFDSYSGSPTAIIHIWCTEDDKGKNDELYIQVQSILLDEIQLDGYTLTLPQISVNESTEQDTNQVLSHTTINAEYASH*	common_virus_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0039	shell	direct	high	389	0.997	GCA_001237185.1_01560
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	49908	50453	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	23227	23772	GCA_001237185_1_11_68	GCA_001237185_1_11_68	+	82153	.	PDB:5A21_H	major-tail-protein	MPTKQGTDELVLIRKVGDKKDANKVMLVTELERETEKDRDTEATFDGSVNSGGTLESTVTINCYMDQKDTLCDEIEDATEDDTPYELWVINKRVQNSEGKYKAEYRQGYWNSITRTNEADGIAEFETEFGVYLKKQRGYATLPQAIEANKAAYGFHDTIAADPADDGLAESIPQPTEAETV*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0040	shell	direct	high	545	0.998	GCA_001237185.1_01561
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	50519	50884	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	23838	24203	GCA_001237185_1_11_69	GCA_001237185_1_11_69	+	82153	.	PFAM:PF12363.7	tail-assembly-chaperone-protein	MHINFKDKELELSFGLGFLNKIDKELGLEVEQMTIGQGLNMLVPNLQNGNIVALSKVIKSATAHHKKKPQTDEELETVLEDIAENEGIDTFSEQIIEELGKRPLTQNLVPDEYKQDKKSKK*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0041	shell	direct	high	365	0.997	GCA_001237185.1_01562
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	50941	51282	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	24260	24601	GCA_001237185_1_11_70	GCA_001237185_1_11_70	+	82153	.	PFAM:PF12363.7	tail-assembly-chaperone	MYDLTKIEMMTLREFNYRMWSLEYEQLDKDMEMYKLAFAIRDAQAEQKKRGGKKGETEYRFRSANDIMDYEENVKRLNRGEPLKFGSDSKRDTNAPNDLLKMIANHNNSLRKA*	phrogs_hmm	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0042	shell	direct	high	341	0.997	GCA_001237185.1_01563
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	51287	55060	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	24606	28379	GCA_001237185_1_11_71	GCA_001237185_1_11_71	+	82153	.	Uniprot:A0A0K2G452_BACCS	tail-tape-measure-protein-	MAEANYSIKAQIEANTRKFKSAIQSAKKVAQSFKKTQESIKDTKLDGDSSGVMKAVKAARDAVKGFDNTHADAELDADISDVREKVAQAKSLVEKFDTYRGDAELDADVSKATANIKKIQNYLDMYDNSNAEADADVNIRKAITHISELQHNLDSIDGSKYSATLDADATRARESIKLAKKQLNDFAHQKAKANLEVDSAGAMAKIQTFKAMLRSIPNRHRTRLEVDGNQPVTFFGQLRKGLKDYNNKLDKLANDIRTFGTVFSNMIKGSLLSNISLLVPAIASVVPALMAVLNALGVVAGGALGVAGAFGVAGAGVVAFGAMGISALKMLSDGTLQATRETERYQASLDSLKSAWAGLIQQNQAQIFNTLANAIDTAKVALAGLTPFINGVSKGIEQASAKMLNWAKNSQVAQKFFEMMGTTGVRIFNNMLDAAGSFGSGLVSVLTQIAPLAEWVSQGFKKMGQAFNEWAQSVEGQNAIKSFIEYTKQNLPLIGQIFGSTFKGIFNLMKAFAPNTHLVLQGLADMAKQFEQWSSTIAESDGFKKFIQYVQENGPKLIQLIGNIIRILINVGVAMAPLASVVLNVALAITKFISKLTEASPIIGMIIGIIATLAGILMALAPAFIFVTQVIIPLITTFGGLSGIISVVMSAFEFLGGVLTALSGPVGIVIAAVVAVIAVFVALWNSSEVVRDAVTGAWKAISGAVGNAVKAVINFFKDLLGQMDYVKGAVDSLGSMWDGFVTIVEGAIKLLSPLFESTFNAIVNTVKIAWEIIKAVITVAMHVIVGTITVLLQILTGDWQGAWQTLQQVGQAIWDAIVQAAINIFNILKDVLTQSWQATVDMFSAIFGPLAEIASNIWNAIVQAVLTVVVQLGVFLMNLWTSIVTTAQTIWTTLVTVASTIWQMIVTTIVTVVQTLGVFLSTIWTSIVTVATTIWTTLVTVAQTIWTMLVTVITTVVQSIVTFVQAGWTLLLTVTSTIMSAISAFISAIWSSIVSIITSIVSSIIAFVSSGWSTLMSITSSIMSAISSLISSIWSSIVSFITNAVSSAVSFVSSGFSNMLSTVGSAMSGIVSAVISGMSNVVSSVRNGVSNAVSVARSFIGHMVSVGRDLIMGLINGIKAMAGQVASAAKNVVMGAVNAAKSALHIGSPSKLFKQYGVWTMEGLGIGINKEGKNVISGMGSMANSITDAFNSNLAIPDITANMKKVNANMNAQVQHTHNIKTNPSQRVVRIEMGVDNDALTTIVNEQNANRDATFTF*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0043	shell	direct	high	3773	1.0	GCA_001237185.1_01564
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	55072	56019	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	28391	29338	GCA_001237185_1_11_72	GCA_001237185_1_11_72	+	82153	.	PDB:2X8K_A	Distal-Tail-Protein	MDLEIKKQNGQQYTLGDFGFVVDDVIIESMEIEDNYETKENTSGRILLSSQYRKRKINVKCHVNSTKLNDNARLRDEFYNLTNSTEEVWIRELRRSVPLNYRFIEPLEDDYQEISEYNNLVLDHEEFNDNYYVNGKRYKVKNADVIVPEENGKKISFELVFETTELPFAESIGTSLDLEKRPDKELWSNDMLIPFDEQDGSRIYSFTNIWNNAIYYHGTADNDQFNMYKKVTIILGEDTENFVFTMTHSDVMTIRNVKMKKGDKIEYDGVQTFKNGTPLSYEVSGSQPKFRHGWNEFEFNQQVKSVKFDMKFYYK*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0044	shell	direct	high	947	0.999	GCA_001237185.1_01565
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	56030	57364	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	29349	30683	GCA_001237185_1_11_73	GCA_001237185_1_11_73	+	82153	.	PDB:3GS9_A	tail-protein	MPILISPKRGRGKFVNTTTNWTDKNSSEAVLQFELLEDAYNYEVVRAIDKRWSVSRVEGPDDEKEYLAFLIDRQAHGTKQRVTVSCRYKPIDTIKRRRIYAPINGSFTAKKFLDIAFGPTDLEYKVTEDKLPSSDFENAGEGETVEELIKKAMSHWDLEFYIDFDKKTKKYTFVFTPYNQKEVDYIIDDEINANNIKVEEDTGDMATYCVGYGDYTDEQGVTGAGLIMKFEHPDMKDIGKYEAEPIKDGRIKDEELMKAKLQKVIDDSVKRSISLDFIVLKKYYPNANPKVGDLVKIRHSVLGLNEIVRIVEVKTKRDSDNEIIKQEITLGEYRRYDRYMNRINVAASTIGGLGGGAFVRDYRSTSAKTSSVLATTIEMRNEGNASTDKAGLMSPEDKKKLDSIDASSKLTAKKVDGTVIDLSDKELYIDENGNLKIKEVSDNA*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0045	shell	direct	high	1334	0.999	GCA_001237185.1_01566
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	57357	59231	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	30676	32550	GCA_001237185_1_11_74	GCA_001237185_1_11_74	+	82153	.	CDD:cd03872	Peptidase-M14	MRKTIYTSLETIFGARHVRELELNFIAFRDMVTYVEDELHRHNFVDNEAHQSHQIKHTFVDGSTRSVKDSINWLDARMRAFLVPTLANDQQEIIDARASIDGKVSKTLGDRLGRDFNSIRNDLDKELNVAADSSYLWTPPYIKGAMRGENETPLHNEPTENLKVFYDKFVDNEYCRKTYIGKDQSGEYSVYSYTFEPQHYSKTLLLTSCIHGNEYSAFYANSRFLDLVVNKWHTDPHLAYIRKNVRIVCVPIVNPHGFANDNRENSNNVDLNRNFDYNWKAGKGTSSTGKNFKGKAPFSEQESKNMKKLVEGLNHITAHVDCHNIVSQVSDYCLFYPRFSNQDHNLMTQFMQDVSNHGDYVTWGSSTLSSFSNWVGIKKNITSYLPEIYEGRAGKPRGAEEMWRSVNFLGNIIIRLMQTNTSGQGRTSNEAFAKTFVYSDRYNNKGVQTFSLQATDKYQRMLMTQQRFNITANGIVEMNGSITVEVDRDTTFGVNPMVVQNYNPWSNNGKSDKRQLFKTEHKLPKGIHTIPINAIAPVQMSSVTPSDVNRSAEIMCPVEVKRSAGVCYIKQLIQNIKFIPTGSHNAFQAFTSTGYGNQKEKTFTQIYPNYESAYDVRNEIITKK*	common_virus_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0046	shell	direct	high	1874	0.999	GCA_001237185.1_01567
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	59244	60485	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	32563	33804	GCA_001237185_1_11_75	GCA_001237185_1_11_75	+	82153	.	PDB:4DIV_C	Distal-Tail-protein	MSSMDIDGIYKNAKLVASDTPYLKPLSDEQIVFYNLDVNTAILTFQVKKDKYPLQISSLNSDIDLYVESENGSHTSLTKVEYIDSLNGIIRFVIDRDFLKASTDTWVNGQVRVKAVGRPDTVILNEFRFYVKDALINKIGADIKVRYIRQIDDLIEEAERRLIAASAGIENVENIQLSFNSFISEQKQDLEKIVTDTERRTNSLVDSAQKDINSAIQNMRDEADTIRKNLSDETAGAVTKPDLDTTLSNYVTTVDFNNALNNKADKGQVAPSNLPDNFNELINQAVTNRISELNQNKALFNNNGEVYEINNPDLSTMDFVDKSGYFYAVGPLHTPDGEDTEGMLQVLAYGNYTKVIFSPNETNAIYLRSKLNQVGNNWTDWLNIGSEVEIGTNDSYVEENDVDTSIDDSTETT*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0047	shell	direct	high	1241	0.999	GCA_001237185.1_01568
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	60504	60920	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	33823	34239	GCA_001237185_1_11_76	GCA_001237185_1_11_76	+	82153	.	.	hypothetical protein	MKYNFNEVINFILLLGLGAFTFARGFFFTKEQEKVLGDSDFYVALHHIMPIWVWGIIIMIASIILGVSSFFLPRQKTNNTCNWLLLIGGTSCSVLYFFMTSASIYNAINWLSTIQFSILSAVCFAVSFIGGADIYDRK*	.	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0048	shell	direct	high	416	0.998	GCA_001237185.1_01569
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	60907	61299	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	34226	34618	GCA_001237185_1_11_77	GCA_001237185_1_11_77	+	82153	.	.	hypothetical protein	MTENKHVTYEEWRISREDILEKIKAGDDENMKHINELKEKIAEGNVYQRQSFEVQKDTNEQIKQLNDTNSKQWDAIKEIKFVVKTHEEDIEKLEGTISEKQKNSVQISVALITTVGGIIVGAIKLAQYMF*	.	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0049	shell	direct	high	392	0.997	GCA_001237185.1_01570
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	61353	63290	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	34672	36609	GCA_001237185_1_11_78	GCA_001237185_1_11_78	+	82153	.	PDB:4OLS_C	Endolysin	MAILPSRGKPTASQVASWAKWMANNRRGVNIDGRYGYQCWDLPNYIFERYWGFRTWGNANAMARRANYPNTSWKIYANTPSFIPKPGDVAVWTYGWAGHTAIVVGPSDKKHFRCVDQNWYGANQYRGSVAAYVNHDYSGRGGSLYFVRPPYKSEPKKPTPKPTEPDKPKDTNTTTPTTKPEEKETKTVVKEVKEVKFTVDDVETNFPAFIPHRIAKGKDRGRSPKKVLIRDAGTMCSVLDLYTTRRKYIRTSELPHYYIDRNYIWQPRYEQIEVPSAPDCLVIEVCGDYSDSKNDFILNEIHAMIYLIGRMKFHSIPMKQSSFIIESEYWRTILEHGAWDTVTKGQPSKKVEDKTIEALINLYQNREKLLNDIPSDKVSKRKIKVEVSKDDETTSTSNDKPKDTNTSTSKTTSVKKKQPTVTVVYSKYTYNNALNIQMARAPQVNYGSGWYNASRSATSAAMNNAKIWNNSKMRYQMLNLGKYQGIPVSKLNKILRGKGTLSGQGQAFADGCKKYNINEIYLISHAFLESGYGTSNFASGRYGAYNYFGIGAYDNNPNYAMTLAKSYGWTTPAKAIIGGAKFVRRGYINNGQQTLYRMRWNPQSPGNHQYATDINWCKHQANTIYNLYSQIGMKGEYFIRDRYKS*	common_virus_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0050	shell	direct	high	1937	0.999	GCA_001237185.1_01571
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	63348	65966	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	36667	39285	GCA_001237185_1_11_79	GCA_001237185_1_11_79	+	82153	.	PDB:4DIV_C	Distal-Tail-protein	MTIYKNKDIETNINERSVDLGNINVTLYPNDQGTASFRIYLKKEVRYSNQTILEPIDLVKAKMDPRVDLLTRDGSTFTKEPIDIIDAENGVIQYVVRPRILKHSGQIDVSITLENESTKSEVANFYFFVKEDKVTQSIGREISPETIKDIVKSVMSENLMGQLSDDYRQVLEREIKDYLKSNSYDFKFKYEDLTSQEKKEFIKVVTNEALSDFVIPDQSINTNKLTLNSVEPQTTSFLKTGKNIFRANNVTQGYSVSHTTGELIKSPYYVVSDFEPVTPSTTYVQNFADAIAFYDLNKKFISGIKKADNTKNTRSFKTPSNCYYIRTGTLKEGVDTYNYKNYQIELGDTATEYEEYYRTIDYLKPNIPNNSITSDQISNSSVSLEKLGFTKHSSNLYNNKTNTTGYYVNPTTGALSSNPTYSASDYINIKGATKVTKSNARNLYAFYDDSKNFIKTNNTNTNTVDVPSNAAYIRFSDTETSMNGQMLVIGDTLPTTFVPYKFFIPKDYIENDANDNSSVSANQESFGKEFLKTYTADFSKAMNSDYNGRAEIAILGDSWVAGGEKKQGERLTRPLRERYLKNYADGGIGFVSFANGHIGNGEVVVNLTGDWTHYDEDPKKADIALSKGLDSAMVESSTVGDSIKVQFYEDLDFYEIHTLNTGTWRYNIDGGDWVTVDATQQEVTPITLSFGKHIINIEIVSGKVTFIGSYAYKGNKGVVVHKIGNGGLRGGHMTSTDRDNYIKQLKRCRANTFGILLGTNEMAQNIPVSTYINDLKEIVSRIREAKPLASIFLIAPSGNKYDGKQLHTIEDYSNAQLNVAKDLNLGHVSLYRNLGDYATTNANGLMYTDGVHPNKDGGYAICNVVYNRLLRL*	hallmark_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0051	cloud	direct	high	2618	1.0	GCA_001237185.1_01572
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	66022	66321	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	39341	39640	GCA_001237185_1_11_80	GCA_001237185_1_11_80	+	82153	.	PFAM:PF06946.10	Phage_holin_5_1	MESIIAFATVISVITIALTQLVKQAGVPKNIVPLIAIGIGIVLGGITAFIPEIITELSIGGRLLAGLISGLMATGIWETVRPRTGSTKDKNNKIGGGRA*	common_virus_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0052	shell	direct	high	299	0.997	GCA_001237185.1_01573
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	66321	68030	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	39640	41349	GCA_001237185_1_11_81	GCA_001237185_1_11_81	+	82153	.	PDB:4CSH_C	Endolysin	MVEKWNGVPVKYDFLPIGTRRSGQPLTSKKPLFAVAHDTGNPETTAQTNVTYYKNTYMIDWSIVASAHIFVDDKECIVCIPVTEKAWHVLYNTPTDNQWYNADANDVAFGVEGSYFPSSQKRSRKSLDNMARVLAYLCNYWGIDYKTEVPGHQDIQDDKIDPGNLLEACGYSRNVKHLDKQIAKYINGVKPAPSKKLSTKTSKKPTPSPQSVVKYKQAIEYMHSLKGQYIDFDKESAFQCADVVVDFIYHVTGGVRFYGNAKELHTLNAMPKGWKVVKNTRNYVPPICAIAVYTEGIYREWGHTGLVWDNSGGTNTFTILEQNYDGNTNTPAKLREDDYTGLTHFIVPDFADDSVDLTDIKEVKATKRQSNSSITVNKRPPKKLTWSNQPYFKAIADNAGVTICRPNHNNVMVTTNEQYKPGDVFYIYEIRDGWARVYSASNNGFVWYERLIVKDIYKTAGGSKLANKPNKQIVNQKNKLDSTTGLKVGSIPPKTMKKSSKAKFRARVDHYGATLVKFKGKEWYTTNDVYRAGYNQFYVFEVKDGWCRVYSKNNNGYIWHERLRITKVY*	common_virus_hmm	common_virus	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0053	shell	direct	high	1709	0.999	GCA_001237185.1_01574
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	68428	68628	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	41747	41947	GCA_001237185_1_11_82	GCA_001237185_1_11_82	-	82153	.	NF040477	reactive chlorine resistance oxidoreductase RclA. 	MTHFNLLVIGFGKAGKTLAKYVASQGQHVALVEQSSDNFGGTCINVKCTNFHNKITRRIRRVLFYF*	mmseqs_cdd	nonviral_gene	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0054	cloud	direct	high	200	0.995	GCA_001237185.1_01575
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	68615	69055	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	41934	42374	GCA_001237185_1_11_83	GCA_001237185_1_11_83	-	82153	.	3LWF_D	Putative transcriptional regulator	MNLEFNIAVHVLSFLTKHSEEQFNSQDLAELTCLNPVQLRRVTTTLNNQQYIDSIRGKGGGYRANAHTPTITLDTLYQLFVLDKLPTQRIFTGSEESHCTISRNIAITMNKYKEQETALALNFYRNLTINDVIKETLQEDTSNDTF*	hhsuite_tools	hypothetical_protein	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0055	persistent	direct	high	440	0.998	GCA_001237185.1_01576
GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote	cenote	CDS	69185	70120	GCA_001237185.1	CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185.1_CUGS01000011.1	GCA_001237185.1|CUGS01000011.1	GCA_001237185_1_11	GCA_001237185_1_11@C1	42504	43439	GCA_001237185_1_11_84	GCA_001237185_1_11_84	+	82153	.	cd19083	AKR11A and  AKR11D families of aldo-keto reductase (AKR). Bacillus subtilis aldo-keto reductase IolS, also called vegetative protein 147 (VEG147), is a founding member of aldo-keto reductase family 11 member A1 (AKR11A1). It is able to reduce the standard aldo-keto reductase (AKR) substrates DL-glyceraldehyde, D-erythrose, and methylglyoxal in the presence of NADPH, albeit with poor efficiency in vitro. Bacillus aryabhattai aldo keto reductase is a founding member of aldo-keto reductase family 11 member D1 (AKR11D1).	MADLVQLGKSDVHVFPIALGTNAVGGHNLYPNLDEEQGKDVVRKAIDNGITLLDTAYIYGPERSEELVGQVVQEYPREQVQIATKGSHVIKENDEVVQNNDPDYLKQQVENSLKRLQVDYIDLYYIHFPDENTPKDKAVAALKELKDEGKIKAIGVSNFSLEQLKEANKDGYVDVVQLEYNLLHRENEEVMKYAAENNITFIPYFPLASGILAGKYEENQTFDDHRAPRRDFQPEVFNDNVRRVKQLQGIAEVHNTSIANVVLAFYLTRPALDVVIPGAKRAEQVVQNIEAANIQLTDDELNKIDELFPIE*	mmseqs_cdd	nonviral_gene	C1	43439	26682	70121	GCA_001237185.1|CUGS01000011.1@region_26683_70121@tool_cenote_CDS_0056	persistent	direct	high	935	0.999	GCA_001237185.1_01577
