>Bougainvillia_cf_muscus_BCFM_g13017.t1 MDKKTTTVYLKPRTKKVITISCGKAAPTLNVSASSPSASASASVNGKDDDKTKHVTEEVL TQVKKEDPKIDVSGTMEVGGSIDVKIPAAQADAEVKTKKKKKKKKKKGFFSKVGEFFDGS SSSSSSSSSSSSEDEDGEKKKSKKAKVDADVKPSIGGGISIGGSSDAGADADVKLPSGNA DIDVGGSGKIDAGKDIDVNLPSASGGFGLGGSGKGDAGGDIDVNLPSASGGFGLGGSGDA DLSINAPKIDMLPKAPIVEGDISEHRKLDAPTVDLDAGLSTDVNVDAPAIGFGGGMDIAI PDMDSKVEMDVPSMNASMGGGFTAGIEVPSMDNDVAVAVDVPSVESTPFSMGGLSGGIEV PSMDDVAVADVPSVESFEEEISAPVVSAEVECIPDMDEEIIAPSIETEVEALPFDLDANA SADVDINIGLFGKVSGFGGEPGVEVDVSTPNVDLRSGGIGNVDLPSGGIGGGIGGGFKAP DVDVSTPVDLPSGGIGGGIGGGFKAPDVDVSTPGIGGGIGGGFKAPDVDASTPNVDLPSI GGGIGDVDVSTPDVDLPGGVDVSTPNVDVHVSTPDVDLPSGGIGGGIGGKDVDVSTPNVG GGFGIGGGFKAPDVDVSTPNVDGIGGGFKAPNVDLPSGGIGGGIGGRFKAGFKAPDVDVS TPNVDLNVDGGIGGGFKAPDVDVSTPNVDLPSGGIGIGGGFKAPDVDVSTPNVDLPSGGI GGGGIGGGFKADVDVSTPDVDLPGGKGFKAPDVDVSTPNVDLPSGGIGGGIGGGFDVSTP NVGGIGGGIGGGFKAPDVDVSTPDVDLPSGGIGIGGGFKANVDLPSGGIGGGFKAPDVDV STPDVDLPSGGIGGGKLGGDVDVNVDLPSGAPVDVSTPDVGGGFKADVDVSTPDVDLPSG IGFKAPHVVDLPSGDVDVSTPDVDLPSGGIGGGIGGGFKAPDVDVSVDLPSGGGIGGGFK APDVDVSGGGIGGGFKADLSTPDVDLPSGGIGGGIGGKLPDVDVSTPNVDLPSGGIGGGI GGGFKAQDVDVSTPNVDLPSGGIGGGIRGDVDVSTPNVDLPSGGIDGGIGGGFKAPNVST PNVDLPSGVDVSTPNVDLPSGGIGGGIGGGFKAPDVDVSTPDVDLPSGGIGGGIGGKLGG IGGGIGGGFKAPDVDVPNVDLSGGIGGGIGGGFKAPDVDVSVDLPSGGIDGGIGGGFKAP DVDVSTPDVDGGGIGGGFKAPDVDVSTPDVDLPGGGIGGKLGGLGGIGGGIGGGFKAPDV DLPSIGGGIGGGFKAPDVDVSTPNVDLPSGGIGGGIGGDVSTPNVDLPSGIGGGIGGGFK APDVDVSTPNVDLPGGFKAPDVDVSTPDVDLGGIGGGIGGKLGGLGGIGSGIGGGFKAPD VDVPNVDIGGGFKAHDVDVSTNVDLPSGGIDGGIGGDVDVSTPDVDLPSGGIGGGIGLGG IGGGIGGGFKAPDVDVSTPNVDIGGGFKADVDVSTNVDLPSGGIGGGIGGKLGGLGGIGG GIGGGFKAPDVDVSTPNVDLPSGGIIGGGFKAPDVNVSTNVDLPSGGIDGDVDVSTPDVD LPSGGIGGGIGGKLGGIGGGIGGGFKAPDVDVSTPNVDLPSGDVDVSTPNVDLDADISTP DVDLGGGIDLEGNDVNLSKQKNRGSFKFGLKMPNLRGKKKGKDGKGGLDADIPDAKVDVD TPKAGVNVDTPDADLKVTAPDADLNIDGPRGSHSSESDDDDDKKKKKKKGKGGFSFGIKM PKFHGPNFGGKGKGGADGELPDVDGKAKDISANIPDATFDLDTPDVKAGVNVDTPDADLN VKAPDADLNIEGPDANVDLKGPSIGGGVDFGVKGRRSHSSESGDDDDKKKKKGKGGFGFK MPKFHGPNFGGKGKGGVDGDIPDVDGKAKGGLDISADIPDATVDLDTPKAGVNVDTPDAD VKVKAPDADLNIDGPDGNVDLKGPSIGGGVDLGIKGRRGSHSSESGDDDDDKKKKKGKGG FGFGLNMPKFHGPSFGGKGKGGVDGDLPDVDGKAKAGLDISAPDAKVDVDTPDVKAGVNV DTPDADLKVKAPDADLNIDGPDGNVDLKGPSIGGGVDFGIGRRGSHSSESGDDDHDKKKK KGKGGFGFGFNMPKFHGPNFGGKGKGGVDRDLPDVDGKAKGGLDISADIPDAKVDVDTPD VKAGVNVDTPDADLKVKAPDADLNIEGPDGNVDLKGPSIGGGFGIKGRRGSHSSESGDDD DDKKKKKKKGKSGFGFSMKMPKFHGPNFGGKGKGGVDGDLPDVDGKAKGGLDISADIPDA KVDLDTPDVKAGVNVDTPDTDLKVKAPDADLDGNVDLKGPSIGGGFGIKGRRGSHSSKSG DDDDDKKKKKGKGGFGFGLNMPKFHGPNFGGKGKGGVDGDLPDVDGKAKGGLDISAPDAK VDLDTPDVKAGVNVDTPDADVKVKAPDADLNIDGPDGNVDLKGPSIGGGFGIKGRRGSHS SESGDDDHDKKKKKGKGGFGFGFNMPKFHGPSFGGKGKGEVDGDLPDVDGKAKGGLDISA DIPDAKVDLDTPDVKAGVNVDTPDADLKVKAPDADLNIDGPDGNVKGPSIGGGVDFGIKG RRGSHSSESGDDDHDKKKKKGKGGFGFGFNMPKFHGPNFGGKGKGGVDGDLPDVDKVKGG LDISADIPDAKVDVDTPDVKAGVNVDTPDADLEIKAPDADLNIDGPDGNVDVKGPSIGGG VDFGIKGRKGSHSSESGDDDDDKKKKKKKKGKSGFGFSMKMPKIHGPNFGGKGKGGVDGD LPDVDGKAKGELDIDIPDAKVDLDTPDVKAGVNVDTPDADLKVKAPDADLNIDGPDGNVD LKGPSIGGGVDFGIKGRKGSHSSESSDDEDDDKKKKKKKGKGGFGFGLNMPKFHGPNFGG KGKGGVDGDLPDVDGKAKGGLDIDIPDAKVDLDTPDVKAGVNVDTPDADLKVKAPDADLD IDGPEGNVDLKGPSIGGGVDFGMKGRKGSHSSESGDDDDEKKKKKKKGKSGFGFSMKMPK FHGPNFGGKGKGGIDGDLPDVDGKAKGGLDISADIPDAKVDVDTPDVKAGVNVDTPDADL KVKAPDTDVNIDGPDRNIGGGVDFGISHSSESSDDGDDDKKKKKKKGKGGFGFGLNMPKF HGPNFGGKGKGGVDGDLPDVDGKADISADIPDAKVDLDTPDVKAGVNVDTPDADLKVKAP DADLNIDGPDGNIRGGVDFGIKGRKSHSSESSDDDDDDKKKKKKKGRGSFGFGIKMPKFH GPNFGGKGKGGVDGDLPDVDGKAKAGLDISADIPDAKVDLDTPDVKAGVNVDTPDADLKV KAPDADLNIDGPDGNADLKGPSIGGGVDFGIGRKGSHSSESSDDEDDDKKKKKKKGKGGF GFGLNMPKFHGPNFGGKGKGGVDGDLPDVDGKTKGGLDISADIPDAKVDVDTPDVKAGVN IDTPDADLKVKAPEADLNIDGPDGNADLKEDDDKKKKKKKGKGGFGFGLNMPKFHGPNFG GKGKGGVDGDLPDVDGKAKGGDISADAGDAPAVAGDVDVKGPNVDGDVDINAPKVGGDIN FGMKGRKGSHSSSSSSDSDSDDDKKKKKKKKKKDKHGFGFSMKMPKFGGGGKGKGDLDVN AGASGDIKTPDNMNVDGDVDVKGTKVPGDVNIEGPDVSLPSGGDVNVKGPNVDGDVDVNA KGSHSSSKKGFGFGLNMPKIHGPNFGGKGKGGVDGDLPDVDKGGLDISADADAGNVADND VKGPNVDGDVDINAPKVEGDINFGMKGRKGSHSSSSSSDSDSDDDKKKKKKKDKKKKHGF GFSMKMPKFGGGGKGKGDLDVNAGASGDIKTPDASLPNADINVDGDVGVKGAPGDVEGPD VSLPSDGDVNVKGPNVDGDVDVNAPKVGGDIKKKGGFGFGLNMPKIHGPNFGGKGKGGVD GDLPDVDGKAKGGLDISAAGDAPAVAGDVDVKGPNVDGDVDIGMKGRKGSHSSSSSSDSD SDDDKKKKKKKDKKKKDKHGFGFSMKMPKFGGGGKGKGGASGDIKTPDASLPTADINVDG DVDVKGAKVPADVNIEGPDVSLPGNIDGDVNVKGPNVDGDVDVNAPKGDINFGMKGRKGS HSSSSSSDSDDDKKKKDKHGFGFNIKMPKFGGKGGVDADVNAEDLSGNVDGPDVSLPSAN LDGDVDVKGPNVDGGVDIKAPKVEGDTDIKGAGTAGDIDVEINAPKIEGGIDLGVKDDDD KKKKKKGGFGFNFKMPKFGGKGKVKTKGKDGDIDMHVGGEAPNIDGDTNIKVPNADIPVE VDLDKPKIDGDADVDVDDKKKKKKKNSFKFKFGASADAKASMPDADVEVNQPSGSVDPNI SAPKGDIATPELPEGSTAQVTVEGPEGGAIAKPDADIPSAEASGEVGIERSGSILDKIGA FFKKPKADADKRGKKRKRGKEGDTKFYAPDTSANLNITGTGDVNIVASDPPSLDTPKGDI NLGISDDTDFVIVETPTTKKKSDIPNADADVNAGAYVDVDLSGETDAKKPKSPSLLRRLG MFFHIGAGDYDVSGKKKKKRRKTSKSSKSGGLPDTDIDLGESESIKKDEDNFTIPEANVD TSAGLAITSDVNLNSELQTSKDIGGNTDTSLGGNTSLGGNTNTSLGGAVGLEITPPSVNV SSEASGGTDLSTDTQVSSGADVSSAGSVAGEASAGVSADASATAGASAGGEIGGFKGQVG GKSFEYSVSYRVYRLIVTLEIFA >Candelabrum_cocksii_CCOCK_ENSQNNP00000014733.1 pep jhCanCock6.1_15_10876986_10882288_-1 gene_ENSQNNG00000010184.1 transcript_ENSQNNT00000015263.1 gene_biotype_protein_coding transcript_biotype_protein_coding gene_symbol_col6a1 description_"collagen type VI alpha 1 chain [Ensembl NN prediction with score 88.04%]" MPKFSGPNFGGDGKADVDGPDIDVGGKVKGGIDVDKPDLKADVDLPDVDVSANLPKGDLK LDHDHSDSDDDHDHKHKEKKDKGKGGFGFGLKMPKFSGPNFGGDGKADIDGPDIDVDGKV KGGVDVDKPDLKADVDLPDVDVSANLPKGDLKLDHDHSDSDDDHDHKHKKKKDKGKGGFG FGLKMPKFSGPNFGGDGKADVDGPDIDVGGKVKGGVDVDKPDLKADVDLPDVDVSANLPK GDLKLDHDHSDSDDDHDHKHKKKKDKGKGGFGFGLKMPKFSGPNFGGDGKADVDGPDIDV DGKVKGGVDVDKPDLKADVDLPDVDVSANLPKGDLKLDHDHSDSDDDKKGKKLKDKKNRG SFGFGIKMPKFSGPNFGGGSKGHLDGKVDCDTDLNVDKPKLKPEGHGKGVDMNADLNLDT GHSDSEDSDHKRKKKNDKDKKNRGSFGFGIKMPKFGGGVKGDVDTPDVDVDFKGKGKGDI NVDTSDLDVSASSPDGDAKLNLPDASLKGGLGLDVDKRKGSHSSSSDSDDDDKDKDKKDK KKKSKSKGKGFGFGIKMPKFGGGGNGDVDKPDVDVDAKGKGKGDINVDTPDLDVSASSPD GDAKLNLPDASLKGGLGLDVDKRKGSHSSDSSSDSDDDDKDKDKKDKKKKNKGFGFNFKL PKFGGGNKENSDASNIPSDYNIKADANVKSPDLEKNIDLSKEDPASGNSIDLKIPDASIQ GDVGIDKRKGSSAGSCSEGDDHKTKKGGKPDLDTSVASSNPDVNGEKKKKKKGFGFKFGG FGSAKKPEDGTSTFYAPSADVSGSVDASADLHVPESEGKLKVNKPDVEMEPQSPHRSHSF LDRLFKKKDDRTSSSSSTGDAKRGKKRKRPKDKDVQLKGPEIKAGASIATGNGRNSAIAE SENGFEIIASPDANANLLQKDEDLHLKTAKSPSLLQRIGMFFHLHSDNYDIEGQSKKKKK KTTHKDQELDADDESTTQLSVRGEDNFTIPEVNVNIDPTLGTATQVESKTVDGKGEGAIG GECEARAGVGVGAGLDASAGISMNAGATTQAEVDGKSYEIKMSL >Clytia_hemisphaerica_CHEMI_XP_066930085.1 LOW QUALITY PROTEIN_ neuroblast differentiation-associated protein AHNAK-like [Clytia hemisphaerica] MDFDAKVDLNAEAKAEAEKVEKKKEKKKKKKKGFFAKVGDLLDGSSSSSSSSSSSSSSSS SSDDEDDKKEKKKTKKKSKAKASAGLSAGIAAPSFSVSGDSNANADLNQSGGVSVSIPSF GGGLSSGGDIGLPAPEVSAEAPSVDTNVDTPSIGGGLGFGGGIKAPETDTNVEAPSIGFG IGDIKAPEVDTSFEAPSPSVGGSMGGGFGLGIEVPSADIEVPEIPDMSFSGISGGLSGGF EVPDIPDITVESVPEVQSIEADIVMPSIESEQETVPFSFDDEVIVPEAVADVESLPFDAK FEAELEAPDVSDGIMGAVGGFGFGGSKPEAKVEVETPSVEANIDTPSIGIGGDLSYGGEV KAPEIDANIDVDIETPSIGGGFGGGFGGGLGFGGGAKVPEIDANIDTPKVDTPSIGGGFG EVDANIDTPKVDIDGGVDIDTPSIDANIDTPKVDIDTPSIGGGFGGLDANIDTPKVGGGI GFGGGAKVPDVDANIDTPKVDGGLGFGGGAKAPKVDIDTPSIGGGIGGGFGAKVSDVDID TPKVDIGFGGGAKVPDVDANIDTPKVDIDTPSIGFGGGAKAPEVEANIDTPKVDIDTPSI GGLGFGGGAKVDVDIDTPKVDIDGGLGAKAPEVANIDTPKVDIDTPSIGGGIGGGFGGGL GFGGGAKVPDVDANDTPKVDIDTPSIGFGGGAKADIDTPSIGGFGGGAKAPEVDIDTPKV DIDTPSIGGGGFGGDVDANIDTPVDIDTPSIGFGGEAPDVDANIGTPKVDIDTGFGAKAP EIEANIDTPKVDIDTPSIGGGIGGGAKVPDVDANVDIDTPSGFGGGAKVPDVDANGLGFG GGAKANIDTPKVDIDTPSIGGGIGGGFPEVDIDSPKVDIDTPSIGSGFGGGIKGDADIDT PKVDLDTDIKSPDVEVGDVDLDVGIGGGLKMPDADVPDVDIDAGVDVKTPSVDVDLPDTD IKVSADVDVNVPKGDVDIEGPDVDLKGKKGGFGFGFKMPKFKGPHFGGSGKGDIDVPDVD IDGKIKGDIDADVKVPDADVDVNIPKGDVDIDGGGFGFGFKGPDIDVDGPDVDFDGKVKT PDVDIDADVKVPDVDLEGPDADLKGKKGGFGFGFKGPKFKGPHFGGSIDGKVKTPDVDID ADVKVPDADVDVNLPKDIDGPDVDIDGKKGGFGFGFKGPGGDIDVDGPDVDFDGKVKTPD VDIDAPDADVDVDLEGPDADLKGKKGGFGFGFKGPKFKGDIDLPDVDIDGKVKTPDVDID ADVKVPDADVDVNLPKDVDIDGPDVDIDGKKGGFGFGFKMPKFKGPNWGGSGKGDIDVDG PDVDFDGKVKTDVDIDADVKVPDADVDVDLEGPDADLKGKKGGFGFGFKGPDIDVDAPDV DIDGKIKGPDVDIDADVKVPDADVDVDVDIDGPDVDIDGKKGGFGFGFKMPKFKGPNWGG SGKGDIDVDGPDVDFDGKVKTPDVDLDADVKVPDADVDVDLEGPDADLKGKKGGFGFGFK GPKMPGPHFGGSGKGDIDVDAPDVDIDGKIKGPDVDVKVPDADVDINLPKGDVNIDGPDV DIDGKKGGFGFGFKMPKFKGPNWGGSGKGDIDVDGPDVDFDGKVKTPDVDIDADVKVPDA DVDVNLPKGDVDIDGPDVDIDGKKGGFGFGFKGPKMPKFKGPNWGGSKGDIDVDGPDDGK VKTPDVDIDADVKVPDADVDVDLEGPDADLKGKKGGFGFGFKMPKFKGPHFGGSGKGDID VDAPDVDIDGKIKGDVDIDADVKVPDADVDVNLPKGDVNIDGPDVDIDGGKFKGPNWGGK GDIDVDGPDVDFDVKTPDVDIDADVKVPDADVDVDLEGPDADLKGKKGGFGFGFGPKMPK FKGPNWGGSGKGDIDVDGPDVDIDGKIKGPDVDIDADVKVPEADVDVILPKGDVDIDGPD VDIDGKKGGFGFGFKMPKFKGPNWGGSGKGDIDVDGPDVDFDGKVKTPDVDINADVKVPD ADVDVDIEGPDADLKGKKGGFGFGFKMPSFKGPNWGGSGKGDIDVDGPDFDGKIKGDVDL DADLPNADIDVNTADFVDIDLPDIDAELPKGSLDADVKLKKDKKRNSFGFGIKMPKFHGG GKSGSVKKNIDVDGDTPDVDAKLKGSVDVSGGVGGDIKLPDVDADVKVPDADVDVSLPKG DIDIDGPDADLKGKKGGFGFGFKGPKMPKFKGPNWGGSGKGDIDVDGPDFDGKVKGPDID VSAGGDVKLPDADLDIDGKVKAPDADVDVNLPKGDIKGGMGFGFGGKGSHSDSDDDDDKK KKKKKKKKGKGGFGFGFHLPHFGGGAKGGVDGPDLDVDGKLDVSAGAGGDIKLPSGDVDV KVPDADVDVNLPKGDADIDGPDVDIDGPDVDGGFGFGFKSGKGDVDVDGPDFDGKVPDVD IDGKKGGFGFGFKMPKFKGPNWGGSGKGDIDVDGPDFDGKVKEPDVDIDADVKVPDAVND VDIDGPDVDIKGDIDVDGPDFDGKVKGPDVDIDADVKVPDADVDVNLPKGDVDIDGPDVD IDGKKGGFGFGFKPKMPKFKGPNWGGSGKGDIDVDGPDFDGKVKGPDVDIDADVKVPDAD VDVNLPKGDVDIDGPDVDIDGKKGGFGFGFKGKMPKFKGPNWGGSGKGDIDVDGPDFDGK VKGPDVDIDADVKVPDADVDVNLPKGDVDIDGPDVDIDXKKERGFGFGFKMPKFKGPNWG GSGKGDIDVDGPDFDGKVKGPDVDIDADVKVPDADVDVNLPKGDVDIDGPDVDIDGKKGG FGFGFKMPKFKGPNWGGSGKGDIDVDGPDFDGKVKGPDVDIDADVKVPDADVDVNLPKGD VDIDGPDVDIDGKKGGFGFGFKMPKFKGPNWGGSGKGDIDVDGPDFDGKVKGPDVDVSAG NLPDADLDVDVKAPDADVDVNLPKDIKGGIGFGFSGKGRKGSTSSSSSSDSDDDKKKKKK KKKKGKGGFGFGFHLPHFGGGAKGGPDLNVDGKAKLDVDAPDVDAKLKGPDVDVSAGAGG DFKLPSGDVDVKVPDADVDLNLDGKKGLSFGPKMPKFKGPSWGGSGKGDVDVDGPDFDKG DVDVSAGGDAKPDADIDGKVKAPDADVDVNLPKGAKGGIGFGFGGKGRKGSTSSSSSSDS ESDDDKKKKKKKKGKGGFGFDINLPSFGGGAKGGVDGPDLDVDGKGKIDVDVPDVDGKLK GPDVKLEAGAGGDINLPDANIGGGIKAPEADVDVNLPKGDIGKKGGFGFGPKMPKFKGPN WGGSGKGDVDVDGPDFDGKVKGDVDVSAGGDVNIPDADLDIDGPDADADVDMGGKGRKGS TSSSSSSDSDDDKKKKKKKKKGKGGFGFGFHLPHFGGGAKGGVKAKLDVKLKGPDVNLSA GAGGDVKIPDADVDVKGDVEIEGPDADKGKKGGGGFGFGFKGPKMPKFGPDVDIDGNVKG PDVDVSAGGDIDANLPKGGVSVGAGVKLPSADKAPDADVDVNLPKGDVKGGIKGRKGSTS SSSSSDSDSGKKKKKGSFSFKLPKFGFGGSAKADVDADLPKVEGGVDIPSVDADVKAPGA KLDVDANLDADKGKKSSSFKLNFKKPSFRPKSPKVDPPSPELNADASAPRSDLSGPSVGG DVNVPTTVDVDANIPDSAGVGADIKVPDVDAGVKGPSLSGDVNVPKVSGDADINLPTADV DMPSASADIEGDVDLKGKKHKKGKFGIKFTGFGNLSGKKPKGDVDVKAPKGDVDVNLPSG SIDADVKGPSGDVDINVKGPSADIGGGADVDLPSADVSGDVKLKSSGSFLGKFGLFGKGK KDGDKRAKKRKHKGDVDLNADVNLPSADLDVDASGKAPSVSGESDFIVVDTPKMPKKEGD IDADIDLGGDASGSISGKGPKSPSLLRRIGMFFHIGGSSYNVEGEKKKKRRKVSSSSKDV DLDANVSVKRDDSFTIPEAELSAPSLSLGGGAGTGVDASADVSAASKVEAPSVAASSAVE VPSLDADVKGAGSAAAEVEAPSAKASGGFGFGLPSVDVSIPSVSIESDANANESLSTGVS GGAGLSGGADLSTGADLSADAGVSGGAAVSGAADASANTSASASGDLGGFKTDLGGKSFE IKMSF >Hydra_viridissima_HVIRI_BRAKERKREP00000021864.1 pep ASM1470644v1_QPEY01000295.1_107978_109238_-1 gene_BRAKERKREG00000020713.1 transcript_BRAKERKRET00000021864.1 gene_biotype_protein_coding transcript_biotype_protein_coding gene_symbol_NEDD1 description_"NEDD1 gamma-tubulin ring complex targeting factor [Ensembl NN prediction with score 73.15%]" MDSNDSYVLGSPNEKDLVSAQDIPSSNVSSTVGSSDFPAVISPDSLSVNDVSDKSLQKRK KRFLFSGSSSKKKKSSPTFYTVLDMPSEPSSSDASRGNVLSSPIVSGQAGVVSESLNDSV VSGHSVDIKGDHKSSTFLHKVFKKNDRKVSSSSVSGEKKSAVKQKNNNFQKVPTTNIPLT NNGDKLSETIIPSNVSVNDDKQEYVIIETTSSKSLQNCEDNNPSVRSLRSPSLLQRIAMF FHLHSDSYDFEHGDSKTPLRIDDGLERKDSLTELSVKGDDCFEIPEVTITLPSNITAPVS VEVSSENSDEALSKGYSVTDASLSNVSEASAYNESVKSTNAISVQNVTSSVHIGGSFSIS GKDSINFSSSKCY >Hydra_viridissima_HVIRI_g14260.t1.1 pep ASM1470644v1_QPEY01000295.1_107978_109238_-1 gene_g14260.1 transcript_g14260.t1.1 gene_biotype_protein_coding transcript_biotype_protein_coding gene_symbol_NEDD1 description_"NEDD1 gamma-tubulin ring complex targeting factor [Ensembl NN prediction with score 73.15%]" MDSNDSYVLGSPNEKDLVSAQDIPSSNVSSTVGSSDFPAVISPDSLSVNDVSDKSLQKRK KRFLFSGSSSKKKKSSPTFYTVLDMPSEPSSSDASRGNVLSSPIVSGQAGVVSESLNDSV VSGHSVDIKGDHKSSTFLHKVFKKNDRKVSSSSVSGEKKSAVKQKNNNFQKVPTTNIPLT NNGDKLSETIIPSNVSVNDDKQEYVIIETTSSKSLQNCEDNNPSVRSLRSPSLLQRIAMF FHLHSDSYDFEHGDSKTPLRIDDGLERKDSLTELSVKGDDCFEIPEVTITLPSNITAPVS VEVSSENSDEALSKGYSVTDASLSNVSEASAYNESVKSTNAISVQNVTSSVHIGGSFSIS GKDSINFSSSKCY >Hydractinia_echinata_HECHI_ENSDJXP00000001173.1 pep Hech_primary_v1.0_JASGCC010000003.1_4467708_4501828_1 gene_ENSDJXG00000000898.1 transcript_ENSDJXT00000001475.1 gene_biotype_protein_coding transcript_biotype_protein_coding gene_symbol_FLNB description_"filamin B [Ensembl NN prediction with score 78.62%]" MPKKKSKRKPGGQNKKAAPTLDDSTGTFTMDSQASASVDITASQNKELIQEDSLQEERIN APIFAADVESLPVVEMDANADATATLSAGKDKKDKKDKKDKKKKKKKGFFEKVGDFLDGS SSSSSSSSSSSSSSEDESDEKKKTKKKKVSKDFAASGNLKGAVTVGTPIDLQIEAPTVDV SGDVSAKTAAPLLPKAAIVEDDASEQRMGDVEIPEPDLDTNFDIKGNALGQKEDDMEELI SGVMDIPEQESSPDCPSLTLPEVEGEVIAPTIEAEVECIPDMDEFILPQTESEVEALPFD LSADIDENAGFNVPSFSGVMGGDVKVPGFDTPSFGGGIGGGIKGPDVDVPSLGGGIGGDV KGPGFDTPSFGGGIGGGIKGPDVDLPSLGGGIGGDVKGPGFDTPSFGGIGGGMKGPDVDV PSLGGGIGGDVKGPGFDTPSFGGGIGGGIKGPDVDVPSLGGGIGGDVKGPGFDTPSFSGG IGGGIKGPNVDVPSLGGGIGGDVKGPGFGTPSFGGGIGGGIKGPDVDVPLVGDGIGGDVK GPEFDGGDISVPEAEIDGSLSKNQKNRGSFKLGFKMPHLRGSGKKKSKKPDGPDDVHLSD PSLPNVDVKGDKPNVGFSNSSEDDHDDDKKKKKKKDKSKGRFSFKKPRVHFPNFGGSGKG NLPDVGLDGKIDVGGGVDVNTPDAKASLDAPDIDVKAGGGVSLPDADLNLKGDVKVPDAD LKGPDVGGGIGLGFGRRGSHSSSDDDDDKKKKKKKDKGKGGFGFNMPNVNLPTFGGGGKG KMDGPDVDFDGKGKIGVGGGVDVNTPAAKASLDTPDIDVKAGGGVSLPDADLNLKGDVKV PDADLKGPDVGGGIGLGFGRRGSHSSGDDDDGDKKKKKKKKDKGKGGFGFKMPHVNFPSF GGSGKGKVDGPDVDFDGKGKIDVGGGVDVKTPDAKASIDAPDVDVKAGGGMSLPDADLNV KGGVKVPDADLSGDADLKGPDVGGGIGLGFGRGGSHSSSDDDDDKKKKKKKDKGKGGFGF NMPNVNLPSFGGGGKGKMDGPDVDFDGKGKIDVGGGVDVNTPDAKANLDAPDIDVKAGGG VSLPDADLNLKGDVKVPDADLKGPDVGGGIGLGFGRRGSHSSGDDDDGDKKKKKKKKDKG KGGFGFKMPHVNFPSFGGSGKGKVDGPDVDFDGKGKIDVGGGVDVKTPDAKASIDAPDVD VKAGGGMSLPDADLNVKGGVKVPDADLSGDADLKGPDVGGGIGLGFGRRGSHSSNDDDKK KKKKKDKGKGGFGFNMPNVNLPSFGGGGKGKMDGPDVDFDGKGKIDVGGGVDVNAPDARA SLDAPDIDVKAGGGVSLPDADLNLKGDVKVPDADLKGPDVGGGIGLGFGRRGSHSSSDDD DDDKKKKKKKKDKGKGGFGFNVNLPSFGGGGKGKMDGPDVDFDGKGKIDVGAGVDVNAPD VKASLDAPDIDVKSGGGVSLPDAKGDVKVPDAELKGPDVGGGIGLGFGRRGSHSSSDDDD DKKKKKKKDKGKGGFGFNVNLPSFGGSGKGKMDGPDVDLDGKGKVDAGGVDVSTPDVDVK AGGGVPLPDADLNVKGADVKGDVKFADTDSSSSSSDDDKKKKKKDKKGSGFKFPGFNFGG KGDVKGPSVSGDIDIPKTGASTGVKGDGDLSVGGAGDVDLPIRRHFLTKG >Hydractinia_echinata_HECHI_ENSDJXP00000005061.1 pep Hech_primary_v1.0_JASGCC010000003.1_4502362_4503273_1 gene_ENSDJXG00000003493.1 transcript_ENSDJXT00000005866.1 gene_biotype_protein_coding transcript_biotype_protein_coding NEPVDASKGNSKFYTPDVNVDSPSGDIQAPTAKIEGDTFVTASLDAPSNVNIDAKSPSVD AEIKTDAPKGELNGSGGADVELPEAEVGVQRSGSFFDRFGGLFKKPKHSSESEDKRDTPT SPKKSVEINAGAEGDVNVAIPEGDGTVPQSPKSPSLLRRIGMFFHIHSNEYDVEGKKKKK RRKISFNGKKDKTQIEADTLNDSQISVKKDDDNFTIPEANINLPSVEKHVEIDTNLNVAA DKNQDVTLPSVGEFNSL >Hydractinia_echinata_HECHI_ENSDJXP00000005065.1 pep Hech_primary_v1.0_JASGCC010000003.1_4502032_4503273_1 gene_ENSDJXG00000003493.1 transcript_ENSDJXT00000005870.1 gene_biotype_protein_coding transcript_biotype_protein_coding MLIFLRLMCQLGGKGGTDLSAGGAGDIDLPSGSASSPDADGRIEGDVNIKGALKGSKPEI DLDHKKRRDSHSSSSSSDDDDDKKKKKKKDKKDTPTSPKKSVEINAGAEGDVNVAIPEGD GTVPQSPKSPSLLRRIGMFFHIHSNEYDVEGKKKKKRRKISFNGKKDKTQIEADTLNDSQ ISVKKDDDNFTIPEANINLPSVEKHVEIDTNLNVAADKNQDVTLPSVGEFNSL >Hydractinia_echinata_HECHI_ENSDJXP00000005068.1 pep Hech_primary_v1.0_JASGCC010000003.1_4502983_4503953_1 gene_ENSDJXG00000003493.1 transcript_ENSDJXT00000005873.1 gene_biotype_protein_coding transcript_biotype_protein_coding MFFHIHSNEYDVEGKKKKKRRKISFNGKKDKTQIEADTLNDSQISVKKDDDNFTIPEANI NLPSVEKHVEIDTNLNVAADKNQDVTLPSVGTGFGAGLQSDVSVLKSTDVAVHSSMADTE ISADAEASAKASAEASAKVSAEGSANLSGDASSDLGGFKANVGGKAFEVKMSF >Hydractinia_echinata_HECHI_ENSDJXP00000005071.1 pep Hech_primary_v1.0_JASGCC010000003.1_4502032_4503953_1 gene_ENSDJXG00000003493.1 transcript_ENSDJXT00000005876.1 gene_biotype_protein_coding transcript_biotype_protein_coding MLIFLRLMCQLGGKGGTDLSAGGAGDIDLPSGSASSPDADGRIEGDVNIKGALKGSKPEI DLDHKKRRDSHSSSSSSDDDDDKKKKKKKDKKGFSFNFKFPFGGGAKTPKNEPVDASKGN SKFYTPDVNVDSPSGDIQAPTAKIEGDTFVTASLDAPSNVNIDAKSPSVDAEIKTDAPKG ELNGSGGADVELPEAEVGVQRSGSFFDRFGGLFKKPKHSSESEDKRGKKRKRTKNQADLK LEADVDVSVGPELKTPATRTSAVGSENDFVILDTPTSPKKSVEINAGAEGDVNVAIPEGD GTVPQSPKSPSLLRRIGMFFHIHSNEYDVEGKKKKKRRKISFNGKKDKTQIEADTLNDSQ ISVKKDDDNFTIPEANINLPSVEKHVEIDTNLNVAADKNQDVTLPSVGTGFGAGLQSDVS VLKSTDVAVHSSMADTEISADAEASAKASAEASAKVSAEGSANLSGDASSDLGGFKANVG GKAFEVKMSF >Hydractinia_echinata_HECHI_ENSDJXP00000056072.1 pep Hech_primary_v1.0_JASGCC010002954.1_23066_24035_1 gene_ENSDJXG00000039683.1 transcript_ENSDJXT00000065226.1 gene_biotype_protein_coding transcript_biotype_protein_coding MFFHIHSNEYDVEGKKKKKRRKISFNGKKDKTQIEADTLNDSQISVKKDDDNFTIPEANI NLPSVEKHVEIDTNLNVAADKNQDVTLPSVGTGFGAGLQSDVSVLKSTDVAVHSSMADTE ISADAEASAKASAEASAKVSAEGSANLSGDASSDLGGFKANVGGKAFEVKMSF >Hydractinia_echinata_HECHI_ENSDJXP00000056074.1 pep Hech_primary_v1.0_JASGCC010002954.1_22091_24035_1 gene_ENSDJXG00000039683.1 transcript_ENSDJXT00000065229.1 gene_biotype_protein_coding transcript_biotype_protein_coding CQGPSVTGDVDIPKANVSAGGKGGTDLSAGGAGDIDLPSGSASSPDADGRIEGDVNIKGA LKGSKPEIDLDHKKRRDSHSSSSSSDDDDDKKKKKKKDKKGFSFNFKFPFGGGAKTPKNE PVDASKGNSKFYTPDVNVDSPSGDIQAPTAKIEGDTFVTASLDAPSNVNIDAKSPSVDAE IKTDAPKGELNGSGGADVELPEAEVGVQRSGSFFDRFGGLFKKPKHSSESEDKRGKKRKR TKNQADLKLEADVDVSVGPELKTPATRTSAVGSENDFVILDTPTSPKKSVEINAGAEGDV NVAIPEGDGTVPQSPKSPSLLRRIGMFFHIHSNEYDVEGKKKKKRRKISFNGKKDKTQIE ADTLNDSQISVKKDDDNFTIPEANINLPSVEKHVEIDTNLNVAADKNQDVTLPSVGTGFG AGLQSDVSVLKSTDVAVHSSMADTEISADAEASAKASAEASAKVSAEGSANLSGDASSDL GGFKANVGGKAFEVKMSF >Hydractinia_echinata_HECHI_ENSDJXP00000055798.1 pep Hech_primary_v1.0_JASGCC010003360.1_17534_24199_-1 gene_ENSDJXG00000039451.1 transcript_ENSDJXT00000064886.1 gene_biotype_protein_coding transcript_biotype_protein_coding MDGPDVDFDGKGKIDVGGGVDVDTPDAKASLDAPDIDVKAGGGVSLPDADLDLKGDVKVP DADLKGPDVGGGIGLGFGRRGSHSSSDDDDDKKKKKKKDKGKGGFGFNMPNVNLPSFGGG GKGKMDGPGVDFDGKGKIDVGAGVDVNAPDAKASLDTPDIDVKSGGGVSLPDADLNLKGD VKVPDADLKGPDVGGGIGLGFGRRGSHSSSDDDDDYKKKKKKKKDKGKGGFGFKMPHVNF PSFGGSGKGKMDGPDVDFDGKGKIDVGAGVDVNAPDVKASLDAPDIDVKSGGGVSLPDAD LNLKGDVKVPDADLKGPDVGGGIGLGFGRRGSHSSSDDDDDKKKKKKKDKGKGGFGFNMP NVNLPSFGGSGKGKMDGPDVDLDGKGKVDVDVSTPDVDVKAGGGVPLPDADLNVKGADVK GDVKFADTDSSSSSSDDDKKKKKKDKKGSGFKFPGFNFGGKGDVKGPSVSGDIDIPKTGA STGVKGGAGDVDLPSGDISLPKADGKIDSDVNIKGDLKGKHKKRRDSQSSSSSSDDDDDK KKKKKKDKKGSGFKFPTIGAHGDVKGPSVTGDVDIPKANVSAGGKGGTDLSAGGAGDIDL PSGSASSPDADGRIEGDVNIKGALKGSKPEIDLDHKKRRDSHSSSSSSDDDDDKKKKKKK DKKGFSFNFKFPFGGGAKTPKNEPVDASKGNSKFYTPDVNVDSPSGDIQAPTAKIEGDTS VTASLDAPSNVNIDAKSPSVDAEIKTDAPKGELNGSGGADVELPEAEVGVQRSGSFFDRF GGLFKKPKHSSESEDKRGKKRKRTKNQADLKLEADVDVSVGPELKTPATRTSAVGSENDF VILDTPTSPKKSVEINAGAEGDVNVAIPEGDGTVPQSPKSPSLLRRIGMFFHIHSNEYDV EGKKKKKRRKISFNGKKDKTQIEADTLNDSQISVKKDDDNFTIPEANINLPSVEKHVEID TNLNVAADKNQDVTLPSVGTGFGAGLQSDVSVLKSTDVAVHSSMADTEISADAEASAKAS AEASAKVSAEGSANLSGDASSDLGGFKANVGGKAFEVKMSF >Hydractinia_symbiolongicarpus_HSYMB_HSymV2.0_g14.24811_t1 MPHVNFPSFGGSGKGKVDGPDVDFDGKGKVDVGGGVDVKTPDAKASIDAPDVNVKAGGGM SLPDADLNVKGDVKVPDADLSGDADVNGPDVGGGIGLGFGRRGSHSSSDDDDDKKKKKKK DKGRGGFGFNMPSVNLPSFGGGGKGKMDGPDVDFGGKGKIDVGGGVDVNTPDAKASLDAP DIDVKAGGGVSLPDADLKLEGDVKVPDADLKGPDVGGGIGLGVGRRGSHSSSDDDDDKKK KKKKDKGKGGFGFNMPSVNLPSFGGGGKGKMDGPDVDFDGKGKIDVGGGVDVNTPDAQAS LDAPDIDVKAGGGVSLPDADLNLKGDVKVPDADLKGPDVRGGIGLGVGRRGSHSSSDDDD GDKKKKKKKKDKGKGGFGFKMPHVNFPSFGGSGKGKVDGPDVDFDGKGKVDVGGGVDVKT PDAKASIDAPDVNVKAGGGMSLPDADLNVKGDVKVPDADLSGDADVNGPDVGGGIGLGFG RRGSHSSSDNDDDKKKKKKKDKGKGGFGFNMPSVNLPSFGGGGKGKMDGPDVDFDGKGKI DVDVNTPDAQASLNAPDIDVKAGGGVSLPDADLSLKGDVKGPDVGGDGYVDLPSGDISVR KADGKIDSDVNIKGDLKGRHKKRRGSQSSSSSSDDDDNKMKKKKKDKKGSVSGDVDIPKT DASSGVKGGGGDVDLPSGDISLPKADGKIDSDVNIKGDLKGKHKKRRDSQSSSSSSDDDD DKKKKKKKDKKGSGFNFPTIGAHGDVKGPSVTGDVDIPKANVSAGGKGDTDLSAGGAGDI HLPSGSASSPDADGRIEGDVNIKGALKGSKPEIDLDHKKRRDSHSSSSSSDDNDDKKKKK KKDKKGNKGFSFNFKFPFGGGAKTARNEPVDASAKGNSKFYTPDVNVDSPSGDIQAPTAK IEGDTSVTASLDAPSNVNIDSKSPSVDAEIKTDTPKGELNGSGGADVELAEVGVQRSGSF FDRFGGLFKKPKHSSESEDKRGKKRKRTKNQADLKLESDVDVSAGPELKTPATRTSAVGS ENDFVILDTPTSPKKAVEINAGAEGDVNVAIPEGDGTVPQSPKSPSLLRRIGMFFHIHSN EYDVEGKKKKKRRKISFNGKKDKTQIEADTLNDSQVSVKKDDDNFTIPEANINLPSVEKH VEIDTNLNVAADKNQDVTLPSVGTSGFGAGLQSDVSVLKSTDVAVDSSIADTGISDDAEA SAKASSEASVKASAEASAKLSAEGSANLSGEASSDLGGFKANVGGKAFEVKMSF >Millepora_alcicornis_MALCI_ENSCIQP00000008947.1 pep jhMilAlci5.1_14_66453359_66580821_1 gene_ENSCIQG00000008294.1 transcript_ENSCIQT00000010460.1 gene_biotype_protein_coding transcript_biotype_protein_coding gene_symbol_AHNAK description_"AHNAK nucleoprotein [Ensembl NN prediction with score 86.77%]" MPKESQNRILIGEKTLNSLLNIKKKERELGDQSTEYNPSSPITAELFSESHTSTMETPSV INRGQNVSISINMNGQDSDRSAVVEDSIEAEVKADVESEVNVDFSTFGDANIEVSKVDDK EEKKEKKKKKKKKKKGFFDKVGDFFDDSSSSSSSSSSSSSSSSSSDEDDDKEKEKKKKKK KKVKGAIDGNTSGAADSSVAGGIAIGAPKVGIDSSVSGGISVDTSDVDIKTDTAPTVDIN GGGSTDLSGGFGVNGGIEGDGGFSPGGIIDSGVSLNIPNIENKEIIVEDDLSEHRSIDKP ALDFNGGIAQDGKIDFGMDLDELVNAPIQVETVESSPQLADLTVSDIEGEIIAPSVEANV ECTPDLSEEIIAPTQEVENEMLPSGFSFGVSADTSNENENIGGGFGFGFGKSKGDSDNED GGKEKNDEKGIGFGLPSFGIGGKEKGEVGVKVPDPDVNVDGKMGVNINSPDIKADLSEPD TNVSTGYGIDLPKGEINLKGPSVETPAIGTTGNVDLDLPKRDIDVKAPSIKMPDVNVPKT DADLSGDVDIKGPEVGGGFGFGFGKSKTDSDDEGESKEKKDKEGFGSGLPSFGIGGKGKE EVDVKVPDTDLNVDGKAAVDIDSPDINADLSGPDTSVSAGYGIDLLKGEINLEGPSVEAP AIDTTGNVDLDLPKGDISVKAPSIETPDVNVPKTDADVSGDVDLKGPKVGGGFGFGKSKG DSDDEDQSKEKKKKKGFGIGLPSFGIGGKGKGEVDVKVPDADLNVDGKTGVDIDSPDIKA DVSGPDTNVSAGYGIDMPKGDISLKGPSVETPGIGTTGNVDLDLPEGDINLKSPNIEASD VNVPKTDADFSGDVDLKGPKVGGGFGFGFGKSKGDSDDEDQSKEKKEKKGFGFGLPSFGI GGKGKGEVDVKVPDADLSVDDKLGGDVDTPDLKPNLSGPDTNVSVDAGIELPKGDVNAEG LSIEKTDVSLPKADADISGDVDIETPKVGGGFGFGFGKGKSDSDSEDDNKKKKEGGGFGF NLPSFGGGVKGNSDIEGPDVNTLGGGIKADISGPNVSLSTDADISIAKVDGDRSRDIDIK GTDVGGEFGFARDKGDSDTEDADKKKKKKKERGSFGFGIKMPKFGGKSKASGNIDGPEVD IDAPGKIDIDPKGSLGVDAPEVNANVDKPNVNISSSADIEIPKGDVDVSAPNLNMKGGDG SLPEADISGGVDLEGPKVSGGIGFGLGKEKDHPDSDDEGKDKKKKKKSGFGFSFKKPKIH GPRFSGSGKGGVDIDGPDLDVKGDVDVNTPSAKATVDTPDLDVSSGNVKLPEGDVKLEKP DVDLKDVQAPDADISGDVSVKGPDLGGGFGVGFGKDKDHSGDDSDHDKDKKKKKKDKGGF GFKMPKFHGPSFGGGAKGNVDLDNPEANVDLDSKREIDVDAPEIKGSIGKPDLDVSAGGD VKLPEGGVKVDTPDIDLPGGQVKAPDTGVSGNIDVNGPDANIKGPDVGGGFGIGFGKDKD HSDSDDDDDDKKDKKKKKKDKGGFGFGFKMPKFHGPNFGGGVKGDADIDGPEAKLDIGGK GGIDVESPEIKASVDKPDLDVSTSSDVKLPEGDIKVEAPDVDVKGGNVKGPDADLSGKVD VKGPDVGGGFGIGFGKDKDHSDSDDDDDDEKDKKKKKKDKGGFGFKMPKFHGPSFGGGGK GDVDIDGPKGNIDVGSKGEIDVDVPEIKASLDKPDTDVSAGGELKLPEADLKVDKPDVDL PGGQVKAPNADLSGDVNVKGPDVDVKGPDIGGGFGIGFGKGKDQSDSDDDEKDKKKKKKD KGGFGFGFKMPKFHGPSFGGGSKGNVDIDGPEGNLDLGAKGGINVDAPDVKASGEKPDLD VSAGGDIKLPEGDVKVEKPDVSLKGGDIKTPNVDLSGDIDVKGPDVNVKGPDVGGGFGVG FVKDKDDSDSDDDDKEKKKKKKDKSGFGFGFKMPKFHGPSFGGGAKGDVDIDSPEGNLDI GGKVGADLNTPEIKASLNKPDVDVSASADVELPKGDIKGRDMSVPDTDLSGEVDVKNLKV GGGVNVGFSKSKDDSDSEDEDKDKKKKKKNKGFGFSFKKPKIHGPRFGGSGKGGADIDGP GFENKGDIDINAPEIKANLDAPEVDVSAGSDVKLPEGDVKVDTPDIDLPGGQVKAPDPNA SLSGNVDVNGPDANIKGPDVGGGFGIGFGKDKDHSDSDDDDDDKKDKKKKKKDKGGFGFG FKMPKFHGPNFGGGVKGDADIDGPEAKLDIGGKGGIDVESPEIKASVDKPDLDVSASSDV KLPEGDIKVEAPDVDVKGGNVKGPDADLSGKVDVKGPDVGGGFGIGFGKDKDHSDSDGDD DDVKDKKKKKKDKGGFGFGLKMPKFHGPSFGGGGKVEGDLDSPNADIDVNSKLDADVGKE DLKADVEKPDIDVSAEGDLKTPEGDVSLEMDGDGGKKKKRGGSFKFGFKKPLFGDSGKQK PEKESKEFAARAEGDLSGPDVKVDGDADIDLKGPKVELDLDGKKKRKDSVTSNSSSSDDE GEKDKKKKKKKEKKGGGFGFGLSLPSFGGGVKGSSGDVSVEGPDAELSGGMKRDNNLDVE GSTDVPKTDFGTPDVTMDNGANTDLKHTKVEGDVDVNLKGSKTSGDGDIELKGPGASFDY DSKKKRRDSSTSTSSSSGDEKDKGKKKKKKKDKKGGGFGFGIKMPSFGGGVKGVSGDTSV EVPDADLSSDVKRVSDVDIEGSVKGPDLNVSDPNVKLEGDADIGLKGPKTGGDVEGPTVG GDADINLKGPKVNLDFDGKKKRKDSATSTSSSSDDEGKKKKKKKGGGFGLGFNLPSFGSG AKGPSGDVSMKGPDANLSGGVKADVDLNVAGSLGEPNANVSVPDVKVSGDTDIDVKEPKV GGNTGIGLKSPTIEGKKDGEIDVAVPKGKVDADISGDIGRTSSNSSASSKDKKKNKGFGF SFKFPKFKFGGKSSVDADADLKKPSGKIDADVNVPTAKLDTDISLEADKPSGNYSGDVKT PTLGGDMDIKPPKIDGGSIAPDVNADLNADVGGKVPKIDTDLGITTPEVGGNVGMSGKTD IDVKNPNDGTAVDFNLAKTGVDEDVNTPKMDVPVSSGSPSVEGDVDIKTPKVDADVDVDI KEPKIGLEGDMNVRKKKKKAKSGFGFKFGGSHQKSDSKFYDGDKPEANINVSEPAASGQI DIDTPEVSGETAKVGEVDTSNVSADINEDVPNPEIKTNVKRSGSFLGKLGGFFKGDKKKR GKKRKLDGDSKFYEPSGSVDVDLKGDASASATLPSAENETDFVIVSTPDSPRKDGNTEVN APLSADADFQMTDKYEKPKSPSLLRRIGMFFHIHSGGFDVEGESKKKKRKTAETKSGKFK SDIDIETQSHESSVKREDSFTIPEATLPSAQVALPSASTEEKPSSVQVAVPNVQLEDSDT KMDVEKPHLAVGSTSASSDVEMSSPGVDVGISDAASGGIMGGIASENDTEKSIGVTSAEI SDNKTSAFGGGIGGGISGGFSADVGGSSKSDNALSLDKDISIGGDSKVDTSGGISLDSQS SIATGSALGVGANASVGGDLSASASATPSGSTGASVGGELGNINAEVGGKAFEIKMSF >Millepora_complanata_MCOMP_ENSODKP00000015616.1 pep jhMilComp2.1_14_96152755_96207432_-1 gene_ENSODKG00000012235.1 transcript_ENSODKT00000017285.1 gene_biotype_protein_coding transcript_biotype_protein_coding MNIYHSELVIQPKVRGSYPKSPSHTSTMETPSVINRGQNVSISINMNGQDSDRSAVVEDS IEAEVKADVESEVNVDFSTFGDANIEVSKVDDKEEKKEKKKKKKKKKKGFFDKVGDFFDD SSSSSSSSSSSSSSSSSSDEDDDKEKEKKKKKKKKVKGAIDGNTSGAADSSVAGGIAIGA PKVGIDSSVSGGISVDTSDVDIKTDTAPTVDINGGGSTDLSGGFGVNGGIEGDGGFSPGG IIDSGVSLNIPNIENKEIIVEDDLSEHRSIDKPALDFNGGIAQDGKIDFGMDLDELVNAP IQVETVESSPQLADLTVSDIEGEIIAPSVEANVECTPDLSEEIIAPTQEVENEMLPSGFS FGVSADTSNENENIGGGFGFGFGKSKGDSDNEDGGKEKNDEKGIGFGLPSFGIGGKGKGE VDVKVPDPDVNVDGKMGVNINSPDIKADLSEPDTNVSTGYGIDLPKGEINLKGPSVETPA IGTTGNVDLDLPKGDIDVKAPSIKMPDVNVPKTDADLSGDVDIKGPEVGGGFGFGFGKSK TDSDDEGESKEKKDKEGFGSGLPSFGIGGKGKEEVDVKVPDTDLNVDGKAAVDIDSPDIN ADLSGPDTSVSAGYGIDLLKGEINLEGPSVETPAIDTTGNVDLDLPKGDISVKAPSIETP DVNVPKTDADVSGDVDLKGPKVGGGFGFGKSKGDSDDEDQSKEKKKKKGFGIGLPSFGIG GKGKGEVDVKVPDADLNVDGKTGVDIDSPDIKADVSGPDTNVSAGYGIDMPKGDISLKGP SVETPGIGTTGNVDLDLPEGDINLKSPNIEASDVNVPKTDADFSGDVDLKGPKVGGGFGF GFGKSKGDSDDEDQSKEKKEKKGFGFGLPSFGIGGKGKGEVDVKVPDADLGVDDKLGGDV DTPDLKPNLSGPDTNVSVDAGIELPKGDVNAEGLSIEKTDVSLPKADADISGDVDIETPK VGGGFGFGFGKGKSDSDSEDDNTKKKEGGGFGFNLPSFGGGVKGNSDIEGPDVNTLGGGI KADISGPNVSLSTDADISIAKVDGDRSRDIDIKGTDVRGEFGFARDKGDSDTEDADKKKK KKKERGSFGFGIKMPKFGGKSKASGNIDGPEVDIDAPGKIDIDPKGSLGVDTPEVNANVD KPNVNISSSADIEIPKGDVDVSAPNLNMKGGDGSLPEADISGGVDLEGPKVSGGIGFGLG KEKDHPDSDDEGKDKKKKKKSGFGFSFKKPKIHGPRFGGSGKGGVDIDGPDLDVKGDVDV NTPSAKATVDTPDLDVSSGNVKLPEGDVKLEKPDVDLKDVQAPDADISGDVSVKGPDLGG GFGVGFGKDKDHSGDDSDHDKDKKKKKKDKGGFGFKMPKFHGPSFGGGAKGNVDLDNPEA NLDLDSKREIDVDAPEIKGSIGKPDLDVSAGGDVKLPEGGVKVDTPDIDLPGGQVKAPDT GVSGNIDVNGPDANIKGPDVGGGFGIGFGKDKDHSDSDDDDDDDDDDDKKEKKKKKKDKG GFKFGLKMPKFHGPNFGGGVKGDADIDGPEAKLDIGGKGGIDVESPEIKASVDKPDLDVS ASSDVKLPEGDVGGGFGIGFGKDKDHSDSDDDDDDDKEKKKKKKGKGGFKFELKMPKFHG PNFGGGVKGDADIDGPEAKLDIGGKGGIDVESPEIKASVDKPDLDVSASSDVKLPEGDIK VEAPDVDVKGGNVKGPDADLSGKVDVKGPDVGGGFGIGFGKDKDHSDSDDDDEKDKKKKK KDKGGFGFGLKMPKFHGPSFGSGGKGDVDIDGPKGNIDVDGKGEIDVDVPEFKASLDKPD TDVSAGGELKLPEADVKVDKPDMDLPGGQVKASDADLSGDVNVKGPDVGGGFGIGFGKGK DHSDSDDDEKDKKKKKKDKGGFGFGFKMPKFHGPSFGGGGKGNVDIDGPEGNIDIGAKGG INVDAPEVKASGEEPDLDVSAGGDIKLPEGDVKLETPDVSLKGSDIKTPNGDVDVKRADV GGGFGIGLGKDKDHSDSDDDEKGKKKKKKDKGGFGFSIKMPKFHGPSFGGGAKGNVDVDN PEANVDLDSKREIDVDAPEIKGSIGKPDLDVSAGGNEKLPGGVKVDTPDIDLPGGQVKAP DTGVSGNIDVNGPDANIKGPDVGGGFGIGFGKDKDHSDSDDDGDDKKEKKKKKKDKGGFG FGFKMPKFHGPSFGGGVKGDADIDGPEAKLDIGGKGGIDVESPEIKASVDKPDLDVSTSS DVKLPEGDIKVEAPDVDVKGGNVKGPDADLSGKVDVKGPDVGGGFGIGFGKDKDHSDSDD DDDDEKDKKKKKKDKGGFGFGLKMPKFHGPSFGGGGKGDVDIDGPKGNIDVGSKGEIDVD VPEFKASLDKPDTDVSAGGELKLPEADLKVDKPDMDLPGGQVKAPNADLSGDVNVKGPDV DVKGPDIGGGFGIGFGKGKDQSDSDDDEKDKKKKKKDKGGFGFGFKMPKFHGPSFGGGSK GNVDIDGPEGNLDLGAKGGINVDAPDVKASGEKPDLDVSAGGDIKLPEGDVKVEKPDVSL KGGDIKTPNVDLSGDIDVKGPNVNVKGPDVGGGFGVGFVKDKDDSDSDDDDKEKKKKKKD KSGFGFGFKMPKFHGPSFGGGAKGDVDIDSPEGNLDIGGKVGADLDTPEIKASLNKPDVD VSASADVELTKGDIKGRDVSVPDIDLSGEVDVKNLKVGGGVNVGFSKSKDDSDSEDEDKD KKKKKKNKGFGFSFKKPKIHGPRFGGSGKGGADIDRPGFENKGDIDINAPEIKANLDAPE VDVSAGSDVKLPEGDVKVDTPDIDLPGGQMKAPDPNASLSANVDVNGPDANIKGPDVGGG FGIGFGKDKDHSDSDDDDDDKKDKKKKKKDKGGFGFGFKMPKFHGPNFGGGVKGDADING PEAKLDIGGKGGIDVESPEIKASVDKPDLDVSASSDVKLPEGDIKVEAPDVDVKGGNVKG PDADLSGKVDVKGPDVGGGFGIGFGKDKDHSDSDGDDDDEKDKKKKKKDKGGFGFGLKMP KFHGPSFGGGGKVEGDLDSPNADIDVNSKLDADVGKEDLKADVEKPDIDVSAEGDLKTPE GDVSLEMDGDGGKKKKRGGSFKFGFKKPLFGDSGKQKPEKESKEFAARAEGDLSGPDVKV DGDADIDLKGPKVELGLDGKKKRKDSVTSNSSSSDDEGEKDKKKKKKKEKKGGGFGFGLS LPSFGGGVKGSSGDVSVEGPDAELSGGMKRDNNLDVEGSTDVPKTDFGTPDVTMDNGANT DLKHTKVEGDVDVNLKGSKTSGDGDIELKGPEASFDYDSKKKRRDSSTSTSSSSGDEKDK GKKKKKKKDKKGGGFGFGIKMPSFGGGVKGVSGDTSVEVPDADLSSDVKRVSDVDIEGSV KGPDLNVSDPNVKLEGDADIGLKGPKTGGDVEGPTVGGDADINLKGPKVNLDFDGKKKRK DSATSTSSSSDDEGKKKKKKKEKKGGGFGLGFNLPSFGSGAKGPAGDVSMKGPDANLSGG VKADVDLNVAGSLGEPNANVSVPDVKVSGDTDINLKEPKVGGNTGIGLKSPTIEGKKDGE IDVAVPKGKVDADISGDIGRTSSNSSASSKDKKKNKGFGFSFKLPKFKFGGKSSVDADAD LKKPSGKIDTDVNVPTAKLDTDISLEADKPSGNYSGDVKTPTLGGDMDIKPPKIDGGSIA PDVNADLNADVGGKVPKIDTDLGITTPEVGGNVGMSGKTDIDVKNPNDETAVDFNLAKTG VDEDVNTPKMDVPVSSGSPSVEGDVDIKTPKVDADVDVDIKEPKIGLEGDMNVRKKKKKA KSGFGFKFGGSHQKSDSKFYDGDKPEANINVSEPVASGQIDIDTPEVSGETAKVGEVDTS NVSADINEDVPNPEIKTNVKRSGSFLGKLGGFFKGDKKKRGKKRKLDGDSKFYEPSGSVD VDLKGDASASATLPSAENETDFVIVSTPDSPRKDGNTEVNAPLSADADVQMTDKYEKPKS PSLLRRIGMFFHIHSGGFDVEGESKKKKRKTAETKSGKFKSDIDIETQSHESSVKREDSF TIPEATLPSAQVALPSASTEEKPSSVQVAVPNVQLEDSDTKMDVEKPHLAVGSTSASSDV EMSSPGVDVGISDAVSGGITGGIASENDTEKSIGVTSAEISDNKTSAFGGGIGGGISGGF SADVGGSSKSDNALSLDKDISIGGDSKVDTSGGISLDSQSSIATGSALGVGANASVGGDL SASASATPSGSTGASVGGELGNINAEVGGKAFEIKMSF >Millepora_complanata_MCOMP_ENSODKP00000015624.1 pep jhMilComp2.1_14_96191557_96254258_-1 gene_ENSODKG00000012235.1 transcript_ENSODKT00000017293.1 gene_biotype_protein_coding transcript_biotype_protein_coding MPKKKSKRKPGAQCRNPDTARLVAVSHTSTMETPSVINRGQNVSISINMNGQDSDRSAVV EDSIEAEVKADVESEVNVDFSTFGDANIEVSKVDDKEEKKEKKKKKKKKKKGFFDKVGDF FDDSSSSSSSSSSSSSSSSSSDEDDDKEKVSGPYVFSDNTS >Millepora_complanata_MCOMP_ENSODKP00000015630.1 pep jhMilComp2.1_14_96152755_96202148_-1 gene_ENSODKG00000012235.1 transcript_ENSODKT00000017300.1 gene_biotype_protein_coding transcript_biotype_protein_coding METPSVINRGQNVSISINMNGQDSDRSAVVEDSIEAEVKADVESEVNVDFSTFGDANIEV SKVDDKEEKKEKKKKKKKKKKGFFDKVGDFFDDSSSSSSSSSSSSSSSSSSDEDDDKEKE KKKKKKKKVKGAIDGNTSGAADSSVAGGIAIGAPKVGIDSSVSGGISVDTSDVDIKTDTA PTVDINGGGSTDLSGGFGVNGGIEGDGGFSPGGIIDSGVSLNIPNIENKEIIVEDDLSEH RSIDKPALDFNGGIAQDGKIDFGMDLDELVNAPIQVETVESSPQLADLTVSDIEGEIIAP SVEANVECTPDLSEEIIAPTQEVENEMLPSGFSFGVSADTSNENENIGGGFGFGFGKSKG DSDNEDGGKEKNDEKGIGFGLPSFGIGGKGKGEVDVKVPDPDVNVDGKMGVNINSPDIKA DLSEPDTNVSTGYGIDLPKGEINLKGPSVETPAIGTTGNVDLDLPKGDIDVKAPSIKMPD VNVPKTDADLSGDVDIKGPEVGGGFGFGFGKSKTDSDDEGESKEKKDKEGFGSGLPSFGI GGKGKEEVDVKVPDTDLNVDGKAAVDIDSPDINADLSGPDTSVSAGYGIDLLKGEINLEG PSVETPAIDTTGNVDLDLPKGDISVKAPSIETPDVNVPKTDADVSGDVDLKGPKVGGGFG FGKSKGDSDDEDQSKEKKKKKGFGIGLPSFGIGGKGKGEVDVKVPDADLNVDGKTGVDID SPDIKADVSGPDTNVSAGYGIDMPKGDISLKGPSVETPGIGTTGNVDLDLPEGDINLKSP NIEASDVNVPKTDADFSGDVDLKGPKVGGGFGFGFGKSKGDSDDEDQSKEKKEKKGFGFG LPSFGIGGKGKGEVDVKVPDADLGVDDKLGGDVDTPDLKPNLSGPDTNVSVDAGIELPKG DVNAEGLSIEKTDVSLPKADADISGDVDIETPKVGGGFGFGFGKGKSDSDSEDDNTKKKE GGGFGFNLPSFGGGVKGNSDIEGPDVNTLGGGIKADISGPNVSLSTDADISIAKVDGDRS RDIDIKGTDVRGEFGFARDKGDSDTEDADKKKKKKKERGSFGFGIKMPKFGGKSKASGNI DGPEVDIDAPGKIDIDPKGSLGVDTPEVNANVDKPNVNISSSADIEIPKGDVDVSAPNLN MKGGDGSLPEADISGGVDLEGPKVSGGIGFGLGKEKDHPDSDDEGKDKKKKKKSGFGFSF KKPKIHGPRFGGSGKGGVDIDGPDLDVKGDVDVNTPSAKATVDTPDLDVSSGNVKLPEGD VKLEKPDVDLKDVQAPDADISGDVSVKGPDLGGGFGVGFGKDKDHSGDDSDHDKDKKKKK KDKGGFGFKMPKFHGPSFGGGAKGNVDLDNPEANLDLDSKREIDVDAPEIKGSIGKPDLD VSAGGDVKLPEGGVKVDTPDIDLPGGQVKAPDTGVSGNIDVNGPDANIKGPDVGGGFGIG FGKDKDHSDSDDDDDDDDDDDKKEKKKKKKDKGGFKFGLKMPKFHGPNFGGGVKGDADID GPEAKLDIGGKGGIDVESPEIKASVDKPDLDVSASSDVKLPEGDVGGGFGIGFGKDKDHS DSDDDDDDDKEKKKKKKGKGGFKFELKMPKFHGPNFGGGVKGDADIDGPEAKLDIGGKGG IDVESPEIKASVDKPDLDVSASSDVKLPEGDIKVEAPDVDVKGGNVKGPDADLSGKVDVK GPDVGGGFGIGFGKDKDHSDSDDDDEKDKKKKKKDKGGFGFGLKMPKFHGPSFGSGGKGD VDIDGPKGNIDVDGKGEIDVDVPEFKASLDKPDTDVSAGGELKLPEADVKVDKPDMDLPG GQVKASDADLSGDVNVKGPDVGGGFGIGFGKGKDHSDSDDDEKDKKKKKKDKGGFGFGFK MPKFHGPSFGGGGKGNVDIDGPEGNIDIGAKGGINVDAPEVKASGEEPDLDVSAGGDIKL PEGDVKLETPDVSLKGSDIKTPNGDVDVKRADVGGGFGIGLGKDKDHSDSDDDEKGKKKK KKDKGGFGFSIKMPKFHGPSFGGGAKGNVDVDNPEANVDLDSKREIDVDAPEIKGSIGKP DLDVSAGGNEKLPGGVKVDTPDIDLPGGQVKAPDTGVSGNIDVNGPDANIKGPDVGGGFG IGFGKDKDHSDSDDDGDDKKEKKKKKKDKGGFGFGFKMPKFHGPSFGGGVKGDADIDGPE AKLDIGGKGGIDVESPEIKASVDKPDLDVSTSSDVKLPEGDIKVEAPDVDVKGGNVKGPD ADLSGKVDVKGPDVGGGFGIGFGKDKDHSDSDDDDDDEKDKKKKKKDKGGFGFGLKMPKF HGPSFGGGGKGDVDIDGPKGNIDVGSKGEIDVDVPEFKASLDKPDTDVSAGGELKLPEAD LKVDKPDMDLPGGQVKAPNADLSGDVNVKGPDVDVKGPDIGGGFGIGFGKGKDQSDSDDD EKDKKKKKKDKGGFGFGFKMPKFHGPSFGGGSKGNVDIDGPEGNLDLGAKGGINVDAPDV KASGEKPDLDVSAGGDIKLPEGDVKVEKPDVSLKGGDIKTPNVDLSGDIDVKGPNVNVKG PDVGGGFGVGFVKDKDDSDSDDDDKEKKKKKKDKSGFGFGFKMPKFHGPSFGGGAKGDVD IDSPEGNLDIGGKVGADLDTPEIKASLNKPDVDVSASADVELTKGDIKGRDVSVPDIDLS GEVDVKNLKVGGGVNVGFSKSKDDSDSEDEDKDKKKKKKNKGFGFSFKKPKIHGPRFGGS GKGGADIDRPGFENKGDIDINAPEIKANLDAPEVDVSAGSDVKLPEGDVKVDTPDIDLPG GQMKAPDPNASLSANVDVNGPDANIKGPDVGGGFGIGFGKDKDHSDSDDDDDDKKDKKKK KKDKGGFGFGFKMPKFHGPNFGGGVKGDADINGPEAKLDIGGKGGIDVESPEIKASVDKP DLDVSASSDVKLPEGDIKVEAPDVDVKGGNVKGPDADLSGKVDVKGPDVGGGFGIGFGKD KDHSDSDGDDDDEKDKKKKKKDKGGFGFGLKMPKFHGPSFGGGGKVEGDLDSPNADIDVN SKLDADVGKEDLKADVEKPDIDVSAEGDLKTPEGDVSLEMDGDGGKKKKRGGSFKFGFKK PLFGDSGKQKPEKESKEFAARAEGDLSGPDVKVDGDADIDLKGPKVELGLDGKKKRKDSV TSNSSSSDDEGEKDKKKKKKKEKKGGGFGFGLSLPSFGGGVKGSSGDVSVEGPDAELSGG MKRDNNLDVEGSTDVPKTDFGTPDVTMDNGANTDLKHTKVEGDVDVNLKGSKTSGDGDIE LKGPEASFDYDSKKKRRDSSTSTSSSSGDEKDKGKKKKKKKDKKGGGFGFGIKMPSFGGG VKGVSGDTSVEVPDADLSSDVKRVSDVDIEGSVKGPDLNVSDPNVKLEGDADIGLKGPKT GGDVEGPTVGGDADINLKGPKVNLDFDGKKKRKDSATSTSSSSDDEGKKKKKKKEKKGGG FGLGFNLPSFGSGAKGPAGDVSMKGPDANLSGGVKADVDLNVAGSLGEPNANVSVPDVKV SGDTDINLKEPKVGGNTGIGLKSPTIEGKKDGEIDVAVPKGKVDADISGDIGRTSSNSSA SSKDKKKNKGFGFSFKLPKFKFGGKSSVDADADLKKPSGKIDTDVNVPTAKLDTDISLEA DKPSGNYSGDVKTPTLGGDMDIKPPKIDGGSIAPDVNADLNADVGGKVPKIDTDLGITTP EVGGNVGMSGKTDIDVKNPNDETAVDFNLAKTGVDEDVNTPKMDVPVSSGSPSVEGDVDI KTPKVDADVDVDIKEPKIGLEGDMNVRKKKKKAKSGFGFKFGGSHQKSDSKFYDGDKPEA NINVSEPVASGQIDIDTPEVSGETAKVGEVDTSNVSADINEDVPNPEIKTNVKRSGSFLG KLGGFFKGDKKKRGKKRKLDGDSKFYEPSGSVDVDLKGDASASATLPSAENETDFVIVST PDSPRKDGNTEVNAPLSADADVQMTDKYEKPKSPSLLRRIGMFFHIHSGGFDVEGESKKK KRKTAETKSGKFKSDIDIETQSHESSVKREDSFTIPEATLPSAQVALPSASTEEKPSSVQ VAVPNVQLEDSDTKMDVEKPHLAVGSTSASSDVEMSSPGVDVGISDAVSGGITGGIASEN DTEKSIGVTSAEISDNKTSAFGGGIGGGISGGFSADVGGSSKSDNALSLDKDISIGGDSK VDTSGGISLDSQSSIATGSALGVGANASVGGDLSASASATPSGSTGASVGGELGNINAEV GGKAFEIKMSF >Millepora_dichotoma_MDICH_ENSYDOP00000012777.1 pep jhMilDich1.1_14_83099131_83162346_1 gene_ENSYDOG00000009148.1 transcript_ENSYDOT00000013163.1 gene_biotype_protein_coding transcript_biotype_protein_coding gene_symbol_AHNAK description_"AHNAK nucleoprotein [Ensembl NN prediction with score 91.11%]" METPSVINPGQNVSISINMNGQDSDRSAVVEDSIEAEVKADVESEVNVDFSKFGDANVEV SKVDDKEEKKEKKKKKKKKKGFFDKVGDFFDSSSSSSSSSSSSSSSSSSSDEDDNKEKEK KKKKKKKVKGAIDGKASGTADSSVAGDITIGAPKVGIDSSVSGGIGVDTPNVDIETDTAP TVNINGGGSADLSGGLGVNGAIEGEGGFSPGGIIDSDVSLNIPNIEKKEVIVEDDLSELR SVDKPALDFNGGIAQDGKIDFGIDLDELVNAPVQVGNVESSPQFADLTVSDIEGEVIAPS VEANVECTPDLSEEIIAPTQELENEMLPFGFSFGVSADTSNENENIGGGFGFGFGKSKGD SDNEDGGKEKNDEKSFGFGLPSFGIGGKGKGEADVKVPDPDLNVDGKMGVDIKSPDIKAD LSGPDTNVSAGYGVELPKAEINLEGPSAETPAIRTIVNFDLDLPKGDMDVKAPSIETPDV NVPKTGANLSGDVDLTGPKVGGGFGFGKSKGDSDDEGENKEKKDKEGFGFGLPSFGIGGK GNGEVDVKVPDIDLNLDGKVDLDIDSPDIKAAVSGPDTNVAAGYGIDLPKGDTNLEGPSA ETPGIGTKGSFDLDLPKGDTDVKAPNIETPDVYVPKTNADISGDMDLKGPKIGGGGFGFG FGKSKEYSDDEGESKEKKDKEGFGFGLPSFGIGGKGKGEVDVKVPDANLNVDGKAAIDID SPDIKADISGPDTSVSTGYGTDMPKGDINLKGPSVETPSIATTGNADLDLPKGDINVNGP SIETPDVYVPKTDTYLSRDVDLKGPKVGGGFGFGFGKIKGDSDDEDESKEKKDKKGLEFG VPSFGIGGKGNGEVDVKVPGADLSVDGKLGGDIDSPDIKSAVSGPDTNISADAGIELPKS DVNAAGLSVEKTDVTLPKTDANISGDVDIEAPKVGGGFGLGFGKGKSDSDSDDDNKKKKE GGGFGFNLPSFGGKVKGDPNIEGPHVNTLGGDIGSDIKTDIRGPNSSVSADADISMPKVD GDRSGDIDIKGVDIGAGFGFARDKGDSDTEDADKKKKKKKERGSFGFSIKMPKFGGKGKT SGNIDGPEVDIDAPGKIDIDPKGSLGVDAPEVNTNVDKPNANISSSADIELPKGDVDVNA PNLNMKGGDGSLPEADISGDVDLEGPKVSGGIGFGLGKEKDHPDSDDEGKDKKKKKKSGF GFSFKKPKIHGPRFGGSGKGGVDIEGPDLDVKEDVDVTTPSAKATVDTPNLDVSSGNVNL PEGDVKLEKPDVDLEDVQAPDADMSGDVNVKGPDLGGGFGVGFGKDKDHSDDDNDDDMPK FRGPSFGGGKGDLQSAEANNSSIDVKTPGIKKNLDTPDLDVDIDLKGPKDKKKKKKDKGG FGFKMPKFHGPSFGGGAKGNVDIDNPEANLDIDSEGGFDVDAPKIKGSIGKPDLEVSAGG DVKLPGDVKVDTPDIDLSGGQVKAPDTGVSGNIDVNGPDANIKGPDVGGGFGIGFGKDKD DSDSDDDDNKKDKKKKKKDKGGFGFGFKMPKFHGPNFGGGVKGDADIDGPEGKLDIGGKG AIDVESPEIKAGVNKPDLDVSASSDVKLPEGEIKVEAPDVGVNVKVPDADVDLEGPDVGG GFGIGFGKDKDHSDSDDDDDEKDKKKKKKDKGGFAFALKMPKFHGPSFGGSGKGDVDIDG PEGKLNIGGKGGIDVESPEINASVDKPDLDVSASSDVKLPEGEIKVEAPDVGVKGGNVKV PDADLSGKVDLEGPDVGGGFGIGFCKNKDHSDSDDDDEKDKKKKKKDKGGFGFGFKMPKF HGPSFGGGGKGDVDIDGPEGNIDVGGKGEIDVDAPEIKASLDKPDTDLSAGTGLKLPEGD VKVDKPDMDLPGGQVKAPDADLSGDVNVKGPDVGGGFGIGFGKGKDQSDSDDDEKDKKKK KKDKGGFGFGFKMPKLHGPSFGSGSKGNIDVDGPEGNLDIGAKGGINVDAPKVKAIREEP DLDVSAGGDIKLPEGDIKLETPDVSLKGGDIKTPGDADVKAPDLGGGFGIGLEKDKDQSD GDDDEKDKKKKKKDKGGFGFSIKMPKFHGPSFGGGAKGNVDVDSPEAKFDNDGKGEIDVD APKIKGSIGKPDLEVSAGGDVKLPGDVKVDTPDIDLSGGQVKAPDTGVSGNIDVNGPDAN IKGPDVGGGFGIGFGKDKDDSDSDDDDNKKDKKKKKKDKGGFGFGFKMPKFHGPNFGGGV KGDADIDGPEGKLDIGGKGAIDVESPEIKAGVNKPDLDVSASSDVKLPEGEIKVEAPDVG VKGGNVKVPDADLSGKVDLEGPDVGGGFGIGFCKDKDHSDSDDDDEKDKKKKKKDKGGFG FGLKMPKFHGPSFGGGGKGDVDIDGPKGNIDVGGKGEIDVDAPEIKANLDKPDTDLSAGT GLKLPEGDVKVDKADMDLPGGQVKAPDTDLSGDVNVKGPDVDFKGPDIGGGFGIGFGKGK DQSDSDDDEKDKKKKKKDKGGFGFGFKMPKFNGPSFGGGGKGNIDIDSPEGNLDVDAKGD IKVDAPGVKASGKTPDLDVSADGDTILPEGDVKLEKPDVSLNGGDIKAPNVDLSGDVDVK EPDVNVKGPDVGGTFGVGFGKDKDDSDSGDDDKEKKKKKKDKSGFGFGFKMPKFHGPSFG GGTKGDVDIGSPEGNLDIGGKVGADLDTPEIKASLKKNDVDVSAGADVELPTGDIKGGDV SVPETDISREVDVKSLKVGGGVNVGFPKSKDDSDSEDEDKDKKKKKKNKGFGFSFKKPKI HGPRFGGSGKGGADIDGPGFENKGDFDINAPEIKANLDAPDVDVSAGSDVKLPEGDVKVD TADIDLPGGQVKAPAPNAGLSGNIDVNGPDANVKGPNVGGGFGIGLGKDKDHSDSDDDDK KDKKKKKKEKGGFGFGFKMPKFHGPNFGGGVKGDADIDGPEGKLDFGGKGGIDVESPEIK ASVDKPDLDVSASSDVKLPEGDIKVEAPDVGIKGGNVKVPDADLSGKVDLEGPDVGGGIG IGFGKDKDHSDSDDDDDAKDKKKKKKDKGGFGFGLKMPKFHGPSFGGGGKVEGDLDSPNA DIDINGKLDADIGKEDFKAGVDKPDIDVSTEGELKTPEGDVSLDLDGDGGKKKKRGGSFK FGFKKPHFGDSGKQKPEKESKGFAGRAESGLSGPNVKVDGDGDIDLKGPKIGLDLDGKKK RKDSVTSSSSSSDDEGEKDKKKKKKKEKKGGGFGFGLSLSSFGGGVKGPSGDVSVEGPDA KLSGGVKRDNNLDVEGTVDVLKTDFGTPGVAVDNGANTDLKHTKIEGDVDVNLKGSEPSG DGDIELKGPEASFDYDSKKKRRDSSTSTSSSSGDEKDKDKKKKKKKDKKGGGFGFGIKMP SFGGGVKGGSGDTSVEVPDANLSSDVKGVSDVDIEGSVKGPDFNVSDPNVKLEGDADIGL KGPKTGGDVKGPTVGSDADINLKGPKINLDFDGNKKRKDSVTSTSSSSDDEDKKTKKKEK KGGGFGFGFNLPSFGSGGKGLSGDVSMKGPDANLSGGVKGDADPSIPDHNLEVKGEAGID GPEFGKKDKKGGGFGFNVKMPSFGSGAPGDVGLDVGGSLGEPNANVSVPDVKVSGDTGIN LKEPKVGGNTGIELKGPTIEGKKDGDIDITVPKGKLDADISGDIGRTSSNSSASSKDKKK NKGFGFSFKLSKFKFGGKSSADADVDLKKPSGGIDTDVNTPTAKLDTDISLEADKSSGGG DYSADVKTPTLGGDMDIKAPKIDGSSTAPDVNADLSADIGGEVPKIDTDLGITTPEVGGN VGMSGKTDINVKNPNDETAMALNLAKSGVITPKMDVPVSSGAPSVEADVDIKTPKVDADG DVDIKEPKIGLEGDMNVPKKKKKGKSGFGFKFGGSHKPDSKFYDGEKPEANIDVPQPATS VQIEIDTPEVSRETAKVGIDGEVETPNVSADINEDVPNPEIKTDVKRSGSFLGKLGGFFK GDKKKRGKKRKLDGDSKFYEPSGSVDVDLKGNASASPALPSAENETDFVIVNTPDSPRKE GNIEVNAPLSAEADVQMPDQYEKPKSPSLLRRIGMFFHIHSGGFDVEGESKKKKRKTVGT KSGKFKSDIDIETQSHESSVKREDSFTIPEATLPSAQETLPSASTEEKPSVEVALPNVQL EDSDTKMDVETPHLAVGSTSASSDVEMASPGLNVGISDALSGGIASEKNAEKSIGVTSAE ISDHKTSAFSGGIGGGISGGFSADAGASSKNDVISLDKDISIGGDRKVDTSGGISLDSQS SVATGSALSVGANASVGGDFSASANATPSGSTGASVGGELGNINAEVGGKAFEIKMSF >Nanomia_septata_NSEPT_ANN10277-RA MKGSDLLKLSQNSTKVDASMELSGGIGASMSAGVKREGKKTKKDKNKKKALLEFGHHSSS SSSSSSSSSSSSSSSSEDDDKKQKKEKKKKKKLKAGTHSAMNVDIPHIDGQVDASACIDT NIGVTPCLDIEVESAPQLLDIEGEEIQPVEVALDESSPFSFSAGIDLGLTADDDHDHNHD HFGQITHALGDALGIGDDCTSDTHADASVSGHIDIPETPSKADIDIPDVDGNSGFGFGMK TPEIEAPSFGFGGKGDDVEVPSVSDAGVDGTPDVRADISGPAVDVSPDVECPGADLTGDV DVDLEGKITGFGFGMKMPEIEAPSFGFGNVNLDAGGNIGTPSLKSDVSVPDVDLSADVNI PNADLSGDVGVDLKGKKPGFGFGMKMPDLKAPSFGSDSKADVGMPDAHLHGGIEVETPDV KADVSVPDVDVSADIQDADLAGDDVDLKGKKPGFGFGMKMPDIKAPNFGFGGVAKADVGL PDGHLHGGIEVETPDVKVSVPDVDVSADVSIPDADLSGDVDLKGKKPGFGFGMKMPDIKA PSFGFGGDAKADVGMPDGHLHGGIEVETPDVADISVPDVDVSVNVPGADLAGDVDLKGKK PGFGFGMKMPDIKAPSFGFGGDAKADVGMPDAHLHGGIEVTPDVKISVPDVDVSDVNVPG ADLAGDVDVDLKGKKPMPDIKAPSFGFGGDAKADVGMPDAHLHGGIELETPDVKADVSVP DVDVSADVSIPDADLSVDVDLKGGFGFGMKMPDIKAPSFGFGGDAKADVEMPDGHLHGGI DVDTQEVSAKMDGPYLDISIEGPDADLSGDVDLKGFGGGAKGDIEIQDHGGVDVDINGPD VDVSADISGPDVDITDADVDIDLKGGMKMPDVEIPDAHAHGGIDVDTPDVSTDLSGPDVD VSADISGPDVDIEGPDIDLKGKKPGFGFGMKMPSFKGPTFGGSAKGDVEMPDAHLHGGID ADVSVDLSGPDVDVSADISSPDVDIEGKGFGFGMKMPDIDVATPDVSADLSGPDVDVSAD ISGPDVDIEGPDADLKGKKPGFGFGMKMPDIKAPDFGGKIHGGVDVETPDLTADVNVPDV DVSADIEGPDADIDLGKKKGFGFGMKMPGGKGDVEMPDAHLHGEIDVATPDVSAPDVDVS GPDVDIEGPDADLKGKKKGFGFGMKMPSFKGEIGIPDVHVHGGVDVETPDIKADISGPDV DVSADIEGDVDIEGPDVDIDFKGKKKGFGFGLKMPKFHGPHFGGGVKGDSDGELPDAHVD GKIDLDAGVDIEIPEADISSGVEGPDVDLKGKKPGLGFGMKMPKADVEMPGGVDIETIKA DLSGPDLDVSADVKGPDADISGDLNLPDADLSLDKDKHRGSFKFKMPHFRGSGKSKKSKA DVSLDGPDLSVDVSTPDVDIDGDVTDANIPDVDAGFKIEGDDVDLKLQEHKKGFGFGLKM PKLNMPSFGGDAKGGAEVEIPDANIEGNVKDADVKVKTSDIKADISSPDLDVDIEGPAHL SGDDVDLKGKKKGFGFGLKMPKFHGPHFGGGVKGDIELPDAHIDGGGSNIDGNARIDGGV DVNTPDVSAGISGPDVNVSDIEGPDVDVDLKGKKKGFGFGLKMPKFHGPHFGGVKGDIDG ELPDDAGVDVEIPDIKADLDGPDVDVDVDIEGPDIDLKGKKKGFGFGMKMPDIKAPSFGF GGKGDIDGELPDAHVGGKIDLGIDVESPYVKADLSGPDVDVSADISGPDVDIDGPDVDVD KGKFHGPHFGVKGDIDGDSPDADVDVENPDLKADLSCPDVDVSADISGPDVDIDGPDVDV DLKGKKKGFGFGLKMPKFHGPHFGGGVKGDIDGDSPDADVDGKIGLDAGVDVENPNLKAD LSCPAVDVSAGVSGPDVDIDGPDVDVDLKGKKKGFGFGLKMPKFHGPNFGGGVKGDIDGE LPDAHIGEKVDLDAGVDVETPDVKADLSGPDVDVSAGASDPDVDIEGPDVDVDLKVKKKG FGFGFKMPKFHGPHFGGGVKGDIDGELPDDLDAGVDVPDVKADLSGPDVVSANISSPDVD IDVDVDLKGKKKGFGFGLKMPKFHGPHFSGGVKGDIDGELPDAHVGGKIDLDAGVDVETP DVKAEFSGPDVDVSADISGPGVDMEGPDVDVDLKGKKKGFGFGLKMPKFHGPNFGGGVKG DIDGELPDAHVGGEIDLDAGVDVETPDVKADLSGPDVDVSADISGPGVDMEGPDVDVKGK KKGFGFGLKMPKFHGPNFGGGVKGDIDGELPDAHVGGKIDLDAGVDVETPDVKADLSGPD VDVSADISGPGVDMEGPDVDVHLKGKKKGFGFGLKMPKFHGPNFGGGVKGDIDGELPDAH VGGKIDLDAGVDVETPDVKGDLSGPDVDVSAGISGPDLDLDIEGPDADLSGDIDVDLKGK GFGFGLKVNRDPDSHIGGKIDLDAIDVDLKGKKKGFGFGLKMPKFHGPNFSGGVNRDIDN ELPDAHVGGKIDLDAGVDVKTPDVKADLSGPDVDASAGISGPDLDVSADIEGPDADLSGD IDVDLKGKKKGFGFGFKMPKFHGPHFGSGVKADVDGEVPDAHGHGGVDIETRDGKADLSS PDLDVSADIESPDADLSGDFHLKGKGKKKKGSFSFKFPKFSGPHFGGSGKGKKDADLDID VDNPDVKADISSPDLDVSADIEGPDADLSGDIDVDLKGKKKGFGFGMKMPSFKGPKFGGG IDGDVEMSDAHIDGGGKLDVDIDAKVPDAQIHGGKIDLDAGVDVETTDLSADVNVPDVDV SADIEGPDANIDLKGKKKGFGFSLKMPKFHGPNFGGGVKGDIDGELPDAHVGGKIDVDAE INVETPDVKADLSCPDVDVSTSVCGPDVDIEGPDADIDLKGKKGFGFGLKMPKFHGPNFG GGVKGDIDGELPVADVGGKVDLDAGETPDVKADLSGPDVDVSASVSGPDDIEGPDADVDL KGKKGFGFGLKMPKFGGGVKGDLPDAHVGGEDLDAGVDVETPDVKADLSGPDVDVSASVC PDVDIEGPDADVDLKGKKGFGFGLKMPKFHGPNFGGGVKGDIDGELPDAHIGKVDLDAGV DVEPDVKADLSGPDVDVSASVCGPDVDIEGPDADVDLKGKKKGFGFGLKMPKFGGGAKGD VDVEMPDVHVHGGVDIETPDLKADVNGPDVDVSANSGPDVDIEGPGVDVDLKGKKKGFGF GLKMPKFHGPNFGGGVKGDIDGELPDVDGEVDAGVDVETDVKADLSGPDVDVSAPDVDAD VDLKGKKGFGFKFHGPNFGGGVKGDIDGELPDAHVGGKVDLDAGVDVETPDVKADLSGPD VDLSAGVSAPDADVSMNLEGNLDGKPKKSKGGFGFGFKFPKFHGPSMNRKSVDIDADGPE INADVNVPSTDLKADVGADASGGSDDLNPSVKVEGPHIDSGGIDVPTPHVHGDGNIDGGI SGEVPDASLNIGTPGLGSGKVSRSGSTDDEKKTKKKNSFRLGFKMPSFSGKTKGGKVKGD IAVDSGDTNADGYVEVEIPVDAPDVDIKLDGNADANLVHHKRKGSHSSSSSSSSSSSSDS DSGDEKKKVKSKLAVKTPSLDASGGVDLPGVDATASGGISVDLDHKHNEGEAGVGIKADI DPSLAINTSRKSSMSSSDDEKKKKKSFKIKGKADVDCYVPDANVSVNTPNIDARADADVS LQVPSPDKNKKKKKKDKDIDINAQLDGECAKSPKSPSLLRRIAMFFHINSAEYNMDNKSS KHNKTSKDTTNIELDLNTNSQVNVKRDDSFTIPEDTVNSSFKISANTETDTNVLVSSSTE AHTHLEGKQDSSLIGSGNLNTNIQVPTIPNGDASASLGGSTAVDASAGLEASASVGASLS LDASGSLTTPEAEGAGEAGTFDVDGKAYEIKVYF >Turritopsis_dohrnii_TDOHR_Tur_r2.0_p0790.1.g15944.t1 VDAPDADLDANINAGGGLDVNIPDAKANVDTPDIDVKAGVGGDLPAADLNLKGPDVDLKG DVDLSGGADLKGPDVGGGIGFGFGGRRGSHSSDDGDDKDKKKKDKKGKGGFGFKLPKFHG PNFGGSGKGGVNVDAPDADLDANINAGGGLDVNIPDAKANVDTPDLDVKAGVGGDLPAAD LNLKGPDVDLKGDVDLSGGADLKGPDVGGGIGFGFGGRRGSHSSDDGDDKDKKKKDKKGK GGFGFKLPKFHGPNFGGSGKGGVNVDAPDADLDANINAGGGLDVNIPDAKANVDTPDIDV KAGVGGDLPDADLNLKGPDVDLKGDVDLSGGADLKGPDVGGGIGFGFGGRKGSHSSDDCG KGDVDGLEGGGNVEVGGGAEFGENLDVSADMEKPKKRGSFKFGFRNRSGSGKGSKDKKAD SVSGDGDIKIDGELPGISGDVGGDINFDGKIKRSSSSSSEGEEGKKKDKKKKKKKNKGGF GINLPSFGGEGDGDVDGNAVGLEGKPEGDLKVGGDIDLDLKKKRKDSTSSSSSSSSENEE GKKKEKKDKKKKSKKDFKFGGDIDASLNADASGDIKVPKLDADIGGDHDKNLGADIKLPS IDAEIEGKKKRTTSTSSSSSDKEKSKKKDKKKSKGKGGFGFKFPSFGGGAKAPSGDVDAN ASVSLEGKDGDVKIPEGDLKVGGDIDLDLKKKRKDSTSSSSSSSSEDEEGKKKEKKDKKK KGKKDFKFGGDIDASLNADASGDIKVPKLDADIGGDHDKNLGADIKLPSIDAEIEGKKKR TTSTSSSSSDKEKSKKKDKKKSKGKGGFGFKFPSFGGGAKAPSGDVDANASVSLEGKDGD VKIPEGDLKVGGDIDLDLKKKRKDSTSSSSSSEGEEGKKKDKKKKKKKNKGKGGFGINLP SFGGEGDLPSGDVDANASLGLEGDGDVKIPEGDLKVGGDIDLDKKKKKTSKGNVGIAMPN LEGGADVSEDVNVKLPDADVNVDAPEINIESGKKRKDSSSSEDGKDKKKEKKKGFGFSFK LPHFGGGGGSSKSAPSVTANASGSNDDPNVNTDVTVEAPKVDVSADIDSKGEGNLKDKKH RGSKGKGGFGFKLPKFSGGKDDVGGDVKIDSDKPTGDVNVSGDVDTSMDLGGANTTGISA DVRLPSVSADTDSNKKKKGKKGDHDKGNATFYANPDADINISGPSVDTEVSLPKAELETP DLDKSGDISLRVPEVDVNADVPETEVSGEAGVRRSGSILDKIGSFFKRSDDDKKRAKKRK RETPTTSKKIEANTGKVDIPTADVDVDVSASTSKQATDVHPDEKRPKSPSFLRRLGMFFH IHSSDYDVEGKKKKKRRKTSGKGTIQTDEENIDASQTSIKKDEDNFTIPEANVNIALPEV STKSEANIETKADAATSGSATTDVNLNLDTDVKTDIKTDISGSANASADAQTAANLSGEA SAQLGGFQGEVGSKSFEVKFSL >Turritopsis_rubra_TRUBR_BRAKERIOWP00000008453.1 pep ASM2516757v1_JAHXJM010000507.1_43968_57603_-1 gene_BRAKERIOWG00000008277.1 transcript_BRAKERIOWT00000008453.1 gene_biotype_protein_coding transcript_biotype_protein_coding gene_symbol_ncl description_"nucleolin [Ensembl NN prediction with score 98.62%]" MSKRFSSSLVIPEKTIRSSLTVYHSNKSPRSPKTFGTPSLEVSTSSSAVDLPTSGGVEDL APPSKKSLVVEETYSEHRVAAASFISNVESLPEMDIEVNTNAEDKTKKSKKAQKPDFDAK IAGNLSGDISGDVNIAAPSVVAPTIDGSGISLNISEKTPIVEESFEENRKADITIPHFEA STNSDLKFQNGIPGTEEEVIGVLDIGTVECAPDDRKTFPNFESYEEEIVMPEVQSEVEAL PFDFNEEIVMPEVQSEVEALPFDFKTYGASADIEINTNTESDKDVAASGFFSSVGGFVKT ALWGSDDDNSQVNTYGGGSEKLEAEINGPDINTPDINTPSLGGFDGGFGGSVGGDVKGPE IDVPSADISGGGADFEGPDLGGGIGFGIGGRRGSHSSEDGDDKDKKKKDKKGKSGFGFKL PKFHGPNFGGSGKGGVDVDAPDADLDGNMKLGGGVDVNVPDANATLDAPDLEVKGGVGGD LPDADLNLKGPDVDLKGPDLGGGIGFGIGGRRGSHSSEEGEDKDKKKKDKKGKGGFGFKL PKFHGPNFGGSGKGGIDVDAPDADLDGKVKLGGGVDVNVPDAKAKIDAPDAELEAAVGGD IPDMDLNLKGPDVDLKSDMALSGDADVKGPDLGGDIGFGFGRSKDSHSSDDGDHKDKKKK DKKSKSGFSFKLPKFHGPHFGGSGKAGVDVNAPNADLDAKTKLGGDVNVNAPDAKAKLDA PDFDLKAGVGGNLPDADLNLKGPDVDLKGDMDLSGGGDIKGPDVDLGGGIGFGMGGREGS HSSSDDDDKDKKKKEKKAKGGFGFKLPKFHGPNFGGSGKGGIDVDVPEKNLELDVGGESG VGDDVEVSADIGKPKKRGSFKFGFGNRSGSGKGLKVTKSGKVDGDGEDLKLPDGDSSFHG KLPSVSGKSDGEIKGDIDIDFNRKRKDSTSSSSSSSSEDEEGKKKEKKVKKKKSKNKIKL GGDLDMSLNADGSDTMKGPKVDVDFKGDNDAGVGGDIKLPSADIEIGGKKKRTSSASSSS DKEKSKKKDKKNKKGKSGFGIKFPHFGGGGKAPTGDIDADASLSLKEKDADLTIPEGDLK IKSGDVKFDGDFDADLNRKRKDSTSSSSSSSSEDGEGKKKEKKGKKKKSKGKQNLGIATP HLDGDIHASRDVDADVDMKLPVVNAPEFNTESKEKKRKESTSSDDDKEKSGKKDKKKGFS FGFKFPNFGGGGKTPSGSATAGVGDAPKGDGKIDIDANVGAGNLDLSTDADSKAEGNLKD KKHRGSKGKGGFGFKFPKLSGGKPDAHVEAEVGGKPTVAASDVNVNADVNADTSVDLRGP DISISDNVADVKVPGVSVDSHSKKKGKKDKGNATFYAAAPDANITLPSGEADVNLPKSDL ETSALNKGSDIEVKVDGPELDINAELPETEGSTEVGVQRSGSILDKIGSFFKRSDDDKKR AKKRKRGKDGDSKFYTSDINADIHVTGTSEVDANLGASADLQSDSVHTSSRVSGDNDFVI VETPTTSKKIDVNAGKIDVNAGGNGTTDVDVDVSVSTSKHGVDVHPDEKRPKSPSFLRRL GMFFHIHSSDYDVEGKKKKKRRKTSAKGTFQTEDENIVDSQTSIKKDEDNFTIPEVNIAL PDVNMKSDAKLDAKLEAAENANATTDVNLNVDSDVKSEASASANASSDLKASADMTGGAS ADISGGASTDLGGFGGAVGGKSFEVSISSKLIDIIMSIPCFH >Turritopsis_rubra_TRUBR_g5965.t1.1 pep ASM2516757v1_JAHXJM010000507.1_43968_57603_-1 gene_g5965.1 transcript_g5965.t1.1 gene_biotype_protein_coding transcript_biotype_protein_coding gene_symbol_ncl description_"nucleolin [Ensembl NN prediction with score 98.62%]" MSKRFSSSLVIPEKTIRSSLTVYHSNKSPRSPKTFGTPSLEVSTSSSAVDLPTSGGVEDL APPSKKSLVVEETYSEHRVAAASFISNVESLPEMDIEVNTNAEDKTKKSKKAQKPDFDAK IAGNLSGDISGDVNIAAPSVVAPTIDGSGISLNISEKTPIVEESFEENRKADITIPHFEA STNSDLKFQNGIPGTEEEVIGVLDIGTVECAPDDRKTFPNFESYEEEIVMPEVQSEVEAL PFDFNEEIVMPEVQSEVEALPFDFKTYGASADIEINTNTESDKDVAASGFFSSVGGFVKT ALWGSDDDNSQVNTYGGGSEKLEAEINGPDINTPDINTPSLGGFDGGFGGSVGGDVKGPE IDVPSADISGGGADFEGPDLGGGIGFGIGGRRGSHSSEDGDDKDKKKKDKKGKSGFGFKL PKFHGPNFGGSGKGGVDVDAPDADLDGNMKLGGGVDVNVPDANATLDAPDLEVKGGVGGD LPDADLNLKGPDVDLKGPDLGGGIGFGIGGRRGSHSSEEGEDKDKKKKDKKGKGGFGFKL PKFHGPNFGGSGKGGIDVDAPDADLDGKVKLGGGVDVNVPDAKAKIDAPDAELEAAVGGD IPDMDLNLKGPDVDLKSDMALSGDADVKGPDLGGDIGFGFGRSKDSHSSDDGDHKDKKKK DKKSKSGFSFKLPKFHGPHFGGSGKAGVDVNAPNADLDAKTKLGGDVNVNAPDAKAKLDA PDFDLKAGVGGNLPDADLNLKGPDVDLKGDMDLSGGGDIKGPDVDLGGGIGFGMGGREGS HSSSDDDDKDKKKKEKKAKGGFGFKLPKFHGPNFGGSGKGGIDVDVPEKNLELDVGGESG VGDDVEVSADIGKPKKRGSFKFGFGNRSGSGKGLKVTKSGKVDGDGEDLKLPDGDSSFHG KLPSVSGKSDGEIKGDIDIDFNRKRKDSTSSSSSSSSEDEEGKKKEKKVKKKKSKNKIKL GGDLDMSLNADGSDTMKGPKVDVDFKGDNDAGVGGDIKLPSADIEIGGKKKRTSSASSSS DKEKSKKKDKKNKKGKSGFGIKFPHFGGGGKAPTGDIDADASLSLKEKDADLTIPEGDLK IKSGDVKFDGDFDADLNRKRKDSTSSSSSSSSEDGEGKKKEKKGKKKKSKGKQNLGIATP HLDGDIHASRDVDADVDMKLPVVNAPEFNTESKEKKRKESTSSDDDKEKSGKKDKKKGFS FGFKFPNFGGGGKTPSGSATAGVGDAPKGDGKIDIDANVGAGNLDLSTDADSKAEGNLKD KKHRGSKGKGGFGFKFPKLSGGKPDAHVEAEVGGKPTVAASDVNVNADVNADTSVDLRGP DISISDNVADVKVPGVSVDSHSKKKGKKDKGNATFYAAAPDANITLPSGEADVNLPKSDL ETSALNKGSDIEVKVDGPELDINAELPETEGSTEVGVQRSGSILDKIGSFFKRSDDDKKR AKKRKRGKDGDSKFYTSDINADIHVTGTSEVDANLGASADLQSDSVHTSSRVSGDNDFVI VETPTTSKKIDVNAGKIDVNAGGNGTTDVDVDVSVSTSKHGVDVHPDEKRPKSPSFLRRL GMFFHIHSSDYDVEGKKKKKRRKTSAKGTFQTEDENIVDSQTSIKKDEDNFTIPEVNIAL PDVNMKSDAKLDAKLEAAENANATTDVNLNVDSDVKSEASASANASSDLKASADMTGGAS ADISGGASTDLGGFGGAVGGKSFEVSISSKLIDIIMSIPCFH