ID A0A9Q1DP18_CONCO Unreviewed; 904 AA.
AC A0A9Q1DP18;
DT 13-SEP-2023, integrated into UniProtKB/TrEMBL.
DT 13-SEP-2023, sequence version 1.
DT 28-JAN-2026, entry version 7.
DE SubName: Full=Uncharacterized protein {ECO:0000313|EMBL:KAJ8275951.1};
GN ORFNames=COCON_G00077030 {ECO:0000313|EMBL:KAJ8275951.1};
OS Conger conger (Conger eel) (Muraena conger).
OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi;
OC Actinopterygii; Neopterygii; Teleostei; Anguilliformes; Congridae; Conger.
OX NCBI_TaxID=82655 {ECO:0000313|EMBL:KAJ8275951.1, ECO:0000313|Proteomes:UP001152803};
RN [1] {ECO:0000313|EMBL:KAJ8275951.1}
RP NUCLEOTIDE SEQUENCE.
RC STRAIN=Concon-B {ECO:0000313|EMBL:KAJ8275951.1};
RX PubMed=36758078;
RA Parey E., Louis A., Montfort J., Bouchez O., Roques C., Iampietro C.,
RA Lluch J., Castinel A., Donnadieu C., Desvignes T., Floi Bucao C.,
RA Jouanno E., Wen M., Mejri S., Dirks R., Jansen H., Henkel C., Chen W.J.,
RA Zahm M., Cabau C., Klopp C., Thompson A.W., Robinson-Rechavi M.,
RA Braasch I., Lecointre G., Bobe J., Postlethwait J.H., Berthelot C.,
RA Roest Crollius H., Guiguen Y.;
RT "Genome structures resolve the early diversification of teleost fishes.";
RL Science 379:572-575(2023).
CC -!- CAUTION: The sequence shown here is derived from an EMBL/GenBank/DDBJ
CC whole genome shotgun (WGS) entry which is preliminary data.
CC {ECO:0000313|EMBL:KAJ8275951.1}.
CC ---------------------------------------------------------------------------
CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms
CC Distributed under the Creative Commons Attribution (CC BY 4.0) License
CC ---------------------------------------------------------------------------
DR EMBL; JAFJMO010000005; KAJ8275951.1; -; Genomic_DNA.
DR AlphaFoldDB; A0A9Q1DP18; -.
DR OrthoDB; 10057281at2759; -.
DR Proteomes; UP001152803; Unassembled WGS sequence.
DR GO; GO:0035082; P:axoneme assembly; IEA:TreeGrafter.
DR InterPro; IPR027968; JHY.
DR PANTHER; PTHR14726; JHY PROTEIN HOMOLOG; 1.
DR PANTHER; PTHR14726:SF1; JHY PROTEIN HOMOLOG; 1.
DR Pfam; PF15261; JHY; 1.
PE 4: Predicted;
KW Reference proteome {ECO:0000313|Proteomes:UP001152803}.
FT REGION 1..33
FT /note="Disordered"
FT /evidence="ECO:0000256|SAM:MobiDB-lite"
FT REGION 165..459
FT /note="Disordered"
FT /evidence="ECO:0000256|SAM:MobiDB-lite"
FT REGION 790..811
FT /note="Disordered"
FT /evidence="ECO:0000256|SAM:MobiDB-lite"
FT REGION 839..874
FT /note="Disordered"
FT /evidence="ECO:0000256|SAM:MobiDB-lite"
FT COMPBIAS 18..31
FT /note="Basic and acidic residues"
FT /evidence="ECO:0000256|SAM:MobiDB-lite"
FT COMPBIAS 186..207
FT /note="Basic and acidic residues"
FT /evidence="ECO:0000256|SAM:MobiDB-lite"
FT COMPBIAS 315..327
FT /note="Basic and acidic residues"
FT /evidence="ECO:0000256|SAM:MobiDB-lite"
FT COMPBIAS 328..345
FT /note="Polar residues"
FT /evidence="ECO:0000256|SAM:MobiDB-lite"
FT COMPBIAS 348..357
FT /note="Basic and acidic residues"
FT /evidence="ECO:0000256|SAM:MobiDB-lite"
FT COMPBIAS 412..424
FT /note="Basic residues"
FT /evidence="ECO:0000256|SAM:MobiDB-lite"
FT COMPBIAS 438..453
FT /note="Basic and acidic residues"
FT /evidence="ECO:0000256|SAM:MobiDB-lite"
FT COMPBIAS 799..811
FT /note="Basic and acidic residues"
FT /evidence="ECO:0000256|SAM:MobiDB-lite"
SQ SEQUENCE 904 AA; 101976 MW; 24968A41A2FC5337 CRC64;
MDNIRQPNCQ DVIPSRASEA RPKEEPEKSS LMEDAQISLW NSLESDTESL VQERRYQMEL
KSRIQQANEI VNANSEGYVD ESSGEEEDDL EELVGEDNYI YDSLDVAESQ QGQIKTVPHD
TKVGEILQEK RQDKFGYRPA EDEYAGLRYD PNWRTNLKED KLFEEGNQLL LEEEGPNVYA
DPSDESPWKS RDHSGNGEQK NLSDHRQARS MGLAVYMAPD RLSEYKSKRL PAPHYTPPQR
NMAVGAETTL SEQQRPQKGL HRTEDASSRR PNGVPAAGNR MHSGETQVVS QEQEESYEEM
NQRYAKEYQV FYEQESDRTE NSTDNSHDSA YSNPNQSRRL PNIRQTKPRK DIVERNKMTL
GVRRKQASYL SAHGQKGLKE EQKSQQQGSD AVEETTEHQY LNPELRWQQK TQRLKVHREK
KKGKREGDHP CPGPPGGDLR ERGNPSVPRD GHGPRQRRGQ AEVLVIDEAD HGDSPLSPTP
PTSLWPQGLS PHTMNPPTFN LNINLSASGD GVPGFLGQEH QHASLNLSPP RGPSLRSRPA
VSYHNPMSGH YDPAQVAYYG PRYPHSAPQA VLPTSWFPAQ KIQGTLPQGS KRGPRDVPPL
WDHDSHSLQG MDSDRSWLGP ATWQPAGDWS LYLSPGEQRI ELRPPHRLPA QSTGSYPLLP
PIGEAVASDS ELSGQNARHN INGMQRSISE GYLAQLEKQR QLKEKTAYKA YTLKDYKALK
KDVKLGGLGP DYKVTPITAE KIRRRQQYSD KVRENNKNIS RIPFLPTRNP CPAGGDTTEN
MVPRMKALEY ARSIPKPKPP AEPKSSERDG PRDFLQERAQ YLEHLDLTQL ARLEMLQKRH
EEEKQRRRCG IEQQAKGVPS SVSARPGRGL NGQAALASSQ DGTLLLFWGP ATASSIHTAC
TWRC
//