ID E9PI30_HUMAN Unreviewed; 364 AA. AC E9PI30; DT 05-APR-2011, integrated into UniProtKB/TrEMBL. DT 05-APR-2011, sequence version 1. DT 05-DEC-2018, entry version 51. DE SubName: Full=Cathepsin W {ECO:0000313|Ensembl:ENSP00000436568}; GN Name=CTSW {ECO:0000313|Ensembl:ENSP00000436568}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000436568, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000436568, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=16554811; DOI=10.1038/nature04632; RA Taylor T.D., Noguchi H., Totoki Y., Toyoda A., Kuroki Y., Dewar K., RA Lloyd C., Itoh T., Takeda T., Kim D.W., She X., Barlow K.F., Bloom T., RA Bruford E., Chang J.L., Cuomo C.A., Eichler E., FitzGerald M.G., RA Jaffe D.B., LaButti K., Nicol R., Park H.S., Seaman C., Sougnez C., RA Yang X., Zimmer A.R., Zody M.C., Birren B.W., Nusbaum C., Fujiyama A., RA Hattori M., Rogers J., Lander E.S., Sakaki Y.; RT "Human chromosome 11 DNA sequence and analysis including novel gene RT identification."; RL Nature 440:497-500(2006). RN [2] {ECO:0000313|Ensembl:ENSP00000436568} RP IDENTIFICATION. RG Ensembl; RL Submitted (JUL-2011) to UniProtKB. CC -!- SIMILARITY: Belongs to the peptidase C1 family. CC {ECO:0000256|RuleBase:RU362133, ECO:0000256|SAAS:SAAS01048375}. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AP001201; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR ProteinModelPortal; E9PI30; -. DR PeptideAtlas; E9PI30; -. DR PRIDE; E9PI30; -. DR Ensembl; ENST00000528419; ENSP00000436568; ENSG00000172543. DR UCSC; uc058drg.1; human. DR EuPathDB; HostDB:ENSG00000172543.7; -. DR HGNC; HGNC:2546; CTSW. DR OpenTargets; ENSG00000172543; -. DR eggNOG; KOG1542; Eukaryota. DR eggNOG; COG4870; LUCA. DR GeneTree; ENSGT00940000161630; -. DR ChiTaRS; CTSW; human. DR Proteomes; UP000005640; Chromosome 11. DR Bgee; ENSG00000172543; Expressed in 112 organ(s), highest expression level in leukocyte. DR ExpressionAtlas; E9PI30; baseline and differential. DR GO; GO:0008234; F:cysteine-type peptidase activity; IEA:InterPro. DR CDD; cd02248; Peptidase_C1A; 1. DR InterPro; IPR033158; Cathepsin_W. DR InterPro; IPR038765; Papain_like_cys_pep_sf. DR InterPro; IPR025660; Pept_his_AS. DR InterPro; IPR013128; Peptidase_C1A. DR InterPro; IPR000668; Peptidase_C1A_C. DR InterPro; IPR039417; Peptidase_C1A_papain-like. DR InterPro; IPR013201; Prot_inhib_I29. DR PANTHER; PTHR12411; PTHR12411; 1. DR PANTHER; PTHR12411:SF101; PTHR12411:SF101; 1. DR Pfam; PF08246; Inhibitor_I29; 1. DR Pfam; PF00112; Peptidase_C1; 1. DR PRINTS; PR00705; PAPAIN. DR SMART; SM00848; Inhibitor_I29; 1. DR SMART; SM00645; Pept_C1; 1. DR SUPFAM; SSF54001; SSF54001; 1. DR PROSITE; PS00639; THIOL_PROTEASE_HIS; 1. PE 1: Evidence at protein level; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Proteomics identification {ECO:0000213|EPD:E9PI30, KW ECO:0000213|MaxQB:E9PI30, ECO:0000213|PeptideAtlas:E9PI30}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Signal {ECO:0000256|RuleBase:RU362133}. FT SIGNAL 1 21 {ECO:0000256|RuleBase:RU362133}. FT CHAIN 22 364 {ECO:0000256|RuleBase:RU362133}. FT /FTId=PRO_5005397589. FT DOMAIN 42 99 Inhibitor_I29. FT {ECO:0000259|SMART:SM00848}. FT DOMAIN 128 345 Pept_C1. {ECO:0000259|SMART:SM00645}. SQ SEQUENCE 364 AA; 40750 MW; FD07CB957DB0BACA CRC64; MALTAHPSCL LALLVAGLAQ GIRGPLRAQD LGPQPLELKE AFKLFQIQFN RSYLSPEEHA HRLDIFAHNL AQAQRLQEED LGTAEFGVTP FSDLTEEEFG QLYGYRRAAG GVPSMGREIR SEEPEESVPF SCDWRKVASA ISPIKDQKNC NCCWAMAAAG NIETLWRISF WDFVDVSVQE LLDCGRCGDG CHGGFVWDAF ITVLNNSGLA SEKDYPFQGK VRAHRCHPKK YQKVAWIQDF IMLQNNEHRI AQYLATYGPI TVTINMKPLQ LYRKGVIKAT PTTCDPQLVD HSVLLVGFGS VKSEEGIWAE TVSSQSQPQP PHPTPYWILK NSWGAQWGEK VSVIYWGRGQ GRTGLFPPSR PYVP //