ID E7EWN1_HUMAN Unreviewed; 5070 AA. AC E7EWN1; DT 08-MAR-2011, integrated into UniProtKB/TrEMBL. DT 08-MAR-2011, sequence version 1. DT 16-JAN-2019, entry version 50. DE SubName: Full=Mucin-4 {ECO:0000313|Ensembl:ENSP00000419798}; GN Name=MUC4 {ECO:0000313|Ensembl:ENSP00000419798}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000419798, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000419798, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=16641997; DOI=10.1038/nature04728; RA Muzny D.M., Scherer S.E., Kaul R., Wang J., Yu J., Sudbrak R., RA Buhay C.J., Chen R., Cree A., Ding Y., Dugan-Rocha S., Gill R., RA Gunaratne P., Harris R.A., Hawes A.C., Hernandez J., Hodgson A.V., RA Hume J., Jackson A., Khan Z.M., Kovar-Smith C., Lewis L.R., RA Lozado R.J., Metzker M.L., Milosavljevic A., Miner G.R., Morgan M.B., RA Nazareth L.V., Scott G., Sodergren E., Song X.Z., Steffen D., Wei S., RA Wheeler D.A., Wright M.W., Worley K.C., Yuan Y., Zhang Z., Adams C.Q., RA Ansari-Lari M.A., Ayele M., Brown M.J., Chen G., Chen Z., RA Clendenning J., Clerc-Blankenburg K.P., Chen R., Chen Z., Davis C., RA Delgado O., Dinh H.H., Dong W., Draper H., Ernst S., Fu G., RA Gonzalez-Garay M.L., Garcia D.K., Gillett W., Gu J., Hao B., RA Haugen E., Havlak P., He X., Hennig S., Hu S., Huang W., Jackson L.R., RA Jacob L.S., Kelly S.H., Kube M., Levy R., Li Z., Liu B., Liu J., RA Liu W., Lu J., Maheshwari M., Nguyen B.V., Okwuonu G.O., Palmeiri A., RA Pasternak S., Perez L.M., Phelps K.A., Plopper F.J., Qiang B., RA Raymond C., Rodriguez R., Saenphimmachak C., Santibanez J., Shen H., RA Shen Y., Subramanian S., Tabor P.E., Verduzco D., Waldron L., Wang J., RA Wang J., Wang Q., Williams G.A., Wong G.K., Yao Z., Zhang J., RA Zhang X., Zhao G., Zhou J., Zhou Y., Nelson D., Lehrach H., RA Reinhardt R., Naylor S.L., Yang H., Olson M., Weinstock G., RA Gibbs R.A.; RT "The DNA sequence, annotation and analysis of human chromosome 3."; RL Nature 440:1194-1198(2006). RN [2] {ECO:0000313|Ensembl:ENSP00000419798} RP IDENTIFICATION. RG Ensembl; RL Submitted (JUL-2011) to UniProtKB. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AC069513; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AC233280; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR ProteinModelPortal; E7EWN1; -. DR jPOST; E7EWN1; -. DR MaxQB; E7EWN1; -. DR PeptideAtlas; E7EWN1; -. DR PRIDE; E7EWN1; -. DR Ensembl; ENST00000478156; ENSP00000419798; ENSG00000145113. DR UCSC; uc032son.2; human. DR EuPathDB; HostDB:ENSG00000145113.21; -. DR HGNC; HGNC:7514; MUC4. DR OpenTargets; ENSG00000145113; -. DR eggNOG; ENOG410IHUZ; Eukaryota. DR eggNOG; ENOG4111F6U; LUCA. DR GeneTree; ENSGT00730000110943; -. DR ChiTaRS; MUC4; human. DR Proteomes; UP000005640; Chromosome 3. DR Bgee; ENSG00000145113; Expressed in 134 organ(s), highest expression level in nasal cavity epithelium. DR ExpressionAtlas; E7EWN1; baseline and differential. DR GO; GO:0005176; F:ErbB-2 class receptor binding; IEA:InterPro. DR GO; GO:0030197; F:extracellular matrix constituent, lubricant activity; IEA:InterPro. DR GO; GO:0007160; P:cell-matrix adhesion; IEA:InterPro. DR GO; GO:0010669; P:epithelial structure maintenance; IEA:InterPro. DR GO; GO:0010469; P:regulation of signaling receptor activity; IEA:InterPro. DR InterPro; IPR005533; AMOP_dom. DR InterPro; IPR039898; Mucin_4. DR InterPro; IPR003886; NIDO_dom. DR InterPro; IPR001846; VWF_type-D. DR PANTHER; PTHR42668; PTHR42668; 2. DR Pfam; PF06119; NIDO; 1. DR Pfam; PF00094; VWD; 1. DR SMART; SM00723; AMOP; 1. DR SMART; SM00539; NIDO; 1. DR SMART; SM00216; VWD; 1. DR PROSITE; PS50856; AMOP; 1. DR PROSITE; PS51220; NIDO; 1. DR PROSITE; PS51233; VWFD; 1. PE 1: Evidence at protein level; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Proteomics identification {ECO:0000213|MaxQB:E7EWN1, KW ECO:0000213|PeptideAtlas:E7EWN1}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Signal {ECO:0000256|SAM:SignalP}. FT SIGNAL 1 28 {ECO:0000256|SAM:SignalP}. FT CHAIN 29 5070 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5003219543. FT DOMAIN 4397 4552 NIDO. {ECO:0000259|PROSITE:PS51220}. FT DOMAIN 4553 4668 AMOP. {ECO:0000259|PROSITE:PS50856}. FT DOMAIN 4681 4916 VWFD. {ECO:0000259|PROSITE:PS51233}. SQ SEQUENCE 5070 AA; 504936 MW; 1816B75C569A23E9 CRC64; MKGARWRRVP WVSLSCLCLC LLPHVVPGTT EDTLITGSKT AAPVTSTGST TATLEGQSTA ASSRTSNQDI SASSQNHQTK STETTSKAQT DTLTQMMTST LFSSPSVHNV METAPPDEMT TSFPSSVTNT LMMTSKTITM TTSTDSTLGN TEETSTAGTE SSTPVTSAVS ITAGQEGQSR TTSWRTSIQD TSASSQNHWT RSTQTTRESQ TSTLTHRTTS TPSFSPSVHN VTGTVSQKTS PSGETATSSL CSVTNTSMMT SEKITVTTST GSTLGNPGET SSVPVTGSLM PVTSAALVTF DPEGQSPATF SRTSTQDTTA FSKNHQTQSV ETTRVSQINT LNTLTPVTTS TVLSSPSGFN PSGTVSQETF PSGETTTSSP SSVSNTFLVT SKVFRMPTSR DSTLGNTEET SLSVSGTISA ITSKVSTIWW SDTLSTALSP SSLPPKISTA FHTQQSEGAE TTGRPHERSS FSPGVSQEIF TLHETTTWPS SFSSKGHTTW SQTELPSTST GAATRLVTGN PSTGTAGTIP RVPSKVSAIG EPGEPTTYSS HSTTLPKTTG AGAQTQWTQE TGTTGEALLS SPSYSVTQMI KTATSPSSSP MLDRHTSQQI TTAPSTNHST IHSTSTSPQE SPAVSQRGHT QAPQTTQESQ TTRSVSPMTD TKTVTTPGSS FTASGHSPSE IVPQDAPTIS AATTFAPAPT GDGHTTQAPT TALQAAPSSH DATLGPSGGT SLSKTGALTL ANSVVSTPGG PEGQWTSASA STSPDTAAAM THTHQAESTE ASGQTQTSEP ASSGSRTTSA GTATPSSSGA SGTTPSGSEG ISTSGETTRF SSNPSRDSHT TQSTTELLSA SASHGAIPVS TGMASSIVPG TFHPTLSEAS TAGRPTGQSS PTSPSASPQE TAAISRMAQT QRTRTSRGSD TISLASQATD TFSTVPPTPP SITSTGLTSP QTETHTLSPS GSGKTFTTAL ISNATPLPVT YASSASTGHT TPLHVTDASS VSTGHATPLP VTSPSSVSTG HTTPLPVTDT SSESTGHVTP LPVTSFSSAS TGDSTPLPVT DTSSASTGHV TPLPVTSLSS ASTGDTTPLP VTDTSSASTG HATSLPVTDT SSVSTGHTTP LPVTDTSSAS TGHATSLPVT DTSSVSTGHT TPLHVTDASS ASTGQATPLP VTSLSSVSTG DTTPLPVTSP SSASTGHATP LLVTDTSSAS TGHATPLPVT DASSVSTDHA TSLPVTIPSA ASTGHTTPLP VTDTSSASTG QATSLLVTDT SSVSTGDTTP LPVTSTSSAS TGHVTPLHVT SPSSASTGHA TPLPVTSLSS ASTGDTMPLP VTSPSSASTG DTTPLPVTDA SSVSTGHTTP LHVTDASSAS TGQATPLPVT SLSSVSTGDT TPLPVTSPSS ASTGHATPLL VTDTSSASTG HATPLPVTDA SSVSTDHATS LPVTIPSAAS TGHTTPLPVT DTSSASTGQA TSLLVTDTSS VSTGDTTPLP VTSTSSASTG HVTPLHVTSP SSASTGHATP LPVTSLSSAS TGDTMPLPVT SPSSASTGDT TPLPVTDASS VSTGHTTPLP VTSPSSASTG HTTPLPVTDT SSASKGDTTP LPVTSPSSAS TGHTTPLPVT DTSSASTGDT TPLPVTNASS LSTGHATPLH VTSPSSASTG HATPLPVTST SSASTGHATP LPVTGLSSAT TDDTTRLPVT DVSSASTGQA TPLPVTSLSS VSTGDTTPLP VTSPSSASTG HASPLLVTDA SSASTGQATP LPVTDTSSVS TAHATPLPVT GLSSASTDDT TRLPVTDVSS ASTGQAIPLP VTSPSSASTG DTTPLPVTDA SSASTGDTTS LPVTIPSSAS SGHTTSLPVT DASSVSTGHA TSLLVTDASS VSTGDTTPLP VTDTNSASTG DTTPLHVTDA SSVSTGHATS LPVTSLSSAS TGDTTPLPVT SPSSASSGHT TPLPVTDASS VPTGHATSLP VTDASSVSTG HATPLPVTDA SSVSTGHATP LPVTDTSSVS TGQATPLPVT SLSSASTGDT TPLPVTDTSS ASTGQDTPLP VTSLSSVSTG DTTPLPVTNP SSASTGHATP LLVTDASSIS TGHATSLLVT DASSVSTGHA TALHDTDASS LSTGDTTPLP VTSPSSTSTG DTTPLPVTET SSVSTGHATS LPVTDTSSAS TGHATSLPVT DTSSASTGHA TPLPVTDTSS ASTGQATPLP VTSPSSASTG HAIPLLVTDT SSASTGQATP LPVTSLSSAS TGDTTPLPVT DASSVSTGHA TSLPVTSLSS VSTGDTTPLP VTSPSSASTG HATPLHVTDA SSASTGHATP LPVTSLSSAS TGDTTPLPVT SPSSASTGHA TPLHVTDASS VSTGDTTPLP VTSSSSASSG HTTPLPVTDA SSASTGDTTP LPVTDTSSAS TGHATHLPVT GLSSASTGDT TRLPVTNVSS ASTGHATPLP VTSTSSASTG DTTPLPGTDT SSVSTGHTTP LLVTDASSVS TGDTTRLPVT SPSSASTGHT TPLPVTDTPS ASTGDTTPLP VTNASSLSTR HATSLHVTSP SSASTGHATS LPVTDTSAAS TGHATPLPVT STSSASTGDT TPLPVTDTYS ASTGQATPLP VTSLSSVSTG DTTPLPVTSP SSASTGHATP LLVTDASSAS TGQATPLPVT SLSSVSTGDT TPLPVTSPSS ASTGHATSLP VTDTSSASTG DTTSLPVTDT SSAYTGDTTS LPVTDTSSSS TGDTTPLLVT ETSSVSTGDT TPLPVTDTSS ASTGHATPLP VTNTSSVSTG HATPLHVTSP SSASTGHTTP LPVTDASSVS TGHATSLPVT DASSVFTGHA TSLPVTIPSS ASSGHTTPLP VTDASSVSTG HATSLPVTDA SSVSTGHATP LPVTDASSVS TGHATPLPLT SLSSVSTGDT TPLPVTDTSS ASTGQATPLP VTSLSSVSTG DTTPLPVTDT SSASTGHATS LPVTDTSSAS TGHATPLPDT DTSSASTGHA TLLPVTDTSS ASIGHATSLP VTDTSSISTG HATPLHVTSP SSASTGHATP LPVTDTSSAS TGHANPLHVT SPSSASTGHA TPLPVTDTSS ASTGHATPLP VTSLSSVSTG DTTPLPVTSP SSASTGHTTP LPVTDTSSAS TGQATALPVT STSSASTGDT TPLPVTDTSS ASTGQATPLP VTSLSSVSTG DTTPLPVTSP SSASTGHATP LLVTDASSAS TGQATPLPVT SLSSVSTGDT TPLPVTSPSS ASTGHATSLP VTDTSSASTG DTTSLPVTDT SSAYTGDTTS LPVTDTSSSS TGDTTPLLVT ETSSVSTGHA TPLLVTDASS ASTGHATPLH VTSPSSASTG DTTPVPVTDT SSVSTGHATP LPVTGLSSAS TGDTTRLPVT DISSASTGQA TPLPVTNTSS VSTGDTMPLP VTSPSSASTG HATPLPVTST SSASTGHATP VPVTSTSSAS TGHTTPLPVT DTSSASTGDT TPLPVTSPSS ASTGHTTPLH VTIPSSASTG DTSTLPVTGA SSASTGHATP LPVTDTSSVS TGHATPLPVT SLSSVSTGDT TPLPVTDASS ASTGQATPLP VTSLSSVSTG DTTPLLVTDA SSVSTGHATP LPVTDTSSAS TGDTTRLPVT DTSSASTGQA TPLPVTSLSS VSTGDTTPLL VTDASSVSTG HATPLPVTDT SSASTGDTTR LPVTDTSSAS TGQATPLPVT IPSSSSSGHT TPLPVTSTSS VSTGHVTPLH VTSPSSASTG HVTPLPVTST SSASTGHATP LLVTDASSVS TGHATPLPVT DASSASTGDT TPLPVTDTSS ASTGQATPLP VTSLSSVSTG DTTPLPVTDA SSASTGHATP LPVTIPSSVS TGDTMPLPVT SPSSASTGHA TPLPVTGLSS ASTGDTTPLP VTDTSSASTR HATPLPVTDT SSASTDDTTR LPVTDVSSAS TGHATPLPVT STSSASTGDT TPLPVTDTSS VSTGHATSLP VTSRSSASTG HATPLPVTDT SSVSTGHATP LPVTSTSSVS TGHATPLPVT SPSSASTGHA TPVPVTSTSS ASTGDTTPLP VTNASSLSTG HATPLHVTSP SSASRGDTST LPVTDASSAS TGHATPLPLT SLSSVSTGDT TPLPVTDTSS ASTGQATPLP VTSLSSVSTG DTTPLPVTIP SSASSGHTTS LPVTDASSVS TGHGTPLPVT STSSASTGDT TPLPVTDTSS ASTGHATPLP VTDTSSASTG HATPLPVTSL SSVSTGHATP LAVSSATSAS TVSSDSPLKM ETPGMTTPSL KTDGGRRTAT SPPPTTSQTI ISTIPSTAMH TRSTAAPIPI LPERGVSLFP YGAGAGDLEF VRRTVDFTSP LFKPATGFPL GSSLRDSLYF TDNGQIIFPE SDYQIFSYPN PLPTGFTGRD PVALVAPFWD DADFSTGRGT TFYQEYETFY GEHSLLVQQA ESWIRKMTNN GGYKARWALK VTWVNAHAYP AQWTLGSNTY QAILSTDGSR SYALFLYQSG GMQWDVAQRS GNPVLMGFSS GDGYFENSPL MSQPVWERYR PDRFLNSNSG LQGLQFYRLH REERPNYRLE CLQWLKSQPR WPSWGWNQVS CPCSWQQGRR DLRFQPVSIG RWGLGSRQLC SFTSWRGGVC CSYGPWGEFR EGWHVQRPWQ LAQELEPQSW CCRWNDKPYL CALYQQRRPH VGCATYRPPQ PAWMFGDPHI TTLDGVSYTF NGLGDFLLVG AQDGNSSFLL QGRTAQTGSA QATNFIAFAA QYRSSSLGPV TVQWLLEPHD AIRVLLDNQT VTFQPDHEDG GGQETFNATG VLLSRNGSEV SASFDGWATV SVIALSNILH ASASLPPEYQ NRTEGLLGVW NNNPEDDFRM PNGSTIPPGS PEEMLFHFGM TWQINGTGLL GKRNDQLPSN FTPVFYSQLQ KNSSWAEHLI SNCDGDSSCI YDTLALRNAS IGLHTREVSK NYEQANATLN QYPPSINGGR VIEAYKGQTT LIQYTSNAED ANFTLRDSCT DLELFENGTL LWTPKSLEPF TLEILARSAK IGLASALQPR TVVCHCNAES QCLYNQTSRV GNSSLELWGA LSCVRTSPAL //