ID E7ETT5_HUMAN Unreviewed; 4510 AA. AC E7ETT5; DT 08-MAR-2011, integrated into UniProtKB/TrEMBL. DT 08-MAR-2011, sequence version 1. DT 16-JAN-2019, entry version 50. DE SubName: Full=Mucin-4 {ECO:0000313|Ensembl:ENSP00000418306}; GN Name=MUC4 {ECO:0000313|Ensembl:ENSP00000418306}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000418306, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000418306, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=16641997; DOI=10.1038/nature04728; RA Muzny D.M., Scherer S.E., Kaul R., Wang J., Yu J., Sudbrak R., RA Buhay C.J., Chen R., Cree A., Ding Y., Dugan-Rocha S., Gill R., RA Gunaratne P., Harris R.A., Hawes A.C., Hernandez J., Hodgson A.V., RA Hume J., Jackson A., Khan Z.M., Kovar-Smith C., Lewis L.R., RA Lozado R.J., Metzker M.L., Milosavljevic A., Miner G.R., Morgan M.B., RA Nazareth L.V., Scott G., Sodergren E., Song X.Z., Steffen D., Wei S., RA Wheeler D.A., Wright M.W., Worley K.C., Yuan Y., Zhang Z., Adams C.Q., RA Ansari-Lari M.A., Ayele M., Brown M.J., Chen G., Chen Z., RA Clendenning J., Clerc-Blankenburg K.P., Chen R., Chen Z., Davis C., RA Delgado O., Dinh H.H., Dong W., Draper H., Ernst S., Fu G., RA Gonzalez-Garay M.L., Garcia D.K., Gillett W., Gu J., Hao B., RA Haugen E., Havlak P., He X., Hennig S., Hu S., Huang W., Jackson L.R., RA Jacob L.S., Kelly S.H., Kube M., Levy R., Li Z., Liu B., Liu J., RA Liu W., Lu J., Maheshwari M., Nguyen B.V., Okwuonu G.O., Palmeiri A., RA Pasternak S., Perez L.M., Phelps K.A., Plopper F.J., Qiang B., RA Raymond C., Rodriguez R., Saenphimmachak C., Santibanez J., Shen H., RA Shen Y., Subramanian S., Tabor P.E., Verduzco D., Waldron L., Wang J., RA Wang J., Wang Q., Williams G.A., Wong G.K., Yao Z., Zhang J., RA Zhang X., Zhao G., Zhou J., Zhou Y., Nelson D., Lehrach H., RA Reinhardt R., Naylor S.L., Yang H., Olson M., Weinstock G., RA Gibbs R.A.; RT "The DNA sequence, annotation and analysis of human chromosome 3."; RL Nature 440:1194-1198(2006). RN [2] {ECO:0000313|Ensembl:ENSP00000418306} RP IDENTIFICATION. RG Ensembl; RL Submitted (JUL-2011) to UniProtKB. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AC069513; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AC233280; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR ProteinModelPortal; E7ETT5; -. DR jPOST; E7ETT5; -. DR MaxQB; E7ETT5; -. DR PeptideAtlas; E7ETT5; -. DR PRIDE; E7ETT5; -. DR Ensembl; ENST00000477756; ENSP00000418306; ENSG00000145113. DR UCSC; uc062rxx.1; human. DR EuPathDB; HostDB:ENSG00000145113.21; -. DR HGNC; HGNC:7514; MUC4. DR OpenTargets; ENSG00000145113; -. DR eggNOG; ENOG410IHUZ; Eukaryota. DR eggNOG; ENOG4111F6U; LUCA. DR GeneTree; ENSGT00730000110943; -. DR ChiTaRS; MUC4; human. DR Proteomes; UP000005640; Chromosome 3. DR Bgee; ENSG00000145113; Expressed in 134 organ(s), highest expression level in nasal cavity epithelium. DR ExpressionAtlas; E7ETT5; baseline and differential. DR GO; GO:0005176; F:ErbB-2 class receptor binding; IEA:InterPro. DR GO; GO:0030197; F:extracellular matrix constituent, lubricant activity; IEA:InterPro. DR GO; GO:0007160; P:cell-matrix adhesion; IEA:InterPro. DR GO; GO:0010669; P:epithelial structure maintenance; IEA:InterPro. DR GO; GO:0010469; P:regulation of signaling receptor activity; IEA:InterPro. DR InterPro; IPR039898; Mucin_4. DR InterPro; IPR003886; NIDO_dom. DR PANTHER; PTHR42668; PTHR42668; 2. DR Pfam; PF06119; NIDO; 1. DR SMART; SM00539; NIDO; 1. DR PROSITE; PS51220; NIDO; 1. PE 1: Evidence at protein level; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Proteomics identification {ECO:0000213|MaxQB:E7ETT5, KW ECO:0000213|PeptideAtlas:E7ETT5}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Signal {ECO:0000256|SAM:SignalP}. FT SIGNAL 1 28 {ECO:0000256|SAM:SignalP}. FT CHAIN 29 4510 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5003217538. FT DOMAIN 4397 4510 NIDO. {ECO:0000259|PROSITE:PS51220}. SQ SEQUENCE 4510 AA; 442190 MW; B00BA320B9D52984 CRC64; MKGARWRRVP WVSLSCLCLC LLPHVVPGTT EDTLITGSKT AAPVTSTGST TATLEGQSTA ASSRTSNQDI SASSQNHQTK STETTSKAQT DTLTQMMTST LFSSPSVHNV METAPPDEMT TSFPSSVTNT LMMTSKTITM TTSTDSTLGN TEETSTAGTE SSTPVTSAVS ITAGQEGQSR TTSWRTSIQD TSASSQNHWT RSTQTTRESQ TSTLTHRTTS TPSFSPSVHN VTGTVSQKTS PSGETATSSL CSVTNTSMMT SEKITVTTST GSTLGNPGET SSVPVTGSLM PVTSAALVTF DPEGQSPATF SRTSTQDTTA FSKNHQTQSV ETTRVSQINT LNTLTPVTTS TVLSSPSGFN PSGTVSQETF PSGETTTSSP SSVSNTFLVT SKVFRMPTSR DSTLGNTEET SLSVSGTISA ITSKVSTIWW SDTLSTALSP SSLPPKISTA FHTQQSEGAE TTGRPHERSS FSPGVSQEIF TLHETTTWPS SFSSKGHTTW SQTELPSTST GAATRLVTGN PSTGTAGTIP RVPSKVSAIG EPGEPTTYSS HSTTLPKTTG AGAQTQWTQE TGTTGEALLS SPSYSVTQMI KTATSPSSSP MLDRHTSQQI TTAPSTNHST IHSTSTSPQE SPAVSQRGHT QAPQTTQESQ TTRSVSPMTD TKTVTTPGSS FTASGHSPSE IVPQDAPTIS AATTFAPAPT GDGHTTQAPT TALQAAPSSH DATLGPSGGT SLSKTGALTL ANSVVSTPGG PEGQWTSASA STSPDTAAAM THTHQAESTE ASGQTQTSEP ASSGSRTTSA GTATPSSSGA SGTTPSGSEG ISTSGETTRF SSNPSRDSHT TQSTTELLSA SASHGAIPVS TGMASSIVPG TFHPTLSEAS TAGRPTGQSS PTSPSASPQE TAAISRMAQT QRTRTSRGSD TISLASQATD TFSTVPPTPP SITSTGLTSP QTETHTLSPS GSGKTFTTAL ISNATPLPVT YASSASTGHT TPLHVTDASS VSTGHATPLP VTSPSSVSTG HTTPLPVTDT SSESTGHVTP LPVTSFSSAS TGDSTPLPVT DTSSASTGHV TPLPVTSLSS ASTGDTTPLP VTDTSSASTG HATSLPVTDT SSVSTGHTTP LPVTDTSSAS TGHATSLPVT DTSSVSTGHT TPLHVTDASS ASTGQATPLP VTSLSSVSTG DTTPLPVTSP SSASTGHATP LLVTDTSSAS TGHATPLPVT DASSVSTDHA TSLPVTIPSA ASTGHTTPLP VTDTSSASTG QATSLLVTDT SSVSTGDTTP LPVTSTSSAS TGHVTPLHVT SPSSASTGHA TPLPVTSLSS ASTGDTMPLP VTSPSSASTG DTTPLPVTDA SSVSTGHTTP LHVTDASSAS TGQATPLPVT SLSSVSTGDT TPLPVTSPSS ASTGHATPLL VTDTSSASTG HATPLPVTDA SSVSTDHATS LPVTIPSAAS TGHTTPLPVT DTSSASTGQA TSLLVTDTSS VSTGDTTPLP VTSTSSASTG HVTPLHVTSP SSASTGHATP LPVTSLSSAS TGDTMPLPVT SPSSASTGDT TPLPVTDASS VSTGHTTPLP VTSPSSASTG HTTPLPVTDT SSASKGDTTP LPVTSPSSAS TGHTTPLPVT DTSSASTGDT TPLPVTNASS LSTGHATPLH VTSPSSASTG HATPLPVTST SSASTGHATP LPVTGLSSAT TDDTTRLPVT DVSSASTGQA TPLPVTSLSS VSTGDTTPLP VTSPSSASTG HASPLLVTDA SSASTGQATP LPVTDTSSVS TAHATPLPVT GLSSASTDDT TRLPVTDVSS ASTGQAIPLP VTSPSSASTG DTTPLPVTDA SSASTGDTTS LPVTIPSSAS SGHTTSLPVT DASSVSTGHA TSLLVTDASS VSTGDTTPLP VTDTNSASTG DTTPLHVTDA SSVSTGHATS LPVTSLSSAS TGDTTPLPVT SPSSASSGHT TPLPVTDASS VPTGHATSLP VTDASSVSTG HATPLPVTDA SSVSTGHATP LPVTDTSSVS TGQATPLPVT SLSSASTGDT TPLPVTDTSS ASTGQDTPLP VTSLSSVSTG DTTPLPVTNP SSASTGHATP LLVTDASSIS TGHATSLLVT DASSVSTGHA TALHDTDASS LSTGDTTPLP VTSPSSTSTG DTTPLPVTET SSVSTGHATS LPVTDTSSAS TGHATSLPVT DTSSASTGHA TPLPVTDTSS ASTGQATPLP VTSPSSASTG HAIPLLVTDT SSASTGQATP LPVTSLSSAS TGDTTPLPVT DASSVSTGHA TSLPVTSLSS VSTGDTTPLP VTSPSSASTG HATPLHVTDA SSASTGHATP LPVTSLSSAS TGDTTPLPVT SPSSASTGHA TPLHVTDASS VSTGDTTPLP VTSSSSASSG HTTPLPVTDA SSASTGDTTP LPVTDTSSAS TGHATHLPVT GLSSASTGDT TRLPVTNVSS ASTGHATPLP VTSTSSASTG DTTPLPGTDT SSVSTGHTTP LLVTDASSVS TGDTTRLPVT SPSSASTGHT TPLPVTDTPS ASTGDTTPLP VTNASSLSTR HATSLHVTSP SSASTGHATS LPVTDTSAAS TGHATPLPVT STSSASTGDT TPLPVTDTYS ASTGQATPLP VTSLSSVSTG DTTPLPVTSP SSASTGHATP LLVTDASSAS TGQATPLPVT SLSSVSTGDT TPLPVTSPSS ASTGHATSLP VTDTSSASTG DTTSLPVTDT SSAYTGDTTS LPVTDTSSSS TGDTTPLLVT ETSSVSTGDT TPLPVTDTSS ASTGHATPLP VTNTSSVSTG HATPLHVTSP SSASTGHTTP LPVTDASSVS TGHATSLPVT DASSVFTGHA TSLPVTIPSS ASSGHTTPLP VTDASSVSTG HATSLPVTDA SSVSTGHATP LPVTDASSVS TGHATPLPLT SLSSVSTGDT TPLPVTDTSS ASTGQATPLP VTSLSSVSTG DTTPLPVTDT SSASTGHATS LPVTDTSSAS TGHATPLPDT DTSSASTGHA TLLPVTDTSS ASIGHATSLP VTDTSSISTG HATPLHVTSP SSASTGHATP LPVTDTSSAS TGHANPLHVT SPSSASTGHA TPLPVTDTSS ASTGHATPLP VTSLSSVSTG DTTPLPVTSP SSASTGHTTP LPVTDTSSAS TGQATALPVT STSSASTGDT TPLPVTDTSS ASTGQATPLP VTSLSSVSTG DTTPLPVTSP SSASTGHATP LLVTDASSAS TGQATPLPVT SLSSVSTGDT TPLPVTSPSS ASTGHATSLP VTDTSSASTG DTTSLPVTDT SSAYTGDTTS LPVTDTSSSS TGDTTPLLVT ETSSVSTGHA TPLLVTDASS ASTGHATPLH VTSPSSASTG DTTPVPVTDT SSVSTGHATP LPVTGLSSAS TGDTTRLPVT DISSASTGQA TPLPVTNTSS VSTGDTMPLP VTSPSSASTG HATPLPVTST SSASTGHATP VPVTSTSSAS TGHTTPLPVT DTSSASTGDT TPLPVTSPSS ASTGHTTPLH VTIPSSASTG DTSTLPVTGA SSASTGHATP LPVTDTSSVS TGHATPLPVT SLSSVSTGDT TPLPVTDASS ASTGQATPLP VTSLSSVSTG DTTPLLVTDA SSVSTGHATP LPVTDTSSAS TGDTTRLPVT DTSSASTGQA TPLPVTSLSS VSTGDTTPLL VTDASSVSTG HATPLPVTDT SSASTGDTTR LPVTDTSSAS TGQATPLPVT IPSSSSSGHT TPLPVTSTSS VSTGHVTPLH VTSPSSASTG HVTPLPVTST SSASTGHATP LLVTDASSVS TGHATPLPVT DASSASTGDT TPLPVTDTSS ASTGQATPLP VTSLSSVSTG DTTPLPVTDA SSASTGHATP LPVTIPSSVS TGDTMPLPVT SPSSASTGHA TPLPVTGLSS ASTGDTTPLP VTDTSSASTR HATPLPVTDT SSASTDDTTR LPVTDVSSAS TGHATPLPVT STSSASTGDT TPLPVTDTSS VSTGHATSLP VTSRSSASTG HATPLPVTDT SSVSTGHATP LPVTSTSSVS TGHATPLPVT SPSSASTGHA TPVPVTSTSS ASTGDTTPLP VTNASSLSTG HATPLHVTSP SSASRGDTST LPVTDASSAS TGHATPLPLT SLSSVSTGDT TPLPVTDTSS ASTGQATPLP VTSLSSVSTG DTTPLPVTIP SSASSGHTTS LPVTDASSVS TGHGTPLPVT STSSASTGDT TPLPVTDTSS ASTGHATPLP VTDTSSASTG HATPLPVTSL SSVSTGHATP LAVSSATSAS TVSSDSPLKM ETPGMTTPSL KTDGGRRTAT SPPPTTSQTI ISTIPSTAMH TRSTAAPIPI LPERGVSLFP YGAGAGDLEF VRRTVDFTSP LFKPATGFPL GSSLRDSLYF TDNGQIIFPE SDYQIFSYPN PLPTGFTGRD PVALVAPFWD DADFSTGRGT TFYQEYETFY GEHSLLVQQA ESWIRKMTNN GGYKARWALK VTWVNAHAYP AQWTLGSNTY QAILSTDGSR SYALFLYQSG GMQWDVAQRS VEMAISKTAH //