ID A0A0G2JSC3_HUMAN Unreviewed; 1176 AA. AC A0A0G2JSC3; DT 22-JUL-2015, integrated into UniProtKB/TrEMBL. DT 22-JUL-2015, sequence version 1. DT 16-JAN-2019, entry version 17. DE SubName: Full=Mucin-4 {ECO:0000313|Ensembl:ENSP00000487522}; GN Name=MUC4 {ECO:0000313|Ensembl:ENSP00000487522}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000487522, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000487522, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=16641997; DOI=10.1038/nature04728; RA Muzny D.M., Scherer S.E., Kaul R., Wang J., Yu J., Sudbrak R., RA Buhay C.J., Chen R., Cree A., Ding Y., Dugan-Rocha S., Gill R., RA Gunaratne P., Harris R.A., Hawes A.C., Hernandez J., Hodgson A.V., RA Hume J., Jackson A., Khan Z.M., Kovar-Smith C., Lewis L.R., RA Lozado R.J., Metzker M.L., Milosavljevic A., Miner G.R., Morgan M.B., RA Nazareth L.V., Scott G., Sodergren E., Song X.Z., Steffen D., Wei S., RA Wheeler D.A., Wright M.W., Worley K.C., Yuan Y., Zhang Z., Adams C.Q., RA Ansari-Lari M.A., Ayele M., Brown M.J., Chen G., Chen Z., RA Clendenning J., Clerc-Blankenburg K.P., Chen R., Chen Z., Davis C., RA Delgado O., Dinh H.H., Dong W., Draper H., Ernst S., Fu G., RA Gonzalez-Garay M.L., Garcia D.K., Gillett W., Gu J., Hao B., RA Haugen E., Havlak P., He X., Hennig S., Hu S., Huang W., Jackson L.R., RA Jacob L.S., Kelly S.H., Kube M., Levy R., Li Z., Liu B., Liu J., RA Liu W., Lu J., Maheshwari M., Nguyen B.V., Okwuonu G.O., Palmeiri A., RA Pasternak S., Perez L.M., Phelps K.A., Plopper F.J., Qiang B., RA Raymond C., Rodriguez R., Saenphimmachak C., Santibanez J., Shen H., RA Shen Y., Subramanian S., Tabor P.E., Verduzco D., Waldron L., Wang J., RA Wang J., Wang Q., Williams G.A., Wong G.K., Yao Z., Zhang J., RA Zhang X., Zhao G., Zhou J., Zhou Y., Nelson D., Lehrach H., RA Reinhardt R., Naylor S.L., Yang H., Olson M., Weinstock G., RA Gibbs R.A.; RT "The DNA sequence, annotation and analysis of human chromosome 3."; RL Nature 440:1194-1198(2006). RN [2] {ECO:0000313|Ensembl:ENSP00000487522} RP IDENTIFICATION. RG Ensembl; RL Submitted (JUN-2015) to UniProtKB. CC -!- CAUTION: Lacks conserved residue(s) required for the propagation CC of feature annotation. {ECO:0000256|PROSITE-ProRule:PRU00076}. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AC069513; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AC233280; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AC239646; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR ProteinModelPortal; A0A0G2JSC3; -. DR jPOST; A0A0G2JSC3; -. DR PeptideAtlas; A0A0G2JSC3; -. DR Ensembl; ENST00000626242; ENSP00000487522; ENSG00000277585. DR HGNC; HGNC:7514; MUC4. DR ChiTaRS; MUC4; human. DR Proteomes; UP000005640; Chromosome 3. DR GO; GO:0016021; C:integral component of membrane; IEA:UniProtKB-KW. DR GO; GO:0005176; F:ErbB-2 class receptor binding; IEA:InterPro. DR GO; GO:0030197; F:extracellular matrix constituent, lubricant activity; IEA:InterPro. DR GO; GO:0007160; P:cell-matrix adhesion; IEA:InterPro. DR GO; GO:0010669; P:epithelial structure maintenance; IEA:InterPro. DR GO; GO:0010469; P:regulation of signaling receptor activity; IEA:InterPro. DR InterPro; IPR005533; AMOP_dom. DR InterPro; IPR000742; EGF-like_dom. DR InterPro; IPR039898; Mucin_4. DR InterPro; IPR003886; NIDO_dom. DR InterPro; IPR001846; VWF_type-D. DR PANTHER; PTHR42668; PTHR42668; 1. DR Pfam; PF06119; NIDO; 1. DR Pfam; PF00094; VWD; 1. DR SMART; SM00723; AMOP; 1. DR SMART; SM00181; EGF; 3. DR SMART; SM00539; NIDO; 1. DR SMART; SM00216; VWD; 1. DR PROSITE; PS50856; AMOP; 1. DR PROSITE; PS50026; EGF_3; 2. DR PROSITE; PS51220; NIDO; 1. DR PROSITE; PS51233; VWFD; 1. PE 1: Evidence at protein level; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Disulfide bond {ECO:0000256|PROSITE-ProRule:PRU00076}; KW EGF-like domain {ECO:0000256|PROSITE-ProRule:PRU00076}; KW Membrane {ECO:0000256|SAM:Phobius}; KW Proteomics identification {ECO:0000213|MaxQB:A0A0G2JSC3, KW ECO:0000213|PeptideAtlas:A0A0G2JSC3}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Signal {ECO:0000256|SAM:SignalP}; KW Transmembrane {ECO:0000256|SAM:Phobius}; KW Transmembrane helix {ECO:0000256|SAM:Phobius}. FT SIGNAL 1 28 {ECO:0000256|SAM:SignalP}. FT CHAIN 29 1176 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5002546738. FT TRANSMEM 1132 1158 Helical. {ECO:0000256|SAM:Phobius}. FT DOMAIN 161 316 NIDO. {ECO:0000259|PROSITE:PS51220}. FT DOMAIN 317 432 AMOP. {ECO:0000259|PROSITE:PS50856}. FT DOMAIN 445 680 VWFD. {ECO:0000259|PROSITE:PS51233}. FT DOMAIN 882 921 EGF-like. {ECO:0000259|PROSITE:PS50026}. FT DOMAIN 1085 1124 EGF-like. {ECO:0000259|PROSITE:PS50026}. FT DISULFID 911 920 {ECO:0000256|PROSITE-ProRule:PRU00076}. SQ SEQUENCE 1176 AA; 130473 MW; 52534C79DABF6A73 CRC64; MKGARWRRVP WVSLSCLCLC LLPHVVPGMT TPSLKTDGGR RTATSPPPTT SQTIISTIPS TAMHTRSTAA PIPILPERGV SLFPYGADAG DLEFVRRTVD FTSPLFKPAT GFPLGSSLRD SLYFTDNGQI IFPESDYQIF SYPNPLPTGF TGRDPVALVA PFWDDADFST GRGTTFYQEY ETFYGEHSLL VQQAESWIRK MTNNGGYKAR WALKVTWVNA HAYPAQWTLG SNTYQAILST DGSRSYALFL YQSGGMQWDV AQRSGNPVLM GFSSGDGYFE NSPLMSQPVW ERYRPDRFLN SNSGLQGLQF YRLHREERPN YRLECLQWLK SQPRWPSWGW NQVSCPCSWQ QGRRDLRFQP VSIGRWGLGS RQLCSFTSWR GGVCCSYGPW GEFREGWHVQ RPWQLAQELE PQSWCCRWND KPYLCALYQQ RRPHVGCATY RPPQPAWMFG DPHITTLDGV SYTFNGLGDF LLVGAQDGNS SFLLQGRTAQ TGSAQATNFI AFAAQYRSSS LGPVTVQWLL EPHDAIRVLL DNQTVTFQPD HEDGGGQETF NATGVLLSRN GSEVSASFDG WATVSVIALS NILHASASLP PEYQNRTEGL LGVWNNNPED DFRMPNGSTI PPGSPEEMLF HFGMTWQING TGLLGKRNDQ LPSNFTPVFY SQLQKNSSWA EHLISNCDGD SSCIYDTLAL RNASIGLHTR EVSKNYEQAN ATLNQYPPSI NGGRVIEAYK GQTTLIQYTS NAEDANFTLR DSCTDLELFE NGTLLWTPKS LEPFTLEILA RSAKIGLASA LQPRTVVCHC NAESQCLYNQ TSRVGNSSLE VAGCKCDGGT FGRYCEGSED ACEEPCFPSV HCVPGKGCEA CPPNLTGDGR HCAALGSSFL CQNQSCPVNY CYNQGHCYIS QTLGCQPMCT CPPAFTDSRC FLAGNNFSPT VNLELPLRVI QLLLSEEENA SMAEVNASVA YRLGTLDMRA FLRNSQVERI DSAAPASGSP IQHWMVISEF QYRPRGPVID FLNNQLLAAV VEAFLYHVPR RSEEPRNDVV FQPISGEDVR DVTALNVSTL KAYFRCDGYK GYDLVYSPQS GFTCVSPCSR GYCDHGGQCQ HLPSGPRCSC VSFSIYTAWG EHCEHLSMKL DAFFGIFFGA LGGLLLLGVG TFVVLRFWGC SGARFSYFLN SAEALP //