ID A0A0G2JRU8_HUMAN Unreviewed; 1125 AA. AC A0A0G2JRU8; DT 22-JUL-2015, integrated into UniProtKB/TrEMBL. DT 22-JUL-2015, sequence version 1. DT 16-JAN-2019, entry version 17. DE SubName: Full=Mucin-4 {ECO:0000313|Ensembl:ENSP00000487084}; GN Name=MUC4 {ECO:0000313|Ensembl:ENSP00000487084}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000487084, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000487084, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=16641997; DOI=10.1038/nature04728; RA Muzny D.M., Scherer S.E., Kaul R., Wang J., Yu J., Sudbrak R., RA Buhay C.J., Chen R., Cree A., Ding Y., Dugan-Rocha S., Gill R., RA Gunaratne P., Harris R.A., Hawes A.C., Hernandez J., Hodgson A.V., RA Hume J., Jackson A., Khan Z.M., Kovar-Smith C., Lewis L.R., RA Lozado R.J., Metzker M.L., Milosavljevic A., Miner G.R., Morgan M.B., RA Nazareth L.V., Scott G., Sodergren E., Song X.Z., Steffen D., Wei S., RA Wheeler D.A., Wright M.W., Worley K.C., Yuan Y., Zhang Z., Adams C.Q., RA Ansari-Lari M.A., Ayele M., Brown M.J., Chen G., Chen Z., RA Clendenning J., Clerc-Blankenburg K.P., Chen R., Chen Z., Davis C., RA Delgado O., Dinh H.H., Dong W., Draper H., Ernst S., Fu G., RA Gonzalez-Garay M.L., Garcia D.K., Gillett W., Gu J., Hao B., RA Haugen E., Havlak P., He X., Hennig S., Hu S., Huang W., Jackson L.R., RA Jacob L.S., Kelly S.H., Kube M., Levy R., Li Z., Liu B., Liu J., RA Liu W., Lu J., Maheshwari M., Nguyen B.V., Okwuonu G.O., Palmeiri A., RA Pasternak S., Perez L.M., Phelps K.A., Plopper F.J., Qiang B., RA Raymond C., Rodriguez R., Saenphimmachak C., Santibanez J., Shen H., RA Shen Y., Subramanian S., Tabor P.E., Verduzco D., Waldron L., Wang J., RA Wang J., Wang Q., Williams G.A., Wong G.K., Yao Z., Zhang J., RA Zhang X., Zhao G., Zhou J., Zhou Y., Nelson D., Lehrach H., RA Reinhardt R., Naylor S.L., Yang H., Olson M., Weinstock G., RA Gibbs R.A.; RT "The DNA sequence, annotation and analysis of human chromosome 3."; RL Nature 440:1194-1198(2006). RN [2] {ECO:0000313|Ensembl:ENSP00000487084} RP IDENTIFICATION. RG Ensembl; RL Submitted (JUN-2015) to UniProtKB. CC -!- CAUTION: Lacks conserved residue(s) required for the propagation CC of feature annotation. {ECO:0000256|PROSITE-ProRule:PRU00076}. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AC069513; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AC233280; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AC239646; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR jPOST; A0A0G2JRU8; -. DR PeptideAtlas; A0A0G2JRU8; -. DR Ensembl; ENST00000626364; ENSP00000487084; ENSG00000277585. DR HGNC; HGNC:7514; MUC4. DR ChiTaRS; MUC4; human. DR Proteomes; UP000005640; Chromosome 3. DR GO; GO:0016021; C:integral component of membrane; IEA:UniProtKB-KW. DR GO; GO:0005176; F:ErbB-2 class receptor binding; IEA:InterPro. DR GO; GO:0030197; F:extracellular matrix constituent, lubricant activity; IEA:InterPro. DR GO; GO:0007160; P:cell-matrix adhesion; IEA:InterPro. DR GO; GO:0010669; P:epithelial structure maintenance; IEA:InterPro. DR GO; GO:0010469; P:regulation of signaling receptor activity; IEA:InterPro. DR InterPro; IPR005533; AMOP_dom. DR InterPro; IPR000742; EGF-like_dom. DR InterPro; IPR039898; Mucin_4. DR InterPro; IPR003886; NIDO_dom. DR InterPro; IPR001846; VWF_type-D. DR PANTHER; PTHR42668; PTHR42668; 1. DR Pfam; PF06119; NIDO; 1. DR Pfam; PF00094; VWD; 1. DR SMART; SM00723; AMOP; 1. DR SMART; SM00181; EGF; 3. DR SMART; SM00539; NIDO; 1. DR SMART; SM00216; VWD; 1. DR PROSITE; PS50856; AMOP; 1. DR PROSITE; PS50026; EGF_3; 2. DR PROSITE; PS51220; NIDO; 1. DR PROSITE; PS51233; VWFD; 1. PE 1: Evidence at protein level; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Disulfide bond {ECO:0000256|PROSITE-ProRule:PRU00076}; KW EGF-like domain {ECO:0000256|PROSITE-ProRule:PRU00076}; KW Membrane {ECO:0000256|SAM:Phobius}; KW Proteomics identification {ECO:0000213|MaxQB:A0A0G2JRU8, KW ECO:0000213|PeptideAtlas:A0A0G2JRU8}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Signal {ECO:0000256|SAM:SignalP}; KW Transmembrane {ECO:0000256|SAM:Phobius}; KW Transmembrane helix {ECO:0000256|SAM:Phobius}. FT SIGNAL 1 28 {ECO:0000256|SAM:SignalP}. FT CHAIN 29 1125 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5002546725. FT TRANSMEM 1081 1107 Helical. {ECO:0000256|SAM:Phobius}. FT DOMAIN 110 265 NIDO. {ECO:0000259|PROSITE:PS51220}. FT DOMAIN 266 381 AMOP. {ECO:0000259|PROSITE:PS50856}. FT DOMAIN 394 629 VWFD. {ECO:0000259|PROSITE:PS51233}. FT DOMAIN 831 870 EGF-like. {ECO:0000259|PROSITE:PS50026}. FT DOMAIN 1034 1073 EGF-like. {ECO:0000259|PROSITE:PS50026}. FT DISULFID 860 869 {ECO:0000256|PROSITE-ProRule:PRU00076}. SQ SEQUENCE 1125 AA; 125188 MW; 119E04D2D82C1099 CRC64; MKGARWRRVP WVSLSCLCLC LLPHVVPGVS LFPYGADAGD LEFVRRTVDF TSPLFKPATG FPLGSSLRDS LYFTDNGQII FPESDYQIFS YPNPLPTGFT GRDPVALVAP FWDDADFSTG RGTTFYQEYE TFYGEHSLLV QQAESWIRKM TNNGGYKARW ALKVTWVNAH AYPAQWTLGS NTYQAILSTD GSRSYALFLY QSGGMQWDVA QRSGNPVLMG FSSGDGYFEN SPLMSQPVWE RYRPDRFLNS NSGLQGLQFY RLHREERPNY RLECLQWLKS QPRWPSWGWN QVSCPCSWQQ GRRDLRFQPV SIGRWGLGSR QLCSFTSWRG GVCCSYGPWG EFREGWHVQR PWQLAQELEP QSWCCRWNDK PYLCALYQQR RPHVGCATYR PPQPAWMFGD PHITTLDGVS YTFNGLGDFL LVGAQDGNSS FLLQGRTAQT GSAQATNFIA FAAQYRSSSL GPVTVQWLLE PHDAIRVLLD NQTVTFQPDH EDGGGQETFN ATGVLLSRNG SEVSASFDGW ATVSVIALSN ILHASASLPP EYQNRTEGLL GVWNNNPEDD FRMPNGSTIP PGSPEEMLFH FGMTWQINGT GLLGKRNDQL PSNFTPVFYS QLQKNSSWAE HLISNCDGDS SCIYDTLALR NASIGLHTRE VSKNYEQANA TLNQYPPSIN GGRVIEAYKG QTTLIQYTSN AEDANFTLRD SCTDLELFEN GTLLWTPKSL EPFTLEILAR SAKIGLASAL QPRTVVCHCN AESQCLYNQT SRVGNSSLEV AGCKCDGGTF GRYCEGSEDA CEEPCFPSVH CVPGKGCEAC PPNLTGDGRH CAALGSSFLC QNQSCPVNYC YNQGHCYISQ TLGCQPMCTC PPAFTDSRCF LAGNNFSPTV NLELPLRVIQ LLLSEEENAS MAEVNASVAY RLGTLDMRAF LRNSQVERID SAAPASGSPI QHWMVISEFQ YRPRGPVIDF LNNQLLAAVV EAFLYHVPRR SEEPRNDVVF QPISGEDVRD VTALNVSTLK AYFRCDGYKG YDLVYSPQSG FTCVSPCSRG YCDHGGQCQH LPSGPRCSCV SFSIYTAWGE HCEHLSMKLD AFFGIFFGAL GGLLLLGVGT FVVLRFWGCS GARFSYFLNS AEALP //