ID A0A0G2JS65_HUMAN Unreviewed; 7418 AA. AC A0A0G2JS65; DT 22-JUL-2015, integrated into UniProtKB/TrEMBL. DT 22-JUL-2015, sequence version 1. DT 16-JAN-2019, entry version 20. DE SubName: Full=Mucin-4 {ECO:0000313|Ensembl:ENSP00000487383}; GN Name=MUC4 {ECO:0000313|Ensembl:ENSP00000487383}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000487383, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000487383, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=16641997; DOI=10.1038/nature04728; RA Muzny D.M., Scherer S.E., Kaul R., Wang J., Yu J., Sudbrak R., RA Buhay C.J., Chen R., Cree A., Ding Y., Dugan-Rocha S., Gill R., RA Gunaratne P., Harris R.A., Hawes A.C., Hernandez J., Hodgson A.V., RA Hume J., Jackson A., Khan Z.M., Kovar-Smith C., Lewis L.R., RA Lozado R.J., Metzker M.L., Milosavljevic A., Miner G.R., Morgan M.B., RA Nazareth L.V., Scott G., Sodergren E., Song X.Z., Steffen D., Wei S., RA Wheeler D.A., Wright M.W., Worley K.C., Yuan Y., Zhang Z., Adams C.Q., RA Ansari-Lari M.A., Ayele M., Brown M.J., Chen G., Chen Z., RA Clendenning J., Clerc-Blankenburg K.P., Chen R., Chen Z., Davis C., RA Delgado O., Dinh H.H., Dong W., Draper H., Ernst S., Fu G., RA Gonzalez-Garay M.L., Garcia D.K., Gillett W., Gu J., Hao B., RA Haugen E., Havlak P., He X., Hennig S., Hu S., Huang W., Jackson L.R., RA Jacob L.S., Kelly S.H., Kube M., Levy R., Li Z., Liu B., Liu J., RA Liu W., Lu J., Maheshwari M., Nguyen B.V., Okwuonu G.O., Palmeiri A., RA Pasternak S., Perez L.M., Phelps K.A., Plopper F.J., Qiang B., RA Raymond C., Rodriguez R., Saenphimmachak C., Santibanez J., Shen H., RA Shen Y., Subramanian S., Tabor P.E., Verduzco D., Waldron L., Wang J., RA Wang J., Wang Q., Williams G.A., Wong G.K., Yao Z., Zhang J., RA Zhang X., Zhao G., Zhou J., Zhou Y., Nelson D., Lehrach H., RA Reinhardt R., Naylor S.L., Yang H., Olson M., Weinstock G., RA Gibbs R.A.; RT "The DNA sequence, annotation and analysis of human chromosome 3."; RL Nature 440:1194-1198(2006). RN [2] {ECO:0000313|Ensembl:ENSP00000487383} RP IDENTIFICATION. RG Ensembl; RL Submitted (JUN-2015) to UniProtKB. CC -!- CAUTION: Lacks conserved residue(s) required for the propagation CC of feature annotation. {ECO:0000256|PROSITE-ProRule:PRU00076}. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AC069513; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AC233280; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AC239646; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR RefSeq; NP_001309397.1; NM_001322468.1. DR UniGene; Hs.369646; -. DR ProteinModelPortal; A0A0G2JS65; -. DR jPOST; A0A0G2JS65; -. DR PeptideAtlas; A0A0G2JS65; -. DR Ensembl; ENST00000626947; ENSP00000487383; ENSG00000277585. DR GeneID; 4585; -. DR CTD; 4585; -. DR HGNC; HGNC:7514; MUC4. DR OrthoDB; 668024at2759; -. DR ChiTaRS; MUC4; human. DR GenomeRNAi; 4585; -. DR Proteomes; UP000005640; Chromosome 3. DR GO; GO:0016021; C:integral component of membrane; IEA:UniProtKB-KW. DR GO; GO:0005176; F:ErbB-2 class receptor binding; IEA:InterPro. DR GO; GO:0030197; F:extracellular matrix constituent, lubricant activity; IEA:InterPro. DR GO; GO:0007160; P:cell-matrix adhesion; IEA:InterPro. DR GO; GO:0010669; P:epithelial structure maintenance; IEA:InterPro. DR GO; GO:0010469; P:regulation of signaling receptor activity; IEA:InterPro. DR InterPro; IPR005533; AMOP_dom. DR InterPro; IPR000742; EGF-like_dom. DR InterPro; IPR039898; Mucin_4. DR InterPro; IPR003886; NIDO_dom. DR InterPro; IPR001846; VWF_type-D. DR PANTHER; PTHR42668; PTHR42668; 2. DR Pfam; PF06119; NIDO; 1. DR Pfam; PF00094; VWD; 1. DR SMART; SM00723; AMOP; 1. DR SMART; SM00181; EGF; 3. DR SMART; SM00539; NIDO; 1. DR SMART; SM00216; VWD; 1. DR PROSITE; PS50856; AMOP; 1. DR PROSITE; PS50026; EGF_3; 2. DR PROSITE; PS51220; NIDO; 1. DR PROSITE; PS51233; VWFD; 1. PE 1: Evidence at protein level; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Disulfide bond {ECO:0000256|PROSITE-ProRule:PRU00076}; KW EGF-like domain {ECO:0000256|PROSITE-ProRule:PRU00076}; KW Membrane {ECO:0000256|SAM:Phobius}; KW Proteomics identification {ECO:0000213|MaxQB:A0A0G2JS65, KW ECO:0000213|PeptideAtlas:A0A0G2JS65}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Signal {ECO:0000256|SAM:SignalP}; KW Transmembrane {ECO:0000256|SAM:Phobius}; KW Transmembrane helix {ECO:0000256|SAM:Phobius}. FT SIGNAL 1 28 {ECO:0000256|SAM:SignalP}. FT CHAIN 29 7418 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5002546446. FT TRANSMEM 7374 7400 Helical. {ECO:0000256|SAM:Phobius}. FT DOMAIN 6403 6558 NIDO. {ECO:0000259|PROSITE:PS51220}. FT DOMAIN 6559 6674 AMOP. {ECO:0000259|PROSITE:PS50856}. FT DOMAIN 6687 6922 VWFD. {ECO:0000259|PROSITE:PS51233}. FT DOMAIN 7124 7163 EGF-like. {ECO:0000259|PROSITE:PS50026}. FT DOMAIN 7327 7366 EGF-like. {ECO:0000259|PROSITE:PS50026}. FT DISULFID 7153 7162 {ECO:0000256|PROSITE-ProRule:PRU00076}. SQ SEQUENCE 7418 AA; 734618 MW; E9A9AE68920B0159 CRC64; MKGARWRRVP WVSLSCLCLC LLPHVVPGTT EDTLITGSKT PAPVTSTGST TATLEGQSTA ASSRTSNQDI SASSQNHQTK STETTSKAQT DTLTQMMTST LFSSPSVHNV METVTQETAP PDEMTTSFPS SVTNTLMMTS KTITMTTSTD STLGNTEETS TAGTESSTPV TSAVSITAGQ EGQSRTTSWR TSIQDTSASS QNHWTRSTQT TRESQTSTLT HRTTSTPSFS PSVHNVTGTV SQKTSPSGET ATSSLCSVTN TSMMTSEKIT VTTSTGSTLG NPGETSSVPV TGSLMPVTSA ALVTVDPEGQ SPVTFSRTST QDTTAFSKNH QTQSVETTRV SQINTLNTLT PVTTSTVLSS PSGFNPSGTV SQETFPSGET TISSPSSVSN TFLVTSKVFR MPISRDSTLG NTEETSLSVS GTISAITSKV STIWWSDTLS TALSPSSLPP KISTAFHTQQ SEGAETTGRP HERSSFSPGV SQEIFTLHET TTWPSSFSSK GHTTWSQTEL PSTSTGAATR LVTGNPSTGA AGTIPRVPSK VSAIGEPGEP TTYSSHSTTL PKTTGAGAQT QWTQETGTTG EALLSSPSYS VTQMIKTATS PSSSPMLDRH TSQQITTAPS TNHSTIHSTS TSPQESPAVS QRGHTQAPQT TQESQTTRSV SPMTDTKTVT TPGSSFTASG HSPSEIVPQD APTISAATTF APAPTGDGHT TQAPTTALQA APSSHDATLG PSGGTSLSKT GALTLANSVV STPGGPEGQW TSASASTSPD TAAAMTHTHQ AESTEASGQT QTSEPASSGS RTTSAGTATP SSSGASGTTP SGSEGISTSG ETTRFSSNPS RDSHTTQSTT ELLSASASHG AIPVSTGMAS SIVPGTFHPT LSEASTAGRP TGQSSPTSPS ASPQETAAIS RMAQTQRTRT SRGSDTISLA SQATDTFSTV PPTPPSITSS GLTSPQTQTH TLSPSGSGKT FTTALISNAT PLPVTYASSA STGHTTPLHV TDASSVSTGH ATPLPVTDTS SESTGHATPL PVTSPSSVST GHTTPLPVTD TSSESTGHVT PLPVTSLSSA STGDSTPLPV TDTSSASTGH VTPLPVTSLS SASTGDTTPL PVTDTSSAST GHATSLPVTD TSSVSTGHTT PLPVTDTSSA STGHATSLPV TDTSSVSTAH ATPLPVTGLS SASTDDTTRL PVTDVSSAST GQAIPLPVTS PSSASTGDTT PLPVTDASSA STGDTTSLPV TIPSSASSGH TTSLPVTDAS SVSTGHATSL LVTDASSVST GDTTPLPVTD TNSASTGDTT PLHVTDASSV STGHATSLPV TSLSSASTGD TTPLPVTSPS SASSGHTTPL PVTDASSVPT GHATSLPVTD ASSVSTGHAT PLPVTDASSV STGHATPLPV TDTSSVSTGQ ATPLPVTSLS SASTGDTTPL PVTDTSSAST GQDTPLPVTS LSSVSTGDTT PLPVTSPSSA STGHATPLLV TDASSVSTGH ATSLLVTDAS SVSTGHATAL HVTDASSLST GDTTPLPVTS PSSASTGDTT PLPVTDTSSA STGHATSLPV TDTSSASTGH ATPLPVTDTS SASTGQATPL PVTGPSSAST GHAIPLLVTD TSSASTGQAT PLPVTSLSSA STGDTTPLPV TDASSVSTGH ATSLPVTSLS SVSTGDTTPL PVTSPSSASS GHTTPLPVTD ASSVSTGDTT PLPVTSPSSA SSGHTTPLPV TSPSSASSGH TTPLPVTDAS SASTGDTTPL PVTDTSSAST GHATHLPVTG LSSASTGDTT RLPVTNVSSA STGHATPLPV TSTSSASTGD TTPLPGTDTS SVSTGHTTPL LVTDASSVST GDTTRLPVTS PSSASTGHTT PLPVTDTPSA STGDTTPLPV TNASSLSTRH TTSLHVTSPS SASTGHATSL PVTDTSSVST GHATPLHVTS PSSASTGDTT PLPVTDTYSA STGQATPLPV TDTSSASTGD TTPLPVTDTS SASTGHATPL PVTNTSSVST GHATPLHVTS PSSASTGHTT PLPVTDASSV STGHATSLPV TDASSVFTGH ATSLPVTIPS SASSGHTTPL PVTDASSVST GHATSLPVTD ASSVSTGHAT PLPVTDASSV STGHATPLPV TDTSSVSTGH ATPLPLTSLS SVSTGDTTPL PVTDTSSAST GQATPLPVTS LSSVSTGDTT PLPVTDTSSA STGHATSLPV TDTSSASTGH ATPLPDTDTS SASTGHATPL PVTDTSSAST GHATLLPVTD TSSASIGHAT PLPVTDTSSI STGHATPLHV TSPSSASTGH ATPLPVTDTS SASTGHANPL HVTSPSSAST GHATPLPVTD TSSASTGHAT PLPVTSLSSV STGDTTPLPV TSPSSASTGH TTPLPVTDTS SASTGQATAL PVTSTSSAST GDTTPLPVTD TSSASTGQAT PLPVTSLSSV STGDTTPLPV TSPSSASTGH ATPLLVTDAS SASTGQATPL PVTDTSSAYT GDTTSLPVTD TSSSSTGDTT PLLVTETSSA STGHATPLHV TSPSSASTGD TTPVPVTDTS SVSTGHATPL PVTGLSSAST GDTTRLPVTD ISSASTGQAT PLPVTNTSSA STGHATPLPV TGLSSASTGD TTRLPVTDIS SASTGQATPL PVTNTSSVST GDTMPLPVTS PSSASTGHAT PLPVTSTSSA STGHATPVPV TSTSSASTGH TTPLPVTDTS SASTGDTTPL PVTSPSSAST GHTTPLHVTI PSSASTGDTS TLPVTGASSA STGHATPLPV TDTSSVSTGH ATPLPVTSFS SVSTGDTTPL PVTDTSSVST GHATPLPVTS FSSVSTGDTT PLPVTDASSA STGHATPLPV TDTSSVSTGH ATPLPLTSLS SVSTGDTTTL PVTDTSSVST GHATPLPVTS FSSVSTGDTT PLPVTDASSA STGHATPLPV TDTSSVSTGH ATPLPVTSLS SVSTGDTTPL PVTDASSAST GQATPLPVTS LSSVSTGDTT PLPVTIPSSA SSGHTTSLPV TDTSSASTGQ ATPLPVTSLS SVSTGDTTPL LVTDASSVST GHATPLPVTD TSSASTGDTT RLPVTDTSSA STGQATPLPV TSLSSVSTGD TTPLLVTNTS SVSRGHATSL PVTIPSSSSS GHTTPLPVTS TSSVSTGHVT PLPVTSTSSA STGHATSLPV TDTSSVSTGH ATSLPVTDTS SVSTGHATPL PVTDASSVST GHATPLPVTD ASSASTGDTT PLPVTNTSSA STGQATPLPV TSLSSVSTGD TMPLPVTSPS SASTGHATPL PVTGLSSAST GDTTPLPVTD TSSASTGHVT PLPVTSLSSA STGDSTPLPV TDTSSASTGH VTPLPVTSLS SASTGDTTPL PVTDTSSAST GHATPLHVTD ASSASTGQAT LLPVTSLSSV STGDTTPLPV TSPSSASTGH ATPLLVTDTS SASTGHATPL PVTDASSVST GHATSLPVTI RSSGSTGHTT PLPVTDTSSA STGQATSLLV TDTSSVSTGD TTPLPVTSTS SASTGHVTPL HVTSPSSAST GHATPLPVTS LSSASTGDTM PLPVTSPSSA STGDTTPLPV TDASSVSTGH TTPLPVTSPS SASTGHTTPL PVTDTTSASK GDTTPLPVTS PSSASTGHTT PLPVTDTSSA STGDTTPLPV TSPSSASTGH ATPLPVTNAS SLSTGHATPL HVTSPSSAST GHATPLPVTS TSSASTGHAT SLPVTSTSSA STGHATPLPV TDNSSVSTGH ATPLPVTGLS SATTDDTTRL PVTDVSSAST GQATPLPVTS LSSVSTGDTT PLPVTSPSSA STGHASPLLV TDASSASTGQ ATPLPVTDTS SVSTAHATPL PVTGLSSAST DDTTRLPVTD VSSASTGQAI PLPVTSPSSA STGDTTPLPV TDASSASTGD TTSLPVTIPS SASSGHTTSL PVTDASSVST GHATSLLVTD ASSVSTGDTT PLPVTDTNSA STGDTTPLHV TDASSVSTGH ATSLPVTSLS SASTGDTTPL PVTSPSSASS GDTTPLPVTD TSSASTGHAT HLPVTGLSSA STGDTTRLPV TNVSSASTGH ATPLPVTSTS SASTGDTTPL PGTDTSSVST GHTTPLLVTD ASSVSTGDTT RLPVTSPSSA STGHTTPLHV TDASSVSTGH TTPLPVTDTS SASTGQATSL LVTDTSSVST GDTTPLPVTS TSSASTGHVT PLHVTSPSSA STGHATPLPV TSLSSASTGD TTPLPVTDTS SVSTGHTTPL PVTSPSSAST GHTTPLPVTD TSSASKGDTT PLPVTSPSSA STGHTTPLPV TDTSSASTGD TTPLPVTNAS SLSTGHATPL HVTSPSSAST GHATPLPVTS TSSASTGHAT PLPVTSTSSA STGHATPLPV TDNSSVSTGH ATPLPVTGLS SATTDDTTRL PVTDVSSAST GQATPLPVTS LSSVSTGDTT PLPVTSPSSA STGHASPLLV TDASSASTGQ ATPLPVTDTS SVSTAHATPL PVTGLSSAST DDTTRLPVTD VSSASTGQAI PLPVTSPSSA STGDTTPLPV TDASSASTGD TTSLPVTIPS SASSGHTTSL PVTDASSVST GHATSLLVTD ASSVSTGDTT PLPVTDTNSA STGDTTPLHV TDASSVSTGH ATSLPVTSLS SASTGDTTPL PVTSPSSASS GHTTSLPVTD ASSVSTGHAT SLPVTIPSSA SSGHTTPLPV TDASSVPTGH ATSLPVTDAS SVSTGHATPL PVTDASSVST GHATPLPVTD TSSVSTGQAT PLPVTSLSSA SSTGDTTPLP VTDTSSASTG QDTPLPVTSL FSVSTGDTTP LPVTSPSSAS TGHATHLLVT DASSVSTGHA TSLLVTDASS VSTGHATALH VTDASSLSTG DTTPLPVTSP SSASTGDTTP LPVTDTSSVS TGHATSLPVT DTSSASTGHA TSLPVTDTSS ASTGQATPLP VTSPSSASTG HAIPLLVTDT SSASTGQATP LPVTSLSSAS TGDTTPLPVT DASSVSTGHA TSLPVTSLSS VSTGDTTPLP VTSPSSASTG HATPLHVTSP SSASTGHATP LPVTSLSSAS TGDTTPLPVT SPSSASTGHA TPLHVTDASS VSTGDTTPLP VTSPSSASSG HTTPLPVTDA SSASTGDTTP LPVTDTSSAS TGHATHLPVT GLSSASTGDT TRLPVTDVSS ASTGHATPLP VTSTSSASTG DTTPLPGTDT SSVSTGHTTP LLVTDASSVS TGDTTRLPVT SPSSASTGHT TPLPVTDTPS ASTGDTTPLP VTNASSLSTR HATSLHVTSP SSASTGHATP LPVTDTSAAS TGHATPLPVT STSSASTGDT TPLPVTDTSS ASTGHATPLP VTNTSSVSTG HATPLHVTSP SSASTGHTTP LPVTDASSVS TGHATSLPVT DASSVSTGHA TPLPVTDASS VSTGHATPLP LTSLSSVSTG DTTPLPVTDT SSASTGQATP LPVTSLSSVS TGDTTPLPVT DTSSASTGHA TSLPVTDTSS ASTGHATPLP VTDTSSISTG HATPLHVTSP SSASTGHATP LPVTDTSSAS TGHATPLPVT SLSSVSTGDT TPLPVTSPSS ASTGHATPLL VTDASSASTG QATPLPVTSL SSVSTGDTTP LPVTSPSSAS TGHATSLPVT DTSSASTGDT TSLPVTDTSS AYTGDTTSLP VTDTSSSSTG DTTPLLVTET SSASTGDTTP VPVTDTSSVS TGHATPLPVT GLSSASTGDT TRLPVTDISS ASTGQATPLP VTNTSSVSTG DTMPLPVTSP SSASTGHATP LPVTSTSSAS TGHATPVPVT STSLASTGHT TPLPVTSPSS ASTGHTTPLP VTDTSSASTG DTTPLPVTNA SSLSTGHTTP LHVTIPSSAS TGDTSTLPVT GASSASTGHA TPLPVTDTSS VSTGHATPLP VTSFSSVSTG DTTPLPVTDA SSASTGHATP LPVTDTSSAS TGDTTPLPVT DASSASTGQA TPLPVTSLSS VSTGDTTPLP VTIPSSASSG HTTSLPVSDT SSASTGQATP LPVTSLSSVS TGDTTPLLVT DASSVSTGHA TPLPVTDTSS ASTGDTTRLP VTDTSSASTG QATPLPVTSL SSVSTGDTTP LLVTNTSSVS TGHATSLPVT IPSSSSSGHT TPLPVTSTSS VSTGHVTPLH VTSPSSSSTG QATPLPVTST SSVSTGHVTP LHVTSPSSAS TGHATPLPVT STSSASTGHA TPLPVTDASS VSTGHATPLP VTDTSSASTG DTTPLPVTDT SSASTGQATP LPVTSLSSVS TGHATPLAVS SATSASTVSS DSPLKMETSG MTTPSLKTDG GRRTATSPPP TTSQTIISTI PSTAMHTRST AAPIPILPER GVSLFPYGAD AGDLEFVRRT VDFTSPLFKP ATGFPLGSSL RDSLYFTDNG QIIFPESDYQ IFSYPNPLPT GFTGRDPVAL VAPFWDDADF STGRGTTFYQ EYETFYGEHS LLVQQAESWI RKMTNNGGYK ARWALKVTWV NAHAYPAQWT LGSNTYQAIL STDGSRSYAL FLYQSGGMQW DVAQRSGNPV LMGFSSGDGY FENSPLMSQP VWERYRPDRF LNSNSGLQGL QFYRLHREER PNYRLECLQW LKSQPRWPSW GWNQVSCPCS WQQGRRDLRF QPVSIGRWGL GSRQLCSFTS WRGGVCCSYG PWGEFREGWH VQRPWQLAQE LEPQSWCCRW NDKPYLCALY QQRRPHVGCA TYRPPQPAWM FGDPHITTLD GVSYTFNGLG DFLLVGAQDG NSSFLLQGRT AQTGSAQATN FIAFAAQYRS SSLGPVTVQW LLEPHDAIRV LLDNQTVTFQ PDHEDGGGQE TFNATGVLLS RNGSEVSASF DGWATVSVIA LSNILHASAS LPPEYQNRTE GLLGVWNNNP EDDFRMPNGS TIPPGSPEEM LFHFGMTWQI NGTGLLGKRN DQLPSNFTPV FYSQLQKNSS WAEHLISNCD GDSSCIYDTL ALRNASIGLH TREVSKNYEQ ANATLNQYPP SINGGRVIEA YKGQTTLIQY TSNAEDANFT LRDSCTDLEL FENGTLLWTP KSLEPFTLEI LARSAKIGLA SALQPRTVVC HCNAESQCLY NQTSRVGNSS LEVAGCKCDG GTFGRYCEGS EDACEEPCFP SVHCVPGKGC EACPPNLTGD GRHCAALGSS FLCQNQSCPV NYCYNQGHCY ISQTLGCQPM CTCPPAFTDS RCFLAGNNFS PTVNLELPLR VIQLLLSEEE NASMAEVNAS VAYRLGTLDM RAFLRNSQVE RIDSAAPASG SPIQHWMVIS EFQYRPRGPV IDFLNNQLLA AVVEAFLYHV PRRSEEPRND VVFQPISGED VRDVTALNVS TLKAYFRCDG YKGYDLVYSP QSGFTCVSPC SRGYCDHGGQ CQHLPSGPRC SCVSFSIYTA WGEHCEHLSM KLDAFFGIFF GALGGLLLLG VGTFVVLRFW GCSGARFSYF LNSAEALP //