ID A0A0G2JM87_HUMAN Unreviewed; 1779 AA. AC A0A0G2JM87; DT 22-JUL-2015, integrated into UniProtKB/TrEMBL. DT 22-JUL-2015, sequence version 1. DT 16-JAN-2019, entry version 15. DE SubName: Full=Mucin-2 {ECO:0000313|Ensembl:ENSP00000478743}; GN Name=MUC2 {ECO:0000313|Ensembl:ENSP00000478743}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000478743, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000478743, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=16554811; DOI=10.1038/nature04632; RA Taylor T.D., Noguchi H., Totoki Y., Toyoda A., Kuroki Y., Dewar K., RA Lloyd C., Itoh T., Takeda T., Kim D.W., She X., Barlow K.F., Bloom T., RA Bruford E., Chang J.L., Cuomo C.A., Eichler E., FitzGerald M.G., RA Jaffe D.B., LaButti K., Nicol R., Park H.S., Seaman C., Sougnez C., RA Yang X., Zimmer A.R., Zody M.C., Birren B.W., Nusbaum C., Fujiyama A., RA Hattori M., Rogers J., Lander E.S., Sakaki Y.; RT "Human chromosome 11 DNA sequence and analysis including novel gene RT identification."; RL Nature 440:497-500(2006). RN [2] {ECO:0000313|Ensembl:ENSP00000478743} RP IDENTIFICATION. RG Ensembl; RL Submitted (JUN-2015) to UniProtKB. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AC139749; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR ProteinModelPortal; A0A0G2JM87; -. DR jPOST; A0A0G2JM87; -. DR PeptideAtlas; A0A0G2JM87; -. DR Ensembl; ENST00000622511; ENSP00000478743; ENSG00000278466. DR HGNC; HGNC:7512; MUC2. DR ChiTaRS; MUC2; human. DR Proteomes; UP000005640; Chromosome 11. DR GO; GO:0070701; C:mucus layer; IEA:InterPro. DR InterPro; IPR028580; MUC2. DR InterPro; IPR036084; Ser_inhib-like_sf. DR InterPro; IPR002919; TIL_dom. DR InterPro; IPR014853; Unchr_dom_Cys-rich. DR InterPro; IPR001007; VWF_dom. DR InterPro; IPR001846; VWF_type-D. DR InterPro; IPR025155; WxxW_domain. DR PANTHER; PTHR11339:SF261; PTHR11339:SF261; 2. DR Pfam; PF08742; C8; 3. DR Pfam; PF13330; Mucin2_WxxW; 1. DR Pfam; PF01826; TIL; 2. DR Pfam; PF00094; VWD; 3. DR SMART; SM00832; C8; 3. DR SMART; SM00215; VWC_out; 2. DR SMART; SM00216; VWD; 3. DR SUPFAM; SSF57567; SSF57567; 3. DR PROSITE; PS51233; VWFD; 3. PE 1: Evidence at protein level; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Proteomics identification {ECO:0000213|PeptideAtlas:A0A0G2JM87}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Signal {ECO:0000256|SAM:SignalP}. FT SIGNAL 1 20 {ECO:0000256|SAM:SignalP}. FT CHAIN 21 1779 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5002546171. FT DOMAIN 36 240 VWFD. {ECO:0000259|PROSITE:PS51233}. FT DOMAIN 390 604 VWFD. {ECO:0000259|PROSITE:PS51233}. FT DOMAIN 859 1065 VWFD. {ECO:0000259|PROSITE:PS51233}. SQ SEQUENCE 1779 AA; 191587 MW; 057867C545C8E76F CRC64; MGLPLARLAA VCLALSLAGG SELQTEGRTR NHGHNVCSTW GNFHYKTFDG DVFRFPGLCD YNFASDCRGS YKEFAVHLKR GPGQAEAPAG VESILLTIKD DTIYLTRHLA VLNGAVVSTP HYSPGLLIEK SDAYTKVYSR AGLTLMWNRE DALMLELDTK FRNHTCGLCG DYNGLQSYSE FLSDGVLFSP LEFGNMQKIN QPDVVCEDPE EEVAPASCSE HRAECERLLT AEAFADCQDL VPLEPYLRAC QQDRCRCPGG DTCVCSTVAE FSRQCSHAGG RPGNWRTATL CPKTCPGNLV YLESGSPCMD TCSHLEVSSL CEEHRMDGCF CPEGTVYDDI GDSGCVPVSQ CHCRLHGHLY TPGQEITNDC EQCVCNAGRW VCKDLPCPGT CALEGGSHIT TFDGKTYTFH GDCYYVLAKG DHNDSYALLG ELAPCGSTDK QTCLKTVVLL ADKKKNVVVF KSDGSVLLNE LQVNLPHVTA SFSVFRPSSY HIMVSMAIGV RLQVQLAPVM QLFVTLDQAS QGQVQGLCGN FNGLEGDDFK TASGLVEATG AGFANTWKAQ SSCHDKLDWL DDPCSLNIES ANYAEHWCSL LKKTETPFGR CHSAVDPAEY YKRCKYDTCN CQNNEDCLCA ALSSYARACT AKGVMLWGWR EHVCNKDVGS CPNSQVFLYN LTTCQQTCRS LSEADSHCLE GFAPVDGCGC PDHTFLDEKG RCVPLAKCSC YHRGLYLEAG DVVVRQEERC VCRDGRLHCR QIRLIGQSCT APKIHMDCSN LTALATSKPR ALSCQTLAAG YYHTECVSGC VCPDGLMDDG RGGCVVEKEC PCVHNNDLYS SGAKIKVDCN TCTCKRGRWV CTQAVCHGTC SIYGSGHYIT FDGKYYDFDG HCSYVAVQDY CGQNSSLGSF SIITENVPCG TTGVTCSKAI KIFMGRTELK LEDKHRVVIQ RDEGHHVAYT TREVGQYLVV ESSTGIIVIW DKRTTVFIKL APSYKGTVCG LCGNFDHRSN NDFTTRDHMV VSSELDFGNS WKEAPTCPDV STNPEPCSLN PHRRSWAEKQ CSILKSSVFS ICHSKVDPKP FYEACVHDSC SCDTGGDCEC FCSAVASYAQ ECTKEGACVF WRTPDLCPIF CDYYNPPHEC EWHYEPCGNR SFETCRTING IHSNISVSYL EGCYPRCPKD RPIYEEDLKK CVTADKCGCY VEDTHYPPGA SVPTEETCKS CVCTNSSQVV CRPEEGKILN QTQDGAFCYW EICGPNGTVE KHFNICSITT RPSTLTTFTT ITLPTTPTTF TTTTTTTTPT SSTVLSTTPK LCCLWSDWIN EDHPSSGSDD GDRETFDGVC GAPEDIECRS VKDPHLSLEQ LGQKVQCDVS VGFICKNEDQ FGNGPFGLCY DYKIRVNCCW PMDKCITTPS PPTTTPSPPP TSTTTLPPTT TPSPPTTTTT TPPPTTTPSP PITTTTTPPP TTTPSPPIST TTTPPPTTTP SPPTTTPSPP TTTPSPPTTT TTTPPPTTTP SPPTTTPITP PASTTTLPPT TTPSPPTTTT TTPPPTTTPI TTTTTVTPTP TPTGTQTPTT TPITTTTTVT PTPTPTGTQT PTSTPITTTT TTPTPTAITT TTTVTPTPTP TGTQTPTTTP ITTTTTVTPT PTPTGTQSPT PTAITTTTTV TPTPTPTGTQ TPTSTPITTT TTVTPTPTPT GTQTPTPTPI STTTTVTPTP TPTGTQTPTT TPITTTTTVT PTPTPTGTQT PTTTPTPTST KSTTVTPITT TTTVTATPTP TGTQTPTMIP ISTTTTVTP //