ID A0A0G2JNJ8_HUMAN Unreviewed; 2439 AA. AC A0A0G2JNJ8; DT 22-JUL-2015, integrated into UniProtKB/TrEMBL. DT 22-JUL-2015, sequence version 1. DT 16-JAN-2019, entry version 19. DE SubName: Full=Mucin-6 {ECO:0000313|Ensembl:ENSP00000481532}; GN Name=MUC6 {ECO:0000313|Ensembl:ENSP00000481532}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000481532, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000481532, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=16554811; DOI=10.1038/nature04632; RA Taylor T.D., Noguchi H., Totoki Y., Toyoda A., Kuroki Y., Dewar K., RA Lloyd C., Itoh T., Takeda T., Kim D.W., She X., Barlow K.F., Bloom T., RA Bruford E., Chang J.L., Cuomo C.A., Eichler E., FitzGerald M.G., RA Jaffe D.B., LaButti K., Nicol R., Park H.S., Seaman C., Sougnez C., RA Yang X., Zimmer A.R., Zody M.C., Birren B.W., Nusbaum C., Fujiyama A., RA Hattori M., Rogers J., Lander E.S., Sakaki Y.; RT "Human chromosome 11 DNA sequence and analysis including novel gene RT identification."; RL Nature 440:497-500(2006). RN [2] {ECO:0000313|Ensembl:ENSP00000481532} RP IDENTIFICATION. RG Ensembl; RL Submitted (JUN-2015) to UniProtKB. CC -!- SUBCELLULAR LOCATION: Secreted {ECO:0000256|SAAS:SAAS00567783}. CC -!- CAUTION: Lacks conserved residue(s) required for the propagation CC of feature annotation. {ECO:0000256|PROSITE-ProRule:PRU00039}. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AC239872; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR jPOST; A0A0G2JNJ8; -. DR PeptideAtlas; A0A0G2JNJ8; -. DR Ensembl; ENST00000621433; ENSP00000481532; ENSG00000277518. DR HGNC; HGNC:7517; MUC6. DR Proteomes; UP000005640; Chromosome 11. DR GO; GO:0005576; C:extracellular region; IEA:UniProtKB-SubCell. DR GO; GO:0030277; P:maintenance of gastrointestinal epithelium; IEA:InterPro. DR InterPro; IPR006207; Cys_knot_C. DR InterPro; IPR030124; MUC6. DR InterPro; IPR036084; Ser_inhib-like_sf. DR InterPro; IPR002919; TIL_dom. DR InterPro; IPR014853; Unchr_dom_Cys-rich. DR InterPro; IPR001007; VWF_dom. DR InterPro; IPR001846; VWF_type-D. DR PANTHER; PTHR11339:SF264; PTHR11339:SF264; 3. DR Pfam; PF08742; C8; 3. DR Pfam; PF01826; TIL; 2. DR Pfam; PF00094; VWD; 3. DR SMART; SM00832; C8; 3. DR SMART; SM00041; CT; 1. DR SMART; SM00215; VWC_out; 2. DR SMART; SM00216; VWD; 3. DR SUPFAM; SSF57567; SSF57567; 3. DR PROSITE; PS01225; CTCK_2; 1. DR PROSITE; PS51233; VWFD; 3. PE 1: Evidence at protein level; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Disulfide bond {ECO:0000256|SAAS:SAAS00509702}; KW Proteomics identification {ECO:0000213|PeptideAtlas:A0A0G2JNJ8}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Secreted {ECO:0000256|SAAS:SAAS00509699}; KW Signal {ECO:0000256|SAM:SignalP}. FT SIGNAL 1 20 {ECO:0000256|SAM:SignalP}. FT CHAIN 21 2439 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5002546755. FT DOMAIN 44 246 VWFD. {ECO:0000259|PROSITE:PS51233}. FT DOMAIN 396 608 VWFD. {ECO:0000259|PROSITE:PS51233}. FT DOMAIN 867 1075 VWFD. {ECO:0000259|PROSITE:PS51233}. FT DOMAIN 2349 2438 CTCK. {ECO:0000259|PROSITE:PS01225}. SQ SEQUENCE 2439 AA; 257082 MW; 87F90307194A9007 CRC64; MVQRWLLLSC CGALLSAGLA NTSYTSPGLQ RLKDSPQTAP DKGQCSTWGA GHFSTFDHHV YDFSGTCNYI FAATCKDAFP TFSVQLRRGP DGSISRIIVE LGASVVTVSE AIISVKDIGV ISLPYTSNGL QITPFGQSVR LVAKQLELEL EVVWGPDSHL MVLVERKYMG QMCGLCGNFD GKVTNEFVSE EGKFLEPHKF AALQKLDDPG EICTFQDIPS THVRQAQHAR ICTQLLTLVA PECSVSKEPF VLSCQADVAA APQPGPQNSS CATLSEYSRQ CSMVGQPVRR WRSPGLCSVG QCPANQVYQE CGSACVKTCS NPQHSCSSSC TFGCFCPEGT VLNDLSNNHT CVPVTQCPCV LHGAMYAPGE VTIAACQTCR CTLGRWVCTE RPCPGHCSLE GGSFVTTFDA RPYRFHGTCT YILLQSPQLP EDGALMAVYD KSGVSHSETS LVAVVYLSRQ DKIVISQDEV VTNNGEAKWL PYKTRNITVF RQTSTHLQMA TSFGLELVVQ LRPIFQAYVT VGPQFRGQTR GLCGNFNGDT TDDFTTSMGI AEGTASLFVD SWRAGNCPAA LERETDPCSM SQLNKVCAET HCSMLLRTGT VFERCHATVN PAPFYKRCMY QACNYEETFP HICAALGDYV HACSLRGVLL WGWRSSVDNC TIPCTGNTTF SYNSQACERT CLSLSDRATE CHHSAVPVDG CNCPDGTYLN QKGECVRKAQ CPCILEGYKF ILAEQSTVIN GITCHCINGR LSCPQRPQMF LASCQAPKTF KSCSQSSENK FGAACAPTCQ MLATGVACVP TKCEPGCVCA EGLYENADGQ CVPPEECPCE FSGVSYPGGA ELHTDCRTCS CSRGRWACQQ GTHCPSTCTL YGEGHVITFD GQRFVFDGNC EYILATDVCG VNDSQPTFKI LTENVICGNS GVTCSRAIKI FLGGLSVVLA DRNYTVTGEE PHVQLGVTPG ALSLVVDISI PGRYNLTLIW NRHMTILIRI ARASQDPLCG LCGNFNGNMK DDFETRSRYV ASSELELVNS WKESPLCGDV SFVTDPCSLN AFRRSWAERK CSVINSQTFA TCHSKVYHLP YYEACVRDAC GCDSGGDCEC LCDAVAAYAQ ACLDKGVCVD WRTPAFCPIY CGFYNTHTQD GHGEYQYTQE ANCTWHYQPC LCPSQPQSVP GSNIEGCYNC SQDEYFDHEE GVCVPCMPPT TPQPPTTPQL PTTGSRPTQV WPMTGTSTTI GLLSSTGPSP SSNHTPASPT QTPLLPATLT SSKPTASSGE PPRPTTAVTP QATSGLPPTA TLRSTATKPT VTQATTRATA STASPATTST AQSTTRTTMT LPTPATSGTS PTLPKSTNQE LPGTTATQTT GPRPTPASTT GPTTPQPGQP TRPTATETTQ TRTTTEYTTP QTPHTTHSPP TAGSPVPSTG PVTATSFHAT TTYPTPSHPE TTLPTHVPPF STSLVTPSTH TVITPTHAQM ATSASIHSAP TGTIPPPTTL KATGSTHTAP PITPTTSGTS QAHSSFSTNK TPTSLHSHTS STHHPEVTPT STTTITPNPT STRTRTPVAH TNSATSSRPP PPFTTHSPPT GSSPFSSTGP MTATSFKTTT TYPTPSHPQT TLPTHVPPFS TSLVTPSTHT VITPTHAQMA TSASIHSMPT GTIPPPTTLK ATGSTHTAPT MTLTTSGTSQ ALSSLNTAKT STSLHSHTSS THHAEATSTS TTNITPNPTS TGTPPMTVTT SGTSQSRSSF STAKTSTSLH SHTSSTHHPE VTSTSTTSIT PNHTSTGTRT PVAHTTSATS SRLPTPFTTH SPPTGTTPIS STGPVTATSF QTTTTYPTPS HPHTTLPTHV PSFSTSLVTP STHTVIIPTH TQMATSASIH SMPTGTIPPP TTIKATGSTH TAPPMTPTTS GTSQSPSSFS TAKTSTSLPY HTSSTHHPEV TPTSTTNITP KHTSTGTRTP VAHTTSASSS RLPTPFTTHS PPTGSSPFSS TGPMTATSFQ TTTTYPTPSH PQTTLPTHVP PFSTSLVTPS THTVIITTHT QMATSASIHS TPTGTVPPPT TLKATGSTHT APPMTVTTSG TSQTHSSFST ATASSSFISS SSWLPQNSSS RPPSSPITTQ LPHLSSATTP VSTTNQLSSS FSPSPSAPST VSSYVPSSHS SPQTSSPSVG TSSSFVSAPV HSTTLSSGSH SSLSTHPTTA SVSASPLFPS SPAASTTIRA TLPHTISSPF TLSALLPIST VTVSPTPSSH LASSTIAFPS TPRTTASTHT APAFSSQSTT SRSTSLTTRV PTSGFVSLTS GVTGIPTSPV TNLTTRHPGP TLSPTTRFLT SSLTAHGSTP ASAPVSSLGT PTPTSPGVCS VREQQEEITF KGCMANVTVT RCEGACISAA SFNIITQQVD ARCSCCRPLH SYEQQLELPC PDPSTPGRRL VLTLQVFSHC VCSSVACGD //