ID MUC22_HUMAN Reviewed; 1773 AA. AC E2RYF6; H3BQR8; DT 28-JUN-2011, integrated into UniProtKB/Swiss-Prot. DT 03-OCT-2012, sequence version 2. DT 16-JAN-2019, entry version 52. DE RecName: Full=Mucin-22; DE AltName: Full=Panbronchiolitis-related mucin-like protein 1; DE Flags: Precursor; GN Name=MUC22; Synonyms=G4, PBMUCL1; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606; RN [1] RP NUCLEOTIDE SEQUENCE [MRNA], INDUCTION, TISSUE SPECIFICITY, AND VARIANT RP ASP-1712. RC TISSUE=Lung; RX PubMed=20981447; DOI=10.1007/s00439-010-0906-4; RA Hijikata M., Matsushita I., Tanaka G., Tsuchiya T., Itoh H., RA Tokunaga K., Ohashi J., Homma S., Kobashi Y., Taguchi Y., Azuma A., RA Kudoh S., Keicho N.; RT "Molecular cloning of two novel mucin-like genes in the disease- RT susceptibility locus for diffuse panbronchiolitis."; RL Hum. Genet. 129:117-128(2011). RN [2] RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=14574404; DOI=10.1038/nature02055; RA Mungall A.J., Palmer S.A., Sims S.K., Edwards C.A., Ashurst J.L., RA Wilming L., Jones M.C., Horton R., Hunt S.E., Scott C.E., RA Gilbert J.G.R., Clamp M.E., Bethel G., Milne S., Ainscough R., RA Almeida J.P., Ambrose K.D., Andrews T.D., Ashwell R.I.S., RA Babbage A.K., Bagguley C.L., Bailey J., Banerjee R., Barker D.J., RA Barlow K.F., Bates K., Beare D.M., Beasley H., Beasley O., Bird C.P., RA Blakey S.E., Bray-Allen S., Brook J., Brown A.J., Brown J.Y., RA Burford D.C., Burrill W., Burton J., Carder C., Carter N.P., RA Chapman J.C., Clark S.Y., Clark G., Clee C.M., Clegg S., Cobley V., RA Collier R.E., Collins J.E., Colman L.K., Corby N.R., Coville G.J., RA Culley K.M., Dhami P., Davies J., Dunn M., Earthrowl M.E., RA Ellington A.E., Evans K.A., Faulkner L., Francis M.D., Frankish A., RA Frankland J., French L., Garner P., Garnett J., Ghori M.J., RA Gilby L.M., Gillson C.J., Glithero R.J., Grafham D.V., Grant M., RA Gribble S., Griffiths C., Griffiths M.N.D., Hall R., Halls K.S., RA Hammond S., Harley J.L., Hart E.A., Heath P.D., Heathcott R., RA Holmes S.J., Howden P.J., Howe K.L., Howell G.R., Huckle E., RA Humphray S.J., Humphries M.D., Hunt A.R., Johnson C.M., Joy A.A., RA Kay M., Keenan S.J., Kimberley A.M., King A., Laird G.K., Langford C., RA Lawlor S., Leongamornlert D.A., Leversha M., Lloyd C.R., Lloyd D.M., RA Loveland J.E., Lovell J., Martin S., Mashreghi-Mohammadi M., RA Maslen G.L., Matthews L., McCann O.T., McLaren S.J., McLay K., RA McMurray A., Moore M.J.F., Mullikin J.C., Niblett D., Nickerson T., RA Novik K.L., Oliver K., Overton-Larty E.K., Parker A., Patel R., RA Pearce A.V., Peck A.I., Phillimore B.J.C.T., Phillips S., Plumb R.W., RA Porter K.M., Ramsey Y., Ranby S.A., Rice C.M., Ross M.T., Searle S.M., RA Sehra H.K., Sheridan E., Skuce C.D., Smith S., Smith M., Spraggon L., RA Squares S.L., Steward C.A., Sycamore N., Tamlyn-Hall G., Tester J., RA Theaker A.J., Thomas D.W., Thorpe A., Tracey A., Tromans A., Tubby B., RA Wall M., Wallis J.M., West A.P., White S.S., Whitehead S.L., RA Whittaker H., Wild A., Willey D.J., Wilmer T.E., Wood J.M., Wray P.W., RA Wyatt J.C., Young L., Younger R.M., Bentley D.R., Coulson A., RA Durbin R.M., Hubbard T., Sulston J.E., Dunham I., Rogers J., Beck S.; RT "The DNA sequence and analysis of human chromosome 6."; RL Nature 425:805-811(2003). CC -!- SUBCELLULAR LOCATION: Membrane {ECO:0000305}; Single-pass membrane CC protein {ECO:0000305}. CC -!- TISSUE SPECIFICITY: Expressed in lung by serous cells of the CC submucosal gland (at protein level). Detected in the placenta, CC lung and testis. {ECO:0000269|PubMed:20981447}. CC -!- INDUCTION: Up-regulated by poly(I:C). CC {ECO:0000269|PubMed:20981447}. CC -!- WEB RESOURCE: Name=Mucin database; CC URL="http://www.medkem.gu.se/mucinbiology/databases/"; CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AB560770; BAJ24154.1; -; mRNA. DR EMBL; AB600271; BAJ33462.1; -; mRNA. DR EMBL; AB600272; BAJ33463.1; -; mRNA. DR EMBL; AL669830; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR CCDS; CCDS59003.1; -. DR RefSeq; NP_001185744.1; NM_001198815.1. DR RefSeq; NP_001305413.1; NM_001318484.1. DR UniGene; Hs.582967; -. DR ProteinModelPortal; E2RYF6; -. DR STRING; 9606.ENSP00000455906; -. DR iPTMnet; E2RYF6; -. DR PhosphoSitePlus; E2RYF6; -. DR BioMuta; MUC22; -. DR PaxDb; E2RYF6; -. DR PRIDE; E2RYF6; -. DR ProteomicsDB; 15279; -. DR Ensembl; ENST00000561890; ENSP00000455906; ENSG00000261272. DR GeneID; 100507679; -. DR KEGG; hsa:100507679; -. DR UCSC; uc063mxr.1; human. DR CTD; 100507679; -. DR DisGeNET; 100507679; -. DR EuPathDB; HostDB:ENSG00000261272.1; -. DR GeneCards; MUC22; -. DR H-InvDB; HIX0164915; -. DR H-InvDB; HIX0166030; -. DR H-InvDB; HIX0166233; -. DR H-InvDB; HIX0167061; -. DR H-InvDB; HIX0167293; -. DR H-InvDB; HIX0167600; -. DR HGNC; HGNC:39755; MUC22. DR MIM; 613917; gene. DR neXtProt; NX_E2RYF6; -. DR OpenTargets; ENSG00000261272; -. DR eggNOG; ENOG410KGW0; Eukaryota. DR eggNOG; ENOG4110RWV; LUCA. DR GeneTree; ENSGT00940000164570; -. DR InParanoid; E2RYF6; -. DR OMA; CTEETEN; -. DR OrthoDB; 1320016at2759; -. DR GenomeRNAi; 100507679; -. DR PRO; PR:E2RYF6; -. DR Proteomes; UP000005640; Chromosome 6. DR Bgee; ENSG00000261272; Expressed in 10 organ(s), highest expression level in esophagus mucosa. DR GO; GO:0016021; C:integral component of membrane; IEA:UniProtKB-KW. DR InterPro; IPR028199; Mucin_dom. DR Pfam; PF14654; Epiglycanin_C; 1. PE 1: Evidence at protein level; KW Complete proteome; Membrane; Polymorphism; Reference proteome; Repeat; KW Signal; Transmembrane; Transmembrane helix. FT SIGNAL 1 26 {ECO:0000255}. FT CHAIN 27 1773 Mucin-22. FT /FTId=PRO_0000410470. FT TOPO_DOM 27 1660 Extracellular. {ECO:0000255}. FT TRANSMEM 1661 1681 Helical. {ECO:0000255}. FT TOPO_DOM 1682 1773 Cytoplasmic. {ECO:0000255}. FT REGION 153 1514 124 X 10 AA approximate repeats. FT COMPBIAS 28 1649 Thr-rich. FT VARIANT 1712 1712 N -> D (in dbSNP:rs4248153). FT {ECO:0000269|PubMed:20981447}. FT /FTId=VAR_065357. FT CONFLICT 57 57 S -> T (in Ref. 1; BAJ24154/BAJ33462/ FT BAJ33463). {ECO:0000305}. SQ SEQUENCE 1773 AA; 173478 MW; A25C9C6C4A5AC924 CRC64; MRRGNISPAF WFLWLLLFGL LGPSSENTTA FTKGSDTTTA SITGSETTMA STMASTSALT TGSKITTDST TGSETTSAST MASTAAFTTG SETNTASTTD SGTTIASTRT FTTGSDTTTG STAGSETIVA STTVSGTTTT FTIASTTVPE TTMASSTTST AGSEKTMASS IISETTMAST TGSETATVST TGSETTTTST ASSEATKVST TGSETTTAST AGSETTTTST SMAGSEATTT STADSKVITA SSMSSETTVA PAAGSNTTTA STTGSETTTI LIKASETTTA STAGSETTTP SPTGSQTTIV SISGSEITTT STAGSENTTV SSAGSGTTTA SMAGSETTVS TAGSETTTVS ITGTETTMVS AMGSETTTNS TTSSETTVTS TAGSETTTVS TVGSETTTAY TADSETTAAS TTGSEMTTVF TAGSETITPS TAGSETTTVS TAGSETTTVS TTGSETTTAS TAHSETTAAS TMGSETTKVS TAGSETTVST AGSETTAAST EDSETNTAFT EDSKTTTAST TGFETTAAST TGSEPTMAST MGSETTMAST IGPETTKVST ASSEVTTVFA AGSETIRAST VGSETTTVST TGSETTTASI MGSETSTDST TGSETTTAST EGSETTTAST EGSEATTVST TGSETTTVSI TDSETTTTCT EGSEMTAVST TVFETTTAST EGSEITIAST SDSETTTAST EGSETTTVTT AGSETKTAYT TGSETTTASN TGLETTTVFT IGSDTTTAST EGSETTAVSA TGSEMTTVST EGSENTTVST TGSETTTVST TGLETTTTST EGSEMTTVST TGAETTTDST EGSGTTAAST AGSETTTVST ADSENTTAST ADSETTSAST TGSETTTAST TSSETTTAST EGSETTTVST TDSETTMVST TGSERTITST EGSETTTVSA TGSETTVSTE GSGTTTVSIT GSETTKVSTT GSETTTTSTE GSEITTASIT GSETTTASTE GSETTTASTE GSETTSASTT GSETTTASTT SSETTMASIM GSETTMASTI GSETTKVSTA SSKMTTVFTE NSETTIASTT ASETTTVSTA GSETIPASTA GSETTTTTST EGSETTTAST EGSETTTAST ESSETTTATT IGSETTTAST EGSETTTTST EGSETTTAST EGSEITTVST TGSETTTAST EGSETTTAST EGSELTTVST TGSETITVSA EGSETTTVTT MGSETTTAST AGSETTTVST AGSETTTASI EGSETTTVSS TGSETTTVST TGTETTITST EGSETTTVTT AGSETTAVYT TGSETTTTST EGSETTTVST TGSETTTAST ADLETTTVST SGSGTTTAST AGSETTTVYI TGSKTTTAST EGSEATTVST TSSETTTAST TGSEMTTVFT TVSETTTVST IGSEATTSSA AGSEATTTST EGSETTTAST AGSETTTAST AGSETTTAST SGSETNTACT TGSETSTPSS AGSETNTAFI IGSESTIAST ASLEPTATSL TGSETTTVSI TASGATAAST TVSSTTFVLT KATDVSIQPI TNTPMSGTRT TGTRLTASSS VTMAPGMDFT ASAASHTVPG IVLNTSGLGT STMGASSTTS AHGVRTTTGS TREPTSSTFQ ETGPVSMGTN TVSMSHTPTN VIKPSGYLQP WAIILISLAA VVAAVGLSVG LSFCLRNLFF PLRYCGIYYP HGHSHSLGLD LNLGLGSGTF HSLGNALVHG GELEMGHGGT HGFGYGVGHG LSHIHGDGYG VNHGGHYGHG GGH //