ID H0YMF1_HUMAN Unreviewed; 2568 AA. AC H0YMF1; DT 22-FEB-2012, integrated into UniProtKB/TrEMBL. DT 20-JUN-2018, sequence version 2. DT 13-FEB-2019, entry version 51. DE SubName: Full=Aggrecan core protein {ECO:0000313|Ensembl:ENSP00000453581}; GN Name=ACAN {ECO:0000313|Ensembl:ENSP00000453581}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000453581, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000453581, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=16572171; DOI=10.1038/nature04601; RA Zody M.C., Garber M., Sharpe T., Young S.K., Rowen L., O'Neill K., RA Whittaker C.A., Kamal M., Chang J.L., Cuomo C.A., Dewar K., RA FitzGerald M.G., Kodira C.D., Madan A., Qin S., Yang X., Abbasi N., RA Abouelleil A., Arachchi H.M., Baradarani L., Birditt B., Bloom S., RA Bloom T., Borowsky M.L., Burke J., Butler J., Cook A., DeArellano K., RA DeCaprio D., Dorris L. III, Dors M., Eichler E.E., Engels R., RA Fahey J., Fleetwood P., Friedman C., Gearin G., Hall J.L., Hensley G., RA Johnson E., Jones C., Kamat A., Kaur A., Locke D.P., Madan A., RA Munson G., Jaffe D.B., Lui A., Macdonald P., Mauceli E., Naylor J.W., RA Nesbitt R., Nicol R., O'Leary S.B., Ratcliffe A., Rounsley S., She X., RA Sneddon K.M., Stewart S., Sougnez C., Stone S.M., Topham K., RA Vincent D., Wang S., Zimmer A.R., Birren B.W., Hood L., Lander E.S., RA Nusbaum C.; RT "Analysis of the DNA sequence and duplication history of human RT chromosome 15."; RL Nature 440:671-675(2006). RN [2] {ECO:0000313|Ensembl:ENSP00000453581} RP IDENTIFICATION. RG Ensembl; RL Submitted (JAN-2012) to UniProtKB. CC -!- CAUTION: Lacks conserved residue(s) required for the propagation CC of feature annotation. {ECO:0000256|PROSITE-ProRule:PRU00323}. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AC103982; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR RefSeq; XP_006720482.1; XM_006720419.1. DR UniGene; Hs.2159; -. DR UniGene; Hs.616395; -. DR ProteinModelPortal; H0YMF1; -. DR PeptideAtlas; H0YMF1; -. DR Ensembl; ENST00000560601; ENSP00000453581; ENSG00000157766. DR GeneID; 176; -. DR UCSC; uc002bnb.2; human. DR CTD; 176; -. DR EuPathDB; HostDB:ENSG00000157766.15; -. DR HGNC; HGNC:319; ACAN. DR OpenTargets; ENSG00000157766; -. DR GeneTree; ENSGT00940000155971; -. DR ChiTaRS; ACAN; human. DR Proteomes; UP000005640; Chromosome 15. DR Bgee; ENSG00000157766; Expressed in 160 organ(s), highest expression level in tibia. DR ExpressionAtlas; H0YMF1; baseline and differential. DR GO; GO:0005509; F:calcium ion binding; IEA:InterPro. DR GO; GO:0005540; F:hyaluronic acid binding; IEA:InterPro. DR GO; GO:0007155; P:cell adhesion; IEA:InterPro. DR CDD; cd00033; CCP; 1. DR CDD; cd03588; CLECT_CSPGs; 1. DR Gene3D; 2.60.40.10; -; 1. DR Gene3D; 3.10.100.10; -; 5. DR InterPro; IPR001304; C-type_lectin-like. DR InterPro; IPR016186; C-type_lectin-like/link_sf. DR InterPro; IPR018378; C-type_lectin_CS. DR InterPro; IPR033987; CSPG_CTLD. DR InterPro; IPR016187; CTDL_fold. DR InterPro; IPR001881; EGF-like_Ca-bd_dom. DR InterPro; IPR013032; EGF-like_CS. DR InterPro; IPR000742; EGF-like_dom. DR InterPro; IPR000152; EGF-type_Asp/Asn_hydroxyl_site. DR InterPro; IPR018097; EGF_Ca-bd_CS. DR InterPro; IPR007110; Ig-like_dom. DR InterPro; IPR036179; Ig-like_dom_sf. DR InterPro; IPR013783; Ig-like_fold. DR InterPro; IPR003006; Ig/MHC_CS. DR InterPro; IPR003599; Ig_sub. DR InterPro; IPR013106; Ig_V-set. DR InterPro; IPR000538; Link_dom. DR InterPro; IPR035976; Sushi/SCR/CCP_sf. DR InterPro; IPR000436; Sushi_SCR_CCP_dom. DR Pfam; PF00008; EGF; 1. DR Pfam; PF00059; Lectin_C; 1. DR Pfam; PF00084; Sushi; 1. DR Pfam; PF07686; V-set; 1. DR Pfam; PF00193; Xlink; 4. DR PRINTS; PR01265; LINKMODULE. DR SMART; SM00032; CCP; 1. DR SMART; SM00034; CLECT; 1. DR SMART; SM00181; EGF; 2. DR SMART; SM00179; EGF_CA; 2. DR SMART; SM00409; IG; 1. DR SMART; SM00406; IGv; 1. DR SMART; SM00445; LINK; 4. DR SUPFAM; SSF48726; SSF48726; 1. DR SUPFAM; SSF56436; SSF56436; 5. DR SUPFAM; SSF57535; SSF57535; 1. DR PROSITE; PS00010; ASX_HYDROXYL; 1. DR PROSITE; PS00615; C_TYPE_LECTIN_1; 1. DR PROSITE; PS50041; C_TYPE_LECTIN_2; 1. DR PROSITE; PS00022; EGF_1; 2. DR PROSITE; PS01186; EGF_2; 1. DR PROSITE; PS50026; EGF_3; 2. DR PROSITE; PS01187; EGF_CA; 1. DR PROSITE; PS50835; IG_LIKE; 1. DR PROSITE; PS00290; IG_MHC; 1. DR PROSITE; PS01241; LINK_1; 3. DR PROSITE; PS50963; LINK_2; 4. DR PROSITE; PS50923; SUSHI; 1. PE 1: Evidence at protein level; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Disulfide bond {ECO:0000256|PROSITE-ProRule:PRU00302, KW ECO:0000256|SAAS:SAAS00601599}; KW EGF-like domain {ECO:0000256|PROSITE-ProRule:PRU00076, KW ECO:0000256|SAAS:SAAS00032677}; KW Immunoglobulin domain {ECO:0000256|SAAS:SAAS00653601}; KW Proteomics identification {ECO:0000213|MaxQB:H0YMF1, KW ECO:0000213|PeptideAtlas:H0YMF1}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Repeat {ECO:0000256|SAAS:SAAS00887150}; KW Signal {ECO:0000256|SAM:SignalP}; KW Sushi {ECO:0000256|PROSITE-ProRule:PRU00302, KW ECO:0000256|SAAS:SAAS00937752}. FT SIGNAL 1 16 {ECO:0000256|SAM:SignalP}. FT CHAIN 17 2568 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5015361698. FT DOMAIN 34 147 Ig-like. {ECO:0000259|PROSITE:PS50835}. FT DOMAIN 153 248 Link. {ECO:0000259|PROSITE:PS50963}. FT DOMAIN 254 350 Link. {ECO:0000259|PROSITE:PS50963}. FT DOMAIN 478 573 Link. {ECO:0000259|PROSITE:PS50963}. FT DOMAIN 579 675 Link. {ECO:0000259|PROSITE:PS50963}. FT DOMAIN 2279 2314 EGF-like. {ECO:0000259|PROSITE:PS50026}. FT DOMAIN 2316 2352 EGF-like. {ECO:0000259|PROSITE:PS50026}. FT DOMAIN 2365 2479 C-type lectin. FT {ECO:0000259|PROSITE:PS50041}. FT DOMAIN 2483 2543 Sushi. {ECO:0000259|PROSITE:PS50923}. FT DISULFID 199 220 {ECO:0000256|PROSITE-ProRule:PRU00323}. FT DISULFID 297 318 {ECO:0000256|PROSITE-ProRule:PRU00323}. FT DISULFID 524 545 {ECO:0000256|PROSITE-ProRule:PRU00323}. FT DISULFID 622 643 {ECO:0000256|PROSITE-ProRule:PRU00323}. FT DISULFID 2283 2293 {ECO:0000256|PROSITE-ProRule:PRU00076}. FT DISULFID 2304 2313 {ECO:0000256|PROSITE-ProRule:PRU00076}. FT DISULFID 2342 2351 {ECO:0000256|PROSITE-ProRule:PRU00076}. FT DISULFID 2485 2528 {ECO:0000256|PROSITE-ProRule:PRU00302}. FT DISULFID 2514 2541 {ECO:0000256|PROSITE-ProRule:PRU00302}. SQ SEQUENCE 2568 AA; 265340 MW; 961AD59C43B0AE6C CRC64; MTTLLWVFVT LRVITAAVTV ETSDHDNSLS VSIPQPSPLR VLLGTSLTIP CYFIDPMHPV TTAPSTAPLA PRIKWSRVSK EKEVVLLVAT EGRVRVNSAY QDKVSLPNYP AIPSDATLEV QSLRSNDSGV YRCEVMHGIE DSEATLEVVV KGIVFHYRAI STRYTLDFDR AQRACLQNSA IIATPEQLQA AYEDGFHQCD AGWLADQTVR YPIHTPREGC YGDKDEFPGV RTYGIRDTNE TYDVYCFAEE MEGEVFYATS PEKFTFQEAA NECRRLGARL ATTGQLYLAW QAGMDMCSAG WLADRSVRYP ISKARPNCGG NLLGVRTVYV HANQTGYPDP SSRYDAICYT GEDFVDIPEN FFGVGGEEDI TVQTVTWPDM ELPLPRNITE GEARGSVILT VKPIFEVSPS PLEPEEPFTF APEIGATAFA EVENETGEAT RPWGFPTPGL GPATAFTSED LVVQVTAVPG QPHLPGGVVF HYRPGPTRYS LTFEEAQQAC LRTGAVIASP EQLQAAYEAG YEQCDAGWLR DQTVRYPIVS PRTPCVGDKD SSPGVRTYGV RPSTETYDVY CFVDRLEGEV FFATRLEQFT FQEALEFCES HNATLATTGQ LYAAWSRGLD KCYAGWLADG SLRYPIVTPR PACGGDKPGV RTVYLYPNQT GLPDPLSRHH AFCFRGISAV PSPGEEEGGT PTSPSGVEEW IVTQVVPGVA AVPVEEETTA VPSGETTAIL EFTTEPENQT EWEPAYTPVG TSPLPGILPT WPPTGAATEE STEGPSATEV PSASEEPSPS EVPFPSEEPS PSEEPFPSVR PFPSVELFPS EEPFPSKEPS PSEEPSASEE PYTPSPPVPS WTELPSSGEE SGAPDVSGDF TGSGDVSGHL DFSGQLSGDR ASGLPSGDLD SSGLTSTVGS GLPVESGLPS GDEERIEWPS TPTVGELPSG AEILEGSASG VGDLSGLPSG EVLETSASGV GDLSGLPSGE VLETTAPGVE DISGLPSGEV LETTAPGVED ISGLPSGEVL ETTAPGVEDI SGLPSGEVLE TTAPGVEDIS GLPSGEVLET TAPGVEDISG LPSGEVLETT APGVEDISGL PSGEVLETAA PGVEDISGLP SGEVLETAAP GVEDISGLPS GEVLETAAPG VEDISGLPSG EVLETAAPGV EDISGLPSGE VLETAAPGVE DISGLPSGEV LETAAPGVED ISGLPSGEVL ETAAPGVEDI SGLPSGEVLE TAAPGVEDIS GLPSGEVLET AAPGVEDISG LPSGEVLETA APGVEDISGL PSGEVLETAA PGVEDISGLP SGEVLETAAP GVEDISGLPS GEVLETAAPG VEDISGLPSG EVLETAAPGV EDISGLPSGE VLETAAPGVE DISGLPSGEV LETAAPGVED ISGLPSGEVL ETTAPGVEEI SGLPSGEVLE TTAPGVDEIS GLPSGEVLET TAPGVEEISG LPSGEVLETS TSAVGDLSGL PSGGEVLEIS VSGVEDISGL PSGEVVETSA SGIEDVSELP SGEGLETSAS GVEDLSRLPS GEEVLEISAS GFGDLSGLPS GGEGLETSAS EVGTDLSGLP SGREGLETSA SGAEDLSGLP SGKEDLVGSA SGDLDLGKLP SGTLGSGQAP ETSGLPSGFS GEYSGVDLGS GPPSGLPDFS GLPSGFPTVS LVDSTLVEVV TASTASELEG RGTIGISGAG EISGLPSSEL DISGRASGLP SGTELSGQAS GSPDVSGEIP GLFGVSGQPS GFPDTSGETS GVTELSGLSS GQPGISGEAS GVLYGTSQPF GITDLSGETS GVPDLSGQPS GLPGFSGATS GVPDLVSGTT SGSGESSGIT FVDTSLVEVA PTTFKEEEGL GSVELSGLPS GEADLSGKSG MVDVSGQFSG TVDSSGFTSQ TPEFSGLPSG IAEVSGESSR AEIGSSLPSG AYYGSGTPSS FPTVSLVDRT LVESVTQAPT AQEAGEGPSG ILELSGAHSG APDMSGEHSG FLDLSGLQSG LIEPSGEPPG TPYFSGDFAS TTNVSGESSV AMGTSGEASG LPEVTLITSE FVEGVTEPTI SQELGQRPPV THTPQLFESS GKVSTAGDIS GATPVLPGSG VEVSSVPESS SETSAYPEAG FGASAAPEAS REDSGSPDLS ETTSAFHEAN LERSSGLGVS GSTLTFQEGE ASAAPEVSGE STTTSDVGTE APGLPSATPT ASGDRTEISG DLSGHTSQLG VVISTSIPES EWTQQTQRPA ETHLEIESSS LLYSGEETHT VETATSPTDA SIPASPEWKR ESESTAAAPA RSCAEEPCGA GTCKETEGHV ICLCPPGYTG EHCNIDIDEC LSSPCLNGAT CVDAIDSFTC LCLPSYEGDL CEIDQEVCEE GWNKYQGHCY RHFPDRETWV DAERRCREQQ SHLSSIVTPE EQEFVNNNAQ DYQWIGLNDR TIEGDFRWSD GHPMQFENWR PNQPDNFFAA GEDCVVMIWH EKGEWNDVPC NYHLPFTCKK GTVACGEPPV VEHARTFGQK KDRYEINSLV RYQCTEGFVQ RHMPTIRCQP SGHWEEPQIT CTDPTTYKRR LQKRSSRHPR RSRPSTAH //