ID F5GZK2_HUMAN Unreviewed; 956 AA. AC F5GZK2; DT 28-JUN-2011, integrated into UniProtKB/TrEMBL. DT 29-OCT-2014, sequence version 2. DT 16-JAN-2019, entry version 59. DE SubName: Full=Collagen alpha-1(XXI) chain {ECO:0000313|Ensembl:ENSP00000444384}; GN Name=COL21A1 {ECO:0000313|Ensembl:ENSP00000444384}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000444384, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000444384, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=14574404; DOI=10.1038/nature02055; RA Mungall A.J., Palmer S.A., Sims S.K., Edwards C.A., Ashurst J.L., RA Wilming L., Jones M.C., Horton R., Hunt S.E., Scott C.E., RA Gilbert J.G.R., Clamp M.E., Bethel G., Milne S., Ainscough R., RA Almeida J.P., Ambrose K.D., Andrews T.D., Ashwell R.I.S., RA Babbage A.K., Bagguley C.L., Bailey J., Banerjee R., Barker D.J., RA Barlow K.F., Bates K., Beare D.M., Beasley H., Beasley O., Bird C.P., RA Blakey S.E., Bray-Allen S., Brook J., Brown A.J., Brown J.Y., RA Burford D.C., Burrill W., Burton J., Carder C., Carter N.P., RA Chapman J.C., Clark S.Y., Clark G., Clee C.M., Clegg S., Cobley V., RA Collier R.E., Collins J.E., Colman L.K., Corby N.R., Coville G.J., RA Culley K.M., Dhami P., Davies J., Dunn M., Earthrowl M.E., RA Ellington A.E., Evans K.A., Faulkner L., Francis M.D., Frankish A., RA Frankland J., French L., Garner P., Garnett J., Ghori M.J., RA Gilby L.M., Gillson C.J., Glithero R.J., Grafham D.V., Grant M., RA Gribble S., Griffiths C., Griffiths M.N.D., Hall R., Halls K.S., RA Hammond S., Harley J.L., Hart E.A., Heath P.D., Heathcott R., RA Holmes S.J., Howden P.J., Howe K.L., Howell G.R., Huckle E., RA Humphray S.J., Humphries M.D., Hunt A.R., Johnson C.M., Joy A.A., RA Kay M., Keenan S.J., Kimberley A.M., King A., Laird G.K., Langford C., RA Lawlor S., Leongamornlert D.A., Leversha M., Lloyd C.R., Lloyd D.M., RA Loveland J.E., Lovell J., Martin S., Mashreghi-Mohammadi M., RA Maslen G.L., Matthews L., McCann O.T., McLaren S.J., McLay K., RA McMurray A., Moore M.J.F., Mullikin J.C., Niblett D., Nickerson T., RA Novik K.L., Oliver K., Overton-Larty E.K., Parker A., Patel R., RA Pearce A.V., Peck A.I., Phillimore B.J.C.T., Phillips S., Plumb R.W., RA Porter K.M., Ramsey Y., Ranby S.A., Rice C.M., Ross M.T., Searle S.M., RA Sehra H.K., Sheridan E., Skuce C.D., Smith S., Smith M., Spraggon L., RA Squares S.L., Steward C.A., Sycamore N., Tamlyn-Hall G., Tester J., RA Theaker A.J., Thomas D.W., Thorpe A., Tracey A., Tromans A., Tubby B., RA Wall M., Wallis J.M., West A.P., White S.S., Whitehead S.L., RA Whittaker H., Wild A., Willey D.J., Wilmer T.E., Wood J.M., Wray P.W., RA Wyatt J.C., Young L., Younger R.M., Bentley D.R., Coulson A., RA Durbin R., Hubbard T., Sulston J.E., Dunham I., Rogers J., Beck S.; RT "The DNA sequence and analysis of human chromosome 6."; RL Nature 425:805-811(2003). RN [2] {ECO:0000313|Ensembl:ENSP00000444384} RP IDENTIFICATION. RG Ensembl; RL Submitted (JUL-2011) to UniProtKB. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AL031779; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL031782; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL034452; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL450430; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL513530; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL590675; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR ProteinModelPortal; F5GZK2; -. DR EPD; F5GZK2; -. DR jPOST; F5GZK2; -. DR PeptideAtlas; F5GZK2; -. DR PRIDE; F5GZK2; -. DR Ensembl; ENST00000535941; ENSP00000444384; ENSG00000124749. DR UCSC; uc063peb.1; human. DR EuPathDB; HostDB:ENSG00000124749.16; -. DR HGNC; HGNC:17025; COL21A1. DR OpenTargets; ENSG00000124749; -. DR eggNOG; ENOG410IS78; Eukaryota. DR eggNOG; ENOG41100RI; LUCA. DR GeneTree; ENSGT00940000162318; -. DR Proteomes; UP000005640; Chromosome 6. DR Bgee; ENSG00000124749; Expressed in 192 organ(s), highest expression level in metanephros. DR ExpressionAtlas; F5GZK2; baseline and differential. DR GO; GO:0005829; C:cytosol; IDA:HPA. DR Gene3D; 3.40.50.410; -; 1. DR InterPro; IPR008160; Collagen. DR InterPro; IPR013320; ConA-like_dom_sf. DR InterPro; IPR001791; Laminin_G. DR InterPro; IPR002035; VWF_A. DR InterPro; IPR036465; vWFA_dom_sf. DR Pfam; PF01391; Collagen; 7. DR Pfam; PF00092; VWA; 1. DR SMART; SM00210; TSPN; 1. DR SMART; SM00327; VWA; 1. DR SUPFAM; SSF49899; SSF49899; 1. DR SUPFAM; SSF53300; SSF53300; 1. DR PROSITE; PS50234; VWFA; 1. PE 1: Evidence at protein level; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Proteomics identification {ECO:0000213|MaxQB:F5GZK2, KW ECO:0000213|PeptideAtlas:F5GZK2}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Signal {ECO:0000256|SAM:SignalP}. FT SIGNAL 1 22 {ECO:0000256|SAM:SignalP}. FT CHAIN 23 956 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5003324715. FT DOMAIN 37 211 VWFA. {ECO:0000259|PROSITE:PS50234}. SQ SEQUENCE 956 AA; 99296 MW; D13685F4BFA0AEF1 CRC64; MAHYITFLCM VLVLLLQNSV LAEDGEVRSS CRTAPTDLVF ILDGSYSVGP ENFEIVKKWL VNITKNFDIG PKFIQVGVVQ YSDYPVLEIP LGSYDSGEHL TAAVESILYL GGNTKTGKAI QFALDYLFAK SSRFLTKIAV VLTDGKSQDD VKDAAQAARD SKITLFAIGV GSETEDAELR AIANKPSSTY VFYVEDYIAI SKIREVMKQK LCEESVCPTR IPVAARDERG FDILLGLDVN KKVKKRIQLS PKKIKGYEVT SKVDLSELTS NVFPEGLPPS YVFVSTQRFK VKKIWDLWRI LTIDGRPQIA VTLNGVDKIL LFTTTSVING SQVVTFANPQ VKTLFDEGWH QIRLLVTEQD VTLYIDDQQI ENKPLHPVLG ILINGQTQIG KYSGKEETVQ FDVQKLRIYC DPEQNNRETA CEIPGFVKCL NGPSDVGSTP APCICPPGKP GLQGPKGDPG LPGNPGYPGQ PGQDGKPGYQ GIAGTPGVPG SPGIQGARGL PGYKGEPGRD GDKGDRGLPG FPGLHGMPGS KGEMGAKGDK GSPGFYGKKG AKGEKGNAGF PGLPGPAGEP GRHGKDGLMG SPGFKGEAGS PGAPGQDGTR GEPGIPGFPG NRGLMGQKGE IGPPGQQGKK GAPGMPGLMG SNGSPGQPGT PGSKGSKGEP GIQGMPGASG LKGEPGATGS PGEPGYMGLP GIQGKKGDKG NQGEKGIQGQ KGENGRQGIP GQQGIQGHHG AKGERGEKGE PGVRGAIGSK GESGVDGLMG PAGPKGQPGD PGPQGPPGLD GKPGREFSEQ FIRQVCTDVI RAQLPVLLQS GRIRNCDHCL SQHGSPGIPG PPGPIGPEGP RGLPGLPGRD GVPGLVGVPG RPGVRGLKGL PGRNGEKGSQ GFGYPGEQGP PGPPGPEGPP GISKEGPPGD PGLPGKDGDH GKPGIQGQPG PPGICDPSLC FSVIARRDPF RKGPNY //