ID A0A087WZY5_HUMAN Unreviewed; 1666 AA. AC A0A087WZY5; DT 29-OCT-2014, integrated into UniProtKB/TrEMBL. DT 29-OCT-2014, sequence version 1. DT 16-JAN-2019, entry version 39. DE SubName: Full=Collagen alpha-6(IV) chain {ECO:0000313|Ensembl:ENSP00000482970}; GN Name=COL4A6 {ECO:0000313|Ensembl:ENSP00000482970}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000482970, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000482970, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=15772651; DOI=10.1038/nature03440; RA Ross M.T., Grafham D.V., Coffey A.J., Scherer S., McLay K., Muzny D., RA Platzer M., Howell G.R., Burrows C., Bird C.P., Frankish A., RA Lovell F.L., Howe K.L., Ashurst J.L., Fulton R.S., Sudbrak R., Wen G., RA Jones M.C., Hurles M.E., Andrews T.D., Scott C.E., Searle S., RA Ramser J., Whittaker A., Deadman R., Carter N.P., Hunt S.E., Chen R., RA Cree A., Gunaratne P., Havlak P., Hodgson A., Metzker M.L., RA Richards S., Scott G., Steffen D., Sodergren E., Wheeler D.A., RA Worley K.C., Ainscough R., Ambrose K.D., Ansari-Lari M.A., Aradhya S., RA Ashwell R.I., Babbage A.K., Bagguley C.L., Ballabio A., Banerjee R., RA Barker G.E., Barlow K.F., Barrett I.P., Bates K.N., Beare D.M., RA Beasley H., Beasley O., Beck A., Bethel G., Blechschmidt K., Brady N., RA Bray-Allen S., Bridgeman A.M., Brown A.J., Brown M.J., Bonnin D., RA Bruford E.A., Buhay C., Burch P., Burford D., Burgess J., Burrill W., RA Burton J., Bye J.M., Carder C., Carrel L., Chako J., Chapman J.C., RA Chavez D., Chen E., Chen G., Chen Y., Chen Z., Chinault C., RA Ciccodicola A., Clark S.Y., Clarke G., Clee C.M., Clegg S., RA Clerc-Blankenburg K., Clifford K., Cobley V., Cole C.G., Conquer J.S., RA Corby N., Connor R.E., David R., Davies J., Davis C., Davis J., RA Delgado O., Deshazo D., Dhami P., Ding Y., Dinh H., Dodsworth S., RA Draper H., Dugan-Rocha S., Dunham A., Dunn M., Durbin K.J., Dutta I., RA Eades T., Ellwood M., Emery-Cohen A., Errington H., Evans K.L., RA Faulkner L., Francis F., Frankland J., Fraser A.E., Galgoczy P., RA Gilbert J., Gill R., Gloeckner G., Gregory S.G., Gribble S., RA Griffiths C., Grocock R., Gu Y., Gwilliam R., Hamilton C., Hart E.A., RA Hawes A., Heath P.D., Heitmann K., Hennig S., Hernandez J., RA Hinzmann B., Ho S., Hoffs M., Howden P.J., Huckle E.J., Hume J., RA Hunt P.J., Hunt A.R., Isherwood J., Jacob L., Johnson D., Jones S., RA de Jong P.J., Joseph S.S., Keenan S., Kelly S., Kershaw J.K., Khan Z., RA Kioschis P., Klages S., Knights A.J., Kosiura A., Kovar-Smith C., RA Laird G.K., Langford C., Lawlor S., Leversha M., Lewis L., Liu W., RA Lloyd C., Lloyd D.M., Loulseged H., Loveland J.E., Lovell J.D., RA Lozado R., Lu J., Lyne R., Ma J., Maheshwari M., Matthews L.H., RA McDowall J., McLaren S., McMurray A., Meidl P., Meitinger T., RA Milne S., Miner G., Mistry S.L., Morgan M., Morris S., Mueller I., RA Mullikin J.C., Nguyen N., Nordsiek G., Nyakatura G., O'dell C.N., RA Okwuonu G., Palmer S., Pandian R., Parker D., Parrish J., RA Pasternak S., Patel D., Pearce A.V., Pearson D.M., Pelan S.E., RA Perez L., Porter K.M., Ramsey Y., Reichwald K., Rhodes S., RA Ridler K.A., Schlessinger D., Schueler M.G., Sehra H.K., RA Shaw-Smith C., Shen H., Sheridan E.M., Shownkeen R., Skuce C.D., RA Smith M.L., Sotheran E.C., Steingruber H.E., Steward C.A., Storey R., RA Swann R.M., Swarbreck D., Tabor P.E., Taudien S., Taylor T., RA Teague B., Thomas K., Thorpe A., Timms K., Tracey A., Trevanion S., RA Tromans A.C., d'Urso M., Verduzco D., Villasana D., Waldron L., RA Wall M., Wang Q., Warren J., Warry G.L., Wei X., West A., RA Whitehead S.L., Whiteley M.N., Wilkinson J.E., Willey D.L., RA Williams G., Williams L., Williamson A., Williamson H., Wilming L., RA Woodmansey R.L., Wray P.W., Yen J., Zhang J., Zhou J., Zoghbi H., RA Zorilla S., Buck D., Reinhardt R., Poustka A., Rosenthal A., RA Lehrach H., Meindl A., Minx P.J., Hillier L.W., Willard H.F., RA Wilson R.K., Waterston R.H., Rice C.M., Vaudin M., Coulson A., RA Nelson D.L., Weinstock G., Sulston J.E., Durbin R.M., Hubbard T., RA Gibbs R.A., Beck S., Rogers J., Bentley D.R.; RT "The DNA sequence of the human X chromosome."; RL Nature 434:325-337(2005). RN [2] {ECO:0000313|Ensembl:ENSP00000482970} RP IDENTIFICATION. RG Ensembl; RL Submitted (SEP-2014) to UniProtKB. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AL031177; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL034369; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL109943; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL136080; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR RefSeq; NP_001274688.1; NM_001287759.1. DR UniGene; Hs.145586; -. DR ProteinModelPortal; A0A087WZY5; -. DR SMR; A0A087WZY5; -. DR EPD; A0A087WZY5; -. DR MaxQB; A0A087WZY5; -. DR PRIDE; A0A087WZY5; -. DR Ensembl; ENST00000621266; ENSP00000482970; ENSG00000197565. DR GeneID; 1288; -. DR UCSC; uc011msn.4; human. DR CTD; 1288; -. DR EuPathDB; HostDB:ENSG00000197565.15; -. DR HGNC; HGNC:2208; COL4A6. DR OpenTargets; ENSG00000197565; -. DR eggNOG; KOG3544; Eukaryota. DR eggNOG; ENOG410YAVF; LUCA. DR GeneTree; ENSGT00940000153991; -. DR OrthoDB; 63831at2759; -. DR ChiTaRS; COL4A6; human. DR GenomeRNAi; 1288; -. DR Proteomes; UP000005640; Chromosome X. DR Bgee; ENSG00000197565; Expressed in 152 organ(s), highest expression level in esophagus. DR ExpressionAtlas; A0A087WZY5; baseline and differential. DR GO; GO:0005581; C:collagen trimer; IEA:UniProtKB-KW. DR GO; GO:0005201; F:extracellular matrix structural constituent; IEA:InterPro. DR Gene3D; 2.170.240.10; -; 1. DR InterPro; IPR008160; Collagen. DR InterPro; IPR001442; Collagen_IV_NC. DR InterPro; IPR036954; Collagen_IV_NC_sf. DR InterPro; IPR016187; CTDL_fold. DR Pfam; PF01413; C4; 2. DR Pfam; PF01391; Collagen; 18. DR SMART; SM00111; C4; 2. DR SUPFAM; SSF56436; SSF56436; 2. DR PROSITE; PS51403; NC1_IV; 1. PE 1: Evidence at protein level; KW Collagen {ECO:0000256|SAAS:SAAS00762088}; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Disulfide bond {ECO:0000256|SAAS:SAAS01066595}; KW Proteomics identification {ECO:0000213|MaxQB:A0A087WZY5, KW ECO:0000213|PeptideAtlas:A0A087WZY5}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Signal {ECO:0000256|SAM:SignalP}. FT SIGNAL 1 21 {ECO:0000256|SAM:SignalP}. FT CHAIN 22 1666 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5001832103. FT DOMAIN 1442 1666 Collagen IV NC1. FT {ECO:0000259|PROSITE:PS51403}. SQ SEQUENCE 1666 AA; 161331 MW; F39A7D32DDEADF19 CRC64; MHPGLWLLLV TLCLTEELAA AGEKSYGKPC GGQDCSGSCQ CFPEKGARGR PGPIGIQGPT GPQGFTGSTG LSGLKGERGF PGLLGPYGPK GDKGPMGVPG FLGINGIPGH PGQPGPRGPP GLDGCNGTQG AVGFPGPDGY PGLLGPPGLP GQKGSKGDPV LAPGSFKGMK GDPGLPGLDG ITGPQGAPGF PGAVGPAGPP GLQGPPGPPG PLGPDGNMGL GFQGEKGVKG DVGLPGPAGP PPSTGELEFM GFPKGKKGSK GEPGPKGFPG ISGPPGFPGL GTTGEKGEKG EKGIPGLPGP RGPMGSEGVQ GPPGQQGKKG TLGFPGLNGF QGIEGQKGDI GLPGPDVFID IDGAVISGNP GDPGVPGLPG LKGDEGIQGL RGPSGVPGLP ALSGVPGALG PQGFPGLKGD QGNPGRTTIG AAGLPGRDGL PGPPGPPGPP SPEFETETLH NKESGFPGLR GEQGPKGNLG LKGIKGDSGF CACDGGVPNT GPPGEPGPPG PWGLIGLPGL KGARGDRGSG GAQGPAGAPG LVGPLGPSGP KGKKGEPILS TIQGMPGDRG DSGSQGFRGV IGEPGKDGVP GLPGLPGLPG DGGQGFPGEK GLPGLPGEKG HPGPPGLPGN GLPGLPGPRG LPGDKGKDGL PGQQGLPGSK GITLPCIIPG SYGPSGFPGT PGFPGPKGSR GLPGTPGQPG SSGSKGEPGS PGLVHLPELP GFPGPRGEKG LPGFPGLPGK DGLPGMIGSP GLPGSKGATG DIFGAENGAP GEQGLQGLTG HKGFLGDSGL PGLKGVHGKP GLLGPKGERG SPGTPGQVGQ PGTPGSSGPY GIKGKSGLPG APGFPGISGH PGKKGTRGKK GPPGSIVKKG LPGLKGLPGN PGLVGLKGSP GSPGVAGLPA LSGPKGEKGS VGFVGFPGIP GLPGIPGTRG LKGIPGSTGK MGPSGRAGTP GEKGDRGNPG PVGIPSPRRP MSNLWLKGDK GSQGSAGSNG FPGPRGDKGE AGRPGPPGLP GAPGLPGIIK GVSGKPGPPG FMGIRGLPGL KGSSGITGFP GMPGESGSQG IRGSPGLPGA SGLPGLKGDN GQTVEISGSP GPKGQPGESG FKGTKGRDGL IGNIGFPGNK GEDGKVGVSG DVGLPGAPGF PGVAGMRGEP GLPGSSGHQG AIGPLGSPGL IGPKGPSITG VPGPAGLPGP KGEKGYPGIG IGAPGKPGLR GQKGDRGFPG LQGPAGLPGA PGISLPSLIA GQPGDPGRPG LDGERGRPGP AGPPGPPGPS SNQGDTGDPG FPGIPGPKGP KGDQGIPGFS GLPGELGLKG MRGEPGFMGT PGKVGPPGDP GFPGMKGKAG PRGSSGLQGD PGQTPTAEAV QVPPGPLGLP GIDGIPGLTG DPGAQGPVGL QGSKGLPGIP GKDGPSGLPG PPGALGDPGL PGLQGPPGFE GAPGQQGPFG MPGMPGQSMR VGYTLVKHSQ SEQVPPCPIG MSQLWVGYSL LFVEGQEKAH NQDLGFAGSC LPRFSTMPFI YCNINEVCHY ARRNDKSYWL STTAPIPMMP VSQTQIPQYI SRCSVCEAPS QAIAVHSQDI TIPQCPLGWR SLWIGYSFLM HTAAGAEGGG QSLVSPGSCL EDFRATPFIE CSGARGTCHY FANKYSFWLT TVEERQQFGE LPVSETLKAG QLHTRVSRCQ VCMKSL //