ID F5H3Q5_HUMAN Unreviewed; 1633 AA. AC F5H3Q5; DT 28-JUN-2011, integrated into UniProtKB/TrEMBL. DT 28-JUN-2011, sequence version 1. DT 16-JAN-2019, entry version 66. DE SubName: Full=Collagen alpha-6(IV) chain {ECO:0000313|Ensembl:ENSP00000445236}; GN Name=COL4A6 {ECO:0000313|Ensembl:ENSP00000445236}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000445236, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000445236, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=15772651; DOI=10.1038/nature03440; RA Ross M.T., Grafham D.V., Coffey A.J., Scherer S., McLay K., Muzny D., RA Platzer M., Howell G.R., Burrows C., Bird C.P., Frankish A., RA Lovell F.L., Howe K.L., Ashurst J.L., Fulton R.S., Sudbrak R., Wen G., RA Jones M.C., Hurles M.E., Andrews T.D., Scott C.E., Searle S., RA Ramser J., Whittaker A., Deadman R., Carter N.P., Hunt S.E., Chen R., RA Cree A., Gunaratne P., Havlak P., Hodgson A., Metzker M.L., RA Richards S., Scott G., Steffen D., Sodergren E., Wheeler D.A., RA Worley K.C., Ainscough R., Ambrose K.D., Ansari-Lari M.A., Aradhya S., RA Ashwell R.I., Babbage A.K., Bagguley C.L., Ballabio A., Banerjee R., RA Barker G.E., Barlow K.F., Barrett I.P., Bates K.N., Beare D.M., RA Beasley H., Beasley O., Beck A., Bethel G., Blechschmidt K., Brady N., RA Bray-Allen S., Bridgeman A.M., Brown A.J., Brown M.J., Bonnin D., RA Bruford E.A., Buhay C., Burch P., Burford D., Burgess J., Burrill W., RA Burton J., Bye J.M., Carder C., Carrel L., Chako J., Chapman J.C., RA Chavez D., Chen E., Chen G., Chen Y., Chen Z., Chinault C., RA Ciccodicola A., Clark S.Y., Clarke G., Clee C.M., Clegg S., RA Clerc-Blankenburg K., Clifford K., Cobley V., Cole C.G., Conquer J.S., RA Corby N., Connor R.E., David R., Davies J., Davis C., Davis J., RA Delgado O., Deshazo D., Dhami P., Ding Y., Dinh H., Dodsworth S., RA Draper H., Dugan-Rocha S., Dunham A., Dunn M., Durbin K.J., Dutta I., RA Eades T., Ellwood M., Emery-Cohen A., Errington H., Evans K.L., RA Faulkner L., Francis F., Frankland J., Fraser A.E., Galgoczy P., RA Gilbert J., Gill R., Gloeckner G., Gregory S.G., Gribble S., RA Griffiths C., Grocock R., Gu Y., Gwilliam R., Hamilton C., Hart E.A., RA Hawes A., Heath P.D., Heitmann K., Hennig S., Hernandez J., RA Hinzmann B., Ho S., Hoffs M., Howden P.J., Huckle E.J., Hume J., RA Hunt P.J., Hunt A.R., Isherwood J., Jacob L., Johnson D., Jones S., RA de Jong P.J., Joseph S.S., Keenan S., Kelly S., Kershaw J.K., Khan Z., RA Kioschis P., Klages S., Knights A.J., Kosiura A., Kovar-Smith C., RA Laird G.K., Langford C., Lawlor S., Leversha M., Lewis L., Liu W., RA Lloyd C., Lloyd D.M., Loulseged H., Loveland J.E., Lovell J.D., RA Lozado R., Lu J., Lyne R., Ma J., Maheshwari M., Matthews L.H., RA McDowall J., McLaren S., McMurray A., Meidl P., Meitinger T., RA Milne S., Miner G., Mistry S.L., Morgan M., Morris S., Mueller I., RA Mullikin J.C., Nguyen N., Nordsiek G., Nyakatura G., O'dell C.N., RA Okwuonu G., Palmer S., Pandian R., Parker D., Parrish J., RA Pasternak S., Patel D., Pearce A.V., Pearson D.M., Pelan S.E., RA Perez L., Porter K.M., Ramsey Y., Reichwald K., Rhodes S., RA Ridler K.A., Schlessinger D., Schueler M.G., Sehra H.K., RA Shaw-Smith C., Shen H., Sheridan E.M., Shownkeen R., Skuce C.D., RA Smith M.L., Sotheran E.C., Steingruber H.E., Steward C.A., Storey R., RA Swann R.M., Swarbreck D., Tabor P.E., Taudien S., Taylor T., RA Teague B., Thomas K., Thorpe A., Timms K., Tracey A., Trevanion S., RA Tromans A.C., d'Urso M., Verduzco D., Villasana D., Waldron L., RA Wall M., Wang Q., Warren J., Warry G.L., Wei X., West A., RA Whitehead S.L., Whiteley M.N., Wilkinson J.E., Willey D.L., RA Williams G., Williams L., Williamson A., Williamson H., Wilming L., RA Woodmansey R.L., Wray P.W., Yen J., Zhang J., Zhou J., Zoghbi H., RA Zorilla S., Buck D., Reinhardt R., Poustka A., Rosenthal A., RA Lehrach H., Meindl A., Minx P.J., Hillier L.W., Willard H.F., RA Wilson R.K., Waterston R.H., Rice C.M., Vaudin M., Coulson A., RA Nelson D.L., Weinstock G., Sulston J.E., Durbin R.M., Hubbard T., RA Gibbs R.A., Beck S., Rogers J., Bentley D.R.; RT "The DNA sequence of the human X chromosome."; RL Nature 434:325-337(2005). RN [2] {ECO:0000313|Ensembl:ENSP00000445236} RP IDENTIFICATION. RG Ensembl; RL Submitted (JUL-2011) to UniProtKB. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AL031177; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL034369; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL109943; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL136080; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR RefSeq; NP_001274689.1; NM_001287760.1. DR UniGene; Hs.145586; -. DR ProteinModelPortal; F5H3Q5; -. DR SMR; F5H3Q5; -. DR MaxQB; F5H3Q5; -. DR PRIDE; F5H3Q5; -. DR Ensembl; ENST00000538570; ENSP00000445236; ENSG00000197565. DR GeneID; 1288; -. DR UCSC; uc010npk.5; human. DR CTD; 1288; -. DR EuPathDB; HostDB:ENSG00000197565.15; -. DR HGNC; HGNC:2208; COL4A6. DR OpenTargets; ENSG00000197565; -. DR eggNOG; KOG3544; Eukaryota. DR eggNOG; ENOG410YAVF; LUCA. DR GeneTree; ENSGT00940000153991; -. DR OrthoDB; 63831at2759; -. DR ChiTaRS; COL4A6; human. DR GenomeRNAi; 1288; -. DR Proteomes; UP000005640; Chromosome X. DR Bgee; ENSG00000197565; Expressed in 152 organ(s), highest expression level in esophagus. DR ExpressionAtlas; F5H3Q5; baseline and differential. DR GO; GO:0005581; C:collagen trimer; IEA:UniProtKB-KW. DR GO; GO:0005201; F:extracellular matrix structural constituent; IEA:InterPro. DR Gene3D; 2.170.240.10; -; 1. DR InterPro; IPR008160; Collagen. DR InterPro; IPR001442; Collagen_IV_NC. DR InterPro; IPR036954; Collagen_IV_NC_sf. DR InterPro; IPR016187; CTDL_fold. DR Pfam; PF01413; C4; 2. DR Pfam; PF01391; Collagen; 18. DR SMART; SM00111; C4; 2. DR SUPFAM; SSF56436; SSF56436; 2. DR PROSITE; PS51403; NC1_IV; 1. PE 1: Evidence at protein level; KW Collagen {ECO:0000256|SAAS:SAAS00762088}; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Disulfide bond {ECO:0000256|SAAS:SAAS01066595}; KW Proteomics identification {ECO:0000213|MaxQB:F5H3Q5, KW ECO:0000213|PeptideAtlas:F5H3Q5}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Signal {ECO:0000256|SAM:SignalP}. FT SIGNAL 1 21 {ECO:0000256|SAM:SignalP}. FT CHAIN 22 1633 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5003324755. FT DOMAIN 1409 1633 Collagen IV NC1. FT {ECO:0000259|PROSITE:PS51403}. SQ SEQUENCE 1633 AA; 158123 MW; 153961243B5CF56F CRC64; MHPGLWLLLV TLCLTEELAA AGEKSYGKPC GGQDCSGSCQ CFPEKGARGR PGPIGIQGPT GPQGFTGSTG LSGLKGERGF PGLLGPYGPK GDKGPMGVPG FLGINGIPGH PGQPGPRGPP GLDGCNGTQG AVGFPGPDGY PGLLGPPGLP GQKGSKGDPV LAPGSFKGMK GDPGLPGLDG ITGPQGAPGF PGAVGPAGPP GLQGPPGPPG PLGPDGNMGL GFQGEKGVKG DVGLPGPAGP PPSTGELEFM GFPKGKKGSK GEPGPKGFPG ISGPPGFPGL GTTGEKGEKG EKGIPGLPGP RGPMGSEGVQ GPPGQQGKKG TLGFPGLNGF QGIEGQKGDI GLPGPDVFID IDGAVISGNP GDPGVPGLPG LKGDEGIQGL RGPSGVPGLP ALSGVPGALG PQGFPGLKGD QGNPGRTTIG AAGLPGRDGL PGPPGPPGPP SPEFETETLH NKESGFPGLR GEQGPKGNLG LKGIKGDSGF CACDGGVPNT GPPGEPGPPG PWGLIGLPGL KGARGDRGSG GAQGPAGAPG LVGPLGPSGP KGKKGEPILS TIQGMPGDRG DSGSQGFRGV IGEPGKDGVP GLPGLPGLPG DGGQGFPGEK GLPGLPGEKG HPGPPGLPGN GLPGLPGPRG LPGDKGKDGL PGQQGLPGSK GITLPCIIPG SYGPSGFPGT PGFPGPKGSR GLPGTPGQPG SSGSKGEPGS PGLVHLPELP GFPGPRGEKG LPGFPGLPGK DGLPGMIGSP GLPGSKGATG DIFGAENGAP GEQGLQGLTG HKGFLGDSGL PGLKGVHGKP GLLGPKGERG SPGTPGQVGQ PGTPGSSGPY GIKGKSGLPG APGFPGISGH PGKKGTRGKK GPPGSIVKKG LPGLKGLPGN PGLVGLKGSP GSPGVAGLPA LSGPKGEKGS VGFVGFPGIP GLPGIPGTRG LKGIPGSTGK MGPSGRAGTP GEKGDRGNPG PVGIPSPRRP MSNLWLKGDK GSQGSAGSNG FPGPRGDKGE AGRPGPPGLP GAPGLPGIIK GVSGKPGPPG FMGIRGLPGL KGSSGITGFP GMPGESGSQG IRGSPGLPGA SGLPGLKGDN GQTVEISGSP GPKGQPGESG FKGTKGRDGL IGNIGFPGNK GEDGKVGVSG DVGLPGAPGF PGVAGMRGEP GLPGSSGHQG AIGPLGSPGL IGPKGPSITG VPGPAGLPGP KGEKGYPGIG IGAPGKPGLR GQKGDRGFPG LQGPAGLPGA PGISLPSLIA GQPGDPGRPG LDGERGRPGP AGPPGPPGPS SNQGDTGDPG FPGIPGPKGP KGDQGIPGFS GLPGELGLKG SSGLQGDPGQ TPTAEAVQVP PGPLGLPGID GIPGLTGDPG AQGPVGLQGS KGLPGIPGKD GPSGLPGPPG ALGDPGLPGL QGPPGFEGAP GQQGPFGMPG MPGQSMRVGY TLVKHSQSEQ VPPCPIGMSQ LWVGYSLLFV EGQEKAHNQD LGFAGSCLPR FSTMPFIYCN INEVCHYARR NDKSYWLSTT APIPMMPVSQ TQIPQYISRC SVCEAPSQAI AVHSQDITIP QCPLGWRSLW IGYSFLMHTA AGAEGGGQSL VSPGSCLEDF RATPFIECSG ARGTCHYFAN KYSFWLTTVE ERQQFGELPV SETLKAGQLH TRVSRCQVCM KSL //