ID F5H851_HUMAN Unreviewed; 1678 AA. AC F5H851; DT 28-JUN-2011, integrated into UniProtKB/TrEMBL. DT 29-OCT-2014, sequence version 2. DT 05-DEC-2018, entry version 64. DE SubName: Full=Collagen alpha-6(IV) chain {ECO:0000313|Ensembl:ENSP00000443707}; GN Name=COL4A6 {ECO:0000313|Ensembl:ENSP00000443707}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000443707, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000443707, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=15772651; DOI=10.1038/nature03440; RA Ross M.T., Grafham D.V., Coffey A.J., Scherer S., McLay K., Muzny D., RA Platzer M., Howell G.R., Burrows C., Bird C.P., Frankish A., RA Lovell F.L., Howe K.L., Ashurst J.L., Fulton R.S., Sudbrak R., Wen G., RA Jones M.C., Hurles M.E., Andrews T.D., Scott C.E., Searle S., RA Ramser J., Whittaker A., Deadman R., Carter N.P., Hunt S.E., Chen R., RA Cree A., Gunaratne P., Havlak P., Hodgson A., Metzker M.L., RA Richards S., Scott G., Steffen D., Sodergren E., Wheeler D.A., RA Worley K.C., Ainscough R., Ambrose K.D., Ansari-Lari M.A., Aradhya S., RA Ashwell R.I., Babbage A.K., Bagguley C.L., Ballabio A., Banerjee R., RA Barker G.E., Barlow K.F., Barrett I.P., Bates K.N., Beare D.M., RA Beasley H., Beasley O., Beck A., Bethel G., Blechschmidt K., Brady N., RA Bray-Allen S., Bridgeman A.M., Brown A.J., Brown M.J., Bonnin D., RA Bruford E.A., Buhay C., Burch P., Burford D., Burgess J., Burrill W., RA Burton J., Bye J.M., Carder C., Carrel L., Chako J., Chapman J.C., RA Chavez D., Chen E., Chen G., Chen Y., Chen Z., Chinault C., RA Ciccodicola A., Clark S.Y., Clarke G., Clee C.M., Clegg S., RA Clerc-Blankenburg K., Clifford K., Cobley V., Cole C.G., Conquer J.S., RA Corby N., Connor R.E., David R., Davies J., Davis C., Davis J., RA Delgado O., Deshazo D., Dhami P., Ding Y., Dinh H., Dodsworth S., RA Draper H., Dugan-Rocha S., Dunham A., Dunn M., Durbin K.J., Dutta I., RA Eades T., Ellwood M., Emery-Cohen A., Errington H., Evans K.L., RA Faulkner L., Francis F., Frankland J., Fraser A.E., Galgoczy P., RA Gilbert J., Gill R., Gloeckner G., Gregory S.G., Gribble S., RA Griffiths C., Grocock R., Gu Y., Gwilliam R., Hamilton C., Hart E.A., RA Hawes A., Heath P.D., Heitmann K., Hennig S., Hernandez J., RA Hinzmann B., Ho S., Hoffs M., Howden P.J., Huckle E.J., Hume J., RA Hunt P.J., Hunt A.R., Isherwood J., Jacob L., Johnson D., Jones S., RA de Jong P.J., Joseph S.S., Keenan S., Kelly S., Kershaw J.K., Khan Z., RA Kioschis P., Klages S., Knights A.J., Kosiura A., Kovar-Smith C., RA Laird G.K., Langford C., Lawlor S., Leversha M., Lewis L., Liu W., RA Lloyd C., Lloyd D.M., Loulseged H., Loveland J.E., Lovell J.D., RA Lozado R., Lu J., Lyne R., Ma J., Maheshwari M., Matthews L.H., RA McDowall J., McLaren S., McMurray A., Meidl P., Meitinger T., RA Milne S., Miner G., Mistry S.L., Morgan M., Morris S., Mueller I., RA Mullikin J.C., Nguyen N., Nordsiek G., Nyakatura G., O'dell C.N., RA Okwuonu G., Palmer S., Pandian R., Parker D., Parrish J., RA Pasternak S., Patel D., Pearce A.V., Pearson D.M., Pelan S.E., RA Perez L., Porter K.M., Ramsey Y., Reichwald K., Rhodes S., RA Ridler K.A., Schlessinger D., Schueler M.G., Sehra H.K., RA Shaw-Smith C., Shen H., Sheridan E.M., Shownkeen R., Skuce C.D., RA Smith M.L., Sotheran E.C., Steingruber H.E., Steward C.A., Storey R., RA Swann R.M., Swarbreck D., Tabor P.E., Taudien S., Taylor T., RA Teague B., Thomas K., Thorpe A., Timms K., Tracey A., Trevanion S., RA Tromans A.C., d'Urso M., Verduzco D., Villasana D., Waldron L., RA Wall M., Wang Q., Warren J., Warry G.L., Wei X., West A., RA Whitehead S.L., Whiteley M.N., Wilkinson J.E., Willey D.L., RA Williams G., Williams L., Williamson A., Williamson H., Wilming L., RA Woodmansey R.L., Wray P.W., Yen J., Zhang J., Zhou J., Zoghbi H., RA Zorilla S., Buck D., Reinhardt R., Poustka A., Rosenthal A., RA Lehrach H., Meindl A., Minx P.J., Hillier L.W., Willard H.F., RA Wilson R.K., Waterston R.H., Rice C.M., Vaudin M., Coulson A., RA Nelson D.L., Weinstock G., Sulston J.E., Durbin R.M., Hubbard T., RA Gibbs R.A., Beck S., Rogers J., Bentley D.R.; RT "The DNA sequence of the human X chromosome."; RL Nature 434:325-337(2005). RN [2] {ECO:0000313|Ensembl:ENSP00000443707} RP IDENTIFICATION. RG Ensembl; RL Submitted (JUL-2011) to UniProtKB. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AL031177; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL034369; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL109943; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AL136080; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR ProteinModelPortal; F5H851; -. DR MaxQB; F5H851; -. DR PRIDE; F5H851; -. DR Ensembl; ENST00000545689; ENSP00000443707; ENSG00000197565. DR UCSC; uc065aqf.1; human. DR EuPathDB; HostDB:ENSG00000197565.15; -. DR HGNC; HGNC:2208; COL4A6. DR OpenTargets; ENSG00000197565; -. DR eggNOG; KOG3544; Eukaryota. DR eggNOG; ENOG410YAVF; LUCA. DR GeneTree; ENSGT00940000153991; -. DR ChiTaRS; COL4A6; human. DR Proteomes; UP000005640; Chromosome X. DR Bgee; ENSG00000197565; Expressed in 152 organ(s), highest expression level in esophagus. DR ExpressionAtlas; F5H851; baseline and differential. DR GO; GO:0005581; C:collagen trimer; IEA:UniProtKB-KW. DR GO; GO:0005201; F:extracellular matrix structural constituent; IEA:InterPro. DR Gene3D; 2.170.240.10; -; 1. DR InterPro; IPR008160; Collagen. DR InterPro; IPR001442; Collagen_IV_NC. DR InterPro; IPR036954; Collagen_IV_NC_sf. DR InterPro; IPR016187; CTDL_fold. DR Pfam; PF01413; C4; 2. DR Pfam; PF01391; Collagen; 20. DR SMART; SM00111; C4; 2. DR SUPFAM; SSF56436; SSF56436; 2. DR PROSITE; PS51403; NC1_IV; 1. PE 1: Evidence at protein level; KW Collagen {ECO:0000256|SAAS:SAAS00762088}; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Disulfide bond {ECO:0000256|SAAS:SAAS01066595}; KW Proteomics identification {ECO:0000213|MaxQB:F5H851, KW ECO:0000213|PeptideAtlas:F5H851}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Signal {ECO:0000256|SAM:SignalP}. FT SIGNAL 1 21 {ECO:0000256|SAM:SignalP}. FT CHAIN 22 1678 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5003327292. FT DOMAIN 1454 1678 Collagen IV NC1. FT {ECO:0000259|PROSITE:PS51403}. SQ SEQUENCE 1678 AA; 162497 MW; 936C2CC438AFFA96 CRC64; MHPGLWLLLV TLCLTEELAA AGEKSYGKPC GGQDCSGSCQ CFPEKGARGR PGPIGIQGPT GPQGFTGSTG LSGLKGERGF PGLLGPYGPK GDKGPMGVPG FLGINGIPGH PGQPGPRGPP GLDGCNGTQG AVGFPGPDGY PGLLGPPGLP GQKGSKGDPV LAPGSFKGMK GDPGLPGLDG ITGPQGAPGF PGAVGPAGPP GLQGPPGPPG PLGPDGNMGL GFQGEKGVKG DVGLPGPAGP PPSTGELEFM GFPKGKKGSK GEPGPKGFPG ISGPPGFPGL GTTGEKGEKG EKGIPGLPGP RGPMGSEGVQ GPPGQQGKKG TLGFPGLNGF QGIEGQKGDI GLPGPDVFID IDGAVISGNP GDPGVPGLPG LKGDEGIQGL RGPSGVPGLP ALSGVPGALG PQGFPGLKGD QGNPGRTTIG AAGLPGRDGL PGPPGPPGPP SPEFETETLH NKESGFPGLR GEQGPKGNLG LKGIKGDSGF CACDGGVPNT GPPGEPGPPG PWGLIGLPGL KGARGDRGSG GAQGPAGAPG LVGPLGPSGP KGKKGEPILS TIQGMPGDRG DSGSQGFRGV IGEPGKDGVP GLPGLPGLPG DGGQGFPGEK GLPGLPGEKG HPGPPGLPGN GLPGLPGPRG LPGDKGKDGL PGQQGLPGSK GITLPCIIPG SYGPSGFPGT PGFPGPKGSR GLPGTPGQPG SSGSKGEPGS PGLVHLPELP GFPGPRGEKG LPGFPGLPGK DGLPGMIGSP GLPGSKGATG DIFGAENGAP GEQGLQGLTG HKGFLGDSGL PGLKGVHGKP GLLGPKGERG SPGTPGQVGQ PGTPGSSGPY GIKGKSGLPG APGFPGISGH PGKKGTRGKK GPPGSIVKKG LPGLKGLPGN PGLVGLKGSP GSPGVAGLPA LSGPKGEKGS VGFVGFPGIP GLPGIPGTRG LKGIPGSTGK MGPSGRAGTP GEKGDRGNPG PVGIPSPRRP MSNLWLKGDK GSQGSAGSNG FPGPRGDKGE AGRPGPPGLP GAPGLPGIIK GVSGKPGPPG FMGIRGLPGL KGSSGITGFP GMPGESGSQG IRGSPGLPGA SGLPGLKGDN GQTVEISGSP GPKGQPGESG FKGTKGRDGL IGNIGFPGNK GEDGKVGVSG DVGLPGAPGF PGVAGMRGEP GLPGSSGHQG AIGPLGSPGL IGPKGFPGFP GLHGLNGLPG TKGTHGTPGP SITGVPGPAG LPGPKGEKGY PGIGIGAPGK PGLRGQKGDR GFPGLQGPAG LPGAPGISLP SLIAGQPGDP GRPGLDGERG RPGPAGPPGP PGPSSNQGDT GDPGFPGIPG FSGLPGELGL KGMRGEPGFM GTPGKVGPPG DPGFPGMKGK AGPRGSSGLQ GDPGQTPTAE AVQVPPGPLG LPGIDGIPGL TGDPGAQGPV GLQGSKGLPG IPGKDGPSGL PGPPGALGDP GLPGLQGPPG FEGAPGQQGP FGMPGMPGQS MRVGYTLVKH SQSEQVPPCP IGMSQLWVGY SLLFVEGQEK AHNQDLGFAG SCLPRFSTMP FIYCNINEVC HYARRNDKSY WLSTTAPIPM MPVSQTQIPQ YISRCSVCEA PSQAIAVHSQ DITIPQCPLG WRSLWIGYSF LMHTAAGAEG GGQSLVSPGS CLEDFRATPF IECSGARGTC HYFANKYSFW LTTVEERQQF GELPVSETLK AGQLHTRVSR CQVCMKSL //