ID A0A087WVP1_HUMAN Unreviewed; 4590 AA. AC A0A087WVP1; DT 29-OCT-2014, integrated into UniProtKB/TrEMBL. DT 29-OCT-2014, sequence version 1. DT 16-JAN-2019, entry version 40. DE SubName: Full=Protocadherin Fat 1 {ECO:0000313|Ensembl:ENSP00000479573}; GN Name=FAT1 {ECO:0000313|Ensembl:ENSP00000479573}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|Ensembl:ENSP00000479573, ECO:0000313|Proteomes:UP000005640}; RN [1] {ECO:0000313|Ensembl:ENSP00000479573, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=15815621; DOI=10.1038/nature03466; RA Hillier L.W., Graves T.A., Fulton R.S., Fulton L.A., Pepin K.H., RA Minx P., Wagner-McPherson C., Layman D., Wylie K., Sekhon M., RA Becker M.C., Fewell G.A., Delehaunty K.D., Miner T.L., Nash W.E., RA Kremitzki C., Oddy L., Du H., Sun H., Bradshaw-Cordum H., Ali J., RA Carter J., Cordes M., Harris A., Isak A., van Brunt A., Nguyen C., RA Du F., Courtney L., Kalicki J., Ozersky P., Abbott S., Armstrong J., RA Belter E.A., Caruso L., Cedroni M., Cotton M., Davidson T., Desai A., RA Elliott G., Erb T., Fronick C., Gaige T., Haakenson W., Haglund K., RA Holmes A., Harkins R., Kim K., Kruchowski S.S., Strong C.M., RA Grewal N., Goyea E., Hou S., Levy A., Martinka S., Mead K., RA McLellan M.D., Meyer R., Randall-Maher J., Tomlinson C., RA Dauphin-Kohlberg S., Kozlowicz-Reilly A., Shah N., RA Swearengen-Shahid S., Snider J., Strong J.T., Thompson J., Yoakum M., RA Leonard S., Pearman C., Trani L., Radionenko M., Waligorski J.E., RA Wang C., Rock S.M., Tin-Wollam A.-M., Maupin R., Latreille P., RA Wendl M.C., Yang S.-P., Pohl C., Wallis J.W., Spieth J., Bieri T.A., RA Berkowicz N., Nelson J.O., Osborne J., Ding L., Meyer R., Sabo A., RA Shotland Y., Sinha P., Wohldmann P.E., Cook L.L., Hickenbotham M.T., RA Eldred J., Williams D., Jones T.A., She X., Ciccarelli F.D., RA Izaurralde E., Taylor J., Schmutz J., Myers R.M., Cox D.R., Huang X., RA McPherson J.D., Mardis E.R., Clifton S.W., Warren W.C., RA Chinwalla A.T., Eddy S.R., Marra M.A., Ovcharenko I., Furey T.S., RA Miller W., Eichler E.E., Bork P., Suyama M., Torrents D., RA Waterston R.H., Wilson R.K.; RT "Generation and annotation of the DNA sequences of human chromosomes 2 RT and 4."; RL Nature 434:724-731(2005). RN [2] {ECO:0000213|PubMed:18220336} RP IDENTIFICATION BY MASS SPECTROMETRY [LARGE SCALE ANALYSIS]. RX PubMed=18220336; DOI=10.1021/pr0705441; RA Cantin G.T., Yi W., Lu B., Park S.K., Xu T., Lee J.D., Yates J.R.; RT "Combining protein-based IMAC, peptide-based IMAC, and MudPIT for RT efficient phosphoproteomic analysis."; RL J. Proteome Res. 7:1346-1351(2008). RN [3] {ECO:0000213|PubMed:21269460} RP IDENTIFICATION BY MASS SPECTROMETRY [LARGE SCALE ANALYSIS]. RX PubMed=21269460; DOI=10.1186/1752-0509-5-17; RA Burkard T.R., Planyavsky M., Kaupe I., Breitwieser F.P., RA Burckstummer T., Bennett K.L., Superti-Furga G., Colinge J.; RT "Initial characterization of the human central proteome."; RL BMC Syst. Biol. 5:17-17(2011). RN [4] {ECO:0000313|Ensembl:ENSP00000479573} RP IDENTIFICATION. RG Ensembl; RL Submitted (SEP-2014) to UniProtKB. CC -!- CAUTION: Lacks conserved residue(s) required for the propagation CC of feature annotation. {ECO:0000256|PROSITE-ProRule:PRU00122}. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AC107050; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AC110761; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR ProteinModelPortal; A0A087WVP1; -. DR EPD; A0A087WVP1; -. DR jPOST; A0A087WVP1; -. DR MaxQB; A0A087WVP1; -. DR PeptideAtlas; A0A087WVP1; -. DR Ensembl; ENST00000614102; ENSP00000479573; ENSG00000083857. DR UCSC; uc063bou.1; human. DR EuPathDB; HostDB:ENSG00000083857.13; -. DR HGNC; HGNC:3595; FAT1. DR OpenTargets; ENSG00000083857; -. DR eggNOG; KOG1219; Eukaryota. DR eggNOG; ENOG410XPEI; LUCA. DR GeneTree; ENSGT00940000157733; -. DR OMA; HVFFGGH; -. DR PhylomeDB; A0A087WVP1; -. DR ChiTaRS; FAT1; human. DR Proteomes; UP000005640; Chromosome 4. DR Bgee; ENSG00000083857; Expressed in 229 organ(s), highest expression level in epithelium of mammary gland. DR ExpressionAtlas; A0A087WVP1; baseline and differential. DR GO; GO:0016021; C:integral component of membrane; IEA:UniProtKB-KW. DR GO; GO:0005886; C:plasma membrane; IEA:InterPro. DR GO; GO:0005509; F:calcium ion binding; IEA:InterPro. DR GO; GO:0007156; P:homophilic cell adhesion via plasma membrane adhesion molecules; IEA:InterPro. DR InterPro; IPR002126; Cadherin-like_dom. DR InterPro; IPR015919; Cadherin-like_sf. DR InterPro; IPR020894; Cadherin_CS. DR InterPro; IPR013320; ConA-like_dom_sf. DR InterPro; IPR001881; EGF-like_Ca-bd_dom. DR InterPro; IPR013032; EGF-like_CS. DR InterPro; IPR000742; EGF-like_dom. DR InterPro; IPR000152; EGF-type_Asp/Asn_hydroxyl_site. DR InterPro; IPR018097; EGF_Ca-bd_CS. DR InterPro; IPR001791; Laminin_G. DR Pfam; PF00028; Cadherin; 29. DR Pfam; PF00008; EGF; 2. DR Pfam; PF02210; Laminin_G_2; 1. DR PRINTS; PR00205; CADHERIN. DR SMART; SM00112; CA; 34. DR SMART; SM00181; EGF; 5. DR SMART; SM00179; EGF_CA; 4. DR SMART; SM00282; LamG; 1. DR SUPFAM; SSF49313; SSF49313; 33. DR SUPFAM; SSF49899; SSF49899; 1. DR PROSITE; PS00010; ASX_HYDROXYL; 1. DR PROSITE; PS00232; CADHERIN_1; 13. DR PROSITE; PS00022; EGF_1; 4. DR PROSITE; PS01186; EGF_2; 1. DR PROSITE; PS50026; EGF_3; 5. DR PROSITE; PS01187; EGF_CA; 1. DR PROSITE; PS50025; LAM_G_DOMAIN; 1. PE 1: Evidence at protein level; KW Calcium {ECO:0000256|SAAS:SAAS00020193}; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Disulfide bond {ECO:0000256|PROSITE-ProRule:PRU00076, KW ECO:0000256|SAAS:SAAS00601599}; KW EGF-like domain {ECO:0000256|PROSITE-ProRule:PRU00076, KW ECO:0000256|SAAS:SAAS00032677}; KW Membrane {ECO:0000256|SAAS:SAAS00616217, ECO:0000256|SAM:Phobius}; KW Proteomics identification {ECO:0000213|EPD:A0A087WVP1, KW ECO:0000213|MaxQB:A0A087WVP1, ECO:0000213|PeptideAtlas:A0A087WVP1}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Repeat {ECO:0000256|SAAS:SAAS00436611}; KW Signal {ECO:0000256|SAM:SignalP}; KW Transmembrane {ECO:0000256|SAAS:SAAS00616217, KW ECO:0000256|SAM:Phobius}; KW Transmembrane helix {ECO:0000256|SAAS:SAAS00616217, KW ECO:0000256|SAM:Phobius}. FT SIGNAL 1 21 {ECO:0000256|SAM:SignalP}. FT CHAIN 22 4590 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5001831979. FT TRANSMEM 4184 4204 Helical. {ECO:0000256|SAM:Phobius}. FT DOMAIN 3792 3829 EGF-like. {ECO:0000259|PROSITE:PS50026}. FT DOMAIN 3831 4011 LAM_G_DOMAIN. FT {ECO:0000259|PROSITE:PS50025}. FT DOMAIN 4015 4052 EGF-like. {ECO:0000259|PROSITE:PS50026}. FT DOMAIN 4054 4090 EGF-like. {ECO:0000259|PROSITE:PS50026}. FT DOMAIN 4091 4127 EGF-like. {ECO:0000259|PROSITE:PS50026}. FT DOMAIN 4129 4165 EGF-like. {ECO:0000259|PROSITE:PS50026}. FT DISULFID 3801 3818 {ECO:0000256|PROSITE-ProRule:PRU00076}. FT DISULFID 4042 4051 {ECO:0000256|PROSITE-ProRule:PRU00076}. FT DISULFID 4080 4089 {ECO:0000256|PROSITE-ProRule:PRU00076}. FT DISULFID 4117 4126 {ECO:0000256|PROSITE-ProRule:PRU00076}. FT DISULFID 4155 4164 {ECO:0000256|PROSITE-ProRule:PRU00076}. SQ SEQUENCE 4590 AA; 506380 MW; 419289F2225FD5D7 CRC64; MGRHLALLLL LLLLFQHFGD SDGSQRLEQT PLQFTHLEYN VTVQENSAAK TYVGHPVKMG VYITHPAWEV RYKIVSGDSE NLFKAEEYIL GDFCFLRIRT KGGNTAILNR EVKDHYTLIV KALEKNTNVE ARTKVRVQVL DTNDLRPLFS PTSYSVSLPE NTAIRTSIAR VSATDADIGT NGEFYYSFKD RTDMFAIHPT SGVIVLTGRL DYLETKLYEM EILAADRGMK LYGSSGISSM AKLTVHIEQA NECAPVITAV TLSPSELDRD PAYAIVTVDD CDQGANGDIA SLSIVAGDLL QQFRTVRSFP GSKEYKVKAI GGIDWDSHPF GYNLTLQAKD KGTPPQFSSV KVIHVTSPQF KAGPVKFEKD VYRAEISEFA PPNTPVVMVK AIPAYSHLRY VFKSTPGKAK FSLNYNTGLI SILEPVKRQQ AAHFELEVTT SDRKASTKVL VKVLGANSNP PEFTQTAYKA AFDENVPIGT TVMSLSAVDP DEGENGYVTY SIANLNHVPF AIDHFTGAVS TSENLDYELM PRVYTLRIRA SDWGLPYRRE VEVLATITLN NLNDNTPLFE KINCEGTIPR DLGVGEQITT VSAIDADELQ LVQYQIEAGN ELDFFSLNPN SGVLSLKRSL MDGLGAKVSF HSLRITATDG ENFATPLYIN ITVAASHKLV NLQCEETGVA KMLAEKLLQA NKLHNQGEVE DIFFDSHSVN AHIPQFRSTL PTGIQVKENQ PVGSSVIFMN STDLDTGFNG KLVYAVSGGN EDSCFMIDME TGMLKILSPL DRETTDKYTL NITVYDLGIP QKAAWRLLHV VVVDANDNPP EFLQESYFVE VSEDKEVHSE IIQVEATDKD LGPNGHVTYS IVTDTDTFSI DSVTGVVNIA RPLDRELQHE HSLKIEARDQ AREEPQLFST VVVKVSLEDV NDNPPTFIPP NYRVKVREDL PEGTVIMWLE AHDPDLGQSG QVRYSLLDHG EGNFDVDKLS GAVRIVQQLD FEKKQVYNLT VRAKDKGKPV SLSSTCYVEV EVVDVNENLH PPVFSSFVEK GTVKEDAPVG SLVMTVSAHD EDARRDGEIR YSIRDGSGVG VFKIGEETGV IETSDRLDRE STSHYWLTVF ATDQGVVPLS SFIEIYIEVE DVNDNAPQTS EPVYYPEIME NSPKDVSVVQ IEAFDPDSSS NDKLMYKITS GNPQGFFSIH PKTGLITTTS RKLDREQQDE HILEVTVTDN GSPPKSTIAR VIVKILDEND NKPQFLQKFY KIRLPEREKP DRERNARREP LYHVIATDKD EGPNAEISYS IEDGNEHGKF FIEPKTGVVS SKRFSAAGEY DILSIKAVDN GRPQKSSTTR LHIEWISKPK PSLEPISFEE SFFTFTVMES DPVAHMIGVI SVEPPGIPLW FDITGGNYDS HFDVDKGTGT IIVAKPLDAE QKSNYNLTVE ATDGTTTILT QVFIKVIDTN DHRPQFSTSK YEVVIPEDTA PETEILQISA VDQDEKNKLI YTLQSSRDPL SLKKFRLDPA TGSLYTSEKL DHEAVPAHLT VMVRDQDVPV KRNFARIVVN VSDTNDHAPW FTASSYKGRV YESAAVGSVV LQVTALDKDK GKNAEVLYSI ESGTFGNIGN SFMIDPVLGS IKTAKELDRS NQAEYDLMVK ATDKGSPPMS EITSVRIFVT IADNASPKFT SKEYSVELSE TVSIGSFVGM VTAHSQSSVV YEIKDGNTGD AFDINPHSGT IITQKALDFE TLPIYTLIIQ GTNMAGLSTN TTVLVHLQDE NDNAPVFMQA EYTGLISESA SINSVVLTDR NVPLVIRAAD ADKDSNALLV YHIVEPSVHT YFAIDSSTGA IHTVLSLDYE ETSIFHFTVQ VHDMGTPRLF AEYAANVTVH VIDINDCPPV FAKPLYEASL LLPTYKGVKV ITVNATDADS SAFSQLIYSI TEGNIGEKFS MDYKTGALTV QNTTQLRSRY ELTVRASDGR FAGLTSVKIN VKESKESHLK FTQDVYSAVV KENSTEAETL AVITAIGNPI NEPLFYHILN PDRRFKISRT SGVLSTTGTP FDREQQEAFD VVVEVTEEHK PSAVAHVVVK VIVEDQNDNA PVFVNLPYYA VVKVDTEVGH VIRYVTAVDR DSGRNGEVHY YLKEHHEHFQ IGPLGEISLK KQFELDTLNK EYLVTVVAKD GGNPAFSAEV IVPITVMNKA MPVFEKPFYS AEIAESIQVH SPVVHVQANS PEGLKVFYSI TDGDPFSQFT INFNTGVINV IAPLDFEAHP AYKLSIRATD SLTGAHAEVF VDIIVDDIND NPPVFAQQSY AVTLSEASVI GTSVVQVRAT DSDSEPNRGI SYQMFGNHSK SHDHFHVDSS TGLISLLRTL DYEQSRQHTI FVRAVDGGMP TLSSDVIVTV DVTDLNDNPP LFEQQIYEAR ISEHAPHGHF VTCVKAYDAD SSDIDKLQYS ILSGNDHKHF VIDSATGIIT LSNLHRHALK PFYSLNLSVS DGVFRSSTQV HVTVIGGNLH SPAFLQNEYE VELAENAPLH TLVMEVKTTD GDSGIYGHVT YHIVNDFAKD RFYINERGQI FTLEKLDRET PAEKVISVRL MAKDAGGKVA FCTVNVILTD DNDNAPQFRA TKYEVNIGSS AAKGTSVVKV LASDADEGSN ADITYAIEAD SESVKENLEI NKLSGVITTK ESLIGLENEF FTFFVRAVDN GSPSKESVVL VYVKILPPEM QLPKFSEPFY TFTVSEDVPI GTEIDLIRAE HSGTVLYSLV KGNTPESNRD ESFVIDRQSG RLKLEKSLDH ETTKWYQFSI LARCTQDDHE MVASVDVSIQ VKDANDNSPV FESSPYEAFI VENLPGGSRV IQIRASDADS GTNGQVMYSL DQSQSVEVIE SFAINMETGW ITTLKELDHE KRDNYQIKVV ASDHGEKIQL SSTAIVDVTV TDVNDSPPRF TAEIYKGTVS EDDPQGGVIA ILSTTDADSE EINRQVTYFI TGGDPLGQFA VETIQNEWKV YVKKPLDREK RDNYLLTITA TDGTFSSKAI VEVKVLDAND NSPVCEKTLY SDTIPEDVLP GKLIMQISAT DADIRSNAEI TYTLLGSGAE KFKLNPDTGE LKTSTPLDRE EQAVYHLLVR ATDGGGRFCQ ASIVLTLEDV NDNAPEFSAD PYAITVFENT EPGTLLTRVQ ATDADAGLNR KILYSLIDSA DGQFSINELS GIIQLEKPLD RELQAVYTLS LKAVDQGLPR RLTATGTVIV SVLDINDNPP VFEYREYGAT VSEDILVGTE VLQVYAASRD IEANAEITYS IISGNEHGKF SIDSKTGAVF IIENLDYESS HEYYLTVEAT DGGTPSLSDV ATVNVNVTDI NDNTPVFSQD TYTTVISEDA VLEQSVITVM ADDADGPSNS HIHYSIIDGN QGSSFTIDPV RGEVKVTKLL DRETISGYTL TVQASDNGSP PRVNTTTVNI DVSDVNDNAP VFSRGNYSVI IQENKPVGFS VLQLVVTDED SSHNGPPFFF TIVTGNDEKA FEVNPQGVLL TSSAIKRKEK DHYLLQVKVA DNGKPQLSSL TYIDIRVIEE SIYPPAILPL EIFITSSGEE YSGGVIGKIH ATDQDVYDTL TYSLDPQMDN LFSVSSTGGK LIAHKKLDIG QYLLNVSVTD GKFTTVADIT VHIRQVTQEM LNHTIAIRFA NLTPEEFVGD YWRNFQRALR NILGVRRNDI QIVSLQSSEP HPHLDVLLFV EKPGSAQIST KQLLHKINSS VTDIEEIIGV RILNVFQKLC AGLDCPWKFC DEKVSVDESV MSTHSTARLS FVTPRHHRAA VCLCKEGRCP PVHHGCEDDP CPEGSECVSD PWEEKHTCVC PSGRFGQCPG SSSMTLTGNS YVKYRLTENE NKLEMKLTMR LRTYSTHAVV MYARGTDYSI LEIHHGRLQY KFDCGSGPGI VSVQSIQVND GQWHAVALEV NGNYARLVLD QVHTASGTAP GTLKTLNLDN YVFFGGHIRQ QGTRHGRSPQ VGNGFRGCMD SIYLNGQELP LNSKPRSYAH IEESVDVSPG CFLTATEDCA SNPCQNGGVC NPSPAGGYYC KCSALYIGTH CEISVNPCSS KPCLYGGTCV VDNGGFVCQC RGLYTGQRCQ LSPYCKDEPC KNGGTCFDSL DGAVCQCDSG FRGERCQSDI DECSGNPCLH GALCENTHGS YHCNCSHEYR GRHCEDAAPN QYVSTPWNIG LAEGIGIVVF VAGIFLLVVV FVLCRKMISR KKKHQAEPKD KHLGPATAFL QRPYFDSKLN KNIYSDIPPQ VPVRPISYTP SIPSDSRNNL DRNSFEGSAI PEHPEFSTFN PESVHGHRKA VAVCSVAPNL PPPPPSNSPS DSDSIQKPSW DFDYDTKVVD LDPCLSKKPL EEKPSQPYSA RESLSEVQSL SSFQSESCDD NGYHWDTSDW MPSVPLPDIQ EFPNYEVIDE QTPLYSADPN AIDTDYYPGG YDIESDFPPP PEDFPAADEL PPLPPEFSNQ FESIHPPRDM PAAGSLGSSS RNRQRFNLNQ YLPNFYPLDM SEPQTKGTGE NSTCREPHAP YPPGYQRHFE APAVESMPMS VYASTASCSD VSACCEVESE VMMSDYESGD DGHFEEVTIP PLDSQQHTEV //