ID B4E1Z4_HUMAN Unreviewed; 1266 AA. AC B4E1Z4; DT 23-SEP-2008, integrated into UniProtKB/TrEMBL. DT 23-SEP-2008, sequence version 1. DT 13-FEB-2019, entry version 103. DE SubName: Full=cDNA FLJ55673, highly similar to Complement factor B {ECO:0000313|EMBL:BAG64956.1}; OS Homo sapiens (Human). OC Eukaryota; Metazoa; Chordata; Craniata; Vertebrata; Euteleostomi; OC Mammalia; Eutheria; Euarchontoglires; Primates; Haplorrhini; OC Catarrhini; Hominidae; Homo. OX NCBI_TaxID=9606 {ECO:0000313|EMBL:BAG64956.1}; RN [1] {ECO:0000313|Ensembl:ENSP00000410815, ECO:0000313|Proteomes:UP000005640} RP NUCLEOTIDE SEQUENCE [LARGE SCALE GENOMIC DNA]. RX PubMed=14574404; DOI=10.1038/nature02055; RA Mungall A.J., Palmer S.A., Sims S.K., Edwards C.A., Ashurst J.L., RA Wilming L., Jones M.C., Horton R., Hunt S.E., Scott C.E., RA Gilbert J.G.R., Clamp M.E., Bethel G., Milne S., Ainscough R., RA Almeida J.P., Ambrose K.D., Andrews T.D., Ashwell R.I.S., RA Babbage A.K., Bagguley C.L., Bailey J., Banerjee R., Barker D.J., RA Barlow K.F., Bates K., Beare D.M., Beasley H., Beasley O., Bird C.P., RA Blakey S.E., Bray-Allen S., Brook J., Brown A.J., Brown J.Y., RA Burford D.C., Burrill W., Burton J., Carder C., Carter N.P., RA Chapman J.C., Clark S.Y., Clark G., Clee C.M., Clegg S., Cobley V., RA Collier R.E., Collins J.E., Colman L.K., Corby N.R., Coville G.J., RA Culley K.M., Dhami P., Davies J., Dunn M., Earthrowl M.E., RA Ellington A.E., Evans K.A., Faulkner L., Francis M.D., Frankish A., RA Frankland J., French L., Garner P., Garnett J., Ghori M.J., RA Gilby L.M., Gillson C.J., Glithero R.J., Grafham D.V., Grant M., RA Gribble S., Griffiths C., Griffiths M.N.D., Hall R., Halls K.S., RA Hammond S., Harley J.L., Hart E.A., Heath P.D., Heathcott R., RA Holmes S.J., Howden P.J., Howe K.L., Howell G.R., Huckle E., RA Humphray S.J., Humphries M.D., Hunt A.R., Johnson C.M., Joy A.A., RA Kay M., Keenan S.J., Kimberley A.M., King A., Laird G.K., Langford C., RA Lawlor S., Leongamornlert D.A., Leversha M., Lloyd C.R., Lloyd D.M., RA Loveland J.E., Lovell J., Martin S., Mashreghi-Mohammadi M., RA Maslen G.L., Matthews L., McCann O.T., McLaren S.J., McLay K., RA McMurray A., Moore M.J.F., Mullikin J.C., Niblett D., Nickerson T., RA Novik K.L., Oliver K., Overton-Larty E.K., Parker A., Patel R., RA Pearce A.V., Peck A.I., Phillimore B.J.C.T., Phillips S., Plumb R.W., RA Porter K.M., Ramsey Y., Ranby S.A., Rice C.M., Ross M.T., Searle S.M., RA Sehra H.K., Sheridan E., Skuce C.D., Smith S., Smith M., Spraggon L., RA Squares S.L., Steward C.A., Sycamore N., Tamlyn-Hall G., Tester J., RA Theaker A.J., Thomas D.W., Thorpe A., Tracey A., Tromans A., Tubby B., RA Wall M., Wallis J.M., West A.P., White S.S., Whitehead S.L., RA Whittaker H., Wild A., Willey D.J., Wilmer T.E., Wood J.M., Wray P.W., RA Wyatt J.C., Young L., Younger R.M., Bentley D.R., Coulson A., RA Durbin R., Hubbard T., Sulston J.E., Dunham I., Rogers J., Beck S.; RT "The DNA sequence and analysis of human chromosome 6."; RL Nature 425:805-811(2003). RN [2] {ECO:0000313|EMBL:BAG64956.1} RP NUCLEOTIDE SEQUENCE. RC TISSUE=Trachea {ECO:0000313|EMBL:BAG64956.1}; RA Wakamatsu A., Yamamoto J., Kimura K., Ishii S., Watanabe K., RA Sugiyama A., Murakawa K., Kaida T., Tsuchiya K., Fukuzumi Y., RA Kumagai A., Oishi Y., Yamamoto S., Ono Y., Komori Y., Yamazaki M., RA Kisu Y., Nishikawa T., Sugano S., Nomura N., Isogai T.; RT "NEDO human cDNA sequencing project focused on splicing variants."; RL Submitted (OCT-2007) to the EMBL/GenBank/DDBJ databases. RN [3] {ECO:0000313|Ensembl:ENSP00000410815} RP IDENTIFICATION. RG Ensembl; RL Submitted (DEC-2012) to UniProtKB. CC -!- SIMILARITY: Belongs to the peptidase S1 family. CC {ECO:0000256|SAAS:SAAS00559343}. CC -!- CAUTION: Lacks conserved residue(s) required for the propagation CC of feature annotation. {ECO:0000256|PROSITE-ProRule:PRU00302}. CC ----------------------------------------------------------------------- CC Copyrighted by the UniProt Consortium, see https://www.uniprot.org/terms CC Distributed under the Creative Commons Attribution (CC BY 4.0) License CC ----------------------------------------------------------------------- DR EMBL; AL645922; -; NOT_ANNOTATED_CDS; Genomic_DNA. DR EMBL; AK304045; BAG64956.1; -; mRNA. DR SMR; B4E1Z4; -. DR STRING; 9606.ENSP00000410815; -. DR BioMuta; ENSG00000244255; -. DR jPOST; B4E1Z4; -. DR MaxQB; B4E1Z4; -. DR PRIDE; B4E1Z4; -. DR Ensembl; ENST00000456570; ENSP00000410815; ENSG00000244255. DR UCSC; uc011dor.4; human. DR EuPathDB; HostDB:ENSG00000244255.5; -. DR GeneCards; ENSG00000244255; -. DR eggNOG; KOG3627; Eukaryota. DR eggNOG; COG5640; LUCA. DR GeneTree; ENSGT00940000158605; -. DR HOGENOM; HOG000038034; -. DR HOVERGEN; HBG106859; -. DR OMA; LSTTCQQ; -. DR TreeFam; TF330194; -. DR Proteomes; UP000005640; Chromosome 6. DR Bgee; ENSG00000244255; Expressed in 67 organ(s), highest expression level in liver. DR ExpressionAtlas; B4E1Z4; baseline and differential. DR GO; GO:0004252; F:serine-type endopeptidase activity; IEA:InterPro. DR CDD; cd00033; CCP; 4. DR CDD; cd00190; Tryp_SPc; 1. DR Gene3D; 3.40.50.410; -; 2. DR InterPro; IPR028341; Complement_B. DR InterPro; IPR009003; Peptidase_S1_PA. DR InterPro; IPR001314; Peptidase_S1A. DR InterPro; IPR035976; Sushi/SCR/CCP_sf. DR InterPro; IPR000436; Sushi_SCR_CCP_dom. DR InterPro; IPR001254; Trypsin_dom. DR InterPro; IPR018114; TRYPSIN_HIS. DR InterPro; IPR033116; TRYPSIN_SER. DR InterPro; IPR002035; VWF_A. DR InterPro; IPR036465; vWFA_dom_sf. DR PANTHER; PTHR19325:SF394; PTHR19325:SF394; 4. DR Pfam; PF00084; Sushi; 4. DR Pfam; PF00089; Trypsin; 2. DR Pfam; PF00092; VWA; 2. DR PRINTS; PR00722; CHYMOTRYPSIN. DR SMART; SM00032; CCP; 5. DR SMART; SM00020; Tryp_SPc; 2. DR SMART; SM00327; VWA; 2. DR SUPFAM; SSF50494; SSF50494; 2. DR SUPFAM; SSF53300; SSF53300; 2. DR SUPFAM; SSF57535; SSF57535; 5. DR PROSITE; PS50923; SUSHI; 5. DR PROSITE; PS50240; TRYPSIN_DOM; 2. DR PROSITE; PS00134; TRYPSIN_HIS; 2. DR PROSITE; PS00135; TRYPSIN_SER; 1. DR PROSITE; PS50234; VWFA; 2. PE 1: Evidence at protein level; KW Complete proteome {ECO:0000313|Proteomes:UP000005640}; KW Disulfide bond {ECO:0000256|PROSITE-ProRule:PRU00302, KW ECO:0000256|SAAS:SAAS00037407}; KW Hydrolase {ECO:0000256|RuleBase:RU363034}; KW Protease {ECO:0000256|RuleBase:RU363034}; KW Proteomics identification {ECO:0000213|PeptideAtlas:B4E1Z4}; KW Reference proteome {ECO:0000313|Proteomes:UP000005640}; KW Serine protease {ECO:0000256|RuleBase:RU363034}; KW Signal {ECO:0000256|SAM:SignalP}; KW Sushi {ECO:0000256|PROSITE-ProRule:PRU00302}. FT SIGNAL 1 20 {ECO:0000256|SAM:SignalP}. FT CHAIN 21 1266 {ECO:0000256|SAM:SignalP}. FT /FTId=PRO_5014567695. FT DOMAIN 22 86 Sushi. {ECO:0000259|PROSITE:PS50923}. FT DOMAIN 87 144 Sushi. {ECO:0000259|PROSITE:PS50923}. FT DOMAIN 173 299 VWFA. {ECO:0000259|PROSITE:PS50234}. FT DOMAIN 311 590 Peptidase S1. FT {ECO:0000259|PROSITE:PS50240}. FT DOMAIN 537 602 Sushi. {ECO:0000259|PROSITE:PS50923}. FT DOMAIN 603 662 Sushi. {ECO:0000259|PROSITE:PS50923}. FT DOMAIN 665 722 Sushi. {ECO:0000259|PROSITE:PS50923}. FT DOMAIN 772 971 VWFA. {ECO:0000259|PROSITE:PS50234}. FT DOMAIN 979 1259 Peptidase S1. FT {ECO:0000259|PROSITE:PS50240}. FT DISULFID 115 142 {ECO:0000256|PROSITE-ProRule:PRU00302}. FT DISULFID 633 660 {ECO:0000256|PROSITE-ProRule:PRU00302}. FT DISULFID 693 720 {ECO:0000256|PROSITE-ProRule:PRU00302}. SQ SEQUENCE 1266 AA; 140943 MW; 89105C1F976EB53D CRC64; MGPLMVLFCL LFLYPGLADS APSCPQNVNI SGGTFTLSHG WAPGSLLTYS CPQGLYPSPA SRLCKSSGQW QTPGATRSLS KAVCKPGHCP NPGISLGAVR TGFRFGHGDK VRYRCSSNLV LTGSSERECQ GNGVWSGTEP ICRQPYSYDF PEDVAPALGT SFSHMLGATN PTQKTKDHEN GTGTNTYAAL NSVYLMMNNQ MRLLGMETMA WQEIRHAIIL LTDGKSNMGG SPKTAVDHIR EILNINQKRN DYLDIYAIGV GKLDVDWREL NELGSKKDGE RHAFILQDTK ALHQVFEHML DVSKLTDTIC GVGNMSANAS DQERTPWHVT IKPKSQETCR GALISDQWVL TAAHCFRDGN DHSLWRVNVG DPKSQWGKEF LIEKAVISPG FDVFAKKNQG ILEFYGDDIA LLKLAQKVKM STHARPICLP CTMEANLALR RPQGSTCRDH ENELLNKQSV PAHFVALNGS KLNINLKMGV EWTSCAEVVS QEKTMFPNLT DVREVVTDQF LCSGTQEDES PCKGVTTTPW SLARPQGSCS LEGVEIKGGS FRLLQEGQAL EYVCPSGFYP YPVQTRTCRS TGSWSTLKTQ DQKTVRKAEC RAIHCPRPHD FENGEYWPRS PYYNVSDEIS FHCYDGYTLR GSANRTCQVN GRWSGQTAIC DNGAGYCSNP GIPIGTRKVG SQYRLEDSVT YHCSRGLTLR GSQRRTCQEG GSWSGTEPSC QDSFMYDTPQ EVAEAFLSSL TETIEGVDAE DGHGPGEQQK RKIVLDPSGS MNIYLVLDGS DSIGASNFTG AKKCLVNLIE KVASYGVKPR YGLVTYATYP KIWVKVSEAD SSNADWVTKQ LNEINYEDHK LKSGTNTKKA LQAVYSMMSW PDDVPPEGWN RTRHVIILMT DGLHNMGGDP ITVIDEIRDL LYIGKDRKNP REDYLDVYVF GVGPLVNQVN INALASKKDN EQHVFKVKDM ENLEDVFYQM IDESQSLSLC GMVWEHRKGT DYHKQPWQAK ISVIRPSKGH ESCMGAVVSE YFVLTAAHCF TVDDKEHSIK VSVGGEKRDL EIEVVLFHPN YNINGKKEAG IPEFYDYDVA LIKLKNKLKY GQTIRPICLP CTEGTTRALR LPPTTTCQQQ KEELLPAQDI KALFVSEEEK KLTRKEVYIK NGDKKGSCER DAQYAPGYDK VKDISEVVTP RFLCTGGVSP YADPNTCRGD SGGPLIVHKR SRFIQVGVIS WGVVDVCKNQ KRQKQVPAHA RDFHINLFQV LPWLKEKLQD EDLGFL //