lung cancer gene and literature database Home
Cancer metastasis database

Annotation category 5

Gene information

Gene ID 23213
Symbol

SULF1

Synonymous

HSULF-1|SULF-1

Full name

sulfatase 1

Gene description

extracellular sulfatase Sulf-1|sulfatase FP

Cytoband

8q13.2

Gene type

protein-coding

Synonymous

MIM:610012; HGNC:HGNC:20391; Ensembl:ENSG00000137573; HPRD:15450; Vega:OTTHUMG00000164466

Pathway and disease

Sequence Information

Nucleotide Sequence

>23213 : length: 5716
GTGATGATAATAATACGCGGGCTTATATAACCGTCTTCATCTTGCGAGCACTTCGCAGACCGTCGCTAATGAATCTTGGGGCCGGTGTCGGGCCGGGGCGGCTTGATCGGCAACTAGGAA
ACCCCAGGCGCAGAGGCCAGGAGCGAGGGCAGCGAGGATCAGAGGCCAGGCCTTCCCGGCTGCCGGCGCTCCTCGGAGGTCAGGGCAGATGAGGAACATGACTCTCCCCCTTCGGAGGAG
GAAGGAAGTCCCGCTGCCACCTTATCTCTGCTCCTCTGCCTCCTCCCTGTTCCCAGAGCTTTTTCTCTAGAGAAGATTTTGAAGGCGGCTTTTGGATTCTTCACTTCTCTTGAACAAGGA
ACTCACTCAGAGACTAACACAAAGGAAGTAATTTCTTACCTGGTCATTATTTAGTCTACAATAAGTTCATCCTTCTTCAGTGTGACCAGTAAATTCTTCCCATACTCTTGAAGAGAGCAT
AATTGGAATGGAGAGGTGCTGACGGCCACCCACCATCATCTAAAGAAGATAAACTTGGCAAATGACATGCAGGTTCTTCAAGGCAGAATAATTGCAGAAAATCTTCAAAGGACCCTATCT
GCAGATGTTCTGAATACCTCTGAGAATAGAGATTGATTATTCAACCAGGATACCTAATTCAAGAACTCCAGAAATCAGGAGACGGAGACATTTTGTCAGTTTTGCAACATTGGACCAAAT
ACAATGAAGTATTCTTGCTGTGCTCTGGTTTTGGCTGTCCTGGGCACAGAATTGCTGGGAAGCCTCTGTTCGACTGTCAGATCCCCGAGGTTCAGAGGACGGATACAGCAGGAACGAAAA
AACATCCGACCCAACATTATTCTTGTGCTTACCGATGATCAAGATGTGGAGCTGGGGTCCCTGCAAGTCATGAACAAAACGAGAAAGATTATGGAACATGGGGGGGCCACCTTCATCAAT
GCCTTTGTGACTACACCCATGTGCTGCCCGTCACGGTCCTCCATGCTCACCGGGAAGTATGTGCACAATCACAATGTCTACACCAACAACGAGAACTGCTCTTCCCCCTCGTGGCAGGCC
ATGCATGAGCCTCGGACTTTTGCTGTATATCTTAACAACACTGGCTACAGAACAGCCTTTTTTGGAAAATACCTCAATGAATATAATGGCAGCTACATCCCCCCTGGGTGGCGAGAATGG
CTTGGATTAATCAAGAATTCTCGCTTCTATAATTACACTGTTTGTCGCAATGGCATCAAAGAAAAGCATGGATTTGATTATGCAAAGGACTACTTCACAGACTTAATCACTAACGAGAGC
ATTAATTACTTCAAAATGTCTAAGAGAATGTATCCCCATAGGCCCGTTATGATGGTGATCAGCCACGCTGCGCCCCACGGCCCCGAGGACTCAGCCCCACAGTTTTCTAAACTGTACCCC
AATGCTTCCCAACACATAACTCCTAGTTATAACTATGCACCAAATATGGATAAACACTGGATTATGCAGTACACAGGACCAATGCTGCCCATCCACATGGAATTTACAAACATTCTACAG
CGCAAAAGGCTCCAGACTTTGATGTCAGTGGATGATTCTGTGGAGAGGCTGTATAACATGCTCGTGGAGACGGGGGAGCTGGAGAATACTTACATCATTTACACCGCCGACCATGGTTAC
CATATTGGGCAGTTTGGACTGGTCAAGGGGAAATCCATGCCATATGACTTTGATATTCGTGTGCCTTTTTTTATTCGTGGTCCAAGTGTAGAACCAGGATCAATAGTCCCACAGATCGTT
CTCAACATTGACTTGGCCCCCACGATCCTGGATATTGCTGGGCTCGACACACCTCCTGATGTGGACGGCAAGTCTGTCCTCAAACTTCTGGACCCAGAAAAGCCAGGTAACAGGTTTCGA
ACAAACAAGAAGGCCAAAATTTGGCGTGATACATTCCTAGTGGAAAGAGGCAAATTTCTACGTAAGAAGGAAGAATCCAGCAAGAATATCCAACAGTCAAATCACTTGCCCAAATATGAA
CGGGTCAAAGAACTATGCCAGCAGGCCAGGTACCAGACAGCCTGTGAACAACCGGGGCAGAAGTGGCAATGCATTGAGGATACATCTGGCAAGCTTCGAATTCACAAGTGTAAAGGACCC
AGTGACCTGCTCACAGTCCGGCAGAGCACGCGGAACCTCTACGCTCGCGGCTTCCATGACAAAGACAAAGAGTGCAGTTGTAGGGAGTCTGGTTACCGTGCCAGCAGAAGCCAAAGAAAG
AGTCAACGGCAATTCTTGAGAAACCAGGGGACTCCAAAGTACAAGCCCAGATTTGTCCATACTCGGCAGACACGTTCCTTGTCCGTCGAATTTGAAGGTGAAATATATGACATAAATCTG
GAAGAAGAAGAAGAATTGCAAGTGTTGCAACCAAGAAACATTGCTAAGCGTCATGATGAAGGCCACAAGGGGCCAAGAGATCTCCAGGCTTCCAGTGGTGGCAACAGGGGCAGGATGCTG
GCAGATAGCAGCAACGCCGTGGGCCCACCTACCACTGTCCGAGTGACACACAAGTGTTTTATTCTTCCCAATGACTCTATCCATTGTGAGAGAGAACTGTACCAATCGGCCAGAGCGTGG
AAGGACCATAAGGCATACATTGACAAAGAGATTGAAGCTCTGCAAGATAAAATTAAGAATTTAAGAGAAGTGAGAGGACATCTGAAGAGAAGGAAGCCTGAGGAATGTAGCTGCAGTAAA
CAAAGCTATTACAATAAAGAGAAAGGTGTAAAAAAGCAAGAGAAATTAAAGAGCCATCTTCACCCATTCAAGGAGGCTGCTCAGGAAGTAGATAGCAAACTGCAACTTTTCAAGGAGAAC
AACCGTAGGAGGAAGAAGGAGAGGAAGGAGAAGAGACGGCAGAGGAAGGGGGAAGAGTGCAGCCTGCCTGGCCTCACTTGCTTCACGCATGACAACAACCACTGGCAGACAGCCCCGTTC
TGGAACCTGGGATCTTTCTGTGCTTGCACGAGTTCTAACAATAACACCTACTGGTGTTTGCGTACAGTTAATGAGACGCATAATTTTCTTTTCTGTGAGTTTGCTACTGGCTTTTTGGAG
TATTTTGATATGAATACAGATCCTTATCAGCTCACAAATACAGTGCACACGGTAGAACGAGGCATTTTGAATCAGCTACACGTACAACTAATGGAGCTCAGAAGCTGTCAAGGATATAAG
CAGTGCAACCCAAGACCTAAGAATCTTGATGTTGGAAATAAAGATGGAGGAAGCTATGACCTACACAGAGGACAGTTATGGGATGGATGGGAAGGTTAATCAGCCCCGTCTCACTGCAGA
CATCAACTGGCAAGGCCTAGAGGAGCTACACAGTGTGAATGAAAACATCTATGAGTACAGACAAAACTACAGACTTAGTCTGGTGGACTGGACTAATTACTTGAAGGATTTAGATAGAGT
ATTTGCACTGCTGAAGAGTCACTATGAGCAAAATAAAACAAATAAGACTCAAACTGCTCAAAGTGACGGGTTCTTGGTTGTCTCTGCTGAGCACGCTGTGTCAATGGAGATGGCCTCTGC
TGACTCAGATGAAGACCCAAGGCATAAGGTTGGGAAAACACCTCATTTGACCTTGCCAGCTGACCTTCAAACCCTGCATTTGAACCGACCAACATTAAGTCCAGAGAGTAAACTTGAATG
GAATAACGACATTCCAGAAGTTAATCATTTGAATTCTGAACACTGGAGAAAAACCGAAAAATGGACGGGGCATGAAGAGACTAATCATCTGGAAACCGATTTCAGTGGCGATGGCATGAC
AGAGCTAGAGCTCGGGCCCAGCCCCAGGCTGCAGCCCATTCGCAGGCACCCGAAAGAACTTCCCCAGTATGGTGGTCCTGGAAAGGACATTTTTGAAGATCAACTATATCTTCCTGTGCA
TTCCGATGGAATTTCAGTTCATCAGATGTTCACCATGGCCACCGCAGAACACCGAAGTAATTCCAGCATAGCGGGGAAGATGTTGACCAAGGTGGAGAAGAATCACGAAAAGGAGAAGTC
ACAGCACCTAGAAGGCAGCGCCTCCTCTTCACTCTCCTCTGATTAGATGAAACTGTTACCTTACCCTAAACACAGTATTTCTTTTTAACTTTTTTATTTGTAAACTAATAAAGGTAATCA
CAGCCACCAACATTCCAAGCTACCCTGGGTACCTTTGTGCAGTAGAAGCTAGTGAGCATGTGAGCAAGCGGTGTGCACACGGAGACTCATCGTTATAATTTACTATCTGCCAAGAGTAGA
AAGAAAGGCTGGGGATATTTGGGTTGGCTTGGTTTTGATTTTTTGCTTGTTTGTTTGTTTTGTACTAAAACAGTATTATCTTTTGAATATCGTAGGGACATAAGTATATACATGTTATCC
AATCAAGATGGCTAGAATGGTGCCTTTCTGAGTGTCTAAAACTTGACACCCCTGGTAAATCTTTCAACACACTTCCACTGCCTGCGTAATGAAGTTTTGATTCATTTTTAACCACTGGAA
TTTTTCAATGCCGTCATTTTCAGTTAGATGATTTTGCACTTTGAGATTAAAATGCCATGTCTATTTGATTAGTCTTATTTTTTTATTTTTACAGGCTTATCAGTCTCACTGTTGGCTGTC
ATTGTGACAAAGTCAAATAAACCCCCAAGGACGACACACAGTATGGATCACATATTGTTTGACATTAAGCTTTTGCCAGAAAATGTTGCATGTGTTTTACCTCGACTTGCTAAAATCGAT
TAGCAGAAAGGCATGGCTAATAATGTTGGTGGTGAAAATAAATAAATAAGTAAACAAAATGAAGATTGCCTGCTCTCTCTGTGCCTAGCCTCAAAGCGTTCATCATACATCATACCTTTA
AGATTGCTATATTTTGGGTTATTTTCTTGACAGGAGAAAAAGATCTAAAGATCTTTTATTTTCATCTTTTTTGGTTTTCTTGGCATGACTAAGAAGCTTAAATGTTGATAAAATATGACT
AGTTTTGAATTTACACCAAGAACTTCTCAATAAAAGAAAATCATGAATGCTCCACAATTTCAACATACCACAAGAGAAGTTAATTTCTTAACATTGTGTTCTATGATTATTTGTAAGACC
TTCACCAAGTTCTGATATCTTTTAAAGACATAGTTCAAAATTGCTTTTGAAAATCTGTATTCTTGAAAATATCCTTGTTGTGTATTAGGTTTTTAAATACCAGCTAAAGGATTACCTCAC
TGAGTCATCAGTACCCTCCTATTCAGCTCCCCAAGATGATGTGTTTTTGCTTACCCTAAGAGAGGTTTTCTTCTTATTTTTAGATAATTCAAGTGCTTAGATAAATTATGTTTTCTTTAA
GTGTTTATGGTAAACTCTTTTAAAGAAAATTTAATATGTTATAGCTGAATCTTTTTGGTAACTTTAAATCTTTATCATAGACTCTGTACATATGTTCAAATTAGCTGCTTGCCTGATGTG
TGTATCATCGGTGGGATGACAGAACAAACATATTTATGATCATGAATAATGTGCTTTGTAAAAAGATTTCAAGTTATTAGGAAGCATACTCTGTTTTTTAATCATGTATAATATTCCATG
ATACTTTTATAGAACAATTCTGGCTTCAGGAAAGTCTAGAAGCAATATTTCTTCAAATAAAAGGTGTTTAAACTTT

Protein Sequence

>23213 : length: 1122
MKYSCCALVLAVLGTELLGSLCSTVRSPRFRGRIQQERKNIRPNIILVLTDDQDVELGSLQVMNKTRKIMEHGGATFINAFVTTPMCCPSRSSMLTGKYVHNHNVYTNNENCSSPSWQAM
HEPRTFAVYLNNTGYRTAFFGKYLNEYNGSYIPPGWREWLGLIKNSRFYNYTVCRNGIKEKHGFDYAKDYFTDLITNESINYFKMSKRMYPHRPVMMVISHAAPHGPEDSAPQFSKLYPN
ASQHITPSYNYAPNMDKHWIMQYTGPMLPIHMEFTNILQRKRLQTLMSVDDSVERLYNMLVETGELENTYIIYTADHGYHIGQFGLVKGKSMPYDFDIRVPFFIRGPSVEPGSIVPQIVL
NIDLAPTILDIAGLDTPPDVDGKSVLKLLDPEKPGNRFRTNKKAKIWRDTFLVERGKFLRKKEESSKNIQQSNHLPKYERVKELCQQARYQTACEQPGQKWQCIEDTSGKLRIHKCKGPS
DLLTVRQSTRNLYARGFHDKDKECSCRESGYRASRSQRKSQRQFLRNQGTPKYKPRFVHTRQTRSLSVEFEGEIYDINLEEEEELQVLQPRNIAKRHDEGHKGPRDLQASSGGNRGRMLA
DSSNAVGPPTTVRVTHKCFILPNDSIHCERELYQSARAWKDHKAYIDKEIEALQDKIKNLREVRGHLKRRKPEECSCSKQSYYNKEKGVKKQEKLKSHLHPFKEAAQEVDSKLQLFKENN
RRRKKERKEKRRQRKGEECSLPGLTCFTHDNNHWQTAPFWNLGSFCACTSSNNNTYWCLRTVNETHNFLFCEFATGFLEYFDMNTDPYQLTNTVHTVERGILNQLHVQLMELRSCQGYKQ
CNPRPKNLDVEDSYGMDGKVNQPRLTADINWQGLEELHSVNENIYEYRQNYRLSLVDWTNYLKDLDRVFALLKSHYEQNKTNKTQTAQSDGFLVVSAEHAVSMEMASADSDEDPRHKVGK
TPHLTLPADLQTLHLNRPTLSPESKLEWNNDIPEVNHLNSEHWRKTEKWTGHEETNHLETDFSGDGMTELELGPSPRLQPIRRHPKELPQYGGPGKDIFEDQLYLPVHSDGISVHQMFTM
ATAEHRSNSSIAGKMLTKVEKNHEKEKSQHLEGSASSSLSSD