lung cancer gene and literature database Home
Cancer metastasis database

Annotation category 5

Gene information

Gene ID 11063
Symbol

SOX30

Synonymous

-

Full name

SRY (sex determining region Y)-box 30

Gene description

Sox30 protein type II|transcription factor SOX-30

Cytoband

5q33

Gene type

protein-coding

Synonymous

MIM:606698; HGNC:HGNC:30635; Ensembl:ENSG00000039600; HPRD:09461; Vega:OTTHUMG00000130247

Pathway and disease

Sequence Information

Nucleotide Sequence

>11063 : length: 3938
GTGCAGAGTCCGGCGGCCACGGACGCGGTAATATTGTCCCTCGGCATCCGCCGTGGTGAGACCCGGCGCGTTGCTGTGAAGACGGACGGGTCTGGAAGAAGTGGGGTGCGGTGAGCTGAG
CAGACCTTTTCCGCTTCGACGTGGGGACTGCAGTGACCCCGGCCTGCTGGCGGGGCGGGTAACGGGTTGAGCCAGGGTGGGGCTGCTCAGCGGCATGGAGCTGAGGTCTGAAGACCCAGC
ACAGGCGATTCCTTTCTGCGACGAGACAATTGCTATGGAAACCAAAGTGCTGGGTCAGCGGGGATTGAGGCTCCAGGATCAAGACTGGTGTCTTTCCGGAAGACCCTTGGCTAAGGCTTC
CCGGAGCGGCTGCTTCCTGAATGAATCCGCCATCTCCTGCGGGGTCTTGACACCGAGCAGGCGAAGAAGCCTATTCCAATGCCAGCTCCCCCGGGAAACCTACCTGGCCCACCCCTATAA
GTGGTGCCTCGCTCTCGTTAACTCTTAGACTTTGTTCCACGTTTATAACCTAATATTTCGGTAACGCCCCGCGGTTTTTGTTTACTTTTCCCACACATAATGGACCAGAAAGACTTGCTT
CCGGACTTTGCTTTATGACTCTGAACAAGTCATTTTTCCCACTGGGTCTCACTTCCCTCTTGTGTAAAATGGAAATATTAACTCTAGATGCCGGTCTGGTTAGGTTTGAAGATCGAACCA
GATGAGGGAAGCCAAAGACTTCATAGGCTGTAAAGTGGTGAAACTGAACTGCTAACGAGTTGCTATTTTTTTCTCCCCTCCCTCTCCCTCAAGCTAAAAGTTCTTCAGATTTCTTGTGAT
TTCTTCAGGCGGTCTTGGGACTCCCTAGCCTCCGACCTGGAATAGATCTCTCTTCACACTTCACTTCCACAGAGCCCTTCATTTTAACTTCCCTATCCAAAGCAAGAAAAATAGTTATCA
TTTTTAGAGGGCTTACTCTGTGCCAAGCCCTGATAAAACTCTTTACCTGGATTATCTCATTAAATTTCACAACATCCTTTTAAGGTCATGGAGAAATGTTGTAGAGGGAAGGAACAAAGT
CTACTGTGCATCCAGCAAGGCATACCAGATACTCCCTTCAGTAAGGACAGAAATGGTCATGTGAAGCGACCCATGAACGCATTTATGGTTTGGGCAAGGATCCACCGACCAGCACTAGCC
AAAGCTAACCCAGCAGCCAACAATGCAGAAATCAGTGTCCAGCTTGGGTTAGAGTGGAACAAACTTAGTGAAGAACAAAAGAAACCCTATTACGATGAAGCACAAAAGATTAAGGAAAAG
CACAGAGAGGAATTTCCTGGTTGGGTTTATCAGCCTCGTCCAGGGAAGCGAAAACGATTCCCTCTAAGTGTTTCCAATGTATTTTCTGGTACCACACAGAATATCATCTCTACAAATCCT
ACAACAGTTTATCCTTACCGCTCACCTACGTACTCTGTGGTAATTCCCAGCCTACAGAATCCCATCACTCATCCAGTTGGTGAAACCTCACCTGCTATCCAGCTGCCCACACCTGCAGTC
CAGAGCCCAAGCCCTGTCACACTTTTCCAGCCCAGCGTCTCCAGTGCTGCTCAGGTGGCTGTCCAGGATCCAAGTCTACCTGTCTATCCAGCACTCCCACCCCAACGCTTTACTGGGCCT
TCCCAAACAGACACTCATCAGCTGCATTCTGAAGCCACTCACACTGTGAAGCAACCCACTCCTGTCTCTCTAGAGAGCGCCAACAGGATTTCAAGTAGTGCAAGTACTGCCCATGCCAGA
TTTGCAACTTCGACCATCCAACCTCCTAGGGAGTATTCCAGCGTTTCCCCTTGTCCCAGAAGTGCTCCAATCCCCCAGGCTTCTCCCATTCCACACCCACATGTCTACCAGCCCCCTCCC
CTTGGCCATCCAGCCACACTGTTCGGGACACCACCAAGATTCTCTTTTCATCACCCTTACTTCCTACCCGGACCTCACTACTTCCCATCAAGTACATGCCCTTACAGTCGGCCTCCCTTT
GGCTATGGAAATTTTCCGAGTTCAATGCCAGAATGCCTTAGTTATTATGAAGACAGGTACCCAAAACATGAGGGTATCTTTTCAACTTTAAATAGAGACTATTCTTTTAGAGACTACTCA
AGTGAATGCACACACAGTGAAAATTCTCGGAGTTGTGAGAACATGAATGGAACTTCTTACTATAACAGTCATAGCCACAGTGGGGAAGAAAACTTAAACCCTGTGCCTCAGCTGGACATT
GGAACCTTGGAGAATGTCTTCACAGCCCCGACATCAACTCCTTCTAGCATCCAGCAAGTCAATGTCACCGACAGTGATGAGGAGGAAGAAGAAAAAGTGCTCAGGGATTTATAATTTTAA
AACAAATATGCACAGAAAATAAACATTTCTTAAAATATATTCTGGGTCAGTTGGTATGAGAAAAAAAAAAGCCTAGAATTCTTTGTTGAAAGTTTTCAGTCGTGATTTGAGGAGTTAAAA
CCAAATGCAATTTATGTCTTCATAAAATTTTGATTAGTGAAACTAGAGTCTGGATGTTTCATTGTAGGAATATTTAAGTTATTAAGTAGTTTAATTTTAATGGCTGAAATTTGCATCAAC
ATGTATTATTATTACTTTATCCTGGAACATGCAAAATACTGAAGCCTCACAGTTGTATGTGAGGGGAAAGGGGAAATAAATCTAGCATAGTGTGATTTTTATTTTATCTCAGGATACATT
TTTTAAATGATTTTTTGTTTGCTTTTTATGTAATACTTATGGATGTTGTCAATTTTTGATGTAACATTTTGAAAGTATTTTGACAACTCCTAGTGAACTTGGACTTGGTTGCTAAATTTA
ACTTACACTAATAACCAATTATAAGTTCCAAATGTGTTTTAATGGCACCTGGGTGATTCTTCAGCTAAATTTAGTCATTTCTGTTTCTAAATATTTTTATCATTTTAAAATATTTTTTTT
CCATTTGGCATACATCGTTCTTTGTTGTAATTAAATAAACATAGATAAAATTGTTCTTGTTGGATGTTTTCTGTTTGCGGGATAGAAGTAAGCAAACAGAGTATTTTTCATAGAAGATTG
TTTTCTATACCATATACAGATAATTCATTTTTACCTATAGTCTCCAGAATTGCATAGATTCTATTAGCTCACACGAGACTTAAACATGTATCAACAAAGTTGCCCACACATTCTGATGCC
ATTTCCAAACTCTTTACACATACGTACACATGACTTAAGCACATCCCAGAATGGAAGAGCTCTTCCAGATTTGGCTCAAGCAGCTGTCTTGAAAACCATGAAGTTTATTTAAGAGCATAA
GGAATTTATTTAATTCACGATGAACAAAAAAACCCTACCTGTGACATAACCTCCTGGTAAGTACCCAGTTAGGGATTGAGAAGGCCTTTTTAGAACAGTATCAGGACTATGAAAGTTGAG
ATCATGGTAAAAGATCTCTAAGGTACAAAGTGAATTGATGATGGGAAATAGTCACCAACCAATACGCTTTTCCCTCAGTGATCTATATAATTTATGCAAATTGAGATCTTGTTACTTAAA
ACTGTGTGGAAATTGTGTATGGAAATCTCTTCTAAGCTTCCACATTCTTCCTTTACTAAACCTGTATTTGTTTCTTAAACAAAATTTGTTAATGTAATACATTTCATCAGACTTACATTT
ATTGTACATGACACTTTCTTTCCCAATACAAATTTTGTTTTCATGGTTTTATATTCTTTATTACTATGCCCAGTGCCATTTTGATGTGTTTAAAGAGTAAAACTTTAATTTCTTCGTGAT
AGAAAGCAAACATATGTCACCTCACATCTGAACTAAAGTAACATTTGATTGTCTACACATTTGATATCTATACCATTAAAGAGAAATGTATGCAACAA

Protein Sequence

>11063 : length: 753
MERARPEPPPQPRPLRPAPPPLPVEGTSFWAAAMEPPPSSPTLSAAASATLASSCGEAVASGLQPAVRRLLQVKPEQVLLLPQPQAQNEEAAASSAQARLLQFRPDLRLLQPPTASDGAT
SRPELHPVQPLALHVKAKKQKLGPSLDQSVGPRGAVETGPRASRVVKLEGPGPALGYFRGDEKGKLEAEEVMRDSMQGGAGKSPAAIREGVIKTEEPERLLEDCRLGAEPASNGLVHGSA
EVILAPTSGAFGPHQQDLRIPLTLHTVPPGARIQFQGAPPSELIRLTKVPLTPVPTKMQSLLEPSVKIETKDVPLTVLPSDAGIPDTPFSKDRNGHVKRPMNAFMVWARIHRPALAKANP
AANNAEISVQLGLEWNKLSEEQKKPYYDEAQKIKEKHREEFPGWVYQPRPGKRKRFPLSVSNVFSGTTQNIISTNPTTVYPYRSPTYSVVIPSLQNPITHPVGETSPAIQLPTPAVQSPS
PVTLFQPSVSSAAQVAVQDPSLPVYPALPPQRFTGPSQTDTHQLHSEATHTVKQPTPVSLESANRISSSASTAHARFATSTIQPPREYSSVSPCPRSAPIPQASPIPHPHVYQPPPLGHP
ATLFGTPPRFSFHHPYFLPGPHYFPSSTCPYSRPPFGYGNFPSSMPECLSYYEDRYPKHEGIFSTLNRDYSFRDYSSECTHSENSRSCENMNGTSYYNSHSHSGEENLNPVPQLDIGTLE
NVFTAPTSTPSSIQQVNVTDSDEEEEEKVLRDL