lung cancer gene and literature database Home
Cancer metastasis database

Annotation category 5

Gene information

Gene ID 4436
Symbol

MSH2

Synonymous

COCA1|FCC1|HNPCC|HNPCC1|LCFS2

Full name

mutS homolog 2

Gene description

DNA mismatch repair protein Msh2|hMSH2|mutS homolog 2, colon cancer, nonpolyposis type 1

Cytoband

2p21

Gene type

protein-coding

Synonymous

MIM:609309; HGNC:HGNC:7325; Ensembl:ENSG00000095002; HPRD:00389; Vega:OTTHUMG00000128861

Pathway and disease

Pathways and Diseases

Detail

Pathway

Mismatch repair;KEGG PATHWAY;hsa03430

Pathway

Pathways in cancer;KEGG PATHWAY;hsa05200

Pathway

Direct p53 effectors;PID Curated;200101

Pathway

Colorectal cancer;KEGG PATHWAY;hsa05210

Disease

Colorectal cancer;KEGG DISEASE;H00020

Disease

Cancers;KEGG DISEASE

Disease

endometrial cancer;GAD

Disease

Mismatch repair cancer syndrome;OMIM

Disease

leukemia;GAD

Disease

Female reproductive cancer;FunDO

Disease

Muir-Torre syndrome;OMIM

Disease

Colorectal cancer, hereditary nonpolyposis, type 1;OMIM

Disease

CANCER;GAD

Disease

Ovarian cancer;KEGG DISEASE;H00027

Disease

Testicular dysfunction;FunDO

Disease

Gastritis;FunDO

Disease

Cancer;FunDO

Disease

Cancers of the digestive system;KEGG DISEASE

Disease

Yersinia infection;FunDO

Disease

Cancers of the breast and female genital organs;KEGG DISEASE

Disease

Lymphoma, Non-Hodgkin;GAD

Disease

colorectal cancer;GAD

Sequence Information

Nucleotide Sequence

>4436 : length: 5315
GGGAGGCGGGAAACAGCTTAGTGGGTGTGGGGTCGCGCATTTTCTTCAACCAGGAGGTGAGGAGGTTTCGACATGGCGGTGCAGCCGAAGGAGACGCTGCAGTTGGAGAGCGCGGCCGAG
GTCGGCTTCGTGCGCTTCTTTCAGGGCATGCCGGAGAAGCCGACCACCACAGTGCGCCTTTTCGACCGGGGCGACTTCTATACGGCGCACGGCGAGGACGCGCTGCTGGCCGCCCGGGAG
GTGTTCAAGACCCAGGGGGTGATCAAGTACATGGGGCCGGCAGGAGCAAAGAATCTGCAGAGTGTTGTGCTTAGTAAAATGAATTTTGAATCTTTTGTAAAAGATCTTCTTCTGGTTCGT
CAGTATAGAGTTGAAGTTTATAAGAATAGAGCTGGAAATAAGGCATCCAAGGAGAATGATTGGTATTTGGCATATAAGGCTTCTCCTGGCAATCTCTCTCAGTTTGAAGACATTCTCTTT
GGTAACAATGATATGTCAGCTTCCATTGGTGTTGTGGGTGTTAAAATGTCCGCAGTTGATGGCCAGAGACAGGTTGGAGTTGGGTATGTGGATTCCATACAGAGGAAACTAGGACTGTGT
GAATTCCCTGATAATGATCAGTTCTCCAATCTTGAGGCTCTCCTCATCCAGATTGGACCAAAGGAATGTGTTTTACCCGGAGGAGAGACTGCTGGAGACATGGGGAAACTGAGACAGATA
ATTCAAAGAGGAGGAATTCTGATCACAGAAAGAAAAAAAGCTGACTTTTCCACAAAAGACATTTATCAGGACCTCAACCGGTTGTTGAAAGGCAAAAAGGGAGAGCAGATGAATAGTGCT
GTATTGCCAGAAATGGAGAATCAGGTTGCAGTTTCATCACTGTCTGCGGTAATCAAGTTTTTAGAACTCTTATCAGATGATTCCAACTTTGGACAGTTTGAACTGACTACTTTTGACTTC
AGCCAGTATATGAAATTGGATATTGCAGCAGTCAGAGCCCTTAACCTTTTTCAGGGTTCTGTTGAAGATACCACTGGCTCTCAGTCTCTGGCTGCCTTGCTGAATAAGTGTAAAACCCCT
CAAGGACAAAGACTTGTTAACCAGTGGATTAAGCAGCCTCTCATGGATAAGAACAGAATAGAGGAGAGATTGAATTTAGTGGAAGCTTTTGTAGAAGATGCAGAATTGAGGCAGACTTTA
CAAGAAGATTTACTTCGTCGATTCCCAGATCTTAACCGACTTGCCAAGAAGTTTCAAAGACAAGCAGCAAACTTACAAGATTGTTACCGACTCTATCAGGGTATAAATCAACTACCTAAT
GTTATACAGGCTCTGGAAAAACATGAAGGAAAACACCAGAAATTATTGTTGGCAGTTTTTGTGACTCCTCTTACTGATCTTCGTTCTGACTTCTCCAAGTTTCAGGAAATGATAGAAACA
ACTTTAGATATGGATCAGGTGGAAAACCATGAATTCCTTGTAAAACCTTCATTTGATCCTAATCTCAGTGAATTAAGAGAAATAATGAATGACTTGGAAAAGAAGATGCAGTCAACATTA
ATAAGTGCAGCCAGAGATCTTGGCTTGGACCCTGGCAAACAGATTAAACTGGATTCCAGTGCACAGTTTGGATATTACTTTCGTGTAACCTGTAAGGAAGAAAAAGTCCTTCGTAACAAT
AAAAACTTTAGTACTGTAGATATCCAGAAGAATGGTGTTAAATTTACCAACAGCAAATTGACTTCTTTAAATGAAGAGTATACCAAAAATAAAACAGAATATGAAGAAGCCCAGGATGCC
ATTGTTAAAGAAATTGTCAATATTTCTTCAGGCTATGTAGAACCAATGCAGACACTCAATGATGTGTTAGCTCAGCTAGATGCTGTTGTCAGCTTTGCTCACGTGTCAAATGGAGCACCT
GTTCCATATGTACGACCAGCCATTTTGGAGAAAGGACAAGGAAGAATTATATTAAAAGCATCCAGGCATGCTTGTGTTGAAGTTCAAGATGAAATTGCATTTATTCCTAATGACGTATAC
TTTGAAAAAGATAAACAGATGTTCCACATCATTACTGGCCCCAATATGGGAGGTAAATCAACATATATTCGACAAACTGGGGTGATAGTACTCATGGCCCAAATTGGGTGTTTTGTGCCA
TGTGAGTCAGCAGAAGTGTCCATTGTGGACTGCATCTTAGCCCGAGTAGGGGCTGGTGACAGTCAATTGAAAGGAGTCTCCACGTTCATGGCTGAAATGTTGGAAACTGCTTCTATCCTC
AGGTCTGCAACCAAAGATTCATTAATAATCATAGATGAATTGGGAAGAGGAACTTCTACCTACGATGGATTTGGGTTAGCATGGGCTATATCAGAATACATTGCAACAAAGATTGGTGCT
TTTTGCATGTTTGCAACCCATTTTCATGAACTTACTGCCTTGGCCAATCAGATACCAACTGTTAATAATCTACATGTCACAGCACTCACCACTGAAGAGACCTTAACTATGCTTTATCAG
GTGAAGAAAGGTGTCTGTGATCAAAGTTTTGGGATTCATGTTGCAGAGCTTGCTAATTTCCCTAAGCATGTAATAGAGTGTGCTAAACAGAAAGCCCTGGAACTTGAGGAGTTTCAGTAT
ATTGGAGAATCGCAAGGATATGATATCATGGAACCAGCAGCAAAGAAGTGCTATCTGGAAAGAGAGAACCTCAGAGTGACAGAGCCAAAAGACCAGTGCCTCATTTTGCTGACATGGAAA
AGGAAACTTCGTGGGGGAAAGAGATCTGCTTGCAGTCGGCCAGAGAGACAGAACCAGGGCAGTGCGACTCCAAGTGCATCAGCATAGGCATTGCCAGGAGCTCATGAGGAATGCAGACTG
TCAGGTCCCACCCCAGACCTACTCAACAGAAACTACTTGGTAAGCAGATTCCCAGGTGGTTCCAGGCACCTTACAGTTTGAAAAGCACTGCTGCATGCTATCCTACCTTCCTGGTCTGTA
ACATCTGTTGCTGTTGAGTATAAAGACACTGTGAACATTGTAAAATCTGCAATTACAAGATTCTGGATGCTTCATCCTGAGGTCACCTTGGAATGAGATCCTCTGGGATCTGGAGGAAGC
AGATGGAGGAGAAACCCCAGGGCTCAATTTTTCTAAGGGCCCAGGCACACCAGTTACCACTGACCTGCTAGTAAGCCAGGAACTTAGCCCCATGTTGGGGGTTGGCCAAGCGCAGGGAGG
AGGCAGCACTCACAAGACAGAGTCCGGAGCATTCTCCACCACAGCCAGTGGCCACTTGGAGAGGGGACCTAGAGTCCCCTGGTAGGTGGCTAGGGAATGGCAGGGTTTGGGGTAGAACTT
CCTGGGGCCAGAGTCTCATAGCAGTGGTAGCCAAGAGTTGGCTTAGGGTGAGAGCCAAGGGGCTTCAGTACCCTTCTTCATTCTCTACCAGCACCTCCCCAACCTCCTGGAAACTGCTGT
GCTTCCTGCAGTTTCAAGCCCCTCCACCCCCTGTTCCTCACCAACTCTCCCCGTGTAGAAACTCTGCAGAGAGTATGACCGTGTCTCTTAAAAAAACTTTGGTGAGGATCAGAGGCTGGA
CTCTGCCCAAAGCACCCACCTTGGGCTCCACACACTTTCCGGATTGCTGGCTGGTGGCCCCATGCAGAGCCCCCGACCCCGGAAAGTCAGTGGAACTGGACGGAAAAAATGGAAGGGCCA
GAAAACTTGGGGAGGACTCCAGAGCTGGGGGTGACACAGGAATAGACCAACGGCCTTTTGTTGTTTCCAAGATCCTCTGAATCTGAGGCAGCCAAACAAGGCATGGGAGTGCTGCTCCAG
GTGTCAGGGATGGGTACACTTACTGAACACTTACCCAAGGCTACCACCACCATCTCCAGATCAAGCAGGAGTTTTTACCCAAAGCCCCCTCACAAGTCACTCAGCCTGCCTTCTGCTCCT
CAGATACCCACCCTTCTCTCCAGCTCCTCCCCTCTGTGCGTAGCGCAACACTCACCCCTTCTGGGAAGCCTTGGTGCCCTCTCAGAACTGTACTGGATTCTCTACTTGTCTATGTGAGCA
GTGTGTGTGTGTGTCTGTGTGTGCTGTTTGTGTGAGAATTATGTGTGTAAGAAAGGGTGTGGGAGAGTGAGAGAGATACACCTACCTTTGGCAATATTGATGTAACTCTTCTAGGGAGGA
TGAGAGCGCAAGCTCTCAGGGAATCCCCCTTTGACTTGCTGGGTAACTTGGGCAACCTCTCCTCCTCTCTGAGCCTTGTGTAAAATGAGGAACAAGGGTAAATTCACCCGCTTTGGGCTG
GTCTTGGAGATGCTCTAGGGCTCTTCAGAGAAGACTTCAGGGAGCGGGCGGCAACTGAGGAAAGGCCCACTGGTCCGGACTCCAGCCCCCACCCCTAATTACAGCAGCTCTGCTCCTATT
TGCTATAATGGGCTGATTGTTGGCTTTTGTTGACAAAATGGTCTACATGCCTGGGGAAAGTTATGAAGGATCTTTGTGGTGCTTCCAGCTAGAATACTCTAGGAGTGTACCTTTGCTCCA
TTCGGCACAATTCTGAGCTGTTCGACGCGGAGGCCCTTGGGCATAGTCAAGACTGAGTGGAAATATGTTCTCTCTCAGCTGGCTTGGCCCAGGAATAGCGGCAGACCATTCCTGGGAGTC
CAGGGGAGAGCAGGGGGATCCAGGTACCTTTCTTGTCTCAGTTTTTGATGGCCTGGCAGTGCCCCCACCTGTTTTTTCTTCTTACCTTTCTCCACTCTCCCAGAACTTCCCAAAGGAAGC
TGCTCTCATTAAAACAAGGGAGGTTGAAGATCCTAACGCCACAGGCTTGTTCGGGAGGCAGCTCACCTCCTGGAACTGAGTGCAGTCCTGGAGAAAACCAAGTGGATGTGCGGCCCCTTT
CCATGGAGCAATTAGGTGGATAACTGTCCAGTCGCTCCTAGGCTTTGTAGAGGCATAGGCTCAGATACAAAGAGACCAGACAGTCTCTCGCTCCAAAGGGGCTGGCCACAAGCACCATGA
AGACAGCAGTACCCACTGACTCAGCAATTTCACCAGCTGGAAGTCATCCCAAGGAGATATCACAGAAAGAAAAGGCCATCTTGCGTAAAGATGATCACTGTGTCATTACTCAAAATAGCC
CCAAACTGGGAAACACCCAGCTATCCAGCAATAGGGGTAGTGAATTACAGAACATCAACTAGATGGAATATTATGCACCCACTAAAATTAGACTACGTGAAAACACAGAAACAACATCAG
TAATAAAATGTTAATAAAACAGAAGCAGCTCAGTA

Protein Sequence

>4436 : length: 974
MAVQPKETLQLESAAEVGFVRFFQGMPEKPTTTVRLFDRGDFYTAHGEDALLAAREVFKTQGVIKYMGPAGAKNLQSVVLSKMNFESFVKDLLLVRQYRVEVYKNRAGNKASKENDWYLA
YKASPGNLSQFEDILFGNNDMSASIGVVGVKMSAVDGQRQVGVGYVDSIQRKLGLCEFPDNDQFSNLEALLIQIGPKECVLPGGETAGDMGKLRQIIQRGGILITERKKADFSTKDIYQD
LNRLLKGKKGEQMNSAVLPEMENQVAVSSLSAVIKFLELLSDDSNFGQFELTTFDFSQYMKLDIAAVRALNLFQGSVEDTTGSQSLAALLNKCKTPQGQRLVNQWIKQPLMDKNRIEERL
NLVEAFVEDAELRQTLQEDLLRRFPDLNRLAKKFQRQAANLQDCYRLYQGINQLPNVIQALEKHEGKHQKLLLAVFVTPLTDLRSDFSKFQEMIETTLDMDQVENHEFLVKPSFDPNLSE
LREIMNDLEKKMQSTLISAARDLGLDPGKQIKLDSSAQFGYYFRVTCKEEKVLRNNKNFSTVDIQKNGVKFTNSKLTSLNEEYTKNKTEYEEAQDAIVKEIVNISSGYVEPMQTLNDVLA
QLDAVVSFAHVSNGAPVPYVRPAILEKGQGRIILKASRHACVEVQDEIAFIPNDVYFEKDKQMFHIITGPNMGGKSTYIRQTGVIVLMAQIGCFVPCESAEVSIVDCILARVGAGDSQLK
GVSTFMAEMLETASILRSATKDSLIIIDELGRGTSTYDGFGLAWAISEYIATKIGAFCMFATHFHELTALANQIPTVNNLHVTALTTEETLTMLYQVKKGVCDQSFGIHVAELANFPKHV
IECAKQKALELEEFQYIGESQGYDIMEPAAKKCYLERENLRVTEPKDQCLILLTWKRKLRGGKRSACSRPERQNQGSGGDFKRKSLVVCKATNPALKWIVPSPLNEFSFIHLEKHSLVLS
MELQATSGGAQCPG