lung cancer gene and literature database Home
Cancer metastasis database

Annotation category 5

Gene information

Gene ID 4350
Symbol

MPG

Synonymous

AAG|ADPG|APNG|CRA36.1|MDG|Mid1|PIG11|PIG16|anpg

Full name

N-methylpurine-DNA glycosylase

Gene description

3' end of the Mid1 gene, localized 68 kb upstream the humanzeta globin gene on 16p|3-alkyladenine DNA glycosylase|3-methyladenine DNA glycosidase|CRA36.1 (3-methyl-adenine DNA glycosylase)|DNA-3-methyladenine glycosylase|N-methylpurine-DNA glycosylase, MP

Cytoband

16p13.3

Gene type

protein-coding

Synonymous

MIM:156565; HGNC:HGNC:7211; Ensembl:ENSG00000103152; HPRD:06766; Vega:OTTHUMG00000047887

Pathway and disease

Pathways and Diseases

Detail

Pathway

Base excision repair;KEGG PATHWAY;hsa03410

Pathway

Cleavage of the damaged purine;PID Reactome;500910

Pathway

DNA Repair;Reactome;REACT:216

Pathway

Depurination;PID Reactome;500029

Pathway

Recognition and association of DNA glycosylase with site containing an affected purine;PID Reactome;500030

Pathway

Displacement of DNA glycosylase by APE1;PID Reactome;501000

Disease

Colon cancer;FunDO

Disease

Cancer;FunDO

Sequence Information

Nucleotide Sequence

>4350 : length: 1289
ACTGCCCCCCTTCTCCCGGCTTCCGTCCCCTTCTGCGCAGGCGCCGCTCCGCCCCGGTCCTAGGGGTGCTTCCGTGGTCGGCGGCTGCTGGGCTCCGCGCCGGGGTCCGAGTCCCACGAA
GCCCCGGCCCGAGCCGCCGGATGCCCGCGCGCAGCGGGGCCCAGGTCATGCAGCCTGGGCCCCCATGCCGTGCAGCTCGCACATATGTGGGGCAGAGCAGCCACCCTGCCCCCAGCAGCA
GCCGTCCATCGTCAGACGTGATCATTTCCTGAGGCCTCGAGTGTGTCAGGGTGTTTGTGCCTCATAACAACCCACAGGATGGTCACCCCCGCTTTGCAGATGAAGAAACCAAAGCAGTTT
TGCCGACGGATGGGGCAAAAGAAGCAGCGACCAGCTAGAGCAGGGCAGCCACACAGCTCGTCCGACGCAGCCCAGGCACCTGCAGAGCAGCCACACAGCTCGTCCGATGCAGCCCAGGCA
CCTTGCCCCAGGGAGCGCTGCTTGGGACCGCCCACCACTCCGGGCCCATACCGCAGCATCTATTTCTCAAGCCCAAAGGGCCACCTTACCCGACTGGGGTTGGAGTTCTTCGACCAGCCG
GCAGTCCCCCTGGCCCGGGCATTTCTGGGACAGGTCCTAGTCCGGCGACTTCCTAATGGCACAGAACTCCGAGGCCGCATCGTGGAGACCGAGGCATACCTGGGGCCAGAGGATGAAGCC
GCCCACTCAAGGGGTGGCCGGCAGACCCCCCGCAACCGAGGCATGTTCATGAAGCCGGGGACCCTGTACGTGTACATCATTTACGGCATGTACTTCTGCATGAACATCTCCAGCCAGGGG
GACGGGGCTTGCGTCTTGCTGCGAGCACTGGAGCCCCTGGAAGGTCTGGAGACCATGCGTCAGCTTCGCAGCACCCTCCGGAAAGGCACCGCCAGCCGTGTCCTCAAGGACCGCGAGCTC
TGCAGTGGCCCCTCCAAGCTGTGCCAGGCCCTGGCCATCAACAAGAGCTTTGACCAGAGGGACCTGGCACAGGATGAAGCTGTATGGCTGGAGCGTGGTCCCCTGGAGCCCAGTGAGCCG
GCTGTAGTGGCAGCAGCCCGGGTGGGCGTCGGCCATGCAGGGGAGTGGGCCCGGAAACCCCTCCGCTTCTATGTCCGGGGCAGCCCCTGGGTCAGTGTGGTCGACAGAGTGGCTGAGCAG
GACACACAGGCCTGAGCAAAGGGCCTGCCCAGACAAGATTTTTTAATTGTTTAAAAACCGAATAAATGTTTTATTTCTAGAAAACTGTG

Protein Sequence

>4350 : length: 298
MVTPALQMKKPKQFCRRMGQKKQRPARAGQPHSSSDAAQAPAEQPHSSSDAAQAPCPRERCLGPPTTPGPYRSIYFSSPKGHLTRLGLEFFDQPAVPLARAFLGQVLVRRLPNGTELRGR
IVETEAYLGPEDEAAHSRGGRQTPRNRGMFMKPGTLYVYIIYGMYFCMNISSQGDGACVLLRALEPLEGLETMRQLRSTLRKGTASRVLKDRELCSGPSKLCQALAINKSFDQRDLAQDE
AVWLERGPLEPSEPAVVAAARVGVGHAGEWARKPLRFYVRGSPWVSVVDRVAEQDTQA