lung cancer gene and literature database Home
Cancer metastasis database

Annotation category 5

Gene information

Gene ID 2067
Symbol

ERCC1

Synonymous

COFS4|RAD10|UV20

Full name

excision repair cross-complementation group 1

Gene description

DNA excision repair protein ERCC-1|excision repair cross-complementing rodent repair deficiency, complementation group 1 (includes overlapping antisense sequence)

Cytoband

19q13.32

Gene type

protein-coding

Synonymous

MIM:126380; HGNC:HGNC:3433; Ensembl:ENSG00000012061; HPRD:00533; Vega:OTTHUMG00000182121

Pathway and disease

Pathways and Diseases

Detail

Pathway

Formation of incision complex in GG-NER;PID Reactome;500060

Pathway

Dual incision reaction in GG-NER;PID Reactome;500061

Pathway

DNA Repair;Reactome;REACT:216

Pathway

Formation of transcription-coupled NER (TC-NER) repair complex;PID Reactome;500065

Pathway

Nucleotide excision repair;KEGG PATHWAY;hsa03420

Pathway

Global Genomic NER (GG-NER);PID Reactome;500058

Disease

chromosomal damage;GAD

Disease

Hemolytic anemia;FunDO

Disease

Genetic disorders;KEGG DISEASE

Disease

Prostate cancer;FunDO

Disease

Inherited disorders of DNA repair systems;KEGG DISEASE

Disease

gastrointestinal toxicity;GAD

Disease

Ovarian disease;FunDO

Disease

Azoospermia;FunDO

Disease

lung cancer;GAD

Disease

CANCER;GAD

Disease

Cancer;FunDO

Disease

Testicular tumor;FunDO

Disease

ovarian cancer;GAD

Disease

Neoplasms;GAD

Disease

PHARMACOGENOMIC;GAD

Disease

Disorders of nucleotide excision repair;KEGG DISEASE;H00403

Disease

Cerebrooculofacioskeletal syndrome 4;OMIM

Sequence Information

Nucleotide Sequence

>2067 : length: 3400
CCGGAAGTGCTGCGAGCCCTGGGCCACGCTGGCCGTGCTGGCAGTGGGCCGCCTCGATCCCTCTGCAGTCTTTCCCTTGAGGCTCCAAGACCAGCAGGTGAGGCCTCGCGGCGCTGAAAC
CGTGAGGCCCGGACCACAGGCTCCAGATGGACCCTGGGAAGGACAAAGAGGGGGTGCCCCAGCCCTCAGGGCCGCCAGCAAGGAAGAAATTTGTGATACCCCTCGACGAGGATGAGGTCC
CTCCTGGAGTGGCCAAGCCCTTATTCCGATCTACACAGAGCCTTCCCACTGTGGACACCTCGGCCCAGGCGGCCCCTCAGACCTACGCCGAATATGCCATCTCACAGCCTCTGGAAGGGG
CTGGGGCCACGTGCCCCACAGGGTCAGAGCCCCTGGCAGGAGAGACGCCCAACCAGGCCCTGAAACCCGGGGCAAAATCCAACAGCATCATTGTGAGCCCTCGGCAGAGGGGCAATCCCG
TACTGAAGTTCGTGCGCAATGTGCCCTGGGAATTTGGCGACGTAATTCCCGACTATGTGCTGGGCCAGAGCACCTGTGCCCTGTTCCTCAGCCTCCGCTACCACAACCTGCACCCAGACT
ACATCCATGGGCGGCTGCAGAGCCTGGGGAAGAACTTCGCCTTGCGGGTCCTGCTTGTCCAGGTGGATGTGAAAGATCCCCAGCAGGCCCTCAAGGAGCTGGCTAAGATGTGTATCCTGG
CCGACTGCACATTGATCCTCGCCTGGAGCCCCGAGGAAGCTGGGCGGTACCTGGAGACCTACAAGGCCTATGAGCAGAAACCAGCGGACCTCCTGATGGAGAAGCTAGAGCAGGACTTCG
TCTCCCGGGTGACTGAATGTCTGACCACCGTGAAGTCAGTCAACAAAACGGACAGTCAGACCCTCCTGACCACATTTGGATCTCTGGAACAGCTCATCGCCGCATCAAGAGAAGATCTGG
CCTTATGCCCAGGCCTGGGCCCTCAGAAAGCCCGGAGGCTGTTTGATGTCCTGCACGAGCCCTTCTTGAAAGTACCCTGATGACCCCAGCTGCCAAGGAAACCCCCAGTGTAATAATAAA
TCGTCCTCCCAGGCCAGGCTCCTGCTGGCTGCGCTGGTGCAGTCTCTGGGGAGGGATTCTGGGGGTGTCACCTTCTGGTGGCCCAGGTGGGCACCTTCAGCTTTCTTTAGTTCCTCAGTT
TCCCGGGGGCAGACTACACAGGCTGCTGCTGCTGCTGCTTCCGCTTCTTGTCCCGGCCTGTGGGAGCCTCCTCCCCAGACTCTGAATTCAGTGGCGGCCCTGGCATCTCCTCTTGGGGCA
CTGTCTCTGGCATCCGGCTTTCCTGACTCTGCTTCTTCCTCTTCTTGGTGGATCCCGGAGTTGCCCTGGCTTCAGGCTGTCCCTCCCCTGGCAGTTCAGGCTCTAGTGGCTGAATTGGCT
CAGTCACTGTGTGACCTCTCTCTTTCTTCTTCTTCTTCTTCTTGGTGGATGTGGGAGCTGCCTGAGGCTCAAGGTCATCCGGCAGCTCAGGCCCCACCACCTCTGTCTCTGGCTCCACTG
TGGCATCTTGCTGTTTTTCTTTCTTCGTCTTCTTTTTGGGAGCTGCCAGAGCTGCCTGGGCCTGAGGCTTCGCTCCTTCTGGCTGTTGAGGCGCCATGGTCCCCCCTGGGGACTCCAGAG
GCTTCATCTCCGGCTCCACTGGCTCCATCGCCTCCGTCCCTGGCTCCATCATTGCCATCTGTCCCTTTTCTTTTTTCCTCTTCTTCGTAGGGGGCAGAGGGATGGCTTCCTCCAGTGGCT
CCACCTTCACCTGTGGCTGAGACTCAACTGTCACCCCCTCCTCTGGCTCCATCCCTTCCGTCCCCTTTTGCCTCTTTCTCTTTTTGGTCGGGGACAGGACTGTGTCTTCTAGAGGCTCAG
TGTTAATCTGTTCCTGCTTCACTGTCTTGTCTTCTGGCTCGAAGGTTTCTTTCCCTTTGGGCTTCTTCCTCTTCTTGGTGGTGGACGGGAACAGCACTCCCAGAGGCTCCAGTGTCTCCA
CTGTGGGCTCTGTCCCCACAGGCCCTGCTGCCTCTGGTTCTTTCAGCTGCTGATTTTTTTTCTTCTTCTTCTTCCGCACATCCATTTCTGGCGACCCCAAAGCCATGTCCACCTCCAGGG
CCCCGTGCCCATTCACTGCCTCCTGAGTGACTGGGGCCTCTGTCACCTGCATCTCCTTTTTCTTCTTCCCTGAGGTGAGCAGGTTGGGGGCCAAGGCTGACCTAGGCCCTGTGACTGGTG
GGTTGCCCCCAAAGGCACAGAACCGAGGCCTCAGGCCAGGAGGGATCTGTGGTGGGGGACTTGCTGGGATGGGCTGCAGAGGGCTCCCTGACAGGGATTGCTGGGGACCCTCAAGGATCC
TTAGGGTGCCCTGGGGGGCTGAGGCACAGGTGAGTCCACCTCCTGCCTCCGTTGAGGGGGCCAGCAGGGTCGCTTCTCCAGCTTGGGGACAGCTGCTGAGGACTCGATAGCGGTGCCGCT
TGCCTGCCAATTTGCCCTTGACGATCTGGGAGCCAGAGAGAGGCACATGCCGCCCATTGAAGCTACAGAGAGAAACAGGGAGGGCAGAGGCTTAAGTGGAACAGGAGAGGGAAGGTTTTT
TGATTTTTTTTTTGTTTTTTTTTGAGAGAGTCTTGCTCTGTTGCCTAGGCTGGAGTGCAGTGGCATGATCTCGGCTCACTGCAATGTCCACCTCCTGGGTTCAAGCGATTCTCCTGCCTC
AGCCTCTCAAGTAGCTGGGATTACAGGCACCTGCCACCACGCCCAGCCAATTTTTGTATTTTTAGTAGAGACAATTTCACTATGTTGGCCAGGCTGGTCTTGAACTCCTGACCTCAAGTG
ATCTGCTCGCCTCGGCCTCCCAAAGGATGGGATTACAGGCACCAGCCACTGCGCCTGGCTGGCCTCTGGTTTTTAATAAAACATGACTAGAGTGACTCCATCTTAAAGTGAGTAGCTAGG
CACTTACAAGGTTCATGCTTATGGCCTGAAAATAACCACATCCCAGGCTGACCACCAATTATAATTACAGAATATTTATGGCCATACAGAACATGTTCCACCAAGCCTGCAGAATGTCCA
AATGTCCTAAGAATGCAGCCCCCATTACTTAAATATAACATAAATGAGCAAGCTTAGGTTGCAGGATTAATGGTCGTGGATAACACCAATAGCCCCTACCTTTAGTGAGCTTATCTGCAC
ACTCCAAGTTTAACTATAGTTCCTTATAGTTTCTTATAAGTAGAAATACTAACAAAGGGCTGTGGGTTTCTCCCCCTGCTTTCTGAGGACACTCTACTCTGTAAAGGAGTAGTTTCCAAT
AAACTTGTTTCTTTCACTGTGCAAAAAAAAAAAAAAAAAA

Protein Sequence

>2067 : length: 323
MDPGKDKEGVPQPSGPPARKKFVIPLDEDEVPPGVAKPLFRSTQSLPTVDTSAQAAPQTYAEYAISQPLEGAGATCPTGSEPLAGETPNQALKPGAKSNSIIVSPRQRGNPVLKFVRNVP
WEFGDVIPDYVLGQSTCALFLSLRYHNLHPDYIHGRLQSLGKNFALRVLLVQVDVKDPQQALKELAKMCILADCTLILAWSPEEAGRYLETYKAYEQKPADLLMEKLEQDFVSRVTECLT
TVKSVNKTDSQTLLTTFGSLEQLIAASREDLALCPGLGPQKVRALGKNPRSWGKERAPNKHNLRPQSFKVKKEPKTRHSGFRL