lung cancer gene and literature database Home
Cancer metastasis database

Annotation category 5

Gene information

Gene ID 2071
Symbol

ERCC3

Synonymous

BTF2|GTF2H|RAD25|TFIIH|XPB

Full name

excision repair cross-complementation group 3

Gene description

BTF2 p89|DNA excision repair protein ERCC-3|DNA repair helicase|DNA repair protein complementing XP-B cells|TFIIH 89 kDa subunit|TFIIH basal transcription factor complex 89 kDa subunit|TFIIH basal transcription factor complex helicase XPB subunit|TFIIH p8

Cytoband

2q21

Gene type

protein-coding

Synonymous

MIM:133510; HGNC:HGNC:3435; Ensembl:ENSG00000163161; HPRD:00593; Vega:OTTHUMG00000131530

Pathway and disease

Pathways and Diseases

Detail

Pathway

Nucleotide excision repair;KEGG PATHWAY;hsa03420

Pathway

mRNA Processing;Reactome;REACT:1675

Pathway

DNA Repair;Reactome;REACT:216

Pathway

Transcription;Reactome;REACT:1788

Pathway

HIV Infection;Reactome;REACT:6185

Pathway

Gene Expression;Reactome;REACT:71

Disease

Hereditary disease;FunDO

Disease

Genetic disorders;KEGG DISEASE

Disease

Inherited disorders of DNA repair systems;KEGG DISEASE

Disease

benzene haematotoxicity;GAD

Disease

Esophageal tumor;FunDO

Disease

Ovarian cancer;FunDO

Disease

Lung cancer;FunDO

Disease

PHARMACOGENOMIC;GAD

Disease

Trichothiodystrophy;OMIM

Disease

Xeroderma pigmentosum, group B;OMIM

Disease

Xeroderma pigmentosum;GAD

Disease

Disorders of nucleotide excision repair;KEGG DISEASE;H00403

Sequence Information

Nucleotide Sequence

>2071 : length: 2947
TGCTGTAGCTGCCATGGGCAAAAGAGACCGAGCGGACCGCGGTGAGACGTTGCGCGGGCACGCTCAGCCACGACTGCCCTTGCCGGCCCTGCCCCCCGCTCTGCCTCGGAGCTGCTCCGG
GCCTCTGCGCCGGCCGACCCTGCTGGCCCTCCCGCGCGCACCCCGTTGGGACAGGCCTTTGGGCGGGAGAGATGCTGGACCTGGGCGCAGCCCAGCGAACTCGGCCTAGGGGAGACGGGT
GAGGGGCGCAACGCCTGCGGGATGCAGGTGGCTCTTAGCTAGGAGTTTGCGGCGGCGCAGACAAGAAGAAATCCAGGAAGCGGCACTATGAGGATGAAGAGGATGATGAAGAGGACGCCC
CGGGGAACGACCCTCAGGAAGCGGTTCCCTCGGCGGCGGGGAAGCAGGTGGATGAGTCAGGCACCAAAGTGGATGAATATGGAGCCAAGGACTACAGGCTGCAAATGCCGCTGAAGGACG
ACCACACCTCCAGGCCCCTCTGGGTGGCTCCCGATGGCCATATCTTCTTGGAAGCCTTCTCTCCAGTTTACAAATATGCCCAAGACTTCTTGGTGGCTATTGCAGAGCCAGTGTGCCGAC
CAACCCATGTGCATGAGTACAAACTAACTGCCTACTCCTTGTATGCAGCTGTCAGCGTTGGGCTGCAAACCAGTGACATCACCGAGTACCTCAGGAAGCTCAGCAAGACTGGAGTCCCTG
ATGGAATTATGCAGTTTATTAAGTTGTGTACTGTCAGCTATGGAAAAGTCAAGCTGGTCTTGAAGCACAACAGATACTTCGTTGAAAGTTGCCACCCTGATGTAATCCAGCATCTTCTCC
AGGACCCCGTGATCCGAGAATGCCGCTTAAGAAACTCTGAAGGGGAGGCCACTGAGCTCATCACAGAGACTTTCACAAGCAAATCTGCCATTTCTAAGACTGCTGAAAGCAGTGGTGGGC
CCTCCACTTCCCGAGTGACAGATCCACAGGGTAAATCTGACATCCCCATGGACCTGTTTGACTTCTATGAGCAAATGGACAAGGATGAAGAAGAAGAAGAAGAGACACAGACAGTGTCTT
TTGAAGTCAAGCAGGAAATGATTGAGGAACTCCAGAAACGTTGCATCCACCTGGAGTACCCTCTGTTGGCAGAATATGACTTCCGGAATGATTCTGTCAACCCTGATATCAACATTGACC
TAAAGCCCACAGCTGTCCTCAGACCCTATCAGGAGAAGAGCTTGCGAAAGATGTTTGGAAACGGGCGTGCACGTTCGGGGGTCATTGTTCTTCCCTGCGGTGCTGGAAAGTCCCTGGTTG
GTGTGACTGCTGCATGCACTGTCAGAAAACGCTGTCTGGTGCTGGGCAACTCAGCTGTTTCTGTGGAGCAGTGGAAAGCCCAGTTCAAGATGTGGTCCACCATTGACGACAGCCAGATCT
GCCGGTTCACCTCCGATGCCAAGGACAAGCCCATCGGCTGCTCCGTTGCCATTAGCACCTACTCCATGCTGGGCCACACCACCAAAAGGTCCTGGGAGGCCGAGCGAGTCATGGAGTGGC
TCAAGACCCAGGAGTGGGGCCTCATGATCCTGGATGAAGTGCACACCATACCAGCCAAGATGTTCCGAAGGGTGCTCACCATCGTGCAGGCCCACTGTAAGCTGGGTTTGACTGCGACCC
TCGTCCGCGAAGATGACAAAATTGTGGATTTAAATTTTCTGATTGGGCCTAAGCTCTACGAAGCCAACTGGATGGAGCTGCAGAATAATGGCTACATCGCCAAAGTCCAGTGTGCTGAGG
TCTGGTGCCCTATGTCTCCTGAATTTTACCGGGAATATGTGGCAATCAAAACCAAGAAACGAATCTTGCTGTACACCATGAACCCCAACAAATTTAGAGCTTGCCAGTTTCTGATCAAGT
TTCATGAAAGGAGGAATGACAAGATTATTGTCTTTGCTGACAATGTGTTTGCCCTAAAGGAATATGCCATTCGACTGAACAAACCCTATATCTACGGACCTACGTCTCAGGGGGAAAGGA
TGCAAATTCTCCAGAATTTCAAGCACAACCCCAAAATTAACACCATCTTCATATCCAAGGTAGGTGACACTTCGTTTGATCTGCCGGAAGCAAATGTCCTCATTCAGATCTCATCCCATG
GTGGCTCCAGGCGTCAGGAAGCCCAAAGGCTAGGGCGGGTGCTTCGAGCTAAAAAAGGGATGGTTGCAGAAGAGTACAATGCCTTTTTCTACTCACTGGTATCCCAGGACACACAGGAAA
TGGCTTACTCAACCAAGCGGCAGAGATTCTTGGTAGATCAAGGTTATAGCTTCAAGGTGATCACGAAACTCGCTGGCATGGAGGAGGAAGACTTGGCGTTTTCGACAAAAGAAGAGCAAC
AGCAGCTCTTACAGAAAGTCCTGGCAGCCACTGACCTGGATGCCGAGGAGGAGGTGGTGGCTGGGGAATTTGGCTCCAGATCCAGCCAGGCATCTCGGCGCTTTGGCACCATGAGTTCTA
TGTCTGGGGCCGACGACACTGTGTACATGGAGTACCACTCATCGCGGAGCAAGGCGCCCAGCAAACATGTACACCCGCTCTTCAAGCGCTTTAGGAAATGATGCTTAGGCAGGGTACTTC
GTTCAAGACCGGCGCTTGGCACCCTTGTTGGAAAGGGATTTTCAGCATAACATTTTCCTTCCACCTCTTTGACCTTCCCTCCAGCGTTGGCCAAATTGTGCTGAGGAAGATGCATCAAGG
GCTTGGCTGTGCCTTCATAGGTCATCTAGGGTTTTATAAAGGAGGAGGAGACAATATTTTTTCAAACTTTTTGGGGAGTGGGGTCATTTCTGTATATAAAAAATGTTAATATTTAAGGTG
TATTTATGTTACCGTTCTGAATAAACAGAATGGACCATTGAACCAGTAAAAAAAAAAAAAAAAAAAA

Protein Sequence

>2071 : length: 788
MGKRDRADRDKKKSRKRHYEDEEDDEEDAPGNDPQEAVPSAAGKQVDESGTKVDEYGAKDYRLQMPLKDDHTSRPLWVAPDGHIFLEAFSPVYKYAQDFLVAIAEPVCRPTHVHEYKLTA
YSLYAAVSVGLQTSDITEYLRKLSKTGVPDGIMQFIKLCTVSYGKVKLVLKHNRYFVESCHPDVIQHLLQDPVIRECRLRNSEGEATELITETFTSKSAHLPLSQISKTAESSGGPSTSR
VTDPQGKSDIPMDLFDFYEQMDKDEEEEEETQTVSFEVKQEMIEELQKRCIHLEYPLLAEYDFRNDSVNPDINIDLKPTAVLRPYQEKSLRKMFGNGRARSGVIVLPCGAGKSLVGVTAA
CTVRKRCLVLGNSAVSVEQWKAQFKMWSTIDDSQICRFTSDAKDKPIGCSVAISTYSMLGHTTKRSWEAERVMEWLKTQEWGLMILDEVHTIPAKMFRRVLTIVQAHCKLGLTATLVRED
DKIVDLNFLIGPKLYEANWMELQNNGYIAKVQCAEVWCPMSPEFYREYVAIKTKKRILLYTMNPNKFRACQFLIKFHERRNDKIIVFADNVFALKEYAIRLNKPYIYGPTSQGERMQILQ
NFKHNPKINTIFISKVGDTSFDLPEANVLIQISSHGGSRRQEAQRLGRVLRAKKGMVAEEYNAFFYSLVSQDTQEMAYSTKRQRFLVDQGYSFKVITKLAGMEEEDLAFSTKEEQQQLLQ
KVLAATDLDAEEEVVAGEFGSRSSQASRRFGTMSSMSGADDTVYMEYHSSRSKAPSKHVHPLFKRFRK