lung cancer gene and literature database Home
Cancer metastasis database

Annotation category 5

Gene information

Gene ID 9001
Symbol

HAP1

Synonymous

HAP2|HIP5|HLP|hHLP1

Full name

huntingtin-associated protein 1

Gene description

HAP-1|huntingtin-associated protein 2|neuroan 1

Cytoband

17q21.2-q21.3

Gene type

protein-coding

Synonymous

MIM:600947; HGNC:HGNC:4812; Ensembl:ENSG00000173805; HPRD:02972; Vega:OTTHUMG00000133498

Pathway and disease

Pathways and Diseases

Detail

Pathway

Huntington's disease;KEGG PATHWAY;hsa05016

Pathway

Huntington disease;PANTHER;P00029

Disease

Huntington disease;FunDO

Sequence Information

Nucleotide Sequence

>9001 : length: 3944
GGCAGACTCGAGATGCGCCCGAAGAGGTTGGGCCGGTGCTGCGCGGGGAGCCGGCTCGGACCCGGGGACCCAGCAGCACTCACCTGTGCACCTTCGCCCTCAGCCAGTCCCGCTCCGGAG
CCCTCTGCGCAGCCGCAGGCACGGGGCACTGGACAGAGAGTAGGATCCCGAGCCACCTCTGGATCCCAGTTCCTCTCGGAAGCCCGCACCGGAGCTCGCCCGGCCTCGGAGGCTGGAGCC
AAGGCAGGAGCCCGGCGCCCGTCCGCATTCTCGGCCATCCAAGGGGATGTCCGGTCTATGCCCGACAATTCGGACGCGCCGTGGACCCGCTTCGTATTCCAAGGGCCGTTTGGTTCCCGG
GCCACTGGCCGGGGGACTGGAAAGGCAGCGGGCATCTGGAAGACGCCAGCCGCCTACGTTGGCCGGCGACCCGGGGTGTCCGGCCCTGAGCGCGCCGCCTTTATTCGGGAGCTGGAGGAA
GCACTGTGTCCTAACCTACCTCCGCCAGTCAAAAAGATCACCCAGGAAGACGTCAAAGTGATGTTATATTTGCTGGAGGAGCTTCTCCCACCTGTCTGGGAGAGCGTTACCTATGGGATG
GTCCTGCAGAGAGAGAGGGACCTGAACACTGCAGCTCGCATCGGCCAGTCCCTGGTGAAACAGAACAGTGTTTTGATGGAGGAGAACAGCAAGCTGGAAGCCCTGCTGGGCTCAGCCAAG
GAGGAGATTTTATACCTCAGACACCAGGTGAACTTGCGGGATGAGCTCCTCCAGCTCTACTCAGATTCTGATGAGGAGGATGAGGATGAAGAAGAGGAGGAGGAAGAAAAGGAGGCAGAA
GAGGAACAGGAAGAAGAAGAAGCAGAGGAAGACCTGCAGTGTGCTCATCCCTGTGATGCCCCTAAGCTGATTTCGCAGGAGGCATTGCTGCACCAGCACCACTGCCCACAGCTGGAAGCC
TTGCAGGAGAAGCTGAGGCTGCTGGAGGAGGAGAATCATCAGCTGAGAGAAGAGGCCTCTCAACTCGACACTCTTGAGGATGAGGAACAGATGCTCATTCTGGAGTGTGTGGAGCAGTTT
TCGGAGGCCAGCCAACAGATGGCTGAGCTGTCGGAGGTGCTGGTGCTCAGGCTGGAAAACTATGAACGGCAGCAGCAGGAGGTCGCTCGGCTGCAGGCCCAGGTGCTGAAGCTGCAGCAG
CGCTGCCGGATGTATGGGGCTGAGACTGAAAAGTTGCAGAAGCAGCTGGCTTCGGAGAAGGAAATCCAGATGCAGCTCCAGGAAGAGGAGACTCTTCCTGGTTTCCAGGAGACGCTGGCT
GAGGAGCTCAGAACGTCTCTAAGGAGGATGATCTCAGACCCTGTGTATTTTATGGAGAGGAATTATGAGATGCCCAGAGGGGACACATCCAGCCTAAGGTATGATTTTCGCTACAGTGAG
GATCGAGAGCAGGTGCGGGGGTTTGAGGCTGAGGAAGGGTTGATGCTGGCAGCGGATATCATGCGGGGGGAAGATTTCACGCCTGCGGAGGAGTTCGTGCCCCAGGAGGAGCTGGGGGCT
GCCAAGAAGGTGCCGGCTGAGGAAGGGGTGATGGAAGAGGCAGAGCTGGTGTCAGAGGAGACCGAGGGCTGGGAGGAGGTGGAACTGGAGCTGGATGAGGCAACGCGGATGAACGTGGTG
ACATCAGCCCTGGAGGCCAGCGGCTTGGGCCCTTCACACCTGGACATGAATTATGTCCTCCAGCAGCTGGCCAACTGGCAAGATGCCCATTACAGGCGGCAGCTGAGGTGGAAGATGCTC
CAGAAAGGTGAGTGCCCCCACGGGGCCCTCCCTGCCGCCAGCCGGACAAGCTGCAGATCGTCGTGCCGATGAAAAGAGAGGGTGGATAAGCTCCCCGAGTGCTCACCTGCCCCAGCCTGG
CTCTACCTGCTGTGCTTATTTGCATGGACTTTGCATATCATTTGCATAGACACCTCTGATCCCCTTCAGTGGGAACCGTAGTGTCAGTGCTCATTTATGTGGCATTTGCTTAGGATTCCA
GATCTCCATCCACTTTTCTCCTGGGGGCTGGGCTGGGGGTTAGGGCTGGGACTGTGCCCCCACACTGCGCCTCAGCTTCCCATCTCTGCCCGCTTGCTTCCCCTGCCCCCAACCCCTGCC
TCCTCTATCCCCCAGGCTCTCCAACTCTGCAGCAGTGGCAGCAGCAGTCAAAACAAACACGGGGGGCGGTGGGTGGGATGGTGGAGCAGCCCGGGGGCTGACCCAGGCTGGAGGACAGGG
CCAGCCACCCTCCCACGGCCTGGGAGGAAGAGAGGCCTTCTGGGACTGCCCAGGCTATGGGGACAAAGGCCTTCACCAGCAAGGGCCACAGTTGGAACAGTCCCCTGGGTGTCAGAAGGT
GGGCTAGGGCCTCCTGCAGGGTTGTGGGGTGGAACAGGGTCTCCTCTCCCCAGCCAGAAACCCCAAAGTCTGGGAGCTGCACCTTCCGAGTGCAGGCCATGTGAGCCCTGCCTCTTTAAG
GAGCCGCAGGACATGAAAGATGACCTTGTGACACTCATGCACAGCAGCCATTGCACGTGCATCAGCTCCCATCAGCCTCATTCCGTGGCAGGTGATGTGTCCCCATTGGTTAGGTGAGGA
GGGTGAGGCTCAGAGAGCTAAGGACACTTGTTTGGGGCCACACAGCCGGGGTAGATCTGAGCCCGTCCTCTCTACTCCTGTGCTGTAGCACCTTCACTGGCCCATCCCTCCCCTCTAGTG
CTGTCCTGGTACCCGTCCCAGCCTGTCCCCATTCTCATGGCCCTTTGGTCACTGCCGGGTGGAATAGCACTGGCTTCAGCAGGCGTGTCATGTAAGCTTGTGCAGGTTATAAACTGAACC
ATGACCTTTATGGCGCATGCAGGGGGCAACCTGCATAATTATCAATGGCGACTTTCCGTGTCCTTCTGATACAGTTGATCAGACCCCTGCCCACCGCCCAGGCCAGGCCTGTGGTCATCA
ATGCCCCAGTTCACATCCACCTGCTTCTCTTCCAGGCTTTGCTGTTCCCCAGCAGCCTGCAGAGGCCCCACAGACAGCTTGAGGCCCCTCCTTCTGCTGCCTGGCCAAGCCCCACACCCG
CAGACCCTCCTTCCCATCCTCTGAAATGGGACCCTGTGTCTGTCACCAGCCCACCCTCTGTGTTCATGAACCTGGGCTGGAGCTTGGGGACCCCTCCCTGCCCCTGGCTTCCTCTTCCAT
GTTCTGCCCTTTCCCACATGTTGGAGGCTTTTCCAACGTCTTCAGGGACAGGCGGTAGGAACCCCGGCCCTCGCTCTGCAGCTGGTGCAAAAGCTGTGGCTGCCAGGTCTGGGCCACATG
GCAGCCCAGGGGGCAGGAGAAGCCCGGGAGAGGCCCACTGGCTACCAGACTCAGCCCTGAGCAGGGAACAGGGCCCAGCTTCCACCGGCAGGGAGTTGTGAGCGCCTTCCCAACAATGTG
CCCCTCACCCCTTGATGCCCATGCTAATGGTAGCCACCCTGGTTCTTGTTGACTTGAGGGACCTGGCTGTCTTCCCTGTTCTTCATCCTTTCTTCTCAGTCCCTACCTACTGTTTGTAAC
CACAAGTGTCTCTGTGTGTGGGTGGGTGAGGGCCCCTCTGCCCAGTGGTGTGTCTCCTCTCCCTCCCTCCCTCTTCTGCCAGTGGCCTGGGGGTGTCCAGGCTCCCATCCGTGGCCCAGC
CCCTCTCCCCTCTGTCTTGATCCCCCCCTCCCTGCCCCTGGCTTCCTCTTCCATGTTCTGCCCTTTCCCACACCTTTGTTCCTCAATAGCTGGGGGCTGGGACTGAGGCCTCCTGCAGGT
ACCTGCCCCCCTTCACACAGCACCTCTCAATCTCCTATTGCTTGTCAGCCTGTGTGCGTGTGGTGCAGGAAATAAAGGATCTATACCCTCCTGGAAAAAAAAAA

Protein Sequence

>9001 : length: 619
MRPKRLGRCCAGSRLGPGDPAALTCAPSPSASPAPEPSAQPQARGTGQRVGSRATSGSQFLSEARTGARPASEAGAKAGARRPSAFSAIQGDVRSMPDNSDAPWTRFVFQGPFGSRATGR
GTGKAAGIWKTPAAYVGRRPGVSGPERAAFIRELEEALCPNLPPPVKKITQEDVKVMLYLLEELLPPVWESVTYGMVLQRERDLNTAARIGQSLVKQNSVLMEENSKLEALLGSAKEEIL
YLRHQVNLRDELLQLYSDSDEEDEDEEEEEEEKEAEEEQEEEEAEEDLQCAHPCDAPKLISQEALLHQHHCPQLEALQEKLRLLEEENHQLREEASQLDTLEDEEQMLILECVEQFSEAS
QQMAELSEVLVLRLENYERQQQEVARLQAQVLKLQQRCRMYGAETEKLQKQLASEKEIQMQLQEEETLPGFQETLAEELRTSLRRMISDPVYFMERNYEMPRGDTSSLRYDFRYSEDREQ
VRGFEAEEGLMLAADIMRGEDFTPAEEFVPQEELGAAKKVPAEEGVMEEAELVSEETEGWEEVELELDEATRMNVVTSALEASGLGPSHLDMNYVLQQLANWQDAHYRRQLRWKMLQKGE
CPHGALPAASRTSCRSSCR