lung cancer gene and literature database Home
Cancer metastasis database

Annotation category 5

Gene information

Gene ID 9984
Symbol

THOC1

Synonymous

HPR1|P84|P84N5

Full name

THO complex 1

Gene description

THO complex subunit 1|hTREX84|nuclear matrix protein p84|tho1

Cytoband

18p11.32

Gene type

protein-coding

Synonymous

MIM:606930; HGNC:HGNC:19070; Ensembl:ENSG00000079134; HPRD:09498; Vega:OTTHUMG00000178051

Pathway and disease

Pathways and Diseases

Detail

Pathway

Spliceosome;KEGG PATHWAY;hsa03040

Disease

Infection;FunDO

Sequence Information

Nucleotide Sequence

>9984 : length: 2713
AATGACGGGTAAAATATAAACGAGAAAACAAAAGAGACAAGGCTGGGCTTCCAGAAACAAGATAAATATCTTCATGGACCAGAAATGCCAAGTAGTGAGCAAAACTGCAGCCTGGGCCTG
CTGGACTCTCTATCCAAGGCAGGTGGTGGTGTCCAGGAATTTGGCTACAAGTAACAGAGACTAAATGTGCACCATGTGGGACAAGGGGCCAGAGCCAGATTCACTTCTTGAAGCCAAGGA
CTAGGGTGGAACTTTTATCCAGTTTTGGGAAGAAACTAAGAAAAAATATTGCCAGTCTTCTGCCAAGGGCTATGGTTTTATAGGAAGTTGTGAGCCTAGGGATAACAAAGACAGCTTTGT
GTCCATCTGCTTGCTCAGTGACCAGATATGTGATATGCTCAGTATACTTATGAAACAGCTGCTCCAAGAAGTCATCATAAGACTTCTTCTAGACTTTTGGACTCAGGGGCCCTGGTAGAA
GCAGATGCAAAACTGCTAGACAGGGAAGGATGTACACAGAGAGGGAGGGGAAAGGAAGTAAACAAACATCCCAAAAGAAAAGGCTCCTGTTCAAAACTCTGATAAATTAAAATTCCAAAA
TCCATAAATCTAATGCTAAGAAGGATCACCAGCAAAATCAACTATTGGGATATATATATATATTTATTCCAGATGAAATATATAGCCTGACCAAGACTTTATGTATGTTTTGGATACTCA
AAAAGATAATCGATGAGATAACATCCATTGAAAAGGAACAAGAAATCATGAAACAAAAGCAGGCTGAAATGAAGTAGGACAGTCGATACAACTAATCGGGAGTCTTGGGAATGAAAAATA
CAATAATTGAAACCAAAACTCAGCACACAGAATTAAACTATACACTGGACATAGATGAACAAAGAACTAGTGAACTGAAGAAGGTGATGAGAACTTCATCCAGCAAGCAGCACAGACAGA
TTTTTTTTTTTTAAGTGGAAGAGCAGTTAAAAGCCATGGTGAATAGATTGGGAATTTCCAACATCTGTCTAGTAGGATTTCCAAAGAAGAAAATGGAGGGAATGGTAGAGAAACTGGATT
GCAAAGAATTGAAGGAAATCTCAAATCCTCAGCTTAAAAGTGTGTCACAACTGCCAAGCAGGATAAAGAAAGATAAATCTACTCTTCATTACATCATGCCATAACTGTGGGCATTCAGAG
AAAACCTAAAAGCCACTAAGGGATAAGAAAGACAAATATACTGGGAAGGCACAGCAGTTTGACTGTTAGCAGATTTCTAACATATCAACCATTAATACCAGAAGACAGTAGAGAAATATT
AAAGTGCTGAAAGAAAAATGACATTCAATCTAGAATTTTATACCGAGTTAAATATACTCAAGACTGTCGATGAAAGAAAGACATTTTTATTTAAAGACCAGGATAACTTACCACTCAGTG
ACCCTCATTTTGAAAAAAACTACTCAAGGATGTTCTTCAGGAGGAAGGAAATTGAACCCATAAGAATGGAGTGGGATACAGAAGGCAACGCTGATGGATTTACAACTGAGTGACAGTAAC
TTTCGTCGACACATCCTGTTGCAGTATCTCATTTTATTCCAATATCTCAAGGGGCAGGTCAAATTCAAAAGTTCAAACTATGTTTTAACTGATGAGCAATCACTTTGGATTGAAGATACT
ACAAAATCAGTTTATCAACTACTATCTGAAAACCCCCCCGATGGAGAAAGATTTTCAAAGATGGTAGAGCATATATTAAACACTGAAGAAAACTGGAACTCGTGGAAAAATGAAGGTTGC
CCAAGTTTTGTGAAAGAAAGTGTATGTTTTGTTCACGACAGAACATCAGATACCAAACCTACGAGAATAATTCGGAAGAGAACAGCACCCGAGGACTTCCTAGGGAAAGGACCCACCAAA
AAAATTCTGATGGGAAATGAGGAGTTAACAAGGCTTTGGAATCTTTGCCCTGATAATATGGAAGCCTGTAAATCAGAGACAAGGGAACACATGCCCACTTTGGAGGAATTCTTTGAAGAA
GCCATTGAACAGGCAGACCCTGAAAATATGGTGGAAAATGAATATAAGGCTGTGAACAATTCAAATTATGGTTGGAGAGCCCTGAGACTATTAGCACGGAGAAGCCCTCACTTCTTCCAG
CCAACCAACCAGCAGTTTAAAAGTTTACCAGAATATCTTGAAAATATGGTAATAAAGCTAGCCAAGGAATTACCGCCTCCTTCTGAAGAAATAAAAACAGGTGAGGATGAAGATGAGGAA
GATAATGATGCTCTACTGAAGGAAAATGAAAGTCCTGATGTTCGGCGAGACAAACCTGTAACAGGAGAACAAATAGAGGTATTTGCCAACAAGCTGGGTGAACAATGGAAGATTCTGGCT
CCCTACTTGGAAATGAAAGACTCAGAAATTAGGCAGATTGAGTGTGACAGTGAAGACATGAAGATGAGAGCTAAGCAGCTCCTGGTTGCCTGGCAAGATCAAGAGGGAGTTCATGCAACA
CCTGAGAATCTGATTAATGCACTGAATAAGTCTGGATTAAGTGACCTTGCAGAAAGTCTAACTAATGACAATGAGACAAATAGTTAGCTTCTTTTTTTTTTCTTTTTATTAAAACTGTGA
TAGATTTTGTTACCAAGCAGCATTTGATAAGAGGTCCACTGGTTTTGGTAAACAATAAACATTTTTATAACAA

Protein Sequence

>9984 : length: 664
MSPTPPLFSLPEARTRFTKSTREALNNKNIKPLLSTFSQVPGSENEKKCTLDQAFRGILEEEIINHSSCENVLAIISLAIGGVTEGICTASTPFVLLGDVLDCLPLDQCDTIFTFVEKNV
ATWKSNTFYSAGKNYLLRMCNDLLRRLSKSQNTVFCGRIQLFLARLFPLSEKSGLNLQSQFNLENVTVFNTNEQESTLGQKHTEDREEGMDVEEGEMGDEEAPTTCSIPIDYNLYRKFWS
LQDYFRNPVQCYEKISWKTFLKYSEEVLAVFKSYKLDDTQASRKKMEELKTGGEHVYFAKFLTSEKLMDLQLSDSNFRRHILLQYLILFQYLKGQVKFKSSNYVLTDEQSLWIEDTTKSV
YQLLSENPPDGERFSKMVEHILNTEENWNSWKNEGCPSFVKESVCFVHDRTSDTKPTRIIRKRTAPEDFLGKGPTKKILMGNEELTRLWNLCPDNMEACKSETREHMPTLEEFFEEAIEQ
ADPENMVENEYKAVNNSNYGWRALRLLARRSPHFFQPTNQQFKSLPEYLENMVIKLAKELPPPSEEIKTGEDEDEEDNDALLKENESPDVRRDKPVTGEQIEVFANKLGEQWKILAPYLE
MKDSEIRQIECDSEDMKMRAKQLLVAWQDQEGVHATPENLINALNKSGLSDLAESLTNDNETNS