KEGG   Homo sapiens (human): 1828
Entry
1828              CDS       T01001                                 
Symbol
DSG1, CDHF4, DG1, DSG, EPKHE, EPKHIA, PPKS1, SPPK1
Name
(RefSeq) desmoglein-1 preproprotein
  KO
K07596  desmoglein 1
Organism
hsa  Homo sapiens (human)
Pathway
hsa04382  Cornified envelope formation
hsa04519  Cadherin signaling
hsa05150  Staphylococcus aureus infection
Network
nt06545  Cornified envelope formation
nt06549  Cadherin signaling
  Element
N01922  Localization of envoplakin and periplakin to the plasma membrane (PM)
N02008  Desmosome maturation
N02009  Desmosomal cadherin to Wint signaling pathway
N02023  DSG1 to Raf/MEK/ERK pathway
Disease
H00717  Striate palmoplantar keratoderma
H03008  Congenital erythroderma with palmoplantar keratoderma, hypotrichosis, and hyper-IgE
Brite
KEGG Orthology (KO) [BR:hsa00001]
 09130 Environmental Information Processing
  09133 Signaling molecules and interaction
   04519 Cadherin signaling
    1828 (DSG1)
 09150 Organismal Systems
  09158 Development and regeneration
   04382 Cornified envelope formation
    1828 (DSG1)
 09160 Human Diseases
  09171 Infectious disease: bacterial
   05150 Staphylococcus aureus infection
    1828 (DSG1)
 09180 Brite Hierarchies
  09183 Protein families: signaling and cellular processes
   04515 Cell adhesion molecules [BR:hsa04515]
    1828 (DSG1)
Cell adhesion molecules [BR:hsa04515]
 Cadherins
  Major cadherins
   1828 (DSG1)
SSDB
Motif
Pfam: Cadherin CADH_Y-type_LIR Cadherin_FAT4_N Ig_CLSTN
Other DBs
NCBI-GeneID: 1828
NCBI-ProteinID: NP_001933
OMIM: 125670
HGNC: 3048
Ensembl: ENSP00000257192.4
UniProt: Q02413
LinkDB
Position
18:31318160..31359246
AA seq 1049 aa
MDWSFFRVVAMLFIFLVVVEVNSEFRIQVRDYNTKNGTIKWHSIRRQKREWIKFAAACRE
GEDNSKRNPIAKIHSDCAANQQVTYRISGVGIDQPPYGIFVINQKTGEINITSIVDREVT
PFFIIYCRALNSMGQDLERPLELRVRVLDINDNPPVFSMATFAGQIEENSNANTLVMILN
ATDADEPNNLNSKIAFKIIRQEPSDSPMFIINRNTGEIRTMNNFLDREQYGQYALAVRGS
DRDGGADGMSAECECNIKILDVNDNIPYMEQSSYTIEIQENTLNSNLLEIRVIDLDEEFS
ANWMAVIFFISGNEGNWFEIEMNERTNVGILKVVKPLDYEAMQSLQLSIGVRNKAEFHHS
IMSQYKLKASAISVTVLNVIEGPVFRPGSKTYVVTGNMGSNDKVGDFVATDLDTGRPSTT
VRYVMGNNPADLLAVDSRTGKLTLKNKVTKEQYNMLGGKYQGTILSIDDNLQRTCTGTIN
INIQSFGNDDRTNTEPNTKITTNTGRQESTSSTNYDTSTTSTDSSQVYSSEPGNGAKDLL
SDNVHFGPAGIGLLIMGFLVLGLVPFLMICCDCGGAPRSAAGFEPVPECSDGAIHSWAVE
GPQPEPRDITTVIPQIPPDNANIIECIDNSGVYTNEYGGREMQDLGGGERMTGFELTEGV
KTSGMPEICQEYSGTLRRNSMRECREGGLNMNFMESYFCQKAYAYADEDEGRPSNDCLLI
YDIEGVGSPAGSVGCCSFIGEDLDDSFLDTLGPKFKKLADISLGKESYPDLDPSWPPQST
EPVCLPQETEPVVSGHPPISPHFGTTTVISESTYPSGPGVLHPKPILDPLGYGNVTVTES
YTTSDTLKPSVHVHDNRPASNVVVTERVVGPISGADLHGMLEMPDLRDGSNVIVTERVIA
PSSSLPTSLTIHHPRESSNVVVTERVIQPTSGMIGSLSMHPELANAHNVIVTERVVSGAG
VTGISGTTGISGGIGSSGLVGTSMGAGSGALSGAGISGGGIGLSSLGGTASIGHMRSSSD
HHFNQTIGSASPSTARSRITKYSTVQYSK
NT seq 3150 nt   +upstreamnt  +downstreamnt
atggactggagtttcttcagagtagttgcaatgctgttcatttttctggtggtggtagaa
gttaacagtgaattccgaatccaggtaagagattataacactaaaaatggcaccatcaaa
tggcattcaatccgaaggcagaaacgtgaatggatcaagttcgcagcagcctgtcgtgaa
ggtgaagacaactcaaagaggaacccaatcgccaaaattcactcagattgtgctgcaaac
cagcaagttacataccgcatctctggagtaggaattgatcagccaccatatgggatcttt
gtcattaatcagaaaactggtgaaattaatataacatccatagttgatcgagaggtcact
cctttcttcattatctactgccgagctctgaactcaatgggccaagatttagagaggcct
ctagagctcagagtcagggttttggatataaatgacaaccctccagtgttttcaatggct
acatttgcaggacaaatagaagaaaattctaatgcaaatacactggtgatgatactcaat
gctactgacgcagatgaaccgaacaatttgaactcaaaaatagccttcaagattataaga
caagaaccttcagattcaccaatgtttattatcaacagaaatactggagaaattcgaacg
atgaataattttctagacagagagcaatacggccagtatgctcttgctgtaagaggctct
gaccgagatggcggggcagatggcatgtcagcggaatgtgagtgcaacattaaaatcctc
gatgtcaatgataatatcccttacatggaacagtcttcatataccatagaaattcaagaa
aatactctaaattcaaatttgctcgagattagagtaattgatttggatgaagagttctca
gctaactggatggcagtaattttctttatctctggaaatgaaggaaattggtttgagata
gaaatgaatgaaagaacaaatgtgggaattttaaaggttgttaagcccttagattatgaa
gctatgcagagtctgcaactcagtattggtgtcagaaataaagctgaatttcatcattca
attatgtctcaatataaactgaaagcatctgcaatttctgtgactgtgttaaatgtaatt
gaaggcccagtgtttcgtccaggttcaaagacatatgttgtaactggtaatatgggatca
aatgataaagtgggagactttgtagctactgacctggacacaggtagaccttcaacgact
gttaggtatgtaatgggaaataatccagctgacctgctagctgttgattcaagaacaggc
aaactcactttgaaaaataaagttaccaaggaacagtacaatatgctcggaggaaaatac
caaggaacgattctctctatagatgataatcttcaaagaacttgcactggtacaattaat
attaacattcaaagttttggtaatgacgacaggactaatacagagccgaacactaaaatt
actaccaatactggcagacaagaaagtacttcttccactaactatgataccagcacaact
tctactgactctagccaagtatattcttctgaacccggaaacggagccaaagatttgtta
tcagacaatgtacattttggtcctgctggcattggactcctcatcatgggattcttggtc
ttaggattggtcccatttttgatgatctgttgtgattgtggaggtgctcctcgtagtgca
gctggctttgagcctgttcccgaatgttcagatggagcaattcattcatgggcagtagaa
ggaccacagcctgaacccagggatataaccactgtcataccacaaataccacctgataac
gcaaatataattgaatgcattgacaactcaggagtttatacaaatgagtatggtggcaga
gaaatgcaagatctgggaggaggagagagaatgacaggatttgaactaacagagggagtt
aaaacttcaggaatgcctgagatatgtcaagaatactctggaacattaagaagaaattct
atgagggaatgtagagaaggaggtctgaatatgaatttcatggaaagctacttctgtcag
aaagcatatgcttacgcagatgaagatgaaggacgcccatctaatgactgtttgctcata
tatgacatcgaaggtgtaggttcccctgctggctctgtgggttgttgtagcttcattgga
gaagacctggatgacagcttcttggataccctgggacctaaatttaagaagttggcagac
atcagcctaggaaaagaatcatatccagaccttgatccttcttggccaccacaaagcact
gaaccagtttgccttcctcaggaaacagagcccgttgttagtggacacccaccaatctcc
ccacatttcggcactaccacagtaatttctgagagcacctatccctcgggacctggtgta
ctgcatcctaagcctattctcgatcctctgggctatggtaatgtcactgtgaccgagtct
tacaccacctctgacactctgaagccctctgtgcacgttcacgataaccgaccagcatca
aacgtggtagtgacagagagagtggtcggcccaatctctggcgctgatttgcatggaatg
ttagagatgcctgacttgcgagatgggtcgaatgttatagtgacagaaagggtaatagca
ccaagctctagtctacccacctctctgactatccatcatcctagagagtcttcaaatgtg
gtagtgacagaaagagtaatccaaccaacttccggcatgataggtagtctgagtatgcac
cccgagttagccaatgcccacaatgtcattgtgacagagagggttgtttctggtgctggc
gtaactggaattagtggcaccactgggatcagcggtggcataggcagcagtggcctggtt
ggcaccagcatgggtgctgggagcggtgccctgagtggagctggcataagtggtggtggc
attggcctgagcagcttgggagggacagccagcattggccacatgaggagttcctctgac
catcactttaaccaaaccattgggtccgcctcccctagcacagctcgaagtcgaatcaca
aagtatagtaccgtgcaatatagcaagtag

KEGG   Homo sapiens (human): 1829
Entry
1829              CDS       T01001                                 
Symbol
DSG2, CDHF5, HDGC
Name
(RefSeq) desmoglein-2 preproprotein
  KO
K07597  desmoglein 2
Organism
hsa  Homo sapiens (human)
Pathway
hsa04382  Cornified envelope formation
hsa04519  Cadherin signaling
hsa04820  Cytoskeleton in muscle cells
hsa05412  Arrhythmogenic right ventricular cardiomyopathy
Network
nt06539  Cytoskeleton in muscle cells
nt06545  Cornified envelope formation
nt06549  Cadherin signaling
  Element
N01758  Desmosome - Vimentin filaments
N01922  Localization of envoplakin and periplakin to the plasma membrane (PM)
N02008  Desmosome maturation
N02009  Desmosomal cadherin to Wint signaling pathway
Disease
H00293  Arrhythmogenic right ventricular cardiomyopathy
H00294  Dilated cardiomyopathy
Brite
KEGG Orthology (KO) [BR:hsa00001]
 09130 Environmental Information Processing
  09133 Signaling molecules and interaction
   04519 Cadherin signaling
    1829 (DSG2)
 09140 Cellular Processes
  09142 Cell motility
   04820 Cytoskeleton in muscle cells
    1829 (DSG2)
 09150 Organismal Systems
  09158 Development and regeneration
   04382 Cornified envelope formation
    1829 (DSG2)
 09160 Human Diseases
  09166 Cardiovascular disease
   05412 Arrhythmogenic right ventricular cardiomyopathy
    1829 (DSG2)
 09180 Brite Hierarchies
  09183 Protein families: signaling and cellular processes
   04515 Cell adhesion molecules [BR:hsa04515]
    1829 (DSG2)
Cell adhesion molecules [BR:hsa04515]
 Cadherins
  Major cadherins
   1829 (DSG2)
SSDB
Motif
Pfam: Cadherin Ig_CLSTN Cadherin_FAT4_N Cadherin_CELSR2_9th CADH_Y-type_LIR AVEN
Other DBs
NCBI-GeneID: 1829
NCBI-ProteinID: NP_001934
OMIM: 125671
HGNC: 3049
Ensembl: ENSP00000261590.8
UniProt: Q14126
Structure
LinkDB
Position
18:31498177..31549008
AA seq 1118 aa
MARSPGRAYALLLLLICFNVGSGLHLQVLSTRNENKLLPKHPHLVRQKRAWITAPVALRE
GEDLSKKNPIAKIHSDLAEERGLKITYKYTGKGITEPPFGIFVFNKDTGELNVTSILDRE
ETPFFLLTGYALDARGNNVEKPLELRIKVLDINDNEPVFTQDVFVGSVEELSAAHTLVMK
INATDADEPNTLNSKISYRIVSLEPAYPPVFYLNKDTGEIYTTSVTLDREEHSSYTLTVE
ARDGNGEVTDKPVKQAQVQIRILDVNDNIPVVENKVLEGMVEENQVNVEVTRIKVFDADE
IGSDNWLANFTFASGNEGGYFHIETDAQTNEGIVTLIKEVDYEEMKNLDFSVIVANKAAF
HKSIRSKYKPTPIPIKVKVKNVKEGIHFKSSVISIYVSESMDRSSKGQIIGNFQAFDEDT
GLPAHARYVKLEDRDNWISVDSVTSEIKLAKLPDFESRYVQNGTYTVKIVAISEDYPRKT
ITGTVLINVEDINDNCPTLIEPVQTICHDAEYVNVTAEDLDGHPNSGPFSFSVIDKPPGM
AEKWKIARQESTSVLLQQSEKKLGRSEIQFLISDNQGFSCPEKQVLTLTVCECLHGSGCR
EAQHDSYVGLGPAAIALMILAFLLLLLVPLLLLMCHCGKGAKGFTPIPGTIEMLHPWNNE
GAPPEDKVVPSFLPVDQGGSLVGRNGVGGMAKEATMKGSSSASIVKGQHEMSEMDGRWEE
HRSLLSGRATQFTGATGAIMTTETTKTARATGASRDMAGAQAAAVALNEEFLRNYFTDKA
ASYTEEDENHTAKDCLLVYSQEETESLNASIGCCSFIEGELDDRFLDDLGLKFKTLAEVC
LGQKIDINKEIEQRQKPATETSMNTASHSLCEQTMVNSENTYSSGSSFPVPKSLQEANAE
KVTQEIVTERSVSSRQAQKVATPLPDPMASRNVIATETSYVTGSTMPPTTVILGPSQPQS
LIVTERVYAPASTLVDQPYANEGTVVVTERVIQPHGGGSNPLEGTQHLQDVPYVMVRERE
SFLAPSSGVQPTLAMPNIAVGQNVTVTERVLAPASTLQSSYQIPTENSMTARNTTVSGAG
VPGPLPDFGLEESGHSNSTITTSSTRVTKHSTVQHSYS
NT seq 3357 nt   +upstreamnt  +downstreamnt
atggcgcggagcccgggacgcgcgtacgccctgctgcttctcctgatctgctttaacgtt
ggaagtggacttcacttacaggtcttaagcacaagaaatgaaaataagctgcttcctaaa
catcctcatttagtgcggcaaaagcgcgcctggatcaccgcccccgtggctcttcgggag
ggagaggatctgtccaagaagaatccaattgccaagatacattctgatcttgcagaagaa
agaggactcaaaattacttacaaatacactggaaaagggattacagagccaccttttggt
atatttgtctttaacaaagatactggagaactgaatgttaccagcattcttgatcgagaa
gaaacaccattttttctgctaacaggttacgctttggatgcaagaggaaacaatgtagag
aaacccttagagctacgcattaaggttcttgatatcaatgacaacgaaccagtgttcaca
caggatgtctttgttgggtctgttgaagagttgagtgcagcacatactcttgtgatgaaa
atcaatgcaacagatgcagatgagcccaataccctgaattcgaaaatttcctatagaatc
gtatctctggagcctgcttatcctccagtgttctacctaaataaagatacaggagagatt
tatacaaccagtgttaccttggacagagaggaacacagcagctacactttgacagtagaa
gcaagagatggcaatggagaagttacagacaaacctgtaaaacaagctcaagttcagatt
cgtattttggatgtcaatgacaatatacctgtagtagaaaataaagtgcttgaagggatg
gttgaagaaaatcaagtcaacgtagaagttacgcgcataaaagtgttcgatgcagatgaa
ataggttctgataattggctggcaaattttacatttgcatcaggaaatgaaggaggttat
ttccacatagaaacagatgctcaaactaacgaaggaattgtgacccttattaaggaagta
gattatgaagaaatgaagaatcttgacttcagtgttattgtcgctaataaagcagctttt
cacaagtcgattaggagtaaatacaagcctacacccattcccatcaaggtcaaagtgaaa
aatgtgaaagaaggcattcattttaaaagcagcgtcatctcaatttatgttagcgagagc
atggatagatcaagcaaaggccaaataattggaaattttcaagcttttgatgaggacact
ggactaccagcccatgcaagatatgtaaaattagaagatagagataattggatctctgtg
gattctgtcacatctgaaattaaacttgcaaaacttcctgattttgaatctagatatgtt
caaaatggcacatacactgtaaagattgtggccatatcagaagattatcctagaaaaacc
atcactggcacagtccttatcaatgttgaagacatcaacgacaactgtcccacactgata
gagcctgtgcagacaatctgtcacgatgcagagtatgtgaatgttactgcagaggacctg
gatggacacccaaacagtggccctttcagtttctccgtcattgacaaaccacctggcatg
gcagaaaaatggaaaatagcacgccaagaaagtaccagtgtgctgctgcaacaaagtgag
aaaaagcttgggagaagtgaaattcagttcctgatttcagacaatcagggttttagttgt
cctgaaaagcaggtccttacactcacagtttgtgagtgtctgcatggcagcggctgcagg
gaagcacagcatgactcctatgtgggcctgggacccgcagcaattgcgctcatgattttg
gcctttctgctcctgctattggtaccacttttactgctgatgtgccattgcggaaagggc
gccaaaggctttacccccatacctggcaccatagagatgctgcatccttggaataatgaa
ggagcaccacctgaagacaaggtggtgccatcatttctgccagtggatcaagggggcagt
ctagtaggaagaaatggagtaggaggtatggccaaggaagccacgatgaaaggaagtagc
tctgcttccattgtcaaagggcaacatgagatgtccgagatggatggaaggtgggaagaa
cacagaagcctgctttctggtagagctacccagtttacaggggccacaggcgctatcatg
accactgaaaccacgaagaccgcaagggccacaggggcttccagagacatggccggagct
caggcagctgctgttgcactgaacgaagaattcttaagaaattatttcactgataaagcg
gcctcttacactgaggaagatgaaaatcacacagccaaagattgccttctggtttattct
caggaagaaactgaatcgctgaatgcttctattggttgttgcagttttattgaaggagag
ctagatgaccgcttcttagatgatttgggacttaaattcaagacactagctgaagtttgc
ctgggtcaaaaaatagatataaataaggaaattgagcagagacaaaaacctgccacagaa
acaagtatgaacacagcttcacattcactctgtgagcaaactatggttaattcagagaat
acctactcctctggcagtagcttcccagttccaaaatctttgcaagaagccaatgcagag
aaagtaactcaggaaatagtcactgaaagatctgtgtcttctaggcaggcgcaaaaggta
gctacacctcttcctgacccaatggcttctagaaatgtgatagcaacagaaacttcctat
gtcacagggtccactatgccaccaaccactgtgatcctgggtcctagccagccacagagc
cttattgtgacagagagggtgtatgctccagcttctaccttggtagatcagccttatgct
aatgaaggtacagttgtggtcactgaaagagtaatacagcctcatgggggtggatcgaat
cctctggaaggcactcagcatcttcaagatgtaccttacgtcatggtgagggaaagagag
agcttccttgcccccagctcaggtgtgcagcctactctggccatgcctaatatagcagta
ggacagaatgtgacagtgacagaaagagttctagcacctgcttccactctgcaatccagt
taccagattcccactgaaaattctatgacggctaggaacaccacggtgtctggagctgga
gtccctggccctctgccagattttggtttagaggaatctggtcattctaattctaccata
accacatcttccaccagagttaccaagcatagcactgtacagcattcttactcctaa

KEGG   Homo sapiens (human): 1830
Entry
1830              CDS       T01001                                 
Symbol
DSG3, ABOLM, CDHF6, PVA
Name
(RefSeq) desmoglein-3 preproprotein
  KO
K07598  desmoglein 3
Organism
hsa  Homo sapiens (human)
Pathway
hsa04382  Cornified envelope formation
hsa04519  Cadherin signaling
Network
nt06545  Cornified envelope formation
nt06549  Cadherin signaling
  Element
N01922  Localization of envoplakin and periplakin to the plasma membrane (PM)
N02008  Desmosome maturation
N02009  Desmosomal cadherin to Wint signaling pathway
Disease
H02648  Acantholytic blistering of the oral and laryngeal mucosa
Brite
KEGG Orthology (KO) [BR:hsa00001]
 09130 Environmental Information Processing
  09133 Signaling molecules and interaction
   04519 Cadherin signaling
    1830 (DSG3)
 09150 Organismal Systems
  09158 Development and regeneration
   04382 Cornified envelope formation
    1830 (DSG3)
 09180 Brite Hierarchies
  09183 Protein families: signaling and cellular processes
   04515 Cell adhesion molecules [BR:hsa04515]
    1830 (DSG3)
Cell adhesion molecules [BR:hsa04515]
 Cadherins
  Major cadherins
   1830 (DSG3)
SSDB
Motif
Pfam: Cadherin Cadherin_FAT4_N Ig_CLSTN CADH_Y-type_LIR
Other DBs
NCBI-GeneID: 1830
NCBI-ProteinID: NP_001935
OMIM: 169615
HGNC: 3050
Ensembl: ENSP00000257189.4
UniProt: P32926
Structure
LinkDB
Position
18:31447741..31478702
AA seq 999 aa
MMGLFPRTTGALAIFVVVILVHGELRIETKGQYDEEEMTMQQAKRRQKREWVKFAKPCRE
GEDNSKRNPIAKITSDYQATQKITYRISGVGIDQPPFGIFVVDKNTGDINITAIVDREET
PSFLITCRALNAQGLDVEKPLILTVKILDINDNPPVFSQQIFMGEIEENSASNSLVMILN
ATDADEPNHLNSKIAFKIVSQEPAGTPMFLLSRNTGEVRTLTNSLDREQASSYRLVVSGA
DKDGEGLSTQCECNIKVKDVNDNFPMFRDSQYSARIEENILSSELLRFQVTDLDEEYTDN
WLAVYFFTSGNEGNWFEIQTDPRTNEGILKVVKALDYEQLQSVKLSIAVKNKAEFHQSVI
SRYRVQSTPVTIQVINVREGIAFRPASKTFTVQKGISSKKLVDYILGTYQAIDEDTNKAA
SNVKYVMGRNDGGYLMIDSKTAEIKFVKNMNRDSTFIVNKTITAEVLAIDEYTGKTSTGT
VYVRVPDFNDNCPTAVLEKDAVCSSSPSVVVSARTLNNRYTGPYTFALEDQPVKLPAVWS
ITTLNATSALLRAQEQIPPGVYHISLVLTDSQNNRCEMPRSLTLEVCQCDNRGICGTSYP
TTSPGTRYGRPHSGRLGPAAIGLLLLGLLLLLLAPLLLLTCDCGAGSTGGVTGGFIPVPD
GSEGTIHQWGIEGAHPEDKEITNICVPPVTANGADFMESSEVCTNTYARGTAVEGTSGME
MTTKLGAATESGGAAGFATGTVSGAASGFGAATGVGICSSGQSGTMRTRHSTGGTNKDYA
DGAISMNFLDSYFSQKAFACAEEDDGQEANDCLLIYDNEGADATGSPVGSVGCCSFIADD
LDDSFLDSLGPKFKKLAEISLGVDGEGKEVQPPSKDSGYGIESCGHPIEVQQTGFVKCQT
LSGSQGASALSTSGSVQPAVSIPDPLQHGNYLVTETYSASGSLVQPSTAGFDPLLTQNVI
VTERVICPISSVPGNLAGPTQLRGSHTMLCTEDPCSRLI
NT seq 3000 nt   +upstreamnt  +downstreamnt
atgatggggctcttccccagaactacaggggctctggccatcttcgtggtggtcatattg
gttcatggagaattgcgaatagagactaaaggtcaatatgatgaagaagagatgactatg
caacaagctaaaagaaggcaaaaacgtgaatgggtgaaatttgccaaaccctgcagagaa
ggagaagataactcaaaaagaaacccaattgccaagattacttcagattaccaagcaacc
cagaaaatcacctaccgaatctctggagtgggaatcgatcagccgccttttggaatcttt
gttgttgacaaaaacactggagatattaacataacagctatagtcgaccgggaggaaact
ccaagcttcctgatcacatgtcgggctctaaatgcccaaggactagatgtagagaaacca
cttatactaacggttaaaattttggatattaatgataatcctccagtattttcacaacaa
attttcatgggtgaaattgaagaaaatagtgcctcaaactcactggtgatgatactaaat
gccacagatgcagatgaaccaaaccacttgaattctaaaattgccttcaaaattgtctct
caggaaccagcaggcacacccatgttcctcctaagcagaaacactggggaagtccgtact
ttgaccaattctcttgaccgagagcaagctagcagctatcgtctggttgtgagtggtgca
gacaaagatggagaaggactatcaactcaatgtgaatgtaatattaaagtgaaagatgtc
aacgataacttcccaatgtttagagactctcagtattcagcacgtattgaagaaaatatt
ttaagttctgaattacttcgatttcaagtaacagatttggatgaagagtacacagataat
tggcttgcagtatatttctttacctctgggaatgaaggaaattggtttgaaatacaaact
gatcctagaactaatgaaggcatcctgaaagtggtgaaggctctagattatgaacaacta
caaagcgtgaaacttagtattgctgtcaaaaacaaagctgaatttcaccaatcagttatc
tctcgataccgagttcagtcaaccccagtcacaattcaggtaataaatgtaagagaagga
attgcattccgtcctgcttccaagacatttactgtgcaaaaaggcataagtagcaaaaaa
ttggtggattatatcctgggaacatatcaagccatcgatgaggacactaacaaagctgcc
tcaaatgtcaaatatgtcatgggacgtaacgatggtggatacctaatgattgattcaaaa
actgctgaaatcaaatttgtcaaaaatatgaaccgagattctactttcatagttaacaaa
acaatcacagctgaggttctggccatagatgaatacacgggtaaaacttctacaggcacg
gtatatgttagagtacccgatttcaatgacaattgtccaacagctgtcctcgaaaaagat
gcagtttgcagttcttcaccttccgtggttgtctccgctagaacactgaataatagatac
actggcccctatacatttgcactggaagatcaacctgtaaagttgcctgccgtatggagt
atcacaaccctcaatgctacctcggccctcctcagagcccaggaacagatacctcctgga
gtataccacatctccctggtacttacagacagtcagaacaatcggtgtgagatgccacgc
agcttgacactggaagtctgtcagtgtgacaacaggggcatctgtggaacttcttaccca
accacaagccctgggaccaggtatggcaggccgcactcagggaggctggggcctgccgcc
atcggcctgctgctccttggtctcctgctgctgctgttggccccccttctgctgttgacc
tgtgactgtggggcaggttctactgggggagtgacaggtggttttatcccagttcctgat
ggctcagaaggaacaattcatcagtggggaattgaaggagcccatcctgaagacaaggaa
atcacaaatatttgtgtgcctcctgtaacagccaatggagccgatttcatggaaagttct
gaagtttgtacaaatacgtatgccagaggcacagcggtggaaggcacttcaggaatggaa
atgaccactaagcttggagcagccactgaatctggaggtgctgcaggctttgcaacaggg
acagtgtcaggagctgcttcaggattcggagcagccactggagttggcatctgttcctca
gggcagtctggaaccatgagaacaaggcattccactggaggaaccaataaggactacgct
gatggggcgataagcatgaattttctggactcctacttttctcagaaagcatttgcctgt
gcggaggaagacgatggccaggaagcaaatgactgcttgttgatctatgataatgaaggc
gcagatgccactggttctcctgtgggctccgtgggttgttgcagttttattgctgatgac
ctggatgacagcttcttggactcacttggacccaaatttaaaaaacttgcagagataagc
cttggtgttgatggtgaaggcaaagaagttcagccaccctctaaagacagcggttatggg
attgaatcctgtggccatcccatagaagtccagcagacaggatttgttaagtgccagact
ttgtcaggaagtcaaggagcttctgctttgtccacctctgggtctgtccagccagctgtt
tccatccctgaccctctgcagcatggtaactatttagtaacggagacttactcggcttct
ggttccctcgtgcaaccttccactgcaggctttgatccacttctcacacaaaatgtgata
gtgacagaaagggtgatctgtcccatttccagtgttcctggcaacctagctggcccaacg
cagctacgagggtcacatactatgctctgtacagaggatccttgctcccgtctaatatga

KEGG   Homo sapiens (human): 147409
Entry
147409            CDS       T01001                                 
Symbol
DSG4, CDGF13, CDHF13, HYPT6, LAH
Name
(RefSeq) desmoglein-4 isoform 2 preproprotein
  KO
K07599  desmoglein 4
Organism
hsa  Homo sapiens (human)
Pathway
hsa04382  Cornified envelope formation
hsa04519  Cadherin signaling
Network
nt06545  Cornified envelope formation
nt06549  Cadherin signaling
  Element
N01922  Localization of envoplakin and periplakin to the plasma membrane (PM)
N02008  Desmosome maturation
N02009  Desmosomal cadherin to Wint signaling pathway
Disease
H00784  Localized autosomal recessive hypotrichosis
H00786  Hypotrichosis
Brite
KEGG Orthology (KO) [BR:hsa00001]
 09130 Environmental Information Processing
  09133 Signaling molecules and interaction
   04519 Cadherin signaling
    147409 (DSG4)
 09150 Organismal Systems
  09158 Development and regeneration
   04382 Cornified envelope formation
    147409 (DSG4)
 09180 Brite Hierarchies
  09183 Protein families: signaling and cellular processes
   04515 Cell adhesion molecules [BR:hsa04515]
    147409 (DSG4)
Cell adhesion molecules [BR:hsa04515]
 Cadherins
  Major cadherins
   147409 (DSG4)
SSDB
Motif
Pfam: Cadherin Cadherin_FAT4_N CADH_Y-type_LIR Ig_CLSTN Cadherin_CELSR2_9th
Other DBs
NCBI-GeneID: 147409
NCBI-ProteinID: NP_817123
OMIM: 607892
HGNC: 21307
Ensembl: ENSP00000311859.4
UniProt: Q86SJ6
LinkDB
Position
18:31376777..31414909
AA seq 1040 aa
MDWLFFRNICLLIILMVVMEVNSEFIVEVKEFDIENGTTKWQTVRRQKREWIKFAAACRE
GEDNSKRNPIAKIRSDCESNQKITYRISGVGIDRPPYGVFTINPRTGEINITSVVDREIT
PLFLIYCRALNSRGEDLERPLELRVKVMDINDNAPVFSQSVYTASIEENSDANTLVVKLC
ATDADEENHLNSKIAYKIVSQEPSGAPMFILNRYTGEVCTMSSFLDREQHSMYNLVVRGS
DRDGAADGLSSECDCRIKVLDVNDNFPTLEKTSYSASIEENCLSSELIRLQAIDLDEEGT
DNWLAQYLILSGNDGNWFDIQTDPQTNEGILKVVKMLDYEQAPNIQLSIGVKNQADFHYS
VASQFQMHPTPVRIQVVDVREGPAFHPSTMAFSVREGIKGSSLLNYVLGTYTAIDLDTGN
PATDVRYIIGHDAGSWLKIDSRTGEIQFSREFDKKSKYIINGIYTAEILAIDDGSGKTAT
GTICIEVPDINDYCPNIFPERRTICIDSPSVLISVNEHSYGSPFTFCVVDEPPGIADMWD
VRSTNATSAILTAKQVLSPGFYEIPILVKDSYNRACELAQMVQLYACDCDDNHMCLDSGA
AGIYTEDITGDTYGPVTEDQAGVSNVGLGPAGIGMMVLGILLLILAPLLLLLCCCKQRQP
EGLGTRFAPVPEGGEGVMQSWRIEGAHPEDRDVSNICAPMTASNTQDRMDSSEIYTNTYA
AGGTVEGGVSGVELNTGMGTAVGLMAAGAAGASGAARKRSSTMGTLRDYADADINMAFLD
SYFSEKAYAYADEDEGRPANDCLLIYDHEGVGSPVGSIGCCSWIVDDLDESCMETLDPKF
RTLAEICLNTEIEPFPSHQACIPISTDLPLLGPNYFVNESSGLTPSEVEFQEEMAASEPV
VHGDIIVTETYGNADPCVQPTTIIFDPQLAPNVVVTEAVMAPVYDIQGNICVPAELADYN
NVIYAERVLASPGVPDMSNSSTTEGCMGPVMSGNILVGPEIQVMQMMSPDLPIGQTVGST
SPMTSRHRVTRYSNIHYTQQ
NT seq 3123 nt   +upstreamnt  +downstreamnt
atggattggctcttcttcagaaacatttgccttttgatcattctaatggtggtgatggaa
gtaaacagtgaatttattgttgaggtgaaggaatttgacattgaaaatggcactacaaaa
tggcaaacagtcagaagacaaaagcgggagtggatcaagtttgccgcagcctgtcgagaa
ggagaggacaactcgaagaggaaccccattgccaaaattcgatcagactgcgaatcgaac
cagaagataacataccggatttctggagtagggattgatcgaccaccatatggggtattc
accattaatcctcgcactggggaaattaacatcacttcagtggtagacagagaaataact
ccacttttcttgatctattgccgggctctgaattcacggggtgaagatttagaaaggcct
cttgagcttagagtcaaagttatggacataaatgataacgctccagtcttttcgcaaagt
gtatacacagccagcattgaagaaaatagtgatgccaatacattggtagtaaagttatgt
gccacagatgcagatgaagaaaatcatctgaattctaaaattgcctacaagatcgtctct
caggagccatcaggtgcacccatgttcattctgaataggtacactggagaagtctgcacc
atgtccagtttcttggacagagagcaacacagtatgtacaacctggttgtgagaggctca
gatcgggatggagctgcagatggactgtcttctgagtgtgactgtagaatcaaggtttta
gacgtcaacgataatttccccaccttagagaaaacttcatactcagccagtattgaagag
aattgtttaagttcggaactgatacgattacaagcaattgatcttgatgaagaaggcact
gataactggttggctcaatatttaattctctctggaaatgatgggaattggttcgatatt
caaacagatccacaaaccaatgaaggcattttgaaagttgtcaagatgctggattatgaa
caagcacctaacattcagcttagtatcggagttaaaaaccaagctgattttcactactcc
gttgcttctcaattccaaatgcacccaacccctgtgagaattcaagttgttgatgtgaga
gaaggacctgcatttcatccaagtactatggcttttagtgtgcgggaaggaataaaagga
agttccttattgaattatgtgcttggcacatatacagccatagatttggacacaggaaac
cctgcaacagatgtcagatatatcatagggcatgatgcaggcagctggttaaaaattgat
tcaagaactggtgagatacaattttctagagaatttgataagaagtcaaaatatattatc
aatgggatatacacagcagagatcctggctatagatgatggctctggaaaaacagctaca
ggaaccatatgtattgaggttcctgatatcaatgattattgtccaaacatttttcctgaa
agaagaaccatctgcattgactctccatcagtccttatctctgttaatgaacattcttat
gggtctccgtttactttctgtgttgttgatgagccaccaggaatagctgacatgtgggat
gtcagatcaacaaatgctacctcggcaatccttacggctaagcaggttttatctccagga
ttttatgaaatcccaatcctggtgaaggacagctataacagagcatgtgaattggcacaa
atggtgcagttatatgcctgtgattgcgatgacaaccacatgtgcctggactctggtgcc
gcgggcatctacacagaggacataactggtgacacgtatgggcctgtcactgaagaccaa
gctggagtttcaaatgttggtcttggaccagcagggattggcatgatggttctgggcatc
ctgctactgattttggctccactcttgctgctcctgtgttgctgcaaacagagacagcca
gaaggcctgggaacaagatttgctcctgtgcctgagggcggagaaggagtgatgcagtct
tggagaattgaaggggcccatcccgaggacagggatgtgtcaaatatatgtgcacccatg
acagcctcaaatacccaggatcggatggattcctctgaaatctacaccaacacctatgca
gccgggggcacggtggaaggaggtgtatcgggagtggagctcaacacaggtatggggaca
gccgttggcctcatggccgcaggggccgcaggagcctcaggggccgcaaggaagaggagc
tctaccatgggaaccctgcgggactacgctgacgcagacatcaacatggctttcttggac
agctacttctcggagaaagcgtatgcttatgcagatgaagatgaaggtcgaccagccaat
gactgcttgctcatttatgaccacgagggagtcgggtctcccgtaggctctattggttgt
tgcagttggattgtggatgacttagatgaaagctgcatggaaactttagatccaaaattt
aggactcttgctgagatctgcttaaacacagaaattgaaccatttccttcacaccaggct
tgtataccaatcagtactgacctccctttgctcggacctaattactttgttaatgaatct
tcaggattgactccctcagaagttgaattccaagaagaaatggcagcatctgaacccgtg
gtccatggggatattattgtgactgagacttacggtaatgctgatccatgtgtgcaaccc
actacaattatttttgatcctcagcttgcacccaatgttgtagtaaccgaagcagtaatg
gcacctgtctatgatattcaagggaatatttgtgtacctgctgagttagcagattacaac
aatgtaatctatgctgagagagtactggctagtcctggtgtgcctgacatgagcaatagt
agcacgactgagggttgtatgggacctgtgatgagcggcaatattttagtagggccagaa
attcaagtgatgcaaatgatgagtccagaccttcccataggccaaaccgttggctccaca
tcccccatgacatctcgacacagagtaacacgatacagtaacatacattacacccaacag
taa

KEGG   Homo sapiens (human): 1823
Entry
1823              CDS       T01001                                 
Symbol
DSC1, CDHF1, DG2/DG3
Name
(RefSeq) desmocollin-1 isoform Dsc1a preproprotein
  KO
K07600  desmocollin 1
Organism
hsa  Homo sapiens (human)
Pathway
hsa04382  Cornified envelope formation
hsa04519  Cadherin signaling
Network
nt06545  Cornified envelope formation
nt06549  Cadherin signaling
  Element
N01922  Localization of envoplakin and periplakin to the plasma membrane (PM)
N02008  Desmosome maturation
N02009  Desmosomal cadherin to Wint signaling pathway
Brite
KEGG Orthology (KO) [BR:hsa00001]
 09130 Environmental Information Processing
  09133 Signaling molecules and interaction
   04519 Cadherin signaling
    1823 (DSC1)
 09150 Organismal Systems
  09158 Development and regeneration
   04382 Cornified envelope formation
    1823 (DSC1)
 09180 Brite Hierarchies
  09183 Protein families: signaling and cellular processes
   04515 Cell adhesion molecules [BR:hsa04515]
    1823 (DSC1)
Cell adhesion molecules [BR:hsa04515]
 Cadherins
  Major cadherins
   1823 (DSC1)
SSDB
Motif
Pfam: Cadherin Cadherin_FAT4_N Cadherin_pro Cadherin_CELSR2_9th CADH_Y-type_LIR Fibulin_C UPF0114
Other DBs
NCBI-GeneID: 1823
NCBI-ProteinID: NP_077739
OMIM: 125643
HGNC: 3035
Ensembl: ENSP00000257198.6
UniProt: Q08554
Structure
LinkDB
Position
18:complement(31129236..31162856)
AA seq 894 aa
MALASAAPGSIFCKQLLFSLLVLTLLCDACQKVYLRVPSHLQAETLVGKVNLEECLKSAS
LIRSSDPAFRILEDGSIYTTHDLILSSERKSFSIFLSDGQRREQQEIKVVLSARENKSPK
KRHTKDTALKRSKRRWAPIPASLMENSLGPFPQHVQQIQSDAAQNYTIFYSISGPGVDKE
PFNLFYIEKDTGDIFCTRSIDREKYEQFALYGYATTADGYAPEYPLPLIIKIEDDNDNAP
YFEHRVTIFTVPENCRSGTSVGKVTATDLDEPDTLHTRLKYKILQQIPDHPKHFSIHPDT
GVITTTTPFLDREKCDTYQLIMEVRDMGGQPFGLFNTGTITISLEDENDNPPSFTETSYV
TEVEENRIDVEILRMKVQDQDLPNTPHSKAVYKILQGNENGNFIISTDPNTNEGVLCVVK
PLNYEVNRQVILQVGVINEAQFSKAASSQTPTMCTTTVTVKIIDSDEGPECHPPVKVIQS
QDGFPAGQELLGYKALDPEISSGEGLRYQKLGDEDNWFEINQHTGDLRTLKVLDRESKFV
KNNQYNISVVAVDAVGRSCTGTLVVHLDDYNDHAPQIDKEVTICQNNEDFAVLKPVDPDG
PENGPPFQFFLDNSASKNWNIEEKDGKTAILRQRQNLDYNYYSVPIQIKDRHGLVATHML
TVRVCDCSTPSECRMKDKSTRDVRPNVILGRWAILAMVLGSVLLLCILFTCFCVTAKRTV
KKCFPEDIAQQNLIVSNTEGPGEEVTEANIRLPMQTSNICDTSMSVGTVGGQGIKTQQSF
EMVKGGYTLDSNKGGGHQTLESVKGVGQGDTGRYAYTDWQSFTQPRLGEKVYLCGQDEEH
KHCEDYVCSYNYEGKGSLAGSVGCCSDRQEEEGLEFLDHLEPKFRTLAKTCIKK
NT seq 2685 nt   +upstreamnt  +downstreamnt
atggctctggcctctgctgccccagggagcatcttctgtaagcagctccttttctctctc
ctggttttaacattactttgcgatgcttgtcagaaagtttatcttcgagttccttctcat
cttcaggctgaaacacttgtaggcaaagtgaatctggaggagtgtctcaagtcggccagc
ctaatccggtccagtgaccctgccttcagaattctagaagatggctcaatttacacaaca
catgacctcattttgtcttctgaaaggaaaagtttttccattttcctttcagatggtcag
agacgggaacaacaagagataaaagttgtactgtcagcaagagaaaacaagtctcctaag
aagagacataccaaagacacagccctcaagcgcagcaagagacgatgggctcctattcca
gcttcattgatggagaactcgttgggtccatttccacaacacgttcagcagatccaatct
gatgctgcacagaattacaccatcttttattccataagtgggccaggcgtggacaaagaa
cccttcaatttgttttacatagagaaagacactggggatatcttttgtacaaggagcatt
gaccgtgagaaatatgaacagtttgcgttatatggctatgcaacaactgcagatggctat
gcaccagaatatccactccctttgatcatcaaaattgaagatgataatgataacgcccca
tattttgaacacagagtgactatctttactgtgcctgaaaattgccgatccggaacttca
gtgggaaaagtgaccgccacagaccttgacgaacctgacactctccatactcgtctgaaa
tataaaatcttacaacaaatcccagatcatccaaagcatttctccatacacccagatacc
ggtgtcatcaccacaactacaccttttctggatagagaaaaatgtgatacttaccagtta
ataatggaagtgcgagacatgggtggtcagcctttcggtttatttaatacaggaacaatt
actatttcacttgaggatgaaaatgacaatccaccatctttcacagaaacttcttatgtt
acagaagtagaagaaaacagaattgacgtggagattttacgaatgaaggtacaggatcag
gatttgccaaacactcctcactcaaaggctgtatacaaaatcctacaaggaaatgaaaat
ggaaacttcataattagcacagatccaaatacaaatgaaggagtgctgtgtgttgtcaag
ccattgaactatgaagtcaatcgccaagttattttgcaagttggtgtcattaacgaggca
caattctctaaagcagcgagctcacaaactcctacaatgtgcactacaactgtcaccgtt
aaaattatagacagtgatgagggccctgaatgccaccctccagtgaaagttattcagagt
caagatggcttcccagctggccaagaactccttggatacaaagcactggacccggaaata
tccagtggtgaaggcttaaggtatcagaagttaggggatgaagataactggtttgaaatt
aatcaacacactggcgacttgagaactctaaaagtactagatagagaatccaaatttgta
aaaaacaaccaatacaatatttcagttgttgcagtggatgcagttggccgatcttgcact
ggaacattagtagttcatttggatgattacaacgatcacgcacctcaaattgacaaagaa
gtgaccatttgtcagaataatgaggattttgctgttctgaaacctgtagatccagatgga
cctgaaaatggaccaccttttcaattctttctggataattctgccagtaaaaactggaac
atagaagaaaaggatggtaaaactgccattcttcgtcaacggcaaaatcttgattataac
tattattctgtgcctattcaaataaaagacaggcatggtttagttgcaacacatatgtta
acagtgagagtatgtgactgttcaactccatctgagtgtagaatgaaggataaaagtaca
agagacgttagaccaaatgtaatacttggaagatgggctattcttgctatggtgttgggt
tctgtattgttattatgtattctgtttacatgtttctgtgtcactgctaagagaacagtc
aagaaatgttttccagaagacatagcccagcaaaatttaattgtatcaaatactgaagga
cctggagaagaagtaacggaagcaaatattagactccccatgcagacatccaacatttgt
gacacaagcatgtctgttggtactgttggtggccagggaatcaaaacacagcaaagtttt
gagatggtcaaaggaggctacactttggattccaacaaaggaggtggacatcagaccttg
gagtccgtcaagggagtggggcagggagatactggcagatatgcgtacacggactggcag
agtttcacccaacctcggcttggcgaaaaggtgtatttgtgtggacaagatgaggagcat
aaacattgtgaagactacgtttgttcgtataactatgaaggcaaaggttctctggccggc
tcagtaggttgctgcagcgatcggcaggaagaagagggactggagtttctagatcacctg
gaacccaaatttaggacattagcaaagacatgcatcaagaaataa

KEGG   Homo sapiens (human): 3728
Entry
3728              CDS       T01001                                 
Symbol
JUP, CTNNG, DP3, DPIII, PDGB, PG, PKGB
Name
(RefSeq) junction plakoglobin
  KO
K10056  junction plakoglobin
Organism
hsa  Homo sapiens (human)
Pathway
hsa04382  Cornified envelope formation
hsa04519  Cadherin signaling
hsa04820  Cytoskeleton in muscle cells
hsa05200  Pathways in cancer
hsa05202  Transcriptional misregulation in cancer
hsa05221  Acute myeloid leukemia
hsa05226  Gastric cancer
hsa05412  Arrhythmogenic right ventricular cardiomyopathy
Network
nt06240  Transcription (cancer)
nt06275  Acute myeloid leukemia
nt06539  Cytoskeleton in muscle cells
nt06545  Cornified envelope formation
nt06549  Cadherin signaling
  Element
N00108  AML1-ETO fusion to transcriptional activtion
N00109  PML-RARA fusion to transcriptional activtion
N00110  PLZF-RARA fusion to transcriptional activtion
N01758  Desmosome - Vimentin filaments
N01922  Localization of envoplakin and periplakin to the plasma membrane (PM)
N02008  Desmosome maturation
N02009  Desmosomal cadherin to Wint signaling pathway
Disease
H00293  Arrhythmogenic right ventricular cardiomyopathy
H00669  Naxos disease
Brite
KEGG Orthology (KO) [BR:hsa00001]
 09130 Environmental Information Processing
  09133 Signaling molecules and interaction
   04519 Cadherin signaling
    3728 (JUP)
 09140 Cellular Processes
  09142 Cell motility
   04820 Cytoskeleton in muscle cells
    3728 (JUP)
 09150 Organismal Systems
  09158 Development and regeneration
   04382 Cornified envelope formation
    3728 (JUP)
 09160 Human Diseases
  09161 Cancer: overview
   05200 Pathways in cancer
    3728 (JUP)
   05202 Transcriptional misregulation in cancer
    3728 (JUP)
  09162 Cancer: specific types
   05226 Gastric cancer
    3728 (JUP)
   05221 Acute myeloid leukemia
    3728 (JUP)
  09166 Cardiovascular disease
   05412 Arrhythmogenic right ventricular cardiomyopathy
    3728 (JUP)
 09180 Brite Hierarchies
  09183 Protein families: signaling and cellular processes
   04147 Exosome [BR:hsa04147]
    3728 (JUP)
Exosome [BR:hsa04147]
 Exosomal proteins
  Exosomal proteins of other body fluids (saliva and urine)
   3728 (JUP)
SSDB
Motif
Pfam: Arm ARM_ARMC5 WRM1_C ARM_PUB HEAT ARM_GAC_2 BAR1_C V-ATPase_H_N Cnd1 ARMC9_ARM HEAT_2 Adaptin_N ELMO_ARM Atx10homo_assoc HEAT_EF3_N
Other DBs
NCBI-GeneID: 3728
NCBI-ProteinID: NP_001339702
OMIM: 173325
HGNC: 6207
UniProt: P14923 A0A0S2Z487
Structure
LinkDB
Position
17:complement(41754609..41786711)
AA seq 745 aa
MEVMNLMEQPIKVTEWQQTYTYDSGIHSGANTCVPSVSSKGIMEEDEACGRQYTLKKTTT
YTQGVPPSQGDLEYQMSTTARAKRVREAMCPGVSGEDSSLLLATQVEGQATNLQRLAEPS
QLLKSAIVHLINYQDDAELATRALPELTKLLNDEDPVVVTKAAMIVNQLSKKEASRRALM
GSPQLVAAVVRTMQNTSDLDTARCTTSILHNLSHHREGLLAIFKSGGIPALVRMLSSPVE
SVLFYAITTLHNLLLYQEGAKMAVRLADGLQKMVPLLNKNNPKFLAITTDCLQLLAYGNQ
ESKLIILANGGPQALVQIMRNYSYEKLLWTTSRVLKVLSVCPSNKPAIVEAGGMQALGKH
LTSNSPRLVQNCLWTLRNLSDVATKQEGLESVLKILVNQLSVDDVNVLTCATGTLSNLTC
NNSKNKTLVTQNSGVEALIHAILRAGDKDDITEPAVCALRHLTSRHPEAEMAQNSVRLNY
GIPAIVKLLNQPNQWPLVKATIGLIRNLALCPANHAPLQEAAVIPRLVQLLVKAHQDAQR
HVAAGTQQPYTDGVRMEEIVEGCTGALHILARDPMNRMEIFRLNTIPLFVQLLYSSVENI
QRVAAGVLCELAQDKEAADAIDAEGASAPLMELLHSRNEGTATYAAAVLFRISEDKNPDY
RKRVSVELTNSLFKHDPAAWEAAQSMIPINEPYGDDMDATYRPMYSSDVPLDPLEMHMDM
DGDYPIDTYSDGLRPPYPTADHMLA
NT seq 2238 nt   +upstreamnt  +downstreamnt
atggaggtgatgaacctgatggagcagcctatcaaggtgactgagtggcagcagacatac
acctacgactcgggtatccactcgggcgccaacacctgcgtgccctccgtcagcagcaag
ggcatcatggaggaggatgaggcctgcgggcgccagtacacgctcaagaaaaccaccact
tacacccagggggtgccccccagccaaggtgatctggagtaccagatgtccacaacagcc
agggccaaacgggtgcgggaggccatgtgccctggtgtgtcaggcgaggacagctcgctt
ctgctggccacccaggtggaggggcaggccaccaacctgcagcgactggccgagccgtcc
cagctgctcaagtcggccattgtgcatctcatcaactaccaggacgatgccgagctggcc
actcgcgccctgcccgagctcaccaaactgctcaacgacgaggacccggtggtggtgacc
aaggcggccatgattgtgaaccagctgtcgaagaaggaggcgtcgcggcgggccctgatg
ggctcgccccagctggtggccgctgtcgtgcgtaccatgcagaataccagcgacctggac
acagcccgctgcaccaccagcatcctgcacaacctctcccaccaccgggaggggctgctc
gccatcttcaagtcgggtggcatccctgctctggtccgcatgctcagctcccctgtggag
tcggtcctgttctatgccatcaccacgctgcacaacctgctcctgtaccaggagggcgcc
aagatggccgtgcgcctggccgacgggctgcaaaagatggtgcccctgctcaacaagaac
aaccccaagttcctggccatcaccaccgactgcctgcagctcctggcctacggcaaccag
gagagcaagctgatcatcctggccaatggtgggccccaggccctcgtgcagatcatgcgt
aactacagttatgaaaagctgctctggaccaccagtcgtgtgctcaaggtgctatccgtg
tgtcccagcaataagcctgccattgtggaggctggtgggatgcaggccctgggcaagcac
ctgaccagcaacagcccccgcctggtgcagaactgcctgtggaccctgcgcaacctctca
gatgtggccaccaagcaggagggcctggagagtgtgctgaagattctggtgaatcagctg
agtgtggatgacgtcaacgtcctcacctgtgccacgggcacactctccaacctgacatgc
aacaacagcaagaacaagacgctggtgacacagaacagcggtgtggaggctctcatccat
gccatcctgcgtgctggtgacaaggacgacatcacggagcctgccgtctgcgctctgcgc
cacctcactagccgccaccctgaggccgagatggcccagaactctgtgcgtctcaactat
ggcatcccagccatcgtgaagctgctcaaccagcccaaccagtggccactggtcaaggca
accatcggcttgatcaggaatctggccctgtgcccagccaaccatgccccgctgcaggag
gcagcggtcatcccccgcctcgtccaactgctggtgaaggcccaccaggatgcccagcgc
cacgtagctgcaggcacacagcagccctacacggatggtgtgaggatggaggagattgtg
gagggctgcaccggagcactgcacatcctcgcccgggaccccatgaaccgcatggagatc
ttccggctcaacaccattcccctgtttgtgcagctcctgtactcgtcggtggagaacatc
cagcgcgtggctgccggggtgctgtgtgagctggcccaggacaaggaggcggccgacgcc
attgatgcagagggggcctcggccccactcatggagttgctgcactcccgcaacgagggc
actgccacctacgctgctgccgtcctgttccgcatctccgaggacaagaacccagactac
cggaagcgcgtgtccgtggagctcaccaactccctcttcaagcatgacccggctgcctgg
gaggctgcccagagcatgattcccatcaatgagccctatggagatgacatggatgccacc
taccgccccatgtactccagcgatgtgccccttgacccgctggagatgcacatggacatg
gatggagactaccccatcgacacctacagcgacggcctcaggcccccgtaccccactgca
gaccacatgctggcctag

KEGG   Homo sapiens (human): 5317
Entry
5317              CDS       T01001                                 
Symbol
PKP1, B6P, EDSFS
Name
(RefSeq) plakophilin-1 isoform 1b
  KO
K10387  plakophilin 1
Organism
hsa  Homo sapiens (human)
Pathway
hsa04382  Cornified envelope formation
hsa04519  Cadherin signaling
Network
nt06545  Cornified envelope formation
nt06549  Cadherin signaling
  Element
N01922  Localization of envoplakin and periplakin to the plasma membrane (PM)
N02008  Desmosome maturation
Disease
H00644  Ectodermal dysplasia/skin fragility syndrome
Brite
KEGG Orthology (KO) [BR:hsa00001]
 09130 Environmental Information Processing
  09133 Signaling molecules and interaction
   04519 Cadherin signaling
    5317 (PKP1)
 09150 Organismal Systems
  09158 Development and regeneration
   04382 Cornified envelope formation
    5317 (PKP1)
 09180 Brite Hierarchies
  09183 Protein families: signaling and cellular processes
   04812 Cytoskeleton proteins [BR:hsa04812]
    5317 (PKP1)
Cytoskeleton proteins [BR:hsa04812]
 Eukaryotic cytoskeleton proteins
  Intermediate filaments
   Intermediate filament-binding proteins
    5317 (PKP1)
SSDB
Motif
Pfam: Arm ARM_ARMC5 HEAT_EZ HEAT V-ATPase_H_C ARM_GAC_2 HEAT_GCN1 Arm_2 UTP20_C SYS1_M ARMC9_ARM
Other DBs
NCBI-GeneID: 5317
NCBI-ProteinID: NP_000290
OMIM: 601975
HGNC: 9023
UniProt: Q13835
Structure
LinkDB
Position
1:201283506..201332989
AA seq 747 aa
MNHSPLKTALAYECFQDQDNSTLALPSDQKMKTGTSGRQRVQEQVMMTVKRQKSKSSQSS
TLSHSNRGSMYDGLADNYNYGTTSRSSYYSKFQAGNGSWGYPIYNGTLKREPDNRRFSSY
SQMENWSRHYPRGSCNTTGAGSDICFMQKIKASRSEPDLYCDPRGTLRKGTLGSKGQKTT
QNRYSFYSTCSGQKAIKKCPVRPPSCASKQDPVYIPPISCNKDLSFGHSRASSKICSEDI
ECSGLTIPKAVQYLSSQDEKYQAIGAYYIQHTCFQDESAKQQVYQLGGICKLVDLLRSPN
QNVQQAAAGALRNLVFRSTTNKLETRRQNGIREAVSLLRRTGNAEIQKQLTGLLWNLSST
DELKEELIADALPVLADRVIIPFSGWCDGNSNMSREVVDPEVFFNATGCLRKRLGMRELL
ALVPQRATSSRVNLSSADAGRQTMRNYSGLIDSLMAYVQNCVAASRCDDKSVENCMCVLH
NLSYRLDAEVPTRYRQLEYNARNAYTEKSSTGCFSNKSDKMMNNNYDCPLPEEETNPKGS
GWLYHSDAIRTYLNLMGKSKKDATLEACAGALQNLTASKGLMSSGMSQLIGLKEKGLPQI
ARLLQSGNSDVVRSGASLLSNMSRHPLLHRVMGNQVFPEVTRLLTSHTGNTSNSEDILSS
ACYTVRNLMASQPQLAKQYFSSSMLNNIINLCRSSASPKAAEAARLLLSDMWSSKELQGV
LRQQGFDRNMLGTLAGANSLRNFTSRF
NT seq 2244 nt   +upstreamnt  +downstreamnt
atgaaccactcgccgctcaagaccgccttggcgtacgaatgcttccaggaccaggacaac
tccacgttggctttgccgtcggaccaaaagatgaaaacaggcacgtctggcaggcagcgc
gtgcaggagcaggtgatgatgaccgtcaagcggcagaagtccaagtcttcccagtcgtcc
accctgagccactccaatcgaggttccatgtatgatggcttggctgacaattacaactat
gggaccaccagcaggagcagctactactccaagttccaggcagggaatggctcatgggga
tatccgatctacaatggaaccctcaagcgggagcctgacaacaggcgcttcagctcctac
agccagatggagaactggagccggcactacccccggggcagctgtaacaccaccggcgca
ggcagcgacatctgcttcatgcagaaaatcaaggcgagccgcagtgagcccgacctctac
tgtgacccacggggcaccctgcgcaagggcacgctgggcagcaagggccagaagaccacc
cagaaccgctacagcttttacagcacctgcagtggtcagaaggccataaagaagtgccct
gtgcgcccgccctcttgtgcctccaagcaggaccctgtgtatatcccgcccatctcctgc
aacaaggacctgtcctttggccactctagggccagctccaagatctgcagtgaggacatc
gagtgcagtgggctgaccatccccaaggctgtgcagtacctgagctcccaggatgagaag
taccaggccattggggcctattacatccagcatacctgcttccaggatgaatctgccaag
caacaggtctatcagctgggaggcatctgcaagctggtggacctcctccgcagccccaac
cagaacgtccagcaggccgcggcaggggccctgcgcaacctggtgttcaggagcaccacc
aacaagctggagacccggaggcagaatgggatccgcgaggcagtcagcctcctgaggaga
accgggaacgccgagatccagaagcagctgactgggctgctctggaacctgtcttccact
gacgagctgaaggaggaactcattgccgacgccctgcctgttctggccgaccgcgtcatc
attcccttctctggctggtgcgatggcaatagcaacatgtcccgggaagtggtggaccct
gaggtcttcttcaatgccacaggctgcttgagaaagagactgggcatgcgggagcttctg
gctcttgttccgcaaagggccactagtagcagggtgaacctgagctcggccgatgcaggc
cgccagaccatgcgtaactactcagggctcattgattccctcatggcctatgtccagaac
tgtgtagcggccagccgctgtgacgacaagtctgtggaaaactgcatgtgtgttctgcac
aacctctcctaccgcctggacgccgaggtgcccacccgctaccgccagctggagtataac
gcccgcaacgcctacaccgagaagtcctccactggctgcttcagcaacaagagcgacaag
atgatgaacaacaactatgactgccccctgcctgaggaagagaccaaccccaagggcagc
ggctggttgtaccattcagatgccatccgcacctacctgaacctcatgggcaagagcaag
aaagatgctaccctggaggcctgtgctggtgccctgcagaacctgacagccagcaagggg
ctgatgtccagtggcatgagccagttgattgggctgaaggaaaagggcctgccacaaatt
gcccgcctcctgcaatctggcaactctgatgtggtgcggtccggagcctccctcctgagc
aacatgtcccgccaccctctgctgcacagagtgatggggaaccaggtgttcccggaggtg
accaggctcctcaccagccacactggcaataccagcaactccgaagacatcttgtcctcg
gcctgctacactgtgaggaacctgatggcctcgcagccacaactggccaagcagtacttc
tccagcagcatgctcaacaacatcatcaacctgtgccgaagcagtgcctcacccaaggcc
gcagaagctgcccggcttctcctgtctgacatgtggtccagcaaggaactgcagggtgtc
ctcagacagcaaggtttcgataggaacatgctgggaaccttagctggggccaacagcctc
aggaacttcacctcccgattctaa

KEGG   Homo sapiens (human): 5318
Entry
5318              CDS       T01001                                 
Symbol
PKP2, ARVD9
Name
(RefSeq) plakophilin-2 isoform 2b
  KO
K12642  plakophilin 2
Organism
hsa  Homo sapiens (human)
Pathway
hsa04382  Cornified envelope formation
hsa04519  Cadherin signaling
hsa04820  Cytoskeleton in muscle cells
hsa05412  Arrhythmogenic right ventricular cardiomyopathy
Network
nt06539  Cytoskeleton in muscle cells
nt06545  Cornified envelope formation
nt06549  Cadherin signaling
  Element
N01758  Desmosome - Vimentin filaments
N01922  Localization of envoplakin and periplakin to the plasma membrane (PM)
N02008  Desmosome maturation
Disease
H00293  Arrhythmogenic right ventricular cardiomyopathy
Brite
KEGG Orthology (KO) [BR:hsa00001]
 09130 Environmental Information Processing
  09133 Signaling molecules and interaction
   04519 Cadherin signaling
    5318 (PKP2)
 09140 Cellular Processes
  09142 Cell motility
   04820 Cytoskeleton in muscle cells
    5318 (PKP2)
 09150 Organismal Systems
  09158 Development and regeneration
   04382 Cornified envelope formation
    5318 (PKP2)
 09160 Human Diseases
  09166 Cardiovascular disease
   05412 Arrhythmogenic right ventricular cardiomyopathy
    5318 (PKP2)
SSDB
Motif
Pfam: Arm ARM_ARMC5 ARMC9_ARM SelP_C
Other DBs
NCBI-GeneID: 5318
NCBI-ProteinID: NP_004563
OMIM: 602861
HGNC: 9024
UniProt: Q99959
Structure
LinkDB
Position
12:complement(32790755..32896777)
AA seq 881 aa
MAAPGAPAEYGYIRTVLGQQILGQLDSSSLALPSEAKLKLAGSSGRGGQTVKSLRIQEQV
QQTLARKGRSSVGNGNLHRTSSVPEYVYNLHLVENDFVGGRSPVPKTYDMLKAGTTATYE
GRWGRGTAQYSSQKSVEERSLRHPLRRLEISPDSSPERAHYTHSDYQYSQRSQAGHTLHH
QESRRAALLVPPRYARSEIVGVSRAGTTSRQRHFDTYHRQYQHGSVSDTVFDSIPANPAL
LTYPRPGTSRSMGNLLEKENYLTAGLTVGQVRPLVPLQPVTQNRASRSSWHQSSFHSTRT
LREAGPSVAVDSSGRRAHLTVGQAAAGGSGNLLTERSTFTDSQLGNADMEMTLERAVSML
EADHMLPSRISAAATFIQHECFQKSEARKRVNQLRGILKLLQLLKVQNEDVQRAVCGALR
NLVFEDNDNKLEVAELNGVPRLLQVLKQTRDLETKKQITDHTVNLRSRNGWPGAVAHACN
PSTLGGQGGRITRSGVRDQPDQHGLLWNLSSNDKLKNLMITEALLTLTENIIIPFSGWPE
GDYPKANGLLDFDIFYNVTGCLRNMSSAGADGRKAMRRCDGLIDSLVHYVRGTIADYQPD
DKATENCVCILHNLSYQLEAELPEKYSQNIYIQNRNIQTDNNKSIGCFGSRSRKVKEQYQ
DVPMPEEKSNPKGVEWLWHSIVIRMYLSLIAKSVRNYTQEASLGALQNLTAGSGPMPTSV
AQTVVQKESGLQHTRKMLHVGDPSVKKTAISLLRNLSRNLSLQNEIAKETLPDLVSIIPD
TVPSTDLLIETTASACYTLNNIIQNSYQNARDLLNTGGIQKIMAISAGDAYASNKASKAA
SVLLYSLWAHTELHHAYKKAQFKKTDFVNSRTAKAYHSLKD
NT seq 2646 nt   +upstreamnt  +downstreamnt
atggcagcccccggcgccccagctgagtacggctacatccggaccgtcctgggccagcag
atcctgggacaactggacagctccagcctggcgctgccctccgaggccaagctgaagctg
gcggggagcagcggccgcggcggccagacagtcaagagcctgcggatccaggagcaggtg
cagcagaccctcgcccggaagggccgcagctccgtgggcaacggaaatcttcaccgaacc
agcagtgttcctgagtatgtctacaacctacacttggttgaaaatgattttgttggaggc
cgttcccctgttcctaaaacctatgacatgctaaaggctggcacaactgccacttatgaa
ggtcgctggggaagaggaacagcacagtacagctcccagaagtccgtggaagaaaggtcc
ttgaggcatcctctgaggagactggagatttctcctgacagcagcccggagagggctcac
tacacgcacagcgattaccagtacagccagagaagccaggctgggcacaccctgcaccac
caagaaagcaggcgggccgccctcctagtgccaccgagatatgctcgttccgagatcgtg
ggggtcagccgtgctggcaccacaagcaggcagcgccactttgacacataccacagacag
taccagcatggctctgttagcgacaccgtttttgacagcatccctgccaacccggccctg
ctcacgtaccccaggccagggaccagccgcagcatgggcaacctcttggagaaggagaac
tacctgacggcagggctcactgtcgggcaggtcaggccgctggtgcccctgcagcccgtc
actcagaacagggcttccaggtcctcctggcatcagagctccttccacagcacccgcacg
ctgagggaagctgggcccagtgtcgccgtggattccagcgggaggagagcgcacttgact
gtcggccaggcggccgcagggggaagtgggaatctgctcactgagagaagcactttcact
gactcccagctggggaatgcagacatggagatgactctggagcgagcagtgagtatgctc
gaggcagaccacatgctgccatccaggatttctgctgcagctactttcatacagcacgag
tgcttccagaaatctgaagctcggaagagggttaaccagcttcgtggcatcctcaagctt
ctgcagctcctaaaagttcagaatgaagacgttcagcgagctgtgtgtggggccttgaga
aacttagtatttgaagacaatgacaacaaattggaggtggctgaactaaatggggtacct
cggctgctccaggtgctgaagcaaaccagagacttggagactaaaaaacaaataacagac
catacagtcaatttaagaagtaggaatggctggccgggcgcggtggctcacgcctgtaat
cccagcactttgggaggccaaggcgggcggatcacgaggtcaggagttcgagaccagcct
gaccaacatggtttgctgtggaatttgtcatctaatgacaaactcaagaatctcatgata
acagaagcattgcttacgctgacggagaatatcatcatccccttttctgggtggcctgaa
ggagactacccaaaagcaaatggtttgctcgattttgacatattctacaacgtcactgga
tgcctaagaaacatgagttctgctggcgctgatgggagaaaagcgatgagaagatgtgac
ggactcattgactcactggtccattatgtcagaggaaccattgcagattaccagccagat
gacaaggccacggagaattgtgtgtgcattcttcataacctctcctaccagctggaggca
gagctcccagagaaatattcccagaatatctatattcaaaaccggaatatccagactgac
aacaacaaaagtattggatgttttggcagtcgaagcaggaaagtaaaagagcaataccag
gacgtgccgatgccggaggaaaagagcaaccccaagggcgtggagtggctgtggcattcc
attgttataaggatgtatctgtccttgatcgccaaaagtgtccgcaactacacacaagaa
gcatccttaggagctctgcagaacctcacggccggaagtggaccaatgccgacatcagtg
gctcagacagttgtccagaaggaaagtggcctgcagcacacccgaaagatgctgcatgtt
ggtgacccaagtgtgaaaaagacagccatctcgctgctgaggaatctgtcccggaatctt
tctctgcagaatgaaattgccaaagaaactctccctgatttggtttccatcattcctgac
acagtcccgagtactgaccttctcattgaaactacagcctctgcctgttacacattgaac
aacataatccaaaacagttaccagaatgcacgcgaccttctaaacaccgggggcatccag
aaaattatggccattagtgcaggcgatgcctatgcctccaacaaagcaagtaaagctgct
tccgtccttctgtattctctgtgggcacacacggaactgcatcatgcctacaagaaggct
cagtttaagaagacagattttgtcaacagccggactgccaaagcctaccactcccttaaa
gactga

KEGG   Homo sapiens (human): 1832
Entry
1832              CDS       T01001                                 
Symbol
DSP, DCWHKTA, DP
Name
(RefSeq) desmoplakin isoform I
  KO
K10381  desmoplakin
Organism
hsa  Homo sapiens (human)
Pathway
hsa04382  Cornified envelope formation
hsa04519  Cadherin signaling
hsa04820  Cytoskeleton in muscle cells
hsa05412  Arrhythmogenic right ventricular cardiomyopathy
Network
nt06539  Cytoskeleton in muscle cells
nt06545  Cornified envelope formation
nt06549  Cadherin signaling
  Element
N01758  Desmosome - Vimentin filaments
N01922  Localization of envoplakin and periplakin to the plasma membrane (PM)
N02008  Desmosome maturation
Disease
H00293  Arrhythmogenic right ventricular cardiomyopathy
H00717  Striate palmoplantar keratoderma
H00893  Dilated cardiomyopathy with woolly hair, keratoderma, and tooth agenesis
H01737  Epidermolysis bullosa
H02094  Carvajal syndrome
Brite
KEGG Orthology (KO) [BR:hsa00001]
 09130 Environmental Information Processing
  09133 Signaling molecules and interaction
   04519 Cadherin signaling
    1832 (DSP)
 09140 Cellular Processes
  09142 Cell motility
   04820 Cytoskeleton in muscle cells
    1832 (DSP)
 09150 Organismal Systems
  09158 Development and regeneration
   04382 Cornified envelope formation
    1832 (DSP)
 09160 Human Diseases
  09166 Cardiovascular disease
   05412 Arrhythmogenic right ventricular cardiomyopathy
    1832 (DSP)
 09180 Brite Hierarchies
  09183 Protein families: signaling and cellular processes
   04812 Cytoskeleton proteins [BR:hsa04812]
    1832 (DSP)
   04147 Exosome [BR:hsa04147]
    1832 (DSP)
Cytoskeleton proteins [BR:hsa04812]
 Eukaryotic cytoskeleton proteins
  Intermediate filaments
   Intermediate filament-binding proteins
    1832 (DSP)
Exosome [BR:hsa04147]
 Exosomal proteins
  Exosomal proteins of other body fluids (saliva and urine)
   1832 (DSP)
SSDB
Motif
Pfam: Plectin SR_desmoplakin_3 Spectrin_2 Spectrin_3 SH3_10 KH_YLL032C_3rd ERM_helical CCDC39 Fez1
Other DBs
NCBI-GeneID: 1832
NCBI-ProteinID: NP_004406
OMIM: 125647
HGNC: 3052
Ensembl: ENSP00000369129.3
UniProt: P15924 B4DKX6
Structure
LinkDB
Position
6:7541671..7586714
AA seq 2871 aa
MSCNGGSHPRINTLGRMIRAESGPDLRYEVTSGGGGTSRMYYSRRGVITDQNSDGYCQTG
TMSRHQNQNTIQELLQNCSDCLMRAELIVQPELKYGDGIQLTRSRELDECFAQANDQMEI
LDSLIREMRQMGQPCDAYQKRLLQLQEQMRALYKAISVPRVRRASSKGGGGYTCQSGSGW
DEFTKHVTSECLGWMRQQRAEMDMVAWGVDLASVEQHINSHRGIHNSIGDYRWQLDKIKA
DLREKSAIYQLEEEYENLLKASFERMDHLRQLQNIIQATSREIMWINDCEEEELLYDWSD
KNTNIAQKQEAFSIRMSQLEVKEKELNKLKQESDQLVLNQHPASDKIEAYMDTLQTQWSW
ILQITKCIDVHLKENAAYFQFFEEAQSTEAYLKGLQDSIRKKYPCDKNMPLQHLLEQIKE
LEKEREKILEYKRQVQNLVNKSKKIVQLKPRNPDYRSNKPIILRALCDYKQDQKIVHKGD
ECILKDNNERSKWYVTGPGGVDMLVPSVGLIIPPPNPLAVDLSCKIEQYYEAILALWNQL
YINMKSLVSWHYCMIDIEKIRAMTIAKLKTMRQEDYMKTIADLELHYQEFIRNSQGSEMF
GDDDKRKIQSQFTDAQKHYQTLVIQLPGYPQHQTVTTTEITHHGTCQDVNHNKVIETNRE
NDKQETWMLMELQKIRRQIEHCEGRMTLKNLPLADQGSSHHITVKINELKSVQNDSQAIA
EVLNQLKDMLANFRGSEKYCYLQNEVFGLFQKLENINGVTDGYLNSLCTVRALLQAILQT
EDMLKVYEARLTEEETVCLDLDKVEAYRCGLKKIKNDLNLKKSLLATMKTELQKAQQIHS
QTSQQYPLYDLDLGKFGEKVTQLTDRWQRIDKQIDFRLWDLEKQIKQLRNYRDNYQAFCK
WLYDAKRRQDSLESMKFGDSNTVMRFLNEQKNLHSEISGKRDKSEEVQKIAELCANSIKD
YELQLASYTSGLETLLNIPIKRTMIQSPSGVILQEAADVHARYIELLTRSGDYYRFLSEM
LKSLEDLKLKNTKIEVLEEELRLARDANSENCNKNKFLDQNLQKYQAECSQFKAKLASLE
ELKRQAELDGKSAKQNLDKCYGQIKELNEKITRLTYEIEDEKRRRKSVEDRFDQQKNDYD
QLQKARQCEKENLGWQKLESEKAIKEKEYEIERLRVLLQEEGTRKREYENELAKVRNHYN
EEMSNLRNKYETEINITKTTIKEISMQKEDDSKNLRNQLDRLSRENRDLKDEIVRLNDSI
LQATEQRRRAEENALQQKACGSEIMQKKQHLEIELKQVMQQRSEDNARHKQSLEEAAKTI
QDKNKEIERLKAEFQEEAKRRWEYENELSKVRNNYDEEIISLKNQFETEINITKTTIHQL
TMQKEEDTSGYRAQIDNLTRENRSLSEEIKRLKNTLTQTTENLRRVEEDIQQQKATGSEV
SQRKQQLEVELRQVTQMRTEESVRYKQSLDDAAKTIQDKNKEIERLKQLIDKETNDRKCL
EDENARLQRVQYDLQKANSSATETINKLKVQEQELTRLRIDYERVSQERTVKDQDITRFQ
NSLKELQLQKQKVEEELNRLKRTASEDSCKRKKLEEELEGMRRSLKEQAIKITNLTQQLE
QASIVKKRSEDDLRQQRDVLDGHLREKQRTQEELRRLSSEVEALRRQLLQEQESVKQAHL
RNEHFQKAIEDKSRSLNESKIEIERLQSLTENLTKEHLMLEEELRNLRLEYDDLRRGRSE
ADSDKNATILELRSQLQISNNRTLELQGLINDLQRERENLRQEIEKFQKQALEASNRIQE
SKNQCTQVVQERESLLVKIKVLEQDKARLQRLEDELNRAKSTLEAETRVKQRLECEKQQI
QNDLNQWKTQYSRKEEAIRKIESEREKSEREKNSLRSEIERLQAEIKRIEERCRRKLEDS
TRETQSQLETERSRYQREIDKLRQRPYGSHRETQTECEWTVDTSKLVFDGLRKKVTAMQL
YECQLIDKTTLDKLLKGKKSVEEVASEIQPFLRGAGSIAGASASPKEKYSLVEAKRKKLI
SPESTVMLLEAQAATGGIIDPHRNEKLTVDSAIARDLIDFDDRQQIYAAEKAITGFDDPF
SGKTVSVSEAIKKNLIDRETGMRLLEAQIASGGVVDPVNSVFLPKDVALARGLIDRDLYR
SLNDPRDSQKNFVDPVTKKKVSYVQLKERCRIEPHTGLLLLSVQKRSMSFQGIRQPVTVT
ELVDSGILRPSTVNELESGQISYDEVGERIKDFLQGSSCIAGIYNETTKQKLGIYEAMKI
GLVRPGTALELLEAQAATGFIVDPVSNLRLPVEEAYKRGLVGIEFKEKLLSAERAVTGYN
DPETGNIISLFQAMNKELIEKGHGIRLLEAQIATGGIIDPKESHRLPVDIAYKRGYFNEE
LSEILSDPSDDTKGFFDPNTEENLTYLQLKERCIKDEETGLCLLPLKEKKKQVQTSQKNT
LRKRRVVIVDPETNKEMSVQEAYKKGLIDYETFKELCEQECEWEEITITGSDGSTRVVLV
DRKTGSQYDIQDAIDKGLVDRKFFDQYRSGSLSLTQFADMISLKNGVGTSSSMGSGVSDD
VFSSSRHESVSKISTISSVRNLTIRSSSFSDTLEESSPIAAIFDTENLEKISITEGIERG
IVDSITGQRLLEAQACTGGIIHPTTGQKLSLQDAVSQGVIDQDMATRLKPAQKAFIGFEG
VKGKKKMSAAEAVKEKWLPYEAGQRFLEFQYLTGGLVDPEVHGRISTEEAIRKGFIDGRA
AQRLQDTSSYAKILTCPKTKLKISYKDAINRSMVEDITGLRLLEAASVSSKGLPSPYNMS
SAPGSRSGSRSGSRSGSRSGSRSGSRRGSFDATGNSSYSYSYSFSSSSIGH
NT seq 8616 nt   +upstreamnt  +downstreamnt
atgagctgcaacggaggctcccacccgcggatcaacactctgggccgcatgatccgcgcc
gagtctggcccggacctgcgctacgaggtgaccagcggcggcgggggcaccagcaggatg
tactattctcggcgcggcgtgatcaccgaccagaactcggacggctactgtcaaaccggc
acgatgtccaggcaccagaaccagaacaccatccaggagctgctgcagaactgctccgac
tgcttgatgcgagcagagctcatcgtgcagcctgaattgaagtatggagatggaatacaa
ctgactcggagtcgagaattggatgagtgttttgcccaggccaatgaccaaatggaaatc
ctcgacagcttgatcagagagatgcggcagatgggccagccctgtgatgcttaccagaaa
aggcttcttcagctccaagagcaaatgcgagccctttataaagccatcagtgtccctcga
gtccgcagggccagctccaagggtggtggaggctacacttgtcagagtggctctggctgg
gatgagttcaccaaacatgtcaccagtgaatgtttggggtggatgaggcagcaaagggcg
gagatggacatggtggcctggggtgtggacctggcctcagtggagcagcacattaacagc
caccggggcatccacaactccatcggcgactatcgctggcagctggacaaaatcaaagcc
gacctgcgcgagaaatctgcgatctaccagttggaggaggagtatgaaaacctgctgaaa
gcgtcctttgagaggatggatcacctgcgacagctgcagaacatcattcaggccacgtcc
agggagatcatgtggatcaatgactgcgaggaggaggagctgctgtacgactggagcgac
aagaacaccaacatcgctcagaaacaggaggccttctccatacgcatgagtcaactggaa
gttaaagaaaaagagctcaataagctgaaacaagaaagtgaccaacttgtcctcaatcag
catccagcttcagacaaaattgaggcctatatggacactctgcagacgcagtggagttgg
attcttcagatcaccaagtgcattgatgttcatctgaaagaaaatgctgcctactttcag
ttttttgaagaggcgcagtctactgaagcatacctgaaggggctccaggactccatcagg
aagaagtacccctgcgacaagaacatgcccctgcagcacctgctggaacagatcaaggag
ctggagaaagaacgagagaaaatccttgaatacaagcgtcaggtgcagaacttggtaaac
aagtctaagaagattgtacagctgaagcctcgtaacccagactacagaagcaataaaccc
attattctcagagctctctgtgactacaaacaagatcagaaaatcgtgcataagggggat
gagtgtatcctgaaggacaacaacgagcgcagcaagtggtacgtgacgggcccgggaggc
gttgacatgcttgttccctctgtggggctgatcatccctcctccgaacccactggccgtg
gacctctcttgcaagattgagcagtactacgaagccatcttggctctgtggaaccagctc
tacatcaacatgaagagcctggtgtcctggcactactgcatgattgacatagagaagatc
agggccatgacaatcgccaagctgaaaacaatgcggcaggaagattacatgaagacgata
gccgaccttgagttacattaccaagagttcatcagaaatagccaaggctcagagatgttt
ggagatgatgacaagcggaaaatacagtctcagttcaccgatgcccagaagcattaccag
accctggtcattcagctccctggctatccccagcaccagacagtgaccacaactgaaatc
actcatcatggaacctgccaagatgtcaaccataataaagtaattgaaaccaacagagaa
aatgacaagcaagaaacatggatgctgatggagctgcagaagattcgcaggcagatagag
cactgcgagggcaggatgactctcaaaaacctccctctagcagaccagggatcttctcac
cacatcacagtgaaaattaacgagcttaagagtgtgcagaatgattcacaagcaattgct
gaggttctcaaccagcttaaagatatgcttgccaacttcagaggttctgaaaagtactgc
tatttacagaatgaagtatttggactatttcagaaactggaaaatatcaatggtgttaca
gatggctacttaaatagcttatgcacagtaagggcactgctccaggctattctccaaaca
gaagacatgttaaaggtttatgaagccaggctcactgaggaggaaactgtctgcctggac
ctggataaagtggaagcttaccgctgtggactgaagaaaataaaaaatgacttgaacttg
aagaagtcgttgttggccactatgaagacagaactacagaaagcccagcagatccactct
cagacttcacagcagtatccactttatgatctggacttgggcaagttcggtgaaaaagtc
acacagctgacagaccgctggcaaaggatagataaacagatcgactttaggttatgggac
ctggagaaacaaatcaagcaattgaggaattatcgtgataactatcaggctttctgcaag
tggctctatgatgctaaacgccgccaggattccttagaatccatgaaatttggagattcc
aacacagtcatgcggtttttgaatgagcagaagaacttgcacagtgaaatatctggcaaa
cgagacaaatcagaggaagtacaaaaaattgctgaactttgcgccaattcaattaaggat
tatgagctccagctggcctcatacacctcaggactggaaactctgctgaacatacctatc
aagaggaccatgattcagtccccttctggggtgattctgcaagaggctgcagatgttcat
gctcggtacattgaactacttacaagatctggagactattacaggttcttaagtgagatg
ctgaagagtttggaagatctgaagctgaaaaataccaagatcgaagttttggaagaggag
ctcagactggcccgagatgccaactcggaaaactgtaataagaacaaattcctggatcag
aacctgcagaaataccaggcagagtgttcccagttcaaagcgaagcttgcgagcctggag
gagctgaagagacaggctgagctggatgggaagtcggctaagcaaaatctagacaagtgc
tacggccaaataaaagaactcaatgagaagatcacccgactgacttatgagattgaagat
gaaaagagaagaagaaaatctgtggaagacagatttgaccaacagaagaatgactatgac
caactgcagaaagcaaggcaatgtgaaaaggagaaccttggttggcagaaattagagtct
gagaaagccatcaaggagaaggagtacgagattgaaaggttgagggttctactgcaggaa
gaaggcacccggaagagagaatatgaaaatgagctggcaaaggtaagaaaccactataat
gaggagatgagtaatttaaggaacaagtatgaaacagagattaacattacgaagaccacc
atcaaggagatatccatgcaaaaagaggatgattccaaaaatcttagaaaccagcttgat
agactttcaagggaaaatcgagatctgaaggatgaaattgtcaggctcaatgacagcatc
ttgcaggccactgagcagcgaaggcgagctgaagaaaacgcccttcagcaaaaggcctgt
ggctctgagataatgcagaagaagcagcatctggagatagaactgaagcaggtcatgcag
cagcgctctgaggacaatgcccggcacaagcagtccctggaggaggctgccaagaccatt
caggacaaaaataaggagatcgagagactcaaagctgagtttcaggaggaggccaagcgc
cgctgggaatatgaaaatgaactgagtaaggtaagaaacaattatgatgaggagatcatt
agcttaaaaaatcagtttgagaccgagatcaacatcaccaagaccaccatccaccagctc
accatgcagaaggaagaggataccagtggctaccgggctcagatagacaatctcacccga
gaaaacaggagcttatctgaagaaataaagaggctgaagaacactctaacccagaccaca
gagaatctcaggagggtggaagaagacatccaacagcaaaaggccactggctctgaggtg
tctcagaggaaacagcagctggaggttgagctgagacaagtcactcagatgcgaacagag
gagagcgtaagatataagcaatctcttgatgatgctgccaaaaccatccaggataaaaac
aaggagatagaaaggttaaaacaactgatcgacaaagaaacaaatgaccggaaatgcctg
gaagatgaaaacgcgagattacaaagggtccagtatgacctgcagaaagcaaacagtagt
gcgacggagacaataaacaaactgaaggttcaggagcaagaactgacacgcctgaggatc
gactatgaaagggtttcccaggagaggactgtgaaggaccaggatatcacgcggttccag
aactctctgaaagagctgcagctgcagaagcagaaggtggaagaggagctgaatcggctg
aagaggaccgcgtcagaagactcctgcaagaggaagaagctggaggaagagctggaaggc
atgaggaggtcgctgaaggagcaagccatcaaaatcaccaacctgacccagcagctggag
caggcatccattgttaagaagaggagtgaggatgacctccggcagcagagggacgtgctg
gatggccacctgagggaaaagcagaggacccaggaagagctgaggaggctctcttctgag
gtcgaggccctgaggcggcagttactccaggaacaggaaagtgtcaaacaagctcacttg
aggaatgagcatttccagaaggcgatagaagataaaagcagaagcttaaatgaaagcaaa
atagaaattgagaggctgcagtctctcacagagaacctgaccaaggagcacttgatgtta
gaagaagaactgcggaacctgaggctggagtacgatgacctgaggagaggacgaagcgaa
gcggacagtgataaaaatgcaaccatcttggaactaaggagccagctgcagatcagcaac
aaccggaccctggaactgcaggggctgattaatgatttacagagagagagggaaaatttg
agacaggaaattgagaaattccaaaagcaggctttagaggcatctaataggattcaggaa
tcaaagaatcagtgtactcaggtggtacaggaaagagagagccttctggtgaaaatcaaa
gtcctggagcaagacaaggcaaggctgcagaggctggaggatgagctgaatcgtgcaaaa
tcaactctagaggcagaaaccagggtgaaacagcgcctggagtgtgagaaacagcaaatt
cagaatgacctgaatcagtggaagactcaatattcccgcaaggaggaggctattaggaag
atagaatcggaaagagaaaagagtgagagagagaagaacagtcttaggagtgagatcgaa
agactccaagcagagatcaagagaattgaagagaggtgcaggcgtaagctggaggattct
accagggagacacagtcacagttagaaacagaacgctcccgatatcagagggagattgat
aaactcagacagcgcccatatgggtcccatcgagagacccagactgagtgtgagtggacc
gttgacacctccaagctggtgtttgatgggctgaggaagaaggtgacagcaatgcagctc
tatgagtgtcagctgatcgacaaaacaaccttggacaaactattgaaggggaagaagtca
gtggaagaagttgcttctgaaatccagccattccttcggggtgcaggatctatcgctgga
gcatctgcttctcctaaggaaaaatactctttggtagaggccaagagaaagaaattaatc
agcccagaatccacagtcatgcttctggaggcccaggcagctacaggtggtataattgat
ccccatcggaatgagaagctgactgtcgacagtgccatagctcgggacctcattgacttc
gatgaccgtcagcagatatatgcagcagaaaaagctatcactggttttgatgatccattt
tcaggcaagacagtatctgtttcagaagccatcaagaaaaatttgattgatagagaaacc
ggaatgcgcctgctggaagcccagattgcttcagggggtgtagtagaccctgtgaacagt
gtctttttgccaaaagatgtcgccttggcccgggggctgattgatagagatttgtatcga
tccctgaatgatccccgagatagtcagaaaaactttgtggatccagtcaccaaaaagaag
gtcagttacgtgcagctgaaggaacggtgcagaatcgaaccacatactggtctgctcttg
ctttcagtacagaagagaagcatgtccttccaaggaatcagacaacctgtgaccgtcact
gagctagtagattctggtatattgagaccgtccactgtcaatgaactggaatctggtcag
atttcttatgacgaggttggtgagagaattaaggacttcctccagggttcaagctgcata
gcaggcatatacaatgagaccacaaaacagaagcttggcatttatgaggccatgaaaatt
ggcttagtccgacctggtactgctctggagttgctggaagcccaagcagctactggcttt
atagtggatcctgttagcaacttgaggttaccagtggaggaagcctacaagagaggtctg
gtgggcattgagttcaaagagaagctcctgtctgcagaacgagctgtcactgggtataat
gatcctgaaacaggaaacatcatctctttgttccaagccatgaataaggaactcatcgaa
aagggccacggtattcgcttattagaagcacagatcgcaaccggggggatcattgaccca
aaggagagccatcgtttaccagttgacatagcatataagaggggctatttcaatgaggaa
ctcagtgagattctctcagatccaagtgatgataccaaaggattttttgaccccaacact
gaagaaaatcttacctatctgcaactaaaagaaagatgcattaaggatgaggaaacaggg
ctctgtcttctgcctctgaaagaaaagaagaaacaggtgcagacatcacaaaagaatacc
ctcaggaagcgtagagtggtcatagttgacccagaaaccaataaagaaatgtctgttcag
gaggcctacaagaagggcctaattgattatgaaaccttcaaagaactgtgtgagcaggaa
tgtgaatgggaagaaataaccatcacgggatcagatggctccaccagggtggtcctggta
gatagaaagacaggcagtcagtatgatattcaagatgctattgacaagggccttgttgac
aggaagttctttgatcagtaccgatccggcagcctcagcctcactcaatttgctgacatg
atctccttgaaaaatggtgtcggcaccagcagcagcatgggcagtggtgtcagcgatgat
gtttttagcagctcccgacatgaatcagtaagtaagatttccaccatatccagcgtcagg
aatttaaccataaggagcagctctttttcagacaccctggaagaatcgagccccattgca
gccatctttgacacagaaaacctggagaaaatctccattacagaaggtatagagcggggc
atcgttgacagcatcacgggtcagaggcttctggaggctcaggcctgcacaggtggcatc
atccacccaaccacgggccagaagctgtcacttcaggacgcagtctcccagggtgtgatt
gaccaagacatggccaccaggctgaagcctgctcagaaagccttcataggcttcgagggt
gtgaagggaaagaagaagatgtcagcagcagaggcagtgaaagaaaaatggctcccgtat
gaggctggccagcgcttcctggagttccagtacctcacgggaggtcttgttgacccggaa
gtgcatgggaggataagcaccgaagaagccatccggaaggggttcatagatggccgcgcc
gcacagaggctgcaagacaccagcagctatgccaaaatcctgacctgccccaaaaccaaa
ttaaaaatatcctataaggatgccataaatcgctccatggtagaagatatcactgggctg
cgccttctggaagccgcctccgtgtcgtccaagggcttacccagcccttacaacatgtct
tcggctccggggtcccgctccggctcccgctcgggatctcgctccggatctcgctccggg
tcccgcagtgggtcccggagaggaagctttgacgccacagggaattcttcctactcttat
tcctactcatttagcagtagttctattgggcactag

DBGET integrated database retrieval system