• Search Research Projects
  • Search Researchers
  • How to Use
  1. Back to previous page

高齢者を対象とした永続的に利用できるマルチモーダル対話システム基盤技術の構築

Research Project

Project/Area Number 23H00493
Research Category

Grant-in-Aid for Scientific Research (A)

Allocation TypeSingle-year Grants
Section一般
Review Section Medium-sized Section 61:Human informatics and related fields
Research InstitutionToyohashi University of Technology

Principal Investigator

北岡 教英  豊橋技術科学大学, 工学(系)研究科(研究院), 教授 (10333501)

Co-Investigator(Kenkyū-buntansha) 小林 彰夫  大和大学, 情報学部, 教授 (10741168)
山本 一公  中部大学, 工学部, 教授 (40324230)
西崎 博光  山梨大学, 大学院総合研究部, 教授 (40362082)
入部 百合絵  愛知県立大学, 情報科学部, 教授 (40397500)
西村 良太  豊橋技術科学大学, 工学(系)研究科(研究院), 准教授 (50635878)
太田 健吾  阿南工業高等専門学校, 創造技術工学科, 准教授 (80712801)
東中 竜一郎  名古屋大学, 情報学研究科, 教授 (90396151)
Project Period (FY) 2023-04-01 – 2027-03-31
Project Status Granted (Fiscal Year 2026)
Budget Amount *help
¥46,670,000 (Direct Cost: ¥35,900,000、Indirect Cost: ¥10,770,000)
Fiscal Year 2026: ¥9,880,000 (Direct Cost: ¥7,600,000、Indirect Cost: ¥2,280,000)
Fiscal Year 2025: ¥11,960,000 (Direct Cost: ¥9,200,000、Indirect Cost: ¥2,760,000)
Fiscal Year 2024: ¥13,130,000 (Direct Cost: ¥10,100,000、Indirect Cost: ¥3,030,000)
Fiscal Year 2023: ¥11,700,000 (Direct Cost: ¥9,000,000、Indirect Cost: ¥2,700,000)
Keywordsマルチモーダル対話システム / 雑談 / 高齢者 / マルチモーダル対話 / 認知力推定 / 音声認識 / マルチモーダル
Outline of Research at the Start

高齢者向けマルチモーダル対話システム基盤技術を構築し、高齢者が対話システムを気兼ねなく活用することで健康長寿力増進を目指す。音声対話のみではなく、人間に似た容姿ど)を備え、表情・視線・ジェスチャを交え、互いの意図・思い・雰囲気が姿から伝わる、親しみのあるマルチモーダル対話システムの構築を可能にする。具体的には、高齢者用の音声認識技術、音声・視線等マルチモーダルの統合認識・理解技術、対話が継続できる自然で魅力的なマルチモーダル対話技術、対話内容や音声を用いて暗黙的に認知力を診断する技術、を実現し、高齢者施設における実証実験を行う。

Outline of Annual Research Achievements

人と対話することは認知力維持増進に効果的とされる。そこで、高齢者向けマルチモーダル対話システム基盤技術を構築し、高齢者が対話システムを気兼ねなく活用することで健康長寿力増進を目指す。音声対話のみではなく、人間に酷似したリアルなエージェント(3D CG SayaやアンドロイドロボットERICAなど)を備え、表情・視線・ジェスチャを交え、互いの意図・思い・雰囲気が姿から伝わる、親しみのあるマルチモーダル対話システムの構築を可能にする。そこで(1)高齢者用の音声認識技術(2)音声・視線等マルチモーダルの統合認識・理解技術(3)対話が継続できる自然で魅力的なマルチモーダル対話技術(4)対話内容や音声を用いて暗黙的に認知力を診断する技術、を実現する。そのうえで(5)高齢者施設における実証実験を実施し、その結果を研究にフィードバックする。最終的に、協力機関の施設に置いてマルチモーダル対話システムが永続的に活用されることを目標とする。
高齢者の音声認識高精度化を目指し、全国の高齢者施設を訪問して音声を録音した。このデータは123名、平均年齢83歳の音声であり、国立情報学研究所から研究用途で無料配布されている。このデータを基に、音声認識とともに年齢推定を行うマルチタスク学習や、一般成人音声による事前学習と高齢者音声によるファインチューニングに基づく手法などで高精度化を図った。エージェントの動作の自然性向上を目指して、音声と頭部動作を同時生成する手法や対話相手音声に合わせて頭部動作を生成する手法を考案した。音声の音響的・言語的情報を利用して認知力を推定する手法を種々考案した。

Current Status of Research Progress
Current Status of Research Progress

2: Research has progressed on the whole more than it was originally planned.

Reason

研究項目として上げた内容については網羅的に研究を実施し、成果を挙げて多くの外部発表につなげている。さらに音声データベースは一般公開して研究コミュニティへの貢献もある。

Strategy for Future Research Activity

個別の技術に関しては、おおよそ研究が進行した。本提案の最終目標は高齢者を対象とした音声・マルチモーダル対話システムの構築とその実証実験による評価なので、個別技術を組み合わせて一つの対話システムとして統合することをまず行う。その上で、対話システムとして未熟な部分を抽出し、改良を加えたうえで来年度の評価実験に向けた準備を行う。

Report

(3 results)
  • 2024 Annual Research Report
  • 2023 Comments on the Screening Results   Annual Research Report
  • Research Products

    (17 results)

All 2025 2024 2023

All Journal Article (5 results) (of which Peer Reviewed: 5 results,  Open Access: 4 results) Presentation (12 results) (of which Int'l Joint Research: 1 results)

  • [Journal Article] Relationship between User's Response and Individual Traits on Spoken Dialogue System2025

    • Author(s)
      坪倉 和哉、入部 百合絵、北岡 教英
    • Journal Title

      電子情報通信学会論文誌D 情報・システム

      Volume: J108-D Issue: 4 Pages: 182-191

    • DOI

      10.14923/transinfj.2024PDP0035

    • ISSN
      1880-4535, 1881-0225
    • Year and Date
      2025-04-01
    • Related Report
      2024 Annual Research Report
    • Peer Reviewed
  • [Journal Article] Recognition of target domain Japanese speech using language model replacement2024

    • Author(s)
      Mori Daiki、Ohta Kengo、Nishimura Ryota、Ogawa Atsunori、Kitaoka Norihide
    • Journal Title

      EURASIP Journal on Audio, Speech, and Music Processing

      Volume: 2024 Issue: 1 Pages: 1-14

    • DOI

      10.1186/s13636-024-00360-8

    • Related Report
      2024 Annual Research Report
    • Peer Reviewed / Open Access
  • [Journal Article] Text-only Domain Adaptation for CTC-based Speech Recognition through Substitution of Implicit Linguistic Information in the Search Space2024

    • Author(s)
      Takagi Tatsunari、Wakabayashi Yukoh、Ogawa Atsunori、Kitaoka Norihide
    • Journal Title

      EURASIP Journal on Audio, Speech and Music Processing

      Volume: 40 Pages: 287-291

    • DOI

      10.21437/interspeech.2024-2222

    • Related Report
      2024 Annual Research Report
    • Peer Reviewed / Open Access
  • [Journal Article] Boosting CTC-based ASR using inter-layer attention-based CTC loss2024

    • Author(s)
      Hojo Keigo、Wakabayashi Yukoh、Ohta Kengo、Ogawa Atsunori、Kitaoka Norihide
    • Journal Title

      Proc. INTERSPEECH

      Volume: 1 Pages: 2860-2864

    • DOI

      10.21437/interspeech.2024-1776

    • Related Report
      2024 Annual Research Report
    • Peer Reviewed / Open Access
  • [Journal Article] Analysis of the relationship between user response to dialog breakdown and personality traits2023

    • Author(s)
      Tsubokura Kazuya、Iribe Yurie、Kitaoka Norihide
    • Journal Title

      Advanced Robotics

      Volume: 38 Issue: 4 Pages: 246-255

    • DOI

      10.1080/01691864.2023.2279610

    • Related Report
      2023 Annual Research Report
    • Peer Reviewed / Open Access
  • [Presentation] 日本語日常会話における他者開始修復の分析2025

    • Author(s)
      坪倉和哉, 入部百合絵, 北岡教英
    • Organizer
      言語処理学会第31回年次大会
    • Related Report
      2024 Annual Research Report
  • [Presentation] 自己教師あり学習を用いた自由会話音声からの早期アルツハイマー病の予測2025

    • Author(s)
      桑山芳明, 坪倉和哉, 入部百合絵, 横井克典, 中村昭範, 北岡教英, 勝野雅央
    • Organizer
      言語処理学会第31回年次大会
    • Related Report
      2024 Annual Research Report
  • [Presentation] 対話システムにおける個人特性を考慮した破綻度合い推定2025

    • Author(s)
      山田竜彰, 坪倉和哉, 入部百合絵, 北岡教英
    • Organizer
      言語処理学会第31回年次大会
    • Related Report
      2024 Annual Research Report
  • [Presentation] 音響と言語の交互適応に基づく高齢者音声認識の性能改善2025

    • Author(s)
      高橋快斗, 若林佑幸, 太田健吾, 北岡教英
    • Organizer
      SPEASIPワークショップ2025
    • Related Report
      2024 Annual Research Report
  • [Presentation] Dialog Breakdown Recovery Strategies Based on User Personality2024

    • Author(s)
      Kazuya Tsubokura, Takuya Takeda, Yurie Iribe, and Norihide Kitaoka
    • Organizer
      IWSDS2024
    • Related Report
      2024 Annual Research Report
    • Int'l Joint Research
  • [Presentation] 年齢情報とのマルチタスク学習による高齢者音声認識の高精度化2024

    • Author(s)
      新惠 拓実, 木内 貴浩, 若林 佑幸, 北岡 教英
    • Organizer
      SPEASIPワークショップ2024
    • Related Report
      2023 Annual Research Report
  • [Presentation] EARS:日本人超高齢者音声コーパスの構築2024

    • Author(s)
      福田 芽衣子, 西村 良太, 入部 百合絵, 山本 一公, 北岡 教英
    • Organizer
      日本音響学会春季研究発表会
    • Related Report
      2023 Annual Research Report
  • [Presentation] 年齢推定タスクの併用による高齢者音声認識の高精度化2024

    • Author(s)
      新惠 拓実, 木内 貴浩, 若林 佑幸, 北岡 教英
    • Organizer
      日本音響学会春季研究発表会
    • Related Report
      2023 Annual Research Report
  • [Presentation] 自由会話のトピックモデルに基づいた軽度認知障害の検出2024

    • Author(s)
      長江 勇樹, 岡田 智哉, 入部 百合絵, 横井 克典, 中村 昭範, 北岡 教英, 勝野 雅央
    • Organizer
      言語処理学会第30回年次大会
    • Related Report
      2023 Annual Research Report
  • [Presentation] 認知症病因物質がもたらす会話内容への影響分析と発症前アルツハイマー病の予測2024

    • Author(s)
      岡田 智哉, 入部 百合絵, 横井 克典, 中村 昭範, 北岡 教英, 勝野 雅央
    • Organizer
      言語処理学会第30回年次大会
    • Related Report
      2023 Annual Research Report
  • [Presentation] 対話破綻修復コーパスの収集と分析 ーユーザの個人特性とシステムとの関係性を考慮した修復文生成に向けてー2024

    • Author(s)
      坪倉 和哉, 岡田 真依, 入部 百合絵, 北岡 教英
    • Organizer
      言語処理学会第30回年次大会
    • Related Report
      2023 Annual Research Report
  • [Presentation] Dialog Breakdown Recovery Strategies Based on User Personality2024

    • Author(s)
      Kazuya Tsubokura, Takuya Takeda, Yurie Iribe, Norihide Kitaoka
    • Organizer
      The 14th International Workshop on Spoken Dialogue Systems Technology (IWSDS2024),
    • Related Report
      2023 Annual Research Report

URL: 

Published: 2023-04-13   Modified: 2026-07-08  

Information User Guide FAQ News Terms of Use Attribution of KAKENHI

Powered by NII kakenhi