• 研究課題をさがす
  • 研究者をさがす
  • KAKENの使い方
  1. 前のページに戻る

授業における非言語モダリティセンシングの高度化による情報保障・授業改善支援技術

研究課題

研究課題/領域番号 23K20729
補助金の研究課題番号 21H00901 (2021-2023)
研究種目

基盤研究(B)

配分区分基金 (2024)
補助金 (2021-2023)
応募区分一般
審査区分 小区分09070:教育工学関連
研究機関山梨大学

研究代表者

西崎 博光  山梨大学, 大学院総合研究部, 教授 (40362082)

研究分担者 豊浦 正広  山梨大学, 大学院総合研究部, 教授 (80550780)
北岡 教英  豊橋技術科学大学, 工学(系)研究科(研究院), 教授 (10333501)
小林 彰夫  大和大学, 情報学部, 教授 (10741168)
宇津呂 武仁  筑波大学, システム情報系, 教授 (90263433)
研究期間 (年度) 2024-04-01 – 2025-03-31
研究課題ステータス 完了 (2024年度)
配分額 *注記
15,860千円 (直接経費: 12,200千円、間接経費: 3,660千円)
2024年度: 2,470千円 (直接経費: 1,900千円、間接経費: 570千円)
2023年度: 4,810千円 (直接経費: 3,700千円、間接経費: 1,110千円)
2022年度: 4,940千円 (直接経費: 3,800千円、間接経費: 1,140千円)
2021年度: 3,640千円 (直接経費: 2,800千円、間接経費: 840千円)
キーワード情報保障 / 授業改善支援 / 深層学習 / 音声認識 / マルチモーダル分析 / 音声翻訳 / 音声字幕 / センシング / 授業センシング / 話し方評価 / 字幕システム / 情報補償 / 音声印象評価 / 機械翻訳 / 文字認識 / 高齢者音声認識 / 音声認識誤り訂正 / OCR / 話し方の特徴 / 非言語モダリティセンシング / 字幕作成 / 行動分析 / 話し方分析 / 非言語現象の整形 / 印象評定 / 授業改善 / 教室映像解析 / 非言語情報 / 映像分析
研究開始時の研究の概要

本研究は、対面・遠隔授業の質の向上を目的とし,非言語モダリティセンシング技術を高度化することで,情報保障・授業改善支援技術の開発を行う。音声認識による授業音声の字幕・翻訳化,講師の音声の話し方評価とフィードバック,映像・音響センシングによる参加度・理解度評価,を組み合わせた「情報保障・授業改善支援システム」を構築し,教育改善を図っていく。

研究成果の概要

本研究は、授業映像や音声等の非言語情報を高度に分析し、情報保障と授業改善を支援する技術の確立を目的とした。そのために、授業音声認識の高度化として、軽量・多言語対応のEnd-to-End音声認識や、Transformerの内部情報を活用しCTCモデルの精度を向上させる新手法など、先進的な音声認識技術群を開発した。また、高齢者などの多様な話者に対する音声認識手法の開発も行なった。また、映像と音響特徴を深層学習技術で統合し、アクティブラーニングにおける学生の活動(グループワーク、発表等)を高精度に自動分類するシステム、音声評価システム、授業音声の自動翻訳システムを開発できた点も大きな成果である。

研究成果の学術的意義や社会的意義

学術的意義は、音声や画像処理技術を融合し、授業の情報保障や学習の分析といった新たな枠組みを提示した点にある。特に、グループワーク等の複雑な授業プロセスを定量的に分析する手法は高い新規性を持ち、授業改善に役立つ。また、本研究で開発した音声認識モデルは、授業字幕システム等で効果があることを示し、教育のために役立つことを示した。社会的には、第一に客観的なデータ分析に基づいて授業改善を行うデータ駆動型教育の可能性を示せたこと、第二にモダリティセンシングより情報保障の質を向上させ、教育の公平性確保に貢献したことである。本成果は、教育分野に留まらず多様な人々が共生する社会の支援基盤となることも期待される。

報告書

(5件)
  • 2024 実績報告書   研究成果報告書 ( PDF )
  • 2023 実績報告書
  • 2022 実績報告書
  • 2021 実績報告書
  • 研究成果

    (40件)

すべて 2025 2024 2023 2022 2021

すべて 雑誌論文 (21件) (うち査読あり 21件、 オープンアクセス 11件) 学会発表 (19件) (うち招待講演 1件)

  • [雑誌論文] Analysis of Classroom Processes Based on Deep Learning With Video and Audio Features2024

    • 著者名/発表者名
      Heng Chuo Hiang、Toyoura Masahiro、Leow Chee Siang、Nishizaki Hiromitsu
    • 雑誌名

      IEEE Access

      巻: 12 ページ: 110705-110712

    • DOI

      10.1109/access.2024.3434742

    • 関連する報告書
      2024 実績報告書
    • 査読あり / オープンアクセス
  • [雑誌論文] Evaluation of Speech Translation Subtitles Generated by ASR with Unnecessary Word Detection2024

    • 著者名/発表者名
      Hotta Makoto、Leow Chee Siang、Kitaoka Norihide、Nishizaki Hiromitsu
    • 雑誌名

      Proceedings of the 2024 IEEE 13th Global Conference on Consumer Electronics

      巻: - ページ: 815-819

    • DOI

      10.1109/gcce62371.2024.10760522

    • 関連する報告書
      2024 実績報告書
    • 査読あり
  • [雑誌論文] Text Detection and Style Classification from Images Using Vision Transformer and Transformer Decoder2024

    • 著者名/発表者名
      Yajima Hideaki、Leow Chee Siang、Nishizaki Hiromitsu
    • 雑誌名

      Proceedings of the 2024 IEEE 13th Global Conference on Consumer Electronics

      巻: - ページ: 619-623

    • DOI

      10.1109/gcce62371.2024.10761042

    • 関連する報告書
      2024 実績報告書
    • 査読あり
  • [雑誌論文] Identification of a Person in a Trajectory Based on Wearable Sensor Data Analysis2024

    • 著者名/発表者名
      Yan Jinzhe、Toyoura Masahiro、Wu Xiangyang
    • 雑誌名

      Sensors

      巻: 24 号: 11 ページ: 3680-3680

    • DOI

      10.3390/s24113680

    • 関連する報告書
      2024 実績報告書
    • 査読あり / オープンアクセス
  • [雑誌論文] Recognition of target domain Japanese speech using language model replacement2024

    • 著者名/発表者名
      Mori Daiki、Ohta Kengo、Nishimura Ryota、Ogawa Atsunori、Kitaoka Norihide
    • 雑誌名

      EURASIP Journal on Audio, Speech, and Music Processing

      巻: 2024 号: 1 ページ: 1-14

    • DOI

      10.1186/s13636-024-00360-8

    • 関連する報告書
      2024 実績報告書
    • 査読あり / オープンアクセス
  • [雑誌論文] Text-only Domain Adaptation for CTC-based Speech Recognition through Substitution of Implicit Linguistic Information in the Search Space2024

    • 著者名/発表者名
      Takagi Tatsunari、Wakabayashi Yukoh、Ogawa Atsunori、Kitaoka Norihide
    • 雑誌名

      EURASIP Journal on Audio, Speech and Music Processing

      巻: 40 ページ: 287-291

    • DOI

      10.21437/interspeech.2024-2222

    • 関連する報告書
      2024 実績報告書
    • 査読あり / オープンアクセス
  • [雑誌論文] Boosting CTC-based ASR using inter-layer attention-based CTC loss2024

    • 著者名/発表者名
      Hojo Keigo、Wakabayashi Yukoh、Ohta Kengo、Ogawa Atsunori、Kitaoka Norihide
    • 雑誌名

      Proc. INTERSPEECH

      巻: 1 ページ: 2860-2864

    • DOI

      10.21437/interspeech.2024-1776

    • 関連する報告書
      2024 実績報告書
    • 査読あり / オープンアクセス
  • [雑誌論文] Single-Line Text Detection in Multi-Line Text with Narrow Spacing for Line-Based Character Recognition2023

    • 著者名/発表者名
      LEOW Chee Siang、YAJIMA Hideaki、KITAGAWA Tomoki、NISHIZAKI Hiromitsu
    • 雑誌名

      IEICE Transactions on Information and Systems

      巻: E106.D 号: 12 ページ: 2097-2106

    • DOI

      10.1587/transinf.2023EDP7070

    • ISSN
      0916-8532, 1745-1361
    • 年月日
      2023-12-01
    • 関連する報告書
      2023 実績報告書
    • 査読あり / オープンアクセス
  • [雑誌論文] A Lightweight End-to-End Speech Recognition System on Embedded Devices2023

    • 著者名/発表者名
      WANG Yu、NISHIZAKI Hiromitsu
    • 雑誌名

      IEICE Transactions on Information and Systems

      巻: E106.D 号: 7 ページ: 1230-1239

    • DOI

      10.1587/transinf.2022EDP7221

    • ISSN
      0916-8532, 1745-1361
    • 年月日
      2023-07-01
    • 関連する報告書
      2023 実績報告書
    • 査読あり / オープンアクセス
  • [雑誌論文] Comparative Evaluation of Diverse Features in Fluency Evaluation of Spontaneous Speech2023

    • 著者名/発表者名
      DENG Huaijin、UTSURO Takehito、KOBAYASHI Akio、NISHIZAKI Hiromitsu
    • 雑誌名

      IEICE Transactions on Information and Systems

      巻: E106.D 号: 1 ページ: 36-45

    • DOI

      10.1587/transinf.2022EDP7047

    • ISSN
      0916-8532, 1745-1361
    • 年月日
      2023-01-01
    • 関連する報告書
      2022 実績報告書
    • 査読あり / オープンアクセス
  • [雑誌論文] Metric Learning Approach for End-to-End Multilingual Automatic Speech Recognition Model2023

    • 著者名/発表者名
      Dobashi Akihiro、Leow Chee Siang、Nishizaki Hiromitsu
    • 雑誌名

      Proceedings of the 2023 IEEE 12th Global Conference on Consumer Electronics (GCCE 2023)

      巻: - ページ: 845-849

    • DOI

      10.1109/gcce59613.2023.10315608

    • 関連する報告書
      2023 実績報告書
    • 査読あり
  • [雑誌論文] Data Augmentation with Automatically Generated Images for Character Classifier Model Training2023

    • 著者名/発表者名
      Leow Chee Siang、Kitagawa Tomoki、Yajima Hideaki、Nishizaki Hiromitsu
    • 雑誌名

      Proceedings of the 2023 IEEE 12th Global Conference on Consumer Electronics

      巻: - ページ: 845-849

    • DOI

      10.1109/gcce59613.2023.10315447

    • 関連する報告書
      2023 実績報告書
    • 査読あり
  • [雑誌論文] A new speech corpus of super-elderly Japanese for acoustic modeling2023

    • 著者名/発表者名
      Fukuda Meiko、Nishimura Ryota、Nishizaki Hiromitsu、Horii Koharu、Iribe Yurie、Yamamoto Kazumasa、Kitaoka Norihide
    • 雑誌名

      Computer Speech & Language

      巻: 77 ページ: 101424-101424

    • DOI

      10.1016/j.csl.2022.101424

    • 関連する報告書
      2022 実績報告書
    • 査読あり / オープンアクセス
  • [雑誌論文] Automatic Selection of Appropriate Data Augmentation Operation for Acoustic Scene Classification Model Training2022

    • 著者名/発表者名
      Sugiura Toki、Kobayashi Akio、Utsuro Takehito、Nishizaki Hiromitsu
    • 雑誌名

      Proceedings of the 2022 IEEE 11th Global Conference on Consumer Electronics

      巻: - ページ: 355-358

    • DOI

      10.1109/gcce56475.2022.10014333

    • 関連する報告書
      2022 実績報告書
    • 査読あり
  • [雑誌論文] Implicit language information replacing method in Japanese encoder?decode ASR model2022

    • 著者名/発表者名
      Mori Daiki、Ohta Kengo、Nishimura Ryota、Kitaoka Norihide
    • 雑誌名

      Proceedings of the 2022 9th International Conference on Advanced Informatics: Concepts, Theory and Applications

      巻: - ページ: 1-6

    • DOI

      10.1109/icaicta56449.2022.9932915

    • 関連する報告書
      2022 実績報告書
    • 査読あり
  • [雑誌論文] Comparison of Static and Time-Sequential Features in Automatic Fluency Detection of Spontaneous Speech2021

    • 著者名/発表者名
      Deng Huaijin、Utsuro Takehito、Kobayashi Akio、Nishizaki Hiromitsu
    • 雑誌名

      Proceedings of the 24th Conference of the Oriental COCOSDA

      巻: - ページ: 158-163

    • DOI

      10.1109/o-cocosda202152914.2021.9660601

    • 関連する報告書
      2021 実績報告書
    • 査読あり
  • [雑誌論文] ExKaldi-RT: A Real-Time Automatic Speech Recognition Extension Toolkit of Kaldi2021

    • 著者名/発表者名
      Wang Yu, Chee Siang Leow, Akio Kobayashi, Takehito Utsuro, Hiromitsu Nishizaki
    • 雑誌名

      Proceedings of 2020 IEEE 10th Global Conference on Consumer Electronics (GCCE)

      巻: - ページ: 346-350

    • DOI

      10.1109/gcce53005.2021.9621992

    • 関連する報告書
      2021 実績報告書
    • 査読あり
  • [雑誌論文] Audio Synthesis-based Data Augmentation Considering Audio Event Class2021

    • 著者名/発表者名
      Sugiura Toki、Kobayashi Akio、Utsuro Takehito、Nishizaki Hiromitsu
    • 雑誌名

      Proceedings of the 2021 IEEE 10th Global Conference on Consumer Electronics

      ページ: 72-76

    • DOI

      10.1109/gcce53005.2021.9621828

    • 関連する報告書
      2021 実績報告書
    • 査読あり
  • [雑誌論文] Corpus Design and Automatic Speech Recognition for Deaf and Hard-of-Hearing People2021

    • 著者名/発表者名
      Kobayashi Akio、Yasu Keiichi、Nishizaki Hiromitsu、Kitaoka Norihide
    • 雑誌名

      2021 IEEE 10th Global Conference on Consumer Electronics (GCCE)

      巻: N.A. ページ: 17-18

    • DOI

      10.1109/gcce53005.2021.9621959

    • 関連する報告書
      2021 実績報告書
    • 査読あり
  • [雑誌論文] Language and Speaker-Independent Feature Transformation for End-to-End Multilingual Speech Recognition2021

    • 著者名/発表者名
      Tomoaki Hayakawa, Chee Siang Leow, Akio Kobayashi, Takehito Utsuro, and Hiromitsu Nishizaki
    • 雑誌名

      Proceedings of INTERSPEECH2021

      巻: - ページ: 2431-2435

    • DOI

      10.21437/interspeech.2021-390

    • 関連する報告書
      2021 実績報告書
    • 査読あり / オープンアクセス
  • [雑誌論文] Voice Activity Detection for Live Speech of Baseball Game Based on Tandem Connection with Speech/Noise Separation Model2021

    • 著者名/発表者名
      Nonaka Yuto、Leow Chee Siang、Kobayashi Akio、Utsuro Takehito、Nishizaki Hiromitsu
    • 雑誌名

      Proceedings of INTERSPEECH2021

      ページ: 351-355

    • DOI

      10.21437/interspeech.2021-792

    • 関連する報告書
      2021 実績報告書
    • 査読あり / オープンアクセス
  • [学会発表] 書類画像における枠の関連性を考慮した項目間の関係性抽出モデル2025

    • 著者名/発表者名
      佐藤創哉,矢島英明,レオ チーシャン,西崎博光
    • 学会等名
      情報処理学会第87回全国大会
    • 関連する報告書
      2024 実績報告書
  • [学会発表] 注意機構に基づく中間特徴量を用いたCTC音声認識の精度向上2025

    • 著者名/発表者名
      北條 圭悟, 若林 佑幸, 太田 健吾, 小川 厚徳, 北岡 教英
    • 学会等名
      日本音響学会春季研究発表会
    • 関連する報告書
      2024 実績報告書
  • [学会発表] 非自己回帰型音声認識モデルにおける内部言語情報推定によるドメイン適応の評価2025

    • 著者名/発表者名
      高城 巽成, 若林 佑幸, 小川 厚徳, 北岡 教英
    • 学会等名
      日本音響学会春季研究発表会
    • 関連する報告書
      2024 実績報告書
  • [学会発表] 雑音環境下でのリアルタイムVADレス音声認識モデルの構築と他モデルとの比較2025

    • 著者名/発表者名
      江本 城太郎,西村 良太, 太田 健吾, 北岡 教英
    • 学会等名
      日本音響学会春季研究発表会
    • 関連する報告書
      2024 実績報告書
  • [学会発表] 中間層出力を用いた自己教師あり学習に基づく音声認識モデルの構築2025

    • 著者名/発表者名
      北條 圭悟, 若林 佑幸, 太田 健吾, 小川 厚徳, 北岡 教英
    • 学会等名
      SPEASIPワークショップ2025
    • 関連する報告書
      2024 実績報告書
  • [学会発表] 雑音・無音ラベリングによる音声区間検出が不要な音声認識2024

    • 著者名/発表者名
      坂井 利光, 若林 佑幸, 北岡 教英
    • 学会等名
      日本音響学会秋季研究発表会
    • 関連する報告書
      2024 実績報告書
  • [学会発表] 生成文字画像を用いた単・複数行テキストに対する文字認識精度向上の検討2023

    • 著者名/発表者名
      レオ チーシャン,北川智樹,矢島英明,西崎博光
    • 学会等名
      情報処理学会第86回全国大会講演論文集
    • 関連する報告書
      2023 実績報告書
  • [学会発表] Transformerデコーダを用いた画像内のテキスト領域検出の検討2023

    • 著者名/発表者名
      矢島英明,レオ チーシャン,北川智樹,西崎博光
    • 学会等名
      情報処理学会第86回全国大会講演論文集
    • 関連する報告書
      2023 実績報告書
  • [学会発表] End-to-End 複数言語音声認識モデル訓練における距離学習の効果2023

    • 著者名/発表者名
      土橋晃弘,レオ チーシャン,西崎博光
    • 学会等名
      日本音響学会2023年秋季研究発表会講演論文集
    • 関連する報告書
      2023 実績報告書
  • [学会発表] 日本語音声認識結果の整形に基づく分かりやすい英語字幕の生成2023

    • 著者名/発表者名
      堀田慎,堀井こはる,北岡教英,西崎博光
    • 学会等名
      情報処理学会第85回全国大会
    • 関連する報告書
      2022 実績報告書
  • [学会発表] 言語・非言語情報タグを付与する音声認識モデルの検討2023

    • 著者名/発表者名
      塩根凪人,若林佑幸,北岡教英
    • 学会等名
      SPEASIPワークショップ
    • 関連する報告書
      2022 実績報告書
  • [学会発表] 音韻特徴を用いた聴覚障害者音声のEnd-to-End音声認識2023

    • 著者名/発表者名
      小林彰夫,安啓一
    • 学会等名
      情報処理学会第85回全国大会
    • 関連する報告書
      2022 実績報告書
  • [学会発表] 品質劣化したラジオ音声を対象とした音声強調手法の検討2023

    • 著者名/発表者名
      小林彰夫,安啓一
    • 学会等名
      情報処理学会第85回全国大会
    • 関連する報告書
      2022 実績報告書
  • [学会発表] Density Ratio Approachに基づく複数Encoder-Decoder音声認識モデル統合手法2022

    • 著者名/発表者名
      北條圭悟,森大輝,若林佑幸,小川厚徳,北岡教英
    • 学会等名
      第24回音声言語および第9回自然言語処理シンポジウム
    • 関連する報告書
      2022 実績報告書
  • [学会発表] ドメイン外音響情報で補強したEncoder-Decoder音声認識モデルの設計2022

    • 著者名/発表者名
      森大輝, 太田健吾, 西村良太, 北岡教英
    • 学会等名
      日本音響学会2022年秋季研究発表会
    • 関連する報告書
      2022 実績報告書
  • [学会発表] 周波数軸注意機構を用いた特徴変換モデルに基づく複数言語音声認識2022

    • 著者名/発表者名
      土橋晃弘,レオチーシャン,西崎博光
    • 学会等名
      日本音響学会2022年春季研究発表会
    • 関連する報告書
      2021 実績報告書
  • [学会発表] Peer Collaborative Learningを用いた音響イベント区間検出2022

    • 著者名/発表者名
      遠藤颯人,西崎博光
    • 学会等名
      日本音響学会2022年春季研究発表会
    • 関連する報告書
      2021 実績報告書
  • [学会発表] Kaldiベースのストリーミング音声認識システムの開発2021

    • 著者名/発表者名
      レオ チーシャン,王 宇,小林彰夫,宇津呂武仁,西崎博光
    • 学会等名
      日本音響学会2021年秋季研究発表会
    • 関連する報告書
      2021 実績報告書
  • [学会発表] 深層学習技術の発展と共に歩む音声認識研究2021

    • 著者名/発表者名
      西崎博光
    • 学会等名
      電子情報通信学会,信学技法,ネットワークシステム研究会
    • 関連する報告書
      2021 実績報告書
    • 招待講演

URL: 

公開日: 2021-04-28   更新日: 2026-01-16  

サービス概要 検索マニュアル よくある質問 お知らせ 利用規程 科研費による研究の帰属

Powered by NII kakenhi