研究課題/領域番号 |
23500116
|
研究種目 |
基盤研究(C)
|
配分区分 | 基金 |
応募区分 | 一般 |
研究分野 |
メディア情報学・データベース
|
研究機関 | 福井大学 |
研究代表者 |
長谷 博行 福井大学, 工学(系)研究科(研究院), 教授 (90142273)
|
研究期間 (年度) |
2011 – 2013
|
研究課題ステータス |
完了 (2013年度)
|
配分額 *注記 |
3,120千円 (直接経費: 2,400千円、間接経費: 720千円)
2013年度: 650千円 (直接経費: 500千円、間接経費: 150千円)
2012年度: 780千円 (直接経費: 600千円、間接経費: 180千円)
2011年度: 1,690千円 (直接経費: 1,300千円、間接経費: 390千円)
|
キーワード | 文書画像処理 / レイアウト解析 / 回転文字認識 / 文献データベース / ページ捲り器 / ページめくり器 / 文字認識 / 文書構造 / データベース |
研究概要 |
本研究は、膨大な学術雑誌や書籍の内容を電子化することを目的として、高解像度カメラで取得した文書画像の情報処理システムの構築を目指した。特に、文書の置き方に制限を設けない手軽な入力作業を可能にする。本研究では、具体的には、電子化されてない大量の古い年代の論文誌を半自動入力するためにページ捲り器を用いて、冊子を裁断することなく見開きページ画像をカメラから入力し、レイアウト解析、角度推定が可能な文字認識を適用することによりデータベースを構築する簡易なシステムを構成した。また、1文字毎の向きを推定することが可能で複数フォントの日本語約3000カテゴリに対応可能な文字認識方式を開発した。
|