[研究課題と成果概要]
� 痢\柴札皀妊襪旅眦找修砲茲覯酸疾言�機構の物理音響的特徴解析(元木邦俊・松崎博季) ]
音声生成系の物理的形状と伝達特性の高精度の対応関係を表現するモデルの開発を目標に研究を行っている。有限要素法による数値シミュレーションでは、モデルの構成精度(口唇突き出し、分岐、断面の簡略化)の違いの影響が伝達特性上で母音毎に異なって現れる場合があることが示された。モード分解における高速算法では、高次モードが伝搬モードとなる高域で伝達特性の変動が大きいことがあらためて示されており、高域での扱いが個人性の特徴分離における課題となることが示唆された。これまで声道形状モデル作成のためのデータが不足していたが、本年度は国際電気通信研究所(ATR)における研究用MRI装置の利用により、2名の被験者の日本語定常5母音発声時における詳細な断層画像データを得ることができた。3次元画像処理・編集ソフトウェアを用いることで、これらの断層画像データから容易に3次元声道形状モデルを作成することができるようになった。また、上述の数値計算だけではなく、3次元切削装置による3次元物理モデルや多数のスライド片から構成される可動声道モデルを作成し、人工喉頭音源と組み合わせた物理モデルによる音声合成を行った。
�◆痢|亮韻畔弧�情報の融合処理へ向けての言語情報処理の高度化と知的言語処理システムへの応用(桃内佳雄・渋木英潔) ]
アイヌ語・日本語機械翻訳システムのための知識と文脈情報の融合的・漸進的な処理方式について検討する中で,場所表現と連体節修飾表現に関する基礎的な考察を行い,また,アイヌ神謡集テキストのXML文書化と情報抽出・表現に関する研究を進めた.アイヌ語と日本語の連体節修飾名詞句の基本的な構成について,従来の研究を参照しつつ比較対照的な考察を進め,機械翻訳システム構築のための基礎として,アイヌ語・日本語対訳パターンの構成を試みた.また,連体節の中に含まれる動詞の単語直接翻訳を知識や文脈情報の利用により適切なテンスやアスペクト表現を含む自然な日本語へ変換する処理に関する基礎的な考察を行った.
言語情報処理の高度化のための研究として,深層格の自動推測手法では,文全体の助詞パターンと語順の情報を考慮するよう改善した.また,未登録語の問題に対処するため,深層格選好の類似した単語を字面などの表層的な情報から自動的にクラスタリングする手法を開発した.作成されたクラスタは分類語彙表よりも深層格選好が類似しており,深層格推測実験では,従来の分類語彙表を用いた場合よりも高い精度で深層格を推測できた.
��[ 学習機能に基づく知的言語処理システムの研究(越前谷博) ]
学習機能に基づく言語処理システムの観点より、様々な言語の対訳コーパスから対訳語を自動抽出する「隣接情報学習を用いた多言語対訳コーパスから対訳語の自動抽出手法」を提案し、その有効性を確認した。従来の対訳コーパスからの対訳語の自動抽出では、Dice係数、Χ2、赤池相互情報量(AIC)のような統計情報を用いた類似度尺度に基づく手法が用いられてきた。これらの手法の問題点は、等価な出現頻度を持つ複数の対訳語が存在する場合、曖昧性を解消できずに正しい対訳語を一意に決定できないことである。そこで、本研究で提案する学習手法は、「対訳文の局所部分において、抽出対象の対訳語の原言語に隣接する単語列の訳語は、対訳語の目的言語に隣接する」という仮定に基づき、対訳語に隣接する単語列間の対応関係とそれらの単語列との位置関係、すなわち、隣接情報を用いて対訳語を抽出する。更に、このような隣接情報は対訳コーパスからシステム自身が自動獲得する。その結果、特定の言語の対訳コーパスに依存することなく、様々な言語の対訳コーパスから対訳語を自動抽出することが可能となる。
|