arXiv論文メモ
新着一覧
cs.HC · 査読状況未確認

当日の校正なしで日をまたいで使える耳周りの無声発話入力

AESSI: An Around-Ear Silent Speech Interface for Cross-Day Online Reuse without Test-Day Calibration

Xiran Xu, Mochu Dong, Yujie Yan, Chenxi Wang, Yu Jiao, Jing Chen

この論文をやさしく読む

ひとことで言うと

耳の周りで測った電気生理信号から無声の発話を読み取り、別の日にも校正せず使えるかを調べた入力インターフェースです。

何に役立つ?

声を出さない通信や、構音障害のある人の支援への応用が考えられます。実証されたのは、指定した25文での日をまたいだ認識とオンライン動作です。

この研究の面白いところ

記録時の変動に強い表現を学ぶため、入力を部分的に隠して教師表現を予測します。少なくとも21日空けたオンライン試験も行っています。

どこまで分かった?

24人の記録を用い、オンライン試験は5人が対象です。25の普通話文に対する結果で、自由発話や脳卒中患者での支援効果は要旨では実証されていません。31.70 msはCPU再生時の処理時間です。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

無声発話インターフェース(SSI)は、聞こえる声を出さずに私的な通信を可能にし、脳卒中後の構音障害がある人を支援できる可能性がある。日常的に繰り返し使うには、センサーの付け直しや生理的な変化があっても、日をまたいで汎化する発話運動関連の表現が必要である。 本研究では、マスク付き文脈表現事前学習(MCRP)を使う、耳周りのSSIであるAESSIを提示する。生徒モデルが、時間・周波数入力の一部をマスクした状態から教師モデルの表現を予測することで、記録の変動に対する頑健性を促す。日常的な中国語普通話の25文について、24人から44回の電気生理学的記録を収集した。6人の最終回の記録全体を評価用に除外した場合、AESSIは試験当日の校正なしで平均正解率92.24%を達成した。最良の適応済みベースラインを50.57パーセントポイント上回った。 各参加者の最終記録から少なくとも21日後、5人がそれぞれ独立に無作為化された50回のオンライン試験を校正なしで行い、全体の正解率は98.0%だった。CPUでの再生処理における前処理と推論時間の中央値は31.70 msだった。これらの結果は、システムがエンドツーエンドで動作することを実証し、試験当日の校正なしのオンライン再利用を支持する。論文にはデモが付属する。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-18(UTC)
最新改訂
2026-09-18 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Silent speech interfaces (SSIs) enable private communication without audible speech and may support people with post-stroke dysarthria. Everyday reuse requires articulation-related representations that generalize across days despite sensor repositioning and physiological changes. We present AESSI, an around-ear SSI using masked-context representation pretraining (MCRP): a student predicts teacher representations from masked time-frequency inputs to encourage robustness to recording variability. We collected 44 electrophysiological recordings from 24 participants for 25 everyday Mandarin sentences. With six participants' complete final recordings held out, AESSI achieved 92.24 percent mean accuracy without test-day calibration. AESSI exceeded the best adapted baseline by 50.57 percentage points. At least 21 days after each participant's last recording, five participants each completed 50 independently randomized online tests without calibration, achieving 98.0 percent overall accuracy. Median preprocessing and inference time in CPU replay was 31.70 ms. These results demonstrate end-to-end system operation and support online reuse without test-day calibration. Demo is included with the paper.

arXiv ID: 2609.21436 / 要約の誤りについて