違う見方

新しい時代の始まり。複数の視点を持つことで、情報過多でややこしい現代をシンプルに捉えるための備忘録的ブログ。考え方は常に変化します。

音声入力はインタフェースの一つ

次のdisり気味のツイートがキッカケだった。

 

 

 

 

「ヘイ、Siri」とか「OK、Google」あるいは「アレクサ」でお馴染みになったAIスピーカーが流行った頃にも音声入力を意識した記憶があるが、その頃は、喋ってる自分を想像するだけでゾッとする気持ちが拭えず手を出せなかった。

 

 

 

しかし、上記のツイートへのリプライを読んでると、一周回って今の音声入力は一度は使うべきかと思った。

 

 

私はブログの下書きや備忘録にMicrosoftのOneNoteを使っているが、OneNoteでの音声入力を私の環境であるMacとiPadとandroidスマホで試してみたが、普通に認識するし改行も任意に指示できるし、改行すると前段の最後には読点が自動で入る。

 

ChatGPTも音声入力してみた。

 

まずは、「ChatGPTを音声入力で利用してる人はどのくらいいる?」と。

 

私の印象としては、現在の利用者は大まかに次の3層に分かれます。

 

  • 多数派:キーボード入力が中心(約7~8割程度と推測)
  • 併用派:長文や移動中だけ音声入力を使う
  • 音声中心派:日常会話のようにChatGPTと話す人(少数)

 

特にスマートフォンでは、長文を入力する際に音声入力を使う人が徐々に増えています。一方で、職場や電車などでは周囲の目やプライバシーの問題があり、テキスト入力の方が使いやすい場面も多いようです。

 

 

 

次に、「音声入力とキーボード入力では脳の使い方の違いは?」と。

 

 

大まかに言うと、音声入力は「話す脳」、キーボード入力は「書く脳」をより強く使います。

 

 

 

音声入力では

  • 言語生成(話す)
  • 聴覚による自己モニタリング
  • ワーキングメモリ
  • 即興的な発話

 

が強く働きます。

 

 

キーボード入力では

  • 手指の運動制御
  • 視覚フィードバック
  • スペリングや漢字変換の確認
  • 文章構成

 

への負荷が大きくなります。

 

 

両者は競合するものではなく、

 

  • 音声入力:「思考を発散させる」

 

  • キーボード入力:「思考を収束させる」

 

という役割分担をすると、それぞれの長所を活かしやすいと言えます。

 

 

 

そして最後にこうまとめてくれた。

 

現在の音声入力は「入力手段の一つ」ではなく、人とコンピューターのインターフェースそのものが変わる転換点にあると言えるでしょう。

 

 

インタフェースであるならば、避けてばかりもいられない、使わないのはともかく、使えないのは後々倍返しを受けることにもなりかねない。

 

少しずつ音声入力に馴染んでいきたい。

 

 

余談だが、言い損なったり吃ったりしてもそういう部分は今時は自動でカットしてくれる、妙に早口だったりするとどうなるかは不明だが、恐る恐る始める人の場合懸念はあまりないはず。