デジタル音声アシスタントはなぜ衰退したのか――失敗の理由と今後の展望
デジタル音声アシスタントの終焉
更新日:2023年12月12日
私は意地悪な人間ではないし、プライドも高くない。それでも、「だから言ったでしょ」という瞬間には、ときに小さな満足感を覚えてしまう。テック企業でエンジニアとして働いていると、重要な会議の合間にLinkedInのダイジェストで「新しい流行」を読んだばかりの「インスパイアされた」マネージャーたちから、DevOpsだのAI/MLだのという言葉を振りかざしながら「未来についてのお説教」を聞かされることがある。そういう経験をしてきた者にとって、物事が必然的に予想通りの結末を迎えたとき、自分が正しかったと確信できるのはごく自然なことだろう。好例こそが、デジタルアシスタントという非現実的な現実である。
ここ1年ほどで、デジタルアシスタントが収益化できていないという報告や記事が相次ぎ、その結果として関連チームや技術が整理・縮小されてきた。かつてSiri、Cortana、Alexaは大いにもてはやされたが、今ではその輝きは薄れている。私にとってこの結末は最初から明らかだった。あとは数年待って、またしても「やっぱりね」と確証されるだけだったのだ。その理由をお話ししよう。
目的のないテクノロジー
なぜ? なぜ? なぜ? 新しい技術が提案されたり、「人生を変革する」とされる変更が持ち上がったりしたとき、誰もがうんざりするほど繰り返すべき問いがこれだ。第一に、革命とは本来大量の流血と悲劇を伴うものなので、「変革」という言葉は疑わしい。第二に、生活はすでにそれ自体で最適化されており、過激な破壊者など必要ない。第三に、提案者がすべての「なぜ」に淀みなく答えられるなら、それは本物かもしれない。
ところが、デジタルアシスタントやAIアシスタントの話を聞いたときに返ってきたのは、ほとんどカルト的な「生活が便利になります」「タスクが簡単になります」「牛乳を注文してくれます」といったIoT系バズワードの羅列だけで、具体的な課題は一切なかった。実際、私が目にしたシナリオといえば、以下のようなものだけだ。
どこか陳腐な3分ほどのやや彩度の高い動画。そこには忙しいハイライフな米国のマーケター兼テック系の人間が登場し、耳にBluetoothイヤホンをつけて、慌ただしい華やかな生活を駆け回っている。若く独身で、料理など到底できない。会議が多すぎて普通の生活を送る暇がない。だから牛乳を買い忘れる! そこで帰宅途中に車の中からデジタルアシスタントに「電話」すると、アシスタントがすべて処理してくれる。遠隔でエアコンをつけ、牛乳を注文してくれる。2時間半の渋滞(公共交通機関は貧乏人の乗り物らしい)を抜けて割高なスタジオタイプのマンションにたどり着くころには、牛乳はもう届いていて、冷え冷えと待っている、というわけだ。
そして……それで終わり。私が見せられたのはほぼこれだけだ。あるいは目覚まし時計とか音楽再生とか、1960年代のSF映画さながらの、ちょっと格好いいおもちゃ以上の何の役にも立たない些細なバリエーション程度。

写真提供:Jacek Dylag(Unsplash)
障害のある方や高齢者の支援、孤独な人のケア、高強度環境や生産ラインで働く人のサポートといった、本当に意味のある用途でデジタルアシスタントが提案されているのを見たことがない。Bluetoothイヤホンを付けたおしゃれな人物より地味だからだろうか。
皮肉な余談になるが、これは同時に残酷な現実の裏返しでもある。つまり、あなたは日常の雑務を代行してくれる「本当のアシスタント」——生身の人間——を雇えるほど金持ちではない、ということだ。実際の権力者たちはそれを持っている。雑務を助けてくれる人間のアシスタントだ。真剣なVP、SVP、CXOを見てみれば、彼らは必ず1〜2人の部従を連れている。家庭では料理人や家政婦、プール清掃業者までいるかもしれない。
オタクが作り、一般ユーザーに押しつける設計
次に、より深刻かもしれない問題は、デジタルアシスタントがユーザーの言葉を話せないことだ。単純明快。「自然言語」で指示すれば動くはずと言われるが、実際に機能するのは基本操作のみ。牛乳の注文くらいだ。
アシスタントに本当に仕事をさせようと思えば、プログラマーの思考が必要になり、if-then条件式のような擬似コードで命令しなければタスクは失敗する。例えば、私がノートパソコンを買いたいとする。しかし、何時間も読み比べ、比較検討し、レビューを読み、細かいスペックを確認して初めて、欲しいものが固まるタイプだ。
では、それをどう機械に伝えるのか?「私の好みに合うノートPCを探して」? 無理だ。こう言わなければならない:「14インチ、400ニットの画面、できれば16:10比率で2〜4K解像度、CPUはAMDかIntelの中級クラス、着脱式バッテリー……」。これを頭の中から流暢に並べ立てるのは疲れる。あるいは要件を全部書き出すことになるが、それならそもそもアシスタントは不要だ。時間の節約にはならない。結局、追加の下準備なしに一度自分でやれば済む話であり、機械に実行させて後から確認・検証する手間の方が大きい。鉄則第1条:近道はない。時間は節約できない。そんなのは嘘だ。

あなたの要求を聞いた後の「AI」アシスタント。写真提供:Rock'n Roll Monkey(Unsplash)
信頼できない市場
さらに、仮に超複雑なクエリを作成でき、機械があなたの要求を確実に理解・解釈できたとしても(実際には英語圏の地域アクセントすら苦手で、外国語は論外)、それで何になるのか。機械はどこへ買いに行くのか?
最大の問題は、100%信頼できる市場が存在しないことだ。ネットでも実店舗でも、何もかも確認し、再確認する必要がある。悪意がなくても、人はミスをするし、商品の表示を間違えることもあるし、こちらが細かい点を見落としたり、気が変わったりすることもある。日常生活には無数の選択肢と自己矛盾が溢れており、それを機械にコード化して渡しても、正常な結果は期待できない。人間とは本質的に予測不可能な存在であり、特に個人レベルではそうだ。
信頼の連鎖も正確性の連鎖もない。誰であれ——人間であれ機械であれ——大きな金額の購入を検証もなしに丸投げできるだろうか? ガムならともかく、家具や電化製品となると絶対に無理だ。
経営幹部たちが、自社の技術が素晴らしい成果を出さなかったことに驚いているのを見ると呆れてしまう。人々はアシスタントを些細なことや小額の購入にしか使わず、販売担当者が好むような定期的な反復購入のパターンは一向に確立されなかった。その上、言語・文化の問題、各国のサプライチェーン基盤整備の差、オンラインショップの成熟度、地域配送の可否、運営コスト、そして何より人間の本性が重なり、成立しないモデルが出来上がったのである。
人間は買い物が好き
どんな生物学的理由によるものかはさておき、人間は実際、モノを手に入れる過程に時間を投じるのが好きだ。食べ物でも、服でも、電化製品でも、車でも家具でも、人は小さな個人的判断を積み重ねることで、その品物に自分らしさを加える。それこそが機械との違いなのだ。リビングを整えたいならIKEAで既製品を買ってもいいが、それでも各家庭の仕上がりは異なり、画一的で魂のない製品に個人的なディテールを加えるために膨大な時間と労力が注がれる。
食品を買うときも同じだ。基本の買い物は変わらないが、今日はパンA、明日はパンB、あるいはふとパスタを試してみるかもしれない。それが人間の混沌とした美しさであり、アルゴリズム化は不可能だ。忙しい人でも、オンラインで買い物をする際は依然として、何が必要かを見極める時間を費やす。店舗への移動や配送の手間は省けても、中間の「選ぶ」プロセスは残り、それは人間のものでなければならない。しかし、デジタルアシスタントはまさにそこを担うと約束していたのだ。

写真提供:Atharva Tulsi(Unsplash)
こうして我々は、問題のないのに解決策だけが先行した原点に回帰する。デジタルアシスタントは、忙しくて人生を楽しむ暇もない魂のない企業的人間に向けられ、100%成功が保証された予測購入のユートピア的ネットワークで支えられる存在として宣伝されてきた。しかし実際に起きたのはこうだ。一般ユーザーもガジェット好きも製品を試してみた結果、通常かかるのと同じだけの時間を少し違う形で投入しなければならないことに気づき、大事なお金を喋る箱に預けるのは惜しいと悟り、高額商品の購入が見かけ以上に複雑で予測不能であることを知り、オンラインショップは盲目的には信用できないと学んだ。そして……すべてがナンセンスだったと気づいたのである。
そのシナリオが成立するのは、SF映画の無菌環境だけであって、怒れる人々、交通渋滞、気まぐれな意思決定、氾濫する偽造品に満ちた現実世界では無理だ。最後に忘れてはならないのは、音声ボックスに自分の精密な毎日の予定や購買習慣などを事細かに話すことによる、甚大なプライバシー上の懸念である。
まとめ
私はこの結果にむしろ満足している。これらの技術に取り組んだ人たちのアイデアや製品が水の泡になったことは残念だが、バズワード好きの経営陣を責めるべきだろう。具体例を挙げれば、私は複数のAndroidスマートフォンでGoogleアシスタントを無効化するのに膨大な時間と苛立ちを費やしてきた。それが脇役になり、消えていくのを見るのは心地よい。あれは私にとって、イライラさせられ、無効化するだけで時間を浪費させる以外に何の役にも立たなかったのだ。
要するに、デジタルアシスタントとは効率の悪いもう一人の自分にすぎない。物理的に何かを実行できるわけではなく、自分の考えを機械用の言語で声に出して表現するための通訳にすぎない。すでに社内PMがいるプロジェクトに外部コンサルタントのプロジェクトマネージャーを付けるようなものだ。どちらかといえば、箱に仕えているのはあなたの方で、その逆ではない。考えてみれば高度に皮肉な話だ。それでも人類にはまだ希望があるらしい。一般ユーザーですら騙されなかったのだから、私たちは思ったほど愚かではないのかもしれない。
笑っちゃうけど、冗談はまだ続く。新世代のAIアシスタントが登場したのだ。さようならGoogleアシスタント、Cortana。こんにちはChatGPT、Bard、Copilot。バズワードは鳴り響く。第一ラウンドがうまくいかなかったら、ユーザーが屈するまで何度でもやり直せ。こうして新しいAIだらけになり、同じようなものばかり、ただ名前だけ違う。今回の「全自然」AI実験はうまくいくのだろうか? おそらく無理だ。最新の化身たちは、どんな名前で呼ばれようと、美しい画像を作り、プロのように文章を紡ぎ、魔法のようなことをやってのけるかもしれない。しかし結局のところ、有用であるためには正確な入力が必要で、正確であるためには有用なデータが必要だ。そして、ランダム性と自己矛盾の権化である人間相手では、どれほどの計算能力をもってしても解決できない。だが、見ていこう。新しい連中のことを忘れたと思っていたでしょう? ではまた。
それでは、また。
-
Firefoxが既定ブラウザに設定できない問題の解決法(KDE Plasma・KDE neon編)
以前、KDE neonでNetwork Managerまわりのトラブルに悩まされた話をしましたが、あの日私が直面した問題はそれだけではありませんでした。VPNのテスト作業の一環として、時間を節約するために、Kubuntuで使っていた堅牢化(hardened)されたFirefoxのプロファイルをneon環境へコピーしたのです。広告ブロック、ユーザーエージェント、ポップアップブロック、WebRTC関連の設定など、すべてを一からやり直す気力はありませんでした。実際、Firefoxの優れた点の一つは、プロファイルをマシン間で簡単にコピーできることで、私自身も過去に何度も成功させてきた経験があります。と
-
Vocus.ioレビュー:Chrome拡張機能でGmailをビジネスの強力な武器に変える
本記事はスポンサード記事であり、Vocus.ioの協力により制作されました。掲載内容および意見は、スポンサー案件であっても編集の独立性を保つ筆者自身の見解に基づくものです。 Gmailの弱点を補う拡張機能 Gmailは世界中で広く使われている一方で、Outlook.comやZoho Mailといった競合プラットフォームには存在する機能の一部が欠けています。メールの差し込み送信(メールマージ)、会議日程の調整、連絡先の管理などをGmailで行おうとすると、どこか物足りなさを感じた経験がある方も多いのではないでしょうか。 これは決して大げさな表現ではありません。実際、Gmailが持つポテンシャル