短く言うと
音声アシスタントが読み上げる答えの多くは、CiteAngleがすでに測っているテキストの回答サービスが作っています。 Appleはシリに GoogleのGemini を載せる契約を結んだと報じられました(CNBC・TechCrunch、2026年1月)。 ChatGPTの音声会話は、GPT本体が答えを書きます。 SamsungのGalaxy Bixbyは、ウェブへの質問にPerplexityベースの検索要約と出典カードで答えます(One UI 8.5)。 このうちPerplexityとGPTは、同じ質問を7回ずつ聞いて測る判定対象です。 つまり「声で流れた答えの中で、どのブランドが引用されたか」の多くは、テキストの回答サービスの引用記録で説明がつきます。
声の面だけに残る差もあります。シリの入れ替えのように配信が進んでいる途中のサービス、 スピーカーで読み上げるための短縮、端末側の地域設定などです。 この差は監視項目として追い、形が定まったものから測定に組み入れます。
これが効いてくる場面
読み上げられた答えが違っていても、指させる先はその裏側のテキスト記録だけです。そこに残った分だけが直せる範囲で、記録の外に出た答えは何年も回り続けます。
読み上げられる答えをつくっているのは、その裏側にあるテキストのエンジンです。私たちはそのエンジン側を同じ規格で測ります。提供が進行中のものは、監視項目として日付とともに書き出します。