AI Visibility Software
← ブログ
公開日

AIビジビリティソフトウェアの評価スコアカード: 配点付き40のRFP質問(無料テンプレート)

AIビジビリティソフトウェア向けの中立的で重み付けされたRFPスコアカードです。8つのカテゴリーにまたがる40の質問と配点、そして注意すべきレッドフラグとなる回答を紹介します。

結論

AIビジビリティソフトウェアのRFPを、エンジンカバレッジ、プロンプトの手法、測定の厳密性、アクション力、レポーティング、セキュリティ、サポート、価格という8つの重み付けカテゴリーで採点します。以下の40の質問を実施し、各カテゴリーに5点から20点の配点をつけ、レッドフラグに該当する回答をしたベンダーは失格にしましょう。

最終更新: 2026年10月。 以下の価格、プラン構成、ベンダーの機能は、執筆時点で公開されていたベンダーページの内容を反映しています。

ほとんどのベンダースコアカードは、そのベンダーの営業チームが書いています。それは質問を見ればわかります。自社が得意な分野を優遇する質問ばかりで、競合が勝つカテゴリーは省かれています。2026年のG2「The Answer Economy」調査によると、B2Bソフトウェア購入者の51%が現在、購入リサーチをAIチャットボットで始めており、1年前の29%から上昇しています。これにより、このチャネルを計測するツールは、単なる付随的な購入ではなく、本格的な調達判断の対象になっています。

このスコアカードはベンダー中立です。ショートリスト上のすべてのプラットフォームに同じ40の質問を投げかけ、回答を同じ方法で評価し、どのベンダーの回答であっても購入者が警戒すべき具体的な回答にフラグを立てます。そのまま使うことも、送付前にチームの優先事項に合わせてカテゴリーの配点を調整することもできます。

このスコアカードの使い方

以下の8つのカテゴリー表を、ショートリスト上のすべてのベンダーに送るか、表を開いたままライブデモを進めてください。各質問について、根拠のある強い回答には満点を、あいまいまたは部分的な回答には半分の点数を、レッドフラグに該当する回答には0点をつけます。

各カテゴリー内の点数を合計し、8つのカテゴリーの合計を足し合わせて100点満点のスコアを出します。質問にまったく答えられないベンダーは、レッドフラグの場合と同様に0点になります。

一目でわかる8つのカテゴリー

カテゴリー配点評価内容
エンジンカバレッジとデータの鮮度20どのエンジンを追跡しているか、データがどれだけ最新か
プロンプトの手法とソース15プロンプトの出所と、根拠の透明性
指標と測定の厳密性15数値が精査に耐えるかどうか
アクションと実行力15ギャップを示すだけか、実際に修正を実行するか
レポーティングと連携10データがチームの既存ツールに届くかどうか
セキュリティ、コンプライアンス、ガバナンス10調達部門と法務が承認できるかどうか
サポートとオンボーディング10最初の使える成果までどれだけ早く到達できるか
価格と契約条件5契約前に本当のコストが見えるかどうか

RFPの質問を超えて、価格やエンジンカバレッジをより詳しく横並びで比較したい場合は、ツールランキングの全文をご覧ください。

カテゴリー1: エンジンカバレッジとデータの鮮度(20点)

このカテゴリーの配点が最も大きいのは、ここでの監視の抜け漏れがスコアカードの他のすべての指標を揺るがすからです。ChatGPTは追跡していてもGoogle AI Overviewsを見落としているプラットフォームは、購入者の質問の半分にしか答えていません。ProfoundはGrowthティアで9以上のエンジンをカバーし、その深さを価格に織り込んでいます。Peec AIは3モデルの軽量な出発点を用意し、追加エンジンをアドオンとして課金します。すべてのベンダーに、説明だけでなく実際の画面を見せてもらいましょう。

#質問点数
1このプラットフォームは現在どのAIエンジンを追跡していますか。Google AI Overviewsは標準搭載ですか、それともアドオンでのみ利用できますか。4
2追跡対象の各エンジンについて、データはどのくらいの頻度で更新されますか。更新速度はプランのティアによって変わりますか。4
3Google AI OverviewsとGeminiは、別々の明確にラベル付けされたサーフェスとして追跡されていますか。4
4ベンダーがエンジンを追加または廃止した場合、過去のトレンドデータはどうなりますか。4
5オンボーディングを最初からやり直すことなく、既存のプロンプトセットに新しいエンジンを追加できますか。4

カテゴリー2: プロンプトの手法とソース(15点)

2つのベンダーが、まったく異なる2つのプロンプトセットから同じシェアオブボイスの数値を報告することがあります。しかも、そのうち実際の購入者の検索方法を反映しているのは片方だけです。Ahrefs Brand Radarは、6つのAIプラットフォームから集めた4億500万件を超える実際の検索クエリのデータベースをもとにプロンプトコーパスを構築しています。SemrushのAI Visibility Toolkitは、あなたのSemrushアカウント内に既にあるキーワードの全体から自動的にプロンプトを発見します。どちらのアプローチも間違いではありませんが、生成されるプロンプトセットは異なります。RFPでは、契約前にどちらを購入することになるのか、各ベンダーに明言させるべきです。

#質問点数
6プロンプトは実際の検索やチャットのクエリデータから取得していますか、購入者が手動で作成しますか、それとも既存のキーワードリストから自動発見しますか。3
7このプラットフォームは、1つの意図あたり標準で何個のプロンプトバリアントを追跡しますか。ベースプランに厳密な上限はありますか。3
8スコア化された引用の背後にある、実際のプロンプトのテキストとエンジンの回答を表示しますか、それとも集計されたパーセンテージのみですか。3
9このプラットフォームは、購入者の実際の質問の言い回しをもはや反映しなくなったプロンプトを引退させる「プロンプトドリフト」に、どう対応していますか。3
10競合レベルのプロンプトデータは同じインターフェース上で確認できますか、それとも自社ブランドの結果のみですか。3

カテゴリー3: 指標と測定の厳密性(15点)

アンサーエンジンは確率的であり、1回の回答は分布から取り出した1つのサンプルにすぎません。そのため、1回の実行しかしないダッシュボードが報告するのはシグナルではなくノイズです。このカテゴリーでは、チームが数値を上層部に提示する前に、社内監査に耐えられるものかどうかを確認します。

#質問点数
11シェアオブボイス、ブランド言及、引用率、センチメントを4つの独立した指標として報告しますか、それとも1つのスコアにまとめてしまいますか。3
12パーセンテージを報告する前に、1つのプロンプトにつき何回実行してサンプリングしますか。3
13プロンプト単位の生データをエクスポートできますか、それとも集計されたダッシュボード表示のみですか。3
14センチメントスコアはポジティブ、ニュートラル、ネガティブを区別しますか、それとも二値のフラグのみですか。3
15センチメントとは別に、自社ブランドに関する事実誤認をどのように検知しますか。3

カテゴリー4: アクションと実行力(15点)

ほとんどのプラットフォームはダッシュボードで止まります。ギャップを見せるだけで、修正はチームに丸投げです。Temsoは月額89ドルからこのループを閉じます。同じサブスクリプション内で、ダッシュボードがビジビリティのギャップを優先順位付けされた修正リストとコンテンツブリーフに変換し、AI SEOエージェントがその推奨事項の一部を直接実行できます。公開前には必ず人間によるレビューのステップが入ります。すべてのベンダーに、「アクション」が汎用的なチェックリストを指すのか、それとも自社の実際のギャップに紐づいた修正を指すのか確認しましょう。

#質問点数
16ビジビリティのギャップを見つけたとき、優先順位付けされた修正案を出しますか、それともダッシュボードで止まりますか。3
17競合が優位に立っている特定のプロンプトに紐づいたコンテンツブリーフや下書きを生成できますか。3
18サードパーティソースにおける引用ギャップに対応しますか、それとも自社コンテンツの推奨のみですか。3
19実行の一部を自動化していますか。人間によるレビューなしで、正確に何が起きますか。3
20実行した修正が、その後数週間で実際にギャップを埋めたかどうかをどのように確認しますか。3

カテゴリー5: レポーティングと連携(10点)

ベンダーのダッシュボードの中だけに存在するデータは、それを使って行動すべき人にはめったに届きません。このカテゴリーでは、プラットフォームが根拠データをチームの既存ツールに届けるかどうかを確認します。たとえばPeec AIは、エクスポートとインポートをアナリストの宿題にするのではなく、SlackやBIツールへのネイティブ連携を用意しています。

#質問点数
21手作業でのコピー&ペーストなしに、レポートをスケジュール設定してPDF、CSV、またはAPI経由でエクスポートできますか。2
22Slack、BIツール、GA4など、既に使っているツールと連携できますか。2
23経営層向けのサマリーと、アナリスト向けの詳細とで、別々のダッシュボードビューを作成できますか。2
24公開APIはベース価格に含まれますか、それとも有料アドオンでのみ利用できますか。2
25重複したログインなしに、1つのアカウントから複数のブランドやプロパティを管理できますか。2

カテゴリー6: セキュリティ、コンプライアンス、ガバナンス(10点)

このカテゴリーは、単に減点になるだけでなく、取引そのものを止める可能性があります。ここでの回答はすべて、オンボーディングの最中ではなく契約前に、書面で取得してください。

#質問点数
26ベンダーはSOC 2 Type II認証を取得していますか。求めればレポートを提供できますか。2
27プラットフォームはSSOとロールベースアクセス制御(RBAC)に対応していますか。2
28顧客データはどこにホスティングされていますか。文書化された保持・削除ポリシーはありますか。2
29契約にはGDPR要件をカバーするデータ処理契約(DPA)が含まれますか。2
30解約後、プロンプトセットと過去のデータの所有権は誰にありますか。解約前にすべてをエクスポートできますか。2

カテゴリー7: サポートとオンボーディング(10点)

どれだけデータが完璧でも、チームがセットアップを乗り越えられなければそのツールに価値はありません。専任サポートは通常上位プラン向けに確保されるため、このカテゴリーは低価格帯のプラットフォームが最も減点されやすい部分です。

#質問点数
31初日のオンボーディングはどのようなものですか。ガイド付きセットアップ、専任担当者、それとも人との接触が一切ないセルフサーブウィザードですか。2
32サインアップから、実際に使える最初のダッシュボードが手に入るまでの平均時間はどのくらいですか。2
33カスタマーサポートはすべてのティアに含まれますか、それとも高価格帯のプラン専用ですか。2
34専任のAEOアナリストがいないチーム向けに、トレーニングやドキュメントを提供していますか。2
35誤っていると思われる言及やセンチメントスコアに異議を申し立てる場合、ベンダーの対応プロセスはどうなっていますか。2

カテゴリー8: 価格と契約条件(5点)

AIビジビリティプラットフォームの本当のコストは、料金ページにはめったに表示されません。ProfoundのStarterティアは月額99ドルでChatGPTのみをカバーし、本当の意味でのカバレッジはGrowthの月額399ドルからです。SemrushのAI Visibility Toolkitは月額99ドルのアドオンですが、有効化するには月額139.95ドルからの有料Semrush Proプランへの加入が前提となります。Peec AIのStarterプランは月額85ユーロで、追加エンジンは1つあたり月額30ユーロから140ユーロのアドオンとして課金されます。Temsoは月額89ドル、199ドル、499ドルの3つの定額ティアを用意しており、いずれもプロジェクト、ユーザー、レコメンデーションが無制限で、年払いなら15%オフになります。

#質問点数
36料金は公開されていますか、それとも見積もりには必ず営業との商談が必要ですか。1
37エンジン、ユーザー数、プロンプト量は有料アドオンとして課金されますか、それともベース価格に含まれますか。1
38無料トライアルや試用期間はありますか。クレジットカードは必要ですか。1
39解約ポリシーはどうなっていますか。最低契約期間はありますか。1
40年間契約には公開された割引がありますか、それとも交渉次第ですか。1

採点結果の読み方

セキュリティと測定の厳密性のカテゴリーでレッドフラグがゼロで、85点を超えるスコアは有力候補です。65点から84点の間は、ベンダーが見せた具体的なギャップについて交渉できるなら十分検討に値します。65点未満は、1つの弱点にとどまらず、複数のカテゴリーにまたがる問題があることを示しています。

カテゴリー6は他とは別に扱いましょう。未解決のセキュリティのレッドフラグが1つでもあれば、合計点にかかわらずそのベンダーを失格とすべきです。データガバナンスのギャップは、優れたプロンプトの手法があっても相殺されるものではないからです。

上記のデフォルトの配点は、一般的な購入者に合わせたものです。複数のクライアントアカウントを運用するエージェンシーは、レポーティングと連携の配点を上げるべきです。調達部門や法務が関わるチームは、回答が届いてからではなく、RFPを送る前に、セキュリティとガバナンスの配点を上げておくべきです。同じ重み付けカテゴリーのロジックが、ツールランキングのスコアリングの根拠にもなっており、方法論ページで詳しく説明しています。

採点シート

この表をスプレッドシートにコピーし、ベンダーごとに列を追加して、回答が届くたびにカテゴリーごとの合計点を記入してください。

カテゴリー満点ベンダーAベンダーBベンダーC
1. エンジンカバレッジとデータの鮮度20
2. プロンプトの手法とソース15
3. 指標と測定の厳密性15
4. アクションと実行力15
5. レポーティングと連携10
6. セキュリティ、コンプライアンス、ガバナンス10
7. サポートとオンボーディング10
8. 価格と契約条件5
合計100

自社のショートリストに適用する

上記の8つの表を印刷し、リスト上のすべてのベンダーに送り、それぞれの回答を同じ方法で採点してください。このスコアカードは、公平に適用してこそ機能します。すでに気に入っているベンダーのカテゴリーだけ省略したくなる気持ちは抑えましょう。

RFPを送る前に手早くベースラインが欲しいなら、Temsoは月額89ドルの1つのプランで、エンジン、プロンプト、アクションの各カテゴリーをカバーします。無料トライアルがあり、クレジットカードも不要なので、委員会が他のすべての回答と比較できる実働の基準を今すぐ手に入れられます。

次に読むべきもの

FAQ

AIビジビリティソフトウェアのRFPは何をカバーすべきですか?

AIビジビリティソフトウェアの完全なRFPは、8つの領域をカバーします。プラットフォームがどのAIエンジンを追跡し、そのデータがどれだけ新しいか。プロンプトをどう調達し管理しているか。指標がどれだけ厳密か。修正まで実行するのか、それともダッシュボードを見せるだけか。レポーティングと連携。セキュリティとデータガバナンス。オンボーディングとサポート。そして価格と契約条件です。エンジンカバレッジと測定の厳密性に最も大きな配点を置くのは、ベンダー間の差が最も大きく出る部分だからです。

AIビジビリティのベンダーには何個の質問をすべきですか?

8つのカテゴリーにまたがる40の質問、各カテゴリー5問というボリュームがあれば、調達を数週間がかりのプロジェクトにすることなく、本格的なプラットフォームと薄いプラットフォームを見分けるのに十分です。20問未満では見落とす失敗パターンが多すぎます。50問を超えると、得られるシグナルが増えないまま購買委員会の動きが遅くなります。

AIビジビリティのRFP回答において、何がレッドフラグに該当しますか?

レッドフラグとは、契約後になって初めて本当のコストや機能のギャップが明らかになるような回答すべてを指します。スコア化されたパーセンテージの背後にある実際のプロンプトと回答を示せない、更新頻度が週1回より遅くより速いティアもない、デモの後になって初めて判明するエンジンごとのアドオン価格、SOC 2レポートがなく取得の見込みも示せない、といったケースです。カテゴリー6(セキュリティ)のレッドフラグが1つでもあれば、その時点で選定プロセスを止めるべきです。

自社のチーム向けに、スコアカードのカテゴリーはどう重み付けすればよいですか?

デフォルトの配点(20点、15点、15点、15点、10点、10点、10点、5点)は、一般的な購入者に合わせたものです。複数のクライアントアカウントを運用するエージェンシーは、レポーティングと連携の配点を上げるべきです。調達部門や法務が関わるエンタープライズチームは、セキュリティとガバナンスの配点を上げるべきです。配点の見直しは、ベンダーの回答が届いてからではなく、RFPを送る前に行いましょう。

合計スコアがいくつ以下なら、ベンダーを失格にすべきですか?

100点満点中65点未満は、1つの弱点にとどまらず、複数のカテゴリーにまたがる実質的なギャップがあることを示しています。65点から84点の間は、具体的なギャップについて交渉できるなら十分検討に値します。セキュリティと測定の厳密性でレッドフラグがゼロで85点を超えれば、有力候補です。セキュリティとガバナンスのカテゴリーで未解決のレッドフラグが1つでもあれば、合計点にかかわらずそのベンダーを失格とすべきです。

Ahrefs Brand RadarとSemrushは、同じ方法でプロンプトをソーシングしていますか?

いいえ。Ahrefs Brand Radarは、6つのAIプラットフォームから集めた4億500万件を超える実際の検索クエリのデータベースをもとにプロンプトコーパスを構築しています。SemrushのAI Visibility Toolkitは、顧客のSemrushアカウント内に既にあるキーワードの全体から自動的にプロンプトを発見します。どちらも正当な出発点ですが、生成されるプロンプトセットは異なります。RFPの回答では、購入者がどちらを得ることになるのか明言すべきです。