2026年のおすすめAI音声エージェント8選、運用者別に比較

Rama Adi
執筆者

Rama Adi

Katelin Teen
レビュー者

Katelin Teen

最終更新 September 29, 2026

専門家による検証済み
電話をかける人の声が、通話タイマーと波形の上に並ぶ4枚のAIエージェントカードへ流れ込む手描きイラスト

基盤のモデルは数週間ごとに変わる

私はeeselで連携機能を構築しており、ここ数年の仕事の大部分は、AIエージェントが実際のサポートキューで稼働するのを見守ることでした。ひとつの教訓は、音声にもほぼそのまま当てはまります。デモで見栄えのするエージェントは、実際の顧客が電話をかけ始めたときに持ちこたえるエージェントと、めったに同じではありません。だからこそ、eeselのすべての導入は、公開前に過去のチケットに対してシミュレーションされます。最初にお伝えしておくと、eeselは音声エージェントを販売していないので、このリストは私にとって率直に書きやすいものです。

購入の考え方を変えるべき変化は、数字に表れています。8月時点で、Artificial Analysisのtau-Voiceベンチマークの最高スコアは56.5%で、Grok Voice Think Fast 2.0が保持していました。tau-Voiceはサポートを軸に作られた唯一の音声ベンチマークで、模擬の発信者が実際の問題を抱えてエージェントに電話し、データベースが正しい状態になった場合にのみスコアが加算されます。9月29日には、Gemini 3.8 Live Extended Thinkingが68.6%に達し、OpenAIのGPT-Live-1の2つのバリアントも以前の上限を超えていました。

tau-Voiceのサポート通話解決スコアの手描き棒グラフ:Gemini 3.8 Live Extended Thinking 68.6%、GPT-Live-1 Astra 67.9%、GPT-Live-1 Sol 59.3%、Grok Voice Think Fast 2.0 56.5%、8月の上限を56.5%で示している
tau-Voiceのサポート通話解決スコアの手描き棒グラフ:Gemini 3.8 Live Extended Thinking 68.6%、GPT-Live-1 Astra 67.9%、GPT-Live-1 Sol 59.3%、Grok Voice Think Fast 2.0 56.5%、8月の上限を56.5%で示している

ここから2つのことが言えます。1つ目は、最高のモデルでも、現実的なサポート通話の約31%で失敗するということです。したがって、きれいな人への引き継ぎは、オプション扱いにできるものではありません。2つ目はロックインです。1つのモデルに縛られるプラットフォームは1四半期で遅れをとります。以下のうち、自分のモデルを持ち込めるプラットフォーム(Vapi、Retell、Deepgram、Parloa)は、そうでないものより長持ちする傾向があります。

速度ももはや本当のボトルネックではありません。Deepslate Opalはボード上で最速級のモデルのひとつで、最初の音声までが0.44秒ですが、tau-Voiceの通話の17.5%しか解決できません。一方、Grok Voice Think Fast 2.0は0.70秒で56.5%です。ですから、ベンダーがレイテンシを前面に出してきたら、代わりにタスク完了率を尋ねることをおすすめします。Hacker Newsの開発者たちも、以前から同じことを指摘しています。

Hacker News

"I've generally observed latency of 500ms to 1s with modern LLM-based voice agents making real calls. That's good enough to have real conversations."

"AI will never be able to answer 100% of the questions... I need an AI who is only handling the tickets that it's confident to handle and all the other ones, leave them alone."

DTCサプリメント企業のCX責任者、eeselの営業通話にて

この発言はテキストサポート側の購入者のものですが、音声エージェントへの要件としても同じように通用します。

この8製品の選び方

出発点は、サポートや運用のチームが音声エージェントを比較するときに繰り返し名前が挙がるプラットフォームでした。そこから、価格を出せないもの、検証できないものを除外しました。Gemini LiveやGrok Voiceのような素の音声モデルは、車ではなくエンジンにあたるため、項目としては外しました。周りに電話番号、ツール、テスト、引き継ぎを構築する必要があるからです。また、Sierraも、音声サポートの比較記事ですでに詳しく扱っているため省きました。

この分野が初めてなら、まずAI音声エージェントの仕組みから始めると役立ちます。電話サポートだけが目的なら、私の電話サポートのおすすめが、ヘルプデスク側からこのテーマに迫っています。私が重視した基準は次のとおりです。

  1. 誰が構築し、保守するか。 開発者向けAPI、設定して使う構築プラットフォーム、あるいはマネージドサービス。
  2. 見出しではなく、実際の分単価。 モデルと音声、そして電話回線が料金に含まれているかを確認することを意味します。
  3. モデルの選択。 より良いものが出たときに、LLMや音声を入れ替えられるか。
  4. 根拠。 ある場合はベンチマークやアリーナの結果、加えてG2、Reddit、Hacker Newsのユーザーが実際に報告している内容。
  5. コンプライアンスと規模。 SOC 2、HIPAA/BAAの条件、同時通話数の上限、SLA。

分類の大半は最初の基準で決まります。8製品がそれによってどう分かれるかは次のとおりです。

音声エージェントを運用者で分類した3つの手描きの列:自分で構築(Vapi、Deepgram Voice Agent、Retell AI)、自分で設定(ElevenLabs Agents、Bland AI)、ベンダーが運用(PolyAI、Parloa、Synthflow)。矢印は、より多くの制御からより任せきりへ向かう
音声エージェントを運用者で分類した3つの手描きの列:自分で構築(Vapi、Deepgram Voice Agent、Retell AI)、自分で設定(ElevenLabs Agents、Bland AI)、ベンダーが運用(PolyAI、Parloa、Synthflow)。矢印は、より多くの制御からより任せきりへ向かう

おすすめAI音声エージェント一覧

すべての価格は各ベンダー自身の料金ページのもので、2026年9月29日に確認しました。

ツール最適な用途運用者課金単位公開されている入門価格LLM+音声は料金に含まれるか独自モデルの持ち込み無料クレジット同時通話数(入門)コンプライアンス稼働率SLA
Retell AI自社で電話エージェントを構築するチーム自分で構築分単位、内訳あり$0.07-$0.31/分はい、内訳ありはい(LLM、TTS)$1020通話SOC 2、HIPAA対応、EnterpriseでBAA非公開
ElevenLabs Agents音声品質と予測しやすい分数自分で設定月ごとの分数バンドル$6/月(75分)音声は含む、LLMは別LLMを選択可月15分6通話EnterpriseでBAAEnterpriseで個別設定
Vapiすべてを細かく設定したい開発者自分で構築$0.05/分+プロバイダー原価$0.05/分の手数料いいえ、原価をそのまま転嫁はい、フルカタログ$54通話HIPAAは月$2,000のアドオン有料パッケージで99%-99.9%
Deepgram Voice Agent API最安のバンドルAPI自分で構築接続1分あたり$0.075/分はいはい(LLM、TTS)$200、期限なし45通話SOC 2 Type 2、GDPR、EnterpriseでBAA非公開
Bland AI1つの定額オールイン料金自分で設定分単位、定額$0.14/分はいいいえ非公開10通話SOC 2 Type II、BAA付きHIPAA、PCI DSS全プランで99.9%
PolyAIマネージドのエンタープライズ音声ベンダーが運用分単位、見積もり見積もりのみはいいいえ(独自のRavenモデル)なし個別設定SOC 2、HIPAA、GDPR、PCI DSS電話回線で99.9%
Parloa欧州の多言語コンタクトセンターベンダーが運用見積もり見積もりのみはいはい(STT、TTS、LLM)なし個別設定SOC 2、ISO 27001、GDPR非公開
SynthflowGoHighLevelやHubSpotと組み合わせる営業主導の導入ベンダーが運用年間契約年$30,000からはい非公開なし個別設定SOC 2、GDPR、HIPAA、ISO 27001のバッジ契約で規定

1か月の通話に実際いくらかかるか

見出しの料金は、ベンダーごとに1分に含める内容が違うため、実際には比較できません(AIカスタマーサービスのコスト全般に共通する問題です)。下でボリュームを選ぶと、同じ通話分数での各オプションのプラットフォーム費用がわかります。

通話量別の月額プラットフォーム費用

同じ分数、8ベンダー。電話回線の費用は含みません(1分あたり約$0.008-$0.015を加算してください)。

ベンダー月額費用内訳
Deepgram$75Standard Voice Agent APIが$0.075/分
Retell AI$70-$230最低$0.07/分からRetell自身の計算例$0.23/分まで
Vapi$82-$129Vapi自身の見積もり:手数料$50に、文字起こし・LLM・音声を原価で加算
ElevenLabs Agents~$100Proプラン$99(1,238分)に、LLM約$1
Bland AI$140Startプランが$0.14/分、プラットフォーム料金なし
Synthflow$2,500+ボリュームに関係なく、年$30,000の契約下限
PolyAI, Parloa見積もり公開料金なし
ベンダー月額費用内訳
Retell AI$350-$1,150最低$0.07/分から計算例$0.23/分まで
Deepgram$375Standard Voice Agent APIが$0.075/分
ElevenLabs Agents~$406Scaleプラン$299(3,738分)+1,262分×$0.08+LLM約$6
Vapi$410-$6451,000分あたりのVapi見積もりを拡大;同時通話が4を超える場合は有料パッケージが必要
Bland AI$700Startプランが$0.14/分
Synthflow$2,500+年$30,000の契約下限
PolyAI, Parloa見積もり公開料金なし
ベンダー月額費用内訳
Retell AI$1,400-$4,600最低$0.07/分から計算例$0.23/分まで
Deepgram$1,500従量課金$0.075/分(年$4,000以上のGrowthプランでは$0.068)
ElevenLabs Agents~$1,624Businessプラン$990(12,375分)+7,625分×$0.08+LLM約$24
Vapi$1,640-$2,580拡大した見積もり、同時通話パッケージ前
Bland AI$2,699Buildプラン:手数料$299+$0.12/分(Startは1日100通話が上限)
Synthflow$2,500+年$30,000の契約下限
PolyAI, Parloa見積もり公開料金なし

出典:各ベンダーの料金ページ、2026年9月29日。ElevenLabsのLLM費用は、掲載されているGemini 2.5 Flashの料金$0.0012/分を使用しています。

ここから見えるパターンは、少量の利用では、従量課金のAPIが最も安いということです。ElevenLabsのようなバンドルは、約5,000分以上でDeepgramと数パーセント以内の差に収まります。Retellの範囲が広いのには理由があります。選ぶLLMが請求額を最も大きく動かすからで、同社自身の例では、1分$0.230のうちLLMが$0.160を占めます。これらの範囲の上限でも、AIの1分は人が対応する1分のほんの一部にすぎません。これがAIエージェントと人間のエージェントのコスト比較の背景にある計算です。

2026年のおすすめAI音声エージェント8選

比較しやすいよう、どの製品も同じ構成にしています。誰に最適か、何が目立ったかに続き、長所、短所、料金、私の見解です。

1. Retell AI

最適な用途: すべての部品を手作業で組み立てずに、自社の電話エージェントを構築したいチーム。

Retell AIのパネル。会話フローのキャンバス、OpenAI 4o-miniに設定されたエージェントのプロンプトエディタ、台本どおりの予約のやり取りを実行するTest Audioパネルが表示されている。出典:Retell AI
Retell AIのパネル。会話フローのキャンバス、OpenAI 4o-miniに設定されたエージェントのプロンプトエディタ、台本どおりの予約のやり取りを実行するTest Audioパネルが表示されている。出典:Retell AI

Retell AIは、素のAPIとノーコードビルダーのちょうど中間に位置します。キャンバスまたはプロンプトでフローを設計してブラウザでテストし、メニューからLLMと音声を選びます。構築する側として気に入っているのは、Retellの料金ページがすべての層を明細化していて、1分がどこに使われているか正確にわかることです。音声インフラが$0.055、TTSが$0.015から、Retell番号での通信が$0.015、そして選んだLLMです。

アドオンは小さく、ページもそれを正直に示しています。ナレッジベースは1分あたり$0.005、PII削除は$0.01、AI QA(通話の自動採点)は最初の100分が無料で、それ以降は1分あたり$0.10です。同時通話20件が無料で付くのも、Vapiの4件と並べれば太っ腹です。

Redditで最も多い称賛は、会話の扱い方についてです。Bland、Synthflow、Retellを比較したある開発者は、r/AI_Agentsのテストで、違いは「was in how it handled interruptions and off-script stuff」だったと述べています。ただ、満足しているユーザーでも請求額は指摘しています。

G2

"The pricing can also become expensive when scaling or doing many test calls during development."

長所

  • すべてのコスト層が明細化されているため、モデルを決めれば予算が読みやすい
  • 無料の同時通話20件と、開始用の$10クレジット
  • 作り直さずにLLMや音声(1分$0.040のElevenLabs音声を含む)を入れ替えられる

短所

  • 範囲が広い:プレミアムLLMを使うと、1分が$0.07から$0.23以上になることも
  • 料金ページにヘルプデスク連携の記載なし。チケット連携はWebhookとAPI経由
  • BAAとSSOは個別のEnterprise条件

料金

項目価格
音声エージェント(従量課金)$0.07-$0.31/分
Retellのページにある計算例$0.230/分(LLM $0.160+音声インフラ $0.055+TTS $0.015)
Retell番号での通信$0.015/分(自前のSIPなら無料)
電話番号$2/月
追加の同時通話1通話あたり月$8
AI QA$0.10/分、最初の100分は無料
Enterprise個別見積もり、同時通話50件以上から

詳しくは、私のRetell AIの料金の解説をご覧ください。ユーザーの評価についてはRetell AIのレビューをまとめた記事で扱っており、Retell AIの代替の別リストもあります。

私の見解: ほとんどのチームにまず勧めるのはRetellです。技術に明るい人が1人いて、数日でリリースしたいなら選んでください。プロンプトとテストを引き受けたい人がチームにいないなら見送りましょう。その部分は自分たちの責任のまま残るからです。決め手はLLMの選択なので、まずそこから価格を出してください。

2. ElevenLabs Agents

最適な用途: エージェントの声の聞こえ方を最も重視し、月々の請求額が予測できることを望むチーム。

33.9K通話、平均通話時間3:46、全体の成功率75.1%、CSAT平均3.5つ星を表示するElevenAgentsのコンソール。出典:ElevenLabs
33.9K通話、平均通話時間3:46、全体の成功率75.1%、CSAT平均3.5つ星を表示するElevenAgentsのコンソール。出典:ElevenLabs

ElevenLabsは音声合成で名を上げ、そのエージェントプラットフォーム(ElevenAgents)もその評判を引き継いでいます。ただ、私が驚いたのは、音声ではなくタスク成功に関する根拠でした。Artificial AnalysisのSpeech Agent Arenaでは、有償の参加者が同じシナリオで2つのシステムとブラインドでライブ通話を行いますが、ElevenLabs Agentsは773サンプルでツール呼び出し成功率90.5%を記録し、アリーナ内の完全なエージェントプラットフォームでは最高です。

Speech Agent Arenaのツール呼び出し成功率の手描き棒グラフ:ElevenLabs Agents 90.5%、Cartesia Line 77.5%、Deepgram Voice Agent 73.7%、Inworld Realtime 69.9%、差は20.6ポイント
Speech Agent Arenaのツール呼び出し成功率の手描き棒グラフ:ElevenLabs Agents 90.5%、Cartesia Line 77.5%、Deepgram Voice Agent 73.7%、Inworld Realtime 69.9%、差は20.6ポイント

同じライブ通話でプラットフォーム間に20.6ポイントの差があるというのは、モデルだけでなくプラットフォームが重要だという、これまで見た中で最良の論拠です。

料金は、月ごとの分数バンドルとして提供されます。有料のどの階層も、含まれる1分あたり約$0.08で、超過分も1分$0.08です。同時通話の上限を超えると「burst」分が$0.16で課金されます。それに加えて、LLMはモデルごとに課金され(Gemini 2.5 Flashは1分$0.0012と記載)、電話回線はTwilioまたはSIP経由で自分で用意します。

公開前に知っておくべき不満は、転送ステップに関するものです。Redditのある開発者は、transfer_to_numberが通話を転送しないことについて、かなりはっきりと述べています。

Reddit

"I am telling I am suffering from the clients, complaining that they cannot transfer, this is really bad from ElevenLabs"

どのプラットフォームを選ぶにしても、人への引き継ぎは初日にテストしてください。

長所

  • ライブアリーナで、あらゆるエージェントプラットフォーム中最高のツール呼び出し成功率(90.5%)
  • 音声品質と音声ライブラリは、このリストで最も強力
  • 本物の無料枠(月15分)と$6のスタータープラン

短所

  • どのバンドルも1分約$0.08になるため、Enterprise未満ではボリュームディスカウントがない
  • バーストの分は2倍のため、通話が急増するパターンでは、平均量から想定するより大きなプランが必要
  • SOC 2とデータレジデンシーはエージェントの料金ページに記載なし。BAAはEnterpriseのみ

料金

プラン月額含まれる分数同時通話数
Free$0154
Starter$6756
Creator$22(初月$11)27510
Pro$991,23820
Scale$2993,73830
Business$99012,37540
Enterprise個別見積もり個別見積もり拡大

超過$0.08/分、バースト$0.16/分、テキスト$0.003/メッセージ。ElevenLabsのエージェント料金に基づきます。ElevenLabsの料金ガイドがさらに詳しく、ElevenLabsの代替のリストでは近い競合を扱っています。

私の見解: エージェントがブランドの声であり、通話量が安定しているならElevenLabsを選んでください。通話が急激なスパイク状に来るなら見送りましょう。バースト料金がまさにそのパターンに厳しいからです。決め手は、月間の分数がバンドルの境目に近いかどうかです。

3. Vapi

最適な用途: すべてのプロバイダーを自分で選び、プラットフォーム手数料を最小に抑えたい開発者。

Deepgram、GPT 4o-mini、Azureのプロバイダーチップと、1分あたりのコストや約450msのレイテンシのメーターを表示するVapiのアシスタントビルダー。出典:Vapi
Deepgram、GPT 4o-mini、Azureのプロバイダーチップと、1分あたりのコストや約450msのレイテンシのメーターを表示するVapiのアシスタントビルダー。出典:Vapi

Vapiはオーケストレーション層です。1分あたり$0.05のホスティング料金がかかり、各モデルプロバイダー(文字起こし、LLM、音声)は上乗せなしで「at cost」で転嫁されます。Vapi自身の見積もりツールによれば、現実的な1,000分は月$82〜$129で、その内訳は手数料$50、Deepgramが約$10、OpenAIが$8〜$45、ElevenLabsが$15〜$24です。

落とし穴は、安い階層が小さいことで、同時通話4件、データ保持14日、電話番号1つです。それ以上に伸ばすには「Success Package」の購入が必要です。Coreは月$29で10通話、Proはホスティング料金の10%(月額最低$999)で30通話と99%の稼働率SLAが付きます。HIPAAはさらに月$2,000のアドオンです。

レビュアーが評価するのは主に柔軟性です。私が見つけた最も厳しい不満は、そのHIPAAアドオンについてのもので、Cartesiaに乗り換えたチームからのものでした。

G2

"They doubled the price for HIPAA compliance overnight with no warning (from $1K/month to $2K/month), and their support was terrible."

長所

  • このリストで最も低いプラットフォーム手数料で、モデル費用への上乗せなし
  • モデルの完全なカタログ:文字起こし、LLM、音声のどれでも入れ替え可能
  • Vapi SIPとWebRTCのトランスポートは無料

短所

  • パッケージを買う前は同時通話が4件のみ
  • レイテンシは連結するプロバイダーに依存し、レビュアーはばらつきがあると報告
  • HIPAAは月$2,000の追加費用

料金

項目価格
ホスティング料金$0.05/分
モデルプロバイダー原価、上乗せなし
Coreパッケージ$29/月(同時通話10件、保持30日)
Proパッケージホスティング料金の10%、月額最低$999(30通話、99% SLA)
Premier営業に問い合わせ(99.9% SLA、SSO)
HIPAA$2,000/月
追加の同時通話1回線あたり月$10
Twilioの電話料金着信$0.008/分、発信$0.014/分

私の見解: Vapiは、音声エージェントを自社プロダクトとして扱うエンジニアリングチーム向けです。より良いモデルが出た週にモデルを切り替えたいなら選んでください。小さな予算で本番の同時通話数とコンプライアンスが必要なら見送りましょう。パッケージとHIPAAがすぐに積み上がるからです。決め手は同時通話数です。

4. Deepgram Voice Agent API

最適な用途: 音声ループ全体を1つのAPIで、バンドル最安値で使いたいチーム。

Voice Agentタブに表示されたDeepgramのプレイグラウンド。カスタマーサポート、営業、ヘルスケアのユースケースプリセット、選択されたDeepgram Fluxの音声、LLMのGoogle Gemini 3.1 Flash Lite、Talk To Your Agentボタンが見える。出典:Deepgram
Voice Agentタブに表示されたDeepgramのプレイグラウンド。カスタマーサポート、営業、ヘルスケアのユースケースプリセット、選択されたDeepgram Fluxの音声、LLMのGoogle Gemini 3.1 Flash Lite、Talk To Your Agentボタンが見える。出典:Deepgram

Deepgramは、他の多くのプラットフォームが裏側で使っている音声認識モデルを作っており、そのVoice Agent APIは、聞く、考える、話すを1つのWebSocketにまとめています。料金は1時間$4.50、つまり1分$0.075で、LLMと音声が含まれ、独自のLLMと音声を持ち込むと$0.050に下がります。

費用をかけずに試すなら、これはリストで最も太っ腹なスタートです。Deepgramの料金には、失効せずカードも不要の$200のクレジットが含まれるからです。従量課金では45の同時エージェントセッションに対応します。上のプレイグラウンドで、コードを書く前にブラウザ上でカスタマーサポートと営業のプリセットを試せます。

見劣りするのはアリーナです。Deepgram Voice AgentはSpeech Agent Arenaで18位、ツール呼び出し成功率は73.7%で、同種の通話ではElevenLabs Agentsより約17ポイント下です。

長所

  • リストで最安のバンドル料金$0.075/分、独自モデルならさらに安い
  • 失効しない$200の無料クレジット
  • SOC 2 Type 1と2、EUエンドポイント付きのGDPR対応、Enterpriseでのセルフホスティング

短所

  • アリーナでのタスク成功率(73.7%)はElevenLabs Agentsより低い
  • APIなので、テスト、分析、引き継ぎは自分で構築する必要がある
  • HIPAAのBAAとセルフホスティングはEnterpriseのみ

料金

階層従量課金Growth(年$4,000以上)
Standard$0.075/分$0.068/分
Standard、独自TTS$0.065/分$0.051/分
独自LLM+TTS$0.050/分$0.041/分
Advanced$0.163/分$0.146/分

WebSocketの接続時間で課金されます。

私の見解: Deepgramは開発者向けのコスパ重視の選択です。1分あたりのコストが制約で、残りを構築することに抵抗がないなら選んでください。テストやダッシュボードまで揃った完成品のプラットフォームが欲しいなら見送りましょう。決め手は、APIの周りのプロダクトをどこまで自分で作る気があるかです。

5. Bland AI

最適な用途: モデル込みの、1分あたり単一の定額料金を望むチーム。

エスカレーションとコールバックのノードを持つテクニカルサポートのフローを示すBland Pathwaysエディタと、Happy Pathゲートが100%、Angry Callerテストが94%と報告するScenariosパネル。出典:Bland AI
エスカレーションとコールバックのノードを持つテクニカルサポートのフローを示すBland Pathwaysエディタと、Happy Pathゲートが100%、Angry Callerテストが94%と報告するScenariosパネル。出典:Bland AI

Bland AIは分かりやすさを売りにしています。料金ページによれば「No token charges」で、LLM、文字起こし、音声のすべてが1分に含まれます。Startは1分$0.14でプラットフォーム料金なし。Buildは1分$0.12に月$299で、Startより得になるのは月14,950分を超えてからです。Blandは無料の階層を含むすべての階層で99.9% SLAも掲げており、ここでそれを掲げているのは他にありません。

Pathwaysエディタは通話フローをノードとして構築し、ドキュメントはエージェントが失敗する箇所について驚くほどオープンで、Bland自身の分析画面のひとつにはツールエラー率34.8%が表示されるほどです。

総ツール実行数408、総エラー数142、エラー率34.8%を報告し、検証エラーとAPIエラーに分けたBlandのツール分析ダッシュボード。出典:Bland AI
総ツール実行数408、総エラー数142、エラー率34.8%を報告し、検証エラーとAPIエラーに分けたBlandのツール分析ダッシュボード。出典:Bland AI

これは、どのベンダーのエージェントも自社のシステムを呼び出すときに起こす現象の正直な姿であり、どのパイロットでも私が注視する指標です。G2では、レビュアーは、何か問題が起きたときのBlandの素早さと対応の良さを主に評価しています。

G2

"There was a point where v2 voices were kind of singing on calls instead of speaking, like they were doing a little bit of voice hallucination - this too was fixed quite quickly. The team is super responsive."

長所

  • オールインの単一料金で、モデルの転嫁費用を追う必要がない
  • すべての階層で99.9% SLA
  • SOC 2 Type IとII、BAA付きHIPAA対応、GDPRとPCI DSSを掲載

短所

  • モデルの選択不可。Blandのバンドルを使う形になる
  • Startは同時通話10件、1日100通話が上限
  • BAA、SSO、データレジデンシー、オンプレミスはEnterpriseのみ

料金

プラン1分あたりプラットフォーム料金同時通話数1日の通話数転送の分数
Start$0.14$010100$0.05/分
Build$0.12$299/月502,000$0.04/分
Enterprise個別見積もり個別見積もり無制限無制限個別見積もり

通信は別途課金で、自前のTwilioまたはSIP、あるいはBlandのものを実費で利用します。

私の見解: 経理が1分あたりの単一の数字を望み、裏でどのモデルが動いているか気にしないならBlandを選んでください。モデル競争に乗り続けたいなら見送りましょう。決め手は、分かりやすさと入れ替えやすさのどちらを取りたいかです。

6. PolyAI

最適な用途: 自前のコールセンター自動化プロジェクトなしで、ベンダーにエージェントの構築、運用、チューニングを任せたいエンタープライズのコンタクトセンター。

サンドボックスのチャットプロンプトと、ナレッジベーストピックの追加や人間のエージェントへの通話転送の処理のスターターテンプレートを表示するPolyAI Agent Studio。出典:PolyAI
サンドボックスのチャットプロンプトと、ナレッジベーストピックの追加や人間のエージェントへの通話転送の処理のスターターテンプレートを表示するPolyAI Agent Studio。出典:PolyAI

PolyAIは、このリストで最も任せきりにできる選択肢です。自社の音声モデルRavenを動かしており、これは「trained on 1B+ enterprise conversations」だと同社は述べています。同じランタイム上に2つの構築パスがあり、非技術系チーム向けのAgent Builderと、開発者向けのADKです。料金は分単位ですが見積もりのみで、PolyAIの料金ページによれば、その料金にはサポートに加え、継続的な性能改善と保守が含まれます。

その見返りとして得られるのはサービスです。すべてのプランに24時間365日の緊急サポート電話回線と、電話回線での99.9%稼働率SLAが含まれ、SOC 2、HIPAA、GDPR、PCI DSSは階層で制限されず標準として掲載されています。成果面では、PolyAIのトップページが、あるホテル・カジノブランドのCMOの言葉として、エージェントが「on track to add just over $7M in incremental revenue」だと引用していますが、これはベンダー自身の顧客事例なので、最良のケースとして読むのがよいでしょう。

長所

  • 継続的なチューニングと24時間365日の緊急サポートを含む、完全マネージド
  • コンプライアンス認証がすべてのプランに含まれる
  • 電話回線で99.9% SLA

短所

  • 公開価格なし。料金を知るには営業プロセスが必要
  • 新しいサードパーティ製モデルは使えず、Ravenに固定される
  • 連携やテストツールは公開ページに記載されていない

料金

項目詳細
課金分単位、年間通話量に応じた見積もり
含まれるもの改善、保守、24時間365日サポート、電話回線の99.9% SLA
公開料金なし

私の見解: 大規模なコンタクトセンターで、プロジェクトではなく成果を求めるならPolyAIを選んでください。デモの前に価格を見たい、あるいはモデルを自分で切り替えたいなら見送りましょう。決め手は、サービスを買いたいのか、能力を築きたいのかです。

7. Parloa

最適な用途: モデルを選べるエンタープライズ管理を望む、欧州や多言語のコンタクトセンター。

1:18時点のParloaの顧客会話ビュー。エージェントが合言葉と生年月日を尋ね、発信者が答え、エージェントが発信者をAuthenticatedとマークしてInformation Updatedを表示している。出典:Parloa
1:18時点のParloaの顧客会話ビュー。エージェントが合言葉と生年月日を尋ね、発信者が答え、エージェントが発信者をAuthenticatedとマークしてInformation Updatedを表示している。出典:Parloa

Parloaは自社製品をAI Agent Management Platformと呼び、設計、テスト、デプロイ、モニタリングをカバーします。PolyAIと違う点が2つあります。第一に、Parloaのプラットフォームページによれば、独自の音声認識、音声合成、LLMを持ち込めるため、1つのモデルに縛られません。第二に、テストが第一級の工程として扱われ、Simulations、Evaluations、Versioningが組み込まれています。

顧客ページには具体的な数字が並んでいます。GESOBAUは適格な通話の66%を自動解決、MEGは顧客通話の42%を自動化、HSEは年間300万件の通話に対応、AUTO1は9週間で9か国・7言語で稼働開始したと報告しています。これらはベンダーが公表した数字ですが具体的で、私は「最大80%」のような曖昧な表現より、こちらのほうがずっと好ましいと考えます。公平な反論は、この製品を概ね気に入っているG2のレビュアーから出ています。

G2

"It's great when the conversation follows a predictable path, but once a user provides a lot of context or has an issue that doesn't fit neatly into the expected flow, it sometimes requires more human involvement."

長所

  • エンタープライズプラットフォームで独自のSTT、TTS、LLMを持ち込める
  • 公開前に使える、組み込みのシミュレーションと評価
  • GDPR、ISO 27001、SOC 2を備えた、多言語での確かな実績

短所

  • 見積もりのみの価格
  • セルフサーブのツールより重い。これはエンタープライズ向けの導入
  • 私が確認したページには、ヘルプデスク連携の記載なし

料金

項目詳細
課金見積もり、営業に問い合わせ
公開料金なし

費用の詳細はParloaの料金をご覧ください。適合性については、ParloaのレビューとSierraとParloaの比較がさらに詳しいです。

私の見解: 多言語のコンタクトセンターを運営し、モデルの選択権を維持したいならParloaを選んでください。今週中に何かを稼働させたい小規模チームなら見送りましょう。決め手は規模と言語です。

8. Synthflow

最適な用途: GoHighLevel、HubSpot、Salesforceと連携した営業主導の導入を望む、大きめのチーム。

Actionsタブで通話詳細ドロワーを開いたSynthflowの通話ログ。ナレッジベース検索が756msで7件を返し、最良の類似度スコアが0.80であることを示している。出典:Synthflow
Actionsタブで通話詳細ドロワーを開いたSynthflowの通話ログ。ナレッジベース検索が756msで7件を返し、最良の類似度スコアが0.80であることを示している。出典:Synthflow

Synthflowはかつて、小規模な代理店が手に取るノーコードの選択肢でしたが、それは変わりました。Synthflowの料金ページは現在、Enterpriseプラン1つだけを掲載しており、契約は年$30,000から始まり、通話量、同時通話数、通信、連携に合わせて設計されます。セルフサーブの階層も分単価も公開されていません。

その代わりに得られるのは、導入支援、ネイティブの通信またはSIP、同時通話数のカスタム計画、MSA/DPAのサポートです。通話ログはデバッグに便利で、上のドロワーは、各回答の背後にあるナレッジベース検索を類似度スコアまで表示しています。料金ページにはSOC 2、GDPR、HIPAA、ISO 27001のバッジとEUおよび米国のホスティングがあり、連携としてCal.com、GoHighLevel、HubSpot、Salesforce、Zapierが挙げられています。

長所

  • 導入とオンボーディングが含まれる
  • ログでの通話単位の明確なデバッグ
  • EUと米国のホスティングオプション

短所

  • 年$30,000の下限が小規模チームを排除する
  • 分数、同時通話数、稼働率の公開数値なし
  • 連携にヘルプデスクの記載なし

料金

項目詳細
プランEnterpriseのみ
最低額年$30,000
SLA契約で規定

私の見解: すでにGoHighLevelやHubSpotを使っていて、ベンダーにエージェントを立ち上げてほしいならSynthflowを選んでください。音声予算が年$30,000未満なら見送りましょう。その場合は、RetellやElevenLabsで同じ仕事ができます。決め手は予算です。

音声エージェントにできないこと:通話後のチケット

上のツールはどれも同じ場所にたどり着きます。エージェントに確信がないとき、あるいは発信者がエージェントにできないことを求めたとき、通話は転送されるか、フォローアップになります。tau-Voiceで最高のモデルでも、約31%の通話が未解決のまま残り、実際のキューではその割合はたいてい高くなります。

それらの通話は消えません。多くの場合、文字起こしを添えて、Zendesk、Freshdesk、Gorgiasのチケットになり、FreshdeskのAIやGorgiasのAIの構成は、メールと同じように処理します。仕事の後半はそこで発生し、それは音声ではなくテキストの仕事です。ここを誤ると、音声エージェントがかえってチームを遅くすることがあります。

Reddit

"shipped a billing/tracking bot, decent containment, but AHT on escalated calls went up. agents had to read the transcript, figure out what the bot already tried, re-ask half of it anyway."

引き継ぎの設定については、通話をチケットに要約するガイドと、AIコールセンターエージェントの記事が、配管にあたる部分を扱っています。

ここは、この記事の冒頭で述べた確信度の問題が戻ってくる場面でもあります。返金の通話で推測してしまう音声エージェントは、チケットで推測するチャットボットと同じ害をもたらします。何を購入するにしても、ベンダーが用意したシナリオではなく、自社の過去の通話やチケットで公開前にテストするよう求めてください。

音声エージェントが引き継ぐチケットにeeselを試す

eeselはAIチームメイトのプラットフォームで、ここに合うチームメイトはAIヘルプデスクのものです。新入社員のように、既存のヘルプデスクキューに参加します(Zendesk連携が最も一般的で、FreshdeskとGorgiasにも対応しています)。そこから過去のチケットとヘルプセンターを学習し、音声エージェントが作成したチケットへの返信を下書きまたは送信します。顧客に1件も回答する前に、過去のチケット数百件でテストし、何と答えていたかを確認できます。

接続されたZendeskのチケットアクティビティと解決統計を表示するeesel AIのダッシュボード
接続されたZendeskのチケットアクティビティと解決統計を表示するeesel AIのダッシュボード

eeselは電話に出ません。それははっきり言っておきたいと思います。上のどの音声エージェントと組み合わせても、ヘルプデスクに届く仕事の半分を担います。そこは、いずれにせよカスタマーサービスの自動化の効果が最も表れる場所です。無料プランにはカード不要で100クレジットが含まれるので、今日からご自身のキューでeeselを試せます。

よくある質問

2026年のおすすめAI音声エージェントは?
自社で電話エージェントを構築するチームの多くにとって、Retell AIが最も安全な出発点で、ElevenLabs Agentsがそれに続きます。完全な制御を求める開発者はVapiやDeepgramのVoice Agent APIを選び、エンタープライズのコンタクトセンターはPolyAIやParloaを候補に挙げることが多いです。最適なAI音声エージェントは、主に誰が構築・保守するかで決まります。
AI音声エージェントの1分あたりの費用は?
公開されている入門料金は、1分あたり$0.05(Vapiのプラットフォーム料金、モデル費用は別)から、Retellの範囲の上限である1分あたり$0.31までです。現実的な構成の多くは、電話回線を除いて1分あたり約$0.075〜$0.23に収まります。Retell AIの料金の解説に詳しい計算例があります。
ベンチマークスコアが最も高いAI音声エージェントは?
模擬サポート通話でタスクが実際に完了したかを採点するArtificial Analysisのtau-Voiceベンチマークでは、2026年9月時点の最高はGemini 3.8 Live Extended Thinkingの68.6%で、GPT-Live-1とGrok Voice Think Fast 2.0がそれに続きます。ライブのSpeech Agent Arenaにおける完全な音声エージェントプラットフォームでは、ElevenLabs Agentsがツール呼び出し成功率90.5%で最高です。
AI音声エージェントは電話サポートチームの代わりになりますか?
完全には代わりません。tau-Voiceで最高のモデルでも、現実的なサポート通話の約3分の1で失敗するため、あらゆるAI音声エージェントには人へのきれいな引き継ぎが必要です。エージェントには定型的な通話の電話サポートの自動化を任せ、残りは引き継ぎのベストプラクティスに沿って、コンテキスト付きでヘルプデスクに渡す設計にしましょう。
AI音声エージェントはZendeskやFreshdeskと連携できますか?
ほとんどの音声エージェントプラットフォームは、ネイティブのヘルプデスクアプリではなく、Webhook、カスタム関数、CRM経由で接続します。すでにZendeskのボイスAIエージェントや、Freshcaller経由のFreshdeskの音声AIを使っている場合は、導入を決める前に、音声エージェントが文字起こし付きのチケットを作成できるか確認してください。
HIPAAに準拠しているAI音声エージェントは?
Bland、Deepgram、ElevenLabs、RetellはBAAを提供していますが、多くはエンタープライズ契約かアドオン条件です。VapiはHIPAAを月額$2,000のアドオンとして販売しています。PolyAIはHIPAAを標準として掲げています。患者からの通話をAI音声エージェントに載せる前に、HIPAA準拠のAIのガイドをお読みください。
無料のAI音声エージェントはありますか?
いくつかのAI音声エージェントには無料の入り口があります。ElevenLabs Agentsは月15分の無料枠、Deepgramは有効期限のない$200のクレジット、Retellは$10のクレジット、Vapiは$5を提供しています。費用をかけずに試すなら、Deepgramのクレジットが最も長く使えます。ElevenLabsの代替の比較記事では、さらに多くの選択肢を扱っています。
音声エージェントプラットフォームと音声モデルの違いは?
Gemini 3.8 LiveやGrok Voiceのような音声モデルは、聞いて話す頭脳にあたります。Retell、Vapi、ElevenLabs Agentsのような音声エージェントプラットフォームは、モデルを電話番号、ツール、テスト、分析、引き継ぎで包みます。tau-Voiceの最高スコアは2026年8月から9月のわずかな間に12.1ポイント上昇したため、多くのチームはモデルを入れ替えられるプラットフォームを選ぶべきです。

Share this article

Rama Adi

Article by

Rama Adi

Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.

Related Posts

All posts →
AIチャットの会話が人間のエージェントにスムーズに引き渡される様子を描いた手書き風イラスト
Guides

不確かなときに人間へエスカレーションするAIエージェントの設定方法

AIチャットエスカレーションの実践ガイド:会話を人間に引き渡すべき5つのトリガー、人間が実際に必要とするコンテキスト、そして主要なヘルプデスクの設定方法。

Rama AdiRama AdiJun 9, 2026
サポートにおけるAIのハルシネーションとそれを防ぐ方法
Guides

サポートにおけるAIのハルシネーションとそれを防ぐ方法

AIのハルシネーションは顧客の信頼を損ない、サポートチームに混乱をもたらす可能性があります。このガイドでは、AIエージェントがなぜ事実を作り出すのかを解明し、それらを防ぐための実用的な戦略を提供し、AIが常に正確で信頼できるサポートを提供できるようにします。

Stevia PutriStevia PutriOct 27, 2025
エージェント向け社内AIコパイロット構築の実践ガイド
Guides

エージェント向け社内AIコパイロット構築の実践ガイド

世界を約束しながら複雑さをもたらすAIプロジェクトにうんざりしていませんか?このガイドでは、実際に機能するエージェント向け社内AIコパイロットを構築するための重要なステップを詳細に解説し、即座に影響を与えるための適切なツールと戦略の選択を支援します。

Kenneth PanganKenneth PanganOct 27, 2025
AI要約を活用したメールからチャットへの誘導
Guides

AI要約を活用したメールからチャットへの誘導

溢れるメールの受信トレイにうんざりしていませんか?AI要約を活用して、効果的なメールからチャットへの誘導戦略を確立する方法を学びましょう。この実用的なガイドでは、サポートの自動化、コスト削減、顧客への迅速な問題解決を提供し、サポートワークフローを「受け身」から「積極的」なものへと変革する手順を説明します。

Kenneth PanganKenneth PanganOct 27, 2025
AIチャットボットが正しく応答しない理由 & その解決策
Guides

AIチャットボットが正しく応答しない理由 & その解決策

AIチャットボットが間違った答えや意味不明な答えを出すことにイライラしていませんか? あなたは一人ではありません。このガイドでは、チャットボットが誤作動を起こす技術的、設計上、実装上の失敗を分析し、実際に顧客を助けるAIサポートエージェントを構築する方法を紹介します。

Stevia PutriStevia PutriOct 27, 2025
Adept AIとは?エージェントAIの台頭、転換、そして未来
Guides

Adept AIとは?エージェントAIの台頭、転換、そして未来

Adept AIは、高度なAIエージェントを通じてソフトウェアとの関わり方を革新すると約束しました。しかし、大きな方針転換とAmazonとの人材取引の後、現在のAdept AIとは何であり、その道のりがAI自動化の実装について何を教えてくれるのでしょうか?

Stevia PutriStevia PutriOct 3, 2025
Protect AIとは?パロアルトネットワークスによる買収の概要
Guides

Protect AIとは?パロアルトネットワークスによる買収の概要

パロアルトネットワークスによるProtect AIの買収は、エンタープライズAIセキュリティにおける大きな転換を示しています。しかし、この複雑なプラットフォームベースのアプローチは、すべてのチームに適しているのでしょうか?Protect AIが何をするのか、買収が何を意味するのかを詳しく解説し、今日のビジネス運用でAIを展開するためのより機敏な代替策を探ります。

Stevia PutriStevia PutriOct 3, 2025
Snorkel AIの概要:その機能と対象ユーザー
Guides

Snorkel AIの概要:その機能と対象ユーザー

Snorkel AIについてお考えですか?当社の包括的な概要では、そのコアサービス、価格設定、およびエンタープライズAI開発における理想的なユースケースを解説しています。それが適切なソリューションなのか、あるいはより実用的でアプリケーション対応のソリューションが本当に必要なのかを発見してください。

Kenneth PanganKenneth PanganOct 3, 2025
AIにおけるインテリジェントエージェントとは何か?実践ガイド
Guides

AIにおけるインテリジェントエージェントとは何か?実践ガイド

チケットのトリアージから完全な自動化まで、インテリジェントなAIエージェントがサポートを変革しています。彼らがどのように機能するのか、異なるタイプ、そして迅速に始める方法を学びましょう。

Kenneth PanganKenneth PanganSep 15, 2025

AIチームメイトを採用する準備はできましたか?

数分でセットアップ。クレジットカード不要。

無料で始める