Perplexityは2026年9月1日、AIエージェント基盤「Perplexity Computer」の新機能として、クラウドの大規模モデルとMac上で動くローカルモデルを1つの作業の中で使い分ける「Hybrid Compute(ハイブリッドコンピュート)」を発表しました。顧客情報や契約書のような外に出したくないデータは端末内のモデルが処理し、調べ物や推論はクラウド側に任せる仕組みです。Apple silicon搭載のMacであれば、追加のハードウェアなしに使えます。
1つのタスクをクラウドと端末で分担する
Perplexity Computerは、モデルとファイル、ツール、Webアクセスを組み合わせて複数手順の仕事をこなすエージェント基盤で、2026年2月に登場しました。4月にはMac上のファイルやアプリを直接扱える「Personal Computer」が加わり、今回のHybrid Computeはその延長線上にあります。
仕組みはシンプルです。利用者が投げた1つのタスクを、Computerがクラウド向けと端末向けに切り分けます。クラウドの最上位モデルが担当するのは高度な推論、Web検索、作業計画の立案です。一方、Mac上のローカルモデルは、私的なファイルの読み込みや機密情報の扱い、端末内で必要になる操作を受け持ちます。利用者がタスクを2つのプロンプトに分けたり、結果を手作業でツール間に移したりする必要はなく、全体の流れはComputerが調整します。
作業を始める前には、どのファイルを端末内にとどめるかの提案が表示されるので、見落としがないか自分の目で確かめられます。このタイミングで、ローカル側とクラウド側にそれぞれどのモデルを使うかも選べます。
「プライバシーゲート」が端末から出る情報を見張る
この機能の中核にあるのが、Mac上で動く「プライバシーゲート」です。Perplexityが新たに訓練した分類器が端末内で動作し、氏名、住所、口座番号、認証情報といった機微な要素を、クラウドへ送る前に検出します。検出結果に応じて、該当箇所をマスクして送る、端末内にとどめる、処理そのものを拒否する、利用者に同意を求める、のいずれかを選ぶ設計です。
なかでもログイン情報、クレジットカード番号、政府発行のID番号はもっとも厳しい扱いを受け、端末外に出さないか、その情報を抜いた形でクラウド側に依頼を書き換えるとしています。
同社は同じ日に、この分類器の背景となる研究成果も公開しました。長い複数ターンの会話の中で、同じ個人情報が何度も出てきたときにすべて拾えるかを測るベンチマーク「PII-TRACE」と、6億パラメータの検出モデル「PII-Tracer」です。ベンチマークは13言語、1万3,148件の会話で構成され、Perplexityの検証では、繰り返し登場する識別子を漏れなく検出できた割合がPII-Tracerで79.4パーセント、比較対象のクラウド向け大規模モデルでは57.0パーセントだったとしています。どちらも近く公開予定です。
企業向けには管理者ルールと監査機能
法務、医療、金融など、機密データを日常的に扱う業種を強く意識した設計です。Perplexityが挙げる例では、投資チームが公開情報や市場データの収集をクラウドで進めつつ、未公開の案件資料の照合や条件の抽出はローカルモデルが担当します。広告代理店なら、市場調査はクラウド、社外秘の制作物のレビューは端末内という分け方になります。弁護士であれば、判例調査をWebで行いながら、秘匿特権のある文書の要約はMac上で処理する、といった使い方が想定されています。
Enterpriseプランでは、管理者が組織全体に対して「端末内にとどめるべき情報」「マスクすればクラウドに送ってよい情報」「送る前に利用者の承認が必要な情報」を定めておけます。情報が端末を離れたタイミングを監査する機能も用意され、チーム単位で一貫したルールを運用できます。
対応環境と利用できるモデル
Hybrid Computeは、Pro、Max、Enterpriseの各プラン加入者に向けて提供が始まっています。動作環境はmacOS 15以降を搭載したApple siliconのMacで、ユニファイドメモリは24GB以上が必要です。快適に使うなら32GB以上を勧める説明もあり、8月に発表された新型Mac miniとMac Studioは相性のよい選択肢として名前が挙がっています。
ローカルモデルは初回に3種類が用意されました。Googleの「Gemma 4 E4B」、Alibabaの「Qwen3.6 35B-A3B」、そしてQwen系をPerplexity ComputerのためにPerplexityが追加学習したモデルです。導入にターミナル操作は不要で、Macアプリからワンクリックでダウンロードできます。今後モデルの選択肢は増やしていくとしています。
作業中は、MacのCPU、GPU、メモリの使用状況が可視化され、横にはタスクが消費したトークン数が表示されます。端末内のモデルが生成したトークンには課金が発生せず、費用がかかるのはクラウド側のモデルを使った分だけです。iPhoneからタスクを送り込むこともできるため、常時稼働のMac miniを1台置いておき、外出先から手元の機密データを扱う、という運用も可能です。
クラウド単独との性能差は「利用者が決める」
気になるのは、クラウドだけで処理した場合との品質差です。Perplexityでこの製品を担当するJon Staff氏は、成果物の出来栄えという点では、クラウドの最上位モデルだけで処理したほうがほぼ常に上回ると認めています。そのうえで、すべての人が最高性能のモデルを必要としているわけではなく、データのプライバシーやコストのほうが重要な場面もあると述べ、どこに重心を置くかは利用者が調整できるべきだという考えを示しました。
筆者としては、この割り切りが好印象です。ローカルモデルの性能を過大に語らず、「守るべきものは端末内、性能が欲しい部分はクラウド」という役割分担を明示したことで、導入を検討する側も判断しやすくなります。8月にはNVIDIA DGX Spark向けに、すべてを端末内で完結させる「Portable Computer」も出ており、Perplexityはクラウド完結からローカル完結までの間を、細かい刻みで埋めにきている印象です。
まとめ
Perplexityの「Hybrid Compute」は、1つのタスクをクラウドの大規模モデルとMac上のローカルモデルに分け、機密情報は端末内のプライバシーゲートで守りながらエージェントを使えるようにする機能です。Pro、Max、Enterpriseの加入者が対象で、macOS 15以降とユニファイドメモリ24GB以上のApple silicon Macがあれば利用できます。ローカルで処理した分に課金がない点も含め、AIエージェントを業務に持ち込むときの現実的な落としどころを示した発表と言えそうです。
