Perplexity「Hybrid Compute」とは?機密データはMacのローカルLLM、残りはOpus 5に振り分ける仕組みを解説
Perplexityが、Macアプリ上で1つのタスクをクラウドのフロンティアモデル(Opus 5やGPT-5.6 Sol)とローカルLLMに分割実行する「Hybrid Compute」を発表しました。機密情報はGemma E4BやQwen 3.6(350億パラメータ)などローカルモデルが処理し、そのトークンは課金対象外になります。
Perplexityが、Macアプリ上で1つのタスクをクラウドのフロンティアモデル(Opus 5やGPT-5.6 Sol)とローカルLLMに分割実行する「Hybrid Compute」を発表しました。機密情報はGemma E4BやQwen 3.6(350億パラメータ)などローカルモデルが処理し、そのトークンは課金対象外になります。
WiredがLM Studio Bionicを使ったローカルLLM環境の作り方を紹介しました。MetaやGoogleなどのモデルを無料でダウンロードし、Windows・macOS・Linuxのいずれでもオフライン動作させられる一方、快適に動かすにはRAM 16GB以上、できれば8GB超のVRAMを持つ専用GPUが要るという現実的な条件も示されています。
AnthropicのAIチャット「Claude」で公開URL共有した会話の一部が、GoogleやBingに検索インデックスされていたことが判明しました。原因は共有ページに「noindex」タグが欠けていたためで、Bingでは執筆時点でも「site:claude.ai/share」で約612件の結果が表示されていました。
Appleのオンデバイスicon AI処理の中核であるNeural Engineは、実現しなかった自動運転車プロジェクトの副産物だった——Bloombergのマーク・ガーマン氏がニュースレター「Power On」で明かしました。同氏によればAppleはM6のPro/Max/Ultra版を見送り、Neural Engineを大幅強化した2027年前半のM7へ開発を前倒し。M7 Ultraは最大1.5TBのRAMに対応するサーバー製品の土台になる見込みです。
XがFTCに求めた2022年プライバシー同意命令の終了申請に対し、プライバシー擁護団体が反対を表明しました。MuskがGrok開発でユーザーデータを新用途に使い始めた今、監督は緩めるべきではないというのが論点です。
プロジェクターで知られるXGIMIが、47グラムのスマートグラス「MemoMind One」をKickstarterで予約開始しました。米Engadgetの評価は7.4/10で、ハードは優秀ながら常時録音型のAI日記機能が評価を落としています。