Bonsai 27Bとは?iPhoneで動く27B推論モデルの圧縮技術をPrismMLが公開
PrismMLが、27Bパラメータの推論モデルをApache 2.0で公開しました。通常54GB必要なモデルを1〜2bit圧縮で最小3.9GBまで縮め、iPhone 17 Pro Max単体で毎秒約11トークンを生成します。
PrismMLが、27Bパラメータの推論モデルをApache 2.0で公開しました。通常54GB必要なモデルを1〜2bit圧縮で最小3.9GBまで縮め、iPhone 17 Pro Max単体で毎秒約11トークンを生成します。
Appleが6月のWWDCで披露した新Siri「Siri AI」が、iOS 27のパブリックベータで一般ユーザーにも開放されました。チャットアプリ化に加え、端末内の写真・メッセージ・カレンダーを横断インデックスする「Optimizing Search and Siri」により、ChatGPTやClaudeが持ち得ない個人文脈を握る設計になっていますが、対応機種はiPhone 15 Pro以降に限られ、記憶(メモリ)機能も未実装です。
Appleのオンデバイスicon AI処理の中核であるNeural Engineは、実現しなかった自動運転車プロジェクトの副産物だった——Bloombergのマーク・ガーマン氏がニュースレター「Power On」で明かしました。同氏によればAppleはM6のPro/Max/Ultra版を見送り、Neural Engineを大幅強化した2027年前半のM7へ開発を前倒し。M7 Ultraは最大1.5TBのRAMに対応するサーバー製品の土台になる見込みです。
Liquid AIが公開したLFM2.5-230Mは、メモリ400MB未満で動きながら、4倍以上のサイズのGemma 3 1BやQwen3.5-0.8Bをデータ抽出やツール呼び出しで上回るオンデバイス特化モデルです。Claude Opus 4.6に毎トークン課金してきた定型処理を、端末側で完結させる選択肢が現実になりました。
Googleは6年ぶりの新型スマートスピーカー「Google Home Speaker」を100ドルで予約受付開始し、6月25日に発売します。2.0GHz駆動のクアッドコアA55プロセッサと専用NPUを搭載し、ローカルでAI処理を行う点が最大の特徴です。
AppleはWWDC基調講演で、iMessageやNotes、Mail、Photosなど自社アプリ内の情報と画面上の内容を参照する新Siriを発表しました。2年の遅延と2億5,000万ドルの訴訟を経た刷新で、iPhone、ノートPC、Apple Vision Proに展開されます。
AppleはWWDC26で第3世代基盤モデル「AFM 3」を発表し、オンデバイス向けのAFM 3 Core Advancedで200億パラメータの重みをDRAMではなくNANDフラッシュに保管する独自設計を採用しました。サーバ側はGoogle CloudのNvidia GPU上で動くなど、Googleとの協業も明らかになっています。
AppleはWWDC 2026で、Safari、Messages、Calendar、Phone、Shortcuts、Image Playground、PhotosにまたがるApple Intelligenceの大型アップデートを発表しました。タブの自動グルーピング、通話中の他アプリ文脈引き出し、写真の被写体位置を動かす「Spatial Reframing」など、生成AIをOS体験の細部に埋め込む方向が鮮明になっています。