#AI推論 の記事一覧(12)

AI
2026-08-28 ・ The Verge

AppleのM6・M5 Ultra搭載Mac miniとMac Studioは「AI推論マシン」なのか?Vergecastの疑問から読む次の論点

AppleがMac miniとMac Studioを刷新し、新チップM6とM5 Ultraを投入。同社はこれをAI推論の成果として訴求していますが、The Vergecastの出演者は「現時点ではマーケティング上の打ち出しにすぎないのでは」と懐疑的な見方を示しました。同じ回では、新たに発表されたAppleイベント(iPhone 18は登場しないとの見立て)、折りたたみiPhone、Metaの和解に伴うティーン向け制限強化も取り上げられています。

AI
2026-08-24 ・ The Decoder

Cerebras CS-4とは?毎秒4,400トークンの「ラックまるごとAI」が推論市場に突きつける論点

Cerebrasが新型AIアクセラレータ「CS-4」を発表しました。チップは前世代と同じ5nmのWSE-3のまま、電力と冷却を増やしてクロックを引き上げ、1ラックあたりのウェハを2枚から3枚に増やすことでCS-3の2倍の性能を実現。ユーザーあたり最大4,400トークン/秒を出し、同社はNvidia GPU構成比で最大30倍速いと主張します。

AI
2026-08-17 ・ TechCrunch

ネオクラウドとは?Groqが評価額69億→35億ドルで「自社チップ」を捨てNvidia側に回った意味

AI半導体スタートアップGroqが、投資会社Disruptive主導で3億5000万ドルを調達し、企業価値は35億ドルとなりました。昨年9月の69億ドルから大きく下がった一方、Nvidiaも参加を予定しており、GroqはLPU(言語処理ユニット)による自社チップ路線から、Nvidia製システムを運用する「ネオクラウド」への転換を鮮明にしています。

AI
2026-08-04 ・ TechCrunch

Sonic Inference Podとは?Runwareの「運べるデータセンター」が推論コストを下げる仕組みと、AIインフラ調達への影響

AIインフラ企業のRunwareが火曜日、輸送可能なモジュール型データセンター「Sonic Inference Pod」を発表しました。水を使わない閉ループ冷却で数日で構築でき、既に米国・欧州・アジア太平洋に10基を展開、Higgsfield AIやWixへ推論を提供しています。

AI
2026-07-27 ・ Ars Technica

Verizonの「AI Connect」とは?Googleとの1000億ドル級ダークファイバー契約とAI時代の通信戦略を解説

Verizonが2026年4-6月期決算で、自社の未使用光ファイバー(ダークファイバー)を使いGoogleのデータセンター群を接続する10億ドル超の契約を公表しました。これは新事業「AI Connect」の第一弾で、年内にさらに数十億ドル規模のAI関連契約を追加発表する見通しです。

AI
2026-07-21 ・ VentureBeat

Weka「NeuralMesh 6」とは?NANDフラッシュにAIトークンをキャッシュしGPU負荷を下げる仕組みを解説

ストレージ企業Wekaが、AI推論のGPUメモリ枯渇を安価なNANDフラッシュで補う新ソフト「NeuralMesh 6」と自社設計ハード「Wekapod 3」を発表しました。計算済みトークンを100%キャッシュして再計算をなくし、既存GPU投資の稼働率を高めるのが狙いです。

AI
2026-06-25 ・ TechCrunch

オシレーター型AIチップとは?元Databricks AI責任者が挑む消費電力1/1000の新計算基盤

元Databricks AI責任者Naveen Rao氏率いるUnconventional AIが、初の画像生成モデル「Un-0」を公開しました。オシレーター(発振器)を用いた新方式のコンピュータ・アーキテクチャで、AI推論の消費電力を最大1,000分の1に抑えることを目指します。

AI
2026-06-22 ・ TechCrunch

Groqが650億円調達、Nvidiaに技術と創業者を奪われた後の「ネオクラウド」再起戦略

AI推論チップのGroqが6.5億ドル(約960億円)の資金調達を発表しました。半年前にNvidiaへLPU技術のIP非独占ライセンスと創業者ら主要人材を移籍させる「20億ドルの非買収型ディール」を経て、残された事業をネオクラウドに集約する再建フェーズに入っています。

AI
2026-06-22 ・ VentureBeat

KVキャッシュとは?AI推論で台頭する「第3のストレージ階層」CMXをNvidiaとSolidigmの動きから読み解く

NvidiaがCMXとして定式化した「コンテキスト階層」が、GPUメモリとバルクストレージの間に新設されつつあります。SolidigmはこのKVキャッシュ専用のSSDを開発しており、AI推論のボトルネックは計算力からコンテキスト保持へと移りつつあります。

AI
2026-06-18 ・ TechCrunch

推論ゴールドラッシュとは?Baseten評価額1.3兆円・5カ月で160%増の意味

AI推論基盤を提供するBasetenが、$13B(約2兆円規模)の評価額で$1.5Bの資金調達を最終段階に入れたとWall Street Journalが報じました。わずか5カ月前のシリーズEから評価額は160%上昇し、VCマネーが「推論レイヤー」に殺到する構図が鮮明になっています。

← タグ一覧へ