#ローカルLLM の記事一覧(7)

AI
2026-07-30 ・ Simon Willison

OpenAI互換APIをローカルで立てるとは?llm-chat-completions-serverが突く会話ログ肥大化の盲点

Simon Willison氏がLLMプラグイン「llm-chat-completions-server 0.1a0」を公開しました。`llm chat-completions-server -p 9001` の一行で、インストール済みの全モデルをOpenAI Chat Completions互換のローカルエンドポイントとして公開でき、真の狙いはLLM 0.32rc1で導入されたコンテンツアドレッサブルなログ、つまり会話履歴の重複をハッシュで排除する仕組みの検証にあります。

AI
2026-06-27 ・ Ahead of AI

ローカルコーディングエージェントとは?Qwen3.6とOllamaで自前構築する手順を解説

Ahead of AIが、Qwen3.6 35B-A3BとOllama、Qwen-Codeハーネスを組み合わせ、ファイル編集やコマンド実行まで行える「production-readyなローカルコーディングエージェント」の構築手順を公開しました。CodexやClaude Codeへの依存を減らし、固定費・オフライン・プライバシーを担保する実践的な代替案です。

AI
2026-06-24 ・ VentureBeat

ローカル完結型AIエージェントOS「Rebel」とは?Markdownで記憶を持つ新潮流をMindstoneが投入

ロンドン拠点のAIスタートアップMindstoneが、ローカルファースト型のエージェント型AI OS「Rebel」をFair Sourceライセンスで正式公開した。エージェントの記憶と命令をMarkdownファイル(agents.md)で管理し、100ユーザー未満の組織は無償で利用できる。

AI
2026-06-03 ・ VentureBeat

Gemma 4 12Bとは?ノートPCで動く新型オープンモデルが企業のAI内製を変える理由

Googleが11.95Bパラメータのオープンモデル「Gemma 4 12B」をApache 2.0で公開しました。エンコーダーレスの統合アーキテクチャを採用し、16GBメモリの業務用ノートPC上でマルチモーダル処理と256Kトークンの長文脈、エージェント機能をローカル実行できます。

AI
2025-08-09 ・ Ahead of AI

gpt-oss-120b/20bとは?OpenAIが6年ぶりに公開したオープンウェイトLLMの中身を解説

OpenAIが2019年のGPT-2以来となるオープンウェイトモデル「gpt-oss-120b」「gpt-oss-20b」を公開しました。20bは16GBのコンシューマGPUで、120bは80GBのH100単体で動かせる設計で、Mixture-of-ExpertsやGrouped Query Attentionなど現代的なアーキテクチャを採用しています。

← タグ一覧へ