claude-mem:コーディングエージェントにセッション横断の永続メモリを与える圧縮レイヤー
claude-mem は、セッション中のエージェントのツール使用の観察を記録し、AI で意味的な要約に圧縮して、次のセッションの開始時に関連部分だけを注入します。エージェントは毎回ゼロから始める必要がなくなります。スター数は約 9 万 6 千で、Claude Code、OpenClaw、Codex、Gemini、OpenCode など多くのホストに対応します。圧縮には独自の observer、OpenRouter や Gemini のキー、Anthropic のプランを選べます。README に再現可能な評価はないため、自分のリポジトリで試験し、機密データの保存先と送信先を点検してください。
背景と課題の所在
コーディングエージェントには構造的な弱点があります。セッションが終わると文脈が消えることです。開発者が一時間かけて、リポジトリの構成、ビルドの落とし穴、設計上のトレードオフを教え込んでも、翌日には最初からやり直しになります。既存の対策にはそれぞれ代償があります。CLAUDE.md のような手書きの指示ファイルは人が保守する必要があり、古くなりがちです。会話履歴をそのまま再投入すれば、コンテキストウィンドウがすぐ埋まり、トークンも消費します。claude-mem はこの隙間を狙っています。エージェントの作業履歴をセッションをまたいで保持し、次のセッションに関連部分だけを注入します。
プロジェクトは thedotmack が管理し、GitHub のスター数は約 9 万 6 千です。トピックには ai-memory、long-term-memory、chromadb、sqlite、rag、claude-code-plugin などが並びます。README によれば、もともとは Claude Code 向けの永続メモリ圧縮システムでしたが、現在は OpenClaw、Codex、Gemini、Hermes、Copilot、OpenCode に加え、Grok Bot、Antigravity CLI、OMP も対象に挙げています。先に断っておくと、本稿はリポジトリの README とメタデータに基づいています。筆者は実機での導入やベンチマークを行っていないため、内部機構に関する記述は README の説明の範囲に限ります。
コアアーキテクチャと技術原理
README が示す流れは、取得、圧縮、注入の三段階です。まず、セッション中のツール使用の観察結果を自動で記録します。次に、AI でそれらの生の記録を意味的に要約します。最後に、新しいセッションの開始時に、関連する圧縮済みの文脈をエージェントへ渡します。トピックに sqlite と chromadb があることから、構造化された記録を SQLite に、意味検索をベクトルストアに置く一般的なハイブリッド構成が推測されます。ただしテーブル設計や順位付けの方式は README の抜粋からは確認できないため、この部分は推測です。
二つ目の設計上の要点は、ホストへの接続方法です。Claude Code のようにフックを持つホストでは、インストーラがプラグインのフックを登録し、ワーカーサービスを起動します。観察と圧縮はバックグラウンドで処理され、メインのセッションを止めません。フックを持たない環境では、README によればチャットのログファイルを監視します。例として Grok Bot が挙げられています。ホスト側のイベント API を必要としない現実的な手法ですが、事後にログを読む形になるため、鮮度と構造化の度合いはログ形式に左右されます。
三つ目は、圧縮を誰が行うかです。README は複数のメモリプロバイダーを挙げています。プロジェクト自身の claude-mem observer、利用者自身の OpenRouter または Gemini のキー、そして Anthropic のプランです。ローカルの観察者は --provider host で明示的に選びます。ここには隠れたコストがあります。メモリの圧縮は言語モデルの呼び出しを伴い、その費用はプランの枠か第三者への支払いで賄われます。
実用性と検証結果
導入手順は短いです。基本は npx claude-mem install で、--ide opencode、--ide antigravity、--ide omp、--ide grok-bot でホストを指定できます。Claude Code 内では /plugin marketplace add thedotmack/claude-mem の後に /plugin install claude-mem を実行し、再起動します。README が特に注意しているのは、npm install -g claude-mem が SDK とライブラリだけを入れる点です。フックは登録されず、ワーカーサービスも起動しません。npx のインストーラかプラグインコマンドを使う必要があります。
アカウントの流れにも注意が要ります。既定では、セットアップの後にブラウザでメールのマジックリンクによるサインインを求められます。サインインすると observer を 14 日間無料で試せ、期間が終わると、購読しない限り Anthropic のプランへ自動で戻ります。サインインを省くには、明示的な --provider を渡すか、CLAUDE_MEM_ONLINE_OPTIN=false を設定するか、CI や非対話シェルで実行します。プライバシーや法令順守の義務があるチームは、既定値を受け入れず、導入時に意図して選ぶべきです。 README は awareness push の試験機能も説明しています。decision、bugfix、security_alert、sensitive と判定された重要な観察が、日付付きの行として Grok Bot の月次ログへ追記されます。CLAUDE_MEM_GROK_BOT_AWARENESS_ENABLED=false で無効にできます。sensitive の内容がログファイルに残る点には注意が必要で、マスキングとファイル権限は利用者が自分で確認してください。 率直な結論として、README には再現可能な比較データがありません。圧縮が重要な詳細を落とす頻度、誤った結論を固定化する頻度、検索の精度は分かりません。採用前に自分のリポジトリで小規模な試験を行い、メモリの有無でタスクの品質とトークン消費を比べてください。
業界への影響と今後の展望
スター数が 10 万に迫ることは、セッションをまたぐ記憶がエージェントのツールチェーンで最も需要の強い領域の一つであることを示します。mem0、supermemory、openmemory といったタグは、競争が激しいことも示しています。claude-mem の差別化は、対応ホストの広さです。特定の製品に縛られず、一つのメモリ層を多くのエージェントの下に置きます。複数のコーディングエージェントを使うチームにとっては、経験がツール間を移動できる点が魅力です。
一方でリスクも明確です。第一に、メモリ層は新しい信頼境界になります。すべてのツール結果を読むため、秘密情報や非公開コードが含まれ得ます。第二に、ホスト型の既定値はデータの流れの問題を生みます。どの部分が第三者のサービスを通るのかを、利用者が確認する必要があります。第三に、圧縮は不可逆であり、誤った要約が事実のように何度も注入されます。今後は、監査できるメモリ項目、利用者が編集と削除をできるメモリ、公開ベンチマークが求められるでしょう。それまでは、成熟した基盤ではなく、試す価値があり監査も必要なツールとして扱うのが堅実です。
Sources
FAQ
なぜ npm install -g claude-mem ではメモリ機能が有効にならないのですか。
README によれば、このコマンドは SDK とライブラリだけをインストールします。プラグインのフックは登録されず、ワーカーサービスも起動しません。npx claude-mem install を使うか、Claude Code 内で /plugin marketplace add thedotmack/claude-mem と /plugin install claude-mem を実行して再起動してください。
メモリの圧縮は誰が行い、どんな費用がかかりますか。
README が挙げる選択肢は、claude-mem observer(14 日間の無料試用の後、購読しなければ Anthropic のプランへ戻る)、利用者自身の OpenRouter または Gemini のキー、Anthropic のプランです。圧縮は言語モデルを呼び出すため、費用はプランの枠か第三者への支払いから発生します。
フックのない環境ではどうやってデータを集めますか。
README は Grok Bot を例に挙げ、ホストのフックがない場合はチャットのログファイルを監視すると説明しています。ホストのイベント API は不要ですが、事後に読む形なので、鮮度はログ形式に左右されます。