Hugging Face「funes」Claude Code・Codex・pi・Hermesのセッション記録を1つの記憶にする単一バイナリ。`funes add claude`でエージェントにrecallとgetのツールが付き、完了したターンごとに自動で索引。埋め込みと再ランクは手元で動き、共有したければ自分のHugging Faceデータセット(既定で非公開)に。要約せず原文と出所を返す
Hugging FaceのDavid Corvoysier氏は2026年9月3日、コーディングエージェントのための永続的な記憶層「funes」を公開した。複数の機械と複数のエージェントを使い分けると、どのエージェントも前回の推論を忘れて始まる。実行記録には「なぜ」が残るが、1万ターンをgrepしても探せない。funesは単一バイナリで、埋め込みと再ランクは自分の機械で動く。`funes add claude`(codex・pi・hermesも)の1コマンドで索引を作り、エージェントにrecallとgetのツールを与え、完了したターンごとに増分で索引する。エージェントは過去の決定に触れると自分でrecallを引き、要約でなく原文と出所(エージェント・時刻・セッション・ターン)を返す。内部は全記録を同じ形式に変換してLanceデータセットに書き、ベクトルとBM25の融合→クロスエンコーダで再ランク→新しさで重み付け。自分のHugging Faceデータセット(既定で非公開)に束ねると別の機械でも同じ記憶を引け、索引時と公開前に秘密を走査する。

2026年9月18日・日本時間時点の情報です。 Hugging Faceのブログ(9月3日)を読んだ。当サイトはエージェントの記憶を蒸留や共有サービスの角度で追ってきたが、「手元の実行記録そのものを記憶にする」道具で、複数のエージェントをまたぐ点が新しい。
3行まとめ
- 何を解くか。 複数の機械と複数のコーディングエージェントを使い分けると、どのエージェントも前回の推論を忘れてよそ者として始まる。エージェントの実行記録には、コードを探し、試し、失敗し、文書を読み、方向を変えた「なぜ」が残っているが、記録は保管庫であって、1万ターンをgrepしても「なぜストリーミングパーサーをやめたのか」は探せない。使えるようにするには索引・検索・順位付け・正確な出所が要る。funesはそのための永続的な記憶層で、Claude Code・Codex・pi・Hermesに対応する。
- 使い方。 単一バイナリで、既定の推論バックエンドはML実行環境に依存せず、埋め込みと再ランクは自分の機械で動く。
funes add claude(codex・pi・hermesも)の1コマンドで最初の索引を作り、エージェントにrecallとgetのツールを与え、完了したターンごとに増分で索引する自動化を入れる(古い分は少しずつ埋め戻す)。以後は普通に作業するだけで、過去の決定や根拠に触れる課題ではエージェントが自分でrecallを引く。recallは要約でなく原文を返し、出所(エージェント・時刻・セッション・ターン)を示し、各結果に前後の文脈を開くgetコマンドが付く。内部は、対応する全記録を同じターン・ブロック形式に変換して分割し、固定のローカルモデルで埋め込んでLanceデータセットに書く。検索はベクトルとBM25の融合→クロスエンコーダで再ランク→新しさで重み付け→隣接チャンクを添付。3つの性質:エージェント横断で1つの記憶(どのエージェントの記録かを各結果が示す)、生の証拠を残す(書き込み時に事実へ蒸留しない)、既定でローカル(アカウントもHubも不要、ホストされたモデルが記録を処理しない)。- 記憶は「データセット」であってサービスではない。
funes add codex acme/funes-memoryのように**自分のHugging Faceデータセット(既定で非公開)**に束ねると、ローカルで索引しセッション境界で公開し、別の機械で同じコマンドを打てば記憶が付いてくる。索引時に認証情報を伏せ、公開前に全チャンクを再走査して秘密らしきものを止める(走査の範囲はSECURITY.mdに)。読み側はデータセットをローカルに保存して温かい検索はローカル速度。所有・アクセス制御・版管理・配布はHubの既存機能で、「記憶が別のサービスのアカウントになり、APIで借り戻す」形にしない。人が聞くときはfunes ask claude "ストリーミングパーサーについて何を決めたか"。funes自身の開発の記憶も公開されている。
複数エージェントの記録を1つに束ねる利点
- 当サイトを含め、Claude Codeの
~/.claudeとCodexの記録を別々に持っている人には、「両方を1つの索引にして、どちらのエージェントからも引ける」が実利。筆者の環境でも両方の記録があるが、この記事のためにfunesを入れてはいない - 「要約せず原文と出所を返す」は、記憶の蒸留の反対の設計で、蒸留時の取りこぼしを避ける代わりに検索の精度に賭ける
- 秘密の走査は「索引時+公開前」の2段だが、本文も「何を扱い何を扱わないかはSECURITY.mdに」と限定している。共有する前に自分で確認する対象
- 対応エージェントにGemini CLIやCursorはない(本文の範囲)
ブログの記述内容を原文で確認、未使用
この記事の下調べで、筆者は9月18日にHugging Faceのブログを取得し、対応エージェント4つ・インストールとaddのコマンド・recall/get/askの挙動・検索の構成・Lance・Hugging Faceデータセットへの束ね方・秘密の走査がその原文にあることを確認した。リポジトリとSECURITY.mdは開いていない。筆者はfunesをインストールしていない。
対応OS・モデル名・ライセンスは不明
- 対応OS(インストールはcurl | shの形式)
- 埋め込みモデルの名前と索引のサイズ
- ライセンス
出典はHugging Faceのブログ
- Give Your Coding Agents a Memory You Own(Hugging Face・David Corvoysier・2026年9月3日)
関連記事
出典・参照資料
大きいニュースはYouTubeでも解説しています。Xでは新着記事をお知らせしています。
コメント
まだコメントはありません。最初のコメントを書いてみませんか?
AIについて聞きたいことはありますか?
質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。
質問箱を見る →