AI時短ラボ
検索
検証

Hugging Face「funes」Claude Code・Codex・pi・Hermesのセッション記録を1つの記憶にする単一バイナリ。`funes add claude`でエージェントにrecallとgetのツールが付き、完了したターンごとに自動で索引。埋め込みと再ランクは手元で動き、共有したければ自分のHugging Faceデータセット(既定で非公開)に。要約せず原文と出所を返す

執筆:約6分で読めます

Hugging FaceのDavid Corvoysier氏は2026年9月3日、コーディングエージェントのための永続的な記憶層「funes」を公開した。複数の機械と複数のエージェントを使い分けると、どのエージェントも前回の推論を忘れて始まる。実行記録には「なぜ」が残るが、1万ターンをgrepしても探せない。funesは単一バイナリで、埋め込みと再ランクは自分の機械で動く。`funes add claude`(codex・pi・hermesも)の1コマンドで索引を作り、エージェントにrecallとgetのツールを与え、完了したターンごとに増分で索引する。エージェントは過去の決定に触れると自分でrecallを引き、要約でなく原文と出所(エージェント・時刻・セッション・ターン)を返す。内部は全記録を同じ形式に変換してLanceデータセットに書き、ベクトルとBM25の融合→クロスエンコーダで再ランク→新しさで重み付け。自分のHugging Faceデータセット(既定で非公開)に束ねると別の機械でも同じ記憶を引け、索引時と公開前に秘密を走査する。

Hugging Face「funes」──Claude Code・Codex・pi・Hermesのセッション記録を1つの記憶にする単一バイナリ。`funes add claude`でエージェントにrecallとgetのツールが付き、完了したターンごとに自動で索引。埋め込みと再ランクは手元で動き、共有したければ自分のHugging Faceデータセット(既定で非公開)に。要約せず原文と出所を返す
目次

2026年9月18日・日本時間時点の情報です。 Hugging Faceのブログ(9月3日)を読んだ。当サイトはエージェントの記憶を蒸留や共有サービスの角度で追ってきたが、「手元の実行記録そのものを記憶にする」道具で、複数のエージェントをまたぐ点が新しい。

3行まとめ

  1. 何を解くか。 複数の機械と複数のコーディングエージェントを使い分けると、どのエージェントも前回の推論を忘れてよそ者として始まる。エージェントの実行記録には、コードを探し、試し、失敗し、文書を読み、方向を変えた「なぜ」が残っているが、記録は保管庫であって、1万ターンをgrepしても「なぜストリーミングパーサーをやめたのか」は探せない。使えるようにするには索引・検索・順位付け・正確な出所が要る。funesはそのための永続的な記憶層で、Claude Code・Codex・pi・Hermesに対応する。
  2. 使い方。 単一バイナリで、既定の推論バックエンドはML実行環境に依存せず、埋め込みと再ランクは自分の機械で動く。funes add claude(codex・pi・hermesも)の1コマンドで最初の索引を作り、エージェントにrecallとgetのツールを与え、完了したターンごとに増分で索引する自動化を入れる(古い分は少しずつ埋め戻す)。以後は普通に作業するだけで、過去の決定や根拠に触れる課題ではエージェントが自分でrecallを引く。recallは要約でなく原文を返し、出所(エージェント・時刻・セッション・ターン)を示し、各結果に前後の文脈を開くgetコマンドが付く。内部は、対応する全記録を同じターン・ブロック形式に変換して分割し、固定のローカルモデルで埋め込んでLanceデータセットに書く。検索はベクトルとBM25の融合→クロスエンコーダで再ランク→新しさで重み付け→隣接チャンクを添付。3つの性質:エージェント横断で1つの記憶(どのエージェントの記録かを各結果が示す)、生の証拠を残す(書き込み時に事実へ蒸留しない)、既定でローカル(アカウントもHubも不要、ホストされたモデルが記録を処理しない)。
  3. 記憶は「データセット」であってサービスではない。 funes add codex acme/funes-memoryのように**自分のHugging Faceデータセット(既定で非公開)**に束ねると、ローカルで索引しセッション境界で公開し、別の機械で同じコマンドを打てば記憶が付いてくる。索引時に認証情報を伏せ、公開前に全チャンクを再走査して秘密らしきものを止める(走査の範囲はSECURITY.mdに)。読み側はデータセットをローカルに保存して温かい検索はローカル速度。所有・アクセス制御・版管理・配布はHubの既存機能で、「記憶が別のサービスのアカウントになり、APIで借り戻す」形にしない。人が聞くときはfunes ask claude "ストリーミングパーサーについて何を決めたか"。funes自身の開発の記憶も公開されている。

複数エージェントの記録を1つに束ねる利点

  • 当サイトを含め、Claude Codeの~/.claudeとCodexの記録を別々に持っている人には、「両方を1つの索引にして、どちらのエージェントからも引ける」が実利。筆者の環境でも両方の記録があるが、この記事のためにfunesを入れてはいない
  • 「要約せず原文と出所を返す」は、記憶の蒸留の反対の設計で、蒸留時の取りこぼしを避ける代わりに検索の精度に賭ける
  • 秘密の走査は「索引時+公開前」の2段だが、本文も「何を扱い何を扱わないかはSECURITY.mdに」と限定している。共有する前に自分で確認する対象
  • 対応エージェントにGemini CLIやCursorはない(本文の範囲)

ブログの記述内容を原文で確認、未使用

この記事の下調べで、筆者は9月18日にHugging Faceのブログを取得し、対応エージェント4つ・インストールとaddのコマンド・recall/get/askの挙動・検索の構成・Lance・Hugging Faceデータセットへの束ね方・秘密の走査がその原文にあることを確認した。リポジトリとSECURITY.mdは開いていない。筆者はfunesをインストールしていない。

対応OS・モデル名・ライセンスは不明

  • 対応OS(インストールはcurl | shの形式)
  • 埋め込みモデルの名前と索引のサイズ
  • ライセンス

出典はHugging Faceのブログ

関連記事

シェア: ポスト はてブ

出典・参照資料

AI時短ラボ

大きいニュースはYouTubeでも解説しています。Xでは新着記事をお知らせしています。

コメント

まだコメントはありません。最初のコメントを書いてみませんか?

AIについて聞きたいことはありますか?

質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。

質問箱を見る →

関連記事

「Agent Memory Distillation」とは何か──学習不要で、4Bの小型モデルにGPT-5-miniの「成功パターン」を渡すの記事画像

「Agent Memory Distillation」とは何か 学習不要で、4Bの小型モデルにGPT-5-miniの「成功パターン」を渡す

研究
ClaudeにもChatGPTにもCursorにも読み書きできる「共有の脳」OzBrain──ページ自体にAIエージェント宛ての指示文が埋め込まれていたの記事画像

ClaudeにもChatGPTにもCursorにも読み書きできる「共有の脳」OzBrain ページ自体にAIエージェント宛ての指示文が埋め込まれていた

検証
Claude Codeの「プロジェクト」が再設計──目標を渡すと、コーディネーターがスレッド(=クラウドのClaude Codeセッション)に仕事を割り振り、並列でPRを開いて結果を組み立てる。9月17日からPro・Maxの一部でベータ、既存プロジェクトはそのままの記事画像

Claude Codeの「プロジェクト」が再設計 目標を渡すと、コーディネーターがスレッド(=クラウドのClaude Codeセッション)に仕事を割り振り、並列でPRを開いて結果を組み立てる。9月17日からPro・Maxの一部でベータ、既存プロジェクトはそのまま

プロダクト
Codexの使い方【2026年9月版】──CLI・IDE拡張・デスクトップ・クラウドの4つの入口、インストールとログイン、プランごとの5時間あたりの目安(Astra/Sol/Terra/Luna)、AGENTS.md・権限・Goal Mode・Auto-review、知っておくべき不具合までの記事画像

Codexの使い方【2026年9月版】 CLI・IDE拡張・デスクトップ・クラウドの4つの入口、インストールとログイン、プランごとの5時間あたりの目安(Astra/Sol/Terra/Luna)、AGENTS.md・権限・Goal Mode・Auto-review、知っておくべき不具合まで

活用
Hermes AgentにKimi K3をつなぐ──公式ガイドが指定する1つのモデル名と、間違えやすい設定ミスの記事画像

Hermes AgentにKimi K3をつなぐ 公式ガイドが指定する1つのモデル名と、間違えやすい設定ミス

検証
Hugging Face、ICML 2026の論文をコーディングエージェントで再現するハッカソン──19日間で1,221人が6,816本の記録を公開し2,226本(会議の34%)を試み、35,908の主張を判定。51%で少なくとも1つの主張が検証、23%で少なくとも1つが反証または係争、242本は独立チームが正反対の判定。スポットライト論文の定理が崩れ、著者は当日確認の記事画像

Hugging Face、ICML 2026の論文をコーディングエージェントで再現するハッカソン 19日間で1,221人が6,816本の記録を公開し2,226本(会議の34%)を試み、35,908の主張を判定。51%で少なくとも1つの主張が検証、23%で少なくとも1つが反証または係争、242本は独立チームが正反対の判定。スポットライト論文の定理が崩れ、著者は当日確認

検証(発表 8月13日)
IBM「Granite 4.2」の作り方──初の推論特化の密なモデル3B・8B・30B(Apache 2.0、日本語を含む12言語)。SFTの31.6%がエージェント軌跡(Codex・Gemini CLI等のハーネスで生成)、RLはRLVR→SWE→端末→検索→RLHFの階段で8B・30Bだけ実環境のエージェントRL。30BはSWE-Bench Verified 57.00の記事画像

IBM「Granite 4.2」の作り方 初の推論特化の密なモデル3B・8B・30B(Apache 2.0、日本語を含む12言語)。SFTの31.6%がエージェント軌跡(Codex・Gemini CLI等のハーネスで生成)、RLはRLVR→SWE→端末→検索→RLHFの階段で8B・30Bだけ実環境のエージェントRL。30BはSWE-Bench Verified 57.00

検証(発表 8月25日)
Google「ADK for Kotlin 1.0」が正式版──Python版・Java版のADK 1.0と同じ機能に加え、Android向けの端末内エージェント(LiteRT-LM・ML Kitベータ)、Firebase AI Logicのハイブリッド、RoomとAppSearchで状態の保存。@Toolと@Paramでスキーマを自動生成、SKILL.mdで手順を段階的に読むの記事画像

Google「ADK for Kotlin 1.0」が正式版 Python版・Java版のADK 1.0と同じ機能に加え、Android向けの端末内エージェント(LiteRT-LM・ML Kitベータ)、Firebase AI Logicのハイブリッド、RoomとAppSearchで状態の保存。@Toolと@Paramでスキーマを自動生成、SKILL.mdで手順を段階的に読む

検証(発表 9月9日)