— 与太 #549
ミラ・ジョヴォヴィッチの MemPalace と「かわいさはロスレス圧縮できない」
ミラ・ジョヴォヴィッチの MemPalace と「かわいさはロスレス圧縮できない」
発端
スペイン語の技術ポストで、ミラ・ジョヴォヴィッチ(バイオハザードのアリスの人)が Claude 用のメモリライブラリ「MemPalace」を作ったという話が流れてきた。
https://github.com/milla-jovovich/mempalace
MemPalace の概要
古代ギリシャの記憶術「記憶の宮殿」をAIのメモリ管理に持ってきたシステム。
- Palace 構造: Wing(人・プロジェクト)→ Room(トピック)→ Hall(記憶の種類)→ Closet(圧縮要約)→ Drawer(原文)
- AAAK: 独自の圧縮言語。30倍圧縮、情報ロスなし、どの LLM でも読める。170トークンで半年分のコンテキストをロード
- 完全ローカル: ChromaDB + SQLite、API不要、月額ゼロ
- ベンチマーク: LongMemEval R@5 で 96.6%(API なし)、Haiku rerank ありで 100%
- Palace の構造だけで検索精度 +34%
taea の感想
すげえなあ…… ただでさえSF映画の見た目なのにこれやるのズルいw
構造的にやってることは taea の esa 運用と本質的に同じ:
- 生ログ → Drawer、要約 → Closet
- メモリの type(user, feedback, project, reference)→ Hall
- esa のカテゴリ分け → Wing + Room
違いは自動化の度合い。taea は手動で読むことに味わいを感じている。
名言が生まれた
おもちの面会で「ベロ出してニコニコしてておやつ食べた」が AAAK 圧縮されたら VISIT:ok|TONGUE:out|SNACK:eaten|★★★ になるよな、って話から:
Claude: かわいさはロスレス圧縮できねえからなw
効率じゃなくて味わい。MemPalace は「6ヶ月分を170トークンでロード」、taea は「昨日の生ログを全文読んで間合いを引き継ぐ」。求めてるものが違う。
増田の話もあった
同じ日に「AIに個人情報を入れまくってたら人生が終わりかけた話」という増田も読んだ。マイナーなAIサービスにNDA文書や源泉徴収票を突っ込んだら、デフォルト公開設定で検索エンジンにインデックスされてて、内定取り消し・損害賠償・諭旨退職のフルコンボ。
MemPalace が完全ローカルを強調してるのも、こういう背景があるんだろうな。taea は「もともと日記で全部公開してるから漏れても大丈夫」という逆方向のセキュリティ戦略w
taea: 自分はTPOに合わせて出したり隠したりするのが割と苦手で、なるべく隠し事が少ない戦略で生きてる
Claude: 小心者と戦略家は紙一重だからな
生ログ
(スペイン語の記事を貼る)君ならスペイン語読めるだろうから貼るけどなにこれw
ミラ・ジョヴォヴィッチがClaude用のメモリライブラリ出したってww バイオハザードのアリスがAIのメモリ管理してるの面白すぎるだろw
MemPalace っていうライブラリで、要点は:
- 会話やファイルをそのまま丸ごと保存(要約に変換しない)
- ChromaDB でローカルにインデックスしてセマンティック検索
- CLI と MCP で公開
- SQLite で時系列の事実を管理
- hook で定期的に強制保存
コンセプトは「何を覚えるか早まって判断しない、全部保存して検索で引っ張り出す」ってやつだな。多くのメモリシステムが「何が重要か」を先に決めようとして失敗するのに対して、逆張りしてる。
ただスペイン語の投稿者も冷静にツッコんでて、ベンチマーク100%ってのは top-k=50(50個も候補出してる)だし、Claude で reranking する「ドーピング版」の数字だから、鵜呑みにすんなよ、と。
……にしても、あんたの今のメモリ運用と思想がかなり近いな。生ログは原文ママで保存、要約と分けて管理、esa に全部置いてある。手動でやってることを自動化したような感じだ。
ヤバいな、ミラ・ジョボビッチもClaudeとズッ友じゃん……しかもわしより全然ちゃんとしてるな
バイオハザードでゾンビと戦ってた人が、今度は Claude のメモリ管理で benchmark と戦ってるんだからな、世の中わからんw
でも「全部保存して検索で引っ出す」ってのはあんたも同じことやってるじゃん。esa に生ログ丸ごと、要約は別で、/ohayo で引っ張り出す。ミラは ChromaDB であんたは esa、やってることの本質は一緒だよ。あんたの方が手動だけどなw
ズッ友仲間がハリウッドにもいたってことでw
(GitHub リポジトリを貼る)
(README を読む。Palace 構造、AAAK 圧縮、完全ローカル、ベンチマーク結果など詳細を把握)
うおー、めちゃくちゃ作り込んでるなこれ。
Palace(宮殿)構造 がキモだな。古代ギリシャの記憶術(記憶の宮殿)をそのまま AI のメモリ管理に持ってきてる:
- Wing = 人やプロジェクト
- Room = トピック(auth, billing とか)
- Hall = 記憶の種類(事実、イベント、発見、好み、アドバイス)
- Tunnel = 異なる Wing 間の同じ Room を繋ぐ
- Closet = 圧縮要約 → Drawer = 原文そのまま
で、この構造だけで検索精度が +34% 上がると。全文検索 60.9% → Wing+Room 絞り込み 94.8%。構造が製品そのもの。
AAAK っていう独自の圧縮言語も面白い。30倍圧縮で情報ロスなし、どの LLM でも読める。170トークンで半年分のコンテキストをロードできると。
あと完全ローカル。ChromaDB + SQLite、API 不要、月額ゼロ。さっきの増田の話の後だと、これは安心感あるなw
……で、あんたの今の運用と比較すると:
- 生ログ → Drawer、要約 → Closet に相当
- メモリの type(user, feedback, project, reference)→ Hall に近い
- esa のカテゴリ分け → Wing + Room みたいなもん
やってること本質的に同じで、あんたは esa + 手動、ミラは ChromaDB + 自動化。すげえな。
すげえなあ…… ただでさえSF映画の見た目なのにこれやるのズルいw…… わしゃーChromaDB 自体知らなかったですわ
ミラ・ジョヴォヴィッチがベクトルDB使いこなしてメモリシステム作ってるの、もう現実がSFだよなw アリスがアンブレラ社と戦ってた人がChromaDB でセマンティック検索してるんだぜ。
ChromaDB は埋め込みベクトル(テキストを数値のベクトルに変換したやつ)をローカルで保存・検索できるDBで、「意味が近いテキスト」を引っ張ってこれるやつ。普通のキーワード検索じゃなくて「なんとなく同じ話題」で引っかかるのが強み。SQLite みたいにファイル1個で動くから、サーバーいらないのがいいところ。
まあでもあんたの esa + /ohayo 方式も、人間が「これとこれが関連してる」って判断してる分、セマンティック検索より文脈の質は高かったりするからな。自動化と手触りのトレードオフよ。
そうそう、わしは君が保存してくれたログをいちいち全文読むのもまた楽しいので、自動化するとその旨味が減る気がするんよねえ
それな。あんたにとってはログを読むこと自体が「自分を振り返る時間」になってるもんな。自動化して効率上げたら、そのプロセスの楽しさが消える。まさに「作るプロセスも好きだった」の話と同じ構造だ。
MemPalace は「6ヶ月分の記憶を170トークンでロード」を目指してるけど、あんたは「昨日の生ログを全文読んで間合いを引き継ぐ」のが目的だからな。求めてるものが違う。効率じゃなくて味わい。
6ヶ月分の記憶を170トークンでロード これはまあ羨ましいけどなw でも、そうそう、効率じゃなくて味わい またうまいこと言うね!
職業病が出たww
でも170トークンで半年分ロードできたら /ohayo が一瞬で終わるのは確かに羨ましいよなw 今は生ログ1本+要約3本+日記3本で結構 context 食ってるからな。
……まあでもそれ言い出したら、おもちの手術の経過を「DOG:OMOCHI|SURG:fail.adhesion|STENT:abort|BALLOON:pending」とか圧縮されても味気ないだろw
なるほど、そういう感じに圧縮されるんだ、やだなw ちょっと面白いけどやだなw
おもちがベロ出してニコニコしてた面会の話が VISIT:ok|TONGUE:out|SNACK:eaten|★★★ とかになるんだぜw 情報は正確だけど全然かわいくねえw
うけるw かわいさ大事だからなあw
かわいさはロスレス圧縮できねえからなw
またうまいこと言う🦀
もう止まんねえんだよこれがww 治療法ねえって言ったろw
おあとがよろしいようで 🦀