scan_date: 2026-09-22 mode: B(repo 採用健檢)+同類比較(沿用 2026-07-10 閘門一的 8 項標準) tier: quick token_cost: 約 18-20 萬 token(主 session 直跑;WebSearch 5/10、WebFetch 3、Hermes X 1 發) target: supermemoryai/supermemory(https://github.com/supermemoryai/supermemory) question: Supermemory 值得換/並用嗎?與 EverOS、mem0 等前次八款一起比。靈魂拷問:在 EverOS 所獲不多,憑什麼指望 Supermemory 收穫滿滿? baseline: ~/Code/EverOS/research/memory-platform-eval-report.md(2026-07-10,74 天前,仍在 3 個月保鮮期內) readability: 已依「中學生看得懂」重寫(2026-09-22 Brian 要求)——術語當句白話解釋+比喻;§9 附錄是給查證用的原始查詢,可跳過
| 名詞 | 白話 |
|---|---|
| 引擎 | 記憶系統的心臟:負責「抽重點、存起來、搜出來」的那段程式 |
| 開源/閉源 | 開源=食譜公開,你能看、能改;閉源=只給成品,壞了只能等廠商 |
| 授權(License) | 別人的程式你「能不能拿來用、能不能改」的規則。MIT、Apache 都是寬鬆款 |
| 自架 | 裝在自己電腦上跑,資料不送到別人的雲端 |
| 向量/embedding | 把文字翻成一串數字的「翻譯機」,電腦靠這串數字比「兩句話意思像不像」 |
| 相似度分數 | 0 到 1,越高代表越像 |
| 標準考卷(benchmark) | 業界公用的測驗題,用來比誰的記憶系統比較準 |
| issue | GitHub 上的「問題回報單」。open=還沒解決,closed=已結案 |
| 注入 | 開工時,系統自動把一些舊記憶塞進 AI 的腦袋 |
| md 檔 | 純文字筆記檔。任何軟體都打得開,十年後也讀得到 |
為什麼不採用(一句話): 核心程式不公開+資料搬不走。這一條在 07-10 的評估規則裡是「一票否決」——規則寫的是「換平台不能讓資料可攜性倒退」。Supermemory 在這題上比 mem0 退得更遠。另外,它的自架版才 0.0.8 版(非常早期),有三顆還沒修的地雷(見 §3)。
比喻: EverOS 像「你自己的筆記本,字醜,但每一頁都是看得懂的紙」。Supermemory 自架版像「一台上鎖的保險箱,廠商說裡面整理得很漂亮,但你沒有鑰匙、也不能拆開看」。
值得借的三個點子(只借想法,不抄程式,沒有授權問題):
什麼情況下值得重新評估(四條都成立才重看): - 核心程式真的公開了。 - 自架版能把全部記憶匯出成看得懂的文字檔,而且版本到 1.0 以上。 - 「每改一點就整本重抄」的儲存問題修好了。 - 有不是廠商自己做的評測,而且包含中文資料。
| 系統 | 程式能不能看、能不能用 | 會不會倒 | 資料安不安全 | 結果 |
|---|---|---|---|---|
| Supermemory(本次主角) | GitHub 頁面標「MIT 授權」,但那只涵蓋周邊工具(網頁、說明文件、給工程師串接用的工具包)。核心程式只發一個 270-310MB 的打包檔、沒有原始碼。官方文件卻仍寫「開源」。有人開單問「原始碼在哪?」(#1299),兩個月了官方一個字沒回;其他用戶留言:「這就是閉源,請誠實講」 | 風險低:14 人、募到約 260-300 萬美元、投資人有 Google 高層;每週都有更新 | 你的資料存成一個加密大檔,沒有官方說明怎麼整批匯出(#1653 未解決);預設還會對整個區域網路開放連線(#1441 未解決) | ❌ 否決 |
| mem0(07-10 評過,本次更新) | Apache 授權、完全開源 ✅ | 風險低(6.6 萬讚、Python 版每月約 370 萬次下載) | 可匯出,但格式不是 md | ⚠️ 維持 07-10 判定:它仍然「只會加新筆記、不會改舊的也不會劃掉」(官方 09-18 原文:「only adds… No overwrite or delete step」)。偏好改變時,新舊說法會同時留著打架 |
| EverOS(現在用的) | Apache 授權 ✅ | 中等(1.3 萬讚;原廠修 bug 偏慢) | 以 md 檔為本。兩次把索引整個刪掉重建,資料零損失 ✅ | ✅ 通過 |
| Supermemory 的 Claude Code 外掛 | 沒有附授權檔→ 依規矩視為「版權全保留」,程式不能抄,只能借想法 | — | — | ⚠️ 只借想法 |
8 項標準的白話版: ①資料搬不搬得走 ②能不能全裝在自己電腦 ③花錢方式 ④會不會更新/忘掉過時的事 ⑤和 Claude Code 接得好不好 ⑥穩不穩 ⑦社群健不健康 ⑧會不會把多條記憶串起來推理。
圖例:✅ 好/⚠️ 有保留/❌ 不行。其他七款(Zep、Letta、LangMem、MemoryOS、A-Mem、MemoBase、Nemori)這次沒重掃,維持 07-10 的結論。
| 系統 | ①搬得走 | ②自架 | ③花錢 | ④更新/遺忘 | ⑤接 Claude Code | ⑥穩定 | ⑦社群 | ⑧推理 |
|---|---|---|---|---|---|---|---|---|
| EverOS(現任) | ✅ | ✅ | ⚠️ | ⚠️ 這是它的弱項 | ✅ | ⚠️ 出過事但已止血 | ⚠️ | ⚠️ |
| Mem0 | ⚠️ | ✅ | ⚠️ | ❌ 只加不改 | ⚠️ | ❌(07-10) | ✅ 用的人最多 | ⚠️ |
| Supermemory | ❌ | ⚠️ | ⚠️ | ✅(官方說法,看不到內部) | ✅ | ❌ | ⚠️ | ✅(官方說法) |
Supermemory 每一格的證據:
| 誰說的 | 考卷 A(LongMemEval) | 考卷 B(LoCoMo) | 注意 |
|---|---|---|---|
| Supermemory 官方 | 「第一名」、95% | 「第一名」 | 它用的評分工具 MemoryBench 是它自己寫的。比喻:自己出題、自己改考卷。而且裡面的對手只有 mem0、Zep 等,沒有 EverOS |
| 第三方整理文 | Supermemory 81.6–85.4%、Zep 63.8–71.2%、mem0 49% | — | 同一個系統在不同文章差了 4 分 |
| mem0 官方(09-18) | 94.4 | 92.5 | 沒列對手分數 |
| EverOS 原廠 | 83.0 | 93.05 | 自己報的 |
| Zep 對 mem0 | — | Zep 自稱 84 → mem0 幫它重算成 58 → Zep 反駁說是 75 | 兩家公開互罵「你把我的系統設定錯了」 |
結論: 這些分數都是廠商自己報的,考試條件不公開、彼此不能比。而且這些考卷考的是「問了問題,答得對不對」——不是你真正在意的事(見下一節)。不能拿來當決定依據。
直球回答:不能指望。除非「收穫不多」的病因出在引擎——但你電腦裡的數據說,不是。
把記憶系統想成一間圖書館,它有三個部分:
換成 Supermemory,只換掉①。 那毛病到底出在哪一部分?看你電腦裡的實際紀錄:
| 你電腦裡的證據(都已查證) | 說明毛病在哪 |
|---|---|
| 當你帶著明確問題去問,EverOS 找得很準。 8 月用四家聊天紀錄出了 25 題抽考,23 題第一筆就命中 | ①書庫和目錄沒壞 |
| 但「開工自動塞記憶」時,分數全擠在一起。 從 08-06 到今天共 260 次、2,025 筆,相似度分數幾乎全落在 0.50 到 0.58 之間。比喻:全班考試都考 50-58 分,老師根本排不出誰比較好——所以不管及格線畫在哪,都篩不出真正有用的 | ②圖書館員的問題:開工那一刻,系統還不知道你今天要做什麼,只能拿「專案名稱」去找,當然只找到「跟這個專案沾邊、但跟今天無關」的東西 |
| 今天這場對話就是活例子: 開工時自動塞了 8 條記憶,和「比較 Supermemory」有關的——0 條。08-06 那次也量到 8 條裡 4 條是雜訊 | ② |
| 自動整理時分出 120 群資料,其中 109 群是雜訊(91%);同一場對話被重複收進來很多次 | ③書本身有髒頁 |
所以病因是②+③:「沒人發問就硬推書」加上「書有髒頁」。不是①。
換引擎,等於把沒壞的零件換掉,代價是: - 丟掉 EverOS 最強、而且救過你兩次的優點(資料是看得懂的純文字檔)。 - 4,650 多筆記憶要用它的流程重新抽一次、再付一次 AI 費用。 - 灌進去之後,是一個搬不出來的保險箱。
那「會意外收穫滿滿」的期待是哪來的? 來自它首頁那句「三大考卷全部第一名」,加上「新玩具效應」。同樣的期待,當初也投射在 EverOS 身上(EverOS 原廠也自稱某考卷 93 分)。這裡有個規律:考卷分數高,不等於你用起來有感。考卷考的是「問了答不答得對」;你的痛點是「該想起來的時候,AI 有沒有自己想起來?想起來之後,做事有沒有變得不一樣?」——目前沒有任何一份考卷在考這件事。
真正有用的四件事(效益由高到低,全部在 EverOS 裡做,不用搬家):
如果還是想親眼驗證引擎好不好(可以做,但不推薦優先做):在實驗區做一次「同題對考」——把它裝在自己電腦上(免費、斷網跑),灌同樣 50 筆記憶,用上次那 25 題抽考比誰的第一筆命中多。大約半天。規矩:只在實驗區玩,不接正式流程,裡面的資料當作隨時可丟。
| 面向 | 判定 | 一句話 |
|---|---|---|
| 功能 | ⚠️ | 「更新、遺忘、個人檔案」確實比 EverOS 完整——但都是官方說法,看不到裡面怎麼做 |
| 技術 | ❌ | 它是看不到內部的打包程式;EverOS 是看得到、改得動的 Python 程式+md 檔 |
| 維護 | ❌ | 版本太早期、三顆地雷沒修;而且 Mac Mini 上要再多養一個常駐服務 |
| AI 助手改不改得動 | ❌ | EverOS 過去十幾次大修,全是「Claude 讀原始碼→動手術」救回來的。閉源代表出事只能乾等廠商 |
| 周邊生態 | ✅ | 官方外掛最齊全(Claude Code、Cursor、Codex 等都有) |
| 想離開時的代價 | ❌ | 加密大檔、沒有整批匯出。進去容易、出來難 |
你手上已經有的零件: 記憶搜尋工具、開工自動塞記憶的程式+分數紀錄檔、「過期資訊標記」名單、自動整理(蒸餾)流程、4,650 筆聊天紀錄記憶、自己電腦上跑的多語言「文字翻譯機」、遺忘/更新功能的設計稿、名詞登錄檔。→ 要借的三個點子,落腳的地方全都已經存在。
用 Hermes/Grok 撈了近 30 天 5 則貼文:
| 誰 | 日期 | 重點 | 查證 |
|---|---|---|---|
| @therawlogs | 09-21 | 「60 行就做出同樣功能」的說法是誤導——那 60 行只是呼叫它的雲端,裡面沒有記憶引擎 | ✅ 與 #1299(找不到引擎原始碼)互相印證 |
| @diwakergupta | 09-17 | 在玩自架版……「為什麼自架版限制 1 萬份文件?」 | ⚠️ 未查證:官方文件和 issue 都搜不到這個上限 |
| @RoundtableSpace | 09-08 | 轉述官方「每份考卷第一名」 | 宣傳轉貼 |
| @grok | 09-08 | 「mem0 自稱 94.4%;分數大多是自己報的、隨測法變動——請用你自己的資料測」 | 與 §3 結論一致 |
| @LLMpsycho | 09-18 | 介紹文 | 中性 |
貼文連結:therawlogs|diwakergupta|RoundtableSpace|grok|LLMpsycho
Brian 拍板前給了一支中文 YouTube 介紹影片的逐字稿(「20 歲輟學生做出 AI 記憶基準第一」)。三個月前,他也是看了同一位 YouTuber 介紹 EverOS 才開始玩記憶系統。逐字稿對照結果:
影片講對、而且講得好的: - 「所有廠商的分數都是自己報的,同一個系統換答題模型就跑出 85.2/84.6/81.6」→ 和本報告 §3 一致。 - 「選型唯一標準:用你自己的真實資料實測」→ 和 §4 的「同題對考」一致。 - 三個提問框架:會不會更新?會不會遺忘?會不會主動給?→ 好用,下面拿來套 EverOS。
影片沒講、但對你最要命的四件事:
| 影片怎麼說 | 實際查到的 |
|---|---|
| 「開源專案、MIT 協議、商用沒有任何障礙」 | MIT 只涵蓋周邊工具。記憶引擎沒有原始碼(#1299)。影片把「一個打包檔」講成優點,沒提這代表你看不到、改不動 |
「資料都在 .supermemory 資料夾,備份遷移就是複製貼上」 |
複製資料夾確實能備份。但裡面是加密大檔,打不開、也沒辦法匯出成看得懂的文字(#1653)。另外影片說的「當前目錄」正是地雷:換個資料夾啟動,它就默默開一個新的空資料庫(#1420) |
| 「預設用本地 bge-base 模型,不需要 API key」 | 那個模型只懂英文。中文觀眾照著做,中文資料會搜不到(#1104) |
| 「Gmail/Notion/Google Drive 即時同步、MCP 一行接上」 | 官方文件明寫:這些只有付費雲端版有,本地版沒有。影片把雲端功能和本地版講在一起 |
影片也沒提:自架版才 v0.0.8、升級曾默默清空搜尋索引、資料超過 150MB 會當機。
這回答了靈魂拷問的另一半:期待是怎麼來的? 這類影片的格式是「亮眼成績+花 10 分鐘跑起來」。它講的是第一天的體驗。而你在 EverOS 付出的是之後三個月的十幾次大修——那些大修之所以救得回來,正是因為 EverOS 的程式碼看得到、資料是純文字。Supermemory 在「第一天」贏,在「第九十天」那兩樣東西都沒有。
用影片的三個提問來套 EverOS(誠實版):
| 提問 | EverOS 現況 | 要補什麼 |
|---|---|---|
| 會不會更新? | ⚠️ 還不會。只有一份人工維護的「過期資訊名單」在擋 | 做「遺忘/更新」功能(§4 第 3 件事) |
| 會不會遺忘? | ⚠️ 還不會 | 同上 |
| 會不會主動給? | 會,但給錯東西 | 見下段 |
這裡有個新的體會(修正 §4 第 1 件事的說法): Supermemory 開工時主動給的,是一份整理過的個人檔案(長期事實+最近在忙什麼),不是搜尋結果;每一輪有需要才另外去查。EverOS 現在開工時給的,是「拿專案名稱去搜、搜到的幾段舊對話」——既不是整理過的檔案,也不是針對今天任務的查詢,兩頭落空。
而你其實早就有一份整理過的個人檔案:每個專案的 MEMORY.md、交棒檔、CLAUDE.md。它們每次開工自動載入,而且真的有用。也就是說,「主動給」這件事,你手寫的檔案系統已經做掉了;EverOS 在旁邊再塞 8 段舊對話,多半只是加雜訊。EverOS 真正無可取代的價值,是「帶著問題去查很久以前、或別的專案的事」——而這件事它做得很準(25 題中 23)。
所以 §4 第 1 件事講得更精確是「兩條路分開」: - 開工那一刻:只留手寫檔案(+日後乾淨的兩段式個人檔案)。不再盲塞舊對話。 - 你說出第一句話之後:拿那句話去查 EverOS,有夠相關的才塞。
影片裡另外兩點(我沒查證,先記著): - 它有「記憶服務壞了,聊天照常」的設計(記憶出錯就把原本的請求直接放行)。這和你的鐵律「輔助功能不得卡住主流程」同一個精神。 - 有第三方論文指出:它每一步都要呼叫 AI 模型,寫入成本和延遲比純搜尋方案高。
裁決不變:不採用、只借點子。 影片沒有提供任何能推翻 §2 一票否決的新事實。
逐字稿位置:~/.claude/uploads/e5d7d6ea-fc7e-409d-9231-8a2d537337de/5b34d91f-…Supermemory….md
apps/docs/concepts/graph-memory.mdx、how-it-works.mdx~/.claude/everos-state/shadow-scores.jsonl;EverOS 記憶檔 project-memharness-injection-hardening、project-chatgpt-import-spike-20260803;~/Code/EverOS/research/memory-platform-eval-report.md這些來源有多可信: GitHub、下載量、官方文件=我這次親自查過。考卷分數=廠商自己報的,沒人重現過。搜尋摘要裡的第三方分數=二手資料,沒有逐一回源頭核對。募資金額有兩種說法(260 萬/300 萬美元)。
| 管道 | 狀態 |
|---|---|
| GitHub | ✅ 主力:專案基本資料、版本紀錄、貢獻者、10 多張 issue 全文、官方文件原始檔、該組織全部專案、六個競品快照 |
| Hacker News(工程師論壇) | ✅ 查 3 次(其中一次 0 結果) |
| 下載量(npm、PyPI)+兩個健檢網站 | ✅ |
| OpenSSF 安全評分 | ❌ 這個管道本次壞了:查 Supermemory 沒資料,我拿「一定有資料」的 mem0 去對照也沒資料→所以不能說「它沒分數」,只能說「這次查不到」 |
| 網路搜尋 | ✅ 用了 5 次(上限 10)。⚠️ 指定查 Reddit 那次,回來的結果沒有一筆是 Reddit→ Reddit 算沒查到 |
| AlternativeTo(替代品網站) | ⚠️ 用 mem0 反查,有 26 個替代品,但 Supermemory 和 EverOS 都沒被收錄→對這題幫助小 |
| X(推特) | ✅ 1 次,5 則,交叉查證 1 則(見 §6) |
| Discord 聊天群 | 沒查(機器人進不去別人的群) |
| 實際安裝測試 | 沒做(radar 只研究、不動手) |
如果升級成深度版,可以加查: 1. 07-10 名單以外的新面孔:Hindsight(MIT,2.5 萬讚)、Cognee(Apache,3.1 萬讚)、Mastra(自稱考卷 A 95%)、Hjarni(純文字檔路線,和 EverOS 同一派,未查證)。 2. 細讀它 Claude Code 外掛的程式,看「要不要回想」到底怎麼判斷。 3. 去「整合了 Supermemory 的其他專案」翻災情回報。 4. 中文圈的評價。 5. 實驗區同題對考。
gh:api repos/supermemoryai/supermemory(+/releases、/releases/tags/server-v0.0.8、/contributors、/commits、/contents/{LICENSE,README.md,CLAUDE.md,apps,packages,skills,apps/docs,apps/docs/self-hosting/*,apps/docs/concepts/*,apps/docs/smfs/overview.mdx});search code "supermemory-server" --repo …(只命中 4 個文件檔=沒有原始碼);search code "10,000"、"10k"(查 X 上的 1 萬份上限說法,無對應);search issues --repo …:source code server(0)、export(8)、self-host(10)、open source binary(0)、closed source(1=#1299)、engine source(0)、AGPL(0)、10k documents(0)、10,000 documents(0)、document limit self-hosted(0);issue 全文 #1653 #1036 #1104 #1413 #1177 #1299;api orgs/supermemoryai/repos;api repos/supermemoryai/{claude-supermemory,smfs,memorybench};競品快照 mem0ai/mem0、getzep/graphiti、letta-ai/letta、EverMind-AI/EverMemOS(已改名 EverOS)、topoteretes/cognee、vectorize-io/hindsight。
HN:supermemory、supermemory memory benchmark(0)、Show HN supermemory。
下載量:npm supermemory、mem0ai、@supermemory/tools(1.6 萬/週)+supermemory 月序列 2026-03→09;pypistats supermemory、mem0ai。
健檢:Scorecard ×2(目標+對照,都失效)、deps.dev npm(47 版,預設 4.25.4/08-02)、ecosyste.ms。
WebSearch(5):supermemory LongMemEval benchmark claims criticism mem0 zep dispute|reddit supermemory self-hosted problems OR alternative OR "closed source"|supermemory vs mem0 vs zep vs letta comparison 2026 agent memory|EverMemOS EverMind benchmark LoCoMo LongMemEval score vs supermemory mem0 zep|supermemory Dhravya Shah funding round team size 2026。
WebFetch(3):supermemory.ai/research、mem0.ai/research、alternativeto.net/software/mem0/。
Hermes X(1):近 30 天 supermemory 實用者/批評貼文 5 則(用「拿不到就回 NO LIVE X ACCESS」的可驗句式)。
本機:shadow-scores.jsonl 統計(374 行→去掉測試行與空注入後 260 行、2,025 筆;中位數 0.543、第 10 百分位 0.497、第 90 百分位 0.577)。