scan_date: 2026-09-22 mode: B(repo 採用健檢)+同類比較(沿用 2026-07-10 閘門一的 8 項標準) tier: quick token_cost: 約 18-20 萬 token(主 session 直跑;WebSearch 5/10、WebFetch 3、Hermes X 1 發) target: supermemoryai/supermemory(https://github.com/supermemoryai/supermemory) question: Supermemory 值得換/並用嗎?與 EverOS、mem0 等前次八款一起比。靈魂拷問:在 EverOS 所獲不多,憑什麼指望 Supermemory 收穫滿滿? baseline: ~/Code/EverOS/research/memory-platform-eval-report.md(2026-07-10,74 天前,仍在 3 個月保鮮期內) readability: 已依「中學生看得懂」重寫(2026-09-22 Brian 要求)——術語當句白話解釋+比喻;§9 附錄是給查證用的原始查詢,可跳過


Radar 報告:Supermemory 值不值得用?(和 EverOS、mem0 一起比)

0. 30 秒看懂

名詞小抄(後文會用到)

名詞 白話
引擎 記憶系統的心臟:負責「抽重點、存起來、搜出來」的那段程式
開源/閉源 開源=食譜公開,你能看、能改;閉源=只給成品,壞了只能等廠商
授權(License) 別人的程式你「能不能拿來用、能不能改」的規則。MIT、Apache 都是寬鬆款
自架 裝在自己電腦上跑,資料不送到別人的雲端
向量/embedding 把文字翻成一串數字的「翻譯機」,電腦靠這串數字比「兩句話意思像不像」
相似度分數 0 到 1,越高代表越像
標準考卷(benchmark) 業界公用的測驗題,用來比誰的記憶系統比較準
issue GitHub 上的「問題回報單」。open=還沒解決,closed=已結案
注入 開工時,系統自動把一些舊記憶塞進 AI 的腦袋
md 檔 純文字筆記檔。任何軟體都打得開,十年後也讀得到

1. 裁決:不採用。路線=「只借點子」。

為什麼不採用(一句話): 核心程式不公開+資料搬不走。這一條在 07-10 的評估規則裡是「一票否決」——規則寫的是「換平台不能讓資料可攜性倒退」。Supermemory 在這題上比 mem0 退得更遠。另外,它的自架版才 0.0.8 版(非常早期),有三顆還沒修的地雷(見 §3)。

比喻: EverOS 像「你自己的筆記本,字醜,但每一頁都是看得懂的紙」。Supermemory 自架版像「一台上鎖的保險箱,廠商說裡面整理得很漂亮,但你沒有鑰匙、也不能拆開看」。

值得借的三個點子(只借想法,不抄程式,沒有授權問題):

  1. 「有需要才回想」。它給 Claude Code 的外掛,不是開工時一口氣倒一堆記憶;而是每一輪先讓 Claude 想一下「這句話需不需要查記憶?」,需要才拿你剛說的那句話去查。→ 正好打中 EverOS 最弱的地方(見 §4)。
  2. 記憶之間的三種關係:新事實「取代」舊的(例:換工作了)、「補充」舊的(例:多知道他帶 5 人團隊)、或由好幾條「推論」出新的。再加一個「這是最新版」的標記:查的時候只回最新版,舊的留著可以回頭查。→ 可以直接寫進 EverOS 已規劃的「遺忘/更新」設計(在 md 檔最上面的標籤區加欄位)。
  3. 兩段式個人檔案:「長期不變的事」(例:職業、習慣)和「最近在忙什麼」分開存,一次拿到。→ EverOS 本來就有類似通道,但目前混進了測試用的假資料,清理工作掛著還沒做。

什麼情況下值得重新評估(四條都成立才重看): - 核心程式真的公開了。 - 自架版能把全部記憶匯出成看得懂的文字檔,而且版本到 1.0 以上。 - 「每改一點就整本重抄」的儲存問題修好了。 - 有不是廠商自己做的評測,而且包含中文資料。

2. 一票否決項檢查

系統 程式能不能看、能不能用 會不會倒 資料安不安全 結果
Supermemory(本次主角) GitHub 頁面標「MIT 授權」,但那只涵蓋周邊工具(網頁、說明文件、給工程師串接用的工具包)。核心程式只發一個 270-310MB 的打包檔、沒有原始碼。官方文件卻仍寫「開源」。有人開單問「原始碼在哪?」(#1299),兩個月了官方一個字沒回;其他用戶留言:「這就是閉源,請誠實講」 風險低:14 人、募到約 260-300 萬美元、投資人有 Google 高層;每週都有更新 你的資料存成一個加密大檔,沒有官方說明怎麼整批匯出(#1653 未解決);預設還會對整個區域網路開放連線(#1441 未解決) ❌ 否決
mem0(07-10 評過,本次更新) Apache 授權、完全開源 ✅ 風險低(6.6 萬讚、Python 版每月約 370 萬次下載) 可匯出,但格式不是 md ⚠️ 維持 07-10 判定:它仍然「只會加新筆記、不會改舊的也不會劃掉」(官方 09-18 原文:「only adds… No overwrite or delete step」)。偏好改變時,新舊說法會同時留著打架
EverOS(現在用的) Apache 授權 ✅ 中等(1.3 萬讚;原廠修 bug 偏慢) 以 md 檔為本。兩次把索引整個刪掉重建,資料零損失 ✅ ✅ 通過
Supermemory 的 Claude Code 外掛 沒有附授權檔→ 依規矩視為「版權全保留」,程式不能抄,只能借想法 — — ⚠️ 只借想法

3. 同一把尺比一比(沿用 07-10 的 8 項標準)

8 項標準的白話版: ①資料搬不搬得走 ②能不能全裝在自己電腦 ③花錢方式 ④會不會更新/忘掉過時的事 ⑤和 Claude Code 接得好不好 ⑥穩不穩 ⑦社群健不健康 ⑧會不會把多條記憶串起來推理。

圖例:✅ 好/⚠️ 有保留/❌ 不行。其他七款(Zep、Letta、LangMem、MemoryOS、A-Mem、MemoBase、Nemori)這次沒重掃,維持 07-10 的結論。

系統 ①搬得走 ②自架 ③花錢 ④更新/遺忘 ⑤接 Claude Code ⑥穩定 ⑦社群 ⑧推理
EverOS(現任) ✅ ✅ ⚠️ ⚠️ 這是它的弱項 ✅ ⚠️ 出過事但已止血 ⚠️ ⚠️
Mem0 ⚠️ ✅ ⚠️ ❌ 只加不改 ⚠️ ❌(07-10) ✅ 用的人最多 ⚠️
Supermemory ❌ ⚠️ ⚠️ ✅(官方說法,看不到內部) ✅ ❌ ⚠️ ✅(官方說法)

Supermemory 每一格的證據:

標準考卷成績:每一家都說自己第一名

誰說的 考卷 A(LongMemEval) 考卷 B(LoCoMo) 注意
Supermemory 官方 「第一名」、95% 「第一名」 它用的評分工具 MemoryBench 是它自己寫的。比喻:自己出題、自己改考卷。而且裡面的對手只有 mem0、Zep 等,沒有 EverOS
第三方整理文 Supermemory 81.6–85.4%、Zep 63.8–71.2%、mem0 49% — 同一個系統在不同文章差了 4 分
mem0 官方(09-18) 94.4 92.5 沒列對手分數
EverOS 原廠 83.0 93.05 自己報的
Zep 對 mem0 — Zep 自稱 84 → mem0 幫它重算成 58 → Zep 反駁說是 75 兩家公開互罵「你把我的系統設定錯了」

結論: 這些分數都是廠商自己報的,考試條件不公開、彼此不能比。而且這些考卷考的是「問了問題,答得對不對」——不是你真正在意的事(見下一節)。不能拿來當決定依據。

4. 靈魂拷問:在 EverOS 收穫不多,憑什麼指望 Supermemory 收穫滿滿?

直球回答:不能指望。除非「收穫不多」的病因出在引擎——但你電腦裡的數據說,不是。

把記憶系統想成一間圖書館,它有三個部分:

換成 Supermemory,只換掉①。 那毛病到底出在哪一部分?看你電腦裡的實際紀錄:

你電腦裡的證據(都已查證) 說明毛病在哪
當你帶著明確問題去問,EverOS 找得很準。 8 月用四家聊天紀錄出了 25 題抽考,23 題第一筆就命中 ①書庫和目錄沒壞
但「開工自動塞記憶」時,分數全擠在一起。 從 08-06 到今天共 260 次、2,025 筆,相似度分數幾乎全落在 0.50 到 0.58 之間。比喻:全班考試都考 50-58 分,老師根本排不出誰比較好——所以不管及格線畫在哪,都篩不出真正有用的 ②圖書館員的問題:開工那一刻,系統還不知道你今天要做什麼,只能拿「專案名稱」去找,當然只找到「跟這個專案沾邊、但跟今天無關」的東西
今天這場對話就是活例子: 開工時自動塞了 8 條記憶,和「比較 Supermemory」有關的——0 條。08-06 那次也量到 8 條裡 4 條是雜訊 ②
自動整理時分出 120 群資料,其中 109 群是雜訊(91%);同一場對話被重複收進來很多次 ③書本身有髒頁

所以病因是②+③:「沒人發問就硬推書」加上「書有髒頁」。不是①。

換引擎,等於把沒壞的零件換掉,代價是: - 丟掉 EverOS 最強、而且救過你兩次的優點(資料是看得懂的純文字檔)。 - 4,650 多筆記憶要用它的流程重新抽一次、再付一次 AI 費用。 - 灌進去之後,是一個搬不出來的保險箱。

那「會意外收穫滿滿」的期待是哪來的? 來自它首頁那句「三大考卷全部第一名」,加上「新玩具效應」。同樣的期待,當初也投射在 EverOS 身上(EverOS 原廠也自稱某考卷 93 分)。這裡有個規律:考卷分數高,不等於你用起來有感。考卷考的是「問了答不答得對」;你的痛點是「該想起來的時候,AI 有沒有自己想起來?想起來之後,做事有沒有變得不一樣?」——目前沒有任何一份考卷在考這件事。

真正有用的四件事(效益由高到低,全部在 EverOS 裡做,不用搬家):

  1. 改「塞記憶的時機」:現在是一開工就盲塞。改成「等你說出第一句話,拿那句話去查,再塞」(就是借來的點子①)。不花 AI 費用(搜尋是在自己電腦上算的)。工程量大約一張普通工單。這是唯一直接打在病灶上的一刀。
  2. 把過期一個月的分數紀錄分析做掉(原訂 08-20)。數據其實已經告訴我們:「調及格線」這條路走不通,因為分數全擠在一起。該決定的是換方法,例如:找到候選後再請模型精排第二輪,或先把問題改寫得更具體再查。
  3. 做「遺忘/更新」功能:用借來的點子②(取代/補充/推論+最新版標記),和 EverOS 已經寫好的設計稿合併。
  4. 先清掉個人檔案裡的假資料,再試點子③(長期事實/最近在忙,分兩段)。

如果還是想親眼驗證引擎好不好(可以做,但不推薦優先做):在實驗區做一次「同題對考」——把它裝在自己電腦上(免費、斷網跑),灌同樣 50 筆記憶,用上次那 25 題抽考比誰的第一筆命中多。大約半天。規矩:只在實驗區玩,不接正式流程,裡面的資料當作隨時可丟。

5. 和你的環境合不合(六個面向)

面向 判定 一句話
功能 ⚠️ 「更新、遺忘、個人檔案」確實比 EverOS 完整——但都是官方說法,看不到裡面怎麼做
技術 ❌ 它是看不到內部的打包程式;EverOS 是看得到、改得動的 Python 程式+md 檔
維護 ❌ 版本太早期、三顆地雷沒修;而且 Mac Mini 上要再多養一個常駐服務
AI 助手改不改得動 ❌ EverOS 過去十幾次大修,全是「Claude 讀原始碼→動手術」救回來的。閉源代表出事只能乾等廠商
周邊生態 ✅ 官方外掛最齊全(Claude Code、Cursor、Codex 等都有)
想離開時的代價 ❌ 加密大檔、沒有整批匯出。進去容易、出來難

你手上已經有的零件: 記憶搜尋工具、開工自動塞記憶的程式+分數紀錄檔、「過期資訊標記」名單、自動整理(蒸餾)流程、4,650 筆聊天紀錄記憶、自己電腦上跑的多語言「文字翻譯機」、遺忘/更新功能的設計稿、名詞登錄檔。→ 要借的三個點子,落腳的地方全都已經存在。

6. X(推特)上的聲音

用 Hermes/Grok 撈了近 30 天 5 則貼文:

誰 日期 重點 查證
@therawlogs 09-21 「60 行就做出同樣功能」的說法是誤導——那 60 行只是呼叫它的雲端,裡面沒有記憶引擎 ✅ 與 #1299(找不到引擎原始碼)互相印證
@diwakergupta 09-17 在玩自架版……「為什麼自架版限制 1 萬份文件?」 ⚠️ 未查證:官方文件和 issue 都搜不到這個上限
@RoundtableSpace 09-08 轉述官方「每份考卷第一名」 宣傳轉貼
@grok 09-08 「mem0 自稱 94.4%;分數大多是自己報的、隨測法變動——請用你自己的資料測」 與 §3 結論一致
@LLMpsycho 09-18 介紹文 中性

貼文連結:therawlogs|diwakergupta|RoundtableSpace|grok|LLMpsycho

6b. 補充:那支介紹影片說的,和實際查到的,差在哪?(09-22 補)

Brian 拍板前給了一支中文 YouTube 介紹影片的逐字稿(「20 歲輟學生做出 AI 記憶基準第一」)。三個月前,他也是看了同一位 YouTuber 介紹 EverOS 才開始玩記憶系統。逐字稿對照結果:

影片講對、而且講得好的: - 「所有廠商的分數都是自己報的,同一個系統換答題模型就跑出 85.2/84.6/81.6」→ 和本報告 §3 一致。 - 「選型唯一標準:用你自己的真實資料實測」→ 和 §4 的「同題對考」一致。 - 三個提問框架:會不會更新?會不會遺忘?會不會主動給?→ 好用,下面拿來套 EverOS。

影片沒講、但對你最要命的四件事:

影片怎麼說 實際查到的
「開源專案、MIT 協議、商用沒有任何障礙」 MIT 只涵蓋周邊工具。記憶引擎沒有原始碼(#1299)。影片把「一個打包檔」講成優點,沒提這代表你看不到、改不動
「資料都在 .supermemory 資料夾,備份遷移就是複製貼上」 複製資料夾確實能備份。但裡面是加密大檔,打不開、也沒辦法匯出成看得懂的文字(#1653)。另外影片說的「當前目錄」正是地雷:換個資料夾啟動,它就默默開一個新的空資料庫(#1420)
「預設用本地 bge-base 模型,不需要 API key」 那個模型只懂英文。中文觀眾照著做,中文資料會搜不到(#1104)
「Gmail/Notion/Google Drive 即時同步、MCP 一行接上」 官方文件明寫:這些只有付費雲端版有,本地版沒有。影片把雲端功能和本地版講在一起

影片也沒提:自架版才 v0.0.8、升級曾默默清空搜尋索引、資料超過 150MB 會當機。

這回答了靈魂拷問的另一半:期待是怎麼來的? 這類影片的格式是「亮眼成績+花 10 分鐘跑起來」。它講的是第一天的體驗。而你在 EverOS 付出的是之後三個月的十幾次大修——那些大修之所以救得回來,正是因為 EverOS 的程式碼看得到、資料是純文字。Supermemory 在「第一天」贏,在「第九十天」那兩樣東西都沒有。

用影片的三個提問來套 EverOS(誠實版):

提問 EverOS 現況 要補什麼
會不會更新? ⚠️ 還不會。只有一份人工維護的「過期資訊名單」在擋 做「遺忘/更新」功能(§4 第 3 件事)
會不會遺忘? ⚠️ 還不會 同上
會不會主動給? 會,但給錯東西 見下段

這裡有個新的體會(修正 §4 第 1 件事的說法): Supermemory 開工時主動給的,是一份整理過的個人檔案(長期事實+最近在忙什麼),不是搜尋結果;每一輪有需要才另外去查。EverOS 現在開工時給的,是「拿專案名稱去搜、搜到的幾段舊對話」——既不是整理過的檔案,也不是針對今天任務的查詢,兩頭落空。

而你其實早就有一份整理過的個人檔案:每個專案的 MEMORY.md、交棒檔、CLAUDE.md。它們每次開工自動載入,而且真的有用。也就是說,「主動給」這件事,你手寫的檔案系統已經做掉了;EverOS 在旁邊再塞 8 段舊對話,多半只是加雜訊。EverOS 真正無可取代的價值,是「帶著問題去查很久以前、或別的專案的事」——而這件事它做得很準(25 題中 23)。

所以 §4 第 1 件事講得更精確是「兩條路分開」: - 開工那一刻:只留手寫檔案(+日後乾淨的兩段式個人檔案)。不再盲塞舊對話。 - 你說出第一句話之後:拿那句話去查 EverOS,有夠相關的才塞。

影片裡另外兩點(我沒查證,先記著): - 它有「記憶服務壞了,聊天照常」的設計(記憶出錯就把原本的請求直接放行)。這和你的鐵律「輔助功能不得卡住主流程」同一個精神。 - 有第三方論文指出:它每一步都要呼叫 AI 模型,寫入成本和延遲比純搜尋方案高。

裁決不變:不採用、只借點子。 影片沒有提供任何能推翻 §2 一票否決的新事實。

逐字稿位置:~/.claude/uploads/e5d7d6ea-fc7e-409d-9231-8a2d537337de/5b34d91f-…Supermemory….md

7. 證據連結(每個重點都能點回源頭)

這些來源有多可信: GitHub、下載量、官方文件=我這次親自查過。考卷分數=廠商自己報的,沒人重現過。搜尋摘要裡的第三方分數=二手資料,沒有逐一回源頭核對。募資金額有兩種說法(260 萬/300 萬美元)。

8. 查了哪些地方、哪些沒查到

管道 狀態
GitHub ✅ 主力:專案基本資料、版本紀錄、貢獻者、10 多張 issue 全文、官方文件原始檔、該組織全部專案、六個競品快照
Hacker News(工程師論壇) ✅ 查 3 次(其中一次 0 結果)
下載量(npm、PyPI)+兩個健檢網站 ✅
OpenSSF 安全評分 ❌ 這個管道本次壞了:查 Supermemory 沒資料,我拿「一定有資料」的 mem0 去對照也沒資料→所以不能說「它沒分數」,只能說「這次查不到」
網路搜尋 ✅ 用了 5 次(上限 10)。⚠️ 指定查 Reddit 那次,回來的結果沒有一筆是 Reddit→ Reddit 算沒查到
AlternativeTo(替代品網站) ⚠️ 用 mem0 反查,有 26 個替代品,但 Supermemory 和 EverOS 都沒被收錄→對這題幫助小
X(推特) ✅ 1 次,5 則,交叉查證 1 則(見 §6)
Discord 聊天群 沒查(機器人進不去別人的群)
實際安裝測試 沒做(radar 只研究、不動手)

如果升級成深度版,可以加查: 1. 07-10 名單以外的新面孔:Hindsight(MIT,2.5 萬讚)、Cognee(Apache,3.1 萬讚)、Mastra(自稱考卷 A 95%)、Hjarni(純文字檔路線,和 EverOS 同一派,未查證)。 2. 細讀它 Claude Code 外掛的程式,看「要不要回想」到底怎麼判斷。 3. 去「整合了 Supermemory 的其他專案」翻災情回報。 4. 中文圈的評價。 5. 實驗區同題對考。

9. 需要你手動做的+要你決定的

10. 附錄:原始查詢紀錄(給查證用,可跳過)

gh:api repos/supermemoryai/supermemory(+/releases、/releases/tags/server-v0.0.8、/contributors、/commits、/contents/{LICENSE,README.md,CLAUDE.md,apps,packages,skills,apps/docs,apps/docs/self-hosting/*,apps/docs/concepts/*,apps/docs/smfs/overview.mdx});search code "supermemory-server" --repo …(只命中 4 個文件檔=沒有原始碼);search code "10,000"、"10k"(查 X 上的 1 萬份上限說法,無對應);search issues --repo …:source code server(0)、export(8)、self-host(10)、open source binary(0)、closed source(1=#1299)、engine source(0)、AGPL(0)、10k documents(0)、10,000 documents(0)、document limit self-hosted(0);issue 全文 #1653 #1036 #1104 #1413 #1177 #1299;api orgs/supermemoryai/repos;api repos/supermemoryai/{claude-supermemory,smfs,memorybench};競品快照 mem0ai/mem0、getzep/graphiti、letta-ai/letta、EverMind-AI/EverMemOS(已改名 EverOS)、topoteretes/cognee、vectorize-io/hindsight。 HN:supermemory、supermemory memory benchmark(0)、Show HN supermemory。 下載量:npm supermemory、mem0ai、@supermemory/tools(1.6 萬/週)+supermemory 月序列 2026-03→09;pypistats supermemory、mem0ai。 健檢:Scorecard ×2(目標+對照,都失效)、deps.dev npm(47 版,預設 4.25.4/08-02)、ecosyste.ms。 WebSearch(5):supermemory LongMemEval benchmark claims criticism mem0 zep dispute|reddit supermemory self-hosted problems OR alternative OR "closed source"|supermemory vs mem0 vs zep vs letta comparison 2026 agent memory|EverMemOS EverMind benchmark LoCoMo LongMemEval score vs supermemory mem0 zep|supermemory Dhravya Shah funding round team size 2026。 WebFetch(3):supermemory.ai/research、mem0.ai/research、alternativeto.net/software/mem0/。 Hermes X(1):近 30 天 supermemory 實用者/批評貼文 5 則(用「拿不到就回 NO LIVE X ACCESS」的可驗句式)。 本機:shadow-scores.jsonl 統計(374 行→去掉測試行與空注入後 260 行、2,025 筆;中位數 0.543、第 10 百分位 0.497、第 90 百分位 0.577)。