SimpleMem 做的就是一套长期记忆系统。
它不是把整段聊天原样保存,而是先提炼成一个个独立事实,需要的时候再通过语义检索把相关内容找回来。
官方测试里,Token 消耗最高可减少约 30 倍,LoCoMo 的 F1 也比此前方法高 26.4 个百分点。
现在还支持图片、音频、视频等多模态记忆,并提供自进化机制,会根据检索效果调整策略。
不过它目前并非完全本地运行,内部 LLM 调用仍需要 OpenAI 兼容 API Key。
🔗 https://github.com/aiming-lab/SimpleMem