- 01捕获提交一条已提炼事实,或带幂等键的推理请求。
- 02提交写入规范记录、历史、作用域、元数据和日志事件。
- 03召回在同一作用域内融合语义、关键词、时间与图候选。
- 01用户、智能体与运行作用域
- 02原文或推理写入
- 03双时间有效性
- 04历史与反馈
原始对话是证据;记忆则是带有作用域、来源和生命周期的持久结论。
决定什么值得持久保存。
当应用已经知道准确记录时使用 infer=false。需要从对话中提炼时使用推理;云端会先返回持久事件回执,再执行模型工作。
- 幂等键让重试安全,并拒绝冲突复用。
- 推理失败不会悄悄退化成保存原始对话。
- 元数据可以保留来源,而不会让派生记录变成权威。
召回正确事实,而不是最近段落。
搜索融合互补信号,并可返回跟踪信息。过滤、作用域、分数下限、排序和时间状态让线上行为足够明确,可以调试。
- 向量和全文候选通过融合协作,而不是互相替代。
- 被替代事实保留有效区间,当前召回优先使用仍有效状态。
- 跟踪模式暴露候选、融合分数与最终选择。
修正记忆,不抹掉审计轨迹。
读取、更新、删除、批处理、反馈、实体和历史,在托管与自托管 HTTP 服务中使用同一规范契约。
- 更新与失效都会记录为事件。
- 实体删除按用户、智能体或运行结构作用域执行。
- 命名空间导出保存权威状态,并标记需要重建的投影。
从一个具体请求开始。
const event = await fishmem.memories.addAsync(
{
content: "Alex 搬到柏林,并偏好深色模式。",
user_id: "alex"
},
{ idempotencyKey: "alex-profile-2026-08" }
);
const result = await fishmem.events.wait(event.event_id);这个产品范围包含什么
- 规范记录、历史、反馈、实体、事件与可迁移快照。
- 同步原文写入与持久异步推理。
- 云端与开源控制面共享公开记忆契约。
明确边界
- 并非每个对话轮次都应该成为记忆。
- 画像与索引是可替换投影,不是事实来源。
- 云端模型质量取决于配置的供应商与应用自己的评估集。
