boundary_id 查询参数,以及——在 BYOK 模式下——一个请求头。
Memory Router 在 MemoryLake 中国站暂未开放。中国站部署尚未启用该记忆网关,下面的步骤和端点在中国站当前无法跑通——本页保留完整流程,供您提前评估接入方案。如需在中国站使用,请联系 contact@data.cloud 了解开放计划;现在就要落地记忆,请改用 REST API 或 MCP 服务器。
第 1 步:获取密钥和 Boundary
- 登录控制台,创建一个 MemoryLake API Key(以
sk-开头)。 - 打开 Integrations → Memory Router API,创建一个 Boundary(记忆范围)——它把您的会话绑定到指定的工作空间、项目和 Actor。复制它的 id。
请将 MemoryLake 密钥保存在环境变量中,例如
MEMORYLAKE_API_KEY。密钥管理详见身份验证。不带 boundary_id 的请求仍然可用,但会以纯透传方式运行,记忆功能关闭。第 2 步:选择模式并替换 base URL
两种模式使用相同的端点——区别在于您发送哪些密钥:
完整对比见部署模式。
MemoryLake 托管——一个密钥
无需模型厂商账号。GPT、Claude 和 Qwen 系列模型均已内置;按原生模型名称调用任意模型即可。BYOK——使用您自己的模型厂商密钥
保留您现有的模型厂商账号。您的模型厂商密钥放在该厂商的原生鉴权头中(OpenAI 用Authorization: Bearer,Anthropic 用 x-api-key);MemoryLake 密钥则放在 x-memorylake-api-key 头中。
Anthropic SDK
使用 Anthropic SDK 时,将 base URL 设为https://app.memorylake.cn/anthropic——SDK 会自行追加 /v1/messages。
第 3 步:照常调用
像今天一样发送请求。附上boundary_id 后,相关记忆会自动召回并注入提示词,新记忆则异步提取并存储——响应绝不会被延迟。
TypeScript
X-Trace-ID 和控制台 Logs 页面,即可确认调用确实经过了 Router——参见可观测性。
较新的 OpenAI 推理模型(
gpt-5 系列、o1/o3/o4)在 Chat Completions 上要求使用 max_completion_tokens 而非 max_tokens。请让参数保持模型厂商官方格式——Router 会原样透传。后续步骤
部署模式
BYOK 与托管模式的完整对比,以及支持的模型厂商。
可观测性
追踪请求并理解错误约定。