已关闭
[Feature-Request|需求反馈]: memcache KvEvent 适配:缓存感知调度全链路 #508
jason lyu创建于 16 天前关闭于 13 天前
16 天前 关联了pull request:[feature] memcache KvEvent 适配:缓存感知调度全链路
wangyang
15 天前 评论:
15 天前 评论:
👋 您好,感谢向 mindie-motor 提交 Issue!
🎉 我们已收到您的反馈,感谢你对开源社区的支持!
📅 处理时效 维护团队将在工作日 24 小时内查看并回复您的问题。
🔍 自助排查(推荐优先查看) 在等待回复期间,您可以先查阅仓库README以及历史 Issue 中相似问题的解决方案,多数问题可快速解决。
💡 为了更快定位问题,请您确保 Issue 包含:
清晰的问题描述
可复现的操作步骤
相关日志、截图或环境信息
我们会尽快跟进,感谢您的理解与配合!


13 天前 关闭了 issue
13 天前 添加了label:resolved
背景
Agentic AI 多轮对话场景下,请求间共享大量相同前缀(System Prompt、历史消息),跨请求随机调度导致 KV Cache 无法命中、每轮重复 Prefill。为最大化 KV 复用,基于 MemCache 池化存储 + kv-conductor 缓存感知调度(两阶段匹配:引擎 offload 事件 × memcache 池 stored 事件),使能 prefill 节点亲和路由。
MemCache 侧已提供 KvEvent 广播能力(memcache PR #334/#363:MetaService 在元数据写入/删除后通过 ZMQ PUB 广播 STORED/REMOVED/CLEARED 事件)。
需求描述
Motor 侧适配 memcache KvEvent 全链路:
部署配置
memcache_meta_service.py:kv_events 配置块(enable/endpoint/model_name/block_size),解除注释即开启mmc-local-*.conf:ock.mmc.local_service.backend_id默认配置,deployer 部署时替换为 Pod IP(common.sh),kv-conductor 据此区分 KV 块所属节点kv-events: 5557端口kv-conductor 事件链路
{"events": [...]},fixmap 首字节快速分流,跳过无谓的 vLLM/Mooncake 试解析)Coordinator
kv_conductor_config.pool_endpoint支持tcp://*:5557通配符(部署时解析为 KVS_MASTER_SERVICE)vLLM 依赖补丁
MultiConnector.get_kv_connector_kv_cache_events未实现,仅 TODO)examples/deployer/patch/),已建议上游合入可维测性
kv_event <state>状态机(received/parsed/queued/offload_cached/matched/confirmed/applied/dropped),matched/confirmed 为 INFO 级测试结果