长会话里被Claude压缩上下文,几乎是每个重度用户的必经之路。一旦触发压缩,Claude就开始丢失之前的工作记忆。你明明在代码里提了“重试逻辑”这个段落,它却要反复跑好几条命令去搜字符串,才能勉强定位到正确位置。

问题出在搜索机制上

打开网易新闻 查看精彩图片

Claude Code和Cowork内置的搜索,在长上下文场景下会变得迟钝。你盯着它的执行过程看,经常能发现它在做重复劳动——一条命令找不到,再换一条,直到碰巧撞上那段代码。这种低效不是模型变笨了,而是上下文被压缩后,索引信息也跟着丢失了。

换成本地嵌入模型之后

作者给出的解法是放弃Claude内置搜索,改用本地嵌入模型。嵌入模型把代码片段转成向量,搜索时直接比对语义相似度,不再依赖被压缩过的上下文索引。结果就是上下文窗口能保持干净,Claude不用再靠猜去定位代码。

这个改动带来的直接好处是:当你引用代码里的某个具体段落时,Claude能更快找到它,而不是先跑一堆搜索命令试错。对于需要长时间维护同一个项目的开发者来说,省下的不只是时间,还有被反复压缩搞崩的心态。

适合谁动手试

如果你经常在Claude Code里做跨文件重构,或者会话一开就是几个小时,本地嵌入模型值得一试。它不改变Claude本身的推理能力,只是把“找代码”这件事从模型手里接过来,交给更擅长干这个的专用工具。