格物集
技术、工具、工程实践与原理探索。
21 篇文章

当 Agent 的等待、轮询和多会话切换不断打碎专注时,如何把工作从对话驱动改为任务驱动,让机器异步执行,让人保持单线程思考。
2853 字
|
14 分钟


从 codex 硬删 chat/completions 的全过程,追到 new-api 被波及的迁移损伤,再拆开 Anthropic Messages 与 OpenAI 协议在 Tool 流上的真实差别——为什么我的长链静默不是协议的锅,以及什么才算真的「边说边做」。
8857 字
|
44 分钟

拆解 Claude Desktop 的五套定时系统,剖析混乱背后的及架构本质,为什么花 N+ 倍精力维护一个项目。以及一个坏的架构能让我们看到什么?
2895 字
|
14 分钟

MoeChat 衍生讨论 RRF 和 Hybrid Search:时间检索应该以什么姿态参与混合检索?在不同场景里如何适配?以及 wikimem 和 XnneHangLab 的边界划分。
8472 字
|
42 分钟


从"稀疏和稠密到底是什么意思"这个困惑出发,一路走通了 embedding pipeline、subword 与词典、输入长度的影响,最终搞清楚稀疏和稠密的区别以及 figure out 它们实际的应用场景。
4577 字
|
23 分钟

用我自己的白话来讲一遍 TF-IDF。从 term 与分词开始,到 TF、IDF、查询打分、BM25,再到博客里推荐相关文章的实践。也算是还了一下没听 NLP 老师课的债,有需要再学果然更容易看进去。
1738 字
|
9 分钟

你的 Agent 是不是也经常同一个错误犯好几遍才记住?聊聊 gotcha.md——哪些记忆是 Agent 在 new session 后必须立刻全量具备的?哪些靠后续召回就够了?
2303 字
|
12 分钟

一篇围绕《How We Use Skills》的阅读笔记——当你无法一次性把所有东西都塞给 Agent 时,你该如何保持它的高效?渐进式披露(Progressive Disclosure)与任务拆解(Task Decomposition)。
4220 字
|
21 分钟



从 AI 陪伴引擎的实践经验出发,对比 LangChain、Dify、LangGraph、Coze 等主流 Agent 框架的局限性,记录我们为实时陪伴场景自建底层框架的核心设计思路与取舍。
5279 字
|
26 分钟


从 AI 桌宠长期记忆系统的实践出发,横向对比三种 LLM 长期记忆方案,探讨 RAG 是否适合作为个人博客的关系图谱展示方案。
2480 字
|
12 分钟

多图分析时网页端和 API 结果一致性差的问题拆解,从 Lost in the Middle 到逐图预摘要的两阶段解法。
3508 字
|
18 分钟

Termix 部署教程——用 Docker 部署一个 Web 端的 SSH 连接工具,从此告别 Termius 抽风。
893 字
|
4 分钟

LLM 的注意力是有限的。从 system prompt 与 user prompt 的权重差异出发,探讨 Lost in the Middle 现象及其启示。
1918 字
|
10 分钟

本博客基于 Fuwari 主题搭建。这篇指南涵盖 Front-matter 配置、Markdown 语法、扩展功能(GitHub 卡片、Admonitions)、代码高亮及视频嵌入。
495 字
|
2 分钟

