

从实际重构项目出发,记录 GitHub Stacked PRs 的线性依赖、分层合并、多级同步与本地 branch 关系。
从实际重构项目出发,记录 GitHub Stacked PRs 的线性依赖、分层合并、多级同步与本地 branch 关系。
3020 字
|
15 分钟

从 codex 硬删 chat/completions 的全过程,追到 new-api 被波及的迁移损伤,再拆开 Anthropic Messages 与 OpenAI 协议在 Tool 流上的真实差别——为什么我的长链静默不是协议的锅,以及什么才算真的「边说边做」。
从 codex 硬删 chat/completions 的全过程,追到 new-api 被波及的迁移损伤,再拆开 Anthropic Messages 与 OpenAI 协议在 Tool 流上的真实差别——为什么我的长链静默不是协议的锅,以及什么才算真的「边说边做」。
8857 字
|
44 分钟

拆解 Claude Desktop 的五套定时系统,剖析混乱背后的及架构本质,为什么花 N+ 倍精力维护一个项目。以及一个坏的架构能让我们看到什么?
拆解 Claude Desktop 的五套定时系统,剖析混乱背后的及架构本质,为什么花 N+ 倍精力维护一个项目。以及一个坏的架构能让我们看到什么?
2895 字
|
14 分钟

MoeChat 衍生讨论 RRF 和 Hybrid Search:时间检索应该以什么姿态参与混合检索?在不同场景里如何适配?以及 wikimem 和 XnneHangLab 的边界划分。
MoeChat 衍生讨论 RRF 和 Hybrid Search:时间检索应该以什么姿态参与混合检索?在不同场景里如何适配?以及 wikimem 和 XnneHangLab 的边界划分。
8472 字
|
42 分钟

深入剖析 MoeChat 如何为 AI 角色构建长期记忆,它的时间+语义混合检索——写给关注记忆系统的人。
深入剖析 MoeChat 如何为 AI 角色构建长期记忆,它的时间+语义混合检索——写给关注记忆系统的人。
6363 字
|
32 分钟

从"稀疏和稠密到底是什么意思"这个困惑出发,一路走通了 embedding pipeline、subword 与词典、输入长度的影响,最终搞清楚稀疏和稠密的区别以及 figure out 它们实际的应用场景。
从"稀疏和稠密到底是什么意思"这个困惑出发,一路走通了 embedding pipeline、subword 与词典、输入长度的影响,最终搞清楚稀疏和稠密的区别以及 figure out 它们实际的应用场景。
4577 字
|
23 分钟

