LLM
沿着同一条持续展开的写作线索继续阅读。
7 篇文章
LLM 的注意力是有限的。从 system prompt 与 user prompt 的权重差异出发,探讨 Lost in the Middle 现象及其启示。
1918 字
|
10 分钟


多图分析时网页端和 API 结果一致性差的问题拆解,从 Lost in the Middle 到逐图预摘要的两阶段解法。
3508 字
|
18 分钟

从 AI 桌宠长期记忆系统的实践出发,横向对比三种 LLM 长期记忆方案,探讨 RAG 是否适合作为个人博客的关系图谱展示方案。
2480 字
|
12 分钟


从 codex 硬删 chat/completions 的全过程,追到 new-api 被波及的迁移损伤,再拆开 Anthropic Messages 与 OpenAI 协议在 Tool 流上的真实差别——为什么我的长链静默不是协议的锅,以及什么才算真的「边说边做」。
8857 字
|
44 分钟

从 DeepSeek 的视觉原语、MiniMax-M3 的图片首字延迟,一路追到 MiniCPM-o 如何在本地实现持续视频理解与全双工语音交互。
5251 字
|
26 分钟

