LLM

沿着同一条持续展开的写作线索继续阅读。

7 篇文章
Attention is Limited - Lost in the Middle
LLM 的注意力是有限的。从 system prompt 与 user prompt 的权重差异出发,探讨 Lost in the Middle 现象及其启示。
1918 字
|
10 分钟
Cover Image of the Post
《放松时光:与你共享 lofi 故事》——给聪音接入 AI Chat
给 Steam 番茄钟游戏《放松时光》的主角聪音接入 AI 对话功能的 Mod 探索记录。
622 字
|
3 分钟
Cover Image of the Post
单图≠多图:多图理解时 VLM 为什么更容易"胡说",以及一个两阶段解法
多图分析时网页端和 API 结果一致性差的问题拆解,从 Lost in the Middle 到逐图预摘要的两阶段解法。
3508 字
|
18 分钟
Cover Image of the Post
做过长期系统项目再看:RAG 怪兽是否适用于个人博客系统的图谱构建?
从 AI 桌宠长期记忆系统的实践出发,横向对比三种 LLM 长期记忆方案,探讨 RAG 是否适合作为个人博客的关系图谱展示方案。
2480 字
|
12 分钟
Cover Image of the Post
大模型时代:我的能力究竟是什么?
重度使用 AI coding 一年后,我的编码能力几乎丧失殆尽。那么我究竟还剩下什么能力?
2093 字
|
10 分钟
Cover Image of the Post
协议的形状决定能力:codex 为什么砍掉 chat_completion,以及桌宠的「边说边做」到底卡在哪
从 codex 硬删 chat/completions 的全过程,追到 new-api 被波及的迁移损伤,再拆开 Anthropic Messages 与 OpenAI 协议在 Tool 流上的真实差别——为什么我的长链静默不是协议的锅,以及什么才算真的「边说边做」。
8857 字
|
44 分钟
Cover Image of the Post
从单帧识图到实时视频对话:DeepSeek、MiniCPM 与 MiniMax 的多模态架构路线
从 DeepSeek 的视觉原语、MiniMax-M3 的图片首字延迟,一路追到 MiniCPM-o 如何在本地实现持续视频理解与全双工语音交互。
5251 字
|
26 分钟
Cover Image of the Post