多 Agent 与实时交互:协作不是把模型数量相加
从单 Agent 的边界出发,理解多 Agent 的分工、上下文隔离、异步事件和人工介入,并看清协作系统最容易出现的失败模式。
Thoughts, tutorials, and development logs.
No matching articles found.
从单 Agent 的边界出发,理解多 Agent 的分工、上下文隔离、异步事件和人工介入,并看清协作系统最容易出现的失败模式。
从 Prefill、Decode 到 PagedAttention、Prefix Caching 与连续批处理,拆解 LLM 推理服务为什么越来越像一个内存和调度系统。
从轨迹反馈出发,判断问题应该由提示词、上下文、工具、知识库还是模型后训练解决,并建立可验证、可回滚的进化循环。
从任务集、轨迹指标和成本延迟出发,建立 Agent 的评估闭环,并用观测、消融和统计方法判断改动是否真的有效。
从搜索、编辑、执行到验证,拆解 Coding Agent 的工作循环,理解为什么可恢复、可审计的工程环境比一次性生成代码更重要。
讲清感知、执行与协作工具的边界,理解 schema、幂等、沙箱、权限和 MCP 如何共同构成可控的 Agent 行动接口。
从 SFT、偏好优化到可验证奖励,理解今天的大语言模型为什么越来越依赖后训练,以及如何把推理能力变成可评测、可发布的工程能力。
从短期上下文到长期记忆,拆解 Agent 的写入、检索和更新链路,并理解向量、关键词与混合检索各自解决什么问题。
理解消息、工具、Skills、状态栏和压缩策略如何共同构成 Agent 的工作上下文,并把上下文从信息堆变成可用状态。
从模型、上下文和工具出发,建立 Agent 的心智模型,理解 ReAct 循环以及一个可靠智能体最小需要哪些工程能力。
Loop Engineering 把 AI 编程从一次次手动提示,推进到发现任务、执行修改、验证结果、记录状态并决定下一步的持续循环。
从 Prompt、Context 到可验证的反馈回路,理解 Harness Engineering 如何把代码智能体从聊天窗口变成可靠的工程协作者。
Vibe Coding 让软件开发更快,但真正决定项目能否持续迭代的,仍然是技术栈规划、上下文管理与工程边界。这篇文章从前端、后端、数据到 Prompt、Context、Skills、MCP,讲清楚如何把 AI 变成生产力,而不是技术债放大器。
在机器学习里,我们经常默认一件事:数据越多,模型越聪明。但现实常常不是这样。
写博客是一种对抗遗忘的仪式。我希望在这里记录技术、分享生活。