企业售后系统里的模型可以归类工单、检索政策、起草回复,也能把一句未执行的“已退款”写得像真的。后者不是语言问题,而是系统没有把事实、权限和业务动作分开。
一套能用于售后流程的 Agent,需要明确谁可以看数据、哪些知识仍然有效、什么情况必须停下来等人、发生问题后怎样还原过程。模型只负责其中一段:根据 ...
下午五点,CI 报了一条失败:test_order_total_rounding 预期得到 19.99,实际得到 20.00。你把任务交给编码 Agent,它很快读了测试、改了一个金额计算函数、又跑了一遍测试。结果第一条测试过了,另外两条折扣测试开始失败。
这时最常见的处理方式,是把报错继续塞回同一 ...
核验范围:harness 不是标准化产品名,不同框架对它的边界划分不同。本文讨论的是通用运行机制,不据此断言某个闭源产品的内部实现。文中的 LangGraph、OpenAI Agents SDK 和 Anthropic 文档只用来核对公开概念;代码是教学用伪代码,不是可直接部署的安全实现。
你让 ...
一、同一个能力,两个人要用我的项目里有个需求,当时把我卡住了。
系统要检索政策文件。这个能力有两个消费者:
模型。用户问「十四五规划里怎么说数字经济」,模型得自己判断该查哪个库、加什么过滤条件,然后调用。这是自主的。
图节点。产业诊断链跑到某一步,固定要去捞该县的产业材料。这是流程写死的,模型不参 ...
这篇写给两类人:一类是刚开始搭 Agent、被「上下文」这个词绕晕的初学者;一类是已经在用 LangGraph / LlamaIndex 之类框架,但总觉得「输出不稳定、模型老捡到不该看的东西」的人。我会尽量把每个术语第一次出现时讲清楚,也会给一个不依赖任何框架、30 行就能跑的最小例子 ...
一、同一个问题,为什么会走出两条路早期版本里,我让模型自己决定分析流程。给它工具、给它目标,让它规划下一步,这听起来很像 Agent。
后来我把同一个问题问了两次。第一次,它先做产业诊断,再查政策。第二次,它先查政策,再回头补诊断。两份结论都不离谱,却不能放在一起比较:一份把问题归因到产业结构,另一 ...
一、一个加功能要动四个文件的版本我的项目里,最早那版「框架」是我自己都不想维护的东西。
那时候我刚学完怎么从零搭一个 Agent 框架,正是手痒的时候。于是我写了抽象基类,写了插件注册机制,给节点设计了继承体系,一切都很「框架」。然后需求来了:加一条新的业务链。
我得改路由逻辑、改基类、改节点注册、 ...







