新项目选了 LangChain4j,而不是继续用 Spring AI 我们团队的运维 Agent 一直是 Spring AI 写的,跑了半年挺稳。上个月开新项目——一个面向业务部门的合同审查 Agent,我评估了一圈,最后选了 LangChain4j。 这个决定在组内有争议,有人认为「统一技术栈」更
客服转来一条投诉:AI 给用户编了个退款政策 十月底,客服同学转来一条用户投诉,附了聊天截图: 用户:我这个订单上周下的,还能退吗? 机器人:可以的,我们支持 15 天内无理由退款,您直接在订单页面点击申请退款即可。 用户:我看到页面上写的是 7 天? 机器人:抱歉造成困扰,7 天是普通商品的标准,
两个同事为「提示词改版有没有用」吵了一周 九月份我们改了一版运维 Agent 的系统提示词,主要变化是加了「先确认信息是否充分,再决定调用工具」这一段。改完之后团队内部炸了: 小王说「明显变准了,我测的几个问题都对」;老李说「变差了,现在它老是不干活,一直问我问题」。两人各举了三四个例子,都很有说服
同一个问题跑五次,得到三种不同的结果 九月初用户反馈我们的运维 Agent 有时会给出错误的重启建议——明明是磁盘满了,它建议重启服务。我们拿到 session ID 去复现,同一个问题、同一份上下文,跑了五次: 次数 结论 步数 耗时 token 1 磁盘满,建议清理日志(正确) 4 18s 21
给公司内部的 CMDB 写了个 MCP Server 八月份我们决定把内部 CMDB、发布系统、监控平台接进 Agent。一开始想的是直接写 Function Calling,写了两周发现每个 Agent 框架(我们内部有 Spring AI 和 LangChain4j 两套)都要实现一遍,工具定义
工单:「你们的 Agent 是不是失忆了」 六月份客服转过来一批工单,其中有条写得挺扎心:「你们的运维助手,我上周三让它排查过一次订单服务超时,昨天又超时了,它从零开始问我要服务名、要时间范围,像完全没见过我一样。是不是失忆了?」 我看了下那两个 session,确实是两套完全独立的对话。我们当时只
审计日志里那条被拦截的命令,让我出了一身冷汗 有天早上巡检,我在运维 Agent 的审计日志里翻到这么一条: { "ts": "2025-07-29T03:14:22.118Z", "sessionId": "sess-7f3a91c0", "userId": "u_zhangwei",
实习生问我:为什么文档喂得越多,答案越差 七月份团队来了个实习生,负责维护我们的文档问答系统。他有天跑来问我一个问题:「我把 topK 从 5 调到 20,召回率肯定上去了吧?但测试集准确率从 71% 掉到 63%,是不是哪儿写错了?」 我看了下代码,没写错。这不是 bug,这是我们一直没认真对待的
财务拿着一张 14.7 万的账单来找我 六月初,财务同事拿着模型账单发消息给我:"你们那个智能运维 Agent,上个月花了 14.7 万?预算不是 5 万吗?" 我一看确实超了快三倍,而且这个 Agent 上线才一个月,日均任务量只有 420 个左右。 我花了两天把账单拆开分析,发现问题比想象的有意
公司要求数据不出境,得换模型 四月底法务下了个通知:客服对话数据不能出境,我们正在用的海外模型必须换掉。当时系统基于 Spring AI 写的,第一反应是"换个 base-url 应该就行",实际折腾了两周才稳定上线。 这篇记录接入国内模型的过程,主要是 Spring AI Alibaba 和 Op