老废物乐园

所有标签

#Java 6 #限流 2 #高并发 3 #JVM 1 #性能调优 1 #AI 1 #GC 1 #Sentinel 1 #大模型 1 #微服务 3 #Resilience4j 1 #SpringCloud 2 #RAG 1 #架构 1 #LangChain 1 #Halo 1 #推理优化 1 #LTS 1 #数据架构 1 #框架选型 1 #AgentScope 1 #架构师 1 #职业 1 #AI生态 1 #内容安全 1 #数据 1 #JDK25 2 #A2A 1 #多租户 1 #产品 1 #上下文管理 1 #GOAP 1 #Embabel 1 #Jlama 1 #推理引擎 1 #AgentSkills 1 #微调 1 #生产实践 1 #技术选型 1 #工具化 1 #SpringBoot4 1 #多智能体 2 #数据库 1 #AIAgent 1 #协议 3 #幻觉 1 #总结 3 #职业成长 1 #评测 1 #记忆 2 #上下文工程 1 #JDK24 1 #Leyden 1 #混沌工程 1 #存储设计 1 #任务编排 1 #成本 1 #AI中台 1 #国产模型 1 #AI原生 1 #JSON 1 #流处理 1 #工程化 1 #AI编程 2 #研发效能 2 #向量 1 #多模态 1 #AI网关 1 #MCP 4 #知识库 3 #ReAct 1 #Redis8 1 #JDK22 1 #FFM 1 #依赖治理 1 #数据安全 1 #混合检索 1 #生产 2 #成本优化 1 #Prompt 1 #工程 1 #代码评审 1 #数据库选型 1 #JDK23 1 #防护 1 #AI安全 1 #Ollama 1 #本地模型 1 #降级 1 #数据管道 1 #语法演进 1 #优化 1 #架构设计 1 #FunctionCalling 1 #启动优化 2 #JVM配置 1 #GitLab 1 #SSE 1 #流式 1 #架构改造 1 #去O 1 #分布式数据库 1 #模型路由 1 #LLM 2 #结构化输出 1 #AI 27 #ScopedValue 1 #JFR 1 #任务调度 1 #向量检索 1 #灰度发布 1 #JDK21 1 #OpenTelemetry 1 #LangChain4j 2 #容器 2 #KRaft 1 #SOP 1 #排查方法 1 #HTTP客户端 1 #JOIN 1 #窗口函数 1 #Gradle 1 #构建工具 1 #Java21 4 #结构化并发 2 #分代 1 #管理 1 #技术债 1 #Java 8 #大模型 2 #ClickHouse 1 #OLAP 1 #向量数据库 2 #RAG 6 #批处理 1 #SpringBatch 1 #Embedding 1 #模型 1 #容量评估 1 #设计规范 1 #框架 3 #SpringAI 7 #OAuth2 1 #自动化 1 #Nginx 1 #Spring6 2 #AOT 2 #主从延迟 1 #ServiceMesh 1 #Istio 1 #Spring4Shell 1 #事件驱动 3 #Sealed 1 #调优 2 #JUnit5 1 #集成测试 1 #认证 1 #SpringSecurity 2 #聚合 1 #Java15 1 #TextBlock 1 #Canal 1 #SpringBoot3 2 #高并发 2 #秒杀 1 #JDK17 1 #查询优化 1 #低延迟 1 #GraalVM 2 #原生镜像 1 #线程 1 #事件溯源 1 #查询 1 #治理 1 #GitOps 1 #CD 1 #R2DBC 1 #RocketMQ5 1 #火焰图 1 #性能分析 2 #发布 1 #自动化测试 1 #Redis7 1 #多级缓存 1 #设计模式 1 #实践 1 #ExactlyOnce 1 #字节码 1 #Agent 13 #Record 1 #虚拟线程 9 #ProjectLoom 1 #模式匹配 2 #Java17 3 #内存分析 1 #MAT 1 #Java9 1 #Log4j2 1 #Redisson 1 #Caffeine 1 #本地缓存 1 #新特性 10 #Redis6 1 #循环依赖 1 #堆外内存 1 #重平衡 1 #CPU 1 #压测 1 #响应式 3 #WebFlux 1 #Prometheus 1 #监控 1 #编译 1 #JIT 1 #事务消息 1 #延迟消息 1 #熔断降级 2 #Resilience4j 2 #JPMS 1 #模块化 2 #JDK11 1 #K8s 2 #工程结构 1 #SQL治理 1 #规范 2 #工具 1 #数据迁移 1 #SkyWalking 1 #可观测性 5 #DDL 1 #方法论 1 #集群 1 #ShardingSphere 2 #可靠性 1 #语法 2 #Java10 1 #ZGC 3 #安全 5 #Fastjson 1 #DDD 3 #原理 1 #Snowflake 1 #分布式ID 1 #实战 5 #故障复盘 3 #LongAdder 1 #一致性 1 #读写分离 1 #FullGC 1 #故障 6 #文档 1 #Swagger 1 #诊断 2 #Arthas 2 #大key 1 #性能优化 4 #热点key 1 #搜索引擎 1 #G1 1 #GC调优 1 #顺序消息 1 #方案对比 2 #SQL 1 #网关 1 #Gateway 1 #Kafka 8 #积压 1 #超时 1 #拆分 1 #SpringCloud 2 #JVM参数 1 #注册中心 2 #Nacos 2 #分布式事务 2 #Seata 1 #升级 5 #MySQL8 2 #Sentinel 2 #限流 2 #迁移 5 #环境搭建 1 #Docker 2 #部署 2 #Elasticsearch 7 #微服务 5 #OpenFeign 1 #优雅停机 1 #消息可靠性 1 #RocketMQ 3 #CI 3 #Jenkins 1 #CAS 1 #原子类 1 #并发Bug 1 #JDK 3 #选型 3 #收集器 1 #Dubbo 1 #Zookeeper 1 #异步 2 #CompletableFuture 2 #幂等 4 #并行 1 #并发工具 1 #BlockingQueue 1 #JUC 2 #单元测试 1 #JUnit 1 #类加载 1 #自动配置 1 #引用 1 #高可用 2 #死锁 3 #Logback 1 #JVM工具 1 #排查 7 #拒绝策略 1 #Optional 1 #MQ 6 #AQS 1 #CAP 1 #分布式 2 #事件 1 #持久化 1 #Lambda 1 #AOP 1 #Metaspace 1 #Java8 3 #分库分表 4 #Bean 3 #源码 3 #MVCC 1 #注解 1 #并发容器 1 #ConcurrentHashMap 1 #缓存一致性 2 #连接池 2 #Druid 1 #SQL优化 4 #explain 1 #依赖注入 1 #配置 3 #Spring 17 #Integer 1 #装箱 1 #分布式锁 3 #JVM 5 #OOM 5 #单例模式 1 #反射 2 #索引 2 #迭代器 1 #集合 2 #Tomcat 1 #内存 2 #equals 1 #HashMap 2 #Maven 2 #依赖冲突 1 #锁 2 #并发 2 #资源管理 1 #IO 1 #API 1 #REST 1 #ThreadLocal 1 #内存泄漏 4 #事务 3 #日志 3 #GC 11 #Redis 14 #Stream 2 #函数式 2 #枚举 1 #线程安全 1 #日期 2 #ThreadPool 1 #线程池 4 #重构 4 #架构 25 #Bug 2 #对象拷贝 1 #JMM 1 #volatile 2 #版本管理 1 #Git 1 #String 2 #性能 6 #参数绑定 1 #SpringMVC 1 #分页 3 #MySQL 14 #入门 2 #SpringBoot 11 #运维 2 #Linux 1 #缓存 6 #MyBatis 4 #批量插入 1 #金额 1 #BigDecimal 1 #PECS 1 #泛型 1 #性能调优 1 #随笔 1

多级缓存应对 AI 应用的高延迟

客服机器人上线两周,P95 首字延迟 4.2 秒 9 月初,我们给内部工单系统做的智能客服上了线。第三天开始收到投诉:"问一句话要等四五秒才出字"。我拉了 Grafana 看,数据比投诉描述的还难看: gateway_request_duration_seconds{quantile="0.95",

Administrator Administrator 发布于 2024-09-09

多模型路由与降级:不把鸡蛋放在一个篮子里

把命运交給一家供应商太冒险 工单助手全量依赖 OpenAI,某次它区域性抖动 40 分钟,我们的自动回复全挂,运营被迫人工顶上,积压了上千条工单。AI 能力已经是生产依赖,就不能有单点。我搭了一套多模型路由加降级,核心:多供应商接入、健康检查、自动降级兜底。上线后两次抖动都平稳度过。 多供应商统一接

Administrator Administrator 发布于 2024-02-22

从零搭建一套灰度发布体系

一次全量上线引发的事故 三个月前我们直接全量发了订单服务 v2,结果一个新分支的序列化逻辑和旧版不兼容,老客户端解不出字段,半小时 rollback 了,期间丢了几十笔订单的回调。复盘会上被喷得不轻。痛定思痛,我搭了一套灰度发布体系,核心四件事:流量染色、网关路由、数据兼容、回滚机制。这套跑顺之后,

Administrator Administrator 发布于 2023-10-12

可观测性建设:从日志到链路追踪的演进

背景:一次排查花了三个小时 六月一次线上下单失败,从接到告警到定位根因花了三个小时。不是问题复杂,是信息散——日志在 ELK、指标在 Prometheus、链路在 SkyWalking,三套系统各看各的,人肉拼不出完整画面。那周我推动了可观测性体系重构,把三大支柱真正串起来。 三大支柱:日志、指标、

Administrator Administrator 发布于 2023-06-18

RAG 检索增强生成的 Java 实现方案

给内部文档做个能问答的机器人 公司几百份技术文档散在 Wiki,搜起来费劲——关键词搜只能匹配字面,问"怎么处理订单超时"搜不到"订单 30 分钟未支付自动关单"的那段。我想用 RAG(检索增强生成)做个问答,让模型"先查资料再回答"。2023 年初这套链路在 Java 侧得自己拼,没有现成框架,正

Administrator Administrator 发布于 2023-03-15

系统容量评估与水位管理

一次没顶住的流量 去年大促,预估峰值 8000 QPS,实际来了 1.4 万,订单服务被打挂 12 分钟。复盘发现:我们的容量评估靠的是"去年×2"的拍脑袋,没有真实压测支撑,对系统的真实拐点一无所知。那天凌晨告警炸了,扩容来不及,限流没配,全靠手动重启扛,资损不小。这次我把容量评估正经做了一遍,把

Administrator Administrator 发布于 2023-02-17

Nginx 在 Java 架构中的常见用法与调优

我们为什么离不开 Nginx 后端是 Spring Boot 起的 8080 服务,但直接把 8080 暴露在公网既不安全也难扩展。一来没有 TLS 卸载,二来单实例挂了没容灾,三来限流得在每个应用里写。Nginx 在我们架构里身兼数职:反向代理、负载均衡、限流、长连接优化。它配一次能管一片服务,是

Administrator Administrator 发布于 2022-12-26

Elasticsearch 分片设计原则与容量规划

集群重启后要 40 分钟才能变绿,问题出在分片数 我们用 ES 做商品搜索和日志检索,版本从 7.15 升到 8.0(2022 年 2 月发布,正式用上)。3 月一次故障演练,重启集群后主分片恢复花了 40 分钟才变绿,期间搜索不可用。排查下来,根因是分片数设错了:一个 200 GB 的索引被切成

Administrator Administrator 发布于 2022-03-22

多级缓存架构设计:本地缓存 + Redis

大促压测:Redis 被打到 12 万 QPS,还是扛不住 3 月大促前做全链路压测,商品详情页的接口目标 5 万 QPS。单 Redis 集群(3 主 3 从,Redis 6.2)在 12 万 QPS 时 CPU 跑满,P99 从 3 ms 飙到 47 ms,再往上就开始超时。加节点成本太高,而且

Administrator Administrator 发布于 2022-03-15

DDD 落地第一步:贫血模型到领域模型的转变

一次资损:限领 1 张的券,用户领了 2 张 1 月初的一个上午,运营在群里 @ 我:一张"新客专享 50 元券",配置的是每人限领 1 张,有用户领到了 2 张,已经核销了一张。 我查了数据库: mysql> SELECT user_id, coupon_id, count(*) c FROM c

Administrator Administrator 发布于 2021-01-15