暂无搜索历史
第一反应是赶紧看下 Nacos 集群状态,结果三个节点全都是正常,健康检查也正常。服务本身也没挂,功能照常能用,就是日志里隔三差五蹦出来这么一条。服务发现数据也...
晚上生产告警群里突然开始刷屏。网关 Pod 不断重启,有客户反馈操作页面时好时坏,K8s 事件里清一色的:
有天下午生产群里甩进来一张截图:生产环境 http://10.3.87.23:8080/api/auth/getuserlist 接口返回异常:413 Requ...
去年部门空降了一位新总监,阿里P8,第一次全员会PPT上就八个大字:拥抱变化,永不言弃。
用户反馈请求生产网关springcloud gateway突然偶发性返回500异常,赶紧上线检查服务,发现有个别实例日志里开始零星出现 OutOfDirectM...
昨天有个同事,甩了半页需求文档给 Claude Code,转身去接了杯热水的功夫,核心业务代码就写完了。 我凑过去扫了一眼,那段逻辑我前阵子刚做过类似的,前后调...
走管理还是走技术路线,其实一直都是程序员职业发展路上反复面对的选择——或主动,或被动。
这次的背景是生产环境 Nacos 集群 3 个节点,其中一个节点因底层硬件问题需要重启。按理说,集群架构天然支持节点故障转移,但重启后大量服务开始报不健康告警,...
起因是用opencode使用kimi-webbridge,于是本机按官网步骤安装kimi-webbridge,但官网原生不支持opencode连接kimi-we...
最近一直收到某个服务pod容器内存超过80%的告警,堆内存加上堆外内存目前看也只有1G左右,但pod内存却达到4G多,查来查去查到active_file对应的l...
最近一直收到某个服务pod容器内存超过80%的告警,堆内存加上堆外内存目前看也只有1G左右,但pod内存却达到4G多,查来查去查到active_file...
Kubernetes 调度 Pod 失败,报错信息明确指出:节点的临时存储资源不足。调度策略为重启时先增后减实例。
生产服务器告警:创建线程总数超过32000个故障。服务器的总线程数无法突破32000的问题在 “k8s的pod容器中微服务无法创建新线程unable to cr...
暂未填写公司和职称
暂未填写学校和专业