想着查查怎么个事,打开任务管理器一眼就看到了wslg这个显眼的关键词,突然就记起前一阵子为了测试一个软件,在 wsl 中折腾了一番 x11,虽然最后并没有成功,...
前言 很多人把 CI/CD 当成一个词来用,但实际上它是三个递进的层次。理解这三个层次的边界,决定了你团队自动化的成熟度。本篇用三个实际的流水线配置,让你直观感...
前言 如果你经历过这样的场景——开发人员写完代码,用 FTP 把文件传到服务器上,手动重启应用,然后在浏览器里刷新看看有没有跑起来——你就会理解 CI/CD 出...
提交后,点击测试按钮或者展开按钮,进行测试,出现测试成功的提示,代表成功的把模型接入进来啦:
前面测试的大多数都是识别中文,为了排除“中文特攻”的可能性,这次测试一张包含日文和英文的混合手写体便签。
OpenCode 本质是一类面向开发者的 AI 编程执行工具,核心能力不是“补全代码”,而是接管一段开发流程并执行。可以把它理解为:
需求足够明确,AI 可以生成代码;接口和输入输出清楚,AI 可以完成对接;验收标准明确,AI 可以补测试、运行测试,再根据错误继续修改。程序员过去在流水线上承担...
腾讯 | 高级前端工程师 (已认证)
前几天,我把一个更便宜的模型接进多 Agent 工作流。原计划是让它先执行,遇到难题再交给 Codex。
某天群里弹出一条消息:"用AI生成了200条用例,五分钟搞定,效率拉满!"底下一片点赞。可等评审会上把这200条用例铺开看,会发现一个尴尬的事实:边界值用的还是...
代码生成能力提高以后,测试需求会同步增加。可很多企业仍然依赖共享测试环境、手工回归、固定测试窗口和少数测试人员。
给视频第一帧的目标掩码,后面所有帧都不再给标注。一套冻结视觉模型能把目标跟到最后吗? 这次没有接入专门训练的视频分割网络,也没有根据验证集标签调阈值。我们把 ...
最近踩了个公众号限流的小坑,之前连续更新大量Claude系列同质化内容,被平台悄悄限流关进“小黑屋”。
在持续交付节奏日益加快的今天,回归测试正从‘质量守门员’演变为‘交付加速器’。然而,传统回归测试面临三大顽疾:用例冗余率超65%(2023年Applitools...
2024年,RAG(Retrieval-Augmented Generation)已从技术概念跃升为金融、医疗、政务等高可信场景的标配架构。但随之而来的,是一场...
随着大模型应用从通用对话走向垂直落地,RAG(Retrieval-Augmented Generation)已成为构建可信AI应用的核心范式。然而,一个鲜被讨论...
这套库有 41 个 skill,重点是把 Agent 拉回真实工程:先对齐,再规格化,再拆票,再实现,再测试和评审。
GSK(中国) | 全栈架构师 (已认证)
一个 AI Agent 在原地无限转圈,另一个 AI Agent 你不敲键盘它就永远不动——它们俩其实是同一个病因。
看出关键区别没?CLAUDE.md 是「你想让它怎么干」,自动记忆是「它自己摸索出来的怎么干」。 你纠正它「这个项目跑测试得先起本地 Redis」,它下次就记得...