后端转全栈,测试第一关差点把我送走:AI生成的测试用例,50%个是废的
2026/8/14 19:42:33 网站建设 项目流程

38岁后端程序员,公司要求转全栈。前端后端都没问题,但测试这一环,我以为最简单,结果被AI坑得最惨。这篇记录我怎么从"AI测试看起来很美"到"自己写核心用例"的血泪过程。


公司说:以后你一个人扛全链路

事情是这样的。

我们团队在做架构调整,领导找我谈话:“以后咱们走全栈模式,一个人从需求到上线,做一个试点项目。?”

我想了想,现在AI这么强大,有AI辅助,Claude Code 自己就能从开发到测试一条龙了。

我太天真了。


第一步:让AI生成测试用例,看起来很美

我打开 Claude Code,丢给它一段业务代码:一个保单费用计算的接口,输入保单号、操作类型、操作时间,输出应缴费用。

指令很简单:“给这段代码生成完整的单元测试,要求覆盖所有分支,包含边界值测试。”

Claude 很积极,唰唰唰生成了100多个测试用例。我扫了一眼,惊了:

  • 参数校验:空值、null、特殊字符、超长字符串… 20多个case
  • 日期边界:月初、月末、闰年、跨月… 30多个case
  • 费用计算:正常费用、0元、负数、超大金额… 40多个case
  • 其他边界:并发、超时、异常类型… 10多个case

看起来全面到离谱,我当时还挺高兴。

直到我开始跑这些测试用例。


问题1:把一个case拆成十个,充数

我注意到一个奇怪的现象。

比如测试"保单费用计算"这个核心方法,AI生成了下面这些case:

  • test_calculate_with_policy_no_12345
  • test_calculate_with_policy_no_abcde
  • test_calculate_with_policy_no_empty_string
  • test_calculate_with_policy_no_null
  • test_calculate_with_policy_no_special_chars
  • …(还有更多)

30个case,测的全是"保单号参数格式",真正的核心逻辑——费用计算本身,只测了3个。

我手动数了一下:100个测试用例里,有60多个是在测各种参数校验(空值、格式、长度),20多个测日期格式,真正测"费用计算逻辑"的不到10个。

AI把"边界值覆盖"理解成了"每个参数的所有可能取值都要测一遍",结果就是大量重复、低价值的测试用例。


问题2:边界值测了,但核心逻辑没测透

AI生成的测试用例里,确实有一些边界值测试,比如:

  • 费用 = 0
  • 费用 = 负数(非法)
  • 费用 = 999999999(超大金额)

但有一个关键边界它没测:宽限期内的费用计算。

保险业务里,宽限期(Grace Period)是一个特殊状态:保单没按时缴费,但还在60天宽限期内,此时费用计算要按"正常费率"而不是"逾期费率"。AI完全不知道这个业务规则,它只测了"正常缴费"和"逾期缴费"两种状态,中间那个"宽限期"状态被跳过了。

这个边界值比"超大金额"重要100倍,但AI不知道,因为它不懂业务。


问题3:回归测试成了摆设

AI生成的测试用例里,有一大块是"回归测试":每次代码变更后,跑一遍全部测试用例,确保没破坏原有功能。

听起来很对,但问题是:测试用例没有分层。

100个用例里,核心逻辑只有10个,其他90个都是参数校验和边缘case。每次回归测试跑这100个用例,80%的时间花在验证"空值会不会报错"——这种测试跑一次就够了,不需要每次都回归。

AI没理解测试的分层原则:核心逻辑要回归,参数校验一次就够了。


我后来怎么做的?

被坑了两次之后,我换了个思路。不再让AI"生成完整测试用例",而是让它做"测试框架搭建+核心用例辅助",真正的测试设计自己来。

第一步:告诉AI业务规则,不是代码

我改了提问方式:

“我要测一个保单费用计算接口。业务规则是:正常缴费按A费率,宽限期按B费率,逾期按C费率。请帮我设计测试用例,重点是这三种状态的切换边界。”

给AI业务上下文,而不是只给代码。

第二步:限定测试用例数量,逼它聚焦

“请生成不超过10个测试用例,覆盖核心逻辑和关键边界。不要生成参数校验类的用例,那些我自己处理。”

限定数量,逼AI聚焦核心。

第三步:自己补充AI不知道的业务边界

AI生成的10个用例里,我手动加了3个:

  • 宽限期第1天的费率(刚进入宽限期)
  • 宽限期第60天的费率(宽限期最后一天)
  • 宽限期第61天的费率(刚过期,边界值)

AI不知道的业务规则,必须自己补。

第四步:测试用例分层

我把测试分成三层:

  • 核心层(10个用例):每次代码变更必跑,包括费用计算逻辑、状态切换
  • 边界层(5个用例):新功能上线时跑,包括宽限期、极端金额
  • 参数层(20个用例):只在新接口或参数结构变更时跑

回归测试只跑核心层,10个用例,5分钟跑完,而不是100个用例跑半小时。


写在最后

这件事给我的教训很深。

AI生成测试用例的能力很强,但它对"什么是重要的"没有判断力。它会把所有参数都当成同等重要,会把一个简单case拆成十个来充数,会漏掉业务里最核心的边界。

测试不是覆盖率的数字游戏,是业务理解的深度测试。

AI可以帮你写测试框架、生成基础用例、跑自动化,但真正关键的测试用例,必须是你自己设计的——因为你懂业务,AI不懂。

38岁转全栈,后端转前端我花了一周,但测试这一环,我花了一个月才摸到门道。不是因为测试技术难,是因为我花了太多时间相信AI能替代我的业务判断。

AI是工具,不是测试经理。关键用例,自己写。

这里给大家精心整理了一份全面的AI大模型学习资源包括:AI大模型全套学习路线图(从入门到实战)、精品AI大模型学习书籍手册、视频教程、实战学习、面试题等,资料免费分享

👇👇扫码免费领取全部内容👇👇

1. 成长路线图&学习规划

要学习一门新的技术,作为新手一定要先学习成长路线图方向不对,努力白费

这里,我们为新手和想要进一步提升的专业人士准备了一份详细的学习成长路线图和规划。可以说是最科学最系统的学习成长路线。

2. 大模型经典PDF书籍

书籍和学习文档资料是学习大模型过程中必不可少的,我们精选了一系列深入探讨大模型技术的书籍和学习文档,它们由领域内的顶尖专家撰写,内容全面、深入、详尽,为你学习大模型提供坚实的理论基础(书籍含电子版PDF)

3. 大模型视频教程

对于很多自学或者没有基础的同学来说,书籍这些纯文字类的学习教材会觉得比较晦涩难以理解,因此,我们提供了丰富的大模型视频教程,以动态、形象的方式展示技术概念,帮助你更快、更轻松地掌握核心知识

4. 2026行业报告

行业分析主要包括对不同行业的现状、趋势、问题、机会等进行系统地调研和评估,以了解哪些行业更适合引入大模型的技术和应用,以及在哪些方面可以发挥大模型的优势。

5. 大模型项目实战

学以致用,当你的理论知识积累到一定程度,就需要通过项目实战,在实际操作中检验和巩固你所学到的知识,同时为你找工作和职业发展打下坚实的基础。

6. 大模型面试题

面试不仅是技术的较量,更需要充分的准备。

在你已经掌握了大模型技术之后,就需要开始准备面试,我们将提供精心整理的大模型面试题库,涵盖当前面试中可能遇到的各种技术问题,让你在面试中游刃有余。

7. 资料领取:全套内容免费抱走,学 AI 不用再找第二份

不管你是 0 基础想入门 AI 大模型,还是有基础想冲刺大厂、了解行业趋势,这份资料都能满足你!
现在只需按照提示操作,就能免费领取:

👇👇扫码免费领取全部内容👇👇

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询