一条字节QA调整消息,戳中了测试行业最危险的盲区

简介: 字节“QA并进RD”引发热议,实则指向质量责任重构:非岗位消亡,而是打破部门墙,将质量责任精准分配至研发、测试开发、产品与项目负责人四类角色。核心在于建立可验证、可追溯、不依赖运气的交付体系。

这两天,关于“字节 QA 并进 RD”的讨论很热。

评论区里有两种很典型的声音。

一种是开发说:早该这样了,开发自己写单测、自己验收,少一层交接,效率更高。

另一种是测试说:QA 都并进研发了,是不是以后就没人要测试了?

这两个问题,其实都问偏了。

QA 和 RD 可以合到一个组织里,质量责任却不能合成一句“大家一起负责”。

因为软件项目里最危险的状态,从来不是“测试岗少了”,而是上线出了问题以后,所有人都能说一句:这个不是我该测的吗?

一次上线,最怕出现四个“我以为”
假设现在要发一个优惠券改版。

开发说:核心计算我写了单测,没问题。

前端说:页面我自己点过,没问题。

产品说:主流程我看了,没问题。

测试说:这个版本不是我负责的,我只帮忙看了一下。

结果上线后,老用户叠加券的场景算错了;客服补发的券没有走新规则;退款后优惠资格又被恢复了一次。

这时候你会发现,问题不是谁“不够努力”,而是没人把这几个问题串起来:

这次改动影响了哪些历史规则?
哪些入口、角色、状态组合必须跑?
单个接口对了,跨系统的数据还能不能对上?
风险已经知道了,谁有权决定“带风险上线”?
以前,很多团队把这些事默认丢给 QA。现在如果 QA 并进 RD,最先要补上的就不是岗位名称,而是这张质量责任表。

QA 并进 RD,不等于 RD 多接几个测试任务
很多人把融合理解成一句话:开发以后顺手把测试做了。

但开发自测,和质量保障,本来就不是一件事。

开发最擅长的是把功能构建出来:接口能通、页面能展示、代码逻辑能跑。他的测试天然会围绕“我刚写的东西”展开。

这没有问题,单测、接口测试、代码评审本来就应该是研发责任的一部分。

可用户不会按你的代码模块来使用产品。

用户会在弱网时连点三次;会拿半年前的账号叠加新活动;会从一个很少用的入口进入;会在支付成功但回调延迟时刷新页面;也会在十万行导出、权限切换、灰度回滚时,把系统推到平时没人走的位置。

这些问题,需要的不是“再点一遍页面”,而是一种专门盯着系统边界、历史包袱和异常路径的风险判断。

所以,融合以后更合理的分工不是“开发把 QA 吞掉”,而是:

角色
需要对什么负责
研发
代码可测试、单元测试、接口契约、基础安全与可观测性
测试开发/质量工程
风险分析、端到端验证、回归策略、测试环境与数据、质量门禁
产品/业务
验收标准、业务规则、异常场景的取舍
项目负责人
在已知风险下,是否发布以及准备什么兜底方案
岗位可以融合,这四类责任不能消失。

单测都过了,为什么还不能直接发?
因为“代码正确”和“业务可用”之间,至少还隔着三道墙。

第一堵墙:模块正确,不等于链路正确
订单服务、优惠券服务、库存服务各自的测试都过了,不代表用户下单一定正确。

真实事故经常发生在接口之间:字段含义没对齐、状态同步晚了一步、重试造成重复扣减、旧版本兼容规则没带上。

第二堵墙:正常输入正确,不等于异常时可控
开发写“用户点击提交”时,脑子里通常是一次点击、网络正常、数据干净。

而质量验证要故意问反面:重复提交怎么办?请求超时后用户重试怎么办?第三方回调晚到十分钟怎么办?权限刚被回收,缓存还没失效怎么办?

第三堵墙:功能正确,不等于发布可控
一个功能即使没有明显 Bug,也可能因为监控缺失、开关不可回退、灰度范围太大、数据库变更无法兼容而不该直接上线。

这就是为什么成熟团队会有质量门禁。

它不是“测试卡研发脖子”,而是把大家各自知道的一点风险,整理成一次能做决策的发布证据。

真正会被压缩的,是“只接单、不判断”的位置
说句实在的,测试行业确实会变。

只拿到需求、列一批固定场景、机械执行、把结果填进系统的工作,会越来越多被自动化和 AI 接手。这不只发生在测试,研发、前端、运营里同样在发生。

但另一类能力反而会更稀缺:

能从需求里提前看出系统性风险;
能把业务规则拆成可执行、可回归的测试设计;
能搭建接口自动化、数据准备、环境治理和持续回归;
能看懂监控、日志、链路,帮助团队从“发现问题”走到“定位问题”;
能在时间、资源都不够时,判断哪几道质量关绝对不能省。
这类人未必还叫“传统 QA”,也可能叫测试开发、质量工程师、质量负责人,甚至直接在研发团队里承担质量角色。

名字会变,价值不会变。

对测试工程师来说,现在最该补什么?
不是急着把简历上的 QA 改成 RD。

先把自己的工作,从“等别人给任务”往前推一步。

需求刚出来时,你能不能用业务规则、状态流转和边界条件把风险问出来?

开发开始实现时,你能不能理解接口、数据库、日志和部署链路,知道自动化该插在哪?

版本准备发布时,你能不能拿出一套有优先级的回归策略,而不是一句“全量测一遍”?

线上有问题时,你能不能把一次事故沉淀成下一次可复用的测试资产?

这就是测试开发真正的价值:不是替开发多点几下,而是让团队每次交付都比上一次更可验证、更可追溯、更不依赖运气。

字节 QA 并进 RD 的讨论,最后不该只落成一句“测试没了”或者“开发赢了”。

它真正提醒我们的,是以前靠部门墙兜住的质量责任,正在往每一个工程角色身上重新分配。

组织可以合并,工牌可以改名。

但总要有人在所有人都说“应该没问题”的时候,继续问一句:

证据呢?如果它在最差的情况下坏掉,我们准备怎么接?

相关文章
|
21小时前
|
人工智能 测试技术 UED
Google公开Agent Quality Flywheel:为什么改Prompt的模型不能同时当裁判?
本文揭示AI Agent质量优化的核心陷阱:若同一模型既优化Prompt又评分,易“讨好裁判”而非提升真实能力。Google强调“优化器与评测器必须解耦”,需冻结测试集、Rubric和基线版本,实施盲测与独立指标验证。真提升需经五重门禁检验——这才是可信质量飞轮的基石。
|
2天前
|
人工智能 安全 API
不用先学复杂平台:6个步骤把Agent的工具调用、轨迹和结果测清楚
本文揭示Agent测试的核心陷阱:答案正确≠行为可靠。AWS Agent-EvalKit提出Plan-Data-Trace-Run-Eval-Report六阶段评测法,强调通过完整执行轨迹验证工具调用、参数准确、数据忠实与推理连贯性,而非仅检验最终输出。适合测试团队快速落地实践。
|
2天前
|
安全 测试技术 网络安全
arxiv 把渗透测试拆成 pytest 能断言的子任务:Google 式记分法轮到防守方用了
本文提出将LLM渗透测试能力量化为可执行的pytest回归基线,首创“攻击链子任务记分法”(侦察、入口、提权等7项0/1/2分级),突破传统二元报告局限。通过每周自动化运行,使防守方提前数周感知能力增长趋势,实现从“事后响应”到“事前加固”的范式升级。
|
4天前
|
前端开发 JavaScript 测试技术
别再写一长串 XPath 了:给登录页写一条扛得住小改版的用例
本文直击应届生UI自动化痛点:用例脆弱易崩。以登录页为例,详解如何用Playwright写出“抗改版”的稳定用例——优先采用语义化定位(role/label),辅以testid兜底;封装自愈定位器实现智能降级;断言聚焦用户可感知的业务结果(URL、文案、状态)。地基打稳,方能长久维护。
|
6天前
|
人工智能 测试技术 API
Agent Skills 到底是什么?测试开发必须搞懂的下一代 AI 能力单元
本文探讨AI测试开发新范式:Prompt已失效,关键在于构建“Skill”——结构化、可复用、带错误处理的原子能力单元。它封装团队真实工作流,与MCP协同解决“能做”与“做对”问题,正成为测试开发核心竞争力。
|
6天前
|
人工智能 监控 测试技术
3个Skills解决SDK版本、代码生成和回归测试,初级测试也能照着做
本文探讨AI编程助手时代测试新挑战:模型可能引用过期文档生成“能跑但错误”的代码。借鉴Google为Gemini设计的Skill评测实践,提出可落地的工作流——通过样本集设计、四维断言(版本/接口/禁用项/可追溯性)、CI化回归测试及三个轻量级Skill切入点,将“知识新鲜度”转化为可量化、可监控的测试能力。
|
2天前
|
Linux API iOS开发
CC-Switch配置DeepSeek教程-2026最新Codex本地调用设置全流程(附下载安装步骤与配置检查清单)
CC-Switch 是一款跨平台的 AI 模型 API 渠道管理工具,作用是统一转发与代理各家大模型的接口请求,适配 Codex、Claude Code 等 AI 编程工具。它要解决的问题很具体:Codex 客户端默认支持的模型范围有限,想改用 DeepSeek,直接在客户端里改配置行不通,需要中间加一层转发。本文把 CC-Switch 接入 DeepSeek 并让 Codex 生效的完整过程拆成九项待办,每项都给出对应操作与自检标准,Windows、macOS、Linux 用户均可对照执行。
137 0
CC-Switch配置DeepSeek教程-2026最新Codex本地调用设置全流程(附下载安装步骤与配置检查清单)
|
2天前
|
人工智能 数据挖掘 Linux
千问办公官网入口:qwenwork.cn (一键直达)注册送2000积分,支持免费使用!
千问办公(QwenWork)是阿里云推出的AI智能办公平台,支持网页端免下载即用,也提供Windows/Mac/Linux客户端。新用户注册送2000积分,个人版免费可用,企业版198元/席/月起。阿里千问办公QwenWork官网:https://t.aliyun.com/U/0VCTGt 阿里AI工作平台,一句话完成数据分析、PPT 生成、视频剪辑、网页搭建等复杂任务
541 1
|
8天前
|
SQL 人工智能 安全
Agent Harness 又要多一层?Jev 开始接管这些高频判断
Jev作为新型System One Model,专司Agent中高频、明确的判断任务(如工具路由、技能筛选、上下文过滤、安全守门与执行复核),将LLM从繁重决策中解放,推动Agent架构向“规则+决策模型+LLM+工具”多层协同演进。
|
8天前
|
人工智能 自然语言处理 测试技术
Google 开源 ARTEMIS:AI Agent 如何接管 Android 真机测试?
Google开源的ARTEMIS是一款AI驱动的Android自动化测试框架,支持自然语言指令、跨App长流程操作、多模态控件识别(Accessibility+OCR+视觉模型),原生集成MCP协议,可无缝接入Antigravity等AI编程环境,实现“描述目标→自主规划→真机执行→结果分析”闭环,标志着移动端测试迈向AI Agent时代。

热门文章

最新文章