测试技术

首页 标签 测试技术
# 测试技术 #
关注
76908内容
|
1天前
|
DeepSeek Harness保姆级实战:Cordis内核解析、环境部署、Python SDK接入与落地建议
DeepSeek Harness,简称DSH,是开源的Agent运行框架,目前处于开发者预览版本。该框架核心设计思路是打通大模型推理能力和本地执行环境,大模型负责理解用户任务、完成逻辑推演,Harness运行时则赋予智能体操作本地文件、调用终端命令、加载各类工具、自动拆解复杂长任务持续迭代执行的能力。整个项目依托Cordis插件架构进行构建,模型适配器、工具集、会话管理、沙箱隔离、持久化存储、Agent主任务循环全部以插件形态实现。开发者不需要改动底层源码,仅仅修改配置文件,就能够完成模块替换、能力扩展,拥有极高的二次开发自由度。
DeepSeek Harness火了,但你知道怎么用它生成测试用例吗?
DeepSeek Harness是开源AI测试助手,一行命令即可启动。它能自动解析API文档,10分钟生成50+覆盖等价类、边界值与异常场景的测试用例,准确率高但需人工复核8条左右。专为测试工程师设计,大幅提升用例设计效率,降低重复劳动。
为什么很多资深工程师,做管理后却带不动研发团队
想要毁掉一个研发团队,只需要几个昏招。但要想管好一支研发团队,就得先管人、再理事。
拆字节开源的 Midscene.js:GUI Agent 做 UI 测试,为什么可以不写选择器
字节开源的Midscene.js是跨端GUI Agent测试框架,以视觉理解替代传统选择器,AndroidWorld基准Pass@1达93.10%。它用自然语言描述操作意图,自动定位图标、Canvas等难选元素,大幅降低UI重构维护成本,但需权衡模型调用开销与判定不确定性。
AI 编程工具进测试场景实测横评:Copilot / Cursor / Claude Code 各擅长哪一段
本文不比“谁最强”,而是按测试真实环节(写骨架、补断言、读仓库、造数据、修flaky)横向测评GitHub Copilot、Cursor、Claude Code。三者能力几乎无重叠:Copilot胜在IDE内联补全与mock生成;Cursor强于全库索引与跨文件理解;Claude Code专精运行闭环,擅修flaky。工具选型应“按段派活”,而非追求全能。
开源研发管理工具,适合哪些团队
开源研发管理工具适合哪些团队?本文从成本、授权、适配条件等角度分析,适合能自行部署维护、流程成熟、要求数据自控的团队,并列出不建议使用的情况。
|
1天前
|
银行卡二三四要素实名认证接口:接入流程、参数设计与工程实践
本文面向开发者,系统介绍银行卡二要素、三要素、四要素实名认证接口的能力说明、五步接入流程、多语言调用示例与返回结构解析,并覆盖调用规范、工程实践(前置校验、重试与熔断、结果缓存、监控告警)及错误码排查指南,适用于在线支付、金融开户、电商绑卡、风控合规等场景。
|
1天前
| |
大模型评测 Benchmark:关键指标与选型方法
大模型评测 Benchmark 是用数据集和评测维度量化模型能力的方法。本文梳理推理结果打分、吞吐量、延迟与 token 级指标,帮助研发和业务团队完成模型对比与选型。
|
1天前
| |
企业大模型选型实战教程:从任务目标到调优部署与知识库应用
企业大模型选型是围绕任务目标匹配合适 LLM 的过程。说明 LLM 定义、Transformer 基础、模型选择、调优与部署机制。帮助企业在知识库智能问答等场景形成可执行路径。
|
1天前
|
阿里云国际站服务商:云服务器ECS试用怎么评估?正式采购前需要验证哪些问题
阿里云国际站云服务器ECS试用,应该帮助企业回答三个实际问题:现有程序能否正常运行,业务高峰时配置是否够用,以及正式上线后的费用能否接受。能够登录云服务器、打开一个测试页面,只完成了基础检查,还不足以决定长期采购。
免费试用