|
主题 |
内容 |
|
模块一:人工智能体系 |
| 人工智能测试开发的价值与体系 |
业务知识库
知识图谱
用例生成
用例执行
缺陷溯源 |
| 大语言模型与关键能力介绍 |
文本模型
多模态
排行榜
思考模式
预训练
微调 |
| 开源大模型本地部署 |
量化模型
模型接口 ollama
Lmstudio
vllm |
| 大模型原理与大模型控制参数 |
transformer
embedding
温度 top-p top-k
思考模式 |
| 大模型调试提示词调优 |
大模型网关
代理与反向代理
提示词请求重放 |
| 提示词工程 |
RAG
GraphRAG
思维链
ReAct
Agent Loop |
| 知识库体系 |
文档处理
知识图谱
向量存储
检索机制 |
| 智能体架构 |
智能体框架
上下文
Memory
Skill
Tool Calling
mcp协议 |
| 技能体系 |
技能原理
渐进式加载机制
工具调用
流程管理 |
| 工具体系 |
内置工具
文件操作
进程管理
计划管理 |
| 编码智能体 |
代码生成
vibe-coding
规范驱动开发SDD |
|
模块二:自动化智能体 |
| Web自动化智能体 |
Web
Agnet原理
网页上下文
技能 browser-use playwright mcp |
| App自动化智能体 |
App智能体原理
app上下文
技能 android ios appium
|
| 视觉识别自动化智能体 |
多模态大模型
视觉分析
自动化工具
多模态智能体 |
| GUI自动化智能体 |
GUI自动化原理
技能 windows mac gui自动化 |
| 接口自动化智能体 |
接口自动化智能体原理
接口上下文
技能 http rpc 多协议 |
| 智能体与工作流平台 |
工作流智能体原理
智能体 coze dify n8n |
|
模块三:智能化测试体系 |
| 业务测试用例生成智能体 |
业务分析
与功能点
测试场景、测试点与 测试用例
测试数据 |
| 自动化测试用例生成 |
web/app被测产品分析
自动化用例规范
自动化测试框架 |
| 单元测试用例生成 |
单元测试框架
代码分析
单元测试用例生成 |
| 接口测试用例生成 |
接口文档
接口测试工具
接口测试框架规范 |
| 智能探索测试 |
模型驱动测试
智能探索
自动遍历 知识图谱 |
| 自动化测试智能体 |
自动化测试框架
智能化测试框架
断言 与测试用例
测试报告 |
| 安全测试智能体 |
被测系统分析
安全测试工具
安全测试智能体开发 |
| 性能测试智能体 |
被测系统分析
性能测试用例生成
性能测试工具
安全测试智能体开发 |
| 缺陷溯源智能体 |
Bug跟踪到测试用例
Bug影响分析:代码,数据,接口 |
| 质量度量分析智能体 |
测试数据
统计
质量指标
AI综合分析 |
| 智能化测试平台 |
测试自动化框架
测试智能体
工作流 测试平台 |
|
模块四:大模型专项测试 |
| 大语言模型测评体系 |
评测数据集
评测指标
评测框架 TTFT TPOT ITL |
| RAG
相关系统测评 |
评测数据集
评测指标
精准率 ,召回率, 相关性
评测框架 |
| 智能体系统的测评 |
评测指标
评测数据集
成功率, 准确率 ,性能
测评框架 |
| AI系统安全测评 |
评测指标:
安全性 鲁棒性
毒性检测
评测数据集
评测框架 |