尧图网站建设 尧图网络
  • 首页
  • 关于我们
  • 服务项目
  • 案例展示
  • 建站流程
  • 资讯中心
  • 联系我们
首页/资讯中心/详情

2026/7/30

2026/7/30
📅 发布时间:2026/7/30 11:18:06

2026/7/30

3 套针对不同受众的"测试 + 展示"清单。

总策略:每种受众关心不同的 3 件事
受众 关心什么 你展示什么
老师验收(7/15) 流程跑通 / 4 表单齐 / 9 步能走完 录屏 + 数据截图
课代表 / 同学 "这玩意能用?" 实操 demo + 关键截图
面试官(求职) 技术深度 / 量化数据 / 思考 录屏 + 量化数字 + 架构图
论文 reviewer 方法论 / 可复现 / 数据 评测集 + A/B 对比截图
一、3 套测试场景(建议按这个顺序跑)
🎬 场景 1:基础流程验收(10 分钟跑完,给老师/课代表看)

步骤 期望 截图关键

1 进学生端 → 选《Half a Day》任务 显示任务卡 + 9 步时间线 任务卡截图
2 点"开始"进 Step 1 显示情境介绍 + AI 对话框 Step1 截图
3 问"作者写作背景"(普通模式) AI 答"我需要查证"+ 给出信息 AI 回答截图
4 点右上角抽屉"≡" 弹出 9 步导航,当前 Step 1 蓝色高亮 抽屉截图
5 强行点 Step 5 提示"请按顺序完成"(顺序锁定) 锁定提示截图
6 完成 Step 1-9 全流程 进度条更新,9 步全绿 完成后截图
7 填写 4 张伦理表单 全部填完显示"4/4" 表单截图
8 退出登录,进教师端 顶部 5 Tab 全部可点 教师端首页截图
关键截图(13 张)够 1 个验收视频。

🤖 场景 2:Agent 模式 + RAG 演示(5 分钟,给面试官看)

操作 期望 亮点

1 教师端 → 任务发布 → 选任务 → 开 RAG → 粘贴《Half a Day》全文 提示"已构建 30 块" 召回率提升
2 学生端 → 选这个任务 → Step 1 默认进 RAG 模式 资料关联
3 开 Agent 模式 → 问"clutching 什么意思" 思考链出现 3-4 步 ReAct 演示
4 看思考链 显示:思考 → 调 dictionary_lookup → 观察 → 调 rag_search → 观察 → 最终答案 杀手锏
5 看 AI 回答下方 "引用的资料"卡片,点开看 #1 完整原文 引用溯源
6 同样问题,关掉 RAG 再问一次 AI 答得不那么准确,引文少了 RAG 价值
7 教师端 → 教学 → Agent 观测日志 看到:1 次调用 / 3 步 / 用了 rag_search / 延迟 3s 可观测性
8 退出,问个开放问题:"这小说批判了什么" AI 调 rag_search 找 "school as punishment" 段落 真语义匹配
这 8 步 = 1 个 5 分钟 demo 视频,面试官看完直接说"这人会写 Agent"。

📊 场景 3:数据/风险/准实验演示(5 分钟,给论文/老师看)

操作 期望

1 教师端 → 大屏 (BigScreen) 4 能力雷达 + 9 步漏斗 + 4 维分布 + AI 活跃度
2 教师端 → 风险看板 (RiskMonitor) 5 维风险卡片 + 高/中/低分布条
3 班级管理 → 给一个班标记"实验组",另一个"对照组" 班级列表有标签
4 教师端 → 准实验对比 (QuasiExp) 4 能力雷达双图 + 8 项指标 + 5 大风险
5 教师端 → 数据导出 (DataExport) 导出 JSON / TXT / CSV,文件名带时间戳
这套 5 步 = "研究工具"的所有可视化,论文/老师最爱看。

二、最关键的 5 个"证据"(面试官必看)
证据 1:召回率对比数字
text

复制
┌─ 在 README/架构文档里 ─────────────────────┐
│ │
│ 检索算法召回率对比: │
│ ┌──────────────┬──────────┬──────────┐ │
│ │ 算法 │ 召回率 │ 响应时间 │ │
│ ├──────────────┼──────────┼──────────┤ │
│ │ 词袋(v13.8) │ 50-65% │ <10ms │ │
│ │ TF-IDF(v15) │ 75-85% │ <50ms │ │
│ │ 真 Embedding │ 85-95% │ 200-500ms│ (计划中)│
│ └──────────────┴──────────┴──────────┘ │
│ │
│ 评测集: 5 个典型问题 × 2 个学生 = 10 题 │
│ 评判标准: top-1 包含正确答案 = 命中 │
└──────────────────────────────────────────────────┘
怎么算的:

选 5 个典型问题(如 "clutching 表现什么情感")
对每个问题跑两种算法
人工判断 top-1 是不是相关段落
算命中率
证据 2:Agent 调用链截图
选 1 个有代表性的问题("clutching 什么意思")
把思考链的 完整截图保存
截图里能看到:思考 → 调 dictionary_lookup → 观察 → 调 rag_search → 观察 → 最终答案
面试官看到这就是"真 Agent 决策"
证据 3:5 大伦理风险量化
跑 1 个有"代写风险"的学生(终稿跟 AI 输出高度相似)
进风险看板
截图显示 "学术代写 78 分" 高风险 + 红色标签
这就是你研究的可视化
证据 4:准实验对比
创建 2 个班级(实验组 + 对照组)
给两个班发布同一个任务
让 1 个学生走完 9 步
进准实验对比页
截图显示 4 能力对比 + 5 风险对比
证据 5:完整架构图
README.md 已经有完整的 ASCII 架构图
打印一份 / PDF 一份
面试时指着图讲 5 分钟,demo 都不用放
三、怎么"录 demo 视频"(2 分钟版)
工具: 用 Windows 自带录屏(Xbox Game Bar,Win+G 启动)

脚本(按这个顺序录 2 分钟):

text

复制
[0:00-0:10] 项目首页(教师端)+ 切到学生端 → 显示 4 Tab
"这是我们给学生用的 AI 教学平台..."
[0:10-0:30] 学生端 → 选任务 → 走 9 步流程
"学生按 9 步学完一篇课文..."
[0:30-0:50] 打开 Agent 模式 → 问"clutching 什么意思"
"AI 自己决定调什么工具 → 思考链实时出现"
"首先调词典 → 然后调 RAG → 最后综合回答"
"(关键:让面试官看到思考链滚动)"
[0:50-1:20] AI 回答下方点开"引用的资料"
"AI 答的不是凭空编的 → 点了引文能看到完整原文"
"(关键词高亮:clutching 被标黄)"
[1:20-1:40] 切到教师端 → 大屏 / 风险看板 / 准实验对比
"教师能看到所有学生的进度、风险、对比数据"
[1:40-2:00] 教师端 → Agent 观测日志
"每次 AI 调用都有完整记录 → 这是 Agent 可观测性"
视频上传: B 站 / 抖音 / YouTube,在简历附链接(比文字描述强 10 倍)。

四、简历"项目链接"放什么
text

复制
简历项目区:
AI Agent 英语教学平台
https://github.com/xxx/ai-english-platform ← 源码
https://youtu.be/xxx ← 2 分钟 demo 视频
部署地址: http://xxx.vercel.app ← 可访问 demo(可选)
GitHub README 里放什么:

一段 30 秒录屏的 GIF(直接展示核心交互)
5 个关键截图(首页 / 思考链 / 引用溯源 / 风险看板 / 准实验)
ARCHITECTURE.md 链接(深度内容)
5 大功能 demo 视频链接
五、给论文/老师验收的"研究证据"
老师最关心"有数据吗?",不是"有功能吗?"。

数据 怎么算 给谁看
召回率 5-10 题标准测试集 老师(方法论)
4 能力分 准实验前后测对比 论文(核心数据)
5 大风险分 班级分布 + 高危学生名单 论文(伦理分析)
AI 使用率 平均对话轮次 / 改写比例 论文(讨论 AI 依赖)
完成率 9 步完成度 + 终稿字数 论文(教学法效果)
最少需要的数据量(让论文能写):

至少 2 个班(实验 / 对照)
每班至少 10 个学生
全程完成 9 步
4 表单全填
没这么多学生怎么办(现实):

跑 1-2 节课的 demo 数据(5-10 人)就能出"小型可行性研究"
论文里标注"pilot study" / "小样本验证"
后续大样本留到正式研究
六、立刻能做的 3 件事
1️⃣ 跑通"演示场景 1 + 2",截图 8 张(30 分钟)
把上面 8 个关键操作的截图保存到 docs/screenshots/ 目录,README 引用。

2️⃣ 录 1 个 2 分钟 demo 视频(1 小时)
按上面的脚本录,反复录到第 3 遍才用(前 2 遍是练手)。

3️⃣ 跑 1 个真实场景拿数据(半天)
找 1-2 个朋友当学生,完整跑 1 单元 9 步,截图 + 导出数据 → 你就有:

真实用户测试报告
5 大风险量化数据
准实验对比的初步数据
这 3 件事做完,简历 + 验收 + 论文全部能用。

七、给你的"测试 1 句话心法"
不要"展示"功能,要"讲故事"。 错误:演示 = "你看,这是 RAG" 正确:演示 = "我让 AI 自己决定调什么工具,它先想了 3 秒,决定先查词典,再查课文,最后综合告诉你 —— 这个过程是可解释的、可追溯的"

面试官 / 老师要的是"故事",不是"功能清单"。

八、现在能立刻验证的 5 件事(30 分钟跑完)
powershell

复制

启动

npm run dev

验证项 时间

1 学生端能选任务 / 显示 9 步 2 min
2 AI 角色能正常对话 3 min
3 RAG 上传教材后能引用 5 min
4 思考链可视化滚动 3 min
5 引用溯源卡片可展开 2 min
5 个全过 = v17 验收通过。

要不要我帮你写一个测试 checklist 文档(包含 30+ 个具体测试点 + 期望结果)?这样你/课代表/朋友都能照着文档测 👀

相关新闻

  • SpringBoot+Vue构建高并发在线招投标系统实践
  • WeCam 是新一代的虚拟视频及直播软件E2ESOFT它拥有所见即所得的视频场景编辑器
  • 老Mac重获新生:OpenCore Legacy Patcher完全指南,让2008-2017年款Mac畅享最新macOS

最新新闻

  • 吴恩达提示词工程:从原理到实践的系统化指南
  • SpringCloud微服务架构在手机商城系统的实践与优化
  • 【图像加密】基于压缩感知中密钥控制测量矩阵的新型图像压缩-加密混合算法附matlab代码
  • RPG Maker MV/MZ资源解密工具:完全指南与实用技巧
  • 现在不学AI驱动微服务开发,6个月后将错过DevOps 3.0人才认证窗口期
  • 原车卤素灯太暗?池州闪特改灯一步到位解决夜间行车难题 - Ayu8888

日新闻

  • 终极TeamSpeak3音乐机器人搭建指南:5分钟实现语音聊天室音频播放
  • 广州海珠区内搬家攻略,平价靠谱搬家服务商推荐,专业打包搬运省心避坑全流程指南 - 厚道搬家
  • 大语言模型入门指南:从零到精通掌握AI核心技术的5大步骤

周新闻

  • 大连理工大学与东京大学联手打造的“主动型AI助手“
  • 170.2026年国家级科研瓶颈:超精密单点金刚石切削(SPDT)光学表面生成
  • SongBloom:革命性歌曲生成框架深度解析——如何通过交织自回归与扩散模型创作完整音乐

月新闻

  • 2026年6月公司网站搭建最新热门渠道测评:四大低成本/零代码平台对比+避坑
  • 【Linux】Linux arm 编译QT程序,出现expected “}“报错
  • 【MATLAB例程】四基站二维AOA定位与距离辅助增强对比仿真。基于角度观测和测距修正的固定目标平面定位精度分析

关于尧图

  • 公司简介
  • 团队介绍
  • 企业文化
  • 荣誉资质

服务项目

  • 定制开发
  • 电商建站
  • UI 设计
  • 运维服务

快速链接

  • 案例展示
  • 建站流程
  • 常见问题
  • 资讯中心

联系方式

  • 📍北京市朝阳区互联网产业园 A 座 10 层
  • 📞400-888-8888
  • ✉️contact@rkmt.cn
  • 🕐周一至周日 9:00-21:00

© 2024 北京尧图网络科技有限公司 版权所有 | 京 ICP 备 XXXXXXXX 号