任务卡 · 崔雨悦(研 0)

角色:Prompt 工程辅助 + 任务调度脚本 直接导师:封永康(主)+ 李婉玉(侧) 核心定位:封永康设计 Prompt 框架,你做调试、测试集构建、失败案例采集


一、你的核心任务(投入后)

  1. 学会 Python + ROS Noetic + LLM API 基础(W3–W4 突击)
  2. 协助封永康做 Prompt 调试 + JSON Schema 验证
  3. 构建并维护测试指令集(≥ 100 条覆盖正常/模糊/异常)
  4. 任务调度脚本:把 LLM 输出对接 L5 状态机
  5. 失败案例采集 + Prompt 持续迭代

二、必学的基础(W3–W4 突击)

你 6/10 之后正式投入,所以前期 W1–W2 用来自学。

  • Python 基础:list / dict / class / requests / json
  • Linux + 命令行:cd / ls / vim / git
  • ROS Noetic 基础:topic / service / launch(跟封永康补课)
  • LLM API 入门:
    • 用站点 https://api.xsqs.app + Codex 或类似 CLI
    • 跑 Function Calling / Structured Output 的最小 demo
  • JSON Schema 基础

三、逐周时间线(5/24 起)

日期任务
W1–W25/24–6/06自学 Python + LLM API 基础;通读项目背景
W36/07–6/13正式入组(≥6/10);跟封永康学 ROS + LLM 调用
W46/14–6/20跑通 LLM Function Calling 的最小 demo
W56/21–6/27W4 末考核(迟开 1 周):能写一个把自然语言转 JSON 的脚本
W66/28–7/04阅读 LLM 任务分解 Paper(封永康挑 2–3 篇)
W77/05–7/11Prompt 调试入门:用封永康的第一版 Prompt 跑测试
W87/12–7/18测试指令集启动:构造 30 条正常指令
W97/19–7/25测试指令集扩充至 60 条(含模糊指令)
W107/26–8/01测试指令集 ≥ 100 条(含异常指令)
W118/02–8/08任务调度脚本:把 LLM 输出转 ROS service 调用
W128/09–8/15调度脚本接入 L5 状态机;失败重试逻辑
W138/16–8/22失败案例采集(自动记录所有失败的指令 + 输出)
W148/23–8/29Prompt 迭代第一轮:把高失败率指令优化
W158/30–9/05联调:与 NavRL/EgoPlanner 跑端到端
W169/06–9/12任务完成率统计
W179/13–9/19评估报告辅助
W189/20–9/26演示用例准备;文档冲刺
W199/27–10/01结项配合;测试指令集 + 失败案例库交付

四、你的关键里程碑

  • 📚 W4(6/20):LLM API + ROS 入门考核
  • 💬 W10(8/01):测试指令集 ≥ 100 条
  • 🔌 W12(8/15):任务调度脚本接入 L5 状态机
  • 🏁 W19(10/01):测试集 + 失败案例库交付

五、你的硬约束

  • 6/10 之前至少把 Python + LLM API 调用摸熟
  • LLM 调用走中转站,不要直接调外网;问封永康要 token
  • 测试指令集要真实:参考实际巡检需求,不要全是教科书例子
  • 失败案例要全部归档,不能”跑不出来就重试”——失败本身就是数据

六、产出标准

6.1 测试指令集

  • ≥ 100 条,分三类:
    • 正常:清晰、单意图(“飞到 A 点拍照”)
    • 模糊:缺信息或多义(“看看那边怎么样”)
    • 异常:超出能力 / 非法(“飞到月球”)
  • 每条都有期望输出 + 实际输出对比

6.2 失败案例库

  • 失败的指令、Prompt 版本、LLM 输出、错误原因
  • 按错误类型分类(schema 不合规、目标不可达、参数错误…)

6.3 调度脚本

  • LLM 输出 → ROS service 调用
  • 错误码处理 + 重试策略

七、求助渠道

  • 入门基础 → 封永康 / 田仁德
  • LLM 调用 → 封永康
  • ROS / 任务层 → 李婉玉 / 封永康
  • 站点 token → 封永康 / 贺林青

八、相关文档