← 返回课程

作业实战指导

把评分标准摊开给你看——逆向自往年「好/中/差」真实作业。清楚知道好档和差档到底差在哪,提交前先自查。配套「作业 AI 评审」用:看攻略 → 做 → 提交评审 → 按反馈改。

个人 · 基础 60% + 提高 40%

怎么评分的

基础功能覆盖与可用性35%

ASR/LLM/拍照(cv2.VideoCapture)/OCR+TTS 四项是否齐备且演示中真实可用;代码有但演示未跑通按半分/零分

四项全实现且演示可证工作;LLM 是真对话端点(文心/ERNIE/qianfan/deepseek)能对语音生成开放式回复
基础大体齐备但有一项硬伤或缺失——最常见是 LLM 整块缺席(退化成命令识别器),或功能被人为削弱
核心能力缺失且无法自证工作:LLM 完全没有 / token 占位符鉴权必失败 / OCR 主链路带功能性 bug / 模板残留报错
提高功能覆盖与质量25%

自建token/while循环/完整全文播报/退出指令 四项;③全文播报的实现质量是最锋利的好中判别点

四项齐备且③真做全文播报——列表推导遍历 words_result 全部行再 join;三套百度 token+LLM access_token 全自建
四项大体落地但③有硬伤(如 [:100] 截断/只读 result[0]) 或①token 自建存疑
提高项代码形态在但整体不可用(被占位符token/OCR bug架空),或部分缺失
端到端演示可验证性20%需视觉证据

录屏能否逐帧证明一次完整闭环成功: ASR→说拍照→拍照→OCR真识别实体文字→TTS朗读→循环回监听

可抽帧确认端到端真跑通(控制台连续可读真实中文OCR结果并进入TTS,循环可见回归监听)
代码看似完整但演示卡壳/只跑一半/证据薄弱(只见IDE+终端无摄像头OCR成功画面)
无一次成功端到端演示,甚至自证跑不通(ASR乱码/关键分支从未命中/OCR空识别)
代码工程质量与鲁棒性15%

模块化分层、异常处理覆盖、资源释放、鲁棒性打磨(噪声校准/超时/临时文件清理/多重回退)

产品级结构: 多个单一职责函数+docstring+adjust_for_ambient_noise+逐函数try/except+try/finally释放cap
函数化、有基本异常兜底但打磨不足(如摄像头/OCR双重回退但非产品级)
单函数流水账/无异常一崩就停/不释放资源/照搬模板残缺不可运行
交付完整度与工程/AI协作记录5%

除代码+录屏外是否附说明文档/README/架构图/量化测试/AI协作记录(不强制,顶格加分项)

附独立说明/架构图/AI协作记录/量化测试
交付单薄,仅 .py+视频,零文档
无视频+无文档、基本照搬模板

别想蒙混——这些会被识破

  • 代码贴满功能但演示不跑→功能分以D3可验证演示为闸门,代码有但演示未触发按半分/零分
  • 假全文播报(看似遍历实则result[0]/截断)→auto抓join覆盖+[:N]切片+LLM核对朗读时长
  • 占位符/借用token伪装自建→正则抓占位符+要求三套服务+LLM均百度智能云自申请+演示LLM真答话
  • 视频剪辑/补音造假闭环→LLM判音画同步+日志时间连续性+Listening循环可见回归
  • 迟交改文件名/时间→以服务器提交时间为准,不信任文件内时间戳
  • 模板残留掩饰→grep模板标记+未定义变量静态检查

提交前自查清单

  • 基础功能覆盖与可用性四项全实现且演示可证工作;LLM 是真对话端点(文心/ERNIE/qianfan/deepseek)能对语音生成开放式回复
  • 提高功能覆盖与质量四项齐备且③真做全文播报——列表推导遍历 words_result 全部行再 join;三套百度 token+LLM access_token 全自建
  • 端到端演示可验证性可抽帧确认端到端真跑通(控制台连续可读真实中文OCR结果并进入TTS,循环可见回归监听)
  • 代码工程质量与鲁棒性产品级结构: 多个单一职责函数+docstring+adjust_for_ambient_noise+逐函数try/except+try/finally释放cap
  • 交付完整度与工程/AI协作记录附独立说明/架构图/AI协作记录/量化测试

评分标准逆向自往年真实档位,档位/阈值为参考,最终成绩由老师确定。

做好了? 去提交 AI 评审 →