代码评分器（Code Grader）的主要作用是什么？	确保模型输出是纯粹的 Python、JSON 或正则表达式，且不包含任何解释。
用于验证代码语法的三个辅助函数分别是什么？	`validateJSON`、`validatePython` 和 `validateRegEx`。
代码评分器如何判断语法是否有效？	尝试解析（如JSON解析或AST解析）或编译输出；成功则得10分，失败则得0分。
为了让代码评分器知道期望的输出格式，需要在测试用例数据集中添加哪个键？	`format` 键。
在更新提示模板时，需要明确要求模型做什么？	仅以 Python、JSON 或纯正则表达式的形式回应，不添加任何评论或解释。
当我们不知道模型会输出哪种格式时，可以使用哪种技巧来预填充助手消息？	使用通用的“code”作为预填充助手消息。
最终的综合分数是如何计算的？	将模型评分（Model Score）和语法评分（Syntax Score）取平均值。
