Claude With Amazon Bedrock
← 所有课程
课程 10Claude With Amazon Bedrock

Controlling model output

摘要音频

本节课没有语音摘要。

学习笔记

LLM 输出控制技术学习笔记

本节讨论了除了修改提示词(Prompt)之外,影响大型语言模型(如 Claude)输出的两种核心技术:预填充助手消息和停止序列。

1. 预填充助手消息 (Pre-filling Assistant Messages)

  • 定义: 在向模型发送用户提示(User Prompt)之前,手动在消息列表中添加一个“助手消息”(Assistant Message)。
  • 作用: 强力引导模型,使其在回答问题时采纳预设的立场或前提。
  • 工作原理: 模型会将预填充的助手消息视为已完成的、已撰写的文本,并从该文本的末尾继续生成后续内容。
  • 注意事项:
  • 预填充通常会产生一个部分响应
  • 在实际使用中,用户需要手动将预填充的文本与模型生成的后续文本进行拼接(Stitching)。
  • 通过改变预填充的内容(例如,支持咖啡 vs. 支持茶),可以显著改变模型的倾向性。

2. 停止序列 (Stop Sequences)

  • 定义: 在模型生成参数中提供一个或多个特定的字符串(停止序列)。
  • 作用: 强制模型在生成任何匹配该序列的字符串时,立即停止输出。
  • 实现方式: 作为 API 调用中的可选参数(如 stop_sequences)传入。
  • 工作机制:
  • 模型一旦生成停止序列,将立即终止生成并返回已生成的内容。
  • 停止序列本身不会包含在最终的输出结果中。
  • 灵活性: 停止序列可以是单个字符,也可以是完整的单词或短语。
  • 应用场景: 用于截断(Truncate)响应或控制模型生成内容的边界。

Takeaways

  • 预填充助手消息:在用户提示前手动添加助手消息,可强力引导模型采纳预设立场,但通常需要手动将预填充文本与模型生成的后续内容进行拼接。
  • 预填充作用:模型会将预填充的文本视为已完成内容,并从该文本末尾继续生成,从而改变模型的倾向性。
  • 停止序列:在模型生成参数中提供特定字符串,强制模型在生成匹配该序列时立即停止输出。
  • 停止序列机制:停止序列作为API参数传入,一旦触发,模型将终止生成,且停止序列本身不会包含在最终的输出结果中。
抽认卡 8 张卡片
问题
点击显示 · ←/→
答案
点击翻回
导出到 Anki (.tsv) ↓
知识检测 0 题

No quiz for this lesson yet.