摘要音频
本节课没有语音摘要。
学习笔记
Claude API 请求生命周期核心概念
🌐 架构与安全原则 (Architecture and Security)
- 请求流程: 客户端 (Web/移动应用) → 开发者服务器 → Vertex/Claude 模型。
- 安全要求: 绝不能从客户端直接访问 Vertex。所有请求必须通过开发者自己实现和控制的服务器进行,以保护秘密凭证 (secret credentials)。
⚙️ API 请求参数 (Request Parameters)
当服务器向 Vertex 发起请求时,必须包含以下关键数据:
- 模型名称 (Model Name): 指定要运行的语言模型。
- 消息列表 (List of Messages): 包含用户提交的文本。
- 最大令牌数 (Max Tokens): 限制模型生成的文本长度。
🧠 文本生成过程 (Text Generation Process)
模型内部的文本生成过程可简化为四个阶段:
- 分词 (Tokenization): 用户输入被分解成更小的字符串,这些单元称为“令牌 (Token)”。Token 可以是完整的词、词的一部分、空格或符号。
- 嵌入 (Embedding): 每个 Token 被转换为一个“嵌入 (Embedding)”,即一个长数字列表,代表该词的数字定义。
- 语境化 (Contextualization): 通过调整每个 Embedding,使其基于周围 Token 的 Embedding 进行修正。此过程用于消除歧义,将词汇的定义精确到句子中的特定含义。
- 生成 (Generation): 经过语境化处理的 Embedding 被传递给输出层,该层为下一个可能的词生成概率。模型结合概率和随机性来选择词,以确保回复自然且多样化。
🛑 停止条件 (Stopping Criteria)
模型在生成文本时会持续检查以下条件,以决定是否停止:
- 达到最大令牌数: 生成的 Token 数量 ≥ 预设的 max tokens 参数。
- 结束序列令牌 (End of Sequence Token): 模型生成一个特殊的信号,表示它认为自然地完成了文本生成。
📤 API 响应 (API Response)
当生成完成,API 会向服务器返回响应,其中包含:
- 消息 (Message): 包含生成的文本。
- 使用量 (Usage): 统计输入 Token 和生成 Token 的数量。
- 停止原因 (Stop Reason): 告知模型停止生成的原因(例如,是否达到自然结束或是否超出了令牌限制)。
Takeaways
- 安全架构: 必须通过开发者服务器访问模型,绝不能从客户端直接访问 Vertex,以保护秘密凭证。
- 请求参数: API请求必须包含模型名称、消息列表和最大令牌数。
- 生成流程: 文本生成过程依次为分词 → 嵌入 → 语境化 → 生成。
- 停止条件: 模型停止生成取决于达到最大令牌数或生成结束序列令牌。
抽认卡 9 张卡片
问题
点击显示 · ←/→
答案
点击翻回
知识检测 0 题
No quiz for this lesson yet.