为什么不应直接从客户端（如Web或移动应用）访问 Vertex？	因为客户端需要包含秘密凭证，这存在严重的安全风险。
在构建聊天应用时，与 Vertex 交互的最佳架构是什么？	必须通过开发者自己实现的服务器（后端）来发起请求。
向 Vertex 发送请求时，必须包含哪些关键数据？	模型名称、消息列表（包含用户提交的文本）和最大令牌值（max tokens）。
什么是“Token”？	用户输入被分解成的较小的文本单元，可以是整个词、词的一部分、空格或符号。
“Embedding”是什么？	一个长数字列表，代表给定词的数字定义。
在文本生成过程中，用于将每个 Embedding 精炼为单一精确定义的流程叫什么？	上下文化（Contextualization）。
在生成阶段，模型是如何选择下一个词的？	它使用概率和随机性的组合来选择词，以创造更自然和多样的响应。
模型决定停止生成文本的两种方式是什么？	达到预设的最大令牌数（max tokens），或生成特殊的“序列结束标记”（end of sequence token）。
模型生成文本后，API响应中包含哪些关键信息？	生成的文本、使用量（Usage）和停止原因（Stop Reason）。
