Waarom mag een client-side applicatie nooit direct toegang krijgen tot Vertex?	Omdat het vereist is dat geheime credentials (secret credentials) worden gebruikt, die veilig op een server moeten blijven.
Welke drie essentiële stukken data moeten bij een request naar Vertex worden doorgegeven?	De naam van het model, een lijst met berichten (messages), en een `max tokens` waarde.
Wat is een 'token' in de context van taalmodellen?	Een kleine string van tekst, zoals een heel woord, een deel van een woord, een spatie of een symbool.
Wat is een 'embedding' en wat vertegenwoordigt het?	Een lange lijst van getallen die een numerieke definitie of betekenis van een gegeven woord bevat.
Wat is 'contextualization' en wat is het doel ervan?	Het proces waarbij embeddings worden aangepast op basis van omliggende embeddings om de precieze, contextuele betekenis van een woord te bepalen.
Hoe wordt de tekst daadwerkelijk gegenereerd in het model?	De verwerkte embeddings worden naar een output layer gestuurd die waarschijnlijkheden voor elk mogelijk volgende woord produceert, waarbij een mix van waarschijnlijkheid en willekeur wordt gebruikt.
Noem de twee manieren waarop een taalmodel stopt met het genereren van tekst.	Het bereikt de `max tokens` limiet, of het genereert een speciale 'end of sequence token'.
Welke drie stukken informatie bevat de API-respons nadat de tekst is gegenereerd?	De gegenereerde tekst, de 'usage' (aantal input- en output tokens), en de 'stop reason'.
