TopicsInference OptimizationWhy are output tokens…Short answer·Medium·Asked atAnthropicCognizantOpenAINextNext questionWhat is the KV cache in transformer inference?Flashcard·EasyPrevSkipNext