Text generation demos# LLM demo VLM demo Agentic demo RAG Long Context Structured output LLM Models in Speculative Decoding Pipeline MTP (Multi-Token Prediction) DFlash EAGLE3 Setting Default Generation Parameters LLM on NPU Scaling on multi CPU and GPU Loading models in GGUF