Text generation demos# LLM demo VLM demo Agentic demo RAG Long Context Structured output LLM Models in Speculative Decoding Pipeline EAGLE3 Fast Draft MTP (Multi-Token Prediction) Setting Default Generation Parameters LLM on NPU Scaling on multi CPU and GPU Loading models in GGUF