Qwen3.8-Flash-Next as Cogni-Brain on NVIDIA DGX Spark (GB10): HashK GPU PLE + SGLang NEXTN, 36.8 tok/s code, 100/100 tool-eval, 262K context.
reasoning speculative-decoding sglang agentic-ai tool-calling nvfp4 dgx-spark grace-blackwell sm121 fp8-kv-cache nextn cogni-brain qwen38-flash-next hashk spark-brain
-
Updated
Sep 3, 2026 - Python