Honest measurement of 1M-token long-context benchmarks (RULER + LongBench v2 + NIAH) on Qwen2.5-7B-1M local vs GitHub Models cloud. All zero credit card, drift-checked, reproducible.
portfolio benchmark transformers llm long-context vllm bitsandbytes qwen github-models qwen2-5 niah consumer-laptop
-
Updated
Aug 17, 2026 - Jupyter Notebook