local-inference 2 Running DeepSeek-V4-Flash at 700 tokens/s on 2x RTX Pro 6000 Jun 20, 2026 Coding locally with Pi Coding agent and open weights models (April 2026 edition) Apr 26, 2026