Private local AI
Keep sensitive context on consumer hardware and make token economics work.
The local-inference track evaluates models, quantization, caching, speculative decoding, and advanced techniques such as DFlash 2 against useful output, memory, latency, and cost. DFlash 2 is an evaluated candidate, not a claimed Automoat integration or measured Automoat speedup.