French startup Kog is betting that software optimization can dramatically accelerate large language model inference on standard data center GPUs, claiming up to.