Stop adding more GPUs: Weka's new storage platform reduces load by caching 100% of AI model's pre-calculated tokens | AllMind News