DeepSeek hat mit DSpark eine neue Optimierungstechnik vorgestellt, die die Antwortgeschwindigkeit seiner KI-Modelle um 60 bis 85 Prozent pro Nutzer erhöht. Das Verfahren nutzt Speculative Decoding: Ein kleineres Modell schlägt Token-Kandidaten vor, die das große Modell gebündelt überprüft – ein eleganter Trick zur Steigerung der Inferenz-Effizienz. Die Neuerung ist technisch bemerkenswert und unterstreicht DeepSeeks Geschick bei Hardware-Optimierung. Langfristig könnte dies Chinas Abhängigkeit von US-amerikanischen Hochleistungschips weiter verringern und die geopolitische Dynamik in der KI-Industrie verschieben.