Unified Memory, deutsch vereinheitlichter Speicher, ist eine Architektur, die es dem Hauptprozessor eines Computers (CPU) und dem Grafikbeschleuniger (GPU) ermöglicht, einen gemeinsamen Speicherbereich zu nutzen. In einer traditionellen Konfiguration haben CPU und GPU ihre eigenen, physisch getrennten Speicher. Wenn die GPU Daten verarbeiten muss, die der CPU zur Verfügung stehen, müssen diese Daten zunächst aus dem Prozessorspeicher in den Speicher des Grafikbeschleunigers kopiert werden. Dieser Datenübertragungsprozess kann langsam sein und einen Leistungsengpass darstellen, insbesondere bei der Arbeit mit großen Datenmengen, was typisch für das Training von Modellen der künstlichen Intelligenz ist. Der vereinheitlichte Speicher löst dieses Problem, indem er einen einzigen virtuellen Speicherbereich schafft, auf den beide Chips zugreifen können. Das System kümmert sich im Hintergrund automatisch um die Verschiebung der Daten zwischen den physischen Speichern, je nachdem, welcher Prozessor sie gerade benötigt. Für Anwendungen und Programmierer vereinfacht dies die Arbeit, da sie sich nicht um die manuelle Verwaltung und das Kopieren von Daten kümmern müssen, was zu einer Beschleunigung der Berechnungen und einer effizienteren Hardwarenutzung führt.