GPGPUs mit OpenMP
摘要
GPGPUs können als Mehrkernchips innerhalb des Rechenknotens gelesen werden, die ihren eigenen, separaten Speicher und mehrere Kerne hosten, die langsam, aber dennoch extrem leistungsfähig sind. Diese Leistung resultiert aus SIMD in großem Maßstab. Wir geben einen kurzen, sehr abstrakten Überblick über das GPU-Architekturparadigma, bevor wir OpenMP’s target einführen. Die Datenbewegung zwischen Host und Beschleuniger erfordert besondere Aufmerksamkeit, während eine kurze Diskussion über Collectives, Funktionsauslagerung und Strukturen (Klassen) für GPUs die Diskussion abschließt.