Ich stehe vor einer technischen Herausforderung und dachte, Ihr könntet möglicherweise mir helfen oder jemanden kennt, der das kann.
Kurz gesagt, ich arbeite an einem Projekt, das in C++ mit der Eigen-Bibliothek geschrieben wurde. Ich bin daran interessiert, den Code (Matrix-Vektor Multiplikation) mithilfe von BLAS und CUDA auf einer NVIDIA GPU zu beschleunigen. Mein System läuft auf der Intel/oneAPI-Plattform (Basekit 2023.0.0-devel) unter Ubuntu 20.04.
Wäre es möglich, dass du Erfahrungen mit der Integration und Optimierung von C++-Anwendungen in Zusammenhang mit BLAS und CUDA hast? Insbesondere interessiere ich mich für Kenntnisse in:
CPU und GPU Schnittstellen
- 1 Methode SYCL/DPC++
- 2 Methide Eigen und CUDA
- 3 Methode Wrapper/Middleware-Techniken, insbesondere Drop-In und Linker
Wenn Ihr nicht die Zeit oder das spezifische Know-how für dieses Projekt hast, kennst du vielleicht jemanden, der es hat? Jede Hilfe oder Empfehlung wird sehr geschätzt.